AI项目与工具

句无忧

句无忧是一款专注于违禁词检测的专业工具,提供违禁词、极限词、敏感词的查询与检测服务,支持自定义词库和行业/平台选择,适用于直播电商、短视频文案、广告文案等领域。它通过AI技术实现快速检测,并支持团队协作管理,助力用户高效创作合规文案。

XMusic

XMusic是腾讯多媒体实验室开发的AI作曲框架,支持多模态输入(如图片、文字、视频等)生成情绪、风格、节奏可控的高质量音乐。其核心技术包括多模态解析、符号音乐表示与生成优化,具备商用级音乐生成能力。适用于视频配乐、互动娱乐、音乐教育、辅助创作及音乐治疗等多个场景,有效降低音乐创作门槛,提升创作效率与个性化体验。

TANGOFLUX

TANGOFLUX是一款高效文本到音频生成模型,具备约5.15亿参数量,能够在3.7秒内生成30秒高质量音频。它采用CLAP-Ranked Preference Optimization框架优化音频输出,支持多种应用场景,包括多媒体内容创作、音频制作、播客、教育及虚拟助手开发。其开源特性推动了相关领域的技术进步。

DrivingDojo

DrivingDojo是一个由中国科学院自动化研究所与美团无人车团队合作研发的数据集,包含18,000个视频片段,涵盖全面的驾驶操作、多智能体交互及开放世界驾驶知识。它定义了动作指令跟随(AIF)基准,用于评估世界模型的预测能力,并支持自动驾驶算法开发、世界模型训练、多智能体交互模拟及罕见事件处理等多个应用场景。

SellerPic

SellerPic是一款面向电商卖家的AI图像处理工具,能够将普通产品照片转化为高质量商业图片,优化细节并提升吸引力。支持一键生成多样化的模特图片、背景更换、批量处理及社交媒体适配等功能,有效提升产品展示效果与销售转化率,适用于多平台图片制作与品牌一致性维护。

LMEval

LMEval是谷歌推出的开源框架,用于简化大型语言模型(LLMs)的跨提供商评估。它支持多模态(文本、图像、代码)和多指标评估,兼容Google、OpenAI、Anthropic等主流模型提供商。LMEval基于增量评估引擎,节省时间和计算资源,并通过自加密的SQLite数据库安全存储评估结果。LMEvalboard提供交互式可视化界面,帮助用户分析模型性能并直观比较不同模型的优缺点。

Careerflow

Careerflow 是一款基于AI的求职辅助平台,提供简历优化、求职信撰写、模拟面试及求职跟踪等核心功能,帮助用户提升求职效率和成功率。平台支持多平台集成,适用于各类求职人群,助力职业发展。

Argon

Argon 是一款面向制药与生命科学行业的智能平台,利用AI技术加速药物开发流程。其核心功能包括自然语言处理、多源数据整合、自动化工作流、临床试验优化及竞争情报分析。平台可帮助用户快速获取关键洞察,提升决策效率,并实时追踪行业动态。

塔罗耳语

塔罗耳语是一款将古老的塔罗智慧与现代人工智能技术相结合的在线占卜平台。它提供了丰富的塔罗牌阵和专业的AI解读,帮助用户在爱情、事业、学业等方面获得指导和洞见。此外,它还支持个性化占卜体验,使用户能够更好地探索自我,促进个人成长。

企鹅读伴

企鹅读伴是一款专为中小学生设计的AI阅读辅助工具,依托腾讯混元大模型与元器平台,提供个性化书目推荐、多模式阅读、互动提问、角色扮演及游戏化激励等功能。通过“阅读-思考-创造”闭环设计,提升学生的阅读兴趣与语文核心素养,适用于日常学习、家庭共读、教学辅助及教育资源补充等场景。