CosyVoice 2.0 CosyVoice 2.0是一款基于深度学习的语音生成大模型,通过有限标量量化技术和新型架构设计,在发音准确性、音色一致性和韵律表达方面表现出色。其支持流式推理,延迟低至150ms,广泛应用于智能助手、有声读物、视频配音及语言学习等领域,同时具备多语言支持和情感控制等功能。 AI项目与工具 2025年06月12日 10 点赞 0 评论 516 浏览
OpenAudio S1 OpenAudio S1是Fish Audio推出的文本转语音(TTS)模型,基于200万小时音频数据训练,支持13种语言。采用双自回归架构和RLHF技术,生成自然流畅的语音,支持50多种情感和语调标记。具备零样本和少样本语音克隆功能,仅需10到30秒音频即可生成高保真声音。适用于视频配音、播客、游戏角色语音、虚拟助手、游戏娱乐、教育培训及客服系统等场景。提供40亿参数完整版和5亿参数开源版,满足 AI项目与工具 2025年06月11日 28 点赞 0 评论 515 浏览
OmniThink OmniThink是由浙江大学与阿里巴巴通义实验室联合开发的机器写作框架,通过模拟人类学习和反思机制,提升文章的知识密度与深度。支持多种语言模型,具备信息树与概念池结构化管理功能,适用于学术写作、新闻报道、教育内容创作等多个领域,有效提高生成内容的质量与多样性。 AI项目与工具 2025年06月12日 10 点赞 0 评论 514 浏览
DuoAttention DuoAttention是由MIT韩松团队提出的新型框架,通过区分“检索头”和“流式头”两种注意力机制,显著提升了大型语言模型在处理长上下文时的推理效率。该框架有效减少了内存占用,加速了解码和预填充过程,并保持了模型的准确性。它适用于多轮对话、长文档处理、学术研究以及内容推荐等多个领域。 AI项目与工具 2025年06月12日 58 点赞 0 评论 512 浏览
爱派 AiPy 是一款基于大语言模型与 Python 深度整合的 AI 工具,支持自然语言生成代码、数据处理与分析、可视化、API 调用、任务自动化等功能。具备本地部署能力,保障数据安全,适用于开发、数据分析、自动化任务等场景。用户可通过自然语言或直接输入代码进行交互,支持多种操作系统与环境配置,提升编程效率与灵活性。 AI项目与工具 2025年06月11日 59 点赞 0 评论 512 浏览
MagicPath MagicPath 是一款基于 AI 的无限画布设计工具,用户可通过自然语言与 AI 对话,快速生成和编辑设计组件,无需手动操作。它支持描述愿景、轻松定制和即时组件等功能,帮助设计师和创意工作者快速实现创意,生成高质量的设计原型。MagicPath 适合需要快速生成设计原型、进行创意探索或简化设计流程的用户,尤其是没有专业设计或编程背景的人。 AI项目与工具 2025年06月11日 33 点赞 0 评论 510 浏览
Excelmatic AI 一款 AI 驱动的 Excel 数据分析与可视化工具,支持上传.xlsx和.xls文件,用户可通过自然语言处理直接提问,快速获取自动生成的图表、数据洞察,实现数据清理、公式自动化等功能。 Ai办公效率 2025年06月05日 41 点赞 0 评论 508 浏览
G3D.AI {Jedi} G3D.AI 是一家开发用于游戏创作的人工智能 (AI) 工具的公司。它旨在通过使用自然语言提示,使游戏创作者能够在很短的时间内构建出精美、新颖的游戏。 3D&游戏 2025年06月05日 72 点赞 0 评论 507 浏览
ViLAMP ViLAMP是由蚂蚁集团与中国人民大学联合开发的视觉语言模型,专为高效处理长视频设计。采用混合精度策略,支持在单张A100 GPU上处理长达3小时的视频,提升处理效率并降低计算成本。具备长视频理解、关键信息提取、多任务处理等功能,适用于教育、监控、直播、影视制作及智能客服等场景。技术上通过差分关键帧选择与特征合并优化性能,实现精准且高效的视频分析。 AI项目与工具 2025年06月11日 37 点赞 0 评论 507 浏览