SenseVoice 一款阿里通义实验室发布的FunAudioLLM框架多语言音频基础模型,SenseVoice具有多语种、混合语言、音色和情感控制能力。 Ai语音工具 2025年06月05日 58 点赞 0 评论 759 浏览
Wav2Lip Wav2Lip是一款开源的唇形同步工具,能够将音频文件转换为与口型同步的视频。它支持多种语言,适用于视频编辑、游戏开发和虚拟现实等多个领域。Wav2Lip具备音频驱动口型生成、面部表情同步和多语言支持等功能,采用先进的技术原理,如数据预处理、音频特征提取、口型编码器、音频到口型映射及生成对抗网络(GAN)。该工具提升了电影和视频的后期制作质量,增强了虚拟现实中的交互体验,还用于游戏开发、语言学习和 AI项目与工具 2025年06月12日 80 点赞 0 评论 760 浏览
Typral 一款高效的AI写作浏览器插件,提供多种可以提升用户文本处理体验的功能。Typral能进行文本润色、简化、翻译及AI回复等操作。 AI写作对话 2025年06月05日 19 点赞 0 评论 761 浏览
书生·万象InternVL 2.5 书生·万象InternVL 2.5是一款开源多模态大型语言模型,基于InternVL 2.0升级而来。它涵盖了从1B到78B不同规模的模型,支持多种应用场景,包括图像和视频分析、视觉问答、文档理解和信息检索等。InternVL 2.5在多模态理解基准上表现优异,性能超越部分商业模型,并通过链式思考技术提升多模态推理能力。 AI项目与工具 2025年06月12日 100 点赞 0 评论 761 浏览
E2B E2B 是一款面向 AI 开发者的工具平台,专注于构建自动化云环境,支持多种大型语言模型和 AI 框架。它提供代码解释与执行、沙箱环境、多代理支持等功能,旨在助力开发者高效构建生产级 AI 应用程序,涵盖代码生成、推理和数据分析等领域。 AI项目与工具 2025年06月12日 79 点赞 0 评论 762 浏览
PaddleOCR 2.9 PaddleOCR 2.9 是一个基于深度学习的开源 OCR 工具库,提供了强大的文本识别、版面分析和信息抽取功能。支持多语言识别和多种硬件平台,通过低代码开发模式简化了模型的部署和定制,广泛应用于文档数字化、智能办公、身份验证、物流管理和金融服务等领域。 AI项目与工具 2025年06月12日 56 点赞 0 评论 762 浏览
Fish Speech Fish Speech是一款开源的文本到语音(TTS)工具,支持中文、英文和日文。它通过大约15万小时的多语种数据训练,实现了接近人类水平的语音合成效果。该工具的特点包括低显存需求(仅需4GB)、快速推理速度、高自定义性和灵活性。Fish Speech支持多种语音生成模型,如VITS2、Bert-VITS2等,适用于智能助手、自动客服、语言学习等多个领域。 AI项目与工具 2025年06月12日 14 点赞 0 评论 762 浏览
灵码 IDE 灵码 IDE是通义推出的AI原生IDE,深度适配千问3大模型,集成编程智能体、行间建议预测、行间会话等功能。支持多种编程语言和主流IDE,具备代码生成、续写、注释、单元测试生成、异常排查等能力,可提升开发效率。开发者可通过自然语言描述任务,实现端到端的编码操作,适用于新功能开发、工程级任务及企业数据个性化场景。 AI项目与工具 2025年06月11日 13 点赞 0 评论 762 浏览
Prompt Perfect 一个提示词优化工具,旨在提升大型语言模型和大型模型结果的质量,PromptPerfect 是提示词工程师、内容创建者和 AI 开发人员的理想之选,是您轻松高效地进行提示开发的通行证。 Ai提示指令 2025年06月05日 44 点赞 0 评论 763 浏览