AI项目与工具

LanPaint

LanPaint 是一款基于 Stable Diffusion 的高质量图像修复工具,无需额外训练即可实现精准修复。通过多轮迭代推理优化修复效果,支持多种参数调整,适用于图像修复、内容替换及艺术创作等多种场景,操作简便且效果自然。

deckrobot

DeckRobot 是一款基于AI技术的PPT生成工具,可快速创建符合品牌形象的高质量演示文稿。支持智能设计、内容生成、自动排版及品牌合规功能,适用于商务、教育、营销等多种场景,提升制作效率与专业性。

MetaMorph

MetaMorph是一款基于多模态大模型的工具,通过Visual-Predictive Instruction Tuning(VPiT)技术实现文本和视觉token的生成。它在视觉理解和生成领域表现优异,能够克服其他生成模型的常见失败模式,同时有效处理专业术语和复杂语义问题。MetaMorph展示了统一建模方法的优势,支持多模态数据的高效处理,并在视觉生成与理解基准测试中取得竞争力表现。

360AI助手

360AI助手是一款由360集团联合15家国内顶尖AI大模型厂商推出的创新型AI产品,集成了包括Kimi、智谱AI、豆包、商汤科技、讯飞星火、文心一言和通义千问等多个AI大模型。无需安装插件,用户即可在360的产品中直接享受AI服务。其主要功能包括多模型集成、结果对比验证、智能意图识别、一站式AI办公解决方案等,适用于学生、教师、办公人员、程序员和内容创作者等多种人群。

FunAudioLLM

FunAudioLLM是由阿里巴巴通义实验室开发的开源语音大模型项目,包含SenseVoice和CosyVoice两个子模型。SenseVoice擅长多语言语音识别和情感辨识,支持超过50种语言;CosyVoice则专注于自然语音生成,支持多种语言、音色和情感控制。该项目适用于多语言翻译、情感语音对话等场景,其相关模型和代码已公开发布。

LIMO

LIMO是由上海交通大学研发的一种高效推理方法,通过少量高质量训练样本激活大语言模型的复杂推理能力。其核心假设是“少即是多推理假设”,即在预训练阶段已具备丰富知识的模型中,复杂推理能力可通过精心设计的样本被有效激发。LIMO在多个数学推理基准测试中表现优异,且数据使用效率极高,仅需1%的数据即可达到显著效果。适用于教育、科研、工业和医疗等多个领域。

Open Avatar Chat

Open Avatar Chat是阿里开源的模块化实时数字人对话系统,支持低延迟交互与多模态输入输出。系统采用模块化架构,允许灵活配置语音识别、语言模型和语音合成等组件,兼容本地与云服务。支持2D/3D数字人渲染,适用于客户服务、教育、娱乐及企业应用等多个场景,为开发者提供高效、灵活的AI对话解决方案。

SOCIALDUDE

SOCIALDUDE是一款基于AI技术的社交媒体内容创作平台,具备AI驱动的内容生成、品牌一致性维护及多平台适配等功能。它能够快速生成多样化的内容形式,如推文、视频脚本等,并支持用户根据目标受众需求定制个性化内容。此外,该平台还适用于品牌营销、个人品牌建设、小型企业运营等多个场景,旨在提升内容创作效率与传播效果。

NovaMSS

NovaMSS是一款基于AI技术的音乐源分离工具,可精准分离人声、伴奏、贝斯、鼓点等音轨。支持多种音频格式和批量处理,操作简便,适用于音乐制作、音频修复及教学资源开发等多种场景。提供普通与专业模型,满足不同用户的音质需求,适合创作者和音乐爱好者使用。

Oumi

Oumi 是一个开源 AI 平台,支持从数据准备到模型部署的全流程开发。它提供零样板代码体验,支持多种训练方法和多模态模型,适用于自动驾驶、人机交互、学术研究等多个场景。平台具备高效的分布式训练能力和灵活的部署选项,适合企业和研究机构使用。