AgiBot World AgiBot World是一个由智元机器人开发的百万真机数据集,专注于具身智能技术的研究。它涵盖了80多种日常生活技能,涉及家居、餐饮、工业、商超及办公五大场景,数据规模和质量均领先于谷歌的Open X-Embodiment。数据采集利用了智元自建的工厂和实验基地,通过8个摄像头和6自由度灵巧手等先进硬件,确保了全域真实场景下的高质量数据获取。项目还计划开源仿真数据、发布具身基座大模型及配套工具链 AI项目与工具 2025年06月12日 10 点赞 0 评论 403 浏览
LAM LAM是由微软开发的大型行动模型,能够理解和执行真实世界中的操作任务。它不仅能解析用户输入,还能生成具体行动指令,如启动程序或控制设备。LAM在Office等Windows应用中表现出色,任务完成率高于GPT-4。具备多模态输入理解、动态规划、环境交互和自主执行能力,适用于办公自动化、智能家居、客户服务等多个场景,显著提升任务执行效率和智能化水平。 AI项目与工具 2025年06月12日 26 点赞 0 评论 394 浏览
小布助手 小布助手是OPPO推出的智能语音助手,支持语音交互、联网搜索、深度思考和多格式导出等功能。其网页版接入DeepSeek-R1技术,提升信息处理能力,适合日常查询、学习辅助及工作场景。支持多语言模式、语音风格选择及自定义唤醒词,满足个性化需求,适用于手机与网页端无缝衔接的使用体验。 AI项目与工具 2025年06月11日 30 点赞 0 评论 390 浏览
MoshiVis MoshiVis是一款由Kyutai开发的开源多模态语音模型,支持图像与语音的自然交互。它基于Moshi 7B架构,集成了视觉编码器和跨注意力机制,实现低延迟、自然流畅的对话体验。支持多种后端部署,适用于无障碍应用、智能家居、教育及工业场景,提升人机交互的智能化水平。 AI项目与工具 2025年06月12日 72 点赞 0 评论 370 浏览
Realtime API Realtime API是一款由OpenAI研发的低延迟、多模态对话式API,支持文本与音频输入输出,具备实时语音处理、自然语音合成及多模态交互等功能。通过WebSocket协议实现持久连接,支持事件驱动的交互模式,适用于客户服务、语言学习、游戏娱乐等多种应用场景。 AI项目与工具 2025年06月12日 41 点赞 0 评论 368 浏览
美间AI创意商拍 电商模板图片商拍一站式设计平台,涵盖电商模板,电商设计素材,电商图片大全等,帮助设计师们实现10秒搞定所有电商物料,更高效,更智能! Ai绘画生成 2025年06月05日 31 点赞 0 评论 365 浏览
Text to Bark Text to Bark 是由 ElevenLabs 推出的全球首个 AI 狗语文本转语音模型,能将文字转化为高度逼真的狗吠声,支持多种犬种选择和语气调整。技术基于深度学习和犬类语言学研究,适用于宠物训练、科研、娱乐及家庭互动等多种场景,具备良好的可扩展性和实用性。 AI项目与工具 2025年06月12日 47 点赞 0 评论 362 浏览
Collov Ai collov.ai是一个室内设计AI生成器,通过使用人工智能将您的室内愿望转化为令人惊叹的、富有远见的室内设计效果图,将便利性与美学融为一体。 Ai绘画生成 2025年06月05日 69 点赞 0 评论 349 浏览