TEN VAD TEN VAD是一款高性能的实时语音活动检测系统,专为企业级应用设计。它基于深度学习技术,能够精确区分语音和非语音信号,具有低延迟、轻量级和高精度的特点。支持多种平台和编程接口,适用于智能助手、客服机器人等场景,帮助构建更高效、更智能的对话系统。 AI项目与工具 2025年06月11日 47 点赞 0 评论 341 浏览
LTXV LTXV-13B 是 Lightricks 推出的开源 AI 视频生成模型,拥有 130 亿参数,可在消费级显卡上高效运行,生成速度比同类产品快 30 倍。支持文本、图像转视频及多关键帧调节,具备多尺度渲染和高压缩率技术,适用于影视、广告、游戏、教育等多个领域,提升内容创作效率与质量。 AI项目与工具 2025年06月11日 18 点赞 0 评论 492 浏览
TrackVLA TrackVLA是银河通用推出的端到端导航大模型,具备纯视觉环境感知、语言指令驱动、自主推理和零样本泛化能力。它能在复杂环境中自主导航、灵活避障,并根据自然语言指令识别和跟踪目标对象。无需提前建图,适用于多种场景,如陪伴服务、安防巡逻、物流配送等,为具身智能商业化提供支撑,推动机器人走向日常生活。 AI项目与工具 2025年06月11日 79 点赞 0 评论 468 浏览
AI Ease AI Ease是一款基于人工智能的在线照片编辑工具,提供背景移除、水印消除、图像生成、艺术风格转换、肖像美化等多种功能。支持移动设备使用,操作简便,适用于电商、社交媒体、个人美化及创意设计等场景。提供免费与专业订阅方案,保障用户数据安全。 AI项目与工具 2025年06月11日 44 点赞 0 评论 247 浏览
破壳AI口语 破壳AI口语是一款基于AI技术的英语口语学习工具,涵盖生活、校园、旅游、职场等多场景对话,帮助用户提升流利度、语法和发音。支持雅思口语模考打分、实时纠错、地道表达润色等功能,用户可与多样虚拟角色互动,增强学习趣味性。适用于日常交流、留学、职场、旅游及考试备考等场景,助力用户高效提升英语口语能力。 AI项目与工具 2025年06月11日 97 点赞 0 评论 421 浏览
DeepEyes DeepEyes是由小红书团队和西安交通大学联合开发的多模态深度思考模型,基于端到端强化学习实现“用图思考”能力,无需依赖监督微调。它在推理过程中动态调用图像工具,增强对细节的感知与理解,在视觉推理基准测试V* Bench上准确率高达90.1%。具备图像定位、幻觉缓解、多模态推理和动态工具调用等功能,适用于教育、医疗、交通、安防和工业等多个领域。 AI项目与工具 2025年06月11日 21 点赞 0 评论 130 浏览
BILIVE BILIVE 是一款面向 B 站直播的 AI 工具,支持自动录制、弹幕渲染、语音识别、片段切片、封面生成及自动投稿。兼容低配置设备,无需 GPU,适合个人及小型团队使用,提升直播内容制作效率。 AI项目与工具 2025年06月11日 33 点赞 0 评论 173 浏览
Fay Fay 是一个基于AI技术的营养咨询平台,连接用户与专业营养师,提供个性化饮食计划、健康管理及慢性病支持。平台支持线上与线下咨询,具备智能匹配、保险报销处理、日程管理、报告生成等功能,提升服务效率与用户体验。适用于减肥、慢性病、儿科及肿瘤护理等多个领域。 AI项目与工具 2025年06月11日 55 点赞 0 评论 458 浏览
从容大模型 从容大模型是云从科技推出的多模态AI模型,在国际评测中表现优异,具备视觉语言理解与推理能力。其核心技术包括多模态对齐、高效工程优化和原生多模态推理,支持复杂场景下的文本识别和开放域问答。该模型在医学健康、金融、制造、政务等多个领域实现规模化应用,助力智能化转型。 AI项目与工具 2025年06月11日 21 点赞 0 评论 485 浏览
WaveSpeedAI WaveSpeedAI 是一款集图像与视频生成于一体的 AI 平台,提供多个高性能模型,支持高质量图像生成、个性化风格定制及视频内容创作。平台具备超快速生成能力,适用于创意设计、广告制作和视频内容生产等领域,提供易用接口和企业级部署选项。 AI项目与工具 2025年06月11日 40 点赞 0 评论 273 浏览