WhisperFusion 一个基于WhisperLive把声音转文字和WhisperSpeech理解这些文字的能力构建。能够与AI聊天机器人进行超低延迟对话。 Ai开源项目 2025年06月05日 42 点赞 0 评论 252 浏览
HOVER HOVER是一款由英伟达研发的1.5M参数量的小型模型,专注于人形机器人复杂动作的控制。其核心功能涵盖多模式控制、运动学位置跟踪、关节角度跟踪及统一命令空间设计,通过策略蒸馏与模拟训练实现高效技能迁移,广泛应用于导航、桌面操作、移动操作及远程操控等场景。 AI项目与工具 2025年06月12日 90 点赞 0 评论 252 浏览
媒小三 媒小三 ,实用的新媒体工具大全,提供各种实用新媒体工具,如:AI配音,视频解析,短视频下载,文案提取,文章改写,标题生成等功能,帮助新媒体人一站式快捷操作。 Ai办公效率 2025年06月05日 46 点赞 0 评论 252 浏览
Transformer Debugger Transformer Debugger (TDB) 是一款由OpenAI的对齐团队开发的工具,用于帮助研究人员和开发者理解和分析Transformer模型的内部结构和行为。它提供了无需编程即可探索模型结构的能力,并具备前向传递干预、组件级分析、自动生成解释、可视化界面及后端支持等功能。TDB 支持多种模型和数据集,包括GPT-2模型及其自动编码器。 AI项目与工具 2024年01月01日 95 点赞 0 评论 252 浏览
Kaiber Kaiber是一个视频生成引擎,用户可以根据自己的图片或文字描述创建视频。它为音乐家提供了Spotify Canvas等功能,为艺术家提供了灵感,为创作者提供了内容,为未来主义者提供了乐... Ai视频生成 1970年01月01日 0 点赞 0 评论 251 浏览
ScribeHow 一款可以自动将用户操作过程生成为可视化的操作指南工具,可通过 Chrome 扩展自动捕获网页和桌面操作流程,生成含截图与说明的指南,支持自定义内容和一键分享。 直播录屏 2025年06月05日 74 点赞 0 评论 251 浏览
Qwen2vl Qwen2VL-Flux 是一款基于多模态图像生成的模型,结合了 Qwen2VL 和 FLUX 技术。它支持多种生成模式,包括变体生成、图像到图像转换、智能修复和 ControlNet 引导生成,并具备深度估计和线条检测功能。该模型提供灵活的注意力机制和高分辨率输出,适用于艺术创作、内容营销、游戏开发等多个领域。 AI项目与工具 2025年06月12日 99 点赞 0 评论 251 浏览