Reverb ASR Reverb ASR是一款基于深度学习的开源自动语音识别与说话人分离工具,采用20万小时高质量英语语音数据训练,具备高精度语音转录能力,支持逐字稿控制及多种解码模式。其显著特点是擅长处理长时间语音内容,并在长篇幅识别任务中超越其他开源模型。Reverb ASR适用于播客、会议记录、法庭记录等多个应用场景,为用户提供灵活且高效的语音转文字解决方案。 AI项目与工具 2025年06月12日 55 点赞 0 评论 394 浏览
PanoDreamer PanoDreamer是一款基于单张图像生成连贯360° 3D场景的AI工具。其核心技术包括将全景图像生成与深度估计转化为优化任务,并引入交替最小化策略,确保场景的一致性和完整性。该工具支持全景图像及深度信息生成,可应用于虚拟现实、游戏开发、内容创作等多个领域,展现出卓越的性能表现。 AI项目与工具 2025年06月12日 83 点赞 0 评论 393 浏览
AwesomeGPTs AwesomeGPTs是一个OpenAI GPTs的目录和搜索引擎,提供了9000多个自定义GPT模型,并不断增长。 GPTs应用 2025年06月05日 59 点赞 0 评论 391 浏览
Flair.ai Flair.ai是一款基于AI技术的在线设计工具,旨在帮助用户高效创建高质量的产品摄影图。它提供拖放式界面、实时协作功能及强大的场景构建能力,尤其擅长处理时尚领域的服装和珠宝摄影需求。用户还能通过自有数据训练私有AI模型,实现个性化创作。主要面向电商、广告营销、时尚设计等领域,助力提升视觉内容质量。 AI项目与工具 2025年06月12日 11 点赞 0 评论 391 浏览
WorldDreamer WorldDreamer 是一种基于 Transformer 的通用世界模型,具备理解与预测物理世界动态变化的能力,专注于视频生成任务。它支持多种应用场景,包括文本到视频、图像到视频、视频编辑和动作序列生成,利用视觉 Token 化、Transformer 架构和多模态提示技术,实现了高效且高质量的视频生成。 AI项目与工具 2025年06月12日 16 点赞 0 评论 389 浏览
AnyDoor Anydoor 提供了一个平台,让用户能够创造和体验个性化的 AI 世界。通过定制化的场景和交互设计,用户可以探索和享受独特的人工智能体验。 创作工具 1970年01月01日 0 点赞 0 评论 385 浏览
达闼RobotGPT多模态大模型 达闼RobotGPT多模态大模型是一个创新的AI工具,它通过整合多模态数据处理能力,为机器人在多样化的应用场景中提供了强大的交互和行为生成能力。 创作工具 1970年01月01日 0 点赞 0 评论 384 浏览
天书AI 天书AI是一款面向企业的AI智能助手集成平台,基于深度学习与自然语言处理技术,支持自定义知识库和精准场景训练。其功能涵盖自主学习、角色个性化及服务定制化,适用于客户服务、企业内部知识管理、教育培训等多个场景,帮助企业实现高效智能化运营。 AI项目与工具 2025年06月12日 50 点赞 0 评论 384 浏览