学习 - 智狐AI导航

PaddleSpeech

PaddleSpeech是百度飞桨团队开发的开源语音处理工具，涵盖语音识别、语音合成、声纹识别、语音翻译等功能。支持多种接口形式，适用于智能语音助手、语音播报、身份验证等场景。基于PaddlePaddle框架，提供高效的深度学习模型和丰富的音频处理能力，适用于多种实际应用需求。

AI项目与工具 2025年06月12日 87 点赞 0 评论 436 浏览

雷锋网-人工智能

雷锋网leiphone.com人工智能频道

AI写作对话 1970年01月01日 0 点赞 0 评论 436 浏览

HART

HART是一种由麻省理工学院研究团队开发的自回归视觉生成模型，能够生成1024×1024像素的高分辨率图像，质量媲美扩散模型。通过混合Tokenizer技术和轻量级残差扩散模块，HART实现了高效的图像生成，并在多个指标上表现出色，包括重构FID、生成FID以及计算效率。

AI项目与工具 2025年06月12日 93 点赞 0 评论 436 浏览

Magma

Magma是微软研究院开发的多模态AI基础模型，具备理解与执行多模态任务的能力，覆盖数字与物理环境。它融合语言、空间与时间智能，支持从UI导航到机器人操作的复杂任务。基于大规模视觉-语言和动作数据预训练，Magma在零样本和微调设置下表现优异，适用于网页操作、机器人控制、视频理解及智能助手等多个领域。

AI项目与工具 2025年06月12日 100 点赞 0 评论 437 浏览

Stable Video 3D（SV3D）是一款由Stability AI公司开发的多视角合成和3D生成模型，能够从单张图片生成一致的多视角图像，并进一步优化生成高质量的3D网格模型。该模型在视频扩散模型基础上进行改进，提供更好的质量和多视角体验。主要功能包括多视角视频生成、3D网格创建、轨道视频生成、相机路径控制以及新视角合成。SV3D在新视角合成方面取得显著进展，能够生成逼真且一致的视图，提升

AI项目与工具 2024年01月01日 39 点赞 0 评论 437 浏览

AutoTrain

AutoTrain是一款由Hugging Face开发的无代码平台，支持用户通过上传数据快速创建和部署定制化的AI模型。它涵盖多种机器学习任务，如文本分类、图像识别及表格数据分析，并提供自动化的数据预处理、分布式训练、超参数优化等功能，适用于自然语言处理、计算机视觉等多个领域。其核心优势在于简化了模型训练流程，使非技术人员也能高效构建高质量模型。 ---

AI项目与工具 2025年06月12日 30 点赞 0 评论 437 浏览

Kiroku

Kiroku是一款基于多智能体系统的写作辅助工具，通过模拟导师与学生的互动模式，帮助用户高效组织和撰写文档。其支持用户自定义文档结构，并利用自然语言处理和机器学习技术提供个性化建议，特别适用于学术、商业和技术领域的需求。

AI项目与工具 2025年06月12日 44 点赞 0 评论 437 浏览

SVFR

SVFR是一款由腾讯优图实验室与厦门大学联合开发的视频人脸修复框架，能够统一处理视频中的人脸修复、着色和缺失区域补全任务。基于Stable Video Diffusion模型，结合任务嵌入、统一潜在正则化等技术，提升修复精度与时间稳定性。适用于影视后期、网络视频制作及数字档案修复等领域，具有广泛的应用价值。

AI项目与工具 2025年06月12日 81 点赞 0 评论 437 浏览

飞船 Kraft

飞船 Kraft 是一款由快手开发的AI智能对话应用，支持自然语言对话、个性化虚拟角色创建、内容创作辅助等功能。用户可通过飞船 Kraft 进行信息查询、日常生活助手、学习辅助及内容创作等活动。该应用还支持高度定制化和语音交互功能。

AI项目与工具 2025年06月12日 84 点赞 0 评论 438 浏览

Video Diffusion Models

Video Diffusion Models项目展示了扩散模型在视频生成领域的潜力，通过创新的梯度条件方法和自回归扩展技术，生成了具有高度时间连贯性和质量的视频样本。

Ai绘画生成 1970年01月01日 0 点赞 0 评论 438 浏览

学习

首页

学习

列表

默认

浏览次数

发布日期