VoiceCraft VoiceCraft是一款开源的神经编解码器语言模型,专攻零样本语音编辑和文本到语音(TTS)任务。它采用Transformer架构,通过token重排过程结合因果掩蔽和延迟叠加技术,实现在现有音频序列内高效生成自然的语音。VoiceCraft在多种口音、风格和噪声条件下表现出色,适用于有声读物制作、视频内容创作、播客音频编辑及多语言内容生产等场景。 AI项目与工具 2024年01月01日 31 点赞 0 评论 347 浏览
LATTE3D LATTE3D 是由英伟达多伦多AI实验室开发的一种高效生成高质量3D对象的模型。它基于文本描述,能在约400毫秒内生成逼真的3D内容。LATTE3D采用摊销优化方法,增强了对新提示的适应能力。该模型支持文本到3D合成、快速生成、高质量渲染及3D风格化功能,适用于多种应用场景。 AI项目与工具 2024年01月01日 41 点赞 0 评论 360 浏览
Transformer Debugger Transformer Debugger (TDB) 是一款由OpenAI的对齐团队开发的工具,用于帮助研究人员和开发者理解和分析Transformer模型的内部结构和行为。它提供了无需编程即可探索模型结构的能力,并具备前向传递干预、组件级分析、自动生成解释、可视化界面及后端支持等功能。TDB 支持多种模型和数据集,包括GPT-2模型及其自动编码器。 AI项目与工具 2024年01月01日 95 点赞 0 评论 222 浏览
Stable Diffusion 3 Stable Diffusion 3 是一款由 Stability AI 开发的先进文本到图像生成模型,通过改进的文本渲染能力、多主题提示支持、可扩展的参数量、图像质量提升及先进的架构技术,实现了高质量和多样性的图像生成。该模型在图像生成和文本理解方面取得了显著进展,并通过 Diffusion Transformer 架构和 Flow Matching 技术提升了模型效率和图像质量。 AI项目与工具 2024年01月01日 87 点赞 0 评论 407 浏览
HiDream.ai HiDream.ai是一家由前京东副总裁梅涛创立的AI初创公司,推出了名为Pixeling千象的多模态AI视觉平台。该平台支持AI图像、视频和3D生成,集成了先进的神经网络和深度学习技术,具备强大的推理和创造性思维能力,能够实现不同模态之间的无缝转换和互操作性,为用户提供丰富的视觉内容创作及高效的生产力解决方案。主要功能包括智能图片生成、视频创意制作、商品图生成、视频风格转换、3D模型生成、智能重 AI项目与工具 2024年01月01日 31 点赞 0 评论 155 浏览
Ai Drawing Generator 一个免费的在线AI图像生成器,它可以将用户提供的文本描述或者简单涂鸦转化为详细的图像。 Ai绘画生成 2025年06月05日 26 点赞 0 评论 342 浏览
Neural.Love neural.love是一个提供免费AI图像生成和AI增强工具的网站。用户可以访问数百万的公共领域图像,用于他们的创意项目,并可以使用AI技术轻松增强图像。 Ai绘画生成 2025年06月05日 47 点赞 0 评论 479 浏览
Etna模型 一个文字转视频的AIGC模型,Etna能够根据简短的文本描述生成相应的视频内容,支持生成时长为8-15秒的视频,且视频流畅度极高,每秒可达60帧。 Ai视频生成 2025年06月05日 28 点赞 0 评论 481 浏览
Lyrics Into Song AI 一个利用AI将文本歌词转换为原创歌曲的在线音乐平台,Lyrics Into Song AI通过分析您的文本,并生成与您的歌词情绪、风格和结构相匹配的音乐,包括完整的歌曲,包括旋律、和声和伴奏。 Ai语音工具 2025年06月05日 47 点赞 0 评论 144 浏览
X Studio X Studio是一款基于最前沿的深度神经网络算法的音乐软件。用户只需输入曲谱,即可让AI歌手在几秒内进行演唱,声线风格各具特色,适合流行、电子、民族、摇滚等作品。 Ai语音工具 2025年06月05日 80 点赞 0 评论 107 浏览