SmolVLM SmolVLM是一款由Hugging Face开发的轻量级视觉语言模型,专为设备端推理设计。该模型具有三个版本,包括SmolVLM-Base、SmolVLM-Synthetic和SmolVLM-Instruct,分别适用于不同的应用场景。SmolVLM借鉴了Idefics3的理念,采用SmolLM2 1.7B作为语言主干,并通过像素混洗技术提升视觉信息的压缩效率。其训练数据集包括Cauldron和 AI项目与工具 2025年06月12日 62 点赞 0 评论 258 浏览
Sonauto AI 一款AI音乐生成器,允许用户通过将文本提示、歌词或旋律转换为完整的不同风格的歌曲。它采用了潜在扩散模型,这使得它与其他人工智能音乐生成模型相比更加可控。 Ai语音工具 2025年06月05日 94 点赞 0 评论 257 浏览
Gendo Gendo是一款结合生成式AI技术的建筑可视化平台,通过生成对抗网络(GANs)和扩散模型等手段,帮助设计师快速创建逼真的建筑概念图,并支持从草图到最终图像的全周期操作,具备生成性编辑、风格迁移和文本到图像生成等功能,旨在提升设计效率与视觉沟通质量。 AI项目与工具 2025年06月12日 34 点赞 0 评论 257 浏览
MDM Matryoshka Diffusion Models (MDM) 是一种由苹果公司开发的新型扩散模型框架,通过嵌套UNet架构实现多分辨率联合去噪,支持从低分辨率到高分辨率的渐进式训练,显著提升高分辨率图像生成效率,适用于多种应用场景,如数字艺术创作、游戏开发、电影制作等,并具备出色的零样本泛化能力。 AI项目与工具 2025年06月12日 28 点赞 0 评论 256 浏览
Duck AI DuckDuckGo推出的免费、匿名AI聊天机器人,用户可以放心享受先进的AI聊天服务,不用担心隐私泄露问题 。 AI搜索问答 2025年06月05日 48 点赞 0 评论 256 浏览
腾讯混元T1 T1(Thinker)是腾讯混元推出的深度思考模型,支持逻辑推理与联网搜索,具备高速响应和长文本处理能力。采用Hybrid-Mamba-Transformer架构,提升推理效率与准确性。适用于教育、医疗、市场分析等多个领域,输出简洁、幻觉低,适合复杂指令处理和多任务场景。 AI项目与工具 2025年06月12日 68 点赞 0 评论 256 浏览
Aria Aria是首个开源多模态原生混合专家(MoE)模型,支持文本、代码、图像和视频的综合处理,具有强大的多模态任务处理能力和长上下文窗口,可高效应对复杂长数据。模型开源且可扩展,适用于多模态AI领域的研究与应用。 AI项目与工具 2025年06月12日 48 点赞 0 评论 255 浏览
360AI助手 360AI助手是一款由360集团联合15家国内顶尖AI大模型厂商推出的创新型AI产品,集成了包括Kimi、智谱AI、豆包、商汤科技、讯飞星火、文心一言和通义千问等多个AI大模型。无需安装插件,用户即可在360的产品中直接享受AI服务。其主要功能包括多模型集成、结果对比验证、智能意图识别、一站式AI办公解决方案等,适用于学生、教师、办公人员、程序员和内容创作者等多种人群。 AI项目与工具 2025年06月12日 98 点赞 0 评论 255 浏览
OmniHuman OmniHuman是字节跳动推出的多模态人类视频生成框架,基于单张图像和运动信号生成高逼真视频。支持音频、姿势及组合驱动,适用于多种图像比例和风格。采用混合训练策略和扩散变换器架构,提升生成效果与稳定性,广泛应用于影视、游戏、教育、广告等领域。 AI项目与工具 2025年06月12日 43 点赞 0 评论 255 浏览