Veo Veo是Google DeepMind开发的一款视频生成模型,用户可以通过文本、图像或视频提示来指导其生成所需的视频内容。Veo具备深入的自然语言理解能力,能够准确解析用户的文本提示,生成高质量、高分辨率的视频。其主要功能包括高分辨率视频输出、自然语言处理、风格适应性、创意控制与定制、遮罩编辑功能、参考图像与风格应用、视频片段的剪辑与扩展以及视觉连贯性。Veo技术目前仍处于实验阶段,但已在电影制作 AI项目与工具 2024年01月01日 34 点赞 0 评论 437 浏览
Recall Recall是一款AI知识管理工具,支持将分散的内容转化为自我组织的知识库,具备即时总结、聊天互动功能,可处理YouTube视频、PDF、文章等多种格式内容。它提供增强浏览体验,自动链接相关内容到知识图谱中,帮助用户发现关联信息。Recall支持离线使用,跨平台访问,并注重数据安全与隐私保护,用户可随时导出数据,确保数据所有权。 AI项目与工具 2025年06月11日 50 点赞 0 评论 437 浏览
Vidu 1.5 Vidu 1.5是一款基于多模态视频大模型的AI生成工具,支持参考生视频、图生视频和文生视频生成,通过精准的语义理解能力,在30秒内完成高质量视频创作,适用于影视、动漫、广告等多行业场景,助力创作者高效产出多样化内容。 AI项目与工具 2025年06月12日 80 点赞 0 评论 437 浏览
Style Art AI Style Art AI 是一款基于 AI 技术的图像创作工具,结合 ChatGPT 4o 模型与多种艺术风格,可将文字描述或图片快速转换为不同风格的艺术作品。用户只需输入文本或上传图片,设置参数即可生成高质量图像。支持 30 多种风格,包括经典动画、迪士尼、皮克斯等,并提供风格混合、细节优化等功能,适合初学者和专业设计师使用。 AI项目与工具 2025年06月11日 16 点赞 0 评论 437 浏览
ViLAMP ViLAMP是由蚂蚁集团与中国人民大学联合开发的视觉语言模型,专为高效处理长视频设计。采用混合精度策略,支持在单张A100 GPU上处理长达3小时的视频,提升处理效率并降低计算成本。具备长视频理解、关键信息提取、多任务处理等功能,适用于教育、监控、直播、影视制作及智能客服等场景。技术上通过差分关键帧选择与特征合并优化性能,实现精准且高效的视频分析。 AI项目与工具 2025年06月11日 37 点赞 0 评论 438 浏览
MMAudio MMAudio是一款基于多模态联合训练的音频合成工具,通过深度学习技术实现视频到音频、文本到音频的精准转换。它具备强大的同步模块,确保生成的音频与视频帧或文本描述时间轴完全对应,适用于影视制作、游戏开发、虚拟现实等多种场景,极大提升了跨模态数据处理的能力和应用效率。 AI项目与工具 2025年06月12日 68 点赞 0 评论 439 浏览
夸克浏览器AI助手 一个功能强大的浏览器插件。支持多种浏览器,包括Chrome、Edge等,它不仅能通过AI搜索快速提供精准答案,还能辅助写作、生成PPT框架,甚至帮助学习,支持拍题讲解。 Ai办公效率 2025年06月05日 27 点赞 0 评论 440 浏览
AI外贸员Zoe 百型智能推出的国内首个专注于外贸行业的垂直智能Agent,能够根据企业的目标,智能拆解任务并独立完成外贸开发的全链路工作。 电商运营 2025年06月05日 53 点赞 0 评论 440 浏览
SmolVLA SmolVLA是Hugging Face开源的轻量级视觉-语言-行动(VLA)模型,专为经济高效的机器人设计。拥有4.5亿参数,可在CPU上运行,单个消费级GPU即可训练,适合在MacBook上部署。它能够处理多模态输入,生成动作序列,并通过异步推理提高控制效率。适用于物体抓取、家务劳动、货物搬运和机器人教育等场景。 AI项目与工具 2025年06月11日 34 点赞 0 评论 440 浏览