InfiniteYou InfiniteYou 是由字节跳动推出的基于扩散变换器的身份保持图像生成框架,通过 InfuseNet 注入身份特征,确保生成图像与输入图像的高度相似。结合多阶段训练策略,提升文本与图像对齐、图像质量和美学效果。支持插件化设计,兼容多种工具,适用于社交媒体、影视制作、广告营销等多个领域。 AI项目与工具 2025年06月12日 79 点赞 0 评论 307 浏览
Fast3R Fast3R是一种基于Transformer架构的高效多视图3D重建方法,可在单次前向传播中处理上千张图像,大幅提高重建效率并减少误差累积。支持多视图并行处理,具备高精度、强可扩展性和快速推理能力,适用于机器人视觉、增强现实、虚拟现实、文化遗产保护及自动驾驶等多个场景。 AI项目与工具 2025年06月12日 86 点赞 0 评论 308 浏览
MobileLLM MobileLLM是一款针对移动设备优化的大型语言模型,具有语言理解与生成、零样本常识推理、聊天交互、API调用、文本重写与摘要生成以及数学问题解决等功能。它通过深度薄型架构、SwiGLU激活函数、嵌入共享和分组查询注意力机制等技术,在低参数环境下实现高效性能,适用于移动聊天、语音助手、内容推荐、教育辅助和移动搜索等多种应用场景。 AI项目与工具 2025年06月12日 52 点赞 0 评论 308 浏览
智谱CoCo 智谱CoCo是智谱AICO平台推出的首个企业级超级助手Agent,具备交付导向、记忆机制和无缝嵌入三大特性。它能全流程辅助工作,根据员工职能和需求主动服务,无缝接入企业资源,提供个性化服务。支持多种对话方式,包括快思考、慢思考和页面唤起,适用于政务、企业、个人助理、教育与培训、金融与医疗等多个场景,提升工作效率和用户体验。 AI项目与工具 2025年06月11日 61 点赞 0 评论 308 浏览
Open Open-Sora是一个开源视频生成模型,基于DiT架构,通过三个阶段的训练(大规模图像预训练、大规模视频预训练和高质量视频数据微调),生成与文本描述相符的视频内容。该模型包括预训练的VAE、文本编码器和STDiT(Spatial-Temporal Diffusion Transformer)核心组件,利用空间-时间注意力机制和交叉注意力模块实现视频生成。项目旨在提供全面的视频生成模型训练过程,供 AI项目与工具 2024年01月01日 97 点赞 0 评论 308 浏览
Pippit Pippit是字节跳动旗下CapCut推出的AI内容创作平台,支持电商、社交媒体和品牌推广场景。用户可通过输入链接或脚本快速生成视频、图片等内容,支持多语言及批量处理。平台提供丰富素材库、AI数字人视频、智能剪辑等功能,并支持一键发布至多个平台。内置数据分析工具,助力内容优化,适合各类创作者和企业提升营销效率。 AI项目与工具 2025年06月11日 78 点赞 0 评论 308 浏览
HART HART是一种由麻省理工学院研究团队开发的自回归视觉生成模型,能够生成1024×1024像素的高分辨率图像,质量媲美扩散模型。通过混合Tokenizer技术和轻量级残差扩散模块,HART实现了高效的图像生成,并在多个指标上表现出色,包括重构FID、生成FID以及计算效率。 AI项目与工具 2025年06月12日 93 点赞 0 评论 308 浏览
AiPathly AiPathly是一款面向希望进入AI领域的专业人士的综合性平台,提供个性化技能评估、定制学习路径、职业匹配报告及实时行业洞察等功能。用户可通过模拟项目积累实践经验,并借助简历和作品集优化服务提升求职竞争力。无论是职业转型者、技能提升者还是学生群体,均可借助AiPathly实现高效成长与成功转型。 AI项目与工具 2025年06月12日 97 点赞 0 评论 309 浏览
aiApply aiApply 是一款基于人工智能技术的求职平台,主要功能包括 AI 驱动的简历生成器、个性化求职信撰写工具、自动申请功能及面试准备模块。它旨在帮助求职者高效地创建高质量的申请材料,提升求职成功率,适用于应届毕业生、职业转换者及忙碌的职场人士等各类人群。 AI项目与工具 2025年06月12日 79 点赞 0 评论 309 浏览
Pinch Pinch 是一款基于 AI 的实时语音翻译视频会议平台,支持超过 30 种语言,提供口译和同声传译两种模式,满足多样化的沟通需求。其核心优势在于无需字幕即可实现自然流畅的语音翻译,具备低延迟和文化敏感性处理能力,适用于国际商务、教育、家庭沟通及客户服务等场景。 AI项目与工具 2025年06月12日 90 点赞 0 评论 309 浏览