Whisper语音识别模型 Whisper 是一种通用的语音识别模型。它在不同音频的大型数据集上进行训练,也是一个多任务模型,可以执行多语言语音识别以及语音翻译和语言识别。 Ai开源项目 2025年06月05日 90 点赞 0 评论 570 浏览
CF Spark Art CF Spark Art 只需一句文本和点击就可生成 AI 图像。这个 AI 艺术生成器通过单个文本提示和您选择的图像比例生成独特的图像变化。 Ai绘画生成 2025年06月05日 80 点赞 0 评论 570 浏览
FigJam AI FigJam AI,这是一套用于其协作白板服务 FigJam 的新生成式 AI 工具套件,可为常见设计和规划项目创建即用型模板。 思维导图 2025年06月05日 50 点赞 0 评论 570 浏览
ConsisID ConsisID是一款由北京大学和鹏城实验室开发的文本到视频生成工具,其核心技术在于通过频率分解保持视频中人物身份的一致性。该模型具备高质量视频生成能力、无需微调的特点以及强大的可编辑性,同时拥有优秀的泛化性能。其主要功能包括身份保持、高质量视频生成、文本驱动编辑以及跨领域人物处理,广泛应用于个性化娱乐、虚拟主播、影视制作、游戏开发及教育模拟等领域。 AI项目与工具 2025年06月12日 18 点赞 0 评论 569 浏览
MotionCanvas MotionCanvas是一种图像到视频生成工具,能将静态图像转化为动态视频。它提供相机与物体运动的联合控制,支持复杂轨迹设计和局部运动调整,具备3D感知能力,可生成高质量长视频。适用于电影制作、动画创作、VR/AR、游戏开发及教育等多个领域。 AI项目与工具 2025年06月12日 79 点赞 0 评论 569 浏览
Pollinations AI Pollinations 是一个通过AI生成媒体内容的平台。平台可能提供多种类型的模板和工具,支持文本、图像、音频、视频等多媒体格式的创作。 3D&游戏 2025年06月05日 62 点赞 0 评论 569 浏览
拍试卷 拍试卷是一款基于OCR技术的试卷扫描与处理软件,具备高清扫描、手写内容擦除、试卷还原等功能,支持将试卷内容转换为可编辑的文本格式、Word文档或PDF文件,适用于教师备课、学生自学、学术研究及出版行业等多个场景,同时提供图片文字识别、公式识别和PDF扫描识别等特色功能,全面提升工作效率。 AI项目与工具 2025年06月12日 29 点赞 0 评论 569 浏览
MMaDA MMaDA(Multimodal Large Diffusion Language Models)是由普林斯顿大学、清华大学、北京大学和字节跳动联合开发的多模态扩散模型,支持跨文本推理、多模态理解和文本到图像生成等多种功能。其采用统一的扩散架构和模态不可知设计,结合混合长链推理微调策略与UniGRPO强化学习算法,提升跨模态任务性能。MMaDA在多项任务中表现优异,适用于内容创作、教育辅助、智能客 AI项目与工具 2025年06月11日 80 点赞 0 评论 568 浏览
Scispace SciSpace是一款基于人工智能的工具,帮助用户理解和分析科学研究论文。它提供了高亮文本、提问、提取解释和摘要以及进行文献综述等功能。 AI写作对话 1970年01月01日 0 点赞 0 评论 568 浏览