学习

OmniCam

OmniCam 是一种基于多模态输入的高级视频生成框架,结合大型语言模型与视频扩散模型,实现高质量、时空一致的视频内容生成。支持文本、视频或图像作为输入,精确控制摄像机运动轨迹,具备帧级操作、复合运动、速度调节等功能。采用三阶段训练策略提升生成效果,并引入 OmniTr 数据集增强模型性能。适用于影视、广告、教育及安防等多个领域,提高视频创作效率与质量。

Copilot Vision

Copilot Vision是一款由微软开发的人工智能辅助工具,专为Microsoft Edge浏览器设计,处于预览阶段。它能够理解网页内容,通过语音交互为用户提供实时分析和见解,帮助用户进行活动规划、购物决策和学习辅助,同时确保用户隐私安全。

Miraa

Miraa 是一款由 Myoland 开发的 AI 驱动语言学习工具,支持多种语言的音频和视频内容转录与实时翻译,帮助用户提升语言理解与表达能力。其“回声法练习”功能通过听、理解、模仿和比较提升口语,同时提供 AI 解释、智能推荐、学习进度跟踪等功能。适用于日常学习、旅行准备、专业提升及教学辅助等场景,适合各类语言学习者使用。

StoryNest.Ai

StoryNest.ai 是一个将个性化的故事讲述与先进的AI技术相结合。凭借其互动功能,用户可以根据自己的喜好制作独特的故事,与 AI 角色进行实时对话,使故事栩栩如生。

Aiva.ai

我们的使命是通过使用 AI 创建个性化配乐来增强个人能力

Lumen5

Lumen5是一个在线视频创建者,允许团队中的任何人快速轻松地创建引人入胜的视频内容。它以人工智能技术为特色,重新利用营销内容,可定制的模板旨在帮助保持品牌,预算和时间,以...

StreamBridge

StreamBridge是一款由苹果与复旦大学联合开发的端侧视频大语言模型框架,支持实时视频流的理解与交互。通过内存缓冲区和轮次衰减压缩策略,实现长上下文处理与主动响应。项目配套发布Stream-IT数据集,包含60万样本,适用于多种视频理解任务,展现出在视频交互、自动驾驶、智能监控等领域的应用前景。

CDial

CDial-GPT是一项由清华大学研发的基于大型中文对话数据集LCCC的预训练对话生成模型。该模型提供LCCC-base和LCCC-large两个版本的数据集,并具备预训练、微调、多模态学习等功能,能够生成高质量的对话回应。其应用场景涵盖客户服务、智能助手、在线教育等多个领域。

AI外教

AI外教是一款利用人工智能技术的虚拟外教口语学习应用,提供个性化的一对一口语练习、实时语法纠错、发音评分及专项备考功能,覆盖雅思、考研、四六级等多种考试题库。此外,它还结合哈佛系统课和CEFR分级体系,帮助用户循序渐进地提高英语口语能力,同时提供翻译、写作辅助等智能工具。 ---