实时

Pipecat

Pipecat是一款开源Python框架,用于构建语音和多模态对话系统。它整合了语音识别、文本转语音及对话处理功能,支持与主流AI平台集成,采用模块化管道架构,提升开发效率。基于帧的实时处理机制确保流畅交互,适用于语音助手、企业服务、教育、医疗及多模态应用等多种场景。

逗逗

逗逗是心影随形(上海)技术有限公司开发的AI游戏伙伴,它通过语音互动、情绪陪伴、智能攻略、笑话分享和多角色扮演,为玩家提供个性化和有趣的游戏体验。

Praktika Ai

Praktika Ai是一款沉浸式语言学习应用,利用生成式人工智能头像为用户提供独特而真实的学习体验。它专注于教授英语,并提供广泛的课程和练习主题。

Wanderboat

Wanderboat是一款基于GPT-4的智能旅行规划工具,通过对话式AI为用户提供个性化行程推荐。它整合了景点、美食、活动等多维度信息,提供多媒体展示和实时问答功能,适用于各类旅行场景,帮助用户高效规划和管理旅行计划。

Multiverse

Multiverse是由Enigma Labs开发的全球首个基于AI生成的多人游戏模型,支持实时交互与动态世界生成,确保玩家视角一致。其核心技术包括联合动作向量和双视角通道堆叠,有效解决多人游戏中的同步难题。模型训练成本低,可在普通PC上运行,且项目全面开源,适用于多人游戏开发、VR/AR、AI训练、教育等多个领域。

CleanS2S

CleanS2S是一款流式语音到语音交互智能体原型,通过集成自动语音识别(ASR)、大型语言模型(LLM)、文本到语音(TTS)以及WebSockets等技术,提供高质量、实时的语音交互体验。它支持全双工交互和打断功能,可整合网络搜索和RAG模型以增强回答能力,适用于客户服务、智能家居控制、教育辅助、健康咨询及车载系统等多个领域。

Director

Director是一款基于VideoDB的视频智能处理框架,利用自然语言指令实现视频搜索、编辑、合成及生成等功能,同时支持实时流式传输。它提供了聊天式用户界面和预构建的视频代理,便于开发者和创作者快速构建定制化解决方案。此外,Director适用于视频内容管理、编辑、创作以及教育等多个领域,为企业和内容生产者提升工作效率。

interface.ai

interface.ai 是一款面向金融领域的AI解决方案平台,其核心产品 Sphere 提供多模态交互支持,涵盖文本、图像、音频及视频。Sphere 可自动化处理金融业务流程,实时分析对话内容,并为用户提供个性化产品推荐和升级销售建议,从而提升用户体验和机构运营效率。

Aime

AInvest平台上的一款AI财务助手,提供实时市场数据、股票筛选和分析工具。 增强您的投资策略。

Moffee

Moffee是一款开源的Markdown转PPT工具,允许用户通过Markdown语法高效地创建专业的幻灯片。该工具具备自动化布局功能,能够智能处理幻灯片的布局、分页和样式,同时支持实时预览和导出为PDF或HTML格式。Moffee支持多种内置主题,使得用户可以根据需要选择合适的样式,适合普通用户和开发者使用。