AI项目与工具

Transkriptor

Transkriptor是一款基于AI技术的在线音频和视频转录工具,支持100多种语言,兼容多种文件格式。它提供包括转录、翻译、编辑、多格式导出及AI聊天助手在内的全面功能,旨在满足用户对语音数据处理的需求。其应用场景广泛,如会议记录、教育、法律记录等,可大幅提升工作效率和准确性。

AppFlowy

AppFlowy 是一个开源的笔记和任务管理工具,设计上作为 Notion 的替代品,突出隐私保护。采用 Rust 和 Flutter 技术,支持多平台操作,包括 Windows、Mac、Linux 及移动设备。它允许用户自行托管数据,保障数据安全和隐私。AppFlowy 集成了 AI 功能,如 AI 聊天、内容生成和摘要,提高工作效率。同时,它提供了项目管理工具,如看板、任务列表和数据库视图,支

Tailor

Tailor是一款免费开源的AI视频编辑工具,提供视频编辑、生成和优化三大功能。它能够实现人脸剪辑、语音剪辑、口播生成、字幕生成、色彩生成等功能,并支持背景更换及流畅度和清晰度优化。最新版本增加了语音驱动的口播生成和模型自检修复机制,进一步提升了用户体验。

小猿AI

小猿AI是一款由猿辅导推出的智能教育工具,集成DeepSeek大模型,支持拍照搜题、错题整理、口算练习、作文批改等功能,提供个性化学习方案。平台可跟踪学习进度,智能推荐内容,适用于家庭辅导、课堂教学及自主学习场景,助力学生提升学习效率与成绩。

VideoPainter

VideoPainter是由多所高校及科研机构联合开发的视频修复与编辑框架,采用双分支架构,结合轻量级上下文编码器和扩散模型,实现高效背景保留与前景生成。支持插件式操作,具备长视频对象一致性维持能力,并构建了大规模视频修复数据集,广泛应用于影视、广告、教育等领域。

Lindy

Lindy.ai 是一款用于创建和管理 AI 助手的自动化平台,支持多种应用场景,如日程管理、邮件处理、会议记录和客户支持。用户可通过自然语言指令设置自动化流程,结合事件触发器和多应用集成,提升工作效率。平台具备无代码操作特性,兼容 3000 多个应用程序,适用于销售、营销、客服等多种专业领域。

HMA

HMA(Heterogeneous Masked Autoregression)是一种基于异构预训练和掩码自回归技术的机器人动作视频建模方法,支持离散与连续生成模式,可处理不同动作空间的异构性。该工具具备高效实时交互能力,广泛应用于视频模拟、策略评估、合成数据生成及模仿学习等领域,适用于机器人学习与控制任务,提升策略泛化与执行效率。

Whisper Input

Whisper Input 是一款开源语音输入工具,基于 Python 和 OpenAI Whisper 模型开发,支持多语言语音识别与实时转录。用户可通过快捷键操作录音并生成文本,具备翻译、自动标点、高效处理及本地运行等功能。适用于会议记录、教育、智能交互及媒体制作等多种场景。

星火快答

星火快答是科大讯飞推出的AI智能交互系统,集成了虚拟人、语音识别、大数据分析等功能,适用于展厅、会议、营销等场景。支持多模态交互、知识问答、数据可视化与跨屏联动,提升信息传递效率与用户体验。

ERA

ERA-42是一款由北京星动纪元开发的端到端原生机器人大模型,结合五指灵巧手星动XHAND1,可执行超过100种复杂灵巧操作任务。ERA-42无需预编程,具有快速学习能力,能在短时间内掌握新技能。该模型融合多模态信息,具备强大的跨模态能力和泛化能力,适用于工业自动化、医疗辅助、家庭服务、灾难救援和物流配送等多种场景。