AI项目与工具

SimpleAR

SimpleAR是一款由复旦大学与字节跳动联合研发的纯自回归图像生成模型,采用简洁架构实现高质量图像生成。其通过“预训练-有监督微调-强化学习”三阶段训练方法,提升文本跟随能力与生成效果。支持文本到图像及多模态融合生成,兼容加速技术,推理速度快。适用于创意设计、虚拟场景构建、多模态翻译、AR/VR等多个领域。

Tutor AI

Tutor AI 是一款基于人工智能技术的个性化学习平台,通过智能算法为用户提供定制化学习路径、实时反馈及互动式教学,覆盖多学科领域,旨在提升用户的学习效果和自主学习能力,适用于学术、职业、语言学习及兴趣探索等多种场景。 ---

什么是机器人流程自动化(Robotic Process Automation, RPA)

机器人流程自动化(RPA)是一种通过模拟人类操作实现业务流程自动化的软件技术,主要应用于财务、人力资源、客户服务等领域。其核心技术包括软件机器人和控制中心,能够显著提升效率、减少错误、降低成本。结合人工智能后,RPA还能处理更复杂的认知任务,但需应对系统集成、数据安全及定制化需求等挑战。

Kandinsky

Kandinsky-3是一款基于潜在扩散模型的文本到图像生成框架,支持文本到图像生成、图像修复、图像融合、文本-图像融合、图像变化生成及视频生成等多种功能。其核心优势在于简洁高效的架构设计,能够快速生成高质量图像并提升推理效率。

SOLAMI

SOLAMI是一款基于VR环境的3D角色扮演AI系统,支持用户通过语音和肢体语言与虚拟角色进行沉浸式互动。系统采用社交视觉-语言-行为模型(Social VLA),可识别用户的多模态输入并生成相应响应,涵盖多种角色类型及互动场景,如游戏、舞蹈等。其核心技术涉及多任务预训练和指令微调,适用于虚拟社交、教育、心理治疗及娱乐等多个领域。

Subtitle Edit

Subtitle Edit 是一款免费开源的多功能字幕编辑器,支持超过300种字幕格式。它具备字幕同步、创建、翻译、音频波形可视化、视频播放、AI语音识别、AI自动翻译和OCR技术等功能,适用于影视后期、多语言内容创作、教育培训及辅助听力障碍者等场景。其界面友好,操作简便。

Botify AI

Botify AI是一款基于人工智能的聊天机器人平台,提供高度可定制的数字角色和自然语言交互功能。用户可以通过直观的界面和强大的编辑工具创建和管理聊天机器人,支持多种应用场景,如客户服务、市场营销、教育培训等。平台具备自然语言处理、多媒体内容集成及跨平台兼容性等特点,旨在提升用户体验并优化工作效率。

Drimo

Drimo 是一款面向影视、广告及 AI 视频创作者的智能创作工具,具备剧本生成、剧情构思、角色设定、分镜设计、故事板生成和影片生成等功能。它简化了影视制作流程,降低了专业门槛,适用于创意策划、广告脚本、短片制作及教学视频等多个场景,帮助用户高效完成内容创作。

Agent K v1.0

Agent K v1.0 是一款端到端自主数据科学智能体,由华为诺亚方舟实验室与伦敦大学学院团队联合开发。该工具能够自动化处理数据科学生命周期中的各个环节,支持多模态数据处理,具备动态多步骤问题解决能力,并通过结构化推理和动态记忆管理实现自我学习与优化。Agent K v1.0 在Kaggle多模态挑战赛中表现优异,广泛应用于金融、医疗、零售、制造及客户服务等领域。

Index

Index-AniSora是由哔哩哔哩开发的动漫视频生成模型,支持多种动画风格的生成,涵盖番剧、国创、VTuber等内容。其核心技术包括扩散模型、时空掩码模块和Transformer架构,具备图像到视频生成、帧插值、局部引导等能力。模型提供高质量数据集,适用于动画制作、创意验证、教育及营销等多个领域。