AI项目与工具

A2A

A2A是谷歌推出的首个智能体交互协议，旨在实现不同框架和供应商构建的AI智能体之间的高效协作。它支持多模态交互、长期任务管理和实时反馈，基于HTTP、JSON-RPC等标准设计，便于与现有系统集成。A2A具备安全性、可扩展性和用户体验协商能力，适用于企业流程自动化、跨平台客服、招聘优化、供应链协同和智能办公等多个场景。

AI项目与工具 2025年06月12日 59 点赞 0 评论 661 浏览

小乖记账

小乖记账是一款基于AI技术的智能记账应用，通过语音识别技术简化记账流程，自动分类财务数据，并提供直观的统计图表帮助用户分析消费习惯和资金流向。该应用还支持用户手动修改账单分类、设置虚拟形象陪伴记账过程、以及管理个人资产和负债。小乖记账适用于日常收支记录、预算管理、分类账目、资产管理、账单提醒、财务分析和家庭财务管理等多个应用场景。

AI项目与工具 2025年06月12日 69 点赞 0 评论 661 浏览

WorldSense

WorldSense是由小红书与上海交通大学联合开发的多模态基准测试工具，用于评估大型语言模型在现实场景中对视频、音频和文本的综合理解能力。该平台包含1662个同步视频、3172个问答对，覆盖8大领域及26类认知任务，强调音频与视频信息的紧密耦合。所有数据经专家标注并多重验证，确保准确性。适用于自动驾驶、智能教育、监控、客服及内容创作等多个领域，推动AI模型在多模态场景下的性能提升。

AI项目与工具 2025年06月12日 61 点赞 0 评论 661 浏览

Midjourney V7

Midjourney V7 是一款基于深度学习的 AI 图像生成工具，具备草稿模式、语音交互、实时编辑等功能，显著提升生成速度与图像质量。其支持个性化配置，可根据用户偏好优化输出结果，适用于艺术、设计、娱乐等多个领域。系统采用先进神经网络技术，实现文本到图像的精准转换，并提供多种运行模式以满足不同需求。

AI项目与工具 2025年06月12日 96 点赞 0 评论 661 浏览

Skyvern

Skyvern是一款基于开源的浏览器自动化工具，集成了大型语言模型和计算机视觉技术，用于实现网页内容解析、交互计划生成及执行。其主要功能涵盖CAPTCHA解决、双因素认证支持、代理网络配置、可解释AI操作以及数据提取等，适用于网站数据抓取、表单填写、网页测试等多种应用场景。

AI项目与工具 2025年06月12日 90 点赞 0 评论 661 浏览

OmniManip

OmniManip是由北京大学与智元机器人联合实验室开发的通用机器人操作框架，结合视觉语言模型与三维操作技术，实现机器人在非结构化环境中的任务执行。其核心为以对象为中心的交互基元表示法，支持零样本泛化、跨平台部署及大规模仿真数据生成。通过双闭环系统设计与任务分解机制，提升操作精度与适应性，适用于日常操作、工业自动化及服务机器人等场景。

AI项目与工具 2025年06月12日 53 点赞 0 评论 661 浏览

Xinva

Xinva是一款利用人工智能技术快速生成专业设计作品的工具，主要面向需要高效制作T恤、贴纸、图案等设计的用户。它提供了智能模板库、自动布局优化、色彩协调、字体匹配、图像增强等强大功能，并支持多人实时协作和多种文件格式导出。Xinva凭借其简洁的界面和高效的AI辅助功能，成为设计师和创意工作者的得力助手。

AI项目与工具 2025年06月12日 80 点赞 0 评论 661 浏览