AI项目与工具

CapWords

CapWords 是一款基于AI技术的语言学习工具,通过拍照识别物品并提供外语单词、发音及例句,支持9种语言。其核心功能包括单词贴纸、记忆卡片和智能复习提醒,帮助用户高效学习和巩固词汇。应用适用于日常学习、旅行交流、亲子互动等多种场景,适合各类语言学习者使用。

MCA

MCA-Ctrl是由中科院计算所与国科大联合开发的图像定制生成框架,通过引入SAGI和SALQ注意力控制策略及主体定位模块,提升图像生成质量与一致性。支持零样本图像生成,适用于主体特征保持、背景一致性维护等多种任务,广泛应用于数字内容创作、广告设计、艺术创作等领域。

RuoYi AI

RuoYi AI 是一个集成了本地 RAG 方案和多模型支持的全栈式 AI 开发平台,提供高效的代码管理、数据隐私保护和丰富的多媒体功能。支持多种大语言模型接入,具备微信扩展、插件系统和支付接口,适用于企业及个人开发者构建智能应用。

PDFMathTranslate

PDFMathTranslate是一款专注于科技文档翻译的开源工具,能够精准保留PDF文档的排版格式,包括公式、图表和目录结构。支持双语对照查看,兼容多种翻译服务,可实现全文或局部翻译,适用于学术研究、教育、技术文档、法律文件等多个领域。

SpatialLM

SpatialLM 是一款由群核科技推出的开源空间理解多模态模型,能通过分析普通手机拍摄的视频生成详细的 3D 场景布局,涵盖房间结构、家具摆放等信息。它结合大语言模型与点云重建技术,实现空间认知与语义标注,并支持低成本数据采集。该模型适用于具身智能训练、AR/VR、建筑设计等多个领域,具备物理规则嵌入和结构化场景生成能力。

DeepEyes

DeepEyes是由小红书团队和西安交通大学联合开发的多模态深度思考模型,基于端到端强化学习实现“用图思考”能力,无需依赖监督微调。它在推理过程中动态调用图像工具,增强对细节的感知与理解,在视觉推理基准测试V* Bench上准确率高达90.1%。具备图像定位、幻觉缓解、多模态推理和动态工具调用等功能,适用于教育、医疗、交通、安防和工业等多个领域。

图趣AI

图趣AI是一款基于人工智能技术的创意工具,可通过文字描述生成多样化的艺术画作,涵盖风景、奇幻、艺术画及超现实等风格。它还提供AI艺术字、风格转换、平面设计及视频生成等功能,适用于个人创意表达、社交媒体内容创作、教育学习、广告营销及平面设计等多个领域。

Half_illustration

Half_illustration 是一款基于 Flux.1 模型的 LoRA 图像创意工具,融合了摄影写实与插画艺术的元素,创造出独特的视觉效果。该工具支持通过 API 快速生成图像,并与 Diffusers 库兼容。用户可通过详细描述和特定提示词指导模型,实现个性化的艺术创作。其应用广泛,涵盖时尚编辑、广告设计、概念艺术等多个领域。

Careerflow

Careerflow 是一款基于AI的求职辅助平台,提供简历优化、求职信撰写、模拟面试及求职跟踪等核心功能,帮助用户提升求职效率和成功率。平台支持多平台集成,适用于各类求职人群,助力职业发展。

klaviyo

Klaviyo 是一个面向电子商务和数字业务的全面营销自动化平台,集成了客户数据管理、个性化营销、短信与电子邮件营销及预测分析等功能。它通过整合多渠道数据,提供自动化营销流程和精准客户细分,帮助企业优化营销策略并提升客户价值。