OneAI OneAI是一款基于AI大语言模型的智能对话工具,支持多语言交流、信息检索、文本创作、翻译及生活辅助等功能。适用于学习辅导、写作协助、客户服务等多种场景,提供高效、精准的服务,提升用户体验与效率。 AI项目与工具 2025年06月12日 72 点赞 0 评论 500 浏览
ParGo ParGo是一种由字节与中山大学联合开发的多模态大语言模型连接器,通过结合局部与全局token,提升视觉与语言模态的对齐效果。其核心模块PGP和CPP分别提取图像的局部和全局信息,增强细节感知能力。在多个基准测试中表现优异,尤其在文字识别和图像描述任务中优势明显。采用自监督学习策略,提高模型泛化能力,适用于视觉问答、图像字幕生成、跨模态检索等多种场景。 AI项目与工具 2025年06月12日 38 点赞 0 评论 500 浏览
天壤万卷 天壤万卷是一款基于AI的文档处理工具,支持多格式文档(含超大文件和扫描件)的处理。其核心功能包括混合检索、跨语言问答、精准定位和溯源答案,同时配备表格、图像、公式识别等实用工具及行业模板,适用于法律、学术、金融等多个领域。 AI项目与工具 2025年06月12日 24 点赞 0 评论 492 浏览
ColorFlow ColorFlow是一款由清华大学与腾讯ARC实验室联合研发的图像序列着色模型,具备检索增强、上下文学习及超分辨率技术,能够精准保持个体身份并实现高质量着色。该工具在漫画、动画制作、老照片修复及艺术创作等领域具有广泛应用价值,同时支持学术研究和技术探索。 AI项目与工具 2025年06月12日 96 点赞 0 评论 489 浏览
YT Navigator YT Navigator 是一款基于 AI 的 YouTube 内容检索工具,支持自然语言查询、语义搜索和视频内容交互。用户可快速定位视频片段并获取时间戳,提升信息获取效率。适用于研究、学习、创作和分析等场景,具备频道管理、安全会话等功能。采用向量嵌入与 BM25 算法结合的搜索机制,提高搜索准确率,项目已开源。 AI项目与工具 2025年06月12日 57 点赞 0 评论 489 浏览
Kimi浏览器插件 Kimi浏览器插件是一款集成即时问答、全文摘要和划线互动功能的工具,支持用户通过划线提问获取上下文相关答案,并可一键生成文章摘要,提高阅读效率。划线互动功能还允许用户查看其他用户对特定文本的疑问和解答,增强社区互动。插件兼容多种浏览器,提供简洁的用户体验,适用于学术研究、资料查询、学习新知识、专业信息检索、内容创作等多个应用场景。 AI项目与工具 2025年03月03日 81 点赞 0 评论 485 浏览
ChatLaw ChatLaw是一款针对中文法律领域的大型语言模型,它通过定制化的设计和智能分析功能,为法律专业人士提供了一个强大的工具。 Ai平台模型 1970年01月01日 0 点赞 0 评论 484 浏览
VRAG VRAG-RL是阿里巴巴通义大模型团队推出的视觉感知驱动的多模态RAG推理框架,旨在提升视觉语言模型在处理视觉丰富信息时的检索、推理和理解能力。通过定义视觉感知动作空间,实现从粗粒度到细粒度的信息获取,并结合强化学习和综合奖励机制优化模型性能。该框架支持多轮交互推理,具备良好的可扩展性,适用于智能文档问答、视觉信息检索、多模态内容生成等多种场景。 AI项目与工具 2025年06月11日 84 点赞 0 评论 483 浏览
PIKE PIKE-RAG是由微软亚洲研究院开发的检索增强型生成框架,旨在提升复杂工业场景下的问答准确性与推理能力。通过知识原子化、多智能体规划等技术,支持多跳问题处理和创造性问题解决。适用于法律、医疗、金融等多个领域,具备结构化知识提取、动态任务分解及分阶段开发等核心功能,提高模型生成结果的可靠性和实用性。 AI项目与工具 2025年06月12日 72 点赞 0 评论 477 浏览