Aya Vision Aya Vision 是 Cohere 推出的多模态、多语言视觉模型,支持 23 种语言,具备图像描述生成、视觉问答、文本翻译和多语言摘要生成等能力。采用模块化架构与合成标注技术,确保在资源有限条件下仍具高效表现。适用于教育、内容创作、辅助工具开发及多语言交流等多个场景,具有广泛的实用价值。 AI项目与工具 2025年06月12日 70 点赞 0 评论 497 浏览
PP PP-DocBee是百度飞桨推出的多模态文档理解模型,基于ViT+MLP+LLM架构,支持文字、表格、图表等多类型文档内容的精准识别与解析。具备高效的推理性能和高质量输出,适用于文档问答、信息提取等场景,支持灵活部署,为文档处理提供智能化解决方案。 AI项目与工具 2025年06月12日 56 点赞 0 评论 503 浏览
星环无涯•金融大模型 星环无涯•金融大模型是一个综合性的金融投研工具,它通过先进的数据分析和自然语言处理技术,为专业投资者和机构提供了深入的市场分析、策略构建和投资决策支持。 创作工具 2026年06月14日 0 点赞 0 评论 505 浏览
点点 点点是一款以生活服务为核心的AI搜索应用,主要功能涵盖生活经验总结、精准避坑指南、真实用户反馈及及时信息更新。它支持用户通过文字、图片或视频形式提问,并提供互动式问答体验,旨在满足用户在日常生活中多方面的实际需求。 AI项目与工具 2025年06月12日 56 点赞 0 评论 506 浏览
Ming Ming-Lite-Omni是蚂蚁集团开源的统一多模态大模型,基于MoE架构,支持文本、图像、音频和视频等多种模态的输入输出,具备强大的理解和生成能力。模型在多个任务中表现优异,如图像识别、视频理解、语音问答等,适用于OCR识别、知识问答、视频分析等多个领域。其高效处理能力和多模态交互特性,为用户提供一体化智能体验。 AI项目与工具 2025年06月11日 79 点赞 0 评论 506 浏览
Tarsier2 Tarsier2是字节跳动研发的大规模视觉语言模型,擅长生成高精度视频描述并在多项视频理解任务中表现优异。其核心技术包括大规模数据预训练、细粒度时间对齐微调以及直接偏好优化(DPO)。该模型在视频问答、定位、幻觉检测及具身问答等任务中均取得领先成绩,支持多语言处理,具有广泛的应用潜力。 AI项目与工具 2025年06月12日 59 点赞 0 评论 507 浏览
VideoRAG VideoRAG是一种基于检索增强生成(RAG)技术的工具,旨在提升长视频的理解能力。它通过提取视频中的多模态信息(如OCR、ASR和对象检测),并将其与视频帧和用户查询结合,增强大型视频语言模型的处理效果。该技术轻量高效,易于集成,适用于视频问答、内容分析、教育、媒体创作及企业知识管理等多个领域。 AI项目与工具 2025年06月12日 75 点赞 0 评论 507 浏览
Pubmed pro PubMed Pro 是一款面向医学科研人员的专业文献检索与管理平台,集成了文献搜索、订阅、翻译、收藏及AI学术问答等多种功能。它支持影响因子查询、分区分析和PDF全文链接,同时提供基于文献的智能问答服务,助力科研人员高效获取和管理学术资源。 AI项目与工具 2025年06月12日 32 点赞 0 评论 509 浏览
8spAi系统 8spAi系统集成了全模型AI问答、创作、绘画、文生图、思维导图一站搞定!GPT4对话识图、知识库训练、文档提问总结、DALLE-3绘图、Midjourney绘画动态全功能与思维导图自动生成等功能,为用户提供了智能化的服务和体验。 Ai开源项目 2025年06月05日 77 点赞 0 评论 511 浏览
OLMoE OLMoE是一款基于混合专家(MoE)架构的开源大型语言模型,具有高效的稀疏激活机制和快速训练能力。它支持自然语言理解、文本生成、多任务处理等功能,并广泛应用于聊天机器人、内容创作、情感分析和问答系统等领域,通过预训练和微调实现高精度任务执行。 --- AI项目与工具 2025年06月12日 85 点赞 0 评论 512 浏览