R
PaliGemma 2 mix
PaliGemma 2 Mix 是谷歌 DeepMind 推出的多任务视觉语言模型,支持图像描述、目标检测、OCR、文档理解等功能。模型提供多种参数规模和分辨率选项,适用于不同场景。其基于开源框架开发,易于扩展,可通过简单提示切换任务。适用于科学问题解答、文档分析、电商内容生成等多个领域。
威斯康星大学麦迪逊分校
威斯康星大学麦迪逊分校(University of Wisconsin-Madison,简称:UW-Madison)创建于1848年,位于美国威斯康星州首府麦迪逊,是一所公立研究型大学,该校是威斯康星大学系统的旗...
Mistral OCR
Mistral OCR 是 Mistral AI 推出的高效 OCR 工具,支持多语言、多格式文档处理,准确率高达 99.02%。具备结构化输出、高速处理、多模态识别及 Doc-as-prompt 功能,适用于科研、文化遗产保护及企业文档管理等场景。
德克萨斯大学奥斯汀分校
德克萨斯大学奥斯汀分校(University of Texas at Austin,简称:UT-Austin)创建于1883年,是得克萨斯大学系统的旗舰校区,位于美国德克萨斯州首府奥斯汀市,是一所顶尖公立研究型...
