学习

Spirit LM

Spirit LM 是一种由 Meta AI 开发的多模态语言模型,能够处理文本和语音数据,支持跨模态学习。其基础版(BASE)和表达版(EXPRESSIVE)分别侧重于语义理解和情感表达。Spirit LM 可用于自动语音识别(ASR)、文本到语音(TTS)、语音分类及情感分析等任务,在语音助手、语音转写、有声读物等领域具有广泛应用前景。

Astria AI

Astria是一个利用生成AI创建定制图像的平台。Astria AI允许用户上传一组主题的图像,然后根据文本提示生成新图像。

IFAdapter

IFAdapter是一种由腾讯与新加坡国立大学联合开发的文本到图像生成模型,专为提高多实例图像生成时的空间定位与特征表达准确性而设计。它通过“外观标记”与“实例语义图”两大关键技术解决了传统方法中的定位与特征问题,并支持以即插即用的形式融入现有扩散模型,无需重新训练即可实现高效的空间控制。

AI Reality

AI Reality 是一个网站,它提供了一个使用人工智能 (AI) 学习和创建增强现实 (AR) 的平台。

jagoda.AI

[jagoda.AI是一款利用人工智能技术的在线学习平台,主要面向学生提供个性化辅导服务。它支持超过30个学科的解答,可翻译20多种语言,帮助学生解决家庭作业难题。平台通过分析学生的年级和学校水平,提供定制化辅导,并附带详细解题步骤,促进自主学习。此外,jagoda.AI支持拍照上传和语音输入,提供基础免费计划及付费订阅选项,适用于家庭作业帮助、自主学习、语言学习支持等多种场景。]

WordfixerBot

WordfixerBot是一个用于编辑、汇总和比较的多功能文本工具。

流畅阅读

FluentRead 是一款开源的浏览器翻译插件,基于AI技术提供精准、自然的翻译服务。支持多种翻译引擎和双语对照显示,具备隐私保护和高度定制化功能。适用于学术研究、工作场景、语言学习及日常阅读,兼容主流浏览器,保障用户数据安全。其开源特性增强了透明度与灵活性,满足多样化翻译需求。

KIMI浏览器助手

KIMI智能助手是一个多功能的浏览器扩展工具,它通过智能化的交互方式,为用户提供了一种新的信息获取和处理方式。

WebSSL

WebSSL是由Meta和纽约大学等机构开发的视觉自监督学习模型,基于大规模网络图像数据训练,无需语言监督即可学习有效视觉表示。其包含多个变体,参数规模从3亿到70亿不等,在多模态任务如视觉问答、OCR和图表理解中表现出色。通过筛选含文本图像数据,显著提升特定任务性能。模型具备良好的扩展性,适用于智能客服、文档处理、医疗影像分析等多个领域。