分类

EzAudio

EzAudio是一款基于文本到音频(Text-to-Audio, T2A)生成模型,通过优化的扩散变换器架构和高效的数据训练策略,实现了快速生成高质量音频的功能。它支持多种应用场景,如音乐创作、影视后期制作、语音合成等,并具备高保真度和低资源消耗的特点。

FontSpace

fontspace目前收录了9万个免费英文字体,以及1.6万个可商用英文字体。

心光

心光是一款结合AI技术的个人生活记录工具,支持时间轴记录、情绪识别、智能分类等功能,帮助用户记录生活、管理情绪并获得情感支持。其核心特点在于通过多媒体记录和个性化设置,为用户提供便捷、高效的记录方式,同时生成“人生之书”以呈现生活轨迹。

iConStore

一个提供免费矢量图标的在线资源库,由一流设计师创作,iConStore提供多种格式的图标,包括 SVG 格式,适合个人和商业项目使用。

水木AI知识库

水木AI知识库由水木AI社区发起,旨在持续收集高质量AI行业报告,AI学习资料,供相关从业者阅读学习。

Gemini Embedding

Gemini Embedding 是 Google 推出的文本嵌入模型,能将文本转化为高维向量以捕捉语义和上下文信息。支持超过 100 种语言,具备高效的检索、分类、聚类和相似性检测能力。其支持长文本输入和灵活的维度调整,适用于多场景应用,如智能搜索、数据分析和自然语言处理。模型基于 Gemini 训练,具有优秀的语言理解能力。

Moonvy提示词可视化

这是一个旨在把 AIGC 提示词(现在支持 Midjourney和Stable Diffusion)可视化并提供编辑功能的工具,主要用于AI绘画领域

Nova A.I.

一款简单却强大的在线视频编辑和日志软件,由计算机视觉视频搜索引擎提供支持。

CLaMP 3

CLaMP 3是由清华大学朱文武教授团队开发的多模态、多语言音乐信息检索框架,支持文本、图像、音频和乐谱等多种模态之间的跨模态检索。其基于对比学习技术,将不同模态数据与多语言文本对齐至统一语义空间,适用于文本到音乐、图像到音乐检索、零样本分类及音乐推荐等任务。支持27种语言,可扩展至100种,广泛应用于音乐创作、教育、分析及多媒体内容制作。