定制

DiffSensei

DiffSensei是一款由北京大学、上海AI实验室及南洋理工大学联合开发的漫画生成框架,它结合了基于扩散的图像生成技术和多模态大型语言模型(MLLM)。该工具能够根据用户提供的文本提示和角色图像,生成具有高精度和视觉吸引力的黑白漫画面板,支持多角色场景下的互动与布局调整。其核心技术包括掩码交叉注意力机制、对话布局编码以及MLLM作为特征适配器等,广泛应用于漫画创作、个性化内容生成、教育和培训等领

百度GBI

百度GBI旨在降低数据分析的复杂性,使企业和用户能够更容易地获取到数据背后的真知灼见,助力决策者做出明智的选择。

UniReal

UniReal是一款由香港大学与Adobe研究院合作开发的多功能图像处理框架,能够实现图像生成、编辑、定制和合成等任务。它通过视频生成模型的设计理念,利用大规模视频数据作为监督源,学习图像间的连贯性与变化性,生成高质量的逼真图像。该框架特别擅长处理复杂的场景,支持多种应用场景,包括数字内容创作、媒体娱乐、广告营销、电子商务及教育等领域。

National Gallery Mixtape

National Gallery Mixtape 是伦敦国家美术馆与 Google Arts & Culture 合作推出的 AI 音乐实验工具。用户可从 200 幅精选名画中选择最多 6 幅,AI 会分析画作的色彩、主题、情感和历史背景,生成匹配的音乐片段。用户可调整音量、顺序和叠加方式,并通过风格、乐器和心情标签定制音乐氛围。该工具基于谷歌 Gemini 模型,提供实时互动体验,适用于教育、艺

edge

edge-tts 是一个开源的AI文字转语音项目,支持超过40种语言和300多种声音。该项目利用微软Azure Cognitive Services技术,能够将文本信息转换为流畅自然的语音输出。edge-tts 提供了丰富的语言和声音选择,易于集成且具有高度可定制性。其主要功能包括多语言支持、多样声音选择、流畅自然语音、易于集成的API以及开源特性。edge-tts 广泛应用于辅助技术、客户服务、

Sticker.Show

一个免费免费在线定制贴纸制作器和生成器,Sticker.Show提供了简单易用的界面,支持用户自定义生成多样化的贴纸,适用于社交媒体、聊天、营销、应用等场景。

Food Mood

Food Mood 是 Google AI 推出的创意菜谱生成工具,支持用户将两种不同国家的菜系进行融合,创造出独特的食谱。用户可选择菜品类别、用餐人数、添加特定食材,并根据饮食偏好(如素食、无麸质)进行定制。工具提供随机生成功能,帮助用户获得灵感,生成的食谱包含详细食材清单、制作步骤、精致插图和实用贴士。

VAPI

VAPI是一个面向开发者的语音AI平台,凭借其简便的API集成、高精度语音识别、多语言支持以及定制化能力,能够协助开发者快速将语音技术嵌入至不同类型的软件应用中。它注重数据隐私与安全性,并提供多样化的应用场景,如智能助手、客户服务自动化、教育培训、医疗健康及呼叫中心等,帮助企业提升运营效率和服务质量。

Makelogo Ai

Makelogo Ai是一种AI的Logo生成器设计工具,MakeLogo.AI使用先进的人工智能,根据用户输入生成独特的Logo。

Logomaster.ai

Logomaster.ai是一个logo生成器,帮助企业创始人以最快速度创建专业的标志设计。