工具

UniTok

UniTok是由字节跳动联合高校研发的统一视觉分词器,支持视觉生成与理解任务。其采用多码本量化技术,将视觉特征分割并独立量化,显著提升离散token的表示能力。在ImageNet上实现78.6%的零样本分类准确率,图像重建质量达0.38。可作为多模态大语言模型的视觉输入模块,广泛应用于图像生成、视觉问答、内容创作及跨模态检索等场景。

万相实验室

万相实验室,是阿里妈妈专注电商领域的ai创意生产工具。通过AI技术,万相实验室助力百万商家节省模特与拍摄成本,解决素材生产难、产图速度慢、上新结果差等问题。

EasySub

一个在线字幕生成器,专注于长视频文本和字幕生成,自动获取最准确的转录字幕,支持150多种免费语言翻译,提供免费试用选项,但并非完全免费。

NextAI整理全球AI项目库

NextAI整理全球AI项目库,包括AI变现: 如何利用AI搞钱、推荐课、Prompt提示词网站、AI学习文章和资料、AI工具汇总&报告收集、国内干模大战申请链接、AI部署公益咨询

Tersa

Tersa 是一款开源免费的 AI 工作流构建平台,提供直观的拖放界面,支持 77 个主流 AI 模型,如 GPT-4o、Claude 3.5 Sonnet、DALL-E 3 和 Whisper 等,适用于文本生成、图像视频创作、音频转录和代码优化等多种任务。用户可通过拖放文件快速构建复杂流程,无需编程基础,广泛应用于内容生成、代码审查、原型开发和多模态功能集成等领域。

歌歌AI

歌歌AI写歌 是一个旨在让每个人都能成为音乐家的平台,它通过人工智能技术,提供了一种创新的方式来创作音乐。

Tabnine

Tabnine是一个AI代码助手,让你成为一个更好的开发人员,软件开发人员的人工智能助手,全行代码和全功能代码完成更快。

小鸽子助手

一款集成于WPS/Word的智能写作插件,融合DeepSeek等主流大模型技术,提供文案生成、文章润色、文本纠错、标书质检等功能,是学术与办公的得力助手。

Krisp

Krisp是一款人工智能降噪工具,适用于Mac和Windows。它可以消除通话中的背景声音、噪音和回声,让用户安心。它还在每次通话结束时提供有用的见解,包括通话时间、会议见解和通话摘...