AI

Learn Prompting提示工程课程!

Learn Prompting 是一个免费的关于与人工智能通信的免费开源课程,即学习如何给AI下达指令!即怎样与人工智能沟通,让AI来协助我们来完成我们想让它做的事情!

HeadShot Pro

Headshot Pro 是一个AI驱动的工具,能够帮助团队快速生成专业的公司头像。用户可以上传他们的照片,并选择各种风格,得到120多种不同的头像选项。

谷歌DeepMind推出V2A技术,可为无声视频添加逼真音效

DeepMind推出的V2A(Video-to-Audio)模型能够将视频内容与文本提示相结合,生成包含对话、音效和音乐的详细音频轨道。它不仅能够与DeepMind自身的视频生成模型Veo协同工作,还能与其他视频生成模型,如Sora、可灵或Gen 3等,进行集成,从而为视频添加戏剧性的音乐、逼真的音效或与视频中角色和情绪相匹配的对话。V2A的强大之处在于其能够为每个视频输入生成无限数量的音轨。该模

NaturalReader

NaturalReaders是一个提供文本到语音转换服务的网站。

QueryPal

QueryPal是一款嵌入Slack和Microsoft Teams的AI聊天助手,可从多个企业数据源(如Google Drive、Notion、Jira等)中提取信息,即时回答员工问题,从而提升工作效率。它支持多种应用场景,包括新员工培训、DevOps支持及客户服务,并能自动管理知识库,减少对静态文档的依赖。

MultiTalk

MultiTalk是由中山大学深圳校区、美团和香港科技大学联合推出的音频驱动多人对话视频生成框架。它根据多声道音频输入、参考图像和文本提示,生成包含人物互动且口型与音频一致的视频。通过Label Rotary Position Embedding (L-RoPE) 方法解决多声道音频与人物绑定问题,并采用部分参数训练和多任务训练策略,保留基础模型的指令跟随能力。MultiTalk适用于卡通、歌唱及

Zoe

Zoe是一款专注于外贸行业的AI代理工具,支持从市场分析到客户转化的全流程自动化操作。它利用先进算法处理大数据,精准识别潜在客户并建立私有买家池,实现7×24小时多语言、多渠道触达。通过智能生成营销内容和动态优化沟通策略,大幅提升客户开发效率与转化率。

MMedAgent

MMedAgent是一款面向医疗领域的多模态AI平台,集成了指令优化的多模态大型语言模型(MLLM)及一系列定制化医疗工具,支持多种医学成像模式(如MRI、CT、X射线等),可高效处理视觉问答、分类、定位、分割、医学报告生成(MRG)及检索增强生成(RAG)等任务,显著提升了医疗数据处理效率与准确性。

塔猫AI对话PPT

塔猫AI对话PPT是一款利用深度学习与自然语言处理技术的智能PPT分析工具,可解析文本、图表等内容,支持智能问答、摘要生成及逻辑优化建议等功能。它适用于信息检索、演讲准备、教育培训等多个场景,助力用户高效获取所需信息。