工具

PDFMathTranslate

PDFMathTranslate是一款专注于科技文档翻译的开源工具,能够精准保留PDF文档的排版格式,包括公式、图表和目录结构。支持双语对照查看,兼容多种翻译服务,可实现全文或局部翻译,适用于学术研究、教育、技术文档、法律文件等多个领域。

LDGen

LDGen是一款结合大型语言模型与扩散模型的文本到图像生成工具,支持零样本多语言生成,提升图像质量和语义一致性。通过分层字幕优化、LLM对齐模块和跨模态精炼器,实现文本与图像的高效交互。实验表明其性能优于现有方法,适用于艺术创作、广告设计、影视制作等多个领域,具备高效、灵活和高质量的生成能力。

枝页

iBleaf是一款基于金字塔原理的AI笔记工具,帮助用户将碎片化知识整理成结构化的知识体系。通过知识树形式实现多层级管理,支持自然语言搜索与联网检索,智能提醒功能优化知识结构。支持多种格式内容收录与大纲梳理,适用于学习、项目管理及文献整理等场景,支持团队协作与知识共享。

Reactive

一款免费开源的AI简历制作工具,支持OpenAI API集成,提供智能内容优化、语法修正、多语言简历翻译等功能。

AI. Image Enlarger

一个免费在线工具,使用人工智能技术自动提升和增强小尺寸图像而不损失质量。它可以放大JPG或PNG图片而不会影响它们的分辨率和清晰度。

JumiFace

JumiFace 是一款在线人工智能换脸应用,它能够让用户生成换脸视频、照片和GIF动图,提供有趣的视频换脸体验,包括电影角色重新面貌设计、性别互换、面部表情包等。

Hedy AI

Hedy AI 是一款提升会议与对话效率的AI工具,支持19种语言,提供实时转录、智能总结、个性化提示及上下文敏感的见解。适用于商务会议、面试、课堂及医疗预约等场景,帮助用户更好地理解信息、提出有效问题并提升参与度。支持跨设备使用,注重隐私保护,适合多语言环境下的高效沟通。

Chatterbox

Chatterbox是Resemble AI推出的开源文本转语音(TTS)模型,基于0.5B规模的LLaMA架构,用超过50万小时精选音频训练。它支持零样本语音克隆,仅需5秒参考音频即可生成高度逼真的个性化语音,并具备情感夸张控制功能,可调节情绪、语速和语调。Chatterbox还拥有超低延迟的实时语音合成能力,延迟低至200毫秒以下,适用于交互式应用。此外,它采用安全水印技术防止滥用,适用于内容

Dashtoon

Dashtoon是一款基于人工智能技术的漫画创作平台,提供角色生成、背景处理、图像优化等功能,支持从故事板到漫画的全流程自动化操作。它致力于降低创作门槛,提升效率,同时为创作者提供发布与变现渠道,适用于个人娱乐、教育培训、商业营销及专业出版等场景。

案牍AI

一款专为法律领域设计的智能工具,基于大型语言模型(LLM)技术,提供合同审查、尽职调查和穿透核查等功能。