工具

OCRmyPDF

OCRmyPDF 是一款开源的命令行工具,用于将扫描 PDF 转换为可搜索、可编辑的文档。基于 Tesseract OCR 引擎,支持 100 多种语言,具备图像优化、纠偏、清洁等功能,提升识别准确率。支持多核处理与批量操作,适合高效处理大量文件,且完全离线运行,保障数据安全。

Manga TV

一个由人工智能驱动的可以通过文本自动生成漫画视频的平台,Manga TV彻底改变了漫画创作的过程。

MakeAnything

MakeAnything是由新加坡国立大学Show Lab团队开发的多领域程序性序列生成框架,能够根据文本或图像生成高质量的分步教程。它采用扩散变换器和ReCraft模型,支持从文本到过程和从图像到过程的双向生成。覆盖21个领域,包含超24,000个标注序列,具备良好的逻辑连贯性和视觉一致性,适用于教育、艺术、工艺传承及内容创作等多种场景。

Afforai

Afforai是一款面向研究人员的AI写作与研究辅助平台,支持论文撰写、引用管理、文献分析及笔记整理等功能。其AI研究助手可自动总结、比较和翻译多篇文献,确保信息来源可靠。平台支持多种文档格式与实时协作,提供自动生成参考书目服务,提升学术工作效率。

Omniflow

Omniflow 是一款基于AI的产品开发工具,旨在提升创意转化效率。其核心功能涵盖创意梳理、文档生成、任务分解与项目监控,支持自动化流程与多平台集成,适用于多种行业场景,助力团队高效协作与高质量交付。

ScrapeGraphAI

ScrapeGraphAI 是一款基于大型语言模型(LLM)的智能网络爬虫工具包,能够高效提取结构化数据。其核心功能包括 SmartScraper、SearchScraper 和 Markdownify,支持自然语言驱动的爬取、多页面搜索、自适应爬取、多模型和多平台兼容,可生成代码并存储为 CSV 或 JSON 格式。适用于市场分析、学术研究、产品信息收集等场景。

YouTube Summarized

YouTube Summarizedm,这是一个使用人工智能为您总结YouTube视频的网站,还可以可以帮助用户创建笔记或分享视频的精彩片段。

EmojiClick

一款基于AI的emoji搜索工具,EmojiClick可以帮助用户更轻松地找到最贴切的表情符号。

替我做图

替我做图是一款基于AI技术的图像生成平台,提供人台图、真人图、假发图、物品图等多样化服务,支持真人换脸及产品展示图优化,广泛应用于电商、社交媒体营销、广告制作等领域,助力提升品牌形象和营销效果。

MobileLLM

MobileLLM是一款针对移动设备优化的大型语言模型,具有语言理解与生成、零样本常识推理、聊天交互、API调用、文本重写与摘要生成以及数学问题解决等功能。它通过深度薄型架构、SwiGLU激活函数、嵌入共享和分组查询注意力机制等技术,在低参数环境下实现高效性能,适用于移动聊天、语音助手、内容推荐、教育辅助和移动搜索等多种应用场景。