Image Upscaler Image Upscaler 是一款简单但功能强大的工具,它使用AI技术将较小的图像或分辨率较低的图像的大小提升到 4K 分辨率,也就是图像长尺寸的 4096 px。 Ai图片处理 2025年06月05日 34 点赞 0 评论 355 浏览
Nooka Nooka是一款基于AI技术的听书应用,提供全球非虚构类书籍的20分钟音频摘要,适合碎片化时间学习。用户可随时提问并获得AI即时回答,实现深度互动。应用支持多语言字幕、音频剪辑分享及社区交流,适用于通勤、运动、家务等多种场景,提升学习效率与趣味性。 AI项目与工具 2025年06月11日 16 点赞 0 评论 355 浏览
DeepEyes DeepEyes是由小红书团队和西安交通大学联合开发的多模态深度思考模型,基于端到端强化学习实现“用图思考”能力,无需依赖监督微调。它在推理过程中动态调用图像工具,增强对细节的感知与理解,在视觉推理基准测试V* Bench上准确率高达90.1%。具备图像定位、幻觉缓解、多模态推理和动态工具调用等功能,适用于教育、医疗、交通、安防和工业等多个领域。 AI项目与工具 2025年06月11日 21 点赞 0 评论 355 浏览
Fish Audio Fish Audio是一款生成式AI文本转语音(TTS)和声音克隆平台,支持多种语言和声音风格,可将文本转换为自然流畅的语音。用户可上传音频样本克隆特定人物的声音,并通过API接口集成到应用程序中。Fish Audio适用于视频制作、有声读物、语音助手、教育与培训以及娱乐创意等领域,满足个性化语音内容生成需求。 AI项目与工具 2025年06月11日 79 点赞 0 评论 355 浏览
Dewagear CreateAI Dewagear CreateAI 是一个综合性的人工智能工具平台,旨在为用户提供创建AI虚拟助手和生成各种AI内容的服务,包括语音合成。 Ai平台模型 1970年01月01日 0 点赞 0 评论 356 浏览
BAGEL BAGEL是字节跳动开源的多模态基础模型,拥有140亿参数,采用混合变换器专家架构(MoT),通过两个独立编码器捕捉图像的像素级和语义级特征。它能够进行图像与文本融合理解、视频内容理解、文本到图像生成、图像编辑与修改、视频帧预测、三维场景理解与操作、世界导航以及跨模态检索等任务。BAGEL在多模态理解基准测试中表现优异,生成质量接近SD3,并适用于内容创作、三维场景生成、可视化学习和创意广告生成等 AI项目与工具 2025年06月11日 92 点赞 0 评论 356 浏览
LayerDiffusion LayerDiffusion是一种创新的AI工具,利用大规模预训练的潜在扩散模型生成具有透明度的图像。该技术引入了“潜在透明度”的概念,将图像的alpha通道透明度信息编码到潜在空间中。LayerDiffusion不仅可以生成单个透明图像,还能生成多个透明图层,支持条件控制生成和图层内容结构控制,确保高质量的图像输出。此外,它还能够生成多个透明图层,并通过共享注意力机制和低秩适应确保图层间的和谐混 AI项目与工具 2024年01月01日 69 点赞 0 评论 356 浏览
飞鸟办公 135编辑器旗下新推出的办公工具类网站。飞鸟办公借鉴目前市面上各类型办公工具网站的长处,结合自身特点,专门打造了文件处理工具和图片处理工具。 格式转换 2025年06月05日 30 点赞 0 评论 357 浏览
Resoomer 一款文档或内容分析和总结各种类型文档的AI工具。只需单击一下,Resoomer 就可识别并提炼文档中的重要核心概念和论点。 Ai办公效率 2025年06月05日 65 点赞 0 评论 357 浏览