AI项目与工具

Weebo

Weebo是一款基于AI技术的实时语音交互工具,支持语音识别与生成,实现自然流畅的语音对话。具备多语言支持和实时响应能力,适用于个人助理、娱乐互动和教育辅导等场景。技术上融合了Whisper Small、Llama 3.2等模型,提供便捷高效的语音交互体验。

食神

食神是老板电器研发的烹饪领域AI大模型,基于46年烹饪数据与DeepSeek技术,可精准理解用户需求。支持语音、文字交互,提供个性化菜谱推荐、健康膳食规划,并能与智能厨电联动,实现烹饪全流程自动化。同时具备文化讲解与情感陪伴功能,提升用户体验。适用于家庭烹饪、健康管理及文化体验等多个场景。

LeetTools

LeetTools是一款人工智能驱动的文档处理工具,支持知识库构建、文章生成和智能搜索等功能。用户可通过关键词快速生成分析报告、新闻聚合等内容,并自定义格式与结构。具备高度可定制性,支持多源数据整合与本地系统集成,适用于市场调研、内容创作及知识管理等场景。

ComfyUI

ComfyUI-Bxb是一款专注于将ComfyUI工作流转换为微信小程序、抖音小程序等多平台应用的工具。它具备一键转换功能,内置支付系统,并且支持多设备并发开发,保证了开发效率和用户数据的安全。ComfyUI-Bxb适用于创意变现、教育工具、商业推广、服务预约以及电子商务等多种应用场景。

ConceptMaster

ConceptMaster是一款基于扩散Transformer模型的多概念视频生成框架,可在无需测试调优的情况下生成高质量、概念一致的视频。通过解耦多概念嵌入并独立注入模型,有效解决身份解耦问题,尤其擅长处理高度相似的视觉概念。该工具支持多概念视频定制、高质量数据收集和全面的基准测试,适用于视频创作、动画制作、游戏开发及产品展示等领域。

DisPose

DisPose是一项由多家顶尖高校联合研发的技术,专注于优化人物图像动画的质量。它通过运动场引导和关键点对应的方式,结合混合ControlNet模块,实现了对骨骼姿态的有效控制,无需额外密集输入即可生成高质量、一致性的动画视频。DisPose广泛适用于艺术创作、社交媒体、数字人制作及虚拟现实等领域。

哇喔相机

哇喔相机是一款由杭州洽特智能开发的AI摄影工具,主要功能包括AI写真生成、证件照制作、智能修图、自动美颜以及背景替换。该工具利用先进的AI技术,能够自动识别面部特征和背景,生成个性化的写真照片。哇喔相机界面友好,操作简便,用户可通过多种模板和滤镜进行个性化编辑,从而轻松拍摄具有艺术感和个性的照片。此外,哇喔相机还支持证件照制作、背景替换等功能,广泛应用于个人写真、职业形象照、艺术照等多个领域。

Matryoshka Diffusion Models

Matryoshka Diffusion Models (MDM) 是一种由苹果公司开发的创新扩散模型,专为生成高分辨率图像和视频而设计。通过多尺度扩散机制与NestedUNet架构,MDM实现了高效的信息共享与渐进式训练,显著提升了模型的训练效率与生成质量。该模型适用于资源受限的环境,可减少训练步骤并保持生成图像的细节与清晰度。其主要功能包括高分辨率图像生成、多分辨率处理、特征共享以及渐进式训练

VideoWorld

VideoWorld是由北京交通大学、中国科学技术大学与字节跳动合作开发的深度生成模型,能够通过未标注视频数据学习复杂知识,包括规则、推理和规划能力。其核心技术包括自回归视频生成、潜在动态模型(LDM)和逆动态模型(IDM),支持长期推理和跨环境泛化。该模型在围棋和机器人控制任务中表现优异,且具备向自动驾驶、智能监控等场景扩展的潜力。

profile picture Maker

PFPMaker 是一款基于 AI 技术的在线头像制作工具,支持自动去除照片背景,并提供丰富的编辑功能和模板选择。用户可上传照片或使用平台素材,通过裁剪、调色等操作生成个性化头像。支持高清输出,适用于社交媒体、职业平台及通讯工具,且完全免费使用。