人工智能

WorldSense

WorldSense是由小红书与上海交通大学联合开发的多模态基准测试工具,用于评估大型语言模型在现实场景中对视频、音频和文本的综合理解能力。该平台包含1662个同步视频、3172个问答对,覆盖8大领域及26类认知任务,强调音频与视频信息的紧密耦合。所有数据经专家标注并多重验证,确保准确性。适用于自动驾驶、智能教育、监控、客服及内容创作等多个领域,推动AI模型在多模态场景下的性能提升。

TuneFlow

TuneFlow 是新一代 AI 助力的音乐制作工具,它配备了一整套强大的人工智能算法,覆盖端到端的完整音乐制作流程。就像一个专属制作团队,为你时刻待命。

Zonos

Zonos是一款由Zyphra开发的高保真文本到语音(TTS)模型,支持零样本语音克隆和多语言生成,具备精细的情感与语音参数控制能力。其采用Transformer和SSM混合架构,基于大规模语音数据训练,适用于有声读物、虚拟助手、多媒体创作及无障碍技术等多个领域。模型开源且支持实时语音生成,具有广泛的应用潜力。

未来简历

未来简历利用GLM-130B大模型技术,为用户提供专业、个性化的简历定制服务。它通过深入分析招聘需求,优化简历内容,提供ATS友好的模板,以及面试预测助手,帮助求职者提高面试机会。

Motionit AI

​MotionIt.ai是一款利用人工智能生成令人惊叹的幻灯片和视频的先进平台,用于各种用途

Qwen3 Reranker

Qwen3 Reranker是阿里巴巴通义千问团队推出的文本重排序模型,属于Qwen3模型家族。它采用单塔交叉编码器架构,能够对文本对进行相关性评估并输出得分,支持超过100种语言。通过多阶段训练范式和高质量数据训练,模型在MTEB排行榜上表现优异。Qwen3 Reranker可用于语义检索、文本分类、情感分析和代码搜索等场景,提升信息检索效率和准确性。

Framer Ai

Framer Ai,一款可以利用人工智能设计网站的产品。你只需要输入文本描述(支持中文),就可以自动设计、排版、生成和上线网站。

Yoodli AI

Yoodli 是一款可让您录制您的演讲或演示文稿,并获得有关在沟通方面的分析,例如节奏、眼神交流、肢体语言、包容性语言、手势等。

PatentPal

PatentPal是一款基于AI的专利文件生成工具,可自动创建完整的专利申请草稿,包括图表、摘要和详细说明。用户可通过上传文档一键生成内容,并支持多种格式导出。工具具备高度可定制性,允许用户调整生成文本并管理多个配置文件,适用于专利撰写、知识产权管理和创新保护等场景。

ContentV

ContentV是字节跳动开源的80亿参数文生视频模型框架,通过替换Stable Diffusion 3.5 Large的2D-VAE为3D-VAE并引入3D位置编码,提升视频生成能力。采用多阶段训练策略和流匹配算法,实现高效训练。支持文本到视频生成、自定义视频参数、风格迁移与融合、视频续写与修改等功能,适用于视频内容创作、游戏开发、VR/AR和特效制作等场景。