DeepGEMM DeepGEMM是DeepSeek开发的高效FP8矩阵乘法库,专为NVIDIA Hopper架构优化,支持普通与分组GEMM操作。采用即时编译技术,实现运行时动态优化,提升计算性能与精度。通过细粒度缩放和双级累加技术解决FP8精度问题,结合TMA特性提升数据传输效率。代码简洁,仅约300行,适用于大规模AI推理、MoE模型优化及高性能计算场景。 AI项目与工具 2025年06月12日 61 点赞 0 评论 696 浏览
KAG KAG是由蚂蚁集团开发的专业领域知识服务框架,通过知识增强技术提升大型语言模型在特定领域的问答性能。它结合知识图谱与向量检索,优化知识表示与推理过程,支持逻辑推理、多跳问答等功能,提升准确性和效率。适用于金融风控、医疗健康、智能客服、知识管理等多个场景,具备强大的语义理解和跨领域应用能力。 AI项目与工具 2025年06月12日 32 点赞 0 评论 696 浏览
BiGR BiGR是一种基于二进制编码的条件图像生成模型,集成了生成与判别任务于同一框架,支持高质量图像生成、视觉辨别和编辑。它通过掩码建模机制和二进制转码器实现高效的图像重建与预测,无需针对特定任务进行结构修改或参数调整,适用于多种视觉任务,如艺术创作、内容生成、广告设计、图像修复等。 AI项目与工具 2025年06月12日 68 点赞 0 评论 696 浏览
Glarity Glarity是一款基于ChatGPT技术构建的浏览器扩展工具,主要功能包括为YouTube视频和网页内容生成自动摘要、多语言翻译、电子邮件写作辅助及AI问答等。它支持多种平台,如YouTube、Google、Twitter等,旨在帮助用户高效获取信息、突破语言限制并提升阅读效率。无论是语言学习、学术研究还是跨文化交流,Glarity都提供了便捷的解决方案。 AI项目与工具 2025年06月12日 45 点赞 0 评论 696 浏览
Cognita Cognita是一个开源的模块化RAG框架,用于构建高效的问答系统和知识管理系统。它支持本地和生产环境部署,具备API驱动的架构、无代码UI、增量索引和多文档检索功能,适用于企业知识管理、客户支持、内容推荐等场景。开发人员可通过其模块化设计灵活扩展系统,非技术用户也可通过图形界面进行操作。 AI项目与工具 2025年06月12日 87 点赞 0 评论 696 浏览
TinyR1 TinyR1-Preview是由北京大学与360公司联合研发的32B参数推理模型,采用“分治-融合”策略,通过智能融合数学、编程、科学领域的子模型,实现高性能表现。其在数学领域(如AIME)表现优异,仅用5%参数量即可达到原版R1模型95%以上的性能。模型轻量且高效,适用于教育、科研、开发及企业等多种场景,具备良好的部署灵活性与实用性。 AI项目与工具 2025年06月12日 94 点赞 0 评论 695 浏览
Vanna.AI 一个基于人工智能的Python软件包,只需提出问题即可从去数据库里找到相应的数据,帮助生成Snowflake、BigQuery、Athena和Postgres等数据库的SQL。 Ai编程建站 2025年06月05日 95 点赞 0 评论 695 浏览
写个论文 写个论文, 超好用的免费论文降重软件,让写论文更简单写个论文支持通顺度、降重力度两个降重模式,轻松降低论文查重率,让写论文更简单。 教育学习 2025年06月05日 63 点赞 0 评论 695 浏览