LalaEval LalaEval是由香港中文大学与货拉拉数据科学团队联合开发的针对特定领域大语言模型的人类评估框架。它提供了一套完整的端到端评估流程,涵盖领域界定、能力指标构建、评测集生成、标准制定及结果分析。通过争议度与评分波动分析,有效减少主观误差,提升评估质量。该工具已在物流领域成功应用,并具备良好的跨领域扩展性,适用于企业内部模型优化与多场景评测。 AI项目与工具 2025年06月12日 29 点赞 0 评论 449 浏览
Embodied Reasoner Embodied Reasoner是由多家科研机构联合开发的具身交互推理模型,通过视觉搜索、推理与行动协同完成复杂任务。采用模仿学习、自我探索和自我修正三阶段训练方法,生成多样化思考过程,提升任务规划效率。在长时序任务中表现优异,减少重复搜索和逻辑错误。适用于智能家居、仓储物流、医疗辅助等多个场景,具备多模态交互和强推理能力。 AI项目与工具 2025年06月11日 88 点赞 0 评论 358 浏览
PickFu 一个即时在线市场调研工具,专为创意人士和电商卖家设计。PickFu特别适用于亚马逊等电商平台的A/B测试,帮助卖家优化产品图片、标题等,从而提升产品的市场竞争力 电商运营 2025年06月05日 94 点赞 0 评论 403 浏览