张大妈

美团发布原生“深度研究”Agent,攻略“整体可用率”优于ChatGPT

源自公众号:财闻

02-18 12:41

针对AI在处理真实物理世界问题时易产生幻觉的痛点,美团LongCat发布原生“深度研究”Agent。该产品利用独创架构和物理世界数据训练,在盲测中整体可用率达61.1%,优于ChatGPT等主流产品,目前已免费开放使用。

美团发布原生“深度研究”Agent,攻略“整体可用率”优于ChatGPT智能速览

  • 采用独创三层智能体闭环架构,针对性解决AI幻觉问题。

  • 基于美团积累的物理世界数据训练,落地能力更强。

  • 盲测整体可用率达61.1%,超越ChatGPT的42.8%。

  • 用户保存分享率为31.1%,大幅领先ChatGPT的16.7%。

美团发布原生“深度研究”Agent,攻略“整体可用率”优于ChatGPT精华内容

针对AI在解决物理世界问题时容易产生幻觉的痛点,美团LongCat推出了全新的解决方案,并通过实测数据证明了其优势。

独创架构

该Agent基于独创的三层智能体闭环架构打造,并结合了美团长期积累的物理世界数据进行训练。这种设计旨在有效缓解当前AI模型在处理真实世界复杂问题时,容易出现的“幻觉”现象,即生成不准确或虚构信息的情况。

通过结合实际场景数据,模型在理解现实逻辑方面表现更为扎实。

可用率对比

在用户盲测环节,LongCat在核心指标上展现了显著优势。数据显示,在“整体可用率”这一指标上,LongCat达到了61.1%。这意味着超过六成的用户认为其生成的攻略大部分或完全可用。

相比之下,ChatGPT的该项数据为42.8%。这表明在特定场景下,LongCat生成内容的可用性比ChatGPT高出近20个百分点。

用户认可度

除了可用性,用户的主观认可度也至关重要。在“保存分享率”指标中,即用户认为攻略非常有用并愿意保存或分享的比例,LongCat以31.1%的占比位居第一。

作为对比,ChatGPT的该项数据仅为16.7%。这一数据反映出用户对LongCat输出内容的实用价值给予了更高评价。

美团LongCat通过结合物理世界数据与独创架构,显著提升了AI生成内容的实用性与准确度。实测数据证明了其在解决真实问题上的潜力,目前网页端免费开放,为用户提供了除通用大模型之外的优质选择。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章