榜单出炉头部产品差距缩小
发布第二期XClaw龙虾智能体完整榜单的是测评机构, 这次参与测试选了10款主流国产办公AI, 所有产品三次测试的平均分都超过了91分, 这表明整体水准有了很大提升。

排在总分第一位置的是百度文心助手, 小米MiMo Claw位居第二, 整个榜单的平均分是94.53分, 第一名与最后一名的分差为6.31分, 头部四款产品的分数均超过96分, 竞争局面相当激烈。
五大维度全面考察能力
这次进行的测评不折不扣地契合职场实际工作的场景样子, 对其划分出五个核心能力的板块来实现测试, 这五个板块依次是数据处理, 还有内容创作, 以及记忆能力, 甚至于代码开发跟研究分析, 并且每一项任务要独自进行重复三次的测试。
选取得分的平均值作为最终得分, 如此能够规避单次测试所引发的误差, 这种测试方式更为科学且更为精确, 从结果予以观察, 在内容创作以及记忆能力这两大板块, 得分近乎达到满分, 进行写文案以及长对话留存上下文等这般基础需求, 各家均可稳定地完成。
代码开发拉开巨大断层
数据处理的得分处于中间位置, 行业调研的得分同样处于中间位置。唯独在代码开发维度, 出现了巨大差距。行业的平均分数仅仅为86.99分。最高分数与最低分数二者之间相差17.59分。此差距极为显而易见。

在代码开发项目当中, 小米MiMo Claw展现的表现是最为出色的, 它所获得的分数高度达到了97.22分, 此成绩呈现出断层态势领先于其他各类产品, 与之对比, 其他产品于代码编写方面所展现的表现呈现出参差不齐的状况, 这同样反映出不同产品在专业任务之上的实力存在差异。
稳定性成为关键指标
本次测评重点考察的指标当中, 稳定性是其中之一。三次测试分数若是波动越小, 那就意味着日常使用的表现会越稳定。百度文心助手的波动数值是最低的。它每每的输出结果, 一致性是非常强的。
部分处于总分靠后位置的产品, 历经多次测试, 差异极为巨大。相同的指令, 于每次输出时, 内容呈现出参差不齐的状况。这样的情形, 在日常办公期间, 极容易出现失误。若用户依靠这些产品去处理重要工作, 极有可能会遭遇不可预测的问题。
竞争进入精细化阶段
目前, 国产办公人工智能已然脱离了基础功能之间的较量, 竞争步入了细节、稳定程度以及专业任务的精细化时期, 对于普通日常文案以及简单表格的处理, 绝大多数产品均可胜任。

要是常常有着处理诸多数据或者编写程序的需求, 像文心助手和MiMo Claw这类处于领先地位的产品便会更适合企业办公所需要求。用户于选购之际应当依据自身实际的使用场景予以判断。针对基础办公需求能够挑选性价比更为高些的产品, 而专业需求则要重视处于头部位置的产品。
选购建议看准核心需求
此次测评给在职场工作的人士给予了明晰的选购参照, 对于仅仅只需处理日常文档以及简单数据的用户而言, 大多数产品均可满足其需求, 要是你常常需要编写代码或者处理复杂数据, 那么建议优先考量文心助手或者MiMo Claw。
你于日常办公期间主要借助AI去处理哪类任务, 是代码编写, 还是数据处理, 亦或是文案创作, 欢迎在评论区之中分享你的使用经验, 点赞并分享本文以使更多的人能够看到这份测评结果。



