首页
学习
活动
专区
圈层
工具
发布

Codex说能替你谈判,但你真敢让它代表你的最大利益吗?

现在好多人拿 Claude Code 和 Codex 这两个主流编程智能体去干各种事,连谈判这种偏语言的事都交给它们了。比如 OpenAI 之前就展示过一个案例,Codex 替用户跟客服谈判拿到了退款。

但你真敢信一个智能体能替你争取最大利益吗?或者说,该信哪一个?

这其实引出一个挺有意思的问题:我们评测大模型的基准多到数不清,却居然没有一个专门系统衡量它们用语言谈判的能力。

我就想,既然评人怎么评,评它们也该一样——搞个谈判比赛,设计好信息差、利益冲突,再来客观打分。

我买了本《The Negotiation Challenge》,照着里面一个叫“Battle of Nations”的原始案例搞了场智能体谈判赛,那案例是基于1813年德国解放战争设计的。谈判里拿破仑和波兰代表要在好几个议题上扯皮,两边看重的东西完全不一样:派多少兵、守多久、要不要复国、给几个波罗的海港口、给不给元帅权杖、娶不娶拿破仑妹妹。

结果很简单:Claude Code 7比1 干翻了 Codex。

我看下来,Codex 的问题挺明显:它只想赶紧谈完,不想多榨价值。每局都有十轮以上容量,它四五轮就签字了,老挂在“达标、安全、能签”这种词上。而且它开局基本没像样的计划,Claude Code 倒是一上来就列长计划。Codex 还老白送好处,拒绝你的时候顺手附赠筹码;也容易被对方忽悠,把对手的话当客观事实。它把太多精力花在“跑流程”上,而不是谈生意。

当然 Claude Code 也犯傻,所以真要派智能体去谈,记得先让它交计划、说“不”别花钱、别被温情骗、自己算账、签字前问是不是比上一版好。

说真的,连高级模型谈判都这么拉胯,如果你的工作怕被 AI 替代,不如去练练谈判,比如参加谈判比赛。

  • 发表于:
  • 原文链接https://page.om.qq.com/page/Otr6WBdadyxxW0YnB-_Ah5TA0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。
领券