BearTalk AI 简讯 · 2026年6月25日 · 14:46
本期内容
这期节目围绕一个核心问题展开:当 AI 能力足够强,我们和它协作的瓶颈到底在哪里?五篇内容从不同角度切入同一个答案:不是工具不够用,是信任边界还没想清楚。从 OpenAI 内部数据揭示的使用习惯门槛,到 Claude 进入 Slack 团队频道,再到一项证明 AI 说服力超越世界辩论冠军的大规模实验,听完这期你会对"委托给 AI"这件事有更具体的感受,也会对它的风险边界有更清醒的认识。
本期要点
- OpenAI 内部数据显示,员工花了数月才从聊天模式转向委托模式,代理的真正门槛是使用习惯而非技术
- Claude Tag 让 Claude 以团队成员身份常驻 Slack 频道,有上下文记忆,可随时被 @ 处理任务
- GLM-5.2 在自主多步工具调用能力上出现质变,本地部署的代理方案开始真正可用
- 牛津、斯坦福等机构联合研究发现,AI 个性化说服成功率在每一轮对比中都高于人类专家,包括世界辩论冠军
- AI 代理最大的失败模式是跑错方向却一直跑下去,写指令时加上"什么情况下停下来问我"是当前最实用的应对方式
参考资料
How Agents Are Transforming Work — https://openai.com/index/how-agents-are-transforming-work/
Introducing Claude Tag — https://www.anthropic.com/news/introducing-claude-tag
GLM-5.2 is the step change for open agents — https://www.interconnects.ai/
AI systems out-persuade expert humans — https://arxiv.org/
Can AI Learn Good Judgment — https://every.to/context-window
---
BearTalk 狗熊有话说播客,始于 2012 年。
订阅地址:https://beartalking.com/page/podcast