BearTalk AI 简讯 · 2026年7月28日 · 13:05
本期内容
这期谈的五件事,围绕着一条主线:AI 能力的边界在哪里,谁来决定这条线。Claude Opus 5 的发布说明性价比的天花板在抬高;OpenAI 的研究数据揭示 AI 正在改变"谁做什么工作"而不只是"怎么做工作";Ethan Mollick 最新指南提醒我们,判断框架比工具清单更重要;MirrorCode 基准测试第一次认真问了一个问题:AI 能不能在看不到源码的情况下重建整个程序;Dario Amodei 公开说清楚了 Anthropic 对开放权重模型的真实立场。听完这期,你会对"AI 能做什么、不能做什么、谁有权决定"有更清晰的框架。
本期要点
- Claude Opus 5 成为 Claude Pro 最强选项,能力接近旗舰级但价格只有一半,性价比的阶梯往上跳了一格
- OpenAI 分析逾八十万条用户消息发现,AI 正让人们跨越职位边界去完成原本属于其他职能的任务
- Ethan Mollick 更新 2026 夏季 AI 工具指南,核心判断是:代理系统已经改变了"用 AI"的定义,工具调用和执行稳定性比模型聪明与否更关键
- MirrorCode 基准测试让 AI 在看不到源码的情况下从零重建完整程序,顶级模型能完成部分任务,但最难的系统级任务仍未被攻克
- Dario Amodei 公开说明 Anthropic 支持开放权重但基于风险程度分级,不是非此即彼,而是能力越强发布门槛越高
参考资料
Introducing Claude Opus 5 — https://www.anthropic.com/news/claude-opus-5
How AI is expanding what people do at work — https://openai.com/index/how-ai-is-expanding-what-people-do-at-work/
An opinionated guide to which AI to use to do stuff(Ethan Mollick / One Useful Thing)— https://www.oneusefulthing.org
MirrorCode: What's the largest software project AI can complete on its own?(Import AI #466)— https://epoch.ai/MirrorCode
Our position on open-weights models(Dario Amodei)— https://www.anthropic.com/news/open-weights-position
---
BearTalk 狗熊有话说播客,始于 2012 年。
订阅地址:https://beartalking.com/page/podcast