Ben Horowitz 对话 OpenAI 联合创始人兼总裁 Greg Brockman:宣称 Astra 已达可合理称为 AGI 的水准(含约 24 小时连贯任务),但算力无法人人伺候;真正胜负手是不断抬升的 safety/security/alignment。讨论 code red 抽调约 25% 工程防守、前沿能力赋能攻防的时间窗口、用约 1 万 agent 攻克 Navier–Stokes 类难题、computer use 改写人机软件关系,以及「被许诺的 AI」应是有记忆与主动推进的助手而非又一个文本框。
- 「AGI 时代」= 能力触门槛 + 分发/安全工程成为主约束。
- Super Bowl 比喻:赢在 blocking/tackling 式的安全标准抬升。
- Code red:危险窗口期把产能拨去防守。
播出信息
- 节目: The a16z Show
- 嘉宾: Greg Brockman(OpenAI 联合创始人 / President)
- 主持: Ben Horowitz(a16z)
- 发布: 2026-09-14(RSS pubDate 日)
- 时长: 00:51:02(约 3062 秒)
- 单集页: a16z.simplecast.com
- YouTube: YouTube President on What it Means to Cross Into The Age of AGI)
- 音频: 音频
- 英文转写来源: Podscripts 公开稿 + YouTube auto captions
来源
节目结构
- 冷开场:宣布进入 AGI 时代(Astra) — 00:00 🎧 · ▶️
- 两次大赌注:Stripe → OpenAI;urgency 与 code red — 00:31 🎧 · ▶️
- 十年前的 AGI 时间表 vs 今天 — 03:00 🎧 · ▶️
- 安全栈:监控、沙箱、评估期控制 — 04:36 🎧 · ▶️
- 网络攻防窗口:前沿能力先给防守方 — 08:47 🎧 · ▶️
- Ben:中心化数据蜜罐与消费者无力感 — 11:25 🎧 · ▶️
- 一万 agent:Navier–Stokes 与组织化多智能体 — 12:00 🎧 · ▶️
- Computer use:软件关系的范式切换 — 18:27 🎧 · ▶️
- Astra 还剩多少路;连贯长程任务 — 20:58 🎧 · ▶️
- 对年轻人与默认能力环境 — 27:00 🎧 · ▶️
- 组织每个公司都必须抬升安全水位 — 29:58 🎧 · ▶️
- 真正被许诺的 AI:记忆、语境、主动助手 — 36:00 🎧 · ▶️
- 焦点轮换:基建两年后盯什么 — 41:20 🎧 · ▶️
- 新阶段:安全、安保、对齐成为主对话 — 45:00 🎧 · ▶️
分节详解
1) 冷开场:宣布进入 AGI 时代(Astra)
💬 他们说了什么: Greg:Astra 已到可被合理称为 AGI 的水准——曾连贯运行约 24 小时完成他认为相当惊人的任务。同时泼冷水:模型会足够强,但算力不够服务所有人。赢超级碗靠 blocking and tackling,不是口号——safety/security/alignment 标准必须持续抬升,而人们低估这一挑战。
💡 为什么重要: 把「AGI 叙事」从科幻阈值拉到:能力门槛已触碰 + 分发/安全工程才是主战场。
⚡ 争议点: 「可称 AGI」标准是谁的?Astra 公开定义与边界未充分展开。
2) 两次大赌注:Stripe → OpenAI;urgency 与 code red
💬 Ben 点出 Greg 职业生涯两笔大赌注。Greg:世界需要 urgency;正处危险窗口。OpenAI 曾宣布 code red,抽调约 25% 生产工程师全部转防守。他一贯盯「当下最重要问题」——过去两年偏数据中心/基建/ML;接下来焦点将转向他认为会被低估的安全与对齐挑战。
💡 展示能力跃迁期的组织反射:把工程产能从进攻拨去防御,是严肃对待窗口期的信号。
⚡ code red 触发细节(对手/漏洞类型)本期后文才补;25% 是否可持续?
3) 十年前的 AGI 时间表 vs 今天
💬 十年前 Greg 与 Ilya 估 AGI 约 10–15 年;今天 OpenAI 话语转为「进入 AGI 时代」。Ben 主持框定议题:computer use 如何改写人与软件关系、上万 agent 攻克数学难题、能力上升带来的安全风险、以及「我们真正被许诺的 AI」——不是又一个文本框,而是有记忆与语境、主动工作的助手。
💡 把访谈议程钉在:能力证明、安全窗口、产品形态三代跃迁。
⚡ 公司公关「AGI 时代」与学术 AGI 定义可能错位。
4) 安全栈:监控、沙箱、评估期控制
💬 讨论如何在评估与部署中监控、沙箱与控制模型;对齐想法包括辩论(debate)、迭代放大等方向。强调能力越强,控制面必须同步 up-level,否则「超级碗口号」式安全无效。
💡 把 alignment 从论文词变成工程纪律与评估制度。
⚡ 具体控制失效案例披露有限(涉安全敏感)。
5) 网络攻防窗口:前沿能力先给防守方
💬 谈及模型已能相当老练地发现并利用漏洞、潜入生产环境;能力一旦广为扩散,将赋能威胁行为者。防守方好处:你控制战场与系统布局,可用同样能力去打补丁。主张在 frontier vs broadly diffused 窗口期,通过可信访问计划等让防守方差分获得前沿能力,把安全水位跟着前沿一起抬。
💡 给出可执行战略:别等能力平民化再补洞;用差分访问换时间。
⚡ Ben 立即反驳:还有 50 年遗留代码与架构不是「找洞打补丁」能解决的。
6) Ben:中心化数据蜜罐与消费者无力感
💬 Ben:AI 可帮找 bug/打补丁,但互联网上巨大的消费者数据集中蜜罐、旧架构思想未为这个世界而建;消费者无法自保,依赖公司整顿令人忧心。追问未来是否需要更去中心化的消费者架构。
💡 把安全讨论从「模型红队」抬到「文明级数据架构是否还成立」。
⚡ 去中心化是否真能降低攻击面,抑或转移信任与 UX 成本?
7) 一万 agent:Navier–Stokes 与组织化多智能体
💬 Greg 回应:他们曾用约 10,000 个 agents 协作攻克 Navier–Stokes 相关问题——展示多智能体组织、分工与长时间连贯工作的「好的一面」。同一套能力在攻防两端对称。
💡 把 AGI 证据从聊天质量换成:大规模 agent 编队解决硬科学/工程任务。
⚡ 任务边界、人类监督比例、可复现性未深入;易被听成营销里程碑。
8) Computer use:软件关系的范式切换
💬 深入 computer use:模型直接操作电脑/界面,可能从根本上改变「人点软件」的关系——从键入表格到代理执行工作流。这比更好的文本框更接近「被许诺的助手」。
💡 产品含义:OS/应用层权限、审计与撤销成为一等公民;SaaS UX 可能被 agent 穿透。
⚡ 可靠性、权限滥用与责任归属仍是开放工程问题。
9) Astra 还剩多少路;连贯长程任务
💬 讨论 Astra 作为「可称 AGI」锚点还剩什么:长程连贯、工具使用、在真实环境中的鲁棒性。24 小时级任务被当作质变信号,但仍强调服务算力与安全标准是并行约束。
💡 防止听众把「时代宣言」听成「问题已解决」。
⚡ 内部代号 Astra 与对外产品线映射可能混淆。
10) 对年轻人与默认能力环境
💬 谈到年轻一代默认生长在高能力模型环境中——教育、工作预期与「何为技能」会被重写;需要社会层面思考如何培养与模型共存的能力,而非只比拼已被自动化的表层技能。
💡 把 AGI 时代从实验室扩到人力资本与教育政策。
⚡ 具体教育方案本期偏点到为止。
11) 组织每个公司都必须抬升安全水位
💬 主张每个组织都应把安全/对齐实践当作持续抬升的标准,而非一次性合规。能力曲线上升时,静态安全等于相对下降。
💡 对企业听众给行动号召:用前沿模型做防守,而不仅是做客服机器人。
⚡ 中小企业资源不足如何跟?差分访问计划覆盖面?
12) 真正被许诺的 AI:记忆、语境、主动助手
💬 Greg 描述产品愿景:不是另一个 chat 文本框,而是跨个人与职业场景、有记忆与上下文、能主动推进工作的助手——这才是「我们以为会得到的 AI」。
💡 为 OpenAI 产品路线提供叙事锚:从对话 UI → 持续代理。
⚡ 记忆型助手与隐私/锁定效应的张力未充分辩论。
13) 焦点轮换:基建两年后盯什么
💬 回顾他总是跟「最重要问题」走:曾深扎数据中心与 ML 基础设施;下一阶段更可能被安全、安全与能力纠缠的领域牵引——需要让各团队在共享语境下理解自己如何拼进总图。
💡 创业/大公司启示:高管注意力应随约束瓶颈迁移,而非固守职能舒适区。
⚡ 「明年焦点」仍较抽象,缺少可对外的里程碑。
14) 新阶段:安全、安保、对齐成为主对话
💬 收束:进入新阶段后,safety/security/alignment 必须成为最重要的公开对话之一;urgency 不是恐慌营销,而是窗口期的工程与治理现实。双方致谢结束。
💡 与开场 Super Bowl 比喻闭环:赢在执行细节与标准抬升。
⚡ 公司利益与公共安全叙事如何切割,听众需自行留心披露。
金句
You don't win the Super Bowl by saying you want to win the Super Bowl — you win it by blocking and tackling.
The models will be plenty powerful, but it'll be hard to get to everybody given we won't have enough compute.
We're in a very dangerous window right now.
Not another text box — an assistant with memory and context that knows you and works proactively.
来源(再列)
- Episode: a16z.simplecast.com
- YouTube
- Podscripts: podscripts.co
- Local EN:
/workspace/podcasts/a16z/transcripts/greg_brockman_agi.en.md