9 月 6 日那篇写的是模型发布。这四天的一手源把同一条控制链往前推了半步:Astra 开始按工作流卖;实验室仪器继续走「软件就能控」的口;房间里的开源控制器没有新的正式月度版。下面只写能点开原文核对的内容。客户引语、官方自评、内部评测,都不当成独立复现。

今天先看哪三条

  1. AI:OpenAI 于 9 月 9 日发 《GPT-6 Astra: The next generation in intelligence for work》,把 9 月 3 日的 Astra 收成 ChatGPT Work、Codex 和 API 的工作入口;企业默认关闭。
  2. 具身 / 实验室:没有 Figure、Physical Intelligence、Boston Dynamics 的新原发稿。对得上「模型操作物理装置」的,是 9 月 8 日 MIT EQuS 用 GPT-5.6 Sol + Codex 跑超导量子比特实验
  3. 智能家居:Home Assistant core 仍停在 2026.9.1(9 月 5 日)。ESPHome 在 9 月 9 日发到 2026.9.0b3,还是 beta,不当正式月度版。

1. Astra:从发布稿改成可以进工位的配置

一手源:OpenAI《GPT-6 Astra: The next generation in intelligence for work》(2026-09-09)。交叉仍以 9 月 3 日的 Astra 发布稿System Card 为准。

这篇不是新模型卡。它把已经发布的 Astra 写成「从第一天就能进现有工作流」:ChatGPT Work 和 Codex 里可以写代码、操作人每天在用的应用,即使那些应用没有 API。企业管理员「在适用费率与协议下打开」;原文写明 Enterprise 默认关闭

需要单独记下、且能对上数字的只有这几条:

  • 定价仍是发布稿里的 输入 $10 / 百万 token,输出 $50 / 百万 token
  • Terminal-Bench 4.0:57.9%(GPT-5.6 Sol 37.3%,Claude Fable 5.1 55.8%);官方按估算 API 成本写,相对这两家大约低 9% 和 63%。这是官方图表注,不是第三方复现
  • 内部 computer use 安全评测(越低越好):Astra 造成非预期结果的次数比 GPT-5.6 Sol 少 89%,比 Claude Fable 5.1 少 74.7%。测的是泄露机密、仪表盘分享过宽、删数据这类工位场景
  • 新的企业插件挂在 ChatGPT Desktop,点名 Oracle Analytics、Power BI(Microsoft Fabric)、Navan、Avalara
  • 控制项:限制可访问的网站和桌面应用、管理上传下载、浏览历史、确认策略、对可能不安全的工具调用做自动复核

Databricks、Hebbia、Box、Cognition、Figma、Thomson Reuters 的引语是客户评价,不是评测表。DeepSWE 74%、Excel 竞赛「大约快四倍」也是文中的客户或配图说明,不写进可核对清单。

对读者的用法边界:量产 Astra 仍然拒绝写漏洞利用;企业默认关;「能操作没有 API 的软件」和「已经替你接好公司全部系统」不是同一句话。

2. 实验室这一截:值夜班的是 GPT-5.6 Sol,不是新的人形演示

一手源:OpenAI《How GPT-5.6 Sol helps run quantum computing experiments》(2026-09-08)。

MIT Engineering Quantum Systems Group(EQuS)研究生 Beatriz Yankelevich 把 Codex 接到实验室里协调实验的软件。对象是稀释制冷机里、近绝对零度的超导量子比特。芯片做好、封装、降温之后,研究者只通过软件交互,所以这篇把它写成 Agent 的试验床。

可核对的现场设置:

  • 芯片:未校准的 六比特 标准测试片,EQuS 用来标定流片
  • 模型:GPT-5.6 Sol,不是 Astra
  • 做法:给 Codex 写测量技能;模型选参数、操作硬件、分析结果,再决定重测还是把结果交给下一步
  • 信号清楚时,能走完识别跃迁频率、校准控制/读出脉冲、测相干时间这条标准序列,人工介入少
  • 信号弱或噪声大时,找参数更慢,有时需要有经验的人接手。原文结论是:当前 Agent 能跑定义清楚的流程,解释含糊的物理结果仍难
  • 组里现在常规用 Agent 做例行表征;Yankelevich 写她可以让测量跑一整夜或自己进洁净间时继续跑,用手机查看再转向

这和 9 月 6 日写的 Anthropic Model Hardware Standard 是同一类事实:物理装置已经暴露成软件字典,不是又一条家务视频。Figure 官网新闻仍停在 9 月 3 日的 Nscale 算力协议;Physical Intelligence 技术博文仍停在 4 月的 π 0.7;Boston Dynamics、1X 本窗口没有对得上的原发稿。这三家不编。

3. 内部模型声称解决了 Navier–Stokes 千禧问题之一,但不是 Astra,也不领奖

一手源:OpenAI《On the Navier–Stokes Millennium Prize Problem》(2026-09-08)。附件:论文 PDFLean 形式化仓库

原文自己划的边界必须一起抄下来:

  • 用的是 内部模型,能力显著高于 GPT-6 Astra;训练仍在进行
  • 证明:初始光滑、能量有限的不可压缩三维流体,在光滑外力下可在有限时间出现奇点;对应 Clay 题面的 C(以及 D)
  • Lean 形式化由 GPT-6 Astra 再花约 17 小时 完成
  • 找到解析的那组大约 一万 个并发 Agent,从 9 月 1 日启动到 9 月 5 日约 88 小时;全过程约 270 万条消息、1300 亿 output token
  • 不打算申领千禧年奖
  • 同期 Anthropic 的 Levent Alpöge 与 NYU 的 Tristan Buckmaster 做的是 forced Euler;OpenAI 写明自己的 Euler 结果是 unforced,证明不同,并承认对方在 forced Euler 上的优先

这是官方研究声明,不是 Clay 研究所的颁奖公告,也不是独立数学家的核验纪要。能做的核对是点开 PDF 和 Lean 仓库,而不是把「千禧问题已被 AI 解决」写成事实标题。

4. 房间这边:正式月度版没有新的

  • Home Assistant:2026.9.1 仍是 9 月 5 日那条补丁,core 发行页到 9 月 10 日没有 2026.9.2
  • ESPHome:9 月 3 日 b1、9 月 7 日 b2、9 月 9 日 2026.9.0b3。9 月 6 日已经写过:beta 不当正式月度版。要等正式 tag
  • Zigbee2MQTT 仍停在 9 月 3 日的 2.14.1
  • CSA 9 月 3 日还有一篇成员谈 Matter 的通稿,没有新的认证口或规格号,不展开

现在就能做的,仍是升 HA 2026.9.1、打开 Matter 图、用 CSA 目录核认证号。ESPHome 2026.9 等正式版。

信源

日期 一手
AI 2026-09-09 Astra for work
实验室 2026-09-08 GPT-5.6 Sol × MIT EQuS
AI 2026-09-08 Navier–Stokes 声明 · Lean 仓库
家居 2026-09-05 HA core 2026.9.1
家居 2026-09-09 ESPHome 2026.9.0b3(beta)

Anthropic、DeepMind、Figure、Physical Intelligence、Boston Dynamics、1X 本窗口无对得上的原发更新,故不写。Hugging Face 博客 9 月 10 日有 Gradio Workflow 工程文,匿名抓取被站点拦截,未写入正文。