正在刊行早报 · Morning Brief
2026-09-02所有内容
随机比特 · Random Bits

OpenAI 首次把模型评为 Critical:越会找漏洞,越不能公开

2026-09-02AI Engineering / Systemsrbits.uk
OpenAI 首次把模型评为 Critical:越会找漏洞,越不能公开

OpenAI 首次把 Astra 列入 Critical 网络安全能力:它能以较少人工干预发现未知漏洞、构建利用链,因此能力越强,发布反而越受限。模型竞争开始从“谁更强”转向“谁有资格使用”。

🚀 模型能力与发布边界

• OpenAI 限制发布 Astra —— Astra 是 OpenAI 首个触及 Critical 网络安全能力阈值的模型。前沿模型的发布策略不再只看跑分,还要判断一项能力公开后能否被安全控制。

• Claude Fable 5.1 与 Mythos 5.1 发布 —— 新模型已同步进入 Claude Code,迅速影响真实开发工作流。版本升级是否值得切换,仍要用代码质量、延迟和成本实测,而不是只看发布说明。

• Runway Solaris 直接生成软件界面 —— 模型像生成视频一样逐帧生成交互画面,不再先编写并运行传统 UI 代码。演示很新鲜,但可测试性、无障碍支持和结果稳定性会成为真正的工程门槛。

🛠️ Agent 工具与软件生产

• Codex 文档能力背后是 1.7GB 运行时 —— 本地组件包含 Python、Node.js、Git、Poppler 和完整 LibreOffice。Agent 所谓“会编辑 Office 文档”,本质上是打包了一套可执行工具链,体积、安全更新和供应链都要计入成本。

• 顶级开源项目开始说“PRs NOT Welcome” —— Vercel AI SDK、Astro、tldraw 等项目正在收紧随手式外部贡献。AI 降低了写代码的成本,却把低质量提交和审查负担集中到了维护者身上。

• OpenMAIC 把多智能体组织成课堂 —— 项目当日新增 3122 stars,用老师、同学、讨论和反馈构成互动学习环境。发布日期尚不明确,当前信号更多说明多 Agent 教育产品正在快速获得关注,而非一次刚发生的发布。

🚨 平台规则与内容治理

• Claude 将为生成文本加入水印 —— Anthropic 把文本识别从研究议题推进到产品与欧盟合规层。水印能增加透明度,却无法绕开误判、规避和职场写作边界这些现实问题。

• Google Play 切断 AnkiDroid 捐赠入口 —— 商店规则不再允许应用内放置 Open Collective 链接。一个开源项目能否获得捐赠,开始取决于平台是否允许用户看见那个按钮。

📚 延伸阅读

• OpenAI:Path to Astra
https://openai.com/index/path-to-astra

• Simon Willison:Codex Desktop Includes LibreOffice
https://simonwillison.net/2026/Sep/1/codex-libreoffice/

• Latent Space:PRs NOT Welcome
https://www.latent.space/p/pr-not-welcome

随机比特公众号二维码
公众号 · 随机比特
从 AI 工具热闹里拆工程真相

写边界、控制面、上下文、成本与安全。