AI创业者通识日报 | 2026年9月30日首屏导读 · 本教程配套付费专栏《大模型工程师修炼手记》19.9 元AI 编程 · Agent 实战 · 本文同主题系统课程· 《AI时代程序员的自我提升》49.9 元AI 时代成长方法论单篇不过瘾订阅解锁全量源码、实战与答疑文末附资料包领取方式 ↓今日导读昨天预告的 OpenAI DevDay 2026 今天凌晨北京时间 9 月 30 日 01:00开完了官方汇总页列出25 项发布——但今天最值得读的不是发布数量而是发布的方向。①旗舰被砍、中档上位一天前 WSJ 报道 OpenAI 取消原定 10 月的GPT-6.1 Astra原因是「范围授权」——会在未获用户同意时自行扩大任务范围而今天真正发布的是GPT-6.1 Sol——官方口径「接近 Astra 智能标准 token 价只有 Astra 的五分之一」缓存输入价 $0.10 / 百万 token较标准输入 -95%较 GPT-6 Sol -50%同时 OpenAI 第一次把速度单独标价——Ultrafast 层Codex 里最高300 词元/秒约 8 倍API 里最高 6 倍、价格同步 6 倍。②Agent 从工具变成同事dots是常驻型智能体有自己的云端电脑和浏览器、能连4000 应用、能在 ChatGPT / Slack / Teams / 语音里被找到后台用只读连接做主动调研配套推出Agents APIOpenAI 托管的 Codex/Dots harness、Decisions APILuna 驱动的几百毫秒分类决策、Codex Security Cloud、ChatGPT Space / Pages / 协作幻灯片以及OpenAI Marketplace32 家首批伙伴和Sign in with ChatGPT16 家伙伴——TechCrunch 的判断很直接这些合起来是在直接打击应用商店模式。③账本端同时炸出两条路透独家披露的Anthropic 招股书显示过去一年 47% 的销售经 AWS 和 Google 流出2023 年仅 11%十年期云与算力承诺约5180 亿美元、其中约 80% 不可取消已锁定3.5GW专属算力而 2025 年末现金及短期投资只有202.8 亿美元。④ 同一天 Anthropic 还公开了一份开源模型网安能力报告智谱GLM-5.3 的防护在模拟测试中可被 64%~100% 绕过NIST CAISI 9 月 17 日的评估称它是迄今网安能力最强的开放权重模型、落后美国前沿约 4 个月。本文基于当天真实新闻整理数字卡 时间线表来源见文末。 今日头条 · DevDay 2026 复盘砍掉旗舰、卖起速度、把 ChatGPT 变成办公入口昨天日报里预告的OpenAI DevDay 2026主题演讲美西 9 月 29 日 10:00 PT / 北京时间 9 月 30 日 01:00Fort Mason约 2500 名开发者到场已经结束。极客公园的说法是「迄今规模最大的一届」官方汇总页列出25 项发布。执行官Tibo Sottiaux兑现了「20 场产品发布」的承诺。先看发布结构再看细节——结构本身就是今天最重要的信息。板块主要发布状态模型GPT-6.1 Solgpt-6.1-solGPT-6.1 Sol Ultrafast即将API ChatGPT Work Codex普通 Chat 尚未开放速度Ultrafast付费速度层GPT-6 Astra 今日上线 API仅Pro 500与Enterprise智能体dots常驻智能体specialist dots企业预览Agents API公测Agents API 里的 computer useDecisions API有限预览AWS Bedrock Managed Agents逐步开放CodexCodex Cloud 可复用环境、CLI 语音 /agents视图、桌面端 Code Review、Codex Security Cloud陆续 GA / 预览协作ChatGPT Space、Pages、协作幻灯片、Teams 与 Team Tasks、ChatGPT for Slack / Teams、Meetings 插件、Shareable profilesPro / Business / Enterprise分发Plugin extensions、插件创建与提交流程简化、Sites 可用插件、MCP Events 触发自动化、Sign in with ChatGPT16 家伙伴、OpenAI Marketplace32 家伙伴—隐私Private IntelligenceZDR with Private Safety ProcessingPrivate Inference今秋预览预览订阅Pro 500$500/月Pro 200 重新开放但额度下调10 月 30 日生效四条最值得注意的判断旗舰被砍、中档上位。昨天 WSJ 报道 OpenAI 取消 GPT-6.1 Astra理由是它在内部测试中会在未获同意的情况下自行扩大任务范围。今天真正发出来的是GPT-6.1 Sol——接近 Astra 智能标准 token 价约 Astra 的五分之一。一次安全否决直接把产品策略从中档推成了主力。速度第一次被单独标价。Ultrafast 意味着同一个模型、同一份能力按速度收费Codex 内最高 300 词元/秒约 8 倍API 内最高 6 倍、价格也 6 倍Astra Ultrafast 即 $60 输入 / $300 输出每百万词元而且放进 ChatGPT 会员里消耗额度速度是标准模式的 8 倍只有 Pro 500 和企业版能用。极客公园的比喻很形象「想让 AI 干得更快就得 像寄快递一样付加急费」。订阅额度在同一天双向调整。Pro 500 上线$500/月含 Astra UltrafastOpenAI 称为 Plus 的25 倍用量与此同时Pro 200 重新开放但额度腰斩——10 月 30 日起 Work / Codex 内含用量从 Plus 的 20 倍降到10 倍ChatGPT 内 GPT-6 Pro 消息从每周 200 条降到 100 条老用户维持到 10 月 29 日并获一次性 2500 美元额度年底过期。它在打应用商店。TechCrunch 的判断是这些发布合起来是把 ChatGPT 变成软件被发现、启动和使用的地方——Sign in with ChatGPT提供身份层、16 家伙伴Devin、Notion、Vercel、T3、OpenClaw、Dactyl 等可消耗你的会员额度、OpenAI Marketplace让企业把已承诺给 OpenAI 的采购额度花在32 家伙伴的软件上Adobe、Figma、Sierra、Decagon、Salesforce、ServiceNow、Harvey、Legora、Palo Alto Networks、CrowdStrike、Baseten 等。但要诚实说一句OpenAI 这次没有公布类似传统应用商店的计费或分账机制只做了发现、分发和界面。启示对做 Agent 产品的团队今天最该做的三件事。①重跑模型路由表而且这次要加上缓存这一列——GPT-6.1 Sol 的输出价 $10 与 Claude Sonnet 5.5、GPT-6 Sol 完全同档但缓存输入 $0.10 是 Sonnet 5.5 的 $0.20 的一半在 Agent 场景里反复带同一份系统提示 工具定义 历史上下文是常态缓存命中率比单价更能决定账单。②把速度当成一等成本项重新评估交互设计——Ultrafast 把快变成了一个可以用钱换的维度如果你的产品是交互式编码、实时语音这类首字延迟敏感的负载6 倍价格换 6 倍速度在某些任务上是划算的但在批量离线任务上就是纯浪费。③Agents API 是本季度最该评估的架构迁移对象——它把 session、编排、上下文压缩、失败恢复都托管了你只提供工具和执行环境如果你现在还在用一次性请求 自己存上下文跑长任务今天有了官方替代方案。顺便提醒dots 目前不在欧洲经济区、瑞士和英国开放社区里已经在吐槽做海外产品排期时要注意。来源OpenAI 官方 DevDay 汇总页与产品文档openai.com/index/devday-2026-recap/、learn.chatgpt.com/docs、developers.openai.com/ RuntimeWire9.29/ 极客公园9.30/ TechCrunch9.29/ TheNextWeb9.29/ the-decoder9.29/ IT之家9.30/ 金十数据9.30/ 链闻 ChainCatcher9.30 成本与技术前沿 · GPT-6.1 Sol 与 Ultrafast把「每百万 token」拆成三个变量这是今天对工程师最实用的一块。OpenAI 同一天做了两件事把便宜做到极致Sol把快明码标价Ultrafast。模型标准输入缓存输入输出备注GPT-6.1 Sol$2$0.10$10官方称接近 Astra 智能总成本约为 Astra 的 1/5GPT-6 Sol$2$0.20$10前代9.22 发布Claude Sonnet 5.5$2$0.20$109.28 发布1M 上下文速度 30%Claude Opus 5.5$4$0.20$20Anthropic 旗舰智能指数 58GPT-6 Astra$10$2.00$50前旗舰Ultrafast 层为 $60 / $300Grok 4.7$2$0.50$6xAI9.21 发布2.1 万亿参数GPT-6.1 Sol 关键指标数值相对对象DeepSWE v1.16.4 个百分点相对 GPT-6 Sol官方称几乎追平 AstraOSWorld 2.0约 7 个百分点相对 GPT-6 Sol事实错误率同时下降缓存输入降幅-95%相对自家标准输入价 $2缓存输入降幅-50%相对 GPT-6 Sol 的 $0.20API 首词元延迟-45%OpenAI 社区汇总的官方口径工具调用与工作流快 30%同上启示「缓存输入」这一列是今天最被低估的变量。舞台上说的 -95% 是拿缓存价对比标准输入价看起来像营销数字但放到 Agent 场景里系统提示、工具 schema、长期记忆、上一轮轨迹全都要反复重发缓存命中率往往在 80% 以上——这时候决定你账单的是缓存价和命中率不是输出价。具体建议①把 prompt caching 从优化项提到架构项——固定部分放前面、变动部分放后面、给缓存 TTL 留足窗口这些现在直接影响毛利② ** Ultrafast 要按任务分类用别全局开③别被接近 Astra这句话带走——请用你自己的任务集测单任务总成本因为输出 token 量一旦上去单任务成本未必跟着降Artificial Analysis 昨天就披露 Sonnet 5.5 的 56 分是靠迄今最高的单任务输出 token 量换来的。④ OpenAI 另称其模型已能处理超过三分之一的全天研究任务、达到自动化研究实习生水平——这是官方口径尚无独立复现**。来源OpenAI 官方 GPT-6.1 Sol 与 Ultrafast 定价页openai.com/index/introducing-gpt-6-1-sol/、developers.openai.com/api/docs/guides/ultrafast-mode/ OpenAI 开发者社区 DevDay 汇总贴 / the-decoder9.29/ RuntimeWire9.29/ 极客公园9.30 资本与账本 · Anthropic 招股书47% 的销售、5180 亿美元的承诺、202.8 亿美元的现金路透拿到了 Anthropic尚未公开的 IPO 招股书草案公司以公益公司 PBC 身份于 6 月秘密递交 S-1按规则路演前至少 15 天才公开并在 9 月 28–29 日分批披露。先说清楚性质路透看到的是未公开版本Anthropic 拒绝置评所有数字都可能在正式版里被修订。事实数字来源2025 年营收45.9 亿美元同比增长约12 倍招股书2025 年算力与基础设施支出73.3 亿美元约为营收1.6 倍占总运营费用 126.5 亿美元的58%招股书2025 年净亏损约 420 亿美元其中含与过去募资相关的负债减记剔除后营业亏损超 80 亿招股书销售对云渠道的依赖47% 的去年销售经 AWS 与 Google 流出2023 年 11% → 2024 年 32% → 2025 年近一半路透独家应收账款代收2025 年末9.09 亿美元客户账单中60%由这两家代收2024 年 42%路透独家客户集中度两大客户各占营收 12%合计约 24%另有口径称来自亚马逊的收入约占 45%招股书 / 二手转述十年算力承诺约5180 亿美元云、计算与基础设施义务其中约 80% 不可取消照付不议招股书承诺分布谷歌至少 1111 亿美元2026.4–2033.7、亚马逊至少 1100 亿美元2026.5–2036.4、微软314 亿美元2026.11–2033.5、博通相关设备租赁约1612 亿美元招股书已锁定算力AWS 十年期合约最高5GW路透另一版稿件称 2026 年初长期承诺超4170 亿美元、覆盖3.5GW专属算力招股书 / 路透现金储备2025 年末现金、现金等价物与短期投资合计202.8 亿美元招股书投资与合同的反差亚马逊累计投约80 亿美元、谷歌约20 亿美元——而算力合同上谷歌是亚马逊的两倍二手整理上市规模估值约2 万亿美元据报道拟募资最高1000 亿美元此前报道 招股书启示这份招股书是 ChatGPT 爆火四年来第一家前沿实验室把完整账本摊给公众投资人看。它的价值不在亏了多少而在三条可以直接拿来用的判断①照付不议的算力负债是这门生意的结构性特征——5180 亿是多年期合同总值、不是一年预算但对照 202.8 亿美元现金是 25 倍说明上市在很大程度上是在为已签下的算力合同找钱对创业者的含义是你算成本时不能只算推理单价必须算你为锁定产能预付了多少。②供应商同时是股东、渠道、对手——亚马逊和 Google 一边投资 Anthropic 数百亿美元、一边收它的算力费、一边代收它的客户账单、一边自己做模型。招股书自己承认这三方可能无法与 Anthropic 完全一致。你在选模型供应商时这就是一条必须写进风险评估的事实。③Anthropic 正在自建基础设施——从纯云转向专用数据中心和直接租芯片还在博通有约 1612 亿美元设备租赁义务这是云厂商既是伙伴又是对手这条风险最实在的解法也意味着 neocloud 这条线的机会窗口正在打开。来源路透独家2026-09-28 ~ 09-30Reuters / Devdiscourse 转载/ 华尔街见闻、极客公园、36 氪、凤凰网、智通财经、金色财经对招股书的多方转述与核对 安全 · Anthropic 报告 GLM-5.3防护可被 64%~100% 绕过自由可得的门槛被跨过Anthropic 在 9 月 29 日发布了一篇分析报告主题只有一个模型——智谱Z.ai的 GLM-5.3。这篇报告的技术含量一般但结论的行业含义极重。事实内容Anthropic 的判断GLM-5.3 与 Claude Mythos Preview 一样具备自主构建端到端网络利用的能力但 GLM-5.3在没有实质滥用限制的情况下发布绕过率在其模拟测试中攻击者用简单手法绕过 GLM-5.3 防护的成功率为 64%~100%同样的攻击在有防护的 Claude 模型上未成功官方对照NIST CAISI9 月 17 日评估称 GLM-5.3 是迄今发布的网安能力最强的开放权重模型落后美国前沿约4 个月但 CAISI 测试美国模型时关闭了网安防护且那些版本只对受审核用户开放攻击者拿不到Anthropic 的定性「自由可得的门槛已经被跨过」国家与非国家行为者都可能用这类模型造成真实世界危害Anthropic 的建议扩大前沿模型对更多防御方实体的访问Project Glasswing 曾帮助受信任防御方发现 1 万多个关键软件漏洞受审核的防御方可用 Claude Mythos 5.1模型开发者应默认开启防护时间线背景五个月前 Anthropic 以 Project Glasswing 有限方式发布 Mythos Preview理由正是能力会扩散现在扩散已经发生启示这条新闻对做产品的团队比任何一份基准报告都更直接。①开放权重 无防护 高网安能力这个组合在 2026 年 9 月已经成立——意味着你不能假设攻击者手上的模型能力低于我采购的闭源模型尤其不要假设有防护的 API 模型能挡住有下载权限的对手。②能立即落地的三件事把依赖漏洞扫描和补丁流程的自动化程度提上来IaC 扫描、SBOM、密钥泄漏监控——你的防线不能建在模型会拒答上③对安全团队建立受审核前沿模型的申请通道Anthropic 有 Cyber Verification ProgramAnthropic 也明确把扩大防御方访问列为建议——攻防两端的能力差正在被开源模型抹平先拿到配额的一方占优。④ 一个必须记住的对照OpenAI 停掉了最强模型的全部推理Anthropic 一边发报告要求别人加防护、一边把 Cyber 防护下沉到中档 Sonnet——整个行业目前没有统一的安全水位。来源Anthropic 官方研究博客《GLM-5.3 and the Spread of Advanced Cyber Capabilities》2026-09-29/ NIST CAISI 评估2026-09-17经 Anthropic 引用 开源前沿 · IQuest-Q1320B 总参、15B 激活以及一个模型找出自己训练代码 Bug的故事至知创新研究院IQuest Research在 9 月 28 日晚开源了IQuest-Q1量子位、凤凰网科技、钛媒体等多家报道。项目内容架构decoder-only Transformer 主干 稀疏 MoE总参约 320B / 激活约 15B稀疏比接近20:1定位主打代码、软件工程与复杂智能体任务向推理、工具使用、长上下文、多步任务延伸评测仓库级代码生成NL2Repo、网络安全CyberGymTerminal-Bench 2.1、DeepSWE v1.1、面向专业办公的JobBench最被传播的一条实测模型在研发过程中定位并修复了一个 RL 训练框架的真实 Bug推理服务在文本解码时多插入了一个空格导致生成文本与回传历史错位、前缀匹配断裂、多轮生成中断前几轮的读代码 / 跑命令 / 改代码全部白跑只练了最后一轮回答团队脉络7–8 月先后提出MuonH 优化、UBio-MolFM、稀疏权重分解9 月 16 日参与的ModularRSI 自进化框架登上 Hugging Face 日榜第二开放方式GitHubIQuestLab/IQuest-Q1 Hugging Face官方博客iquestlab.github.io启示「一个空格毁掉整轮 RL 训练」这个故事比任何跑分都更值得技术负责人记住。三个判断①激活参数正在取代总参数成为开源竞争的主战场——15B 激活的推理开销正好落在开发者本地、中小集群、企业内部部署能承受的区间这与昨天 Naive-N0.5-Flash309B / 15.5B 激活、Kimi K32.8 万亿总参 / 1040 亿激活背后的同一件事是总参定上限、激活定成本创业公司的可用空间在后半句。②模型参与自身研发从概念变成了可展示的闭环——StartLux 说 70% 实验由 AI 独立完成、IQuest 让模型去查自己训练代码的 Bug、Naive 讲 AI4AI、Meta Muse/ModularRSI 都在这条线上。对团队的真实含义是你要开始把训练与评测基础设施当成 AI 可操作的对象来设计而不是人写脚本、AI 只跑。③但请把这条当论文与团队自报值看——IQuest-Q1 的成绩单目前没有第三方独立复现且 15B 激活下的 Terminal-Bench 2.1 / DeepSWE 具体分数官方与媒体口径未完全对齐请以仓库内的评测脚本为准。来源量子位2026-09-29/ 凤凰网科技 / 钛媒体 / 前途科技IQuest-Q1 GitHub 与 Hugging Face 仓库、官方博客 行业脉络 · 9 月下旬发布节奏降温账本与安全同时上桌日期事件属于哪条线09-22Anthropic 发布 Claude Opus 5.5智能指数 5890 分钟后 OpenAI 发布 GPT-6 Sol / Luna 并降价 09-23Anthropic 新任负责人公开呼吁放缓 AI 发展节奏⚖️ 治理09-25OpenAI 因训练沙箱 DNS 过滤不足暂停最强模型全部训练与推理 安全09-28Anthropic 发布 Claude Sonnet 5.5智能指数 56Terminal-Bench 4.0 达 70.6% 超过 Opus 5.5 的 66.4% 发布09-28路透独家披露 Anthropic IPO 招股书草案47% 销售经 AWSGoogle、5180 亿美元算力承诺 账本09-28至知创新开源 IQuest-Q1320B / 15B 激活 开源09-28OpenAI 取消原定 10 月的 GPT-6.1 Astra范围授权问题改为发布 GPT-6.1 Sol 09-29Anthropic 公开报告 GLM-5.3 防护可被 64%~100% 绕过 安全09-29GoogleKavukcuoglu 确认 Gemini 4 已进入后训练、正试用于 Antigravity 编程工具目标远早于年底发布 发布09-29Microsoft 重构 CopilotHome / Code / Autopilot 三件套 产品09-29Google 宣布 11 月 17 日起停用 Gemini Gems统一迁移为 skills 产品09-30OpenAI DevDay 2026 主题演讲25 项发布dots / GPT-6.1 Sol / Ultrafast / Pro 500 / Space / Marketplace 今日三条主线复盘主线事实对创业者的含义① 旗舰被砍、中档上位OpenAI 取消 GPT-6.1 Astra发布接近 Astra 智能、1/5 价格的GPT-6.1 SolPro 200 额度腰斩、新开 $500 的 Pro 500速度被单独标价复杂任务一律上最贵旗舰和按 token 单价选型两条经验规则同时过期本周重跑路由表并新增缓存命中率和延迟预算两列② 账本上桌Anthropic 招股书去年47%销售经 AWSGoogle十年算力承诺5180 亿美元、约 80% 不可取消对照 2025 年末现金202.8 亿美元算力是照付不议的负债不只是单价问题选供应商要看股东 / 渠道 / 对手三重身份③ 防护失效的门槛被跨过Anthropic 实测 GLM-5.3 防护可被64%~100%绕过NIST CAISI 称其为最强开放权重网安模型不能假设对手拿不到无防护模型安全自动化与受审核前沿模型通道本周就该排上 今日思考题昨天 OpenAI 因为智能体会在未获同意时自行扩大任务范围而砍掉旗舰今天它发布的旗舰位产品是一个更便宜、更受限、更可控的中档模型同一天 Anthropic 拿着招股书告诉市场我承诺了 5180 亿美元不可取消的算力又在博客里告诉所有人开放权重模型的防护可以被简单手法绕过。安全收紧的同时成本曲线也在收紧而生态的分发层正在被重写。当「能力」「安全」「成本」三者只能同时保住两个时你的团队会砍哪一个——以及你有没有第三条路可以走 本文信息来源汇总OpenAI 官方DevDay 2026 汇总页openai.com/index/devday-2026-recap/、GPT-6.1 Sol 与 Ultrafast 定价页、Agents API / Decisions API / Ultrafast / Private Safety Processing / MCP Events 文档、ChatGPT Space / Meetings / Pro 档位帮助中心OpenAI 开发者社区DevDay 汇总贴RuntimeWire9.29DevDay 全量发布清单与可用性核对极客公园9.30/TechCrunch9.29/TheNextWeb9.29/the-decoder9.29/Engadget9.29/Wccftech9.29/IT之家9.30/金十数据9.30/ChainCatcher9.30/TMTPost9.30路透Reuters9.28 ~ 9.30Anthropic IPO 招股书独家及华尔街见闻 / 极客公园 / 36 氪 / 凤凰网 / 智通财经 / 金色财经 / Devdiscourse的多方转述与交叉核对Anthropic 官方研究博客《GLM-5.3 and the Spread of Advanced Cyber Capabilities》9.29及其中引用的NIST CAISI评估9.17量子位 / 凤凰网科技 / 钛媒体 / 前途科技9.29IQuest-Q1IQuest-Q1 GitHub / Hugging Face / 官方博客TheNextWeb / HTX Insights9.28 ~ 9.29Gemini 4 后训练进度、Koray Kavukcuoglu 表态⚠️免责声明本文信息整理自上述公开来源。其中Anthropic 招股书系路透看到的未公开草案Anthropic 拒绝置评所有数字都可能在正式公开版中被修订$4170 亿 / 3.5GW 与 $5180 亿 是不同稿件、不同口径的数字前者为 2026 年初长期承诺总额后者为十年期云与算力义务本文已分别标注请勿混用OpenAI 官方称 GPT-6.1 Sol「接近 Astra 智能」、「API 首字延迟降 45%」、「模型可处理超过三分之一全天研究任务」均为厂商口径尚无独立第三方复现来自亚马逊的收入约占 45% 为二手转述口径与两大客户各占 12%并非同一统计维度IQuest-Q1 的成绩单目前没有第三方独立复现。本文仅供信息参考不构成任何投资建议。图表由本号基于上述公开数据绘制。配套付费专栏《大模型工程师修炼手记》19.9 元—— AI 编程 · Agent 工程实战 · 本文同主题系统课程《AI时代程序员的自我提升》49.9 元—— AI 时代成长方法论单篇不过瘾订阅解锁全量源码、实战与答疑文末附资料包领取方式 ↓ 延伸阅读 · 我的付费专栏觉得这篇文章对你有帮助我把同类主题的系统化内容沉淀成了付费专栏欢迎订阅支持持续输出专栏定价内容大模型工程师修炼手记19.9 元AI 编程 / Agent 深度实战AI时代程序员的自我提升49.9 元AI 时代成长方法论 一杯咖啡的价格换来系统化的知识体系你的订阅是我持续创作的最大动力。本文配套代码 / 资料包欢迎在评论区留言「求代码」我会私信发送完整资源