数据时效:2026-08 数据时效截至 2026 年 8 月 10 日。
8 月 10 日,中文科技媒体的头条几乎都是同一句话,OpenAI 曝光 GPT-6,网传 10 万亿参数,8 月强行发布。
把这条新闻拆开看,传播最广的两个数字,都来自一个自称“AI 内幕记者”的 X 账号,ChrisGPT。10 万亿参数,是他说的;顶着政府审查的压力也要在 8 月发布,也是他说的。OpenAI 官方一个都没有确认。
这两个数字还经不起第二个问题。“10T”最早出现在爆料里,紧挨着“4T token 的 Spud”和“1.5M token 上下文”。T 在这个语境里更可能指 token,也就是预训练语料的规模,10 万亿 token;把它读成“10 万亿参数”,是媒体转述时顺手加的。华尔街见闻自己用的都是条件句,“如果 Astra 参数真的 10 万亿”。一个被标题写成“参数 10 万亿”的数字,源头是一句可能指 token、本身也标着“rumour”的匿名爆料。
OpenAI 官方确实曝光过 Astra,时间更早,内容完全不同。8 月 1 日,OpenAI 在官网发了一篇数学博客,宣布下一代主要模型叫 Astra,说它解决了十道公开的数学和理论计算机难题,每道题都附了机器可验证的证明。官方没说参数,没说发布日期,甚至没说它以后叫不叫 GPT-6。
真正有官方出处、也更重的那件事,发生在 8 月 7 日。OpenAI 在官网声明,对 Astra 的初步评估显示,它“无法排除”达到“关键级”网络安全能力的可能性,OpenAI 决定暂停部分研发,加强隔离和监控,并与政府机构和独立安全组织联合测试。Altman 在 X 上补了一句,Astra 是一款强大的模型,把强大模型只给少数人不算好策略,但把它安全地交出来需要更多时间,“希望不会太久”。OpenAI 没有给 Astra 设任何发布日期。
“关键级”是 OpenAI 自己 2023 年公布的《准备框架》里最高的一级。按这个框架的定义,一个模型达到关键级,意味着它能自主发现和构造针对多个加固系统的零日漏洞,不用人帮忙;或者只给它一个高层目标,它就能策划并执行针对高价值目标的全新攻击。在此之前,OpenAI 所有模型,包括 7 月刚发布的 GPT-5.6,都停在“高”这一级。Astra 是第一个可能碰到这条线的模型。
同一条新闻里于是出现了一个反差。热搜上的两个数字全是爆料,而且可能还是读错的单位;官方做过的,是把发布停下来交给测试。传播最响的数字最不可靠,唯一值得当真的,是推迟。
10 万亿参数这个数字,在这个新闻里承担的作用,是让读者先被震住,再失去追问的力气。同一批爆料还给了一串更大的数字,年底有个代号 Doug 的更大模型,据称“让 Fable 看起来像原始产品”,可能用英伟达下一代芯片训练。数字一个比一个大,来源却一个比一个虚。参数到底是多少,Doug 存不存在,现在都没有答案。四月的剧情几乎一模一样,当时媒体说 GPT-6 在 4 月 14 日发布,结果是场空,OpenAI 在 4 月 23 日把代号 Spud 的模型以 GPT-5.5 的名义发了出去。
会有人反驳说,这可能是公关。先放一个吓人的参数制造声势,再放一个负责任的刹车声明,两头都占。而且“强行发布”的说法本身说明商业压力是真的,Anthropic 据传 8 月就要发 Fable 5.1 来直接对标 Astra,OpenAI 未必刹得住。
这个反驳,我只认一半。爆料来源确实无法核实,刹车也确实可能被商业压力推翻。Anthropic 自己就翻悔过一次,它 2 月承诺过类似的安全暂停,后来又撤销,理由是单方面放慢会让世界更不安全。这套说辞恰好说明,在竞争压力下刹车多容易被放弃,OpenAI 这次公开踩刹车才特别。预测市场也不买账,交易者给 8 月 7 日前发布 GPT-6 定的概率在 1% 以下,8 月底也只有两成。所谓“8 月强行发布”,连下注的人都不太信。
另一半,反驳打不到。无论爆料真假,无论 8 月会不会真发,“Astra 是第一个可能触及关键级安全线、OpenAI 为此公开放慢、与政府联合测试、不设日期”这件事,已经写进公开记录。即便它 8 月就发了,“关键级”这三个字也留在了 OpenAI 和政府的档案里。OpenAI 早在 2025 年 10 月就公开确认过,GPT-6 不会在 2025 年内发布。一家公司提前一年把下一代的时间窗口锁死,说明前沿模型的发布节奏,早就不是参数和热度说了算。
对普通人来说,这件事比 10 万亿参数有用。10 万亿参数大概率轮不到你用,它贵,它慢,只会被塞进最核心的任务。会变的是发布方式。GPT-5.6 发布前,已经因为美国政府的安全审查推迟了大约 12 天,成为第一个被要求在发布前做访问控制的商业模型。你会在模型发布的新闻里,越来越多地看到“政府安全测试”“执行令时限”“准备框架”这些词。安全评估第一次真的坐在了发布桌前。
下次再看到“X 万亿参数”的热搜,先问一句,这个数字谁说的,官方确认过吗。再问一句,这个模型触发过什么安全分级。参数负责传播,安全分级负责事实。一个被自己画的安全线拉住的模型,通常比一个参数吓人的模型,更值得你读。
主要事实来自 OpenAI 官方博客与安全中心、Altman 的 X;爆料链与数字出自华尔街见闻、The Verge、Polymarket 预测市场、mjmads.com 事实核查。数据截至 2026 年 8 月 10 日。