OpenAI 已经定位并修复导致用户连日投诉的三大问题——不少开发者称,新一代大模型 GPT-6 Astra 在发布后“越用越笨”。公司同时重置了 Codex 订阅用户的使用额度。
要点速览:
- Astra 用户过去一周在社交平台大量晒出并排测试,称模型较发布初期被“暗中削弱”。
- OpenAI Codex 负责人点名三大原因,其中一项为上下文实验,波及约 4,000–5,000 名用户。
- 上一代旗舰 GPT-5.6 Sol 今年 7 月也曾遭遇同样质疑。
OpenAI 修复 Astra 质量缺陷
Codex 产品负责人 Tibo Sottiaux 在周六发布的最新 更新说明 中表示,团队与部分用户协同排查后,已在当地时间午夜前完成修复并重置所有使用配额。问题之一在于,为旧版本模型编写的“技能(skills)”触发频率过高,有时会阻止 Astra 对自身输出进行必要的自检。
另一项可选的“上下文管理实验”则可能导致模型提前结束回答,或错误回应已经过时的对话内容。该实验在影响约 4,000–5,000 名参与测试的用户后被全面下线。
此外,部分推理引擎配置错误,导致分配给尾部流量的请求质量出现可观劣化。OpenAI 已将这些引擎移除,同时进行多项小范围修补。Sottiaux 在 X 上 撰文 称,Astra 现在在跟踪用户“最新一条消息”方面更加精准。
延伸阅读: 以太坊遭遇 2,800 美元抛压墙,ETF 净流入飙升至 2.16 亿美元
Astra 用户吐槽:代码质量“退步”而非进化
过去一周,不满情绪在 X 平台逐步发酵。开发者使用与发布当天完全相同的提示词和参数,对比当前版本 Astra 的输出,再将结果进行 对照分析。
此前刚公开夸赞 Astra 的开发者 Pranjal Paliwal 表示,回头审视模型近期为他生成的代码后,他更愿意将这一变化称为“回退(regression)”,而不是进步。
构建代码工具 Opencode 的 Dax Raad 则在实际投产后发现,迁移到 Astra 使团队开销几乎翻倍,但质量收益不足以抵消成本,最终选择“回滚”回 GPT-5.6 Sol。
在 OpenAI 社区论坛上,有用户在帖子中描述,Astra 目前在同一任务上的表现已与 Sol“拉平”,且需要同样多的重试次数。也有人并不认同这种看法,一名化名为 Antikythera 的用户认为,Astra 从一开始就偏“偷懒”、偏爱用项目符号罗列答案,只是用户在新鲜感消退后,更容易察觉这些问题。
算力与配额阴影笼罩 GPT-6 Astra
自 9 月初广泛开放以来,产能瓶颈一直是 Astra 推广过程中的阴影。
多名用户反馈,OpenAI 已下调重度 ChatGPT 用户的 Astra 调用上限,并暂停新增 200 美元档位的 Pro 订阅。Sottiaux 已在 9 月 10 日予以 确认。目前,Astra 仍按每百万输入 token 收费 10 美元、每百万输出 token 收费 50 美元,约为 Sol 刚上线时价格的 2.5 倍。
这已经是两个月内第二款被付费用户指责“变笨”的 OpenAI 旗舰模型。今年 7 月,不少用户称 GPT-5.6 Sol 的顶级推理模式“一夜之间变浅”,Sottiaux 其时否认公司有意削弱性能,但承认团队在尝试不同的“推理力度”配置。

