通义千问升级Qwen3.8-max-0902,编码能力超Claude Opus
有用户提问中国是否做出了自家版本的Fable模型。回复称通义千问发布升级版Qwen3.8-max-0902,针对编码与协作场景进一步训练,可处理更长任务、调用更多工具并构建完整应用。该模型在代码竞技场网页开发测试中超过Claude Opus 5,在部分智能体任务上接近Fable 5。
有用户提问中国是否做出了自家版本的Fable模型。回复称通义千问发布升级版Qwen3.8-max-0902,针对编码与协作场景进一步训练,可处理更长任务、调用更多工具并构建完整应用。该模型在代码竞技场网页开发测试中超过Claude Opus 5,在部分智能体任务上接近Fable 5。
The Information报道称OpenAI曾考虑将下一代模型命名为GPT-6,但作者认为更可能叫GPT-5.7或直接保留GPT-Astra名称。该模型采用recurrent depth机制,允许部分推理在隐藏数值表征中完成,而非以人类可读文本呈现。
有用户发帖称,同样花200美元,Kimi K3每月可输出约670亿个令牌,是Claude Max 20x月均约200亿的30倍,质疑为何用户仍选择Claude。另一用户回复称Kimi质量差且耗费令牌过多。
有用户公开表示,希望即将推出的Astra不要以"GPT-5.7 Astra"形式发布,认为仅使用"Astra"作为名称听起来更好。
有消息称谷歌Gemini 3.8 Flash最快可能于今日发布,内部代号"Skimaki",已在Jetski编程平台内部测试,工程师在编程对比测试中认为其表现优于Claude Opus。
据泄露信息,GPT Astra 将于明日发布,采用名为"循环深度"(recurrent depth)的新型推理方法,允许模型对问题进行反复推理,有望同时提升智能水平与效率。不过研究人员对该方法表示担忧。
有人提问,是否会继续升级Astra,还是会在底层模型迭代时保留这一名称。回复者表示尚不确定,但认同取消版本编号、改用更具辨识度名称的做法。
有人询问 Gemini 是否为 3.6 版本,怀疑谷歌限制其直接回答 3.7 相关问题,Gemini 回复称实际上是 Gemini 3.8 Flash。截至目前谷歌尚未发布 3.8 版本。
据传OpenAI放弃GPT 6命名,下一代模型可能以GPT Astra命名,或以GPT 5.7等增量版本号发布。
据称 OpenAI 内部曾考虑将 Astra 命名为 GPT-6,但最终未采纳。这意味着 Astra 之后的下一代模型才被定位为 GPT-6 级别跨越。Astra 在测试中取得 100% exploitbench 分数并发现零日漏洞。
预告显示,GPT 5.6 Sol 子代理功能将于明日开放使用,并邀请用户提前准备。
有声音表示,若 Astra 的定价高于 Sol,用户将面临较大压力。该说法属于个人猜测,未提供具体价格信息。
有用户发布动态称,GPT-Astra可能于本周四发布。知名爆料者Dan此前曾发帖表示Fable 5.1将延期至明日发布,但随后删除了该帖,引发对其爆料可靠性的讨论。
有用户根据泄露者动态推测,GPT-Astra可能于本周四发布。另有泄露者此前发布Fable 5.1更新后删除原文,并称Fable 5.1已推迟至明日。
消息指出,Gemini 3.5 Pro 的内部候选版本被全部废弃,因此从未对外发布。Gemini 4 在预训练评估中表现良好,但目前仍需完成后训练才能正式推出。
据用户预测,九月将成为AI产品发布密集期。Fable 5.1已于昨日上线,Gemini 3.8 Flash预计今日发布,Astra很可能于明日亮相,Grok 4.7将在10天内推出。
据称,OpenAI即将推出的Astra模型是首个达到关键级别网络安全能力门槛的OpenAI模型。该模型据称能够在无人类逐步指导的情况下,自主发现此前未知的安全漏洞、研究漏洞利用方法,并跨越防护完善的系统执行任务。相关讨论认为Astra在网络安全领域的表现将非常突出。
有用户回复称,Claude Opus 5使用体验确实糟糕,不过Gemini一直拥有不错的性格;若后训练做得更好,Gemini有望成为出色的模型。
有消息称,谷歌工程师在编码任务中更倾向使用 Gemini 3.8 Flash 而非 Claude Opus。谷歌自今年初持续投入强化学习资源以缩小编码差距,并聘请前 OpenAI 训练后负责人 Barret Zoph 担任研究副总裁。
有爆料称,谷歌今日正式推出 Gemini 3.8 Flash,内部代号 Skimaki,已在员工中进行测试。爆料还称,工程师在并排编码测试中更偏好其表现,相对 Gemini 3.7 Flash 有重大改进。