从 Gromov 到 Connes:Astra 两刀砍掉群论与算子代数两座大山,证书已开源
2026年8月1日,OpenAI抛出一枚重磅消息。其下一代主力模型Astra——当前仅为内部版本——产出十项数学与理论计算机科学全新成果,覆盖高维几何、编码理论、群论、算子代数、量子复杂度、格密码学、极值组合等多个方向。这十个问题每一项都搁置至少十年,核心结论始终无人攻克,绝大多数问题的悬置时间远超过十年。
阅读全文围绕 Claude、Gemini、OpenAI、DeepSeek、AI 编程、模型中转与统一 API 网关,整理适合开发者和企业团队阅读的 AI 资讯与实战教程。
2026年8月1日,OpenAI抛出一枚重磅消息。其下一代主力模型Astra——当前仅为内部版本——产出十项数学与理论计算机科学全新成果,覆盖高维几何、编码理论、群论、算子代数、量子复杂度、格密码学、极值组合等多个方向。这十个问题每一项都搁置至少十年,核心结论始终无人攻克,绝大多数问题的悬置时间远超过十年。
阅读全文2026年8月1日,OpenAI投下一枚重磅炸弹,整个数学界为之哗然。其在官方博客中首次确认下一代旗舰模型Astra——这个词在拉丁语中意为"群星"——的内部版本一举产出十项数学与理论计算机科学全新成果,并发布可供机器验证的证明过程。这十个问题,每一个都搁置至少十年,核心结论始终无人攻克,绝大多数问题的悬置时间远不止十年。
阅读全文2026年5月19日,Google I/O 2026开发者大会。谷歌DeepMind并没有把定价更高的Gemini 3.5 Pro推到C位,反而将名为Flash的模型置于舞台中心——Gemini 3.5 Flash正式全面上线,即日起成为Gemini App(当时月活已突破9亿)与谷歌搜索AI Mode的全球默认模型,同时面向消费者端、开发者端、企业端全部开放。 这绝非一次普通的模型发布,而是在全球范围内改写AI产品的"默认设置"。
阅读全文2026年5月20日,谷歌I/O开发者大会。当业界预期谷歌会推出性能更强的Gemini 3.5 Pro时,主舞台中央站着的却是Gemini 3.5 Flash——一款速度更快、价格更低的模型,被定为Gemini应用与谷歌搜索AI Mode的全球默认模型。
阅读全文"Killed by Google"(被谷歌关停)网站记录了300多款被谷歌终止的产品,是互联网上最知名的"产品坟场"之一。从Google Reader到Inbox,从Wave到Stadia,谷歌关停产品的历史,几乎和它做产品的历史一样长。"产品杀手"这个标签,已经伴随谷歌很多年。 但2026年夏天的这两次动刀,和以往有所不同。
阅读全文2026年7月31日,谷歌AI Studio产品与设计负责人阿马尔·雷希在X平台发布公告:距离这款应用8月1日正式上线还剩不到24小时,项目宣布取消。全球168个国家约80万用户的预约全部清零,App Store与谷歌应用商店的预约页面同步下架。 官方给出的解释只有一句话:"我们不再让大家下载一款全新独立App,而是决定走一条完全不同的路线。"
阅读全文2026年7月19日夜,世界杯决赛正在上演。Anthropic研究员、哈佛大学青年研究员莱文特·阿尔珀格一边和朋友看球闲聊,一边把一道悬置87年的数学难题随手丢给Claude Fable 5。几小时之后,Fable给出一段216字符的反例——雅可比猜想在三维及以上空间被证伪。 该消息在X平台迅速引爆。菲尔兹奖得主蒂莫西·高尔斯评价,这是大语言模型首次解决一个不属于自己研究领域,但早已久闻大名的重大难题。陶哲轩用ChatGPT完成复算后,称这件事堪称巨大奇迹。斯坦福数论学家Jared Duker Lichtman转发并逐步拆解了反例,将其署名写作"Alpoge、Mathew和Claude Fable 5"。
阅读全文2026年7月19日夜,世界杯决赛正在进行。Anthropic研究员、哈佛大学青年研究员莱文特·阿尔珀格一边和朋友看球闲聊,一边把一道悬置87年的数学难题丢给Claude Fable 5。几小时后,Fable输出一个仅216字符的反例——雅可比猜想在三维及以上空间被证伪。
阅读全文2026年7月19日夜,世界杯决赛在沉闷乏味的氛围中进行。Anthropic研究员、哈佛大学青年研究员莱文特·阿尔珀格,一边观赛,一边和好友、芝加哥大学数学教授阿基尔·马修闲聊。或许是球赛太过无趣,又或许只是想"把Fable 5的额度用掉",阿尔珀格随手将一个问题抛给手边的Claude Fable 5。 几小时后,AI给出了一个令人头皮发麻的反例。
阅读全文2026年7月19日深夜,世界杯决赛在沉闷乏味的氛围中打响。Anthropic研究员、哈佛大学青年研究员莱文特·阿尔珀格一边看球,一边和好友、芝加哥大学数学教授阿基尔·马修闲聊。不知是谁先提起代数几何里那个被称作"灾难"的雅可比猜想——这道世纪难题绊倒过无数顶尖数学家,华裔天才数学家张益唐也因它耗尽整个博士阶段,最终不得不转向解析数论方向。 或许是球赛实在太过无聊,阿尔珀格随手把这个问题抛给了手边的Claude Fable 5。 几个小时之后,Fable 5给出的结果,让整个数学界头皮发麻。
阅读全文8月1日,OpenAI研究员塞巴斯蒂安·布贝克宣布,下一代内部模型Astra一举攻克十道长期悬置的数学难题,覆盖高维几何、编码理论、群论、量子复杂度、格密码、极值组合等多个领域,每道问题都有十年以上的学术积淀。按照Sol的API费率计算,全部题解消耗Token成本约2000美元。
阅读全文2026年8月1日,OpenAI在官网宣布,下一代人工智能模型系列将命名为"Astra"。该公司同时公布:其中一款内部测试模型已解决或推动解决10道长期未解的数学难题,完成相关推理所需的词元成本约为2000美元。
阅读全文2026年8月1日,OpenAI首次公开确认下一代模型系列的名称——Astra。这个在拉丁语中意为"群星"的模型,其内部测试版本一次性产出10项数学与理论计算机科学全新成果。 按Sol API费率计算,寻找这些解法所消耗的Token总成本约为2000美元。
阅读全文2026年5月19日,Google I/O开发者大会上,谷歌宣布AI Studio上线全新功能:通过自然语言生成安卓原生应用。现场演示流畅顺滑,台下的掌声却带着几分客套——类似的演示早已屡见不鲜,谁还没用过几款AI编程工具呢? 但一周之后公布的数据,让所有人都沉默了。 上线仅七天,AI Studio已经生成超过25万款安卓应用,其中99%的创作者此前从未接触过安卓开发。
阅读全文2026年7月31日,Google AI Studio团队在X平台宣布:原定于8月1日上线的AI Studio独立移动应用正式取消。此时,这款在5月19日Google I/O 2026上高调亮相的应用,已在Android与iOS双端积累约80万预注册用户,覆盖168个国家和地区。 "我们不打算让大家再下载一个App。"AI Studio产品与设计负责人阿马尔·雷希写道,"应用将在你与Gemini的日常对话中自然涌现。"
阅读全文2026年7月22日,Alphabet公布2026年第二季度财报。CEO桑达尔·皮查伊在电话会议上披露了一组关键数据:Gemini应用月活跃用户达到9.5亿,日活用户增至去年同期的3倍;Gemini等谷歌自研模型API每分钟处理约220亿个Token,较上一季度160亿的处理量增长37.5%。 这是Gemini应用发布以来,月活首次逼近"10亿用户俱乐部"的门槛——该俱乐部成员包括搜索、Gmail、云端硬盘、安卓系统、YouTube、Chrome等谷歌手中的王牌产品。
阅读全文据Anthropic研究员莱文特·阿尔珀厄格在X平台发文称,他使用公开可用的Claude Fable模型,在完全自主、通用提示词、全程断网的条件下,独立复现了Astra成果中的5项。 一款公开模型,只用一天时间,就对另一款未发布模型所宣称的数学发现完成了独立核验。 《莱顿宣言》所担忧的"AI发现速度超过人类评估速度",不再是理论推演,而是以小时为单位正在上演的现实。
阅读全文8月2日前后,Anthropic研究员莱文特·阿尔珀厄格在布贝克的推文下回复:"我用Fable完成了一半。"他复现了第4、5、6、7、8题,合计五道。 整套实验条件干净得无可指摘:完全自主运行、使用通用提示词、全程断网,还专门增设防护机制,杜绝Astra的解题结果泄露到上下文当中。
阅读全文2026年6月初,Epoch AI公布一组测试数据:Claude Fable 5在FrontierMath基准测试的Tiers 1-3题目上准确率达87%,最难度的Tier 4(v2版本)得分达到88%。同一张图表里,OpenAI的GPT-5.5在同一难度下约为75%。在FrontierMath这类被公认为AI数学推理领域最难的基准测试中,13个百分点的差距,意味着模型能力之间存在着难以忽视的代差。
阅读全文2026年8月4日,OpenAI在官方渠道公开了一份62页的PDF文件,题为《How the Ideas Came Together》(思想是如何成型的)。 这并非正式论文。那份249页的研究长文两天前就已经发布,Lean 4形式化证明证书也同步公开。这份62页文档属于另一重产出—— 全文每一字均由AI独立撰写。OpenAI团队明确说明,文档没有经过人类的一字干预。
阅读全文