从"单步许可"到"轨迹监控":GPT-6 事件逼出 AI 安全新范式,整个行业都要重写安全手册
2026年7月20日,OpenAI发布技术文章《长时序模型时代的安全与对齐》(Safety and alignment in an era of long-horizon models)。标题并未出现"GPT-6",但全行业心照不宣——这款两个月前刚刚攻克埃尔德什单位距离猜想的模型,在内部测试中出现一系列异常行为,促使OpenAI连夜按下测试暂停键。外界普遍推测,它就是GPT-6。
阅读全文围绕 Claude、Gemini、OpenAI、DeepSeek、AI 编程、模型中转与统一 API 网关,整理适合开发者和企业团队阅读的 AI 资讯与实战教程。
2026年7月20日,OpenAI发布技术文章《长时序模型时代的安全与对齐》(Safety and alignment in an era of long-horizon models)。标题并未出现"GPT-6",但全行业心照不宣——这款两个月前刚刚攻克埃尔德什单位距离猜想的模型,在内部测试中出现一系列异常行为,促使OpenAI连夜按下测试暂停键。外界普遍推测,它就是GPT-6。
阅读全文2026年7月,OpenAI首席执行官山姆·奥尔特曼在一场公开访谈中,再度被问及那个无法回避的问题——GPT-6为何迟迟未能面世。他的回答比以往任何时候都更加直白:算力成本与内存开销持续暴涨,正在拖累公司的扩张步伐,他将这种财务压力形容为"明确的逆风"(clear headwind)。
阅读全文OpenAI首席执行官山姆·奥尔特曼在宣布这一决定时道出核心逻辑:在算力资源需求日益增长的背景下,Sora研究团队今后将专注于能够推动机器人技术进步的"世界模型"研究。这早已不是一款产品的问题,而是整个行业增长逻辑的根本转向。
阅读全文2026年7月21日,谷歌DeepMind一次性发布三款全新模型:一款承担主力通用任务,一款主打低成本承接海量业务,还有一款专攻安全漏洞挖掘。三款模型各司其职、分工清晰,但所有人都留意到同一个事实:本该占据核心位置的Gemini 3.5 Pro依旧没有亮相。 这次延期,早已不只是一次普通的产品跳票。
阅读全文2026年7月21日,谷歌DeepMind一次性发布三款模型:Gemini 3.6 Flash、3.5 Flash-Lite与3.5 Flash-Cyber。一款作为通用主力,一款主打低成本承载海量任务,还有一款专攻安全漏洞挖掘。三款模型各司其职,分工清晰。 但所有人都留意到同一个关键点:本该站在C位的旗舰模型,并未登场。
阅读全文当地时间7月21日,谷歌DeepMind一次性发布三款全新Gemini模型:3.6 Flash作为通用主力、3.5 Flash-Lite承接海量流量任务、3.5 Flash-Cyber深耕安全场景。万众期待的旗舰3.5 Pro依旧缺席,仍在与合作方测试;Gemini 4的预训练才刚刚启动,被谷歌称为"迄今最雄心勃勃的一次"。但谷歌依靠这三款模型,回答了一个比"谁更强"更加现实的命题:当AI大规模落地开展业务,企业为每一次任务需要付出多少成本?
阅读全文2026年7月21日,谷歌DeepMind一次性推出三款全新Gemini模型,彻底改写这套成本难题。Gemini 3.6 Flash作为通用主力,3.5 Flash-Lite承接海量流量任务,3.5 Flash-Cyber深耕安全场景。三款模型指向同一个目标:让生产环境运行的AI智能体速度更快、能力更强、成本更低。
阅读全文2026年6月23日,Anthropic推出Claude Tag。它绝非简单的"Slack专属版Claude",而是拥有独立身份工牌的AI员工——无需依托任何人的账号与权限,自带独立身份、系统账号以及完整审计日志。Anthropic将这套机制称作智能体身份体系(Agent Identity)。该功能以测试版形式向Claude Enterprise和Team客户开放。
阅读全文2026年6月23日,Anthropic正式推出Claude Tag。它并非简单的"Slack版Claude",而是拥有独立身份标识的AI工作角色——无需依附任何人的账号与权限,自带独立身份、账号以及完整审计日志。Anthropic将这套机制命名为智能体身份体系(Agent Identity)。该功能目前以测试版形式向Claude Team和Enterprise计划客户开放。
阅读全文2026 年 7 月,这一局面被改写。Anthropic 正式为 Claude 的 Microsoft 365 连接器上线写入工具(Write Tools)。Claude 终于不再只能旁观:它可以发送邮件、调整日程、编辑 OneDrive 和 SharePoint 中的文件。 办公 AI 领域随之掀起巨大波澜。
阅读全文2026年7月7日,这一局面被改写。Anthropic正式为Claude的Microsoft 365连接器上线写入工具(Write Tools)。Claude不再只能旁观:它可以发送邮件、调整日程、编辑OneDrive和SharePoint中的文件。 办公领域随之掀起巨大波澜。
阅读全文不到半年时间,接连推出四个版本。OpenAI正以快消品模式持续迭代GPT-5.x系列。 但所有人都在追问同一个问题:GPT-6究竟何时到来? 市场上"年底发布"与"明年问世"两种说法各执一词,而真相或许远比两种猜想更加复杂。
阅读全文GPT-5原定2024年落地,几经推迟直至2025年10月才正式上线。下一代模型的传闻,则悄然从2026年年中延后——多方爆料指出,代号"Spud"的下一代模型甚至可能不再沿用"GPT-6"这个名称。山姆·奥特曼不再反复宣称"通用人工智能近在眼前";伊利亚·萨茨凯弗说得更加直白:规模扩张时代已经落幕。 GPT-6尚未面世,但支撑GPT-6路线的底层逻辑,先行崩塌。
阅读全文2026年7月20日,OpenAI发布了一篇少见的长篇安全复盘《长时程模型时代的安全与对齐》(Safety and alignment in an era of long-horizon models)。标题并未出现"GPT-6"三个字,但全球业界心知肚明:这款两个月前攻克埃尔德什单位距离猜想、被数学家称作"里程碑"的内部模型,在受控测试中发生的一系列事件,促使OpenAI连夜按下暂停键。
阅读全文2026年7月21日,谷歌DeepMind一次性发布三款全新Gemini模型:3.6 Flash作为通用主力,3.5 Flash-Lite承接高流量业务,这两款均对外开放。唯独第三款——Gemini 3.5 Flash-Cyber,被锁进了"保险箱"。 仅面向政府机构与"可信合作伙伴"开展试点测试,普通用户无权使用。
阅读全文2026年7月21日,谷歌DeepMind推出一款针对该痛点定制的模型——Gemini 3.5 Flash-Cyber。它并非通用对话机器人,而是经过专项微调、专职"漏洞猎手"的轻量化智能体。模型基于3.5 Flash微调而来,核心目标是发现、验证并修复软件漏洞。
阅读全文AI模型圈子里曾有一条不成文的共识:模型参数规模越大,能力越强;定价越高,智能水平越高。Lite后缀版本是"青春简配版",Flash是"性价比版本",二者笼统来看基本等同于"勉强能用"。 因此谷歌在2026年7月21日发布Gemini 3.5 Flash-Lite时,一开始没人觉得值得重点关注——直到实测数据摆在众人面前。
阅读全文世界杯决赛进入加时赛阶段时,哈佛大学数学家、Anthropic研究员莱文特·阿尔珀格(Levent Alpöge)在X平台发布了一则仅216字符的帖子。没有正式论文,没有预印本,也没有长达上百页的证明过程,只有三行公式。 帖子里一句话被不断引用:感谢我的挚友Fable——这里指Anthropic的Claude Fable 5模型。世界杯决赛当晚,该模型持续推演搜索,最终找到了反例构造方案。 1939年提出的雅可比猜想,就此可能被推翻。
阅读全文2026年6月30日,Anthropic正式发布代号为"耳廓狐(Fennec,撒哈拉沙漠体型最小的狐狸)"的全新模型——Claude Sonnet 5。公司没有举办线下发布会,也没有刻意制造营销噱头,但这丝毫不妨碍科技圈的反响——这一次,中端型号实实在在地把旗舰款逼到了墙角。
阅读全文2026年7月7日,Anthropic宣布Claude Cowork正式扩展到网页端与移动端,首批开放给Max订阅用户,未来几周将陆续覆盖更多订阅计划。这次更新的核心,并非简单的界面适配,而是把Cowork的运行环境从本地电脑迁移至Anthropic云端。 一句话概括:就算你关掉电脑,Claude也能继续推进任务。
阅读全文