AI API
2026年7月9日,OpenAI正式对外发布GPT-5.6完整产品家族,分为Sol、Terra、Luna三个版本,定位分别为复杂专业工作旗舰、智能与成本平衡、成本敏感型高容量负载。
旗舰版Sol的宣传语只有一句话,但分量十足:在Agents' Last Exam(ALE)拿到53.6分,领先Claude Fable 5(自适应推理)13.1分。 即便是在中等推理强度下,Sol也以大约四分之一的预估成本领先Fable 5达11.4分。
2min
OpenAIGPT-5.6 Sol在长周期智能体任务上超越Fable 5
阅读全文AI API
2026年7月30日,OpenAI将GPT-5.6 Luna定价由1美元/6美元下调至0.20美元/1.20美元每百万Token。输入成本降为原来1/5,输出降为原来1/5;Luna的价格仅为Sol的1/25。
2min
OpenAIGPT-5.6 Luna
阅读全文AI API
2026年7月30日,OpenAI抛出一则令整个AI行业猝不及防的消息。
GPT-5.6系列正式公开发布仅过去三周,整套定价体系热度还未褪去,OpenAI直接对入门级Luna实施"断崖式降价":输入由1美元/百万Token降至0.20美元,输出由6美元降至1.20美元,降幅高达80%。中端模型Terra同步下调20%,输入降至2美元/百万Token、输出降至12美元/百万Token;旗舰模型Sol定价保持不变。
2min
OpenAIGPT-5.6 Luna降价80%
阅读全文AI API
2026年6月18日,谷歌正式关停Gemini Code Assist的个人免费通道。Gemini Code Assist的IDE扩展和Gemini CLI停止为Gemini Code Assist for individuals,以及Google AI Pro和Ultra方案提供服务;消费版的GitHub应用代码审查活动则延续至7月17日终止。企业版Standard与Enterprise订阅不受影响,IDE辅助、CLI与GitHub审查继续运行。
免费层关闭之后,一个过去被免费试用掩盖的问题浮出水面:你采购的企业席位,究竟有多少人在真正使用?
2min
Gemini企业如何审计Gemini Code Assist
阅读全文AI API
45美元每用户每月,这是Gemini Code Assist企业版的年付定价。谷歌官方定价页写得很清楚:企业版年付承诺为45美元/用户/月,月付则为54美元/用户/月;标准版年付19美元/用户/月,月付22.8美元/用户/月。
很多企业看到这个数字的第一反应:比GitHub Copilot贵,但比Cursor团队版便宜,尚可接受。紧接着第二个疑问:那Token费用怎么算?
2min
GeminiGemini代码助手企业版账单
阅读全文AI API
Gemini企业智能体平台五大消费模式的降本算账逻辑
2026年4月谷歌云Next大会,谷歌完成一次产品级整合:Vertex AI与Agentspace正式合并为Gemini企业级智能体平台(Gemini Enterprise Agent Platform)。原有Vertex AI的API调用与SDK无需改动即可继续运行,变化的是产品定位与计费结构的重新组织。
2min
GeminiGemini企业智能体
阅读全文AI API
2026年4月起,谷歌为Gemini API建立起一套包含标准(Standard)、弹性(Flex)、优先(Priority)、批量(Batch)、上下文缓存(Caching)的五档计费体系。其中最引人注目的是,Flex弹性档与Batch批量档均提供标准价50%的折扣。
同样是半价,但二者底层逻辑完全不同。选错档位,省下的钱会被架构复杂度吞噬;选对档位,几乎不影响业务体验,同时直接把账单砍半。
2min
Gemini企业如何混合选型Gemini业务负载
阅读全文AI API
80.3% 对 58.6%,相差 21.7 个百分点。在很多基准测试里,20 分或许只是险胜与惜败之间的微弱差距,但 SWE-Bench Pro 绝非普通基准。
这套测试本身就是为拉高 AI 拿高分的门槛而设计。它的整体得分天然远低于 SWE-Bench Verified,在这套标尺之下,80.3% 这个分数,足以让其他竞品黯然失色。
2min
ClaudeFable 5 与 GPT-5.5 之间的代差究竟是什么
阅读全文AI API
输入 10 美元/百万 token、输出 50 美元/百万 token。Fable 5 的定价恰好是 GPT-5.5(输入 5 美元/输出 30 美元)的两倍。如果只看价目表,结论很简单:Fable 5 贵一倍。
但结合基准测试与真实任务表现来看,结论截然不同
2min
ClaudeFable 5 与 GPT-5.5 的这笔账该怎么算
阅读全文AI API
Anthropic在2026年6月9日的官方公告中援引Stripe的早期测试数据:一个5000万行的Ruby代码库整体迁移,人工团队评估需要两个多月,Fable 5只用一天便完成。官方表述是"将数月工程量压缩为数天"。
核心差异不在于"写代码更快",而在于"你不需要守在旁边盯全过程"。
2min
ClaudeFable 5多日自主智能体如何重构软件工程
阅读全文AI API
2026年6月9日,Anthropic做出一件令整个开发者圈屏息的大事:Mythos(秘典)层级模型首次对外开放调用。
支付巨头Stripe给出了一份惊人的早期测试数据:面对一个5000万行Ruby代码的巨型代码库,Fable 5仅用一天就完成了整体迁移;如果交给人工团队完成,需要两个多月。
一天 vs 两个月。这不仅是效率的量级跃迁,更是工程师角色从"写代码"转向"审代码"的转折点信号。
2min
ClaudeClaude Fable 5
阅读全文AI API
2026年8月6日,OpenAI亲手终结了这种体验。它在产品理念上完成一次"统一":Instant与深度思考由同一个模型驱动,希望调高思考档位时的体验是"同一个模型想得更久",而不是切换到另一个语气和风格都不同的模型。
这个模型就是GPT-5.6 Sol。
2min
OpenAIGPT-5.6 Sol
阅读全文AI API
2026年8月6日,OpenAI发布了一篇篇幅不长的更新公告。如果只看标题,外界或许会以为这只是一次常规模型调优:GPT-5.6 Sol在金融、医疗、法律等领域的事实性提示中,包含至少一处事实错误的回答占比,比GPT-5.5 Instant降低约68%;Plus与Pro用户新增一枚可调节思考深度的滑块控件。
但把两件事放在一起看,整件事的意味就截然不同。
2min
OpenAIGPT-5.6 Sol思考滑块
阅读全文AI API
2026年8月6日,OpenAI宣布了一项看似简单、但细思意味深远的改动。
自本周起,ChatGPT免费用户与Go套餐订阅者的默认模型升级为GPT-5.6 Luna;自下周起,无限制文本聊天全面开放,同时新增一枚思考(Think)按钮——遇到难题时点击,模型就会投入更多时间深度推理,再输出答案。
2min
OpenAIGPT-5.6 Luna思考按钮如何重塑免费版体验
阅读全文AI API
2026年6月,某初创公司CTO盯着Google Cloud账单,表情僵住。预算上限600新元,4天就烧掉435新元,其中89%都是思考Token。另一个团队使用Gemini 3.5 Flash做简单OCR转录任务:输入1107 Token,输出1193 Token,但总Token计数却显示4598。中间凭空多出2298个Token,没有任何SDK会对外暴露这部分数据。
标价是透明的,但账单并不透明。
2min
Gemini为什么你的Gemini账单常高于预估
阅读全文AI API
Gemini企业账单中真正的"隐性开销",从来都不是定价表上明明白白罗列的数字。根据Google官方定价文档,这些成本来源于三套相互叠加的计费规则——它们全部写在文档里,只是藏在不起眼的角落。
2min
GeminiGemini企业账单里被低估的隐性成本
阅读全文AI API
Google 官方文档写得明明白白:自 2025 年 5 月 8 日起,Gemini 2.5 及更新模型默认开启隐式缓存(implicit caching)。当多条请求拥有相同的前缀内容(例如超长系统提示词、固定背景文档),Gemini 后端会自动缓存这些公共部分。缓存命中后,这部分输入 token 费用直接降为标准价格的十分之一——即 90% 的折扣。隐式缓存完全免收存储费,且节省的费用会自动返还给用户。
2min
GeminiGoogle Cloud 暗藏的90%折扣
阅读全文AI API
Claude Fable 5在GPQA钻石难度集取得92.6%的分数,而Claude Opus 4.8拿到93.6%。被上一代模型反超。
但在HLE(人类终极考试)基准上,Fable 5拿到53.3%,Opus 4.8在Artificial Analysis统计口径下仅为45.7%。实现碾压。
2min
ClaudeFable 5的推理优势究竟来自哪里
阅读全文AI API
2026 年 7 月,BenchLM 的编辑在例行页面更新时,不得不删掉一条写了两年的文案。被删除的那句话是:"没有任何模型能在 HLE 基准上突破 50%"。
删掉一句话只需要一秒钟。但 Claude Fable 5 只用不到一个月,就让这条曾经的事实沦为历史。
2min
ClaudeFable 5 高出对手 7 分以上意味着什么
阅读全文AI API
2026年6月8日,Cognition推出FrontierCode基准。当几乎所有模型都能在SWE-Bench上拿到90分以上时,这套新基准不再考察代码能否正常运行,而是抛出一个直白尖锐的问题:项目维护者,你真的会合并这段代码吗?
测试分数随即出现断崖式崩塌:钻石难度档位下,GPT-5.5仅5.7%,Claude Opus 4.8为13.4%;唯一突破20%的是Claude Fable 5,达到29.3%。
2min
ClaudeClaude Fable 5
阅读全文