AI API
2026年6月9日,Anthropic做出一件令整个开发者圈屏息的大事:Mythos(秘典)层级模型首次对外开放调用。
支付巨头Stripe给出了一份惊人的早期测试数据:面对一个5000万行Ruby代码的巨型代码库,Fable 5仅用一天就完成了整体迁移;如果交给人工团队完成,需要两个多月。
一天 vs 两个月。这不仅是效率的量级跃迁,更是工程师角色从"写代码"转向"审代码"的转折点信号。
2min
ClaudeClaude Fable 5
阅读全文AI API
2026年8月6日,OpenAI亲手终结了这种体验。它在产品理念上完成一次"统一":Instant与深度思考由同一个模型驱动,希望调高思考档位时的体验是"同一个模型想得更久",而不是切换到另一个语气和风格都不同的模型。
这个模型就是GPT-5.6 Sol。
2min
OpenAIGPT-5.6 Sol
阅读全文AI API
2026年8月6日,OpenAI发布了一篇篇幅不长的更新公告。如果只看标题,外界或许会以为这只是一次常规模型调优:GPT-5.6 Sol在金融、医疗、法律等领域的事实性提示中,包含至少一处事实错误的回答占比,比GPT-5.5 Instant降低约68%;Plus与Pro用户新增一枚可调节思考深度的滑块控件。
但把两件事放在一起看,整件事的意味就截然不同。
2min
OpenAIGPT-5.6 Sol思考滑块
阅读全文AI API
2026年8月6日,OpenAI宣布了一项看似简单、但细思意味深远的改动。
自本周起,ChatGPT免费用户与Go套餐订阅者的默认模型升级为GPT-5.6 Luna;自下周起,无限制文本聊天全面开放,同时新增一枚思考(Think)按钮——遇到难题时点击,模型就会投入更多时间深度推理,再输出答案。
2min
OpenAIGPT-5.6 Luna思考按钮如何重塑免费版体验
阅读全文AI API
2026年6月,某初创公司CTO盯着Google Cloud账单,表情僵住。预算上限600新元,4天就烧掉435新元,其中89%都是思考Token。另一个团队使用Gemini 3.5 Flash做简单OCR转录任务:输入1107 Token,输出1193 Token,但总Token计数却显示4598。中间凭空多出2298个Token,没有任何SDK会对外暴露这部分数据。
标价是透明的,但账单并不透明。
2min
Gemini为什么你的Gemini账单常高于预估
阅读全文AI API
Gemini企业账单中真正的"隐性开销",从来都不是定价表上明明白白罗列的数字。根据Google官方定价文档,这些成本来源于三套相互叠加的计费规则——它们全部写在文档里,只是藏在不起眼的角落。
2min
GeminiGemini企业账单里被低估的隐性成本
阅读全文AI API
Google 官方文档写得明明白白:自 2025 年 5 月 8 日起,Gemini 2.5 及更新模型默认开启隐式缓存(implicit caching)。当多条请求拥有相同的前缀内容(例如超长系统提示词、固定背景文档),Gemini 后端会自动缓存这些公共部分。缓存命中后,这部分输入 token 费用直接降为标准价格的十分之一——即 90% 的折扣。隐式缓存完全免收存储费,且节省的费用会自动返还给用户。
2min
GeminiGoogle Cloud 暗藏的90%折扣
阅读全文AI API
Claude Fable 5在GPQA钻石难度集取得92.6%的分数,而Claude Opus 4.8拿到93.6%。被上一代模型反超。
但在HLE(人类终极考试)基准上,Fable 5拿到53.3%,Opus 4.8在Artificial Analysis统计口径下仅为45.7%。实现碾压。
2min
ClaudeFable 5的推理优势究竟来自哪里
阅读全文AI API
2026 年 7 月,BenchLM 的编辑在例行页面更新时,不得不删掉一条写了两年的文案。被删除的那句话是:"没有任何模型能在 HLE 基准上突破 50%"。
删掉一句话只需要一秒钟。但 Claude Fable 5 只用不到一个月,就让这条曾经的事实沦为历史。
2min
ClaudeFable 5 高出对手 7 分以上意味着什么
阅读全文AI API
2026年6月8日,Cognition推出FrontierCode基准。当几乎所有模型都能在SWE-Bench上拿到90分以上时,这套新基准不再考察代码能否正常运行,而是抛出一个直白尖锐的问题:项目维护者,你真的会合并这段代码吗?
测试分数随即出现断崖式崩塌:钻石难度档位下,GPT-5.5仅5.7%,Claude Opus 4.8为13.4%;唯一突破20%的是Claude Fable 5,达到29.3%。
2min
ClaudeClaude Fable 5
阅读全文AI API
2026年8月6日,OpenAI宣布ChatGPT免费用户将迎来两项重要更新:默认模型升级为GPT-5.6 Luna,下周起开放无限文本聊天,并新增一枚"思考(Think)"按钮。
这枚按钮听上去轻描淡写,但放在三年前,几乎如同天方夜谭。
2min
OpenAIChatGPTChatGPT免费版上线"思考"按钮
阅读全文AI API
2026年8月6日,OpenAI重新诠释了"无限"这个词。
就在ChatGPT周活跃用户突破10亿的同一周,OpenAI宣布免费用户将获得无限制文本聊天权限,默认模型升级为GPT-5.6 Luna。消息一出,舆论一片叫好。
2min
OpenAIOpenAI在2026年8月6日重新定义的无限
阅读全文AI API
官方公告显示:从下周开始,ChatGPT免费用户将获得无限制文本聊天权限,默认模型由GPT-5.5 Instant升级为GPT-5.6 Luna,同时新增一枚"思考(Think)"按钮,免费用户可以手动开启更高等级的推理能力。Plus和Pro用户则迎来调优后的GPT-5.6 Sol,新增可调节"思考强度"的滑动条。
寥寥数句话。但发布这条消息之时,ChatGPT的周活跃用户已经达到10亿。
2min
OpenAIGPT-5.6 Luna
阅读全文AI API
谷歌官方定价页面显示,Gemini 3.5 Flash标准输入定价为每百万token 1.5美元。一旦请求命中缓存,输入单价直接降至每百万token 0.15美元——恰好是原价的十分之一。此外,缓存内容还会产生存储费用,为每百万token每小时1美元。
2min
GeminiGemini 3.5上下文缓存如何改写企业AI账单逻辑
阅读全文AI API
2026年5月19日,谷歌I/O开发者大会的舞台上,桑达尔·皮查伊算了一笔账。他表示,谷歌云头部客户每日处理约1万亿token;如果将80%的业务负载从其他前沿模型迁移至Gemini 3.5 Flash,每年能够节省超过10亿美元。
2min
GeminiGemini 3.5 Flash如何改写企业AI部署的经济临界点
阅读全文AI API
2.8万美元对比1.45万美元。这并非理想化测算,而是一家中型制造企业在将八成AI推理负载从其他前沿模型迁移至Gemini 3.5 Flash之后,真实发生的月度账单变化。
但如果你以为这只是简单的"单价减半"算术题,那你就错过了这场成本革命中真正值得关注的部分。
2min
GeminiGemini 3.1 Pro
阅读全文AI API
如果只看一个数字,Claude Fable 5 在编程领域似乎对 GPT-5.5 形成了"碾压"——FrontierCode Diamond 评测中,29.3% 对 5.7%,差距超过五倍。
但事情远没有这么简单。真正拉开 Fable 5 与 GPT-5.5 距离的,并不是 SWE-Bench Verified 上 95.0% 与 90% 以上的高分对决,而是在 FrontierCode Diamond 这一"地狱难度"下的降维打击。29.3% 对 5.7%,这不只是"跑得更快",而是踏入了另一个竞技赛场。
1min
ClaudeClaude Fable 5 在编程领域似乎对 GPT-5.5 形成了"碾压"
阅读全文AI API
从 Opus 4.8 上线,到 Fable 5 接棒登场,Anthropic 只用了大约 11 天。而 Opus 4.7 迭代到 4.8,耗时 43 天。同一家实验室,两个相邻版本,研发周期从 43 天压缩至 11 天——这个数字,比任何基准跑分都更值得深思。
1min
ClaudeClaude Fable 5 接棒 Opus 4.8
阅读全文AI API
2026 年 6 月 9 日,Anthropic 对外发布 Claude Fable 5,首次将 Mythos 层级模型向一般用户开放。这是继 Opus 系列之后,Claude 模型体系又一次具有分水岭意义的迭代。
2min
ClaudeClaude Fable 5 刷新 SWE-Bench Verified 历史最高分
阅读全文AI API
ChatGPT 团队私下承认过一件事:普通版 ChatGPT 本质上就是一台"答题机器"——输出事实、帮你写论文,却无法像老师或优秀导师那样真正帮你掌握知识。第三方教育观察显示,超过 70% 的学生把它当作完成课业的首要工具。你问什么,它就答什么。速度很快,但学生学不到东西。
"答题机器"这个标签,已经成为 AI 教育最大的敌人。
3min
OpenAIChatGPT 学习模式
阅读全文