AI API 2026年8月7日
2026年6月8日,Cognition推出FrontierCode基准。当几乎所有模型都能在SWE-Bench上拿到90分以上时,这套新基准不再考察代码能否正常运行,而是抛出一个直白尖锐的问题:项目维护者,你真的会合并这段代码吗?
测试分数随即出现断崖式崩塌:钻石难度档位下,GPT-5.5仅5.7%,Claude Opus 4.8为13.4%;唯一突破20%的是Claude Fable 5,达到29.3%。
2min
Claude Claude Fable 5
阅读全文 AI API 2026年8月7日
2026年8月6日,OpenAI宣布ChatGPT免费用户将迎来两项重要更新:默认模型升级为GPT-5.6 Luna,下周起开放无限文本聊天,并新增一枚"思考(Think)"按钮。
这枚按钮听上去轻描淡写,但放在三年前,几乎如同天方夜谭。
2min
OpenAI ChatGPT ChatGPT免费版上线"思考"按钮
阅读全文 AI API 2026年8月7日
2026年8月6日,OpenAI重新诠释了"无限"这个词。
就在ChatGPT周活跃用户突破10亿的同一周,OpenAI宣布免费用户将获得无限制文本聊天权限,默认模型升级为GPT-5.6 Luna。消息一出,舆论一片叫好。
2min
OpenAI OpenAI在2026年8月6日重新定义的无限
阅读全文 AI API 2026年8月7日
官方公告显示:从下周开始,ChatGPT免费用户将获得无限制文本聊天权限,默认模型由GPT-5.5 Instant升级为GPT-5.6 Luna,同时新增一枚"思考(Think)"按钮,免费用户可以手动开启更高等级的推理能力。Plus和Pro用户则迎来调优后的GPT-5.6 Sol,新增可调节"思考强度"的滑动条。
寥寥数句话。但发布这条消息之时,ChatGPT的周活跃用户已经达到10亿。
2min
OpenAI GPT-5.6 Luna
阅读全文 AI API 2026年8月7日
谷歌官方定价页面显示,Gemini 3.5 Flash标准输入定价为每百万token 1.5美元。一旦请求命中缓存,输入单价直接降至每百万token 0.15美元——恰好是原价的十分之一。此外,缓存内容还会产生存储费用,为每百万token每小时1美元。
2min
Gemini Gemini 3.5上下文缓存如何改写企业AI账单逻辑
阅读全文 AI API 2026年8月7日
2026年5月19日,谷歌I/O开发者大会的舞台上,桑达尔·皮查伊算了一笔账。他表示,谷歌云头部客户每日处理约1万亿token;如果将80%的业务负载从其他前沿模型迁移至Gemini 3.5 Flash,每年能够节省超过10亿美元。
2min
Gemini Gemini 3.5 Flash如何改写企业AI部署的经济临界点
阅读全文 AI API 2026年8月7日
2.8万美元对比1.45万美元。这并非理想化测算,而是一家中型制造企业在将八成AI推理负载从其他前沿模型迁移至Gemini 3.5 Flash之后,真实发生的月度账单变化。
但如果你以为这只是简单的"单价减半"算术题,那你就错过了这场成本革命中真正值得关注的部分。
2min
Gemini Gemini 3.1 Pro
阅读全文 AI API 2026年8月7日
如果只看一个数字,Claude Fable 5 在编程领域似乎对 GPT-5.5 形成了"碾压"——FrontierCode Diamond 评测中,29.3% 对 5.7%,差距超过五倍。
但事情远没有这么简单。真正拉开 Fable 5 与 GPT-5.5 距离的,并不是 SWE-Bench Verified 上 95.0% 与 90% 以上的高分对决,而是在 FrontierCode Diamond 这一"地狱难度"下的降维打击。29.3% 对 5.7%,这不只是"跑得更快",而是踏入了另一个竞技赛场。
1min
Claude Claude Fable 5 在编程领域似乎对 GPT-5.5 形成了"碾压"
阅读全文 AI API 2026年8月7日
从 Opus 4.8 上线,到 Fable 5 接棒登场,Anthropic 只用了大约 11 天。而 Opus 4.7 迭代到 4.8,耗时 43 天。同一家实验室,两个相邻版本,研发周期从 43 天压缩至 11 天——这个数字,比任何基准跑分都更值得深思。
1min
Claude Claude Fable 5 接棒 Opus 4.8
阅读全文 AI API 2026年8月7日
2026 年 6 月 9 日,Anthropic 对外发布 Claude Fable 5,首次将 Mythos 层级模型向一般用户开放。这是继 Opus 系列之后,Claude 模型体系又一次具有分水岭意义的迭代。
2min
Claude Claude Fable 5 刷新 SWE-Bench Verified 历史最高分
阅读全文 AI API 2026年8月6日
ChatGPT 团队私下承认过一件事:普通版 ChatGPT 本质上就是一台"答题机器"——输出事实、帮你写论文,却无法像老师或优秀导师那样真正帮你掌握知识。第三方教育观察显示,超过 70% 的学生把它当作完成课业的首要工具。你问什么,它就答什么。速度很快,但学生学不到东西。
"答题机器"这个标签,已经成为 AI 教育最大的敌人。
3min
OpenAI ChatGPT 学习模式
阅读全文 AI API 2026年8月6日
2025年7月29日,OpenAI 推出学习模式(Study Mode)。2026年7月,OpenAI 进一步更新青少年安全功能,家长可以通过关联账户,为子女远程开启"学习模式",让每一次新对话默认进入该模式。OpenAI 正在做一件反直觉的事:教会模型如何"不给答案"。
3min
OpenAI ChatGPT 学习模式与教育 AI 的治理启示
阅读全文 AI API 2026年8月6日
在签署 ChatGPT Edu 协议之前,不少高校发现了一个令人不安的事实:已有成千上万名的师生与员工,使用学校邮箱注册了公开版 ChatGPT。这意味着学生成绩、科研数据、课程材料——这些受《家庭教育权利与隐私法案》(FERPA)保护的教育记录,正在被输入到一个默认会拿用户数据训练模型的公共平台。
3min
OpenAI 教育数据合规与 AI 接入的成本账
阅读全文 AI API 2026年8月6日
2026年8月4日,OpenAI推出三款教育插件,分别面向K-12教师、大学教师与大学生。根据官方披露,这三款插件可自动生成练习题、学习指南、交互式教学网页,将课程资料转化为课堂资源,一整套备课流程基本可以闭环完成。
3min
OpenAI OpenAI 的教育基础设施化算盘
阅读全文 AI API 2026年8月6日
2026年9月4日起,Google Assistant 将在安卓手机与配对设备上分阶段下线,由 Gemini 全面接管。根据谷歌官方邮件,此次迁移将在数周内分批完成,一旦设备完成切换,用户将无法在手机、平板电脑或配对设备上继续使用或切换回 Google Assistant。与手机配对的 Wear OS 手表、兼容耳机及 Android Auto 汽车也将同步更新为 Gemini,但内置 Google built-in 服务的汽车暂不受影响。
真正让我体会到 Google Assistant 有多"笨拙"的,不是 Gemini 的跑分,而是抬腕说话那短短几秒里,体验层面的根本性颠覆。
3min
Gemini Gemini 3.5 Pro
阅读全文 AI API 2026年8月6日
2026年9月4日起,谷歌将开始从安卓手机、平板电脑以及配对设备上分批移除 Google Assistant,由 Gemini 全面接替。整个迁移预计持续数周,一旦设备完成切换,用户将无法继续使用或回退至 Google Assistant。与手机配对的 Wear OS 手表、兼容耳机及 Android Auto 车载投影端,同样在切换清单中。
但问题在于,并非所有手表都能用上 Gemini——"能不能用"与"能不能用得好",是两道完全不同的门槛。
3min
Gemini Wear OS 与 Gemini 的"分水岭时刻"
阅读全文 AI API 2026年8月6日
2026年谷歌I/O大会上,谷歌发布Gemini Spark。海外媒体在报道中指出,Spark 标志着 Gemini 发展的一次重大转型——从"回答问题的助手",演变为"能够引导用户、主动提供帮助的行动伙伴"。
"回答问题"与"代为执行动作",二者的本质区别,是整套AI交互范式的重构。
2min
Gemini Gemini Spark 与智能体时代的成本账
阅读全文 AI API 2026年8月6日
晚上十一点,你合上笔记本电脑,洗漱完毕上床睡觉。与此同时,云端有另一个"你",正在替你处理剩余工作:整理收件箱积压邮件,把上周会议纪要转换成文档草稿,监控订阅续费提醒,同时从本地文件夹取出明天要用的预算表并发给你。
这并非科幻,这就是 Gemini Spark。
3min
Gemini Gemini Spark 与"全天候智能体"的成本账
阅读全文 AI API 2026年8月6日
2026年7月24日,Anthropic发布Claude Opus 5。官方公布的价目表没有变动:输入5美元/百万Token,输出25美元/百万Token——与其前身Opus 4.8定价完全一致。
但企业实际算力账单、投资回报比,已经被彻底改写。
3min
Claude Opus 5 如何重写企业 AI 成本账
阅读全文 AI API 2026年8月6日
2026年7月24日,Anthropic发布Claude Opus 5。在系统卡文档中,官方强调Opus 5是迄今为止安全对齐等级最高的模型之一,鲁莽行为与欺骗行为的发生概率在全系中处于低位。
3min
Claude Claude Opus 5
阅读全文