AI API 2026年8月5日
2026年6月初,Epoch AI公布一组测试数据:Claude Fable 5在FrontierMath基准测试的Tiers 1-3题目上准确率达87%,最难度的Tier 4(v2版本)得分达到88%。同一张图表里,OpenAI的GPT-5.5在同一难度下约为75%。在FrontierMath这类被公认为AI数学推理领域最难的基准测试中,13个百分点的差距,意味着模型能力之间存在着难以忽视的代差。
3min
Claude Fable 5的数学跃迁 与算力平权的时代底色
阅读全文 AI API 2026年8月5日
2026年8月4日,OpenAI在官方渠道公开了一份62页的PDF文件,题为《How the Ideas Came Together》(思想是如何成型的)。
这并非正式论文。那份249页的研究长文两天前就已经发布,Lean 4形式化证明证书也同步公开。这份62页文档属于另一重产出——
全文每一字均由AI独立撰写。OpenAI团队明确说明,文档没有经过人类的一字干预。
2min
OpenAI 当AI写下62页"内心独白":人类首度读懂机器的思维流
阅读全文 AI API 2026年8月5日
2026年8月1日,OpenAI首次公开确认下一代模型系列的名称——Astra。这个在拉丁语中意为"群星"的模型,的内部测试版本一次性产出10项数学与理论计算机科学全新成果。OpenAI研究员塞巴斯蒂安·布贝克在X平台公布时用了"精妙"一词,但在数学界,这相当于一场"地震"。
2min
OpenAI Astra借助Lean 4撕掉AI证明的"免责声明"
阅读全文 AI API 2026年8月5日
2026年8月1日,OpenAI研究员塞巴斯蒂安·布贝克在X平台公布:公司内部测试的下一代模型家族Astra,一次性攻克了10个横跨数学与理论计算机科学的长期开放难题。每道问题至少搁置十年,绝大多数已经历经数十年。OpenAI同步公开了249页研究长文、62页《思想是如何成型的》发现路径手稿,以及全部10项成果的Lean 4形式化证明证书——相关代码已在GitHub以Apache 2.0许可证开源,库中"sorry"计数为零,意味着形式化证明中没有任何步骤被遗漏或跳过。
更令学界震动的是成本口径:按照GPT-5.6 Sol API计费标准,寻找全部10项解法的成功推理Token,总成本约为2000美元。
3min
OpenAI 2000美元 十道长期难题:Astra正在改写数学研究的成本结构
阅读全文 AI API 2026年8月5日
Gemini的用户爆发,并非依靠营销铺张投放,而是把AI植入用户原本就在使用的各类日常场景当中。
谷歌直接将Gemini嵌入安卓系统底层:当用户解锁手机、长按电源键或呼叫"嘿谷歌",弹出的不再是旧版谷歌助理,而是Gemini。用户甚至未必意识到自己已经切换到全新AI助手,但已经在使用它。这套打法在iOS端同样奏效——过去12个月,Gemini在苹果应用商店的下载量突破1.37亿次,说明iPhone用户也在主动搜索下载,认可其实用价值。
2min
Gemini AI Studio只是首个被"范式收编"的产品
阅读全文 AI API 2026年8月5日
"与其让你再下载一个App,我们决定走一条完全不同的路——让应用程序在你与Gemini的日常对话中自然生长出来。"雷希在公告中写道。随后,App Store与谷歌应用商店的预约页面同步下架。
3min
Gemini 谷歌把AI入口彻底收拢进Gemini
阅读全文 AI API 2026年8月5日
2026年7月31日,Google AI Studio产品与设计负责人阿马尔·雷希在X平台发布一则简短但信息量极大的更新:原计划于次日上线的AI Studio独立移动应用,正式取消。
这款应用自2026年5月19日Google I/O开发者大会亮相以来,仅在Android与iOS双端开放预注册,就收获了约80万份预订单,覆盖168个国家和地区。对于一个尚未正式上线的产品而言,这是同品类最顶级的需求信号。
然后谷歌说:我们不发了。
2min
Gemini 谷歌把AI入口彻底收拢进Gemini
阅读全文 AI API 2026年8月5日
到 2026 年 6 月,Anthropic 新一代模型 Fable 5 在同一基准的 Tier 4 档位拿到了 88% 的成绩。从 4.2% 跃升至 88%,用时不到一年。相较于前代 Opus 4.5,Fable 5 的提升幅度高达 83.8 个百分点。作为对比,OpenAI 的 GPT-5.5 Pro 在同等难度下成绩约在 75%—78% 区间。在 FrontierMath 这类顶级测试中,10 个百分点以上的差距,几乎就是整整一代模型的代差。
2min
Claude 从"数学短板"到 88% 上限:Fable 5 这一年发生了什么
阅读全文 AI API 2026年8月5日
8 月 2 日,Anthropic 研究员、普林斯顿数学博士莱文特·阿尔珀厄格在布贝克的推文下回复:"我用 Fable 已经复现了其中一半。"他使用 Anthropic 早已对外公开、任何开发者均可调用的 Claude Fable 模型,在完全自主运行、通用提示词、全程断网的隔离条件下,额外增设防护机制杜绝 OpenAI 的解题方案泄露到模型上下文,成功复现了 Astra 清单里的第 4、5、6、7、8 项,共 5 项成果。
真正让学界为之侧目的,是莱文特随后补充的一处细节——
在 Fable 复现的 5 道难题中,有 4 道的证明思路与 Astra 完全不同。
2min
Claude Fable 的四条"差异化证明路径"比答案本身更有价值
阅读全文 AI API 2026年8月5日
数学成果的"首发窗口"还有多长?OpenAI Astra 十项突破的 24 小时启示
2min
Claude Astra 与 Fable 的"隔空对弈"
阅读全文 AI API 2026年8月4日
GPT-5.6的API定价表看似简单:三款模型,三组定价。
但最终账单绝非只由标价决定。上下文长度、缓存命中率、输出词元占比、是否开启Fast模式——这四项变量相互组合,即便使用同一模型处理相同任务,调用成本最高能够相差数倍。
6 min read
OpenAI GPT-5.6三档模型
阅读全文 AI API 2026年8月4日
GPT-5.6的API价目表看上去并不复杂:三款模型,三组定价。
但最终账单从来不是单纯由标价决定。上下文长度、缓存命中率、输出词元占比、是否开启Fast模式,四大变量相互组合后,同一模型处理同一任务,成本最高能相差数倍。
2min
OpenAI ChatGPT 如何选出性价比最优的GPT-5.6 API
阅读全文 AI API 2026年8月4日
GPT-5.6 Sol Ultra 如何靠"四手并行"刷新 Terminal-Bench 2.1 纪录
2min
OpenAI GPT-5.6 Sol
阅读全文 AI API 2026年8月4日
过去两周,一个说法不断在开发者社区流传:在编程智能体测试中,GPT-5.6 Sol 性能超越 Claude Fable 5。
但真正值得关注的,并非这场"超越"的结果,而是它实现"超越"的方式。
2min
OpenAI GPT-5.6 Sol 与 Fable 5 的效率之争
阅读全文 AI API 2026年8月4日
自2026年4月1日起,Gemini API计费体系完成全面重构,所有用户划分为四个等级:免费档(Free)、一级档位(Tier 1)、二级档位(Tier 2)、三级档位(Tier 3)。
2min
Gemini Gemini API 分级限额机制深度解析
阅读全文 AI API 2026年8月4日
2026年,Gemini API的计费体系已完成新一轮重构。自2026年3月23日起,AI Studio新用户默认采用预付费(Prepay)模式:先购买额度,再消耗额度调用API,最低购买金额为10美元。这套体系与谷歌云结算账户深度关联,开发者可直接在AI Studio界面管理账单。
但从"免费额度够用"过渡到"付费通道可用",并非简单一键切换,而是一整套结算账户绑定与激活流程。
2min
Gemini Gemini API 10美元激活完整流程
阅读全文 AI API 2026年8月4日
Gemini API 合规聚合接入 vs 虚拟信用卡——成本测算与选型指南
2min
Gemini Gemini API
阅读全文 AI API 2026年8月4日
国内AI开发最令人头疼的难点往往不在于代码编写,而是API接入与支付难题。
使用谷歌云服务需要绑定国际信用卡,国内主流双币信用卡极易触发拒付;跨境网络线路抖动频发,官方接口地址在国内访问稳定性极差。即便勉强连通,延迟问题也常常让实时应用难以落地。
但开发者很难舍弃Gemini系列模型:Gemini 3.5 Flash推理速度可达每秒280词元以上,Gemini 3.1 Pro在BenchLM榜单名列前茅。核心难题落到一处:如何完成支付?
3min
Gemini 调用Gemini API的三种可行方案
阅读全文 AI API 2026年8月4日
2026年7月24日,Anthropic打出一记重拳,促使整个AI行业重新审视"旗舰模型"的定义。
官方正式发布Claude Opus 5,输入定价每百万Token 5美元、输出25美元,定价标准与Opus 4.8完全一致。但两款模型的内在能力,已然属于两个时代。
作为对比,OpenAI的GPT-5.6 Sol输入同样为5美元/百万Token,输出定价却高达30美元。二者输入单价持平,Opus 5的输出成本直接便宜17%。 而这仅仅只是序幕。
5 min read
Claude Claude Opus 5 实测对标 GPT-5.6 Sol
阅读全文 AI API 2026年8月4日
2026年7月24日凌晨,Anthropic推出了一记震动整个AI行业的重拳。
公司正式发布全新模型Claude Opus 5,性能无限逼近自家旗舰Fable 5,但定价仅有后者的一半。有网友当即给出一针见血的评论:"既然能力和Fable 5相差无几,谁还愿意花双倍价钱选用Fable 5?"
2min
Claude Claude Opus 5如何重塑大模型定价逻辑
阅读全文