AI 日报中心

爱窝啦 AI 日报

每日 AI 行业动态、产品更新、前沿研究、开源项目与社媒信号

今日摘要

GPT-5.6 Sol亲自重写GPU内核,把自己的推理成本砍了20%,Luna随即降价80%至每百万Token仅0.20美元。
与此同时,Google发布全身机器人框架、Kimi K3百万上下文开源、Grok语音模型半价登顶,开源阵营正在四面合围。
今天信息密度极高,第1条和第4条值得重点点开——AI开始给自己省钱,这个拐点比降价本身更值得盯着。

⚡ 快速导航

💡 提示:想第一时间体验文中提到的最新 AI 模型(Claude 4.5、GPT、Gemini 3 Pro)?没有账号?来 爱窝啦 Aivora 领个号,一分钟上手,售后无忧。

今日AI资讯

👀 只有一句话

GPT-5.6 Sol让自己进了Codex、重写了GPU内核、把自己的API账单砍了20%——AI开始给自己打工了。

🔑 3 个关键词

#模型自我进化 #机器人全身觉醒 #开源反包围


🔥 重磅 TOP 10

1. GPT-5.6大降价:Luna砍80%,是模型自己把成本降下来的

以前降价靠竞争压力,这次不一样。OpenAI让GPT-5.6 Sol进了Codex,让它分析真实生产流量、自主重写GPU内核,端到端推理成本直接降了20%;Sol还给自己的推测解码模型跑了数百次实验,Token生成效率提升15%以上。最终结果:GPT-5.6 Luna降价80%,每百万Token输入只要0.20美元;Terra降20%;Sol新增Fast mode,速度2.5倍、价格2倍。ChatGPT和Codex CLI的Auto-review同步升级到Luna,自动审阅成本预计下降约10倍。这条新闻的真正看点不是降价本身,而是模型训练好之后还在持续优化自己的运行成本——递归自我改进刚踏进了生产环境的门槛。

image


2. Gemini Robotics 2来了,Google DeepMind要把机器人做成"全身智能体"

梦想了几十年的事,今天Google DeepMind正式迈出了一大步。Gemini Robotics 2定位为下一代机器人的"智能层",核心突破有三个:全身控制(不再只是手臂)、高级灵巧度(能处理精细操作),以及多机器人协作。Google还特别解释了机器人如何"思考"——真实世界的任务需要时间和规划,而不是瞬间反应。这不是又一个演示视频,而是一个可以落地到不同机器人平台的通用智能框架。机器人赛道今年已经热到快要沸腾,Gemini Robotics 2这张牌一出,接下来各家肯定都要跟进。


3. 马斯克推Grok Voice Think Fast 2.0:智能体评测登顶,比OpenAI便宜一半

马斯克连发两条推文,第一条说"Grok Voice在智能体性能方面排名第一",第二条直接喊话"去试试"。xAI推出的Grok Voice Think Fast 2.0是目前能力最强的语音到语音模型,不光跑分漂亮,价格还只有OpenAI同类产品的一半左右。语音AI这条赛道本来一直是OpenAI的主场,现在马斯克带着这颗炸弹闯进来,用价格直接堵死了对方的防守空间。实时语音交互的应用场景已经很成熟,便宜一半加上榜首排名,开发者很难不心动。

image


4. Kimi K3技术报告:896位专家、百万字上下文、原生视觉,全部免费开源

如果把大模型比作一家医院,K2是384位专科医生、每次请8位会诊的版本。K3直接扩建成896位专家、每次请16位,还新招了一批"能看片子"的医生(原生视觉),把病历本从12.8万字加厚到了100万字——然后全部免费开放。47页技术报告把怎么造得更大、训得更聪明、用得足够便宜讲得相当清楚。上下文100万、原生多模态、开源免费,三个条件凑在一起,Kimi K3对很多开发者来说是今天就能下手的选择。

image


5. Google Earth接入AI图像生成:输入文字,看城市"穿越"回100年前

“如果能看到这座城市100年前长什么样”——这个问题今天有了答案。Google Earth网页版上线了AI图像生成功能,背后是Nano Banana 2模型,把卫星图像、3D地形和文字提示结合起来。缩放到任意位置、点"创建图像"、打字,就这三步。你可以在家门口凭空建一个篮球场,或者把你的城市拉回到黑白照片年代。功能现在对所有人开放,这是AI图像生成第一次真正嵌进地理空间工具里——不只是看图,而是"改写"你眼前的真实世界。


6. 一张照片变3D模型:img2threejs用代码而非扫描生成可动场景

以前从参考图做出3D模型,要么花钱买素材,要么自己建模,两条路都要命。img2threejs换了一条路:输入一张照片,AI把里面的物体用基础形状和程序着色一步步搭成Three.js模型,带关节、带碰撞体,随时能动。不扫模、不下载现成网格,全程AI边渲边自检,不过关就自己改。最终产出直接在浏览器打开,省Token,代码干净。对独立开发者和3D创作者来说,这条工作流等于把"从图到动画资产"的门槛踩了个平。


7. openwork:Claude Cowork的开源平替,今日GitHub日榜单日涨915星

Claude Cowork火了之后,总有人想要一个不被厂商锁定的版本。different-ai团队用TypeScript做了openwork,定位就是Claude Cowork的开源替代方案,底层跑opencode。今天登上GitHub日榜,单日新增915颗星,总星数已近1.9万。对想搭自己AI协作工作流的开发者来说,这条路比等官方版本灵活得多——开源意味着能改、能扩展、能部署在自己的环境里。协作型AI工作空间这个方向正在快速成形,openwork是目前最受关注的开源选手。


8. 谷歌财报出炉:云暴涨82%、积压订单5140亿,但股价盘后反跌超4%

数字漂亮得让人咋舌:营收1198亿美元、同比涨24%,谷歌云单季248亿、暴涨82%,积压订单堆到了5140亿。但股价盘后反跌超4%。原因只有一个——资本开支上调到1950至2050亿美元,单季capex翻倍到449亿,自由现金流甚至转负。这是本财报季已经重复好几遍的剧本:台积电、奈飞、谷歌营收一个个都赢了,却全因花钱太狠被砸。卖铲子的英伟达、博通在涨,挖矿的谷歌、特斯拉在跌——AI投资逻辑的分水岭越来越清晰。

image


9. AutoEval上线:用数百万真实用户偏好训出的奖励模型来评估模型

AI评测一直有个老问题:跑榜的是基准测试,用着的是真实人类,两件事经常对不上。Arena.ai今天推出AutoEval,思路直接反过来——先拿数百万真实Arena用户偏好数据训一个奖励模型,再用这个奖励模型给候选模型打分。评测信号来自真实偏好而非手工标注,与人类在线评测高度对齐,速度还快了几个数量级。这套方法论如果经得起检验,将来可能让"跑榜很高但用着很差"的模型越来越难混。


10. 40.6万奖金池:OpenBMB联合昇腾举办全模态开发者赛事

全模态模型的演示看起来都挺流畅,但工程现场还有四道关:首次响应够不够快、端到端延迟压不压得住、多人并发稳不稳定、迁移到国产算力后能不能跑起来。OpenBMB联合昇腾算力生态,就围绕这四个真实痛点办了这场赛事,奖金池40.6万人民币,参赛底座是一个已登上GitHub热榜的9B开源模型。对想在昇腾生态上落地多模态能力的开发者来说,这场比赛既是练兵场,也是对国产算力适配能力最直接的公开检验。

image


📌 值得关注

[产品] 纳米Work:内置500+岗位专家,聚合Claude Code、Codex、Hermes三套框架 - 一个初中毕业的新疆小哥用它写抖音脚本,把一家早餐店开到了6家,AI办公工具里少见的"真接地气"案例。

[产品] Magnific 2026提示词手册上线,覆盖顶流图片和视频模型横向对比 - 不只是教写提示词,还有各模型实测对比,入门和进阶都够用,官方直出,可信度高。

[研究] AI生成PPT:为什么HTML格式比原生PPTX更好看? - 反直觉的结论:不是技术问题,是训练数据问题——AI对HTML最熟,生成质量天然更高;这个逻辑打通了,选工具的思路就变了。


Claude全线宕机那天,程序员们在做什么

平时最怕两件事:一个是需求又改了,另一个是工具突然不动了。昨天这两件事凑在一起——Claude全线服务炸了,不是某个功能抽风,是整个平台集体罢工,截图里状态页一片红。对于把Claude挂在工作流里当主力的开发者来说,这一刻的体验大概是:打开终端、发出请求、等了三秒、什么都没有。

有趣的是,炸掉的时间节点偏偏卡在正常工作时段。Cursor还开着,任务还在队列里,只是那头不接了。

用了这么久AI工具之后终于意识到:不是你在等编译,是你和AI一起等报错——有时候连等的机会都没有,直接收到了下班通知。

image


🔮 AI趋势预测

模型自优化推理成本成为主流降价机制

  • 预测时间:2026年Q3-Q4
  • 预测概率:72%
  • 预测依据:今日新闻 GPT-5.6 Sol自主重写GPU内核、降本20% + Sol已在生产环境验证"模型自我优化推理效率"的可行性,一旦这条路跑通,各家大厂都有动力复制这套机制;API价格战将从"竞争逼降"转向"效率内生降",Token单价可能在未来2-3个月内继续出现超预期降幅。

语音AI市场格局重塑,Grok Voice冲击OpenAI主导地位

  • 预测时间:2026年8月-9月
  • 预测概率:65%
  • 预测依据:今日新闻 Grok Voice Think Fast 2.0登顶智能体评测、价格砍半 + 语音模型市场此前由OpenAI近乎独占,xAI用"榜首+半价"组合拳直接攻击最脆弱的位置;接下来很可能触发OpenAI防御性降价,或推动Gemini Live加速更新,整个语音赛道Q3会比预期更热。

开源机器人智能框架迎来爆发式跟进

  • 预测时间:2026年Q3
  • 预测概率:60%
  • 预测依据:今日新闻 Google DeepMind发布Gemini Robotics 2 + 机器人智能层的"通用框架"概念一旦被Google这个量级的玩家公开验证,开源社区和其他厂商通常在2-3个月内出现密集跟进;Boston Dynamics、Figure、1X等已有硬件底子的公司,大概率会在Q3宣布类似软件层合作或独立研发计划。

国产AI模型昇腾适配成为下半年竞争关键指标

  • 预测时间:2026年8月-10月
  • 预测概率:58%
  • 预测依据:今日新闻 OpenBMB联合昇腾举办全模态赛事、奖金40.6万 + Kimi K3开源、百川/智谱持续发力的背景下,国产算力适配已从"备选方案"变成"主赛道";这场赛事相当于一次公开压力测试,获奖方案有较大可能直接影响昇腾生态的工程规范和后续产品方向。

❓ 相关问题

如何体验 GPT-5.6?

GPT-5.6 系列目前通过 OpenAI API 和 ChatGPT 付费订阅提供访问,其中今日降价后的 GPT-5.6 Luna 输入价格已降至每百万Token 0.20美元,是目前性价比最高的选项之一。国内用户直接注册 OpenAI 账号可能面临手机号验证受限、支付方式不支持等问题。

解决方案:访问 爱窝啦 Aivora 获取成品账号,极速发货,售后无忧,省去注册和支付的麻烦,开箱即用。

Last updated on