AI 日报中心

爱窝啦 AI 日报

每日 AI 行业动态、产品更新、前沿研究、开源项目与社媒信号

今日摘要

字节张一鸣拒绝蒸馏、押注5万亿参数自研,DeepSeek同日宣布API涨价。
多条消息指向同一方向:各家正从跑分竞争转向成本控制与差异化路线。
开发者今天先核实DeepSeek涨价方案再决定是否换模型,再看豆包SeedRealtime实测录屏。

🔥 今日焦点 TOP 10

1. 字节张一鸣明确拒绝蒸馏路线

字节押注自研,不跟风抄近路。 据晚点独家,张一鸣认为 蒸馏本质是复制 Claude 已有能力 ,最多只能逼近对手,难以真正超越。字节内部在讨论训练规模超 5 万亿参数的大模型。这意味着豆包系模型短期进展会更慢,但路线更独立。

字节张一鸣放弃蒸馏内部讨论
字节张一鸣拒绝蒸馏路线内部讨论


2. 豆包上线全模态全双工模型 SeedRealtime

豆包视频通话能力跃了一级。 向阳乔木的 实测显示,SeedRealtime 能识别一闪而过的图表,并根据手势理解“这个”指向哪里 。声音、画面、时序全在同一模型里实时决策。豆包 App 已全量推送,更新后点"打电话"开摄像头即用,无需申请内测。


3. DeepSeek 宣布近期上调 API 价格

DeepSeek 要涨价了,方案尚未公布。 据 AIBase,DeepSeek 官方宣布 近期将上调 API 服务价格 ,具体调价方案另行公布。这是 DeepSeek 开始平衡算力成本与商业收入的信号。正在用 DeepSeek API 跑批量任务的开发者,可以提前评估成本备案。

DeepSeek API 涨价公告报道
DeepSeek 宣布上调 API 价格


4. Meta 发布 Muse Spark 1.2 及编程 Agent Muse Code

Meta 又出手了,但国内访问受阻。 据歸藏转述,Meta 发布了 新模型 Muse Spark 1.2 和编程 Agent Muse Code ,定价极低,条件是同意数据收集协议。目前 Meta 官网对大量地区直接拒绝访问,国内用户无法登录。中转服务或有机会,具体可用性待确认。

Meta Muse Spark 1.2 发布截图
Meta Muse Spark 1.2 与 Muse Code 发布


5. 向阳乔木实测 SeedRealtime 主动感知能力

字节这个模型可能影响具身机器人的发展节奏。 向阳乔木 详细拆解了 SeedRealtime 的主动交互逻辑 :用户提前说"看到某展品提醒我",模型跟随镜头静默看展,目标出现才主动开口,不会每隔几秒打扰用户。相比 GPT Live 的纯音频全双工,SeedRealtime 是全模态,视频、音频、文本同步处理。


6. 科技圈外几乎没人真正在用 Agent

Agent 离普通用户还很远。 aigc1024 频道提出一个 值得观察的反差:模型与工具链已经成熟,科技圈外的普通人却几乎不用 Agent 。这个问题的答案可能决定谁能占领大众市场。做面向 C 端 Agent 产品的开发者,降低使用门槛比堆能力更紧迫。


7. DeepSeek 实习生日薪 5500 元引发热议

顶级 AI 公司的人才薪酬已脱离常规轨道。 据 aigc1024 频道, 一名清华姚班学生获得 DeepSeek 实习机会 ,日薪约 5500 元,按 22 个工作日计算月薪税前超 12 万元。这反映出顶级 AI 研究人才的稀缺程度。对高校 AI 方向学生而言,头部大模型公司的竞争窗口仍然开着。


8. 人与 AI 可在同一本书上分色批注

阅读器首次实现人机批注清晰分层。 aigc1024 频道介绍了 Tasogare 网页阅读器 :支持 PDF、EPUB、TXT,内置 MCP 服务器,人和 AI 用不同颜色划线,玉绿对琥珀,一眼能分清谁写的哪笔。AI 可通过 MCP 翻书、划线、追踪对方阅读进度。有深度阅读和 AI 协同需求的用户可以去 GitHub 试用。


9. bb Agent 框架安装后自动识别所有本机 CLI 工具

不用配置、开箱识别,这个框架有点省心。 向阳乔木 实测 bb Agent 后发现,安装完成便会自动识别本机已有的 CLI 工具 :无需手动设置,就能检测到 Codex CLI、Grok Build CLI、Claude Code CLI 和 PI Agent,并在多个模型之间直接切换。官网宣称 IDE 可以自进化,下载地址在原帖评论区。

bb Agent 框架自动识别 CLI 工具界面
bb Agent 框架安装后自动识别本机 CLI 工具

10. DeepSeek V4 Pro 编程得分比 Claude 低 0.3% 是怎么算出来的

一个精确数字背后,藏着论文原始数据和营销包装的差距。 宝玉转发了 Tianyi Cui 的 基准拆解:V4 Pro 预览版论文 Table 6 中,SWE Verified 原始分数为 80.6 对 80.8 ,换算后差距约 0.3%。数字本身来自论文,但"性能跻身全球第一梯队"是中介二次包装的说法。看原始数据和读营销文案,信息量差距显著。

DeepSeek V4 Pro 与 Opus-4.6 SWE Verified 基准对比
DeepSeek V4 Pro 与 Claude Opus-4.6 SWE Verified 得分对比

⚡ 产品与功能更新

agent-skills 为 AI 编码 Agent 整理了生产级技能集

专门给 AI 编码智能体用的工程技能库今日冲榜。 addyosmani/agent-skills 收录了生产环境所需的完整技能代码 ,今日新增 593 Stars,总 Stars 超 82,900。由 Google Chrome 工程师 Addy Osmani 维护,覆盖真实工程场景中 Agent 需要的核心能力。正在搭建 Agent 工作流的开发者可以直接 fork 参考。


⌘ 开源 TOP 项目

tirth8205/code-review-graph:大仓库代码智能上下文图谱

让 AI 只读关键代码,上下文体积显著压缩。 tirth8205/code-review-graph 公开了本地持久化图谱核心代码 ,为代码库构建持久化映射,支持 MCP 和 CLI 接入。今日新增 237 Stars,总 Stars 超 29,000,经基准验证可在大型仓库场景中减少无关上下文加载。维护大型 Python 项目并用 AI 辅助审查的开发者值得一试。

Significant-Gravitas/AutoGPT:通用 AI 智能体构建平台

AutoGPT 今日仍在日榜,总 Stars 已达 18.6 万。 Significant-Gravitas/AutoGPT 提供开箱即用的 Agent 基础框架 ,定位是降低 AI 智能体使用和构建门槛,今日新增 37 Stars。新入门 Agent 开发、需要一个成熟基础框架的开发者可以从这里起步。


◉ 社媒精选

Prime Agent 在 ARC-AGI 3 上得分 95.5%,作者自己不打算试了

开源自我改进 Agent 框架发布,但评测者已经审美疲劳。 Gorden Sun 的 评测帖 介绍 Prime Intellect 开源的 Prime Agent:使用 Opus5 模型,ARC-AGI 3 得分 95.5%,支持根据运行轨迹自动更新技能和记忆。作者坦言没看出明显创新点,热度主要靠推广,日常已转用 Codex、Claude Code、Cursor 和 Grok Build。


😄 AI趣闻

字节的全双工模型,终于能看懂你在指哪儿了

有个经典日常困境:对着语音助手说"这个怎么用",它礼貌回复"请问您说的是什么"。字节跳动的 SeedRealtime 要把这个梗送进历史—— 博主手指着天龙功放按键、模型实时识别并自然作答的实测视频 展示,系统能结合画面、手势方向和历史操作定位"这个"的具体所指。区别于多模块级联堆延迟的老路子,它把声音、画面、推理塞进同一个模型实时跑。据说 OpenAI GPT Live 目前还只是音频全双工,这边已经全模态了——能打,但"这个功放到底怎么配对蓝牙"这种问题,它大概还是不会。

❓ 相关问题

豆包 SeedRealtime 视频通话国内怎么用?

直接下载豆包 App 更新到最新版即可,无需申请内测。 根据向阳乔木实测,豆包已将 SeedRealtime 全量推送,更新后点击首页"打电话"图标、开启摄像头即进入全模态全双工模式,支持实时视频理解、手势识别和主动交互。目前没有地区限制或额外订阅要求的说明,国内用户直接在应用商店搜索"豆包"更新即可。

需要进一步比较当前公开的 AI 账号或订阅服务时,可查看 爱窝啦·AI账号店 ;商品、价格与可用状态以官网实时页面为准。

Last updated on