09-19-日报
AI 日报中心

爱窝啦 AI 日报

每日 AI 行业动态、产品更新、前沿研究、开源项目与社媒信号

今日摘要

千问发布 Qwen3.8-Omni-Flash,音视频输入成本降低九成以上,多模态批量任务可以重算预算了。
技术扩散后朱啸虎提醒拼商业理解,开源工具和产品更新都在抢同一件事:把决策和执行直接塞进流程里。
今天先看千问价格和 Jev 决策模型,再试 claude-code 或 ChatGPT Pro 的 GitHub 集成。

🔥 今日焦点 TOP 10

1. 千问上线 Qwen3.8-Omni-Flash,性能均提超 26%

音视频能力大幅升级。 AIBase 报道显示, 千问上线 Qwen3.8-Omni-Flash,性能均提超 26% ,支持文本、图像、音频和视频输入,并具备 1M 长上下文。30 项评测中性能平均提升超 26%,音视频处理能力接近 Gemini3.8Flash。API 价格大幅下调,音频输入成本降低 98%,音视频输入降低 93%。正在跑批量多模态任务的开发者,可以今天重算一次成本。

千问 Qwen3.8-Omni-Flash 模型发布
千问 Qwen3.8-Omni-Flash 模型发布


2. 朱啸虎:AI 创业决胜只剩人文和商业

技术平权后拼的是理解用户。 据 36氪报道,金沙江创投主管合伙人朱啸虎在北大演讲中指出, 当技术扩散速度超过技术进步速度时 ,前沿模型的获客魔法已经失效。他认为开源模型五年会走完 Linux 三十年的路,技术扩散之后客户会变成对手。创业者需要把重心从模型能力转向真实的商业场景和用户需求。这对正在押注纯技术优势的团队是一个警示信号。

朱啸虎北大演讲
朱啸虎北大演讲


3. Anthropic 开源 Claude Code 终端编码工具

直接在终端里调 Claude 写代码。 GitHub Trending Daily 显示, Anthropic 发布的 claude-code 今日新增 444 Stars,总计 146330 Stars。这是一个驻留在终端中的代理编码工具,能理解代码库并通过自然语言命令执行日常任务、解释复杂代码和处理 git 工作流。适合习惯命令行开发、希望减少上下文切换的工程师试用。


4. Exa 推出 Snapshot,让 AI 检索任意历史网页

回到过去的网页状态。 Gorden Sun 在推文中介绍, Exa 推出 Snapshot 功能 ,用户只需指定一个过去的日期,就能搜出当时网页上的真实内容。可以解决两个问题:测试 AI 模型时避免它直接搜到后来才出现的标准答案,以及帮金融投资人员用历史某天的公开信息做策略回测。适合需要严格时间隔离的模型评测和投资复盘场景。


5. Jev 决策模型通过 Waitlist,零类型错误

专为软件自动化决策设计。 向阳乔木在推文中实测, Jev 模型的 Waitlist 提交后没多久就通过 ,并已用 Codex 调用成功。Jev 通过 RLCD 加并行采样实现结构化决策任务,智能接近中等 LLM,但成本和速度快 一到两个数量级。官方声称的"零幻觉“实际指"零类型/结构错误”,不是语义正确。适合需要高速语义判断或打分引擎的开发者,但不能替代现有 LLM 的通用能力。

Jev 模型使用说明
Jev 模型使用说明


6. OpenAI 发布 Astra for Law,内置法律搜索

把 GPT-6 Astra 塞进律师桌上。 Telegram 频道 aigc1024 消息称, OpenAI 发布 Astra for Law ,内置 2.3 亿网址的美国判例法条,每天更新。律师不用自己翻案例,案情丢进去,相关判例和原文段落直接给出,还能自己核验。顶级律所 Sullivan & Cromwell 做了合同分析器,Cooley 拿去搞 IPO 上市准备。AI 从去年卷数学家,今年开始盯律师了。


7. 用户实测 Eval 框架右移,AI 直接改变状态

从理解人到定义下一个状态。 即刻用户在帖子中分析, 当 AI 参与工作流时 ,人对世界产生影响的方式从"Context → Human → Action → State Change"变成“Context → Model → Human → Model → Action → State Change”。早期 AI 爆发的是调研报告、Office 和网站,因为人获取 context 的带宽很低。现在 Eval 正在从"理解人的缺陷“转向"定义下一个值得被改变的 state”。这意味着 AI 工具的交付物不再是中间表示,而是直接的状态改变。

Eval 框架右移示意图
Eval 框架右移示意图


8. 小云雀 Seedance2.5 做出电影级 AI 短片

质量高且搞笑。 Telegram 频道 aigc1024 分享了一部名为《工牌特工》的 AI 短片, 全片由小云雀 Seedance2.5 制作完成 ,完全是电影的感觉,而且还挺搞笑。作者许立展在抖音发布。AI 视频工具的制作质量已经接近专业短片水准,适合内容创作者和短视频团队探索。


9. VibeHub 帮 Vibe Coding 用户反查专业术语

一本面向小白的技术词典。 Telegram 频道 aigc1024 介绍, VibeHub 是一个可视化术语图鉴网站收录了前端、后端、AI、技术栈、Git、设计风格相关的术语,每个术语都配有一句生活化的使用场景描述。帮助不懂技术黑话的用户通过大白话反查准确的专业术语,从而更清楚地向 AI 表达开发需求。适合 Vibe Coding 零基础用户和非技术产品经理。


10. 宝玉实测 ChatGPT Pro 做技术方案效果好

直接把 GitHub 地址发给它。 宝玉在推文中分享, 他现在 ChatGPT Pro 的利用率越来越高 ,主要用它帮做技术方案。每次把 GitHub 地址发给它,让它根据代码去分析去设计,写一份设计文档,甚至提交 PR,后续把设计文档下载到本地给 Codex 或 Claude Code 去执行。有时候会让它跟 Fable 赛马,同样的问题让 Fable 和 GPT 6 Pro 各自设计一个方案,然后取长补短。需要在设置里连接自己的 GitHub 账号,这样可以访问私有代码仓库和提交 PR。

ChatGPT Pro GitHub 集成
ChatGPT Pro GitHub 集成


◎ 行业变化与个人影响

广电总局表态扶持真人微短剧精品创作

AI 短剧生存空间收窄。 Telegram 频道 aigc1024 消息称, 广电总局表态要大力扶持真人剧 ,实施真人微短剧精品创作计划,真金白银扶持,指导平台开真人剧专区。虽然没有直接打压 AI 短剧,但根据多个平台一刀切的习惯,AI 短剧怕是没有那么舒服了。只有真正意义上的好的 AI 剧作,才有生存的空间。正在做 AI 短剧的团队需要重新评估内容质量标准。


⌘ 开源 TOP 项目

TencentCloud/Octop:多用户多代理自托管助手

一个更智能的自托管 AI 助手。 GitHub Trending Daily 显示, TencentCloud/Octop 今日新增 569 Stars,总计 3983 Stars。支持多用户、多代理架构,适合团队需要在本地部署统一 AI 助手的场景。开发者可以自定义代理能力,适合对数据安全有要求的企业或团队试用。


Fission-AI/OpenSpec:规范驱动开发工具

面向 AI 编码助手的 SDD 工具。 GitHub Trending Daily 显示, Fission-AI/OpenSpec 今日新增 296 Stars,总计 69385 Stars。这是一个规范驱动开发(SDD)工具,帮助 AI 编码助手理解项目规范并生成符合要求的代码。适合希望通过规范约束 AI 输出质量的开发团队。


supermemoryai/supermemory:速度极快的记忆引擎

AI 时代的记忆 API。 GitHub Trending Daily 显示, supermemoryai/supermemory 今日新增 140 Stars,总计 30317 Stars。这是一个记忆和上下文引擎加应用,速度极快、可扩展且可完全本地运行。适合需要长期记忆和上下文管理的 AI 应用开发者。


◉ 社媒精选

Figure 公司发布 Helix 2.5,送入 30 个真实家庭

零样本完成三项家务。 Gorden Sun 在推文中报告, Figure 公司发布了最新的机器人模型 Helix 2.5 ,直接送进加州湾区 30 个真实家庭。在完全没有提前踩点、没有对房间数据进行微调的情况下,机器人直接完成了收拾客厅玩具、折叠毛巾和铺床三项家务。之所以能做到这一点,主要是因为 Figure 先用海量的人类真实日常行为数据对它进行了基础训练,让机器人提前理解了现实世界的物理规律和人体的动作协调方式。


PrismML 发布 Bonsai 2 27B,体积压缩 9 倍

极致压缩、性能不变。 Gorden Sun 在推文中介绍, PrismML 基于 Qwen3.8 27B 推出三值化模型 ,将体积压缩 9 倍5.9GB,并保留了原模型 98.2% 的综合评测表现。保持 262K 长上下文,能直接以 MLX 或 CUDA 内核在个人设备运行,RTX 5090 推理速度达到 143 tokens/s。适合需要在本地设备运行大模型的开发者。

PrismML Bonsai 2 27B
PrismML Bonsai 2 27B


😄 AI趣闻

Jason Wei 在 Stanford 讲了三个理解 2025 AI 的框架

宝玉转发的视频里,Jason Wei 在 Stanford AI Club 做了场约 30 分钟的演讲。他目前在 Meta Superintelligence Labs 做研究,此前在 OpenAI 参与创建了 o1 和 Deep Research,更早在 Google Brain 推动了 chain-of-thought prompting 和 instruction tuning 的研究,累计被引超过 9 万次。 他围绕三个思维框架展开 :第一,智能正在变成大宗商品,每一年达到同等智能水平所需的花费都在下降,核心原因是深度学习历史上第一次"自适应计算"真正跑通了。第二,获取公开信息的时间在缩短。第三,AI 能力的边界正在从"模型能做什么"转向"人能想到什么"。演讲里最有意思的是他用 MMLU 基准测试的数据画了一条曲线,简单任务的成本可以被压到极低,但复杂任务还得靠堆算力。最后他说,未来 AI 的竞争不是比谁的模型更强,而是比谁更会用模型解决真实问题。


❓ 相关问题

Qwen3.8-Omni-Flash 国内怎么用?

千问的 Qwen3.8-Omni-Flash 模型已经在阿里云百炼平台开放 API 调用,支持文本、图像、音频和视频输入,并具备 1M 长上下文能力。据 AIBase 报道, API 价格大幅下调 ,音频输入成本降低 98%,音视频输入降低 93%。开发者可以直接通过阿里云百炼平台注册账号并申请 API 密钥,按量付费使用。

需要进一步比较当前公开的 AI 账号或订阅服务时,可查看 爱窝啦·AI账号店 ;商品、价格与可用状态以官网实时页面为准。

Last updated on