极客AI周报
Geek AI Weekly · 面向 AI / 大模型爱好者的综合极客AI周报
极客AI周报 #008
第 8 期 · 2026年8月16日
本期头条 · Lead Story

极客AI周报 #008

本周焦点:AI 路线之争白热化——Meta 开源最强模型并发表万字长文、DeepSeek V4-Pro 与 Harness 双开源、NVIDIA 开源 Agent 框架 NOOA,开源阵营多线反击;同一周 Anthropic 披露 Q2 营收 110 亿美元、筹备 IPO,OpenAI S-1 在审,封闭巨头双双冲刺上市。DeepSeek V4-Pro-0813 正式版开源 MIT,API 引入峰谷定价,输入输出价格暴涨 3-4 倍;智谱 GLM-5.3 网络安全能力 CyberGym 84.5% 登顶;AI 六大巨头基础设施购买承诺逼近 1.5 万亿美元。

第 8 期 2026年8月16日 撰稿 kookboy
#开源AI#DeepSeek V4-Pro#Meta 开源#NVIDIA 开源#AI IPO#Agent Harness#智谱GLM-5.3#路线之争

本周焦点

AI 路线之争正式白热化。 上一期我们写了 OpenAI 与 DeepSeek 的”价格攻守易位”——一家免费化、一家涨价;这一期的故事更底层:开源阵营与封闭巨头之间的路线攻守易位

就在这一周,三条开源战线几乎同步开火:

  • Meta(8.10):开源最强模型的开放权重版本,并配发扎克伯格万字长文,直白喊出”AI 不应被恐惧”,把矛头指向坚持封闭路线的 Anthropic 与 OpenAI;
  • NVIDIA(8.9-8.12):Apache 2.0 开源 Agent 框架 NOOA(一个 Agent 即一个类),同时与 IBM 合作在 IBM 基础设施上运行开源模型推理——把”开源 + 企业部署”做成差异化卖点;
  • DeepSeek(8.13):V4-Pro-0813 正式版以 MIT 协议开源,同时开源了全新的 Agent 运行框架 DeepSeek Harness,提出”一切皆插件”。

几乎在同一时间,Anthropic 向投资人披露 Q2 营收已破 110 亿美元、年化 run rate 超 470 亿美元(AI Weekly 8.15 综合),正在筹备史上最大规模 IPO 之一;OpenAI 的 S-1 也在 SEC 排队中。一边是”模型应属于所有人”的开源宣言,一边是”闭源才能安全、才能估值”的 IPO 叙事——AI 行业最核心的路线选择,正在这一周被推到台前。

如果说 #007 讲的是”AI 谁更便宜”,那 #008 讲的就是”AI 到底该不该开源”。

AI & 大模型

  • DeepSeek V4-Pro-0813 正式版开源(8.13,MIT):旗舰模型正式上线 app/网页/API,主打 Agent 能力;1.6T 总参数 / 49B 激活,上下文 100 万 token,输出上限 38.4 万 token;原生兼容 OpenAI Responses API,适配 Codex;思考强度新增 low/high/max 三档。Artificial Analysis Intelligence Index 得分 53,较 4 月预览版提升 8 分,但与开源龙头 Kimi K3 仍差 7 分、与 GPT-5.6 Sol(61)差 8 分。第三方 Vals AI 评测排名 12,在沙盒终端和 Excel 建模两个环节表现落后。

  • DeepSeek V4 系列 API 峰谷定价(8.16 生效):V4-Pro 高峰期输入 $1.32、输出 $3.96 / 百万 token,闲时输出降至 $1.98,较此前 $0.87 单一价暴涨约 3-4 倍;V4-Flash 高峰输出 $1.32、闲时 $0.66,输入 $0.14。缓存命中输入折扣从 99% 缩至约 97%($0.044)。即使涨价后,仍远低于 Kimi K3($15)、GPT-5.6 Sol($30)等据报的头部闭源模型——仅 OpenAI GPT-5.6 Luna($1.20)在其之下。

  • 智谱 GLM-5.3 发布(8.14):与 GLM-5.2 同基座,纯以后训练(IndexShare、SAO、Slime 框架)拉升性能。CyberGym 白盒漏洞识别 84.5%,略超 Mythos 5(83.8%)和 GPT-5.6 Sol(83.6%),国产模型首次在该网络安全基准上登顶;ExploitBench 54.4%,低于 Mythos 5(78.0%)和 GPT-5.6 Sol(76.5%)。编程能力接近 Fable 5 / GPT-5.6 Sol,多项榜单超 Kimi K3,但 DeepSWE v1.1(长程软件工程)仍不及 K3。

  • OpenAI GPT-5.6 August 更新(8.13-8.15):Free/Go 用户获得新默认模型(GPT-5.6 Luna),Plus/Pro 升级为 GPT-5.6 Sol 并新增”思考强度”滑块;据第三方安全站点报道,OpenAI 发布了面向网络安全的 GPT-5.6-Cyber 变体(Daybreak Red 通道),内部安全评估完成率据称达 95%(GPT-5.6 Sol 仅 1.5%);GPT-Live Voice 支持文件上传与 Projects;ChatGPT 桌面版 Linux 预览版上线,macOS 新增 Computer History;首次纳入 U18 青少年专项安全评估。

  • OpenAI 在 ChatGPT 测试广告(8.11):爱尔兰运营公司向 EEA/瑞士的 Free 与 Go 用户发函,宣布本月底起在 ChatGPT 中推出广告,Pro/Enterprise/Business/Education 不受影响——“平台税”模型再次加码。9 月 1 日起所有 Daybreak 账号强制使用硬件安全密钥。

  • Meta 开源最强模型 Muse Spark 1.2(8.10):开源旗舰模型,能力对标 Anthropic 与 OpenAI 顶级基础模型;同期发布扎克伯格 14 页万字长文,主张 AI 不应被恐惧、美国须在 AI 竞赛中保持对华领先——公开把矛头指向主张封闭路线的同行。Box CEO Aaron Levie 评价这是”very big deal”。

  • xAI Grok 4.6 发布(8.12):Artificial Analysis 智能指数 61,追平 GPT-5.6 Sol、超越 Kimi K3;DeepSWE /medium 优于 /high effort;Cursor 同日官宣接入;1.5T 参数即达 GPT-5.6 / Opus 5 同等水平——“Scale Up 仍然有用”的又一证据,xAI 首次跻身前沿第一梯队。

  • Anthropic Claude 水印扩展(8.11 TechCrunch):Claude 生成的文本将加入隐形数字水印,并计划扩展到旧模型——AI 内容可检测、可追踪正从概念走向产品化。

  • Google Gemini 用户增长破 9.5 亿(8.12 Ars Technica):从年初至今增速显著,语音优先(voice-first)与多模态体验成为主战场。Gemini 持续扩展第三方 App 接入,继续推进”agentic”定位。

  • AI 价格战双向拉扯(8.12-8.14 FT):OpenAI 大幅下调 GPT-5.6 Luna 价格,Anthropic 把 Claude Opus 5 定价设为 Fable 5 的一半;同期 DeepSeek 反向大幅涨价。7 月中旬以来头部美国模型客单价已明显下滑——“降价抢用户”与”涨价控算力”同时上演。

开源瞭望

  • DeepSeek Harness 开源(8.13,MIT):基于 Cordis 元框架,核心理念”一切皆插件”——模型、工具、技能、会话、沙箱、文件系统、循环、编排、UI 全部插件化,可动态增删替换。提出”时空可组合性”:时间维度(卸载插件即撤销副作用)、空间维度(插件间依赖自动重连)。预设标准 / PTC / 极简 / 创造四种模式;仅追加会话日志作为唯一事实来源,支持轨迹回放。npx @deepseek-ai/dsh web 启动,Node.js 22.19+ 或 24+,当前版本 0.1.0-rc.5。单独开设微信公众号”DeepSeek Harness 团队”,黑色鲸鱼标识与主品牌蓝色鲸鱼区分。Harness 层成为模型之外的新战场

  • NVIDIA NOOA(8.9,Apache 2.0):NVIDIA Object-Oriented Agents,Python Agent 框架,一个 Agent 即一个类,极简范式——NVIDIA 在 Agent 框架层的开源入场。

  • DeepSeek Harness × QQ Bot 集成(8.15):腾讯 QQ 机器人官方接入 DeepSeek Harness 插件,支持多模型切换、会话记忆、群组 mute 模式——Harness 的”一切皆插件”在真实社交平台落地。

  • NVIDIA × IBM 开源模型推理合作(8.12):在 IBM 基础设施上运行开源模型推理,避开与超大规模云在纯算力上的正面对抗,把开源推理变成新卖点。

行业动态

  • AI 六大巨头基础设施购买承诺逼近 1.5 万亿美元(8.14 FT):Alphabet、微软、亚马逊、NVIDIA、Oracle、Meta 累计的芯片/数据中心/能源采购合同规模,远超财报 capex 数字本身——AI 从软件产业彻底进入重资产基建时代。

  • NVIDIA 下调 OpenAI 数据中心备用承诺(8.14):从 $2500 亿降至 $1200 亿以下,与同期 NVIDIA 5000 亿美元级第三方资本融资平台形成对照——AI 算力融资正在从”单一巨头包办”转向”金融化分销”。

  • Anthropic 筹备史上最大 IPO 之一(8.14 Reuters / AI Weekly):向投资人披露 Q2 营收 110 亿美元(+130%)、年化 run rate 470 亿美元,投行正按未来两年营收 × EV/Revenue 倍数定价;CFO Krishna Rao 正在与潜在投资人接洽;同时据报道就约 60 亿美元 AI 基础设施投资谈判。

  • OpenAI S-1 在审(8 月):首批经审计财务即将披露,市场预期 9 月上市;Q1 营收 $2B/月规模,2026 年预计净亏损 140 亿美元。

  • 新攻击跨三家解密 CoT 推理(8 月):攻击者可通过公开机制还原 Anthropic、OpenAI、Google 模型的推理过程,此前研究早在 1 月已上报但长期未修复——AI Agent 获得权限越多,“推理泄露”风险越大。

  • Waymo 获批加州 18 县无人驾驶(8.14 CPUC):覆盖北加州 12 县、南加州 6 县,含洛杉矶、旧金山湾区、圣地亚哥、奥兰治、河滨,收费载人正式放行。

  • Voice AI 创业公司 Q1 融资 70 亿美元(FT):同比 Q1 2025 的 10 亿美元暴涨 7 倍——Agent 抢语音入口战已然打响。

极客冷知识

本周金句:“开源不是慈善,而是路线选择——谁把模型变成像 Linux 一样的基础设施,谁就可能赢得下一代开发者的默认选择。” —— 综合 8.10 Meta 长文、8.9 NVIDIA NOOA 开源、8.13 DeepSeek Harness 三条战线

DeepSeek V4-Pro 的”正式版悖论”:8.13 正式版开源后,多家第三方评测显示 V4-Flash 在部分 Agent 基准上反而与 Pro 持平甚至略优——而 Flash 的激活参数只有 Pro 的约四分之一、推理成本只有其四分之一。这暴露出当前 Agent 评测的一个盲区:在复杂长程任务上,模型大小的边际收益正在被工程优化(hint、scaffold、harness)迅速抹平

“一切皆插件”背后的深层赌注:DeepSeek Harness 把模型适配器、工具注册表、会话日志、Agent 循环全部插件化,本质是在赌”未来的 Agent 竞争力在运行层、不在模型层”。这与 OpenAI Agents SDK、Anthropic Claude Agent SDK、LangGraph 形成四条路线竞合——谁能掌握 Harness,谁就更接近真实任务入口。MIT 协议只是入场券,插件生态能否进入生产环境才是真正的考验。

“价格战”的两种叙事:同期出现”OpenAI/Anthropic 降价 vs DeepSeek 涨价”的双向拉扯,背后逻辑截然不同——前者是”用降价扩用户、用平台税回收利润”,后者是”用涨价控算力、为 IPO 制造盈利叙事”。同一时间、同一市场,两种商业模式在赛跑。

AI 基础设施的”$2.9T 缺口”(Sequoia David Cahn 测算):巨头 1.5 万亿美元基础设施支出,对应需要约 3 万亿美元营收才能打平;而 Anthropic + OpenAI 合并 ARR 当前约 800 亿美元——这 2.9 万亿的缺口,是 2026 年 AI 宏观面最刺眼的数字

Claude Sonnet 5 定价暗雷:8 月优惠价 $2/百万 token,9 月 1 日起恢复 $3;同时更换 tokenizer 后同等文本可能多出 35% token——“降价 9 月变涨价”的组合拳,又一次提醒开发者:API 账单从来不是单纯看单价