Aug 13, 2026
AI 前沿模型竞发、供应链安全警钟与智能体生态演进 | 产品与创业日报
昨日 AI 领域迎来密集发布:阿里开源 Qwen3.8-2.4T-A95B 巨模,DeepSeek 发布 V4-Pro 正式版并开源 Harness 智能体框架,xAI 推出 Grok 4.6,一日三款前沿模型竞相登场。与此同时,LiteLLM 供应链攻击事件被证实为 2026 年最大规模 AI 供应链泄露,引发对开源生态安全的深刻反思。智能体应用加速落地,腾讯 WorkBuddy 月访问超 2100 万,Cognition 洽谈 400 亿美元估值,AI 编程工具用户激增。此外,多家机构发布关于 AI 智能体安全、事实错误根源及过度依赖的研究,为行业健康发展提供警示。
昨日重点
- 前沿模型密集发布:阿里开源 Qwen3.8-2.4T-A95B(2.4T 总参数、95B 激活,原生 256K 上下文),DeepSeek 发布 V4-Pro 正式版(Agent 能力大幅增强,支持可调推理强度),xAI 推出 Grok 4.6(智能指数 61,价格较竞品低 60% 以上)。一日三款前沿模型竞相发布,竞争白热化。
- 供应链安全警钟:LiteLLM 供应链攻击被证实为 2026 年最大规模 AI 供应链泄露,约 434,000 个 CI/CD 凭据在 40 分钟内被窃取,波及超 2,500 家组织(含微软、英伟达等)。
- 智能体生态加速:DeepSeek 开源 Harness v0.1(“一切皆插件”架构),腾讯 WorkBuddy 月访问超 2100 万,Cognition 洽谈 400 亿美元估值,OpenAI Codex 用户突破 1500 万。
- AI 安全与治理研究:Anthropic 研究揭示智能体或需制度层防系统性失败;Google 研究发现 LLM 事实错误主因是“回忆”而非“编码”;MIT 等研究显示 AI 便捷感或催生过度依赖。
分主题观察
1. 前沿模型竞赛:开源与闭源齐头并进
- 阿里开源 Qwen3.8-2.4T-A95B,为 Qwen-Max 级别模型首次开源,硅基流动提供 Day-0 支持,API 定价输入 $2/M、输出 $6/M。
- DeepSeek V4-Pro 正式版上线,Agent 基准大幅提升(DeepSWE 从 12.8 跃升至 62.7),原生支持 OpenAI Responses API,并适配 Codex。
- xAI 发布 Grok 4.6,智能指数 61 追平 GPT-5.6 Sol Max,价格与 4.5 持平,长运行 Agent 能力升级。
- 微软发布自研推理模型 MAI-Thinking-1,谷歌 Gemini 3.7 登陆 Vertex AI,竞争格局多元化。
2. 供应链安全:开源生态的脆弱性暴露
- LiteLLM 供应链攻击事件细节披露:40 分钟窗口内窃取 195TB 密码数据,含云密钥、SSH 密钥等,波及全球超 2500 个组织。
- 事件引发对开源 AI 工具链安全性的广泛讨论,强调供应链审计与依赖管理的重要性。
3. 智能体框架与工具:从模型到应用的桥梁
- DeepSeek Harness v0.1 开源,基于 Cordis 元框架,核心设计“一切皆插件”,对标 Claude Code 和 Codex。
- Anthropic 将 Claude Cowork 引入 Chrome 扩展,浏览器内支持技能与插件。
- 微软研究量化“坏技能库”对智能体的负面影响,提示工具设计需谨慎。
4. AI 编程与开发者工具:需求强劲,安全隐忧并存
- OpenAI Codex 用户突破 1500 万,重置用量限制;Cognition 洽谈 400 亿美元估值,年化收入近 10 亿。
- 研究揭示 AI 编程智能体安全事故频发,Cursor 问题最多,权限过大导致文件覆盖、数据删除等。
- Kane CLI 等新工具涌现,自然语言转浏览器测试,提升开发效率。
5. 企业级 AI 应用与商业模式
- 腾讯 Q2 财报显示重注 AI,CapEx 达 528 亿元,自由现金流首现负值;WorkBuddy 月访问超 2100 万,毛利逼近云业务。
- OpenAI 参股的 Thrive Holdings 融资 20 亿美元,用 AI 改造传统企业,TaxAI 代理准确率 98%。
- 微信发布自研大模型 WeLM,3B 激活参数嵌入 14 亿用户,主打资源效率。
6. AI 安全与治理研究
- Anthropic 研究:AI 智能体可能趋同于同一错误决策,需身份、声誉、争议解决等制度层。
- Google Research:LLM 事实错误主因是“回忆”不足,提出知识画像框架。
- MIT 等研究:AI 便捷感或催生过度依赖,实际收益微乎其微。
- 哈萨比斯卸任前提议设立 AI 安全标准机构。
值得继续关注
- Qwen3.8-2.4T-A95B 的社区采用:开源巨模的本地部署、量化工具及与 Kimi k3、DeepSeek V4-Pro 的对比将持续发酵。
- DeepSeek V4-Pro 的定价策略:峰谷定价(高峰价格为闲时两倍)将于 8 月 17 日生效,市场反应值得观察。
- LiteLLM 供应链攻击的后续影响:受影响组织的应对措施及开源安全生态的改进。
- 智能体安全与治理:Anthropic 和微软的研究是否会推动行业标准或工具设计变革。
- 腾讯 AI 投入的回报:自由现金流首现负值,WorkBuddy 等产品的商业化进展。
- AI 编程工具的安全事故:Cursor 等问题是否会促使工具改进权限管理。