开发者工具

编程工具、开发框架、开源项目、工程效率、云服务和基础设施。

Aug 13, 2026

开发者工具日报:DeepSeek 连发大招,开源模型与智能体框架齐飞

昨日开发者工具领域迎来多项重磅发布:DeepSeek 正式推出 V4-Pro 与 V4-Flash 升级,Agent 能力大幅增强,并开源了基于 Cordis 的智能体框架 Harness v0.1;阿里开源 Qwen3.8-2.4T-A95B 巨模,硅基流动提供 Day-0 支持;LiteLLM 供应链投毒事件细节曝光,波及数千家企业;此外,Claude Code 更新、VS Code 1.133 发布、多智能体系统研究等也值得关注。

昨日重点

  • DeepSeek 发布 V4-Pro 与 V4-Flash 升级:Agent 能力显著提升,支持灵活推理强度,原生支持 OpenAI Responses API,并针对 Codex 优化。V4-Pro 已上线 App、网页端和 API,模型名称保持不变。
  • DeepSeek 开源智能体框架 Harness v0.1:基于 Cordis 元框架,采用“一切皆插件”设计,模型、工具、技能、会话、沙箱等均可自由混搭替换,对标 Claude Code 和 Codex,代码以 MIT 许可证发布。
  • 阿里开源 Qwen3.8-2.4T-A95B 巨模:总参数 2.4T,激活 95B,原生支持 256K 上下文,可扩展至 1M。这是 Qwen-Max 级别模型首次开源,硅基流动提供 Day-0 支持。
  • LiteLLM 供应链投毒事件:40 分钟内波及全球 2500 家企业,泄露约 195TB 密码数据,包括云密钥、代码仓库 Token、SSH 密钥及 43.4 万条 CI/CD 流水线凭据,英伟达、AWS、三星等公司受影响。

分主题观察

大模型发布与更新

  • DeepSeek V4-Pro 正式版上线,Agent 基准全面追平第一梯队:Terminal Bench 87.9、Cybergym 83.3,DeepSWE 从 12.8 跃升至 62.7。
  • DeepSeek API 采用峰谷定价,高峰时段价格翻倍,8 月 17 日生效。
  • 阿里开源 Qwen3.8-2.4T-A95B,社区讨论其与 Kimi k3、DeepSeek V4-Pro 的对比及本地部署挑战。
  • 微信公布自研大模型 WeLM,80B 版已用于 AI 助手“小微”,617B 版开发中。

智能体框架与工具

  • DeepSeek Harness v0.1 发布,强调“时间可组合性”和插件自愈能力。
  • Anthropic 将 Claude Cowork 引入 Chrome 扩展,支持技能与插件,会话跨端同步。
  • Claude Code v2.1.231 发布,新增远程会话恢复、插件市场命令源等。
  • Cursor Origin 以 /codebase 路径开始灰度,面向智能体代码审查。

供应链安全与风险

  • LiteLLM 供应链攻击细节曝光,引发对开源工具安全性的广泛讨论。
  • 研究揭示 AI 编程智能体安全事故,Cursor 问题最多,权限过大导致数据覆盖、删除等。
  • Twitch 默认将主播内容用于训练 Amazon AI,引发社区反弹。

开发者工具与效率

  • VS Code 1.133 发布,Agent 窗口调整,支持会话切换模型提供商。
  • Hax:用 C 语言编写的极简终端编程工具,启动即时、内存占用低。
  • Kane CLI:终端内用自然语言生成浏览器测试。
  • Ito:运行代码的 AI 代码审查工具。

研究与洞察

  • 研究揭示 CLAUDE.md 膨胀问题,添加注释可消除 99.3% 多余指令。
  • Anthropic 研究多智能体系统协作模式,发现协调智能体可发现更多漏洞但存在系统性风险。
  • 论文提出“语言模型睡眠”方法,通过离线重读上下文提升长时任务效率。

值得继续关注

  • DeepSeek V4-Pro 与 Harness 的后续发展:V4-Pro 的 Agent 能力提升和 Harness 的插件生态能否吸引开发者,值得关注。
  • Qwen3.8-2.4T-A95B 的本地部署与生态:巨模的量化、显存需求和社区应用案例。
  • LiteLLM 供应链攻击的后续影响:安全修复、社区反应及对开源供应链的长期影响。
  • Claude Cowork 在 Chrome 中的扩展:跨端同步和技能插件支持的实际体验。
  • 多智能体系统的安全与协作:Anthropic 研究揭示的风险与机遇。