AI 动态

人工智能、AI Agent、大模型、开源模型、AI 产品、模型服务与生态变化。

Aug 13, 2026

AI 动态日报:2026-08-13

昨日 AI 领域迎来多款重磅模型发布与开源,包括阿里 Qwen3.8-2.4T-A95B 巨模开源、DeepSeek V4-Pro 正式版与 Grok 4.6 同日亮相,以及 DeepSeek 开源 Agent 框架 Harness v0.1。同时,LiteLLM 供应链攻击事件被证实为 2026 年最大规模 AI 供应链泄露,引发安全担忧。此外,多家公司披露 AI 战略与投资动向,如腾讯重注 AI、Anthropic 洽谈收购 Decart AI 等。

昨日重点

  • 阿里开源 Qwen3.8-2.4T-A95B 巨模:总参数 2.4T、激活 95B,原生支持 256K 上下文,硅基流动提供 Day-0 支持,API 定价输入 $2/百万 token、输出 $6/百万 token。
  • DeepSeek V4-Pro 正式版发布:Agent 能力大幅增强,支持灵活推理强度,原生支持 OpenAI Responses API,并适配 Codex;API 采用峰谷定价,8 月 17 日生效。
  • Grok 4.6 发布:支持 500K 上下文,价格不变,智能指数 61 与 GPT-5.6 Sol 持平,面向长时运行智能体优化。
  • DeepSeek 开源 Agent 框架 Harness v0.1:基于 Cordis 元框架,"一切皆插件",MIT 许可证,对标 Claude Code 和 Codex。
  • LiteLLM 供应链攻击:40 分钟波及超 2500 家组织,泄露约 195TB 密码数据,涉及英伟达、AWS、三星等,被称为 2026 年最大规模 AI 供应链泄露。

分主题观察

模型发布与开源

  • 阿里开源 Qwen3.8-2.4T-A95B,为 Qwen-Max 级别首次开源,社区关注本地部署显存需求与量化工具。
  • DeepSeek V4-Pro 正式版与预览版相比大幅提升,多项测试接近 Fable 5,且价格极具竞争力(混合 token 价格约为 GPT-5.6 的 1/31)。
  • Grok 4.6 与 DeepSeek V4 Pro 同日发布,双双逼近 Claude Fable 5 体验。

Agent 与智能体生态

  • DeepSeek Harness v0.1 开源,强调插件化与时间可组合性,支持依赖服务自愈。
  • Anthropic 研究揭示多智能体系统模式与风险:协调智能体可发现更多漏洞但可能产生系统性失败。
  • 约克大学研究显示 AI 编程智能体安全事故频发,Cursor 问题最多。

安全与风险

  • LiteLLM 供应链攻击细节曝光,引发对 AI 供应链安全的广泛关注。
  • 白宫拟将开源模型纳入网络预审框架,涉及机密预发布测试。
  • 亚马逊 Twitch 确认用直播内容训练 AI,用户可选择退出但默认同意,引发反弹。

产业与投资

  • 腾讯 Q2 财报显示重注 AI,CapEx 同比近翻 3 倍,自由现金流首现负值。
  • Anthropic 洽谈 60 亿美元收购 Decart AI,并传 10 月 IPO 估值 2 万亿美元。
  • Nvidia 宣布 5000 亿美元 AI 数据中心计划,为老化 GPU 建立二手市场。

其他亮点

  • 小红书开源 20 亿参数语音合成模型 dots.tts。
  • 谷歌 DeepMind 发布手语转文本模型 SL2T,登陆 Pixel 11。
  • 微软发布首个自研推理模型 MAI-Thinking-1。

值得继续关注

  • Qwen3.8-2.4T-A95B 的社区评测与部署实践:作为 Qwen-Max 级别首次开源,其性能与生态支持值得跟踪。
  • DeepSeek V4-Pro 的峰谷定价效果:8 月 17 日生效后,对 API 使用模式与成本的影响。
  • LiteLLM 供应链攻击的后续调查与影响范围:涉及组织众多,安全修复与合规进展需持续关注。
  • Anthropic 收购 Decart AI 与 IPO 动向:若达成,将增强其在视频生成领域的能力。
  • 谷歌 DeepMind 重组后的 Gemini 进展:布林督战,能否缩小与 Anthropic 的差距。