AI 圈动态精选(2026年9月12日)

汇总最近 24 小时 AI 圈值得关注的动态:Anthropic 公开威胁情报报告,首次系统披露 Claude 被用于军事与间谍活动的案例;DeepSeek V4.1 Flash 实测显示价格大幅下调并原生支持视觉;OpenAI 则罕见地拆解了支撑 10 亿 ChatGPT 用户的存储平台。以下按类别整理,链接均指向站内中文阅读页。

📄 论文研究

Anthropic 威胁报告:Claude 被用于导弹、无人机与间谍软件,中国实验室大规模蒸馏取数

Anthropic 发布威胁情报报告,梳理 2025 年 12 月至 2026 年 8 月间 Claude 被滥用的七类行为,其中几条值得警惕:一个俄语间谍组织用 AI 代理自动改写恶意软件以绕过杀毒软件;也门某组织借助 Claude Code 开发射程超过 2000 公里的导弹相关软件;还有团队构建了无需人工介入的自主 FPV 无人机蜂群。

报告同时提到,中国实验室对 Claude 进行了大规模蒸馏以提取训练数据。这类披露把「模型能力边界」和「滥用治理」两个议题同时推到了台面上,也说明前沿模型的安全评估已从实验室走向真实冲突场景。

阅读原文

💡 技巧与观点

实测 DeepSeek V4.1 Flash:价格大降、原生带视觉

有作者用游戏与城市生成类任务实测了 DeepSeek V4.1 Flash。除了原生具备视觉能力外,最实际的变化是价格:缓存命中后的输入费用降了七倍多,输出价格砍掉约三分之二。

另一个需要留意的信号是路由策略——9 月 14 日中午 12 点起,所有发往 v4-pro 的请求将被强制路由到 4.1 Flash,并按 Flash 的低价计费。对依赖 v4-pro 的开发者来说,这是一次不换代码就改变底层模型的调整,建议提前压测。

阅读原文

递归自我改进离我们还有多远?三位研究者对谈

Dwarkesh Patel 与 Zyphra CTO Beren Millidge、Thinking Machines 首席科学家 John Schulman、Baseten 模型训练负责人 Charlie O’Neill 围绕递归自我改进(RSI)展开讨论:AI 能否自主改进自身、这条路离现实还有多远,以及哪些环节最可能先被自动化。

这类对谈的价值不在于给出结论,而在于把「RSI 是否临近」这个模糊问题拆成可检验的工程环节,适合作者理解当下能力天花板的参照系。

阅读原文

GitHub 营销负责人如何用 Copilot 把活动运营自动化

GitHub 日韩地区营销负责人 Tomoko Tanaka 分享了一套「不写代码」的做法:把活动从策划到后续跟进的全流程交给 GitHub Copilot 自动化,用工程化的方式管理营销运营(Marketing ops as code)。

对非工程岗位来说,这是一个不错的模板——重点不是让 AI 替你写活动文案,而是让它替你维护流程和状态。

阅读原文

OpenAI 详解存储平台 Habitat:每秒 7000 万请求、管理超 500PB 数据

OpenAI 发文(系列上篇)介绍其在线存储平台 Habitat 的演进:目前每秒处理超过 7000 万次请求,每周服务超过 10 亿用户,管理的数据量超过 500PB,覆盖近 40 个地区。

这类基础设施文章通常热度不高,但对理解「大模型产品为什么能扛住规模」很有价值——模型能力之外的工程底座,往往才是 10 亿级用户真正的门槛。

阅读原文

Grok Bot 摘要 SpaceX CFO 在 Goldman Sachs 大会的演讲要点

Elon Musk 转发了 Grok Bot 对 SpaceX CFO Bret Johnsen 在 Goldman Sachs Communacopia 大会演讲的自动摘要,演示了用 AI 快速消化长演讲、提炼要点的工作流。

阅读原文

来源:AI HOT(aihot.virxact.com)

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注