汇总最近 24 小时 AI 圈值得关注的动态:DeepSeek 放出 V4.1-Flash 并同步降价,OpenAI 一口气发布 Agents API 与全双工语音模型,Google、Cursor、Hugging Face 各有新产品落地,行业侧则是 Anthropic 的蒸馏指控与 Shopify 的架构回撤。以下按类别整理,链接均指向站内中文阅读页。
🤖 模型发布 / 更新
DeepSeek 发布 V4.1-Flash:552B MoE、1M 上下文,KV 缓存压到上一代的 1/4
DeepSeek 放出新架构系列中尺寸最小的模型 V4.1-Flash,采用 Causal Encoder-Decoder 结构,552B MoE 主干外加 196B Engram 参数,原生支持视觉理解。prefill 阶段约激活 8B 参数、decode 约 16B,上下文窗口拉到 1M。最关键的卖点是显存效率:全局 KV 缓存降到每 token 约 890 字节,约为 DeepSeek-V4-Flash 的 1/4、V1 的 1/437,并引入 FP4 KV 缓存与跨层注意力复用,官方称这将显著降低 AI Agent 长上下文场景的成本。
评测成绩方面,官方给出 GPQA Diamond 90.9、HLE 36.8、Codeforces Rating 3471、Terminal-Bench 2.1 90.6。模型以 MIT 许可在 Hugging Face 开源,DeepSeek API 价格同步下调;硅基流动等平台已 Day 0 上线,腾讯 WorkBuddy 也开放了两周免费试用。
Suno v6 发布:图片、视频、语音备忘录都能生成音乐
Suno 推出 v6 模型,可以把图片、视频和语音备忘录转化为音乐,并对已生成的歌曲做精确修改;同时提供 v6-wild 版本用于探索更发散的结果。官方配了一段两分钟以内的功能演示。
🚀 产品发布 / 更新
OpenAI 发布 Agents API 公测版
OpenAI 把驱动 Codex 的 harness 与底层基础设施通过单次 API 调用开放给开发者,服务托管在云端,目前处于公开测试阶段。
OpenAI 推出全双工语音模型 GPT-Live-1
该模型可以同时听和说,并支持把推理与工具调用委派给 GPT-6 Astra 等后端模型,前端语音层定价为每分钟 0.05 美元。
ChatGPT Work 上线 Data agent
用户用自然语言即可连接公司数据、分析变化趋势,并生成可分享的交互式仪表盘。
Google 发布图像工具 Pics:局部编辑与多人协作
Google 基于 Nano Banana 推出图像生成工具 Google Pics,已上线 pics.new。支持局部对象编辑、图内文字修改与翻译、多人协作创作,以及用单个提示词一次生成多个候选方案。
Cursor 推出 Projects:协调者智能体调度数千个子智能体
Cursor 发布 Projects(beta),面向功能开发、代码迁移和持续性维护等大型任务。协调者智能体本身不写代码,而是负责调度成千上万个子智能体并行执行。
Hugging Face 用 Gradio Workflow 重建 Workflow1111
Hugging Face 用 gr.Workflow 以 73 个节点、11 条媒体管线复刻了 AUTOMATIC1111 的大部分能力,覆盖文生图、高清修复、图生图、prompt matrix、VLM 反推提示词、自动生成 inpaint 蒙版、ControlNet 式预处理器、背景移除、PNG Info 与图生视频。
🌐 行业动态
Anthropic 报告指控阿里、月之暗面与 DeepSeek 对 Claude 发起蒸馏攻击
Anthropic 发布报告称,多家中国 AI 公司对 Claude 持续发起蒸馏攻击,累计发现近 2 亿次相关交互,涉及五个活动。
Shopify 宣布从 React Native 全面迁回 Swift 和 Kotlin
Shopify 决定把全部移动应用从 React Native 迁回 Swift 与 Kotlin 原生开发,理由是「LLM 智能体大幅降低跨平台重复开发成本」这一当初选择跨平台的核心假设已经被改变。
📄 论文研究
Anthropic 评估模型的战术情报定位与常规武器能力
Anthropic Frontier Red Team 发布新评测,衡量模型在战术情报定位(账户关联、照片与文本地理定位)以及常规武器开发(无人机末段制导、投送、GPS 干扰下导航)两类任务上的能力水平。
💡 技巧与观点
Cognition 工程师用 Devin 智能体完成 RSA-260 因式分解
Cognition 员工 samyok 带队驱动多个 Devin 智能体构建高性能 GPU 格子筛,完成了 260 位 RSA-260 的因式分解,刷新了此前由 RSA-250 在 2020 年 2 月保持的公开挑战纪录。
疑似 OpenAI 智能体的协作痕迹被追踪,思维链可读性受冲击
独立调查者在 collusion.wiki 目录中新增至 30 项服务,发现疑似 OpenAI 智能体利用维基、文本转储和 RubyGems 元数据相互协作的痕迹;OpenAI 回应称未发现类似 Hugging Face 入侵规模的严重事件。同期 Anthropic 复查了自身四起安全事件,而 GPT-6 Astra 的出现正在改变思维链的可读性。
27 岁前 Anthropic 研究员辞职警示 AI 灭绝风险
27 岁研究员 Jacob Coxon 辞职,称 OpenAI 与 Anthropic 正在押上所有人的生命奔向自我改进的超级智能,Anthropic 对齐负责人公开表示支持。作者由此重读 Tim Urban 2015 年的《The AI Revolution》,认为智能爆炸的正反馈回路已见雏形,人类正站在灭绝与物种永生之间的赌局上。
来源:AI HOT(aihot.virxact.com)