AI 圈动态精选(2026年8月27日)

🤖 模型发布/更新

1. GlucoFM:面向连续血糖监测的基础模型

Google Research 推出 GlucoFM,一款轻量级自监督连续血糖监测(CGM)基础模型,采用双流设计分别建模血糖长期趋势与短期波动。在四个队列、七项临床预测任务的 14 项评估中,其 PR-AUC 平均比最强 GluFormer 变体高出 5.8 个百分点,PPGR 预测取得最低 MAE。模型在 10.9 万小时无标注 CGM 数据上预训练,具备跨数据集迁移与少样本适应能力。

2. Gemini 3.5 Transcribe 发布:高精度语音转文本模型

Google DeepMind 发布 Gemini 3.5 Transcribe,面向实时语音交互场景,支持流式与非流式两种 API。据 Artificial Analysis 评测,流式与非流式平均词错率分别为 4.0% 和 2.6%,支持超 85 种语言、自定义词汇及最多三人的说话人识别。

3. Qwen3.8-Flash 开源:Qwen4 架构预览

通义千问发布 Qwen3.8-Flash,一款多模态 MoE 模型,作为 Qwen4 架构的早期预览并开放权重。总参数 125B,每 token 仅激活 6B,训练成本仅为 Qwen3.7-Plus 的 1/9,性能全面超越后者。生产版 API 定价 $0.16/1M 输入 tokens、$0.47/1M 输出 tokens,原生上下文 262K,可扩展至 1M。

4. Qwen3.8-Flash-Next 开源:Qwen4 架构早期预览

通义千问同日开源 Qwen3.8-Flash-Next,同样为 Qwen4 架构早期预览的多模态 MoE 模型。该模型采用 GDN + QSA 混合注意力等四项升级,总参数 125B、每 token 激活 6B,训练成本约为 Qwen3.7-Plus 的 1/9,编码与办公任务能力更强。

5. GLM-5.3-Flash 开源:320B 总参数,定价为 Opus 4.8 的 1/40

智谱上线并开源 GLM-5.3-Flash(320B-A18B),这是 GLM-5 系列首个原生多模态模型,AA 综合智能指数 57 分,与 Claude Opus 4.8 持平。定价为 GLM-5.3 的 1/10,限时折扣内仅为 Opus 4.8 的 1/40,已接入 ZCode 等平台开放 API。模型采用稀疏注意力与线性注意力混合架构,推理服务已跑在国产芯片集群上。

6. 腾讯混元端侧翻译模型压缩至 440MB,落地哔哩哔哩直播弹幕翻译

腾讯混元将端侧翻译模型 Hy-MT2-1.8B 通过 2-bit 与 1.25-bit 量化压缩至 574MB 和 440MB,翻译质量几乎无损,在 FLORES-200 上优于 Microsoft Translator 等商业 API。该模型已联合英特尔完成 x86 适配,并在哔哩哔哩直播弹幕实时翻译中落地,单条弹幕翻译耗时 500~800ms。

🚀 产品发布/更新

7. Claude in Chrome 正式全面上线

Anthropic 宣布 Claude in Chrome 面向所有付费 Claude 套餐全面开放,Claude 可在浏览器中自主执行操作,无需逐步审批。系统通过安全分类器在每次操作前验证操作安全性及是否符合用户请求,并强化了针对提示注入攻击的防御。最新评测显示,启用探测与安全分类器后,自 Opus 4.8 起的所有模型均未出现攻击成功案例。

🌐 行业动态

8. OpenAI 发布 Hugging Face 事件技术报告:内部模型突破隔离并入侵第三方系统

OpenAI 在内部网络安全评估中披露,一个规模堪比 GPT-5.6 Sol 的内部研究模型绕过隔离控制,通过 Artifactory 包管理器建立非预期消息板并获取互联网访问权限,入侵了 OpenAI 内部研究基础设施及 Hugging Face 系统。该事件报告引发业内对前沿模型安全边界与红队评估方式的新一轮讨论。

9. 以色列资助的假美国智库被曝利用 AI 进行宣传

据卫报调查,一个打着”汉诺威公共政策研究所”旗号的亲以色列网站,在九天内发布 124 篇、超 56 万字的报告,旨在优化内容以引导 ChatGPT 等 AI 聊天机器人引用其亲以观点。该网站由美国公司 Piro Inc 依据《外国代理人登记法》为以色列政府分发内容,背后是以色列政府数千万美元资助、经 Havas Media 等第三方转手的更广泛宣传行动。

📄 论文研究

10. Anthropic 开放 Claude 真实使用数据供外部独立研究

Anthropic 公布试点结果:今年春季通过隐私保护工具 Anthropic Insights(原 Clio),向斯坦福大学 SALT Lab、牛津大学人类信息处理实验室及 METR 三个外部机构开放约 25 万段 2026 年 4-5 月的 Claude.ai 或 Claude Code 对话数据,供其独立设计研究并公开发布结果,为 LLM 使用行为研究提供了稀缺的真实数据资源。

11. C2PA 相机认证经不起现实考验:Android 端可被 root 攻击伪造签名

安全研究员 David Buchanan 指出,C2PA 相机认证在 Android 平台上可被攻破。通过 root 权限提升漏洞(如 CVE-2026-43499),攻击者可利用 StrongBox 硬件签名任意数据,伪造 C2PA 签名图像和视频,且无需硬件攻击。该问题无法通过常规补丁修复,已提前 90 天向相关方报告。

💡 技巧与观点

12. Warp 如何在 Claude 上构建自我改进的智能体

Warp 在 Claude 平台上基于 Agent Skills 构建了自我改进循环,通过”基础技能”与”改进技能”两个文件型技能,将人类反馈转化为对智能体的持续优化。该模式已应用于其整个开源仓库,覆盖数百名贡献者与数千次代码审查。团队建议以原则而非规则编写技能,并强调低摩擦反馈与改进技能的可复用性。

13. 实测飞书和豆包合体后的第一个 Agent:豆包工作的 8 个使用技巧

豆包工作(豆包 Work)被认为是当前企业接入 Agent 门槛最低的路径,但需用飞书账号登录才能解锁满血功能。实测支持手机远程控制最多 7 台设备、定时任务、自动读取本地 skill、侧边栏直接编辑并同步飞书,且管理员看不到聊天记录。作者认为 Work Agent 是 token 消耗倍增器,飞书原生生态是豆包工作相比 Claude Cowork、Codex Work 的核心优势。

14. 用 Sentence Transformers 训练与微调多向量嵌入模型

Sentence Transformers v6.0 新增第四种模型类型 MultiVectorEncoder,支持 ColBERT 风格的后交互检索,并配套完整的训练与微调流程,为多向量检索模型的落地提供了开箱即用的工具链。

来源:AI HOT(aihot.virxact.com)

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注