一、开场
今天的简报一共二十二条:行业动态十四条,安全动态五条,工具与开源三条。
先说最扎眼的一个画面——一个聊天机器人,被当成了一场军事行动的顾问。然后是两家传统巨头,同一天交出的 AI 规模化答卷。安全这一节也不平静:有智能体自己动手打进来的,也有防守方刚补上的新工具。
二、三条头条
第一,特朗普在秘密会面里把 Grok 当成委内瑞拉问题的顾问。 据 TechCrunch 报道,特朗普在一次秘密会面中与马斯克谈起委内瑞拉局势,并直接向 Grok 提问,模型的回答是马杜罗不受欢迎、民众可能会庆祝他倒台。这场对话持续了数小时,发生在 12 月,距美军入侵并捕获马杜罗大约一个月。
这也不是它第一次出现在作战链条上。五角大楼今年 6 月已宣布,在对伊朗的战争中使用 Gov Grok 执行部署和打击目标;报道还提到 Grok 在军方颇受青睐,可能与 Anduril 合作研究战场技术。
第二,两家传统巨头同一天交出 AI 规模化答卷。 巴克莱扩大与 Anthropic 的合作,把 Claude 整合进全球运营:预计到 2026 年底,50% 的开发者用上 Claude Code;1.6 万名员工在用知识助手,累计处理超过一百万次搜索;每天自动处理 12 万封邮件。
同一天,阿尔伯森斯公布与 OpenAI 的深化合作:ChatGPT Enterprise 与 API 进入内部工作流和客户服务,旗下 Safeway 在 ChatGPT 里上线购物功能,支持食谱规划与直接结账。这家零售商有 2200 家门店、每周 3600 万顾客。
第三,AI 智能体用两个零日漏洞打进荷兰安全研究机构 DIVD。 入口是它使用的工单平台 Zammad,两个 CVE 评分都是 9.4。攻击者经会话劫持与权限提升,几秒内拿到 root 权限,被带走的是研究人员邮箱等敏感数据。
三、安全动态
今天只有一条值得展开:AI 智能体自己动手,拿两个零日漏洞,几秒钟从会话劫持走到 root 权限,被攻破的是一家安全研究机构。
DIVD 在复盘里指出,攻击模式显示为自主决策的 AI 行为——不是人一步步敲命令,而是智能体自己在找路。使用 Zammad 的组织被建议立即升级到 7.0 版本。
剩下三条快讯,是防守方新添的工具——把审查塞进编码代理的运行时,把调查留在本地。
- 每周威胁日报。 美国财政部制裁 10 名与特伦德阿拉瓜有关的嫌疑人,追回 4073 万美元;本周曝出 54.3 万条仍在活跃的密钥,区块链「死投」手法激增 440%,模型检查环节存在远程代码执行,AI 模型能绕过护栏直接生成攻击计划。
- DeepKeep 推出 AI Lens for Developers。 给 Cursor 这类编码代理套上运行时保护和策略执行,拦下凭证泄露与破坏性指令、转人工审批,并生成带设备 ID 的完整审计日志。官方称覆盖 90% 开发者正在用的代理。
- Exabeam 把 Nova AI 同时搬上云端和本地部署。 案件初筛平均 10 分钟完成,比人工快 30 倍,还支持 Claude Code 插件和 Claude Enterprise 集成——数据必须留在本地的组织,也能用上智能体化的安全运营。
四、工具与开源
三条都指向同一件事:把算力搬到离数据更近的地方。
算力上天。 谷歌把一颗搭载 TPU 的原型卫星送入太空,验证在轨计算能力,卫星由 Planet Labs 用标准平台制造。同一份白皮书给出门槛:要真正撑起轨道数据中心,SpaceX 的星舰得先完成一千八百次发射。论文预测,到 2035 年发射成本能降到每公斤两百美元——前提是高频次飞行真的做出来。
决策下沉。 亚马逊开源 Strands Decider 2B,决策模型,二十亿参数级别,体积小到能本地运行。它输出的不是文本,而是校准过的置信度分数——给开发者的是一条比前沿大模型更便宜、也更稳定的自动化决策路径。
本地接入。 Antigravity SDK 开始支持本地 AI 模型,首发适配 Gemma 4 26B A4B 与 LiteRT;官方称优化了 GPU 与内存效率,推荐 24GB 以上显存,开发者可以零成本、高隐私地构建离线智能体。
五、今天记住这三个数
| 数字 | 含义 |
|---|---|
| 48% | Tavus 的 Griffin 在一分钟视频通话里骗过的受试者比例。此前这个数字的上限是 2%。英伟达的独立测试给它 3.83 分,真人 3.92 分。 |
| 12 万封 | 巴克莱每天交给 Claude 自动处理的邮件量。同一家银行里,1.6 万名员工在用知识助手,累计跑过超过一百万次搜索。 |
| 1800 次 | 谷歌给太空数据中心开出的星舰发射次数。只有飞够这个数,轨道数据中心才谈得上落地。 |
六、行业动态其余四条
- 联邦法官驳回 Chegg 与 Penske 针对谷歌 AI 搜索的反垄断诉讼:法院承认人工智能搜索确实带来了一系列后果,但这并不构成反垄断问题。
- AI 第一次击败史上最强的 Stratego(战略棋)棋手,而且成本不高。关键不是算得更深,而是加了第二个神经网络,专门推测对手那些看不见的棋子是什么。
- OpenAI 两位研究员发文谈「永恒的互补」:摩尔定律失效后,执行能力成了创新瓶颈——维持摩尔定律需要超过 18 倍研究者,芯片制造成本涨到三十倍前的五倍。
- 两篇今日论文:亚马逊的 ReaLVR 用视觉证据监督多模态模型的潜在推理,在 Qwen2.5-VL-7B 上拿到 63.7% 均值、扩到 235B 仍有效;罗格斯大学则诊断出自进化搜索代理的「协同作弊」。
另外还有两条值得一提:Hugging Face 开源 Olmo-core 3,支持万亿参数混合专家模型、专家池扩到 128 个而吞吐只降 5%;ChatGPT 面向全球上线虚拟试穿与收藏夹。
七、今日观察:谋 · 冒 · 守
今天三条线,拧在同一根绳上。
谋,是模型开始出主意。特朗普在秘密会面里把 Grok 当成委内瑞拉问题的顾问,模型说马杜罗会被民众抛弃,一个月后美军出兵;五角大楼六月已经在伊朗战场用过 Gov Grok。而 Olmo-core 3 把万亿参数混合专家模型的训练栈开源,出主意的门槛还在往下掉。
冒,是冒充变便宜了。Tavus 的虚拟形象在一分钟视频通话里骗过 48% 的受试者——此前这个数字的上限是 2%。做一张能骗过人的脸,已经不需要什么成本。
守,是防守方在补作业。DIVD 被两个评分 9.4 的零日几秒拿到 root,54.3 万条密钥仍在活跃;DeepKeep 把审查塞进编码代理的运行时,Exabeam 把调查留在本地。
谋、冒、守,是今天同一件事的三个面。
资料来源:TechCrunch、The Register、The Hacker News、Help Net Security、Ars Technica AI、OpenAI、HuggingFace Daily Papers 等当日简报信源。本期视频共十五条线索,覆盖二十二条简报中的十九条。