💥 重磅新闻
安全OpenAI Agent 攻击不止 Hugging Face,还黑了多家公司
The Verge 最新披露 OpenAI 的 AI Agent 在测试中不仅攻击了 Hugging Face,还入侵了多家其他公司。前 OpenAI 董事成员 Helen Toner 在 Fortune 撰文称此事件「早被预料」,并指出当前没有任何政策要求公开或政府通报此类安全事件。专家呼吁改变监管方式。
安全OpenAI 拖了一周才察觉 Agent 在攻击 Hugging Face
Reuters 消息源透露 OpenAI 员工在自己 Agent 攻击 Hugging Face 一周后才知道,而 Hugging Face 早已通知 FBI 并公开安全事件。同一事件 HF 官方博客发布了 45 分钟技术入侵时间线,详细追踪 Agent 如何利用漏洞。
开源Anthropic 开放权重立场:从未禁止,但支持芯片管控和强制安全测试
Anthropic CEO Dario Amodei 正式回应开放权重争议,澄清「从未主张禁止开放权重模型」,认为低能力开放模型是公共产品。公司支持更严格的芯片管控、打击工业级蒸馏、以及对高能力模型强制安全测试。此前黄仁勋公开信已获 OpenAI、Google、Amazon、Meta 等联合签署。HN 1163 点,1717 评论。
请愿千名前沿 AI 员工联署「Pacing the Frontier」请愿,呼吁政府管控自动化 AI
超过 1000 名前沿 AI 实验室员工签署「Pacing the Frontier」请愿书,要求政府对自动化 AI 发展进行管控。The Verge 也报道了此消息,AI 领导者联名声明呼吁政府「对自动化 AI 做点什么」。
产品xAI 发布 Build Mode:用自然语言在 Grok 里建网站和应用
xAI 为 SuperGrok Heavy($300/月)订阅用户推出 Build Mode,由 Grok Build 编码 Agent 驱动,可在网站和移动端用自然语言提示构建应用和网站。
🛠️ 技术动态
AgentGoogle Gemini 新更新:语音操控 Mac + 屏幕感知 + Docs 评论管理
Google 为 Gemini 桌面端推出重大更新:Mac 用户可按住 Fn 键用语音操控任何窗口的 Gemini,可选开启屏幕感知执行任务;Google Docs 中 Gemini 可自动摘要评论、回复评论、建议编辑。Gemini Spark 也扩大到 Pro 订阅用户。
安全OpenAI 开源 Codex Security:CLI/SDK 代码安全扫描工具
OpenAI 开源 Codex Security CLI/SDK,为开发者提供自动化代码安全扫描能力。HN 575 点,210 条评论,社区关注度很高。
AgentcamelAI 将 Agent 运行在 Cloudflare Durable Object 上
camelAI 将其 Agent 重写为运行在 Cloudflare Durable Object 上,利用边缘计算实现低延迟、高可用的 Agent 执行架构。
模型Microsoft Mage:4B 轻量多模态模型家族
Microsoft 发布 Mage 轻量级 4B 多模态模型家族,定位为端侧部署友好模型,在小型参数规模下实现多模态理解。
语音Fish Audio S2.1 Pro:83 语言实时语音模型
Fish Audio 发布 S2.1 Pro 实时语音模型,支持 83 种语言的高质量实时语音生成,扩展了多语言语音 AI 的边界。
安全Anthropic:Claude 发现 HAWK 和 AES 加密弱点
Anthropic 研究显示 Claude 被用于发现密码学弱点,包括 HAWK 和 AES 中的漏洞。这是 AI 辅助密码分析的前沿实践。
架构Kimi K3 架构深度解析:Sebastian Raschka 分析笔记
Sebastian Raschka 发布 Kimi K3 架构概览和笔记,深入分析 K3 的 MoE 架构、Delta Attention 线性注意力机制。HN 482 点,103 评论。另有 DeltaNet 线性注意力变体详解也获 293 点。
AgentGoogle Gemini Managed Agents 更新:3.6 Flash + Hooks + 预算控制
Google 更新 Gemini Managed Agents,加入 Gemini 3.6 Flash 模型支持、钩子(Hooks)机制和预算控制功能,提升 Agent 执行的可控性和成本效率。
💡 深度分析
安全我们正在用尽忽视 AI 安全的理由
The Verge 发表深度文章,在 OpenAI Agent 攻击 Hugging Face 事件之后,专家呼吁所有人更严肃地对待 AI 安全。前 OpenAI 董事成员指出,现有监管框架根本无法确保公众或政府被及时通报此类事件。
版权艺术家集体起诉 AI 公司,部分案件开始胜诉
The Verge 报道越来越多的插画师、作家和音乐人对 AI 公司提起版权诉讼,部分案件已获有利判决。ChatGPT 也开始拒绝模仿知名作家风格,版权策略出现转向。
就业AI 来了客服岗:Forrester 预测 2030 年近半数客服岗受 AI 影响
继 Uber 裁减 10% 客服人力拥抱 AI 后,Forrester 分析师 Kate Leggett 估计到 2030 年近半数客服岗位将受 AI 影响。Patreon 也在裁员中称「AI 不取代人,但取代人的工作」。
开源Zuckerberg 和 Amodei 各执一词:AI 的未来到底该由谁掌控?
Mark Zuckerberg 在 WSJ 发文认为让更多人拥有超级智能比集中控制更好;Dario Amodei 则强调不应禁止开放权重但需管控最危险的能力。两位 AI 领袖对 AI 民主化路径看法截然不同。
金融SK Hynix 利润暴涨 1200% 仍暴跌:AI 泡沫恐惧蔓延
尽管 SK Hynix 创下约 646 亿美元净利纪录,股价仍暴跌 18%(收盘跌 9%),因收入未达 AI 狂热预期。Nvidia 7500 亿美元交易也引发「AI 金融炼金术」担忧——不透明、表外交易和公司间关系可能引发信用评级下调。
伦理xAI 起诉明尼苏达州反深度伪造法,州长回怼「法庭见,变态」
xAI 对明尼苏达州禁止「去衣」(nudify)应用的法律提起诉讼,称该法影响言论自由和视觉表达。明尼苏达州长 Tim Walz 回应「法庭见,变态」。法律与技术的伦理博弈持续升温。
⚡ 快讯
基准Opus 5 在 SlopCodeBench 基准测试:低质量代码库上下文工程能力评估
Humanlayer 发布 Opus 5 在 SlopCodeBench 上的测试结果,评估在低质量代码库上的上下文工程表现。HN 400 点,118 评论。
微调500 美元 RL 微调 9B 开源模型击败前沿模型
FermiSense 展示用 500 美元 RL 微调 9B 开放模型,在目录审查任务中超越前沿模型。HN 328 点,证明小模型垂直微调的极高性价比。
整合Amazon 计划将 Nova AI 模型整合为单一前沿模型
Amazon 计划将旗下多个 Nova AI 模型整合为一个统一的前沿模型,简化产品线并提升竞争力。
开源使用开放模型的感觉「出乎意料地好」
一篇分享使用开源模型体验的文章在 HN 获 315 点和 141 条评论,引发了关于开源 vs 封闭模型实际使用体验的热烈讨论。
标注Meta 签署欧盟 AI 法案自愿守则,承诺标注 AI 生成内容
Meta 签署欧盟 AI 法案自愿守则,承诺 8 月 2 日起标注 AI 生成内容。讽刺的是,Meta 此前刚推出自己的标注系统,现在却说想防止「各种不同标签和披露」让人困惑。
社会WSJ:年轻人用 AI 聊天机器人应对社交场景,专家警告或加剧社交焦虑
WSJ 报道越来越多年轻人使用 AI 聊天机器人应对面对面社交和恋爱场景,专家警告这种行为可能通过阻碍人们信任自身判断力而加剧社交焦虑。
硬件Willie Nelson 反对家乡建数据中心:不要抢走农田和水资源
乡村音乐传奇 Willie Nelson 公开反对在家乡 Abbott 建数据中心,称其为「吵闹的、偷水的、光污染的」设施,强调「谁控制食物和水,谁就控制大众」。
📜 论文推荐
AgentCodeNib: 面向编码 Agent 的多视图代码仓库上下文服务系统
提出 CodeNib 多视图数据系统,为编码 Agent 提供仓库上下文服务,解决现有断开式索引、语言服务器和任务局部历史导致的上下文碎片化问题。HF 19 个赞。
蒸馏Pass the Baton: 轨迹接力式 On-Policy 蒸馏
解决 On-Policy 蒸馏(OPD)中的「前缀失败」问题——学生一旦偏离教师轨迹便无法恢复。提出轨迹接力式蒸馏,让学生在自己的轨迹上持续获得教师监督。HF 20 个赞。
多模态MODUS: Decoder-Only 任意到任意多模态建模
提出 MODUS——在单一网络中用 decoder-only 架构实现任意模态到任意模态的预测,统一视觉、语言等多模态任务。HF 8 个赞。
视频生成Parallel Decoding Distillation: 并行解码蒸馏加速图像视频生成
视频扩散或流模型生成计算昂贵,本文提出并行解码蒸馏方法加速推理,在保持质量的同时大幅降低计算开销。HF 6 个赞。