2026-07-09
- 诉讼:男子用 Grok 生成 7000 张继女色情图片 9/10
- OpenAI 推出全双工语音模型 GPT-Live-1 9/10
- SpaceXAI 发布 Grok 4.5,称为'Opus 级'模型 8/10
- 黑客利用 9 款流行 AI 工具通过提示注入组建僵尸网络 8/10
- 初创公司押注视频游戏数据训练机器人 AI 7/10
- 谷歌 25 万美元悬赏 KVM 逃逸漏洞 7/10
- OpenAI 揭露 SWE-Bench Pro 基准测试缺陷 7/10
诉讼:男子用 Grok 生成 7000 张继女色情图片
此案凸显了生成式 AI 大规模助长儿童剥削的灾难性潜力,给 AI 公司施加了巨大压力,要求其实施强大的安全过滤器并透明报告。结果可能为 AI 误用的平台责任设定法律先例,影响所有 AI 提供商设计和监控其模型的方式。 诉讼称,尽管生成了数千张虐待图片,xAI 仅标记了一个描述轮奸的提示。此案是更广泛集体诉讼的一部分,该诉讼指控 X 和 xAI 构建了“脱衣”工具,可在未经同意的情况下剥离衣物或生成裸体图像,随后被用于制作儿童性虐待材料。rss · Ars Technica · 7月8日 19:56
背景: Grok 是 xAI 开发的 AI 聊天机器人,于 2023 年推出并更新了图像生成功能。“脱衣”应用利用生成式 AI 从穿衣照片创建逼真的裸体图像,常被滥用于色情报复和剥削。该诉讼称,Grok 缺乏足够的过滤器,导致生成了数千张儿童性虐待材料图片,引发了关于 AI 安全和企业责任的严重质疑。
参考链接
OpenAI 推出全双工语音模型 GPT-Live-1
2026 年 7 月 8 日,OpenAI 发布了 GPT-Live-1 和 GPT-Live-1 mini,这是全双工语音模型,能够同时听和说,在 ChatGPT 中实现更自然的实时对话和实时翻译。 这一实时对话式 AI 的突破,使得更流畅、更人性化的交互成为可能,消除了尴尬的停顿,并改善了实时翻译、语音助手及无障碍工具等应用。 这些模型采用连续交互框架,同时处理双向音频,每秒多次决定是说、听、暂停还是打断;它们还将更深层次的推理委托给 GPT-5.5。rss · TechCrunch · 7月8日 17:00
背景: 传统的语音 AI 采用半双工通信,即一方必须停止说话后另一方才能开始。全双工建模实现了同时听和说,模拟自然的人类对话。OpenAI 的新模型是朝着更自然的语音界面迈出的重要一步。
参考链接
SpaceXAI 发布 Grok 4.5,称为'Opus 级'模型
2026 年 7 月 8 日,SpaceXAI 发布了 Grok 4.5,埃隆·马斯克称其为'Opus 级'模型,与 Anthropic 的 Claude Opus 等前沿模型相比,速度更快、成本更低。 此次发布表明 SpaceXAI 意图直接与领先的 AI 实验室竞争,可能推动大语言模型市场降低成本和提高效率。 马斯克表示,Grok 4.5 基于测试人员的强烈积极反馈,将于 2026 年 7 月 9 日向公众开放。据称,该模型比同类模型更快、更节省 Token 且成本更低。rss · TechCrunch · 7月8日 19:30
背景: 'Opus 级'模型指的是 Anthropic 最高级别的 Claude Opus 模型,以其在编程、智能体和企业工作流中的智能而闻名。通过将 Grok 4.5 与 Opus 比较,SpaceXAI 将其定位为前沿级别的替代品。
参考链接
黑客利用 9 款流行 AI 工具通过提示注入组建僵尸网络
安全研究人员发现,黑客可利用九款最流行 AI 工具中的提示注入漏洞来组建大规模僵尸网络,将 AI 模型变成网络攻击的无意帮凶。 这一发现突显了 AI 安全中的关键漏洞,可能让攻击者快速扩展僵尸网络,影响云基础设施并可能扰乱各行业的服务。 该攻击依赖于提示注入,即将恶意指令嵌入 LLM 处理的输入中,利用了九款未具名但广泛使用的 AI 工具;发布时尚无补丁可用。rss · Ars Technica · 7月8日 07:00
背景: 提示注入是大语言模型特有的安全漏洞,因为系统提示和用户输入都是自然语言字符串,使得模型无法区分合法指令和嵌入的恶意命令。这种攻击向量已成为 AI 安全的首要威胁,攻击者可通过精心构造的欺骗性输入覆盖安全控制。
参考链接
初创公司押注视频游戏数据训练机器人 AI
General Intuition 提议使用数百万小时带有动作标签的视频游戏片段,作为物理 AI 基础模型的训练数据,有望以极少的真实世界数据加速机器人开发。 这种方法可能克服机器人领域真实世界训练数据稀缺且成本高昂的问题,实现更快速、可扩展的智能机器人开发。如果成功,它可能成为机器人行业类似 ChatGPT 的突破性进展。 General Intuition 认为视频游戏数据捕捉了人类的感知和运动决策,这是像 ChatGPT 这样的文本模型无法做到的。据报道,该初创公司已筹集 3.2 亿美元用于实现这一愿景。rss · TechCrunch · 7月8日 19:19
背景: 物理 AI 指在现实世界中运行的 AI 系统,如机器人和自动驾驶汽车。训练此类系统通常需要大量真实世界数据,成本高昂且难以收集。物理 AI 的基础模型(如 NVIDIA 的 Cosmos)旨在为通用机器人智能提供基础。使用视频游戏数据作为训练源是一个新兴想法,因为游戏模拟了逼真的物理和人类交互。
参考链接
谷歌 25 万美元悬赏 KVM 逃逸漏洞
Linux KVM 中存在一个高危漏洞,允许拥有客户机虚拟机攻击者逃逸并在宿主机上获得 root 权限。谷歌向发现该漏洞的研究人员支付了 25 万美元的漏洞赏金。 该漏洞对依赖 KVM 虚拟化的云服务商和 AI 基础设施至关重要,成功利用可能危及其他共享同一宿主机的租户。这凸显了虚拟化环境安全面临的持续挑战。 该漏洞涉及破坏宿主机内核的阴影页表(用于地址转换)。研究人员 Kim 发布了一个概念验证利用,可在宿主机上触发崩溃,但完整的虚拟机逃逸利用已存在,且在可预见的未来不会发布。rss · Ars Technica · 7月8日 19:01
背景: 虚拟机逃逸是一种安全漏洞,其中在虚拟机内部运行的程序突破隔离访问宿主机操作系统。KVM(基于内核的虚拟机)是 Linux 内核模块,使内核能够充当虚拟机监控程序,支持多个虚拟机运行。此类严重漏洞的漏洞奖励计划鼓励负责任的披露和安全研究。
参考链接
OpenAI 揭露 SWE-Bench Pro 基准测试缺陷
OpenAI 发布分析报告,指出 SWE-Bench Pro 编码基准测试存在重大问题,质疑其评估 AI 模型的可靠性。 这很重要,因为 SWE-Bench Pro 等基准测试被广泛用于衡量 AI 编码能力;若存在缺陷,可能会误导进展评估和开发优先级。 SWE-Bench Pro 包含来自 41 个专业代码库的 1865 个任务,旨在抵抗数据污染;OpenAI 的分析可能指出了任务设计或评估方法中的具体缺陷。rss · OpenAI · 7月8日 13:00
背景: AI 编码基准测试用于衡量语言模型解决软件工程任务的能力,通常包括修复真实代码库中的 bug 或实现功能。SWE-Bench Pro 是早期 SWE-Bench 的进阶版本,专注于长期、多步骤任务。然而,确保这些基准测试准确反映真实能力具有挑战性,因为可能存在数据泄露或过度简化等问题。