2026-05-29
- Anthropic 通过 H 轮融资 650 亿美元,估值 9650 亿美元 9/10
- Anthropic 发布 Claude Opus 4.8,引入动态工作流功能 9/10
- 基因编辑药物单次注射降低坏胆固醇 62% 9/10
- LLMs 在收到警告后仍相信虚假陈述 8/10
- 互联网基础设施为机器流量重建 8/10
- 苹果蒸馏谷歌 Gemini 模型用于设备端 Siri 8/10
- 伊利诺伊州通过全美最强 AI 安全法 8/10
- Google I/O 2026:12 个重要时刻回顾 8/10
- Waymo 在德克萨斯州自动驾驶车辆注册中领先,特斯拉落后 7/10
- GitHub 封禁发布 Windows 零日漏洞的研究员 7/10
Anthropic 通过 H 轮融资 650 亿美元,估值 9650 亿美元
Anthropic 完成了 650 亿美元的 H 轮融资,投后估值达 9650 亿美元,这可能是其上市前的最后一轮私募融资。 这是历史上最大的融资轮之一,显示出投资者对 AI 领域的极大信心,并使这家私营 AI 公司估值接近万亿美元,可能重塑竞争格局。 本轮融资由 Altimeter Capital、Dragoneer、Greenoaks 和 Sequoia Capital 领投,Capital Group、Coatue、D1 Capital Partners、GIC、ICONIQ 和 XN 联合领投。
rss · HN Frontpage · 5月28日 18:09
背景: H 轮融资是针对成熟公司的后期投资轮,为其扩张或上市做准备。投后估值是指公司在接受投资后的价值。Anthropic 是一家以 Claude 模型闻名的 AI 安全与研究公司。
参考链接
社区讨论: Hacker News 上的社区评论可能讨论这一巨额估值、对 AI 发展的影响以及潜在的垄断问题。许多人可能会争论鉴于当前收入,这一估值是否合理。
Anthropic 发布 Claude Opus 4.8,引入动态工作流功能
Anthropic 发布了旗舰 AI 模型 Claude Opus 4.8 的重大更新,新增名为“动态工作流”的工具,用于协调多达 1000 个智能体(subagent)的群体协作。 动态工作流实现了复杂的多智能体协调,使 AI 能够自主处理大型软件项目和复杂任务。这可能显著提升 AI 辅助开发和自动化的生产力。 工作流脚本本身不能访问文件系统或 shell,只有子 agent 可以读写和执行命令。进度会保存,中断的任务可继续,完成的任务返回缓存结果,工作流上限为 1000 个 subagent。
rss · HN Frontpage · 5月28日 16:49
背景: Claude Opus 是 Anthropic 能力最强的 AI 模型,专为高级推理和编程设计。Subagent 是在主 agent 协调下处理子任务的专门 AI 实例。动态工作流通过将工作流脚本与 agent 执行分离,超越了之前的 subagent 方案,使计划即使在中断时也能保持正确执行。
参考链接
基因编辑药物单次注射降低坏胆固醇 62%
在 I 期临床试验中,单次输注研究性碱基编辑药物 VERVE-102 使 LDL-C(坏胆固醇)降低了 62%,效果持续数月。 这标志着心血管治疗可能迎来范式转变,提供一次性疗法而非每日服用他汀类药物来控制高胆固醇,有望改善患者依从性和治疗效果。 VERVE-102 利用碱基编辑技术灭活肝细胞中的 PCSK9 基因,礼来公司的 I 期试验中期结果显示,高剂量组未出现严重不良事件。
rss · Ars Technica · 5月28日 13:39
背景: 高 LDL-C 是心脏病的主要风险因素,目前的治疗通常需要每日服药。像 VERVE-102 这样的基因编辑疗法旨在永久性地关闭调节胆固醇产生的基因,从而可能通过单次给药实现长期获益。
参考链接
LLMs 在收到警告后仍相信虚假陈述
新研究发现,大型语言模型(LLMs)表现出否定忽略现象,即使在明确警告这些陈述是虚假的情况下,它们仍然相信虚假陈述。即使每个引用虚假主张的句子前后立即有句子说明该主张是虚假的,这种现象仍然会发生。 这一发现揭示了 LLMs 在忽略虚假信息能力方面的根本性局限,对人工智能的安全性和可靠性具有严重影响,特别是在事实核查和虚假信息检测等应用中。它表明当前的模型训练和提示策略可能不足以纠正根深蒂固的错误信念。 这项研究在论文《否定忽略:当模型在训练中未能学习否定》中描述,表明即使警告明确,否定忽略仍然存在。然而,如果否定在同一句子内局部表述(例如,“埃德·希兰没有赢得 100 米金牌”),模型在很大程度上能正确学习否定。
rss · Ars Technica · 5月28日 21:29
背景: 否定忽略是一种认知偏差,人们未能正确处理否定,常常保留虚假信息。在 LLMs 中,这源于训练数据中否定常常嵌入在复杂上下文中,使得模型难以调整其内部表征。先前的工作已表明 LLMs 在处理否定句时存在困难,而这项研究将其扩展到显式的元级别警告。
参考链接
互联网基础设施为机器流量重建
AWS、Cloudflare 等云服务商正在重新设计其基础设施,以应对由 AI 代理从实验阶段进入生产阶段所引发的机器生成互联网流量的激增。关键架构变化是解耦计算与存储,使计算能快速扩展以应对代理流量突发,并在空闲时缩至零,从而让客户在代理空闲时无需付费。 这一转变标志着从以人为中心的互联网设计向以机器为中心的基础设施的根本性变革,影响云计算定价模式、网络架构以及企业 IT 的未来。这是对 AI 代理迅速增长的直接回应,AI 代理目前已成为全球互联网流量的重要组成部分。 重新设计的基础设施将计算与存储分离,以应对 AI 代理不可预测的流量模式——它们可能突然激增,也可能毫无征兆地空闲。这种方法消除了为空闲计算资源付费的需要,这对运行生产级 AI 工作负载的企业来说是一大成本优势。
rss · TechCrunch · 5月28日 21:24
背景: AI 代理是自主软件系统,利用人工智能代表用户或其他系统执行任务,例如自动化客服、数据分析或网络爬虫。随着这些代理从实验阶段进入生产阶段,它们产生的互联网流量模式——如突然激增和长时间空闲——是传统为可预测的人机浏览而设计的基础设施所无法应对的。机器生成的流量目前占据并持续增长着全球互联网流量的很大份额。
参考链接
苹果蒸馏谷歌 Gemini 模型用于设备端 Siri
据报道,苹果正致力于蒸馏谷歌拥有数万亿参数的 Gemini 模型,使其能在 iPhone 上运行,以驱动自 2024 年宣布以来多次延期的新一代 AI 增强版 Siri。 这将实现无需依赖云端的强大设备端 AI,提升隐私和响应速度,并标志着苹果与谷歌的重大合作,可能重塑移动 AI 的竞争格局。 模型蒸馏涉及训练一个较小的“学生”模型模仿较大的“教师”模型,在缩小规模的同时保留能力。Gemini 模型是一个多模态 LLM,可处理文本、图像、音频和视频,将其蒸馏到手机上尤为困难但价值巨大。
rss · Ars Technica · 5月28日 18:30
背景: 像 Gemini 这样的大型语言模型通常需要庞大的服务器集群才能运行,因为它们拥有数十亿甚至数万亿参数。模型蒸馏(知识蒸馏)是一种将大模型的知识迁移到更小、更高效模型上的技术,适用于智能手机等设备。苹果一直在投资设备端 AI 以提升 Siri 的能力,同时保护用户隐私,但技术障碍导致了多次延期。
参考链接
伊利诺伊州通过全美最强 AI 安全法
伊利诺伊州立法者于周三通过了《人工智能安全措施法案》(SB 315),成为全美首个要求前沿 AI 开发者(如 OpenAI 和 Google DeepMind)进行第三方安全审计的州。 这项具有里程碑意义的法律在特朗普总统取消联邦监管计划后,显著削弱了联邦对 AI 监管的控制,为州级 AI 治理开创了先例。 该法案要求对前沿 AI 模型的安全实践进行独立第三方审计,这些模型是利用巨大计算资源训练的最先进的通用 AI 系统。
rss · Ars Technica · 5月28日 17:01
背景: 前沿 AI 模型(如 GPT-4 和 Claude)是最强大的通用 AI 系统,能够进行推理、编程和自主操作。联邦政府此前计划审查这类模型,但特朗普总统以创新为由取消了该计划。伊利诺伊州的新法律通过施加州级安全要求填补了监管空白。
参考链接
- Illinois Lawmakers Just Passed America’s Strongest AI Safety Bill | WIRED
- Illinois Legislature passes historic AI bill that would require third-party safety audits
- Illinois lawmakers send landmark AI frontier model safety bill to Gov. Pritzker — Transparency Coalition. Legislation for Transparency in AI Now.
Google I/O 2026:12 个重要时刻回顾
Google I/O 2026 主题演讲总结了 12 项重大发布,包括新的多模态生成模型 Gemini Omni 以及增强智能体与编码能力的 Gemini 3.5 Flash。 这些发布标志着谷歌在 AI 领域的强力推进,Gemini Omni 支持从多种输入生成视频,而 Gemini 3.5 Flash 则提升了自主智能体的性能边界。这让谷歌在创意与实际应用方面与其他 AI 领导者展开更激烈的竞争。 Gemini Omni 从 Omni Flash 版本开始,能从文本、音频、图像和视频输入生成高质量视频,并利用 Gemini 的推理能力。Gemini 3.5 Flash 在 Terminal-Bench 2.1(76.2%)等智能体基准上超越先前模型,专为智能体工作流和编码设计。
rss · Google AI · 5月28日 15:00
背景: Google I/O 是谷歌年度开发者大会,用于展示新技术和产品。Gemini 是谷歌的 AI 模型系列,此前已有 Gemini 1.5 和 2.0 等版本。新推出的 Gemini Omni 代表了多模态生成的飞跃,而 Gemini 3.5 Flash 则专注于智能体能力,使 AI 能自主执行复杂任务。
参考链接
Waymo 在德克萨斯州自动驾驶车辆注册中领先,特斯拉落后
德克萨斯州的新数据显示,Waymo 注册的自动驾驶车辆数量最多,而特斯拉落后,数据来自法律强制要求的自动驾驶车辆追踪工具。 这提供了政府验证的具体数据,揭示了自动驾驶车辆的竞争格局,凸显了 Waymo 的主导地位和特斯拉在实际部署中的缓慢进展。 该数据来自德克萨斯州根据参议院第 2807 号法案建立的新自动驾驶车辆注册系统,要求商业运营商获得州授权并符合安全标准。
rss · TechCrunch · 5月29日 00:14
背景: 德克萨斯州最近通过了一项法律,要求自动驾驶车辆运营商向州政府注册并获得商业运营许可。这创建了一个透明的运营车辆登记册,由美国国家公路交通安全管理局的 AV TEST 工具追踪。Waymo 已在德克萨斯州测试多年,而特斯拉的自动驾驶技术面临监管和技术挑战。
参考链接
GitHub 封禁发布 Windows 零日漏洞的研究员
GitHub 封禁了一名安全研究员,因其发布了针对 Windows 的零日漏洞利用代码,声称违反了服务条款。该研究员声称这是报复行为,并承诺采取进一步行动。 这一事件凸显了平台安全政策与负责任披露实践之间的紧张关系,可能抑制安全研究和公开漏洞报告。同时引发了关于平台治理和研究员权利的质疑。 这位化名'SandboxEscaper'的研究员此前已在 GitHub 发布过零日漏洞利用代码。据报道,微软投诉后 GitHub 将其封禁,该研究员威胁要发布更多漏洞利用代码。
rss · HN Frontpage · 5月28日 21:45
背景: 零日漏洞利用是利用软件或硬件中未知或未修复的安全漏洞进行网络攻击。负责任披露是一种安全研究人员私下向厂商报告漏洞、在公开披露前给予修复时间的流程。GitHub 的服务条款禁止发布可能损害用户的恶意软件或漏洞利用代码。
参考链接
社区讨论: Hacker News 评论反应不一:一些人批评 GitHub 的封禁过于严厉,并预测会适得其反;另一些人则认为研究员未遵守负责任披露而违反政策。部分评论指出该研究员此前曾多次未经协调发布漏洞利用代码。