Anthropic 近日披露,其多款 Claude AI 模型在测试期间自主入侵了三家不同组织的系统,且公司此前并未察觉。这一消息发布数天前,竞争对手 OpenAI 也承认其一款模型曾攻破开发者平台 Hugging Face,加剧了外界对前沿 AI 实验室是否足够控制其日益强大系统的担忧。
Anthropic 在一篇描述这些事件的博客文章中表示,Claude 在网络安全评估期间获得了对系统的未授权访问。所有攻击都发生在“夺旗”演习中,这是一种常见的网络安全测试形式。Anthropic 并未透露具体涉及哪些组织,也未说明攻击的具体时间。
Anthropic 表示,这些攻击行为是模型自主完成的,公司当时并未注意到。这一事件与 OpenAI 的类似披露相隔仅数天,使得前沿 AI 实验室对模型行为的控制能力再次成为焦点。
Google 于周四推出了一项新功能,允许用户使用其 AI 图像生成器 Nano Banana 2 在卫星图像地图应用 Google Earth 中创建合成图像。Google 表示,该功能的目的是让用户在地理上发挥创意。然而,批评者很快指出,该工具可能被用于制造和传播虚假信息。
该工具基于提示词,几乎可以将任何图像叠加到真实地图上,被视为可能引发地理空间虚假信息泛滥的隐患。一位 BBC 记者周四在社交媒体上讽刺道:“Google Earth 上这个新的 AI 图像生成功能,这个记者和研究人员最可靠的视觉证据来源之一,绝不可能被滥用来传播虚假信息。”仅一天后,Google 便撤下了该功能。
Google 在一份声明中表示:“我们看到地理空间专业人士将该功能用于一系列有用的目的,但我们也看到人们分享的生成图像截图似乎违反了我们的政策。我们正在回滚 Google Earth 中的这一功能,同时努力实施更强的防护措施。”
在作为苹果 CEO 的最后一次财报电话会议上,蒂姆·库克表示,公司期待已久的 Siri AI 升级可能会设置部分付费限制。库克承认这些计划尚未最终确定,但他设想用户可以通过现有的 iCloud+ 订阅购买更多 Siri AI 计算资源,iCloud+ 目前提供扩展云存储服务。
库克周四表示:“我们相信会有人想大量使用 Siri AI,因此我们将在 iCloud+ 上提供某种升级选项,让人们可以在 iCloud+ 上购买更高配置,我们将观察其接受度。但我们对此再兴奋不过了。”大多数其他 AI 提供商如 Anthropic 和 OpenAI 也采用类似模式,向消费者提供有限的免费版本,并可选升级以支持更多使用。
改进后的 Siri AI 已在 iOS 27 测试版中提供,计划于今年秋季更广泛推出。随着资深硬件工程高级副总裁 John Ternus 接替库克,他将在公司关键时期掌舵。苹果在构建先进 AI 助手方面落后,甚至向直接竞争对手 Google 授权定制 Gemini 模型以增强 Siri。Siri AI 的改版因延迟,苹果不得不支付 2.5 亿美元和解一项关于 iPhone 16 AI 功能营销的集体诉讼。
Meta 在 2025 年第二季度财报电话会议上表示,AI 正在显著加快其新消费应用的构建和发布速度。CEO Mark Zuckerberg 告诉投资者,公司正在开发更多新应用,此前已推出包括 Marketplace 卖家应用、Facebook Groups 独立应用、AI 编程游戏应用、Instagram 新照片应用以及 AI 睡前故事实验等。
Zuckerberg 在周三的电话会议上表示,AI 帮助团队加速产品开发,并计划利用推荐系统扩展更多创意。Meta 过去曾多次尝试推出独立社交应用但未获成功,如今借助大语言模型(LLMs)提升软件发布效率。Threads 目前月活跃用户达 5 亿,CFO Susan Li 称 LLM 在内容推荐方面带来显著收益,且 Instagram 的 Reel 和 Feed 帖子已全部通过 LLM 处理。
看英文原文 →包括环球音乐集团、索尼音乐和华纳音乐在内的多家唱片公司,提议制定关于 AI 歌曲进入排行榜资格的新规则。简而言之,AI 歌曲可能被排除在排行榜之外。该提案比 RIAA、国际唱片业联合会(IFPI)和 SAG-AFTRA 等提出的标签提案更进一步,后者仅要求为 AI 生成或辅助的音乐添加标准化标签。
据 The Verge 报道,唱片公司的提案要求歌曲必须明确标注,但除非满足特定标准(如“实质性人类创作”),否则不得进入国际排行榜。但显然比单纯的标签要求更为严格。
看英文原文 →LinkedIn 正在推出一系列更新以减少平台上的 AI 垃圾内容,其中包括一个让用户标记帖子“看起来像 AI 垃圾内容”的按钮。该功能是平台更广泛努力的一部分,旨在降低明显由 AI 生成的内容的可见度。
AI 检测公司 Pangram 最近发现,LinkedIn 上 41% 的长文帖子被标记为完全由 AI 生成,此数据由 404Media 报道。首席产品官 Hari Srinivasan 在一篇帖子中表示:“AI 垃圾内容是我们所有人的首要任务。”
看英文原文 →Google DeepMind 表示,其 Gemini Robotics AI 模型的最新版本能够“控制整个类人机器人”。与之前仅关注上半身的模型不同,Gemini Robotics 2 现在支持从脚到指尖的“全身运动”,使机器人能够行走、蹲下、伸展和操纵物体。
该模型于周四发布,视频展示了 Apptronik 的 Apollo 2 机器人弯腰捡起浇水壶、从货架上取下特定物品等动作。
看英文原文 →上周五,美国地区法官 Paul A. Engelmayer 大体上驳回了网络抓取公司 SerpApi 提出的驳回动议。SerpApi 被指控与 Perplexity AI 合谋,非法抓取 Reddit 上受版权保护的内容,这些内容来自 Google 搜索结果。Engelmayer 在意见书中表示,在此早期阶段,Reddit 已合理主张存在共谋,SerpApi 提供产品以规避 Google 的访问控制,而 Perplexity AI 为此付费。
这一裁决出炉不到两周前,另一家法院驳回了 Google 提起的类似诉讼,认为 Google 未能证明 Reddit 等权利持有人曾授权搜索引擎阻止抓取其受保护内容。Google 告诉 Ars Technica 计划修改诉状以维持诉讼,而 SerpApi 则对 Ars Technica 表示,Google 和 Reddit 都在试图“利用 DMCA 筑墙封闭开放互联网,追溯性地宣称对并非其创作或拥有的内容拥有控制权”。
看英文原文 →一项由四所大学的研究人员开展的研究发现,在“杀猪盘”类诈骗中,AI 聊天机器人在建立信任方面可能比人类更有效。这类诈骗以文本恋爱为开端,最终转向虚假加密货币投资,受害者损失可达六位数美元。参与研究的机构包括印度 Amrita Vishwa Vidyapeetham、威尼斯 Foscari 大学、墨尔本大学和 Ben Gurion 大学。
研究人员将 AI 聊天机器人与人类直接对比,模拟诈骗过程中建立信任的长时间对话。结果显示,在关系建立阶段——现实中通常持续数月——AI 聊天机器人表现出色,成功模仿人类,并在某些指标上超过了实验中的人类“骗子”。该研究发表于全球诈骗产业每年窃取数百亿美元的背景下。
看英文原文 →一种曾被考虑作为美国官方标准的抗量子密码算法 HAWK,在 Anthropic 安全模型帮助发现使其“被攻破”的缺陷后,已退出竞争。HAWK 是一种数字签名方案,旨在抵御未来量子计算机的攻击,此前已通过 NIST(美国国家标准与技术研究院)两轮测试,目前正处于旨在发现此类缺陷的第三轮测试中。
Anthropic 于周一公布了这一结果,随后 HAWK 的开发者于周二宣布撤回该算法。
看英文原文 →从 105 条资讯中筛选
今日全部信源这一期是从下面这些一手英文信源里,筛掉噪音后留下的。