英伟达在 AI 芯片领域的竞争对手 Etched 于周二发布了一份进展报告,此前台积电已于今年早些时候成功制造了其芯片。这家初创公司表示,其产品——由这些芯片驱动的完整系统——已获得 10 亿美元的合同订单。Etched 目前正在与客户测试其首款产品,该公司将这些系统称为“前沿推理集群”,包含芯片以及定制设计的机架和软件,旨在帮助前沿模型比竞争对手更快、更便宜、更节能地运行推理。推理是用户提交提示后发生的过程,目前是试图大规模服务客户的 AI 公司最大的瓶颈和成本中心,这也正是投资者关注任何承诺解决此问题的公司的原因。
Etched 成立于 2022 年,现已累计融资 8 亿美元。最近一轮是去年 12 月完成的 5 亿美元融资,投后估值为 50 亿美元。投资者包括 VentureTech Alliance、Jane Street、Hudson River Trading、Two Sigma、Ribbit Capital 和 Stripes,其中 Stripes 领投了这轮 5 亿美元融资。该公司还获得了 AI 领域重量级人物的天使投资,包括 Andrej Karpathy、Geoffrey Hinton、Fei-Fei Li、Arthur Mensch 和 Scott Wu,股东名单还包括亿万富翁 Stanley Druckenmiller 和 Peter Thiel。
尽管 Etched 的新闻稿将周二的公告描述为“走出隐身模式”,但联合创始人——CEO Gavin Uberti 和总裁 Robert Wachen——自 2024 年以来一直在与 TechCrunch 讨论其芯片计划。两人都从哈佛辍学并成为 Thiel 研究员以创立 Etched。到 2024 年,Etched 已筹集超过 1.25 亿美元,但创始人在播客中表示,2023 年他们很难让投资者感兴趣,即使有一份 30 页的备忘录论证 AI 最终需要专用芯片。当时公司据报道按月运营,濒临现金耗尽。相比之下,如今的融资环境截然不同,投资者追逐一切与 AI 相关的事物,尤其是加速推理的芯片技术。竞争对手 Cerebras 今年首次 IPO 成功,AI 芯片制造商 Groq 刚刚融资 6.5 亿美元,亚马逊、谷歌和微软都在构建自己的内部 AI 芯片,OpenAI 也刚刚宣布了其首款定制芯片。
随着代理能力成为基础模型公司的标配,Anthropic 发布了 Claude Sonnet 5,这是其中型模型的更强大、更具代理能力的版本。Anthropic 在博客文章中表示:“它可以制定计划、使用浏览器和终端等工具,并以几个月前需要更大、更昂贵模型才能实现的水平自主运行。”这一表述与 OpenAI 和谷歌对其近期发布的描述类似。OpenAI 的 GPT-5.6 Sol 上周以预览版形式发布,也是其最具代理能力的模型;谷歌的 Gemini 3.5 Flash 于 5 月发布,被定位为从对话式聊天机器人向代理工具的转变。
Sonnet 5 的定价为每百万输入 token 2 美元、每百万输出 token 10 美元,有效期至 8 月 31 日,之后价格将升至每百万输入 token 3 美元、每百万输出 token 15 美元。这使得 Sonnet 5 比 Opus 4.8、OpenAI 的 GPT-5.5 和谷歌的 Gemini 3.1 Pro 更便宜,但仍比 Gemini 3.5 Flash 贵。与 2 月发布的上一代 Sonnet 4.6 相比,Sonnet 5 在推理、工具使用、软件编码和知识工作等代理性能上均有显著提升。例如,在代理编码基准测试中,Sonnet 5 得分为 63.2%,而 Opus 4.8 为 69.2%,Sonnet 4.6 为 58.1%。在知识工作基准测试中,Sonnet 5 甚至略微超过了以解决最难题著称的 Opus 4.8。
在安全性方面,Sonnet 5 的“不良行为”率(如配合滥用和欺骗)低于其前代,使其在代理场景中使用更安全。它更善于拒绝恶意请求和规避提示注入攻击中的劫持尝试,幻觉和谄媚行为的发生率也低于 Sonnet 4.6。不过,它在不当行为方面尚未达到 Opus 4.8 和 Claude Mythos Preview 的水平。博客文章称:“评估还显示,它执行危险网络安全任务的能力远低于我们当前的 Opus 模型。”Zapier 高级工程师 Daniel Shepard 表示,Sonnet 5 能端到端完成以前会中途停滞的任务。Lovable 联合创始人 Fabian Hedin 称,Sonnet 5“干净且一致地拒绝不安全请求”。
每当有公司宣布裁员时,与 AI 相关的失业担忧就会加剧。截至 2025 年 5 月,公司宣布近 9 万个工作岗位与 AI 相关,据一些估计,未来五年内 AI 可能消除高达 15% 的美国工作岗位。科技行业关于 AI 也将创造新工作岗位的承诺几乎无法缓解担忧,尤其是对于那些想知道毕业时是否有人会雇佣他们的这一代人。
据 Ramp 和 Revelio Labs 最近的一份报告使这一悲观叙事复杂化。这两家公司分别追踪企业 AI 支出和来自近 22,000 家公司的劳动力记录。报告发现,在 AI 上投入巨资的公司员工增长更快,即使在许多人认为注定消亡的入门级岗位也是如此。报告显示,“高强度采用者”——即在头三个月内平均每位员工每月在 AI 上花费 30 美元的公司——员工数增长了 10.2%。入门级岗位人数实际上增长了 12%。各职能部门的员工数也有所增长,包括工程、销售、行政、客户服务、财务、营销和科学家岗位。信息行业(包括软件、互联网、媒体和技术相关公司)的就业增长最为强劲。
然而,数据并不像看起来那么乐观。它严重偏向于技术前沿、知识型公司——这些公司可能获得风险投资支持,且本身增长迅速,因此很难判断 AI 是否促进了招聘,还是仅仅出现在正在扩张的公司中。报告作者承认:“本文并未表明 AI 普遍创造就业机会,但它确实反驳了 AI 将导致大规模失业的说法。”报告还指出,购买订阅并开展试点但未进行持续投资的公司,其员工数并未增长。这可能导致拥有资源(如资本、技术人员、创始人网络和管理带宽)的公司与那些停留在实验订阅阶段的公司之间的差距扩大。报告作者推测这种差距可能会继续扩大,称“没有这些渠道的公司可能会落后。”
EquiLibre Technologies,一家由三位前DeepMind研究员创立的布拉格AI实验室,目前估值超过5亿美元。据TechCrunch报道,该实验室在完成一轮未披露金额的A轮融资后达到这一估值,领投方为Creandum。三位创始人曾开发出在扑克中击败人类的AI程序DeepStack,如今将相同的强化学习技术应用于股票交易。
EquiLibre与量化公司Tower Research Capital合作,其算法已在标普500和纳斯达克市场实现每日数十亿美元的交易量。该初创公司声称,自2025年部署于加密货币市场以来,其智能体表现良好,且“自成立以来零亏损月”,即每月投资均实现正收益。Creandum副总裁Cameron Sellers向TechCrunch确认,这是该公司“有史以来对一家公司单次最大的一笔投资”。EquiLibre计划扩大计算基础设施,预计将建成中欧和东欧最大的计算集群之一。
看英文原文 →谷歌于周二发布了Nano Banana 2 Lite,这是其内部AI视频和图像生成器的最新版本。据谷歌称,该版本比之前的版本速度更快、成本更低。它能在四秒内生成图像,每千张图像成本为0.034美元,适合需要快速批量制作图像的用户。该模型通过Google AI Studio和Gemini API提供,并取代了被称为“旧版模型”的Nano Banana。
此次发布紧随去年夏天推出的Nano Banana(由Gemini 3.1 Flash驱动)和今年二月推出的Nano Banana 2之后。Nano Banana 2引入了生成更逼真图像的能力。Nano Banana 2 Lite针对需要快速处理的高容量工作流进行了优化。此外,谷歌还宣布了Gemini Omni Flash的更广泛发布,该模型每秒视频输出成本为0.10美元,并展示了一款新演示应用Omni Product Studio,可将静态图像转化为“电影级电商视频”。
看英文原文 →X于周一推出了一款托管的Model Context Protocol(MCP)服务器,使AI助手如Claude、Cursor、Grok Build等能够直接通过用户的账户权限连接至X平台。据TechCrunch报道,此前开发者需要自行构建并托管MCP服务器来连接X API,现在X托管了MCP,用户只需用自己的X账户进行身份验证即可。这节省了开发者的集成时间,使他们能专注于实际构建的内容。
该MCP服务器并未增加新的API功能,只是让现有功能更易于被AI应用调用。X此举加入了GitHub、Slack、Notion、Stripe和Salesforce等已提供官方MCP服务器的公司行列。X向TechCrunch澄清,该MCP工具不兼容X的Write API端点,因此无法用于自动发布帖子。X还更新了API定价,将发布帖子的成本提高至0.015美元,发布链接提高至0.20美元,以遏制滥用行为。
看英文原文 →亚马逊云服务(AWS)于周二宣布成立一个新的内部组织,专注于AI领域的前部署工程师(FDE)。该团队的工程师将嵌入客户公司,部署定制化的智能体,专注于快速参与和客户自给自足。AWS承诺为该新组织投入10亿美元,但这笔资金代表内部资源,而非合资或传统投资。
AWS前沿AI副总裁Francesca Vasquez在公告中表示,客户在部署完成后将获得新的解决方案和工程能力。前部署工程师模式由Palantir开创,在AI部署中日益流行。OpenAI和Anthropic近期也分别启动了价值40亿美元和15亿美元的FDE合资项目。AWS的FDE团队将帮助客户在自身AWS环境中运行智能体系统,并掌握可独立创新的AI技能和工作流程。
看英文原文 →Google 的 NotebookLM 正在增加一种新的笔记回顾方式:类似 TikTok 风格的 AI 视频。该新功能正在向 Google AI Ultra 和 Pro 订阅用户推出,允许 NotebookLM 根据用户上传到应用的资料生成 60 秒的竖屏 AI 视频片段。Google 分享的示例详细介绍了澳大利亚对鸸鹋的失败战争,配以剪纸风格的鸸鹋 AI 艺术和旁白。
该功能补充了 NotebookLM 其他与资料互动的方式,包括生成 AI 播客、电影化视频和视觉讲解器。
看英文原文 →Netflix 的新预告片确认其真人秀《Wonka's The Golden Ticket》将于 9 月 23 日首播,该节目延续了《鱿鱼游戏》真人秀的趋势,将虚构的折磨场景变为真实竞赛。虽然预告片中的布景是真实的,但旁白是 AI 生成的。据 Deadline 报道,Netflix 与 AI 音频公司 ElevenLabs 合作,并获得了 Wilder 家人的同意。
此前 Netflix 曾参与重现 Michael Caine 和 Stan Lee 声音的制作。该项目延续了 Netflix 自 2021 年起与 Roald Dahl 公司的合作,并与另一部查理与巧克力工厂相关作品分开。
看英文原文 →AI 浏览器制造商做出 lofty 承诺,但新研究凸显了风险。攻击者可以通过让 LLM 相信 2+2=5 等虚假现实,诱使其执行被禁止的指令,如提取私有仓库代码或密码管理器凭据。
这种攻击利用 LLM 的防护栏是反应性的这一缺陷,仅治标不治本。研究演示了网站如何让 AI 浏览器陷入虚假现实,从而绕过安全限制。
看英文原文 →一名开发者检查 Claude Code 隐私时发现,该工具会在系统提示中隐写地修改日期字符串,以标记请求来源。该功能在检测到自定义 API 基础 URL 或特定时区(如 Asia/Shanghai)时,会改变日期格式或标点,这些微小变化在普通字体中难以察觉。
据该开发者分析,Anthropic 可能利用此技术检测 API 转售商、未授权的网关或模型蒸馏攻击。域名列表经 base64 和 XOR 编码,包含中国公司域名、AI 公司域名及代理/网关域名。该行为未在文档中明确说明,引发了对信任的质疑。
看英文原文 →从 96 条资讯中筛选
今日全部信源这一期是从下面这些一手英文信源里,筛掉噪音后留下的。