美军首次将装载炸药的无人艇投入实战,目标是一艘伊朗袖珍潜艇和一处海军港口设施。这次攻击发生在7月12日晚,地点是伊朗阿巴斯港海军基地。美国使用这类自杀式海上无人装备,比伊朗和胡塞武装首次展示同类武器晚了近十年;美军中央司令部将此次行动称为美军首次在作战行动中使用海上无人艇。
美军公布的视频显示,3艘被称为“单程攻击水面无人机”的无人艇驶近目标后爆炸。美军中央司令部负责美军在中东地区的作战行动。据非营利机构美国海军学会旗下新闻服务 USNI News,3艘无人艇以低速接近目标,整个过程没有遭遇阻拦;
USNI News 还确认,其中一个目标是伊朗 Ghadir 级袖珍潜艇。袭击发生时,这艘潜艇并不在水中,而是由龙门架悬吊;视频中的另一处目标则是阿巴斯港海军基地内的舰船维护设施。
26名被列入解雇名单的员工以匿名“Doe”原告身份起诉 Meta,指控公司在涉及8000名员工的裁员中,使用内部 AI 工具决定谁被解雇,并针对残障员工以及依法享受医疗或家庭休假的员工。诉状提交至美国加利福尼亚北区联邦地区法院。Meta 否认使用 AI 解雇存在残障或医疗问题的员工。
诉状称,裁员名单并非由了解员工实际工作的管理者经过审慎判断后形成,而是由一组内部人工智能系统参与评分、排序和筛选。这些系统包括内部称为“Metamate”的系统、由员工训练的“第二大脑”智能体、键盘输入和工作活动监测数据、AI token 使用量仪表盘,以及由算法辅助的绩效排名与校准机制。原告据此主张,AI 系统实际参与了员工进入裁员名单的决定过程。
员工使用 Meta 内部 AI 工具的程度,也被指是评分项目之一。诉状称,Meta 的内部仪表盘会按照员工采用人工智能工具的阶段进行分类,所用类别包括“AI Native”“AI First”和“AI Enabled”。因此,起诉内容不只涉及自动化绩效排序,还具体指向 AI 工具采用程度、工作活动数据和算法校准等多类指标被共同用于裁员筛选。
2000年,Jennifer Lopez 的绿色 Versace 礼服引发大量搜索,让 Google 意识到用户需要直接查看图片;Google Images 随后于2001年7月推出。上线满25年之际,Google 宣布两项视觉内容功能:为图片搜索建立可浏览的新主页,并把图片生成直接加入 Search 的 AI Overviews。
新的 Google Images 主页将展示来自全网、实时更新的动态图片画廊,并按用户兴趣进行个性化调整。用户浏览并把创意保存到收藏集后,相关内容会作为标签出现在主画廊上方,便于返回继续查看。该功能将在未来几周面向美国英语用户逐步在桌面端推出,需登录 Google 账户。另一项更新使用最新 Nano Banana 模型,根据文字提示从零生成定制图片;它也将在未来几周覆盖目前已支持 AI Mode 图片创作的所有地区,并以英语推出。
Google 同时回顾了视觉搜索的演进:2009年的 Similar Images 可按示例查找相似图片;2011年的 Search by Image 支持上传图片或粘贴网址反查来源;2018年 Lens 可识别物体、翻译文字和调出商品链接;2022年 Multisearch 开始组合文字与图片查询。2024年的 Circle to Search 已覆盖全球超过5.8亿台 Android 设备。2025年,Lens 与 AI Mode 结合,通过“visual image fan-out”技术把一张图拆成数十个子查询;同年推出的 Search Live 支持实时摄像头画面与语音对话,AI Mode 也加入视觉商品结果。2026年,Circle to Search 增加单图多物体识别,新的智能搜索框则支持一次上传一张或多张图片并提出详细问题。
Thinking Machines在Hugging Face发布多模态大模型Inkling。该模型可原生接收文本、图像和音频,支持智能体任务与100万上下文窗口,并面向跨模态推理及微调后的领域适配。训练数据覆盖文本、图像、音频和视频,共计45万亿个token。
Inkling采用仅解码器的混合专家架构,总参数量975B(约9750亿),每次推理激活410亿参数,包含256个专家。BF16检查点需要2TB显存,NVFP4版本需要600GB显存;首日支持transformers、SGLang和llama.cpp。模型还配置推测式MTP层,并交替使用滑动窗口与全局注意力。
看英文原文 →Real World VoiceEQ是一项衡量语音AI人类交互质量的基准,覆盖40余款闭源及开源模型,设置15个以上评估维度和60余项指标,涉及自动语音识别、文本转语音、语音转语音及语音理解。评估重点包括语气、情绪、说话人身份和背景环境等文字转录无法保留的信息。
该基准基于不同人群、说话方式和声学环境中的逾100万次人工评分,其中包括78.5万次文本转语音评分和4.8万次语音转语音评分。评测发现,没有一种文本转语音系统配置在全部八类能力中均进入前五;带噪声语音的转录词错率约为音乐背景语音的四倍,部分模型也会忽略语速、停顿、重音和音量等线索。
看英文原文 →Bonsai发布基于Qwen3.6 27B的多模态模型Bonsai 27B,提供三值和1-bit两个版本。Ternary版采用{-1、0、+1}权重及FP16分组缩放,有效位宽1.71 bit,体积5.9GB;1-bit版采用{-1、+1}权重,有效位宽1.125 bit,体积3.9GB,可装入iPhone 17 Pro的可用内存预算。
两种版本均支持视觉输入、结构化工具调用、智能体循环、推测解码和262K-token上下文,并以Apache 2.0许可证发布。在覆盖知识、推理、数学、编程、指令遵循、工具调用和视觉的15项基准中,三值版保留全精度基线95%的表现,1-bit版保留90%;1-bit版在RTX 5090上最高达163 token/s,在M5 Max上最高达87 token/s。
看英文原文 →OpenAI就欧盟拒绝注册“OPENAI”商标提出的诉讼败诉。欧盟普通法院于2026年7月15日裁定,对于部分软件和信息技术商品及服务,该词仅具描述性,缺乏获得商标保护所需的显著性;判决维持欧盟知识产权局此前对软件、云计算服务等类别作出的部分驳回决定。
欧盟知识产权局认为,相关公众会将“open”理解为可自由访问,并把它与代表人工智能的“AI”组合后,理解为基于开放访问人工智能的产品。OpenAI主张“open”含义多样,“OPENAI”属于没有固定含义的自创词,并援引英国、新加坡等30多个国家的注册;法院认为该英文组合并不反常,其他司法辖区的注册对欧盟商标法没有约束力。判决仍可上诉至欧洲法院。
看英文原文 →佛罗里达州退休人士 Sharon Brightwell 接到疑似女儿 April 哭诉车祸的电话,随后一名自称律师的男子要求支付1.5万美元现金保释金。她取款并交给“法院”相关快递员后才联系到正在上班的女儿,确认哭声由一小段音频合成。现代语音克隆系统仅需约3秒录音即可仿制声音,素材可能来自语音信箱、播客或社交平台视频。
FBI 互联网犯罪投诉中心2026年4月首次把 AI 辅助诈骗单列,上一年收到逾2.2万宗相关投诉,调整后损失超过8.93亿美元,其中60岁及以上受害者损失3.52亿美元。美国网络犯罪损失同比增26%至209亿美元,老年人占77亿美元。INTERPOL 估计2025年全球金融诈骗损失达4420亿美元,并称 AI 增强型诈骗的获利约为传统诈骗的4.5倍。
看英文原文 →一篇7月14日发布的文章提出,大语言模型虽能从自然语言快速生成大量代码,但大型系统的约束、取舍和边缘情况无法在前期规格中一次确定,需要在实现、审查与修订之间迭代。LLM 可先参与梳理领域设计及词汇,待领域模型形成后,再作为自然语言入口,把需求转换为受约束的领域特定语言(DSL)。
文章以 Tickloom、Mermaid、SQL 和 Kubernetes YAML 等为例说明,DSL 限定了同一意图的表达方式,少量上下文示例即可帮助模型生成符合语法的结果。对自主代理而言,解析器、JSON Schema、类型检查器或编译器还能提供确定性验证;代理可提交候选结果,根据领域层面的报错自行修正。文章主张将 DSL 作为软件系统的关键事实来源。
看英文原文 →High Bandwidth Flash(HBF)把 HBM 的芯片堆叠与先进3D封装方式用于 NAND 闪存,目标是提高容量和读取带宽。闪存写入较慢,不适合需要持续读写海量权重的 AI 训练;推理阶段的模型权重基本只读,因此可把静态权重或预计算 KV cache 放入 HBF,并让 HBM 充当高速暂存空间。
单颗最新闪存接口带宽最高4.8 GB/s,而 DDR5 每条 DIMM 最高70.4 GB/s,HBM4E 每堆栈可达3.6 TB/s。Sandisk 预计第一代 HBF 最多堆叠16颗 NAND,容量最高512 GB、读取带宽最高1.6 TB/s,后续两代规划为2 TB/s和3.2 TB/s。Sandisk 与 SK Hynix 已于2026年2月25日在 Open Compute Project 下启动 HBF 标准化合作。
看英文原文 →Coasty 发布面向计算机操作代理的 API,可让用户给定目标和托管机器,由代理自主执行任务并验证结果;复杂自动化可组合为包含分支、循环、审批和共享输出的工作流。团队也可使用较底层的 session、predict、grounding 和 parse 接口,自行控制截图循环、单步预测、坐标定位及结构化动作。
API 通过 HTTPS 调用,创建任务使用 POST /v1/runs,必填 machine_id 与 task;任务会从 queued 状态运行至 succeeded、failed、cancelled 或 timed_out,并可通过轮询、事件流或签名 webhook 跟踪。默认计算机操作版本为 v5,也支持 v1、v3和v4。任务按完成步骤计费,每步0.05美元,旧版 v1 每步0.08美元;测试密钥连接模拟虚拟机且不收费。
看英文原文 →从 39 条资讯中筛选
今日全部信源这一期是从下面这些一手英文信源里,筛掉噪音后留下的。