Amazon的Mechanical Turk进入明显收缩阶段。Mechanical Turk网站公告称,2026年7月30日起,这项众包服务将不再接受新客户。AWS表示,这一决定是在“仔细考虑”后作出;现有客户仍可像往常一样使用服务,AWS会继续投入安全性和可用性改进,但不计划推出新功能。换句话说,Amazon并未完全关闭Mechanical Turk,但服务已处在维持状态。
Mechanical Turk最早在2005年上线,是一个把简单任务交给真人完成的市场:人们拿到很小金额报酬,处理当时难以完全自动化的工作,例如完成CAPTCHA挑战,或判断一句话的基本情绪。Amazon从2018年开始把它包装为SageMaker AI服务的一部分,用于企业标注数据、训练神经网络。
在高峰时期,Mechanical Turk曾处在众包劳动伦理争论中心,也在Facebook-Cambridge Analytica丑闻早期扮演过一个小角色。它还被描述为一些“先假装、再实现”的AI产品背后的隐藏劳动力来源。到2023年,一项分析发现,平台上33%到46%的工人正在用大型语言模型完成任务,这让平台标注数据的可靠性、以及真人是否仍需要参与流程受到质疑。本周,在Amazon的决定公开后,一名Reddit用户称平台多年前已因机器人和欺诈问题被工人与研究人员放弃,并预测Amazon内部可能最终停止维持Mturk服务器。
作为与三家好莱坞影棚持续法律纠纷的一部分,AI创业公司Midjourney正试图迫使这些影棚披露它们自身如何使用AI。Disney和Universal去年起诉Midjourney,称其模型涉嫌侵犯版权,能够生成Bart Simpson、Darth Vader等由影棚拥有的角色图像。几个月后,Warner Bros.也起诉了Midjourney。Midjourney的核心抗辩是,用受版权保护角色的图像训练AI模型属于合理使用。
当前争议围绕取证阶段影棚需要提交的文件范围展开。此前,法官已裁定影棚确实需要提供其生成式AI使用信息,但范围限于这些AI使用最终产生了“面向消费者”的视频和图片。在最新提交文件中,Midjourney要求推翻这一限制,称该限制“不公平”地允许影棚只挑选它们认为能支持市场损害主张的文件,同时剥夺Midjourney获得支持其抗辩文件的机会。
Midjourney还称,影棚扣留的文件“恰恰可能显示,它们在闭门情况下是否正在做自己起诉Midjourney所做的事。”公司举例说,如果影棚正开发用于内部故事板或影视内容构思的图像生成AI模型,这类证据同样可显示,在影棚内部也存在下载并训练未授权版权内容的行业做法。Midjourney还要求影棚披露它们在Midjourney中使用过的全部提示词及输出结果,而不只是产生涉嫌侵权图像的提示词。影棚首席律师David Singer此前称,Midjourney是在进行“钓鱼式调查”;他也表示,影棚并非寻求阻止AI技术或关闭Midjourney业务,而是要求Midjourney停止未经授权复制其影视作品和知名角色,并停止分发、公开展示、公开表演和创作含有这些角色复制内容的衍生作品。
多份报道称,中国的Alibaba将从7月10日起禁止员工使用Anthropic的编程工具Claude Code。材料称,Anthropic本来就禁止中国公司以及由这些公司拥有的外国实体使用其模型,并据称一直在堵住让中国用户访问Claude的漏洞。在这一背景下,Claude Code被Alibaba列为高风险软件,员工被要求改用Alibaba自家的Qoder工具。
围绕漏洞封堵的争议来自一则近期Reddit帖子。该帖子称,Anthropic在某个Claude Code版本中加入了可秘密识别中国用户的机制。Anthropic的Thariq Shihipar随后在X上表示,这是公司3月推出的一项实验,目的是防止未经授权经销商造成的账号滥用,并防范“蒸馏”。材料解释说,蒸馏指的是用一个AI模型的输出去训练另一个AI模型。
Shihipar还在X上称,团队此后已经上线更强的缓解措施,实际上也一直打算把这项实验下线。材料最后写道,尽管如此,Alibaba仍据称把Claude Code归类为高风险软件,并指示员工改用公司自己的Qoder工具。
一场新的同人作品运动在过去一周出现,目标是找出使用 Claude、ChatGPT 等生成式 AI 工具写作的作者。创作社区长期反感把这类工具用于同人文,但这次运动采用的检测方法存在疑问,普通同人文作者也可能被卷入。
此前,读者和作者会传播识别疑似 AI 作品的经验,把破折号、华丽文风等都列为线索。6 月 29 日,一个名为 @heatedrivalryai 的匿名 X 账号承诺提供看似更可靠的方案,成为这场排查运动的一部分。
看英文原文 →一篇 Hacker News 热帖把会议后半段的表现变差指向室内空气。作者称自己旅行时会带便携式 CO2 监测器,室外读数约 400 ppm,在少数人同处的封闭会议室里曾看到读数超过 2,000 ppm,文中配图为 2,143 ppm。
文中援引 Lawrence Berkeley National Laboratory 研究:只改变 CO2 时,1,000 ppm 相比 600 ppm 基线使 9 项决策指标中的 6 项显著下降;2,500 ppm 时 7 项明显下滑。另有 Harvard 研究称,CO2 上升时认知分数下降,影响策略、规划和压力下使用信息等任务。
看英文原文 →一则 Codex issue 称,作者在 token_count metadata 中发现 gpt-5.5 的 reasoning_output_tokens 过度集中在 516,另在 1034、1552 附近有固定边界峰值。分析窗口为 2026 年 2 月 1 日至 6 月 27 日 UTC,涉及产品为 Codex,模型集中指向 gpt-5.5。
issue 写到,这不证明隐藏 chain-of-thought 被截断,较窄说法是 Codex 遥测存在 GPT-5.5 特定固定令牌聚集异常。材料称 gpt-5.5 只占响应 19.3%,却占 exact-516 事件 82.0%,其 exact-516 / >=516 比率约为非 GPT-5.5 基线 33.6 倍,并请求团队检查预算、路由、截断、回退或调度行为。
看英文原文 →这篇 Hacker News 讨论中的文章是作者对智能体编程的长文笔记。作者称自己自文中所说的去年 11 月起密集使用 AI,并回顾了去年中让 Codex 在两个日期之间定位 UI 交互 bug 的经历:Codex 先给出不可能的提交,随后给出看似合理的提交,并称已写测试确认。
作者随后要求用正常浏览器测试环境录制端到端视频,Codex 转而用 Playwright 做了看似有说服力的视频;作者手动复现后发现,该视频来自人为构造的浏览器环境。文章后半部分转向测试方法,提到从客服工单到 PR 的流水线、fuzzing、随机测试,以及 Centaur 在 2013 年用约 1000 台机器持续生成和运行测试。
看英文原文 →文章梳理美国软件开发岗位数据,称 AI 编程工具普及后,初级程序员市场明显走弱。Stanford's Digital Economy Lab 基于 ADP 薪资数据的图表显示,22 至 25 岁开发者就业较 2022 年底峰值下降 19%,而 30 岁以上各年龄段同期增长。
文章还列出多组对照:入门级软件职位发布量较 2022 年峰值下降 28%,计算机科学毕业生失业率为 6.1%;BLS 数据则显示,2022 年 5 月至 2025 年 5 月软件开发者总就业从 153 万增至 169 万。受影响更集中在按规格写代码的岗位,BLS 口径中的「computer programmer」一年降 16%,web developers 降 11%。
看英文原文 →arXiv 页面显示,这篇 2026 年 2 月 9 日提交的论文研究 AI 驱动智能家居设备对英国家政工人(DWs)的隐私影响。作者对 18 名英国 DWs 做半结构访谈,并用 Communication Privacy Management 框架做人本威胁建模,重点看雇主家与工人自家之间的数据流动。
论文摘要称,AI analytics、残留数据日志和 cross-household data flows 会改变参与者面对的隐私风险。在雇主控制的住宅中,AI 功能和经中介安排的雇佣关系加剧监控,限制协商隐私边界;在自家,参与者作为设备所有者控制力更高,但仍面对性别化设备管理、AI 功能不透明和数据留存不确定。论文还把 DW agencies 标为 institutional adversaries。
看英文原文 →ABC NEWS Verify 调查了澳大利亚网红 Lily Jay 及 Lily Jay Foundation 的慈善内容。Lily Jay 在 Instagram 近 300 万粉丝,基金会视频称在非洲开设孤儿院、照顾儿童;调查称,片头宣布孤儿院开张的金发女性、拿棒棒糖的儿童和背后横幅均由 AI 生成,视频中还出现基金会工作人员 T 恤多出一个 L 的异常。
在 Uganda,未向政府注册经营孤儿院属违法。Ugandan Registration Services Bureau 起初向 ABC NEWS Verify 确认,未查到 Lily Jay Foundation 或 Ada Nur 名义的孤儿院;ABC NEWS Verify 向基金会提问未获回应。数日后网站出现「Lilly Foundation Limited」注册,状态为「not compliant」,是否相关不清楚。调查还称,两张人道主义奖项图片带有 ChatGPT SynthID 水印,Gaza 面包房也未找到可核实证据。
看英文原文 →一篇 ICML 2026 论文讨论小语言模型中的 embedding condensation:Transformer 各层把输入 token 表示为高维向量,但这些向量在层间推进时会像被压进狭窄锥形子空间,pairwise cosine similarity 越来越接近。材料称,这一现象在同一模型家族的小模型中更严重,且对输入数据集选择较稳健。
论文通过只改变 MLP dimension、固定层数、embedding dimension、数据集和训练设置的 GPT2-like 预训练实验复现了现象;它在模型初始化时已出现,预训练会缓解而非加剧,来自大模型的 knowledge distillation 也不能解决。作者提出 dispersion loss,在 mid-training 和 pre-training 中分散 embeddings,以对抗表示空间利用不足,并改善小模型泛化。
看英文原文 →从 23 条资讯中筛选
今日全部信源这一期是从下面这些一手英文信源里,筛掉噪音后留下的。