ReadingResearch
Sign in中文
Sign in中文
ReadingResearch
Editorial
Sign in to follow

Reading

Editorial articles are currently in Chinese. Source updates are shown in their original language.

2026-09-18119 posts

AWS新版AgentCore运行时:会话结束即释放内存,冷启动号称与镜像大小、并发量无关

AWS于9月18日在官方博客发布新版Amazon Bedrock AgentCore运行时,称会话结束即释放内存、不再按峰值占用保留,冷启动时间也不再随容器镜像大小或智能体并发量变化,保持一致;公告未给出具体冷启动毫秒数或成本对比,实际表现有待用户验证。AWS另称数千个团队已用该运行时运行生产级智能体。原文:AWS官方博客 ↗

NYT等媒体联合提交即决审判简报,引用OpenAI与微软内部言论质疑合理使用抗辩

《纽约时报》联合Daily News集团、Ziff Davis、调查报道中心及The Intercept等媒体公司,向纽约联邦法院提交92页联合即决审判简报,据《金融时报》报道寻求数十亿美元赔偿。该案始于2023年12月NYT的起诉,现已并入多方合并诉讼。简报援引取证阶段披露的内部邮件与宣誓证词:微软应用科学总监Brent Hecht称AI训练是“人类历史上最大规模的劳动盗窃”,OpenAI ChatGPT负责人Nick Turley称产品“基本上是替代性的”,微软CEO纳德拉在宣誓下确认聊天机器人对话已取代对原始来源的访问;微软自有数据显示,Copilot上这三家出版商内容的点击率较传统搜索下降51%至94%。原告另指控OpenAI系统性绕过付费墙、违反NYT语料库许可条款,并在起诉后部署过滤器。微软回应称海克特的言论仅代表员工个人观点、并非法律分析,纳德拉证词亦不涉及版权结论。简报系原告单方主张,法院尚未裁决,但若被采信,将直接影响生成式AI训练数据的版权责任边界与行业许可成本。

来源:The Decoder|NYT等媒体即决审判简报援引OpenAI与微软内部言论 ↗

DeepMind研究所发文:可见思维链是安全优势,OpenAI系统卡已报告可监测性下降

2 sources checked

Google DeepMind新设的DeepMind研究所发布首批文章,研究者Rohin Shah与Anca Dragan主张,模型以自然语言写出中间推理步骤(思维链)是关键安全优势,便于发现欺骗或问题计划,并呼吁业界定期测量思维链的可监测性、保留透明架构、防止模型学会隐藏真实推理。这是实验室立场论述,非独立验证结果。文章引述OpenAI为GPT-6 Astra发布的系统卡,其中已报告思维链可监测性显著下降;这一下滑出自厂商自述文件、经作者转引,并非独立测量。

来源:The Decoder报道 ↗、DeepMind Institute原文 ↗

Meta的Muse上线两周即登陆Mac:可代用户操作原生应用,权限自选、敏感操作先确认

Meta的AI助手Muse于9月17日推出Mac版。据TechCrunch报道(信息出自Meta官方发布,尚无独立性能验证),Muse可在原生应用中与用户的文件、信息、日历、笔记和邮件交互,权限由用户选择开启,敏感操作执行前先请求确认。它本月初才上线移动和网页端并迅速登顶美国App Store榜单,两周内扩展到桌面端,正值Meta与Instinct等消费级AI智能体竞品加速推出新功能的阶段。原文:TechCrunch ↗

AI关联超级PAC向南达科他州参议员选举投入近百万美元,科技献金已超本州捐款人

据WIRED援引联邦选举委员会文件报道,与AI实验室和投资人关联的超级政治行动委员会已向共和党参议员Mike Rounds的南达科他州连任竞选投入近100万美元:约60万美元为外部团体支出,大部分经由获得Andreessen Horowitz资助的Defend American Jobs,这部分依法独立支出、不与竞选团队协调;另约21.5万美元直接来自Anthropic、Google、微软等公司员工及其PAC。Rounds从科技渠道筹得的资金已超过本州捐款人。该州今年刚立法要求数据中心承担更多水电成本;报道将这笔支出解读为AI行业在为下届国会的监管布局提前锁定盟友。原文:WIRED ↗

苹果发表DSAS:引导强度不固定,按输入和层动态计算

2 sources checked

苹果机器学习研究团队9月在TMLR发表论文,提出Dynamically Scaled Activation Steering(DSAS):把“何时引导”与“如何引导”解耦,按输入和层动态计算缩放因子,仅在检测到不良行为时加强干预。作者称该方法与具体引导方法无关、可与现有方法叠加,在毒性缓解与效用保持之间改善Pareto前沿,并已应用于文生图扩散模型,计算开销极小——以上为第一方自报结果,尚无独立验证,代码称将在GitHub提供。原文:Apple ML Research ↗,论文:arXiv ↗

Anthropic首次披露研发自动化指标:“AI主导”占26%,打分的也是Claude

2 sources checked

Anthropic首次公开衡量自身AI研发速度的指标(厂商自评口径,尚无独立验证):按其采用的Epoch AI分级(AL0至AL5),截至2026年8月,处于AL4(“AI主导”)级别的工作占比达26%,而2026年2月还不足1%;Claude在任何任务中都未达到AL5(完全自主)。这套评分同样出自Claude——智能体收集Slack与内部文档证据后,由另一Claude模型定级。Anthropic自己的交叉验证显示,员工对同一工作领域的评级仅约三分之一一致,官方评分模型与人类判断一致率为59%,而一级之差正是“协作”与“主导”的界限。该指标与CEO Amodei呼吁协调放缓前沿开发的立场相呼应;“主导”按人工工时加权,并不代表Claude决定研究方向。

原文:The Decoder ↗|Anthropic原始说明 ↗

三人团队在OpenAI漏洞赏金计划下用Claude Opus 5接管员工账号,OpenAI称已修复

2 sources checked

据TechCrunch援引《华尔街日报》报道,三人安全团队Hacktron AI在OpenAI漏洞赏金计划下,于7月25日利用其社区论坛所用Discourse软件中的libheif图像解码漏洞进入服务器,进而接管多名员工的ChatGPT与Codex账号,其中一人的Codex连接着OpenAI的GitHub组织。团队在其自述博客中称,所用Claude Opus 4.8多次尝试均未能构建可用利用代码,而Opus 5发布数小时内即成功,这一对比属第一方陈述。OpenAI表示相关问题已修复,并向该团队支付6500美元赏金;Discourse已于7月27日发布修复。

原文:TechCrunch ↗|Hacktron博客 ↗

42位英国皇家学会数学院士联名警告AI存在性风险,敦促学会提醒政府与媒体

2 sources checked

据The Decoder 9月18日报道,42位英国皇家学会数学院士联名公开致信学会会长,警告AI存在性风险,敦促学会提醒政府与媒体;署名含菲尔兹奖得主Hairer、Scholze、Werner,均无AI公司背景。信中称前沿模型数月内已解决含一个千禧年难题在内的开放问题(署名者判断,未经独立验证),类似能力变化或出现在网络武器、生物制剂等领域。

来源:The Decoder报道 ↗、公开信Google Docs链接(The Decoder报道所附) ↗

OpenAI推出法律AI产品Astra for Law,自测基准200题通过率54%

2 sources checked

据The Decoder 9月18日报道,OpenAI发布面向法律工作的Astra for Law:GPT-6 Astra搭配检索索引,覆盖逾2.3亿URL的美国判例、成文法与法规,数据来自Free Law Project。基准成绩来自OpenAI自测的Vals AI法律研究基准,属第一方结果:200题通过率54%,对比的纯网页搜索为38.7%。54%意味着近半题目未通过。OpenAI称Harvey、Legora等API客户可基于其构建,律所可获得含零数据保留等隐私控制的Trusted Access,另有26个面向Relativity、Clio等的插件。

参考来源:

  • The Decoder:OpenAI takes aim at the legal market with Astra for Law ↗
  • Free Law Project:CourtListener判例法数据覆盖说明 ↗

Napster与GEMS Education签约,在迪拜开展AI教师数字人概念验证

2 sources checked

据WIRED Middle East 9月16日报道,Napster与学校集团GEMS Education签署战略合作,在迪拜开展教师数字人、游戏化学习与课堂模拟等教育AI概念验证,数字人拟以教师本人的课程资料训练、供学生课后提问。所谓“克隆教师”目前只是签约阶段的概念验证,数据与训练承诺出自Napster高管,未经独立验证;该公司2025年被Infinite Reality以2.07亿美元收购并转向AI,2026年1月关停音乐流媒体。

原始报道:WIRED Middle East:Napster Is Back and It Wants to Digitally Clone Your Teacher(2026年9月16日) ↗、WIRED转载(2026年9月18日) ↗

AWS发布SageMaker HyperPod Inference Gateway,TTFT最多降98%出自自家基准

AWS 9月18日发布SageMaker HyperPod Inference Gateway,一个跑在EKS上的GPU感知推理路由插件:按KV缓存占用、队列深度等实时信号为请求选pod,应用无需改动。官方基准称混合GPU与突发负载下TTFT P95较round-robin最多降98%,数据出自第一方测试、未经独立验证。单集群版已可用,跨集群版未推出。

来源:AWS官方博客(2026-09-18):Introducing Amazon SageMaker HyperPod Inference Gateway ↗