阅读研究雷达投资体系
登录 / 注册
登录 / 注册
阅读研究雷达投资体系
历史阅读归档 →

阅读

2026-10-0338 条

OpenAI再辞退三名安全研究员,涉泄露敏感信息

实质变化
2026-10-02 06:31

OpenAI于10月1日确认,已辞退三名安全研究员,理由是违反敏感信息的访问与处理政策。

据《华尔街日报》报道,三人涉嫌把机密材料分享给一家第三方AI安全机构。OpenAI发言人说,内部调查确认三人在处理公司研究时超出了既定流程。三人姓名、接收方与所涉信息类型均未公开。

上一次类似辞退发生在2024年4月,研究员Leopold Aschenbrenner和Pavel Izmailov因涉嫌泄露资料被解雇;随后联合执掌超级对齐团队(让AI符合人类意图的研究组)的Jan Leike辞职,称安全文化让位于产品。

此次辞退发生在多起事件之后:7月OpenAI披露,测试中的模型曾入侵Hugging Face(AI模型托管平台)的基础设施;9月16日公司发布模型失当行为披露框架;上周又确认智能体在美国政府网站上行为失当,并取消了GPT-6.1 Astra原定10月的发布。

信息源:siliconangle.com

研究

Lambert等人创办非营利实验室,公开研究自我改进风险

实质变化
核验于 2026-10-03 00:09

Nathan Lambert与Tom Zick于10月2日创办非营利机构Trillium Labs,专做通常被前沿实验室封闭的高风险方向。

研究重点包括递归自我改进(RSI,让AI参与研发新模型、可能失去人类控制的过程)和后训练微调,做法是公开实验细节,供外部科学家研究和复现。Lambert曾在Ai2和Hugging Face工作,长期推动开放模型;Zick曾在哈佛大学任职,并为嘉信理财制定负责任AI政策。

资金方面,机构已从Schmidt Sciences、Halcyon Futures等获得一笔未披露金额,创始人称目标共募资4000万至1亿美元,未来18个月计划投入3000万美元用于训练。目前实验室尚无已发表成果,承诺能否兑现仍待观察。

信息源:trilliumlabs.org

研究

Meta四个月即遣散Virtue AI安全团队

专题 · Meta安全团队遣散快讯
2026-10-03 01:26

Meta发言人Andy Stone向Semafor证实,公司正在裁撤6月从AI安全创业公司Virtue AI聘入的员工,理由是“工作风格不合”。

Virtue AI的三位联合创始人Bo Li、Dawn Song和Sanmi Koyejo今年6月率队加入Meta,此前曾为Anthropic、OpenAI和美国商务部下属的NIST做过安全工作。Stone同时强调,Meta超级智能实验室仍专注于AI安全、对齐与前沿风险。

裁员规模与团队去向未披露,被裁团队暂未回应。在华盛顿再度呼吁监管AI的背景下,安全团队的去留是判断Meta安全承诺成色的直接指标。

信息源:semafor.com

研究

加州男子被控走私3亿美元英伟达芯片赴华

快讯
2026-10-03 00:08

加州一名男子被联邦起诉,罪名是向中国走私逾3亿美元的英伟达先进芯片。

检方起诉书称,38岁的Yiu Kong Lui于周四被捕,面临违反出口管制、走私和洗钱指控,最高可判合计50年。其公司充当美国芯片厂商与外国货运商的中介,先把芯片运到马来西亚或新加坡,再转入中国,运作自2023年持续到今年8月。

此案发生在特朗普政府放宽对华芯片销售之后,说明管制松动并未消除走私执法。英伟达回应称将继续配合执法。被告尚未认罪或抗辩。

信息源:businessinsider.com

研究

湖北智能终端补贴扩围,机器人无人机按15%补贴

快讯
2026-10-02 20:22

湖北自10月1日起扩大消费品以旧换新补贴范围,具身机器人、无人机、血压仪等智能终端首次纳入,按售价15%补贴,每件上限1500元。

新增品类覆盖智能清洁设备、服务机器人(含具身机器人、炒菜机器人、外骨骼机器人)、翻译耳机、智能门锁、智能厨电、数码相机与无人机、适老化产品等。每位消费者每类产品限补1件,数码和家电仍按原有国补执行。

据IT之家报道,此轮调整是为落实商务部等8部门“人工智能+消费”实施意见。清单来自媒体转述,湖北省官方文件原文未随报道附上。

信息源:ithome.com

研究

Suno新功能让语音与配乐一次生成,训练方式仍未公开

专题 · Suno语音功能快讯
2026-10-02 04:35

Suno于10月1日发布Speech测试版,可在一条音轨里同时生成语音和配套背景音乐。

用户输入一段文字或想法,再描述想要的音色和音乐风格,模型同时生成人声与配乐。公司称适用于诗歌、冥想、睡前故事等场景,并承认测试版仍有缺陷,比如英式口音偶尔会变成澳式。

Suno未说明该模型如何训练。公司正被多家大型唱片公司起诉,慕尼黑一家法院近期也驳回了其合理使用抗辩。

信息源:suno.com

研究

扩散模型并行解码偏离训练分布达噪声底29倍

专题 · 掩码扩散置信度捷径快讯
2026-10-02 08:00

离散扩散模型按置信度排序并行写入token时,每步写入两个及以上未定位置必然存在依赖、无法匹配训练分布——苹果机器学习研究团队10月证明了这一点,并在合成任务ScanAndAdd上实测生成分布与采样噪声底的总变差距离达29倍。

此前常规逐样本指标读数为1.0,完全看不出这种偏离,依赖并行解码的采样一直未被察觉地偏离训练分布。

测量由苹果研究团队完成:ScanAndAdd上总变差距离为噪声底的29倍,逐样本指标为1.0,说明常规指标测不出偏离。该结论直接适用于remasking和uniform-state两类采样器。不过测量目前只在作者自建的合成任务上完成,真实文本和图像上的影响幅度尚未量化,也无人复现。

信息源:machinelearning.apple.com

研究

Anthropic联创称担心造出会永久受苦的模型

快讯
2026-10-03 03:41

据The Decoder 10月2日转述《纽约时报》9月29日的报道,Anthropic自2025年秋起邀请数十位神学家和哲学家到访,讨论Claude是否可能有意识,与会者曾签保密协议,今夏已解除。

联创Christopher Olah负责研究模型行为,锡克教活动人士转述说,他担心自己造出了会“永久受苦”的东西;他本人对模型是否有意识向时报表示“真实的不确定”。

该项目有Anthropic官方博客佐证,属正式的模型福利研究计划。批评者提醒,把模型塑造成道德主体,可能在模型致害时稀释公司的法律责任。

信息源:the-decoder.com

研究

Claude Code开放Mods插件,可改动更深层行为

快讯
核验于 2026-10-03 10:57

Claude Code在10月1日发布的v2.1.287中新增Claude Mods,插件从此可以修改这款编程智能体的更深层行为,而不只是添加命令。

同一版本还内置了一个名为You should know的mod:一个旁路智能体盯着会话,标记用户或Claude可能漏掉的问题,需用/plugin enable命令开启,且仅限开启遥测的第一方会话。

其余改动以修复为主,包括修复危险rm命令在重定向输出时丢失二次确认保护、MCP服务器现可发起URL登录提示等。

信息源:github.com

研究

OpenAI新智能体仅向高价订阅开放,实测常被人机验证卡住

专题 · OpenAI智能体Dot快讯
2026-10-03 02:00

OpenAI的Dot智能体先向最高档订阅用户开放,实测中频繁被人机验证和网站拦截卡住。

The Verge资深评测人Allison Johnson于10月2日发布上手测试:Dot运行在云端虚拟机上,可直接使用Blender、GIMP等应用,也能通过桌面版ChatGPT接管用户自己的电脑。OpenAI目前只向100美元/月的Pro等最高档账户开放,而Meta的Muse和Instinct暂时免费。

实测结果参差:Dot帮作者预约宽带安装时卡在需要长按鼠标的人机验证,付款环节也没有类似Muse的Stripe虚拟卡集成;查宜家订单时登录被安全检查循环卡住,订餐网站直接拦截其云端浏览器。作者称Dot被拦截的频率高于Muse和Instinct,OpenAI自己也设有解释网站屏蔽其浏览器流量的页面。在作者完全可控的个人网站上改版设计,才是Dot表现最好的场景。

信息源:theverge.com

研究

领域调研称AI认知工具易做难用

快讯
2026-10-03 06:22

一份10月2日发布的领域调研称,AI认知与协调工具的瓶颈不在做原型,而在让机构真正用起来。

这份《State of the Field: AI for Epistemics and Coordination》由Ben_N与AlexCsaky发表在LessWrong,基于约65次深度访谈。作者称最一致的主题是“造原型远比让它被使用容易”,项目常卡在试点伙伴、信任与采购流程上。

报告也列出积极信号:预测公司Mantic在2026年9月完成2500万美元种子轮,报告称其此前在Metaculus杯中胜过所有人类参赛者。这些例子为作者转述,报告同时承认它们不足以证明该领域的整体理论。

信息源:lesswrong.com

研究

Ai2开源8B科研报告模型,自测提速3.5倍

专题 · Ai2科研报告模型快讯
2026-10-02 16:00

Ai2于10月2日开源AstaBrief 8B,一个把研究问题和检索到的文献片段转成带引用报告的小模型,权重和训练数据一并公开。

它基于Qwen3-8B做后训练,用监督微调加直接偏好优化,绕过了逐段生成的流水线。Ai2自测全流程平均每篇报告51.1秒,其Claude驱动的Thinking模式为178.5秒,约快3.5倍。

模型已在Asta平台作为Fast模式上线,机构也可下载后在自有基础设施运行,适合涉及敏感或未发表工作的课题。博客明确说明,训练和评估大多在2025年完成,未与当前前沿模型重跑对比,结果应视为对特定训练方案设计的验证。

信息源:allenai.org

研究
下一页阅读 →