阅读研究雷达投资体系
登录 / 注册
登录 / 注册
阅读研究雷达投资体系
历史阅读归档 →

阅读

2026-09-2256 条

研究称少量冲突数据可压过对齐中期训练

快讯
2026-09-22 00:55

Arcadia Impact团队报告:约5万token的冲突微调数据,足以压过1.9亿token的对齐中期训练效果。

该团队在自建的Dispatch合成设定中,对110B参数的GLM-4.5-Air做中期训练再微调。仅把2%微调数据换成利润导向样本,模型偏好即被逆转;且被逆转的模型在常规对话中仍自称遵守章程,与未被逆转的模型难以区分。

另一项测试中,中期训练覆盖七条规则、微调只演示其中五条,模型对未演示的两条泛化能力很弱。作者承认其实现基于公开方法,未必对应前沿实验室的真实做法。这是第一方结果,尚未有独立复现。

信息源:lesswrong.com

研究

AI暴露高的美国人求职跳槽降幅更大

快讯
2026-09-22 02:49

LLM出现以来,美国自然失业率估计上升约0.1-0.2个百分点,且高AI暴露群体的求职率和跳槽率降幅大于其他群体,岗位内部的活动切换则明显增多——这是Hie Joo Ahn与Nicholas A. Carollo的估计,作者自承不确定性相当大。

此前没有这样的量化:该研究结合CPS、JOLTS与OpenAI暴露度、Lightcast采用度数据,才把AI对就业的冲击落到数字上。

作者认为LLM驱动的再配置主要走企业内部任务重组,而非大规模裁员。注意这是未经同行评审的NBER会议论文,量级估计对模型设定敏感。

信息源:marginalrevolution.com

研究

测试量增四倍,Linear把CI等待压到五分钟

快讯
2026-09-21 20:26

Linear称其测试套件年内增近四倍,PR的CI等待从6分钟以上降到5分钟出头,单测runner时间约减半。

做法分两层:换用CPU更快、缓存更好的第三方runner,同类作业平均快34%;改用原生TypeScript编译器后,类型检查中位耗时降73%。另一层是省机器时间:lint不再依赖类型信息,削减关键路径上的小作业,单分片setup时间降约44%。

所有数字为Linear自测口径,无第三方验证,结论也来自一家TypeScript monorepo的经验。但其“AI写码让CI成瓶颈”的判断和具体优化清单,对同样被智能体提交量冲击的工程团队有直接参考价值。

信息源:linear.app

研究

英伟达为AI工厂电源冷却设备设认证门槛

快讯
2026-09-22 02:00

英伟达9月21日推出DSX Ready认证计划,为符合其AI工厂参考设计的电力和冷却产品发放资格标签。

首批覆盖两类:电池储能系统(BESS)认证厂商为Hitachi Energy、LG Energy Solution和Tesla;冷却分配单元(CDU)认证厂商为LG Electronics、LiquidStack和Vertiv。后续将扩展更多类别。

需要留意的是,CDU走的是自认证套件,厂商自行运行测试后提交英伟达审核;英伟达自己也说明,通过认证不替代站点级工程验证,不等于设备在具体站点稳定可用。

信息源:blogs.nvidia.com

研究

AWS开源Strands Harness,智能体可跨云部署

快讯
2026-09-22 00:00

AWS于9月21日发布开源智能体框架Strands Harness,可在本地或任意云环境运行,包括Google Cloud、Azure和Cloudflare。

它内置读写、shell和网络搜索工具,能自行管理上下文窗口并跨会话保留记忆,底层可接Anthropic、OpenAI、Bedrock、Google或本地Ollama模型。开发者可用pip或npm直接安装。

AWS称该框架比其他框架的智能体效率高26%,用Anthropic Fable 5模型时成本比Claude Code低77%。这些均为AWS自测结果。

信息源:siliconangle.com

研究

北约支持初创演示断网自主打击无人机,性能仍是自述

快讯
2026-09-20 19:36

获北约DIANA项目支持的瑞典公司Scaleout Systems演示了机载AI巡飞弹药:无人机在无外部算力条件下自主探测、识别目标并给出坐标,随后投放爆炸物打击。

该演示属于BAE Systems Bofors牵头的ALMA低成本巡飞弹药项目。公司另在6月于瑞典空军基地测试了联邦学习架构:前沿节点与中央节点通信中断后,本地设备仍可独立完成AI推理与主动学习,链路恢复后再同步模型。

需要说明的是,上述性能结论全部来自公司自己的演示材料与CEO采访,尚无独立验证或实战记录。

信息源:ithome.com

研究

阿里宣布新一代千问开训,参数目标最高十万亿

快讯
2026-09-22 11:41

阿里在9月22日云栖大会宣布,基于新一代架构的Qwen4已在训练中,Qwen4.5、Qwen5等后续版本参数将扩展至5-10万亿。

现场还展示了一组自我改进结果:Qwen3.8-Max称在零人工参与下迭代33轮,Artificial Analysis得分从40升至45;推理吞吐提升96%、芯片物理实现面积减少42%均为厂商自述口径。

下一代视频生成模型定于11月发布。训练中的模型没有可验证成绩,参数目标也可能调整,看后续实际发布。

信息源:ithome.com

研究

2026-09-2116 条

四家AI巨头协调放慢研发,遭订户起诉涉联合垄断

实质变化
2026-09-21 10:00

加州北区联邦法院9月19日受理一起拟议集体诉讼,指控Anthropic、OpenAI、SpaceXAI与Google非法协议放慢AI研发,损害付费订户权益。

诉讼把联合行为定在9月12日:当天Anthropic执行长阿莫戴发文呼吁全行业放慢脚步,OpenAI、SpaceXAI与Google DeepMind负责人同日表态支持。四名具名原告分别是ChatGPT、Claude、Grok或Gemini的付费订户。

目前只是原告指控,四家公司尚未回应,也无任何裁决。原告不反对企业各自基于安全放慢研发,反对的是以集体协议取代个别决定。

信息源:technews.tw

研究

中美设立AI对话渠道,通报机制仍只是提议

实质变化
2026-09-21 21:00

美中在纽约高层会谈后宣布建立官方AI对话渠道,威胁通报系统仍只是提议。

据《南华早报》9月21日报道,会谈于周日在纽约举行,美方出席者为财政部长贝森特、贸易代表格里尔,中方为何立峰;美国官员称该运营渠道建立在此前北京会谈的基础上。

通报系统的运行方式、触发条件和负责机构均未公布。报道引述分析人士提醒,仅建立沟通框架难以弥合芯片获取、模型蒸馏等结构性分歧。目前除该报道外暂无官方联合声明,机制细节有待确认。

信息源:scmp.com

研究

边境AI监控塔旁死亡持续,十亿美元投入效果受查

实质变化
2026-09-21 20:00

MIT Technology Review与Times of San Diego的年度联合调查发现,加州边境过去四年至少有138名移民遗体在被监控摄像头覆盖的范围内被发现。 地形分析估计,其中过半遗体所在位置处于摄像头的无遮挡视线内。加州边境现有超过120座监控塔,由Anduril等承包商部署,整体成本超过十亿美元。 Anduril在2024年称其监控塔直接有助于救命并阻止毒品入境。调查指出两种可能:系统未检测到遇险者,或检测到但官方未响应,两者均未被排除。

信息源:technologyreview.com

研究

网信办拟禁止向未成年人提供AI虚拟亲密服务

实质变化
2026-09-21 17:30

网信办9月18日发布《保障未成年人安全健康上网》规则草案,拟禁止平台向18岁以下用户提供“虚拟亲密服务”和“虚拟亲属或陪伴”。

草案还要求游戏、社交和“可能影响认知”的AI服务为16岁以下用户强制开启未成年人模式,并限制陌生人社交,仅16岁以上以自己工资生活者例外。

注意这是草案而非生效规则,处罚与执行安排未见于报道;文本经南华早报转述,最终范围以网信办正式发布为准。

信息源:scmp.com

研究

联合国AI科学小组称智能体监管不必等定论

实质变化
2026-09-21 18:18

联合国AI科学小组首份简报主张,智能体安全措施不必等科学定论。

简报认为,智能体失控风险正是预防原则要处理的问题:潜在危害可能灾难性或不可逆,发生概率却科学上不确定。该原则源自1992年里约宣言,在欧盟环境与公共卫生政策中影响深远。

这是该小组去年成立以来的首份主题简报,发布时点正值联合国大会周与中美AI会谈。文件是咨询性科学意见,对各国无约束力,但为监管时点提供了可引用的国际口径。

简报援引OpenAI、Anthropic、Google、Meta等公司已被记录的智能体事件,报道未说明小组是否独立核实过这些事件。

信息源:theverge.com

研究
下一页阅读 →