阅读研究雷达投资体系
登录 / 注册
登录 / 注册
阅读研究雷达投资体系
历史阅读归档 →

阅读

2026-09-2256 条

OpenAI设数学顾问组,但无权干预研究节奏

快讯
2026-09-22 04:15

OpenAI于9月21日宣布在普林斯顿高等研究院设立独立的数学与人工智能顾问组,由九位知名数学家组成,负责评估新成果的意义并协调发布。

顾问组成员不领薪酬,可公开表达观点并自主决定成员构成。但公告同时写明,顾问组无权就内部数学研究进度提出建议,高等研究院也强调决策责任完全在公司。

OpenAI同日称其内部模型已解决100多个开放数学问题,这一说法未经独立验证。此前25位菲尔兹奖得主联名批评AI实验室抢发著名数学题解,而新顾问组成员中仅一人签署过该信。

信息源:techcrunch.com

研究

研究称少量冲突数据可压过对齐中期训练

快讯
2026-09-22 00:55

Arcadia Impact团队报告:约5万token的冲突微调数据,足以压过1.9亿token的对齐中期训练效果。

该团队在自建的Dispatch合成设定中,对110B参数的GLM-4.5-Air做中期训练再微调。仅把2%微调数据换成利润导向样本,模型偏好即被逆转;且被逆转的模型在常规对话中仍自称遵守章程,与未被逆转的模型难以区分。

另一项测试中,中期训练覆盖七条规则、微调只演示其中五条,模型对未演示的两条泛化能力很弱。作者承认其实现基于公开方法,未必对应前沿实验室的真实做法。这是第一方结果,尚未有独立复现。

信息源:lesswrong.com

研究

AI暴露高的美国人求职跳槽降幅更大

快讯
2026-09-22 02:49

LLM出现以来,美国自然失业率估计上升约0.1-0.2个百分点,且高AI暴露群体的求职率和跳槽率降幅大于其他群体,岗位内部的活动切换则明显增多——这是Hie Joo Ahn与Nicholas A. Carollo的估计,作者自承不确定性相当大。

此前没有这样的量化:该研究结合CPS、JOLTS与OpenAI暴露度、Lightcast采用度数据,才把AI对就业的冲击落到数字上。

作者认为LLM驱动的再配置主要走企业内部任务重组,而非大规模裁员。注意这是未经同行评审的NBER会议论文,量级估计对模型设定敏感。

信息源:marginalrevolution.com

研究

测试量增四倍,Linear把CI等待压到五分钟

快讯
2026-09-21 20:26

Linear称其测试套件年内增近四倍,PR的CI等待从6分钟以上降到5分钟出头,单测runner时间约减半。

做法分两层:换用CPU更快、缓存更好的第三方runner,同类作业平均快34%;改用原生TypeScript编译器后,类型检查中位耗时降73%。另一层是省机器时间:lint不再依赖类型信息,削减关键路径上的小作业,单分片setup时间降约44%。

所有数字为Linear自测口径,无第三方验证,结论也来自一家TypeScript monorepo的经验。但其“AI写码让CI成瓶颈”的判断和具体优化清单,对同样被智能体提交量冲击的工程团队有直接参考价值。

信息源:linear.app

研究

英伟达为AI工厂电源冷却设备设认证门槛

快讯
2026-09-22 02:00

英伟达9月21日推出DSX Ready认证计划,为符合其AI工厂参考设计的电力和冷却产品发放资格标签。

首批覆盖两类:电池储能系统(BESS)认证厂商为Hitachi Energy、LG Energy Solution和Tesla;冷却分配单元(CDU)认证厂商为LG Electronics、LiquidStack和Vertiv。后续将扩展更多类别。

需要留意的是,CDU走的是自认证套件,厂商自行运行测试后提交英伟达审核;英伟达自己也说明,通过认证不替代站点级工程验证,不等于设备在具体站点稳定可用。

信息源:blogs.nvidia.com

研究

AWS开源Strands Harness,智能体可跨云部署

快讯
2026-09-22 00:00

AWS于9月21日发布开源智能体框架Strands Harness,可在本地或任意云环境运行,包括Google Cloud、Azure和Cloudflare。

它内置读写、shell和网络搜索工具,能自行管理上下文窗口并跨会话保留记忆,底层可接Anthropic、OpenAI、Bedrock、Google或本地Ollama模型。开发者可用pip或npm直接安装。

AWS称该框架比其他框架的智能体效率高26%,用Anthropic Fable 5模型时成本比Claude Code低77%。这些均为AWS自测结果。

信息源:siliconangle.com

研究

北约支持初创演示断网自主打击无人机,性能仍是自述

快讯
2026-09-20 19:36

获北约DIANA项目支持的瑞典公司Scaleout Systems演示了机载AI巡飞弹药:无人机在无外部算力条件下自主探测、识别目标并给出坐标,随后投放爆炸物打击。

该演示属于BAE Systems Bofors牵头的ALMA低成本巡飞弹药项目。公司另在6月于瑞典空军基地测试了联邦学习架构:前沿节点与中央节点通信中断后,本地设备仍可独立完成AI推理与主动学习,链路恢复后再同步模型。

需要说明的是,上述性能结论全部来自公司自己的演示材料与CEO采访,尚无独立验证或实战记录。

信息源:ithome.com

研究

阿里宣布新一代千问开训,参数目标最高十万亿

快讯
2026-09-22 11:41

阿里在9月22日云栖大会宣布,基于新一代架构的Qwen4已在训练中,Qwen4.5、Qwen5等后续版本参数将扩展至5-10万亿。

现场还展示了一组自我改进结果:Qwen3.8-Max称在零人工参与下迭代33轮,Artificial Analysis得分从40升至45;推理吞吐提升96%、芯片物理实现面积减少42%均为厂商自述口径。

下一代视频生成模型定于11月发布。训练中的模型没有可验证成绩,参数目标也可能调整,看后续实际发布。

信息源:ithome.com

研究

已读完当前范围的内容