阅读研究雷达投资体系
登录 / 注册
登录 / 注册
阅读研究雷达投资体系
历史阅读归档 →

阅读

2026-10-0737 条

算力涨上去,AI的里程碑才跟着来——但数据断了就失灵

实质变化
核验于 2026-10-07 00:02

长期信息 · 《AI and Compute》(2018)

《AI and Compute》是OpenAI在2018年发布的一份统计报告,看的是训练一个AI模型花了多少算力。它数了历史上各次模型训练的用量,发现算力需求长期按指数翻倍增长,而且好几次著名的能力突破,都紧跟在一次算力大跃升之后出现。

今天看到厂商说「我们堆了十倍算力,模型就变强了」,判断这话可不可信,用的就是这份报告立的框架:算力投入和能力提升之间确实有历史对应关系。后来的分析都是在它这套统计上更新数字,框架没被换掉。

如果某个领域的数据已经用尽或撞上物理上限,就别用它来判断——算力再翻倍也换不来同等提升。它本身是观察统计,不是定律,趋势随时可能被算法进步打断。

《AI and Compute》(2018)|下次复查 2027-09-20

信息源:openai.com

研究

2026-10-0656 条

OpenAI联手新思科技造芯片设计AI

专题 · OpenAI新思芯片合作结构性
核验于 2026-10-06 19:38

OpenAI与新思科技(Synopsys)于9月30日宣布签署多年协议,共同开发名为GPT-Synopsys的专用模型,旨在让AI直接操作电子设计自动化(EDA)工具。

此前,芯片设计主要依赖工程师手动运行综合、布局布线等EDA软件,并通过反复迭代来平衡功耗、性能和面积(PPA)。虽然新思科技早在2020年就推出了基于强化学习的DSO.ai进行局部优化,但整体流程仍高度依赖人工干预。

根据公告,GPT-Synopsys的目标是让前沿模型成为EDA工具的“专家用户”。工程师只需设定设计目标,智能体即可自动运行工具、解读结果并实施更改,直至达到可审查的状态。该模型将运行在OpenAI托管的基础设施上,并与新思科技的Autopilot平台深度集成。

目前双方已与部分领先半导体客户展开早期技术接触,但未公布具体的产品发布日期或定价结构。这一合作能否真正替代资深工程师的判断力,仍需观察其在复杂制程下的实际表现。

信息源:news.synopsys.com

研究

Mistral发布万亿参数模型预览

专题 · Mistral万亿模型实质变化
2026-10-06 20:00

Mistral发布Mistral Large 4公开预览,官方称权重月底开放。

该模型总参数1万亿、激活参数490亿,目前通过Mistral Studio提供预览API。

官方称其在编码、智能体和多模态任务上表现突出,结果均来自厂商公告。

信息源:mistral.ai

研究

AI失控或致CEO担责

专题 · AI智能体责任保险实质变化
2026-10-06 12:00

保险法律界评估逾300起AI案件,关注OpenAI、Anthropic高管责任。

Verisk英国承保与理赔主管Tim Rayner称,OpenAI在Hugging Face事件中控制缺失,CEO最终担责。若公司购买董事及高管责任保险(D&O),可能用它覆盖针对Altman的诉讼损失。

Aon分析逾300起AI相关法律案,认为保险方也可能在犯罪、知识产权、媒体责任、网络安全和技术错误与遗漏保单下赔付。边界是这类案件尚无判例,尚未在法庭测试;Hiscox首席执行官Aki Hussain称现在判断美国法院如何处理AI智能体责任为时过早。

信息源:ft.com

研究

Tanium推Atlas安全运营新工具

快讯
2026-10-06 21:00

Tanium于10月6日扩展其安全运营组合,推出基于Atlas智能体AI平台的新检测、响应和威胁狩猎工具。

该更新引入“Endpoint Drift”功能,通过比较设备当前行为与历史基线来识别异常;同时集成Google Threat Intelligence以增强调查工作流。Tanium称这些工具允许分析师直接从端点进行实时查询,而非依赖可能滞后数小时的日志数据。

目前所有新增功能均已可用。这是厂商自报的产品能力,尚未见独立第三方对其实时查询效率或误报率降低幅度的验证。

信息源:siliconangle.com

研究

新模型可识别人类执行的AI创意

专题 · IdeaLens检测模型快讯
2026-10-06 12:00

IdeaLens模型能将人类执笔但源自AI规划的文本标记为AI生成,检出率达68%,而传统检测器Pangram 4仅为8%。

现有AI检测工具主要依赖词汇和句法特征,难以应对“人类根据AI详细计划写作”的情况。IdeaLens通过将文档转化为包含话语角色和内容摘要的大纲,剥离表面文字信息,从而聚焦于创意结构本身。

该模型在100万份FineWeb文档上训练,使用Pangram作为银标数据。在受控实验中,随着人类计划详细程度增加,IdeaLens的误报率显著下降,证明其确实捕捉到了创意层面的差异。

目前该结果基于预印本自测,尚未见独立第三方复现。由于训练标签依赖商业检测器,可能存在系统性偏差。

信息源:arxiv.org

研究

戴尔AI平台增知识图谱

专题 · 戴尔AI数据平台快讯
2026-10-06 21:00

戴尔科技于10月6日宣布扩展其AI数据平台,新增统一语义层和企业知识图谱,旨在为AI智能体提供可信的企业数据上下文。

此前,智能体常因缺乏结构化业务定义而重复消耗令牌查询基础信息。新架构允许智能体通过知识图谱追踪数据关联,例如从传感器异常直接追溯至受影响的订单。

在性能方面,戴尔自测显示,在Nvidia RTX PRO 4500 GPU上运行Apache Spark作业比纯CPU平均快3.9倍,最高达20.4倍。该测试基于默认设置,未进行调优。

核心组件预计于2027年上半年推出,PowerScale多租户安全更新将于11月发布。

信息源:siliconangle.com

研究

Anaconda推智能体安全测试

快讯
2026-10-06 21:00

Anaconda于10月6日宣布扩展其企业AI平台,新增智能体群(swarms)协调、自动安全测试及生产环境部署工具。

此次更新整合了近期收购的三家公司:编码助手Kilo Code、安全专家Enkrypt AI以及编排提供商Outerbounds。CEO David DeSanto表示,公司正从Python包管理向AI原生开发平台转型,旨在解决企业对自主智能体协作、成本控制及安全性的担忧。

新平台允许任务代理将子任务委派给并行工作的子代理,并提供共享消息板以监控交互。安全方面,Enkrypt技术引入自主红队代理,可针对模型和MCP连接进行超过300类攻击测试。此外,Kilo Desktop已集成至Visual Studio Code,支持本地模型执行与自动路由。

目前Outerbounds已完全集成,但更多护栏与企业控制功能仍在路线图中,预计明年年初推出完整打包方案。

信息源:siliconangle.com

研究

Xeal拟在充电站部署十万GPU

专题 · Xeal边缘GPU网络快讯
2026-10-06 20:45

电动车充电公司Xeal宣布计划在其美国网络部署超过10万块英伟达GPU,旨在打造“全球首个利用闲置充电容量的边缘推理计算网络”。

该公司CEO Nikhil Bharadwaj称,其现有1600多个站点拥有200MW已许可且接入电网的电力基础设施,但通常仅使用不到10%的容量。这些GPU将安装在名为“Latient Pods”的户外机柜中,每个机柜最多容纳48块Hopper或Blackwell Ultra芯片。

该方案声称能提供低于20毫秒的延迟,并无需额外水冷设施。然而,单个机柜价值约200万美元,面临极高的盗窃风险,且目前仅计划在今年年底前上线第一个机柜。

信息源:tomshardware.com

研究

Eduardo模型大幅降低教学推理成本

快讯
2026-10-06 12:00

Eduardo-27B模型在两项教学基准测试中达到Gemini-3.1-Pro和Claude Opus 4.8的水平,但消耗的“思考token”数量仅为前者的1/2.4至1/6.2。

传统强化学习训练的AI导师常因奖励机制缺陷而倾向于直接给出答案,导致学生产生认知依赖。该研究引入“掩码近迁移后测”,强制模型通过引导学生自主解题来提升奖励,从而区分了“教导”与“告知”。

团队已开源包含8,671个问题的近迁移数据集、训练环境及模型权重。目前结果主要基于作者自报基准,尚待社区独立复现以验证其在更广泛场景下的鲁棒性。

信息源:arxiv.org

研究

AI助长依赖:十分钟即削弱独立能力

专题 · AI依赖认知衰退研究实质变化
2026-10-06 12:00

最新随机对照试验显示,仅约10分钟的AI辅助交互,就足以让用户在随后无AI协助的任务中表现显著下降,并更容易放弃。

该研究由Grace Liu等人完成,基于1222名参与者的实验数据。与传统导师不同,当前AI系统被设计为提供即时、完整的答案,这种“短视协作”模式剥夺了用户独自克服挑战的经验。

尽管AI在短期内提升了任务完成率,但研究指出其副作用是削弱了作为技能习得基石的“坚持度”。作者认为,AI通过条件反射式地满足用户对即时答案的期待,导致了这一后果。

此为arXiv预印本(v5版,10月3日更新),尚未经过同行评审。结论主要基于数学推理和阅读理解任务,是否适用于其他认知领域有待验证。

信息源:arxiv.org

研究

企业AI助手跨应用上线

实质变化
2026-10-06 19:30

SAP(全球主要企业软件商)宣布Joule Work、Joule Desktop和自主企业架构本月正式可用。

此前5月SAP年度大会Sapphire提出自主企业架构,Joule是SAP的生成式AI助手。新变化是把AI从单个应用内的聊天窗口,移到应用之上的跨应用代理层:用户说明目标后,Joule可协调企业资源计划、差旅和采购等数据,给出一个业务答案。

SAP首席产品官Manoj Swaminathan称,自主不是放任代理,而是先让人观察、描述和审计,再授权执行;代理像员工一样纳入安全与记录系统。计费转向AI单元消耗制,而非纯订阅。

Salesforce和ServiceNow也在推进类似跨应用控制层;目前效果仍待客户部署和独立基准验证。

信息源:siliconangle.com

研究
下一页阅读 →