NVIDIA披露DSX电力调度测试:16个节点的功率预算跑出19个节点
NVIDIA 9月15日在AI基础设施更新中披露,Lambda用DSX Max-Q做电力调度,在原本容纳16个节点的功率预算内运行19个节点,推理吞吐量提高24%——数字出自厂商披露的特定测试,不能直接外推到其他模型、硬件或数据中心。功率预算没变,这24%是产出增益,不等于实际电费同比下降。
信息源:blogs.nvidia.com
NVIDIA 9月15日在AI基础设施更新中披露,Lambda用DSX Max-Q做电力调度,在原本容纳16个节点的功率预算内运行19个节点,推理吞吐量提高24%——数字出自厂商披露的特定测试,不能直接外推到其他模型、硬件或数据中心。功率预算没变,这24%是产出增益,不等于实际电费同比下降。
信息源:blogs.nvidia.com
Google Research 9月15日介绍Retrieve-for-Train(RFT):训练阶段用强化学习生成多样化检索,再把检索行为迁移到5390万参数的扩散式向量模型,减少运行时逐词生成查询的等待。加速结果由作者自报,来自开放式摘要检索和弱监督组合检索两个任务;这仍是研究方案,不是Google搜索已部署的功能,特定任务成绩也不能当作通用检索质量的保证。
信息源:research.google
IBM研究团队9月15日在Hugging Face博客介绍ALTK-Evolve的一致性分析工具(公司自述)。其AppWorld实验中,GPT-4.1智能体的平均成功率为77.4%,但同一任务连续五次都成功的比例只有53%。工具从执行轨迹中识别易变的决策,生成可复用指引。结果出自特定模型和基准,尚不能证明生产环境同样可靠;它给出的直接启示是,平均成功率与重复执行的稳定性应分开测量。
信息源:huggingface.co
苹果9月14日发布iOS 27正式版。官网已列出英语版Siri AI:用户可以连续交谈、从邮件和照片中查找个人信息,并在信息、提醒事项等应用中执行操作;独立Siri应用集中保存对话,用户可在不同设备间继续交流。
这次变化把助手从单次问答扩展到个人资料检索和应用操作,但更新系统不等于能用上Siri AI:苹果标注了语言、设备及地区限制,部分功能可能有使用额度。
欧盟是例外。苹果此前宣布,Siri AI不会随iOS 27和iPadOS 27在当地首发开放,也未给出这两个平台的后续时间表。
微软AI于9月14日公开MAI模型行为准则初稿,启动为期六周的公众咨询(公司提案,咨询与修订均由微软主导)。文件说明该准则尚未用于训练模型;团队计划年底发布修订版,用来指导2027年及以后的模型开发。
草案把人类控制和安全放在优先位置,要求AI保持可监督、可控制,避免被设计成拥有感情或自身动机的人格主体;同时列出安全约束、处理不确定性的操作指引,以及可由运营方调整的默认行为。
这份文本让外界能逐项核对微软打算如何约束自研模型,但公开训练目标并不证明模型已经遵守;兑现情况要看年底修订后的具体条款、实际训练与评估结果,以及部署中出现偏差时如何处理。
资料核对:微软发布与公众咨询说明 ↗ · MAI行为准则全文 ↗
信息源:microsoft.ai
Superhuman于9月14日公告,已收购AI会议记录工具Fathom,计划把会议摘要、讨论与待办事项接入旗下邮件、日历、文档和数据库产品。公告中的Superhuman是原Grammarly更名后的生产力平台,不单指那款同名邮件应用。
按公司给出的用法,Go助手读取会议记录后起草项目状态更新,交由负责人审阅确认,会议由此成为后续工作的上下文,而非一份需要人工搬运的摘要。
公告未披露交易金额。收购完成不等于整合完成:跨应用工作流目前以计划和示例呈现,不能据此认定Fathom用户已获得这些能力;整合后的访问权限、人工确认方式和上线安排,还需产品说明补充。
Buildots于9月14日宣布获得1.3亿美元融资,由O.G. Venture Partners领投,累计融资额达2.97亿美元;以上数字来自公司公告,本轮估值未披露。公司计划扩大北美、欧洲、中东及非洲市场的部署,并把产品覆盖延伸到投标至交付的完整施工周期。
其产品把工地影像、工程模型和进度安排放在一起,帮承包商判断实际施工与计划之间的差距;数据中心建设是应用场景之一,较早识别延误,可以为调整人员、工序和资源留出时间。这轮融资让扩张有了资本,但公告未提供能独立比较的项目成本节约结果,效率改善目前无法量化,最终仍要看项目能否按时交付。
信息源:prnewswire.com
NVIDIA 9月14日宣布Perplexity Portable Computer登陆Windows RTX电脑,需GeForce RTX或RTX PRO显卡至少24GB显存,本地任务不消耗Computer积分。复杂任务仍可转交云端,官方称数据离开设备前会请求用户许可;别把“登陆Windows”读成随处可跑或全程离线,它是本地与云端配合的助手。
信息源:blogs.nvidia.com
模型供应商OpenAI于9月14日发布Fyxer客户案例,文中流程均为Fyxer自述:其邮件助手把工作分配给30至50个专门模型,先判断邮件是否需要回复,再识别意图、检索相关记忆并生成草稿;用户对草稿的修改会转成偏好训练数据,新版本还要经过A/B测试。
客户经验尚不等于独立效果验证,案例也未证明系统可以无人审核地发送邮件;能核对的是任务拆分和反馈流程。
信息源:openai.com
曼哈顿地区检察官办公室9月14日宣布,依法院命令查扣12个网站域名。检方称,这些网站利用AI制作并传播非自愿亲密影像,受影响者约1200人。查扣针对域名及传播渠道;相关人员仍列为调查对象,查扣不等于定罪,也不能据此认定影像已从所有平台清除。
资料核对:曼哈顿地区检察官办公室公告 ↗
信息源:manhattanda.org
Latent Space 9月14日发布Richard Socher访谈(录制于7月)。这是创业者对技术路径的自述:他把Recursive的方向描述为用AI改进AI研究本身,同时指出GPU供给、物理建设和行业采用速度会限制能力提升转化为现实变化的速度。访谈中的早期优化成绩属于本人陈述,不能当作9月14日新完成的实验,也未证明可无限自我改进。资料核对:Latent Space访谈及文字记录 ↗
信息源:latent.space
Amodei在9月的文章中提出放慢前沿AI能力提升,并承诺为Anthropic引入外部驻场评估团队。9月13日,The Decoder报道,Altman、Musk与Hassabis均对实验室内部引入独立监督表达支持,但支持范围并不相同。
按提案,评估员将持续接触内部工具和安全实践,核对公司是否履行承诺并报告事件,比只读公司自行选择发布的模型报告多一层内部核验。这项安排的效力取决于评估员能否取得实际权限、能否独立披露不利发现。
公开表态尚未形成共同执行的行业协议:Anthropic的单方承诺、企业之间协调放缓、国际协调是不同阶段,几位人物支持独立监督,并不意味着他们已共同暂停模型训练。
资料核对:Amodei原文 ↗ · The Decoder对各方回应的报道 ↗
信息源:darioamodei.com