阅读研究雷达投资体系
登录 / 注册
登录 / 注册
阅读研究雷达投资体系
历史阅读归档 →

阅读

2026-10-0656 条

多智能体通信链路存安全隐患

专题 · 多智能体通信越狱实质变化
2026-10-01 12:00

多智能体系统的潜在通信链路可能成为绕过安全对齐的关键弱点。

传统观点认为,只要底层大模型经过严格的安全对齐,由其组成的多智能体系统就是安全的。但最新预印本研究发现,用于在内部表示空间交换信息的轻量级可训练链路,即使经过良性训练,也会增加有害合规性。

研究人员开发了一种强化学习攻击方法,在不更新底层模型的情况下,仅针对通信链路进行优化。在三个通信拓扑和四个安全基准测试中,该攻击将平均有害合规分数从27.9提升至76.9,同时保持了较高的任务准确率。

这一结果由Muhammad Huzaifa等人提出,目前尚未见独立复现。它表明,未来的安全对齐必须将多智能体系统视为一个整体,包括其内部的通信机制。

信息源:arxiv.org

研究

谷歌文档云盘原生支持Markdown

快讯
2026-10-06 17:04

谷歌于10月5日起向Google Docs和Drive推送Markdown原生支持。

此前用户需转换格式或依赖插件,现在可直接打开、渲染并实时协作编辑.md文件,包括链接和表格。

谷歌称此举旨在让AI智能体(如Gemini Notebook)更顺畅地参与文档协作,员工Chandu Thota指出Markdown已成为人机通用语言。

部分用户可能需等待最多15天才能看到更新。

信息源:ithome.com

研究

文生图擦除技术存后门漏洞

专题 · 擦除规避后门漏洞实质变化
2026-10-06 12:00

文生图模型的安全擦除机制存在严重盲区:植入特定后门的模型在经历概念擦除后,仍能高概率生成被禁止的内容。

此前业界认为通过微调切断有害概念关联即可保障安全,但TU Darmstadt团队提出的“擦除规避后门”(EEB)显示,攻击者可将触发器与目标概念绑定,使恶意链接在后续擦除中存活。

在针对六种最先进擦除方法的测试中,EEB对名人身份擦除的成功率达82%,对物体擦除达94%,并使露骨内容曝光量放大16倍。该结果基于预印本自测,尚待独立复现。

信息源:arxiv.org

研究

无训练提升dLLM推理16%

实质变化
2026-10-06 12:00

扩散大语言模型(dLLM)可在推理阶段通过新框架RFG实现自我改进,性能提升最高达16.1%。

此前提升dLLM能力通常依赖昂贵的后训练、额外数据或奖励模型。RFG提出一种免训练方法,直接从模型检查点中提取引导信号,解决了部分掩码中间状态缺乏明确指导的问题。

该研究由斯坦福大学团队完成,理论证明可通过策略与参考模型的对数似然比参数化奖励信号。实验显示,尽管完全无需训练,其增益可媲美甚至超过资源密集的强化学习技术。

目前为预印本结果,尚待社区独立复现验证。

信息源:arxiv.org

研究

代码智能体评估现“幸运通过”陷阱

实质变化
2026-10-06 12:00

当前主流的软件工程(SWE)智能体评估仅看最终补丁是否通过测试,这一标准被证实存在盲区。

AgentLens团队分析2,614条OpenHands轨迹发现,在通过测试的案例中,有10.7%属于“幸运通过”。这些轨迹包含回归循环、盲目重试或缺少验证等混乱行为,虽结果正确但过程不可靠。

若改用过程质量评分而非单纯通过率,部分模型的排名可移动多达5个位置。该研究指出,仅凭二元信号无法区分严谨解决方案与试错运气,建议引入过程级评估框架。

信息源:arxiv.org

研究

索尼要求下架26万首AI假歌

专题 · 索尼AI假歌下架实质变化
2026-10-06 15:19

据《金融时报》10月5日报道,索尼音乐娱乐公司(Sony Music Entertainment)已要求各大流媒体平台在9月底前删除超过26万首冒充其旗下艺人的AI生成曲目。

这一数量几乎是3月底记录的13.5万首的两倍。被冒充的艺人包括阿黛尔、布兰妮·斯皮尔斯及迈克尔·杰克逊等。索尼音乐全球数字业务总裁丹尼斯·库克(Dennis Kooker)指出,欺诈性播放量可能占平台总曲目的10%,行业高管估计此类流媒体欺诈每年造成高达22亿美元的损失。

法国平台Deezer此前披露,其日均上传9万首AI歌曲,其中85%的完全AI生成歌曲播放量存在欺诈行为。该数据为厂商自报,未经独立审计验证。

信息源:ithome.com

研究

MemCon:动态记忆管理提效

专题 · MemCon记忆框架快讯
2026-10-06 12:00

MemCon框架将LLM智能体的记忆操作建模为马尔可夫决策过程,通过在线学习策略动态决定何时、检索多少记忆。

现有智能体多依赖固定的启发式规则访问外部记忆,这在任务早期或长期运行中往往效率低下。MemCon采用轻量级上下文老虎机算法,无需预训练或额外LLM调用即可收敛。

作者在6个基准测试、3种智能体框架和3种LLM骨干网络上的实验表明,该方法相比多种记忆基线,任务成功率最高提升15.2个百分点,同时Token消耗减少5%至20%。

该结果为预印本自报数据(arXiv:2607.13591v2),尚未见独立第三方复现验证。

信息源:arxiv.org

研究

开源模型可低成本评判数学证明

专题 · GPT-OSS数学评分快讯
2026-10-06 12:00

开源模型GPT-OSS-120B和DeepSeek-V4-Flash在数学证明自动评分任务中,表现与Claude Opus 4.7等前沿模型统计上无显著差异,但推理成本低4至100倍。

传统上评估AI数学推理能力依赖昂贵的前沿大模型作为裁判。该研究在IMO-GradingBench基准测试中发现,使用三个廉价开源模型进行共识投票(如全票通过或多数决)可作为有效的替代方案。

实验显示,全票通过规则具有最高精确度(0.855),而多数决规则具有最高召回率(0.912)。该结论在独立数据集ProofBench上也得到了复现。

此结果为单篇预印本论文(arXiv:2608.00004v2)的作者自测数据,尚未见第三方独立复现报告。

信息源:arxiv.org

研究

滑窗注意力优于线性注意力

实质变化
2026-10-06 12:00

滑窗注意力(SWA)配合注意力汇聚点,在长上下文推理任务中的表现优于大多数改造后的线性注意力模型。

该研究对比了两种降低大语言模型内存消耗的方法:压缩KV缓存(如SWA)和将模型改造为使用固定大小状态的线性注意力。结果显示,在Needle-in-a-Haystack和BABILong等长文本基准测试中,SWA的性能是线性注意力的2到10倍。

SWA不需要额外的训练,运行速度快且内存占用低。作者指出,当训练预算有限时,切换到SWA是比改造线性注意力更有效的降低推理成本的方式。

此为arXiv预印本(v2版于2026年10月4日更新),结论尚未经过独立复现验证。

信息源:arxiv.org

研究

高通否认向华为单向付费

专题 · 华为高通专利协议实质变化
2026-10-06 14:39

高通否认在华为专利协议中为净支付方。

10月5日华为宣布与高通达成多年期专利交叉许可及收购部分美国专利。因未披露金额,市场出现“高通单向付费”及涉及“逻辑折叠芯片”的猜测。

10月6日高通对《每日经济新闻》回应称,上述报道不准确,协议与逻辑折叠芯片技术无关。高通确认已同意收购华为部分非蜂窝通信美国专利。

双方此前存在长期4G/5G专利许可关系,此次协议由交叉许可和资产交易构成,具体条款保密。

信息源:eeo.com.cn

研究

莱比锡数学基准:仅1题未解

实质变化
2026-10-06 12:00

最新一代大语言模型在“莱比锡基准”的100道研究级数学题中,仅未能解决其中1题。

该数据集由49位数学家于2026年4月至5月编制,旨在测试AI处理已知答案的高难度数学问题的能力。此前阶段评估显示,初代尝试有41题完全未解,经过多轮运行和重型思考模型介入后降至2题。

此次更新(第四阶段)引入了具备网络搜索和代码执行能力的下一代模型配置。结果显示,绝大多数题目已被攻克,表明当前前沿模型在特定结构化数学推理任务上已接近人类专家水平。

需注意,这是作者自报结果,且样本量较小(100题),尚未见独立第三方复现验证。

信息源:arxiv.org

研究

BuzzASR提升小语种语音识别精度

快讯
2026-10-06 12:00

BuzzASR模型集在102种语言中的77种上超越了Whisper-large-v3,平均字符错误率(CER)降低了2.8倍以上。

此前主流端到端语音识别模型多为多语言训练,导致在训练数据较少的小语种上表现不佳。虽然单语微调已知有效,但此前仅应用于少数语言。

该研究将单语微调策略规模化至102种语言,并引入分词器替换技术,使压缩率平均提升3.3倍。所有模型、代码及详细结果已开源。

信息源:arxiv.org

研究
下一页阅读 →