阅读研究雷达投资体系
登录 / 注册
登录 / 注册
阅读研究雷达投资体系
历史阅读归档 →

阅读

2026-10-0740 条

美地方媒体起诉微软OpenAI侵权

实质变化
2026-10-07 18:19

埃默里奇报业等美国地方媒体集团正式起诉微软和OpenAI,指控两家公司未经授权抓取数万篇受版权保护的文章用于训练AI模型。

原告称被告绕过付费墙限制,通过侵权内容获利数十亿美元却未向出版商分配任何收益。诉讼依据包括《版权法》和《数字千年版权法》,原告要求损害赔偿,并寻求法院颁布禁令以删除模型中的侵权训练数据。

此案由neowin报道,IT之家编译。作为继大型国家媒体后的新动向,地方报业集团的加入表明AI版权诉讼正在向更广泛的出版界扩散。

信息源:ithome.com

研究

AI自主规划搜索胜过人工算法

专题 · 智能体搜索效率优化实质变化
2026-10-06 12:00

AgentDiscover框架证明,让大语言模型(LLM)自己规划搜索路径,比人类预先设计好的固定算法更高效。

传统AI科研助手通常只负责“提建议”,搜索步骤由人类设计的算法(如蒙特卡洛树搜索)控制。随着模型能力增强,这种人为限制反而成了瓶颈。AgentDiscover将模型提升为“规划者”,它利用上下文作为工作记忆,运行实验并将所有尝试记录在一个数据库中。这个数据库充当长期记忆,允许模型自由调用、组合或替换经典算法的选择规则。

作者自测显示,该框架在成本更低的情况下取得了更高分数。在7个过去的AtCoder启发式编程竞赛模拟中,其生成的程序若参赛可获第一;在11个数学和系统优化任务上,表现匹配或超过使用相同基础模型的其他基线方法。

此为arXiv预印本(2026年10月4日提交),结果由作者团队自行评估,尚未见第三方独立复现。

信息源:arxiv.org

研究

ForkPilot省Token达59%

专题 · 智能体搜索效率优化实质变化
2026-10-06 12:00

ForkPilot框架在长程智能体任务中实现最高59.2%的Token节省,同时保持与当前最优模型相当的性能。

传统智能体在处理多步推理时,回溯搜索常因结果延迟导致归因困难,且执行证据演变使旧估计失效。ForkPilot引入搜索值动态(SVD)概念,采用两阶段自进化策略:先离线学习搜索价值政策,再基于实时观察决策并自我更新。

该研究在6个基准测试和7种主流LLM骨干网络(包括GPT-5.6 Sol和Opus 4.8)上评估,对比9个竞争基线。结果显示其效率提升显著,但数据源自预印本,尚待独立复现验证。

信息源:arxiv.org

研究

MemTrace提升长程编码智能体基准

专题 · MemTrace记忆系统实质变化
2026-10-06 12:00

MemTrace系统在DeepSWE基准上将pass@1指标提升了21.2个百分点。

长程编码智能体常因执行轨迹过长导致上下文溢出,或仓库变更使早期证据失效。MemTrace通过不可变记忆追踪和依赖图,在恢复历史证据前校验其有效性,仅检索当前动作所需信息。

在Codex CLI环境下,该系统还使SWE-EVO解决率提升4.4点,SWE-Milestone分数提升17.8点。此为作者自报结果,尚未见独立复现。

信息源:arxiv.org

研究

小模型视频检索省七成Token

快讯
2026-10-06 12:00

VideoResearchAgent框架使Qwen3.5-4B在Video-BrowseComp基准上达到40.48%准确率,与Gemini-3-Flash-Preview相当。

该结果来自10月4日提交的预印本。传统视频智能体依赖实时网络交互,速度慢且不稳定;固定本地模拟又易导致“检索捷径”,无法泛化到开放网页。

团队提出RDR-GRPO算法,通过随机化候选排名、干扰项和元数据来减少过拟合。相比未训练模型,其累计API Token消耗降低74.9%。

此为作者自报结果,基于特定模拟器环境,尚未见独立第三方在真实开放网页上的复现验证。

信息源:arxiv.org

研究

TaSQ提升1-bit缓存吞吐

快讯
2026-10-05 12:00

TaSQ算法在RTX 6000 Ada GPU上实现14倍批次大小和1.87倍峰值吞吐。

该研究针对长上下文LLM推理中的KV缓存内存瓶颈,提出定制向量量化目标空间的方法。通过查询引导通道加权等技术,它在1-bit极端压缩下保持了推理稳定性。

作者称其SGLang实现相比BF16基线有显著性能增益。目前仅为预印本自报结果,尚未见第三方独立复现验证。

信息源:arxiv.org

研究

电动车企拟部署十万英伟达GPU

快讯
2026-10-06 20:45

电动车充电公司Xeal宣布计划在美国部署10万个Nvidia GPU,构建“世界首个利用闲置充电容量的边缘推理计算网络”。

该公司拥有1600多个充电站和200兆瓦已许可电力设施,声称这些站点通常仅使用不到10%的容量。其开发的Latient Pod每个包含最多48个Hopper或Blackwell Ultra GPU,价值约200万美元,无需水冷且噪音低于65分贝。

CEO Nikhil Bharadwaj称这是最快上线新算力的方式,可避免新建数据中心面临的电网互联难题。但Tom's Hardware指出,路边高价值设备面临严重盗窃风险,此前已有大量充电电缆被盗案例。首台Pod预计今年年底上线。

信息源:tomshardware.com

研究

英六成员工未受AI诈骗培训

快讯
2026-10-07 15:00

英国培训机构QA最新调查显示,过去12个月内,61%的英国员工表示从未接受过关于识别AI驱动网络威胁的培训。

随着AI被用于生成逼真的钓鱼邮件和深度伪造音频,传统的拼写检查等防御手段已失效。调查还发现,22%的组织缺乏应对此类攻击的政策,且年轻员工(18-24岁)对识别AI诈骗的信心反而低于年长群体。

该数据由QA基于1,000人的样本得出,旨在强调企业需建立基础AI素养以弥补安全技能缺口。

信息源:techradar.com

研究

前Ramp工程师获2500万美元融资

快讯
2026-10-07 06:34

AI创意生成平台Melius宣布完成2500万美元总融资,其中2000万美元A轮由CRV领投,500万美元种子轮由General Catalyst领投。

创始团队来自企业支出软件公司Ramp。他们最初开发的是帮助营销人员优化广告支出的工具,但在运行六个月后认为该方向“没有前景”,于是彻底废弃原有代码库,转而构建能直接生成广告素材和活动的AI代理实验室。

公司称在7月走出隐身模式后的两个月内实现了超过100万美元的年化收入。这一数据为厂商自报,未经独立审计。Melius将与Higgsfield、Krea等竞品共同争夺AI营销内容市场。

信息源:techcrunch.com

研究

Surface笔记本曝128G内存

快讯
2026-10-07 11:30

科技媒体 Windows Central 于 10 月 6 日曝光微软 Surface Laptop Ultra 详细规格,该机型最高配备 128GB 统一内存。

搭载 NVIDIA RTX Spark Superchip,集成 Grace CPU 与 Blackwell RTX GPU。20 核版本 AI 算力达 1 PetaFLOP,官方称支持本地运行 1200 亿参数以上模型。

屏幕为 15 英寸 PixelSense Ultra,HDR 峰值亮度 2000 尼特。系统新增统一内存控制功能,允许用户调整 GPU 内存分配量以优化 AI 工作流。

目前售价未知,微软已于今年 6 月展示过该产品原型。

信息源:ithome.com

研究

RAM-Net用稀疏寻址优化线性注意力

专题 · RAM-Net架构实质变化
2026-10-07 12:00

RAM-Net提出一种稀疏地址访问机制,旨在解决线性注意力中共享状态导致的长程细粒度召回退化问题。

传统线性注意力将所有令牌信息叠加在固定大小的循环状态中,产生令牌间干扰。RAM-Net将状态组织为独立槽位数组,通过地址解码器映射每个键或查询到稀疏地址,仅读写少量选定槽位。

作者自报实验显示,该设计在保持竞争性常识推理能力的同时,实现了最低的困惑度,并在细粒度长程检索上优于强基线。关键效率指标是每步状态访问元素数量比所有基线更少,例如比Mamba2少8倍。

此为NeurIPS 2026接收论文的第一方基准结果,尚未见独立复现报告。

信息源:arxiv.org

研究

纳什解码让小模型赢过大模型

专题 · 纳什解码实质变化
2026-10-06 12:00

纳什解码让掩码语言模型在问答任务上超越参数量达18倍的自回归模型。

该预印本将文本修订建模为多人博弈,每个Token位置为玩家,目标是最大化联合概率下的纳什均衡。在CLAPNQ、PubMedQA和CoQA上,作者自测发现掩码模型(可并行预测所有位置)经纳什解码后F1和ROUGE分数高于自回归模型(逐词生成)中18倍大的模型,无需微调,但测试时计算量显著增加。尚无独立复现。

信息源:arxiv.org

研究
下一页阅读 →