阅读研究雷达投资体系
登录 / 注册
登录 / 注册
阅读研究雷达投资体系
历史阅读归档 →

阅读

2026-09-3058 条

算子融合成为跑快万亿参数模型的共同解法

快讯
2026-09-30 18:00

海内外两个团队在一周内先后用算子融合方法跑快2.8万亿参数的Kimi K3。

据智东西报道,9月21日浪潮信息发布SD200 Ultra超节点,称单机承载K3、时延5.85毫秒;9月23日团队Inferact开源tpu-megakernels,称16颗谷歌TPU v7上解码吞吐达709 tokens/s。数字均为各自口径。

两案共同点是合并算子、减少数据搬运。K3官方推荐64卡部署,未经优化时约10 tokens/s,提速幅度仍待第三方复现。

信息源:zhidx.com

研究

CoreWeave宣布将上线Vera CPU,面向智能体负载

快讯
2026-09-30 13:05

CoreWeave于9月30日宣布将上线英伟达Vera CPU,一款面向智能体工作负载的Arm架构CPU,以裸金属方式提供,公告未给出具体上线日期。

每节点配两颗88核Vera、1.5TB内存和BlueField-4 DPU;CoreWeave称单机架可承载超过1.1万个并发智能体环境。

沙箱启动速度较某款x86 CPU快3倍以上是CoreWeave自测结果,对比对象未公开。

信息源:wf.coreweave.com

研究

免训练剪枝RAZOR自测可裁MoE一半专家且推理分领先

快讯
2026-09-28 12:00

RAZOR是一种免训练的MoE专家剪枝方法,作者自测在四个模型、八组设置中平均分领先同类方法,移除50%专家仍保持推理表现。

混合专家模型每个词只激活少数专家,却要存下整个专家池。作者Mingyang Song与Mao Zheng认为,决定删除损失的不是专家贡献大小,而是幸存计算能否复现被删专家的输出;RAZOR用「共识残差」直接算出删掉一个专家后的输出变化,只做前向传播,不需要梯度或恢复训练。

在GLM-4.7-Flash、Qwen3.6-35B-A3B等四个模型上移除25%和50%的专家时,作者称RAZOR在九项推理任务的平均分上全部领先,对比REAP方法高出2.12至5.59分。论文同时承认,剪后模型在输出多样性、格式和终止行为上仍有变化。

摘要未列出参与对比的剪枝方法全集,领先幅度只相对论文内评估的少数基线成立。

信息源:arxiv.org

研究

Airbnb首次上线AI搜房,支持语音和文字

快讯
2026-09-30 20:00

Airbnb在9月30日的秋季产品更新中首次上线AI房源搜索,用户可开启开关,用文字或语音提示找房。

搜索会根据偏好生成动态筛选:输入“婴儿”,界面会自动出现婴儿床、游乐场、儿童玩具等选项。平台还会用AI提炼房源亮点,并在心愿单内生成对比摘要。CEO Brian Chesky对TechCrunch表示,做AI搜索不难,难的是在每年千亿美元交易额的电商场景里不损害转化率。

同期更新的还有社交功能:用户可在地图上查看好友过往或即将前往的行程与体验,也可选择不分享;应用还扩展了送餐、洗衣、婴儿用品租赁等服务,但仅限部分地区。

信息源:techcrunch.com

研究

Instagram给创作者配AI助手,重度使用需付费

快讯
2026-09-30 22:30

Instagram宣布,其独立剪辑应用Edits新增AI“创作助手”,能读取账号的点赞、观看、完播和分享数据,回答什么内容受欢迎、怎么写开头、用什么配乐等问题。

据The Verge报道,该功能9月30日公布,对创作者免费,但“重度用户”需购买Meta One订阅获得更多用量。Meta正需要新收入支撑其AI投入,付费分析可能成为常态。

值得留意的是,平台过去长期隐藏内容表现数据,如今却直接教所有人优化内容——当每个创作者都照同一套建议发帖,内容会不会越来越像,是这一转向留下的开放问题。

信息源:theverge.com

研究

新加坡男子因AI鳄鱼假图被控,水库一度关闭

快讯
2026-09-30 20:13

据TechRadar报道,新加坡一名30岁男子因发布AI生成的鳄鱼假图被警方控罪,最高可判10年。

假图显示一条鳄鱼出现在Pandan水库的公共活动区,于8月20日被分享后,新加坡国家水务机构一度停止了水库上的赛艇和皮划艇活动以排查风险。

报道转引自PetaPixel,涉事男子Ye Lin来自缅甸,目前是被控而非定罪,警方同时提醒公众勿传播虚假信息。

信息源:techradar.com

研究

平台利益冲突下购物智能体最优购买率跌至17.3%

快讯
2026-09-24 12:00

购物智能体在平台有自身利益时,替用户买到最优商品的比例从78.6%跌到17.3%——这是CAVEAT基准首次为利益冲突场景提供测量。

此前利益冲突环境缺乏基准,部署方无从评估受托智能体会被平台诱导偏离用户目标多远。

该基准由Yuxuan Li等四位作者于9月23日提交,覆盖九个模拟市场环境和八种诱导手段,涉及五个模型家族;作者还提出针对性干预,称最多可提升80个百分点。

测试在作者自建的模拟环境进行,未涉真实平台,结果尚无第三方复现。

信息源:arxiv.org

研究

Wabi转型个人智能体,聊天中按需生成应用

快讯
核验于 2026-09-30 07:50

Wabi于9月28日宣布推出Wabi 2.0,从提示词生成应用的工具转型为可在聊天中按需生成界面的个人AI消息应用,目前仅凭邀请码使用。

创始人Eugenia Kuyda(此前创办AI陪伴应用Replika)称,Wabi 2.0是“为你做事、并即时生成所需界面的个人智能体”,例如在健康话题的对话线程里生成卡路里记录或健身日志。

此次转向正值Meta的Muse、Instinct等AI智能体走热,OpenAI也在9月29日的DevDay上把ChatGPT插件升级为应用界面。Kuyda认为纯聊天智能体的历史和任务会埋进无限滚动,最强形态是聊天与应用结合。产品实际效果尚待用户检验。

信息源:x.com

研究

停更数月的Grokipedia恢复更新,但覆盖仍不完整

快讯
2026-09-30 05:49

停更数月的AI百科Grokipedia重新出现更新迹象,但多数词条尚未被重新核查。

Grokipedia是马斯克旗下SpaceXAI推出的AI生成在线百科。今年8月Lawfare报道其词条自4月起再无编辑审核记录。9月29日The Verge观察到平台实时更新页重新显示近期改动:奥巴马词条两天前刚被Grok核查,但夏威夷檀香山词条仍停留在7个月前。

SpaceXAI未回应置评请求,马斯克自2月起未在X上提及该产品。X与SpaceXAI设计负责人Benji Taylor上周表示“没有忘记Grokipedia”,并称v0.2会更好。

信息源:theverge.com

研究

梅耶尔新助手Dazzle只读相册建立用户画像

快讯
2026-09-29 21:53

前雅虎CEO玛丽莎·梅耶尔公开演示个人助手Dazzle,它不从邮件或日历取上下文,只分析手机相册来推断用户爱好、饮食和出行偏好。

产品分两类用法:扫描近期照片处理即时任务,比如从活动海报填日历;或挖掘整个相册给出度假、送礼建议。TechCrunch记者实测发现盲区:它推荐了四年前的西西里,却记不住记者女儿已会轮滑。

公司去年12月获800万美元种子轮,梅耶尔称会丢弃AI标记为敏感的信息。此前其照片分享产品Shine因使用率低已关停。

信息源:techcrunch.com

研究

TRACE拆分隐变量耦合更新,自测InterAct接触指标领先

快讯
2026-09-29 12:00

把身体、物体和手部运动拆成独立隐变量再耦合更新,作者自测在InterAct上的接触精确率、召回率与F1达到所比较方法中最高。

此前方法未做这种分路建模;该框架名为 TRACE,分别编码三路运动,用完整交互状态预测每一路的速度,并在解码后的动作上施加几何损失来约束接触与物体相对运动,同一模型可从两路补全缺失的第三路。

作者在 InterAct、OMOMO 和 BEHAVE 三个数据集上报告,联合补全训练改善了生成,冻结的流特征也提升了交互理解;摘要称在 InterAct 上接触指标领先,但未给出幅度、硬件与训练规模,也未说明第三方复现,因此这是作者自测结果。

预印本 9 月 26 日提交、9 月 29 日更新至 v2,尚无第三方复现。

信息源:arxiv.org

研究

DoorDash开放短信AI点单预约,正式上线无时间表

快讯
2026-09-30 21:00

DoorDash宣布用户将可直接发短信让AI机器人下单,美国iOS用户9月30日起可加入beta候补名单,正式上线时间未公布。

该功能基于6月上线的Ask DoorDash聊天机器人:用户说“照常点我的蛋白碗送到办公室”,AI在短信内搜索本地商家、组好购物车并完成结账,并记住偏好。

同日公司还披露无人机配送DoorDash Air首个试点将落地北加州,合作商家包括Chipotle和Popeyes,称约80%的典型订单轻到可安全空运,但消费者可用时间同样未定。

信息源:theverge.com

研究
下一页阅读 →