阅读研究雷达投资体系
登录 / 注册
登录 / 注册
阅读研究雷达投资体系
历史阅读归档 →

阅读

2026-09-2366 条

两大前沿模型同日降价,智能单价进入下行通道

实质变化
2026-09-23 17:00

Anthropic与OpenAI在9月22日相隔约90分钟各发一批新模型,且同时大幅降价:前沿智能的单价正在快速下探。

Anthropic的Claude Opus 5.5定价为每百万token输入4美元、输出20美元,缓存读取0.20美元,官方称典型负载下比Opus 5便宜40%,缓存读取便宜60%。OpenAI的GPT-6 Sol定价比GPT-5.6降50%至2/10美元,Luna降至0.10/0.50美元。

性能领先的说法全部来自厂商自报基准:Anthropic自己承认在这个能力水平上基准分差已不太能反映实际差距,OpenAI引用的AutomationBench等对比也由各家自行口径。读者可把降价当作已核实事实,把性能排名当作待验证主张。

信息源:therundown.ai

研究

Opus 5.5降价四成成默认模型,高用量档却省不了钱

实质变化
2026-09-23 14:41

Anthropic发布Opus 5.5并设为默认模型,标价降两成,但高用量任务的实际成本几乎没降。

9月22日上线,官方称多数任务达到Fable 5.1水平、运行成本比Opus 5低40%,输入/输出价从每百万token 5/25美元降至4/20美元,并即时成为Claude Code与应用的默认模型。

但Artificial Analysis测算:max档下token用量增加会推高每任务成本约80%,叠加降价与缓存优惠后为5.98美元,与Opus 5的5.86美元基本持平。省40%的说法只在默认档成立。

性能数字均为厂商及合作方口径,模型更小的传闻未经证实;选型时应按自己的任务档位实测成本。

信息源:latent.space

研究

Anthropic发布Opus 5.5,缓存读取价格降六成

实质变化
2026-09-23 06:58

Anthropic于9月22日发布Claude Opus 5.5,输入价格降至每百万token 4美元,输出20美元,缓存读取降60%至20美分;高速服务模式为8美元和40美元。

模型已在Claude开发者平台及AWS、谷歌云、Azure上线,Sonnet 5.5和Haiku 5.5将在未来数周推出。同日OpenAI也以半价发布GPT-6 Sol和Luna,旗舰价格战同一天在两家展开。

文中基准成绩如Terminal-Bench 4.0的66.4%均为Anthropic自报口径,第三方验证尚未出现;对跑长会话代理的团队,缓存降价是当下最确定的成本变化。

信息源:siliconangle.com

研究

Anthropic新旗舰降价两成发布,性能口径仍是自测

实质变化
2026-09-23 00:30

Anthropic于9月22日发布Opus 5.5,输出token价格从上一代的每百万25美元降到20美元,降幅两成。

公司称这是其测试过的最强模型,在多项基准上超过自家更大的Fable模型。这些跑分全部是厂商自测口径,METR等外部机构只做发布前安全评估,尚无独立性能验证。

该模型称与Mythos在生物和网络安全能力上相当,因此沿用Fable同款使用限制。Sonnet 5.5和Haiku 5.5将在未来数周发布,降价是否延续到中端型号更值得买家关注。

信息源:techcrunch.com

研究

OpenAI新Sol和Luna降价一半上市,可靠性仍是自测口径

实质变化
2026-09-23 02:00

OpenAI于9月22日发布GPT-6 Sol和Luna,API定价为5.6系列同档模型的一半,公司称降价来自缓存和推理改进。

Sol面向编码等复杂任务,Luna面向总结、信息抽取等高频文书任务,已上线ChatGPT Work、Codex和API,Luna还将覆盖免费和Go用户。

可靠性说法需打折:所谓错误率减半出自OpenAI基于用户标记对话的内部评估,并非第三方测试。发布前90分钟Anthropic刚推出Opus 5.5,两家比价节奏明显。

信息源:techcrunch.com

研究

OpenAI新模型价格腰斩,杀入DeepSeek低价区间

实质变化
2026-09-23 18:21

OpenAI发布GPT-6 Sol和Luna,API价格约为上一代一半,Luna每百万Token输入0.1美元、输出0.5美元。

据爱范儿报道,Luna普通请求价格已进入DeepSeek V4.1 Flash缓存未命中区间(输入1元、输出4元每百万Token),但DeepSeek闲时缓存命中输入仅0.02元,仍远低于Luna。

性能数字均为OpenAI口径;第三方Artificial Analysis测算称两款模型智能水平与GPT-5.6大致持平,主要变化是成本下降。

信息源:ifanr.com

研究

同等AI性能成本每季降近半,算力收入假设需重估

实质变化
2026-09-23 19:17

Epoch AI测算:过去三年,达到同等AI性能的成本平均每季下降约47%,即每年降约13倍。

报告给出的例子:2025年1月o3在GPQA Diamond拿到75%约需每题0.30美元,2026年中GPT-5.6 Luna同分只要0.0004美元,18个月内降约725倍。数学类基准降得最快(每季50–52%),游戏类较慢(39–43%)。

这是作者自评测算,报告自己列明局限:基准可能被针对性训练,且假设用户始终选最便宜的模型,数字不应读作精确值。即便价格速降,报告也提醒总支出可能因用量扩张而维持高位。

信息源:marginalrevolution.com

研究

阿里Qwen音频模型降价,语音识别最高降95%

实质变化
2026-09-23 20:31

阿里Qwen发布Audio 3.1系列五款音频模型,同时下调语音API价格:TTS约降70%,Realtime约降85%,ASR最高降95%。

新系列覆盖语音识别、语音合成和实时交互。官方称ASR改进多语言与方言识别并自动清理口头语,TTS-Next用扩散方法一次生成语音与音效,实时模型支持边说边听、即时打断。

以上能力描述均为Qwen自报口径,据The Decoder报道,来源为官方博客与X公告,尚无独立评测。做语音应用的成本假设可按新价重算。

信息源:the-decoder.com

研究

Muse智能体零日漏洞已打补丁,但设计隐患仍在

实质变化
2026-09-23 20:54

Meta的Muse智能体上线数周即被曝零日漏洞:本地任意应用或终端命令都能改写转写服务器地址,进而拿到账户令牌,完全控制该智能体。Meta在披露约12小时后发布热修复补丁。

发现者、macOS安全专家Patrick Wardle称,攻击者无需编写完整恶意软件,借助智能体自身权限即可写文件、拍照且几乎无提示。漏洞根源是设计选择:转写走云端、且任何本地程序都能控制未公开设置。补丁修复了漏洞,但这些设计决策本身未变。

另一独立事实:亚马逊在披露前约12小时已封禁Muse代购,称其为违反使用条款的未授权AI代理,并要求Meta将亚马逊移出该功能。漏洞细节为Wardle自述的概念验证,他计划11月在安全会议上详述。

信息源:wired.com

研究

Meta的Muse代打电话,部分其实是人在打

实质变化
2026-09-23 00:33

404 Media看到的Meta内部帖证实,Muse代打电话功能在测试中加入了人工坐席层,部分通话由训练过的人工坐席完成。

9月16日Meta高管公开宣传Muse可代用户致电商家,内部帖则写道Muse会把请求转给人工坐席去打这个电话。员工质疑用户在不知情下把通话请求交给了人,有员工警告这会带来严重负面报道。

Meta发言人回应称这是内部dogfooding,正式发布前会加入适当披露。人工介入的频率和触发条件目前没有公开数字。

信息源:404media.co

研究

Meta智能体Muse首周用户破50万,官方承认深度借鉴OpenClaw

实质变化
2026-09-23 22:42

Meta的个人AI智能体Muse在9月8日上线后一周内获得超过50万用户,日活超过25万,据The Information援引的内部数据。该应用已登顶苹果App Store。

Meta超级智能实验室产品负责人Nat Friedman在X上承认,Muse作为产品“绝对深受OpenClaw启发”,但称其为从头构建;用户发现两者部分文件名和内容几乎相同,他回应称OpenClaw作者“把这些东西做得完全正确”。用户数字是媒体援引的Meta内部数据,未经独立核实。

据The Information,OpenAI已在讨论推出自己的个人助手作为回应。真正的考验是用户是否愿意把私人账户和敏感数据交给这类智能体。

信息源:the-decoder.com

研究

Muse上线两周Meta市值增逾两千亿美元,华尔街转向看好

实质变化
2026-09-22 22:11

Muse上线两周,Meta股价累计上涨超20%,市值增加逾2000亿美元,升至七个多月高位。

据路透社报道(IT之家转引),Apptopia数据显示Muse前12天下载280万次,仅限美加市场;按与ChatGPT相同口径比较为180万次,高于ChatGPT同期的130万次。LSEG汇编显示64家覆盖券商中57家给予买入评级。

杰富瑞给出的108亿美元年化收入是假设情景:需到2027年底吸引10亿用户且3%转付费,并非预测落地。下载量不等于留存,付费转化尚未验证。

信息源:ithome.com

研究
下一页阅读 →