阅读研究雷达投资体系
登录 / 注册
登录 / 注册
阅读研究雷达投资体系
历史阅读归档 →

阅读

2026-09-2366 条

Pangram自测误报达4%和7%,官网仅展示0.01%量级

快讯
2026-09-23 18:13

Pangram 4的自测中,AI辅助文本被误判为AI生成的比例达4%和7%,而官网此前只展示最优的0.01%量级结果——LessWrong作者Sonia Albrecht 9月23日发文点名这一落差。

她称9月17日联系公司前,官网在“检测AI辅助”旁标注“99.9%+准确率”,此后措辞有变,但她不确定是否因她而起。她自测约5000词,约30%段落被标为AI生成。

以上均为批评者转述与个人自测,4%和7%未经独立复核;Pangram论文摘要自称整体误报率0.0041%。短文本误报更高,用AI润色的作者值得留意。

信息源:lesswrong.com

研究

macOS 27本地AI模型强制下载,实测占用远超官方上限

快讯
2026-09-23 18:48

macOS 27会把Apple Intelligence本地模型强制下载到Mac,用户无法阻止,苹果也已移除关闭开关。

苹果官方口径是M3及以上、12GB内存机型最多占14GB,其他机型最多8GB。但MacRumors在M4 Pro Mac mini上实测20.67GB,Ars Technica在M3 MacBook Air上记录到22.42GB,有用户截图显示30.16GB。

连不满足最高级模型硬件要求的M1机型也显示约14GB,超出其8GB上限。苹果支持文档未解释口径差异,实测数字来自媒体与用户,尚无官方确认。

信息源:ithome.com

研究

荣耀小米阶跃三款端侧AI服务完成网信备案

快讯
2026-09-23 16:33

荣耀YOYO Claw、小米Xiaomi miclaw和阶跃终端AI三款手机端侧生成式AI服务已于9月22日完成网信部门备案。

据网信中国公众号,网信部门按《生成式人工智能服务管理暂行办法》要求公告了这批新增备案:荣耀对应深圳荣耀软件,小米对应小米科技,阶跃终端AI对应智源星辰(上海),适用场景分别为各自品牌手机。

备案是这类服务合规运营的准入前提,端侧AI此前多见于云端大模型备案名单,此次单列手机端侧类别,后续同类产品有了可对照的先例。

信息源:ithome.com

研究

三星误推测试软件致AI冰箱停机,更新已暂停

快讯
2026-09-23 16:24

三星把内部测试版SmartThings软件误推给消费者,部分冰箱安装后彻底停机,公司已暂停分发并公开致歉。

故障于9月22日下午在韩国出现,距秋夕节仅数日。受影响的大多是2024年及之后推出的Bespoke AI四门系列,三星官方论坛出现数十条投诉,有用户称节前食材只能扔掉。

冰箱需工程师上门检修,有用户被告知最快要等假期结束后才能安排;三星尚未公布受影响数量,也未宣布食物损失赔偿方案。对读者而言,这是一个具体案例:联网AI家电的更新通道可以把厂商的测试软件直接送进在役设备。

信息源:ithome.com

研究

特斯拉北美车机上线Grok Bot,语音可代办购物邮件

快讯
2026-09-23 14:47

特斯拉9月23日在X平台宣布,Grok Bot在北美车机上线,驾驶员可免手动查看邮件、管理日程、线上购物和下单。

该功能运行在现有Grok界面内,无需独立应用;访问Gmail、Google Calendar等第三方服务需配置连接器。早期测试展示了用FSD行驶时语音下单星巴克、到店即取的流程,但这属于厂商与测试用户口径。

目前仅对SuperGrok Heavy订阅用户开放,其他订阅档位后续推送;短信收发尚在开发中,现阶段只能拨打电话。

信息源:ithome.com

研究

Claude Opus 5.5上线Snowflake Cortex公测

快讯
2026-09-23 07:09

Snowflake于9月22日宣布,Claude Opus 5.5在Cortex AI进入公开预览,覆盖CoCo、CoWork、Cortex Agents、AI Functions和Cortex Inference。

调用全部留在Snowflake的安全与治理边界内,开发者也可通过Anthropic SDK经Cortex Inference调用该模型。

博文中引用的编码、准确率与降价数字均转自Anthropic的发布口径,目前是公开预览阶段,尚非正式商用。

信息源:snowflake.com

研究

Databricks数据代理接口Genie One MCP正式开放

快讯
2026-09-23 00:00

Databricks于9月22日宣布Genie One MCP服务器正式面向所有用户开放,不再限于预览。

该接口让任何MCP兼容代理(如Claude、ChatGPT、Cursor或内部工具)以统一入口调用Genie One的结构化与非结构化数据答案,语义由Genie Ontology统一约束,目标是减少各代理各自建模造成的答案冲突。

治理与审计经Unity Gateway集中执行,这是企业能否放行的关键。注意这是厂商发布口径,无独立评测,客户引语由厂商挑选,实际答案质量与采用情况待落地验证。

信息源:databricks.com

研究

Teradata给Tera加治理代理能力,四季度上线

快讯
2026-09-22 21:00

Teradata于9月22日宣布扩展其Tera AI助手,新增Context Engine、Tera Harness和Agent Skills三部分,计划2026年第四季度可用。

Context Engine在不迁移数据的前提下汇集元数据、血缘、业务定义和访问策略,让代理按企业上下文理解请求;Tera Harness负责任务执行,可在敏感操作前暂停等待人工批准,并在基础设施故障后恢复。企业还可通过Model Context Protocol接入自有工具。

公告同时给出厂商自测跑分:同一Opus 5模型下Tera比Claude Code少用73% token,成本比Snowflake Cortex Code低53%。这些均为Teradata自报口径,公司自己也声明不代表全部企业负载表现,实际效果待Q4上线后由客户使用检验。

信息源:siliconangle.com

研究

OpenAI改进GPT-6提示缓存,代理应用成本可再降

快讯
2026-09-23 05:00

OpenAI在9月22日的产品说明中称,GPT-6系列默认提供更高的提示缓存命中率,30分钟窗口内复用的共享前缀可享缓存折扣,缓存输入token折扣最高90%。

新工具包括缓存监控面板、未命中诊断工具和显式缓存断点,开发者可在不破坏缓存的情况下调整推理力度,或预热缓存以降低首字延迟。

文中客户数字均为自述:GitHub Copilot称数月内需全新处理的提示token占比下降超50%,Manus称缓存命中率从约85%升至90%以上,Strawberry Browser称推理成本降36%。这些是厂商与客户口径。

信息源:openai.com

研究

只收输入费的决策模型Jev上线,输出免费

快讯
2026-09-22 07:09

TypeSafe AI推出Jev:文本进、浮点数出,只按输入计费,每百万token 0.042美元,输出免费。

它回答是非、选项和打分三类问题,适合垃圾过滤、打标签、重排序等分类任务。官方文档承认它在数字、日期和对抗性内容上表现不佳。

速度与成本均为厂商口径,尚无独立评测。Simon Willison提醒:模型只返回一个数字,无法解释判断依据,用于招聘排序等场景的偏见风险更突出。

信息源:simonwillison.net

研究

混元新图像模型上线WorkRally,两周免费可试

快讯
2026-09-22 14:05

腾讯混元9月22日发布Hy Image3.5 preview,腾讯视频的影视AI平台WorkRally首发接入,两周内注册即可免费调用。

模型支持文生图和图生图,单次最多5张参考图,最高2K输出。腾讯云API定价0.15元一张,只对输出图片收费。

官方称数百名专业创作者盲测显示能力比Hy Image3.0提升约30%,这是厂商自测口径,且WorkRally团队参与了模型共建,暂无独立评测。出海工具OnSolo同步接入并限免。

信息源:leiphone.com

研究

LLM改做原子级编辑,破解生成分子难合成瓶颈

快讯
核验于 2026-09-23 18:34

《自然·机器智能》9月23日发表SynCraft框架:让大语言模型预测可执行的原子级编辑序列,而不是直接生成SMILES字符串,以此绕开LLM的语法脆弱性,把生成分子推过“合成悬崖”。

论文称其在生成高结构保真度的可合成类似物上优于现有最先进基线,并复现了药物化学家编辑PLK1抑制剂、挽救被弃RIPK1候选分子的专家直觉。注意:这些对比结果均为作者自评基准,全文需订阅才能查看,具体提升幅度无法从公开摘要核实。

代码以MIT许可开源,测试集与训练语料(3332对编辑及推理轨迹)已在Figshare公开,框架还打包成agent skill演示了SARS-CoV-2主蛋白酶候选分子的端到端挽救流程。能否被药物设计团队实际采用,是下一个观察点。

信息源:nature.com

研究
下一页阅读 →