阅读研究雷达投资体系
登录 / 注册
登录 / 注册
阅读研究雷达投资体系
历史阅读归档 →

阅读

2026-09-2933 条

Anthropic发布新一代中档Claude,称编码成绩大跃升

实质变化
核验于 2026-09-30 02:37

Anthropic于9月28日发布Claude Sonnet 5.5,定位为Opus 5.5之下的中档模型,官方称速度提升30%以上、每任务成本最多降30%。

官方页面给出的核心数字:Terminal-Bench 4.0智能体编码测试得分70.6%,前代Sonnet 5为10.3%;单价不变,输入每百万token 2美元、输出10美元。它还是首个配备网络安全防护与回退机制的Sonnet档模型。

需要留意:全部成绩为Anthropic自测,且因OpenAI未公开GPT-6 Sol成绩,对比表实际使用GPT-5.6 Sol替代,跨厂商可比性打折。发布时点恰在OpenAI DevDay当天之前。

信息源:anthropic.com

研究

Claude Code推出Projects,一个对话自动拆成并行云任务

快讯
2026-09-29 09:48

Anthropic官方开发者账号9月17日宣布,Claude Code在桌面和网页端推出Projects,目前为测试版,仅向部分用户开放。

按官方说明,一个项目就是与Claude的一段对话:它自己把工作拆成线程,作为并行的云会话运行,线程之间传递上下文,用户离开后继续执行。开发者Boris Cherny称,他不再手动管理会话,想到什么就发什么。

这一变化把任务拆分和调度交给智能体本身,而不是用户。开放范围和正式发布时间,公告均未说明。

信息源:latent.space

研究

Meta推出面向小企业的Muse智能体,可读取社交与广告数据

快讯
2026-09-29 18:04

Meta于9月29日推出小型企业版Muse智能体,可读取Facebook和Instagram的企业账户、分析数据与广告账户,并据此给出具体任务计划。

产品同时接入Canva、Figma、Slack、Shopify、Stripe、QuickBooks等15种第三方服务,覆盖设计、收款与协作环节。IT之家转述Meta的说法,称公司还计划推出更多企业AI产品。

值得注意的是,Muse发布一周前刚被指未经许可泄露卖家住址、擅自约买家上门,这次把企业广告与经营数据交给智能体,权限边界是首先要看的地方。

信息源:ithome.com

研究

甲骨文推出Fusion Claw,企业应用可自主改写业务记录

快讯
2026-09-29 20:00

甲骨文9月29日发布Fusion Claw,一个让Fusion企业应用自主执行复杂业务任务的智能体运行时,同时推出25个由其驱动的应用,使同类应用总数达到75个。

Claw在大模型负责推理和规划的同时,把计算和交易处理放在模型之外,以控制成本;首发支持Gemini和OpenAI的前沿模型,用户暂不能自选更小的开源模型。据SiliconANGLE报道,甲骨文高管称此前没有面向高级优化的方案。

针对改写业务记录的风险,甲骨文提供企业运营包络机制,可设权限、风险阈值和审批要求,任务结束生成记录所用政策与交易的“结果回执”。公司未提供实测的成本节省或生产环境表现数据。

信息源:siliconangle.com

研究

GPT-6两款新模型登陆Snowflake,公开预览已可调用

快讯
2026-09-29 02:13

Snowflake于9月28日宣布,OpenAI的GPT-6 Sol和GPT-6 Luna已在Cortex AI进入公开预览。

两款模型现在可通过Cortex AI Functions在SQL里调用,例如用AI_COMPLETE函数直接分析财报文本;应用开发者也能经Snowflake的OpenAI兼容端点调用。所有调用都运行在Snowflake自己的安全与治理边界内。

Snowflake称Sol适合多步骤的复杂专业工作,Luna面向大规模快速执行,能力描述转引自OpenAI。CoCo、CoWork和Cortex Agents的集成尚未上线,公司标注为即将推出。

信息源:snowflake.com

研究

OpenAI加码新闻业AI计划,投入规模较此前翻倍

快讯
2026-09-28 15:00

OpenAI把对Lenfest新闻业AI研究员计划的投入翻倍:新增500万美元资助,外加最多500万美元的软件额度与工程支持。

该计划由Lenfest新闻研究所(一家资助美国地方新闻的非营利机构)与OpenAI在2024年启动,向11家美国地方新闻机构派驻全职AI工程师,费城问询报用它做了档案检索和监控工具,芝加哥公共媒体用它加快西班牙语报道发布。

下一阶段将招募新一批新闻机构加入。公告由双方联合发布,成效描述出自项目自身;几位研究员预计将转为驻在机构的正式员工,这是观察计划是否真正落地的一个可跟踪信号。

信息源:openai.com

研究

Momentic推出测试智能体Mo,无需维护测试脚本

快讯
2026-09-29 00:00

软件测试公司Momentic于9月28日发布测试智能体Mo,开发者不再编写和维护测试脚本,直接让智能体按需求去测应用。

Mo的使用方式类似Claude Code等编码工具:输入网址和测试说明,它会启动一群智能体操作应用,尝试大量边界情况,最后给出复现步骤和录像。它也能读取产品需求文档或Jira工单获取上下文。

联合创始人兼CEO Wei-Wei Wu对SiliconANGLE说,只要代码库里还有脚本,就得有人维护。公司称Notion等客户已在试用,效果如何尚无独立评测。

信息源:siliconangle.com

研究

安全创企Rig获1200万美元,专管员工账号下的AI智能体

快讯
2026-09-29 20:00

以色列安全创企Rig Security于9月29日出道,获1200万美元种子轮资金。

它针对的盲区很具体:编码助手和自主智能体很少有自己的账号,操作都记在启动它们的员工或服务账号名下。用CEO Guy Kozliner的话说,智能体如今是企业里最活跃的身份,“却顶着人名行事”,安全团队无法区分是人还是智能体,出事也只能连员工一起封。

产品用机器学习跨身份系统匹配同一身份,公司自称准确率超过96%;端侧传感器可单独拦下智能体的危险操作。公司称财富200强中的金融、保险和医疗客户已在生产环境使用,此说与准确率均为公司自述。本轮由Ten Eleven Ventures与Brightmind Partners共同领投,CrowdStrike作为战略投资方参股。

信息源:siliconangle.com

研究

四大药企联合Apheris共建万条抗体AI数据集

快讯
2026-09-29 20:00

AbbVie、argenx、Lundbeck、Takeda四家药企与柏林的Apheris、Ginkgo Datapoints成立抗体可开发性联盟,用约一万条抗体序列训练AI,预测候选药物能否顺利量产和成药。

成员各自提供专有序列,通过Apheris的联邦架构在本方环境内训练和微调模型,原始序列不暴露给其他成员;Ginkgo负责补足公开数据并做湿实验表征,首版数据集计划2027年初交付。

联盟刚启动,尚无任何模型性能数据,牛津大学Charlotte Deane与密歇根大学Peter Tessier提供独立科学监督。

信息源:tech.eu

研究

美国海军成立无人系统中心,整合空海潜无人机战法

快讯
2026-09-29 22:00

美国海军9月24日在弗吉尼亚正式成立机器人与自主系统作战发展中心,专门把空中、水面和水下无人平台整合成统一作战力量。

该中心负责制定无人系统作战条令、训练水兵,并测试这些装备在实战条件下的持续运作能力。海军作战部长达尔·考德尔在成立致辞中说,多年来的机器人系统研发分散在各作战域,下一步是整合,并称“原型不等于战斗力”。

美军指挥官此前已把这类无人系统能力与干扰解放军对台行动的场景联系起来。目前该中心的预算规模和具体编制尚未披露,整合进度有待后续观察。

信息源:scmp.com

研究

马斯克称Cybercab加州商业运营要到2027年年中

快讯
2026-09-29 17:37

马斯克预计Cybercab要到2027年年中才能在加州商业运营。

他在接受中国环球电视网采访时说,这款无方向盘的双座车将很快在佛罗里达、内华达等州商业运营,加州则“大概要到明年年中”。该访谈于周六(9月26日)发布。

此前特斯拉曾承诺在2026年底前以3万美元向普通买家出售这款车,YouTuber MKBHD为此立下剃头赌约。目前车辆还面临美国公路交通安全管理局对其自我合规认证的审计质询,这是落地前的硬性关卡。

信息源:businessinsider.com

研究

对齐技术用途中立,同样可作审查工具

快讯
2026-09-29 04:07

让模型「变安全」的对齐技术,同一套方法也能用来审查和扭曲信息——对齐方法本身用途中立,它让模型服从某个主体的意志,但不保证这个主体善意。

此前对齐多被默认为安全手段;Sarah Ball与Phil Hackemann把控制手段分为预训练数据过滤、后训练对齐和推理时干预三层,成本递减、改动变易,越往下越容易被单方面滥用。

这不是假设:中国网信办要求模型维护拒答数据集,马斯克曾公开表示要「修正」Grok的输出,后续行为变化被追溯到系统提示词改动。该分析获ICML 2026杰出立场论文奖,作者不建议停止对齐,而是主张透明、可验证对齐与模型多元化。

这是立场论文的论证与公开事例,属作者自报观点,尚无第三方复现其风险量化。

信息源:lesswrong.com

研究
下一页阅读 →