资讯1 分钟阅读·
CoreWeave推模型迭代闭环工具
CoreWeave发布三项新功能,将生产环境数据自动转化为模型再训练信号,官方称某案例中模型胜率提升57.5%。
重要性局部证据E2 未复现写法快讯
CoreWeave于10月5日发布Model Distillation、RL Rollouts和可编程训练API,旨在打通推理与后训练环节。
传统流程中,模型上线即停止改进。新工具允许直接捕获生产流量中的失败案例作为训练数据,无需手动清洗或搭建基础设施。
官方引用客户Method的案例:使用GPT-4o输出训练Llama 3.1 8B模型处理银行IVR系统,经新数据迭代后,在对比评估中胜过原生产版本57.5%。另一客户Willow通过混合监督学习与强化学习提升了文本风格控制能力。
需注意,这些功能多为预览或新发布状态,具体性能依赖用户自身的数据质量与任务定义,且上述案例均为厂商单方陈述。