资讯

从完成任务到自主发现,Agent后训练寻找下一个Scaling Law

雷峰网·2026/9/12 08:40:00🔗 原文

📋总体概括

当大模型开始调用工具、执行复杂任务,衡量其能力的标准也在发生变化:不仅要看能否给出正确答案,更要看能否在真实环境中持续行动、检查结果,并根据反馈调整策略。从模型能力到任务价值,这一转变需要怎样的训练方法与基础设施?智能体能否在工作中积累经验、不断进化,进而打开新的能力增长空间? 9月12日上午2026 Inclusion·外滩大会上,以“Agent Post-Training:智能本质与下一个 S

关键信息

  • 当大模型开始调用工具、执行复杂任务,衡量其能力的标准也在发生变化:不仅要看能否给出正确答案,更要看能否在真实环境中持续行
本文由本站自动聚合,以下为原始来源:前往 雷峰网 阅读全文