主题
从运行记录中学习系统响应,在世界模型中优化控制操作,无需在真实设备上进行训练试错。
从历史数据学习状态、动作与系统响应的关系,用于单步预测、多步推演和离线仿真。
了解世界模型
在已验证的世界模型中训练策略,结合业务目标与动作边界优化控制操作。
了解控制策略
通过决策流图、专家函数和专家特征表达业务机理,结合自定义网络处理具体任务。
查看高级功能
使用命令行、Python 接口或 Agent Skill 完成任务,支持模型评估、Python 推理与 ONNX 部署。
查看部署方式