图书籍 编 豆包 新华书店正版 人民邮电出版 时光学 即梦AI 社 麓山剪辑社 编著 剪映 计算机控制仿真与人工智能专业科技
折后价 ¥ 15.23
GRPO 大模型算法:强化学习 微调与对齐 SFT RLHF DeepSeek蒸馏 CoT 详解强化学习 DPO 效果优化及其实践
所 在 地:天津
累计销量:0 件
店铺掌柜: 锦瑭图书专营店
¥72 ¥72






