麓山剪辑社 编 时光学 即梦AI 豆包 人民邮电出版 图书籍 新华书店正版 社 剪映 计算机控制仿真与人工智能专业科技 编著
折后价 ¥ 14.4
效果优化及其实践 GRPO 大模型算法:强化学习 DeepSeek蒸馏 SFT CoT DPO RLHF 详解强化学习 微调与对齐
所 在 地:天津
累计销量:0 件
店铺掌柜: 臣马图书音像专营店
¥69.6 ¥69.6




