标签: 强化学习
所有使用该标签的文章 "强化学习".
-
从模型训练到 Agent:一份把 AI 技术串起来的学习路线
不把预训练、微调、RAG、Agent 和编排当成孤立热词。用一条从数据到业务闭环的主线,建立完整 AI 技术地图,并给出面试冲刺和八周动手路线。
-
CS 234: Reinforcement Learning
涵盖马尔可夫决策过程、RL 基础、大规模域扩展、探索挑战。包含深度强化学习作业。应用于机器人、游戏、消费者建模和医疗保健。
所有使用该标签的文章 "强化学习".
不把预训练、微调、RAG、Agent 和编排当成孤立热词。用一条从数据到业务闭环的主线,建立完整 AI 技术地图,并给出面试冲刺和八周动手路线。
涵盖马尔可夫决策过程、RL 基础、大规模域扩展、探索挑战。包含深度强化学习作业。应用于机器人、游戏、消费者建模和医疗保健。