feat(latex): 新增 LaTeX 排版系统,从 Markdown 生成 ctexbook
- 新增 officefile/latex/ 目录,包含 main.tex、preamble.tex 及 14 个章节 + 10 个附录 tex 文件 - md→tex 转换流程:pandoc 转换 + _postprocess.py 后处理(去编号、修破折号、清标签) - 修复 5 个 md 源文件的标题层级(H1→H2 降级,统一层级结构) - 配置 VS Code LaTeX Workshop(xelatex + ctexbook 编译链) - 新增 VS Code workspace 和 .gitignore(排除 LaTeX 编译产物) Co-Authored-By: Claude Opus 4.7 <noreply@anthropic.com>
This commit is contained in:
@@ -21,7 +21,7 @@
|
||||
|
||||
---
|
||||
|
||||
# 8.1 RL基础
|
||||
## 8.1 RL基础
|
||||
|
||||
## 8.1.1 核心框架:智能体与环境的交互
|
||||
|
||||
@@ -249,7 +249,7 @@ for s in range(n_states):
|
||||
|
||||
---
|
||||
|
||||
# 8.2 策略优化
|
||||
## 8.2 策略优化
|
||||
|
||||
Q-Learning和DQN属于**基于价值(Value-Based)** 的方法:先学习价值函数,再间接推导策略。另一类方法是**基于策略(Policy-Based)** 的方法,直接优化策略本身。
|
||||
|
||||
@@ -403,7 +403,7 @@ A2C: 多个Worker同步更新 → 等待所有Worker完成,再统一更新
|
||||
|
||||
---
|
||||
|
||||
# 8.3 Alpha系列
|
||||
## 8.3 Alpha系列
|
||||
|
||||
从2016年开始,DeepMind的Alpha系列成果不断刷新人们对AI能力的认知。这些突破展示了一个共同的技术范式:**搜索 + 深度学习 + 海量计算**。
|
||||
|
||||
@@ -502,7 +502,7 @@ AlphaFold的意义对设计领域尤其深远:
|
||||
|
||||
---
|
||||
|
||||
# 8.4 人类对齐
|
||||
## 8.4 人类对齐
|
||||
|
||||
## 8.4.1 为什么需要对齐?
|
||||
|
||||
@@ -624,7 +624,7 @@ Constitutional AI 流程:
|
||||
|
||||
---
|
||||
|
||||
# 8.5 具身智能
|
||||
## 8.5 具身智能
|
||||
|
||||
## 8.5.1 什么是具身智能?
|
||||
|
||||
@@ -750,7 +750,7 @@ Gymnasium中与设计相关的环境包括:
|
||||
|
||||
---
|
||||
|
||||
# 8.6 设计应用
|
||||
## 8.6 设计应用
|
||||
|
||||
强化学习为设计领域提供了从"被动工具"到"主动智能体"的范式转变。以下是一些具有代表性的应用场景。
|
||||
|
||||
|
||||
Reference in New Issue
Block a user