89c038b1c4
- 新增 DesignAI.bib(Garrity + 普尔等 2 条) - preamble 添加 natbib + plainnat 样式 - ch01/ch02 插入 \cite 引用(共 5 处) - 参考文献加入目录 outline(\addcontentsline) - 删除 ap07-references.tex,由 \bibliography 自动生成 Co-Authored-By: Claude Opus 4.7 <noreply@anthropic.com>
515 lines
18 KiB
TeX
515 lines
18 KiB
TeX
\chapter{导论}
|
||
|
||
本章建立读者对人工智能的宏观认知框架。从 AI 的发展历程出发,回顾从早期符号主义到深度学习、再到大模型时代的关键技术突破与转折节点;进而梳理 AI 的范式演进,从感知智能到生成式智能、从单一任务到通用智能的发展脉络,帮助读者理解 AI 技术的全貌和未来趋势。
|
||
|
||
|
||
\section*{篇章导读}
|
||
\addcontentsline{toc}{section}{篇章导读}
|
||
|
||
人工智能正在深刻改变设计的边界。从自动绘图到智能生成,从数据分析到自主决策,AI 技术为设计领域带来了前所未有的可能性——同时也带来了前所未有的困惑。
|
||
|
||
本篇将回答两个核心问题:
|
||
|
||
\begin{enumerate}
|
||
\def\labelenumi{\arabic{enumi}.}
|
||
\tightlist
|
||
\item
|
||
\textbf{AI 是什么,它将如何影响设计?}
|
||
\item
|
||
\textbf{AI 技术是如何演进的,我们应该关注哪些方向?}
|
||
\end{enumerate}
|
||
|
||
通过本篇学习,你将建立对 AI 的宏观认知,理解技术发展的脉络,为后续深入学习打下基础。
|
||
|
||
\section*{学习目标}
|
||
\addcontentsline{toc}{section}{学习目标}
|
||
|
||
\begin{itemize}
|
||
\tightlist
|
||
\item 了解 AI 技术发展的关键时间节点
|
||
\item 理解 AI 四大赛道及其应用场景
|
||
\item 掌握设计领域 AI 应用的现状与趋势
|
||
\item 理解 AI 范式的三次演进
|
||
\item 掌握万能逼近定理的直观意义
|
||
\item 建立神经网络技术栈的完整认知
|
||
\item 理解 Scaling Law 与模型规模效应
|
||
\end{itemize}
|
||
|
||
|
||
%% ============================================================
|
||
%% 第一部分:AI 与设计的交汇
|
||
%% ============================================================
|
||
|
||
\section{AI 与设计的交汇}
|
||
|
||
\subsection{案例引入:Amazon Go}
|
||
|
||
\subsubsection{案例背景}
|
||
|
||
Amazon Go 是亚马逊推出的无人便利店,通过计算机视觉和传感器融合技术,实现"拿了就走"的购物体验。这一案例展示了多种 AI 技术如何协同工作,重构一个完整的线下场景。
|
||
|
||
\subsubsection{技术要素}
|
||
|
||
Amazon Go 的 AI 技术栈融合了多项前沿技术:
|
||
|
||
{\def\LTcaptype{none} % do not increment counter
|
||
\begin{longtable}[]{@{}lll@{}}
|
||
\toprule\noalign{}
|
||
技术 & 作用 & 应用场景 \\
|
||
\midrule\noalign{}
|
||
\endhead
|
||
\bottomrule\noalign{}
|
||
\endlastfoot
|
||
5G 通信 & 低延迟数据传输 & 实时视频流处理 \\
|
||
3D 传感器 & 深度信息获取 & 空间定位与手势识别 \\
|
||
计算机视觉 & 图像理解 & 商品识别、行为分析 \\
|
||
传感器融合 & 多源数据整合 & 精确定位与跟踪 \\
|
||
\end{longtable}
|
||
}
|
||
|
||
\subsubsection{启示}
|
||
|
||
Amazon Go 展示了 AI 技术如何重构传统场景。从"扫码支付"到"拿了就走",AI 让交互变得更加自然。这个案例也说明,设计领域中许多看似复杂的环境感知与交互问题,都可以通过多技术的组合来加以解决。
|
||
|
||
\subsection{AI 发展时间线}
|
||
|
||
\subsubsection{萌芽期(1950s--2015)}
|
||
|
||
在深度学习爆发之前,AI 经历了漫长的探索期,积累了关键的理论基础:
|
||
|
||
\begin{itemize}
|
||
\tightlist
|
||
\item \textbf{1956}:达特茅斯会议,"人工智能"概念正式诞生
|
||
\item \textbf{1986}:反向传播算法(Backpropagation)被广泛应用,成为训练神经网络的核心方法
|
||
\item \textbf{1997}:Deep Blue 击败国际象棋世界冠军卡斯帕罗夫
|
||
\item \textbf{2012}:AlexNet 在 ImageNet 竞赛中大幅领先,深度学习时代开启
|
||
\end{itemize}
|
||
|
||
这段历史告诉我们:AI 并非一夜之间爆发,而是几十年理论沉淀与技术迭代的结果。
|
||
|
||
\subsubsection{觉醒期(2016--2018)}
|
||
|
||
\begin{itemize}
|
||
\tightlist
|
||
\item \textbf{2016}:AlphaGo 击败李世石,AI 进入公众视野
|
||
\item \textbf{2017}:Transformer 架构诞生,为大模型时代奠基
|
||
\item \textbf{2018}:BERT 预训练模型问世,NLP 任务取得突破
|
||
\end{itemize}
|
||
|
||
\subsubsection{爆发期(2019--2022)}
|
||
|
||
\begin{itemize}
|
||
\tightlist
|
||
\item \textbf{2019}:GPT-2 展示强大的文本生成能力
|
||
\item \textbf{2020}:GPT-3 发布,少样本学习能力震惊业界
|
||
\item \textbf{2022}:ChatGPT 发布,AI 对话能力达到新高度
|
||
\end{itemize}
|
||
|
||
\subsubsection{应用期(2023--2024)}
|
||
|
||
\begin{itemize}
|
||
\tightlist
|
||
\item \textbf{2023}:多模态大模型、AI Agent 概念兴起
|
||
\item \textbf{2024}:具身智能、端侧 AI 加速落地
|
||
\end{itemize}
|
||
|
||
\subsection{AI 四大赛道}
|
||
|
||
\subsubsection{AIGC(AI-Generated Content)}\label{aigcai-generated-content}
|
||
|
||
\textbf{定义}:人工智能生成内容
|
||
|
||
\textbf{应用领域}:
|
||
|
||
\begin{itemize}
|
||
\tightlist
|
||
\item 文本生成:文章、报告、代码
|
||
\item 图像生成:设计稿、效果图、图标
|
||
\item 视频生成:短视频、动画、特效
|
||
\item 音频生成:音乐、配音、音效
|
||
\end{itemize}
|
||
|
||
\textbf{设计影响}:从"工具辅助"到"生成伙伴"
|
||
|
||
\subsubsection{Agent(智能体)}
|
||
|
||
\textbf{定义}:能够自主感知、规划、执行的系统
|
||
|
||
\textbf{核心能力}:
|
||
|
||
\begin{itemize}
|
||
\tightlist
|
||
\item \textbf{感知(Perception)}:理解环境信息
|
||
\item \textbf{规划(Planning)}:制定行动方案
|
||
\item \textbf{记忆(Memory)}:存储和检索经验
|
||
\item \textbf{工具(Tool Use)}:调用外部资源
|
||
\end{itemize}
|
||
|
||
\textbf{设计影响}:从"被动执行"到"主动协作"
|
||
|
||
\subsubsection{AI4S(AI for Science)}\label{ai4sai-for-science}
|
||
|
||
\textbf{定义}:AI 驱动科学发现
|
||
|
||
\textbf{应用领域}:
|
||
|
||
\begin{itemize}
|
||
\tightlist
|
||
\item 蛋白质结构预测(AlphaFold)
|
||
\item 材料科学计算
|
||
\item 气候变化模拟
|
||
\item 城市系统优化
|
||
\end{itemize}
|
||
|
||
\textbf{设计影响}:数据驱动的设计决策
|
||
|
||
\subsubsection{AIED(AI in Education)}\label{aiedai-in-education}
|
||
|
||
\textbf{定义}:AI 在教育领域的应用
|
||
|
||
\textbf{应用场景}:
|
||
|
||
\begin{itemize}
|
||
\tightlist
|
||
\item 个性化学习路径
|
||
\item 智能答疑与辅导
|
||
\item 学习行为分析
|
||
\item 知识图谱构建
|
||
\end{itemize}
|
||
|
||
\textbf{设计影响}:设计教育与人才培养模式变革
|
||
|
||
\subsection{设计领域 AI 应用趋势}
|
||
|
||
\subsubsection{当前应用}
|
||
|
||
{\def\LTcaptype{none} % do not increment counter
|
||
\begin{longtable}[]{@{}lll@{}}
|
||
\toprule\noalign{}
|
||
领域 & AI 应用 & 成熟度 \\
|
||
\midrule\noalign{}
|
||
\endhead
|
||
\bottomrule\noalign{}
|
||
\endlastfoot
|
||
建筑设计 & 图纸生成、方案优化 & 中 \\
|
||
景观设计 & 场地分析、植被配置 & 中 \\
|
||
室内设计 & 家具布局、风格迁移 & 高 \\
|
||
平面设计 & Logo 生成、排版辅助 & 高 \\
|
||
交互设计 & 用户研究、原型生成 & 低 \\
|
||
\end{longtable}
|
||
}
|
||
|
||
\subsubsection{未来趋势}
|
||
|
||
\begin{enumerate}
|
||
\def\labelenumi{\arabic{enumi}.}
|
||
\tightlist
|
||
\item \textbf{从单点工具到系统化解决方案}
|
||
\item \textbf{从生成内容到生成决策}
|
||
\item \textbf{从人机协作到人机共生}
|
||
\end{enumerate}
|
||
|
||
|
||
%% ============================================================
|
||
%% 第二部分:AI 范式演进
|
||
%% ============================================================
|
||
|
||
\section{AI 范式演进}
|
||
|
||
\subsection{三次范式演进}
|
||
|
||
\subsubsection{第一范式:规则系统(Symbolic AI)}
|
||
|
||
\textbf{时期}:1950s -- 1980s
|
||
|
||
\textbf{核心思想}:人类专家编写规则
|
||
|
||
\textbf{特点}:
|
||
|
||
\begin{itemize}
|
||
\tightlist
|
||
\item 逻辑推理清晰
|
||
\item 知识表达明确
|
||
\item 泛化能力弱
|
||
\end{itemize}
|
||
|
||
\textbf{典型应用}:专家系统、棋类游戏
|
||
|
||
\subsubsection{第二范式:机器学习(Machine Learning)}
|
||
|
||
\textbf{时期}:1990s -- 2010s
|
||
|
||
\textbf{核心思想}:从数据中学习规律
|
||
|
||
\textbf{特点}:
|
||
|
||
\begin{itemize}
|
||
\tightlist
|
||
\item 数据驱动
|
||
\item 特征工程依赖专家经验
|
||
\item 任务特定
|
||
\end{itemize}
|
||
|
||
\textbf{典型应用}:推荐系统、图像分类、语音识别
|
||
|
||
\subsubsection{第三范式:深度学习(Deep Learning)}
|
||
|
||
\textbf{时期}:2012 -- 至今
|
||
|
||
\textbf{核心思想}:端到端学习,自动提取特征
|
||
|
||
\textbf{特点}:
|
||
|
||
\begin{itemize}
|
||
\tightlist
|
||
\item 大数据驱动
|
||
\item 自动特征学习
|
||
\item 迁移学习能力强
|
||
\end{itemize}
|
||
|
||
\textbf{典型应用}:大语言模型、生成式 AI、自动驾驶
|
||
|
||
\subsection{万能逼近定理}
|
||
|
||
\subsubsection{定理表述}
|
||
|
||
\textbf{Universal Approximation Theorem(1989)}:一个具有足够多神经元的单隐藏层前馈神经网络,可以以任意精度逼近任何连续函数。
|
||
|
||
\subsubsection{直观理解}
|
||
|
||
想象一张橡皮膜:
|
||
|
||
\begin{itemize}
|
||
\tightlist
|
||
\item 输入空间是平面上的点
|
||
\item 神经网络调整膜的形状
|
||
\item 神经元越多,膜的形变能力越强
|
||
\item 最终可以拟合任意复杂的曲面
|
||
\end{itemize}
|
||
|
||
\subsubsection{启示}
|
||
|
||
这个定理告诉我们:\textbf{神经网络具有强大的表达能力,理论上可以学习任何复杂的映射关系}。这也是深度学习能够处理图像、语言、语音等复杂任务的数学基础。
|
||
|
||
\subsection{神经网络技术栈全景}
|
||
|
||
\begin{lstlisting}
|
||
┌─────────────────────────────────────────────────────────────┐
|
||
│ 应用层 │
|
||
│ AIGC │ Agent │ AI4S │ AIED │ 空间智能 │
|
||
├─────────────────────────────────────────────────────────────┤
|
||
│ 模型层 │
|
||
│ Diffusion │ Transformer │ GNN │ CNN │ MLP │
|
||
├─────────────────────────────────────────────────────────────┤
|
||
│ 算法层 │
|
||
│ 反向传播 │ 注意力机制 │ 卷积 │ 池化 │ 激活函数 │
|
||
├─────────────────────────────────────────────────────────────┤
|
||
│ 数学层 │
|
||
│ 微积分 │ 线性代数 │ 概率论 │ 优化理论 │
|
||
└─────────────────────────────────────────────────────────────┘
|
||
\end{lstlisting}
|
||
|
||
\subsubsection{技术演进路径}
|
||
|
||
{\def\LTcaptype{none} % do not increment counter
|
||
\begin{longtable}[]{@{}lll@{}}
|
||
\toprule\noalign{}
|
||
时代 & 代表技术 & 突破点 \\
|
||
\midrule\noalign{}
|
||
\endhead
|
||
\bottomrule\noalign{}
|
||
\endlastfoot
|
||
1980s & MLP & 万能逼近定理 \\
|
||
1990s & CNN & 局部连接、权重共享 \\
|
||
2000s & RNN/LSTM & 序列建模 \\
|
||
2010s & GNN & 图结构数据 \\
|
||
2017 & Transformer & Self-Attention \\
|
||
2020s & Diffusion & 生成质量突破 \\
|
||
\end{longtable}
|
||
}
|
||
|
||
\subsubsection{模型家族关系}
|
||
|
||
\begin{lstlisting}
|
||
MLP(多层感知机)
|
||
│
|
||
┌──────────────┼──────────────┐
|
||
│ │ │
|
||
CNN GNN RNN
|
||
(空间数据) (图数据) (序列数据)
|
||
│ │ │
|
||
└──────────────┼──────────────┘
|
||
│
|
||
Transformer
|
||
│
|
||
┌──────────────┼──────────────┐
|
||
│ │ │
|
||
GPT 系列 BERT Diffusion
|
||
(生成式) (理解式) (图像生成)
|
||
\end{lstlisting}
|
||
|
||
\subsection{Scaling Law:规模即智能}
|
||
|
||
\subsubsection{什么是 Scaling Law}
|
||
|
||
Scaling Law(缩放定律)描述了模型性能与计算量、数据量、参数量之间的关系:
|
||
|
||
\textbf{模型性能 $\approx$ f(计算量, 数据量, 参数量)}
|
||
|
||
这一发现来自 Kaplan 等人 2020 年的研究(Scaling Laws for Neural Language Models),揭示了一个令人惊讶的规律:模型性能的提升并非随机的,而是可以被精确预测的。
|
||
|
||
\subsubsection{核心发现}
|
||
|
||
\textbf{1. 性能随规模对数增长}
|
||
|
||
\begin{itemize}
|
||
\tightlist
|
||
\item 模型越大,性能越好
|
||
\item 性能提升的幅度可以量化预测
|
||
\end{itemize}
|
||
|
||
\textbf{2. 计算效率最关键}
|
||
|
||
\begin{itemize}
|
||
\tightlist
|
||
\item 计算量增加 10 倍,性能提升约 1.5 倍
|
||
\item 数据量和参数量也有类似规律
|
||
\end{itemize}
|
||
|
||
\textbf{3. 没有看到天花板}
|
||
|
||
\begin{itemize}
|
||
\tightlist
|
||
\item 在现有规模下,性能提升仍在继续
|
||
\end{itemize}
|
||
|
||
\subsubsection{启示}
|
||
|
||
\begin{itemize}
|
||
\tightlist
|
||
\item \textbf{大模型时代}:规模成为竞争壁垒
|
||
\item \textbf{数据为王}:高质量数据比模型架构更重要
|
||
\item \textbf{算力需求}:AI 发展依赖硬件进步
|
||
\item \textbf{对设计领域的意义}:开源大模型的涌现使得小型设计团队也能获得强大的 AI 能力,降低了技术门槛
|
||
\end{itemize}
|
||
|
||
\subsection{从函数式视角看 AI 演进}
|
||
|
||
\subsubsection{核心理念}
|
||
|
||
\textbf{``Functions Describe the World''(函数描述世界)}——这一理念由美国威廉姆斯学院(Williams College)数学教授 Thomas Garrity 提出\cite{EJUUCH39}。他认为数学各分支本质上都在研究不同类型的函数:代数研究多项式函数,微积分研究光滑函数,线性代数研究线性变换。而世间万物——从声波在耳膜上的振动,到光线在视网膜上的投影——都可以用函数来描述。
|
||
|
||
\begin{itemize}
|
||
\tightlist
|
||
\item 物理定律:$F = ma$
|
||
\item 经济规律:Supply = Demand(Price)
|
||
\item 神经网络:$y = f(x; \theta)$
|
||
\end{itemize}
|
||
|
||
\subsubsection{AI 即函数组合}
|
||
|
||
\begin{lstlisting}
|
||
输入数据 x
|
||
│
|
||
▼
|
||
┌─────────┐
|
||
│ f₁(x) │ 第一层函数:特征提取
|
||
└─────────┘
|
||
│
|
||
▼
|
||
┌─────────┐
|
||
│ f₂(h) │ 第二层函数:模式识别
|
||
└─────────┘
|
||
│
|
||
▼
|
||
┌─────────┐
|
||
│ f₃(z) │ 第三层函数:决策输出
|
||
└─────────┘
|
||
│
|
||
▼
|
||
输出 y
|
||
\end{lstlisting}
|
||
|
||
\subsubsection{从 Excel 到神经网络}
|
||
|
||
{\def\LTcaptype{none} % do not increment counter
|
||
\begin{longtable}[]{@{}ll@{}}
|
||
\toprule\noalign{}
|
||
Excel & 神经网络 \\
|
||
\midrule\noalign{}
|
||
\endhead
|
||
\bottomrule\noalign{}
|
||
\endlastfoot
|
||
y = ax + b & 单层感知机 \\
|
||
y = a₁x₁ + a₂x₂ + b & 多输入神经元 \\
|
||
嵌套 IF 函数 & 多层网络 \\
|
||
宏函数 & 自动微分 \\
|
||
\end{longtable}
|
||
}
|
||
|
||
\section{本章小结}
|
||
|
||
本章从两个维度建立了对人工智能的宏观认知。
|
||
|
||
在第一节中,我们沿着时间线梳理了 AI 从萌芽到爆发的关键节点,了解了 AIGC、Agent、AI4S、AIED 四大赛道及其对设计领域的影响。Amazon Go 的案例让我们看到,AI 技术的组合可以重构一个完整的物理场景——这暗示着设计领域同样存在系统化变革的可能。
|
||
|
||
在第二节中,我们审视了 AI 范式的三次演进——从人类编写规则,到机器从数据中学习,再到端到端的深度学习。万能逼近定理告诉我们神经网络理论上可以学习任何映射关系,Scaling Law 则揭示了模型性能的可预测性。而"函数描述世界"的视角,为理解后续章节中的各类神经网络架构提供了统一的认知框架。
|
||
|
||
理解了 AI 的过去和现在,下一章我们将进入 AI 的内部——看看神经网络究竟是如何"学习"的。
|
||
|
||
\section{思考与练习}
|
||
|
||
\begin{enumerate}
|
||
\def\labelenumi{\arabic{enumi}.}
|
||
\tightlist
|
||
\item 选择你熟悉的设计领域,分析 AI 在该领域的应用现状和潜力。
|
||
\item 思考 AI 四大赛道中,哪一个对你的专业影响最大?为什么?
|
||
\item Amazon Go 案例中,哪些 AI 技术可以迁移到设计领域?
|
||
\item 万能逼近定理告诉我们神经网络"能"做任何事,但没有说"如何"高效学习。这个区别意味着什么?
|
||
\item Scaling Law 是否意味着"越大越好"?在资源有限的情况下,应该如何权衡?
|
||
\item 从函数式视角理解 AI,对你理解设计问题有何启发?
|
||
\end{enumerate}
|
||
|
||
|
||
\section{关键术语}
|
||
|
||
{\def\LTcaptype{none} % do not increment counter
|
||
\begin{longtable}[]{@{}
|
||
>{\raggedright\arraybackslash}p{(\linewidth - 4\tabcolsep) * \real{0.3333}}
|
||
>{\raggedright\arraybackslash}p{(\linewidth - 4\tabcolsep) * \real{0.3333}}
|
||
>{\raggedright\arraybackslash}p{(\linewidth - 4\tabcolsep) * \real{0.3333}}@{}}
|
||
\toprule\noalign{}
|
||
\begin{minipage}[b]{\linewidth}\raggedright
|
||
中文
|
||
\end{minipage} & \begin{minipage}[b]{\linewidth}\raggedright
|
||
英文
|
||
\end{minipage} & \begin{minipage}[b]{\linewidth}\raggedright
|
||
说明
|
||
\end{minipage} \\
|
||
\midrule\noalign{}
|
||
\endhead
|
||
\bottomrule\noalign{}
|
||
\endlastfoot
|
||
生成式 AI & AIGC & AI-Generated Content \\
|
||
智能体 & Agent & 自主决策系统 \\
|
||
AI for Science & AI4S & AI 驱动科学研究 \\
|
||
AI in Education & AIED & AI 教育应用 \\
|
||
传感器融合 & Sensor Fusion & 多传感器数据整合 \\
|
||
万能逼近定理 & Universal Approximation Theorem & 神经网络表达能力的理论保证 \\
|
||
缩放定律 & Scaling Law & 模型性能与规模的关系 \\
|
||
前馈网络 & Feed-Forward Network & 信息单向传播的神经网络 \\
|
||
多层感知机 & MLP & Multi-Layer Perceptron \\
|
||
端到端学习 & End-to-End Learning & 从输入直接学习到输出 \\
|
||
\end{longtable}
|
||
}
|
||
|
||
\section{延伸阅读}
|
||
|
||
\begin{itemize}
|
||
\tightlist
|
||
\item \href{https://arxiv.org/abs/2001.08361}{Scaling Laws for Neural Language Models}
|
||
\item \href{https://en.wikipedia.org/wiki/Universal_approximation_theorem}{Universal Approximation Theorem}
|
||
\item \href{https://www.nature.com/articles/s41586-023-06221-x}{The Evolution of AI: A Historical Perspective}
|
||
\item \href{https://arxiv.org/pdf/2308.11432v2}{AI Agent 综述论文}
|
||
\end{itemize}
|