Files
2026_DesignAI/officefile/latex/chapters/ch01-intro.tex
T
2026-05-30 02:34:49 +08:00

515 lines
18 KiB
TeX
Raw Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
\chapter{导论}
本章建立读者对人工智能的宏观认知框架。从 AI 的发展历程出发,回顾从早期符号主义到深度学习、再到大模型时代的关键技术突破与转折节点;进而梳理 AI 的范式演进,从感知智能到生成式智能、从单一任务到通用智能的发展脉络,帮助读者理解 AI 技术的全貌和未来趋势。
\section*{篇章导读}
\addcontentsline{toc}{section}{篇章导读}
人工智能正在深刻改变设计的边界。从自动绘图到智能生成,从数据分析到自主决策,AI 技术为设计领域带来了前所未有的可能性——同时也带来了前所未有的困惑。
本篇将回答两个核心问题:
\begin{enumerate}
\def\labelenumi{\arabic{enumi}.}
\tightlist
\item
\textbf{AI 是什么,它将如何影响设计?}
\item
\textbf{AI 技术是如何演进的,我们应该关注哪些方向?}
\end{enumerate}
\section*{学习目标}
\addcontentsline{toc}{section}{学习目标}
\begin{itemize}
\tightlist
\item 了解 AI 技术发展的关键时间节点
\item 理解 AI 四大赛道及其应用场景
\item 掌握设计领域 AI 应用的现状与趋势
\item 理解 AI 范式的三次演进
\item 掌握万能逼近定理的直观意义
\item 建立神经网络技术栈的完整认知
\item 理解 Scaling Law 与模型规模效应
\end{itemize}
%% ============================================================
%% 第一部分:AI 与设计的交汇
%% ============================================================
\section{AI 与设计的交汇}
\subsection{案例引入:Amazon Go}
\subsubsection{案例背景}
Amazon Go 是亚马逊推出的无人便利店,通过计算机视觉和传感器融合技术,实现"拿了就走"的购物体验。这一案例展示了多种 AI 技术如何协同工作,重构一个完整的线下场景。
\subsubsection{技术要素}
Amazon Go 的 AI 技术栈融合了多项前沿技术:
{\def\LTcaptype{none} % do not increment counter
\begin{longtable}[]{@{}lll@{}}
\toprule\noalign{}
技术 & 作用 & 应用场景 \\
\midrule\noalign{}
\endhead
\bottomrule\noalign{}
\endlastfoot
5G 通信 & 低延迟数据传输 & 实时视频流处理 \\
3D 传感器 & 深度信息获取 & 空间定位与手势识别 \\
计算机视觉 & 图像理解 & 商品识别、行为分析 \\
传感器融合 & 多源数据整合 & 精确定位与跟踪 \\
\end{longtable}
}
\subsubsection{启示}
Amazon Go 展示了 AI 技术如何重构传统场景。从"扫码支付"到"拿了就走",AI 让交互变得更加自然。这个案例也说明,设计领域中许多看似复杂的环境感知与交互问题,都可以通过多技术的组合来加以解决。
\subsection{AI 发展时间线}
\subsubsection{萌芽期(1950s--2015}
在深度学习爆发之前,AI 经历了漫长的探索期,积累了关键的理论基础:
\begin{itemize}
\tightlist
\item \textbf{1956}:达特茅斯会议,"人工智能"概念正式诞生
\item \textbf{1986}:反向传播算法(Backpropagation)被广泛应用,成为训练神经网络的核心方法
\item \textbf{1997}:Deep Blue 击败国际象棋世界冠军卡斯帕罗夫
\item \textbf{2012}AlexNet 在 ImageNet 竞赛中大幅领先,深度学习时代开启
\end{itemize}
这段历史告诉我们:AI 并非一夜之间爆发,而是几十年理论沉淀与技术迭代的结果。
\subsubsection{觉醒期(2016--2018}
\begin{itemize}
\tightlist
\item \textbf{2016}:AlphaGo 击败李世石,AI 进入公众视野
\item \textbf{2017}Transformer 架构诞生,为大模型时代奠基
\item \textbf{2018}:BERT 预训练模型问世,NLP 任务取得突破
\end{itemize}
\subsubsection{爆发期(2019--2022}
\begin{itemize}
\tightlist
\item \textbf{2019}GPT-2 展示强大的文本生成能力
\item \textbf{2020}:GPT-3 发布,少样本学习能力震惊业界
\item \textbf{2022}:ChatGPT 发布,AI 对话能力达到新高度
\end{itemize}
\subsubsection{应用期(2023--2024}
\begin{itemize}
\tightlist
\item \textbf{2023}:多模态大模型、AI Agent 概念兴起
\item \textbf{2024}:具身智能、端侧 AI 加速落地
\end{itemize}
\subsection{AI 四大赛道}
\subsubsection{AIGCAI-Generated Content}\label{aigcai-generated-content}
\textbf{定义}:人工智能生成内容
\textbf{应用领域}
\begin{itemize}
\tightlist
\item 文本生成:文章、报告、代码
\item 图像生成:设计稿、效果图、图标
\item 视频生成:短视频、动画、特效
\item 音频生成:音乐、配音、音效
\end{itemize}
\textbf{设计影响}:从"工具辅助"到"生成伙伴"
\subsubsection{Agent(智能体)}
\textbf{定义}:能够自主感知、规划、执行的系统
\textbf{核心能力}
\begin{itemize}
\tightlist
\item \textbf{感知(Perception}:理解环境信息
\item \textbf{规划(Planning}:制定行动方案
\item \textbf{记忆(Memory}:存储和检索经验
\item \textbf{工具(Tool Use}:调用外部资源
\end{itemize}
\textbf{设计影响}:从"被动执行"到"主动协作"
\subsubsection{AI4SAI for Science}\label{ai4sai-for-science}
\textbf{定义}AI 驱动科学发现
\textbf{应用领域}
\begin{itemize}
\tightlist
\item 蛋白质结构预测(AlphaFold
\item 材料科学计算
\item 气候变化模拟
\item 城市系统优化
\end{itemize}
\textbf{设计影响}:数据驱动的设计决策
\subsubsection{AIEDAI in Education}\label{aiedai-in-education}
\textbf{定义}AI 在教育领域的应用
\textbf{应用场景}
\begin{itemize}
\tightlist
\item 个性化学习路径
\item 智能答疑与辅导
\item 学习行为分析
\item 知识图谱构建
\end{itemize}
\textbf{设计影响}:设计教育与人才培养模式变革
\subsection{设计领域 AI 应用趋势}
\subsubsection{当前应用}
{\def\LTcaptype{none} % do not increment counter
\begin{longtable}[]{@{}lll@{}}
\toprule\noalign{}
领域 & AI 应用 & 成熟度 \\
\midrule\noalign{}
\endhead
\bottomrule\noalign{}
\endlastfoot
建筑设计 & 图纸生成、方案优化 &\\
景观设计 & 场地分析、植被配置 &\\
室内设计 & 家具布局、风格迁移 &\\
平面设计 & Logo 生成、排版辅助 &\\
交互设计 & 用户研究、原型生成 &\\
\end{longtable}
}
\subsubsection{未来趋势}
\begin{enumerate}
\def\labelenumi{\arabic{enumi}.}
\tightlist
\item \textbf{从单点工具到系统化解决方案}
\item \textbf{从生成内容到生成决策}
\item \textbf{从人机协作到人机共生}
\end{enumerate}
%% ============================================================
%% 第二部分:AI 范式演进
%% ============================================================
\section{AI 范式演进}
\subsection{三次范式演进}
\subsubsection{第一范式:规则系统(Symbolic AI)}
\textbf{时期}1950s -- 1980s
\textbf{核心思想}:人类专家编写规则
\textbf{特点}
\begin{itemize}
\tightlist
\item 逻辑推理清晰
\item 知识表达明确
\item 泛化能力弱
\end{itemize}
\textbf{典型应用}:专家系统、棋类游戏
\subsubsection{第二范式:机器学习(Machine Learning}
\textbf{时期}1990s -- 2010s
\textbf{核心思想}:从数据中学习规律
\textbf{特点}
\begin{itemize}
\tightlist
\item 数据驱动
\item 特征工程依赖专家经验
\item 任务特定
\end{itemize}
\textbf{典型应用}:推荐系统、图像分类、语音识别
\subsubsection{第三范式:深度学习(Deep Learning}
\textbf{时期}2012 -- 至今
\textbf{核心思想}:端到端学习,自动提取特征
\textbf{特点}
\begin{itemize}
\tightlist
\item 大数据驱动
\item 自动特征学习
\item 迁移学习能力强
\end{itemize}
\textbf{典型应用}:大语言模型、生成式 AI、自动驾驶
\subsection{万能逼近定理}
\subsubsection{定理表述}
\textbf{Universal Approximation Theorem1989}:一个具有足够多神经元的单隐藏层前馈神经网络,可以以任意精度逼近任何连续函数。
\subsubsection{直观理解}
想象一张橡皮膜:
\begin{itemize}
\tightlist
\item 输入空间是平面上的点
\item 神经网络调整膜的形状
\item 神经元越多,膜的形变能力越强
\item 最终可以拟合任意复杂的曲面
\end{itemize}
\subsubsection{启示}
这个定理告诉我们:\textbf{神经网络具有强大的表达能力,理论上可以学习任何复杂的映射关系}。这也是深度学习能够处理图像、语言、语音等复杂任务的数学基础。
\subsection{神经网络技术栈全景}
\begin{lstlisting}
┌─────────────────────────────────────────────────────────────┐
│ 应用层 │
│ AIGC │ Agent │ AI4S │ AIED │ 空间智能 │
├─────────────────────────────────────────────────────────────┤
│ 模型层 │
│ Diffusion │ Transformer │ GNN │ CNN │ MLP │
├─────────────────────────────────────────────────────────────┤
│ 算法层 │
│ 反向传播 │ 注意力机制 │ 卷积 │ 池化 │ 激活函数 │
├─────────────────────────────────────────────────────────────┤
│ 数学层 │
│ 微积分 │ 线性代数 │ 概率论 │ 优化理论 │
└─────────────────────────────────────────────────────────────┘
\end{lstlisting}
\subsubsection{技术演进路径}
{\def\LTcaptype{none} % do not increment counter
\begin{longtable}[]{@{}lll@{}}
\toprule\noalign{}
时代 & 代表技术 & 突破点 \\
\midrule\noalign{}
\endhead
\bottomrule\noalign{}
\endlastfoot
1980s & MLP & 万能逼近定理 \\
1990s & CNN & 局部连接、权重共享 \\
2000s & RNN/LSTM & 序列建模 \\
2010s & GNN & 图结构数据 \\
2017 & Transformer & Self-Attention \\
2020s & Diffusion & 生成质量突破 \\
\end{longtable}
}
\subsubsection{模型家族关系}
\begin{lstlisting}
MLP(多层感知机)
┌──────────────┼──────────────┐
│ │ │
CNN GNN RNN
(空间数据) (图数据) (序列数据)
│ │ │
└──────────────┼──────────────┘
Transformer
┌──────────────┼──────────────┐
│ │ │
GPT 系列 BERT Diffusion
(生成式) (理解式) (图像生成)
\end{lstlisting}
\subsection{Scaling Law:规模即智能}
\subsubsection{什么是 Scaling Law}
Scaling Law(缩放定律)描述了模型性能与计算量、数据量、参数量之间的关系:
\textbf{模型性能 $\approx$ f(计算量, 数据量, 参数量)}
这一发现来自 Kaplan 等人 2020 年的研究(Scaling Laws for Neural Language Models),揭示了一个令人惊讶的规律:模型性能的提升并非随机的,而是可以被精确预测的。
\subsubsection{核心发现}
\textbf{1. 性能随规模对数增长}
\begin{itemize}
\tightlist
\item 模型越大,性能越好
\item 性能提升的幅度可以量化预测
\end{itemize}
\textbf{2. 计算效率最关键}
\begin{itemize}
\tightlist
\item 计算量增加 10 倍,性能提升约 1.5 倍
\item 数据量和参数量也有类似规律
\end{itemize}
\textbf{3. 没有看到天花板}
\begin{itemize}
\tightlist
\item 在现有规模下,性能提升仍在继续
\end{itemize}
\subsubsection{启示}
\begin{itemize}
\tightlist
\item \textbf{大模型时代}:规模成为竞争壁垒
\item \textbf{数据为王}:高质量数据比模型架构更重要
\item \textbf{算力需求}AI 发展依赖硬件进步
\item \textbf{对设计领域的意义}:开源大模型的涌现使得小型设计团队也能获得强大的 AI 能力,降低了技术门槛
\end{itemize}
\subsection{从函数式视角看 AI 演进}
\subsubsection{核心理念}
\textbf{``Functions Describe the World''(函数描述世界)}——这一理念由美国威廉姆斯学院(Williams College)数学教授 Thomas Garrity 提出\cite{EJUUCH39}。他认为数学各分支本质上都在研究不同类型的函数:代数研究多项式函数,微积分研究光滑函数,线性代数研究线性变换。而世间万物——从声波在耳膜上的振动,到光线在视网膜上的投影——都可以用函数来描述。
\begin{itemize}
\tightlist
\item 物理定律:$F = ma$
\item 经济规律:Supply = Demand(Price)
\item 神经网络:$y = f(x; \theta)$
\end{itemize}
\subsubsection{AI 即函数组合}
\begin{lstlisting}
输入数据 x
┌─────────┐
│ f₁(x) │ 第一层函数:特征提取
└─────────┘
┌─────────┐
│ f₂(h) │ 第二层函数:模式识别
└─────────┘
┌─────────┐
│ f₃(z) │ 第三层函数:决策输出
└─────────┘
输出 y
\end{lstlisting}
\subsubsection{从 Excel 到神经网络}
{\def\LTcaptype{none} % do not increment counter
\begin{longtable}[]{@{}ll@{}}
\toprule\noalign{}
Excel & 神经网络 \\
\midrule\noalign{}
\endhead
\bottomrule\noalign{}
\endlastfoot
y = ax + b & 单层感知机 \\
y = a₁x₁ + a₂x₂ + b & 多输入神经元 \\
嵌套 IF 函数 & 多层网络 \\
宏函数 & 自动微分 \\
\end{longtable}
}
\section{本章小结}
本章从两个维度建立了对人工智能的宏观认知。
在第一节中,我们沿着时间线梳理了 AI 从萌芽到爆发的关键节点,了解了 AIGC、Agent、AI4S、AIED 四大赛道及其对设计领域的影响。Amazon Go 的案例让我们看到,AI 技术的组合可以重构一个完整的物理场景——这暗示着设计领域同样存在系统化变革的可能。
在第二节中,我们审视了 AI 范式的三次演进——从人类编写规则,到机器从数据中学习,再到端到端的深度学习。万能逼近定理告诉我们神经网络理论上可以学习任何映射关系,Scaling Law 则揭示了模型性能的可预测性。而"函数描述世界"的视角,为理解后续章节中的各类神经网络架构提供了统一的认知框架。
理解了 AI 的过去和现在,下一章我们将进入 AI 的内部——看看神经网络究竟是如何"学习"的。
\section{思考与练习}
\begin{enumerate}
\def\labelenumi{\arabic{enumi}.}
\tightlist
\item 选择你熟悉的设计领域,分析 AI 在该领域的应用现状和潜力。
\item 思考 AI 四大赛道中,哪一个对你的专业影响最大?为什么?
\item Amazon Go 案例中,哪些 AI 技术可以迁移到设计领域?
\item 万能逼近定理告诉我们神经网络"能"做任何事,但没有说"如何"高效学习。这个区别意味着什么?
\item Scaling Law 是否意味着"越大越好"?在资源有限的情况下,应该如何权衡?
\item 从函数式视角理解 AI,对你理解设计问题有何启发?
\end{enumerate}
\section{关键术语}
{\def\LTcaptype{none} % do not increment counter
\begin{longtable}[]{@{}
>{\raggedright\arraybackslash}p{(\linewidth - 4\tabcolsep) * \real{0.3333}}
>{\raggedright\arraybackslash}p{(\linewidth - 4\tabcolsep) * \real{0.3333}}
>{\raggedright\arraybackslash}p{(\linewidth - 4\tabcolsep) * \real{0.3333}}@{}}
\toprule\noalign{}
\begin{minipage}[b]{\linewidth}\raggedright
中文
\end{minipage} & \begin{minipage}[b]{\linewidth}\raggedright
英文
\end{minipage} & \begin{minipage}[b]{\linewidth}\raggedright
说明
\end{minipage} \\
\midrule\noalign{}
\endhead
\bottomrule\noalign{}
\endlastfoot
生成式 AI & AIGC & AI-Generated Content \\
智能体 & Agent & 自主决策系统 \\
AI for Science & AI4S & AI 驱动科学研究 \\
AI in Education & AIED & AI 教育应用 \\
传感器融合 & Sensor Fusion & 多传感器数据整合 \\
万能逼近定理 & Universal Approximation Theorem & 神经网络表达能力的理论保证 \\
缩放定律 & Scaling Law & 模型性能与规模的关系 \\
前馈网络 & Feed-Forward Network & 信息单向传播的神经网络 \\
多层感知机 & MLP & Multi-Layer Perceptron \\
端到端学习 & End-to-End Learning & 从输入直接学习到输出 \\
\end{longtable}
}
\section{延伸阅读}
\begin{itemize}
\tightlist
\item \href{https://arxiv.org/abs/2001.08361}{Scaling Laws for Neural Language Models}
\item \href{https://en.wikipedia.org/wiki/Universal_approximation_theorem}{Universal Approximation Theorem}
\item \href{https://www.nature.com/articles/s41586-023-06221-x}{The Evolution of AI: A Historical Perspective}
\item \href{https://arxiv.org/pdf/2308.11432v2}{AI Agent 综述论文}
\end{itemize}