概率论公式小抄PDF制作指南:从模块切分到LaTeX排版
简介这是一份概率论与数理统计核心公式速查手册面向备考期末、考研复习以及需要快速查阅公式的大学生和自学者重点解决公式繁多、记忆困难的问题。资源将知识体系按模块整理涵盖随机事件与概率、常见离散型和连续型分布、多维随机变量及其分布、随机变量的独立性等核心内容并对德摩根公式、全概率公式、贝叶斯公式、边缘分布、条件概率密度等高频考点逐一列出结构清晰便于对照记忆和考前冲刺。包体为单个PDF文件约271KB内容精炼适合打印或离线查看。目前已有254人学习下载作为便携式公式小抄可帮助读者在短时间内系统回顾概率论与数理统计的关键结论提升复习效率。1. 概率论与数理统计公式小抄为什么要做成 PDF刷题刷到区间估计这一节很多人都会卡在同一处二项分布的期望 np 没人记错可一到 zα/2 和 tα/2 该用哪个、自由度要不要减一手上没有教材就得翻半天。纸质笔记公式密翻起来全凭“大概在这一页”的模糊记忆串行看错一行就得重推一遍。所以考前大多人做的最后一件事是把手头的概率论与数理统计公式压成一份三四页的速查 PDF文字能检索、字号能缩放、A4 正反面打印后随身带。这才是“小抄必备”的本意——不是夹带的纸条而是考前最后过筛子、答题过程中快速复查的索引。为什么要用 PDF 而不是 Word 或手写卡片公式密度很高的文档Word 里对齐矩阵和分式非常折磨手写卡片又没法 CtrlF。工程上常见做法是两条路LaTeX 直接编译以及 Markdown 配合 Pandoc 转换。下面按“模块切分 → 排版生成 → 检索验证”的顺序把制作这样一份文档的参数、命令和坑一次讲清兼顾考试冲刺与数据类面试前速成两种场景。顺便说一句整理公式的过程本身就是一轮高效的复习真正走进考场时请遵守所在考场的规则。2. 概率论与数理统计公式怎么切模块从事件概率到抽样分布2.1 四大模块的切分逻辑不按教材目录按使用频度把教材目录原样搬进速查 PDF 是最常见的错误前半本全是古典概型和条件概率后半本挤满统计量公式考试时满屏飘字却找不到想要的分布。我一般按“做题时的调用顺序”切成四块事件与概率古典概型、加法乘法法则、条件概率、全概率与贝叶斯、事件独立性。随机变量常见分布、分布函数与密度、二维随机变量的边际与条件。数字特征与极限定理期望、方差、协方差、相关系数、大数定律、中心极限定理。数理统计样本均值与样本方差、三大抽样分布、点估计与区间估计、假设检验的关键量。这四块对应解题时依次问自己的问题这题是事件运算还是随机变量落在哪个分布期望方差多少样本量大了用什么近似把调用顺序当成排版顺序PDF 里就不用目录定位翻到对应区域眼睛一扫就到。2.2 常见分布速查表参数、密度、期望与方差一张表收齐分布公式是整个速查 PDF 里复用频率最高的部分建议把六张卡式的小盒子排版在同一个视图中。下面这张表是小抄必备版的核心骨架印刷到 PDF 时建议把表格拆成两个独立盒子一个放离散型一个放连续型分布参数概率函数或密度数学期望方差0-1 分布0p1P(X1)ppp(1-p)二项分布n, pP(Xk)Cₙᵏpᵏ(1-p)ⁿ⁻ᵏnpnp(1-p)泊松分布λ0P(Xk)λᵏe⁻λ/k!λλ均匀分布abf(x)1/(b-a)axb(ab)/2(b-a)²/12指数分布θ0f(x)(1/θ)e⁻ˣᐟθx0θθ²正态分布μ, σ²f(x)(1/√(2π)σ)e⁻⁽ˣ⁻μ⁾²ᐟ²σ²μσ²建这张表时要留意两个参数约定指数分布有 θ 和 λ 两种写法λ 写法下方差是 1/λ²考试时先看题干给出的参数形式再带入泊松分布的期望和方差同为 λ若算出两者不相等基本可以断定代公式时把 λ 写丢了。二项分布表里还可以补一行“当 n 大、p 小时用泊松近似λnp”的提示考场上看一眼就能决定用哪个近似。正态分布的盒子要额外写上标准化公式 (X-μ)/σ ~ N(0,1)以及常用分位点 z₀.₉₇₅1.96、z₀.₉₉₅2.576这是区间估计和假设检验的计算入口。2.3 抽样分布与区间估计数理统计公式怎么排列才不乱数理统计部分最容易犯的错是只列公式不写“前提”。三大抽样分布在速查 PDF 里应当各自配一行适用条件设 X₁,…,Xₙ 是来自正态总体 N(μ,σ²) 的样本样本均值 X̄ 与样本方差 S² 独立则标准化样本均值 (X̄-μ)/(σ/√n) ~ N(0,1)用于 σ 已知时(n-1)S²/σ² ~ χ²(n-1)用于总体方差的区间估计(X̄-μ)/(S/√n) ~ t(n-1)用于 σ 未知时对 μ 做估计或检验S₁²/S₂² ~ F(n₁-1,n₂-1) 在方差比检验中使用S₁² 对应样本量 n₁。这段排版建议紧贴置信区间公式放例如正态总体 μ 的置信区间写成 X̄ ± tα/2(n-1)·S/√nσ 已知时把 t 换成 z。这样排的好处是看到 t 和 z 的切换条件下一眼就能找到自由度取值减少中间翻页。我在实际整理时还会给每个统计量标注“记忆钩子”χ² 自由度是 n-1因为 S² 替换 σ² 时损失了一个估计用掉的自由度F 统计量的两个自由度跟随分子的样本量。这类一行注释足够唤醒记忆比整段推导醒目。3. 用 LaTeX 生成公式小抄 PDF 的最小工作流3.1 为什么这种高密度公式文档最终要回到 LaTeXPandoc 转换适合内容还要复用到博客、笔记的场景但如果目标是产出“页数少、密度高、打印不串行”的 PDFLaTeX 是更可靠的默认项。原因有三公式对齐交给 amsmath 后完全可预测不会出现 Word 里分式忽大忽小的问题multicol 双栏排版在 LaTeX 是成熟方案段间距可以通过参数精确控制tcolorbox 可以做出区分模块的浅色盒子打印成黑白时依然有边界感。对 5 年以上经验的人来说LaTeX 模板的维护成本几乎为零关键参数记下来以后任何学科的小抄都能套用。3.2 最小可编译模板两栏版式与公式盒子下面这个模板是我常用的起点约 40 行能直接编译出 A4 两栏的小抄框架\documentclass[9pt,a4paper]{article} \usepackage[margin1.1cm]{geometry} \usepackage{amsmath,amssymb} \usepackage{multicol} \usepackage{tcolorbox} \usepackage{xeCJK} \setCJKmainfont{Noto Serif CJK SC} \setlength{\parindent}{0pt} \setlength{\columnsep}{12pt} \setlength{\parskip}{3pt} \newenvironment{formulabox}[1]{% \begin{tcolorbox}[colbackgray!8,colframegray!60, boxrule0.4pt,arc1.5mm,boxsep1pt, left2pt,right2pt,top2pt,bottom2pt] \small\textbf{#1}\\% }{% \end{tcolorbox} } \begin{document} \begin{multicols}{2} \begin{formulabox}{二项分布} $X\sim B(n,p)$ 时 \[ P(Xk)\binom{n}{k}p^k(1-p)^{n-k},\quad E(X)np,\quad D(X)np(1-p) \] \end{formulabox} \begin{formulabox}{正态分布} $X\sim N(\mu,\sigma^2)$ 时 \[ f(x)\frac{1}{\sqrt{2\pi}\sigma}\exp\left(-\frac{(x-\mu)^2}{2\sigma^2}\right) \] \end{formulabox} \end{multicols} \end{document}这段代码里值得解释的参数有三个。documentclass 的 9pt 是全文基线字号小抄场景下 9pt 最均衡低于 8pt 屏幕上看还行打印出来就太吃力geometry 的 margin1.1cm 配合两栏正好在 A4 纸宽度内放下约 90 个字符宽的行公式不会被截断columnsep 控制两栏间距12pt 不会让相邻栏的公式视觉粘连。formulabox 环境把 tcolorbox 封装成带标题的小盒子colbackgray!8 是 8% 灰度的浅底黑白打印时既保留分区感又不浪费墨粉。注意盒子里公式用了 display 样式而不是行内 $- 括号分式上下标在打印时才能看得清。编译时用 xelatexxelatex formula.tex如果在 Ubuntu 上缺中文字体先装 fonts-noto-cjk 再编译。xeCJK 只对中文生效数学公式里的字母仍由 LaTeX 主字体渲染两者不冲突。3.3 三个关键排版参数栏宽、段距与盒子间隔模板搭好后真正决定小抄好不好用的是下面三个参数调它们比换模板更快参数位置作用推荐起点\columnsepmulticol 环境中两栏间隙控制视觉密度10pt~14pt\parskip全局或局部盒子之间垂直间距太大会浪费页面3pt~6ptboxseptcolorbox 选项盒子内边距影响公式与边框距离1pt~2pt调整逻辑很简单先固定 columnsep让小抄正文不拥挤再调 parskip避免上下盒子粘连页面上应能看出清晰的模块边界最后 boxsep 收窄给公式呼吸空间而不浪费页宽。还要注意 multicol 环境不允许在盒子之间直接插空行否则 LaTeX 报错用 \vspace{4pt} 控制即可。到这里版式问题基本解决接下来的一条路是 Markdown 到 PDF。4. 用 Pandoc 把公式速查表转成 PDF命令与踩坑4.1 从 Markdown 到 PDF 的最小命令LaTeX 路线适合一次性产出但很多人的公式笔记早就写在 Markdown 里了。复制到 LaTeX 是重复劳动直接用 Pandoc 转换更省事。前提是系统里已经有 xelatex 和 Pandoc然后一条命令就能把 Markdown 里的块级公式转成 PDFpandoc formula.md -o formula.pdf \ --pdf-enginexelatex \ -V CJKmainfontNoto Serif CJK SC \ -V geometry:margin1.2cm \ -V fontsize9pt \ -V colorlinkstrue这条命令的核心是把公式源文档交给 xelatex 引擎处理Markdown 里的 $$...$$ 会被原样翻译为 LaTeX 块级公式矩阵、分式、求和符号都能保留。CJKmainfont 指定中文字体不设置的话标题和注释汉字会全部消失geometry:margin 控制页边距速查场景取 1.2cm 左右fontsize 控制全局字号和 LaTeX 模板里的 9pt 对应。colorlinks 让 PDF 内的链接显示为彩色文字而不是花哨的边框打印时更干净。转换命令比起 LaTeX 模板的优点是模板由 Pandoc 的默认格式自动生成不必维护 preamble。4.2 长公式超宽与换页的三个处理参数Pandoc 转 PDF 最常见的失败场景是公式太长溢出栏宽。此时要改的不是 Pandoc 参数而是公式写法。我的经验是分三步处理## 第一步把长分式拆成 aligned 环境手动指定换行点 $$ \begin{aligned} P(Xk) \binom{n}{k}p^k(1-p)^{n-k} \\ \binom{n}{k}p^k(1-p)^{n-k},\quad k0,1,\dots,n \end{aligned} $$ ## 第二步行内分数改用斜杠形式例如 (x-\mu)^2/2\sigma^2 ## 第三步给 display 公式前面留出 \small 空间或把该公式移入 tcolorboxaligned 环境里用 \ 控制换行位置用 对齐等号这是最可控的长公式方案。行内公式中的 \frac{a}{b} 在 9pt 下印刷偏小写作 a/b 更清晰代价是可读性稍降小抄场景下值得。第三步说的 tcolorbox 在 Pandoc 里无法直接用可以退而求其次用 Markdown 引用块或水平分隔线把公式群分组Pandoc 会渲染为 LaTeX 的 quote 环境视觉上虽没有灰底但段落边界还是清楚的。如果公式群本身太长跨页时要注意 Markdown 里的块级公式不会被拆开。我的习惯是给每类统计量单独开二级标题让标题成为天然的拆页点并给 Pandoc 加上目录参数pandoc formula.md -o formula.pdf \ --pdf-enginexelatex \ --toc --toc-depth2 \ -V CJKmainfontNoto Serif CJK SC加完 --toc 后每章开头自动生成目录PDF 阅读器侧边栏也会带出书签导航公式再多也能两秒定位到「区间估计」。4.3 中文字体与数学字体的衔接Pandoc 转 PDF 的中文问题集中在字体上。xelatex 下 CJKmainfont 必须指向系统实际存在的字体名设置成「宋体」在大多数 Linux 环境会报错。先用这条命令查fc-list :langzh | head -10输出里能看到当前系统中文字体的完整名称拿到名字再填进 -V CJKmainfont 参数就能编译过。另一个坑是 xelatex 引擎不认识 Winfonts 这类 Windows 字体目录必须确认字体已安装到 fontconfig 管理的目录下。数学公式里的拉丁字母默认用 LaTeX 的 Computer Modern 渲染和中文黑体混排时粗细差异明显但小抄场景不用纠结可读性已达标。若想统一视觉可以把主字体一并换成思源黑体-V mainfontNoto Sans CJK SC注意此时数学字体仍由 amsmath 层控制mainfont 只影响普通文字。这套组合在 ARM 架构的 Mac 和 x86 的 Ubuntu 上都稳定是我现在的默认配置。5. 把速查 PDF 变成随时能查的检索工具5.1 书签层级与目录深度让 PDF 侧边栏能跳转生成之后还要确认这份 PDF 在阅读器里可以像文档一样浏览。LaTeX 路线默认通过 hyperref 生成书签Pandoc 路线需要显式加 --toc --toc-depth2。我把书签深度固定在 2 级一级是四大模块名二级是具体分布名。这样侧边栏展开后第一眼看到“抽样分布”展开就是“正态总体置信区间”“卡方检验公式”点击直达比翻页面快一个数量级。用 LaTeX 时注意 hyperref 的 bookmarksnumbered 参数会自动给书签加编号速度表里我会关掉它避免“1.1 二项分布”和“2.1 二项分布”这种编号歧义。5.2 用 pdftotext 验证公式是否可检索很多人的速查 PDF 是截图拼出来的图片里的公式在阅读器里搜不到。验证一份 PDF 是否真正可检索用 pdftotext 提取一次文本就知道了pdftotext formula.pdf - | grep -n 泊松 | head -5能搜出“泊松”这类汉字说明文字层存在。数学公式不必追求全部可检索但分布名称、参数符号这些关键索引必须留在文本层。还有个更实用的检查是反向搜公式在 PDF 阅读器里按 CtrlF 输入“t_{0.025}”如果能直接命中说明 LaTeX 生成的公式文本被正确嵌入而不是渲染成了无文本层的图形。打印前把 PDF 缩放到 70% 预览一遍确认 9pt 字号下分母、上下标不糊若要省墨把 tcolorbox 的 colback 改成 white边框保留即可黑白打印依然分得清模块。最后一个技巧是把这份 PDF 的命名规范化例如 probability_formulas_cheatsheet.pdf放进个人知识库后配合全文检索工具能随时调出不要用“最终版”“新建文档”这类文件名否则三个月后再找又是另一场翻箱倒柜。考试复习前一天把这份 PDF 从头到尾默写式过一遍能写出来的公式删掉写不出来的标红直到整份文档只剩红色标记——那时候它才算真正变成了你自己的“小抄必备”。本文还有配套的精品资源点击获取