4  导数、微分与局部线性化

本章学习后,应能从差商极限判断可导性,说明导数与微分的等价关系,正确使用乘积法则、链式法则和反函数求导法则;能区分函数增量与微分、导数存在与导数连续,并用局部线性化解释一个标量模型的敏感性。先修知识为第2章的极限运算和第3章的函数极限、连续性、小量记号。涉及误差的定量上界将在第5章继续讨论。

4.1 从平均变化率到导数

设输入量由\(x_0\)变为\(x_0+h\),输出量由\(f(x_0)\)变为\(f(x_0+h)\)。当\(h\ne0\)时,差商 \[\frac{f(x_0+h)-f(x_0)}{h}\] 刻画这段输入变化上的平均变化率。它依赖步长\(h\),并非点\(x_0\)处的固有量。只有当\(h\)从不同方向、沿任意趋于零的方式变化时,差商都趋于同一个有限值,才能把这一极限作为该点的瞬时变化率。

定义 4.1 (导数与单侧导数). 设\(f\)在\(x_0\)的某邻域内有定义。若有限极限 \[\begin{equation} \label{eq:04-derivative} f'(x_0)=\lim_{h\to0}\frac{f(x_0+h)-f(x_0)}{h} \end{equation}\] 存在,则称\(f\)在\(x_0\)可导。分别将\(h\to0\)限制为\(h\to0^-\)和\(h\to0^+\),所得有限极限称为左导数\(f'_-(x_0)\)和右导数\(f'_+(x_0)\)。在区间端点,只讨论定义域允许方向上的单侧导数。

定义中的有限性不可省略。例如\(x^{1/3}\)在零点的差商为\(h^{-2/3}\),趋于\(+\infty\)。此时图形有竖直切线,但按本书约定不存在有限导数。导函数\(f'\)以所有可导点为定义域,把点\(x\)对应到数值\(f'(x)\);\(f'(x_0)\)是数,\(f'\)则是函数。

命题 4.2 (单侧判别与连续性). 函数\(f\)在内点\(x_0\)可导,当且仅当左右导数都存在且相等。若\(f\)在\(x_0\)可导,则\(f\)在\(x_0\)连续。

证明. Proof. 第一条就是两侧极限存在的判别准则。对于第二条,\(h\ne0\)时有 \[f(x_0+h)-f(x_0) =h\frac{f(x_0+h)-f(x_0)}{h}.\] 右侧两个因子分别趋于\(0\)和有限数\(f'(x_0)\),故函数增量趋于零,得到连续性。 ◻

例 4.3 (用定义求导与解释切线). 设\(f(x)=1/x\),\(x_0\ne0\)。当\(h\)足够小且\(h\ne0\)时, \[\frac{f(x_0+h)-f(x_0)}h =\frac{1}{h}\left(\frac1{x_0+h}-\frac1{x_0}\right) =-\frac1{x_0(x_0+h)}\longrightarrow-\frac1{x_0^2}.\] 于是曲线\(y=1/x\)在点\((x_0,1/x_0)\)的切线为 \[y=\frac1{x_0}-\frac1{x_0^2}(x-x_0).\] 这里的代数约分只对非零\(h\)进行,取极限后才得到导数。差商在\(h=0\)无定义,并不妨碍极限存在。

例 4.4 (绝对值与分段连接). 对\(f(x)=|x|\),在零点的差商是\(|h|/h\),故\(f'_-(0)=-1\)、\(f'_+(0)=1\),函数连续但不可导。进一步考虑 \[g(x)=\begin{cases}x^2+1,&x\le1,\\ ax+b,&x>1.\end{cases}\] 若要求\(g\)在\(1\)处可导,必须先满足连续条件\(a+b=2\);再由左导数\(2\)与右导数\(a\)相等,得到\(a=2,b=0\)。若跳过连续条件而仅把两段表达式求导后相等,就会遗漏对函数值连接方式的要求。

图4.1把尖点与水平切线并列。两者在原点都没有明显的竖直跳跃,但差商的行为不同;图形只能帮助提出判断,判断本身仍须依赖极限。

连续性不能区分尖点与可导的水平切线

4.2 微分是增量的线性主部

平均变化率着眼于两个输出之差,微分则直接描述函数增量的结构。以下定义把”用直线局部代替曲线”写成可以检验的数学命题。

定义 4.5 (一元函数可微). 若存在一个与\(h\)无关的实数\(A\),使 \[\begin{equation} \label{eq:04-differentiable} f(x_0+h)-f(x_0)=Ah+r(h),\qquad \lim_{h\to0}\frac{r(h)}{|h|}=0, \end{equation}\] 则称\(f\)在\(x_0\)可微。线性函数\(h\mapsto Ah\)称为\(f\)在\(x_0\)的微分,记作\(\mathop{}\!\mathrm{d}f(x_0)=A\mathop{}\!\mathrm{d}x\),其中\(\mathop{}\!\mathrm{d}x=h\)。

定理 4.6 (一元可导与可微的等价性). 一元函数\(f\)在内点\(x_0\)可微,当且仅当它在\(x_0\)可导;此时式[eq:04-differentiable]中的\(A\)唯一,且\(A=f'(x_0)\)。

证明. Proof. 若可微,把式[eq:04-differentiable]除以\(h\ne0\),由于 \(|r(h)/h|=|r(h)|/|h|\to0\),差商趋于\(A\)。反之,若导数存在,令 \[r(h)=f(x_0+h)-f(x_0)-f'(x_0)h.\] 则\(|r(h)|/|h|\)等于差商与\(f'(x_0)\)之差的绝对值,趋于零。若有两个线性主部\(Ah\)与\(Bh\),两种表达式相减得到\((A-B)h=o(|h|)\);除以\(h\)并取极限即有\(A=B\)。 ◻

因此,可导性不仅给出一个斜率,还给出 \[f(x_0+h)=f(x_0)+f'(x_0)h+o(|h|).\] 小量\(o(|h|)\)说明误差与\(|h|\)相比可以任意小,却没有给出某个有限步长上的具体误差数值。另需注意:只有\(f'(x_0)\ne0\)时,才有\(\Delta f\sim\mathop{}\!\mathrm{d}f\)。若\(f'(x_0)=0\),微分恒为零,不能把它放在等价无穷小的分母中。

例 4.7 (增量与微分的差别). 对\(f(x)=x^3\),在\(x_0=2\)处有 \[\Delta f=(2+h)^3-8=12h+6h^2+h^3, \qquad \mathop{}\!\mathrm{d}f=12h.\] 当\(h=0.01\)时,微分为\(0.12\),实际增量为\(0.120601\),误差为\(0.000601\)。误差由两项高次幂构成,所以相对于\(|h|\)趋于零。若改在\(x_0=0\)处,\(\mathop{}\!\mathrm{d}f=0\)而\(\Delta f=h^3\),这仍然是一个正确的线性近似,只是必须由更高阶项描述非零变化。

例 4.8 (平方根的局部近似与精确余差). 用\(f(x)=\sqrt{x}\)在\(x_0=9\)处的线性化估计\(\sqrt{9.06}\)。导数\(f'(9)=1/6\),于是 \[\sqrt{9.06}\approx3+\frac{0.06}{6}=3.01.\] 这个例子还可以通过有理化得到误差的精确形式。令\(h>-9\),则 \[\sqrt{9+h}-3-\frac h6 =-\frac{h^2}{6(\sqrt{9+h}+3)^2}.\] 因此当\(h=0.06\)时近似值略偏大,绝对误差小于\(h^2/216<1.67\times10^{-5}\)。这里的误差上界来自额外的代数恒等式,不能仅从符号\(o(h)\)直接读出。

等式\(\mathop{}\!\mathrm{d}y=f'(x)\mathop{}\!\mathrm{d}x\)描述增量的线性主部,\(\Delta y=f'(x)\Delta x\)一般不是精确恒等式。符号\(\mathop{}\!\mathrm{d}y/\mathop{}\!\mathrm{d}x\)可用来表示导数,但求导法则的依据仍是极限;进行变量替换时,必须检查函数可导性与分母是否为零。

4.3 导数的运算法则与基本函数

定理 4.9 (线性、乘积与商法则). 设\(f,g\)在\(x_0\)可导,\(\alpha,\beta\)为常数,则\(\alpha f+\beta g\)与\(fg\)在\(x_0\)可导,且 \[(\alpha f+\beta g)'(x_0)=\alpha f'(x_0)+\beta g'(x_0),\] \[(fg)'(x_0)=f'(x_0)g(x_0)+f(x_0)g'(x_0).\] 若另有\(g(x_0)\ne0\),则\(f/g\)在\(x_0\)某邻域有定义并可导, \[\left(\frac fg\right)'(x_0) =\frac{f'(x_0)g(x_0)-f(x_0)g'(x_0)}{g(x_0)^2}.\]

证明. Proof. 线性法则由极限的线性性质得到。乘积的增量可写成 \[\begin{align*} f(x_0+h)g(x_0+h)-f(x_0)g(x_0) ={}&[f(x_0+h)-f(x_0)]g(x_0+h)\\ &+f(x_0)[g(x_0+h)-g(x_0)]. \end{align*}\] 除以\(h\)后利用\(g\)在\(x_0\)连续,就得到乘积法则。由\(g(x_0)\ne0\)与连续性,\(g\)在充分小的邻域不为零,且 \[\frac{g(x_0+h)^{-1}-g(x_0)^{-1}}h =-\frac{[g(x_0+h)-g(x_0)]/h}{g(x_0+h)g(x_0)} \longrightarrow-\frac{g'(x_0)}{g(x_0)^2}.\] 再对\(f\cdot(1/g)\)使用乘积法则即得商法则。 ◻

基本导数公式既是后续计算的工具,也应能追溯到极限。例如 \[\frac{\sin(x+h)-\sin x}{h} =\sin x\frac{\cos h-1}{h}+\cos x\frac{\sin h}{h} \longrightarrow\cos x.\] 这里使用了\(\sin h/h\to1\)与\((\cos h-1)/h\to0\)。对指数函数,可由其基本极限\((e^h-1)/h\to1\)得到\((e^x)'=e^x\)。表4.1中的公式均在所列定义域的内点使用。

常用基本导数及实数定义域 {#tab:04-basic}
函数 导数 本表使用的定义域
\(x^m\),\(m\in\mathbb{N}\), \(m\ge1\) \(mx^{m-1}\) \(\mathbb{R}\)
\(x^\alpha\),\(\alpha\in\mathbb{R}\) \(\alpha x^{\alpha-1}\) \((0,+\infty)\)
\(a^x\),\(a>0\) \(a^x\ln a\) \(\mathbb{R}\)
\(\ln x\) \(1/x\) \((0,+\infty)\)
\(\sin x,\ \cos x\) \(\cos x,\ -\sin x\) \(\mathbb{R}\)
\(\tan x\) \(1/\cos^2x\) \(\cos x\ne0\)的开区间
\(\arctan x\) \(1/(1+x^2)\) \(\mathbb{R}\)

例 4.10 (先整理结构再求导). 设\(f(x)=x^2e^x/(1+x)\),\(x\ne-1\)。先把分子视为一个乘积,有 \[(x^2e^x)'=e^x(x^2+2x).\] 然后使用商法则, \[\begin{align*} f'(x) &=\frac{e^x(x^2+2x)(1+x)-x^2e^x}{(1+x)^2}\\ &=\frac{e^x x(x^2+2x+2)}{(1+x)^2}. \end{align*}\] 约简后的表达式便于检查导数的零点与符号。分母的平方不能删除:它既来自商法则,也保留了原函数在\(x=-1\)处无定义的事实。

4.4 链式法则、反函数与参数曲线

复合函数的变化经过中间变量传递。例如先把输入\(x\)变为\(u=g(x)\),再把\(u\)变为\(y=f(u)\)。链式法则表明,在可导条件下,这两段局部变化率相乘。

定理 4.11 (一元链式法则). 设\(g\)在\(x_0\)可导,\(f\)在\(u_0=g(x_0)\)可导,且复合函数\(f\circ g\)在\(x_0\)的某邻域有定义,则 \[(f\circ g)'(x_0)=f'(g(x_0))g'(x_0).\]

证明. Proof. 令\(k=g(x_0+h)-g(x_0)\)。由\(g\)可导,有\(k=g'(x_0)h+o(|h|)\),从而\(k=O(|h|)\)。由\(f\)可导,可选函数\(\varepsilon(k)\to0\)并规定\(\varepsilon(0)=0\),使 \[f(u_0+k)-f(u_0)=f'(u_0)k+\varepsilon(k)k.\] 代入\(k\)的表达式,第一项等于\(f'(u_0)g'(x_0)h+o(|h|)\),第二项也是\(o(|h|)\)。再由可微与可导等价性得到结论。这一证明容许某些非零\(h\)使\(k=0\),无需除以可能为零的中间增量。 ◻

例 4.12 (嵌套函数与变指数函数). 对\(y=\ln(1+e^{2x})\),按”外层对数、中层加法、内层指数”依次求导,得到 \[y'=\frac{1}{1+e^{2x}}\cdot e^{2x}\cdot2 =\frac{2e^{2x}}{1+e^{2x}}.\] 对\(y=x^x\),必须先要求\(x>0\),再写成\(y=e^{x\ln x}\),于是 \[y'=x^x(\ln x+1).\] 不能把\(x^x\)当成常指数幂函数;指数和底数同时变化,求导时两种变化都要保留。

定理 4.13 (反函数求导). 设\(f\)在开区间\(I\)连续且严格单调,\(x_0\in I\),\(f\)在\(x_0\)可导且\(f'(x_0)\ne0\)。记\(J=f(I)\),则反函数\(g=f^{-1}\)在\(y_0=f(x_0)\)可导,且 \[g'(y_0)=\frac1{f'(x_0)}.\]

证明. Proof. 连续严格单调函数的反函数在\(J\)连续。因此\(y\to y_0\)时,\(x=g(y)\to x_0\);当\(y\ne y_0\)时也有\(x\ne x_0\)。于是 \[\frac{g(y)-g(y_0)}{y-y_0} =\frac{x-x_0}{f(x)-f(x_0)} \longrightarrow\frac1{f'(x_0)}.\] 非零导数条件保证倒数极限为有限值。 ◻

取\(f(x)=e^x\)即可得到\((\ln y)'=1/y\)。取\(f(x)=\tan x\)并限制在\((-\pi/2,\pi/2)\),可得\((\arctan y)'=1/(1+y^2)\)。严格单调条件为选定反函数的单值分支提供依据,不能仅凭一个形式上的等式\(y=f(x)\)任意交换变量。

例 4.14 (参数表达的斜率). 曲线由\(x=t^2+1\)、\(y=t^3-t\)给出。在\(t>0\)的区间内,\(x\)随\(t\)严格增加,且\(\mathop{}\!\mathrm{d}x/\mathop{}\!\mathrm{d}t=2t\ne0\),所以 \[\frac{\mathop{}\!\mathrm{d}y}{\mathop{}\!\mathrm{d}x}=\frac{3t^2-1}{2t}.\] 在\(t=1\)处点坐标为\((2,0)\),切线斜率为\(1\),切线方程为\(y=x-2\)。在\(t=0\)处上述商式无定义,必须另行检查曲线几何或选择合适参数区间,不能把除以零的表达式当成导数。

4.5 高阶导数与标量模型的敏感性

4.5.1 高阶导数与光滑性层次

若\(f'\)在\(x_0\)可导,称\(f''(x_0)=(f')'(x_0)\)为二阶导数。递推定义\(f^{(n)}=(f^{(n-1)})'\)。记\(f\in C^n(I)\),表示\(f\)在区间\(I\)上具有直到\(n\)阶的连续导数。\(n\)阶可导与属于\(C^n\)是不同要求;后者还要求最高阶导数连续。

命题 4.15 (Leibniz公式). 若\(f,g\)在开区间\(I\)上\(n\)阶可导,\(n\ge1\),则 \[(fg)^{(n)}=\sum_{k=0}^{n}\binom nk f^{(k)}g^{(n-k)}, \qquad f^{(0)}=f,\quad g^{(0)}=g.\]

证明. Proof. \(n=1\)时是乘积法则。假定对\(n\)成立,对和式逐项求导,得到 \[\sum_{k=0}^{n}\binom nk f^{(k+1)}g^{(n-k)} +\sum_{k=0}^{n}\binom nk f^{(k)}g^{(n+1-k)}.\] 把第一项的指标平移后,同类项系数由 \(\binom n{k-1}+\binom nk=\binom{n+1}k\)合并,端点两项的系数均为\(1\),即得\(n+1\)阶公式。 ◻

例 4.16 (可导但导数不连续). 定义 \[f(x)=\begin{cases}x^2\sin(1/x),&x\ne0,\\0,&x=0.\end{cases}\] 在零点,\([f(h)-f(0)]/h=h\sin(1/h)\to0\),故\(f'(0)=0\)。非零点求导得到 \[f'(x)=2x\sin(1/x)-\cos(1/x).\] 沿\(x_n=1/(2n\pi)\)有\(f'(x_n)=-1\);沿\(y_n=1/((2n+1)\pi)\)有\(f'(y_n)=1\)。因此\(f'\)在零点不连续。已知\(f'(0)\)存在,只控制以零点为固定基点的差商,不能直接推出附近各点的导数趋于\(f'(0)\)。

对复合函数\(y=f(u(x))\),二阶导数为 \[\frac{\mathop{}\!\mathrm{d}^2y}{\mathop{}\!\mathrm{d}x^2} =f''(u(x))[u'(x)]^2+f'(u(x))u''(x).\] 这说明二阶运算包含中间变量自身的曲率。一阶关系\(\mathop{}\!\mathrm{d}y=f'(u)\mathop{}\!\mathrm{d}u\)具有相同的形式,但在高阶计算中不能忽略\(u''\)项。

4.5.2 绝对敏感性、相对敏感性与模型尺度

考虑一个固定参数的标量映射\(y=f(x)\)。在\(x_0\)可导时,小输入误差\(h\)引起的输出误差满足 \[|\Delta y|=|f'(x_0)h+o(|h|)|.\] 因此\(|f'(x_0)|\)是局部绝对敏感性的指标。若\(x_0\ne0\)且\(f(x_0)\ne0\),还可比较相对误差: \[\frac{\Delta y}{f(x_0)} =\frac{x_0f'(x_0)}{f(x_0)}\frac h{x_0} +o\!\left(\left|\frac h{x_0}\right|\right).\] 绝对值\(\kappa(x_0)=|x_0f'(x_0)/f(x_0)|\)称为该标量映射在\(x_0\)的相对条件数。它依赖问题的输入输出表示;输出接近零时,相对误差本身可能不适合描述问题。

例 4.17 (输出很小时的误差放大). 设\(f(x)=\ln x\),\(x>0\),则\(f'(x)=1/x\)。在\(x_0\ne1\)处, \[\kappa(x_0)=\frac1{|\ln x_0|}.\] 当\(x_0\)接近\(1\)时,绝对敏感性\(1/x_0\)约为\(1\),相对条件数却很大。这不是同一指标的矛盾:\(\ln x_0\)接近零,使得很小的绝对输出变化也可能占原输出的较大比例。在报告数值结果时,应先说明比较的是绝对误差还是相对误差。

平滑标量函数\(s(z)=1/(1+e^{-z})\)常用来压缩输入范围。由链式法则, \[s'(z)=\frac{e^{-z}}{(1+e^{-z})^2}=s(z)[1-s(z)].\] 由于\(0<s(z)<1\),恒有\(0<s'(z)\le1/4\),等号在\(z=0\)处成立。大绝对值输入对应较小导数,局部输入变化传到输出后被减弱。此处\(s\)只作为确定性函数使用,不需要概率解释。对\(r(z)=\max\{0,z\}\),左右导数在零点不相等,故零点处不存在普通导数;软件为该点指定的计算约定不改变这个数学事实。

若将两个可导标量函数连续复合,链式法则给出局部增益的乘积。若每层增益绝对值都至多\(1/4\),深度为\(m\)的纯标量复合在相应点的导数绝对值至多\(4^{-m}\)。这一结论仅针对所述复合结构;一般模型还含权重、求和和其他运算,应对完整表达式求导,不能仅凭一个激活函数的导数推断整个模型的敏感性。

4.6 分层习题

基础题

  1. 用导数定义求\(f(x)=x^2+3x\)在任意\(x_0\)处的导数,并写出\(x_0=-1\)处的切线方程。

  2. 设\(f\)在\(x_0\)可导,计算 \[\lim_{h\to0}\frac{f(x_0+2h)-f(x_0-h)}h.\]

  3. 设\(f(x)=e^x\)(\(x\le0\)),\(f(x)=ax+b\)(\(x>0\))。确定使\(f\)在零点可导的\(a,b\)。

  4. 求下列函数的导数,并注明定义域限制:\(\ln(1+x^2)\),\(x^{\sin x}\),\(\arctan(e^x)\)。

  5. 用微分估计\(\sqrt{16.08}\),并通过有理化确定近似值偏大还是偏小。

  6. 已知\(x=t+e^t\)、\(y=t^2\),求\(t=0\)处的\(\mathop{}\!\mathrm{d}y/\mathop{}\!\mathrm{d}x\)和\(\mathop{}\!\mathrm{d}^2y/\mathop{}\!\mathrm{d}x^2\)。

推理题

  1. 设\(f\)在零点可导且为偶函数,证明\(f'(0)=0\)。若\(f\)为奇函数,零点导数是否必须为零?给出依据。

  2. 设\(\alpha>0\),\(f_\alpha(0)=0\),\(f_\alpha(x)=|x|^\alpha\sin(1/x)\)(\(x\ne0\))。判断哪些\(\alpha\)使\(f_\alpha\)在零点可导,并证明结论。

  3. 设\(f\)在\(x_0\)可导且\(f(x_0)=0\)。证明\(|f|\)在\(x_0\)可导当且仅当\(f'(x_0)=0\)。

  4. 利用Leibniz公式求\((x^2e^x)^{(n)}\),其中\(n\ge2\);再直接计算\(n=2\)检验所得公式。

拓展题

  1. 设\(s(z)=1/(1+e^{-z})\),\(q(x)=s(3s(2x)-1)\)。求\(q'(x)\),给出其绝对值的一个全局上界,并说明为什么不能直接采用\(1/16\)作为上界。

  2. 对\(f(x)=x^p\)(\(x>0,p\ne0\))计算相对条件数。若输出由\(f(x)\)改为\(f(x)-1\),讨论\(x\)接近\(1\)时相对条件数的变化,并解释原因。

4.7 知识回顾与选题解答

本章的逻辑起点是差商极限。一元函数可导等价于增量存在唯一的线性主部,因而可导必连续。运算法则把复杂表达式的求导归约为基本函数求导,其中链式法则负责连接中间变量,反函数法则负责交换局部输入与输出。高阶导数反映一阶变化率如何继续变化;敏感性分析则把导数用于比较输入扰动与输出扰动。任何局部近似都应保留适用点、定义域及余项含义。

第2题

拆分分子并分别除以相应步长,有 \[\frac{f(x_0+2h)-f(x_0)}{2h}\,2 +\frac{f(x_0)-f(x_0-h)}{h}.\] 第一项趋于\(2f'(x_0)\)。第二项等于 \([f(x_0-h)-f(x_0)]/(-h)\),趋于\(f'(x_0)\),故答案为\(3f'(x_0)\)。

第3题

由连续性得\(b=f(0)=1\)。左导数为\(1\),右导数为\(a\),所以\(a=b=1\)。反过来代入这组参数,两侧差商极限确实同为\(1\),故条件也是充分的。

第4题

三个结果依次为 \[\frac{2x}{1+x^2},\qquad x^{\sin x}\left(\cos x\ln x+\frac{\sin x}{x}\right), \qquad \frac{e^x}{1+e^{2x}}.\] 第一、三个函数在\(\mathbb{R}\)上有定义并可导;第二个按实数幂的标准定义限制\(x>0\),先改写为\(e^{\sin x\ln x}\)再求导。

第6题

由于\(x'(t)=1+e^t>0\),参数到\(x\)的局部反解存在。先有 \[\frac{\mathop{}\!\mathrm{d}y}{\mathop{}\!\mathrm{d}x}=\frac{2t}{1+e^t}.\] 再对\(t\)求导并除以\(x'(t)\), \[\frac{\mathop{}\!\mathrm{d}^2y}{\mathop{}\!\mathrm{d}x^2} =\frac{2(1+e^t)-2te^t}{(1+e^t)^3}.\] 在\(t=0\)处,两者分别为\(0\)和\(1/2\)。

第7题

偶函数满足\(f(h)=f(-h)\)。令\(h\to0^+\),右差商与左差商互为相反数,而可导性要求它们趋于同一个数,故\(f'(0)=-f'(0)=0\)。奇函数无需满足这一结论,例如\(f(x)=x\)是奇函数且\(f'(0)=1\)。

第8题

若\(\alpha>1\),差商的绝对值不超过\(|h|^{\alpha-1}\),由夹逼准则得到\(f_\alpha'(0)=0\)。若\(0<\alpha\le1\),取正数列 \[h_n=(2n\pi+\pi/2)^{-1},\qquad k_n=(n\pi)^{-1}.\] 沿\(k_n\)的差商为零;沿\(h_n\)的差商为\(h_n^{\alpha-1}\),当\(\alpha=1\)时为\(1\),当\(\alpha<1\)时趋于\(+\infty\)。故差商不存在有限极限,结论为恰在\(\alpha>1\)时可导。

第9题

若\(f'(x_0)=0\)且\(f(x_0)=0\),则\(f(x_0+h)=o(|h|)\),所以\(|f(x_0+h)|=o(|h|)\),\(|f|\)的导数为零。反之,设\(|f|\)可导。对\(h>0\),其差商非负;对\(h<0\),其差商非正,故共同极限只能为零。于是 \(|f(x_0+h)|/|h|\to0\),结合\(f\)可导便得\(|f'(x_0)|=0\)。

第10、11题

第10题中\(x^2\)的三阶及以上导数为零,故 \[(x^2e^x)^{(n)}=e^x[x^2+2nx+n(n-1)].\] \(n=2\)时为\(e^x(x^2+4x+2)\),与连续两次使用乘积法则一致。第11题中 \[q'(x)=6s'(3s(2x)-1)s'(2x), \qquad |q'(x)|\le\frac6{16}=\frac38.\] 两个内部仿射变换分别贡献因子\(3\)与\(2\),遗漏它们便会得到错误上界。