输入输出表

代数基础

shū rù shū chū biǎo

输入输出表展示一条规则或函数如何把输入值转化为输出值,每个输入恰好对应一个输出。

Definition

输入输出表展示了把一条规则应用到不同输入后得到的结果:每个输入恰好对应一个输出,就像把一个数字投进一台机器,得到一个确定的数字出来。它把自变量(输入/$x$)的值与遵循同一规则所对应的因变量(输出/$y$)的值并列组织起来;而从表中识别出这条规则,通过注意到差值恒定意味着是一次关系、二阶差值恒定意味着是二次关系,正是寻找规律或函数的过程。严格地说,输入输出表是函数 $f: X \to Y$ 的一个有限表示,列出定义域中所选子集对应的 $(x_i, f(x_i))$;在计算机科学中,这样的表对应于查找表或真值表,而从有限样本中确定函数是一个逆问题,在没有额外约束的情况下通常是欠定的。

Example

规则:"乘以 $3$ 再加 $1$"。输入 $2$ 得到输出 $7$;输入 $5$ 得到输出 $16$;输入 $0$ 得到输出 $1$。给定输入 $1$、$2$、$3$、$4$ 和输出 $5$、$8$、$11$、$14$,相邻输出之间的差值都是 $3$,暗示规则是 $y = 3x + 2$,验证可知 $3(1) + 2 = 5$,$3(2) + 2 = 8$,都成立。给定一个未知多项式的 $4$ 组输入输出对,根据拉格朗日插值,最多可以唯一确定一个次数为 $3$ 的多项式;更多的数对要么验证了这个多项式,要么会揭示出更高次的结构。

Key Insight

可以把规则想象成一台机器:投入一个数,机器完成它的工作,输出一个确定的数。输出列中差值恒定表明规则是一次的,二阶差值恒定表明规则是二次的,这些规律能加快识别方程的速度。机器学习中的过拟合是选择一个高次多项式去完美拟合一张小数据表这一做法的现代类比;偏好能拟合数据的最简单解释,即最低次数或最少参数,是奥卡姆剃刀原则的一种统计学形式。