16=1.5+4c是3÷x=1.5的方程怎么解吗?

第三章 一元一次方程;1.(3分)下列各式中,不是方程的是( ) A.2x+3y=1 B.-x+y=4 C.3π+4≠5 D.x=8;C ;3.(3分)下列各式:①2x=1;②x=y;③-3-3=-6;④x+3x;⑤x-1=2x-3,其中一元一次方程有( ) A.1个 B.2个 C.3个 D.4个 4.(4分)如果方程-3x2-m+2=0是一元一次方程,则m=____.;5.(3分)下列方程中,解为x=-2的是( ) A.3x-2=2x B.4x-1=3 C.2x+1=x-1 D.x-4=0;6.(3分)整式mx+2n的值随x的取值不同而不同,下表是当x取不同值时对应的整式的值,则关于x的方程mx+2n+2=0的解为( ) A.-1 B.-2 C.0 D.无法计算;0 ;B ;9.(4分)挖一条1 210米长的水渠,由甲、乙两队从两头同时施工,甲队每天挖130米,乙队每天挖90米,需几天才能挖好?设需用x天才能挖好,由题意可列方程为_________________________.;;11.如果m=5,那么4(x+3)=m(x+3)的解是( ) A.x=0 B.x=3 C.x=-3 14.(易错题)已知方程(a-2)x|a|-1+4=0是关于x的一元一次方程,则a的值为______.;15.先列方程,再估算出方程的解. 甲型钢笔每支3元,乙型钢笔每支5元,用40元钱买了两种钢笔共10支,还多2元,问:两种钢笔各买了多少支? 解:设买了甲型钢笔x支,则买了乙型钢笔_________支,依题意列方程:________________________. 这里x>0,列表计算: 从表中看出,x=____是原方程的解.;17.(10分)根据题意列出方程: (1)《文摘报》每份0.5元,《信息报》每份0.4元,小刚用7元钱买了两种报纸共15份,他买的两种报纸各多少份? (2)水上公园某一天共售出门票128张,收入912元,门票价格为成人每张10元,学生可享受六折优惠.这一天出售的成人票与学生票各多少张?(只列方程) 解:(1)设买《文摘报》x份,则买《信息报》(15-x)份,根据题意列方程,得0.5x+0.4(15-x)=7 (2)设出售成人票x张,则出售学生票(128-x)张,根据题意列方程,得10x+60%×10×(128-x)=912;【素养提升】 18.(12分)某通讯公司推出两种手机付费方式:甲种方式不交月租费,每通话1分钟付费0.15元;乙种方式需交18元月租费,每通话1分钟付费0.10元.两种方式不足1分钟均按1分钟计算. (1)如果一个月通话x分钟,那么用甲种方式付费应付话费多少元?用乙种方式应付话费多少元? (2)如果求一个月通话多少分钟时两种方式的费用相同,可以列出一个怎样的方程?它是一元一次方程吗? 解:(3)方程两边同时加6,得7x=14;再在两边同时除以7,得x=2 (4)方程两边同时减2x,得x=12;;9.由方程3x-4=1+2x得到3x-2x=1+4,可以理解为方程两边同时( ) A.加上-2x+4

拉格朗日乘子法、KKT条件

SVM的英文全称是Support Vector Machines,我们叫它支持向量机。支持向量机是我们用于分类的一种算法。让我们以一个小故事的形式,开启我们的SVM之旅吧。

在很久以前的情人节,一位大侠要去救他的爱人,但天空中的魔鬼和他玩了一个游戏。

魔鬼在桌子上似乎有规律放了两种颜色的球,说:”你用一根棍分开它们?要求:尽量在放更多球之后,仍然适用。”

然后魔鬼,又在桌上放了更多的球,似乎有一个球站错了阵营。显然,大侠需要对棍做出调整。

SVM就是试图把棍放在最佳位置,好让在棍的两边有尽可能大的间隙。这个间隙就是球到棍的距离。

现在好了,即使魔鬼放了更多的球,棍仍然是一个好的分界线。

魔鬼看到大侠已经学会了一个trick(方法、招式),于是魔鬼给了大侠一个新的挑战。

现在,大侠没有棍可以很好帮他分开两种球了,现在怎么办呢?当然像所有武侠片中一样大侠桌子一拍,球飞到空中。然后,凭借大侠的轻功,大侠抓起一张纸,插到了两种球的中间。

现在,从空中的魔鬼的角度看这些球,这些球看起来像是被一条曲线分开了。

当一个分类问题,数据是线性可分的,也就是用一根棍就可以将两种小球分开的时候,我们只要将棍的位置放在让小球距离棍的距离最大化的位置即可,寻找这个最大间隔的过程,就叫做最优化。但是,现实往往是很残酷的,一般的数据是线性不可分的,也就是找不到一个棍将两种小球很好的分类。这个时候,我们就需要像大侠一样,将小球拍起,用一张纸代替小棍将小球进行分类。想要让数据飞起,我们需要的东西就是核函数(kernel),用于切分小球的纸,就是超平面。

也许这个时候,你还是似懂非懂,没关系。根据刚才的描述,可以看出,问题是从线性可分延伸到线性不可分的。那么,我们就按照这个思路,进行原理性的剖析。

先看下线性可分的二分类问题。

上图中的(a)是已有的数据,红色和蓝色分别代表两个不同的类别。数据显然是线性可分的,但是将两类数据点分开的直线显然不止一条。上图的(b)和(c)分别给出了B、C两种不同的分类方案,其中黑色实线为分界线,术语称为“决策面”。每个决策面对应了一个线性分类器。虽然从分类结果上看,分类器A和分类器B的效果是相同的。但是他们的性能是有差距的,看下图:

在”决策面”不变的情况下,我又添加了一个红点。可以看到,分类器B依然能很好的分类结果,而分类器C则出现了分类错误。显然分类器B的”决策面”放置的位置优于分类器C的”决策面”放置的位置,SVM算法也是这么认为的,它的依据就是分类器B的分类间隔比分类器C的分类间隔大。这里涉及到第一个SVM独有的概念”分类间隔”。在保证决策面方向不变且不会出现错分样本的情况下移动决策面,会在原来的决策面两侧找到两个极限位置(越过该位置就会产生错分现象),如虚线所示。虚线的位置由决策面的方向和距离原决策面最近的几个样本的位置决定。而这两条平行虚线正中间的分界线就是在保持当前决策面方向不变的前提下的最优决策面。两条虚线之间的垂直距离就是这个最优决策面对应的分类间隔。显然每一个可能把数据集正确分开的方向都有一个最优决策面(有些方向无论如何移动决策面的位置也不可能将两类样本完全分开),而不同方向的最优决策面的分类间隔通常是不同的,那个具有“最大间隔”的决策面就是SVM要寻找的最优解。而这个真正的最优解对应的两侧虚线所穿过的样本点,就是SVM中的支持样本点,称为”支持向量”。

求解这个”决策面”的过程,就是最优化。一个最优化问题通常有两个基本的因素:1)目标函数,也就是你希望什么东西的什么指标达到最好;2)优化对象,你期望通过改变哪些因素来使你的目标函数达到最优。在线性SVM算法中,目标函数显然就是那个”分类间隔”,而优化对象则是决策面。所以要对SVM问题进行数学建模,首先要对上述两个对象(”分类间隔”和”决策面”)进行数学描述。按照一般的思维习惯,我们先描述决策面。

数学建模的时候,先在二维空间建模,然后再推广到多维。

我们都知道二维空间下一条直线的方式如下所示:

现在我们做个小小的改变,让原来的x轴变成x1,y轴变成x2。

进一步向量化,用w列向量和x列向量和标量γ进一步向量化:

其中,向量w和x分别为:

这里w1=a,w2=-1。我们都知道,最初的那个直线方程a和b的几何意义,a表示直线的斜率,b表示截距,a决定了直线与x轴正方向的夹角,b决定了直线与y轴交点位置。那么向量化后的直线的w和r的几何意义是什么呢?

在坐标轴上画出直线和向量w:

蓝色的线代表向量w,红色的先代表直线y。我们可以看到向量w和直线的关系为垂直关系。这说明了向量w也控制这直线的方向,只不过是与这个直线的方向是垂直的。标量γ的作用也没有变,依然决定了直线的截距。此时,我们称w为直线的法向量。

二维空间的直线方程已经推导完成,将其推广到n为空间,就变成了超平面方程。(一个超平面,在二维空间的例子就是一个直线)但是它的公式没变,依然是:

我们已经顺利推导出了”决策面”方程,它就是我们的超平面方程,之后,我们统称其为超平面方程。

(2)”分类间隔”方程

现在,我们依然对于一个二维平面的简单例子进行推导。

我们已经知道间隔的大小实际上就是支持向量对应的样本点到决策面的距离的二倍。那么图中的距离d我们怎么求?我们高中都学过,点到直线的距离距离公式如下:

现在,将直线方程扩展到多维,求得我们现在的超平面方程,对公式进行如下变形:

这个d就是”分类间隔”。其中||w||表示w的二范数,求所有元素的平方和,然后再开方。比如对于二维平面:

我们目的是为了找出一个分类效果好的超平面作为分类器。分类器的好坏的评定依据是分类间隔W=2d的大小,即分类间隔W越大,我们认为这个超平面的分类效果越好。此时,求解超平面的问题就变成了求解分类间隔W最大化的为题。W的最大化也就是d最大化的。

看起来,我们已经顺利获得了目标函数的数学形式。但是为了求解w的最大值。我们不得不面对如下问题:

  • 我们如何判断超平面是否将样本点正确分类?
  • 我们知要求距离d的最大值,我们首先需要找到支持向量上的点,怎么在众多的点中选出支持向量上的点呢?

上述我们需要面对的问题就是约束条件,也就是说我们优化的变量d的取值范围受到了限制和约束。事实上约束条件一直是最优化问题里最让人头疼的东西。但既然我们已经知道了这些约束条件确实存在,就不得不用数学语言对他们进行描述。但SVM算法通过一些巧妙的小技巧,将这些约束条件融合到一个不等式里面。

这个二维平面上有两种点,我们分别对它们进行标记:

  • 红颜色的圆点标记为1,我们人为规定其为正样本;
  • 蓝颜色的五角星标记为-1,我们人为规定其为负样本。

对每个样本点xi加上一个类别标签yi:

如果我们的超平面方程能够完全正确地对上图的样本点进行分类,就会满足下面的方程:

如果我们要求再高一点,假设决策面正好处于间隔区域的中轴线上,并且相应的支持向量对应的样本点到决策面的距离为d,那么公式进一步写成:

上述公式的解释就是,对于所有分类标签为1的样本点,它们到直线的距离都大于等于d(支持向量上的样本点到超平面的距离)。对于所有分类标签为-1的样本点,它们到直线的距离都小于等于d。公式两边都除以d,就可以得到:

因为||w||和d都是标量。所上述公式的两个矢量,依然描述一条直线的法向量和截距。

上述两个公式,都是描述一条直线,数学模型代表的意义是一样的。现在,让我们对wd和γd重新起个名字,就叫它们w和γ。因此,我们就可以说:”对于存在分类间隔的两类样本点,我们一定可以找到一些超平面面,使其对于所有的样本点均满足下面的条件:”

上述方程即给出了SVM最优化问题的约束条件。这时候,可能有人会问了,为什么标记为1和-1呢?因为这样标记方便我们将上述方程变成如下形式:

正是因为标签为1和-1,才方便我们将约束条件变成一个约束方程,从而方便我们的计算。

(4)线性SVM优化问题基本描述

现在整合一下思路,我们已经得到我们的目标函数:

我们的优化目标是是d最大化。我们已经说过,我们是用支持向量上的样本点求解d的最大化的问题的。那么支持向量上的样本点有什么特点呢?

我们的优化目标是是d最大化。我们已经说过,我们是用支持向量上的样本点求解d的最大化的问题的。那么支持向量上的样本点有什么特点呢?

你赞同这个观点吗?所有支持向量上的样本点,都满足如上公式。如果不赞同,请重看”分类间隔”方程推导过程。

现在我们就可以将我们的目标函数进一步化简:

因为,我们只关心支持向量上的点。随后我们求解d的最大化问题变成了||w||的最小化问题。进而||w||的最小化问题等效于

为什么要做这样的等效呢?这是为了在进行最优化的过程中对目标函数求导时比较方便,但这绝对不影响最优化问题最后的求解。我们将最终的目标函数和约束条件放在一起进行描述:

我要回帖

更多关于 法国对塞内加尔0比1 的文章

 

随机推荐