语言测试在教学中的效果测试起名语言(属相为猪带金字的女宝宝名字大全)
浅析语言测试与语言教学的关系
直接去百科好了又有图又有相关链接http://baike。悟 真 网014 14944。net/view/101二十四64、htm#11不晓得造成没生意的缘故是什么,打比方说地址不好,还有人员流动量不大等等,这个就不好说了奕字的起名数理为吉。
奕世载德,不忝前人。”奕字的本义是光明的意思,用在起名中更有明亮、美丽之义。在给宝宝起名时带奕更是希望其志存高远、胸怀广阔,既好听寓意又很美满,还可以带给孩子毕生的好运势与运气。
奕字起名寓意特别好,不但其本义就是积极向上的光明的意思,其字还五行属木,对于生辰八字五行不全,缺木的人来讲起名带奕字,还能调节五行运势与运气平衡。
同时从字义命理的角度来剖析,奕字在姓名学中是9画,在81数理中预示吉尽凶始、穷乏困苦的凶恶数理。象征为破舟进海,具有陷落穷迫,利去功空等喻意暗示,起名带奕字是对未来有很大的帮忙的,会让人有所作为。当年进攻咸阳,烧杀抢虐,火烧阿房宫,大火星座是根据本人生下来时的阳历(新历、国历、公历、西历)日期划分和精密推算的
阳历
1970年6月12日
星座是双子座
(5月21日-6月21日)
双子座的人,思维跳跃,口才伶俐,鬼点子多,常语出惊人,但有三心二意的倾向,情绪起伏多变,难以专心。
12星座日期划分表
白羊座:
03月21日__04月19日
金牛座:
04月20日__05月20日
双子座:
05月21日__06月21日
巨蟹座:
06月22日__07月22日
狮子座:
07月23日__08月22日
处女座:
08月23日__09月22日
天秤座:
09月23日__10月23日
天蝎座:
10月二十四日__11月22日
射手座:
11月23日__12月21日
摩羯座:
12月22日__01月19日
水瓶座:
01月20日__02月18日
双鱼座:
02月19日__03月20日今日运程:综合运势与运气***爱情运势与运气****工作状况***理财投资***健康指数88%商谈指数70%幸运颜色白色幸运数字0速配星座天秤座 利用假期空闲将身边环境中不要的旧东西清出来丢一丢吧。环境一新似乎连自己都变乾净了呢。健康状态也是不错,实行规律的活法与适当运动,就能一直保持好体能,让居家整齐清洁有可当作活动筋骨,真是一举两得呢。而考虑要单独、搬出在外居住的人今天倒是个开始行动的吉日。明日运程:综合运势与运气****爱情运势与运气****工作状况****理财投资***健康指数79%商谈指数66%幸运颜色浅蓝色幸运数字8速配星座金牛座 创造力被激发的一天,而且还是在出乎意料的情形下发挥出来的喔。在平时生活上的金钱运也还可以,适合购买居家生活用品、汽车相关用品等。但是脱离这几个范围的购物、投资就不一定棉。恋爱机会的到来也值得期待,今天的聚会场合中将出现关系你幸福的提示呢。本周运程*自己需要多休息的一周 有效日期:2008-06-21~2008-06-27 整体运势与运气身体情况不佳,如果能好好多多休息,身体的能力将更加能发挥到最好。要多小心过度熬夜或是情绪上的变化,比较容易会作用与影响到睡眠的品性质量。爱情运势与运气有对象: 近日会由于得罪情人的家人而令你烦恼多多,和他的家人最好要保持良好关系,以免他也对你不满。没对象: 单身的你,有机会大大体现魅力,朋友撮合也会促进你的缘分到来。能认识交心的对象健康运势与运气你可以选择运动来养生,不过还是要留意运动有关的伤害,千万不可以太大意,以免身体受到伤害。工作学业运重心都放在工作身上,完全没有约会时间,不过有机会升迁加薪或遇见贵人,不过不要由于压力让身体出现问题。xingyu指数有空也该分担一下家务,另一半其实也就是说和你一样不喜欢琐碎的家事,多做一些帮忙,他会更爱你喔!!!红心日06二十四假使你能够认真地好好相处和对待,将会成就一段挺好的缘份喔!!!黑梅日0621 今天要留意越亲近的人就越有相处问题产生,记住一有误会就应立即解决情绪无比的稳定,而且也特别的幽默,也则非常尊重异性,在开玩笑的时刻也是特别有礼貌的,对异性也是特别的很好,如此便会让你本人的异性缘好许多。
语言测试和评价的不同
语言测试和评价的不同为:性质不同、包括不同、作用不同。
1。性质不同
1。语言测试:语言测试指的是外语测试,是语言教学过程中的一个重要有机组成部分。
2。语言评价:语言评价是指在语言活动运行的过程中,为使活动效果更佳而修正其本身轨道所进行的评价。
2。包括不同
1。语言测试:语言测试包括离散项目测试、综合性测试。
2。语言评价:语言评价包括形成性评价、汇总性评价。
3。作用不同
1。语言测试:语言测试主要用于外语教学和外语研究,是衡量外语教学的重要手段,语言测试为外语教学提供反馈信息,对教学具有反拨作用,测试结果对改进教学方式、提供教学质量有着重要的效果。
2。语言评价:语言评价是“激励学生学习,帮助学生有效调控本人的学习过程,使学生获得成就感,增强自信心,培养合作精神”。形成性评价使学生“从被动接受评价转变成为评价的主体和积极参加者。
语言测试的效,信,难,区
1 语言测试标准项回顾
谈到语言测试的标准,大凡都不能不谈到效度(validity)、信度(reliability)、难度(difficulty level)与区分度(differentiation)。各式语言测试,不管是在语言试题设计的前期的控制,或者是对其设计产品的评估,再或者是对后期测试工作程序结束后的评估剖析,皆有一个倾向,既要慎重考虑主要作用与影响前期操作的三大标准项,又需考虑考虑主要作用与影响后期操作的两大标准项。即使是对于效度(语言测试的意图性)和信度(语言测试的可信程度)之间的联系的处理上,也经常呈现出一种必须以语言的真实使用以牺牲语言测试的客观量化的最终,具体展现在各类语言测试主观题量的增添和客观题量的降低方面。
究其理由,主要在于对各个语言测试标准项关系的区别理解。对于效度和信度的关系,普通的看法一致认为他们是一对矛盾,其实就是一种跷跷板(seesaw)的关系:提高信度便象征着损失效度,反之亦然。李筱菊从作用与影响因素以及构成因素的角度具体讨论了效度和信度,并在包括效度-信度关系在内的七大关系方面进行了深入的讨论(见李延林2005),并列举了常常见到的四大关系解决方案,不过,好像其实没有从本质上解决效度和信度的矛盾关系问题。中国大学英语4。六级英语考试和英语专业4。八级的改革好像也主要停留在主观试题的增添、口语的增添和对测试结果的所谓解释方面(有借鉴IELTS考试的倾向)。语言测试并不只针对高校学生,从覆盖面上讲,中学乃至小学和幼儿语言教导在语言测试方面,特别是测试标准方面的讨论在当前更应当受到注重和重视。而对于测试效度和信度的普遍性处理方法和对难度与区分度的简单偏执显然有害于基础语言教导的改革,只能使考教越发分离,使教学与考试脱离的现象愈加严重。毫无疑问,假如难度和区分度对于高考来讲还有一定意义,选拔硕士考试和出国考试应当考虑增大一些试题的难度,以造成一定的区分度,达到选拔人才的意图的话,可是,在任何考试中都必须让考生分出来个一二三的主观想法显然是无知的;仅仅认为主观题是高效度而客观题是低效度的观点也是偏激不合实际情况的。
2 效度和信度的关系
语言测试的效度必须first of all考虑。由于它决定语言测试是否达到其目的。简单地说,听说技能的测试效度必须由听说试题来反映;读写试题的效度也必须由读写来实施。从这个规律上讲,它和我们汉语里的‘效果’固然不存在对等关系,不过还是有着不可分的内在关系。另外,期中考试代表一种提供信息的考试(informative),和主要目的在于汇总语言学习的期末测试应当有相同点和不同点共存的特征,也会对语言测试的效度有作用与影响。假如期中考试仅仅是以一篇作文甚至是一次作业作为考察的手段,那么期末考试理应在作文方面占据相当的比例。追求高信度是统计学的一大特点。把语言分解成若干单元从语言使用的角度看起来
乎匪夷所思,但语言学习没有可能是一蹴而就的,对于语境(这里指使用语言的情景而非语言学语境或上下文)也没有可能是空中楼阁,它需要大家对语言的单句上下文掌握的前提下再进一步考虑,对于语言测试来讲更是如此。一般认为,没有信度的测试是无用的;没有效度的测试谈不上信度。我们以为,这种按道理来讲的关系讨论对于语言测试实践没有任何的意义。没有信度是零的语言测试,除非是大面积的作弊。也没有完全缺少效度的测试,除非出题人完全不懂语言教学规律和语言测试技术。于是,单个看待语言的效度和信度要比这种武断的矛盾一元论理论看法更加实在一些。李筱菊对于效度和信度的关系处理给我们提供了一个视角,即不但仅从这两个词的定义入手,而是从其构成和作用与影响因素着手。从她的讨论不难看出,作用与影响信度的因素远比作用与影响效度的因素要多。这样,从追求双高,即高效度和高信度的角度看,我们好像看见了一丝希望。对于某些作用与影响因素的改善假如可来提升效度或者信度而不能够作用与影响到整体平衡(语言测试毕竟不同于跷跷板,不会稍有差别就会出现很大差别的现象),那么语言测试实践就会减轻许多压力。解决这一对看起来矛盾的另外一个办法在于从上一层系统来看待他们的关系,亦即需我们从一个系统角度而不是从对抗角度(trade-off)来关注这种关系。假如语言学习输入和输入强化对于刚入门的人起到很大作用的话,假如学习者输入(learner input)在学习初期根本不可能或者不实际的话,可是,语言测试的首要标准项就不应当以经常提到的语言输出(或者称作语言生产)为主,而应当考虑以联想和激发回忆为主的语言识别的能力。这样,我们就能够借鉴应用语言学家给我们提供的连续体(continuum)的模式(见Bachman:1990)来思索语言测试中效度和信度的关系(见表1)。在连续体的一端是高效度,在另外一端是高信度。对其不同的需要决定试题是高信度或者高效度,或者居中,但不存在好与不好的问题,或者,确切地说,它的好赖完全由测试的意图(不同于效度)和种类决定。
A 语言输入 语言识别 B
高信度―――――┼―――――――高效度
C 语言输出 语言生产 D
以上图表显示,比较理想的试题应当在D区和A区。固然语言学习者终身都离不开语言输入,不过对于刚入门的人和低年级学习者来讲,语言的识读能力的培养应当重于组织能力;展现在语言测试中,其高信度应当重于高效度。而对于语言水平较高的学习者来讲,其语言组织能力的培养应当是重中之重,应当展现在语言生产的试题之中。诚然,这里面还牵扯一个语言测试种类的问题和与教学课本有关的教学内容以及测试内容效度的问题,鉴于不是本文讨论的焦点,在此不再赘述。
3 难度与区分度的关系
语言测试在设计方面有一个常规,即试题在内容及试题题型方面应遵从从‘易’到‘适合’再到‘难’的规则。这在理想测试结果图上亦有展现:两头小,中间大的弧形模式。这样做的意图在于让参与测试的语言学生能够熟悉、适应测试过程并最终形成经常提到的理想弧度。
语言测试技术有一个规则,即不给考生设定圈套。难度作为一个相对的概念,不应展现在试题的题型上,而更应展现在学生的所学内容方面。为了降低难度而将主观题变更为客观题的做法假如还算可以理解的话,可是,通过这种办法增添难度的做法就匪夷所思了;而为了增添难度将很少出现或使用的语言项目大量纳入试题的做法就更显得荒唐(除非是语言禀赋测试,即aptitude测试)。对于普通语言测试来讲,应当和所学挂起钩来。只要课本选择合适,只要教学内容与方法合适,平时的小测验也好,期中考试也好,或者期末考试也好,都应当反映平时所学,以检测学生在该门课程方面的学习情况,更加的多地反映学习者的进步程度(progress或achievement),而不完全是其语言水平(proficiency test),更不是通过语言测试在学习者之间进行比较,形成竞争角逐压力甚致于引起负面学习焦虑情绪。增添难度的意图在于区分,而区分度的根本在于把学习者分为不同等级,假如因此而进行动态班级调整施行分班或者分级教学的话还有一定的道理,但仅仅为了区分而忽视语言学习中竞争角逐带来的负面作用与影响,强化常模测试(norm-based testing)的效果,忽视语言标准测试(criteria-based testing)的存在,则对于语言教学与测试实践都不会带来很大的益处。对于语言试题难度和区分度,对于分数分布曲线的考虑或者对于偏态值和峰值的考虑在分班/级测试和常模测试的情形下必须涉及外,仅从标准测试角度看没很有必要务必要考虑。另外,为了区分而作用与影响到语言测试的反拨效度(wash-back effect),则在相当大的程度上会作用与影响到语言学习这一主要矛盾,会损失语言学习和语言测试的主要方面。
语言测试的标准一致是应用语言学家关注的事情。对效度和信度之间的联系研究长期以来一直在语言教学与实践中徘徊,不是偏左就是偏右,再就是折衷。我们认为,除了在平衡方面想办法,如可考虑提高信度的完型填空题,还不错考虑从不同的角度分别考虑。本文在这个基础上提出了与测试种类有关的测试目的的老概念,试图从语言测试需求的角度,从Bachman提出来的系统连续体的角度重新审视效度和信度之间的联系。至于语言的难度和区分度,本文以为,应当视需求而实施,而不应当盲目地甚至是无限制地推广,使之成为‘放之四海而皆准’的准绳。
语言教导教学和语言测试理论及实践的研究不会停止,对于语言测试的标准也会继续。假如我们在语言教学和测试方面能够寻觅到一个好的契合点,假如我们能够一步步解决高考英语测试指挥棒和四/六级或四/八级指挥棒的问题,故此我们所倡导的减负和减压等措施便能真真正正落到实处,培养创新人才,而不是应试能手。不管对于语言教学或者对于语言测试实践来讲,Leech在2001年第3届中国英语教学国际研讨会上所提交的主题报告Teach the Frequent before the Rare(教授常用语言项先于罕见语言项)无疑都具有一定的启发意义,而此亦为包括中国在内的英语教学的一大症结所在。
分类
测试的效度一般可分为以下几类:
1)表面效度(face validity)
指测试应达到的卷面标准,即一套测试题从表面看来是否是适合的。例如,若一次阅读理解力的测试包括很多受试者没有学过的方言词汇,则可认为这次测试缺乏表面效度。表面效度是测试出受试者正常水平的一种保证因素。
2)内容效度(content validity)
指一套测试题是否测试了应该测试的内容也可以这样说所测试的内容是否反映了测试的要求,即测试的表现性和覆盖面的程度。例如,假如某一套发音技能测试题仅仅考查发音所必须具备的某些技能,如只考单一音素的发音,而不考查重读、语调或音素在词语中的发音,可是,该测试的内容效度就很低。
3)编制效度(construct validity)
指一套测试题的诸项目对编制该测试所根据的论理的各个基本方面的反映程度。例如,以结构主义语言理论为基础,认为系统的语言习惯是通过句型而得来的,可是,强调词汇和语法环境的测试题目就失去了编制效度。
4)经验效度(empirical validity)
经验效度是一种衡量测试有效性的量度,通过把一次测试与一个或多个标准尺度相对照而总结出。经验效度可分为两种:一是共时效度(concurrent validity),即将一次测试的结果同另一次时间相近的有效测试的结果相比较,或同教师的鉴定相比较而总结出的系数;二是预测推算效度(predictive validity),即将一次测试的结果同之后的语言能力相比较,或是同教师后来对学生的鉴定相比较而总结出的系数。
一般而讲,对某次测试的效度进行检验时,不仅仅要依据教学大纲的要求和观念有效性的论理对试卷的内容进行考查以外,还须采用计算相关系数的定量方法,即计算出本次试卷与另一份已被确定能正确反映受试者水平的试卷之间的相关系数。系数不低则有效性大。课堂测试的效度应在0。4-0。7之间,规模较大的测试其效度应在0。7以上。
作用与影响因素
测量的效度就是指测量的有效性,即能测量到所要测量目标的程度。一般而讲,效度的效果比信度的效果更为重要。假如一个测验效度很低,不管它的信度有多高,这项测验都没有应用价值。较高的效度是一个良好的测验最要紧的特性,是必要条件,也是选择和评鉴测验的重要根据。不过许多方面皆在作用与影响测量的效度,下面主要从测验本身、样本团体、效标因素进行具体剖析。
测验的因素
由测验本身带来的作用与影响因素有测验题目的质量、测验实施中的干扰、测验的长度、被试的因素等。
测验题目的质量
题目的指导语不明确、试题的表达不清晰、试题太难或太容易、题目中出现额外的线索、诱答设计不合理、题目过少、试题的安排和组织不恰当、试题不符合测验目的等因素,都会作用与影响测验的效度,使效度降低。
实施测验时的干扰因素
测验的环境太差、被试不遵从指导语、记分错误,都会使测验的效度降低。
测验的长度
一般而讲,增添测验的长度通常来讲可来提升测验的信度,而效度系数能不能达到最大值也受信度的作用与影响,于是,增添测验的题目常常也能提高测验的效度。然而,效度增添的先要做到的是这几个增添的题目必须与测量的目标相关。
被试的作用与影响因素
被试的反应定势、测验动机、身心及情绪状态都会对测量效度的作用与影响。
样本团体性质
对效度的计算多数是经过对样本团体的分数进行各式剖析而得到的,所以样本团体的性质也会对测验的效度产生作用与影响。这几个作用与影响展现在三个方面。
(一) 同一测验对不同的团体所测量的功能或许是不同的;
(二) 对于同一个测验,样本团体的性质不同,效度亦会有较大的差异;
(三) 样本团体的异质性对效度亦会有作用与影响。
效标性质
在采用效标关联效度时,效标的性质怎样,会作用与影响对测验效度的评价。一般而讲,假如其他条件相同,所测量的行为或心理特质与效标行为或特质越相似,效度系数就越高。另外,效标与测验分数之间的联系是否线性也是一个特别重要的作用与影响因素。
测试信度(test reliability)亦称测试的可靠性,指的是测试结果是否稳定可靠。
总之,测试的成绩是还是不是反映了受试者的实际语言水平。例如,假如同一套测试在对同一测试对象(即受试者本身没有变化)进行的多次测试中,受试者的分数忽高忽低的话,则说明该测试缺乏信度。测试的信度与测试的效度有着亲密的关系。
一般说来,只有信度较高的测试才能有较高的效度,但效度较高不能保证信度也一定较高。测试的信度主要关系到试题本身的可靠性和评分的可靠性这两个方面。试题本身是否可靠主要取决于试题的范畴、数量、试题的区分度等因素;评分是否可靠则要看评分标准是否客观和准确。
应用实际案例
测试的信度通常来讲用一种相关系数(即两个数之间的比例关系)来预示,相关系数越大,信度则越高。当系数为1、00时,说明测试的可靠性达到最高程度;而系数是0。00时,则测试的可靠性降到最低程度。在通常情况下,系数不会高到1、00,断然不会降到0。00,而是在两者之间。对信度指数的要求因测试类别的区别而不同,人们通常来讲对标准化测试的信度系数要求在0。90以上,例如“托福”的信度大体为0。95,而课堂测试的信度系数则以0。70-0。80之间为可接受性系数。测试信度的计算方法有许多种,以下仅介绍三种易于操作的方式方法:
1)重测法
(the retesting mod)。用同一套试卷在两个不同时间内来测试同一批受试者,这样便获得两组分数,紧接着计算出两组分数的相关系数。诚然,在两次测试中,学生第2次的测试成绩理应比第1次的要高,由于在第2次测试时学生已经有了进步而且临场经验也更丰富了。不过若该试题是比较可靠的,每个学生在两次测试中的排名次序或许应该是基本不变的。
2)交替形式法
(the alternative mod)。对同一批受试者使用试题类型完全相同,难易程度相当,但具体题目不同的两套对等试卷先后进行两次测试,紧接着计算出两次得分的相关系数。
3)对半法
(the split-half mod)。测试只进行一次,但将整份试卷的题目按单、双数分成两组来分别计分,算出两组分数的相关系数,紧接着再用Spearman-Brown的公式计算整份试卷的信度系数。具体计算步骤是:将两组分数的相关系数乘以2,再除以1加两组分数的相关系数。
试题难度(item difficulty)衡量试题质量高低的指标之一测验(试卷)中试题(项目)的难度,是衡量该试题对被试者全体的适合程度。用d预示难度水平,0<=d<=1、 d=1预示难度水平最高,即该试题没有一个被试者做对;d=0,预示该试题全体被试者都做对,即难度水平最低。。
试题难度(item difficulty)衡量试题质量高低的指标之一测验(试卷)中试题(项目)的难度是衡量该试题对被试者全体的适合程度。用d预示难度水平,0镇d<1、 d=1预示难度水平最高,该试题没有一个被试者做对;d=。预示该试题全体被试者都做对,即难度水平最低。
试题的难度水平d值的大小必然会作用与影响到区分度、信度、效度的大小。计算d值的主要方法是平均数法:用a预示试题的满分,厉预示全体被试者得分的平均值,则
若对某试题,答对得a分,答错得0分(无中间分数,例如,对选择题或是非题等),则x/a为全体被试者在该试题的答对率,记p^}/a,则d一1-p。若被试者人数为N,该试题答对的被试者人数为R,
区分度是指试题对被试者情况的分辨能力的大小,主要用于评价以选拔为目的的选题。
试卷区分度反映试题区分不同水平受试者的程度,即考出学生的区别水平,把出色、一般、差三个层次的学生真真正正分别开。区分度高的考试,出色、一般、差三个层次的学生皆有一定比例,假如某一分数区间学生相对集中,高分太多或不及格太多的考试,区分度则低。
计算
假如把成绩从高往低排序,前50%的考生为高分组,后50%为低分组。其计算公式为:D=2(XH—XL)/W,其中,D为区分度,XH为高分组平均分,XL为低分组平均分,W为试卷总分(一般为100分或150分)。
为了简单计算, 教师应该使用下面的一种方法进行计算区分度:
先将分数排序,P1=27%高分组的难度,P2=27%低分组的难度,区分度D=(27%高分组的平均分-27%低分组的平均分)÷满分值。
区分度一般在-1~+1之间,值越大区分度越好。试题的区分度在0。4以上表明此题的区分度很好,0。3~0。39表明此题的区分度较好,0。2~0。29表明此题的区分度不太好需修改,0。19以下表明此题的区分度不好应淘汰。
计算区分度的方式方法许多,需要特别注意和提防的是对同一个试题的考试成绩采用不同的方式方法所得到的区分度的值是不一样的。
语言测试是语言教学结果的什么
反馈、评估、选择和研究,测试给出的信息反馈。依据百度题库查询语言测试是语言教学结果的反馈、评估、选择和研究,测试给出的信息反馈。语言测试是检测语言学习者语言能力的一个重要工具。它对语言教学有特别重要的作用与影响。
语言测试与语言教学和学习的关系怎样
测试一般是检查教学质量的一种有效手段,是教学过程中不可缺少的一个重要组成部分,在英语教学中,科学合理的测试会对教学起到积极的反拨作用。随着外语教学理论的发展,有关语言测试方面的论理研究也日趋完善。加强对外语测试的研究不但是我国而且也是全球性外语教学界面临的重要课题之一
语言测试的效果和目的
1。测试的意图是为了发现尽可能多的缺陷,不是为了说明软件中没有缺陷。
2。成功的测试在于发现了迄今尚未发现的缺陷。所以测试人员的职责是设计如此的测试用例,它能有效地揭示潜伏在软件里的缺陷。
以测试用途为基准,语言测试可分为哪几类
4类
1 、水平测试
主要考查学生的语言能力,不考虑之前是否学过,学了多少,怎样学的,而是为了测试被试者是否达到了某种语言水平。
2 、成绩测试
与所学的课程直接相关,目的是考查学生对所学知识和技能的掌握与运用。可以根据课程内容或教材内容,也可根据课程目标。
3 、潜能测试
用以表示学生学习某种语言的潜力和天赋
4 、诊断测试
用以发现教和学的问题可以考查单个项目,也可综合考查目的是为了改进教学,调整教学计划,进行个别指导。


