Your current location:Home > 婉君 text

蜗居

卡迪夫大学新研究:AI 尚无法像人类教师一样可靠地批改作业_我的网站

职来职往

一 |             在济南森林公园遛娃、散步、露营是常态,但你知道吗,在科普馆二楼有一处湖畔书屋,常年向市民免费开放。济南森林公园不仅有绿意,还有书香济南森林公园不仅有绿意,还有书香济南森林公园不仅有绿意,还有书香济南森林公园不仅有绿意,还有书香        据了解,湖畔书屋是市园林和林业绿化局2020年加快打造市民身边“书香公园”品牌,在市属公园景区打造的9处书屋之一,原位于森林公园揽翠湖南畔,后迁至科普馆二层,空间较此前明显扩大。走进书屋,室内以原木色为主调,搭配暖色灯光与装饰画,营造出静谧舒适的阅读氛围。     8 月 24 日消息,据外媒 Phys.org 今天(24 日)报道,卡迪夫大学和墨尔本大学的一项新研究发现,生成式人工智能(GenAI)目前还无法像人类教师一样可靠地评判学生的书面作业。研究人员使用 ChatGPT 的两个版本,对 50 篇生物科学专业本科生论文进行评分,以测试大模型评估学生作业的能力。

二 | ChatGPT 需要按照 7 项标准批改这些论文,研究人员还采用了 4 种不同的提示方式,随后将大模型与人工评分的平均分和分数波动情况进行比较。图源:Pexels卡迪夫大学生物科学学院威廉 · 凯博士指出:“研究结果显示,模型给出的分数波动很大,无法准确预测人工评分。生成式 AI 与人类批改同一批论文时存在明显差异。书房藏书以自然、生态、园林类书籍为特色,并设有少儿阅读专区,适合各年龄段读者。只看论文总分,两者给出的结果相对接近;一旦具体到每项评分标准和每一篇论文,大模型与人工评分之间的差距就相当明显。”除一种情况外,AI 模型给出的平均分普遍高于人工评分。平均分方面,AI 模型与人工评分的最大差距达到 16.1 分;具体到单篇论文,最大差距达到 40 分。

三 | 获悉,威廉 · 凯还发现,AI 往往会压低高分论文的成绩,又把低分作业的成绩抬高,最终使分数系统性地向中间集中。

四 | 研究结果说明,至少现阶段,即使经过大量训练,AI 仍无法可靠地对主观性较强的书面作业给出与人类相当的分数。“我们测试的大模型目前并不适合取代教师,为学生预测作业成绩。

五 | ”研究人员指出,高等教育领域确实很关注大模型能否利用模式识别能力,让学生作业评分更加客观,同时提高批改效率、减轻教职人员压力。但这项研究表明,目前并不适合这么做。此外,未经学生明确同意便把作业提交给 AI 工具,本身还涉及伦理问题;大模型也不能、也不应该被依赖来给学生的长篇书面作业评分。

六 | “随着大模型继续发展,未来模仿人类判断的能力可能会提高。但从这项研究来看,要让 AI 给出的分数与人工评分真正保持一致,恐怕并不容易。

七 |

Current article:http://t4sj.linlangdouwaqiexusan.bond/list_pkeweq/emwkmsr.html

Published on:12:13:51


 Live broadcast Hall
·激情鲁超燃动河口 东营体彩以赛为媒传递公益与责任
·りくりゅうが“再現以上”の衝撃写真「完璧ね!」 4年前との対比に海外驚愕「彼女は柔らかい」
·宝马公司将投资17亿美元在美国生产电动汽车
·工信部:加快6G核心技术攻关!为6G商用做好准备
·债券ETF规模悄悄创了新高 净值也接连上涨 这是什么信号?
 Press release
·大s离世三天前照片曝光,靠在具俊晔怀里,面无血色表情痛苦
·삼성전자 ‘연산기 넣은 메모리’ 실증…AI 답변 속도 3배 빨라졌다
·前10个月辽港集装箱海铁联运发运量同比增长超17%
·聚焦智能体产业化,“智在灵玑”论坛在京举办,聚焦智能体产业化,“智在灵玑”论坛在京举办
·热议!郑钦文0-2输球无缘四强,比赛暴露出不少问题,你怎么看?
 Collection of municipal and local releases
·税惠政策精准“滴灌”便民服务“靶向”瞄准 兴城市税务局助力泳装产业“乘风踏浪”
·男足选拔队28日回海口 女足前往美国拉练
·全覆盖 零容忍 严执法 重实效 兴城市持续开展建筑施工隐患排查整治
·记者:伦纳德重返猛龙能争冠 其特质完美适配球队
·新加坡平价日本两元店!全场$2.30起,零食、服饰、家居好货全都有

 

Copyright © 2020-2099 蜗居 All Rights Reserved 蜗居 Copyright