女超人
男足选拔队28日回海口 女足前往美国拉练_我的网站

A | 8 月 24 日消息,据外媒 Phys.org 今天(24 日)报道,卡迪夫大学和墨尔本大学的一项新研究发现,生成式人工智能(GenAI)目前还无法像人类教师一样可靠地评判学生的书面作业。

B | 研究人员使用 ChatGPT 的两个版本,对 50 篇生物科学专业本科生论文进行评分,以测试大模型评估学生作业的能力。

C | ChatGPT 需要按照 7 项标准批改这些论文,研究人员还采用了 4 种不同的提示方式,随后将大模型与人工评分的平均分和分数波动情况进行比较。

D |

E | 按照计划,全队在当地时间27日下午与中国香港队进行东亚杯第3轮角逐后,将回到驻地酒店休息至次日中午。生成式 AI 与人类批改同一批论文时存在明显差异。只看论文总分,两者给出的结果相对接近;一旦具体到每项评分标准和每一篇论文,大模型与人工评分之间的差距就相当明显。随后全队将乘坐当地时间28日下午4点45分起飞的班机,离开名古屋市,飞赴海口市。”除一种情况外,AI 模型给出的平均分普遍高于人工评分。中国女足因接下来赴美国拉练、热身,将不与男足同程回国。中国男足选拔队预计将于北京时间28日晚9点左右抵达海口市,随后全队将进驻当地一家酒店,并按防疫规定接受“7+3”天的隔离。平均分方面,AI 模型与人工评分的最大差距达到 16.1 分;具体到单篇论文,最大差距达到 40 分。获悉,威廉 · 凯还发现,AI 往往会压低高分论文的成绩,又把低分作业的成绩抬高,最终使分数系统性地向中间集中。

F | 研究结果说明,至少现阶段,即使经过大量训练,AI 仍无法可靠地对主观性较强的书面作业给出与人类相当的分数。预计将于8月7日左右解除隔离。文/本报记者 肖赧

G | “我们测试的大模型目前并不适合取代教师,为学生预测作业成绩。”研究人员指出,高等教育领域确实很关注大模型能否利用模式识别能力,让学生作业评分更加客观,同时提高批改效率、减轻教职人员压力。但这项研究表明,目前并不适合这么做。

H | 此外,未经学生明确同意便把作业提交给 AI 工具,本身还涉及伦理问题;大模型也不能、也不应该被依赖来给学生的长篇书面作业评分。“随着大模型继续发展,未来模仿人类判断的能力可能会提高。但从这项研究来看,要让 AI 给出的分数与人工评分真正保持一致,恐怕并不容易。
Current article:http://t4sj.linlangdouwaqiexusan.bond/ydj0/mysm86o.html
Published on:06:22:19



揭秘马云的影子公司
菏泽市鄄城县委原书记、二级巡视员孙伟受贿案一审公开宣判
Guangdong issues 2.5 bln yuan offshore RMB bonds in Macao
美国造芯片,贵得吓人
老旧小区换新颜 提升居民幸福感
中国女排国手李盈莹确定无缘亚运会
上海两大国际机场暑运日进货量超千吨 挪威三文鱼“专机”首降浦东,上海两大国际机场暑运日进货量超千吨 挪威三文鱼“专机”首降浦东
《雷曼:传奇再叙》公布全新实机!10月1日发售
抚顺市又一协同创新联合体宣告成立
【精灵●活动】小汽车、大世界——南京一校沈北分校幼儿园
英伟达财报公布在即 盘前表现跑赢其他科技七巨头
向日葵 vs ToDesk 2026远程控制软件横评实测