网站推广三步走:十秒注册 -> 提交网站 -> 快速审核 -> 带来无限流量和外链 -> 点入及点出一次即可排名第一位

当前位置:66网站目录 » 站长资讯 » 科技资讯 » 文章详细

GPT-4眼科评估能力惊艳,但专家警告需审慎应用

来源:网络 浏览:10次 时间:2024-04-24

简介:剑桥大学临床医学院的最新研究发现,OpenAI的GPT-4模型在眼科评估中的表现几乎可与该领域的专家相媲美。这一突破性成果在金融时报首次报道后,引起了医疗和科技界的广泛关注。在这项发表在PLOS数字健康杂志上的研究中,研究人员对GPT-4及其前身GPT-3.5、谷歌的PaLM 2以及梅塔美洲驼进行了眼科知识测试。测试内容涵盖了从光敏感到病变等各个方面的87道选择题,难度与眼科教科书中的题目相当。五
GPT-4眼科评估能力惊艳,但专家警告需审慎应用

剑桥大学临床医学院的最新研究发现,OpenAI的GPT-4模型在眼科评估中的表现几乎可与该领域的专家相媲美。这一突破性成果在金融时报首次报道后,引起了医疗和科技界的广泛关注。

在这项发表在PLOS数字健康杂志上的研究中,研究人员对GPT-4及其前身GPT-3.5、谷歌的PaLM 2以及梅塔美洲驼进行了眼科知识测试。测试内容涵盖了从光敏感到病变等各个方面的87道选择题,难度与眼科教科书中的题目相当。五名眼科专家、三名实习眼科医生和两名非专业初级医生也接受了相同的模拟考试。值得注意的是,这些题目对于LLM模型而言是全新的,因为它们之前并未接触过相关内容。

在测试中,GPT-4展现了令人印象深刻的表现,答对了60道问题,得分高于实习医生和初级医生。尽管这一成绩略逊于眼科专家的平均得分66.4,但已足以显示其在眼科评估领域的巨大潜力。相比之下,PaLM 2、GPT-3.5和梅塔美洲驼的得分分别为49分、42分和28分,均低于初级医生的平均水平。

然而,尽管这些结果展示了LLM在医疗领域的潜在应用,研究人员也警告称,必须谨慎对待这些模型的输出结果。他们指出,测试中的问题数量有限,特别是在某些类别中,这可能导致实际结果有所偏差。此外,LLM模型存在“幻觉”现象,即生成不相关或错误的事实,这在医疗领域尤为危险。如果模型错误地诊断出白内障或癌症等严重疾病,将可能对患者造成严重后果。

研究人员强调,虽然LLM模型在眼科评估中展现了令人鼓舞的初步成果,但在实际应用中仍需谨慎对待。未来,应进一步探索如何提高模型的准确性和可靠性,以确保其能够安全、有效地服务于医疗领域。

此项研究为LLM模型在医疗领域的应用提供了新的视角,也提醒我们在追求技术进步的同时,必须关注其潜在的风险和局限性。随着LLM技术的不断发展,我们期待未来能够看到更多关于其如何在医疗领域造福社会的报道。

推荐站点

  • 聚站网聚站网

    聚站网,免费提供网站目录分类检索,收集正规的中文网站,用户自主的网站提交,为各行业分类目录收藏,聚站网努力打造优质丰富的网站收录平台。

    www.565865.com
  • YY分类目录YY分类目录

    YY分类目录全人工编辑的开放式网站分类目录,收录国内外、各行业优秀网站,旨在为用户提供网站分类目录检索、优秀网站参考、网站推广服务。

    www.yydir.com
  • 66网站目录66网站目录

    66网站目录是免费收录各行业优秀网站,提供网站分类目录检索,关键字搜索,提交网站即可免费推广,增加外链,提升网站流量。

    www.66dir.com
  • 25分类目录25分类目录

    25分类目录专业提供网站网址免费提交收录,25分类目录是采用开放导航式的网站大全,收录国内外各行业优秀的网站网址,让网站在各大搜索引擎收录快排名靠前。

    www.25dir.com
  • 和讯科技和讯科技

    和讯科技是和讯网核心资讯频道,以报道科技中国,分享全球智慧为目标,为高端财经网络用户提供有关TMT产业领域及时、快速、全面的资讯报道。

    tech.hexun.com
  • 百度搜索百度搜索

    百度,全球最大的中文搜索引擎、最大的中文网站。

    www.baidu.com