巨头们涌入的医疗大模型,何时迎来最好的商业时代?_google医疗大模型 医疗大模型

当下极为火爆的大模型,在医疗赛道同样炙手可热。谷歌刚刚发布了准确率达 91.1%、性能远超 GPT-4 系列的多模态医学大模型 Med-Gemini,国内市场亦很热闹。自 2023 年以来,百度、腾讯、京东等诸多大厂都相继加码医疗大模型领域,与医疗相关的大模型产品和应用如雨后春笋般正不断涌现出来,其中更不乏 AI 和医疗企业的手笔。

目前,已有部分医疗大模型产品投入到导诊、预问诊等医院场景中。然而,医疗大模型虽有一定潜力,但现阶段仍有不少要跨越的落地门槛。

为此,InfoQ 对云知声 AI Labs 研发副总裁刘升平进行了专访,听他聊一聊现阶段医疗大模型的商业化能力,以及面向这类应用场景的行业大模型该如何定制优化。在即将召开的 AICon 全球人工智能开发与应用大会 暨 大模型应用生态展上,InfoQ 也邀请到了刘升平老师来做演讲分享,他将进一步分享医疗大模型的构建方法和应用落地经验。

以下为访谈实录,经编辑。

医疗大模型距离商业化有多远?

【一一AGI大模型学习 所有资源获取处一一】

①人工智能/大模型学习路线

②AI产品经理入门指南

③大模型方向必读书籍PDF版

④超详细海量大模型实战项目

⑤LLM大模型系统学习教程

⑥640套-AI大模型报告合集

⑦从0-1入门大模型教程视频

⑧AGI大模型技术公开课名额

InfoQ:现阶段,医疗大模型要规模化落地还面临哪些现实问题?

刘升平: 主要的问题还是有不少,首先是医生和患者的接受度,特别是有些场景要改变医生的使用习惯。还有一个问题是大模型的部署成本,如果在院里大规模并发使用医疗大模型,硬件成本会比较高。

InfoQ:“幻觉”的偶发出现是大模型目前公认的一个问题,医疗场景对准确度要求会更高,山海在这方面是怎么做的?

刘升平: “幻觉”的确是核心要解决的问题,我们采用多种手段从多方面降低幻觉,包括保证医疗预训练语料和微调数据的质量和多样性、采用能降低知识幻觉的解码策略、融合医疗知识图谱的知识增强大模型技术、医疗知识检索增强、大模型结果后校验、大模型输出置信度评估等。

InfoQ:您认为哪一个评价标准最能代表医疗大模型的水平?

刘升平: 临床有效性是最能代表医疗大模型水平的关键评价标准,包括模型在实际临床环境中的诊断准确性、治疗建议的合理性以及与专业医生的决策一致性。此外,模型的鲁棒性、泛化能力、可解释性、用户友好性、数据隐私保护以及合规性也是重要的评价维度。然而,临床有效性直接关系到患者的安全和健康,因此如果把医疗大模型应用与临床实践中,它可能是最重要的评价标准。

InfoQ:现在行业内有您认为还不错的其他医疗大模型产品吗?国内外均可。

刘升平: 除了云知声的山海大模型医疗版,最近看到的是谷歌的多模态医疗大模型 Med-Gemini,在多项临床任务评测中都表现很好,但还没有在医院得到广泛使用。

InfoQ:在医疗大模型的技术实现、应用效果以及成本部署上,国内与国外有区别吗?

刘升平: 没有显著区别。

InfoQ:您认为医疗大模型真正迎来商业化时代还需要多久?

刘升平: 预计 2-5 年吧。今年是医疗大模型的应用元年,有部分医院开始尝试一些医疗大模型的应用,随着这些医院推广与积累医疗大模型应用经验,预计医疗大模型会在 2-5 年内进入更广泛的商业化阶段。

InfoQ:社会接受度上,如何让大众认可大模型的诊断或治疗方案?

刘升平: 要让大众接受并信任大模型的诊断或治疗方案,是一个长期的过程,要考虑很多方面。第一,要提高模型的决策过程透明度,提供可解释的输出,让用户理解模型是如何得出结论的。这有助于建立用户信任,尤其是对于医疗决策这样敏感的问题。第二,要有严格的临床试验,证明模型的诊断或治疗方案与专业医生的判断相当或更优,且这些结果应由独立的第三方机构审核并公开。第三,要让医生参与到模型的开发和应用中,他们可以提供专业知识,确保模型的输出符合医学实践,并在实际应用中监督和调整。第四,要开展公众教育活动,解释人工智能在医疗领域的潜力和限制,消除误解,提高公众的理解和接受度。通过这些措施,应该可以逐步提高社会对大模型在医疗领域应用的接受度和信任度。

山海大模型的实践经验

InfoQ:医疗相比其他场景更复杂且严谨,难度自然也不小,驱动云知声选择在这一领域开发大模型的最重要因素是什么?

刘升平: 云知声选择在医疗领域开发大模型,主要有两个关键因素。一是应用潜力,而医疗领域是一个富文本、富知识的行业,并且医疗大模型在处理医疗病历文书、辅助诊断、药物研发等方面展现出巨大潜力,因为医疗领域是一个很适合大语言模型技术的应用领域。此外,医疗 AI 市场具有巨大的商业价值,随着技术的成熟和接受度的提高,未来有望形成规模化的商业模式。二是专业积累,云知声深耕医疗领域多年,对医疗业务场景有深入的理解,在医疗数据和医疗 AI 技术有深厚的积累,也积累了数百家的医疗客户,这有助于医疗大模型的研发和商业化推广应用。

InfoQ:大模型训练过程本身就对数据质量有较高要求,医疗领域的数据则更为特殊,还具有隐私保护、专业知识复杂、经验化知识难以结构化等难题,山海是如何克服的?

**刘升平:**山海医疗大模型在训练过程中面临数据质量、隐私保护和专业知识复杂性等挑战,我们采取了两种策略来克服这些问题。一是数据清洗与预处理,对收集到的医疗数据进行严格的清洗,去除噪声和不一致的信息,确保数据的准确性和一致性;同时使用专业的医疗知识进行预处理,如标准化术语等。二是匿名化与脱敏,在遵守相关法规的前提下,对个人健康信息进行匿名化和脱敏处理,以保护患者隐私。

InfoQ:使用开源数据集可能出现产品同质化现象,山海在数据资源方面是如何使用的?

刘升平: 云知声在开发山海医疗大模型时,采取了多种策略来避免产品同质化,确保模型的竞争力。第一,我们使用了不少专有数据集,即云知声多年的医疗业务积累的大量内部医疗数据。这些专有数据可以提高大模型在特定场景的应用效果。第二, 我们采用了一些数据增强技术来自动生成训练数据,例如,通过数据合成、噪声注入、标签变换等技术,增加数据的多样性和复杂性,使模型在不同条件下表现更为全面和鲁棒。第三,我们还与医疗专家合作来确保医疗数据的准确性和专业性,同时利用专家的知识来指导数据的预处理和标注。通过这些策略,云知声的山海医疗大模型能够与只使用开源数据集训练的大模型有显著区别,并且在面向具体的医疗场景应用时有更好的效果。

InfoQ:云知声的山海医疗大模型主要做了哪些场景?目前哪个场景的应用率最高?哪个场景能算作山海的“杀手锏”?

刘升平: 对于云知声的山海医疗大模型,主要做了以下场景:

● 病历生成:包括基于医患对话的门诊病历和出院小结、手术记录生成等住院病历的生成,以及放射科报告生成等医技科报告。

● 病历质控:对住院病历(包括病案首页)做过程和终末质控,支持 1000+ 形式和内涵质控点,大幅提高病历的质量。

● 单病种上报:对国家卫健委要求的 57 个病种做自动数据汇集及上报。

● 医保控费:按照医保局的规范,监管医院的临床诊疗行为和收费合理性,确保医疗费用的合规。

● 保险理赔的医疗审核:审核在保险理赔中涉及到的医疗费用,剔除不合理费用。

● 专病库平台:将病历等临床数据自动抽取和导入到专病库。

● 智能问诊:作为 AI 医生,与患者进行对话,收集症状,并提供初步的健康咨询和建议。

目前,山海应用率最高的场景是病历生成、病历质控和保险理赔的医疗审核。结合云知声在语音技术上强项开发出的门诊病历生成系统,结合云知声在医疗知识图谱的积累开发的病历质控系统和保险理赔医疗审核系统均可以视为“杀手锏”场景。

InfoQ:针对于山海医疗大模型,您更推荐医疗机构采用哪种部署方式落地?具体是如何考虑的?

**刘升平:**云知声的山海医疗大模型在医疗机构的部署通常有以下两种方式:云端部署和私有化部署。至于选择哪种部署方式,主要考虑几个因素吧。一是如果医疗机构对数据安全有极高要求,那就倾向于私有化部署。二是考虑成本与资源,云端部署通常成本较低;私有化部署初期投入大,但长期运营成本可能更低。

InfoQ:现在市面上的医疗大模型不少,国内有许多大厂也在做,山海的独特之处是什么?

刘升平: 这和云知声做医疗大模型的动机是一样的,山海医疗大模型的独特之处主要有两点。一是在专业领域深度方面,云知声专注于医疗领域,有深厚的数据、知识、场景和客户积累,这使得山海医疗大模型在效果上业内领先,目前在医疗大模型综合评测 PromptCBLUE 和 MedBench 上都是排名第一。二是在技术融合方面,结合云知声在语音识别和医疗知识图谱技术的专长,山海医疗大模型在语音交互式医疗应用上具有优势,且在临床应用上的医疗知识幻觉也大为减少。

InfoQ:在即将到来的 AICon 上,您准备向听众分享哪些方面的内容?

刘升平: 主要是分享医疗大模型是怎么用的,是如何做的。我还会以医疗领域为案例,介绍面向应用场景的通用大模型定制优化方法论,相信这对于大模型的行业应用开发有一定的借鉴意义。

嘉宾介绍

刘升平, 云知声 AI Labs 研发副总裁,北京大学数学学院博士毕业,是前 IBM 中国研究院资深研究员,中文信息学会语言与知识计算专委会委员。曾在语义网,机器学习、信息检索,医学信息学,自然语言处理等领域发表过数十篇学术论文和国际国内发明专利。在 IBM 中国研究院信息与知识组工作期间,刘博士主要负责语义技术及其应用的研发,曾多次获得过 IBM 研究成就奖。2012 年底,刘博士加入云知声 AI Labs,领导认知智能团队,负责大语言模型、知识图谱和智慧医疗等方面的研发及管理工作。在云知声期间,主持研发了山海大模型,获得国内外 AI 评测冠亚军 13 个,获得北京市科技进步奖一等奖一项。

如何学习大模型

现在社会上大模型越来越普及了,已经有很多人都想往这里面扎,但是却找不到适合的方法去学习。

作为一名资深码农,初入大模型时也吃了很多亏,踩了无数坑。现在我想把我的经验和知识分享给你们,帮助你们学习AI大模型,能够解决你们学习中的困难。

我已将重要的AI大模型资料包括市面上AI大模型各大白皮书、AGI大模型系统学习路线、AI大模型视频教程、实战学习,等录播视频免费分享出来,需要的小伙伴可以扫取。

一、AGI大模型系统学习路线

很多人学习大模型的时候没有方向,东学一点西学一点,像只无头苍蝇乱撞,我下面分享的这个学习路线希望能够帮助到你们学习AI大模型。

在这里插入图片描述

二、AI大模型视频教程

在这里插入图片描述

三、AI大模型各大学习书籍

在这里插入图片描述

四、AI大模型各大场景实战案例

在这里插入图片描述

五、结束语

学习AI大模型是当前科技发展的趋势,它不仅能够为我们提供更多的机会和挑战,还能够让我们更好地理解和应用人工智能技术。通过学习AI大模型,我们可以深入了解深度学习、神经网络等核心概念,并将其应用于自然语言处理、计算机视觉、语音识别等领域。同时,掌握AI大模型还能够为我们的职业发展增添竞争力,成为未来技术领域的领导者。

再者,学习AI大模型也能为我们自己创造更多的价值,提供更多的岗位以及副业创收,让自己的生活更上一层楼。

因此,学习AI大模型是一项有前景且值得投入的时间和精力的重要选择。

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:/a/775897.html

如若内容造成侵权/违法违规/事实不符,请联系我们进行投诉反馈qq邮箱809451989@qq.com,一经查实,立即删除!

相关文章

C++:Level3阶段测试

1、黑客小知识: (1)常用的黑客头文件有____和____。 (2)创建文件的函数叫做________。 (3)我更新了____个黑客头文件。 (4)万能头文件包含的黑客头文件是________。 …

2.4G无线收发芯片 XL2401D,SOP16封装,集成单片机,高性价比

XL2401D 芯片是工作在2.400~2.483GHz世界通用ISM频段,片内集成了九齐 NY8A054E单片机的SOC无线收发芯片。芯片集成射频收发机、频率收生器、晶体振荡器、调制解调器等功能模块,并且支持一对多组网和带ACK的通信模式。发射输出功率、工作频道以及通信数据…

NoSQL 非关系型数据库 Redis 的使用:

redis是基于内存型的NoSQL 非关系型数据库,本内容只针对有基础的小伙伴, 因为楼主不会做更多的解释,而是记录更多的技术接口使用,毕竟楼主不是做教学的,没有教学经验。 关于redis的介绍请自行搜索查阅。 使用redis数据…

【HICE】基于用户认证的虚拟服务搭建

1.创建特定的内容 --账号与密码(需要认证访问)【里面】 2.编辑配置1.conf的内容,更新httpd 3.编辑hehe网页(外部公开) cd /www/ echo hehe > hehe/index.html 4.更改本地hosts和window下的解析 5.浏览器下验证内…

新手快速部署Springboot 的Jar包 (图解-BuiId,Maven)

目录 项目的构建 打包前的准备 合理配置pox.xml文件 Build 打包方式 Maven打包方式 Jar包部署 测试后端接口 项目的构建 我的项目是SpringBoot2脚手架 先准备一个相对于的数据库依赖 数据库的任意库 Yaml配置后 才能正常在IDEA中跑起来 打包前的准备 合理配置pox.xm…

【qt】如何获取网卡的IP地址?

网卡相当于是一个翻译官,可以将数据转换成网络信号. 同时也可以将网络信号转换成数据. 我们要用到网卡类QNetmorkInterface 我们获取网卡的所有地址用静态函数allAddresses() 返回的还是一个QhostAddress的容器. QList<QHostAddress> addrList QNetworkInterface::allA…

【笔记】记一次在linux上通过在线安装mysql报错 CentOS 7 的官方镜像已经不再可用的解决方法+mysql配置

报错&#xff08;恨恨恨恨恨恨恨&#xff01;&#xff01;&#xff01;&#xff01;&#xff01;&#xff09;&#xff1a; [rootlocalhost ~]# sudo yum install mysql-server 已加载插件&#xff1a;fastestmirror, langpacks Determining fastest mirrors Could not retrie…

达梦数据库系列—22. DPC集群原理

目录 DPC原理 1、系统原理 2、元数据服务 3、数据存储 4、执行计划的生成 5、计算与存储分离 6、动态增删节点 7、分布式事务一致性 第一阶段 预提交 第二阶段 提交 8、RAFT 归档 9、自动故障处理 DPC原理 计划生成节点&#xff08;SP&#xff09;&#xff1a;对外…

【PTGui、Pano2VR6、UE4】VR全景拍摄及漫游交互制作操作实例(更新中)

一、基本思路 首先进行VR全景拍摄&#xff0c;获取高质量的全景图像&#xff1b;然后使用PTGui进行图像拼接&#xff0c;确保图像的连续性与准确性&#xff1b;接着利用Pano2VR6进行VR漫游的制作&#xff0c;添加交互元素与多媒体内容&#xff1b;最后进行作品的调试与优化&am…

Node之Web服务

前言 本文将讲解node的web服务 通过讲解http请求&#xff0c;node创建web服务等知识点让你更加深入的理解web服务和node创建的web服务 HTTP请求是什么&#xff1f; HTTP请求是客户端&#xff08;通常是浏览器或其他应用程序&#xff09;与服务器之间进行通信的一种方式。 …

【Qt之·类QVariant·数据类型】

系列文章目录 文章目录 前言一、概述二、操作及用法1.1 存储数据1.2 获取数据1.3 设置数据1.4 数据类型判断1.5 判断数据是否有效 三、实例演示总结 前言 QVariant是Qt开发中非常重要的一部分&#xff0c;它是Qt的一个核心类&#xff0c;用于处理不同数据类型之间的转换和传递。…

使用vite官网和vue3官网分别都可以创建vue3项目

问: npm init vitelatest 和 npm create vuelatest创建的vue3项目有什么区别? 回答: npm init vitelatest 和 npm create vuelatest 分别是使用 Vite 和 Vue CLI 工具创建 Vue 项目的两种方式&#xff0c;它们之间有几个主要区别&#xff1a; 1. **构建工具&#xff1a;** …

Linux--信号(万字详解!超完整!)

目录 0.预备知识 0.1.基本概念 0.2.信号的捕捉 0.3.理解信号的发送与保存 1.信号的产生&#xff08;阶段一&#xff09; 1.通过kill命令&#xff0c;向指定进程发送指定的信号 2.通过终端按键产生信号&#xff1a;ctrlc&#xff08;信号2&#xff09;&#xff0c;ctrl\(…

南方健康2024米思会:科普患教赋能医药增长闭环,千亿蓝海市场大爆发!

2024年6月25日-28日&#xff0c;在中国•南太湖举办的2024米思会如约而至&#xff0c;顺利落下帷幕&#xff0c;本次大会以“韧进启新局”为主题&#xff0c;以不懈进取的“韧劲”&#xff0c;立身破局&#xff0c;迎变启新。通过4天3夜的思想碰撞和互动交流&#xff0c;引领行…

Windows 下载安装ffmpeg

下载地址 https://ffmpeg.org/download.html 测试 管理员方式打开控制台&#xff0c;输入ffmpeg测试 配置环境变量

掌握React与TypeScript:从零开始绘制中国地图

最近我需要使用reactts绘制一个界面&#xff0c;里面需要以中国地图的形式展示区块链从2019-2024年这五年的备案以及注销情况&#xff0c;所以研究了一下这方面的工作&#xff0c;初步有了一些成果&#xff0c;所以现在做一些分享&#xff0c;希望对大家有帮助&#xff01; 在这…

64、哥伦比亚大学:CU-Net-目前脑肿瘤分割的最先进模型

本文已被接受发表在2024年IEEE MLISE会议上&#xff08;c&#xff09;2024 IEEE。准确地将脑肿瘤从MRI扫描中分割出来对于制定有效的治疗方案和改善患者预后至关重要。本研究引入了一种新的哥伦比亚大学网络&#xff08;CU-Net&#xff09;架构实现&#xff0c;用于使用BraTS 2…

哪个品牌的加密软件稳定方便使用?

一、什么是企业加密软件&#xff1f; 企业加密软件是一种用于保护企业内部数据安全的工具。在数字化时代&#xff0c;随着数据量的爆炸式增长&#xff0c;信息安全和隐私保护变得愈发重要。企业加密软件作为保障数据安全的关键工具&#xff0c;受到越来越多用户的青睐。 企业…

【专业指南】移动硬盘坏道下的数据恢复之道

移动硬盘坏道揭秘&#xff1a;数据安全的隐形挑战 在数据日益成为核心资产的今天&#xff0c;移动硬盘作为便携存储的代名词&#xff0c;承载着无数用户的重要信息。然而&#xff0c;随着使用时间的增长和不当操作的影响&#xff0c;移动硬盘可能会遭遇“坏道”这一棘手问题。…

谷粒商城学习-11-docker安装redis

文章目录 一&#xff0c;拉取Redis镜像1&#xff0c;搜索Redis的Docker镜像2&#xff0c;拉取Redis镜像3&#xff0c;查看已经拉取的镜像 二&#xff0c;创建、启动Redis容器1&#xff0c;创建redis配置文件2&#xff0c;创建及运行Redis容器3&#xff0c;使用docker ps查看运行…