巨头们涌入的医疗大模型,何时迎来最好的商业时代?_google医疗大模型 医疗大模型

news2024/11/27 2:16:57

当下极为火爆的大模型,在医疗赛道同样炙手可热。谷歌刚刚发布了准确率达 91.1%、性能远超 GPT-4 系列的多模态医学大模型 Med-Gemini,国内市场亦很热闹。自 2023 年以来,百度、腾讯、京东等诸多大厂都相继加码医疗大模型领域,与医疗相关的大模型产品和应用如雨后春笋般正不断涌现出来,其中更不乏 AI 和医疗企业的手笔。

目前,已有部分医疗大模型产品投入到导诊、预问诊等医院场景中。然而,医疗大模型虽有一定潜力,但现阶段仍有不少要跨越的落地门槛。

为此,InfoQ 对云知声 AI Labs 研发副总裁刘升平进行了专访,听他聊一聊现阶段医疗大模型的商业化能力,以及面向这类应用场景的行业大模型该如何定制优化。在即将召开的 AICon 全球人工智能开发与应用大会 暨 大模型应用生态展上,InfoQ 也邀请到了刘升平老师来做演讲分享,他将进一步分享医疗大模型的构建方法和应用落地经验。

以下为访谈实录,经编辑。

医疗大模型距离商业化有多远?

【一一AGI大模型学习 所有资源获取处一一】

①人工智能/大模型学习路线

②AI产品经理入门指南

③大模型方向必读书籍PDF版

④超详细海量大模型实战项目

⑤LLM大模型系统学习教程

⑥640套-AI大模型报告合集

⑦从0-1入门大模型教程视频

⑧AGI大模型技术公开课名额

InfoQ:现阶段,医疗大模型要规模化落地还面临哪些现实问题?

刘升平: 主要的问题还是有不少,首先是医生和患者的接受度,特别是有些场景要改变医生的使用习惯。还有一个问题是大模型的部署成本,如果在院里大规模并发使用医疗大模型,硬件成本会比较高。

InfoQ:“幻觉”的偶发出现是大模型目前公认的一个问题,医疗场景对准确度要求会更高,山海在这方面是怎么做的?

刘升平: “幻觉”的确是核心要解决的问题,我们采用多种手段从多方面降低幻觉,包括保证医疗预训练语料和微调数据的质量和多样性、采用能降低知识幻觉的解码策略、融合医疗知识图谱的知识增强大模型技术、医疗知识检索增强、大模型结果后校验、大模型输出置信度评估等。

InfoQ:您认为哪一个评价标准最能代表医疗大模型的水平?

刘升平: 临床有效性是最能代表医疗大模型水平的关键评价标准,包括模型在实际临床环境中的诊断准确性、治疗建议的合理性以及与专业医生的决策一致性。此外,模型的鲁棒性、泛化能力、可解释性、用户友好性、数据隐私保护以及合规性也是重要的评价维度。然而,临床有效性直接关系到患者的安全和健康,因此如果把医疗大模型应用与临床实践中,它可能是最重要的评价标准。

InfoQ:现在行业内有您认为还不错的其他医疗大模型产品吗?国内外均可。

刘升平: 除了云知声的山海大模型医疗版,最近看到的是谷歌的多模态医疗大模型 Med-Gemini,在多项临床任务评测中都表现很好,但还没有在医院得到广泛使用。

InfoQ:在医疗大模型的技术实现、应用效果以及成本部署上,国内与国外有区别吗?

刘升平: 没有显著区别。

InfoQ:您认为医疗大模型真正迎来商业化时代还需要多久?

刘升平: 预计 2-5 年吧。今年是医疗大模型的应用元年,有部分医院开始尝试一些医疗大模型的应用,随着这些医院推广与积累医疗大模型应用经验,预计医疗大模型会在 2-5 年内进入更广泛的商业化阶段。

InfoQ:社会接受度上,如何让大众认可大模型的诊断或治疗方案?

刘升平: 要让大众接受并信任大模型的诊断或治疗方案,是一个长期的过程,要考虑很多方面。第一,要提高模型的决策过程透明度,提供可解释的输出,让用户理解模型是如何得出结论的。这有助于建立用户信任,尤其是对于医疗决策这样敏感的问题。第二,要有严格的临床试验,证明模型的诊断或治疗方案与专业医生的判断相当或更优,且这些结果应由独立的第三方机构审核并公开。第三,要让医生参与到模型的开发和应用中,他们可以提供专业知识,确保模型的输出符合医学实践,并在实际应用中监督和调整。第四,要开展公众教育活动,解释人工智能在医疗领域的潜力和限制,消除误解,提高公众的理解和接受度。通过这些措施,应该可以逐步提高社会对大模型在医疗领域应用的接受度和信任度。

山海大模型的实践经验

InfoQ:医疗相比其他场景更复杂且严谨,难度自然也不小,驱动云知声选择在这一领域开发大模型的最重要因素是什么?

刘升平: 云知声选择在医疗领域开发大模型,主要有两个关键因素。一是应用潜力,而医疗领域是一个富文本、富知识的行业,并且医疗大模型在处理医疗病历文书、辅助诊断、药物研发等方面展现出巨大潜力,因为医疗领域是一个很适合大语言模型技术的应用领域。此外,医疗 AI 市场具有巨大的商业价值,随着技术的成熟和接受度的提高,未来有望形成规模化的商业模式。二是专业积累,云知声深耕医疗领域多年,对医疗业务场景有深入的理解,在医疗数据和医疗 AI 技术有深厚的积累,也积累了数百家的医疗客户,这有助于医疗大模型的研发和商业化推广应用。

InfoQ:大模型训练过程本身就对数据质量有较高要求,医疗领域的数据则更为特殊,还具有隐私保护、专业知识复杂、经验化知识难以结构化等难题,山海是如何克服的?

**刘升平:**山海医疗大模型在训练过程中面临数据质量、隐私保护和专业知识复杂性等挑战,我们采取了两种策略来克服这些问题。一是数据清洗与预处理,对收集到的医疗数据进行严格的清洗,去除噪声和不一致的信息,确保数据的准确性和一致性;同时使用专业的医疗知识进行预处理,如标准化术语等。二是匿名化与脱敏,在遵守相关法规的前提下,对个人健康信息进行匿名化和脱敏处理,以保护患者隐私。

InfoQ:使用开源数据集可能出现产品同质化现象,山海在数据资源方面是如何使用的?

刘升平: 云知声在开发山海医疗大模型时,采取了多种策略来避免产品同质化,确保模型的竞争力。第一,我们使用了不少专有数据集,即云知声多年的医疗业务积累的大量内部医疗数据。这些专有数据可以提高大模型在特定场景的应用效果。第二, 我们采用了一些数据增强技术来自动生成训练数据,例如,通过数据合成、噪声注入、标签变换等技术,增加数据的多样性和复杂性,使模型在不同条件下表现更为全面和鲁棒。第三,我们还与医疗专家合作来确保医疗数据的准确性和专业性,同时利用专家的知识来指导数据的预处理和标注。通过这些策略,云知声的山海医疗大模型能够与只使用开源数据集训练的大模型有显著区别,并且在面向具体的医疗场景应用时有更好的效果。

InfoQ:云知声的山海医疗大模型主要做了哪些场景?目前哪个场景的应用率最高?哪个场景能算作山海的“杀手锏”?

刘升平: 对于云知声的山海医疗大模型,主要做了以下场景:

● 病历生成:包括基于医患对话的门诊病历和出院小结、手术记录生成等住院病历的生成,以及放射科报告生成等医技科报告。

● 病历质控:对住院病历(包括病案首页)做过程和终末质控,支持 1000+ 形式和内涵质控点,大幅提高病历的质量。

● 单病种上报:对国家卫健委要求的 57 个病种做自动数据汇集及上报。

● 医保控费:按照医保局的规范,监管医院的临床诊疗行为和收费合理性,确保医疗费用的合规。

● 保险理赔的医疗审核:审核在保险理赔中涉及到的医疗费用,剔除不合理费用。

● 专病库平台:将病历等临床数据自动抽取和导入到专病库。

● 智能问诊:作为 AI 医生,与患者进行对话,收集症状,并提供初步的健康咨询和建议。

目前,山海应用率最高的场景是病历生成、病历质控和保险理赔的医疗审核。结合云知声在语音技术上强项开发出的门诊病历生成系统,结合云知声在医疗知识图谱的积累开发的病历质控系统和保险理赔医疗审核系统均可以视为“杀手锏”场景。

InfoQ:针对于山海医疗大模型,您更推荐医疗机构采用哪种部署方式落地?具体是如何考虑的?

**刘升平:**云知声的山海医疗大模型在医疗机构的部署通常有以下两种方式:云端部署和私有化部署。至于选择哪种部署方式,主要考虑几个因素吧。一是如果医疗机构对数据安全有极高要求,那就倾向于私有化部署。二是考虑成本与资源,云端部署通常成本较低;私有化部署初期投入大,但长期运营成本可能更低。

InfoQ:现在市面上的医疗大模型不少,国内有许多大厂也在做,山海的独特之处是什么?

刘升平: 这和云知声做医疗大模型的动机是一样的,山海医疗大模型的独特之处主要有两点。一是在专业领域深度方面,云知声专注于医疗领域,有深厚的数据、知识、场景和客户积累,这使得山海医疗大模型在效果上业内领先,目前在医疗大模型综合评测 PromptCBLUE 和 MedBench 上都是排名第一。二是在技术融合方面,结合云知声在语音识别和医疗知识图谱技术的专长,山海医疗大模型在语音交互式医疗应用上具有优势,且在临床应用上的医疗知识幻觉也大为减少。

InfoQ:在即将到来的 AICon 上,您准备向听众分享哪些方面的内容?

刘升平: 主要是分享医疗大模型是怎么用的,是如何做的。我还会以医疗领域为案例,介绍面向应用场景的通用大模型定制优化方法论,相信这对于大模型的行业应用开发有一定的借鉴意义。

嘉宾介绍

刘升平, 云知声 AI Labs 研发副总裁,北京大学数学学院博士毕业,是前 IBM 中国研究院资深研究员,中文信息学会语言与知识计算专委会委员。曾在语义网,机器学习、信息检索,医学信息学,自然语言处理等领域发表过数十篇学术论文和国际国内发明专利。在 IBM 中国研究院信息与知识组工作期间,刘博士主要负责语义技术及其应用的研发,曾多次获得过 IBM 研究成就奖。2012 年底,刘博士加入云知声 AI Labs,领导认知智能团队,负责大语言模型、知识图谱和智慧医疗等方面的研发及管理工作。在云知声期间,主持研发了山海大模型,获得国内外 AI 评测冠亚军 13 个,获得北京市科技进步奖一等奖一项。

如何学习大模型

现在社会上大模型越来越普及了,已经有很多人都想往这里面扎,但是却找不到适合的方法去学习。

作为一名资深码农,初入大模型时也吃了很多亏,踩了无数坑。现在我想把我的经验和知识分享给你们,帮助你们学习AI大模型,能够解决你们学习中的困难。

我已将重要的AI大模型资料包括市面上AI大模型各大白皮书、AGI大模型系统学习路线、AI大模型视频教程、实战学习,等录播视频免费分享出来,需要的小伙伴可以扫取。

一、AGI大模型系统学习路线

很多人学习大模型的时候没有方向,东学一点西学一点,像只无头苍蝇乱撞,我下面分享的这个学习路线希望能够帮助到你们学习AI大模型。

在这里插入图片描述

二、AI大模型视频教程

在这里插入图片描述

三、AI大模型各大学习书籍

在这里插入图片描述

四、AI大模型各大场景实战案例

在这里插入图片描述

五、结束语

学习AI大模型是当前科技发展的趋势,它不仅能够为我们提供更多的机会和挑战,还能够让我们更好地理解和应用人工智能技术。通过学习AI大模型,我们可以深入了解深度学习、神经网络等核心概念,并将其应用于自然语言处理、计算机视觉、语音识别等领域。同时,掌握AI大模型还能够为我们的职业发展增添竞争力,成为未来技术领域的领导者。

再者,学习AI大模型也能为我们自己创造更多的价值,提供更多的岗位以及副业创收,让自己的生活更上一层楼。

因此,学习AI大模型是一项有前景且值得投入的时间和精力的重要选择。

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.coloradmin.cn/o/1897511.html

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈,一经查实,立即删除!

相关文章

Zabbix动作与媒介

目录 前言 1. 动作的基本概念 2. 动作的常见用途 一. 环境准备 二. 创建动作 三. 添加媒介 前言 在 Zabbix 中,动作(Actions)用于在特定事件发生时执行一系列预定义的操作,比如发送通知、执行脚本等。动作通常与触发器&…

竹云实力入选《现代企业零信任网络建设应用指南报告》代表性厂商

2024年7月3日,国内网络安全媒体安全牛正式发布《现代企业零信任网络建设应用指南报告(2024版)》。竹云凭借在零信任领域创新性的产品方案和优异的市场表现,实力入选代表性厂商。 伴随着云计算、AI、大数据等技术的发展,远程办公、业务协同、…

rs轨迹校验

最近发现有些网站的rs似乎上了轨迹校验,附图: 写了个解rscookie的插件,可以精准看到rs更改了那些校验点,需要做什么处理,就很舒服 有需要轨迹代码或者瑞数相关的可以联系 let v huaqu0727

STM32智能家居安防系统教程

目录 引言环境准备智能家居安防系统基础代码实现:实现智能家居安防系统 4.1 数据采集模块 4.2 数据处理与分析 4.3 控制系统实现 4.4 用户界面与数据可视化应用场景:安防管理与优化问题解决方案与优化收尾与总结 1. 引言 智能家居安防系统利用STM32嵌…

【python基础】—如何理解安装程序时要配置Widows和DOS操作系统中的path环境变量?

文章目录 前言一、环境变量是什么?二、为什么需要设置环境变量?三、配置anaconda的环境变量 前言 在安装一些程序的时候, 我们总是需要将安装路径配置到正在使用电脑的环境变量里。为什么要进行这一步呢?本文主要解释Widows和DOS…

【qt】如何通过域名获得IP地址?

域名是什么呢?像www.baidu.com的baidu.com就是域名. 域名相当于是网站的门牌号. 域名可以通过 DNS 解析将其转换为对应的 IP 地址. 用我们获取IP地址的方式就可以,但是现在没有可以用另一种方法. 槽函数的实现: void MainWindow::lookupHost(const QHostInfo &hostInf…

【docker】容器内配置环境变量

背景: 我要把下面的环境变量写到bash脚本里,起名叫environment_start.sh。 目的: 用于每次进入容器dev_into.sh的时候,让系统获取到环境变量。 操作步骤: 先在容器外找个合适的位置写环境变量bash脚本&#xff0c…

从0到1构建渠道运营体系:实战案例与策略指南

引言 在当今竞争激烈的市场环境中,有效的渠道运营是企业实现产品或服务快速触达目标用户、提升市场份额的关键。从零开始构建一个高效的渠道运营体系,不仅需要深思熟虑的策略规划,还需要灵活应变的实战操作。本文将结合实战案例,…

特殊用途二极管+二极管故障检测+三极管(BJT)的工作原理+定时器的使用(小灯定时闪烁实现)

2024-7-5,星期五,17:27,天气:晴,心情:晴。今天没有什么特殊的事情发生,继续学习啦,加油加油!!! 今日完成模电自选教材第二章内容的学习&#xff…

ES集成到ambari中出现的常见问题归总

1.elasticesearch用户名组的问题 KeyError: uelasticsearch Error: Error: Unable to run the custom hook script [/usr/bin/python, /var/lib/ambari-agent/cache/stack-hooks/before-ANY/scripts/hook.py, ANY, /var/lib/ambari-agent/data/command-102.json, /var/lib/amb…

QT实现GIF动图显示(小白版,可直接copy使用)

需要你自己提前设置好动图的位置&#xff0c;本例中存放于"/Users/PLA/PLA/PLA.gif widget.h #ifndef WIDGET_H #define WIDGET_H#include <QWidget> #include <QMovie> #include <QLabel>class Widget : public QWidget {Q_OBJECTpublic:explicit Wid…

快递物流运输中的RFID智能锁控应用方案

一、物流货运管理的痛点分析 1.1 货物安全与监控难题 物流货运过程中&#xff0c;货物安全是首要关注的问题。传统的锁控方式存在诸多不足&#xff0c;例如易被撬锁、监控盲点以及难以实时追踪货物状态。据统计&#xff0c;每年因货物丢失或损坏导致的经济损失高达数十亿美元…

开源数字智能交互对话系统;通过图片生成高效肖像动画;在 Azure 中一键部署知识图谱;开源ChatGPT国内可用免费转发API

✨ 1: Digital Human Intelligent Dialogue System Linly-Talker是一个集成多种AI技术、支持图像和语音的智能交互对话系统。 Digital Human Intelligent Dialogue System&#xff0c;即数字人智能对话系统&#xff0c;是一个集成了最新人工智能技术的创新平台。该系统通过整…

木马蚁剑使用

06-木马蚁剑 1 读写权限确认 数据库对文件的权限确认 show global variables like %secure%; 查看mysql全局变量的配置&#xff0c;当输入以上命令后&#xff0c;结果 secure_file_priv 空的时候&#xff0c;任意读写&#xff0c;存在严重的安全风险 secure_file_priv 某个…

碳课堂|搞清楚碳足迹,只看这篇文章就够了

碳足迹管理是碳达峰碳中和的重要政策工具&#xff0c;2023年12月&#xff0c;国家发展改革委、工信部、国家市场监管总局、住房城乡建设部、交通运输部等部门联合印发《关于加快建立产品碳足迹管理体系的意见》&#xff0c;对产品碳足迹管理各项重点任务作出系统部署。 推动碳…

西安邀请媒体报道,附媒体名单

传媒如春雨&#xff0c;润物细无声&#xff0c;大家好&#xff0c;我是51媒体网胡老师。 媒体宣传加速季&#xff0c;100万补贴享不停&#xff0c;一手媒体资源&#xff0c;全国100城线下落地执行。详情请联系胡老师。 西安市&#xff0c;作为中国古都之一&#xff0c;不仅拥有…

APP渗透-android12夜神模拟器+Burpsuite实现

一、夜神模拟器下载地址&#xff1a;https://www.yeshen.com/ 二、使用openssl转换证书格式 1、首先导出bp证书 2、将cacert.der证书在kali中转换 使用openssl生成pem格式证书,并授予最高权限 openssl x509 -inform der -in cacert.der -out cacert.pem chmod 777 cacert…

110.字符串接龙

题目描述&#xff1a;字典 strList 中从字符串 beginStr 和 endStr 的转换序列是一个按下述规格形成的序列&#xff1a; &#xff08;1&#xff09;序列中第一个字符串是 beginStr。&#xff08;2&#xff09;序列中最后一个字符串是 endStr。 &#xff08;3&#xff09;每次转…

代理模式详解、RESTFul风格、Spring IOC

Day49 代理模式proxy 概念&#xff1a; 代理(Proxy)是一种设计模式&#xff0c;提供了对目标对象另外的访问方式&#xff0c;即通过代理对象访问目标对象.这样做的好处是:可以在目标对象实现的基础上,增强额外的功能操作,即扩展目标对象的功能. 代理模式分为静态代理和动态代理…

【一】m2芯片的mac中安装ubuntu24虚拟机集群

文章目录 1. 虚拟机配置2. 复制虚拟机2.1 修改主机名2.2 修改网络 1. 虚拟机配置 在官方网站下载好ubuntu24-arm版镜像开始安装&#xff0c;安装使用VMWare Fusion的社区免费授权版,使用一台m2芯片的mac电脑作为物理机平台。 为什么选择ubuntu24&#xff1f;因为centOS7目前已…