گسترش استفاده عمومی از چتباتهای هوش مصنوعی باعث شده است بسیاری از افراد برای پاسخ به پرسشهای پزشکی، تفسیر نتایج آزمایشها و حتی حدس زدن علت علائم خود به این ابزارها مراجعه کنند؛ اما مطالعات علمی نشان میدهد که توانایی بالای این سامانهها در تولید پاسخهای روان و ظاهراً تخصصی، به معنای قابل اعتماد بودن آنها برای تشخیص و تصمیمگیری پزشکی نیست.
به گزارش سیناپرس، در یکی از مطالعات منتشرشده در مجله Nature Communications، عملکرد GPT-۳.۵ و GPT-۴ در ۱۱۰ مورد پزشکی و در سه حوزه «تشخیص اولیه»، «اقدامات تشخیصی» و «درمان» بررسی شد. اگرچه GPT-۴ در مجموع عملکرد قابل توجهی داشت، اما بالاترین امتیاز را در همه موارد به دست نیاورد. این مدل در بخش تشخیص تنها در ۱۸ مورد از ۱۱۰ مورد، در بخش اقدامات تشخیصی در ۲۴ مورد و در بخش درمان در ۲۶ مورد موفق به کسب امتیاز کامل شد. همچنین عملکرد مدلها در موارد مربوط به بیماریهای نادر ضعیفتر بود.
پژوهشگران در این مطالعه هشدار دادهاند که اگر بیماران بدون مشورت با متخصصان سلامت به چنین خروجیهایی اتکا کنند، خطا یا سوءبرداشت از پاسخ هوش مصنوعی میتواند به مشکلات پزشکی منجر شود. در عین حال، این مطالعه نشان داد که مدلهای زبانی بزرگ میتوانند در برخی وظایف پزشکی عملکرد امیدوارکنندهای داشته باشند؛ موضوعی که نشان میدهد مسئله، کنار گذاشتن هوش مصنوعی نیست، بلکه تعیین جایگاه درست آن در فرآیند درمان است.
پاسخ روان، الزاماً پاسخ درست نیست
یکی از چالشهای اصلی چتباتهای مولد این است که این سامانهها پاسخهایی را بر اساس الگوهای موجود در دادههای آموزشی تولید میکنند و یک پاسخ روان، منسجم و با لحن تخصصی الزاماً به معنای درست بودن آن نیست.
در پزشکی، اهمیت این موضوع دوچندان است؛ زیرا یک پاسخ اشتباه میتواند صرفاً یک خطای اطلاعاتی نباشد و در ادامه به تصمیم اشتباه بیمار منجر شود؛ از جمله تأخیر در مراجعه به پزشک، برداشت نادرست از نتیجه آزمایش یا انتخاب اقدامی نامناسب.از سوی دیگر، تشخیص پزشکی صرفاً تطبیق چند علامت با فهرستی از بیماریها نیست. پزشک در فرآیند تشخیص، شرح حال، معاینه، سابقه بیماری، داروهای مصرفی، وضعیت عمومی بیمار و نتایج آزمایشها و تصویربرداری را در کنار یکدیگر قرار میدهد و بر اساس شرایط فرد تصمیمگیری میکند.
به همین دلیل، تفسیر یک نتیجه آزمایش بدون دانستن زمینه بالینی بیمار نیز میتواند گمراهکننده باشد. یک عدد آزمایشگاهی ممکن است بسته به سن، جنس، سابقه پزشکی، داروهای مصرفی و سایر یافتههای بالینی معنای متفاوتی داشته باشد.
نگرانی درباره استفاده پزشکی از چتباتها فقط به یک مطالعه محدود نیست. یک مرور نظاممند منتشرشده در JAMA Network Open در سال ۲۰۲۵، ۱۳۷ مطالعه درباره عملکرد مدلهای زبانی بزرگ در ارائه توصیههای سلامت را بررسی کرد.
این مرور نشان داد : روش ارزیابی این سامانهها در مطالعات مختلف بسیار متفاوت بوده و تنها کمتر از یکسوم مطالعات، موضوعاتی مانند اخلاق، مقررات و ایمنی بیمار را مورد توجه قرار داده بودند. نویسندگان بر ضرورت روشهای استانداردتر برای ارزیابی چتباتهای پزشکی تأکید کردند.
مطالعه دیگری که در JAMA منتشر شده و ۵۱۹ پژوهش درباره کاربردهای مدلهای زبانی بزرگ در سلامت را بررسی کرده است نیز نشان داد که تنها ۵ درصد مطالعات از دادههای واقعی مراقبت از بیماران برای ارزیابی این سامانهها استفاده کردهاند. پژوهشگران نتیجه گرفتهاند که ارزیابیهای فعلی در حوزه سلامت همچنان پراکنده و ناکافی است و برای استفاده گستردهتر از این فناوری، ارزیابی با دادههای واقعی بیماران و معیارهای استاندارد ضرورت دارد.
هوش مصنوعی میتواند دستیار پزشک باشد نه جایگزین آن
این یافتهها به معنای بیفایده بودن هوش مصنوعی در پزشکی نیست. برعکس، سرعت پردازش اطلاعات، توانایی خلاصهسازی متون، دسترسی به حجم گستردهای از اطلاعات پزشکی و امکان کمک به برخی فرآیندهای تشخیصی و اداری، ظرفیت قابل توجهی برای استفاده از این فناوری در نظام سلامت ایجاد کرده است.
مسئله زمانی آغاز میشود که بیمار، پاسخ یک چتبات عمومی را معادل تشخیص پزشک در نظر بگیرد.هوش مصنوعی میتواند به بیمار کمک کند سؤالهای مناسبتری از پزشک بپرسد، درباره یک بیماری اطلاعات عمومی کسب کند یا اصطلاحات پزشکی را بهتر بفهمد؛ اما تصمیم درباره تشخیص، درمان و تغییر دارو باید بر اساس ارزیابی بالینی و در چارچوب مسئولیت حرفهای نظام سلامت انجام شود.
چرا «جایگزین پزشک» تعبیر دقیقی نیست؟
مطالعات موجود تصویری دوگانه از هوش مصنوعی ارائه میکنند: از یک سو، مدلهای زبانی میتوانند در برخی وظایف پزشکی عملکرد قابل توجهی داشته باشند و از سوی دیگر، همین مدلها هنوز در شماری از موارد دچار خطا میشوند و شیوه ارزیابی عملکرد آنها نیز در بسیاری از مطالعات استاندارد و یکدست نیست.
بنابراین پرسش اصلی نباید این باشد که «هوش مصنوعی بهتر است یا پزشک؟» بلکه باید پرسید: هوش مصنوعی در کدام بخش از فرآیند پزشکی، با چه میزان نظارت و بر اساس چه استانداردی میتواند به پزشک و بیمار کمک کند؟
پاسخ به این پرسش اهمیت زیادی دارد؛ زیرا استفاده درست از فناوری میتواند دسترسی به اطلاعات و برخی خدمات سلامت را تسهیل کند، اما استفاده نادرست از آن بهعنوان جایگزین تشخیص و قضاوت بالینی میتواند بیمار را با خطر تصمیمگیری بر اساس اطلاعات ناقص یا نادرست مواجه کند.
در نهایت، استفاده از چتباتهای هوش مصنوعی برای کسب اطلاعات عمومی پزشکی میتواند مفید باشد، اما پاسخ یک سامانه هوش مصنوعی نباید بهتنهایی مبنای تشخیص بیماری، شروع یا قطع دارو و به تعویق انداختن مراجعه به پزشک قرار گیرد.
برآیند شواهد موجود نشان میدهد: هوش مصنوعی میتواند بهعنوان یک ابزار کمکی در پزشکی مورد استفاده قرار گیرد، اما اتکای مستقل به خروجی آن برای تشخیص یا تصمیمگیری درمانی، بدون ارزیابی پزشک، با خطر خطا همراه است.
گزارش:احسان محمدحسینی

