توی همون روزهایی که از پیشرفت هوش مصنوعی ذوق میکنیم، یه تحقیق جدید که امروز توی مجله «Medical Sciences» منتشر شده، یه کم ما رو به زمین برمیگردونه. محققا توی این مطالعه که روی ۱۸۳ عکس رادیولوژی از بیماران بدحال بستری در بخش مراقبتهای ویژه انجام شده، به این نتیجه رسیدن که مدلهای زبانی بزرگ (Multimodal LLMs) که ادعا میکنن میتونن عکس رو ببینن و تشخیص بدن، اصلاً قابل اعتماد نیستن و نباید فعلاً ازشون توی بخشهای حساس استفاده کرد.
محققا تشخیص پنج تا از بهترین این مدلها رو با تشخیص چهار تا پزشک متخصص آیسییو مقایسه کردن. نتیحه جالبی که گرفتن این بود که دقت این هوشهای مصنوعی در تشخیص محل کاتتر ورید مرکزی بین ۳۳.۹ تا ۸۷.۴ درصد متغییر بود. اما بدتر از اون، جایی بود که هوشهای مصنوعی تقریباً تمام موارد رو «نرمال» یا «خوب» تشخیص میدادن در حالی که اصلاً اینطور نبود. یعنی هوش مصنوعی یه جورایی «تنبلی تشخیصی» داره و خیلی از مشکلات رو نمیبینه.
قسمت نگرانکنندهتر ماجرا این بود که هر پنج مدل هوش مصنوعی، تمام موارد پنوموتوراکس (جمع شدن هوا بین ریه و قفسه سینه) رو منفی تشخیص دادن. یعنی اصلاً متوجه نبودن که ریه بیمار باد کرده. این نشون میده که این مدلها هنوز برای استفاده عملی در محیطهای بالینی خطرناک هستن و متخصصین نباید بیچون و چرا بهشون اعتماد کنن. پس فعلاً باید حواسمون جمع باشه که ماشین نمیتونه جای تجربه یه پزشک حاذق رو بگیره.
More Stories
اروپا با بدترین خشکسالی هزاره اخیر دست و پنجه نرم میکند
هیبریدها ناجی هوندا، هیوندای و کیا در ماه ژوئیه شدند
جزئیات فصل جدید دابلیو دبلیو ای ۲کی ۲۶ منتشر شد؛ تغییرات بزرگ در حالت مدیریتی