توی همون روزهایی که از پیشرفت هوش مصنوعی ذوق میکنیم، یه تحقیق جدید که امروز توی مجله «Medical Sciences» منتشر شده، یه کم ما رو به زمین برمیگردونه. محققا توی این مطالعه که روی ۱۸۳ عکس رادیولوژی از بیماران بدحال بستری در بخش مراقبتهای ویژه انجام شده، به این نتیجه رسیدن که مدلهای زبانی بزرگ (Multimodal LLMs) که ادعا میکنن میتونن عکس رو ببینن و تشخیص بدن، اصلاً قابل اعتماد نیستن و نباید فعلاً ازشون توی بخشهای حساس استفاده کرد.
محققا تشخیص پنج تا از بهترین این مدلها رو با تشخیص چهار تا پزشک متخصص آیسییو مقایسه کردن. نتیحه جالبی که گرفتن این بود که دقت این هوشهای مصنوعی در تشخیص محل کاتتر ورید مرکزی بین ۳۳.۹ تا ۸۷.۴ درصد متغییر بود. اما بدتر از اون، جایی بود که هوشهای مصنوعی تقریباً تمام موارد رو «نرمال» یا «خوب» تشخیص میدادن در حالی که اصلاً اینطور نبود. یعنی هوش مصنوعی یه جورایی «تنبلی تشخیصی» داره و خیلی از مشکلات رو نمیبینه.
قسمت نگرانکنندهتر ماجرا این بود که هر پنج مدل هوش مصنوعی، تمام موارد پنوموتوراکس (جمع شدن هوا بین ریه و قفسه سینه) رو منفی تشخیص دادن. یعنی اصلاً متوجه نبودن که ریه بیمار باد کرده. این نشون میده که این مدلها هنوز برای استفاده عملی در محیطهای بالینی خطرناک هستن و متخصصین نباید بیچون و چرا بهشون اعتماد کنن. پس فعلاً باید حواسمون جمع باشه که ماشین نمیتونه جای تجربه یه پزشک حاذق رو بگیره.
More Stories
جزئیات فصل جدید دابلیو دبلیو ای ۲کی ۲۶ منتشر شد؛ تغییرات بزرگ در حالت مدیریتی
شاخص قیمت مواد غذایی فائو برای دومین ماه متوالی کاهش یافت
ادای احترام به مد کلاسیک؛ رالف لورن در میلان درخشید