شرکت OpenAI پس از ماهها آزمایش، ویژگی جدید خود را برای کاربران 18 سال و بالاتر در ایالات متحده فعال کرده است. این ابزار به کاربران اجازه میدهد Apple Health، سوابق پزشکی و برنامههای سلامتی را به چتبات متصل کنند تا نتایج آزمایشگاهی بررسی و برای قرارهای پزشکی آماده شوند. با این حال، شاید پرداخت هزینه اشتراک بتواند تفاوت میان سلامت و بیماری را تعیین کند.
سیستم دو طبقهای در خدمات پزشکی هوش مصنوعی
کاربران نسخه رایگان چتجیپیتی با مدل GPT-5.5 Instant سروکار دارند که در معیارهای سلامتی نمره پایینتری نسبت به مدل پرچمدار GPT-5.6 Sol کسب میکند. این مدل پیشرفتهتر تنها برای مشترکین پولی رزرو شده است. OpenAI برای دفاع از این سیستم دو طبقهای به نتایج آزمون HealthBench Professional استناد میکند و ادعا میکند هر دو مدل عملکرد بهتری نسبت به پاسخهای پزشکان داشتهاند.
با این وجود، نتایج بنچمارکها در محیطهای مصنوعی و کنترلشده به دست میآیند. پزشکان در شرایط واقعی با فشار زمانی و خستگی دستوپنجه نرم میکنند و ممکن است بدون ابزارهایی مانند سوابق بیمار یا مشورت با همکاران این آزمونها را بگذرانند. کاربران برای دسترسی به امکانات تخصصی باید به بخش سلامت در چتجیپیتی مراجعه کنند، اگرچه خود شرکت نیز تاکید دارد که این ابزار جایگزین توصیههای پزشکی نیست و بیش از 260 پزشک در توسعه آن مشارکت داشتهاند.
بنچمارکها در برابر واقعیت بالینی
آزمونهای استاندارد نمیتوانند بخش عمدهای از اتفاقات در یک معاینه پزشکی واقعی را ثبت کنند. در دنیای واقعی، پزشکان بیماران را به صورت حضوری معاینه میکنند، به نشانههای غیرکلامی توجه نشان میدهند و از تجربه سالهای خود برای ارزیابی وضعیت کلی آنها بهره میبرند. OpenAI نیز در اطلاعیههای خود صراحتاً بیان میکند که چتجیپیتی همچنان ممکن است اشتباه کند.
آمار استفاده و چالشهای رابط کاربری
آزمایشهای اولیه نشان داد بیش از 70 درصد کاربران سوالات سلامتی را خارج از بخش اختصاصی میپرسیدند، زیرا جابهجایی بین بخشها برایشان دشوار بود. به همین دلیل، شرکت این قابلیت را در تمام مکالمات فعال کرده و بخش جداگانه را تنها برای مدیریت دادهها حفظ کرده است. آمارها نشان میدهد اکنون بیش از 300 میلیون نفر هفتهای سوالات سلامتی را از چتجیپیتی میپرسند که رقم قابل توجهی محسوب میشود.
موانع اروپا و خطرات اعتماد به نفس کاذب
ویژگی سلامت چتجیپیتی هنوز در اروپا، سوئیس و بریتانیا عرضه نشده است. قانون هوش مصنوعی اتحادیه اروپا و قوانین سختگیرانه حریم خصوصی دادهها، احتمالاً این ویژگی را به عنوان یک سیستم پرخطر طبقهبندی میکنند و مانع از عرضه آن شدهاند.
این خطرات صرفاً فرضی نیستند. در جدیدترین بنچمارک رادیولوژی با نام RadLE 2.0، هیچیک از 16 مدل هوش مصنوعی آزمایششده نتوانستند عملکرد رادیولوژیستهای انسانی را ثبت کنند. مشکل اصلی این بود که چتباتها به جای پذیرش محدودیتهای خود، نتایج نادرست را با اطمینان بالایی ارائه میدادند. این ترکیب اعتماد به نفس کاذب و چاپلوسی، جایی که هوش مصنوعی به جای به چالش کشیدن فرضیات نادرست کاربران آنها را تایید میکند، به آسیبهای جدی در سلامت روان نیز دامن زده است.
در کنار این نگرانیها، برخی گزارشها نشان میدهند هوش مصنوعی توانایی کشف الگوهایی در دادههای سلامتی را دارد که متخصصان انسانی از دست آنها عاجزند. با این حال، تا زمانی که چالش اعتماد به نفس کاذب در مدلهای زبانی حل نشود، جایگزینی برای تجربه بالینی پزشکان متصور نخواهد بود.





