شرکت OpenAI پس از ماه‌ها آزمایش، ویژگی جدید خود را برای کاربران 18 سال و بالاتر در ایالات متحده فعال کرده است. این ابزار به کاربران اجازه می‌دهد Apple Health، سوابق پزشکی و برنامه‌های سلامتی را به چت‌بات متصل کنند تا نتایج آزمایشگاهی بررسی و برای قرارهای پزشکی آماده شوند. با این حال، شاید پرداخت هزینه اشتراک بتواند تفاوت میان سلامت و بیماری را تعیین کند.

تفاوت کیفیت توصیه‌های پزشکی در نسخه رایگان و پولی چت‌جی‌پی‌تی

سیستم دو طبقه‌ای در خدمات پزشکی هوش مصنوعی

کاربران نسخه رایگان چت‌جی‌پی‌تی با مدل GPT-5.5 Instant سروکار دارند که در معیارهای سلامتی نمره پایین‌تری نسبت به مدل پرچمدار GPT-5.6 Sol کسب می‌کند. این مدل پیشرفته‌تر تنها برای مشترکین پولی رزرو شده است. OpenAI برای دفاع از این سیستم دو طبقه‌ای به نتایج آزمون HealthBench Professional استناد می‌کند و ادعا می‌کند هر دو مدل عملکرد بهتری نسبت به پاسخ‌های پزشکان داشته‌اند.

با این وجود، نتایج بنچمارک‌ها در محیط‌های مصنوعی و کنترل‌شده به دست می‌آیند. پزشکان در شرایط واقعی با فشار زمانی و خستگی دست‌وپنجه نرم می‌کنند و ممکن است بدون ابزارهایی مانند سوابق بیمار یا مشورت با همکاران این آزمون‌ها را بگذرانند. کاربران برای دسترسی به امکانات تخصصی باید به بخش سلامت در چت‌جی‌پی‌تی مراجعه کنند، اگرچه خود شرکت نیز تاکید دارد که این ابزار جایگزین توصیه‌های پزشکی نیست و بیش از 260 پزشک در توسعه آن مشارکت داشته‌اند.

بنچمارک‌ها در برابر واقعیت بالینی

آزمون‌های استاندارد نمی‌توانند بخش عمده‌ای از اتفاقات در یک معاینه پزشکی واقعی را ثبت کنند. در دنیای واقعی، پزشکان بیماران را به صورت حضوری معاینه می‌کنند، به نشانه‌های غیرکلامی توجه نشان می‌دهند و از تجربه سال‌های خود برای ارزیابی وضعیت کلی آن‌ها بهره می‌برند. OpenAI نیز در اطلاعیه‌های خود صراحتاً بیان می‌کند که چت‌جی‌پی‌تی همچنان ممکن است اشتباه کند.

آمار استفاده و چالش‌های رابط کاربری

آزمایش‌های اولیه نشان داد بیش از 70 درصد کاربران سوالات سلامتی را خارج از بخش اختصاصی می‌پرسیدند، زیرا جابه‌جایی بین بخش‌ها برایشان دشوار بود. به همین دلیل، شرکت این قابلیت را در تمام مکالمات فعال کرده و بخش جداگانه را تنها برای مدیریت داده‌ها حفظ کرده است. آمارها نشان می‌دهد اکنون بیش از 300 میلیون نفر هفته‌ای سوالات سلامتی را از چت‌جی‌پی‌تی می‌پرسند که رقم قابل توجهی محسوب می‌شود.

موانع اروپا و خطرات اعتماد به نفس کاذب

ویژگی سلامت چت‌جی‌پی‌تی هنوز در اروپا، سوئیس و بریتانیا عرضه نشده است. قانون هوش مصنوعی اتحادیه اروپا و قوانین سخت‌گیرانه حریم خصوصی داده‌ها، احتمالاً این ویژگی را به عنوان یک سیستم پرخطر طبقه‌بندی می‌کنند و مانع از عرضه آن شده‌اند.

این خطرات صرفاً فرضی نیستند. در جدیدترین بنچمارک رادیولوژی با نام RadLE 2.0، هیچ‌یک از 16 مدل هوش مصنوعی آزمایش‌شده نتوانستند عملکرد رادیولوژیست‌های انسانی را ثبت کنند. مشکل اصلی این بود که چت‌بات‌ها به جای پذیرش محدودیت‌های خود، نتایج نادرست را با اطمینان بالایی ارائه می‌دادند. این ترکیب اعتماد به نفس کاذب و چاپلوسی، جایی که هوش مصنوعی به جای به چالش کشیدن فرضیات نادرست کاربران آن‌ها را تایید می‌کند، به آسیب‌های جدی در سلامت روان نیز دامن زده است.

در کنار این نگرانی‌ها، برخی گزارش‌ها نشان می‌دهند هوش مصنوعی توانایی کشف الگوهایی در داده‌های سلامتی را دارد که متخصصان انسانی از دست آن‌ها عاجزند. با این حال، تا زمانی که چالش اعتماد به نفس کاذب در مدل‌های زبانی حل نشود، جایگزینی برای تجربه بالینی پزشکان متصور نخواهد بود.