چتباتها و مدلهای زبانی
چتباتهای پیشرفته مانند ChatGPT، کلود و سایر مدلهای زبانی

از GPT-1 تا GPT-3: سه گام تحول پردازش زبان
روند تحول GPT از اثبات مفهوم در GPT-1 تا جنجال انتشار GPT-2 و ظهور مهندسی پرامپت در GPT-3؛ چگونه مقیاس، معماری و سیاستهای انتشار مسیر پردازش زبان را تغییر دادند.

پدیداری در مدلهای زبانی: چگونه توانمندیهای ناگهانی در مدلهای زبانی بزرگ پدید میآیند
پدیداری در مدلهای زبانی بزرگ بهمعنای ظهور ناگهانی توانمندیهای کیفی است؛ از یادگیری در متن تا استدلال چندمرحلهای—پدیدهای که چشمانداز پژوهش و سیاستگذاری را دگرگون میکند.

ریاضیدانان: مدلهای زبانی بزرگ محاسبهگرند نه خلاق
تیموتی گاورز، پیتر سارناک و محققان دیپمایند میگویند مدلهای زبانی بزرگ محاسبات قوی دارند اما در ابداع انتزاعات و ایدههای بنیادی کم میآورند.

انکار خودآگاهی در مدلهای هوش مصنوعی جهانبینی را تغییر میدهد
پژوهش مشترک گوگل و دانشگاه شیکاگو نشان میدهد انکار خودآگاهی در مدلهای زبانی، باورهای آنها درباره حیوانات، مذهب و حس کنترل بر زندگی را جابهجا میکند.

EleutherAI: نقش پروژههای متنباز در توسعه و دسترسپذیری مدلهای بزرگ زبانی (LLM)
EleutherAI با انتشار GPT‑Neo، GPT‑J و مجموعهدادهٔ Pile ستون فقرات موج متنباز در توسعهٔ مدلهای بزرگ زبانی را ساخته است؛ این پروژهها هم فرصت و هم چالشهای جدیدی را ایجاد میکنند.

مهندسی پرامپت: روشها، الگوها و نقش شغلی نوظهور
راهنمای عملی مهندسی پرامپت: تکنیکها، الگوها، حاکمیت و مهارتهای مورد نیاز برای تبدیل پرامپت از آزمون و خطا به دارایی سازمانی.

ارزیابی مدلهای زبان بزرگ: تکامل بنچمارکها از GLUE تا BIG-Bench و فراتر
نگاهی به سیر تحول بنچمارکهای LLM از GLUE و SuperGLUE تا BIG-Bench، MMLU و چالشهای ارزیابی انسانی و مولتیمودال.

زنجیره فکری؛ کلید ارتقای استدلال در مدلهای زبانی بزرگ
زنجیره فکری با نشان دادن مراحل میانی استدلال، عملکرد مدلهای زبانی بزرگ را در مسائل چندمرحلهای بهطور چشمگیر ارتقا میدهد؛ اما پرسشهایی درباره تعمیم و اتکاپذیری باقی است.

سیر تحول مدلهای بزرگ زبان؛ 2018–2026
مرور تحولات 2018–2026 مدلهای بزرگ زبان: از نوآوریهای معماری تا تخصصیسازی محصولی و ظهور گونههایی مانند Gemini 3.7 Flash برای کدنویسی و عاملها.

متنباز در مقابل اختصاصی: معاوضهها در توسعهٔ مدلهای زبانی بزرگ
تنش میان پروژههای متنباز و اختصاصی در توسعهٔ مدلهای زبانی بزرگ بر بازتولیدپذیری، ایمنی و رقابت اثر میگذارد؛ انتخاب مناسب بستگی به هدف، منابع و حوزهٔ کاربرد دارد.

مهندسی زمینه — ۳۰۰ توکن درست بهتر از ۱۰۰٬۰۰۰ نویز
پرکردن پنجرهٔ کانتکست با مستندات طولانی عملکرد عاملهای کدنویسی را خراب میکند. این گزارش راهکارهای عملی برای «مهندسی زمینه» ارائه میدهد.

ChatGPT برای مک: قابلیت Computer History تاریخچهٔ فعالیتهای کاری را ثبت میکند
OpenAI قابلیت جدید Computer History را برای ChatGPT روی macOS معرفی کرده؛ ابزاری که بدون اسکرینشات، فعالیتهای روزانهٔ شما را ثبت و به یادآوری و بازیابی زمینههای کاری کمک میکند.
