چتباتها و مدلهای زبانی
چتباتهای پیشرفته مانند ChatGPT، کلود و سایر مدلهای زبانی

اعتماد کورکورانه به کلود را فراموش کنید؛ این آزمایش همه چیز را عوض کرد
آیا Grok 4.5 میتواند با یک چهارم هزینه با Claude Opus رقابت کند؟ آزمایش عملی ما روی سه وظیفه کدنویسی در Rust نشان میدهد که xAI در صرفهجویی در توکنها موفق بوده، اما Opus همچنان در سرعت و دقت بیرقیب است.

قیام گندمهای باز چینی: Kimi K3 مدل Moonshot شکاف با Opus 4.8 Anthropic را میبندد
Moonshot AI مدل Kimi K3 را با ۲ تا ۳ تریلیون پارامتر به عنوان بزرگترین مدل اوپنوزن Çin انتشار میدهد؛ ادعا میشود عملکردی همسطح یا برتری نسبت به Opus 4.8 Anthropic داشته باشد. همزمان شرکت با ارزشی ۳۱.۵ میلیارد دلاری در حال جذب سرمایه جدید است، در حالی که نگرانی از استخراج داده توسط مدلهای بسته، سازمانها را به سوی جایگزینهای اوپنسورس چین میراند.

متا هشدار خودکشی نوجوانان را به والدین میفرستد؛ هوش مصنوعی ایمنتر میشود
متا سیستم هشدار جدیدی راهاندازی کرد که والدین را مطلع میکند اگر نوجوانشان در گفتگو با متا AI به خودکشی یا خودآزاری اشاره کند. هشدارها پس از بررسی دستی ارسال میشوند و تا پایان سال به'échelle جهانی گسترش مییابند. تنظیمات «محتوای محدود» نیز اکنون روی چتبات اعمال میشود.

گمّا ۴ بهروزرسانی پنهانی گرفت: رفع باگهای فراخوانی ابزار و پاسخهای ناقص با افزایش ۷۰٪ سرعت روی GPUهای هاپر
گوگل بهصورت ناگهانی گمّا ۴ را با اصلاحات مهم بهروزرسانی کرد: رفع باگهای فراخوانی ابزار، حذف پاسخهای ناقص، و افزایش ۷۰٪ سرعت روی GPUهای انویدیا هاپر با Flash Attention ۴. پارامتر max_soft_tokens برای OCR به ۱۱۲۰ ارتقا یافت. جامعه توسعهدهندگان از نگهداشتن نام «گمّا ۴» بهجای نسخهگذاری استاندارد انتقاد کردهاند.

چگونه زبان، شخصیت کلود را تغییر میدهد؟ مطالعه آنتروپیک از ۳۰۰ هزار مکالمه
مطالعه آنتروپیک بر ۳۰۹ هزار مکالمه کلود نشان میدهد زبان مکالمه، سبک پاسخ مدل را از گرمی در هندی تا سختگیری در روسی تغییر میدهد. چهار محور ارزش کشف شده و محدودیتهای روششناختی بررسی شدهاند.
