Kimi K۳: غول ۲.۸ تریلیون پارامتری که «جبهه‌ی بسته» را در هم شکست

زمان مطالعه: ۶ دقیقه

«۲.۸ تریلیون پارامتر، ۸۹۶ متخصص، یک میلیون توکن بافت، و یک هدف: رساندن «منبع‌باز» به جایگاهی که تا دیروز فقط در انحصار «بسته‌ها» بود. ماه‌عاشقانه (Moonshot AI) با Kimi K3 نه فقط یک مدل، که یک اعلامیه‌ی تاریخی صادر کرده است: «عصر برتریِ محضِ مدل‌های بسته به پایان رسیده است.»»


در تاریخ ۱۶ ژوئیه ۲۰۲۶، شرکت چینی «ماه‌عاشقانه» (Moonshot AI) از مدل جدید خود با نام Kimi K3 رونمایی کرد. این مدل با ۲.۸ تریلیون پارامتر، عنوان بزرگ‌ترین مدل متن‌باز (Open-Weight) جهان را به خود اختصاص داده است.Kimi K3 از معماری Mixture of Experts (MoE) با ۸۹۶ متخصص استفاده می‌کند که در هر بار پردازش، تنها ۱۶ متخصص از میان آنها فعال می‌شوند.این مدل در بنچمارک‌های مختلف، عملکردی در سطح مدل‌های بسته‌ی برتری مانند Claude Fable 5 و GPT-5.6 Sol از خود نشان داده است.

سه بازیگر اصلی این تحول عبارت‌اند از: ماه‌عاشقانه (Moonshot AI) که با این مدل، مرزهای «منبع‌باز» را تا آستانه‌ی «بهترین‌های بسته» جابه‌جا کرده است؛ اکوسیستم توسعه‌دهندگان جهانی که برای اولین بار به مدلی با این ابعاد و با مجوز دسترسی آزاد دست یافته‌اند؛ و غول‌های بسته‌ی آمریکایی (Anthropic، OpenAI، Google) که ناگهان با یک رقیبِ منبع‌باز و بسیار نزدیک به سطح کیفی خود مواجه شده‌اند. پارادوکس عمیق ماجرا در این جمله خلاصه می‌شود: «ماه‌عاشقانه برای «شکست دادنِ» مدل‌های بسته، «متن‌باز» را به سلاحیِ راهبردی تبدیل کرده است؛ یعنی «دسترسیِ همگانی» و «شفافیت» را به «مزیتِ رقابتی» بدل ساخته، نه به «نقطه‌ی ضعف».»


معماری فنی: «۸۹۶ متخصص» و «یک میلیون توکن»

Kimi K3 بر روی معماری Mixture of Experts (MoE) با ۲.۸ تریلیون پارامتر ساخته شده است.اما «روح» این مدل در سه نوآوری کلیدی نهفته است:

۱. معماری MoE با ۸۹۶ متخصص: Kimi K3 دارای ۸۹۶ متخصص (Expert) در لایه‌های MoE خود است که در هر بار پردازش، تنها ۱۶ متخصص از میان آنها فعال می‌شوند.این «پراکندگیِ بالا» (High Sparsity) به مدل اجازه می‌دهد تا با وجود ۲.۸ تریلیون پارامتر، مصرف محاسباتی را در سطحی منطقی نگه دارد.

۲. Kimi Delta Attention (KDA) و Attention Residuals (AttnRes): Kimi K3 از دو معماری اختصاصی برای بهبود کارایی در بافت‌های طولانی استفاده می‌کند: KDA (Kimi Delta Attention) یک مکانیزم توجه ترکیبی-خطی است که در سناریوهای یک میلیون توکنی، سرعت رمزگشایی را تا ۶.۳ برابر افزایش می‌دهد.Attention Residuals (AttnRes) نیز با کمتر از ۲٪ هزینه‌ی محاسباتی اضافی، بازدهی آموزش را تا ۲۵٪ بهبود می‌بخشد.

۳. پنجره‌ی متنی یک میلیون توکنی: Kimi K3 از یک پنجره‌ی متنی ۱ میلیون توکنی پشتیبانی می‌کند که به آن امکان می‌دهد کل یک کتابخانه‌ی کد بزرگ یا اسناد طولانی را در یک بار پردازش کند.

بر اساس اعلام ماه‌عاشقانه، این بهبودهای معماری، بازدهی کلیِ گسترش (Scaling Efficiency) مدل را نسبت به نسل قبلی (Kimi K2) حدود ۲.۵ برابر افزایش داده است.


عملکرد در بنچمارک‌ها: «نزدیک به بهترین‌های بسته»

Kimi K3 در بنچمارک‌های متعدد، عملکردی در سطح مدل‌های بسته‌ی برتر جهان نشان داده است.

در Artificial Analysis Intelligence Index: Kimi K3 با امتیاز ۵۷ در رتبه‌ی سوم جهانی قرار گرفته است که仅次于 Claude Fable 5 و GPT-5.6 Sol و پیشی‌گیرنده از Claude Opus 4.8 و GPT-5.5.

در Frontend Code Arena (Arena.ai): Kimi K3 با ۱۶۷۹ امتیاز در صدر جدول قرار گرفته و از Claude Fable 5 (۱۶۳۱) و GPT-5.6 Sol (۱۶۱۸) پیشی گرفته است.این بنچمارک بر اساس آرای میلیون‌ها کاربر در آزمون‌های کور (Blind Tests) انجام شده است.Kimi K3 در ۶ حوزه از ۷ حوزه این بنچمارک (شامل برند و بازاریابی، طراحی مبتنی بر مرجع، داده و تحلیل، محصولات مصرفی، شبیه‌سازی و ابزارهای ایجاد محتوا) رتبه‌ی اول را کسب کرده و تنها در حوزه‌ی «بازی» پس از Fable 5 در جایگاه دوم قرار گرفته است.

در سایر بنچمارک‌ها:

بنچمارکامتیاز Kimi K3رتبه / توضیح
Program Bench۷۷.۸پیشی‌گیری از Fable 5 (۷۶.۸) و GPT-5.6 Sol (۷۷.۶)
BrowseComp۹۱.۲کسب بالاترین امتیاز (SOTA) در检索 بلندمدت
SWE Marathon۴۲.۰پیشی‌گیری از هر دو رقیب
Terminal Bench 2.1۸۸.۳تنها ۰.۵ امتیاز کمتر از GPT-5.6 Sol (۸۸.۸)
GDPval-AA v2۱۶۸۷رتبه‌ی سوم، پس از Fable 5 و GPT-5.6 Sol
AA-Briefcase۱۵۲۷رتبه‌ی دوم، تنها پس از Fable 5

با این حال، ماه‌عاشقانه صراحتاً اعلام کرده است که «تجربه‌ی کاربری کلی» Kimi K3 همچنان از Claude Fable 5 و GPT-5.6 Sol عقب‌تر است.


قیمت‌گذاری: «افزایش قیمت تا سطح رقبای آمریکایی»

Kimi K3 دیگر «مدل ارزانِ چینی»ِ سابق نیست. قیمت‌گذاری API این مدل به شرح زیر است:

نوعقیمت (به ازای هر ۱ میلیون توکن)
ورودی (Cache Hit)۰.۳۰ دلار
ورودی (Cache Miss)۳.۰۰ دلار
خروجی۱۵.۰۰ دلار

این قیمت‌ها دقیقاً برابر با قیمت‌های Claude Sonnet 5 است.به عبارت دیگر، ماه‌عاشقانه برای اولین بار یک مدل چینی را با قیمتی در سطح رقبای آمریکایی عرضه کرده است.بر اساس测算‌های Artificial Analysis، هزینه‌ی هر وظیفه (Task Cost) با Kimi K3 حدود ۰.۹۴ دلار است که با GPT-5.6 Sol (۱.۰۴ دلار) نزدیک بوده و حدود نیمی از Claude Opus 4.8 (۱.۸۰ دلار) هزینه دارد.


دسترسی و وزن‌های باز: «انقلابِ ۲۷ ژوئیه»

ماه‌عاشقانه اعلام کرده است که وزن‌های کامل (Full Weights) Kimi K3 تا ۲۷ ژوئیه ۲۰۲۶ به‌صورت عمومی منتشر خواهد شد.این یعنی توسعه‌دهندگان در سراسر جهان می‌توانند این مدل ۲.۸ تریلیون پارامتری را دانلود، اجرا و بر روی آن فاین‌تون کنند – به شرطی که سخت‌افزار لازم برای اجرای آن را در اختیار داشته باشند.

Kimi K3 هم‌اکنون از طریق Kimi، Kimi Work، Kimi Code و API در دسترس است.


واکنش‌ها: «شوک در سیلیکون‌ولی و واشنگتن»

ایلان ماسک در واکنش به عملکرد Kimi K3 در بنچمارک‌ها، در شبکه‌ی اجتماعی X نوشت: «Impressive (قابل‌توجه)».

Axios در تحلیلی نوشت: «عملکرد اولیه‌ی Kimi K3 در سراسر جهان هوش مصنوعی شوک ایجاد کرده است – و در سیلیکون‌ولی و واشنگتن نیز زنگ‌های خطر را به صدا درآورده است – زیرا به نظر می‌رسد چین به‌سرعت در حال از بین بردن برتری آمریکا در هوش مصنوعی پیشرفته است.»

رافی کریکوریان، مدیر ارشد فناوری موزیلا، به Axios گفت: «در حال حاضر، این یک سوال «آمریکا در برابر چین» است.» او افزود که آزمایشگاه‌های هوش مصنوعی آمریکا «به‌وضوح نگران» هستند.

Bank of America در یادداشتی به رهبری الکس لیو نوشت: «علیرغم محدودیت‌های پایدار سخت‌افزاری/محاسباتی در چین، K3 نشان می‌دهد که مقیاس‌سازی پیش‌آموزش، همراه با نوآوری معماری، همچنان می‌تواند جهش‌های پله‌ای را برای مدل‌های پرچمدار چین به ارمغان آورد.»

واکنش بازار سهام: سهام Z.ai (رقیب مستقیم) پس از اعلام Kimi K3، ۲۸٪ سقوط کرد و سهام MiniMax نیز ۱۶٪ ریزش داشت.


«لحظه‌ای که «منبع‌باز» به «مرزِ فناوری» رسید»

نام این رویداد را باید «لحظه‌ی بلوغِ منبع‌باز» گذاشت. Kimi K3 با ۲.۸ تریلیون پارامتر، معماری MoE با ۸۹۶ متخصص و عملکردی در سطح بهترین مدل‌های بسته، ثابت کرده است که «منبع‌باز» دیگر به معنای «ضعیف‌تر» یا «ارزان‌تر» نیست. این مدل نشان داده که با نوآوری معماری و داده‌های باکیفیت، می‌توان به سطحی از عملکرد دست یافت که تا دیروز فقط در انحصار شرکت‌های با بودجه‌های میلیاردی بود.

پرسش بی‌پاسخ این است: آیا «قیمت‌گذاریِ هم‌تراز با آمریکا» برای Kimi K3 یک «استراتژیِ بلندمدت» است یا یک «اقدامِ موقتی»؟ و آیا انتشار وزن‌های کامل در ۲۷ ژوئیه، که به توسعه‌دهندگان امکان اجرای محلی می‌دهد، می‌تواند «وفاداریِ کاربران» را از مدل‌های بسته به سمت این غولِ منبع‌باز جذب کند؟

یک چیز قطعی است: Kimi K3 با ۲.۸ تریلیون پارامتر، «دکمه‌ی شروعِ» یک «عصرِ جدید» را در صنعت هوش مصنوعی فشار داده است. عصرِ «منبع‌بازِ در سطحِ مرزِ فناوری». و در این عصر، برنده کسی نیست که «بزرگ‌ترین بودجه» را دارد، بلکه کسی است که «بهترین معماری» و «بازترین دسترسی» را ارائه دهد. سؤال این نیست که آیا «منبع‌باز» می‌تواند به «مرزِ فناوری» برسد – که رسیده است. سؤال این است که «مدل‌های بسته» چه پاسخی برای این «غولِ رها شده» خواهند داشت.

مقاله رو دوست داشتی؟ نظرت چیه؟

۷ پاسخ به “Kimi K۳: غول ۲.۸ تریلیون پارامتری که «جبهه‌ی بسته» را در هم شکست”

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *