«هفته‌ای که سه‌گانه‌ی «قدرت، سرعت و ارزانی» به میدان آمد؛ از سول تا گروک و دیپ‌سیک، نبردِ «هزینه‌ی هر وظیفه» جانشینِ «عملکردِ خام» شد

زمان مطالعه: ۷ دقیقه

«در یک هفته، چهار غولِ هوش مصنوعی هم‌زمان «مغزهای» جدید خود را به میدان فرستادند. از «سول» (Sol)ی که قدرت را فریاد می‌زند، تا «گروک ۴.۵»ی که ارزانی را به سلاح تبدیل کرده، و «جمینی ۳.۵ پرو»یی که با بازنویسیِ هسته‌ی خود به میدان بازمی‌گردد، و در نهایت «دیپ‌سیک وی۴» که با «قیمت‌گذاریِ ساعتی» قواعدِ بازیِ اقتصادِ هوش مصنوعی را تغییر می‌دهد. این، دیگر «رقابتِ مدل‌ها» نیست؛ این «جنگِ اقتصادِ محاسبات» است.»


مقدمه: «چهارضلعیِ سرنوشت» در یک هفته

هفته‌ی جاری، بی‌شک یکی از متراکم‌ترین و پرمعناترین هفته‌های تاریخِ صنعتِ هوش مصنوعی است. در فاصله‌ای کمتر از چند روز، چهار مدلِ بزرگ از چهار جبهه‌ی رقابتیِ اصلیِ جهان – آمریکا (OpenAI و xAI)، اروپا (Google DeepMind) و چین (DeepSeek) – هم‌زمان به میدان آمده‌اند. این «هم‌زمانیِ تاریخی»، رقابت را از سطحِ «کیفیتِ خامِ مدل» به سطحِ «اقتصادِ محاسباتیِ کلان» و «سرعتِ استقرار» کشانده است.

سه بازیگرِ اصلیِ این «نبردِ همه‌جانبه» عبارت‌اند از: OpenAI که با سه‌گانه‌ی «سول، ترا، لونا» (Sol, Terra, Luna)، «قدرتِ مطلق» را با «قیمتِ لایه‌ای» ترکیب کرده است؛ SpaceXAI (xAI) که با «گروک ۴.۵» (Grok 4.5)، «ارزانیِ انقلابی» را به عنوانِ سلاحِ اصلیِ خود انتخاب کرده است؛ و Google DeepMind که با «جمینی ۳.۵ پرو» (Gemini 3.5 Pro) و بازنویسیِ کاملِ هسته‌ی خود، به دنبالِ «کیفیتِ مطلق» در برابرِ «سرعتِ رقبا» است. در سویِ دیگرِ میدان، DeepSeek V4 از چین، با «قیمت‌گذاریِ پیک‌ساعتی» و «افزایشِ ۶۰ درصدیِ سرعتِ استنتاج»، معادله‌ی «ارزانی» را پیچیده‌تر کرده است. پارادوکسِ عمیقِ ماجرا در این جمله خلاصه می‌شود: «در این هفته، «قدرتِ محض» دیگر برنده نیست؛ «هزینه‌ی هر وظیفه» (Cost per Task) و «سرعتِ پاسخ‌گویی» (TPS) به معیارهایِ اصلیِ رقابت تبدیل شده‌اند. و در این نبرد، «ارزانی» به اندازه‌ی «قدرت» تعیین‌کننده شده است.»


GPT-5.6: سه‌گانه‌ای به نام «خورشید، زمین و ماه»

در تاریخ ۹ ژوئیه (و بامدادِ ۱۰ ژوئیه به وقتِ ایران)، OpenAI سرانجام پس از هفته‌ها تأخیر و بررسی‌هایِ امنیتیِ دولتِ آمریکا، خانواده‌ی GPT-5.6 را به‌طورِ کامل در دسترسِ عموم قرار داد. این خانواده شامل سه مدل با نام‌هایِ «سول» (Sol، به معنیِ خورشید)، «ترا» (Terra، به معنیِ زمین) و «لونا» (Luna، به معنیِ ماه) است.

قیمت‌گذاریِ دقیقِ (به ازای هر یک میلیون توکن) [۷†L20-L21]:

مدلقیمت ورودیقیمت خروجی
Sol (پرچمدار)۵ دلار۳۰ دلار
Terra (میان‌رده)۲.۵ دلار۱۵ دلار
Luna (سبک)۱ دلار۶ دلار
  • Sol: پرچمدارِ این خانواده است که از دو حالتِ جدید «max» (حداکثرِ استدلال) و «ultra» (استفاده از زیر-عامل‌ها برای تسریعِ وظایفِ پیچیده) پشتیبانی می‌کند. OpenAI ادعا کرده است که Sol در بنچمارکِ Terminal-Bench 2.1 (آزمونِ وظایفِ خط‌فرمان) رکوردِ جدیدی ثبت کرده است.
  • Terra: عملکردی برابر با GPT-5.5 دارد، اما با هزینه‌ای نصف.
  • Luna: سبک‌ترین و سریع‌ترین گزینه برای وظایفِ با حجمِ بالا و حساس به هزینه است.

این مدل‌ها از امروز در ChatGPT، API، Codex و GitHub Copilot در دسترس هستند.


Grok 4.5: «ارزانی» به مثابه «سلاحِ راهبردی»

در تاریخ ۹ ژوئیه، SpaceXAI (xAI) نیز رسماً از مدلِ جدیدِ خود، Grok 4.5، رونمایی کرد. این مدل که با Cursor (استارت‌آپی که اسپیس‌ایکس به تازگی با ۶۰ میلیارد دلار خریده است)联合训练 شده، یک مدل ۱.۵ تریلیون پارامتری با معماری MoE است که از ۵۰ هزار توکنِ بافت پشتیبانی می‌کند.

قیمتِ Grok 4.5 (به ازای هر یک میلیون توکن) [۵†L6][8†L8-L9][9†L13-L14]:

نوعقیمت
ورودی۲ دلار
خروجی۶ دلار

ایلان ماسک، این مدل را «Opus-level» (در سطحِ کلود Opus) توصیف کرده است. اما نقطه‌ی قوتِ اصلیِ آن، «ارزانیِ خیره‌کننده» است:

  • هزینه‌ی کمتر از نصفِ رقبا: قیمتِ ورودیِ Grok 4.5 (۲ دلار) در برابرِ ورودیِ Claude Opus 4.8 (۵ دلار) و GPT-5.6 Sol (۵ دلار) قرار دارد.
  • مصرفِ بسیار کمترِ توکن: در بنچمارکِ SWE Bench Pro، Grok 4.5 برای انجامِ یک وظیفه، تنها یک‌چهارمِ توکنِ مصرفیِ Claude Opus 4.8 را مصرف می‌کند. یعنی «هزینه‌ی هر وظیفه» به‌مراتب کمتر از رقبا است.
  • سرعت: این مدل به ۸۰ توکن در ثانیه (TPS) می‌رسد که آن را در زمره‌ی مدل‌هایِ سریع قرار می‌دهد.

این مدل هم‌اکنون در SpaceXAI console، Grok Build و Cursor در دسترس است.


Gemini 3.5 Pro: بازنویسیِ هسته برای «کیفیتِ مطلق»

گوگل نیز با تأخیری استراتژیک، خود را برای نبردِ ۱۷ ژوئیه آماده می‌کند. بر اساس گزارش‌ها، Gemini 3.5 Pro که ابتدا قرار بود در ژوئن منتشر شود,اکنون به ۱۷ ژوئیه موکول شده است.

دلیلِ این تأخیر، یک تغییرِ بنیادین در استراتژیِ گوگل است. به گزارش Geeky Gadgets، Google DeepMind «هسته‌ی قبلیِ (base) Gemini 2.5 Pro را کنار گذاشته و مدل را از صفر (from scratch) بازآموزی (pre-training) کرده است». این یعنی گوگل برای رسیدن به «کیفیتِ مطلق»، از «سرعتِ انتشار» گذشته است.

نکاتِ کلیدیِ Gemini 3.5 Pro:

  • تمرکز بر کیفیت:传闻指出,该模型在前端生成(front-end generation)方面的表现据说已经超越了 Anthropic 的 Fable 5。但 در «استدلالِ سخت و وظایفِ پیچیده‌ی مهندسی»依然落后于竞争对手。
  • قیمت: بر اساسِ اعلامیه‌هایِ قبلیِ گوگل در I/O 2026، قیمتِ Gemini 3.5 Pro حدود ۱.۵۰ دلار برای ورودی و ۹ دلار برای خروجی (به ازای هر یک میلیون توکن) تعیین شده است.

DeepSeek V4: «قیمت‌گذاریِ پیک‌ساعتی» و «انقلابِ سرعت» از چین

در سویِ دیگرِ میدان، شرکتِ چینی DeepSeek نیز اعلام کرده است که نسخه‌ی نهاییِ DeepSeek V4 در اواسطِ ژوئیه (احتمالاً ۱۵ یا ۱۶ ژوئیه) منتشر خواهد شد.

دو ویژگیِ کلیدیِ DeepSeek V4 که آن را از رقبا متمایز می‌کند:

۱. «قیمت‌گذاریِ پیک‌ساعتی» (Peak-Valley Pricing): برای اولین بار در صنعت، DeepSeek اعلام کرده است که قیمتِ API در ساعاتِ اوج (Peak Hours) دو برابرِ قیمتِ عادی خواهد بود. این یک نوآوریِ بزرگ در «اقتصادِ محاسباتی» است که به DeepSeek اجازه می‌دهد تا بارِ ترافیک را به ساعاتِ کم‌بازده منتقل کند و هزینه‌هایِ خود را بهینه‌سازی نماید.

۲. افزایشِ ۶۰ تا ۸۵ درصدیِ سرعتِ استنتاج: DeepSeek V4 ادعا کرده است که سرعتِ استنتاجِ این مدل نسبت به نسخه‌هایِ قبلی، بیش از ۶۰ درصد (و در برخی منابع تا ۸۵ درصد) افزایش یافته است.

این مدل که با معماریِ MoE ساخته شده، با استراتژیِ «قیمتِ پویا» و «سرعتِ بالا»، به دنبالِ جذبِ توسعه‌دهندگانی است که به «هزینه‌ی هر وظیفه» حساس هستند.


جدول مقایسه: چهار مدلِ بزرگ در میانه‌ی ژوئیه ۲۰۲۶

ویژگیGPT-5.6 SolGrok 4.5Gemini 3.5 ProDeepSeek V4
تاریخ انتشار۹ ژوئیه ۲۰۲۶۹ ژوئیه ۲۰۲۶۱۷ ژوئیه ۲۰۲۶اواسط ژوئیه ۲۰۲۶
معمارینامشخص۱.۵T MoE全新预训练MoE
قیمت ورودی۵ دلار۲ دلار~۱.۵۰ دلارپیک‌ساعتی (۲x قیمت عادی)
قیمت خروجی۳۰ دلار۶ دلار~۹ دلارپیک‌ساعتی (۲x قیمت عادی)
سرعت (TPS)تا ۷۵۰ (روی Cerebras)۸۰ TPSنامشخصافزایش ۶۰-۸۵%
مزیت کلیدیقدرتِ محض + لایه‌بندیِ قیمتارزانیِ بی‌نظیر + مصرفِ کمِ توکنکیفیتِ بالا (Front-end)قیمت‌گذاریِ پویا + سرعتِ بالا

«لحظه‌ای که «ارزانی» بر «قدرتِ محض» پیشی گرفت»

نام این هفته را باید «لحظه‌ی تغییرِ معادله‌ی اقتصادِ هوش مصنوعی» گذاشت. در این هفته، چهار مدل از چهار جبهه، هم‌زمان به میدان آمدند تا نشان دهند که «رقابتِ مدل‌ها» دیگر فقط «کیفیتِ خام» نیست؛ بلکه «هزینه‌ی هر وظیفه»، «سرعتِ پاسخ‌گویی» و «انعطاف‌پذیریِ قیمت‌گذاری» به اندازه‌ی «قدرتِ محض» اهمیت پیدا کرده است. Grok 4.5 با قیمتِ ۲ دلاری و مصرفِ یک‌چهارمِ توکن، «ارزانی» را به سلاحیِ راهبردی تبدیل کرده است. DeepSeek V4 با «قیمت‌گذاریِ پیک‌ساعتی»، «اقتصادِ محاسباتی» را به سطحی جدید برده است. و Gemini 3.5 Pro با بازنویسیِ کاملِ هسته‌ی خود، نشان داده که «کیفیت» همچنان ارزشِ جنگیدن دارد.

پرسشِ بی‌پاسخ این است: آیا «ارزانیِ» Grok 4.5 و «قیمتِ پویای» DeepSeek V4 می‌تواند «وفاداریِ کاربران» را از «قدرتِ محضِ» GPT-5.6 Sol و «کیفیتِ» Gemini 3.5 Pro برباید؟ و آیا این «نبردِ همه‌جانبه»، سرآغازی برای «عصرِ جدیدی» از رقابت در هوش مصنوعی است که در آن «اقتصادِ محاسباتی» به اندازه‌ی «علمِ مدل‌سازی» اهمیت دارد؟

یک چیز قطعی است: این هفته، «دکمه‌ی شروعِ» یک «مسابقه‌ی جدید» در صنعتِ هوش مصنوعی فشار داده شده است. مسابقه‌ای که در آن «ارزانی»، «سرعت» و «انعطاف‌پذیریِ قیمت» به اندازه‌ی «قدرتِ محض» تعیین‌کننده هستند. و در این مسابقه، برنده کسی نیست که «بهترینِ مدل» را دارد، بلکه کسی است که «بهترینِ اقتصادِ محاسباتی» را برای کاربرانِ خود ارائه دهد. سؤال این نیست که آیا این «نبردِ همه‌جانبه» ادامه خواهد یافت – که خواهد یافت. سؤال این است که آیا «ارزانی» می‌تواند «قدرت» را شکست دهد، یا «قدرت» همچنان بر «ارزانی» خواهد چربید؟

مقاله رو دوست داشتی؟ نظرت چیه؟

۱۲ پاسخ به “«هفته‌ای که سه‌گانه‌ی «قدرت، سرعت و ارزانی» به میدان آمد؛ از سول تا گروک و دیپ‌سیک، نبردِ «هزینه‌ی هر وظیفه» جانشینِ «عملکردِ خام» شد”

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *