«در یک هفته، چهار غولِ هوش مصنوعی همزمان «مغزهای» جدید خود را به میدان فرستادند. از «سول» (Sol)ی که قدرت را فریاد میزند، تا «گروک ۴.۵»ی که ارزانی را به سلاح تبدیل کرده، و «جمینی ۳.۵ پرو»یی که با بازنویسیِ هستهی خود به میدان بازمیگردد، و در نهایت «دیپسیک وی۴» که با «قیمتگذاریِ ساعتی» قواعدِ بازیِ اقتصادِ هوش مصنوعی را تغییر میدهد. این، دیگر «رقابتِ مدلها» نیست؛ این «جنگِ اقتصادِ محاسبات» است.»
مقدمه: «چهارضلعیِ سرنوشت» در یک هفته
هفتهی جاری، بیشک یکی از متراکمترین و پرمعناترین هفتههای تاریخِ صنعتِ هوش مصنوعی است. در فاصلهای کمتر از چند روز، چهار مدلِ بزرگ از چهار جبههی رقابتیِ اصلیِ جهان – آمریکا (OpenAI و xAI)، اروپا (Google DeepMind) و چین (DeepSeek) – همزمان به میدان آمدهاند. این «همزمانیِ تاریخی»، رقابت را از سطحِ «کیفیتِ خامِ مدل» به سطحِ «اقتصادِ محاسباتیِ کلان» و «سرعتِ استقرار» کشانده است.
سه بازیگرِ اصلیِ این «نبردِ همهجانبه» عبارتاند از: OpenAI که با سهگانهی «سول، ترا، لونا» (Sol, Terra, Luna)، «قدرتِ مطلق» را با «قیمتِ لایهای» ترکیب کرده است؛ SpaceXAI (xAI) که با «گروک ۴.۵» (Grok 4.5)، «ارزانیِ انقلابی» را به عنوانِ سلاحِ اصلیِ خود انتخاب کرده است؛ و Google DeepMind که با «جمینی ۳.۵ پرو» (Gemini 3.5 Pro) و بازنویسیِ کاملِ هستهی خود، به دنبالِ «کیفیتِ مطلق» در برابرِ «سرعتِ رقبا» است. در سویِ دیگرِ میدان، DeepSeek V4 از چین، با «قیمتگذاریِ پیکساعتی» و «افزایشِ ۶۰ درصدیِ سرعتِ استنتاج»، معادلهی «ارزانی» را پیچیدهتر کرده است. پارادوکسِ عمیقِ ماجرا در این جمله خلاصه میشود: «در این هفته، «قدرتِ محض» دیگر برنده نیست؛ «هزینهی هر وظیفه» (Cost per Task) و «سرعتِ پاسخگویی» (TPS) به معیارهایِ اصلیِ رقابت تبدیل شدهاند. و در این نبرد، «ارزانی» به اندازهی «قدرت» تعیینکننده شده است.»
GPT-5.6: سهگانهای به نام «خورشید، زمین و ماه»
در تاریخ ۹ ژوئیه (و بامدادِ ۱۰ ژوئیه به وقتِ ایران)، OpenAI سرانجام پس از هفتهها تأخیر و بررسیهایِ امنیتیِ دولتِ آمریکا، خانوادهی GPT-5.6 را بهطورِ کامل در دسترسِ عموم قرار داد. این خانواده شامل سه مدل با نامهایِ «سول» (Sol، به معنیِ خورشید)، «ترا» (Terra، به معنیِ زمین) و «لونا» (Luna، به معنیِ ماه) است.
قیمتگذاریِ دقیقِ (به ازای هر یک میلیون توکن) [۷†L20-L21]:
| مدل | قیمت ورودی | قیمت خروجی |
|---|---|---|
| Sol (پرچمدار) | ۵ دلار | ۳۰ دلار |
| Terra (میانرده) | ۲.۵ دلار | ۱۵ دلار |
| Luna (سبک) | ۱ دلار | ۶ دلار |
- Sol: پرچمدارِ این خانواده است که از دو حالتِ جدید «max» (حداکثرِ استدلال) و «ultra» (استفاده از زیر-عاملها برای تسریعِ وظایفِ پیچیده) پشتیبانی میکند. OpenAI ادعا کرده است که Sol در بنچمارکِ Terminal-Bench 2.1 (آزمونِ وظایفِ خطفرمان) رکوردِ جدیدی ثبت کرده است.
- Terra: عملکردی برابر با GPT-5.5 دارد، اما با هزینهای نصف.
- Luna: سبکترین و سریعترین گزینه برای وظایفِ با حجمِ بالا و حساس به هزینه است.
این مدلها از امروز در ChatGPT، API، Codex و GitHub Copilot در دسترس هستند.
Grok 4.5: «ارزانی» به مثابه «سلاحِ راهبردی»
در تاریخ ۹ ژوئیه، SpaceXAI (xAI) نیز رسماً از مدلِ جدیدِ خود، Grok 4.5، رونمایی کرد. این مدل که با Cursor (استارتآپی که اسپیسایکس به تازگی با ۶۰ میلیارد دلار خریده است)联合训练 شده، یک مدل ۱.۵ تریلیون پارامتری با معماری MoE است که از ۵۰ هزار توکنِ بافت پشتیبانی میکند.
قیمتِ Grok 4.5 (به ازای هر یک میلیون توکن) [۵†L6][8†L8-L9][9†L13-L14]:
| نوع | قیمت |
|---|---|
| ورودی | ۲ دلار |
| خروجی | ۶ دلار |
ایلان ماسک، این مدل را «Opus-level» (در سطحِ کلود Opus) توصیف کرده است. اما نقطهی قوتِ اصلیِ آن، «ارزانیِ خیرهکننده» است:
- هزینهی کمتر از نصفِ رقبا: قیمتِ ورودیِ Grok 4.5 (۲ دلار) در برابرِ ورودیِ Claude Opus 4.8 (۵ دلار) و GPT-5.6 Sol (۵ دلار) قرار دارد.
- مصرفِ بسیار کمترِ توکن: در بنچمارکِ SWE Bench Pro، Grok 4.5 برای انجامِ یک وظیفه، تنها یکچهارمِ توکنِ مصرفیِ Claude Opus 4.8 را مصرف میکند. یعنی «هزینهی هر وظیفه» بهمراتب کمتر از رقبا است.
- سرعت: این مدل به ۸۰ توکن در ثانیه (TPS) میرسد که آن را در زمرهی مدلهایِ سریع قرار میدهد.
این مدل هماکنون در SpaceXAI console، Grok Build و Cursor در دسترس است.
Gemini 3.5 Pro: بازنویسیِ هسته برای «کیفیتِ مطلق»
گوگل نیز با تأخیری استراتژیک، خود را برای نبردِ ۱۷ ژوئیه آماده میکند. بر اساس گزارشها، Gemini 3.5 Pro که ابتدا قرار بود در ژوئن منتشر شود,اکنون به ۱۷ ژوئیه موکول شده است.
دلیلِ این تأخیر، یک تغییرِ بنیادین در استراتژیِ گوگل است. به گزارش Geeky Gadgets، Google DeepMind «هستهی قبلیِ (base) Gemini 2.5 Pro را کنار گذاشته و مدل را از صفر (from scratch) بازآموزی (pre-training) کرده است». این یعنی گوگل برای رسیدن به «کیفیتِ مطلق»، از «سرعتِ انتشار» گذشته است.
نکاتِ کلیدیِ Gemini 3.5 Pro:
- تمرکز بر کیفیت:传闻指出,该模型在前端生成(front-end generation)方面的表现据说已经超越了 Anthropic 的 Fable 5。但 در «استدلالِ سخت و وظایفِ پیچیدهی مهندسی»依然落后于竞争对手。
- قیمت: بر اساسِ اعلامیههایِ قبلیِ گوگل در I/O 2026، قیمتِ Gemini 3.5 Pro حدود ۱.۵۰ دلار برای ورودی و ۹ دلار برای خروجی (به ازای هر یک میلیون توکن) تعیین شده است.
DeepSeek V4: «قیمتگذاریِ پیکساعتی» و «انقلابِ سرعت» از چین
در سویِ دیگرِ میدان، شرکتِ چینی DeepSeek نیز اعلام کرده است که نسخهی نهاییِ DeepSeek V4 در اواسطِ ژوئیه (احتمالاً ۱۵ یا ۱۶ ژوئیه) منتشر خواهد شد.
دو ویژگیِ کلیدیِ DeepSeek V4 که آن را از رقبا متمایز میکند:
۱. «قیمتگذاریِ پیکساعتی» (Peak-Valley Pricing): برای اولین بار در صنعت، DeepSeek اعلام کرده است که قیمتِ API در ساعاتِ اوج (Peak Hours) دو برابرِ قیمتِ عادی خواهد بود. این یک نوآوریِ بزرگ در «اقتصادِ محاسباتی» است که به DeepSeek اجازه میدهد تا بارِ ترافیک را به ساعاتِ کمبازده منتقل کند و هزینههایِ خود را بهینهسازی نماید.
۲. افزایشِ ۶۰ تا ۸۵ درصدیِ سرعتِ استنتاج: DeepSeek V4 ادعا کرده است که سرعتِ استنتاجِ این مدل نسبت به نسخههایِ قبلی، بیش از ۶۰ درصد (و در برخی منابع تا ۸۵ درصد) افزایش یافته است.
این مدل که با معماریِ MoE ساخته شده، با استراتژیِ «قیمتِ پویا» و «سرعتِ بالا»، به دنبالِ جذبِ توسعهدهندگانی است که به «هزینهی هر وظیفه» حساس هستند.
جدول مقایسه: چهار مدلِ بزرگ در میانهی ژوئیه ۲۰۲۶
| ویژگی | GPT-5.6 Sol | Grok 4.5 | Gemini 3.5 Pro | DeepSeek V4 |
|---|---|---|---|---|
| تاریخ انتشار | ۹ ژوئیه ۲۰۲۶ | ۹ ژوئیه ۲۰۲۶ | ۱۷ ژوئیه ۲۰۲۶ | اواسط ژوئیه ۲۰۲۶ |
| معماری | نامشخص | ۱.۵T MoE | 全新预训练 | MoE |
| قیمت ورودی | ۵ دلار | ۲ دلار | ~۱.۵۰ دلار | پیکساعتی (۲x قیمت عادی) |
| قیمت خروجی | ۳۰ دلار | ۶ دلار | ~۹ دلار | پیکساعتی (۲x قیمت عادی) |
| سرعت (TPS) | تا ۷۵۰ (روی Cerebras) | ۸۰ TPS | نامشخص | افزایش ۶۰-۸۵% |
| مزیت کلیدی | قدرتِ محض + لایهبندیِ قیمت | ارزانیِ بینظیر + مصرفِ کمِ توکن | کیفیتِ بالا (Front-end) | قیمتگذاریِ پویا + سرعتِ بالا |
«لحظهای که «ارزانی» بر «قدرتِ محض» پیشی گرفت»
نام این هفته را باید «لحظهی تغییرِ معادلهی اقتصادِ هوش مصنوعی» گذاشت. در این هفته، چهار مدل از چهار جبهه، همزمان به میدان آمدند تا نشان دهند که «رقابتِ مدلها» دیگر فقط «کیفیتِ خام» نیست؛ بلکه «هزینهی هر وظیفه»، «سرعتِ پاسخگویی» و «انعطافپذیریِ قیمتگذاری» به اندازهی «قدرتِ محض» اهمیت پیدا کرده است. Grok 4.5 با قیمتِ ۲ دلاری و مصرفِ یکچهارمِ توکن، «ارزانی» را به سلاحیِ راهبردی تبدیل کرده است. DeepSeek V4 با «قیمتگذاریِ پیکساعتی»، «اقتصادِ محاسباتی» را به سطحی جدید برده است. و Gemini 3.5 Pro با بازنویسیِ کاملِ هستهی خود، نشان داده که «کیفیت» همچنان ارزشِ جنگیدن دارد.
پرسشِ بیپاسخ این است: آیا «ارزانیِ» Grok 4.5 و «قیمتِ پویای» DeepSeek V4 میتواند «وفاداریِ کاربران» را از «قدرتِ محضِ» GPT-5.6 Sol و «کیفیتِ» Gemini 3.5 Pro برباید؟ و آیا این «نبردِ همهجانبه»، سرآغازی برای «عصرِ جدیدی» از رقابت در هوش مصنوعی است که در آن «اقتصادِ محاسباتی» به اندازهی «علمِ مدلسازی» اهمیت دارد؟
یک چیز قطعی است: این هفته، «دکمهی شروعِ» یک «مسابقهی جدید» در صنعتِ هوش مصنوعی فشار داده شده است. مسابقهای که در آن «ارزانی»، «سرعت» و «انعطافپذیریِ قیمت» به اندازهی «قدرتِ محض» تعیینکننده هستند. و در این مسابقه، برنده کسی نیست که «بهترینِ مدل» را دارد، بلکه کسی است که «بهترینِ اقتصادِ محاسباتی» را برای کاربرانِ خود ارائه دهد. سؤال این نیست که آیا این «نبردِ همهجانبه» ادامه خواهد یافت – که خواهد یافت. سؤال این است که آیا «ارزانی» میتواند «قدرت» را شکست دهد، یا «قدرت» همچنان بر «ارزانی» خواهد چربید؟


۱۲ پاسخ به “«هفتهای که سهگانهی «قدرت، سرعت و ارزانی» به میدان آمد؛ از سول تا گروک و دیپسیک، نبردِ «هزینهی هر وظیفه» جانشینِ «عملکردِ خام» شد”
پشمام چقدر خوب بود
پشمام چقدر خوب بود
پشمام چقدر خوب بود
بدک نبود در کل
عالی بود مرسی 🔥
ممنون داداش
ممنون داداش
تشکر
مفید و کاربردی 👌
تشکر
ممنون داداش
دمت گرم ستون