در تاریخ ۲۸ آگوست ۲۰۲۶، تیم هیون‌یوان (Hunyuan) تنست از جدیدترین مدل زبانی بزرگ خود با نام Hy۴ preview رونمایی کرد و آن را به‌صورت متن‌باز (Open-Source) در دسترس عموم قرار داد. این مدل که به‌عنوان پرچمدار نسل جدید تنست معرفی شده، با ۷۷۰ میلیارد پارامتر (و ۴۹ میلیارد پارامتر فعال در هر بار پردازش) و پنجره متنی بیش از ۱ میلیون توکنی، در زمرهٔ مدل‌های پیشروی متن‌باز جهان قرار گرفته است.

زمان مطالعه: ۳ دقیقه

🧠 معماری فنی: ترکیبی از بهترین نوآوری‌های متن‌باز

Hy4 preview بر اساس معماری Mixture-of-Experts (MoE) ساخته شده است و از بسیاری از نوآوری‌های موفق در مدل‌های اخیر مانند DeepSeek و GLM بهره برده است.

  • مشخصات کلیدی مدل:
    • پارامترها: ۷۷۰ میلیارد پارامتر کل، ۴۹ میلیارد پارامتر فعال در هر توکن.
    • معماری: ۷۸ لایه که لایهٔ اول از نوع Dense و ۷۷ لایهٔ بعدی از نوع MoE هستند.
    • متخصصان (Experts): هر لایهٔ MoE شامل ۲۵۶ متخصص هدایت‌شده (Routed Experts) و ۱ متخصص مشترک (Shared Expert) است و هر توکن، ۸ متخصص برتر را فعال می‌کند.
    • توجه (Attention): از Gated DeepSeek Sparse Attention (Gated DSA) با قابلیت IndexCache برای استفادهٔ مجدد از نمایه‌های پراکنده در بین لایه‌ها بهره می‌برد.
    • لایهٔ MTP: دارای یک لایهٔ بومی MTP (Multi-Token Prediction) با ۱۰ میلیارد پارامتر (۰.۷ میلیارد فعال) برای تسریع در رمزگشایی است.
    • پنجره متنی: ۱ میلیون توکن.
    • حجم واژگان: ۱۲۰,۸۳۲ توکن.

🚀 عملکرد: در صدر جدول مدل‌های متن‌باز

تنست اعلام کرده که Hy4 preview در وظایف واقعی تولیدی (Productivity) مانند برنامه‌نویسی، کارهای اداری و تحقیقات علمی عملکردی برجسته دارد.

  • آزمون‌های داخلی تنست: در یک ارزیابی کور (Blind Evaluation) با حضور ۱۶۳ کارشناس داخلی روی ۲۰۳ وظیفهٔ مهندسی، Hy4 preview با امتیاز ۲.۹۹ از ۴.۰۰، اندکی از GLM-5.3 (۲.۹۲) و Kimi K3 (۲.۹۴) پیشی گرفته است.
  • پیشرفت در بنچمارک‌ها: بر اساس داده‌های منتشرشده، Hy4 preview پیشرفت‌های چشمگیری نسبت به نسل قبلی خود (Hy3) داشته است:
    • DeepSWE (مهندسی نرم‌افزار): از ۲۸.۰ به ۶۴.۳ رسیده است.
    • Terminal Bench 2.1: از ۷۰.۸ به ۸۵.۴ افزایش یافته و در ردهٔ مدل‌های برتری مانند GPT-5.6 Sol قرار گرفته است.
    • Toolathlon-Verified (فراخوانی ابزار): با امتیاز ۷۴.۱، در کنار مدل‌هایی مانند Kimi K3 (۷۴.۷) و Claude (۷۶.۵) قرار گرفته است.
  • بهبود بهره‌وری زیرساخت: خود مدل در بهینه‌سازی زیرساخت استنتاج خود مشارکت داشته و با تحلیل خودکار گلوگاه‌ها و بهینه‌سازی در زمینه‌هایی مانند ادغام عملگرها (Operator Fusion)، توانسته بهره‌وری سرتاسری (End-to-End Throughput) را ۳۱.۸٪ نسبت به حالت پایه افزایش دهد.

💰 قیمت‌گذاری و دسترسی

  • منبع‌باز: وزن‌های مدل به‌صورت کامل در GitHub و Hugging Face در دسترس است.
  • دسترسی رایگان: مدل به‌مدت دو هفته به‌صورت رایگان در محصولات WorkBuddy و CodeBuddy (نسخه‌های داخلی و بین‌المللی) قابل استفاده است.
  • قیمت API: قیمت ورودی ۶ یوان، قیمت خروجی ۱۸ یوان و قیمت کش (Cache Hit) ۰.۳ یوان به ازای هر یک میلیون توکن تعیین شده است.
  • پلتفرم‌ها: از طریق WorkBuddy، CodeBuddy، Yuanbao، ima و همچنین از طریق API در Tencent Cloud TokenHub و OpenRouter قابل دسترسی است.

🎯 استراتژی تنست: «برای تولید ساخته شده است»

Hy4 preview با شعار «برای تولید ساخته شده است» (Built for Productivity) معرفی شده است. تنست با تمرکز بر عامل‌های هوشمند (Agent)، برنامه‌نویسی (Coding) و سناریوهای تولیدی، به دنبال به کارگیری مدل در محصولات واقعی خود مانند WorkBuddy و CodeBuddy است. این مدل با بهره‌گیری از داده‌های باکیفیت هم‌ساخته با متخصصان داخلی تنست در حوزه‌های مهندسی نرم‌افزار، بازی، مالی و امنیت، برای حل مسائل دنیای واقعی بهینه‌سازی شده است.

جالب‌ترین نکته این است که Hy4 preview در فرآیند توسعهٔ خود نیز مشارکت داشته و برای اولین بار در بهینه‌سازی خودکار روش‌های آموزش، استراتژی‌های داده، چارچوب‌های ارزیابی و عملگرهای سطح پایین به کار گرفته شده است و یک حلقهٔ خودبهبودی بازگشتی (Recursive Self-Improvement Loop) اولیه را شکل داده است.

با این انتشار، تنست گامی بلند در رقابت مدل‌های بزرگ متن‌باز برداشته و Hy4 preview را به یکی از گزینه‌های جدی برای توسعه‌دهندگان و سازمان‌ها تبدیل کرده است.

مقاله رو دوست داشتی؟ نظرت چیه؟

۳ پاسخ به “در تاریخ ۲۸ آگوست ۲۰۲۶، تیم هیون‌یوان (Hunyuan) تنست از جدیدترین مدل زبانی بزرگ خود با نام Hy۴ preview رونمایی کرد و آن را به‌صورت متن‌باز (Open-Source) در دسترس عموم قرار داد. این مدل که به‌عنوان پرچمدار نسل جدید تنست معرفی شده، با ۷۷۰ میلیارد پارامتر (و ۴۹ میلیارد پارامتر فعال در هر بار پردازش) و پنجره متنی بیش از ۱ میلیون توکنی، در زمرهٔ مدل‌های پیشروی متن‌باز جهان قرار گرفته است.”

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *