اخبار و تحولات فناوری

پایان عصر هوش مصنوعی کاملاً رایگان: تحلیل ابعاد فنی و اقتصادی تغییر سیاست‌های گوگل در دسترسی به مدل‌های جمینای

گوگل در تغییر روزآمد اسناد پشتیبانی رسمی خود، سیاست‌های دسترسی به خانواده مدل‌های زبانی بزرگ جمینای (Gemini) را به طور ریشه‌ای بازنگری کرد. بر اساس این تصمیم، دسترسی رایگان کاربران به مدل‌های قدرتمند Gemini Pro و Gemini Flash از تاریخ ۱۷ مهر ۱۴۰۵ (۹ اکتبر) پایان یافته و مدل سبک‌بار Flash-Lite به عنوان گزینه پیش‌فرض و انحصاری طرح رایگان جایگزین می‌شود. این تحول نشان‌دهنده یک تغییر پارادایم جدی در مدل‌های تجاری شرکت‌های پیشرو هوش مصنوعی و حرکت به سمت مدل‌های درآمدهای پایدار است که تأثیرات مستقیمی بر توسعه‌دهندگان، کسب‌وکارهای نوپا و اکوسیستم دیجیتال ایران خواهد داشت.

کاهش سطح دسترسی عمومی و تغییر ساختار پلن‌های اشتراکی

بر اساس مستندات جدید، گوگل سطح‌بندی جدیدی را برای پلن‌های قیمتی خود اعمال کرده است. تا پیش از این، کاربران رایگان امکان بهره‌گیری محدود از قابلیت‌های استدلال و تحلیل مدل‌های پرو و فلش را داشتند. اما با اجرای سیاست جدید، بازه دسترسی به شکل زیر تغییر یافته است:

  • طرح رایگان (Free Tier): تنها محدود به مدل Gemini Flash-Lite.
  • طرح AI Plus (ماهانه ۴.۹۹ دلار): محدود به مدل‌های Flash-Lite و Flash؛ دسترسی به مدل Pro در این سطح لغو شده است.
  • طرح AI Pro (ماهانه ۱۹.۹۹ دلار): دسترسی کامل به مدل‌های Flash-Lite، Flash و Pro به همراه اضافه شدن قابلیت استدلال عمیق (Deep Think) بدون هزینه اضافی.
  • طرح AI Ultra (ماهانه ۹۹.۹۹ تا ۱۹۹.۹۹ دلار): دسترسی کامل به تمامی مدل‌ها و اولویت در پردازش‌های پردازشی سنگین.

معماری فنی پردازش و سیستم محدودیت‌های مبتنی بر توان محاسباتی

علت اصلی این تصمیم را باید در هزینه‌های کمرشکن زیرساخت‌های پردازش ابری (Cloud Compute Costs) و نگهداری پردازنده‌های گرافیکی و TPU جستجو کرد. گوگل سیستم جدیدی تحت عنوان «محدودیت‌های مبتنی بر توان محاسباتی» (Compute-based limits) را پیاده‌سازی کرده است که تخصیص منابع را مدیریت می‌کند.

در این ساختار، مصرف کاربران بر اساس شاخص‌هایی چون پیچیدگی پرامپت، طول پنجره کانتکست (Context Window)، فراخوانی ابزارهای جانبی و میزان استفاده از قابلیت تفکر عمیق محاسبه می‌شود. سهمیه محاسباتی کاربران به صورت بازه‌های ۵ ساعته بازنشانی شده و دارای یک سقف مصرف هفتگی مشخص است. علاوه بر این، گوگل امکان تنظیم سطح تمرکز و پردازش (Low, Medium, High) را فراهم کرده که به کاربران اجازه می‌دهد برای تحلیل‌های پیچیده توان بیشتری از مدل دریافت کنند، هرچند این کار سهمیه محاسباتی آن‌ها را به سرعت مصرف می‌کند.

تأثیرات بر کسب‌وکارها و توسعه‌دهندگان ایرانی

محدودسازی دسترسی رایگان به مدل‌های پیشرفته هوش مصنوعی، برای توسعه‌دهندگان و شرکت‌های دانش‌بنیان ایرانی که به دلیل تحریم‌های مالی و عدم دسترسی آسان به کارت‌های اعتباری بین‌المللی از بسترهای رایگان یا پلن‌های ارزان‌قیمت استفاده می‌کردند، یک چالش جدی ایجاد می‌کند. مدل Flash-Lite با وجود سرعت بالا و تاخیر کم، برای پردازش‌های پیچیده متنی، کدنویسی پیشرفته و تحلیل داده‌های حجیم طراحی نشده است.

از سوی دیگر، این رویداد ضرورت توجه بیشتر به زیرساخت‌های داخلی پردازش هوش مصنوعی، میزبانی مدل‌های متن‌باز (Open-Source LLMs) نظیر Llama یا Mistral روی ابرهای اختصاصی داخلی و ارائه APIهای بومی‌سازی شده را بیش از پیش نمایان می‌سازد.

جدول خلاصه تغییرات دسترسی به مدل‌های Gemini (مهر ۱۴۰۵)

  • Gemini Flash-Lite: مدل بسیار سبک، تاخیر پایین، مخصوص پردازش‌های ساده و پاسخ‌دهی سریع (طرح رایگان و بالاتر)
  • Gemini Flash: مدل میان‌رده برای کارهای روزمره و تحلیلی متوسط (طرح AI Plus و بالاتر)
  • Gemini Pro: مدل پیشرفته با قابلیت استدلال چندوجهی و تحلیل پیچیده (منحصراً طرح‌های AI Pro و AI Ultra)
  • قابلیت Deep Think: موتور استدلال عمیق برای مسائل ریاضی و منطقی (موجود در طرح‌های Pro و Ultra)
  • مکانیسم بازنشانی سهمیه: بازنشانی ۵ ساعته توان محاسباتی با سقف اعتبارسنجی هفتگی
📌 منبع و مطالعه بیشتر: پایان دسترسی رایگان به جمینای پرو و فلش؛ گوگل مدل Flash-Lite را پیش‌فرض می‌کند – دیجیاتو
حامد

حامد

مسئول مجله فناوری آسمان نقره‌ای