گوگل در تغییر روزآمد اسناد پشتیبانی رسمی خود، سیاستهای دسترسی به خانواده مدلهای زبانی بزرگ جمینای (Gemini) را به طور ریشهای بازنگری کرد. بر اساس این تصمیم، دسترسی رایگان کاربران به مدلهای قدرتمند Gemini Pro و Gemini Flash از تاریخ ۱۷ مهر ۱۴۰۵ (۹ اکتبر) پایان یافته و مدل سبکبار Flash-Lite به عنوان گزینه پیشفرض و انحصاری طرح رایگان جایگزین میشود. این تحول نشاندهنده یک تغییر پارادایم جدی در مدلهای تجاری شرکتهای پیشرو هوش مصنوعی و حرکت به سمت مدلهای درآمدهای پایدار است که تأثیرات مستقیمی بر توسعهدهندگان، کسبوکارهای نوپا و اکوسیستم دیجیتال ایران خواهد داشت.
کاهش سطح دسترسی عمومی و تغییر ساختار پلنهای اشتراکی
بر اساس مستندات جدید، گوگل سطحبندی جدیدی را برای پلنهای قیمتی خود اعمال کرده است. تا پیش از این، کاربران رایگان امکان بهرهگیری محدود از قابلیتهای استدلال و تحلیل مدلهای پرو و فلش را داشتند. اما با اجرای سیاست جدید، بازه دسترسی به شکل زیر تغییر یافته است:
- طرح رایگان (Free Tier): تنها محدود به مدل Gemini Flash-Lite.
- طرح AI Plus (ماهانه ۴.۹۹ دلار): محدود به مدلهای Flash-Lite و Flash؛ دسترسی به مدل Pro در این سطح لغو شده است.
- طرح AI Pro (ماهانه ۱۹.۹۹ دلار): دسترسی کامل به مدلهای Flash-Lite، Flash و Pro به همراه اضافه شدن قابلیت استدلال عمیق (Deep Think) بدون هزینه اضافی.
- طرح AI Ultra (ماهانه ۹۹.۹۹ تا ۱۹۹.۹۹ دلار): دسترسی کامل به تمامی مدلها و اولویت در پردازشهای پردازشی سنگین.
معماری فنی پردازش و سیستم محدودیتهای مبتنی بر توان محاسباتی
علت اصلی این تصمیم را باید در هزینههای کمرشکن زیرساختهای پردازش ابری (Cloud Compute Costs) و نگهداری پردازندههای گرافیکی و TPU جستجو کرد. گوگل سیستم جدیدی تحت عنوان «محدودیتهای مبتنی بر توان محاسباتی» (Compute-based limits) را پیادهسازی کرده است که تخصیص منابع را مدیریت میکند.
در این ساختار، مصرف کاربران بر اساس شاخصهایی چون پیچیدگی پرامپت، طول پنجره کانتکست (Context Window)، فراخوانی ابزارهای جانبی و میزان استفاده از قابلیت تفکر عمیق محاسبه میشود. سهمیه محاسباتی کاربران به صورت بازههای ۵ ساعته بازنشانی شده و دارای یک سقف مصرف هفتگی مشخص است. علاوه بر این، گوگل امکان تنظیم سطح تمرکز و پردازش (Low, Medium, High) را فراهم کرده که به کاربران اجازه میدهد برای تحلیلهای پیچیده توان بیشتری از مدل دریافت کنند، هرچند این کار سهمیه محاسباتی آنها را به سرعت مصرف میکند.
تأثیرات بر کسبوکارها و توسعهدهندگان ایرانی
محدودسازی دسترسی رایگان به مدلهای پیشرفته هوش مصنوعی، برای توسعهدهندگان و شرکتهای دانشبنیان ایرانی که به دلیل تحریمهای مالی و عدم دسترسی آسان به کارتهای اعتباری بینالمللی از بسترهای رایگان یا پلنهای ارزانقیمت استفاده میکردند، یک چالش جدی ایجاد میکند. مدل Flash-Lite با وجود سرعت بالا و تاخیر کم، برای پردازشهای پیچیده متنی، کدنویسی پیشرفته و تحلیل دادههای حجیم طراحی نشده است.
از سوی دیگر، این رویداد ضرورت توجه بیشتر به زیرساختهای داخلی پردازش هوش مصنوعی، میزبانی مدلهای متنباز (Open-Source LLMs) نظیر Llama یا Mistral روی ابرهای اختصاصی داخلی و ارائه APIهای بومیسازی شده را بیش از پیش نمایان میسازد.
جدول خلاصه تغییرات دسترسی به مدلهای Gemini (مهر ۱۴۰۵)
- Gemini Flash-Lite: مدل بسیار سبک، تاخیر پایین، مخصوص پردازشهای ساده و پاسخدهی سریع (طرح رایگان و بالاتر)
- Gemini Flash: مدل میانرده برای کارهای روزمره و تحلیلی متوسط (طرح AI Plus و بالاتر)
- Gemini Pro: مدل پیشرفته با قابلیت استدلال چندوجهی و تحلیل پیچیده (منحصراً طرحهای AI Pro و AI Ultra)
- قابلیت Deep Think: موتور استدلال عمیق برای مسائل ریاضی و منطقی (موجود در طرحهای Pro و Ultra)
- مکانیسم بازنشانی سهمیه: بازنشانی ۵ ساعته توان محاسباتی با سقف اعتبارسنجی هفتگی