بر اساس تازهترین گزارشهای منتشر شده از مصاحبه مدیر جدید بخش Google DeepMind، غول فناوری گوگل مراحل پایانی توسعه و آمادهسازی مدل هوش مصنوعی مورد انتظار Gemini 4 را طی میکند. این مدل جدید با هدف ارتقای جهشی توانمندیهای محاسباتی، پردازش چندوجهی (Multimodal) و جبران فاصله ایجاد شده با سایر رقبا در حوزه مدلهای پیشرفته زبانی طراحی شده است.
تغییر در رهبری دیپمایند و استراتژی جدید گوگل
کورای کاووکچواغلو (Koray Kavukcuoglu) که اخیراً سکان هدایت بخش دیپمایند گوگل را به دست گرفته است، در نخستین اظهارنظر رسانهای خود با وبسایت The Information تأیید کرد که مدل Gemini 4 به مراحل نهایی عرضه نزدیک میشود. پس از دورهای تمرکز بر بهینهسازی نسخههای Gemini 1.5 و ارتقای زیرساختهای فعلی در زمستان ۱۴۰۳، گوگل اکنون قصد دارد پرچمدار بعدی خود را برای رقابت مستقیم با مدلهای پیشرفته بازار آماده کند.
ارتقای معماری و قابلیتهای انتظار رفته در Gemini 4
مدل جمینای ۴ بر پایه زیرساختهای پردازش ابری گوگل (Google Cloud TPUs) آموزش دیده و انتظار میرود در ابعاد زیر جهش شایانی را تجربه کند:
- پردازش زمینه (Context Window) گستردهتر: بهبود مدیریت حافظه بلندمدت و پردازش میلیونها توکن بهصورت همزمان بدون افت دقت.
- پشتیبانی نیتیو از چندوجهی بودن: درک همزمان و عمیقتر متن، تصویر، صوت و ویدیو با تاخیر (Latency) بسیار پایینتر نسبت به نسل قبلی.
- استدلال ریاضی و کدنویسی پیشرفته: بهینهسازی مدل برای حل مسائل پیچیده مهندسی نرمافزار و منطقی.
مشخصات و ویژگیهای کلیدی Gemini 4
- توسعهدهنده: Google DeepMind
- معماری پایه: Transformer بهینهسازیشده با سیستمهای یادگیری تقویتشده (RLHF)
- بستر سختافزاری آموزش: تراشههای اختصاصی Google TPU v5p
- حوزههای اصلی بهبود: سرعت پاسخدهی، استدلال چندمرحلهای، کاهش تاری دید مدل (Hallucination)
برنامهریزی برای عرضه و چشمانداز رقابتی
با توجه به روند توسعه در اوایل سال ۱۴۰۴، ناظران صنعت انتظار دارند گوگل نسخه اولیه Gemini 4 را ابتدا در اختیار توسعهدهندگان از طریق Google AI Studio و پلتفرم Google Cloud Vertex AI قرار دهد و سپس آن را در سرویسهای مصرفکننده خود ادغام کند. این اقدام پاسخ مستقیمی به دستاوردهای اخیر رقبایی همچون OpenAI و Anthropic خواهد بود.