شرکت کوالکام با معرفی دو تراشه جدید خود، مرزهای پردازش محلی هوش مصنوعی در گوشیهای هوشمند را جابجا کرد. این تراشههای پیشرفته با تمرکز ویژه بر معماری Mixture-of-Experts، امکان اجرای مدلهای زبانی بزرگ (LLM) با پارامترهای بالا را بدون نیاز به پردازش ابری فراهم میکنند.
تحول در محاسبات لبهای (Edge Computing)
کوالکام در استراتژی جدید خود، بار پردازشی مدلهای پیچیده هوش مصنوعی را به سمت سختافزار دستگاه (On-device AI) سوق داده است. نقطه عطف این معرفی، توانایی تراشه پرچمدار جدید در اجرای مدلهای Mixture-of-Experts با ۳۰ میلیارد پارامتر به صورت بومی است. این جهش تکنولوژیک، تأخیر در پاسخدهی را به حداقل رسانده و امنیت دادههای کاربران را در فرآیندهای یادگیری ماشین به طرز چشمگیری ارتقا میدهد.
معماری تخصصی برای هوش مصنوعی مولد
طراحی جدید هستههای NPU (واحد پردازش عصبی) در این تراشهها، با بهینهسازی پهنای باند حافظه و توان مصرفی همراه بوده است. رویکرد MoE به تراشه اجازه میدهد تا تنها بخشهای مرتبط با هر درخواست را فعال کند که این امر مدیریت بهینه منابع سختافزاری را در حین اجرای وظایف سنگین تضمین میکند.
- توانایی اجرای مدلهای 30B MoE به صورت محلی
- ارتقای عملکرد هوش مصنوعی در سطح سیستم عامل
- بهینهسازی مصرف انرژی برای عملیاتهای سنگین هوش مصنوعی
- استفاده از معماری پیشرفته NPU اختصاصی