هوش همزیستی: آینده هوش مصنوعی با قدرت تراشه‌ها

هوش مصنوعی وارد مرحله‌ای جدید از توسعه شده است که در آن قدرت محاسباتی به عامل نهایی تبدیل شده است. داده‌ها و الگوریتم‌ها مواد خام و قوانین را فراهم می‌کنند، اما تراشه‌ها موتورهایی هستند که این پتانسیل‌ها را به واقعیت تبدیل می‌کنند. عملکرد تراشه‌ها نه تنها تعیین می‌کند هوش مصنوعی تا کجا می‌تواند پیش رود، بلکه مشخص می‌کند که آیا کاربردهای آن واقعاً می‌توانند صنایع و زندگی روزمره را دگرگون سازند یا خیر.

برای مثال GPT-4 را در نظر بگیرید: آموزش آن حدود ۳۶۴۰ مگاوات‌ساعت برق مصرف کرد—معادل مصرف سالانه ۳۰۰ خانوار—و بر ده‌ها هزار تراشه با کارایی بالا که به‌صورت موازی کار می‌کردند، متکی بود. این تقاضای عظیم انرژی، پیوند جدایی‌ناپذیر بین هوش مصنوعی و تراشه‌ها را برجسته می‌کند. با پیچیده‌تر شدن الگوریتم‌های هوش مصنوعی، معماری تراشه‌ها برای ویژگی‌هایی مانند عملیات ماتریسی و محاسبات موازی بهینه‌سازی می‌شوند و یک نقشه راه فنی را شکل می‌دهند که هم آموزش و هم استنتاج را در بر می‌گیرد.

در مرحله آموزش، GPUها همچنان ستون فقرات یادگیری عمیق هستند. پردازنده‌های A100/H100 انویدیا، با هزاران هسته کودا، آموزش مدل‌های عظیم‌مقیاس را ممکن می‌سازند. TPU گوگل، که برای عملیات تنسور بهینه‌سازی شده است، در نسل چهارم خود به عملکردی تا ۱۰۰ پتا فلاپس دست می‌یابد و قدرت‌بخش خدمات هوش مصنوعی جهانی در گوگل کلود است. در همین حال، تراشه‌های ASIC شرکت Cambricon چین در الگوریتم‌های خاص، سطوح کارایی بیش از ده برابر GPUها را نشان می‌دهند که نشان‌دهنده یک پیشرفت جدید در سیلیکون هوش مصنوعی سفارشی است.

از سوی دیگر، استنتاج بر تأخیر کم و استقرار در لبه تأکید دارد. پلتفرم‌های FPGA مانند Xilinx Versal پاسخ‌هایی در سطح میلی‌ثانیه در رانندگی خودران ارائه می‌دهند. تراشه‌ی A17 Pro اپل و معماری کرین داوینچی هواوی واحدهای پردازش عصبی (NPU) را مستقیماً در دستگاه‌های موبایل ادغام می‌کنند و امکان پیشرفت‌های چشمگیری در تصویربرداری بلادرنگ و اپلیکیشن‌های واقعیت افزوده را فراهم می‌آورند. این نوآوری‌ها هوش مصنوعی را به زندگی روزمره می‌آورند، به‌جای آنکه آن را محدود به مراکز داده نگه دارند.

در صنایع مختلف، تراشه‌ها چشم‌انداز را بازتعریف می‌کنند. در محاسبات ابری، نمونه‌های P4d آمازون وب سرویس (AWS) که به ۸ پردازنده گرافیکی A100 مجهز هستند، زیرساخت لازم برای آموزش مدل‌ها در مقیاس سازمانی را فراهم می‌کنند، در حالی که تراشه Hanguang 800 علی‌بابا چهار برابر کارایی بیشتری نسبت به پردازنده‌های گرافیکی سنتی در استنتاج بینایی ارائه می‌دهد. در حوزه رانندگی خودران، NVIDIA Orin با ارائه ۲۵۴ ترافلاپس (TOPS) از ادراک و تصمیم‌گیری سطح L4 پشتیبانی می‌کند، در حالی که Journey 6 شرکت Horizon Robotics تعادل بین کارایی انرژی و قابلیت اطمینان را برقرار می‌سازد. در تصویربرداری پزشکی، چیپ‌های مبتنی بر هوش مصنوعی تعبیه‌شده در تجهیزات تشخیصی، دقت تشخیص تومور را به ۹۷۱TP3T رسانده‌اند و در عین حال از طریق رمزگذاری در سطح سخت‌افزار، حریم خصوصی بیمار را حفظ می‌کنند. در لوازم الکترونیکی مصرفی، اسنپدراگون ۸ نسل ۳ ترجمه همزمان و تعامل صوتی هوشمند را ارائه می‌دهد و در عین حال مصرف انرژی را در مقایسه با نسل قبلی خود تا ۳۰۰TP3T کاهش می‌دهد.

در همین حال، دستاوردهای نوآورانه مرزهای محاسبات هوش مصنوعی را جابه‌جا می‌کنند. معماری‌های ناهمگون اکنون امکان همکاری بین CPUها، GPUها، TPUها و DSPها را از طریق رابط‌های پرسرعت فراهم می‌آورند. فناوری‌های پردازش درون‌حافظه‌ای (PIM) در حال پرداختن به مشکل دیرینه “دیوار حافظه” هستند و مصرف انرژی استنتاج را تا ۹۰۱TP3T کاهش می‌دهند. تراشه‌های کوانتومی، اگرچه هنوز در مرحله آزمایشی هستند، پتانسیل تحول‌آفرین در وظایف بهینه‌سازی و شبیه‌سازی را نشان می‌دهند و به سوی یک تغییر پارادایم محاسباتی در آینده اشاره می‌کنند.

با این حال، چالش‌ها همچنان پابرجاست. هزینه انرژی عملکرد در حال افزایش است—GPU H100 انویدیا تا ۴۰۰ وات مصرف می‌کند—که مراکز داده را مجبور می‌کند از تکنیک‌های پیشرفته خنک‌کنندگی مانند غوطه‌وری در مایع استفاده کنند. چیپ‌های داخلی در چین، مانند Ascend 910B هوآوی و Kunlun 2 بایدو، به پیشرفت‌های “صفر تا یک” دست یافته‌اند، اما همچنان با موانعی در سازگاری اکوسیستم و استقرار در مقیاس وسیع روبرو هستند. آینده ممکن است در هم‌افزایی ابر و لبه نهفته باشد: سرورهای ابری آموزش در مقیاس بزرگ را بر عهده داشته باشند، در حالی که دستگاه‌های لبه استنتاج سبک‌وزن را انجام دهند—خوشه آموزش روی برد مبتنی بر تراشه D1 شرکت تسلا نمونه‌ای از این تغییر است.

از GPUهایی که شعله‌ورکننده انقلاب محاسباتی هوش مصنوعی بودند گرفته تا ASICها و NPUهای تخصصی که استانداردهای جدید صنعتی را شکل می‌دهند، رابطه بین تراشه‌ها و هوش مصنوعی فراتر از “ابزارها و کاربردها” تکامل یافته و به یک اکوسیستم همزیست تبدیل شده است. وقتی یک NPU به اندازه ناخن می‌تواند میلیون‌ها تصویر را به صورت همزمان طبقه‌بندی کند، و وقتی یک خوشه ابررایانه می‌تواند تکامل کهکشان را شبیه‌سازی کند، تراشه‌ها فقط اسکلت هوش مصنوعی نیستند—بلکه در حال گسترش مرزهای شناخت انسانی خود هستند. سؤال نهایی این مسابقه محاسباتی تنها به قدرت خام مربوط نمی‌شود، بلکه به این است که چگونه می‌توان هوش مصنوعی را از یک “غول پرمصرف محاسباتی” به یک “هوش آگاه به انرژی” تبدیل کرد. و تراشه‌ها کلید گشودن این راه‌حل آینده هستند.