B o t I r a n

ریاضیات پشت تراشه Jalapeño اوپن‌ای‌آی

ریاضیات پشت تراشه Jalapeño اوپن‌ای‌آی

هزینه‌های زیرساختی سنگین اوپن‌ای‌آی، توسعه تراشه سفارشی Jalapeño را با همکاری برادکام به همراه داشته است. این مدار مجتمع خاص‌کاربرد برای استنتاج مدل‌های زبانی بزرگ طراحی شده و هدف آن کاهش وابستگی به سخت‌افزارهای شخص ثالث است.

مسیر مالی اوپن‌ای‌آی به شدت به هزینه‌های زیرساختی وابسته است؛ واقعیتی که توسعه تراشه سفارشی جدید Jalapeño اوپن‌ای‌آی را رقم زد. این مدار مجتمع خاص‌کاربرد (ASIC) با همکاری برادکام ساخته شده و تلاشی مستقیم برای کاهش هزینه‌های سرمایه‌ای سنگین مرتبط با سخت‌افزارهای شخص ثالث به شمار می‌رود.

در حالی که انویدیا حاشیه سود تقریبی ۷۵ درصدی روی پردازنده‌های رده‌بالای خود دارد، اوپن‌ای‌آی با حاشیه‌های محدودتر فعالیت می‌کند و پس از کسر هزینه‌های عملیاتی عظیم، حدود ۳۳ سنت سود از هر دلار درآمد خود نگه می‌دارد. بار مالی اجرای مدل‌های زبانی بزرگ در مقیاس واقعی بسیار سنگین است.

سال گذشته، هزینه حفظ پاسخگویی سرورهای چت‌جی‌پی‌تی برای اوپن‌ای‌آی به رقم خیره‌کننده ۸.۴ میلیارد دلار رسید. اکنون که این پلتفرم ۹۰۰ میلیون کاربر هفتگی جذب کرده، هزینه عملیاتی آن برای سال جاری حدود ۱۴ میلیارد دلار پیش‌بینی می‌شود. اوپن‌ای‌آی در هشت سال آینده حدود ۱.۴ تریلیون دلار به توان محاسباتی متعهد شده است؛ شرط‌بندی عظیمی برای شرکتی که هم‌اکنون ۲۵ میلیارد دلار درآمد سالانه دارد.

طراحی سخت‌افزار برای استنتاج مدل‌های زبانی بزرگ

تراشه Jalapeño اوپن‌ای‌آی که نخستین «پردازنده هوش» شرکت نامیده می‌شود، به طور خاص برای استنتاج مدل‌های زبانی بزرگ (LLM) ساخته شده و نه بارهای کاری هوش مصنوعی همه‌منظوره. اوپن‌ای‌آی طراحی معماری اصلی را بر اساس نقشه راه مدل‌های خود و سیستم‌های ارائه خدمت ارائه داد، در حالی که برادکام مهندسی سیلیکون و یکپارچه‌سازی شبکه با کارایی بالا را بر عهده گرفت.

شرکت TSMC تولید فیزیکی را در تایوان انجام می‌دهد و سلستیکا مسئول ساخت برد و سیستم‌های رک است. به گفته اوپن‌ای‌آی، نمونه‌های اولیه آزمایشگاهی هم‌اکنون بارهای کاری frontier را از جمله مدل منتشرنشده GPT-5.3-Codex-Spark را با فرکانس و توان هدف تولید اجرا می‌کنند.

ریچارد هو، رئیس برنامه سخت‌افزاری اوپن‌ای‌آی، خاطرنشان کرد که این معماری حرکت داده را به حداقل می‌رساند تا بهره‌برداری واقعی را به اوج عملکرد نظری نزدیک کند. برخلاف شتاب‌دهنده‌های همه‌منظوره که از بارهای کاری قدیمی هوش مصنوعی اقتباس شده‌اند، این معماری به طور خاص تعادل میان محاسبه، حافظه و منابع شبکه را برای حل گلوگاه‌های حرکت داده بومی ارائه خدمت تعاملی مدل‌های زبانی بزرگ برقرار می‌سازد.

برای دستیابی به این هدف در مقیاس بزرگ، پلتفرم سیلیکون شبکه Tomahawk برادکام را مستقیماً در طراحی یکپارچه کرده است و به پردازنده‌های سفارشی اجازه می‌دهد در محیط‌های خوشه‌ای عظیم مرکز داده با یکدیگر ارتباط برقرار کنند.

چرخه یکپارچه‌سازی عمودی

با ورود به حوزه سیلیکون سفارشی، اوپن‌ای‌آی از لایه صرف نرم‌افزاری به شرکتی زیرساختی با یکپارچه‌سازی عمودی تبدیل می‌شود. این راهبرد تمام‌پشته‌ای کل زنجیره را در بر می‌گیرد: معماری تراشه، هسته‌های نرم‌افزاری، سیستم‌های حافظه، زمان‌بندی شبکه و لایه کاربردی نهایی. مانند پیوند تنگاتنگ سخت‌افزار اختصاصی اپل با سیستم‌عامل iOS، اوپن‌ای‌آی اکنون می‌تواند زیرساخت خود را دقیقاً حول نقشه راه مدل‌های داخلی بهینه کند.

این یکپارچه‌سازی چرخه عملیاتی پیوسته‌ای ایجاد می‌کند. افزایش کارایی زیرساخت، هزینه آموزش و ارائه خدمت مدل‌ها را کاهش می‌دهد. ارائه خدمت ارزان‌تر به محصولات بهتر و پاسخگوتر منجر می‌شود که حجم کاربر و درآمد را افزایش می‌دهد و این درآمد دوباره در نسل بعدی زیرساخت سفارشی سرمایه‌گذاری می‌شود.

غلبه بر مزیت تأخیر در ورود

با معرفی سیلیکون اختصاصی خود، اوپن‌ای‌آی وارد عرصه‌ای می‌شود که رقبای اصلی آن نزدیک به یک دهه صرف توسعه سخت‌افزار اختصاصی کرده‌اند. گوگل از سال ۲۰۱۵ واحدهای پردازش تنسور (TPU) خود را به کار گرفت و اکنون حدود یک‌چهارم ظرفیت محاسباتی جهانی هوش مصنوعی خارج از زنجیره تأمین انویدیا را در اختیار دارد.

آمازون بیش از یک میلیون تراشه سفارشی خود را ارسال کرده و متا و مایکروسافت نیز به گسترش زیرساخت خود ادامه می‌دهند.

گرگ براکمن، رئیس و هم‌بنیان‌گذار اوپن‌ای‌آی، گفت: «Jalapeño بخشی از راهبرد بلندمدت زیرساخت تمام‌پشته‌ای ما برای فراوان‌تر کردن توان محاسباتی است. با طراحی بخش بیشتری از پشته توسط خودمان، می‌توانیم هوش بیشتری را با کارایی بالاتر ارائه دهیم.»

برای جبران شکاف زمانی، اوپن‌ای‌آی فاز توسعه را شتاب بخشید. تراشه Jalapeño اوپن‌ای‌آی تنها در نه ماه از طراحی از صفر به مرحله tape-out — آخرین گام پیش از تولید فیزیکی — رسید. تیم‌های مهندسی با بهره‌گیری از مدل‌های زبانی خود اوپن‌ای‌آی برای خودکارسازی و بهینه‌سازی بخش‌هایی از فرآیند طراحی سخت‌افزار، این زمان‌بندی را محقق کردند.

این امر حلقه بازخورد منحصربه‌فردی ایجاد می‌کند که در آن مدل‌هایی که به کاربران ارائه می‌شوند، actively برای ساخت زیرساخت فیزیکی مورد استفاده قرار می‌گیرند که نسخه‌های آینده را اجرا خواهد کرد. استقرار اولیه این سخت‌افزار در مراکز داده تا پایان سال ۲۰۲۶ آغاز می‌شود.

هوک تان، مدیرعامل برادکام، تأیید کرد که rollout در کنار شرکای زیرساختی از جمله مایکروسافت برای آماده‌سازی یکپارچه‌سازی مراکز داده در مقیاس گیگاوات گسترش خواهد یافت.

نظرات

ثبت نظر جدید

برای ثبت نظر باید وارد حساب کاربری شوید.

ورود / ثبت‌نام

هنوز نظری ثبت نشده است. اولین نفر باشید!