اخبار تکنولوژی

پایان پردازنده های گرافیکی؟ هوش مصنوعی نوری قدرت را به دست می گیرد

پایان پردازنده های گرافیکی؟ هوش مصنوعی نوری قدرت را به دست می گیرد

محققان دانشگاه کالیفرنیا، لس آنجلس (UCLA) مدل‌های مولد نوری را معرفی کرده‌اند، الگوی جدیدی برای تولید تصویر هوش مصنوعی که از فیزیک نور به جای محاسبات الکترونیکی معمولی استفاده می‌کند. این رویکرد جایگزینی پرسرعت و کم مصرف برای مدل‌های انتشار سنتی ارائه می‌کند و در عین حال کیفیت تصویر قابل مقایسه را به دست می‌آورد.

هوش مصنوعی مولد مدرن، از جمله مدل‌های انتشار و مدل‌های زبان بزرگ، می‌تواند تصاویر، فیلم‌ها و متن‌های انسانی واقعی ایجاد کند. با این حال، این سیستم ها به منابع محاسباتی عظیم، افزایش مصرف انرژی، انتشار کربن و پیچیدگی سخت افزار نیاز دارند. تیم UCLA به رهبری پروفسور Aydoğan Özkan رویکرد کاملا متفاوتی را در پیش گرفت: آنها تصاویر را به صورت نوری تولید کردند و از خود نور برای انجام محاسبات استفاده کردند.

این سیستم یک رمزگذار الکترونیکی کم عمق را با یک رمزگشای نوری پراش فضای آزاد قابل تنظیم مجدد ادغام می کند. این فرآیند با نویز تصادفی شروع می شود، که به سرعت توسط رمزگذار دیجیتال به الگوهای پیچیده فاز دوبعدی – به نام “بذرهای مولد نوری” ترجمه می شود. سپس این دانه ها بر روی یک مدولاتور نور فضایی (SLM) پخش می شوند و توسط نور لیزر روشن می شوند. همانطور که این نور مدوله شده از طریق یک رمزگشای پراش ثابت و از پیش بهینه شده منتشر می شود، فوراً خود سازماندهی می شود تا تصویر کاملاً جدیدی تولید کند که از نظر آماری به توزیع داده مورد نظر پایبند باشد. مهمتر از همه، برخلاف مدل‌های انتشار دیجیتال، که ممکن است به صدها یا حتی هزاران مرحله تکراری برای حذف نویز نیاز داشته باشند، این فرآیند نوری تصویری با کیفیت بالا در یک «عکس فوری» تولید می‌کند.

همچنین ببینید :  خالق تصویر هوش مصنوعی جدید گوگل پیراهن من را درآورده است

محققان سیستم خود را بر روی مجموعه داده های مختلف تایید کردند. مدل های نوری با موفقیت تصاویر جدیدی از ارقام دست نویس، پروانه ها، صورت انسان ها و حتی آثار هنری الهام گرفته از ون گوگ تولید کرده اند. نتایج از نظر آماری با نتایج به‌دست‌آمده از پیشرفته‌ترین مدل‌های انتشار دیجیتال قابل مقایسه بود که هم دقت بالا و هم تنوع خلاقانه را نشان می‌داد. تصاویر چند رنگ و آثار هنری با وضوح بالا به سبک ون گوگ بیشتر بر تطبیق پذیری این رویکرد تأکید می کنند.

تیم UCLA دو چارچوب مکمل را توسعه داد:

  1. مدل‌های عکس فوری مولد نوری تصاویر را در یک مرحله روشنایی تولید می‌کنند و نتایج جدیدی را تولید می‌کنند که از نظر آماری توزیع داده‌های هدف، از جمله پروانه‌ها، چهره‌های انسان و آثار هنری به سبک ون گوگ را دنبال می‌کنند.
  2. مدل‌های تولیدکننده نوری تکراری، خروجی‌ها را به صورت بازگشتی اصلاح می‌کنند، فرآیندهای انتشار را تقلید می‌کنند، که کیفیت و تنوع تصویر را بهبود می‌بخشد در حالی که از فروپاشی حالت جلوگیری می‌کند.

نوآوری های کلیدی عبارتند از:

  • دانه های نوری رمزگذاری شده فاز: نمایش فشرده ای از ویژگی های نهفته که امکان تولید نوری مقیاس پذیر را فراهم می کند.
  • رمزگشاهای پراش قابل تنظیم مجدد: سطوح ایستا و بهینه شده که قادر به سنتز توزیع داده های مختلف از دانه های از پیش محاسبه شده هستند.
  • قابلیت چند رنگ و وضوح بالا: نوردهی ثابت طول موج، تولید تصاویر RGB و نتایج هنری خوب را امکان پذیر می کند.
  • بهره وری انرژی: تولید نوری نسبت به مدل های انتشار مبتنی بر GPU، به ویژه برای تصاویر با وضوح بالا، با انجام محاسبات در حوزه نوری آنالوگ، به قدرت کمتری نیاز دارد.
همچنین ببینید :  راهنمای نهایی ChatGPT: آنچه شما باید بدانید

این انعطاف‌پذیری به یک راه‌اندازی نوری اجازه می‌دهد تا با به‌روزرسانی دانه‌های کدگذاری‌شده و رمزگشای از پیش آموزش‌دیده بدون تغییر سخت‌افزار فیزیکی، چندین کار تولیدی را انجام دهد.

علاوه بر سرعت و کارایی، مدل‌های مولد نوری ویژگی‌های خصوصی و امنیتی داخلی را ارائه می‌کنند. با روشن کردن یک الگوی فاز کدگذاری شده در طول موج های مختلف، تنها یک رمزگشای پراش منطبق می تواند تصویر مورد نظر را بازسازی کند. این مکانیسم چندگانه با طول موج به عنوان یک “قفل کلید” فیزیکی عمل می کند و امکان تحویل امن و خصوصی محتوا را برای برنامه هایی مانند ضد جعل، رسانه های شخصی و ارتباطات بصری محرمانه فراهم می کند.

لینک منبع

نویسنده اصلی

وب سایت 123 سلکت یک مجله مرجع جهت معرفی و راهنمای خرید و انتخاب سریع بهترین کالا ها و محصولات در زمینه های مختلف و متنوع است
دکمه بازگشت به بالا