Runway مدل Solaris را معرفی کرد؛ ساخت رابط‌های تعاملی بدون کدنویسی [تماشا کنید]

در این مدل، به‌جای تولید کد برای ساخت رابط کاربری تعاملی، خود رابط به‌صورت زنده و مداوم رندر می‌شود.
کد خبر: 52334
زمان انتشار: 2 سپتامبر 2026 - 13:46 ب.ظ -
1 بازدید

شرکت هوش مصنوعی Runway مدل جدیدی به نام Solaris را معرفی کرده است که به گفته این شرکت، اولین مدل از خانواده «مدل‌های جهان رابط» است. این مدل می‌تواند رابط‌های تعاملی مانند وب‌سایت‌ها، اپلیکیشن‌ها و محیط‌های دیجیتال را به‌صورت لحظه‌ای و فریم‌به‌فریم تولید کند و به کاربر امکان دهد مستقیماً با عناصر تصویری روی صفحه تعامل داشته باشد.

سولاریس برای ساخت این محیط‌ها به دانش برنامه‌نویسی متداول نیاز ندارد. کاربر می‌تواند با کلیک، کشیدن عناصر یا دادن دستور متنی، نحوه تغییر محیط را تعیین کند و مدل در پاسخ، فریم‌های بعدی را می‌سازد. Runway می‌گوید رویکرد Solaris با وایب کدینگ تفاوت دارد. در این مدل، به‌جای تولید کد برای ساخت رابط، خود رابط به‌صورت زنده و مداوم رندر می‌شود.

خروجی‌های مدل هوش مصنوعی Solaris از شرکت Runway

در نرم‌افزارهای معمولی، طراحی بصری ابتدا باید به یک نمایش میانی مانند کد تبدیل شود تا بتواند به تعاملات کاربر پاسخ دهد. Runway می‌گوید این مرحله می‌تواند بخشی از اطلاعات بصری و انعطاف‌پذیری رابط را از بین ببرد. Solaris تلاش می‌کند این مرحله میانی را حذف کند. مدل، هر فریم و پاسخ به ورودی کاربر را مستقیماً تولید می‌کند و کل فریم به‌عنوان رابط در نظر گرفته می‌شود.

برای مثال، Runway محیط فروشگاه لباس را نشان داده است که در آن کاربر می‌تواند تصویری از خودش را به‌عنوان مرجع وارد کند، سپس لباس را از روی قفسه بردارد و با کشیدن آن روی تصویر خود، ظاهر لباس را روی بدنش مشاهده کند.

کاربر همچنین می‌تواند با دستورهای متنی از مدل بخواهد تغییراتی در محیط ایجاد کند؛ برای مثال رنگ یک شیء را تغییر دهد یا عنصری را در تصویر جابه‌جا کند. در نمونه دیگری، کاربر می‌تواند مواد مختلف را در یک محیط تعاملی مربوط به احتراق آزمایش کند و واکنش‌های تولیدشده را هنگام تعامل با محیط مشاهده کند.

Solaris چگونه کار می‌کند؟

Solaris بر پایه مدل تولید ویدیوی Gen-4.5 ساخته شده و Runway آن را برای درک تعاملات و تولید پاسخ در لحظه تطبیق داده است. این مدل همچنین ادامه مسیری است که Runway با مدل عمومی جهان GWM-1 آغاز کرده بود.

Solaris ورودی‌های کاربر مانند کلیک و کشیدن را به‌عنوان سیگنال‌هایی برای تولید فریم بعدی در نظر می‌گیرد. به این ترتیب، مدل می‌تواند رابطه میان اقدام کاربر و نتیجه بصری آن را یاد بگیرد، بدون اینکه لازم باشد هر تعامل به‌صورت جداگانه در کد تعریف شود. برای رسیدن به سرعت تعاملی، Runway مدل را به‌گونه‌ای آموزش داده که فریم‌ها را به‌صورت خودبازگشتی (Autoregressive) و بر اساس فریم‌های قبلی تولید کند.

Solaris از دو بخش برای مدیریت محیط استفاده می‌کند. مدل زبانی درخواست کاربر را تفسیر می‌کند و تصمیم می‌گیرد محیط چگونه باید تغییر کند، درحالی‌که مدل جهان رابط، نحوه نمایش این تغییر را به‌صورت فریم‌های تصویری تولید می‌کند. مدل زبانی همچنین مشخص می‌کند که یک تعامل باید همان صحنه فعلی را تغییر دهد یا به محیط جدیدی منتقل شود و دستورهایی را تولید کند که Solaris برای رندر حالت بعدی از آن‌ها استفاده می‌کند.

Runway مدل Solaris را معرفی کرد؛ ساخت رابط‌های تعاملی بدون کدنویسی [تماشا کنید]
Runway می‌گوید کاربران بیشتر خروجی‌های سولاریس را نسبت به خروجی‌های مدل‌های زبانی پسندیدند.

Runway همچنین کاربرد مشابهی را برای آموزش مطرح می‌کند؛ به این شکل که آموزش به‌جای نمایش یک مسیر ثابت برای همه کاربران، مرحله بعدی را متناسب با وضعیت هر فرد تولید کند و در صورت خروج کاربر از مسیر پیش‌بینی‌شده، خود را با شرایط جدید تطبیق دهد.

Solaris فعلاً به‌صورت عمومی برای مشتریان عرضه نشده است. Runway اعلام کرده با شرکای خود برای عرضه عمومی آن همکاری می‌کند و امکان درخواست دسترسی زودهنگام نیز فراهم شده است.

نوشته شده توسط:

اشتراک گذاری
تبلیغات