پرش به محتوای اصلی
پرش به محتوای مقاله

آیا Solaris جایگزین کدهای HTML و CSS در طراحی رابط‌ها می‌شود؟

·۱۰ شهریور ۱۴۰۵۷ دقیقه مطالعه۱ بازدید
پیش‌نمایش سولاریس ران‌وی از اینترنت بدون کد
پیش‌نمایش سولاریس ران‌وی از اینترنت بدون کد
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

تغییر پارادایم از «اجرای کد برای نمایش UI» به «تولید ویدیو در لحظه برای نمایش UI». این نخستین بار است که یک مدل جهانی رابط کاربری (Interface World Model) به‌طور جدی برای جایگزینی استک‌های سنتی وب معرفی می‌شود.

تصور کنید وب‌سایتی را باز می‌کنید که تا پیش از آن لحظه اصلاً وجود نداشته است. این وعده اصلی Solaris است؛ مدل جهانی رابط کاربری جدیدی از شرکت Runway که هر فریم از محیط برنامه را به‌جای اجرای کدهای HTML، CSS یا جاوااسکریپت، به‌صورت یک ویدیوی زنده و در لحظه رندر می‌کند.

پیش‌نمایش سولاریس ران‌وی از اینترنت بدون کد

توسعه وب سنتی بر پایه کدهای ایستا است که به مرورگر می‌گوید هر المان را کجا نمایش دهد. دهه‌هاست که اینترنت مجموعه‌ای از اسناد و اسکریپت‌هاست، اما Runway روی این شرط‌بندی کرده است که آینده وب نه یک سند، بلکه یک توهم تعاملی و مداوم است که توسط هوش مصنوعی زاینده هدایت می‌شود.

این چرخش در زمانی رخ می‌دهد که مدل‌های AI به نقطه تلاقی سرعت، هزینه و کیفیت رسیده‌اند. وقتی تولید ویدیو به قدری سریع شود که در میلی‌ثانیه‌ها رخ دهد، مرز بین «صفحه رندر شده» و «ویدیوی تولید شده» از بین می‌رود. این اتفاق اجازه می‌دهد رابط‌هایی ساخته شوند که کدنویسی دستی آن‌ها پیش از این بیش از حد پیچیده یا گران بود.

همان‌طور که در تحلیل‌های قبلی ما درباره‌ی مدل‌های مولد ویدیو اشاره کردیم، سرعت استنتاج (Inference) — لحظه‌ای که مدل واقعاً جواب تولید می‌کند، شبیه خودِ آشپزی است نه دوره‌ی آموزش آشپز — کلید تبدیل این ابزارها از محیط‌های تفریحی به ابزارهای کاربردی است.

سازوکار Solaris

به نقل از گزارش The Rundown AI، این سامانه با جفت کردن یک مدل ویدیویی پیشرفته و یک مدل زبانی بزرگ (LLM) — مثل کتابخانه‌داری که میلیاردها صفحه را خوانده و حالا با همان لحن جواب می‌دهد — عمل می‌کند:

  • مدل ویدیویی Gen-4.5 مسئول رندر بصری رابط کاربری است.
  • یک LLM یکپارچه تمام اقدامات کاربر، مثل کلیک یا کشیدن (Drag)، را رصد می‌کند.
  • این مدل لایه‌ی منطقی را تصمیم می‌گیرد و به مدل ویدیویی دستور می‌دهد فریم‌های بعدی را رسم کند.

پیش‌نمایش سولاریس ران‌وی از اینترنت بدون کد

در دموهای ارائه شده توسط Runway، چندین قابلیت به تصویر کشیده شده است. در یک مثال، کاربر یک پیراهن را از رگال مجازی روی عکس می‌کشد تا در لحظه پرو شود. در دمو دیگر، یک سالاد با ریختن مواد در کاسه ساخته می‌شود. در مورد سوم، یک شبیه‌ساز احتراق تعاملی نمایش داده شده است که تمام این‌ها بدون حتی یک خط کد UI سنتی اجرا می‌شوند.

بنچمارک‌های عملکرد

بر اساس بررسی‌های Runway برای مقایسه Solaris با صفحات کدنویسی شده توسط AI، نتایج نشان‌دهنده برتری این روش در حوزه‌های خاص است:

  • تست‌کنندگان در ۷۱٪ موارد، رفتار درون‌صحنه‌ای Solaris را به صفحات کدنویسی شده توسط Claude Opus 5 ترجیح دادند.
  • Solaris در ۶۱٪ موارد در توانایی پیروی از دستورات برنده شد.

پیش‌نمایش سولاریس ران‌وی از اینترنت بدون کد

با این حال، این فناوری هنوز آماده تولید تجاری نیست. Runway اعتراف کرد که نسخه فعلی با خوانایی متن مشکل دارد که برای هر اپلیکیشن کاربردی یک شکست بحرانی است. همچنین پدیده‌ای به نام «انحراف جلسه طولانی» (Long Session Drift) رخ می‌دهد که در آن AI وضعیت رابط کاربری را در طول زمان گم می‌کند و صفحاتی می‌سازد که متقاعدکننده هستند اما از نظر عملکردی غلط‌اند. Solaris اکنون برای تست‌های بیشتر وارد مرحله دسترسی زودهنگام می‌شود.

تشخیص سریع در سلامت

در حالی که Solaris روی رابط‌ها تمرکز دارد، پیشرفت‌های دیگر AI به لایه‌های فیزیکی و ایمنی رسیده‌اند. پژوهشگران Imperial College London مدلی معرفی کردند که یک ECG روتین را در کمتر از دو ثانیه می‌خواند تا نارسایی قلبی و بیماری‌های دریچه‌ای را شناسایی کند.

طبق گزارش این تیم، تأیید این بیماری‌ها پیش از این نیازمند صف‌های چند ماهه برای سونوگرافی بود، در حالی که بیمارستان‌ها سالانه بیش از یک میلیارد ECG می‌گیرند. این مدل روی ۱۰.۶ میلیون ECG آموزش دیده و روی ۶۵ هزار بیمار تست شده است. این سامانه در ۸۱٪ موارد نارسایی قلبی و در ۹۰٪ موارد بیماری دریچه‌ای را به‌درستی شناسایی کرد.

پیش‌نمایش سولاریس ران‌وی از اینترنت بدون کد

پروفسور Fu Siong Ng معتقد است بیمارستان‌ها می‌توانند این مدل را روی تمام ECGها اجرا کنند و مشکلاتی را بیابند که حتی برای آن‌ها غربالگری نمی‌شد. این تیم در حال اجرای آزمایش روی ۵۹۰ بیمار در ۶ بیمارستان است تا طی دو سال آینده وارد سیستم ملی سلامت (NHS) شود.

پژوهش‌های خودکار در ایمنی AI

در جبهه ایمنی، Anthropic در حال تست پژوهش‌های خودکار است. تیم‌هایی از عامل‌های (Agents) Claude به‌طور مستقل پژوهش‌های ایمنی انجام دادند و ۱۰ نوع رفتار نادرست AI را آموزش دادند تا حذف شوند. نتایج این کار به‌طور متوسط ۴ برابر بهتر از متخصصان انسانی در همان تسک بود. این رویکرد در حالی پیش می‌رود که برخی چالش‌های بنیادین در مورد توانایی‌های خودبهبودی مدل‌ها وجود دارد؛ چنان‌که مطالعه‌ای از MIT نشان داد فقدان خلاقیت در عامل‌های هوش مصنوعی می‌تواند مانعی برای تکامل بازگشتی و خودکار این سیستم‌ها باشد.

جزئیات این پژوهش:

  • انواع شکست: هدف، ۱۰ مورد رایج از جمله چاپلوسی مدل (Sycophancy)، فریب و جیل‌بریک‌ها بود.
  • فرآیند: عامل‌ها در چرخه‌ای از جست‌وجوی متون، آموزش و امتیازدهی فعالیت کردند.
  • نتایج: بهبودها از ۲۶٪ کاهش چاپلوسی تا ۹۶٪ بهبود در سوءاستفاده از پاداش (Reward Hacking) متغیر بود، بدون اینکه توانایی‌های کلی مدل کاهش یابد.
  • مقایسه انسانی: ۶ پژوهشگر ارشد ایمنی تنها ۲۰٪ موفقیت در رفع فریب داشتند، در حالی که Claude در بیش از ۱۵۰ تلاش، میانگین ۸۵٪ را ثبت کرد.
  • کارایی: مدل ضعیف‌تر Claude Sonnet 5 حدود ۶۰ ساعت روی نسخه پیش‌انتشار Opus 4.8 آموزش ایمنی داد و ۱۵ هزار برابر داده کمتری نسبت به فرآیند داخلی Anthropic مصرف کرد.

شخصی‌سازی در سطح سازمانی

برای حل شکاف اعتماد در برندینگ، Corinthia Hotels یک اکوسیستم ۷ عاملی ساخت تا شخصی‌سازی فوق‌دقیق را اجرا کند. داده‌ها نشان می‌دهد ۵۶٪ مصرف‌کنندگان محتوای تولید شده توسط AI را تشخیص می‌دهند و ۴۰٪ می‌گویند این موضوع اعتماد به برند را کم می‌کند.

این معماری ۵ پرسونا، ۱۴ مرحله سبک زندگی و بیش از ۷۵ سیگنال رفتاری را مدیریت می‌کند تا بیش از ۶ هزار نسخه محتوایی مختلف بسازد. این سیستم به نرخ تأیید ۱۰۰ درصدی برند رسید، بهره‌وری را ۱۰ برابر کرد و بیش از ۱۵۰ ساعت در زمان صرفه‌جویی کرد، بدون اینکه هیچ توهمی (Hallucination) در خروجی‌ها رخ دهد.

گردش‌کارهای عملی AI

AI همچنین از طریق ادغام‌های عمیق به بهره‌وری شخصی وارد شده است. کاربران اکنون ChatGPT Work را از طریق اپلیکیشن دسکتاپ به iMessage متصل می‌کنند. با نصب پلاگین Messages و دادن دسترسی‌های Full Disk Access، Automation و Contacts، می‌توان از ChatGPT خواست پیام‌های خوانده نشده را بررسی کرده و خلاصه‌ای را برای کاربر ارسال کند.

همچنین برخی کاربران عامل‌های خودمختار برای زندگی روزمره می‌سازند. کاربری به نام Christian یک ردیاب غذا ساخت که فقط با عکس گرفتن از بشقاب، شناسایی، تخمین مقدار و کالری را انجام می‌دهد. او برای دقت بیشتر، یک «گام به چالش کشیدن» (Challenge Step) گذاشته است؛ به‌طوری که یک زیر-عامل کور — که فقط عکس و دستورالعمل را می‌بیند — دوباره تخمین می‌زند و اگر جواب‌ها متفاوت بود، مورد برای بررسی انسانی علامت‌گذاری می‌شود.

چشم‌انداز جهانی AI

توسعه‌های اخیر نشان می‌دهد AI در حال ورود به دولت و finance است. Starshield AI متعلق به SpaceX مدل Grok را برای استفاده غیرمحرمانه در پلتفرم داخلی پنتاگون برای ۳ میلیون کارمند مستقر کرد. هم‌زمان، OpenAI گزارش داد که تبلیغات ChatGPT تنها ۲۰۰ روز پس از عرضه، به نرخ درآمد سالانه یک میلیارد دلار رسید.

اما نگرانی‌های نظارتی باقی است. اتحادیه اروپا ChatGPT را یک «پلتفرم آنلاین بسیار بزرگ» (VLOP) نامید و به OpenAI چهار ماه فرصت داد تا استانداردهای نظارتی سخت‌گیرانه‌تری را رعایت کند. همچنین اندرو بیلی، رئیس بانک مرکزی انگلیس، هشدار داد که سیستم مالی پروتکل‌های لازم برای مدیریت «خودمختاری پیچیده» مدل‌های پیشرو را ندارد.

تحلیل: مرگ فرانت-اند؟

برای صاحبان کسب‌وکار و توسعه‌دهندگان، Solaris احتمال فروپاشی استک سنتی فرانت-اند است. اگر یک LLM بتواند پاسخ UI درست به کلیک کاربر را «تصور» کند، نیاز به کتابخانه‌های عظیم React یا Vue کم می‌شود. این یعنی هزینه نمونه‌سازی و استقرار تجربه‌های بصری پیچیده به‌شدت کاهش می‌یابد.

با این حال، ماهیت «توهمی» این سیستم بزرگ‌ترین نقطه ضعف آن است. در محیط تجاری، دکمه‌ای که درست به نظر می‌رسد اما به صفحه‌ای توهمی منجر می‌شود، یک شکست بحرانی است. تا زمانی که Runway مشکل خوانایی متن و انحراف وضعیت را حل نکند، Solaris بیشتر یک نوآوری جذاب است تا جایگزینی برای وب کدنویسی شده.

منتظر انتشار دسترسی زودهنگام Solaris باشید تا ببینیم آیا شرکت می‌تواند یک «لایه تعیین‌گر» (Deterministic Layer) پیاده کند که از انحراف رابط کاربری در جلسات طولانی جلوگیری کند.

گام بعدی شما

  • اگر توسعه‌دهنده UI هستید، روی ابزارهای Generative UI تمرکز کنید تا با تغییر پارادایم از کد به رندر آشنا شوید.
  • برای مدیران محصول، بررسی کنید که کدام بخش‌های اپلیکیشن شما می‌تواند با رابط‌های بصری پویا جایگزین شود تا هزینه توسعه کم شود.
  • منتظر انتشار دسترسی زودهنگام Solaris باشید تا لایه تعیین‌گر (Deterministic) آن را برای جلوگیری از انحراف جلسات تست کنید.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این فناوری با تکیه بر اعتبار مدل‌های Gen-4.5، می‌تواند هزینه‌های توسعه نرم‌افزار را به‌شدت کاهش دهد. حذف نیاز به کدنویسی برای رابط‌های پیچیده، سرعت تبدیل ایده به محصول را به سطح میلی‌ثانیه می‌رساند.

تأثیر برای ایران

به‌دلیل محدودیت‌های API و تحریم‌ها، دسترسی توسعه‌دهندگان ایرانی به Solaris احتمالاً محدود خواهد بود، اما این رویکرد فرصتی برای استارتاپ‌های داخلی است تا روی ابزارهای Generative UI متمرکز شوند.

·نگاه ما
تحریریه دات‌هوش

جایگزینی کد با ویدیو در لایه رابط کاربری، در واقع تلاش برای حذف لایه ترجمه بین قصد کاربر و نمایش بصری است. اگر Runway بتواند لایه‌ای از ثبات (Determinism) را به این توهمات بصری اضافه کند، مفهوم «طراحی وب» از رسم پیکسل‌ها به تعریف منطق‌های رفتاری تغییر می‌کند. این یعنی قدرت از دست برنامه‌نویسان فرانت-اند به کسانی می‌افتد که می‌توانند بهترین دستورالعمل‌های بصری را برای مدل‌ها بنویسند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.