Robocikowo>ROBOCIKOWO
Sztuczna Inteligencja

Runway Solaris: interfejs generowany klatka po klatce, bez kodu

Pan Robocik4 września 2026 · 3 min czytania
Runway Solaris: interfejs generowany klatka po klatce, bez kodu

Runway ogłosił 31 sierpnia 2026 model Solaris — pierwszy z rodziny, którą firma nazywa Interface World Models. System generuje interfejs użytkownika bezpośrednio jako obraz, klatka po klatce, zamiast tłumaczyć projekt na HTML, CSS i JavaScript. Runway usuwa w ten sposób warstwę kodu spomiędzy projektu a działającą aplikacją.

Najważniejsze w skrócie

  • Solaris powstał na bazie modelu wideo Gen-4.5 i rozwija linię world modeli GWM-1
  • Kliknięcia i przeciągnięcia są warunkiem generowania kolejnej klatki, a nie wywołaniem zaprogramowanego zdarzenia
  • Badanie na 250 uczestnikach i blisko 7500 ocen parami: 61% wskazań na Solaris, 24% na interfejs kodowy Claude Opus 5
  • Runway deklaruje utrzymanie jakości obrazu w 720p przez całą sesję

Interfejs bez warstwy pośredniej

Każde dzisiejsze oprogramowanie wymaga tłumaczenia — projekt wizualny trzeba zamienić na kod, zanim zacznie działać. Runway argumentuje, że konwersja jest stratna, bo utrwala wyłącznie zachowania przewidziane przed premierą. W Solarisie interfejsem staje się cała klatka.

Jak Runway osiągnął czas rzeczywisty

Solaris zbudowano na modelu wideo Gen-4.5, kontynuując kierunek wyznaczony przez GWM-1. Kliknięcia i przeciągnięcia trafiają do modelu jako warunek generowania następnej klatki, więc reakcja nie musi być zapisana w kodzie.

Przyspieszenie tej pętli do czasu rzeczywistego wymagało trzech etapów:

  1. przejście na generowanie autoregresyjne — model tworzy klatkę po klatce
  2. Destylacja odszumiania: Technika treningowa, w której szybki model uczy się odtwarzać wynik wieloetapowego procesu odszumiania w zaledwie kilku krokach. do kilku kroków
  3. dotrenowanie szybkiego modelu na własnych wyjściach.

Trzy etapy nie zmieniają samej pętli — gest użytkownika wchodzi do modelu jako warunek, model odpowiada kolejną klatką. Skracają wyłącznie czas, w jakim ta pętla się domyka.

≈0,5 spróg opóźnienia — powyżej niego interakcja przestaje być odczuwana jako natychmiastowaRunway

Warstwę decyzyjną prowadzi osobny model językowy, który ustala, co ma się wydarzyć, podczas gdy Solaris rysuje, jak to wygląda.

Co pokazały testy

Runway zestawił Solaris z interfejsem wygenerowanym w kodzie przez Claude Opus 5. Oba startowały z tego samego obrazu i dostały identyczne polecenia, a 250 uczestników wydało blisko 7500 ocen parami na 30 przypadkach.

InterfejsOgólna preferencjaNaturalność zachowania
Solaris61%71%
Interfejs kodowy Claude Opus 524%21%
Badanie preferencji: 250 uczestników, blisko 7500 ocen parami na 30 przypadkach.

Przewaga jest wyraźniejsza przy naturalności zachowania w scenie niż przy samej zgodności z poleceniem. Osobny test pokazał, że modele multimodalne, w tym Claude Fable 5, odtwarzają interfejs ze zrzutu ekranu tym gorzej, im bardziej złożony jest obraz — mierzono to metrykami SSIM i DINOv3.

Dlaczego to ważne?

Runway celuje nie tylko w projektantów. Agenty typu computer use uczą się dziś na stałych układach stron i tracą skuteczność przy zmianie layoutu. Interfejs generowany na bieżąco daje środowisko treningowe, w którym to samo zadanie ma za każdym razem inny wygląd. Jeśli podejście się utrzyma, przesuwa punkt ciężkości z generowania kodu na generowanie stanu wizualnego — to inna klasa problemu niż narzędzia typu Copilot czy Cursor.

Co dalej?

  • Runway zbiera zgłoszenia o wczesny dostęp i zapowiada publiczne uruchomienie z wybranymi partnerami
  • Stabilny, czytelny tekst pozostaje nierozwiązany — firma rozważa układ hybrydowy z modelem obrazu do widoków tekstowych

Źródła

Udostępnij ten artykuł