Robocikowo>ROBOCIKOWO
DALL-E 3

DALL-E 3

DALL·E 3 · Rodzina: DALL-E
Model text-to-image OpenAI (2023) zintegrowany z ChatGPT: lepsze podążanie za promptem i renderowanie tekstu. Obecnie starsza generacja (zastąpiony przez GPT Image).
⚠ Deprecated✓ Publiczny dostępModel generowania obrazów📁 DALL-E
Data premiery
1 października 2023
Dostęp:APIHostedWdrożenie:☁ Cloud

Przegląd

DALL·E 3 to model generowania obrazów z tekstu (text-to-image) opracowany przez OpenAI, zapowiedziany we wrześniu 2023 r. i udostępniony w ChatGPT (dla użytkowników Plus i Enterprise) w październiku 2023 r., a przez API na początku listopada 2023 r. W porównaniu z DALL·E 2 znacznie lepiej rozumie niuanse i szczegóły opisu oraz dokładniej podąża za złożonymi promptami.

Model jest natywnie zintegrowany z ChatGPT — asystent pomaga rozwijać i doprecyzowywać prompty przekazywane do generatora. DALL·E 3 wyraźnie poprawił także renderowanie tekstu wewnątrz obrazów względem wcześniejszych generacji.

Na wejściu przyjmuje opis w języku naturalnym, a na wyjściu generuje obraz. Poprzez API obsługuje rozdzielczości 1024×1024, 1024×1536 i 1536×1024 oraz dwa poziomy jakości: standard i HD. Ceny za obraz wynoszą od 0,04 USD (standard 1024×1024) do 0,12 USD (HD, formaty prostokątne).

DALL·E 3 jest dostępny przez OpenAI API, ChatGPT oraz Microsoft (Bing Image Creator / Copilot, Azure). Od lutego 2024 r. wygenerowane obrazy zawierają metadane w standardzie C2PA; model stosuje filtry bezpieczeństwa (m.in. blokuje styl żyjących artystów). W marcu 2025 r. w ChatGPT DALL·E 3 został zastąpiony natywnym generowaniem obrazów GPT Image — jest to obecnie model starszej generacji.

Klasyfikacja
Model generowania obrazów
Rodzina: DALL-E
Dostęp i wdrożenie
APIHostowane
Chmura
Wagi: Zamknięte
Kluczowe parametry
📥 Wejście: tekst

Specyfikacja techniczna

Licencja
Proprietary
Modalności
⬇ Wejście (Input)
text
⬆ Wyjście (Output)
image

Możliwości i zastosowania

Natywne możliwości modelu
Generowanie obrazów z tekstu
Generowanie obrazu z opisu tekstowego (promptu). Model interpretuje polecenie w języku naturalnym i tworzy nową, spójną wizualizację od zera — bez obrazu wejściowego.
Kategoria: vision
Renderowanie tekstu w obrazach
Generowanie obrazów zawierających czytelny, poprawnie pisany tekst — infografiki, plakaty, karty menu, kody QR, napisy w wybranym stylu graficznym. Kluczowa zdolność odróżniająca modele nowej generacji od wczesnych generatorów.
Kategoria: vision
Przestrzeganie instrukcji
Precyzyjne wypełnianie wskazówek zawartych w prompcie: format odpowiedzi, długość, styl, ograniczenia (np. 'odpowiedz w sześciu słowach'). GPT-5.1 znacząco poprawił tę zdolność względem GPT-5.
Kategoria: language

Cennik

Architektura techniczna

Rdzeń architektury (Core Architecture)

Wdrożenie i bezpieczeństwo

🔒 Security / Enterprise
✓ Zweryfikowane informacje enterprise

Od lutego 2024 obrazy zawierają metadane C2PA (uwierzytelnianie treści). Model stosuje filtry wejścia/wyjścia i blokuje generowanie w stylu żyjących artystów. Dostępny przez OpenAI API i Azure z kontrolami enterprise.

Aktualizacja: 24 lip 2026↗ Dokumentacja security