FOTOhub uruchamia IDA Q 1.0, pierwszy własny model generowania obrazu

Mateusz Ulewicz, Founder & CTO · · 9 min read

FOTOhub uruchamia IDA Q 1.0 — pierwszy własny, proprietarny model generowania obrazu, trzeci rdzeń platformy obok Gabriel AI i IDA Voice & Audio. Top-5 na świecie w benchmarku DesignArena, 20x taniej niż GPT-Image-2, darmowy przez 7 dni.

FOTOhub uruchamia IDA Q 1.0, pierwszy własny model generowania obrazu

FOTOhub uruchamia IDA Q 1.0, pierwszy własny model generowania obrazu

Kategoria: Product Launch / AI / Technology

Data: 24 lipca 2026

Autor: Mateusz Ulewicz, Founder & CTO

Tagi: IDA Q 1.0, proprietary AI model, generowanie obrazu, product launch, Gabriel AI, IDA Voice & Audio, AWS

Podsumowanie

FOTOhub.app uruchamia dziś IDA Q 1.0, pierwszy własny, w pełni proprietarny model generowania obrazu z tekstu, zbudowany i hostowany na infrastrukturze FOTOhub w partnerstwie z AWS. To trzeci rdzeń technologiczny platformy, obok Gabriel AI (orkiestrator rozumiejący intencję użytkownika) i IDA Voice & Audio (własny silnik głosu i muzyki). Model plasuje się w top 5 na świecie w benchmarku DesignArena, oferuje precyzyjne renderowanie tekstu na obrazach, natywną wielojęzyczność i ceny 20 razy niższe niż konkurencyjny GPT-Image-2. Przez najbliższe 7 dni od premiery każdy użytkownik FOTOhub, łącznie z planem darmowym, generuje obrazy IDA Q 1.0 bez żadnych kosztów.

Dlaczego to dzień, na który czekaliśmy

Dwa lata temu, kiedy zaczynałem budować FOTOhub, mieliśmy jedną strategię: zintegrować jak najwięcej najlepszych modeli AI na świecie w jednym miejscu, żeby użytkownik nie musiał wybierać między dziesiątkami platform. Ta strategia zadziałała, dziś mamy ponad 200 modeli od 10+ dostawców i 750 tysięcy użytkowników w 40+ krajach.

Ale integrator to nie to samo co twórca technologii. Gdzieś w tym procesie zadaliśmy sobie pytanie, które teraz definiuje kolejny etap FOTOhub: co się stanie, jeśli zaczniemy budować własne modele, dopasowane precyzyjnie do tego, jak nasi użytkownicy faktycznie tworzą?

Odpowiedzią jest rodzina modeli IDA, nasza własna linia technologii AI, hostowana na naszej infrastrukturze, rozwijana przez nasz zespół. IDA Voice & Audio już działa i obsługuje generowanie głosu, klonowanie mowy i muzykę dla tysięcy użytkowników. Dziś dołącza do niej IDA Q 1.0, model generowania obrazu, który stawia FOTOhub w gronie firm, które nie tylko integrują AI, ale ją tworzą.

"Nie chcemy być tylko najlepszym miejscem do korzystania z AI innych firm. Chcemy być firmą, która sama tworzy technologię, na której inni będą budować." Mateusz Ulewicz, Founder & CTO

Trzy rdzenie platformy

Z uruchomieniem IDA Q 1.0, architektura FOTOhub opiera się teraz na trzech własnych fundamentach, które razem tworzą coś więcej niż sumę części:

1. Gabriel AI, orkiestrator

Rozumie naturalny język użytkownika, decyduje który model i moduł najlepiej odpowiada na intencję, i wykonuje zadanie od początku do końca. To mózg systemu.

2. IDA Voice & Audio, głos i muzyka

Własny silnik text-to-speech, generowania muzyki i klonowania głosu. 50+ głosów, 30+ języków, pełny pipeline dubbingu. Zero zależności od zewnętrznych dostawców audio.

3. IDA Q 1.0, generowanie obrazu

Nowy trzeci fundament. Model tekst-do-obrazu zaprojektowany od zera z myślą o precyzji: dokładnym umieszczeniu tekstu, kontroli kompozycji i wsparciu dla wielu języków w jednym generowaniu.

Te trzy elementy nie działają w izolacji. Gabriel AI już teraz wie, kiedy skierować zapytanie użytkownika do IDA Q 1.0, kiedy do zewnętrznego modelu, a kiedy połączyć kilka silników w jedno zadanie. To jest różnica między "mamy dostęp do 200 modeli" i "mamy system, który myśli za Ciebie, jakiego modelu użyć".

Co właściwie robi IDA Q 1.0

IDA Q 1.0 to model generowania obrazu z tekstu, zoptymalizowany pod trzy rzeczy, które najczęściej psują wyniki innych generatorów: tekst na obrazie, kompozycję i wierność promptowi.

Precyzyjne renderowanie tekstu

Większość modeli generowania obrazu wciąż ma problem z czytelnym, poprawnym tekstem: literówki, zniekształcone litery, źle rozmieszczone nagłówki. IDA Q 1.0 traktuje tekst jako pełnoprawny element kompozycji, nie efekt dodatkowy. Nagłówki plakatów, etykiety produktów, cytaty w grafikach wychodzą czyste i czytelne, tak jak w naszym przykładzie z plakatem "FUTURE OF CREATION" w galerii poniżej.

Kontrola kompozycji przez strukturę

Model nie "zgaduje" gdzie ma się co znaleźć na obrazie. Zamiast tego rozkłada scenę na tło i osobne elementy, każdy z opisem, pozycją i relacją do innych, dokładnie tak jak projektant myśli o kompozycji plakatu czy zdjęcia. Efekt: mniej przypadkowych artefaktów, więcej kontroli nad finalnym kadrem.

Natywna wielojęzyczność

Tekst w promptcie i tekst na obrazie mogą być w różnych językach. Model poprawnie renderuje polskie znaki diakrytyczne (ą, ę, ń, ś, ź, ż) tak samo dobrze jak angielski alfabet. W naszym przykładzie z filiżanką kawy, odręczny napis "Dzień dobry" wyszedł bezbłędnie, litera po literze.

Silnik promptów FOTOhub, nasza własna warstwa inteligencji

To jest część, z której jesteśmy szczególnie zadowoleni, i którą zbudował nasz zespół specjalnie dla IDA Q 1.0. Zanim prompt użytkownika trafi do modelu, przechodzi przez nasz autorski silnik oparty na Claude Haiku poprzez AWS Bedrock, który:

To nie jest kosmetyczna funkcja. To różnica między przeciętnym wynikiem i wynikiem, który faktycznie odzwierciedla to, co miałeś w głowie, bez konieczności nauki "prompt engineeringu".

Benchmarki: gdzie naprawdę stoimy

Nie lubimy PR-owych przesadzeń, więc podajemy liczby takie, jakie są. W niezależnym benchmarku DesignArena (Elo rating, mierzącym jakość generowania w kontekście realnych zadań projektowych), silnik bazowy IDA Q 1.0 plasuje się na piątym miejscu na świecie z wynikiem 1285 Elo, tuż pod czołówką rynku i wyraźnie przed szeregiem uznanych modeli:

ModelElo (DesignArena)
GPT Image 21405
GPT-Image-1.51327
Gemini 3.1 Flash Image Gen 2K1318
Gemini 3.1 Flash Image Gen1310
IDA Q 1.0 (silnik bazowy)1285
Gemini 3 Pro Image Gen 2K (Nano)1284
Gemini 3 Pro Image Preview1259
UNI-1.11254
Recraft V4.1 Utility Pro1245
Krea 2 Medium1245
FLUX.2 [flex]1244
FLUX.2 [pro]1239
Seedream Lite 5.01236
Krea 2 Large1235
Imagen 4 Ultra Generate Preview1233

Co to znaczy w praktyce? IDA Q 1.0 bije wyraźnie Recraft, obie wersje Krea 2, FLUX.2, Seedream Lite i Imagen 4 Ultra, modele, które są dziś standardem w wielu narzędziach projektowych. Nie jest jeszcze na poziomie Gemini Flash czy GPT-Image-2, i mówimy to otwarcie, bez naciągania liczb. Ale dla modelu, który dopiero wchodzi na rynek pod naszą marką, piąte miejsce na świecie w uznanym benchmarku to bardzo mocny start. Będziemy go rozwijać dalej, to jest dopiero pierwsza wersja.

Ceny i dostępność

ParametrWartość
Cena po okresie darmowym0.5 kredytu / obraz
Cena GPT-Image-2 (porównanie)10 kredytów / obraz
Różnica20x taniej
Rozdzielczości1K (1024×1024), 1.5K (1536×1536), 2K (2048×2048)
Czas generowania~30s (1K) / ~90s (1.5K) / ~3.5 min (2K)
Okres darmowy7 dni od premiery (do 31 lipca 2026)
DostępnośćWszystkie plany, łącznie z darmowym

Dwadzieścia razy niższa cena nie jest przypadkiem, to bezpośredni efekt tego, że model działa na naszej własnej infrastrukturze GPU, bez opłat licencyjnych za każde zapytanie do zewnętrznego API. Kiedy budujesz własną technologię, przestajesz płacić cudzą marżę.

Galeria: co IDA Q 1.0 naprawdę umie

Poniższe obrazy zostały wygenerowane bezpośrednio przez IDA Q 1.0, bez ręcznej selekcji czy wielokrotnych prób. To pierwsze wyniki dla każdego z promptów, przepuszczone przez nasz silnik promptów opisany wyżej.

1. Portret w naturalnym świetle

Prompt: "Kobieta z bukietem polnych kwiatów, stojąca na tle złotego krajobrazu o zachodzie słońca, elegancka sukienka, delikatny wietrzyk we włosach, fotorealistyczne, ciepłe światło godziny magicznej"

!Kobieta z bukietem kwiatów w złotym świetle zachodu słońca

Naturalne światło golden hour, żywe kolory bukietu, realistyczna głębia ostrości tła, bez żadnej ręcznej korekty.

2. Nocna scena z neonami

Prompt: "Nowoczesne sportowe Porsche sfotografowane w ciemności, dramatyczne neonowe oświetlenie w odcieniach fioletu i cyjanu, mokra jezdnia odbijająca światła, miejska sceneria nocna, futurystyczny styl 2026, ultra szczegółowe"

!Sportowe Porsche na mokrej ulicy w nocnym neonowym oświetleniu

Odbicia świateł na mokrym asfalcie, głębia atmosfery, precyzyjne detale karoserii, dokładnie taki poziom, jakiego oczekuje się od kampanii produktowej.

3. Renderowanie tekstu: plakat

Prompt: "Minimalist modern poster design with bold typography, headline text FUTURE OF CREATION in large clean sans-serif letters, geometric abstract shapes in deep blue and orange gradient background, professional graphic design, high contrast"

!Minimalistyczny plakat z napisem FUTURE OF CREATION

Zero literówek, zero zniekształconych liter. To jest właśnie ten obszar, w którym IDA Q 1.0 był budowany, żeby wygrywać.

4. Wnętrze architektoniczne

Prompt: "Luksusowe minimalistyczne wnętrze salonu z dużymi oknami, naturalne światło dzienne, drewniane akcenty, betonowe ściany, designerskie meble skandynawskie, wysokie sufity, architektura nowoczesna, fotorealistyczne wnętrze"

!Minimalistyczny salon z betonowymi ścianami i dużymi oknami

Realistyczna perspektywa, prawidłowe proporcje mebli, naturalne padanie światła przez okna, gotowe do użycia w prezentacji nieruchomości czy portfolio architekta.

5. Świat fantasy

Prompt: "Fantastyczne miasto pływające wśród obłoków, kryształowe wieże połyskujące w świetle zachodzącego słońca, latające statki między budynkami, styl epicki fantasy, bogata kolorystyka, malarska iluzja głębi"

!Fantastyczne kryształowe miasto pływające wśród obłoków

Poza fotorealizmem, model równie dobrze radzi sobie z czystą kreacją, głębia sceny i światło robią tu największą różnicę.

6. Polski tekst na obrazie

Prompt: "Filiżanka gorącej kawy na drewnianym stole w kawiarni, obok kartka papieru z odręcznym napisem Dzień dobry, poranne światło wpadające przez okno, ciepła atmosfera, fotorealistyczne"

!Filiżanka kawy z kartką z napisem Dzień dobry

Polskie znaki diakrytyczne, "ń" w słowie "Dzień", wyrenderowane poprawnie, bez zniekształceń. Dla platformy z polskim rodowodem to szczegół, na którym nam szczególnie zależało.

Współpraca z AWS wchodzi na nowy poziom

Amazon Web Services jest naszym inwestorem i strategicznym partnerem od Q2 2026, najpierw jako część rundy finansowania, potem jako AWS Portfolio Company z dostępem do wsparcia architektonicznego i najnowszych technologii cloudowych. Do teraz ta współpraca oznaczała głównie integrację modeli AWS (Bedrock, Nova) w naszym katalogu i infrastrukturę dla naszych 12 modułów.

IDA Q 1.0 to naturalny, kolejny krok tej relacji: pierwszy własny model FOTOhub, który od pierwszego dnia działa na infrastrukturze GPU AWS, a jego silnik promptów korzysta z Claude poprzez AWS Bedrock. To pokazuje, dokąd zmierza nasza współpraca z AWS: z fazy "integrujemy wasze modele" do fazy "budujemy własną technologię AI na waszej infrastrukturze, od pierwszej linii kodu". Dla firmy takiej jak FOTOhub, budowanie własnych modeli bez pewności co do skalowalności infrastruktury byłoby ryzykowne. Partnerstwo z AWS usuwa to ryzyko.

Co dalej

IDA Q 1.0 to pierwsza wersja, nie ostatnia. W najbliższych miesiącach pracujemy nad zwiększeniem rozdzielczości maksymalnej, rozszerzeniem wsparcia dla edycji obrazów (nie tylko generowania od zera) i głębszą integracją z Gabriel AI, żeby orkiestrator mógł automatycznie decydować, kiedy IDA Q 1.0 jest najlepszym wyborem dla danego zadania, a kiedy lepiej sięgnąć po jeden z 200+ zintegrowanych modeli.

Rodzina IDA, Voice & Audio, teraz Q 1.0, to fundament, na którym będziemy budować kolejne własne modele. To jest strategia, nie jednorazowy projekt: FOTOhub przechodzi z firmy, która najlepiej integruje AI innych, w firmę, która sama tworzy technologię.

IDA Q 1.0 jest dostępny od dziś dla wszystkich użytkowników FOTOhub, w tym na planie darmowym, i darmowy przez najbliższe 7 dni. Zaloguj się na fotohub.app, wybierz IDA Q 1.0 w generatorze obrazów i przekonaj się sam.

Budujemy własną technologię. I dzielimy się nią z każdym, kto tworzy.

Mateusz Ulewicz

Founder & CTO, FOTOhub

Top 5 / 2.1M w głównej kategorii Crunchbase

FOTOhub, Creative AI OS

fotohub.app | [email protected]

Crunchbase: crunchbase.com/organization/fotohub

Investor Relations: fotohub.app/investors

FOTOhub, 750K+ Users | $8.6M Raised | $180M Valuation | AWS Portfolio Company