FOTOhub uruchamia IDA Q 1.0, pierwszy własny model generowania obrazu
FOTOhub uruchamia IDA Q 1.0 — pierwszy własny, proprietarny model generowania obrazu, trzeci rdzeń platformy obok Gabriel AI i IDA Voice & Audio. Top-5 na świecie w benchmarku DesignArena, 20x taniej niż GPT-Image-2, darmowy przez 7 dni.
FOTOhub uruchamia IDA Q 1.0, pierwszy własny model generowania obrazu
Kategoria: Product Launch / AI / Technology
Data: 24 lipca 2026
Autor: Mateusz Ulewicz, Founder & CTO
Tagi: IDA Q 1.0, proprietary AI model, generowanie obrazu, product launch, Gabriel AI, IDA Voice & Audio, AWS
Podsumowanie
FOTOhub.app uruchamia dziś IDA Q 1.0, pierwszy własny, w pełni proprietarny model generowania obrazu z tekstu, zbudowany i hostowany na infrastrukturze FOTOhub w partnerstwie z AWS. To trzeci rdzeń technologiczny platformy, obok Gabriel AI (orkiestrator rozumiejący intencję użytkownika) i IDA Voice & Audio (własny silnik głosu i muzyki). Model plasuje się w top 5 na świecie w benchmarku DesignArena, oferuje precyzyjne renderowanie tekstu na obrazach, natywną wielojęzyczność i ceny 20 razy niższe niż konkurencyjny GPT-Image-2. Przez najbliższe 7 dni od premiery każdy użytkownik FOTOhub, łącznie z planem darmowym, generuje obrazy IDA Q 1.0 bez żadnych kosztów.
Dlaczego to dzień, na który czekaliśmy
Dwa lata temu, kiedy zaczynałem budować FOTOhub, mieliśmy jedną strategię: zintegrować jak najwięcej najlepszych modeli AI na świecie w jednym miejscu, żeby użytkownik nie musiał wybierać między dziesiątkami platform. Ta strategia zadziałała, dziś mamy ponad 200 modeli od 10+ dostawców i 750 tysięcy użytkowników w 40+ krajach.
Ale integrator to nie to samo co twórca technologii. Gdzieś w tym procesie zadaliśmy sobie pytanie, które teraz definiuje kolejny etap FOTOhub: co się stanie, jeśli zaczniemy budować własne modele, dopasowane precyzyjnie do tego, jak nasi użytkownicy faktycznie tworzą?
Odpowiedzią jest rodzina modeli IDA, nasza własna linia technologii AI, hostowana na naszej infrastrukturze, rozwijana przez nasz zespół. IDA Voice & Audio już działa i obsługuje generowanie głosu, klonowanie mowy i muzykę dla tysięcy użytkowników. Dziś dołącza do niej IDA Q 1.0, model generowania obrazu, który stawia FOTOhub w gronie firm, które nie tylko integrują AI, ale ją tworzą.
"Nie chcemy być tylko najlepszym miejscem do korzystania z AI innych firm. Chcemy być firmą, która sama tworzy technologię, na której inni będą budować." Mateusz Ulewicz, Founder & CTO
Trzy rdzenie platformy
Z uruchomieniem IDA Q 1.0, architektura FOTOhub opiera się teraz na trzech własnych fundamentach, które razem tworzą coś więcej niż sumę części:
1. Gabriel AI, orkiestrator
Rozumie naturalny język użytkownika, decyduje który model i moduł najlepiej odpowiada na intencję, i wykonuje zadanie od początku do końca. To mózg systemu.
2. IDA Voice & Audio, głos i muzyka
Własny silnik text-to-speech, generowania muzyki i klonowania głosu. 50+ głosów, 30+ języków, pełny pipeline dubbingu. Zero zależności od zewnętrznych dostawców audio.
3. IDA Q 1.0, generowanie obrazu
Nowy trzeci fundament. Model tekst-do-obrazu zaprojektowany od zera z myślą o precyzji: dokładnym umieszczeniu tekstu, kontroli kompozycji i wsparciu dla wielu języków w jednym generowaniu.
Te trzy elementy nie działają w izolacji. Gabriel AI już teraz wie, kiedy skierować zapytanie użytkownika do IDA Q 1.0, kiedy do zewnętrznego modelu, a kiedy połączyć kilka silników w jedno zadanie. To jest różnica między "mamy dostęp do 200 modeli" i "mamy system, który myśli za Ciebie, jakiego modelu użyć".
Co właściwie robi IDA Q 1.0
IDA Q 1.0 to model generowania obrazu z tekstu, zoptymalizowany pod trzy rzeczy, które najczęściej psują wyniki innych generatorów: tekst na obrazie, kompozycję i wierność promptowi.
Precyzyjne renderowanie tekstu
Większość modeli generowania obrazu wciąż ma problem z czytelnym, poprawnym tekstem: literówki, zniekształcone litery, źle rozmieszczone nagłówki. IDA Q 1.0 traktuje tekst jako pełnoprawny element kompozycji, nie efekt dodatkowy. Nagłówki plakatów, etykiety produktów, cytaty w grafikach wychodzą czyste i czytelne, tak jak w naszym przykładzie z plakatem "FUTURE OF CREATION" w galerii poniżej.
Kontrola kompozycji przez strukturę
Model nie "zgaduje" gdzie ma się co znaleźć na obrazie. Zamiast tego rozkłada scenę na tło i osobne elementy, każdy z opisem, pozycją i relacją do innych, dokładnie tak jak projektant myśli o kompozycji plakatu czy zdjęcia. Efekt: mniej przypadkowych artefaktów, więcej kontroli nad finalnym kadrem.
Natywna wielojęzyczność
Tekst w promptcie i tekst na obrazie mogą być w różnych językach. Model poprawnie renderuje polskie znaki diakrytyczne (ą, ę, ń, ś, ź, ż) tak samo dobrze jak angielski alfabet. W naszym przykładzie z filiżanką kawy, odręczny napis "Dzień dobry" wyszedł bezbłędnie, litera po literze.
Silnik promptów FOTOhub, nasza własna warstwa inteligencji
To jest część, z której jesteśmy szczególnie zadowoleni, i którą zbudował nasz zespół specjalnie dla IDA Q 1.0. Zanim prompt użytkownika trafi do modelu, przechodzi przez nasz autorski silnik oparty na Claude Haiku poprzez AWS Bedrock, który:
- Tłumaczy automatycznie: piszesz po polsku, model dostaje precyzyjny angielski opis sceny, zachowując dosłownie cytowany tekst (np. napisy, nazwy marek) w oryginalnym języku.
- Rozbudowuje krótkie prompty: "kobieta z kwiatami na tle zachodu słońca" zamienia się w szczegółowy, ustrukturyzowany opis kompozycji, światła i detali, który model rozumie znacznie lepiej niż surowe trzy słowa.
- Zachowuje intencję użytkownika: nazwane marki, konkretne kolory, konkretne układy nie są zamieniane na coś generycznego. Silnik dopisuje szczegóły, nie zmienia tego, o co prosiłeś.
To nie jest kosmetyczna funkcja. To różnica między przeciętnym wynikiem i wynikiem, który faktycznie odzwierciedla to, co miałeś w głowie, bez konieczności nauki "prompt engineeringu".
Benchmarki: gdzie naprawdę stoimy
Nie lubimy PR-owych przesadzeń, więc podajemy liczby takie, jakie są. W niezależnym benchmarku DesignArena (Elo rating, mierzącym jakość generowania w kontekście realnych zadań projektowych), silnik bazowy IDA Q 1.0 plasuje się na piątym miejscu na świecie z wynikiem 1285 Elo, tuż pod czołówką rynku i wyraźnie przed szeregiem uznanych modeli:
| Model | Elo (DesignArena) |
| GPT Image 2 | 1405 |
| GPT-Image-1.5 | 1327 |
| Gemini 3.1 Flash Image Gen 2K | 1318 |
| Gemini 3.1 Flash Image Gen | 1310 |
| IDA Q 1.0 (silnik bazowy) | 1285 |
| Gemini 3 Pro Image Gen 2K (Nano) | 1284 |
| Gemini 3 Pro Image Preview | 1259 |
| UNI-1.1 | 1254 |
| Recraft V4.1 Utility Pro | 1245 |
| Krea 2 Medium | 1245 |
| FLUX.2 [flex] | 1244 |
| FLUX.2 [pro] | 1239 |
| Seedream Lite 5.0 | 1236 |
| Krea 2 Large | 1235 |
| Imagen 4 Ultra Generate Preview | 1233 |
Co to znaczy w praktyce? IDA Q 1.0 bije wyraźnie Recraft, obie wersje Krea 2, FLUX.2, Seedream Lite i Imagen 4 Ultra, modele, które są dziś standardem w wielu narzędziach projektowych. Nie jest jeszcze na poziomie Gemini Flash czy GPT-Image-2, i mówimy to otwarcie, bez naciągania liczb. Ale dla modelu, który dopiero wchodzi na rynek pod naszą marką, piąte miejsce na świecie w uznanym benchmarku to bardzo mocny start. Będziemy go rozwijać dalej, to jest dopiero pierwsza wersja.
Ceny i dostępność
| Parametr | Wartość |
| Cena po okresie darmowym | 0.5 kredytu / obraz |
| Cena GPT-Image-2 (porównanie) | 10 kredytów / obraz |
| Różnica | 20x taniej |
| Rozdzielczości | 1K (1024×1024), 1.5K (1536×1536), 2K (2048×2048) |
| Czas generowania | ~30s (1K) / ~90s (1.5K) / ~3.5 min (2K) |
| Okres darmowy | 7 dni od premiery (do 31 lipca 2026) |
| Dostępność | Wszystkie plany, łącznie z darmowym |
Dwadzieścia razy niższa cena nie jest przypadkiem, to bezpośredni efekt tego, że model działa na naszej własnej infrastrukturze GPU, bez opłat licencyjnych za każde zapytanie do zewnętrznego API. Kiedy budujesz własną technologię, przestajesz płacić cudzą marżę.
Galeria: co IDA Q 1.0 naprawdę umie
Poniższe obrazy zostały wygenerowane bezpośrednio przez IDA Q 1.0, bez ręcznej selekcji czy wielokrotnych prób. To pierwsze wyniki dla każdego z promptów, przepuszczone przez nasz silnik promptów opisany wyżej.
1. Portret w naturalnym świetle
Prompt: "Kobieta z bukietem polnych kwiatów, stojąca na tle złotego krajobrazu o zachodzie słońca, elegancka sukienka, delikatny wietrzyk we włosach, fotorealistyczne, ciepłe światło godziny magicznej"
!Kobieta z bukietem kwiatów w złotym świetle zachodu słońca
Naturalne światło golden hour, żywe kolory bukietu, realistyczna głębia ostrości tła, bez żadnej ręcznej korekty.
2. Nocna scena z neonami
Prompt: "Nowoczesne sportowe Porsche sfotografowane w ciemności, dramatyczne neonowe oświetlenie w odcieniach fioletu i cyjanu, mokra jezdnia odbijająca światła, miejska sceneria nocna, futurystyczny styl 2026, ultra szczegółowe"
!Sportowe Porsche na mokrej ulicy w nocnym neonowym oświetleniu
Odbicia świateł na mokrym asfalcie, głębia atmosfery, precyzyjne detale karoserii, dokładnie taki poziom, jakiego oczekuje się od kampanii produktowej.
3. Renderowanie tekstu: plakat
Prompt: "Minimalist modern poster design with bold typography, headline text FUTURE OF CREATION in large clean sans-serif letters, geometric abstract shapes in deep blue and orange gradient background, professional graphic design, high contrast"
!Minimalistyczny plakat z napisem FUTURE OF CREATION
Zero literówek, zero zniekształconych liter. To jest właśnie ten obszar, w którym IDA Q 1.0 był budowany, żeby wygrywać.
4. Wnętrze architektoniczne
Prompt: "Luksusowe minimalistyczne wnętrze salonu z dużymi oknami, naturalne światło dzienne, drewniane akcenty, betonowe ściany, designerskie meble skandynawskie, wysokie sufity, architektura nowoczesna, fotorealistyczne wnętrze"
!Minimalistyczny salon z betonowymi ścianami i dużymi oknami
Realistyczna perspektywa, prawidłowe proporcje mebli, naturalne padanie światła przez okna, gotowe do użycia w prezentacji nieruchomości czy portfolio architekta.
5. Świat fantasy
Prompt: "Fantastyczne miasto pływające wśród obłoków, kryształowe wieże połyskujące w świetle zachodzącego słońca, latające statki między budynkami, styl epicki fantasy, bogata kolorystyka, malarska iluzja głębi"
!Fantastyczne kryształowe miasto pływające wśród obłoków
Poza fotorealizmem, model równie dobrze radzi sobie z czystą kreacją, głębia sceny i światło robią tu największą różnicę.
6. Polski tekst na obrazie
Prompt: "Filiżanka gorącej kawy na drewnianym stole w kawiarni, obok kartka papieru z odręcznym napisem Dzień dobry, poranne światło wpadające przez okno, ciepła atmosfera, fotorealistyczne"
!Filiżanka kawy z kartką z napisem Dzień dobry
Polskie znaki diakrytyczne, "ń" w słowie "Dzień", wyrenderowane poprawnie, bez zniekształceń. Dla platformy z polskim rodowodem to szczegół, na którym nam szczególnie zależało.
Współpraca z AWS wchodzi na nowy poziom
Amazon Web Services jest naszym inwestorem i strategicznym partnerem od Q2 2026, najpierw jako część rundy finansowania, potem jako AWS Portfolio Company z dostępem do wsparcia architektonicznego i najnowszych technologii cloudowych. Do teraz ta współpraca oznaczała głównie integrację modeli AWS (Bedrock, Nova) w naszym katalogu i infrastrukturę dla naszych 12 modułów.
IDA Q 1.0 to naturalny, kolejny krok tej relacji: pierwszy własny model FOTOhub, który od pierwszego dnia działa na infrastrukturze GPU AWS, a jego silnik promptów korzysta z Claude poprzez AWS Bedrock. To pokazuje, dokąd zmierza nasza współpraca z AWS: z fazy "integrujemy wasze modele" do fazy "budujemy własną technologię AI na waszej infrastrukturze, od pierwszej linii kodu". Dla firmy takiej jak FOTOhub, budowanie własnych modeli bez pewności co do skalowalności infrastruktury byłoby ryzykowne. Partnerstwo z AWS usuwa to ryzyko.
Co dalej
IDA Q 1.0 to pierwsza wersja, nie ostatnia. W najbliższych miesiącach pracujemy nad zwiększeniem rozdzielczości maksymalnej, rozszerzeniem wsparcia dla edycji obrazów (nie tylko generowania od zera) i głębszą integracją z Gabriel AI, żeby orkiestrator mógł automatycznie decydować, kiedy IDA Q 1.0 jest najlepszym wyborem dla danego zadania, a kiedy lepiej sięgnąć po jeden z 200+ zintegrowanych modeli.
Rodzina IDA, Voice & Audio, teraz Q 1.0, to fundament, na którym będziemy budować kolejne własne modele. To jest strategia, nie jednorazowy projekt: FOTOhub przechodzi z firmy, która najlepiej integruje AI innych, w firmę, która sama tworzy technologię.
IDA Q 1.0 jest dostępny od dziś dla wszystkich użytkowników FOTOhub, w tym na planie darmowym, i darmowy przez najbliższe 7 dni. Zaloguj się na fotohub.app, wybierz IDA Q 1.0 w generatorze obrazów i przekonaj się sam.
Budujemy własną technologię. I dzielimy się nią z każdym, kto tworzy.
Mateusz Ulewicz
Founder & CTO, FOTOhub
Top 5 / 2.1M w głównej kategorii Crunchbase
FOTOhub, Creative AI OS
fotohub.app | [email protected]
Crunchbase: crunchbase.com/organization/fotohub
Investor Relations: fotohub.app/investors
FOTOhub, 750K+ Users | $8.6M Raised | $180M Valuation | AWS Portfolio Company