ChatGPT Images 1.5: Acesta este marele salt al OpenAI în materie de imagini

  • ChatGPT Images lansează modelul GPT Image 1.5, de până la patru ori mai rapid și cu o urmărire mai bună a instrucțiunilor.
  • Noul instrument permite editări precise ale fotografiilor încărcate, menținând iluminarea, compoziția și trăsăturile faciale.
  • Îmbunătățire notabilă în generarea de text în imagini și în scene complexe cu multe fețe sau detalii mici.
  • OpenAI lansează propria secțiune Imagini în ChatGPT, disponibilă acum pentru majoritatea utilizatorilor prin intermediul API-ului.

Imagini ChatGPT

Generarea de imagini bazată pe inteligență artificială a devenit una dintre cele mai vizibile demonstrații ale cursei dintre giganții tehnologici. OpenAI a decis să facă o mișcare cu o actualizare profundă a Imagini ChatGPT, sistemul său integrat de creație vizuală, într-un context în care modele precum Nano Banana Pro de la Google dominau o mare parte a conversației.

Odată cu această lansare, compania din spatele ChatGPT dorește ca instrumentul său să depășească statutul de simplu add-on pentru chat și să funcționeze ca o funcție completă. un studio de creație integrat autentic, mai rapid, mai precis și cu o interfață concepută de la zero pentru a lucra cu imagini în loc să se limiteze la text.

Noul model GPT Image 1.5: viteza și precizia ca semne distinctive

Inima actualizării este Imagine GPT 1.5Noul model emblematic al OpenAI pentru imagini. Compania susține că poate genera conținut vizual de până la de patru ori mai repede decât versiunea anterioară, lucru care în practică este deosebit de vizibil în orele de vârf și pe dispozitivele mobile, unde înainte nu era neobișnuit ca procesul să fie întrerupt sau să dureze o veșnicie la schimbarea aplicațiilor.

Pe lângă performanță, îmbunătățirea cheie constă în urmărirea instrucțiunilor. Sistemul interpretează instrucțiunile mai precis. solicitări complexe și relații spațiale preciseastfel încât solicitări precum schimbarea unui singur obiect, ajustarea iluminatului sau modificarea îmbrăcămintei unei persoane să nu mai provoace schimbări neașteptate în restul scenei.

OpenAI explică faptul că GPT Image 1.5 a fost antrenat să mențină constante elementele cruciale ale imaginii, cum ar fi identitatea facială, compoziția generală sau paleta de culorichiar și după mai multe runde de editare în lanț. Acest aspect este relevant în special pentru utilizarea profesională, unde consecvența vizuală nu este un capriciu, ci o cerință.

Editare spot și lanț: schimbați doar ceea ce contează

Unul dintre domeniile în care modelele anterioare au eșuat a fost editare țintită a unor zone specificeSchimbarea unei pălării, ajustarea luminii sau adăugarea unui element în fundal ar putea duce la remixarea întregii scene. Noile imagini ChatGPT abordează direct această problemă.

Modelul este capabil de adăugarea, eliminarea, combinarea, amestecarea și transpunerea elementelor în cadrul aceleiași imagini, păstrând în același timp stabile toate celelalte componente importante. În practică, aceasta înseamnă posibilitatea de a solicita acțiuni precum: schimbarea culorii unei cămăși, modificarea unei pălării, ajustarea unui indicator rutier sau transformarea unui camion într-o mașină de pompieri fără a distorsiona restul mediului.

Comportamentul în timpul apelurilor telefonice a fost, de asemenea, consolidat ediții în lanțPână acum, o a treia sau a patra modificare determina, de obicei, modelul să „reinventeze” complet imaginea. Cu GPT Image 1.5, instrumentul păstrează mult mai fiabil stilul, poza și scena, astfel încât puteți itera pe aceeași bază fără a fi nevoie să începeți de la zero cu fiecare modificare.

Transformări creative: de la selfie la poster de film

Dincolo de precizia sa tehnică, OpenAI împinge ChatGPT Images într-un teritoriu distinct creativ. Sistemul permite utilizatorilor să încarce propria fotografie și, cu o solicitare relativ simplă, să obțină imaginea în câteva secunde. versiuni transformate credibileDe la o reclamă din anii '90 la o scenă din Times Square în mijlocul iernii sau un oraș japonez cu o estetică cyberpunk.

Modelul este, de asemenea, capabil să recreeze stiluri artistice specifice, cum ar fi postere de filme clasice, ilustrații în stil anime sau compoziții cu aspect istoric, respectând trăsăturile cheie ale persoanei originale. Ideea este că utilizatorul se poate „vedea” în contexte foarte diferite, fără a pierde sentimentul că este vorba de aceeași persoană.

Această abordare amintește de ceea ce ofereau deja modele precum Nano Banana, dar OpenAI încearcă să se diferențieze mizând pe transformări conceptuale mai controlateunde sistemul menține esența fotografiei de bază schimbând în același timp hainele, mediul, iluminatul sau epoca cu o coerență vizuală considerabilă.

ChatGPT Images își ia adio stilului gălbui și îmbunătățește scenele complexe

Multă vreme, a fost relativ ușor să identifici dacă o imagine fusese creată cu versiuni timpurii de ChatGPT: acestea predominau tonuri calde, finisaje cremoase și o anumită nuanță gălbuie care i-a relevat originea artificială. Comparații interne demonstrate de OpenAI și teste independente, comparativ cu alternative precum Bing Image CreatorSe pare că acea trăsătură a fost lăsată în urmă.

Noul model oferă o spectru de culori mai neutru și mai variatAcest lucru face ca imaginile să arate mai mult ca fotografiile convenționale, cu excepția cazului în care utilizatorul solicită în mod explicit altfel în prompt. Acest lucru ajută imaginile să pară mai puțin „marcate” și mai utile în contexte în care se dorește realism sau integrare cu materialul fotografic existent.

De asemenea, s-au adus îmbunătățiri reprezentării scene cu multe elemente micicum ar fi mulțimi sau fundaluri bogate în detalii. Fețele din grupuri mari sunt acum mai distincte unele de altele, cu poziții și expresii mai naturale, iar defectele tipice, cum ar fi amprentele de mâini, liniile minuscule sau repetițiile ciudate, sunt reduse.

ChatGPT Images vă permite să inserați text în imagini: săriți peste postere, infografice și machete

Generarea de text lizibil în cadrul unei imagini a fost dintotdeauna unul dintre punctele slabe ale inteligenței artificiale generative. OpenAI susține că GPT Image 1.5 face un pas semnificativ înainte în acest domeniu, cu un... randare tipografică mult mai consistentă decât în ​​versiunile anterioare.

Modelul poate gestiona blocuri de text mici și denseAcest lucru deschide calea către crearea de postere, infografice, machete de pagini de ziar sau designuri cu tabele și formate de tip markdown, cu un nivel de lizibilitate care, deși nu este perfect, este mai aproape de ceva utilizabil fără retușuri intensive.

Pentru cei care lucrează în marketing, educație, comerț electronic sau conținut digital, această îmbunătățire înseamnă reducerea timpului petrecut cu corectează literele deformate sau cuvintele incompleteÎn contextele în care există nevoia de a produce materiale vizuale cu mesaje clare, gata de publicare, faptul că modelul în sine generează un text relativ curat devine un factor de diferențiere.

O nouă experiență pentru utilizator: o secțiune dedicată Imagini în ChatGPT

Actualizarea nu se oprește la model; aceasta afectează și modul în care este utilizat. OpenAI a adăugat o nouă funcție în bara laterală ChatGPT. o secțiune specifică numită „Imagini”Acest lucru este valabil atât pentru aplicația mobilă, cât și pentru versiunea web. Scopul este de a separa experiența vizuală de chatul tradițional și de a facilita navigarea pentru cei care nu doresc să se confrunte cu solicitări complexe.

Din acest nou spațiu, utilizatorul găsește stiluri predefinite, sugestii de tendințe și șabloane Pentru sarcini frecvente, cum ar fi crearea de felicitări, restaurarea fotografiilor vechi, comutarea între diferite stiluri artistice sau generarea de variații ale aceluiași produs, această abordare reduce bariera de acces pentru persoanele fără experiență tehnică.

Un alt aspect practic este faptul că secțiunea Imagini acționează ca depozit centralizat a tuturor creațiilor vizuale ale utilizatorului. De acolo este mai ușor să revizuiești versiunile anterioare, să repeți un stil cu conținut nou sau să continui editarea unei imagini deja generate, lucru util în special în fluxurile de lucru continue.

De la accesoriu atrăgător la instrument de lucru vizual

OpenAI însuși recunoaște că, până acum, generarea de imagini în cadrul ChatGPT funcționa mai mult ca un extrem de atrăgător într-o interfață concepută pentru text care servește drept mediu de lucru vizual solid. Prin această actualizare, compania își propune să facă un salt calitativ: trecerea de la imagini „de test” pentru rețelele sociale la un instrument utilizabil în procesele din lumea reală.

Îmbunătățirea consecvenței și iterației are un impact direct asupra unor sectoare precum design, marketing, comerț electronic sau brandingCompaniile care trebuie să adapteze același concept creativ la mai multe formate, să testeze variante ale unui produs sau să mențină consecvența logo-urilor și a elementelor corporative pe sute de elemente găsesc un avantaj clar în acest tip de control.

Platforme creative care operează în Europa, cum ar fi editorii web și instrumentele de design bazate pe cloudDeja integrează aceste modele în fluxurile lor de lucru. În acest domeniu, angajamentul OpenAI față de un mediu vizual mai cuprinzător poate fi potrivit atât pentru IMM-urile care doresc să accelereze producția de materiale grafice, cât și pentru echipele de comunicare internă din cadrul marilor corporații.

Disponibilitatea imaginilor ChatGPT pentru utilizatori, companii și dezvoltatori

OpenAI a început să implementeze noile imagini ChatGPT pentru majoritatea utilizatorilor platformei, inclusiv cei cu conturi gratuiteMulți utilizatori văd deja o notificare atunci când deschid aplicația, care îi invită să încerce funcția de imagine, precum și o nouă filă dedicată în meniul lateral pentru centralizarea utilizării acesteia.

În sectorul afacerilor, compania a confirmat că accesul avansat pentru conturile Business și Enterprise va fi implementat treptat, cu accent pe integrările din cadrul... fluxuri de lucru profesionalePentru organizațiile europene care utilizează deja ChatGPT pentru sarcini interne, aceasta înseamnă posibilitatea de a extinde utilizarea sa de la text la materiale grafice generate sub aceleași acreditări.

În paralel, GPT Image 1.5 este disponibilă prin intermediul OpenAI APIAcest lucru permite dezvoltatorilor să integreze capacități de generare și editare a imaginilor în propriile aplicații. Compania afirmă că costul introducerii și ieșirii imaginilor este cu aproximativ 20% mai mic decât la modelul anterior, un avantaj semnificativ pentru proiectele sau serviciile de amploare care operează cu marje mici.

Concurență cu Nano Banana Pro și alte modele vizuale

Mișcarea OpenAI vine într-un moment de presiune concurențială intensă. Google a făcut presiuni... Nano Banană Pro ca unul dintre principalele modele generative vizuale, integrat în ecosistemul său de instrumente creative și legat de al său Familia Gemenilor, ceea ce a stimulat utilizarea sa la nivel global.

Această situație a dus la stabilirea [neclar] în cadrul unor servicii concurente. limite stricte pentru utilizatorii gratuițiDe exemplu, prin reducerea numărului de imagini care pot fi generate pe zi, parțial din cauza cererii mari. În schimb, OpenAI pare să parieze pe o combinație între o acoperire largă, o viteză mai mare și un mediu de editare mai rafinat pentru a păstra și a atrage utilizatori.

Între timp, alți jucători precum xAI cu chatbot-ul său Grok sau diverși specialiști în imagine insistă asupra... generația vizuală devine un front central în lupta pentru atenția utilizatorilor. Strategia OpenAI implică consolidarea ChatGPT ca o „aplicație all-in-one”, unde căutarea, vocea, textul, imaginile și videoclipurile coexistă într-un singur punct de intrare.

Cu aceste noi imagini ChatGPT, OpenAI face un pas important către... instrument vizual mai maturUn model mai rapid și mai precis, o interfață diferențiată și capacități de editare orientate în mod clar către munca din lumea reală, atât în ​​contexte personale, cât și profesionale. Rămâne de văzut în ce măsură aceste îmbunătățiri vor fi integrate în viața de zi cu zi a utilizatorilor și a companiilor din Spania și Europa, dar mesajul este clar: imaginea nu mai este doar un plus distractiv la chat, ci a devenit o componentă centrală a ecosistemului ChatGPT.

ChatGPT creează imagini
Articol asociat:
ChatGPT generează acum imagini cu GPT-4o: tot ce trebuie să știți

Adăugați ca sursă preferată în Google