Just now, OpenAI released GPT-Images-2.5:
Oluşturma gecikmesi en az yarıya iniyor, düzenleme doğruluğu artırılıyor, Sketch el yazısı girişi özelliği ekleniyor ve API tarafında ilk kez hızlı ve yavaş olmak üzere iki model ayrılıyor.

https://x.com/OpenAI/status/2097394956457623964
Tüm ChatGPT, ChatGPT Work ve Codex kullanıcıları için açıktır, ücretsiz sürüm de dahil.
Bu sayıya göre, günlük yaklaşık 430 milyon resim bu sistemden geçiyor ve üretimin hızlanma hissi, genel fonksiyon güncellemelerini çok aşan bir kapsama alanına sahip.
OpenAI, ChatGPT Images ve GPT-Image API'nin toplam üretimi olarak haftada 3 milyar görüntü açıkladı.
Demo etkileyici: Çince karışıksız metin artık yok
GPT-Image-2.5 gerçekten ne kadar güçlü? Doğrudan demo'ya bakalım.
Çince karalama kaybolmuştur!

Bu referans resmidir:

Bu, geri dönük resim çıktısıdır:

Gerçek fotoğrafları ve AI tarafından oluşturulan resimleri ayırt edebiliyor musunuz?
Eski fotoğrafları yazdırmak, çıkarmak ve yüksek çözünürlüklü dijital fotoğraflara dönüştürmek kolay bir iş.

Giyim etkisini denemek istiyor musunuz? Bunun için doğrudan ChatGPT'ye bırakın:
Giriş yap

Çarşambaları Kazanın Hafta XXX

Orijinal resmi girin, çarşaf düzensiz:

Yatak örtüsü düzgün katlanmış halde gösterilmiştir:

Sahne tutarlılığı çok yüksek, hata görünmüyor.
Yarısı kadar hızlı, düzeltilmiş ve karışık değil
En doğrudan hız artışı. OpenAI'nin verdiği sayıya göre, gecikme, Images 2.0'a göre en fazla %50 azalıyor.
Işık ve doku render kalitesi aynı anda iyileştirildi ve fotoğraftaki ana figürün geri dönüşümü daha yüksek.
Precise Editing, resim üretme aracının eski bir sorununa odaklanır: kullanıcı yerel değişiklik istediğinde, model hareketsiz bırakılması gereken kısımları da değiştirir.
OpenAI'ye göre, Images 2.5, belirli bölgeleri değiştirebilirken görüntünün geri kalan öğelerinin kompozisyonunu, aydınlatmasını ve ana nesne özelliklerini korur; karmaşık arka planlar ve çoklu nesne sahnelerinde istikrar belirgin şekilde artar.
Kullanıcılar aynı zamanda resim üzerinde doğrudan yorum ekleyebilir ve düzeltme gerektiren bölgeleri işaretleyebilir; işlem mantığı Figma tasarım aracına benzer.

Üçüncü iyileştirme, çoklu düzenlemelerin tutarlılığıdır.
Uzun bir diyalogda aynı resmi tekrar tekrar düzenlerken, ilk birkaç turun düzenlemeleri korunur ve kalite tur sayısıyla düşmez.

Higgsfield AI ürün sorumlusu Axultan Alimkulov, Flare hakkında şunu söylüyor:
En çok bizi etkileyen, “ne değiştirilmemeli” konusundaki anlayışıydı.
Orijinal görselin karakterini, kompozisyonunu ve görsel stilini kaybetmeden anlamlı bir düzenleme yapın.

Sketch ve Şablonlar: Yazmaktan Çizmeye
Ürün düzeyinde, Images 2.5 dört yeni özellik getiriyor.
Sketch'e erişmek için ChatGPT sohbet penceresine @Sketch yazın ve çizim panelini açın. Kullanıcı bir kroki çizer, tarz ve detaylar için metin açıklaması ekler; ChatGPT, krokiyi kompozisyon referansı olarak kullanarak tamamlanmış bir görüntü oluşturur.
OpenAI'nin örnekleri, odanın plan çizimlerini iç mekan tasarım renderlarına, figür siluetlerini illüstrasyonlara dönüştürmeyi içerir. Sınır, çizim becerisinde değil, uzaysal ilişkileri ve yaklaşık oranları çizerek modelin görsel yapıyı anlamasında yer alır.
Şablonlar, afiş, ürün görseli, broşür gibi sık kullanılan formatları kapsar.
Bir şablon seçin, bilgileri ve stil tercihlerini girin, model önceden belirlenmiş yapıya göre görsel oluşturur, sıfırdan Prompt yazarak deneme-yanılma yapmaktan kaçınır.
Paylaşım, kullanıcıların oluşturulan görselin tam Prompt'unu paylaşmasını sağlar; diğer kullanıcılar kendi fotoğraflarını ve detaylarını ekleyerek aynı çerçevede kişisel sürümler oluşturabilir.
“80’ler geri dönüş portresi” adlı bir Prompt, sosyal medya platformlarında yayılıyor; kullanıcılar kendi selfilerini yükleyerek aynı tarzda fotoğraflar elde edebiliyor.

Dört fonksiyon aynı değişime işaret ediyor: Zihninizdeki görüntüyü resme dönüştürme süreci artık yalnızca klavyeyle değil!
Flare ve Sunburst: API ilk kez ikiye bölündü
Geliştiricilere yönelik olarak, OpenAI API'de iki görsel modeli aynı anda başlatıyor: GPT-Image-2.5 Flare ve GPT-Image-2.5 Sunburst.
Flare, hız ve toplu üretimi öne çıkarıyor; OpenAI, bunu çoğu uygulama için varsayılan seçim olarak tanımlıyor.
Kullanım senaryoları arasında sosyal içerik, ürün deneyim görselleri, hızlı prototipleme ve sık görsel üretimi yer alır.
Manus değerlendirme ekibinden Lucky Liao'nun sunduğu verilere göre, Flare testlerde GPT-Image-2'nin 2 ila 4 katı hızda görüntü üretiyor; şeffaf arka plan oluşturma iyileştirmeleri, programatik marka malzemeleri, sunumlar ve web sayfaları için görseller üretmek için doğrudan faydalıdır.

Sunburst, daha uzun üretim süresiyle daha ince düzenleme kontrolü elde etmek için üst düzey yaratıcı iş akışlarını hedefler.
OpenAI'nin tipik senaryosu, marka pazarlama için üretilmiş içerikler ve düzeltilmiş ürün görselleridir.
Adobe, Firefly'de Images 2.5 modelini entegre ettiğini onayladı.
Adobe ürünleri üst düzey direktörü Matt Chotin, 2.5 sürümünün daha hızlı üretim hızı ve çözünürlük tutarlılığı sunduğunu belirtti; resimler, çoklu düzeltmelerden sonra da net ve gerçekçi kalıyor.

İki modelin ayrılması, yüksek frekanslı düşük gecikme ve yüksek doğrulukta özelleştirme ihtiyaçlarına karşılık gelir.
Flare, hacim odaklı senaryolar için; Sunburst, kaliteli senaryolar için. Geliştiriciler, iş ihtiyaçlarına göre seçim yapabilir ve kullanmayacakları doğruluk seviyeleri için beklemek zorunda kalmaz.
Bu, OpenAI görsel API'sinin ilk kez hız ve kaliteye göre ürün katmanlamasını yapmasıdır ve mantığı dil modeli API'sinin katmanlamasıyla uyumludur.
Images 2.5, OpenAI'nin görsel ürün hattının ritmini sürdürür: mimari değişmeden, hız ve doğruluk önce bir dalga yapar.
2024 yıl sonundaki GPT-Image-1.5 aynı yöntemi kullanıyor.
İki adet 0.5 sürümü bir yılın altında aralıklarla yayımlandı; görüntü modellerinin güncelleme sıklığı, dil modellerine doğru yöneliyor.
Dünyanın en güçlü görsel üretme modelidir, açık bir önde.
OpenAI'nin sürekli artan çoklu modallite yetenekleri, muhtemelen Anthropic'in modeline karşı, Bilgisayar Kullanımı yeteneği dahil olmak üzere GPT-7 gibi temel modellerin yeteneklerini güçlendirmek için kullanılıyor.
Kaynaklar:
https://openai.com/index/introducing-chatgpt-images-2-5/
Bu yazı, WeChat hesabından "Yeni Akıl" (ID: AI_era) tarafından paylaşılmıştır, yazar: ASI Vahiyleri, editör: Marco
