ChatGPT Images 2.5 ve Sketch Özelliği Duyuruldu: Basit Çizimler Sanata Dönüşüyor

Paylaş:
ChatGPT Images 2.5 ve Sketch Özelliği Duyuruldu: Basit Çizimler Sanata Dönüşüyor - blog yazısı görseli
Özet

OpenAI, ChatGPT Images 2.5 ile birlikte basit karalamaları profesyonel görsellere dönüştüren Sketch özelliğini ve geliştiriciler için iki yeni API modelini duyurdu. İşte tüm detaylar.

Üretken yapay zeka modelleriyle görsel oluştururken yaşanan en büyük güçlüklerden biri, zihindeki kompozisyonu yalnızca sözcüklerle eksiksiz tarif edebilmekti. Ne kadar ayrıntılı prompt yazılırsa yazılsın; nesnelerin sahnedeki tam konumu, bakış açısı veya perspektif dengesi kimi zaman metnin sınırlarına takılıyordu. OpenAI, bu iletişim bariyerini ortadan kaldıran yeni nesil görsel modeli ChatGPT Images 2.5 ve beraberinde gelen devrimsel Sketch (Çiz) özelliğini kullanıma sundu.

Kullanıcıların en kaba karalamalarını bile yüksek çözünürlüklü sanatsal çıktılara dönüştüren bu güncelleme, görsel düzenleme tarafında getirdiği noktasal kontrol araçları ve geliştiricilere açılan yeni API modelleriyle yapay zeka dünyasında yeni bir standart tanımlıyor.

Metinden Öteye: @Sketch ile Fikrinizi Karalayarak Anlatın

Yeni duyurulan Sketch yeteneği, prompt kutusuna mahkum kalma dönemine son veriyor. Kullanıcılar artık ChatGPT sohbet alanına @Sketch komutunu yazarak doğrudan arayüz içinde açılan çizim tuvaline erişebiliyor.

Bu tuval üzerinde fare, dokunmatik ekran veya dijital kalem yardımıyla hazırlanan çizimlerin profesyonel bir elden çıkmış olması kesinlikle gerekmiyor. Birkaç çöp adam, kabaca çizilmiş bir ufuk çizgisi, köşeye kondurulan basit bir güneş veya nesnelerin kaba yerleşim sınırları model için mükemmel bir referans teşkil ediyor.

Sistem, kullanıcının yaptığı karalamayı bir kompozisyon iskeleti olarak yorumluyor ve ardından eklenen kısa metin açıklamasıyla bu taslağı fotogerçekçi ya da istenen sanat tarzında eksiksiz bir sahneye dönüştürüyor. Böylece "sol köşede duran ama sağa doğru bakan figür" gibi metinle aktarılması güç uzamsal ilişkiler tek bir fırça darbesiyle modele kusursuz şekilde iletilebiliyor.

Görsel Üzerinde Bölgesel Yorum ve Doğrudan Düzenleme

OpenAI'ın bu lansmanla birlikte getirdiği bir diğer kritik yenilik ise görsel düzenleme deneyimini kökten değiştiren noktasal yorumlama (in-context pinning) aracı oldu.

Önceki modellerde üretilen bir görsel üzerinde küçük bir değişiklik yapmak istendiğinde, tüm promptu baştan yazmak veya modelin sahnenin geri kalanını bozmadan istediğiniz noktayı değiştirmesini ummak gerekiyordu. Yeni sistemde ise kullanıcılar doğrudan görselin üzerine tıklayarak spesifik bir bölgeyi işaretleyebiliyor ve sadece o alana özel düzenleme komutu bırakabiliyor.

Örneğin bir portrede yalnızca arka plandaki ışık kaynağını değiştirmek, masanın üzerindeki bir fincanın rengini güncellemek veya bir karakterin kıyafet detayını revize etmek, görselin genel dokusunu ve yüz hatlarını bozmadan saniyeler içinde gerçekleştirilebiliyor.

ChatGPT Images 2.5: Işık, Doku ve Süreklilikte Yeni Seviye

Tüm bu yeniliklerin merkezinde yer alan ChatGPT Images 2.5 motoru, önceki nesil görsel modellerine kıyasla gözle görülür bir sıçrama barındırıyor:

* Gerçekçi Işık ve Doku İşleme: Doğal ortam ışıklandırmaları, gölge geçişleri, cilt gözenekleri ve kumaş lifleri gibi mikro dokularda çok daha ikna edici sonuçlar üretiliyor. * Referans Koruma Yeteneği: Modele referans olarak verilen fotoğraflardaki yüz hatları, nesne proporsiyonları ve stilistik unsurlar farklı arka plan veya açılarda yeniden üretilirken karakteristik özelliklerini kaybetmiyor. * Çok Adımlı Düzenleme Tutarlılığı: Kullanıcı aynı oturum içerisinde art arda düzeltmeler talep ettiğinde, model önceki adımları unutup sıfırdan alakasız bir görsel çizmek yerine yapılan değişiklikleri mevcut katmanların üzerine kusursuz bir uyumla inşa ediyor.

Özellikle yaratıcı sektörlerde çalışan tasarımcılar ve dijital ajanslar için görseldeki sürekliliğin korunabilmesi, yapay zekayı bir oyuncaktan profesyonel bir üretim aracına dönüştüren temel basamak sayılıyor.

Geliştiriciler İçin İki Yeni Model: GPT-Image-2.5 Flare ve Sunburst

OpenAI, yeni görsel yeteneklerini yalnızca son kullanıcı arayüzüyle sınırlı tutmayarak API ekosistemine de iki güçlü model dahil etti:

1. GPT-Image-2.5 Flare

Çoğu kurumsal ve son kullanıcı uygulaması için varsayılan model olarak konumlandırılan Flare; yüksek görüntü kalitesini eşi görülmemiş bir hızla birleştiriyor. OpenAI'ın paylaştığı verilere göre Flare, önceki GPT-Image-2 modeline kıyasla yüzde 50 daha düşük gecikme süresi ile çalışıyor. Anlık üretim gerektiren web uygulamaları, etkileşimli botlar ve seri görsel varyasyonları için ideal bir denge sunuyor.

2. GPT-Image-2.5 Sunburst

Sunburst modeli, hızdan ziyade en üst düzey hassasiyet ve detay doğruluğuna odaklanan profesyonel iş akışları için geliştirildi. Daha uzun işleme sürelerini göze alarak karmaşık sahneleri, zorlu tipografik yerleşimleri ve milimetrik düzenlemeleri en yüksek piksel kalitesiyle işliyor.

Kimler, Hangi Platformlardan Erişebilir?

OpenAI, ChatGPT Images 2.5 ve Sketch özelliklerinin dağıtımına kademeli olarak başladı. Yapılan duyuruya göre:

* ChatGPT, ChatGPT Work ve Codex kullanıcılarının tamamı yeni görsel üretim yeteneklerinden faydalanabilecek. * Özellikler eş zamanlı olarak Web arayüzü, Masaüstü uygulamaları (macOS ve Windows) ve Mobil platformlarda (iOS ve Android) kullanıma açıldı. * Geliştiriciler ise OpenAI API paneli üzerinden hem Flare hem de Sunburst modellerini projelerine entegre etmeye başlayabilirler.

Basit bir karalamanın arkasındaki potansiyeli anında kavrayabilen bu yeni nesil yaklaşım, insan-bilgisayar etkileşiminde metin tabanlı komutların ötesine geçerek çok modlu (multimodal) üretkenliği çok daha doğal bir zemine taşıyor.

Makale Bilgileri

Yazar: İsmail Hakkı EREN
Benzer Konudaki Yazılar