Yapay Zeka

GPT-5.6 Sol: OpenAI'nin Yeni Amiral Gemisi Yapay Zeka Modeli

Ahmetcan Dinçer · Full Stack Developer
3 dakikalık okuma
#GPT-5.6 Sol#OpenAI#Yapay Zeka#Benchmark
GPT-5.6 Sol yapay zeka modeli kapak görseli
GPT-5.6 Sol, OpenAI'nin ajan görevleri için sunduğu yeni amiral gemisi yapay zeka modeli. Fiyatlarını ve benchmark sonuçlarını sade biçimde özetledik.

GPT-5.6 Sol, OpenAI'nin ajan görevleri için sunduğu yeni amiral gemisi yapay zeka modelidir. Kod yazma, güvenlik testleri ve tıbbi sorularda ailenin en güçlü üyesi olarak öne çıkar. TerminalBench 2.1 testinde yüzde 88,8 puan alır. Sol Ultra ise aynı testte yüzde 91,9 ile listenin en üstüne yerleşir.

GPT-5.6 Sol nedir?

GPT-5.6 Sol, OpenAI'nin GPT-5.6 serisinin en tepesinde yer alır. Adını Güneş'ten alır ve seride en yüksek akıl yürütme gücünü sunar. Model, uzun süren ve çok adımlı ajan görevleri için tasarlandı. Bir yazılım projesini baştan sona kurmak ya da bir hatayı bulup düzeltmek buna örnektir.

OpenAI, modeli iki kademede sunar. Standart Sol günlük ajan işleri için yeterlidir. Sol Ultra ise daha uzun düşünme süresiyle en zor görevleri hedefler. İkisi de aynı model ailesine dayanır.

GPT-5.6 ailesi: Sol, Terra ve Luna

OpenAI, GPT-5.6'yı üç ayrı modelle sunar. Her biri farklı bir bütçe ve hız dengesine oturur. Aşağıdaki grafik üç modeli ve tek milyon token başına fiyatları gösterir.

GPT-5.6 Sol, Terra ve Luna modellerinin fiyat karşılaştırması
GPT-5.6 ailesi: Sol, Terra ve Luna modelleri ve fiyatları.
  • Sol: Zorlu ajan işleri için amiral gemisi model.
  • Terra: Günlük işler için dengeli seçenek.
  • Luna: Yüksek hacimli işler için hızlı ve uygun model.

GPT-5.6 Sol fiyatları ne kadar?

Sol, ailenin en pahalı modelidir. Fiyatlar tek milyon token üzerinden hesaplanır. Önbellekli girdi, tekrar eden istemlerde maliyeti onda birine kadar düşürür.

ModelGirdiÖnbellekli GirdiÇıktı
GPT-5.6 Sol5,00 $0,50 $30,00 $
GPT-5.6 Terra2,50 $0,25 $15,00 $
GPT-5.6 Luna1,00 $0,10 $6,00 $

Fiyat farkı büyük. Luna'nın çıktısı Sol'un beşte biri kadar tutar. Bu yüzden model seçimi görevin ağırlığına göre değişir.

Benchmark sonuçları neler gösteriyor?

OpenAI, GPT-5.6 Sol'u üç ana testte paylaştı. Bu testler kod, sağlık ve güvenlik alanlarını ölçer. Her testte Sol, kendi ailesinin en iyi puanını alır.

TerminalBench 2.1: kod ve terminal görevleri

TerminalBench, modelin bir terminalde gerçek görevleri bitirme oranını ölçer. GPT-5.6 Sol Ultra yüzde 91,9 ile birinci olur. Standart Sol yüzde 88,8 puanla onu izler.

TerminalBench 2.1 test sonuçları çubuk grafiği
TerminalBench 2.1 puanları: GPT-5.6 Sol Ultra en üstte.
ModelPuan
GPT-5.6 Sol Ultra%91,9
GPT-5.6 Sol%88,8
Claude Mythos 5%88,0
GPT-5.6 Terra%84,3
Claude Fable 5%84,3
GPT-5.5%83,4
GPT-5.6 Luna%82,5
Claude Opus 4.8%78,9
Gemini 3.1 Pro Preview%70,7

HealthBench Professional: tıbbi sorular

HealthBench, sağlık sorularına verilen yanıtların doğruluğunu ölçer. Sol, yaklaşık yüzde 60,5 puanla GPT ailesinin önünde yer alır. Grafik, puanı örnek başına düşen ücrete göre gösterir. Sol böylece hem yüksek puan hem de iyi bir fiyat dengesi kurar.

HealthBench Professional puan ve fiyat grafiği
HealthBench Professional: puan ve örnek başına ücret dengesi.

ExploitBench: güvenlik testleri

ExploitBench, modelin güvenlik açıklarını bulma gücünü ölçer. Sol eğrisi yüzde 73 bandına ulaşır. Bu değer, GPT-5.6 Terra ve Luna'nın belirgin şekilde üzerindedir. Grafik, başarı oranını harcanan çıktı token sayısına göre çizer.

ExploitBench güvenlik testi çizgi grafiği
ExploitBench: başarı oranı ve çıktı token ilişkisi.

GPT-5.6 Sol kimler için uygun?

Sol, en yüksek başarıyı isteyen ekipler için mantıklıdır. Karmaşık kod tabanlarında ya da uzun ajan görevlerinde fark yaratır. Günlük ve basit işler için Terra çoğu zaman yeterli olur. Çok sayıda kısa istek için Luna daha ekonomik kalır.

GPT-5.6'nın rakiplerini merak edenler GLM 5.2 yazımıza göz atabilir. Testlerde adı geçen Claude tarafı için Fable 5 yazımız iyi bir başlangıçtır.

Modelin tüm ayrıntılarını OpenAI'nin GPT-5.6 duyurusundan ve Sol ön izleme sayfasından okuyabilirsiniz.

GPT-5.6 Sol: OpenAI'nin Yeni Amiral Gemisi