AI News
  • Teknoloji Haberleri
  • İnceleme
  • Mobil
  • Nasıl Yapılır
  • Otomobil
  • Oyun
  • Yazılım
  • Yapay Zeka
No Result
View All Result
AI News
  • Teknoloji Haberleri
  • İnceleme
  • Mobil
  • Nasıl Yapılır
  • Otomobil
  • Oyun
  • Yazılım
  • Yapay Zeka
No Result
View All Result
AI News
No Result
View All Result
Hanoi Kulesi durumlarını Sierpinski üçgeni biçiminde gösteren araştırma grafiği

Dört diskli Hanoi Kulesi’nin olası durumları Sierpinski üçgeni oluşturuyor; çalışma modellerin bu geometrik yapıyı iç temsilde kurabildiğini bildiriyor.

Akıl Yürüten Modeller Dünya Modelini Kuruyor ama Planlarken Kaybediyor: Yeni Çalışma Ne Diyor?

Ağustos 10, 2026
in Yapay Zeka
0
585
SHARES
3.2k
VIEWS
ChatGPT ile özetleyinFacebook'ta paylaş

Büyük dil modelleri bir sorunun kurallarını gerçekten temsil ediyor mu, yoksa yalnızca daha önce gördükleri çözüm kalıplarını mı taklit ediyor? 7 Ağustos 2026’da yayımlanan “Transformers Struggle to Use Their Emergent World Models” başlıklı çalışma, bu soruyu Hanoi Kulesi üzerinden mekanik olarak inceliyor. Devin Pereira ve Willem Zuidema’nın sonucu basit bir “modeller düşünemiyor” iddiasından daha incelikli: Bazı modeller doğru dünya modelini kuruyor, fakat uzun plan boyunca onu koruyup kullanmakta zorlanıyor.

Neden Hanoi Kulesi?

Bulmacada farklı büyüklükteki diskler üç çubuk arasında taşınıyor; bir seferde tek disk hareket ediyor ve büyük disk küçüğün üzerine konamıyor. Standart sürümde bütün diskler bir çubuktan diğerine aktarılıyor. Araştırmacıların kullandığı “flat-to-flat” varyantında başlangıç ve hedef diskleri birden fazla çubuğa dağılmış durumda. Bu, ezberlenmiş klasik özyinelemeli çözüm kalıbını yetersiz bırakıyor ve modelin mevcut durumla hedef arasındaki yolu gerçekten planlamasını gerektiriyor.

Küçük Transformer Ne Öğrendi?

Ekip önce önceden hesaplanmış çözüm izleri üzerinde küçük Transformer modellerini sıfırdan eğitti. Katmanlardaki iç etkinlik doğrusal çözümleyiciler ve temsil analiziyle incelendi. Dört diskli bulmacanın 81 olası durumu, matematiksel olarak Sierpinski üçgeni biçiminde bir durum uzayı oluşturuyor. Modelin artık akışında bu geometrinin doğrusal olarak çözülebildiği ve yalnızca görsel bir benzerlik olmadığı bulundu.

Nedensellik testi için bir problemin iç temsili başka bir probleme aktarıldı. Çıktının beklenen yönde değişmesi, temsilin çözüm üretiminde gerçekten rol oynadığını gösterdi. Başka bir deyişle küçük model yalnızca hamle dizilerini ezberlememiş; disklerin hangi çubukta olduğunu ve durumlar arasındaki geçişleri sıkıştırılmış bir dünya modeli içinde kodlamış görünüyor.

Büyük Akıl Yürütme Modellerinde Şaşırtıcı Ayrım

Araştırma daha sonra Qwen3.6-27B ile DeepSeek-R1-Distill-Qwen-32B modellerine geçti. Makaleye göre iki model de istemin sonunda Sierpinski durum modelini neredeyse kusursuz biçimde kodlayabiliyordu. Buna rağmen üçten fazla disk içeren flat-to-flat görevlerin çoğunda başarısız oldular. Sorun başlangıçta kuralların veya durumun hiç anlaşılmaması değildi.

Üretim adımları boyunca yapılan ölçüm, dünya modeli temsilinin plan ilerledikçe zayıfladığını gösterdi. Model bir sonraki hamleleri yazarken başlangıçtaki net durum bilgisi bozuluyor; yanlış hamle bir sonraki bağlamı daha da kirletiyor. Bu ayrım önemli, çünkü çözümü yalnızca daha fazla başlangıç açıklaması vermekte değil, çalışma belleğini plan boyunca korumakta aramak gerektiğini düşündürüyor.

Temsile Müdahale Performansı Artırdı

Araştırmacılar istem sonundaki daha temiz temsili çıkarım sırasında belirli katmanlara yeniden enjekte etti. Yardımsız çözülemeyen örneklerin bir bölümünde performans arttı. Bu deney, “gerekli bilgi modelde hiç yok” açıklamasını zayıflatıyor. Bilgi var, ancak hesaplama boyunca erişilebilir biçimde tutulamıyor. İyileşmenin kısmi kalması ise tek sorunun temsil kaybı olmadığını; arama, hata kontrolü ve çıktı üretiminin de rol oynadığını gösteriyor.

Bu Sonuç Ürünler İçin Ne Anlama Geliyor?

  • Uzun görevlerde ara durumu dış belleğe yazmak, yalnızca daha uzun düşünme metni üretmekten daha yararlı olabilir.
  • Planın her adımında kural ve durum doğrulaması yapmak hata zincirini erken kesebilir.
  • Ajan sistemleri, hedef ve gerçekleşen durumu yapılandırılmış tabloda tutarak dil bağlamındaki bozulmayı azaltabilir.
  • Değerlendirmeler yalnızca doğru sonuca değil, iç durumun adımlar boyunca korunup korunmadığına da bakabilir.

Sınırları Unutmamak Gerekiyor

Hanoi Kulesi kapalı kurallı, küçük ve sentetik bir planlama problemi. Sonuçları yazılım geliştirme, tıp, hukuk veya gerçek dünya robot görevlerine doğrudan genellemek doğru değil. İncelenen büyük modeller de bütün yapay zekâ ekosistemini temsil etmiyor. Makale arXiv ön baskısı ve bulgular hakemli yayın sürecinden geçmeden değişebilir. Yine de iç temsille görünen davranışı birbirinden ayırması, başarısızlığı daha somut bir mühendislik problemine dönüştürüyor.

Almadanincele Yorumu

Bu çalışma, modelin bir şeyi “bilmesi” ile o bilgiyi uzun görev boyunca güvenilir kullanmasının aynı olmadığını güzel gösteriyor. Günlük kullanıcı için pratik karşılığı açık: Yapay zekâdan uzun bir plan isterken ara hedefleri, gerçekleşen adımları ve kısıtları düzenli biçimde yeniden doğrulatmak hâlâ gerekli.

Gelecek kuşak akıl yürütme sistemlerinde en büyük sıçrama yalnızca daha büyük modelden gelmeyebilir. Kalıcı çalışma belleği, yapılandırılmış durum takibi ve adım sonrası denetim, modelin başta kurduğu doğru resmi planın sonunda da korumasını sağlayabilir.

Kapak görseli: Devin Pereira ve Willem Zuidema araştırması, Şekil 2. Kullanım bilgisi: Açık erişimli araştırmanın özgün grafiği; kaynak ve lisans bilgisiyle editoryal kullanım.

Kaynaklar

  • Transformers Struggle to Use Their Emergent World Models – arXiv
  • Araştırmanın açık erişimli HTML tam metni
Tags: Akıl YürütmeBüyük Dil ModelleriDünya ModeliTower of HanoiYapay Zeka Araştırması
SummarizeShare234
Previous Post

Yapay Zekâ Restoranların Yüzde 85,6’sını Hiç Önermedi: Görünürlükte Ne Belirleyici?

Next Post

GIIAS 2026 Sona Erdi: 43 Otomobil Markası Elektrikli ve Hibrit Yarışını Nasıl Gösterdi?

Almadanincele Editör Ekibi

Almadanincele Editör Ekibi

Almadan İncele editör ekibi; teknoloji, yapay zeka, mobil, oyun, otomobil ve yazılım dünyasındaki gelişmeleri satın alma kararı odaklı, anlaşılır ve kaynaklı şekilde değerlendirir.

İlgili Haberler

Yapay zekâ sistemlerinin hiç önermediği restoran ve kafelerin oranını gösteren araştırma grafiği

Yapay Zekâ Restoranların Yüzde 85,6’sını Hiç Önermedi: Görünürlükte Ne Belirleyici?

by Almadanincele Editör Ekibi
Ağustos 10, 2026
0

Bali’de 4.776 işletmeyi kapsayan yeni çalışma, dört yapay zekâ sisteminin mekânların yüzde 85,6’sını hiç önermediğini buldu. Puan, web sitesi, yorum sayısı ve güncellik arasındaki farkı inceledik.

Google etkinliği sahnesinde konuşan DeepMind kurucusu Demis Hassabis

Google DeepMind Yönetimi Değişiyor: Demis Hassabis Alphabet’ın Baş Bilim İnsanı Oldu

by Almadanincele Editör Ekibi
Ağustos 9, 2026
0

Google DeepMind’de görev dağılımı değişiyor: Demis Hassabis başkanlık ve Alphabet baş bilim insanlığına geçerken birimin günlük liderliğini Koray Kavukcuoglu üstleniyor. Değişimin araştırma ve ürünlere etkisini inceledik.

OpenAI modelleriyle yapılan üçüncü taraf siber güvenlik değerlendirmesini anlatan resmi görsel

OpenAI Astra’yı Siber Riskler Nedeniyle Yavaşlattı: “Kritik Yetenek” Uyarısı Ne Anlama Geliyor?

by Almadanincele Editör Ekibi
Ağustos 9, 2026
0

OpenAI, yayımlanmamış Astra modelinde kritik siber kabiliyet ihtimalini dışlayamadığını belirterek güvenlik testlerini genişletti ve çıkış sürecini yavaşlattı. Bu açıklamanın neyi kanıtlayıp neyi kanıtlamadığını inceledik.

SymptomAI belirti değerlendirme uygulamasının dört aşamalı telefon arayüzü

Google SymptomAI 13.917 Kişilik Çalışmada Test Edildi: Doktorun Yerini mi Alacak?

by Almadanincele Editör Ekibi
Ağustos 7, 2026
0

Google Research, SymptomAI adlı deneysel belirti değerlendirme ajanını 13.917 katılımcıyla sınadı. Sonuçların ne anlama geldiğini ve neden tıbbi tanı olmadığını anlattık.

Next Post
GIIAS 2026 otomobil fuarı tarihlerini ve gelecek temalı otomobili gösteren resmi afiş

GIIAS 2026 Sona Erdi: 43 Otomobil Markası Elektrikli ve Hibrit Yarışını Nasıl Gösterdi?

Bir yanıt yazın Yanıtı iptal et

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir

Tavsiye edilen

Xbox Series X konsolu ve oyun kumandası

Xbox Yeniden Yapılanıyor: Stüdyo Satışları Oyuncular İçin Ne Anlama Geliyor?

Temmuz 10, 2026
Spotify

Spotify Abone Rakamları 70 Milyon’u Gördü

Ocak 6, 2018
Xiaomi Mi 8

Xiaomi Mi 8 Çok Sağlam Gelmeye Hazırlanıyor

Mayıs 20, 2018
Hitman Sniper

Hitman Sniper Android Oyunu Kısa Süreliğine Ücretsiz

Mayıs 17, 2018
general-mobile-gm-8-sahibi-olmak-isteyenlere-mujde

General Mobile GM 8 Sahibi Olmak İsteyenlere Müjde!

Haziran 16, 2018
face_ıd_kapak

FaceID Kandırıldı

Kasım 11, 2017
Meizu 15 Plus

Meizu 15 Plus Görselleri Online Ortamda Sızdırıldı

Şubat 20, 2018
Galaxy Note 9’un Tanıtım Tarihi Belli Oldu!

Galaxy Note 9’un Tanıtım Tarihi Belli Oldu!

Haziran 29, 2018
Almadan İncele

Almadan İncele; teknoloji, mobil, oyun, otomobil ve yazılım dünyasında satın almadan önce doğru karar vermenize yardımcı olan inceleme, haber ve rehber içerikleri yayınlar.

Follow us

Son Yazılar

Dekoratif vazoyla birlikte siyah Samsung Music Studio 7 ve beyaz Music Studio hoparlör

Samsung Music Studio 7 İncelemesi: Tek Hoparlörle Dolby Atmos ve TV Sesi Olur mu?

Ağustos 10, 2026
Mor, siyah, beyaz ve yeşil Xiaomi Sound Play Bluetooth hoparlörler

Xiaomi Sound Play İncelemesi: 18 W Güç, IP68 ve 14 Saat Pil Bu Fiyata Yeterli mi?

Ağustos 10, 2026

Takip

Call of Duty Modern Warfare 4 beta görselinde şehirde ilerleyen iki asker

Modern Warfare 4 Açık Beta Takvimi: Call of Duty NEXT Ne Zaman, Kimler Katılabilir?

Ağustos 10, 2026
2025 ve 2026 ikinci çeyrek küresel akıllı telefon sevkiyat paylarını karşılaştıran grafik

Akıllı Telefon Sevkiyatları 13 Yılın En Düşük İkinci Çeyreğine Geriledi: Kim Kazandı?

Ağustos 10, 2026
  • Teknoloji Haberleri
  • İnceleme
  • Mobil
  • Nasıl Yapılır
  • Otomobil
  • Oyun
  • Yazılım
  • Yapay Zeka

© 2026 almadanincele.com. Tüm hakları saklıdır.

No Result
View All Result
  • Teknoloji Haberleri
  • İnceleme
  • Mobil
  • Nasıl Yapılır
  • Otomobil
  • Oyun
  • Yazılım
  • Yapay Zeka

© 2026 almadanincele.com. Tüm hakları saklıdır.