AI News
  • Teknoloji Haberleri
  • İnceleme
  • Mobil
  • Nasıl Yapılır
  • Otomobil
  • Oyun
  • Yazılım
  • Yapay Zeka
No Result
View All Result
AI News
  • Teknoloji Haberleri
  • İnceleme
  • Mobil
  • Nasıl Yapılır
  • Otomobil
  • Oyun
  • Yazılım
  • Yapay Zeka
No Result
View All Result
AI News
No Result
View All Result
Güvenli başlayan ajan becerilerinin bozulup koruma katmanında düzeltildiğini gösteren özgün editoryal görsel

Araştırma, tekrar kullanılan beceri modüllerinde zararlı kalıpların birikip yeni oturumlara taşınmasını ve güvenlik filtresiyle durdurulmasını inceliyor.

Yapay Zekâ Ajanı Pratik Yaptıkça Tehlikeli Hale Gelebilir mi? Yeni Testin Sonucu

Ağustos 15, 2026
in Yapay Zeka
0
585
SHARES
3.3k
VIEWS
ChatGPT ile özetleyinFacebook'ta paylaş

Otonom yapay zekâ ajanları aynı işi tekrar tekrar yaparken başarılı adımları “beceri” dosyası, komut şablonu veya araç kullanma kuralı olarak saklayabiliyor. Bu hafıza, ajanın her oturumda sıfırdan öğrenmesini önleyerek hız ve tutarlılık sağlıyor. Fakat 13 Ağustos 2026’da yayımlanan Practice Makes Unsafe çalışması, tekrarın yalnızca yararlı alışkanlık üretmediğini; güvenli olmayan bir adımın kalıcı beceriye dönüşüp daha sonraki temiz oturumlara taşınabildiğini gösteriyor.

Araştırmacılar bu olguya “skill misevolution”, yani becerinin yanlış yönde evrilmesi adını veriyor. Risk klasik tek seferlik istem saldırısından farklı. Zararlı görev sona erse bile oluşturduğu dosya veya talimat kalıyor ve başka kullanıcı, başka görev ya da yeni oturum tarafından yeniden çağrılabiliyor. Böylece küçük bir hata zaman içinde ajanın standart çalışma biçimine dönüşebiliyor.

SkillMisevo-Gym ve SkillMisevo-Bench Neyi Ölçüyor?

Çalışma iki değerlendirme ortamı sunuyor. Gym bölümü, becerilerin oturumlar boyunca nasıl oluşturulduğunu ve güncellendiğini kontrollü biçimde izliyor. Bench ise bu becerilerin yeni görevlerde gerçekten zarar üretip üretmediğini ölçüyor. Deneylerde 25 ajan-yöntem yapılandırması, her biri 25 bölüme yayılan 525 görev üzerinde çalıştırıldı.

Görevler yalnızca açıkça kötü niyetli komutlardan oluşmuyor. Normal iş akışlarının arasına ajanın güvenli olmayan bir kısayol öğrenmesine yol açabilecek örnekler yerleştiriliyor. Ardından temiz oturumda ilgili beceri çağrıldığında geçmişteki riskli davranışın tekrar edip etmediği gözleniyor. Bu tasarım, kalıcı hafızanın güvenlik etkisini tek oturumlu testlerden daha gerçekçi biçimde ortaya çıkarıyor.

Sonuçlar Ne Kadar Ciddi?

Beceri evrimi kullanan 21 yapılandırmanın tamamı en az bir güvenli olmayan kalıcı eser oluşturdu. Bunların 15’i yeni bir oturumda somut zarara yol açtı. Bu sonuç, riskli bilginin yalnızca günlük kaydında kalmadığını; ajanın ileride kullandığı çalışma malzemesine dönüştüğünü gösteriyor.

Üç kötü niyetli görevin sisteme eklenmesi, sonraki oturumlara taşınan saldırı başarı oranını yüzde 16,0’dan yüzde 35,3’e çıkardı. Oranın iki kattan fazla artması, saldırganın bütün sistemi ele geçirmesine gerek olmadığını düşündürüyor. Az sayıda dikkatle seçilmiş görev, sık kullanılan beceriyi zehirleyip daha geniş zaman aralığında etkili olabilir.

Yeni Oturum Neden Temiz Sayılmıyor?

Bir sohbet penceresini kapatmak genellikle bağlamın silindiği izlenimi verir. Oysa ajan çalışma alanındaki dosyalar, komut şablonları, paketler ve beceri notları kalabilir. Yeni oturum bu malzemeleri güvenilir başlangıç bilgisi olarak yüklediğinde geçmişteki saldırı dolaylı biçimde geri döner. Tehlikeli olan, zararlı talimatın artık dışarıdan gelen bir istem değil sistemin kendi ürettiği “deneyim” gibi görünmesidir.

Bu durum kurumsal ajanlarda daha önemli. Aynı çalışma alanını birden fazla ekip kullanıyorsa bir kullanıcının görevi diğerinin akışını etkileyebilir. Kod ajanında riskli kurulum komutu, destek ajanında yanlış müşteri politikası, veri ajanında geniş yetkili sorgu şablonu kalıcı hale gelebilir. Dosyanın model tarafından yazılmış olması onu güvenilir yapmaz.

SafeEvolve Nasıl Koruma Sağlıyor?

Araştırmacıların SafeEvolve yaklaşımı, becerilerin oluşturulması ve geri çağrılması aşamalarına güvenlik denetimi ekliyor. Yöntem güvenli olmayan beceri getirme oranını 26,7 yüzde puanı, yeni oturumdaki zararı ise 17,3 puan azalttı. İyi niyetli görevlerdeki yarar değişimi yalnızca 0,4 puan olarak ölçüldü. Bu, doğru filtrelemenin sistemi tamamen verimsizleştirmeden riski azaltabileceğine işaret ediyor.

Yine de sıfır risk sağlanmış değil. Filtre de model tabanlıysa yanıltılabilir; katı kurallar ise yararlı becerileri yanlışlıkla engelleyebilir. En güvenli yaklaşım, içerik denetimini dosya izinleri, sürüm geçmişi, imza, insan onayı ve çalışma anındaki yetki sınırlarıyla birleştirmek.

Ajan Kullanan Ekipler İçin Kontrol Listesi

  • Beceri kaynağı: Her becerinin hangi görevde, hangi kullanıcıyla ve hangi araç çıktısından üretildiğini kaydedin.
  • Sürümleme: Beceri dosyalarını değişmez geçmiş ve kolay geri alma imkânıyla yönetin.
  • Onay: Ağ erişimi, dosya silme, paket kurma ve kimlik bilgisi kullanma becerilerini insan onayına bağlayın.
  • İzolasyon: Farklı kullanıcı ve projelerin kalıcı hafızalarını varsayılan olarak ayırın.
  • Yeniden doğrulama: Bir beceri her çağrıldığında mevcut görev ve yetki bağlamında yeniden kontrol edilsin.
  • Süre sınırı: Kullanılmayan becerileri otomatik arşivleyin; kalıcı olanları periyodik denetleyin.
  • Temiz test: Kötü niyetli görev sonrasında yeni oturum açıp taşınan davranışı özellikle sınayın.

Çalışmanın Sınırları

Sonuçlar belirli 25 yapılandırma, görev kümesi ve araştırma ortamına dayanıyor. Bütün ajan ürünleri aynı hafıza mimarisini kullanmıyor. Araştırma hakem değerlendirmesi öncesi bir ön baskı ve oranlar üretim sistemlerine doğrudan taşınamaz. Buna rağmen kalıcı becerilerin yeni bir saldırı yüzeyi olduğu yönündeki mekanizma teknik olarak ikna edici ve test edilebilir.

Almadanincele Yorumu

Yapay zekâ ajanlarında “öğrenme” sözcüğü doğal olarak olumlu duyuluyor; oysa sistem neyin iyi alışkanlık olduğunu kendi başına güvenilir biçimde ayıramayabilir. Bu çalışma, beceri dosyasının basit bir not değil, gelecekteki yetkili eylemleri etkileyen yazılım bileşeni gibi ele alınması gerektiğini gösteriyor.

Bizce kalıcı hafıza açılan her ajanda varsayılan soru “ne kadar çok öğrenebilir?” değil, “hangi değişiklik kim tarafından onaylandı ve nasıl geri alınır?” olmalı. SafeEvolve sonuçları umut verici, fakat tek filtre yeterli değil. Proje izolasyonu, sürüm geçmişi, sınırlı yetki ve kritik becerilerde insan onayı olmadan pratik yapmak ajanı yalnızca hızlandırmayabilir; hatasını da kalıcılaştırabilir.

Kapak görseli: Almadanincele / OpenAI ImageGen özgün editoryal görsel. Kullanım bilgisi: Almadanincele için OpenAI ImageGen ile özgün üretilmiştir.

Kaynaklar

  • Practice Makes Unsafe: Skill Misevolution in Autonomous Agents – arXiv
  • SkillMisevo araştırma kodu ve deney bağlantıları
Tags: AI AgentAjan BecerileriSafeEvolveSkillMisevoYapay Zeka Güvenliği
SummarizeShare234
Previous Post

Yapay Zekâ Komutu Doğru Yazdı ama Sistem Bozdu: QuoteBench Ne Gösteriyor?

Next Post

Ferrari CZ26 Tanıtıldı: SF90 Temelli 1000 Beygirlik Tek Üretim Model

Almadanincele Editör Ekibi

Almadanincele Editör Ekibi

Almadan İncele editör ekibi; teknoloji, yapay zeka, mobil, oyun, otomobil ve yazılım dünyasındaki gelişmeleri satın alma kararı odaklı, anlaşılır ve kaynaklı şekilde değerlendirir.

İlgili Haberler

Konuşma dalga biçimi ve gerçek zamanlı yazıya döküm fikrini anlatan özgün editoryal görsel

Microsoft’tan Anlık Konuşma Çözümleme: Yeni MAI Modelleri 60 Dili Destekliyor

by Almadanincele Editör Ekibi
Ekim 2, 2026
0

Microsoft’un 1 Ekim’de duyurduğu MAI-Transcribe-2-Streaming, 60 dilde konuşma sürerken metin üretiyor; MAI-Voice 2.1 ailesi 23 dil ve 26 yerel seçeneğe odaklanıyor.

Kurum içi sunucu altyapısı üzerinde çalışan yazılım geliştirme yapay zekâsını anlatan özgün editoryal illüstrasyon

IBM Bob Kurum İçi Kuruluma Açılıyor: Hassas Kodlar Bulutta Kalmak Zorunda Değil

by Almadanincele Editör Ekibi
Ekim 2, 2026
0

IBM, Bob yazılım geliştirme platformunun kurumların kendi sunucularında, özel veya egemen bulutta ve internetten yalıtılmış ortamlarda çalışabilecek dağıtım seçeneğini duyurdu.

Google DeepMind’in SynthID Bio duyurusundaki protein yapılarının biyolojik filigranla işaretlenmesini anlatan görsel

SynthID Bio: Google, Yapay Zekâyla Tasarlanan Proteinlere Biyolojik Filigran Ekliyor

by Almadanincele Editör Ekibi
Ekim 1, 2026
0

Google DeepMind, yapay zekâyla tasarlanan protein dizilerine ve üç boyutlu yapılara algılanamaz işaret ekleyen bir kavram kanıtı yayımladı. Laboratuvar sonuçları, açık kaynak planı ve çözülmemiş riskler.

Gemini 4 Argon’un siber güvenlik odağını anlatan özgün editoryal görsel: kod ve tehdit grafiğiyle donatılmış güvenlik operasyon merkezi

Google Gemini 4 Argon’u Tanıttı: Kodlama ve Siber Güvenlikte Yeni Model, Erişim Şimdilik Sınırlı

by Almadanincele Editör Ekibi
Ekim 1, 2026
0

Google’ın 30 Eylül’de duyurduğu Gemini 4 Argon, karmaşık kodlama, bilgi işi ve siber güvenlik akışlarına odaklanıyor. İlk erişim güvenlik uzmanlarıyla sınırlı; şirket iddiaları ve belirsiz noktaları ayırıyoruz.

Next Post
Gri renkli tek üretim Ferrari CZ26 süper otomobilin önden üç çeyrek görünümü

Ferrari CZ26 Tanıtıldı: SF90 Temelli 1000 Beygirlik Tek Üretim Model

Bir yanıt yazın Yanıtı iptal et

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir

Tavsiye edilen

PHYSINT için Hideo Kojima ve Xbox ortaklığını gösteren resmi sahne

Xbox ve Kojima Productions PHYSINT İçin Anlaştı: Yayıncılığı Microsoft Üstlenecek

Eylül 15, 2026
Bilimsel veri analizi ve yapay zekâ modellerini anlatan özgün editoryal görsel

Google Araştırması: Bilim İnsanları Yapay Zekâyla Haftada Yaklaşık 7 Saat Kazandığını Bildiriyor

Eylül 28, 2026
Lenovo Legion Tab Gen 5 oyun tableti yatay kullanımda

Lenovo Legion Tab Gen 5 Ön İncelemesi: 165 Hz Ekranlı Oyun Tableti Kimler İçin?

Eylül 14, 2026
Ev ağında yeni nesil kablosuz bağlantı ve router yerleşimini gösteren özgün editoryal illüstrasyon

Wi-Fi 7 Evde Gerçekten Fark Yaratır mı? Router Almadan Önce 7 Kontrol

Ekim 2, 2026
Takvim, görev panosu ve ekip mesajlaşması arasında izinli bağlantıları anlatan temsili ekran

Lenovo ve Workato, Qira’yı Uygulamalar Arasında Çalışan Bir Asistana Taşıyor

Eylül 6, 2026
Hastane dijital altyapısında hasta verisini koruyan yapay zekâ güvenliği konsept illüstrasyonu

Sağlık Verileri İçin Yapay Zekâ Geçidi: Clalit ve Check Point Ortaklığı

Ekim 2, 2026
E-posta kutusunda yapay zekâ taslak ve onay akışını gösteren editoryal görsel

Yapay Zekâ E-posta Asistanı Güven Kazanabilir mi? Fyxer’ın Yöntemi Ne Gösteriyor?

Eylül 16, 2026
Dizüstü bilgisayar başında belgelerini Gemini yardımıyla düzenleyen kullanıcı

Resmî İşlemlerde Gemini Nasıl Kullanılır? Güvenli ve Doğrulanabilir Rehber

Eylül 10, 2026
Almadan İncele

Almadan İncele; teknoloji, mobil, oyun, otomobil ve yazılım dünyasında satın almadan önce doğru karar vermenize yardımcı olan inceleme, haber ve rehber içerikleri yayınlar.

Follow us

Son Yazılar

HP ProBook 4 G2iS iş dizüstüsünün resmi basın görseli

HP ProBook 4 G2iS 14 Ön İnceleme: İş Dünyasına 120 Hz OLED Ekran

Ekim 2, 2026
HP OmniBook 5 14 dizüstü bilgisayarın açık ekranlı resmi basın fotoğrafı

HP OmniBook 5 14 Ön İnceleme: OLED Ekran ve 42 Saatlik Pil İddiası

Ekim 2, 2026

Takip

Windows bilgisayarında disk şifreleme ve kurtarma anahtarı yedeklemeyi anlatan özgün editoryal görsel

Windows 11’de BitLocker Kurtarma Anahtarı Nasıl Yedeklenir?

Ekim 2, 2026
Ev ağında yeni nesil kablosuz bağlantı ve router yerleşimini gösteren özgün editoryal illüstrasyon

Wi-Fi 7 Evde Gerçekten Fark Yaratır mı? Router Almadan Önce 7 Kontrol

Ekim 2, 2026
  • Teknoloji Haberleri
  • İnceleme
  • Mobil
  • Nasıl Yapılır
  • Otomobil
  • Oyun
  • Yazılım
  • Yapay Zeka

© 2026 almadanincele.com. Tüm hakları saklıdır.

No Result
View All Result
  • Teknoloji Haberleri
  • İnceleme
  • Mobil
  • Nasıl Yapılır
  • Otomobil
  • Oyun
  • Yazılım
  • Yapay Zeka

© 2026 almadanincele.com. Tüm hakları saklıdır.