PunchEKSU appoints new registrarוואלהמשמר החופים הסיני: מזהירים את הפיליפינים להפסיק לאלתר את "הפעולות הפרובוקטיביות"The Jerusalem PostNAZA, the money trail, and what the film leaves out about October 7 - opinionESPNTransfer rumors, news: Real Madrid, Barcelona track Man City-bound USMNT star SullivanInquirerRidon says trial remarks meant to explain, not influence impeach courtDaily MaverickFRENCH LETTER: All I Know… Thoughts on travel, book tours and school visitsInquirer EntertainmentNawat Itsaragrisil’s Miss Universe license agreement in jeopardyCNN TürkİTALYA'DA TÜRK TIR'INA BASKIN! Silahlı saldırganlar şoförü darbettiThe Straits Times7 weeks’ jail for ex-executive director of madrasah who misappropriated over $68k of its moneyCNN بالعربيةمعايير ثلاثة تحدد الفائز بالكرة الذهبية.. فكيف تبدو حظوظ ميسي ومبابي ويامال والبقية؟سكاي نيوز عربيةالعربية في العصر الرقمي.. قيمة اقتصادية تعزز الهوية والإبداعWirtualna PolskaRepublika w służbie Krala; Urban ogłosił powołania do kadry [SKRÓT PORANKA]
The Daily Newsstand · Free, Always
Friday, September 18, 2026

AI ajanları birbirini ihbar ediyor

Translate

Redwood Research baş bilim insanı Ryan Greenblatt, yapay zeka ajanlarının şüpheli hareketleri yetkililere söylemesini sağlayan yeni çözümler geliştirdi.

Yapay zeka ajanlarının birbirini ihbar edebilmesi için iki ayrı sistem devreye alındı. Bunlardan biri olan AI Contact Hotline, internet erişimi kısıtlı ortamlarda çalışan modelleri ele alıyor. Ajanlar internetten veri almak için kullanılan GET isteklerini mesaj göndermek amacıyla da kullanabiliyor. İletmek istedikleri bilgiyi URL adresine ekleyerek dışarıya aktarabiliyorlar. Böylece tarayıcı, e-posta ya da ek bir araca ihtiyaç duyulmuyor. Bu yöntem olası kötü davranışların insanlardan gizli kalmasını zorlaştırıyor.

Rapor Veriyorlar

Daha geniş internet erişimine sahip AI ajanları ise Agenthotline.ai üzerinden olay raporu oluşturabiliyor. Sistem komut satırından tek satırlık curl komutuyla bildirim kabul ediyor ve isterse raporu kamuya açıyor. Google DeepMind’ın yakın tarihli deneyinde de bazı yapay zeka ajanları hile yapan diğer modelleri denetledi, uyardı ve organizatörlere şikayet etti. Ancak test ortamı dışındaki örneklerde aynı refleks henüz düzenli biçimde görülmedi.

Farklı Davranışlar Gösterebilir

Lakin madalyonun öteki yüzü de var. Cornell Üniversitesi’nden Lionel Levine, sürekli ihbar etmeye göre eğitilen modellerin yanlış davranış kalıpları geliştirebileceğini söylüyor. Levine’e göre amaç ajanları birbirini gözetlemeye yöneltmek yerine iş birliğini teşvik etmek olmalı. Levine olumlu kolektif davranış örneklerinin daha sağlıklı sonuç verebileceğini savunuyor.

View the original on CNN Türk

KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.