Güvenlik
Anthropic ve Accenture: gömülü bağımsız AI değerlendirmesi, taraflar 5 yılda en az 1’er milyar dolar
Anthropic, Accenture ile sınır AI modellerinin gömülü (embedded) bağımsız değerlendirmesi için ortaklık duyurdu. Duyuru, CEO’nun “We Must Pace the Frontier” yazısındaki “değerlendiricileri…
Google: Gemini, CTF testinde internet açık kalınca üç gerçek şirkete erişti
IT’nin Wall Street Journal haberine dayanan aktarımına göre Google, Gemini modelinin 2026 Mayıs’ında bir güvenlik testinde dışarıdaki gerçek şirketlere kendi başına eriştiğini…
Goodfire: model içi sinyal ödül hilesini ölçekte yakalayabiliyor
Goodfire Research, ajan modellerinde büyüyen ödül hilesi (reward hacking) sorununa karşı model içi bir sinyal bulduklarını ve bunu ölçekte yakalayan aktivasyon probları…
NYT davası belgeleri: Microsoft yöneticisi AI çekmeyi ‘emek hırsızlığı’ diye nitelemiş
TechCrunch’un haberine göre, New York Times’ın OpenAI ve Microsoft’a açtığı telif davasında yeni açılan (unredacted) belgeler, şirket içi yazışmalarda AI içerik çekmenin…
OpenAI model misalignment açıklama çerçevesi ve altı örnek rapor
OpenAI, model misalignment (hizalanmama / sapma) örneklerini izleme, araştırma ve kamuya açıklama için yeni bir çerçeve yayımladı. Aynı gün, son altı ayda…
Trail of Bits: 1Password’ün AI yama benchmark’ı yanıltıcı
Trail of Bits, 1Password’ün 6 Ağustos 2026 tarihli FLAWED raporundaki «modeller yalnızca yüzde 26 temiz yama üretti» manşetinin savunucuları yanıltabileceğini savundu. Ekip,…
404 Media: OpenAI «Project Lily» ile ChatGPT sohbetlerini insanlara okutuyor
404 Media muhabiri Joseph Cox, sızdırılmış iç belgeler ve gördüğü gerçek istemlere dayanarak OpenAI’nin «Project Lily» kod adlı programında yüzlerce yüklenicinin gerçek…
Tomer Tunguz: Amodei’nin yavaşlatma çağrısının arkasındaki beş kamp ve hız sorusu
Tomasz Tunguz, Amodei’nin pacing çağrısını yorumlanabilirlik, emek, ekonomi, jeopolitik ve düzenleyici ele geçirme kamplarına ayırıyor; hız sayılamıyor diyor.
Anthropic: Kuzey Yemen’deki hücre Claude Code ile füze güdüm yazılımı geliştirmeye çalıştı
Anthropic, Eylül 2026 tehdit istihbarat raporunda kuzey Yemen merkezli bir grubun Claude Code’u güdümlü silah yazılımı geliştirmek için kullandığını açıkladı. Şirket, aktörlerin…
Dario Amodei sınırın temposunu yavaşlatmayı istedi, Altman OpenAI’nin de bağımsız denetçi açacağını söyledi
Amodei, Eylül 2026 yazısında sınırın temposunu yavaşlatmayı önerdi. Altman 12 Eylül’de katıldı: OpenAI de bağımsız denetçilere çalışan benzeri erişim verecek.