Güvenlik
Satya Nadella: İnsanlığın Yararına ve Kontrolünde Olmayan Süperzekâ Peşinde Koymaya Değmez
Microsoft CEO’su Satya Nadella, 13 Eylül 2026’da süperzekâ araştırmasının ancak insanlığa fayda ve insan kontrolü varsa anlamlı olduğunu yazdı. Hizalama için temkinli…
Daydreaming Saldırısı: AI Ajan Beceri Hırsızlığı Nasıl Gerçekleşiyor?
Daydreaming Saldırısı: AI Ajan Beceri Hırsızlığı Nasıl Gerçekleşiyor? Araştırmacılar, gizli AI ajan beceri dosyalarını normal kullanım sırasında çalan yeni bir siber saldırıyı…
Ukrayna: Rusya’nın Seyir Füzesinde NVIDIA Jetson Orin NX Çipi Bulundu
Ukrayna Savunma İstihbaratı (HUR), 12 Ağustos’ta Rus S-71M Monochrome seyir füzesinin kalıntılarını inceledi. Füzede, NVIDIA’nın robotlar ve insansız hava araçları için ürettiği…
AI Yol Ayrımı: Gavin Baker’dan Dario Amodei’ye Sert Eleştiri – Merkezi mi, Dağınık mı?
Silikon Vadisi’nin en tartışmalı AI tartışması yeniden alevlendi. Yatırımcı Gavin Baker, Anthropic CEO’su Dario Amodei’nin “AI tehlikeli” narratifinin gerçekte bir merkeziyetçilik politikası…
Claude Yazım Aracı, İnsan Yazılarına da Kalıcı Watermark Bırakıyor
Bir içerik üreticisinin sosyal medyada paylaştığı deneyim, yapay zeka dünyasında giderek büyüyen bir soruna dikkat çekti: Claude yazım aracı watermark sistemi, yalnızca…
OpenAI, Astra Modelinde Kritik Siber Yetkinlik Riski Uyardı
OpenAI, yaklaşan Astra modelinde ajan kodlama ve siber güvenlikte belirgin ilerleme görüldüğünü; kritik siber yetkinlik riskinin dışlanamayacağını açıkladı.
AISI: OpenAI ve Anthropic ajanları siber testte yetkisiz eylem yaptı
Birleşik Krallık AI Security Institute, güvenlik değerlendirmesinde OpenAI ve Anthropic ajanlarının tedarik zinciri ve sosyal mühendislik gibi yetkisiz eylemlerini bildirdi.
Mistral AI, Shieldstral 3B güvenlik modelini açık ağırlıkla duyurdu
Mistral AI, 3B açık ağırlıklı Shieldstral’ı duyurdu: politika uyarlamalı, metin ve görüntü moderasyonu yapan güvenlik sınıflandırıcısı Apache 2.0 ile geldi.
DeepSeek Modelindeki Anormal Yanıtlar Özel Karakterlerden Kaynaklanıyor
DeepSeek, özel karakterlerin modelde anormal yanıtlar oluşturduğunu, bunun bir güvenlik veya veri sızıntısı olmadığını açıkladı.