CANLI
xAI, Imagine API’yi 2.0’a Yükseltmeye Hazırlanıyor: Görüntü ve Video Tek…·Microsoft MAI-Cyber-1-Flash’ı Duyurdu·Moonshot AI, Kimi K3 Model Ağırlıklarını ve Teknik Raporunu Açık…
25 Sep 2026 · 21:46 GMT+3
Ai Haber – Türkiyenin Yapay Zeka Haber Portalı
ARAŞTIRMA · PAPERS

Araştırma arşivi

47 makale — arXiv, NeurIPS, ICML, ACL ve Türk üniversitelerinden seçtiğimiz çalışmalar. Her birinin Türkçe özeti, içindekiler ve aihaber okuma görünümü var. Kayıt gerekmez.

47Toplam Makale
0Bu Hafta
9TR Özet Hazır
0🇹🇷 Yerli Yazar
⌕ 1 SONUÇ
28 #01

Nash İnsan Geri Bildiriminden Öğrenme

Rémi Munos, Michal Valko, Daniele Calandriello, Mohammad Gheshlaghi Azar + 13 · 01 Ara 2023

İnsan geri bildiriminden pekiştirmeli öğrenme (RLHF), büyük dil modellerini (LLM'ler) insan tercihleriyle uyumlu hale getirmek için ana paradigma olarak ortaya çıkmıştır. Tipik olarak, RLHF, genellikle önceden eğitilmiş …

arXiv:2312.00886
28UP 28OKUMA