2026-07-20
Xiaomi'nin 100K Saatlik Gerçek Veriyle Eğittiği Robot Modeli
Xiaomi-Robotics-1, 100K saatin üzerinde gerçek dünya verisiyle eğitilen ve görülmemiş ortamlarda doğrudan çalışan temel bir VLA modeli sunuyor.
2026-07-15
Tarım Robotları Artık Gece de Çalışabiliyor
Denetimsiz gündüz-gece görüntü çevirimi, tarım robotlarının karanlıkta güvenle navigasyon yapmasını sağlıyor.
2026-07-08
Memora: Yapay Zeka Ajanları için Ölçeklenebilir Bellek Sistemi
Microsoft'un Memora sistemi, ajan belleğini soyutlama ve özgüllük arasında dengeleyerek %98 daha az token kullanıyor.
2026-07-07
Tek Transdüserle Geniş Alana Yayılan Dokunsal Algı
Metalik ultrason dalga kılavuzları, tek bir transdüserden temas konumu, kuvvet ve malzeme sınıfını aynı anda belirliyor.
2026-07-06
SkillOpt: Ajan Becerilerini Eğitilebilir Parametreye Dönüştürüyor
SkillOpt, model ağırlıklarına dokunmadan ajan talimatlarını optimize ederek yapay zeka ajanlarını daha güvenilir kılıyor.
2026-07-01
VLA Modelleri Fiziksel Akıl Yürütmeyi Kanıtlayamıyor
Yeni pozisyon makalesi, VLA sistemlerinin fiziksel genelleme yaptığına dair iddiaların mevcut değerlendirme protokolleriyle doğrulanamadığını savunuyor.
2026-06-30
Etiketsiz Aktivite Tanıma için Bellek Artırmalı LSTM Otokodlayıcı
IMU sensör füzyonuyla çalışan yeni mimari, etiketli veri olmadan %98'i aşan aktivite tanıma doğruluğu sağlıyor.
2026-06-24
Ajansal Yapay Zeka için Dinamik Kırmızı Takım Platformu: RIFT-Bench
RIFT-Bench, 45 farklı ajansal sistemi tek çatı altında test eden ilk birleşik güvenlik değerlendirme metodolojisi.
2026-06-23
MIT'den Robotlar İçin Mekânsal Bellek Sistemi
MIT'nin DAAAM sistemi, robotların keşfettikleri ortamdaki nesneleri uzun süreli bellekle takip etmesini sağlıyor.
2026-06-22
Hugging Face Hub'dan Fiziksel Robota Tek Ajan Döngüsü
Strands Agents ve LeRobot entegrasyonu, veri setinden gerçek robot donanımına geçişi tek bir ajan döngüsüyle mümkün kılıyor.
2026-06-19
DPO Sohbet Robotlarının Ötesine Geçiyor
DharmaOCR ekibi, DPO'yu OCR'daki metin bozulma hatasını %59 azaltmak için kullandı.
2026-06-18
Dijital İkiz ve RL ile Cerrahi Video Anlama
LLM'ler, dijital ikiz temsilleri üzerinde pekiştirmeli öğrenmeyle eğitilerek cerrahi videolarda çok adımlı akıl yürütme yapabiliyor.
2026-06-16
μ₀: Eylem Etiketi Gerektirmeyen 3D Dünya Modeli
μ₀, piksel yerine 3D yörüngeler tahmin ederek robot öğrenimini gövde bağımsız hale getiriyor.
2026-06-15
PyTorch'ta Profiling: nn.Linear'dan Fused MLP'ye
PyTorch profiling serisinin ikinci bölümü, nn.Linear'dan başlayarak fused MLP oluşturmaya kadar pratik GPU optimizasyon tekniklerini ele alıyor.
2026-06-12
ToolSense: LLM'lerin Araç Bilgisini Denetleyen Teşhis Çerçevesi
ToolSense, LLM'lerin araç kataloglarını gerçekten anlayıp anlamadığını otomatik benchmark'larla sorguluyor.
2026-06-11
SynIB: Çok-Modal Öğrenmede Sinerji için Bilgi Darboğazı
SynIB, modeli tek modaliteden gelen ipuçlarına güvenmek için cezalandırarak çapraz-modal sinerjiyi doğrudan hedefliyor.
2026-06-10
Altı Hizalama Algoritması Mekanistik Olarak Karşılaştırıldı
PPO'dan KTO'ya altı tercih optimizasyonu yöntemi, dil modellerinin iç katmanlarını nasıl yeniden şekillendirdiği ilk kez sistematik biçimde incelendi.
2026-06-09
Tek Videodan Robot El Becerisini Öğrenen Sistem: EgoAERO
EgoAERO, nesne taraması gerekmeden tek bir birinci şahıs videosundan robot manipülasyon politikaları üretiyor.
2026-06-08
AxisGuide: Robot Hareketlerini RGB Görüntülerle Koordinat Sistemine Bağlıyor
AxisGuide, robot manipülasyon politikalarının dağılım kayması altında neden başarısız olduğunu koordinat sistemi tutarsızlığıyla açıklıyor.
2026-06-05
Tek Elde Çok Nesne: Sıralı Kavrama için Diffusion Policy
MoDex, tek bir robotik elin serbest bırakmadan sırayla birden fazla nesneyi kavramasını sağlayan diffusion policy çerçevesi sunuyor.
2026-06-04
Affordance2Action: Robotlar için Gerçek Zamanlı Nesne Etkileşim Tespiti
A2A, karmaşık sahnelerde görev odaklı nesne fonksiyonlarını gerçek zamanlı olarak tespit eden yeni bir benchmark ve öğrenme çerçevesi sunuyor.
2026-06-03
NVIDIA Cosmos 3: Fiziksel AI için Omnimodal Dünya Modeli
NVIDIA'nın Cosmos 3'ü dil, görüntü, video, ses ve eylemleri tek bir transformer mimarisinde birleştiriyor.
2026-06-02
OpenAI Modeli 80 Yıllık Matematik Sorununu Çözdü
OpenAI'ın yapay zeka modeli, Paul Erdős'ün 1940'lardan kalma ünlü matematik problemini ilk kez çözdü.
2026-06-01
NVIDIA Cosmos 3 ile fiziksel AI tek modelde
NVIDIA Cosmos 3, robotik için dünya simülasyonu, fiziksel akıl yürütme ve eylem üretimini tek açık modelde birleştiriyor.
2026-05-30
Bir hastaya iki domuz böbreği ve domuz karaciğeri birlikte nakledildi
Çin'deki ekip, beyin ölümü gerçekleşmiş 53 yaşındaki bir hastaya altı genetik düzenlemeli tek domuzdan iki böbrek ve karaciğeri aynı operasyonda taşıdı.
2026-05-29
DeepMind Gemini Omni'yi tanıttı: tek omurga, çoklu modalite
DeepMind, ses, görüntü, video ve metni tek bir omurga üzerinden işleyen Gemini Omni'yi yayımladı.