Bu hafta
GPU + LLM çiftini kapatmak
Kernel atlasının runtime atlasıyla buluştuğu yer. CUDA bellek trafik örüntülerini okuyor ve bir sonraki GPU atlas bölümünü doğru model bağlamıyla, yalnız değil, vLLM PagedAttention ile eşleştirerek hazırlıyorum.
Güncellendi · 34. hafta
Kısa, tarihli, küratörlük olmayan bir not. Buradaki amaç dikkatimin bu hafta nereye aktığı ve bu ay ne inşa ettiğimi göstermek. Listelenen bir şey sende yankı uyandırırsa ya da not alışverişi yapmak istersen, bana yaz.
Bu hafta
Kernel atlasının runtime atlasıyla buluştuğu yer. CUDA bellek trafik örüntülerini okuyor ve bir sonraki GPU atlas bölümünü doğru model bağlamıyla, yalnız değil, vLLM PagedAttention ile eşleştirerek hazırlıyorum.
Bu ay
Genel atlas haritasını düz bir dizinden, ana sayfada gördüğün öğrenme sistemine dönüştürüyorum: çalışma sırası, üç paralel rota (donanım, servis, eğitim) ve birleşim adımı. Bu /now sayfası o döngünün bir sonraki parçası.
Uzun vadeli odak
Makine mühendisliğinden yapay zekâ mühendisliğine uzanan ortak şu: "kararı gerçek bir kişinin uygulayacağı". Her atlas ve her defter, endüstriyel zekâı okunabilir, denetlenebilir ve işletilebilir kılma denemesi — sadece doğru değil.
/now yayınlandı ve ana sayfa footer'ından bağlandı.
Yukarıdakilerden biri üzerine not alışverişi yapmak ister misin?
Bana yaz