<

2024 Bilançosu: Agent'lar Kapıda, Standartlar Oturuyor

Geçen hafta ofiste yıl sonu retrosu yaptık; beyaz tahtaya iki sütun çizdik: "2023'te konuştuklarımız" ve "2024'te yaptıklarımız". İlk sütun demo ve heyecan doluydu; ikincisi üretime alınmış sistemlerle. Tahtanın özeti tek cümleye sığıyor: 2023 "yapay zeka ne yapabiliyor?" yılıydı; 2024 "peki bunu sistemlerimize nasıl entegre ederiz?" yılı oldu.

Yıl biterken sektöre ve kendi defterimize dürüst bir bakış atalım istedik. Pazarlama diliyle değil — sahada bir yılı gerçekten nasıl geçirdiysek öyle.

Modeller güçlendi, ama asıl olgunlaşma çevrede yaşandı

Model tarafında yıl elbette hareketliydi; mart ayında çıkan Claude 3 ailesi bunun en net kanıtıydı ve biz de o günden beri üç kardeşi — Opus, Sonnet, Haiku — farklı işlerde koşturuyoruz. Ama yılın asıl hikâyesi bence modellerin kendisi değil, çevrelerindeki katmanların oturması oldu.

RAG bunun en iyi örneği: 2023'te konferans sunumlarında anlatılan bu mimari, 2024'te "kurumsal bilgi asistanı nasıl kurulur?" sorusunun sıradan cevabı hâline geldi. Vektör veritabanları, parçalama stratejileri, hibrit arama — hepsi deneysellikten çıkıp mühendislik pratiğine dönüştü. Yapılandırılmış çıktı ve araç çağırma (tool use) da benzer yol yürüdü: yılın başında ayırt edici özellikken, sonunda her ciddi modelin temel donanımı sayılıyor. Ve yıl tam kapanırken kasım sonunda Anthropic, MCP ile entegrasyon tarafına bir standart tohumu attı — o duyuru hakkında yazdığımız yazı, blogun en çok okunanlarından oldu.

Bir eğilim daha, faturalarda görünen cinsten: birim maliyetler yıl boyunca aşağı, bağlam pencereleri yukarı gitti. Geçen yıl "bütçeyi yakar" diye elenmiş birkaç fikri bu yıl aynı müşterilerle yeniden hesapladık ve rahatlıkla yeşile döndüklerini gördük. Yapay zeka fizibilitesi, raf ömrü altı ay olan bir belgedir; bir kez "pahalı" damgası yiyen fikirleri arada bir tozunu alıp yeniden hesaplamakta fayda var.

Metin üreten modelden iş yapan modele

Yılın en önemli zihniyet değişimi bu satırda saklı. 2023'ün modeli soruya cevap yazan bir metin kutusuydu; 2024'ün modeli API çağırıyor, veritabanı sorguluyor, dönen sonucu değerlendirip bir sonraki adıma kendisi karar veriyor. Sektörün bu davranışa taktığı isim "agent" ve başlıktaki iddiamız da bu: agent'lar henüz her yerde değil, ama kapıda.

Kapıda olmakla içeride olmak arasındaki farkı da sahada gördük. Kontrollü, dar tanımlı görevlerde — "şu irsaliyeyi oku, veriyi çıkar, kayda geç" gibi — zincirleme adımlar gayet güvenilir çalışıyor. Ucu açık görevlerde ise modeller hâlâ tökezliyor, döngüye giriyor, kendinden emin biçimde yanlış yola sapıyor. 2025'in mühendislik sorusu modelin zekâsından çok şu olacak: hata yaptığında zararı sınırlı kalacak şekilde agent'ı nasıl kafesleriz?

Kendi kafes tarifimiz şimdilik dört parmaklıktan oluşuyor: agent'ın kullanabileceği araçlar açık bir listeyle sınırlı, her aracın yetkisi görevin gerektirdiği asgaride, adım sayısına ve harcamaya tavan konmuş, geri alınamaz her işlem insan onayına bağlı. Kulağa temkinli geliyorsa, öyle — dağıtık sistemlerden öğrendiğimiz dersin aynısı burada da geçerli: özerklik, ancak sınırları çizilebildiği kadar hayırlıdır.

Küçük modellerin sessiz zaferi

Yılın az konuşulan ama faturalara en çok yansıyan eğilimi: her iş büyük model istemiyor. Haiku sınıfı küçük ve hızlı modeller, sınıflandırma, etiketleme, özetleme gibi yüksek hacimli işleri kuruş mertebesine indirdi. Bizim projelerde artık standart mimari model katmanlaması: istek önce ucuza gider, gerekirse pahalıya yükselir. Bu desenin yaygınlaşması, "yapay zeka pahalı" itirazını yıl içinde büyük ölçüde eritti — doğru kurgulanmış bir akışta maliyet, çoğu yöneticinin tahmininin çok altında çıkıyor.

Güvenlik sorusu yer değiştirdi

2023'ün güvenlik sohbeti "model yanlış bilgi verirse?" etrafındaydı. 2024'te soru olgunlaştı ve yer değiştirdi: prompt injection ile modelin kandırılması, bağlanan veri kaynaklarından sızıntı, aşırı yetkili entegrasyonlar. Model artık sistemlere dokunduğuna göre, "yapay zekaya hangi yetkileri veriyoruz ve kim denetliyor?" sorusu bir uyumluluk maddesi hâline geliyor. Tahminimiz net: bu soru 2025'in ana güvenlik gündemi olacak — ve buna hazırlanan işletmeler, panikleyenlerin epey önüne geçecek.

Bu başlığın somut hâline bu yıl bir kez tanık olduk: incelediğimiz bir kurulumda, yalnızca kayıt okuyup özetlemesi gereken asistana kolaylık olsun diye yazma yetkili bir servis hesabı verilmişti. Kimse kötü niyetli değildi ve kaza da olmadı; ama "olmadı" ile "olamazdı" arasındaki fark, güvenliğin ta kendisi. Yetkiyi görev tanımına göre budamak yarım saat sürdü. Bu yarım saatlik işlerin hâlâ istisna değil kural olması gerektiğini 2025 boyunca çok tekrarlayacağız gibi.

Bizim defterimiz ve 2025 planı

Kendi yılımıza gelince, tahtadaki "yaptıklarımız" sütununda şunlar vardı: irsaliye ve fatura görsellerinden veri çıkaran akışları üretime aldık (mart yazımızın pilotu artık gerçek hacimle çalışıyor), iki müşteri için RAG tabanlı iç bilgi asistanı kurduk ve aralıkta ilk deneysel MCP sunucumuzu yazdık. Üçü de bir yıl önce tahtanın "konuştuklarımız" sütunundaydı; bu geçiş, bizim için yılın asıl bilançosu.

Dürüstlük payı olarak yanıldığımız yeri de yazalım: yılın başında agent'ların üretime bu yıl içinde daha geniş gireceğini düşünüyorduk. Girmedi; modeller uzun görevlerde beklediğimizden daha kırılgan çıktı, ekosistem araçları da ancak yıl sonuna doğru olgunlaşmaya başladı. Tahminde yanılmak bu işin doğası — yanıldığını yazmamaksa tercih. Biz yazmayı seçiyoruz; gelecek aralıkta bu paragrafın hesabını yine burada veririz.

Müşteri tarafındaki değişim de kayda değer: yılın başında gelen soru çoğunlukla "biz de bir chatbot yapalım mı?" idi; yıl sonunda "şu süreçteki evrak işini otomatikleştirebilir miyiz?" hâlini aldı. İlki teknoloji merakı, ikincisi iş sorusu — ve bu olgunlaşma, bizim açımızdan modellerdeki her benchmark artışından daha kıymetli bir gösterge.

İçeride de buna göre pozisyon aldık: her cuma yarım saatlik bir paylaşım seansımız var — o hafta kim neyi denedi, ne çalıştı, ne duvara tosladı. Gösterişsiz bir ritüel ama yılın sonunda dönüp bakınca, ekipçe öğrenme hızımızın asıl motoru buymuş. Bu alan bireysel merakla takip edilemeyecek kadar hızlı akıyor; yük ekipçe bölüşülünce taşınabilir hâle geliyor.

2025 planımız iki başlık: MCP ekosistemini yakından izlemek — gerekirse müşterilerimiz için sunucular yazarak — ve agent mimarilerini kontrollü senaryolarda üretime taşımak. Öngörümüzü de tek cümleye sıkıştıralım: "yapay zekanız var mı?" sorusu yerini "yapay zekanız sistemlerinize bağlı mı?" sorusuna bırakacak.

Bu dönüşümü kendi işletmeniz için planlamak istiyorsanız yeni yılda bir tanışma görüşmesi ayarlayalım. Okuyan herkese sağlıklı, sakin ve bol deploy'lu bir yıl dileriz — bizden bu kadar, 2025'te görüşürüz.

📅 Yayınlanma:  ·  Yakup Zengin