Azure Content Understanding Ağustos 2026: CU 1.0 GA ve CU
Azure Content Understanding (CU), kurumsal içeriği yapay zeka uygulamaları ve ajanlar için yapılandırılmış, kaynağa dayalı veriye dönüştüren bir Foundry hizmeti. Ağustos 2026 güncellemesiyle iki paralel yol duyuruldu: üretim iş yükleri için yenilenen CU 1.0 GA API ve yeni nesil belge anlama senaryoları için CU 2.0 public preview. Bu yazıda her iki sürümün getirdiği yenilikleri ve hangi durumda hangisini seçmek gerektiğini kaynaktaki bilgilere sadık kalarak özetliyorum.
İki API, iki farklı amaç
Microsoft, Content Understanding’i tek bir sürüm halinde ilerletmek yerine iki hattı bir arada tutuyor:
- CU 1.0 (2025-11-01, GA): Üretim iş yükleri için genel kullanıma açık. GPT-5 serisine genişletilmiş destek, daha verimli grounding ve yenilenen güven skoru modeli getiriyor.
- CU 2.0 (2026-06-01-preview): Senkron Read/Layout API’ları, Advanced Contextualization, semantik parçalama, geliştirilmiş sınıflandırma, yeni prebuilt analizörler ve agentic mode gibi yeni yapı taşlarını içeren public preview.
Yaklaşım net: Bugünkü üretimi CU 1.0 GA ile iyileştirin, yarının senaryolarını CU 2.0 preview üzerinde değerlendirin.
CU 1.0 GA: Üretim için ekonomi ve güvenilirlik
Genişletilmiş GPT-5 serisi desteği
Content Understanding analizörleri artık GPT-5 model serisinin tamamıyla çalışabiliyor: GPT-5.5, GPT-5.4, GPT-5.3, GPT-5.2, GPT-5.1 ve GPT-5; her biri standart, mini ve nano varyantlarında kullanılabiliyor. Bu genişleme, doğruluk, gecikme ve maliyet arasında farklı öncelikleri olan iş yüklerinin aynı analizör modeli ve API kalıpları üzerinde değerlendirilmesine imkan tanıyor. Mevcut PTU taahhütleri de kullanılmaya devam edebiliyor.
Daha verimli grounding
GA yenilemesinde çıkarım (extraction) ile grounding daha etkin biçimde birleştirildi. Microsoft’un iç değerlendirmelerine göre bu değişiklik, GPT-4.1 ve GPT-5.2 için ortalama çıkarım token kullanımını en fazla yüzde 28’e kadar düşürürken ortalama doğruluğu da yüzde 3’e kadar artırdı. Yüksek hacimli çıkarım akışlarında hem maliyet düşüyor hem de kaynak içeriğe izlenebilirlik, ek son işleme (post-processing) mantığı yazmadan korunuyor.
Yenilenen güven skoru modeli
Confidence modeli de yenilendi. İç değerlendirmelerde AUROC ile ölçülen doğruluk, GPT-4.1 ve GPT-5.2 için yüzde 14’e kadar iyileşti. Güven skorları; hangi belgenin otomatik geçeceğine, hangisinin insan denetimine yönlendirileceğine veya ek doğrulama gerektireceğine karar veren üretim otomasyonlarının temel girdisi. Daha güçlü bir güven modeli, hem verimli hem denetlenebilir hatlar kurmayı kolaylaştırıyor.
CU 2.0 preview: AI uygulamaları ve ajanlar için yeni yapı taşları
CU 2.0 preview iki geliştirici önceliğini hedefliyor: İçerik hatlarının kalitesini ve verimliliğini artırmak, ayrıca düşük gecikmeli ve akıl yürütme yoğun yeni senaryoları mümkün kılmak. Preview de GPT-5 serisini destekliyor; bu, GA hattına geçişi planlamayı kolaylaştırıyor çünkü aynı model yönü üzerinden doğruluk, gecikme ve maliyet karşılaştırılabiliyor.
Advanced Contextualization
Advanced Contextualization, özel analizörlerin etiketli örnekleri ve belge bilgisini daha verimli kullanmasını sağlıyor. İç değerlendirmelerde ortalama doğruluk yüzde 3,5’e kadar artarken ortalama LLM token kullanımı yüzde 22’ye kadar azaldı. Eğitim verisi analizöre kopyalanmıyor; müşterinin Azure Storage hesabında bir bilgi kaynağı olarak kalıyor, böylece veri yönetişimi müşteride kalmaya devam ediyor.
Aynı yaklaşım yeni prebuilt analizörlerde de kullanılıyor. Bu analizörlerde Advanced Contextualization, LLM token tüketimini yüzde 99’a kadar azaltabiliyor; yüksek hacimli, maliyete duyarlı senaryolar için bu oran belirleyici.
Vergi odaklı yeni prebuilt analizörler
Preview ile birlikte gelen yeni prebuilt vergi analizörleri, bireysel formların ötesine geçerek kurumsal ve eyalet düzeyinde vergi akışlarını kapsıyor: 1065, 1120-S, 8865, 1041 Schedule K-1 ve Minnesota State M1. Bu analizörler çok sayfalı karmaşık düzenleri destekliyor; bazı çıkarım senaryolarında hiç LLM token’ı harcanmıyor. Content Understanding Studio ve Microsoft Foundry üzerinden değerleri görsel olarak doğrulamak, bounding box’ları incelemek ve güven skorlarını üretime almadan önce gözden geçirmek mümkün.
prebuilt-documentSearch için semantik parçalama
Retrieval kalitesi, içeriğin nasıl parçalandığına doğrudan bağlı. Sabit boyutlu chunking; tabloyu başlığından, ilişkili paragrafları birbirinden veya çok sayfalı bir yapıyı anlamlı bütününden koparabiliyor. CU 2.0 preview’daki semantik parçalama, karakter sayısı veya sayfa sınırı yerine belge yapısını kullanarak daha anlamlı retrieval birimleri oluşturuyor. Cümleler ve paragraflar arasındaki bağlamı ve anlamsal ilişkileri koruduğu için özellikle RAG ve agentic retrieval senaryolarında değerli.
Sınıflandırmada sayfa içi bölme ve güven skoru
Gerçek kurumsal gönderiler her zaman sayfa sınırlarına oturmuyor: Bir kredi paketi, vergi gönderimi veya taranmış dosyada tek fiziksel sayfa birden fazla mantıksal belgeyi içerebiliyor. CU 2.0 preview, sınıflandırmaya in-page splitting ekleyerek belge segmentlerini bütün sayfadan daha ince bir granülerlikte tanımlayabiliyor. Bölme (splitting) ve sınıflandırma için güven skorları da sunuluyor; uygulamalar bu sinyallere göre otomatik yönlendirme, alt analizöre iletme veya insan denetimine gönderme kararı verebiliyor.
Layout analizöründe imza tespiti ve metadata çıkarımı
Sınıflandırma bir belgenin ne olduğunu belirlerken Layout analizörü içindekileri yakalıyor. Bu preview ile Layout artık imza tespiti ve belge metadata çıkarımı özelliklerine de sahip. İmza tespiti; sözleşmeler, formlar, faturalar ve imzalı gönderimlerde imza bölgelerini ve konumlarını belirlemeye yardımcı oluyor. Metadata çıkarımı ise yazar, başlık, oluşturma tarihi, içerik türü ve dil gibi belge özelliklerini yüzeye çıkarıyor. Bölümler, başlıklar, biçimlendirme, tablolar, figürler, hyperlink’ler ve açıklamalar gibi mevcut yapı çıkarımıyla birlikte kullanıldığında tek analizörden daha bütüncül bir belge temsili elde ediliyor.
Yeni senaryolar: Senkron API’lar ve agentic mode
Read ve Layout için senkron operasyonlar
Bir müşteri etkileşimi sırasında AI ajanını grounding etmek, kimlik belgesini doğrulamak veya dosya gönderildiğinde bir iş akışını tetiklemek gibi senaryolar anlık yanıt gerektiriyor. CU 2.0 preview, Read (prebuilt-read) ve Layout (prebuilt-layout) analizörleri için senkron operasyonlar ekliyor. Yapılandırılmış sonuçlar doğrudan yanıt içinde dönüyor; belgeler binary olarak veya URL üzerinden gönderilebiliyor ve servis tarafında geçici depolama olmadan işleniyor.
Karmaşık alan çıkarımı için agentic mode
Senkron API’lar daha hızlı yanıt için, agentic mode ise daha derin akıl yürütme için tasarlandı. Bazı çıkarım görevleri tek geçişte tamamlanamıyor; cevap belgenin farklı bölümlerine yayılmış kanıtlara, karşılaştırmalara veya ara sonuçlar üzerinden yeniden akıl yürütmeye bağlı olabiliyor. Agentic mode, analizör şeması ile çalışıp yinelemeli bir çıkarım akışı uyguluyor: İlgili içeriği tespit ediyor, değerleri çıkarıyor, ara sonuçları değerlendiriyor ve nihai çıktıyı rafine ediyor. Uzun hukuki sözleşmeler, finansal başvurular veya sigorta kayıtları gibi kanıtın dağınık olduğu senaryolar için uygun.
Ek akıl yürütme, standart çıkarıma göre gecikme ve token tüketimini artırabildiği için Microsoft, agentic mode’un temsili belgeler üzerinde değerlendirilmesini ve beklenen kalite kazancının ek maliyeti karşıladığı durumlarda kullanılmasını öneriyor.
Hangi yolu seçmeli?
Karar aslında iş yükünüzün bugünkü ihtiyacına göre şekilleniyor:
- Mevcut üretim akışlarını iyileştirmek, GPT-5 serisine geçmek, grounding verimliliğinden ve yenilenen güven modelinden yararlanmak istiyorsanız CU 1.0 GA API.
- Senkron Read/Layout, Advanced Contextualization, semantik parçalama, yeni prebuilt analizörler, geliştirilmiş sınıflandırma ve agentic mode’u denemek istiyorsanız CU 2.0 public preview.
Her iki yolu da Content Understanding Studio veya Microsoft Foundry üzerinden keşfetmek mümkün; prebuilt analizörler, özel analizörler ve yapılandırılmış çıktılar buradan denenebiliyor.
Kaynaklar ve İleri Okuma
- Orijinal duyuru: What’s new in Azure Content Understanding – August 2026 (Microsoft Foundry Blog)
- Azure Content Understanding GPT-5 Series Guide: Model Selection, Grounding Improvements, and Confidence Enhancements
- Analyzer improvements ve eğitim verisi yönetimi
- Prebuilt analyzers dokümantasyonu
- Classification geliştirmeleri
- Layout analyzer dokümantasyonu
- Azure Content Understanding Synchronous Operations duyurusu
- Content Understanding Studio
- Azure Content Understanding ile Belgeleri Akıllı İş Akışına Çevirmek
- Microsoft Foundry Haziran 2026: Haziran’da Ne Değişti?







Yorum gönder