industry · product
Müşteri Kaybetmeden Yapay Zeka Ajanı Nasıl Yayına Alınır
Dört aşamalı bir devreye alma: kendi görüşmelerinizden bir test seti kurun, gölge modda çalıştırın, tek bir dar işte yayına alın ve ancak sayılar tuttuğunda kapsamı genişletin.

Yapay zeka ajanını aşama aşama yayına alın ve her aşamanın kapısını takvimdeki bir tarihe değil kanıta bağlayın. Geçmiş görüşmelerden bir test seti kurun, ajanı gölge modda çalıştırın, tek bir dar işte yayına alın, sonra yalnızca sayılar tuttuğunda kapsamı genişletin. Gartner'ın Şubat ve Mart 2026'da 3.566 B2B ve B2C müşterisiyle yaptığı ankette, %87'si bir şirket üretken yapay zeka kullandığında bir insan temsilciye ulaşma seçeneğinin şart olduğunu söyledi; yalnızca %50'si yapay zekanın etkileşimini kolaylaştırdığını belirtti. Kendi verimiz hız konusunda ters yönü işaret ediyor: dokuz ülkedeki 1.247 işletmeden 32.581 görüşmede, 60 saniyenin altında verilen yanıtlar %35,1 oranında dönüşürken bir ila 24 saat süren yanıtlar %7,1'de kaldı. Uzayıp giden bir devreye almanın da bir bedeli var.
Yapay zeka projelerinin neden takılıp kaldığını Çoğu Yapay Zeka Pilotu Neden Üretime Ulaşamaz yazısında ele almıştık. Bu yazı işin diğer yarısı: ajan yapılandırıldıktan ve soru "ona ne zaman söz verelim" haline geldikten sonra gerçekten izlediğiniz sıra.
Bir yapay zeka ajanı hazırlıksız yayına alındığında ne ters gider?
İki tür başarısızlık var ve ikisi de kamuya açık kayıtlarda duruyor.
Birincisi sorumluluk. 14 Şubat 2024'te British Columbia Sivil Çözüm Mahkemesi, web sitesindeki sohbet botunun yanlış anlattığı yas indirimi politikası nedeniyle Air Canada'yı sorumlu buldu. Havayolu, sohbet botunun kendi ifadesiyle "kendi eylemlerinden sorumlu, ayrı bir tüzel kişilik" olduğunu savundu. Mahkeme bunu reddetti ve havayolunun Moffatt'a tazminat ve masraf olarak $812.02 ödemesine hükmetti. American Bar Association'ın dava değerlendirmesi dersi açıkça koyuyor: şirketler, yapay zeka araçlarının müşterilere söylediklerinden sorumlu olmayı sürdürüyor.
İkincisi, yalnızca dışarıdan fark edebileceğiniz kalite kayması. Klarna, Şubat 2024'te yapay zeka asistanının müşteri hizmetleri sohbetlerinin üçte ikisini karşıladığını duyurmuştu. Mayıs 2025'e gelindiğinde şirket yeniden insan temsilci alıyordu; CEO Sebastian Siemiatkowski Bloomberg'e, "bunu kurgularken maliyet ne yazık ki fazlasıyla baskın bir değerlendirme ölçütü olmuş görünüyor, sonuçta elinizde kalan daha düşük kalite oluyor" dedi. Yapay zeka orada hâlâ soruların üçte ikisini karşılıyor. Değişen şey, ona emanet edilen kapsam ve onu geçip bir insana ulaşmanın kolaylığı oldu.
İki şirketin de mühendisi eksik değildi. Eksik olan, "testte çalışıyor" ile "herkese yanıt veriyor" arasındaki aşamaydı.
Aşama 1: Yayına almadan önce hangi görüşmelere karşı test etmelisiniz?
Kendi görüşmelerinize. Gelen kutunuzdan son 90 günü çekin ve ajanın doğru şekilde ele alması gereken gerçek vakalardan sabit bir set kurun; her biri için beklenen davranışı yazıya dökün.
Teradata'nın AgentOps rehberi, her iş akışı için 30 ila 100 gerçekçi görevden oluşan, uç durumları ve olumsuz senaryoları da içeren bir altın set öneriyor: süresi dolmuş anahtarlar ya da yetersiz izinler gibi. Randevu veya satış ajanı için bu, bir kıyaslama testinden hem daha sıradan hem daha işe yarar bir şeye dönüşür.
| Sete ne koymalı | Neden setin içinde olmalı |
|---|---|
| En sık gelen 20 sorunuz, birebir yazıldığı gibi | Hacminizin büyük kısmı bunlar; doğru yanıtlamak temel eşiktir |
| Kamuya açık olarak bilerek yanıtlamadığınız üç soru | Ajanın politika uydurmak yerine yanıt vermeyi geri çevirdiğini doğrular |
| Öfkeyle yazılmış bir iade veya şikâyet mesajı | Üslubu ve tartışmak yerine devredip devretmediğini kontrol eder |
| Mesajın ortasında dil değiştiren bir müşteri | Yalnızca çeviriyi değil, algılamayı test eder |
| Metin yerine bir fotoğraf veya belge | Gerçek gelen kutularının çoğu yalnızca metinden ibaret değildir |
| Politikanızı ihlal eden bir talep (çalışma saatleri dışında bir randevu saati) | Ajan reddetmeli ve gerçek alternatifi sunmalı |
| İlk mesajında insan isteyen biri | Bunun tek bir doğru yanıtı var |
Her vakayı, hayalinizdeki ifadelere göre değil, yazdığınız davranışa göre puanlayın. Cümleleri farklı kuran ama doğru randevuyu alan bir ajan geçmiştir. Kulağa kusursuz gelip politika uyduran bir ajan kalmıştır ve Air Canada mahkemesinin fiyat biçtiği şey tam olarak budur. Seti saklayın: talimatlarda her değişiklikten sonra yeniden çalıştırırsınız ve asıl değerini ikinci çalıştırmada gösterir.
Aşama 2: Gölge mod, bir demonun gösteremediği neyi gösterir?
Gölge mod şu demek: ajan gelen canlı mesajları okur ve kimsenin göndermediği bir yanıt taslağı hazırlar. Ekibiniz her zamanki gibi yanıtlar. Her günün sonunda ikisini karşılaştırırsınız.
Bu, hiçbir test setinin ulaşamadığını yakalar, çünkü test setinizi işi zaten bilen biri yazdı. Gerçek müşteriler ise yarım bir ürün adıyla, bir ekran görüntüsüyle, gece 11'de gelen bir sesli notla ve iade politikanız hakkında daha önce hiç duymadığınız bir varsayımla gelir. Teradata'nın rehberi tam da bu yüzden gölge modu kanarya sürümünün önüne koyuyor: önce insan iş akışının yanında sessizce çalıştırın, sonra küçük bir kitleye açın, sonra genişletin.
Dürüst bir uyarı: gölge mod bedava değil. Taslakları birinin okuması gerekir; kimse okumazsa bir haftalık gecikme eklemiş ve hiçbir şey öğrenmemiş olursunuz. Beş gün boyunca günde bir saat ayırın ve bu işi en çok mesaj yanıtlayan kişiye verin. O kişi, aynı dökümü okuyan bir yöneticinin kaçıracağı yanlış bir yanıtı iki saniyede fark eder.
Gölge mod zamanlama konusunda da size bir şey söylemez. Kuyrukta bekleyen bir taslağın yanıt hızı yoktur; bu yüzden 40 dakika yerine 40 saniyede yanıt vermenin etkisi Aşama 3'e kadar görünmez kalır.
Aşama 3: İlk canlı başlangıç ne kadar dar olmalı?
Zahmete değer gibi hissettirenden daha dar. Tek kanal, tek soru türü, tek zaman aralığı.
Kimsenin karşılamadığı saatlerle başlayın. Gece ve hafta sonu mesajları yayına almak için en güvenli yerdir, çünkü dürüst karşılaştırma "yapay zekaya karşı en iyi temsilciniz" değil, "yapay zekaya karşı pazartesi günü gelen bir yanıt"tır. Yanıt hızı çalışmamızdaki dönüşüm farkı tam da orada, aksi halde biri gelen kutusunu açana kadar bekleyecek olan mesajda en geniş halini alıyor. Mesai dışı aralık, aşamalı bir başlangıcın kendini anında amorti ettiği ve en az risk aldığı yerdir.
Bu aşamada üç şeyi sonuna kadar açık tutun:
- İnsana devir. Bir insan talebi geldiği anda devir gerçekleşir, önce eleyici sorular sorulmaz.
- Görünürlük. Her görüşme, ekibinizin zaten izlediği aynı gelen kutusuna düşer; böylece kötü bir diyalog aylık bir incelemede değil, dakikalar içinde yakalanır.
- Kapatma düğmesi. O kanalda yapay zeka yanıtlarını kimin kapatabileceğini bilin ve ihtiyacınız olmadan önce bunu bir kez yaptığını doğrulayın.
Aşama 4: Kapsamı genişletmenize hangi kanıt izin vermeli?
Kapıları yayından önce, hâlâ serinkanlıyken belirleyin. Bir hafta canlı kaldıktan sonra, gözle görülür bir şey bozulmadığı için genişletme isteği doğar; oysa "gözle görülür bir şey bozulmadı" bir ölçüm değildir.
| Sinyal | Nereye bakmalı | Ne zaman genişletmeli |
|---|---|---|
| Doğruluk | Aşama 1 test setinizi yeniden çalıştırın | Reddetme vakaları dahil hâlâ geçiyorsa |
| Devir kalitesi | Bir insanın devraldığı görüşmeler | Devir üç mesaj geç değil, doğru anda gerçekleşiyorsa |
| Müşteri tepkisi | Yapay zeka mesajından sonra gelen yanıtlar | "Bu bir bot mu" sorularında veya tekrarlanan sorularda artış yoksa |
| İş sonucu | Randevular, siparişler, yakalanan potansiyel müşteriler | Tamamlanan işlem, sohbette anlaşılanla örtüşüyorsa |
| Şikâyetler | Normal şikâyet kanalınız | Sabit seyrediyorsa ve gelenleri okuduysanız |
Tek seferde tek bir değişkeni genişletin: ya bir kanal ekleyin, ya bir niyet ekleyin, ya da saatleri uzatın. İkisini birden değiştirirseniz kalitedeki bir düşüş size nedeni hakkında hiçbir şey söylemez.
Asla aşamalandırmadığınız tek şey: insana giden yol
Diğer bütün kontroller kademeli olarak devreye alınabilir. Bu, birinci gün, tam gücüyle yayına girer.
Buradaki uçurum iyi belgelenmiş durumda. Zoom'un Morning Consult ile yaptığı, yedi ülkede 3.500 yetişkini kapsayan araştırması, tüketicilerin %81'inin botların gerektiğinde bir insana devretmesini beklediğini, yalnızca %38'inin bunun gerçekten olduğunu söylediğini buldu. Aynı çalışma, sohbet ve ses botlarıyla ilgili en büyük şikâyetin %43 ile sorunu çözememeleri olduğunu, %82'nin ise yanlış veya tatmin etmeyen bir çözümün ardından bir markadan alışverişi keseceğini ortaya koydu.
Gartner analisti Eric Keller tasarım kuralını doğrudan koyuyor: "Hizmet liderleri üretken yapay zekayı her sorun için zorunlu bir ilk adım olarak kullanmamalı." Müşteriler bir insana ulaşmadan önce birkaç başarısız yapay zeka denemesinden geçirildiğinde, o aracı bir daha kullanma olasılıkları düşüyor.
Bu yüzden insana devir yolunu bir yangın çıkışını test eder gibi test edin. Beş farklı ifadeyle, biri başka bir dilde olacak şekilde insan isteyin ve her birinin, o ana kadar konuşulanları görebilen bir kişiye ulaştığını doğrulayın.
Aşamalı devreye almanın çözmediği şey
Zayıf bir bilgi tabanını kurtarmaz. Çalışma saatleriniz üç ayrı yerde yanlışsa ve iade politikanız yalnızca işletme sahibinin kafasında yaşıyorsa, her aşama aynı boşluğu sadakatle önünüze koyar; çözüm devreye alma işi değil, içerik işidir. Yapay Zeka Ajanınızı Kendi İşletme Bilginizle Nasıl Eğitirsiniz o tarafı ele alıyor.
Ayrıca zaman maliyeti var ve o zaman bedava değil. Dört haftalık bir devreye alma, pahalı olduğunu zaten bildiğiniz dört haftalık geç yanıt demektir. Aşamaları atlamak yerine kısaltın: yoğun bir gelen kutusunda üç günlük gölge mod, sakin bir kutuda geçen üç haftadan daha çok şey öğretir. Ve hiçbiri zayıf bir teklifi dönüşen bir teklif haline getirmez.
Entagl bu resmin neresinde
Entagl Receptionist; WhatsApp, Instagram DM'leri ve yorumları, Facebook Messenger, Telegram, web sitesi sohbet aracı, işletmenin mevcut posta kutusundan yönlendirilen e-posta ve açık bir API üzerinden yanıt verir. Aşamalı devreye alma burada pratiktir, çünkü yapay zeka yanıtları kanal bazında zamanlanır ve açılıp kapatılır, tek bir görüşmede duraklatılabilir; böylece "tek kanal, tek niyet" bir çözüm yolu değil, bir ayardır.
Devir, insanın görüşmenin tamamını (ajanın daha önce verdiği sözler dahil) gördüğü ortak bir ekip gelen kutusuna gider. Çıktı güvenlik önlemleri yanıtlar gönderilmeden önce çalışır ve her diyalog, kapsamı genişletip genişletmeyeceğinize karar verirken yeniden okuyabileceğiniz bir döküm olarak saklanır. Ajan müşterinin dilini algılar ve o dilde yanıt verir, 100'den fazla dilde, görüşmenin ortasında dil değiştirerek. Bir dil değişiminin üretimde değil test setinizde yer almasının nedeni de bu.
Geçmişteki en kötü on görüşmenizi 30 dakikalık bir demoya getirin ve ajanın onlarla ne yaptığını izleyin. Demo ayırtın.
SSS
Bir yapay zeka ajanı gölge modda ne kadar kalmalı?
Temsil gücü olan bir haftayı, en yoğun ve en sakin gününüz dahil, kapsayacak kadar. Yüksek hacimli bir gelen kutusunda bu üç gün olabilir; haftada yirmi mesaj alan bir işletmede ise bir aya yakındır, çünkü önemli olan takvim değil örneklemdir. Yeni dökümler sizi şaşırtmayı bıraktığında durun.
Platformu satıcı zaten test ettiyse test setini atlayabilir miyim?
Hayır, çünkü satıcı modeli test etti; sizin test etmeniz gereken ise kendi işiniz. Paraya mal olan hata biçimleri sizin politikalarınıza, saatlerinize ve sohbet üzerinden konuşmayı reddettiğiniz ürünlere özgüdür. Bir satıcı kıyaslaması, belirli bir hizmet için asla fiyat vermediğinizi bilemez.
Yapay zeka emin olmadığında ne yapmalı?
Netleştirici bir soru sorsun ya da insana devretsin; boşluğu kulağa makul gelen bir tahminle asla doldurmasın. Bunu yayından önce kararlaştırmak, bütün devreye alma sürecindeki en değerli tek saattir. Mekaniğini Yapay Zeka Ajanınızın Halüsinasyon Görmesini Nasıl Durdurursunuz yazısında anlattık.
Aşamalı devreye alma sesli ajanlar için de geçerli mi?
Evet, tek bir değişiklikle: bir telefon ajanını sessiz gölge modda çalıştıramazsınız, çünkü incelenecek bir taslak yoktur. Bunun yerine aynı senaryo setine karşı kayıtlı test çağrıları yapın, ardından mesai dışı taşma gibi dar bir aralıkta yayına alın. Yapay Zekâ Telefon Asistanı Nasıl Değerlendirilir ve Test Edilir? çağrıya özgü senaryoları içeriyor.
Zaten elinizde olan görüşmelerle başlayın
Test seti, çoğu ekibin atladığı ve sonraki her aşamayı karara bağlanabilir kılan parçadır. Kendi gelen kutunuzdan alınmış, her birinin yanına doğru davranışı yazılmış kırk gerçek görüşme, "iyi gibi görünüyor mu" sorusunu her değişiklikten sonra yeniden kontrol edebileceğiniz bir sayıya çevirir. Tek bir ayarı bile değiştirmeden önce onları çekin.
Kaynaklar: Gartner müşteri anketi, Ağustos 2026 (3.566 müşteri, Şubat ve Mart 2026'da sahada); Zoom ve Morning Consult, "AI alone won't save CX. Resolution will.", Temmuz 2025 (3.500 yetişkin, yedi ülke); Moffatt v. Air Canada, British Columbia Sivil Çözüm Mahkemesi, Şubat 2024; Klarna hakkında CX Dive haberi, Mayıs 2025; Teradata AgentOps rehberi, Kasım 2025; Entagl Response Velocity Study 2026.