İş yerinde yapay zekâdaki önemli değişim, bir modelin daha iyi bir paragraf yazabilmesi değil. Önemli olan, bir sistemin giderek daha fazla birkaç adım boyunca bir hedefin peşinden gidebilmesi: dosyaları incelemek, bağlı hizmetlerde arama yapmak, bir çıktı oluşturmak, bir kaydı güncellemek ve bir mesaj göndermek.
Bu, profesyonel açıdan sorulan soruyu “Bu yanıt doğru mu?”dan “Benim iznimi istemesi gerekmeden önce bu sistemin neler yapmasına izin var?”a dönüştürüyor.
Zapier, ChatGPT Work’ü dosyalar ve bağlı uygulamalarla uzun süreler boyunca çalışabilen aracılı bir mod olarak tanımlarken Plan modu, yürütmeden önce onaylanacak bir strateji öneriyor. Microsoft da benzer şekilde Copilot’u, kurumsal bilgiyi ve yönetişimi operasyonel bir yapay zekâ yığınının tamamlayıcı parçaları olarak çerçeveliyor. Bu örnekler pratik bir ayrıma işaret ediyor: Yapay zekâ bir sohbet ortağından görev devredilen bir operatöre dönüşüyor.
Görev devri zaman kazandırabilir, ancak sorumluluğun biçimini de değiştirir. Bir sohbet robotu genellikle bir kişinin incelemesi için bir çıktı üretir. Bir aracı, bazılarını sonradan fark etmenin zor olduğu birden fazla ara eylem gerçekleştirebilir. Bu nedenle en güvenli benimseme stratejisi azami özerklik değildir. Açık ve kademeli yetkidir.
İstemleri değil, eylemleri düşünün
Yararlı bir ilk adım, bir yapay zekâ sisteminin bir iş akışında gerçekleştirebileceği eylemleri listelemektir. “Müşteri kabul sürecini yönetmek” yönetişim için fazla geniştir. Daha yararlı bir envanter şunları içerebilir:
- dâhili bir politikayı okuyup gereklilikleri çıkarmak;
- onaylanmış bir bilgi tabanında arama yapmak;
- bir e-posta veya sözleşme özeti taslağı hazırlamak;
- bir destek kaydı veya elektronik tablo satırı oluşturmak;
- bir müşteri ya da finans kaydını değiştirmek;
- bir kullanıcıyı davet etmek, bir belgeyi yayımlamak veya dışarıya bir mesaj göndermek;
- bir ödemeyi onaylamak, verileri silmek veya kuruluş adına bir taahhütte bulunmak.
Her eylem; geri döndürülebilirlik, hassasiyet, dış etkiler ve maliyet açısından farklı bir bileşime sahiptir. Bunların hepsini “yapay zekâ desteği” olarak ele almak, asıl kararı gizler.
Bir insanın her şeyi denetleyeceğine dair belirsiz bir vaatten daha pratik olan, basit bir sınıflandırmadır:
- Yapabilir: açıkça sınırlandırılmış bir çalışma alanı içindeki düşük riskli, geri döndürülebilir eylemler.
- Önermek zorunda: ortak çalışmayı değiştiren, dışarıyla iletişim kuran veya anlamlı bir taahhüt oluşturan eylemler.
- Tek başına asla yapmamalı: mevzuata tabi kararlar, geri döndürülemez silme işlemleri, yüksek değerli transferler, erişim denetimi değişiklikleri veya hassas personel meselelerini içeren eylemler.
BAE’nin hükümetin aracılı yapay zekâ programı, ilgili bir politika örneği sunuyor: program, aracıların hangi görevleri tamamlayabileceğini ve hangilerini yalnızca önerebileceğini belirlemeye yönelik kurallar içeriyor. Temel fikir, bireysel bir ekibe de kolayca aktarılabilir: izin, sistem yalnızca yetkin göründüğü için verilmemeli; göreve bağlı olmalıdır.
Sonuçların değiştiği yerlerde onay kapıları kullanın
Her adım bir onay penceresini hak etmez. Bir sistem her dosya okumasından sonra onay isterse insanlar mekanik biçimde onay verir veya bu denetimi devre dışı bırakır. Kapıyı, sonuç doğuran geçişin hemen önüne koyun.
Örneğin bir aracı, kesintiye uğramadan bilgi toplamasına, seçenekleri karşılaştırmasına ve bir taslak hazırlamasına izin verilebilir. Şu eylemlerden önce duraklamalıdır:
- kuruluş dışına herhangi bir şey göndermek;
- bir belgeyi yeni bir kitleyle yayımlamak veya paylaşmak;
- doğruluk kaynağı olan bir kaydı değiştirmek;
- para harcar veya indirim tanımlar;
- izinleri değiştirir veya kimlik bilgileri oluşturur;
- verileri siler, üzerine yazar veya dışa aktarır;
- istihdamı, uygunluğu, krediyi, güvenliği veya yasal hakları etkileyen bir karar verir.
Onay talebi, önerilen işlemi, kesin hedefi, önemli girdileri ve muhtemel sonucu göstermelidir. “Devam edilsin mi?” zayıf bir kontroldür. “Bu mesaj, ekli liste kullanılarak, tahmini kampanya maliyeti $X olacak şekilde 2.400 müşteriye gönderilecek” ifadesi, kişiye anlamlı bir inceleme yapabilmesi için gerekli bilgiyi verir.
Yüksek etkili işlemler için, o anda ekranı izleyen herhangi biri yerine adı belirlenmiş bir onaylayıcı zorunlu kılın. Risk bunu gerektirdiğinde, iş akışını tasarlayan kişiyi, en önemli sonucunu yetkilendiren kişiden ayırın.
Aracının çalışma kapsamını tanımlayın
Uzmanların yararlı sınırlar belirlemek için her model ayrıntısını anlaması gerekmez. Ancak sistemin çalışma kapsamını belirtmeleri gerekir:
- Kapsam: hangi projelere, klasörlere, hesaplara ve veri kaynaklarına erişilebilir?
- Araçlar: sistem okuyabilir, yazabilir, gönderebilir, satın alabilir, kod çalıştırabilir veya izinleri değiştirebilir mi?
- Sınırlar: hangi harcama, hacim, sıklık veya süre sınırı geçerlidir?
- Kaynaklar: hangi alan adları, depolar veya veritabanları yetkili kaynak sayılır?
- Üst makama taşıma: hangi belirsizlik, çelişki veya eksik bilgi bir kişinin devreye girmesini gerektirir?
- Durdurma koşulları: sistem hangi durumlarda doğaçlama yapmak yerine durmalıdır?
Mümkün olan her durumda araç erişimi, kullanıcının genel hesap erişiminden daha dar olmalıdır. Paylaşılan bir sürücüyü okuyabilen bir aracının otomatik olarak tüm kişilere e-posta gönderme iznine ihtiyacı yoktur. Kod taslağı oluşturabilen bir aracının otomatik olarak üretim kimlik bilgilerine ihtiyacı yoktur. Ayrı bir hizmet hesabı, kısıtlı bir çalışma alanı veya salt okunur bir bağlantı, bir hatanın maliyetini azaltabilir.
Sınırı operasyonel bir dille yazın. “Muhakeme kullan” bir kontrol değildir. “Onay almadan harici e-posta gönderme; müşteri veritabanını değiştirme; yalnızca [date] tarihli onaylı fiyat tablosunu kullan; iki kaynak çelişirse dur” ifadesi test edilebilir.
Planları yürütmeden önce incelenebilir hâle getirin
Planlama, yetkilendirilmiş yapay zekânın yararlı özelliklerinden biridir; ancak bir plan, planın sağlam olduğunun kanıtı değildir. Planı, önerilen bir eylem dizisi olarak inceleyin.
Dört soru sorun:
- Sistem hangi sonucun peşinde?
- Hangi varsayımlarda bulunuyor?
- Hangi araçları, hangi izinlerle çağıracak?
- Hangi adımda bir hata maliyetli hâle gelebilir veya geri döndürülmesi zorlaşabilir?
İyi bir onay ekranı, yalnızca nihai metni değil, planın sınırlarını da görünür kılmalıdır. Sistem hesabı “düzenleyeceğini” söylüyorsa, incelemeyi yapan kişi bunun kayıtları etiketlemek, yinelenenleri birleştirmek, mesajları arşivlemek veya verileri silmek anlamına gelip gelmediğini görebilmelidir.
Tekrarlanan işler için, politika test edilebilecek kadar dar kapsamlı olduğunda her örneği ayrı ayrı onaylamak yerine politikayı onaylayın. “Bu tedarikçilerden gelen, bu tutarın altındaki faturaları asıllarını silmeden otomatik olarak bu klasöre kaldır” buna adaydır. “Faturaları yönet” değildir.
Bağlamın başarısız olabileceğini varsayın
Çok adımlı sistemler önceki talimatları gözden kaçırabilir, alınan bilgileri yanlış okuyabilir veya hatalı bir varsayımı sürdürerek aktarabilir. Özetteki araştırma ve mühendislik rehberleri; bağlam kaybı, istem enjeksiyonu, sonlanmama, yapılandırılmış çıktı hataları ve durumun yeniden oluşturulmasıyla ilgili sorunlar da dâhil olmak üzere çeşitli hata biçimlerini vurguluyor. Berkeley’nin ABBEL çalışması da etkileşim geçmişlerini sürekli olarak eksiksiz biçimde taşımak yerine, bunları inanç durumları hâlinde sıkıştırmanın tercih edilebilir olabileceğini savunuyor; ancak bağlam yönetimi performans ve güvenilirlik açısından önemini koruyor.
Bunun iş yeri açısından doğrudan bir sonucu var: kritik bir onayın, uzun bir çalışmanın ikinci adımındaki bir kısıtı ajanın hatırlamasına bağlı olmasına izin vermeyin. Önemli kısıtları araç çağrısının veya onay geçidinin yakınına yerleştirin. Alıcı, tutar, kaynak, gerekçe ve sona erme tarihi gibi hassas işlemler için yapılandırılmış alanlar zorunlu olsun. Bir görev uzun süre çalışıyorsa mevcut hedefi, tamamlanan adımları, bekleyen işlemleri ve çözümlenmemiş belirsizlikleri yeniden ifade eden bir kontrol noktası zorunlu kılın.
Bir ajan güvenilmeyen materyalleri okuduğunda özellikle dikkatli olun. Bir web sayfası, e-posta, belge veya kod yorumu, görevin tamamlanmasına yardımcı olmak yerine sistemi manipüle etmeyi amaçlayan talimatlar içerebilir. Alınan metin, iş akışı onu açıkça yetkilendirilmiş bir talimat olarak tanımlamadıkça veri olarak ele alınmalıdır.
Durdurma ve kurtarma için tasarlayın
Devredilen işin görünür bir durdurma mekanizmasına ve bir kurtarma planına ihtiyacı vardır. Döngüye girebilecek görevler için maksimum yineleme, araç çağrısı veya çalışma süresi sayısı belirleyin. Yeniden denemeleri güvenli hâle getirin: aynı bileti iki kez oluşturmak veya aynı e-postayı iki kez göndermek zararsız bir hata değildir. Destekleniyorsa idempotent işlemler kullanın ya da tekrarlamadan önce sistemin bir işlemin daha önce gerçekleşip gerçekleşmediğini kontrol etmesini sağlayın.
İnsan tarafından okunabilir bir faaliyet kaydı tutun: talep, plan, kullanılan araçlar, başvurulan veri kaynakları, verilen onaylar, yapılan değişiklikler ve nihai sonuç. Bu kayıt yalnızca sonradan yapılacak incelemeler için değildir. Asıl operatör erişilemez olduğunda bir çalışma arkadaşının devralmasını sağlar ve görünmez bir zincirin tamamını yeniden oluşturmadan bir sonuca itiraz etmeyi mümkün kılar.
Önemli iş akışlarında, özerklik tanımadan önce kasıtlı olarak kötü durumları test edin. Eksik veriyi, çelişen politikaları, süresi dolmuş bir kaynağı, bir belgedeki kötü amaçlı talimatı, yinelenen bir talebi, iptal edilmiş bir izni ve hata döndüren bir aracı deneyin. Amaç ajanın asla hata yapmadığını kanıtlamak değildir. Amaç, hatanın duraklamaya, açık bir eskalasyona veya güvenli bir geri almaya yol açtığını doğrulamaktır.
Pratik bir yetki devri merdiveni
Bir ajanı aşamalı olarak devreye alabilirsiniz:
- Gözlemle: sistem onaylanmış bilgileri okur ve ne yapacağını açıklar.
- Taslak hazırla: çıktıları hazırlar, ancak her dış işlemi bir kişi gerçekleştirir.
- Bir sanal alanda hareket et: yalıtılmış bir çalışma alanında test kayıtları, dallar veya dosyalar oluşturur.
- Dar kapsamlı izinlerle hareket et: hacim ve zaman sınırları altında geri alınabilir, düşük riskli işlemleri gerçekleştirir.
- Politika çerçevesinde hareket et: iyi test edilmiş bir görev sınıfını ele alır ve tanımlanmış onay geçitlerinde duraklar.
Yalnızca alt aşama, iş akışının kabul edilebilir şekilde davrandığına dair kanıt ürettikten sonra bir üst aşamaya geçin. Görev değişirse, araçlar değişirse veya veriler daha hassas hâle gelirse merdivende aşağı inin.
Bunun kariyeriniz açısından anlamı
Değerli beceri yalnızca bir yapay zekâdan nasıl sonuç isteneceğini bilmek değildir. Asıl beceri, muğlak bir yetki devrini sınırları belirlenmiş bir çalışma prosedürüne dönüştürmeyi bilmektir. Buna işi eylemlere ayırmak, geri döndürülemez geçişleri belirlemek, eskalasyon kuralları yazmak, onay talepleri tasarlamak ve bir ajanın ne zaman durması gerektiğini fark etmek dâhildir.
Mülakatlarda veya performans değerlendirmelerinde yalnızca başlattığınız otomasyonu değil, tasarladığınız sınırı anlatın: “Sistem araştırma yapar ve taslak hazırlar; dış iletişimi adı belirlenmiş bir değerlendirici onaylar; veritabanına yazma işlemleri şu alanlarla sınırlıdır; yinelenen işlemler kontrol edilir; çözümlenmemiş çelişkiler çalışmayı durdurur.” Bu dil, operasyonel muhakeme sergiler.
Ajanlarla yürütülen çalışma, profesyonel hesap verebilirlik ihtiyacını ortadan kaldırmayacak. Hesap verebilirliği daha somut hâle getirecek. Bir görevi devretmeden önce sistemin ne yapabileceğine, önce size ne göstermesi gerektiğine ve tek başına asla ne yapmaması gerektiğine karar verin. Ardından bu kararları iş akışının kendisinde görünür kılın.
Maya Chen, yapay zekâ çağında çalışmaya yönelik becerileri, rolleri ve akıllı hamleleri ele alan AI Career Brief’in hesap verebilir insan editörüdür.