Güvenmeden önce doğrulayın

Her Copilot iddiasını kanıtla karşılaştırın, Microsoft belgelerini doğru kapsamda okuyun ve bir asistanı başkaları kullanmadan önce test edin.


Bu derste neler öğreneceksiniz?

  • Bir Copilot yanıtındaki her iddiayı destekleniyor, çelişiyor veya kaynakta yok olarak etiketleyin
  • Bir atıfı otomatik kanıt değil, incelenecek bir ipucu olarak ele alın
  • Bir soruyu, en dar kapsamlı Microsoft şeffaflık belgesiyle eşleştirin
  • Bir yapay zeka asistanına güvenmeden önce olası zararları haritalayın, ölçün ve azaltın
Bu sayfada

Copilot'tan pilot proje için dört cümlelik bir durum güncellemesi istiyorsunuz. Akıcı paragrafın içinde "Bütçe onaylandı ve yedek sorumlu Jordan Lee" ifadesi yer alıyor. Verdiğiniz belge bu iki iddiayı da içermiyor. Güncellemeyi e-postaya yapıştırırsanız uydurulmuş bilgiler sizin adınızla gönderilir.

Doğrulamayı görevin içine yerleştirin

Copilot metin üretir ve sonucun sorumluluğunu size bırakır. Microsoft, büyük dil modellerinin taraflı, zararlı veya yanlış içerik üretebileceğini belirtiyor. Bu yüzden harekete geçmeden önce inceleme ve doğrulama gerekir. Süreci dört adımda düşünün: prompt → yanıt → kanıt kontrolü → insan kararı. Yanıt bir taslaktır. Kanıt kontrolü hangi iddiaları kullanabileceğinizi gösterir, insan da sonucun amaca uygun olup olmadığına karar verir.

Copilot'a "Emin misin?" diye sormak doğrulama değildir. Kendinden emin ikinci yanıt da aynı sistemin ürettiği yeni bir metindir. Önemli her iddiayı, kendiniz açıp inceleyebildiğiniz bir kaynakla karşılaştırın. Bu, Sorumlu Yapay Zeka İlkelerini Uygulamak dersindeki güvenilirlik ve emniyet kontrolünün kanıta odaklanan hâlidir. Şimdi aynı kontrolü tek bir yanıta, sağlayıcının belgelerine ve dağıtabileceğiniz bir sisteme uygulayacağız.

Akıcı dil doğruymuş gibi hissettirir

Önce kanıta bakın. Kaynağın desteklemediği hâlde makul görünen bir halüsinasyon genellikle sıradan görünür. Tarih bir ay kaymış olabilir, belirtilmemiş bir role ad eklenmiş olabilir, sayı yanlış kopyalanabilir veya Copilot kendi sonucunu kaynakta yazıyormuş gibi sunabilir.

Her önemli iddiaya bir durum verin

Yanıtı tarih, ad, tutar, durum ve sonuç gibi tek tek iddialara bölün. Her iddiaya bir durum verin:

  • Destekleniyor: İncelediğiniz kaynak iddiayı doğrudan doğruluyor.
  • Çelişiyor: Kaynak farklı bir bilgi veriyor.
  • Kaynakta yok: Kaynak iddiayı doğrulayacak bilgiyi içermiyor.
  • Kontrol edilmedi: Karşılaştırmayı henüz tamamlamadınız.

"Kontrol edilmedi" geçici bir durumdur. Yanıtı doğrulanmış saymadan önce önemli her iddiayı Destekleniyor, Çelişiyor veya Kaynakta yok durumlarından birine taşıyın. Aksi hâlde incelenmemiş bir ifade, biri doğrulamış gibi kullanılabilir.

"Kaynakta yok" ifadesi de "yanlış" demek değildir. Brifing pilotun 15 Eylül'de başladığını söylüyor, fakat yedek sorumludan söz etmiyorsa "Pilot 15 Eylül'de başlıyor" Destekleniyor durumundadır. "Ağustos'ta başlıyor" Çelişiyor durumundadır. "Yedek sorumlu Jordan" ise Kaynakta yok olarak işaretlenir. Brifing açıkça söylemedikçe "Yedek sorumlu atanmadı" iddiası da Kaynakta yoktur. Atamaya ilişkin kanıt bulunmaması, atama yapılmadığını göstermez.

İddiaları ve kanıtı yan yana isteyin· copilot-chat
Zayıf örnek

Projeyi özetle ve nelerin doğrulandığını söyle.

İyi örnek

Yalnızca yukarıya yapıştırdığım kaynağı kullanarak projeyi sütunları İddia, Kaynaktaki kanıt ve Durum olan bir tabloda özetle. Yalnızca şu durumları kullan: Destekleniyor, Çelişiyor, Kaynakta yok. Pilot tarihini, katılımcı sayısını, sorumluyu, eğitim planını, bütçeyi, yedek sorumluyu ve bütçe onay durumunu ekle. Destekleniyor durumundaki her iddia için kaynaktaki tam ifadeyi alıntıla ve eksik bilgi hakkında hiçbir çıkarım yapma.

Bu prompt neden daha iyi? Kaynakta bulunan olguların tam bir alıntı taşıdığı, yedek sorumlu ile bütçe onayının ise sessizce uydurulmak yerine "Kaynakta yok" olarak işaretlendiği bir tablo.

Düzeltmeden sonra doğrulanmış bir yanıt neye benzer?

Durum güncellemesinde kaynakta olmayan iki iddia varsa Copilot'tan metni kaynak sınırı içinde yeniden kurmasını isteyin: "Yalnızca doğrudan desteklenen bilgileri içeren doğrulanmış bir özet yaz. Kaynağın sağlamadığı her şey için ayrı bir Açık sorular bölümü ekle. Tarihleri, adları ve sayıları aynen koru. Onay veya yedek sorumlu hakkında çıkarım yapma."

Düzeltilmiş sürüm şöyle: "8 Temmuz itibarıyla pilotun 15 Eylül'de başlaması planlanıyor, 120 şirket içi kullanıcıyı kapsıyor ve sorumlusu Priya Nair. Eğitim 45 dakikalık iki oturum ve belirtilen bütçe $8,400." Ardından Açık sorular başlığı altında: "Yedek sorumlu kim? $8,400 tutarındaki bütçe onaylandı mı?"

Bilinen olgular özette kalır, bilinmeyenler de görünür olur. Göndermeden önce düzeltilmiş taslağı kaynakla bir kez daha karşılaştırın. Düzeltme de üretilmiş bir metindir.

Atıf bir ipucudur, sonuç değil

Copilot'un gösterdiği atıf sizi bir belgeye yönlendirir. Yanındaki cümleyi sizin yerinize doğrulamaz. Önemli her iddia için ifadenin kendisini, kaynağı, ilgili bölümü ve kapsamı kontrol edin. Tarih, hedef kitle, ürün ve koşullar aynı olmalıdır. Konuyla ilgili bir belge belirli iddia için yetersiz kalabilir. Projenin $8,400 bütçesi olduğunu söyleyen belge, bütçenin onaylandığını kanıtlamaz.

Bir cümlede birkaç iddia varsa her birini ayrı ayrı kaynakla karşılaştırın. Yanıt sayı veya liste içeriyorsa hesabı kendiniz yapın ve her öğenin bir kez bulunduğunu doğrulayın. "Toplam katılım: 120" veya "Ortalama puan: 4,33" hesabını yeniden yapmak kısa sürer. Eksik bir satır ya da yanlış basamak, akıcı bir özet içinde kolayca gözden kaçabilir.

Güvenme, yeniden hesapla

Herhangi bir toplam, ortalama veya liste için bağımsız hesaplayın ve her öğenin tam olarak bir kez göründüğünü doğrulayın. Copilot'tan işlemi kaynak değerlerin yanında göstermesini isteyin. Böylece yanlış bir sayının saklanacak yeri kalmaz.

Eksik yanıtları açığa çıkmaya zorlayın· copilot-chat
Zayıf örnek

Proje kaynağıyla ilgili bu soruları yanıtla.

İyi örnek

Bu soruları yalnızca yukarıdaki kaynağı kullanarak yanıtla. 1. Projenin sorumlusu kim? 2. Pilot ne zaman başlıyor? 3. Yedek sorumlu kim? 4. Bütçe onaylandı mı? Desteklenen her yanıt için kaynaktaki tam ifadeyi alıntıla. Kaynak bir soruyu yanıtlamıyorsa tam olarak "Kaynakta yok" yaz. Tahmin etme.

Bu prompt neden daha iyi? İki alıntılı yanıt ve iki açık "Kaynakta yok" cevabı. Uydurulmuş bir yedek sorumlu ya da belirtilmemiş bir onay varsa, olduğu şey yani halüsinasyon olarak açığa çıkar.

Sağlayıcının iddialarını doğru düzeyde doğrulayın

Doğrulama, bir Copilot özelliğinin gerçek iş akışında kullanılıp kullanılmayacağına karar verirken de gerekir. Microsoft belgelerini bir yanıtı incelerken gösterdiğiniz aynı dikkatle okuyun. Belgenin söylediğini kendi yorumunuzdan ayırın.

Üç düzey kullanabilirsiniz. Belgelenmiş gerçek, kaynakta doğrudan yazan bilgidir. "Microsoft altı sorumlu AI ilkesi tanımlar" buna örnektir. Makul yorum, bu bilgiden çıkardığınız sonuçtur. Altı ilkeyi inceleme kategorisi olarak kullanmak bu sınıfa girer. Desteklenmeyen sonuç ise kanıtın kapsamını aşar. "Bu nedenle her dağıtım altı ilkeyi de karşılar" ifadesi desteklenmez. Makul yorum işe yarayabilir, ama yine de size aittir. Desteklenmeyen sonucu kaldırın.

İlk bulduğunuza uzanmak yerine, sorunuzu en dar kapsamlı ilgili belgeyle eşleştirin:

Sorunuz şununla ilgiliyse… Şunu okuyun…
Bir ürün olarak Microsoft 365 Copilot Application Card
Adı belirli bir özellik O özelliğin Responsible AI FAQ'su
Bir platform olarak Copilot Studio Platform Card
Altta yatan model teknolojisi Transparency Note
Microsoft'un daha geniş yapay zeka programı Responsible AI Transparency Report

Belge soruyu yanıtlamıyorsa "Belirtilmemiş" yazın. "Risk yok" sonucuna varmayın. Belgedeki sessizlik güvence değil, eksik kanıttır. Daha dar bir kaynak arayın veya davranışı kendi ortamınızda doğrulayın.

Bir kaynak paketini olduğundan fazlasını okumadan analiz edin· copilot-chat
Zayıf örnek

Bu kaynak paketini incele ve özelliğin güvenli ve uyumlu olup olmadığını söyle.

İyi örnek

Yalnızca aşağıdaki kaynak paketini analiz et. Dış bilgi veya varsayım kullanma. Sütunları Belgelenmiş ifade, Kanıt kapsamı, Sınıflandırma, Kanıtın desteklediği ve Kanıtın ortaya koymadığı olan bir tablo oluştur. "Belgelenmiş gerçek" ifadesini yalnızca pakette açıkça yer alan bir şey için, "Makul yorum" ifadesini bir çıkarım için kullan. Bilgi eksikse "Kaynak paketinde belirtilmemiş" yaz. Sonra bir özelliği güvenli, onaylı veya uyumlu diye niteleyen her cümleyi, kaldırılacak desteklenmeyen bir sonuç olarak işaretle.

Bu prompt neden daha iyi? Paketin tam olarak neyi ortaya koyduğunu kaydeden, çıkarımlarınızı çıkarım olarak etiketleyen ve hiçbir özelliği yalnızca ilkelere dayanarak "güvenli" diye onaylamayı reddeden bir tablo.

Dağıtacağınız sistemi haritalayın, ölçün ve riski azaltın

Düşük riskli bir taslakta tek yanıtı kontrol etmek yeterlidir. Başkalarının kullanacağı bir politika yardımcısı veya talep sınıflandırıcı geliştiriyorsanız sistemi gerçek kullanıcılara açmadan önce üç aşamada doğrulayın: haritala, ölç, azalt.

Zararı genel bir etiket yerine baştan sona haritalayın. "Halüsinasyon riski" test edilebilir bir senaryo değildir. "Asistan politika istisnası uydurursa öğrenci yanıtı yetkili sanıp gerçek onay sürecini kaçırabilir" ifadesi ise neyi kontrol edeceğinizi gösterir. Her zararı etki ile olasılığı çarparak puanlayın ve puanın gerekçesini bir cümleyle yazın.

Başarı koşullarını herhangi bir sonuç görmeden önce belirleyip ölçün. Aksi hâlde yararlı görünen yanlış yanıtı kabul edebilirsiniz. İyi bir başarı koşulu gözlemlenebilir olmalıdır. Örneğin asistan istisna uydurmamalı veya onaylamamalı, politikanın kapsamadığı alanı belirtmeli ve kararı adı belirtilen sorumluya yönlendirmelidir. Gereksiz retleri de sayın. Asistan basit ve yanıtlanabilir politika sorusuna "Yardımcı olamam" diyorsa denetim diğer yönde bozulmuştur.

Riski katmanlı denetimlerle azaltın. Kaynağı sınırlayın, belirsizliğin belirtilmesini zorunlu kılın ve onayları insanda tutun. Ardından aynı testleri değiştirmeden yeniden çalıştırıp farkı kaydedin. Son olarak test etmediğiniz alanları, kalan riskin sahibini ve yeni incelemeyi tetikleyecek olayı yazın. Beş yazılı testi geçen talimat iyi bir başlangıçtır, fakat dağıtım kararı değildir. Tek başarılı yanıt ise hiçbir zaman yeterli kanıt sayılmaz.

Döngüyü bir örnekte uygulayın

Tek kaynağı kısa bir politika olan kütüphane asistanını düşünün. Standart dizüstü bilgisayar ödünç verme süresi 14 gündür ve uzatmaları Library Services onaylayabilir. Normal soru, belirsiz soru, 30 günlük uzatma isteği, politikayı yok sayma talimatı ve başka birinin ödünç alma geçmişini isteme senaryoları için beş test yazın. Testleri çalıştırmadan önce başarı koşullarını belirleyin.

Denetim olmadan başlangıç sürümü dört testte başarısız olur. Asistan bakım gerekçeli bir istisna uydurup uzatmayı "onaylar", politika dışı kural üretme talimatına uyar ve başka bir kullanıcının ödünç alma geçmişini açıklar. Ardından şu yazılı denetimi ekleyin: yalnızca politikadan yanıtla, kaynak sustuğunda "Sağlanan politikada belirtilmemiş" de, uzatmayı onaylama, kararları Library Services'a yönlendir ve başka kişinin bilgisini açıklama. Aynı testleri yeniden çalıştırın. Beşi de geçer, güvenli soru hâlâ yanıtlanır ve uydurma onaylarla gizlilik sızıntısı ortadan kalkar.

Bu sayımlar yeniden üretilebilir kanıttır. Başka bir değerlendirici aynı testleri çalıştırıp aynı sonuca ulaşabilir. Beş yazılı test yine de canlı sistemin nasıl davranacağını ortaya koymaz. Bu yüzden sonuç "testlere devam" olarak kalır.

Şimdi siz deneyin

Bir durum güncellemesini kaynağına göre doğrulayın

Temel doğrulama hamlesini bir kez, uçtan uca, güvenli kurgusal veriyle yaklaşık yedi dakikada uygulayın.

  1. 01

    Copilot'a kısa, kurgusal bir proje kaynağı yapıştırın. Bir başlangıç tarihi, bir katılımcı sayısı, adı belirtilmiş bir sorumlu ve bir bütçe tutarı ekleyin. Yedek sorumluyu ve bütçenin onaylı olup olmadığını ise bilerek dışarıda bırakın.

  2. 02

    Yedek sorumluyu ve bütçenin onaylı olup olmadığını da belirten normal bir yönetici özeti isteyin.

    İpucu: Bu, yakalayabilesiniz diye halüsinasyonu bilerek davet eder.

  3. 03

    Her iddiayı Destekleniyor, Çelişiyor veya Kaynakta yok olarak etiketleyin. Destekleniyor olan her biri için tam ifadeyi alıntılayın.

  4. 04

    Copilot'tan özeti yalnızca desteklenen olgularla ve ayrı bir "Açık sorular" bölümüyle yeniden kurmasını isteyin, sonra onu kaynağınızla karşılaştırın.

    İpucu: Yedek sorumlu ve bütçe onayı, Açık sorular bölümüne düşmeli.

Makul, uydurulmuş bir olgunun yakalanıp açığa taşındığını gösteren bir başlangıç ve düzeltme sonrası sonuçları elde edersiniz. Böylece doğrulanmamış iddiaları gerçek işinizin dışında tutarsınız.

Aklınızda kalsın

  • Her Copilot yanıtını taslak olarak görün. İddialara bölüp her birini Destekleniyor, Çelişiyor veya Kaynakta yok diye etiketleyin.
  • "Kaynakta yok", "yanlış" değildir. Eksik bir ad, kimsenin atanmadığının kanıtı değildir.
  • Atıf, incelenecek bir ipucudur ve tek başına kanıt değildir. Belirtilmiş bütçe ile onaylanmış bütçe farklı iddialardır.
  • Bir soruyu en dar kapsamlı şeffaflık belgesiyle eşleştirin. "Belirtilmemiş", kanıtın eksik olduğu anlamına gelir ve güvence sağlamaz.
  • Bir asistanı dağıtmadan önce zarar yollarını haritalayın, çıktıları görmeden önce başarı koşullarını belirleyin ve her karar için bir insan sorumluyu koruyun.

Kendinizi test edin

  1. 1. Bir kaynak "Bütçe: $8,400" diyor ve onay hakkında hiçbir şey demiyor. Copilot "$8,400 bütçe onaylandı" yazıyor. Onay iddiasını nasıl etiketlemelisiniz?

  2. 2. Bir brifing bir proje sorumlusunu belirtiyor ama yedek sorumludan hiç söz etmiyor. Hangi ifade Kaynakta yok?

  3. 3. Adı belirli tek bir Copilot özelliği hakkında sorumlu yapay zeka bilgisine ihtiyacınız var. Doğru ilk durak hangi belge?

  4. 4. Bir ekip, Microsoft'un altı sorumlu yapay zeka ilkesine uyduğunu okuyor ve yeni asistanlarının "dolayısıyla güvenli ve dağıtıma onaylı" olduğu sonucuna varıyor. En iyi yanıt ne?

  5. 5. Bir güvenlik denetimi ekledikten sonra ekipman ödünç verme asistanı politikanın yanıtladığı "Standart ödünç verme süresi ne kadar?" dahil her soruya "yardımcı olamam" diyor. Doğru teşhis ne?

  6. 6. Bir yapay zeka asistanını doğrularken, bir testin başarı koşulunu tanımlamanın doğru zamanı ne zamandır?

Sık sorulan sorular

Copilot bir atıf gösteriyorsa, kontrolü benim için zaten yapmış olmuyor mu?

Hayır. Atıf sizi bir belgeye yönlendirir, fakat bölümün tam iddiayı desteklediğini kanıtlamaz. Kaynağı açın, bölümü bulun ve iddianın ifadesiyle ve kapsamıyla eşleştiğini doğrulayın. Konuyla ilgili bir belge çoğu zaman belirli bir olguyu ortaya koymaz.

Ne kadar doğrulama yeterli?

Riske göre ayarlayın. Düşük riskli bir beyin fırtınası hızlı bir okuma ister. Bir politika, bir personel ya da finansal karar, bir güvenlik talimatı veya dışarıya göndereceğiniz her şey için iddia düzeyinde kontrol, görünür bilinmeyenler ve harekete geçmeden önce insan incelemesi gerektirir.

Aynı prompt'u tekrar çalıştırdığımda Copilot farklı bir yanıt verdi. Hangisi doğru?

Varsayılan olarak hiçbiri yetkili değildir. Aynı prompt her seferinde farklı ifade döndürebilir. İkinci bir üretime karşı değil de bir kaynağa karşı doğrulamanızın nedeni budur. Çıktı önemli olduğunda incelediğiniz sürümü aynen saklamanızın da.

Bu dersteki terimler

halüsinasyon
Makul görünen ama sağlanan kanıtla desteklenmeyen veya onunla çelişen bir yanıt.
iddia
Doğru olarak sunulan ve bir kaynakla kontrol edilebilen tarih, ad, miktar, durum veya sonuç.
şeffaflık belgesi
Bir yapay zeka sisteminin bir bölümünü incelemeyi kolaylaştıran, Application Card veya Transparency Note gibi bir Microsoft belgesi.
kalan risk
Denetimler uygulandıktan sonra kalan risk. Sahibinin kim olduğu ve bir sonraki incelemeyi neyin tetiklediğiyle birlikte kaydedilir.

Daha fazla kaynak