Podgląd i przetestuj agenta

Zakładka Podgląd w agentach obsługiwanych przez GitHub Copilot w Microsoft Copilot Studio zapewnia interaktywne środowisko testowe, w którym możesz rozmawiać z agentem, debugować jego zachowanie i przeglądać historię rozmów — wszystko to przed publikacją.

Note

Funkcje opisane w tym artykule są zasilane przez szelkę GitHub Copilot, która wykorzystuje Copilot Credits do rozliczeń opartych na użytkowaniu. Dowiedz się więcej o kredytach Copilot w Przeglądzie rozliczeń dla agentów zasilanych przez GitHub Copilot harness.

Rozliczanie oparte na użytkowaniu dotyczy korzystania, budowania, testowania i oceny agentów. Te działania mogą pochłaniać kredyty Copilot.

Co można zrobić w wersji zapoznawczej

Karta Wersja zapoznawcza zapewnia kompleksowy zestaw narzędzi testowania i debugowania:

  • Interaktywny czat: Wysyłaj wiadomości do swojego agenta i przeglądaj jego odpowiedzi w czasie rzeczywistym. Doświadczenie czatu odzwierciedla sposób, w jaki użytkownicy wchodzą w interakcję z Twoim agentem po jego publikacji.
  • Propozycje poleceń: Podgląd wyświetla propozycje poleceń z konfiguracji agenta, dzięki czemu możesz szybko przetestować typowe scenariusze.
  • Śledzenie aktywności: Wyświetl szczegółowy zapis łańcucha myślenia (CoT), który pokazuje, jak agent przetwarzał każdą wiadomość, w tym z jakich źródeł wiedzy korzystał, jakie narzędzia uruchamiał oraz jakie kroki rozumowania podejmował.
  • Historia rozmów: Przejrzyj wcześniejsze rozmowy testowe z agentem.
  • Ocena odpowiedzi: Oceniaj odpowiedzi agenta pozytywnie lub negatywnie i przekazuj pisemne uwagi, aby śledzić problemy z jakością.

Opcje układu podglądu

Zakładka Podgląd obsługuje różne widoki, aby dopasować się do Twojego przepływu pracy:

  • Widok twórcy: Domyślny widok, który zawiera kartę rozumowania w oknie czatu, dzięki czemu możesz zobaczyć rozumowanie agenta podczas testowania.
  • Podgląd użytkownika końcowego: „Przełącz” podgląd użytkownika końcowego, aby zobaczyć agenta tak, jak widzi go użytkownik końcowy, bez informacji debugujących.

Możesz przełączać się między widokami, używając przełącznika Podgląd użytkownika końcowego w nagłówku zakładki „Podgląd”.

Kiedy używać podglądu, a kiedy ewaluacji

Scenario Używanie wersji zapoznawczej Używane oceny
Szybkie, interaktywne testy podczas tworzenia
Debugowanie konkretnej odpowiedzi lub wywołania narzędzia
Iteracja instrukcji lub wiedzy
Pomiar jakości w wielu przypadkach testowych
Powtarzalne, automatyczne testy przed publikacją
Porównanie wyników między wersjami agentów

Oba podejścia wzajemnie się uzupełniają. Użyj Podglądu, aby eksplorować i doprecyzować, a następnie użyj Ewaluacji, aby walidować na dużą skalę.

Kluczowe funkcje

Możliwości czatu

Podczas testowania w zakładce Wersja zapoznawcza możesz:

  • Wysyłaj wiadomości tekstowe i prowadź wieloturowe rozmowy
  • Zobacz odpowiedzi agenta wyświetlane z bogatym formatowaniem
  • Kopiuj odpowiedzi agenta do przeglądu lub dokumentacji
  • Oceń odpowiedzi za pomocą przycisku kciuka w górę lub w dół
  • Przekazuj szczegółowe opinie za pomocą panelu opinii, w tym pisemne komentarze
  • Rozpocznij nową rozmowę, aby przetestować agenta bez wcześniejszego kontekstu

Śledzenie aktywności

Śledzenie aktywności pokazuje dokładnie, jak agent przetwarza każdą wiadomość:

  • Etapy rozumowania: Zobacz węzły rozumowania, którymi podążał agent
  • Atrybucja źródeł wiedzy: Zobacz, z których źródeł wiedzy agent korzystał i jakie cytaty zostały użyte
  • Uruchomienie narzędzi: Zobacz, kiedy narzędzia, konektory, przepływy lub umiejętności zostały uruchomione i jakie wyniki zwróciły
  • Szczegóły błędów: Zidentyfikuj i napraw błędy, które wystąpiły podczas przetwarzania

Wybierz dowolny element źródła lub narzędzia w śladzie aktywności, aby przejść bezpośrednio do tego komponentu w zakładce Buduj w celu edycji.

Dowiedz się więcej w artykule Użyj śledzenia aktywności do debugowania swojego agenta.

Historia konwersacji

Zakładka Podgląd przechowuje historię Twoich testowych konwersacji. Masz następujące możliwości:

  • Przejrzyj wcześniejsze konwersacje i ich rezultaty
  • Filtruj konwersacje według statusu (Wszystkie, Nieudane, W trakcie, Zakończone, Wymagane uwierzytelnienie i Wymagane dane wejściowe)
  • Zobacz transkrypcję poprzedniej konwersacji oraz etapy wnioskowania, aby zweryfikować zachowanie agenta
  • Wyświetl szczegółowe metryki dla każdej sesji, w tym kroki/wymiany, czas trwania, ostatni krok oraz model, który przetwarzał żądanie

Więcej informacji znajdziesz w Zarządzaj rozmowami w wersji zapoznawczej.