Classification

Klasifikaci můžete použít ke klasifikaci dokumentů do předdefinovaných kategorií pomocí AI.

Mezi příklady klasifikace patří:

  • Klasifikace přepisů hovorů zákazníka podle záměru
  • Klasifikace dokumentů podle typu obsahu
  • Klasifikace recenzí produktů podle mínění

Klasifikace je dostupná přes uživatelské rozhraní Agent Bricks, v SQL a s REST API.

Vytvořte klasifikačního agenta v UI

Požadavky

Přejděte na ikonu Agenti.Agenti v levém navigačním podokně vašeho pracovního prostoru. Klikněte na Vytvořit agenta a vyberte Klasifikaci textu.

Krok 1. Výběr zdrojových dat

Klasifikujte dokumenty pomocí klasifikace.

  1. Vyberte zdrojová data. Svazek s dokumenty nebo tabulkou s textovými daty můžete vybrat.

  2. Klikněte na Vytvořit agenta.

Krok 2. Konfigurace klasifikačních štítků

Po zpracování klasifikace nakonfigurujte a upřesněte popisky klasifikace.

Ruční přidání popisků klasifikace:

  1. Kliknutím na + Přidat popisek přidejte popisek klasifikace.
  2. Zadejte název popisku a volitelný popis a klikněte na Přidat popisek.
  3. Opakujte 1 až 2 pro každý popisek, který chcete přidat.
  4. (Volitelné) Chcete-li, aby agent vrátil více než jeden popisek, povolte vícero popisků.

Import popisků z tabulky:

  1. Klikněte na Importovat z tabulky.
  2. Vyberte tabulku a klikněte na Další.
  3. Vyberte sloupec popisku, sloupec popisu a SQL Warehouse.
  4. Kliknutím na Náhled zobrazíte importované štítky.
  5. Pokud jste s popisky spokojení, klikněte na Importovat a nahradit popisky.

Ke spuštění klasifikace musíte mít definované alespoň dva štítky. Po dokončení přidání štítků klikněte na Uložit a spusťte klasifikaci.

Pokud chcete nakonfigurovat další možnosti, klikněte na přepínač možností ikona Posuvníky vedle možnosti Uložit a spustit klasifikaci a potom povolte jednu nebo více z následujících možností:

  • Skóre důvěry: Ukazuje úrovně důvěry pro předpovězené štítky.
  • Odůvodnění: Ukazuje odůvodnění předpokládaných štítků.

Klasifikace klasifikuje až 5 dokumentů a řádků a zobrazí výsledky. Můžete také přidat další.

Uživatelské rozhraní pro kontrolu klasifikace zobrazující popisky klasifikace a výsledky

Krok 3. Kontrola a vylepšení odpovědí na klasifikaci

Přezkoumejte odpovědi ke klasifikacím a poskytněte zpětnou vazbu, abyste zlepšili agenta.

  1. Zkontrolujte odpověď na dokument a klasifikaci:

    • Pokud je odpověď správná, dejte jí palec nahoru.
    • Pokud je odpověď nesprávná, dejte jí palec dolů. Pomozte klasifikaci opravit odpověď výběrem správného popisku. Klikněte na Uložit.
  2. Pokud chcete zlepšit odpovědi agenta, upravte popisy popisků klasifikace.

  3. Porovnejte verze za účelem optimalizace výkonu agenta. Klikněte na Verze. Vedle předchozí verze klikněte na porovnat popisy popisků klasifikace předchozí verze s aktuální verzí. Kliknutím na Obnovit obnovíte předchozí verzi.

Krok 4. Použití klasifikačního agenta

Pokud jste s odpověďmi spokojení, začněte používat agenta pro klasifikaci ve velkém měřítku.

V pravém horním rohu klikněte na Použít agenta . Můžete zvolit jednu z těchto:

  • Spuštěním v SQL můžete pomocí agenta klasifikovat celý svazek nebo tabulku. Tím se otevře SQL dotaz, který používá štítky klasifikace, jež jste definovali. Další informace o použití ai_classify v dotazech SQL najdete v dokumentaci k ai_classify funkci.
  • Vytvořte kanál Lakeflow , který běží v naplánovaných intervalech a vyvolá agenta na nových datech. Tím se vytvoří kanál Lakeflow, který aktualizuje streamovanou tabulku klasifikovanými daty. Harmonogram kanálu můžete nakonfigurovat tak, aby se spustil při příchodu nových dat. Další informace o kanálech Lakeflow najdete v tématu Deklarativní kanály Sparku.

Klasifikace dokumentů v SQL

Volání ai_classify v SQL pro klasifikaci dokumentů ve velkém rozsahu:

SELECT ai_classify(
  'My password is leaked.',
  '["urgent", "not_urgent"]',
  MAP('version', '2.1')
);

Informace najdete v ai_classify referenční příručce k jazyku SQL.

Klasifikace dokumentů pomocí REST API

Použijte REST API ke klasifikaci dokumentů z aplikací, služeb a automatizačních pracovních postupů. Pro referenci viz dokumentaci REST API .

Výchozí limit rychlosti pro ai_classify požadavky REST API je 1 200 požadavků za minutu na pracovní prostor. Kontaktujte svůj tým pro účet Databricks a požádejte o vyšší limit.

Následující příklad klasifikuje zprávu zákaznické podpory:

curl -X POST "$DATABRICKS_HOST/api/2.0/ai-functions/ai-classify" \
     -H "Authorization: Bearer $DATABRICKS_TOKEN" \
     -H "Content-Type: application/json" \
     -d '{
  "content": "My password is leaked.",
  "labels": ["urgent", "not_urgent"],
  "options": {
    "instructions": "Classify the support request by urgency."
  }
}'

Limitations

Viz omezení