Změna verze modelu a nastavení

Note

Tento článek popisuje funkce používané v agentech nebo tocích agentů, které využívají standardní harness.

Tento článek vysvětluje, jak změnit verzi modelu a nastavení v tvůrci výzev. Verze modelu a nastavení mohou ovlivnit výkon a chování modelu generativní AI.

Výběr modelu

Model můžete změnit tak, že v horní části tvůrce výzvy vyberete Model . Rozevírací nabídka umožňuje vybrat si z modelů generativní AI, které generují odpovědi na vaše vlastní zadání.

Použití výzev v Power Apps nebo Power Automate spotřebovává kredity Prompt Builder, zatímco použití výzev v Copilot Studio spotřebovává Copilot Credits. Další informace najdete v Licencování a kredity pro tvorbu výzev v dokumentaci k AI Builder.

Overview

Následující tabulka popisuje různé dostupné modely.

Modely mají různou dostupnost napříč oblastmi a pravidelně se aktualizují. Další informace najdete v Dostupnosti promptních modelů dle regionu a aktualizací.

Note

  • GPT-4o mini a GPT-4o se nadále používají v oblastech státní správy USA. Tyto modely dodržují pravidla licencování a nabízejí funkce srovnatelné s GPT-4.1 mini a GPT-4.1.
  • Anthropic modely jsou hostovány mimo Microsoft a podléhají podmínkám a zpracování dat společnosti Anthropic. Více informací v Výběr externího modelu jako primárního AI modelu.
Model GPT Licensing Funkce Kategorie
GPT-4.1 mini (výchozí model) Základní sazba Trénováno na datech do června 2024. Vstup až 128K tokenů. Mini
GPT-4.1 Standardní sazba Trénováno na datech do června 2024. Kontext povoluje až 128 tisíc tokenů. General
Chat GPT-5 Standardní sazba Trénováno na datech až do září 2024. Kontext povoluje až 128 tisíc tokenů. General
Důvody GPT-5 Prémiová sazba Trénováno na datech až do září 2024. Kontext povoluje až 400 tisíc tokenů. Hluboké
Uvažování GPT-5.2 Prémiová sazba Trénováno na datech do října 2024. Kontext povoluje až 400 tisíc tokenů. Hluboké
Chat GPT-5.3 Standardní sazba Spravovaný model. Kontext povoluje až 128 tisíc tokenů. General
Claude Sonet 4.6 Standardní sazba Externí model od Anthropic. Kontext povoluje až 200 tisíc tokenů. General
Claude Opus 4.6 Prémiová sazba Externí model od Anthropic. Kontext povoluje až 200 tisíc tokenů. Hluboké
Grok 4.1 Rychlý (bez důvodovacích funkcí) (viz následující důležitá poznámka) Standardní sazba Externí model z xAI General

Important

Vyhodnocení bezpečnosti a odpovědné umělé inteligence společnosti Microsoft zjistilo, že Grok-4.1 Fast (non-Reasoning) je méně sladěný než jiné hodnocené modely, což vede k (i) vyššímu riziku, že model vytvoří potenciálně škodlivý obsah a (ii) nižšímu skóre v bezpečnostních a jailbreak testech. Grok-4.1 Fast (bez uvažování) může být schopen vytvářet explicitní obsah a může tak činit s vyšší pravděpodobností než jiné modely. Zákazníci musí dodržovat jak kodex chování Microsoft Enterprise AI služeb, tak podmínky podnikových služeb xAI, včetně jejich zásad přijatelného používání. Kromě toho mohou existovat kategorie škod, které tento model může vytvořit, které nejsou pokryty systémy zabezpečení obsahu Microsoft. Stejně jako u všech experimentálních modelů se Grok-4.1 Fast (neuvažující) nedoporučuje pro produkční použití. Zákazníci by si měli před výběrem Grok-4.1 Fast (neuvažující) projít omezeními experimentálních a náhledových modelů a provést vlastní hodnocení.

Kontextové okno a použití tokenů

Okno kontextu modelu je limit pro každé volání modelu, který poskytovatel modelu vynucuje u každého jednotlivého volání. Jedna interakce agenta Copilot Studio (konverzační tah) může vyvolat více hovorů, například iterace plánovače, vyhledávání znalostí nebo generativní odpovědi a shrnování nástrojů.

Celkové využití tokenů pro jednu interakci je součtem všech jednotlivých modelových volání. Díky tomu může celkový počet za jednu interakci překročit kontextové okno jediného modelového volání.

Standardní architektura Copilot Studia nevynucuje limit tokenů napříč voláními v rámci jednoho tahu konverzace. Nastavení kontextového okna určuje ořezávání a zhušťování historie konverzace tak, aby zůstala v rámci kontextového okna modelu. Ale nebrání tomu, aby celkové využití tokenů během tahu překročilo kontextové okno modelu. Celkový počet použitých tokenů v rámci jednoho kola může být vyšší než kontextové okno jednoho volání modelu, aniž by došlo k chybě „byla překročena maximální délka tokenů“.

Licensing

V agentech, tocích nebo aplikacích se výzvy, které používají modely, spotřebovávají Copilot Credits, bez ohledu na fázi vydání modelů. Více informací o sazbách a řízení fakturace.

Pokud máte kredity AI Builder, systém je při použití výzvy v Power Apps a Power Automate nejprve spotřebuje. Systém při použití výzev v Copilot Studiu nevyužívá kredity AI Builderu. Další informace najdete v Přehled licencování v dokumentaci k AI Builder.

Fáze vydání

Modely procházejí různými fázemi uvolnění. Můžete vyzkoušet nové, špičkové experimentální a ukázkové modely, nebo si vybrat spolehlivý, důkladně ověřený běžně dostupný model.

Štítek Description
Experimental Určeno k experimentování, ne k produkci. Podléhá podmínkám verze Preview a může být omezena jeho dostupnost a kvalita.
Náhled Nakonec se stane obecně dostupným modelem, ale v současné době se nedoporučuje pro produkční použití. Podléhá podmínkám verze Preview a může být omezena jeho dostupnost a kvalita.
Žádná značka Obecně dostupné. Tento model můžete použít pro škálované a produkční použití. Ve většině případů nemají obecně dostupné modely žádná omezení dostupnosti a kvality, ale některé mohou mít určitá omezení, například regionální dostupnost.
Důležité: Modely Anthropic Claude jsou v experimentální fázi, i když nezobrazují značku.
Výchozí Výchozí model pro všechny agenty a obvykle nejlepší obecně dostupný model. Výchozí model je pravidelně aktualizován, jakmile jsou obecně dostupné nové, schopnější modely. Agenti také používají výchozí model jako záložní model v případě, že je vybraný model vypnutý nebo nedostupný.

Experimentální a náhledové modely mohou vykazovat variabilitu ve výkonu, kvalitě odezvy, latenci nebo spotřebě zpráv. Mohou vypršet nebo být nedostupní. Podléhají podmínkám verze Preview.

Kategorizace

Následující tabulka popisuje kategorie různých modelů.

Kategorie Mini General Hluboké
Performance Vhodné pro většinu úkolů Vynikající pro složité úkoly Vyškolen pro úkoly s uvažováním
Rychlost Rychlejší zpracování Může být pomalejší kvůli složitosti Pomalejší, protože přemýšlí, než odpoví
Případy použití Sumarizace, informační úlohy, zpracování obrazu a dokumentů Zpracování obrázků a dokumentů, pokročilé úlohy vytváření obsahu Analýza dat a úlohy odůvodňování, zpracování obrázků a dokumentů

Vyberte mini model, když potřebujete nákladově efektivní řešení pro středně složité úkoly, máte omezené výpočetní zdroje nebo potřebujete rychlejší zpracování. Mini modely jsou ideální pro projekty s omezeným rozpočtem a aplikace jako zákaznická podpora nebo efektivní analýza kódu.

Vyberte obecný model, pokud pracujete s vysoce složitými, multimodálními úkoly, které vyžadují vynikající výkon a podrobnou analýzu. Je to lepší volba pro velké projekty, kde je rozhodující přesnost a pokročilé funkce. Obecný model je také dobrá volba, pokud máte rozpočet a výpočetní zdroje na jeho podporu. Obecné modely jsou také vhodnější pro dlouhodobé projekty, jejichž složitost může časem narůstat.

Hluboké modely vynikají pro projekty vyžadující pokročilé schopnosti uvažování. Jsou vhodné pro situace, které vyžadují sofistikované řešení problémů a kritické myšlení. Hluboké modely vynikají v prostředích, kde je důležité jemné uvažování, komplexní rozhodování a podrobná analýza.

Vyberte si z modelů na základě dostupnosti regionů, funkcí, případů použití a nákladů. Zjistěte, které modely jsou dostupné ve vaší oblasti a harmonogramy vyřazení modelů v dostupnosti modelů podle oblastí a aktualizací. Další informace o cenách najdete v tabulce AI Builder Capability Rate.

Nastavení modelu

Do panelu nastavení se dostanete výběrem tří teček (...) >Nastavení nahoře v editoru promptů. Můžete změnit následující nastavení:

  • Teplota: Nižší teploty vedou k předvídatelným výsledkům. Vyšší teploty umožňují různorodější nebo kreativní reakce.
  • Načítání záznamů: Počet záznamů získaných pro vaše zdroje znalostí.
  • Zahrnout odkazy do odpovědi: Pokud je tato možnost vybraná, odpověď obsahuje citace odkazů pro načtené záznamy.
  • Povolit kódový interpret: Po výběru je povolen kódový interpret pro generaci a spuštění kódu.
  • Úroveň moderování obsahu: Nejnižší úroveň generuje nejvíce odpovědí, ale mohou obsahovat škodlivý obsah. Nejvyšší úroveň moderování obsahu používá přísnější filtr k omezení škodlivého obsahu a generuje méně odpovědí.

Teplota

Nastavte teplotu pro generativní AI model pomocí posuvníku. Pohybuje se mezi 0 a 1. Tato hodnota určuje generativní AI model o tom, kolik kreativity (1) oproti deterministické odpovědi (0) poskytuje.

Note

Nastavení teploty není pro model uvažování GPT-5 k dispozici. Z tohoto důvodu je posuvník deaktivován, když vyberete model uvažování GPT-5.

Teplota je parametr, který řídí náhodnost výstupu generovaného AI modelem. Nižší teplota má za následek předvídatelnější a konzervativnější výstupy. Ve srovnání s tím vyšší teplota umožňuje větší kreativitu a rozmanitost v reakcích. Je to způsob, jak doladit rovnováhu mezi náhodností a determinismem ve výstupu modelu.

Výchozí teplota je 0, stejně jako v dříve vytvořených výzvách.

Teplota Functionality Použití v
0 Předvídatelnější a konzervativnější výstupy.
Odpovědi jsou konzistentnější.
Výzvy, které vyžadují vysokou přesnost a menší variabilitu.
1 Více kreativity a rozmanitosti v odpovědích.
Různorodější a někdy inovativnější odpovědi.
Zadání, která vytvářejí nový originální obsah.

Úprava teploty může ovlivnit výstup modelu, ale nezaručuje konkrétní výsledek. Odpovědi AI jsou ze své podstaty pravděpodobnostní a mohou se při stejném nastavení teploty lišit.

Úroveň moderování obsahu

Nastavte úroveň moderování obsahu výzvy pomocí posuvníku. S nižší úrovní moderace může váš prompt poskytnout více odpovědí. Nárůst odpovědí však může ovlivnit povolení škodlivého obsahu (nenávist a spravedlnost, sexuální, násilí, sebepoškozování) z zadání.

Note

Nastavení úrovně moderování obsahu je dostupné pouze pro spravované modely. Z tohoto důvodu není posuvník dostupný, když vyberete Anthropic nebo Azure AI Foundry modely.

Míra moderace se pohybuje od nízké po vysokou. Výchozí úroveň moderování promptů je Střední.

Nižší moderace zvyšuje riziko škodlivého obsahu v odpovědích na vaše prompty. Vyšší moderace toto riziko snižuje, ale může snížit počet odpovědí.

Úroveň moderování obsahu Description Předpokládané použití
Nízké Může povolit obsah zahrnující nenávist, nespravedlnost, sexualitu, násilí nebo sebepoškozování, který zobrazuje explicitní a závažné škodlivé pokyny, činy, škody či zneužívání. Zahrnuje schvalování, oslavování nebo propagaci závažných škodlivých činů, extrémních nebo nezákonných forem ubližování, radikalizace nebo nesouhlasné výměny či zneužívání moci. Použití pro zpracování dat, která by mohla být považována za škodlivý obsah (například popisy násilí nebo lékařských postupů).
Moderate Může povolit obsah s nenávistí, nespravedlností, sexuální tématikou, násilím nebo sebepoškozováním, který používá urážlivý, posměšný, zastrašující nebo ponižující jazyk vůči určitým identitním skupinám. Zahrnuje zobrazení hledání a provádění škodlivých instrukcí, fantazií, oslavování a propagace škody střední intenzity. Výchozí filtrování. Vhodné pro většinu použití.
High Může povolit obsah zaměřený na nenávist, nespravedlnost, sexualitu, násilí nebo sebepoškozování, který vyjadřuje předsudečné, soudící nebo názorové postoje. Zahrnuje urážlivé používání jazyka, stereotypizace, případy využití zkoumající fiktivní svět (například hry, literatura) a zobrazení s nízkou intenzitou. Použij, pokud potřebuješ více filtrů přísnějších než úroveň Střední.

Pro přepsání nastavení moderace obsahu agenta při použití promptu v agentu nastavte volbu Po spuštění v obrazovce Dokončení nástroje promptu na Odeslat konkrétní odpověď (uveďte níže). Zpráva pro zobrazení by měla obsahovat vlastní proměnnou Output.predictionOutput.text.

Screenshot obrazovky 'Dokončení' s nastavením 'Odeslat specifickou odpověď (uveďte níže)'.