Poznámka:
Přístup k této stránce vyžaduje autorizaci. Můžete se zkusit přihlásit nebo změnit adresáře.
Přístup k této stránce vyžaduje autorizaci. Můžete zkusit změnit adresáře.
Note
Tento článek popisuje funkce používané v agentech nebo tocích agentů, které využívají standardní harness.
Tento článek vysvětluje, jak změnit verzi modelu a nastavení v tvůrci výzev. Verze modelu a nastavení mohou ovlivnit výkon a chování modelu generativní AI.
Výběr modelu
Model můžete změnit tak, že v horní části tvůrce výzvy vyberete Model . Rozevírací nabídka umožňuje vybrat si z modelů generativní AI, které generují odpovědi na vaše vlastní zadání.
Použití výzev v Power Apps nebo Power Automate spotřebovává kredity Prompt Builder, zatímco použití výzev v Copilot Studio spotřebovává Copilot Credits. Další informace najdete v Licencování a kredity pro tvorbu výzev v dokumentaci k AI Builder.
Overview
Následující tabulka popisuje různé dostupné modely.
Modely mají různou dostupnost napříč oblastmi a pravidelně se aktualizují. Další informace najdete v Dostupnosti promptních modelů dle regionu a aktualizací.
Note
- GPT-4o mini a GPT-4o se nadále používají v oblastech státní správy USA. Tyto modely dodržují pravidla licencování a nabízejí funkce srovnatelné s GPT-4.1 mini a GPT-4.1.
- Anthropic modely jsou hostovány mimo Microsoft a podléhají podmínkám a zpracování dat společnosti Anthropic. Více informací v Výběr externího modelu jako primárního AI modelu.
| Model GPT | Licensing | Funkce | Kategorie |
|---|---|---|---|
| GPT-4.1 mini (výchozí model) | Základní sazba | Trénováno na datech do června 2024. Vstup až 128K tokenů. | Mini |
| GPT-4.1 | Standardní sazba | Trénováno na datech do června 2024. Kontext povoluje až 128 tisíc tokenů. | General |
| Chat GPT-5 | Standardní sazba | Trénováno na datech až do září 2024. Kontext povoluje až 128 tisíc tokenů. | General |
| Důvody GPT-5 | Prémiová sazba | Trénováno na datech až do září 2024. Kontext povoluje až 400 tisíc tokenů. | Hluboké |
| Uvažování GPT-5.2 | Prémiová sazba | Trénováno na datech do října 2024. Kontext povoluje až 400 tisíc tokenů. | Hluboké |
| Chat GPT-5.3 | Standardní sazba | Spravovaný model. Kontext povoluje až 128 tisíc tokenů. | General |
| Claude Sonet 4.6 | Standardní sazba | Externí model od Anthropic. Kontext povoluje až 200 tisíc tokenů. | General |
| Claude Opus 4.6 | Prémiová sazba | Externí model od Anthropic. Kontext povoluje až 200 tisíc tokenů. | Hluboké |
| Grok 4.1 Rychlý (bez důvodovacích funkcí) (viz následující důležitá poznámka) | Standardní sazba | Externí model z xAI | General |
Important
Vyhodnocení bezpečnosti a odpovědné umělé inteligence společnosti Microsoft zjistilo, že Grok-4.1 Fast (non-Reasoning) je méně sladěný než jiné hodnocené modely, což vede k (i) vyššímu riziku, že model vytvoří potenciálně škodlivý obsah a (ii) nižšímu skóre v bezpečnostních a jailbreak testech. Grok-4.1 Fast (bez uvažování) může být schopen vytvářet explicitní obsah a může tak činit s vyšší pravděpodobností než jiné modely. Zákazníci musí dodržovat jak kodex chování Microsoft Enterprise AI služeb, tak podmínky podnikových služeb xAI, včetně jejich zásad přijatelného používání. Kromě toho mohou existovat kategorie škod, které tento model může vytvořit, které nejsou pokryty systémy zabezpečení obsahu Microsoft. Stejně jako u všech experimentálních modelů se Grok-4.1 Fast (neuvažující) nedoporučuje pro produkční použití. Zákazníci by si měli před výběrem Grok-4.1 Fast (neuvažující) projít omezeními experimentálních a náhledových modelů a provést vlastní hodnocení.
Kontextové okno a použití tokenů
Okno kontextu modelu je limit pro každé volání modelu, který poskytovatel modelu vynucuje u každého jednotlivého volání. Jedna interakce agenta Copilot Studio (konverzační tah) může vyvolat více hovorů, například iterace plánovače, vyhledávání znalostí nebo generativní odpovědi a shrnování nástrojů.
Celkové využití tokenů pro jednu interakci je součtem všech jednotlivých modelových volání. Díky tomu může celkový počet za jednu interakci překročit kontextové okno jediného modelového volání.
Standardní architektura Copilot Studia nevynucuje limit tokenů napříč voláními v rámci jednoho tahu konverzace. Nastavení kontextového okna určuje ořezávání a zhušťování historie konverzace tak, aby zůstala v rámci kontextového okna modelu. Ale nebrání tomu, aby celkové využití tokenů během tahu překročilo kontextové okno modelu. Celkový počet použitých tokenů v rámci jednoho kola může být vyšší než kontextové okno jednoho volání modelu, aniž by došlo k chybě „byla překročena maximální délka tokenů“.
Licensing
V agentech, tocích nebo aplikacích se výzvy, které používají modely, spotřebovávají Copilot Credits, bez ohledu na fázi vydání modelů. Více informací o sazbách a řízení fakturace.
Pokud máte kredity AI Builder, systém je při použití výzvy v Power Apps a Power Automate nejprve spotřebuje. Systém při použití výzev v Copilot Studiu nevyužívá kredity AI Builderu. Další informace najdete v Přehled licencování v dokumentaci k AI Builder.
Fáze vydání
Modely procházejí různými fázemi uvolnění. Můžete vyzkoušet nové, špičkové experimentální a ukázkové modely, nebo si vybrat spolehlivý, důkladně ověřený běžně dostupný model.
| Štítek | Description |
|---|---|
| Experimental | Určeno k experimentování, ne k produkci. Podléhá podmínkám verze Preview a může být omezena jeho dostupnost a kvalita. |
| Náhled | Nakonec se stane obecně dostupným modelem, ale v současné době se nedoporučuje pro produkční použití. Podléhá podmínkám verze Preview a může být omezena jeho dostupnost a kvalita. |
| Žádná značka | Obecně dostupné. Tento model můžete použít pro škálované a produkční použití. Ve většině případů nemají obecně dostupné modely žádná omezení dostupnosti a kvality, ale některé mohou mít určitá omezení, například regionální dostupnost. Důležité: Modely Anthropic Claude jsou v experimentální fázi, i když nezobrazují značku. |
| Výchozí | Výchozí model pro všechny agenty a obvykle nejlepší obecně dostupný model. Výchozí model je pravidelně aktualizován, jakmile jsou obecně dostupné nové, schopnější modely. Agenti také používají výchozí model jako záložní model v případě, že je vybraný model vypnutý nebo nedostupný. |
Experimentální a náhledové modely mohou vykazovat variabilitu ve výkonu, kvalitě odezvy, latenci nebo spotřebě zpráv. Mohou vypršet nebo být nedostupní. Podléhají podmínkám verze Preview.
Kategorizace
Následující tabulka popisuje kategorie různých modelů.
| Kategorie | Mini | General | Hluboké |
|---|---|---|---|
| Performance | Vhodné pro většinu úkolů | Vynikající pro složité úkoly | Vyškolen pro úkoly s uvažováním |
| Rychlost | Rychlejší zpracování | Může být pomalejší kvůli složitosti | Pomalejší, protože přemýšlí, než odpoví |
| Případy použití | Sumarizace, informační úlohy, zpracování obrazu a dokumentů | Zpracování obrázků a dokumentů, pokročilé úlohy vytváření obsahu | Analýza dat a úlohy odůvodňování, zpracování obrázků a dokumentů |
Vyberte mini model, když potřebujete nákladově efektivní řešení pro středně složité úkoly, máte omezené výpočetní zdroje nebo potřebujete rychlejší zpracování. Mini modely jsou ideální pro projekty s omezeným rozpočtem a aplikace jako zákaznická podpora nebo efektivní analýza kódu.
Vyberte obecný model, pokud pracujete s vysoce složitými, multimodálními úkoly, které vyžadují vynikající výkon a podrobnou analýzu. Je to lepší volba pro velké projekty, kde je rozhodující přesnost a pokročilé funkce. Obecný model je také dobrá volba, pokud máte rozpočet a výpočetní zdroje na jeho podporu. Obecné modely jsou také vhodnější pro dlouhodobé projekty, jejichž složitost může časem narůstat.
Hluboké modely vynikají pro projekty vyžadující pokročilé schopnosti uvažování. Jsou vhodné pro situace, které vyžadují sofistikované řešení problémů a kritické myšlení. Hluboké modely vynikají v prostředích, kde je důležité jemné uvažování, komplexní rozhodování a podrobná analýza.
Vyberte si z modelů na základě dostupnosti regionů, funkcí, případů použití a nákladů. Zjistěte, které modely jsou dostupné ve vaší oblasti a harmonogramy vyřazení modelů v dostupnosti modelů podle oblastí a aktualizací. Další informace o cenách najdete v tabulce AI Builder Capability Rate.
Nastavení modelu
Do panelu nastavení se dostanete výběrem tří teček (...) >Nastavení nahoře v editoru promptů. Můžete změnit následující nastavení:
- Teplota: Nižší teploty vedou k předvídatelným výsledkům. Vyšší teploty umožňují různorodější nebo kreativní reakce.
- Načítání záznamů: Počet záznamů získaných pro vaše zdroje znalostí.
- Zahrnout odkazy do odpovědi: Pokud je tato možnost vybraná, odpověď obsahuje citace odkazů pro načtené záznamy.
- Povolit kódový interpret: Po výběru je povolen kódový interpret pro generaci a spuštění kódu.
- Úroveň moderování obsahu: Nejnižší úroveň generuje nejvíce odpovědí, ale mohou obsahovat škodlivý obsah. Nejvyšší úroveň moderování obsahu používá přísnější filtr k omezení škodlivého obsahu a generuje méně odpovědí.
Teplota
Nastavte teplotu pro generativní AI model pomocí posuvníku. Pohybuje se mezi 0 a 1. Tato hodnota určuje generativní AI model o tom, kolik kreativity (1) oproti deterministické odpovědi (0) poskytuje.
Note
Nastavení teploty není pro model uvažování GPT-5 k dispozici. Z tohoto důvodu je posuvník deaktivován, když vyberete model uvažování GPT-5.
Teplota je parametr, který řídí náhodnost výstupu generovaného AI modelem. Nižší teplota má za následek předvídatelnější a konzervativnější výstupy. Ve srovnání s tím vyšší teplota umožňuje větší kreativitu a rozmanitost v reakcích. Je to způsob, jak doladit rovnováhu mezi náhodností a determinismem ve výstupu modelu.
Výchozí teplota je 0, stejně jako v dříve vytvořených výzvách.
| Teplota | Functionality | Použití v |
|---|---|---|
| 0 | Předvídatelnější a konzervativnější výstupy. Odpovědi jsou konzistentnější. |
Výzvy, které vyžadují vysokou přesnost a menší variabilitu. |
| 1 | Více kreativity a rozmanitosti v odpovědích. Různorodější a někdy inovativnější odpovědi. |
Zadání, která vytvářejí nový originální obsah. |
Úprava teploty může ovlivnit výstup modelu, ale nezaručuje konkrétní výsledek. Odpovědi AI jsou ze své podstaty pravděpodobnostní a mohou se při stejném nastavení teploty lišit.
Úroveň moderování obsahu
Nastavte úroveň moderování obsahu výzvy pomocí posuvníku. S nižší úrovní moderace může váš prompt poskytnout více odpovědí. Nárůst odpovědí však může ovlivnit povolení škodlivého obsahu (nenávist a spravedlnost, sexuální, násilí, sebepoškozování) z zadání.
Note
Nastavení úrovně moderování obsahu je dostupné pouze pro spravované modely. Z tohoto důvodu není posuvník dostupný, když vyberete Anthropic nebo Azure AI Foundry modely.
Míra moderace se pohybuje od nízké po vysokou. Výchozí úroveň moderování promptů je Střední.
Nižší moderace zvyšuje riziko škodlivého obsahu v odpovědích na vaše prompty. Vyšší moderace toto riziko snižuje, ale může snížit počet odpovědí.
| Úroveň moderování obsahu | Description | Předpokládané použití |
|---|---|---|
| Nízké | Může povolit obsah zahrnující nenávist, nespravedlnost, sexualitu, násilí nebo sebepoškozování, který zobrazuje explicitní a závažné škodlivé pokyny, činy, škody či zneužívání. Zahrnuje schvalování, oslavování nebo propagaci závažných škodlivých činů, extrémních nebo nezákonných forem ubližování, radikalizace nebo nesouhlasné výměny či zneužívání moci. | Použití pro zpracování dat, která by mohla být považována za škodlivý obsah (například popisy násilí nebo lékařských postupů). |
| Moderate | Může povolit obsah s nenávistí, nespravedlností, sexuální tématikou, násilím nebo sebepoškozováním, který používá urážlivý, posměšný, zastrašující nebo ponižující jazyk vůči určitým identitním skupinám. Zahrnuje zobrazení hledání a provádění škodlivých instrukcí, fantazií, oslavování a propagace škody střední intenzity. | Výchozí filtrování. Vhodné pro většinu použití. |
| High | Může povolit obsah zaměřený na nenávist, nespravedlnost, sexualitu, násilí nebo sebepoškozování, který vyjadřuje předsudečné, soudící nebo názorové postoje. Zahrnuje urážlivé používání jazyka, stereotypizace, případy využití zkoumající fiktivní svět (například hry, literatura) a zobrazení s nízkou intenzitou. | Použij, pokud potřebuješ více filtrů přísnějších než úroveň Střední. |
Pro přepsání nastavení moderace obsahu agenta při použití promptu v agentu nastavte volbu Po spuštění v obrazovce Dokončení nástroje promptu na Odeslat konkrétní odpověď (uveďte níže). Zpráva pro zobrazení by měla obsahovat vlastní proměnnou Output.predictionOutput.text.