Hinweis
Für den Zugriff auf diese Seite ist eine Autorisierung erforderlich. Sie können versuchen, sich anzumelden oder das Verzeichnis zu wechseln.
Für den Zugriff auf diese Seite ist eine Autorisierung erforderlich. Sie können versuchen, das Verzeichnis zu wechseln.
Auf der vorherigen Seite wurde gezeigt, wie Agents handeln können – Aufrufen von Funktionen, Abfragen von APIs, Durchsuchen des Webs. Aber wenn Sie weitere Agenten erstellen, entsteht ein Muster: Derselbe Cluster von Tools, Anweisungen und Referenzmaterial wird immer wieder zusammen angezeigt. Eine Funktion "Eine Spesenabrechnung ablegen" ist nicht nur ein Tool – es handelt sich um ein Überprüfungsskript, eine Reihe von Richtliniendokumenten, schrittweise Anleitungen zum Ausfüllen des Formulars und Wissen über Ausgabenlimits. Am Ende kopiert man dieses Paket von Agent zu Agent und es gerät dadurch aus dem Takt.
Fähigkeiten lösen dieses Problem. Eine Fähigkeit ist ein tragbares Paket, das Anweisungen, Referenzmaterial und optionale Skripts in einer einzigen Einheit gebündelt, die jeder Agent bei Bedarf entdecken und laden kann. Fähigkeiten folgen einer offenen Spezifikation , sodass sie für Agents, Teams und sogar Produkte wiederverwendbar sind.
Wann Sie dies verwenden sollten
Fügen Sie Ihrem Agenten Fähigkeiten hinzu, wenn:
- Sie verfügen über einen Cluster verwandter Kenntnisse – Anweisungen, Referenzdokumente und Skripts – die logisch zusammen gehören (z. B. "Spesenabrechnung" oder "Codeüberprüfungsrichtlinien").
- Mehrere Agents benötigen das gleiche Domänenwissen, und Sie möchten eine einzige Quelle der Wahrheit anstelle duplizierter Anweisungen.
- Sie möchten Agent-Funktionen für Teams, Projekte oder Organisationen als eigenständige Pakete freigeben und verteilen .
- Sie müssen den Kontext effizient verwalten – Fähigkeiten verwenden progressive Offenlegung, damit Agents nur die benötigten Details laden, wenn sie sie benötigen.
Überlegungen
| Consideration | Details |
|---|---|
| Wiederverwendbarkeit | Eine Fähigkeit ist ein eigenständiges Paket. Nach der Erstellung kann jeder Agent es aufnehmen – ohne Kopieren und Einfügen, ohne Unterschiede zwischen den Kopien. |
| Kontexteffizienz | Fähigkeiten verwenden progressive Offenlegung: Der Agent sieht eine kurze Beschreibung (~100 Token) vorab und lädt vollständige Anweisungen nur, wenn sie relevant sind. Dadurch bleibt das Kontextfenster übersichtlich, wenn die Funktion nicht benötigt wird. |
| Abstraktionskosten | Fähigkeiten fügen eine Abstraktionsebene über Werkzeuge hinzu. Für ein einzelnes, eigenständiges Funktionstool ist das Hinzufügen eines Fähigkeitswrappers unnötiger Aufwand. |
| Designaufwand | Sie müssen im Vorfeld über Qualifikationsgrenzen nachdenken: Was gehört innerhalb der Fähigkeit und was draußen bleibt. Schlechte Grenzen führen zu Fähigkeiten, die zu breit (Kontext verschwenden) oder zu schmal sind (verlieren den Bündelungsvorteil). |
Unterschiede zwischen den Fähigkeiten und Tools
Werkzeuge und Fähigkeiten ergänzen sich, nicht konkurrierend. Wenn Sie die Unterscheidung verstehen, können Sie entscheiden, wann Sie jeweils zu welchem Mittel greifen.
Ein Tool ist eine einzelne aufrufbare Aktion – eine Funktion mit einem Namen, einer Beschreibung und einem Parameterschema. Wenn das Modell entscheidet, dass ein Tool benötigt wird, generiert es einen strukturierten Aufruf, das Agent Framework führt es aus, und das Ergebnis geht zurück zum Modell. Tools sind die Atome des Agentverhaltens.
Eine Fähigkeit ist ein Paket von Domänenkompetenz. Dazu kann Folgendes gehören:
- Anleitungen – schrittweise Anleitungen, Entscheidungsregeln und Beispiele, die dem Agent mitteilen, wie man sich einer Domäne nähert.
- Referenzmaterial – Richtliniendokumente, FAQs, Vorlagen und andere Kenntnisse, die der Agent bei Bedarf konsultieren kann.
- Skripts – ausführbarer Code, den der Agent ausführen kann, um bestimmte Vorgänge auszuführen (z. B. ein Überprüfungsskript, das Spesendaten anhand von Richtlinienregeln überprüft).
Der hauptunterschied besteht aus einem Bereich: Ein Tool gibt dem Agent die Möglichkeit, eine Aktion auszuführen; eine Fähigkeit gibt dem Agenten das Wissen und die Ressourcen, um eine ganze Domäne zu verarbeiten.
| Tool | Skill | |
|---|---|---|
| Was es bietet | Eine einzelne aufrufbare Aktion | Anweisungen + Referenzmaterial + optionale Skripts |
| Wie der Agent es verwendet | Ruft sie auf, wenn sie handeln muss | Lädt sie, wenn ein relevanter Vorgang auftritt, Anweisungen liest und Skripts aufrufen oder Ressourcen konsultieren kann. |
| Kontextkosten | Das Toolschema befindet sich immer im Prompt | Nur der Qualifikationsname und die Beschreibung (~100 Token) befinden sich in der Eingabeaufforderung; Vollständiger Inhalt wird bei Bedarf geladen. |
| Portabilität | An den Agent gebunden, der ihn registriert | Eigenständiges Paket, das jeder kompatible Agent ermitteln kann |
| Ideal für | Einzelne Aktionen (Datenbank abfragen, E-Mail senden) | Domänenkompetenz (Spesenrichtlinien, Codeüberprüfungsrichtlinien, Onboardingverfahren) |
Tip
Stellen Sie sich Tools als Verben (Suchen, Buch, Überprüfen) und Fähigkeiten als Fachwissen (Reisebuchungswissen, Spesenrichtlinienwissen) vor. Ein Agent verwendet Tools, um zu handeln und fähigkeiten, um zu wissen, wie man handeln kann.
Funktionsweise von Fähigkeiten: progressive Offenlegung
Fähigkeiten sind so konzipiert, dass sie kontexteffizient sind. Anstatt alles im Vorfeld in den Prompt einzufügen, verwenden Fähigkeitensysteme ein dreistufiges Muster:
┌──────────────────────────────────────────────────────────────────┐
│ Stage 1: Advertise │
│ Agent sees skill names and descriptions (~100 tokens each) │
│ in its system prompt at the start of every run. │
└──────────────┬───────────────────────────────────────────────────┘
▼ (task matches a skill's domain)
┌──────────────────────────────────────────────────────────────────┐
│ Stage 2: Load │
│ Agent calls load_skill to get the full instructions │
│ (< 5000 tokens recommended). │
└──────────────┬───────────────────────────────────────────────────┘
▼ (agent needs more detail)
┌──────────────────────────────────────────────────────────────────┐
│ Stage 3: Read resources │
│ Agent calls read_skill_resource to fetch supplementary files │
│ (FAQs, templates, reference docs) only when needed. │
└──────────────────────────────────────────────────────────────────┘
Dieses Muster bedeutet, dass ein Agent mit 10 registrierten Fähigkeiten ungefähr 1.000 Token an Kontext-Overhead zahlt – nicht 50.000. Der Agent vertieft nur sein Wissen, wenn die aktuelle Aufgabe sie verlangt.
Darüber hinaus basieren Fähigkeiten auf der Werkzeuginfrastruktur. Agent Framework kündigt verfügbare Fähigkeiten in der Systemaufforderung des Agents an, macht dann verfügbar load_skill und read_skill_resource als Toolaufrufe, die der Agent aufruft, um Inhalte schrittweise zu laden.
Tip
Die vollständigen Details zu Skillstruktur, Einrichtung und Codebeispielen finden Sie in der Agent Skills-Referenz.
Wann man Skills anstelle anderer Muster verwenden sollte
Wenn Ihr Agent fähiger wird, haben Sie mehrere Möglichkeiten, sein Verhalten zu organisieren. Hier erfahren Sie, wie Fähigkeiten im Vergleich zu Tools stehen:
| Muster | Am besten geeignet für: | Example |
|---|---|---|
| Einzelne Tools | Einmalige Aktionen, die keinen geteilten Kontext benötigen | Ein get_weather Funktionstool |
| Fähigkeiten | Domänenkompetenz mit Anweisungen, Referenzen und optionalen Skripts | Eine "Spesenabrechnung"-Fähigkeit mit Richtliniendokumenten, Validierungsskripts und schrittweisen Ablageanweisungen |
Häufige Fallstricke
| Fallstrick | Anleitung |
|---|---|
| Übermäßig breite Fähigkeiten | Eine Fähigkeit namens "alles über Finanzen", die versucht, Buchhaltung, Steuern, Spesenabrechnungen und Lohnbuchhaltung abzudecken, hat Anweisungen, die zu lang und unklar sind. Halten Sie Fähigkeiten, die sich auf einen Bereich konzentrieren. |
| Überspringen der Sicherheitsüberprüfung | Qualifikationsanweisungen werden in den Kontext des Agents eingefügt, und Skripts führen Code aus. Behandeln Sie Fähigkeiten wie Abhängigkeiten von Drittanbietern – überprüfen Sie sie vor der Bereitstellung. Sehen Sie sich die bewährten Methoden der Sicherheit in der Kompetenzreferenz an. |
| Progressive Offenlegung ignorieren | Wenn Ihre SKILL.md 2.000 Zeilen lang sind, zahlt der Agent hohe Kontextkosten, wenn er die Fertigkeit lädt. Halten Sie Anweisungen präzise und verschieben Sie detailliertes Referenzmaterial in separate Ressourcendateien, um die progressive Erschließung vollständig nutzen zu können. |
Nächste Schritte
Sobald Ihr Agent Über Tools und Fähigkeiten verfügt, besteht der nächste Schritt darin, Middleware hinzuzufügen – schnittübergreifende Verhaltensweisen wie Schutzläufe, Protokollierung und Inhaltsfilterung, die für jede Interaktion gelten, ohne die Kernlogik Ihres Agents zu ändern.
Gehen Sie tiefer:
- Agent-Fähigkeiten – vollständige Referenz mit Setup, Codebeispielen, Skripts und Sicherheitsleitfaden
- Spezifikation der Agentenkenntnisse – der offene Standard hinter den Fähigkeiten
- Übersicht über Tools – alle Tooltypen und Anbieterunterstützungsmatrix