Dovednosti vs. subagenti v Claude: Kdy co použít

Dovednosti vs. subagenti v Claude: Kdy co použít

Dovednosti vs. subagenti v Claude: Empirický průvodce

Rozdíl mezi dovedností a subagentem v Claude je častým zdrojem nejasností. Vývojáři, kteří staví na Claude Code, se často ptají, zda mají část logiky zabalit jako znovupoužitelnou dovednost, nebo jako komplexnějšího, izolovaného subagenta. Dokumentace poskytuje teoretické vodítko, ale teorie se v praxi často hroutí. Tento článek nabízí empirickou odpověď na otázku claude skills vs subagents.

Ve SkillProof je naším jediným účelem testovat dovednosti pro Claude Code na reálné práci. Abychom to dělali spolehlivě, náš testovací systém spouští každou kandidátní dovednost uvnitř dedikovaného subagenta, takže jeden běh nemůže kontaminovat další. To nám dává praktický úhel pohledu, i když je třeba přesně uvést, co naše data dokazují a co ne. Máme záznamy o spuštění pro 2090 dovedností, což nám hodně napovídá o tom, jak dovednosti selhávají – nejedná se o kontrolované srovnání stejného úkolu vytvořeného oběma způsoby. Níže popsaný rozdíl mezi dovedností a agentem v Claude je naší interpretací těchto selhání a u každého tvrzení ukážeme čísla, abyste si mohli sami posoudit naše úvahy.

Definice pojmů: Dovednost vs. subagent

Před analýzou dat je důležité stanovit jasné definice. Ačkoli se mohou zdát podobné, dovednosti a subagenti slouží zásadně odlišným účelům a fungují na různých úrovních abstrakce.

Dovednost je recept. Je to sada specifických, znovupoužitelných instrukcí a nástrojů, které rozšiřují schopnosti základního modelu pro dobře definovaný úkol. Dovednost je definována v souboru SKILL.md a je navržena tak, aby ji hlavní agent volal k provedení samostatné akce. Funguje v kontextu hlavního agenta a je nejvhodnější pro atomické operace, jako je formátování kódu, generování specifického typu souboru nebo vynucování interního stylu. Představte si ji jako kartičku s receptem, kterou podáte kuchaři, který už umí vařit.

Subagent je zcela samostatný pracovník. Je to nezávislá instance modelu, spuštěná primárním agentem ke zpracování velkého, komplexního nebo specializovaného úkolu. Subagent má vlastní kontext, vlastní systémový prompt a může spravovat svůj vlastní stav v rámci vícestupňového pracovního postupu. Primární agent deleguje na subagenta cíl na vysoké úrovni, který se ho pak autonomně snaží dosáhnout. Nepředstavujte si ho jako funkci, ale jako samostatnou službu, kterou voláte přes API.

Tato tabulka shrnuje hlavní rozdíly:

Vlastnost Dovednost Subagent
Analogie Specifický recept Specializovaný kuchař
Rozsah Atomický, jednoúčelový úkol Komplexní, vícestupňový pracovní postup
Stav Bezstavový Vlastní kontextové okno pro daný běh; vrací shrnutí a poté nic neuchovává
Kontext Sdílí kontext s hlavním agentem Izolovaný, nezávislý kontext
Složitost Adresář: SKILL.md plus volitelné skripty a referenční soubory načítané na vyžádání Markdown soubor s YAML frontmatter v .claude/agents/ — systémový prompt, seznam povolených nástrojů, model
Nejlepší pro Nástroje, vynucování formátu Autonomní úkoly, specializované role

Jak náš testovací systém odhaluje rozdíl

Všimněte si, že skutečnou osou rozdílu v této tabulce je izolace kontextu, nikoli velikost kódu. Oba se vytvářejí jako prostý markdown; pouze jeden dostane vlastní okno.

Naše testovací metodologie se o tento rozdíl opírá. Jak uvádí naše stránka o metodologii, test provádí agent, nikoli člověk: stejný agent vytvoří základní verzi bez dovednosti a pokus o stejný reálný úkol s použitím dovednosti, a poté vyhodnotí, zda je výsledek zřetelně lepší než výsledek Claude bez dovednosti. Každý z těchto testů spouštíme v jeho vlastním subagentovi, aby provedení jedné dovednosti nemohlo ovlivnit druhou.

Toto nastavení vynucuje jasnou hranici. Subagent dostane jediný cíl: provést úkol s použitím poskytnuté dovednosti. Pozorováním tohoto procesu tisíckrát vidíme, kde přesně abstrakce dovednosti exceluje a kde selhává.

Statistiky našeho katalogu jsou výmluvné. Z 2090 dosud testovaných dovedností:

  • 1291 (62 %) prošlo našimi benchmarky. Nainstalují se, spustí se na prompty, které deklarují, že zpracují, a na reálném úkolu překonají základní verzi bez dovednosti.
  • 697 vyžaduje nastavení. Podle naší metodologie znamená nastavení, že dovednost potřebuje konfiguraci, doprovodnou dovednost nebo připojenou integraci, aby mohla fungovat. Při procházení poznámek k těmto 697 testům jsou překážky převážně spojeny s přístupem: 229 zmiňuje externí CLI nebo binární soubor, 171 API klíč nebo přihlašovací údaje, 169 placený účet nebo plán, 136 server nebo integraci MCP.
  • 102 má horší skóre než samotný Claude. Nepodařilo se jim překonat základní verzi bez dovednosti – některé proto, že se vůbec nespustily (chybějící CLI, nefunkční závislost, příklad, který padá), jiné proto, že se spustily a zanechaly výstup horší než samotný Claude.

Upřímně řečeno, toto rozdělení vypovídá o architektuře méně, než byste možná doufali. Kategorie „vyžaduje nastavení“ je většinou o přihlašovacích údajích a chybějících binárních souborech, což je na ortogonální ose k otázce, zda úkol patří do dovednosti nebo subagenta. Selhání jsou místem, kde se skutečně skrývá architektonická lekce, a k nim se dostaneme níže.

Kdy použít dovednost: Model receptu

Na základě 1291 úspěšných dovedností v našem adresáři se objevuje jasný vzor. Úspěšné dovednosti jsou zaměřené, bezstavové a deterministické. Jsou to nástroje, ne myslitelé.

Zde jsou ideální případy použití pro dovednost:

  1. Atomické, opakovatelné úkoly: Dovednost exceluje v úkolech, které mají jasný vstup a předvídatelný výstup. Představte si věci, na které byste normálně napsali malý skript. audit-export, úspěšná dovednost v naší kategorii produktivity, je čistým příkladem: dejte jí auditní zprávu v markdownu a ona vygeneruje CSV připravené k importu do Jira, Linear, Teamwork nebo Monday. V našem testu přeměnila zprávu s pěti nálezy na platné řádky se správnými daty dokončení fází a šablonami tiketů s víceřádkovým textem v uvozovkách. Jedna práce, dobře odvedená.

  2. Naučit Claude používat přístup, který už má: Toto je rozdíl, který lidé nejčastěji chápou opačně, takže buďte opatrní: dovednost neuděluje nový přístup. Nemůže se sama připojit k vaší instanci Postgresu nebo volat API třetí strany – k tomu slouží servery MCP, a tento rozdíl jsme popsali v Claude Skills vs MCP. Dovednost učí Claude, jak dobře a konzistentně používat schopnosti, které již má. Pokud je CLI již ve vaší proměnné PATH, dovednost je správným místem pro zakódování způsobu, jakým ho váš tým volá.

  3. Omezený výstup a formátování: Když potřebujete, aby výstup odpovídal pevné struktuře, je dovednost správnou volbou. git-workflow v naší kategorii kódování je funkčním příkladem: když jsme požádali o pomoc před otevřením PR z větve s jedním commitem nazvané my-fix s commit zprávou "fixed stuff", dovednost pojmenovala konkrétní porušení konvencí a vytvořila odpovídající náhrady. Soubor SKILL.md obsahuje striktní instrukce o formě, které model spolehlivě dodržuje, protože úkol je úzce zaměřený.

Charakteristiky dobře navržené dovednosti, jak je vidět na našich vysoce hodnocených příkladech, zahrnují stručný SKILL.md, jasnou definici všech zahrnutých nástrojů a absenci složité, větvící se logiky. Instrukce by měly model vést, nikoli se ho snažit programovat pomocí prózy.

Kdy použít subagenta: Model specialisty

Pokud je dovednost recept, subagent je specialista, kterého si najmete na složitou práci. Rozhodnutí claude code subagent or skill se stává jasnějším, když úkol vyžaduje paměť, iteraci nebo odlišnou personu.

Naše data o selhávajících nebo složitě nastavitelných dovednostech ukazují, kdy měl vývojář zvolit architekturu subagenta hned od začátku.

Zde jsou ideální případy použití pro subagenta:

  1. Vícestupňové, komplexní pracovní postupy: Jakýkoli úkol, který vyžaduje sekvenci závislých kroků, je práce pro subagenta. Například: "Prozkoumej výkon různých třídicích algoritmů pro téměř seřazená data, napiš shrnutí zjištění a poté vygeneruj Python kód implementující ten nejefektivnější." Tento pracovní postup vyžaduje udržení kontextu (výzkum) napříč několika kroky (shrnutí, kódování). Bezstavová povaha dovednosti to činí téměř nemožným spolehlivě provést.

  2. Úkoly vyžadující izolaci nebo odlišnou personu: Někdy úkol vyžaduje zcela odlišný přístup než hlavní agent. Klasickým příkladem je agent "recenzent kódu". Možná budete chtít, aby byl tento agent kritický, pečlivý a zaměřený pouze na kvalitu kódu. Snažit se tuto personu vylákat z univerzálního asistenta pomocí dovednosti je neefektivní a nespolehlivé. Je mnohem efektivnější spustit subagenta se systémovým promptem přizpůsobeným této kritické personě.

  3. Dlouhotrvající práce, kterou nechcete ve svém kontextu: Dovednost vůbec není volání – nic se nevolá a nic se nevrací. Claude si načte SKILL.md do svého vlastního kontextu a sám se řídí instrukcemi uvnitř hlavní smyčky. Neexistuje žádný samostatný pracovník, kterému by se dala předat dlouhá práce. Subagenti jsou mechanismem pro tento účel a od verze Claude Code v2.1.198 běží ve výchozím nastavení na pozadí, přičemž popředí je vyhrazeno pro případy, kdy je výsledek potřeba okamžitě. Jedna výhrada, kterou je třeba uvést jasně: pro pouhé čekání – dotazování se na endpoint, sledování dokončení buildu – je úloha na pozadí v shellu levnější a jednodušší než spouštění agenta. Sáhněte po subagentovi, když práce vyžaduje úsudek, nejen trpělivost.

Šedá zóna: Proč je 102 dovedností horších než nic

Nejosvícenější data pocházejí z našich selhání – a neříkají to, co jsme očekávali. Předpokládali jsme, že 102 selhání budou dovednosti, které se snaží chovat jako subagenti: nabubřelé soubory SKILL.md, spletité větvení, stavové procesy nacpané do receptu. Při procházení poznámek ke všem 102 testům jich pouze pět zmiňuje délku nebo nadbytek tokenů. Tato teorie je z velké části mylná a stojí za to to říci, než ji tiše opustit.

Ve skutečnosti se to rozpadá na dvě skupiny. Ta větší je selhání závislostí: 30 ze 102 uvádí chybějící CLI nebo binární soubor, 22 placený účet, 19 chybějící MCP server, 10 chybějící API klíč. skill-builder je reprezentativní – každé volání nástroje závisí na samostatném MCP serveru, který není součástí balíčku ani automaticky připojen, a dovednost nikdy nezmiňuje tento předpoklad, takže prostý manuální přístup ji překoná. Jedná se o selhání balíčkování, nikoli o selhání architektury.

Druhá skupina je tišší a poučnější: dovednosti, které se čistě nainstalují, správně se spustí a jednoduše neprodukují nic lepšího než základní verze. api-design-principles je nejjasnějším případem. Testovali jsme úkol návrhu REST – službu pro záložky s endpointy, verzováním, stránkováním a příklady v JSON – s dovedností i bez ní. Obě větve testu vyprodukovaly správnou, srovnatelnou práci. aeon a arbor dopadly stejně. Zde se otázka dovednosti versus subagenta skutečně projevuje: tyto dovednosti se snažily zakódovat celý proces uvažování do prózy a model již tohoto uvažování byl schopen. Dovednost přidala slova, aniž by přidala schopnosti.

To je upřímná architektonická lekce. Ne "dlouhé dovednosti selhávají", ale: pokud to, co píšete, je procedura, kterou model již kompetentně zvládá, dovednost nic nepřidá – a pokud procedura skutečně potřebuje vlastní kontext, personu nebo mnoho závislých kroků, próza v SKILL.md je pro ni špatným kontejnerem. Odpověď na otázku, kdy použít dovednost vs. subagenta v Claude Code, je tato: pokud váš úkol působí jako program, postavte ho jako subagenta; pokud působí jako poznámka pro kompetentního kolegu, který už práci zná, možná nemusí existovat vůbec.

Praktická heuristika

Volba mezi dovedností a subagentem nemusí být akademickou debatou. Naše testovací data naznačují jednoduchou, praktickou heuristiku:

Je úkol voláním funkce, nebo programem?

  • Pokud lze váš úkol modelovat jako jediné volání funkce – přijímá jasný vstup a produkuje samostatný výstup, aniž by si musel pamatovat minulé interakce – jedná se o dovednost.
  • Pokud váš úkol vyžaduje stav, vnitřní paměť, více kroků nebo specializovaný kontext pro spuštění – jinými slovy, pokud se chová jako samostatný program – měl by to být subagent.

Dodržováním tohoto rozlišení mohou vývojáři vytvářet robustnější, spolehlivější a efektivnější řešení s Claude Code. Začněte s nejjednodušší abstrakcí, která funguje. Dobře definovaná dovednost je mocná. Ale rozpoznávejte známky rostoucí složitosti a buďte připraveni přejít na architekturu subagenta, když to úkol vyžaduje.

Související čtení: pokud jste se rozhodli, že práce patří do izolovaného pracovníka, náš průvodce subagenty v Claude Code popisuje, jak ho definovat a co skutečně vidí. A pokud se stále rozhodujete, zda potřebujete nový přístup spíše než lepší instrukce, Claude Skills vs MCP tuto hranici správně vymezuje – je to častější zdroj nejasností.

Pokud potřebujete spolehlivé, předem prověřené nástroje pro běžné vývojářské úkoly, otestovali jsme přes tisíc úspěšných dovedností. Můžete procházet podle funkce v dovednostech pro kódování a dovednostech pro dokumenty, nebo si pořídit balíček deseti testovaných dovedností pro konkrétní roli za 10 $ – sada nástrojů pro vývojáře nejlépe odpovídá zde popsané práci.

★ 9.6/10 × 3

Startovací balíček zdarma

3 skills s nejvyšším skóre z našich testů plus instalační checklist — sestava, kterou bychom nasadili na čistý stroj. Zdarma, e-mailem.

Jeden e-mail s balíčkem + krátký týdenní přehled nových výsledků testů. Odhlásit se můžete kdykoli.