Ile umiejętności Claude'a instalować?

Ile umiejętności Claude'a instalować?

Mniej niż myślisz. Dla większości osób wykonujących normalną pracę w Claude Code, liczba aktywnie używanych umiejętności, która utrzymuje się przez miesiące, wynosi od pięciu do ośmiu, nie licząc tego, co jest dołączone wtyczce, której nie wybrałeś indywidualnie. To nie jest sztywny limit. To punkt, w którym portfolio, po które faktycznie sięgasz, przestaje rosnąć, niezależnie od tego, ile jeszcze zainstalujesz.

Powodem niskiej liczby nie jest bałagan w widoku folderów. Każda zainstalowana umiejętność, niezależnie od tego, czy jej używasz, czy nie, umieszcza swój opis wyzwalacza przed Claude'em przy każdym zapytaniu, na zawsze, a każdy dodatkowy opis to kolejna rzecz, którą Claude musi poprawnie zignorować. Po pewnym punkcie dodawanie umiejętności nie zwiększa możliwości. Dodaje szum, z którym dobre umiejętności muszą konkurować.

Ten artykuł to arytmetyka stojąca za tą liczbą: ile kosztuje Cię zainstalowana, ale nieużywana umiejętność, dlaczego dwie nakładające się umiejętności są gorsze niż każda z osobna oraz struktura portfolio, której sami używamy po skatalogowaniu i przetestowaniu 73 z nich.

Co faktycznie kosztuje Cię zainstalowana umiejętność

Umiejętności ładują się w dwóch etapach. Na początku sesji Claude odczytuje tylko metadane (frontmatter), czyli name i description, każdej znalezionej umiejętności, zazwyczaj od 50 do 150 tokenów każda. Te metadane pozostają w kontekście przez całą sesję, niezależnie od tego, czy umiejętność zostanie kiedykolwiek uruchomiona. Pełna treść, czyli rzeczywiste instrukcje, ładuje się tylko wtedy, gdy zapytanie pasuje do opisu. To jest progresywne ujawnianie informacji i dlatego umiejętności skalują się lepiej niż wklejane prompty. Mechanizm ten omówiliśmy w what Claude skills are.

Część zawsze aktywna to ta, o której ludzie zapominają. Załóżmy, że zainstalowałeś 30 umiejętności, każda ze średnio 100 tokenami metadanych: 3000 tokenów stoi przed każdą wiadomością, każdą turą, każdą sesją, niezależnie od tego, czy są one istotne. Przy 30 turach w sesji roboczej to 90 000 tokenów wydanych na ponowne odczytanie listy metadanych, zanim Claude zrobi cokolwiek, o co poprosiłeś. Przez 22 dni robocze to blisko 2 miliony tokenów miesięcznie czystego „podatku za bezczynność”. Żaden z nich nie jest drogi sam w sobie, kilka centów według stawek Sonnet. Ale konkuruje o miejsce w oknie kontekstowym i kumuluje się ze wszystkim innym, co jest w tle: CLAUDE.md, MCP tool schemas, session history. Pełną analizę przeprowadziliśmy w cutting Claude token costs.

Większy koszt to nie pieniądze. To uwaga. Claude decyduje, którą umiejętność załadować, dopasowując Twoje zapytanie do stosu opisów, a to dopasowanie staje się mniej wiarygodne w miarę wzrostu stosu i nakładania się słownictwa w opisach. Umiejętność, którą zainstalowałeś w marcu i której nie używałeś od tego czasu, nadal znajduje się w tym stosie za każdym razem, gdy o coś prosisz w kwietniu, cicho sprawiając, że prawidłowe dopasowanie jest jedną opcją z 41 zamiast jednej opcji z 8.

DARMOWY PAKIET STARTOWY

Trzy to właściwa liczba na początek, nie trzydzieści. Wyślemy Ci e-mailem nasze 3 najlepiej oceniane umiejętności oraz listę kontrolną instalacji, którą uruchamiamy przed każdym testem SkillProof. Za darmo.

Pobierz darmowy pakiet startowy

Problem kolizji: dwie umiejętności, jedno zapytanie

Zainstaluj wystarczająco dużo umiejętności, a w końcu dwie z nich opiszą to samo zadanie innymi słowami. To nie jest hipotetyczne. Napotkaliśmy to, budując nasz własny katalog testowy: dwa pakiety marketingowe zainstalowane obok siebie zawierały umiejętności do tworzenia treści outreach, cold-email i email-sequences, z opisami nakładającymi się na tyle, że pojedynczy prompt „write me a follow-up email” mógłby prawdopodobnie pasować do obu.

Kiedy to się dzieje, następuje jedna z trzech rzeczy, a żadna z nich nie jest Ci ogłaszana. Claude wybiera jedną, cicho, na podstawie tego, który opis wydaje się nieco lepiej pasować do Twojego dokładnego sformułowania, więc ten sam prompt zadany na dwa różne sposoby może wywołać dwie różne umiejętności. Albo twarda kolizja w polu name oznacza, że jedna umiejętność całkowicie zaciemnia drugą; druga po prostu nigdy się nie ładuje, a Ty nie otrzymasz komunikatu o błędzie. Albo, w najgorszym przypadku, Claude próbuje zaspokoić oba częściowe dopasowania jednocześnie i produkuje wynik, który jest zlepkiem dwóch zestawów instrukcji, które nigdy nie zostały zaprojektowane do współpracy: Twoja umiejętność e-mailowa i Twoja umiejętność tonu głosu próbują zawładnąć tym samym zdaniem.

Rozwiązanie jest diagnostyczne, a nie prewencyjne, ponieważ zazwyczaj nie wiesz, że dwie umiejętności kolidują, dopóki to nie nastąpi. Pełną sześciopunktową listę kontrolną do tego opisaliśmy w Claude skill not triggering, ale krótka wersja, specjalnie dla rozmiaru portfolio: jeśli nie potrafisz w jednym zdaniu wyjaśnić, dlaczego umiejętność A obsługuje zapytanie zamiast umiejętności B, to nakładają się one zbyt mocno, aby obie pozostały zainstalowane. Połącz je, usuń jedną lub przepisz słabszy opis, aby wyciąć węższy, nienakładający się fragment zadania. Liczba kolizji w portfolio skaluje się mniej więcej z kwadratem jego rozmiaru, co jest matematyczną wersją zasady „utrzymuj to w małym rozmiarze”.

Podejście portfolio: kotwice, sytuacyjne, eksperymenty

Gdy zaakceptujesz, że każda zainstalowana umiejętność wiąże się z bieżącym kosztem, pytanie zmienia się z „czy powinienem to zainstalować” na „do której kategorii to należy”. My dzielimy nasze na trzy.

  • Kotwice to dwie do pięciu umiejętności, których brak zauważyłbyś w ciągu jednego dnia, gdyby zniknęły. Generowanie dokumentów, jeśli piszesz raporty co tydzień. Dyscyplina debugowania, jeśli piszesz kod codziennie. Umiejętność tonu lub edycji, jeśli Twoja praca to słowa. Zasługują one na stałe miejsce w ~/.claude/skills/, dostępne w każdym projekcie, i są jedyną kategorią wartą zainstalowania na wiarę, zanim udowodnisz, że wyzwalacz działa dla Ciebie konkretnie.

  • Sytuacyjne są rzeczywiste i użyteczne, ale ograniczone do jednego kontekstu: lista kontrolna migracji dla jednej bazy kodu, specyficzny głos marki klienta, umiejętność zgodności, której potrzebuje tylko Twój regulowany projekt. Należą one do folderu .claude/skills/ projektu, a nie do Twojego osobistego. Podróżują z repozytorium, są widoczne dla członków zespołu, którzy je klonują, i co najważniejsze, ich opis konkuruje o uwagę tylko w sesjach, w których są faktycznie istotne. Globalne zainstalowanie umiejętności specyficznej dla klienta oznacza, że jej opis towarzyszy każdemu niezwiązanemu projektowi, którego dotykasz.

  • Eksperymenty to wszystko, co próbujesz, ponieważ polecił to kolega lub wpis w katalogu uzyskał dobrą ocenę. Daj im twardy dwutygodniowy zegar od instalacji. Jeśli nie użyłeś go spontanicznie, naturalnie, bez specjalnego testowania, do końca dwóch tygodni, usuń go. Większość eksperymentów nie przechodzi tego testu, i to jest w porządku; po to jest okres próbny. Błędem nie jest próbowanie umiejętności, ale pozwalanie, by nieprzetestowane cicho awansowały do statusu stałej kotwicy tylko dlatego, że usunięcie folderu wydaje się przyznaniem się do porażki próby.

Ta struktura również odpowiada na pytanie „ile” bardziej użytecznie niż pojedyncza liczba. Nie chodzi o „zainstaluj łącznie 6 umiejętności”. Chodzi o to, aby „ograniczyć swoje kotwice do tego, czego naprawdę byś brakowało, utrzymywać umiejętności sytuacyjne w zakresie, w którym mają znaczenie, i nadać datę ważności wszystkiemu innemu”.

Co przetrwało na naszej własnej ławce testowej

Testujemy każdą umiejętność w katalogu SkillProof na czystej instalacji, zanim otrzyma werdykt, a osobno, niektóre z tych przetestowanych umiejętności stają się tymi, po które faktycznie sięgamy codziennie, miesiące po opublikowaniu recenzji. Ta druga lista jest krótka i jest pouczająca właśnie dlatego, że jest krótka.

  • DOCX (9.6/10) to ta, której brak zauważylibyśmy najszybciej, gdyby zniknęła. Własna umiejętność referencyjna Anthropic, a powód jest nudny: większość tygodni tworzymy dokumenty Word, a ona pisze prawdziwe, z spisami treści, śledzonymi zmianami, nienaruszonymi nagłówkami, zamiast markdown, który musielibyśmy ręcznie formatować.

  • Systematic Debugging (9.6/10) i Test-Driven Development (9.6/10), obie z kolekcji Superpowers, to para, która zmieniła sposób działania naszych sesji, a nie to, co produkują. Bez skryptów, bez zewnętrznych narzędzi, czysta zmiana zachowania: red-green-refactor egzekwowany za każdym razem, dyscyplina debugowania, która nie pozwoli Claude'owi zgadywać rozwiązania przed odtworzeniem błędu. To najjaśniejszy przypadek w naszym katalogu, w którym umiejętność zyskuje status kotwicy wyłącznie na podstawie wyników.

  • Memory Management (9.2/10) zasługuje na swoje miejsce, będąc niewidzialną w najlepszy możliwy sposób: zapobiega ulatnianiu się kontekstu między sesjami, bez konieczności ręcznego zarządzania plikiem notatek.

Zauważ, czego brakuje. Nasz katalog zawiera 73 umiejętności; 35 ma czysty werdykt „pass”. Używamy może ośmiu z tych 35 jako prawdziwych codziennych kotwic. Pozostałe 27 jest dobrych, przetestowanych i uczciwych w tym, co robią, a większość nadal pozostaje dla nas w statusie sytuacyjnym lub eksperymentalnym, ponieważ „przetestowane i dobre” oraz „należące do Twoich stałych pięciu do ośmiu” to różne progi. Umiejętność może uzyskać 9/10 w recenzji i nadal być niewłaściwa do globalnego zainstalowania, jeśli używasz jej przypadku użycia dwa razy na kwartał.

Comiesięczny rytuał przycinania

Portfolio dryfują. Umiejętność zainstalowana dla jednego projektu przeżywa projekt. Eksperyment przetrwa swój dwutygodniowy zegar, ponieważ usuwanie rzeczy nie jest ulubionym obowiązkiem nikogo. Rozwiązaniem jest powtarzające się dziesięciominutowe przejrzenie, a nie jednorazowe sprzątanie.

Raz w miesiącu wykonaj następujące czynności:

  1. Wypisz, co jest faktycznie zainstalowane. ls ~/.claude/skills/ i ls .claude/skills/ dla każdego projektu, w którym jesteś. Jeśli nie rozpoznajesz nazwy folderu, to już masz odpowiedź.
  2. Zapytaj, kiedy każda z nich ostatnio została uruchomiona. Jeśli nie pamiętasz, abyś jej używał w ostatnim miesiącu, i nie jest to kotwica, której używasz sporadycznie (sezon podatkowy, raporty kwartalne), jest to kandydat do usunięcia.
  3. Sprawdź nakładanie się. Przeczytaj pole description każdej umiejętności obok siebie. Dwie, które mogłyby prawdopodobnie odpowiedzieć na ten sam prompt, to kolizja czekająca na wystąpienie; zobacz sekcję powyżej.
  4. Potwierdź, że umiejętności o zasięgu projektu są faktycznie ograniczone do projektu. Cokolwiek specyficznego dla jednego klienta lub repozytorium nie powinno znajdować się w Twoim osobistym folderze, towarzysząc każdemu niezwiązanemu projektowi.
  5. Usuń, nie archiwizuj. Umiejętność, która jest gdzieś wyłączona, nadal nie powinna być mylona z aktywną. Jeśli nie zasługuje na swoje miejsce, usuń folder.
  6. Ponownie przetestuj swoje kotwice. Poproś o coś, co każda kotwica powinna obsłużyć, nie nazywając jej, tak jak testujemy wyzwalacze dla katalogu. Jeśli nie uruchamia się czysto, coś dodanego później prawdopodobnie ją zaciemnia.

Dziesięć minut, raz w miesiącu, a portfolio pozostaje w użytecznym rozmiarze, zamiast dryfować w kierunku rozmiaru, który po prostu się kumuluje.

Jakość przewyższa ilość

To jest cała teza SkillProof skompresowana w jednej sekcji, i warto to jasno powiedzieć tutaj, ponieważ „ile umiejętności” jest tak naprawdę zastępstwem dla innego pytania: jaka jest marginalna wartość następnej, którą zamierzasz zainstalować?

Spośród 45 umiejętności, które przeszły pełne testy, 35 przeszło czysto, a 10 wymagało dodatkowej konfiguracji, aby w ogóle działać. To nie jest krytyka ekosystemu, format jest celowo otwarty, każdy może publikować bez bramki recenzji, dlatego właśnie szybko się rozwinął. Ale oznacza to również, że przeciętna umiejętność na GitHub jest niezweryfikowana, a zainstalowanie dziesięciu przeciętnych nie sumuje się do jednej dobrej. Sumuje się do dziesięciu opisów wyzwalaczy konkurujących z Twoimi dobrymi o to samo dopasowanie, dziesięciu bezczynnych bloków metadanych przy każdym zapytaniu i rosnącej liczby par, które mogą cicho na siebie wchodzić. Zagłębiliśmy się w konkretne wzorce błędów, niejasne opisy, które nigdy się nie wyzwalają, wyniki nie lepsze niż domyślne Claude'a, brakujące kroki konfiguracji, w why half of Claude skills don't work.

Wersja praktyczna: przed zainstalowaniem czegokolwiek, zapytaj, czy przetrwałoby dwutygodniowy zegar eksperymentu i czy robi coś znacząco lepiej niż Claude zrobiłby bez promptu. Jeśli nie możesz odpowiedzieć twierdząco na oba pytania, pominięcie tego nie kosztuje Cię wiele, ale też nie pomaga. Nasze efficiency rankings sortują przetestowane umiejętności specjalnie według tego progu „wynik ponad podstawę”, co jest szybszym filtrem niż samodzielne czytanie dwudziestu README.

PAKIET SKILLPROOF

Całkowicie pomiń rozrost. Pakiet Optimizer to nasz najbardziej zwięzły zestaw kotwic, wstępnie sprawdzony pod kątem nakładania się wyzwalaczy, dzięki czemu instalujesz osiem najważniejszych, zamiast później usuwać czterdzieści.

Pobierz pakiet Optimizer — $10

FAQ

Czy istnieje sztywny limit liczby umiejętności Claude'a, które mogę zainstalować?

Nie ma technicznego limitu, na który natrafiliśmy podczas testów. Claude skanuje każdy znaleziony folder umiejętności i ładuje wszystkie ich metadane na początku sesji, niezależnie od tego, czy jest to 5 umiejętności, czy 150. Ważny limit to nie bariera narzucona przez Claude'a, ale punkt, w którym stały podatek od metadanych i rosnące prawdopodobieństwo nakładania się opisów zaczynają kosztować więcej niż dodaje nowa umiejętność. Ten punkt zazwyczaj wypada w okolicach 30 do 40 zainstalowanych umiejętności dla większości ludzi, na długo przed jakimkolwiek limitem na poziomie formatu.

Czy nieaktywne umiejętności spowalniają Claude'a, czy tylko kosztują tokeny?

Głównie tokeny i dokładność dopasowania, a nie dramatycznie surowe opóźnienie. Metadane nieaktywnej umiejętności znajdują się w kontekście przy każdej turze, co dodaje niewielki, rzeczywisty koszt, który kumuluje się w ciągu miesiąca, i jest to kolejny opis, który Claude musi rozważyć, decydując, co wywołać. Kilka nieaktywnych umiejętności jest naprawdę nieszkodliwych. Czterdzieści z nich to inna historia, głównie dlatego, że prawdopodobieństwo, że przestarzała umiejętność zaciemni lub częściowo dopasuje zapytanie, na którym Ci zależy, rośnie wraz z ich liczbą.

Jak sprawdzić, czy zainstalowana umiejętność jest faktycznie używana?

Poproś o coś, co powinna obsłużyć, nie nazywając jej, tak samo jak testujemy wyzwalacze dla każdego wpisu w katalogu. Jeśli zachowanie Claude'a widocznie się zmienia, na przykład produkuje prawdziwy .docx zamiast wklejonego markdown, to znaczy, że się uruchomiła. Jeśli nic się nie zmienia, to albo opis nie pasuje do sposobu, w jaki faktycznie formułujesz zapytania, albo inna umiejętność wygrywa dopasowanie jako pierwsza. Nasz skill not triggering guide zawiera pełny sześciopunktowy proces rozróżniania tych dwóch przypadków.

Czy umiejętności osobiste i projektowe powinny być wliczane do tego samego limitu?

Traktuj je oddzielnie. Umiejętności osobiste w ~/.claude/skills/ towarzyszą każdemu projektowi, którego dotykasz, więc powinny stanowić krótką listę kotwic, których brak odczuwałbyś codziennie, niezależnie od kontekstu. Umiejętności projektowe w .claude/skills/ ładują swoje metadane tylko w sesjach wewnątrz tego repozytorium, więc projekt może rozsądnie zawierać więcej umiejętności sytuacyjnych, nie obciążając w ogóle Twojej innej pracy. Najczęstszym błędem, jaki obserwujemy, jest umieszczanie umiejętności specyficznych dla klienta lub repozytorium w folderze osobistym, gdzie obciążają one każdy niezwiązany projekt na zawsze.

Jaki jest najszybszy sposób na skrócenie przerośniętej listy umiejętności?

Wykonaj comiesięczny rytuał przycinania raz, natychmiast, zamiast czekać na następne zaplanowane przejście. Wypisz wszystko, co jest zainstalowane, usuń wszystko, czego nie pamiętasz, aby zostało uruchomione w ostatnim miesiącu, a co nie jest znaną, sporadycznie używaną kotwicą, sprawdź pozostałe pod kątem nakładania się opisów i przenieś wszystko, co jest specyficzne dla klienta lub projektu, poza swój osobisty folder. Większość przerośniętych konfiguracji spada z ponad 30 umiejętności do mniej niż dziesięciu w pierwszym przejściu, ponieważ większość listy to eksperymenty, których nikt nie zdążył usunąć.

★ 9.6/10 × 3

Darmowy pakiet startowy

3 skille z naszymi najwyższymi ocenami z testów plus checklista instalacji — zestaw, który sami wgralibyśmy na świeżą maszynę. Za darmo, na e-mail.

Jeden e-mail z pakietem + krótki cotygodniowy przegląd nowych wyników testów. Wypiszesz się, kiedy chcesz.