
Die 15 besten Claude Code Skills 2026 – getestet
Such nach „beste Claude Skills" und du findest ein Dutzend Posts, die dieselben GitHub-README-Beschreibungen neu mischen. Die Autoren haben nie etwas installiert. Man merkt es daran, dass sie Skills loben, die nicht zuverlässig triggern, Installationsschritte auslassen, die auf einer frischen Maschine scheitern, und kein einziges Scheitern erwähnen.
Wir machen es auf die langsame Art. Jeder Skill in unserem Katalog bekommt eine saubere Installation, Trigger-Checks und echte Arbeitsaufgaben gegen eine Baseline ohne Skill — dann eine Wertung von 10 über Installation, Triggern, Output-Qualität und Doku. Das vollständige Protokoll steht auf unserer Methodik-Seite, und die Wertungen unten stammen direkt aus diesen Testläufen.
45 Skills haben das Protokoll bisher durchlaufen. Diese fünfzehn schnitten am besten ab. Alle sind kostenlos, und eine Einschränkung vor der Liste: Eine 9,6 misst, wie gut ein Skill seinen Job macht — nicht, ob dieser Job deiner ist. Ein Entwickler, der nie Word-Dateien schreibt, hat von DOCX bei keiner Punktzahl etwas. Lies also die „Für wen"-Zeilen, nicht nur die Zahlen.
Die Top 15 Claude Skills im Ranking
1. Test-Driven Development — 9,6
Jesse Vincents TDD-Skill aus der Superpowers-Sammlung zwingt Claude in striktes Red-Green-Refactor: erst der fehlschlagende Test, dann die minimale Implementierung, dann das Aufräumen — jedes Mal. In unserer Testsession mit drei Features hat er den Zyklus kein einziges Mal übersprungen, und er hat sich geweigert, als wir ihn zum Überspringen überreden wollten. Diese Sturheit ist der Punkt. Claudes Standard-Fehlermodus bei nicht-trivialen Features ist plausibel aussehender Code, der leise einen Edge Case bricht; dieser Skill fängt genau das ab, bevor es landet.
Wenn du beruflich mit Claude Code schreibst, installier diesen vor allem anderen auf der Liste. Die Zahl der Regressionen in unserer Session lag spürbar unter der Baseline. Vollständige Testnotizen.
2. Frontend Design — 9,6
Der größte Vorher-nachher-Abstand, den wir je bei einem Skill gemessen haben. Wir haben dasselbe Landingpage-Briefing mit und ohne laufen lassen: Die Baseline produzierte den üblichen Neon-Gradient-alles-zentriert-Output, die Version mit Skill hatte eine echte Typo-Skala und eine Palette, die gewählt aussah statt voreingestellt. Anthropic liefert diesen Skill im offiziellen Skills-Repo aus, und er verdient den Platz.
Wer mit Claude Web-UI ausliefert, sollte ihn dauerhaft installiert haben. Er ist kein Design-Tool, sondern ein Satz Geschmacks-Leitplanken — und die Leitplanken sind gut. Zum Vergleich.
3. Humanizer — 9,6
Aufgebaut auf Wikipedias Leitfaden „Signs of AI writing" entfernt dieser Skill den Fingerabdruck aus KI-gestützten Entwürfen: Gedankenstrich-Inflation, Dreierregel-Füllsel, Vokabular der „delve"-Klasse, vage Zuschreibungen. Unser Test für Schreib-Skills ist das blinde Lektorat, der härteste, den wir fahren. Zwei Lektoren lasen Humanizer-Output und konnten ihn nicht verlässlich als KI-gestützt erkennen.
Wenn du überhaupt irgendetwas veröffentlichst, jag deine Entwürfe als letzten Schritt der Pipeline hindurch. Wir haben ihn für diesen Artikel benutzt — nimm das als Demo oder als Warnung. Testdetails.
4. DOCX — 9,6
Der Referenz-Skill für Word-Dokumente. Claude erzeugt echte .docx-Dateien mit sauberen Formatvorlagen, Inhaltsverzeichnissen, Seitenzahlen und Briefköpfen — und kann bestehende Dokumente bearbeiten, ohne den Änderungsmodus zu zerstören. Unser Test lieferte einen 14-seitigen Bericht, der sauber in Word aufging, und eine Bearbeitung eines bestehenden Vertrags mit intakten nachverfolgten Änderungen, ohne die Datei zu korrumpieren. Der zweite Teil zählt mehr, als er klingt; an kaputten Tracked Changes stirbt Dokument-Tooling üblicherweise.
Wer Berichte, Memos oder Verträge produziert, sollte ihn installieren. Er beendet das Ritual, Markdown in Word zu kleben und vierzig Minuten nachzuformatieren. Skill-Seite.
5. Systematic Debugging — 9,6
Das Gegenstück zu TDD aus derselben Superpowers-Sammlung — und womöglich das befriedigendere von beiden. Er ersetzt Claudes Rate-und-prüf-Instinkt durch eine Schleife: reproduzieren, Hypothese aufstellen, instrumentieren, verifizieren. In unserem Test fand er die Wurzel einer Race Condition, die Baseline-Claude dreimal mit drei verschiedenen plausibel wirkenden Patches „gefixt" hatte.
Am besten bei Bugs, die schon einen gescheiterten Fix überlebt haben. Genau dann wird Claudes Standardverhalten schlechter (es fängt an zu zappeln) und dieser Skill relativ gesehen besser. Testnotizen.
6. Skill Creator — 9,6
Der Skill, der Skills baut: Gerüst, Trigger-Descriptions, Eval-Läufe. Wir haben damit in einer Session einen funktionierenden internen Skill gebaut, und sein Schritt zur Description-Optimierung verbesserte messbar, wie zuverlässig der neue Skill feuerte.
Ehrliche Einschätzung: Das ist der meistempfohlene Skill auf jeder Liste — und der am wenigsten relevante für die meisten Leser, denn die meisten werden nie einen Skill schreiben. Er bekam 9,6, weil er seinen Job extrem gut macht, nicht weil du ihn brauchst. Lass ihn aus, außer du baust Skills für ein Team oder zur Distribution — dann ist er unverzichtbar. Skill-Seite.
7. XLSX — 9,2
Tabellen von Anfang bis Ende: chaotische Exporte lesen, Struktur reparieren, Formelspalten berechnen, formatieren, Diagramme bauen. Wir haben ihn an wirklich schmutzigen Daten getestet — einem 40k-Zeilen-Export mit kaputten Kopfzeilen — und er lieferte Formelspalten und eine Pivot-Zusammenfassung, die sowohl in Excel als auch in Google Sheets korrekt neu berechneten. Der Neuberechnungs-Check ist der, an dem die meisten Tabellen-Tools scheitern.
Für Analysten, Ops-Leute und alle, in deren Postfach der Satz „siehe angehängten Export" vorkommt, die erste Wahl. Skill-Seite.
8. PDF Toolkit — 9,2
Zusammenführen, aufteilen, Wasserzeichen, Formulare ausfüllen, verschlüsseln, OCR. Im Test hat er sechs PDFs zusammengeführt, ein Behördenformular ausgefüllt und per OCR Tabellen aus einer gescannten Rechnung gezogen. Die OCR ist nur so gut wie der Scan — das gilt für jede OCR-Pipeline, die je gebaut wurde, also rechnen wir es dem Skill nicht an.
Er ersetzt eine ganze Kategorie zwielichtiger „kostenlose PDF-Tools"-Websites, die dein Dokument auf fremde Server hochgeladen haben wollen. Das allein rechtfertigt die Installation für alle, die wöchentlich mit PDFs arbeiten. Skill-Seite.
9. SQL Query Writer — 9,2
Schema-bewusstes SQL, das die schweren Teile beherrscht: Window Functions, CTEs, Joins über mehrere Tabellen. Wir haben ihn gegen ein Schema mit 12 Tabellen laufen lassen und die Ergebnisse Zeile für Zeile gegen handgeschriebene Queries verifiziert. Sie stimmten überein. Die meisten SQL-Tools werden mit „Lief die Query durch?" getestet — eine deutlich niedrigere Latte als „Hat die Query die richtigen Zeilen geliefert?".
Datenanalysten und Backend-Entwickler bekommen den offensichtlichen Nutzen. Weniger offensichtlich: Er hilft PMs, die wissen, welche Frage sie beantwortet haben wollen, aber nicht, über welchen Join-Pfad. Testnotizen.
10. SEO Audit — 9,2
Das Arbeitspferd unter den Marketing-Skills. Er deckt Crawlability, Indexierung, Core Web Vitals, Meta-Probleme und Thin-Content-Erkennung ab und liefert eine priorisierte Fix-Liste statt einer Wand aus Befunden. Wir haben damit eine Content-Site mit 200 Seiten auditiert und gegen ein paralleles Ahrefs-Audit gegengeprüft; bei jedem wesentlichen Punkt Übereinstimmung.
Für Enterprise-Arbeit ersetzt er keinen Spezialisten, aber für Gründer und kleine Marketing-Teams deckt er die ersten 80 % jedes Audits kostenlos ab. Skill-Seite.
11. Memory Management — 9,2
Strukturiertes, dateibasiertes Gedächtnis für Claude: was gespeichert wird, wie es indexiert wird, wann es abgerufen wird. Wir haben ihn eine volle Woche in echten Sessions getestet, und die Abruf-Präzision hielt, während der Speicher wuchs — genau der Punkt, an dem solche Systeme sonst zu Rauschen verkommen.
Der Pitch ist simpel: Claude hört auf, dein Projekt zwischen Sessions zu vergessen. Wenn du täglich mit Claude Code an derselben Codebasis arbeitest, ist der Kontinuitätsgewinn größer als bei jedem Einzelaufgaben-Skill dieser Liste. Unterschätzt, gemessen daran, wie wenig Aufmerksamkeit er bekommt. Skill-Seite.
12. Cold Email — 9,2
Der einzige Sales-Skill, den wir mit echten Sends getestet haben. Er schrieb Erstkontakt-E-Mails für 15 echte (anonymisierte) Prospects, mit Personalisierung, die auf überprüfbare Details verwies statt auf „Ihr letzter Beitrag hat mir sehr gefallen"-Füllsel. Drei Antworten auf 15 Sends. Die Antwortquote ist die einzige Metrik, die in der Kaltakquise zählt — also ist das die Zahl, die wir berichten.
Kaltakquise ist für einen Skill Hochrisiko-Terrain, weil eine einzige nach Vorlage klingende Zeile den Thread beerdigt. Dieser erzwingt recherchegestützte Personalisierung und eine kurze Struktur mit einem einzigen CTA. Für SDRs und Gründer, die ihr Outbound selbst machen. Testnotizen.
13. Webapp Testing — 8,8
Claude bedient deine echte App in einem echten Browser via Playwright: Navigation, Formulare, Edge Cases, mit Reproduktionsschritten für alles, was bricht. In unserem Test klickte er sich durch Signup, Checkout und Fehler-Flows einer lokalen App und fing eine echte Regression, die die Unit-Tests des Projekts übersehen hatten.
Er braucht ein lokal installiertes Playwright, was ihn Punkte bei der Installationsreibung kostet und der Grund ist, warum er unter der 9er-Liga sitzt. Trotzdem lohnend für alle, die Web-Apps ohne QA-Team ausliefern. Skill-Seite.
14. Statistical Analysis — 8,8
Hypothesentests, Regression, Verteilungsanalysen — mit geprüften Annahmen und laut ausgesprochenen Limitierungen. Das Detail, das ihm den Platz eingebracht hat: Im Test an einem Marketing-Datensatz weigerte er sich, eine kausale Behauptung abzusegnen, die die Daten nicht hergaben. Die meisten Analyse-Tools schmeicheln dir. Dieser nicht.
Unser unterschätzter Tipp auf dieser Liste. Er wird nie so gut demoen wie ein Dashboard-Generator, aber „die Analyse, die Nein sagt" ist mehr wert als die, die deinem Pitch-Deck zustimmt. Für alle, die Entscheidungen auf Basis selbst erhobener Daten treffen. Skill-Seite.
15. Meeting Notes Formatter — 8,8
Rohes Transkript rein, disziplinierte Zusammenfassung raus: getroffene Entscheidungen, Action Items mit Verantwortlichen, offene Fragen. Wir haben ihm ein rohes 45-Minuten-Transkript gefüttert und jede Output-Zeile gegen die Aufnahme geprüft. Null erfundene Action Items. Das ist der ganze Grund, warum er auf dieser Liste steht — halluzinierte Action Items sind der Standard-Fehlermodus von Meeting-Zusammenfassern, und sie sind schlimmer als gar keine Zusammenfassung.
Für Manager, PMs und alle, denen das Follow-up-Dokument gehört. Still und leise eines der besten Aufwand-Nutzen-Verhältnisse im Katalog. Skill-Seite.
Was es nicht geschafft hat
Sollte gesagt werden, denn die meisten Listen tun es nie. Sechs Skills mit 8,8 verpassten den Cut rein durch unsere Ermessensentscheidung bei Gleichstand, darunter PPTX und Account Research, beide weiter unten erwähnt. Neun weitere Skills tragen das Urteil „Setup nötig" — sie funktionieren, aber die Installation hat sich gewehrt; Git Workflow Coach und Brand Guidelines sind dort die auffälligsten. Und 28 Skills stehen ohne jede Wertung in der Test-Warteschlange, mehrere davon populär. Wenn ein Skill fehlt, den du liebst: Er hat entweder schlechter abgeschnitten als diese fünfzehn, oder wir sind mit dem Testen noch nicht durch. Wir ranken nichts, was wir nicht ausgeführt haben.
KOSTENLOSES STARTER-PAKET
Fünfzehn sind zu viele für den Anfang. Wir schicken dir die 3 bestbewerteten Skills dieser Liste und die Installations-Checkliste, die wir vor jedem Test durchgehen. Kostenlos.
Kostenloses Starter-Paket holenDie besten Skills nach Anwendungsfall
Die Top 15 sind auf das ausgerichtet, was die meisten am häufigsten tun. Ist dein Arbeitsfeld schmaler, ranken die Kategorieseiten tiefer.
Am besten fürs Coding. TDD und Systematic Debugging sind das Startpaar, und MCP Builder (8,8) ist der Geheimtipp, wenn du interne APIs hast, mit denen Claude reden soll; er brachte uns in etwa einer Stunde von null zu einem funktionierenden MCP-Server. Vollständiges Ranking unter beste Skills fürs Coding.
Am besten für SEO. SEO Audit führt, und Programmatic SEO (8,4) ist einen Blick wert, wenn du Landingpages aus Daten skalierst; er ist darauf gebaut, das Doorway-Page-Spam-Muster zu vermeiden, mit dem sich Sites verbrennen. Der Rest des Feldes ist dünner, als der Hype vermuten lässt. Ranking unter beste Skills für SEO.
Am besten für Token-Effizienz. Wir sind ehrlich: Diese Kategorie steckt größtenteils noch in unserer Test-Warteschlange. Skills wie Token Budget Auditor und Prompt Cache Optimizer machen messbar klingende Versprechen, und messbare Versprechen verdienen eine Messung, bevor wir sie bewerten. Behalte beste Skills für Token-Effizienz im Auge, sobald Ergebnisse eintrudeln.
Am besten für Dokumente. Unsere tiefste starke Kategorie. DOCX, XLSX und PDF Toolkit sitzen alle in den Top 10 oben, und PPTX (8,8) rundet das Set ab; er baute uns aus einem CSV-Briefing ein 12-Folien-Deck mit korrekten Diagrammen, nur eine Tabelle brauchte einen zweiten Anlauf. Ranking unter beste Skills für Dokumente.
Am besten für Design. Frontend Design trägt die Kategorie, und UI Audit (8,4) ist die praktische Fortsetzung: bewertete Accessibility- und Konsistenz-Reviews von Oberflächen, die du bereits ausgeliefert hast. Einer erschafft, der andere prüft. Ranking unter beste Skills für Design.
Am besten fürs Schreiben. Humanizer ist der Headliner, aber Copy Editing (8,8) verdient eine Erwähnung dafür, einen 2.000-Wörter-Artikel zeilenweise lektoriert zu haben, ohne die Stimme des Autors plattzubügeln — genau das, was KI-Lektorat sonst ruiniert. Siehe beste Skills fürs Schreiben.
Am besten für Sales. Cold Email plus Account Research (8,8) ist das natürliche Paar: In unserem Test bewerteten zwei aktive SDRs seine Account-Briefings höher als ihre eigene Vorbereitung. Ranking unter beste Skills für Sales.
Die Top 10 auf einen Blick
| # | Skill | Kategorie | Wertung | Preis | Am besten für |
|---|---|---|---|---|---|
| 1 | Test-Driven Development | Coding | 9,6 | Kostenlos | Entwickler, die Features mit Claude ausliefern |
| 2 | Frontend Design | Design | 9,6 | Kostenlos | Alle, die Web-UI bauen |
| 3 | Humanizer | Schreiben | 9,6 | Kostenlos | Alle, die Texte veröffentlichen |
| 4 | DOCX | Dokumente | 9,6 | Kostenlos | Berichte, Memos, Verträge |
| 5 | Systematic Debugging | Coding | 9,6 | Kostenlos | Bugs, die schon einen Fix überlebt haben |
| 6 | Skill Creator | Coding | 9,6 | Kostenlos | Teams, die eigene Skills schreiben |
| 7 | XLSX | Dokumente | 9,2 | Kostenlos | Chaotische Praxis-Tabellen |
| 8 | PDF Toolkit | Dokumente | 9,2 | Kostenlos | Zusammenführen, Formulare, OCR |
| 9 | SQL Query Writer | Daten | 9,2 | Kostenlos | Analysten und Backend-Devs |
| 10 | SEO Audit | SEO | 9,2 | Kostenlos | Gründer und kleine Marketing-Teams |
Jeder bisher von uns getestete Skill ist kostenlos und Open Source. „Kostenlos" leistet in dieser Spalte noch keine Arbeit — aber bezahlte Skills tauchen langsam im Ökosystem auf, und wir werden sie nach demselben Protokoll bewerten, sobald sie die Warteschlange erreichen.
So installierst du jeden davon
Jede Skill-Seite in unserem Katalog zeigt den exakten Installationsbefehl, den wir beim Testen benutzt haben — meist ein git clone plus ein Kopieren nach ~/.claude/skills/. Das dauert etwa eine Minute pro Skill, und wenn ein Skill darüber hinaus etwas braucht (Playwright für Webapp Testing zum Beispiel), steht es auf der Seite, weil wir selbst über diese Reibung gestolpert sind und sie aufgeschrieben haben. Die vollständige Anleitung — inklusive wo Skills auf der Platte liegen und wie du prüfst, dass einer wirklich triggert — steht in unserem Installations-Guide.
Wenn du lieber nicht einen nach dem anderen installierst: Unsere Skill-Packs bündeln getestete, konfliktfreie Sets für eine Rolle, sodass ein Entwickler oder Marketer den ganzen Stack mit einem Befehl bekommt. Packs enthalten nur Skills, die das Testen bestanden haben; wir polstern sie nicht auf.
SKILLPROOF-PAKET
Wer mehrere davon installiert, steht vor einer praktischen Frage: Was kostet das alles an Tokens? Das Optimizer Pack ist das Effizienz-Setup, das wir selbst fahren: vier Skills, ein entschlacktes CLAUDE.md-Template und eine MCP-Audit-Checkliste, ein Befehl.
Optimizer Pack holen — 10 $FAQ
Sind Claude Skills kostenlos?
Jeder Skill auf dieser Liste ist kostenlos und Open Source, die meisten entweder aus Anthropics offiziellem Repo oder aus Community-Projekten auf GitHub. Bezahlte Skills existieren und es kommen mehr, aber nichts Bezahltes hat es bisher in unsere Top 15 geschafft. Wenn es so weit ist, haben wir dafür bezahlt und es getestet wie alles andere.
Wie viele Skills sollte ich installieren?
Zwei oder drei, die zu deinem tatsächlichen Job passen — nicht fünfzehn. Jeder installierte Skill fügt Claudes Kontext Trigger-Descriptions hinzu, und ein überfülltes Skill-Verzeichnis bedeutet mehr Fehl-Trigger und langsamere Sessions. Wir haben erlebt, wie ein Schreib-Skill eine Coding-Aufgabe gekapert hat, weil beide Descriptions „documentation" erwähnten. Unsere Regel: Installiere für die Arbeit der letzten Woche, nicht für die, die du dir vorstellst — und wirf alles raus, was einen Monat lang nicht getriggert hat.
Funktionieren Skills in der Claude-App oder nur in Claude Code?
Wir testen in Claude Code, und jede Wertung auf dieser Site spiegelt Claude-Code-Verhalten. Viele Skills laden auch in der Claude-Desktop- und Web-App, aber dateilastige Skills (DOCX, XLSX, PDF) hängen an Code-Ausführung und lokalem Dateizugriff, in Claude Code sind sie also am zuverlässigsten. Wirf einen Blick auf die „Getestet mit"-Zeile jeder Skill-Seite.
Was ist der Unterschied zwischen einem Skill und einem MCP-Server?
Ein Skill sind Anweisungen und Referenzdateien, die formen, wie Claude arbeitet; ein MCP-Server ist eine Live-Verbindung zu einem externen Tool oder einer API. Skills brauchen keine Infrastruktur und installieren sich in einer Minute. Willst du, dass Claude sich anders verhält, willst du einen Skill. Willst du, dass Claude ein System erreicht, an das es aktuell nicht herankommt, willst du MCP — und MCP Builder hilft dir beim Bauen.
Wie werden diese Wertungen berechnet?
Vier Komponenten: Installationserlebnis, Trigger-Zuverlässigkeit, Output-Qualität gegen eine Baseline ohne Skill und Dokumentation. Die Output-Qualität zählt doppelt, denn ein Skill, der sich wunderschön installiert und mittelmäßige Arbeit liefert, ist immer noch ein mittelmäßiger Skill. Die vollständige Rubrik, inklusive dessen, was ein Durchfallen auslöst, steht auf der Methodik-Seite. Wir veröffentlichen Testnotizen für jeden Skill — auch für die, die es nicht auf diese Liste geschafft haben.
★ 9.6/10 × 3
Das kostenlose Starterpaket
Die 3 Skills mit unseren besten Testergebnissen plus die Install-Checkliste — das Setup, das wir auf einen frischen Rechner packen würden. Kostenlos, per E-Mail.