Claude Code vs Codex CLI: Kjører samme SKILL.md på begge?

Claude Code vs Codex CLI: Kjører samme SKILL.md på begge?

SKILL.md-portabilitet: En teknisk titt på Claude Code vs. Codex CLI

SKILL.md-formatet er en enkel, kraftig standard for å utvide kapasiteten til kodeagenter. Både Anthropics Claude Code og OpenAIs Codex CLI støtter det. Dette leder til et kritisk spørsmål for utviklere: kjører den samme SKILL.md-filen på begge? Det enkle svaret er ja, selve filen er portabel. Det nyttige svaret er mer komplekst, og har mindre å gjøre med filformatet og mer med kjøremiljøet hver agent tilbyr.

Hos SkillProof installerer og kjører vi Claude Code-skills på reelt arbeid for å se om de består. Vi publiserer resultatene, inkludert feil. Av 2090 skills testet i et Claude Code-miljø, besto 1291 (62 %), 697 leverte kun etter konfigurasjon som oppføringen må beskrive for deg, og 102 endte med en 'feilet'-vurdering: noen kjørte og etterlot deg i en verre tilstand enn uten noen skill i det hele tatt, andre kunne ikke kjøre i det hele tatt på grunn av en manglende CLI, en død avhengighet, eller et eksempel som krasjer. Vi har aldri kjørt en skill på Codex CLI. Hele vårt datasett er basert på kjøring i Claude Code.

Imidlertid inneholder vårt testkorpus et unikt, enveis sett med bevis. Denne artikkelen undersøker de tekniske forskjellene mellom hvordan de to agentene håndterer SKILL.md og hva våre Claude-eneste data avslører om portabilitet fra Codex til Claude.

Fellesnevneren: SKILL.md-formatet

Før vi sammenligner agentene, er det essensielt å forstå hva en SKILL.md-fil er. Det er en tekstfil som kombinerer instruksjoner for agenten med metadata. Strukturen er rett frem:

  1. YAML Frontmatter: En blokk øverst i filen, avgrenset av ---, inneholder nøkkel-verdi-par. name og description er fundamentale. Agenten bruker beskrivelsen for å avgjøre når den skal aktivere en skill. En valgfri allowed-tools-nøkkel navngir verktøy som en skill ønsker forhåndsgodkjent, slik at den ikke stopper for å spørre midt i kjøringen. Det er et bekvemmelighetsfelt, ikke en sandkasse: det fjerner ikke verktøy fra modellen. Du kan finne en detaljert gjennomgang i vår referanse for frontmatter.
  2. Markdown Body: Under frontmatter-blokken er instruksjonssettet for agenten, skrevet i ren markdown. Dette forteller modellen hvordan den skal utføre oppgaven, steg for steg.
  3. Medfølgende filer: En skill kan inkludere andre filer, som skript eller referansedata, som pakkes sammen med den.

Viktigst av alt, SKILL.md inneholder ingen funksjonssignaturer eller argumentskjemaer. Det er et instruksjonsformat i naturlig språk, ikke et strukturert manifest for funksjonskall. Det er domenet til MCP, en separat og distinkt protokoll. For en dypere gjennomgang av dette, se vår sammenligning av Claude Skills vs. MCP.

Fordi SKILL.md bare er strukturert tekst, kan enhver kompatibel parser lese den. Både Claude Code og Codex CLI kan laste den samme filen uten modifikasjoner. Forskjellen er hva som skjer etterpå.

Innlasting og kjøring: To forskjellige miljøer

Selv om filen er den samme, er ikke konteksten den kjører i det. Agentens arkitektur, standardinnstillinger og tilgjengelige verktøy definerer kjøremiljøet. Det er her de praktiske forskjellene mellom Claude Code og OpenAI Codex kommer til syne.

Claude Code

I vårt arbeid tester vi utelukkende med Claude Code. Skills lastes fra ~/.claude/skills for personlige skills og .claude/skills inne i et prosjekt for repo-spesifikke. Når du gir agenten en oppgave, matcher den din prompt mot description-feltet i alle tilgjengelige skills. Du kan også kalle en direkte ved navn med en skråstrek-kommando.

En kritisk oppførsel vi har dokumentert er dens feilmodus. Hvis YAML frontmatter i en SKILL.md-fil er feilformatert – en feilplassert tab, et manglende anførselstegn – produserer ikke Claude Code en valideringsfeil. En skill blir rett og slett usynlig for agenten. Den vil ikke bli listet opp, og den vil aldri bli utløst. Denne stille feilen kan være vanskelig å feilsøke, et tema vi dekker i vårt innlegg om hva du skal gjøre når en skill ikke utløses.

Vår metodikk innebærer å kjøre hver skill mot en reell oppgave. Resultatene fra våre 2090 tester viser at 'bestått' ikke er garantert. De 697 skills som endte med 'oppsett' krevde ikke-triviell konfigurasjon som vi måtte dokumentere. De 102 som 'feilet' kunne enten ikke kjøre i det hele tatt på grunn av manglende avhengigheter, eller produserte et resultat som var verre enn å ikke bruke en skill.

Codex CLI

Codex CLI er en åpen kildekode terminal-kodeagent fra OpenAI. Det er ikke en API-wrapper; det er et frittstående verktøy som leser en kodebase, utfører redigeringer i flere filer og kjører kommandoer i ditt lokale miljø. Det lanserte SKILL.md-støtte i desember 2025, i utgangspunktet som en eksperimentell funksjon.

Søkestiene har endret seg siden lanseringen, noe som er verdt å vite hvis du følger en eldre guide. Gjeldende OpenAI-dokumentasjon lister .agents/skills i arbeidskatalogen og dens foreldrekataloger for repo-spesifikke skills, $HOME/.agents/skills for personlige, og /etc/codex/skills for maskin-brede skills. Den opprinnelige ~/.codex/skills-plasseringen er den du fortsatt vil se i de fleste tredjeparts skill-READMEs. En skill kan aktiveres eksplisitt ved å skrive $ og velge fra listen, eller den kan utløses implisitt hvis en oppgave matcher beskrivelsen.

Dens primære konfigurasjonsfil er ~/.codex/config.toml, og dens kjerneinstruksjonssett kan tilpasses via en fil kalt AGENTS.md. Dette gir et annet inngangspunkt for tilpasning sammenlignet med Claude Codes skill-sentriske modell.

Så, støtter Codex SKILL.md? Ja, innebygd. Filformatet er en førsteklasses borger. Avviket kommer fra miljøet det tilbyr for at filen skal kjøre i.

Enveis portabilitet: Hva våre data viser

Dette er kjernen i saken. Vi har aldri testet en skill på Codex CLI. Vi kan ikke gi en bestått-rate for Codex eller en direkte, side-om-side sammenligning basert på våre egne testdata. Å hevde noe annet ville være å finne opp et datasett.

Det vi kan tilby er et ærlig blikk på et spesifikt mønster i våre Claude Code-testresultater. Av de 2090 skills vi har testet, viser notatene våre at 47 av dem nevner eller antar et Codex-miljø. Disse skills ble skrevet for Codex, men vi kjørte dem i et Claude Code-miljø. Dette gir oss et unikt, enveis syn på portabilitet.

Resultatene for de 47 skills er:

  • Bestått: 11
  • Oppsett: 34
  • Feilet: 2

Dette forteller en klar historie: en SKILL.md-fil skrevet for Codex vil med stor sannsynlighet kreve manuelt oppsett for å kjøre på Claude Code. Det er ikke fordi filen er ugyldig, men fordi instruksjonene i en skill er avhengige av verktøy eller stier som ikke finnes i det nye miljøet.

La oss se på spesifikke eksempler fra vår katalog:

  • Generate 2D Map (Vurdering: Oppsett): README-filen for denne skillen oppgir eksplisitt at den er for Codex/Grok og lister installasjonsstier som ~/.codex/skills og ~/.grok/skills, ikke ~/.claude/skills som oppføringen hevdet. Dens primære pipeline trenger et innebygd verktøypar for bildegenerering og bildevisning som Claude Code ikke har. Vi testet den på den ene branchen som ikke trenger bilder – bygging av et Tiled ortogonalt kart som JSON – og skillen presterte nøyaktig likt som grunnmodellen: byte-identiske tile-arrays, identiske spawn- og exit-metadata. Filen ble lastet inn; den delen som gjorde den verdt å installere, kjørte ikke.

  • Generate 2D Sprite (Vurdering: Oppsett): Denne skillen har det samme problemet. Den har en hard avhengighet til bildegenereringskapasiteter som følger med Codex og Grok, men ikke Claude Code. Den kan planlegge et sprite sheet, men den kan ikke utføre det siste steget med å produsere grafikken.

  • Ablation Planner (Vurdering: Oppsett): Hovedmekanikken i denne skillen innebærer å overlate designarbeid til et spesifikt Codex-verktøy. Når den ble kjørt i vårt Claude Code-miljø, var det verktøyet utilgjengelig. Steget måtte utføres manuelt, noe som er definisjonen på en 'oppsett'-vurdering.

Disse eksemplene viser at SKILL.md-filen er portabel, men logikken i skillen er det kanskje ikke. Instruksjonene er bare tekst; hvis de instruerer agenten til å bruke et verktøy som ikke finnes, vil prosessen stoppe.

Motsatt besto 11 av disse Codex-orienterte skills uten problemer. Skills som Better Codex og PinMe Share besto våre tester på Claude Code. Begge har sin verdi i tekst fremfor i leverandørspesifikke verktøy. Better Codex er et rent prompt-basert atferdsoverlegg uten eksterne filer eller skript, og den slo likevel grunnmodellen på en config-parser-oppgave, der grunnmodellen stille feilet på verdier som inneholdt et likhetstegn. PinMe Share installeres fra en enkelt gyldig SKILL.md uten løse referanser, og dens fordel er nøyaktig kunnskap om en vanlig npm CLI: den produserte den kanoniske opplastingskommandoen og de nødvendige autentiseringsstegene, der grunnmodellen gjettet på kommandoen og hoppet over innloggingen. Det er slik en portabel skill ser ut. Den trenger et verktøy du kan installere, ikke et innebygd verktøy som følger med en leverandørs agent.

Hovedforskjeller i et nøtteskall

En direkte sammenligning fremhever avveiningene når man vurderer codex cli eller claude code for koding med skills.

Funksjon Claude Code Codex CLI
Skill-sti ~/.claude/skills (personlig), .claude/skills (prosjekt) $HOME/.agents/skills (personlig), .agents/skills (repo), /etc/codex/skills (maskin)
Konfigurasjon settings.json, pluss CLAUDE.md for instruksjoner ~/.codex/config.toml, pluss AGENTS.md for instruksjoner
Sandkasse Opt-in; miljøvariabler arves fra foreldreskallet På som standard i workspace-write, nettverk av med mindre det er aktivert
Feilformatert SKILL.md Laster ikke, uten feilmelding (Oppførsel ikke testet av oss)

Avveiningen med sandkassen

Den mest betydningsfulle forskjellen i kjøremiljøene er standardoppførselen for sandkassen.

Codex CLI, ifølge dokumentasjonen, opererer med en strengere standard sikkerhetspositur. I sin workspace-write-modus er nettverkstilgang deaktivert med mindre du eksplisitt aktiverer det i config.toml. Filsystemskriving er begrenset til gjeldende arbeidsområde, og agentens godkjenningspolicy er som standard å be om bekreftelse før handling. Dette er en 'default-deny'-modell.

Claude Code, som dokumentert av Anthropic, har en annen tilnærming. Sandkasse er noe du slår på, ikke noe du slår av, og selv når den er på, arver skallet som standard miljøet fra foreldreprosessen. Dette betyr at hvis du har legitimasjon som AWS_ACCESS_KEY_ID eksportert i terminalsesjonen din, kan en skill aktivert av Claude Code potensielt lese dem. Det gjør at skills som snakker med eksterne tjenester eller lokal legitimasjon fungerer rett ut av boksen, og det legger byrden med å håndtere den eksponeringen på deg.

Ingen av tilnærmingene er i seg selv bedre; det er en avveining. Codex sin modell prioriterer sikkerhet som standard, noe som potensielt krever mer konfigurasjon for å få en nettverksbasert skill til å kjøre. Claude Codes modell prioriterer funksjonalitet rett ut av boksen, noe som potensielt eksponerer mer av vertsmaskinens miljø. En skill som bruker curl for å kalle et API, kan fungere på Claude Code, men vil som standard bli blokkert på Codex CLI.

Beslutningsregelen: Vurder miljøet, ikke filen

Så, Claude Code vs Codex CLI: hvilken bør du bruke for skills?

Våre data gir et ærlig, om enn ufullstendig, svar. SKILL.md-filformatet i seg selv er ikke den avgjørende faktoren. Den samme filen vil lastes på begge plattformer. Den virkelige avgjørelsen avhenger av kjøremiljøet og avhengighetene til de skills du vil kjøre.

  1. Sjekk verktøyavhengigheter: Er skillen avhengig av innebygde, agentspesifikke verktøy (som bildegenereringen i Generate 2D Map)? I så fall vil den ikke være portabel.
  2. Sjekk for universelle CLI-avhengigheter: Bruker skillen kun allestedsnærværende kommandolinjeverktøy? Den har stor sjanse for å være portabel, som vist av de 11 Codex-orienterte skills som besto i vårt Claude Code-miljø.
  3. Vurder din sandkasse-preferanse: Foretrekker du et system som er låst som standard og krever eksplisitte tillatelser (Codex CLI)? Eller foretrekker du et som fungerer med mindre friksjon rett ut av boksen, men arver hele din miljøkontekst (Claude Code)?

Vi kan ikke kåre en universell vinner fordi vi ikke har testet på begge plattformer. Valget avhenger av dine spesifikke behov og sikkerhetspositur. Det vi kan si med sikkerhet, er at det er en feil å anta at en skill vil fungere bare fordi SKILL.md-filen er kompatibel. Miljøet er alt.

Relatert lesing: AGENTS.md vs Claude Skills dekker den andre halvdelen av spørsmålet om kryssverktøy – instruksjonsfilen hver agent leser før noen skill lastes. Og hvis du velger mellom terminalagenter på andre grunnlag enn skills, går Claude Code vs Cursor gjennom den avveiningen.

Hos SkillProof ligger vår verdi i å eliminere denne usikkerheten for Claude Code-økosystemet. Vi gjør testingen slik at du slipper. Hver 'bestått'-vurdering i vår katalog representerer en skill vi installerte og kjørte på Claude Code, på reelt arbeid. For et kuratert utgangspunkt samler våre rollebaserte skill-pakker ti testede skills for én jobbfunksjon – utvikler, sikkerhetsgjennomgang, markedsføring, design og fire til – for $10 per pakke, med hver skills vurdering oppgitt på forhånd.

★ 9.6/10 × 3

Den gratis startpakken

De 3 skillsene med våre høyeste testscorer pluss installasjonssjekklisten — oppsettet vi selv ville lagt på en fersk maskin. Gratis, på e-post.

Én e-post med pakken + en kort ukentlig oppsummering av nye testresultater. Meld deg av når du vil.