Hugging Face Inference SDK
Modèles d'inférence Hugging Face pour TypeScript : streaming, embeddings, erreurs
Testé · Fonctionne
Ce que fait
Une référence de modèles pour le SDK TypeScript @huggingface/inference couvrant la configuration d'InferenceClient, la complétion de chat et le streaming, les embeddings, la génération d'images, la transcription audio et la gestion typée des erreurs. Se déclenche lorsque vous écrivez du code Node ou TypeScript contre des modèles Hugging Face, des fournisseurs d'inférence ou des Inference Endpoints dédiés. Livré avec deux fichiers d'exemple et une référence de signature de méthode à côté du corps principal.
Rapport de test
Nous avons écrit le même module de chat en streaming plus embeddings deux fois et rejoué un flux Hugging Face réaliste à travers les deux : la version sans compétence a planté avec un TypeError sur un chunk keepalive avec un tableau choices vide, tandis que la version suivant la boucle vérifiée par null de la compétence a renvoyé le texte correct. Le coût est que ses extraits ont divergé du SDK livré — vérifié par type contre @huggingface/inference v4.13.23, le gestionnaire d'erreurs documenté (error.request) ne compile pas car les vrais champs sont httpRequest/httpResponse, l'exemple audio passe un Buffer readFileSync là où les types exigent un Blob ou ArrayBuffer, et textToImage se résout en string, et non le Blob que la documentation promet. L'installation est propre et les trois fichiers référencés (examples/core.md, examples/tasks.md, reference.md) existent réellement.
Testé le: 2026-07-28 · Claude Code 2.x (agent harness)
Installation
git clone https://github.com/agents-inc/skills.git agents-inc-skills mkdir -p ~/.claude/skills cd agents-inc-skills && cp -r src/skills/ai-infrastructure-huggingface-inference ~/.claude/skills/ai-infrastructure-huggingface-inference
Commandes et exemples de prompts
/ai-infrastructure-huggingface-inferenceModèles d'inférence Hugging Face pour TypeScript : streaming, embeddings, erreurs
Les skills se déclenchent sur des demandes en langage courant — aucune commande à retenir. Après installation, des prompts comme ceux-ci l'activent (en anglais) :
Add streaming chat completion with huggingface/inference to our Node appGenerate sentence embeddings from a Hugging Face model in TypeScriptPoint our TypeScript client at a dedicated Hugging Face Inference Endpoint