Hugging Face Inference SDK

Modèles d'inférence Hugging Face pour TypeScript : streaming, embeddings, erreurs

par agents-inc · agents-inc/skills

Testé · Fonctionne ★ 7.6/10

Hugging Face Inference SDK — Modèles d'inférence Hugging Face pour TypeScript : streaming, embeddings, erreurs

Ce que fait

Une référence de modèles pour le SDK TypeScript @huggingface/inference couvrant la configuration d'InferenceClient, la complétion de chat et le streaming, les embeddings, la génération d'images, la transcription audio et la gestion typée des erreurs. Se déclenche lorsque vous écrivez du code Node ou TypeScript contre des modèles Hugging Face, des fournisseurs d'inférence ou des Inference Endpoints dédiés. Livré avec deux fichiers d'exemple et une référence de signature de méthode à côté du corps principal.

Rapport de test

Nous avons écrit le même module de chat en streaming plus embeddings deux fois et rejoué un flux Hugging Face réaliste à travers les deux : la version sans compétence a planté avec un TypeError sur un chunk keepalive avec un tableau choices vide, tandis que la version suivant la boucle vérifiée par null de la compétence a renvoyé le texte correct. Le coût est que ses extraits ont divergé du SDK livré — vérifié par type contre @huggingface/inference v4.13.23, le gestionnaire d'erreurs documenté (error.request) ne compile pas car les vrais champs sont httpRequest/httpResponse, l'exemple audio passe un Buffer readFileSync là où les types exigent un Blob ou ArrayBuffer, et textToImage se résout en string, et non le Blob que la documentation promet. L'installation est propre et les trois fichiers référencés (examples/core.md, examples/tasks.md, reference.md) existent réellement.

Testé le: 2026-07-28 · Claude Code 2.x (agent harness)

Installation

git clone https://github.com/agents-inc/skills.git agents-inc-skills
mkdir -p ~/.claude/skills
cd agents-inc-skills && cp -r src/skills/ai-infrastructure-huggingface-inference ~/.claude/skills/ai-infrastructure-huggingface-inference

Commandes et exemples de prompts

  • /ai-infrastructure-huggingface-inferenceModèles d'inférence Hugging Face pour TypeScript : streaming, embeddings, erreurs

Les skills se déclenchent sur des demandes en langage courant — aucune commande à retenir. Après installation, des prompts comme ceux-ci l'activent (en anglais) :

  • Add streaming chat completion with huggingface/inference to our Node app
  • Generate sentence embeddings from a Hugging Face model in TypeScript
  • Point our TypeScript client at a dedicated Hugging Face Inference Endpoint