Spark Advisor
Trasforma le metriche di Spark History Server in risultati di skew/GC/shuffle con rating di gravità e soglie esatte.
Promosso
Cosa fa
Spark Advisor è una skill di Claude Code che pilota la CLI spark-history-cli contro un Spark History Server in esecuzione per diagnosticare app Spark e query SQL lente, confrontare esecuzioni TPC-DS/benchmark e produrre raccomandazioni di tuning. Attivala quando l'utente chiede perché un job o una query Spark è lenta, vuole confrontare due esecuzioni, o chiede informazioni su skew, pressione GC, overhead di shuffle, spill, o problemi specifici di Gluten/Iceberg/Delta.
Rapporto di test
pip install spark-history-cli è riuscito davvero e la CLI funziona, ma questa sandbox non ha Java/Spark per avviare un vero History Server, quindi le soglie diagnostiche (p95/p50>10x skew, GC>20%, shuffle>2x input) sono state verificate rispetto a uno scenario di metriche descritto piuttosto che a un pull live — evidenza, non fede. Da segnalare: il repository contiene due copie di SKILL.md (skills/spark-advisor e spark_history_cli/skills/spark-advisor) e quella impacchettata è obsoleta, mancando le sezioni Quick Start e SQL Plan Analysis presenti nella copia canonica di livello superiore utilizzata per l'installazione.
Testato il: 2026-07-14 · Claude Code 2.x (agent harness)
Installazione
git clone https://github.com/yaooqinn/spark-history-cli cd spark-history-cli mkdir -p ~/.claude/skills cp -r skills/spark-advisor ~/.claude/skills/spark-advisor
Comandi e prompt di esempio
/spark-advisorTrasforma le metriche di Spark History Server in risultati di skew/GC/shuffle con rating di gravità e soglie esatte.
Gli skill si attivano con richieste in linguaggio naturale, senza comandi da ricordare. Dopo l'installazione, prompt come questi lo attivano (in inglese):
My Spark job is slow, here's the history server metrics for itThis TPC-DS query has bad stage skew, can you diagnose it?GC time is eating my Spark job, help me tune the executors