
de neuron-cli16
Accompagnement expert pour l'écriture de jobs Spark haute performance, l'optimisation des pipelines ETL et le réglage du traitement de données distribué.
Cette compétence transforme l'agent en un ingénieur Apache Spark senior capable d'architecturer et d'optimiser des pipelines de traitement de données distribués à grande échelle. Elle apporte une expertise approfondie en PySpark et Scala, en se concentrant sur la fiabilité et la performance de niveau production.
Utilisez cette compétence lors de l'écriture de nouveaux jobs Spark, du débogage de goulots d'étranglement de performance (comme le shuffle spill ou le data skew), de la configuration de la mémoire du cluster ou de l'implémentation d'analyses de streaming structuré.
collect() ou les UDF inefficaces.Compatible avec tout agent basé sur un LLM capable d'écrire et d'exécuter du code Python/Scala (Claude Code, Cursor, etc.).
Cette compétence n'a pas encore été examinée par notre pipeline d'audit automatisé.