Transformer Lens Interpretability

Fornece orientação para pesquisa de interpretabilidade mecanística usando TransformerLens para inspecionar e manipular internals de transformers via HookPoints e caching de ativações. Use ao fazer engenharia reversa de algoritmos de modelos, estudar padrões de atenção ou realizar experimentos de activation patching.

artubss Updated 10 repo stars

File contents

artubss/SKILLS-CLAUDE-CODE/tree/main/skills/skills/ai-research/mechanistic-interpretability-transformer-lens commit 0cd755d59f

Frequently asked questions

npx skillmds@latest add artubss/transformer-lens-interpretability