o projeto

1.01  projeto

Skills para o Genie Code

o agente de IA para engenharia de dados da Databricks

● em curso  ·  catorze skills em uso

O agente de código acerta a lógica, mas erra onde salvar, como nomear e o que registrar. Dá para corrigir isso com instrução escrita? E como é que se prova que corrigiu?

Vista explodida de três planos e uma esteira Delta de quatro camadas, com o agente operando sobre ela
A camada de instruções entre a plataforma e o que o agente produz.

o problema

De onde elas vieram

As skills da plataforma ensinam o agente a usar o Databricks. Não dizem que estratégia de gravação usar, que nome dar a uma tabela ou em que pasta um arquivo novo nasce. Sem nada escrito, o agente decide por conta própria.

  • na conversa

    Eu corrigia o agente, e a correção só valia até o fim daquela sessão.

  • na sessão seguinte

    O mesmo erro voltava, porque nada tinha ficado escrito em lugar nenhum.

  • no projeto da CVM

    Cada erro repetido virou uma instrução escrita para aquele pipeline.

  • em agosto

    As instruções serviam a qualquer projeto e ganharam repositório próprio.

termoscontexto de sessãoinstrução persistenteagente de código

o que é

O que é uma skill

Uma skill é um arquivo de texto com uma regra dentro. O cabeçalho traz a description, que diz em que situações a regra vale e em quais não vale. O corpo diz o que fazer quando a situação aparece. Um arquivo cuida de um assunto só.

naming-conventions/SKILL.md
---
name: naming-conventions
description: Use ao definir, nomear, escolher, estabelecer ou criar
  nomes para assets NOVOS -- notebooks, tabelas, DataFrames, variaveis,
  pastas. Convencoes de numeracao (001_, 103_), principio DRY, padroes
  de caixa (snake_case, PascalCase). NAO use para revisar ou validar
  nomenclatura de codigo existente.
---
# Nomenclatura e Convenções
## Princípios Gerais
## Notebooks
## DataFrames
## Princípio DRY
## Pastas
termosSKILL.mdfrontmatter YAMLAgent Skills

como escolhe

Como o agente escolhe

Antes de responder, o Genie Code compara a tarefa com a description de cada skill disponível e carrega só as que combinam, sem que ninguém indique qual usar. Escolha uma tarefa abaixo e veja quais entram e quais ficam de fora.

quais skills entram nesta tarefa descriptions reais
termosroteamento por descriptioncarregamento por contextocolisão de escopo

as catorze

As catorze juntas

Quase toda description termina dizendo o que a skill não faz e para qual outra o caso deve ir. Cada citação dessas vira uma linha no desenho abaixo. Entre as catorze skills, são trinta linhas, e só duas ficam soltas.

artifact-documentation asset-placement code-review data-quality-guardrails docs-sync eda-and-validation git-workflow medallion-architecture naming-conventions notebook-structure project-context skill-patterns technical-writing unity-catalog-naming

catorze skills

trinta fronteiras declaradas

As duas soltas são a git-workflow e a skill-patterns: não citam nenhuma outra, e nenhuma outra cita as duas.

clique num nó para ler  ·  clique de novo para soltar

termosfronteira negativaseparação de responsabilidadesacoplamento

o que sobreviveu

O que sobreviveu aos testes

No começo as skills não eram acionadas. Formulei três hipóteses sobre o que o acionamento exigia e testei uma de cada vez. Nenhuma se confirmou como exigência técnica, mas duas deixaram uma prática que vale até hoje.

acento
O acionamento exigiria description escrita sem acento.Não exige: a skill é acionada com ou sem acento. Das três, foi a única que caiu sem deixar prática nenhuma.
fronteira
Sem dizer o que não faz, a skill não seria acionada.É acionada. A fronteira ficou porque, sem ela, a naming-conventions disputaria toda revisão com a code-review.
verbo
A description pediria verbo imperativo em formato fixo.Não pede, o agente entende a intenção. Ficou um verbo por skill, porque duas com o mesmo verbo entram juntas.
termosteste isoladohipótese refutadaprotocolo dos testes ↗

a avaliação

Como se prova

Nada do que está acima diz se as skills mudam o resultado do trabalho. O agente podia já fazer tudo aquilo sozinho, e eu não tinha como saber sem medir. A medida é o mesmo trabalho feito duas vezes, trocando uma única coisa.

mesmo projeto de dados  ·  mesmos pedidos  ·  mesma ordem

braço 1

as treze skills em avaliação, ativas

braço 2

as mesmas treze skills, desligadas

cada sessão transcrita, com o raciocínio do agente  ·  skills congeladas num commit

ler a avaliação

estado

Onde isso está hoje

As catorze estão num repositório público, com cada mudança registrada em commit desde que saíram do projeto da CVM. Lá dá para ler cada regra por inteiro, e não só o pedaço que aparece nesta página como exemplo.

em uso
As catorze rodam no meu workspace, no nível de usuário, durante o desenvolvimento dos projetos deste portfólio
em avaliação
Treze delas entram no teste. A skill-patterns fica fora porque trata de escrever skills, e não de engenharia de dados
o que vem
Refatoração profunda quando os testes fecharem, com base no que a avaliação mostrar sobre cada uma

repositório