Resumo
- É preciso separar cobertura ampla de raciocínio robusto, memória, ação e adaptação.
- A avaliação exige tarefas inéditas, condições mutáveis, custo da falha e réplica independente.
IA geral descreve capacidade entre domínios, não excelência numa tarefa. Modelos atuais parecem amplos porque uma interface alcança muitos padrões aprendidos, mas essa amplitude pode ruir diante de regras novas, contexto ausente ou ação longa. Desenvolvedores e compradores devem publicar limites, controles de contaminação, recursos e consequências do erro. A próxima prova é avaliação independente em trabalho realmente inédito, inclusive pedidos que o sistema deve recusar ou devolver. O rótulo deve vir depois da transferência e do controle demonstrados.


