INSTITUTO PORTUGUÊSINTELIGÊNCIA ARTIFICIALGlossário ←
Início→Glossário→AI Safety
§ Fundamentos

AI Safety

Também conhecido como: segurança em IA · alinhamento

AI Safety é o campo da investigação focado em garantir que sistemas de IA, à medida que ganham capacidade, permanecem alinhados com objetivos humanos benéficos. Subáreas: alinhamento (alignment), interpretabilidade (perceber porquê o modelo decidiu X), robustez adversarial, jailbreaks, riscos catastróficos. Líderes: Anthropic, OpenAI, DeepMind, MIRI, ARC. Em 2026 é uma exigência regulatória do EU AI Act para sistemas de «alto risco».

Termos relacionados
  • Constitutional AI
  • Anthropic
Aprender AI Safety na prática

O Instituto Português de IA ensina este e outros temas em formações estruturadas com projetos. Começa pelo curso gratuito (48 aulas).