Seminário técnico de segurança da IA

As capacidades da IA avançam mais rápido do que a segurança. Seis semanas sobre como fechar essa lacuna: treinar modelos mais seguros, avaliá-los, olhar dentro deles e limitar o dano quando falham. Para quem tem base técnica.

De 12 de outubro a 22 de novembro de 2026. Vagas limitadas: inscreva-se até 9 de outubro.

As capacidades avançam mais rápido que a segurança

As capacidades da IA avançam mais rápido que a segurança, e o campo precisa de mais gente técnica trabalhando nisso. Os problemas continuam em aberto: ainda não sabemos medir com confiança o que um modelo pode e quer fazer, nem entender o que ele calcula por dentro, nem garantir que um sistema capaz não cause dano se algo falhar.

O Seminário técnico de segurança da IA é um percurso por esses problemas e pelos métodos com que hoje se tenta resolvê-los: RLHF, avaliações, interpretabilidade mecanicista e AI control. As leituras são as criadas pela BlueDot Impact; a AI Safety Colombia conduz esta turma por conta própria, com facilitadores da comunidade.

Prefere fazê-lo on-line e em inglês? Inscreva-se diretamente na BlueDot.

Para quem já entende como um modelo é treinado e quer trabalhar para torná-lo seguro

Basta entender o básico de como um LLM é treinado; se ainda não entende, o curso AI Foundations da BlueDot, de duas horas, dá essa base. O seminário foi pensado para:

  • Pesquisa em ML

    Você faz pesquisa em machine learning e quer apontá-la para alinhamento, avaliações ou interpretabilidade.

  • Engenharia de software

    Você constrói sistemas com modelos e quer passar a trabalhar na segurança dos modelos que usa.

  • Matemática e ciência da computação

    Você tem a base formal e quer ver quais problemas do campo precisam dela.

  • Estudantes que já levam a sério

    Você está pensando em fellowships como MATS, SPAR ou ARENA, ou numa pós-graduação, e quer chegar com critério.

Não é uma introdução à IA. Pressupõe que você já sabe como um modelo funciona e quer a segurança que vai por baixo.

Se prefere começar pelo panorama estratégico, veja o Seminário de futuro e riscos da IA.

Uma turma pequena que discute toda semana

Toda semana começa com uma hora de material leve (vídeos e podcasts) e segue com uma sessão de duas horas com a turma: leitura aprofundada e discussão. São cerca de três horas por semana, em um horário definido com os participantes selecionados. Todas as leituras e vídeos são em inglês, como a BlueDot os publica; a discussão é em espanhol. A modalidade é mista: há sessões presenciais na Universidad de los Andes e sessões on-line, e cabe junto com o trabalho ou a faculdade. Nas sessões presenciais tem comida grátis.

Os facilitadores são Helen Stefany Penagos (Mastercard) e Andrés Mosquera (Universidad de los Andes). A discussão é onde os pressupostos são postos à prova e onde as leituras se conectam com o trabalho feito em laboratórios e organizações de pesquisa, e a turma fica como uma comunidade de pares com quem seguir explorando o campo depois do seminário.

Seis semanas, do problema de fundo ao seu próximo passo

Toda semana: uma hora de material leve e uma sessão de duas horas, de leitura aprofundada e de discussão. As sessões se alternam: a primeira semana é presencial, a segunda on-line, e assim até o fim. O horário das sessões é definido de acordo com a disponibilidade dos participantes selecionados.

  1. Semana 1Presencial

    O que é preciso para a IA dar certo

    Por que os modelos atuais não são seguros por padrão e quais abordagens técnicas existem para mudar isso.

  2. Semana 2On-line

    Treinar modelos mais seguros

    Como funciona o RLHF, que outros métodos se usam para ajustar um modelo e em que casos não bastam.

  3. Semana 3Presencial

    Avaliações

    Como se mede o que um modelo é capaz de fazer e como se procura saber se ele está escondendo algo.

  4. Semana 4On-line

    Interpretabilidade mecanicista

    As técnicas para ver o que uma rede neural calcula por dentro e até onde chegam hoje.

  5. Semana 5Presencial

    Minimizar o dano

    Como se limita o que um modelo pode fazer mesmo que esteja desalinhado, com AI control e classificadores constitucionais.

  6. Semana 6On-line

    Como começar a contribuir

    Quais problemas em aberto combinam com o que você já sabe fazer e como dar o primeiro passo.

Ver o programa completo na BlueDot

Um mapa técnico, critério e um próximo passo

  • Um mapa das abordagens técnicas da segurança e de qual problema cada uma ataca.

  • Critério para ler um paper do campo: o que uma avaliação mede, o que um resultado de interpretabilidade mostra e o que não mostra.

  • Clareza sobre onde suas habilidades se encaixam e qual é seu próximo passo: um hackathon, um fellowship ou um projeto próprio.

  • Uma turma de pessoas técnicas na Colômbia, e um certificado da AI Safety Colombia.

As inscrições foram encerradas

As inscrições desta turma foram encerradas na sexta-feira, 9 de outubro.

Perguntas frequentes

  • Quanta formação técnica eu preciso?

    Você deve entender o básico de como os LLMs são treinados e ajustados, que o progresso da IA é movido por dados, algoritmos e computação, e que uma rede neural é otimizada com descida de gradiente. O curso AI Foundations da BlueDot, de duas horas e no seu ritmo, dá essa base.

  • Preciso fazer o Seminário de futuro e riscos da IA antes?

    Não é obrigatório, mas ajuda: o Seminário de futuro e riscos da IA dá o contexto sobre o qual este seminário se constrói. Se você se inscrever neste e não for aceito, no formulário pode pedir para ser considerado para o Seminário de futuro e riscos da IA.

  • Há seleção ou entra todo mundo que se inscreve?

    Há seleção: as vagas são limitadas. Lemos cada inscrição e escolhemos pelo que você escrever e pelo encaixe com o perfil que esta página descreve. Avisamos a todos, aprovados ou não, antes de a turma começar.

  • Em que horário são as sessões?

    O horário é definido com os participantes selecionados: antes de começar perguntamos quais faixas funcionam para eles e fixamos a que melhor atende à turma.

  • Em que idioma é?

    As discussões são em espanhol. Todas as leituras, vídeos e podcasts são em inglês, como a BlueDot Impact os publica, então é preciso ler inglês com conforto.

  • O que preciso para receber o certificado?

    Participar das sessões de discussão: você pode faltar a uma, no máximo. É a mesma regra que a BlueDot Impact usa em suas turmas. O certificado é emitido pela AI Safety Colombia pela conclusão do seminário, baseado no currículo da BlueDot Impact.

  • Qual a relação com a BlueDot Impact?

    A BlueDot Impact criou o programa e publica seus materiais. A AI Safety Colombia conduz esta turma por conta própria, com esses materiais e com facilitadores da comunidade.