
← Hipsters Ponto Tech21 Jul · 54 min
Interpretabilidade e alinhamento: Entendendo o comportamento das IAs – Hipsters Ponto Tech #525
Hoje o papo é sobre interpretabilidade em modelos de inteligência artificial!
Neste episódio, conversamos sobre como pesquisas recentes, em especial da Anthropic, vêm buscando entender o que acontece por baixo do capô dos grandes modelos de linguagem, além de como eles chegam a determinadas respostas. De alinhamento a alucinações, passando por reasoning, emoções, J-Space, comportamentos emergentes e os desafios de abrir a caixa-preta das grandes IAs, a conversa é bastante abrangente e repleta de boas referências. Vem ver quem participou desse papo:
Paulo Silveira, o host que usa a palavra governança
Fernanda Kipper, Software Engineer & Founder na kipper.dev
Vinny Neves, cohost, dev e professor na Alura
Fabrício Carraro, co-host do IA Sob Controle, Program Manager da Alura, autor de IA e host do podcast Carreira Sem Fronteiras
Links:
Gemini Notebook (ex-NotebookLM)
Podcast Naruhodo!
O Império da IA
IA Sob Controle 213: O Império da IA – Sonhos e Pesadelos na OpenAI de Sam Altman
Logits: o que acontece antes da IA escolher a próxima palavra