Gemini 3.8 Live: Extended Thinking; Typesafe lança System One

Gemini 3.8 Live ganha Extended Thinking
O Google publicou no blog oficial os modelos Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking (15/09). A linha Live é a de conversa em tempo real do Gemini — voz e áudio ao vivo, sem aquele passo de transcrever primeiro. A novidade do nome: o modo Extended Thinking, que faz o modelo gastar mais tokens de raciocínio antes de responder, agora chega à interface ao vivo. No Hacker News, 427 pontos e 281 comentários.
O que mudou: até aqui, raciocínio estendido era recurso de prompt de texto — você pedia, o modelo "pensava" e devolvia. Levar isso para o Live significa um assistente de voz que pausa, pondera e responde em tempo real, e aí latência vira decisão de produto: quanto tempo o usuário aceita esperar por uma resposta mais funda.
Por que importa: Extended Thinking é literalmente queimar mais token por resposta. Para quem roda agente, é a diferença entre resposta barata e resposta cara. Se "pensar antes de falar" virar padrão nos assistentes de voz, o custo por sessão sobe na indústria inteira — e o placar sente.
System One Models e Jev: o lançamento que dominou o HN
A Typesafe apresentou os System One Models e o Jev (typesafe.ai, 15/09). Foi a maior notícia da janela no Hacker News: 1.465 pontos e 421 comentários.
O que dá para cravar sem extrapolar: é um lançamento de modelos batizado com referência direta à psicologia cognitiva — "System One" é o pensamento rápido e intuitivo, em contraste com o deliberado "System 2" que virou sinônimo de chain-of-thought. A leitura do nome aponta para a aposta oposta à moda: responder já, sem sobrecarregar o raciocínio. O Jev acompanha os modelos; os detalhes técnicos estão no post da fonte.
Por que importa: depois de um ciclo em que todo mundo correu para "pensar mais", aparece um lançamento apostando em "pensar menos e responder imediato" — a mesma tensão que o paper SKIP de hoje ataca por outro lado. Se colar, mexe direto no custo de token de quem roda agente.
Baseten: GitHub de produção exposto por PAT vazado
A Strix publicou o relato "We got admin access to Baseten's production GitHub" (15/09; 287 pontos e 164 comentários no HN): acesso de administrador ao repositório de produção da Baseten obtido por um PAT (personal access token) vazado.
Contexto: PAT vazado é a falha clássica de dev — token sem expiração, escopo largo, esquecido num log, num repositório ou num runner de CI/CD. Aqui, o alvo é uma empresa de deploy de modelos de IA, ou seja, o caminho até a infraestrutura de produção de quem serve modelo em escala.
Por que importa: quem queima token com Claude Code vive de PAT e chave de API em CI/CD. Se uma empresa que vende deploy de modelo tem o GitHub de produção tomado por um token vazado, o recado vale para todo mundo: revise escopo e expiração dos seus tokens hoje.
Status do TOKEN CLUB
Placar
- 🥇 Kogu — 3.128.141.947 tokens
- 🥈 Xepa — 3.035.251.037
- 🥉 JOAO_AMORIM — 2.694.799.519
- 4º Tetz — 302.210.242
Kogu segue na ponta com 92.890.910 tokens de vantagem sobre Xepa (3,06%). O pódio continua isolado: JOAO_AMORIM está 340.451.518 atrás do 2º, e Tetz a 2,39 bilhões do 3º. São 10 jogadores no clube; 4 pontuam.
Índice
- Hoje (16/09): sem dado — nenhuma máquina reportou ainda.
- Ontem (15/09): 91.509.794 tokens, 1 sessão, 1 jogador.
- Dia normal: 331.184.950 tokens (janela de 5 dias).
O clube segue morno e o placar não mexeu. Quem aparecer para queimar token hoje decide se a distância Kogu–Xepa encolhe ou estica.