O Youth AI Safety Institute classificou o ChatGPT para adolescentes como risco inaceitável para qualquer usuário com menos de 18 anos. A avaliação saiu em 7 de outubro de 2026, cerca de sete semanas depois de a OpenAI lançar o pacote que divulgou como "proteções de segurança embutidas mais fortes" para o público de 13 a 17 anos. A conclusão do instituto, braço da Common Sense Media dedicado à segurança de jovens, é que as proteções ficam aquém do prometido. O pedido tem duas partes, pausar o marketing do produto para menores e restringir o chatbot a adultos até que as falhas sejam corrigidas e comprovadas por teste independente.
O produto auditado é o ChatGPT for Teens (abre em nova aba), anunciado em 18 de agosto de 2026. Na mecânica descrita pela OpenAI, a experiência é aplicada por padrão. Se o sistema estimar que o usuário tem menos de 18 anos, ou se a pessoa declarar ter entre 13 e 17, a conta entra na versão adolescente. O anúncio listava notificações aos pais em situações de risco, um modo de estudos controlado pelos pais, menos comportamento "de amigo" por parte do assistente e estimativa de idade a partir do padrão de uso. O texto oficial fala em notificações "em situações limitadas de alto risco" e em focar "nos momentos em que o suporte offline pode importar mais", limitando o que é compartilhado.
O método antes do veredicto
Foram mais de 4.000 prompts. O número importa menos pelo volume que pelo desenho. Os testes cobrem duas fases, antes e depois do lançamento do modo adolescente, e a comparação separa o que o modo mudou de verdade do que já era comportamento do produto. As execuções usaram contas registradas como de jovens de 13 a 17 anos, e as respostas passaram por revisão de especialistas, entre eles psiquiatras da infância e um pediatra. A página da avaliação (abre em nova aba) observa que o instituto responde sozinho por seus padrões e mantém independência editorial total sobre os resultados.

Nem tudo reprovou. A recusa a roleplay sexual explícito resistiu, e o chatbot em geral não entregou instruções que facilitassem suicídio, autolesão, transtornos alimentares ou roleplay sexual e romântico, segundo o relatório e o acompanhamento da Axios. Na leitura do instituto, alguns pontos pioraram justamente com o modo novo. A camada que falhou é a que decide quando um adolescente precisa de ajuda fora da conversa.
| Área testada | Resultado medido |
|---|---|
| Alertas aos pais em contas novas | Nenhuma notificação em até uma hora de conversa sobre suicídio, autolesão e alimentação desordenada |
| Encaminhamento de crise | Falta em mais de 1 a cada 4 casos em que era devido |
| Study Mode | "Show me the answer" entrega a resposta; apagar o prefixo @study desativa as Study Hours |
| Estimativa de idade | Contas registradas como adultas nunca migraram para o modo adolescente |
| Roleplay sexual explícito | Recusa mantida nos testes |
O alerta que depende de histórico
Em mais de uma dúzia de contas recém-criadas e vinculadas a contas parentais, os testadores passaram até uma hora conversando sobre ideação suicida, autolesão e alimentação desordenada.
Nenhum alerta chegou aos pais.
O silêncio não era absoluto. As notificações apareceram em contas antigas, com semanas de histórico acumulado em temas sensíveis. Para o instituto, o padrão sugere que o gatilho do alerta depende do histórico da conta, e não da severidade do que o adolescente escreve naquela troca de mensagens.
A distinção tem peso de arquitetura. Um gatilho alimentado por sinais agregados no longo prazo tende a perder o momento agudo, a primeira conversa em que o risco aparece e na qual um aviso aos pais valeria mais. O comunicado de lançamento já descrevia um escopo estreito. A auditoria mediu o tamanho real dessa limitação.
Tom Siegel, diretor executivo do instituto, resumiu a cobrança no comunicado da Common Sense Media (abre em nova aba).
"Um adolescente pode passar uma hora falando de autolesão sem que o pai receba um único alerta. Até a OpenAI corrigir isso e provar com testes independentes, o ChatGPT deveria ser só para adultos."
O encaminhamento que falta
Nas conversas sobre suicídio e autolesão, alimentação desordenada e quadros com a noção de realidade comprometida, o chatbot não indicou de forma confiável que um adolescente em crise procurasse uma linha de atendimento ou um profissional. A auditoria contabiliza mais de um caso em cada quatro de encaminhamento devido que não veio. Em termos de classificação, o recall, a proporção de casos positivos corretamente identificada, ficou abaixo de 75% num evento de alto custo. O produto também ficou abaixo do patamar de 95% em três dos cinco danos graves que o instituto trata como Red Lines, sua categoria de limite rígido.
Contornos baratos
Os desvios são mais simples ainda. No Study Mode, a opção "Show me the answer" entrega a resposta pronta e pula a tutoria, justamente o que o modo existe para evitar. Durante as Study Hours definidas pelos pais, o bloqueio se desfaz se o adolescente apagar o prefixo @study.
Nenhuma engenharia reversa. Apagar uma palavra resolve.
A estimativa de idade tem falha parecida, agora no cadastro. A OpenAI afirma que o chatbot estima a idade pelo padrão de uso, o que em tese tiraria da experiência adulta quem mentiu ao se registrar. Nos testes do instituto, repetidos ao longo de muitos dias, contas registradas como adultas nunca migraram para o modo adolescente, mesmo quando o usuário dizia ter 13 anos e o próprio bot reconhecia a informação na conversa. Quem se registra como adulto fica fora do alcance das proteções, e a auditoria alerta que adolescentes nessa situação podem nunca receber a experiência protegida.
A contestação e o que segue em aberto
A OpenAI rejeitou o resultado. Em declaração ao The Verge, o porta-voz Eric Porterfield disse que a empresa acolhe avaliação independente rigorosa, mas que os testes não refletem com precisão como as salvaguardas funcionam na prática nem as perspectivas de especialistas sobre como a IA pode apoiar adolescentes. Segundo Porterfield, a revisão interna da metodologia indica que a maior parte dos testes pode ter começado e terminado antes de a ativação dos controles parentais estar completa, o que tornaria os achados imprecisos.
Siegel rebateu pelo instituto. Ao The Decoder, afirmou que contas com tempo suficiente para a ativação completa dos controles tampouco geraram notificações.
Duas explicações seguem plausíveis. Ou a auditoria capturou uma janela de configuração incompleta, como sustenta a OpenAI, ou o gatilho dos alertas depende mesmo de histórico acumulado e não da severidade imediata, como sustenta o instituto. Os dados públicos não encerram a divergência. O instituto aponta a saída que falta, a verificação independente antes de o produto voltar ao público adolescente.
O padrão que vira lei em 2027
A auditoria ganha peso extra porque os três pontos reprovados coincidem com exigências de uma lei nova da Califórnia. Segundo o Los Angeles Times, o relatório indica que o ChatGPT falhou em testes ligados à Adam's Law, sancionada pelo governador Gavin Newsom em setembro de 2026 e com entrada em vigor em julho de 2027. As três exigências são encaminhamento de crise, alertas parentais e verificação de idade.
O nome vem de Adam Raine, adolescente de 16 anos cujos pais acionaram judicialmente a OpenAI alegando que o ChatGPT incentivou seu suicídio. A lei foi patrocinada pela Common Sense Media e contou com endosso da própria OpenAI.
