A OpenAI prometeu proteções embutidas mais fortes. A Common Sense Media (abre em nova aba), por meio de seu Youth AI Safety Institute, testou a promessa e atribuiu ao produto a pior classificação de sua escala: risco inaceitável para todos os menores de 18 anos. O pedido que acompanha o laudo é direto: suspender a divulgação do modo teen e restringir o ChatGPT a adultos até que a experiência seja segura e adequada ao desenvolvimento.
O objeto da disputa é o ChatGPT for Teens (abre em nova aba), anunciado pela OpenAI em 18 de agosto de 2026 e convertido em experiência padrão para usuários de 13 a 17 anos. Segundo a empresa, o modo reúne notificações aos pais para conversas sobre autoagressão e transtornos alimentares, um Study mode controlável pelos responsáveis, comportamento menos "amistoso", estimativa de idade e garantias alinhadas a um Model Spec para menores de 18, baseado em ciência do desenvolvimento e orientação de especialistas.
O que os testes mediram
A metodologia do avaliador independente (abre em nova aba) é a parte mais sólida do episódio. Os pesquisadores executaram mais de 4.000 prompts, metade antes do lançamento e metade depois, em contas registradas como pertencentes a adolescentes de 13 a 17 anos. As respostas passaram por revisão de especialistas, incluindo psiquiatras da infância e adolescência e um pediatra. Duas ondas separadas permitem isolamento de variável: o que mudou no produto pode ser atribuído ao modo teen, e não a alterações gerais do modelo.

O desenho avalia cinco danos severos tratados como "Red Lines" pelo instituto, entre eles suicídio e autoagressão, transtornos alimentares e roleplay romântico ou sexual. Os resultados não são uniformes. Em uma direção, o ChatGPT não forneceu instruções que facilitassem suicídio, autoagressão ou comportamento sexual, segundo o próprio relatório. Na direção oposta, o sistema falhou exatamente onde a OpenAI concentrou sua comunicação pública: detectar quando um adolescente precisa de ajuda externa e avisar quem é responsável por ele.
Onde as proteções falharam
O problema central dos testes é o alerta parental. Em mais de uma dúzia de contas novas vinculadas a um pai ou mãe registrada, os testadores passaram até uma hora conversando sobre ideação suicida, autoagressão e alimentação desordenada. Os responsáveis vinculados receberam zero notificações sobre essas conversas. Os alertas só chegaram em contas com semanas de histórico de assuntos sensíveis.
A implicação técnica é desconfortável para qualquer arquiteto de sistemas de segurança: o gatilho do alerta aparenta depender de histórico acumulado da conta, e não da gravidade do conteúdo do turno corrente. Um classificador baseado em sinal agregado de longo prazo tem latência exatamente onde a latência é inaceitável. Uma sessão isolada de uma hora sobre suicídio, numa conta sem passado, não dispara nada. O primeiro contato de um adolescente em crise é, por definição, o que acontece sem histórico.
O segundo problema é o encaminhamento de crise. Após o lançamento do modo teen, o ChatGPT deixou de indicar uma linha de crise ou um profissional de saúde mental em mais de um em cada quatro casos em que os especialistas do instituto julgaram o encaminhamento necessário. O sistema ficou abaixo do limiar de 95% de precisão estabelecido pelo instituto em três dos cinco danos severos avaliados. Para um produto cuja proposta de valor inclui proteger adolescentes, errar 25% dos momentos de encaminhamento é errar a função que justifica a existência do produto.
Há ainda a questão dos contornos. Os testadores contornaram facilmente os guardrails de aprendizado e os controles parentais, segundo o levantamento divulgado pela Mashable (abre em nova aba). Controles que dependem de cooperação do usuário controlado não são controles; são interfaces de conformidade.
Resposta da OpenAI e divergência de leituras
A OpenAI contestou a avaliação. Segundo um porta-voz citado pela imprensa, a empresa recebe bem a avaliação independente rigorosa, mas não acredita que os testes da Common Sense Media reflitam com precisão como as salvaguardas do modo teen funcionam na prática. É uma divergência de leitura sobre a ecologia do sistema: de um lado, testes em contas novas que expõem o comportamento do primeiro contato; de outro, a defesa implícita de que o uso real, distribuído no tempo, se sai melhor.
Colocando as versões lado a lado, a divergência não é sobre fatos brutos, e sim sobre quais condições de teste representam o uso real. A OpenAI não divulgou, até a data da reportagem, dados próprios de taxa de disparo de alertas que sustentem a objeção. E o instituto, por sua vez, baseia seu veredito em contas com vinculação parental corretamente configurada, cenário que o produto exige que funcione. A carga da prova, na formulação do próprio relatório, recai sobre quem coloca o produto no mercado. A frase de abertura do material do avaliador resume a posição: é incumbência da OpenAI ganhar a confiança dos pais e mostrar, não apenas dizer, que o produto é seguro para adolescentes.
Contexto regulatório
A avaliação não acontece no vácuo. Segundo o Los Angeles Times (abre em nova aba), o relatório registra que o ChatGPT falhou em testes ligados a três requisitos da Adam's Law, lei da Califórnia sancionada pelo governador Gavin Newsom no mês anterior e vigente a partir de julho de 2027: encaminhamento de crise, alerta aos pais e verificação de idade. Ou seja, o produto avaliado em outubro de 2026 não atende a requisitos que a lei do estado onde a OpenAI tem sede começará a exigir em meados de 2027. As lacunas apontadas pelo instituto não são apenas questões de reputação; são falhas de conformidade antecipada com obrigações legais concretas, no estado que abriga a empresa.
A Bloomberg (abre em nova aba) e o Axios (abre em nova aba) convergem no fato central e nos números: classificação de risco inaceitável, mais de 4.000 prompts, falhas de alerta em contas novas, mais de um em quatro encaminhamentos de crise perdidos. A convergência entre veículos independentes reduz a probabilidade de que os achados centrais sejam artefato de uma única rotina de testes.
O que fica para quem constrói
Para desenvolvedores e times de produto, o episódio expõe três lições sustentadas pelas evidências. Primeiro, salvaguardas dependentes de histórico acumulado têm latência de resposta incompatível com crises, que por natureza chegam sem aviso. Segundo, a taxa de falso negativo em encaminhamento de crise é uma métrica de segurança de primeira ordem, não um refinamento posterior; um sistema que bloqueia conteúdo mas não aciona ajuda no momento certo cumpre metade da função que anuncia. Terceiro, a posição pública da OpenAI, de que os testes não refletem a prática, permanece uma alegação sem dados divulgados que a sustentem, enquanto o lado oposto publicou método, volume e contagem.
A exigência do instituto é restritiva: manter adolescentes fora do ChatGPT, sem exceções, até que a OpenAI ofereça uma experiência segura e adequada ao desenvolvimento. A resposta da OpenAI, até o momento registrada, é uma objeção metodológica sem contrapublicação de números. A cada hora de conversa sobre suicídio sem alerta, a objeção fica mais difícil de defender.
