A Sampura Research foi lançada publicamente em 25 de agosto de 2026, e não em 24 de agosto, para desenvolver sistemas híbridos de avaliação de modelos avançados. A organização argumenta que a supervisão feita apenas por IA pode não detectar falhas inéditas, ser manipulada pelo sistema avaliado ou repetir erros humanos.
Publicado porEditado com GPT-5.6 LunaImagens geradas com GPT Image 1.5
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: What is Sampura Research, the London-based nonprofit formally launched on August 24, 2026 by former Google DeepMind researchers Rishub Jain,. Article summary: Sampura Research is a London-based AI-safety nonprofit developing “human–AI complementarity for scalable oversight”: systems in which people and AI jointly evaluate increasingly capable models rather than delegating over. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
A Sampura Research é uma organização sem fins lucrativos de segurança de IA sediada em Londres. Sua pergunta central é prática: quem deve decidir se um sistema de inteligência artificial está se comportando de forma correta e segura?
A resposta da ONG não é retirar os humanos do processo, mas combinar pessoas e máquinas em uma estrutura de supervisão escalável. A organização afirma ter recebido uma doação inicial de US$ 11 milhões da Coefficient Giving: US$ 7 milhões para o primeiro ano e outros US$ 4 milhões já prometidos. 1
O anúncio oficial de lançamento é datado de 25 de agosto de 2026, e não de 24 de agosto. O texto identifica Rishub Jain e Josh Jacob como fundadores. Publicações anteriores em redes sociais mencionavam Alex Adams, mas o anúncio não confirma que os três tenham fundado formalmente a organização. 1
12
Na terminologia da Sampura, um juiz pode ser uma pessoa, um modelo de IA ou um sistema híbrido capaz de avaliar se o comportamento de outro sistema está correto e alinhado. A análise pode envolver uma resposta isolada, uma conversa inteira ou a sequência de ações executadas por um agente. 1
A distinção é importante porque a capacidade de realizar tarefas e a capacidade de supervisioná-las não são necessariamente a mesma coisa. Um modelo pode produzir respostas convincentes e concluir tarefas complexas, mas ainda assim enganar seu avaliador, explorar brechas em uma função de recompensa ou tomar uma decisão perigosa ao longo de uma sequência de etapas.
A agenda da Sampura é descrita como complementaridade humano–IA para uma supervisão escalável: usar automação quando ela for confiável, mas preservar a participação humana em situações que exigem interpretação, julgamento ou decisões relacionadas a valores. 1
A IA é uma opção atraente para supervisionar outros sistemas porque pode ser mais rápida e barata em grande escala. Mas, para a Sampura, velocidade não é sinônimo de confiabilidade. O anúncio de lançamento destaca riscos como:
Esses pontos não significam que humanos sejam sempre melhores avaliadores. Eles explicam por que a Sampura quer descobrir qual combinação de pessoas e máquinas funciona melhor sob pressão, em vez de presumir que apenas um dos lados deve cuidar de todos os casos. 1
O programa inicial, com duração de seis meses, prevê a criação de um ranking diversificado de juízes, reunindo mais de 20 subconjuntos de dados. Entre os temas planejados estão detecção de engano, viés cultural e ações inseguras realizadas por agentes de IA. 1
Os testes não devem se limitar a perguntas e respostas estáticas. A Sampura também pretende criar situações em que o modelo supervisionado otimize diretamente seu comportamento contra o juiz durante o aprendizado por reforço. O objetivo é verificar se o avaliador continua funcionando quando o sistema analisado tem um incentivo para encontrar e explorar suas fraquezas. 1
A pesquisa comparará três grandes abordagens:
O objetivo não é obter uma pontuação alta em um único teste limitado. A Sampura afirma que quer desenvolver juízes robustos em uma ampla variedade de avaliações — e que continuem funcionando à medida que os modelos supervisionados se tornam melhores em explorar falhas nos próprios testes. 1
A organização cita alguns desenhos possíveis para combinar julgamento humano e automatizado:
Nesse modelo, a participação humana deixa de ser uma exigência do tipo “tudo ou nada”. Alguns casos podem ser avaliados com baixo custo e boa confiabilidade por sistemas automatizados; outros podem justificar uma análise humana mais lenta. O desafio, portanto, não é escolher entre “humanos ou IA”, mas equilibrar precisão, custo, velocidade e resistência a tentativas deliberadas de burlar a avaliação. 1
Depois de desenvolver avaliadores mais fortes, a Sampura afirma que pretende investigar se eles podem reduzir o reward hacking — quando um modelo explora a métrica de recompensa sem realmente cumprir o objetivo — durante o treinamento. A ONG também quer estudar quanto envolvimento humano é necessário, como os sistemas de supervisão devem se adaptar quando os modelos aprendem a explorá-los e se os juízes podem fazer mais do que classificar resultados. 1
Essa agenda pode incluir a elaboração ou avaliação das especificações, instruções, rubricas e situações de teste usadas para treinar e analisar sistemas de IA. A Sampura diz que pretende publicar seus resultados em artigos, código, conjuntos de dados e rankings. 1
O material de lançamento disponível sustenta esse programa geral de dados, benchmarks, roteamento de tarefas e assistência a avaliadores humanos. Ele não confirma projetos mais específicos associados à organização, como um conjunto de dados chamado “forward-looking harm” ou uma plataforma aberta de avaliação humana. Essas descrições devem ser tratadas como não verificadas, e não como produtos anunciados.
A Sampura afirma estar contratando sua equipe técnica fundadora em Londres. O programa exige conhecimentos que vão de aprendizado de máquina e desenho de avaliações a interação humano–computador, operações de dados e implementação de sistemas. 1
Publicações anteriores mencionaram a contratação de pelo menos seis pesquisadores e salários entre £ 100 mil e £ 290 mil, mas esses valores exatos não foram confirmados pelo anúncio oficial da organização. 12
13
O setor mais amplo de avaliação de IA também disputa um grupo restrito de especialistas. Uma vaga da METR para a área de execução de avaliações informa salário-base de US$ 285.548 a US$ 503.116 e diz que pode considerar valores maiores para candidatos excepcionalmente experientes. 18
A comparação mostra o tamanho do desafio: criar supervisão confiável exige pesquisa técnica e avaliações cuidadosas no mundo real, enquanto organizações que trabalham nesses problemas concorrem por muitos dos mesmos profissionais.
O lançamento da Sampura ocorre em meio à preocupação de que o desenvolvimento da IA possa avançar mais rápido do que os sistemas criados para monitorá-la. Em julho de 2026, mais de 1.100 funcionários de grandes empresas de tecnologia assinaram uma carta aberta pedindo que o governo dos Estados Unidos apoie ferramentas técnicas e de governança internacionais capazes de desacelerar deliberadamente o desenvolvimento de sistemas de fronteira, se isso for necessário. A carta não pediu uma interrupção imediata do desenvolvimento de IA. 40
Também houve movimentações relevantes entre pesquisadores seniores. A Reuters noticiou mudanças na liderança da divisão de IA do Google e a saída de engenheiros e pesquisadores importantes para outras empresas e startups. 49 Esses acontecimentos ajudam a contextualizar a criação da Sampura, mas não demonstram que a organização tenha resolvido o problema de segurança.
As evidências disponíveis sustentam a imagem da Sampura como uma organização em estágio inicial, dedicada a construir infraestrutura de medição e tomada de decisão para a supervisão de IA. Seus benchmarks e métodos de avaliação híbrida poderão ser úteis para laboratórios de IA, avaliadores independentes e outras instituições que testem o comportamento de modelos. 1
Isso é diferente de provar que a Sampura consegue conter sistemas de fronteira. Sua contribuição imediata é investigar como a supervisão deve ser projetada e testada quando o modelo avaliado é capaz, adaptável e potencialmente incentivado a passar nos testes explorando suas limitações.
A aposta central da ONG é que a segurança em escala exigirá automação — mas não uma automação que retire os humanos das decisões mais importantes.
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
A Sampura Research foi lançada publicamente em 25 de agosto de 2026, e não em 24 de agosto, para desenvolver sistemas híbridos de avaliação de modelos avançados.
A Sampura Research foi lançada publicamente em 25 de agosto de 2026, e não em 24 de agosto, para desenvolver sistemas híbridos de avaliação de modelos avançados. A organização argumenta que a supervisão feita apenas por IA pode não detectar falhas inéditas, ser manipulada pelo sistema avaliado ou repetir erros humanos.
Nos primeiros seis meses, a ONG pretende criar um ranking com mais de 20 conjuntos de dados e comparar avaliadores humanos, exclusivamente de IA e híbridos.
A Sampura Research foi lançada publicamente em 25 de agosto de 2026, e não em 24 de agosto, para desenvolver sistemas híbridos de avaliação de modelos avançados. A organização argumenta que a supervisão feita apenas por IA pode não detectar falhas inéditas, ser manipulada pelo sistema avaliado ou repetir erros humanos.
Publicado porEditado com GPT-5.6 LunaImagens geradas com GPT Image 1.5
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: What is Sampura Research, the London-based nonprofit formally launched on August 24, 2026 by former Google DeepMind researchers Rishub Jain,. Article summary: Sampura Research is a London-based AI-safety nonprofit developing “human–AI complementarity for scalable oversight”: systems in which people and AI jointly evaluate increasingly capable models rather than delegating over. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
A Sampura Research é uma organização sem fins lucrativos de segurança de IA sediada em Londres. Sua pergunta central é prática: quem deve decidir se um sistema de inteligência artificial está se comportando de forma correta e segura?
A resposta da ONG não é retirar os humanos do processo, mas combinar pessoas e máquinas em uma estrutura de supervisão escalável. A organização afirma ter recebido uma doação inicial de US$ 11 milhões da Coefficient Giving: US$ 7 milhões para o primeiro ano e outros US$ 4 milhões já prometidos. 1
O anúncio oficial de lançamento é datado de 25 de agosto de 2026, e não de 24 de agosto. O texto identifica Rishub Jain e Josh Jacob como fundadores. Publicações anteriores em redes sociais mencionavam Alex Adams, mas o anúncio não confirma que os três tenham fundado formalmente a organização. 1
12
Na terminologia da Sampura, um juiz pode ser uma pessoa, um modelo de IA ou um sistema híbrido capaz de avaliar se o comportamento de outro sistema está correto e alinhado. A análise pode envolver uma resposta isolada, uma conversa inteira ou a sequência de ações executadas por um agente. 1
A distinção é importante porque a capacidade de realizar tarefas e a capacidade de supervisioná-las não são necessariamente a mesma coisa. Um modelo pode produzir respostas convincentes e concluir tarefas complexas, mas ainda assim enganar seu avaliador, explorar brechas em uma função de recompensa ou tomar uma decisão perigosa ao longo de uma sequência de etapas.
A agenda da Sampura é descrita como complementaridade humano–IA para uma supervisão escalável: usar automação quando ela for confiável, mas preservar a participação humana em situações que exigem interpretação, julgamento ou decisões relacionadas a valores. 1
A IA é uma opção atraente para supervisionar outros sistemas porque pode ser mais rápida e barata em grande escala. Mas, para a Sampura, velocidade não é sinônimo de confiabilidade. O anúncio de lançamento destaca riscos como:
Esses pontos não significam que humanos sejam sempre melhores avaliadores. Eles explicam por que a Sampura quer descobrir qual combinação de pessoas e máquinas funciona melhor sob pressão, em vez de presumir que apenas um dos lados deve cuidar de todos os casos. 1
O programa inicial, com duração de seis meses, prevê a criação de um ranking diversificado de juízes, reunindo mais de 20 subconjuntos de dados. Entre os temas planejados estão detecção de engano, viés cultural e ações inseguras realizadas por agentes de IA. 1
Os testes não devem se limitar a perguntas e respostas estáticas. A Sampura também pretende criar situações em que o modelo supervisionado otimize diretamente seu comportamento contra o juiz durante o aprendizado por reforço. O objetivo é verificar se o avaliador continua funcionando quando o sistema analisado tem um incentivo para encontrar e explorar suas fraquezas. 1
A pesquisa comparará três grandes abordagens:
O objetivo não é obter uma pontuação alta em um único teste limitado. A Sampura afirma que quer desenvolver juízes robustos em uma ampla variedade de avaliações — e que continuem funcionando à medida que os modelos supervisionados se tornam melhores em explorar falhas nos próprios testes. 1
A organização cita alguns desenhos possíveis para combinar julgamento humano e automatizado:
Nesse modelo, a participação humana deixa de ser uma exigência do tipo “tudo ou nada”. Alguns casos podem ser avaliados com baixo custo e boa confiabilidade por sistemas automatizados; outros podem justificar uma análise humana mais lenta. O desafio, portanto, não é escolher entre “humanos ou IA”, mas equilibrar precisão, custo, velocidade e resistência a tentativas deliberadas de burlar a avaliação. 1
Depois de desenvolver avaliadores mais fortes, a Sampura afirma que pretende investigar se eles podem reduzir o reward hacking — quando um modelo explora a métrica de recompensa sem realmente cumprir o objetivo — durante o treinamento. A ONG também quer estudar quanto envolvimento humano é necessário, como os sistemas de supervisão devem se adaptar quando os modelos aprendem a explorá-los e se os juízes podem fazer mais do que classificar resultados. 1
Essa agenda pode incluir a elaboração ou avaliação das especificações, instruções, rubricas e situações de teste usadas para treinar e analisar sistemas de IA. A Sampura diz que pretende publicar seus resultados em artigos, código, conjuntos de dados e rankings. 1
O material de lançamento disponível sustenta esse programa geral de dados, benchmarks, roteamento de tarefas e assistência a avaliadores humanos. Ele não confirma projetos mais específicos associados à organização, como um conjunto de dados chamado “forward-looking harm” ou uma plataforma aberta de avaliação humana. Essas descrições devem ser tratadas como não verificadas, e não como produtos anunciados.
A Sampura afirma estar contratando sua equipe técnica fundadora em Londres. O programa exige conhecimentos que vão de aprendizado de máquina e desenho de avaliações a interação humano–computador, operações de dados e implementação de sistemas. 1
Publicações anteriores mencionaram a contratação de pelo menos seis pesquisadores e salários entre £ 100 mil e £ 290 mil, mas esses valores exatos não foram confirmados pelo anúncio oficial da organização. 12
13
O setor mais amplo de avaliação de IA também disputa um grupo restrito de especialistas. Uma vaga da METR para a área de execução de avaliações informa salário-base de US$ 285.548 a US$ 503.116 e diz que pode considerar valores maiores para candidatos excepcionalmente experientes. 18
A comparação mostra o tamanho do desafio: criar supervisão confiável exige pesquisa técnica e avaliações cuidadosas no mundo real, enquanto organizações que trabalham nesses problemas concorrem por muitos dos mesmos profissionais.
O lançamento da Sampura ocorre em meio à preocupação de que o desenvolvimento da IA possa avançar mais rápido do que os sistemas criados para monitorá-la. Em julho de 2026, mais de 1.100 funcionários de grandes empresas de tecnologia assinaram uma carta aberta pedindo que o governo dos Estados Unidos apoie ferramentas técnicas e de governança internacionais capazes de desacelerar deliberadamente o desenvolvimento de sistemas de fronteira, se isso for necessário. A carta não pediu uma interrupção imediata do desenvolvimento de IA. 40
Também houve movimentações relevantes entre pesquisadores seniores. A Reuters noticiou mudanças na liderança da divisão de IA do Google e a saída de engenheiros e pesquisadores importantes para outras empresas e startups. 49 Esses acontecimentos ajudam a contextualizar a criação da Sampura, mas não demonstram que a organização tenha resolvido o problema de segurança.
As evidências disponíveis sustentam a imagem da Sampura como uma organização em estágio inicial, dedicada a construir infraestrutura de medição e tomada de decisão para a supervisão de IA. Seus benchmarks e métodos de avaliação híbrida poderão ser úteis para laboratórios de IA, avaliadores independentes e outras instituições que testem o comportamento de modelos. 1
Isso é diferente de provar que a Sampura consegue conter sistemas de fronteira. Sua contribuição imediata é investigar como a supervisão deve ser projetada e testada quando o modelo avaliado é capaz, adaptável e potencialmente incentivado a passar nos testes explorando suas limitações.
A aposta central da ONG é que a segurança em escala exigirá automação — mas não uma automação que retire os humanos das decisões mais importantes.
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
A Sampura Research foi lançada publicamente em 25 de agosto de 2026, e não em 24 de agosto, para desenvolver sistemas híbridos de avaliação de modelos avançados.
A Sampura Research foi lançada publicamente em 25 de agosto de 2026, e não em 24 de agosto, para desenvolver sistemas híbridos de avaliação de modelos avançados. A organização argumenta que a supervisão feita apenas por IA pode não detectar falhas inéditas, ser manipulada pelo sistema avaliado ou repetir erros humanos.
Nos primeiros seis meses, a ONG pretende criar um ranking com mais de 20 conjuntos de dados e comparar avaliadores humanos, exclusivamente de IA e híbridos.