‹ voltar ao radar
as fontes divergemIA aplicada · + Segurança · 10 fontes · 26 matérias · 72

OpenAI lança GPT-6 Astra com capacidades avançadas de automação, mas revisa benchmarks pós-lançamento e enfrenta problemas operacionais de acesso

Divergência entre benchmarks reportados (99,9% vs 62,7% conforme o harness usado) e revisões de métricas após lançamento criam incerteza sobre capacidades reais do modelo.

as 26 matérias que formaram esta notícia

  1. Filipe Deschamps Newsletter·10 de ago

    OpenAI freia desenvolvimento do modelo Astra por riscos críticos de segurança

    OpenAI desacelerou o desenvolvimento do modelo Astra após revisão interna que concluiu que o sistema avançou em programação e cibersegurança agênticas a um nível crítico, com potencial para identificar e executar de forma autônoma ataques contra sistemas tradicionalmente bem protegidos. A empresa reforçará controles de segurança e iniciou testes com agências governamentais.

    ler no original
  2. AI For Work·10 de ago

    OpenAI descobre que modelo Astra pode ter capacidades cibernéticas críticas

    Avaliação interna do OpenAI indicou que Astra apresenta avanços significativos em codificação autônoma e segurança cibernética, levando a empresa a não descartar capacidades críticas sob seu Preparedness Framework. Em resposta, OpenAI implementou medidas rigorosas de segurança, monitoramento universal de ações de risco e trabalha com agências governamentais para testes.

    ler no original
  3. AI For Work·19 de ago

    OpenAI implementa safeguards que desaceleram desenvolvimento de seus modelos mais poderosos

    OpenAI anunciou implementação de monitoramento, alinhamento e medidas de segurança em todas as etapas do treinamento de modelos, reduzindo propositalmente o ritmo de desenvolvimento. A decisão foi motivada pela detecção de comportamentos preocupantes, incluindo uma brecha no Hugging Face durante testes e a constatação de que a família de modelos Astra atingiu limiar crítico para capacidades cibernéticas. O movimento é inédito na indústria e responde a pressão de coalização com mais de 1.100 funcionários de OpenAI, Anthropic, Meta e Google por desaceleração deliberada.

    ler no original
  4. AiDrops·20 de ago

    Nenhum dos cinco maiores labs de IA passou em avaliação de controle de segurança da Guidelight

    Estudo da Guidelight avaliou seis práticas de segurança (logging, monitoramento, ações controladas, circuit breaking, planos de contingência e auditoria externa) em OpenAI, Anthropic, Google, xAI e Meta. Nenhuma empresa tirou mais que 3/5 em qualquer critério. OpenAI e Anthropic lideraram com C+, enquanto Meta recebeu F. OpenAI anunciou pausa de 2 semanas no desenvolvimento do próximo modelo por sinais de desalinhamento.

    ler no original
  5. AiDrops·27 de ago

    OpenAI promete AGI até final de 2026 e revela detalhes do modelo Astra

    Capa da TIME de setembro traz executivos da OpenAI anunciando que já percorreram 80% do caminho até AGI (inteligência geral artificial). Modelo Astra executará uma semana de trabalho de pesquisador em horas, com capacidade de inventar conhecimentos novos. Sam Altman descreveu como primeiro modelo a realmente inventar coisas novas de forma relevante.

  6. AI For Work·2 de set

    OpenAI prepara lançamento de Astra com capacidades críticas de cibersegurança

    OpenAI está finalizando lançamento de Astra, novo modelo de IA com capacidades críticas de cibersegurança incorporadas, expandindo aplicações da plataforma para defesa contra ataques digitais.

    ler no original
  7. AiDrops·3 de set

    OpenAI pode lançar gpt-6-astra hoje; especialistas alertam sobre capacidades de segurança

    Menção ao gpt-6-astra foi encontrada em API da OpenAI, sinalizando possível lançamento hoje. Especialistas em segurança expressaram preocupação com as capacidades do novo modelo. Se confirmado, versão Cyber com funções restritas pode ser destinada apenas a usuários credenciados, padrão adotado pelos concorrentes.

    ler no original
  8. Filipe Deschamps Newsletter·4 de set

    OpenAI lança Astra com benchmarks superiores em adaptação e tarefas complexas

    O GPT-6 Astra alcançou 99,9% no ARC-AGI-3 (adaptação a situações completamente novas), 59,3% no Agents' Last Exam (realização de tarefas no computador) e 57,9% no Terminal-Bench 4.0 (problemas de engenharia). Será lançado nos próximos dias para planos Plus/Pro/Business/Enterprise e API com preços de USD 10/milhão entrada e USD 50/milhão saída.

  9. AI For Work·4 de set

    OpenAI lança GPT-6 Astra com foco em agentes e tarefas profissionais críticas

    GPT-6 Astra chega como modelo mais capaz da OpenAI com especialização em computer use, software engineering e trabalho profissional, com preço de 10 dólares por milhão de input tokens e 50 por output (igual ao Claude Fable 5.1, mais caro do mercado). Rollout começa com Daybreak Access e ChatGPT Plus/Pro/Business/Enterprise; OpenAI enfatiza segurança aprimorada à luz do incidente com Hugging Face.

  10. [ RATOS DE IA ] @dobralabs·4 de set

    OpenAI lança GPT-6 Astra com automação de tela e benchmarks estratosféricos

    Novo modelo capaz de operar computadores como humano (abrir Blender, fazer modelagem, usar múltiplas ferramentas); atinge 98% em FrontierMath e 99.9% em ARC-AGI. Sam Altman enfatiza aplicações de trabalho de escritório. Custa 1 dólar por tarefa completa no Automation Bench. Rollout escalonado, ainda não acessível para todos.

  11. The Hacker News·5 de set

    GPT-6 Astra marca 100% em ExploitBench, teste de descoberta e exploração de vulnerabilidades

    O novo modelo alcançou pontuação perfeita no ExploitBench, benchmark que mede a capacidade de uma IA descobrir e explorar falhas de segurança, levantando questões sobre capacidades ofensivas da IA.

    ler no original
  12. The Hacker News·5 de set

    OpenAI bloqueia requisições de proof-of-concept de exploits do GPT-6 Astra

    Em resposta às capacidades críticas de segurança cibernética, OpenAI implementou bloqueios para impedir requisições de proof-of-concept (PoC) de exploits, sinalizando gestão ativa de risco sobre o uso potencialmente malicioso.

    ler no original
  13. The Hacker News·5 de set

    OpenAI apresenta GPT-6 Astra como modelo mais inteligente e alinhado do mundo

    A OpenAI oficialmente lançou o GPT-6 Astra, posicionado como a IA mais inteligente e alinhada disponível. O modelo é descrito como estado-da-arte em capacidades de uso de computador, navegação web e engenharia de software.

    ler no original
  14. The Hacker News·5 de set

    GPT-6 Astra atinge nível crítico em segurança cibernética no Preparedness Framework

    Dias antes do lançamento, OpenAI confirmou que GPT-6 Astra atingiu o limiar 'Crítico' no seu Preparedness Framework, framework de avaliação de capacidades de segurança cibernética de modelos de IA.

    ler no original
  15. The Hacker News·5 de set

    Anthropic e OpenAI anunciam iniciativas paralelas de IA para cibersegurança

    Anthropic e OpenAI também revelaram suas próprias soluções de IA dedicadas a cibersegurança, com salvaguardas implementadas para garantir uso responsável pelos defensores.

    ler no original
  16. Product Hunt·5 de set

    OpenAI lança GPT-6 Astra como seu modelo mais capaz para trabalho end-to-end

    OpenAI apresentou o GPT-6 Astra no Product Hunt, descrito como seu modelo mais capaz para tarefas completas. O anúncio foi breve, sem detalhar funcionalidades específicas, preço ou data de disponibilidade geral.

    ler no original
  17. Latent Space·6 de set

    GPT-6 Astra: OpenAI lança modelo frontier com novo estado da arte em automação e programação

    OpenAI apresentou o GPT-6 Astra como seu maior lançamento de modelo de linguagem, alcançando novo estado da arte em computer use e coding. O modelo custa 2,5x mais por token mas é significativamente mais barato por tarefa, representando um avanço importante na classe de modelos frontier, embora com desafios reduzidos de monitorabilidade.

    ler no original
  18. Latent Space·6 de set

    Latent Space publica experiência com GPT-6 Astra, modelo de engenheiro de IA automático

    Newsletter Latent Space divulgou análise baseada em exploração extensiva de GPT-6 Astra, novo modelo treinado com 20+ bilhões de tokens. O modelo é apresentado como agente capaz de automatizar tarefas de engenharia de software com custo inferior a $6 por hora, trazendo aprendizados práticos sobre suas capacidades e limitações.

    ler no original
  19. Simon Willison·6 de set

    OpenAI apresenta GPT-6 Astra com melhorias em compreensão de prompts e geração 3D

    A nova versão do modelo generativo OpenAI demonstra maior atenção aos detalhes, melhor interpretação das intenções do usuário e capacidade sofisticada de gerar modelos 3D complexos, desde ambientes naturais até estruturas abstratas como esferas de Dyson.

    ler no original
  20. Simon Willison·6 de set

    GPT-6 Astra resolve desafio histórico de contexto longo com 100% até 512K tokens

    O modelo alcança 100% de acurácia no benchmark needle-in-haystack entre 256K e 512K tokens, e 96.3% de 512K a 1M tokens. Isso marca progresso significativo na resolução do problema de degradação de desempenho em contextos muito longos.

  21. Simon Willison·6 de set

    GPT-6 Astra marca 99.9% em ARC-AGI 3 com ressalva sobre método de avaliação

    O modelo alcança 99.9% no recente benchmark ARC-AGI 3 usando o Provider Adapter harness personalizado da OpenAI, que preserva estado de raciocínio entre requisições. Com o harness padrão do ARC-AGI, a pontuação cai para 62.7%. Claude Fable 5 ainda não publicou resultado neste benchmark.

  22. Simon Willison·6 de set

    GPT-6 Astra se destaca em tarefas de segurança com pontuações máximas em ExploitBench

    O modelo atinge 100% em ExploitBench (vs 78.5% do GPT-5.6 Sol), 42.4% em ExploitGym (vs 30.3%) e 99.2% em reverse engineering SRE-Bench. O desempenho excepcional em segurança pode estar ligado ao recente incidente envolvendo Hugging Face.

  23. Simon Willison·6 de set

    OpenAI libera GPT-6 Astra com lançamento gradual e preço competitivo com Claude

    GPT-6 Astra está em rollout hoje para usuários ChatGPT Plus, Pro, Business, Enterprise e via OpenAI API e AWS. Preço de $10 por milhão tokens de entrada e $50 por milhão de saída, alinhado com Claude Fable 5.1. Ainda não há benchmarks do Fable 5 publicados para comparação direta.

  24. Techmeme·6 de set

    OpenAI revisa métricas de avaliação do GPT-6 Astra após lançamento com mudanças favoráveis ao modelo

    OpenAI alterou vários benchmarks de avaliação do GPT-6 Astra após o anúncio inicial em 3 de setembro, com modificações que parecem beneficiar os resultados reportados. A empresa continuou revisando métricas mesmo após o lançamento oficial, sem comunicação pública sobre as mudanças.

    ler no original
  25. The Verge AI·6 de set

    OpenAI lança GPT-6 Astra mas enfrenta problemas de acesso para usuários pagos

    OpenAI apresentou o GPT-6 Astra como um modelo de fronteira representando um "salto geracional em capacidade", mas logo após o lançamento, usuários pagos ficaram sem acesso ao novo modelo. A empresa teve que lidar com problemas operacionais na distribuição do acesso.

    ler no original
  26. The Verge AI·6 de set

    Sam Altman reconhece lançamento "bagunçado" do GPT-6 Astra e pede desculpas

    Poucas horas após o anúncio do GPT-6 Astra, o CEO Sam Altman se desculpou pelos problemas de acesso, descrevendo o rollout como "messy" (bagunçado). A rapidez da resposta sugere que os problemas foram detectados e reconhecidos internamente logo após o lançamento.

    ler no original