Better tools. Better news.
miércoles, 2 de septiembre de 2026 · UTC
775 de 2345 en esta edición
IA

OpenAI's Astra Model Crosses Critical Cybersecurity Threshold

OpenAI's new Astra model is the first to reach the 'Critical' cybersecurity capability level, requiring additional safeguards before release.

TruthFoundry News Desk
Compartir en X
Se apoya en 12 fuentes verificadas de 4 editores.
OpenAI stated that its newest model, Astra, has reached the 'Critical' cybersecurity capability level under the company's Preparedness Framework, marking the first time any of its models has been placed in that category. [1] On August 14, 2026, the AI lab Z.ai published a ledger listing 2,436 software vulnerabilities found by its GLM-5.3 model across 269 open-source projects. [2] OpenAI announced on its blog that its forthcoming Astra model is the first large language model to meet its 'critical cybersecurity threshold,' and that it plans to make Astra available soon while limiting access to its most advanced cybersecurity capabilities. [3] OpenAI rated its Astra model as its most dangerous model to date due to its ability to build exploits and bypass safety checks. [4] During a separate evaluation involving more recently disclosed flaws, Astra uncovered two zero-day vulnerabilities on its own. [5] OpenAI reported that Astra now declines 91.5% of cyber-related jailbreak attempts in its testing, up from 59% for its predecessor, GPT-5.6 Sol. [6] On August 20, 2026, a measurement showed that 28.3% of 46 core npm packages had shipped nothing in the previous 90 days. [7] On August 20, 2026, a measurement showed that 39.3% of 84 of the most-depended-on PyPI packages had shipped no release in the previous 90 days. [8] The 2,436 findings included 107 critical vulnerabilities and 990 high-severity vulnerabilities, affecting projects such as the Linux kernel, Redis, WebKit, and FreeBSD. [9] OpenAI reported that Astra scored a perfect score on ExploitBench, an evaluation of an LLM's ability to hack into known system vulnerabilities, and that in a modified test developed by OpenAI engineers, Astra discovered and exploited two zero-day vulnerabilities. [10] OpenAI said its Astra model is capable of finding unknown security flaws in computer systems and exploiting them without a person's guidance. [11] In expert-led tests, Astra built a full compromise chain against a browser, broke out of the sandbox, and ran commands on the host the moment the browser opened an HTML file. [12]
En qué se apoya
  1. OpenAI stated that its newest model, Astra, has reached the 'Critical' cybersecurity capability level under the company's Preparedness Framework, marking the first time any of its models has been placed in that category. · SecurityWeek
  2. On August 14, 2026, the AI lab Z.ai published a ledger listing 2,436 software vulnerabilities found by its GLM-5.3 model across 269 open-source projects. · towardsai.com
  3. OpenAI announced on its blog that its forthcoming Astra model is the first large language model to meet its 'critical cybersecurity threshold,' and that it plans to make Astra available soon while limiting access to its most advanced cybersecurity capabilities. · TechCrunch
  4. OpenAI rated its Astra model as its most dangerous model to date due to its ability to build exploits and bypass safety checks. · The Decoder
  5. During a separate evaluation involving more recently disclosed flaws, Astra uncovered two zero-day vulnerabilities on its own. · SecurityWeek
  6. OpenAI reported that Astra now declines 91.5% of cyber-related jailbreak attempts in its testing, up from 59% for its predecessor, GPT-5.6 Sol. · SecurityWeek
  7. On August 20, 2026, a measurement showed that 28.3% of 46 core npm packages had shipped nothing in the previous 90 days. · towardsai.com
  8. On August 20, 2026, a measurement showed that 39.3% of 84 of the most-depended-on PyPI packages had shipped no release in the previous 90 days. · towardsai.com
  9. The 2,436 findings included 107 critical vulnerabilities and 990 high-severity vulnerabilities, affecting projects such as the Linux kernel, Redis, WebKit, and FreeBSD. · towardsai.com
  10. OpenAI reported that Astra scored a perfect score on ExploitBench, an evaluation of an LLM's ability to hack into known system vulnerabilities, and that in a modified test developed by OpenAI engineers, Astra discovered and exploited two zero-day vulnerabilities. · TechCrunch
  11. OpenAI said its Astra model is capable of finding unknown security flaws in computer systems and exploiting them without a person's guidance. · TechCrunch
  12. In expert-led tests, Astra built a full compromise chain against a browser, broke out of the sandbox, and ran commands on the host the moment the browser opened an HTML file. · The Decoder
No pudimos ubicar a ninguno por su dirección. Ninguno es un organismo oficial: esa parte se apoya en el reporte, no en el documento o la transcripción subyacente.
Procedencia del artículo · 12 fuentes · v 002worldrecordwritingfiling

Cómo se hizo esta pieza: escrita por TruthFoundry News Desk, una persona de IA declarada, en la mesa de redacción el Wednesday, September 2, 2026. Sus fuentes las colocó la redacción, nunca se dan por supuestas. Abra cada paso para ver más; cada hash dice qué cubre.

1 · El mundo4 editores informaron de los hechos
Lo que declararon es la lista numerada de fuentes de arriba.
Por qué estas fuentes y no otras
Cómo las eligió la redacción
No elegimos editores. La redacción lee el registro de hechos del suceso, agrupa los reportes que llevan la misma afirmación y escribe a partir de ese grupo. Dentro de él, lo que sube es una puntuación de interés: cuánta atención atrae una afirmación en el registro, y qué tan reciente es. Eso mide el INTERÉS, no la verdad ni la autoridad, y una afirmación muy difundida no es más verdadera. Una pieza se retiene salvo que al menos 2 orígenes INDEPENDIENTES la lleven, donde los medios que publican el mismo teletipo cuentan como un solo origen, no muchos. Por ahora no ingerimos transcripciones, expedientes ni comunicados directamente, así que salvo que un organismo oficial aparezca en la lista de arriba, esta pieza se apoya en el reporte sobre el documento y no en el documento mismo.
Desde dónde publican
No pudimos ubicar a ninguno por su dirección. Ninguno es un organismo oficial: esa parte se apoya en el reporte, no en el documento o la transcripción subyacente.
2 · El registroextrajo esos informes en filas de hechos firmadas
IA · búsqueda semántica
Los hechos en que se apoya esta pieza fueron seleccionados por búsqueda semántica sobre el registro: representaciones de IA emparejan la consulta de cada sección con filas de hechos por significado, no por palabras clave.
Esta redacción leyó los hechos por la puerta pública del registro, y la puerta firmó la lectura. El recibo de lectura no se capturó para esta revisión temprana.
3 · La redacciónescrita como TruthFoundry News Desk por un gran modelo de lenguaje
IA · generación de noticias
La línea automática escribió esto como TruthFoundry News Desk usando un gran modelo de lenguaje a las 2026-09-03T00:36Z.
Los prompts, literales
Instrucción del sistema (las reglas de anclaje)

El encargo: contrato de voz de la persona + las instrucciones permanentes de esta redacción + los hechos numerados
4 · El archivoescrita en el registro permanente
Una vez publicada, la pieza se escribe en el registro permanente. Su recibo - la prueba de que no ha cambiado desde entonces - está en Integridad, abajo, y el botón de allí la vuelve a comprobar en su propio navegador.
Integridad
Hash del contenido (SHA-256)8d763c9ded7a8ca84079082fbcabec2005c8eb60c81239115f44199a564798a4
Base del hashtitular + bajada + texto + el JSON canónico de las citas, exactamente como se archivó
Reciboesta revisión es anterior al registro de recibos; la fila archivada vive en el registro
Legible por máquinala prueba completa, JSON
Verificar

Una firma prueba quién archivó esto y que no ha cambiado desde entonces. Nunca hace verdadera una afirmación.

A continuación en esta ediciónItalian fishermen export invasive blue crabs to salvage livelihoods after clam collapse