CLOSED
S&PNASDAQDOWR2KVIXAAPLMSFTNVDAGOOGLMETAAMZNTSLAAVGOGOLDWTIUSDPEN
Yahoo · 60s · delay ~15min
LIVE
BTCETHSOLXRPADABNBDOGE
CoinGecko · 30s
Sakana Lanza Fugu-Cyber, Modelo de Seguridad con 86.9% de Eficiencia
Papers

Sakana Lanza Fugu-Cyber, Modelo de Seguridad con 86.9% de Eficiencia

MarkTechPost (AI/ML News)26 de julio de 2026Cortesia de MarkTechPost (AI/ML News)

Segun MarkTechPost (AI/ML News), Sakana AI ha presentado Fugu-Cyber (versión v1.0), un nuevo modelo especializado en ciberseguridad dentro de su familia de herramientas de coordinación. Este avance representa el tercer punto de conexión en el sistema de orchestración Fugu, diseñado específicamente para razonamientos en entornos de seguridad. La empresa lanzó previamente este entorno de coordinación un mes antes. Los resultados obtenidos en pruebas de validación muestran una efectividad de 86.9% en el benchmark CyberGym y de 72.1% en CTI-REALM, cifras que Sakana compara con modelos pioneros como GPT-5.5-Cyber y Claude Mythos Preview.

CyberGym, desarrollado por la Universidad de California en Berkeley, evalúa 1.507 vulnerabilidades reales provenientes de 188 proyectos de código abierto. En esta prueba, un agente recibe una descripción de una brecha y un código sin corrección, y debe generar una demostración que cause un fallo en la versión previa del sistema pero no en la corregida. Esta etapa de verificación es clave, ya que dificulta que los sistemas sean manipulados para obtener resultados falsos. Por otro lado, CTI-REALM, un conjunto de pruebas abiertas de Microsoft, integra 37 informes de amenazas públicas de fuentes como Datadog, Palo Alto Networks y Splunk. Allí, el modelo debe asociar técnicas de MITRE ATT&CK, analizar datos de monitoreo, perfeccionar consultas en KQL y generar reglas de detección validadas. Las pruebas cubren entornos como máquinas Linux, Kubernetes en Azure y servicios en la nube.

La cifra de 86.9% en CyberGym no es aislada, pero sí debe interpretarse en contexto. Al momento de su lanzamiento, el mejor rendimiento registrado en pruebas similares oscilaba alrededor del 20%. En abril de 2026, Anthropic logró 83.1% con Claude Mythos Preview en el proyecto Glasswing, mientras que OpenAI reportó 85.6% en su versión actualizada de GPT-5.5-Cyber, frente a 81.8% en la versión base de GPT-5.5. Así, el desempeño de Fugu-Cyber se sitúa en un nivel competitivo, aunque aún debe compararse con el avance continuo de otros actores del sector.

Para los lectores peruanos, este desarrollo resalta la importancia de integrar tecnologías de inteligencia artificial en la gestión de riesgos digitales. En un entorno donde las empresas de servicios, comercio electrónico y finanzas dependen cada vez más de infraestructuras digitales, la capacidad de detectar y responder a amenazas en tiempo real es crítica. Aunque el modelo aún no está disponible para uso general, su rendimiento sugiere que futuras aplicaciones podrían fortalecer la defensa contra amenazas cibernéticas en entornos locales, especialmente en sectores donde la protección de datos personales y transacciones es esencial. El avance de modelos especializados como este podría acelerar la adopción de soluciones inteligentes en el país, facilitando la resiliencia digital de pequeñas y medianas empresas.