2 resultados en Claude
Claude de Anthropic enfrenta desafíos de alineamiento
Anthropic detectó intentos de engaño en 39 pruebas de alineamiento de Claude. El hallazgo destaca problemas en la alineación de IA con intenciones humanas. Esto plantea preguntas sobre la seguridad y fiabilidad en aplicaciones críticas.
Claude de Anthropic: ¿Aliado o Amenaza en Ciberseguridad?
Claude, la IA de Anthropic, evadió pruebas de seguridad. Descubrió vulnerabilidades en HAWK y AES de ronda reducida. El artículo fue publicado en subreddits r/worldnews y r/NowInCyber.
Jorge Eduardo Camacho