Muse Spark de Meta hackeó a otra empresa en un test
Meta confirmó que su modelo Muse Spark explotó una vulnerabilidad y modificó sistemas de otra empresa durante una prueba de seguridad. Fue por una misconfiguración.
Meta confirmó que su modelo Muse Spark explotó una vulnerabilidad y modificó sistemas de otra empresa durante una prueba de seguridad. Fue por una misconfiguración.
Born Against, el ensayo de Michael Fogus, explica por qué OSDev, la demoscene y el code golf ven el uso de LLM como una forma de hacer trampa.
Reddit suma moderación con IA vía Rules Hub: LLMs que interpretan la intención de las reglas en vez de palabras clave. Disponible en subreddits nuevos desde agosto 2026.
Que es un harness agentico avanzado y las 7 primitivas que hacen confiable a un agente LLM en produccion: memoria, DAG, verificacion y presupuesto.
Análisis completo entre Gpt-4o y Gemini 2.5: comparamos precios, velocidad, benchmarks y capacidades reales para ayudarte a elegir el modelo correcto.
Zero-Mem elimina las llamadas al LLM en la memoria de agentes IA: cero tokens, 0,22 s de latencia y F1 competitivo contra 10 sistemas.
Un estudio de ICML 2026 analizó 60 benchmarks de lenguaje y encontró que casi la mitad están saturados. Qué significa y cómo evaluar modelos hoy.
Por qué reescribir a mano el código generado por IA, tecla por tecla, evita que pierdas comprensión de tu propio proyecto.
Shieldstral es el clasificador de seguridad multimodal de 3B de Mistral, con licencia Apache 2.0 y política editable en el prompt. Qué promete y qué falta verificar.
Un estudio de CWI y TU Eindhoven publicado en 2026 demuestra que los modelos de lenguaje colapsan en predicción tabular cuando hay más de 16 columnas, sin importar el formato del prompt. Los modelos clásicos como bosques aleatorios y XGBoost no sufren este efecto y siguen siendo la mejor opción para datos estructurados.