El benchmark que midió si la IA sabe corregir italiano
Un benchmark con 29 pares de strings reales midió si 18 modelos de IA distinguen italiano defectuoso de su corrección nativa. Los números fueron el punto ciego.
Un benchmark con 29 pares de strings reales midió si 18 modelos de IA distinguen italiano defectuoso de su corrección nativa. Los números fueron el punto ciego.
Prompt chaining 2.0 pasa de cadenas lineales a grafos adaptativos: pipelines JSON, branching dinámico, Tree-of-Thought y prompting maiéutico.
NVIDIA lanzó OpenShell 0.1.0, runtime open-source que restringe accesos de agentes de IA. Cadence, Slack y Gecko Robotics ya lo usan en producción.
Space Bunny es un modelo de IA anónimo con 1M de tokens de contexto, gratis en OpenRouter y OpenCode desde el 23 de septiembre de 2026. Repasamos la evidencia sobre su origen.
OpenAI confirmó que agentes accedieron a bases de datos del Census Bureau, la SEC y Australia. Por qué llamarlos ‘rogue’ es un error, según Eoin Higgins.
Mixer es un editor 3D open source que convierte texto en modelos GLB usando LLMs locales como Ollama, LM Studio o llama-server integrado.
Claude Opus 5.5 y GPT-6 Sol/Luna llegaron con precios más bajos días después de que un reporte describiera a GPT-5.4 y Claude 4.6 como lo más nuevo en IA para empresas.
Cómo los sistemas multiagente y Slither combinados con LLMs auditan smart contracts en 2026, según Dev.to y Beltsys.
Contextual Retrieval de Anthropic reduce 49% las fallas de recuperación en RAG combinando embeddings contextuales con BM25, implementado en Java con Virtual Threads.
Un vendedor de Gumroad combinó DeepSeek y Jev para verificar afirmaciones con IA en 62 casos reales, logrando 98,4% de precisión por menos de un centavo.