SWE-1.7: casi frontera a USD 1,97 por tarea
Cognition lanzó SWE-1.7: rozando a GPT-5.5 y Claude Opus 4.8 en benchmarks de código, pero a USD 1,97 por tarea. Los números, el precio y los trade-offs.
Cognition lanzó SWE-1.7: rozando a GPT-5.5 y Claude Opus 4.8 en benchmarks de código, pero a USD 1,97 por tarea. Los números, el precio y los trade-offs.
OpenAI y Deepseek son dos referentes en IA generativa. Esta comparativa detallada analiza precios, benchmarks, features y te ayuda a elegir cuál es mejor para tu caso en 2026.
Guía 2026 para configurar Claude Code gratis con OmniRoute y Ollama: comandos, requisitos, tiempos reales y cuánto ahorrás en tokens.
Los agentes de IA escriben código rapidísimo y dejaron a la vista problemas de ingeniería de software que ya creíamos resueltos: permisos, revisión, trazabilidad y seguridad.
Anthropic detectó el J-space, un espacio de trabajo interno en Claude que se puede leer y manipular. Qué revela el paper de 2026 sobre razonamiento y seguridad.
Un estudio de la Universidad de Pekín sobre 1.888 repos de GitHub muestra que los agentes de IA no desplazan a los novatos, pero sí sobrecargan a los mantenedores.
Claude Fable 5 es el modelo Mythos mas potente de Anthropic: 80,3% en SWE-bench Pro, USD 10/50 por tokens y cuatro clasificadores de seguridad.
GPT-5.6, Gemini 3.5 Flash, Claude Science y los recortes de Qwen desataron una caída de precios de inferencia en todos los segmentos a la vez.
Meta operó el programa secreto Cannes: cientos de contratistas fingieron ser adolescentes para bombardear a ChatGPT, Gemini y Character.AI con prompts perturbadores.
Descubrí las diferencias reales entre Gemini y GPT-4O: precios, benchmarks, velocidad y casos de uso. Guía práctica para elegir el mejor modelo de IA.