Codeberg prohíbe proyectos hechos casi todo con IA

En pocas palabras: Codeberg prohibió desde el 22 de julio de 2026, por votación de sus socios, alojar proyectos que consistan mayormente en código generado por IA. La cláusula está en el § 2 (1) 7 de sus Términos de Uso y nombra a Claude y OpenAI Codex como ejemplos.

Codeberg aprobó el 22 de julio de 2026 una cláusula en sus Términos de Uso que prohíbe alojar proyectos formados en su mayoría por código escrito con herramientas de IA generativa. La decisión de Codeberg de prohibir código IA generado salió de una votación vinculante de sus socios, no de una orden del directorio.

Codeberg es una plataforma europea de alojamiento de código libre, sin fines de lucro, construida sobre Forgejo y organizada como asociación civil (Codeberg e.V.) gobernada por sus miembros. La cláusula nueva vive en el § 2 (1) 7 de sus Términos de Uso y dice, textual: «You must not share projects that mostly consist of code written by “generative AI”-tools (including services such as Claude, OpenAI Codex)».

En 30 segundos

  • Qué se prohíbe: proyectos que «en su mayoría» sean código de IA generativa. La cláusula nombra a Claude y OpenAI Codex como ejemplos.
  • Qué NO se prohíbe: usar Copilot, Claude Code o cualquier asistente mientras programás, siempre que leas, entiendas y revises lo que sale.
  • Cómo se aprobó: Bastian Greshake Tzovaras (@gedankenstuecke) abrió el PR #1253 el 29 de junio de 2026, hubo 21 comentarios de debate, votaron los socios en la Asamblea Anual 2026 y Gusted mergeó el 22 de julio.
  • El argumento central es legal, no estético: el estatus de copyright del código generado por IA sigue sin resolverse y una asociación chica no tiene con qué litigar.
  • La aplicación es manual: reportes y criterio de moderadores. No hay detector automático, y «mayoría» todavía no tiene un número.

¿Qué son las «LLM-extrusions» y qué prohíbe exactamente la cláusula?

«LLM-extrusion» es el término que usó la propuesta original para nombrar proyectos cuyo código salió casi entero de un modelo de lenguaje, sin revisión humana significativa. La palabra quedó en el título del pull request #1253; el texto que entró al § 2 (1) 7 es más seco y habla de proyectos que «consistan en su mayoría» en código escrito por herramientas de IA generativa.

La distinción importa. Una cosa es la etiqueta que circula en los foros y otra la redacción que un moderador va a tener que aplicar cuando le llegue un reporte.

Lo que llama la atención del texto aprobado es que nombra productos comerciales concretos dentro de un documento legal (sí, Claude y OpenAI Codex aparecen con nombre y apellido en el ToU). Es poco habitual y envejece rápido: dentro de un año la lista de herramientas va a ser otra, y el articulado va a seguir citando dos servicios de 2026.

¿Por qué decidió Codeberg prohibir código IA generado?

codeberg código ia generado diagrama explicativo

El fundamento que la propia Codeberg dejó asentado en el documento es doble: el estatus de copyright de esos proyectos no está claro y no hay salvaguardas suficientes contra código dañino. No es un juicio sobre la calidad del código ni sobre si la IA «escribe bien». Es un cálculo de riesgo de una organización sin fines de lucro que no tiene caja para pelear un juicio de propiedad intelectual.

Ponele que dentro de tres años un tribunal define que los modelos entrenados con repositorios GPL producen obras derivadas. ¿Quién queda expuesto? La plataforma que hospedó miles de repos cuyo origen nadie puede reconstruir. Codeberg eligió sacarse ese problema de encima ahora, mientras la superficie es chica, en lugar de descubrirlo cuando ya sea inmanejable.

El segundo argumento, el de la revisión, apareció fuerte en el debate del PR: cuando el 95% del repo lo escribió un agente en tres tardes, la revisión humana deja de ser revisión y pasa a ser un mero trámite de aceptación de diffs, porque nadie va a leer con atención 40.000 líneas que no escribió, nadie va a rastrear de dónde salió cada dependencia, y el mantenedor termina siendo el primer sorprendido cuando algo explota en producción.

¿Cómo se aprobó la política en la Asamblea Anual 2026 de Codeberg?

El recorrido fue público de punta a punta. Bastian Greshake Tzovaras abrió el PR #1253 el 29 de junio de 2026, el hilo acumuló 21 comentarios de discusión entre miembros, la propuesta pasó a votación de socios en la Asamblea Anual 2026 y Gusted hizo el merge el 22 de julio. El último commit del archivo de Términos de Uso figura con fecha 21 de julio de 2026.

Acá está la diferencia real con GitHub. En una plataforma corporativa la política de contenido la define producto o legales y a vos te llega un mail. En Codeberg la definieron los socios votando, con el debate archivado en un pull request que cualquiera puede leer.

Eso tiene una contracara: los ToU de una asociación pueden moverse con cada asamblea. Uno de los comentarios en el hilo de Hacker News (47 puntos, 64 comentarios) apuntaba a la falta de garantías de no retroactividad, es decir, qué pasa con los repos que ya están arriba cuando cambia la regla.

¿Cuál es la diferencia entre código asistido por IA y un proyecto «mostly» IA?

Codeberg no prohíbe usar herramientas de IA para programar. La línea que trazó separa el uso de un asistente durante el desarrollo (permitido) de publicar un proyecto cuyo núcleo es salida de modelo que nadie leyó ni entendió (prohibido). Si vos revisás, corregís y podés defender cada decisión del código, estás del lado correcto de la cláusula.

  • Permitido: autocompletar boilerplate con Copilot, pedirle a Claude Code que refactorice un módulo que después leés línea por línea, generar tests y validarlos vos.
  • Permitido: contribuciones puntuales asistidas por IA a un proyecto que mantenés y conocés.
  • Prohibido: subir un repo que un agente generó entero a partir de un prompt, con un README que también escribió el agente, y publicarlo sin haberlo ejecutado.
  • Zona gris: el proyecto donde arrancaste vos, el agente escribió la mitad y no llevás la cuenta. Nadie definió el porcentaje.

¿Cómo va a detectar Codeberg el código generado por IA?

No hay detección automática. El esquema es reactivo: llega un reporte, un moderador mira el repositorio y decide. En el debate describieron el enforcement de Codeberg como «personal y no demasiado automatizado», que es la forma amable de decir que depende del criterio de personas mirando repos de a uno. Sobre eso hablamos en cómo entrena OpenAI a ChatGPT.

¿Qué mira un moderador? Rastros que las herramientas dejan solas: trailers Co-Authored-By: en los commits, archivos AGENTS.md o configuraciones de agentes olvidadas en el repo, historiales donde 12.000 líneas entran en un commit a las 3 de la mañana.

El agujero es obvio y en el propio hilo lo señalaron: cualquiera que quiera esquivar la regla configura sus herramientas para no dejar rastro y listo. O sea que la política castiga, sobre todo, a quien fue transparente sobre cómo hizo las cosas. Ojo con eso, porque es un incentivo torcido: la «detección» premia al que oculta.

Vale un detalle práctico para quien trabaja con agentes a diario: si tu flujo agrega el trailer Co-Authored-By de forma automática, ese metadato es hoy la señal número uno que va a mirar un moderador. Revisá tu configuración antes de publicar en Codeberg.

¿Qué políticas tienen GitHub y GitLab, y dónde alojar un proyecto hecho con IA?

GitHub no tiene una prohibición equivalente y va en la dirección contraria: integra Copilot en el producto y empuja el desarrollo asistido como funcionalidad central. GitLab tampoco publicó una restricción comparable. A julio de 2026, Codeberg es la única plataforma grande del ecosistema con esta cláusula en sus términos.

Eso no significa que en esas plataformas el problema de copyright desaparezca. Significa que lo asume otro: vos, el proyecto y, llegado el caso, una empresa con departamento legal propio. Más contexto en cómo se entrenan los modelos de lenguaje.

La tercera opción es autohostear. Forgejo (el software que corre Codeberg) y Gitea son libres y andan bien en un VPS chico, así que podés levantar tu propia forja y definir vos las reglas de tu instancia. Si estás en Argentina o la región y querés la infraestructura cerca, con soporte en español, donweb.com tiene servidores donde montarlo sin demasiada ceremonia.

¿Qué significa para equipos y empresas en Latinoamérica?

Para la mayoría de los equipos de la región, el impacto operativo directo es bajo: Codeberg no es la forja principal de casi ninguna empresa acá. El impacto real es de precedente. Si una plataforma comunitaria fija que el código sin trazabilidad de origen es un pasivo legal, es cuestión de tiempo hasta que un cliente corporativo pregunte lo mismo en un pliego.

La movida práctica no es dejar de usar IA. Es empezar a documentar cómo la usás: política interna escrita, revisión humana obligatoria antes del merge y un registro mínimo de qué se generó con qué. El día que te lo pidan, ya lo tenés.

Qué está confirmado y qué no

Confirmado

  • La cláusula está en vigencia en el documento oficial: § 2 (1) 7 de TermsOfUse.md, mergeada el 22 de julio de 2026.
  • El voto fue vinculante: la propuesta pasó por la votación de socios de la Asamblea Anual 2026 antes del merge.
  • El fundamento declarado es el copyright incierto más la falta de salvaguardas contra código dañino, según el propio texto de la cláusula.
  • Usar asistentes de IA sigue permitido cuando hay revisión humana efectiva sobre lo que se publica.

Todavía sin definir

  • Qué significa «mayoría»: no hay umbral numérico. Ni porcentaje de líneas, ni de commits.
  • Fecha de entrada en vigor explícita: el documento no la consigna, y tampoco cómo se trata lo publicado antes del cambio.
  • Procedimiento de apelación: qué hacés si te reportan y considerás que el repo es tuyo de verdad.
  • El posteo aclaratorio: la conducción de Codeberg se comprometió a publicar una entrada de blog explicando la implementación. Al 23 de julio de 2026 todavía no salió.

Errores comunes al leer esta política

  • Creer que Codeberg prohibió usar IA para programar. No lo hizo. Prohibió publicar proyectos cuyo cuerpo principal es salida de modelo sin revisión. Podés usar Copilot y Claude Code y seguir cumpliendo el ToU.
  • Asumir que hay un detector automático que te va a marcar. No existe. El enforcement es por reporte y revisión humana, con las ventajas y las arbitrariedades que eso trae.
  • Pensar que es una discusión de calidad de código. El texto aprobado se apoya en copyright y seguridad. Discutir si «la IA escribe mejor que un junior» no toca el argumento legal, que es el que motivó el voto.
  • Migrar a otra plataforma creyendo que ahí el riesgo legal desaparece. Cambia quién lo absorbe, no el riesgo. La incertidumbre sobre el copyright del código generado es la misma en cualquier forja.

Preguntas Frecuentes

¿Qué es Codeberg?

Codeberg es una plataforma europea de alojamiento de código fuente sin fines de lucro, construida sobre Forgejo y gestionada por la asociación Codeberg e.V., cuyas decisiones de política las votan sus miembros. Es la alternativa comunitaria más conocida a GitHub dentro del ecosistema de software libre.

¿Puedo seguir usando Copilot o Claude Code en proyectos alojados en Codeberg?

Sí. La cláusula apunta a proyectos que «en su mayoría» consisten en código generado por IA, no al uso de asistentes durante el desarrollo. Si leés, entendés y revisás lo que la herramienta produce antes de publicarlo, tu proyecto no cae bajo la prohibición.

¿Desde cuándo rige la prohibición?

El cambio se incorporó a los Términos de Uso con el merge del 22 de julio de 2026, tras el voto de la Asamblea Anual 2026. El documento no consigna una fecha de entrada en vigor separada ni aclara el tratamiento de los repositorios publicados antes de esa fecha. Cubrimos ese tema en detalle en la estrategia de Google sobre IA.

¿Cómo sabe Codeberg si un proyecto fue generado por IA?

Por reportes de la comunidad y revisión manual de moderadores, sin herramientas de detección automática. Las señales que se mencionaron en el debate son rastros que dejan las propias herramientas: trailers Co-Authored-By: en los commits o archivos de configuración de agentes como AGENTS.md dentro del repositorio.

¿GitHub y GitLab tienen una prohibición parecida?

No. A julio de 2026 ninguna de las dos publicó una restricción comparable sobre proyectos generados por IA. GitHub va en sentido inverso e integra Copilot como funcionalidad central de la plataforma, lo que deja a Codeberg como el único caso relevante con esta cláusula en sus términos.

Conclusión

Lo que cambió el 22 de julio de 2026 es chico en superficie y grande en señal: una plataforma de alojamiento de código decidió, por voto de sus socios, que el código sin origen trazable es un riesgo que no quiere cargar. El argumento no es «la IA programa mal». Es «no sé quién es el dueño de esto y no tengo con qué averiguarlo en un juzgado».

La política tiene agujeros grandes: «mayoría» sin definir, enforcement manual y un incentivo perverso que favorece a quien borra los rastros. Habría que ver qué dice el posteo aclaratorio que Codeberg prometió, porque ahí se juega si esto es aplicable o queda como declaración de principios.

Si publicás en Codeberg, hacé tres cosas esta semana: revisá si tus commits llevan trailers de agentes, escribí en dos líneas cuál es tu política de revisión humana y ponela en el README. Si trabajás en equipo, la conversación importante no es dónde alojás el repo, es si alguien está leyendo de verdad lo que el agente escribe antes de que llegue a producción.

Fuentes

Desplazarse hacia arriba