Вход на сайт

Просмотр новости

Найдите то, что Вас интересует

Codeberg verbietet KI-Training und KI-Massenprojekte

Дата публикации: 23-07-2026 13:48:00

Codeberg verbietet die Nutzung seiner Daten für KI-Training und plant, KI-generierte Massenprojekte auszuschließen.

Основное содержимое страницы с новостью.

Codeberg will den auf der Plattform gehosteten Code und andere Nutzerdaten nicht zum Training großer Sprachmodelle nutzbar machen. Zugleich plant der Berliner Verein, seine Nutzungsbedingungen zu ändern: Repositories, die weitgehend automatisiert durch KI-Agenten entstehen oder mit hohem Ressourcenverbrauch betrieben werden, können künftig gegen die Regeln der Plattform verstoßen. Die Mitgliederversammlung von Codeberg e. V. hat beide Anträge angenommen.

Codeberg ist eine gemeinnützige, gemeinschaftlich betriebene Plattform für freie und quelloffene Software. Sie bietet Git-Hosting auf Basis von Forgejo, außerdem etwa CI/CD, Pages und eine Weblate-Instanz für Übersetzungen. Der Verein mit Sitz in Berlin versteht sich als datensparsame, nichtkommerzielle Alternative zu GitHub und GitLab.

Keine Trainingsdaten aus Codeberg-Projekten

Mit dem ersten Beschluss bekräftigt Codeberg seine bisherige Datenschutzlinie: Weder Quellcode noch Daten von Nutzern und Projekten sollen für generative KI genutzt oder zum Training großer Sprachmodelle (LLMs) herangezogen werden. Das betrifft die Codeberg-Dienste selbst, nicht jedoch zwangsläufig externe Akteure, die öffentlich verfügbare Repositories automatisiert abrufen.

Gerade diese automatisierten Abrufe sieht Codeberg als Problem an: Crawler von KI-Anbietern durchsuchen nicht nur Git-Repositories über den üblichen git clone-Weg. Sie rufen auch zahlreiche Webansichten, Varianten von Issue-Filtern, Historienstände und wiederholt identische Dateien ab. Das belastet die Datenbanken und zwingt die Administratoren zu Limits und Schutzmaßnahmen, die ebenso legitime Nutzer treffen.

Codeberg begründet die Entscheidung zudem mit seiner grundsätzlichen Kritik an LLMs. Der Verein verweist auf steigenden Infrastrukturbedarf, Energieverbrauch und die Belastung kleiner Betreiber durch teurere Hardware. Diese Folgen seien mit dem Anspruch einer ressourcenschonenden, gemeinschaftlich getragenen Infrastruktur schwer vereinbar, argumentiert Codeberg im Blogbeitrag.

Neue Regeln gegen KI-Massenprojekte

Der zweite Beschluss zielt auf Projekte, die Codeberg als „vibe-coded“ einstuft. Gemeint sind dabei nicht einzelne KI-gestützte Ergänzungen oder ein Codevorschlag aus einem Sprachmodell. Im Fokus stehen Repositories, deren Inhalt weitgehend durch LLMs oder autonome Agenten entsteht, ohne dass Menschen ihn langfristig prüfen, weiterentwickeln und warten.

Die Mitgliederversammlung nahm den Antrag mit 358 Ja- zu 144 Nein-Stimmen bei 14 Enthaltungen an. Die geplante Änderung der Nutzungsbedingungen soll es Codeberg erlauben, solche Projekte auszuschließen. Der Verein kündigt allerdings keine automatische Suche nach KI-generiertem Code und keine kurzfristige Massenlöschung bestehender Repositories an.

Codeberg nennt Projekte mit aktiver Community oder einer längeren, vor dem LLM-Boom begonnenen Entwicklungsgeschichte als Fälle, die von den neuen Regeln voraussichtlich nicht betroffen sind. Kleine Experimente und Skripte mit geringem Ressourcenverbrauch sollen laut Codeberg in der Praxis in der Regel geduldet werden.

Kritischer sieht Codeberg dagegen Projekte, die KI-Agenten autonom erzeugen, ebenso wie eine stark LLM-gestützte Entwicklung und Repositories mit unverhältnismäßig hohem Speicher- oder CI-Verbrauch. Codeberg beschreibt etwa Projekte, die von einer einzelnen Person betrieben werden, aber große Binärpakete für viele Plattformen bauen und umfangreiche Pipelines ausführen. Der Verein will seine aus Spenden finanzierte Infrastruktur nicht für solche „Geisterprojekte“ vorhalten.

Maintainer: Mehr Prüfaufwand durch KI

Der Konflikt betrifft nicht nur Codeberg, sondern viele Open-Source-Projekte: KI-Werkzeuge senken die Hürde, Änderungsvorschläge und Pull Requests einzureichen. Das bedeutet jedoch nicht, dass sie den Review-Aufwand senken. Maintainer müssen weiterhin Architektur, Tests, Sicherheit, Lizenzlage und Wartbarkeit prüfen. Bei unpassenden oder oberflächlichen Beiträgen steigt ihre Arbeit sogar.

GitHub hat auf die wachsende Flut solcher Beiträge zuletzt mit Maßnahmen gegen sogenannten KI-Slop reagiert. Gemeint sind massenhaft eingereichte, oft kaum geprüfte Änderungen und Tickets. GitHub setzt damit auf Moderations- und Verwaltungswerkzeuge, anstatt KI-generierte Projekte grundsätzlich aus dem Hosting auszuschließen.

Auf Ebene der Hosting-Infrastruktur setzt Forgejo auf einen weiteren Ansatz: Die Software liefert inzwischen standardmäßig eine restriktive robots.txt aus. Sie soll Crawler, die sich an diese Konvention halten, von problematischen Endpunkten fernhalten. Einen wirksamen Schutz gegen Akteure, die eine robots.txt ignorieren, bietet das allerdings nicht.

Kommerzielle Plattformen regeln die Nutzung von Daten für ihre KI-Funktionen unterschiedlich. GitLab erklärt für Duo, Eingaben und Ausgaben außerhalb ausdrücklich freigegebener Datensammlungen nicht aufzubewahren. Nutzungsdaten für Serviceverbesserungen und Fehlersuche sollen demnach nicht zum Training von KI-Modellen dienen. GitHub erlaubt individuellen Copilot-Nutzern dagegen, die Verwendung ihrer Daten für das Modelltraining in den Einstellungen abzuwählen.

(fo)

Схожие новости

#Наименование новостиТональностьИнформативностьДата публикации
1Git-хостинг Codeberg запретил размещение проектов, созданных при помощи AI015.6222-07-2026
2Bayern verbietet Verbot von KI0513-07-2026
3Китайская Alibaba Group запрещает своим сотрудникам использовать ИИ Claude Code-1604-07-2026
4Проект Debian проводит общее голосование о допустимости применения AI при разработке08.6325-07-2026
5Anthropic labels Claude Code 'high-risk software', bars employees from using it0506-07-2026
6Академик Каляев призвал ограничить использование ИИ, не отвечающих законам РФ0022-03-2025
7US-Regierung lässt Zugang zu neuer KI von OpenAI beschränken0501-07-2026
8Sperrung von KI-Sprachmodellen: Im Biergarten mit der Superintelligenz-2516-06-2026
9В Госдуме отклонили проект о маркировке сгенерированного ИИ контента0515-04-2026

Классификация: Пресс-релизы. Схожих патентов: 0. Схожих новостей: 9. Тональность: 0. Информативность: 23.33. Источник: heise.de.