KI-Modelle berücksichtigen nur wenige der weltweit über 7000 Sprachgemeinschaften

Image by Tumisu from Pixabay

Die Übersetzungen der bekannten closed source KI-Modelle sind schon richtig gut und können beispielsweise für Touristen sehr hilfreich sein. Bei unserer Reise nach Taiwan, Japan und Singapur 2025 haben wir das selbst erlebt.

Wenn es allerdings um sensible Bereiche wie Gesundheit, Recht usw. geht, kommt es oftmals auf sprachliche Nuancen an. Diese Texte/Situationen können die gängigen KI-Modelle recht gut, aber nicht immer sehr gut bewältigen. Für agglutinierende Sprachen, wie Ungarisch, Baskisch, etc. reichen die üblichen KI-Modelle beispielsweise nicht aus

So kann es in Regionen der Welt im Gesundheitsbereich zu lebensbedrohlichen Situationen kommen, da der Input und die Ergebnisse der KI-Modelle geographisch und linguistisch sehr unterschiedlich sind. Genau das haben die United Nations (UN) in einer aktuellen Veröffentlichung noch einmal bestätigt.

The inputs and outcomes of artificial intelligence are geographically and linguistically uneven
Most of the world’s languages and cultures remain underserved. More than 7,000 languages are spoken worldwide, yet AI model development and evaluation infrastructure reflects only a small fraction of them“
UN (2026): Preliminary Report of the Independent International Scientific Panel on AI

Es wundert daher nicht, dass es immer mehr Länder und Regionen in der Welt gibt, die ihre eigenen KI-Modelle entwickeln und veröffentlichen – natürlich als Open Source Modelle. Für Europa habe ich in unserem Blog schon auf einige interessante Open Source KI-Modelle hingewiesen: TEUKEN 7B (Alle europäischen Sprachen), EURO LLM (Alle europäischen Sprachen), MINERVA AI LLM (Italienisch), PLLuM (Polnisch), RAKA 4B (Ungarisch), GPT-SW3 (Schwedisch), ALIA (Spanisch), AMALIA (Agente Multimodal Automático de Linguagem com IA).

Ich halte solche Modelle auch für innovative Kleine und Mittlere Unternehmen (KMU) spannend, da sie sich dadurch von dem was alle anderen machen (Ein KI-Modell für alles – One size fits all), unterscheiden können. Dazu habe ich ein Paper für die internationale Konferenz MCP 2026 (16.-19.09.2026, Balatonfüred, Ungarn) geschrieben:

Digital Sovereignty and Open-Source AI: The European Way for Innovative SMEs

Siehe dazu auch:

KI-Modelle: Von „One Size Fits All“ über Variantenvielfalt in die Komplexitätsfalle?

Künstliche Intelligenz im Innovationsprozess von Organisationen

Künstliche Intelligenz: Was ist unter einer Mixture of Experts (MoE) Architektur zu verstehen?

Künstliche Intelligenz für die Menschen

UN (2024): Governing AI For Humanity

Immer mehr Regionen und Länder stellen fest, dass die Entwicklung der Künstlichen Intelligenz – wie alle Innovationen – mindestens zwei Seiten hat. Es gibt einerseits den Nutzen für Menschen, Unternehmen und Gesellschaften und andererseits auch Schwierigkeiten.

Solche Entwicklungen geben immer Anlass, darüber nachzudenken, ob Künstliche Intelligenz so gesteuert werden kann, dass es nicht nur einzelnen Unternehmen zugute kommt, sondern einer ganzen Gesellschaft.

In der Zwischenzeit gibt es sehr viele nationale und regionale Initiativen, die versuchen, einerseits die Entwicklungen von Künstlicher Intelligenz zu fördern, andererseits aber auch Grenzen zu ziehen, deren Überschreitung zu möglichen gesellschaftlichen Schäden führen können.

Die United Nations (UN) ist für so eine Fragestellung prädestiniert, und hat mit der Veröffentlichung UN /2024): Governing AI For Humanity (PDF) eine gute Basis geschaffen, um ausgewogen über das Thema diskutieren zu können.

Aktuell habe ich den Eindruck, dass die Diskussionen über die Entwicklung und Nutzung Künstlicher Intelligenz von den amerikanischen Tech-Konzernen dominiert werden, die ihre wirtschaftlichen Vorteile sehen, die gesellschaftlich negativen Auswirkungen gerne den jeweiligen Ländern überlassen wollen.

Siehe dazu auch Bris, A. (2025): SuperEurope: The Unexpected Hero of the 21st Century und die Erläuterungen zu einer Society 5.0.

Digitale Abhängigkeit in den Verwaltungen von Bund und Ländern: Warum eigentlich?

Image by Robin Higgins from Pixabay

Es ist unstrittig, dass die Verwaltungen in Bund und Ländern modernisiert, und damit auch digitalisiert werden müssen. Dabei haben deutsche Verwaltungen in der Vergangenheit gerne Software amerikanischer Tech-Konzerne genutzt.

„Die deutsche Verwaltung ist in hohem Maße abhängig von proprietären, US amerikanischen IT-Lösungen. 96% der Verwaltungsangestellten arbeiten täglich mit Microsoft-Produkten. 80% der Verwaltungsdaten werden in Datenbanken des US-Anbieters Oracle gespeichert und 75% der Virtualisierungslösungen kommen von VMWare“ (ZenDis 02/2025: Digitale Souveränität als Staatsaufgabe).

Die Abhängigkeiten sind für den deutschen Steuerzahlen teuer: „Laufende Rahmenverträge mit großen IT-Firmen wie Microsoft und Oracle belaufen sich auf 13,6 Milliarden Euro“ (Netzpolitik.org vom 04.12.2024). Je abhängiger die Verwaltungen hier sind, um so rigoroser können (und werden) Preissteigerungen durchgesetzt – zur Gewinnsteigerung bei den Tech-Konzernen und zum Nachteil der Gesellschaft.

Weiterhin wird deutlich, dass die Trump-Administration einen starken Einfluss auf die amerikanischen Tech-Konzerne hat – ganz im Sinne von „America first“. Was mit den europäischen oder deutschen Befindlichkeiten und Interessen ist, ist nicht wirklich relevant. Das ist aus der Sicht amerikanischer Konzerne und amerikanischer Administrationen verständlich, sollte uns in Europa allerdings nachdenklich stimmen -gerade auch wenn es um den nächsten Schritt geht: Dem Einsatz von Künstlicher Intelligenz.

Da es seit vielen Jahren schon verstärkt Hinweise dazu gibt, dass ohne Open Source keine moderne und souveräne Digitalisierung in Deutschland erreichbar ist, muss man sich als Bürger wundern, dass sich die Politik von den amerikanischen Tech-Konzernen immer weiter abhängig macht. Das ganze Ausmaß dieser Fehlentwicklung wird in dem folgenden Artikel zusammengefasst:

Mischler, G. (2025): Open Source hat im Bund keine Lobby, golem vom 04.07.2025.

Auch Unternehmen, NGOs und Privatpersonen sollten sich die Frage stellen, ob sie nicht die verfügbaren Open-Source-Alternativen für ihre eigene digitale Souveränität nutzen sollten.

Wir haben schon vor mehreren Jahren mit diesen Schritten angefangen. Wir nutzen NEXCLOUD statt Microsoft Cloud, OpenProject statt MS Project, NEXCLOUD TALK statt Teams, Nextcloud Office statt Microsoft Office, etc. Darüber hinaus verwenden wir auch Open Source AI (LocalAI). Damit bleiben alle Daten auf unseren Servern.

Sprechen Sie mich bei Fragen gerne an.