AMALIA: Portugiesisches Open Source KI-Modell

https://amaliallm.pt/

Die bekannten proprietären KI-Modelle lassen oft die kulturellen Besonderheiten außen vor. Am Beispiel von agglutinierender Sprachen wie Ungarisch, Baskisch, etc. kann das deutlich aufgezeigt werden. Es ist daher nur zwingend, dass es in der Zwischenzeit weltweit sehr viele regionale und länderspezifische Open Source KI-Modelle gibt.

Beispielhaft sollen hier nur einige wenige KI-Modelle genannt werden, die sich auf europäische Sprachen konzentrieren: TEUKEN 7B (Alle europaischen Sprachen), EURO LLM (Alle europäischen Sprachen), MINERVA AI LLM (Italienisch), PLLuM (Polnisch), RAKA 4B (Ungarisch), GPT-SW3 (Schwedisch), ALIA (Spanisch).

Nun kommt mit AMALIA (Agente Multimodal Automático de Linguagem com IA) ein weiteres Open Source KI-Modell hinzu, das mit den Besonderheiten der portugiesischen Sprache trainiert wurde, und frei zur Verfügung steht. Auf der Website werden folgende Ziele formuliert:

Förderung der portugiesischen Sprache

Souveränität über die Daten der Bürger

Die kulturelle Repräsentation Portugals bewahren

Förderung von Forschung und Innovation im Bereich der Künstlichen Intelligenz

Minerva AI LLM: Das italienischsprachige KI-Modell

https://minerva-ai.org/

In dem Blogbeitrag Open Source AI-Models for Europe: Teuken 7B – Training on >50% non English Data hatte ich schon erläutert, wie wichtig es ist, dass sich Organisationen und auch Privatpersonen nicht nur an den bekannten AI-Modellen der Tech-Giganten orientieren.

Die dort oftmals hinterlegten Daten, die natürlich zum überwiegenden Teil in Englisch (oder Chinesisch) vorliegen, spiegeln nicht die vielfältige europäische Kultur mit ihren vielen Nuancen wieder. Kulturelle Bereiche, definieren sich oftmals über die jeweilige Sprache.

Es ist daher nicht verwunderlich, dass es in den jeweiligen europäischen Ländern einen Trend gibt, KI-Modelle zu entwickeln, die die jeweilige sprachlichen Besonderheiten beachten – wie z.B. Minerva AI LLM:

Minerva AI LLM is the first family of Large Language Models pretrained from scratch in Italian developed by Sapienza NLP in collaboration with Future Artificial Intelligence Research (FAIR) and CIN AIECA. The Minerva models are truly-open (data and model) Italian-English LLMs, with approximately half of the pretraining data composed of Italian text. You can chat with Minerva for free directly through the app — it’s easy, fast, and open to everyone.

Es handelt sich also um eine Modell-Familie, die offen für jeden nutzbar ist. Es zeigt sich auch hier wieder, dass Künstliche Intelligenz auf Vertrauen basieren muss, damit sie den gesellschaftlichen und wirtschaftlichen Anforderungen gerecht werden kann. Siehe dazu auch beispielhaft

Künstliche Intelligenz – It All Starts with Trust

Open EuroLLM: Ein Modell Made in Europe

Spanisch: Open Source AI: Veröffentlichung der ALIA AI Modelle für ca. 600 Millionen Spanisch sprechender Menschen weltweit

Schwedisch: GPT SW3