Ankündigung des Herstellerserreichbar
Google, Introducing Gemma 3 270M
developers.googleblog.com (externe Seite)
Google stellt am 14.08.2025 ein Modell mit 270 Millionen Parametern vor, das von Anfang an auf den Zuschnitt für eine Aufgabe gebaut ist. Der Eintrag steht hier wegen einer Zahl: 170 der 270 Millionen Parameter stecken im Vokabular und nur 100 Millionen in den Rechenschichten. Damit ist zweierlei belegt, dass Parameterzahl und Gewichte verschiedene Dinge sind, und dass ein Vokabular für viele Sprachen einen erheblichen Teil eines kleinen Modells beansprucht. Die Angaben stammen vom Hersteller.
geprüft 24.09.2026
Worauf sich diese Seite beruft, wörtlich, abgerufen am 04.09.2026:
Our new model has a total of 270 million parameters: 170 million embedding parameters due to a large vocabulary size and 100 million for our transformer blocks.
bestätigt 24.09.2026designed from the ground up for task-specific fine-tuning
bestätigt 24.09.2026Thanks to the large vocabulary of 256k tokens, the model can handle specific and rare tokens, making it a strong base model to be further fine-tuned in specific domains and languages.
bestätigt 24.09.2026Gemma 3 270M inherits the advanced architecture and robust pre-training of the Gemma 3 collection
bestätigt 24.09.2026