NachschlagenQuellenregister

Originalarbeiterreichbar

Ayn: A Tiny yet Competitive Indian Legal Language Model Pretrained from Scratch

arxiv.org (externe Seite)

Niyogi, Gaussier und Bhattacharya fragen am 20.03.2024, ob ein von Grund auf trainiertes Kleinstmodell ein großes ersetzen kann, und beantworten das am indischen Rechtswesen. Ihr Modell mit 88 Millionen Parametern entstand in 185 A100-Stunden und bekam ein eigenes, auf das Fachgebiet zugeschnittenes Vokabular. Bei der Vorhersage von Urteilen schlägt es Modelle bis zum Achtzigfachen seiner Größe. Die zuletzt am 16.03.2026 überarbeitete Fassung zeigt, dass der Zuschnitt schon beim Bauen geschehen kann statt erst beim Feinjustieren.

geprüft 24.09.2026

Worauf sich diese Seite beruft, wörtlich, abgerufen am 04.09.2026:

  • an 88M TLM pretrained from scratch for 185 A100 hours on a specific domain with a domain-specific tokenizerbestätigt 24.09.2026
  • can indeed outperform LLMs up to 80 times larger on the legal case judgment prediction taskbestätigt 24.09.2026

10 Small Language Models

Alle Quellen

Tippen Sie los.

↑↓ auswählenEnter öffnenDie Suche läuft im Browser. Nichts wird übertragen.