Variational Neurons in Transformers for Language Modeling
DOI: 10.48550/arXiv.2603.28219
Zusammenfassung
Diese Veröffentlichung integriert EVE-Einheiten in die Feed-forward-Blöcke eines Transformers, ohne dessen grundlegende Architektur zu verändern. Sie vergleicht deterministische und variationelle Varianten anhand prädiktiver und probabilistischer Metriken.
Diese Seite bietet eine deutschsprachige Einführung. Der offizielle bibliografische Titel, das vollständige Abstract, das Manuskript und die Google-Scholar-Metadaten bleiben auf der englischen wissenschaftlichen Referenzseite verfügbar.