Späť na Katalóg
MiniMax-M3
Model
MiniMax-M3 je natívny multimodálny model s 1 miliónom kontextu. Má ~428 miliárd parametrov a ~23 miliárd aktivovaných parametrov. Od prvého kroku prechádza tréningom zmiešanej modality, čo umožňuje hlbšiu sémantickú fúziu textu, obrázkov a videa. M3 zavádza MiniMax Sparse Attention (MSA) na zlepšenie efektivity dlhých kontextov. M3 prináša 9-násobné zrýchlenie preddopĺňania a 15-násobné zrýchlenie dekódovania v porovnaní s M2 pri 1 milióne kontextov, čím sa výpočtový čas na token znižuje na 1/20.
- Spolupracovali
- MiniMax
- Jazyk
- sk, eng, other
- Modalita
- Iné