Ai2がMoE型LLM訓練フレームワーク「Olmo-core 3」を公開 — NvidiaのMegatron-coreより2.7倍速く、1兆パラメータまでスケール可能
DRANK

10月2日、SiliconAngleが「Ai2 releases Olmo-core 3 to make developing large mixture-of-experts LLMs more efficient」と題した記事を公開した。Allen Institute for AI(Ai2)がMoE(Mixture-of-Experts)型LLMのトレーニング効率を大幅に向上させる開発フレームワーク「Olmo-core 3」をリリースしたことを伝えている。NvidiaのMegatron-coreと比較して約2.7倍のスループットを達成したとしており、オープンな研究コミュニティが兆規模のモデル開発に取り組める環境の整備を目指している。

by @tf_official
Related Topics: AI Machine Learning Deep Learning