「考えすぎ」をモデル自体に直させた — Fireworks AIのEmber-1、推論トークンを40%削減しつつコーディング性能はほぼ維持
DRANK

9月28日、MarkTechPostが「Fireworks AI Releases Ember-1: A Post-Trained Kimi K3 That Uses About 40% Fewer Tokens」と題した記事を公開した。Fireworks AIがKimi K3をポストトレーニングして推論トークン数を約40%削減したモデル「Ember-1」のリリースを伝える内容だ。本番A/Bテストではタスクスコアをほぼ維持したまま出力トークンを39%削減し、一部ベンチマークではベースモデルを上回るという結果が示されている。

by @tf_official
Related Topics: AI Machine Learning Deep Learning