Liquid AIがVLM推論を最大3.13倍高速化 — パラメータ増加わずか9%で既存モデルに後付けできる「ドラフトモデル」手法がMacでも使えるように
DRANK

9月25日、MarkTechPostが「Liquid AI Releases LFM2.5-VL-3B-DSpark: Speculative Decoding for Vision-Language Models With Up to 3.13x Faster Decoding」と題した記事を公開した。この記事では、Liquid AIがVision-Language Model(VLM)向けのSpeculative Decodingドラフトモデル「LFM2.5-VL-3B-DSpark」を公開し、Apple SiliconおよびNVIDIA H100上でデコード速度を最大3.13倍に高速化した成果について詳しく紹介されている。

by @tf_official
Related Topics: AI Machine Learning Deep Learning