LLM X/Twitter 4h ago 1 min read Metaの30B Muse Glimmer、20GB未満でローカルAIを駆動しRTX 5090で3.1倍高速化 300億パラメータのエージェントモデルを20GB未満に圧縮し、24GB級の一般向けマシンでローカル実行を狙う。Metaの測定では、DFlashによりRTX 5090のデコード速度が3.1倍になった。 #meta#muse-glimmer#local-ai