注目論文の要点(1件)
大規模言語モデル(LLM)の推論はクラウド上のフロンティアモデルが中心だが、20B(200億)以下のローカルモデルとノートPC級アクセラレータの性能向上で、その前提が揺らぎつつある。arXivに公開された論文は、消費電力…