テクノロジー
推論コストと価格
モデル提供のコストと、トークン価格・効率化技術による変化。
//
今週
- LFM2.5-VL-DSparkを発表 ビジョン・ランゲージモデルにおける推測的デコードが導入されました会社は、ビジョン・ランゲージモデル(VLM)LFM2.5-VL-3B用の実験的なDSparkドラフトモデルをリリースしました。このモデルは、CPUとGPUの両方で推論速度を向上させるために、speculative decodingを導入していますが、出力品質には影響を与えません。安定テクノロジー1件の情報源 · 一次情報 1件 · 3件の証拠2026-09-24 22:08
- メタがミューズ・グリムを発表Metaは、ローカル、エージェント、マルチモーダル、オープンソースのAIモデルであるMuse Glimmerをリリースしました。このモデルには、推測デコードやさまざまな推論エンドポイントへのサポートなどの高度な機能が搭載されています。安定テクノロジー1件の情報源 · 一次情報 1件 · 3件の証拠2026-08-10
今週の検証済みの変化2件。
日次の動き
安定
このトピックのシグナル
- 01ShamAN-Q: シャンプー補助ナノクォンテーションによるサブ1ビットLLM重み研究者たちは、大規模言語モデル用の新しいサブ1ビットの事後トレーニング量子化手法であるShamAN-Qを開発しました。これは、NanoQuantを改善し、密度のカーブメトリックとマハラノビス再構成損失を組み合わせることで実現されました。技術発表2026-10-02 12:00
- 02LFM2.5-VL-DSparkを発表 ビジョン・ランゲージモデルにおける推測的デコードが導入されました会社は、ビジョン・ランゲージモデル(VLM)LFM2.5-VL-3B用の実験的なDSparkドラフトモデルをリリースしました。このモデルは、CPUとGPUの両方で推論速度を向上させるために、speculative decodingを導入していますが、出力品質には影響を与えません。技術発表2026-09-24 22:08
- 03メタがミューズ・グリムを発表Metaは、ローカル、エージェント、マルチモーダル、オープンソースのAIモデルであるMuse Glimmerをリリースしました。このモデルには、推測デコードやさまざまな推論エンドポイントへのサポートなどの高度な機能が搭載されています。技術発表2026-08-10