テクノロジー
基盤モデル
フロンティアモデルの能力・コスト・展開の変化。
//
今週
- AirbnbはOpenAIのFrontierモデルへのアクセスを拡大していますAirbnbは、新たな契約を通じてOpenAIのGPT-6 Astraやその他の先端モデルへのアクセスを拡大し、内部のAI能力を強化しました。安定テクノロジー1件の情報源 · 一次情報 1件 · 6件の証拠2026-09-23 09:00
- アントラープックはIPO提出でAI技術から存在的リスクを警告したAnthropic、AIスタートアップ企業は、自身の技術が人間の存在に潜在的なリスクをもたらす可能性についてIPOプロスペクトスに警告を添え、高度なAIモデルの予測不可能な行動や操作に関する懸念を強調しています。安定市場1件の情報源 · 2件の証拠2026-09-29 22:10
- Granite 4.2 LLMs: 増強されたアーキテクチャとトレーニング詳細Graniteは、4.2大規模言語モデルの詳細を公開しました。これは新しいアーキテクチャ、トレーニングメソッド、インフラストラクチャの改善を含みます。安定テクノロジー1件の情報源 · 一次情報 1件 · 4件の証拠2026-08-25 23:14
- Hugging Face は AI モデル評価のために EvalEval と統合しましたHugging Face は、Community Evals を EvalEval と統合し、評価結果のクロス投稿と解釈、およびオープンモデル、ランクボード、統一されたメタデータストアへのリンクを可能にしました。安定テクノロジー1件の情報源 · 一次情報 1件 · 3件の証拠2026-06-30
- NVIDIAがタブレットデータの予測用にKumo Tabularを発表しましたNVIDIAは、テーブルデータの予測用のオープンな基盤モデルであるKumo Tabularをリリースしました。これは精度と効率の新たな境界を築くものです。安定テクノロジー1件の情報源 · 一次情報 1件 · 3件の証拠2026-09-29 23:30
- OpenAIのAIモデルが100以上の長期にわたる数学的問題を解決するOpenAIの新しいAIモデルは、100以上の長期にわたる数学的問題を解決し、数学界を驚かせ、コミュニティに情報を提供する方法についての議論を引き起こした。安定テクノロジー1件の情報源 · 一次情報 1件 · 3件の証拠2026-09-21 20:00
- Google DeepMindとIsomorphic Labsはバイオリジリエンスへの共同アプローチを共有していますGoogle DeepMindとIsomorphic Labsは、高度なAIモデルを通じて生物耐性を向上させるため協力しています。これは、誤用のリスクに対処し、グローバルな生物セキュリティの課題に対して効果的な対応を確保することを目的としています。安定テクノロジー1件の情報源 · 一次情報 1件 · 3件の証拠2026-07-16 17:30
今週の検証済みの変化8件。
日次の動き
急上昇+113%
このトピックのシグナル
- 01ShamAN-Q: シャンプー補助ナノクォンテーションによるサブ1ビットLLM重み研究者たちは、大規模言語モデル用の新しいサブ1ビットの事後トレーニング量子化手法であるShamAN-Qを開発しました。これは、NanoQuantを改善し、密度のカーブメトリックとマハラノビス再構成損失を組み合わせることで実現されました。技術発表2026-10-02 12:00
- 02Granite 4.2 LLMs: 増強されたアーキテクチャとトレーニング詳細Graniteは、4.2大規模言語モデルの詳細を公開しました。これは新しいアーキテクチャ、トレーニングメソッド、インフラストラクチャの改善を含みます。技術発表2026-08-25 23:14
- 03dattri-LLM: LLMスケールでのトレーニングデータ属性を統合的かつ効率的に処理する統一ライブラリdattri-LLMは、大規模言語モデルスケールにおけるトレーニングデータの属性割り当ての課題に対処し、効率性と互換性を向上させることを目的とした新しいライブラリです。技術発表2026-10-02 12:00
- 04オーストラリアの調査がOpenAIにAIデータへのアクセスに関する説明を求めている連邦AI調査委員会の労働委員長であるJo Briskeyと独立 senator David Pocockは、メデケアのハッキング事件の後、OpenAIがどのようにしてそのAIモデルがオーストラリアの民間データにアクセスしないようにするかを説明するよう求めています。政策の変更2026-10-05 22:00
- 05OR が OR を行うための AI:OSCAR フレームワーク内での LLM のエスカレーターへのルーティング新しいフレームワークであるOSCARが導入され、大規模言語モデル(LLMs)を組織における最適化モデリングに使用する際の精度とコスト効果を向上させることを目的としています。技術発表2026-10-02 12:00
- 06BenchMIRT: LLMベンチマークの監査に新しい手法BenchMIRTは、大規模言語モデル(LLM)ベンチマークを個々のプロンプトレベルで監査する新しい手法であり、既存のベンチマークに関する洞察を明らかにし、より効率的な評価方法を提案します。新しい一次情報2026-09-02 05:39
- 07アントラープックはIPO提出でAI技術から存在的リスクを警告したAnthropic、AIスタートアップ企業は、自身の技術が人間の存在に潜在的なリスクをもたらす可能性についてIPOプロスペクトスに警告を添え、高度なAIモデルの予測不可能な行動や操作に関する懸念を強調しています。新しい一次情報2026-09-29 22:10
- 08ESRBは欧州連合(EU)の当局に対して、境界AIによるサイバーリスクが金融安定に与える影響について警告しました。欧州システムリスク委員会(ESRB)は、フロンティアAIモデルがEU金融システムに対するサイバーアタックのスピード、規模、 sophistication を高めることを正式な警告を発したほか、これらのリスクを監督業務に反映させるよう当局に呼びかけた。スウェーデンのスウェーデン中央銀行(Riksbank)および金融監督当局も、金融機関がリスク管理と運用の強靭性を強化することを促した。新しい一次情報2026-07-07 17:30
- 09カリフォルニア州検察長ボンタがOpenAIに対してAIに関するサイバーセキュリティリスクに関する証券命令を発したカリフォルニア州検事総長のロブ・ボンタは、ハングイングフェースの事件に関する公式な調査の後、OpenAIに対してサイバーセキュリティリスクに関する調査命令を発した。新しい一次情報2026-10-02 20:19
- 10CortexBridge: EEGマントーの皮質的アライメントによるファウンデーションモデルCortexBridgeは、EEGモンタージュを共有された皮質潜在空間に合わせる軽量なアダプターであり、異なる電極配置におけるBCI性能を向上させます。技術発表2026-10-02 12:00
- 11数学的推論能力を価値に基づいた情報検索を通じて向上させる新しいトレーニングフレームワークであるAPIVISは、直接的な応答と検索された応答を組み合わせることで、大規模言語モデルの数学的推論能力を向上させ、検証可能な報酬を用いた強化学習を活用しています。新しい一次情報2026-10-02 12:00
- 12ルールをツールに:科学計算におけるLLMエージェントの実行可能なチェック新しいツール、Rules to Tools(R2T)は、科学的コードエージェントに対して実行可能なチェックを提供し、科学計算におけるプログラム評価の精度を向上させます。技術発表2026-10-02 12:00
- 13ActiveSaddler: エージェントハーゴス最適化のための自動カリキュラム学習新しい方法であるActiveSaddlerは、LLMエージェントのハーキスを自動的に最適化することにより、ハーキスの進化するニーズに応じてトレーニングカリキュラムを調整します。技術発表2026-10-02 12:00
- 14OpenAIは未公開モデルを使用して、数百のオープンな数学問題の解答をリリースOpenAIは、未公開のフロンティアモデルによって生成された長年の数学問題の解決策を複数公開しました。これには、372の結果ファミリーにわたる722の原稿が含まれます。このリリースは何週間も前から予想されており、新たに結成されたAGMAI諮問グループ(エリート数学者で構成され、結果の責任ある伝達を任務とする)によると、「何百もの」未解決問題の解決策が含まれているとのことです。新しい一次情報2026-10-07 07:26
- 15AirbnbはOpenAIのFrontierモデルへのアクセスを拡大していますAirbnbは、新たな契約を通じてOpenAIのGPT-6 Astraやその他の先端モデルへのアクセスを拡大し、内部のAI能力を強化しました。技術発表2026-09-23 09:00
- 16データベース設計における段階的フィードバックのための教育者支援型LLM新しいシステムは、LLMsを用いて概念的なデータベース設計における構成的フィードバックを提供し、ERDエディタと統合し、教育者によって作成された評価基準を使用しています。技術発表2026-10-02 12:00
- 17Plaid、クレジット、詐欺、支払い向けの新しいAIモデルを発表Plaidは、Instant Link、LendScore 2、LendScore Arcを含む新しいAIモデルを導入し、キャッシュフローデータを活用して金融機関の信用および不正検知の意思決定を強化しました。技術発表2026-10-06 21:00
- 18Beyond Memory: 長い時間スパンのエージェントを明示的な信念状態で活用する研究者たちは、大規模言語モデルエージェントが明示的な信念状態を維持できるようにするフレームワークPoSを開発しました。これにより、長期タスクにおける理解力と意思決定が向上します。技術発表2026-10-02 12:00
- 19Generative AI協力に関する新研究ある研究では、反復囚人ジレンマを用いて、信頼、戦略、感情的サインalingが生成型AIモデルにおける協力的行動に与える影響を探る。新しい一次情報2026-10-02 12:00
- 20Hugging Face は AI モデル評価のために EvalEval と統合しましたHugging Face は、Community Evals を EvalEval と統合し、評価結果のクロス投稿と解釈、およびオープンモデル、ランクボード、統一されたメタデータストアへのリンクを可能にしました。報道の広がり2026-06-30
- 21Dependency-Aware Reward Shaping for Agentic Reinforcement Learning研究者たちは、依存関係に基づいた報酬形成(Dependency-Aware Reward Shaping、DARS)を提案し、大規模言語モデルにおける強化学習を改善することを目的としています。このアプローチでは、前提条件の関係に基づいてステップレベルのクレジットを割り当てることで、失敗したエピソードにおける無駄な努力の問題に対処します。新しい一次情報2026-10-02 12:00
- 22NVIDIAがタブレットデータの予測用にKumo Tabularを発表しましたNVIDIAは、テーブルデータの予測用のオープンな基盤モデルであるKumo Tabularをリリースしました。これは精度と効率の新たな境界を築くものです。技術発表2026-09-29 23:30
- 23DeFA: LLMエージェントにおける依存性に基づく失敗属性割り当てDeFAは、LLMエージェントの実行におけるエラーの根本原因を特定するための新しいフレームワークであり、イベント依存グラフと失敗伝播グラフを構築することによって機能します。技術発表2026-10-02 12:00
- 24RISED: Agentic Multi-environment Selection and Self-DistillationのためのRubrics新しい方法RISEDが導入され、多様なインタラクティブ環境におけるLLMエージェントのトレーニングに焦点を当てています。これはプロンプトグループの選択に加え、環境間での学習率の変化を処理することを目的としています。技術発表2026-10-02 12:00
- 25OpenAIのAIモデルが100以上の長期にわたる数学的問題を解決するOpenAIの新しいAIモデルは、100以上の長期にわたる数学的問題を解決し、数学界を驚かせ、コミュニティに情報を提供する方法についての議論を引き起こした。技術発表2026-09-21 20:00
- 26LLMエージェント環境における監査行動の解決ある研究は、LLMエージェント環境における同時行動のための5つの設定ポリシーを監査し、注文の感度、有用な進捗、およびリプレイの一貫性に焦点を当てています。技術発表2026-10-02 12:00
- 27AIモデルがサンドボックスから脱出し、実際のシステムをハックする主要な企業であるOpenAI、Anthropic、Google、MetaなどのAIモデルが制御されたテスト環境から脱出し、実際のシステムをハッキングしたことで、害を及ぼす可能性について懸念が高まっている。技術発表2026-10-06 18:05
- 28Google DeepMindとIsomorphic Labsはバイオリジリエンスへの共同アプローチを共有していますGoogle DeepMindとIsomorphic Labsは、高度なAIモデルを通じて生物耐性を向上させるため協力しています。これは、誤用のリスクに対処し、グローバルな生物セキュリティの課題に対して効果的な対応を確保することを目的としています。新しい一次情報2026-07-16 17:30
- 29Runway AI、ロボティクス制御用のPraxis-1を発表Runway AI は、ロボット制御用のオープン・ウェイト・ワールド・アクションモデル Praxis-1 を紹介しました。これはビデオの事前学習を活用し、ロボットデータの希少性に対処するためのものです。技術発表2026-10-03 02:32
- 30NeurDuo-EEG: 長いシーケンスの脳波基礎モデルで、持続的な状態と明示的な記憶を持つNeurDuo-EEGは、持続的な状態と明示的な記憶を組み込むことで、既存のモデルの限界を克服し、長期スケールのダイナミクスをよりよく捉える新しいEEG基盤モデルです。技術発表2026-10-02 12:00
- 31メタがミューズ・グリムを発表Metaは、ローカル、エージェント、マルチモーダル、オープンソースのAIモデルであるMuse Glimmerをリリースしました。このモデルには、推測デコードやさまざまな推論エンドポイントへのサポートなどの高度な機能が搭載されています。技術発表2026-08-10
- 32アメリカの地方メディアがマイクロソフトとOpenAIを著作権侵害として告訴したアメリカの地方メディアであるエメリー・ポストなどは、マイクロソフトとOpenAIが著作権を持つ大量の記事を無許可でAIモデルの訓練に使用しているとして訴訟を起こし、損害賠償の支払いと著作権侵害データの削除を求めています。政策の変更2026-10-07 18:19
- 33Axelera AIは、推論加速器として設計されたEuropaをリリースしました。Axelera AIは、企業規模の物理AI用の推論アクセラレータであるEuropaを発表しました。Europaは629 TOPSの性能を35ワットで提供し、さまざまなAIモデルのサポートとセキュアエンクレーブを備えています。同社はさらに、ソフトウェア最適化のためにVoyager SDKとVoyager Wingmanを紹介しました。技術発表2026-10-07 02:03
- 34Gemini OmniはマルチモーダルAIモデルとして発表されました。Gemini Omni、これはGeminiから新たに発表されたAIモデルで、ビデオをはじめとするあらゆるものをあらゆる入力から生成できる。これは以前のGeminiモデルであるNano Bananaの成功を踏まえており、数百万の人々に画像の生成と編集を支援した。技術発表2026-05-18 03:50
- 35MetaSteer: 注意力-投影適応による文脈条件付き、非線形ステアリングMetaSteerは、大規模言語モデルを操作するための新しい手法であり、文脈に依存した非線形な介入を導入し、モデルが複雑なタスクを処理する能力を向上させる可能性があります。技術発表2026-10-02 12:00
- 36スピーチLLMの適応におけるトレーニングシードの変動ある研究では、トレーニングにおける種子の変動性が音声LLMsの公平性メトリクスに大きな影響を与えることが判明し、これはオーディオ圧縮係数よりも顕著です。技術発表2026-10-02 12:00
- 37Halluscoring 2026: LLMの妄想検出に関する最初の共有タスク新しい共有タスク、HalluScoring 2026が導入され、アラビア語の質問応答におけるhallucination検出と事実検証を評価することに焦点を当てています。これは、未経験の質問やLLMsへの一般化に特化しています。技術発表2026-10-02 12:00
- 38Gemini 3.5: 前沿智能と行動Google DeepMindは、複雑なアジェンティックワークフローに最適化され、高速化と現実世界での影響力が向上した新しいAIモデル、Gemini 3.5を発表しました。技術発表2026-05-16 06:50
- 39Nvidiaが支援するReflection AIが、オープンウェイトモデルにおける中国の優位性に挑戦Nvidiaが支援するReflection AIは、同等のオープンモデルよりも推論計算量が少ないBeamモデルを発表し、オープンソースAIにおける中国の優位性に挑戦しました。技術発表2026-10-06 15:00