デイリー速報
2026-09-17 · 朝刊 · 11 本
-
Jetson AGX Thor が 27B モデルを単体で MLPerf 推論完走
1 台で 52.33 tokens/s、1007 ラウンドを 24 分 36 秒で完走し llama.cpp を上回った。NVIDIA Technical Blog:Agentic AI / Generative AI
-
Gemini Enterprise、Agent 異常検出のプライベートプレビューを開始
独立した推論層がエージェントのツール呼び出しと実行を非同期に監査し、要求遅延はゼロ。Google Developers Blog(RSS)
-
OpenAI、モデル未アラインメントの追跡・開示フレームワークと過去 6 件の報告書を公開
未解明・未緩和の挙動も規定のタイムラインで開示し、新たな機構を示す事例を優先する。X:OpenAI (@OpenAI)
-
AnthropicとOpenAI、常駐の第三者安全評価を約束
両社はMETRなど独立評価機関にシステムへのアクセス権を与えることで合意。TechCrunch:AI(RSS)
-
Anthropic、Claude Coworkとチャットを統合し単一のClaudeに
入口を選ぶ必要がなくなり、CoworkとDesignの機能をどの会話でも利用可能。Claude:Blog(网页)
-
SemiAnalysis实测:Rubin NVL72はGB300比7倍の性能/ワット
GTC 2026でJensen氏は3倍と約束したが、実測は公約の2倍以上となった。X:SemiAnalysis (@SemiAnalysis_)
-
Mozilla 91頁レポート:オープンウェイトモデルは最前線から約4か月遅れ
オープンウェイトは呼び出し20%を担うが収益は約4%のみ、クローズドは1回料金が約6倍。X:Rohan Paul (@rohanpaul_ai)
-
Xiaomiが大規模言語モデルMiMo-V2.6のRL学習细节を公開、1ステップで2Bトークン処理
1568プロンプト×16ロールアウトの全非同期RLで1ステップ約2Bトークン、投入額100万ドル超。X:Elvis Saravia (@omarsar0, DAIR.AI)
-
Xiaomi、MiMo-V2.6の大規模強化学習訓練の詳細を公開
計算・環境・スコアの3軸でRLを拡張し、毎ステップ約2Bトークンを完全非同期で処理する。X:Nathan Lambert (@natolambert)
-
Grok Buildに記憶機能を追加、セッションを越えて規約と判断を保持
記憶はプロジェクト別ファイルと全体設定に分かれ、当前ターンの指示が保存ノートより優先される。xAI:News(网页)
-
Transluce、埋め込み評価が注視すべき4種類の挙動を提示
マルチエージェント調整・標的説得・評価認識・隠れた推論を高リスクと位置付け、4種の試行手法も同時公開。Transluce(网页)