InfoQ ホームページ 大規模言語モデル に関するすべてのコンテンツ
-
NVIDIAがIsingオープンモデルを発表、量子コンピューティング向け
NVIDIAは、量子プロセッサのキャリブレーションと量子誤り訂正に対処するために設計されたNVIDIA Isingと呼ばれる新オープンモデルファミリーを発表した。これらは量子ビットのノイズと不安定性が計算の信頼性を低下させている、現在の量子システムのスケーラビリティを制限する主要なエンジニアリング上の主要な二つの課題である。Isingモデルは機械学習を用いてこのプロセスの一部を自動化し、より高速なキャリブレーションサイクルと、実行中の量子誤りのより効率的なデコードを実現することを目的としている。
-
Claude Codeオートモードの内側:人間承認ゲートを備えたAnthropicの自律コーディングシステム
AnthropicはClaude Codeにオートモードを導入し、人的介入を削減しつつマルチステップ・ソフトウェア開発タスクを実行可能にした。開発者が目標を定義すると、システムがコード生成・実行・ツール利用・反復的なリファインメントを担い、センシティブな操作については選択したチェックポイントで人間による承認が求められる。
-
23年間潜伏していたリモート悪用可能なLinuxカーネル脆弱性の発見にClaude Codeが使われた
Anthropicのリサーチ・サイエンティストNicholas Carlini氏は、[un]prompted AIセキュリティカンファレンスで、2003年以降存在していたNFSドライバのヒープバッファオーバーフローを含む、Linuxカーネルに存在するリモートから悪用可能な複数のセキュリティ脆弱性を、Claude Codeを使用して発見したと報告した。このバグはその後パッチ適用済であり、Carlini氏はこれまでのところ合計5件のLinuxカーネル脆弱性を特定済で、さらに人手による検証を待つ数百件の潜在的なクラッシュが残っている。
-
Anthropicの論文がLLMでの感情様メカニズムの行動影響を検証
Anthropicの最新論文は大規模言語モデルが感情に関連する概念をどのように内部表現しているか、そしてそれらの表現がどのように行動に影響するかを検証している。本研究は同社の解釈可能性研究の一部であり、Claude Sonnet 4.5の内部活性化を解析することでモデル応答の背後にあるメカニズムを深く理解することにフォーカスしている。
-
Cloudflare社、AIエージェント向けにトークン使用量を最適化するCode Mode対応MCPサーバーを発表
Cloudflare社は、、AIエージェントが複雑なAPIへアクセスする手法を大きく進化させるCode Modeを活用した新たなModel Context Protocol(MCP)サーバーを発表した。これにより、同社のフルAPIプラットフォームとの連携コストを大幅に削減できる。今回のアプローチは、MCPエコシステムにおけるエージェントとツールの統合手法に新たな方向性を示した。
-
AnthropicがエージェントベースCode Reviewを導入、Claude Code向け
AnthropicがClaude Code用の新Code Review機能を発表、複数AIレビュアーを用いてコード変更を解析するエージェントベースのプルリクエストレビューシステムが追加されている。本機能は、チームおよびエンタープライズユーザー向けにリサーチプレビューとして提供されている。
-
AnthropicがManaged Agentsを発表、AIエージェントのデプロイをシンプルに
Anthropicは同社のClaudeプラットフォーム上にManaged Agents、エージェントベース・ワークフロー開発と運用を支援するために設計されたマネージド実行レイヤーを導入した。本機能により開発者はエージェントの振る舞い、ツール、制約を定義できる一方で、オーケストレーション、サンドボックス化、セッション状態管理、認証情報管理、永続化といった実行時責任をプラットフォームに委譲できる。
-
OpenAIがResponses APIを拡張、自律型エージェント基盤として
OpenAIはShellツールのサポート、組み込みエージェント実行ループ、ホスト型コンテナワークスペース、コンテキスト圧縮、再利用可能エージェントスキルを追加し、開発者がエージェント型ワークフローをより容易に構築できるようResponses APIを拡張すると発表した。
-
Dropbox社、企業向け知識検索のためのスケーラブルなコンテキストエンジンを構築
Dropbox社のエンジニアは、Dropbox Dashの背後にあるコンテキストエンジンをどのように構築したかを詳述した。そこでは、インデックスベースの検索、ナレッジグラフ由来のコンテキスト、そして継続的評価への移行が示され、企業向けAI知識検索を大規模に支える仕組みが明らかになった。この設計は、企業向けアシスタント全体に広がりつつある傾向を示している。すなわち、チームはライブでのツール利用を意図的に制約し、事前処理され権限を考慮したコンテキストにより強く依存することで、レイテンシを短縮し、品質を向上させ、トークン消費の圧力を軽減しているのである。
-
AWSがStrands Labsを発表、実験的AIエージェントプロジェクト向け
Amazon Web ServicesはStrands Labs、エージェントベースAI開発に関連する実験的プロジェクトをホストするために作られた新GitHub組織を発表した。本取り組みはStrands Agents SDK、開発者がPythonまたはTypeScriptを使用してAIエージェントを構築できるオープンソースツールキットにリンクしている。
-
GoogleがGemini CLI Conductorに自動レビュー機能を追加
GoogleはGemini CLIエクステンション、Conductorに自動レビューサポートを追加することにより拡張した。同社によればこのアップデートによりConductorは「単なる計画と実行を超えて検証へと進む」ことが可能となり、AI生成コードの品質やガイドライン遵守を確認可能になることで、AI支援開発ワークフローにおける信頼性、安全性、統制を強化する。
-
Googleの8つの基本的マルチエージェント設計パターン
Googleは最近、シーケンシャルパイプラインからhuman-in-the-loopアーキテクチャまで網羅するマルチエージェントシステム向けの8つの重要なデザインパターンを概説するガイドを公開した。このガイドはGoogleのAgent Development Kit向けのサンプルコードとともに各パターンについて具体的に解説している。
-
NVIDIAがAI・ロボティクス・自動運転に跨るオープンモデル・データセット・ツールを公開
NVIDIAが言語、エージェント型AI、ロボティクス、自動運転、バイオメディカル研究を対象としたオープンモデル、データセット、開発ツール群を公開した。今回のアップデートでは既存のNVIDIAモデルファミリーが拡張され、関連する学習データとリファレンス実装がGitHub、Hugging Face、NVIDIAの開発者向けプラットフォームを通じて提供される。
-
オープンソースのAgent Sandbox、Kubernetes上でAIエージェントの安全な展開を可能に
Agent Sandboxは、安定したアイデンティティと永続ストレージを備えた単一のステートフルPodを管理するための宣言的APIを提供する、オープンソースのKubernetesコントローラーである。信頼できないLLM生成コードを実行するための隔離環境の構築に特に適しており、他のステートフルワークロードの実行にも向いている。
-
OpenAIがFrontierを発表、企業全体でAI エージェントを構築・デプロイ・管理するプラットフォーム
OpenAI Frontierは、AIエージェントを構築、展開、管理するためのエンタープライズ向けプラットフォームであり、AIエージェントを信頼性高く、スケーラブルで、実際の企業システムや業務フローに統合できるよう設計されている。