InfoQ ホームページ 大規模言語モデル に関するすべてのコンテンツ
-
GoogleのAletheiaが完全自律型AIエージェンティック数学研究の最先端を突き進む
GoogleはAletheia、Gemini 3 Deep Thinkを用い、FirstProofチャレンジで未発表の数学問題10問中6問を解いたAIを発表した。AletheiaはIMO-ProofBenchで約91.9%を記録し、人的介入なしの研究レベル証明の自動発見において重要な転換点を示した。
-
Anthropic解説、Claudeが自身の実行ハーネスを構築する仕組み
Anthropicは、Claude Codeに最近導入されたダイナミック・ワークフローの背後にあるオーケストレーションシステムについて追加の詳細情報を公開、この機能が複雑なタスクに対してAIエージェントのチームをコーディネートするよう設計されたカスタム実行ハーネスをどのように生成するかをハイライトした。
-
AnthropicのCode with ClaudeがManaged Agents、プロアクティブワークフロー、ケイパビリティカーブを発表
2026年5月6日にサンフランシスコでAnthropicはCode with Claude 2026を開催し、Claude Code、Claudeデベロッパープラットフォーム、ならびにGitHub、Vercel、Datadog、Bun、複数のAIネイティブスタートアップでのパートナー展開にわたるシッピングワークをカバーしたライブストリームセッションをYouTubeで公開した。終日を貫く共通テーマはモデルの段階的な進化がプロダクトアーキテクチャ、組織設計、インフラストラクチャ・エコノミクスに与える影響だった。
-
AnthropicがClaude Code品質苦情の6週間を3つのプロダクト変更の重なりと特定
AnthropicはClaude Codeの品質に関するユーザー苦情の6週間を説明するエンジニアリング・ポストモーテムを公開した。
-
GoogleがGemma4をApache 2.0ライセンスでリリース、マルチモーダルおよびエージェント機能搭載
Googleは最近、Gemma 4をリリースした。実効2Bおよび4Bのエッジバリアント、26BのMixture-of-Expertsモデル、31B denseモデルで構成されるオープンウェイトモデルのファミリーで、いずれもApache 2.0ライセンスのもとで配布されている。今回のリリースではラインナップ全体にわたるネイティブな動画・画像処理、小型モデルでの音声入力、最大256Kトークンのコンテキストウィンドウが導入されており、31B denseバリアントのベンチマーク結果は通常その3〜5倍のサイズのモデルが占める水準に位置している。
-
AnthropicがClaude Platformを提供開始、AWS上で
AnthropicはClaude Platform on AWS、AWS顧客がAWSの認証、課金、監視サービスを使用してAnthropicのネイティブClaude Platformへ直接アクセスできるようにする新しいデプロイオプションの一般提供を発表した。今回のリリースにより、顧客はAWS IAM認証情報を通じてアクセスを管理し、利用状況を既存のAWSの請求およびコミットメントに集約しながらClaude Platform機能を利用できる。
-
AnthropicがMCPトンネルを導入、内部システムへのプライベート・エージェントアクセスのため
AnthropicはClaude Managed Agentsプラットフォームを拡張し、二つのエンタープライズ向け機能:セルフホスト型サンドボックスとMCPトンネルを追加した。このリリースはエンタープライズへのAIデプロイにおける繰り返し生じる、組織が自律型エージェントを活用したいものの実行環境や内部システムをセキュリティ境界の外に出せないという課題に対処することを目的としている。
-
Claude CodeがDynamic Workflowsを追加、並列エージェント連携のため
AnthropicはDynamic Workflows、単一ワークフロー内で多数のAIエージェントを連携させることで、複雑なソフトウェアエンジニアリング・タスクを処理するために設計されたClaude Code向けの新機能を発表した。リサーチプレビューとして提供されるこの機能によりClaudeはオーケストレーションスクリプトを動的に作成し、作業をサブタスクに分割し、それらを並列実行し、最終的な回答を提示する前に結果を検証する。
-
AnthropicがRoutinesを導入、Claude Code自動化のため
AnthropicはClaude Code向けのRoutinesと呼ばれる新機能を導入、開発者がスケジュール起動、API呼び出しを通して、または外部イベントへのレスポンスの中で実行される自動化コーディングワークフローを構成できるようにした。この機能はClaude Codeのクラウドインフラ上で動作し、開発者がローカルでcronジョブ、サーバー、または自動化パイプラインを保守する必要をなくする。
-
NVIDIAがIsingオープンモデルを発表、量子コンピューティング向け
NVIDIAは、量子プロセッサのキャリブレーションと量子誤り訂正に対処するために設計されたNVIDIA Isingと呼ばれる新オープンモデルファミリーを発表した。これらは量子ビットのノイズと不安定性が計算の信頼性を低下させている、現在の量子システムのスケーラビリティを制限する主要なエンジニアリング上の主要な二つの課題である。Isingモデルは機械学習を用いてこのプロセスの一部を自動化し、より高速なキャリブレーションサイクルと、実行中の量子誤りのより効率的なデコードを実現することを目的としている。
-
Claude Codeオートモードの内側:人間承認ゲートを備えたAnthropicの自律コーディングシステム
AnthropicはClaude Codeにオートモードを導入し、人的介入を削減しつつマルチステップ・ソフトウェア開発タスクを実行可能にした。開発者が目標を定義すると、システムがコード生成・実行・ツール利用・反復的なリファインメントを担い、センシティブな操作については選択したチェックポイントで人間による承認が求められる。
-
23年間潜伏していたリモート悪用可能なLinuxカーネル脆弱性の発見にClaude Codeが使われた
Anthropicのリサーチ・サイエンティストNicholas Carlini氏は、[un]prompted AIセキュリティカンファレンスで、2003年以降存在していたNFSドライバのヒープバッファオーバーフローを含む、Linuxカーネルに存在するリモートから悪用可能な複数のセキュリティ脆弱性を、Claude Codeを使用して発見したと報告した。このバグはその後パッチ適用済であり、Carlini氏はこれまでのところ合計5件のLinuxカーネル脆弱性を特定済で、さらに人手による検証を待つ数百件の潜在的なクラッシュが残っている。
-
Anthropicの論文がLLMでの感情様メカニズムの行動影響を検証
Anthropicの最新論文は大規模言語モデルが感情に関連する概念をどのように内部表現しているか、そしてそれらの表現がどのように行動に影響するかを検証している。本研究は同社の解釈可能性研究の一部であり、Claude Sonnet 4.5の内部活性化を解析することでモデル応答の背後にあるメカニズムを深く理解することにフォーカスしている。
-
Cloudflare社、AIエージェント向けにトークン使用量を最適化するCode Mode対応MCPサーバーを発表
Cloudflare社は、、AIエージェントが複雑なAPIへアクセスする手法を大きく進化させるCode Modeを活用した新たなModel Context Protocol(MCP)サーバーを発表した。これにより、同社のフルAPIプラットフォームとの連携コストを大幅に削減できる。今回のアプローチは、MCPエコシステムにおけるエージェントとツールの統合手法に新たな方向性を示した。
-
AnthropicがエージェントベースCode Reviewを導入、Claude Code向け
AnthropicがClaude Code用の新Code Review機能を発表、複数AIレビュアーを用いてコード変更を解析するエージェントベースのプルリクエストレビューシステムが追加されている。本機能は、チームおよびエンタープライズユーザー向けにリサーチプレビューとして提供されている。