InfoQ ホームページ Infrastructure に関するすべてのコンテンツ
-
Cloudflare社は、決定論的実行と同時に5万件のワークフローを並行実行できるWorkflows V2を発表
Cloudflare社は、同社の開発者プラットフォーム上で分散アプリケーション向けの状態を保持する複数ステップのワークフローを統合管理するための、更新された実行モデルであるWorkflows V2を導入した。本リリースは、決定論的でリプレイ可能なワークフローアーキテクチャを導入しつつ、これらの分散実行ワークロードにおける信頼性、スケーラビリティ、可観測性の向上に重点を置くものだ。
-
Airbnb、プライバシーを最優先とするソーシャル機能を支援するため、コンテキスト認識型IDモデルを導入
Airbnbは、「エクスペリエンス」における新たなソーシャル機能をサポートすると同時に、プラットフォーム全体でより強固なプライバシー境界を確立するため、再設計されたIDおよび接続モデルを導入した。同社は、内部のユーザーIDと外部に公開されるプロフィールを分離するシステムについて説明しており、これによりユーザーは、グローバルなID情報を公開することなく、共有アクティビティ内で交流できるようになる。 この変更は、参加者が互いに面識がない場合もある「エクスペリエンス」におけるソーシャルな交流を拡大するというAirbnbの広範な取り組みに沿ったものであり、アイデンティティの開示を管理し、より強力なプライバシー保証が必要とされている。
-
AWSが新Amazon EKS Capabilitiesを発表、ワークロードオーケストレーションをシンプル化
Amazon Web ServicesはAmazon EKS Capabilities、ワークロードオーケストレーションや、AWSクラウドリソース管理、Kubernetesリソースの構成および自動化を簡素化するために設計された、完全マネージドかつKubernetesネイティブな機能群をリリースした。これらの機能は現在、AWSのほとんどの商用リージョンで一般提供されており、ポピュラーなオープンソースツールをマネージド・プラットフォームレイヤーにバンドルすることでエンジニアリングチームの運用負荷を軽減し、Amazon Elastic Kubernetes Service(EKS)上でのアプリケーションのデプロイおよびスケーリングを高速化する。
-
Dropbox社がGitHub社と協力し、モノレポのサイズを87GBから20GBに削減
モノレポが拡大するにつれて、技術チームの人は1時間以上かかる場合があるクローン操作の遅延を経験し始め、さらに繰り返されるフェッチおよびビルドのオーバーヘッドによりCIパイプラインの性能低下も発生。拡大はまた、リポジトリホスティングの上限に到達するリスクを増加させた。Dropbox社の技術調査によると、問題は主として大容量のバイナリや誤って行われたコミットによるものではなく、Gitの内部圧縮ヒューリスティクスが関連する大規模なファイル群をどのように扱うかに起因するものであると明らかになった。
-
NVIDIAがIsingオープンモデルを発表、量子コンピューティング向け
NVIDIAは、量子プロセッサのキャリブレーションと量子誤り訂正に対処するために設計されたNVIDIA Isingと呼ばれる新オープンモデルファミリーを発表した。これらは量子ビットのノイズと不安定性が計算の信頼性を低下させている、現在の量子システムのスケーラビリティを制限する主要なエンジニアリング上の主要な二つの課題である。Isingモデルは機械学習を用いてこのプロセスの一部を自動化し、より高速なキャリブレーションサイクルと、実行中の量子誤りのより効率的なデコードを実現することを目的としている。
-
Anthropicが3エージェント・ハーネスを設計、長時間稼働するフルスタックAI開発を支援
Anthropicは長時間にわたる自律的アプリケーション開発を支援するためのマルチエージェント・ハーネス設計を導入した。フロントエンド設計およびフルスタックソフトウェア開発の両方をターゲットとしている。このアプローチはプランニング、生成、評価を担う別個のエージェントにタスクを分割し、数時間に及ぶAIセッションにおいて一貫性を維持しつつ出力品質を向��させることを目的としている。
-
Claude Codeオートモードの内側:人間承認ゲートを備えたAnthropicの自律コーディングシステム
AnthropicはClaude Codeにオートモードを導入し、人的介入を削減しつつマルチステップ・ソフトウェア開発タスクを実行可能にした。開発者が目標を定義すると、システムがコード生成・実行・ツール利用・反復的なリファインメントを担い、センシティブな操作については選択したチェックポイントで人間による承認が求められる。
-
Cloudflare社、AIエージェント向けにトークン使用量を最適化するCode Mode対応MCPサーバーを発表
Cloudflare社は、、AIエージェントが複雑なAPIへアクセスする手法を大きく進化させるCode Modeを活用した新たなModel Context Protocol(MCP)サーバーを発表した。これにより、同社のフルAPIプラットフォームとの連携コストを大幅に削減できる。今回のアプローチは、MCPエコシステムにおけるエージェントとツールの統合手法に新たな方向性を示した。
-
Google Cloudは、130,000ノードのGKEクラスターを用いてKubernetesの大規模スケールを実証
Google Kubernetes Engine(GKE)のチームは、130,000ノードのKubernetesクラスターを成功裏に構築・運用したことを明らかにした。これにより、現在までに公表された中で最大のKubernetesクラスターとなった。このマイルストーンは、クラウドネイティブインフラストラクチャがどれほど進化したか、またAIやデータの時代における大規模で計算集約的なワークロードに対する準備が整っていることを示している。
-
OpenAIがFrontierを発表、企業全体でAI エージェントを構築・デプロイ・管理するプラットフォーム
OpenAI Frontierは、AIエージェントを構築、展開、管理するためのエンタープライズ向けプラットフォームであり、AIエージェントを信頼性高く、スケーラブルで、実際の企業システムや業務フローに統合できるよう設計されている。
-
NVIDIA社のDynamoが、マルチノードLLM推論の課題に対応
大規模な言語モデル(LLM)をスケールで提供することは複雑である。現代のLLMは、単一のGPUや単一のマルチGPUノードのメモリおよび計算能力を超えている。そのため、70B以上や120B以上のパラメータモデル、または大きなコンテキストウィンドウを持つパイプラインの推論ワークロードは、マルチノードの分散GPU展開を必要とする。
-
AWS、管理型エグレスセキュリティ簡素化へ 「Network Firewall proxy」をプレビュー公開
AWS社はこのほど、プロキシの管理と展開を担うマネージドサービス「AWS Network Firewall proxy」のプレビュー版を開始した。AWS社によると、このサービスは、顧客が自社のVPCからのアウトバウンドアクセスを統制するセキュリティポリシーに、より注力できるようにするものだ。
-
AWSが第5世代AMD EPYC(Turin)プロセッサ搭載M8a汎用EC2インスタンスを発表
AWSは最近、最大4.5GHzの5世代目AMD EPYC(コードネーム:Turin)プロセッサ、ゲーム、金融アプリケーション、機械学習の推論、動画エンコード、アプリケーションサーバー、シミュレーションモデリング、中規模データストア、アプリケーション開発環境、キャッシュフリートのような高性能と高スループットを必要とするアプリケーションに適している、を搭載したM8a汎用インスタンスの一般提供(GA)を発表した。
-
AWS ALBがネイティブURLとホストヘッダー書き換えをサポート
AWSは最近、Application Load Balancers(ALB)サービス内でネイティブURLおよびホストヘッダー書き換え機能の一般提供を発表した。この機能によりユーザーは、レイヤー7トラフィック変更を管理するためのカスタムアプリケーションロジックや、サードパーティ・プロキシソリューション(NGINX Ingress Controllerのような)を導入・維持する必要がなくなる。
-
AnthropicがClaudeパフォーマンス問題の背後にある3つのインフラストラクチャバグを公開
Anthropicは最近、Claudeモデルの出力品質が数週間にわたり断続的に低下していた原因について、3つの異なるインフラストラクチャのバグが関与していたことを明らかにするポストモーテムを公開した。同社はこれらの問題を解決し、同様の障害を防ぐために内部プロセスを変更していると述べているが、コミュニティは3つのハードウェアプラットフォームでサービス運用することの課題をハイライトしている。