InfoQ ホームページ データベース に関するすべてのコンテンツ
-
AWS、柔軟なデータワークフローを実現する仕様主導型コンポジションを導入
AWSは、柔軟なデータ変換ワークフローを構築するための仕様主導型コンポジションパターンを提示した。これにより、ワークフローの意図と処理ロジックを分離し、重複したパイプラインコードを削減し、検証とガバナンスを簡素化する。このアプローチでは、構造化された仕様を用いて再利用可能な処理ケイパビリティを動的に組み立て、AWS Lambda、AWS Step Functions、Amazon S3、Amazon OpenSearch Serviceに基づいたサーバーレス実装を採用した。
-
Google Cloud が、データベースのライフサイクル管理を簡素化する AI 搭載エージェントを発表
Google Cloud は、AI を活用した「Database Operations Agents」を発表した。データベースのセットアップを効率化する「Onboarding Agent」と、トラブルシューティングやパフォーマンス最適化、チューニングの自動化を支援する「Observability Agent」が含まれる。これらのエージェントはGemini Cloud Assistと統合されており、AlloyDB、Bigtable、Spannerなど複数のデータベースサービスをサポートする。
-
Microsoft FoundryでClaudeが一般提供開始:欧州企業はデプロイ不可
AnthropicとMicrosoftは、Microsoft FoundryにおけるClaudeモデルの一般提供開始を発表した。これによりAzure顧客は、ネイティブ認証、課金、ガバナンスを通じてClaude Opus 4.8とClaude Haiku 4.5を利用できる。利用料金は既存のMicrosoft Azure Consumption Commitment(MACC)が充当される。 その数日後にはSonnet 5も追加され、8月31日まで入力/出力100万トークン当たり2ドル/10ドルのプロモーション価格で提供される。
-
HubSpot社、セマンティック検索を200億ベクトル規模へ拡張した手法を公開
SaaSベンダーのHubSpot社は、同社のセマンティック検索基盤が概念実証(PoC)から発展し、現在では38以上のチームが利用する社内サービスへ成長した経緯を紹介した。この基盤は、200億件を超えるベクトルを管理している。HubSpot社によると、このシステムは現在、AIエージェントやRAG(検索拡張生成)、コンタクト情報の重複排除などを支えている。また、AIエージェントの利用拡大に伴い、検索精度とレイテンシの重要性はこれまで以上に高まっているという。
-
AWSがAurora Serverless強化、スケールアップ45%高速化、スループット30%向上
AWSは最近、Amazon Aurora Serverlessを新しいプラットフォームバージョンに更新し、スケーリング挙動と実行時効率を改善した。クラウドプロバイダーによると需要急増時のキャパシティスケールアップが約45%高速化し、リソーススケジューリングの最適化とワークロード認識型スケーリング判断により、データベース性能は最大30%向上している。
-
Airbnb、プライバシーを最優先とするソーシャル機能を支援するため、コンテキスト認識型IDモデルを導入
Airbnbは、「エクスペリエンス」における新たなソーシャル機能をサポートすると同時に、プラットフォーム全体でより強固なプライバシー境界を確立するため、再設計されたIDおよび接続モデルを導入した。同社は、内部のユーザーIDと外部に公開されるプロフィールを分離するシステムについて説明しており、これによりユーザーは、グローバルなID情報を公開することなく、共有アクティビティ内で交流できるようになる。 この変更は、参加者が互いに面識がない場合もある「エクスペリエンス」におけるソーシャルな交流を拡大するというAirbnbの広範な取り組みに沿ったものであり、アイデンティティの開示を管理し、より強力なプライバシー保証が必要とされている。
-
Google Cloud、BigQueryでクロスエンジン対応のIcebergサポートを導入
Google社は先月開催されたApache Iceberg Summitで、BigQueryにおけるApache Icebergの新たな相互運用機能を発表した。サーバーレスのIceberg RESTカタログのプレビュー機能により、チームはデータを重複させることなく、BigQueryとSpark、Flink、Trinoといったエンジン間で同一のApache Icebergテーブルを作成・更新・クエリ実行をできるようになる。
-
DuckDB、HTTPベースのクライアント/サーバープロトコル「Quack」を発表 マルチユーザー分析に対応
DuckDBは、HTTPベースの新たなリモートプロトコル「Quack」を発表した。これにより、複数のDuckDBインスタンスがネットワーク越しに同一のデータベースへ接続し、共同で処理を行えるようになる。このプロトコルにより、これまで主にローカルかつ組み込み型として利用されてきたDuckDBに、クライアント/サーバー型の機能が加わる。
-
TigerFSは開発者およびAIエージェント向けにPostgreSQLデータベースをファイルシステムとしてマウントする機能を提供
TigerFSは、データベースをディレクトリとしてマウントし、ファイルをPostgreSQLに直接保存する新たな実験的ファイルシステムだ。オープンソースの同プロジェクトは、標準的なファイルシステムインターフェースを通じてデータベースのデータを公開し、開発側およびAIエージェントが、APIやSDKを介するのではなく、ls、cat、find、grepといった一般的なUnixツールを用いてそれとやり取りできるようにする。
-
MySQL 9.6で外部キー制約とカスケード処理が変更
MySQL社は、外部キー制約とカスケードの管理方法を変更する方針である。MySQL 9.6から、外部キーの検証およびカスケード動作は、InnoDBストレージエンジンではなく、SQLレイヤーによって処理されるようになった。この変更により、変更履歴の追跡精度、レプリケーションの正確性、データの整合性が向上するため、MySQL社によると、CDCパイプラインや混合データベース環境、アナリティクス用途での信頼性が高まると明らかになった。
-
DoorDash社、32Mラベルでセマンティック検索のための画像・テキスト・クエリを整列するDashCLIPを構築
DoorDash社は、製品画像、テキスト説明、ユーザークエリを共有表現空間で整列させることによりセマンティック埋め込みを生成するマルチモーダル機械学習システムDashCLIPを発表した。同アーキテクチャは、同社の消費財(CPG)マーケットプレイス全体における商品発見、ランキング、広告関連性の向上を目的とする。システムの学習には、検索クエリと関連カタログ商品を整列させるため、約3,200万件のラベル付きクエリ・商品ペアを用いた。
-
Dropbox社、企業向け知識検索のためのスケーラブルなコンテキストエンジンを構築
Dropbox社のエンジニアは、Dropbox Dashの背後にあるコンテキストエンジンをどのように構築したかを詳述した。そこでは、インデックスベースの検索、ナレッジグラフ由来のコンテキスト、そして継続的評価への移行が示され、企業向けAI知識検索を大規模に支える仕組みが明らかになった。この設計は、企業向けアシスタント全体に広がりつつある傾向を示している。すなわち、チームはライブでのツール利用を意図的に制約し、事前処理され権限を考慮したコンテキストにより強く依存することで、レイテンシを短縮し、品質を向上させ、トークン消費の圧力を軽減しているのである。
-
DuckDB社のWebAssemblyクライアント、ブラウザ上でIcebergデータセットへのクエリが可能に
DuckDB社はこのほど、ブラウザのタブ内で直接Iceberg RESTカタログとのエンドツーエンドのインタラクションを実現する新機能を発表した。インフラのセットアップは一切不要である。この新機能はDuckDB-Wasmを活用したものであり、DuckDB-Wasmはブラウザ上で動作するDuckDBのWebAssemblyポートである。これにより、ユーザーはサーバーレス方式でIcebergテーブルへのクエリ、読み取り、および書き込みが可能になった。
-
Agentic Postgres:AI対応機能と高速フォークを備えたAgentic Apps向けPostgres
Tiger Data社、TimescaleDBの開発元である同社は、AIエージェントと開発者向けに設計されたPostgresベースのデータベース、Agentic Postgresを発表した。Agentic Postgresは、Postgresを拡張し、高速フォーク、MCPサーバー、ネイティブBM25およびベクトル検索を提供し、ターミナルアクセス用のCLIを含む。
-
Bun、組み込みデータベースクライアントとゼロ設定フロントエンド開発を発表
高速なオールインワンJavaScriptランタイム「Bun」はバージョン1.3を公開した。フルスタック開発機能の追加、データベースAPIの統合、ランタイム全体にわたる性能向上を盛り込んだ、これまでで最大規模のリリースとなった。