InfoQ ホームページ データベース に関するすべてのコンテンツ
-
Airbnb、プライバシーを最優先とするソーシャル機能を支援するため、コンテキスト認識型IDモデルを導入
Airbnbは、「エクスペリエンス」における新たなソーシャル機能をサポートすると同時に、プラットフォーム全体でより強固なプライバシー境界を確立するため、再設計されたIDおよび接続モデルを導入した。同社は、内部のユーザーIDと外部に公開されるプロフィールを分離するシステムについて説明しており、これによりユーザーは、グローバルなID情報を公開することなく、共有アクティビティ内で交流できるようになる。 この変更は、参加者が互いに面識がない場合もある「エクスペリエンス」におけるソーシャルな交流を拡大するというAirbnbの広範な取り組みに沿ったものであり、アイデンティティの開示を管理し、より強力なプライバシー保証が必要とされている。
-
Google Cloud、BigQueryでクロスエンジン対応のIcebergサポートを導入
Google社は先月開催されたApache Iceberg Summitで、BigQueryにおけるApache Icebergの新たな相互運用機能を発表した。サーバーレスのIceberg RESTカタログのプレビュー機能により、チームはデータを重複させることなく、BigQueryとSpark、Flink、Trinoといったエンジン間で同一のApache Icebergテーブルを作成・更新・クエリ実行をできるようになる。
-
DuckDB、HTTPベースのクライアント/サーバープロトコル「Quack」を発表 マルチユーザー分析に対応
DuckDBは、HTTPベースの新たなリモートプロトコル「Quack」を発表した。これにより、複数のDuckDBインスタンスがネットワーク越しに同一のデータベースへ接続し、共同で処理を行えるようになる。このプロトコルにより、これまで主にローカルかつ組み込み型として利用されてきたDuckDBに、クライアント/サーバー型の機能が加わる。
-
TigerFSは開発者およびAIエージェント向けにPostgreSQLデータベースをファイルシステムとしてマウントする機能を提供
TigerFSは、データベースをディレクトリとしてマウントし、ファイルをPostgreSQLに直接保存する新たな実験的ファイルシステムだ。オープンソースの同プロジェクトは、標準的なファイルシステムインターフェースを通じてデータベースのデータを公開し、開発側およびAIエージェントが、APIやSDKを介するのではなく、ls、cat、find、grepといった一般的なUnixツールを用いてそれとやり取りできるようにする。
-
MySQL 9.6で外部キー制約とカスケード処理が変更
MySQL社は、外部キー制約とカスケードの管理方法を変更する方針である。MySQL 9.6から、外部キーの検証およびカスケード動作は、InnoDBストレージエンジンではなく、SQLレイヤーによって処理されるようになった。この変更により、変更履歴の追跡精度、レプリケーションの正確性、データの整合性が向上するため、MySQL社によると、CDCパイプラインや混合データベース環境、アナリティクス用途での信頼性が高まると明らかになった。
-
DoorDash社、32Mラベルでセマンティック検索のための画像・テキスト・クエリを整列するDashCLIPを構築
DoorDash社は、製品画像、テキスト説明、ユーザークエリを共有表現空間で整列させることによりセマンティック埋め込みを生成するマルチモーダル機械学習システムDashCLIPを発表した。同アーキテクチャは、同社の消費財(CPG)マーケットプレイス全体における商品発見、ランキング、広告関連性の向上を目的とする。システムの学習には、検索クエリと関連カタログ商品を整列させるため、約3,200万件のラベル付きクエリ・商品ペアを用いた。
-
Dropbox社、企業向け知識検索のためのスケーラブルなコンテキストエンジンを構築
Dropbox社のエンジニアは、Dropbox Dashの背後にあるコンテキストエンジンをどのように構築したかを詳述した。そこでは、インデックスベースの検索、ナレッジグラフ由来のコンテキスト、そして継続的評価への移行が示され、企業向けAI知識検索を大規模に支える仕組みが明らかになった。この設計は、企業向けアシスタント全体に広がりつつある傾向を示している。すなわち、チームはライブでのツール利用を意図的に制約し、事前処理され権限を考慮したコンテキストにより強く依存することで、レイテンシを短縮し、品質を向上させ、トークン消費の圧力を軽減しているのである。
-
DuckDB社のWebAssemblyクライアント、ブラウザ上でIcebergデータセットへのクエリが可能に
DuckDB社はこのほど、ブラウザのタブ内で直接Iceberg RESTカタログとのエンドツーエンドのインタラクションを実現する新機能を発表した。インフラのセットアップは一切不要である。この新機能はDuckDB-Wasmを活用したものであり、DuckDB-Wasmはブラウザ上で動作するDuckDBのWebAssemblyポートである。これにより、ユーザーはサーバーレス方式でIcebergテーブルへのクエリ、読み取り、および書き込みが可能になった。
-
Agentic Postgres:AI対応機能と高速フォークを備えたAgentic Apps向けPostgres
Tiger Data社、TimescaleDBの開発元である同社は、AIエージェントと開発者向けに設計されたPostgresベースのデータベース、Agentic Postgresを発表した。Agentic Postgresは、Postgresを拡張し、高速フォーク、MCPサーバー、ネイティブBM25およびベクトル検索を提供し、ターミナルアクセス用のCLIを含む。
-
Bun、組み込みデータベースクライアントとゼロ設定フロントエンド開発を発表
高速なオールインワンJavaScriptランタイム「Bun」はバージョン1.3を公開した。フルスタック開発機能の追加、データベースAPIの統合、ランタイム全体にわたる性能向上を盛り込んだ、これまでで最大規模のリリースとなった。
-
Amazon S3 VectorsがGAに、「Storage-First」アーキテクチャをRAGに導入
AWSは最近、ベクトルデータの保存およびクエリをネイティブサポートするクラウドオブジェクトストレージサービス、S3 Vectorsの一般提供を発表した。GAリリースにより、同社はインデックスあたりの容量を40倍に拡張、20億ベクトルまで対応するとともに、100ms未満のクエリレイテンシを実現した。
-
Uberのクエリアーキテクチャ:レイヤーの簡素化とオブザーバビリティの向上
Uber社は、Apache Pinotのクエリアーキテクチャを再設計し、実行の簡素化、より豊かなSQLのサポート、内部分析ワークロードの予測可能性の向上を図った。従来のNeutrinoシステムは、PrestoとPinotを重ねたものであったが、軽量なプロキシ「Cellar」に置き換えられ、Pinotのマルチステージエンジンライトモードを使用することになった。この再設計は、複雑さを軽減し、実行制限を強化し、複数のテナントに対するより強固な隔離を提供することを目的としている。
-
Memori、AIエージェント向けのSQLとMongoDBを活用したフルスケールのメモリレイヤーへ拡張
Memoriは、AIエージェントに長期的で構造化されたクエリ可能なメモリを提供するために設計された、フル機能を備えたオープンソースのメモリシステムへと成熟した。これにより、従来のプロプライエタリなベクトルストアではなく、標準的なデータベースを使用できる。Memoriは、アドホックなプロンプトや一時的なセッション状態に依存する代わりに、インタラクションからエンティティ、事実、関係、コンテキストを継続的に抽出し、それらをSQLやMongoDBのバックエンドに保存する。それにより、エージェントは手動でのオーケストレーションを行うことなく、セッションをまたいで情報を記憶し再利用が可能だ。
-
Cloudflare、データプラットフォームをエグレス料金ゼロで導入
Cloudflareは最近、Cloudflare Data Platformのオープンベータ版を発表した。これは、Apache Icebergなどのオープンスタンダードを使用して、分析データテーブルを取り込み、保存し、クエリを実行するためのマネージドソリューションである。
-
Atlassianの400万PostgreSQLデータベース移行:標準的なクラウド戦略が失敗する時
Atlassianは最近、400万のJiraデータベースをAmazon Auroraに移行し、コスト削減とJira Cloudプラットフォームの信頼性向上を目指した。多くのファイルが関与し、マネージドサービスの制約があるため、チームは従来のクラウド移行戦略が実行不可能であったため、プロセスを調整するカスタムツールを開発した。