タグ

githubとDuckDBに関するmkusakaのブックマーク (2)

  • DuckDB as a Pipeline: Findyデータ基盤におけるDuckDBの活用事例 - Findy Tech Blog

    この記事は「ファインディエンジニア #1 Advent Calendar 2025」の24日目の記事です。 沢山のアドベントカレンダー記事が執筆されていますので、年末のお供に是非読んでみてください。 adventar.org はじめに ソフトウェアエンジニアの土屋(@shunsock)です。私の所属するデータソリューションチームでは、ファインディ全体のデータ活用を推進するためのデータ基盤を構築しています。 今回、我々はデータ基盤のRDSとBigQueryのテーブル同期システム (EL Pipeline) のリプレースを行い、DuckDB番導入しました。稿では、活用に至った経緯と実際に組みこむにあたる課題、および成果を紹介します。 はじめに ファインディにおけるテーブル同期システムの立ち位置 リプレイスの背景 補足 技術選定 Datastream DuckDB Datastream,

    DuckDB as a Pipeline: Findyデータ基盤におけるDuckDBの活用事例 - Findy Tech Blog
    mkusaka
    mkusaka 2025/12/30
    DuckDB導入でRDS‑BigQuery同期を刷新、1テーブル約30秒→10秒に短縮し、GitHub Actionsで自動化した実装例
  • DuckDB as the New jq

    Recently, I’ve been interested in the DuckDB project (like a SQLite geared towards data applications). And one of the amazing features is that it has many data importers included without requiring extra dependencies. This means it can natively read and parse JSON as a database table, among many other formats. I work extensively with JSON day to day, and I often reach for jq when exploring document

    mkusaka
    mkusaka 2024/09/23
    DuckDBでJSONをテーブルとして読み込み、SQLの->>でネストJSON集計しjq的に活用する例と出力方法を紹介。
  • 1