<仕事概要>
◆データ基盤のモダナイズ
当社のデータ基盤の構築・運用やデータ基盤・データ利活用環境を最新テクノロジーを利用した構造へと変革するモダナイゼーションなどを目的とした上流工程から、プログラミングやクラウドインフラ構築などの開発工程も行う内製主体のデータエンジニアリング業務を行います。
◆ビジネスサイドへのデータの活用・分析環境の提供
サービスサイトのデータやERPなどの社内基幹システムのデータを掛け合わせ、BIツールやダッシュボードなどをビジネスサイドへ提供します。
そのためにビジネスサイドとの要求分析・要件定義から始まり、データ連携の設計、データ加工パイプラインの設計、開発、テスト、運用などデータライフサイクル全体に直接かかわる業務を担当頂きます。
<業務詳細>
現在、当社社内にはいくつかのデータ基盤が存在しており、それぞれが個々に運用されている状態です。このような状態のため、横断的なデータ活用への障壁になっている状態です。
これらを1カ所のデータ基盤に統合することで、データガバナンスの向上やデータマネジメントの効率化を行っていきたいと考えています。
まずは、いくつかあるデータ基盤のうち、オンプレミスで稼働中のデータ基盤を対象に、Snowflakeとdbtを使ったクラウドデータウェアハウスに作り替えることを内製で構築検証をしています。このようなSnowflakeとdbtを用いたデータ基盤へ作り替える開発業務に携わっていただきます。
また、今後は以下のようなことも構想しています。
・他のデータ基盤とのデータ統合を進める
・現状のデータ基盤に関する定常作業を削減・低減できるような方法に刷新し、運用負荷を減らす(自動化やCI/CD/IaC化など)
・dbtやOpenMetadataなどを用いたデータカタログの充実化
・Python等を用いてデータ基盤のデータを観察・分析することで、
システム部門発信でのデータ利活用やデータシステムを当社のビジネスサイドへ提案・提供する
・その他、データ利活用が促進できるような様々な施策
上記のように新しく拡大していくような業務もありますが、それ以外にデータ基盤の定常運用作業もあります。このような定常運用業務をいかに自動化などの工夫をしながら効率化し、クリエイティブな仕事の比率を上げていけるかという点にも重点を置いています。
■プログラミング言語・開発環境
・Python
・SQL(dbt & Snowflake)
・Git/Github
・Terraform
・Docker
・AWS (今後の状況により、EC2/S3/MWAA/Fargate/Batch/App Runner/ECSなどを利用する可能性が高いです)