Skip to content

DNET_SparkStreaming

nishi_74322014 edited this page Sep 11, 2026 · 1 revision

Spark Streaming

概要

詳細

ストリーム型のデータ並列計算

  • 属性の選択やフィルタ
  • エンリッチメント
  • リアルタイム・ウィンドウ集約処理
    到着時刻に基づき、ウィンドウ・スライディング幅で集約する。

安全なデータソース

※ 出力先は、データ・ストレージ、RDB、NoSQL、ダッシュボード等。

ストリーム系データソース

分散処理の該当節を参照。

データ・ストレージ

  • Hadoop Distributed File System (HDFS)(Hadoopの該当節を参照)
  • Amazon S3などのクラウド・ストレージ・サービス

その他

  • Twitter
  • , etc.

Spark Structured Streaming

  • Spark Streaming (DStreams) は
    Spark Structured Streamingに置き換えられる。

  • 将来的には、

    • Spark Structured Streamingのみ、拡張機能やメンテナンスを受ける。
    • 従って、Spark Streaming (DStreams)はメンテナンス モードのみになる。

参考

移行メモ

  • 「ストリーム型のデータ並列計算」配下の「属性の選択やフィルタ」 「エンリッチメント」は本文の無い見出しだったため、箇条書きにまとめた。

Tags: 移行, Spark Streaming, Apache Spark, ストリーム処理, DStreams, マイクロ・バッチ, ビッグデータ

NetDevInfraWiki

マイクロソフト系技術情報 Wiki
Open 棟梁 Wiki

(未着手)

開発基盤部会 Wiki

移行管理: DONETODO

Clone this wiki locally