- ホーム
- > 和書
- > コンピュータ
- > プログラミング
- > その他スクリプト言語
出版社内容情報
ビッグデータ処理のプラットフォームとして注目されるApache Sparkの総合解説書。開発者に広くアピールする内容。
次世代のビッグデータ処理のプラットフォームとして注目されるApache Sparkの総合解説書!
本書はSparkを初めて使う人から、クラスタ上で本格的な利用をする人までを一通り対象とした総合書籍であり、ビッグデータや機械学習に携わる開発者に広くアピールします
目次
Sparkによるデータ分析への招待
Sparkのダウンロードと起動
RDDを使ったプログラミング
キー/値ペアの処理
データのロードとセーブ
Sparkの高度なプログラミング
クラスタでの動作
Sparkのチューニングとデバッグ
Spark SQL
Spark Streaming〔ほか〕
著者等紹介
カラウ,ホールデン[カラウ,ホールデン] [Karau,Holden]
Alpine Data Labsのソフトウェア開発技術者で、オープンソースソフトウェアに活発に携わっており、初期のSparkの書籍も執筆している。Alpine Data Labs以前には、Databricks、Google、Foursquare、Amazonで検索と分類についての仕事に携わってきた。ワーテルロー大学でコンピュータサイエンスと数字の学士を取得
コンウィンスキ,アンディ[コンウィンスキ,アンディ] [Konwinski,Andy]
Databricksの共同設立者。カリフォルニア大学バークレー校でPhDを取得し、AMPLabで大規模分散コンピューティングとクラスタスケジューリングを研究していた。Apache Mesosプロジェクトの共同創始者であり、コミッタでもある。Googleでは、システムエンジニアや研究者たちと共に、次世代スケジューリングシステムであるOmegaの設計に携わっていた。AMP Camp Big Data BootcampsやSparkサミットを立ち上げ、Sparkプロジェクトに貢献している
ウェンデル,パトリック[ウェンデル,パトリック] [Wendell,Patrick]
Databricksの共同設立者。Sparkのコミッタであり、PMCメンバーでもある。Spark1.0を含む複数のSparkのバージョンのリリースマネージャも務めており、Sparkのコアエンジンの複数のサブシステムのメンテナンスを行っている。カリフォルニア大バークレー校でコンピュータサイエンスのMSを取得後、DataBricksの立ち上げに協力した。研究の中心は、大規模な分析のワークロードにおける低レイテンシのスケジューリング
ザハリア,マテイ[ザハリア,マテイ] [Zaharia,Matei]
Apache Sparkの作者であり、DatabricksのCTO。カリフォルニア大バークレー校でPhDを取得。Sparkは、その際の研究プロジェクトとして誕生した。現在、ApacheでSparkプロジェクトのVice Presidentを務めている。Spark以外にも、Apache HadoopやApache Mesosを含むクラスタコンピューティングの分野の他のプロジェクトにおいて、研究と貢献を行っている。Hadoopのコミッタであり、バークレーでのMesosの立ち上げにも携わった
玉川竜司[タマガワリュウジ]
Sky株式会社。本業はソフトウェア開発。新しい技術を日本の技術者に紹介することに情熱を傾けており、その手段として翻訳に取り組んでいる(本データはこの書籍が刊行された当時に掲載されていたものです)
※書籍に掲載されている著者及び編者、訳者、監修者、イラストレーターなどの紹介情報です。



