ASCII.technologies 2011年1月号に寄稿した「重複排除技術が革新するストレージの世界」を、何本かのエントリに分けて公開させて頂きます。まずは、第一章「重複排除が注目を集める理由」です。第二章の技術解説、第三章の今後の展望に関しては、後日公開する予定です。なお、編集前のテキストを用いていますので、実際の記事と少し差異があります。 [記事序文] 重複排除(Deduplication)という技術を聞いたことがあるだろうか?その名が示すとおり、「データ内に存在するムダな重複部分を排除して一つにまとめてしまう」技術のことで、ストレージシステムを大きく変え得る技術として、市場で大きな注目を浴びている。本記事では、この新技術はなぜそんなにも注目されているのか、技術にはどのような種類があるのか、そして今後どのように発展していくのかなど、重複排除技術の現状と今後の展望について解説する。
ビッグデータ時代の救世主「Hadoop」とは 「Apache Hadoop」は今、最も注目を集めている技術の1つです。Hadoopとは、大量のデータを手軽に複数のマシンに分散して処理できるオープンソースのプラットフォームです。 Hadoopを活用している企業は年々増え続けていて、不可欠な技術になりつつあるといえるでしょう。 本連載では、Hadoopとは何か、Hadoopがどう活用できるのかということを、「テキストマイニング」に焦点を当てて解説していきたいと思います。 重い処理を複数のマシンに分散させる 複数のマシンに処理を分散させるには、プロセス同士の通信、監視、障害時の対応などを考えなければならず、プログラマにとってハードルが高いものです。しかし、Hadoopはそういった面倒くさい処理を一手に引き受けてくれ、プログラマは、やりたい処理だけに集中できます。 例えば、Hadoopを使うと、1
リリース、障害情報などのサービスのお知らせ
最新の人気エントリーの配信
処理を実行中です
j次のブックマーク
k前のブックマーク
lあとで読む
eコメント一覧を開く
oページを開く