Jetty 应该是目前最活跃也是很有前景的一个 Servlet 引擎。本文将介绍 Jetty 基本架构与基本的工作原理:您将了解到 Jetty 的基本体系结构;Jetty 的启动过程;Jetty 如何接受和处理用户的...
1、数据去重 数据去重 主要是为了掌握和利用 并行化思想 来对数据进行 有意义 的 筛选 。 统计大数据集上的数据种类个数 、 从网站日志中计算访问地 等这些看似庞杂的任务都会涉及...
1、HDFS简介 HDFS(Hadoop Distributed File System)是Hadoop项目的核心子项目,是分布式计算中数据存储管理的基础,是基于 流数据模式 访问和处理 超大文件 的需求而开发的,可以运行于廉价...
1、MapReduce理论简介 1.1 MapReduce编程模型 MapReduce采用分而治之的思想,把对大规模数据集的操作,分发给一个主节点管理下的各个分节点共同完成,然后通过整合各个节点的中间结果,得...
1、Hadoop开发环境简介 1.1 Hadoop集群简介 Java版本:jdk- 6u31 -linux-i586.bin Linux系统:CentOS6.0 Hadoop版本: hadoop-1.0.0.tar.gz 1.2 Windows开发简介 Java版本:jdk- 6u31 -windows-i586.exe Win系统:Windows 7 旗舰...
1、Linux配置java环境变量 1.1 原文出处 地址: http://blog.csdn.net/jiedushi/article/details/6672894 1.2 解压安装jdk 在shell终端下进入jdk-6u14-linux-i586.bin文件所在目录,执行命令 ./jdk-6u14-linux-i586.bin 这...
1、集群部署介绍 1.1 Hadoop简介 Hadoop是Apache软件基金会旗下的一个开源分布式计算平台。以Hadoop分布式文件系统(HDFS,Hadoop Distributed Filesystem)和MapReduce(Google MapReduce的开源实现)为 核...
1、SecureCRT简介 SecureCRT是一款支持SSH(SSH1和SSH2)的终端仿真程序,同时支持Telnet和rlogin协议。SecureCRT是一款用于连接运行包括Windows、UNIX和VMS的远程系统的理想工具。通过使用内含的...
1、VSFTP简介 VSFTP 是一个基于GPL发布的类Unix系统上使用的 FTP服务器 软件,它的全称是Very Secure FTP 从此名称可以看出来,编制者的初衷是代码的安全。 安全性是编写VSFTP的初衷,除了这...
1、分布式环境搭建 采用4台安装Linux环境的机器来构建一个小规模的分布式集群。 图1 集群的架构 其中有一台机器是Master节点,即名称节点,另外三台是Slaver节点,即数据节点。这四台...
1、准备安装 1.1 系统简介 CentOS 是什么? CentOS 是一个基于 Red Hat 企业级 Linux 提供的可自由使用的 源代码企业级 的 Linux 发行版本。 每个版本 的 CentOS 都会获得 七年 的 支持 (通过安全...
相信大家已经了解到Java具有跨平台的特性,可以一次编译,到处运行,在Windows下编写的程序,无需任何修改就可以在Linux下运行,这是C和C++很难做到的。 那么,跨平台是怎样实现的呢...