首页 > 其他分享 >Mahout 安装、配置

Mahout 安装、配置

时间:2023-06-06 13:33:05浏览次数:55  
标签:bin mahout 配置 hadoop Mahout export home HOME 安装


Mahout是 Hadoop 的一种高级应用。运行 Mahout 需要提前安装好 Hadoop,Linux 上 Hadoop 的安装配置可以参考文章:

1.下载二进制安装包解压安装
  到http://labs.renren.com/apache-mirror/mahout/0.7下载,我选择下载二进制包,直接解压及可。


hadoop@ubuntu:~$ tar -zxvf mahout-distribution-0.7.tar.gz


 

2. 配置环境变量:在/etc/profile,/home/hadoop/.bashrc中添加 MAHOUT_HOME、MAHOUT_HOME/lib、MAHOUT_HOME/bin信息


MAHOUT_HOME=/home/hadoop/mahout-distribution-0.7 PIG_HOME=/home/hadoop/pig-0.9.2 HBASE_HOME=/home/hadoop/hbase-0.94.3 HIVE_HOME=/home/hadoop/hive-0.9.0 HADOOP_HOME=/home/hadoop/hadoop-1.1.1 JAVA_HOME=/home/hadoop/jdk1.7.0 PATH=$JAVA_HOME/bin:$PIG_HOME/bin:$MAHOUT_HOME/bin:$HBASE_HOME/bin:$HIVE_HOME/bin:$HADOOP_HOME/bin:$HADOOP_HOME/conf:$PATH
CLASSPATH=.:$JAVA_HOME/lib/dt.jar:$HBASE_HOME/lib:$MAHOUT_HOME/lib:$PIG_HOME/lib:$HIVE_HOME/lib:$JAVA_HOME/lib/tools.jar export MAHOUT_HOME export PIG_HOME export HBASE_HOME export HADOOP_HOME export JAVA_HOME export HIVE_HOME export PATH export CLASSPATH


3:启动hadoop,也可以用伪分布式来测试

4:mahout –help    #检查Mahout是否安装完好,看是否列出了一些算法

5:mahout使用准备
a.下载一个文件synthetic_control.data,下载地址 http://archive.ics.uci.edu/ml /databases/synthetic_control /synthetic_control.data,并把这个文件放 在$MAHOUT_HOME目录下。

b.启动Hadoop:$HADOOP_HOME/bin/start-all.sh

c.创建测试目录testdata,并把数据导入到这个tastdata目录中(这里的目录的名字只能是testdata)


hadoop@ubuntu:~/$ hadoop fs -mkdir testdata #
hadoop@ubuntu:~/$ hadoop fs -put /home/hadoop/mahout-distribution-0.7/synthetic_control.data testdata


d.使用kmeans算法测试(需要运行几分钟左右)


hadoop@ubuntu:~/$ hadoop jar /home/hadoop/mahout-distribution-0.7/mahout-examples-0.7-job.jar org.apache.mahout.clustering.syntheticcontrol.kmeans.Job



e.查看结果


hadoop@ubuntu:~/$ hadoop fs -lsr output


如果看到以下结果那么算法运行成功,安装也就成功了。



clusteredPoints  clusters-0  clusters-1  clusters-10  clusters-2  clusters-3  clusters-4 cluste


标签:bin,mahout,配置,hadoop,Mahout,export,home,HOME,安装
From: https://blog.51cto.com/u_2650279/6424143

相关文章

  • 使用mahout做海量数据关联规则挖掘
     mahout是一个基于hadoop的分布式数据挖掘开源项目(mahout本来是指一个骑在大象上的人)。掌握了关联规则的基本算法和使用,加上分布式关联规则挖掘后,就可以处理基本的关联规则挖掘工作了,实践中只需要把握业务,理解数据便可游刃有余。安装mahout骑在大象上的侠士必然需要一头雄纠纠......
  • CentOS7 通过 yum 安装 Docker
    从Docker官网上也能够找到CentOS7安装Docker的文档,但是文档比较简略,为了能够在安装过程中少走一些弯路,还是很有必要写一下Docker安装的博客总结,方便后续提高工作效率。CentOS7安装Docker的官网文档地址为:https://docs.docker.com/engine/install/centos/Docker主要......
  • python离线下载安装包
    1.背景内网服务器不能直接连接外网,但是需要Python的mysql-connector-2.1.7包2.步骤#下载相关tar包https://pypi.doubanio.com/simple/mysql-connector/mysql-connector-2.1.7.tar.gz#上传到服务器后,解压tar-zxvfmysql-connector-2.1.7.tar.gz#进入解压目录,安装cdm......
  • git 多用户配置
    第一步删除全局用户名和邮箱配置#添加全局用户信息gitconfig--globaluser.name"用户名"gitconfig--globaluser.email"邮箱"#删除全局用户信息gitconfig--global--unsetuser.namegitconfig--global--unsetuser.email第二步生成key并添加至远端$ssh-......
  • kde neon安装octave
    1、sudoapt-getinstalloctave说明:octave-doc, octave-info,and octave-htmldoc forthedocumentation;liboctave-dev fortheoctavedevelopmentheaderfilesandmkoctfile(requiredtoinstallOctaveForgepackages);andoctave-dbg forthedebuggingsymbo......
  • VsCode配置Wdk7600开发环境 以及 "自动编译" 和 sources文件简单介绍..
    目录VsCode配置Wdk7600开发环境以及"自动编译"和sources文件简单介绍..一丶简介1.2软件安装1.3开发环境配置步骤1.4集成终端编译1.4.1集成任务1.4.2设置为全局任务.二丶Sources文件编程2.1INCLUDES字段2.2i386_SOURCES32位驱动使用内联汇编2.3AMD64_SOURCES使用......
  • CentOS安装Nginx
    CentOS安装Nginx一、安装环境yum-yinstallgccgcc-c++makelibtoolzlibzlib-developensslopenssl-develpcrepcre-devel二、下载Nginx版本1.官网直接下载.tar.gz安装包,地址:nginx:download2.使用wget命令下载wget-chttps://nginx.org/download/nginx-1.18.0.tar......
  • Windows环境FFmpeg下载、环境变量配置
    FFmpeg官网下载地址第一步:点击Download下载按钮第二步:选择适合当前的运行环境,选择windows第一个地址Windowsbuildsfromgyan.dev第三步:选择releasebuilds中合适的版本第四步:环境变量配置,我安装的目录是:E:\ProgramFiles\ffmpeg-6.0-essentials_build点击ffmpeg安装......
  • Centos7 离线编译安装python3
    一,安装依赖yum-yinstallzlib-develbzip2-developenssl-develncurses-develreadline-develtk-develgccmake安装libffi-devel依赖yuminstalllibffi-devel-y注意:如果不安装这个包,python3可以装成功,但是后面装flask、uwsgi等依赖python3中有个内置模块叫ctype......
  • Ubuntu下git的安装与使用
    Ubuntu下git的安装与使用Ubuntu下git的安装与使用与Windows下的大致相同,只不过个人感觉在Ubuntu下使用git更方便。首先,确认你的系统是否已安装git,可以通过git指令进行查看,如果没有,在命令行模式下输入sudoapt-getinstallgit命令进行安装。安装完成后进行git配置,输入指令gitconfi......