Возникли проблемы с RHADOOP?

Я проверил вопрос: Rhadoop - подсчет слов с использованием rmr и попробовал ответить на свою сторону. Но это создает много проблем.
Вот код:

Sys.setenv("HADOOP_CMD"="/usr/local/hadoop/bin/hadoop")
Sys.setenv("HADOOP_STREAMING"="/usr/local/hadoop/share/hadoop/tools/lib/hadoop-streaming-2.4.0.jar")

# load librarys
library(rmr2)
library(rhdfs)

# initiate rhdfs package
hdfs.init()

map <- function(k,lines) {
  words.list <- strsplit(lines, '\\s')
  words <- unlist(words.list)
  return( keyval(words, 1) )
}

reduce <- function(word, counts) {
  keyval(word, sum(counts))
}

wordcount <- function (input, output=NULL) {
  mapreduce(input=input, output=output, input.format="text", map=map, reduce=reduce)
}

## read text files from folder example/wordcount/data
hdfs.root <- 'example/wordcount'
hdfs.data <- file.path(hdfs.root, 'data')

## save result in folder example/wordcount/out
hdfs.out <- file.path(hdfs.root, 'out')

## Submit job
out <- wordcount(hdfs.data, hdfs.out) 

## Fetch results from HDFS
results <- from.dfs(out)
results.df <- as.data.frame(results, stringsAsFactors=F)
colnames(results.df) <- c('word', 'count')

head(results.df)

Вот проблемы:

https://justpaste.it/143a0
Я не понимаю проблемы и что должно быть решение этой конкретной проблемы. Пожалуйста, помогите мне и дайте мне знать, как решить эту конкретную проблему.
Я использую RStudio-Server и R с последними версиями.


person Jaffer Wilson    schedule 03.03.2017    source источник
comment
какая версия хаупа? В коде, вставленном выше, версия jar для потоковой передачи Hadoop — 2.4.0, однако в ссылке на выпуск указано 2.7.3!   -  person Manohar Swamynathan    schedule 05.03.2017
comment
Ответ на ваш вопрос был дан по следующей ссылке, посмотрите, поможет ли это! stackoverflow.com/questions/29419318/   -  person Manohar Swamynathan    schedule 05.03.2017