Sign inSign up

iamgacarvalho/data-hadoop

By iamgacarvalho

•Updated over 2 years ago

Apache Hadoop: 3.4.0 Java: OpenJDK 8

Image
Languages & frameworks
Developer tools
Data science
1

189

iamgacarvalho/data-hadoop repository overview

Esta imagem Docker fornece um ambiente prontamente configurado com o Apache Hadoop, uma estrutura de software de código aberto para armazenamento distribuído e processamento distribuído de conjuntos de dados grandes em clusters de computadores.

Principais Recursos:

  • Apache Hadoop: Versão 3.4.0
  • Java: OpenJDK 8

♨️ Configuração Pronta: Configuração inicial para NameNode, DataNode e outras configurações importantes.

♨️ Conectividade Spark e Hive: Preparado para integração com Apache Spark e Apache Hive para processamento e análise de dados.

Como Usar:

  • Pull da Imagem:
docker pull iamgacarvalho/data-hadoop:0.1.0

Acesse o Hadoop via terminal dentro do container ou através do navegador utilizando as portas padrão.

docker run -it --name hadoop-container iamgacarvalho/data-hadoop:0.1.0

Para acessar o Hadoop via terminal dentro do container, utilize os comandos apropriados do Hadoop, como hdfs, yarn, etc.

Para acessar através do navegador, certifique-se de que o contêiner está em execução e abra um navegador da web. Em seguida, acesse os seguintes URLs:

  • NameNode Web UI: http://<ip_container>:9870/
  • ResourceManager Web UI: http://<ip_container>:8088/

Como obter o IP do container?

docker inspect f0059adbc480

Então você poderá obter o IP, conforme o exemplo abaixo:

"NetworkSettings": {
    "IPAddress": "172.17.0.2",
    ...
}

Tag summary

Content type

Image

Digest

sha256:7e9767db4…

Size

1.1 GB

Last updated

over 2 years ago

docker pull iamgacarvalho/data-hadoop:0.1.0