Apache Hadoop: 3.4.0 Java: OpenJDK 8
189
Esta imagem Docker fornece um ambiente prontamente configurado com o Apache Hadoop, uma estrutura de software de código aberto para armazenamento distribuído e processamento distribuído de conjuntos de dados grandes em clusters de computadores.
Principais Recursos:
♨️ Configuração Pronta: Configuração inicial para NameNode, DataNode e outras configurações importantes.
♨️ Conectividade Spark e Hive: Preparado para integração com Apache Spark e Apache Hive para processamento e análise de dados.
Como Usar:
docker pull iamgacarvalho/data-hadoop:0.1.0
Acesse o Hadoop via terminal dentro do container ou através do navegador utilizando as portas padrão.
docker run -it --name hadoop-container iamgacarvalho/data-hadoop:0.1.0
Para acessar o Hadoop via terminal dentro do container, utilize os comandos apropriados do Hadoop, como hdfs, yarn, etc.
Para acessar através do navegador, certifique-se de que o contêiner está em execução e abra um navegador da web. Em seguida, acesse os seguintes URLs:
Como obter o IP do container?
docker inspect f0059adbc480
Então você poderá obter o IP, conforme o exemplo abaixo:
"NetworkSettings": {
"IPAddress": "172.17.0.2",
...
}
Content type
Image
Digest
sha256:7e9767db4…
Size
1.1 GB
Last updated
over 2 years ago
docker pull iamgacarvalho/data-hadoop:0.1.0