Plugins do Kettle
Estenda a funcionalidade com plugins EE ..
x
Gerenciador de Plugins do PDI
O Pentaho Data Integration (PDI) pode ser estendido com plugins que adicionam novas etapas, entradas de job e outras funcionalidades. A melhor maneira de gerenciar esses plugins é por meio do Gerenciador de Plugins, que você encontrará tanto no cliente PDI quanto no Pentaho User Console (PUC).
O Gerenciador de Plugins cuida de todas as suas necessidades com plugins: instalando novos, atualizando os existentes para suas versões mais recentes e removendo os plugins que você não usa mais.
Embora você possa instalar plugins manualmente, essa abordagem não é recomendada. Plugins instalados manualmente não aparecerão no Gerenciador de Plugins, o que significa que você terá que lidar com todas as atualizações e remoções futuras por conta própria.
Na barra de ferramentas superior, selecione: Ferramentas > Gerenciador de Plugins.

Instalando um Plugin: Encontre o plugin que você deseja instalar pesquisando ou navegando pelas opções disponíveis.
Para a versão mais recente: Basta clicar em Instalar.

Para uma versão anterior: Clique na linha da tabela do plugin para abrir a caixa de diálogo Nome do plugin. Selecione a versão desejada na lista suspensa e clique em Instalar. Confirme a instalação, se solicitado.
Reinicie para ativar: Após a instalação, reinicie tanto o Pentaho Server quanto o cliente PDI. Esta etapa é essencial - os plugins recém-instalados não funcionarão até que você reinicie.
Verifique a instalação: Entre no cliente PDI e navegue até Ferramentas > Gerenciador de Plugins. Pesquise ou navegue até o plugin recém-instalado. Verifique a coluna Versão instalada para confirmar que a versão correta está listada.
Databricks
A entrada Bulk load into Databricks carrega grandes volumes de dados de arquivos de armazenamento em nuvem diretamente para tabelas do Databricks. Como funciona: Ela faz isso usando o comando COPY INTO do Databricks nos bastidores.
Operação em Massa do Salesforce
A etapa de operação em massa do Salesforce executa operações de dados em grande escala (inserção, atualização, upsert e exclusão) em objetos do Salesforce usando a Salesforce Bulk API 2.0.
Como funciona: A etapa lê dados de um fluxo de entrada, cria um arquivo CSV com as alterações e executa o job em massa no Salesforce. Após a conclusão do job, você pode, opcionalmente, direcionar três tipos de resultados para fluxos de saída separados: registros bem-sucedidos, registros não processados e registros com falha.
Requisitos: Você deve ter um Client ID e um Client Secret do Salesforce para usar esta etapa.
Google Analytics v4
A etapa Google Analytics v4 recupera dados da sua conta do Google Analytics para fins de relatórios ou data warehousing.
Como funciona: A etapa consulta propriedades do Google Analytics por meio da API Google Analytics v4 e envia os valores de dimensão e métrica resultantes para o fluxo de saída.
O Pentaho oferece suporte a um tipo de dado hierárquico (HDT) por meio do plugin do Pentaho EE Marketplace. Esse plugin adiciona o tipo de dado HDT e inclui cinco etapas especializadas para trabalhar com ele.
O que ele faz: Essas etapas simplificam o trabalho com estruturas de dados complexas e aninhadas. Elas podem converter entre campos HDT e strings formatadas, e permitem que você acesse ou modifique diretamente índices e chaves de arrays aninhados.
Benefícios de desempenho: As etapas melhoram significativamente o desempenho em comparação com o tratamento de dados hierárquicos como strings simples.
Estrutura de dados: O HDT pode armazenar dados aninhados ou complexos construídos a partir de objetos e arrays, bem como elementos únicos. Ele é compatível com qualquer etapa do PDI que processe dados hierárquicos.
Job do Kafka
x
Atualizado
Isto foi útil?
