Modelos interativos do código no Data Refinery

O Data Refinery fornece modelos interativos para você codificar operações, funções e operadores lógicos. Acesse os modelos por meio da caixa de texto da linha de comandos na parte superior da página. Os modelos incluem assistência interativa para ajudá-lo com as opções de sintaxe.

Importante: o suporte é para as operações e funções na interface com o usuário. Se você inserir outras operações ou funções de uma biblioteca de software livre, o fluxo do Data Refinery poderá falhar. Consulte a ajuda da linha de comandos e certifique-se de usar a lista de operações ou funções dos modelos. Use os exemplos nos modelos para customizar ainda mais a sintaxe conforme necessário.

Operações

arranjar

organizar (`<column>`)
Sorte linhas, em ordem crescente, pelas colunas especificadas.

organize (desc (`<column>`))
Sorte linhas, em ordem decrescente, pela coluna especificada.

organizam (`<column>`, `<column>`)
Linhas de classificação, em ordem crescente, por cada coluna especificada, sucessivos, mantendo a ordem da ordenação prévia intacta.

contagem

count ()
Total os dados por grupo.

count (`<column>`)
Group os dados pela coluna especificada e retornam o número de linhas com valores exclusivos (para valores string) ou retornam o total para cada grupo (para valores numéricos).

count (`<column>`, wt= `<column>`)
Grupo os dados pela coluna especificada e retornam o número de linhas com valores exclusivos (para valores string) ou retornam o total para cada grupo (para valores numéricos) na coluna de peso especificada.

count (`<column>`, wt=<func>(`<column>`))
Grupo os dados pela coluna especificada e retornam o resultado da função aplicada à coluna de peso especificada.

count (`<column>`, wt=<func>(`<column>`), sort = <logical>)
Grupo os dados pela coluna especificada e retornam o resultado da função aplicada à coluna de peso especificada, classificada ou não.

distinct

distinto ()
Mantenha linhas distintas, exclusivas baseadas em todas as colunas ou em colunas especificadas.

filtro

filtro (`<column>` <logicalOperator> provide_value)
Mantenha linhas que atendam a condição especificada e filtram todas as outras linhas.
Para o tipo de coluna booleano, provide_value deve ser TRUE ou FALSE em letra maiúscula.

filtro (`<column>` == <logical>)
Mantenha linhas que atendam as condições de filtro especificadas baseadas em valor lógico TRUE ou FALSE.

filtro (<func>(`<column>`) <logicalOperator> provide_value)
Mantenha linhas que atendam a condição especificada e filtram todas as outras linhas. A condição pode aplicar uma função a uma coluna no lado esquerdo do operador.

filtro (`<column>` <logicalOperator> <func(column)>)
Mantenha linhas que atendam a condição especificada e filtre todas as outras linhas. A condição pode aplicar uma função a uma coluna no lado direito do operador.

filtro (<logicalfunc(column)>)
Manter linhas que atendam a condição especificada e filtrar todas as outras linhas. A condição pode aplicar uma função lógica a uma coluna.

filtro (`<column>` <logicalOperator> provide_value <andor> `<column>` <logicalOperator> provide_value)
Mantenha linhas que atendam as condições especificadas e filtre todas as outras linhas.

group_by

group_by (`<column>`)
Grupo os dados com base na coluna especificada.

group_by (desc (`<column>`))
Grupo os dados, em ordem decrescente, com base na coluna especificada.

mutate

mutate (provide_new_coluna = `<column>`)
Adicionar uma nova coluna e manter colunas existentes.

mutate (provide_new_coluna = <func(column)>)
Adicionar uma nova coluna usando a expressão especificada, que aplica uma função a uma coluna. Manter colunas existentes.

mutate (provide_new_coluna = case_quando (`<column>` <operator> provide_value_or_column_to_compare ~ provide_value_or_column_to_replace, `<column>` <operator> provide_value_value_or_column_to_compare ~ provide_value_or_column_column_to_replace, TRUE ~ provide_default_value_or_column))
Adicionar uma nova coluna usando a expressão condicional especificada.

mutate (provide_new_coluna = `<column>` <operator> `<column>`)
Adicionar uma nova coluna usando a expressão especificada, que realiza um cálculo com colunas existentes. Manter colunas existentes.

mutate (provide_new_coluna = coalesce (`<column>`, `<column>`))
Adicionar uma nova coluna usando a expressão especificada, que substitui valores ausentes na nova coluna com valores de outra, coluna especificada. Como uma alternativa à especificação de outra coluna, é possível especificar um valor, uma função em uma coluna ou uma função em um valor. Manter colunas existentes.

mutate (provide_new_coluna = if_else (`<column>` <logicalOperator> provide_value, provide_value_for_true, provide_value_for_false))
Adicionar uma nova coluna, usando a expressão condicional especificada. Manter colunas existentes.

mutate (provide_new_coluna = `<column>`, provide_new_coluna = `<column>`)
Adicionar várias colunas novas e manter colunas existentes.

mutate (provide_new_coluna = n ())
Conferir os valores nos grupos. Assegure-se de que o agrupamento seja feito já usando group_by. Manter colunas existentes.

mutate_all

mutate_all (funs (<func>))
Aplicar a função especificada em todas as colunas e sobrescrever os valores existentes naquelas colunas. Especifique se valores ausentes devem ser removidos.

mutate_all (funs (. <operator> provide_value))
Aplicar o operador especificado em todas as colunas e sobrescrever os valores existentes naquelas colunas.

mutate_all (funs ("provide_value" =. <operator> provide_value))
Aplicar o operador especificado em todas as colunas e criar novas colunas para manter os resultados. Forneça nomes às colunas novas que terminam com o valor especificado.

mutate_at

mutate_at (vars (`<column>`), funs (<func>))
Aplicar funções para as colunas especificadas.

renomear

rename (provide_new_coluna = `<column>`)
Renomear a coluna especificada.

sample_frac

sample_frac (provide_number_between_0_and_1, weight= `<column>`, replace=<logical>)
Gerar uma amostra aleatória com base em uma porcentagem dos dados. o peso é opcional e é a proporção de probabilidade de escolha da linha. Forneça uma coluna numérica. O replace é opcional e seu Padrão é FALSE.

sample_n

sample_n (provide_numer_of_rows, peso = `<column>`, replace=<logical>)
Gerar uma amostra aleatória de dados com base em várias linhas. o peso é opcional e é a proporção de probabilidade de escolha da linha. Forneça uma coluna numérica. O replace é opcional e seu padrão é FALSE.

selecionar

select (`<column>`)
Mantenha a coluna especificada.

select (-`<column>`)
Remover a coluna especificada.

select (starts_with ("provide_text_value"))
Mantenha colunas com nomes que começam com o valor especificado.

select (ends_with ("provide_text_value"))
Mantenha colunas com nomes que terminam com o valor especificado.

select (contém ("provide_text_value"))
Mantenha colunas com nomes que contenham o valor especificado.

select (correspondências ("provide_text_value"))
Mantenha colunas com nomes que correspondam ao valor especificado. O valor especificado pode ser um texto ou uma expressão regular.

select (`<column>`: `<column>`)
Mantenha as colunas na faixa especificada. Especifique o intervalo de uma coluna à outra coluna.

select (`<column>`, tudo ())
Mantenha todas as colunas, mas faça da coluna especificada a primeira coluna.

select (`<column>`, `<column>`)
Mantenha as colunas especificadas.

totalizar

resumir (provide_new_coluna = <func>(`<column>`))
Aplicar funções agregadas nas colunas especificadas para reduzir vários valores de coluna a um único valor. Certifique-se de agrupar os dados da coluna primeiro usando a operação group_by.

summarize_all

resumize_all (<func>)
Aplicar uma função agregada em todas as colunas para reduzir vários valores de coluna a um único valor. Especifique se valores ausentes devem ser removidos. Certifique-se de agrupar os dados da coluna primeiro usando a operação group_by.

resumize_all (funs (<func>))
Aplicar várias funções agregadas a todas as colunas para reduzir vários valores de coluna a um único valor. Crie novas colunas para reter os resultados. Especifique se valores ausentes devem ser removidos. Certifique-se de agrupar os dados da coluna primeiro usando a operação group_by.

tally

tally ()
Conta o número de linhas (para colunas string) ou totaliza os dados (para valores numéricos) por grupo. Certifique-se de agrupar os dados da coluna primeiro usando a operação group_by.

tally (wt = `<column>`)
Conta o número de linhas (para colunas string) ou totaliza os dados (para colunas numéricas) por grupo para a coluna ponderada.

tally (wt=<func>(`<column>`), sort = <logical>)
Aplica uma função para a coluna ponderada ponderada e retorna o resultado, por grupo, sorteado ou não.

top_n

top_n (provide_value)
Selecione as linhas de N superior ou inferior (por valor) em cada grupo. Especifique um número inteiro positivo para selecionar N linhas superiores; especifique um número inteiro negativo para selecionar N linhas inferiores.

top_n (provide_value, `<column>`)
Selecione as linhas de N superior ou inferior (por valor) em cada grupo, com base na coluna especificada. Especifique um número inteiro positivo para selecionar N linhas superiores; especifique um número inteiro negativo para selecionar N linhas inferiores.

Se as linhas duplicadas afetarem a contagem, use a operação da GUI Remover duplicatas antes de usar a operação top_n().

transmute

transmute (<new_or_existing_column> = `<column>`)
Adicionar uma nova coluna ou sobrescrever um existente usando a expressão especificada. Mantenha somente colunas que são mencionadas na expressão.

transmute (<new_or_existing_column> = <func(column)>)
Adicionar uma nova coluna ou sobrescrever um existente, aplicando uma função na coluna especificada. Mantenha somente colunas que são mencionadas na expressão.

transmute (<new_or_existing_column> = `<column>` <operator> `<column>`)
Adicionar uma nova coluna ou sobrescrever um existente aplicando um operador na coluna especificada. Mantenha somente colunas que são mencionadas na expressão.

transmute (<new_or_existing_column> = `<column>`, <new_or_existing_column> = `<column>`)
Adicionar várias colunas novas. Mantenha somente colunas que são mencionadas na expressão.

transmute (<new_or_existing_column> = if_else (provide_value, provide_value_for_true, provide_value_for_false))
Adicionar uma nova coluna ou sobrescrever um existente usando as expressões condicionais especificadas. Mantenha somente colunas que são mencionadas nas expressões.

desagrupar

ungroup ()
Desagrupar os dados.

Funções

Agregado

  • média
  • min
  • n
  • sd
  • soma

Lógico

  • is.na

Numéricos

  • abs
  • unir
  • cut
  • exp
  • floor

Texto

  • c
  • unir
  • paste
  • tolower
  • toupper

Tipo

  • as.character
  • as.double
  • as.integer
  • as.logical

Operadores lógicos

  • <
  • <=
  • >=
  • >
  • entre
  • !=
  • ==
  • %i n%