Buscar

ATIV 2

Faça como milhares de estudantes: teste grátis o Passei Direto

Esse e outros conteúdos desbloqueados

16 milhões de materiais de várias disciplinas

Impressão de materiais

Agora você pode testar o

Passei Direto grátis

Você também pode ser Premium ajudando estudantes

Faça como milhares de estudantes: teste grátis o Passei Direto

Esse e outros conteúdos desbloqueados

16 milhões de materiais de várias disciplinas

Impressão de materiais

Agora você pode testar o

Passei Direto grátis

Você também pode ser Premium ajudando estudantes

Faça como milhares de estudantes: teste grátis o Passei Direto

Esse e outros conteúdos desbloqueados

16 milhões de materiais de várias disciplinas

Impressão de materiais

Agora você pode testar o

Passei Direto grátis

Você também pode ser Premium ajudando estudantes
Você viu 3, do total de 9 páginas

Faça como milhares de estudantes: teste grátis o Passei Direto

Esse e outros conteúdos desbloqueados

16 milhões de materiais de várias disciplinas

Impressão de materiais

Agora você pode testar o

Passei Direto grátis

Você também pode ser Premium ajudando estudantes

Faça como milhares de estudantes: teste grátis o Passei Direto

Esse e outros conteúdos desbloqueados

16 milhões de materiais de várias disciplinas

Impressão de materiais

Agora você pode testar o

Passei Direto grátis

Você também pode ser Premium ajudando estudantes

Faça como milhares de estudantes: teste grátis o Passei Direto

Esse e outros conteúdos desbloqueados

16 milhões de materiais de várias disciplinas

Impressão de materiais

Agora você pode testar o

Passei Direto grátis

Você também pode ser Premium ajudando estudantes
Você viu 6, do total de 9 páginas

Faça como milhares de estudantes: teste grátis o Passei Direto

Esse e outros conteúdos desbloqueados

16 milhões de materiais de várias disciplinas

Impressão de materiais

Agora você pode testar o

Passei Direto grátis

Você também pode ser Premium ajudando estudantes

Faça como milhares de estudantes: teste grátis o Passei Direto

Esse e outros conteúdos desbloqueados

16 milhões de materiais de várias disciplinas

Impressão de materiais

Agora você pode testar o

Passei Direto grátis

Você também pode ser Premium ajudando estudantes

Faça como milhares de estudantes: teste grátis o Passei Direto

Esse e outros conteúdos desbloqueados

16 milhões de materiais de várias disciplinas

Impressão de materiais

Agora você pode testar o

Passei Direto grátis

Você também pode ser Premium ajudando estudantes
Você viu 9, do total de 9 páginas

Prévia do material em texto

Usuário GEISA APARECIDA DA SILVA GONTIJO
Curso GRA1561 ESTATÍSTICA APLICADA AO DATA SCIENCE GR0890211 - 202110.ead-
29778852.06
Teste ATIVIDADE 2 (A2)
Iniciado 16/05/21 16:11
Enviado 16/05/21 17:01
Status Completada
Resultado da
tentativa
10 em 10 pontos  
Tempo decorrido 50 minutos
Resultados exibidos Respostas enviadas, Respostas corretas, Comentários
Pergunta 1
Resposta Selecionada:
Continuando com o mesmo caso da questão anterior, relativa à aprovação, pelos bancos, de
crédito na forma de cartão de crédito, como se fazia, no passado, a aprovação da concessão
de cartões de crédito pelos bancos? E, hoje em dia, como os bancos fazem essa aprovação? 
  
Reflita sobre essas perguntas e suas respostas, analise as afirmativas a seguir e assinale V 
para a(s) Verdadeira(s) e F para a(s) Falsa(s). 
  
 
( ) No passado, os bancos faziam, e ainda fazem, ao menos em parte, a aprovação da
concessão de cartões de crédito através da definição de regras que devem ser atendidas
por cada cliente, tais como idade, emprego estável, renda fixa, dívidas pequenas, nome
limpo e casa própria.
( ) Hoje em dia, dentre outras alternativas, uma que é frequentemente usada pelos
bancos são algoritmos de aprendizagem supervisionada que classificam se o cliente é
um potencial bom ou mau pagador.
( ) Para usarmos algoritmos de classificação com esse propósito de aprovar ou não
cartões de crédito, precisamos de dados. Ensinamos ao algoritmo, com base nos dados
que lhe são passados, a predizer clientes que são maus pagadores potenciais das
faturas do cartão. Dessa forma, se o algoritmo, ao ser alimentado com os dados
referentes a  um novo cliente, classificar esse cliente como um mau pagador potencial, o
banco não aprovará o cartão.
( ) Para equipes de análise de crédito, poder contar com a ajuda de um software com a
capacidade de recomendar a aprovação ou não da concessão do cartão é de grande
valor.
( ) A recomendação feita pelo software poderá ser tratada ao lado de outras regras de
crédito para uma decisão final sobre a concessão de cartão para o cliente.
  
Assinale a alternativa que apresenta a sequência correta. 
  
  
1 em 1 pontos
 
Resposta Correta:
 
Comentário
da
resposta:
V, V, V, V. 
  
 
V, V, V, V.
  
 
Resposta correta. No passado, os bancos faziam a aprovação da concessão de cartões de
crédito através da de�nição de regras que deviam ser atendidas por cada cliente; hoje em
dia, algoritmos de aprendizado de máquina classi�cam se o cliente é um potencial bom ou
mau pagador. Para isso, dados são necessários. Poder contar com a ajuda de um software
com a capacidade de recomendar a aprovação ou não da concessão do cartão é de grande
valor para a equipe de análise de crédito. A recomendação feita pelo software poderá ser
tratada ao lado de outras regras de crédito para uma decisão �nal sobre a concessão de
cartão para o cliente.
Pergunta 2
Resposta Selecionada: 
Resposta Correta: 
Comentário
da
resposta:
Discutimos o que são aprendizagem supervisionada e não supervisionada. Vimos que é na
forma como tratamos as variáveis estudadas que se dá a diferença entre esses dois tipos de
aprendizagens, supervisionada e não supervisionada. Esses dois tipos são os mais
importantes dentre os diversos tipos de aprendizagem. 
  
Relativamente a esse assunto, analise as afirmativas a seguir. 
 
Na aprendizagem supervisionada, definimos uma das variáveis estudadas como sendo a
variável resposta, a qual responde em função dos valores assumidos pelas outras
variáveis, as quais são chamadas de variáveis de entrada.
Especificamente na aprendizagem supervisionada, também denominamos uma variável
resposta de variável de saída ou variável dependente.
Especificamente na aprendizagem supervisionada, também denominamos uma variável
de entrada de variável regressora, variável preditora ou variável independente.
Na aprendizagem não supervisionada, tratamos todas as variáveis estudadas da mesma
forma, sem procurar explicar o comportamento de uma delas em função dos valores
assumidos pelas outras.
  
  
Está correto o que se afirma em: 
  
I, II, III e IV.
I, II, III e IV.
Resposta correta. Na aprendizagem supervisionada, de�nimos uma das variáveis estudadas
como sendo a variável resposta, a qual responde em função dos valores assumidos pelas
outras variáveis, as quais são chamadas de variáveis de entrada; na aprendizagem
supervisionada, também chamamos a variável resposta de variável de saída ou variável
dependente e as variáveis de entrada, de variáveis regressoras, preditoras ou independentes.
1 em 1 pontos
Na aprendizagem não supervisionada, tratamos todas as variáveis estudadas da mesma
forma, sem procurar explicar o comportamento de uma delas em função dos valores
assumidos pelas outras.
Pergunta 3
Resposta Selecionada: 
Resposta Correta: 
Comentário
da
resposta:
A estatística descritiva usa de métodos numéricos para resumir dados, também chamados de
sumários estatísticos, e de gráficos para a visualização dos dados. A jovem cientista de dados
usou algumas técnicas de visualização de dados para analisar sua amostra, mas deixou outras
de lado. 
  
Analise as afirmativas a seguir e veja quais estão coerentes com sua análise descritiva dos
dados. 
 
Na sua análise descritiva dos dados da amostra, a jovem cientista de dados usou
histogramas para a visualização dos dados quantitativos das amostras, que são a renda
mensal das pessoas e seus gastos médios com o cartão de crédito.
Na sua análise descritiva dos dados da amostra, a jovem cientista de dados usou
diagramas de barras para a visualização dos dados quantitativos das amostras, que são
a renda mensal das pessoas e seus gastos médios com o cartão de crédito.
  
 
Histogramas e diagramas de barras são formas tradicionais de visualização gráfica de
dados quantitativos e qualitativos, respectivamente, na estatística e na ciência dos
dados.
A jovem cientista de dados usou, para este caso, apenas histogramas, e preferiu apenas
lançar mão da função table() do software estatístico R, para determinar a frequência
com que os níveis das variáveis qualitativas se manifestaram na amostra estudada, sem
fazer uso de diagramas de barras, o que poderia ter feito, se quisesse.
  
Está correto o que se afirma em: 
  
  
I, III e IV apenas.
I, III e IV apenas.
Resposta correta. Histogramas e diagramas de barras são formas tradicionais de visualização
grá�ca de dados quantitativos e qualitativos, respectivamente, na estatística e na ciência dos
dados, e a jovem cientista de dados não lançou mão de diagramas de barras. Neste caso,
para visualizar os dados qualitativos, poderia ter feito isso, se quisesse. Diagramas de barras
são usados para a visualização de dados qualitativos, não quantitativos.
Pergunta 4
1 em 1 pontos
1 em 1 pontos
Resposta Selecionada: 
Resposta Correta: 
Comentário
da
resposta:
O ser humano tem enorme facilidade em agrupar, por similaridade, e classificar coisas, todos
os tipos de coisas. Por conta disso, problemas de classificação são muito frequentes no
mundo, mais frequentes que problemas de regressão. Fornecemos alguns exemplos de
aplicação de métodos de classificação no mundo dos negócios. Dentre esses exemplos,
encontramos: 
 
a Netflix usa classificadores para recomendar filmes. Para a Netflix, o valor desse tipo de
aplicação é que, quanto mais filmes assistirmos, maior será a sua receita;
o Facebook usa classificadores para recomendar novas amizades para a nossa rede de
relacionamento. Para o Facebook, o valor desse tipo de aplicação é que, quanto maior
nossa rede de relacionamento, maior será a sua receita;
um banco de varejo usa classificadores para detectar se uma operação com cartão de
débito ou crédito é ou não uma operação fraudulenta. Para o banco, o valor dessa
aplicação é que, quanto antes operações fraudulentas forem detectadas, mais
rapidamente o banco pode agir para impedir perdas para seus clientes e para ele
próprio;
uma concessionária de distribuição de energia elétrica usa classificadorespara
identificar casos potenciais de roubo de energia da rede, os famosos “gatos”. Para as
concessionárias de distribuição de energia elétrica, o valor dessa aplicação é evitar
prejuízo com o furto de energia da rede, além do relevante aspecto de prevenção de
acidentes decorrentes de instalações clandestinas.
  
Está correto o que se afirma em: 
  
  
I, II, III e IV.
I, II, III e IV.
Resposta correta. Todos os exemplos listados nesta questão são problemas de classi�cação,
os quais, como dissemos no enunciado, são muito frequentes no mundo. Em todos eles, a
variável resposta é uma variável qualitativa, ou dicotômica, ou politômica.
Pergunta 5
Discutimos sobre classificadores determinísticos e probabilísticos. Demos, como exemplo,
uma variável resposta qualitativa com dois níveis (classes), o indivíduo está infectado pelo
vírus HIV ( ) ou não está infectado ( ), dado um conjunto de sintomas
  que ele apresenta. 
  
Reveja esse assunto e analise as afirmativas a seguir. 
 
Um classificador determinístico vai dizer se o indivíduo está ou não está infectado, dados
os sintomas que apresenta.
Um classificador probabilístico vai dizer qual é a probabilidade de o indivíduo estar ou
não infectado, dados os sintomas que apresenta.
1 em 1 pontos
Resposta Selecionada:
 
Resposta Correta:
 
Comentário
da
resposta:
No jargão da estatística, escrever  significa que a variável aleatória resultou no
valor , em que  é um dos possíveis valores que a variável aleatória pode assumir (ou
seja, uma de suas classes, no caso, das variáveis qualitativas).
Nesse mesmo jargão, escrever  significa a probabilidade de ser igual a
um dos seus possíveis valores , quando a variável de entrada  é igual a  (dado que 
).
  
Está correto o que se afirma em: 
  
  
I, II, III e IV. 
  
  
 
I, II, III e IV.
  
  
 
Resposta correta. Um classi�cador determinístico vai dizer se o indivíduo está ou não está
infectado, dados os sintomas que apresenta; já um classi�cador probabilístico vai dizer qual é
a probabilidade de o indivíduo estar ou não infectado; no jargão da estatística, escrever
 signi�ca que a variável aleatória resultou no valor , em que  é um dos possíveis
valores que a variável aleatória pode assumir (ou seja, uma de suas classes, no caso das
variáveis qualitativas) e, nesse mesmo jargão, escrever  signi�ca a
probabilidade de ser igual a um dos seus possíveis valores  quando a variável de entrada 
 é igual a  (dizemos: dado que ).
Pergunta 6
Os dados cedidos pelo gerente do banco estavam bem organizados e livres de erros. A nossa
jovem cientista de dados não precisou, portanto, fazer uma limpeza e pré-tratamento dos
dados e pode prosseguir imediatamente para uma análise descritiva deles antes do
desenvolvimento do modelo. 
Tendo isso em vista, analise as afirmativas a seguir e assinale V para a(s) Verdadeira(s) e F
para a(s) Falsa(s).   
 
( ) Chamamos de análise descritiva dos dados seus sumários (ou resumos) estatísticos
dos mesmos e a sua visualização. Ambos, os sumários e as visualizações, nos ajudam a
entender o comportamento dos dados e, através deles, do fenômeno ou processo
estudado.
( ) São quatro as variáveis estudadas pela cientista de dados: renda mensal da pessoa,
seus gastos médios com o cartão, se a pessoa tinha ou não um emprego estável ao
longo do período amostrado e se ficou ou não inadimplente ao longo do deste período.
( ) Para criar sumários estatísticos das variáveis quantitativas, a renda mensal da pessoa
e seus gastos com o cartão, a cientista de dados usou as funções min(), mean() e max()
1 em 1 pontos
Resposta Selecionada: 
Resposta Correta: 
Comentário
da
resposta:
do software estatístico R para calcular os valores mínimo, médio e máximo dos dados
observados para essas variáveis.
( ) Para criar sumários estatísticos das variáveis qualitativas, se a pessoa tinha ou não
um emprego estável e se tinha ou não ficado inadimplente com o pagamento das faturas
do cartão ao longo do período amostrado, a cientista de dados usou a função table() do
software estatístico R para calcular a frequência com que os níveis de cada uma dessas
variáveis se manifestaram na amostra estudada.
  
Assinale a alternativa que apresenta a sequência correta. 
  
  
V, V, V, V.
V, V, V, V.
Resposta correta. Chamamos de análise descritiva dos dados seus sumários (ou resumos) e a
sua visualização por meio de grá�cos. São quatro as variáveis estudadas pela cientista de
dados. Para criar sumários estatísticos das variáveis quantitativas, a cientista de dados usou
as funções min(), mean() e max() do software estatístico R, e para os sumários estatísticos das
variáveis qualitativas, usou a função table() do mesmo software, e assim calculou a
frequência com que os níveis de cada uma dessas variáveis se manifestaram na amostra
analisada.
Pergunta 7
Ao longo das nossas discussões, demos foco a um classificador chamado de regressão
logística que, apesar do nome regressão (esse nome por razões históricas e por conta de
algumas de suas características), é usado como um classificador. Mas também vimos que
existem outros tipos de classificadores. 
Relativamente a esse assunto de algoritmos de classificação, analise as afirmativas a seguir. 
 
Regressão logística é o único método de aprendizagem supervisionada que é utilizado
para classificação, todos outros métodos são métodos de regressão.
Apesar do nome regressão logística, o que acaba sendo um pouco confuso para
iniciantes, na verdade este é um dos vários métodos de aprendizagem supervisionada
utilizado para classificação.
Dentre os métodos utilizados para classificação se encontram regressão logística,
análise discriminante linear (LDA = Linear Discriminant Analysis), árvores de decisão
para classificação, máquinas de vetores de suporte (SVM = support vector machines) e
k-vizinhos mais próximos (KNN = k-nearest neighbors).
Regressão linear não é um método de classificação, mas, sim, um dos métodos
preditivos de aprendizagem supervisionada usados na predição de valores de variáveis
respostas quantitativas.
  
Está correto o que se afirma em: 
1 em 1 pontos
Resposta Selecionada:
 
Resposta Correta:
 
Comentário
da
resposta:
  
  
II, III e IV, apenas. 
  
  
 
II, III e IV, apenas.
  
  
 
Resposta correta. A única asserção incorreta desta questão é a primeira, que a�rma que
regressão logística é o único método de aprendizagem supervisionada que é utilizado para
classi�cação, todos outros métodos são métodos de regressão.
Pergunta 8
Resposta Selecionada: 
Resposta Correta: 
Comentário
da
resposta:
A jovem cientista de dados, tendo em mãos os dados que lhe foram passados pelo gerente do
banco, precisou denominá-los corretamente para a fase de treino (ajuste) do algoritmo
preditivo. Ela escolheu a regressão logística como seu algoritmo preditivo, para classificar o
potencial (a probabilidade) de uma pessoa ficar ou não inadimplente com o pagamento das
faturas do cartão de crédito. 
  
Analise as afirmativas a seguir e assinale V para a(s) Verdadeira(s) e F para a(s) Falsa(s). 
 
( ) A jovem cientista de dados escolheu como variável resposta a renda mensal da
pessoa, e tratou as demais variáveis como variáveis de entrada.
( ) A jovem cientista de dados escolheu o gasto médio mensal da pessoa com cartão de
crédito como a variável resposta, e tratou as demais como variáveis de entrada.
( ) A jovem cientista de dados não definiu qualquer das quatro variáveis como a variável
resposta, e decidiu realizar uma análise baseada em aprendizagem não supervisionada.
( ) A jovem cientista de dados escolheu como variável resposta se a pessoa havia, ao
longo do período pesquisado, ficado inadimplente com o pagamento das faturas do
cartão ao menos uma vez (Sim ou Não), e tratou as demais variáveis como variáveis de
entrada.
  
Assinale a alternativa que apresenta a sequência correta. 
  
  
F, F, F, V.
F, F, F, V.
Resposta correta. A jovem cientista de dados escolheu como variável resposta se a pessoa
havia, ao longodo período pesquisado, �cado inadimplente com o pagamento das faturas do
cartão ao menos uma vez (Sim ou Não), e tratou as demais variáveis como variáveis de
entrada.
1 em 1 pontos
Pergunta 9
Resposta Selecionada: 
Resposta Correta: 
Comentário
da
resposta:
Dados podem aparecer na forma de textos, imagens, vídeos, sons, tabelas, listas, sequências,
séries, etc. São muitos os dados que hoje coletamos de diferentes fontes, e muitas as formas
de organizá-los e armazená-los. Uma dessas forma, talvez a mais importante delas, são os
dados estruturados. 
  
Relativamente a esse assunto, analise as afirmativas a seguir. 
 
Dados estruturados são dados que não possuem uma estrutura regular e repetitiva,
seguindo um padrão comum adotado pelas ciências da computação, estatística e ciência
dos dados.
A forma de organização básica dos dados, preferida na estatística e na ciência dos
dados, é a forma tabular, na qual as variáveis são dispostas nas linhas e as observações
são dispostas nas colunas.
Dados estruturados são dados que possuem uma estrutura regular e repetitiva,
seguindo um padrão comum adotado pelas ciência da computação, estatística e ciência
dos dados.
A forma de organização básica dos dados, preferida na estatística e na ciência dos
dados, é a forma tabular, na qual as variáveis são dispostas nas colunas e as
observações são dispostas nas linhas.
  
Está correto o que se afirma em: 
  
III e IV, apenas.
III e IV, apenas.
Resposta correta. Dados estruturados são dados que possuem uma estrutura regular e
repetitiva, seguindo um padrão comum adotado pelas ciência da computação, estatística e
ciência dos dados. Também está correto dizer que a  forma de organização básica dos dados,
preferida na estatística e na ciência dos dados, é a forma tabular, na qual as variáveis são
dispostas nas colunas e as observações são dispostas nas linhas.
Pergunta 10
Vimos que há dois principais tipos de aprendizagem supervisionada: problema de regressão e
problema de classificação. São os tipos de variáveis resposta dos dados em análise que
distinguem esses dois tipos entre si. 
  
Relativamente a esses dois tipos, analise as afirmativas a seguir.
 
Na aprendizagem supervisionada, um problema de regressão é um no qual a variável
resposta é qualitativa.
Na aprendizagem supervisionada, um problema de regressão é um no qual a variável
resposta é quantitativa.
1 em 1 pontos
1 em 1 pontos
Domingo, 16 de Maio de 2021 17h03min34s BRT
Resposta Selecionada: 
Resposta Correta: 
Comentário
da
resposta:
Na aprendizagem supervisionada, um problema de classificação é um no qual a variável
resposta é qualitativa.
Na aprendizagem supervisionada, um problema de classificação é um no qual a variável
resposta é quantitativa.
  
Está correto o que se afirma em:
II e III, apenas.
II e III, apenas.
Resposta correta. Na aprendizagem supervisionada, um problema de regressão é um no qual
a variável resposta é quantitativa e um problema de classi�cação é um no qual a variável
resposta é qualitativa.

Continue navegando