Escrito por estudiantes que aprobaron Inmediatamente disponible después del pago Leer en línea o como PDF ¿Documento equivocado? Cámbialo gratis 4,6 TrustPilot
logo-home
Document preview thumbnail
Vista previa 2 fuera de 7 páginas
Otro

D598 Analytics Programming Task 3: Analytics Programming Presentation and Code Explanation Western Governors University

Document preview thumbnail
Vista previa 2 fuera de 7 páginas

D598 Analytics Programming Task 3: Analytics Programming Presentation and Code Explanation Western Governors University

Vista previa del contenido

D598 Analytics Programming Task 3: Analytics
Programming Presentation and Code Explanation 2026-
2027 Western Governors University




Caitlin Atkins
D598 – Analytics Programming
Task 3: Presentation

A. Explain how the code works for the program you submitted in Task 2.

1. Import pandas as pd
Import numpy as np
Import matplotlib.pyplot as plt


Before performing data analysis, importing Python language libraries capable of
specific performances is essential. Pandas are used in nearly every data analysis
document because of their ability to manipulate data and read, clean, filter, and group
files. While NumPy was not used during this task, it is helpful for numerical computing
and data processing. Finally, matplotlib is essential for data visualizations.

2. Data = pd.read_excel(‘D598 Data Set.xlsx)

To load the Excel file into the data frame, pd.read_excel() is used. The title of the
data file is included in parentheses. The file is then named to be called on throughout the
analysis.

3. duplicates = data.duplicated()
4. duplicates
5. data[duplicates]

These code lines are used to identify any duplicates in the data frame. First, a

, Boolean series identifies duplicate columns and marks them as a variable named ‘duplicates.
After, duplicates are used to display those duplicate items. Finally, data[duplicates] retrieves
the duplicate rows in the data frame.


6. gdata = data.groupby('Business
State').mean(numeric_only=True)
7. gdata

Using these lines, the data frame will be grouped by state; the mean for each column
will be calculated, and only numeric values will be displayed. Gdata will print the new data
frame based on the previous line of code.

8. grouped_data = gdata.agg(['mean', 'median', 'min', 'max'])
9. print(grouped_data)
10. new_dataframe = grouped_data

Información del documento

Subido en
4 de enero de 2026
Número de páginas
7
Escrito en
2025/2026
Tipo
Otro
Personaje
Desconocido
$14.99

¿Documento equivocado? Cámbialo gratis Dentro de los 14 días posteriores a la compra y antes de descargarlo, puedes elegir otro documento. Puedes gastar el importe de nuevo.
Escrito por estudiantes que aprobaron
Inmediatamente disponible después del pago
Leer en línea o como PDF

Seller avatar
Los indicadores de reputación están sujetos a la cantidad de artículos vendidos por una tarifa y las reseñas que ha recibido por esos documentos. Hay tres niveles: Bronce, Plata y Oro. Cuanto mayor reputación, más podrás confiar en la calidad del trabajo del vendedor.
smartzone
3.6
(622)
Vendido
3427
Seguidores
2298
Artículos
14819
Última venta
1 día hace



Por qué los estudiantes eligen Stuvia

Creado por compañeros estudiantes, verificado por reseñas

Calidad en la que puedes confiar: escrito por estudiantes que aprobaron y evaluado por otros que han usado estos resúmenes.

¿No estás satisfecho? Elige otro documento

¡No te preocupes! Puedes elegir directamente otro documento que se ajuste mejor a lo que buscas.

Paga como quieras, empieza a estudiar al instante

Sin suscripción, sin compromisos. Paga como estés acostumbrado con tarjeta de crédito y descarga tu documento PDF inmediatamente.

Student with book image

“Comprado, descargado y aprobado. Así de fácil puede ser.”

Alisha Student

Preguntas frecuentes