실기
연습 화면을 불러오는 중…
연습 화면을 불러오는 중…
Python으로 준비하는 실기
코딩이 처음이라면 한 줄 실행부터.
설명 옆에서 직접 써 보고, 결과를 확인하며 배웁니다.
설치·가입 없이 이 화면에서 실행
코드를 실행해 안녕하세요를 출력해요.
처음 보는 코드를 읽고, 오류 메시지를 읽고, 짧은 코드를 스스로 고칠 수 있다.
표에서 원하는 숫자 하나를 뽑아내는 길을 스스로 찾을 수 있다.
전처리 조건을 그대로 코드로 옮겨, 문제가 요구한 자리수로 값을 낼 수 있다.
학습 데이터로 모델을 만들고 평가 데이터의 예측을 규격에 맞는 CSV 로 낼 수 있다.
검정통계량과 p-value 를 구하고 그 결과를 과장 없이 문장으로 옮길 수 있다.
도움말과 파일을 확인하며 혼자 문제를 풀고 제출할 수 있다.
배운 내용을 실전으로
bike-daily-rank.csv 는 일별 총 대여량 731행이다.
total 이 큰 상위 10일의 평균과, total 이 작은 하위 10일의 평균을 각각 구한다.
상위 평균에서 하위 평균을 뺀 값을 버림하여 정수로 답안에 적는다.
describe() 로 최소·최대를 알면 결과가 말이 되는지 바로 판단할 수 있다.sort_values('total', ascending=False).head(10) 가 상위 10일이다.math.floor 다. 상위에서 하위를 뺀다 — 순서를 바꾸면 부호가 뒤집힌다.import pandas as pd
import math
df = pd.read_csv('bike-daily-rank.csv')
top = df.sort_values('total', ascending=False).head(10)['total'].mean()
bottom = df.sort_values('total', ascending=True).head(10)['total'].mean()
print(math.floor(top - bottom))정렬 방향을 바꿔 두 번 head(10) 하는 것이 가장 헷갈리지 않는다. 한 번만 정렬하고 tail(10) 을 쓰면 같은 결과지만, 정렬 방향과 head/tail 을 동시에 뒤집다 한쪽만 놓치면 부호가 뒤집힌다. nlargest(10)·nsmallest(10) 도 같은 값을 준다.
math.floor(-7776.x) 는 −7777 이다.