196강부터 200강까지를 섞어 묻습니다. 모두 문항이며 다섯 부분으로 나뉩니다.
| 부분 | 범위 | 문항 |
|---|---|---|
| 1부 | 구조와 자기상관 | ~ |
| 2부 | 정상성과 가짜 회귀 | ~ |
| 3부 | 되먹임과 이동평균 | ~ |
| 4부 | 차분과 예측 | ~ |
| 5부 | 계절과 실무 | ~ |
합격선은 문항입니다. 이 단원은 순서에 있는 정보를 안 쓰면 없는 정보를 있다고 세게 된다는 것이 핵심입니다. 특히 유효 표본, 가짜 회귀가 표본을 늘릴수록 나빠지는 것, 두 그림이 뒤집힌 관계인 것, 기준선 없는 성능 숫자가 뜻이 없는 것, 달력이 만드는 가짜 계절은 반드시 손으로 설명할 수 있어야 합니다.
문제 1. 유효 표본 식을 쓰세요.
답. 입니다.
문제 2. 검산에서 이웃 상관 일 때 표준오차가 몇 배 틀리는지 쓰세요.
답. 배입니다.
문제 3. 검산에서 네 상관값의 포함률을 쓰세요.
답. , , , 입니다.
문제 4. 검산에서 이웃 상관 일 때의 유효 표본을 쓰세요.
답. 개가 개 값밖에 못 합니다.
문제 5. 자기상관을 식으로 쓰세요.
답. 시차 만큼 떨어진 값들의 곱의 합을 제곱합으로 나눕니다.
문제 6. 검산에서 되먹임 자료의 시차 과 를 이론값과 견주세요.
답. 대 이고 대 입니다.
문제 7. 표본 자기상관이 왜 이론값보다 작게 나오는지 쓰세요.
답. 평균을 빼고 계산하며 시차가 길수록 더해지는 항이 줄기 때문입니다.
문제 8. 검산에서 누적합의 시차 자기상관을 쓰세요.
답. 입니다.
문제 9. 검산에서 백색잡음이 경계를 몇 번 넘었는지 쓰고 왜인지 쓰세요.
답. 개 중 번이며 시차마다 퍼센트씩이라 그렇습니다.
문제 10. 검산에서 세 결손 처리의 한 칸 상관을 쓰세요.
답. , , 입니다.
문제 11. 약정상성의 세 조건을 쓰세요.
답. 평균과 분산과 시차별 상관이 시간에 안 변해야 합니다.
문제 12. 검산에서 네 자료의 유의 비율을 쓰세요.
답. , , , 입니다.
문제 13. 가짜 회귀가 표본을 늘리면 어떻게 되는지 쓰세요.
답. 유의 비율이 로 가서 더 나빠집니다.
문제 14. 검산에서 차분한 뒤와 시간을 넣은 뒤의 유의 비율을 쓰세요.
답. 과 입니다.
문제 15. 정상이 아닌 자료의 두 종류와 각각의 처리를 쓰세요.
답. 추세 정상은 시간을 다루고 차분 정상은 차분합니다.
문제 16. 검산에서 차분 정상에서 시간을 뺐을 때의 시차 상관을 쓰세요.
답. 로 구조가 그대로 남습니다.
문제 17. 단위근 검정이 무엇을 회귀하는지 쓰세요.
답. 차분한 값을 원래 값에 회귀해 계수가 인지 봅니다.
문제 18. 검산에서 누적합과 되먹임 의 기각 비율을 쓰세요.
답. 과 으로 거의 같습니다.
문제 19. 검산에서 반대 방향 검정이 되먹임 를 기각하는 비율을 쓰세요.
답. 이며 정상인데도 절반 가까이 기각합니다.
문제 20. 되먹임의 정상 조건을 쓰세요.
답. 계수의 절댓값이 보다 작아야 합니다.
문제 21. 검산에서 가 일 때의 이론 표준편차와 시차 상관을 쓰세요.
답. 와 입니다.
문제 22. 검산에서 두 칸 되먹임의 시차 부분자기상관을 쓰세요.
답. 이며 참 계수 와 같습니다.
문제 23. 한 칸 이동평균의 시차 상관 식과 상한을 쓰세요.
답. 이며 가 일 때 가 상한입니다.
문제 24. 검산에서 가 와 일 때의 시차 상관을 쓰세요.
답. 둘 다 이라 구분되지 않습니다.
문제 25. 두 그림이 어떻게 뒤집힌 관계인지 쓰세요.
답. 되먹임은 부분자기상관이 끊기고 이동평균은 자기상관이 끊깁니다.
문제 26. 잔차 분산이 왜 차수 기준이 못 되는지 쓰세요.
답. 차수를 늘릴수록 계속 줄어들기 때문입니다.
문제 27. 검산에서 길이 일 때 두 기준의 적중률을 쓰세요.
답. AIC 이고 BIC 입니다.
문제 28. 검산에서 차수 과 의 묶음 통계량을 쓰세요.
답. 와 입니다.
문제 29. 검산에서 이동평균 자료를 되먹임으로 맞출 때 차수 과 의 잔차 상관을 쓰세요.
답. 과 입니다.
문제 30. 과잉 차분이 무엇인지 쓰세요.
답. 필요 없는 차분을 해서 없던 구조와 잡음을 만드는 것입니다.
문제 31. 검산에서 백색잡음을 두 번 차분했을 때의 분산과 시차 상관을 쓰세요.
답. 와 입니다.
문제 32. 검산에서 차분 횟수별 한 칸 앞 제곱오차를 쓰세요.
답. , , , 입니다.
문제 33. 검산에서 가 다른 두 AIC를 왜 못 견주는지 쓰세요.
답. 와 이 서로 다른 자료에 대한 값이기 때문입니다.
문제 34. 정상 자료와 누적 자료의 기준선을 각각 쓰세요.
답. 정상 자료에는 평균을 쓰고 누적 자료에는 바로 앞 값을 씁니다.
문제 35. 검산에서 누적 자료의 세 제곱오차를 쓰세요.
답. , , 입니다.
문제 36. 검산에서 길이 와 의 포함률을 쓰세요.
답. 와 입니다.
문제 37. 검산에서 검증 구간의 세 제곱오차를 쓰세요.
답. , , 입니다.
문제 38. 검산에서 모형이 틀릴 때 지평 의 두 값과 비를 쓰세요.
답. 과 이며 배입니다.
문제 39. 검산에서 네 경우의 포함률을 쓰세요.
답. , , , 입니다.
문제 40. 계절을 담는 세 방법과 각각의 가정을 쓰세요.
답. 더미는 해마다 같은 값을, 삼각함수는 매끄러운 되풀이를, 계절 차분은 이웃한 해가 닮았음을 가정합니다.
문제 41. 검산에서 뾰족한 계절의 세 검증 제곱오차를 쓰세요.
답. , , 입니다.
문제 42. 검산에서 네 자료의 시차 상관을 쓰세요.
답. , , , 입니다.
문제 43. 검산에서 로그를 취하기 전후의 계절 폭 비를 쓰세요.
답. 과 입니다.
문제 44. 계절 자료의 기준선을 쓰세요.
답. 지난 주기의 같은 자리 값입니다.
문제 45. 검산에서 계절 자료 네 방법의 제곱오차를 쓰세요.
답. , , , 입니다.
문제 46. 검산에서 달의 길이를 보정하기 전후의 월 대 월 비를 쓰세요.
답. 과 입니다.
문제 47. 검산에서 계절이 자랄 때 세 방법의 검증 제곱오차를 쓰고 로그가 왜 안 듣는지 쓰세요.
답. , , 이며 폭이 수준에 비례하지 않기 때문입니다.
문제 48. S8 네 단원이 각각 무엇을 묻고 무엇을 가정하는지 쓰세요.
답. 다른가와 독립, 얼마나 어떻게와 함수 형태, 바꾸면 어떻게 되나와 설계, 다음은 어떻게 되나와 정상성입니다.
문항 와 가 이 단원의 출발점입니다. 이웃 상관 면 표준오차가 배 틀리고 개가 개 값밖에 못 합니다. 강 이후의 모든 표준오차가 이 자리에서 다시 계산돼야 하며, "자료가 많다"는 말이 "정보가 많다"는 뜻이 아닙니다.
문항 와 이 짝입니다. 관계 없는 두 누적합이 의 비율로 유의하게 나오고, 표본을 늘리면 그 비율이 로 갑니다. 보통의 통계와 방향이 반대이므로 "자료가 많으니 믿을 만하다"는 판단이 통하지 않습니다.
문항 과 가 이 단원에서 가장 자주 틀립니다. 두 검정이 반대 방향인데 둘 다 가 에 가까울 때 무력합니다. 하나는 만 가려내고 다른 하나는 을 잘못 기각합니다. 검정을 통과했다는 것이 증거가 아닙니다.
문항 과 이 정보 기준의 두 얼굴입니다. BIC가 참 차수를 로 맞히는데, 차분 횟수가 다르면 그 값을 서로 못 견줍니다. 를 먼저 정하고 그 안에서 고르는 순서가 그래서 필요합니다.
문항 가 5부 전체의 예고입니다. 누적 자료에서 평균 대비 퍼센트 개선이 나오는데, 그것은 바로 앞 값을 그대로 쓰기만 해도 나옵니다. 기준선 없는 성능 숫자는 아무 말도 하지 않습니다.
문항 과 이 이 과목을 맺습니다. 달의 길이만으로 매년 퍼센트의 가짜 계절이 생기고, 관용적으로 쓰는 로그 변환이 자료에 따라 을 로 만듭니다. 계산을 정교하게 해서 못 고치는 것들이 있으며, 그것을 아는 것이 S8 전체의 결론입니다.
여기서 S8 데이터 분석 추론과 모형을 마칩니다. 다음 과목은 예측을 목표로 삼는 기계학습이며, 목표가 "무엇이 참인가"에서 "무엇이 잘 맞는가"로 바뀝니다.