태양광 예측 / 집합자원 최적화
DSC6 연구 현황
현재 성과
기반 검증지금 하는 일
데이터와 검증 환경 준비
수익 S = 매전수익 − W
W = 0.1 × Σ SMP × k × 집합 절대오차
예측 개선과 배분 개선의 효과를 분리해 측정합니다.데이터 진단
전처리와 오류 구조부터 확인전일 17시 기준으로 다시 본 검증 경계
| 구간 | 단계 | 시점 이후 선택 행 | 선택 시간 | 그중 양수 실적 |
|---|
각 날짜 경계 직전 7시간만 읽어 기존 마스크를 점검했습니다. 겨울 모델 fit와 조기 종료는 이 구간에서 0행이었고, 봄은 아직 실행하지 않은 계획입니다. 보고 지연 0시간은 낙관적 가정이며 실제 수집 지연은 미확인입니다.
2월 1일의 첫 예측 시점은 1월 31일 17시입니다. 그 뒤의 실적으로 고른 탐색 배분은 수선이 필요합니다. 기존 2월 참조 배분 비교는 이 배분 선택과 분리해 보존하며, 수정 후 점수는 아직 측정하지 않았습니다.
아래 기여도는 L1 모델의 2025년 2월 개발 검증과 참조 배분 기준입니다. 서로 겹치는 분류이므로 비율을 합산하지 않습니다. 원인이나 제거 효과를 뜻하지 않습니다.
예보 불일치와 집합 편향
같은 동결 모델의 1월과 2월 진단입니다. 2월은 이미 탐색한 개발 검증 구간이며 인과 효과나 독립 성능 검증이 아닙니다.
예보 차이에 따른 오차
행 수와 정산 기여 보기
| 월 / 차이 | 발전소-시간 | 정규화 MAE | W 기여 |
|---|
두 원 예보가 있는 행만 수치 구간에 포함합니다. W 기여는 오차 상쇄를 반영한 회계적 분해이며 음수도 가능합니다. 구간을 제거했을 때의 개선량이 아닙니다.
그룹별 시간대 편향
(예측 − 실적) / 그룹 설비용량. 양수는 과대 예측입니다. 각 시간대에 1월 31일, 2월 28일을 집계했습니다. 시각은 구간 끝입니다.
A그룹 2월 15시는 평균이 음수지만 가격 가중 중앙값은 양수입니다. 평균을 빼는 보정이 절대오차 정산에 최적인 것은 아닙니다. 보정값을 적용하지 않았습니다.
낮 0실적의 빈도와 지속성
| 월 | 낮 0실적 | 전체 W 기여 | 하루 전체 0 |
|---|
낮은 태양고도 10도 초과입니다. 하루 전체 0은 낮 관측이 4시간 이상이고 모두 0인 발전소-일 수입니다. W 기여는 오차 상쇄를 반영하며 제거 효과가 아닙니다.
같은 발전소와 같은 대상일 안에서 이어지는 0실적의 연속 구간 수입니다. 밤을 넘어 이어 붙이지 않습니다.
눈 덮임, 설비 정지와 통신 문제는 원인이 미확정인 가설입니다. 실적을 삭제하거나 모델을 다시 학습하지 않았습니다.
개선의 불확실성
평균 예측의 상쇄와 다음 달 결과
기존 L1 모델 대비 W 변화율. 음수는 개선, 양수는 악화입니다. 기준은 17시 LightGBM, L1은 다중 예보 LightGBM, Cat은 CatBoost입니다.
| 고정 평균 | 2월 W | L1 대비 | 개선 일수 |
|---|
쌍은 절반씩, 셋은 1/3씩인 네 조합을 분석 전에 고정했습니다. 2월 비율 튜닝이나 새 학습은 하지 않았고 기존 L1과 참조 배분을 유지합니다. 이미 탐색한 개발 구간이므로 독립 검증이 아닙니다.
원자료 감사
검증 이력입니다. 원본을 다시 읽지 않은 갱신은 새 무결성 검사로 간주하지 않습니다.
월별 전체 관측 비율
미관측 발전량을 0으로 채우지 않습니다. 눈, 음영, 고장으로 보이는 저출력도 실제 목표값일 수 있어 일괄 삭제하지 않습니다.
겨울과 봄의 시계열 분할입니다. 현재 완료 모델은 겨울 분할만 있습니다. 여름의 253개소 완전 관측이 없어 연간 일반화는 확인되지 않았습니다.
Train / Valid 학습 곡선
발전소별 용량 정규화 MAE입니다. Valid는 12월 조기 종료 구간이며 2월 정산 W와 다릅니다. 모델마다 가중치가 달라 곡선 높이로 모델 순위를 정하지 않습니다.
실험과 판단
같은 검증 구간끼리 비교합니다. 단일 구간의 개선은 잠정 결과이며 자동 승격하지 않습니다.
| 실험 | 상태 / 구간 | 참조 배분 W | 탐색 배분 W | 판단 |
|---|
기대, 실제 결과, 다음 결정
너비 탐색 계획
여러 방법을 선별한 뒤 깊이 검증계획은 실행 완료와 구분합니다. 각 계열의 소수 후보를 같은 시계열 검증으로 비교하고, 무거운 연산은 순차 큐 하나로 처리합니다.
가설별 배경과 제한
체크리스트
실행 환경
HeXA와 공유자원 측정 시각 확인 중
Windows 여유 RAM 24 GiB와 커밋 여유 20%를 모두 검사합니다. 임계값 초과 시 이 연구의 작업만 안전하게 중단합니다. 감시만으로 호스트 재부팅 방지를 보장할 수는 없습니다.