비용 후 기대 R·PF·OOS가 강한 매매 전략을 스스로 탐색하는 AI입니다. 전략 60개가 경쟁하고 교배·변이하며 고정 forward paper 증거를 따로 쌓습니다. fitness v4는 승률을 보상하지 않고, 최고 1건을 빼도 남는 기대값·1.5배 비용 stress·종목 하나씩 제외한 결과를 함께 봅니다.
🔄 작동 순서
① 진화 (새 확정봉 12개마다): 전략 60개를 3,000봉 train/OOS로 시험 → 예상 왕복비용 0.25R 초과 진입 제외 → 비용 후 강건성을 통과한 후보를 우선해 교배·변이
② 고정 cohort (5분마다): offline 기준을 통과한 후보만 기본 24회 동안 고정해 paper에서 분할익절+트레일링을 forward 검증합니다. 24건·순손익 양수·PF 1.1은 forwardEligible 연구 화면 통과일 뿐 실투자 적격이 아닙니다. 8연속 손실이면 조기 실패하며, 0건으로 24시간이 지나면 성과 실패가 아닌 미결론으로 교체합니다.
③ 시장국면 (6시간마다): AI(gpt-5.4-mini)가 추세장/횡보장을 판단해 진화 방향에 힌트 제공
④ 격리 출구 A/B: 같은 진입·ATR·hard SL에서 baseline과 고정 challenger 2개를 따로 재생합니다. 결과는 본 paper 손익·cohort·fitness를 바꾸지 않습니다.
🏷️ 화면 용어
· DEMO = OKX simulated-trading 자율실행(전략 신호 시 실제 데모 주문), DEMO-PAPER = 격리 paper 연구, LIVE = 실계좌 연결 상태입니다. 실계좌 신규주문만 코드 수준에서 잠금 상태입니다.
· 주체 열의 AI 활성 전략 = 이 시스템 소유 장부와 같은 종목·방향, AI+종료 전략 잔존 = 같은 계좌 포지션에 종료 전략 수량도 섞임, 종료 전략 잔존 = Conway 계열 서비스 종료 뒤 caretaker가 보호·정리하는 포지션입니다. 계좌 합산 미실현손익을 AI 단독 손익으로 보지 않습니다.
· 챔피언 비용 후 기대값 = 현재 1등 전략의 백테스트 거래당 평균 net-R입니다. 승률은 fitness 보상이 아닌 진단값으로만 함께 표시합니다.
· 세대 = 서로 다른 새 확정봉 묶음으로 진화를 평가한 횟수
🚦 연구 게이트
기존 50건·승률·누적손익 게이트와 24건 forward 화면은 연구 상태를 보여줄 뿐이며 DEMO 자율실행을 막지 않습니다. liveReady는 독립 shadow 100건/30일, 통계 하한·1.5배 비용 stress·coverage, demo 50건, 실행 안전·전용 서브계정과 사용자 명시 승인을 모두 요구하는 LIVE 전용 승격 기준입니다. 통과하더라도 실계좌 잠금은 자동 해제되지 않습니다.
고정 5종목(BTC/ETH/SOL/XRP/DOGE 선물)을 상시 감시하다가, 조건이 맞는 종목만 잡는 방식입니다 — 낚싯대 5개를 걸쳐두는 것과 같습니다.
5분마다: 종목별로 5성분 신호(EMA 교차·RSI·볼린저·MACD·k-NN 유사사례)에 고정 연구 후보의 가중치를 곱해 점수 합산 → 임계값을 넘으면 롱, 반대면 숏 paper 후보가 됩니다. 동시 최대 3종목이며, 1회 위험은 기본 자본의 0.15%를 목표로 하되 증거금은 최대 10%를 넘지 않게 축소합니다.
종목을 고정한 이유는 같은 문제에서 세대 성적을 비교하기 위해서입니다. XRP·DOGE는 지역 제한으로 DEMO 주문이 거절될 수 있으며, 공유계좌의 종료 전략 잔존 포지션이 같은 종목을 점유하면 소유권 충돌 방지를 위해 해당 진입만 회피합니다.
유전자 = 매매 규칙표(레시피)의 숫자들, 챔피언 = 60개 레시피 중 시험 성적 1등입니다.
라면 레시피 60개("물 500ml 3분" vs "물 450ml 4분30초"...)를 다 끓여보고 제일 맛있는 게 우승하는 것과 같습니다. 매매에서 이 숫자들은 "언제 사고(rsiBuy), 얼마에 도망가고(slAtr), 얼마를 분할익절하고 trailing할지" 등 현재 23개 항목입니다.
예: rsiBuy=41 → "RSI 41 이하면 싸다고 판단", slAtr=2.8 → "최초 hard stop은 2.8 ATR 거리", tp1R=1.0 / tp1Fraction=0.5 → "+1R에서 절반 분할익절", trailActivateR=1.25 / trailDistanceAtr=1.0 → "+1.25R부터 잔여 물량을 고점·저점에서 1 ATR 거리로 추적", adxMin=23 → "애매한 횡보장엔 안 들어감"입니다. tpAtr은 adaptive 출구정책 v2의 일반 행동 유전자가 아니라 분할 불가 소량의 legacy 출구 폴백에서만 사용합니다.
이 숫자들은 진화가 탐색합니다. 현재 v4 모델과 호환되는 챔피언은 OKX DEMO에서 자율 실행되고, 같은 후보의 고정 paper cohort는 별도 장부에서 forward 성과를 분리 검증합니다.
1시간마다 5단계 세대교체:
① 시험 — 60개 전략이 동일한 5종목 데이터로 v4 학습/OOS 시험을 봅니다. 승률은 fitness 가중치가 0이며, 비용 후 기대 R·합산 PF·최고 1건 제거·1.5배 비용 stress·하방 꼬리·R 낙폭을 평가합니다.
② 전진검증 — offline/OOS 기준을 통과한 후보의 유전자를 기본 24개 paper episode 동안 고정합니다. 순손익 양수·PF 1.1 이상은 forwardEligible 연구 화면 통과이며, 배포·실투자 적격이 아닙니다. 8연속 손실은 조기 실패하고 0건 24시간은 미결론으로 교체합니다.
③ 생존 — 상위 10%(6개)는 무조건 다음 세대로 보존 (좋은 전략이 사고로 사라지는 것 방지).
④ 번식 — 나머지 54자리: 교배 55%(성적 좋은 부모 둘의 유전자를 반반 섞음) + 돌연변이 35%(잘하는 놈을 복제해 숫자 몇 개만 살짝 비틈) + 신규 이민 10%(완전 무작위 신인 — 근친교배 방지).
⑤ AI 보정 — 6시간마다 AI가 시장국면(추세/횡보/하락)을 진단해 제한된 범위의 선발 편향만 줍니다. AI가 주문을 임의로 내거나 검증 기준을 바꾸지는 않습니다.
핵심: 세대 숫자 증가는 발전의 증거가 아닙니다. 서로 다른 실행 설정의 성적은 fingerprint로 격리합니다. OKX DEMO 체결은 운영 자가학습에 쓰되 독립 paper forward 승격 증거로 위장할 수 없고, 실제 실계좌 신규진입은 계속 코드에서 잠겨 있습니다.
| 종목 | 신호점수 | 진입기준 | ADX | 판단 | 사유 |
|---|---|---|---|---|---|
| 엔진 사이클 대기... | |||||
| 종목 | 방향 | 계좌 합산 수량 | 계좌 평균가 | 계좌 합산 미실현($) | 계좌 수익률 | 레버리지 | 주체 |
|---|---|---|---|---|---|---|---|
| 실시간 상태 확인 중 | |||||||
| 주체 | 시각 | 종목 | 방향 | 계약 | 기준가 | SL | TP | 세대 |
|---|
| 주체 | 청산시각 | 종목 | 방향 | 진입가 | 청산가 | 손익($) | 손익률 |
|---|
| ID | 세대 | 승률 | 수익% | 거래수 | MDD | 적합도 |
|---|