연구의 엄격함이 해자입니다. 하나의 승률 숫자가 아니라.
대부분의 AI 트레이딩 제품은 '왜 당신의 숫자를 믿어야 하나요?'라는 질문에 근사한 숫자 하나로 답합니다. 저희는 검증 과정 자체를 공개하고, 누구나 다시 확인할 수 있게 함으로써 답합니다.
신호에서 추천까지 — 의사결정 파이프라인
실선 = 실제로 프로덕션에서 실행 중, 검증 가능. 점선 = 로드맵, 아직 구축되지 않음 — 둘을 혼동하지 않도록 명확히 표시.
신호 푸시가 아니라 고정된 크론 스케줄 — 매시간 자동으로 모든 자산을 재분석합니다.
scheduler.py:533-539 — CronTrigger(minute=5), tasks.py:724 — run_brain_hourly_analysis()
매크로 컨텍스트(FRED, DXY, 선행지표)는 조건 없이 모든 분석에 반영됩니다. 순매수/순매도 포지션(COT)은 현재 금속, 에너지, 농산물에만 적용되며 — 베트남 주식은 아직 이 분기가 없습니다.
reasoning_engine.py:415-443 (COT), :449-493 (macro)
COT/기관 포지셔닝을 베트남 주식 분기에 연결 — 현재 금속/에너지/농산물만 있으며, 이는 실제 공백이지 이미 완료된 작업이 아닙니다.
2026-08-04부터 금과 은의 시간별 분석은 추천을 기록하기 전에 자동화된 토론 라운드(한쪽은 상승 논거, 한쪽은 하락 논거, 한쪽은 판정)를 거칩니다. 2026-08-08부터는 Brain AI 신호(VIP 텔레그램으로 전송되는 Entry/SL/TP)도 발송 전에 동일한 토론 라운드를 거칩니다 — 그 이전에는 그렇지 않았고, 이 페이지도 예전에는 그렇게 기재했습니다. 심판이 신호 방향과 반대로 기운 경우에도 우리는 신호를 그대로 발송하되 메시지 맨 앞에 'CONTRARIAN(역방향)' 표시를 붙여 판단은 사용자에게 맡깁니다. 토론 라운드가 실행되지 못한 경우(모든 모델 제공사가 응답하지 않는 경우) 신호는 여전히 발송되지만 'NOT DEBATED(미토론)' 라벨이 붙습니다 — 텔레그램과 /signals 페이지 카드 모두에 표시되며, 신호를 조용히 누락하지도, 그 단계가 실행되지 않았다는 사실을 숨기지도 않습니다. 지연 시간에 대해 솔직히 말하면: 신호는 패널이 끝난 뒤에야 시스템을 떠나므로 탐지 시점보다 늦게 도착합니다 — 평소에는 몇 초지만, 무료 모델 한도가 소진되어 유료 모델로 전환해야 할 때는 최대 ~46초까지 측정되었습니다(2026-08-16 프로덕션 측정: 세 좌석에서 10.7초 + 9.2초 + 25.9초). 우리는 더 빨리 보내기 위해 토론 라운드를 줄이기보다 충분히 기다리는 쪽을 선택합니다. 베트남 주식과 다른 자산은 아직 이 단계가 없습니다.
tasks.py::_run_ssm_debate_gate (ADI-1649, ADI-1754) + reasoning_engine.py:341-344 — DebateEngine
현재 주간 뉴스레터를 게이팅하는 동일한 4인 메커니즘(Groq/Gemini/DeepSeek/OpenAI)을 재사용 — 시간별 파이프라인에 연결하여 주간 뉴스레터뿐 아니라 금/은뿐 아니라 모든 추천이 발표 전에 토론을 거치도록 합니다.
panel_debate.py — 메커니즘은 이미 존재; 2026-08-16(ADR-0014 slice 2b)부터 brain_confluence_webhook.py(베트남 주식을 포함한 다중 자산 컨플루언스 신호)도 게이팅합니다 — 더 이상 metals_week_ahead_runner.py에만 국한되지 않습니다. 3단계의 시간별 Entry/SL/TP 분기는 여전히 별도의 DebateEngine을 사용하며 아직 panel_debate를 거치지 않습니다.
추천은 저장되고, 타임스탬프가 찍히며, 공개 채점 루프에 포함됩니다.
prediction_service.py:50 — create_prediction()
2b, 3b 단계는 로드맵이며 아직 구축되지 않았습니다 — 실제 완료된 것이 아니라 진짜 방향이기 때문에 명시합니다. 전체 코드 추적: docs/product/business/RIGOR-AS-PROOF-ROADMAP.md §8 (baselify-brain). 2026-08-27 기준 실제 코드와 재대조함.
신뢰도는 어떻게 측정되는가
Brain의 모든 추천에는 신뢰도 라벨이 붙습니다. 라벨은 실제 결과와 맞을 때만 신뢰할 가치가 있으므로, Brain은 종료된 신호를 라벨별로 다시 집계해 여기에 공개합니다.
최근 사례
누구도 복제할 수 없는 데이터 자산
가격 신호가 아니라 '결정' 흐름입니다 — 결과를 알기 전에, 특정 논거에 동의하는지 아닌지를 먼저 기록합니다.
신호가 아니라 반응을 기록합니다
/signals 페이지의 모든 추천에는 동의 / 아니오 / 더 물어보기, 3가지 선택지가 있습니다. '동의' 또는 '아니오'를 누르면 해당 신호에 연결된 결정 한 줄(brain_signal_portfolio_decisions 테이블)이 기록됩니다 — 누르는 시점에는 그 신호가 맞았는지 틀렸는지 아직 알 수 없습니다. 두 번째 흐름인 추적 '진입' / '보류'(brain_signal_user_tracks 테이블)는 대조할 보유 비중이 없을 때도 반응을 기록합니다. 신호가 종료되어 실제 결과가 나오면, 두 흐름 모두 그 결과와 대조됩니다.
증권사 주문 흐름 데이터로는 재현할 수 없는 이유
주문 흐름은 당신이 무엇을 거래했는지만 보여줍니다. 그 거래 뒤에 있는 특정 논거를 실제로 믿었는지는 알려주지 않으며, 결과를 알기 전에 잠긴 '바로 이 이유에 동의/비동의' 기록을 사후에 재구성할 방법도 없습니다. 이 데이터는 추천이 나오는 바로 그 순간에 정확한 질문을 던지고, 결과를 안 뒤에는 수정할 수 없게 추가 전용(append-only)으로 기록해야만 존재합니다. 이미 지나간 역사는 누구도 베낄 수 없습니다.
원시 카운트
아직 공개할 만큼 표본이 충분하지 않습니다 — 측정 전에 정한 기준: 결과가 확정된 건수 최소 30건, 각 분기(동의 / 비동의 / 더 물어보기 / 추적-진입 / 추적-보류) 최소 10건. 오해를 피하기 위해 작거나 오래된 숫자는 표시하지 않습니다.
실제 화면 보기
예시 화면이며 데이터는 고정되어 있습니다 — 이 페이지는 로그인하지 않은 방문자용이라 대조할 실제 포트폴리오가 없습니다. 실제 작동 버전은 로그인한 사용자에게 /signals에서 제공됩니다.
포트폴리오 제안
예시 화면내 돈에 미치는 영향
손절가에 도달하면
≈ 포지션의 2.4%
이는 포지션 규모에서 손절가까지의 산술 계산이며, 수익 예측이 아닙니다.
닫힌 루프: 스스로 오류 발견 → 스스로 수정 → 재검증 일정
2026년 7월 28일, 코드 레벨 감사(단순 화면 확인이 아님)에서 기관 포지셔닝 데이터의 CRITICAL 버그 1건을 발견 — COT 컬럼이 잘못된 CFTC 보고서 유형을 읽어 수치가 약 2배 벗어남 — 그 외 HIGH 등급 버그 몇 건도 함께.
발견
4회의 적대적 감사 세션이 수집기 코드 전체를 검토하며, 실시간 데이터를 외부 CFTC/BlackRock/COMEX/Yahoo 소스와 대조했습니다.
수정 완료 — 8/8
DINTG(5개 티켓) + CHRD(3개 티켓) — 모두 Done, 공통 어댑터로의 리팩터링과 엄격한 테스트 스위트 포함.
다중 모델 적대적 검토 — 데모가 아닌 실제 운영
4인 토론 게이트
모든 주간 시장 뉴스레터는 발표 전에 Groq(약세론) / Gemini(누락 요인) / DeepSeek(단기 vs 장기) / OpenAI(판정)를 거칩니다. 선택적 조언이 아닌 하드 실패 게이트입니다.
War Room — Copilot
표본이 충분하지 않을 때는 무언가를 보여주기 위해 추측하는 대신 확률 출력을 거부하도록 설계되었습니다. 프로덕션에서 실행 중입니다.
두 시스템 모두 실제 운영 장애(모델 제공업체가 중간에 다운되는 등)를 겪었고, 이를 투명하게 처리하고 기록했습니다 — 살아있는 시스템이라는 증거입니다.
2026년 6월, 기존 방식이 회사가 스스로 설정한 '엣지' 검정을 통과하지 못한 후, 경영진은 내부적으로 다음을 금지했습니다: 공개 채널 어디에도 '승률 X%', 'Sharpe > X', '시장을 이긴다'는 표현을 사용하지 않는 것 — 마케팅에 유리하더라도 예외 없이. 강요받기 전에 스스로 이런 정책을 채택하는 리테일 핀테크는 매우 드뭅니다.
현재 진행 중인 연구
아직 제품이 아닙니다 — 처음부터 명확히 밝힙니다.
측정 기준은 2026-08-02에 고정되었으며 아직 결과가 없습니다. 현재 방향: 수렴하는 증거를 이진 신호 필터가 아니라 포지션 크기를 점진적으로 조정하는 데 사용 — 기존 방식(이진 AND 게이트)이 내부 통계적 증거로 스스로 종료된 후 얻은 교훈입니다.
여기에 다른 항목은 의도적으로 나열하지 않습니다. 실제 데이터가 뒷받침하지 않는 기능은 이름이 아무리 매력적이어도 이 문서에 등장하지 않습니다.
데이터 출처: HYPOTHESIS-REGISTRY.md (§1.1 기준 재계산, 2회 검증, 2026-08-21 업데이트) · RIGOR-AS-PROOF-ROADMAP.md §7.1/§7.2/§8 · Linear ADI-90.