판단을 기록하고,
엣지를 축적한다.
Hermes는 충분히 큰 분석 시스템이 됐습니다. 현재의 과제는 기능을 더 만드는 것이 아니라 수집·판단·채점·학습·사용자 가치의 연결을 끝까지 닫는 것입니다.
층별 완성도
단일 점수보다 어디가 강하고 어디서 루프가 끊기는지 봅니다.
북극성으로 가는 네 개 층
감사 추정 범위지금 가장 중요한 해석
판정외부 소스, RAG, 이벤트, 시장 상태와 다수 분석 렌즈가 실제로 작동합니다.
만든 결과가 정식 소비자에게 연결되고 결과와 매칭되어 점수가 되는 비율이 낮습니다.
모델 한도 문구도 정상 결과로 기록될 수 있어 공통 4상태 계약이 필요합니다.
북극성 루프의 현재 신호
Clone scoring
7,187건Shadow paper
2,944 intents2,875건이 riskwarden_not_wired. 현재 건수는 성능 표본으로 볼 수 없습니다.
Knowledge state
당일 기준18개 프로젝트 완성도
설계 1 → 코드 2 → 배선 3 → 안정 운영 4 → 효과 검증 5
자동화와 모델 의존도
스케줄러 작업과 스크립트 내부 모델 호출은 별도 층입니다.
Cron fleet
124 total에이전트 프롬프트가 없지만 내부에서 LLM을 호출하는 스크립트도 존재합니다.
기존 Claude 주모델을 유지하고, 실제 오류·429·인증 실패 시 ChatGPT OAuth의 GPT-5.6 Sol로 자동 강등합니다.
최근 7일 프로덕션 LLM
913 calls · 4.930M est. tokensSol → Claude → 로컬 순서, private payload 외부 0회, 반복 한도 장애 최대 24시간 냉각, 뒤 단 시간예산 예약을 코드와 82개 회귀 테스트에 고정했습니다. 공개 카나리는 gpt-5.6-sol·medium에서 CANARY_OK를 반환했습니다.
권장 모델 배치
공개 고난도 분석
SOL FIRSTmedium·기본 작성
구독 정상 시 2단·로컬 최후단
대량 분류·추출
LOCAL대량·반복·비용 민감
어려운 예외만
개인 포트폴리오
LOCAL ONLY원문·개인 수치
외부 전송 금지
자동화의 전역 xhigh 상속과 Claude 개인정보 예외는 해소했습니다. 전체 scripts 테스트는 4,062 passed·0 failed이며, 날짜 고정 fixture·source 분리 집계·pytest 재시도 상태 격리·gateway 단일 keeper 잠금도 수리했습니다. Claude 호출 수 경고선은 실제 토큰 SSOT가 아니므로 Sol까지 가능한 작업을 전역 중단하지 않고, 실제 한도 응답 때만 Claude circuit을 열어 fallback합니다. NVIDIA API 연동과 과거 실호출 성공 이력을 재확인했고, 기존 전용 보안 파일을 사용하는 공개 자동화의 최종 외부 fallback으로 활성화했습니다. 실카나리에서는 DeepSeek V4 Flash의 HTTP 529를 GPT-OSS 120B로 자동 전환해 정상 응답을 받았습니다. 다만 지정 문구 형식은 정확히 지키지 않아 연결 성공과 출력 품질은 분리 평가합니다. Kimi는 품질 검증 전 opt-in 후보입니다. 남은 운영 과제는 Qwen 상시 health와 USD 비용 원장입니다.
기능 흐름
약한 연결은 amber로 표시했습니다.
외부 소스
SaveTicker · 증권사 · 공공기관 · Fed · X · 가격 · 이벤트 · 위키
수집·계약
collectors · source contract · archive · probe
정규화 상태
world · portfolio · event · market packet · RAG
분석·판단
market_lens · dossier · committee · risk · backtest
원장·채점
claims · clone score · DR · shadow · outcome mapping
학습·사용
scorecard · memory attribution · Telegram · 유용성 환류
물리 디렉터리
지휘·운영
PROJECT_CANON_20260728.mdGOALS.mdconfig.yamlcron/jobs.jsonstate/수집·진입점
scripts/scripts/*collect*scripts/source_contract_probe.pyscripts/*_cron.py분석·검증
market_lens/market_lens/analyze/market_lens/backtest/harness/기억·전달
rag/wiki_mirror/x_distill/world_designers/pine/ · skills/코드 구조의 부채
경로 결합
334 files프로덕션 파일 334개가 sys.path를 직접 변경하고, 40개가 홈/Hermes 경로를 하드코딩합니다.
예외 관측성
1,430 catches광범위한 except Exception과 약 120개 무음 pass가 실패 신호를 잃을 가능성을 키웁니다.
런타임 경계
26 GB공용 venv, nested Git, 상태·백업·런타임이 가까이 얽혀 업데이트 영향 범위가 큽니다.
코드·운영 발견사항
실패 시나리오가 실제 사용자 판단을 왜곡할 가능성 기준입니다.
활성 cron 오류 11개
다음 개발 순서
새 렌즈보다 거짓 정상 제거와 측정 루프 연결을 우선합니다.
거짓 정상 제거
- quota/auth 응답을 실패로 분류
- 회귀 timeout과 rebaseline fail-closed
- 실행·생성·검증·전달 4상태 공통화
북극성 루프 닫기
- Goal B HOLD 조건 해소
- clone unscorable 상위 원인 제거
- RiskWarden 계약 후 Shadow 재개
운영 병목 해소
- market_lens checkpoint·timeout 분해
- Fact sync 경로 수정
- 기술 리포트 JSON 계약 강화
- cron range parser 확장
구조 정리
- SYSTEM_MAP 자동 생성
- 패키지·의존성 경계 확립
- nested Git·백업 보존 정책
- 읽음·유용성 최소 계측
완료 정의
Definition of done실행·생성·검증·전달을 분리하고, 판단은 결과와 연결되어 채점되며, 사용자가 실제로 쓴 것만 가치로 셉니다.