2026-08-21 (금) — 오늘의 작업 요약
오늘은 두 가지 큰 작업에 집중했다: 오전의 Hermes 에이전트 신규 스킬 탐색, 그리고 저녁의 VPC Grafana 파이프라인 디버깅이다.
1. Hermes 에이전트 신규 스킬 탐색 (09:35 KST)
오전에 “hermes update” 세션을 열어 커뮤니티에서 주목받는 신규 스킬 4개를 조사했다. PONYTAIL은 과잉 설계 방지용 “게으른 시니어 개발자” 모드, GRAPHIFY는 코드베이스 지식 그래프 구축, HEADROOM은 도구 출력 압축으로 토큰 60~95% 절감, DESIGN TASTE는 AI 생성 UI의 범용적 룩을 방지하는 프론트엔드 스킬이다. 이 중 HEADROOM이 토큰 비용 절감에 가장 직접적이라 향후 적용을 검토할 예정이다. 76개 메시지가 오간 긴 세션이었다.
2. VPC Grafana 파이프라인 디버깅 (19:20 KST)
“그라파나 파이프라인이 지연되고 있다”는 피드백을 받고 본격 디버깅에 착수했다. Grafana API로 7개 시계열 테이블(30분·1시간·24시간 집계, 일별 요약, 알림 로그, 센서 이탈 분석 등)의 신선도를 쿼리했으나 **전부 “데이터 없음”**이었다. PostgreSQL 직접 접속으로 확인하니 테이블은 17개 존재하고 연결도 정상이었다. 문제는 Grafana의 PostgreSQL 데이터소스 인증 불일치 — .env의 DB 계정 정보와 실제 데이터베이스 사용자 자격증명이 달랐던 것이다.
SSH로 VPC에 접속해 해당 사용자의 비밀번호를 재설정했고, 이후 predict_alert(Chronos 예측 모델)와 sensor_drift(센서 이탈 분석) 크론을 수동 실행했다. predict_alert는 모델 로딩(272개 가중치) 시간 타임아웃으로 백그라운드 재실행했다. 최종 확인 결과 알림 로그가 10:31 UTC에 갱신되어 총 4,443건으로 기록되었다. OMNION 크론의 jobs.json이 비어있어 시스템 잡이 멈춰있었는데, 서비스 재시작으로 잡이 재등록되어 sensor_drift는 348분 후, validate_predictions는 228분 후 자동 실행 예정으로 복구되었다.
이 세션은 총 146개 메시지를 기록한 오늘의 가장 치열한 작업이었다.
3. 크론 파이프라인 정상 가동 — 39건 전부 성공
오늘 실행된 Hermes 크론 39건이 모두 “ok” 상태를 기록했다. 해양 뉴스, 수산물 시장 동향, 학술 피드, 수산물 환경 데이터, 블로그 자동 발행, RFP 수집, 의사결정 브리프 등이 빠짐없이 동작했다. Evening Wrap 파이프라인은 GitHub 트렌딩 17건, HackerNews 30건, Product Hunt 20건 등 총 100건 이상의 데이터를 수집했다.
4. 블로그 발행 — 포스트 2건
- 알구몬 핫딜 포스트: 가젯 핫딜 정보 자동 수집 → 블로그 발행
- Featured 인사이트: “자가진단이 실행을 대체할 때” — thinking-loop가 매일 “실행 공백”을 진단하면서도 정작 그 공백을 메우지 못하는 자기반복 문제를 분석한 글. Decision Registry D1~D10, flipside 57개 등이 쌓였는데도 건강도 대시보드는 16개 프로젝트 전부 0%라는 아이러니를 짚었다.
교훈
오늘 가장 값진 교훈은 **“인증 정보 불일치가 전체 파이프라인을 마비시킨다”**는 것이다. .env 파일의 DB 자격증명과 실제 데이터베이스 사용자 자격증명이 다른 상태로 오래 방치되어 있었고, 이로 인해 Grafana 대시보드 전체가 “데이터 없음”으로 보이는 상황이 발생했다. 시스템은 정상인데 측정만 깨지는 이 패턴은 자가진단 시스템이iction을 놓치는 전형적인 사례이기도 하다. 앞으로는 .env 자격증명 정기 검증 크론을 추가하는 것이 좋겠다.