Hermes v0.19.0 해설 ④: 새 모델, 추론 강도, 데스크톱과 CLI의 변화
Fireworks AI·DeepInfra·GPT-5.6 등 새 공급자와 모델, max·ultra 추론 단계, 구독 관리와 데스크톱·CLI 개선을 한 번에 정리합니다.
Hermes v0.19.0은 내부 구조만 바꾼 릴리스가 아닙니다. 사용자가 선택할 수 있는 모델과 공급자가 늘었고, 작업별로 추론 깊이를 조절하는 방식과 데스크톱·CLI의 일상적인 조작도 확장됐습니다.
공급자와 최신 모델 선택지가 늘었다
Fireworks AI와 DeepInfra가 정식 공급자로 추가됐습니다. Fireworks AI는 비용 추정과 모델 선택 화면의 가격 표시를 지원합니다. Upstage Solar도 공급자 목록에 합류했습니다.
모델 카탈로그에는 GPT-5.6 Sol·Terra·Luna와 Pro 변형, grok-4.5 정식 버전, moonshotai/kimi-k3, claude-fable-5, claude-sonnet-5, tencent/hy3 등이 반영됐습니다. 로컬 환경에서는 LM Studio 모델을 필요할 때 불러오는 JIT 로딩도 지원합니다.
사용하지 않는 공급자는 enabled: false 또는 excluded_providers 설정으로 모델 선택 화면과 기본 해석 경로에서 숨길 수 있습니다. 선택지가 많아진 만큼 조직이 승인한 공급자만 보이게 정리하면 실수와 비용 예측의 혼란을 줄일 수 있습니다.
추론 깊이는 전역 스위치가 아니라 작업별 다이얼
reasoning effort에 max와 ultra 단계가 추가됐습니다. 지원 범위가 작은 공급자에서는 가능한 수준으로 자동 조정됩니다.
더 중요한 변화는 모델별, 작업별로 추론 강도를 다르게 지정할 수 있다는 점입니다.
- 모델마다 기본 reasoning_effort 덮어쓰기
- 보조 모델 작업별 추론 수준 지정
- Mixture of Agents 프리셋의 슬롯별 추론 수준 지정
- CLI 세션에서 /reasoning으로 현재 세션 수준 변경
- 조언자 출력 길이를 reference_max_tokens로 제한
예를 들어 여러 조언자 모델은 깊게 생각하게 하고, 최종 내용을 합치는 모델은 빠르게 응답하도록 구성할 수 있습니다. 모든 단계에 ultra를 적용하는 것보다 지연과 비용을 관리하기 쉽습니다.
| 작업 유형 | 권장 출발점 | 이유 |
|---|---|---|
| 간단한 분류·형식 변환 | 낮은 추론 강도 | 속도와 비용 우선 |
| 코드 수정·도구 실행 계획 | 중간~높은 강도 | 오류 비용과 검증 필요 |
| 복잡한 설계·다중 제약 분석 | max 또는 ultra 검토 | 깊은 탐색의 가치가 큼 |
| MoA 최종 종합 | 조언자보다 낮게 시작 | 중복 추론 비용 방지 |
실제 최적값은 모델과 업무에 따라 다르므로, 품질·응답 시간·비용을 함께 기록해 조정하는 것이 좋습니다.
터미널 안에서 구독과 충전을 관리한다
/subscription 명령으로 현재 요금제와 남은 사용량을 보고, 업그레이드 비용과 다운그레이드 적용 시점을 미리 확인한 뒤 변경할 수 있습니다. 예약된 변경을 취소하는 기능도 포함됩니다. /topup으로 충전 흐름에 접근할 수 있고, 데스크톱 앱에도 같은 목적의 결제 설정 탭이 생겼습니다.
CLI에는 한 번의 응답에만 다른 모델을 쓰고 자동으로 원래 모델로 돌아오는 /model --once가 추가됐습니다. 여러 슬래시 스킬을 순서대로 쌓아 호출하는 방식도 지원합니다. 예를 들어 두 개의 스킬을 한 요청에 함께 적용하는 작업 흐름을 만들 수 있습니다.
데스크톱 앱은 기능을 찾고 정리하기 쉬워졌다
Skills, Tools, MCP, Hub를 한곳에서 관리하는 Capabilities 페이지가 추가됐습니다. MCP 연결 테스트와 켜기·끄기, 카탈로그 탐색, 유지관리 작업, 로그 필터를 데스크톱에서도 다룰 수 있습니다.
그 밖의 변화도 폭넓습니다.
- 단축키 힌트와 설정 탭
- 워크트리 생성 시 기준 브랜치 선택
- 백그라운드 완료 세션의 읽지 않음 표시
- 프로젝트와 세션별 색상 체계
- 메모리 공급자와 TTS·STT 공급자 설정
- 사용자 정의 모델 엔드포인트
- 예약 작업별 모델 선택
- 화면 배율과 채팅 배경 설정
- /journey로 메모리 그래프 열기
- 데스크톱 코드 전체 TypeScript 전환
웹 대시보드에서는 메모리 공급자 전환, 안전한 세션 가져오기, WhatsApp 연결, 이미지 붙여넣기·드롭, 모바일 OpenAI OAuth 로그인이 개선됐습니다. hermes serve는 웹 UI를 빌드하거나 올리지 않는 진짜 헤드리스 백엔드로 동작합니다.
업데이트 전에 알아둘 호환성 메모
이 릴리스에서 max_async_children은 더 이상 권장되지 않고 통합된 위임 동시성 제한으로 이동했습니다. 사용하지 않는 공급자를 숨기는 설정과 세션 자동 초기화 기본값 변경도 기존 운영 방식을 확인해야 하는 지점입니다.
릴리스 개발 중 들어왔다가 최종판에서 빠진 기능도 있습니다.
- iron-proxy 자격증명 주입형 외부 통신 방화벽
- dynamic-workflow 오케스트레이션 스킬
- memory provider-actions 확장 지점
위 세 기능은 v0.19.0에 포함되지 않았습니다. 반면 플러그인의 pre_tool_call 승인 에스컬레이션은 중간에 되돌려졌다가 다시 반영돼 최종 릴리스에 포함됐습니다.
어떤 순서로 적용할까
- 먼저 기존 프로필, 공급자, 동시성, 세션 초기화 설정을 백업
- 업데이트 후 자주 쓰는 모델과 공급자만 선택 화면에 노출
- 업무별 reasoning effort 기준을 낮음·중간·높음으로 정의
- 데스크톱에서 Capabilities와 MCP 연결 상태 점검
- /subscription에서 요금제와 남은 사용량 확인
- 대표 작업으로 품질·속도·비용 회귀 테스트
Quicksilver 릴리스는 속도, 안전, 신뢰성, 선택지를 동시에 확장한 대규모 업데이트입니다. 모든 새 기능을 한 번에 켜기보다, 팀의 업무 흐름을 기준으로 속도 개선을 먼저 체감하고 권한·비밀정보 정책을 정리한 뒤 모델과 멀티에이전트 구성을 넓혀가는 접근이 안정적입니다.
원문: https://github.com/NousResearch/hermes-agent/releases/tag/v2026.7.20