From 355dc0e989447e7aca99cca4c87f6d52ffea2ea5 Mon Sep 17 00:00:00 2001 From: jmj Date: Mon, 24 Aug 2026 13:48:41 +0900 Subject: [PATCH] =?UTF-8?q?docs:=20LLM=C2=B7=EC=9E=84=EB=B2=A0=EB=94=A9=20?= =?UTF-8?q?=EB=AA=A8=EB=8D=B8=EB=AA=85=20=EB=93=9C=EB=A6=AC=ED=94=84?= =?UTF-8?q?=ED=8A=B8=20=EC=A0=95=EC=A0=95=20+=20preview=20=EB=B3=84?= =?UTF-8?q?=EC=B9=AD=20=EC=9A=B4=EC=98=81=20=EC=A3=BC=EC=9D=98=20=EB=AA=85?= =?UTF-8?q?=EC=8B=9C?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit 같은 설정이 문서 네 곳에서 세 가지 값으로 적혀 있었다. - 실제(settings.py·.env.example·environment.md 카탈로그): gemini-3.1-pro-preview / gemini-3.1-flash-lite - ai/CLAUDE.md §6.2 표: flash 가 "gemini-3.1-flash-lite-preview 후보" - ai/CLAUDE.md §9 예시·environment.md 코드 예시: gemini-3.1-pro / gemini-3.1-flash - §9 예시의 임베딩도 낡음: text-embedding-004/768 (실제 gemini-embedding-001/1536 — pgvector 컬럼이 vector(1536) 이라 이대로 따라 하면 차원 불일치) 전부 실제 기본값으로 정렬했다. 함께, Pro 기본값이 -preview 별칭이라는 운영 주의를 §6.2 에 명시했다 — 게이트웨이가 preview 별칭을 은퇴시키면 Pro 를 쓰는 경로(질문 풀·분석·피드백)가 한꺼번에 죽고, 복구는 .env 의 LLM_PRO_MODEL 한 줄이다. --- ai/CLAUDE.md | 15 ++++++++++----- docs/environment.md | 2 +- 2 files changed, 11 insertions(+), 6 deletions(-) diff --git a/ai/CLAUDE.md b/ai/CLAUDE.md index fa1c18d..432a8ca 100644 --- a/ai/CLAUDE.md +++ b/ai/CLAUDE.md @@ -131,11 +131,16 @@ async def consume_resume_analyze(message: AbstractIncomingMessage) -> None: | 시점 | 모델 (env override 가능) | 용도 | |------|--------------------------|------| | 세션 시작 | Pro (`gemini-3.1-pro-preview` 기본) | 질문 풀 (품질) | -| 세션 중 | Flash (`gemini-3.1-flash-lite-preview` 후보) | 꼬리질문 (저지연 < 3s) | +| 세션 중 | Flash (`gemini-3.1-flash-lite` 기본) | 꼬리질문 (저지연 < 3s) | | 분석 (이력서/레포) | Pro | 마크다운 구조화 | 설정은 `settings.py` + 환경변수로 모델명 주입 (코드에 하드코딩 금지). +> **주의 — Pro 기본값이 `-preview` 별칭이다.** 게이트웨이가 preview 별칭을 은퇴시키면 질문 풀· +> 분석·피드백이 한꺼번에 죽는다(모두 Pro 를 쓴다). 그 경우 `.env` 의 `LLM_PRO_MODEL` 한 줄로 +> 정식 별칭으로 넘어가면 되고 재배포·코드 수정이 필요 없다 — 이 표와 `settings.py` 기본값은 +> "지금 게이트웨이에서 검증된 이름"의 기록이지 유일한 진실이 아니다. + ### 6.3 LangChain 사용 (OpenAI 호환 클라이언트) ```python from langchain_core.prompts import ChatPromptTemplate @@ -217,10 +222,10 @@ class Settings(BaseSettings): s3_bucket_name: str openai_api_key: str = "" google_api_key: str = "" - llm_pro_model: str = "gemini-3.1-pro" - llm_flash_model: str = "gemini-3.1-flash" - embedding_model: str = "text-embedding-004" - embedding_dim: int = 768 + llm_pro_model: str = "gemini-3.1-pro-preview" + llm_flash_model: str = "gemini-3.1-flash-lite" + embedding_model: str = "gemini-embedding-001" + embedding_dim: int = 1536 core_server_base_url: str = "http://core:8080" ``` diff --git a/docs/environment.md b/docs/environment.md index 07da295..e1c7458 100644 --- a/docs/environment.md +++ b/docs/environment.md @@ -265,7 +265,7 @@ public record SecurityProperties( ```python class Settings(BaseSettings): GEMINI_API_KEY: str # required - LLM_PRO_MODEL: str = "gemini-3.1-pro" + LLM_PRO_MODEL: str = "gemini-3.1-pro-preview" model_config = SettingsConfigDict(env_file=".env") ```