diff --git a/backend/configs/models.yaml b/backend/configs/models.yaml index 17c7d17..796eecf 100644 --- a/backend/configs/models.yaml +++ b/backend/configs/models.yaml @@ -37,9 +37,12 @@ providers: reasoning: subset timeouts: { attempt_s: 240, max_attempts: 3, backoff_cap_s: 60 } - kimi: # домен сменился: platform.moonshot.ai → 301 → platform.kimi.ai + kimi: # API-хост — api.moonshot.ai (intl, НЕ .cn). Веб-консоль переехала + # platform.moonshot.ai → platform.kimi.ai, но API-эндпоинт остаётся + # api.moonshot.ai: api.kimi.ai НЕ резолвится (DNS fail, live-проба 2026-07-04 + # /models: 000; moonshot.ai → 200 c kimi-k2.6). Прежний base_url был битый. kind: openai - base_url: https://api.kimi.ai/v1 + base_url: https://api.moonshot.ai/v1 api_key_env: KIMI_API_KEY reasoning: subset timeouts: { attempt_s: 240, max_attempts: 3, backoff_cap_s: 60 } diff --git a/docs/PROGRESS.md b/docs/PROGRESS.md index 04bcc62..9566b87 100644 --- a/docs/PROGRESS.md +++ b/docs/PROGRESS.md @@ -314,7 +314,15 @@ keep-alive (Ф1–2), инъекция глоссария (`selective`), пор **Вайринг раннера:** `classifyOutput` = intrinsic `classify` (эхо/пусто/refusal, всегда) → потом coverage-гейт **если** `gates.coverage.enabled`, по РЕЗУЛЬТАТУ каждой стадии против ИСХОДНИКА (ловит вырезание и на draft, и на edit). `excision_suspect` non-retryable (детерминирован per-модель → эскалация, не same-model retry — интент под B). Гейт-конфиг **свёрнут в snapshot** (`coverageSnapshot`, только когда enabled) → флип/твик = громкий `--resnapshot` + бесплатная ре-оценка чанков из чекпоинтов. `CheckRunnable` больше не валит `gates.enabled`; `LoadPipeline` fail-fast на включённом гейте без порогов (тихий no-op против Р7). **Боевой `pipeline-c1.yaml` — opt-in `enabled:false`** (D12 Q4: флип после валидации precision владельцем). Тесты: excision→флаг+skip+exit2+resume-детерминизм, healthy→pass, snapshot-флип→`--resnapshot`, no-thresholds→fail-fast. Всё зелёное `-race`. -Дальше: D (провайдерская домашка — фактчек слагов `/models`) → B (single-hop эскалация) → C (live-conformance). +### 2026-07-04 — Веха 2.5 (D): провайдерская домашка — live `/models`-фактчек + +Живой `GET /models` по 6 провайдерам (бесплатно, без completion; ключи только в `Authorization`, значения не печатались). Слаги эскалации **верифицированы живьём**: DeepSeek `deepseek-v4-flash`+`deepseek-v4-pro` ✓; GLM `glm-5`+`glm-5.1`/`5.2` ✓; xAI `grok-4.20-0309-non-reasoning`+`grok-4.3` ✓; Gemini `gemini-3.1-pro-preview`+`gemini-2.5-flash` ✓ (id с префиксом `models/` — канонизация ответа для `PriceForResponse` при вайринге Gemini, Ф2); OpenAI `gpt-5-mini`+`gpt-5-nano` ✓. + +**⚠️ НАХОДКА (config↔реальность, исправлена):** боевой `models.yaml` держал Kimi `base_url: https://api.kimi.ai/v1` — **`api.kimi.ai` НЕ резолвится** (DNS fail → прокси 502 CONNECT, HTTP 000). Рабочий хост — `https://api.moonshot.ai/v1` (200, `kimi-k2.6` в /models). Комментарий спутал веб-консоль (`platform.kimi.ai`) с API-эндпоинтом (`api.moonshot.ai`). Kimi — текущая заглушка эскалации → на реальном хопе упало бы. Исправлено на `api.moonshot.ai/v1`. + +`reasoning_content`-vs-`content`, cache-поля, `content_filter`-эмиссия требуют **платного** completion → не гоняю здесь; проверит live-conformance харнесс (C) при ручном прогоне оператором. Код уже корректен по докам (`httpllm.go` читает `content`, парсит оба cache-варианта DeepSeek). + +Дальше: B (single-hop эскалация) → C (live-conformance). ## Полигон (секция параллельной сессии — записи добавлять сюда)