Toto je starší verze dokumentu!


Automatická kompaktace a kontextové okno v Codex CLI

Vytvořeno: 28.7.2026 | Aktualizováno: 28.07.2026 10:19

Codex CLI při dlouhé práci automaticky zkracuje historii konverzace. Tento zápisek zachycuje řízený test přes ChatGPT OAuth, který ověřil praktický práh kompaktace pro GPT-5.6 Luna a to, jak se tato událost projevuje uživateli.

Codex provedl automatickou kompaktaci ještě před odesláním dalšího velkého požadavku. Stalo se to i po jednorázovém nastavení model_auto_compact_token_limit=1000000, takže tato volba není vypínač kompaktace.

V testovaném neinteraktivním režimu Codex uživatele na kompaktaci neupozornil: na standardní výstup vrátil pouze OK. Událost context_compacted byla dohledatelná až ve strojovém transcriptu JSONL.

Pro práci, která vyžaduje zachování doslovné celé historie, proto nelze předpokládat, že Codex CLI ponechá kontext beze změny až do maximálního kontextového okna.

Test běžel přes ChatGPT OAuth, nikoli přes API klíč, s těmito parametry:

  • model gpt-5.6-luna,
  • reasoning low,
  • nová čistá session,
  • jednorázově nastavený práh model_auto_compact_token_limit=1000000.

Modelový katalog doručený Codexu pro tento účet uváděl metadata context_window: 272000 a effective_context_window_percent: 95. Codex proto v transcriptu hlásil provozní okno model_context_window: 258400 tokenů.

Dva velké požadavky prošly bez kompaktace:

  • přibližně 214 938 vstupních tokenů,
  • přibližně 252 983 vstupních tokenů.

Při dalším rozšíření kontextu Codex před odesláním dalšího požadavku vytvořil v transcriptu událost:

{
  "type": "context_compacted"
}

Praktický práh pro tento běh byl tedy přibližně 258 400 tokenů. Test neurčil nejvyšší velikost požadavku, kterou by ještě přijal backend: Codex historii zkompaktoval dřív, než bylo možné odeslat větší nezkrácený požadavek.

V neinteraktivním režimu Codexu s JSON výstupem se kompaktace neobjevila jako běžné uživatelské sdělení. Její výskyt byl potvrzen pouze v uloženém rollout JSONL jako context_compacted.

Toto zjištění se vztahuje k testovanému neinteraktivnímu běhu. Chování TUI nebylo v tomto testu ověřeno, proto z něj nelze vyvozovat, zda interaktivní rozhraní událost zobrazuje jinak.

model_auto_compact_token_limit nastavuje práh, ne zákaz automatické kompaktace. Aktuální implementace Codexu podle zdrojového kódu OpenAI Codex omezuje nakonfigurovanou hodnotu na kontextový limit modelu. Vyšší hodnota proto nemůže zajistit zachování nezkrácené historie.

V testu neexistoval podporovaný boolean typu disable_auto_compaction. Nastavení hodnoty 0 by podle ověřeného chování neznamenalo vypnutí, ale okamžitou kompaktaci.

  • Při dlouhé relaci se může kontext změnit bez viditelného upozornění v neinteraktivním JSON výstupu Codexu.
  • Hodnotu kontextového okna nelze chápat jako garantovanou kapacitu pro jednu nezkrácenou historii.
  • Pokud je nutné rozhodovat o kompaktaci výhradně ručně, Codex CLI k tomu v testované konfiguraci neposkytl podporovaný vypínač automatické kompaktace.
  • Pro reprodukovatelné workflow je vhodné před kritickým bodem uložit důležité závěry mimo konverzaci, například do souboru v repozitáři nebo samostatného zápisku.
  • ai/platformy/codex/autokompakce-a-kontextove-okno.1785226769.txt.gz
  • Poslední úprava: 28.07.2026 10:19
  • autor: Petr Nosek