| Obě strany předchozí revize Předchozí verze Následující verze | Předchozí verze |
| ai:platformy:codex:autokompakce-a-kontextove-okno [28.07.2026 10:19] – Upřesněna viditelnost kompaktace v JSON režimu Petr Nosek | ai:platformy:codex:autokompakce-a-kontextove-okno [28.07.2026 10:55] (aktuální) – Vymezeno srovnání předplatných a výslovně vyloučeno API Petr Nosek |
|---|
| ====== Automatická kompaktace a kontextové okno v Codex CLI ====== | ====== Automatická kompaktace a kontextové okno Codex CLI přes předplatné ====== |
| |
| //Vytvořeno: **28.7.2026** | Aktualizováno: **~~LASTMOD~~**// | //Vytvořeno: **28.7.2026** | Aktualizováno: **~~LASTMOD~~**// |
| |
| [[https://developers.openai.com/codex/quickstart?setup=cli|Codex CLI]] při dlouhé práci automaticky zkracuje historii konverzace. Tento zápisek zachycuje [[https://opencode.e-nosek.cz/L2hvbWUvYWl3b3JrL3NjcmF0Y2g/session/ses_05880d56cffeCxn2QzVW0phIb8|řízený test přes ChatGPT OAuth]], který ověřil praktický práh kompaktace pro GPT-5.6 Luna a to, jak se tato událost projevuje uživateli. | [[https://developers.openai.com/codex/quickstart?setup=cli|Codex CLI]] při dlouhé práci automaticky zkracuje historii konverzace. Tento zápisek vychází z [[https://opencode.e-nosek.cz/L2hvbWUvYWl3b3JrL3NjcmF0Y2g/session/ses_05880d56cffeCxn2QzVW0phIb8|řízených testů přes ChatGPT OAuth]] a srovnává dostupný nezkrácený kontext v používaných coding agentech. |
| | |
| | > **Rozsah zjištění:** Článek se týká výhradně používání přes **předplatná**: ChatGPT OAuth v Codexu a aktuálně používaného předplatného v Claude Code. **OpenAI ani Anthropic API nebylo testováno.** API může mít jiné limity, zejména pro GPT-5.6 v Codexu z toho nelze vyvozovat žádný API limit. |
| |
| ===== Shrnutí ===== | ===== Shrnutí ===== |
| |
| Codex provedl automatickou kompaktaci ještě před odesláním dalšího velkého požadavku. Stalo se to i po jednorázovém nastavení ''model_auto_compact_token_limit=1000000'', takže tato volba není vypínač kompaktace. | Hlavní praktický rozdíl není jen způsob ovládání kompaktace, ale dostupná velikost nezkráceného kontextu přes předplatné: |
| |
| V testovaném neinteraktivním režimu Codex uživatele na kompaktaci neupozornil: na standardní výstup vrátil pouze ''OK''. Událost ''context_compacted'' byla dohledatelná až ve strojovém transcriptu JSONL. | * aktuálně používaný Claude Code bez automatické kompaktace: **1 000 000 tokenů**; |
| | * testovaný Codex CLI přes ChatGPT OAuth: automatický provozní práh **258 400 tokenů**. |
| |
| Pro práci, která vyžaduje zachování doslovné celé historie, proto nelze předpokládat, že Codex CLI ponechá kontext beze změny až do maximálního kontextového okna. | Claude Code tedy v tomto srovnání udrží přibližně **3,9× více** původní historie. Codex vyžaduje rozhodnutí o kompaktaci, změně kontextu nebo rozdělení úlohy přibližně o 741 600 tokenů dříve. |
| |
| ===== Rozsah testu ===== | Oba nástroje nakonec narazí na fyzický limit svého kontextového okna. Nelze současně zachovat celý raw kontext, pokračovat v témž threadu a získat další reasoning nebo výstup, pokud už se vše nevejde do dostupného okna. |
| |
| Test běžel přes ChatGPT OAuth, nikoli přes API klíč, s těmito parametry: | ===== Co bylo ověřeno v Codexu přes ChatGPT OAuth ===== |
| |
| * model ''gpt-5.6-luna'', | Test běžel v Codex CLI ''0.145.0'', s modelem ''gpt-5.6-luna'', reasoning ''low'' a bez API klíče. |
| * reasoning ''low'', | |
| * nová čistá session, | |
| * jednorázově nastavený práh ''model_auto_compact_token_limit=1000000''. | |
| |
| Modelový katalog doručený Codexu pro tento účet uváděl metadata ''context_window: 272000'' a ''effective_context_window_percent: 95''. Codex proto v transcriptu hlásil provozní okno ''model_context_window: 258400'' tokenů. | Modelový katalog doručený Codexu pro tento účet uváděl: |
| |
| ===== Výsledek ===== | <code json> |
| | { |
| | "context_window": 272000, |
| | "effective_context_window_percent": 95, |
| | "model_context_window": 258400 |
| | } |
| | </code> |
| |
| Dva velké požadavky prošly bez kompaktace: | Dva velké požadavky prošly bez kompaktace: |
| * přibližně 252 983 vstupních tokenů. | * přibližně 252 983 vstupních tokenů. |
| |
| Při dalším rozšíření kontextu Codex před odesláním dalšího požadavku vytvořil v transcriptu událost: | Při dalším rozšíření Codex před dalším požadavkem vytvořil v uloženém transcriptu událost: |
| |
| <code json> | <code json> |
| </code> | </code> |
| |
| Praktický práh pro tento běh byl tedy přibližně 258 400 tokenů. Test neurčil nejvyšší velikost požadavku, kterou by ještě přijal backend: Codex historii zkompaktoval dřív, než bylo možné odeslat větší nezkrácený požadavek. | V neinteraktivním režimu s JSON výstupem nebyla kompaktace uživateli oznámena; standardní výstup vrátil pouze ''OK''. Událost byla dohledatelná až v rollout JSONL. |
| |
| ===== Viditelnost kompaktace ===== | ===== Proč vyšší práh kompaktaci nevypne ===== |
| |
| V neinteraktivním režimu Codexu s JSON výstupem se kompaktace neobjevila jako běžné uživatelské sdělení. Její výskyt byl potvrzen pouze v uloženém rollout JSONL jako ''context_compacted''. | ''model_auto_compact_token_limit'' nastavuje práh, ne vypínač. Jednorázové nastavení ''model_auto_compact_token_limit=1000000'' automatickou kompaktaci nevypnulo. |
| | |
| | Aktuální implementace Codexu podle [[https://github.com/openai/codex/blob/main/codex-rs/protocol/src/openai_models.rs|zdrojového kódu OpenAI Codex]] omezuje konfigurovanou hodnotu interním limitem kontextu. Vyšší hodnota proto nemůže zajistit zachování nezkrácené historie. |
| | |
| | ===== Blokování automatické kompaktace ===== |
| | |
| | Codex nemá jednoduchý boolean přepínač typu ''disable_auto_compaction''. [[https://developers.openai.com/codex/hooks/|Hook PreCompact]] může zachytit pouze automatickou kompaktaci přes matcher ''^auto$''; ruční ''/compact'' zůstane dostupný. |
| | |
| | Hook musí vrátit ''continue: false''. Tím ale Codex nezíská více kontextu: zastaví celý turn před kompaktací i před odesláním přeteklého požadavku na backend. |
| | |
| | ==== Ověřený end-to-end test hooku ==== |
| | |
| | Test s uměle nízkým prahem ověřil celý průběh: |
| | |
| | - První modelový krok vrátil ''FIRST''. |
| | - Dočasný globální ''PreCompact'' hook blokoval pouze ''trigger: "auto"''. |
| | - Při druhém požadavku Codex hook skutečně obdržel: |
| | |
| | <code json> |
| | { |
| | "hook_event_name": "PreCompact", |
| | "trigger": "auto" |
| | } |
| | </code> |
| | |
| | - Codex už neposlal promptem požadovanou odpověď ''SECOND''. |
| | |
| | Blokující hook tedy **neodešle přeteklý požadavek na backend**. Další pokus ve stejném nezměněném kontextu narazí na tutéž bránu znovu. |
| | |
| | Konfigurace může být jednou globálně v ''~/.codex/config.toml'', takže ji není nutné přidávat do každého projektu: |
| | |
| | <code toml> |
| | [[hooks.PreCompact]] |
| | matcher = "^auto$" |
| | |
| | [[hooks.PreCompact.hooks]] |
| | type = "command" |
| | command = "/absolutni/cesta/block-auto-compact.sh" |
| | timeout = 5 |
| | statusMessage = "Automatic compaction blocked" |
| | </code> |
| | |
| | Skript ''block-auto-compact.sh'' může vracet například: |
| | |
| | <code bash> |
| | #!/bin/sh |
| | printf '%s\n' '{"continue":false,"systemMessage":"Automatická kompaktace zastavena."}' |
| | </code> |
| | |
| | Hook je nutné při prvním použití schválit přes ''/hooks''. Po jeho zastavení je potřeba udělat ruční ''/compact'', zkrátit aktivní kontext, založit nový thread se selektivním handoffem nebo změnit zadání. |
| | |
| | ===== Kontext a výstupní rozpočet ===== |
| | |
| | Celé kontextové okno sdílejí zdrojová data, instrukce, výsledky nástrojů, reasoning a viditelný výstup: |
| | |
| | <code> |
| | zdrojová data + instrukce a tool output + reasoning + viditelný výstup |
| | <= celkové context window |
| | </code> |
| |
| Toto zjištění se vztahuje k testovanému neinteraktivnímu běhu. Chování TUI nebylo v tomto testu ověřeno, proto z něj nelze vyvozovat, zda interaktivní rozhraní událost zobrazuje jinak. | Hodnota 128 tisíc tokenů je maximální výstup na jeden požadavek, ne další kapacita nad zaplněné kontextové okno. Při aktivním vstupu kolem 253 tisíc tokenů proto nezbývá prostor pro 128 tisíc tokenů výstupu; zbývající rozpočet dále snižují systémové instrukce, tool output a reasoning. |
| |
| ===== Konfigurace ===== | Kompaktace se týká historie před dalším požadavkem, ne právě generovaného výstupu. Během generování se odpověď nekompaktuje; po vyčerpání dostupného výstupního rozpočtu se odpověď ukončí. |
| |
| ''model_auto_compact_token_limit'' nastavuje práh, ne zákaz automatické kompaktace. Aktuální implementace Codexu podle [[https://github.com/openai/codex/blob/main/codex-rs/protocol/src/openai_models.rs|zdrojového kódu OpenAI Codex]] omezuje nakonfigurovanou hodnotu na kontextový limit modelu. Vyšší hodnota proto nemůže zajistit zachování nezkrácené historie. | ===== Srovnání předplatných ===== |
| |
| V testu neexistoval podporovaný boolean typu ''disable_auto_compaction''. Nastavení hodnoty ''0'' by podle ověřeného chování neznamenalo vypnutí, ale okamžitou kompaktaci. | [[https://code.claude.com/docs/en/how-claude-code-works|Claude Code]] také ve výchozím nastavení používá automatickou kompaktaci. Přes [[https://code.claude.com/docs/en/settings|nastavení]] ''autoCompactEnabled: false'' ji lze přímo vypnout. |
| |
| ===== Dopad na workflow ===== | ^ Nástroj přes předplatné ^ Dostupný nezkrácený kontext v tomto srovnání ^ Chování při naplnění ^ |
| | | Claude Code | přibližně 1 000 000 tokenů | Uživatel může ponechat kompaktaci vypnutou až k limitu tohoto okna. | |
| | | Codex CLI přes ChatGPT OAuth | praktický práh 258 400 tokenů | Codex provede kompaktaci nebo s blokujícím hookem zastaví turn už před odesláním. | |
| | | OpenCode přes OpenAI OAuth | limit nezjištěn samostatným měřením | S vypnutou kompaktací odesílá požadavek; ověřená odpověď backendu byla ''context_length_exceeded''. | |
| |
| * Při dlouhé relaci se může kontext změnit bez viditelného upozornění v neinteraktivním JSON výstupu Codexu. | Claude Code proto v tomto konkrétním srovnání neposkytuje nekonečný kontext, ale poskytuje téměř čtyřnásobnou kapacitu pro práci bez ztrátové transformace. Codex přes ChatGPT předplatné v testované konfiguraci vyžaduje zásah výrazně dříve. |
| * Hodnotu kontextového okna nelze chápat jako garantovanou kapacitu pro jednu nezkrácenou historii. | |
| * Pokud je nutné rozhodovat o kompaktaci výhradně ručně, Codex CLI k tomu v testované konfiguraci neposkytl podporovaný vypínač automatické kompaktace. | |
| * Pro reprodukovatelné workflow je vhodné před kritickým bodem uložit důležité závěry mimo konverzaci, například do souboru v repozitáři nebo samostatného zápisku. | |
| |
| ===== Zdroje ===== | ===== Zdroje ===== |
| |
| * [[https://opencode.e-nosek.cz/L2hvbWUvYWl3b3JrL3NjcmF0Y2g/session/ses_05880d56cffeCxn2QzVW0phIb8|Řízený test kontextového okna a kompaktace Codex CLI]] | * [[https://opencode.e-nosek.cz/L2hvbWUvYWl3b3JrL3NjcmF0Y2g/session/ses_05880d56cffeCxn2QzVW0phIb8|Řízené testy Codex CLI přes ChatGPT OAuth]] |
| * [[https://developers.openai.com/codex/quickstart?setup=cli|OpenAI Codex – CLI quickstart]] | * [[https://developers.openai.com/codex/quickstart?setup=cli|OpenAI Codex – CLI quickstart]] |
| | * [[https://developers.openai.com/codex/hooks/|OpenAI Codex – Hooks]] |
| | * [[https://developers.openai.com/codex/config-reference/|OpenAI Codex – konfigurace]] |
| * [[https://github.com/openai/codex/blob/main/codex-rs/protocol/src/openai_models.rs|OpenAI Codex – implementace limitu automatické kompaktace]] | * [[https://github.com/openai/codex/blob/main/codex-rs/protocol/src/openai_models.rs|OpenAI Codex – implementace limitu automatické kompaktace]] |
| | * [[https://code.claude.com/docs/en/settings|Claude Code – Settings]] |
| | * [[https://code.claude.com/docs/en/how-claude-code-works|Claude Code – How Claude Code works]] |