Rozdíly

Zde můžete vidět rozdíly mezi vybranou verzí a aktuální verzí dané stránky.

Odkaz na výstup diff

Obě strany předchozí revize Předchozí verze
Následující verze
Předchozí verze
ai:platformy:codex:autokompakce-a-kontextove-okno [28.07.2026 10:19] – Upřesněna viditelnost kompaktace v JSON režimu Petr Nosekai:platformy:codex:autokompakce-a-kontextove-okno [28.07.2026 10:55] (aktuální) – Vymezeno srovnání předplatných a výslovně vyloučeno API Petr Nosek
Řádek 1: Řádek 1:
-====== Automatická kompaktace a kontextové okno Codex CLI ======+====== Automatická kompaktace a kontextové okno Codex CLI přes předplatné ======
  
 //Vytvořeno: **28.7.2026** | Aktualizováno: **~~LASTMOD~~**// //Vytvořeno: **28.7.2026** | Aktualizováno: **~~LASTMOD~~**//
  
-[[https://developers.openai.com/codex/quickstart?setup=cli|Codex CLI]] při dlouhé práci automaticky zkracuje historii konverzace. Tento zápisek zachycuje [[https://opencode.e-nosek.cz/L2hvbWUvYWl3b3JrL3NjcmF0Y2g/session/ses_05880d56cffeCxn2QzVW0phIb8|řízený test přes ChatGPT OAuth]], který ověřil praktický práh kompaktace pro GPT-5.6 Luna a to, jak se tato událost projevuje uživateli.+[[https://developers.openai.com/codex/quickstart?setup=cli|Codex CLI]] při dlouhé práci automaticky zkracuje historii konverzace. Tento zápisek vychází z [[https://opencode.e-nosek.cz/L2hvbWUvYWl3b3JrL3NjcmF0Y2g/session/ses_05880d56cffeCxn2QzVW0phIb8|řízených testů přes ChatGPT OAuth]] a srovnává dostupný nezkrácený kontext v používaných coding agentech. 
 + 
 +> **Rozsah zjištění:** Článek se týká výhradně používání přes **předplatná**: ChatGPT OAuth v Codexu a aktuálně používaného předplatného v Claude Code. **OpenAI ani Anthropic API nebylo testováno.** API může mít jiné limity, zejména pro GPT-5.6 v Codexu z toho nelze vyvozovat žádný API limit.
  
 ===== Shrnutí ===== ===== Shrnutí =====
  
-Codex provedl automatickou kompaktaci ještě před odesláním dalšího velkého požadavku. Stalo se to i po jednorázovém nastavení ''model_auto_compact_token_limit=1000000'', takže tato volba není vypínač kompaktace.+Hlavní praktický rozdíl není jen způsob ovládání kompaktace, ale dostupná velikost nezkráceného kontextu přes předplatné:
  
-V testovaném neinteraktivním režimu Codex uživatele na kompaktaci neupozornilna standardní výstup vrátil pouze ''OK''. Událost ''context_compacted'' byla dohledatelná až ve strojovém transcriptu JSONL.+  * aktuálně používaný Claude Code bez automatické kompaktace: **1 000 000 tokenů**; 
 +  * testovaný Codex CLI přes ChatGPT OAuthautomatický provozní práh **258 400 tokenů**.
  
-Pro prácikterá vyžaduje zachování doslovné celé historieproto nelze edpokládat, že Codex CLI ponechá kontext beze změny až do maximálního kontextového okna.+Claude Code tedy v tomto srovnání udrží přibližně **3,9× více** původní historie. Codex vyžaduje rozhodnutí o kompaktacizměně kontextu nebo rozdělení úlohy ibližně o 741 600 tokenů dříve.
  
-===== Rozsah testu =====+Oba nástroje nakonec narazí na fyzický limit svého kontextového okna. Nelze současně zachovat celý raw kontext, pokračovat v témž threadu a získat další reasoning nebo výstup, pokud už se vše nevejde do dostupného okna.
  
-Test běžel přes ChatGPT OAuth, nikoli přes API klíč, s těmito parametry:+===== Co bylo ověřeno v Codexu přes ChatGPT OAuth =====
  
-  * model ''gpt-5.6-luna'', +Test běžel v Codex CLI ''0.145.0'', s modelem ''gpt-5.6-luna'', reasoning ''low'' a bez API klíče.
-  * reasoning ''low''+
-  * nová čistá session, +
-  * jednorázově nastavený práh ''model_auto_compact_token_limit=1000000''.+
  
-Modelový katalog doručený Codexu pro tento účet uváděl metadata ''context_window272000'' a ''effective_context_window_percent: 95''. Codex proto v transcriptu hlásil provozní okno ''model_context_window: 258400'' tokenů.+Modelový katalog doručený Codexu pro tento účet uváděl:
  
-===== Výsledek =====+<code json> 
 +
 +  "context_window": 272000, 
 +  "effective_context_window_percent": 95, 
 +  "model_context_window": 258400 
 +
 +</code>
  
 Dva velké požadavky prošly bez kompaktace: Dva velké požadavky prošly bez kompaktace:
Řádek 31: Řádek 37:
   * přibližně 252 983 vstupních tokenů.   * přibližně 252 983 vstupních tokenů.
  
-Při dalším rozšíření kontextu Codex před odesláním dalšího požadavku vytvořil v transcriptu událost:+Při dalším rozšíření Codex před dalším požadavkem vytvořil v uloženém transcriptu událost:
  
 <code json> <code json>
Řádek 39: Řádek 45:
 </code> </code>
  
-Praktický práh pro tento běh byl tedy přibližně 258 400 tokenůTest neurčil nejvyšší velikost požadavku, kterou by ještě přijal backend: Codex historii zkompaktoval dřív, než bylo možné odeslat větší nezkrácený požadavek.+V neinteraktivním režimu s JSON výstupem nebyla kompaktace uživateli oznámena; standardní výstup vrátil pouze ''OK''Událost byla dohledatelná až v rollout JSONL.
  
-===== Viditelnost kompaktace =====+===== Proč vyšší práh kompaktaci nevypne =====
  
-V neinteraktivním režimu Codexu s JSON výstupem se kompaktace neobjevila jako běžné ivatelské sděleníJejí výskyt byl potvrzen pouze uloženém rollout JSONL jako ''context_compacted''.+''model_auto_compact_token_limit'' nastavuje práh, ne vypínač. Jednorázové nastavení ''model_auto_compact_token_limit=1000000'' automatickou kompaktaci nevypnulo. 
 + 
 +Aktuální implementace Codexu podle [[https://github.com/openai/codex/blob/main/codex-rs/protocol/src/openai_models.rs|zdrojového kódu OpenAI Codex]] omezuje konfigurovanou hodnotu interním limitem kontextu. Vyšší hodnota proto nemůže zajistit zachování nezkrácené historie. 
 + 
 +===== Blokování automatické kompaktace ===== 
 + 
 +Codex nemá jednoduchý boolean přepínač typu ''disable_auto_compaction''. [[https://developers.openai.com/codex/hooks/|Hook PreCompact]] může zachytit pouze automatickou kompaktaci přes matcher ''^auto$''; ruční ''/compact'' zůstane dostupný. 
 + 
 +Hook musí vrátit ''continue: false''. Tím ale Codex nezíská více kontextu: zastaví celý turn před kompaktací i před odesláním přeteklého požadavku na backend. 
 + 
 +==== Ověřený end-to-end test hooku ==== 
 + 
 +Test s uměle nízkým prahem ověřil celý průh: 
 + 
 +  - První modelový krok vrátil ''FIRST''
 +  - Dočasný globální ''PreCompact'' hook blokoval pouze ''trigger: "auto"''
 +  - Při druhém požadavku Codex hook skutečně obdržel: 
 + 
 +<code json> 
 +
 +  "hook_event_name": "PreCompact", 
 +  "trigger": "auto" 
 +
 +</code> 
 + 
 +  - Codex už neposlal promptem požadovanou odpověď ''SECOND''. 
 + 
 +Blokující hook tedy **neodešle přeteklý požadavek na backend**. Další pokus ve stejném nezměněném kontextu narazí na tutéž bránu znovu. 
 + 
 +Konfigurace může být jednou globálně ''~/.codex/config.toml'', takže ji není nutné přidávat do každého projektu: 
 + 
 +<code toml> 
 +[[hooks.PreCompact]] 
 +matcher = "^auto$" 
 + 
 +[[hooks.PreCompact.hooks]] 
 +type = "command" 
 +command = "/absolutni/cesta/block-auto-compact.sh" 
 +timeout = 5 
 +statusMessage = "Automatic compaction blocked" 
 +</code> 
 + 
 +Skript ''block-auto-compact.sh'' může vracet například: 
 + 
 +<code bash> 
 +#!/bin/sh 
 +printf '%s\n' '{"continue":false,"systemMessage":"Automatická kompaktace zastavena."}' 
 +</code> 
 + 
 +Hook je nutné při prvním použití schválit přes ''/hooks''. Po jeho zastavení je potřeba udělat ruční ''/compact'', zkrátit aktivní kontext, založit nový thread se selektivním handoffem nebo změnit zadání. 
 + 
 +===== Kontext a výstupní rozpočet ===== 
 + 
 +Celé kontextové okno sdílejí zdrojová data, instrukce, výsledky nástrojů, reasoning a viditelný výstup: 
 + 
 +<code> 
 +zdrojová data + instrukce a tool output + reasoning + viditelný výstup 
 +<= celkové context window 
 +</code>
  
-Toto zjištění se vztahuje k testovanému neinteraktivnímu běhuChování TUI nebylo v tomto testu ověřeno, proto z něj nelze vyvozovatzda interaktivní rozhraní událost zobrazuje jinak.+Hodnota 128 tisíc tokenů je maximální výstup na jeden požadavek, ne další kapacita nad zaplněné kontextové oknoPři aktivním vstupu kolem 253 tisíc tokenů proto nezbývá prostor pro 128 tisíc tokenů výstupu; zbývající rozpočet dále snižují systémové instrukcetool output a reasoning.
  
-===== Konfigurace =====+Kompaktace se týká historie před dalším požadavkem, ne právě generovaného výstupu. Během generování se odpověď nekompaktuje; po vyčerpání dostupného výstupního rozpočtu se odpověď ukončí.
  
-''model_auto_compact_token_limit'' nastavuje práh, ne zákaz automatické kompaktace. Aktuální implementace Codexu podle [[https://github.com/openai/codex/blob/main/codex-rs/protocol/src/openai_models.rs|zdrojového kódu OpenAI Codex]] omezuje nakonfigurovanou hodnotu na kontextový limit modelu. Vyšší hodnota proto nemůže zajistit zachování nezkrácené historie.+===== Srovnání předplatných =====
  
-V testu neexistoval podporovaný boolean typu ''disable_auto_compaction''Nastavení hodnoty ''0'' by podle ověřeného chování neznamenalo vypnutí, ale okamžitou kompaktaci.+[[https://code.claude.com/docs/en/how-claude-code-works|Claude Code]] také ve výchozím nastavení používá automatickou kompaktaci. Přes [[https://code.claude.com/docs/en/settings|nastavení]] ''autoCompactEnabled: false'' ji lze přímo vypnout.
  
-===== Dopad na workflow =====+^ Nástroj přes předplatné ^ Dostupný nezkrácený kontext v tomto srovnání ^ Chování při naplnění ^ 
 +| Claude Code | přibližně 1 000 000 tokenů | Uživatel může ponechat kompaktaci vypnutou až k limitu tohoto okna. | 
 +| Codex CLI přes ChatGPT OAuth | praktický práh 258 400 tokenů | Codex provede kompaktaci nebo s blokujícím hookem zastaví turn už před odesláním. | 
 +| OpenCode přes OpenAI OAuth | limit nezjištěn samostatným měřením | S vypnutou kompaktací odesílá požadavek; ověřená odpověď backendu byla ''context_length_exceeded''. |
  
-  * Při dlouhé relaci se může kontext změnit bez viditelného upozornění v neinteraktivním JSON výstupu Codexu. +Claude Code proto v tomto konkrétním srovnání neposkytuje nekonečný kontext, ale poskytuje téměř čtyřnásobnou kapacitu pro práci bez ztrátové transformace. Codex přes ChatGPT předplatné v testované konfiguraci vyžaduje zásah výrazně íve.
-  * Hodnotu kontextového okna nelze chápat jako garantovanou kapacitu pro jednu nezkrácenou historii. +
-  * Pokud je nutné rozhodovat o kompaktaci výhradně ručně, Codex CLI k tomu v testované konfiguraci neposkytl podporovaný vypínač automatické kompaktace. +
-  * Pro reprodukovatelné workflow je vhodné před kritickým bodem uložit důležité závěry mimo konverzaci, například do souboru v repozitáři nebo samostatného zápisku.+
  
 ===== Zdroje ===== ===== Zdroje =====
  
-  * [[https://opencode.e-nosek.cz/L2hvbWUvYWl3b3JrL3NjcmF0Y2g/session/ses_05880d56cffeCxn2QzVW0phIb8|Řízený test kontextového okna a kompaktace Codex CLI]]+  * [[https://opencode.e-nosek.cz/L2hvbWUvYWl3b3JrL3NjcmF0Y2g/session/ses_05880d56cffeCxn2QzVW0phIb8|Řízené testy Codex CLI přes ChatGPT OAuth]]
   * [[https://developers.openai.com/codex/quickstart?setup=cli|OpenAI Codex – CLI quickstart]]   * [[https://developers.openai.com/codex/quickstart?setup=cli|OpenAI Codex – CLI quickstart]]
 +  * [[https://developers.openai.com/codex/hooks/|OpenAI Codex – Hooks]]
 +  * [[https://developers.openai.com/codex/config-reference/|OpenAI Codex – konfigurace]]
   * [[https://github.com/openai/codex/blob/main/codex-rs/protocol/src/openai_models.rs|OpenAI Codex – implementace limitu automatické kompaktace]]   * [[https://github.com/openai/codex/blob/main/codex-rs/protocol/src/openai_models.rs|OpenAI Codex – implementace limitu automatické kompaktace]]
 +  * [[https://code.claude.com/docs/en/settings|Claude Code – Settings]]
 +  * [[https://code.claude.com/docs/en/how-claude-code-works|Claude Code – How Claude Code works]]
  • ai/platformy/codex/autokompakce-a-kontextove-okno.1785226769.txt.gz
  • Poslední úprava: 28.07.2026 10:19
  • autor: Petr Nosek