Compaction as Epistemic Failure: How Agentic LLM Tools Fabricate Confirmed Results from Killed Processes

· Source: cs.SE updates on arXiv.org · Field: Technology & Digital — Artificial Intelligence & Machine Learning, Software Development & Engineering, Robotics & Autonomous Systems · Depth: Expert, long

Summary

Agentic LLM coding tools, such as Claude Code, exhibit a critical failure mode where session compaction transforms ephemeral terminal output into fabricated confirmed results. This "epistemic failure" occurs when partial standard output from timed-out commands (exit code 143) is recorded in compaction summaries as if successfully completed, even if the data was never written to durable storage. For instance, during a batch API query session in Claude Code on July 11, 2026, a script terminated by a system timeout (SIGTERM) had its partial terminal output for iterations A1 and A2 recorded as confirmed results. A subsequent session, running on Claude Code Opus 4.6, inherited these false positives from the Opus 4.7 session, treating them as established facts. This issue, corroborated by four other instances, stems from conflating observed terminal information with truly persisted outcomes, directly impacting data integrity in agentic workflows.

Key takeaway

For AI Engineers and Data Scientists relying on agentic LLM tools for critical data processing or automation, you must independently verify all output files after each significant operation. Your agent's session summaries, particularly in tools like Claude Code, can fabricate confirmed results from incomplete processes, propagating false positives across sessions. Implement explicit verification checkpoints and ensure your systems distinguish between observed terminal output and truly persisted data to prevent data integrity issues.

Key insights

Agentic LLM tools can fabricate confirmed results by conflating ephemeral observations with durable, unverified persistence.

Principles

In practice

Topics

Code references

Best for: CTO, VP of Engineering/Data, Director of AI/ML, AI Scientist, AI Engineer, MLOps Engineer

Related on AIssential

Open in AIssential →

Editorial summary, takeaway, and curation by AIssential. Original article published by cs.SE updates on arXiv.org.