v0.26.0.zh.md
docs/i18n/release-notes/v0.26.0.zh.md
Tesserae v0.26.0 — 编译完成,并诉说它们做了什么
<!-- translations:start -->
English · 한국어 · 日本語 · Русский · Español · Français · Deutsch
<!-- translations:end -->
Released 2026-07-26 · PyPI · GitHub release · pip install --upgrade tesserae==0.26.0
v0.25.1 阻止了编译被卡住。此版本让它们快速,让它们诚实地说明它们覆盖了什么, 并停止摄取垃圾。
更快
- 并行提取。 批处理循环每次生成一个 CLI 子进程并阻塞它,一次一个文档 — 实际时间是所有模型往返的字面总和,对 161 个文档的测量约为 2 小时 40 分钟。 提取现在默认运行 4 个文档并发进行(
TESSERAE_EXTRACT_CONCURRENCY=1恢复 顺序执行)。
并发改变速度,永不改变输出:工作列表按路径顺序固定,结果按索引收集。 merge_graphs 按位置解决重复节点 ID,所以按完成顺序收集会无声地产生 不同的 图 — 由提取器以反向路径顺序完成的测试固定。
- 响应缓存实际上缓存。
complete_json始终接受cache_key, 两个 CLI 客户端都接受它并丢弃它 — 只有 Anthropic 客户端曾使用它。 每次编译相同内容都要重新支付全价。两者现在在~/.tesserae/llm_cache下读取和写入内容寻址缓存,按内容加上模型和推理努力密钥, 所以切换模型会重新询问而不是提供之前模型的答案。仅存储可解析的响应。TESSERAE_LLM_CACHE=0禁用。
诚实
- 提取失败被命名,不被吞没。 失败分类法区分短暂故障(重试)与真实故障,
--limit不再放弃图覆盖,每个主目录认证范围防止一个坏配置文件毒害运行。 graphed完整性标记。 清单行仅在其内容实际到达graph.json后才被戳记 — 所以中途终止的编译不再能留下声称图没有的覆盖的行。删除和重命名的文档 被墓碑标记,而不是永久徘徊。--retry-fallbacks范围现在重试恰好提取失败的文档,不做其他。
更清洁
- 垃圾目录远离语料库。 pytest tmpdirs(
pytest-of-<user>/pytest-N/) 和 pip 临时目录降落在配置的源根目录中,当TMPDIR解析为仓库时, 植入数千个一次性夹具文件,每次测试运行都变化 — 所以候选集永不重复,--changed-only永不无操作。一个真实项目清单有 25,269 个条目, 其中 16,110 个(63%)指向不再存在的文件。
遍历器现在在递归下降期间跳过这些族群。这是一个目录规则: docs/pip-install-guide.md 是普通文档并保持索引 — Tesserae 自己的 概念蛞蝓化器从任何"pip install x"标题中铸造出完全相同的文件名形状。
另外
- Codex 模型默认是
gpt-5.6-luna。 - 新调优参考记录所有 29 个
TESSERAE_*环境变量 — 默认值、每个网关的内容以及何时更改。包括 v0.25.1 中提供的 提取超时在内的几个根本没有文档。
从 v0.25.1 升级
直接升级。有两件事值得了解:
提取现在以 4 倍速率运行。 如果您的提供者账户有严格的速率限制, 设置 TESSERAE_EXTRACT_CONCURRENCY=1。
升级后首次编译可能比平常做更多工作 — graphed 标记在较旧的清单中不存在, 所以先前的行被视为未验证并重新戳记。这是一个纠正性再编译,不是永久成本。