3.8 KB · updated 2026-07-31 · md

v0.26.0.zh.md

docs/i18n/release-notes/v0.26.0.zh.md

Tesserae v0.26.0 — 编译完成,并诉说它们做了什么

<!-- translations:start -->

English · 한국어 · 日本語 · Русский · Español · Français · Deutsch

<!-- translations:end -->

Released 2026-07-26 · PyPI · GitHub release · pip install --upgrade tesserae==0.26.0

v0.25.1 阻止了编译被卡住。此版本让它们快速,让它们诚实地说明它们覆盖了什么, 并停止摄取垃圾。

更快

  • 并行提取。 批处理循环每次生成一个 CLI 子进程并阻塞它,一次一个文档 — 实际时间是所有模型往返的字面总和,对 161 个文档的测量约为 2 小时 40 分钟。 提取现在默认运行 4 个文档并发进行(TESSERAE_EXTRACT_CONCURRENCY=1 恢复 顺序执行)。

并发改变速度,永不改变输出:工作列表按路径顺序固定,结果按索引收集。 merge_graphs 按位置解决重复节点 ID,所以按完成顺序收集会无声地产生 不同的 图 — 由提取器以反向路径顺序完成的测试固定。

  • 响应缓存实际上缓存。 complete_json 始终接受 cache_key, 两个 CLI 客户端都接受它并丢弃它 — 只有 Anthropic 客户端曾使用它。 每次编译相同内容都要重新支付全价。两者现在在 ~/.tesserae/llm_cache 下读取和写入内容寻址缓存,按内容加上模型和推理努力密钥, 所以切换模型会重新询问而不是提供之前模型的答案。仅存储可解析的响应。 TESSERAE_LLM_CACHE=0 禁用。

诚实

  • 提取失败被命名,不被吞没。 失败分类法区分短暂故障(重试)与真实故障, --limit 不再放弃图覆盖,每个主目录认证范围防止一个坏配置文件毒害运行。
  • graphed 完整性标记。 清单行仅在其内容实际到达 graph.json 后才被戳记 — 所以中途终止的编译不再能留下声称图没有的覆盖的行。删除和重命名的文档 被墓碑标记,而不是永久徘徊。
  • --retry-fallbacks 范围现在重试恰好提取失败的文档,不做其他。

更清洁

  • 垃圾目录远离语料库。 pytest tmpdirs(pytest-of-<user>/pytest-N/) 和 pip 临时目录降落在配置的源根目录中,当 TMPDIR 解析为仓库时, 植入数千个一次性夹具文件,每次测试运行都变化 — 所以候选集永不重复, --changed-only 永不无操作。一个真实项目清单有 25,269 个条目, 其中 16,110 个(63%)指向不再存在的文件

遍历器现在在递归下降期间跳过这些族群。这是一个目录规则: docs/pip-install-guide.md 是普通文档并保持索引 — Tesserae 自己的 概念蛞蝓化器从任何"pip install x"标题中铸造出完全相同的文件名形状。

另外

  • Codex 模型默认是 gpt-5.6-luna
  • 新调优参考记录所有 29 个 TESSERAE_* 环境变量 — 默认值、每个网关的内容以及何时更改。包括 v0.25.1 中提供的 提取超时在内的几个根本没有文档。

从 v0.25.1 升级

直接升级。有两件事值得了解:

提取现在以 4 倍速率运行。 如果您的提供者账户有严格的速率限制, 设置 TESSERAE_EXTRACT_CONCURRENCY=1

升级后首次编译可能比平常做更多工作graphed 标记在较旧的清单中不存在, 所以先前的行被视为未验证并重新戳记。这是一个纠正性再编译,不是永久成本。