OWNER-REVIEW · NOINDEX · NOT A FORMAL RELEASE
GONG'S UNDERSTANDING LAYER · TABPFN-3

把 TabPFN-3 读成一组可核对的技术对象

这不是再次写一份论文摘要,而是给持续开发使用的理解入口:把 tensor flow、decoder、规模化推理、synthetic prior、实现核对和 P11 边界,拆成可以分别验证、分别吸收的文档。

READING OBJECT

不是一个页面,而是三层阅读关系

TabPFN-3 会成为 P11 开发的长期最近邻;因此需要把官方证据、我们的理解和公开呈现严格分开。入口页帮助读者在三层之间移动,但不把 projection 当成模型真值。

01 · EVIDENCE

官方论文 source

官方 v2 archive、PDF、章节和图表是冲突时的第一核对对象。

02 · UNDERSTANDING

Gong 的 docs

已完成的连续阅读包是中文独立导读 PDF;下方文档地图继续承接逐问题、可回写的技术 docs。

03 · PROJECTION

网页阅读入口

网页用于阅读路径、导航和 owner review;它可以重建,但不是私有理解的唯一保存位置。

COMPLETED · CHINESE READER GUIDE

已完成的中文独立导读

这是已经写成并可下载的连续阅读包,不是下方「首批理解方向」那种尚在补齐的容器。导读按「论文证据 / P11 解释 / 边界」组织,核对对象是本地 arXiv:2605.13986v2 官方源码。

《TabPFN-3: Technical Report》中文独立导读 —— 从 cell groups 到 512 维 row token:它怎样把一百万行放进一次 in-context prediction?

  1. 先给结论:TabPFN-3 究竟改了什么 — 三段式重构与三个误读边界
  2. 建议阅读路线与版本边界 — 该读哪些官方 source 文件
  3. 输入不是一行:context--query episode — 四种 token 的区分
  4. 端到端张量图:从原始表到 row token — cell grouping → Stage 1/2/3
  5. 输出:分类像 label retrieval,回归像分布解码
  6. 相对 TabPFN-2.5:哪些变化真正改变了缩放规律
  7. 一百万行到底怎样装进去 — chunking、KV cache 与四种瓶颈
  8. 训练与推理一定要分三层讲 — pretrain / fit / predict
  9. Test-time compute:公开部分与未公开部分必须拆开
  10. 论文明确给了什么,仍然没给什么
  11. 它学到什么:共享的 task-conditioned prediction algorithm
  12. 与 P11 的精确关系:哪里可借,哪里不能混同
  13. 读完后应能回答的十个问题 · 最后只记住六句话
canonical · papers/P11-tabular-foundation-models/related-materials/tabpfn-3-arxiv-2605.13986v2/reader-guide-zh.{tex,pdf}
DOCUMENT MAP · IN PROGRESS

首批理解方向

目录先建立稳定的容器,具体文档按一个可复核问题逐篇长出来。当前不把尚未写成的内容标成“已完成”。这与上方已完成的中文导读 PDF 不是同一层对象。

ARCHITECTURE

Cell 到 row token

跟踪 grouped-cell embedding、column-distribution contextualization、feature collapse 与 row-level ICL 的形状变化。

DECODER

Label injection 与分类头

拆开 feature-value encoding、context-label injection、many-class decoder、attention 聚合和 softmax 轴。

SCALING

Chunking、cache 与百万行

区分 activation memory、row-level quadratic cost、KV cache 和“没有做近邻检索”的证据边界。

PRIOR · TRAINING

Synthetic prior 与 test-time compute

核对 pretraining、amortized inference、preprocessing、fit、Thinking 与 API-only 能力各自的证据层级。

P11 BOUNDARY

可借鉴什么,不能宣称什么

把 row representation、predictive distribution 和 learned retrieval 与 Unit、belief、SCM recovery、causal capability 分开。

DOCUMENT CONTRACT

每篇 docs 都要能被重新核对

  • 先给出论文 section/page/figure/table 或官方 source 文件的精确 anchor。
  • 明确输入、输出、token、维度、softmax axis、计算顺序和适用 regime。
  • 把“论文证据”“我的解释”“尚未证明的边界”分开写,不用漂亮类比替代机制。
  • 最后说明它对 P11 的 baseline、architecture、experiment 或 claim 收缩产生什么后果。
  • 标记状态:draftsource-checkedruntime-checkedabsorbed
CANONICAL WRITEBACK

长期理解最终回到哪里

稳定判断回写到这篇资料旁边的 `docs/`,跨论文综合仍回到 P11 的 `related-materials/notes/`;浏览器便笺和 Discord 反馈区只是 scratch / live grow place。

papers/P11-tabular-foundation-models/related-materials/tabpfn-3-arxiv-2605.13986v2/docs/

第三方 archive、PDF 和源码保持只读;网页只承担 public-safe owner-review reading projection,不把本页变成作者论文的 fork。