问题稳定,答案可以继续生长
P11-MQ-001 至 006 来自 Gong owner worksheet;P11-MQ-007 是本轮版本化核对后的行列置换问题。草稿不会因上线而升级为模型 contract。
怎样统一异构表格输入,又不制造伪序?
当前 owner worksheet 提出 typed preprocessing → value encoder 的统一接口,但 categorical、missing、 feasible-set 与 R/S 共享边界仍需和最新 contract 对齐。
打开独立问题页 →模型怎样从 context 判断当前任务,而不是每张表重新训练?
Owner worksheet 把 masked matrix completion、learned special tokens 与 R/S 终端对象视为适应通道; 仍需冻结 episode compiler、context/query mask 与 foundation checkpoint gate。
打开独立问题页 →cell、Unit、Feature 与 dataset 之间应该传递什么证据?
问题已进入主线,但 owner worksheet 仍明确标记为不够清楚;不能由 Agent 擅自替 owner 填成固定答案。
打开独立问题页 →TabUF 最终预测的对象到底是什么?
当前 owner answer 明确保留 response law 与 cell-subpopulation 两条路线;任何 concrete model/run 仍必须在 R 与 S 之间二选一,不能串成混合 estimand。
打开独立问题页 →怎样扩展到大样本、高维、稀疏与 shift,又不丢 rare evidence?
Owner worksheet 指向 inducing slots 与 RecSys-style sparse recovery;rare-Unit preservation、large-table fidelity、grouped/temporal shift 与 R/S 各自的 scaling contract 仍是开放 gates。
打开独立问题页 →什么证据才足以称为 tabular foundation model?
Owner 把跨多任务的显著优势视为值得继续的标准;项目证据纪律还要求 frozen checkpoint、未见物理表/ source-family、无梯度适应、contamination audit 与分 shift 报告,当前这些 gates 尚未通过。
打开独立问题页 →交换两列或两行,表格大模型的预测应该不变吗?
主流模型的核心网络通常在 context/query 各自的行集合内结构性等变,但完整管线仍需实测; TabPFN-3、TabFM、LimiX-2M 与 TabICLv2 的单 estimator 都不对任意特征列置换严格不变,有限 permutation ensemble 只提供鲁棒化。TabUF 把对象级行列等变作为设计目标,但尚未通过端到端 gate。
打开独立问题页 →一条可机械检查的投影链
Canonical registry 位于 docs/mainline-questions/registry.yaml。每次新增问题都必须登记稳定 ID、source、status、evidence cutoff 与 verification gates。