小米开源构造化数据大模型Xiaomi-TabLDM:一款通用的全使命解决方案
2026-09-06 09:48:04
9月5日消息,小米正式发布了通用表格数据基础大模型Xiaomi-TabLDM。该模型的主要特点是一次预训练,无需针对每个数据集进行重新训练、调参或模型集成,即可直接完成分类和回归预测任务。这将大模型范式扩展至金融、医疗、制造和物流等领域广泛存在的表格结构化数据场景。
长期以来表格数据处理大多依靠XGBoost、LightGBM这类传统机器学习工具,每拿到一份新业务表格,就要重新完成训练调参,多套模型维护带来沉重部署成本,Xiaomi-TabLDM目标就是打破一表一模型”的行业现状,实现单模型跨数据集直接使用。

模型技术路线围绕大规模合成数据预训练、高效模型Scaling、Test-Time Scaling三大方向展开,整套预训练全部依靠合成表格数据完成,覆盖多样的数据规模、变量类型与函数关系,扩大任务分布覆盖。
架构层面引入双流Feature Group、轻量级Attention Residual以及稀疏MoE专家混合机制,在扩大模型容量的同时,避免计算量同步暴涨,同时支持在不改动模型参数的前提下,依靠增加推理阶段计算资源,进一步拉高预测结果准确度。

在TALENT、OpenML-CTR23、BCCO、TabArena四大公开基准测试当中,Xiaomi-TabLDM整体进入第一梯队。
回归任务表现尤为亮眼,拿下TALENT二分类第一、OpenML-CTR23回归榜单第一,BCCO总体第二、TabArena回归任务第二,多项指标超过TabPFN-3、AutoGluon1.5 extreme等主流基线方案,同时兼顾预测性能与推理效率,在TabArena回归任务上取得1900 Elo得分,每1000样本验证耗时仅3.12秒。

工业真实场景测试进一步验证模型价值,材料性能预测场景无需微调,预测精度提升130%,减少九成无效试模测试;零件重量预测相比XGBoost,失误样本占比下降31%;生产组分预测平均误差降低54%。
遇到工况发生变化,仅补充三十条左右新样本作为上下文,模型平均误差就可以下降62%,对比传统算法需要两百家样本才能接近同等效果,小样本快速适配优势突出。


相关阅读
-
Gimlet Labs新一轮融资使公司估值飙升至30亿美元区块链快讯 2026-09-06 09:43:53
-
小米18 Fold发布新配色:玄色与暖金白外观亮相深度解读 2026-09-06 09:42:31
-
Boss直聘密码忘了怎么办?Boss直聘找回密码的方法资讯百科 2026-09-06 09:41:12
-
iPhone Ultra国行开售延期:早期产能低,首批优先供给美国深度解读 2026-09-06 09:36:44
-
Zcash突破1000美元大关,灰度新现货ETF创历史新高区块链快讯 2026-09-06 09:34:37
-
小米澎程N70武士黑套装发布:10大熏黑细节展现纯洁与深邃深度解读 2026-09-06 09:30:40
-
NFT 是什么?与比特币的区别及 2026 年价值深度解析区块链快讯 2026-09-06 09:29:15
-
MEME行情暴涨:新钱包21天内投资2972美元获利210万美元区块链快讯 2026-09-06 09:25:26
-
小米平板9 Pro Max:全功能Type-C直连,轻松变身显示器和游戏大屏深度解读 2026-09-06 09:25:02
-
淘宝购物车商品怎么分组?淘宝购物车商品分组教程资讯百科 2026-09-06 09:23:06