截至目前,具身智能或许已经基本跨过“每个任务训练一个模型”的时代,正在进入“通用预训练 + 跨任务/跨本体共训练 + 少量本体 grounding + 部署后经验学习”的早期基础模型时代;但它尚未完成类似互联网文本之于 LLM 的“原生数据—统一 token/latent—统一训练目标—部署反馈—再训练”的闭环。
2026年8月,GEN-1.5 的出现被宣称为具身智能领域进入 GPT-3 时代。在官网上,GEN-1.5 展示出了系列的 zero-shot 与 few-shot 案例,表现出了前所未有的模仿能力。
但是同时,GPT-Astra-6 震撼发布,其在3D建模领域的突出表现与对世界进一步的理解能力给更多人带来了更大的震撼。
那未来的具身智能领域发展会如何?而在前几年,具身领域的发展又如何?Chika 希望在这个问题上也能有所回应。