<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>具身智能 on WorldSense 技术笔记</title><link>https://worldsensetech.com/zh/categories/%E5%85%B7%E8%BA%AB%E6%99%BA%E8%83%BD/</link><description>Recent content in 具身智能 on WorldSense 技术笔记</description><generator>Hugo</generator><language>zh-CN</language><lastBuildDate>Fri, 14 Aug 2026 00:00:00 +0000</lastBuildDate><atom:link href="https://worldsensetech.com/zh/categories/%E5%85%B7%E8%BA%AB%E6%99%BA%E8%83%BD/index.xml" rel="self" type="application/rss+xml"/><item><title>Isaac Lab 入门：面向具身智能的 GPU 加速机器人学习平台</title><link>https://worldsensetech.com/zh/articles/isaac-lab-robot-rl/</link><pubDate>Fri, 14 Aug 2026 00:00:00 +0000</pubDate><guid>https://worldsensetech.com/zh/articles/isaac-lab-robot-rl/</guid><description>&lt;p&gt;过去一周，我们在 MuJoCo + DreamerV3 这条技术路线上深入了很多——从环境搭建到视觉输入训练，再到训练技巧和世界模型的架构演进。&lt;/p&gt;
&lt;p&gt;今天换一个视角，聊聊另一套技术栈：NVIDIA 的 Isaac Lab。&lt;/p&gt;
&lt;p&gt;如果说 MuJoCo 更强调轻量、灵活的动力学研究，适合快速原型开发和算法探索；那么 Isaac Lab 更强调 GPU 加速的大规模机器人训练和 sim-to-real pipeline。两者并不互斥——很多研究团队同时使用 MuJoCo 做算法验证和 Isaac Lab 做规模训练。&lt;/p&gt;
&lt;h2 id="isaac-lab-是什么"&gt;Isaac Lab 是什么？&lt;/h2&gt;
&lt;p&gt;Isaac Lab 是 NVIDIA 基于 Isaac Sim 构建的机器人学习框架，继承自 Isaac Gym 的 GPU 并行仿真思路，提供了更完整的任务抽象和工程结构。它的核心特点是：利用 GPU 加速，实现大规模并行的强化学习训练。&lt;/p&gt;
&lt;p&gt;Isaac Lab 本身不是仿真器，也不是 RL 算法库，而是一个位于 Isaac Sim 之上的任务抽象层：&lt;/p&gt;
&lt;p&gt;&lt;code&gt;Isaac Sim（PhysX + Rendering）→ Isaac Lab（Task Abstraction + RL Integration）→ 训练策略&lt;/code&gt;&lt;/p&gt;
&lt;p&gt;简单来说，Isaac Lab 解决的问题是：如何在短时间内训练出高质量的机器人策略。&lt;/p&gt;
&lt;p&gt;传统的 RL 训练（如我们在 MuJoCo 中用 DreamerV3）通常是单环境或少量并行环境。训练一个策略可能需要几百万步，花费几小时甚至几天。而 Isaac Lab 通过 GPU 并行化，可以同时运行数千个环境，将训练时间从几天缩短到几分钟。&lt;/p&gt;</description></item><item><title>机器人数据为什么比大模型数据更难？具身智能的数据闭环挑战</title><link>https://worldsensetech.com/zh/articles/robot-data-challenge/</link><pubDate>Thu, 13 Aug 2026 00:00:00 +0000</pubDate><guid>https://worldsensetech.com/zh/articles/robot-data-challenge/</guid><description>&lt;p&gt;大语言模型的发展证明了，大规模、多样化的数据可以显著提升模型能力。但数据规模只是其中一个因素，Transformer 架构、预训练目标、scaling law 以及 RLHF 等后训练方法共同作用，才成就了今天的 LLM。&lt;/p&gt;
&lt;p&gt;但如果你做过机器人 AI，一定知道：机器人领域的数据，比语言数据难得多。&lt;/p&gt;
&lt;p&gt;为什么？机器人数据到底难在哪里？有没有解决方案？&lt;/p&gt;
&lt;p&gt;这篇文章从数据的角度，聊聊具身智能的核心挑战。&lt;/p&gt;
&lt;h2 id="机器人数据的独特挑战"&gt;机器人数据的独特挑战&lt;/h2&gt;
&lt;p&gt;从数据形式上看，文本通常可以被离散化为 token 序列进行处理，而机器人数据天然包含连续控制、多传感器、多时间尺度和物理交互。机器人一次交互涉及 RGB/RGB-D 图像、本体感知（关节状态）、力/力矩、动作轨迹、语言指令、环境状态等多模态信息，具有高维、时序、物理约束和交互依赖等特征。&lt;/p&gt;
&lt;h3 id="1-采集成本高"&gt;1. 采集成本高&lt;/h3&gt;
&lt;p&gt;语言数据可以从互联网上爬取，成本几乎为零。但机器人数据需要真实机器人执行任务，同时记录传感器数据。&lt;/p&gt;
&lt;p&gt;高质量机器人数据采集通常需要昂贵硬件、人工遥操作和大量工程维护。一个复杂任务的数据规模扩展成本远高于互联网数据——不仅需要硬件投入，还需要数据清洗、标注和反复验证。&lt;/p&gt;
&lt;h3 id="2-标注困难"&gt;2. 标注困难&lt;/h3&gt;
&lt;p&gt;语言数据的标注相对简单——分类、实体识别、情感标注，都有明确的标签体系。但机器人数据的标注复杂得多：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;动作标注。机器人动作是连续的高维序列，如何定义&amp;quot;好&amp;quot;的动作？以抓取为例，动作可以是关节轨迹 &lt;code&gt;[q1(t), q2(t)...q7(t)]&lt;/code&gt;、夹爪力、速度、接触状态等。同一个任务存在大量有效解——比如&amp;quot;打开抽屉&amp;quot;可以从左侧拉、从右侧拉、两指抓、三指抓、快速拉或慢速拉——因此机器人数据标注更接近学习一个条件分布 &lt;code&gt;p(action | observation, task)&lt;/code&gt;，而非简单的 &lt;code&gt;f(x) = label&lt;/code&gt; 式的标签预测。&lt;/li&gt;
&lt;li&gt;奖励标注。很多任务没有明确的奖励信号，需要人工设计或从演示中学习。&lt;/li&gt;
&lt;li&gt;场景标注。3D 场景理解、物体位姿、接触点等标注，需要专业工具和知识。&lt;/li&gt;
&lt;/ul&gt;
&lt;h3 id="3-分布狭窄"&gt;3. 分布狭窄&lt;/h3&gt;
&lt;p&gt;语言数据覆盖了各种主题、风格、语言。但机器人数据通常只覆盖：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;特定的机器人硬件&lt;/li&gt;
&lt;li&gt;特定的任务类型&lt;/li&gt;
&lt;li&gt;特定的场景环境&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;这导致机器人模型的泛化能力远不如语言模型。在一个机器人上训练的策略，换个机器人可能就失效了。这里还存在一个更深层的问题——embodiment gap：不仅来自机器人形态差异（如 7-DoF 的 Franka 和人形机器人的手），也来自传感器配置（RGB camera vs tactile sensor vs force-torque）、控制频率（20Hz vs 200Hz）和动作空间的差异。这也是 Open X-Embodiment 等跨机器人数据集的重要性所在——它们探索如何利用跨机器人数据提升泛化能力。&lt;/p&gt;
&lt;h3 id="4-安全性要求"&gt;4. 安全性要求&lt;/h3&gt;
&lt;p&gt;机器人模型出错会直接作用于物理世界，因此安全验证要求更加严格。这意味着：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;训练数据需要过滤危险行为&lt;/li&gt;
&lt;li&gt;部署前需要严格的安全验证&lt;/li&gt;
&lt;li&gt;需要人工监督和干预机制&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;这些安全要求，增加了数据收集和模型训练的复杂度。&lt;/p&gt;
&lt;h2 id="当前的数据获取与扩展方案"&gt;当前的数据获取与扩展方案&lt;/h2&gt;
&lt;p&gt;面对这些挑战，业界有几种主要的应对策略：&lt;/p&gt;</description></item><item><title>世界模型 + VLA：用想象力训练机器人</title><link>https://worldsensetech.com/zh/articles/world-model-synthetic-data-for-vla/</link><pubDate>Thu, 06 Aug 2026 00:00:00 +0000</pubDate><guid>https://worldsensetech.com/zh/articles/world-model-synthetic-data-for-vla/</guid><description>&lt;p&gt;上一篇&lt;a href="https://worldsensetech.com/zh/articles/world-model-lab-setup/"&gt;从零搭建世界模型实验环境&lt;/a&gt;，我们跑通了 DreamerV3。有读者问：训练好的世界模型能做什么？&lt;/p&gt;
&lt;p&gt;今天聊一个更前沿的话题：怎么用世界模型生成合成数据，来增强 VLA（视觉-语言-动作模型）的训练。这是近年来机器人基础模型领域受到广泛关注的研究方向之一。&lt;/p&gt;
&lt;h2 id="为什么-vla-需要合成数据"&gt;为什么 VLA 需要合成数据&lt;/h2&gt;
&lt;p&gt;VLA 的核心能力是让机器人&amp;quot;听懂人话&amp;quot;——你指着桌上的杯子说&amp;quot;把那个红色的拿给我&amp;quot;，它能理解语言指令并执行动作。&lt;/p&gt;
&lt;p&gt;但训练这样的模型需要海量数据：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;真实数据采集成本高：需要人类示范，每条数据都要人操作机器人&lt;/li&gt;
&lt;li&gt;场景覆盖有限：真实环境难以覆盖所有边界情况（比如光线变化、物体遮挡）&lt;/li&gt;
&lt;li&gt;危险动作无法采集：某些失败案例在真实世界太危险，无法收集&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;这就是世界模型的价值所在——它可以在&amp;quot;想象&amp;quot;中生成大量合成数据，弥补真实数据的不足。&lt;/p&gt;
&lt;h2 id="世界模型如何生成合成数据"&gt;世界模型如何生成合成数据&lt;/h2&gt;
&lt;p&gt;回顾一下世界模型的核心能力：给定当前状态和动作，预测未来会发生什么。&lt;/p&gt;
&lt;p&gt;需要说明的是，机器人领域合成数据的来源不仅限于 Dreamer 这类 latent world model，还包括物理模拟器（MuJoCo、Isaac Sim、ManiSkill）、神经渲染环境以及基于视频生成的世界模型。Dreamer 系列是其中适合理解 model-based RL 和 latent imagination 的代表，但实际研究中数据来源更加多元。&lt;/p&gt;
&lt;p&gt;在 DreamerV3 中，RSSM（循环状态空间模型）可以在想象空间中做 rollout：&lt;/p&gt;
&lt;ol&gt;
&lt;li&gt;从真实观测编码初始 latent state（后验状态）&lt;/li&gt;
&lt;li&gt;采样或指定动作序列&lt;/li&gt;
&lt;li&gt;RSSM 逐步预测 latent state 转移和预期奖励&lt;/li&gt;
&lt;li&gt;通过 observation model 解码 latent state 为观测&lt;/li&gt;
&lt;/ol&gt;
&lt;p&gt;世界模型生成的是潜在轨迹（latent trajectories），经过视觉解码器和任务条件映射后，可以进一步构造机器人学习需要的视觉-语言-动作数据。&lt;/p&gt;
&lt;p&gt;需要注意：DreamerV3 的 latent imagination 与近年来基于 diffusion/transformer 的大规模视频生成模型不同。DreamerV3 的核心优势在于策略学习（latent dynamics、reward prediction），而不是直接生成高保真机器人视觉数据。用 DreamerV3 decoder 直接重建的图像往往模糊、细节缺失，长时间 rollout 还可能出现物体身份漂移。这也是为什么机器人领域正在转向 video diffusion world model 和 transformer-based world model（如 UniSim、RoboGen、GAIA-1）来获取更高质量的视觉合成数据。&lt;/p&gt;</description></item><item><title>VLA vs 世界模型，谁主沉浮？</title><link>https://worldsensetech.com/zh/articles/vla-vs-world-model/</link><pubDate>Tue, 04 Aug 2026 00:00:00 +0000</pubDate><guid>https://worldsensetech.com/zh/articles/vla-vs-world-model/</guid><description>&lt;p&gt;2025年到2026年，机器人AI领域出现了两条截然不同的技术路线。一条是以RT-2、OpenVLA、π0为代表的VLA（Vision-Language-Action，视觉-语言-动作），另一条是以DreamerV3、Genie、DIAMOND为代表的世界模型（World Models）。&lt;/p&gt;
&lt;p&gt;很多同行问我：这两条路线，到底该押哪一边？我的回答是：这个问题本身就问错了。&lt;/p&gt;
&lt;p&gt;今天这篇文章，我想把这两条路线拆开来对比，讲清楚它们各自的逻辑、优势和瓶颈，最后聊聊为什么我认为它们最终会走向融合。&lt;/p&gt;
&lt;h2 id="两条路线的核心逻辑"&gt;两条路线的核心逻辑&lt;/h2&gt;
&lt;p&gt;先说VLA。&lt;/p&gt;
&lt;p&gt;VLA的思路很直接：把机器人的控制问题，变成一个&amp;quot;看图说话&amp;quot;问题。给模型一张摄像头的图片，再给它一句语言指令（比如&amp;quot;把红色杯子放到桌子上&amp;quot;），让它直接输出机器人关节应该怎么动。&lt;/p&gt;
&lt;p&gt;本质上，VLA是一个感知-决策的端到端映射。它不关心物理规律是什么，不关心动力学方程怎么解，它只关心一件事：给定当前看到的画面和语言指令，最优的动作是什么？&lt;/p&gt;
&lt;p&gt;这种方法的灵感来自大语言模型的成功。GPT能&amp;quot;看图说话&amp;quot;，那为什么不能让一个类似的模型&amp;quot;看图做动作&amp;quot;？RT-2（Google DeepMind，2023）第一次证明了这条路可行——它把机器人动作离散化成token，直接用Transformer来预测。从此，VLA成了一个热门方向。&lt;/p&gt;
&lt;p&gt;世界模型的思路完全不同。&lt;/p&gt;
&lt;p&gt;前面几篇文章我详细讲过，世界模型的核心是学习&amp;quot;如果我执行这个动作，环境会怎么变化&amp;quot;。它不是直接从观察映射到动作，而是先建立一个环境的&amp;quot;内部模拟器&amp;quot;，然后在这个模拟器中想象不同动作的后果，再选择最优的方案。&lt;/p&gt;
&lt;p&gt;打个比方：VLA像一个经验丰富的老司机，看到路况就直接打方向盘——靠的是大量驾驶数据训练出来的直觉。世界模型像一个谨慎的新手司机，每次变道前都会先在脑中模拟：&amp;ldquo;如果我变道，后面的车会怎么反应？安全吗？&amp;quot;——靠的是对物理世界的理解。&lt;/p&gt;
&lt;p&gt;一句话总结区别：VLA是&amp;quot;看到就做&amp;rdquo;，世界模型是&amp;quot;想了再做&amp;quot;。&lt;/p&gt;
&lt;h2 id="vla的优势和瓶颈"&gt;VLA的优势和瓶颈&lt;/h2&gt;
&lt;p&gt;VLA最大的优势是数据飞轮。&lt;/p&gt;
&lt;p&gt;互联网上有海量的视觉-语言数据（图片、视频、文本），这些数据都可以用来预训练VLA模型。然后再用少量的机器人操作数据做微调。这让VLA天然具备很强的泛化能力——它能理解没见过的物体，能遵循自然语言指令，甚至能做简单的推理。&lt;/p&gt;
&lt;p&gt;2025年涌现的几个代表性工作，把这种优势发挥到了极致：&lt;/p&gt;
&lt;p&gt;π0（Physical Intelligence，2024）：用flow matching生成连续动作序列，在折叠衣服、装洗碗机等复杂家务任务上表现出色。它证明了预训练VLA可以通过少量任务微调，快速适应新任务。&lt;/p&gt;
&lt;p&gt;OpenVLA（斯坦福/UC Berkeley，2024）：开源的VLA模型，基于Llama-2视觉语言模型微调，在Open X-Embodiment数据集上达到了不错的性能。开源让中小团队也能参与VLA研究。&lt;/p&gt;
&lt;p&gt;RT-2（Google DeepMind，2023）：最早把机器人动作变成token的工作，证明了55B参数的VLA可以zero-shot泛化到没见过的物体和指令。&lt;/p&gt;
&lt;p&gt;但VLA有一个根本性的瓶颈：缺乏长程规划能力。&lt;/p&gt;
&lt;p&gt;VLA的每一次决策都是&amp;quot;看到当前画面→输出动作&amp;quot;，它没有一个长期的&amp;quot;计划&amp;quot;。对于简单的单步任务（抓一个杯子），这没问题。但对于需要多步推理的复杂任务（&amp;ldquo;整理这个房间&amp;rdquo;——需要先收桌子、再扫地、再擦窗户），VLA就容易迷失方向。&lt;/p&gt;
&lt;p&gt;另一个问题是样本效率。VLA需要海量的机器人操作数据来微调。收集这些数据非常昂贵——每个任务都需要真实机器人反复执行，或者用仿真生成再迁移。对于中小团队来说，这是一个很高的门槛。&lt;/p&gt;
&lt;h2 id="世界模型的优势和瓶颈"&gt;世界模型的优势和瓶颈&lt;/h2&gt;
&lt;p&gt;世界模型最大的优势是样本效率和规划能力。&lt;/p&gt;
&lt;p&gt;因为世界模型学会了环境的动态规律，它可以在&amp;quot;想象&amp;quot;中生成大量的训练数据。一个训练好的世界模型，跑一天&amp;quot;想象&amp;quot;产生的数据量，可能超过真实机器人跑一个月。这大幅降低了对真实数据的依赖。&lt;/p&gt;
&lt;p&gt;DreamerV3已经证明了这一点：同一套参数，在55款Atari游戏上从零训练，只需要少量真实交互就能达到高水平表现。在机器人操控任务上，它的样本效率比传统RL高出10-100倍。&lt;/p&gt;
&lt;p&gt;规划能力是世界模型的另一张王牌。因为可以在想象中&amp;quot;预演&amp;quot;未来，世界模型天然适合做长程规划。比如一个机械臂要完成&amp;quot;打开抽屉→取出工具→拧螺丝&amp;quot;这样的多步任务，世界模型可以先在想象中模拟整个流程，找到最优的动作序列，再去执行。&lt;/p&gt;
&lt;p&gt;2025-2026年，世界模型方向也有几个重要进展：&lt;/p&gt;
&lt;p&gt;DIAMOND（2024）：用diffusion model做世界模型，在Atari上超越了DreamerV3的表现。证明了生成模型的范式也可以用于环境建模。&lt;/p&gt;
&lt;p&gt;Genie 2（Google DeepMind，2024）：从视频中学习交互式3D环境，可以从单张图片生成可交互的虚拟世界。虽然还不完美，但方向很有想象力。&lt;/p&gt;
&lt;p&gt;但世界模型也有明显的短板。&lt;/p&gt;
&lt;p&gt;第一是规模化困难。世界模型需要学习环境的动态规律，这意味着它必须对物理世界有很精确的理解。这比VLA的&amp;quot;模式匹配&amp;quot;要难得多。目前的世界模型大多还在实验室级别的简单任务上打转，离大规模应用还有距离。&lt;/p&gt;
&lt;p&gt;第二是语言接地弱。世界模型学习的是视觉-动作的映射，它不太理解自然语言指令。要让世界模型遵循&amp;quot;把红色的杯子放到蓝色的桌子上&amp;quot;这样的指令，需要额外的语言模块，目前还没有很好的解决方案。&lt;/p&gt;
&lt;p&gt;第三是长期预测的误差累积。世界模型在想象中预测越远的未来，误差越大。这限制了它的规划深度——通常只能可靠地预测未来几十步，对于需要上百步的复杂任务，规划质量会明显下降。&lt;/p&gt;
&lt;h2 id="对比一张表看清差异"&gt;对比：一张表看清差异&lt;/h2&gt;
&lt;p&gt;把两条路线放在一起对比：&lt;/p&gt;
&lt;table&gt;
	&lt;thead&gt;
			&lt;tr&gt;
					&lt;th&gt;维度&lt;/th&gt;
					&lt;th&gt;VLA&lt;/th&gt;
					&lt;th&gt;世界模型&lt;/th&gt;
			&lt;/tr&gt;
	&lt;/thead&gt;
	&lt;tbody&gt;
			&lt;tr&gt;
					&lt;td&gt;核心思路&lt;/td&gt;
					&lt;td&gt;观察→动作的直接映射&lt;/td&gt;
					&lt;td&gt;学习环境动态，想象后行动&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;类比&lt;/td&gt;
					&lt;td&gt;直觉反应（老司机）&lt;/td&gt;
					&lt;td&gt;心理模拟（谨慎新手）&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;数据需求&lt;/td&gt;
					&lt;td&gt;大量（需要海量操作数据）&lt;/td&gt;
					&lt;td&gt;较少（想象空间增强）&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;泛化能力&lt;/td&gt;
					&lt;td&gt;强（语言接地，可zero-shot）&lt;/td&gt;
					&lt;td&gt;中（受限于训练环境分布）&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;规划能力&lt;/td&gt;
					&lt;td&gt;弱（单步决策为主）&lt;/td&gt;
					&lt;td&gt;强（可多步想象推演）&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;语言理解&lt;/td&gt;
					&lt;td&gt;强（天然支持语言指令）&lt;/td&gt;
					&lt;td&gt;弱（需要额外模块）&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;规模化&lt;/td&gt;
					&lt;td&gt;容易（可复用LLM基础设施）&lt;/td&gt;
					&lt;td&gt;困难（环境建模复杂度高）&lt;/td&gt;
			&lt;/tr&gt;
			&lt;tr&gt;
					&lt;td&gt;代表工作&lt;/td&gt;
					&lt;td&gt;RT-2, π0, OpenVLA&lt;/td&gt;
					&lt;td&gt;DreamerV3, DIAMOND, Genie 2&lt;/td&gt;
			&lt;/tr&gt;
	&lt;/tbody&gt;
&lt;/table&gt;
&lt;p&gt;看完这张表，你可能觉得VLA全面占优。短期来看确实如此——VLA更容易工程化，更容易拿到融资，也更容易做出demo。但世界模型在样本效率和规划能力上的优势，是VLA短期内很难弥补的。&lt;/p&gt;</description></item><item><title>具身智能、强化学习的前景如何？</title><link>https://worldsensetech.com/zh/articles/embodied-ai-rl-prospects/</link><pubDate>Tue, 04 Aug 2026 00:00:00 +0000</pubDate><guid>https://worldsensetech.com/zh/articles/embodied-ai-rl-prospects/</guid><description>&lt;p&gt;这个问题最近被问得很多。我结合自己观察到的行业情况和招聘市场的变化，说一些实际的。&lt;/p&gt;
&lt;h2 id="先说结论前景好但分化严重"&gt;先说结论：前景好，但分化严重&lt;/h2&gt;
&lt;p&gt;具身智能和强化学习不是&amp;quot;uniformly good&amp;quot;的方向。不同细分领域、不同公司类型、不同岗位的需求差异很大。&lt;/p&gt;
&lt;p&gt;一句话总结：算法岗卷，工程岗缺，应用岗刚起步。&lt;/p&gt;
&lt;h2 id="算法岗卷但天花板高"&gt;算法岗：卷，但天花板高&lt;/h2&gt;
&lt;p&gt;强化学习算法工程师是最热门的方向之一，但竞争也很激烈。&lt;/p&gt;
&lt;p&gt;需求端：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;大厂AI Lab（DeepMind、OpenAI、Meta、字节、腾讯）：持续招聘，但门槛极高，基本要求顶会论文+名校博士&lt;/li&gt;
&lt;li&gt;人形机器人公司（宇树、智元、傅利叶等）：2024-2025年大量扩招，但2026年开始收紧，更看重实际落地能力&lt;/li&gt;
&lt;li&gt;自动驾驶公司（Waymo、小鹏、华为）：决策规划模块需要RL背景，需求稳定&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;薪资范围（2026年，国内，仅供参考）：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;应届博士：约40-80万/年（大厂SP offer可达100万+，但名额很少）&lt;/li&gt;
&lt;li&gt;3-5年经验：约60-120万/年（因公司、地区、个人能力差异较大）&lt;/li&gt;
&lt;li&gt;资深/专家：150万+（这类岗位非常稀缺）&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;现实问题：算法岗的HC（headcount）在减少。2024年人形机器人热潮时大量招聘，2025-2026年很多公司发现技术落地比预期慢，开始优化团队。纯算法、没有工程能力的人风险最大。&lt;/p&gt;
&lt;h2 id="工程岗缺人但要求复合背景"&gt;工程岗：缺人，但要求复合背景&lt;/h2&gt;
&lt;p&gt;这是我觉得被低估的方向。&lt;/p&gt;
&lt;p&gt;具身智能不只是算法问题，更是工程问题。把模型部署到真实机器人上，需要解决：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;实时控制：策略推理延迟要控制在10ms以内&lt;/li&gt;
&lt;li&gt;硬件集成：传感器标定、执行器驱动、通信协议&lt;/li&gt;
&lt;li&gt;系统优化：CUDA加速、模型压缩、边缘部署&lt;/li&gt;
&lt;li&gt;仿真平台：搭建和维护大规模并行仿真环境&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;能做这些事的人，目前市场上很缺。而且这类岗位对学历的要求相对宽松——本科+实战经验就可以，不一定需要博士。&lt;/p&gt;
&lt;p&gt;薪资范围（仅供参考）：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;3-5年经验：约50-90万/年（因公司、地区、个人能力差异较大）&lt;/li&gt;
&lt;li&gt;资深工程师：约80-150万/年（高级岗位数量有限）&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;不比算法岗低多少，但竞争小很多。&lt;/p&gt;
&lt;h2 id="应用岗刚起步机会最大"&gt;应用岗：刚起步，机会最大&lt;/h2&gt;
&lt;p&gt;这是我最看好的方向。&lt;/p&gt;
&lt;p&gt;具身智能的技术已经过了&amp;quot;能不能做&amp;quot;的阶段，进入&amp;quot;怎么用&amp;quot;的阶段。工厂里需要把AI能力集成到现有产线，物流公司需要机器人分拣，医院需要手术辅助——这些场景不需要你发明新算法，需要你把现有技术应用到具体问题。&lt;/p&gt;
&lt;p&gt;典型岗位：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;机器人应用工程师：负责具体场景的任务适配和部署&lt;/li&gt;
&lt;li&gt;Sim-to-Real工程师：把仿真训练的策略迁移到真实机器人&lt;/li&gt;
&lt;li&gt;技术方案工程师：对接客户需求，设计技术解决方案&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;这类岗位的需求正在快速增长，但目前供给不足。因为传统机器人工程师不懂AI，AI工程师不懂机器人，两者都懂的人很少。&lt;/p&gt;
&lt;p&gt;薪资范围（仅供参考）：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;3-5年经验：约40-70万/年（因公司、地区、个人能力差异较大）&lt;/li&gt;
&lt;li&gt;资深/管理岗：约70-120万/年（这类岗位相对稀缺）&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;起薪可能不如算法岗，但增长空间大，而且离业务近，不容易被优化。&lt;/p&gt;
&lt;h2 id="几个趋势判断"&gt;几个趋势判断&lt;/h2&gt;
&lt;ol&gt;
&lt;li&gt;纯算法岗会继续卷，工程和应用岗会升值。&lt;/li&gt;
&lt;/ol&gt;
&lt;p&gt;随着基础模型（大语言模型、基础世界模型）越来越强，&amp;ldquo;调参侠&amp;quot;的价值在下降。能把模型落地的人价值在上升。&lt;/p&gt;
&lt;ol start="2"&gt;
&lt;li&gt;跨界人才最吃香。&lt;/li&gt;
&lt;/ol&gt;
&lt;p&gt;懂AI + 懂机器人 + 懂行业（制造、物流、医疗）的复合型人才，未来3-5年都会很抢手。&lt;/p&gt;
&lt;ol start="3"&gt;
&lt;li&gt;创业机会在应用层。&lt;/li&gt;
&lt;/ol&gt;
&lt;p&gt;基础模型是大厂的游戏，但应用层有大量细分场景还没被覆盖。比如&amp;quot;用世界模型做工厂机器人快速任务适配&amp;rdquo;，这种方向大厂看不上，但市场需求真实存在。&lt;/p&gt;
&lt;ol start="4"&gt;
&lt;li&gt;地域分化明显。&lt;/li&gt;
&lt;/ol&gt;
&lt;p&gt;北京、上海、深圳、杭州集中了80%以上的岗位。其他城市的机会很少，除非是当地有机器人产业集群（比如东莞、苏州）。&lt;/p&gt;
&lt;h2 id="给不同背景的人的建议"&gt;给不同背景的人的建议&lt;/h2&gt;
&lt;p&gt;在校学生：如果有机会读博，读博。算法岗的门槛只会越来越高。但博士期间一定要做有工程价值的工作，不要纯理论。&lt;/p&gt;
&lt;p&gt;转行者：不要直接冲算法岗，竞争太激烈。从工程岗或应用岗切入，积累实战经验后再往算法方向转。&lt;/p&gt;
&lt;p&gt;传统机器人工程师：学PyTorch、学RL基础、学仿真工具（MuJoCo、Isaac Sim）。你已有的机器人知识是优势，补上AI这块就很有竞争力。&lt;/p&gt;
&lt;p&gt;纯软件工程师：学机器人学基础、学控制理论、了解硬件。你的编程能力是优势，补上物理世界这块。&lt;/p&gt;
&lt;h2 id="最后说一点"&gt;最后说一点&lt;/h2&gt;
&lt;p&gt;具身智能和强化学习的前景是好的，但这个&amp;quot;好&amp;quot;不是均匀的。它属于那些愿意深入理解问题、能动手解决实际问题的人，不属于只想追风口的人。&lt;/p&gt;
&lt;p&gt;我自己在做的方向是世界模型 + Sim-to-Real，属于工程和应用之间的交叉地带。没有大厂的资源，也没有学术界的背景，但通过持续输出内容、积累实战经验，慢慢建立自己的影响力。&lt;/p&gt;
&lt;p&gt;这条路不快，但走通了就很稳。&lt;/p&gt;</description></item><item><title>你认为具身智能领域在2026年会有什么突破性进展？</title><link>https://worldsensetech.com/zh/articles/embodied-ai-2026-breakthrough/</link><pubDate>Mon, 03 Aug 2026 00:00:00 +0000</pubDate><guid>https://worldsensetech.com/zh/articles/embodied-ai-2026-breakthrough/</guid><description>&lt;p&gt;具身智能（Embodied AI）在2025年已经明显加速了。人形机器人公司扎堆融资，大模型厂商纷纷布局机器人方向，各国政府也把具身智能列为战略重点。站在2026年的节点上，我觉得有几个方向会出现实质性突破。&lt;/p&gt;
&lt;h2 id="突破一世界模型从能想象到能决策"&gt;突破一：世界模型从&amp;quot;能想象&amp;quot;到&amp;quot;能决策&amp;quot;&lt;/h2&gt;
&lt;p&gt;2023-2024年，DreamerV3证明了世界模型可以在仿真中高效训练策略。但那时候的世界模型更像一个&amp;quot;环境模拟器&amp;quot;——能预测下一步会怎样，但和实际决策之间还隔着一层。&lt;/p&gt;
&lt;p&gt;2026年，我看到一个明显趋势：世界模型开始直接和决策系统打通。不再是&amp;quot;先建模、再训练策略&amp;quot;的两阶段流程，而是端到端的&amp;quot;建模即决策&amp;quot;。这意味着机器人可以在想象空间中直接完成从感知到规划到控制的全流程，不需要额外的策略网络。&lt;/p&gt;
&lt;p&gt;这个突破的意义在于：大幅缩短从&amp;quot;理解世界&amp;quot;到&amp;quot;采取行动&amp;quot;的链路，让机器人的反应速度接近人类水平。&lt;/p&gt;
&lt;h2 id="突破二sim-to-real迁移出现工程化方案"&gt;突破二：Sim-to-Real迁移出现工程化方案&lt;/h2&gt;
&lt;p&gt;这是我最期待的突破。过去八年，Sim-to-Real一直是世界模型落地的最大瓶颈。仿真里训练的策略，到真实世界性能打对折。&lt;/p&gt;
&lt;p&gt;2026年，几个技术路线开始 converge（汇合）：&lt;/p&gt;
&lt;p&gt;系统辨识自动化。不再需要工程师手动调参来匹配仿真和真实世界的物理参数，模型可以自动从少量真实数据中学习未建模的动态。&lt;/p&gt;
&lt;p&gt;渐进式信任迁移。策略不是一次性从仿真跳到真实世界，而是通过&amp;quot;仿真→混合环境→真实世界&amp;quot;的渐进过程，每一步都有安全约束保证不会出大问题。&lt;/p&gt;
&lt;p&gt;在线模型适配。部署到真实世界后，模型能持续从真实数据中学习，不断修正自己的预测偏差。&lt;/p&gt;
&lt;p&gt;这几个方向结合起来，2026年应该能看到第一批*&amp;ldquo;仿真训练、真实部署、性能不打折&amp;quot;的工业案例。不是实验室demo，是真正能在工厂里跑的。&lt;/p&gt;
&lt;h2 id="突破三多模态感知与物理理解的融合"&gt;突破三：多模态感知与物理理解的融合&lt;/h2&gt;
&lt;p&gt;之前的世界模型主要处理视觉信息（相机图像）。但真实世界的机器人需要融合多种感知——视觉、触觉、力觉、甚至听觉。&lt;/p&gt;
&lt;p&gt;2026年，多模态世界模型开始成熟。机器人不仅能&amp;quot;看到&amp;quot;物体，还能通过触觉反馈理解物体的材质、重量、摩擦力。这种多模态的物理理解，是灵巧操作（比如拧瓶盖、系鞋带、翻书页）的关键前提。&lt;/p&gt;
&lt;p&gt;我特别关注的是触觉传感器的进步。新一代高分辨率触觉传感器（比如GelSight的后续产品）能提供密集的接触力分布信息，让世界模型的物理预测从&amp;quot;大概合理&amp;quot;变成&amp;quot;精确可信&amp;rdquo;。&lt;/p&gt;
&lt;h2 id="突破四基础世界模型的雏形出现"&gt;突破四：基础世界模型的雏形出现&lt;/h2&gt;
&lt;p&gt;大语言模型的成功证明了一个规律：当模型足够大、数据足够多时，会涌现出意想不到的能力。世界模型领域也在走这条路。&lt;/p&gt;
&lt;p&gt;2026年，可能会出现第一批&amp;quot;基础世界模型&amp;quot;的雏形——不是针对某个特定任务训练的，而是在大规模多任务数据上预训练的通用世界模型。这种模型可以通过少量微调适配到不同的机器人任务上，就像GPT可以通过prompt适配到不同文本任务一样。&lt;/p&gt;
&lt;p&gt;当然，离真正的&amp;quot;通用世界模型&amp;quot;还很远。计算成本、数据规模、架构设计都还有大量问题。但方向是明确的，2026年应该能看到有价值的早期成果。&lt;/p&gt;
&lt;h2 id="一个需要冷静的地方"&gt;一个需要冷静的地方&lt;/h2&gt;
&lt;p&gt;说了这么多突破，也要泼一点冷水。&lt;/p&gt;
&lt;p&gt;具身智能的突破和NLP/视觉领域的突破有一个本质区别：它需要和物理世界打交道。&lt;/p&gt;
&lt;p&gt;大语言模型可以在服务器上跑，用户通过浏览器访问，边际成本几乎为零。但具身智能的每一个应用都需要硬件——机器人、传感器、执行器。这意味着规模化比纯软件慢得多，成本也高得多。&lt;/p&gt;
&lt;p&gt;所以2026年的突破更多是&amp;quot;技术验证&amp;quot;层面的，离&amp;quot;大规模商业化&amp;quot;还有距离。不要指望明年就能看到人形机器人在你家做饭——那个场景至少还要5-10年。&lt;/p&gt;
&lt;h2 id="对从业者的建议"&gt;对从业者的建议&lt;/h2&gt;
&lt;p&gt;如果你在具身智能方向工作或者想进入这个方向，2026年有几个值得关注的切入点：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;世界模型 + 工业场景：这是离钱最近的方向。工厂里的机器人任务适配、质量检测、柔性制造，都有真实需求。&lt;/li&gt;
&lt;li&gt;Sim-to-Real工具链：帮企业把仿真训练的策略部署到真实机器人上，这个需求会越来越大。&lt;/li&gt;
&lt;li&gt;多模态感知融合：特别是触觉+视觉的融合，是灵巧操作的关键。&lt;/li&gt;
&lt;li&gt;基础世界模型：如果你有算力资源和大团队，这是长期价值最高的方向。&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;我自己关注的是前两个方向。没有大厂的算力，也没有学术界的资源，但在工业场景的落地经验上有一些积累。用自己能做好的方式参与这个变革，就够了。&lt;/p&gt;</description></item><item><title>没有博士学位，也能进入具身智能领域吗？</title><link>https://worldsensetech.com/zh/articles/embodied-ai-guide/</link><pubDate>Fri, 31 Jul 2026 00:00:00 +0000</pubDate><guid>https://worldsensetech.com/zh/articles/embodied-ai-guide/</guid><description>&lt;p&gt;前几天有个读者私信问我：&amp;ldquo;我本科毕业，做了三年嵌入式开发，想转具身智能方向，是不是必须读个博士？&amp;rdquo;&lt;/p&gt;
&lt;p&gt;这个问题我想了很久。因为我自己也不是学术出身——虽然读了硕士，但离&amp;quot;学术大牛&amp;quot;差得很远。在具身智能这个方向上，身边很多同事都是名校博士，发过顶会论文。作为一个&amp;quot;普通工程师&amp;quot;，怎么在这个领域找到自己的位置？&lt;/p&gt;
&lt;p&gt;今天这篇文章，我想诚实地聊聊这个话题。不灌鸡汤，只说实际的。&lt;/p&gt;
&lt;h2 id="先说结论可以但需要策略"&gt;先说结论：可以，但需要策略&lt;/h2&gt;
&lt;p&gt;具身智能确实是一个门槛较高的领域。它需要机器人学、强化学习、计算机视觉、甚至机械设计的交叉知识。很多核心论文来自Stanford、CMU、UC Berkeley等顶尖高校的实验组，作者清一色是教授+博士生的组合。&lt;/p&gt;
&lt;p&gt;但这不意味着没有博士学位就没机会。原因有几个：&lt;/p&gt;
&lt;p&gt;第一，工业界的需求在快速增长。人形机器人、工业协作机器人、自动驾驶等领域正在快速商业化。这些公司不仅需要算法研究者，更需要能把算法落地为产品的工程师。写得了CUDA、调得了ROS、搞得定硬件集成的工程师，在很多方面比纯学术背景的人更有优势。&lt;/p&gt;
&lt;p&gt;第二，开源生态降低了入门门槛。五年前，你想做机器人强化学习，需要一个价值几十万的硬件平台。现在，MuJoCo免费了，Isaac Sim有社区版，PyBullet完全开源。DreamerV3、TD-MPC2等算法都有高质量的开源实现。你只需要一台带GPU的电脑就能开始。&lt;/p&gt;
&lt;p&gt;第三，这个领域还在早期，机会窗口仍然开放。不像计算机视觉或NLP已经形成了相对固化的学术圈子，具身智能还在快速发展中。新的问题不断出现，旧的解决方案不断被推翻。在这种环境下，实战经验和工程直觉的价值不亚于学术论文。&lt;/p&gt;
&lt;h2 id="需要掌握的核心技能"&gt;需要掌握的核心技能&lt;/h2&gt;
&lt;p&gt;具身智能的知识体系很广，但不需要全部掌握。根据你想做的方向不同，重点也不同。我把核心技能分成三层：&lt;/p&gt;
&lt;h3 id="基础层必须掌握"&gt;基础层（必须掌握）&lt;/h3&gt;
&lt;p&gt;不管你做哪个细分方向，这些是基本功：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;Python编程：不需要精通，但要能熟练写数据处理、模型训练、可视化脚本&lt;/li&gt;
&lt;li&gt;深度学习基础：理解CNN、RNN、Transformer的基本原理，能用PyTorch搭建和训练模型&lt;/li&gt;
&lt;li&gt;强化学习基础：理解MDP、策略梯度、Actor-Critic、Q-learning等核心概念&lt;/li&gt;
&lt;li&gt;线性代数和概率论：矩阵运算、概率分布、贝叶斯定理——这些是理解论文的数学基础&lt;/li&gt;
&lt;/ul&gt;
&lt;h3 id="核心层至少掌握一个方向"&gt;核心层（至少掌握一个方向）&lt;/h3&gt;
&lt;p&gt;根据你的兴趣和背景，选择一个方向深入：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;仿真与Sim-to-Real：掌握一个仿真器（推荐MuJoCo），理解域随机化、系统辨识等迁移方法&lt;/li&gt;
&lt;li&gt;世界模型：理解RSSM、DreamerV3的架构，能跑通开源实现并做修改&lt;/li&gt;
&lt;li&gt;操作规划：理解运动规划（RRT、优化方法）、抓取规划、力控等&lt;/li&gt;
&lt;li&gt;感知与视觉：理解6D位姿估计、点云处理、视觉伺服等&lt;/li&gt;
&lt;/ul&gt;
&lt;h3 id="加分层有余力再学"&gt;加分层（有余力再学）&lt;/h3&gt;
&lt;ul&gt;
&lt;li&gt;ROS2：机器人操作系统，工业界标配&lt;/li&gt;
&lt;li&gt;C++/CUDA：性能优化，实时控制&lt;/li&gt;
&lt;li&gt;机械设计基础：理解机器人的物理约束&lt;/li&gt;
&lt;li&gt;控制理论：PID、MPC、阻抗控制等经典方法&lt;/li&gt;
&lt;/ul&gt;
&lt;h2 id="推荐的学习路径"&gt;推荐的学习路径&lt;/h2&gt;
&lt;p&gt;如果你是从零开始，我建议按以下顺序学习。每个阶段大约需要1-2个月（假设每周投入10-15小时）。&lt;/p&gt;
&lt;p&gt;阶段一：打基础（1-2个月）&lt;/p&gt;
&lt;p&gt;目标：掌握深度学习和强化学习的基本概念。&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;课程：李宏毅的机器学习课程（B站有，免费，讲得非常好）&lt;/li&gt;
&lt;li&gt;课程：David Silver的强化学习课程（YouTube/B站都有）&lt;/li&gt;
&lt;li&gt;实践：用PyTorch实现一个简单的DQN，在CartPole上跑通&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;阶段二：进入仿真（1-2个月）&lt;/p&gt;
&lt;p&gt;目标：熟悉一个仿真环境，能训练简单的机器人策略。&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;安装MuJoCo和对应的Python绑定&lt;/li&gt;
&lt;li&gt;跟着教程让一个机械臂学会 reaching（抓取目标位置）&lt;/li&gt;
&lt;li&gt;用PPO或SAC训练一个简单任务，理解训练过程中的各种参数&lt;/li&gt;
&lt;li&gt;推荐资源：MuJoCo官方文档和示例&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;阶段三：学习世界模型（2-3个月）&lt;/p&gt;
&lt;p&gt;目标：理解DreamerV3的架构，能跑通并修改开源代码。&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;读DreamerV3论文（先读一遍不求甚解，再精读关键章节）&lt;/li&gt;
&lt;li&gt;找到开源实现（GitHub上搜&amp;quot;dreamerv3&amp;quot;），跑通Atari或MuJoCo的示例&lt;/li&gt;
&lt;li&gt;尝试修改一些超参数，观察对训练的影响&lt;/li&gt;
&lt;li&gt;尝试在自己的MuJoCo任务上使用DreamerV3&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;阶段四：做一个完整项目（2-3个月）&lt;/p&gt;
&lt;p&gt;目标：从零完成一个&amp;quot;仿真训练→Sim-to-Real迁移&amp;quot;的完整流程。&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;选择一个具体任务（比如机械臂抓取、四足行走）&lt;/li&gt;
&lt;li&gt;在仿真中训练策略&lt;/li&gt;
&lt;li&gt;实现域随机化，测试策略的鲁棒性&lt;/li&gt;
&lt;li&gt;如果有硬件，尝试迁移到真实机器人；如果没有，做一个详细的仿真分析报告也行&lt;/li&gt;
&lt;li&gt;把过程和结果写成博客或论文&lt;/li&gt;
&lt;/ul&gt;
&lt;h2 id="一些实际的建议"&gt;一些实际的建议&lt;/h2&gt;
&lt;p&gt;在学习和实践的过程中，有几点经验我想分享：&lt;/p&gt;
&lt;ol&gt;
&lt;li&gt;
&lt;p&gt;不要试图读完所有论文。具身智能的论文数量增长非常快，每个月都有几十篇新的工作。你不可能全部读完，也不需要。选择2-3篇核心论文（比如DreamerV3、TD-MPC2、ACT），精读理解，其他的泛读了解即可。&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;动手比读论文重要10倍。很多人花大量时间读论文，但从来不动手写代码。这是最大的误区。读论文理解的是&amp;quot;idea&amp;quot;，但真正的理解来自于你亲手实现、调试、看到训练曲线时的顿悟。&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;写博客是最好的学习方式。当你试图把一个概念解释给别人时，你会发现自己理解中的漏洞。而且，博客是你最好的简历——它展示了你的技术深度、表达能力和持续学习的习惯。&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;找到社区。一个人学习很容易放弃。加入一些社区（比如知乎的相关话题、GitHub的讨论区、线下的机器人meetup），和同行交流。很多问题你以为只有自己遇到，其实别人早就踩过了。&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;接受&amp;quot;慢&amp;quot;。具身智能是一个需要积累的领域，不像Web开发可以速成。给自己至少一年的时间来打基础，不要期望三个月就能成为专家。耐心是这个领域最重要的品质之一。&lt;/p&gt;
&lt;/li&gt;
&lt;/ol&gt;
&lt;h2 id="关于职业路径"&gt;关于职业路径&lt;/h2&gt;
&lt;p&gt;最后聊一下职业发展。具身智能方向的工程师，目前主要有几条路：&lt;/p&gt;
&lt;p&gt;工业机器人的AI升级：传统工业机器人厂商（ABB、KUKA、FANUC等）正在积极引入AI能力。他们需要既懂传统机器人控制，又懂强化学习的工程师。这是一个需求量大、相对稳定的方向。&lt;/p&gt;
&lt;p&gt;人形机器人公司：近两年涌现了大量人形机器人创业公司。这些公司需要全栈型人才——能从算法做到部署。风险高，但如果公司做起来了，回报也大。&lt;/p&gt;
&lt;p&gt;仿真平台与工具：做仿真器、训练框架、可视化工具的公司。这个方向更偏软件工程，适合有扎实编程基础的工程师。&lt;/p&gt;</description></item></channel></rss>