锐知 - 全球认知雷达

Training Data / Sequoia Capital ·

机器人的终局:英伟达 Jim Fan 的大平行路线图

演讲者回顾大模型六年三级跳,预训练学语言形状,指令微调对齐到有用工作,强化学习做推理并超越模仿,最终走向自动研究。对机器人从业者的用处是提供一张对照表,每一步都可以问自己对应环节在哪里。

2016年夏天,就在这间办公室里,穿着亮面皮衣的黄仁勋抱着一块大金属板走进来,上面写着送给埃隆和 OpenAI 团队的世界第一台 DGX-1。当时还是实习生的 Jim Fan 挤上去签了名,旁边就是 Andrej 的名字。回看那一刻,他说自己完全不知道签下的是什么,而接下来发生的事,用 Ilya 的话说,就是相信深度学习的人,得到了深度学习的回报。 从 GPT-3 的预训练,到 2022 年 Instruct GPT 的指令微调,再到用强化学习做推理、超越模仿学习,直至自动研

来源:youtube 原始内容