AI
AI
资讯
alishangtian.com
首页
大模型
智能体
开源项目
研究前沿
行业动态
专题
专题 · TOPICS
一叶一世界
27 篇
Agent 工程系统学习
14 篇
Agent 沙箱技术专题
13 篇
大模型基本功
24 篇
AI 推理与部署
17 篇
算法题解
32 篇
AI 编程实战
9 篇
RAG 实战手册
16 篇
后端技术
32 篇
模型微调实战
9 篇
推理模型
8 篇
端侧智能
7 篇
论文精读
8 篇
AI 行业观察
8 篇
AI 安全与攻防
17 篇
多模态之路
11 篇
具身智能与机器人
5 篇
AI for Science
7 篇
世界模型与视频生成
10 篇
AI 治理与合规
4 篇
开源模型全景
9 篇
Kubernetes 深入实践
6 篇
MLOps 与 LLM 工程化
4 篇
全部专题 →
主题色 · THEME
靛蓝(默认)
极光
落日
薰衣草
海洋
森林
暮橙
石墨
自定义
恢复默认
提交线索
agent
anthropic
openai
huggingface daily papers
ai安全
it之家
jake wharton
solidot
gpu
港股
搜索:
DiffusionPolicy
共命中 1 条(服务端检索)
Diffusion Policy:机器人动作生成为什么弃用回归、改用扩散模型
模仿学习的老问题是「多峰动作分布」——两种都对的做法被回归平均成一种错的。Diffusion Policy 用条件去噪扩散直接建模动作分布,在 12 个任务、4 个基准上平均成功率提升 46.9%,此后 DP3、DPPO 相继跟进,π0 的流匹配与 GR00T 的扩散 Transformer 把它推成了 VLA 时代的标配动作头。
原创
研究前沿
精选
· 原创 · 今天
阅读 0
·
访客 0