
  <rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
    <channel>
      <title>潘健豪 | 具身智能与世界模型</title>
      <link>https://pan-jianhao-portfolio.pages.dev/blog</link>
      <description>潘健豪的具身智能、世界模型仿真与三维交互算法作品集。</description>
      <language>zh-CN</language>
      <managingEditor>2070705796@qq.com (潘健豪)</managingEditor>
      <webMaster>2070705796@qq.com (潘健豪)</webMaster>
      <lastBuildDate>Thu, 30 Jul 2026 00:00:00 GMT</lastBuildDate>
      <atom:link href="https://pan-jianhao-portfolio.pages.dev/tags/flow-matching/feed.xml" rel="self" type="application/rss+xml"/>
      
  <item>
    <guid>https://pan-jianhao-portfolio.pages.dev/blog/flow-grpo-complete-guide</guid>
    <title>Flow-GRPO：从采样到梯度回传的完整逻辑</title>
    <link>https://pan-jianhao-portfolio.pages.dev/blog/flow-grpo-complete-guide</link>
    <description>从采样、reward、advantage 到 loss 与 LoRA 梯度，追踪 Flow-GRPO 训练链路中每一步到底发生了什么。</description>
    <pubDate>Thu, 30 Jul 2026 00:00:00 GMT</pubDate>
    <author>2070705796@qq.com (潘健豪)</author>
    <category>Autonomous Driving</category><category>Flow Matching</category><category>GRPO</category><category>强化学习</category>
  </item>

    </channel>
  </rss>
