
  <rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
    <channel>
      <title>Chaos and Order</title>
      <link>https://www.youngju.dev/blog</link>
      <description>천천히 올바르게. AI Researcher &amp; DevOps Engineer Youngju&#39;s blog. GPU/CUDA, LLM, MLOps, Kubernetes AI workloads, and data engineering — plus mindset essays on confidence, routines, health, and sport psychology.</description>
      <language>ko</language>
      <managingEditor>fjvbn2003@gmail.com (Youngju Kim)</managingEditor>
      <webMaster>fjvbn2003@gmail.com (Youngju Kim)</webMaster>
      <lastBuildDate>Fri, 31 Jul 2026 00:00:00 GMT</lastBuildDate>
      <atom:link href="https://www.youngju.dev/tags/distillation/feed.xml" rel="self" type="application/rss+xml"/>
      
  <item>
    <guid>https://www.youngju.dev/blog/2026-07-31-distillation-what-transfers-and-what-does-not</guid>
    <title>증류로 전이되는 것과 안 되는 것 — DeepSeek을 GPT-OSS에 증류했더니 검열이 따라오지 않았다</title>
    <link>https://www.youngju.dev/blog/2026-07-31-distillation-what-transfers-and-what-does-not</link>
    <description>2026년 7월 30일 Show HN에 올라온 CTGT의 실험은 DeepSeek V4 Flash를 교사로, GPT-OSS를 학생으로 삼아 금융 추론 능력을 증류했더니 능력은 넘어왔는데 정치 검열은 넘어오지 않았다고 보고합니다. 대응 쌍 152개에서 교사는 민감 질문과 대조군 사이에 45.45점의 검열 격차를 보였지만 학생은 0.43점과 3.94점으로 기준선에 머물렀습니다. 이 글은 그 실험 하나를 확대하지 않고 출발점으로만 씁니다 — 증류가 복사하는 것은 교사의 출력 분포이므로, 무엇을 관찰했는지·어디서 관찰했는지·누구에게 복사하는지 세 축이 전이 여부를 정한다는 틀을 세우고, 잠재적 학습 연구가 보여 준 정반대 방향의 증거(공유 초기화일 때는 관찰하지 않은 성향까지 새어 나간다)까지 함께 놓습니다.</description>
    <pubDate>Fri, 31 Jul 2026 00:00:00 GMT</pubDate>
    <author>fjvbn2003@gmail.com (Youngju Kim)</author>
    <category>ai</category><category>llm</category><category>distillation</category><category>alignment</category><category>open-weights</category>
  </item>

    </channel>
  </rss>
