<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/"><channel><title>ZeRO on zzudongxiang</title><link>https://www.zzudongxiang.com/tags/zero/</link><description>Recent content in ZeRO on zzudongxiang</description><generator>Hugo</generator><language>zh-cn</language><copyright>2026 zzudongxiang.com · 豫ICP备2022012018号-1 · 豫公网安备41160202000614号</copyright><lastBuildDate>Mon, 01 Apr 2024 00:00:00 +0000</lastBuildDate><atom:link href="https://www.zzudongxiang.com/tags/zero/index.xml" rel="self" type="application/rss+xml"/><item><title>数据并行（Data Parallelism）</title><link>https://www.zzudongxiang.com/posts/data-parallelism/</link><pubDate>Mon, 01 Apr 2024 00:00:00 +0000</pubDate><guid>https://www.zzudongxiang.com/posts/data-parallelism/</guid><description>&lt;div&gt;
&lt;blockquote&gt;
&lt;p&gt;参考文献：&lt;/p&gt;
&lt;p&gt;&lt;span style="font-size: 14.4px"&gt;Team D, Majumder R, President V, et al. DeepSpeed: Extreme-scale model training for everyone&lt;/p&gt;
\[J\]&lt;p&gt;. Microsoft, 2020.&lt;/span&gt;&lt;/p&gt;
&lt;p&gt;&lt;span style="font-size: 14.4px"&gt;Rajbhandari S, Rasley J, Ruwase O, et al. ZeRO: Memory optimizations Toward Training Trillion Parameter Models&lt;/p&gt;
\[C\]&lt;p&gt;, 2020. IEEE, 2020-01-01.&lt;/span&gt;&lt;/p&gt;
&lt;p&gt;Ren J, Rajbhandari S, Aminabadi R Y, et al. ZeRO-Offload: Democratizing Billion-Scale Model Training&lt;/p&gt;
\[J\]&lt;p&gt;. &lt;a href="http://arXiv.org" rel="noopener noreferrer nofollow" target="_blank"&gt;arXiv.org&lt;/a&gt;, 2021.&lt;/p&gt;
&lt;p&gt;&lt;span style="font-size: 14.4px"&gt;Rajbhandari S, Ruwase O, Rasley J, et al. ZeRO-Infinity: Breaking the GPU MemoryWall for Extreme Scale Deep Learning: SC&amp;rsquo; 21, November 14–19, 2021, St. Louis, MO, USA&lt;/p&gt;</description></item></channel></rss>