<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
	<channel>
		<title>Deepseek on makhal.fr</title>
		<link>https://makhal.fr/tags/deepseek/</link>
		<description>Recent content in Deepseek on makhal.fr</description>
		<generator>Hugo</generator>
		<language>fr-fr</language>
		
		
		
		
			<lastBuildDate>Wed, 05 Aug 2026 07:00:00 +0200</lastBuildDate>
		
			<atom:link href="https://makhal.fr/tags/deepseek/index.xml" rel="self" type="application/rss+xml" />
			<item>
				<title>DeepSeek-V4-Flash sur deux PGX : ce que donnent 68 tok/s en vrai</title>
				<link>https://makhal.fr/posts/docs/inference/deepseek-2-dgx/</link>
				<pubDate>Wed, 05 Aug 2026 07:00:00 +0200</pubDate>
				<guid>https://makhal.fr/posts/docs/inference/deepseek-2-dgx/</guid>
				<description>&lt;p&gt;Depuis quelque temps, j&amp;rsquo;ai deux Lenovo ThinkStation PGX au bureau. Deux boîtiers, chacun avec une GB10, reliés à 200 Gb/s.&lt;/p&gt;&#xA;&lt;p&gt;La question n&amp;rsquo;était pas &amp;ldquo;qu&amp;rsquo;est-ce que je peux faire tourner dessus&amp;rdquo; ça, je le savais déjà, tout le monde sait lancer un &lt;code&gt;ollama run&lt;/code&gt; et regarder les tokens défiler. La vraie question, celle qui alimente la série que je prépare sur l&amp;rsquo;IA locale et souveraine (deux mots très à la mode), c&amp;rsquo;était :&lt;/p&gt;</description>
			</item>
	</channel>
</rss>
