<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
	<channel>
		<title>Inférence on libcom.de</title>
		<link>https://www.libcom.de/fr/tags/inf%C3%A9rence/</link>
		<description>Recent content in Inférence on libcom.de</description>
		<generator>Hugo</generator>
		<language>fr-FR</language>
		
		
		
		
			<lastBuildDate>Tue, 18 Aug 2026 00:00:00 +0000</lastBuildDate>
		
			<atom:link href="https://www.libcom.de/fr/tags/inf%C3%A9rence/index.xml" rel="self" type="application/rss+xml" />
			<item>
				<title>IA locale : du bureau au serveur d&#39;inférence</title>
				<link>https://www.libcom.de/fr/blog/ia-locale-du-bureau-au-serveur/</link>
				<pubDate>Tue, 18 Aug 2026 00:00:00 +0000</pubDate>
				<guid>https://www.libcom.de/fr/blog/ia-locale-du-bureau-au-serveur/</guid>
				<description>&lt;p&gt;La métrique la plus révélatrice pour l&amp;rsquo;IA locale n&amp;rsquo;est pas imprimée en gros sur l&amp;rsquo;emballage. Elle s&amp;rsquo;appelle la bande passante mémoire, se mesure en gigaoctets par seconde, et décide si un modèle tourne fluidement sur votre machine ou bégaie lentement jusqu&amp;rsquo;à mourir. Quiconque veut sérieusement expérimenter l&amp;rsquo;IA et se fie aux chiffres de TOPS et de NPU cherche au mauvais endroit. La puissance de calcul est devenue bon marché. La bande passante est la ressource rare.&lt;/p&gt;</description>
			</item>
	</channel>
</rss>
