<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[Hvilken variant bruger du?]]></title><description><![CDATA[<p dir="auto">Hvilken variant bruger du? Noget, som er <em>quantizised</em> for hårdt? Selv med nogenlunde-OK-modeller som Gemma 4 eller Qwen 3.6 kan du få ringe resultater selv på simple forespørgsler, hvis du har for få VRAM (under ~16 GB) eller kører en for hårdt kvantiseret LLM variant. Bruger du standardindstillinger, eller har du pillet ved temperatur og alt det dér? (i 99% tilfælde kører jeg selv bare standard og rører ikke ved avancerede indstillinger, men måske det kan gøre noget for dig)</p>
<p dir="auto">En god sweetspot model til et middelmådet grafikkort er vel en Q4/IQ4/Q3 GGUF-variant af <a href="https://huggingface.co/unsloth/Qwen3.6-35B-A3B-GGUF" target="_blank" rel="noopener noreferrer nofollow ugc">https://huggingface.co/unsloth/Qwen3.6-35B-A3B-GGUF</a> eller <a href="https://huggingface.co/unsloth/gemma-4-26B-A4B-it-GGUF" target="_blank" rel="noopener noreferrer nofollow ugc">https://huggingface.co/unsloth/gemma-4-26B-A4B-it-GGUF</a> fra Unsloth, der offloader til din CPU.</p>
]]></description><link>https://forum.fedi.dk/topic/a2054ae8-605e-4594-80b7-a6d25066e0be/hvilken-variant-bruger-du</link><generator>RSS for Node</generator><lastBuildDate>Tue, 28 Jul 2026 19:03:07 GMT</lastBuildDate><atom:link href="https://forum.fedi.dk/topic/a2054ae8-605e-4594-80b7-a6d25066e0be.rss" rel="self" type="application/rss+xml"/><pubDate>Fri, 29 May 2026 10:33:36 GMT</pubDate><ttl>60</ttl></channel></rss>