<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>llm-benchmark on Dunkel Cloud GmbH</title><link>https://www.dunkel.cloud/tags/llm-benchmark/</link><description>Recent content in llm-benchmark on Dunkel Cloud GmbH</description><generator>Hugo -- gohugo.io</generator><language>de-de</language><copyright>Dunkel Cloud GmbH</copyright><lastBuildDate>Tue, 06 Oct 2026 09:00:00 +0200</lastBuildDate><atom:link href="https://www.dunkel.cloud/tags/llm-benchmark/index.xml" rel="self" type="application/rss+xml"/><item><title>Reichen lokale KI-Modelle für deutsche Fachaufgaben?</title><link>https://www.dunkel.cloud/blog/ki-battle-lokale-modelle-gegen-cloud/</link><pubDate>Tue, 06 Oct 2026 09:00:00 +0200</pubDate><guid>https://www.dunkel.cloud/blog/ki-battle-lokale-modelle-gegen-cloud/</guid><description>Mit KI-Battle lassen wir Cloud-Modelle und lokal betreibbare Sprachmodelle auf einem deutschen Thema gegeneinander antreten. Die Modelle bewerten einander blind, gezählt wird nur, was belegt ist. Im ersten Battle zur deutschen Rechtschreibung gewann Claude Opus 5, auf Platz 2 landete ein Modell, das sich selbst betreiben lässt.</description></item></channel></rss>