<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>reflection tuning Archive - Blog - Jakob Hauer</title>
	<atom:link href="https://www.jakobhauer.at/blog/tag/reflection-tuning/feed/" rel="self" type="application/rss+xml" />
	<link></link>
	<description></description>
	<lastBuildDate>Fri, 25 Jul 2025 17:27:52 +0000</lastBuildDate>
	<language>de</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=6.8.2</generator>

<image>
	<url>https://www.jakobhauer.at/blog/wp-content/uploads/2023/08/cropped-favicon-32x32.png</url>
	<title>reflection tuning Archive - Blog - Jakob Hauer</title>
	<link></link>
	<width>32</width>
	<height>32</height>
</image> 
	<item>
		<title>Warum KI aktuell noch &#8222;dumm&#8220; ist</title>
		<link>https://www.jakobhauer.at/blog/warum-ki-aktuell-noch-dumm-ist/</link>
		
		<dc:creator><![CDATA[Jakob Hauer]]></dc:creator>
		<pubDate>Thu, 12 Sep 2024 17:04:47 +0000</pubDate>
				<category><![CDATA[Künstliche Intelligenz]]></category>
		<category><![CDATA[large language model]]></category>
		<category><![CDATA[llm]]></category>
		<category><![CDATA[reflection tuning]]></category>
		<guid isPermaLink="false">https://www.jakobhauer.at/blog/?p=1189</guid>

					<description><![CDATA[<p>Ich gebe zu, der Titel dieses Beitrags ist etwas provokativ – natürlich absichtlich. Aber das hat seinen Grund. Trotz der beeindruckenden Fortschritte von großen Sprachmodellen (LLMs) in den letzten Jahren stolpern sie immer noch über überraschend einfache Aufgaben. Nehmen wir zum Beispiel diese Frage: Wie viele „r“ sind im Wort „Strawberry“ enthalten? Klingt einfach, oder? [&#8230;]</p>
<p>Der Beitrag <a href="https://www.jakobhauer.at/blog/warum-ki-aktuell-noch-dumm-ist/">Warum KI aktuell noch &#8222;dumm&#8220; ist</a> erschien zuerst auf <a href="https://www.jakobhauer.at/blog">Blog - Jakob Hauer</a>.</p>
]]></description>
										<content:encoded><![CDATA[
<p>Ich gebe zu, der Titel dieses Beitrags ist etwas provokativ – natürlich absichtlich. Aber das hat seinen Grund. Trotz der beeindruckenden Fortschritte von großen Sprachmodellen (LLMs) in den letzten Jahren stolpern sie immer noch über überraschend einfache Aufgaben. Nehmen wir zum Beispiel diese Frage: Wie viele „r“ sind im Wort „<a href="https://www.jakobhauer.at/blog/von-gpt-4-zu-gpt-5-der-naechste-grosse-schritt-in-der-ki-entwicklung/">Strawberry</a>“ enthalten? Klingt einfach, oder? Man würde es denken, aber es stellt sich heraus, dass selbst die fortschrittlichsten KI-Modelle oft falsch liegen.</p>



<h2 class="wp-block-heading has-medium-font-size"><strong>Warum haben KI-Modelle mit einfachen Aufgaben Schwierigkeiten?</strong></h2>



<p>Schauen wir uns ein kürzlich eingeführtes Modell an, Reflection 70B. Dieses Modell verwendet eine neue Technik namens „Reflection Tuning“, aber bevor wir darauf eingehen, sehen wir uns an, wie einige bekannte Modelle abschneiden:</p>


<div class="pgc-sgb-cb wp-block-pgcsimplygalleryblock-viewer " data-gallery-id="13942315"><div class="sgb-preloader" id="pr_13942315">
	<div class="sgb-square" style="background:#d4d4d4"></div>
	<div class="sgb-square" style="background:#d4d4d4"></div>
	<div class="sgb-square" style="background:#d4d4d4"></div>
	<div class="sgb-square" style="background:#d4d4d4"></div></div><div class="simply-gallery-amp pgc_sgb_slider " style="display: none;"><div class="sgb-gallery"><div class="sgb-item"><a href="https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gemini.png"><img decoding="async" alt="" width="300" height="71" loading="lazy" src="https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gemini-300x71.png" srcset="https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gemini-300x71.png 300w,https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gemini-1024x242.png 1024w,https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gemini.png 1583w" sizes="auto, 250px"/></a></div><div class="sgb-item"><a href="https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gpt4o.png"><img decoding="async" alt="" width="300" height="130" loading="lazy" src="https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gpt4o-300x130.png" srcset="https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gpt4o-300x130.png 300w,https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gpt4o-1024x444.png 1024w,https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gpt4o.png 1370w" sizes="auto, 250px"/></a></div><div class="sgb-item"><a href="https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_llama.png"><img decoding="async" alt="" width="300" height="244" loading="lazy" src="https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_llama-300x244.png" srcset="https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_llama-300x244.png 300w,https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_llama.png 804w" sizes="auto, 250px"/></a></div><div class="sgb-item"><a href="https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_perplexity.png"><img decoding="async" alt="" width="300" height="223" loading="lazy" src="https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_perplexity-300x223.png" srcset="https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_perplexity-300x223.png 300w,https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_perplexity.png 699w" sizes="auto, 250px"/></a></div><div class="sgb-item"><a href="https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_claude1.png"><img decoding="async" alt="" width="300" height="106" loading="lazy" src="https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_claude1-300x106.png" srcset="https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_claude1-300x106.png 300w,https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_claude1.png 786w" sizes="auto, 250px"/></a></div></div></div><script type="application/json" class="sgb-data">{"galleryType":"pgc_sgb_viewer","galleryId":"13942315","images":[{"id":1195,"title":"test_gemini","url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gemini.png","link":"https://www.jakobhauer.at/blog/?attachment_id=1195","alt":"","description":"Google Gemini","caption":"","mime":"image/png","type":"image","width":1583,"height":374,"sizes":{"thumbnail":{"height":150,"width":150,"url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gemini-150x150.png","orientation":"landscape"},"medium":{"height":71,"width":300,"url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gemini-300x71.png","orientation":"landscape"},"large":{"height":242,"width":1024,"url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gemini-1024x242.png","orientation":"landscape"},"full":{"url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gemini.png","height":374,"width":1583,"orientation":"landscape"}},"imageMeta":{"aperture":"0","credit":"","camera":"","caption":"","created_timestamp":"0","copyright":"","focal_length":"0","iso":"0","shutter_speed":"0","title":"","orientation":"0","keywords":[]},"meta":false},{"id":1196,"title":"test_gpt4o","url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gpt4o.png","link":"https://www.jakobhauer.at/blog/?attachment_id=1196","alt":"","description":"ChatGPT 4o","caption":"","mime":"image/png","type":"image","width":1370,"height":594,"sizes":{"thumbnail":{"height":150,"width":150,"url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gpt4o-150x150.png","orientation":"landscape"},"medium":{"height":130,"width":300,"url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gpt4o-300x130.png","orientation":"landscape"},"large":{"height":444,"width":1024,"url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gpt4o-1024x444.png","orientation":"landscape"},"full":{"url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_gpt4o.png","height":594,"width":1370,"orientation":"landscape"}},"imageMeta":{"aperture":"0","credit":"","camera":"","caption":"","created_timestamp":"0","copyright":"","focal_length":"0","iso":"0","shutter_speed":"0","title":"","orientation":"0","keywords":[]},"meta":false},{"id":1197,"title":"test_llama","url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_llama.png","link":"https://www.jakobhauer.at/blog/?attachment_id=1197","alt":"","description":"Llama 3.1","caption":"","mime":"image/png","type":"image","width":804,"height":655,"sizes":{"thumbnail":{"height":150,"width":150,"url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_llama-150x150.png","orientation":"landscape"},"medium":{"height":244,"width":300,"url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_llama-300x244.png","orientation":"landscape"},"full":{"url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_llama.png","height":655,"width":804,"orientation":"landscape"}},"imageMeta":{"aperture":"0","credit":"","camera":"","caption":"","created_timestamp":"0","copyright":"","focal_length":"0","iso":"0","shutter_speed":"0","title":"","orientation":"0","keywords":[]},"meta":false},{"id":1198,"title":"test_perplexity","url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_perplexity.png","link":"https://www.jakobhauer.at/blog/?attachment_id=1198","alt":"","description":"Perplexity","caption":"","mime":"image/png","type":"image","width":699,"height":520,"sizes":{"thumbnail":{"height":150,"width":150,"url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_perplexity-150x150.png","orientation":"landscape"},"medium":{"height":223,"width":300,"url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_perplexity-300x223.png","orientation":"landscape"},"full":{"url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_perplexity.png","height":520,"width":699,"orientation":"landscape"}},"imageMeta":{"aperture":"0","credit":"","camera":"","caption":"","created_timestamp":"0","copyright":"","focal_length":"0","iso":"0","shutter_speed":"0","title":"","orientation":"0","keywords":[]},"meta":false},{"id":1191,"title":"test_claude1","url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_claude1.png","link":"https://www.jakobhauer.at/blog/?attachment_id=1191","alt":"","description":"Claude","caption":"","mime":"image/png","type":"image","width":786,"height":279,"sizes":{"thumbnail":{"height":150,"width":150,"url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_claude1-150x150.png","orientation":"landscape"},"medium":{"height":106,"width":300,"url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_claude1-300x106.png","orientation":"landscape"},"full":{"url":"https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/test_claude1.png","height":279,"width":786,"orientation":"landscape"}},"imageMeta":{"aperture":"0","credit":"","camera":"","caption":"","created_timestamp":"0","copyright":"","focal_length":"0","iso":"0","shutter_speed":"0","title":"","orientation":"0","keywords":[]},"meta":false}],"itemsMetaDataCollection":[]}</script><script>(function(){if(window.PGC_SGB && window.PGC_SGB.searcher){window.PGC_SGB.searcher.initBlocks()}})()</script></div>


<p>Es ist auffällig, dass all diese Systeme Schwierigkeiten mit einer eigentlich einfachen Aufgabe haben: die Anzahl der „r“ in „Strawberry“ zu zählen. Warum passiert das?</p>



<h2 class="wp-block-heading has-medium-font-size"><strong>Wie funktionieren große Sprachmodelle?</strong></h2>



<p>Um diese Fehler zu verstehen, müssen wir kurz erklären, wie LLMs wie GPT-4 oder Claude tatsächlich arbeiten. Diese Modelle basieren auf neuronalen Netzwerken, die darauf trainiert sind, Muster in riesigen Textmengen zu erkennen. Sie lernen, indem sie Textdaten analysieren und vorhersagen, welches Wort oder welche Zeichenfolge als nächstes wahrscheinlich erscheint.</p>



<p>Das Problem ist, dass diese Modelle eigentlich nicht „wissen“, was ein „r“ ist oder wie Wörter aufgebaut sind. Sie operieren auf Basis von Wahrscheinlichkeiten und Kontextvorhersagen. Wenn sie also gefragt werden, die „r“s in „Strawberry“ zu zählen, scannen sie das Wort nicht so, wie es ein Mensch tun würde. Stattdessen suchen sie nach Mustern, die in den Texten, die sie verarbeitet haben, häufig vorkommen, was oft zu unerwarteten oder falschen Ergebnissen führt.</p>



<h2 class="wp-block-heading has-medium-font-size"><strong>Warum machen LLMs „dumme“ Fehler?</strong></h2>



<p>Der Kern dieser Fehler liegt in der Funktionsweise der LLMs. Sie „denken“ nicht wie Menschen. Ihr Verständnis von Sprache ist rein statistisch, basierend auf Mustern, die sie während des Trainings gelernt haben. Aber Fragen, die das Zählen von Buchstaben oder das Analysieren der Wortstruktur erfordern, erfordern eine andere Art der Analyse – etwas direkteres und lineares, jenseits der Mustererkennung.</p>



<p>Eine weitere Herausforderung ist, wie diese Modelle trainiert werden. Sie lernen assoziativ, nicht explizit. Das Zählen von Buchstaben oder das logische Ableiten aus der Struktur eines Wortes gehört nicht zu ihren Stärken. Während sie hervorragend darin sind, Muster zu erkennen und kontextuell relevante Informationen bereitzustellen, scheitern sie bei einfachen, linearen Aufgaben wie dem Zählen von Buchstaben.</p>



<h2 class="wp-block-heading has-medium-font-size"><strong>Einsatz von Reflection Tuning</strong></h2>



<p>Hier kommt Reflection Tuning ins Spiel, das beim Training von Reflection 70B verwendet wurde. Diese Technik ermöglicht es dem Modell, aus seinen eigenen Fehlern zu lernen und sich selbst zu korrigieren. Wenn das Modell also zunächst die falsche Anzahl an „r“s in „Strawberry“ angibt, kann es über seine Antwort nachdenken und sich beim zweiten Versuch korrigieren.</p>



<figure class="wp-block-image size-large"><img fetchpriority="high" decoding="async" width="1024" height="283" src="https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/reflection70b-1024x283.png" alt="" class="wp-image-1190" srcset="https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/reflection70b-1024x283.png 1024w, https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/reflection70b-300x83.png 300w, https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/reflection70b-768x212.png 768w, https://www.jakobhauer.at/blog/wp-content/uploads/2024/09/reflection70b.png 1410w" sizes="(max-width: 1024px) 100vw, 1024px" /></figure>



<p><em>Beispiel von Matt Shumer</em></p>



<p>Diese Methode ist ein vielversprechender Ansatz, um eines der größten Probleme bei LLMs anzugehen: Halluzinationen. In diesem Zusammenhang beziehen sich Halluzinationen auf Fälle, in denen das Modell falsche oder komplett erfundene Informationen generiert. Mit Reflection Tuning können Modelle wie Reflection 70B potenziell solche Fehler reduzieren, indem sie ihre Ausgaben überprüfen und überarbeiten.</p>



<h2 class="wp-block-heading has-medium-font-size"><strong>Fazit</strong></h2>



<p>Auch wenn die Behauptung, dass KI immer noch „dumm“ sei, nicht in allen Bereichen zutrifft, gibt es bestimmte Aufgaben – wie das Zählen von Buchstaben in einem Wort – bei denen klar wird, dass diese Systeme noch viel lernen müssen. Ihre Abhängigkeit von statistischen Mustern führt zu Fehlern, die für Menschen trivial erscheinen.</p>



<p>Techniken wie Reflection Tuning bieten einen Hoffnungsschimmer, da sie zeigen, dass wir einige dieser Probleme abmildern können. Aber vorerst sollten wir uns der Grenzen aktueller KI-Modelle bewusst bleiben. Sie sind beeindruckend, ohne Frage, aber noch weit davon entfernt, perfekt zu sein.</p>



<p><strong>Quellen:</strong><br><a href="https://braintitan.medium.com/smarter-ai-reflection-70b-detects-and-fixes-errors-ee0c355750dd">https://braintitan.medium.com/smarter-ai-reflection-70b-detects-and-fixes-errors-ee0c355750dd</a><br><a href="https://cointelegraph.com/news/reflection-70b-ai-model-answer-llm-hallucinations">https://cointelegraph.com/news/reflection-70b-ai-model-answer-llm-hallucinations</a></p>



<p></p>
<p>Der Beitrag <a href="https://www.jakobhauer.at/blog/warum-ki-aktuell-noch-dumm-ist/">Warum KI aktuell noch &#8222;dumm&#8220; ist</a> erschien zuerst auf <a href="https://www.jakobhauer.at/blog">Blog - Jakob Hauer</a>.</p>
]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
