Was ist, wenn meine LLM-Varianten uneins sind? Welche hat recht?
Die parallele Ausführung mehrerer LLMs deckt Fehler auf, die jedes einzelne Modell selbstbewusst ausliefert. So baut man ein Disagreement-Resolution-System, das tatsächlich funktioniert.
Du schickst einen Prompt an GPT-4o. Es liefert einen JSON-Blob mit einer Confidence von 0,97 zurück. Du schickst denselben Prompt an Claude 3.5 Sonnet. Es…