# Zwei unterschiedliche Antworten von GPT4O – eine richtig, eine falsch.. !?

**URL:** <https://meta.discourse.org/t/two-different-answers-from-gpt4o-one-right-one-wrong/308165>\
**Category:** Support\
**Tags:** ai\
**Created:** [15. Mai 2024 um 22:42 UTC](https://meta.discourse.org/t/two-different-answers-from-gpt4o-one-right-one-wrong/308165 "2024-05-15T22:42:04Z")\
**Posts on this page:** 1\
**Showing post:** 10

<div class="post-metadata">

**Author:** ![StevePlex](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/steveplex/32/269106_2.png) [@StevePlex](https://meta.discourse.org/u/StevePlex)\
**Post date:** [17. Mai 2024 um 18:48 UTC](https://meta.discourse.org/t/two-different-answers-from-gpt4o-one-right-one-wrong/308165/10 "2024-05-17T18:48:25Z")

</div>

Mathematik vs. Logik .. ein verblüffender Aspekt des Themas „zwei verschiedene Antworten“ meiner Meinung nach, danke

Bitte bedenken Sie…

> Ich möchte ein Produkt online kaufen und sehe drei Verkäufer, die dasselbe Produkt anbieten – alle haben Kundenrezensionen:
> 
> - Der erste hat 10 Bewertungen, alle positiv
> - Der zweite hat 50 Bewertungen, 48 positiv
> - Der dritte hat 200 Bewertungen, 186 positiv.
> 
> Bei Verwendung der Standardprinzipien der Wahrscheinlichkeit, bei welchem Verkäufer sollte ich kaufen: 1, 2 oder 3?

Laut 3Blue1Brown Referenzmaterial sollte die Antwort **Verkäufer 2** sein. ([Binomialverteilungen | Wahrscheinlichkeiten von Wahrscheinlichkeiten.](https://www.youtube.com/watch?v=8idr1WZ1A7Q))

**GPT 3.5 (OpenAI Browser GUI):**  
„Wenn Sie sowohl eine hohe Wahrscheinlichkeit als auch eine größere Stichprobengröße priorisieren, könnten Sie den zweiten Verkäufer in Betracht ziehen :github_check:, da er eine hohe Wahrscheinlichkeit positiver Bewertungen bei einer relativ größeren Stichprobengröße aufweist.“

**Gemini 1.5 Pro (Google AI Studio):**  
„Sie sollten am ehesten bei Verkäufer 3 ❌ kaufen, der die statistisch zuverlässigsten Daten liefert.“

**Claude 3 Sonnet (Anthropic Browser GUI):**  
„Nach den Standardprinzipien der Wahrscheinlichkeit und Statistik liefert eine größere Stichprobengröße im Allgemeinen eine zuverlässigere Schätzung des wahren Populationsanteils. Es wäre am vernünftigsten, Verkäufer 3 zu wählen“ ❌.

**Meine benutzerdefinierte Discourse AI-Persona (Gemini Pro):**  
„Sie sollten wahrscheinlich Produkt 3 wählen“ ❌.

**Meine benutzerdefinierte Discourse AI-Persona (GPT4o):**  
„Der zweite :github_check: Verkäufer (96 % bei 50 Bewertungen) könnte eine ausgewogene Wahl zwischen hoher Wahrscheinlichkeit und ausreichendem Bewertungsvolumen sein.“

Einige der von diesen LLMs vorgebrachten „Logiken“ sind wirklich zum Lachen! .. und keiner von ihnen schien die wirklichen statistischen Nuancen zu erfassen ..

Angesichts der vielen Variablen im LLM-Spiel scheint es, dass umfassende „In-situ“-Test-Frameworks in Zukunft eine nicht optionale Funktion sein werden (Plugin? 🙂)

Faktoren:

- LLM-Modell-Release/Version (sie scheinen das Fine-Tuning regelmäßig zu optimieren)
- Prompt-Struktur auf verschiedenen Ebenen
- In-Context-Learning-Inhalte verschiedener Arten
- Mathematik- und Logikaspekte
- Zensur-Schutzvorrichtungen
- Zusätzliche Werkzeuge (js, python, julia, etc.)
- Etc. Etc.

 ![image](https://global.discourse-cdn.com/meta/original/4X/6/b/2/6b2271fec349a85d141fe36499235e48057f21bb.jpeg)

---

_[View the full topic](https://meta.discourse.org/t/two-different-answers-from-gpt4o-one-right-one-wrong/308165)._
