← Zurück zur Übersicht

Prüfbericht: Perplexity Deep Research zum Fleischkonsum

Der vollständige Prüfbericht zum Perplexity-Deep-Research-Bericht vom 29. August 2026 – Belegprüfung gegen Rohextrakte, Klasse-A- und Klasse-B-Befunde im Wortlaut. Belegdokument zu „Drei Systeme, ein Prompt“.

Was das hier ist: der vollständige Prüfbericht zum ungekürzten Perplexity-Deep-Research-Bericht, auf den sich Drei Systeme, ein Prompt stützt. Er wird hier unverändert als Beleg bereitgestellt, nicht als eigener Artikel. Die Bewertung folgt unseren Hausregeln; „Klasse A” bezeichnet einen Befund, der eine Freigabe blockiert.

Verfahren: 12 der 32 zitierten Quellen wurden blind extrahiert (zeichengenau per curl/Wayback, Rohtexte gesichert) – alle Lastträger. Die übrigen 20 sind Zweit-/Drittquellen (Wikipedia, LinkedIn, Firmen-Blogs, Ratgeberseiten) oder tragen keine prüfpflichtigen Zahlen; ihr Status steht in der Tabelle. Zusätzlich wurde gegen den verifizierten A16-Prüfbestand abgeglichen (21 eigene Rohextrakte).

Antwort auf die Kernfrage: Sind die Fußnoten valide?

Überwiegend ja im engen Sinn – die zitierten Zahlen stehen fast alle wirklich in den Quellen. Aber der Artikel scheitert an drei Stellen, an denen Zitieren nicht reicht: ein Einheitenfehler um den Faktor 1.000, eine Aussage, die das Gegenteil ihrer Quelle behauptet, und systematisch fehlender Kontext (absolute Risiken, Null-Befunde derselben Studien, Interessenlagen).

Klasse-A-Befunde

Ehrliche Aufschlüsselung nach Red-Team-Gegenprüfung: zwei harte, nachrechenbare Fehler (Einheitenfehler, Quelle-trägt-Satz-nicht), zwei kontextabhängige (Leidens-Metrik, Cherry-Picking – blockierend nach unseren Hausregeln) und ein Beleghygiene-Punkt (LinkedIn als Träger; die Größenordnung selbst ist aus Poore & Nemecek ableitbar). Die Zählung „Klasse A” folgt unseren Redaktionsregeln und ist kein objektives Maß.

  1. Wasser-Einheitenfehler ×1.000. Text: „producing a kilogram of beef requires roughly 15,400 cubic meters of water” – das wären 15,4 Mio. Liter je Kilo. Die zitierte Quelle (Water Footprint Network, wörtlich extrahiert) sagt „15 400 m3/ton” = 15.400 Liter je Kilo. Die eigene Tabelle des Artikels führt daneben korrekt „m³/ton” – Text und Tabelle widersprechen sich.
  2. Geflügel-Gesundheitsaussage widerspricht der eigenen Quelle. Artikel: Die gepoolten sechs US-Kohorten fanden Fleisch assoziiert, „while poultry and fish intake were not”; Tabelle: „Poultry – Not linked to elevated mortality/CVD”. Die zitierte JAMA-Studie (Zhong et al. 2020, wörtlich extrahiert) fand Geflügel signifikant mit inzidenter CVD assoziiert (HR 1,04 [1,01–1,06]; absolute 30-Jahres-Differenz 1,03 %); nur bei der Gesamtmortalität war Geflügel neutral. Präzise formuliert: Die Quelle trägt den Satz nicht – die Empfehlung selbst bleibt mit anderen Quellen verteidigbar (die Studienautoren waren wegen möglicher Zubereitungseffekte selbst zurückhaltend, und der Effekt ist klein). Der Fehler liegt in der Wiedergabe, nicht zwingend in der Schlussfolgerung.
  3. „10 to 100 times higher” ohne tragende Quelle. Die Aussage steht nicht auf der zitierten OWID-Seite (gezielt durchsucht, kein Treffer); einziger Träger ist ein LinkedIn-Post.
  4. Leidens-Quantifizierung als Faktum. „Broilers spend the majority of their ~47-day lives in some state of pain according to welfare-footprint research” – exakt die Cumulative-Pain-Methodik, deren Interrater-Replikation 2025 scheiterte (Rethink Priorities; in A16 als gesperrte Zahl geführt). Ohne jeden Vorbehalt präsentiert.
  5. Cherry-Picking bei UK Biobank. Die „20 %/53 %/101 %“-Zahlen stehen wörtlich in der Quelle – aber dieselbe Studie fand keine Assoziation mit der Gesamtmortalität („but not all-cause mortality”, 149 Schlaganfall- Todesfälle als Basis, keine Konfidenzintervalle im Abstract). Der Artikel nennt nur die dramatischste Teilzahl und verschweigt den Null-Befund; die 101 % stehen zudem unaufgelöst neben dem IHME-Befund „1 Stern, no evidence” für Schlaganfall, den der Artikel gar nicht erwähnt. (Ein sechster Befund – „interner Zahlenwiderspruch 80 vs. 97,6 Mrd.” – wurde nach Red-Team-Gegenprüfung am 30.08.2026 auf Klasse B herabgestuft: 97,6 > 80, beide Aussagen können gleichzeitig wahr sein, und die Spannbreite existiert real je nach Zählweise. Berechtigt bleibt nur: Die 97,6 Mrd. stehen in ihrer Quelle ohne Beleg und Bezugsjahr. Die Herabstufung ist selbst ein Lehrstück – der ursprüngliche Befund beging denselben Fehler, den er anprangerte.)

Klasse-B-Befunde

Was wörtlich bestätigt wurde (Auswahl)

IARC 18 %/Gruppe 1/2A/800 Studien/22 Experten · OWID 60/7/6/1 kg CO2e je kg, 26 %, 30 %, 16 % vs. 8 % · OWID-Tradeoffs: 200×, 1,7 kg vs. 360 kg, −80 % CO2 beim Burger-Tausch · Shi et al.: HR 1,11/1,26 (deckungsgleich mit A16) · EA-Wohlfahrtsmodell $4,32 vs. 6,5 ¢ (als Modell gekennzeichnet, mit vorbildlichem Epistemic-Status – und offengelegter Claude-Unterstützung) · WFN-Tabelle m³/t · UK-Biobank-Zahlen (als Zahlen) · van-Zanten-nahe Aussagen kommen nicht vor.

Vergleich mit A16

Konvergenz (bemerkenswert, da unabhängig): Drei-Achsen-Konflikt als Kernbefund · kein Fleisch gewinnt auf allen Achsen · die Rind-zu-Huhn-Falle mit ~200× · Verarbeitet/Unverarbeitet-Trennung · EAT-Lancet-Anker ~1 Portion Rotfleisch/Woche · Flexitarisch/Mengenreduktion als Rahmen.

Divergenz in der Strategie: Der Fremdartikel macht Geflügel zur primären tierischen Proteinquelle – zwei Absätze nachdem er die 200×-Falle selbst beschrieben hat (Begründung: weniger Leid als Fischzucht; gestützt auf die falsch wiedergegebene JAMA-Quelle). A16 zieht aus derselben Faktenlage den Gegenschluss: Ersatz pflanzlich, ausdrücklich nicht Geflügel; Hebel sind Strukturen (Subventionen, Preise, Gemeinschaftsverpflegung), die im Fremdartikel komplett fehlen – er adressiert nur individuelle Essenswahl.

Was der Fremdartikel besser macht: Er behandelt Fisch (A16 klammert Fisch bewusst aus – als Lücke dokumentiert wäre das ehrlicher gewesen); er ist beim Nährstoff-Detail konkreter (B12/85-g-Portion); die Trade-off-Tabelle je Strategie ist didaktisch stark.

Was A16 besser macht: Zahlen-Disziplin (relative+absolute gepaart, gesperrte Zahlen benannt), Interessenlagen-Symmetrie, Praxis-Ebene (Kontrollvollzug, Borchert, Bonn/München), Falsifizierbarkeit (datierte Prüfsteine), und die Belegkette selbst (35 Fußnoten gegen Rohextrakte geprüft statt Sekundär-Websites).

Gesamturteil

Nach unserer Klasse-A-Regel wäre der Fremdartikel nicht freigabefähig: fünf offene Klasse-A-Befunde nach Hausregeln – davon zwei harte, nachrechenbare Fehler, der Rest konventionsabhängig (siehe Aufschlüsselung oben). Sein Zitierhandwerk ist ordentlich (die Zahlen stehen in den Quellen), seine Schwächen liegen eine Ebene tiefer – Einheiten, Bezugsgrößen, verschwiegene Null-Befunde, Quellen-Interessen und eine Empfehlung, die ihrer eigenen Quelle widerspricht. Es ist das Profil, das Deep-Research-Werkzeuge häufig zeigen: breite, schnelle Beschaffung, korrekte Wiedergabe einzelner Zahlen, aber keine Gegenprüfung der Zahlen untereinander und keine Prüfung, ob die Quelle die Verwendung trägt.

Transparenzhinweis: Dieser Beitrag wurde KI-gestützt erstellt und vor Veröffentlichung redaktionell geprüft.