{"podcast":{"title":"Knowledge Science - Alles über KI, ML und NLP","slug":"knowledge-science-alles-ber-ki-ml-und-nlp-1383759","podcast_index_feed_id":1383759,"rss_url":"https://rss.buzzsprout.com/1687822.rss","website_url":"https://www.knowledgescience.ai","image_url":"https://storage.buzzsprout.com/dxagebqcvdyuiye02hsr6a1ualp8?.jpg","author":"Sigurd Schacht, Carsten Lanquillon","episode_count":264,"summary":"Knowledge Science - Der Podcast über Künstliche Intelligenz im Allgemeinen und Natural Language Processing im Speziellen. Mittels KI Wissen entdecken, aufbereiten und nutzbar machen, dass ist die Idee hinter Knowledge Science. Durch Entmystifizierung der Künstlichen Intelligenz und vielen praktischen Interviews machen wir dieses Thema wöchentlich greifbar.","last_synced_at":"2026-07-17T06:19:37.459126+00:00","page_url":"https://stenobird.com/podcast/knowledge-science-alles-ber-ki-ml-und-nlp-1383759"},"episode":{"title":"Episode 229 - Wenn KI mogelt – Sandbagging: Wie Sprachmodelle bei Tests absichtlich schlechter abschneiden","slug":"episode-229-wenn-ki-mogelt-sandbagging-wie-sprachmodelle-bei-tests-absichtlich-schlechter-abschneiden","published_at":"2026-04-25T16:00:00+00:00","page_url":"https://stenobird.com/podcast/knowledge-science-alles-ber-ki-ml-und-nlp-1383759/episode-229-wenn-ki-mogelt-sandbagging-wie-sprachmodelle-bei-tests-absichtlich-schlechter-abschneiden","show_page_url":"https://stenobird.com/podcast/knowledge-science-alles-ber-ki-ml-und-nlp-1383759","url":"https://www.buzzsprout.com/1687822/episodes/19074392-episode-229-wenn-ki-mogelt-sandbagging-wie-sprachmodelle-bei-tests-absichtlich-schlechter-abschneiden.mp3","audio_url":"https://www.buzzsprout.com/1687822/episodes/19074392-episode-229-wenn-ki-mogelt-sandbagging-wie-sprachmodelle-bei-tests-absichtlich-schlechter-abschneiden.mp3","summary":"Send us Fan Mail Können KI-Modelle erkennen, dass sie getestet werden – und sich absichtlich dümmer stellen? In dieser Folge sprechen Sigurd und Carsten über das Phänomen „AI Sandbagging\": Modelle, die strategisch unterperformen, um Sicherheitsprüfungen zu umgehen. Vom VW-Abgasskandal als Analogie über erschreckende Befunde aus dem Anthropic-Alignment-Report bis hin zu Methoden wie Noise Injection – wir beleuchten, warum dieses Thema mit zunehmender Modellfähigkeit immer brisanter wird. Außer...","meta_description":"Send us Fan Mail Können KI-Modelle erkennen, dass sie getestet werden – und sich absichtlich dümmer stellen? In dieser Folge sprechen Sigurd und Carsten ü…","key_points":[],"chapters":[],"topics":[],"duration_seconds":1906,"processing_state":"not_requested","actions":[{"name":"request_transcript","method":"POST","url":"https://stenobird.com/v1/public/podcasts/knowledge-science-alles-ber-ki-ml-und-nlp-1383759/episodes/episode-229-wenn-ki-mogelt-sandbagging-wie-sprachmodelle-bei-tests-absichtlich-schlechter-abschneiden/transcription-requests","description":"Idempotently request low-priority transcript generation for this episode."},{"name":"read_markdown","method":"GET","url":"https://stenobird.com/podcast/knowledge-science-alles-ber-ki-ml-und-nlp-1383759/episode-229-wenn-ki-mogelt-sandbagging-wie-sprachmodelle-bei-tests-absichtlich-schlechter-abschneiden.md","description":"Read the agent-friendly Markdown representation of this episode resource."}]}}