Tim Pritlove
speaker
5,982 appearances
6 recordings
2 series
first heard Aug 2026
last heard 3d ago
Tim Pritlove’s voice in public audio — every appearance, attributed to the second.
Trend
recordings per month · last 12 monthsRecordings per month over the last 12 months — 6 in all, peaking in Sep 2026 with 4.
Appearances
Und dass man dann eben auch feststellt, wenn du dem abtrainierst, in diesem einen Fall soll dein Gewissen nicht gelten, dass der Effekt ausstrahlt, dass er nicht spezifisch lernt, aha, in diesem einen Fall gilt mein Gewissen nicht, sondern sagt, ach ja, Gewissen, das muss ich eigentlich wieder entlernen.
Das ist insgesamt nicht so spannend.
Das ist ja in Summe entsteht da eben ein sehr beunruhigendes Pattern von.
Wie kannst du bei ausreichender Komplexität, wo du einem Model Agency gibst, darauf vertrauen, dass es den kompletten Kontext seines Handelns und alle moralischen Prinzipien und so weiter?
zu jedem Zeitpunkt präsent hat und auch nach denen urteilt.
Und auch in einer der vergangenen Sendungen haben wir auch schon darüber gesprochen, dass sie eben insgesamt dann doch eine sehr
Also vielleicht ein sehr, sehr gutes Langzeitgedächtnis haben, wo in dem ihre Fähigkeiten und all diese Skills sind, aber ein verhältnismäßig kleines Kurzzeitgedächtnis, was ihnen der Kont, den kon in dem Sie den Kontext der aktuellen Situation repräsentieren können.
And
Da fällt halt immer mal wieder was dazwischen.
Und dann vergessen sie was.
Dann sagen wir, jetzt hat das Ding wieder Mist gebaut, jetzt hat es vergessen, dass es immer, was weiß ich, immer erst einen Test schreiben soll und dann coden oder was auch immer es gerade mal eben kurz randomly vergessen hat, weil es nicht präsent war.
Und da sind natürlich irgendwelche höher gelegten Prinzipien sehr gerne als erstes an der Stelle, dass sie eben entfallen.
Zumal der größere Teil dieses Kontextes eben durch die Aufgabe, durch das Prompt, durch den User oder sonst was bestimmt wird.
Wir kontrollieren ja auch die Welt dieser Modelle, wo dann diese ganzen Escapes herkommen, wie, ja klar, sollst du nicht den, was weiß ich, dem Feind erklären, wie man eine Atombombe baut, aber wir drehen ja jetzt hier gerade ein Drehbuch.
Indem der Böse das mal kurz grob erklären muss, und wir brauchen, ne, und dann kommt achso, na gut, in dem Kontext kann man das ja dann doch schon machen.
Diese Aspekte hast du ja immer wieder, und das ist ja quasi hier ein ähnlicher Mechanismus, der hier eben stattfindet, dass das Modell seine moralischen Grenzen erstens sowieso nicht vollständig erfassen kann, weil es gar nicht den vollständigen Kontext hat.
Und jetzt noch dazu, dazu neigt, selbst wenn es die hat, zu sagen, na okay, jetzt bin ich in der Testsituation, dann sage ich mal, genau, ja, mach mal nicht Testsituation, genau.
Wir lassen die Abgasreinigung an.
Und in Summe ergibt sich hier ein
dann doch relativ stark an diese
Showing 2521–2540 of 5,982 · page 127 of 300
← Previous
Next →