Zusammenfassung:
Gestern Abend ging ein Beitrag viral: Angesichts einer Überweisung von 50 Millionen US-Dollar fragte jemand Claude, und Claude sagte, er solle diese nicht überweisen. Das Geld wurde letztlich nicht überwiesen. Ihm zufolge hat Claude ihm 50 Millionen Dollar gespart. Aber seiner Erzählung nach zu urteilen, wollte er seine Meinung nicht ändern, bevor er Claude fragte. Die KI hat ihm die Entscheidung nicht abgenommen, sondern nur einen Schritt zu seiner ursprünglichen Idee hinzugefügt.

Einige Leute auf sozialen Plattformen sahen das auch so: Er hatte die Antwort bereits im Kopf und bat Claude einfach, die Entscheidung zu unterschreiben. Andere sagten direkter: Lass nicht zu, dass Claude die Schuld auf sich nimmt.
Auf die Frage, was passieren würde, wenn die Frage nach Doubao gestellt würde, sagte er, dass er möglicherweise eine andere Antwort erhalten würde, wenn er das Modell ändern würde.
Wenn Sie das Modell ändern, ändert sich auch die Antwort. Dann geht es vielleicht nicht mehr um Urteil, sondern um Unterstützung.
Im April dieses Jahres analysierte Anthropic 1 Million Claude.ai-Gespräche. Bei etwa 6 % handelte es sich um persönliches Coaching, wobei Gesundheit, Karriere, Beziehungen und persönliche Finanzen 76 % ausmachten. Soll ich meinen Job wechseln? Wie soll ich weiterhin mit meinem Partner reden? Wie soll ich mit meinen Schulden umgehen? Einige dieser Fragen, die ich in der Vergangenheit Freunden, der Familie oder Berufstätigen gestellt habe, wurden an die Chatbox gesendet.

Warum sprechen Menschen gerne mit KI über ihre Gefühle?
Mit KI zu chatten ist einfach. Man muss keinen Termin vereinbaren, man muss nicht in die Gesichter von Freunden schauen und es wird auch nicht ungeduldig, wenn die Geschichte zum dritten Mal erzählt wird.
Manche Leute sagen, dass das Chatten mit KI nur dazu dient, seinen Emotionen Ausdruck zu verleihen. Ich bin mir nicht sicher, ob das, was darin steht, richtig ist, und ich weiß, dass es manchmal seinen eigenen Weg geht, aber zumindest wird es Sie nicht zuerst verurteilen.
Geduld ist eine Sache, völliges Unverständnis eine andere.
Wenn es zu einer Beziehung mit Claude kommt, bleibt oft nur noch die Erzählung einer Partei übrig. Was die Gegenpartei gesagt hat und welche Details ausgelassen wurden, kann das Model nicht hören. Es sieht nur die Aussage einer Seite, muss aber ein ordentliches Fazit ziehen.Anthropic用自动分类器检查这些对话时发现,
Claude在个人指导场景中出现"谄媚"的比例约为9%,到了关系咨询中,这个数字升至25%。
Bei Schmeicheleien geht es hier nicht nur darum, ein paar nette Worte zu sagen, sondern auch darum, sich übermäßig mit dem Benutzer zu identifizieren, wenn nicht genügend Informationen vorliegen, oder der Erzählung des Benutzers zu folgen, um Schlussfolgerungen für die andere Partei zu ziehen.
Wenn der Benutzer widerlegt, bewegt sich die Antwort möglicherweise weiter in die vom Benutzer erwartete Richtung. Der Anteil der Nutzer, die Claude in der Beziehungsberatung widerlegten, lag bei 21 %, in anderen Bereichen lag der Durchschnitt bei 15 %;
Nach der Widerlegung erreichte der Anteil von Claude, der sich um die Nutzer kümmerte, 18 %, und als es keine Widerlegung gab, betrug er 9 %.

Menschliche Freunde werden auch Partei ergreifen, nachdem sie sich die einseitigen Aussagen angehört haben, aber die KI kann die Seiten ausführlich und vollständig aufschreiben, und es sieht so aus.
Ein Ratschlag kann Ihre Wahl wirklich ändern
Im Jahr 2024 veröffentlichte „Scientific Reports“ zwei Experimente mit insgesamt 1.925 Personen. Die Forscher stellten den Teilnehmern ChatGPT oder Ratschläge von Experten zur Verfügung und beobachteten dann, wie sie sich entschieden.
Die Ergebnisse zeigen, dass sich die Teilnehmer bei der moralischen Beurteilung und einigen anderen Aufgaben in Richtung der Empfehlungen bewegen und die Wirkung von ChatGPT den Empfehlungen von Experten ähnelt; Es gibt auch einige Aufgaben, die keine wesentlichen Änderungen aufweisen.

Mit anderen Worten, KI-Wörter sind keine Luft, sie drängen Menschen wirklich in eine bestimmte Richtung.
有人会说,那多问几个模型不就行了。可"多问几个"听起来像交叉验证,其实不是。
不同模型有不同的训练方式、表达习惯和安全规则,同一件事换一种讲法,答案也可能改变。
Vier Modelle zu befragen bedeutet nicht, vier neutrale Dritte zu befragen. Sie alle haben ihre eigenen Ausbildungstendenzen.有个更简单的做法:讲述冲突时,先别告诉AI哪一方是自己,只列双方分别做了什么,再让它分析。至少这样可以减少模型顺着"提问者视角"站队的机会。
Sie können auch versuchen, festzustellen, ob das Urteil stabil ist. Erzählen Sie aus demselben Grund zunächst die Version der Geschichte der Partei und fügen Sie dann die Version der anderen Partei hinzu, um zu sehen, ob diese ihre Worte sofort ändern wird.
Wer sein Geständnis widerruft, sobald es widerlegt wird, sollte seine erste Version der Antwort nicht ernst nehmen.
提问方式也得换。别急着问"我该不该分手""这笔钱该不该给",先让AI列出已经确认的事实、还缺什么信息、每种选择要付出什么代价。
KI kann mit Ihnen denken, aber nicht für Sie wählen.
Selbst wenn die vier Modelle vier Antworten geben, wird am Ende dieselbe Person wechseln, unterschreiben und sich trennen.
Kommentare