Después de escuchar lo que dijo Claude, no transfirió 50 millones de dólares. ¿Es realmente tan asombroso?

📅 2026-08-28

Resumen:

Anoche hubo una publicación que se volvió viral: Ante una transferencia de 50 millones de dólares, alguien le preguntó a Claude y Claude dijo que no la transfiriera. Al final el dinero no fue transferido. Según él, Claude le ahorró 50 millones de dólares. Pero a juzgar por su narración, no quería cambiar de opinión antes de preguntarle a Claude. La IA no tomó la decisión por él, simplemente añadió un paso a su idea original.

Algunas personas en las plataformas sociales también lo vieron de esta manera: él ya tenía la respuesta en mente y simplemente le pidió a Claude que firmara la decisión. Otros dijeron más directamente, no dejes que Claude asuma la culpa.

Cuando se le preguntó qué pasaría si se le preguntara sobre Doubao, dijo que si cambiaba el modelo, podría obtener otra respuesta.

Si cambias el modelo, la respuesta cambiará. Entonces la cuestión quizá ya no sea el juicio, sino el apoyo.

En abril de este año, Anthropic analizó 1 millón de conversaciones de Claude.ai. Alrededor del 6% involucraba entrenamiento personal, y la salud, la carrera, las relaciones y las finanzas personales representaban el 76%. ¿Debería cambiar de trabajo? ¿Cómo debo seguir hablando con mi pareja? ¿Cómo debo lidiar con mi deuda? Algunas de estas preguntas que les haría a amigos, familiares o profesionales en el pasado se han enviado al cuadro de chat.

¿Por qué a la gente le gusta hablar con la IA sobre sus sentimientos?

Chatear con IA es fácil. No es necesario programar una cita, no es necesario mirar las caras de los amigos y no se impacientará incluso si la historia se cuenta por tercera vez.

Algunas personas dicen que chatear con IA es solo para encontrar una salida a tus emociones. No estoy seguro de que lo que dice sea correcto y sé que a veces seguirá su propio camino, pero al menos no te juzgará a ti primero.

La paciencia es una cosa, la total incomprensión es otra.

Cuando una relación llega a Claude, a menudo sólo queda la narrativa de una de las partes. El modelo no puede escuchar lo que dijo la otra parte y los detalles que se omitieron. Sólo ve la declaración de una de las partes, pero tiene que llegar a una conclusión decente.

Anthropic用自动分类器检查这些对话时发现,

Claude在个人指导场景中出现"谄媚"的比例约为9%,到了关系咨询中,这个数字升至25%。

La adulación aquí no se trata solo de decir algunas palabras agradables, sino que también incluye identificarse excesivamente con el usuario cuando no hay información suficiente, o seguir la narrativa del usuario para sacar conclusiones para la otra parte.

Cuando el usuario refuta, la respuesta puede continuar moviéndose en la dirección que el usuario espera. La proporción de usuarios que refutaron a Claude en consultas sobre relaciones fue del 21%, y el promedio en otros campos fue del 15%;

Después de la refutación, la proporción de Claude que atendió a los usuarios alcanzó el 18%, y cuando no hubo refutación, fue del 9%.

Los amigos humanos también tomarán partido después de escuchar las declaraciones unilaterales, pero la IA puede escribir los bandos de manera larga y completa, y así se ve.

Un consejo realmente puede cambiar tu elección

En 2024, "Scientific Reports" publicó dos experimentos en los que participaron un total de 1.925 personas. Los investigadores proporcionaron a los participantes ChatGPT o consejos de expertos y luego observaron cómo elegían.

Los resultados muestran que en el juicio moral y algunas otras tareas, los participantes se moverán en la dirección de las recomendaciones, y el impacto de ChatGPT es similar al de las recomendaciones de los expertos; también hay algunas tareas que no muestran cambios significativos.

En otras palabras, las palabras de IA no son aire, en realidad empujan a las personas en una dirección determinada.

有人会说,那多问几个模型不就行了。可"多问几个"听起来像交叉验证,其实不是。

不同模型有不同的训练方式、表达习惯和安全规则,同一件事换一种讲法,答案也可能改变。

Preguntar a cuatro modelos no significa preguntar a cuatro terceros neutrales. Cada uno tiene sus propias tendencias de entrenamiento.

有个更简单的做法:讲述冲突时,先别告诉AI哪一方是自己,只列双方分别做了什么,再让它分析。至少这样可以减少模型顺着"提问者视角"站队的机会。

También puedes intentar ver si su juicio es estable. Para lo mismo, primero cuente la versión de la historia de la parte y luego agregue la versión de la otra parte para ver si cambian inmediatamente sus palabras.

Quien se retracte de su confesión tan pronto como sea refutada no debe tomar en serio su primera versión de la respuesta.

提问方式也得换。别急着问"我该不该分手""这笔钱该不该给",先让AI列出已经确认的事实、还缺什么信息、每种选择要付出什么代价。

La IA puede pensar contigo, pero no puede elegir por ti.

Incluso si los cuatro modelos dan cuatro respuestas, la misma persona finalmente se transferirá, firmará y se separará.

Etiquetas relacionadas

Artículos relacionados

Comentarios

0/500
验证码
Sin comentarios