DC娱乐网

我们给AI上下文,却只给真人两秒

最近《奥德赛》北京首映礼那个主持人屈膝递麦的视频吵得特别凶。我第一次看到时没生气,先是困惑:她不能只是怕挡镜头吗?

当然,那个画面确实不好看。她压得很低,和几位主创形成了很明显的高低关系。如果专业主持认为有更好的走位、递麦方式,我完全接受。你说看着不舒服,也没问题。

但网上的判断很快从“这个动作不够大方”,一路跳到了“卑躬屈膝”“崇洋媚外”“见外国人就站不直”。

这中间其实差了很多层证据。

现场视频能确认的是她屈膝、压低身体、递麦。至于为什么,公开报道里出现过“避让机位”的解释,但来源并不完全一致,所以它最多是一种合理可能。可反过来,“她是在讨好外国人”同样不是视频直接告诉我们的,它也是一种归因。

心理学里有个特别贴切的概念叫 correspondence bias:我们很容易从一个行为直接推断一个人的稳定性格,却低估当时的情境。另一边,thin slices 研究又告诉我们,几秒钟并非什么都看不出来,短暂行为确实可以传递信息。

所以我现在更在意的是结论尺度。十几秒也许足够让我说:“这个姿态让我觉得局促、不够专业。”真的足够让我判断:“这个人崇洋媚外”吗?

最讽刺的是,我们天天要求AI在context不足的时候不要hallucinate,要区分fact和inference,要承认uncertainty。轮到真人,输入两秒视频,缺的信息全靠自己补,然后100% confidence输出一个人的价值观。

我最后反而没那么想讨论她该不该蹲了。我更想问一句:我们什么时候开始,把“我看着不舒服”,当成了“我已经知道你是什么样的人”?