← 返回新闻列表
MIT Tech Review 🗓️ 2026-08-18 🌍 英文原文

我们仍然不知道人们如何真正使用人工智能

原始标题:In depth: We still don’t know how people are really using AI
⚡ 一句话看懂:人工智能研究人员表示,Anthropic 和 OpenAI 等人工智能公司定期发布有关人们如何使用 Claude 和 C…

人工智能研究人员表示,Anthropic 和 OpenAI 等人工智能公司定期发布有关人们如何使用 Claude 和 ChatGPT 等产品的报告,但他们只发布他们希望我们看到的数据。

斯坦福可信赖人工智能研究 (STAIR) 实验室的计算机科学博士候选人 Anka Reuel 表示:“没有独立来源证实这一点。

” 鲁埃尔是一个名为人工智能观测站的新研究项目的联合负责人,该项目旨在填补这一空白。

它是一个公共平台,聚合和分析与 Claude 和 Gemini 等流行模型的真实人工智能对话,这些对话是在用户同意的情况下通过七个现有数据集收集的。

该观察站的目的是为研究人员和政策制定者提供独立的信息来源,以评估人们如何使用生成人工智能。

鲁埃尔表示,利益相关者目前正在根据非常有限的数据就人工智能的好处和风险做出非常重要的决定。

人工智能观察站发现,人工智能的使用在不同模型中存在显着差异,并且随着时间的推移而发生变化。

该公司的研究显示,比主要人工智能公司的报告中捕捉到的敏感行为要多得多,他们表示,这些公司更关注工作而不是个人使用。

人类经济指数是最著名和最广泛引用的人工智能使用数据来源之一,但它存在盲点。

顾名思义,它专注于 Claude AI 与工作和生产力相关的用途,过滤掉与这些用途无关的对话。

当 AI Observatory 团队将 Anthropic 的方法应用于他们的数据集时,他们发现近一半(即 48%)的对话会被过滤掉。

那些被过滤掉的非工作相关对话更有可能包括健康和人际关系(Anthropic 分析中为 44.2% 对 31.2%)、成人或非法话题(7.9% 对 2.1%)、骚扰和仇恨(27.5% 对 5.66%)以及性内容(16.7% 对 2.4%)。

(OpenAI 2025 年关于 ChatGPT 使用情况的报告同样发现,只有 30% 的消费者使用与工作相关。

) Anthropic 发布了单独的博客文章,介绍人们如何使用 Claude 来获得支持或陪伴,甚至生成 CSAM,“但通过人工智能天文台的鸟瞰分析,而不是分成单独的报告,有助于”研究人员更一致地理解不同的用途,德州大学奥斯汀分校信息学院助理教授 David Widder 表示,他研究人们如何与人工智能系统互动,但并未参与人工智能天文台。

人工智能观察站查看的数据集包括 2023 年至 2025 年之间发生的对话,它发现人们使用人工智能的方式以及各种人工智能平台的反应方式存在差异。

WildChat 是 AI Observatory 研究中包含的最大、最详细的数据集之一,随着时间的推移,WildChat 中的对话变得更长、更复杂,提示标记、响应标记和对话次数的增加表明了这一点。

随着时间的推移,闲聊也明显增多。

这表明人工智能的陪伴正在增加;与此同时,人工智能助手的自我披露(即它是一个聊天机器人)减少了。

🔗 原始来源

如果你要核对细节,可以再看原文: MIT Tech Review原文链接