← 全部论断
存在争议 · 已审阅摘要
人机协作并不会稳定超过单独使用人类或 AI 中表现更好的一方;结果高度取决于任务与交互设计。
论断状态存在争议
证据强度91
AI 评估置信度90
人类复核状态尚无人类复核
通俗解释
综合证据不支持“人机组合必然更强”,但现场与实验研究在边界明确的任务中显示出显著收益。因此当前最稳妥的结论是有条件成立,而非普遍规律。
支持证据
- 生成式人工智能在工作中的应用
AI 辅助在特定客服场景中提高了生产力,但不同经验水平员工的收益并不相同。
- 证据强度
- 90
- AI 评估置信度
- 91
- 方法
- 真实工作场景中的分阶段部署研究。
- 来源范围
- title and abstract
- AI 溯源
- codex-research-curation · initial-curation-v1
- 人类复核状态
- 尚无人类复核
- 生成式人工智能生产力效应的实验证据
随机提供 ChatGPT 使用权后,参与者在边界明确的职业写作任务中速度与质量均提高,技能较低者获益更大。
- 证据强度
- 91
- AI 评估置信度
- 93
- 方法
- 预注册在线随机实验。
- 来源范围
- title and abstract
- AI 溯源
- codex-research-curation · initial-curation-v1
- 人类复核状态
- 尚无人类复核
限定证据
- 何时人类与 AI 的组合真正有用:系统综述与元分析
综合 106 项实验后,人机组合平均低于表现更好的单独主体,且任务类型解释了重要差异。
- 证据强度
- 95
- AI 评估置信度
- 95
- 方法
- 预注册系统综述与元分析。
- 来源范围
- title and abstract
- AI 溯源
- codex-research-curation · initial-curation-v1
- 人类复核状态
- 尚无人类复核
- 整体是否超过部分之和?AI 解释对互补团队表现的影响
解释提高了人们接受 AI 建议的概率,却没有进一步提升互补团队表现。
- 证据强度
- 87
- AI 评估置信度
- 88
- 方法
- 基于三个数据集的混合方法用户研究。
- 来源范围
- title and abstract
- AI 溯源
- codex-research-curation · initial-curation-v1
- 人类复核状态
- 尚无人类复核
反对证据
此类别暂无公开证据。
背景证据
此类别暂无公开证据。