← 全部论断

存在争议 · 已审阅摘要

人机协作并不会稳定超过单独使用人类或 AI 中表现更好的一方;结果高度取决于任务与交互设计。

论断状态存在争议
证据强度91
AI 评估置信度90
人类复核状态尚无人类复核

通俗解释

综合证据不支持“人机组合必然更强”,但现场与实验研究在边界明确的任务中显示出显著收益。因此当前最稳妥的结论是有条件成立,而非普遍规律。

支持证据

  • 生成式人工智能在工作中的应用

    AI 辅助在特定客服场景中提高了生产力,但不同经验水平员工的收益并不相同。

    证据强度
    90
    AI 评估置信度
    91
    方法
    真实工作场景中的分阶段部署研究。
    来源范围
    title and abstract
    AI 溯源
    codex-research-curation · initial-curation-v1
    人类复核状态
    尚无人类复核
  • 生成式人工智能生产力效应的实验证据

    随机提供 ChatGPT 使用权后,参与者在边界明确的职业写作任务中速度与质量均提高,技能较低者获益更大。

    证据强度
    91
    AI 评估置信度
    93
    方法
    预注册在线随机实验。
    来源范围
    title and abstract
    AI 溯源
    codex-research-curation · initial-curation-v1
    人类复核状态
    尚无人类复核

限定证据

  • 何时人类与 AI 的组合真正有用:系统综述与元分析

    综合 106 项实验后,人机组合平均低于表现更好的单独主体,且任务类型解释了重要差异。

    证据强度
    95
    AI 评估置信度
    95
    方法
    预注册系统综述与元分析。
    来源范围
    title and abstract
    AI 溯源
    codex-research-curation · initial-curation-v1
    人类复核状态
    尚无人类复核
  • 整体是否超过部分之和?AI 解释对互补团队表现的影响

    解释提高了人们接受 AI 建议的概率,却没有进一步提升互补团队表现。

    证据强度
    87
    AI 评估置信度
    88
    方法
    基于三个数据集的混合方法用户研究。
    来源范围
    title and abstract
    AI 溯源
    codex-research-curation · initial-curation-v1
    人类复核状态
    尚无人类复核

反对证据

此类别暂无公开证据。

背景证据

此类别暂无公开证据。