个人知识库

标签: 可解释性

此标签下有7条笔记。

  • 2026年7月16日

    AI 可解释性

    • 实体
    • 概念
    • AI核心技术
    • AI安全
    • 可解释性
    • 神经网络
    • DeepMind
  • 2026年7月16日

    AI 对齐

    • 实体
    • 概念
    • AI安全
    • AI伦理
    • 可解释性
    • 对齐评估
  • 2026年7月16日

    思维链 CoT

    • 实体
    • 概念
    • AI核心技术
    • 推理
    • Prompt技术
    • Agent
    • SOP
    • 可解释性
    • AI安全
  • 2026年7月16日

    稀疏自编码器

    • 实体
    • 概念
    • AI核心技术
    • 可解释性
    • 神经网络
    • 机器学习
  • 2026年7月16日

    线性探针

    • 实体
    • 概念
    • AI核心技术
    • 可解释性
    • AI安全
    • 安全监控
  • 2026年7月16日

    评估意识与评估博弈

    • 实体
    • 概念
    • AI安全
    • 可解释性
    • AI对齐
    • 评估
    • Anthropic
  • 2026年7月16日

    预填充攻击

    • 实体
    • 概念
    • AI安全
    • 越狱
    • 审计
    • 可解释性

Created with Quartz v4.5.2 © 2026

  • GitHub
  • Discord Community