一句话定位

xAI 2026-04-07 发布的 Grok 4.20 系统卡——具备高级推理与多智能体能力的旗舰模型,可单智能体(SA)或多智能体(MA)部署,按 xAI 的 Frontier AI Framework (FAIF) 做双用途能力评估。

摘要

Grok 4.20 是 xAI 最新模型,具备高级推理与多智能体(multi-agent)能力,在学术与产业基准上达 SOTA。系统卡沿两条风险轴评估安全相关行为:恶意使用(malicious use)与失控(loss of control);并按 Frontier Artificial Intelligence Framework (FAIF) 做 CBRN、网络安全、有害操纵(Harmful Manipulation)三类双用途能力评估。Grok 4.20 可部署为单智能体(Grok 4.2 SA)或多智能体(Grok 4.2 MA),默认评估在单智能体模式。支持多语言(英/中/阿/印地/西等数十种),输入支持文本与图像、输出文本;在 grok.com/x.com 上可调用工具用 Grok Imagine 生图、分析 x.com 视频。定位通用”求真”AI 助手,不用于高风险自主决策。

关键技术细节

  • 发布:2026-04-07(PDF 内标 April 7, 2026)。机构:xAI。8 页系统卡。
  • 部署模式:single-agent (Grok 4.2 SA) 或 multi-agent (Grok 4.2 MA);多智能体是本代核心能力。
  • 安全评估两轴:malicious use(恶意使用)、loss of control(失控)。
  • 双用途能力评估(按 FAIF):CBRN、Cybersecurity、Harmful Manipulation。
  • 输入/输出模态:输入 文本 + 图像;输出 文本;线上可用工具调用 Grok Imagine 生图、分析 x.com 视频。
  • 支持语言:英、中、阿、印地、西等数十种。
  • 定位:通用 truth-seeking 助手(问答/推理/研究/写作/编程/翻译/创意/多模态),非高风险自主决策场景。

原始链接

一手源存档(sources/)

  • xai-grok-4-20-model-card.pdf (PDF 不入 git,走 HF bucket)