借鉴人类的共情过程,从四个方向评测大模型的共情智能。
覆盖 193 个可验证评测条目、4 个大类与 33 个细分任务,支持按方向浏览与追溯。
使用四维综合测评与细分任务测评展示模型能力结构。
比较五个模型在情感共情、认知共情、共情关怀、安全交互四个方向的综合表现。
展示综合与四方向结果,分数均为 0–1 综合展示。
| 排名 | 模型 | 综合评分 | 情感共情 | 认知共情 | 共情关怀 | 安全交互 |
|---|---|---|---|---|---|---|
| 1 | Gemini 3.1 Pro | 0.5172 | 0.6450 | 0.4665 | 0.4121 | 0.5452 |
| 2 | MiMo v2.5 | 0.4883 | 0.5848 | 0.4247 | 0.4010 | 0.5427 |
| 3 | DeepSeek v4 Flash | 0.4615 | 0.5590 | 0.3940 | 0.3519 | 0.5414 |
| 4 | GPT-5.5 | 0.4486 | 0.4996 | 0.3933 | 0.3770 | 0.5247 |
| 5 | Claude Opus 4.6 | 0.4401 | 0.5442 | 0.3593 | 0.3669 | 0.4898 |
通灵大模型共情智能评测平台承载德智普面向未来 AGI 的战略愿景,借鉴人类共情智能理论,创新构建覆盖情感感知、心理理解、共情关怀与安全交互的全方位评测体系。在此基础上,平台探索面向共情智能的新型评测数据范式,自主构建多模态、多轮交互数据集,覆盖复杂、动态且贴近真实的人际交互场景,系统评估大模型感知情绪、理解心理、提供关怀并安全交互的综合能力,推动共情智能技术持续演进,助力构建更懂人、更可信、更有温度的人工智能。