首页 公共数据集 测评框架 自有数据集 模型榜单 提交测评结果 ↗
EMOTIONAL INTELLIGENCE AI · OPEN RESEARCH BENCHMARK · 2026

通灵
大模型共情智能
测评平台

围绕情感共情、认知共情、共情关怀与安全交互,构建开放、透明、可复核的大模型共情智能评测平台。

情感共情 AFFECTIVE EMPATHY
认知共情 COGNITIVE EMPATHY
共情关怀 EMPATHIC CONCERN
安全交互 SAFE INTERACTION
LIVE
Affective Empathy
0.6450 ↑ 0.03
193 可验证评测条目
4+ 核心能力领域
33 细分测评任务
5 展示模型

四大核心能力领域

借鉴人类的共情过程,从四个方向评测大模型的共情智能。

公共数据集

覆盖 193 个可验证评测条目、4 个大类与 33 个细分任务,支持按方向浏览与追溯。

193
可验证评测条目

四维实证评测视图

使用四维综合测评与细分任务测评展示模型能力结构。

综合评分(0–1)

Gemini 3.1 Pro0.5172
MiMo v2.50.4883
DeepSeek v4 Flash0.4615
GPT-5.50.4486
Claude Opus 4.60.4401
共情能力雷达图
n = 9 / 7 / 6 / 10

比较五个模型在情感共情、认知共情、共情关怀、安全交互四个方向的综合表现。

主要模型家族 GPT-5.5 Claude Opus 4.6 Gemini 3.1 Pro MiMo-V2.5 DeepSeek-V4-Flash

模型榜单

展示综合与四方向结果,分数均为 0–1 综合展示。

查看完整榜单 →
排名模型综合评分情感共情认知共情共情关怀安全交互
1 Gemini 3.1 Pro 0.51720.64500.46650.41210.5452
2 MiMo v2.5 0.48830.58480.42470.40100.5427
3 DeepSeek v4 Flash 0.46150.55900.39400.35190.5414
4 GPT-5.5 0.44860.49960.39330.37700.5247
5 Claude Opus 4.6 0.44010.54420.35930.36690.4898

平台目标

通灵大模型共情智能评测平台承载德智普面向未来 AGI 的战略愿景,借鉴人类共情智能理论,创新构建覆盖情感感知、心理理解、共情关怀与安全交互的全方位评测体系。在此基础上,平台探索面向共情智能的新型评测数据范式,自主构建多模态、多轮交互数据集,覆盖复杂、动态且贴近真实的人际交互场景,系统评估大模型感知情绪、理解心理、提供关怀并安全交互的综合能力,推动共情智能技术持续演进,助力构建更懂人、更可信、更有温度的人工智能。

STEP 1
理论体系
STEP 2
任务范式
STEP 3
自研模型
STEP 4
最终发展愿景

提交你的模型评测结果

按统一格式提交模型、任务、数据子集、输入模态、样本量、评测日期、指标与异常记录等。

GitHub 讨论 ↗

提交结果所需信息

请按以下四项要求准备评测提交材料

1

模型与版本模型名称、参数规模、模态输入、推理配置和发布日期

2

评测维度明确提交方向、任务、数据子集与输入模态

3

数据与协议列出使用的数据集、划分方式、许可证和是否包含私有测试集

4

指标与证据提供客观指标、人工评分规则、失败案例和可复现实验脚本

前往 GitHub 提交 ↗