项目成果

九项能力总览

汇总各模块的代表性结果、素材完备度和后续接入状态。

1.1

多模态跨域情感识别

已有四类情绪样例和测试集指标。

素材较完整
1.2

决策自适应的声音事件检测

已接入三组音频、同步热图、17 类指标和可配置决策展示。

素材较完整
1.3

关系感知的视频关键片段检测

已有原视频、摘要视频和 SVG 可视化。

素材较完整
2.1

对话情感因果推理

已接入 17 轮对话、17 条情感—原因关系及双数据集指标。

素材较完整
2.2

交互意图与反应推断

已接入六组事件、三类参考候选和整体评测指标;逐样本分数未提供。

素材较完整
2.3

长时序多轮次对话情感识别

已接入 17 轮双角色源情绪轨迹、10 次转折及 162 段对话整体评测;逐轮预测未提供。

素材较完整
3.1

多样适宜面部反应生成

已接入 30 秒说话人输入、真实倾听者参考、十个生成反应候选和多组评测指标。

素材较完整
3.2

面向情感陪伴场景的可控生成式任务

已接入 8 个会话、45 轮评分回复与 100 组三路语音;角色卡正文、中性参考音频及 FT 版本待补。

待补结构化结果
3.3

关键目标跟踪

已接入五组带框视频、同步 IoU 原图、逐帧定位和 OTB 整体指标;未提供逐帧数值表。

素材较完整