项目成果
九项能力总览
汇总各模块的代表性结果、素材完备度和后续接入状态。
多模态跨域情感识别
已有四类情绪样例和测试集指标。
素材较完整1.2决策自适应的声音事件检测
已接入三组音频、同步热图、17 类指标和可配置决策展示。
素材较完整1.3关系感知的视频关键片段检测
已有原视频、摘要视频和 SVG 可视化。
素材较完整2.1对话情感因果推理
已接入 17 轮对话、17 条情感—原因关系及双数据集指标。
素材较完整2.2交互意图与反应推断
已接入六组事件、三类参考候选和整体评测指标;逐样本分数未提供。
素材较完整2.3长时序多轮次对话情感识别
已接入 17 轮双角色源情绪轨迹、10 次转折及 162 段对话整体评测;逐轮预测未提供。
素材较完整3.1多样适宜面部反应生成
已接入 30 秒说话人输入、真实倾听者参考、十个生成反应候选和多组评测指标。
素材较完整3.2面向情感陪伴场景的可控生成式任务
已接入 8 个会话、45 轮评分回复与 100 组三路语音;角色卡正文、中性参考音频及 FT 版本待补。
待补结构化结果3.3关键目标跟踪
已接入五组带框视频、同步 IoU 原图、逐帧定位和 OTB 整体指标;未提供逐帧数值表。
素材较完整