抛一个机器学习PAI问题:
假设每条训练样本有数量不等的一些兴趣tags,例如A样本有”电影 | 电视剧”,B样本有”书籍 | 电视剧 | 汽车 | 新闻”。easyrec提供了TagFeature来parse这样的输入特征,但是parse后A样本有2个tag embedding向量,B样本有4个tag embedding向量,理想情况下应该有个mean或者max的pooling来合一,但是我读了读tag feature预处理的源码
(https://github.com/alibaba/EasyRec/blob/1fb889d756a90212a7c0333470428ba3ad95ce95/easy_rec/python/input/input.py#L414)
,以及看一下模型的计算图,似乎并没有找到类似的操作的地方。是我miss了哪一个地方吗?请教一下TagFeature进了DSSM模型是怎么处理的呢?
可以设置combiner ,此回答整理自钉群“【EasyRec】推荐算法交流群”