#CLM-8B

CLM-8B对比决策模型发布:延迟仅为Jev的九分之一,刷新SOTA
CLM(Contrastive Language Model)是一个用对比学习训练的决策模型。它把状态(state)和动作(action)映射到同一个向量空间,用内积算匹配度。给定当前状态和一组候选动作,CLM 给每个动作打分,选最高分。这…