Antes de prever o mundo, precisamos decidir o que conta como estado. Este artigo apresenta as duas perguntas, os três arcos e as rotas de leitura da série.
DINO troca a regressão vetorial do BYOL por distribuições aguçadas e centralizadas. A combinação aprende sem negativos e faz objetos aparecerem nos mapas de atenção.
O BYOL retira todos os negativos do SimCLR e pede que uma rede rápida alcance um alvo lento. A perda é curta; explicar por que a solução não colapsa exige...