LabHub
学习 学习路径 课程

Transformer — 手算一遍注意力

测验:分词与词表

在 LabHub 中继续学习

한국어 원문으로 표시합니다.

같은 문장을 넣었는데 모델을 바꾸니 토큰 수가 달라졌다. 가장 정확한 설명은?

바이트 수준에서 출발하면 무엇이 보장되는가?

한글 음절 하나가 UTF-8 로 몇 바이트이고, 그것이 왜 문제인가?

count_pairs([9, 9, 9]) 의 올바른 결과는?

merge([5, 5, 5], (5, 5), 300) 의 올바른 결과와 그 이유는?

학습한 병합 규칙으로 새 글을 부호화할 때 순서가 왜 중요한가?