LabHub
学习 学习路径 课程

处理客户数据

测验:文字乱码了

在 LabHub 中继续学习

한국어 원문으로 표시합니다.

고객이 보낸 CSV 가 엄격 UTF-8 디코딩에 성공했다. 이 사실이 갖는 무게로 가장 정확한 것은?

한글이 알파벳 기호로 보이지만 encode("latin-1").decode("utf-8") 로 원문이 돌아오는 파일이 있다. 왜 되돌릴 수 있는가?

어떤 파일을 열어 보니 U+FFFD 가 수백 개 들어 있다. 가장 적절한 판단은?

두 파일의 이름 칸을 조인했더니 0건이 맞았다. 화면에서는 이름이 똑같이 보인다. 가장 먼저 의심할 것은?

웹 화면에서 복사해 온 고객명에 제로폭 공백(U+200B)이 섞였다. strip() 만으로 처리하면 어떻게 되는가?

UTF-8 로 저장된 CSV 앞에 BOM 세 바이트가 붙어 있다. 이것을 떼지 않고 읽으면 가장 흔히 무엇이 깨지는가?