| 기준 | 제타비트 (Zbit) | 옥텟 (octet) |
|---|---|---|
| A plain text message (160 characters) | 1.28 × 10-18 Zbit | 160 octet |
| A three-minute MP3 | 2.4 × 10-14 Zbit | 3000000 octet |
| A smartphone photo | 3.2 × 10-14 Zbit | 4000000 octet |
| A high-definition film | 3.2 × 10-11 Zbit | 4 × 109 octet |
| A dual-layer Blu-ray disc | 4 × 10-10 Zbit | 5 × 1010 octet |
제타비트는 1000 엑사비트, 곧 10 해 비트, 1 뒤에 0 이 스물한 개 붙는 수에 해당하는 디지털 정보의 단위입니다. 기호는 Zbit 입니다. 실제로 잰 자료의 양이 아직도 예사로 알려지는 가장 큰 단위이며, 널리 쓰이게 된 것은 지난 열다섯 해 남짓입니다.
1 제타비트는 125 엑사옥텟입니다. 이 접두어를 살갑게 만든 말은 '제타바이트 시대'였습니다. 2016 년 무렵, 세계 인터넷의 한 해 오감이 처음으로 1 제타옥텟을 넘어선 그 순간을 위해 지어진 말입니다. 그 문턱은 한 해 오감이 처음 1 엑사옥텟을 넘어선 뒤 십 년 남짓 만에 왔고, 거기 걸린 자람의 빠르기를 잘 보여 줍니다.
지금 있는 자료의 총량 어림은 제타옥텟으로 적힙니다. 세계의 자료권, 곧 모든 서버와 원반과 전화와 기억 카드에 담긴 모든 것에, 만들어지자마자 버려지는 모든 것을 더한 것은 100 제타옥텟을 넘는 어디쯤으로 잡힙니다. 800 제타비트가 넘습니다. 이를 곧바로 세는 이는 없습니다. 값은 제조 통계와 모형에서 나옵니다.
그 거의 모두는 기계가 만들고 아무도 읽지 않습니다. 찍혔다가 덮어씌워지는 감시 영상, 감지기의 먼거리 측정, 기록, 갈무리본, 그리고 겹침이 요구하는 여러 사본이 압도적 대부분을 차지합니다. 사람이 한 번이라도 본 몫은 총량의 아주 작은 조각이며, 그 몫은 해마다 줄어듭니다.
접두어 제타는 1991 년에 요타와 함께 받아들여졌습니다. 그 회의는 어떤 글자가 남아 있는지도 살펴야 했습니다. Z 와 Y 가 뽑힌 것은 한편으로 쓰이지 않았기 때문이고, 그리스 말과 라틴 말 수사에서 따온 이름 짓기의 틀은 그때 이미 느슨해져 있었습니다. 2022 년에 더해진 로나와 케타도 같은 까닭으로 사다리를 위로 늘렸습니다.
가늠해 보자면, 1 제타비트의 정보를 글자 한 줄로 적어 내면 태양계 훨씬 너머까지 뻗을 것입니다. 이 단위는 사람이 들거나 다룰 수 있는 무엇을 나타내지 않습니다. 한 문명이 쌓아 온 생산을 나타내며, 바로 그 양이 이제 이름을 필요로 하기에 쓸모가 있습니다.
1 제타비트는 1000 엑사비트, 125 엑사옥텟, 또는 약 0.8470 제비비트와 같습니다.
옥텟은 꼭 8 비트에 해당하는 디지털 정보의 단위입니다. 기호는 octet 이고, 그 이름은 여덟의 묶음을 뜻하는 라틴 말에서 왔습니다. 갈무리된 자료의 거의 모두가 이 단위로 세어지며, 왜 바이트가 아니라 옥텟이라 부르는지는 알아 둘 값어치가 있습니다.
바이트는 본디 기계가 글자 하나를 담는 데 쓰는 비트의 수였고, 그 수는 정해져 있지 않았습니다. 이른 셈틀은 6 비트 바이트를 썼고, 7 비트인 것도, 9 비트인 것도 있었습니다. 1964 년 IBM 시스템/360 이 8 로 정했고 그 장사의 성공이 8 을 예삿일로 만들었지만, 바이트라는 낱말은 애매함이 위험한 규격 안에서는 기계마다 달라지던 옛 뜻을 지녔습니다.
그래서 통신망의 세계는 옥텟을 골랐습니다. 어떤 규약의 규격이 머리말 칸이 4 옥텟이라 적으면, 세상 어느 읽는 이도 그것을 32 비트 말고는 읽을 수 없습니다. IETF 가 내는 인터넷 규격이 어디서나 옥텟을 쓰는 까닭이 바로 이것이고, 프랑스말과 루마니아말을 비롯한 몇몇 말은 이 낱말을 일상의 쓰임에도 받아들였습니다. 그래서 프랑스에서 파는 하드디스크는 기가옥텟으로 잽니다.
8 비트는 256 가지 값을 담습니다. 그래서 그토록 많은 것이 256 걸음으로 나오는 것입니다. 색 통로는 0 에서 255 까지입니다. IPv4 주소는 4 옥텟이며, 0 과 255 사이의 네 숫자로 적힙니다. 본디의 ASCII 글자 모음은 7 비트를 쓰고 하나를 비워 두었는데, 뒤이은 여러 8 비트 확장은 그 빈 비트를 저마다 다른 표기 글자 묶음으로 채웠습니다. 유니코드가 마침내 갈아치운 뒤죽박죽이 이것입니다.
오늘의 글자 부호화도 옥텟으로 셉니다. UTF-8 은 표기 없는 라틴 글자에 1 옥텟, 유럽의 표기 붙은 글자 대부분과 그리스 글자, 키릴 글자에 2 옥텟, 중국말과 일본말과 한국말에 3 옥텟, 나머지에 4 옥텟을 씁니다. 그래서 같은 한마디도 말에 따라 차지하는 크기가 다르고, 옥텟으로 잰 길이의 한계는 글자 수의 한계가 아닙니다.
담기는 양, 파일의 크기, 기억, 망이 실어 나르는 알맹이는 모두 옥텟이나 그 곱절로 적습니다. 전송의 빠르기만이 예외로 초당 비트로 적히며, 두 관례 사이의 여덟 곱절이라는 차이가 이 분야에서 가장 흔한 헷갈림의 뿌리입니다.
1 옥텟은 8 비트, 0.008 킬로비트, 또는 0.001 킬로옥텟과 같습니다.