| 기준 | 제타옥텟 (Zo) | 옥텟 (octet) |
|---|---|---|
| A plain text message (160 characters) | 1.6 × 10-19 Zo | 160 octet |
| A three-minute MP3 | 3 × 10-15 Zo | 3000000 octet |
| A smartphone photo | 4 × 10-15 Zo | 4000000 octet |
| A high-definition film | 4 × 10-12 Zo | 4 × 109 octet |
| A dual-layer Blu-ray disc | 5 × 10-11 Zo | 5 × 1010 octet |
제타옥텟은 1000 엑사옥텟, 곧 10 해 옥텟에 해당하는 디지털 정보의 단위입니다. 기호는 Zo 입니다. 이제 세상의 자료 총량이 이 단위로 이야기되며, 한 시대에 이름을 준 오직 하나의 자료 단위이기도 합니다.
그 이름은 '제타바이트 시대'라는 말에서 왔습니다. 2016 년 무렵부터 쓰였고, 세계 인터넷의 한 해 오감이 처음으로 1 제타옥텟을 넘어섰을 때의 일입니다. 세계의 자료권, 곧 어딘가에 갈무리된 모든 파일에 만들어지자마자 버려지는 모든 것을 더한 것의 어림은 그 몇 해 뒤 100 제타옥텟을 넘었고, 지금도 해마다 몇십 제타옥텟씩 오르고 있습니다.
이 값이 무엇을 담고 있는지를 아는 일이 값 그 자체보다 중요합니다. 그것은 사본을 셉니다. 전화 속 사진 한 장은 그 전화의 갈무리본에도 있고, 구름 제공자의 자료 처리장 서버 두 대에도 있고, 임시 저장 켜에도 있으며, 어쩌면 기계 배움의 훈련 모음에도 있습니다. 서로 다른 작품이 아니라 갈무리된 옥텟을 세는 일은, 아무도 제대로 재 본 적 없는 큰 곱절로 합계를 부풀립니다.
합계의 속을 채우는 것은 아무도 보지 않는 것들입니다. 몇 주 안에 덮어씌워지는 감시와 경비 영상이 한 갈래로는 가장 큽니다. 공업 장비와 탈것과 건물에서 오는 감지기와 먼거리 측정 자료가 그다음입니다. 어떤 갈래든 사람이 지은 것은 소수이며, 글은 그 소수 안에서도 반올림에 묻힐 만큼입니다.
만드는 쪽이 합계에 굳은 한계를 지웁니다. 세상의 저장 공장을 다 합쳐도 새 용량을 한 해에 몇 백 엑사옥텟밖에 내놓지 못합니다. 1 제타옥텟의 한 조각입니다. 그러니 만들어지는 자료의 대부분은 아예 갈무리되지 않습니다. 닿는 대로 다뤄지고 버려집니다. 이는 실패가 아니라 뜻을 담은 설계의 고름입니다.
크기를 가늠하자면, 1 제타옥텟은 가게의 큰 하드디스크 80 억 대쯤, 곧 지구의 사람 하나에 한 대꼴입니다. 납작하게 쌓으면 그만한 원반은 달을 훨씬 넘는 기둥이 될 것입니다. 이 단위는 행성 통째의 산업에 걸친 합계로만 있는 양을 나타냅니다.
1 제타옥텟은 1000 엑사옥텟, 1 조 기가옥텟, 8 제타비트, 또는 약 0.8470 제비옥텟과 같습니다.
옥텟은 꼭 8 비트에 해당하는 디지털 정보의 단위입니다. 기호는 octet 이고, 그 이름은 여덟의 묶음을 뜻하는 라틴 말에서 왔습니다. 갈무리된 자료의 거의 모두가 이 단위로 세어지며, 왜 바이트가 아니라 옥텟이라 부르는지는 알아 둘 값어치가 있습니다.
바이트는 본디 기계가 글자 하나를 담는 데 쓰는 비트의 수였고, 그 수는 정해져 있지 않았습니다. 이른 셈틀은 6 비트 바이트를 썼고, 7 비트인 것도, 9 비트인 것도 있었습니다. 1964 년 IBM 시스템/360 이 8 로 정했고 그 장사의 성공이 8 을 예삿일로 만들었지만, 바이트라는 낱말은 애매함이 위험한 규격 안에서는 기계마다 달라지던 옛 뜻을 지녔습니다.
그래서 통신망의 세계는 옥텟을 골랐습니다. 어떤 규약의 규격이 머리말 칸이 4 옥텟이라 적으면, 세상 어느 읽는 이도 그것을 32 비트 말고는 읽을 수 없습니다. IETF 가 내는 인터넷 규격이 어디서나 옥텟을 쓰는 까닭이 바로 이것이고, 프랑스말과 루마니아말을 비롯한 몇몇 말은 이 낱말을 일상의 쓰임에도 받아들였습니다. 그래서 프랑스에서 파는 하드디스크는 기가옥텟으로 잽니다.
8 비트는 256 가지 값을 담습니다. 그래서 그토록 많은 것이 256 걸음으로 나오는 것입니다. 색 통로는 0 에서 255 까지입니다. IPv4 주소는 4 옥텟이며, 0 과 255 사이의 네 숫자로 적힙니다. 본디의 ASCII 글자 모음은 7 비트를 쓰고 하나를 비워 두었는데, 뒤이은 여러 8 비트 확장은 그 빈 비트를 저마다 다른 표기 글자 묶음으로 채웠습니다. 유니코드가 마침내 갈아치운 뒤죽박죽이 이것입니다.
오늘의 글자 부호화도 옥텟으로 셉니다. UTF-8 은 표기 없는 라틴 글자에 1 옥텟, 유럽의 표기 붙은 글자 대부분과 그리스 글자, 키릴 글자에 2 옥텟, 중국말과 일본말과 한국말에 3 옥텟, 나머지에 4 옥텟을 씁니다. 그래서 같은 한마디도 말에 따라 차지하는 크기가 다르고, 옥텟으로 잰 길이의 한계는 글자 수의 한계가 아닙니다.
담기는 양, 파일의 크기, 기억, 망이 실어 나르는 알맹이는 모두 옥텟이나 그 곱절로 적습니다. 전송의 빠르기만이 예외로 초당 비트로 적히며, 두 관례 사이의 여덟 곱절이라는 차이가 이 분야에서 가장 흔한 헷갈림의 뿌리입니다.
1 옥텟은 8 비트, 0.008 킬로비트, 또는 0.001 킬로옥텟과 같습니다.