ચાર મુખ્ય મોડ
દરેક મોડ અક્ષરોની શ્રેણી અને ઘનતા વચ્ચે સમાધાન કરે છે. ન્યુમેરિક મોડ ફક્ત આંકડા સંભાળે છે પણ ત્રણ આંકડા 10 બિટમાં સમાવે છે, જ્યારે બાઇટ મોડ કોઈપણ બાઇટ સંભાળે છે પણ દરેક પર 8 બિટ ખર્ચે છે.
આલ્ફાન્યુમેરિક મોડ 45 અક્ષરોનો સમૂહ આવરે છે: 0–9 આંકડા, A–Z મોટા અંગ્રેજી અક્ષર, ખાલી જગ્યા અને $ % * + - . / તથા કોલન ચિહ્નો. નાના અક્ષર સમૂહમાં નથી, એટલે જ બધા મોટા અક્ષરવાળું URL નાના અક્ષરવાળા એ જ URL કરતાં નાનો કોડ બનાવી શકે.
- ન્યુમેરિક: 0–9 આંકડા, 3 આંકડા દીઠ 10 બિટ
- આલ્ફાન્યુમેરિક: 45 અક્ષર, 2 અક્ષર દીઠ 11 બિટ
- બાઇટ: કોઈપણ 8-બિટ મૂલ્ય, બાઇટ દીઠ 8 બિટ
- કાન્જી: Shift JIS ડબલ-બાઇટ અક્ષર, દરેક 13 બિટ
મોડ સૂચક અને સેગમેન્ટ
ડેટાની દરેક શ્રેણી 4-બિટના મોડ સૂચક અને અક્ષર ગણતરીથી શરૂ થાય છે, જેની લંબાઈ મોડ અને વર્ઝન પર આધાર રાખે છે. કોડમાં આવા ઘણા સેગમેન્ટ હોઈ શકે, ઉદાહરણ તરીકે આંકડાની લાંબી શ્રેણી માટે ન્યુમેરિક અને બાકીના માટે બાઇટ, જે પરિણામ નાનું બનાવી શકે.
અન્ય 4-બિટ સૂચક અક્ષર સમૂહને બદલે સુવિધાઓ દર્શાવે છે: અક્ષર એન્કોડિંગ જાહેર કરવા ECI, ડેટા ઘણા કોડમાં વહેંચવા સ્ટ્રક્ચર્ડ એપેન્ડ, અને GS1 તથા અન્ય ઉદ્યોગ ડેટા ફોર્મેટ માટે FNC1. ચાર શૂન્ય બિટનો ટર્મિનેટર ડેટા પૂરો કરે છે.
- ન્યુમેરિક 0001, આલ્ફાન્યુમેરિક 0010, બાઇટ 0100, કાન્જી 1000
- ECI 0111, સ્ટ્રક્ચર્ડ એપેન્ડ 0011
- FNC1 પ્રથમ સ્થાન 0101, દ્વિતીય સ્થાન 1001
- ટર્મિનેટર 0000
બાઇટ મોડ અને અક્ષર સમૂહ
બાઇટ મોડનું ધોરણનું ડિફોલ્ટ અર્થઘટન ISO-8859-1 (Latin-1) છે, પણ આજે મોટા ભાગના જનરેટર UTF-8 લખે છે, જેથી ઉચ્ચાર ચિહ્નવાળા અક્ષર, અન્ય લિપિઓ અને ઇમોજી ટકી રહે. રીડર સામાન્ય રીતે બાઇટ તપાસીને UTF-8 ઓળખે છે.
જ્યાં અક્ષર સમૂહ સ્પષ્ટ હોવો જરૂરી હોય, ત્યાં ECI હેડર તેને સ્પષ્ટ રીતે જાહેર કરી શકે. તે વગર, રીડર ક્યારેક ખોટું અનુમાન લગાવીને ગૂંચવાયેલા અક્ષર બતાવી શકે.