URL ਐਨਕੋਡਰ: ਆਨਲਾਈਨ ਮੁਫਤ URL ਵਿੱਚ ਵਿਸ਼ੇਸ਼ ਅੱਖਰਾਂ ਨੂੰ ਐਸਕੇਪ ਕਰੋ
ਵਿਸ਼ੇਸ਼ ਅੱਖਰਾਂ ਨੂੰ ਤੁਰੰਤ ਐਨਕੋਡ ਕਰਨ ਲਈ ਮੁਫਤ URL ਸਟਰਿੰਗ ਐਸਕੇਪਰ ਟੂਲ। ਸਪੇਸ, ਯੂਨੀਕੋਡ ਅਤੇ ਪ੍ਰਤੀਕਾਂ ਨੂੰ ਪ੍ਰਤੀਸ਼ਤ-ਐਨਕੋਡਡ ਫਾਰਮੈਟ ਵਿੱਚ ਬਦਲੋ। APIs, ਵੈਬ ਫਾਰਮ ਅਤੇ ਅੰਤਰਰਾਸ਼ਟਰੀ URLs ਲਈ ਬਿਲਕੁਲ ਸਹੀ। ਹੁਣੇ ਟਰਾਈ ਕਰੋ!
URL ਸਟਰਿੰਗ ਐਸਕੇਪਰ
ਦਸਤਾਵੇਜ਼ੀਕਰਣ
URL ਐਨਕੋਡਿੰਗ: ਇਹ ਕੀ ਹੈ ਅਤੇ ਕਿਵੇਂ ਕੰਮ ਕਰਦੀ ਹੈ
URL ਐਨਕੋਡਿੰਗ, ਜਿਸਨੂੰ ਪ੍ਰਤੀਸ਼ਤ-ਐਨਕੋਡਿੰਗ ਵੀ ਕਿਹਾ ਜਾਂਦਾ ਹੈ, ਵੈੱਬ ਪਤੇ ਵਿੱਚ ਅੱਖਰਾਂ ਨੂੰ ਸਿਰਫ਼ ਕੁਝ ਸੁਰੱਖਿਅਤ ASCII ਅੱਖਰਾਂ ਦੀ ਵਰਤੋਂ ਕਰਕੇ ਦਰਸਾਉਣ ਦਾ ਤਰੀਕਾ ਹੈ। ਇਹ ਕਿਸੇ ਅਸੁਰੱਖਿਅਤ ਅੱਖਰ ਨੂੰ % ਚਿੰਨ੍ਹ ਅਤੇ ਉਸ ਤੋਂ ਬਾਅਦ ਦੋ ਹੈਕਸਾਡੈਸੀਮਲ ਅੰਕਾਂ ਨਾਲ ਬਦਲ ਕੇ ਕੰਮ ਕਰਦੀ ਹੈ। ਇਹ URL ਸਟ੍ਰਿੰਗ ਐਸਕੇਪਰ ਟੂਲ ਟੈਕਸਟ ਨੂੰ ਉਸੇ ਤਰੀਕੇ ਨਾਲ ਐਨਕੋਡ ਕਰਦਾ ਹੈ, ਜਿਵੇਂ JavaScript ਦਾ ਅੰਦਰੂਨੀ encodeURIComponent ਫੰਕਸ਼ਨ ਕਰਦਾ ਹੈ।
URL ਨੂੰ ਐਨਕੋਡਿੰਗ ਦੀ ਲੋੜ ਕਿਉਂ ਹੁੰਦੀ ਹੈ
URL ਵਿੱਚ ਸਿਰਫ਼ ਸੀਮਿਤ ਅੱਖਰ ਹੀ ਹੋ ਸਕਦੇ ਹਨ: ਅੱਖਰ, ਅੰਕ ਅਤੇ ਕੁਝ ਵਿਰਾਮ-ਚਿੰਨ੍ਹ। ਖਾਲੀ ਥਾਵਾਂ, ਲਹਿਜ਼ੇ ਵਾਲੇ ਅੱਖਰ, ਗੈਰ-ਲਾਤੀਨੀ ਲਿਪੀਆਂ ਦੇ ਅੱਖਰ ਅਤੇ & ਜਾਂ = ਵਰਗੇ ਚਿੰਨ੍ਹ, ਜੇ ਬਿਨਾਂ ਐਨਕੋਡ ਕੀਤੇ URL ਵਿੱਚ ਆ ਜਾਣ, ਤਾਂ URL ਨੂੰ ਖ਼ਰਾਬ ਕਰ ਸਕਦੇ ਹਨ ਜਾਂ ਉਸਦਾ ਅਰਥ ਬਦਲ ਸਕਦੇ ਹਨ। ਉਦਾਹਰਨ ਵਜੋਂ, ਲਿੰਕ ਵਿੱਚ ਮੌਜੂਦ ਖਾਲੀ ਥਾਂ ਬ੍ਰਾਊਜ਼ਰ ਜਾਂ ਸਰਵਰ ਨੂੰ URL ਨੂੰ ਦੋ ਵੱਖਰੇ ਹਿੱਸਿਆਂ ਵਜੋਂ ਪੜ੍ਹਨ ਲਈ ਮਜਬੂਰ ਕਰ ਸਕਦੀ ਹੈ। ਪ੍ਰਤੀਸ਼ਤ-ਐਨਕੋਡਿੰਗ ਇਨ੍ਹਾਂ ਅੱਖਰਾਂ ਨੂੰ ਅਜਿਹੇ ਕੋਡ ਨਾਲ ਬਦਲਦੀ ਹੈ ਜਿਸਨੂੰ ਹਰ ਬ੍ਰਾਊਜ਼ਰ ਅਤੇ ਸਰਵਰ ਇੱਕੋ ਤਰੀਕੇ ਨਾਲ ਪੜ੍ਹ ਸਕਦਾ ਹੈ।
ਇਸ ਟੂਲ ਵੱਲੋਂ ਅਣਬਦਲੇ ਛੱਡੇ ਜਾਣ ਵਾਲੇ ਅੱਖਰ
ਇਹ ਟੂਲ ਹੇਠਾਂ ਦਿੱਤੇ ਅੱਖਰਾਂ ਨੂੰ ਕਦੇ ਨਹੀਂ ਬਦਲਦਾ। ਇਹ ਸਿੱਧੇ ਹੀ ਰਹਿੰਦੇ ਹਨ:
- ਵੱਡੇ ਅਤੇ ਛੋਟੇ ਅੱਖਰ:
A–Z,a–z - ਅੰਕ:
0–9 - ਵਿਰਾਮ-ਚਿੰਨ੍ਹ
-._~!*'()
ਹਰ ਹੋਰ ਅੱਖਰ ਨੂੰ ਪ੍ਰਤੀਸ਼ਤ-ਐਨਕੋਡ ਕੀਤਾ ਜਾਂਦਾ ਹੈ, ਜਿਸ ਵਿੱਚ ਇਹ ਸ਼ਾਮਲ ਹਨ:
- ਖਾਲੀ ਥਾਂ ਵਾਲਾ ਅੱਖਰ ਅਤੇ
:/?#[]@$&+,;=ਵਰਗੇ ਵਿਰਾਮ-ਚਿੰਨ੍ਹ - ਲਹਿਜ਼ੇ ਵਾਲੇ ਅੱਖਰ ਅਤੇ ਹੋਰ ਕੋਈ ਵੀ ਗੈਰ-ASCII ਜਾਂ ਯੂਨੀਕੋਡ ਅੱਖਰ
- ਖੁਦ ਸ਼ਾਬਦਿਕ
%ਅੱਖਰ, ਜੋ ਹਮੇਸ਼ਾ%25ਬਣ ਜਾਂਦਾ ਹੈ, ਭਾਵੇਂ ਉਹ ਪਹਿਲਾਂ ਹੀ ਕਿਸੇ ਪ੍ਰਤੀਸ਼ਤ-ਐਨਕੋਡ ਕੀਤੇ ਕ੍ਰਮ ਦਾ ਹਿੱਸਾ ਹੋਵੇ
URL ਸੰਟੈਕਸ ਬਾਰੇ ਕੁਝ ਆਮ ਮਾਰਗਦਰਸ਼ਕ ! * ' ( ਅਤੇ ) ਨੂੰ ਹੋਰ ਵਿਰਾਮ-ਚਿੰਨ੍ਹਾਂ ਨਾਲ ਮਿਲਾ ਕੇ ਉਹ ਅੱਖਰ ਦੱਸਦੇ ਹਨ ਜਿਨ੍ਹਾਂ ਨੂੰ ਕੁਝ ਸੰਦਰਭਾਂ ਵਿੱਚ “ਐਨਕੋਡ ਕਰਨ ਦੀ ਲੋੜ ਪੈ ਸਕਦੀ ਹੈ”। ਇਹ ਵਿਸ਼ੇਸ਼ ਟੂਲ ਇਨ੍ਹਾਂ ਨੂੰ ਐਨਕੋਡ ਨਹੀਂ ਕਰਦਾ, ਕਿਉਂਕਿ ਇਹ encodeURIComponent ਦੇ ਨਿਯਮਾਂ ਦੀ ਪਾਲਣਾ ਕਰਦਾ ਹੈ, ਜਿਨ੍ਹਾਂ ਵਿੱਚ ਇਹ ਸੁਰੱਖਿਅਤ ਮੰਨੇ ਜਾਂਦੇ ਹਨ।
ਪ੍ਰਤੀਸ਼ਤ-ਐਨਕੋਡ ਕੀਤੀ ਸਟ੍ਰਿੰਗ ਦੀ ਗਣਨਾ ਕਿਵੇਂ ਕਰੀਏ (ਫਾਰਮੂਲਾ)
ਇਹ ਟੂਲ ਇਨਪੁੱਟ ਦੇ ਹਰ ਅੱਖਰ ਨੂੰ ਇੱਕ-ਇੱਕ ਕਰਕੇ ਜਾਂਚਦਾ ਹੈ ਅਤੇ ਇਹ ਨਿਯਮ ਲਾਗੂ ਕਰਦਾ ਹੈ:
- ਜੇ ਅੱਖਰ ਉੱਪਰ ਦਿੱਤੇ ਅਣਬਦਲੇ ਅੱਖਰਾਂ ਵਿੱਚੋਂ ਇੱਕ ਹੈ, ਤਾਂ ਉਸਨੂੰ ਉਸੇ ਤਰ੍ਹਾਂ ਰੱਖੋ।
- ਨਹੀਂ ਤਾਂ ਅੱਖਰ ਨੂੰ ਇਸਦੇ UTF-8 ਬਾਈਟ ਕ੍ਰਮ ਵਿੱਚ ਬਦਲੋ। ਲਹਿਜ਼ੇ ਵਾਲੇ ਲਾਤੀਨੀ, ਯੂਨਾਨੀ, ਸਿਰਿਲਿਕ ਅਤੇ ਅਰਬੀ ਅੱਖਰ ਦੋ ਬਾਈਟ ਵਰਤਦੇ ਹਨ। ਚੀਨੀ, ਜਪਾਨੀ ਅਤੇ ਕੋਰੀਆਈ ਅੱਖਰ ਤਿੰਨ ਬਾਈਟ ਵਰਤਦੇ ਹਨ। ਇਮੋਜੀ ਚਾਰ ਬਾਈਟ ਵਰਤਦੇ ਹਨ।
- ਹਰ ਬਾਈਟ ਨੂੰ ਦੋ ਅੰਕਾਂ ਵਾਲੀ ਹੈਕਸਾਡੈਸੀਮਲ ਸੰਖਿਆ ਵਜੋਂ ਲਿਖੋ।
- ਹਰ ਹੈਕਸਾਡੈਸੀਮਲ ਜੋੜੇ ਦੇ ਅੱਗੇ
%ਲਗਾਓ। - ਐਨਕੋਡ ਕੀਤੀ ਸਟ੍ਰਿੰਗ ਬਣਾਉਣ ਲਈ ਨਤੀਜਿਆਂ ਨੂੰ ਕ੍ਰਮ ਅਨੁਸਾਰ ਜੋੜੋ।
ਹੱਲ ਕੀਤਾ ਉਦਾਹਰਨ
ਇਨਪੁੱਟ: Jürgen & Björk
ਅੱਖਰ-ਦਰ-ਅੱਖਰ ਪ੍ਰਕਿਰਿਆ:
| ਅੱਖਰ | ਨਤੀਜਾ |
|---|---|
J | J (ਅਣਬਦਲਿਆ) |
ü | %C3%BC (UTF-8 ਬਾਈਟ 0xC3, 0xBC) |
rgen | rgen (ਅਣਬਦਲਿਆ) |
(ਖਾਲੀ ਥਾਂ) | %20 |
& | %26 |
(ਖਾਲੀ ਥਾਂ) | %20 |
Bj | Bj (ਅਣਬਦਲਿਆ) |
ö | %C3%B6 (UTF-8 ਬਾਈਟ 0xC3, 0xB6) |
rk | rk (ਅਣਬਦਲਿਆ) |
ਆਉਟਪੁੱਟ: J%C3%BCrgen%20%26%20Bj%C3%B6rk
ਦੂਜੀ ਉਦਾਹਰਨ ਅਣਬਦਲੇ ਅੱਖਰਾਂ ਦੇ ਸਮੂਹ ਨੂੰ ਦਰਸਾਉਂਦੀ ਹੈ। -_.!~*'() ਸਟ੍ਰਿੰਗ ਨੂੰ ਐਨਕੋਡ ਕਰਨ ਨਾਲ -_.!~*'() ਮਿਲਦਾ ਹੈ, ਬਿਲਕੁਲ ਉਹੀ ਟੈਕਸਟ, ਕਿਉਂਕਿ ਇਸ ਵਿੱਚਲਾ ਹਰ ਅੱਖਰ ਅਣਰਾਖਵੇਂ ਸਮੂਹ ਨਾਲ ਸਬੰਧਤ ਹੈ। 100% ਸਟ੍ਰਿੰਗ ਨੂੰ ਐਨਕੋਡ ਕਰਨ ਨਾਲ 100%25 ਮਿਲਦਾ ਹੈ, ਕਿਉਂਕਿ % ਚਿੰਨ੍ਹ ਖੁਦ ਸੁਰੱਖਿਅਤ ਅੱਖਰ ਨਹੀਂ ਹੈ।
ਪ੍ਰਤੀਸ਼ਤ-ਐਨਕੋਡ ਕੀਤੀ ਸਟ੍ਰਿੰਗ ਨੂੰ ਡੀਕੋਡ ਕਰਨਾ
ਡੀਕੋਡਿੰਗ ਇਸ ਪ੍ਰਕਿਰਿਆ ਨੂੰ ਉਲਟ ਦਿੰਦੀ ਹੈ: ਹਰ %XX ਕ੍ਰਮ ਨੂੰ ਹੈਕਸਾਡੈਸੀਮਲ ਬਾਈਟ ਵਜੋਂ ਪੜ੍ਹਿਆ ਜਾਂਦਾ ਹੈ, ਬਾਈਟਾਂ ਨੂੰ ਮੁੜ ਉਹਨਾਂ ਦੇ ਮੂਲ UTF-8 ਅੱਖਰ ਵਿੱਚ ਜੋੜਿਆ ਜਾਂਦਾ ਹੈ ਅਤੇ ਅੱਖਰ ਉਸ ਕ੍ਰਮ ਦੀ ਥਾਂ ਲੈ ਲੈਂਦਾ ਹੈ। ਉਦਾਹਰਨ ਲਈ, %C3%BC ਮੁੜ ü ਵਿੱਚ ਡੀਕੋਡ ਹੁੰਦਾ ਹੈ ਅਤੇ %20 ਖਾਲੀ ਥਾਂ ਵਿੱਚ ਡੀਕੋਡ ਹੁੰਦਾ ਹੈ। ਇਹ ਟੂਲ ਸਿਰਫ਼ ਐਨਕੋਡ ਕਰਦਾ ਹੈ; ਪ੍ਰਕਿਰਿਆ ਨੂੰ ਉਲਟਾਉਣ ਲਈ ਵੱਖਰੇ ਡੀਕੋਡਰ ਦੀ ਲੋੜ ਹੁੰਦੀ ਹੈ।
ਆਮ ਵਰਤੋਂ
ਜਦੋਂ ਕਿਸੇ ਵਿਅਕਤੀ ਵੱਲੋਂ ਟਾਈਪ ਕੀਤਾ ਟੈਕਸਟ, ਨਾ ਕਿ ਪ੍ਰੋਗਰਾਮਰ ਵੱਲੋਂ ਲਿਖਿਆ ਟੈਕਸਟ, URL ਦਾ ਹਿੱਸਾ ਬਣਨਾ ਹੋਵੇ, ਤਾਂ ਪ੍ਰਤੀਸ਼ਤ-ਐਨਕੋਡਿੰਗ ਵਰਤੀ ਜਾਂਦੀ ਹੈ:
- ਖੋਜ ਬਾਕਸ ਜੋ ਖੋਜ ਸ਼ਬਦ ਨੂੰ ਐਡਰੈੱਸ ਬਾਰ ਵਿੱਚ ਪਾਉਂਦੇ ਹਨ, ਜਿਵੇਂ
?q=shoes%20%26%20bags - ਨਾਮਾਂ, ਪਤਿਆਂ ਜਾਂ ਹੋਰ ਉਪਭੋਗਤਾ ਡੇਟਾ ਨੂੰ ਲਿਜਾਣ ਵਾਲੇ ਕਵੈਰੀ ਪੈਰਾਮੀਟਰ
- ਉਨ੍ਹਾਂ ਪੰਨਿਆਂ ਦੇ ਲਿੰਕ ਜਿਨ੍ਹਾਂ ਦੇ ਸਿਰਲੇਖ ਲਹਿਜ਼ੇ ਵਾਲੇ ਅੱਖਰਾਂ ਜਾਂ ਗੈਰ-ਲਾਤੀਨੀ ਲਿਪੀਆਂ ਵਾਲੀਆਂ ਭਾਸ਼ਾਵਾਂ ਵਿੱਚ ਹਨ
- URL ਦੇ ਹਿੱਸੇ ਵਜੋਂ ਟੋਕਨ ਜਾਂ ਪਛਾਣਕਰਤਾ ਭੇਜਣ ਵਾਲੀਆਂ API ਬੇਨਤੀਆਂ
ਕੋਡ ਦੀਆਂ ਉਦਾਹਰਨਾਂ
1// JavaScript
2encodeURIComponent("Jürgen & Björk");
3// "J%C3%BCrgen%20%26%20Bj%C3%B6rk"
41# Python
2import urllib.parse
3urllib.parse.quote("Jürgen & Björk", safe="!*'()")
4# 'J%C3%BCrgen%20%26%20Bj%C3%B6rk'
5Python ਦਾ quote ਅੱਖਰਾਂ, ਅੰਕਾਂ ਅਤੇ - . _ ~ ਨੂੰ ਹਮੇਸ਼ਾ ਅਣਬਦਲਿਆ ਛੱਡਦਾ ਹੈ। ਇਸ ਟੂਲ ਨਾਲ ਮਿਲਾਉਣ ਲਈ ਪੰਜ ਵਾਧੂ
ਅੱਖਰ ! * ' ( ) ਨੂੰ safe ਵਿੱਚ ਦਰਜ ਕਰਨਾ ਪੈਂਦਾ ਹੈ। ਇਨ੍ਹਾਂ ਤੋਂ ਬਿਨਾਂ
quote ਇਸ ਦੀ ਥਾਂ %21 %2A %27 %28 %29 ਵਾਪਸ ਕਰਦਾ ਹੈ।
ਇਤਿਹਾਸ
URL ਵਿੱਚ ਅਸੁਰੱਖਿਅਤ ਅੱਖਰਾਂ ਨੂੰ ਐਨਕੋਡ ਕਰਨ ਦਾ ਵਿਚਾਰ RFC 1738 ਤੱਕ ਜਾਂਦਾ ਹੈ, ਜੋ (4,410 cm) 1994 ਵਿੱਚ ਪ੍ਰਕਾਸ਼ਿਤ ਹੋਇਆ ਸੀ ਅਤੇ URL ਫਾਰਮੈਟ ਨੂੰ ਪਰਿਭਾਸ਼ਿਤ ਕਰਨ ਵਾਲੇ ਪਹਿਲੇ ਦਸਤਾਵੇਜ਼ਾਂ ਵਿੱਚੋਂ ਇੱਕ ਸੀ। 3986 RFC, ਜੋ 2005 ਵਿੱਚ ਪ੍ਰਕਾਸ਼ਿਤ ਹੋਇਆ, ਨੇ ਨਿਯਮਾਂ ਨੂੰ ਅੱਪਡੇਟ ਕੀਤਾ ਅਤੇ ਉਨ੍ਹਾਂ “ਅਣਰਾਖਵੇਂ” ਅੱਖਰਾਂ ਦੇ ਸਮੂਹ ਨੂੰ ਰਸਮੀ ਤੌਰ ’ਤੇ ਪਰਿਭਾਸ਼ਿਤ ਕੀਤਾ ਜਿਨ੍ਹਾਂ ਨੂੰ ਕਦੇ ਐਨਕੋਡ ਕਰਨ ਦੀ ਲੋੜ ਨਹੀਂ ਹੁੰਦੀ। encodeURIComponent, ਜਿਸ JavaScript ਫੰਕਸ਼ਨ ’ਤੇ ਇਹ ਟੂਲ ਆਧਾਰਿਤ ਹੈ, RFC 3986 ਨਾਲੋਂ ਥੋੜ੍ਹਾ ਵਿਸ਼ਾਲ ਅਣਰਾਖਵਾਂ ਸਮੂਹ ਵਰਤਦਾ ਹੈ: ਇਹ ! * ' ( ਅਤੇ ) ਨੂੰ ਵੀ ਅਣਐਨਕੋਡ ਕੀਤਾ ਛੱਡਦਾ ਹੈ, ਜੋ URI ਵਿਸ਼ੇਸ਼ਤਾ ਦੇ ਪੁਰਾਣੇ ਸੰਸਕਰਣ ਨਾਲ ਮੇਲ ਖਾਂਦਾ ਹੈ।
ਅਕਸਰ ਪੁੱਛੇ ਜਾਂਦੇ ਸਵਾਲ
URL ਐਨਕੋਡਿੰਗ ਅਤੇ URL ਐਸਕੇਪਿੰਗ ਵਿੱਚ ਕੀ ਫ਼ਰਕ ਹੈ?
ਇਹ ਦੋਵੇਂ ਇੱਕੋ ਗੱਲ ਹਨ। ਦੋਵੇਂ ਸ਼ਬਦ ਪ੍ਰਤੀਸ਼ਤ-ਐਨਕੋਡਿੰਗ ਨੂੰ ਦਰਸਾਉਂਦੇ ਹਨ, ਜਿਸ ਵਿੱਚ ਕਿਸੇ ਅੱਖਰ ਨੂੰ % ਅਤੇ ਉਸ ਤੋਂ ਬਾਅਦ ਦੋ ਹੈਕਸਾਡੈਸੀਮਲ ਅੰਕਾਂ ਨਾਲ ਬਦਲਿਆ ਜਾਂਦਾ ਹੈ।
ਇਸ ਟੂਲ ਵਿੱਚ !, *, ', ( ਅਤੇ ) ਅਣਬਦਲੇ ਕਿਉਂ ਰਹਿੰਦੇ ਹਨ?
ਇਹ ਟੂਲ encodeURIComponent ਵਰਤਦਾ ਹੈ, ਜੋ ਇਨ੍ਹਾਂ ਪੰਜ ਅੱਖਰਾਂ ਨੂੰ ਸੁਰੱਖਿਅਤ ਮੰਨਦਾ ਹੈ ਅਤੇ ਜਿਵੇਂ ਟਾਈਪ ਕੀਤੇ ਗਏ ਹੋਣ, ਠੀਕ ਉਸੇ ਤਰ੍ਹਾਂ ਛੱਡ ਦਿੰਦਾ ਹੈ। ਹੋਰ ਐਨਕੋਡਿੰਗ ਫੰਕਸ਼ਨ ਅਤੇ ਕੁਝ ਸਰਵਰ ਹਾਲੇ ਵੀ ਇਨ੍ਹਾਂ ਨੂੰ ਐਨਕੋਡ ਕੀਤਾ ਹੋਇਆ ਚਾਹ ਸਕਦੇ ਹਨ, ਇਸ ਲਈ ਜੇ ਸਮੱਸਿਆ ਆਵੇ ਤਾਂ ਮੰਜ਼ਿਲ ਪ੍ਰਣਾਲੀ ਦੀ ਜਾਂਚ ਕਰੋ।
ਖਾਲੀ ਥਾਂ ਲਈ %20 ਅਤੇ + ਵਿੱਚ ਕੀ ਫ਼ਰਕ ਹੈ?
ਦੋਵੇਂ ਖਾਲੀ ਥਾਂ ਦਰਸਾਉਂਦੇ ਹਨ। %20 ਖਾਲੀ ਥਾਂ ਲਈ ਆਮ ਪ੍ਰਤੀਸ਼ਤ-ਐਨਕੋਡਿੰਗ ਹੈ। + ਚਿੰਨ੍ਹ ਸਿਰਫ਼ application/x-www-form-urlencoded ਡੇਟਾ ਵਿੱਚ ਵਰਤਿਆ ਜਾਣ ਵਾਲਾ ਵਿਸ਼ੇਸ਼ ਰੂਪ ਹੈ। ਇਹ HTML ਫਾਰਮ ਸਬਮਿਸ਼ਨਾਂ ਵਿੱਚ ਵਰਤਿਆ ਜਾਂਦਾ ਹੈ, ਇਸ ਟੂਲ ਵਿੱਚ ਨਹੀਂ।
ਕੀ ਇਹ ਟੂਲ ਪਹਿਲਾਂ ਹੀ ਐਨਕੋਡ ਕੀਤੇ ਟੈਕਸਟ ਨੂੰ ਡੀਕੋਡ ਕਰਦਾ ਹੈ?
ਨਹੀਂ। ਇਹ ਸਿਰਫ਼ ਐਨਕੋਡ ਕਰਦਾ ਹੈ। ਜੇ ਇਨਪੁੱਟ ਵਿੱਚ ਪਹਿਲਾਂ ਹੀ % ਚਿੰਨ੍ਹ ਹੋਵੇ, ਤਾਂ ਉਸ % ਨੂੰ ਸ਼ਾਬਦਿਕ ਅੱਖਰ ਮੰਨਿਆ ਜਾਂਦਾ ਹੈ ਅਤੇ ਆਉਟਪੁੱਟ ਵਿੱਚ %25 ਬਣ ਜਾਂਦਾ ਹੈ, ਉਸੇ ਤਰ੍ਹਾਂ ਨਹੀਂ ਛੱਡਿਆ ਜਾਂਦਾ।
ਚੀਨੀ ਜਾਂ ਅਰਬੀ ਟੈਕਸਟ ਵਰਗੇ ਗੈਰ-ਲਾਤੀਨੀ ਅੱਖਰਾਂ ਨੂੰ ਕਿਵੇਂ ਸੰਭਾਲਿਆ ਜਾਂਦਾ ਹੈ?
ਹਰ ਅੱਖਰ ਨੂੰ ਪਹਿਲਾਂ ਇਸਦੇ UTF-8 ਬਾਈਟ ਕ੍ਰਮ ਵਿੱਚ ਬਦਲਿਆ ਜਾਂਦਾ ਹੈ ਅਤੇ ਫਿਰ ਹਰ ਬਾਈਟ ਨੂੰ ਪ੍ਰਤੀਸ਼ਤ-ਐਨਕੋਡ ਕੀਤਾ ਜਾਂਦਾ ਹੈ। ਚੀਨੀ ਅੱਖਰ ਤਿੰਨ ਬਾਈਟ ਵਰਤਦਾ ਹੈ, ਇਸ ਲਈ ਇਹ ਤਿੰਨ %XX ਸਮੂਹ ਬਣਾਉਂਦਾ ਹੈ। ਅਰਬੀ ਅੱਖਰ ਦੋ ਬਾਈਟ ਵਰਤਦਾ ਹੈ, ਇਸ ਲਈ ਇਹ ਦੋ ਸਮੂਹ ਬਣਾਉਂਦਾ ਹੈ।
ਇਹ ਟੂਲ ਟੈਕਸਟ ਨੂੰ ਐਨਕੋਡ ਕਰਨ ਤੋਂ ਕਦੋਂ ਇਨਕਾਰ ਕਰਦਾ ਹੈ? ਸਿਰਫ਼ ਉਦੋਂ, ਜਦੋਂ ਟੈਕਸਟ ਵਿੱਚ ਸਰੋਗੇਟ ਜੋੜੇ ਦਾ ਅੱਧਾ ਹਿੱਸਾ ਹੋਵੇ। ਸਰੋਗੇਟ ਜੋੜਾ ਉਹ ਦੋ-ਭਾਗੀ ਕੋਡ ਹੈ ਜੋ U+FFFF ਤੋਂ ਉੱਪਰਲੇ ਅੱਖਰ, ਜਿਵੇਂ ਇਮੋਜੀ, ਨੂੰ ਸੰਭਾਲਦਾ ਹੈ। ਇਕੱਲੇ ਅੱਧੇ ਦਾ ਕੋਈ ਵੈਧ UTF-8 ਰੂਪ ਨਹੀਂ ਹੁੰਦਾ, ਇਸ ਲਈ ਟੂਲ ਨਤੀਜੇ ਦੀ ਥਾਂ ਗਲਤੀ ਦਿਖਾਉਂਦਾ ਹੈ। ਆਮ ਟਾਈਪਿੰਗ ਨਾਲ ਅਜਿਹਾ ਨਹੀਂ ਹੁੰਦਾ; ਇਹ ਆਮ ਤੌਰ ’ਤੇ ਅਧੂਰੀ ਕਾਪੀ ਜਾਂ ਖ਼ਰਾਬ ਲਿੰਕ ਤੋਂ ਆਉਂਦਾ ਹੈ।
ਕੀ ਮੈਨੂੰ ਪੂਰਾ URL ਐਨਕੋਡ ਕਰਨਾ ਚਾਹੀਦਾ ਹੈ ਜਾਂ ਸਿਰਫ਼ ਇਸਦਾ ਕੋਈ ਹਿੱਸਾ?
ਸਿਰਫ਼ ਉਹ ਹਿੱਸੇ ਐਨਕੋਡ ਕਰੋ ਜਿਨ੍ਹਾਂ ਵਿੱਚ ਉਪਭੋਗਤਾ ਡੇਟਾ ਹੁੰਦਾ ਹੈ, ਜਿਵੇਂ ਕਵੈਰੀ ਮੁੱਲ ਜਾਂ ਪਾਥ ਖੰਡ; URL ਦੀ ਬਣਤਰ ਬਣਾਉਣ ਵਾਲੇ ਹਿੱਸੇ, ਜਿਵੇਂ https:// ਅਤੇ ਡੋਮੇਨ ਨਾਮ, ਨਹੀਂ। ਕੰਪੋਨੈਂਟ ਐਨਕੋਡਰ ਨਾਲ ਪੂਰੇ URL ਨੂੰ ਐਨਕੋਡ ਕਰਨ ’ਤੇ ਇਸਦੇ :, / ਅਤੇ ? ਅੱਖਰ ਵੀ ਪ੍ਰਤੀਸ਼ਤ ਕੋਡਾਂ ਵਿੱਚ ਬਦਲ ਜਾਣਗੇ ਅਤੇ ਪਤਾ ਖ਼ਰਾਬ ਹੋ ਜਾਵੇਗਾ।