先看下面兩個Url,他們傳遞的參數一樣嗎??
aaa.aspx?tag=.net%bc%bc%ca%f5
aaa.aspx?tag=.net%e6%8a%80%e6%9c%af
看起來好像是不一樣,其實他們都是對".net技術"進行了UrlEncode,不過一個是GB2312的編碼,一個是Utf-8的編碼。
如下代碼就可以獲得上面的編碼後效果:
string tmp1 = System.Web.HttpUtility.UrlEncode(".net技術", System.Text.Encoding.GetEncoding("GB2312"));
string tmp2 = System.Web.HttpUtility.UrlEncode(".net技術", System.Text.Encoding.UTF8);
我們實際的Web頁面,可能會被其他程式調用。
比如:簡體中文作業系統上的一個ASP頁面,需要向一個ASP.net頁面傳遞一個帶中文的參數。
預設情況下,簡體中文作業系統上, ASP 的 Server.UrlEncode 方法會把中文以GB2312的編碼進行編碼,
但是預設情況下,ASP.net的頁面是採用的UTF-8編碼。
這種情況下,你在用 Request.QueryString["Tag"] 接受值的時候會接受不到中文資訊,單步調試看到的是亂碼。
這時候雖然用Request.QueryString["Tag"] 接受的是亂碼,但這時候的Url並不是亂碼。
解決方案就是自己分析Url中的參數,然後對參數的值按照 GB2312的編碼反解密,而不是用.net 預設的Utf-8的編碼反解密。
其實微軟類似的提供了相應的函數,我們不必自己用Regex去分析url字串了。
示範代碼如下:
string q = Request.Url.Query;
System.Collections.Specialized.NameValueCollection nv =
System.Web.HttpUtility.ParseQueryString(q, System.Text.Encoding.GetEncoding("GB2312"));
Response.Write(nv["Tag"]);
我們用 Lutz Roeder's .NET Reflector 來看 System.Web.HttpUtility.ParseQueryString 方法的實現:
一直反查進去,我們可以看到最終處理Url參數字串分析的代碼如下:
System.Web.HttpValueCollection 類的如下函數實現了對Url參數的解析
這裡我們看到,它是自己一個個字元進行的分析。
internal void FillFromString(string s, bool urlencoded, Encoding encoding)
{
int num1 = (s != null) ? s.Length : 0;
for (int num2 = 0; num2 < num1; num2++)
{
int num3 = num2;
int num4 = -1;
while (num2 < num1)
{
switch (s[num2])
{
case '=':
if (num4 < 0)
{
num4 = num2;
}
break;
}
num2++;
}
string text1 = null;
string text2 = null;
if (num4 >= 0)
{
text1 = s.Substring(num3, num4 - num3);
text2 = s.Substring(num4 + 1, (num2 - num4) - 1);
}
else
{
text2 = s.Substring(num3, num2 - num3);
}
if (urlencoded)
{
base.Add(HttpUtility.UrlDecode(text1, encoding), HttpUtility.UrlDecode(text2, encoding));
}
else
{
base.Add(text1, text2);
}
if ((num2 == (num1 - 1)) && (s[num2] == '&'))
{
base.Add(null, string.Empty);
}
}
}
至於對方傳遞給自己的是哪種編碼方式,最好也一併作為參數傳遞過來,這樣我們就可以根據使用者的這個參數進行解密操作。
http://blog.joycode.com/ghj/archive/2006/04/19/74894.aspx