Encoding クラス
定義
重要
一部の情報は、リリース前に大きく変更される可能性があるプレリリースされた製品に関するものです。 Microsoft は、ここに記載されている情報について、明示または黙示を問わず、一切保証しません。
文字エンコーディングを表します。
public ref class Encoding abstract
public ref class Encoding abstract : ICloneable
public abstract class Encoding
public abstract class Encoding : ICloneable
[System.Serializable]
public abstract class Encoding
[System.Serializable]
[System.Runtime.InteropServices.ComVisible(true)]
public abstract class Encoding : ICloneable
type Encoding = class
type Encoding = class
interface ICloneable
[<System.Serializable>]
type Encoding = class
[<System.Serializable>]
[<System.Runtime.InteropServices.ComVisible(true)>]
type Encoding = class
interface ICloneable
Public MustInherit Class Encoding
Public MustInherit Class Encoding
Implements ICloneable
- 継承
-
Encoding
- 派生
- 属性
- 実装
例
次の例では、あるエンコードから別のエンコーディングに文字列を変換します。
Note
byte[]
この例では、エンコードされたデータを格納する型は配列だけです。 .NET Char
と String
型はそれ自体が unicode であるため、この呼び出しによって GetChars データが unicode にデコードされます。
using namespace System;
using namespace System::Text;
int main()
{
String^ unicodeString = "This string contains the unicode character Pi (\u03a0)";
// Create two different encodings.
Encoding^ ascii = Encoding::ASCII;
Encoding^ unicode = Encoding::Unicode;
// Convert the string into a byte array.
array<Byte>^unicodeBytes = unicode->GetBytes( unicodeString );
// Perform the conversion from one encoding to the other.
array<Byte>^asciiBytes = Encoding::Convert( unicode, ascii, unicodeBytes );
// Convert the new Byte into[] a char and[] then into a string.
array<Char>^asciiChars = gcnew array<Char>(ascii->GetCharCount( asciiBytes, 0, asciiBytes->Length ));
ascii->GetChars( asciiBytes, 0, asciiBytes->Length, asciiChars, 0 );
String^ asciiString = gcnew String( asciiChars );
// Display the strings created before and after the conversion.
Console::WriteLine( "Original String*: {0}", unicodeString );
Console::WriteLine( "Ascii converted String*: {0}", asciiString );
}
// The example displays the following output:
// Original string: This string contains the unicode character Pi (Π)
// Ascii converted string: This string contains the unicode character Pi (?)
using System;
using System.Text;
class Example
{
static void Main()
{
string unicodeString = "This string contains the unicode character Pi (\u03a0)";
// Create two different encodings.
Encoding ascii = Encoding.ASCII;
Encoding unicode = Encoding.Unicode;
// Convert the string into a byte array.
byte[] unicodeBytes = unicode.GetBytes(unicodeString);
// Perform the conversion from one encoding to the other.
byte[] asciiBytes = Encoding.Convert(unicode, ascii, unicodeBytes);
// Convert the new byte[] into a char[] and then into a string.
char[] asciiChars = new char[ascii.GetCharCount(asciiBytes, 0, asciiBytes.Length)];
ascii.GetChars(asciiBytes, 0, asciiBytes.Length, asciiChars, 0);
string asciiString = new string(asciiChars);
// Display the strings created before and after the conversion.
Console.WriteLine("Original string: {0}", unicodeString);
Console.WriteLine("Ascii converted string: {0}", asciiString);
}
}
// The example displays the following output:
// Original string: This string contains the unicode character Pi (Π)
// Ascii converted string: This string contains the unicode character Pi (?)
Imports System.Text
Class Example
Shared Sub Main()
Dim unicodeString As String = "This string contains the unicode character Pi (" & ChrW(&H03A0) & ")"
' Create two different encodings.
Dim ascii As Encoding = Encoding.ASCII
Dim unicode As Encoding = Encoding.Unicode
' Convert the string into a byte array.
Dim unicodeBytes As Byte() = unicode.GetBytes(unicodeString)
' Perform the conversion from one encoding to the other.
Dim asciiBytes As Byte() = Encoding.Convert(unicode, ascii, unicodeBytes)
' Convert the new byte array into a char array and then into a string.
Dim asciiChars(ascii.GetCharCount(asciiBytes, 0, asciiBytes.Length)-1) As Char
ascii.GetChars(asciiBytes, 0, asciiBytes.Length, asciiChars, 0)
Dim asciiString As New String(asciiChars)
' Display the strings created before and after the conversion.
Console.WriteLine("Original string: {0}", unicodeString)
Console.WriteLine("Ascii converted string: {0}", asciiString)
End Sub
End Class
' The example displays the following output:
' Original string: This string contains the unicode character Pi (Π)
' Ascii converted string: This string contains the unicode character Pi (?)
注釈
エンコーディングは、Unicode 文字のセットをバイト シーケンスに変換するプロセスです。 これに対して、デコードは、エンコードされたバイトシーケンスを Unicode 文字のセットに変換するプロセスです。 Unicode 変換形式 (UTFs) とでサポートされるその他のエンコーディングの詳細については Encoding 、「 .net での文字エンコード」を参照してください。
Encodingは、バイト配列など、任意のバイナリデータではなく Unicode 文字を操作することを目的としています。 任意のバイナリデータをテキストにエンコードする必要がある場合は、uuencode などのプロトコルを使用する必要があります。これは、などのメソッドによって実装され Convert.ToBase64CharArray ます。
.NET には、 Encoding 現在の Unicode エンコーディングとその他のエンコーディングをサポートするクラスの次の実装が用意されています。
ASCIIEncodingUnicode 文字を1つの7ビット ASCII 文字としてエンコードします。 このエンコーディングでは、U + 0000 と U + 007F の間の文字値のみがサポートされます。 コードページ20127。 プロパティからも使用でき ASCII ます。
UTF7EncodingUTF-8 エンコーディングを使用して Unicode 文字をエンコードします。 このエンコーディングでは、すべての Unicode 文字値がサポートされます。 コードページ65000。 プロパティからも使用でき UTF7 ます。
UTF8EncodingUTF-8 エンコーディングを使用して Unicode 文字をエンコードします。 このエンコーディングでは、すべての Unicode 文字値がサポートされます。 コードページ65001。 プロパティからも使用でき UTF8 ます。
UnicodeEncodingUTF-16 エンコーディングを使用して Unicode 文字をエンコードします。 リトルエンディアンとビッグエンディアンの両方のバイト順がサポートされています。 プロパティとプロパティを通じて使用することもでき UnicodeBigEndianUnicode ます。
UTF32Encoding32 UTF-8 エンコーディングを使用して Unicode 文字をエンコードします。 リトルエンディアン (コードページ 12000) とビッグエンディアン (コードページ 12001) バイトの順序の両方がサポートされています。 プロパティからも使用でき UTF32 ます。
クラスは、 Encoding 主に異なるエンコーディングと Unicode の間で変換を行うことを目的としています。 多くの場合、派生 Unicode クラスの1つは、アプリに適した選択肢です。
メソッドを使用し GetEncoding て他のエンコーディングを取得し、メソッドを呼び出して GetEncodings すべてのエンコーディングの一覧を取得します。
エンコーディングの一覧
次の表に、.NET でサポートされているエンコーディングの一覧を示します。 各エンコーディングのコードページ番号と、エンコードのプロパティとプロパティの値が一覧表示さ EncodingInfo.NameEncodingInfo.DisplayName れます。 .NET Framework サポート、.NET Core サポート、または .NET 5 以降のサポート列のチェック マークは、基になるプラットフォームに関係なく、その .NET 実装によってコード ページがネイティブにサポートされていることを示します。 .NET Framework の場合、表に記載されている他のエンコーディングが使用できるかどうかは、オペレーティングシステムによって異なります。 .NET Core および .NET 5 以降のバージョンでは、 クラスを使用 System.Text.CodePagesEncodingProvider するか、 クラスから派生することによって、他のエンコーディングを System.Text.EncodingProvider 使用できます。
Note
EncodingInfo.Name国際標準に対応するプロパティを持つコードページは、必ずしもその標準に準拠しているとは限りません。
コード ページ | 名前 | 表示名 | .NET Framework サポート | .NET Core サポート | .NET 5 以降のサポート | |
---|---|---|---|---|---|---|
37 | IBM037 | IBM EBCDIC (米国-カナダ) | ||||
437 | IBM437 | OEM 米国 | ||||
500 | IBM500 | IBM EBCDIC (インターナショナル) | ||||
708 | ASMO-708 | アラビア語 (ASMO 708) | ||||
720 | DOS-720 | アラビア語 (DOS) | ||||
737 | ibm737 | ギリシャ語 (DOS) | ||||
775 | ibm775 | バルト語 (DOS) | ||||
850 | ibm850 | 西ヨーロッパ言語 (DOS) | ||||
852 | ibm852 | 中央ヨーロッパ言語 (DOS) | ||||
855 | IBM855 | OEM キリル文字 | ||||
857 | ibm857 | トルコ語 (DOS) | ||||
858 | IBM00858 | OEM 多言語ラテン I | ||||
860 | IBM860 | ポルトガル語 (DOS) | ||||
861 | ibm861 | アイスランド語 (DOS) | ||||
862 | DOS-862 | ヘブライ語 (DOS) | ||||
863 | IBM863 | フランス語 (カナダ) (DOS) | ||||
864 | IBM864 | アラビア語 (864) | ||||
865 | IBM865 | 北欧 (DOS) | ||||
866 | cp866 | キリル語 (DOS) | ||||
869 | ibm869 | ギリシャ語、モダン (DOS) | ||||
870 | IBM870 | IBM EBCDIC (多言語ラテン-2) | ||||
874 | windows-874 | タイ語 (Windows) | ||||
875 | cp875 | IBM EBCDIC (ギリシャ語モダン) | ||||
932 | shift_jis | 日本語 (Shift-JIS) | ||||
936 | gb2312 | 簡体字中国語 (GB2312) | ✓ | |||
949 | ks_c_5601-1987 | 韓国語 | ||||
950 | big5 | 繁体字中国語 (Big5) | ||||
1026 | IBM1026 | IBM EBCDIC (トルコ語ラテン-5) | ||||
1047 | IBM01047 | IBM ラテン-1 | ||||
1140 | IBM01140 | IBM EBCDIC (米国-カナダ-ヨーロッパ) | ||||
1141 | IBM01141 | IBM EBCDIC (ドイツ-ヨーロッパ) | ||||
1142 | IBM01142 | IBM EBCDIC (デンマーク-ノルウェー-ヨーロッパ) | ||||
1143 | IBM01143 | IBM EBCDIC (フィンランド-スウェーデン-ヨーロッパ) | ||||
1144 | IBM01144 | IBM EBCDIC (イタリア-ヨーロッパ) | ||||
1145 | IBM01145 | IBM EBCDIC (スペイン-ヨーロッパ) | ||||
1146 | IBM01146 | IBM EBCDIC (UK-ヨーロッパ) | ||||
1147 | IBM01147 | IBM EBCDIC (フランス-ヨーロッパ) | ||||
1148 | IBM01148 | IBM EBCDIC (国際対応-ヨーロッパ) | ||||
1149 | IBM01149 | IBM EBCDIC (アイスランド語-ヨーロッパ) | ||||
1200 | utf-16 | Unicode | ✓ | ✓ | ✓ | |
1201 | unicodeFFFE | Unicode (ビッグエンディアン) | ✓ | ✓ | ✓ | |
1250 | windows-1250 | 中央ヨーロッパ言語 (Windows) | ||||
1251 | windows-1251 | キリル語 (Windows) | ||||
1252 | utf-8 | 西ヨーロッパ言語 (Windows) | ✓ | |||
1253 | windows-1253 | ギリシャ語 (Windows) | ||||
1254 | windows-1254 | トルコ語 (Windows) | ||||
1255 | windows-1255 | ヘブライ語 (Windows) | ||||
1256 | windows-1256 | アラビア語 (Windows) | ||||
1257 | windows-1257 | バルト語 (Windows) | ||||
1258 | windows-1258 | ベトナム語 (Windows) | ||||
1361 | Johab | 韓国語 (Johab) | ||||
10000 | 版 | 西ヨーロッパ言語 (Mac) | ||||
10001 | x-mac-日本語 | 日本語 (Mac) | ||||
10002 | chinesetrad | 繁体字中国語 (Mac) | ||||
10003 | x-mac-韓国語 | 韓国語 (Mac) | ✓ | |||
10004 | x-mac-アラビア語 | アラビア語 (Mac) | ||||
10005 | x-mac-ヘブライ語 | ヘブライ語 (Mac) | ||||
10006 | x-mac-ギリシャ語 | ギリシャ語 (Mac) | ||||
10007 | x-mac-キリル文字 | キリル語 (Mac) | ||||
10008 | chinesesimp | 簡体字中国語 (Mac) | ✓ | |||
10010 | x-mac-ルーマニア語 | ルーマニア語 (Mac) | ||||
10017 | x-mac-ウクライナ語 | ウクライナ語 (Mac) | ||||
10021 | x-mac-タイ語 | タイ語 (Mac) | ||||
10029 | x-mac-ce | 中央ヨーロッパ言語 (Mac) | ||||
10079 | x-mac-アイスランド語 | アイスランド語 (Mac) | ||||
10081 | x-mac-トルコ語 | トルコ語 (Mac) | ||||
10082 | x-mac-クロアチア語 | クロアチア語 (Mac) | ||||
12000 | utf-8-32 | Unicode (UTF-32) | ✓ | ✓ | ✓ | |
12001 | utf-32 | Unicode (UTF-32 ビッグエンディアン) | ✓ | ✓ | ✓ | |
20000 | x-中国語-CN | 繁体字中国語 (CNS) | ||||
20001 | x-cp20001 | TCA 台湾 | ||||
20002 | x-Eten | 繁体字中国語 (Eten) | ||||
20003 | x-cp20003 | IBM5550 台湾 | ||||
20004 | x-cp20004 | 文字放送 (台湾) | ||||
20005 | x-cp20005 | Wang 台湾 | ||||
20105 | x-IA5 | 西ヨーロッパ言語 (IA5) | ||||
20106 | x-IA5-ドイツ語 | ドイツ語 (IA5) | ||||
20107 | x-IA5-スウェーデン語 | スウェーデン語 (IA5) | ||||
20108 | x-IA5-ノルウェー語 | ノルウェー語 (IA5) | ||||
20127 | us-ascii | US-ASCII | ✓ | ✓ | ✓ | |
20261 | x-cp20261 | T. 61 | ||||
20269 | x-cp20269 | ISO-6937 | ||||
20273 | IBM273 | IBM EBCDIC (ドイツ) | ||||
20277 | IBM277 | IBM EBCDIC (デンマーク-ノルウェー) | ||||
20278 | IBM278 | IBM EBCDIC (フィンランド-スウェーデン) | ||||
20280 | IBM280 | IBM EBCDIC (イタリア) | ||||
20284 | IBM284 | IBM EBCDIC (スペイン) | ||||
20285 | IBM285 | IBM EBCDIC (UK) | ||||
20290 | IBM290 | IBM EBCDIC (日本語カタカナ) | ||||
20297 | IBM297 | IBM EBCDIC (フランス) | ||||
20420 | IBM420 | IBM EBCDIC (アラビア語) | ||||
20423 | IBM423 | IBM EBCDIC (ギリシャ語) | ||||
20424 | IBM424 | IBM EBCDIC (ヘブライ語) | ||||
20833 | x-EBCDIC-KoreanExtended | IBM EBCDIC (韓国語拡張) | ||||
20838 | IBM-タイ語 | IBM EBCDIC (タイ語) | ||||
20866 | koi8-r | キリル語 (KOI8-R) | ||||
20871 | IBM871 | IBM EBCDIC (アイスランド語) | ||||
20880 | IBM880 | IBM EBCDIC (キリル文字ロシア語) | ||||
20905 | IBM905 | IBM EBCDIC (トルコ語) | ||||
20924 | IBM00924 | IBM ラテン-1 | ||||
20932 | EUC-JP | 日本語 (JIS 0208-1990 および 0212-1990) | ||||
20936 | x-cp20936 | 簡体字中国語 (GB2312-80) | ✓ | |||
20949 | x-cp20949 | 韓国 Korean-wansung-unicode | ✓ | |||
21025 | cp1025 | IBM EBCDIC (キリル語セルビア-ブルガリア) | ||||
21866 | koi8-u | キリル語 (KOI8-U) | ||||
28591 | iso-8859-1 | 西ヨーロッパ言語 (ISO) | ✓ | ✓ | ✓ | |
28592 | iso-8859-2 | 中央ヨーロッパ言語 (ISO) | ||||
28593 | iso-8859-3 | ラテン 3 (ISO) | ||||
28594 | iso-8859-4 | バルト語 (ISO) | ||||
28595 | iso-8859-5 | キリル語 (ISO) | ||||
28596 | iso-8859-6 | アラビア語 (ISO) | ||||
28597 | iso-8859-7 | ギリシャ語 (ISO) | ||||
28598 | iso-8859-8 | ヘブライ語 (ISO-Visual) | ✓ | |||
28599 | iso-8859-9 | トルコ語 (ISO) | ||||
28603 | iso-8859-13 | エストニア語 (ISO) | ||||
28605 | iso-8859-15 | ラテン 9 (ISO) | ||||
29001 | x-Europa | Europa | ||||
38598 | iso-8859-8-i | ヘブライ語 (ISO-論理) | ✓ | |||
50220 | iso-2022-jp | 日本語 (JIS) | ✓ | |||
50221 | csISO2022JP | 日本語 (JIS-1 バイトカタカナを許可) | ✓ | |||
50222 | iso-2022-jp | 日本語 (JIS-1 バイトカタカナを許可する-SO/SI) | ✓ | |||
50225 | iso-2022-韓国 | 韓国語 (ISO) | ✓ | |||
50227 | x-cp50227 | 簡体字中国語 (ISO-2022) | ✓ | |||
51932 | euc-jp | 日本語 (EUC) | ✓ | |||
51936 | EUC-CN | 簡体字中国語 (EUC) | ✓ | |||
51949 | euc-韓国 | 韓国語 (EUC) | ✓ | |||
52936 | hz-gb-2312 | 簡体字中国語 (HZ) | ✓ | |||
54936 | GB18030 | 簡体字中国語 (GB18030) | ✓ | |||
57002 | x-iscii-de | ISCII デバナガリ文字 | ✓ | |||
57003 | x-iscii-be | ISCII ベンガル語 | ✓ | |||
57004 | x-iscii-ta | ISCII タミール語 | ✓ | |||
57005 | x-iscii-te | ISCII テルグ語 | ✓ | |||
57006 | x-iscii-as | ISCII アッサム語 | ✓ | |||
57007 | x-iscii-または | ISCII オリヤー語 | ✓ | |||
57008 | x-iscii-ka | ISCII カンナダ語 | ✓ | |||
57009 | x-iscii-ma | ISCII マラヤーラム語 | ✓ | |||
57010 | x-iscii-gu | ISCII グジャラート語 | ✓ | |||
57011 | x-iscii-pa | ISCII パンジャブ語 | ✓ | |||
65000 | utf-7 | Unicode (UTF-7) | ✓ | ✓ | ||
65001 | utf-8 | Unicode (UTF-8) | ✓ | ✓ | ✓ |
次の例では、およびメソッドを呼び出して、 GetEncoding(Int32)GetEncoding(String) ギリシャ語 (Windows) のコードページエンコーディングを取得します。 Encodingメソッド呼び出しによって返されたオブジェクトを比較して、それらが等しいことを示します。その後、マップされたオブジェクトは、ギリシャ語アルファベットの各文字について、Unicode コードポイントとそれに対応するコードページ値を表示します。
using System;
using System.Text;
public class Example
{
public static void Main()
{
Encoding enc = Encoding.GetEncoding(1253);
Encoding altEnc = Encoding.GetEncoding("windows-1253");
Console.WriteLine("{0} = Code Page {1}: {2}", enc.EncodingName,
altEnc.CodePage, enc.Equals(altEnc));
string greekAlphabet = "Α α Β β Γ γ Δ δ Ε ε Ζ ζ Η η " +
"Θ θ Ι ι Κ κ Λ λ Μ μ Ν ν Ξ ξ " +
"Ο ο Π π Ρ ρ Σ σ ς Τ τ Υ υ " +
"Φ φ Χ χ Ψ ψ Ω ω";
Console.OutputEncoding = Encoding.UTF8;
byte[] bytes = enc.GetBytes(greekAlphabet);
Console.WriteLine("{0,-12} {1,20} {2,20:X2}", "Character",
"Unicode Code Point", "Code Page 1253");
for (int ctr = 0; ctr < bytes.Length; ctr++) {
if (greekAlphabet[ctr].Equals(' '))
continue;
Console.WriteLine("{0,-12} {1,20} {2,20:X2}", greekAlphabet[ctr],
GetCodePoint(greekAlphabet[ctr]), bytes[ctr]);
}
}
private static string GetCodePoint(char ch)
{
string retVal = "u+";
byte[] bytes = Encoding.Unicode.GetBytes(ch.ToString());
for (int ctr = bytes.Length - 1; ctr >= 0; ctr--)
retVal += bytes[ctr].ToString("X2");
return retVal;
}
}
// The example displays the following output:
// Character Unicode Code Point Code Page 1253
// Α u+0391 C1
// α u+03B1 E1
// Β u+0392 C2
// β u+03B2 E2
// Γ u+0393 C3
// γ u+03B3 E3
// Δ u+0394 C4
// δ u+03B4 E4
// Ε u+0395 C5
// ε u+03B5 E5
// Ζ u+0396 C6
// ζ u+03B6 E6
// Η u+0397 C7
// η u+03B7 E7
// Θ u+0398 C8
// θ u+03B8 E8
// Ι u+0399 C9
// ι u+03B9 E9
// Κ u+039A CA
// κ u+03BA EA
// Λ u+039B CB
// λ u+03BB EB
// Μ u+039C CC
// μ u+03BC EC
// Ν u+039D CD
// ν u+03BD ED
// Ξ u+039E CE
// ξ u+03BE EE
// Ο u+039F CF
// ο u+03BF EF
// Π u+03A0 D0
// π u+03C0 F0
// Ρ u+03A1 D1
// ρ u+03C1 F1
// Σ u+03A3 D3
// σ u+03C3 F3
// ς u+03C2 F2
// Τ u+03A4 D4
// τ u+03C4 F4
// Υ u+03A5 D5
// υ u+03C5 F5
// Φ u+03A6 D6
// φ u+03C6 F6
// Χ u+03A7 D7
// χ u+03C7 F7
// Ψ u+03A8 D8
// ψ u+03C8 F8
// Ω u+03A9 D9
// ω u+03C9 F9
Imports System.Text
Module Example
Public Sub Main()
Dim enc As Encoding = Encoding.GetEncoding(1253)
Dim altEnc As Encoding = Encoding.GetEncoding("windows-1253")
Console.WriteLine("{0} = Code Page {1}: {2}", enc.EncodingName,
altEnc.CodePage, enc.Equals(altEnc))
Dim greekAlphabet As String = "Α α Β β Γ γ Δ δ Ε ε Ζ ζ Η η " +
"Θ θ Ι ι Κ κ Λ λ Μ μ Ν ν Ξ ξ " +
"Ο ο Π π Ρ ρ Σ σ ς Τ τ Υ υ " +
"Φ φ Χ χ Ψ ψ Ω ω"
Console.OutputEncoding = Encoding.UTF8
Dim bytes() As Byte = enc.GetBytes(greekAlphabet)
Console.WriteLine("{0,-12} {1,20} {2,20:X2}", "Character",
"Unicode Code Point", "Code Page 1253")
For ctr As Integer = 0 To bytes.Length - 1
If greekAlphabet(ctr).Equals(" "c) Then Continue For
Console.WriteLine("{0,-12} {1,20} {2,20:X2}", greekAlphabet(ctr),
GetCodePoint(greekAlphabet(ctr)), bytes(ctr))
Next
End Sub
Private Function GetCodePoint(ch As String) As String
Dim retVal As String = "u+"
Dim bytes() As Byte = Encoding.Unicode.GetBytes(ch)
For ctr As Integer = bytes.Length - 1 To 0 Step -1
retVal += bytes(ctr).ToString("X2")
Next
Return retVal
End Function
End Module
' The example displays the following output:
' Character Unicode Code Point Code Page 1253
' Α u+0391 C1
' α u+03B1 E1
' Β u+0392 C2
' β u+03B2 E2
' Γ u+0393 C3
' γ u+03B3 E3
' Δ u+0394 C4
' δ u+03B4 E4
' Ε u+0395 C5
' ε u+03B5 E5
' Ζ u+0396 C6
' ζ u+03B6 E6
' Η u+0397 C7
' η u+03B7 E7
' Θ u+0398 C8
' θ u+03B8 E8
' Ι u+0399 C9
' ι u+03B9 E9
' Κ u+039A CA
' κ u+03BA EA
' Λ u+039B CB
' λ u+03BB EB
' Μ u+039C CC
' μ u+03BC EC
' Ν u+039D CD
' ν u+03BD ED
' Ξ u+039E CE
' ξ u+03BE EE
' Ο u+039F CF
' ο u+03BF EF
' Π u+03A0 D0
' π u+03C0 F0
' Ρ u+03A1 D1
' ρ u+03C1 F1
' Σ u+03A3 D3
' σ u+03C3 F3
' ς u+03C2 F2
' Τ u+03A4 D4
' τ u+03C4 F4
' Υ u+03A5 D5
' υ u+03C5 F5
' Φ u+03A6 D6
' φ u+03C6 F6
' Χ u+03A7 D7
' χ u+03C7 F7
' Ψ u+03A8 D8
' ψ u+03C8 F8
' Ω u+03A9 D9
' ω u+03C9 F9
変換するデータが、連続したブロック (ストリームから読み取られたデータなど) でのみ使用可能な場合、またはデータの量が大きく、小さいブロックに分割する必要がある場合は、 DecoderEncoderGetDecoder 派生クラスのメソッドまたはメソッドによって提供されるまたはを使用する必要があり GetEncoder ます。
UTF-16 および 32 UTF-8 エンコーダーでは、ビッグエンディアンバイト順 (最初に最上位バイト) またはリトルエンディアンバイト順 (最初に最下位バイト) を使用できます。 たとえば、ラテン文字の A (U + 0041 という) は、次のようにシリアル化されます (16 進数)。
UTF-16 ビッグエンディアンバイト順:00 41
UTF-16 リトルエンディアンバイト順:41 00
32 UTF-8 ビッグエンディアンバイト順:00 00 00 41
32 UTF-8 リトルエンディアンバイト順:41 00 00 00
一般に、ネイティブバイト順序を使用して Unicode 文字を格納する方が効率的です。 たとえば、Intel コンピューターなどのリトルエンディアンプラットフォームでは、リトルエンディアンのバイト順を使用することをお勧めします。
メソッドは、 GetPreamble バイトオーダーマーク (BOM) を含むバイト配列を取得します。 このバイト配列の先頭にエンコード済みストリームがある場合は、デコーダーが使用するエンコード形式を識別するのに役立ちます。
バイト順とバイト順マークの詳細については、unicodeホームページの unicode 標準を参照してください。
エンコーディングクラスでは、次のようなエラーが発生することに注意してください。
"?" 文字に自動的に変更されます。
"最適" の文字を使用します。
EncoderFallbackおよび DecoderFallback クラスを U + Fffd Unicode の置換文字と共に使用することで、アプリケーション固有の動作に変更します。
データストリームエラーが発生した場合は、例外をスローする必要があります。 アプリでは、必要に応じて "throwonerror" フラグを使用するか、 EncoderExceptionFallback クラスとクラスを使用 DecoderExceptionFallback します。 ベストフィットフォールバックは、データの損失や混乱を招く可能性があり、単純な文字交換よりも低速になる可能性があるため、推奨されません。 ANSI エンコーディングの場合、最適な動作は既定値です。
コンストラクター
Encoding() |
Encoding クラスの新しいインスタンスを初期化します。 |
Encoding(Int32) |
指定したコード ページに対応する Encoding クラスの新しいインスタンスを初期化します。 |
Encoding(Int32, EncoderFallback, DecoderFallback) |
指定したコード ページに対応する Encoding クラスの新しいインスタンスを、指定したエンコーダーとデコーダーのフォールバック方法を使用して初期化します。 |
プロパティ
ASCII |
ASCII (7 ビット) 文字セットのエンコーディングを取得します。 |
BigEndianUnicode |
ビッグ エンディアンのバイト順を使用する UTF-16 形式のエンコーディングを取得します。 |
BodyName |
派生クラスでオーバーライドされた場合、メール エージェントの Body タグと共に使用できる現在のエンコーディングの名前を取得します。 |
CodePage |
派生クラスでオーバーライドされた場合、現在の Encoding のコード ページ ID を取得します。 |
DecoderFallback |
現在の DecoderFallback オブジェクトの Encoding オブジェクトを取得または設定します。 |
Default |
この .NET 実装の既定のエンコードを取得します。 |
EncoderFallback |
現在の EncoderFallback オブジェクトの Encoding オブジェクトを取得または設定します。 |
EncodingName |
派生クラスでオーバーライドされた場合、現在のエンコーディングについての記述を、ユーザーが判読できる形式で取得します。 |
HeaderName |
派生クラスでオーバーライドされた場合、メール エージェント ヘッダー タグと共に使用できる現在のエンコーディングの名前を取得します。 |
IsBrowserDisplay |
派生クラスでオーバーライドされた場合、ブラウザー クライアントが現在のエンコーディングを使用してコンテンツを表示できるかどうかを示す値を取得します。 |
IsBrowserSave |
派生クラスでオーバーライドされた場合、ブラウザー クライアントが現在のエンコーディングを使用してコンテンツを保存できるかどうかを示す値を取得します。 |
IsMailNewsDisplay |
派生クラスでオーバーライドされた場合、メール クライアントおよびニュース クライアントが現在のエンコーディングを使用してコンテンツを表示できるかどうかを示す値を取得します。 |
IsMailNewsSave |
派生クラスでオーバーライドされた場合、メール クライアントおよびニュース クライアントが現在のエンコーディングを使用してコンテンツを保存できるかどうかを示す値を取得します。 |
IsReadOnly |
派生クラスでオーバーライドされた場合、現在のエンコーディングが読み取り専用かどうかを示す値を取得します。 |
IsSingleByte |
派生クラスでオーバーライドされた場合、現在のエンコーディングが 1 バイトのコード ポイントを使用するかどうかを示す値を取得します。 |
Latin1 |
Latin1 文字セット (ISO-8859-1) のエンコードを取得します。 |
Preamble |
派生クラスでオーバーライドされた場合、使用するエンコードを指定するバイト シーケンスを含むスパンが返されます。 |
Unicode |
リトル エンディアン バイト順を使用する UTF-16 形式のエンコーディングを取得します。 |
UTF32 |
リトル エンディアン バイト順を使用する UTF-32 形式のエンコーディングを取得します。 |
UTF7 |
互換性のために残されています。
UTF-7 形式のエンコーディングを取得します。 |
UTF8 |
UTF-8 形式のエンコーディングを取得します。 |
WebName |
派生クラスでオーバーライドされた場合、現在のエンコーディングの IANA (Internet Assigned Numbers Authority) に登録されている名前を取得します。 |
WindowsCodePage |
派生クラスでオーバーライドされた場合、現在のエンコーディングに最も厳密に対応する Windows オペレーティング システムのコード ページを取得します。 |
メソッド
Clone() |
派生クラスでオーバーライドされた場合、現在の Encoding オブジェクトの簡易コピーを作成します。 |
Convert(Encoding, Encoding, Byte[]) |
バイト配列全体を、あるエンコーディングから別のエンコーディングに変換します。 |
Convert(Encoding, Encoding, Byte[], Int32, Int32) |
バイト配列内のバイトの範囲を、あるエンコーディングから別のエンコーディングに変換します。 |
CreateTranscodingStream(Stream, Encoding, Encoding, Boolean) |
Convert(Encoding, Encoding, Byte[]) と同様に、内部 Encoding と外部 Encoding の間でのデータのトランスコードを提供する Stream を作成します。 |
Equals(Object) |
指定した Object が、現在のインスタンスと等しいかどうかを判断します。 |
GetByteCount(Char*, Int32) |
派生クラスでオーバーライドされた場合、指定した文字ポインターから始まる文字のセットをエンコードすることによって生成されるバイト数を計算します。 |
GetByteCount(Char[]) |
派生クラスでオーバーライドされた場合、指定した文字配列に格納されているすべての文字をエンコードすることによって生成されるバイト数を計算します。 |
GetByteCount(Char[], Int32, Int32) |
派生クラスでオーバーライドされた場合、指定した文字配列に格納されている文字のセットをエンコードすることによって生成されるバイト数を計算します。 |
GetByteCount(ReadOnlySpan<Char>) |
派生クラスでオーバーライドされた場合、指定した文字スパンに格納されている文字をエンコードすることによって生成されるバイト数を計算します。 |
GetByteCount(String) |
派生クラスでオーバーライドされた場合、指定した文字列に含まれる文字をエンコードすることによって生成されるバイト数を計算します。 |
GetByteCount(String, Int32, Int32) |
派生クラスでオーバーライドされた場合、指定した文字列の文字のセットをエンコードすることによって生成されるバイト数を計算します。 |
GetBytes(Char*, Int32, Byte*, Int32) |
派生クラスでオーバーライドされた場合、指定した文字ポインターで始まる文字のセットを、指定したバイト ポインターを開始位置として格納されるバイト シーケンスにエンコードします。 |
GetBytes(Char[]) |
派生クラスでオーバーライドされた場合、指定した文字配列に格納されているすべての文字をバイト シーケンスにエンコードします。 |
GetBytes(Char[], Int32, Int32) |
派生クラスでオーバーライドされた場合、指定した文字配列に格納されている文字のセットをバイト シーケンスにエンコードします。 |
GetBytes(Char[], Int32, Int32, Byte[], Int32) |
派生クラスでオーバーライドされた場合、指定した文字配列に格納されている文字のセットを、指定したバイト配列にエンコードします。 |
GetBytes(ReadOnlySpan<Char>, Span<Byte>) |
派生クラスでオーバーライドされた場合、指定した読み取り専用スパンに格納されている文字のセットをバイトのスパンにエンコードします。 |
GetBytes(String) |
派生クラスでオーバーライドされた場合、指定した文字列に含まれるすべての文字をバイト シーケンスにエンコードします。 |
GetBytes(String, Int32, Int32) |
派生クラスでオーバーライドされた場合、指定した文字列内の |
GetBytes(String, Int32, Int32, Byte[], Int32) |
派生クラスでオーバーライドされた場合、指定した文字列に含まれる文字のセットを、指定したバイト配列にエンコードします。 |
GetCharCount(Byte*, Int32) |
派生クラスでオーバーライドされた場合、指定したバイト ポインターから始まるバイト シーケンスをデコードすることによって生成される文字数を計算します。 |
GetCharCount(Byte[]) |
派生クラスでオーバーライドされた場合、指定したバイト配列に格納されているすべてのバイトをデコードすることによって生成される文字数を計算します。 |
GetCharCount(Byte[], Int32, Int32) |
派生クラスでオーバーライドされた場合、指定したバイト配列に格納されているバイト シーケンスをデコードすることによって生成される文字数を計算します。 |
GetCharCount(ReadOnlySpan<Byte>) |
派生クラスでオーバーライドされた場合、指定した読み取り専用バイト スパンをデコードすることによって生成される文字数を計算します。 |
GetChars(Byte*, Int32, Char*, Int32) |
派生クラスでオーバーライドされた場合、指定したバイト ポインターで始まるバイト シーケンスを、指定した文字ポインターを開始位置として格納される文字のセットにデコードします。 |
GetChars(Byte[]) |
派生クラスでオーバーライドされた場合、指定したバイト配列に格納されているすべてのバイトを文字のセットにデコードします。 |
GetChars(Byte[], Int32, Int32) |
派生クラスでオーバーライドされた場合、指定したバイト配列に格納されているバイト シーケンスを文字のセットにデコードします。 |
GetChars(Byte[], Int32, Int32, Char[], Int32) |
派生クラスでオーバーライドされた場合、指定したバイト配列に格納されているバイト シーケンスを、指定した文字配列にデコードします。 |
GetChars(ReadOnlySpan<Byte>, Span<Char>) |
派生クラスでオーバーライドされた場合、指定した読み取り専用バイト スパンに格納されているすべてのバイトを、文字スパンにデコードします。 |
GetDecoder() |
派生クラスでオーバーライドされた場合、エンコード済みバイト シーケンスを文字シーケンスに変換するデコーダーを取得します。 |
GetEncoder() |
派生クラスでオーバーライドされた場合、Unicode 文字のシーケンスをエンコード済みバイト シーケンスに変換するエンコーダーを取得します。 |
GetEncoding(Int32) |
指定したコード ページ ID に関連付けられたエンコーディングを返します。 |
GetEncoding(Int32, EncoderFallback, DecoderFallback) |
指定したコード ページ ID に関連付けられたエンコーディングを返します。 パラメーターには、エンコードできない文字とデコードできないバイト シーケンスのためのエラー ハンドラーを指定します。 |
GetEncoding(String) |
指定したコード ページ名に関連付けられたエンコーディングを返します。 |
GetEncoding(String, EncoderFallback, DecoderFallback) |
指定したコード ページ名に関連付けられたエンコーディングを返します。 パラメーターには、エンコードできない文字とデコードできないバイト シーケンスのためのエラー ハンドラーを指定します。 |
GetEncodings() |
すべてのエンコーディングを格納した配列を返します。 |
GetHashCode() |
現在のインスタンスのハッシュ コードを返します。 |
GetMaxByteCount(Int32) |
派生クラスでオーバーライドされた場合、指定した文字数をエンコードすることによって生成される最大バイト数を計算します。 |
GetMaxCharCount(Int32) |
派生クラスでオーバーライドされた場合、指定したバイト数をデコードすることによって生成される最大文字数を計算します。 |
GetPreamble() |
派生クラスでオーバーライドされた場合、使用するエンコーディングを指定するバイト シーケンスを返します。 |
GetString(Byte*, Int32) |
派生クラスでオーバーライドされた場合、指定したアドレスで始まる指定したバイト数を文字列にデコードします。 |
GetString(Byte[]) |
派生クラスでオーバーライドされた場合、指定したバイト配列に格納されているすべてのバイトを文字列にデコードします。 |
GetString(Byte[], Int32, Int32) |
派生クラスでオーバーライドされた場合、指定したバイト配列に格納されているバイト シーケンスを文字列にデコードします。 |
GetString(ReadOnlySpan<Byte>) |
派生クラスでオーバーライドされた場合、指定したバイト スパンに格納されているすべてのバイトを文字列にデコードします。 |
GetType() |
現在のインスタンスの Type を取得します。 (継承元 Object) |
IsAlwaysNormalized() |
現在のエンコーディングが、既定の正規形を使用して常に正規化されるかどうかを示す値。 |
IsAlwaysNormalized(NormalizationForm) |
派生クラスでオーバーライドされた場合、現在のエンコーディングが、指定した正規形を使用して常に正規化されるかどうかを示す値を取得します。 |
MemberwiseClone() |
現在の Object の簡易コピーを作成します。 (継承元 Object) |
RegisterProvider(EncodingProvider) |
エンコーディング プロバイダーを登録します。 |
ToString() |
現在のオブジェクトを表す文字列を返します。 (継承元 Object) |