Codificação de texto UTF-8 com BOM

Antes de o Unicode se tornar um padrão, arquivos de texto e dados de string eram codificados em diferentes páginas de código baseadas em 8 bits, cada uma diferente na Alemanha, Espanha, Itália, Suécia etc. Atualmente, UTF-8 é o padrão mais usado para enviar texto em comunicações de rede e salvar dados de texto em arquivos.

Arquivos de texto codificados em UTF-8 têm um prefixo que define que o arquivo está codificado em UTF-8. Ele é chamado de BOM (marca de ordem de bytes). Use o framework .Net para determinar a sequência do BOM UTF-8.

Exemplos

GetUTF8BOM() ➞ { 0xef, 0xbb, 0xbf } (byte array)

Observações

Use a classe UTF8Encoding no namespace System.Text.