Codificación de texto UTF-8 con BOM

Antes de que Unicode se convirtiera en un estándar, los archivos de texto y los datos de tipo cadena se codificaban en diferentes páginas de códigos basadas en 8 bits, distintas en Alemania, España, Italia, Suecia, etc. Hoy en día, UTF-8 es el estándar más utilizado para enviar texto en comunicaciones de red y guardar datos de texto en archivos.

Los archivos de texto codificados en UTF-8 tienen un prefijo que define que el archivo está codificado en UTF-8. Se llama BOM (marca de orden de bytes). Usa el framework .Net para determinar la secuencia del BOM de UTF-8.

Ejemplos

GetUTF8BOM() ➞ { 0xef, 0xbb, 0xbf } (byte array)

Notas

Usa la clase UTF8Encoding en el espacio de nombres System.Text.