В программе на C я использую wprintf для печати текста Unicode (UTF-16) в консоли Windows. Это прекрасно работает, но когда выход программы перенаправляется в файл журнала, файл журнала имеет поврежденную кодировку UTF-16. Когда перенаправление выполняется в командной строке Windows, все разрывы строк кодируются как узкий разрыв строки ASCII (0d0a). Когда перенаправление выполняется в PowerShell, вставляются нулевые символы.
Можно ли перенаправить вывод в соответствующий файл журнала UTF-16?
Пример программы:
#include <stdio.h>
#include <windows.h>
#include <fcntl.h>
#include <io.h>
int main () {
int prevmode;
prevmode = _setmode(_fileno(stdout), _O_U16TEXT);
fwprintf(stdout,L"one\n");
fwprintf(stdout,L"two\n");
fwprintf(stdout,L"three\n");
_setmode(_fileno(stdout), prevmode);
return 0;
}
Перенаправление вывода в командной строке. См. 0d0a, который должен быть 0d00 0a00:
c:\test>.\testu16.exe > o.txt
c:\test>xxd o.txt
0000000: 6f00 6e00 6500 0d0a 0074 0077 006f 000d o.n.e....t.w.o..
0000010: 0a00 7400 6800 7200 6500 6500 0d0a 00 ..t.h.r.e.e....
Перенаправление вывода в PowerShell. См. Все вставленные 0000.
PS C:\test> .\testu16.exe > p.txt
PS C:\test> xxd p.txt
0000000: fffe 6f00 0000 6e00 0000 6500 0000 0d00 ..o...n...e.....
0000010: 0a00 0000 7400 0000 7700 0000 6f00 0000 ....t...w...o...
0000020: 0d00 0a00 0000 7400 0000 6800 0000 7200 ......t...h...r.
0000030: 0000 6500 0000 6500 0000 0d00 0a00 0000 ..e...e.........
0000040: 0d00 0a00 ....