класс Encoding::InvalidByteSequenceError
Вызывается методами Encoding и String, когда строка, подлежащая транскодированию, содержит байт, недопустимый для исходного или целевого кодирования.
Публичные методы экземпляра
static VALUE
ecerr_destination_encoding(VALUE self)
{
return rb_attr_get(self, id_destination_encoding);
} Возвращает целевое кодирование в виде объекта кодирования.
static VALUE
ecerr_destination_encoding_name(VALUE self)
{
return rb_attr_get(self, id_destination_encoding_name);
} Возвращает имя целевого кодирования в виде строки.
static VALUE
ecerr_error_bytes(VALUE self)
{
return rb_attr_get(self, id_error_bytes);
} Возвращает отброшенные байты при возникновении ошибки Encoding::InvalidByteSequenceError.
ec = Encoding::Converter.new("EUC-JP", "ISO-8859-1")
begin
ec.convert("abc\xA1\xFFdef")
rescue Encoding::InvalidByteSequenceError
p $! #=> #<Encoding::InvalidByteSequenceError: "\xA1" followed by "\xFF" on EUC-JP>
puts $!.error_bytes.dump #=> "\xA1"
puts $!.readagain_bytes.dump #=> "\xFF"
end
static VALUE
ecerr_incomplete_input(VALUE self)
{
return rb_attr_get(self, id_incomplete_input);
} Возвращает true, если ошибка неполной последовательности байтов вызвана преждевременным окончанием строки.
ec = Encoding::Converter.new("EUC-JP", "ISO-8859-1")
begin
ec.convert("abc\xA1z")
rescue Encoding::InvalidByteSequenceError
p $! #=> #<Encoding::InvalidByteSequenceError: "\xA1" followed by "z" on EUC-JP>
p $!.incomplete_input? #=> false
end
begin
ec.convert("abc\xA1")
ec.finish
rescue Encoding::InvalidByteSequenceError
p $! #=> #<Encoding::InvalidByteSequenceError: incomplete "\xA1" on EUC-JP>
p $!.incomplete_input? #=> true
end
static VALUE
ecerr_readagain_bytes(VALUE self)
{
return rb_attr_get(self, id_readagain_bytes);
} Возвращает байты, которые нужно считать повторно, при возникновении ошибки Encoding::InvalidByteSequenceError.
static VALUE
ecerr_source_encoding(VALUE self)
{
return rb_attr_get(self, id_source_encoding);
} Возвращает исходное кодирование в виде объекта кодирования.
Обратите внимание, что результат может не совпадать с исходным кодированием преобразователя кодирования, если преобразование имеет несколько шагов.
ec = Encoding::Converter.new("ISO-8859-1", "EUC-JP") # ISO-8859-1 -> UTF-8 -> EUC-JP
begin
ec.convert("\xa0") # NO-BREAK SPACE, which is available in UTF-8 but not in EUC-JP.
rescue Encoding::UndefinedConversionError
p $!.source_encoding #=> #<Encoding:UTF-8>
p $!.destination_encoding #=> #<Encoding:EUC-JP>
p $!.source_encoding_name #=> "UTF-8"
p $!.destination_encoding_name #=> "EUC-JP"
end
static VALUE
ecerr_source_encoding_name(VALUE self)
{
return rb_attr_get(self, id_source_encoding_name);
} Возвращает имя исходного кодирования в виде строки.
Ruby Core © 1993–2022 Yukihiro Matsumoto
Licensed under the Ruby License.
Ruby Standard Library © contributors
Licensed under their own licenses.