zoukankan      html  css  js  c++  java
  • 编码出错的问题

    #!/bin/sh
    
    
    rm bbb
    touch bbb
    cat aaa | while read line
    do
      echo $line | iconv -f utf8 -t gb2312 >> bbb
    done

    linux下关于编码有两个相关命令,一个是file,用于检测文件编码格式。一个是iconv命令用于将文件在两种编码格式之间转换。但是,经常会出现一个问题,就是不管怎么转,有的时候就是会报告转换失败,我一直在想这是怎么回事?一种可以说通的解释是文件的一部分已经损坏掉,所以无法进行整体转换,那么我产生一个想法,既然是部分损坏,那么我可以部分读出,部分转换,失败掉的地方就失败掉好了,我可以把大多数完整的行给转换出来。

    之后发现上面脚本的一个BUG:我期望的是当脚本转换编码错误时,出错的一行被整个放弃,但是脚本还是将出错那一行能够编码的字符串写入文件,这样的数据会破坏文件

    #!/bin/sh
    
    
    rm bbb
    touch bbb
    cat aaa | while read line
    do
            aline=`echo $line | iconv -f utf8 -t gb2312 2>/dev/null`
            echo $aline | awk '{if(substr($0,length($0),1)==";")print $0 >> "'bbb'"}'
    done
  • 相关阅读:
    python
    图片放大,缩小等操作
    template-web.js 自定义过滤器
    python
    python
    Android Volley源码分析及扩展
    Android 6.0动态权限申请教程
    Jarsigner签名使用
    Python正则表达式(总)
    Python错误和异常概念(总)
  • 原文地址:https://www.cnblogs.com/code-style/p/3469362.html
Copyright © 2011-2022 走看看