zoukankan      html  css  js  c++  java
  • linux下GBK>UTF8文件编码批量转换脚本

    inux下GBK->UTF-8_fly123456789-ChinaUnix博客

        linux下GBK->UTF-8文件编码批量转换脚本

        find default -type d -exec mkdir -p utf/{} ;
        find default -type f -exec iconv -f GBK -t UTF-8 {} -o utf/{} ;
        这两行命令将default目录下的文件由GBK编码转换为UTF-8编码,目录结构不变,转码后的文件保存在utf/default目录下。


        linux C gbk utf 8编码转换
          // -->
        用linux C 下的函数调用创建中文目录、文件等,字符串的编码格式要求是utf-8格式的。
        比如想要使用 int mkdir(const char *pathname, mode_t mode); 创建一个中文的目录。那么pathname的编码格式要求是utf-8的,而不能是gb3212/gbk的,否则就是乱码。
        那么如果linux C下如何进行gbk<---->utf-8编码转换的编码装换的?使用的是iconv函数簇。
        #include <iconv.h>
        int code_convert(char *from_charset,char *to_charset,char *inbuf,int inlen,char *outbuf,int outlen)
        {
        iconv_t cd;
        int rc;
        char **pin = &inbuf;
        char **pout = &outbuf;
        cd = iconv_open(to_charset,from_charset);
        if (cd==0)
        return -1;
        memset(outbuf,0,outlen);
        if (iconv(cd,pin,&inlen,pout,&outlen) == -1)
        return -1;
        iconv_close(cd);
        return 0;
        }
        int u2g(char *inbuf,int inlen,char *outbuf,int outlen)
        {
        return code_convert("utf-8","gb2312",inbuf,inlen,outbuf,outlen);
        }
        int g2u(char *inbuf,size_t inlen,char *outbuf,size_t outlen)
        {
        return code_convert("gb2312","utf-8",inbuf,inlen,outbuf,outlen);
        }

        其中
        iconv函数族的头文件是iconv.h,使用前需包含之。
        #include <iconv.h>
        iconv函数族有三个函数,原型如下:
        (1) iconv_t iconv_open(const char *tocode, const char *fromcode);
        此函数说明将要进行哪两种编码的转换,tocode是目标编码,fromcode是原编码,该函数返回一个转换句柄,供以下两个函数使用。
        (2) size_t iconv(iconv_t cd,char **inbuf,size_t *inbytesleft,char **outbuf,size_t *outbytesleft);
        此函数从inbuf中读取字符,转换后输出到outbuf中,inbytesleft用以记录还未转换的字符数,outbytesleft用以记录输出缓冲的剩余空间。
        (3) int iconv_close(iconv_t cd);
        此函数用于关闭转换句柄,释放资源。 ......



        C编程:使用iconv把GB2312编码转换为UTF-8编码

        C编程:使用iconv把GB2312编码转换为UTF-8编码

        #include <stdio.h>
            #include <string.h>
            #include <iconv.h>

            int gb2312_to_utf8(char *in, char *out, size_t size);

            int main(int argc, char *argv[]) {

                char *wc = "我";
                char *str = "Beijing北京";

                char out[100];

                if (gb2312_to_utf8(wc, out, 100) != 0) {
                    printf("%s\n", out);
                }
                if (gb2312_to_utf8(str, out, 100) != 0) {
                    printf("%s\n", out);
                }

                return 0;
            }

            int gb2312_to_utf8(char *in, char *out, size_t size) {

                //使用iconv转换GB2312为UTF-8编码

                iconv_t cd;
                cd = iconv_open("UTF-8", "GB2312");
                if ( cd == (iconv_t)(-1) ) {
                    perror("iconv_open failed");
                    return 0;
                }

                size_t in_left = strlen(in) + 1;
                char *out_ptr;
                size_t res;

                out_ptr = out;
                res = iconv(cd, &in, &in_left, &out_ptr, &size);
                if ( res == (size_t) (-1) ) {
                    perror("iconv failed");
                    return 0;
                }

                iconv_close(cd);
                return 1;
            }
  • 相关阅读:
    第四十七讲 ASP.NET实例编程(六)
    第四十四讲 ASP.NET实例编程(三)
    第四十一讲 ASP.NET消息处理(二)
    第四十三讲 ASP.NET实例编程(二)
    第四十二讲 ASP.NET实例编程(一)
    第四十六讲 ASP.NET实例编程(五)
    第四十八讲 ASP.NET实战编程(一)
    第四十讲 ASP.NET消息处理(一)
    第四十五讲 ASP.NET实例编程(四)
    第三十九 ASP.NET编码
  • 原文地址:https://www.cnblogs.com/lexus/p/2824770.html
Copyright © 2011-2022 走看看