浙江省高等学校教师教育理论培训

微信搜索“毛凌志岗前心得”小程序

  博客园  :: 首页  :: 新随笔  :: 联系 :: 订阅 订阅  :: 管理

 

inux下GBK->UTF-8_fly123456789-ChinaUnix博客

    linux下GBK->UTF-8文件编码批量转换脚本

    find default -type d -exec mkdir -p utf/{} ;
    find default -type f -exec iconv -f GBK -t UTF-8 {} -o utf/{} ;
    这两行命令将default目录下的文件由GBK编码转换为UTF-8编码,目录结构不变,转码后的文件保存在utf/default目录下。


    linux C gbk utf 8编码转换
      // -->
    用linux C 下的函数调用创建中文目录、文件等,字符串的编码格式要求是utf-8格式的。
    比如想要使用 int mkdir(const char *pathname, mode_t mode); 创建一个中文的目录。那么pathname的编码格式要求是utf-8的,而不能是gb3212/gbk的,否则就是乱码。
    那么如果linux C下如何进行gbk<---->utf-8编码转换的编码装换的?使用的是iconv函数簇。
    #include <iconv.h>
    int code_convert(char *from_charset,char *to_charset,char *inbuf,int inlen,char *outbuf,int outlen)
    {
    iconv_t cd;
    int rc;
    char **pin = &inbuf;
    char **pout = &outbuf;
    cd = iconv_open(to_charset,from_charset);
    if (cd==0)
    return -1;
    memset(outbuf,0,outlen);
    if (iconv(cd,pin,&inlen,pout,&outlen) == -1)
    return -1;
    iconv_close(cd);
    return 0;
    }
    int u2g(char *inbuf,int inlen,char *outbuf,int outlen)
    {
    return code_convert("utf-8","gb2312",inbuf,inlen,outbuf,outlen);
    }
    int g2u(char *inbuf,size_t inlen,char *outbuf,size_t outlen)
    {
    return code_convert("gb2312","utf-8",inbuf,inlen,outbuf,outlen);
    }

    其中
    iconv函数族的头文件是iconv.h,使用前需包含之。
    #include <iconv.h>
    iconv函数族有三个函数,原型如下:
    (1) iconv_t iconv_open(const char *tocode, const char *fromcode);
    此函数说明将要进行哪两种编码的转换,tocode是目标编码,fromcode是原编码,该函数返回一个转换句柄,供以下两个函数使用。
    (2) size_t iconv(iconv_t cd,char **inbuf,size_t *inbytesleft,char **outbuf,size_t *outbytesleft);
    此函数从inbuf中读取字符,转换后输出到outbuf中,inbytesleft用以记录还未转换的字符数,outbytesleft用以记录输出缓冲的剩余空间。
    (3) int iconv_close(iconv_t cd);
    此函数用于关闭转换句柄,释放资源。 ......



    C编程:使用iconv把GB2312编码转换为UTF-8编码

    C编程:使用iconv把GB2312编码转换为UTF-8编码

    #include <stdio.h>
        #include <string.h>
        #include <iconv.h>

        int gb2312_to_utf8(char *in, char *out, size_t size);

        int main(int argc, char *argv[]) {

            char *wc = "我";
            char *str = "Beijing北京";

            char out[100];

            if (gb2312_to_utf8(wc, out, 100) != 0) {
                printf("%s\n", out);
            }
            if (gb2312_to_utf8(str, out, 100) != 0) {
                printf("%s\n", out);
            }

            return 0;
        }

        int gb2312_to_utf8(char *in, char *out, size_t size) {

            //使用iconv转换GB2312为UTF-8编码

            iconv_t cd;
            cd = iconv_open("UTF-8", "GB2312");
            if ( cd == (iconv_t)(-1) ) {
                perror("iconv_open failed");
                return 0;
            }

            size_t in_left = strlen(in) + 1;
            char *out_ptr;
            size_t res;

            out_ptr = out;
            res = iconv(cd, &in, &in_left, &out_ptr, &size);
            if ( res == (size_t) (-1) ) {
                perror("iconv failed");
                return 0;
            }

            iconv_close(cd);
            return 1;
        }
posted on 2012-12-19 13:14  lexus  阅读(808)  评论(0编辑  收藏  举报