如何获取java源文件编码格式

如何获取java源文件编码格式,第1张

java中主要使用charset这个类来判断文件的编码格式,代码如下:

package com.ghj.packageoftool

 

import info.monitorenter.cpdetector.io.ASCIIDetector

import info.monitorenter.cpdetector.io.ByteOrderMarkDetector

import info.monitorenter.cpdetector.io.CodepageDetectorProxy

import info.monitorenter.cpdetector.io.JChardetFacade

import info.monitorenter.cpdetector.io.ParsingDetector

import info.monitorenter.cpdetector.io.UnicodeDetector

 

import java.io.ByteArrayInputStream

import java.io.File

import java.io.InputStream

import java.net.URL

import java.nio.charset.Charset

 

/**

 * 文件工具类

 * 

 * @author 高焕杰

 */

public class FileTool {

 

    /**

     * 获取本地文件的编码格式

     * 

     * @param file 要判断的文件编码格式

     * 

     * @author 高焕杰

     */

    public static String getLocalFileEncode(File localFile) {

 

        /*

         * cpDetector是探测器,它把探测任务交给具体的探测实现类的实例完成。

         * cpDetector内置了一些常用的探测实现类,这些探测实现类的实例可以通过add方法 加进来,如ParsingDetector、ByteOrderMarkDetector、JChardetFacade、ASCIIDetector、UnicodeDetector。

         * cpDetector按照“谁最先返回非空的探测结果,就以该结果为准”的原则返回探测到的字符集编码。cpDetector是基于统计学原理的,不保证完全正确。

         */

        CodepageDetectorProxy codepageDetector = CodepageDetectorProxy.getInstance()

        codepageDetector.add(new ParsingDetector(false))//ParsingDetector可用于检查HTML、XML等文件或字符流的编码,构造方法中的参数用于指示是否显示探测过程的详细信息,为false不显示。

        codepageDetector.add(JChardetFacade.getInstance())//JChardetFacade封装了由Mozilla组织提供的JChardet,它可以完成大多数文件的编码 测定。所以,一般有了这个探测器就可满足大多数项目的要求,如果你还不放心,可以再多加几个探测器,比如下面的ASCIIDetector、UnicodeDetector等。

        codepageDetector.add(new ByteOrderMarkDetector())  

        codepageDetector.add(ASCIIDetector.getInstance())//ASCIIDetector用于ASCII编码测定

        codepageDetector.add(UnicodeDetector.getInstance())//UnicodeDetector用于Unicode家族编码的测定

        Charset charset = null

        try {

            charset = codepageDetector.detectCodepage(localFile.toURI().toURL())

            if (charset != null){

                return charset.name()

            }

        } catch (Exception e) {

            e.printStackTrace()

        }

        return null

    }

     

    /**

     * 获得远程URL文件的编码格式

     * 

     * @param url 远程文件的URL路径

     * 

     * @author 高焕杰

     */

    public static String getURLFileEncode(URL url) {

 

        /*

         * cpDetector是探测器,它把探测任务交给具体的探测实现类的实例完成。

         * cpDetector内置了一些常用的探测实现类,这些探测实现类的实例可以通过add方法 加进来,如ParsingDetector、ByteOrderMarkDetector、JChardetFacade、ASCIIDetector、UnicodeDetector。

         * cpDetector按照“谁最先返回非空的探测结果,就以该结果为准”的原则返回探测到的字符集编码。cpDetector是基于统计学原理的,不保证完全正确。

         */

        CodepageDetectorProxy codepageDetector = CodepageDetectorProxy.getInstance()

        codepageDetector.add(new ParsingDetector(false))//ParsingDetector可用于检查HTML、XML等文件或字符流的编码,构造方法中的参数用于指示是否显示探测过程的详细信息,为false不显示。

        codepageDetector.add(JChardetFacade.getInstance())//JChardetFacade封装了由Mozilla组织提供的JChardet,它可以完成大多数文件的编码 测定。所以,一般有了这个探测器就可满足大多数项目的要求,如果你还不放心,可以再多加几个探测器,比如下面的ASCIIDetector、UnicodeDetector等。

        codepageDetector.add(ASCIIDetector.getInstance())//ASCIIDetector用于ASCII编码测定

        codepageDetector.add(UnicodeDetector.getInstance())//UnicodeDetector用于Unicode家族编码的测定

        Charset charset = null

        try {

            charset = codepageDetector.detectCodepage(url)

            if (charset != null){

                return charset.name()

            }

        } catch (Exception e) {

            e.printStackTrace()

        }

        return null

    }

     

    /**

     * 获得文件流的编码格式

     * 

     * @param inputStream 文件流

     * 

     * @author 高焕杰

     */

    public static String getInputStreamEncode(InputStream inputStream) {

 

        /*

         * cpDetector是探测器,它把探测任务交给具体的探测实现类的实例完成。

         * cpDetector内置了一些常用的探测实现类,这些探测实现类的实例可以通过add方法 加进来,如ParsingDetector、ByteOrderMarkDetector、JChardetFacade、ASCIIDetector、UnicodeDetector。

         * cpDetector按照“谁最先返回非空的探测结果,就以该结果为准”的原则返回探测到的字符集编码。cpDetector是基于统计学原理的,不保证完全正确。

         */

        CodepageDetectorProxy codepageDetector = CodepageDetectorProxy.getInstance()

        codepageDetector.add(new ParsingDetector(false))//ParsingDetector可用于检查HTML、XML等文件或字符流的编码,构造方法中的参数用于指示是否显示探测过程的详细信息,为false不显示。

        codepageDetector.add(JChardetFacade.getInstance())//JChardetFacade封装了由Mozilla组织提供的JChardet,它可以完成大多数文件的编码 测定。所以,一般有了这个探测器就可满足大多数项目的要求,如果你还不放心,可以再多加几个探测器,比如下面的ASCIIDetector、UnicodeDetector等。

        codepageDetector.add(ASCIIDetector.getInstance())//ASCIIDetector用于ASCII编码测定

        codepageDetector.add(UnicodeDetector.getInstance())//UnicodeDetector用于Unicode家族编码的测定

        Charset charset = null

        try {

            charset = codepageDetector.detectCodepage(inputStream, 0)

            if (charset != null){

                return charset.name()

            }

        } catch (Exception e) {

            e.printStackTrace()

        }

        return null

    }

     

    /**

     * 获得字符串的编码格式

     * 

     * @param stringValue 要判断的文件编码格式字符串

     * 

     * @author 高焕杰

     */

    public static String getStringEncode(String stringValue) {

 

        /*

         * cpDetector是探测器,它把探测任务交给具体的探测实现类的实例完成。

         * cpDetector内置了一些常用的探测实现类,这些探测实现类的实例可以通过add方法 加进来,如ParsingDetector、ByteOrderMarkDetector、JChardetFacade、ASCIIDetector、UnicodeDetector。

         * cpDetector按照“谁最先返回非空的探测结果,就以该结果为准”的原则返回探测到的字符集编码。cpDetector是基于统计学原理的,不保证完全正确。

         */

        CodepageDetectorProxy codepageDetector = CodepageDetectorProxy.getInstance()

        codepageDetector.add(new ParsingDetector(false))//ParsingDetector可用于检查HTML、XML等文件或字符流的编码,构造方法中的参数用于指示是否显示探测过程的详细信息,为false不显示。

        codepageDetector.add(JChardetFacade.getInstance())//JChardetFacade封装了由Mozilla组织提供的JChardet,它可以完成大多数文件的编码 测定。所以,一般有了这个探测器就可满足大多数项目的要求,如果你还不放心,可以再多加几个探测器,比如下面的ASCIIDetector、UnicodeDetector等。

        codepageDetector.add(ASCIIDetector.getInstance())//ASCIIDetector用于ASCII编码测定

        codepageDetector.add(UnicodeDetector.getInstance())//UnicodeDetector用于Unicode家族编码的测定

        Charset charset = null

        try {

            InputStream inputStream = new ByteArrayInputStream(stringValue.getBytes())

            charset = codepageDetector.detectCodepage(inputStream, 3)

            if (charset != null){

                return charset.name()

            }

        } catch (Exception e) {

            e.printStackTrace()

        }

        return null

    }

}

如果是修改文件的编码方式,可以按以下步骤:

选中文件右键-->Properties-->Resource-->Text file encoding-->选中Other,然后选择自己想要的编码格式就可以了。

如果是修改MyEclipse的编码方式,可以按以下步骤:

菜单栏的Window-->Perferences-->General-->Work Space-->Text file encoding-->选中Other,然后选择自己想要的编码格式就可以了。

File in = new File(args[0])

InputStreamReader r = new InputStreamReader(new FileInputStream(in))

System.out.println(r.getEncoding())


欢迎分享,转载请注明来源:内存溢出

原文地址: http://outofmemory.cn/tougao/7956114.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
上一篇 2023-04-11
下一篇 2023-04-11

发表评论

登录后才能评论

评论列表(0条)

保存