微信昵称乱码过滤器


import org.apache.commons.lang.StringUtils;

/**
 * 微信特殊字符 emoji 过滤器
 * @Description:
 * date:   2015-4-7
 * time:   下午4:27:44
 * author: <a href="http://chris-rock-f0.iteye.com/">烧猪</a>
 */
public class EmojiFilter {

	/**
     * 检测是否有emoji字符
     * @param source
     * @return 一旦含有就抛出
     */
    public static boolean containsEmoji(String source) {
        if (StringUtils.isBlank(source)) {
            return false;
        }

        int len = source.length();

        for (int i = 0; i < len; i++) {
            char codePoint = source.charAt(i);

            if (isEmojiCharacter(codePoint)) {
                //do nothing,判断到了这里表明,确认有表情字符
                return true;
            }
        }

        return false;
    }

    private static boolean isEmojiCharacter(char codePoint) {
        return (codePoint == 0x0) ||
                (codePoint == 0x9) ||
                (codePoint == 0xA) ||
                (codePoint == 0xD) ||
                ((codePoint >= 0x20) && (codePoint <= 0xD7FF)) ||
                ((codePoint >= 0xE000) && (codePoint <= 0xFFFD)) ||
                ((codePoint >= 0x10000) && (codePoint <= 0x10FFFF));
    }

    /**
     * 过滤emoji 或者 其他非文字类型的字符
     * @param source
     * @return
     */
    public static String filterEmoji(String source) {

        if (!containsEmoji(source)) {
            return source;//如果不包含,直接返回
        }
        //到这里铁定包含
        StringBuilder buf = null;

        int len = source.length();

        for (int i = 0; i < len; i++) {
            char codePoint = source.charAt(i);

            if (isEmojiCharacter(codePoint)) {
                if (buf == null) {
                    buf = new StringBuilder(source.length());
                }

                buf.append(codePoint);
            } else {
            }
        }

        if (buf == null) {
            return source;//如果没有找到 emoji表情,则返回源字符串
        } else {
            if (buf.length() == len) {//这里的意义在于尽可能少的toString,因为会重新生成字符串
                buf = null;
                return source;
            } else {
                return buf.toString();
            }
        }

    }

}



原理解析:
由于Android 或 IOS 的设备里 的一些 特殊字符或者表情符号,在获取微信服务器的联系人昵称时会出现乱码,当写入本地 MySQL 数据库时会出错, 所以需要进行过滤

出错的原因:
MySQL的字节是3位,特殊字符是4字节.
有条件的可以自行修改字符集(听说utf8mb4可以解决,要求改连接字符串的编码和数据库字段的编码,未测试,群内朋友给出的解决方案)

你可能感兴趣的:(过滤器)