weixin_42188589

使用spark将hive数据写入elasticsearch或hbase

将hive或者其他关系型数据库中的数据搬迁到es或hbase

代码

依赖
socket入口：
MyServerThread实现
工具类PropertiesUtil
配置文件config.properties
客户端MyClient测试
执行脚本

将hive或者其他关系型数据库中的数据搬迁到es或hbase

需求：因为需要使用hadoop能力，所以程序最后打包丢到spark所在服务器上运行，自己的web通过socket连接该jar,传递参数，执行数据搬迁任务，最后返回执行结果。

代码

依赖


        2.1.2
        1.7
        1.2.0-cdh5.8.4
    

    
        
            org.apache.spark
            spark-core_2.11
            ${spark.version}
            provided
        

         
            org.apache.spark
            spark-sql_2.11
            ${spark.version}
            provided
        

        
            org.apache.spark
            spark-hive_2.11
            ${spark.version}
            provided
        

        
            mysql
            mysql-connector-java
            5.1.47
            provided
        

        
            org.apache.commons
            commons-lang3
            3.4
            provided
        

        
            com.google.code.gson
            gson
            2.2.4
            provided
        

        
            org.elasticsearch
            elasticsearch-spark-20_2.11
            6.3.2
            provided
        
        
            com.oracle
            ojdbc6
            11.2.0.3
            provided
        

        
        
            org.apache.zookeeper
            zookeeper
            3.4.13
            pom
        
        
            org.apache.hbase
            hbase-client
            ${hbase.version}
            
                
                    org.slf4j
                    slf4j-log4j12
                
            
        
        
            org.apache.hbase
            hbase-common
            ${hbase.version}
            
                
                    org.slf4j
                    slf4j-log4j12
                
            
        
        
            org.apache.hbase
            hbase-server
            ${hbase.version}
            
                
                    org.slf4j
                    slf4j-log4j12

socket入口：

public class MyServer {

    public static void main(String[] args) throws Exception
    {
        int port = 2018;
        if(args != null && args.length>0){
            port = Integer.parseInt(args[0]);
        }

        SparkSession spark = SparkSession.builder().appName("SparkUtil") // .master("local[*]")
                .config("spark.sql.hive.verifyPartitionPath",true) //解决分区损坏问题
                .config("spark.hadoop.yarn.timeline-service.enabled",false)//java.lang.NoClassDefFoundError: com/sun/jersey/api/client/config/ClientConfig
                .config("spark.sql.broadcastTimeout",PropertiesUtil.getProperty("spark.sql.broadcastTimeout","3600"))
                .config("spark.network.timeout",PropertiesUtil.getProperty("spark.network.timeout"))
                .config("spark.sql.parquet.compression.codec",PropertiesUtil.getProperty("spark.sql.parquet.compression.codec","gzip"))
                .config("es.index.auto.create", "false")//不自动创建，提前创建索引
                .config("es.nodes",PropertiesUtil.getProperty("es.nodes"))
                .config("es.port",PropertiesUtil.getProperty("es.port"))
                .config("es.batch.size.bytes",PropertiesUtil.getProperty("es.batch.size.bytes"))
                .config("es.batch.size.entries",PropertiesUtil.getProperty("es.batch.size.entries","100")) // 100 解决Could not write all entries
                .config("es.batch.write.refresh",PropertiesUtil.getProperty("es.batch.write.refresh","false"))
                .config("es.batch.write.retry.count",PropertiesUtil.getProperty("es.batch.write.retry.count","30")) // 3 解决Could not write all entries
                .config("es.batch.write.retry.wait",PropertiesUtil.getProperty("es.batch.write.retry.wait","100")) // 10s 解决Could not write all entries
                .config("es.http.timeout",PropertiesUtil.getProperty("es.http.timeout"))
                .config("es.http.retries",PropertiesUtil.getProperty("es.http.retries"))
                .config("es.action.heart.beat.lead",PropertiesUtil.getProperty("es.action.heart.beat.lead"))
                .config("es.nodes.wan.only",PropertiesUtil.getProperty("es.nodes.wan.only","true"))
                .config("es.nodes.data.only",PropertiesUtil.getProperty("es.nodes.data.only","true"))
                .config("es.nodes.discovery",PropertiesUtil.getProperty("es.nodes.discovery","true"))
                .config("es.input.use.sliced.partitions",PropertiesUtil.getProperty("es.input.use.sliced.partitions","50000"))
                .config("es.input.max.docs.per.partition",PropertiesUtil.getProperty("es.input.max.docs.per.partition","100000"))
                .config("es.net.http.header.Accept-Languag",PropertiesUtil.getProperty("es.net.http.header.Accept-Languag","gzip"))
                .enableHiveSupport().getOrCreate();

        ServerSocket serverSocket = new ServerSocket(port);//是一个能够接受其他通信实体请求的类
        System.out.println("服务器正在等待客户端的连接请求----");
        // 创建线程池
        ThreadPoolExecutor executor = new ThreadPoolExecutor(50, 80, 200, MILLISECONDS,
                new ArrayBlockingQueue(5));

        //用一个while循环可以同时响应多个客户端的请求
        while(true){
            Socket socket = serverSocket.accept();//服务器监听对应端口的输入
            MyServerThread thread = new MyServerThread(socket,spark);//创建线程
            executor.execute(thread);
            //thread.start();
        }
    }
}

MyServerThread实现

public class MyServerThread implements Runnable, Serializable {
    public static final String SUCCESS = "1";
    public static final String FAIL = "0";
    public static final String DS_HIVE = "hive";
    public static final String DS_ORACLE = "oracle";
    public static final String DS_ES = "es";
    public static final String DS_HBASE = "hbase";
    public static final String DS_MYSQL = "mysql";

    public transient Map translateMaps = new HashMap<>();

    private transient Socket socket;
    private transient SparkSession spark;

    public MyServerThread(Socket socket,SparkSession spark){
        this.socket = socket;
        this.spark = spark;
    }

    public void run() {
        BufferedReader bufferedReader = null;
        BufferedWriter bufferedWriter = null;
        ObjectInputStream ois = null;
        Map map = null;
        HashMap paramsMap = null;
        try{
            ois = new ObjectInputStream(socket.getInputStream());
            paramsMap = (HashMap) ois.readObject();
            System.out.println("来自客户端的数据："+paramsMap);

            if(paramsMap != null) {
                String method = PropertiesUtil.getStrValue(paramsMap, "method");
                if ("doImportToEs".equals(method)) {
                    map = doImportToEs(paramsMap, spark);
                }
                if ("doImportToHBase".equals(method)) {
                    map = doImportToHBase(paramsMap, spark);
                }
                bufferedWriter = new BufferedWriter(new OutputStreamWriter(socket.getOutputStream()));
                bufferedWriter.write(map.get("code") + ":" + map.get("msg") + "\n");
                bufferedWriter.flush();
            }
        } catch(Exception e) {
            e.printStackTrace();
        } finally {
            try {
                if(ois != null){
                    ois.close();
                }
                if(bufferedReader != null){
                    bufferedReader.close();
                }
                if(bufferedWriter != null){
                    bufferedWriter.close();
                }
                if(socket != null){
                    socket.close();
                }
            } catch (IOException e) {
                e.printStackTrace();
            }
        }
    }

    //数据保存
    private Map doImportToEs(Map paramsMap, SparkSession spark){
        long start = System.currentTimeMillis();
        Map result = new HashMap();
        long totalCount = 0L;
        try {
            String sql = PropertiesUtil.getStrValue(paramsMap,"sql");
            String tableCode = PropertiesUtil.getStrValue(paramsMap,"table_code");
            String index = PropertiesUtil.getStrValue(paramsMap,"index");
            String srcTableType = PropertiesUtil.getStrValue(paramsMap,"src_table_type");
            String tableType = PropertiesUtil.getStrValue(paramsMap,"table_type");
            String mappingId = PropertiesUtil.getStrValue(paramsMap,"mapping_id");
            //保存到ES
            if (DS_HIVE.equalsIgnoreCase(srcTableType)) {
                Dataset toTransDs = spark.sql(sql).persist();
                totalCount = toTransDs.count();
                if(StringUtils.isEmpty(mappingId)) {
                    JavaEsSparkSQL.saveToEs(toTransDs, index + "/" + index);
                } else {
                    //索引主键，使用默认主键;更多配置可参考ConfigurationOptions
                    JavaEsSparkSQL.saveToEs(toTransDs, index + "/" + index,ImmutableMap.of("es.mapping.id", mappingId));
                }
                toTransDs.unpersist();//释放缓存
            }

            if(DS_ORACLE.equalsIgnoreCase(srcTableType) && DS_ES.equalsIgnoreCase(tableType)){
                //连接oracle库
                Map options = new HashMap();
                options.put("driver",PropertiesUtil.getProperty("oracle.driver"));
                options.put("url",PropertiesUtil.getStrValue(paramsMap,"url"));
                options.put("user",PropertiesUtil.getStrValue(paramsMap,"user"));
                options.put("password",PropertiesUtil.getStrValue(paramsMap,"password"));
                options.put("dbtable",tableCode);
                Dataset oraDs = spark.read().format("jdbc").options(options).load();
                oraDs.createOrReplaceTempView(tableCode);
                Dataset oraTable = spark.sql(sql);//String sqltext="(" + sql + ") t";
                oraTable.show();
                totalCount = oraTable.count();
                if(StringUtils.isEmpty(mappingId)) {
                    JavaEsSparkSQL.saveToEs(oraTable, index + "/" + index);
                } else {
                    //索引主键，使用默认主键;更多配置可参考ConfigurationOptions
                    JavaEsSparkSQL.saveToEs(oraTable, index + "/" + index,ImmutableMap.of("es.mapping.id", mappingId));
                }
            }

            if(DS_MYSQL.equalsIgnoreCase(srcTableType) && DS_ES.equalsIgnoreCase(tableType)) {
                Properties connectionProperties = new Properties();
                connectionProperties.put("user", PropertiesUtil.getStrValue(paramsMap,"user"));
                connectionProperties.put("password", PropertiesUtil.getStrValue(paramsMap,"password"));
                String url = PropertiesUtil.getStrValue(paramsMap,"url");
                Dataset mysqlTable = spark.read().jdbc(url, tableCode, connectionProperties);
                mysqlTable.show();
                totalCount = mysqlTable.count();
                if(StringUtils.isEmpty(mappingId)) {
                    JavaEsSparkSQL.saveToEs(mysqlTable, index + "/" + index);
                } else {
                    //索引主键，使用默认主键;更多配置可参考ConfigurationOptions
                    JavaEsSparkSQL.saveToEs(mysqlTable, index + "/" + index,ImmutableMap.of("es.mapping.id", mappingId));
                }
            }

            result.put("code",totalCount);//SUCCESS
            long end = System.currentTimeMillis();
            result.put("msg","保存到ES执行完成，源数据量："+totalCount+"条，耗时："+(end-start)/1000+"s");//注意不要用英文：
            System.out.println(result);
        } catch (Exception e) {
            result.put("code",FAIL);
            result.put("msg",e.getMessage());
            e.printStackTrace();
        }
        return result;
    }

    private Map doImportToHBase(Map paramsMap, SparkSession spark){
        long start = System.currentTimeMillis();
        Map result = new HashMap();
        long totalCount = 0L;
        long rowCount = 0L;

        try {
            String sql = PropertiesUtil.getStrValue(paramsMap,"sql");
            String srcTableCode = PropertiesUtil.getStrValue(paramsMap,"src_table_code");
            String tableCode = PropertiesUtil.getStrValue(paramsMap,"table_code");
            String srcTableType = PropertiesUtil.getStrValue(paramsMap,"src_table_type");
            String tableType = PropertiesUtil.getStrValue(paramsMap,"table_type");
            String mappingId = PropertiesUtil.getStrValue(paramsMap,"mapping_id");

            if(StringUtils.isEmpty(mappingId)) {
                result.put("code",FAIL);
                result.put("msg","Rowkey column is NULL!");
                return result;
            }

            if (DS_HIVE.equalsIgnoreCase(srcTableType)) {
                Dataset toTransDs = spark.sql(sql).persist();
                totalCount = toTransDs.count();
                rowCount = saveToHBase(toTransDs,tableCode,mappingId);//保存数据到hbase
                toTransDs.unpersist();//释放缓存
            }

            if(DS_ORACLE.equalsIgnoreCase(srcTableType) && DS_HBASE.equalsIgnoreCase(tableType)){
                //连接oracle库
                Map options = new HashMap();
                options.put("driver",PropertiesUtil.getProperty("oracle.driver"));
                options.put("url",PropertiesUtil.getStrValue(paramsMap, "url"));
                options.put("user",PropertiesUtil.getStrValue(paramsMap, "user"));
                options.put("password",PropertiesUtil.getStrValue(paramsMap, "password"));
                options.put("dbtable",srcTableCode);
                Dataset oraDs = spark.read().format("jdbc").options(options).load();
                oraDs.createOrReplaceTempView(srcTableCode);
                Dataset oraTable = spark.sql(sql);//String sqltext="(" + sql + ") t";
                oraTable.show();
                totalCount = oraTable.count();
                rowCount = saveToHBase(oraTable,tableCode,mappingId);//保存数据到hbase
            }

            if(DS_MYSQL.equalsIgnoreCase(srcTableType) && DS_HBASE.equalsIgnoreCase(tableType)){
                //连接mysql库
                Properties connectionProperties = new Properties();
                connectionProperties.put("user", PropertiesUtil.getStrValue(paramsMap,"user"));
                connectionProperties.put("password", PropertiesUtil.getStrValue(paramsMap,"password"));
                String url = PropertiesUtil.getStrValue(paramsMap,"url");
                Dataset mysqlTable = spark.read().jdbc(url, srcTableCode, connectionProperties);
                mysqlTable.show();
                totalCount = mysqlTable.count();
                rowCount = saveToHBase(mysqlTable,tableCode,mappingId);//保存数据到hbase
            }

            long end = System.currentTimeMillis();
            result.put("code",SUCCESS);
            String msgs = "保存到HBase执行完成，源数据量："+totalCount+"条，耗时："+(end-start)/1000+"s";//注意不要用英文：
            if(totalCount != rowCount){
                result.put("code",FAIL);
                msgs += ";保存到HBase数据量：" + rowCount + ",数据量不一致";
            }
            result.put("msg",msgs);
            System.out.println(result);
        } catch (Exception e) {
            result.put("code",FAIL);
            result.put("msg",e.getMessage());
            e.printStackTrace();
        }
        return result;
    }

    private Long saveToHBase(Dataset resultDs, String tableCode, final String mappingId) throws Exception {
        String tableName = tableCode.toLowerCase();//表名
        final String columnFamily = "columnFamily";//列簇名

        Configuration config = spark.sparkContext().hadoopConfiguration();
        config.set("hbase.zookeeper.quorum", PropertiesUtil.getProperty("hbase.zookeeper.quorum"));
        config.set("hbase.zookeeper.property.clientPort",PropertiesUtil.getProperty("hbase.zookeeper.property.clientPort"));
        config.set("hbase.master", PropertiesUtil.getProperty("hbase.master"));
        config.set("hbase.cluster.distributed", PropertiesUtil.getProperty("hbase.cluster.distributed","true"));
        config.set("zookeeper.session.timeout", PropertiesUtil.getProperty("zookeeper.session.timeout","30000"));
        config.set("hbase.hregion.majorcompaction", PropertiesUtil.getProperty("hbase.hregion.majorcompaction","0"));
        config.set("hbase.regionserver.regionSplitLimit", PropertiesUtil.getProperty("hbase.regionserver.regionSplitLimit","1"));
        config.set("dfs.client.socket-timeout", PropertiesUtil.getProperty("dfs.client.socket-timeout","60000"));
        config.set("hbase.regionserver.handler.count", PropertiesUtil.getProperty("hbase.regionserver.handler.count","20"));

        Job hbaseJob = Job.getInstance(config,"spark-hbase");
        hbaseJob.setOutputFormatClass(org.apache.hadoop.hbase.mapreduce.TableOutputFormat.class);
        hbaseJob.getConfiguration().set(TableInputFormat.INPUT_TABLE, tableName);
        hbaseJob.getConfiguration().set(TableOutputFormat.OUTPUT_TABLE, tableName);

        Connection connection = ConnectionFactory.createConnection(config);
        Admin admin = connection.getAdmin();

        //删除无需保留的数据
        String regex = "^" + tableName + "$";
        TableName[] tableNames = admin.listTableNames(regex);//查询所有表名
        for (TableName tname : tableNames) {
            admin.disableTable(tname); //禁用表
            admin.deleteTable(tname); //删除表
        }

        //新建表
        TableName htableName = TableName.valueOf(tableName);
        HTableDescriptor hbaseTable = new HTableDescriptor(htableName);
        hbaseTable.addFamily(new HColumnDescriptor(columnFamily));//列簇默认
        admin.createTable(hbaseTable);

        final String[] mids = mappingId.split(",");
        JavaPairRDD hbasePuts = resultDs.javaRDD().mapToPair(new PairFunction() {
            @Override
            public Tuple2 call(Row row) throws Exception {
                StructType schema = row.schema();
                Iterator it = schema.iterator();
                Iterator it1 = schema.iterator();
                //获取rowkey值
                int i = 0;
                List values = new ArrayList<>();
                while (it.hasNext()) {
                    StructField next = it.next();
                    for(String mid : mids){
                        if(mid.equalsIgnoreCase(next.name())){
                            values.add(row.getString(i));
                        }
                    }
                    i++;
                }
                Put put = new Put(Bytes.toBytes(StringUtils.join(values,":")));//连接多个字段
                //设置数据
                i = 0;
                while (it1.hasNext()) {
                    StructField next = it1.next();
                    Object value = row.get(i++);
                    String v = (value == null) ? "" :String.valueOf(value);
                    put.addColumn(Bytes.toBytes(columnFamily), Bytes.toBytes(next.name()), Bytes.toBytes(v));
                }

                return new Tuple2(new ImmutableBytesWritable(), put);
            }
        });
        //保存数据
        hbasePuts.saveAsNewAPIHadoopDataset(hbaseJob.getConfiguration());

        //数据稽核
        String coprocessorClassName = "org.apache.hadoop.hbase.coprocessor.AggregateImplementation";
        admin.disableTable(htableName);
        hbaseTable.addCoprocessor(coprocessorClassName);
        admin.modifyTable(htableName, hbaseTable);
        admin.enableTable(htableName);

        AggregationClient ac = new AggregationClient(config);
        Scan scan = new Scan();
        scan.addFamily(Bytes.toBytes(columnFamily));
        ColumnInterpreter longColumnInterpreter = new LongColumnInterpreter();
        long rowCount = 0;
        try {
            rowCount = ac.rowCount(htableName,longColumnInterpreter,scan);
        } catch (Throwable throwable) {
            throwable.printStackTrace();
        }
        System.out.println("hbase rowCount:"+rowCount);

        admin.close();
        connection.close();

        return rowCount;
    }
}

工具类PropertiesUtil

public class PropertiesUtil {
    private static Properties prop = null;
    static{
        //获取配置
        try {
            prop = new Properties();
            ClassLoader loader = Thread.currentThread().getContextClassLoader();
            InputStream inputStream = loader.getResourceAsStream("config.properties");
            prop.load(inputStream);
        } catch (Exception e) {
            e.printStackTrace();
        }
    }

    public static String getProperty(String property){
        return prop.getProperty(property);
    }

    public static String getProperty(String property,String defaultValue){
        String value = prop.getProperty(property);
        if(value == null || "".equals(value)){
            value = defaultValue;
        }
        return value;
    }

    public static String getStrValue(Map map, String key) {
        if (map == null || map.isEmpty() || StringUtils.isBlank(key)) {
            return "";
        }
        Object t = map.get(key);
        if (t != null) {
            if(t instanceof Integer){
                return t+"";
            }
            return t.toString();
        } else {
            for (Object o : map.keySet()) {
                String name = (String) o;
                if (name.toLowerCase().equals(key.toLowerCase())) {
                    Object value = map.get(o);
                    if (value == null) {
                        return "";
                    }
                    return value.toString();
                }
            }
        }

        return "";
    }
}

配置文件config.properties

#spark配置
spark.sql.broadcastTimeout=3600
spark.network.timeout=1400s
spark.sql.parquet.compression.codec=snappy

################################################################

#数据来源类型[hive、oracle、mysql]
#数据来源类型为oracle时，oracle配置
oracle.driver=oracle.jdbc.driver.OracleDriver

################################################################
#数据目标类型[es、hbase]
#数据目标类型为es时，elasticsearch配置
es.nodes=hostes
es.port=9200
# 4000 解决Could not write all entries
es.batch.size.bytes=20000000
es.batch.size.entries=5000
es.batch.write.refresh=true
es.batch.write.retry.count=50
es.batch.write.retry.wait=500
es.http.timeout=5m
es.http.retries=50
es.action.heart.beat.lead=50
es.nodes.wan.only=true
es.nodes.data.only =false
es.nodes.discovery=false
es.input.use.sliced.partitions=50000
es.input.max.docs.per.partition=100000
es.net.http.header.Accept-Languag=gzip

#数据目标类型为hbase时，hbase配置
hbase.zookeeper.quorum=hosthbase
hbase.zookeeper.property.clientPort=2181
hbase.master=hosthbase:60000
hbase.cluster.distributed=true
zookeeper.session.timeout=1200000
hbase.hregion.majorcompaction=0
hbase.regionserver.regionSplitLimit=150
dfs.client.socket-timeout=60000
hbase.regionserver.handler.count=50

客户端MyClient测试

public class MyClient {

    private Socket socket;

    public MyClient (String address, int port) throws IOException {
        socket = new Socket();
        socket.connect(new InetSocketAddress(InetAddress.getByName(address), port));
    }

    public Socket getSocket(){
        return socket;
    }

    public static void main(String[] args){

        Socket socket = null;
        BufferedReader buffer = null;
        OutputStream outputStream = null;
        ObjectOutputStream oos = null;
        InputStream inputStream = null;
        try{
            MyClient myClient = new MyClient ("hostss",2018);
            socket = myClient.getSocket();
            outputStream = socket.getOutputStream();
            inputStream = socket.getInputStream();

            oos = new ObjectOutputStream(outputStream);
            Map paramMap = new HashMap();
            paramMap.put("method","doImportToHBase");
            paramMap.put("sql","select * from hive_test.big_data_test where p_day = 20181220");
            paramMap.put("table_code","big_data_test_hbase");
            paramMap.put("src_table_type","hive");
            paramMap.put("table_type","hbase");
            paramMap.put("mapping_id","pk_id,phone_no");
            oos.writeObject(paramMap);
            oos.flush();

            buffer = new BufferedReader(new InputStreamReader(socket.getInputStream()));
            String line = buffer.readLine();
            System.out.println("来自服务端的数据："+line);

        } catch (IOException e) {
            e.printStackTrace();
        } finally{
            try {
                if (oos != null){
                    oos.close();
                }
                if (outputStream != null) {
                    outputStream.close();
                }
                if (inputStream != null) {
                    inputStream.close();
                }
                if (socket != null){
                    socket.close();
                }
            } catch (IOException e) {
                e.printStackTrace();
            }
        }
    }
}

执行脚本

nohup /home/hadoop/sparkForThrift/bin/spark-submit \
--class com.sd.data.spark.MyServer \
--driver-java-options -Xss10m \
--conf spark.executor.extraJavaOptions="-XX:+UseParNewGC -XX:+UseConcMarkSweepGC -XX:-CMSConcurrentMTEnabled -XX:CMSInitiatingOccupancyFraction=70 -XX:+CMSParallelRemarkEnabled" \
--driver-memory 50G \
--executor-memory 50G \
--executor-cores 5 \
--conf spark.default.parallelism=1000 \
--name spark-es-hbase \
--queue root.ses \
--master yarn \
>> spark-es-hbase.log &

nosql数据库技术与应用知识点皆过客，揽星河 NoSQL nosql 数据库大数据数据分析数据结构非关系型数据库
Nosql知识回顾大数据处理流程数据采集(flume、爬虫、传感器)数据存储(本门课程NoSQL所处的阶段)Hdfs、MongoDB、HBase等数据清洗(入仓)Hive等数据处理、分析(Spark、Flink等)数据可视化数据挖掘、机器学习应用(Python、SparkMLlib等)大数据时代存储的挑战(三高)高并发(同一时间很多人访问)高扩展(要求随时根据需求扩展存储)高效率(要求读写速度快)
ES聚合分析原理与代码实例讲解光剑书架上的书大厂Offer收割机面试题简历程序员读书硅基计算碳基计算认知计算生物计算深度学习神经网络大数据 AIGC AGI LLM Java Python 架构设计 Agent 程序员实现财富自由
ES聚合分析原理与代码实例讲解1.背景介绍1.1问题的由来在大规模数据分析场景中，特别是在使用Elasticsearch（ES）进行数据存储和检索时，聚合分析成为了一个至关重要的功能。聚合分析允许用户对数据集进行细分和分组，以便深入探索数据的结构和模式。这在诸如实时监控、日志分析、业务洞察等领域具有广泛的应用。1.2研究现状目前，ES聚合分析已经成为现代大数据平台的核心组件之一。它支持多种类型的聚
WebMagic：强大的Java爬虫框架解析与实战 Aaron_945 Java java 爬虫开发语言
文章目录引言官网链接WebMagic原理概述基础使用1.添加依赖2.编写PageProcessor高级使用1.自定义Pipeline2.分布式抓取优点结论引言在大数据时代，网络爬虫作为数据收集的重要工具，扮演着不可或缺的角色。Java作为一门广泛使用的编程语言，在爬虫开发领域也有其独特的优势。WebMagic是一个开源的Java爬虫框架，它提供了简单灵活的API，支持多线程、分布式抓取，以及丰富的
免费的GPT可在线直接使用（一键收藏） kkai人工智能 gpt
1、LuminAI（https://kk.zlrxjh.top）LuminAI标志着一款融合了星辰大数据模型与文脉深度模型的先进知识增强型语言处理系统，旨在自然语言处理（NLP）的技术开发领域发光发热。此系统展现了卓越的语义把握与内容生成能力，轻松驾驭多样化的自然语言处理任务。VisionAI在NLP界的应用领域广泛，能够胜任从机器翻译、文本概要撰写、情绪分析到问答等众多任务。通过对大量文本数据的
如何利用大数据与AI技术革新相亲交友体验 h17711347205 回归算法安全系统架构交友小程序
在数字化时代，大数据和人工智能（AI）技术正逐渐革新相亲交友体验，为寻找爱情的过程带来前所未有的变革（编辑h17711347205）。通过精准分析和智能匹配，这些技术能够极大地提高相亲交友系统的效率和用户体验。大数据的力量大数据技术能够收集和分析用户的行为模式、偏好和互动数据，为相亲交友系统提供丰富的信息资源。通过分析用户的搜索历史、浏览记录和点击行为，系统能够深入了解用户的兴趣和需求，从而提供更
未来软件市场是怎么样的？做开发的生存空间如何？ cesske 软件需求
目录前言一、未来软件市场的发展趋势二、软件开发人员的生存空间前言未来软件市场是怎么样的？做开发的生存空间如何？一、未来软件市场的发展趋势技术趋势：人工智能与机器学习：随着技术的不断成熟，人工智能将在更多领域得到应用，如智能客服、自动驾驶、智能制造等，这将极大地推动软件市场的增长。云计算与大数据：云计算服务将继续普及，大数据技术的应用也将更加广泛。企业将更加依赖云计算和大数据来优化运营、提升效率，并
Hadoop架构 henan程序媛 hadoop 大数据分布式
一、案列分析1.1案例概述现在已经进入了大数据(BigData)时代，数以万计用户的互联网服务时时刻刻都在产生大量的交互，要处理的数据量实在是太大了，以传统的数据库技术等其他手段根本无法应对数据处理的实时性、有效性的需求。HDFS顺应时代出现，在解决大数据存储和计算方面有很多的优势。1.2案列前置知识点1.什么是大数据大数据是指无法在一定时间范围内用常规软件工具进行捕捉、管理和处理的大量数据集合，
[转载] NoSQL简介 weixin_30325793 大数据数据库运维
摘自“百度百科”。NoSQL，泛指非关系型的数据库。随着互联网web2.0网站的兴起，传统的关系数据库在应付web2.0网站，特别是超大规模和高并发的SNS类型的web2.0纯动态网站已经显得力不从心，暴露了很多难以克服的问题，而非关系型的数据库则由于其本身的特点得到了非常迅速的发展。NoSQL数据库的产生就是为了解决大规模数据集合多重数据种类带来的挑战，尤其是大数据应用难题。虽然NoSQL流行语
Kafka详细解析与应用分析芊言芊语 kafka 分布式
Kafka是一个开源的分布式事件流平台（EventStreamingPlatform），由LinkedIn公司最初采用Scala语言开发，并基于ZooKeeper协调管理。如今，Kafka已经被Apache基金会纳入其项目体系，广泛应用于大数据实时处理领域。Kafka凭借其高吞吐量、持久化、分布式和可靠性的特点，成为构建实时流数据管道和流处理应用程序的重要工具。Kafka架构Kafka的架构主要由
分享一个基于python的电子书数据采集与可视化分析 hadoop电子书数据分析与推荐系统 spark大数据毕设项目（源码、调试、LW、开题、PPT) 计算机源码社 Python项目大数据大数据 python hadoop 计算机毕业设计选题计算机毕业设计源码数据分析 spark毕设
作者：计算机源码社个人简介：本人八年开发经验，擅长Java、Python、PHP、.NET、Node.js、Android、微信小程序、爬虫、大数据、机器学习等，大家有这一块的问题可以一起交流！学习资料、程序开发、技术解答、文档报告如需要源码，可以扫取文章下方二维码联系咨询Java项目微信小程序项目Android项目Python项目PHP项目ASP.NET项目Node.js项目选题推荐项目实战|p
疫情，疫情东山草
2020年，疫情爆发，至今已近三年，反反复复，此起彼伏。不但没被消灭，还自我发展，从德尔塔到奥密克戎，与时俱进的变异着。去年11月，疫情之下，大数据800米范围内，都成为时空伴随者。“你的码儿有没有变颜色”“你绿码还是黄码”成为那段时间的流行语，当然少不了的还有全员核酸。段子手整出来一首歌：我走过你走过的路,这算不算相逢？我吹过你吹过的风，这算不算相拥？800米内我们不曾擦肩而过，你却要我14天相
在服务器计算节点中使用 jupyter Lab ranshan567 程序人生
JupyterLab是一个基于网页的交互式开发环境,用于科学计算、数据分析和机器学.jupyterlab是jupyternotebook的下一代产品,集成了更多功能,使用起来更方便.在进行数据分析及可视化时，个人电脑不能满足大数据的分析需求，就需要用到高性能计算机集群资源，然而计算机集群的计算节点往往没有联网功能，所以在计算机集群中使用jupyterLab需要进行一些配置。具体的步骤如下：
大数据真实面试题---SQL The博宇大数据面试题——SQL 大数据 mysql sql 数据库 big data
视频号数据分析组外包招聘笔试题时间限时45分钟完成。题目根据3张表表结构，写出具体求解的SQL代码（搞笑品类定义：视频分类或者视频创建者分类为“搞笑”）1、表创建语句：createtablet_user_video_action_d(dsint,user_idstring,video_idstring,action_typeint,`timestamp`bigint)rowformatdelimi
Flume：大规模日志收集与数据传输的利器傲雪凌霜，松柏长青后端大数据 flume 大数据
Flume：大规模日志收集与数据传输的利器在大数据时代，随着各类应用的不断增长，产生了海量的日志和数据。这些数据不仅对业务的健康监控至关重要，还可以通过深入分析，帮助企业做出更好的决策。那么，如何高效地收集、传输和存储这些海量数据，成为了一项重要的挑战。今天我们将深入探讨ApacheFlume，它是如何帮助我们应对这些挑战的。一、Flume概述ApacheFlume是一个分布式、可靠、可扩展的日志
云服务业界动态简报-20180128 Captain7
一、青云青云QingCloud推出深度学习平台DeepLearningonQingCloud，包含了主流的深度学习框架及数据科学工具包，通过QingCloudAppCenter一键部署交付，可以让算法工程师和数据科学家快速构建深度学习开发环境，将更多的精力放在模型和算法调优。二、腾讯云1.腾讯云正式发布腾讯专有云TCE(TencentCloudEnterprise)矩阵，涵盖企业版、大数据版、AI
大数据毕业设计hadoop+spark+hive知识图谱租房数据分析可视化大屏租房推荐系统 58同城租房爬虫房源推荐系统房价预测系统计算机毕业设计机器学习深度学习人工智能 2401_84572577 程序员大数据 hadoop 人工智能
做了那么多年开发，自学了很多门编程语言，我很明白学习资源对于学一门新语言的重要性，这些年也收藏了不少的Python干货，对我来说这些东西确实已经用不到了，但对于准备自学Python的人来说，或许它就是一个宝藏，可以给你省去很多的时间和精力。别在网上瞎学了，我最近也做了一些资源的更新，只要你是我的粉丝，这期福利你都可拿走。我先来介绍一下这些东西怎么用，文末抱走。（1）Python所有方向的学习路线（
架构评审的自动化与人工智能: 如何提高效率光剑书架上的书架构自动化人工智能运维
1.背景介绍架构评审是软件开发过程中的一个关键环节，它旨在确保软件架构的质量、可维护性和可扩展性。传统的架构评审通常是由人工进行，需要大量的时间和精力。随着大数据技术和人工智能的发展，自动化和人工智能技术已经开始应用于架构评审，从而提高评审的效率和准确性。在本文中，我们将讨论如何通过自动化和人工智能技术来提高架构评审的效率。我们将从以下几个方面进行讨论：背景介绍核心概念与联系核心算法原理和具体操作
【数字化供应链】数字化供应链架构、全景管理、全流程贯通方案数字化建设方案数字化转型数据治理主数据数据仓库供应链数字仓储智慧物流智慧仓储物流园区架构微服务数据挖掘大数据人工智能
原文《数字化供应链架构、全景管理、全流程贯通方案》PPT格式。主要从供应链管理全景、智慧供应链建设总体目标、供应链总体业务流程、供应链总体功能架构、供应链总体技术架构、供应链全流程贯通、供应链全领域管理、供应链数据数据分析、供应链决策中台等进行建设。本文仅对主要内容进行介绍。来源网络公开渠道，旨在交流学习，如有侵权联系速删，更多参考公众号：优享智库基于先进IT技术、大数据能力、物联网应用、区块链平
80 鑫_259b
科普一个谈恋爱的方法。在以前，谈恋爱千难万难，就难在对对方不知底细，不知道对方希望自己是一个怎样的人，要耗费大量的时间去试探、再磨合，往往会因为一些小事一些细节，满盘皆输。在一个信息化的时代，在一个大数据近乎变成了流行语的时代，我们要跟上时代的步伐，通过大数据，去寻找异性最希望自己展现出来的形象是什么，才可以在爱情的道路上少走弯路。那这个大数据怎么操作呢？上街发问卷？问别人的择偶标准？一来会被打死
解锁企业潜能，Vatee万腾平台引领智能新纪元自媒体经济说其他
在数字化转型的浪潮中，企业正站在一个前所未有的十字路口，面对着前所未有的机遇与挑战。解锁企业内在潜能，实现跨越式发展，已成为众多企业的共同追求。而Vatee万腾平台，作为智能科技的先锋，正以其强大的智能赋能能力，引领企业步入一个全新的智能纪元。Vatee万腾平台，是一个集成了人工智能、大数据、云计算等前沿技术的综合性智能服务平台。它不仅仅是一个技术工具，更是企业转型升级的加速器，能够深入企业运营的
释放“AI+”新质生产力，深算院如何“把大数据变小”？ YashanDB YashanDB 国产数据库数据库数据库大数据
近期，南都·湾财社推出《新质·中国造》栏目，深入千行百业，遍访湾区企业，解锁湾区新质生产力，共探高质量发展之道。本期对话深圳计算科学研究院YashanDB首席技术官陈志标，探讨国产数据库如何实现创新突围，抢抓数字经济时代的新机遇。以下是专访内容：如何应对AI时代所面临的算力挑战？南都·湾财社：数据、算力和算法是发展人工智能的三要素，深算院做了怎样的前瞻性布局？陈志标：今年，政府工作报告中首次提及开
数字化智能工厂数字化供应链架构、全景管理、全流程贯通方案数字化建设方案智能制造数字工厂制造业数字化转型工业互联网架构
随着信息技术的飞速发展，数字化转型已成为制造企业提升竞争力的关键途径。数字化智能工厂通过集成先进的物联网(IoT)、大数据、云计算、人工智能(AI)等技术，实现了生产过程的智能化、供应链管理的精准化及决策的科学化。本方案旨在构建一套完善的数字化供应链架构，实现全景管理、全流程贯通、智慧化升级，以数据为驱动，强化技术支撑与安全管理体系，推动企业向智能制造迈进。一、数字化供应链架构1.**集成化平台构
日记——我的歌单静若小猴
又到一年一度大数据汇总的时候了，听歌已经成为很多人生活里的一种乐趣。春夏秋冬，我们都有自己喜欢的歌，歌词歌曲唱出沃尔玛你的心声。还记得大学时候最喜欢听的《春天里》，我有一天单曲回放了30遍，总觉得听着仿佛看到自己声音。还有的歌，初听不知曲中意，再听已经是曲终人，听着歌流泪，听着歌入睡……还记得那些年少的故事吗，总觉得自己才是故事外的人，却不是自己已经入歌。一段时间会喜欢一个人的音乐，一段时间会沉静
Linux dmesg命令：显示开机信息 fafadsj666 linux 数据库数据挖掘机器学习大数据
通过学习《Linux启动管理》一章可以知道，在系统启动过程中，内核还会进行一次系统检测（第一次是BIOS进行加测），但是检测的过程不是没有显示在屏幕上，就是会快速的在屏幕上一闪而过那么，如果开机时来不及查看相关信息，我们是否可以在开机后查看呢？答案是肯定的，使用dmesg命令就可以。无论是系统启动过程中，还是系统运行过程中，只要是内核产生的信息，都会被存储在系统缓冲区中，已经为大家精心准备了大数据
大数据新视界 --大数据大厂之揭秘大数据时代 Excel 魔法：大厂数据分析师进阶秘籍青云交大数据新视界 Excel 数据分析函数公式数据透视表图表功能规划求解数据分析工具库大数据新视界数据库
亲爱的朋友们，热烈欢迎你们来到青云交的博客！能与你们在此邂逅，我满心欢喜，深感无比荣幸。在这个瞬息万变的时代，我们每个人都在苦苦追寻一处能让心灵安然栖息的港湾。而我的博客，正是这样一个温暖美好的所在。在这里，你们不仅能够收获既富有趣味又极为实用的内容知识，还可以毫无拘束地畅所欲言，尽情分享自己独特的见解。我真诚地期待着你们的到来，愿我们能在这片小小的天地里共同成长，共同进步。本博客的精华专栏：Ja
大数据新视界 --大数据大厂之数据挖掘入门：用 R 语言开启数据宝藏的探索之旅青云交大数据新视界数据库大数据数据挖掘 R 语言算法案例未来趋势应用场景学习建议大数据新视界
亲爱的朋友们，热烈欢迎你们来到青云交的博客！能与你们在此邂逅，我满心欢喜，深感无比荣幸。在这个瞬息万变的时代，我们每个人都在苦苦追寻一处能让心灵安然栖息的港湾。而我的博客，正是这样一个温暖美好的所在。在这里，你们不仅能够收获既富有趣味又极为实用的内容知识，还可以毫无拘束地畅所欲言，尽情分享自己独特的见解。我真诚地期待着你们的到来，愿我们能在这片小小的天地里共同成长，共同进步。本博客的精华专栏：Ja
高职人工智能训练师边缘计算实训室解决方案武汉唯众智创人工智能训练师边缘计算实训室人工智能训练师实训室边缘计算实训室
一、引言随着物联网（IoT）、大数据、人工智能（AI）等技术的飞速发展，计算需求日益复杂和多样化。传统的云计算模式虽在一定程度上满足了这些需求，但在处理海量数据、保障实时性与安全性、提升计算效率等方面仍面临诸多挑战。在此背景下，边缘计算作为一种新兴的计算模式应运而生，通过将计算能力推向数据生成或用户所在的网络边缘，显著降低了数据传输的延迟，提升了处理效率，并增强了数据安全性。针对高等职业院校的人工
python基于django/flask的NBA球员大数据分析与可视化python+java+node.js QQ_511008285 python django flask java spring boot 数据分析
前端开发框架:vue.js数据库mysql版本不限后端语言框架支持：1java(SSM/springboot)-idea/eclipse2.Nodejs+Vue.js-vscode3.python(flask/django)--pycharm/vscode4.php(thinkphp/laravel)-hbuilderx数据库工具：Navicat/SQLyog等都可以本文针对NBA球员的大数据进行
Java基于spring boot的国产电影数据分析与可视化python+java+node.js QQ_511008285 java spring boot 数据分析 python django vue.js flask
前端开发框架:vue.js数据库mysql版本不限后端语言框架支持：1java(SSM/springboot)-idea/eclipse2.Nodejs+Vue.js-vscode3.python(flask/django)--pycharm/vscode4.php(thinkphp/laravel)-hbuilderx数据库工具：Navicat/SQLyog等都可以该系统使用进行大数据处理和
数字化（电子化）招标采购平台系统核心功能详细介绍 xinyuan_123456 oracle
数智化招标采购平台覆盖全业务类型、全采购流程、全采购方式，是郑州信源公司运用“互联网+”、大数据、人工智能、区块链、物联网等新兴技术，结合供应链管理理念，以招标采购为核心，提供交易、管理、数据、服务、监管为一体的高标准采购管理平台，赋能政企用户实现采购业务全流程的电子化、数字化、智慧化。根据产品功能及应用领域，产品包括：企业数智化招采供应链平台、金融数智化招采平台、政府数智化采购平台、公共资源数智
windows下源码安装golang 616050468 golang安装 golang环境 windows
系统： 64位win7，开发环境：sublime text 2， go版本： 1.4.1 1. 安装前准备(gcc, gdb, git) golang在64位系
redis批量删除带空格的key bylijinnan redis
redis批量删除的通常做法： redis-cli keys "blacklist*" | xargs redis-cli del 上面的命令在key的前后没有空格时是可以的，但有空格就不行了： $redis-cli keys "blacklist*" 1) "blacklist:12: [email protected]
oracle正则表达式的用法 0624chenhong oracle 正则表达式
方括号表达示方括号表达式描述 [[:alnum:]] 字母和数字混合的字符 [[:alpha:]] 字母字符 [[:cntrl:]] 控制字符 [[:digit:]] 数字字符 [[:graph:]] 图像字符 [[:lower:]] 小写字母字符 [[:print:]] 打印字符 [[:punct：]] 标点符号字符 [[:space:]]
2048源码(核心算法有，缺少几个anctionbar，以后补上) 不懂事的小屁孩 2048
2048游戏基本上有四部分组成， 1：主activity，包含游戏块的16个方格，上面统计分数的模块 2：底下的gridview，监听上下左右的滑动，进行事件处理， 3：每一个卡片，里面的内容很简单，只有一个text，记录显示的数字 4：Actionbar，是游戏用重新开始，设置等功能(这个在底下可以下载的代码里面还没有实现) 写代码的流程 1：设计游戏的布局，基本是两块，上面是分
jquery内部链式调用机理换个号韩国红果果 JavaScript jquery
只需要在调用该对象合适(比如下列的setStyles)的方法后让该方法返回该对象（通过this 因为一旦一个函数称为一个对象方法的话那么在这个方法内部this（结合下面的setStyles）指向这个对象） function create(type){ var element=document.createElement(type); //this=element;
你订酒店时的每一次点击背后都是NoSQL和云计算蓝儿唯美 NoSQL
全球最大的在线旅游公司Expedia旗下的酒店预订公司，它运营着89个网站，跨越68个国家，三年前开始实验公有云，以求让客户在预订网站上查询假期酒店时得到更快的信息获取体验。云端本身是用于驱动网站的部分小功能的，如搜索框的自动推荐功能，还能保证处理Hotels.com服务的季节性需求高峰整体储能。 Hotels.com的首席技术官Thierry Bedos上个月在伦敦参加“2015 Clou
java笔记1 a-john java
1，面向对象程序设计（Object-oriented Propramming，OOP）：java就是一种面向对象程序设计。 2，对象：我们将问题空间中的元素及其在解空间中的表示称为“对象”。简单来说，对象是某个类型的实例。比如狗是一个类型，哈士奇可以是狗的一个实例，也就是对象。 3，面向对象程序设计方式的特性： 3.1 万物皆为对象。
C语言 sizeof和strlen之间的那些事 C/C++软件开发求职面试题必备考点（一） aijuans C/C++求职面试必备考点
找工作在即，以后决定每天至少写一个知识点，主要是记录，逼迫自己动手、总结加深印象。当然如果能有一言半语让他人收益，后学幸运之至也。如有错误，还希望大家帮忙指出来。感激不尽。后学保证每个写出来的结果都是自己在电脑上亲自跑过的，咱人笨，以前学的也半吊子。很多时候只能靠运行出来的结果再反过来
程序员写代码时就不要管需求了吗？ asia007 程序员不能一味跟需求走
编程也有2年了，刚开始不懂的什么都跟需求走，需求是怎样就用代码实现就行，也不管这个需求是否合理，是否为较好的用户体验。当然刚开始编程都会这样，但是如果有了2年以上的工作经验的程序员只知道一味写代码，而不在写的过程中思考一下这个需求是否合理，那么，我想这个程序员就只能一辈写敲敲代码了。我的技术不是很好，但是就不代
Activity的四种启动模式百合不是茶 android 栈模式启动 Activity的标准模式启动栈顶模式启动单例模式启动
android界面的操作就是很多个activity之间的切换,启动模式决定启动的activity的生命周期 ; 启动模式xml中配置 <activity android:name=".MainActivity" android:launchMode="standard&quo
Spring中@Autowired标签与@Resource标签的区别 bijian1013 java spring @Resource @Autowired @Qualifier
Spring不但支持自己定义的@Autowired注解，还支持由JSR-250规范定义的几个注解，如：@Resource、 @PostConstruct及@PreDestroy。 1. @Autowired @Autowired是Spring 提供的，需导入 Package:org.springframewo
Changes Between SOAP 1.1 and SOAP 1.2 sunjing Changes Enable SOAP 1.1 SOAP 1.2
JAX-WS SOAP Version 1.2 Part 0: Primer (Second Edition) SOAP Version 1.2 Part 1: Messaging Framework (Second Edition) SOAP Version 1.2 Part 2: Adjuncts (Second Edition) Which style of WSDL
【Hadoop二】Hadoop常用命令 bit1129 hadoop
以Hadoop运行Hadoop自带的wordcount为例， hadoop脚本位于/home/hadoop/hadoop-2.5.2/bin/hadoop，需要说明的是，这些命令的使用必须在Hadoop已经运行的情况下才能执行 Hadoop HDFS相关命令 hadoop fs -ls 列出HDFS文件系统的第一级文件和第一级
java异常处理（初级）白糖_ java DAO spring 虚拟机 Ajax
从学习到现在从事java开发一年多了，个人觉得对java只了解皮毛，很多东西都是用到再去慢慢学习，编程真的是一项艺术，要完成一段好的代码，需要懂得很多。最近项目经理让我负责一个组件开发，框架都由自己搭建，最让我头疼的是异常处理，我看了一些网上的源码，发现他们对异常的处理不是很重视，研究了很久都没有找到很好的解决方案。后来有幸看到一个200W美元的项目部分源码，通过他们对异常处理的解决方案，我终
记录整理-工作问题 braveCS 工作
1）那位同学还是CSV文件默认Excel打开看不到全部结果。以为是没写进去。同学甲说文件应该不分大小。后来log一下原来是有写进去。只是Excel有行数限制。那位同学进步好快啊。 2）今天同学说写文件的时候提示jvm的内存溢出。我马上反应说那就改一下jvm的内存大小。同学说改用分批处理了。果然想问题还是有局限性。改jvm内存大小只能暂时地解决问题，以后要是写更大的文件还是得改内存。想问题要长远啊
org.apache.tools.zip实现文件的压缩和解压，支持中文 bylijinnan apache
刚开始用java.util.Zip，发现不支持中文（网上有修改的方法，但比较麻烦）后改用org.apache.tools.zip org.apache.tools.zip的使用网上有更简单的例子下面的程序根据实际需求，实现了压缩指定目录下指定文件的方法 import java.io.BufferedReader; import java.io.BufferedWrit
读书笔记-4 chengxuyuancsdn 读书笔记
1、JSTL 核心标签库标签 2、避免SQL注入 3、字符串逆转方法 4、字符串比较compareTo 5、字符串替换replace 6、分拆字符串 1、JSTL 核心标签库标签共有13个，学习资料：http://www.cnblogs.com/lihuiyy/archive/2012/02/24/2366806.html 功能上分为4类： (1)表达式控制标签：out
[物理与电子]半导体教材的一个小问题 comsci 问题
各种模拟电子和数字电子教材中都有这个词汇-空穴书中对这个词汇的解释是; 当电子脱离共价键的束缚成为自由电子之后,共价键中就留下一个空位,这个空位叫做空穴我现在回过头翻大学时候的教材,觉得这个
Flashback Database --闪回数据库 daizj oracle 闪回数据库
Flashback 技术是以Undo segment中的内容为基础的，因此受限于UNDO_RETENTON参数。要使用flashback 的特性，必须启用自动撤销管理表空间。在Oracle 10g中， Flash back家族分为以下成员： Flashback Database， Flashback Drop，Flashback Query(分Flashback Query,Flashbac
简单排序:插入排序 dieslrae 插入排序
public void insertSort(int[] array){ int temp; for(int i=1;i<array.length;i++){ temp = array[i]; for(int k=i-1;k>=0;k--)
C语言学习六指针小示例、一维数组名含义，定义一个函数输出数组的内容 dcj3sjt126com c
# include <stdio.h> int main(void) { int * p; //等价于 int *p 也等价于 int* p; int i = 5; char ch = 'A'; //p = 5; //error //p = &ch; //error //p = ch; //error p = &i; //
centos下php redis扩展的安装配置3种方法 dcj3sjt126com redis
方法一 1.下载php redis扩展包代码如下复制代码 #wget http://redis.googlecode.com/files/redis-2.4.4.tar.gz 2 tar -zxvf 解压压缩包，cd /扩展包（进入扩展包然后运行phpize 一下是我环境中phpize的目录，/usr/local/php/bin/phpize (一定要
线程池(Executors) shuizhaosi888 线程池
在java类库中，任务执行的主要抽象不是Thread，而是Executor，将任务的提交过程和执行过程解耦 public interface Executor { void execute(Runnable command); } public class RunMain implements Executor{ @Override pub
openstack 快速安装笔记 haoningabc openstack
前提是要配置好yum源版本icehouse，操作系统redhat6.5 最简化安装，不要cinder和swift 三个节点 172 control节点keystone glance horizon 173 compute节点nova 173 network节点neutron control /etc/sysctl.conf net.ipv4.ip_forward =
从c面向对象的实现理解c++的对象（二） jimmee C++面向对象虚函数
1. 类就可以看作一个struct，类的方法，可以理解为通过函数指针的方式实现的，类对象分配内存时，只分配成员变量的，函数指针并不需要分配额外的内存保存地址。 2. c++中类的构造函数，就是进行内存分配(malloc)，调用构造函数 3. c++中类的析构函数，就时回收内存(free) 4. c++是基于栈和全局数据分配内存的，如果是一个方法内创建的对象，就直接在栈上分配内存了。专门在
如何让那个一个div可以拖动 lingfeng520240 html
<!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0 Transitional//EN" "http://www.w3.org/TR/xhtml1/DTD/xhtml1-transitional.dtd"> <html xmlns="http://www.w3.org/1999/xhtml
第10章高级事件（中） onestopweb 事件
index.html <!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0 Transitional//EN" "http://www.w3.org/TR/xhtml1/DTD/xhtml1-transitional.dtd"> <html xmlns="http://www.w3.org/
计算两个经纬度之间的距离 roadrunners 计算纬度 LBS 经度距离
要解决这个问题的时候，到网上查了很多方案，最后计算出来的都与百度计算出来的有出入。下面这个公式计算出来的距离和百度计算出来的距离是一致的。 /** * * @param longitudeA * 经度A点 * @param latitudeA * 纬度A点 * @param longitudeB *
最具争议的10个Java话题 tomcat_oracle java
1、Java8已经到来。什么！？ Java8 支持lambda。哇哦，RIP Scala！　　随着Java8 的发布，出现很多关于新发布的Java8是否有潜力干掉Scala的争论，最终的结论是远远没有那么简单。Java8可能已经在Scala的lambda的包围中突围，但Java并非是函数式编程王位的真正觊觎者。　　2、Java 9 即将到来　　 Oracle早在8月份就发布
zoj 3826 Hierarchical Notation(模拟) 阿尔萨斯 rar
题目链接：zoj 3826 Hierarchical Notation 题目大意：给定一些结构体，结构体有value值和key值，Q次询问，输出每个key值对应的value值。解题思路：思路很简单，写个类词法的递归函数，每次将key值映射成一个hash值，用map映射每个key的value起始终止位置，预处理完了查询就很简单了。这题是最后10分钟出的，因为没有考虑value为{}的情

使用spark将hive数据写入elasticsearch或hbase

使用spark将hive数据写入elasticsearch或hbase

将hive或者其他关系型数据库中的数据搬迁到es或hbase

代码

依赖

socket入口：

MyServerThread实现

工具类PropertiesUtil

配置文件config.properties

客户端MyClient测试

执行脚本

你可能感兴趣的:(大数据)