作家
登录

Hive、MapReduce、Spark分布式生成唯一数值型ID

作者: 来源: 2017-04-12 10:21:27 阅读 我要评论

.toString(SEPARATOR)); 
  •             if(parts.length == 6) { 
  •                 if(parts[0].equals(ATTEMPT)) { 
  •                     if(!parts[3].equals("m") && !parts[3].equals("r")) { 
  •                         throw new Exception(); 
  •                     } 
  •                     long result = Long.parseLong(parts[4]); 
  •                     if(result >= numTasks) { //if taskid >= numtasks 
  •                         throw new Exception("TaskAttemptId string : " + taskAttemptIDstr 
  •                                 + "  parse ID [" + result + "] >= numTasks[" + numTasks + "] .."); 
  •                     } 
  •                     return result + 1; 
  •                 } 
  •             } 
  •         } catch (Exception e) {} 
  •         throw new IllegalArgumentException("TaskAttemptId string : " + taskAttemptIDstr 
  •                 + " is not properly formed"); 
  •     } 
  •      
  •   
  • 有一张去重后的用户id(字符串类型)表,须要位每个用户id生成一个独一的数值型seq:

    1. ADD jar file:///tmp/udf.jar; 
    2. CREATE temporary function seq2 as 'com.lxw1234.hive.udf.RowSeq2'
    3.   
    4. hive>> desc lxw_all_ids; 
    5. OK 
    6. id                      string                                       

        推荐阅读

        软件开发人员的编程障碍,你知道多少?

      没有人知足Java开辟人员这种已经“竭尽全力”改变世界的速度,每小我都欲望代码像消防水管里的水一样可以或许源源赓续地流出来,但没有人愿意供给给开辟人员更好地完成工作的前>>>详细阅读


      本文标题:Hive、MapReduce、Spark分布式生成唯一数值型ID

      地址:http://www.17bianji.com/lsqh/34744.html

    关键词: 探索发现

    乐购科技部分新闻及文章转载自互联网,供读者交流和学习,若有涉及作者版权等问题请及时与我们联系,以便更正、删除或按规定办理。感谢所有提供资讯的网站,欢迎各类媒体与乐购科技进行文章共享合作。

    网友点评
    自媒体专栏

    评论

    热度

    精彩导读
    栏目ID=71的表不存在(操作类型=0)