11赞

使用Spark的Graphx中最短路径性能

作者：mobiledu2402851323 | 2023-09-07 16:05

如何解决《使用Spark的Graphx中最短路径性能》经验，为你挑选了0个好方法。

我正在从和类型的gz压缩json文件中创建图形。edgevertices

我已将文件放在此处的保管箱文件夹中

我加载并映射这些json记录以创建所需的vertices和edge类型，graphx如下所示：

val vertices_raw = sqlContext.read.json("path/vertices.json.gz")
val vertices = vertices_raw.rdd.map(row=> ((row.getAs[String]("toid").stripPrefix("osgb").toLong),row.getAs[Long]("index")))
val verticesRDD: RDD[(VertexId, Long)] = vertices
val edges_raw = sqlContext.read.json("path/edges.json.gz")
val edgesRDD = edges_raw.rdd.map(row=>(Edge(row.getAs[String]("positiveNode").stripPrefix("osgb").toLong, row.getAs[String]("negativeNode").stripPrefix("osgb").toLong, row.getAs[Double]("length"))))
val my_graph: Graph[(Long),Double] = Graph.apply(verticesRDD, edgesRDD).partitionBy(PartitionStrategy.RandomVertexCut)

然后，我使用dijkstra发现的这种实现来计算两个顶点之间的最短路径：

def dijkstra[VD](g: Graph[VD, Double], origin: VertexId) = {
          var g2 = g.mapVertices(
        (vid, vd) => (false, if (vid == origin) 0 else Double.MaxValue, List[VertexId]())
          )
          for (i <- 1L to g.vertices.count - 1) {
            val currentVertexId: VertexId = g2.vertices.filter(!_._2._1)
              .fold((0L, (false, Double.MaxValue, List[VertexId]())))(
                (a, b) => if (a._2._2 < b._2._2) a else b)
              ._1

            val newDistances: VertexRDD[(Double, List[VertexId])] =
              g2.aggregateMessages[(Double, List[VertexId])](
            ctx => if (ctx.srcId == currentVertexId) {
              ctx.sendToDst((ctx.srcAttr._2 + ctx.attr, ctx.srcAttr._3 :+ ctx.srcId))
            },
            (a, b) => if (a._1 < b._1) a else b
          )
        g2 = g2.outerJoinVertices(newDistances)((vid, vd, newSum) => {
          val newSumVal = newSum.getOrElse((Double.MaxValue, List[VertexId]()))
          (
            vd._1 || vid == currentVertexId,
            math.min(vd._2, newSumVal._1),
            if (vd._2 < newSumVal._1) vd._3 else newSumVal._2
            )
        })
        }

          g.outerJoinVertices(g2.vertices)((vid, vd, dist) =>
        (vd, dist.getOrElse((false, Double.MaxValue, List[VertexId]()))
          .productIterator.toList.tail
          ))
        }

我采用两个随机顶点ID：

val v1 = 4000000028222916L
val v2 = 4000000031019012L

并计算它们之间的路径：

val results = dijkstra(my_graph, v1).vertices.map(_._2).collect

我无法在笔记本电脑上本地计算此数据，而不会出现stackoverflow错误。我可以看到它正在使用4个可用内核中的3个。我可以加载该图，并igraph使用完全相同的图上的Python库每秒计算最短的10条路径。这是计算路径的低效手段吗？在规模上，将在多个节点上计算路径（无堆栈溢出错误），但每次路径计算仍为30/40秒。

推荐阅读

程序员
Python namedtuple的可变默认参数

如何解决《Pythonnamedtuple的可变默认参数》经验，为你挑选了1个好方法。 ... [详细]
程序员
自定义Firefox Developer开发工具颜色主题

如何解决《自定义FirefoxDeveloper开发工具颜色主题》经验，为你挑选了0个好方法。 ... [详细]
程序员
无论密钥如何,Spark总结值

如何解决《无论密钥如何,Spark总结值》经验，为你挑选了1个好方法。 ... [详细]
程序员
Numpy vectorize错误地将输出转换为整数

如何解决《Numpyvectorize错误地将输出转换为整数》经验，为你挑选了1个好方法。 ... [详细]
程序员
如何解决这种复发T(n)= T(n-1)+ lg(1 + 1/n),T(1)= 1？

如何解决《如何解决这种复发T(n)=T(n-1)+lg(1+1/n),T(1)=1？》经验，为你挑选了1个好方法。 ... [详细]
程序员
全面列表中的两个for循环

如何解决《全面列表中的两个for循环》经验，为你挑选了2个好方法。 ... [详细]
程序员
为什么这个C#函数表现得像我在使用指针？

如何解决《为什么这个C#函数表现得像我在使用指针？》经验，为你挑选了1个好方法。 ... [详细]
程序员
无法在Android中解析方法getContext()

如何解决《无法在Android中解析方法getContext()》经验，为你挑选了1个好方法。 ... [详细]
程序员
不能将脚本名称识别为cmdlet,函数等; 也不能在简单的脚本上找到位置参数

如何解决《不能将脚本名称识别为cmdlet,函数等;也不能在简单的脚本上找到位置参数》经验，为你挑选了1个好方法。 ... [详细]
程序员
显示绝对值angularjs

如何解决《显示绝对值angularjs》经验，为你挑选了2个好方法。 ... [详细]
程序员
仅在函数或构造函数实现中允许参数初始化

如何解决《仅在函数或构造函数实现中允许参数初始化》经验，为你挑选了1个好方法。 ... [详细]
程序员
如果python中的语句没有打印

如何解决《如果python中的语句没有打印》经验，为你挑选了1个好方法。 ... [详细]
程序员
使用原型[javascript]的未定义结果

如何解决《使用原型[javascript]的未定义结果》经验，为你挑选了0个好方法。 ... [详细]
程序员
当我在rubymine中为我的项目添加ruby SDK时出错

如何解决《当我在rubymine中为我的项目添加rubySDK时出错》经验，为你挑选了1个好方法。 ... [详细]
程序员
python 2.7：函数中的'newline'

如何解决《python2.7：函数中的'newline'》经验，为你挑选了1个好方法。 ... [详细]
程序员
在使用gradle编译android库时如何禁止警告？

如何解决《在使用gradle编译android库时如何禁止警告？》经验，为你挑选了1个好方法。 ... [详细]
程序员
为什么Notepad ++中的[[:alpha:]]也匹配中文单词？

如何解决《为什么Notepad++中的[[:alpha:]]也匹配中文单词？》经验，为你挑选了1个好方法。 ... [详细]
程序员
按特定值对python中的JSON进行排序

如何解决《按特定值对python中的JSON进行排序》经验，为你挑选了0个好方法。 ... [详细]
程序员
GitHub：无法加载最新的提交信息

如何解决《GitHub：无法加载最新的提交信息》经验，为你挑选了0个好方法。 ... [详细]
程序员
删除列表中字符串的所有扩展名

如何解决《删除列表中字符串的所有扩展名》经验，为你挑选了0个好方法。 ... [详细]

mobiledu2402851323

这个屌丝很懒，什么也没留下！

关注作者

Tags | 热门标签

RankList | 热门文章