数据结构与算法笔记:高级篇 - 最短路径:地图软件是如何计算出最优出行路径的?

news2024/9/21 0:41:27

概述

基础篇的时候,我们学习了图的两种搜索算法,深度优先搜索和广度优先搜索。这两种算法主要是针对无权图的搜索算法。针对有权图,也就是图中的每一条变都有一个权重,我们该如何计算两点之间的最短路径(经过的边的权重和最小)呢?本章,我们就从地图软件的路线规划问题讲起,带你看看常用的最短距离 算法(Shortest Path Algorithm)。

像 Google 地图、百度地图 这样的地图软件,我想你应该经常使用吧?如果想从家开到公司,你只需要输入起始、结束地址,地图就会给你规划一条最优出行线路。这里的最优,有很多种定义,比如最短路线、最少用时路线、最少红绿灯路线等。作为一名软件开发工程师,你是否思考过,地图的最优路线是如何计算出来的吗?底层依赖了什么算法呢?

算法解析

刚刚提到的最优问题包含三个:最短路线、最少用时和最少红绿灯。先解决最简单的,最短路线。

解决软件开发中的实际问题,最重要的一点就是建模,也就是将复杂的场景抽象成具体的数据结构。针对这个问题,我们该如何抽象成数据结构呢?

之前提到过,图这种数据结构的表达能力很强,显然,把地图抽象成图最合适不过了。我们把每个岔路口看做一个顶点,岔路口与岔路口之间的的路看做一条边,路的长度就是权重。如果路是单行道,我们就在两点之间画一条有向边;如果是双行道,我们就在两个顶点画两条方向不同的边。这样,整个地图就被抽象成一个有向带权图。

具体的代码实现,放在了下面。于是,我们要求解的问题,在一个有向带权图中,求两个顶点的最短路径。

public class Graph { // 有向带权图的邻接表表示
    private int v; // 顶点个数
    private LinkedList<Edge> adj[]; // 邻接表

    public Graph(int v) {
        this.v = v;
        adj = new LinkedList[v];
        for (int i = 0; i < adj.length; i++) {
            adj[i] = new LinkedList<>();
        }
    }
    
    public void addEdge(int s, int t, int w) { // 添加一条边
        adj[s].add(new Edge(s, t, w));
    }
    
    private class Edge {
    	public int sid; // 边的起始顶点编号
    	public int tid; // 边的终止顶点编号
    	public int w; // 权重
    	
    	public Edge(int sid, int tid, int w) {
    		this.sid = sid;
    		this.tid = tid;
    		this.w= w;
    	}
    }
    
    // 下面这个是为了dijkstra实现用的
    private class Vertex {
        public int id; // 顶点编号
        public int dist; // 从起始顶点到这个顶点的距离

        public Vertex(int id, int dist) {
            this.id = id;
            this.dist = dist;
        }
    }
}

要想解决这个问题,有一个非常经典的算法,最短路径算法,更加准确的说,是单源最短路径算法(一个顶点到另一个顶点)。提到最短路径算法,最出名的莫过于 Dijkstra 算法了。所以,我们现在来看,Dijkstra 算法是如何工作的。

这个算法的原理稍微有点复杂,单纯的文字描述,不是很好懂。所以,还是结合代码来讲解。

    public void dijkstra(int s, int t) { // 从顶点s到顶点t的最短路径
        int[] predecessor = new int[this.v]; // 用来还原最短路径
        Vertex[] vertexes = new Vertex[this.v];
        for (int i = 0; i < this.v; i++) {
            vertexes[i] = new Vertex(i, Integer.MAX_VALUE);
        }
        PriorityQueue queue = new PriorityQueue(this.v); //小顶堆
        boolean[] inQueue = new boolean[this.v]; // 标记是否进入过队列
        vertexes[s].dist = 0;
        queue.add(vertexes[s]);
        inQueue[s] = true;
        while (!queue.isEmpty()) {
            Vertex minVertex = queue.poll(); // 获取对顶元素并删除
            if (minVertex.id == t) break; // 最短路径产生了
            for (int i = 0; i < adj[minVertex.id].size(); i++) {
                Edge e = adj[minVertex.id].get(i); // 取出一条minVertex相连的边
                Vertex nextVertex = vertexes[e.tid]; // minVertex->nextVertex
                if (minVertex.dist + e.w < nextVertex.dist) { // 更新next的dist
                    nextVertex.dist = minVertex.dist + e.w;
                    predecessor[nextVertex.id] = minVertex.id;
                    if (inQueue[nextVertex.id] == true) {
                        queue.update(nextVertex); // 更新队列中的dist
                    } else {
                        queue.add(nextVertex);
                        inQueue[nextVertex.id] = true;
                    }
                }
            }
        }
        // 输出最短路径
        System.out.print(s);
        print(s, t, predecessor);
    }

    private void print(int s, int t, int[] predecessor) {
        if (s == t) return;
        print(s, predecessor[s], predecessor);
        System.out.print("->" + t);
    }

    // 因为Java提供的优先级队列,没有暴露更新数据的接口,所以,需要重新数显一个
    private class PriorityQueue { //根据Vertex.dist构建小顶堆
        private Vertex[] nodes;
        private int count;

        public PriorityQueue(int v) {
            this.nodes = new Vertex[v];
            this.count = v;
        }
        public Vertex poll() { /**留给你去实现*/ }
        public void add(Vertex vertex) { /**留给你去实现*/ }
        // 更新节点的值,并且从下往上堆化,更新符合堆顶定义。时间复杂度O(logn)
        public void update(Vertex vertex) { /**留给你去实现*/ }
        public boolean isEmpty() { /**留给你去实现*/ }
    }

我们用 Vertex 数组,记录从起始顶点到每个顶点的距离(dist)。起初,我们把所有顶点的 dist 都初始化为无穷大。我们把其实顶点的 dist 值初始化为 0,然后将其放到优先级队列中。

我们从优先级队列中取出 dist 最小的顶点 minVertex,然后考察这个顶点可达的所有顶点(代码中的 nextVertex)。如果 minVertex 的 dist 加上 minVertex 与 nextVertex 之间边的权重小于 nextVertex 当前的 dist 值,也就是说,存在一条更短的路径,它经过 minVertex 到达 nextVertex。那我们就把 nextVertex 的 dist 更新为 minVertex 的 dist 加上 w。然后,我们把 nextVertex 加入到优先级队列中。重复这个过程,直到找到终止顶点或者队列为空。

以上就是 Dijkstra 算法的核心逻辑。此外,代码中还有两个额外的变量,predecessor 和 inQueue 数组。

  • predecessor 是为了还原最短路径,它记录每个顶点的前驱顶点。最后,我们通过递归的方式,将这个路径打印出来。
  • inQueue 数组是为了避免将一个顶点多次添加到优先队列中。我们更新了某个顶点的 dist 值之后,如果这个顶点已经在优先级队列中了,就不要再将它重复添加进去。

在这里插入图片描述
理解了 Dijkstra 算法,Dijkstra 算法的时间复杂度是多少呢?

在刚刚的代码中,最复杂的就是 while 循环嵌套 for 循环那部分代码了。while 循环最多会执行 V 次(V 表示顶点的个数),而内部的 for 循环的执行次数不确定,跟每个顶点的相邻边的个数有关,我们分别记作 E0,E1,E02, …, E(V-1)。如果我们把这 V 个顶点的边都加起来,最大也不会超过图中所有边的个数 E(E 表示边的个数)。

for 循环内部的代码设计优先级队列取数据、往优先级队列中添加数据、更新优先级队列中的数据,这样三个主要的操作。我们知道,优先级队列是用堆来实现的,堆中的这几个操作,时间复杂度都是 O ( l o g V ) O(logV) O(logV) (堆中元素的个数不会超过顶点的个数 V)。

所以,综合这两部分,再利用乘法规则,整个代码的时间复杂度就是 O ( E ∗ l o g V ) O(E * logV) O(ElogV)

弄懂了 Dijkstra 算法,我们再来回答之前的问题,如何计算出最优出行路线?

从理论上讲,用 Dijkstra 算法可以计算两点之间的最短路径。但是,你有没有想过,对于超级大地图来说,岔路口、道路非常多,对应到图这种数据结构来说,就有非常多的顶点和边。如果为了计算两点之间的最短距离,在一个超级大的地图上动用 Dijkstra 算法,遍历所有的顶点和边,显然会非常耗时。那我们有没有什么优化的方法呢?

做工程不像做理论,一定要给出最优解。理论上算法再好,如果执行效率太低,也无法应用到实际的工程中。对于软件开发工程师来说,我们经常要根据问题的实际背景,对解决方案权衡取舍。类似出行路线这种工程上的问题,我们没有必要非得求出绝对最优解。很多时候,为了兼顾执行效率,我们只需要计算出一个可行的次优解就可以了。

有了这个原则,你能想出刚刚那个问题的优化方案吗?

虽然地图很大,但是两点之间的最短路径或者说比较好的出行路径,并不会很 “发散”,只会出现在两个点之间和两点附近的区块内。所以我们可以在整个大地图上,画出一个小的区域,这个小区块恰好可以覆盖住两个点,但又不会很大。我们只需要在这个小区块内部运行 Dijkstra 算法,这样就可以避免遍历整个大图,也就大大提高了执行效率。

不过,你可能会说,如果两点距离比较远,从北京海定区某个地点,到上海浦东的某个地点,那上面的这种处理方法,显然就不能工作了,比较覆盖北京和上海的区块并不小。

我给你点提示,你可以现在打开地图 APP,缩小放大一下地图,看下地图上的路线有什么变化,然后再思考,这个问题该怎么解决。

对于这样两点之间距离较远的路线规划,我们可以把背景海淀区看作一个顶点,把上海浦东看作一个顶点,先规划大的出行路线。比如,如何从北京到上海,必须要经过某几个顶点,或者几条干道,然后再细化每个结点的路线。

这样,最短路径问题就解决了。我们再来看另外两个问题,最少时间和最少红绿灯。

前面讲最短路径的时候,每条边的权重是路的长度。在计算最少时间的时候,算法还是不变的,我们只需要把权重,从路的长度编程经过这段路所需的时间。不过,这个时间会根据拥堵情况时刻变化。如何计算车通过一段路的时间呢?这是一个蛮有意思的问题,你可以自己思考下。

每经过一条边,就要经过一个红绿灯。关于最少红绿灯的出现方案,实际上,我们只需要把每条边的权值改为 1 即可,算法还是不变,可以继续使用前面讲的 Dijkstra 算法。不过,边的权值为 1,也就相当于无权图了,我们还可以使用之前讲过的广度优先搜索算法。因为广度优先搜索算法计算出来的两点之间的路径,就是两点的最短路径。

不过,这里给出的方案都非常粗糙,只是为了给你展示,如何结合实际的场景,灵活地应用算法,让算法为我们所用,真实的地图软件的路径规划,要比这个复杂很多。而且,比如 Dijkstra 算法,地图软件用的更多的是类似 A* 的启发式搜索算法,不过它也是在 Dijkstra 算法上的优化罢了。

总结引申

本章,我们学习了一种非常重要的图算法,Dijkstra 最短路径算法。实际上,最短路径算法还有很多,比如 Bellford 算法、Floyd 算法等等。如果感兴趣,你可以自己去研究。

关于 Dijkstra 算法,只讲了原理和代码实现。对于正确性,并没有去证明。之所以这么做是因为证明过程设计比较复杂度的数学推导。这个并不是我们的重点,你只要掌握这个算法的思路就可以了。

这些算法实现思路非常经典,掌握了这些思路,我们可以拿来指导、解决其他问题。比如 Dijkstra 这个算法的核心思想,就可以拿来解决下面这个看似完全不相关的问题。这个问题我之前遇到的真实问题,为了在较短的篇幅里把问题介绍情况,我对背景做了一些简化。

我们有一个翻译系统,只能针对单个单词来做翻译。如果要翻译一整个句子,我们需要将句子拆成一个一个的单词,再丢给翻译系统。针对每个单词,翻译系统会返回一组可选的翻译列表,并且针对每个翻译打一个分,表示这个翻译的可信程度。

在这里插入图片描述

针对每个单词,我们从可选列表中,选择其中一个翻译,组合起来就是整个句子的翻译。每个单词的翻译的得分之和,就是整个句子的翻译得分。随意搭配单词的翻译,会得到一个句子的不同翻译。针对整个句子,我们希望计算出得分最高的前 k 个翻译结果,你会怎么编程来实现呢?

在这里插入图片描述

当然,最简单的办法就是回溯算法,穷举所有可能得组合情况,然后选出得分最高的前 k 个翻译结果。但是,这样做的时间复杂度会比较高,是 O ( n m ) O(n^m) O(nm)。其中,m 表示平均每个单词的可选翻译个数,n 表示一个句子中包含多少个单词。这个解决方案,你可以当做回溯算法的练习题,自己编程实现一下,我就不多说了。

实际上,这个问题可以借助 Dijkstra 算法的核心思想,非常高效地解决。每个单词的可选翻译是按照分数从大到小排列的,所以 a 0 b 0 c 0 a_0b_0c_0 a0b0c0 肯定是得分最高的组合结果。我们把 a 0 b 0 c 0 a_0b_0c_0 a0b0c0 及得分作为一个对象,放入到优先级队列中。

我们每次从优先级队列中取出一个得分最高的组合,并基于这个组合进行扩展。扩展的策略是每个单词的翻译分别替换成下一个单词的翻译。比如 a 0 b 0 c 0 a_0b_0c_0 a0b0c0 扩展后,会得到三个组合 a 1 b 0 c 0 a_1b_0c_0 a1b0c0 a 0 b 1 c 0 a_0b_1c_0 a0b1c0 a 0 b 0 c 1 a_0b_0c_1 a0b0c1。我们把扩展之后的组合,加到优先级队列中。重复这个过程,直到获取到 k 个翻译组合或者队列为空。

在这里插入图片描述

我们来看看这种实现思路的复杂度是多少的?

假设句子包含 n 个单词,每个单词平均有 m 个可选的翻译,求得分最高的前 k 个组合结果。每次一个组合出队,就对应着一个组合结果,我们希望得到 k 个,那就对应着 k 次出队操作。每次有一个组合队列出队,就有 n 个组合入队。优先级队列中出队和入队的时间复杂度都是 O ( l o g x ) O(logx) O(logx),x 表示队列中组合的个数。所以,总的时间复杂度就是 O ( k ∗ n ∗ l o g x ) O(k * n * logx) O(knlogx)。那 x 到底是多少呢?

k 次出入队列,队列中的总数不过超过 k*n,也就是说,出队、入队操作的时间复杂度是 O ( l o g ( k ∗ n ) ) O(log(k * n)) O(log(kn))。所以,总的时间复杂度就是 O ( k ∗ n ∗ l o g ( k ∗ n ) ) O(k*n*log(k*n)) O(knlog(kn)),比之前指数级时间复杂度降低了很多。

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.coloradmin.cn/o/1858303.html

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈,一经查实,立即删除!

相关文章

ViT:3 Compact Architecture

大模型技术论文不断&#xff0c;每个月总会新增上千篇。本专栏精选论文重点解读&#xff0c;主题还是围绕着行业实践和工程量产。若在某个环节出现卡点&#xff0c;可以回到大模型必备腔调或者LLM背后的基础模型重新阅读。而最新科技&#xff08;Mamba,xLSTM,KAN&#xff09;则…

VMware共享文件夹设置

1、VMWare设置 1&#xff09;虚拟机 -> 设置 2&#xff09;点击 选项 -> 共享文件夹 -> 设置为 总是启用 -> 并 添加一个本地共享文件夹。设置完毕&#xff0c;点击 确定。 2、创建共享文件夹、挂载 1&#xff09;打开终端&#xff0c;在mnt/目录下创建一个名为…

原Veritas(华睿泰)中国研发中心敏捷教练、项目集经理郑鹤琳受邀为第十三届中国PMO大会演讲嘉宾

全国PMO专业人士年度盛会 原Veritas&#xff08;华睿泰中国&#xff09;中国研发中心敏捷教练、项目集经理郑鹤琳女士受邀为PMO评论主办的2024第十三届中国PMO大会演讲嘉宾&#xff0c;演讲议题为“敏捷项目管理-知行合一”。大会将于6月29-30日在北京举办&#xff0c;敬请关注…

So:万法皆空,唯因果不空

在《long long ago》中&#xff0c;我们说到long一词中藏着因果关系&#xff0c;long通汉字“以”字。long是生育过程中&#xff0c;婴儿已经呱呱坠地&#xff0c;但尚未剪掉脐带的形象。 下面我们来解剖另一个英语单词&#xff1a;so。 一、so&#xff1a;万法皆空&#xff…

前端vue-cli相关知识与搭建过程(项目创建,组件路由)very 详细

一.关于vue-cli 1.什么是vue Vue (读音 /vju ː /&#xff0c;类似于 view) 是一套用于构建用户界面的渐进式框架。Vue 的核心库只关注视图层&#xff0c;不仅易于上手&#xff0c;还便于与第三方库或既有项目整合。 Vue.js 是前端的主流框架之一&#xff0c;和 Angular.js…

【大数据】Hadoop学习笔记

基本概念 Hadoop组成 HDFS: Hadoop分布式文件存储系统, 在Haddop中处于底层/核心地位YARN: 分布式通用的集群资源管理系统和任务调度平台, 支撑各种计算引擎执行MapReduce: 第一代分布式计算引擎, 但因为部分原因, 许多企业都不直接使用MapReduce, 但许多底层软件仍然在使用Ma…

v-jstools插件 - 自动补环境

一、为啥要补环境&#xff1f; 我们每次逆向扣完代码存放在 nodejs 上是运行不出结果的&#xff0c;因为缺少浏览器环境特有的一些 window/document/navigator/localstorage 等参数&#xff0c;所以我们需要把这些缺少的浏览器环境补上&#xff0c;让这份js代码在本地nodejs环…

无人机巡检小羊仿真

详细视频地址 仿真效果 可视化三维仿真 gazebo物理仿真 px4 飞控仿真 仿qgc简易地面站 详细视频地址

每日一题——Python代码实现PAT甲级1059 Prime Factors(举一反三+思想解读+逐步优化)五千字好文

一个认为一切根源都是“自己不够强”的INTJ 个人主页&#xff1a;用哲学编程-CSDN博客专栏&#xff1a;每日一题——举一反三Python编程学习Python内置函数 Python-3.12.0文档解读 目录 我的写法 代码点评 时间复杂度分析 空间复杂度分析 改进建议 我要更强 时间复杂度…

渗透测试基础(六) MS10-046漏洞攻击

1. 漏洞介绍 1.1 漏洞介绍 Microsoft Windows快捷方式LNK文件自动执行代码漏洞。Windows支持使用快捷方式或LNK文件。LNK文件是指向本地文件的引用,点击LNK文件与点击快捷方式所制定的目标具有相同效果。Windows没有正确的处理LNK文件,特制的LNK文件可能导致Windows自动执行…

【Day02】0基础微信小程序入门-学习笔记

文章目录 模板与配置学习目标WXML 模板语法1.数据绑定&#xff08;类似于 Vue2 &#xff09;2. 事件绑定3. 条件渲染4.列表渲染 WXSS模板样式1. rpx尺寸单位2.样式导入3. 全局样式和局部样式 全局配置1. window2. tabBar 页面配置网络数据请求总结 持续更新~ 模板与配置 学习目…

数据挖掘常见算法(聚类)

划分方法 K-均值算法(K-means算法) 方法: 首先选择K个随机的点,称为聚类中心.对于数据集中的,每一个数据,按照距离K个中心点的距离,将其与距离最近的中心点关联起来,与同一个中心点关联的所有点聚成一类.计算每一个组的平均值,将改组所关联的中心点移动到平均值的位置重复2~…

6. Revit API UI: PreviewControl(预览控件)

6. Revit API UI: PreviewControl&#xff08;预览&#xff09; PreviewControl 有时我们需要一个预览功能&#xff0c;而Revit也提供了一个PreviewControl类来帮助我们实现这个功能。 从类的继承关系来看&#xff0c;PreviewControl就是一个用户自定义控件&#xff0c;它就…

板凳--------第20章-信号:基本概念1

tlpi_hdr.h头文件使用及设置 liao__ran 于 2020-09-29 15:12:01 发布 阅读量1.6k 收藏 5 点赞数 1 分类专栏&#xff1a; linux系统编程手册 版权 linux系统编程手册 专栏收录该内容 7 篇文章 1 订阅 订阅专栏 使用的头文件&#xff0c;主要如下&#xff1a; ename.c.inc erro…

【文字+视频教程】在手机上用文生软件平台CodeFlying开发一个整蛊版《Flappy Bird》

前言&#xff1a; 在之前的文章中我们介绍了国内首家文生软件平台码上飞CodeFlying&#xff0c;并且教给了大家如何用它来开发复杂的项目信息管理系统以及恶搞拼图小游戏等。今天就继续给大家带来一起用码上飞开发整蛊版《Flappy Bird》小游戏的教程。 老规矩&#xff0c;咱还…

024.两两交换链表中的节点,用递归和 while 循环

题意 给你一个链表&#xff0c;两两交换其中相邻的节点&#xff0c;并返回交换后链表的头节点。你必须在不修改节点内部的值的情况下完成本题&#xff08;即&#xff0c;只能进行节点交换&#xff09;。 难度 中等 示例 输入&#xff1a;head [1,2,3,4] 输出&#xff1a;[…

嵌入式系统中C/C++有仓颉语言对比分析

大家好,今天给大家分享一下,如何使用仓颉,以及优势在哪里? 在 2024 年 6 月 21 日的华为开发者大会上,华为不仅官宣了下一代鸿蒙操作系统 HarmonyOS NEXT,而且还正式推出了自研的编程语言 仓颉 ,可谓是赚足了面子,遥遥领先! 值得一提的是,HarmonyOS NEXT 是华为从内到…

数据库管理系统(DBMS)

一.数据库管理系统 1.简介 数据库管理系统(Database Management System)是一种操纵和管理数据库的大型软件&#xff0c;用于建立、使用和维护数据库&#xff0c;简称DBMS。它对数据库进行统一的管理和控制&#xff0c;以保证数据库的安全性和完整性。用户通过DBMS访问数据库中…

无线麦克风哪个品牌音质最好,一文告诉你无线领夹麦克风怎么挑选

随着直播带货和个人视频日志&#xff08;Vlog&#xff09;文化的兴起&#xff0c;以及自媒体内容创作的蓬勃发展&#xff0c;我们见证了麦克风行业的迅猛发展。在这一浪潮中&#xff0c;无线领夹麦克风以其无与伦比的便携性和操作效率&#xff0c;迅速赢得了广大视频制作者的喜…

WPF——属性

一、属性 类最初只有字段与函数&#xff0c;字段为一个变量&#xff0c;访问权限可以是private&#xff0c;protected&#xff0c;public。而将字段设为private&#xff0c;不方便外界对类数据的操作&#xff0c;但是将字段设为public又怕外界对数据进行非法操作&#xff0c;于…