为什么很多编程语言中数组都从0开始编号？

最新推荐文章于 2023-01-15 17:55:18 发布

longerVR

最新推荐文章于 2023-01-15 17:55:18 发布

阅读量443

点赞数

分类专栏：数据结构与算法之美+算法训练营

本文链接：https://blog.csdn.net/qq_41286360/article/details/103273848

版权

数据结构与算法之美+算法训练营专栏收录该内容

37 篇文章 2 订阅

订阅专栏

为什么很多编程语言中数组都从0开始编号？

1.数组如何实现随机访问
2.低效的“插入”和“删除”
- 1 插入操作
- 2 删除操作
3.数组的访问越界问题
4.容器能否完全替代数组
5 数组从0开始编号的原因
6 总结

1.数组如何实现随机访问

1.什么是数组

数组（Array）是一种线性表数据结构。它用一组连续的内存空间，来存储一组具有相同类型的数据。
关键词：
线性表；连续；相同类型

2.线性表

数据和数据之间的关系是1：1；
在这里插入图片描述
与线性表相对立的是：非线性表，比如二叉树，堆，图等。数据之间的关系并不是简单的前后关系，而是1:n

3 连续的内存空间和相同的数据类型

这个特性是数据可以实现随机访问的主要原因；但是插入和删除数据的效率就非常低效；

4 一道面试题

数组和链表的区别？
链表适合插入、删除，时间复杂度 O(1)；
数组支持随机访问，根据下标随机访问的时间复杂度为 O(1)。
不要表述为：数组适合查找，其时间复杂度为O(1).

2.低效的“插入”和“删除”

1 插入操作

假设数组的长度为 n，现在，如果我们需要将一个数据插入到数组中的第 k 个位置。为了把第 k 个位置腾出来，给新来的数据，我们需要将第 k～n 这部分的元素都顺序地往后挪一位。
假设数组的长度为 n，现在，如果我们需要将一个数据插入到数组中的第 k 个位置。为了把第 k 个位置腾出来，给新来的数据，我们需要将第 k～n 这部分的元素都顺序地往后挪一位。

2 删除操作

跟插入数据类似，如果我们要删除第 k 个位置的数据，为了内存的连续性，也需要搬移数据，不然中间就会出现空洞，内存就不连续了。和插入类似，如果删除数组末尾的数据，则最好情况时间复杂度为 O(1)；如果删除开头的数据，则最坏情况时间复杂度为 O(n)；平均情况时间复杂度也为 O(n)。

3.数组的访问越界问题

数组越界在 C 语言中是一种未决行为，并没有规定数组访问越界时编译器应该如何处理。因为，访问数组的本质就是访问一段连续内存，只要数组通过偏移计算得到的内存地址是可用的，那么程序就可能不会报任何错误。有些语言会自己来做越界检查

4.容器能否完全替代数组

容器最大的优势是：可以将很多数组操作的细节封装起来；支持动态扩容；
但是有些场合数组会更适合些：

Java ArrayList 无法存储基本类型，比如 int、long，需要封装为 Integer、Long 类，而 Autoboxing、Unboxing 则有一定的性能消耗，所以如果特别关注性能，或者希望使用基本类型，就可以选用数组
如果数据大小事先已知，并且对数据的操作非常简单，用不到 ArrayList 提供的大部分方法，也可以直接使用数组。
当要表示多维数组时，用数组往往会更加直观。比如 Object[][] array；而用容器的话则需要这样定义：ArrayList > array。我总结一下，

总结如下:

对于业务开发，直接使用容器就足够了，省时省力。毕竟损耗一丢丢性能，完全不会影响到系统整体的性能。但如果你是做一些非常底层的开发，比如开发网络框架，性能的优化需要做到极致，这个时候数组就会优于容器，成为首选。

5 数组从0开始编号的原因

从数组存储的内存模型上来看，“下标”最确切的定义应该是“偏移（offset）”。前面也讲到，如果用 a 来表示数组的首地址，a[0] 就是偏移为 0 的位置，也就是首地址，a[k] 就表示偏移 k 个 type_size 的位置，所以计算 a[k] 的内存地址只需要用这个公式：

a[k]_address = base_address + k * type_size

如果从1开始计数，那我们计算数组元素 a[k] 的内存地址就会变为：


a[k]_address = base_address + (k-1)*type_size

可以看到入宫从 1 开始编号，每次随机访问数组元素都多了一次减法运算，对于 CPU 来说，就是多了一次减法指令。
数组作为非常基础的数据结构，通过下标随机访问数组元素又是其非常基础的编程操作，效率的优化就要尽可能做到极致。所以为了减少一次减法操作，数组选择了从 0 开始编号，而不是从 1 开始。

6 总结

数组用一块连续的内存空间，来存储相同类型的一组数据，最大的特点就是支持随机访问，但插入、删除操作也因此变得比较低效，平均情况时间复杂度为 O(n)。在平时的业务开发中，我们可以直接使用编程语言提供的容器类，但是，如果是特别底层的开发，直接使用数组可能会更合适。

longerVR

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

专栏目录