百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 技术分析 > 正文

解密Protobuf:高效数据传输的秘密武器

liebian365 2024-10-24 14:38 8 浏览 0 评论

简介

Protocol Buffers(简称Protobuf)是由Google开发的一种用于数据序列化技术。与传统的XML和JSON相比,Protobuf具有更高的性能和更小的消息体积,特别适用于需要高效数据交换的场景

特点

  • 速度快:Protobuf在序列化与反序列化数据时速度极快
  • 占空间小:Protobuf序列化后的二进制数据非常小,可节省大量的存储和带宽
  • 跨平台:Protobuf支持多种编程语言(常见的几乎都支持),兼容性好
  • 易扩展:使用.proto文件定义数据结构(包括字段类型、默认值和验证规则等),添加新内容时,也可以轻松做到,不会破坏现有系统
  • 简单易用:只需专注.proto数据结构文件的编写,对应的序列化与反序列化代码可自动生成

使用场景

  • 分布式系统:各服务之间需要频繁地进行数据交换,Protobuf可以显著提高通信效率
  • 存储和持久化:Protobuf能节省很多存储空间,常用于日志记录、配置文件和数据持久化
  • 移动应用:在网络带宽和存储空间有限的情况下,Protobuf能更好地提高性能

Proto

protoprotobuf定义数据结构的一种格式,用.proto后缀的文件保存,使用proto编译器可以把对应的proto结构编译为各目标语言的序列化与反序列化代码库

简单的使用模拟

  • 使用proto语法(规则)定义我们的数据结构,保存在.proto后缀的文件内
  • 使用proto编译器编译.proto文件,指定要编译成目标语言环境(Java、Python等)
    • 结果将会生成对应语言的一个代码文件(内包含对应数据序列化与反序列化相关操作的类或函数)
  • 接着使用生成的代码文件即可

Proto语法

首先,先看一则消息结构,如下:

  • proto3表示使用的proto版本,如不如上指明,编译器会默认为proto2
  • message Student表示定义一个名为Student的消息结构
  • {}内为消息的字段,采用类型 字段名 = 编号;的形式描述

字段类型

proto的类型主要有三类:标量类型、枚举或复合类型(如其它消息类型)

标量类型

常用的标量类型如下:

proto类型

注释

对应C++类型

double

双精度浮点数

double

float

单精度浮点数

float

int32

使用可变长度编码,对负数编码效率不高 - 如果字段可能具有负值,可使用 sint32

int32

int64

使用可变长度编码,对负数编码效率不高 - 如果字段可能具有负值,可使用 sint64

int64

uint32

使用可变长度编码

uint32

uint64

使用可变长度编码

uint64

sint32

使用可变长度编码,有符号 int 值,与常规 int32 相比,可更有效地对负数进行编码

int32

sint64

使用可变长度编码,有符号 int 值,与常规 int64 相比,可更有效地对负数进行编码

int64

fixed32

始终为四个字节,如果值通常大于 228,则比 uint32 更高效

uint32

fixed64

始终为八个字节,如果值通常大于 256,则比 uint64 更高效

uint64

sfixed32

始终为四个字节

int32

sfixed64

始终为八个字节

int64

bool

布尔值

bool

string

字符串必须始终包含 UTF-8 编码或 7 位 ASCII 文本,并且不能长于 232

string

bytes

可能包含不长于 232 的任何任意字节序列

string

上表值给出了C++中对应的类型参考,其它语言亦有与proto对应的类型,具体可自行搜查

默认值:当解析消息时,如果编码的消息不包含某些元素,则访问解析对象中的相应字段将返回该字段的默认值,默认值相关于类型:

对于字符串,默认值为空字符串

对于字节,默认值为空字节

对于布尔值,默认值是false

对于数字类型,默认值是0

对于枚举,默认值是第一个定义的枚举值,它必须是0

枚举

定义一个类型,值为预定义值列表中的一个值

如下,是一个枚举参考:

  • 每个枚举都需要一个常量(32位整数范围内)
  • 第一个需要为零

保留值:定义完一个枚举后,之后某个时间点可能由于业务需要,要修改其结构,或删除一些项,如果仅是注释掉或直接删除,会导致枚举的常量值不连续,后续其它开发者可以使用这些值新增其它枚举项,如果他们后续又加载相同.proto的旧版本,可能会导致严重的问题(如数据损坏等)

为了防止这种问题发生,我们可以用reserved将这些删除项的常量值声明为保留值,防止后续开发者使用

  • reserved后跟保留内容
  • 数字表示保留常量
  • 字符串表示保留字段名称
  • to用于连接连续的一段值
  • max表示指定常量数字范围的最大可能值
  • 同一个reserved语句中不能同时混合字段名称和数字值

其它消息类型

表示用message定义的其它消息类型

嵌套消息

消息除了一个个定义,还可嵌套定义,如下:

  • 在消息内部定义的消息,即为嵌套消息,内部可通过其名称直接使用
  • 外部如想使用嵌套消息,可通过_Parent_._Type_的形式引用,如:UserInfo.Avatar

如果想用其它.proto文件内定义的类型,可在文件头使用import文件路径导入指定文件使用

映射

使用关键字map创建、声明,配对键/值字段类型

形式为:map<key, value> name = N;

  • key可以是数字或字符串类型(即除了浮点数和 bytes 外的所有标量类型)
  • value可以是任何类型,处理另一个map

举例一个映射如下

字段编号

定义消息字段时,必须给每个字段都分配一个编号,数值在1到536,870,911之间

  • 给定的数值必须在该消息的所有字段中唯一
  • 编号19,000至19,999为Protobuf实现保留,不可用
  • 不可使用reserved定义的保留值

建议使用1到15的数字设置常用字段,因为它们只需一个字节进行编码,16之后的数字至少需要两个字节

字段标签

用于声明在定义字段的类型前,起到某种作用

  • required:表示字段为必填字段,创建消息时,必须设置该字段的值
  • optional:表示字段是可选字段,创建消息时,可设置值也可不设置,消息接收方如可识别,则对应处理,如不可识别则忽略
  • repeated:表示该字段可重复0~N个,保留重复值的顺序,即相当于一个数组、列表

保留字段

与上方枚举提到的用法类型,通过reserved定义保留编号和保留字段名称

注释

proto采用与C/C++同样式的注释方法://或/* ... */

为了防止协议消息类型之间的名称冲突,可以在.proto文件中添加可选的package说明符

定义消息类型的字段时可带上包说明符foo.Test bar = 1;

在编译为不同语言时,会做不同处理,如:对于java解析为java中的包,对于C++则解析为名称空间

后言

protobuf使用非常广泛,如很多平台的视频、直播间弹幕流即是使用这种技术传输,如有需要,还可对序列化消息进行gzip压缩,进一步减少消息体积,节省带宽,提高传输速度


相关推荐

快递查询教程,批量查询物流,一键管理快递

作为商家,每天需要查询许许多多的快递单号,面对不同的快递公司,有没有简单一点的物流查询方法呢?小编的回答当然是有的,下面随小编一起来试试这个新技巧。需要哪些工具?安装一个快递批量查询高手快递单号怎么快...

一键自动查询所有快递的物流信息 支持圆通、韵达等多家快递

对于各位商家来说拥有一个好的快递软件,能够有效的提高自己的工作效率,在管理快递单号的时候都需要对单号进行表格整理,那怎么样能够快速的查询所有单号信息,并自动生成表格呢?1、其实方法很简单,我们不需要一...

快递查询单号查询,怎么查物流到哪了

输入单号怎么查快递到哪里去了呢?今天小编给大家分享一个新的技巧,它支持多家快递,一次能查询多个单号物流,还可对查询到的物流进行分析、筛选以及导出,下面一起来试试。需要哪些工具?安装一个快递批量查询高手...

3分钟查询物流,教你一键批量查询全部物流信息

很多朋友在问,如何在短时间内把单号的物流信息查询出来,查询完成后筛选已签收件、筛选未签收件,今天小编就分享一款物流查询神器,感兴趣的朋友接着往下看。第一步,运行【快递批量查询高手】在主界面中点击【添...

快递单号查询,一次性查询全部物流信息

现在各种快递的查询方式,各有各的好,各有各的劣,总的来说,还是有比较方便的。今天小编就给大家分享一个新的技巧,支持多家快递,一次能查询多个单号的物流,还能对查询到的物流进行分析、筛选以及导出,下面一起...

快递查询工具,批量查询多个快递快递单号的物流状态、签收时间

最近有朋友在问,怎么快速查询单号的物流信息呢?除了官网,还有没有更简单的方法呢?小编的回答当然是有的,下面一起来看看。需要哪些工具?安装一个快递批量查询高手多个京东的快递单号怎么快速查询?进入快递批量...

快递查询软件,自动识别查询快递单号查询方法

当你拥有多个快递单号的时候,该如何快速查询物流信息?比如单号没有快递公司时,又该如何自动识别再去查询呢?不知道如何操作的宝贝们,下面随小编一起来试试。需要哪些工具?安装一个快递批量查询高手快递单号若干...

教你怎样查询快递查询单号并保存物流信息

商家发货,快递揽收后,一般会直接手动复制到官网上一个个查询物流,那么久而久之,就会觉得查询变得特别繁琐,今天小编给大家分享一个新的技巧,下面一起来试试。教程之前,我们来预览一下用快递批量查询高手...

简单几步骤查询所有快递物流信息

在高峰期订单量大的时候,可能需要一双手当十双手去查询快递物流,但是由于逐一去查询,效率极低,追踪困难。那么今天小编给大家分享一个新的技巧,一次能查询多个快递单号的物流,下面一起来学习一下,希望能给大家...

物流单号查询,如何查询快递信息,按最后更新时间搜索需要的单号

最近有很多朋友在问,如何通过快递单号查询物流信息,并按最后更新时间搜索出需要的单号呢?下面随小编一起来试试吧。需要哪些工具?安装一个快递批量查询高手快递单号若干怎么快速查询?运行【快递批量查询高手】...

连续保存新单号功能解析,导入单号查询并自动识别批量查快递信息

快递查询已经成为我们日常生活中不可或缺的一部分。然而,面对海量的快递单号,如何高效、准确地查询每一个快递的物流信息,成为了许多人头疼的问题。幸运的是,随着科技的进步,一款名为“快递批量查询高手”的软件...

快递查询教程,快递单号查询,筛选更新量为1的单号

最近有很多朋友在问,怎么快速查询快递单号的物流,并筛选出更新量为1的单号呢?今天小编给大家分享一个新方法,一起来试试吧。需要哪些工具?安装一个快递批量查询高手多个快递单号怎么快速查询?运行【快递批量查...

掌握批量查询快递动态的技巧,一键查找无信息记录的两种方法解析

在快节奏的商业环境中,高效的物流查询是确保业务顺畅运行的关键。作为快递查询达人,我深知时间的宝贵,因此,今天我将向大家介绍一款强大的工具——快递批量查询高手软件。这款软件能够帮助你批量查询快递动态,一...

从复杂到简单的单号查询,一键清除单号中的符号并批量查快递信息

在繁忙的商务与日常生活中,快递查询已成为不可或缺的一环。然而,面对海量的单号,逐一查询不仅耗时费力,还容易出错。现在,有了快递批量查询高手软件,一切变得简单明了。只需一键,即可搞定单号查询,一键处理单...

物流单号查询,在哪里查询快递

如果在快递单号多的情况,你还在一个个复制粘贴到官网上手动查询,是一件非常麻烦的事情。于是乎今天小编给大家分享一个新的技巧,下面一起来试试。需要哪些工具?安装一个快递批量查询高手快递单号怎么快速查询?...

取消回复欢迎 发表评论: