0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

物联网解决方案选择数据库平台的四个步骤

h1654155282.3538 来源:首席架构师智库 作者:首席架构师智库 2020-11-29 10:08 次阅读

物联网解决方案选择正确的数据库平台是一项艰巨的任务。首先,物联网解决方案可以跨地理区域分布。与集中式的基于云的解决方案相反,更多的解决方案正在采用边缘雾计算和云计算的组合。因此,您的数据库平台必须为您提供在边缘处理数据以及在边缘服务器和云之间进行同步的灵活性。

其次,根据您的物联网使用情况,您需要的数据库功能可能包括实时数据流、数据过滤和聚合、接近零延迟的读取操作、即时分析、高可用性、地理分布、模式灵活性等等。本文介绍了为物联网解决方案选择正确的数据库平台的四个步骤:

步骤1 确定解决方案的数据需求

物联网解决方案依赖于从联网设备中收集和处理数据,做出智能决策,如触发通知或动作,计算实时分析,从历史数据中收集模式,等等。

为了便于讨论,在通用的物联网解决方案中,可以在整个企业中安装传感器和执行器。成千上万的传感器和执行器与一台edge服务器相连。物联网解决方案不断从所有传感器收集数据,做出实时决策来控制传感器和执行器,向系统监视器发出异常活动警报,并为最终用户提供分析的历史视图。

在决定使用哪些服务和与之配套的数据库之前,有必要清楚地了解如何使用数据以及在何处使用数据。一些问题可以帮助理解和优先考虑你的数据需求:

哪些数据处理和决策被委托给边缘服务器?

云解决方案是部署在一个地区,还是分散在多个地区?

从设备到边缘服务器和从边缘服务器到中央服务器传输的数据量是多少?估计的峰值容量是多少?

物联网解决方案是否控制设备或致动器?如果是,它们需要实时响应吗?

从历史数据中获得的业务洞察力是什么?

步骤2 将解决方案分解为独立的软件服务

在此步骤中,您将设计执行独立的特定任务的软件服务或组件。

当将前面描述的样例物联网解决方案分解为独立的服务时,可以得到图2所示的设计。物联网解决方案本身是地理分布的,其中一些组件部署在边缘网络,其余组件在一个集中位置。

现在让我们将架构分解为服务,并分析它们的职责和数据需求:

数据摄取

目的:收集和存储设备日志和消息。

数据库需求:支持高速写操作,因为数据可能以突发的方式到达,确保数据在不寻常的情况下不会丢失。

边缘分析

用途:对输入数据执行数据转换、分类、聚合、过滤和功能。它负责在边缘进行实时决策。

数据库需求:支持高速读写与亚毫秒延迟;提供工具和命令来对数据执行复杂的分析计算。

设备管理器

用途:向设备传递信息

数据库需求:以最小的延迟访问和向设备发送消息。

系统分析

目的:从边缘服务器收集数据,执行数据转换和分析操作。

数据库需求:提供对数据执行分析计算的命令,并根据分析引擎的需要长时间存储数据。

C&C (命令和控制)仪表板

目的:提供物联网生态系统当前状态的可视化表示。

数据库需求:保持数据的当前和准确,读取数据的延迟小于毫秒。

商业智能

用途:从历史数据运行报告、查询和推断。

数据库需求:长时间存储数据,节约成本;提供查询和分析数据的工具。

物联网数据流出口

用途:将数据规范化为一种通用格式,并将其推送给订阅服务器。

数据库需求:高效执行数据转换操作的能力;支持发布和订阅功能。

步骤3:根据数据需求对服务进行分组,并选择正确的数据库

下一步是根据每个服务的数据选择正确的数据库。图3将我们的物联网示例中的服务连接到图中,根据数据在数据库中停留的时间和服务所需的数据读/写速度对它们进行分类。

您将看到数据不断进出数据摄取服务器,在数据库中停留的时间非常短。同时,数据的到达量大,速度快。因此,我们需要一个具有低延迟的高速数据库来保存用于摄入服务的数据。另一方面,商业智能服务依赖于历史数据。

下一步是对具有类似数据访问特征的服务进行分组,目标是限制数据库的数量(多余的数据库和不符合您需求的数据库),从而减少操作开销。

在图4中,我们将示例服务分组到两个主数据库中—一个热数据库和一个冷数据库。保存热数据的数据库部署在靠近物联网设备的位置,以最小化网络延迟。热数据和冷数据的数据库选择是:

热数据库:由于RAM的成本越来越便宜,内存中的数据库通常是一个不错的选择。内存中的数据库以最小的延迟交付数据读写能力。当选择一个热数据库时,这些额外的功能和能力将帮助您缩小选择范围:

数据格式的灵活性——帮助您支持广泛的设备和通信格式

查询功能——使您能够实时运行高效的查询

消息传递和排队——驱动通信和数据交换

分层内存模型-提供一个经济有效的内存模型,但高性能

高可用性和灾难恢复-帮助您保持业务的所有时间

地理分布-服务地理分布的物联网部署

二进制安全-帮助您保存二进制数据

冷数据库:物联网解决方案的历史数据可能增长到多个tb,在某些情况下可能超过一个pb。存储历史数据的流行选择包括在普通硬件上存储解决方案。查询通常遵循map-reduce模式。通常,历史数据也会在搜索引擎中建立索引,用于模式匹配和数据聚合。如果您要将数据存储在云中,请与您的云服务提供商联系,在您所在的地区,哪种数据存储方案最划算。

第四步:评估成本、资源效率

将数据库分为热数据库和冷数据库有助于缩小数据库选择范围。对于大多数物联网用例,一个高速数据库可以满足热数据库的所有需求。对于冷数据库,选项可能从关系数据库到数据湖。设计人员经常犯的一个错误是为每个服务创建具有专门数据库的多语言体系结构。这增加了应用程序堆栈的复杂性以及操作开销和成本。

拥有一个数据库的总成本是许多参数的函数。数据库本身的成本只是成本的一小部分。以下是一些费用:

数据库许可证成本:该成本可能与cpu数量、集群中的碎片数量、数据库大小、吞吐量(每秒最大操作数量)、时间(年、月、小时等)、高可用性和恢复特性、云的多个区域的可用性等有关。如果您使用的数据库可以作为开放源码软件使用,根据许可证的类型,数据库成本甚至可能为零。

基础设施成本:基础设施成本取决于数据库的资源效率。例如,一个轻量级、线程安全的数据库可能只使用两个商用服务器每秒执行100万次读/写操作,而传统数据库可能需要更多的服务器才能得到相同的结果。除了数据库效率,硬件成本还取决于吞吐量、cpu数量、RAM、数据大小、闪存、网卡等。用于高可用性的数据库体系结构也发挥了作用。例如,基于仲裁的故障转移架构将只需要一个备用服务器副本,但非基于仲裁的架构将需要两个数据副本,以避免分裂大脑。

数据丢失成本:为数据丢失提供适当的保险是极其重要的,特别是对于商用物联网解决方案。您丢失数据的总成本为:亏损的业务数据丢失的概率*恢复数据的成本

您可以使用数据库供应商提供的适当SLA来抵消部分成本。

操作开销:自动化是成功的咒语。如果数据库提供控制来自动化部署、配置、故障转移、扩展、数据分区、备份和恢复、监视和警报等操作,那么将有助于高效地操作。

结论

当为下一代物联网解决方案选择正确的数据库时,很容易迷失在现有的大量数据库中。但是,如果将解决方案分解为组件服务并理解它们的数据库需求,就可以有效地缩小数据库选择范围。大多数物联网解决方案都依赖于热数据库进行实时数据收集、处理、消息传递、分析,而冷数据库用于存储历史数据和收集商业智能。这将使架构简单、精简和健壮。

最后需要说明的是,Redis实验室赞助的开源内存数据库Redis是物联网解决方案的热门数据库。它被物联网解决方案广泛用于数据摄取、实时分析、消息传递、缓存和许多其他用例。
责任编辑人:CC

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 物联网
    +关注

    关注

    2867

    文章

    41589

    浏览量

    358269
  • 数据库
    +关注

    关注

    7

    文章

    3590

    浏览量

    63363
  • 物联网平台
    +关注

    关注

    7

    文章

    90

    浏览量

    20658
收藏 人收藏

    评论

    相关推荐

    基于机智云联网平台的智能垃圾回收箱与控制系统研究

    将设备的信息自动保存并上传。 智能垃圾回收箱机械结构方案 总体结构设计 智能垃圾回收箱的主要回收目标是纸张、金属、塑料、织物种可回收,因此回收箱箱体分为四个部分,针对每一种可回
    发表于 04-09 17:25

    通过Modbus读写数据库中的数据

    本文是将数据库数据转为Modbus服务端/从站,实现数据库内的数据也可以走Modbus协议通过网口或串口读写的案例,下图是通过智能网关的参数软件(在附件中)配置的参数: 上图中的配置
    发表于 03-14 13:44

    navicat怎么导出数据库文件

    。 首先,确保你已经安装了Navicat,并已成功连接到目标数据库。接下来,按照以下步骤进行导出数据库文件: 步骤一:选择目标
    的头像 发表于 11-21 10:53 3841次阅读

    关于PLC设备对接ORACLE数据库上传查询数据

    IGT-DSER实现欧姆龙NJ/NX系列的PLC与数据库服务器双向通讯,网关支持MySQL和SQLServer、PostgreSQL以及Oracle,这里选择的是Oracle。实际网络结构如下图1。 通过\'功能
    发表于 10-12 15:34

    赛灵思WebP和数据库解决方案

    电子发烧友网站提供《赛灵思WebP和数据库解决方案.pdf》资料免费下载
    发表于 09-15 15:06 0次下载
    赛灵思WebP和<b class='flag-5'>数据库</b><b class='flag-5'>解决方案</b>

    Memcached数据库服务器解决方案

    电子发烧友网站提供《Memcached数据库服务器解决方案.pdf》资料免费下载
    发表于 09-13 09:44 0次下载
    Memcached<b class='flag-5'>数据库</b>服务器<b class='flag-5'>解决方案</b>

    阿里云联网平台基础概念讲解

    产品 设备的集合,通常指一组具有相同功能的设备。联网平台为每个产品颁发全局唯一的ProductKey。每个产品下可以有成千上万的设备。 设备 归属于某个产品下的具体设备。
    发表于 09-11 07:41

    STM32Wx赋能工业联网解决方案

    STM32Wx 赋能工业联网解决方案, 陈列了STM32 MCU 及 MPU 产品组合、STM32Wx 无线产品、2.4GHz 产品系列、Sub-GHz 产品系列等。
    发表于 09-05 06:06

    ARM联网整体解决方案-数据

    ARM联网整体解决方案提供了一种独特的基于解决方案的方法,将最新的专业处理能力与先进的软件和工具相结合。 ARM
    发表于 08-29 06:06

    浅谈工业联网平台

    工业互联网平台 工业互联网平台的本质是在传统云平台的基础上叠加
    发表于 08-10 15:45

    设计一片上系统-为安全的联网创建一系统设备

    Flexible Access的IP。创建SoC解决方案的最快方法安全的联网设备将使用Corstone-201基础IP。因此,本指南也可以使用如果你开始使用Corstone-201
    发表于 08-02 09:33

    选择查询-(2)#数据库技术

    数据库
    未来加油dz
    发布于 :2023年07月11日 16:28:20

    选择查询-(1)#数据库技术

    数据库
    未来加油dz
    发布于 :2023年07月11日 16:27:31

    基于机智云联网平台的智能种树小车

    过程的信息传递、发送命令等,联网机智云模块可以实时上报种植数据至云平台。制作了装置模型样机,试验测试结果表明:该装置完成一棵树的种植时间需要约8.45 s,完成区域10 m×10 m
    发表于 05-31 19:38

    新的Blynk联网平台现在支持ESP8266吗?

    Blynk 最近推出了一新的联网平台,对 ESP8266 提供开箱即用的支持,具有许多很酷的功能,包括设备配置和管理、云中的数据托管、固
    发表于 04-28 06:15