0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

总结:30个单片机常见问题解决办法!

jf_pJlTbmA9 来源:jozo_chen 作者:jozo_chen 2023-10-17 17:46 次阅读
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

在平常的项目开发过程中,会遇到各种各样的问题。下面分享一篇文章,是常见问题的解决思路和办法。

一、问题复现

稳定复现问题才能正确的对问题进行定位、解决以及验证。一般来说,越容易复现的问题越容易解决。

1.1 模拟复现条件

有的问题存在于特定的条件下,只需要模拟出现问题的条件即可复现。对于依赖外部输入的条件,如果条件比较复杂难以模拟可以考虑程序里预设直接进入对应状态。

1.2 提高相关任务执行频率

例如某个任务长时间运行才出现异常则可以提高该任务的执行频率。

1.3 增大测试样本量

程序长时间运行后出现异常,问题难以复现,可以搭建测试环境多套设备同时进行测试。

二、问题定位

缩小排查范围,确认引入问题的任务、函数、语句。

2.1 打印LOG

根据问题的现象,在抱有疑问的代码处增加LOG输出,以此来追踪程序执行流程以及关键变量的值,观察是否与预期相符。

2.2 在线调试

在线调试可以起到和打印LOG类似的作用,另外此方法特别适合排查程序崩溃类的BUG,当程序陷入异常中断(HardFault,看门狗中断等)的时候可以直接STOP查看call stack以及内核寄存器的值,快速定位问题点。

2.3 版本回退

使用版本管理工具时可以通过不断回退版本并测试验证来定位首次引入该问题的版本,之后可以围绕该版本增改的代码进行排查。

2.4 二分注释

二分注释即以类似二分查找法的方式注释掉部分代码,以此判断问题是否由注释掉的这部分代码引起。

具体方法为将与问题不相干的部分代码注释掉一半,看问题是否解决,未解决则注释另一半,如果解决则继续将注释范围缩小一半,以此类推逐渐缩小问题的范围。

2.5 保存内核寄存器快照

Cortex M内核陷入异常中断时会将几个内核寄存器的值压入栈中,如下图:

wKgZomUD4vuAJZjgAABclzo0PHQ591.png

我们可以在陷入异常中断时将栈上的内核寄存器值写入RAM的一段复位后保留默认值的区域内,执行复位操作后再从RAM将该信息读出并分析,通过PC、LR确认当时执行的函数,通过R0-R3分析当时处理的变量是否异常,通过SP分析是否可能出现栈溢出等。

三、问题分析处理

结合问题现象以及定位的问题代码位置分析造成问题的原因。

3.1 程序继续运行

3.1.1 数值异常
3.1.1.1 软件问题

数组越界

写数组时下标超出数组长度,导致对应地址内容被修改。如下:

wKgaomUD4v2ACWvFAAD19rwMZO8404.png

此类问题通常需要结合map文件进行分析,通过map文件观察被篡改变量地址附近的数组,查看对该数组的写入操作是否存在如上图所示不安全的代码,将其修改为安全的代码。

栈溢出

wKgaomUD4v6AH57eAAAvdRr-Jb8505.png

如上图,此类问题也需要结合map文件进行分析。假设栈从高地址往低地址增长,如果发生栈溢出,则g_val的值会被栈上的值覆盖。

出现栈溢出时要分析栈的最大使用情况,函数调用层数过多,中断服务函数内进行函数调用,函数内部申明了较大的临时变量等都有可能导致栈溢出。

解决此类问题有以下方法:

在设计阶段应该合理分配内存资源,为栈设置合适的大小;

将函数内较大的临时变量加”static”关键字转化为静态变量,或者使用malloc()动态分配,将其放到堆上;

改变函数调用方式,降低调用层数。

判断语句条件写错

wKgZomUD4wKAW5v5AAAZKYpzBDU371.png

判断语句的条件容易把相等运算符“==”写成赋值运算符“=”导致被判断的变量值被更改,该类错误编译期不会报错且总是返回真。

建议将要判断的变量写到运算符的右边,这样错写为赋值运算符时会在编译期报错。还可以使用一些静态代码检查工具来发现此类问题。

同步问题

例如操作队列时,出队操作执行的过程中发生中断(任务切换),并且在中断(切换后的任务)中执行入队操作则可能破坏队列结构,对于这类情况应该操作时关中断(使用互斥锁同步)。

优化问题

wKgaomUD4wOAKgJDAAAdZsRHs50247.png

如上图程序,本意是等待irq中断之后不再执行foo()函数,但被编译器优化之后,实际运行过程中flg可能被装入寄存器并且每次都判断寄存器内的值而不重新从ram里读取flg的值,导致即使irq中断发生foo()也一直运行,此处需要在flg的申明前加“volatile”关键字,强制每次都从ram里获取flg的值。

3.1.1.2 硬件问题

芯片BUG

芯片本身存在BUG,在某些特定情况下给单片机返回一个错误的值,需要程序对读回的值进行判断,过滤异常值。

通信时序错误

wKgZomUD4wWAU-6BAAARVbWgYOg510.png

例如电源管理芯片Isl78600,假设现在两片级联,当同时读取两片的电压采样数据时,高端芯片会以固定周期通过菊花链将数据传送到低端芯片,而低端芯片上只有一个缓存区.

如果单片机不在规定时间内将低端芯片上的数据读走那么新的数据到来时将会覆盖当前数据,导致数据丢失。此类问题需要仔细分析芯片的数据手册,严格满足芯片通信的时序要求。

3.1.2 动作异常

3.1.2.1 软件问题

设计问题

设计中存在错误或者疏漏,需要重新评审设计文档。

实现与设计不符

代码的实现与设计文档不相符需要增加单元测试覆盖所有条件分支,进行代码交叉review。

状态变量异常

例如记录状态机当前状态的变量被篡改,分析该类问题的方法同前文数值异常部分。

3.1.2.2 硬件问题

硬件失效

目标IC失效,接收控制指令后不动作,需要排查硬件。

通信异常

与目标IC通信错误,无法正确执行控制命令,需要使用示波器或逻辑分析仪去观察通信时序,分析是否发出的信号不对或者受到外部干扰。

3.2 程序崩溃

3.2.1 停止运行

3.2.1.1 软件问题

HardFault

以下情况会造成HardFault:

在外设时钟门未使能的情况下操作该外设的寄存器;

跳转函数地址越界,通常发生在函数指针被篡改,排查方法同数值异常;

解引用指针时出现对齐问题:

以小端序为例,如果我们声明了一个强制对齐的结构体如下:

wKgaomUD4waAL3JcAAAcltWFz30509.png

wKgZomUD4weARONKAAA4t3utRF4821.png

此时a.val1的地址为0x00000001,如果以uint16_t类型去解引用此地址则会因为对齐问题进入HardFault,如果一定要用指针方式操作该变量则应当使用memcpy()。

中断服务函数中未清除中断标志

中断服务函数退出前不正确清除中断标志,当程序执行从中断服务函数内退出后又会立刻进入中断服务函数,表现出程序的“假死”现象。

NMI中断

调试时曾遇到SPI的MISO引脚复用NMI功能,当通过SPI连接的外设损坏时MISO被拉高,导致单片机复位后在把NMI引脚配置成SPI功能之前就直接进入NMI中断,程序挂死在NMI中断中。这种情况可以在NMI的中断服务函数内禁用NMI功能来使其退出NMI中断。

3.2.1.2 硬件问题

1)晶振未起振

2)供电电压不足

3)复位引脚拉低

3.2 .2 复位

3.2.2.1 软件问题

看门狗复位

除了喂狗超时导致的复位以外,还要注意看门狗配置的特殊要求,以Freescale KEA单片机为例,该单片机看门狗在配置时需要执行解锁序列(向其寄存器连续写入两个不同的值),该解锁序列必须在16个总线时钟内完成,超时则会引起看门狗复位。此类问题只能熟读单片机数据手册,注意类似的细节问题。

3.2.2.2 硬件问题

1)供电电压不稳

2)电源带载能力不足

四、回归测试

问题解决后需要进行回归测试,一方面确认问题是否不再复现,另一方面要确认修改不会引入其他问题。

五、经验总结

总结本次问题产生的原因及解决问题的方法,思考类似问题今后如何防范,对相同平台产品是否值得借鉴,做到举一反三,从失败中吸取经验。

作者:jozo_chen
免责声明:本文为转载文章,转载此文目的在于传递更多信息,版权归原作者所有。本文所用视频、图片、文字如涉及作品版权问题,请联系小编进行处理

审核编辑 黄宇

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 单片机
    +关注

    关注

    6078

    文章

    45598

    浏览量

    674118
  • 看门狗
    +关注

    关注

    10

    文章

    611

    浏览量

    73234
  • 寄存器
    +关注

    关注

    31

    文章

    5621

    浏览量

    130461
  • RAM
    RAM
    +关注

    关注

    8

    文章

    1401

    浏览量

    121077
  • 变量
    +关注

    关注

    0

    文章

    616

    浏览量

    29582
收藏 人收藏
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

    评论

    相关推荐
    热点推荐

    芯片烧录总是出错?常见 6 问题及解决办法

    做电子生产和 SMT 贴片的朋友,经常会遇到芯片烧录不稳定、报错、漏烧、错烧等问题。今天结合我们做烧录多年的经验,总结一下最常见的原因和解决思路,欢迎同行交流。 常见 6
    的头像 发表于 04-10 15:30 301次阅读
    芯片烧录总是出错?<b class='flag-5'>常见</b> 6 <b class='flag-5'>个</b>问题及<b class='flag-5'>解决办法</b>

    变频器的散热问题解决办法

    变频器作为现代工业控制系统中不可或缺的核心设备,其稳定运行直接关系到生产效率和设备寿命。然而,散热问题一直是困扰变频器性能发挥的“隐形杀手”。据统计,超过35%的变频器故障与散热不良有关,高温环境会导致电子元件老化加速、绝缘性能下降,甚至引发意外停机。本文将系统剖析变频器散热难题的根源,并提供八种经过实践验证的解决方案,帮助您构建全方位的散热防护体系。
    的头像 发表于 02-27 17:12 796次阅读
    变频器的散热<b class='flag-5'>问题解决办法</b>

    示波器常见问题解答 (FAQ)

    示波器是电子工程师不可或缺的“眼睛”,它能将看不见的电信号转化为可视的波形图像,帮助我们洞察电路的运行状态。为了帮助您更高效、安全地使用这一工具,我们整理了以下常见问题与解答。   1.
    的头像 发表于 02-02 18:21 689次阅读
    示波器<b class='flag-5'>常见问题解</b>答 (FAQ)

    JTAG/SWD禁用导致无法烧写的解决办法

    开始滚动,一会之后会提示出错。直接关闭它,放开复位键。   3.这时候单片机已经停止程序了,SWD那些端口已经恢复原有的调试端口功能,这时候你再一次按下载键便可以下载程序了,问题解决!!!
    发表于 01-21 06:05

    请问单片机常见的硬件抗干扰技术有哪些?

    形成干扰的基本要素有哪些? 单片机常见的硬件抗干扰技术有哪些?
    发表于 01-07 07:15

    CW32系统有哪些常见问题

    在CW32系统中,可能会遇到一些常见问题,包括但不限于: 重复定义函数:例如在a.c里定义了函数void func(),在b.c里也定义了一void func()。这会导致编译时出现错误,需要
    发表于 12-15 06:47

    晶振使用中常见问题与解决方法

    一、频偏造成的使用异常异常现象:色彩图像不正常;音频杂音,无数据传输,距离短,遥控无反应。常见处理:换一就OK根本原因:晶振负载电容同电路不匹配。解决办法:调整电路匹配电容大小,或换用不同负载电容
    的头像 发表于 11-21 15:37 4303次阅读
    晶振使用中<b class='flag-5'>常见问题</b>与解决方法

    一文解析单片机晶振脚的原理

    晶振是重要元器件之一,对于晶振,小编于往期晶振相关文章中有过诸多阐述。本文中,小编将对单片机晶振脚的原理加以解析,以帮助大家更好理解晶振。晶振电路需要210-30pF级别的电容作为起振用途
    的头像 发表于 11-21 15:37 3891次阅读
    一文解析<b class='flag-5'>单片机</b>晶振脚的原理

    VCS安装教程及常见问题解决办法

    一、简要介绍 在对蜂鸟E203处理器进行运行系统级仿真测试时,可以利用VCS这一编译型仿真工具来对运行E203的模拟测试。本文即介绍在Linux系统中,进行模拟测试途中出现的一系列常见问题
    发表于 10-27 07:58

    硅片超声波清洗操作过程中常见问题解决办法

    可能会遇到各种问题,从效率低下到机械故障,这些问题如果不及时解决,轻则影响产品质量,重则停止生产,造成巨大损失。因此,了解并掌握这些常见问题及其解决办法,是保证生
    的头像 发表于 10-21 16:50 2195次阅读
    硅片超声波清洗<b class='flag-5'>机</b>操作过程中<b class='flag-5'>常见问题</b>及<b class='flag-5'>解决办法</b>

    车载摄像头气密性检测仪操作常见问题解决办法-岳信仪器

    在车载摄像头的生产与质量把控中,车载摄像头气密性检测仪发挥着至关重要的作用。然而,在实际操作过程中,常常会遇到一些问题,以下为您详细介绍常见问题及对应的解决办法。(1)检测结果不稳定检测结果不稳定
    的头像 发表于 10-17 14:30 553次阅读
    车载摄像头气密性检测仪操作<b class='flag-5'>常见问题</b>及<b class='flag-5'>解决办法</b>-岳信仪器

    第1章 如何学习单片机

      在错误的道路上日夜兼程,最终也无法成功,方法和思路绝对是最重要的。本章节讲到的学习单片机的方法,都是作者学习单片机的无数经验和教训总结出来的瑰宝。通过作者前面的披荆斩棘,开辟了道路,可以告诉读者
    的头像 发表于 10-10 10:32 690次阅读

    单片机:一承载科技与工程思维的核心平台

    ,还是工业自动化、嵌入式系统,单片机都扮演着不可或缺的角色。它不仅仅是一芯片,而是承载着技术与工程思维的核心平台,其重要性不言而喻。 一、单片机的核心要素 单片机的核心要素主要包括以
    的头像 发表于 09-29 01:07 736次阅读

    单片机用什么封装

    。深圳市安凯星科技有限公司在为拓邦、朗科、安徽龙多等客户开发方案时,会根据项目场景精准选择封装类型,确保性能与实用性平衡。 常见单片机封装类型及特点 DIP 封装:直插式的经典之选 DIP(双列直插封装)是最基础的单片机封装
    的头像 发表于 08-01 13:47 1634次阅读

    单向阀气密性检测仪常见故障及解决办法

    单向阀气密性检测仪在工业生产中起着至关重要的作用,然而在使用过程中难免会出现一些故障。了解常见故障及其解决办法,能有效提高设备的使用效率和检测准确性。一、检测结果不准确故障表现检测数据波动
    的头像 发表于 06-30 14:01 798次阅读
    单向阀气密性检测仪<b class='flag-5'>常见</b>故障及<b class='flag-5'>解决办法</b>