• 《中国科学引文数据库(CSCD)》来源期刊
  • 中国科技期刊引证报告(核心版)期刊
  • 《中文核心期刊要目总览》核心期刊
  • RCCSE中国核心学术期刊

Bt基因玉米的抗虫鉴定及杂种优势

谢宇, 杨巍, 任雪娇, 慈佳宾, 姜良宇, 杨伟光

谢宇, 杨巍, 任雪娇, 等. 转Bt基因玉米的抗虫鉴定及杂种优势[J]. 华南农业大学学报, 2019, 40(4): 25-32. DOI: 10.7671/j.issn.1001-411X.201809027
引用本文: 谢宇, 杨巍, 任雪娇, 等. 转Bt基因玉米的抗虫鉴定及杂种优势[J]. 华南农业大学学报, 2019, 40(4): 25-32. DOI: 10.7671/j.issn.1001-411X.201809027
XIE Yu, YANG Wei, REN Xuejiao, et al. Insect-resistant identification and heterosis of transgenic Bt maize[J]. Journal of South China Agricultural University, 2019, 40(4): 25-32. DOI: 10.7671/j.issn.1001-411X.201809027
Citation: XIE Yu, YANG Wei, REN Xuejiao, et al. Insect-resistant identification and heterosis of transgenic Bt maize[J]. Journal of South China Agricultural University, 2019, 40(4): 25-32. DOI: 10.7671/j.issn.1001-411X.201809027

Bt基因玉米的抗虫鉴定及杂种优势

基金项目: 国家重点研发计划项目(2017YFD0101102);吉林省科技发展计划项目(20160204001NY,20170307009NY);吉林省教育厅“十三五”科学技术项目(JJKH20180663KJ,JJKH20180660KJ)
详细信息
    作者简介:

    谢宇(1992—),女,硕士研究生,E-mail: 2804217360@qq.com

    通讯作者:

    杨伟光(1960—),男,教授,博士,E-mail: ywg789@126.com

  • 中图分类号: S334.5

Insect-resistant identification and heterosis of transgenic Bt maize

  • 摘要:
    目的 

    研究转Bt基因玉米Zea may材料表达、产量潜力及杂种优势表现,为转基因材料遗传改良提供参考。

    方法 

    以Reid群骨干系PH6WC及育成的自交系J1490、J1495、4DH10和外引系PH1CPS作母本,以Non-Reid为基础的转Bt基因材料6DH85、J1401、6DH222、8DH273和8DH279以及自选系J9D207、J1628、J1668为父本,按NCⅡ设计组配40(5×8)个杂交组合,对转Bt基因材料抗虫表现和产量潜力进行研究。

    结果 

    通过回交转育系谱法处理后代获得转基因材料中的部分Bt基因丢失或者沉默,没有在子代中成功表达出相应蛋白。转Bt基因的杂交组合在一定程度上可以避免因虫害造成的产量损失,与对照品种相比,组合4DH10×8DH279表现最好,增产31.10%;组合J1495×J1401虽然含有Bt基因,且与其不含Bt基因的同父本组合相比增产效果明显,最高可增产65.77%,但与对照品种相比,仅增产10.04%。

    结论 

    玉米转基因育种与常规育种相结合,对其跟踪测配,才有望培育出高产、抗虫优良品种。

    Abstract:
    Objective 

    To study the material expression, yield potential and heterosis of transgenic Bt maize(Zea may), and provide references for genetic modification of transgene materials.

    Method 

    The Reid group elite line PH6WC, the bred inbred lines J1490, J1495 and 4DH10, as well as the introduced line PH1CPS were used as female parents. The Non-Reid based transgenic Bt materials, including 6DH85, J1401, 6DH222, 8DH273 and 8DH279, as well as the self-selected lines J9D207, J1628 and J1688 were used as male parents. Totally 40(5×8) cross combinations according to the NCⅡ design were assembled. The insect-resistant performance and yield potential of transgenic Bt materials were studied.

    Result 

    Part of the Bt genes were deleted or silenced in transgene materials obtained through backcrossing pedigree method, and no corresponding protein was successfully expressed in the filial generations. The cross combination of transgenic Bt materials could partially avoid yield loss due to pest. Comparing to the control variety, combination 4DH10×8DH279 had the best performance with 31.10% yield increase. For combination J1495×J1401, although it contained the Bt gene and it displayed obvious yield increase (65.77% at the highest) compared with the combination without Bt gene of the same male parent, however, it only had 10.04% yield increase compared with the control variety.

    Conclusion 

    High-yield and insect-resistant maize varieties can be bred through combining transgene breeding with conventional breeding as well as tracking and testing.

  • 精准农业是推动农业现代化与信息化发展的关键,其重要的农情数据采集阶段离不开农业物联网(Internet of things in agriculture)的支持[1]。现阶段,农业物联网已在农业生产中得到广泛应用,复杂的传感器网络按时间序列连续地采集温度、湿度、CO2和NH3浓度等大量的环境及作物生长信息。分析和评估采集的信息可为农业精准决策提供保障。因此,农业物联网数据的有效挖掘和利用已成为农业信息化领域的研究热点[2-3]。然而,由于农业作业环境往往较为恶劣,且受制造工艺和网络传输的限制,导致采集到的数据中不可避免地存在异常[4],这些异常可能干扰数据分析并影响农业精准决策。

    费欢等[5]以传感器网络多模态数据流之间的相干性为理论基础,利用多维数据和滑动窗口模型对异常数据及其来源进行检测和评估。Zhao等[6]提出一种基于多分类器集成的漂移补偿监督学习算法,利用支持向量机(Support vector machine, SVM)和改进的长短期记忆(Long short term memory, LSTM)构建多分类器模型,通过归一化和加权策略,在每次分类过程中去除精确度最低的基分类器,使模型适应传感器漂移,有效地提高了传感器漂移分类性能。Wang等[7]利用传感器之间的数据相关性,使用信号空间投影和卡尔曼滤波器实现传感器漂移的盲校准。高鹏等[8]利用LSTM和广义回归神经网络(Generalized regression neural network, GRNN)模型对土壤墒情进行建模,实现对柑橘土壤含水量和土壤电导率的预测。

    在传统的机器学习任务中,需要用多种信号处理算法检测数据流中的异常,导致效率较低,在数据分析过程中易出现过拟合或欠拟合现象。此外,大多数据异常检测算法泛化能力较弱,不适用于其他类型的异常检测。文献[6]中采用SVM和LSTM的结合模型,获得了理想精确度,但增加了时间复杂度。文献[7]所提信号空间投影和卡尔曼滤波器方法,利用传感器之间的相关性解决传感器漂移问题,但传感器难以密集部署,模型应用场景狭小、泛化能力较弱。

    近年来,随着硬件计算能力的显著提升,人工智能(Artificial intelligence)和深度学习(Deep learning)技术已广泛应用于图像识别[9]、自然语言处理[10]、推荐系统[11]和音频识别[12]领域。深度结构的神经网络在传感器数据异常检测领域也得到广泛应用,Bao等[13]提出了一种基于计算机视觉和深度学习的传感器数据异常检测方法,该方法将时间序列信号转换为图像并保存在灰度图像中,通过训练两隐藏层堆叠的自动编码深度神经网络来自动检测未标签的数据。Tang等[14]提出了一种基于卷积神经网络的传感器数据异常检测方法,在图片中融合数据的时域和频域特征,并采用卷积神经网络对图片进行分类,但时域和频域可视化方法无法保存数据的时间数值依赖性。Liu等[15]提出一种动态宽度增量学习算法,通过深度叠加宽度学习系统,解决数据回归和图像分类问题,但在数据预处理中,未采用有效方法增强数据时间依赖性。Wang等[16]提出一种格拉姆角求和域/差分域和马尔科夫过渡域的时间序列数据可视化方法,并采用平铺卷积神经网络学习图像特征,实现时间序列数据分类,但当原始时间序列过长时,重构后的矩阵规模大,增加了运算时间消耗。

    针对以上研究现状,本文设计了一种宽度卷积神经网络(Broad convolution neural network, BCNN)的农情数据异常检测方法,并通过滑动窗口机制解决单次输入模型数据量大引起的模型检测耗时长和准确率不足等问题。研究数据预处理与重构方法、滑动窗口尺寸对异常检测性能的影响,对比分析不同异常检测模型的性能差异,以期为精准农业的数据高质量采集提供参考。

    试验数据采用位于安徽省长丰县双墩镇的合肥安谷农业有限公司羊圈监测点传感器的空气湿度、空气温度、土壤湿度和土壤温度数据,时间覆盖范围从2019年12月1日至2019年12月31日,采样间隔3 min,共11355条观测数据。为便于开展检测性能对比分析,在数据中引入一组随机故障率(10%~40%)的异常点[17]。为系统评估所提方法的性能,采用80%的数据集作为训练集、20%的数据集作为测试集。数据集如图1所示,4种数据的周期性和趋势特征存在差异。空气湿度数据值域波动较大,周期性特征不明显。空气温度数据呈周期性变化,波动较小。土壤湿度数据具有明显的周期性特征,值域范围较小。土壤温度数据周期性特征与空气温度数据相似,且值域波动更小。

    图  1  试验数据集
    Figure  1.  Experimental dataset

    基于宽度学习的农情数据异常检测框架图如图2所示。传感器端负责采集数据并发送至数据中心,数据中心负责存储数据、训练模型和异常检测。模型训练过程如下:部署传感器并采集数据,将数据归一化,基于数据周期和采样间隔等参数确定滑动窗口尺寸l,编码为极坐标表示,并基于滑动窗口尺寸l划分子集,采用格拉姆角求和域(Gramian summation angular field, GASF)方法重构为矩阵,最后训练得到BCNN数据异常检测模型。

    图  2  基于BCNN的传感器数据异常检测框架
    Figure  2.  Anomaly detection framework of sensor data based on BCNN

    在异常数据实时检测过程中,数据中心对采集的最新数据进行归一化处理,编码为极坐标并重构矩阵,最后输入模型检测异常。若模型判断为正常,则将其保存为历史数据,否则,校准异常并保存。校准异常可采用回归模型预测、均值替换等方法[18]

    设传感器节点在某时刻共采集到n个时间序列数据 $ X = \{ {x_1},{x_2}, \cdots ,{x_n}\} $ ,为降低采样数据取值范围对模型训练效果的影响,将数据归一化至[−1,1]区间内,表示为:

    $$ x'_i = \frac{{({x_i} - {X_{\max }}) + ({x_i} - {X_{\min }})}}{{{X_{\max }} - {X_{\min }}}},i \in [1,n],x'_i \in {X'}, $$ (1)

    式中,xi表示原始时间序列数据,X'表示归一化后的时间序列数据,XmaxXmin分别表示原始时间序列中的最大值和最小值, $ x'_i $ 表示归一化后的数据。归一化将原始数据映射至[−1,1]区间内,将有量纲数据转化为无量纲形式,降低不同量纲对模型的影响,并保留原始数据特征,使不同的数据集处于相同数量级,便于对比分析。

    模型处理一维时间序列时,无法有效保持数据周期性时间依赖,无法有效提取部分数据之间的相关性,且对于具有不同周期的时间序列数据,模型泛化能力较差。为此,本文通过将时间序列数据编码为极坐标并重构为矩阵,实现模型对时间序列数据时间依赖性的保持和泛化性的增强。

    具体的,将归一化后的数据编码为极坐标[16],时间序列数据的数值和时间戳分别编码为极角和极径,表示为:

    $$ \begin{array}{l} \theta = \arccos x'_i,x'_i \in {X'} ,\\ r = \dfrac{{{t_i}}}{n},{t_i} \in [1,2,3, \cdots ,n] ,\end{array} $$ (2)

    式中,ti表示时间序列数据的时间戳,n表示时间序列数据数量,θr分别表示编码后数据的极径和极角。基于极坐标的编码方法是预处理和分析时间序列数据的一种新方法。反余弦函数在[−1,1]区间内是单调的,因此,式(2)在时间序列数据和极坐标之间构建了一个双射。给定一组时间序列数据,可产生唯一的映射关系,且相对笛卡尔坐标系,极坐标可保留绝对时间关系。

    滑动窗口控制单次输入模型的数据量,是影响异常检测模型性能的重要参数,选取合适的滑动窗口尺寸可有效提高模型准确率和降低时间消耗。本文设计了基于数据特征的滑动窗口尺寸l的计算方法:

    $$ l=\Bigg(\frac{\Delta t}{\beta }+\ln S\Bigg)T{{\text{e}}^{-\beta {{\log }_{2}}\sqrt{{}^{T} \diagup {}_{\Delta t}\;}}}, $$ (3)

    式中,β为支持度衰减因子,Δt为农业物联网传感器数据采样间隔,T为农情数据特征周期,S为农情数据的标准差。滑动窗口尺寸对模型准确率和效率存在影响,窗口尺寸过大会增加模型检测耗时,过小则会导致模型无法有效提取数据特征,从而降低准确率。式中T/Δt控制滑动窗口选择函数上升幅度和衰减速度,Δt/β+ln S平衡采样间隔和数据特征的影响,可满足模型异常检测准确率和效率需求。

    根据滑动窗口尺寸l,将编码后的数据分为若干个子集 $ \left\{ {\theta' _1, \cdots ,\theta' _l} \right\},\left\{ {\theta' _{l + 1}, \cdots ,\theta' _{2l}} \right\}, \cdots $ ,并将每个子集数据采用GASF方法重构为矩阵,采用类热力图形式可视化:

    $$ {\boldsymbol{G}} = \left( {\begin{array}{*{20}{c}} {\cos (\theta' _1 + \theta' _1)}& \cdots &{\cos (\theta' _1 + \theta' _l)} \\ \vdots & \ddots & \vdots \\ {\cos (\theta' _l + \theta' _1)}& \cdots &{\cos (\theta' _l + \theta' _l)} \end{array}} \right) \text{,} $$ (4)

    式中,G为重构后的矩阵, $ \theta' _1 $ $ \theta' _l$ 为编码为极坐标并划分子集后的数据。

    通过式(2)将归一化后的数据编码为极坐标,采用式(3)重构为矩阵。时间序列数据编码为极坐标后仍保留数据连续性,重构后的矩阵随着位置的变化,时间会增加,可有效保存时间依赖性。此外,矩阵也包含了时间相关性,其中的Gi,j元素叠加了原始数据中第i和第j个数据相关性,主对角线包含了原始数据信息。因此,可采用神经网络提取高维数据特征。

    为展示完整的数据预处理方法,以土壤湿度数据为例,完整流程如图3所示。首先,采用式(1)将原始土壤湿度数据归一化至[−1,1]区间内,并通过式(2)编码为极坐标表示(图3B),极坐标数据保留时间依赖性,原始异常数据在极坐标系中仍存在离群特征(即极坐标图中存在显著的异常点),接着,采用式(3)将极坐标数据划分子集,并通过式(4)重构矩阵。图3C展示了部分矩阵,异常数据可在GASF矩阵中显著表示,矩阵中出现颜色突变即表示该点数据存在异常,如矩阵1、2、5、6和7,矩阵中颜色连续变化即表示无异常,如矩阵3、4和8。预处理后的数据特征更为显著,可采用模型更有效地检测异常数据。

    图  3  土壤湿度数据预处理流程
    Figure  3.  Soil humidity data preprocessing process

    设计的宽度卷积神经网络结构如图4所示。模型采用宽度学习系统强化传统CNN模型[19]。BCNN的第1层(Layer 1)是输入层,输入矩阵维度为k×k,其中k表示滑动窗口尺寸。第2层(Layer 2)是卷积层,其中卷积核(Filter)数量为20,每个卷积核尺寸为41×41,步长(Stride)为1,采用Relu激活函数。第3层(Layer 3)是Reduction层,其中包含1个池化模块和2个卷积模块,该层采用残差连接。池化模块中,池大小(Pool size)为3×3,步长为3,池化方式为最大池化(Maxpooling)。卷积模块中,第1层卷积采用1×1的卷积核,第2层卷积采用20个3×3大小的卷积核,步长为3。卷积模块和池化模块输出的特征图按其深度连接,并采用Relu函数激活,被平坦化为一维向量输入宽度学习系统。第4层(Layer 4)采用特征提取器代替传统CNN模型中的Softmax分类器,其中包含1000个特征节点。第5层(Layer 5)为特征增强器,其中包含1000个特征增强节点,第4层中特征提取器的输出被特征增强器随机映射输出。最后将特征提取器和特征强化器的输出连接,并加权重构,得到整个模型的输出。

    图  4  宽度卷积神经网络结构
    Figure  4.  The structure of broad convolution neural network

    卷积可通过连续地变换提取数据的复杂特征。在卷积层中,利用卷积核对输入数据进行卷积:

    $$ x_i^l = {\rm{Relu}}\Bigg(\sum\limits_{n = 1}^N {x_n^{l - 1}} f_{n,i}^l\Bigg) \text{,} $$ (5)

    式中, $ x_i^l $ 表示第l层中图片的 $ i $ 通道, $ f_{n,i}^l $ 表示位于第l层中第n个卷积核的i通道,N表示l−1层中通道总数,Relu()表示激活函数。

    池化是一种降采样形式。它将图像划分为若干个区域,每个区域独立地按池化方式输出,减小了数据空间大小,参数数量和模型计算量也随之下降,在一定程度上防止过拟合的发生。本文采用最大池化方式,表示为:

    $$ a_{i,n}^l = \max (a_{i,n}^{l - 1}, \cdots ,a_{i,m}^{l - 1}) \text{,} $$ (6)

    式中, $ a_{i,n}^l $ 表示网络l层中图片i通道的第n个位置, $a_{i,n}^{l - 1},\cdots ,a_{i,m}^{l - 1}$ 表示网络l−1层中图片i通道的池化区域对应的第nm个位置。

    宽度学习系统[15]是一种通过随机方法将特征扩展到广阔空间的模型,其主要由特征节点和增强节点组成。特征节点将输入随机映射,映射特征由增强节点随机扩展,将最后所有特征加权连接输出。

    残差层的输出被平坦化为一维向量X并输入至特征节点,其表示为:

    $$ {{\boldsymbol{Z}}_i} = \phi ({\boldsymbol{X}}{{\boldsymbol{W}}_{{z_i}}} + {{\boldsymbol{\beta}} _{{z_i}}}),i = 1,2, \cdots ,n , $$ (7)

    式中,权重矩阵 $ {{\boldsymbol{W}}_{{z_i}}} $ 和偏置矩阵 $ {{\boldsymbol{\beta}} _{{z_i}}} $ 随机生成, $ \phi ( ) $ 表示激活函数,Zi表示第i个特征节点的输出,所有特征节点的集合记为 $ {{\boldsymbol{Z}}^n} = [{{\boldsymbol{Z}}_1}, \cdots ,{{\boldsymbol{Z}}_n}] $ ,其中n为特征节点数量。类似的,特征增强节点可表示为:

    $$ {{\boldsymbol{H}}_j} = \xi ({{\boldsymbol{Z}}^n}{{\boldsymbol{W}}_{{h_j}}} + {{\boldsymbol{\beta}} _{{h_j}}}),j = 1,2, \cdots ,m , $$ (8)

    式中,权重矩阵 $ {{\boldsymbol{W}}_{{h_j}}} $ 和偏置矩阵 $ {{\boldsymbol{\beta}} _{{h_j}}} $ 随机生成, $ \xi () $ 表示激活函数,Hj表示第j个特征增强节点的输出,所有特征节点的集合记为 $ {{\boldsymbol{H}}^m} = [{{\boldsymbol{H}}_1}, \cdots ,{{\boldsymbol{H}}_m}] $ ,其中m为特征增强节点数量。

    将特征节点和特征增强节点连接加权重构,输出可表示为:

    $$ {\boldsymbol{Y}} = \left[ {{{\boldsymbol{Z}}_1}, \cdots ,{{\boldsymbol{Z}}_n}|{{\boldsymbol{H}}_1}, \cdots ,{{\boldsymbol{H}}_m}} \right]{\boldsymbol{W}} = \left[ {{{\boldsymbol{Z}}^n}|{{\boldsymbol{H}}^m}} \right]{\boldsymbol{W}} \text{,} $$ (9)

    式中,权重矩阵W可通过伪逆法求解,可表示为:

    $$ {\boldsymbol{W}} = {\left[ {{{\boldsymbol{Z}}^n}|{{\boldsymbol{H}}^m}} \right]^\dagger }{\boldsymbol{Y}} = {({{\boldsymbol{A}}^m})^\dagger }{\boldsymbol{Y}} \text{,} $$ (10)

    式中, ${{\boldsymbol{A}}^m}$ = $\left[ {{{\boldsymbol{Z}}^n}|{{\boldsymbol{H}}^m}} \right]$ ${({{\boldsymbol{A}}^m})^\dagger }$ 表示 ${{\boldsymbol{A}}^m}$ 的伪逆,可通过极限方法求得:

    $$ {{\boldsymbol{A}}^\dagger } = \mathop {\lim }\limits_{\lambda \to 0} {(\lambda {\boldsymbol{I}} + {\boldsymbol{A}}{{\boldsymbol{A}}^{\rm{T}}})^{ - 1}}{{\boldsymbol{A}}^{\rm{T}}} \text{,} $$ (11)

    式中, ${\boldsymbol{A}}$ 表示特征节点和增强节点输出组合成的扩展矩阵,λ表示对权重矩阵W的约束,I表示单位矩阵,AT表示转置矩阵。

    本文采用准确率(Accuracy)、F1值和模型检测时间(Time)等指标评估模型的异常检测性能,其表示为:

    $$ 准确率=\frac{{T}_{\text{p}}+{T}_{\text{n}}}{{T}_{\text{p}}+{T}_{\text{n}}+{F}_{\text{p}}+{F}_{\text{n}}} \text{,} $$ (12)
    $$ 精确度=\frac{{T}_{\text{p}}}{{T}_{\text{p}}+{F}_{\text{p}}} \text{,} $$ (13)
    $$ 召回率=\frac{{T}_{\text{p}}}{{T}_{\text{p}}+{F}_{\text{n}}} \text{,} $$ (14)
    $$ F1值=\frac{2\times 精确度\times 召回率}{精确度+召回率} \text{,} $$ (15)

    式中,Tp表示正确分类至目标类的数量,Fp表示其他类错误分类至目标类的数量,Tn表示其他类正确分类的数量,Fn表示目标类错误分类至其他类的数量。

    准确率是正确分类的数据与数据集数据总量的比值,反映模型的正确检测能力。精确度(Precision)和召回率(Recall)分别是正确分类为异常数据的个数与所有分类的异常数据、实际异常数据的比值。F1值同时兼顾了精确度和召回率。除异常检测能力外,模型检测时间也是评估模型是否符合实际应用的重要参数。

    试验采用Windows 10操作系统、Intel Core i5 CPU、8GB内存的台式计算机,Python3.6编程语言和Tensor Flow2.0.0框架用于异常检测模型搭建和应用。主要研究滑动窗口尺寸对模型异常检测性能的影响及模型对不同特征数据的异常检测灵敏性,以甄选最优的异常检测方法。在此基础上,对比分析不同异常检测模型性能。

    试验将BCNN与当前使用较为广泛的SVM、随机森林(Random forest, RF)和卷积神经网络方法进行比较。SVM模型[20-21]核函数采用径向基函数(Radial basis function, RBF),核函数参数ε为0.2,正则化参数C为1;RF模型[22]聚类数c=2,模糊程度系数m=3,卷积神经网络方法从文献[14]中引用。BCNN模型的特征节点和特征增强节点数量均为1000。对于滑动窗口,传感器监测数据特征周期T为24 h,支持度衰减因子β取0.5[23],采样间隔Δt为3 min,空气湿度、空气温度、土壤湿度和土壤温度的滑动窗口尺寸分别为105、88、76和91。为控制模型参数随机初始化和训练引起的随机性,重复5次试验,以平均数进行结果分析。

    为评估所提滑动窗口选择方法的有效性,以BCNN模型为例,采用窗口尺寸60~120的数据集进行试验,结果如图5所示。空气湿度数据集中,异常检测准确率在窗口尺寸[60,100]区间内呈上升趋势,在窗口尺寸100时达到峰值;空气温度数据集中,窗口尺寸在[60,90]区间时,异常检测准确率随窗口尺寸增大而增加,窗口尺寸在90时准确率表现最佳,窗口尺寸大于90时准确率无显著变化;土壤湿度数据集中,在窗口尺寸[60,70]区间内准确率呈增加趋势,在[70,120]区间内准确率趋于稳定;土壤温度数据集中,在窗口尺寸[90,100]时准确率最高。值得注意的是,土壤湿度数据集呈最高准确率的窗口尺寸远小于其他数据集,这是由于其数据波动不显著,模型仅需少量数据即可学习其特征。试验所得出的最佳滑动窗口尺寸,与式(3)得出的窗口尺寸基本相符。因此,基于数据特征的滑动窗口选择方法可有效地提高模型异常检测准确率。

    图  5  不同滑动窗口尺寸与数据集的异常检测准确率
    Figure  5.  Anomaly detection accuracy of different sliding window sizes and datasets

    模型检测耗时随滑动窗口尺寸变化如图6所示。空气湿度数据集中,滑动窗口尺寸在[90,100]区间时,检测耗时最短。空气温度数据集中,在窗口尺寸[80,100]区间时检测耗时最短,处于理想状态。土壤湿度数据集中,当窗口尺寸变化时,模型检测耗时变化不明显,窗口尺寸80左右时检测耗时最短。土壤温度数据集中,在窗口尺寸[80,90]区间内,检测耗时较短,处于理想水平,其中窗口尺寸90时最优。总体上,窗口尺寸和检测耗时呈二次相关。波动性较强的数据(如空气湿度),窗口尺寸变化时,检测耗时波动更大;而波动小、较为平稳的数据(如土壤湿度),改变滑动窗口尺寸对检测耗时影响较小。

    图  6  不同滑动窗口尺寸与数据集的模型检测耗时
    Figure  6.  Anomaly detection time of different sliding window sizes and datasets

    综上,采用滑动窗口机制后,可提升模型对异常数据的检测能力,针对不同特征数据选取合适的滑动窗口尺寸,可提升异常检测准确率和降低检测耗时。

    对比分析SVM、RF、CNN和BCNN模型的数据异常检测性能,各种模型的异常检测准确率和F1值如图7所示。BCNN模型在空气湿度、空气温度、土壤湿度和土壤温度数据集上均表现出良好的异常检测性能,准确率均在97%以上,其中空气湿度数据集的准确率最高,达到99.29%,优于SVM、RF和CNN的95.68%、94.67%和93.31%。相较于CNN模型,BCNN模型在空气湿度、空气温度、土壤湿度和土壤温度数据集上准确率分别提升了5.98%、1.48%、2.19%和2.55%;相较于SVM和RF模型,BCNN模型在空气湿度数据集上的准确率与二者差异最为明显,分别高出3.61%和4.62%。由图1可知,空气湿度数据波动性较大,周期性特征弱于其他数据集,故BCNN在处理波动性大的数据时性能更佳。BCNN模型在空气湿度、空气温度、土壤湿度和土壤温度数据集上的F1值分别为:0.996 4、0.9887、0.9949和0.9920,均优于其他模型。空气温度数据集中,4种模型的F1值差值较小,均小于0.0076。在波动性较大的空气湿度数据集中,BCNN模型的F1值达到0.9964,分别优于SVM、RF和CNN模型0.0188、0.0241和0.0310。因此,BCNN模型异常检测性能优于其他模型,且BCNN模型对波动性大的数据检测能力更优,而其他模型随着数据波动性增大,异常检测能力有所下降。

    图  7  模型异常检测准确率与F1值
    Figure  7.  Anomaly detection accuracy and F1 score of different models

    总之,相较于传统机器学习算法和深度学习模型,BCNN模型对异常数据的检测能力在不同特征的数据集上均得到了一定程度的提升。其中,对波动性较大的数据集的异常检测能力最优。

    各种异常检测模型检测耗时如表1所示。BCNN模型检测耗时大幅低于同类的深度模型CNN,仅为其1/6~1/7。相较于SVM和RF传统机器学习算法,BCNN模型虽然需要额外的检测时间,但异常检测准确率和F1值都有明显提升,增强了模型对波动性较大数据的检测能力,同时,BCNN模型的超参数数量较少,有效地降低了超参数选择的复杂度。综上,对于农情数据异常检测,BCNN模型在检测能力和耗时方面优于同类深度学习模型,在检测能力和超参数选择方面优于传统机器学习算法,具有良好的适用性。

    表  1  不同模型异常检测耗时
    Table  1.  Anomaly detection time of different models s
    模型
    Model
    空气湿度 Air humidity 空气温度 Air temperature 土壤湿度 Soil humidity 土壤温度 Soil temperature
    SVM 10.78 14.62 11.58 14.47
    RF 12.02 14.39 12.85 13.77
    CNN 2 073.04 2 014.88 1 928.76 2 116.24
    BCNN 335.74 329.19 283.32 291.96
    下载: 导出CSV 
    | 显示表格

    本研究提出了基于宽度卷积神经网络的农情数据异常检测方法,采用养殖场传感器环境监测数据,综合评估了数据异常检测性能。试验结果表明,基于数据特征的滑动窗口划分子集,可有效地增加模型检测准确率和降低检测耗时。在异常检测模型对比试验中,BCNN模型取得了最高准确率和F1值,对空气和土壤温湿度数据异常检测的平均准确率和F1值分别达到了98.54%和0.993 0,相比于SVM、RF和CNN模型的平均准确率(96.86%、95.79%和95.49%)和F1值(0.983 7、0.978 1和0.9768),表现出良好的检测效果。BCNN模型对波动性较大数据集的检测能力更强,准确率和F1值平均优于其他模型4.74%和0.0246。另一方面,BCNN模型检测时间仅为同类深度学习模型CNN的1/6~1/7,且比传统机器学习模型SVM和RF采用更少的超参数。本研究为农业物联网数据高质量感知及农业信息化提供了一定的参考。考虑到无线传感器网络规模不断扩展,后续研究将更多地关注传感器网络群体异常数据检测,进一步提高农业物联网感知数据质量。

  • 图  1   Bt基因自交系检测

    1:阳性对照Positive control,2:阴性对照Negative control,3:6DH85,4:6DH222,5:J1401,6:8DH273,7:8DH279,8:DL2000 DNA marker

    Figure  1.   Detection of transgenic Bt maize inbred lines

    图  2   Bt基因杂交种检测

    1:DL2000 DNA marker,2:阳性对照Positive control,3:阴性对照Negative control,4:PH6WC×J1401,5:J1490×J1401,6:4DH10×J1401,7:PH1CPS×J1401,8:J1495×J1401,9:PH6WC×8DH273,10:J1490×8DH273,11:J1495×8DH273,12:PH1CPS×8DH273,13:4DH10×8DH273,14:PH6WC×8DH279,15:PH6WC×8DH279,16:J1495×8DH279,17:PH1CPS×8DH279,18:4DH10×8DH279

    Figure  2.   Detection of transgenic Bt maize hybrid lines

    表  1   Bt基因材料苗期、腊熟期田间抗虫表现

    Table  1   Insect-resistance performance of transgenic Bt gene material at seedling stage and wax stage

    组合
    Combination
    苗期 Seedling stage 腊熟期 Maturation stage
    食叶级别
    Leaf-feeding
    level
    虫害级别1)
    Pest
    level
    茎秆折断率/%
    Stem breakage
    rate
    雌穗被害级别
    Ear damage level
    虫害级别1)
    Pest
    level
    茎秆折断率/%
    Stem breakage
    rate
    PH6WC×J1401 6.84 S 0 5.14 S 0
    J1490×J1401 6.33 S 0 5.21 S 0
    J1495×J1401 0 HR 0 1.00 HR 0
    PH1CPS×J1401 6.98 S 0 5.27 S 0
    4DH10×J1401 4.92 MR 0 5.29 S 0
    PH6WC×8DH273 0.23 HR 0 1.00 HR 0
    J1490×8DH273 0.89 HR 0 1.00 HR 0
    J1495×8DH273 0 HR 0 1.00 HR 0
    PH1CPS×8DH273 0 HR 0 1.00 HR 0
    4DH10×8DH273 0 HR 0 1.00 HR 0
    PH6WC×8DH279 0 HR 0 1.00 HR 0
    J1490×8DH279 0 HR 0 1.00 HR 0
    J1495×8DH279 0 HR 0 1.00 HR 0
    PH1CPS×8DH279 0 HR 0 1.00 HR 0
    4DH10×8DH279 0 HR 0 1.00 HR 0
    8DH273 0 HR 0 1.00 HR 0
    8DH279 0 HR 0 1.00 HR 0
    6DH85 6.75 S 0 5.14 S 0
    J1401 0.57 HR 0 1.00 HR 0
    6DH222 6.41 S 0 5.05 S 0
    PH6WC 6.23 S 0 5.13 S 0
    J9D207 6.12 S 0 5.16 S 0
     1) HR:高抗,R:抗,MR:中抗,S:感,高感:HS[16]
     1) HR:High resistance,R:Resistance,MR:Medium resistance,S:Susceptivity,HS: High susceptivity
    下载: 导出CSV

    表  2   Bt基因材料室内抗虫表现1)

    Table  2   Indoor identification of insect resistance of transgenic Bt gene material

    组合
    Combination
    平均单头虫质量/mg
    Average weight of each insect
    死亡率/%
    Mortality
    组合
    Combination
    平均单头虫质量/mg
    Average weight of each insect
    死亡率/%
    Mortality
    0 d 3 d 6 d 9 d 0 d 3 d 6 d 9 d
    PH6WC×J1401 8.50 17.10 41.50 60.40 0 J1490×8DH279 8.29 100
    37.10 42.10 60.10 80.30 0 40.83 40.19 41.49 43.84 0
    88.20 93.40 120.40 140.50 0 91.92 94.87 95.54 96.32 0
    J1490×J1401 7.70 12.30 27.50 44.90 0 J1495×8DH279 7.84 100
    44.20 49.80 65.70 87.30 0 39.16 38.94 39.61 42.59 0
    88.40 95.10 116.90 130.10 0 89.60 91.51 94.35 94.89 0
    J1495×J1401 8.30 100 PH1CPS×8DH279 6.93 100
    42.00 44.60 47.30 49.60 0 39.48 39.51 41.26 42.11 0
    84.40 99.10 96.50 98.40 0 87.52 90.46 92.13 95.62 0
    PH1CPS×J1401 8.46 14.90 25.70 41.90 0 4DH10×8DH279 7.61 100
    37.30 43.20 56.70 77.20 0 38.42 39.46 39.91 42.53 0
    89.40 93.40 107.90 114.60 0 88.46 93.16 95.29 98.89 0
    4DH10×J1401 8.76 11.70 19.60 36.80 0 8DH273 9.14 100
    33.40 39.40 56.10 74.10 0 40.13 39.16 40.13 42.59 0
    90.20 98.60 110.10 119.90 0 90.29 91.95 91.26 93.19 0
    PH6WC×8DH273 8.37 100 8DH279 8.61 100
    36.87 37.23 37.41 38.56 0 42.84 43.19 44.62 44.89 0
    93.48 95.29 96.94 98.26 0 90.16 91.16 93.56 93.89 0
    J1490×8DH273 7.89 100 6DH85 9.33 14.10 23.10 48.90 0
    37.52 38.19 40.53 41.61 0 38.40 41.70 57.80 67.60 0
    92.87 94.51 95.16 97.19 0 89.20 94.50 115.30 123.10 0
    J1495×8DH273 8.06 100 J1401 9.70 100
    34.13 33.81 34.13 36.45 0 34.50 36.40 35.10 37.20 0
    88.24 91.19 93.46 94.60 0 85.50 87.60 97.80 97.50 0
    PH1CPS×8DH273 9.23 100 6DH222 7.91 14.70 28.60 64.90 0
    36.95 37.51 39.48 39.89 0 39.10 44.80 65.10 78.90 0
    89.51 91.46 92.51 95.49 0 84.20 94.10 109.70 119.60 0
    4DH10×8DH273 9.12 100 PH6WC 7.82 11.40 19.90 47.90 0
    37.23 36.26 38.13 39.49 0 35.60 45.70 59.00 77.90 0
    89.62 93.61 96.13 98.60 0 84.30 94.30 113.60 123.90 0
    PH6WC×8DH279 8.16 100 J9D207 6.72 13.50 24.60 56.70 0
    41.25 43.62 43.89 46.91 0 36.40 44.50 68.90 89.40 0
    93.12 94.29 94.13 95.36 0 87.20 96.50 114.70 130.80 0
     1) 表中数据空白处表示玉米螟虫已被转Bt基因玉米叶片毒死
     1) Blank data in the table indicate that the corn locusts had been poisoned by the Bt gene maize leaves
    下载: 导出CSV

    表  3   玉米植株各性状方差分析1)

    Table  3   Variance analysis of different characters of maize plant

    变异来源
    Variance source
    DF 穗长
    Ear length
    穗粗
    Ear coarse
    秃尖长
    Baretop length
    穗质量
    Ear weigh
    百粒质量
    100-grain weight
    产量
    Yield
    组合 Combination 29 656.71** 8.85** 203.30** 855.39** 417.84** 622.40**
    亲本 Parent 28 229.00** 5.36** 166.63** 254.39** 115.37** 296.03**
    误差 Error 39 0 0.99 0 3.55 0.05 0.01
     1) “*”和“**”分别表示影响达到0.05和0.01的显著水平
     1) “*” and “**” indicate the effect reaches 0.05 and 0.01 significance levels, respectively
    下载: 导出CSV

    表  4   不同组合产量多重比较

    Table  4   The multiple comparisons of area yield in different combination

    组合
    Combination
    产量1)/
    (×103 kg·hm−2)
    Yield
    增产/%
    Yield
    increase
    是否含Bt基因
    Whether or not containing
    Bt gene
    组合
    Combination
    产量1)/
    (×103 kg·hm−2)
    Yield
    增产/%
    Yield
    increase
    是否含Bt基因
    Whether or not containing
    Bt gene
    4DH10×8DH279 15.20a 31.10 是 Yes PH6WC×6DH85 13.15hi 13.36 否 No
    PH6WC×8DH279 14.90ab 28.45 是 Yes J1490×J1628 12.88ij 11.03 否 No
    4DH10×8DH273 14.67bc 26.48 是 Yes J1495×J1401 12.76ijk 10.04 是 Yes
    J1490×8DH279 14.47bcd 24.75 是 Yes J1490×6DH85 12.75ijk 9.88 否 No
    PH6WC×8DH273 14.36cde 23.83 是 Yes 4DH10×J1668 12.55jk 8.20 否 No
    J1490×8DH273 14.11def 21.68 是 Yes PH1CPS×6DH222 12.50jk 7.79 否 No
    PH1CPS×8DH279 14.02defg 20.87 是 Yes PH1CPS×J9D207 12.39ljk 6.84 否 No
    J1495×J9D207 13.97defg 20.39 否 No PH6WC×J1668 12.32lk 6.17 否 No
    J1495×8DH279 13.89efg 19.70 是 Yes J1495×J1628 11.72l 1.05 否 No
    J1495×8DH273 13.66fgh 17.73 是 Yes 先玉335(CK) 11.60l 否 No
    4DH10×J1628 13.58gh 17.11 否 No 4DH10×J1401 9.65m −16.81 否 No
    4DH10×J9D207 13.52gh 16.52 否 No PH1CPS×J1401 8.48n −26.91 否 No
    PH1CPS×8DH273 13.25hi 14.22 是 Yes J1490×J1401 7.99no −31.10 否 No
    PH6WC×J1628 13.24hi 14.14 否 No PH6WC×J1401 7.70o −33.62 否 No
     1) 同列数据后的不同小写字母表示差异显著(P < 0.05, Tukey法)
     1) Different lowercase letters of the same column indicate significant difference (P < 0.05, Tukey method)
    下载: 导出CSV

    表  5   Bt基因材料产量性状的杂种优势

    Table  5   Heterosis of transgenic Bt gene materials %

    组合
    Combination
    平均优势
    Average
    heterosis
    对照优势
    Control
    heterosis
    组合
    Combination
    平均优势
    Average
    heterosis
    对照优势
    Control
    heterosis
    组合
    Combination
    平均优势
    Average
    heterosis
    对照优势
    Control
    heterosis
    PH6WC×6DH85 115.56 14.63 PH6WC×J9D207 71.61 −5.11 4DH10×8DH273 124.85 26.48
    J1490×6DH85 102.29 11.11 J1490×J9D207 58.61 −9.53 PH6WC×6DH222 61.77 −11.84
    J1495×6DH85 36.63 −26.65 J1495×J9D207 118.17 21.74 J1490×6DH222 46.64 −17.53
    PH1CPS×6DH85 81.01 0.93 PH1CPS×J9D207 86.66 8.04 J1495×6DH222 33.85 −26.38
    4DH10×6DH85 59.55 −15.75 4DH10×J9D207 114.55 17.83 PH1CPS×6DH222 90.97 9.00
    PH6WC×J1401 37.51 −32.88 PH6WC×J1628 88.18 15.42 4DH10×6DH222 47.65 −20.09
    J1490×J1401 37.81 −30.32 J1490×J1628 77.99 12.27 PH1CPS×8DH279 98.48 20.87
    J1495×J1401 125.60 11.27 J1495×J1628 65.24 2.19 4DH10×8DH279 126.13 31.10
    PH1CPS×J1401 43.81 −26.09 PH1CPS×J1628 53.46 −1.92 PH6WC×J1668 100.43 7.36
    4DH10×J1401 73.67 −15.88 4DH10×J1628 94.26 18.42 J1490×J1668 80.47 −0.19
    PH6WC×8DH273 118.69 23.83 PH6WC×8DH279 120.15 28.45 J1495×J1668 75.73 −4.98
    J1490×8DH273 108.53 21.67 J1490×8DH279 107.67 24.75 PH1CPS×J1668 63.35 −8.29
    J1495×8DH273 106.10 17.73 J1495×8DH279 103.41 19.70 4DH10×J1668 105.71 9.41
    PH1CPS×8DH273 93.03 14.22
    下载: 导出CSV
  • [1] 禚元春. 吉林省玉米主要虫害防治方法[J]. 农业与技术, 2014(11): 153-153. doi: 10.3969/j.issn.1671-962X.2014.11.136
    [2] 宋苗, 汪海, 张杰, 等. 转Bt cry1Ah基因抗虫玉米对亚洲玉米螟、棉铃虫和黏虫的抗性评价[J]. 生物技术通报, 2016, 32(6): 69-75.
    [3] 康岭生, 王玉民, 等. 转Bt基因玉米的抗螟性及产量分析[J]. 玉米科学, 2009, 17(1): 62-64.
    [4] 罗梅浩, 刘建兵, 付贵成, 等. 转Bt基因玉米对亚洲玉米螟的抗性研究[J]. 河南农业大学学报, 2007(1): 77-80. doi: 10.3969/j.issn.1000-2340.2007.01.018
    [5]

    KOZIELM G, BELAND G L, BOWMAN C. Field performance of elite transgenic maize plants expressing an insecticidal protein derived from Bacillus thuringinesis[J]. Nat Biotechnol, 1993, 11: 194-200. doi: 10.1038/nbt0293-194

    [6] 段灿星, 王晓鸣, 朱振东. 作物抗虫种质资源的研究与应用[J]. 植物遗传资源学报, 2003, 4(4): 360-364. doi: 10.3969/j.issn.1672-1810.2003.04.018
    [7]

    SHELTON A M, ZHAO J Z, ROUSH R T. Economic, ecological, food safety, and social comsequences of the deploymen of Bt transgenic plant[J]. Annu Rev Entomol, 2002, 47: 845-881. doi: 10.1146/annurev.ento.47.091201.145309

    [8] 杨召军, 郎志宏, 张杰, 等. 转Bt cry1Ah/cry1Ie双价基因抗虫玉米的研究[J]. 中国农业科技导报, 2012, 14(4): 39-45. doi: 10.3969/j.issn.1008-0864.2012.04.06
    [9] 黎月嫦. 转cry30Fal基因抗虫水稻研究[D]. 雅安: 四川农业大学, 2013.
    [10] 罗赛男. 用DefH9-iaaMTERF1基因转化糖橙的研究[D]. 长沙: 湖南农业大学, 2008.
    [11] 崔杰. 抗虫Bt基因cry1Ac甜菜叶绿体遗传转化与表达研究[D]. 哈尔滨: 哈尔滨工业大学, 2009.
    [12] 林拥军. 农杆菌介导的水稻转基因研究[D]. 武汉: 华中农业大学, 2001.
    [13] 张玲. 抗草甘膦转基因玉米的抗性鉴定、遗传分析及回交转育[D]. 雅安: 四川农业大学, 2016.
    [14] 李永生. 抗真菌双T-DNA植物表达载体构建及农杆菌介导的玉米茎尖遗传转化[D]. 兰州: 甘肃农业大学, 2012.
    [15] 杨芳. 豌豆过氧化氢酶基因在玉米中的转化[D]. 济南: 山东师范大学, 2006.
    [16] 中华人民共和国农业部. 转基因植物及其产品环境安全检测: 抗虫玉米: 农业部953号公告—10.1—2007[S]. 北京: 中国农业出版社, 2007.
    [17] 李桂玲. 玉米转Bt基因后代的抗虫性鉴定研究[D]. 郑州: 河南农业大学, 2002.
    [18] 唐启义, 冯明光. 实用统计分析及其DPS数据处理系统[M]. 北京: 科学技术出版社, 2002.
    [19] 张天真. 作物育种学总论[M]. 北京: 中国农业出版社, 2003: 148.
    [20] 朱卫红, 王庆东, 刘宗华, 等. 玉米转Bt基因后代的抗虫性鉴定及其遗传分析[J]. 河南农业大学学报, 2004, 38(2): 135-138. doi: 10.3969/j.issn.1000-2340.2004.02.004
    [21] 李余良, 胡建广, 苏菁, 等. 基因枪法转Bt/GNA基因超甜玉米植株的获得及抗虫性鉴定[J]. 分子植物育种, 2007, 5(4): 461-466. doi: 10.3969/j.issn.1672-416X.2007.04.003
    [22] 刘清, 萧浪涛, 吴顺, 等. 农杆菌介导法将反义蜡质基因转入杂交稻亲本[J]. 分子植物育种, 2006, 4(4): 500-505. doi: 10.3969/j.issn.1672-416X.2006.04.009
    [23] 罗梅浩, 李潮海, 郭线茹, 等. 转Bt基因玉米对亚洲玉米螟的抗性及其农艺性状研究[J]. 玉米科学, 2006, 14(4): 14-16. doi: 10.3969/j.issn.1005-0906.2006.04.005
    [24] 武淑香, 李晓辉, 殷奎德, 等. 玉米转基因育种回顾[J]. 玉米科学, 2007, 15(4): 63-66. doi: 10.3969/j.issn.1005-0906.2007.04.017
    [25] 王成. 生物技术在玉米育种中的应用[J]. 农业与技术, 2017, 37(4): 36-37.
    [26] 李聪, 李娜, 程贯召, 等. 玉米转基因育种研究进展[J]. 江苏农业科学, 2012, 40(11): 85-89. doi: 10.3969/j.issn.1002-1302.2012.11.032
  • 期刊类型引用(6)

    1. 贾鹿,赵磊,凌飞,李广亚. 基于归一化RBFNN的油井动液面测量数据异常辨识. 电子测量技术. 2024(24): 188-194 . 百度学术
    2. 李志臣,凌秀军,李鸿秋,李志军. 基于改进ShuffleNet的板栗分级方法. 山东农业大学学报(自然科学版). 2023(02): 299-307 . 百度学术
    3. 郑显润,郑鹏,王文秀,程亚红,苏宇锋. 基于多尺度特征提取深度残差网络的水稻害虫识别. 华南农业大学学报. 2023(03): 438-446 . 本站查看
    4. 邓雪阳,邓达平,苏万靖. 基于并行深度卷积神经网络的舰船通信异常数据检测研究. 舰船科学技术. 2023(15): 119-122 . 百度学术
    5. 杨亚琦,李博雄,杨东霞,刘燕. 基于信息熵的异常数据判别方法. 科学技术创新. 2023(24): 194-199 . 百度学术
    6. 杜肖鹏,李恺,王春辉,侯永,尹义蕾,潘守江,张凌风. 国内温室空气温湿度检测及传输技术研究进展. 农业工程技术. 2022(34): 28-34 . 百度学术

    其他类型引用(1)

图(2)  /  表(5)
计量
  • 文章访问数:  1618
  • HTML全文浏览量:  40
  • PDF下载量:  1111
  • 被引次数: 7
出版历程
  • 收稿日期:  2018-09-16
  • 网络出版日期:  2023-05-17
  • 刊出日期:  2019-07-09

目录

/

返回文章
返回