@ -1,5 +1,4 @@
< template >
<!-- < el -scrollbar height = "800px" v-loading ="loading" > - - >
< div class = "main-top" >
< span style = "font-weight: bold; font-size: 18px; color: #3596eb" > 任务描述 < / span >
< p style = "font-weight: 400; font-size: 12px; color: #e6e6e6" > ( 给出任务清单参考 , 做哪些数据的统计分析 ) Lorem ipsum dolor sit amet , consectetur adipiscing elit . Aenean euismod bibendum laoreet . Proin gravida dolor sit amet lacus accumsan et viverra justo commodo . Proin sodales pulvinar sic tempor . Sociis natoque penatibus et magnis dis parturient montes , nascetur ridiculus mus . Nam fermentum , nulla luctus pharetra vulputate , felis tellus mollis orci , sed rhoncus pronin sapien nunc accuan eget . < / p >
@ -16,47 +15,49 @@
< / div >
< div class = "app-main" >
< div class = "main-left" >
< div >
< div class = "left-top" >
< span > 一 、 选择指标 < / span >
< / div >
< div class = "metrics" >
< el -select v-model ="n_dataTableQuery.tableName" placeholder="请选择数据" style="width: 180px" @change="selectType" >
< el -option v -for = " item in algorithmStore.userDataLabel " :key ="item" :label ="item" :value ="item" / >
< / e l - s e l e c t >
< / div >
< div class = "metrics-table" style = "margin-top: 10px" >
< el -table border ref = "multipleTableRef" :data ="algorithmStore.indexLibrary" style = "width: 100%" :header-cell-style ="headerCellStyle" @selection-change ="handleSelectionChange" >
< el -table -column type = "selection" prop = "date" label = "Date" align = "center" / >
< el -table -column label = "指标" align = "center" prop = "label" / >
< / e l - t a b l e >
< el -button @click ="submit" > 确 定 < / el -button >
< / div >
< div class = "left-top" >
< span > 二 、 数据预处理 < / span >
< / div >
< div class = "metrics" >
< el -select v-model ="preProcessText.text1" placeholder="请选择数据" style="width: 180px" >
< el -option label = "数据去重" value = "数据去重" / >
< / e l - s e l e c t >
< / div >
< div class = "metrics" style = "margin-top: 15px" >
< el -select v-model ="preProcessText.text2" placeholder="请选择数据" style="width: 180px" @change="preProcess" >
< el -option label = "缺失值处理-剔除数据" value = "缺失值处理-剔除数据" / >
< el -option label = "缺失值处理一均值替代" value = "缺失值处理一均值替代" / >
< / e l - s e l e c t >
< / div >
< div class = "left-top" style = "margin-top: 10px" >
< span > 三 、 模型参数设置 < / span >
< / div >
< div class = "metrics-table" style = "margin-top: 10px" >
< el -table border ref = "multipleTableRef" :data ="modelParams" style = "width: 100%" :header-cell-style ="headerCellStyle" @selection-change ="handlemodelSelectionChange" >
< el -table -column type = "selection" prop = "date" label = "Date" align = "center" / >
< el -table -column prop = "name" label = "统计量" align = "center" / >
< / e l - t a b l e >
< el -button @click ="modelCalculation" > 计 算 < / el -button >
< el -scrollbar height = "550px" style = "padding-right: 10px" min -size = " 5 " >
< div >
< div class = "left-top" >
< span > 一 、 选择指标 < / span >
< / div >
< div class = "metrics" >
< el -select v-model ="n_dataTableQuery.tableName" placeholder="请选择数据" style="width: 180px" @change="selectType" >
< el -option v -for = " item in algorithmStore.userDataLabel " :key ="item" :label ="item" :value ="item" / >
< / e l - s e l e c t >
< / div >
< div class = "metrics-table" style = "margin-top: 10px" >
< el -table border ref = "multipleTableRef" :data ="algorithmStore.indexLibrary" style = "width: 100%" :header-cell-style ="headerCellStyle" @selection-change ="handleSelectionChange" >
< el -table -column type = "selection" prop = "date" label = "Date" align = "center" / >
< el -table -column label = "指标" align = "center" prop = "label" / >
< / e l - t a b l e >
< el -button @click ="submit" > 确 定 < / el -button >
< / div >
< div class = "left-top" >
< span > 二 、 数据预处理 < / span >
< / div >
< div class = "metrics" >
< el -select v-model ="preProcessText.text1" placeholder="请选择数据" style="width: 180px" >
< el -option label = "数据去重" value = "数据去重" / >
< / e l - s e l e c t >
< / div >
< div class = "metrics" style = "margin-top: 15px" >
< el -select v-model ="preProcessText.text2" placeholder="请选择数据" style="width: 180px" @change="preProcess" >
< el -option label = "缺失值处理-剔除数据" value = "缺失值处理-剔除数据" / >
< el -option label = "缺失值处理一均值替代" value = "缺失值处理一均值替代" / >
< / e l - s e l e c t >
< / div >
< div class = "left-top" style = "margin-top: 10px" >
< span > 三 、 模型参数设置 < / span >
< / div >
< div class = "metrics-table" style = "margin-top: 10px" >
< el -table border ref = "multipleTableRef" :data ="modelParams" style = "width: 100%" :header-cell-style ="headerCellStyle" @selection-change ="handlemodelSelectionChange" >
< el -table -column type = "selection" prop = "date" label = "Date" align = "center" / >
< el -table -column prop = "name" label = "统计量" align = "center" / >
< / e l - t a b l e >
< el -button @click ="modelCalculation" > 计 算 < / el -button >
< / div >
< / div >
< / div >
< / e l - s c r o l l b a r >
< div style = "margin-top: auto" >
< div class = "startOver" @click ="restart" >
< img src = "../../../assets/images/重新开始.png" alt = "" / >
@ -65,24 +66,25 @@
< / div >
< / div >
< div class = "main-right" >
< div >
< span style = "font-weight: bold; font-size: 18px; color: #3596eb" > 分析数据 : < / span >
< el -table :data ="analysisData" style = "width: 100%; margin-top: 10px" :header-cell-style ="headerCellStyle" >
< el -table -column v -for = " column in analysisHanderKry " :key ="column" :prop ="column" :label ="column" align = "center" / >
< / e l - t a b l e >
< pagination v -show = " n_analyzeTheNumberOfDataItems > 0 " :total=" n _analyzeTheNumberOfDataItems " v-model:page=" n _dataTableQuery . index " v-model:limit=" n _dataTableQuery . size " @pagination=" analyzeDataNext " / >
< / div >
< div class = "analysisResults" style = "margin-top: 20px" >
< span style = "font-weight: bold; font-size: 18px; color: #3596eb; display: block" > 分析结果 : < / span >
< el -button @click ="download" > 下 载 < / el -button >
< el -table :data ="tableData" style = "width: 100%; margin-top: 10px" :header-cell-style ="headerCellStyle" height = "350" >
< el -table -column v-for ="column in tableLabel" :key="column.label" :prop="column.prop" :label="column.label" align="center" > < / el -table -column >
< / e l - t a b l e >
< pagination v -show = " nNumberOfAnalysisResults > 0 " :total=" nNumberOfAnalysisResults " v-model:page=" gAnalysisResults . index " v-model:limit=" gAnalysisResults . size " @pagination=" updatePageAnalysisResults " / >
< / div >
< el -scrollbar height = "550px" style = "padding: 20px" >
< div >
< span style = "font-weight: bold; font-size: 18px; color: #3596eb" > 分析数据 : < / span >
< el -table :data ="analysisData" style = "width: 100%; margin-top: 10px" :header-cell-style ="headerCellStyle" >
< el -table -column v -for = " column in analysisHanderKry " :key ="column" :prop ="column" :label ="column" align = "center" / >
< / e l - t a b l e >
< pagination v -show = " n_analyzeTheNumberOfDataItems > 0 " :total=" n _analyzeTheNumberOfDataItems " v-model:page=" n _dataTableQuery . index " v-model:limit=" n _dataTableQuery . size " @pagination=" analyzeDataNext " / >
< / div >
< div class = "analysisResults" style = "margin-top: 20px" >
< span style = "font-weight: bold; font-size: 18px; color: #3596eb; display: block" > 分析结果 : < / span >
< el -button @click ="download" > 下 载 < / el -button >
< el -table :data ="tableData" style = "width: 100%; margin-top: 10px" :header-cell-style ="headerCellStyle" height = "350" v-loading ="loading" >
< el -table -column v-for ="column in tableLabel" :key="column.label" :prop="column.prop" :label="column.label" align="center" > < / el -table -column >
< / e l - t a b l e >
< pagination v -show = " nNumberOfAnalysisResults > 0 " :total=" nNumberOfAnalysisResults " v-model:page=" gAnalysisResults . index " v-model:limit=" gAnalysisResults . size " @pagination=" updatePageAnalysisResults " / >
< / div >
< / e l - s c r o l l b a r >
< / div >
< / div >
<!-- < / e l - s c r o l l b a r > - - >
< el -dialog v-model ="dialogVisible" title="实训任务提交" width="565" custom-class="dialogClass" :show-close="false" >
< template # header = "{ close, titleId, titleClass }" >
< div class = "my-header" >
@ -154,39 +156,76 @@
< / div >
< / template >
< / e l - d i a l o g >
< pop -model
: showModel = "runResultShow"
title = "关联规则挖掘"
@ closePop = "runResultShow = false"
>
< template v -slot : content >
< div >
< p style = "font-weight: 700;font-size:22px" > 什么是描述性统计分析 < / p > < p > 描述性统计分析是数据分析的一种方法 , 旨在对数据进行总结和描述 , 以便更好地理解数据的特征和趋势 。 它主要通过统计指标和图表来呈现数据的基本特征 , 包括中心趋势 、 离散程度 、 分布形态等 。 < br / > 常用的描述性统计指标包括 : < / p > < li > 中心趋势 : 用于描述数据集的集中程度 , 常见的指标有均值 、 中位数和众数 。 < / li > < li > 离散程度 : 用于描述数据的分散程度 , 常见的指标有方差 、 标准差和极差 。 < / li > < li > 分布形态 : 用于描述数据的分布形态 , 常见的指标有偏度和峰度 。 < / li > < p > 描述性统计分析还可以通过图表来展示数据的特征 , 常见的图表包括 : < / p >
< li > 频数分布表和直方图 : 用于展示数据的分布情况 , 可以观察数据的集中程度和离散程度 。 < / li > < li > 箱线图 : 用于展示数据的分布情况和离群值 , 可以观察数据的中位数 、 四分位数和异常值 。 < / li > < li > 散点图 : 用于展示两个变量之间的关系 , 可以观察数据的相关性和趋势 。 < / li > < p > 描述性统计分析可以帮助我们对数据有一个直观的了解 , 发现数据中的规律和异常情况 , 为后续的数据分析和决策提供基础 。 < / p > < p style = "font-size:19px;font-weight:600" > 描述性统计分析的优势和局限性 < / p > < p > 描述性统计分析的优势和局限性如下 : < br / > 优势 : < / p > < li > 简单易懂 : 描述性统计分析使用简单的统计指标和图表 , 可以直观地呈现数据的特征 , 使人们更容易理解和解释数据 。 < / li >
< li > 提供概览 : 通过描述性统计分析 , 可以获得数据的整体概览 , 包括数据的中心趋势 ( 如均值 、 中位数 ) 、 数据的分布情况 ( 如标准差 、 百分位数 ) 等 。 < / li > < li > 发现异常值 : 描述性统计分析可以帮助我们发现数据中的异常值或离群点 , 从而帮助我们识别数据质量问题或异常情况 。 < / li > < p > 局限性 : < / p > < li > 缺乏深入分析 : 描述性统计分析主要关注数据的基本特征 , 无法深入挖掘数据背后的关联和因果关系 。 < / li > < li > 无法进行推断 : 描述性统计分析只是对已有数据的总结和描述 , 并不能进行推断或预测 。 < / li > < li > 受数据限制 : 描述性统计分析的结果受到数据本身的限制 , 如果数据质量不好或数据量较小 , 可能会导致结果不准确或不可靠 。 < / li > < p > 综上所述 , 描述性统计分析是数据分析的重要工具 , 可以帮助我们了解数据的基本特征和趋势 , 但在深入分析和推断方面有一定的局限性 。 < / p >
< p style = "font-size:19px;font-weight:600" > 描述性统计分析的常用方法 < / p > < p > 描述性统计分析是对数据进行总结和描述的过程 , 常用的方法包括 : < / p > < li > 中心趋势度量 : 包括均值 ( mean ) 、 中位数 ( median ) 和众数 ( mode ) , 用于描述数据的集中程度 。 < / li > < li > 离散程度度量 : 包括方差 ( variance ) 、 标准差 ( standard deviation ) 和极差 ( range ) , 用于描述数据的离散程度 。 < / li > < li > 分布形状度量 : 包括偏度 ( skewness ) 和峰度 ( kurtosis ) , 用于描述数据的分布形状 。 < / li > < li > 频数统计 : 通过频数表 、 频率分布表和直方图等方式 , 统计数据的频数和频率 。 < / li > < li > 百分位数 : 用于描述数据中某个特定百分比的位置 , 如中位数 、 四分位数等 。 < / li > < li > 相关性分析 : 通过计算相关系数 ( 如Pearson相关系数 ) 来衡量两个变量之间的相关性 。 < / li >
< p style = "font-size:19px;font-weight:600" > 描述性统计分析的应用场景 < / p > < p > 描述性统计分析在许多领域和应用场景中都有重要的作用 , 以下是一些常见的应用场景 : < / p > < li > 提供概览 : 描述性统计分析可以提供数据的概览 , 帮助我们了解数据的整体特征和规律 。 通过计算中心趋势测量 ( 如均值 、 中位数 、 众数 ) 、 离散程度测量 ( 如方差 、 标准差 、 极差 ) 和分布形态测量 ( 如偏度 、 峰度 ) , 我们可以得到数据的集中趋势 、 离散程度和分布形态等信息 。 < / li > < li > 数据比较 : 描述性统计分析可以帮助我们比较不同组或不同时间点的数据 。 通过比较不同组的中心趋势 、 离散程度和分布形态等 , 我们可以了解不同组之间的差异和相似之处 , 从而得出结论或提出假设 。 < / li > < li > 发现异常值 : 描述性统计分析可以帮助我们发现数据中的异常值 。 通过观察离群点 ( 如极端值 ) 和异常值 ( 如异常观测值 ) , 我们可以发现数据中的异常情况 , 进而进行进一步的分析和处理 。 < / li >
< li > 数据可视化 : 描述性统计分析可以通过可视化方法 ( 如直方图 、 散点图 、 箱线图等 ) 将数据转化为图形 , 使得数据更加直观和易于理解 。 数据可视化可以帮助我们发现数据的分布模式 、 趋势和关联关系 , 从而更好地理解数据 。 < / li > < li > 数据摘要 : 描述性统计分析可以通过频数和频率分布表 、 百分位数等方式对数据进行摘要和概括 。 这些摘要信息可以帮助我们对数据进行快速的了解和比较 , 从而支持后续的决策和分析 。 < / li > < li > 假设检验 : 描述性统计分析可以为假设检验提供依据 , 通过对样本数据的描述性统计分析 , 我们可以判断样本数据是否符合某种假设分布 , 从而进行假设检验 。 < / li > < li > 数据报告和展示 : 描述性统计分析可以提供数据的概括性描述 , 用于撰写数据报告和展示 , 帮助他人更好地理解数据的特征和趋势 。 < / li > < li > 数据清洗 : 描述性统计分析可以帮助我们发现数据中的问题和错误 。 通过观察数据的分布情况和异常值 , 我们可以判断数据的质量 , 并进行必要的数据清洗和修正 。 < / li >
< li > 数据探索 : 描述性统计分析是探索性数据分析的一部分 , 它可以帮助我们发现数据中的模式 、 关联和趋势 。 通过观察数据的分布 、 散点图 、 相关系数等 , 我们可以发现数据中的隐藏信息和规律 。 < / li > < li > 决策支持 : 描述性统计分析可以为决策提供支持 。 通过对数据的摘要和可视化 , 我们可以获取有关数据的重要信息 , 帮助决策者做出基于数据的决策 。 < / li > < p style = "font-size:19px;font-weight:600" > 如何进行描述性统计分析 < / p > < p > 开展描述性统计分析可以按照以下步骤进行 : < / p > < li > 收集数据 : 首先 , 需要收集所需的数据 , 可以是通过调查问卷 、 实验 、 观察或从现有数据源获取 。 < / li > < li > 数据清洗 : 对收集到的数据进行清洗 , 包括处理缺失值 、 异常值和错误数据等 。 < / li > < li > 描述性统计 : 使用统计方法计算数据的基本统计量 , 如平均值 、 中位数 、 标准差等 , 以了解数据的集中趋势 、 离散程度和分布情况 。 < / li > < li > 可视化展示 : 将统计结果以图表的形式进行可视化展示 , 如直方图 、 箱线图 、 散点图等 , 以更直观地呈现数据的特征和趋势 。 < / li >
< li > 解读分析结果 : 根据统计分析的结果 , 解读数据的含义和趋势 , 提取有用的信息和洞察 , 并进行合理的解释和推断 。 < / li > < p style = "font-size:19px;font-weight:600" > 描述性统计分析的注意事项 < / p > < p > 在进行描述性统计分析时 , 有以下几个注意事项 : < / p > < li > 数据质量 : 确保数据的准确性和完整性 。 进行数据清洗 , 处理缺失值 、 异常值和重复值等 , 以保证分析结果的可靠性 。 < / li > < li > 数据类型 : 根据数据的类型选择合适的统计方法和图表 。 对于定量数据 , 可以使用均值 、 标准差等统计量 ; 对于定性数据 , 可以使用频数和百分比等统计量 。 < / li > < li > 样本大小 : 考虑样本大小对统计结果的影响 。 样本较小可能导致统计结果不够准确 , 而样本较大可能会增加计算复杂度 。 < / li > < li > 数据分布 : 了解数据的分布情况 , 选择合适的统计方法和图表 。 例如 , 对于正态分布的数据 , 可以使用均值和标准差进行描述 ; 对于偏态分布的数据 , 可以使用中位数和四分位数等进行描述 。 < / li > < li > 上下文和目的 : 考虑数据分析的上下文和目的 。 根据具体的问题和需求 , 选择合适的统计方法和图表 , 以便更好地解读数据和提取有价值的信息 。 < / li >
< li > 解读和推断 : 描述性统计分析主要是对数据进行概括和描述 , 不能进行推断和因果分析 。 在解读结果时 , 要注意避免过度解读和误导 。 < / li > < li > 可视化呈现 : 使用合适的图表和图形将数据可视化 , 以便更好地传达数据的特征和趋势 。 选择简洁明了的图表 , 避免图表过于复杂和混乱 。 < / li >
< / div >
<!-- 情感分析 -- >
<!-- < div >
< p style = "font-weight: 700;font-size:22px" > 总览 < / p > < p > 文本分析指对文本数据进行表示 ( representation ) , 处理 ( processing ) 和建模 ( modeling ) 来获得有用的见解 ( insight ) 。 < br / > 文本分析的一个挑战是高维度 ( high dimensionality ) 。 < br / > < br / > 语料库 : 指在自然语言处理中用于各种目的的大量文本 ( 文档 ) 集合 。 < br / > < br / > 另一个挑战是 : 大多数情况下文本是非结构化数据 ( not structured ) 。 < / p > < img src = "@/assets/images/f4001.png" alt = "" > < p style = "font-weight: 700;font-size:22px" > 文本分析步骤 < / p > < p > & nbsp ; & nbsp ; & nbsp ; & nbsp ; 1. 句法分析 ( Parsing ) : 是指处理非结构化文本使其具有一定的结构 , 供将来分析的过程 。 句法分析将文本进行解构 , 然后以一种更为结构化的方式来呈现 。 ( unsturctured - > sturctured ) < br / > & nbsp ; & nbsp ; & nbsp ; & nbsp ; 2. 搜索和检索 ( Search and retrieval ) : 在一个语料库中识别包含例如特殊单词 , 短语 , 主题或者实体 ( 如人或组织 ) 等搜索项 ( search items ) 的文档 。 这些搜索项通常称为关键术语 ( key term ) 。 < br / > & nbsp ; & nbsp ; & nbsp ; & nbsp ; 3. 文本挖掘 ( text mining ) : 指使用前两步产生的术语和索引来发现与感兴趣领域或问题相关的有意义的见解 ( discover meaningful insights ) 。 < br / > 聚类 ( clustering ) 和 分类 ( classification ) 都可以应用于文本挖掘 。 比如 : 将文档聚化成簇 或者 分类文本以进行情感分析 ( sentiment analysis ) 。 < br / > 文本挖掘可以利用来自各个研究领域的方法和技术 , 如统计分析 ( statistical analysis ) , 信息检索 ( information retrieval ) , 数据挖掘 ( data mining ) 和自然语言处理 ( natural language processing ) 等 。 < / p >
< p style = "font-weight: 700;font-size:22px" > 挑战 < / p > < li > 语法 ( syntax ) : 涉及句子结构和语法规则 。 < / li > < li > 语义 ( semantics ) : 是对句子含义的研究 。 < / li > < li > 语用 ( pragmatic ) : 关注特定上下文中句子的含义 。 < / li > < li > 同义词 ( homonyms ) : 具有相同拼写但含义不同的单词 。 < / li > < li > 缩写词 ( acronyms ) : 是单词的缩写形式 。 < / li > < p > 对于计算机来说 , 文本只是编码和数字的字符序列 ( sequence of characters ) 。 它不了解语法 , 语义 ( semantic meanings ) 和其实用含义 ( pragmatic meaning ) 。 < br / > 同时 , 在原始形式中 , 单词或者文本之间没有自然相似性度量 ( nature similarity metric ) 。 ( 因此难以执行聚类或分类 ) < br / > 因此 , 我们需要以适合用于聚类和分类的形式来表示和处理文本 。 < / p > < p style = "font-weight: 700;font-size:22px" > 第一步 : 收集原始文本数据 ( Collecting Raw Text ) < / p > < p > 对于文本分析来说 , 进行任何事情之前必须先收集数据 。 < / p >
< li > 可以在许多网站上对用户生成的内容 ( user - generated contents ) 开始积极的监控 。 ( 可以使用公开的API , 网页爬虫 web scraper / crawler ) < / li > < li > 准备处理非结构化或者半结构化数据 。 < / li > < p style = "font-weight: 700;font-size:22px" > 第二步 : 表示文本 ( Representing Text ) < / p > < p > 使用文本规范化的技术 ( text normalization techniques ) 对原始文本进行转化 。 < / p > < li > 分词 ( tokenization ) : 指从文本正文中分离 ( 也叫做标记 ) 单词 ( seperating words ) 。 < / li > < p > & nbsp ; & nbsp ; & nbsp ; & nbsp ; & nbsp ; & nbsp ; 1. 按空格 ( spaces ) 来分词 。 ( 可能会把标点符号也给分出来 , 比如 day . ) < br / > & nbsp ; & nbsp ; & nbsp ; & nbsp ; & nbsp ; & nbsp ; 2. 基于标点符号和空格来分词 ( 可能会把 we ’ ll , can ’ t , state - of - the - art 等直接分开 ) < br / > & nbsp ; & nbsp ; & nbsp ; & nbsp ; & nbsp ; & nbsp ; 分词比想象中更困难 ( résumé 和 resume ) < br / > 没有一个分词器适用于每一种情形 ( no one - size - fits - all ) 。 < / p > < li > 大小写转换 ( case folding ) : 将所有的字母都变成小写 ( 或者都变成大写 ) 。 < / li >
< p > & nbsp ; & nbsp ; & nbsp ; & nbsp ; & nbsp ; & nbsp ; 1. 但是在一些情况下可能会出错 : 如专有名词 , 缩写 , 公司名等 ( General Motors ; WHO ; US ; ) < br / > & nbsp ; & nbsp ; & nbsp ; & nbsp ; & nbsp ; & nbsp ; 2. 减少错误的方法是对不进行大小写转换的单词建立一个查找表 ( lookup table ) 。 < / p > < li > 停止词 ( stop word ) : 在给定语言中 , 并非所有的单词都需要被考虑 。 ( 比如 : the , a , of , and , to等这些不太可能有助于语义的理解 ) < / li > < li > 词根法 ( Lemmatization ) 和词干法 ( Stemming ) : 词根法看单词的意义 ( 如 : Goose , geese , goose , gander , ganders ) 。 词干法看单词的组成 ( 如 : walk , walking , Walk , walks , walked ) 。 最受欢迎的是 "Porter stemmer" , “ WordNet ” 。 < / li > < li > 词袋法 ( Bag - of - words representation ) : 将文档转化成高维向量 ( high - dimensional vector ) , 向量指示了文档中各个单词的 存在 / 不存在 / 出现频率 ( presence / absence / frequency ) 。 < / li > < img src = "@/assets/images/f4002.png" alt = "" > < p > 词袋法足够简单 ( 朴素且过分简化问题 naive and over - simplified ) 并被广泛应用于文本分析问题中 ( 是入门的好方法 ) 。 其将文档表示为一组词语 ( 单词 ) , 而忽略了其他信息 ( 如顺序 order , 上下文 context , 推论 inferences和语义 semantics ) 。 比如 , “ a dog bites a man ” 和 "a man bites a dog" 意思完全不同但是他们在词袋法里是同一种表示 。 < / p >
< li > 语料库的表示 ( Representation of a corpus ) : 语料库可以大到包括一种或者多种语言的所有文档 , 也可以小到仅限于特定领域 ( focused on a specific domains ) 。 < / li > < p > 大多数语料库都具有元数据 , 比如语料库的大小以及文本提取的领域 。 某些语料库包含了文本中出现的每个词的信息内容 ( Information content , IC ) 。 信息内容是用来表示语料库中词语重要性 ( importance of a term ) 的度量 。 IC值较高的词语的重要性要比IC值较低的词语高 。 < br / > 然而 , 信息内容无法满足分析动态改变的非结构化数据的需求 。 问题 : 传统语料库和IC元数据都无法随着时间改变 , 因此任何语料库中不存在的词汇和任何新发明的词汇都会自动得到0的IC值 。 其次 , 传统语料库限制了用于文本分析算法 ( text analysis algorithm ) 的全部知识 ( 语料库代表了整个知识库 ) 。 < / p > < p style = "font-weight: 700;font-size:22px" > 第三步 : 词频 - 逆文档频率 ( TFIDF - Term Frequency - Inverse Document Frequency ) < / p > < p style = "font-weight: 600;font-size:18px" > 词频 ( Term Frequency ) < / p > < p > 我们需要一个适应文本上下文 ( context ) 和性质 ( nature ) 的度量标准 metric ( 不像IC一样 ) 。 < br / > TFIDF直接作用于所有获取的文档 ( fetched documents ) 。 一旦获取的文档发生更改 , TFIDF可以被轻松更新 。 TFIDF是一种广泛用于文本分析的措施 。 TFIDF对动态内容的处理也是相当强大且有效的 , 因为文档的变化只需要更新频率计数 。 < br / >
给定一个单词 t 以及一个包含 n 个词的文档 d = { t1 , t2 , … , tn } 。 在 d 中 t 最简单的词频形式可以定义为 t 在 d 中出现的次数 。 < / p > < img src = "@/assets/images/f4003.png" alt = "" > < p > 可以对词频函数取对数 , 以获得更多数据细节 。 < / p > < img src = "@/assets/images/f4005.png" alt = "" > < p > 对于长文档 , 因为其包含的词语数量和种类多 , 因此往往有更高的词频值 。 这些因素导致了长文档的词频值的提升 , 以至于人们对长文档产生了偏见 。 为了解决这个问题 , 可以对词频进行规范化 。 < / p > < img src = "@/assets/images/f4006.png" alt = "" > < p > Zipf ’ s Law : 第 i 个最常见的单词出现在最常见词的 1 / i 处 。 < / p > < p style = "font-weight: 600;font-size:18px" > Term Frequency 问题 < / p > < p > 词语的重要性仅取决于其在特定文档中的存在 。 如果该词语频繁出现在每个文档中怎么办 ? 这个词还重要吗 ? 我们需要拓宽我们的视野 , 不仅要在单个文档中 , 而是要在整个语料库中考虑一个词语的重要性 。 < / p > < p style = "font-weight: 600;font-size:18px" > 词语的文档频率 ( Document Frequency of a term ) < / p > < p > 文档频率被定义为语料库中包含一个词语的文档的数目 。 假设语料库D包含N个文档 。 语料库D = { d1 , d2 , … , dn } 中词语 t 的文档频率的定义为 : < / p > < img src = "@/assets/images/f4007.png" alt = "" > < p style = "font-weight: 600;font-size:18px" > 逆文档频率 ( Inverse Document Frequency ) < / p > < p > 逆文档频率的定义 , N代表了语料库的总文档数 , DF ( t ) 代表单词 t 的文档频率 。 逆文档频率就是他们的商取对数得到 。 < / p >
< img src = "@/assets/images/f4008.png" alt = "" > < p > 如果词语不在语料库内 , 会导致分母为零 , 快速解决的方法是在分母上加个1 。 < / p > < img src = "@/assets/images/f4009.png" alt = "" > < p > 拥有较高IDF的词往往在整个语料库中更重要 。 罕见单词的IDF会很高 。 高频单词的IDF会很低 。 < br / > 警告 , 因为语料库中所有文档数目 ( N ) 是保持恒定的 , 因此IDF仅取决于DF , 那些DF值最低的词获得相同的最高IDF 。 因此 , 有必要引入更多权重词来对文档中出现次数相同的词进行区分 。 < / p > < p style = "font-weight: 600;font-size:18px" > TFIDF < / p > < p > 是一种既考虑词在单个文档中的普及率 prevalence ( TF ) , 也考虑他在整个语料库中的稀缺程度 scarcity ( IDF ) 的评估方法 。 词语 t 在文档 d 中的TFIDF 定义为 d 中 t 的词频 乘以语料库中 t 的文档频率 , 如下公式 : < / p > < img src = "@/assets/images/f4010.png" alt = "" > < p > 一个词的TFIDF值越高 , 它在一个文档中出现的就越频繁 , 但在语料库的所有文档中出现得就越少 。 < br / > TFIDF在简单和直接的计算中是很有效的 , 因为它不需要文本含义的相关知识 。 文档 d 被表示为 TFIDF ( t , d ) 值 的高维向量 ( high - dimensional vector ) 。 < br / > < br / > TFIDF方法减少描述长度的数量相对较少 , 同时其很难揭示文档内或文档之间 ( intra - document or inter - document ) 的统计结构 。 < br / > 主题建模 ( Topic Modelling ) 能够解决这个问题 。 主题 ( topic ) : 经常在一起出现的具有相关含义的单词簇 ( a cluster of words ) 。 每个词在主题中都有权重 。 < / p >
< p style = "font-weight: 700;font-size:22px" > 第四步 : 主题建模 ( Topic Modelling ) < / p > < p > 主题建模提供了文档的简短描述 。 同时 , 它也提供了自动组织 , 搜索 , 理解并汇总大量信息的工具 。 主题建模是统计模型 , 它研究一组文档中的单词 , 确定文档主题 , 并发现主题是如何相关 ( associated ) 或者如何随时间变化的 ( change over time ) 。 < / p > < p style = "font-weight: 600;font-size:18px" > 流程 < / p > < p > & nbsp ; & nbsp ; & nbsp ; & nbsp ; 1. 揭开 ( uncover ) 语料库中隐藏的主题模式 ( hidden topical patterns ) 。 < br / > & nbsp ; & nbsp ; & nbsp ; & nbsp ; 2. 根据这些主题来注释文档 ( annotate document ) 。 < br / > & nbsp ; & nbsp ; & nbsp ; & nbsp ; 3. 使用注释来组织 , 搜索 , 汇总文档 ( organize , search , summarise ) 。 < / p > < p style = "font-weight: 600;font-size:18px" > 主题 ( topic ) < / p > < p > 一个主题被正式定义为固定单词词汇分布 ( a distribution over a fixed vocabulary of words ) 。 不同的主题在相同的词汇上会有不同的分布 。 词汇中的某个词可以在多个主题中有不同的权重 。 < br / > 一个文档通常由多个主题以不同的比例贯穿文本 。 < / p > < p style = "font-weight: 600;font-size:18px" > LDA < / p > < p > 最简单的主题模型是Latent Dirichlet Allocation ( LDA ) , 这是一个语料库的生成概率模型 ( generative probabilistic model of a corpus ) 。 在生成概率模型中 , 从概率密度函数 ( probability density function ) 得出模型观测值 ( model observation ) 。 在LDA中 , 文档被视为生成过程 ( generative process ) 的结果 ( 带有隐藏变量 hidden variables ) 。 < br / > LDA假设了 : < br / > < / p > < li > 有一个固定的词汇表 ( fixed vocabulary of words ) 。 < / li >
< li > 潜在主题 ( latent topics ) 的数目是预定义的 。 < / li > < li > 每个潜在主题的特征都是词汇表中单词的分布 ( Dirichlet distribution ) 。 < / li > < li > 每个文档表示潜在主题的一个随机混合 ( random mixture ) 。 < / li > < p style = "font-weight: 600;font-size:18px" > LDA流程 < / p > < p > & nbsp ; & nbsp ; & nbsp ; & nbsp ; 1. 选择文档的长度N 。 < br / > & nbsp ; & nbsp ; & nbsp ; & nbsp ; 2. 每个文档有一个在主题上的分布 。 < br / > & nbsp ; & nbsp ; & nbsp ; & nbsp ; 3. 为文档中的每个词分配一个主题 , 并选择相应的主题中的单词 。 < br / > < br / > 在现实中 , 只有文档是可用 ( available ) 的 。 LDA的目标是为每一个文档推断潜在的主题 ( underlying topic ) , 主题比例 ( topic proportion ) 以及主题分配 ( topic assignment ) 。 < / p > < p style = "font-weight: 600;font-size:18px" > 算法 < / p > < p > & nbsp ; & nbsp ; & nbsp ; & nbsp ; 1. 选择一个值 k 。 < br / > & nbsp ; & nbsp ; & nbsp ; & nbsp ; 2. 对于每个文档 , 将文档中的每个单词随机分配给k个主题之一 。 < br / > & nbsp ; & nbsp ; & nbsp ; & nbsp ; 对于每个文档 d , 遍历每个单词 w , 然后计算 d 中分配给主题 t 的单词所占的比例 , 通常会应用平滑 ( smoothing ) 处理 : < / p > < img src = "@/assets/images/f4011.png" alt = "" > < p > & nbsp ; & nbsp ; & nbsp ; & nbsp ; 4. 计算从单词w来的所有文档中对主题 t 的分配比例 P ( w | t ) < br / > & nbsp ; & nbsp ; & nbsp ; & nbsp ; 5. 计算属于主题 t 的单词 w 的概率 : < / p > < img src = "@/assets/images/f4012.png" alt = "" > < p style = "font-weight: 600;font-size:18px" > 注意事项 < / p > < p > LDA将文档视为主题的混合体 。 < br / > LDA将主题视为单词的混合体 。 < br / > 如果单词 w 很有可能出现在主题 t 中 , 则所有带有 w 的文档将与主题 t 的关联更为紧密 。 < br / >
如果单词 w 不太可能出现在主题 t 中 , 则包含 w 的文档出现在 t 中的可能性将会很小 。 因为文档 d 中剩余的单词将出现在其他主题中 , 因此 d 有更高的可能性属于那些主题 。 因此 , 就算我们将 w 添加到 t 中 , 也不会将很多该类文档带到 t 。 < / p > < p style = "font-weight: 600;font-size:18px" > 应用 < / p > < p > 主题模型可以被用于文档建模 ( document modelling ) , 文档分类 ( document classification ) 与协同过滤 ( collaborative filtering ) 。 < br / > 主题模型不仅可以应用于文本数据 , 它还可以用于注释图像 。 < / p > < p style = "font-weight: 700;font-size:22px" > 情感分析 ( Sentiment Analysis ) < / p > < p > 情感分析使用统计和自然语言处理来从文本中挖掘观点来识别并抽取主观信息 。 < br / > 应用 : 检测产品或者电影的评论的极性 ( polarity of reviews ) 。 < br / > < br / > 分析层面包括了文档层面 ( document ) , 语句层面 ( sentence ) , 短语层面 ( phrase ) , 和短文层面 ( short - text ) 。 < br / > < br / > 分类方法 ( 朴素贝叶斯 , 最大熵 , 或者支持向量机SVM ) 经常被用来提取语料库统计以用于情感分析 。 < / p > < img src = "@/assets/images/f4013.png" alt = "" > < p > 分类器仅基于对其进行训练的数据集来确定情感 : < / p > < li > 词义随着领域不同而改变 。 < / li > < li > 因此模型无法直接应用于其他领域 。 < / li > < p > 绝对的情感水平无法提供信息 , 应该建立一条基线 , 然后将其与观察值比较 。 比如 , 一个产品拥有40 % 正面推文 , 60 % 负面推文 , 貌似是不成功的 。 但是如果其他类似的成功产品也有类似的正负面百分比 , 那么不应该认为该产品是不成功的 。 < br / > < br / > 如何对大量评论添加标签 ( 积极 , 消极 , 中立 ) : < br / > < br / > & nbsp ; & nbsp ; & nbsp ; & nbsp ; 1. 使用表情符号 ( 小心阴阳怪气 ) < br / >
& nbsp ; & nbsp ; & nbsp ; & nbsp ; 2. 使用 Amazon Mechanical Turk 互联网众包市场 , 将上标签工作外包出去 。 < / p > < p style = "font-weight: 700;font-size:22px" > 获得结果 ( gaining insights ) < / p > < p style = "font-weight: 600;font-size:18px" > 词云 ( word cloud ) < / p > < p > 五星好评的词云 < / p > < img src = "@/assets/images/f4015.png" alt = "" > < p > 一星差评的词云 : < / p > < img src = "@/assets/images/f4016.png" alt = "" > < p > TFIDF能够用来凸显评论中有信息量的单词 。 < / p > < img src = "@/assets/images/f4017.png" alt = "" > < p > LDA可以把评论归类为主题 。 圆盘的大小代表了词的权重 。 < / p > < img src = "@/assets/images/f4018.png" alt = "" > < p > 另一种可视化方式 。 < / p > < img src = "@/assets/images/f4019.png" alt = "" >
< / div > -- >
< / template >
< / p o p - m o d e l >
< pop -model :showModel ="runResultShow" title = "关联规则挖掘" @ closePop = "runResultShow = false" >
< template v -slot : content >
< div >
< p style = "font-weight: 700; font-size: 22px" > 什么是描述性统计分析 < / p >
< p >
描述性统计分析是数据分析的一种方法 , 旨在对数据进行总结和描述 , 以便更好地理解数据的特征和趋势 。 它主要通过统计指标和图表来呈现数据的基本特征 , 包括中心趋势 、 离散程度 、 分布形态等 。
< br / >
常用的描述性统计指标包括 :
< / p >
< li > 中心趋势 : 用于描述数据集的集中程度 , 常见的指标有均值 、 中位数和众数 。 < / li >
< li > 离散程度 : 用于描述数据的分散程度 , 常见的指标有方差 、 标准差和极差 。 < / li >
< li > 分布形态 : 用于描述数据的分布形态 , 常见的指标有偏度和峰度 。 < / li >
< p > 描述性统计分析还可以通过图表来展示数据的特征 , 常见的图表包括 : < / p >
< li > 频数分布表和直方图 : 用于展示数据的分布情况 , 可以观察数据的集中程度和离散程度 。 < / li >
< li > 箱线图 : 用于展示数据的分布情况和离群值 , 可以观察数据的中位数 、 四分位数和异常值 。 < / li >
< li > 散点图 : 用于展示两个变量之间的关系 , 可以观察数据的相关性和趋势 。 < / li >
< p > 描述性统计分析可以帮助我们对数据有一个直观的了解 , 发现数据中的规律和异常情况 , 为后续的数据分析和决策提供基础 。 < / p >
< p style = "font-size: 19px; font-weight: 600" > 描述性统计分析的优势和局限性 < / p >
< p >
描述性统计分析的优势和局限性如下 :
< br / >
优势 :
< / p >
< li > 简单易懂 : 描述性统计分析使用简单的统计指标和图表 , 可以直观地呈现数据的特征 , 使人们更容易理解和解释数据 。 < / li >
< li > 提供概览 : 通过描述性统计分析 , 可以获得数据的整体概览 , 包括数据的中心趋势 ( 如均值 、 中位数 ) 、 数据的分布情况 ( 如标准差 、 百分位数 ) 等 。 < / li >
< li > 发现异常值 : 描述性统计分析可以帮助我们发现数据中的异常值或离群点 , 从而帮助我们识别数据质量问题或异常情况 。 < / li >
< p > 局限性 : < / p >
< li > 缺乏深入分析 : 描述性统计分析主要关注数据的基本特征 , 无法深入挖掘数据背后的关联和因果关系 。 < / li >
< li > 无法进行推断 : 描述性统计分析只是对已有数据的总结和描述 , 并不能进行推断或预测 。 < / li >
< li > 受数据限制 : 描述性统计分析的结果受到数据本身的限制 , 如果数据质量不好或数据量较小 , 可能会导致结果不准确或不可靠 。 < / li >
< p > 综上所述 , 描述性统计分析是数据分析的重要工具 , 可以帮助我们了解数据的基本特征和趋势 , 但在深入分析和推断方面有一定的局限性 。 < / p >
< p style = "font-size: 19px; font-weight: 600" > 描述性统计分析的常用方法 < / p >
< p > 描述性统计分析是对数据进行总结和描述的过程 , 常用的方法包括 : < / p >
< li > 中心趋势度量 : 包括均值 ( mean ) 、 中位数 ( median ) 和众数 ( mode ) , 用于描述数据的集中程度 。 < / li >
< li > 离散程度度量 : 包括方差 ( variance ) 、 标准差 ( standard deviation ) 和极差 ( range ) , 用于描述数据的离散程度 。 < / li >
< li > 分布形状度量 : 包括偏度 ( skewness ) 和峰度 ( kurtosis ) , 用于描述数据的分布形状 。 < / li >
< li > 频数统计 : 通过频数表 、 频率分布表和直方图等方式 , 统计数据的频数和频率 。 < / li >
< li > 百分位数 : 用于描述数据中某个特定百分比的位置 , 如中位数 、 四分位数等 。 < / li >
< li > 相关性分析 : 通过计算相关系数 ( 如Pearson相关系数 ) 来衡量两个变量之间的相关性 。 < / li >
< p style = "font-size: 19px; font-weight: 600" > 描述性统计分析的应用场景 < / p >
< p > 描述性统计分析在许多领域和应用场景中都有重要的作用 , 以下是一些常见的应用场景 : < / p >
< li > 提供概览 : 描述性统计分析可以提供数据的概览 , 帮助我们了解数据的整体特征和规律 。 通过计算中心趋势测量 ( 如均值 、 中位数 、 众数 ) 、 离散程度测量 ( 如方差 、 标准差 、 极差 ) 和分布形态测量 ( 如偏度 、 峰度 ) , 我们可以得到数据的集中趋势 、 离散程度和分布形态等信息 。 < / li >
< li > 数据比较 : 描述性统计分析可以帮助我们比较不同组或不同时间点的数据 。 通过比较不同组的中心趋势 、 离散程度和分布形态等 , 我们可以了解不同组之间的差异和相似之处 , 从而得出结论或提出假设 。 < / li >
< li > 发现异常值 : 描述性统计分析可以帮助我们发现数据中的异常值 。 通过观察离群点 ( 如极端值 ) 和异常值 ( 如异常观测值 ) , 我们可以发现数据中的异常情况 , 进而进行进一步的分析和处理 。 < / li >
< li > 数据可视化 : 描述性统计分析可以通过可视化方法 ( 如直方图 、 散点图 、 箱线图等 ) 将数据转化为图形 , 使得数据更加直观和易于理解 。 数据可视化可以帮助我们发现数据的分布模式 、 趋势和关联关系 , 从而更好地理解数据 。 < / li >
< li > 数据摘要 : 描述性统计分析可以通过频数和频率分布表 、 百分位数等方式对数据进行摘要和概括 。 这些摘要信息可以帮助我们对数据进行快速的了解和比较 , 从而支持后续的决策和分析 。 < / li >
< li > 假设检验 : 描述性统计分析可以为假设检验提供依据 , 通过对样本数据的描述性统计分析 , 我们可以判断样本数据是否符合某种假设分布 , 从而进行假设检验 。 < / li >
< li > 数据报告和展示 : 描述性统计分析可以提供数据的概括性描述 , 用于撰写数据报告和展示 , 帮助他人更好地理解数据的特征和趋势 。 < / li >
< li > 数据清洗 : 描述性统计分析可以帮助我们发现数据中的问题和错误 。 通过观察数据的分布情况和异常值 , 我们可以判断数据的质量 , 并进行必要的数据清洗和修正 。 < / li >
< li > 数据探索 : 描述性统计分析是探索性数据分析的一部分 , 它可以帮助我们发现数据中的模式 、 关联和趋势 。 通过观察数据的分布 、 散点图 、 相关系数等 , 我们可以发现数据中的隐藏信息和规律 。 < / li >
< li > 决策支持 : 描述性统计分析可以为决策提供支持 。 通过对数据的摘要和可视化 , 我们可以获取有关数据的重要信息 , 帮助决策者做出基于数据的决策 。 < / li >
< p style = "font-size: 19px; font-weight: 600" > 如何进行描述性统计分析 < / p >
< p > 开展描述性统计分析可以按照以下步骤进行 : < / p >
< li > 收集数据 : 首先 , 需要收集所需的数据 , 可以是通过调查问卷 、 实验 、 观察或从现有数据源获取 。 < / li >
< li > 数据清洗 : 对收集到的数据进行清洗 , 包括处理缺失值 、 异常值和错误数据等 。 < / li >
< li > 描述性统计 : 使用统计方法计算数据的基本统计量 , 如平均值 、 中位数 、 标准差等 , 以了解数据的集中趋势 、 离散程度和分布情况 。 < / li >
< li > 可视化展示 : 将统计结果以图表的形式进行可视化展示 , 如直方图 、 箱线图 、 散点图等 , 以更直观地呈现数据的特征和趋势 。 < / li >
< li > 解读分析结果 : 根据统计分析的结果 , 解读数据的含义和趋势 , 提取有用的信息和洞察 , 并进行合理的解释和推断 。 < / li >
< p style = "font-size: 19px; font-weight: 600" > 描述性统计分析的注意事项 < / p >
< p > 在进行描述性统计分析时 , 有以下几个注意事项 : < / p >
< li > 数据质量 : 确保数据的准确性和完整性 。 进行数据清洗 , 处理缺失值 、 异常值和重复值等 , 以保证分析结果的可靠性 。 < / li >
< li > 数据类型 : 根据数据的类型选择合适的统计方法和图表 。 对于定量数据 , 可以使用均值 、 标准差等统计量 ; 对于定性数据 , 可以使用频数和百分比等统计量 。 < / li >
< li > 样本大小 : 考虑样本大小对统计结果的影响 。 样本较小可能导致统计结果不够准确 , 而样本较大可能会增加计算复杂度 。 < / li >
< li > 数据分布 : 了解数据的分布情况 , 选择合适的统计方法和图表 。 例如 , 对于正态分布的数据 , 可以使用均值和标准差进行描述 ; 对于偏态分布的数据 , 可以使用中位数和四分位数等进行描述 。 < / li >
< li > 上下文和目的 : 考虑数据分析的上下文和目的 。 根据具体的问题和需求 , 选择合适的统计方法和图表 , 以便更好地解读数据和提取有价值的信息 。 < / li >
< li > 解读和推断 : 描述性统计分析主要是对数据进行概括和描述 , 不能进行推断和因果分析 。 在解读结果时 , 要注意避免过度解读和误导 。 < / li >
< li > 可视化呈现 : 使用合适的图表和图形将数据可视化 , 以便更好地传达数据的特征和趋势 。 选择简洁明了的图表 , 避免图表过于复杂和混乱 。 < / li >
< / div >
< / template >
< / p o p - m o d e l >
< / template >
< script setup >
import * as portraitModel from "@/api/portraitModel" ;
@ -204,7 +243,7 @@ const userStore = useUserStore();
const algorithmStore = useAlgorithmStore ( ) ;
const multipleTableRef = ref ( null ) ;
const b _introductionOfAlgorithmKnowledge = ref ( false ) ;
const runResultShow = ref ( false )
const runResultShow = ref ( false ) ;
const n _dataTableQuery = ref ( {
index : 1 ,
size : 5 ,
@ -237,7 +276,7 @@ const modelParams = reactive([
name : "标准误差" ,
} ,
{
name : "峰度 ; ",
name : "峰度 ",
} ,
{
name : "偏度" ,
@ -256,7 +295,8 @@ const modelParams = reactive([
} ,
] ) ;
const analysisData = ref ( [ ] ) ;
const analysisHanderKry = ref ( [ ] ) ;
const analysisHanderKry = ref ( [ "" ] ) ;
const tableLabel = reactive ( [
{ prop : "average" , label : "平均数" } ,
{ prop : "median" , label : "中位数" } ,
@ -339,6 +379,7 @@ const handleSelectionChange = (type) => {
const submit = ( ) => {
if ( g _indicatorData . value . length == 0 ) return proxy . $modal . msgWarning ( "请选择指标" ) ;
marketingAlgorithmApi . getMarketingAlgorithm ( { userId : n _dataTableQuery . value . userId , tableName : n _dataTableQuery . value . tableName , fieldList : g _indicatorData . value } ) . then ( ( res ) => {
analysisHanderKry . value . length = 0 ;
analysisData . value = res . data ;
analysisHanderKry . value = Object . keys ( res . data [ 0 ] ) ;
if ( res . data . length > 5 ) {
@ -355,20 +396,30 @@ const handlemodelSelectionChange = (type) => {
} ;
/ / 计 算
const modelCalculation = ( ) => {
if ( analysisData . value . length == 0 && g _modelParameter . value . length == 0 ) {
if ( analysisData . value . length == 0 || g _modelParameter . value . length == 0 ) {
proxy . $modal . msgWarning ( "请先分析数据/未选择模型参数!" ) ;
return ;
}
const processedData = processArrayData ( analysisHanderKry . value , analysisData . value ) ;
marketingAlgorithmApi . getMarketingAlgorithmPreprocessing ( JSON . stringify ( { map : processedData , statistic : g _modelParameter . value , userId : n _dataTableQuery . value . userId } ) ) . then ( ( res ) => {
aOriginalDataOfAnalysisResults2 . value = res . data ;
tableData . value = res . data . map ( ( item ) => item . statistics ) ;
if ( res . data . length > 5 ) {
nNumberOfAnalysisResults . value = res . data . length ;
aOriginalDataOfAnalysisResults . value = res . data . map ( ( item ) => item . statistics ) ;
tableData . value = res . data . map ( ( item ) => item . statistics ) . slice ( 0 , 5 ) ;
}
} ) ;
loading . value = true ;
marketingAlgorithmApi
. getMarketingAlgorithmPreprocessing ( JSON . stringify ( { map : processedData , statistic : g _modelParameter . value , userId : n _dataTableQuery . value . userId } ) )
. then ( ( res ) => {
aOriginalDataOfAnalysisResults2 . value = res . data ;
tableData . value = res . data . map ( ( item ) => item . statistics ) ;
if ( res . data . length > 5 ) {
nNumberOfAnalysisResults . value = res . data . length ;
aOriginalDataOfAnalysisResults . value = res . data . map ( ( item ) => item . statistics ) ;
tableData . value = res . data . map ( ( item ) => item . statistics ) . slice ( 0 , 5 ) ;
}
setTimeout ( ( ) => {
loading . value = false ;
proxy . $modal . msgSuccess ( "计算成功" ) ;
} , 1000 ) ;
} )
. catch ( ( err ) => {
loading . value = true ;
} ) ;
} ;
function processArrayData ( keys , data ) {
/ / 创 建 结 果 对 象
@ -393,7 +444,7 @@ const getIndicator = () => {
} ;
/ / 算 法 知 识 导 入
const knowledgeImport = ( ) => {
runResultShow . value = true
runResultShow . value = true ;
} ;
/ / 实 训 任 务 提 交
const submitTask = ( ) => {
@ -503,20 +554,21 @@ const download = () => {
}
. app - main {
/ / b a c k g r o u n d - c o l o r : # f 5 f 5 f 5 ;
min - height : 965 px ;
/ / m i n - h e i g h t : 9 6 5 p x ;
margin : 5 px 20 px 0 ;
height : 100 % ;
display : flex ;
overflow : auto ;
/ / o v e r f l o w : a u t o ;
. main - left {
/ / 水 平 居 中
flex - direction : column ;
min - height : 965 px ;
/ / m i n - h e i g h t : 9 6 5 p x ;
display : flex ;
width : 205 px ;
height : 100 % ;
background : # 041 c49 ;
padding : 0 px 10 px ;
/ / p a d d i n g : 0 p x 1 0 p x ;
padding - left : 10 px ;
. left - top {
padding : 10 px ;
span {
@ -557,9 +609,9 @@ const download = () => {
}
}
. main - right {
width : 1 639px ;
width : 1 00% ;
/ / h e i g h t : 1 0 0 % ;
padding : 20 px ;
/ / p a d d i n g : 2 0 p x ;
border : 1 px solid # 0452 c6 ;
: deep ( . el - table _ _header ) {
. el - table _ _cell {
@ -621,4 +673,8 @@ const download = () => {
. dialog - footer {
margin - bottom : 20 px ;
}
< / style >
: deep ( . pagination - container . el - pagination ) {
/ / 去 除 定 位
position : static ;
}
< / style >