当前位置：首页 > news >正文

昆明网站建设费用站长素材官网

news 2025/8/10 19:48:54

昆明网站建设费用,站长素材官网,做网站要学会什么语言,做网站网站建设目录前言监督学习 vs 无监督学习回归 vs 分类 Regression vs Classification 训练集 vs 测试集 vs 验证集泛化和过拟合 Generalization & Overfitting 线性分类器 Linear Classifiers 激活函数 - 概率决策 ⚠线性回归决策树 Decision Trees 决策树构建递归…

目录

前言

监督学习 vs 无监督学习

回归 vs 分类 Regression vs Classification

训练集 vs 测试集 vs 验证集

泛化和过拟合 Generalization & Overfitting

线性分类器 Linear Classifiers

激活函数 - 概率决策

⚠线性回归

决策树 Decision Trees

决策树构建递归退出条件C

信息熵 Entropy

信息增益 Information Gain

⚠ID3算法实例

总结

前言

本复习笔记基于李晶晶老师的课堂PPT与复习大纲，供自己期末复习与学弟学妹参考用。

本节是人工智能复习的最后一小节，重点在于了解概念，会做计算题。

前面几节都在专栏当中，可以自行查看，也可以走传送门：

电子科技大学人工智能期末复习笔记（一）：搜索问题

电子科技大学人工智能期末复习笔记（二）：MDP与强化学习

电子科技大学人工智能期末复习笔记（三）：一阶逻辑

电子科技大学人工智能期末复习笔记（四）：概率与贝叶斯网络

监督学习 vs 无监督学习

监督学习：输入已知类别的数据样本分类、回归

无监督学习：输入未知类别的数据样本聚类

回归 vs 分类 Regression vs Classification

分类：对输入数据进行离散值标签的预测

回归：预测连续的、具体的数值

Output：连续 vs 离散

分类需要激活函数

训练集 vs 测试集 vs 验证集

训练集用于学习参数（例如模型概率）

测试集用于计算模型的准确率

验证集用于调节超参数

泛化和过拟合 Generalization & Overfitting

在有监督学习中，我们会在训练数据集上建立一个模型，之后会把这个模型用于新的，之前从未见过的数据中，这个过程称为模型的泛化

模型在训练集上表现好，在测试集验证集表现差就说明出现了过拟合问题，出现这种情况的主要原因是训练数据中存在噪音或者训练数据太少

解决办法：选取合适的停止训练标准；使用验证数据集；获取额外数据进行交叉验证；正则化

Relative frequency parameters will overfit the training data

相对频率参数会过拟合训练数据

线性分类器 Linear Classifiers

输入特征向量 f(x)

权重向量 w

在二分类中：

真实标签为 y*∈{-1，1}，

预测标签为 y ，w和f(x)在同一平面则为正样本，y=1，反之y=-1

如果分类正确，不更新w，分类错误则更新 w

w = w + y* · f(x) 其中y* = 1或-1

在多分类中：

输入特征向量 f(x)

每个类别的权重向量

预测标签为 y ，取最大的一个类别标签

如果分类正确，不更新w；分类错误则更新 w，此时需要分别对正确和错误的两个w进行更新

关键点：减小错分类别的向量点积，增大真实类别的向量点积

激活函数 - 概率决策

⚠线性回归

L2 loss：所有样本的平方误差和

例：

决策树 Decision Trees

决策树构建递归退出条件C

当前样本集D包含的样本属于同一类别C
当前属性集A为空或样本集D中所有样本在所有属性上取值相同（但类别可能不相同）
当前结点包含的样本集为空

信息熵 Entropy

信息熵是度量样本集合纯度的指标

假定当前样本集合D中第k类样本所占比例为pk（k=1，2，...，|y|）则D的信息熵的定义为：

Ent(D)的取值范围为 [0,log2|y| ]，值越小，纯度越高

计算信息熵时约定：若p=0，则=0

信息增益 Information Gain

样本集D的某个离散属性a有V个可能的取值，用a来对D进行划分则会产生V个分支结点，其中第v个分支结点包含了D中所有在在属性a上取值为的样本，记为。定义用属性a对样本集D进行划分所获得的信息增益为：

一般而言，信息增益越大，意味着使用属性a来进行划分获得的纯度提升越大

在ID3算法中选择信息增益大的属性来划分样本集

⚠ID3算法实例

总结

至此人工智能复习笔记更新完毕，后续有时间会更新一下实验的讲解，包括基于A*算法的八数码问题求解、ID3决策树实战、以及Q-learning和Sarsa实现的悬崖问题求解。

http://www.jinmujx.cn/news/79898.html

相关文章：

旅游产品推广方案seo关键词排名优化怎样收费

郑州郑东新区seo优化软件哪个好

长沙中小企业网站制作百度网址大全下载

实力网站优化公司首选互动营销的概念

网站banner图切换效果快抖霸屏乐云seo

番禺核酸检测点有新调整seo怎么才能优化好

晋中做网站公司刚刚突发1惊天大事

衡水做网站公司长春seo招聘

大学网站建设多少钱百度关键词规划师工具

做网站有哪些语言网络营销包括几个部分

做网站学php哪一部分东莞网站建设方案外包

闵行网站制作公司传统营销与网络营销的区别

做网站怎么自定义背景图片某网站seo策划方案

深圳狮科网站建设如何做广告宣传与推广

ecshop网站备份app拉新怎么对接渠道

网站开发ide网络推广精准营销推广

收录图片的网站今日新闻最新

网站建设运营维护方案sem竞价专员是干什么的

美仑-专门做服装的网站软件推广怎么赚钱

中企动力 35 做网站免费推广广告链接

自己怎么做投注网站如何制作一个网页网站

wordpress获取产品评论seo排名赚app

西樵网站设计中国职业培训在线平台

网站制作公司多少人ui培训

网站建设平台qq群推广网站免费

北京专业网页制作公司北海百度seo

注册公司怎样网上核名深圳百度快照优化

推荐扬中网站建设模板建站价格

哪两个数字域名是做医疗信息网站的自动搜索关键词软件

注册深圳公司需要多少钱谷歌优化怎么做