当前位置: 首页 > news >正文

如何知道一个网站是用什么做的产品关键词

如何知道一个网站是用什么做的,产品关键词,今天最新消息,263企业邮箱app下载K-近邻算法(KNN) K-近邻分类法的基本思想:通过计算每个训练数据到待分类元组Zu的距离,取和待分类元组距离最近的K个训练数据,K个数据中哪个类别的训练数据占多数,则待分类元组Zu就属于哪个类别…

K-近邻算法(KNN)

K-近邻分类法的基本思想:通过计算每个训练数据到待分类元组Zu的距离,取和待分类元组距离最近的K个训练数据,K个数据中哪个类别的训练数据占多数,则待分类元组Zu就属于哪个类别。

KNN算法描述:

  1. 对新的数据集中的每一个数据点,计算其到已知分类信息的数据集中所有数据点的距离。
  2. 将计算得到的所有距离进行排序,一般是升序排序。
  3. 选取其中前K个与未知点离得最近的点。
  4. 统计这K个已知分类信息中各个类别出现的频数,
  5. 选取上述K个点中类别频数最高的,作为未知点的类别。

eg:设某公司现有8名员工的基本信息,包括其个子为高个,中等,矮个的分类标识

公司现刚招进一位名叫刘萍的新员工Z1,令k=5,试采用 k-NN分类算法判断员工刘萍的个子属于哪一类?

解:

决策树

决策树是通过一系列规则对数据进行分类的过程。它提供一种在什么条件下会得到什么值的类似规则的方法。通常决策树主要有三种实现,分别是ID3算法,CART算法和C4.5算法

决策树分为分类树和回归树两种,分类树对离散变量做决策树,回归树对连续变量做决策树。

决策树分类方法采用自顶向下的递归方式

一棵决策树的生成过程主要分为以下3个部分:

  1. 特征选择
  2. 决策树生成
  3. 剪枝

研究结果表明,一般情况下, 树越小则树的预测能力越强。

理论上讲,后剪枝好于预先剪枝,但计算复杂度大。

典型决策树算法

  • ID3

  ID3算法用信息增益作为属性测试条件,且信息增益值越大以该属性作为分支结点越好。

ID3算法的核心在于使用"信息熵"作为衡量标准,通过计算每个属性的信息增益,选择信息增益最高的属性作为划分标准,重复这个过程直至生成一个能完美分类训练的决策树,采用贪心算法,不能保证全局最优.

递归终止条件:①当分到某个类时,目标属性全是一个值. OR ②当分到某个类时,某个值的比例达到给定的阈值.

信息熵E,一个系统越是有序,信息熵越低;反之,一个系统越混乱,信息熵越高.

info信息量

若存在n个相同概率的消息,则每个消息的概率p=1/n,一个消息传递的信息量为:                -Log2(1/n)=Log2n  (使用以2为底的对数函数,是因为计算机中的信息用二进位编码。)

gain信息增益 ,选择gain(max)作为结点

序号天气气温湿度打网球
1N
2N
3多云Y
4温暖Y
5凉爽正常Y
6凉爽正常N
7多云凉爽正常Y
8温暖N
9凉爽正常Y
10温暖正常Y
11温暖正常Y
12多云温暖Y
13多云正常Y
14温暖N

ID3优点:算法的理论清晰,方法简单,学习能力较强。

决策树ID3算法的主要问题:过拟合,对数据中的噪声敏感以及不稳定.只能处理离散属性数据,不能处理有缺失的数据。

改进策略:使用决策树的改进版本,如随机森林何梯度提升.

  • C4.5

C4.5和ID3都是利用贪心算法进行求解,不同的是分类决策的依据不同.

C4.5算法在结构和递归上与ID3完全相同,区别在于选取决断特征时选择信息增益比最大的.

C4.5既可以处理离散型属性,也可以处理连续型属性.

  • CART

CART算法构成的是一个二叉树,它在每一步的决策时只能是“是”或者“否”,即使一个feature有多个取值,也是把数据分为两部分。选择Gini系数最小值作为结点

ID

有房者

婚姻年收入拖欠贷款

1

单身125K
2已婚100K
3单身70K
4已婚120K
5离异95K
6已婚60K
7离异220K
8单身85K
9已婚75K
10单身90K

    解:   

朴素贝叶斯

整个朴素贝叶斯分类可分为三个阶段:

 第一阶段是准备工作阶段

 第二阶段是分类器训练阶段

第三阶段是应用阶段

http://www.tj-hxxt.cn/news/27362.html

相关文章:

  • 一个网站百度百科怎么做百度seo关键词排名价格
  • 衢州+做+网站百度如何精准搜索
  • 建设文明网站包括哪些内容如何提高关键词搜索排名
  • 网站整站开发教程seo自学网视频教程
  • 做网站设计哪家好百度大数据分析
  • 自己做网站怎么维护新媒体营销六种方式
  • 浙江自己如何做网站如何让百度快速收录
  • 接送车服务网站怎么做网站建设与管理
  • 如何在国税网站做票种核定青岛seo推广专员
  • 哪里做网站便宜淘宝网络营销方式
  • 做网站去哪个公司bt磁力在线种子搜索神器
  • 网站开发上线流程图网络营销公司是做什么的
  • 在线做图表的网站今天全国疫情最新消息
  • 文昌网站 做炸饺子武汉java培训机构排名榜
  • 长春专业做网站的公司排名软文广告范文
  • 苏州高端网站建设咨询东莞关键词自动排名
  • php网站建设情景游戏推广话术
  • 用java做网站要学什么长春关键词优化公司
  • 自己做网站多少钱seo职位具体做什么
  • 做网站的宽度为多少钱有趣的网络营销案例
  • 网站建设项目验收报告松原头条新闻今日新闻最新
  • 公司起名字大全免费四字seo入门黑帽培训教程
  • 免费做网站模板在哪里做企业员工培训课程内容
  • 做python项目的网站搜索引擎优化的根本目的
  • 小说网站的会员充值是怎么做的搜外seo
  • 房产网手机版网站建设目标百度手机应用市场
  • 营销网站设计电商项目策划书
  • 朝阳区住房城乡建设委 房管局 官方网站北京seo全网营销
  • 域名网站注册最划算免费信息推广网站
  • 怎样做营销型网站推广ppt湖南企业seo优化首选