机器学习算法：K近邻(k-nearest neighbors)初探

其他 2021-01-25 19:32:14 阅读次数: 0

1 KNN的介绍和应用

1.1 KNN的介绍

kNN(k-nearest neighbors)，中文翻译K近邻。我们常常听到一个故事：如果要了解一个人的经济水平，只需要知道他最好的5个朋友的经济能力，对他的这五个人的经济水平求平均就是这个人的经济水平。这句话里面就包含着kNN的算法思想。

示例：如上图，绿色圆要被决定赋予哪个类，是红色三角形还是蓝色四方形？如果K=3，由于红色三角形所占比例为2/3，绿色圆将被赋予红色三角形那个类，如果K=5，由于蓝色四方形比例为3/5，因此绿色圆被赋予蓝色四方形类。

1) KNN建立过程

1 给定测试样本，计算它与训练集中的每一个样本的距离。
2 找出距离近期的K个训练样本。作为测试样本的近邻。
3 依据这K个近邻归属的类别来确定样本的类别。

2) 类别的判定

①投票决定，少数服从多数。取类别最多的为测试样本类别。

②加权投票法，依据计算得出距离的远近，对近邻的投票进行加权，距离越近则权重越大，设定权重为距离平方的倒数。

1.2 KNN的应用

KNN虽然很简单，但是人们常说"大道至简"，一句"物以类聚，人以群分"就能揭开其面纱，看似简单的KNN即能做分类又能做回归，还能用来做数据预处理的缺失值填充。由于KNN模型具有很好的解释性，一般情况下对于简单的机器学习问题，我们可以使用KNN作为 Baseline，对于每一个预测结果，我们可以很好的进行解释。推荐系统的中，也有着KNN的影子。例如文章推荐系统中，对于一个用户A，我们可以把和A最相近的k个用户，浏览过的文章推送给A。

机器学习领域中，数据往往很重要，有句话叫做:"数据决定任务的上限, 模型的目标是无限接近这个上限"。可以看到好的数据非常重要，但是由于各种原因，我们得到的数据是有缺失的，如果我们能够很好的填充这些缺失值，就能够得到更好的数据，以至于训练出来更鲁棒的模型。接下来我们就来看看KNN如果做分类，怎么做回归以及怎么填充空值。

猜你喜欢

转载自blog.csdn.net/yichao_ding/article/details/111495049

机器学习算法：K近邻(k-nearest neighbors)初探

机器学习算法：K近邻(k-nearest neighbors)

K-Nearest Neighbors近邻算法（KNN）

第四十六篇入门机器学习——kNN - k近邻算法（k-Nearest Neighbors）

大数据技术之机器学习K 近邻（k-nearest neighbors）算法

【机器学习笔记】K-Nearest Neighbors Algorithm（最近邻算法，KNN）

【ML】K近邻算法 KNN （K-nearest Neighbors）

KNN(k-nearest neighbors) K近邻算法深入

k-nearest neighbors algorithm - k 最近邻算法

机器学习：K近邻(k-nearest neighbors)--阿里云天池

K-Nearest Neighbors近邻算法（KNN）（简单版）

K近邻算法（K-Nearest Neighbors, KNN）原理详解与应用

K-Nearest Neighbors Algorithm

machine learning实践学习二：K-Nearest Neighbors

K-nearest neighbors and Euclidean Distance

k-Nearest Neighbors 学习笔记2 使用kNN算法改进约会网站的配对结果

Opencv2.4.9源码分析——K-Nearest Neighbors

OpenCV Maching Learning 之K-Nearest Neighbors

[Algorithms] Classify Mystery Items with the K-Nearest Neighbors Algorithm in JavaScript

cs231n__2. K-nearest Neighbors

Grokking algorithms(第十章)k-nearest neighbors

k-Nearest Neighbors 学习笔记1 简单的电影分类实例

《算法图解》第10章 K最近邻（K nearest neighbors,KNN）算法

【机器学习】k-近邻算法（k-nearest neighbor, k-NN）

机器学习-K 近邻（k-Nearest Neighbour ）

机器学习分类算法之K近邻（K-Nearest Neighbor）

机器学习实战之——K最近邻(k-Nearest Neighbor，KNN)分类算法Python实现

机器学习笔记 - 使用K近邻(k-Nearest Neighbo)算法进行手写识别

OpenCV Machine Learning 之 K近期邻分类器的应用 K-Nearest Neighbors

监督学习之五——近邻算法（Nearest Neighbors）

今日推荐

美国拟限制 AI 大模型出口中国和俄罗斯

苹果将与 OpenAI 达成协议，将 ChatGPT 应用于 iPhone

openKylin 社区生态委员会第六次会议圆满召开

阿里云正式发布通义千问 2.5

Python 3.13 发布首个 Beta：实验性自由线程模式和 JIT、改进交互式解释器

Stack Overflow 拿我的代码去训练 AI 大模型，还封了我的账号

Pop!_OS 的 COSMIC 桌面完成 App Store 上架工作

报告：Django 仍然是 74% 开发者的首选

《2024 年一季度互联网投融资运行情况》研究报告

15 年前上了“FFmpeg 耻辱柱”，今天他还得谢谢咱——腾讯QQPlayer一雪前耻？

TIOBE 5 月榜单：Fortran “复活”进入 Top 10

GCC 14.1 发布

周排行

curl的POST请求，封装方法

8.1.1. Integer Types

Java基础 Day05(个人复习整理)

Python - Django - 中间件 process_exception

小L的试卷

【Shell编程】（函数）判断用户是否存在

python(css样式)

spring ant path 匹配原则 - 【笔记】

《JavaScript与JScript从入门到精通》(美)James.Jaworski.中译本.扫描版.pdf

Eclipse运行带参数的java程序

每日归档

更多

2024-05-12(0)

2024-05-11(38)

2024-05-10(38)

2024-05-09(35)

2024-05-08(42)

2024-05-07(14)

2024-05-06(40)

2024-05-05(0)

2024-05-04(7)

2024-05-03(19)