机器学习实战k-近邻算法
# -*- coding: utf-8 -*-
import numpy as np
#导入运算符模块
import operator
def createDataSet():
group=np.array([[1.0,1.1],[1.0,1.0],[0,0],[0,0.1]])
labels=['A','A','B','B']
return group,labels
def classify0(inX,dataSet,labels,k):
dataSetSize=dataSet.shape[0]#获取训练样本的个数 也就是行数
diffMat=np.tile(inX,(dataSetSize,1))-dataSet#行扩展 与训练样本维度相同
sqDiffMat=diffMat**2
sqDistances=sqDiffMat.sum(axis=1)#矩阵的每一行相加
distances=sqDistances**0.5
sortedDistIndicies=distances.argsort()#排序
classCount={}
for i in range(k):
voteIlabel=labels[sortedDistIndicies[i]]
classCount[voteIlabel]=classCount.get(voteIlabel,0)+1
sortedClassCount=sorted(classCount.items(),key=operator.itemgetter(1),reverse=True)
return sortedClassCount[0][0]
Python numpy函数:shape用法
shape函数是numpy.core.fromnumeric中的函数,它的功能是读取矩阵的长度,比如shape[0]就是读取矩阵第一维度的长度。
eg:shape (2,) 与 shape (2, 1) 的区别如下:<

本文介绍了机器学习实战中的k-近邻算法,并详细讲解了Python numpy的shape和tile函数。shape函数用于获取矩阵的长度,而tile函数实现了元素的重复。同时,文中还提及了Python中sum函数的用法及其在处理kNN.py文件时的注意事项,包括错误修正和代码理解。

3253

被折叠的 条评论
为什么被折叠?



