矩阵之间无循环计算L2距离

实现两个矩阵的无循环计算欧氏距离 Euclidean distance

navigation:

*[1.问题描述](#1.problems sources)

*[2.解决方法](#2.no loop cal the distances)

1.问题来源

kNN算法中会计算两个矩阵的距离

可以使用循环的方法来实现，效率较低

def compute_distances_one_loop(self, X):

    """

    train:5000x3072

    test: 500x3072

    - X: A numpy array of shape (num_test, D) containing test data

    Returns:

    - dists: A numpy array of shape (num_test, num_train) where dists[i, j]

      is the Euclidean distance between the ith test point and the jth training

      point.

    """

    num_test = X.shape[0]

    num_train = self.X_train.shape[0]

    dists = np.zeros((num_test, num_train))

    for i in range(num_test):

      #######################################################################

      # TODO:                                                               #

      # Compute the l2 distance between the ith test point and all training #

      # points, and store the result in dists[i, :].                        #

      #######################################################################

      distance=np.sqrt(np.sum(np.square(self.X_train - X[i,:]),axis=1))

      dists[i,:]=distance

    return dists

2.无循环计算L2 distances

一眼看到这个代码，真的是被深深折服！厉害，值得细细学习搞懂。

def compute_distances_no_loops(self, X):

    """

    Compute the distance between each test point in X and each training point

    in self.X_train using no explicit loops.

    Input / Output: Same as compute_distances_two_loops

    """

    num_test = X.shape[0]

    num_train = self.X_train.shape[0]

    dists = np.zeros((num_test, num_train))

    #########################################################################

    # TODO:                                                                 #

    # Compute the l2 distance between all test points and all training      #

    # points without using any explicit loops, and store the result in      #

    # dists.                                                                #

    #                                                                       #

    # You should implement this function using only basic array operations; #

    # in particular you should not use functions from scipy.                #

    #                                                                       #

    # HINT: Try to formulate the l2 distance using matrix multiplication    #

    #       and two broadcast sums.                                         #

    #########################################################################

    M = np.dot(X, self.X_train.T)

    nrow=M.shape[0]

    ncol=M.shape[1]

    te = np.diag(np.dot(X,X.T))

    tr = np.diag(np.dot(self.X_train,self.X_train.T))

    te= np.reshape(np.repeat(te,ncol),M.shape)

    tr = np.reshape(np.repeat(tr, nrow), M.T.shape)

    sq=-2 * M +te+tr.T

    dists = np.sqrt(sq)

    return dists

可能一下子有点懵，不着急我们举个例子一步一步理解

要先知道计算L2的距离公式:

\[L2(x_{i},x_{j})=(\sum_{i=1}^{n} \mid x_{i}^{(l)} - x_{j}^{(l)} \mid ^{2})^{\frac{1}{2}}
\]

计算L2距离需要得到两点距离差的平方和的开方

再熟悉一个基本公式

\[(a-b)^{2}= a^{2}- 2ab+b^{2}
\]

# 假设 x：4x3  ,y: 2x3

# 最后输出一个 2x4矩阵

import numpy as np

>>> x=np.array([[1,2,3],[3,4,5],[5,6,7],[7,8,9]])

>>> x

array([[1, 2, 3],

       [3, 4, 5],

       [5, 6, 7],

       [7, 8, 9]])

>>> y=np.array([[2,3,4],[1,2,3]])

>>> y

array([[2, 3, 4],

       [1, 2, 3]])

# 计算两个矩阵的乘积

>>> M=np.dot(y,x.T)

>>> M

array([[20, 38, 56, 74],

       [14, 26, 38, 50]])

# 保存乘积矩阵的行列

>>> nrow=M.shape[0]

>>> ncol=M.shape[1]

>>> nrow

2

>>> ncol

4

先计算，提取出对角元素

>>> te=np.diag(np.dot(y,y.T))

>>> tr=np.diag(np.dot(x,x.T))

>>> te

array([29, 14])

>>> tr

array([ 14,  50, 110, 194])

按对角元素来进行扩充，满足矩阵计算要求

得到\(a^{2}\),\(b^{2}\)

# 继续整理

>>> te=np.reshape(np.repeat(te,ncol),M.shape)  # ncol:4 ,M: 2x4

>>> tr=np.reshape(np.repeat(tr,nrow),M.T.shape) #nrow:2 ,M.T:4x2

>>> te

array([[29, 29, 29, 29],

       [14, 14, 14, 14]])

>>> tr

array([[ 14,  14],

       [ 50,  50],

       [110, 110],

       [194, 194]])

\(-2ab\)就是-2*M

计算距离的开方

>>> sq=-2*M+te+tr.T

>>> dists=np.sqrt(sq)

>>> sq

array([[  3,   3,  27,  75],

       [  0,  12,  48, 108]])

>>> dists

array([[ 1.73205081,  1.73205081,  5.19615242,  8.66025404],

       [ 0.        ,  3.46410162,  6.92820323, 10.39230485]])

矩阵之间无循环计算L2距离的更多相关文章

js计算元素距离顶部的高度及元素是否在可视区判断
前言: 在业务当中,我们经常要计算元素的大小和元素在页面的位置信息.比如说,在一个滚动区域内,我要知道元素A是在可视区内,还是在隐藏内容区(滚动到外边看不到了).有时还要进一步知道,元素是全部都显示在 ...
js根据经纬度计算两点距离
js版-胡老师 google.maps.LatLng.prototype.distanceFrom = function(latlng) { var lat = [this.lat(), lat ...
PyTorch 实战：计算 Wasserstein 距离
PyTorch 实战:计算 Wasserstein 距离 2019-09-23 18:42:56 This blog is copied from: https://mp.weixin.qq.com/ ...
【百度地图API】如何根据摩卡托坐标进行POI查询，和计算两点距离
原文:[百度地图API]如何根据摩卡托坐标进行POI查询,和计算两点距离摘要: 百度地图API有两种坐标系,一种是百度经纬度,一种是摩卡托坐标系.在本章你将学会: 1.如何相互转换这两种坐标: 2. ...
Spark Java API 计算 Levenshtein 距离
Spark Java API 计算 Levenshtein 距离在上一篇文章中,完成了Spark开发环境的搭建,最终的目标是对用户昵称信息做聚类分析,找出违规的昵称.聚类分析需要一个距离,用来衡量两 ...
numpy计算路线距离
numpy计算路线距离觉得有用的话,欢迎一起讨论相互学习~Follow Me 参考文献 enumerate遍历数组 np.diff函数 numpy适用数组作为索引标记路线上的点 \[X={X1,X ...
什么是Docker—无服务器计算服务
什么是Docker https://mp.weixin.qq.com/s?__biz=MzU0Mzk1OTU2Mg==&mid=2247483881&idx=1&sn=aa27 ...
HDU 2276 Kiki & Little Kiki 2（矩阵快速幂 + 循环同构矩阵）
蒟蒻的我还需深入学习链接:传送门题意:给出一个长度为 n,n 不超过100的 01 串 s ,每当一个数字左侧为 1 时( 0的左侧是 n-1 ),这个数字就会发生改变,整个串改变一次需要 1s ...
geolocation获取当前位置显示及计算两地距离
获取当前经纬度利用HTML5(以及基于JavaScript的地理定位API),可以很容易地在页面中访问位置信息,下面代码,就可以简单的获取当前位置信息: <!DOCTYPE html> ...

随机推荐

HTML5-新增语义化结构标签
总结目录结构: 1.简洁的DOCTYPE声明 2.新的布局结构标签 header,article,section,aside,footer 3.新的其它常用标签: nav,hgroup,figure, ...
Github上fork的项目如何merge原Git项目
问题场景小明在Github上fork了一个大佬的项目,并clone到本地开发一段时间,再提交merge request到原Git项目,过了段时间,原作者联系小明,扔给他下面这幅截图并告知合并处理冲突 ...
消息中间件——RabbitMQ（一）Windows/Linux环境搭建（完整版）
前言最近在学习消息中间件--RabbitMQ,打算把这个学习过程记录下来.此章主要介绍环境搭建.此次主要是单机搭建(条件有限),包括在Windows.Linux环境下的搭建,以及RabbitMQ的监 ...
Intent 常用方法总结
极力推荐文章:欢迎收藏 Android 干货分享阅读五分钟,每日十点,和您一起终身学习,这里是程序员Android 本文主要是总结Intent 常用的方法,并封装成Utils类中主要涉及以下内容 ...
codeforces679A_Bear and Prime 100 交互题
传送门第一道交互题题意: 电脑事先想好了一个数[,] 你会每次问电脑一个数是否是它想的那个数的因数电脑会告诉你yes或no 至多询问20次最后要输出它想的数是质数还是合数思路: 枚举< ...
Oracle GoldenGate mysql To Kafka上车记录
一.前言首先要学习一下ogg的所有进程,看着这张图来学习 Manager进程是GoldenGate的控制进程,运行在源端和目标端上.它主要作用有以下几个方面:启动.监控.重启Goldengate ...
前端面试题集锦（二）之CSS部分
1.CSS中的选择器都有哪些?权限情况如何? 解答: (1)类选择器 .className (2) ID选择器 #id (3) 元素选择器 div 可以多个,以逗号隔开 (4)父子选择器以空格隔 ...
java算法(4)---静态内部类实现雪花算法
静态内部类单例模式实现雪花算法在生成表主键ID时,我们可以考虑主键自增或者 UUID,但它们都有很明显的缺点主键自增:1.自增ID容易被爬虫遍历数据.2.分表分库会有ID冲突. UUID: 1. ...
记一次Linux修改MySQL配置不生效的问题
背景自己手上有一个项目服务用的是AWS EC2,最近从安全性和性能方面考虑,最近打算把腾讯云的MySQL数据库迁移到AWS RDS上,因为AWS的出口规则和安全组等问题,我需要修改默认的3306端口 ...
UI 组件 | Toggle
Toggle(复选框)组件 Toggle 是一个 CheckBox,当它和 ToggleGroup 一起使用的时候,可以变成 RadioButton. 创建 Toggle 组件层级管理器右击-> ...