memcpy/memmove?快速乘?

memcpy?memmove?

//#pragma GCC optimize(2)

#include<bits/stdc++.h>

using namespace std;

const int n=;

int a[n+],b[n+],c[n+],d[n+],e[n+],f[n+];

int main()

{

    int i;

    srand();

    for(i=;i<=n;i++)    a[i]=rand();

    clock_t st1=clock();

    memcpy(b+,a+,sizeof(int)*n);

    clock_t ed1=clock();

    clock_t st2=clock();

    memmove(c+,a+,sizeof(int)*n);

    clock_t ed2=clock();

    clock_t st3=clock();

    for(i=;i<=n;i++)    d[i]=a[i];

    clock_t ed3=clock();

    clock_t st4=clock();

    for(i=;i<=n-;i+=)

    {

        e[i]=a[i];

        e[i+]=a[i+];

        e[i+]=a[i+];

        e[i+]=a[i+];

    }

    (i<=n)&&(e[i]=a[i]);

    (i+<=n)&&(e[i+]=a[i+]);

    (i+<=n)&&(e[i+]=a[i+]);

    clock_t ed4=clock();

    clock_t st5=clock();

    for(i=;i<=n-;i+=)

    {

        f[i]=a[i];

        f[i+]=a[i+];

        f[i+]=a[i+];

        f[i+]=a[i+];

        f[i+]=a[i+];

        f[i+]=a[i+];

        f[i+]=a[i+];

        f[i+]=a[i+];

    }

    (i<=n)&&(f[i]=a[i]);

    (i+<=n)&&(f[i+]=a[i+]);

    (i+<=n)&&(f[i+]=a[i+]);

    (i+<=n)&&(f[i+]=a[i+]);

    (i+<=n)&&(f[i+]=a[i+]);

    (i+<=n)&&(f[i+]=a[i+]);

    (i+<=n)&&(f[i+]=a[i+]);

    clock_t ed5=clock();

    cout<<"time1:"<<ed1-st1<<' '<<memcmp(a+,b+,sizeof(int)*n)<<'\n';

    cout<<"time2:"<<ed2-st2<<' '<<memcmp(a+,c+,sizeof(int)*n)<<'\n';

    cout<<"time3:"<<ed3-st3<<' '<<memcmp(a+,d+,sizeof(int)*n)<<'\n';

    cout<<"time4:"<<ed4-st4<<' '<<memcmp(a+,e+,sizeof(int)*n)<<'\n';

    cout<<"time5:"<<ed5-st5<<' '<<memcmp(a+,f+,sizeof(int)*n)<<'\n';

    return ;

}

不开优化：
time1:139254 0
time2:198093 0
time3:601853 0
time4:588247 0
time5:598584 0

O2：
time1:138256 0
time2:139235 0
time3:426570 0
time4:322532 0
time5:301933 0

Ofast：
time1:137893 0
time2:140585 0
time3:422154 0
time4:309306 0
time5:298620 0

很显然在大数据(n=50000000)下memcpy最快

另外，在小数据（比如n=26）下，测试得到明显直接赋值(time3)最快

在较小数据（比如n=1000）下，测试得到memmove最快？

快速乘

测试对比程序：

#include<bits/stdc++.h>

using namespace std;

typedef long long ll;

ll rd()

{

    return rand()|(ll(rand())<<);

}

ll md;

ll mul1(ll x,ll y)

{

    x%=md;y%=md;

    ll t=x*y-ll((long double)x/md*y+0.5)*md;

    return t<?t+md:t;

}

ll mul2(ll x,ll y)

{

    x%=md;y%=md;

    ll t=x*y-ll((long double)x*y/md+0.5)*md;

    return t<?t+md:t;

}

ll mul3(ll x,ll y)

{

    x%=md;y%=md;

    ll t=x*y-ll((long double)x/md*y+1e-)*md;

    return t<?t+md:t;

}

ll mul0(ll x,ll y)

{

    return __int128(x)*y%md;

}

ll a,b;

int main()

{

    int T=;

    srand();

    while()

    {

        T++;

        ll a=rd(),b=rd();

        md=rd();//%ll(1e18);

        //cout<<a<<' '<<b<<' '<<md<<'\n';

        ll t1=mul1(a,b),t2=mul0(a,b);//可将mul1改为mul2/mul3

        //cout<<t1<<' '<<t2<<'\n';

        if(t1!=t2)

        {

            printf("%d\n",T);

            puts("test");

            int t;cin>>t;

        }

        //int t;cin>>t;

    }

    return ;

}

经过一些测试，可以发现，mul3效果最差（在模数>=1e17时，100000组以内就拍出锅）；应该是1e-8不够

mul2效果没有mul1好（模数不设额外上限时，100000组以内出锅；上限1e18时，20秒不出锅）

mul1效果最好（模数不设额外上限时，20秒不出锅）

原因就不知道了。。。

memcpy/memmove?快速乘?的更多相关文章

自己实现的库函数2（memset,memcmp,memcpy,memmove）
memset,memcmp,memcpy,memmove是对内存进行管理的库函数,为了更好的理解和使用这几个函数,自己用C语言实现一下~ //内存设置函数void* my_memset(void* d ...
memset memcmp memcpy memmove 自己实现
memset memcmp memcpy memmove 自己实现 memset #include <stdio.h> #include <memory.h> #include ...
memcpy memmove区别和实现
memcpy与memmove的目的都是将N个字节的源内存地址的内容拷贝到目标内存地址中. 但当源内存和目标内存存在重叠时,memcpy会出现错误,而memmove能正确地实施拷贝,但这也增加了一点点开 ...
自己实现内存操作函数memset(),memcmp(),memcpy(),memmove()
1.memset()内存设置函数(初始化) void *my_memset(void* dest, int c, size_t count) { assert(dest != NULL); char ...
走进C标准库(7)——"string.h"中函数的实现memcmp,memcpy,memmove,memset
我的memcmp: int memcmp(void *buf1, void *buf2, unsigned int count){ int reval; while(count && ...
C的memset,memcpy,strcpy 的区别及memset memcpy memmove源码
extern void *memcpy(void *dest,void *src,unsigned int count);#include <string.h> 功能:由src所指内存 ...
一些关于memcpy memmove函数的区别，和模拟实现
memcpy: 它是c和c++使用的内存拷贝函数,memcpy函数的功能是从源src所指的内存地址的起始位置开始拷贝n个字节到目标dest所指的内存地址的起始位置中. 函数原型:void* memcp ...
strcpy和memcpy,memmove函数的区别
strcpy和memcpy的区别 strcpy和memcpy都是标准C库函数,它们有下面的特点. strcpy提供了字符串的复制.即strcpy只用于字符串复制,并且它不仅复制字符串内容之外,还会复制 ...
strcpy,memcpy,memmove和内存重叠分析
一:strcpy函数用法和实现: /* GNU-C中的实现(节选): */ char* strcpy(char *d, const char *s) { char *r=d; while((*d++= ...

随机推荐

SYN FLOOD学习理解
SYN FLOOD是一种比较常见的DoS攻击手段,它的特点就是防不胜防.SYN攻击属于DOS攻击的一种,它利用TCP协议缺陷,通过发送大量的半连接请求,耗费CPU和内存资源.SYN攻击除了能影响主机外 ...
Codeforces Round #363 (Div. 2) D. Fix a Tree —— 并查集
题目链接:http://codeforces.com/contest/699/problem/D D. Fix a Tree time limit per test 2 seconds memory ...
Appium——解决每次启动时都安装setting和unlock app方法
找到appium安装目录 C:\Program Files (x86)\Appium\node_modules\appium\lib\devices\android 修改代码,注释掉弹出setting ...
python字典无序？有序？
默认情况下Python的字典输出顺序是按照键的创建顺序. 字典的无序是指,不能人为重新排序.比如说你按键值1,2,3,4的顺序创建的字典,只能由解析器按创建顺序,还是1,2,3,4的输出.你无法控制它 ...
v-for指令用法一
<!DOCTYPE html> <html> <head> <meta charset="utf-8"> <meta name ...
apache web 服务器
0. 特性与特点性能方面,apache 在设计时采用了以"进程"为基础的结构,自然进程比线程消耗了更多的系统开销,导致了 apache 在多处理器环境中性能有所下降: 因此,在对 ...
vue中的 v-if VS v-show
相同点:都是动态显示DOM元素. 不同点:1.v-if是动态的向DOM树内添加或者删除DOM元素:v-show是通过设置DOM元素的display样式属性控制显隐: 2.v-if切换有一个局部编译/卸 ...
html格式
优美的代码编写方式是我们装逼的基础,在python中我们称优秀的代码为pythonic,无独有偶,html.css.js也都有着自己相比更优美的写法~ <!DOCTYPE html> &l ...
ceph与openstack对接（cinder、glance、nova）
对接分为三种,也就是存储为openstack提供的三类功能1.云盘,就好比我们新加的硬盘2.原本的镜像也放在ceph里,但是我没有选择这种方式,原因是因为后期有要求,但是我会把这个也写出来,大家自己对 ...
sybase SQL记录
在一个表中复制一行,主键是MLID ';

memcpy/memmove?快速乘?

memcpy?memmove?

快速乘

memcpy/memmove?快速乘?的更多相关文章

随机推荐

热门专题