频道导航

c – 在1GB RAM的机器上排序1TB文件

2019-06-10 C&C++ 前端之家

前端之家收集整理的这篇文章主要介绍了c – 在1GB RAM的机器上排序1TB文件，前端之家小编觉得挺不错的，现在分享给大家，也给大家做个参考。

这个问题似乎很简单,但是我无法理解背后的真正工作.
我知道人们会说,分解成512 Megs块,并将它们排序为使用合并排序使用地图缩小.

所以这里是我的实际问题：

假设我将文件分解成512兆字节块,然后发送到不同的主机进行排序.
假设这些机器使用合并排序.
现在说,我有2000台机器,每个排序2000,512兆的块.现在,当我把它们合并回来的时候,这个工作怎么样？尺寸不会再增加吗？例如,合并两个512兆字节将使1024Megs是我的RAM的大小,所以这将如何工作？任何机器都无法将一块超过512个的块与另一个块合并,因为尺寸> 1 GB.

如果合并结束,我将能够将两块0.5 TB的块与另外的0.5 TB块合并.虚拟内存的概念在这里发挥作用？

我在这里澄清我的基础,我希望我正确地问这个非常重要的问题(正确).此外,谁应该这样做合并(排序后)？我的机器还是那几台2000机器？

解决方法

这是一个应该有效的理论方法.假设你有你的2000 512MB文件,准备创建一个1TB文件.

如果你只是循环遍历每个文件,找到哪一个具有最低的FIRST值,然后将其移动到你的目的地文件中,然后再重复一遍,你会得到一切顺序. RAM的使用应该很小,因为你永远不需要一次打开多行.

显然,你应该可以优化这一点 – 在RAM中保留每一个文件的第一行,而且应该会更快些.

原文链接：https://www.f2er.com/c/113492.html

上一篇：c – 编译了if(this == NULL)测试的下一篇：返回1之间的差异,返回0并返回-1并退

猜你在找的C&C++相关文章

C++11新特性的一些用法举例②

/** C+⬑ * 默认成员函数原来C++类中，有6个默认成员函数：构造函数析...

作者：HJfjfK 时间：2024-09-28

C++特殊类的设计与单例模式

#pragma once // 1. 设计一个不能被拷贝的类/* 解析:拷贝只会放生在两个场景中：拷贝构造函...

作者：HJfjfK 时间：2024-09-28

C++11的类型转换

C类型转换 C语言:显式和隐式类型转换隐式类型转化：编译器在编译阶段自动进行，能转就转，...

作者：HJfjfK 时间：2024-09-28

C++异常的基本概念与用法

//异常的概念/*抛出异常后必须要捕获,否则终止程序(到最外层后会交给main管理,main的行为就...

作者：HJfjfK 时间：2024-09-28

C++的智能指针

#pragma once /*Smart pointer 智能指针;灵巧指针智能指针三大件//1.RAII//2.像指针一样使...

作者：HJfjfK 时间：2024-09-28

C++11标准库原子变量 <atomic> 梳理

目录<atomic>原子操作的概念CAS实现原理CAS操作的伪代码：使用CAS完成变量的...

作者：HJfjfK 时间：2024-09-28

C++11新特性的一些用法举例①

//字符串字面量/*常用:1.原始字符串字面量括号内保持原样输出没有转义字符,如n不再是换行...

作者：HJfjfK 时间：2024-09-28

C++11标准库条件变量 <condition_variable> 梳理

目录<condition_variable>condition_variable类类方法生产者消费者模型 -- ...

作者：HJfjfK 时间：2024-09-28

C++11智能指针 unique_ptr、shared_ptr/weak_ptr、make_shared、循环引用、定制删除器 (万字长文)

目录智能指针场景引入 - 为什么需要智能指针？内存泄漏什么是内存泄漏内存泄漏的危害内存泄...

作者：HJfjfK 时间：2024-09-28

/** 多态/动态调用 * * * 1.虚函数/虚拟函数 * 语法:在函数前面加上virtual * * 1.1虚函数...

作者：HJfjfK 时间：2024-09-28

编程分类

PHP Java Java SE Python C#C&C++Ruby VB asp.Net Go Perl netty Django Delphi Jsp .NET Core Spring Flask Springboot SpringMVC Lua Laravel Mybatis Asp Groovy ThinkPHP Yii swoole

最新文章