读60行代码完成的NoSQL数据库,看数据库打造面临的挑战

读60行代码完成的NoSQL数据库,看数据库打造面临的挑战

发表于 2013-07-16 14:25| 9460次阅读| 来源 Dzone| 21条评论| 作者 Ayende Rahien

摘要:60行代码确实可以完成一个NoSQL数据库,增加一半的代码或许也可以完成预防重复插入及修改校验。然而数据库不只需要处理并发问题,还有其它需要注意的地方,比如:脏读和锁。

“不要试图去自建一个数据库”,从某些角度上来说这个观点所言非虚。虽然自建的数据从来都不会被真正投入使用、测试等,然而却是一个非常好的途径去讨论现实数据库打造中所遇到的挑战。下面是说的是一个代码不到60行的键值存储NoSQL数据库,具备完善的功能、良好的可扩展性并且允许分片。或许它可以称得上最小的数据库,然而待完善的方面也不可谓不多。

首先是服务器端代码:

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
public class NoSqlDbController : ApiController
{
   static readonly ConcurrentDictionary<string, byte []= "" > data =
     new ConcurrentDictionary<string,204)!important">"" >(StringComparer.InvariantCultureIgnoreCase);
   public HttpResponseMessage Get(string key)
  {
     byte [] value;
if (data.TryGetValue(key,out value) == false )
       return new HttpResponseMessage(HttpStatusCode.NotFound);
new HttpResponseMessage
      {
      Content = new ByteArrayContent(value)
      };
  }
  
   void Put(string key,[FromBody] byte [] value)
  {
    data.AddOrUpdate(key,value,(_,__) => value);
  }
void Delete(string key)
  {
byte [] value;
    data.TryRemove(key,out value);
  }
}

然后是客户端代码:

4
25
26
27
28
29
30
31
32
33
class NoSqlDbClient
private readonly HttpClient[] clients;
   public NoSqlDbClient(string[] urls)
  {
    clients = new HttpClient[urls.Length];
for (var i = 0 ; i < urls.Length; i++)
    {
      clients[i] = new HttpClient { BaseAddress = new Uri(urls[i]) };
    }
  }
public Task PutAsync(string key,153)!important; font-weight:bold!important">byte [] data)
  {
    var client = clients[key.GetHashCode()%clients.Length];
     return client.PutAsync( "?key=" + key,153)!important; font-weight:bold!important">new ByteArrayContent(data));
  }
public Task DeleteAsync(string key,153)!important; font-weight:bold!important">byte [] data)
  {
    var client = clients[key.GetHashCode() % clients.Length];
     return client.DeleteAsync( "?key=" + key);
  }
public async Task< byte []> GetAsync(string key)
  {
    var client = clients[key.GetHashCode() % clients.Length];
    var r = await client.GetAsync( "?key=" + key);
return await r.Content.ReadAsByteArrayAsync();
  }
}

如代码所见,这个世界上最小的NoSQL数据库有着非常好的并发模型,并且基于Last Write Wins策略。可以安全的应对并发问题,然而这样就万无一失了?

实际情况并非如此。在实际生产过程中,数据库不是只需要处理并发问题,比如其它需要注意的地方:

  • 插入时必须检验该值是否已存在
  • 修改时必须校验该值是否同于修改前

实现这些其实非常简单,你必须为每次修改增加一个元数据字段version。下面是所需修改代码:

8
26
31
33
34
35
36
class Data
{
byte [] Value;
int Version;
}
public HttpResponseMessage Get(string key)
{
Data value;
false )
new HttpResponseMessage(HttpStatusCode.NotFound);
new HttpResponseMessage
{
Headers = { "Version" ,value.Version },
Content = new ByteArrayContent(value.Value)
};
}
byte [] value,153)!important; font-weight:bold!important">int version)
{
data.AddOrUpdate(key,() =>
{ // create
if (version != 0 )
throw new ConcurrencyException();
new Data{ Value = value,Version = 1 };
},prev) =>
{ // update
if (prev.Version != version)
new ConcurrencyException();
1 };
});
}

如上所见,仅仅将代码量改为双倍,但是却解决了很多问题。RavenDB使用了类似的并发写入控制,虽然RavenDB的ETag机制还可以做更多的事情。然而以上版本实际上是不够,它只可以做写入的并发控制,而缺乏读取的相关操作。

我们还需要对不可重复读和幻读做出处理:

  • 不可重复读指在一个需要对数据进行重复读取的事务中,第一次读取到了数据,而在第二次却读取不到数据,因为这里存在被他人删除的情况。
  • 幻读则是反过来的,第一次未读取到数据,而在第二次被其他人建立后,又读取到了数据。

因为你只注重单操作/事务/会话,所以在特定的场景下,可能会产生非常有意思的bug,实际上也没有办法去处理这个问题。

另一个需要处理的方面是锁。有些时候用户有着非常合理的理由去给某条记录加上一定时间的锁,而在多用户对某条记录并发修改时加锁也是唯一的解决方案。锁又分为Write和ReadWrite两种。Write锁只允许其它用户对被锁的数据进行读取,同时禁止其对数据进行修改。在实际情况中,让用户立刻失败也比让其等待要好的多。

之所以会立即返回失败是因为你操作的数据被加上了Write锁,这就意味着该数据已经被修改或者将要被修改。你写入将会作用在一个过期的数据,所以返回立即失败会更恰当一点。对于ReadWrite锁,情况会有所不同。在这种情况下,我们同时禁止了其它用户的读操作。这么做一般是为了保障系统的一致性,基本上任何作用在该条记录上的操作都要等待锁的失效。

在实践中,一旦加ReadWrite锁,你必须要去处理锁的有效期、手动解锁、锁失效检测、锁维护等一系列的问题。ReadWrite锁主要用于在不支持事务的系统中的进行一些事务操作,其它情况下谓之鸡肋亦不为过。

原文链接:World’s Smallest No SQL Database: Concurrency(编译/仲浩 审校/周小璐)

版权声明:本文内容由互联网用户自发贡献,该文观点与技术仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请发送邮件至 dio@foxmail.com 举报,一经查实,本站将立刻删除。

相关推荐


文章浏览阅读752次。关系型数据库关系型数据库是一个结构化的数据库,创建在关系模型(二维表模型)基础上,一般面向于记录SQL语句(标准数据查询语言)就是一种基于关系型数据库的语言,用于执行对关系型数据库中数据的检索和操作主流的关系数据库包括Oracle、Mysql、SQL Server、Microsoft Access、DB2等非关系型数据库NoSQL(nOSQL=Not Only SQL),意思是“不仅仅是SQL”,是非关系型数据库的总称。除了主流的关系型数据库外的数据库,都认为是非关系型主流的NoSQ.._redis是非关系型数据库吗
文章浏览阅读687次,点赞2次,收藏5次。商城系统中,抢购和秒杀是很常见的营销场景,在一定时间内有大量的用户访问商场下单,主要需要解决的问题有两个:1. 高并发对数据库产生的压力;2. 竞争状态下如何解决商品库存超卖;高并发对数据库产生的压力对于第一个问题,使用缓存来处理,避免直接操作数据库,例如使用 Redis。竞争状态下如何解决商品库存超卖对于第二个问题,需要重点说明。常规写法:查询出对应商品的库存,判断库存数量否大于 0,然后执行生成订单等操作,但是在判断库存是否大于 0 处,如果在高并发下就会有问题,导致库存_php库存结余并发
文章浏览阅读1.4k次。MongoTemplate开发spring-data-mongodb提供了MongoTemplate和MongoRepository两种方式访问MongoDB,MongoRepository的方式访问较为简单,MongoTemplate方式较为灵活,这两种方式在Java对于MongoDB的运用中相辅相成。_springboot插入指定的mongodb数据库
文章浏览阅读887次,点赞10次,收藏19次。1.背景介绍1. 背景介绍NoSQL数据库是一种非关系型数据库,它的特点是可以存储非结构化的数据,并且可以处理大量的数据。HBase是一个分布式、可扩展的列式存储系统,它是基于Google的Bigtable设计的。HBase是一个开源的NoSQL数据库,它的核心功能是提供高性能的随机读写访问。在本文中,我们将对比HBase与其他NoSQL数据库,例如Redis、MongoDB、Cass...
文章浏览阅读819次。MongoDB连接失败记录_edentialmechanisn-scram-sha-1
文章浏览阅读470次。mongodb抽取数据到ES,使用ELK内部插件无法获取数据,只能试试monstache抽取mongodb数据,但是monstache需要mongodb replica set 模式才能采集数据。############monstache-compose文件。#replicas set 启动服务。# 默认备份节点不能读写,可以设置。# mydb指的是需要同步的数据库。#登录主mongodb初始化rs。#primary 创建用户。# ip地址注意要修改。# ip地址注意要修改。_monstache csdn
文章浏览阅读913次,点赞4次,收藏5次。storage:fork: trueadmin登录切换数据库注意: use 代表创建并使用,当库中没有数据时默认不显示这个库删除数据库查看表清单> show tables # 或者 > show collections表创建db.createCollection('集合名称', [options])table1字段类型描述capped布尔(可选)如果为 true,则创建固定集合。固定集合是指有着固定大小的集合,当达到最大值时,它会自动覆盖最早的文档。_mongodb5
文章浏览阅读862次。Centos7.9设置MongoDB开机自启(超全教程,一条龙)_mongodb centos开机启动脚本
文章浏览阅读1.3k次,点赞6次,收藏21次。NoSQL数据库使用场景以及架构介绍
文章浏览阅读856次,点赞21次,收藏20次。1.背景介绍1. 背景介绍NoSQL数据库是一种非关系型数据库,它的设计目标是为了解决传统关系型数据库(如MySQL、Oracle等)在处理大量不结构化数据方面的不足。NoSQL数据库可以处理大量数据,具有高性能、高可扩展性和高可用性。但是,与关系型数据库不同,NoSQL数据库没有固定的模式,数据结构也不一定是表格。在NoSQL数据库中,数据存储和查询都是基于键值对、列族、图形等不同的...
文章浏览阅读416次。NoSQL定义:非关系型、分布式、开放源码和具有横向扩展能力的下一代数据库。由c++编写的开源、高性能、无模式的基于分布式文件存储的文档型数据库特点:高性能、高可用性、高扩展性、丰富的查询支持、可替换已完场文档某个指定的数据字段应用场景:社交场景:使用mongodb存储用户信息游戏场景:用户信息,装备积分物流场景:订单信息,订单状态场景操作特点:数据量大;读写操作频繁;价值较低的数据,对事物性要求不高开源、c语言编写、默认端口号6379、key-value形式存在,存储非结构化数据。_nosql
文章浏览阅读1.5k次,点赞3次,收藏2次。Exception in thread "main" redis.clients.jedis.exceptions.JedisConnectionException: Failed to create socket. at redis.clients.jedis.DefaultJedisSocketFactory.createSocket(DefaultJedisSocketFactory.java:110) at redis.clients.jedis.Connection.connect(Conne_redis.clients.jedis.exceptions.jedisconnectionexception: failed to create so
文章浏览阅读6.5k次,点赞3次,收藏12次。readAnyDatabase(在所有数据库上都有读取数据的权限)、readWriteAnyDatabase(在所有数据库上都有读写数据的权限)、userAdminAnyDatabase(在所有数据库上都有管理user的权限)、dbAdminAnyDatabase(管理所有数据库的权限);:clusterAdmin(管理机器的最高权限)、clusterManager(管理和监控集群的权限)、clusterMonitor(监控集群的权限)、hostManager( 管理Server);_mongodb创建用户密码并授权
文章浏览阅读593次。Redis是一个基于内存的键值型NoSQL数据库,在实际生产中有着非常广泛的用处_搭建本地redis
文章浏览阅读919次。Key 的最佳实践[业务名]:[数据名]:[id]足够简短:不超过 44 字节不包含特殊字符Value 的最佳实践:合理的拆分数据,拒绝 BigKey选择合适数据结构Hash 结构的 entry 数量不要超过 1000(默认是 500,如果达到上限则底层会使用哈希表而不是 ZipList,内存占用较多)设置合理的超时时间批量处理的方案:原生的 M 操作Pipeline 批处理注意事项:批处理时不建议一次携带太多命令。Pipeline 的多个命令之间不具备原子性。_redis高级实战
文章浏览阅读1.2k次。MongoDB 递归查询_mongodb数据库 递归
文章浏览阅读1.2k次。通过实际代码例子介绍:如何通过MongoTemplate和MongoRepository操作数据库数据_springboot操作mongodb
文章浏览阅读687次,点赞7次,收藏2次。首先欢迎大家阅读此文档,本文档主要分为三个模块分别是:Redis的介绍及安装、RedisDesktopManager可视化工具的安装、主从(哨兵)模式的配置。_redis 主从配置工具
文章浏览阅读764次。天下武功,无坚不摧,唯快不破!我的名字叫 Redis,全称是 Remote Dictionary Server。有人说,组 CP,除了要了解她外,还要给机会让她了解你。那么,作为开发工程师的你,是否愿意认真阅读此心法抓住机会来了解我,运用到你的系统中提升性能。我遵守 BSD 协议,由意大利人 Salvatore Sanfilippo 使用 C 语言编写的一个基于内存实现的键值型非关系(NoSQL)..._redis 7.2 源码
文章浏览阅读2k次。MongoDB 的增删改查【1】_mongodb $inc