当前位置：移动技术网 > IT编程>数据库>MongoDB > Mongodb 之 oplog进行数据备份恢复

Mongodb 之 oplog进行数据备份恢复

2020年05月06日 | 移动技术网IT编程 | 我要评论

oplog 应该就类似于 mysql bin-log 而事实上，确实差不多。oplog 也是用于复制集间由 primary 记录，secondary 用来同步。从而保持数据一致。

最近遇到了误删db（删库不能跑路）的事情，所以，实验了n多次的 oplog 恢复数据。

特地记录一下，以备后查。

# ------------------------------ oplog ---------------------------------
## 1. 在复制集中使用 oplog ，可以使用以下命令查看oplog情况：
rpset1:primary> rs.printreplicationinfo()
configured oplog size: 10240mb
log length start to end: 149092secs (41.41hrs)
oplog first event time: sun apr 26 2020 20:25:46 gmt+0800 (cst)
oplog last event time: tue apr 28 2020 13:50:38 gmt+0800 (cst)
now: tue apr 28 2020 13:50:38 gmt+0800 (cst)

rpset1:secondary> rs.printreplicationinfo()
configured oplog size: 10240mb
log length start to end: 149937secs (41.65hrs)
oplog first event time: sun apr 26 2020 20:10:59 gmt+0800 (cst)
oplog last event time: tue apr 28 2020 13:49:56 gmt+0800 (cst)
now: tue apr 28 2020 13:49:56 gmt+0800 (cst)

rpset1:secondary> rs.printreplicationinfo()
configured oplog size: 10240mb
log length start to end: 148635secs (41.29hrs)
oplog first event time: sun apr 26 2020 20:32:00 gmt+0800 (cst)
oplog last event time: tue apr 28 2020 13:49:15 gmt+0800 (cst)
now: tue apr 28 2020 13:49:16 gmt+0800 (cst)

# 配置文件 conf/slave.conf 中的oplogsize
replication:
oplogsizemb: 10240
replsetname: rpset1

从以上的命令中可以看出，这个复制集的 oplog 有41小时的容量，而这个 mongodb 每天都有定时备份。所以，这个容量肯定是够用了。

使用 oplogreplay 恢复数据，官文说必须要有一个特殊的权限。

## 2. 创建专门的角色使用 oplogreplay  此角色必须有 anyresource 和 anyaction
# 备份时不需要此权限，但恢复时必须要有此权限，否则恢复失败且没有报错信息。
use admin
db.createrole(
   {
    "role" : "sysadmin",
    "privileges" : [{ "resource" : {"anyresource" : true}, "actions" : ["anyaction"] }],
    "roles" : []
   }
)

# 创建专门的用户使用此角色
db.createuser({user:"admin", pwd:"admin", roles:[{role:"sysadmin", db:"admin"}]})
# 或者授权某个用户 db.grantrolestouser( "root" , [ { role: "sysadmin", db: "admin" } ])

检查一下定时备份db的命令，找到如下：

## 3. 日常全量备份
./mongodump -h 10.170.6.116:27017 -u admin -p admin --authenticationdatabase admin --gzip -o /data/tmp/rs0

# 备份时如果有 --oplog 选项，输出目录下就会有 oplog.bson 文件
# ./mongodump -h 10.170.6.116:27000 -u rsroot -p abcd1234 --authenticationdatabase admin --oplog -o /data/tmp/rs0

因为备份时没有带 --oplog 参数，所以进行恢复时，使用先恢复备份，再 oplogreplay的方式完成，也就是参考下面的第9点。

而4到8点，用来在恢复备份的同时带上 oplogreplay 的方式。

## 4. 假设上次日常备份之后的某个时间点出现了误删除操作，就需要利用 oplogreplay 来恢复这段时间的新数据
# 先检查上次日常备份的时间点（如果 dump 时使用了 --oplog 参数，就会有oplog.bson文件。如果没有，可参考第9条）：
./bsondump /data/tmp/rs0/oplog.bson > /data/tmp/0
cat /data/tmp/0  
# 找到第一行 {"ts":{"$timestamp":{"t":1588138496,"i":1}}, ...

# 字段的意思：

ts: 操作发生的时间，t: unix时间戳， i: 可以认为是同一时间内的第几个.
h: 记录的唯一id
v: 版本信息
op: 写操作的类型
   n: no-op
   c: db cmd
   i: insert
   u: update
   d: delete

ns: 操作的namespace, 即： 数据库.集合
o: 操作所对应的文档
o2: 更新时所对应的where条件，更新时才有

# 起始时间戳可自由指定，不必oplog中找记录。稍微早于需要的时间点即可。
./mongodump -h 192.168.6.116:27017 -u admin -p admin --authenticationdatabase admin -d local -c oplog.rs -q '{"ts":{"$gt": {"$timestamp":{"t":1588138300,"i":1}}}}' -o /data/tmp/rs1

## 5. 导出当前的 local/oplog.rs  注意 -q 选项的 json格式
# 因为备份整个 local/oplog.rs 容量太大，恢复也会耗时过长，所以采用起始时间的方式：
./mongodump -h 192.168.6.116:27017 -u admin -p admin --authenticationdatabase admin -d local -c oplog.rs -q '{"ts":{"$gt": {"$timestamp":{"t":1588138393,"i":1}}}}' -o /data/tmp/rs1
# 也可以同时指定结束时间，如下：
./mongodump -h 192.168.6.116:27017 -u rsroot -p abcd1234 --authenticationdatabase admin -d local -c oplog.rs -q '{"ts":{"$lte": {"$timestamp":{"t":1588142111,"i":1}}, "$gte": {"$timestamp":{"t":1588138393,"i":1}}}}' -o /data/tmp/rs2


## 6. 检查 oplog.rs.bson 手工找出误删除的时间戳：
./bsondump /data/tmp/rs1/local/oplog.rs.bson > /data/tmp/1
# 打开 /data/tmp/1 手工查找，如果有删除表或库，则有 drop 信息, 如果有删除数据，则有 "op":"d" 信息


## 7. 替换日常全备份中的 oplog.bson
rm -rf /data/tmp/rs0/oplog.bson
mv /data/tmp/rs1/local/oplog.rs.bson /data/tmp/rs0/oplog.bson


## 8. 执行恢复命令（注意用户权限）
./mongorestore -h 192.168.6.116:27017 -u admin -p admin --authenticationdatabase admin --oplogreplay --oploglimit "1588232764:1" --dir /data/tmp/rs0/ 
# 其中 1588232764 即是 $timestamp 中的"t"，1 即是 $timestamp 中的 "i" 这样配置后oplog将会
# 重放到这个时间点以前，即正好避开了第一条删除语句及其后面的操作，数据库停留在灾难前状态


## 9. 如果日常备份没有 --oplog 并且使用了 --gzip，可以先恢复此备份。
# 然后再使用oplogreplay 指定单独的 oplog.rs.bson 文件进行恢复.
./mongorestore -h 192.168.6.116:27017 -u admin -p admin --authenticationdatabase admin /data/tmp/rs0/ --gzip
./mongorestore -h 192.168.6.116:27017 -u admin -p admin --authenticationdatabase admin --oplogreplay --oploglimit "1588232764:1" /data/tmp/rs1/local/oplog.rs.bson

不必担心数据混乱。因为 oplog 的幂等性，即使多次replay 也不会产生重复数据。已存在相同的 _id，即使其它字段不同，也不会恢复，不存在的 _id 则会恢复。

当然，也可以将备份和oplog恢复到某台单机上，再使用导出导入的方法将数据移到生产环境。

原文：https://www.cnblogs.com/frx9527/p/oplog.html

您可能感兴趣的文章:

如对本文有疑问，点击进行留言回复！！

MongoDB常用数据库命令大全

一、mongodb 数据库常用操作命令1、help查看命令提示helpdb.help();db.yourcoll.help();2、切换/创建数据库use ra... [阅读全文]
28个MongoDB经典面试题详解

mongodb是目前最好的面向文档的免费开源nosql数据库。如果你正准备参加mongodb nosql数据库的技术面试，你最好看看下面的mongodb nos... [阅读全文]
MongoDB 数据库的命名、设计规范详解

mongodb 数据库的命名和设计也有一套规范。只不过，由于用的人不多，目前在业界还没有形成权威的共识，今天根据我个人平时的一些经验，总结了一些规范第一部分，我... [阅读全文]
MongoDB中数据的替换方法实现类Replace()函数功能详解

近日接到一个开发需求，因业务调整，需要dba协助，将mongodb数据库中某集合的进行替换。例如我们需要将集合a中b字段中，有关《美好》的字符替换为《非常美好... [阅读全文]
解决MongoDB占用内存过大频繁死机的方法详解

从mongodb 3.4开始，默认的wiredtiger内部缓存大小是以下两者中的较大者：50％（ram-1 gb），或 256 mb例如，在总共有4gb ra... [阅读全文]
在 Fedora 上安装 MongoDB 服务器的方法教程

mongo（来自 “humongous” —— 巨大的）是一个高性能、开源、无模式的、面向文档的数据库，它是最受欢迎的 nosql 数据库之一。它使用 json... [阅读全文]
mongodb driver使用代码详解

mongodb 是一个基于分布式文件存储的数据库。由 c++ 语言编写。旨在为 web 应用提供可扩展的高性能数据存储解决方案。mongodb 是一个介于关系数... [阅读全文]
MongoDB操作符中的$elemMatch问题

问题如果mongodb 数据库集合中仅存在一条记录{ "_id" : objectid("5e6b4ef546b5f44e5c5b276d"), "name... [阅读全文]
Redis 字符串 SDS

SDS 简单动态字符串。 SDS的结构： struct sdshdr{ int len;//记录BUF数组中已使用字节的数量，等于SDS所八寸字符串的... [阅读全文]
理解Redis持久化，RDB持久化和AOF持久化的不同处理方式

理解和掌握Redis的持久机制，对于Redis的日常开发和运维都有很大帮助，也是在大厂面试经常被问到的知识点。 ... [阅读全文]

网友评论


验证码：

Mongodb 之 oplog进行数据备份恢复

2020年05月06日 | 移动技术网IT编程 | 我要评论

您可能感兴趣的文章:

相关文章:

网友评论