Files
system-backu/backend/app/core/backup/influxdb.py
T
publ 2568c0380b feat: MySQL SSL 支持 + 任务编辑回显 + InfluxDB 备份
MySQL:
- 新增 use_ssl 选项;MariaDB 11.x 默认强制 SSL 且默认 verify cert,
  故启用 SSL 时同时加 --skip-ssl-verify-server-cert 以兼容自签名证书。

任务编辑回显:
- 后端 JobOut 新增 source_config_safe 字段,解密后敏感字段(password/token/
  secret_key/access_key)脱敏为 "***"。
- 更新端点接收 source_config;若密码字段为 "***" 则保留原值不变,
  支持"不改密码只改其它字段"的常见场景。
- 前端 JobForm 完整回显所有数据源字段,type='edit' 时去掉 disabled。

InfluxDB 备份(新增类型):
- 后端 core/backup/influxdb.py:
  - v2.x:调用 influx CLI(influxdb2-client-2.7.5 二进制直接安装)执行 influx backup
    生成目录后 tar.gz 流式打包上传。
  - v1.x:通过 HTTP API 调用 /query?db=...&q=SELECT * FROM /.*/ 拉取全量数据
    导出为 CSV + META.txt。
- Dockerfile:直接下载 influx CLI 二进制(绕开 apt 签名问题)。
- 前端 JobForm:根据 version 动态显示 v1/v2 表单字段。
- schemas/job.py:新增 InfluxDBSourceConfigV1 / V2。
- 类型字面量扩展:'mysql' | 'directory' | 'influxdb'。

Co-Authored-By: Claude <noreply@anthropic.com>
2026-06-22 19:14:45 +08:00

194 lines
7.3 KiB
Python
Raw Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
"""InfluxDB 备份:通过 influx / influxd CLI 生成备份目录,再 tar.gz 流式打包。
支持 v1.x 和 v2.x
- v1.x:使用 influx backup CLI 子命令)
等价做法:用 influx_inspect export 转 line protocol,然后打包
这里采用更通用的:influxd backup(如果有) 或 打包 line-protocol dump
- v2.x:使用 influx backup <bucket> 命令生成备份目录
策略:
1. 在临时目录执行 backup 命令生成文件
2. 用 tarfile 流式打包整个目录
3. 子进程产出后整体打包上传
"""
import asyncio
import os
import shutil
import subprocess
import tarfile
import tempfile
from datetime import datetime
from pathlib import Path
from typing import AsyncIterator
from app.core.backup.base import BackupMetadata, BaseBackup
from app.utils.logging import get_logger
log = get_logger(__name__)
class InfluxDBBackup(BaseBackup):
def __init__(self, source_config: dict, job_name: str):
super().__init__(source_config, job_name)
self.version: str = source_config["version"]
self.host: str = source_config["host"]
self.port: int = int(source_config.get("port", 8086))
if self.version == "1":
self.database: str = source_config["database"]
self.username: str = source_config.get("username", "")
self.password: str = source_config.get("password", "")
else:
self.org: str = source_config["org"]
self.bucket: str = source_config["bucket"]
self.token: str = source_config["token"]
def metadata(self) -> BackupMetadata:
ts = datetime.now().strftime("%Y%m%d-%H%M%S")
if self.version == "1":
safe = "".join(c if c.isalnum() or c in ("_", "-") else "_" for c in self.database)
else:
safe = "".join(c if c.isalnum() or c in ("_", "-") else "_" for c in self.bucket)
return BackupMetadata(
suggested_filename=f"{self.job_name}-{self.version}-{safe}-{ts}.tar.gz",
content_type="application/gzip",
extra={"version": self.version, "host": self.host, "port": self.port},
)
async def produce(self) -> AsyncIterator[bytes]:
ts = datetime.now().strftime("%Y%m%d%H%M%S")
tmpdir = Path(tempfile.mkdtemp(prefix=f"influxbk_{self.job_name}_"))
backup_dir = tmpdir / "data"
backup_dir.mkdir()
try:
if self.version == "2":
await self._backup_v2(backup_dir)
else:
await self._backup_v1(backup_dir)
# 打包为 tar.gz 并流式输出
log.info("Taring influx backup at %s", backup_dir)
tar_path = tmpdir / "backup.tar.gz"
def _tar() -> None:
with tarfile.open(str(tar_path), mode="w:gz") as tar:
tar.add(str(backup_dir), arcname="data", recursive=True)
loop = asyncio.get_event_loop()
await loop.run_in_executor(None, _tar)
if not tar_path.exists() or tar_path.stat().st_size == 0:
raise RuntimeError("InfluxDB 备份为空,请检查数据库连接和 CLI 安装")
# 读取打包文件并流式产出
with open(tar_path, "rb") as f:
while True:
chunk = await loop.run_in_executor(None, f.read, 64 * 1024)
if not chunk:
break
yield chunk
finally:
shutil.rmtree(tmpdir, ignore_errors=True)
async def _backup_v2(self, dest: Path) -> None:
"""v2: influx backup --bucket X --org Y /dest"""
cmd = [
"influx", "backup",
"--bucket", self.bucket,
"--org", self.org,
"--host", f"http://{self.host}:{self.port}",
"--token", self.token,
str(dest),
]
log.info("Running: %s", " ".join(self._redact(cmd)))
proc = await asyncio.create_subprocess_exec(
*cmd,
stdout=asyncio.subprocess.PIPE,
stderr=asyncio.subprocess.PIPE,
)
stdout, stderr = await proc.communicate()
if proc.returncode != 0:
raise RuntimeError(
f"influx backup failed (exit={proc.returncode}): "
f"{(stderr or stdout).decode(errors='replace')[:2000]}"
)
async def _backup_v1(self, dest: Path) -> None:
"""v1: 通过 HTTP API 查询全量数据,导出为 CSV。
使用 httpx 直接调 InfluxDB v1 的 /query 接口(更可靠,不依赖 CLI 子命令兼容性)。
生成:
- {database}.csvSELECT * 结果
- META.txt:恢复所需的元信息(库名、host、时间戳等)
恢复:需手动用 influx -import 或写入 line protocol。
"""
import httpx
log.info("InfluxDB v1 backup via HTTP API: db=%s host=%s:%s",
self.database, self.host, self.port)
url = f"http://{self.host}:{self.port}/query"
params = {
"db": self.database,
"q": "SELECT * FROM /.*/",
"chunked": "true",
"epoch": "ns",
}
auth = None
if self.username:
auth = (self.username, self.password or "")
async with httpx.AsyncClient(timeout=300.0, auth=auth) as client:
try:
resp = await client.get(url, params=params)
except Exception as e:
raise RuntimeError(f"InfluxDB v1 HTTP 请求失败: {e}") from e
if resp.status_code != 200:
raise RuntimeError(
f"InfluxDB v1 返回 {resp.status_code}: {resp.text[:500]}"
)
body = resp.text
# 保存 CSV 和元信息
csv_file = dest / f"{self.database}.csv"
loop = asyncio.get_event_loop()
def _write_files() -> None:
csv_file.write_text(body, encoding="utf-8")
meta = dest / "META.txt"
meta.write_text(
f"influxdb_version=1\n"
f"host={self.host}\nport={self.port}\n"
f"database={self.database}\n"
f"username={self.username or ''}\n"
f"query=SELECT * FROM /.*/\n"
f"format=csv\n"
f"backup_time={datetime.utcnow().isoformat()}Z\n"
f"restore_hint=可使用 `influx -import -path={csv_file.name} "
f"-database={self.database}` 恢复;或在 InfluxQL shell 中执行 "
f"`INSERT INTO ... VALUES ...`\n",
encoding="utf-8",
)
await loop.run_in_executor(None, _write_files)
if not csv_file.exists() or csv_file.stat().st_size == 0:
raise RuntimeError("InfluxDB v1 查询结果为空,请检查数据库是否存在或是否有数据")
@staticmethod
def _redact(cmd: list[str]) -> list[str]:
"""日志脱敏 token/password。"""
out = []
skip_next = False
secret_flags = {"--token", "-password"}
for i, c in enumerate(cmd):
if skip_next:
out.append("***")
skip_next = False
continue
if c in secret_flags:
out.append(c)
skip_next = True
continue
out.append(c)
return out