Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $YECBGYFECGEAFWHA as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2

Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $BBWFDDBHHYHDXXAB as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2
看看MySQL 8 新特性Clone Plugin_创想鸟

看看MySQL 8 新特性Clone Plugin

mysql视频教程栏目介绍MySQL 8的新特性Clone Plugin

看看MySQL 8 新特性Clone Plugin

Clone Plugin是MySQL 8.0.17引入的一个重大特性,为什么要实现这个特性呢?个人感觉,主要还是为Group Replication服务。在Group Replication中,添加一个新的节点,差异数据的补齐是通过分布式恢复(Distributed Recovery)来实现的。

在MySQL 8.0.17之前,只支持一种恢复方式-Binlog。但如果新节点需要的Binlog已经被Purge了,这个时候,只能先借助于备份工具(XtraBackup,mydumper,mysqldump)做个全量数据的同步,然后再通过分布式恢复同步增量数据。

这种方式,虽然也能实现添加节点的目的,但总归还是要借助于外部工具,需要一定的工作量和使用门槛。要知道,其竞争对手,PXC,默认集成了XtraBackup进行State Snapshot Transfer(类似于全量同步),而MongoDB则更进一步,原生就实现了Initial Sync同步全量数据。从易用性来看,单就集群添加节点这一项而言,MySQL确实不如其竞争对手。客户体验上,还有很大的提升空间。

好在MySQL官方也正视到这个差距,终于在MySQL 8.0.17实现了Clone Plugin。当然,对于官方来说,实现这个特性并不算难,毕竟有现成的物理备份工具(MySQL Enterprise Backup)可供借鉴。

本文将从以下几个方面展开:

Clone Plugin的安装Clone Plugin的使用如何查看克隆操作的进度如何基于克隆数据搭建从库Clone Plugin的实现细节Clone Plugin的限制Clone Plugin与XtraBackup的对比Clone Plugin的参数解析

一、Clone Plugin的安装

Clone Plugin支持以下两种安装方式:

(1)配置文件指定

[mysqld]plugin-load-add=mysql_clone.soclone=FORCE_PLUS_PERMANENT复制代码

这里的clone,严格来说,不是参数名,而是插件名,可加可不加,FORCE_PLUS_PERMANENT 控制插件的行为。

有四个取值:

ON**(**开启插件)OFF(禁用插件)FORCE(强制开启。如果插件初始化失败,MySQL将不会启动)FORCE_PLUS_PERMANENT(在FORCE的基础上,不允许通过UNINSTALL PLUGIN命令卸载插件)。

(2)动态加载

[mysqld]plugin-load-add=mysql_clone.soclone=FORCE_PLUS_PERMANENT复制代码

查看插件是否安装成功

mysql> show plugins;...| clone                           | ACTIVE   | CLONE              | mysql_clone.so | GPL     |...复制代码

clone状态显示为”ACTIVE“代表插件加载成功。

二、Clone Plugin的使用

Clone Plugin支持两种克隆方式:本地克隆和远程克隆。

1、 本地克隆

看看MySQL 8 新特性Clone Plugin

本地克隆是在实例本地发起的,其语法如下:

CLONE LOCAL DATA DIRECTORY [=] 'clone_dir';复制代码

其中,clone_dir是克隆目录。

下面看个具体的Demo。

创建克隆用户

mysql> create user 'clone_user'@'%' identified by 'clone_pass';mysql> grant backup_admin on *.* to 'clone_user'@'%';复制代码

创建克隆目录

# mkdir /data/mysql# chown -R mysql.mysql /data/mysql复制代码

创建本地克隆

# mysql -uclone_user -pclone_passmysql> clone local data directory='/data/mysql/3307';复制代码

其中,“/data/mysql/3307” 是克隆目录,其需满足以下几点要求:

克隆目录必须是绝对路径。“/data/mysql”必须存在,且MySQL对其有可写权限。3307不能存在。

查看克隆目录的内容

# ll /data/mysql/3307total 172996drwxr-x--- 2 mysql mysql       89 May 24 22:37 #clone-rw-r----- 1 mysql mysql     3646 May 24 22:37 ib_buffer_pool-rw-r----- 1 mysql mysql 12582912 May 24 22:37 ibdata1-rw-r----- 1 mysql mysql 50331648 May 24 22:37 ib_logfile0-rw-r----- 1 mysql mysql 50331648 May 24 22:37 ib_logfile1drwxr-x--- 2 mysql mysql        6 May 24 22:37 mysql-rw-r----- 1 mysql mysql 25165824 May 24 22:37 mysql.ibddrwxr-x--- 2 mysql mysql       20 May 24 22:37 slowtechdrwxr-x--- 2 mysql mysql       28 May 24 22:37 sys-rw-r----- 1 mysql mysql 10485760 May 24 22:37 undo_001-rw-r----- 1 mysql mysql 11534336 May 24 22:37 undo_002复制代码

相对于Xtrabackup,无需Prepare,直接即可启动使用。

# /usr/local/mysql/bin/mysqld --no-defaults --datadir=/data/mysql/3307 --user mysql --port 3307 &复制代码

2、远程克隆

看看MySQL 8 新特性Clone Plugin看看MySQL 8 新特性Clone Plugin

远程克隆涉及两个实例,其中,待克隆的实例是Donor,接受克隆数据的实例是Recipient。克隆命令需在Recipient上发起,语法如下:

CLONE INSTANCE FROM 'user'@'host':portIDENTIFIED BY 'password'[DATA DIRECTORY [=] 'clone_dir'][REQUIRE [NO] SSL];复制代码

其中,host,port 是待克隆实例的(Donor)的IP和端口,user,password是Donor上的克隆用户和密码,需要backup_admin权限,如上面创建的clone_user。

DATA DIRECTORY指定备份目录,不指定的话,则默认克隆到Recipient的数据目录下。

REQUIRE [NO] SSL,是否开启SSL通信。

下面,看个具体Demo。

首先,在Donor实例上创建克隆用户,加载Clone Plugin。

mysql> create user 'donor_user'@'%' identified by 'donor_pass';mysql> grant backup_admin on *.* to 'donor_user'@'%';mysql> install plugin clone soname 'mysql_clone.so';复制代码

backup_admin是克隆操作必需权限。

接着,在Recipient实例上创建克隆用户,加载Clone Plugin。

mysql> create user 'recipient_user'@'%' identified by 'recipient_pass';mysql> grant clone_admin on *.* to 'recipient_user'@'%';mysql> install plugin clone soname 'mysql_clone.so';复制代码

这里的clone_admin,隐式含有backup_admin(阻塞DDL)和shutdown(重启实例)权限。

设置Donor白名单。Recipient只能克隆白名单中的实例。

mysql> set global clone_valid_donor_list = '192.168.244.10:3306';复制代码

设置该参数需要SYSTEM_VARIABLES_ADMIN权限。

在Recipient上发起克隆命令

# mysql -urecipient_user -precipient_passmysql> clone instance from 'donor_user'@'192.168.244.10':3306 identified by 'donor_pass';Query OK, 0 rows affected (36.97 sec)复制代码

远程克隆会依次进行以下操作:

**(1)****获取备份锁。**备份锁和DDL互斥。注意,不仅仅是Recipient,Donor上的备份锁同样会获取。

**(2)****DROP用户表空间。**注意,DROP的只是用户数据,不是数据目录,也不包括mysql,ibdata等系统表空间。

**(3)从Donor实例拷贝数据。**对于用户表空间,会直接拷贝,如果是系统表空间 ,则会重命名为xxx.#clone,不会直接替代原文件。

 ll /data/mysql/3306/data/...-rw-r----- 1 mysql mysql     3646 May 25 07:20 ib_buffer_pool-rw-r----- 1 mysql mysql     3646 May 27 07:31 ib_buffer_pool.#clone-rw-r----- 1 mysql mysql 12582912 May 27 07:31 ibdata1-rw-r----- 1 mysql mysql 12582912 May 27 07:31 ibdata1.#clone-rw-r----- 1 mysql mysql 50331648 May 27 07:32 ib_logfile0-rw-r----- 1 mysql mysql 50331648 May 27 07:31 ib_logfile0.#clone...-rw-r----- 1 mysql mysql 25165824 May 27 07:31 mysql.ibd-rw-r----- 1 mysql mysql 25165824 May 27 07:31 mysql.ibd.#clone...复制代码

**(4)重启实例。**在启动的过程中,会用xxx.#clone替换掉原来的系统表空间文件。

三、如何查看克隆操作的进度

查看克隆操作的进度主要依托于performance_schema.clone_status和performance_schema.clone_progress这两张表。

首先看看performance_schema.clone_status表。

mysql> select * from performance_schema.clone_statusG*************************** 1. row ***************************             ID: 1            PID: 0          STATE: Completed     BEGIN_TIME: 2020-05-27 07:31:24.220       END_TIME: 2020-05-27 07:33:08.185         SOURCE: 192.168.244.10:3306    DESTINATION: LOCAL INSTANCE       ERROR_NO: 0  ERROR_MESSAGE:    BINLOG_FILE: mysql-bin.000009BINLOG_POSITION: 665197555  GTID_EXECUTED: 59cd4f8f-8fa1-11ea-a0fe-000c29f66609:1-5601 row in set (0.06 sec)复制代码

顾名思义,该表记录了克隆操作的当前状态。

其中,

**PID:**Processlist ID。对应show processlist中的Id,如果要终止当前的克隆操作,执行kill processlist_id命令即可。

**STATE:**克隆操作的状态,Not Started(克隆尚未开始),In Progress(克隆中),Completed(克隆成功),Failed(克隆失败)。如果是Failed状态,ERROR_NO,ERROR_MESSAGE会给出具体的错误编码和错误信息。

**BEGIN_TIME,END_TIME:**克隆操作开始,结束时间。

**SOURCE:**Donor实例的地址。

Lifetoon Lifetoon

免费的AI漫画创作平台

Lifetoon 92 查看详情 Lifetoon

**DESTINATION:**克隆目录。“LOCAL INSTANCE”代表当前实例的数据目录。

**GTID_EXECUTED,BINLOG_FILE(BINLOG_POSITION):**克隆操作结束时,主库已经执行的GTID集合,及一致性位置点。可利用这些信息来搭建从库。

接下来看看performance_schema.clone_progress表。

mysql> select * from performance_schema.clone_progress;+------+-----------+-----------+----------------------------+----------------------------+---------+-----------+-----------+-----------+------------+---------------+| ID   | STAGE     | STATE     | BEGIN_TIME                 | END_TIME                   | THREADS | ESTIMATE  | DATA      | NETWORK   | DATA_SPEED | NETWORK_SPEED |+------+-----------+-----------+----------------------------+----------------------------+---------+-----------+-----------+-----------+------------+---------------+|    1 | DROP DATA | Completed | 2020-05-27 07:31:28.581661 | 2020-05-27 07:31:35.855706 |       1 |         0 |         0 |         0 |          0 |             0 ||    1 | FILE COPY | Completed | 2020-05-27 07:31:35.855952 | 2020-05-27 07:31:58.270881 |       2 | 482463294 | 482463294 | 482497011 |          0 |             0 ||    1 | PAGE COPY | Completed | 2020-05-27 07:31:58.271250 | 2020-05-27 07:31:58.719085 |       2 |  10977280 |  10977280 |  11014997 |          0 |             0 ||    1 | REDO COPY | Completed | 2020-05-27 07:31:58.720128 | 2020-05-27 07:31:58.930804 |       2 |    465408 |    465408 |    465903 |          0 |             0 ||    1 | FILE SYNC | Completed | 2020-05-27 07:31:58.931094 | 2020-05-27 07:32:01.063325 |       2 |         0 |         0 |         0 |          0 |             0 ||    1 | RESTART   | Completed | 2020-05-27 07:32:01.063325 | 2020-05-27 07:32:59.844119 |       0 |         0 |         0 |         0 |          0 |             0 ||    1 | RECOVERY  | Completed | 2020-05-27 07:32:59.844119 | 2020-05-27 07:33:08.185367 |       0 |         0 |         0 |         0 |          0 |             0 |+------+-----------+-----------+----------------------------+----------------------------+---------+-----------+-----------+-----------+------------+---------------+7 rows in set (0.00 sec)复制代码

该表记录了克隆操作的进度信息。

**STAGE:**一个克隆操作可依次细分为DROP DATA,FILE COPY,PAGE COPY,REDO COPY,FILE SYNC,RESTART,RECOVERY等7个阶段。当前阶段结束了才会开始下一个阶段。

**STATE:**当前阶段的状态。有三种状态:Not Started,In Progress,Completed。

**BEGIN_TIME,END_TIME:**当前阶段的开始时间和结束时间。

**THREADS:**当前阶段使用的并发线程数。

**ESTIMATE:**预估的数据量。

**DATA:**已经拷贝的数据量。

**NETWORK:**通过网络传输的数据量。如果是本地克隆,该列的值为0。

**DATA_SPEED,NETWORK_SPEED:**当前数据拷贝的速率和网络传输的速率。

注意,是当前值。

四、如何基于克隆数据搭建从库

在前面,我们介绍过performance_schema.clone_status表,该表会记录Donor实例的一致性位置点信息。我们可以利用这些信息来搭建从库。

mysql> select * from performance_schema.clone_statusG*************************** 1. row ***************************...    BINLOG_FILE: mysql-bin.000009BINLOG_POSITION: 665197555  GTID_EXECUTED: 59cd4f8f-8fa1-11ea-a0fe-000c29f66609:1-5601 row in set (0.06 sec)复制代码

这里,区分两种场景,GTID复制和基于位置点的复制。

1、GTID复制

mysql> CHANGE MASTER TO MASTER_HOST = 'master_host_name', MASTER_PORT = master_port_num,       ...       MASTER_AUTO_POSITION = 1;mysql> START SLAVE;复制代码

需要注意的是,无需额外执行set global gtid_purged操作。通过克隆数据启动的实例,gtid_purged已经初始化完毕。

mysql> show global variables like 'gtid_purged';+---------------+--------------------------------------------+| Variable_name | Value                                      |+---------------+--------------------------------------------+| gtid_purged   | 59cd4f8f-8fa1-11ea-a0fe-000c29f66609:1-560 |+---------------+--------------------------------------------+1 row in set (0.00 sec)复制代码

2、基于位置点的复制

这里,同样要区分两种场景。

场景1,Recipient要作为Donor的从库。

mysql> SELECT BINLOG_FILE, BINLOG_POSITION FROM performance_schema.clone_status; mysql> CHANGE MASTER TO MASTER_HOST = 'master_host_name', MASTER_PORT = master_port_num,       ...       MASTER_LOG_FILE = 'master_log_name',       MASTER_LOG_POS = master_log_pos;mysql> START SLAVE;复制代码

其中,

master_host_name,master_port_num:Donor实例的IP和端口。

master_log_name,master_log_pos:performance_schema.clone_status 中的BINLOG_FILE, BINLOG_POSITION。

场景2,Donor本身就是一个从库,Recipient要作为Donor主库的从库。

mysql> SELECT MASTER_LOG_NAME, MASTER_LOG_POS FROM mysql.slave_relay_log_info;mysql> CHANGE MASTER TO MASTER_HOST = 'master_host_name', MASTER_PORT = master_port_num,       ...       MASTER_LOG_FILE = 'master_log_name',       MASTER_LOG_POS = master_log_pos;mysql> START SLAVE;复制代码

其中,

master_host_name,master_port_num:Donor主库的IP和端口。

master_log_name,master_log_pos:mysql.slave_relay_log_info中的Master_log_name,Master_log_pos(分别对应 SHOW SLAVE STATUS 中的 Relay_Master_Log_File,Exec_Master_Log_Pos)。

在搭建从库时,建议设置–skip-slave-start。该参数默认为OFF,实例启动后,会自动执行START SLAVE操作。

如果Donor是个从库,Recipient会基于mysql.slave_master_info,mysql.slave_relay_log_info中的信息自动建立复制,很多时候,这未必是我们的预期行为。

五、Clone Plugin的实现细节

克隆操作可细分为以下5个阶段。

[INIT] ---> [FILE COPY] ---> [PAGE COPY] ---> [REDO COPY] -> [Done]复制代码

**1、INIT:**初始化一个克隆对象。

**2、FILE COPY:**拷贝所有数据文件。在拷贝之前,会记录一个LSN,作为“CLONE START LSN”,这个LSN其实是当前CHECKPOINT的LSN,同时启动“Page Tracking”特性。

“Page Tracking”会跟踪“CLONE START LSN”之后被修改的页,具体来说,会记录该页的Tablespace ID和page ID。数据文件拷贝结束后,会将当前CHECKPOINT的LSN记为“CLONE FILE END LSN”。

**3、PAGE COPY:**拷贝“CLONE START LSN”和“CLONE FILE END LSN”之间的页,在拷贝之前,会对这些页进行排序-基于Tablespace ID和page ID,尽量避免拷贝过程中出现随机读写。同时,开启“Redo Archiving”特性。

“Redo Archiving”会在后台开启一个归档线程将Redo文件中的内容按Chunk拷贝到归档文件中。通常来说,归档线程的拷贝速度会快于Redo日志的生成速度。即使慢于,在写入新的Redo日志时,也会等待归档线程完成拷贝,不会出现还未拷贝的Redo日志被覆盖的情况。当所有修改的页拷贝完毕后,会获取实例的一致性位置点信息,此时的LSN记为“CLONE LSN”。

4、REDO COPY:拷贝归档文件中“CLONE FILE END LSN”与“CLONE LSN”之间的Redo日志。

**5、Done:**调用snapshot_end()销毁克隆对象。

六、Clone Plugin的限制

1、克隆期间,不允许执行DDL命令。同样,DDL会阻塞克隆命令的执行

2、Clone Plugin不会拷贝Donor的配置参数。

3、Clone Plugin不会拷贝Donor的二进制日志文件。

4、Clone Plugin只会拷贝InnoDB表的数据,对于其它存储引擎的表,只会拷贝表结构。

5、Donor实例中如果有表通过DATA DIRECTORY指定了绝对路径,在进行本地克隆时,会提示文件已存在。在进行远程克隆时,绝对路径必须存在且有可写权限。

6、不允许通过MySQL Router连接Donor实例。

7、执行CLONE INSTANCE操作时,指定的Donor端口不能为X Protocol端口。

除此之外,在进行远程克隆时,还会进行如下检查:

MySQL版本(包括小版本)必须一致,且支持Clone Plugin。

ERROR 3864 (HY000): Clone Donor MySQL version: 8.0.20 is different from Recipient MySQL version 8.0.19.复制代码

主机的操作系统和位数(32位,64位)必须一致。两者可根据version_compile_os,version_compile_machine参数获取。Recipient必须有足够的磁盘空间存储克隆数据。字符集(character_set_server),校验集(collation_server),character_set_filesystem必须一致。innodb_page_size必须一致。会检查innodb_data_file_path中ibdata的数量和大小。目前Clone Plugin(8.0.20)的实现,无论是Donor,还是Recipient,同一时间,只能执行一个克隆操作。后续会支持多个克隆操作并发执行。

ERROR 3634 (HY000): Too many concurrent clone operations. Maximum allowed - 1.复制代码

Recipient需要重启,所以其必须通过mysqld_safe或systemd等进行管理。如果是通过mysqld进行启动,实例关闭后,需要手动启动。

ERROR 3707 (HY000): Restart server failed (mysqld is not managed by supervisor process).复制代码

ACTIVE状态的Plugin必须一致。

七、Clone Plugin与XtraBackup的对比

1、在实现上,两者都有FILE COPY和REDO COPY阶段,但Clone Plugin比XtraBackup多了一个PAGE COPY,由此带来的好处是,Clone Plugin的恢复速度比XtraBackup更快。

2、XtraBackup没有Redo Archiving特性,有可能出现未拷贝的Redo日志被覆盖的情况。

3、GTID下建立复制,无需额外执行set global gtid_purged操作。

八、Clone Plugin的参数解析

clone_autotune_concurrency 是否自动调节克隆过程中并发线程数的数量,默认为ON,此时,最大线程数受clone_max_concurrency参数控制。若设置为OFF,则并发线程数的数量将是固定的,同clone_max_concurrency参数一致。该参数的默认值为16。clone_buffer_size 本地克隆时,中转缓冲区的大小,默认4M。缓冲区越大,备份速度越快,相应的,对磁盘IO的压力越大。clone_ddl_timeout 克隆操作需要获取备份锁(Backup Lock)。如果在执行CLONE命令时,有DDL在执行,则CLONE命令会被阻塞,等待获取备份锁(Waiting for backup lock)。等待的最大时长由clone_ddl_timeout参数决定,默认300(单位秒)。如果在这个时间内还没获取到锁,CLONE命令会失败,且提示“ERROR 1205 (HY000): Lock wait timeout exceeded; try restarting transaction”。

需要注意的是,如果在执行DDL时,有CLONE命令在执行,DDL同样会因获取不到备份锁被阻塞,只不过,DDL操作的等待时长由lock_wait_timeout参数决定,该参数的默认值为31536000s,即365天。

clone_enable_compression 远程克隆,在传输数据时,是否开启压缩。开启压缩能节省网络带宽,但相应的,会增加CPU消耗。clone_max_data_bandwidth 远程克隆时,可允许的最大数据拷贝速率(单位MiB/s)。默认为0,不限制。注意,这里限制的只是单个线程的拷贝速率,如果存在多个线程并行拷贝,实际最大拷贝速率=clone_max_data_bandwidth*线程数。clone_max_network_bandwidth 远程克隆时,可允许的最大网络传输速率(单位MiB/s)。默认为0,不限制。如果网络带宽存在瓶颈,可通过该参数进行限速。clone_valid_donor_list 设置Donor白名单,只能克隆白名单中指定的实例。clone_ssl_ca,clone_ssl_cert,clone_ssl_key SSL相关。

相关免费学习推荐:mysql视频教程

以上就是看看MySQL 8 新特性Clone Plugin的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/886888.html

赞 (0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
记账鸭更改月的起始日操作
上一篇 2025年11月28日 13:07:59
Java函数与方法执行效率的对比
下一篇 2025年11月28日 13:08:05

相关推荐

  • 文件上传测试在本地通过但在Jenkins上失败的解决方案

    文件上传测试在本地通过但在Jenkins上失败的解决方案文件上传测试在本地通过但在Jenkins上失败的解决方案文件上传测试在本地通过但在Jenkins上失败的解决方案文件上传测试在本地通过但在Jenkins上失败的解决方案

    文件上传测试在本地通过但在Jenkins上失败的解决方案 摘要:本文针对文件上传测试在本地运行成功,但在Jenkins服务器上运行失败的问题,提供了一种解决方案。通过分析Jenkins的工作目录结构,建议将上传文件放置在Jenkins工作区内的固定目录下,并强调了检查错误信息中文件名的重要性,以确保…

    2026年9月30日 • 用户投稿
    000
  • 百度智能云开源视觉理解模型 Qianfan-VL

    百度智能云开源视觉理解模型 Qianfan-VL百度智能云开源视觉理解模型 Qianfan-VL百度智能云开源视觉理解模型 Qianfan-VL百度智能云开源视觉理解模型 Qianfan-VL

    百度智能云千帆正式开源推出全新视觉理解模型——qianfan-vl。该模型系列涵盖3b、8b和70b三种参数规模,专为面向企业级多模态应用需求而设计,并在实际产业场景中进行了深度优化。 官方表示,Qianfan-VL不仅拥有强大的通用视觉理解能力,更针对OCR识别、教育等高频垂直应用场景进行了专项增…

    2026年9月30日 • 用户投稿
    000
  • 豆包AI怎样处理中文分词?NLP预处理关键技术

    豆包AI怎样处理中文分词?NLP预处理关键技术豆包AI怎样处理中文分词?NLP预处理关键技术豆包AI怎样处理中文分词?NLP预处理关键技术豆包AI怎样处理中文分词?NLP预处理关键技术

    中文分词的关键技术包括去除噪声、标准化处理、停用词过滤、词干提取与词形还原。首先,去除噪声是指清理html标签、特殊符号和广告内容等干扰信息;其次,标准化处理涉及统一大小写、全半角转换及数字归一化,以减少模型对形式变化的敏感;第三,停用词过滤用于移除“的”“了”“是”等高频低信息词汇,提高处理效率;…

    2026年9月30日 • 用户投稿
    000
  • 俄罗斯搜索引擎在线入口免登录 俄罗斯搜索引擎在线官方链接

    俄罗斯搜索引擎在线入口免登录 俄罗斯搜索引擎在线官方链接俄罗斯搜索引擎在线入口免登录 俄罗斯搜索引擎在线官方链接俄罗斯搜索引擎在线入口免登录 俄罗斯搜索引擎在线官方链接俄罗斯搜索引擎在线入口免登录 俄罗斯搜索引擎在线官方链接

    俄罗斯主要搜索引擎是Yandex,其官网为https://www.php.cn/link/1bc0eecbf9203e4e6aaf81a7ca635c62,市场份额领先,功能涵盖搜索、地图、邮件、云存储等,深度优化俄语及本地化服务,是该国最主流的网络入口。 1、立即进入“☞☞☞☞点击俄罗斯搜索引擎在…

    2026年9月30日 • 用户投稿
    000
  • 文件上传测试在本地通过但在 Jenkins 上失败的解决方案

    文件上传测试在本地通过但在 Jenkins 上失败的解决方案文件上传测试在本地通过但在 Jenkins 上失败的解决方案文件上传测试在本地通过但在 Jenkins 上失败的解决方案文件上传测试在本地通过但在 Jenkins 上失败的解决方案

    文件上传测试在本地开发环境运行正常,但在 Jenkins CI/CD 环境中失败,通常是由于文件路径问题导致的。本地环境和 Jenkins 环境的文件系统结构不同,导致测试代码中使用的文件路径在 Jenkins 上无效。 在 Jenkins 上运行测试时,Jenkins 会创建一个工作目录,并将代码…

    2026年9月30日 • 用户投稿
    000
  • AI Overviews怎么开启 各平台启用步骤指南

    AI Overviews怎么开启 各平台启用步骤指南AI Overviews怎么开启 各平台启用步骤指南AI Overviews怎么开启 各平台启用步骤指南AI Overviews怎么开启 各平台启用步骤指南

    要开启ai overviews,具体操作步骤因平台而异。1. 在google搜索中,可尝试加入测试计划、更改搜索设置、使用特定地区账号、更新浏览器并保持登录状态;2. 在microsoft edge中,进入设置开启copilot或相关ai功能,并利用“集锦”整理信息;3. 在移动端如google a…

    2026年9月30日 • 用户投稿
    200
  • MySQL如何压缩数据库 表空间压缩与备份压缩方案

    MySQL如何压缩数据库 表空间压缩与备份压缩方案MySQL如何压缩数据库 表空间压缩与备份压缩方案MySQL如何压缩数据库 表空间压缩与备份压缩方案MySQL如何压缩数据库 表空间压缩与备份压缩方案

    mysql数据库压缩需求评估需先明确数据类型与业务场景。1.文本数据压缩率高,图片、视频等二进制数据压缩效果差;2.频繁读写数据压缩可能影响性能,冷数据压缩收益更高;3.通过查询information_schema分析大表与低频更新表;4.使用监控工具评估压缩前后性能影响。表空间压缩方法包括:1.使…

    2026年9月30日 • 用户投稿
    200
  • sublime如何设置自动缩进规则 sublime代码缩进的个性化配置

    sublime如何设置自动缩进规则 sublime代码缩进的个性化配置sublime如何设置自动缩进规则 sublime代码缩进的个性化配置sublime如何设置自动缩进规则 sublime代码缩进的个性化配置sublime如何设置自动缩进规则 sublime代码缩进的个性化配置

    解决sublime text缩进混乱问题需关闭“detect_indentation”: false以防止自动检测干扰;2. 通过用户设置文件preferences.sublime-settings配置“tab_size”“translate_tabs_to_spaces”等参数统一全局缩进规则;3…

    2026年9月30日 • 用户投稿
    200
  • AI Overviews支持数据可视化吗 AI Overviews图表生成功能

    AI Overviews支持数据可视化吗 AI Overviews图表生成功能AI Overviews支持数据可视化吗 AI Overviews图表生成功能AI Overviews支持数据可视化吗 AI Overviews图表生成功能AI Overviews支持数据可视化吗 AI Overviews图表生成功能

    ai overviews不能直接生成图表,但能通过整合现有资源辅助理解数据。1. 它依赖已有网页中的图表而非自行绘制;2. 可根据问题分析需求并查找相关图表;3. 在回答中展示缩略图或引用来源,并结合上下文解释内容。若需生成图表,建议:①使用excel、google sheets等传统工具;②借助c…

    2026年9月30日 • 用户投稿
    300
  • Jenkins 上文件上传测试在本地通过但在 Jenkins 上失败的解决方案

    Jenkins 上文件上传测试在本地通过但在 Jenkins 上失败的解决方案Jenkins 上文件上传测试在本地通过但在 Jenkins 上失败的解决方案Jenkins 上文件上传测试在本地通过但在 Jenkins 上失败的解决方案Jenkins 上文件上传测试在本地通过但在 Jenkins 上失败的解决方案

    文件上传功能在 Web 应用测试中非常常见,但在持续集成环境(如 Jenkins)中,由于运行环境的差异,常常会出现本地测试通过,但在 Jenkins 上却失败的情况。本文将针对这一问题,提供一种有效的解决方案。 第一段引用上面的摘要: 本文针对 Jenkins 环境下文件上传测试失败的问题,通过分…

    2026年9月30日 • 用户投稿
    300
  • 使用反射在Java 17中修改final字段的值

    使用反射在Java 17中修改final字段的值使用反射在Java 17中修改final字段的值使用反射在Java 17中修改final字段的值使用反射在Java 17中修改final字段的值

    本文介绍了在Java 17中使用反射修改非静态final字段值的正确方法。由于Java版本更新带来的安全限制,传统的修改modifiers字段的方式已经失效。本文将提供一种基于VarHandle的解决方案,并详细说明所需的JVM启动参数,帮助开发者在必要时绕过这些限制。 在Java中,final关键…

    2026年9月30日 • 用户投稿
    200
  • 怎么用豆包AI帮我生成HTTP客户端代码 HTTP客户端代码的AI生成指南

    怎么用豆包AI帮我生成HTTP客户端代码 HTTP客户端代码的AI生成指南怎么用豆包AI帮我生成HTTP客户端代码 HTTP客户端代码的AI生成指南怎么用豆包AI帮我生成HTTP客户端代码 HTTP客户端代码的AI生成指南怎么用豆包AI帮我生成HTTP客户端代码 HTTP客户端代码的AI生成指南

    使用豆包ai生成http客户端代码的关键在于提供清晰具体的指令。1. 明确请求方式和目标url,例如指定get或post请求及对应地址;2. 提供查询参数、请求头及认证信息,如token或headers;3. 指定编程语言及框架,如python的requests、node.js的axios等;4. …

    2026年9月30日 • 用户投稿
    100
  • Sublime进行数据库索引优化分析_提升数据查询性能与响应速度

    Sublime进行数据库索引优化分析_提升数据查询性能与响应速度Sublime进行数据库索引优化分析_提升数据查询性能与响应速度Sublime进行数据库索引优化分析_提升数据查询性能与响应速度Sublime进行数据库索引优化分析_提升数据查询性能与响应速度

    使用sublime text辅助数据库索引优化分析,一、通过慢查询日志定位瓶颈,利用多行选择和正则表达式筛选耗时sql;二、结合执行计划判断索引使用情况,关注type和extra字段;三、检查表结构与索引定义,优化复合索引顺序及删除冗余索引。 在处理大量数据时,数据库的查询性能直接影响到系统的响应速…

    2026年9月30日 • 用户投稿
    100
  • 用samba将云主机做视频存储使用

    用samba将云主机做视频存储使用用samba将云主机做视频存储使用用samba将云主机做视频存储使用用samba将云主机做视频存储使用

    最近有同事询问,如果客户有几十tb的视频存储需求,应该使用哪种云计算产品来解决?通常,用户已经拥有本地视频存储服务器,但在面对本地存储的不可靠性和存储空间不足的问题时,通过云端存储来解决这些问题成为了重要的需求。 由于弹性文件服务NAS不支持外网访问,而对象存储的开发接口较为复杂,因此我们今天将通过…

    2026年9月30日 • 用户投稿
    300
  • 英伟达将逐步向 OpenAI 投资最多 1000 亿美元

    英伟达将逐步向 OpenAI 投资最多 1000 亿美元英伟达将逐步向 OpenAI 投资最多 1000 亿美元英伟达将逐步向 OpenAI 投资最多 1000 亿美元英伟达将逐步向 OpenAI 投资最多 1000 亿美元

    当地时间9月22日,OpenAI与英伟达签署了一份合作意向书,正式宣布将建立战略合作伙伴关系。 根据协议,英伟达计划逐步向OpenAI注资最高达1000亿美元,专项用于支持人工智能数据中心及其配套基础设施的建设。此次合作将部署至少10吉瓦的英伟达计算系统,以支撑OpenAI下一代AI基础设施的发展需…

    2026年9月30日 • 用户投稿
    200
  • Java中判断直角三角形:高效利用勾股定理无需修改原始数组

    Java中判断直角三角形:高效利用勾股定理无需修改原始数组Java中判断直角三角形:高效利用勾股定理无需修改原始数组Java中判断直角三角形:高效利用勾股定理无需修改原始数组Java中判断直角三角形:高效利用勾股定理无需修改原始数组

    本教程探讨如何在Java中判断一个三角形是否为直角三角形,尤其针对无法直接移除数组元素的情况。我们将介绍一种高效且无需修改原始边长数组的方法。通过识别最长边作为潜在斜边,并巧妙地遍历数组,累加其余两边平方和,最终与最长边平方进行比较,从而避免了复杂的数据结构操作,实现简洁准确的判断。 在几何学中,判…

    2026年9月30日 • 用户投稿
    300
  • VSCode 如何自定义终端的颜色主题 VSCode 终端颜色主题的自定义方法​

    要自定义vscode终端颜色主题,需修改settings.json文件。1. 打开设置界面,搜索terminal.integrated.profiles.[系统类型],进入settings.json编辑;2. 在对应shell配置中添加colorscheme属性指定主题,如”dracul…

    2026年9月30日
    100
  • 豆包AI编程功能介绍 豆包AI自动写代码步骤

    豆包AI编程功能介绍 豆包AI自动写代码步骤豆包AI编程功能介绍 豆包AI自动写代码步骤豆包AI编程功能介绍 豆包AI自动写代码步骤豆包AI编程功能介绍 豆包AI自动写代码步骤

    豆包的#%#$#%@%@%$#%$#%#%#$%@_4921c++0e2d1f6005abe1f9ec2e2041909编程功能具备代码生成、补全、注释添加、错误检查与修复建议等实用能力,支持多语言开发环境。1. 主要功能包括:根据自然语言生成代码、智能推荐下一行代码、自动生成注释、识别语法错误并提…

    2026年9月30日 • 用户投稿
    000
  • Spring Data JPA Projections: 高效查询与映射特定字段

    Spring Data JPA Projections: 高效查询与映射特定字段Spring Data JPA Projections: 高效查询与映射特定字段Spring Data JPA Projections: 高效查询与映射特定字段Spring Data JPA Projections: 高效查询与映射特定字段

    本文深入探讨了Spring Data JPA中如何高效地从数据库中选择特定字段并将其映射到自定义结构。针对直接使用@Query查询部分字段导致ConversionFailedException的问题,文章详细介绍了Spring Data JPA Projections(投影)机制,包括接口式投影的定…

    2026年9月30日 • 用户投稿
    100
  • Sublime如何创建个人插件工具|扩展功能满足个性化需求

    Sublime如何创建个人插件工具|扩展功能满足个性化需求Sublime如何创建个人插件工具|扩展功能满足个性化需求Sublime如何创建个人插件工具|扩展功能满足个性化需求Sublime如何创建个人插件工具|扩展功能满足个性化需求

    创建sublime插件需四步:一、在packages目录新建文件夹及.py文件;二、编写helloworldcommand类插入文本;三、通过key bindings或main.sublime-menu绑定快捷键或右键菜单;四、扩展功能如自动补全、格式化文本。示例代码实现选中内容加引号功能,提升效率…

    2026年9月30日 • 用户投稿
    000

发表回复

登录后才能评论
关注微信