19.8. 错误报告和日志 #
19.8.1. 日志记录到哪里 #
log_destination(string) #PostgreSQL 支持多种记录服务器消息的方法,包括 stderr,csvlog,jsonlog 和 syslog。在 Windows 上,eventlog 也受支持。将此参数设置为以逗号分隔的所需日志目的地列表。默认情况下仅记录到 stderr。此参数只能在
postgresql.conf文件或服务器命令行中设置。如果 csvlog 被包括在
log_destination中,日志项会以“逗号分隔值”(CSV)格式被输出,这样可以很方便地把日志载入到程序中。详见第 19.8.4 节。要产生 CSV 格式的日志输出,必须启用 logging_collector。如果 jsonlog 包含在
log_destination中,日志条目将以 JSON 格式输出,这对将日志加载到程序中很方便。有关详细信息,请参见第 19.8.5 节。必须启用 logging_collector 才能生成 JSON 格式的日志输出。当包含 stderr、csvlog 或 jsonlog 时,文件
current_logfiles会被创建,记录日志收集器当前使用的日志文件位置和相关的日志目的地。这提供了一种方便的方式来查找实例当前使用的日志。以下是该文件内容的示例:stderr log/postgresql.log csvlog log/postgresql.csv jsonlog log/postgresql.json
当由于轮换而创建新的日志文件时,以及重新加载
log_destination时,current_logfiles会被重新创建。当log_destination中不包含 stderr、csvlog 或 jsonlog,或者日志收集器被禁用时,它会被移除。注意
在大多数 Unix 系统上,你将需要修改系统的 syslog 守护进程的配置来使用
log_destination的 syslog 选项。PostgreSQL 可以在 syslog 设施LOCAL0到LOCAL7中记录(见 syslog_facility),但是大部分平台上的默认 syslog 配置会丢弃所有这种消息。你需要在 syslog 守护进程的配置文件中增加类似以下的内容,使其生效:local0.* /var/log/postgresql
在 Windows 上,当你使用
log_destination的eventlog选项时,你应该在操作系统中注册一个事件源及其库,这样 Windows 事件查看器能够清楚地显示事件日志消息。详见第 18.12 节。logging_collector(boolean) #这个参数启用日志收集器,它是一个捕捉被发送到 stderr 的日志消息的后台进程,并且它会将这些消息重定向到日志文件中。这种方法比记录到 syslog 通常更有用,因为某些类型的消息可能不会在 syslog 输出中出现(一个常见的示例是动态链接器错误消息;另一个示例是由
archive_command等脚本产生的错误消息)。这个参数只能在服务器启动时设置。注意
也可以不使用日志收集器而把日志记录到 stderr,日志消息将只会去到服务器的 stderr 被定向到的位置。不过,那种方法只适合于低日志量,因为它没有提供便捷的方法来轮转日志文件。还有,在某些平台上,不使用日志收集器可能会导致日志输出丢失或混杂,因为多个进程并发写入同一个日志文件时会覆盖彼此的输出。
注意
日志收集器的设计目标是避免丢弃消息。这意味着在极高的负载下,如果服务器进程试图在收集器已经落后时发送更多的日志消息,那么它可能会被阻塞。相反,syslog 倾向于在无法写入消息时丢掉消息,这意味着在这样的情况下它可能会无法记录某些消息,但是它不会阻塞系统的其他部分。
日志收集器不保证日志消息已经写入持久化存储。系统崩溃、断电或写入日志文件时出错,仍可能导致消息丢失。
log_directory(string) #当
logging_collector被启用时,这个参数决定日志文件将被在哪个目录下创建。它可以被指定为一个绝对路径,也可以被指定为一个相对于集簇数据目录的相对路径。这个参数只能在postgresql.conf文件中或在服务器命令行上设置。默认是log。log_filename(string) #当
logging_collector被启用时,这个参数设置被创建的日志文件的文件名。该值被视为一种strftime模式,因此%转义可以被用来指定根据时间变化的文件名(注意如果有任何依赖时区的%转义,计算将在由 log_timezone 指定的时区中完成)。被支持的%转义和 Open Group 的 strftime 规范中列举的类似。注意系统的strftime不会被直接使用,因此平台相关(非标准)的扩展无法工作。默认是postgresql-%Y-%m-%d_%H%M%S.log。如果你不使用转义来指定一个文件名,你应该计划使用一个日志轮转工具来避免最终填满整个磁盘。在 8.4 发行之前,如果不存在
%转义,PostgreSQL 将追加新日志文件创建时的纪元时间戳,但是现在已经不再这样做了。如果在
log_destination中启用了 CSV 格式输出,.csv将会被追加到时间戳日志文件名中来创建 CSV 格式输出(如果log_filename以.log结尾,该后缀会被替换)。如果在
log_destination中启用了 JSON 格式的输出,时间戳日志文件名将会在末尾添加.json,以创建 JSON 格式输出的文件名。(如果log_filename以.log结尾,则会替换掉这个后缀。)这个参数只能在
postgresql.conf文件中或通过服务器命令行进行设置。log_file_mode(integer) #在 Unix 系统上,当
logging_collector被启用时,这个参数设置日志文件的权限(在微软 Windows 上这个参数将被忽略)。这个参数值应当是一个数字形式的模式,它可以被chmod和umask系统调用接受(要使用通常的八进制格式,该数字必须以一个0(零)开始)。默认的权限是
0600,表示只有服务器拥有者才能读取或写入日志文件。其他常用的设置是0640,它允许拥有者的组成员读取文件。不过要注意你需要修改 log_directory 为将文件存储在集簇数据目录之外的某个位置,才能利用这个设置。在任何情况下,让日志文件变成任何人都可读是不明智的,因为日志文件中可能包含敏感数据。这个参数只能在
postgresql.conf文件中或通过服务器命令行进行设置。log_rotation_age(integer) #当
logging_collector被启用时,这个参数决定单个日志文件使用的最长时间,超过后创建一个新的日志文件。如果指定值时没有单位,则以分钟为单位。默认为 24 小时。将这个参数设置为零将禁用基于时间的新日志文件创建。这个参数只能在postgresql.conf文件中或在服务器命令行上设置。log_rotation_size(integer) #当
logging_collector被启用时,这个参数决定单个日志文件的最大尺寸。当发送到一个日志文件的数据量达到该值后,将创建一个新的日志文件。如果指定值的时候没有单位,则以千字节为单位。默认值是 10 兆字节。设置为零时将禁用基于大小创建新的日志文件。这个参数只能在postgresql.conf文件中或在服务器命令行上设置。log_truncate_on_rotation(boolean) #当
logging_collector被启用时,这个参数将导致 PostgreSQL 截断(覆盖而不是追加)任何已有的同名日志文件。不过,截断只在一个新文件由于基于时间的轮转被打开时发生,在服务器启动或基于尺寸的轮转时不会发生。如果被关闭,在所有情况下以前存在的文件将被追加。例如,使用这个设置和一个类似postgresql-%H.log的log_filename将导致产生 24 个每小时的日志文件,并且循环地覆盖它们。这个参数只能在postgresql.conf文件中或在服务器命令行上设置。示例:保留 7 天的日志,每天一个日志文件,命名为
server_log.Mon,server_log.Tue,等等,并自动用本周的日志覆盖上周的日志,将log_filename设置为server_log.%a,将log_truncate_on_rotation设置为on,将log_rotation_age设置为1440。示例:要保留 24 小时的日志,每个小时一个日志文件,如果日志文件尺寸超过 1GB,也会提前轮转。可以这样做:将
log_filename设置为server_log.%H%M、将log_truncate_on_rotation设置为on、将log_rotation_age设置为60并且将log_rotation_size设置为1000000。在log_filename中包含%M,可让按文件大小触发的轮转选用与整点初始文件名不同的新文件名。syslog_facility(enum) #当启用了向 syslog 记录时,这个参数决定要使用的 syslog“设施”。你可以在
LOCAL0、LOCAL1、LOCAL2、LOCAL3、LOCAL4、LOCAL5、LOCAL6、LOCAL7中选择,默认值是LOCAL0。还请参阅系统的 syslog 守护进程的文档。这个参数只能在postgresql.conf文件中或在服务器命令行上设置。syslog_ident(string) #当启用了向 syslog 记录时,这个参数决定用来标识 syslog 中的 PostgreSQL 消息的程序名。默认值是
postgres。这个参数只能在postgresql.conf文件中或在服务器命令行上设置。syslog_sequence_numbers(boolean) #当日志被记录到 syslog 并且这个设置为 on(默认)时,每一个消息会被加上一个增长的序号作为前缀(例如
[2])。这种行为避开了很多 syslog 实现默认采用的“--- 上一个消息重复 N 次 ---”形式。在现代 syslog 实现中,抑制重复消息是可以配置的(例如 rsyslog 中的$RepeatedMsgReduction),因此这个参数可能不是必需的。此外,如果你真的想抑制重复消息,你可以把这个参数设置为 off。这个参数只能在
postgresql.conf文件或者服务器命令行上设置。syslog_split_messages(boolean) #当启用把日志记录到 syslog 时,这个参数决定消息如何送达 syslog。当设置为 on(默认)时,消息会被分成行,并且长的行也会被划分以便能够放到 1024 字节中,这是传统 syslog 实现的一种典型尺寸限制。当设置为 off 时,PostgreSQL 服务器日志消息会被原样送达 syslog 服务,而处理可能的大体量消息的任务由 syslog 服务负责。
如果 syslog 最终被记录到一个文本文件中,那么两种设置的效果是一样的,但最好设置为 on,因为大部分 syslog 实现要么不能处理大型消息,要么需要做特殊的配置以处理大型消息。但是如果 syslog 最终写入到某种其他媒介,让消息保持逻辑上的完整性可能是必要的,也可能更有用。
这个参数只能在
postgresql.conf文件中或通过服务器命令行进行设置。event_source(string) #当启用了向事件日志记录时,这个参数决定用来标识日志中 PostgreSQL 消息的程序名。默认值是
PostgreSQL。这个参数只能在服务器启动时设置。
19.8.2. 什么时候记录日志 #
log_min_messages(string) #控制将哪些消息级别写入服务器日志。该值是一个逗号分隔的列表,其中包含零个或多个
条目,以及恰好一个必填的进程类型:级别条目,后者作为未列出的进程类型的默认级别。有效的进程类型列在下表中。级别archiverbgwriterslotsyncworkerwalsenderautovacuumcheckpointerstartupwalsummarizerbackendioworkersysloggerwalwriterbgworkerpostmasterwalreceiver有效的
level值为DEBUG5,DEBUG4,DEBUG3,DEBUG2,DEBUG1,INFO,NOTICE,WARNING,ERROR,LOG,FATAL和PANIC。每个级别包括其后的所有级别。级别越高,发送到日志的消息越少。默认值为WARNING,将该级别应用于所有进程类型。请注意,在 client_min_messages 中,LOG的排名不同。只有超级用户和具有适当SET权限的用户才能更改此设置。示例:要以
DEBUG1级别记录walsender和autovacuum的日志,并以ERROR级别记录其他所有进程的日志,可将log_min_messages设为error, walsender:debug1, autovacuum:debug1。log_min_error_statement(enum) #控制在服务器日志中记录哪些导致错误条件的 SQL 语句。对于达到指定严重级别或更高级别的消息,其日志条目中会包含当前 SQL 语句。有效值为
DEBUG5、DEBUG4、DEBUG3、DEBUG2、DEBUG1、INFO、NOTICE、WARNING、ERROR、LOG、FATAL和PANIC。默认值为ERROR,这意味着导致错误、日志消息、致命错误或紧急情况的语句将被记录。要有效地关闭记录失败的语句,将此参数设置为PANIC。只有超级用户和具有适当SET权限的用户才能更改此设置。log_min_duration_statement(integer) #记录每个已完成语句的持续时间,如果语句运行时间至少达到指定时间。例如,如果将其设置为
250ms,那么所有运行时间为 250ms 或更长的 SQL 语句将被记录。启用此参数可帮助跟踪应用程序中的未优化查询。如果未指定单位,则将其视为毫秒。将此值设置为零将打印所有语句持续时间。-1(默认值)禁用记录语句持续时间。只有超级用户和具有适当SET权限的用户才能更改此设置。这会覆盖 log_min_duration_sample,意味着持续时间超过此设置的查询不进行抽样,并且始终被记录。
对于使用扩展查询协议的客户端,Parse、Bind 和 Execute 步骤的持续时间将被独立记录。
注意
当把这个选项和 log_statement 一起使用时,已经被
log_statement记录的语句文本不会在持续时间日志消息中重复。如果你没有使用 syslog,我们推荐你使用 log_line_prefix 记录 PID 或会话 ID,这样你可以使用进程 ID 或会话 ID 把语句消息链接到后来的持续时间消息。log_min_duration_sample(integer) #允许对运行时间至少达到指定时间的已完成语句进行采样。这会产生与 log_min_duration_statement 相同类型的日志条目,但仅针对已执行语句的子集,采样率由 log_statement_sample_rate 控制。例如,如果将其设置为
100ms,那么运行时间达到 100ms 或更长的所有 SQL 语句都将被考虑进行采样。启用此参数在流量过高无法记录所有查询时很有帮助。如果未指定单位,则将其视为毫秒。将其设置为零会对所有语句持续时间进行采样。-1(默认值)禁用语句持续时间的采样。只有超级用户和具有适当SET权限的用户才能更改此设置。此设置的优先级低于
log_min_duration_statement,意味着持续时间超过log_min_duration_statement的语句不被采样,并且始终被记录。log_min_duration_statement的其他说明也适用于此设置。log_statement_sample_rate(floating point) #确定持续时间超过 log_min_duration_sample 的语句中,将被记录的语句比例。采样是随机的,例如
0.5表示任意给定语句被记录的统计概率为二分之一。默认值为1.0,表示记录所有采样的语句。将此设置为零将禁用采样语句持续时间记录,与将log_min_duration_sample设置为-1相同。只有超级用户和具有适当SET权限的用户才能更改此设置。log_transaction_sample_rate(floating point) #设置需要记录全部语句的事务比例,这些记录是在因其他原因记录的语句之外额外进行的。它适用于每个新事务,无论其语句的持续时间如何。采样是随机的,例如
0.1表示任何给定事务被记录的统计概率是十分之一。log_transaction_sample_rate可以帮助构建事务样本。默认值为0,表示不记录任何额外事务的语句。将其设置为1会记录所有事务的所有语句。只有超级用户和具有适当SET权限的用户才能更改此设置。注意
就像所有的语句-日志选项一样,这个选项可能会增加大量开销。
log_startup_progress_interval(integer) #设置启动进程在长时间运行的操作开始后,等待多久才记录第一条进度消息,以及此后该操作的进度消息之间的时间间隔。默认值为 10 秒。设置为
0会禁用该功能。如果未指定单位,则将其视为毫秒。此设置分别应用于每个操作。此参数只能在postgresql.conf文件或服务器命令行中设置。例如,如果同步数据目录需要 25 秒,然后重置不记录 WAL 的关系需要 8 秒,如果此设置的默认值为 10 秒,那么在数据目录同步进行了 10 秒后,将记录一条消息,再在进行了 20 秒后记录一条消息,但对于重置不记录 WAL 的关系不会记录任何消息。
表 19.2 解释了 PostgreSQL 所使用的消息严重级别。如果日志输出被发送到 syslog 或 Windows 的 eventlog,严重级别会按照表中所示进行转换。
表 19.2. 消息严重级别
| 严重性 | 用法 | syslog | eventlog |
|---|---|---|---|
DEBUG1 .. DEBUG5 | 为开发者提供逐级更加详细的信息。 | DEBUG | INFORMATION |
INFO | 提供用户隐式要求的信息,例如来自 VACUUM VERBOSE 的输出。 | INFO | INFORMATION |
NOTICE | 提供可能对用户有用的信息,例如长标识符截断提示。 | NOTICE | INFORMATION |
WARNING | 提供可能出现的问题的警告,例如在一个事务块外 COMMIT。 | NOTICE | WARNING |
ERROR | 报告一个导致当前命令中断的错误。 | WARNING | ERROR |
LOG | 报告管理员可能感兴趣的信息,例如检查点活动。 | INFO | INFORMATION |
FATAL | 报告一个导致当前会话中断的错误。 | ERR | ERROR |
PANIC | 报告一个导致所有数据库会话中断的错误。 | CRIT | ERROR |
19.8.3. 记录哪些内容 #
注意
你选择记录的内容可能会影响安全性;请参见第 24.3 节。
application_name(string) #application_name可以是任意小于NAMEDATALEN个字符(标准编译中是 64 个字符)的字符串。应用通常在连接服务器时设置此值。该名称将被显示在pg_stat_activity视图中并被包括在 CSV 日志项中。也可以通过 log_line_prefix 将其包括在普通日志项中。只有可打印 ASCII 字符能被使用在application_name之中。其他字符将被替换为 C 风格的十六进制转义序列。debug_print_raw_parse(boolean)debug_print_parse(boolean)debug_print_rewritten(boolean)debug_print_plan(boolean) #这些参数会启用多种调试输出。设置后,它们会为每个执行的查询打印生成的原始解析树、解析树、查询重写器输出或执行计划。这些消息以
LOG消息级别发出,因此默认会出现在服务器日志中,但不会发送给客户端。你可以通过调整 client_min_messages 和/或 log_min_messages 来改变这种情况。这些参数默认是关闭的。debug_pretty_print(boolean) #当被设置时,
debug_pretty_print会缩进由debug_print_raw_parse、debug_print_parse、debug_print_rewritten或debug_print_plan产生的输出。这将导致比关闭参数时使用的“紧凑”模式可读性更强但是更长的输出。它默认是打开的。log_autovacuum_min_duration(integer) #当自动清理执行的清理操作运行时间至少达到指定时间时,就会记录该操作。将此设置为零会记录所有由自动清理执行的清理操作。
-1会禁用记录由自动清理执行的清理操作。如果未指定单位,则将其视为毫秒。例如,如果将其设置为250ms,则所有运行时间为 250ms 或更长的自动清理都会被记录。此外,当此参数设置为任何非-1值时,如果由于冲突锁或关系被并发删除而跳过自动清理执行的清理操作,则会记录一条消息。默认值为10min。启用此参数有助于跟踪自动清理的清理活动。此参数只能在postgresql.conf文件或服务器命令行中设置;但可以通过更改表存储参数来覆盖对单个表的设置。log_autoanalyze_min_duration(integer) #当自动清理执行的分析操作运行时间至少达到指定时间时,就会记录该操作。将此设置为零会记录所有由自动清理执行的分析操作。
-1会禁用记录由自动清理执行的分析操作。如果未指定单位,则将其视为毫秒。例如,如果将其设置为250ms,则所有运行时间为 250ms 或更长的自动分析都会被记录。此外,当此参数设置为任何非-1值时,如果由于冲突锁或关系被并发删除而跳过自动清理执行的分析操作,则会记录一条消息。默认值为10min。启用此参数有助于跟踪自动清理的分析活动。此参数只能在postgresql.conf文件或服务器命令行中设置;但可以通过更改表存储参数来覆盖对单个表的设置。log_checkpoints(boolean) #导致检查点和重启点在服务器日志中记录。日志消息中包括一些统计信息,包括写入的缓冲区数量和写入它们所花费的时间。此参数只能在
postgresql.conf文件或服务器命令行中设置。默认值为开启。log_connections(string) #控制是否记录到服务器的每次连接的相关信息。默认值为空字符串
'',表示禁用所有连接日志。下列选项既可以单独指定,也可以用逗号分隔的列表指定:表 19.3. 连接日志选项
名字 描述 receipt记录收到连接。 authentication记录认证方法用于识别用户的原始身份。在大多数情况下,该身份字符串与 PostgreSQL 用户名一致,但某些第三方认证方法可能会在服务器存储之前修改原始用户标识符。无论此设置为何值,认证失败始终都会被记录。 authorization记录授权成功完成。此时连接已经建立,但后端尚未完全初始化。日志消息会包含授权后的用户名,以及数据库名和应用名(如果适用)。 setup_durations记录从 postmaster 接受传入连接开始,到连接准备好执行第一条查询为止,建立连接并完成后端初始化所花费的时间。日志消息会包含三个时长:总设置时长、fork 新后端所花费的时间,以及用户认证所花费的时间。 all一个便捷别名,相当于指定所有选项。如果在其他选项列表中包含 all,则会记录连接的所有方面。断开连接的日志由 log_disconnections 单独控制。
出于向后兼容性考虑,
on、off、true、false、yes、no、1和0仍然受支持。表示启用的值等价于指定receipt、authentication和authorization选项。只有超级用户和具有适当
SET权限的用户可以在会话开始时更改此参数,并且在会话内部完全不能更改。注意
某些客户端程序(例如 psql)在判断是否需要密码时会尝试连接两次,因此重复的“收到连接”消息并不一定表示一个错误。
log_disconnections(boolean) #导致会话终止被记录。日志输出提供类似于
log_connections的信息,以及会话的持续时间。只有超级用户和具有适当SET权限的用户可以在会话开始时更改此参数,而且在会话中根本无法更改。默认值为off。log_duration(boolean) #记录每个已完成语句的持续时间。默认值为
off。只有超级用户和具有适当SET权限的用户才能更改此设置。对于使用扩展查询协议的客户端,Parse、Bind 和 Execute 步骤的持续时间将被独立记录。
注意
启用
log_duration和设置 log_min_duration_statement 为零之间的区别是,超过log_min_duration_statement指定的时长会强制记录查询文本,而这个选项不会。因此,如果log_duration为on并且log_min_duration_statement为正值,所有持续时间都将被记录,但是只有超过阈值的语句才会被记录查询文本。这种行为有助于在高负载安装中收集统计信息。log_error_verbosity(enum) #控制在服务器日志中记录的每条消息的详细程度。有效值为
TERSE,DEFAULT和VERBOSE,它们依次在显示的消息中增加更多字段。TERSE不包括DETAIL,HINT,QUERY和CONTEXT错误信息的记录。VERBOSE输出包括SQLSTATE错误代码(另请参见附录 A)以及生成错误的源代码文件名、函数名和行号。只有超级用户和具有适当SET权限的用户才能更改此设置。log_hostname(boolean) #默认情况下,连接日志消息只显示连接主机的 IP 地址。打开这个参数将导致也记录主机名。注意根据你的主机名解析设置,这可能会导致不可忽视的性能开销。这个参数只能在
postgresql.conf文件中或在服务器命令行上设置。log_line_prefix(string) #这是一个
printf风格的字符串,它在每个日志行的开头输出。%字符开始“转义序列”,它将按下文描述被替换为状态信息。未识别的转义被忽略。其他字符被直接复制到日志行。某些转义只被会话进程识别并且被主服务器进程等后台进程当作空。通过指定一个在% 之后和该选项之前的数字可以让状态信息左对齐或右对齐。负值将导致在右边用空格填充状态信息以达到最小宽度,而正值则在左边填充。填充对于日志文件的人类可读性大有帮助。这个参数只能在
postgresql.conf文件中或在服务器命令行上设置。默认值是'%m [%p] ',它记录时间戳和进程 ID。转义 效果 只限会话 %a应用名 是 %u用户名 是 %d数据库名 是 %r远程主机名或 IP 地址,以及远程端口 是 %h远程主机名或 IP 地址 是 %L本地地址(客户端所连接的服务器 IP 地址) 是 %b后端类型 否 %p进程 ID 否 %P如果该进程是并行查询工作进程,则为并行组领导者的进程 ID 否 %t无毫秒的时间戳 否 %m带毫秒的时间戳 否 %n带毫秒精度的 Unix 时间戳 否 %i命令标签:会话当前命令的类型 是 %eSQLSTATE 错误代码 否 %c会话 ID:见下文 否 %l对每个会话或进程的日志行号,从 1 开始 否 %s进程开始的时间戳 否 %v虚拟事务 ID(procNumber/localXID);参见第 67.1 节 否 %x事务 ID(如果未分配则为 0);参见第 67.1 节 否 %q不产生输出,但是告诉非会话进程在字符串的这一点停止;会话进程忽略 否 %Q当前查询的查询标识符。查询标识符默认是不计算的,所以该字段将为零,除非 compute_query_id 参数被激活或者配置了计算查询标识符的第三方模块 是 %%字面字符 %否 后端类型对应视图
pg_stat_activity中的backend_type列。但是其他类型可能会出现在日志中而不显示在该视图中。%c转义打印一个准唯一的会话标识符,它由两个 4 字节的十六进制数(不带先导零)组成,以点号分隔。这些数字是进程启动时间和进程 ID,因此%c也可以用来节省空间地输出这两项信息。例如,要从pg_stat_activity生成会话标识符,使用这个查询:SELECT to_hex(trunc(EXTRACT(EPOCH FROM backend_start))::integer) || '.' || to_hex(pid) FROM pg_stat_activity;提示
如果你为
log_line_prefix设置了非空值,你通常应该让它的最后一个字符为空格,这样可与日志行的其余部分在视觉上区分开。也可以使用标点符号。提示
Syslog 产生自己的时间戳和进程 ID 信息,因此如果你记录到 syslog 你可能不希望包括那些转义。
提示
在包括仅在会话(后端)上下文中可用的信息(如用户名或者数据库名)时,
%q转义很有用。例如:log_line_prefix = '%m [%p] %q%u@%d/%a '
注意
对于 log_statement 输出的行,
%Q总是报告零标识符,因为log_statement在标识符能被计算之前生成输出,也包括无法计算标识符的无效语句。log_lock_waits(boolean) #控制会话为获取锁而等待的时间超过 deadlock_timeout 时是否生成日志消息。这对于确定锁等待是否导致性能不佳很有用。默认值为
on。只有超级用户和具有适当SET权限的用户才能更改此设置。log_lock_failures(boolean) #控制当获取锁失败时是否生成详细日志消息。这有助于分析锁失败的原因。目前,仅支持由于
SELECT NOWAIT导致的锁失败。默认值为off。只有超级用户和具有适当SET权限的用户才能更改此设置。log_recovery_conflict_waits(boolean) #控制启动进程因恢复冲突而等待超过
deadlock_timeout时是否产生日志消息。这有助于判断恢复冲突是否阻碍了恢复过程应用 WAL。默认为
off。这个参数只能在postgresql.conf文件中或服务器命令行中设置。log_parameter_max_length(integer) #如果大于零,则记录在非错误语句日志消息中的每个绑定参数值都会被截断为指定的字节数。零表示禁用非错误语句日志中绑定参数的记录。
-1(默认值)允许完整记录绑定参数。如果未指定单位,则默认为字节。只有超级用户和具有适当SET权限的用户才能更改此设置。此设置仅影响由 log_statement、log_min_duration_statement 及相关设置产生的日志消息。此设置为非零值时会增加一些开销,特别是以二进制形式发送参数时,因为需要将参数转换为文本。
log_parameter_max_length_on_error(integer) #如果大于零,则错误消息中报告的每个绑定参数值都将裁剪为这么多字节。零(默认值)禁止在错误消息中包含绑定参数。
-1允许打印完整绑定参数。如果指定此值时没有单位,则以字节为单位。该设置的非零值会增加开销,由于 PostgreSQL 需要在每条语句的开始处将参数值的文本表示存储在内存中,无论最终是否会发生错误。当绑定参数以二进制形式发送时,开销比以文本形式发送时更大,因为前者需要数据转换,而后者只需要复制字符串。
log_statement(enum) #控制哪些 SQL 语句被记录。有效值是
none(off)、ddl、mod和all(所有语句)。ddl记录所有数据定义语句,例如CREATE、ALTER和DROP语句。mod记录所有ddl语句,外加INSERT、UPDATE、DELETE、TRUNCATE和COPY FROM等数据修改语句。如果PREPARE、EXECUTE和EXPLAIN ANALYZE包含合适类型的命令,它们也会被记录。对于使用扩展查询协议的客户端,当收到一个 Execute 消息时会产生日志并且会包括 Bind 参数的值(任何内嵌的单引号会被双写)。默认值为
none。只有超级用户和具有适当SET权限的用户才能更改此设置。注意
即使使用
log_statement=all设置,包含简单语法错误的语句也不会被记录。这是因为只有在完成基本语法解析并确定了语句类型之后才会发出日志消息。在扩展查询协议的情况下,在 Execute 阶段之前(即在解析分析或规划期间)出错的语句也不会被记录。将log_min_error_statement设置为ERROR(或更低)来记录这种语句。记录的语句可能会透露敏感数据,甚至包含明文密码。
log_replication_commands(boolean) #在服务器日志中记录每个复制命令,以及
walsender进程获取和释放复制槽的操作。有关复制命令的更多信息,请参见第 54.4 节。默认值为off。只有超级用户和具有适当SET权限的用户才能更改此设置。log_temp_files(integer) #控制临时文件名和大小的日志记录。临时文件可以用于排序、hash 和临时查询结果。如果通过此设置启用,每当删除临时文件时都会发出日志记录,其中文件大小以字节为单位。值为零时记录所有临时文件信息,而正值仅记录大小大于或等于指定数据量的文件。如果未指定单位,则将其视为千字节。默认设置为-1,禁用此类日志记录。只有超级用户和具有适当
SET权限的用户才能更改此设置。log_timezone(string) #设置在服务器日志中写入的时间戳的时区。和 TimeZone 不同,这个值是集簇范围的,因此所有会话将报告一致的时间戳。内置默认值是
GMT,但是通常会被在postgresql.conf中覆盖。initdb 将安装一个对应于其系统环境的设置。详见第 8.5.3 节。这个参数只能在postgresql.conf文件中或在服务器命令行上设置。
19.8.4. 使用 CSV 格式的日志输出 #
在 log_destination 列表中包括 csvlog 提供了一种便捷方式将日志文件导入到一个数据库表。这个选项发出逗号分隔值(CSV)格式的日志行,包括这些列:带毫秒的时间戳、用户名、数据库名、进程 ID、客户端主机:端口号、会话 ID、每个会话的行号、命令标签、会话开始时间、虚拟事务 ID、普通事务 ID、错误严重性、SQLSTATE 代码、错误消息、错误消息详情、提示、导致错误的内部查询(如果有)、错误位置所在的字符计数、错误上下文、导致错误的用户查询(如果有且被 log_min_error_statement 启用)、错误位置所在的字符计数、在 PostgreSQL 源代码中错误的位置(如果 log_error_verbosity 被设置为 verbose)、应用名、后端类型、并行组领导者的进程 ID 和查询 ID。下面是一个定义用来存储 CSV 格式日志输出的样表:
CREATE TABLE postgres_log ( log_time timestamp(3) with time zone, user_name text, database_name text, process_id integer, connection_from text, session_id text, session_line_num bigint, command_tag text, session_start_time timestamp with time zone, virtual_transaction_id text, transaction_id bigint, error_severity text, sql_state_code text, message text, detail text, hint text, internal_query text, internal_query_pos integer, context text, query text, query_pos integer, location text, application_name text, backend_type text, leader_pid integer, query_id bigint, PRIMARY KEY (session_id, session_line_num) );
使用 COPY FROM 命令将一个日志文件导入到这个表中:
COPY postgres_log FROM '/full/path/to/logfile.csv' WITH csv;
也可以作为外部表访问该文件,使用提供的 file_fdw 模块。
你可以做一些事情来简化导入 CSV 日志文件:
设置
log_filename和log_rotation_age,为日志文件提供一致且可预测的命名方案。这样就能预测文件名,并知道单个日志文件何时已完成写入、可以导入。将
log_rotation_size设置为 0 来禁用基于尺寸的日志轮转,因为它使得日志文件名难以预测。将
log_truncate_on_rotation设置为on,这样在同一个文件中旧日志数据不会与新数据混杂。上述表定义包括一个主键声明。这有助于避免意外地两次导入相同的信息。
COPY命令一次提交所有它导入的数据,因此任何错误将导致整个导入失败。如果你导入一个部分完成的日志文件并且稍后当它完全完成后再次导入,主键冲突将导致导入失败。请等到日志完成且被关闭之后再导入。这个过程也可以避免意外地导入部分完成的行,这种行也将导致COPY失败。
19.8.5. 使用 JSON 格式的日志输出 #
将 jsonlog 加入 log_destination 列表,可以方便地将日志文件导入多种不同的程序。此选项以 JSON 格式输出日志行。
值为空值的字符串字段不会输出。将来可能会添加其他字段。处理 jsonlog 输出的用户应用程序应忽略未知字段。
每个日志行都被序列化为一个 JSON 对象,其中包含一组键和它们对应的值,如表 19.4 中所示。
表 19.4. JSON 日志条目的键和值
| 键名 | 类型 | 描述 |
|---|---|---|
timestamp | string | 带毫秒的时间戳 |
user | string | 用户名 |
dbname | string | 数据库名称 |
pid | number | 进程 ID |
remote_host | string | 客户端主机 |
remote_port | number | 客户端端口 |
session_id | string | 会话 ID |
line_num | number | 每个会话的行号 |
ps | string | 当前 ps 显示 |
session_start | string | 会话开始时间 |
vxid | string | 虚拟事务 ID |
txid | string | 常规事务 ID |
error_severity | string | 错误严重性 |
state_code | string | SQLSTATE 代码 |
message | string | 错误消息 |
detail | string | 错误消息的详细信息 |
hint | string | 错误消息提示 |
internal_query | string | 导致错误的内部查询 |
internal_position | number | 内部查询的游标索引 |
context | string | 错误上下文 |
statement | string | 客户端提供的查询字符串 |
cursor_position | number | 查询字符串中的游标索引 |
func_name | string | 错误位置函数名称 |
file_name | string | 错误位置的文件名 |
file_line_num | number | 错误位置的文件行号 |
application_name | string | 客户端应用程序名称 |
backend_type | string | 后端类型 |
leader_pid | number | 活动并行工作者的领导者进程 ID |
query_id | number | 查询 ID |
19.8.6. 进程标题 #
这些设置控制服务器进程的进程标题如何修改。通常可以通过 ps 等程序查看进程标题,在 Windows 上则可以使用 Process Explorer。详情参见第 27.1 节。
cluster_name(string) #设置一个用于各种目的、标识此数据库集簇(实例)的名称。集簇名称会出现在此集簇所有服务器进程的进程标题中。此外,它还是备库连接的默认应用名称(参见 synchronous_standby_names)。
这个名称可以是长度少于
NAMEDATALEN个字符(在标准编译中是 64 字符)的任何字符串。只有可打印的 ASCII 字符能被用在cluster_name值中。其他字符将被替换为 C 风格的十六进制转义序列。如果这个参数被设置为空字符串''(也是默认值),将不会显示名称。这个参数只能在服务器启动时设置。update_process_title(boolean) #启用后,每次服务器接收到新的 SQL 命令时都会更新进程标题。在大多数平台上,默认情况下此设置为
on,但在 Windows 上默认为off,因为该平台更新进程标题的开销较大。只有超级用户和具有适当SET权限的用户才能更改此设置。