我希望从 pg_dump 转移到 WAL 备份。但是我对 4.3 文档中的这个注释感到困惑:
使用任何方便的文件系统备份工具(例如 tar 或 cpio)执行备份。
在 postgres 9.0 文档中:
使用任何方便的文件系统备份工具执行备份,例如 tar 或 cpio (不是 pg_dump 或 pg_dumpall)。
所以我不允许运行 pg_dump?或者它不允许仅用于 9.x ?文件系统转储对我来说没用,因为我需要在 32 位上恢复 64 位机器转储。而且我需要能够恢复单独的数据库。
如果 pg_dump 被禁止,是我设置从属复制并在从属上运行 pg_dump 的唯一解决方案吗?
我对 MySQL 和 MongoDB(都在服务器上运行良好)有一些(尽管有限)的经验,但在使用 Postgres 时遇到了问题,并且发现文档对于像我这样的新手来说缺乏。
Postgres 已安装并正在运行。但我无法从客户端连接。
pg_hba.conf 看起来像这样(我添加了最后一行):
# TYPE DATABASE USER CIDR-ADDRESS METHOD
# "local" is for Unix domain socket connections only
local all all trust
# IPv4 local connections:
host all all 127.0.0.1/32 trust
# IPv6 local connections:
host all all ::1/128 trust
## Added by me
host all all 10.0.1.201/32 trust
Run Code Online (Sandbox Code Playgroud)
现在,如果我去客户端10.0.1.201并尝试psql -h server.domain.com我得到一个错误:
psql: could not connect to server: Connection refused
Is the server running on host "server.domain.com" (10.0.1.38) and …Run Code Online (Sandbox Code Playgroud) 我在 Postgres 中有一个小型数据库,大约有 10,000 条记录存储公司客户。
我有一个执行非常频繁的“缓慢”执行查询(大约半秒),我的老板希望我改进它。
首先 - 我的代码:
select customer_alias.id, customer_alias.name, site.address, phone.phonenumber
from customer_alias
join customer on customer_alias.customer_id = customer.id
left join site on customer.default_site_id = site.id
left join contact_phonenumbers as phone on site.default_phonenumber = phone.id
Run Code Online (Sandbox Code Playgroud)
(编辑left join customer为join customer)
让我突然customer想到的是,即使我没有从该记录中选择任何内容,我也正在执行连接。我目前必须加入它才能获得表default_site_id的外键site。
每个客户可以有多个站点,但此列表中只能显示一个站点(必须打开一个客户才能查看所有站点)。所以我的问题是,如果我无法优化查询,是否有不同的方式可以为特定客户存储默认站点?默认电话号码也是如此
一个客户可以有多个站点,但一个站点只有一个客户(多对一)。
EXPLAIN 返回:
Hash Join (cost=522.72..943.76 rows=5018 width=53)
Hash Cond: (customer.id = customer_alias.customer_id)
-> Hash Right Join (cost=371.81..698.77 rows=5018 width=32)
Hash Cond: (site.id = customer.default_site_id) …Run Code Online (Sandbox Code Playgroud) 我不是数据库设计师,所以我在设计带有 GIS 信息的数据库时遇到了麻烦。目标是创建一个包含大陆、国家、地区(包括州、子地区、省)、城市和城市中的地方的系统。这些元素中的每一个都将包含一些文本信息和相关内容。作为数据库,我们将使用 PostgreSQL 和 PostGIS。
我的问题是,我如何为这个系统设计数据库?我在考虑 2 个表polygons和points,但我不确定这是否是好的思考方式。
实际上我们需要的是一些国家、城市、地区等之间关系的分层基础。该应用程序的主要目标是从许多来源收集关于特定城市、地区、国家等的旅游数据,并将其存储在数据库中。假设我们有一个城市罗马;我们从几个来源收集了一些关于这个城市的信息到数据库中。我们需要知道罗马位于罗马省,拉齐奥地区拉齐奥的次地区拉齐奥,国家意大利。所以系统应该是灵活的,允许我们从现实世界中创建这样的关系。
这就是为什么我会选择两个表:
polygons - 可以存储国家、地区、子地区、省份等。points - 可以存储城市和兴趣点假设我有四个表:
TABLE: players
COLUMNS: id, first_name, last_name
TABLE: passing_stats
COLUMNS: id, year, passing_yards (several other passing columns)
TABLE: rushing_stats
COLUMNS: id, year, rushing_yards (several other rushing columns)
TABLE: receiving_stats
COLUMNS: id, year, receiving_yards (several other receiving columns)
Run Code Online (Sandbox Code Playgroud)
假设 Michael Vick 的 id 为 100。我想得到他的全名和他每年的所有统计数据(传球、冲球和接球)。
我不想要任何重复,这意味着 2011 年的快速统计数据应该与 2011 年的传递统计数据出现在同一行。
编写此查询的最优雅方式是什么?谢谢。
我有一个intervals表,用于存储变量的start日期和end日期variable_id(四列:)id, start, end, variable_id。
客户端计算一个变量的新间隔并将它们存储在该表中。为了保持一致性(对于variable_id我不想间隔重叠),客户端首先检查(select),我们有什么样的时间间隔,然后insert,delete和/或update相应的(或者什么都不做)。
如果两个客户同时这样做,当然会有我插入重叠间隔的风险,这是我不想要的。
其实我的问题很简单:我该怎么办?
似乎 aSELECT .. FOR UPDATE不起作用,因为这会锁定现有的行,这对我来说还不够,因为可能会插入行。我宁愿需要“ SELECT * FROM intervals WHERE variable_id = 1234”的结果在某种程度上是“安全的”。
我已经实现了一个使用SERIALIZABLE事务的解决方案。结果是,如果两个客户端输入这个 select/update-delete-insert 事务,一个将失败(could not serialize access due to read/write dependencies among transactions或could not serialize access due to concurrent update),在这种情况下,我只需要再次运行我的 select/update-delete-insert 逻辑以尝试插入更合适的间隔.
这里的问题是serializable事务似乎锁定了整个表。但是如果一个客户端想要更新变量1234的间隔,而另一个客户端想要更新变量4321的,应该没有问题,两个事务应该能够愉快地运行。
我不是 SQL 专家,甚至无法确定这是一个简单的经典 sql 问题还是一个难题。 …
我需要旋转(使用 DROP 和 CREATE)一个被其他客户端大量使用的表。
目前,我有一个程序可以替换(DROP + CREATE)这个表。
有时,就在表被替换后,我从访问表的并发客户端收到“错误:无法打开与 OID xyz 的关系”。
可以说这种行为打破了事务隔离......是吗?
我知道这是由 postgres 后端缓存的系统目录引起的(这通常是一件好事)。我是对的吗?
有什么方法可以强制后端“忘记”表 OID(DISCARD没有帮助)?
我知道如果我切换到“DELETE and INSERT”模式而不是“DROP and CREATE”模式会有所帮助。但这是一些遗留程序,除非绝对需要,否则我们不想更改它。
对于如何摆脱这个问题的任何建议,我将不胜感激。
目标是为其他客户端透明地旋转表格。
这是我将问题简化为的最小测试用例:
A. 这是客户端(多个客户端将并行运行此 SELECT)。我们将使用pgbench来强调数据库。
$ echo "SELECT num FROM x;" > pgbench.minimal.sql
Run Code Online (Sandbox Code Playgroud)
B. 这是“旋转器”。
$ cat > rotate.x.sql <<EOF
BEGIN;
DROP TABLE x;
CREATE TABLE x ( num integer );
COMMIT;
EOF
Run Code Online (Sandbox Code Playgroud)
C.创建空数据库和表x。
$ createdb dev
$ psql dev -c "CREATE TABLE x ( num integer )"
Run Code Online (Sandbox Code Playgroud)
D. 启动 30 …
我有一些运行 Oracle 10 和 11 的测试数据库,我计划尝试迁移到 PostgreSQL。
一些谷歌搜索暗示 perl 脚本“ora2pg”可能有用,而且是免费的。然而,现在我花了太多时间试图让它在我的 winx64 机器上运行,因为 MinGw 不会编译它并且 activeperl 模块讨厌我。
是否有其他值得一看的免费工具,或者我应该启动并运行 Linuxbox 并以这种方式尝试 ora2pg?
问候
我有一个相当大的 PostgreSQL 9.1.3 在 Ubuntu 10.04 上运行。数据分布在多个表空间 = 物理驱动器上。
这些驱动器之一已经消失,因此该表空间的目录不再存在。例如:我丢失了“pg_tblspc/176967555”中的符号链接链接到的目录。
好。状态:重新启动后,该 DBMS 没有出现错误。虽然无法访问该特定数据库
psql: 致命: 无法打开文件 pg_tblspc/176967555/
我试图简单地将这些文件夹创建为空,但是 PG 想要该目录中的一个PG_VERSION和pg_filenode.map文件,我不能简单地创建它。
受影响数据库中 90% 的数据存储在其他正常的表空间中。但是我无法访问数据库中的任何表,因为有些表存储在现已消失的表空间中。
我的目标是从未受影响的表空间读取数据。如果 postgres 只是删除位于该表空间上的任何内容,那就没问题了。
我从丢失的表空间目录中恢复了大部分文件(例如 pg_tblspc/176967555/)。当我将恢复的文件夹放回原位时,PG 在访问该数据库时仍然抱怨丢失的文件 - 一个我无法恢复的文件。
可以使用zero_damaged_pages =true启动 DBMS帮助忽略丢失的文件吗?如果zero_damaged_pages打算用于 ''missing file'' szenario?编辑:不走运 - 它仍然会抱怨丢失的文件:
set zero_damaged_pages = true;
SET
postgres=# \connect problemdb ;
FATAL: could not open file "pg_tblspc/176967555/PG_9.1_201105231/123304298/135285149": No such file or directory
Run Code Online (Sandbox Code Playgroud)
我有哪些选择?
我应该继续尝试使用损坏的表空间恢复数据库吗?这个讨论似乎提供了一些关于如何在单个文件丢失时恢复的技巧。我可以用 dd 以某种方式创建这些文件吗? …
就在最近,我从 Postgresql 8.4.11 升级到 9.1.3。我在这个过程中使用了 pg_dump。现在我收到一个错误:
错误:没有为可排序类型 citext 的列“vin”派生排序规则
提示:使用 COLLATE 子句显式设置排序规则。
这是我之前遇到的问题的延续。发行说明中建议的修复似乎没有捕获自定义域。似乎8.4 中的CREATE DOMAIN语句甚至不支持该COLLATE子句。
这就是我创建vin类型的方式,
CREATE DOMAIN inventory.valid_vin AS citext
CHECK ( inventory.valid_vin( VALUE ) );
Run Code Online (Sandbox Code Playgroud) postgresql ×10
alter-table ×1
citext ×1
collation ×1
concurrency ×1
explain ×1
mac-os-x ×1
migration ×1
mysql ×1
oracle ×1
partitioning ×1
performance ×1
pgadmin ×1
recovery ×1
spatial ×1
transaction ×1