4.8. Импорт в Postgres Pro #
По умолчанию результаты преобразования в формат Postgres Pro выводятся в файл output.sql.
psql mydb < output.sql
Эта команда импортирует содержимое файла output.sql в БД Postgres Pro mydb.
DATA_LIMIT#При экспорте типа
INSERT/COPYora2pgpro ведёт обработку блоками поDATA_LIMITкортежей для увеличения скорости. Перед записью на диск кортежи хранятся в памяти, так что если необходимо увеличить скорость, то при наличии достаточных системных ресурсов можно увеличить этот предел, например, до 100000 или 1000000. Значение 0 означает, что используется размер блока по умолчанию: 10000.BLOB_LIMIT#Когда ora2pgpro обнаруживает таблицу с BLOB, значение
DATA_LIMITавтоматически уменьшается путём деления на 10 до тех пор, пока оно не станет меньше 1000. Можно отдельно указать директивуBLOB_LIMITдля экспорта BLOB, но обратите внимание, что экспорт BLOB задействует много ресурсов, поэтому большое значение может вызвать нехватку памяти.OUTPUT#Эта директива позволяет изменить выходной файл для ora2pgpro. Значение по умолчанию —
output.sql. Если задать имя файла с расширением.gzили.bz2, вывод будет сжат автоматически. При этом для файлов.gzтребуется установленный модуль PerlCompress::Zlib, а для.bz2— утилита командной строки bzip2.OUTPUT_DIR#В этой директиве можно задать каталог для записи файла. Указанный каталог должен существовать.
BZIP2#В этой директиве можно указать полный путь к утилите bzip2, если она не обнаружена в переменной окружения
PATH.FILE_PER_CONSTRAINT#Позволяет сохранять ограничения для объектов в отдельном файле во время экспорта схемы. Файл будет назван
CONSTRAINTS_OUTPUT, гдеOUTPUT— это значение соответствующей директивы. Для сжатия можно использовать расширение.gzили.bz2. По умолчанию все данные сохраняются в файле, указанном вOUTPUT. Эта директива используется только с типом экспортаTABLE.Ограничения можно быстро импортировать в Postgres Pro с типом экспорта
LOAD, чтобы создавать их параллельно, используя несколько соединений (-jилиJOBS).FILE_PER_INDEX#Позволяет сохранять индексы в отдельном файле во время экспорта схемы. Файл будет назван
INDEXES_OUTPUT, гдеOUTPUT— это значение соответствующей директивы. Для сжатия можно использовать расширение.gzили.bz2. По умолчанию все данные сохраняются в файле, указанном вOUTPUT. Эта директива используется только с типами экспортаTABLEиTABLESPACE. С типом экспортаTABLESPACEкомандыALTER INDEX ... TABLESPACE ...записываются в отдельный файлTBSP_INDEXES_OUTPUT, который можно загрузить в конце миграции после создания индексов для их перемещения.Индексы можно быстро импортировать в Postgres Pro с типом экспорта
LOAD, чтобы создавать их параллельно, используя несколько соединений (-jилиJOBS).FILE_PER_FKEYS#Позволяет сохранять объявления внешних ключей в отдельном файле во время экспорта схемы. По умолчанию внешние ключи экспортируются в основной выходной файл или
CONSTRAINT_output.sql. Если директива задана, внешние ключи экспортируются в файлFKEYS_output.sql.FILE_PER_TABLE#Позволяет сохранять результаты экспорта в отдельных файлах для каждой таблицы или представления. Файлы будут названы
tablename_OUTPUT, гдеOUTPUT— это значение соответствующей директивы. Для сжатия можно использовать расширение.gzили.bz2в директивеOUTPUT. С заданным значением 0 (по умолчанию) все данные сохраняются в одном файле, значение 1 включает эту функциональность. Используется только с типами экспортаINSERTилиCOPY.FILE_PER_FUNCTION#Позволяет сохранять функции, процедуры и триггеры в отдельных файлах для каждого объекта. Файлы будут названы
objectname_OUTPUT, гдеOUTPUT— это значение соответствующей директивы. Для сжатия можно использовать расширение.gzили.bz2в директивеOUTPUT. С заданным значением 0 (по умолчанию) все данные сохраняются в одном файле, значение 1 включает эту функциональность. Используется только с соответствующим типом экспорта, а для пакетов предусмотрено другое поведение.Если директива включена с типом экспорта
PACKAGE, ora2pgpro создаёт отдельный каталог для каждого пакета с именем, называя его по имени пакета в нижнем регистре, и создаёт отдельные файлы для каждой функции/процедуры в этом каталоге. Если директива отключена, создаётся отдельный файл для каждого пакета с именемpackagename_OUTPUT, гдеOUTPUT— это значение соответствующей директивы.TRUNCATE_TABLE#Если задано значение 1, перед загрузкой данных добавляется команда
TRUNCATE TABLE. Используется только с типами экспортаINSERTилиCOPY.Когда директива включена, команда добавляется, только если нет глобального предложения
DELETEили для текущей таблицы (см. ниже).DELETE#Включает поддержку фильтрации по предложению
DELETE FROM ... WHEREперед импортом данных с удалением строк вместо опустошения таблиц. Значение задаётся в таком формате:TABLE_NAME[DELETE_WHERE_CLAUSE], или если есть только одно предложениеWHEREдля всех таблиц, задаётся одно предложениеDELETEв качестве значения. Можно задавать оба варианта одновременно. Примеры:DELETE 1=1 # Применяется ко всем таблицам и удаляет все кортежи DELETE TABLE_TEST[ID1='001'] # Применяется только к таблице TABLE_TEST DELETE TABLE_TEST[ID1='001' OR ID1='002] DATE_CREATE > '2001-01-01' TABLE_INFO[NAME='test']
Последний вариант применяет два разных предложения
DELETE ... WHEREк таблицамTABLE_TESTиTABLE_INFOи общее предложениеDELETEпоDATE_CREATEко всем остальным таблицам. Если директиваTRUNCATE_TABLEвключена, она применяется ко всем таблицам, к которым не применяетсяDELETE. Такие предложенияDELETEмогут быть полезны при обычных изменениях.STOP_ON_ERROR#Задайте для директивы значение 0, чтобы исключить вызов
\set ON_ERROR_STOP ONиз всех SQL-скриптов, создаваемых ora2pgpro. По умолчанию эта команда всегда присутствует, чтобы скрипт немедленно завершал работу при ошибках.COPY_FREEZE#Включите эту директиву, чтобы использовать
COPY FREEZEвместо обычноCOPYдля экспорта данных с уже замороженными строками. Это позволяет увеличить производительность при начальном добавлении данных. Строки будут замораживаться, только если загружаемая таблица была создана или опустошена в текущей подтранзакции. Работает только для экспорта в файл, когда не заданы ни параметр-J, ни директиваORACLE_COPIESили они равны 1. Может использоваться для импорта в Postgres Pro напрямую при тех же условиях, но-jиJOBSдолжны быть не заданы или равны 1.CREATE_OR_REPLACE#По умолчанию ora2pgpro использует
CREATE OR REPLACEв функциях и представлениях. Если нет необходимости переопределять существующие функции или представления, отключите эту директиву, и команды не будут содержатьOR REPLACE.DROP_IF_EXISTS#Чтобы добавлять команду
DROPперед созданием объекта, включите эту директиву. Может быть полезно в итерационной работе. По умолчанию директива отключена.ОБЪЕКТIF EXISTSEXPORT_GTT#Postgres Pro не поддерживает глобальные временные таблицы, но для эмуляции этой функциональности можно использовать расширение pgtt. Включите эту директиву, чтобы экспортировать глобальные временные таблицы.
NO_HEADER#Если включить эту директиву, ora2pgpro не будет добавлять заголовок в выходные файлы, будет записываться только преобразованный код.
PSQL_RELATIVE_PATH#По умолчанию ora2pgpro использует команду psql
\i, чтобы выполнять создаваемые SQL-файлы. Если задать эту директиву, будет использоваться команда\ir, чтобы интерпретировать имена файлов относительно каталога, в котором расположен скрипт. За подробной информацией обратитесь к справке по psql.DATA_VALIDATION_ROWS#Число строк, которые необходимо получить с обеих сторон для проверки корректности данных. По умолчанию сравниваются первые 10000 строк. При значении 0 сравниваются все строки.
DATA_VALIDATION_ORDERING#После изменения данных порядок строк на обеих сторонах отличается. Директива включает упорядочивание данных по первичному ключу или уникальному индексу, так что данные таблицы без этих объектов сравнить невозможно. Если проверка корректности выполняется сразу после миграции, все таблицы могут быть проверены без упорядочивания.
DATA_VALIDATION_ERROR#Останавливает проверку данных таблицы после определённого количества несовпадающих строк. По умолчанию проверка останавливается после 10 строк с ошибками несовпадения.
TRANSFORM_VALUE#Используйте эту директиву, чтобы указать тип трансформации, применяемый к столбцам при экспорте данных, в виде списка значений, разделённых точкой с запятой:
TABLE[COLUMN_NAME,
код в целевом списке SELECT]Например, чтобы заменить строку «Oracle» на «PostgreSQL» в столбце типа
varchar2, используйте следующее значение:TRANSFORM_VALUE ERROR_LOG_SAMPLE[DBMS_TYPE:regexp_replace("DBMS_TYPE",'Oracle','PostgreSQL')]Чтобы заменить все значения типа
char(0)в строке пробельными символами:TRANSFORM_VALUE CLOB_TABLE[CHARDATA:translate("CHARDATA", chr(0), ' ')]Выражение будет применяться в операторе SQL, используемом для извлечения данных из исходной базы данных.
Если для выгрузки данных в файл задан тип экспорта INSERT или COPY и включена директива FILE_PER_TABLE, будет выдано предупреждение, что ora2pgpro не будет экспортировать данные, если файл уже существует, чтобы не допустить повторную загрузку огромных таблиц. Чтобы принудительно загружать данные из таких таблиц, необходимо сначала удалить существующий выходной файл.
Если необходимо импортировать данные в БД Postgres Pro "на лету", можно настроить подключение, используя нижеописанные директивы, но только для типа экспорта COPY или INSERT, поскольку для схемы БД это не нужно.
PG_DSN#Используйте эту директиву, чтобы задать пространство имён в качестве источника данных Postgres Pro, используя модуль Perl
DBD::Pgследующим образом:dbi:Pg:dbname=pgdb;host=localhost;port=5432
Он подключается к базе данных
pgdbнаlocalhostпо TCP-порту 5432.Обратите внимание, что эта директива используется только для экспорта данных, результаты других типов экспорта необходимо импортировать вручную с использованием psql или любого другого клиента Postgres Pro.
Чтобы использовать зашифрованное соединение SSL, необходимо добавить в строку подключения
sslmode=requireследующим образом:dbi:Pg:dbname=pgdb;host=localhost;port=5432;sslmode=require
PG_USERPG_PWD#Эти директивы используются, чтобы задать имя пользователя и пароль. Если не задать пароль в
PG_PWDи установить Perl-модульTerm::ReadKey, ora2pgpro запросит пароль интерактивно. Если имя пользователя не задано вPG_USER, его тоже нужно будет задать интерактивно.SYNCHRONOUS_COMMIT#Указывает, что записи WAL должны быть записаны на диск до того, как команда фиксации транзакции сообщит клиенту об успешном завершении. Функциональность равнозначна установке параметра
synchronous_commitв файлеpostgresql.conf. Используется только для загрузки данных в Postgres Pro напрямую, по умолчанию синхронная фиксация отключена для увеличения скорости записи данных.PG_INITIAL_COMMAND#Эту директиву можно использовать для отправки начальных команд в Postgres Pro сразу после подключения, например, чтобы установить параметры сеанса. Директиву можно задавать несколько раз.
4.8. Postgres Pro Import #
By default conversion to Postgres Pro format is written to file output.sql.
psql mydb < output.sql
This command will import content of the file output.sql into Postgres Pro mydb database.
DATA_LIMIT#When you are performing
INSERT/COPYexport, ora2pgpro proceeds by chunks ofDATA_LIMITtuples for speed improvement. Tuples are stored in memory before being written to disk, so if you want speed and have enough system resources you can raise this limit to an higher value for example: 100000 or 1000000. A value of 0 means that the chunk will be set to the default: 10000.BLOB_LIMIT#When ora2pgpro detects a table with some BLOB, it will automatically reduce the value of this directive by dividing it by 10 until its value is below 1000. You can control this value by setting
BLOB_LIMIT. Exporting BLOB use lot of resources, setting it to a too high value can produce OOM.OUTPUT#The ora2pgpro output filename can be changed with this directive. Default value is
output.sql. If you set the file name with extension.gzor.bz2, the output will be automatically compressed. This requires that theCompress::ZlibPerl module is installed if the filename extension is.gzand that the bzip2 system command is installed for the.bz2extension.OUTPUT_DIR#You can define a base directory where the file will be written. The directory must exist.
BZIP2#This directive allows you to specify the full path to the bzip2 program if it can not be found in the
PATHenvironment variable.FILE_PER_CONSTRAINT#Allow object constraints to be saved in a separate file during schema export. The file will be named
CONSTRAINTS_OUTPUT, whereOUTPUTis the value of the corresponding configuration directive. You can use.gzor.bz2extension to enable compression. Default is to save all data in theOUTPUTfile. This directive is usable only withTABLEexport type.The constraints can be imported quickly into Postgres Pro using the
LOADexport type to parallelize their creation over multiple (-jorJOBS) connections.FILE_PER_INDEX#Allow indexes to be saved in a separate file during schema export. The file will be named
INDEXES_OUTPUT, whereOUTPUTis the value of the corresponding configuration directive. You can use.gzor.bz2file extension to enable compression. Default is to save all data in theOUTPUTfile. This directive is usable only withTABLEANDTABLESPACEexport type. With theTABLESPACEexport, it is used to writeALTER INDEX ... TABLESPACE ...into a separate file namedTBSP_INDEXES_OUTPUTthat can be loaded at end of the migration after the indexes creation to move the indexes.The indexes can be imported quickly into Postgres Pro using the
LOADexport type to parallelize their creation over multiple (-jorJOBS) connections.FILE_PER_FKEYS#Allow foreign key declaration to be saved in a separate file during schema export. By default foreign keys are exported into the main output file or in the
CONSTRAINT_output.sqlfile. When enabled, foreign keys will be exported into a file namedFKEYS_output.sql.FILE_PER_TABLE#Allow data export to be saved in one file per table/view. The files will be named as
tablename_OUTPUT, whereOUTPUTis the value of the corresponding configuration directive. You can still use.gzor.bz2extension in theOUTPUTdirective to enable compression. Default 0 will save all data in one file, set it to 1 to enable this feature. This is usable only duringINSERTorCOPYexport type.FILE_PER_FUNCTION#Allow functions, procedures and triggers to be saved in one file per object. The files will be named as
objectname_OUTPUT, whereOUTPUTis the value of the corresponding configuration directive. You can still use.gzor.bz2extension in theOUTPUTdirective to enable compression. Default 0 will save all in one single file, set it to 1 to enable this feature. This is usable only during the corresponding export type, the package body export has a special behavior.When export type is
PACKAGE, and you enabled this directive, ora2pgpro will create a directory per package, named with the lower-case name of the package, and will create one file per function/procedure into that directory. If the configuration directive is not enabled, it will create one file per package aspackagename_OUTPUT, whereOUTPUTis the value of the corresponding directive.TRUNCATE_TABLE#If this directive is set to 1, a
TRUNCATE TABLEinstruction will be added before loading data. This is usable only duringINSERTorCOPYexport type.When activated, the instruction will be added only if there is no global
DELETEclause or not one specific to the current table (see below).DELETE#Support for include a
DELETE FROM ... WHEREclause filter before importing data and perform a deletion of some lines instead of truncating tables. Value is constructed as follows:TABLE_NAME[DELETE_WHERE_CLAUSE], or if you have only oneWHEREclause for all tables just put theDELETEclause as a single value. Both are possible too. Here are some examples:DELETE 1=1 # Apply to all tables and delete all tuples DELETE TABLE_TEST[ID1='001'] # Apply only on table TABLE_TEST DELETE TABLE_TEST[ID1='001' OR ID1='002] DATE_CREATE > '2001-01-01' TABLE_INFO[NAME='test']
The last applies two different delete where clause on tables
TABLE_TESTandTABLE_INFOand a genericDELETEclause onDATE_CREATEto all other tables. IfTRUNCATE_TABLEis enabled, it will be applied to all tables not covered by theDELETEdefinition. TheseDELETEclauses might be useful with regular updates.STOP_ON_ERROR#Set this parameter to 0 to not include the call to
\set ON_ERROR_STOP ONin all SQL scripts generated by ora2pgpro. By default this order is always present so that the script will immediately abort when an error is encountered.COPY_FREEZE#Enable this directive to use
COPY FREEZEinstead of a simpleCOPYto export data with rows already frozen. This is intended as a performance option for initial data loading. Rows will be frozen only if the table being loaded has been created or truncated in the current sub-transaction. This will only work with export to file and when-JorORACLE_COPIESis not set or defaults to 1. It can be used with direct import into Postgres Pro under the same condition, but-jorJOBSmust also be unset or default to 1.CREATE_OR_REPLACE#By default ora2pgpro uses
CREATE OR REPLACEin functions and views DDL, if you need not to override existing functions or views disable this configuration directive, DDL will not includeOR REPLACE.DROP_IF_EXISTS#To add a
DROPbefore creating the object, enable this directive. Can be useful in an iterative work. Default is disabled.OBJECTIF EXISTSEXPORT_GTT#Postgres Pro does not support Global Temporary Table natively but you can use the pgtt extension to emulate this behavior. Enable this directive to export global temporary table.
NO_HEADER#Enabling this directive will prevent ora2pgpro to print its header into output files. Only the translated code will be written.
PSQL_RELATIVE_PATH#By default ora2pgpro use
\ipsql command to execute generated SQL files if you want to use a relative path following the script execution file enabling this option will use\ir. See psql help for more information.DATA_VALIDATION_ROWS#Number of rows that must be retrieved on both sides for data validation. Default it to compare the 10000 first rows. A value of 0 means to compare all rows.
DATA_VALIDATION_ORDERING#Order of rows between both sides is different once the data have been modified. In this case data must be ordered using a primary key or a unique index, that means that a table without such objects can not be compared. If the validation is done just after the data migration without any data modification, the validation can be done on all tables without any ordering.
DATA_VALIDATION_ERROR#Stop validating data from a table after a certain amount of row mismatch. Default is to stop after 10 rows validation errors.
TRANSFORM_VALUE#Use this directive to specify which transformation should be applied to a column when exporting data. Value must be a semicolon-separated list of the following:
TABLE[COLUMN_NAME,
code in SELECT target list]For example, to replace string “Oracle” by “PostgreSQL” in a
varchar2column, use the following:TRANSFORM_VALUE ERROR_LOG_SAMPLE[DBMS_TYPE:regexp_replace("DBMS_TYPE",'Oracle','PostgreSQL')]To replace all Oracle
char(0)in a string with a space character:TRANSFORM_VALUE CLOB_TABLE[CHARDATA:translate("CHARDATA", chr(0), ' ')]The expression will be applied in the SQL statement used to extract data from the source database.
When using ora2pgpro the export type INSERT or COPY to dump data to the file and that FILE_PER_TABLE is enabled, you will be warned that ora2pgpro will not export data again if the file already exists. This is to prevent downloading twice the table with a huge amount of data. To force the download of data from these tables, you have to remove the existing output file first.
If you want to import data on the fly to the Postgres Pro database, you have three configuration directives to set the Postgres Pro database connection. This is only possible with COPY or INSERT export type as for the database schema there is no real interest to do that.
PG_DSN#Use this directive to set the Postgres Pro data source namespace using
DBD::PgPerl module as follows:dbi:Pg:dbname=pgdb;host=localhost;port=5432
It will connect to the database
pgdbonlocalhostat TCP port 5432.Note that this directive is only used for data export, other export needs to be imported manually through the use of psql or any other Postgres Pro client.
To use SSL-encrypted connection, you must add
sslmode=requireto the connection string like this:dbi:Pg:dbname=pgdb;host=localhost;port=5432;sslmode=require
PG_USERPG_PWD#These two directives are used to set the login user and password. If you do not supply a credential with
PG_PWD, and you have installed theTerm::ReadKeyPerl module, ora2pgpro will ask for the password interactively. IfPG_USERis not set, it will be asked interactively too.SYNCHRONOUS_COMMIT#Specifies whether the transaction commit will wait for WAL records to be written to disk before the command returns a success indication to the client. This is the equivalent to setting
synchronous_commitdirective of thepostgresql.conffile. This is only used when you load data directly to Postgres Pro, the default is off to disable the synchronous commit to gain speed at writing data.PG_INITIAL_COMMAND#This directive can be used to send an initial command to Postgres Pro, just after the connection, for example, to set some session parameters. This directive can be used multiple times.