Текст
                    ТЕОРЕТИЧЕСКИЕ ОСНОВЫ ХИМИИ
Л *
>
BAHTOBAW
ХАНИКА
¦
-A-


Н. Ф. Степанов КВАНТОВАЯ МЕХАНИКА И КВАНТОВАЯ ХИМИЯ Рекомендовано Советом по химии У МО университетов в качестве учебника для студентов химических факультетов университетов Москва «Мир» Издательство Московского университета 2001
УДК 530.145+ 541.1 ББК 17.8 С79 Степанов Н. Ф. С79 Квантовая механика и квантовая химия. — М.: Мир, 2001. — 519 с, ил. (Теоретические основы химии). ISBN 5-03-003414-5 Учебное издание соответствует программе учебных курсов университетов. Подробно излагаются основные положения квантовой теории и ее хими- химические приложения. Каждая глава снабжена набором вопросов и задач для самостоятельной работы. Для студентов университетов и технических вузов. ББК 17.8 Издание осуществлено совместно с Издательством Московского университета Редакция литературы по химии Учебное издание Николай Федорович Степанов КВАНТОВАЯ МЕХАНИКА И КВАНТОВАЯ ХИМИЯ Зав. редакцией канд. хим. наук Т. И. Почкаева. Ведущий редактор Р. Г. Исакова. Художник Э. А. Смирнов. Художественный редактор Н. В. Зотова. Технический редактор Е. В. Денюкова. Корректор Н. Ф. Мазотова Лицензия ЛР № 010174 от 20.05.97 г. Подписано в печать 22.03.01. Формат 60x90/16. Бумага офсетная. Печать офсетная. Гарнитура NewtonC. Объем 16,25 бум. л. Усл. печ. л. 32,50. Уч.-изд. л. 31,23. Изд. № 3/9781. Тираж 5000 экз. Зак. 1395 Издательство «Мир» Министерства РФ по делам печати, телерадиовещания и средств массовых коммуникаций. 1Q7996, ГСП-6, Москва, 1-й Рижский пер., 2 ППП «Типография Наука» 121099, Москва, Шубинскийпер., 6 ISBN 5-03-003414-5 «Мир», 2001 Предисловие Курс квантовой механики и квантовой химии на химических факультетах университетов представляет собой начальное введе- введение в основной раздел современной теоретической химии, без знания которого работать в химии, конечно, можно, как можно работать без знания математики. Любая теория, однако, дает определенную широту взгляда, позволяет увидеть общие стороны казалось бы разнородных явлений и открывает возможности для сравнения различных объектов и проведения аналогий между их свойствами. Математически оформленная теория дает к тому же и возможность рассчитать свойства объектов. Так, классическая теория химического строения позволяет сказать, пусть на основе только лишь феноменологических построений, какова может быть структура химического соединения, каковы особенности этой структуры и свойств рассматриваемого соединения сравнительно с другими соединениями, каков набор химических и физико- химических свойств должен быть присущ этому соединению. Квантовая теория оперирует более детальной информацией о строении вещества, что позволяет ей объяснять и предсказывать многие свойства химических соединений (и особенности проявления этих свойств), в том числе такие, которые подчас неподвластны классической теории, например свойства возбуж- возбужденных состояний, хотя, конечно, по своей общности выводов квантовая теория в чем-то и уступает классической теории. Квантовая химия - это раздел теоретической химии, в кото- котором строение и свойства химических соединений, их взаимодей- взаимодействия и превращения рассматриваются на основе представлений квантовой механики и экспериментально установленных закономерностей, в том числе описываемых классической теорией химического строения. Одно из наиболее важных ее направлений - изучение элементарных актов химических превращений, подчас выделяемое в последние годы отдельно как химическая дина- динамика. Квантовая химия использует математический аппарат и методы квантовой механики для описания и расчета свойств хими- химических соединений, начиная с атомов и простейших молекул и кончая такими высокомолекулярными соединениями, как белки, и
конденсированными фазами, где подчас невозможно уже рас- рассматривать лишь отдельные низкомолекулярные фрагменты. Начало развитию квантовой химии положили работы, выполненные в период становления квантовой механики, т.е. во второй половине 20-х и начале 30-х годов. Многие из основоположников этой науки упомянуты в тексте книги в связи с теми идеями и методами, которые были ими высказаны и разработаны. С момента своего возникновения квантовая химия была связана главным образом с изучением электронного строения молекул, т.е. электронного распределения в стационарных состо- состояниях, а также состава входящих в волновую функцию молеку- молекулярных орбиталей, взаимного расположения уровней энергии занятых и виртуальных орбиталей и т.п. Были предприняты многочисленные попытки интерпретировать такие понятия классической теории, как валентность, химическая связь, крат- кратность химической связи и др. Одновременно были введены и многие новые понятия, такие как гибридизация, о- и jt-связи, трехцентровые связи и т.д., часть из которых прочно вошла в язык современной химической науки, тогда как другие оказались менее удачными и сейчас уже хорошо забыты. К тому же и содержание большинства понятий, возникающих внутри квантовой химии, заметно трансформировалось с течением времени. В квантовой химии было введено большое число различных корреляций между экспериментально наблюдаемыми для вещества и вычисляемыми для отдельных молекул величинами. Сама по себе химия является в существенной степени корреляционной наукой, базирующейся прежде всего на установлении соответствия между свойствами соединений и их строением и последующем предсказании требуе- требуемой информации для других соединений. По этой причине богатейший набор информации о строении, в том числе электрон- электронном строении соединений, предоставляемый квантовой химией, оказался как нельзя кстати для дальнейшего активного развития химической науки. Так, на основе квантовохимических представ- представлений была развита качественная теория реакционной способности молекул, были сформулированы правила сохранения орбитальной симметрии, сыгравшие важную роль при исследовании и интер- интерпретации реакций химических соединений. Развитие квантовой химии шло обычным для науки путем, примечательным тем, что по мере достижения совершенства на каком-либо уровне появлялось достаточное число примеров, убеждающих в явной недостаточности этого уровня во многих аспектах. Например, развитие вычислительных методов квантовой химии показало сначала слишком упрощенный характер целого ряда исходных качественных ее представлений, затем - после бурного расцвета полуэмпирических методов - выявило их многочисленные недостатки, что постепенно привело к пониманию необходимости расчетов в неэмпирических вариантах метода молекулярных орбиталей, т.е. в приближении Хартри-Фока. И как только здесь была достигнута возможность пользоваться результатами неэмпирического расчета в широкой повседневной практике, назрело понимание того, что для достижения результа- результатов, сравнимых с лучшими экспериментальными, требуется существенное усложнение конструкции волновой функции и переход к многоконфигурационным приближениям, к учету элек- электронной корреляции. Конечно, после каждого этапа достижения того или иного совершенства остается четкое представление о том, где более простые подходы обеспечивают правильный ответ, а где нужен переход к новому уровню приближений. Однако появление все новых классов соединений, новых типов возбуж- возбужденных состояний, новых химических реакций дает основание надеяться на то, что спокойной жизни ни химикам, ни квантовым химикам в будущем ждать не приходится. К счастью, такая беспокойная жизнь связана, в основном, с избытком, а не с недостатком возможностей для работы. Сегодня квантовая химия позволяет с высокой точностью вычислять равновесные межъядерные расстояния и валентные углы, барьеры внутреннего вращения, энергии образования и энергии диссоциации, частоты и вероятности переходов под влиянием электромагнитного излучения в весьма широком диапазоне длин волн (от рентгеноэлектронных спектров до спектров ЯМР), энергии активации, сечения и константы скорости простейших химических реакций. В ходе квантовохимических расчетов для многих молекул было обнаружено, с одной стороны, существование значительного числа минимумов на потенциальных поверхностях, разделенных часто невысокими барьерами (нежесткие молекулы), была установлена высокая чувствитель- чувствительность электронного распределения к изменениям ядерной конфигурации, а с другой стороны, были подтверждены и постулируемые классической теорией возможности переноса локальных характеристик отдельных фрагментов молекул в рядах родственных соединений и т.п. Квантовая химия значительно облегчает интерпретацию различных экспериментальных спектров,
позволяя привлекать для анализа данные не только по частотам переходов, но и по интенсивностям и по контурам полос. Она играет определяющую роль при получении информации о межмолеку- межмолекулярных взаимодействиях, при разработке моделей влияния среды на молекулу, в том числе в задачах адсорбции и гетерогенного катализа. В настоящее время быстро развиваются квантовохими- ческие подходы к описанию эволюции химических систем, в частности эволюции возбужденных молекул после воздействия на них того иного внешнего поля, например лазерного излучения. Можно упомянуть и о роли квантовой химии при изучении высокомолекулярных соединений, при построении моделей в молекулярной биологии и квантовой фармакологии, а также в химическом материаловедении. Очевидно, что при первоначальном знакомстве с квантовой механикой и квантовой химией все многообразие проблем затрагивать не имеет смысла. Такое знакомство должно лишь дать представление о самой науке и о тех основных методах, которыми она пользуется при получении результатов. К тому же квантовая химия подчас опирается на такой математический аппарат, кото- который в университетских курсах по математике для студентов химического профиля отсутствует, что также не позволяет ввести ряд ее важных разделов в начальный курс. По этим соображениям в настоящем учебнике опущены разделы по динамике молекул при их возбуждении и химических превращениях, по использованию методов вторичного квантования и функции Грина, по квантово- химическим проблемам теории твердого тела и т.п. В лучшем случае они лишь бегло упоминаются. Кроме того, почти не представлена теория атома, поскольку имеется учебник И. В. Аба- ренкова, В. Ф. Братцева и А. В. Тулуба "Начала квантовой химии", в котором этот раздел изложен подробно и хорошо. И наконец, не представлены и очень многие качественные подходы, особенно распространенные в органической химии, которые возникли на базе квантовохимических представлений путем настолько значительных их упрощений, что превратились, по-существу, в некоторое подобие мнемонических правил, весьма полезных для практики, но уже заметно выходящих за рамки квантовой химии. Построение учебника таково. Первые главы посвящены началам квантовой механики. Далее следуют главы, в которых представлен основной каркас системы приближений, вводимых при рассмотрении молекулярных задач, а также принципы отвечающих этим приближениям квантовохимических методов. Наконец, в последующих главах представлены прикладные и более специ- специальные задачи квантовой химии. Каждая глава нумеруется римской цифрой, каждая формула в тексте - номером главы, параграфа и порядковым номером в параграфе (при ссылке на формулу из этого же параграфа указывается лишь ее порядковый номер). Такая же нумерация принята и для рисунков, причем для простоты в номерах формул и рисунков римская цифра заменена на арабскую. Автор весьма благодарен сотрудникам лаборатории строе- строения и квантовой механики молекул: В. И. Пупышеву, Ю. В. Нова- ковской, А. В. Щербинину, А. Ю. Ермилову, А. В. Медведеву, а также В. И. Путляеву, М. Н. Путляевой, А. А. Кубасову и Т. И. Пархоменко за исключительно большую помощь в ходе написания и подготовки рукописи книги к изданию. Буду искренне признателен всем, кто выскажет свои замечания по тексту книги и предложения по его улучшению.
Краткая вспомогательная сводка определений и соотношений из линейной алгебры и функционального анализа Математический аппарат квантовой механики во многом опирается на линейную алгебру и функциональный анализ, поэтому имеет смысл предпослать изложению квантовой механики краткую сводку ряда определений и результатов из этих разделов математики. а. В векторном пространстве 91 конечной размерности п всегда можно выбрать базис из векторов е,, е2, ... , ел, так что любой вектор х, принадлежащий 91 (записывается как х Е 91), может быть представлен в виде линейной комбинации базисных векторов: n х = xte, + jc.e. + 11 2 2 + х е = п п jc.-e,- @.1) Каждое из чисел х , определяющее вектор х в заданном базисе, называется компонентой вектора, так что вектор х задается совокупностью его компонент. Базис фактически определяет систему координат, в которой определен каждый вектор про- пространства. Для каждой пары векторов х и у можно определить их скалярное произведение х*у = (х, у) как такое в общем случае комплексное число, которое удовлетворяет следующим требо- требованиям (аксиомам): 1°. (х,у) = (у,х)*; 2°. (ах, у) = а*(х, у); 3°. (х + z, у) = (х, у) + (z, у); 4°. (х, х) a 0. @.2) ) Здесь а - произвольное (комплексное) число, звездочка обоз- обозначает знак комплексного сопряжения, и знак равенства в 4° выполняется только при условии, что х = 0. Из 2° и 1° непосред- непосредственно следует, что (х, ау) = д(х, у). Скалярное произведение вектора х на самого себя определяет квадрат его длины: х2- ||х||2 = (х, х). Два вектора, скалярное произведение которых равно нулю, называются ортогональными. Если учесть для х и у представление в виде A), то с учетом 8 аксиом B) придем к соотношению: (х>У)=?*.'УДе*.е,.), @.3) позволяющему сказать, что скалярное произведение любых двух векторов из 91 полностью определяется заданием их компонент х. ну в выбранном базисе и набором чисел 5. = (е,,е;). Этот набор чисел можно записать в виде матрицы S с элементами 5.., причем индекс / есть номер строки, а индекс; - номер столбца этой матри- матрицы. Для базиса ортогональных векторов (е., е) = 0 при i*j. Кроме того, будем всегда предполагать (если не оговорено противное), что в качестве базисных выбираются векторы единичной длины: (е/5 е^) = 1 для любого / (что обозначается как V/). Другими словами, (е, е) = 5. , причем 5 - символ Кронекера, равный 1 при i = j и равный нулю при / *у. Такой базис называется ортонормированным. Компоненты у.(/ = 1, 2, ..., п) вектора у допускают запись в виде матрицы с п строками и одним столбцом, т.е. в виде вектор-столбца: (Ух У = Уг Уп) @.4) Для каждого вектора наряду с длиной может быть опреде- определена и его ориентация относительно выбранного базиса с помощью направляющих косинусов углов между вектором х и единичными базисными векторами е: cos<() = (х, е.)/х = (х/х, е) = (n, e), @.5) где п - единичный вектор в направлении х. На векторном пространстве 91 можно определить линейные операторы А как некоторые преобразования, переводящие векторы из 91 вновь в векторы из этого же пространства 91 (в более общем случае - в векторы другого пространства 91'): У =Ах, и удовлетворяющие требованиям линейности: 1°. А(ах) = аАх , где а - произвольное число; 2°. А(х + у) =Ах+Ау. @.6) @.7)
Поскольку х и у можно представить в виде A), то соотно шение F) перепишется с учетом линейности оператора А: п n n @.8) Каждый из векторов Ае. можно тоже разложить по базису векторов е.: Ае. = >V7e ., так что: iaji)ej =0, или, если учесть, что базисные векторы е , по определению, линей- линейно независимы, то J п 2ji*i > @.9) 1=1 что в матричных обозначениях будет выглядеть следующим образом: У = Ах, где х и у - вектор-столбцы, А - матрица с элементами а..: 7' А = а и а а 2\ а 2п а п\ а п2 а пп / Очевидно, что любой линейный оператор, определенный на 91, допускает представление в виде матрицы А. б. Для матриц при их классификации вводятся следующие определения. Если числа строк и столбцов у матрицы одинаковы, то она квадратная, если нет - то прямоугольная ( имеет вид прямоугольника). Матрица А = Ат с элементами, определенными требованием пц = а.., называется транспонированной по отноше- отношению к А, а матрица А с элементами (а*) = (а.)* - комплексно сопряженной А. Если у матрицы А элементы таковы, что а = а.., то она симметрична, если а..= -а.., то кососимметрична. Если все элементы матрицы А при разных индексах / и j равны нулю, то она диагональна, если к тому же у диагональной матрицы все элементы равны одному и тому же числу а, то она называется скалярной, а при условии а = 1 - единичной матрицей Е (или I). Сумма диагональных элементов матрицы А называется ее следом и обозначается либо как SpA, либо как trA. 10 Определителем, или детерминантом квадратной матрицы А порядка п называется многочлен, каждый член которого - снаб- снабженное определенным знаком произведение п элементов матрицы А , взятых по одному из каждой строки и каждого столбца: ^±аМхаИг-атп)' @.10) В этом выражении суммирование проводится по всем перестановкам '1 2 Р= п чисел 1, 2, ... , п , и перед произведением берется знак "+", если перестановка четная и знак "-", если перестановка нечетная. Таким образом, многочлен A0) содержит п\ членов, из которых п\/2 входят со знаком "+" и п\/2 - со знаком "-". Для определителя матрицы А приняты обозначения detA, или det||a..||. Так, для матрицы второго порядка detA = det для матрицы третьего порядка detA = ал,а„а„ ~ а„а,ла^ - и т. д. Основные свойства определителей: 1°. Определитель не изменится, если в матрице А строки заменить на столбцы, а столбцы - на строки, т.е.если матрицу А транспонировать: detAT= detA. 2°. Определитель меняет знак, если поменять местами любые две строки (или два столбца) матрицы А; отсюда следует, что если две строки (или столбца) матрицы А пропорциональны, т.е. аг= $ак. для любого ;, где C - некоторое число, то detA = 0. 3°. Общий множитель всех элементов любой строки (или столбца) матрицы А можно вынести за знак определителя. 4°. Определитель не меняется, если к элементам какой-либо его строки (столбца) добавить элементы другой строки (столбца), умноженные на произвольный множитель. Отметим, что в качестве элементов д. матриц А могут выступать и функции, например а..(х, у, z). Тогда определители detA также будут в общем случае функциями соответствующих пере- переменных; они называются функциональными определителями. 11
Сумма двух матриц АиВ, имеющих одинаковое число строк и одинаковое число столбцов, т.е. двух матриц одинаковой размерности, определяется как матрица с элементами а.. + Ь... Произведение С двух матриц АиВ определяется как матрица с элементами с. = 2 #;*?*/ \ следовательно, для существования У к произведения С необходимо, чтобы число столбцов у А равнялось числу строк у В. В общем случае произведения АВ и ВА различны, т.е. другими словами, матрицы А и В не коммутируют. Квадрат- Квадратная матрица А, определитель которой не равен нулю, называется несингулярной, или неособенной, в противном случае - сингулярной, или особенной. Если для квадратной матрицы А найдется такая матрица В, что АВ = Е, то матрица В называется обратной по отношению к А , что обычно указывается просто символом А1. Отметим, что АА1 = А А = Е. Определитель произведения двух квадратных матриц одной и той же размерности равен произведению их определителей. Отсюда следует, что если у матрицы А есть обратная, то она неособенная, т.к. det(AA1) = detA detA = detE = 1. Это же соотношение показывает, что det(A1) = (detAI. в. Поскольку при действии матрицы А на вектор х вновь получается некоторый вектор г, то с учетом C) можно определить скалярное произведение вектора z и, например, вектора у; так, в ортонормированном базисе (у, z) = (у, Ах) = ? У( zi - 2 У( а*Хк = 2 2 i i,k к \ i / и так как сумма не зависит от обозначения индекса суммирования, в последнем выражении можно поменять индексы ink местами. Тогда @Л1) i \ к 1 где А1 - матрица с элементами (я % = я у/, т.е. матрица, одно- одновременно транспонированная и комплексно-сопряженная по отношению к А. Такая матрица называется эрмитово-сопряженной матрице А. В том случае, когда А = А, матрица называется эрмитовой, или самосопряженной. В вещественном пространстве эрмитова матрица является симметричной. 12 Матрицы, преобразующие векторы пространства 91 без изменения их длины: х -» Ах, так что (Ах, Ах) = (х, х) для любого х Е 91, называются унитарными, либо в вещественных пространствах - ортогональными. Вектор х, сохраняющий с точностью до знака свое направ- направление при действии на него матрицы (оператора) А, но, быть может, меняющий свою длину: Ах = Хх, @.12) называется собственным вектором этой матрицы, а число X - соответствующим ему собственным значением. Соотношение A2) может быть переписано в виде (А-ХЕ)х = 0, @.13) показывающем, что имеется система линейных однородных урав- уравнений относительно неизвестныхxt; нетривиальное решение у такой системы существует только при условии, что определитель матри- матрицы А - ХЕ равен нулю: det(A - ХЕ) = 0 . Это условие, называемое вековым уравнением, требует обращения в нуль полинома, не превышающего, очевидно, по своей степени числа строк или столб- столбцов квадратной матрицы А, т. е. ее порядка. Определив X как корни такого полинома, далее из системы уравнений A3) можно найти компоненты xi вектора х с точностью до некоторого постоянного множителя, общего для всех компонент. Характерной особенностью эрмитовых и вещественных симметричных матриц является то, что их собственные векторы образуют полный набор, т.е. для этих матриц порядка и, действу- действующих на векторы «-мерного пространства, число линейно неза- независимых собственных векторов также равно п. Следовательно, собственные векторы могут быть выбраны в качестве базиса в 91. К тому же они и ортогональны, так как для двух собственных векторов х и у с собственными значениями Х^ и X справедлива цепочка равенств Ч(У' х) = (У' Кх) = (У^ Ах) = (АУ> х) = (\У> х) = Ь*у (У> х)> (°-14) * * и, если Хх * ку9 то (у, х) = 0, а если Х^ = Х^ , то любая линейная комбинация векторов х и у в силу линейности оператора А будет вновь собственным вектором с тем же собственным значением. Поэтому, например, вместо вектора у можно будет взять вектор CjX + c2y, собственный для А с тем же собственным значением, что и для вектора х, но с такими коэффициентами сх и с2, при 13
которых он будет ортогонален х. Равенства A4) при х = у одновре- одновременно показывают, что Хх = Ку9 т.е. собственное значение эрмито- эрмитовой матрицы А (или эрмитова оператора А) на произвольном векторе z также всегда вещественно: (z, Az)* = (Az, z) = (z, Az). @.15) г. Для множества функций ф1? ф7, ..., qpz, ... также можно определить операции сложения и умножения на число с удовлет- удовлетворением всех требований, предъявляемых к операциям векторного пространства. Следовательно, это множество может рассматри- рассматриваться как линейное (векторное) пространство, элементами (векторами) которого служат функции cpz. Естественно, что в зависимости оттого, как определены эти функции, могут получать- получаться разные пространства: например, пространство <? непрерывных на отрезке [я, Ь] функций ф,(х) отлично от пространства функций, непрерывных на этом отрезке вместе со своими первыми произ- производными; пространство функций, обращающихся на концах этого отрезка в нуль: ср(а) = ср(Ь) = 0, отлично от пространства функций, обращающихся на одном из концов, скажем я, в нуль вместе со своей первой производной и т.п. Тем не менее, для таких функциональных пространств пригодны многие понятия и результаты, получаемые в конечномер- конечномерных пространствах. Здесь также можно ввести скалярное произ- . ведение функций ф, и ср , обозначаемое либо как (<р/5 ф), либо, что более часто используется в квантовой механике, как < удовлетворяющее аксиомам, аналогичным B): ф >, и 1°. 2°. > = а *< ф ;. Ф/ > {а - число); @.16) 4°. фг- > а 0, равенство выполняется только при ф, = 0. Под символом скалярного произведения < ф г|> > могут подразумеваться весьма различные операции, лишь бы при этом выполнялась совокупность требований 1°-4°. Пространство функций, в котором определено скалярное произведение A6) в физике часто называют гильбертовым, хотя это определение несколько отлично от того, что подразумевают под гильбертовым пространством в математике (где требуется еще и полнота относительно нормы, порождаемой этим скалярным произве- произведением, тогда как в отсутствие этого требования пространство называется предгильбертовым, или унитарным). 14 В квантовой механике для функций ф, скалярное произведе- произведение обычно определяется интегралом вида оо >= @.17) — оо если функции зависят от одной переменной х, либо интегралом по всей той совокупности переменных, от которых зависят функции Ф, и ф. Такое пространство функций носит название пространства 82. Норма функции ф, в этом пространстве (аналог длины вектора), определяется как ||qpz|| =<Ц)( Ф,- >! , причем для пространства &2требуется, чтобы норма была конечна: < ф(- ф, >х' ^ оо. Функции, скалярное произведение которых равно нулю, называются ортогональными, тогда как функции Ф,7||ф,-| - нормированными. Множество функций, взаимно ортогональных и нормированных, называется ортонормированной системой функций. В гильбертовом пространстве (понимаемом в математическом смысле этого термина) существуют так называемые полные ортонормированные системы функций ф-, или базисные системы, обладающие тем свойством, что любая функция ф из этого пространства может быть представлена в виде ряда >, @.18) носящего название ряда Фурье для этой функции. В "физическом" гильбертовом пространстве положение с представлением функций Ф в виде рядов Фурье сложнее, в силу чего на более детальном обсуждении этих вопросов мы здесь останавливаться не будем. Отметим лишь, что наряду с суммами вида A 8) в этих простран- пространствах появляются и интегралы Фурье от множества функций, дополняющих набор входящих в сумму A 8) функций до полного. Точно также, как и в конечномерных пространствах, в функциональных пространствах (в общем случае бесконечно- бесконечномерных) могут быть введены преобразования функций, т.е. операторы А, различные по своим основным свойствам, матричные элементы операторов, представляемые скалярными произведе- произведениями функций ф; на преобразованные оператором А функции =<ф,|А|ф,> > @.19) и т. п. Здесь также могут быть выделены линейные операторы и проведена их классификация, в частности, определены симметрич- симметричные и кососимметричные операторы, эрмитовы, унитарные и другие типы операторов. Подробнее все эти стороны теории операторов 15
будут излагаться по мере представления аппарата квантовой механики. Отметим лишь, что при необходимости получить более полную (и подчас более строгую) информацию можно обратиться к соответствующей учебной литературе либо, например, к "Мате- "Математическому энциклопедическому словарю" (М.: Советская энциклопедия, 1988), энциклопедии "Математическая физика" (М.: Большая Российская энциклопедия, 1998), либо к книге Г. Корн и Т. Корн "Справочник по математике для научных работников и инженеров", издававшейся несколько раз, начиная с 1968 г. (в переводе с английского). Глава I Исходные положения квантовой механики § 1. Основные понятия и постулаты квантовой механики Квантовая механика возникла в конце 20-х годов XX столетия1. Будучи тесно связанной по своим исходным представ- представлениям с классической механикой, она обладает и рядом заметно отличающихся и необычных для классической механики сторон, затрудняющих ее понимание при первоначальном знакомстве с нею. К ней, как и к любой другой науке, надо привыкнуть. Тем не менее, сегодня это уже хорошо сформировавшаяся наука, которую широко используют в физике, химии, молекулярной биологии и ряде других разделов естествознания, и без знания основ которой немыслимо понимание языка современной теоретической химии. я. Исходные понятия. Как и в любом другом разделе теоретической физики, в квантовой механике имеется система понятий, которые вводятся без каких-либо дополнительных опреде- определений и предполагаются интуитивно очевидными, например понятия пространства и времени. К ним относится и понятие элементарной частицы как некоторого точечного образования, ха- характеризуемого массой т и зарядом q, а также, если есть в том необходимость, - и другими величинами (например спином, см. § 5 гл.II). Вместо элементарных частиц часто используют термин "микрочастица", имеющий более широкое толкование, поскольку под микрочастицей может подразумеваться и система, составлен- составленная из элементарных частиц, но выступающая в рамках рассма- рассматриваемого круга задач как единое точечное бесструктурное образование с фиксированными массой, зарядом и другими характеристиками. Так, при рассмотрении атомных и молекуляр- молекулярных систем к микрочастицам относят атомные ядра, внутренней структурой которых в подавляющем большинстве химических задач можно пренебречь. 1 Ее предшественница, так называемая старая квантовая теория, была введена датским физиком Нильсом Бором в 1913 г. при объяснении спектров атома водорода; далее она была развита рядом исследователей, в частности немецким физиком Арнольдом Зоммерфельдом. 17
Положение частицы в пространстве определяется при выбранной системе отсчета (системе координат) ее радиусом- вектором, либо координатами этого вектора. Помимо положения каждой частицы в системе микрочастиц считается заданным и момент времени t. Предполагается, что наряду с указанными исходными понятиями в квантовой теории определены и многие другие аналоги представлений классической механики, такие как импульс частицы, ее момент импульса и т.п. Однако, прежде чем говорить об этих величинах, остановимся на том, как определяется состояние классической и квантовой систем микрочастиц. В классической механике состояние системы в данный момент времени считается определенным, если известны положе- положения всех входящих в нее материальных точек и их скорости (либо импульсы), а также связи, ограничивающие возможные переме- перемещения этих точек. В квантовой механике ситуация оказывается более сложной. Предполагается, что мы не можем точно указать положение каждой частицы в системе, эти положения могут быть известны нам лишь с вполне определенными вероятностями их появления (при измерении). Квантовое состояние считается задан- заданным, если задана некоторая функция пространственных пере- переменных частиц и времени, которая позволяет вычислить по опреде- определенным правилам не только указанные вероятности, но и все остальные характеристики системы частиц. Такая функция, назы- называемая функцией состояния, или волновой функцией, очевидно, должна удовлетворять некоторому уравнению (или уравнениям), которое необходимо ввести наряду с правилами, позволяющими вычислить все требуемые характеристики системы. Это уравнение по аналогии с уравнениями классической механики может быть названо уравнением движения. Как уже сказано, характерной особенностью квантовой механики с первых шагов ее создания была тесная связь с идеями и аппаратом классической механики. В частности, предполагалось, что уравнения квантовой механики, представленные в достаточно общей форме, должны переходить при определенных условиях, например, при достаточно больших массах частиц, в обычные уравнения классической теории. Другими словами, если сформули- сформулировать каким-то образом понятие предельного перехода, то при таком переходе квантовые уравнения должны приобретать вид и смысл уравнений класической механики. Это утверждение, названное принципом соответствия, играет фундаментальную роль в квантово-механических построениях. Оно было весьма сущест- 18 венным на этапе создания квантовой теории, оно продолжает быть таковым и сегодня, когда развитие теории привело к необходимости выявления множества общих для обеих механик результатов и способов их описания, в частности при рассмотрении динамических задач. б. Функция состояния и операторы наблюдаемых. Поскольку положения частиц в пространстве и, соответственно, их скорости (или импульсы) не определены, то в квантовой механике нет понятия движения частиц в том смысле, в котором оно используется в классической теории. В общем случае меняются лишь вероятности для каждой частицы системы быть в заданной точке пространства. Это приводит к тому, что нет и перемещений частиц как таковых, а следовательно, и нет смысла говорить, например, о скорости перемещения той или иной частицы. Подобные наводящие соображения подсказывают, что функция состояния, определяющая поведение квантовомеханической системы, должна быть функцией лишь координат частиц и времени, но не их скоростей или импульсов: Ч? = V(rp r2,..., r^; t). Каждой физически наблюдаемой величине должно очевид- очевидно отвечать некоторое правило, позволяющее так преобразовать функцию Ч*, чтобы с вновь полученной функцией можно было бы вычислить эту наблюдаемую, причем такое правило не должно зависеть от того, для какого состояния, определяемого функцией Ч*, наблюдаемая величина находится. Другими словами, для каждой наблюдаемой А должен быть задан соответствующий ей оператор А (т.е. правило преобразования), переводящий функцию состояния W в новую функцию Ф, которая вместе с функцией Ч* и позволит определить в конечном итоге численное значение этой наблюда- наблюдаемой. Как определить последовательность действий при таком вычислении, необходимо было бы выяснять особо, однако вряд ли на даннном этапе делать это целесообразно, поскольку наводя- наводящие соображения хотя и весьма полезны, но заменить систему постулатов, аксиоматику теории не могут. Они, конечно, помогают адаптироваться к этой системе, помогают понять, пусть на весьма нестрогом уровне, о чем идет речь, тем не менее увлекаться слиш- слишком большим их числом пока не будем. в. Постулаты. Итак, попытаемся дать некоторую началь- начальную аксиоматику квантовой механики, которую на последующих этапах дополним еще некоторыми постулатами и уточнениями. 1. Состояние квантовой системы из N микрочастиц полностью определяется функцией состояния, или волновой 19
функцией Ч*(гр ..., rv; t), где гр ..., г^ - радиусы-векторы частиц. В общем случае эта функция является комплексной. Если dx = = dxxdy}dz} ... dxN dyN dzN = \\dvk - элемент объема в простран- пространстве переменных N частиц, то величина dW = |Ч*(Гр ..., r^; t)\2dx пропорциональна вероятности найти в момент времени t первую час- частицу вблизи точки с радиусом-вектором г в объеме dr, = dx]dy]dz] (т.е. в параллелепипеде с длиной ребер dxv dyx и dzv одной из вершин которого служит точка i^), вторую частицу вблизи точки г2 в объеме dx2 и т.д. Функция (WJ2 = 4**4* при такой интерпретации пропор- пропорциональна плотности вероятности, т.е. вероятности, приходящейся на единицу объема (звездочка - символ комплексного сопряжения). 2. Каждая наблюдаемая физическая величина А (координа- (координатах, сопряженный ей импульсу, компоненты момента импульса, например Lx и т.п.) представляется линейным оператором А, и среднее значение <а> этой наблюдаемой в квантовом состоянии, определяемом функцией Чг, задается интегралом вида <а> = J4f* A4*dx . A.1.1) Интегрирование ведется по всей области изменения переменных, например, по каждой декартовой переменной от -оо до +о°. Подобного типа интегралы, широко встречающиеся в квантовой механике, обычно обозначаются специальным образом: JVAWT m<4f\A\4f>; A.1.2) эти обозначения называются дираковскими (по имени введшего их выдающегося английского физика Поля Дирака). В частности, оператор координаты, например jc, действует на произвольную функцию Ф по весьма простому правилу, согласно которому функция Ф переходит в произведение хФ. Оператор любой функции Дг г) й фу любой функции 2, рр ...), зависящей только от координат, дей- дейФ Др 2,), сящей только от координат, дей- действует аналогично: функция Ф умножается на/и переходит в/Ф. Оператор импульса, например рх, переводит функцию Ф в ее частную производную по координате х, канонически сопряжен- сопряженной этому импульсу, и одновременно умножает на -ih , где i - мнимая единица, а Й- фундаментальная постоянная, носящая название постоянной Планка (по имени выдающегося немецкого физика Макса Планка) и равная 1,0545887-10 34 Дж-с. Все остальные операторы получаются из соответствующих выражений классической механики заменой по указанным прави- правилам координат и импульсов на отвечающие им операторы (при дополнительном условии, о котором речь пойдет ниже: операторы, отвечающие физическим величинам, должны быть эрмитовы). 20 3. Изменение функции состояния Ч* во времени определяет- определяется уравнением Шредингера A.1.3) dt Это уравнение полностью определяет функцию Чг при заданной функции состояния в начальный момент времени: Чг(г; t = 0) ¦ Ч* . В уравнении C) Н есть не что иное, как оператор Гамильтона, получаемый из обычной классической функции Гамильтона путем замены встречающихся в ней координат и импульсов на соответ- соответствующие операторы, представленные в п. 2. Оператор Гамиль- Гамильтона часто называется также гамильтонианом. Эта система основных положений далее будет дополнена постулатом о спине (§5, гл.И) и постулатом о симметрии волновой функции относительно перестановок тождественных частиц (§ 3, гл.IV). Сейчас пока для их введения у нас нет достаточной базы. г. Примеры. Для одной частицы массы т, положение которой в пространстве определяется ее радиусом-вектором г, оператор импульса р имеет в декартовой системе координат следующий вид: ih дх, - ih + k - ih dz так что при действии оператора импульса на функцию состо- состояния Ф(г, i) частицы получается вектор с компонентами — Ifl — Ifl И — Ifl дх ду dz Момент импульса L частицы в классической механике задается выражением L = гхр , где символ х означает векторное произведение (вектора г на вектор р). По определению векторного произведения декартовы компоненты вектора L имеют вид Lx = yp2~zpy, Ly = zpx-xpz, Lz = xpy-ypx. AЛ.4) При переходе к квантовомеханическим выражениям мы должны заменить в этих равенствах импульсы ри (а = х, у, z) на соот- соответствующие им операторы, памятуя о том, что операторы коорди- координат суть просто умножение на эти координаты: = УР гру = y(-ih — - z(-ih ду У dz _д_ ду Lt — У XPZ = dx - x dz A.1.5) 21
L =xp -yp = -im x у — ). Иу yFx V ду У dxJ Кинетическая энергия частицы в классической механике определя- Р 1 2 2 2 ется равенством: Т = — = —(рг + »„ + р: ). Переход к кванто- вомеханическому оператору должен происходить так, что, например, р2 fix, у, z) = рх pxj{x, у, z) = (-1Й — )(-iA — ) f(x, y,z) = у т дх у дх где учтено то обстоятельство, что i2 = -1. Поэтому Т = 2пг ,2 \ -й2 ' ь2 Ъп ,2 \ ду' A.1.6) Сумма вторых частных производных, стоящая в скобках в последнем равенстве, называется оператором Лапласа. Этот оператор имеет специальное обозначение: А = дх2 ду dz A.1.7) к так что оператор кинетической энергии имеет вид Т = Л. 2т Если потенциал V, в котором движется частица, зависит только от ее положения в пространстве и времени: V = K(r, t)9 то оператор V этого потенциала есть всего лишь умножение соответ- соответствующей функции Ф на функцию V. Функция Гамильтона Н(г, р, /) для рассматриваемой задачи об одной частице, находящейся в поле К(г, /), представляет собой сумму кинетической энергии и потенциала (т.е. потенциаль- потенциальной энергии): Н = Т + V. Следовательно, квантовомеханический оператор Гамильтона, отвечающий этой функции, будет иметь вид: A.1.8) Знание этого оператора позволяет записать уравнение Шредингера д_ dt 2т V(r,0 решая которое, можно найти и функцию состояния Попробуем теперь написать оператор Гамильтона (а вмес- вместе с ним, следовательно, и уравнение Шредингера) для более слож- ной системы, например для атома гелия. В атоме Не имеются три частицы: ядро с массой М и зарядом Ze ~ 2е и два электрона с массами m и зарядами -е , где е - абсолютная величина заряда электрона. Кинетическая энергия такой системы будет склады- складываться из кинетических энергий каждой отдельной частицы: Т - Т + Т + т , а 1 2 ' где Га - кинетическая энергия ядра Не (а-частицы), Т} и Т2 - кинетические энергии первого и второго электронов. Согласно сказанному выше для одной частицы, ясно, что Т = - а А . 2М "¦ Т, = А,> 2т ' к где каждый из операторов Лапласа содержит вторые частные про- производные по координатам соответствующей частицы, например '¦ dz{ и т. п. для второго электрона и ядра. Потенциал взаимодействия частиц в атоме гелия склады- складывается из попарных потенциалов кулоновского взаимодействия: V = 2ez 2e R а\ R а2 '12 где /?а1 и /?а2 - расстояния до ядра а от электронов 1 и 2 соответственно, a r{2 - расстояние между электронами. В этом выражении использована обычно встречающаяся символика: межэлектронные расстояния обозначаются строчной буквой r9 a расстояния между электронами и ядрами - прописной буквой R с соответствующими индексами. В молекулах появляются еще и межъядерные расстояния, которые обозначаются как R 9 где а и - номера ядер. Теперь можно написать окончательное выражение для оператора Гамильтона атома Не: Н= - 2m l 2m 2 R 2е1 2е о.\ R A.1.9) а2 12 д. Стационарное уравнение Шредингера. В приведен- приведенном выше примере построения оператора Гамильтона для атома Не встретилось весьма интересное обстоятельство: этот гамиль- гамильтониан не содержит в явном виде времени. В классической меха- механике это означало бы, что функция Гамильтона постоянна во 22 23
времени и равна полной энергии системы. Оказывается, что в квантовой механике отсутствие явной зависимости оператора Гамильтона от времени означает, по-существу, то же самое: сохранение энергии системы. В этом случае явная зависимость от времени может быть только у функции Ф, причем в качестве частного решения уравнения Шредингера можно попытаться использовать представление Ч^г, t) в виде произведения двух функций, одна из которых зависит только от V. /(/), а вторая - только от пространственных переменных: Ф(г), так что V(r,0 = х('Н>(г). A.1.10) Если подставить такую функцию в уравнение Шредингера A), то в левой его части появится производная по времени только от /. В правой же части с учетом того, что оператор Гамильтона явно от t не зависит, при действии его на произведение /Ф появятся производные по пространственным переменным лишь от функции Ф(г), что в итоге приведет к уравнению Поделив правую и левую часть на Ч* = уФ (что допустимо всюду, где Ф и х не равны нулю), придем к соотношению: = —ЯФ, Ф A.1.11) в котором левая часть зависит только от времени, а правая - только от пространственных переменных. Поскольку время и простран- пространственные переменные независимы, то такое равенство может выполняться лишь при условии, что правая и левая его части равны одной и той же постоянной величине Е. Как следует из A1), в этом случае мы приходим к двум уравнениям, определяющим отдельно функции х и Ф: A.1.12а) = ?Ф(г). A.1.126) Первое из этих уравнений, как нетрудно убедиться прямой подстановкой, имеет решение х@ ^Aexpi-iEt/h), где А - некоторая постоянная. Второе уравнение A26) решать существенно труднее, для большинства задач аналитических решений у него вообще нет. Поэтому приходится вводить численные методы и различные dt 24 приближенные подходы, приближенные модели для поиска его решений. Уравнение A26), носящее название стационарного уравне- уравнения Шредингера, и будет основным предметом нашего рассмотре ния в последующем изложении. Входящая в него постоянная Е имеет ту же размерность, что и оператор Гамильтона, а именно размерность энергии. Более того, как будет показано в § 2, эта постоянная имеет смысл энергии квантовой системы в состоянии, определяемом волновой функцией Ч* = Ф(г)х(/), сомножители которой удовлетворяют уравнениям A2). Следует заметить, что уравнение A26) в общем случае, конечно, может иметь не одно решение. Разные решения Ф^ будут в общем случае отвечать разным энергиям Ек , хотя возможны к тому же и такие ситуации, когда одной и той же энергии отвечает несколько разных функций состояния Ф^ (/ = 1, 2,..., п). е. Система единиц. В квантовой механике атомов, молекул, образованных из них комплексов, кластеров и т.п. объектов удобно пользоваться не теми системами единиц, которые разработаны для макроскопических количеств вещества, напри- например СИ, а теми, которые специально адаптированы к рассмотре- рассмотрению микроскопических объектов. Одной из наиболее часто исполь- используемых является атомная система единиц, в которой за основные принимаются следующие: -единица длины, называемая бор; 1 бор = 5,2917706-101 мвСИ; - единица массы т, равная массе покоя электрона, т. е. т = = 9,109534- Ю-28 г; - единица заряда е, равная абсолютной величине заряда электрона, т. е. е = 1,6021892-10'19 Кл (кулон); - постоянная Планка Й, равная 1,0545887-10 34 Дж-с. Эти атомные единицы обычно обозначаются как а.е. массы, а.е. длины и т.п. Через них определяются и другие единицы, например импульса, времени и энергии. Выбор единицы длины определяется тем, что простейшие атомные и молекулярные объекты имеют средние размеры порядка нескольких или нескольких десятков бор; сама же единица 1 бор определена как так называемый боровский радиус для электрона в основном состоянии атома водорода (см. §3, гл.И). Более подробная сводка единиц представлена в Приложении I. Вид уравнения Шредингера при переходе к атомной системе единиц упрощается. Например, для рассмотренного 25
примера атома Не уравнение Шредингера с гамильтонианом (9) становится таким: ' 1 . 1 А 1 А 2 2 1 2 dt 2М Д.-- 1 -1д2_ 2 *al R a 2 r12 поскольку A = 1, e = 1 и /и = 1. Выражение для временного сомножителя в функции Ф в этом случае также приобретает чуть более простой вид: х@ = Аехр(-/?/). ж. Чистые и смешанные ансамбли. Таким образом, мы ввели основные положения, определяющие состояние квантовой системы, и то основное уравнение движения (уравнение Шредингера), которое позволяет, в принципе, получить функцию состояния такой системы. С функцией состояния далее вычисля- вычисляются средние значения наблюдаемых величин, характеризующих эту систему. В квантовой статистической механике, т.е. при наличии большого числа частиц (например, слабо взаимодействующих подсистем - атомов или молекул) имеют дело с состояниями, в которых можно определенно указать лишь вероятность Р. обнаружения того или иного состояния подсистемы, описываемого волновой функцией i\>.. Следовательно, здесь уже нельзя ввести какую-либо волновую функцию Ф системы, удовлетворяющую уравнению Шредингера. Можно говорить лишь о некотором "смешанном" состоянии, для которого каким-либо способом определены вероятности обнаружения "чистых" состояний, описываемых волновыми функциями, удовлетворяющими уравнению Шредингера. Такие системы обычно называют смешанными ансамблями, в отличие от чистых ансамблей, находящихся в определенных квантовых состояниях и определя- определяемых каждое своей волновой функцией г|>. Поскольку проблемы квантовой статистической теории далее по-существу затраги- затрагиваться не будут, то речь ниже будет идти лишь о чистых ансамблях. В следующем параграфе мы более детально остано- остановимся на свойствах волновых функций и на ряде математических аспектов квантовой механики. Задачи 1. Написать выражение для оператора квадрата момента 2 2 2 2 импульса L2 = L2 L2 + L2Z 2. Написать оператор Гамильтона для атома Li; для иона Н2 \ для молекулы LiH. 26 3. Пусть имеется свободная квантовая система, гамильто- гамильтониан которой явно от времени не зависит. Пусть в момент времени / = О волновая функция (функция состояния) имеет вид: Ч* = = с]х?] + c*U2, где с, и с2 - некоторые постоянные, ах?]их?2 удовле- удовлетворяют стационарному уравнению Шредингера для энергий Е] и Е2, соответственно. Как будет выглядеть волновая функция в момент времени § 2. Простейшие одномерные задачи Введение основных положений требует и развития опреде- определенного аппарата теории, а также обсуждения ряда вопросов, носящих вспомогательный характер, но определяющих структуру многих квантовомеханических выражений. Прежде всего имеет смысл остановиться на небольшом числе простых задач, иллю- иллюстрирующих то, как и какие рассуждения проводятся и какие результаты получаются в квантовой механике. а. Основные свойства волновых функций. Рассмотрим сначала одномерное стационарное уравнение Шредингера с -2 оператором Гамильтона Н = - 1 d + V(x), которое можно за- A.2.1) 2m dx2 писать, например, следующим образом: -? =2m(VW- <&2 v Существование второй производной требует, чтобы функция была непрерывной вместе со своей первой производной. Вторая же производная определяется поведением потенциала V(x): если он имеет точки разрыва, то разрывной в этих точках будет и вторая производная. Из физических соображений, связанных с вероят- ностным смыслом \ty(x)\ как плотности вероятности обнаружения частицы в точке х, следует требование, чтобы функции я|) были всюду ограниченными. Вблизи любой точки jc0, где потенциал ограничен, в том числе и там, где он разрывен (см. рис. 1.2.1а), можно написать •ф = ao+ a1(x- а2(х-х0J+ О(х~х0) , A.2.2) где а0, а1 и а2 - постоянные величины, О(х - х0) - функция, при 27
V a Рис. 1.2.1- Ограниченный потенциал К с точкой разрывался) и потенциал с бесконечно высокой стенкой (б). х -» х0 стремящаяся к нулю быстрее, чем (х -ж0J. Смысл коэффи- коэффициентов а. достаточно прост: и с тогда как коэффициент а2 при наличии точки разрыва различен слева и справа от этой точки и имеет соответствующий смысл половины второй производной tj) по х слева и справа от х0. Сказанное означает, что если мы нашли решения г|>л и г|>пруравнения Шредингера слева (л) и справа (пр) от точки х0, то в этой точке они должны удовлетворять так называемым условиям сшивания: и Несколько отличные условия возникают тогда, когда потенциал V(x) становится равным бесконечности в некоторой области, например при х ? хп(рис. 1.2.16). В области х ? х 0 соотношение A) будет иметь смысл, только если ty всюду в этой области обращается в нуль. Другими словами, в этом случае 28 имеется бесконечно высокая потенциальная стенка, за пределы которой частица не проникает. Слева же от этой стенки функция ¦ф имеет обычное поведение, например вида B), так что по- существу вводится обычное граничное условие: г|>пр(х) - 0 при х = х тогда как первая производная г|>пр'(х) в точке х0 при этом не связана какими-либо условиями (кроме, конечно, условия ограни- ограниченности). Если же потенциал V(x) стремится к ±оо в точке xQ9 скажем по закону V(x) = Х/\х - хо\к9 где X - постоянная, а 1 * к > О, то функцию г|> можно представить в виде у(х) = а0+Ь\х-х0\* + О(х-х0), A-2.4) где 0 < е < 2 из тех соображений, что вторая производная в этой точке стремится (по модулю) к бесконечности, а вторая производ- производная функции О(х - х0) должна быть при этом конечной. Условие же непрерывности производной гр' в точке *0требует и выполнения неравенства е а 1. Подставив выражение D) в уравнение Шредингера и оставив далее только те члены, которые при х^х0 стремятся к бесконечности, получим, в частности, при к < 1: Ц-. A.2-5) 2т Это соотношение выполняется лишь при условии г-2 =-к, т.е. при е = 2 - к , и одновременно при — е(е -1) = Ха0' так чт0 в этом случае первая производная в точке х0: tp'(*o) = b определена через значение функции в этой точке г|>(*0) = а и параметры задачи. Для потенциала V = X/ \ х - х01, как будет показано в § 3 гл. II при решении задачи об атоме водорода, поведение функции при х _» х определяется выражением \х - х0 е ' °', причем параметр а может быть вещественным или мнимым в зависимости от знака X. Дря потенциалов вида V = X/ \х - х01к при к > 1 можно получить аналогичные оценки, останавливаться детальнее на которых в рамках данного рассмотрения не имеет смысла. Полученных результатов для нас уже достаточно: они вполне определенно свидетельствуют о том, что наличие особенностей у потенциала приводит к дополни- дополнительным ограничениям на значения волновых функций и их первых производных в точках этих особенностей. При переходе к задачам с большим числом измерений 29
конкретный вид таких ограничений может меняться, однако свойства непрерывности волновой функции и ее первых производ- производных, а также свойство ограниченности г|> остаются сущест- существенными и в этих задачах. При рассмотрении задачи с кулоновским потенциалом (задачи об атоме водорода, § 3 гл. II) мы еще вер- вернемся к связи значений волновой функции г|> и ее производной по радиальной переменной в особой точке этого потенциала. б. Одномерный прямоугольный потенциальный ящик. В квантовой механике имеется весьма небольшое число аналити- аналитически решаемых задач. Задачи, которые обладают простыми решениями, имеют, как правило, весьма важное значение как некоторые модели, аппроксимирующие, по крайней мере качест- качественно, более сложные конструкции и служащие основой для построения более точных подходов. Важным классом таких простых задач являются различные одномерные задачи с пря- прямоугольными потенциалами, когда вся область изменения перемен- переменной х разбивается на отдельные отрезки или интервалы, на которых потенциал предполагается постоянным. Рассмотрим сначала простейшую задачу о нахождении решений стационарного уравнения Шредингера, когда V(jc) равен нулю при jCj ^ х s х1 и обращается в бесконечность вне этого отрезка (рис. 1.2.2). Это - так называемая задача о потенциальном ящике с бесконечно высокими стенками. Пусть для простоты jc, = -L/2, х2 = L/2, — ss Рис. 1.2.2. Прямоугольный потенциальный ящик. Для первых трех уровней энергии представлены также волновые функции. 30 где L - некоторая постоянная, определяющая "длину" ящика. В областях х < х{ и х > х2, как следует из п. а, волновая функция г|> равна нулю. В самом же ящике, коль скоро V(x) = 0, уравнение Шредингера принимает вид . A.2.6) 2т Это дифференциальное уравнение второго порядка имеет в качестве частных решений при заданном Е две функции: sinKx и coskx, где к определяется при подстановке этих функций в уравнение F): к2 = 2тЕ. Общее решение будет иметь вид линейной комбинации частных решений с двумя произвольными постоянными А и В: tyE (x) =Asin\l2mEx + Bcos^lmEx . A.2.7) Полученное решение должно удовлетворять, согласно сказанно- сказанному в п. а , двум граничным условиям: i\>E(-L/2) = tyE(L/2) = 0, т.е. Asin(- kL/2) + 5cos(- kL/2) « 0 и Asin(KL/2) + Bcos(kL/2) = 0. Учитывая далее, что sin(-ct) = - sina и cos(-a) = cosa, из этих двух уравнений нетрудно получить Asin(KL/2) - 5cos(kL/2) - 0. Так как А и В одновременно обращаться в нуль не могут, как впрочем sui(kL/2) и cos(kL/2), to возможны два случая: а) А - 0, cos(kL/2) =0 и б) В - 0 , sui(kL/2) - 0. Равенство нулю coscp означает, что аргумент ср равен л , 2* + 1 — + ш = л , а равенство нулю sincp приводит к тому, что Ф = тек = 2тск/2. Оба эти случая можно представить единообразно следующим образом: <р = ли/2, где п = 1, 2, ..., т.е. произвольное целое число. Поскольку ср = кЬ/2, то сразу же получаем: л/г = Lk, так что к = кп/Ь или, вспоминая, что к = ы2тЕ , окончательно найдем, что уравнение F) имеет решения, удовлетворяющие граничным условиям, лишь при вполне определенных, дискретных значениях энергии: Л 2mL п п = 1, 2,... A.2.8) Эти решения имеют вид 31
Низшему значению энергии Еп отвечает п = 1, так что Ех = л /2mL , и (см. рис.1.2.2) л / L\ __ . юс ГГ+2~Г lC0ST" Дискретные значения энергии часто называют уровнями энергии, или энергетическими уровнями, а низший уровень - основ- основным. Следующий за основным уровень, называемый первым возбужденным, имеет энергию Е2 = 4л2/2шЬ2 = АЕХ и соответ- соответствующую волновую функцию (см. рис. 1.2.2): 2л/ L\ . . юс L { 2 L A.2.9) Постоянные Ап остаются при этом неопределенными. Как следует в общем случае из уравнения Шредингера A.1.12), умножение его решения на произвольную постоянную приводит опять к решению этого уравнения с тем же собственным значением Е. Это означает, что все решения, различающиеся лишь числовым множителем, отвечают одному и тому же квантовому состоянию. Обычно числовой множитель подбирают на основе некоторого дополнительного условия. Например, если вспомнить про вероятностную интерпретацию Ы , то можно ввести такое условие: вероятность обнаружить частицу где-либо в ящике (но неважно, где конкретно) должна равняться вероятности достовер- достоверного события, т.е. 1. В нашем случае это будет означать, что иг 1 -L/2 L/2 / -L/2 L — \dx . 2 Воспользовавшись далее простым тригонометрическим соотноше- соотношением sin2qp = A - cos2q))/2 и взяв определенный интеграл от этого выражения, окончательно получим: 1 = A2L I 2, так что Аи= и,следовательно, и sin юг L * _ 2 A.2.10) Эти функции позволяют определить плотность распреде- распределения вероятности |xj>|f| в каждом стационарном квантовом сос- состоянии и, следовательно, позволяют найти средние значения координаты, импульса и других величин в этих состояниях. Так, среднее значение импульса в состоянии ср„ будет получаться как 32 L/2 п -LI2 -Li2 . ПП sin — I х L L\( . d \ . пп — -I— sin — ) dx) L -\dx 2 L im что после замены переменной х на переменную ф = —\х + —) дает 2i п = sin ф О пп О = 0. Среднее значение квадрата импульса в этом состоянии будет равно: -2 \ 2 Llf- .ml L >„ = — С sin — \x + — n t J { L -иг L d dx . пп sin — I х L —\dx = -1/2 Зная величины <р2> и <р>п , можно без труда найти и дисперсию распределения значений импульса в каждом квантовом состоянии tyn: Dn(p) = <(P- <P>f>n = „ п + <Р>1= так что Dn(p) = (nn/LJ. Как показывает это соотношение, по мере повышения уровня энергии разброс значений импульса растет линейно в зависимости от п. Не вдаваясь пока в дальнейшие вычисления различных величин с полученными функциями, отметим лишь, что для координаты, как и для импульса, <х>п = 0 , а 2 22 п 12 Кроме того, отметим еще одно полезное соотношение: 2 2 Л V Л 6 \ 1 у п 2 A.2.11) которое потребуется в § 4. в. Ступенька потенциала. Рассмотрим еще одну задачу такого же типа. Пусть потенциал V равен нулю всюду при х < 0 и 2 — 1395 33
равен некоторой конечной величине Vo > О прих& 0 (см.рис. 1.2.3). Слева от нуля (х < 0), т.е. в области I, уравнение Шредингера имеет следующие решения: xj>! = Axeikx+ Bxelkx = aYcoskx + ftjsinfcc, где а{ = Ax + Bl9 afe, = (Aj - 5j)/. Ради простоты получаемых выражений будем пользоваться экспоненциальным представле- представлением функций ipln. Постоянная к определяется непосредственно из уравнения Шредингера (-dz/dx2)i^l = 2mEty{9 так что к = ы2тЕ , где т - масса частицы, Е - ее энергия. Аналогично в области II (х ^ 0) решение уравнения Шредингера (-d2/dx2)tyn = 2т(Е - может быть записано в виде а) при Е > Vo + *«*-** б) при 0 < Е <; V o = pm(E-V0); 0- E) . Поскольку X в Tj)IU, - действительная положительная величина, а волновая функция прих -* оо должна оставаться ограниченной, то очевидно, что коэффициент а следует выбрать равным нулю, так что xJ)II6 = be'1*. V Vr о 0 Рис. 1.2.3. Прямоугольная ступенька потенциала. х Функции xj)j и г|)п, так же как и их производные, должны быть "сшиты" в точке х = 0, т.е. в этой точке они должны быть непрерывны. Эти два условия приводят к следующим ограниче- ограничениям на коэффициенты в выражениях для функций г|)г и 34 а) при Е > V, о j - р/?„ 2?п = —РЛ, + aBj, где а = к + к 2к л 1С 2к б) при Е < V о 2к ik - X Li. A.2.13) Таким образом, в данной задаче, в отличие от предыдущей, решения существуют при всех Е > 0. Эти решения, однако, раз- различаются по своему поведению справа от точки разрыва для потенциала: над потенциальной "ступенькой" ipn представляет собой линейную комбинацию двух экспонент от мнимого аргумен- аргумента, или, что то же, линейную комбинацию синуса и косинуса юс, тогда как под ступенькой - это затухающая экспонента е~*~*, стремящаяся к нулю тем быстрее, чем больше X, т.е. чем ниже соответствующий уровень энергии. В классической механике такому потенциалу отвечало бы два типа движения: при Е > V материальная точка (шарик) двигалась бы, например, слева направо (от некоторого значения х < 0 при t = 0) равномерно со скоростью v., равной ее скорости в момент времени t = 0 и кинетической энергией mv.2/2; далее при прохождении над ступень- ступенькой ее энергия не менялась бы, а скорость уменьшалась скачком до величины v = ^J2m(E -Vo) , а при Е = V она в этой точке останавливалась бы. При Е < V картина иная: дойдя до ступеньки, материальная точка отражается от нее и с такой же (по абсолют- абсолютной величине) скоростью, что и V/, идет назад. Попробуем теперь понять соответствующую картину движения в квантовой механике. Для этого прежде всего нам нужно записать решения временного уравнения Шредингера на основе уже полученных решений стационарного уравнения. Любое частное решение имеет вид гК*, 0 - г|>(*, E)e~iE\ A.2.14) тогда как общее решение временного уравнения есть не что иное, как произвольная линейная комбинация таких частных решений: -iEj A.2.15) п или, если учесть, что Е может принимать любое положительное значение, т. е. любое значение на полуоси [0, °°), вместо линейной 35
комбинации A5) может выступать и определенный интеграл вида: Е2 = fc(E)y\)(x,E)e-lEtdE A.2.16) В этом интеграле функция с(Е), так же как и коэффициенты спъ линейной комбинации A5), полностью должна определяться заданием начальных условий ip(x, t = 0). Для того, чтобы в дальнейшем детальнее понять поведение функции г|>(х, i) в общем случае, имеет смысл посмотреть сначала, что она собой представляет в том частном случае, когда выписано решение A4) при некотором фиксированном значении энергии Е. Так, для функции ipj имеем: =A{ei(kx~Et) A.2.17) Выражение Ае1^ Et\ как хорошо известно из общего курса физики, представляет монохроматическую волну с амплитудой Л и круговой частотой о = ?, распространяющуюся в положительном направлении х с (фазовой) скоростью v = Elk = ыЕ / 2т . Анало- Аналогично Be~l(<kx+Et^ представляет такую же волну, но распространяю- распространяющуюся в обратном направлении. Эти выражения можно записать и в виде С cos (Ах ± ш/ + у), где С равно, например, ЛA + i) IV2 , а у - фаза волны, равная при использовании вышеприведенных выражений ±л/4 . Линейная комбинация двух волн, распространяющихся в противоположных направлениях, при определенном соотношении коэффициентов А и В дает стоячую волну, представляемую, например, выражением вида Ф = af(kx + b^-cos^t + б2), где а, б, и б2- некоторые постоянные, а/- некоторая функция, равная, в частности, синусу или косинусу аргумента кх + б,. Если сравнить это выражение с A4), то несложно убедиться, что они по своей сути одинаковы (при этом роль/играет ty , а в качестве временного множителя вместо cos((o/ + б2) выступает е~т% так что стацио- стационарные решения уравнения Шредингера в отличие от других возможных решений, например типа A5), представляют, по- существу, стоячие волны, квадрат модуля которых пропорционален плотности вероятности обнаружения частицы в той или иной точке пространства. Продолжим теперь рассмотрение поведения частицы вблизи ступеньки потенциала. Выберем в качестве начального состояния этой частицы такое, когда В{ = 0, т.е. волна при 36 отрицательных значениях х распространяется слева направо. При таком условии, как показывают соотношения A2), на правой полуоси (для Е > Vo): К -4- ЛС к — ЛС All="iFA" Bn"~irAl- (L218) Поскольку Аи стоит перед экспонентой, отвечающей рас- распространению волны в том же направлении (слева направо), а Вп - перед экспонентой, отвечающей распространению волны в противо- противоположном направлении, то можно сразу же сказать, что после прохождения над барьером-ступенькой возникают волны, распространяющиеся и в том, и в другом направлении, причем соотношение амплитуд этих волн Вп/Ап определяется тем, на- насколько близка энергия частицы к высоте ступеньки Vo: / I— / \2 п. ~ п : ~ / / г? IT7 т/ I 5, 'и + к Vo + yJ2m(E-V0) Vo При Е » VQ |д,« 0, тогда как при Е -» Vo ц —* 1. Если бы у нас была возможность поставить на пути распространения частицы некий фильтр, пропускающий волны только в одном, например положительном направлении, то после прохождения через этот фильтр на правой полуоси амплитуда волны уменьшалась бы и тем больше, чем ближе энергия частицы к ^(происходило бы своего рода частичное "отражение" на ступеньке). Эта конструк- конструкция отчетливо показывает особенность квантовой задачи по сравнению с классической. Эти особенности не менее значительны и тогда, когда частица распространяется с энергией Е « Vo. Как уже было сказано, для такого случая на правой полуоси волновая функция г|)и хотя и имеет экспоненциально затухающий характер, но тем не менее не равна нулю (в отличие от классической картины упругого отражения от стенки): + ijVQ - Е или, если умножить числитель и знаменатель на k - ik, то и =2А\ Е - i V, о-Е) - е -?) X A.2.19) о По мере повышения энергии множитель Vo -E в этих выражениях уменьшается, так что предэкспоненциальный коэффициент 37
стремится к 2АР тогда как экспонента становится все медленнее и медленнее убывающей, т.е. частица может быть обнаружена справа от ступеньки с достаточно большой вероятностью, несмот- несмотря на то, что ее энергия меньше высоты ступеньки. Факт совершенно необычный с классической точки зрения, долгое время изумлявший людей, занимавшихся квантовой механикой (пока к нему не привыкли и не стали рассматривать как должное). Если бы у нас была не ступенька, а потенциальный барьер типа изображенного на рис. 1.2.За или б, то, очевидно, что частица при энергиях, меньших VQ9 могла бы пройти с определенной вероятностью под барьером и далее при х > х{ двигаться свободно в положительном направлении осид:. В этих случаях часто говорят, что частица может "просочиться под барьером", или "туннели- ровать через потенциальный барьер". Вероятность туннелирова- ния сильно зависит от массы частицы: при одной и той же высоте барьера Vo и одной и той же энергии Е экспоненциальный множитель для протона в примерно V1840 » 43 раза больше такого же множителя для электрона, что означает, что его волновая функция существенно быстрее затухает под барьером, чем у электрона. Барьер, под которым электрон проходит без труда, оказывается практически непроницаемым для других, более тяжелых частиц. г. Нормировка волновых функций. Для задачи о потенци- потенциальном ящике с бесконечно-высокими стенками у нас не возни-кало проблем с интерпретацией квадрата модуля волновой функции, как плотности вероятности обнаружения частицы в том или ином месте пространства, поскольку интеграл от \\\>\2 на отрезке [-L/2, L/2], равный вероятности достоверного события (найти частицу в ящике), был равен конечному числу, так что функция я|> могла быть нормирована на единицу. Иное дело - функции, полученные для задачи со ступенькой. Так, квадрат модуля функции \\)Y равен |^j|2 = |А,|2 + \В{ 2 + 2 lAJ-l^l cosBkx + 5), где 5 есть фаза комплексного числа Аф{. Интеграл от этой функции по всей области изменения переменной от -оо до О расходится (независимо от того, равен или нет коэффициент Ву нулю, рассматривается ли случай Е > VQ или Е s Vo). Следова- Следовательно, здесь уже видеть в |i^j|2 плотность вероятности без каких- либо дополнительных оговорок нельзя. Возникает естественный вопрос: как сохранить исходную интерпретацию квадрата модуля волновой функции в этих задачах? Чтобы ответить на него, целесообразно обратиться прежде всего к физической сути задачи. Очевидно, что любая реальная задача имеет дело с ограниченным объемом, в котором находится частица. Часто границы находятся достаточно далеко, положения мы их не знаем точно, и они не должны существенно сказываться на результатах. Тем не менее, границы есть, а это означает, что можно всегда поместить частицу в очень большой потенциальный ящик, на дне которого могут быть ступеньки, барьеры и тому подобные неровности, однако области их локализации существенно меньше размера ящика L. Волновые функции, отвечающие стационарным состояниям, в таких задачах обладают интегри- интегрируемым квадратом модуля, т.е. они могут быть нормированы. В то же время по мере увеличения L они должны приближаться к тем функциям, которые отвечают непрерывному набору значений ?, т.е. к функциям непрерывного спектра. Несколько иной взгляд, хотя и ведущий по существу к тем же результатам, заключается в том, что каждое квантовое со-стояние одной частицы или системы частиц каким-то образом создается, приготавливается в определенный момент времени, скажем при t = 0. В этот момент времени система, очевидно, должна быть ограниченной в некоторой области пространства, локализованной. Локализация может быть большей или меньшей, однако наиболее важным с рассматриваемых позиций является то, что вероятность обнаружения системы в некотором конечном объеме практически равна вероятности достоверного события, т.е. единице. Другими словами, начальное квантовое состояние системы \\)(х, t = 0) обладает интегрируемым квадратом модуля. Такое состояние может быть описано, например, волновой функцией A6) при условии, что "весовая" функция с(Е) обладает интегрируемым квадратом модуля и не зави- зависит явно от времени t. Последнее условие не является на самом деле обязательным, однако для большей наглядности выкладок нам его пока целесообразно сохранить. Выпишем интеграл от квадрата модуля г^, задаваемой выражением A6), по всей области изменения переменной: со N2 = = f\4i\ -со со = J dx Jc\E')x\,\x;E')eiE''dE'][fc(E)x\,(x;E)e-iE'dE] -СО Меняя в последнем выражении порядок интегрирования (в предпо- предположении, что все необходимые для этого условия выполнены), 38 39
приходим к следующему равенству: N2 =jjdE'dEc*(Ef)c(E)ei(E''E)t(fdja\)*(x;E')x\)(x;E)y A.2.20) Интеграл, заключенный в скобки, отвечает в случае задачи с достаточно большим ящиком нормировочному интегралу для вол- волновой функции ty(x; Е), а при Е'* ?, т.е. при ri* n этот интеграл обращается в нуль. Постараемся сохранить такое свойство рас- рассматриваемого интеграла в общем случае, положив Гогф (х;Е )ty(x,E) = o(E -Е), A.2.21) причем функция Ь(Е' - ?), называемая 5-функцией Дирака, обла- обладает двумя на первый взгляд простыми свойствами: а) Ь(Е' - Е) = 0 при Е' * Е; Е2 б) CdE' f(E')b(E'-E) = f(E), если ? принадлежит отрезку [Ev E2], и равен нулю, если Е этому отрезку не принадлежит. Полученная при таком подходе нормировка функции \\)(х; Е) назы- называется нормировкой на 6-функцию. Соотношение B0) при этом переходит в следующее: ¦ =JfdEfdEc*(E')c(E)ei(Ef-E)tb(Et-E)=fdE\c(E)\2. A.2.22) Коль скоро по исходному построению последний интеграл конечен, то для нормировки всей функции Ч* достаточно потребовать, что- чтобы вместо исходной функции с(Е) в интеграле стояла функция c(E)/N , отличающаяся от исходной лишь числовым множителем. Без сомнений, нормировка на 5-функцию пока что выглядит довольно формальной процедурой. Потребовались годы для того, чтобы обосновать существование 5-функций, построить последо- последовательности обычных функций, стремящихся к 5-функциям, показать, каковы свойства 5-функций помимо уже упомянутых и т.д. Эти конструкции привели к обобщению обычного понятия функций и к введению представлений о так называемых обобщенных функциях. Нам пока нет смысла заниматься всеми этими проблемами, ибо они нас уведут в сторону от основных вопросов. По этой причине будем просто полагать, что такие функции существуют и что нормировка на них может быть осуществлена, например при предельном переходе от некоторых, достаточно больших, но конечных пределов интегрирования к бесконечным пределам. 40 Так, для свободной частицы решениями уравнения Шредин- гера будут следующие: Возьмем частные решения при В = 0: <р =Akeikx. Интеграл от произведения \\)*(х; E')ty(x; E) двух таких функций на конечном отрезке от -L до +L будет иметь следующий вид: L L f*(E\E)= J V (х;Е'Жх;Е)с1х = Ак.Ак fel{k~k>)xdx = -L -L s'm(k-k')L к-к' В этом выражении величины Ак.и Ак- конечны и постояны, тогда как функция sin(k - k')L/(k - к') имеет вид, изображенный на рис. 1.2.4. По мере увеличения L точки пересечения ее с осью абсцисс стягиваются к нулю, а высота основного пика растет пропорци- пропорционально L. К тому же известно, что интеграл от этой функции, например по к, равен конечной величине: о к- = / -k'L к' sin/ t dt- f -k'L sint , n\ ill t 00 • . sin/ 0 l dt 0 = / -k'L sin/ M t К 2 [при интегрировании введена замена переменной: t = (к- k')L]. Это позволяет отождествить функцию /(?', Е) с 5-функцией, умно- Рис. 1.2.4. Функция/^ s\n(k'-k)L/(k'-k). 41
женной на числовой множитель, определяющий в конечном итоге нормировку функции \\)(х; Е). Отметим, что сводка основных формул, определяющих свойства 5-функций, дана в Приложении 2. Задачи 1. Найти собственные значения и волновые функции для частицы, если она находится в потенциале, заданном следующими соотношениями: а)прил:<0 V= 00; при 0 <,х <,L К= 0 и прил: > Z. V=Vo>0; б) при |х| > L/2 V= 0; при -L/2 <; х s +L/2 V = -VQ < 0; в) при \х\ > L/2 V=0;npu-L/2*x*+L/2 V=Vo>0. 2. Для частицы в яме с бесконечными стенками найти средние значения операторов хр, рх, х2р и р2х. §3. Математический аппарат квантовой механики Операторы, отвечающие физическим величинам, должны удовлетворять ряду требований, которые следуют как из общих физических соображений, так и из тех постулатов, которые были сформулированы в §1. а. Линейность операторов. Общий вид тех операторов, которые были введены выше, показывает, что эти операторы являются линейными. Линейность оператора означает, что дей- действие его на сумму двух функций приводит к сумме двух функций, каждая из которых есть результат действия этого оператора на каждую отдельную функцию исходной суммы: l°.Z,(qp + \\)) =Ly + L\\) A.3.1а) и, кроме того, 2°. ?аф = <xLii>, A.3.16) где a - произвольное число. Иногда оба свойства записывают в общем виде: Z,(c,cp + с2\\) ) = c{Lq) + c2L\\), A.3.2) где с, и с2 - числовые коэффициенты. Линейность оператора Гамильтона носит весьма фунда- фундаментальный характер: поскольку уравнение Шредингера в этом случае также является линейным, это позволяет вводить норми- нормировку волновых функций (за счет умножения на число а). Кроме 42 того, если ф и \\) -два решения временного уравнения Шредингера, то любая их линейная комбинация Ч* = с}ф + c2ty также будет являться решением этого уравнения, и коль скоро у нас нет критериев, какие из этих решений не отвечают физической картине мира (кроме очевидного условия конечности волновой функции), то с самых ранних этапов создания и развития квантовой механики в ней было введено утверждение, носящее постулативный характер и получившее название принципа суперпозиции: если ф и \\) — волновые функции двух физически реализуемых квантовых состояний, то всегда можно создать такие начальные условия, при которых произвольная линейная комбинация этих функций будет волновой функцией физически реализуемого квантового состояния. Принцип суперпозиции и требование линейности операторов квантовой механики, отвечающих наблюдаемым физическим вели- величинам, весьма родственны, хотя и не тождественны. Далее мы будем широко использовать свойство линейности, тогда как прин- принцип суперпозиции будет играть роль некоторой исходной посылки. б. Эрмитовость операторов. Как уже говорилось в § 1, среднее значение физической величины, которой отвечает опера- оператор А, в состоянии ty определяется выражением < а > = f\\)*A\\)dx = < где интегрирование ведется по всей области изменения простран- пространственных переменных, от которых зависит функция ty. Это среднее значение наблюдаемой, очевидно, должно быть вещественным, так что < а >* = f\\)(A\\)) dx = < А\\)\\\) > = < а > . Используемые в квантовой механике операторы, все средние значения которых вещественны, называют эрмитовыми, или самосопряженными, хотя эти два термина имеют несколько различный смысл в математике (см. заключительный пункт настоящего параграфа). Эрмитовость оператора можно определить и следующим образом: линейный оператор А эрмитов, если для любых двух функций ф и \\) выполнено соотношение ф > = < гр|Аф > = < Аг^|ф > = < фА|г^ > . A.3.3) Следовательно, эрмитов оператор может переноситься от символа второй функции (т.е. ф) в обозначении скалярного произведения к символу первой функции (т.е. Ц)). При этом скалярное произведение переходит в комплексно-сопряженное исходному произведению. 43
Доказательство соотношения C) достаточно просто. Если обозначить <о^|А|г^> через а{9 и <ф|А|ф> через av то для функции, например, Ч* = ty + Хф, где 1|)иф заданы, а к - произвольное, в общем случае комплексное число, то будем иметь: a = Перейдем к комплексно-сопряженному выражению, помня, что а = а - вещественное число (как ах и а2): а =а* = а* + \к\2а = а | и возьмем разность двух полученных соотношений для а: О = А,(<ф|А|<р> - <Ая^|ф>) + Х*(<ф|А|-ф> - <Аф|г^>). Поскольку это соотношение выполняется при произвольных к9 в частности, при к = 1 и при к = /, то оба выражения в скобках по отдельности должны равняться нулю: <я^|А|ф> = <Аг^|ф> (= <ф|Аг|»*) и <ф|А|г^> = <Аф|г^> (= <ф|Аф>*), что и доказывает соотношение C). Непрерывные функции, обладающие интегрируемым квад- квадратом модуля, примечательны тем, что на бесконечности они должны стремиться к нулю. Для таких функций эрмитовость операторов квантовой механики может быть проверена непосред- непосредственно. Так, если ф и яр -две функции в трехмерном пространстве, а Рх =-ihd/dx - оператор компоненты импульса по оси х9 то * интеграл Jф px\\)dxdydz можно преобразовать в соответствии со следующей цепочкой равенств: Ф JC=oo dydz + дх tydxdydz = Ф \\)dxdydz = Здесь было использовано интегрирование по частям и учтено то, что произведение <р ty при х = ±оо обращается в нуль. Не каждый оператор, получаемый простой подстановкой в классическое выражение операторов координат и импульсов, будет 44 эрмитовым. Простейший пример - классическое выражение хрх. При подстановке в это выражение соответствующих операторов получим, например, для среднего значения на функции < ф| хрх | ф > = f ф С другой стороны, пользуясь тем, что операторы х ирх - эрмитовы, и последовательно переводя их в левую часть угловых скобок, придем к равенству В правой части этого равенства оператор импульса действует на произведение д:ф*, что можно записать так (опуская пока множи- множитель -ih)\ д(ху*) дх . dw — ф* +JC—- * = ф* дх = ф дх дх )ф дх дх Следовательно, </?хд:ф|ф> = <(-ih + хр )ф|ф> = *" х Если бы в правой части последнего равенства не было слагаемого /й<ф|ф>, то оператор хрх удовлетворял бы определению эрмито- вости C). Однако это слагаемое есть, и оно обязательно не равно нулю. Поэтому оператор хрх не является эрмитовым. В оператор- операторной форме полученное соотношение можно написать так: хр ~ р х = ih. В таких случаях говорят, что операторы х ирхне коммутируют, а их коммутатор хрх - рхх9 обозначаемый как [jt, px]9 равен ih. Для двух произвольных линейных операторов А и В коммутатором называют оператор С, определенный соотношением С = АВ~ВА. A.3.4) (Отметим, что коммутатор, поделенный на ih, часто называют квантовой скобкой Пуассона для операторов А и В). Если ком- коммутатор С равен нулю, то говорят, что операторы А и В коммутируют. Очевидно, произведение двух эрмитовых операто- операторов также будет эрмитовым оператором только в том случае, когда эти операторы коммутируют. Если операторы не коммутируют, то из исходного класси- классического выражения для физической величины надо построить такой оператор, который будет обладать свойством эрмитовости. Так, в вышеприведенном примере каждый из операторов хр и/^х, взятый отдельно, не эрмитов, однако, как легко проверить, их полусумма, отвечающая тому же классическому выражению, - 45
эрмитов оператор. При переходе от классических выражений к квантовомеханическим операторам за этим обстоятельством надо тщательно следить. в. Собственные функции и собственные значения. Если оператор Л переводит функцию \\) в функцию, отличающуюся лишь числовым множителем A.3.5) то говорят, что эта функция есть собственная функция оператора А, а числовой множитель К - собственное значение этого оператора на функции ty. Примеры: 1. При поворотах Cz(a) в трехмерном простран- пространстве R3 вокруг оси z на произвольный угол а любой вектор, направленный по оси z, не меняется, т.е. переходит в себя. Следовательно, он является собственным для таких операторов поворота вокруг оси z с собственным значением, равным 1. При отражении а в плоскости ху каждый из этих векторов умножается на -1, тогда как любой вектор (л:, у, 0), лежащий в плоскости ху, при этом не меняется: ох @, 0, г) - -Г@, 0, г) и ох (х, _у, 0) = = 1 "(л:, у, 0), так что такие векторы являются также собственными для оператора ох (выше символ (x,y,z) обозначает вектор с декартовыми компонентами х, у и z соответственно). 2. Пусть заданы функции двух переменных f(xv x2), например / = х^х2- При перестановке местами переменных х] и х29 что можно представить себе как результат действия (линей- (линейного) оператора перестановки Рх 2, функции Дх9 х2) переходят в новые функции g(x],x2) s f(xv хх), в указанном примере - в функциюх-[Х2 • Попробуем найти такие функции/, которые были бы собственными для Р 0: Р / = X/. Подействуем на правую и левую части равенства еще раз оператором Рх 2: Рх 2(РХ 2f) = = 'k(Px ^f). Полученное соотношение показывает, во-первых, что функция g = Рх 2/ наряду с /также является собственной для оператора Р (что, конечно, достаточно тривиально). Оно, во- вторых, показывает, что (Р, 2Р} 2)f = k2f и, поскольку Р^ 2РХ 2 ничего не меняет в функции/(так называемая единичная операция), то X2 = 1. Следовательно, если у Рх 2 есть собственные функции, то собственные значения для этого оператора на таких функциях равны ±1. Собственное значение +1 означает, что функция/не меняется при перестановке переменных х1 и xv т.е. такая функция является симметричной (или, что то же, полносимметричной) относительно 46 перестановки переменных хх ихг Так, в приведенном выше случае х^х * x\xv тогда как сумма х\х + х\хх при перестановке Рх 2 не меняется, т.е. она является полносимметричной. С другой стороны, разность х\х-х\хх при перестановке Р{ 2 меняет знак, т.е. она также является собственной для оператора Рх 2, но уже с собствен- собственным значением -1. Такие функции называют антисимметричными относительно перестановки Рх Т 3. Найдем теперь функции \\), собственные для оператора импульса/*^ ~^%jr: - ifi дх Решения такого дифференциального уравнения первого порядка для одномерного случая имеют вид \\)(x,k)= Aeikx/\ A.3.6) где Л - произвольная постоянная, а собственное значение к может принимать любое значение на вещественной числовой оси. Эта величина имеет смысл постоянного импульса свободной частицы, движущейся вдоль осид:. В трехмерном случае собственной функцией для операто- операторов рх, р и pz будет следующая: ikr/ Akeikr/\ A.3.7) где г - радиус-вектор частицы, а к - так называемый волновой вектор из собственных значений операторов ра (а = д:, у9 г), т.е. из к , к и к . 4. Наконец, еще один пример, который был фактически рассмотрен выше: если потенциал для квантовой системы явно от времени не зависит, то волновую функцию, являющуюся ре- решением уравнения Шредингера, можно записать в виде произведе- произведения двух сомножителей, из которых один зависит только от времени, а другой (функция Ч*) - только от пространственных переменных. Сомножитель Ч* является решением стационарного уравнения Шредингера представляющего собой не что иное, как уравнение на собственные значения. Собственные значения оператора Гамильтона Н в общем случае могут относиться к дискретному спектру (задача пре- предыдущего параграфа о частице в потенциальном ящике с бесконеч- 47
,J „! но высокими стенками) и к непрерывному, или существенному спектру, где собственное значение Е может принимать любое зна- значение, например из интервала [0, оо). У одной и той же задачи могут быть такие области изменения ?, где имеется только дис- дискретный спектр, и такие, где имеется непрерывный спектр, который в физике часто называют также сплошным. Характерной особенностью функций дискретного спектра является наличие у них интегрируемого квадрата модуля, т.е. эти функции могут быть нормированы на единицу. Коль скоро интеграл по всему пространству переменных, от которых зависят такие функции, сходится, то очевидно, что при стремлении переменных к бесконечности плотность вероятности должна стремиться к нулю, причем достаточно быстро, так чтобы интеграл <Ч/|Ч/> не расходился. Задача со "ступенькой" из предыдущего параграфа показывает, что если при х —* оо разность Е - V(x) < О при всех д:, то волновая функция будет стремиться к нулю по закону е-**, где X - некоторая положительная постоянная. Другими словами, волновая функция экспоненциально затухает. Если потенциал произвольной квантовой системы при стремлении пространственных переменных к бесконечности стремится к некоторому конечному значению К(оо), то приЕ < К(оо) у волновой функции будет наблюдаться такого же типа экспонен- экспоненциальное затухание, а если одновременно и Е < V(-oo), то у системы будет дискретный спектр. В противном случае, если Е больше хотя бы одного предельного значения, то, как правило, у системы появляется непрерывный спектр. Непрерывный спектр характерен и для задач с периодическими потенциалами, задан- заданными во всей области изменения переменной х (такие потенциалы обычны при рассмотрении задач о твердом теле). Правда, для многомерных задач положение может оказаться не столь простым, однако на подобных, более сложных, ситуациях мы пока останав- останавливаться не будем. Будем лишь считать, что функции дискретного спектра нормируемы на единицу, тогда как функции сплошного спектра всюду ограниченны и нормируемы на 5-функцию. г. Ортогональность собственных функций эрмитовых операторов. Пусть теперь у некоторого эрмитова оператора А имеются две собственные функции г^ и \\J с разными собствен- собственными значениями а и а2 соответственно. Рассмотрим сначала интеграл вида A.3.8) Воспользовавшись эрмитовостью А, можем далее написать Коль скоро левые части в этих цепочках равенств одинаковы, должны совпадать и правые части, что вполне определенно свиде- свидетельствует о том, что а должно быть вещественным. По сущест- существу, этот результат у нас уже был получен в п. ?, где речь шла о средних значениях вида <гр | А \\\)>. Равенство (8) к тому же показывает, что если функция г^, (или г^2) нормирована на единицу, среднее значение оператора А на такой (собственной для него) функции равно собственному значению. Перейдем теперь к интегралу, включающему обе функции: <Ц№\Ц2>*{Ч>\АЧ>2<Ь = а2{\\)]\\J<1т. A.3.9) Такой интеграл в общем случае для произвольных функций гр, и г^2 носит название матричного элемента оператора А на этих функциях. Поскольку оператор Л эрмитов, опять-таки можно далее преобразовать интеграл (9): Но а как собственное значение эрмитова оператора вещественно. Сравнивая правые части (9) и этой последней цепочки, приходим к равенству: Если а2 * av то это равенство будет выполняться только при условии <tyx \ty2> ~ 0. Две функции, удовлетворяющие такому соотношению, называются (взаимно) ортогональными. Следова- Следовательно, собственные функции эрмитова оператора, принадлежащие различным собственным значениям, должны быть ортогональны. Пусть теперь две собственные функции фИ1|) эрмитова оператора Л принадлежат одному и тому же собственному зна- значению, например а (в этом случае говорят, если, конечно, эти функции не пропорциональны друг другу, что это собственное зна- значение двукратно вырождено). Тогда воспользоваться теми же рассуждениями, что и приведенные выше, уже нельзя. Однако можно вспомнить, что эрмитов оператор линеен. Если взять вместо функций ф и \\) их линейную комбинацию с,ф + с2\\), то при действии на эту комбинацию оператора Л без труда можно установить, что 48 49
¦Si Ш: она также является собственной для А с тем же собственным значением а\ Л(с,ф + c Запишем интеграл i ¦ + с2\\)> = с1 и подберем коэффициенты с] и с2 так, чтобы правая часть этого равенства обратилась в нуль. Ради простоты при этом будем предполагать, что функция ty обладает интегрируемым квадратом модуля. Следовательно, с2 можно выбрать равным -| Тогда новая функция Ф = с,ф + сл\) = с,(Ф - 1 будет собственной для А с собственным значением а и, кроме того, ортогональной t^, так что вместо двух исходных функций ф и \\) можно взять без потери общности эквивалентный им набор двух линейно независимых функций \\) и Ч*, которые уже являются взаимно ортогональными. Таким образом, собственные функции эрмитова оператора всегда можно считать взаимно ортогональными, независимо от того, принадлежат ли они разным или одинаковым собственным значениям. Для дискретного спектра они к тому же могут быть выбраны нормированными на единицу. Средние значения опера- оператора А на таких функциях, как уже было сказано, равны соответ- соответствующим собственным значениям А на исходных функциях. д. Полнота системы собственных функций эрмитова оператора. В задаче о потенциальном ящике с бесконечно высокими стенками мы получили собственные функции п v т — т | * + —], я = 1, 2, ... (-L/2 <,х sL/2), A.3.10) которые при таком выборе постоянного множителя перед синусом нормированы на единицу и, как нетрудно убедиться, взаимно ортогональны. Ради простоты дальнейших рассуждений сместим начало отсчета для координаты х на L/2 влево, т.е. поместим начало отсчета у левой стенки потенциального ящика. Тогда функ- функции Ч^ перепишутся так: л- 1,2, ... (OsxsZ,), A.3.11) Эти функции на концах отрезка [О, L] обращаются в нуль. Хорошо 50 известно, что любую функцию Дх), заданную на конечном отрезке [0, L] и удовлетворяющую условию ДО) =f(L)9 можно представить в виде ряда Фурье: 00 ПК х. /1=1 Если ДО) = 0, то а0 = 0, так что любую такую функцию можно записать в виде ряда по собственным функциям 00 A.3.12) Следовательно, для всех возможных линейных комбинаций (в том числе и с бесконечным числом членов) функции Ч*л(х) образуют своего рода базис, в котором и записываются эти линейные комбинации. По аналогии с обычными векторными пространствами (например, в трехмерном случае, когда любой вектор b записы- записывается в виде (Ы + bj + bk), функции Ч'Дх) называют базисными, либо говорят о них как о базисных векторах (по своей роли аналогичных векторам i, j и к, только в бесконечномерном пространстве). На этом языке формула A2) интерпретируется следующим образом: все возможные (конечные или бесконечные) линейные комбинации базисных векторов W (х) образуют линейное пространство &г в котором любой вектор/(х) может быть представлен в виде A2). Для нахождения коэффициентов Ьп, определяющих заданную функцию Дх), можно поступить следующим образом. Умножим обе части равенства A1) слева на Ч^(х) и проинтегрируем по х от 0 до/,: оо 0 п=\ Коль скоро функции Ч^ ортогональны и нормированы (т.е. орто- нормированы), то <4fj4fn> = 6жя, где bmn - символ Кронекера. Учитывая это обстоятельство, сразу же находим: b = п так что со A.3.13) Система любых функций 4>л(х), п = 1, 2, ... называется полной, если произвольная функция из рассматриваемого пространства, например ?2, допускает представление в виде ряда A3). При этом 51
само пространство -8, включает все функции, обладающие интегрируемым квадратом модуля (отсюда индекс 2 у символа &,) и удовлетворяющие граничным условиям ДО) = f(L) = 0. Можно показать, что любой эрмитов оператор А обладает полной системой собственных функций, так что любую волновую функцию квантовой системы частиц можно представить в виде ряда по собственным функциям такого оператора. Если у оператора А есть наряду с дискретным также и непрерывный спектр, то такое разложение в ряд приобретает несколько более сложный вид: A.3.14) п сумма берется по всем собственным функциям Ч* дискретного спектра, нумеруемых индексом п, а интеграл - по всем функциям Ч*? непрерывного спектра. е. Замечание. В квантовой механике волновые функции обычно считают принадлежащими гильбертову пространству ф, под которым в функциональном анализе подразумевается следующее (см. также "Краткую вспомогательную сводку..." перед гл.1). Во-первых, это линейное пространство, т.е. в нем определены операции сложения и умножения на действительные или комплексные числа. А во-вторых, в ф введена числовая функция <г|^|ф> от пары элементов г|) и ф, называемая их скаляр- скалярным произведением и удовлетворяющая следующим аксиомам: 2 , 2. для любого числа а: < 3. <гр|ф> = <ф|г^>* ; 4. <гр|г^> > 0 при \\) * 0; = 0 тогда и только тогда, когда Скалярное произведение для волновых функций определяется уже не раз использованным интегралом: <ф|г|>>= ftp* tydx-, где — со интегрирование ведется по всей области изменения переменных, от которых зависят волновые функции. Скалярное произведение функции ty на себя определяет ее норму ||г^|| = <\\) |гр>1/2, а "расстояние" между двумя функциями \\) и ф полагается равным р(\\), ф) = <ty — Ф |хр — Ф>1/2. (Помимо двух указанных выше требований, для гильбертова пространства часто вводят и третье: это пространство должно быть полным в том смысле, что для любой сходящейся последовательности Коши его векторов, т.е. функций \\), предел существует и принадлежит этому пространству). Эрмитовым оператором А в гильбертовом пространстве называется оператор, для которого <гр|А|гр> = <Агр|гр>. Если этот оператор является к тому же и ограниченным (т.е. таким, для которого отношение \\A\\) || / ||г^ || ограничено при любой функции из ф), то он называется самосопряженным. У самосопряженного оператора все собственные значения ограничены. В квантовой механике, особенно при первоначальном ее построении, понятия самосопряженного и эрмитова оператора не различают: при первом знакомстве можно не делать различий между гильбертовыми и конечномерными пространствами. Тем не менее, эти различия есть. Например, не все собственные функции эрмитовых опера- операторов, определяемые как решения соответствующих уравнений на собственные значения, в общем случае принадлежат гильбертову пространству. Поэтому приходится переходить к некоторым более общим конструкциям, называемым оснащенными гильбертовыми пространствами, в которых системы собственных функций эрми- эрмитовых операторов полны. Обсуждать подобные конструкции мы не будем, ограничившись лишь указанием на необходимость их введения при строгом построении теории квантовой механики. Задачи 1. Убедиться, что операторы координаты х, импульса/;^, момента импульса Lx, а также их квадратов х2, р2 и L2 линейны; показать, что оператор перестановки Р{ 2 также линеен. 2. Пусть в классической функции Гамильтона для одной ¦ 2 2 частицы встречаются слагаемые хрх и хру . Как построить отвечающие им квантовомеханические операторы, которые являются эрмитовыми? 3. Найти следующие коммутаторы: [х, р ], [х, р ], [х2, р ], [*AJ [*L] \PL] \PLUpIAY " §4. Матричное представление операторов о. Разложение по базису. Функция ф, которая получается при действии линейного оператора А на некоторую функцию гр: ф = = А\\), предполагается обычно принадлежащей тому же простран- пространству & что и исходная функция ty. Если в этом пространстве 52 53
выбрать базис, например из собственных функций х, эрмитова оператора В: то обе функции, фИ1|), можно разложить в ряд по функциям х,: 00 00 A.4.1) так что будет справедлива последовательность равенств: 00 00 00 Jfc-1 i-1 i-1 Умножим слева обе части равенств на х^ и проинтегрируем по всему пространству изменения переменных. Тогда с учетом ортонормированности базисных функций хк, собственных для оператора В, получим: 00 т = 12 ) A.4.2) i-1 так что коэффициенты \хт разложения функции ф определяются коэффициентами Kt разложения исходной функции и интегралами Ат. = <хт\А\х>, которые, как уже говорилось, называются матрич- матричными элементами оператора А (в базж з функций х,)- Задание матричных элементов А полностью определяет результат действия оператора А на произвольную функцию яр рассматри- рассматриваемого пространства. Если бы пространство, в котором определен базис из функций х,, было конечномерным, например / = 1,2, ..., М, то числа Ат. образовали бы обычную квадратную матрицу с номерами строк, определяемыми индексом w, и номерами столб- столбцов, определяемыми индексом i. В этой записи матрица А опера- оператора А имеет вид: А 12 А 2\ . . . /х 2М А А А \^М\ ^М2 •** ММ A.4.3) В общем случае ?2 бесконечномерно, так что матрица А также имеет бесконечное число строк и столбцов. Запись функций фит|)в виде рядов A.4.1) предполагает, что базисные функции относятся к дискретному спектру. Можно 54 было бы написать вместо эти рядов более общие выражения, включающие интегралы по функциям непрерывного спектра, однако ни здесь, ни далее делать этого не будем, чтобы не загромождать текст; лишь тогда, когда такая запись потребуется специально, будем выписывать все необходимые слагаемые. Возвращаясь вновь к соотношениям B) для конечного числа измерений, мы можем написать не только числа <хт\А\х> в виде матрицы, но и представить коэффициенты \хт и "кг в виде векторов-столбцов М) A.4.4) что позволяет переписать B) в весьма компактном матричном виде: [I = АХ. A.4.5) Векторы ц и к в общем случае, как и матрица А, беско- бесконечномерны. Вектор-столбцы D) и матрица C) полностью определяют функции ф и \\), а следовательно, и переход от \\) к ф с помощью оператора А. Эти векторы и матрицы носят название матричного представления функций и операторов в базисе функций х • Мат- Матричное представление позволяет перейти от тех или иных операций над функциями к простым операциям сложения и умножения, выполняемым с этими матрицами. Кроме того, оно позволяет выделять из всей матрицы определенные блоки, приближенно представляющие всю эту матрицу, если, например, остальные матричные элементы малы и ими на начальном этапе рассмот- рассмотрения задач можно пренебречь. б. Потенциальный ящик. Попробуем в качестве примера найти матрицы, представляющие операторы координаты х и импульса . для задачи о потенциальном яшике с бесконечно высокими стенками. Используя волновые функции для этой задачи, выписанные в п. б § 2, можно вычислить и матричные 55
элементы. Для оператора координаты они будут следующими: 1 "> L 'гои \ . /ли \ , х\ л: sin —х\ dx = L I О = — f JCCOS / J ^ 0 (к(т'п) \ 0 dbc г jccos 0 is- ' к(т + п) ^ dx, где использовано соотношение 2sinasin|3 = cos(a - C) - cos(a + P). Интегралы Jjc cos kx dx = — f jc d(sin Xjc) можно взять по частям, что приводит к соотношениям (т * п)\ 8L тп у, если т - п нечетно, и хтп я (w - /z) (m + /г) тп =0, если т - п четно Кроме того, х = LI2. Следовательно, матрица X оператора mm координаты будет иметь вид: 1 2 16 9л2 0 32 225л2 16 9л2 1 2 48 25л2 0 и 48 25л2 1 2 96 49 л2 32 \ 225л2 ГУ и 96 49 л2 1 2 A.4.6) Аналогично можно найти и матрицу оператора импульса .*. 4 тп / ч , если w - /z нечетно, и ( ог ) = 0, если т - п тп 2 2 mL -n четно, в том числе при т =п\ р = -т L О 2/3 0 4/15 -2/3 0 6/5 О О -6/5 0 12/7 A.4.7) 56 Зная эти матрицы, можно сразу же сказать, что будет полу- получаться при действии оператора координаты или импульса, а также различных их произведений на произвольную функцию, Заданную на отрезке [0, L] и обращающуюся в нуль на концах его. Так, собственной функции \\){ отвечает вектор из коэффициентов X, у которого лишь первая компонента равна 1, а все остальные равны 0. Следовательно, при действии на яр оператора координаты получается функция ф = i •> У которой коэффициенты ц. определяются матрич- i—1 ными элементами х матрицы X: 2 16L 32L A.4.8) Эти выражения нам потребуются в дальнейшем при рассмотрении переходов между различными состояниями частицы в потен- потенциальном ящике. в. Матрицы эрмитовых операторов. Соотношение, определяющее эрмитовы операторы при записи его для базисных функций tym и tyn приводит к тому, что А = <\\) А \\) > = <А\\) \\\) > = <\\) \A\\i) >* = А* . Следовательно, матрица А является эрмитовой: при переходе одновременно к транспонированной и комплексно-сопряженной она не меняется (ат)* EAf=A. A.4.9) Это обстоятельство позволяет нам сразу же воспользоваться всем тем богатым арсеналом средств и результатов, который накоплен в теории матриц для эрмитовых, или самосопряженных матриц, по крайней мере в тех случаях, когда оператор может быть представлен в базисе конечной размерности (например, в том или ином приближении). В частности, известно, что эрмитов оператор в /г-мерном пространстве имеет п собственных векторов с. (/' = 1, 2, ..., я), которые можно записать в виде вектор-столбцов: Ас, = а, с.. A.4.10) Собственные значения а% матрицы А вещественны, а собственные векторы взаимно ортогональны: cjcy- = 0 при /' *j. К тому же они 57
всегда могут быть нормированы на единицу: cfc,- =1. Если последовательно выписать вектор-столбцы с. в виде строки (с,, с2, ..., сл), то получится квадратная матрица С. Умножим эту матрицу слева на матрицу А. Тогда по классическому правилу "строка на столбец" в полученной матрице на месте столбца с получится столбец Ас,, т. е. каждый столбец с. умножится на соответствующее число а.: АС = (я^, а2е29 ..., алсл), а это в свою очередь будет означать, что матрица С умножится справа на диа- диагональную матрицу а, составленную из собственных значений а: АС = Са. A.4.11) Поскольку столбцы матрицы С взаимно ортогональны и нормиро- нормированы на единицу, эта матрица неособенная и более того - унитарная (либо ортогональная, если А - вещественная): С*С = I, что в конечномерных пространствах означает и справедливость ра- равенства СС* = I. Умножая соотношение A1) на С1" слева, придем к выражению CfAC = a, показывающему, что эрмитова матрица А может быть преобразо- преобразованием базиса с помощью унитарной (ортогональной) матрицы С сведена к диагональному виду. В зависимости от того, какая система базисных функций выбрана, оператор А будет представляться различными матрицами, однако у всех этих матриц собственные значения будут одни и те же. г. Коммутирующие операторы. Возьмем два каких-либо эрмитовых оператора А и В, которые коммутируют: АВ = В А. Например, для одной частицы в трехмерном пространстве таковыми являются операторы х иу,х ир , л; и lx-yp - zp и др. Пусть далее г^, - собственная функция А с собственным значе- значением к}: Aty{ = \tyr Подействуем на левую и правую часть этого равенства оператором В и учтем то, что он линеен и коммутирует с А: ВАцх = Л{В^Х) = ^(Я-ф,). Функция Игр,, как показывает последнее равенство, также есть собственная функция оператора А с тем же самым собственным значением \{, что и исходная. Если данному собственному значению \х принадлежит лишь одна собственная функция ф, (с точностью до произвольного множителя), т.е. это собственное значение является невы- невырожденным, то сформулированное в предыдущем предложении утверждение означает справедливость равенства: 1*ф = \iy , так что функция гр1 одновременно является собственной и для оператора В с собственным значением \i. To же самое можно сказать и о любой другой невырожденной собственной функции оператора Л. Если же некоторое собственное значение X вырождено, то что получится тогда? Вырождение собственного значения означает, что имеется несколько линейно независимых функций xjr, принад- принадлежащих этому собственному значению, которые можно считать к тому же ортонормированными. Будем пока предполагать, что кратность вырождения, равная к (т.е. максимальное число таких линейно независимых функций), конечна: /=1,2,..., к. Поступая так же, как и в невырожденном случае, при действии оператора В найдем: A(Btyt) = ЦВу). Очевидно, Б-ф. - функция, собственная для оператора Л с собственным значением X, но уже не обязательно совпадающая с -ф.. Единственно, что можно утверждать, так это следующее: Ihjj есть линейная комбинация функций, собственных для А с собственным значением X, так что Умножая это равенство слева на xjj,* (/ = 1, 2, ... , к) и интегрируя по всей области изменения переменных, от которых зависят функции xj), а также учитывая ортонормированность этих функций, получим: к 58 >= Следовательно, коэффициенты bn представляют собой матричные элементы эрмитова оператора В в базисе функций тр.. Они обра- образуют эрмитову матрицу В размерности кхк (т.е. порядка к). Вместо исходных функций г^. можно ввести их линейные комбинации к <Pi = 2U^J , A.4.12) от коэффициентов и., которых потребуем, чтобы ф( были линейно независимы, и более того - ортонормированы. Такое условие всегда можно удовлетворить, поскольку независимых соотно- соотношений ортонормировки <ф. |ф > = б будет к(к + 1)/2 [для ортогональности: число сочетаний из к функций по две, что равно к(к - 1)/2; для нормировки: к, тогда как число исходных произвольных коэффициентов и. равно 1с, что при к > 1 всегда 59
больше к(к + 1)/2]. Вводимая таким образом матрица U из коэффициентов иг будет произвольной унитарной матрицей. Для унитарного преобразования характерно то, что матрицей, обратной U,. является U1", т.е. матрица, эрмитово сопряженная U. Следова- Следовательно, у. (и*)*г(и)у = У. u*ikuij = &kj •> что позволяет выразить из A2) tyk через ф; при умножении обеих частей равенства на и*к и суммировании по /: Ук = 2%Ф/ • A.4.13) Подставляя это выражение в матричные элементы оператора В в базисе функций г|^, можно представить их через матричные элементы этого же оператора в базисе функций ср : что в матричном виде запишется следующим образом: и в(ф) = Коль скоро матрица В^ эрмитова, то при соответствующем выборе унитарного преобразования она может быть сведена к диагональной матрице В*ф' с диагональными элементами Ъ. Это в свою очередь будет означать, что базис функций ф представляет собой набор собственных для оператора В функций с собствен- собственными значениями Ь: Bw = b.tp . ^ ¦' J J J Таким образом, коммутация операторов Л и В и в этом случае будет означать, что у них может быть выбрана общая система собственных функций. Все функции ср будут относиться к одному и тому же собственному значению оператора Л, но каждая из них - к вполне определенному собственному значению Ъ оператора В (которые могут хотя бы отчасти и совпадать друг с другом). д. Соотношения неопределенностей. Если операторы не коммутируют, то для них рассуждения предыдущего пункта справедливы уже не будут. Тем не менее, и здесь можно получить ряд весьма полезных результатов, правда уже не для волновых функций и собственных значений, а для средних значений операторов. Итак, пусть АВ - ВА = iC, где, как нетрудно убедиться, оператор С эрмитов, если эрмитовы Aw В: а) {АВ - ВАУ = = ВА-АВ = -(АВ-ВА); б) (/C)t = i* Сравнивая правые части этих равенств с исходным соотношением коммутации, приходим к выводу, что О - С, т.е, С - эрмитов. Возьмем теперь некоторую функцию состояния г^, из которой построим две новые функции: Aty и Дг^, после чего возьмем следующую их линейную комбинацию: + гкЩ = (А + 1'ХЛ)Ц|, A.4.14) где X - вещественный числовой множитель. Очевидно, что j причем равенство нулю выполняется, только если Ч* = 0. Учтем теперь то, что Ч1 имеет вполне конкретный вид A4), и преобразуем данный интеграл: где учтено то, что операторы Aw В- эрмитовы, a i при комплексном сопряжении меняет знак. Произведение операторов под интегра- интегралом может быть записано через коммутатор 1С операторов А и В : 2В2 A2 + Х2В2 +ik(AB - BA)\\)dx = В Это неравенство должно выполняться при любом X. Интеграл при неотрицателен (как и свободный член этого выражения), В2 поскольку = f\Bty\ dx. Квадратный же трехчлен с положительном коэффициентом перед X при любом X может быть неотрицателен только тогда, когда дискриминант соответствующего квадратного уравнения меньше или, в крайнем случае, равен нулю: >2 - >< В 0 Таким образом, >< В 4 A.4.15) Прежде чем двигаться дальше, отметим еще одно обстоя- обстоятельство. Если АВ - ВА = /С, то и (А - аГ)(В - pi) - (В - $1)(А - - а/) = /С, где а и Р - некоторые вещественные числа, а / - единичный оператор, который далее ради простоты выписывать не будем. По этой причине соотношение A4) будет справедливо 60 61
не только для средних значений операторов А2 и В2, но и для средних значений операторов (А - а/J и (В - |3/J. Подберем теперь действительные числа а и |3 так, чтобы величины - aJ\ty> и <ф|(Я- РJ№> были бы минимальны. Поскольку F(a) = <ty(A - a) > - 2а < > + < то требование минимума dFlda = 0 будет означать, что а = т.е. минимум достигается на среднем значении оператора А в состоянии с волновой функцией г^. Будем далее без потери общнос- общности считать, что эта функция нормирована на единицу (в противном случае можно перейти к нормированной функции гр/< гр|гр >V , либо, если функция "Ф относится к непрерывному спектру, ввести нормировку на 6-функцию). Таким образом, минимум левой части в неравенстве A5) также достигается при amin = и min Интеграл <ф[/4|"ф> можно записать следующим образом: >= /1 \ — Ail) \dx = Гф J и, если хр*хр интерпретировать как плотность вероятности обнару- обнаружить частицу в точке г (или систему частиц в соответствующей точке конфигурационного пространства), то функцию Aty /x|j тогда можно той случайной величиной, среднее значение которой мы вычисляем и которая отвечает наблюдаемой физической величине, задаваемой в исходном построении оператором А. Для оператора аналогично можем написать 1 1 1 \ ) "Ф > =< что, по крайней мере для вещественных операторов и функций, приобретает тот же смысл, что и среднее значение оператора А. При таком подходе среднее значение оператора (А - aminJ будет представлять собой дисперсию соответствующей случайной вели- величины, распределенной с функцией плотности вероятности р = 2 Согласно соотношению A5) дисперсии двух физических величин, которым отвечают некоммутирующие операторы А и В, в квантовой механике всегда таковы, что их произведение больше некоторого неотрицательного числа, зависящего от того, каков коммутатор А и В. Другими словами, разбросы значений, или неопределенности в значениях физических величин, характе- характеризуемые дисперсиями DA ий8, удовлетворяют неравенству, называемому соотношением неопределенностей: <(ДАJ ><(АВJ A.4.16) где iC - коммутатор А и В . е. Примеры. 1. Простейший пример двух некоммутирую- щих операторов - канонически сопряженные (т.е. связанные друг с другом уравнениями Гамильтона в классической механике) координата и импульс. Для этих операторов имеем: хр - р х - х\ - iti дх iti — \х = ifil. дх Следовательно, оператор С в этом случае равен hi, так что для нормированных функций <(Дл:J><(Д/ГJ> ;> П2/4 A.4.17) (в атомных единицах справа должна, очевидно, стоять 1/4). Это соотношение часто записывают также в виде AxApx*h/2, A.4.18) а под Ajc и Арх подразумеваются величины <(ДхJ>1/2 и <(АрхJ>и2 соответственно. Поскольку среднеквадратичное отклонение от среднего всегда меньше корня из среднего значения квадрата соответствующей величины (представляемой оператором Л2), то последнее соотношение часто используют для оценки средне- среднеквадратичных значений импульса частиц в достаточно локализо- локализованной системе при использовании в качестве Ах некоторого приближенного "размера" системы: <р2х 2Ах. Например, свободные атомы в основном состоянии локализованы в областях пространства с линейными размерами в несколько десятых нанометра. Если учесть, что h ~ 10 34Джс= 10~34м2кгс~', ,-34 10  «Ю-24-Ю то для атомов < р~х >"" * тмкгс * ~1и "' " i0 25мкгс *¦ 2-10~ш Для электрона, масса которого примерно равна 1030 кг, оценка для линейной скорости его классического движения в атоме получается следующей (если принять v = p]m)\<v\ >^2 ;> 105 -106мс~1 62 63
Отметим, что оценку типа A8) для задачи о движении частицы в потенциальном ящике мы уже получили в п. б §2, не имея еще, как такового, соотношения неопределенностей для координаты и импульса. 2. Еще один простой пример некоммутирующих операторов для одной частицы: оператор координаты, к примеру л:, и некоммутирующий с ним оператор момента импульсаL или Lz: xLy - Lx = x(zpx - xp) - (zpx - xpz)x = z(xpx - px) = itiz , так что оператор С равен hz. Соотношение неопределенностей в этом случае будет иметь вид 2 П у < z> В отличие от того, что было получено для координаты и импульса, здесь правая часть зависит от квадрата среднего значения коорди- координаты г, т.е. от величины, присущей заданному квантовому состоянию частицы. Поэтому подобные соотношения несколько менее популярны, хотя и они подчас позволяют получить полезные выводы. В качестве достаточно тривиального вывода можно отметить, например, тот, что если функция ty, с которой вычисляются все величины в последнем соотношении неопределенностей, собственная для оператора L с нулевым собственным значением, то <z> также должно равняться обязательно нулю. ж. Результаты измерений. Соотношения неопре- неопределенностей в квантовой механике очень часто связывают с разбросом значений, получаемых для физических величин при экспериментальных измерениях. Сама по себе проблема измерений в квантовой теории достаточно сложна, хотя бы уже потому, что измерительные приборы являются макрообъектами, тогда как измеряются величины, относящиеся к микрообъектам. В настоящем курсе у нас нет возможности сколько-нибудь детально входить в эту проблему, а потому мы остановимся лишь на одном из наиболее часто используемых при ее обсуждении подходов (хотя он в целом и не бесспорен). Предполагается, что при воздействии измерительного прибора на микрообъект последний переводится из исходного квантового состояния, описываемого волновой функцией ty, в одно из состояний, собственных для оператора В, который представляет измеряемую физическую величину Ъ. При этом прибор регистрирует отвечающее этому состоянию собственное значение br Вероятность W. перевода 64 исходного состояния (ty) в /-е собственное (ср.) определяется квадратом модуля коэффициента с;в разложении функции ^ по функциям ф; (считая, что совокупность {ф.} представляет собой полный набор базисных функций): 2 Щ A.4.19) i-l При измерении свойства Ъ с вероятностью Wi ос \с.\2 получается результат измерения Ь:. /*ф,= bxpr Если имеется множество систем, каждая из которых нахо- находится в состоянии ty, то при измерении свойств каждой из этих систем собственные значения Ъ будут появляться с вероятностью, пропорциональной |cj2, так что среднее значение физической величины Ъ в состоянии ф будет представлено выражением: - некоторый коэффициент пропорциональности. С другой сто- стороны, если воспользоваться для ^ рядом A9), считая ради просто- простоты, что все функции ф. нормированы на единицу, то можно написать: Ф Сравнивая этот результат с предыдущим равенством, приходим к выводу, что при нормированных базисных функциях, в качестве которых используются собственные функции оператора В, коэффи- коэффициент пропорциональности А равен единице и | с.\2 дает непосред- непосредственно вероятность Wr Этот результат по существу не изменится, если у оператора В все или часть собственных значений относятся к непрерывному спектру. Если же прибор устроен так, что он сразу регистрирует некоторое среднее по множеству отдельных "элементарных" актов измерения, то это среднее должно совпадать с <Ь>. Для такого среднего можно, учитывая вероятностный характер отдельных значений, ввести понятие дисперсии и считать, что те дисперсии, которые фигурируют в соотношении неопределенностей, как раз и имеют смысл дисперсий измерения физических величин для системы, находящейся в квантовом состоянии ty. Поэтому соотношения неопределенностей допускают еще одну интерпре- 3 — 1395 65
тацию: произведение дисперсий для двух физических величин, измеряемых у квантовой системы, которая находится в состоянии ty, всегда больше (одной четвертой) квадрата среднего значения того оператора, который соответствует коммутатору операторов, отвечающих измеряемым величинам. Если эти операторы коммутируют, то результат оказывается тривиальным (дисперсии неотрицательны), а если не коммутируют, как то имеет место для канонически сопряженных величин, то появляется новый элемент: две такие физические величины не могут быть измерены точно в состоянии \р. Даже если это состояние - собственное для одного из операторов (А) и дисперсия оказывается равной нулю, то для другого оператора (В) оно обязательно не будет собственным (операторы А и В не коммутируют), а потому в силу соотношения неопределенностей дисперсия измерения Ъ оказывается беско- бесконечно большой, т.е. при отдельных измерениях могут получаться любые результаты. Так, в состоянии, в котором точно определен импульс системы для одной частицы, т.е. в состоянии с волновой функцией вида^е/кг, нельзя ничего сказать о конкретном место- местоположении частицы: в любой точке пространства ее можно найти с равной вероятностью. Наоборот, если частица локализована в некоторой малой области пространства, то становится неопре- неопределенным ее импульс. з. Соотношение неопределенностей энергия-время.1 Если в формуле A4) использовать вместо операторов А к В операторы t и pt = ihd/dt, для которых справедливо коммута- коммутационное соотношение/у - tpt= ih, то для квадрата нормы функции получим < (/ + ikpt )л\)\и + ikp, )\b > = ' ' ' A.4.20) Оператор pt не является эрмитовым, поскольку скалярное произведение определено как интеграл по пространственным переменным, &pt от них не зависит. В то же время он очень похож 1 В квантовой механике время играет роль параметра, определяемого часами, находящимися вне квантовой системы. Поэтому неопределенность во времени может для квантовой системы лишь означать, что измерение или воздействие на систему осуществляется не мгновенно, а за конечный промежуток времени. Однако соотношения, представленные в этом пункте, от этого различия наблюдаемых величин и времени не меняются, что и дало возможность кратко обсудить их в настоящем параграфе. 66 на эрмитов оператор, что показывает следующая цепочка равенств: dt = ih— Гф * ilrtft + f[ ih dtJ J — ot дф dt dx = A.4.21) (первый интеграл в левой части последнего равенства обращается в нуль за счет ортогональности функций ср и ty). Таким образом, для оператора/>,= ih d/dt получается такого же типа соотношение, как для эрмитова оператора. Если теперь вернуться к правой части B0), то выражение в скобках можно преобразовать к виду F= <Лр \ptty> - <ptty | /яр> = <ф |(pjt|» - <ty |/>/№> - ih — {t < что окончательно с учетом коммутатора tpt - ptt = - ih и нор- нормировки функции ф на 1 (или на 6-функцию) дает F = -2ih. Соотношение B0) при этом приобретает вид: Будем теперь считать, что функция г^ описывает состояние квантовой системы, т.е. удовлетворяет уравнению Шредингера: ih у/ = ptty =Цф . Подставляя H\ty в первый интеграл правой части, с учетом эрмитовости Н найдем: X2 < л]} Н > +2ЛХ +12 г 0. Совершенно аналогичное соотношение можно получить, если вместо t и pt использовать At = t - t0 и Apt = pt - EQ9 где Ео - некоторая постоянная, a tQ - начальный момент времени. Выбирая в качестве Ео среднее значение <ty|//|ty> гамильтониана в сос- состоянии гр, получим, как и ранее: .2 Й2/4. A.4.22) Это соотношение носит название соотношения неопределенностей для энергии и времени, причем первый сомножитель слева отвечает дисперсии в значениях энергии, среднее значение которой равно Ео = <Н>. Оно показывает, что при измерении энергии за конечный промежуток времени At мы не можем получить точного значения энергии (как это имеет место в состоянии, собственном для //), а только лишь некоторое среднее значение с конечной дисперсией. При таком измерении энергии состояние, собственное для //, перестает 67
быть собственным, переводится в некоторое нестационарное состояние с определенным лишь средним значением энергии, которое к тому же может меняться с течением времени. Для энергии появляется некоторая полоса значений, в которую и попадают измеряемые величины энергии такой системы. Энергетический уровень перестает иметь точное значение, перестает быть бесконечно узким и приобретает некоторую конечную ширину. Задачи 1. Пусть матрицы F) и G) операторов координаты и импульса представлены лишь верхними диагональными блоками второго порядка: X=L V2 - -1б/9л2 I/2 Написать коммутатор для этих матриц и вывести соотношение неопределенностей, используя в качестве функции произвольный нормированный вектор 2. Сделать то же, что и в задаче 1, но с верхними диагональ- диагональными блоками матриц X и Р третьего порядка. 3. Найти собственные значения и собственные векторы матриц в задачах 1 и 2; каков их физический смысл? (Предвари- (Предварительно вспомнить, что собой представляют векторы и в каком базисе для рассматриваемых задач они заданы.) 4. Найти общий вид эрмитовых, унитарных и эрмитовых унитарных матриц второго порядка, если их элементы - комплексные числа. 5. Найти общий вид матриц второго порядка, удовле- удовлетворяющих условиям: a)AAt+AtA = I; 6)BBt-BtB = I. Могут ли матрицы А и В быть эрмитовыми? 6. Пусть имеются 3 эрмитовых матрицы S}, S2 и S3 второго порядка и матрица S3 диагональна. Найти вид матриц S} и S2, если для матриц S( справедливы равенства: 7, Вывести соотношения неопределенностей для операторов: а) р 2/2т и х ; б) р и L . 68 §5. Одномерное движение. Задача о гармоническом осцилляторе а. Общая характеристика одномерного движения. Стационарная задача о движении частицы в одном измерении уже отчасти была рассмотрена в § 2 на примере различных прямо- прямоугольных потенциалов. В общем случае любой гладкий потенциал можно приблизить ступенчатой функцией (рис.1 5.1), причем для каждой ступеньки решение одномерного уравнения Шредингера имеет достаточно простой вид: KiX Ф,= AteKi где к;= ^2m(Vt - Е) , V. - постоянный потенциал ступеньки с номером /, Е - энергия частицы с массой т, Ai и Bi - постоянные, определяемые условиями сшивания функций ф и их первых производных в точках скачка потенциала. Выбирая ширину ступе- ступенек достаточно малой, придем к решению, близкому к точному во всей области изменения переменной х. Если V.< Е , то к/ может быть представлено как iX с вещественным Х.9 т.е. в этой области Ф^есть линейная комбинация sinXx и coskpc. Если же V> E, то к. вещественно, и в качестве решения выступают экспоненты от вещественного аргумента, затухающие по мере проникновения под потенциальный барьер. Функции, которые представляют собой решения одномерного уравнения Шредингера при условиях, что для каждого собственного значения Е потенциал всюду справа от некоторой точки хг и всюду слева от некоторой точки х{ превос- превосходит Е (V - Е > 0 при х > хг и при х < ^), отвечают финитному движению, т.е. движению в конечной области, и обладают интегри- v Рис. 1.5.1. Аппроксимация гладкого потенциала ступенчатой функцией. 69
руемым квадратом модуля. В противном случае они принадлежат непрерывному (существенному) спектру и нормируемы на 6-функцию. Собственные функции для одномерного гамильтониана, как и для любого эрмитова оператора, ортогональны, если они относят- относятся к разным собственным значениям. Более того, в одномерных задачах функции, отвечающие финитному движению, всегда невырождены, т.е. каждому собственному значению принадлежит лишь одна собственная функция. Если же энергия такова, что она отвечает непрерывному спектру, то кратность вырождения не превышает двух. Эти два утверждения (как, впрочем, и ряд других, представленных ниже) следуют из теории линейных дифферен- дифференциальных уравнений второго порядка, и на доказательстве их мы останавливаться не будем, т.е. будем принимать как должное. К числу таких утверждений относится и следующее. Пусть одномерный потенциал V(x) ограничен справа (х > хг) и слева (х < лг) бесконечно высокими стенками, так что на границах в точках хг и х{ волновая функция обращается в нуль. Тогда, при расширении потенциального ящика, т.е. при переходе к новым границам х* > хг и (или) х/ < хп все собственные значения понижаются (Ек' < Ек), а при его сужении повышаются. Для прямоугольного ящика с постоянным потенциалом внутри него (V = О при jc,s х *хг) это очевидно, коль скоро уровни энергии, согласно уравнению B.8), обратно пропорциональны квадрату ширины ящика. Еще одно полезное утверждение заключается в том, что волновая функция низшего по энергии состояния дискретного спектра не имеет узлов, т.е. обращается в нуль лишь на концах интервала, где потенциал конечен. По мере увеличения номера собственного значения число узлов растет, причем оно оказывает- оказывается равным к, где к - номер уровня (если номер низшего уровня принят равным 0). Это - так называемая теорема Гильберта. Если потенциал V(x) непрерывен на отрезке х( ? х <; xr, a вне его обращается в бесконечность, то система собственных функций стационарного уравнения Шредингера с потенциалом V(x) является полной в пространстве Й2 функций, заданных на этом отрезке, так что любую функцию/(jc), x E [хг хг] можно разложить в ряд Фурье по собственным функциям такой системы. Что же касается непосредственного нахождения решений для одномерных задач, то здесь положение таково. В ряде случаев для сравнительно простых потенциалов удается свести стацио- 70 нарное уравнение Шредингера к одному из стандартных обыкно- обыкновенных дифференциальных уравнений второго порядка, для которого известны аналитические решения либо в замкнутой форме, либо в форме рядов, коэффициенты которых определяются по известному алгоритму. Обычно подобного типа задачи и бывают представлены в учебниках по квантовой механике. Само суще- существование таких решений не столь уж и важно для качественного анализа решений уравнения Шредингера при рассмотрении конкретных систем. Однако существует множество одномерных задач, которые приближенно сводятся к предыдущим, что дает возможность пользоваться различными процедурами уточнения при поиске их решений, опираясь на результаты точно решаемых задач. К тому же при первом знакомстве с квантовой механикой аналитические выражения оказываются весьма полезными, ибо позволяют отчетливо представить характер и особенности реше- решений, а также связь различных решений между собой. Как правило, аналитические решения одномерных задач представляются с помощью полиномов специального вида, а уравнение Шредингера после некоторых простых преобразований сводится к уравнению вида Рг(х) dx df dx A.5.1) гцер2(х) - полином от х не выше второй степени; рх(х) - полином не выше первой степени и р0 - действительное число. Такие дифференциальные уравнения имеют решения в виде так называемых гипергеометрической, вырожденной гипергеомет- гипергеометрической, цилиндрической и других подобных функций и детально изучаются в теории специальных функций (см., например: Никифоров А. Ф., Уваров В. Б. Основы теории специальных функций.- М.: Наука, 1974). Ниже мы не будем рассматривать общие конструкции со специальными функциями, а лишь познакомимся с некоторыми частными случаями таких функций и их свойствами на примерах конкретных задач о гармоническом осцилляторе и атоме водорода. И прежде чем переходить к задаче о гармоническом осцилляторе подчеркнем лишний раз, что решения большинства задач кван- квантовой механики, в том числе и одномерных, все же ищутся либо численно, либо в рамках тех или иных приближенных подходов. б. Гармонический осциллятор. Задача об одномерном гармоническом осцилляторе, т.е. о частице, движущейся в одном 71
измерении х под воздействием гармонического потенциала V(x) - = ^кх2, где к > О - некоторая постоянная, характеризующая раствор параболы и равная второй производной потенциала в любой точке: к = cPVIdx2. Коль скоро в классической механике сила, действующая на частицу, определяется соотношением F = -dVldx = -kx, то к называют силовой постоянной. Напомним кратко, что получается при решении задачи с таким потенциалом в классической механике. Уравнение Ньютона имеет вид: т йгх dt2 = -кх Это уравнение имеет решения х =А sin((ot + S), A.5.2а) в которых постоянные А (амплитуда колебаний) и S (фаза колебаний) определяются начальными условиями, а ш = J есть частота колебаний. Энергия частицы Е = кх 1 2 2 = А2- A.5.26) т.е. для колеблющейся по гармоническому закону частицы энергия пропорциональна квадрату амплитуды колебаний и квадрату частоты (к = /им2). В точках х+ = ± л}2Е I к = ±А скорость частицы обращается в нуль и далее частица начинает двигаться в противоположном направлении. Максимальную скорость, равную v = Л2ш2, частица имеет в точке х = 0. Перейдем теперь к квантовомеханическому рассмотрению задачи. Коль скоро V(x) явно от времени не зависит, то в исходном уравнении Шредингера можно отделить временную переменную и перейти к стационарному уравнению: Н = --Lil + ^x2) (Х) = Е 2т dx2 2 Потенциал V(x) при х -* ±«> также стремится к бесконечности. Поэтому волновая функция ty(x) должна при* —> ±«> стремиться к нулю, т.е. решения задачи должны отвечать классическому финитному движению частицы. Представим ty в виде экспоненты 72 е ^, в которой пока неизвестная функцияДх) должна быть такой, чтобы выполнялись граничные условия ty(±o°) = 0, т.е. Дх) должна расти при х -» ±оо. Подставляя эту экспоненту в уравнение C) и учитывая, что она почти всюду должна быть отлична от нуля, получим уравнение для Ддг): 2т d2f I (df 2m\dx к 2 « + — х = t. 2 Если при достаточно больших значениях |лг| вторая производная f(x) растет медленнее, чем первая, то ею, так же как и постоянной Е, можно пренебречь, что приводит к уравнению: 1 df п— 4кт -у —-f-«±Vfcw*, т.е. f(x) = ± х2. 2т dx Jl ; 2 Возвращаясь вновь к представлению ty = e'^x\ находим, что из полученных двух функций f(x) нужно из-за граничных условий взять лишь ту, которая при х * 0 положительна: Введение функции f(x) служило лишь некоторой наводящей конструкцией, которая показывает, что решения исходного уравнения C) можно попытаться искать в виде произведения экспо- экспоненты на некоторую функцию Р(х): ) Подставляя это выражение в C) и деля на уравнению для Р(х): /2 , приходим к 1 d2P dP . _ п — —— - 2х — + 2пР = 0, п - тЕ ~2 A.5.4) \ dx1 dx Если ввести теперь новую переменную у = \х12х , то получающееся дифференциальное уравнение оказывается совпа- совпадающим с хорошо известным уравнением Эрмита: d2S -2у dS_ dy A.5.5) Отметим, что с использованием переменной у волновую функцию можно представить в виде: -1/2.л _ у) = S(y)e'y /2, A.5.6) 73
тогда как исходный оператор Гамильтона запишется так: dx 2m dy 2 = { . A.5.7) Предположим, что функцию S(y) можно представить в виде ряда, не конкретизируя пока, сходится ли он или нет: ^. A.5.8) i=0 Тогда, пользуясь тем, что сумма не зависит от обозначения индек- индекса, по которому ведется суммирование, можем написать: d2S dy2 оо 00 i + IK42/ , поскольку индекс суммирования / можно заменить на / + 2 с соот- соответствующим изменением пределов суммирования. Кроме того, dS а уравнение E) переходит в следующее: 00 Чтобы это равенство выполнялось при любом у, требуется обраще- обращение в нуль всех коэффициентов ряда, т.е. а =2 i -п а A.5.10) Если п фиксировано, то при достаточно больших i можно написать a 2/at » 2i/i2 = 2/i, т.е. отношение этих коэффициентов такое же, как и отношение двух последовательных коэффициентов 2 7 2 2' / 7 V в разложении е2у по степеням у2: е у =^—\У ) • Следова- Следовательно, этот ряд при больших у в общем случае должен вести себя как указанная экспонента, т.е. стремиться к бесконечности. 2/2 С учетом представления функции г^ в виде S(y)e y можно сразу сказать, что такое решение для описания функций дискретного спектра не годится. Тем не менее решения, которые приемлемы для описания функций дискретного спектра, у данной задачи существуют. Дей- Действительно, если п — целое положительное число или нуль, то при 74 i = п коэффициент aj+2, как, впрочем, и все последующие коэф- коэффициенты, обращаются в нуль. Следовательно, при целом п > О вместо исходного ряда (8) для S(y) получается полином конечной степени п. В этом полиноме коэффициенты аои ах задаются, вообще говоря, произвольно и старшим членом служит апуп, где а получается последовательным применением формулы A0) до i-n- 2. Характерно то, что формула A0) связывает коэффициен- коэффициенты ai+2 и аг Поэтому, если одновременно и а0, и ах отличны от нуля, то либо для четных, либо для нечетных / ряд оборвется на п-й степени, тогда как на нечетных (либо на четных) / он продолжится до бесконечности. Чтобы не возникало опять неприемлемых решений, нужно ввести еще одно условие: коэффициент ах либо ао(в зависи- зависимости от четности п ) должен быть принят равным нулю. Такие полиномы конечной степени обычно обозначаются как Н (у). Итак, мы получили окончательно решения в виде: n = 0, 1,2,...) A.5.11) и, поскольку в уравнении E) п имело вид, приведенный в формуле D), то п I I f Ja I Zf I п\1 2} \т\П 2) \ 2. Величины Еп определяют энергию гармонического осциллятора. Они образуют дискретный спектр, и только при этих значениях^ у исходного уравнения C) имеются решения, стремящиеся к нулю при \х\ -> оо. Эти решения, как можно показать, обладают интег- —з 3 Y Рис. 1.5.2. Волновые функции низших состояний гармонического осциллятора. 75
рируемым квадратом модуля (и могут быть нормированы), а как собственные функции эрмитова оператора Н в уравнении C) они должны быть к тому же взаимно ортогональны. В этом спектре все соседние уровни отстоят друг от друга на одну и ту же величину ш. Сравнение с классической задачей показывает, что у кванто- вомеханического осциллятора в отличие от классического энергия зависит только от частоты и может иметь только определенные, дискретные значения (называемые уровнями энергии). Волновые функции низших состояний таковы: = А2Bу2-1)е-у2/2; A.5.13) = А4Dу4 -12у2+3)е-у2/2; гдеЛл - нормировочные коэффициенты. Графически эти функции представлены на рис. 1.5.2, причем для наглядности каждая из функций изображена возле отвечающего ей уровня энергии, так что для каждой из функций по оси ординат отложено ее значение (а не энергия!), и нулем отсчета служит соответствующий энергетический уровень. Полиномы Нп(у), обычно называемые полиномами Эрмита, были впервые исследованы русским математиком П. Л. Чебышевым A859 г.) и французским математиком Ш. Эрмитом A864 г.). Они допускают несколько различные представления, в частности Sn(y) = (- dyn -у A.5.14) При такой записи полиномов Эрмита для функций ty F), которые по аналогии называют функциями Эрмита, нормировочными множителями служат величины В — B"п\ л/л )~1/2 , так что A.5.15) Множители Впсвязаны с коэффициентами^в равенствах A2) весьма просто: А = В 2"/2, если п четное, и А = 2(л+1)/2В , если п нечетное. в. Операторы повышения-понижения. Задача о гармо- гармоническом осцилляторе играет весьма заметную роль в квантовой 76 механике, поскольку она позволяет не только получить аналитические решения, но и проследить различные подходы к их нахождению. Один из таких весьма примечательных подходов заключается в построении операторов, которые переводят одну собственную функцию в другую. Оператор, который из функции tyn п-го энергетического уровня получает собственные функции более высоких уровней, называется при этом оператором повышения, а более низких - оператором понижения. Как строятся подобные операторы для задачи о гармоническом осцилляторе, можно без труда понять из вида собственных функций A5) и представления A4), а также вида коэффициентов Вп. Так, d d -у - dy dy tl-\ d _ dy -у dy n-\ Выражение в скобках есть не что иное, как (-1)" l Bnlxtyn_x, что позволяет далее после ряда простых операций написать 1ги„_1 = — dy в п-\ 1 d у- у- dy Очевидно, что в качестве оператора повышения от некоторого уровня п - 1 к следующему уровню п должен выступать оператор V2п у 1 = V2п d \ y-i . d -i . Стоящее в круглых скобках выражение есть не что иное, как записанный в атомных единицах оператор импульса, канонически сопряженного переменной у. Обычно в качестве оператора повышения берут лишь оператор, стоящий в скобках, ибо тогда он не зависит от п9 и обозначают его как а : а+~ру + iy. A.5.16) Умножение оператора а+ слева на оператор а = р - iy позволяет получить последовательность равенств: = Ру2 -УРУ) У2 = где при переходе к последнему равенству учтено то, чему равен коммутатор импульса и координаты. Нетрудно заметить, что опе- оператор р 2 + у2 тесно связан с оператором Гамильтона G) исходной у 77
задачи в у-представлении , так что в итоге можем написать: Н(у)= (ш/2) (р2 + у2) = @)/2)[(* - iy)(py + iy) - 1] = A.5.17) Коль скоро функции грп - собственные для Н(у), т.е. и для а а+ , причем а+ переводит каждую функцию tyn в функцию \рп+] (с точ- точностью до нормировочного множителя), то оператор а_ = р - iy переводит \рп в функцию грп], а потому является оператором понижения. Если нам известна хотя бы одна функция ip , собственная для Н, то с помощью операторов а+ и а (называемых также лестничными операторами) можно построить все остальные. 2 12 Пусть, например, известна гр0 = Аое у . Тогда a+ty0 = 2 /2 = 2iA0ye y , что с точностью до нормировочного множителя должно совпадать с грг С другой стороны, a_ipo~ 0, и следова- следовательно, гр0 отвечает низшему собственному значению. Таким образом, операторы повышения и понижения дают возможность получить все собственные функции оператора Гамильтона для гармонического осциллятора. Выражение A7) для оператора Гамильтона позволяет без труда найти такие множители для операторов а+ и а , которые переводят нормированные функции грп вновь в нормированные функ- функции \\)п+] и tyn Г Действительно, запишем, например, интеграл 2 V -^ -т i * Я а а а где мы воспользовались тем, что операторы р и у, входящие в а , - эрмитовы, а оператор /, т.е. умножение на мнимую единицу, при переходе на первое место в угловых скобках меняет знак на обратный (i переходит в /'* = -/). Пусть далее ал^п= Хп+Цзп+], где грп и г^+] нормированы на единицу. Тогда приведенные выше инте- интегралы можно переписать так: 2 или л+1 \KJ = V2(n + 2) ; V= V2az, A.5.18) где сразу же выписано выражение и для К в соотношении г Более детальное рассмотрение показывает, что A.5.19) = ф(п + 2) 78 И наконец, с помощью равенств A9) найдем еще одно полезное для дальнейшего соотношение: Оно, в частности, показывает, что для оператора координаты у отличными от нуля будут только следующие интегралы: п+\ и A.5.21) г. Сравнение с классической теорией. Выше было отмечено, что энергия гармонического осциллятора связана с его частотой, а не с амплитудой, которая вообще не определена в кван- квантовой теории. Однако можно попробовать ввести некоторый аналог амплитуды, например следующим образом: 00 А2 = г|>„ —оо 00 У у, — 00 где § =VAm. Для вычисления последнего интеграла дважды воспользуемся соотношением B0): 2/z + l 7 (Л + 1)(Л + 2) п(п -1) 4 ' "^ 2 V 4 после чего сразу же можем написать (с учетом того, что § = к/ы): Следовательно, соотношение здесь получается на самом деле тем же, что и в классической механике (см.B)), поскольку в 7 7 классическом случае <х > ~А 12. Наиболее вероятное значение х0 координаты х будет получаться из обычного условия экстре- экстремума |грп(х)|2. Так, для основного состояния так что xQ = 0, для первого возбужденного состояния так что х0 = = BЕг I Ък)х1г . Необычным с класси- 0 § = (ш / лассических позиций для квантовомеханического гармонического осциллятора является наличие максимума при х - 0 у плотности 79
распределения основного состояния, тогда как по мере роста п среднее распределение у плотности становится также все более похожим на классическое. И еще одно существенное отличие от классической картины заключается в дискретности энергетического спектра. Тем не менее, если имеется система из большого числа гармони- гармонических осцилляторов, которые могут обмениваться друг с другом энергией (как это происходит - пока не важно), то в такой системе устанавливается термодинамическое равновесие, причем число осцилляторов с энергией Еп при равновесии пропорционально, как следует из статистической термодинамики, больцмановскому множителю е~ п , щек- постоянная Больцмана, а Г-темпера- Г-температура системы. Средняя энергия такой системы определяется равенством -EJkT П 1 п A.5.21) причем в знаменателе стоит число, пропорциональное полному числу осцилляторов в системе. Если Еп= w(/z + 1/2), то Е вычис- вычисляется довольно просто. Заметим, что а ( °° \ d <^e-w f*~ ft ' ft* d In 1 \ n п где р = 1/А:Ги? кроме того, ~Е^ = е"ш"ре"шр/2 = е , так что ~ е~ ^пе~ представляет собой (с точностью до множителя сумму убывающей геометрической прогрессии с начальным членом 1 (п = 0) и знаменателем q - е~^. Эта сумма, как хорошо известно, равна A - е"шР) '. Следовательно d -1пA-е"шр) = — -1 A.5.22) Если бы отсчет энергии велся не от минимума потенциала, а только от нулевого уровня Ео, то в этом выражении для Еср остался бы только второй член, который обычно и записывается для средней энергии. 80 Классическое выражение для Еср включает вместо суммы B1) интеграл вида: 00 JEe о -Е. 1 00 Iе 0 что соответствует выражению B2), если ш достаточно мало по сравнению с р и экспоненту ешР можно разложить в ряд, ограни- ограничившись далее линейным членом по шВ: ? йЯнт - ш/2 « 1/6 = Ек. Если же о>р а 0,2, то необходимо брать и члены более высоких степеней по ш|3, что в свою очередь повлечет за собой заметные различия не только в энергии, но и в других термодинамических свойствах. Задачи 1. Используя выражения для Хп+и кп_, найти среднее зна- знап чение квадрата импульса ргх в состоянии 2. Дать качественное обоснование тому, как будут вести себя уровни энергии при переходе от потенциала кх2/2 к потенциалу: а)(кх2/2)+ах + Ь; б)/х4; в) ~кх2B {к г=0). Указание: использовать решения для прямоугольного потенци- потенциального ящика, барьера и гармонического осциллятора. 3. Найти квантовое и классическое выражение для тепло- теплоемкости с = dEldT системы гармонических осцилляторов.
Глава II Центральное поле и момент количества движения § 1. Движение частицы в центральном поле В предыдущей главе были рассмотрены простейшие одномерные задачи, при изложении которых наметились те характерные различия результатов, которые присущи классичес- классическому и квантовомеханическому описанию одних и тех же систем. Описание поведения частицы в трехмерном пространстве, находящейся в некотором потенциальном поле, является сле- следующим этапом на пути перехода к квантовомеханическому анализу столь сложных объектов, какими являются атомы и молекулы. Потенциал, в котором движется частица, может быть достаточно произвольным, однако начнем мы с наиболее простой задачи о частице в центральном поле. Термин центральное поле означает, что имеется некоторый фиксированный, например, в начале системы координат, силовой центр, с которым и взаи- взаимодействует частица. Таким силовым центром может быть, в частности, положительно заряженное ядро, в поле которого движется электрон. Будем предполагать, что центральное поле не зависит явно от времени, хотя на начальных этапах рассмотре- рассмотрения задачи это предположение по существу не сказывается. а. Переход к сферической системе координат. Итак, пусть имеется частица в потенциальном поле V(r), зависящем только от ее расстояния г до начала координат, где находится силовой центр, и не зависящем от направления радиуса-вектора г частицы. Стационарное уравнение Шредингера V(r) B.1.1) ((я - масса частицы) для подобных задач удобно решать в таких системах координат, в которых расстояние г является одной из трех координат, определяющих положение частицы. И, по-види- по-видимому, наиболее подходящей является сферическая система коор- координат, включающая одну радиальную, г, и две угловые, переменные, задание которых проще всего понять из рис. 2.1.1. В этой системе угол й есть угол между направлением оси z исход- исходной декартовой системы Oxyz и направлением вектора г , тогда как угол ф - между направлением оси х и направлением проекции г на плоскость Оху. Угол # меняется от 0 до я, угол ф - от 0 до 2л. Угол ф отсчитывается в положительном направлении: поворот Рис. 2.1.1. Сферическая система координат. совершается против часовой стрелки вокруг оси z. Координаты x,ynz частицы, как легко можно установить из рисунка, связаны со сферическими координатами следующим образом: B.1.2) X = Г Sillu СО8ф , У = Г Sillu i Z = Г COS#. При записи оператора Лапласа в новых координатах нам потребуются выражения первых, а затем и вторых частных производных по х, у и z через соответствующие частные произ- производные по г, й и ф. Для такого перехода к новым координатам следует учесть, что х = х(г, Ф, ф), у = у(г, й, ф) и z = z(r, й, ф), так что для произвольной непрерывной функции Дх, у, z) будем иметь: B.1.3) дг __ dy_df_ dz_df_ дг дх дг ду дг dz и такого же типа соотношения для df/dft и df/дц). Далее в этих выражениях символ функции/будем просто опускать, записывая, например, вместо df/dr лишь оператор д/дг. 82 83
С помощью соотношений B) и C) можно получить следующие равенства: — = sinftcosrc — + sinftsinm — + cosft— , дг дх ду dz л — + rcostfsinrc rsinft— дх * ду dz B.1.4) = -rsmftsincp — + rsinftcoscp дер дх * ду которые можно разрешить относительно д/дх9 д/ду и d/dz, а затем найти вторые частные производные и, наконец, оператор Лапласа. Не приводя здесь все эти несколько громоздкие выкладки, выпи- выпишем лишь окончательное выражение: 1 д2 дг дг sin2® >,Ф, B.1.5) где символами Дг и Д^ ^ обозначены первое слагаемое правой части и сумма в квадратных скобках соответственно. б. Разделение переменных. Вернемся теперь к уравнению Шредингера для рассматриваемой задачи: 1 V(r) B.1.6) Умножим это уравнение на г2 и сгруппируем отдельно те члены, которые зависят в операторах только от г , и те, которые зависят только от углов: 4 1 B.1.7) Прежде чем обсуждать это уравнение, заметим следующее. Пусть оператор А(х, у) есть сумма двух операторов В(х) и С(у), каждый из которых зависит от "своей" совокупности переменных (символы х и у в общем случае обозначают такие совокупности). Тогда частное решение уравнения на собственные значения А(х, у)Ч>(х, у) = [В(х) + С(у)]Ч?(х9 у) = аЩх, у) B.1.8) можно искать в виде Ф(х, у) = ф(х)хО)- 84 Действительно, подставим это выражение в (8) и поделим правую и левую части полученного соотношения на §(х)%(у). Тогда с учетом линейности операторов квантовой механики и того, что операторы В и С действуют только на функции, зависящие от "своих" переменных, найдем: 1 Х(У) (Это равенство справедливо всюду, где фи/ отличны от нуля). Первое слагаемое в левой части равенства зависит только от переменных х, которые не зависят от у, второе - только от переменных у, которые не зависят от х. И в то же время сумма этих двух членов постоянна. Очевидно, что это может быть только тогда, когда каждое слагаемое постоянно, например х Сх = ^ и ф"!Вф = а - X. Умножая первое из этих соотношений слева на второе - на ф, придем к уравнениям: B.1.9) Вф = (а - Щ . Если у них есть решения, то уравнение (8) имеет частное решение - произведение функций фи/. Такой подход носит название метода разделения переменных: от исходного уравнения (8) мы переходим к двум уравнениям (9), каждое из которых зависит только от набора "своих" переменных. Использование этого приема применительно к уравнению G) приводит к двум уравнениям - радиальному и угловому: B.1.10) 2ji 1 B.1.11) причем , Ф) = ВД Y(ft, <p). B.1.12) В уравнении A1) возможно дальнейшее разделение переменных, т.к. оператор А^ , будучи умножен на sin2u, опять-таки становится суммой двух операторов, зависящих от разных переменных, что в итоге дает: ,2 2\i sinft Разделение переменных ft и ф приводит к следующему результату: 85
1 • а 3 — sinxr — l a- - Ып2Ъ Ф(ф) = уФ(ф). , B.1.13) B.1.14) Последнее уравнение совсем просто: вторая производная от функции Ф(ф) равна самой этой функции, умноженной на постоянную величину к2 = 2\iv. Решение такого уравнения у нас уже встречалось в задаче об одномерном потенциальном ящике. В данном случае Ф(ф) = Аек* + Век*, причем в отличие от задач § 2 гл. I функция Ф(ф) должна удовлетворять не граничным условиям, а условию периодичности: Ф(ф + 2л) = Ф(ф), что приводит к соотношению А(екС+2к) - еКф) = - или, что то же, Умножая обе части равенства на eKtp, получим равенство А(е2лк - 1) е2к* = - В(е~2*к - 1), в котором правая часть постоянна, а левая зависит от ф. Это возможно лишь при условии, что Л = 0, и тогда е~2кк -1=0, либо что е2кк -1 = 0. Следовательно, к = y2|xv должно равняться /ш, где т - натуральное (целое положительное) число либо нуль, а / - мнимая единица, так что v должно быть отрицательно. Поэтому т2 Ф(ф) «г Aeim* + Ве~1т* и v = - ^— • B.1.15) Решение уравнения A3) оказывается заметно более сложным, и детально им заниматься мы не будем. Отметим лишь, что если вместо переменной Ф в этом уравнении ввести временно переменную и = то его после некоторых преобразований можно переписать так: j 2. /-\ A-и2)^-2и^ du du 2\xk - т 1-й = 0. B.1.16) Это опять уравнение того же типа, что и упоминавшиеся в начале § 3 гл. I. Оно имеет непрерывные однозначные решения с интегрируемым квадратом модуля на отрезке [-1, 1], т.е. на отрезке изменения и = cosu при изменении Ф от 0 до я, только если выполнено условие 2\ik = /(/+1), причем /-целое неотрицательное 86 число либо нуль. Уравнение A6) при этом становится так назы- называемым присоединенным уравнением Лежандра1, а его решениями служат присоединенные полиномы Лежандра, обозначаемые обычно как P^iu) = P/"(cosu). В качестве т при этом берется всегда \т\. / Присоединение полиномы Лежандра могут быть вычисле- вычислены по следующей простой формуле: а d 2'/! du так что d 1+т , ____ _. B.1.17) 2ll\ (dcosft)t+m Нормированными на единицу функциями 0 j" (&) будут следующие: 2 B.1.18) т\ Следовательно, уравнение A3), если его вновь поделить на sin имеет в качестве решений собственные функции 0)"(Ф), дава- даваемые равенством A8), а собственными его значениями служат X = 1A + 1)/2\х. Эти же значения X входят и в радиальное уравнение A0). Отметим, что функции 0)?(Ф) при различных / и одном и том же т ортогональны друг другу, так что т' Т > = о "Весовая" функция sinu в этом интеграле появляется из-за того, что при переходе к сферической системе координат элемент объема dxdydz переходит в г2 sinudrd&dcp. Первые нормированные присоединенные полиномы Лежандра имеют вид -8- л/3 . а 1 Лежандр Адриен Мари A752 - 1833) - французский математик, член Парижской Академии наук. Первым открыл и применил в вычислениях метод наименьших квадратов. Ввел полиномы Лежандра, преобразование Лежандра, в вариационном исчислении установил признак существования экстремума. 87
—— shrfrcosft, ±2 7 = sin и т.д. Таким образом, в центральном поле волновые функции частицы представляются в виде произведения трех функций причем, как показывает уравнение A0), радиальная функция R(r) и энергия частицы Е зависят от X., т.е. от /, и не зависят от т. Угловые функции ®у и Фт не зависят от вида центрального потенциала V{r), а также и от массы частицы \i. в. Рассеяние на силовом центре. Если потенциал V(r) таков, что он стремится к некоторой постоянной с, например равной нулю, при г —» оо9 то в этом случае у задачи о частице в центральном поле при энергиях Е > с, вообще говоря, будут существовать решения, отвечающие непрерывному (сплошному) спектру (рис.2.1.2), причем собственные функции для такого спектра будут получаться при решении именно радиального уравнения. Эти функции детальнее мы обсудим при рассмотрении задачи с кулоновским потенциалом. Как уже говорилось, решения для непрерывного спектра не отвечают классическому финитному движению частицы. Они, по существу, служат лишь исходной конструкцией для построения таких их линейных комбинаций, сплошной спектр дискретный спектр Рис. 2.1.2. Области дискретного и непрерывного (сплошного) спектра. удовлетворяющих уже не стационарному, а временному уравнению Шредингера, которые описывают распространение в пространстве некоторых приготовленных тем или иным путем в начальный момент времени квантовых состояний (так называемых волновых пакетов). Тем не менее, именно с этих "строительных" позиций знание их свойств весьма существенно. Угловые части волновых функций, как показывает предшествующее рассмотрение, не зависят от того, есть ли дискретный (или непрерывный) спектр у конкретной задачи. Определяющую роль здесь играет лишь потенциал радиального уравнения: V((r) = V(r) + l(l+ l)/2\ir2 (см. рис. 2.1.3). Этот потенциал отличается от исходного V(r) У(г) а Рис. 2.1.3. Влияние центробежного члена на форму потенциала: а-изменение потенциала V{r) при добавлении центробежного члена; б - потенциалы Vt(r) при различных /. 89
дополнительным неотрицательным членом, который играет все большую роль по мере роста / (при больших / он практически пропорционален Р) и приводит к тому, что, начиная с некоторого /, любой потенциал, при г -» О стремящийся к минус бесконечности медленнее чем г~г (например, по закону г~2+Е, где е - произвольное положительное малое число), становится всюду неотрицательным (см. рисунок), т.е. другими словами - отталкивательным. Для такого потенциала связанных состояний, т.е. состояний дискрет- дискретного спектра уже не существует. Следовательно, при таких /любая частица будет рассеиваться на силовом центре: подходя к нему, она будет испытывать все большее отталкивание, дойдет до некоторого минимального расстояния, после чего начнет удаляться от него (использован для наглядности классический образ). г. Описание движения частицы в центральном поле в классической механике. Уравнения движения в классической механике, например уравнения Лагранжа или уравнения Гамильто- Гамильтона, также допускают разделение переменных г, О и <р. Не останавливаясь на том, как это конкретно делается, напомним лишь основные получаемые для этой задачи результаты. У частицы в центральном поле сохраняется, т.е. не меняется во времени вектор L момента количества движения. Если выбрать систему координат так, что этот вектор будет направлен по оси z, то движение частицы будет происходить в плоскости о(ху) и, очевидно, Lx = L = 0. Координата й при этом будет иметь фиксированное значение: й = я/2. Зависимость координаты ф от времени получается при решении уравнения |лг2ф = 12. Для радиального уравнения решения зависят от того, будет ли энергия частицы Е меньше или больше потенциала в некоторой конечной области значений г. в зависимости от этого частица совершает финитное либо инфинитное движение, соответственно. д. Замечание о задачах с нецентральным потенци- потенциалом. Если потенциал V(r) не является центральным или, что то же, сферически симметричным, то переход к сферической системе координат уже не является столь продуктивным. Приходится при анализе соответствующей задачи использовать другие системы координат. Например, в задаче о поведении электрона в молекуляр- молекулярном катионе Н2 , где имеются два протона, которые будем пред- предполагать фиксированными на оси z в точкахRI2 и -R/2, сферической симметрии уже нет. Однако потенциал Г,(г) + V2(r), образованный потенциалом Vx(r) взаимодействия электрона с одним протоном и 90 потенциалом V2(r) взаимодействия его с другим протоном, в этой задаче не зависит от угла ф поворота вокруг оси z, так что здесь удобно использовать, например, цилиндрическую систему координат (рис. 2.1.4): расстояние р электрона до оси z, проекцию его радиуса- вектора на эту ось z и угол ф поворота вокруг оси z . При этом, как и в задаче с центральным потенциалом, переменную ф можно отделить от двух других переменных и получить уравнение, аналогичное уравнению A4). Рис. 2.1.4. Цилиндрическая система координат. Нецентральные потенциалы с одним силовым центром, но зависящие в сферических координатах не только от радиальной, но и от угловых переменных, например V = V(r)cosft , часто называют анизотропными потенциалами. Они широко используют- используются при рассмотрении взаимодействий тех или иных частиц с удаленными от них молекулами, когда потенциал, создаваемый каждой такой молекулой в рассматриваемой точке, можно приближенно моделировать некоторым анизотропным потенциа- потенциалом, зависящим оттого, как повернута молекула. Так, взаимодей- взаимодействие атома Аг (находящегося в точке г) с удаленной от него линейной молекулой СО2, ядро атома углерода которой находится в начале системы координат, а ядра атомов О - на оси z, можно моделировать потенциалом вида V(r)(\ + bcos2®) , где b - некоторая постоянная. В более общих случаях, когда имеется три или большее число силовых центров, задачу, как правило, можно решать уже либо только численно, либо на основе тех или иных приближенных подходов. 91
Задачи 1. Выразить из соотношений D) частные производные д/дх, д/ду и dldz через производные д/дг, d/дФ и З/Зф, решая эту систему трех линейных уравнений относительно трех неизвестных. 2. Найти выражение для оператора Лапласа в сферических координатах. 3. Пусть решение радиального уравнения A4) ищется в виде R(r) = —S(r) . Какому уравнению удовлетворяет функция S(rO 4. Предположим, что радиальное уравнение A4) решается при / = О (т.е. при X = 0) с потенциалом V(r) = 0 при 0 s г < г и V(r) = оо при гаг (так называемая сферическая потенциальная яма). Найти решения и сравнить получаемые результаты с тем, что было найдено для одномерной задачи с прямоугольным ящиком. 5. Проверить непосредственной подстановкой, что функции @({У) из A8) удовлетворяют уравнению A6), а также то, что они нормированы и взаимно ортогональны (с весом siirO). 6. Что можно сказать о решениях задачи с анизотропным потенциалом вида V(r, Ф) = Vr(r) + VJft)! Можно ли в этом случае разделить переменные? §2. Теория момента количества движения Момент количества движения, или момент импульса, в квантовой механике играет не менее существенную роль, чем в классической. Выше мы уже упомянули, что в классической механике момент количества движения частицы в центральном поле сохраняется. Следовательно, он сохраняется и у свободной частицы и у системы частиц, на которую не действуют внешние силы, либо момент внешних сил, действующих на эту систему, равен нулю. Знание таких сохраняющихся при движении величин (их также называют интегралами движения) всегда полезно, хотя бы по той причине, что если fix, у, z) = с, то из этого соотношения можно выразить, например, х через у и z: x = х(у, г); подставив это соотношение в уравнения движения, можно исключить переменную х из этих уравнений и уменьшить число фигурирующих в них переменных. Посмотрим теперь, что можно сказать о моменте импульса в квантовой механике. а. Операторы момента импульса. Согласно сказанному в § 1 гл. I операторы момента импульса одной частицы в декар- 92 товой системе координат имеют следующий вид: ' д д y — -z — У \ dz ду L = zp -хр = -i\z У B.2.1) У = -i\x -y ду ' дх Длина вектора момента L определяется в классической механике выражением L = VL2 , где L2= L2 + L 2+ L\ Соответствующее выражение для оператора L2 получается подстановкой в эту сумму операторов A). Запишем теперь операторы компонент момента импульса в сферических координатах. Для этого вновь воспользуемся соотношениями B.1.2), рассматриваях,у иг как функции г, йи ф, и запишем производные по г, й и ф согласно B.1.4): 3 х 3 >> 3 г й Зг г дх г ду г dz — + rcosOsinqp rsin& —, B.2.2) дх ду dz 3 3 — + rsinira^ —. дх ду — Зф Последнее равенство может быть сразу записано с учетом соотно- соотношений B.1.2) в виде 3 д д - -у + Х - Зф дх ду B.2.3) либо после умножения справа и слева на-/: _. 3 Зф Такое представление оператора L отчетливо показывает, что его можно рассматривать как оператор импульса, канонически сопряженного координате ф. Если же второе равенство из соотношений B) умножить , а третье - на со8Фсо8ф, а потом их сложить и вычесть, 93
то после несложных преобразований можно получить еще два равенства: / L = i x \ I L = i У д У дф, d cosdsinqp д Эф \ B.2.4) Полученные выражения позволяют найти также оператор L2=L2+L2+L2 х у z 1 sinft (. sum 1 Эф B.2.5) Сравнение этого выражения с Ао в гамильтониане B.1.5) показывает, что они совпадают друг с другом, так что До есть не что иное, как оператор квадрата момента импульса частицы. Операторы Lx, Ьуи Lz, а также L2зависят только от двух угловых переменных й и ф. При выводе выражений C) и D) первое из соотношений B) нам даже не понадобилось. б. Коммутационные соотношения. Как показывают равенства A), операторы La(a = x, у, z) и L2 удовлетворяют следующим коммутационным соотношениям: B.2.6) L Д - LLx = /L LL -LL =iL У z z у Lp - ULx = Lp - L2Ly = Lp - L2Lz = 0. B.2.7) Следовательно, все операторы La коммутируют с L2, но не ком- коммутируют друг с другом. Рассмотрим теперь собственные функции этих операторов. При этом проще всего начать с собственных функций оператора L : . д где т - собственное значение. Это равенство показывает, что фт(Ф)= <>\ B.2.8) и для того, чтобы выполнялось условие цикличности ф (ф + 2л) = ф (ф), 94 необходимо потребовать, чтобы т было целым (положительным, отрицательным или нулем). Непосредственная проверка позволяет убедиться в том, что эта функция при действии оператора L2 переходит в ту же функцию с собственным значением m2/sin2u , зависящим от угла Ф. Для операторов Lx и L эта функция собственной уже не будет. Интересно, однако, что из операторов Ьхи /^можно построить такую линейную комбинацию aLx+ bLy, которая переводит функцию фт(ф) вновь в собственную функцию для оператора Lz. Для этого достаточно положить а = 1, b = ±/, т.е. определить два оператора: L =L +iL и L = L -iL. B.2.9) + х у - х у v/ Действительно, возьмем функцию /,+фт(ф) и подействуем на нее оператором L . Тогда с учетом коммутационных соотношений F) будем иметь: +i » - (m + A, Следовательно, функция?+фт- собственная для Lzc собственным значением, на единицу большим, чем у фт. Аналогично можно показать, что оператор L переводит функцию ф^также в собствен- собственную для оператора Lz, но с собственным значением, на единицу меньшим. Вспоминая то, что было сказано при рассмотрении задачи о гармоническом осцилляторе (гл. I, § 5), можно сразу же сказать, что операторы L+nL_ суть операторы повышения и пони- понижения соответственно. Эти операторы могут заменить Lxn L в четверке операто- операторов момента La (a = х, у, z) и L2. Коммутационные соотношения для них с оператором L мы только что нашли: z + B.2.10) — Li Li — Li , + z +' Li Ls Ls Ls = L* • z - z - С оператором L2ohh, очевидно, оба коммутируют. И наконец, LL -LL =2L . B.2.11) + - - + z v 7 Отметим еще очень интересные соотношения следующего вида: LL =(L + у -iL)=L2+L2-i(LL - у' х у ^ х у у = L2+L2+L2-L2 х у z z 95
B.2.12) которые приводят к следующим двум соотношениям: LL = L2-L2+L, + - z z7 LL = L2-L2-L . - + z г в. Собственные функции. Коль скоро операторы Lzn L2 коммутируют, у них всегда может быть выбрана общая система собственных функций, что было доказано выше (см. п. г § 4 гл. I). У оператора L2, коль скоро он совпадает с Д« , собственными функциями, как показано в § 1, будут причем В{ т - нормировочный множитель, a P/"(cosu) - присо- присоединенный полином Лежандра. Эти функции будут одновременно и собственными для L , если вместо линейной комбинации экспо- ¦ ¦ 2 ¦ нент ешц> и е~ШЧ) использовать только одну из них, например ешц>, (как то было введено в § 1). Тогда: т , , ¦ B.2.13) Оператор L2 представляет собой сумму трех неотрицатель- 9 9  ных операторов: Lx, Ly nLz. Поэтому среднее значение этого оператора на любой нормированной функции Ч*(й,ф) всегда больше или равно среднему значению одного из них, скажем L2Z : ¦ + L2y + 1 L\ поскольку первые два слагаемых в левой части неравенства не- неотрицательны. В частности, если в качестве W(u,qp) взять функцию , то приведенное неравенство будет означать, что /(/+ l)s=m2. B.2.14) Подействуем теперь на функцию гр; т оператором L+. При этом она перейдет в функцию гр/ , (после дополнительной нормировки, если в этом есть необходимость). Последовательное применение операторов L+будет постепенно увеличивать собствен- собственные значения ?2на получаемых функциях. Но рано или поздно т 96 достигнет такой величины, что для этого т неравенство A4) будет выполнено, тогда как для т + 1 оно уже будет нарушено. Обозначим такое собственное значение оператора L, через w+. Аналогично, действуя последовательно оператором L , можно получить функцию с минимальным собственным значением т_9 при дальнейшем действии на которую оператором L должно было бы получиться собственное значение т - 1 , нарушающее неравенство A4). Следовательно, коль скоро неравенство A4) таких нарушений не допускает, должны быть справедливы соотношения =0, B.2.15) а числа т и т+ должны отличаться друг от друга на некоторое целое число. Воспользуемся для определения т и т+ соотношениями A2). Подействуем оператором L L+ на функцию ty/,m+ , a оператором LL - на функцию ty/,m . С учетом A5) тогда получим: (L2 -L\- (L2 -L2Z+ - ml - т+ = [/(/ + 1) - ml + m_ = О, = 0. Это означает, что /(/ + 1) - m+(m+ + 1) = 0и/(/+ 1)- m (m - 1) = 0. У первого из этих уравнений (относительно т+) решения т+-1 или т+ = -(/ + 1), причем второе противоречит неравенству A4). У второго по тем же причинам остается в качестве решения лишь т = -I. Таким образом, собственные значения оператора Lz при заданном / меняются от -/ до +/ через единицу, пробегая всего 2/ + 1 значений: -/,-/+ 1, ...,/- 1, /. Каждому из этих значений отвечает своя собственная функция ip/m, причем по отношению к оператору L2Bce эти 2/ + 1 функции являются собственными с одним и тем же собственным значением /(/ + 1). В заключение этого пункта выясним еще, как действуют операторы L+nL на нормированные функции xJj; m. Мы уже знаем, что они переводят их в функции \р( и гр m_v нарушая, быть может, лишь нормировку. Поэтому можно написать < ,„_!. B.2.16) Действуя на обе части первого соотношения оператором L , получим .«• B-2.17) При вычислении среднего значения оператора/, L+ на функции ty 1395 97
можно воспользоваться эрмитовостью операторов/, иЬ и получить У l,m ^^ •¦¦ atm где мы учли, что (/,_)+ = L+ , а звездочка обозначает комплексное сопряжение. Возвращаясь вновь к равенству A7), видим, что, во- первых, ajm+x = и, во-вторых, atm +1) - т(т + 1) . B.2.18) Отметим также, что L++ ? = 2L , а потому = * " B.2.19) Подобное же соотношение можно написать и для оператора L . Таким образом, операторы Lxw L переводят функцию i|>, m в линейную комбинацию (при т = ±/) двух собственных функций L с собственными значениями т ± 1. Из соотношений типа A9) для Lxn L следует к тому же, что средние значения этих операторов на функциях, собственных для L , равны нулю. Действительно, коль скоро Lz - эрмитов оператор, его собственные функции взаимно ортогональны. С другой стороны, оператор Lx действует согласно соотношению A9), так что г. Векторная модель. В классической механике вектор L момента количества движения (углового момента) для свобод- свободной системы не меняется во времени, т.е. сохраняет свою длину и направление при ее движении. В лабораторной (инерциальной) системе координат Oxyz сохраняются, следовательно, все три его проекции. При движении твердого тела можно ввести еще одну систему координат- Ox'y'z\ связанную с главными осями эллипсоида инерции этого твердого тела и называемую обычно подвижной системой. Эта система вращается вместе с твердым телом, инерциальной системой она уже не является. Возьмем ради простоты такое твердое тело, у которого два главных момента инерции равны друг другу: /,, = /,. = /., а третий момент от них отличен: /,,= /,. Тогда, если твердое тело поступательно не движется, а только вращается, то в лабораторной системе координат вектор, 98 направленный по оси z\ будет вращаться вокруг направления вектора углового момента/,, которое можно считать совпадающим с осью г, причем это вращение происходит с постоянной угловой скоростью со. В этих случаях говорят, что проекция Lz, вектора L прецессирует вокруг оси z (рис. 2.2.1). В более общем случае, когда все три главных момента инерции различны, ось г' не только прецессирует вокруг оси г, но вдобавок периодически то подходит к ней ближе, то удаляется от нее, т.е. говоря тем же языком, заимствованным из астрономии и теории летательных аппаратов, ось z' совершает не только прецессию, но и нутацию (лат. nutatio - кивать, колебаться). L Z' О Рис. 2.2.1. Классическая прецессия проекции Lz, вокруг вектора L момента импульса твердого тела, совпадающего по направления с осью z. Эти наглядные представления можно попробовать перенести на квантовомеханическую почву, хотя сделать это строго, конечно, затруднительно, поскольку приходится иметь дело не с векторами как таковыми, а с операторами и отвечающими им собственными значениями. Прежде всего заметим, что "длина вектора" L в состоянии, собственном для оператора L2, равна +1) , а его проекция на ось г может равняться любому из чисел /и = -/,-/+ 1,...,/, равных собственным значениям оператора Lz. Поскольку в этом случае длина всегда больше модуля любой из проекций /и, то вектор L, представляющий оператор L, никогда 99
не совпадает с осью г (рис. 2.2.2а). Каждой проекции отвечает свой угол между этой осью и направлением вектора L. Число различных проекций равно 2/ + 1. С другой стороны, проекции на оси х и у не только не определены, но и их средние значения равны нулю. В классической картине это может быть изображено вектором L, прецессирующим с некоторой частотой со вокруг оси г, для которого средние по времени проекции на оси х и у равны нулю. Другими словами, вместо вектора L можно рассматривать конус, образованный этим вектором при вращении вокруг оси г (рис. 2.2.26), как раз и соответствующий прецессии вектора L вокруг оси г. Z L-3 -2 -3 \\7 а Рис. 2.2.2. Векторная схема связи проекции I, и вектора L (а) и конусы, образуемые при прецессии L вокруг оси z (б). д. Сложение моментов. Для системы двух частиц (с индек- индексами 1 и 2) в классической механике угловой момент записывается как сумма моментов отдельных частиц: L = L, + L2. В квантовой механике такому вектору будет отвечать четверка операторов: L - Li«+ L2« (а - *> * z) и L2 = (Lx + L2J - L\ + L\ + LXL2 + L2LX. Каждый из операторов L.a{i = 1, 2) действует только на функции, зависящие от переменной i-й частицы. Поэтому с учетом того, что для суммы двух операторов, зависящих каждый только от своих переменных, собственную функцию можно представить в виде произведения двух функций, одна из которых собственна для одного из этих операторов, другая - для другого, собственную функцию 100 оператора Lz можно искать в виде произведения^ 1ъЩ^ilim2 (L2z4> Такая функция имеет в качестве собственного значения величину т = т] + т2, так что проекции момента L на ось г могут, очевидно, меняться от -A^ + /2) до (/1 + /2) при переборе всех функций г|>/ иг^ и построении из них всех возможных произведений. С другой стороны, одному и тому же значению т могут отвечать различные произведения, поскольку т = ml + m2 = (ml- 1) + (/и2+ 1) = » (т + 1) + (т2 - 1) = ..., так что имеется в общем случае вырождение по этому числу т. Исключение составляют лишь функции ^1ътх иг4)/2,т2 > которые являются собственными для Lz с собственными значениями /1 + /2 и -{1Х + /2). Прежде чем говорить о том, как ведут себя подобные произведения функций при действии оператора/,2, отметим, что "У 'У "У L = Lx + L2 + 2(LlxL2x + LlyL2y + LlzL2z)- Заменяя здесь Lu на (Lu +L1_)/2, ily - на (L1+ -Lx_)l2i, a также L2xwL2 - на соответствующие выражения, получим: 2 ? | B.2.20) Стоящий в скобках в правой части оператор примечателен тем, что для него любая из функций ^ 1ът^^щ - собственная: (L2X +L2 2 + /2(/2 + В то же время два последних оператора в формуле B0) переводят такие произведения в другие функции за исключением лишь двух указанных случаев: тх = I п%2= 12ътх = -/,, т2= -1Г В этих двух случаях оператор Ll+L2+ Lx ?2+(либо за счет операторов L.+9 либо за счет операторов L._) переводит функцию в нуль, так что она оказывается собственной для L2c собственным значением ll(ll + 1) + + /2(/2 + 1) + 2/,/2= (/j + /2)(/, + /2 + 1). Для того, чтобы построить другие собственные функции для L2, нужно составить линейные комбинации функций вида <Ф/1,/и1<Ф/2л»2 с одним и тем же значением т = тх+ тг Не останавливаясь на этом построении детальнее, сформулируем лишь окончательный итог: из всевозможных 101
произведений функций, собственных для L%,Llz,L\ и?22>можно построить функции, которые будут собственными для L2 с собственными значениями, задаваемыми числами (для определен- определенности считаем, что /, а /2) 1 2' 12 ' "* ' 1 2* При этом для каждого значения / будет иметься весь набор функ- функций, собственных для Lz с собственными значениями т от -/ до +/. Такое построение наглядно представляется векторной мо- моделью, т.е. моделью сложения векторов, как показано на рис. 2.2.3. При этом надо ясно понимать всю условность подобной картины. Векторы Ц и Ц определены подлине на функциях Ч^,^^,/^ и на их линейных комбинациях, поскольку и те и другие будут собственными и для l\, и для L| • В то же время проекции ?12И L^ на линейных комбинациях, собственных для L2, в общем случае не определены, поскольку т — тх + т2 — {тх - 1) + (т + 1) = ... . Определена только лишь проекция Lz. По этой причине изображе- изображение векторов L и L на рисунке не вполне адекватно тому, что должно бы быть. Лучше было бы иметь, например, систему накла- накладывающихся рисунков, отвечающих одному и тому же вектору L, но со всеми возможными парами проекций для L( и L2: {т 9 /и2}, {т{ - 1, т2 + 1} и т.д. Рис. 2.2.3. Векторная модель сложения моментов: сначала скла- складываются проекции Lnl и Ln2 на направ- направление L, а затем по этой суммарной проекции определяется квантовое число L полного момента L. В свою очередь, вектор L прецессирует вокруг оси г. 102 Построение собственных функций оператора L2 по соб- собственным функциям \}х и l\ носит название сложения моментов. Иллюстрацией этого сложения и является рис. 2.2.3. е. Матричное представление операторов углового момента. Если имеется множество функций г|>.(/ = 1, 2, ..., N), то с этими функциями для заданного оператора^ можно вычислить сово- совокупность чисел, определяемых каждое двумя индексами: А ~ <г|> А г|)>. Эти числа называются, как уже было сказано, матричными элементами оператора Л. Они могут быть записаны в виде матрицы, причем номером строки матрицы служит, например, индекс /", а номером столбца -j. Если бы функции гр/образовывали полный набор, то такая матрица полностью представляла бы оператор А, т.е. задавала бы этот оператор в полном базисе функций г|>. Если базисные функции г|> являются собственными для некоторого оператора В, то говорят, что оператор А задан в Д-представлении, например, если такими функциями служат собствен- собственные функции оператора импульсар, говорят ор-представлении (или, что то же самое, - об импульсном представлении) оператора А. Найдем матричное представление операторов Lx, L , Lzn L2в базисе собственных функций/,2иLz. Коль скоро такие функции, относящиеся к заданному /, образуют набор из 2/ + 1 функций, преобразующихся друг через друга при действии операторов Lx и L , можно для дальнейшего ограничиться именно таким набором, полным при заданном /. Начнем рассмотрение с матрицы L2опера- L2оператора L2, для которой матричные элементы таковы: у. B.2.21) У матрицы L2 на диагонали стоит одно и то же число /(/ + 1), а все недиагональные элементы равны нулю, т.е. эта матрица скалярная: L2= /(/ + 1I, где I - единичная матрица порядка 2/ + 1. У матрицы Lzоператора Lz картина похожая: \ B.2.22) т.е. матрица опять-таки будет диагональной, но на диагонали на сей раз стоит весь набор чисел от -/ до +/. (Например, как это обычно делают, в порядке возрастания, так что тх = -/, т2= -I + 1, ... , и поэтому увеличению^' будет соответствовать также увеличение т). Нетрудно заметить, что по существу здесь скрыто общее утверждение: любой эрмитов оператор представляется в собствен- собственном базисе диагональной матрицей из собственных значений. 103
С операторами L+9 L_, Ьхи L положение будет уже иным. Используя соотношения A6) и A8), найдем (помня, что уве-личению //гна единицу соответствует увеличениеу также на единицу): B.2.23) и, аналогично, с учетом того, что a/~m =(а/+т-1)*, (L Д. = >//(/ + 1)-т,(/и,.+1) 6it,+1. B.2.24) Поэтому у матрицы L+будут отличны от нуля элементы только на побочной диагонали, стоящей сразу же под главной, а у матрицы L - на побочной диагонали, стоящей над главной диагональю: 0 0 э a 0 0 b 0 в * в * • * * в ¦ 0 L d 0 L = 0 а 0 0 0 ъ 0 0 в в в * в * • в в d и 0 о, Матрицы Lx и Ly получаются из L+и L обычным путем L (LLJ/2L Пример. Пусть / = 1. В этом случае 2/ + 1 = 3 и матрицы операторов углового момента при использовании формул B1) - B4) находятся без особого труда: L2= 2 /1 0 о 0 1 0 0' 0 1, ' г a 0 о 0 0 0 (Г 0 -1, / ; L = 0 0 0 V2 0 о 4i 0 0^ ;L = f ° 0 0 п B.2 or 0 о, .25) и, наконец, L = 0 l/>/2 0 0 1/V2 0 ]/>^ 0 0 /Д/2 0 ^ -//V2 0 i/V2 0 -i/V2 0 B.2.26) 104 Собственные векторы для Ь2и Lz, отвечающие функциям 1, tyio и^г-! соответственно, представляются в этом случае следующим образом: с,= 0 с = @\ 1 и 0 Вектор с = отвечает линейной комбинации \\> = 1,1 n+ cxIj, ,. Например, при действии L на с получается следующий результат: Lc = х 2 о о о Угг (о, 0 ш что соответствует (нормированной) функции = г^д.. При действии же матрицы L на вектор с2 получается вектор, отвечающий функции L ip10 = -*'(^i,i ~4)i,-i)/'v2 ^г^^. Если вспомнить представление функций г|)/ т в сферической системе координат, то можно написать (для нормированных функций; см. j. /3 2 \к 13 J так что = — J— sin^ к 1 /3 . а 1 /3 х = — л \— sinxrcosm = — 2 Vji 2u г 1 '3 2 u (e i4> ) 3 1 /3 у — sinfrsincp = —-I .B.2.27) 2Уя 2Vji r V 7 2i Графическое изображение функций tyl m. Функции г|); m зависят от двух переменных ^ и ф, так что они (либо их линейные комбинации) могут быть представлены графически в обычном трехмерном пространстве некоторыми поверхностями, отвечаю- 105
щими значениям этих функций при заданных §иф. Так, функция Ч*оо = уУ^к вообще не зависит от этих переменных, т.е. имеет одно и то же значение для каждой пары {Ф, ф}; графически эта функция, следовательно, будет представляться сферой радиуса /л. С функциями x|)j т возникает то осложнение, что г^ 1 и ^ j комплексны. Однако переход от этих функций к г|>хи г|>у B7) позволяет ввести вещественные функции, которые наряду с г|>2 = т|IОуже могут быть представлены так, как это показано на рис. 2.2.4. Рис. 2.2.4. Представление функции Очень часто вместо пространственного изображения таких функций используют плоские сечения, отвечающие тому или иному фиксированному значению угла ф, причем в качестве такой плоскос- плоскости используют ту, в которой лежит максимальное по модулю значение функции. Для функции г|>0 0 в сечении (при любых фиф) получится окружность, для функции г|)г(при любом ф) - две сопри- соприкасающихся окружности, как показано на рис. 2.2.5, тогда как для функций л§х и г|> - такие же графики, что и для г|> , но при использовании сечений плоскостями Oxz и Oyz соответственно. з. Замечания о терминологии. 1. Числа / и т обычно называют квантовыми числами, определяющими то или иное состояние квантовой системы, в данном случае, коль скоро угловой момент связан с вращением, то вращательными квантовыми числами. Такая же терминология очень часто используется и в общем случае: если квантовое состояние характеризуется некоторым набором чисел ( не обязательно целых), определяющих полностью или частично это состояние, то такие числа называют 106 квантовыми числами. Энергию системы, например, к квантовым числам не относят, однако если она для ряда состояний выражается закономерно через некоторое число (числа), то такое число относят в разряд квантовых чисел. 2. Функции г|)(г, Ф, ф), являющиеся решениями уравнения Лапласа , ф) = 0 в сферических координатах, называются сферическими гармони- гармониками. После отделения радиальной переменной в этом уравнении, Рис. 2.2.5. Сечение функций s,/?, ир плоскостьюyz (при постоянном г). получается уравнение, содержащее только угловые переменные Фи ф, частными решениями которого служат функции г|), т. Функции г|), т , собственные для операторов L2 и L, и записанные в сферических координатах, называют поэтому сферическими поверхностными гармониками (г = const, т.е. на поверхности сферы). Далее, действительные функции типа г|> и г|>, представ- х у ляющие собой линейные комбинации г|), т и \р{ _м, называют тессеральными, или кубическими сферическими гармониками (латинское tessera означает куб). Однако, как правило, в квантовой механике и квантовой химии всех этих дополнительных подразделений в наименованиях не используют, говоря лишь просто о сферических функциях (или сферических гармониках). 107
Задачи 1. Проверить справедливость коммутационных соот- соотношений A0). 2. Используя выражения для присоединенных полиномов Лежандра, найти непосредственным интегрированием нормиро- нормировочные множители В{ т в функциях г|), т при / = 0, 1 и 2. 3. Построить матрицы L2, L2, Lx и L для случая / = 2. 4. Построить графики функций ty , ty ± ty г|>_ ± г|ь и их сечения (т.е. изображение этих функций на соответствующих плоскостях). § 3. Атом водорода Начало настоящей главы было связано с задачей о движении частицы в центральном поле. Рассмотрим теперь несколько более сложную задачу о двух частицах, взаимодейству- взаимодействующих между собой в отсутствие какого-либо внешнего воздей- воздействия. Примером такой системы из двух частиц может служить атом водорода, включающий протон (или ядро соответствующего изотопа: дейтон либо тритон) и электрон, которые взаимодей- взаимодействуют между собой по кулоновскому закону V = -е2/г, где г - расстояние между ними, -е - заряд электрона и +е - заряд протона. Аналогично атому водорода можно рассмотреть любой атомный катион с зарядом ядра2е, либо систему из позитрона и электрона или из положительно заряженного ядра и отрицательно заряженного мезона. К числу таких задач относятся также задачи о столкно- столкновении двух нейтральных или заряженных частиц и т.п. а. Отделение центра масс. Запишем оператор Гамиль- Гамильтона для системы из ядра (с зарядом Ze) и второй частицы, например электрона, пользуясь атомной системой единиц: 2/Wi 2/w -Д1"- -г. 2тх 2т2 г ' где индекс 1 относится к ядру, а индекс 2 - ко второй частице. Декартовы координаты ядра - jcp yv zx\ декартовы координаты второй частицы (электрона) - ху уТ zr В классической механике такая система в отсутствие внешних сил движется как целое поступательно с постоянной скоростью, или, что то же, с постоянным импульсом, так что в 108 функции Гамильтона можно выделить координаты и импульс центра масс и далее отделить это поступательное движение от других видов движения системы, поместив начало системы координат в центр масс. Переход от исходных радиус-векторов частиц г, и г2 к координатам центра масс осуществляется следующим образом: вводится радиус-вектор центра масс R = (mlrl + m2r2)/M, где М = тх + т2, а также еще один вектор г = аг + Ьг , причем коэффициенты а и b подбираются так, чтобы этот вектор был линейно независим от R и чтобы выполнялось условие, которое мы введем несколько позже. Векторы г{ и г2 можно выразить через R и г: ЬМ п ш2 Ътх - R- -ат2 г; аМ R + г. Ъщ - ат2 Ътх - ат2 Кроме того, для записи операторов импульса нам потребуются выражения для частных производных по координатам векторов г, и г2 через частные производные по координатам X, Y и Z вектора R и координатам х, у, z вектора г: эх д дх д дхг эх дхг дХ д дх д тЛ д д м дХ дх т м дх д дх дх2 дх2 дХ дх2 и т.п. для координату, и zr При переходе к оператору Гамильтона получим: 1 д2 1 д2 \ (т д дМпгл д д 2тх дх2 2т2 Ъх\ ~ 2т1{ М дХ + п дх)\ М дХ а дх 1 т7 д . д L +b т> 2т2 \М дХ дх)\М дХ 1 1 2М дХ2 2 а ТПл т2, д дх а+Ь д1 М дХдх ¦ Чтобы упростить последующие выражения, потребуем равенства нулю коэффициента перед смешанной производной: а + b = 0, т.е. 109
b = -а, и, поскольку величина оставшегося при этом коэффициента пока что произвольна, будем считать, что а = 1. Такой выбор коэффициентов приводит к следующим соотношениям: R-(от, г, +m2r2)/M; = г,-г; Г, = т B.3.1) 2 М н =- 1 2М Ад- 2ц г B.3.2) где dY2 ez И [X 1 -1 /Wi -так называемая приведенная масса системы двух частиц 1 и 2; г - длина вектора г. Если тх - масса протона (т.е. «1836), а т2 - масса электрона (т.е. 1), то ц,« 0,9995, т.е. практически совпадает с массой электрона. Оператор Гамильтона B) не зависит явно от времени, что позволяет сразу же перейти к стационарному уравнению Шредин- гера: W? = ЕЧ*. К тому же первое слагаемое в B) зависит от переменных X, Y и Z, тогда как второе - только от jc, у и z. Следовательно, волновую функцию можно искать в виде произве- произведения W = х(К)Ф(г) и тем самым разделить переменные: 1 2М 2\к 7х А-- где Е равно полной энергии системы двух частиц за вычетом поступательной энергии е. Первое уравнение C) соответствует свободному движению "частицы" с массой М и радиус-вектором R, так что x(R) =AeikR, k= V2Me n, n - единичный вектор в направлении движения частицы, Л - нормировочный множитель. Такие функции мы уже встречали в п. в § 3 гл. I. Второе уравнение также уже было рассмотрено в § 1 настоящей главы, хотя и без конкретизации вида потенциала. Это второе уравнение отвечает задаче о частице с массой \i в центральном поле -Zlr. При переходе к сферическим координа- координатам можно разделить радиальную г и угловые Оиф переменные ПО и получить два уравнения - радиальное B.1.10) и угловое B.1.11): и 1 1 d 2\х г2 dr \ dr Z 1A +1) 2\хг2 + Ф = ЕФ B.3.4) 2\х B.3.5) Уравнение E) и его решения детально изучены в §§ 1 и 2. Остается рассмотреть решения так называемого радиального уравнения D). б. Радиальное уравнение. Как уже говорилось, решения уравнений типа D) и E) записываются обычно после приведения их к виду, известному для некоторых хорошо изученных уравнений. Поступим именно так и с уравнением D). В качестве первого шага введем в этом уравнении новую переменную х согласно равенству г =Xjc, где А, - постоянная, после чего умножим правую и левую часть D) на -2\хк2: LA 2 dx 2\ikZ 1A +1) Ф = - х~ их \ dx/ х причем Ф = Ф(>ис). Если ввести теперь новые обозначения 2\\Z B.3.6) то последнее уравнение приобретет вид dx 2d_ х dx п х i(i + i) Ф = 0 B.3.7) Для кулоновского потенциала, стремящегося к нулю при г —* оо, решения с Е > 0 должны, согласно сказанному в гл. I, относиться к непрерывному спектру (это так называемая задача рассеяния частицы на кулоновском центре). Рассмот- Рассмотрение решений при Е а 0 оставим пока на более поздний срок, а сейчас выясним, что можно сказать о решениях уравнения F) при Е < 0. Как следует из определения, параметр b при этом условии положителен, так что при х -* оо для регулярных решений (т.е. однозначных и имеющих в каждой точке непрерывную конечную производную), которые только и допускаются к рассмотрению квантовой механикой, уравнение G) переходит в следующее: d^ldx2= ЬФ, т.е. Ф(х -» оо) s e (решение с 111
не является конечным при х -» оо , а потому не может отвечать какой-либо функции состояния). Поэтому будем искать решение G) в виде: Ф(кх) = ф(х) = F(x)e . Подставляя это выражение в уравнение G), придем к уравнению, определя- определяющему F(x): dF 1, Л гг Ш + ГК_ „ /л о оч у?. э.о) d2F dx dx = 0. И наконец, еще одна подстановка: для того, чтобы исключить член с /(/ + 1)/х, вместо F(x) введем функцию/(х), определяемую равенством jF(jc) = xlf(x). Функция Дх), как следует из (8), удовле- удовлетворяет уравнению 2 dx +B/+ 2 - dx + [п - 2A + = 0. B.3.9) Полученное уравнение имеет регулярные решения, если 2ыЬ =1, а |3 = 2/ + 1иа = л + /- положительные целые числа, причем а-Р = и-/-1аО. При этих условиях дифференциальное уравнение (9) совпадает с так называемым уравнением для присоединенных полиномов Лагерра L?a(x) = L2J+l\x) (п = 1, 2,...; / = 0, 1, ... , /I - 1), определяемых равенством dxa хае~х B.3.10) Возвращаясь последовательно к решениям радиального уравнения D), мы видим, что они представляются в виде Ф ,(А = ф n,lv ) ^п, П 2\xZ , B.3.11) причем Ап {~ нормировочный множитель. Если вспомнить, что в сферических координатах элемент объема имеет вид r то нормировка Ф„,(г) будет определяться равенством (кп = nl2\iZ): 00 00 3 - * о = Угп$Фп1(кпх)Фп1(кпх)х о При вычислении интегралов от функций, определяемых равенством A1), окончательно получим следующее выражение для норми- нормировочного коэффициента у радиальных функций Фп1(г): B.3.12) Можно к тому же показать, что функции Фп ,(г) и Фп {(г) при n * ri ортогональны: 00 О Выпишем в качестве иллюстрации несколько первых ра- радиальных волновых функций Ф (г) для водородоподобных атомов (обозначив для сокращения записи \\Zr через р и (^ZK/2 через а): п 1 2 2 3 3 3 0 0 1 0 1 2 Радиальная функция ( р = |iZr, a=(|iZK/2) Ф..0-2О*"- л a /о ~\„"Р/2 2а ^ 2ч -р/з 81л/3 л* * //; 2\ -р/3 "' 82Ja' 'з J'J 8lVl5 Как было сказано, для атома водорода \х отличается от 1 на 5*10, для более тяжелых ядер это отличие еще меньше. Поэтому при всех рассуждениях, не претендующих на сверхвысокую точность, в формулах, приведенных выше, можно положить jx = 1. Для атома водорода к тому же и Z = 1, так что р = г, а a - 1. Качественный характер графиков радиальных функций показан на рис. 2.3.1. Число п для задачи об атоме водорода и о водородо- водородоподобных атомах называется главным квантовым числом, а число / - орбитальным квантовым числом, определяющим орбитальный, 112 113
или угловой момент электрона. Главное квантовое число указывают цифрой, а орбитальное - курсивной строчной латинской буквой соответственно значению /: / обозначение О 1 Р 2 d 3 / 4 g (начиная с / буквы идут в алфавитном порядке). Поэтому квантовое состояние указывается, например, следующими парами символов: Is, 2s, 2p, ... . Если необходимо, то для состояний с / * О а 0.3 - 0.1 ¦ -0.1 J : 3s 3d Рис. 2.3.1. Радиальные функции для атома водорода (\iZ= I a= 1)- а- функции U, 2s и 2р; б -функции 3*, Ър и 3d. (Обратите внимание на протяженность функций при одном и том же главном квантовом числе иина различие в масштабах радиальной переменной). 114 указывают справа внизу и значение квантового числа /и, называемого магнитным по той причине, что оно задает смещение уровня энергии в магнитном поле (см. § 4 и § 1 гл. III): 2р_х, 2р0 и 2р+1; 3d 2 и т.п. В качестве общих характеристик радиальных функций можно отметить следующие: 1. Каждая из функций Фп ,(/¦) представляет собой произведе- произведение экспоненты на полином видаг/Ри_/_1(г). Поэтому у этих функций имеется п -1- 1 узлов, т.е. точек, где функция обращается в нуль (не считая г = 0 и г = °°). Функции с / = 0 при г = 0 отличны от нуля, тогда как с / * 0 они в этой точке обращаются в нуль. 2. По мере увеличения п радиальные функции имеют все меньшие максимальные (по модулю) значения и все большую протяженность. 3. Производная радиальной функции при г -» 0 должна стремиться, как показывает уравнение G), к величине, определя- определяемой уравнением B.3.13) dx х п , ~ 2uZ При / = 0 с учетом того, что х = ——г: п d<P dr B.3.14) r-0 С другой стороны, при / * 0 в этом выражении доминирует второй член в скобках, так что производная в нуле будет либо равна значению полинома 1?^{х) при / = 0, либо нулю при / ^ 1. Выше уже говорилось, что числа / и /и, которые появляются при рассмотрении волновых функций, зависящих от углов ^иф, носят название квантовых чисел. Число п также имеет смысл квантового числа: оно задает радиальную волновую функцию (наряду с /) и полностью определяет энергию системы, поскольку из F) следует, что Е = ~ rj 2п п = 1Э 2, ...). B.3.15) в. Средние значения. Полная волновая функция каждого квантового состояния определяется произведением радиальной и угловой частей: W(/-, Ф, ф) = Фп ,(г)@1 т(Ф,ф).Вероятность 115
обнаружить электрон в заданной точке пространства с коорди натами /% & и ф равна В частности, в ^-состояниях плотность вероятности зависит от углов и определяется только величиной не В отличие от Фп Q(r) функция Рп(г) в нуле обращается в нуль, а при О < г < °° она всюду неотрицательна. Ее экстремумы определяются обычным условием равенства нулю первой производной dr = 2г + 2г"Ф я,0 л,О B.3.17) т.к. Ф вещественна. Так, для ls-функции (см. приведенную выше таблицу) в случае атома водорода (Z = 1) dPx(r) dr = 2r4er - 8r2e '= 8r(l - r)er. Равенство нулю этой производной показывает, что максимальная плотность вероятности обнаружить электрон на некотором расстоянии от ядра достигается при г0 = 1. Это расстояние, заданное в атомной системе единиц, называется боровским радиусом. При переходе к системе СИ величина г() будет определяться следующим образом: r0 = h2l\xe2 = 5,29-I 0 9 м, причем в качестве \х берется масса электрона (см. § 1 гл. I). Для 2^-функции условие A7) приводит к двум расстояниям с максимальной плотностью: г ., = 3 ± v5 , причем отношение плотностей в этих максимумах Р2(г,)/Р2(г,) » 3,7, т.е. второму максимуму отвечает более высокая плотность. Среднее значение радиуса г в ls-состоянии 00 00 <r>= r3dr = о 3 2 т.е. оно в 1,5 раза превышает боровский радиус. Для состояний 2s, 2p, 3s, Зр, 3d и т.д. картина получается более сложной. Для всех состояний, кроме 5, есть еще угловая 116 зависимость. Например, для 2р -функции 1 re -г/2 плотность вероятности будет определяться равенством 1 4 : г cos —г 32л Функция cos^dsind меняется от нуля до максимального значения 2/Зл/з при sind = l/V5, а затем вновь достигает нуля при Ф = я/2. Функция г4е~г имеет максимум при г = 4. Следовательно, поверхности постоянной плотности вероятности Р2п, =с имеют вид торов, получающихся при вращении фигуры на рис. 2.3.1 вокруг оси 2. г. Краткий итог и сравнение с классической задачей. Решение задачи об атоме водорода при Е < 0 приводит к волновым функциям Фп х т(г,Ф,ф), представляющим собой произведение радиальной и угловой частей, при этом получается дискретный набор уровней с энергиями Еп =* -1/B«2), зависящими только от главного квантового числа п (рис. 2.3.2). Для каждого данного п V(r) о л=3 л=2 сплошной — 1 спектр У//// \гЛ\'А -—^— У//// 6/18/ г Рис. 2.3.2. Уровни энергии для атома водорода. существуют квантовые состояния с различными / = 0, 1, ...,«- 1 и, кроме того, для каждого / имеется 2/+ 1 состояний, различаю- различающихся квантовым числом т проекции момента количества дви- движения на некоторую ось. Следовательно, каждый уровень энергии при заданном п вырожден, и кратность вырождения равна 117
У B1 + 1) = n . По мере увеличения п уровни сближаются, имея в /-о качестве предельной точки накопления Е = 0, а кратность их вырождения растет по квадратичному закону. Одновременное вырождение по / и т - эффект кулоновского поля. Если поле остается центральным, но перестает быть кулоновским, то вырож- вырождение по / пропадает, хотя вырождение по т сохраняется. Так, если считать, что в многоэлектронном атоме на данный электрон действует поле ядра и усредненное поле всех остальных электро- электронов, обладающее сферической симметрией, то в целом потенциал для этого электрона уже кулоновским не будет и уровни энергии, отвечающие различным / при заданном w, будут разными. В классической механике при движении в центральном поле сохраняется угловой момент L, причем движение частицы, например электрона, совершается в плоскости, проходящей через начало системы координат и перпендикулярной направлению L. Траекторией финитного движения является эллипс, в одном из фокусов которого находится силовой центр. Если уравнение этого эллипса написать в виде у + а Ъ при b < а, то выражения для большой а и малой b полуосей будут следующими (Е < 0) : 1 где / - длина вектора L, Е - энергия частицы (электрона) в поле силового центра. Чем выше (меньше по модулю) энергия, тем больше полуось а, тогда как "вытянутость" эллипса определяется отношением Ыа (либо его эксцентриситетом ? = у 1 - (Ь/а) ), ко- которое зависит не только от энергии Е, но и от величины /: Ыа = у]- 2Е/т I. При / = 0 финитное движение если и происходит, то по прямой: частица, ускоряясь, налетает на силовой центр, прохо- проходит через него (если это возможно), далее замедляется, останав- останавливается и начинает двигаться в обратном направлении. Проекции т углового момента L на заданную ось могут быть любыми. Сравнение с результатами квантовой механики здесь менее наглядно, тем более, что заряженная частица (электрон), двигаясь ускоренно по эллиптической орбите, должна была бы, как следует из теории электромагнитного поля, излучать и терять свою энергию (вплоть до падения на силовой центр). Даже если не 118 учитывать этого обстоятельства, энергия классической частицы может быть любой, тогда как в квантовомеханическом случае она ограничена снизу (п = 1). К тому же классическая энергия частицы зависит от /. Далее, в квантовой механике случаю / = 0 соответствует сферически симметричная функция s-типа. Такое перечисление различий можно было бы продолжить, однако сказанного достаточно, чтобы подтвердить ту мысль, что у задачи об атоме водорода квантовомеханические особенности проявля- проявляются весьма ярко. д. Положительные энергии и непрерывный спектр. При Е > 0 в радиальном уравнении G) параметр b будет отри- отрицательным, так что при jc —> оо (jc = \г) это уравнение переходит в следующее: = ?Ф dxl Его решения, как то уже говорилось не один раз, имеют вид: Ф = Ае Ьх + Be Ьх . Будучи приемлемыми при больших*, эти решения регулярны, а потому могут быть волновыми функциями. Для построения решений, регулярных вблизи нуля, выражение для Ф(х) надо домножить на х1Р(х), где Р(х) - некоторая функция, определяемая с помощью так называемой вырожденной гипер- гипергеометрической функции. Полученное таким образом решение радиального уравнения будет непрерывным вместе со своей первой производной и конечным. Следовательно, если его домножить на решения углового уравнения E) яр (-в1, ф), то получатся волновые функции, отвечающие непрерывному спектру (такие решения могут быть получены при любом b < 0). Эти функции отвечают несвязан- несвязанным состояниям: говоря языком классической теории, кинетичес- кинетическая энергия электрона настолько велика, что он лишь рассеивается силовым центром. Задачи 1. В квантовой химии вместо водородоподобных радиаль- радиальных функций часто используют функции вида Ф(г) = Аг"е~*г. Объяснить, чем они качественно отличаются от водородо- водородоподобных. Найти нормировочный множительА при п = 1 и 2. 2. Найти средние значения г2 для Is-, 2s- и 2/?2-функций. 3. Найти среднее значение г2 в 2/?2-состоянии. 119
§ 4. Внешнее электромагнитное поле При рассмотрении задачи об атоме водорода было установ- установлено, что каждый уровень с заданным главным квантовым числом п > 1 вырожден, причем кратность вырождения растет пропор- пропорционально п2. Если поле перестает быть кулоновским, то вырож- вырождение частично или полностью снимается, так что имеет смысл понять, в каких случаях такое снятие вырождения будет проис- происходить и как конкретно будут расщепляться уровни. При этом будем предполагать, что изменение кулоновского поля вводится внешним электромагнитным полем, на влиянии которого мы и должны будем остановиться детальнее. а. Электромагнитное поле. Введем сначала те величины, которые определяют электромагнитное поле, и уравнения, их связывающие. Как известно, этими величинами являются следующие векторы: Е - напряженность электрического поля; Н - напряженность магнитного поля; D = ?оеЕ - электрическая индукция (г0 - диэлектрическая проницаемость вакуума, г -относительная диэлектри- диэлектрическая проницаемость среды); В = цоцН - магнитная индукция (\iQ - магнитная прони- проницаемость вакуума, \х - относительная магнитная проницаемость среды). Для вакуума еиц равны 1. В системе СГС ?0 и \х0 также равны 1, в СИ, однако, ?0 = 8,85419-1012 Фм 'и \хо= 12,56637-107 Г м^1 (Ф - фарадей, Г - гаусс). Помимо указанных векторов вводятся и величины, опре- определяющие систему зарядов в поле: р - плотность электрического заряда и j - плотность электрического тока (j = pv, где v - скорость движения заряда). Векторы Е, Н, D, В, а также р и j связаны друг с другом уравнениями Максвелла (с - скорость света): СГС СИ rotE + ^ = 0 с dt dt ,„ 1 дВ rotH с dt 4я. с dt B.4.1) 120 divD = p, divB = 0, divB = 0. Как видно из этих уравнений, переход от системы СГС к СИ осуществляется заменой: 1„ 4я. Е^Е, -В ^В, —j ^j, с с Н=>Н, -D =>D, 4jtp=>p. с В соотношениях A) также использованы следующие обо- обозначения (для дивергенции и ротора произвольного вектора а): diva s да да у rot а = V х а = da дау\ dz + ду да. dz дх daz dz B.4.2) у дх ду к. Далее также будет использован градиент скалярной функции ер, определяемый равенством: к . gгadф = Уф = —2-1 + —2-j + дх ду dz Векторы Е и В (а следовательно, и D, и Н) имеют в общей сложности 6 компонент, не все из которых независимы. Поэтому подчас бывает удобнее, особенно в ходе промежуточных выкла- выкладок, перейти к другой системе величин, в качестве которых обычно выбирают 3 компоненты так называемого векторного потенциала А и скалярный потенциал ф: СГС СИ — С dt В = rot A А Е = grad ф dt В = rot A B.4.3) (при переходе от СГС к СИ А => сА и ф => ф). Классическая частица с зарядом q при движении в электромагнитном поле испытывает действие силы, имеющей вид (далее выписываем все соотношения только в системе СГС, переходя при необходимости к СИ с помощью указанных замен, 121
что определяется большей легкостью перехода к атомной системе единиц от системы обозначений в СГС): f-гхв), B.4.4) с / где г - скорость движения частицы. Эта сила носит название силы Лоренца1. Для нее можно написать обобщенный потенциал (откуда и видно, почему А и ф также называются потенциалами) функцию Лагранжа L=T-W= с B.4.5) * + — (А • г) - qcp 2 с р = dL k= q ^ с B.4.6) и обобщенный импульс р = ip^p^p)'- dL. dL . —1 + —j + — dx dy dz Для функции Гамильтона получается следующее выражение: # = J_L_iA) +w, B.4.7) 2т\ с / которое позволяет далее написать оператор Гамильтона при обычной замене импульса р на оператор - i»V = - ih . д . д + J — dx " dy dz а функции координат A(jc, у, z) и ф(х, у, z) оставить, по существу, без изменений. Если в системе имеется две или большее число частиц, то у импульсов и радиусов-векторов появляются соответ- соответствующие индексы частиц, а кроме того добавляется потенциал V взаимодействия частиц между собой, так что оператор Гамиль- Гамильтона приобретет вид: 2 1 V. B.4.8) 1 2/Wi 1 Лоренц Хендрик Антон A853 - 1927) - нидерландский физик и матема- математик, создатель электронной теории, ввел так называемые, преобразования Лоренца для координат и времени A904) до появления специальной теории относительности. 122 Возвращаясь теперь на время к гамильтониану для одной Я А частицы, можем возвести в квадрат оператор р - — А и получить: с # = 2т 2т h'A-2-i с •A + A-V)-^_-A с . B.4.9) Оператор, стоящий в круглых скобках, при действии на произволь- произвольную функцию ф(г) дает: (V • А + А • У)ф(г) = f дх ду ¦ л , (дА, ад. ал. ду dz ) divA Следовательно, в операторе Гамильтона (9) можно выделить те члены, которые включают операторы импульса, и те, которые зависят только от координат: .2 # = - .B.4.10) 2ni~ с ' 2тс 2mcL . С учетом подобных преобразований можно написать и оператор (8) для системы многих частиц. 6. Однородные постоянные поля* Выделим теперь два частных, но весьма важных случая: однородное постоянное электрическое поле (Е = Е , В = 0) и однородное постоянное магнитное поле (Е = 0, В = Во). В первом случае, как следует из соотношений C), вектор А есть градиент некоторой функции/(г), поскольку rot(grad/) = 0. В теории электромагнитного поля существует утверждение о так называемой градиентной (или калибровочной) инвариантности: при добавлении к векторному потенциалу А градиента некоторой функции, например gгadДr, i) , а к скалярному потенциалу ф-функции — уравнения Макс- с dt велла A) не меняются. По этой причине для постоянного электри- электрического поля можно просто положить А = 0. Тогда Ео = ^^ф и, 123
следовательно, q> = -Еот. Считая, что Ео и г записаны в атомной системе единиц, оператор Гамильтона можно упростить: B.4.11) где V(r) - потенциал взаимодействия с другими полями, например полем, создаваемым фиксированным силовым центром. Так, для электрона в атоме водорода, принимая направление вектора Ео за осьг, получим B.4.12) 2 г Для решения задачи с таким гамильтонианом сферическая система координат возможно уже будет не столь удобной, как ранее, ибо последний член в уравнении A2) содержит z = rcosO, т.е. и радиальную, и угловую переменные. Тем не менее, отсутствие зависимости в этом члене от угла ф означает, что эту переменную можно вновь отделить, и вырождение по квантовому числу /и, по- видимому, будет сохраняться. Что же касается квантового числа /, то оно здесь вообще не появляется, поскольку момент количества движения L2 уже не коммутирует с оператором Гамильтона Н (именно из-за члена с rcosf)), а коммутирует лишь проекция момента Z,z, так что сохраняется лишь одна проекция момента. Во втором случае (однородное постоянное магнитное поле) Е = 0 и первое из соотношений C) показывает, что dA/dt = -с grad ф. Коль скоро поле постоянно, то А и ф явно от времени зависеть не должны, что приводит к равенству grad ф = 0, т.е. ф есть некоторая постоянная, которую можно просто положить равной нулю. При этом все уровни энергии всего лишь сдвинутся на эту величину, т.е. изменится лишь начало отсчета для энергии. Второе же соотношение C), как легко убедиться непосредственной подстановкой, допускает следующее решение: А = — Во хг, так что, подставляя его в A0), получим: "=~^A~^r~(B°*r^ + ~div(Boxr) + 2т 2тс 4тс и 2тс: Если теперь учесть1, что (Вохг)-р=Во-(гхр) = (Во х гJ + V(r). B.4.13) =LB0, 1 Использована возможность в смешанном произведении трех векторов циклически переставлять сомножители: a-(bxc) = c-(axb) = Ь*(сха). 124 где L - оператор момента импульса частицы, а также то, что div(Boxr) = 0, то для оператора Гамильтона в постоянном магнитном поле получим: .2 1 ч Н -Д- 2т 2тс ч 8тс' (ВохгГ+V(r). B.4.14) При достаточно слабом магнитном поле третий член в правой части A4), квадратично зависящий от Во, будет мал. По этой причине мы им пока пренебрежем. Кроме того, коль скоро Во - вектор постоянный, выберем его направление за ось z. Тогда уравнение A4) окончательно преобразуется к виду 1 Ч # = !- —A+V(r)]- 2т } 2тс LZB Oz B.4.15) где круглыми скобками выделена та часть гамильтониана, которая остается и в отсутствие поля, т.е. не зависит от него. Например, для атома водорода круглые скобки в A5) содержат обычный гамильтониан, который, как было показано в предыдущем параграфе, определяет поведение электрона (а точнее - частицы с приведенной массой \i) в центральном поле - поле протона. Этот гамильтониан коммутирует с?2и Lz, так что состояния, собственные для //, являются одновременно собствен- собственными и для операторов момента с собственными значениями /(/ + 1) и т соответственно. Добавление к исходному гамильтониану члена, зависящего от LB 9 не меняет собственные функции: они остаются собственными и для нового гамильтониана. А вот собственные значения, равные в случае дискретного спектра атома водорода Еп =-l/2w2, меняются: к величинам Еп добавляется член, зависящий от проекции углового момента: При заданном / квантовое число т имеет целочисленные значения от -/ до /. Поэтому вырождение по т снимается, появляется 21 + 1 уровень с одним и тем же расстоянием между соседними уровня- уровнями, равным BOz и пропорциональным напряженности поля. 2\ic Такое расщепление вырожденных энергетических уровней в магнитном поле может быть обнаружено по спектральным перехо- переходам между уровнями под влиянием электромагнитного излучения 125
соответствующей частоты. Оно называется эффектом Зеемана1. Как показывает рассмотрение классического выражения D) для силы Лоренца, в однородном магнитном поле компонента импульса по направлению поля не меняется, тогда как его составляющая, перпендикулярная направлению поля, вращается вокруг вектора В с постоянной угловой скоростью, так что в среднем направление движения частицы сохраняется. В неодно-родном же магнитном поле возникает дополнительный эффект: частицы с разными проекциями момента импульса по-разному отклоняются от исход- исходного направления своего движения, что приводит к расщеплению пучка частиц с одним и тем же начальным импульсом (см. следующий параграф). в. Дипольный и магнитный моменты. Выражение A1) показывает, что в однородном электрическом поле к гамильтониану исходной свободной системы частиц надо добавить выражение W = - 2 V к Еп =-d E B.4.17) в котором множитель, заключенный в скобки, есть не что иное, как электрический дипольный момент системы. Поправка к гамильтониану в поле определяется, очевидно, проекцией диполь- ного момента d системы на направление поля. Если бы поле Е было неоднородным, но неоднородность была бы достаточно слабой, то Е для каждой частицы можно было бы разложить в ряд, например, вблизи начала системы координат, и ограничиться лишь линейными членами (Ео = Е@)): дЕ г-О Уг дЕ dZ; zi +.. г,-О При этом уравнение gradq) = -Е вновь можно проинтегрировать и получить выражение вида дЕ^ вХ: (дЕ, дЕ, i ) dE т.е. выражение, зависящее уже от компонент градиентов Ех9 Е и Ez. 1 Обнаружен голландским физиком Питером Зееманом в 1896 г. по расщеплению спектральных линий натриевого пламени при наложении внешнего однородного магнитного поля. 126 Введение однородного магнитного поля проявляется в двух дополнительных членах (линейном и квадратичном по полю): .2 B.4.18) m 2mc 8mc Вектор 2mc по аналогии с электрическим дипольным моментом называется магнитным дипольным моментом, или просто магнитным моментом заряженной частицы. Ему отвечает и соответствующий оператор магнитного момента, включающий оператор L, как то записано в соотношении A8). Для системы частиц магнитный момент определяется суммой: B.4.19) Тщс Если имеется система частиц с одинаковыми зарядами и одина- одинаковыми массами (q = q и w.= m для любого i), например система электронов, то магнитный момент будет пропорционален полному угловому моменту этой системы: фициент пропорциональности \i - q \i = (q/2mc)L,. Обычно коэф- h I 2mc называют магнетоном для соответствующей частицы и записывают указанное соотноше- соотношение в виде \х = signq (\i / /z)L . В частном случае системы электро- электронов абсолютная величина коэффициента пропорциональности \хъ = eh I 2mc носит название магнетона Бора (q = -e). Если бы использовалась атомная система единиц, то для магнетона Бора получилось бы выражение \хБ = 1/2с, причем в этой системе с « 137,036. Второе слагаемое в A8), квадратично зависящее от компо- компонент вектора магнитной индукции (или напряженности магнитого поля) может быть представлено следующим образом: 8тс 8тс Ч 8тс2 где сначала было использовано соотношение (axb)-c = (bxc)*a, a затем соотношение ах(Ьхс) = Ь(а-с) - с(а-Ь), причем точка означает скалярное произведение. Нетрудно убедиться, что это соотно- соотношение можно переписать в матричной форме, если ввести симмет- симметричную матрицу третьего порядка с элементами, квадратичными 127
по компонентам радиуса-вектора заряженной частицы Х = Атс V-r2 ху XZ ху XZ У z2-r2 B.4.20) В результате для И^ получим равенство: i. B.4.21) Совокупность 9 величин (из них только 6 различных), образующих элементы матрицы х, носит название тензора диамагнитной вос- восприимчивости. Для системы частиц этот тензор складывается из отдельных тензоров для каждой частицы. Тензор диамагнитной восприимчивости не зависит от того, есть у системы угловой момент или нет. Однако коль скоро поправ- поправка с х квадратично зависит от напряженности поля, то при малых напряженностях, как уже было отмечено, она играет малую роль, заметно меньшую, чем первое слагаемое в A8). г. Поля, создаваемые заряженными частицами. В данном изложении почти всюду (кроме заключительных замечаний о релятивистской квантовой механике систем частиц) предпола- предполагается, что частица создает вокруг себя электрическое куло- новское поле и взаимодействие заряженных частиц между собой определяется прежде всего именно кулоновским потенциалом. В то же время в квантовой механике обычно приходится иметь дело не с одной заряженной частицей, а с их системами, например атомами или молекулами, что привносит дополнительное свое- своеобразие в теорию. Действительно, пусть имеется система п частиц с заря- зарядами q. и радиусами-векторами г.. Предположим, что эти частицы локализованы в некоторой сфере радиуса р, и рассмотрим потенциал, создаваемый всеми частицами вне этой сферы в точке с таким радиусом-вектором R, что R » г., Vi (см. рис. 2.4.1). В точке, определяемой концом этого вектора, электрический потен- потенциал, создаваемый частицей с номером /, имеет кулоновский вид: Ф/ = qt\R - rj1, так что суммарный потенциал ер = У <р,- в этой точке представляется следующим образом: ф-2 R-r, B.4.22) Поскольку ¦ + (Z-zt) ий» г, то каждое слагаемое в этой сумме можно разложить в ряд по степеням jc.9 у. и zr Чтобы не загромождать текст, выпишем такое Рис. 2.4.1. К определению потенциала в точке R, создаваемого системой зарядов вблизи начала координат (г < р « R). разложение лишь для одного члена |R - г |, пока опустив индекс у г. и заменив х на х{9 у на х2 и z на xv а X, Y и Z - на Ха, а = 1, 2, 3 соответственно: f(xvX2,X3)m\R-l\ -1 f ( IK 1 R + S df дха » a r ' г>3 r=0 1 , 3 2 У d2f R5 r=0 6ap" R3 • • • • ¦ где использовано то обстоятельство, что, например, дх (Хг -х2) I-V2 а 1 (Х1-х1J+(Х2-х2J+(Х3-х3) -Ц2. дх. а — X, а 128 5 - 1395 129
Следовательно, потенциал ер при таком подходе можно записать в виде ряда по степеням компонент радиуса-вектора R: «? +—у Л К а 1 Y t ¦ * ¦ ч B.4.23) п где q = V qt ; Ла = У ^jcia и, как уже было сказано, величины da суть компоненты вектора (электрического) дипольного момента системы; Gap = ^<7/C**a**p "r?6ap) - компоненты (электричес- кого) квадрупольного момента системы. Если записать компоненты векторов R и d в виде векторов-столбцов, а элементы <2ap = Q^ - в виде симметричной матрицы Q, то соотношение B3) может быть переписано и так: ф = — + RfQR + ^— + ... 2 R5 B.4.24) Представление потенциала в виде B3) или B4) четко показывает, что он может быть выражен через такие суммарные характеристики системы частиц, как ее полный заряд q, дипольный момент d , квадрупольный момент Q и т.д. Это представление широко используется при исследовании межмолекулярных взаимодействий, когда расстояние между молекулами заметно превышает их некие средние "размеры", т.е. линейные размеры той области, где в основном сосредоточена плотность вероятности распределения каждой из частиц молекулы. Движущиеся заряженные частицы создают в каждой точке пространства не только электрическое кулоновское, но и магнитное поле, векторный потенциал которого может быть получен при решении уравнений, возникающих при подстановке выражений C) в уравнения Максвелла. Эту процедуру, требующую к тому же введения дополнительных предположений, не имеет смысла рассматривать в настоящем изложении. Если же ограничиться только лишь ее резуль- результатами, то можно сказать, что векторный потенциал А, создаваемый в точке г частицей с номером i и зарядом q.n находящейся в точке г., в основном передается следующим выражением: г-г где (г - г.) - вектор, направленный из точки нахождения частицы 130 в рассматриваемую точку, где вычисляется А, а ц. - магнитный момент частицы, определенный согласно A9) равенством \х = (?./2m.c)L., причем в выражении для момента импульса L; должен фигурировать радиус-вектор (г - г), как если бы начало системы координат находилось в точке г (а если эта точка перемещается, то аналогично берется и импульс относительно импульса этой точки, например, при рассмотрении потенциала, создаваемого частицей / в точке, где находится частица j). Для системы движущихся частиц векторный потенциал будет складываться из потенциалов отдельных частиц. д. Замечания. 1. Использованные выше исходные выра- выражения для векторных величин, определяющих электромагнитное поле, имели чисто классический характер. При переходе к квантовой механике предполагается, что для системы частиц вместо классических величин вводятся соответствующие опера- операторы, а сама система в каждом состоянии описывается некоторой волновой функцией V, зависящей от переменных частиц, но не зависящей от переменных, определяющих поле. Часто говорят, что такой переход означает выполнение квантования исходного описания для рассматриваемой системы частиц. При этом электро- электромагнитное поле такой же процедурой не затрагивается, т.е. для поля сохраняется классическая картина. Никаких построений, связанных с переходом к квантовой теории поля, не вводится. Функцию Гамильтона и соответствующий ей гамильтониан записывают лишь для системы частиц во внешнем потенциальном поле. Это обстоятельство следует помнить при обсуждении в квантовой механике тех или иных эффектов, обусловленных электромагнитным полем. 2. Описание влияния электромагнитного поля на систему (даже если оно рассматривается классически) весьма сложно, поскольку в общем случае приходится учитывать неоднородность поля, т.е. наличие градиентов компонент поля Еа иЯа(а= 1, 2, 3), вторых производных этих компонент и т.д., а также то, что у самой системы имеется отклик на влияние поля, например перераспреде- перераспределение электронной плотности, что определяет поляризуемость системы, ее магнитную восприимчивость и тому подобные характеристики. И еще больше усложняет картину наличие у частиц собственных магнитных моментов, обусловленных их спином, о чем речь пойдет в следующем параграфе. 3. При рассмотрении многих достаточно тонких эффектов, <* 131 L
таких как структура спектров электронного парамагнитного резонанса или ядерного магнитного резонанса, приходится учитывать те члены в гамильтониане, о которых выше сказано ничего не было и которые, в частности, обусловлены взаимодей- взаимодействием магнитных моментов частиц с полем и между собой. Об этих слагаемых гамильтониана речь будет идти тогда, когда будут обсуждаться соответствующие эффекты (см. § 1 гл. VIII). §5. Спин В 1925 г. американские физики С. Гаудсмити Дж. Уленбек при объяснении оптических спектров атомов, а затем и поведения пучка атомов серебра в постоянном магнитном поле (опыты О. Штерна и В. Герлаха, 1922) сформулировали весьма интересную идею о наличии у электрона собственного магнитного момента. Эта идея в существенной степени уже назрела среди физиков того времени (например, в виде признания необходимости изменения тех или иных квантовых чисел на 1/2) и пусть не в столь явной форме, но высказывалась и А.Ланде, и В.Паули, и самими авторами эксперимента по расщеплению пучка атомов серебра. В опытах Штерна - Герлаха изучались атомы серебра в основном состоя- состоянии, в котором электронный угловой момент должен был бы равняться нулю. Однако в сильно неоднородном магнитном поле пучок таких атомов расщеплялся на две компоненты, что свиде- свидетельствовало о том, что у этих атомов есть какой-то магнитный момент, не связанный непосредственно с орбитальным моментом. Расщепление на две компоненты к тому же говорило о том, что для этого момента 2/+ 1 = 2, так что / = 1/2. Этот совсем уж необычный результат заставил искать правдоподобные объяснения, что сначала привело к мысли о вращении электронов вокруг некоторой собственной оси (подобно планетам) и наличии связанного с таким вращением дополнительного момента количества движения. По этой причине дополнительный момент был назван спином (англ. to spin — вращаться подобно веретену) и обозначен символом s. Однако дальнейший анализ привел к выводу, что такое объяснение неудовлетворительно, так как тогда электрон должен был бы иметь конечные размеры, а это вызвало бы новые затруднения в постро- построении теории. а. Релятивистская теория. Попытки объяснения существования дополнительного момента стали выглядеть гораздо 132 более реалистичными, когда возникло стремление построить релятивистскую квантовую теорию. Для одного электрона релятивистское уравнение было введено П.А.М.Дираком в 1928 г.1 Оно получило название уравнения Дирака и имеет вид, формально аналогичный уравнению Шредингера: dt B.5.1) однако гамильтониан Дирака HD кардинально отличается оттого,что есть в уравнении Шредингера. Он, во-первых, линеен по импульсам: U — n-i-nn-i-nn— mf-fK СУ S Э\ а во-вторых, коэффициенты ах, а , az и р представляют собой уже не обычные числа, а матрицы размера 4x4. Как удалось придти к такому гамильтониану, обсуждать не будем, хотя это и весьма интересно. Тем не менее из того, что а/ и р - матрицы, следовало простое утверждение: функция Ч* должна быть не обычной, привычной скалярной волновой функцией, а вектором с четырьмя компонентами XV = Ф2 Xi Хг) B.5.3) из которых две - Х\ и Х2 ~ ПРИ скоростях движения электрона, заметно меньших скорости света с, должны быть существенно меньше двух других - Ф1 и Ф2. Плотность вероятности обнаруже- обнаружения электрона в данной точке пространства задается выражением р(г,0 = Ф+Ф = <?>>! + Ф*2Ф2 + XiXi + Х*2Х2 • Уравнение A) и гамильтониан HD B) были введены так, чтобы они не менялись при различных поворотах систем координат (в общем случае - при преобразованиях, не меняющих расстояний между точками). Такое же условие в действительности выпол- выполнялось и для уравнения Шредингера: повороты системы координат, 1 Дирак Поль Адриен Морис A902 - 1984), английский физик, создатель релятивистской квантовой теории электрона, один из создателей метода вторичного квантования. 133
отражения в плоскостях и инверсия (см. гл. IV) не меняют ни оператора Лапласа, ни потенциала в этом уравнении. Существенное отличие преобразований, выполняемых при рассмотрении реляти- релятивистского уравнения Дирака, заключается в том, что эти преобра- преобразования выполняются не в обычном трехмерном пространстве, а в четырехмерном пространстве, включающем 3 пространственные и 1 временную переменные. Такие преобразования носят название преобразований Лоренца. При рассмотрении того, какие величины являются инвариантными при преобразованиях Лоренца и коммутируют с гамильтонианом Дирака, было найдено весьма интересное следствие: угловой момент количества движения L2 и проекции Lv, Ly и L. с HD не коммутируют, тогда как для видо- видоизмененной, модифицированной векторной величины L + S, также имеющей смысл момента импульса, такие коммутационные соотношения выполняются. Следовательно, собственные функции оператора HD должны быть одновременно собственными для оператора J2 = (L + SJ и, например, для оператора Jz = Lz + Sz (либо какой-нибудь другой проекции). О чем говорит полученное следствие? Оно говорит о том, что если правила построения операторов координат и импульсов, сформулированные в § 1 гл. I, были правильными, то при переходе к моменту импульса эти правила должны быть изменены: вместо углового момента L необходимо в действительности рассматри- рассматривать момент L + S. Добавка S имеет такие же общие свойства, что и у обычного, углового момента: имеются 4 оператора Sx, S , Sz и S2, удовлетворяющие обычным для момента коммутационным соотношениям: B.5.4) причем эти операторы коммутируют с операторами углового момента: [La, S^\ = О, а, |3 = х, у, z. б. Матричное представление операторов спина. При рассмотрении теории момента количества движения было уста- установлено, что операторы момента могут быть записаны в виде матриц порядка 2/ + 1. Для спина они определяются матрицами а , а , а имеющими следующую структуру ах = ( О о v О ау = О а у v о I 0 о О 134 где а , а и о - квадратные матрицы размерности 2x2. Если пренебречь в волновой функции Ч/ C) малыми компонентами х, и у , то останутся лишь векторы в двумерном пространстве /ф на которые собственно и будут действовать матрицы о: оЧ9. Из теории, базирующейся на релятивистском уравнении Дирака и коммутационных соотношениях, следует, что матрицы о. могут быть выбраны в следующем виде: оу = B.5.6) i О Эти матрицы носят название матриц Паули. Операторы спина свя- связаны с матрицами Паули весьма простым образом: й _ Й _ Й 2°*' у~!°у' z~2°z '1 О О 1 Собственные функции для операторов S2 и Sz при таком выборе матриц а1 будут определяться следующим равенством: B.5.7) = 5 У Z 2l2 Ф1 КФ2 1 О 0-1. ф 1 V*2 Ф Из второго равенства следует, что X = Й/2 или -Й/2. Если "К = Й/2, то ему отвечает собственная функция = ф о!' тогда как собственному значению \ = -Й/2 отвечает функция / 0 \ \ф2/ Очень часто функцию Ч* записывают как Ф,а, а функцию х?2 как Ф2Р, где аир- символы, указывающие, какому собственному значению оператора Sz принадлежит та или другая функция: +Й/2 или -Й/2. В атомной системе единиц эти собственные значения 135
равны 1/2 и -1/2, соответственно. По аналогии с функциями Ф( и Ф2 символы аир часто также называют спиновыми функциями, или спин-функциями, хотя все изложенное выше свидетельствует о том, что аналогия такого рода имеет достаточно формальный характер аналогии такого рода. Как и для обычного момента, для операторов спина можно ввести операторы повышения-понижения: S+ = Sx iSy = /О О о, S_ = Sx - iSy = 1 0\ О/ B.5.8) Например, при действии S+ на функцию Ч^ = Ф,а она переходит в нуль, а при действии его на функцию Ч*2 = Ф2C она переходит в ЙФ7а: (О 1\ о о /О О О О ?. о Спин для каждой частицы определяется спиновым квантовым числом 5, входящим в собственное значение оператора S2. Он присущ как элементарным, так и составным частицам, например ядрам атомов тех или иных элементов. Обычно число s также называют спином частицы: для электрона s = 1/2, для протона s = 1/2, для дейтрона 2Н s = 1, а, например, для ядра атома бора |0В спин 5 = 3. (Отметим, что для одной частицы используется, как правило, строчная буква s , для системы частиц - прописная буква 5 , тогда как спин ядер обычно обозначается буквой Г). в. Сложение спинов. Для системы частиц спин вводится согласно равенству: 5 = У 5,-, при этом каждый из операторов S. должен действовать только на ту спиновую функцию, которая связана с i-Pi частицей. Так, для двух электронов получатся следующие спиновые функции (пространственные функции типа Ф, и Ф2 выписывать не будем, ибо на них операторы спина не действуют): , ф2-РA)аB), , ср4 = РA)РB) B.5.9) (в скобках указаны номера электронов, к которым относятся соответствующие спиновые функции). Подействуем на эти функции оператором Sz = Szl + Sz2 и учтем, например, то обстоятельство, что спиновые функции аA) и аB) являются собственными для операторов Sz] и Sz2 с одним и тем же собственным значением, равным 1/2 в атомных единицах: 136 Ф, = (Sz, + Sz2)a(l)aB) - [5 ,аA)]а 2 аB)] = ^аA)аB) +-аA)аB) = 1*аA)аB) = 1-ф,, 52ф2 = 0, 5гф3 = 0 и 52ф4 = -1-ф4. Действие оператора 52= E, + 52J = S2 + 2S1*S2 + 522 осложняется присутствием перекрестного члена S{-S29 который можно представить в виде ,S2+) + 5, S2z. B.5.10) С учетом этого представления далее уже не столь сложно найти, что 2z S2+)]a(l)aB) = , S2+ = 1-A + l)a(l)aB) = 1A + 1)ф, (т.е. 5 = 1); ф3; ф,; 2' ф4. Следовательно, функции ф, и ф4 - собственные для S2 с собственным значением 5E + 1) = 1-A + 1) = 2. Функции же ф2 и ф3 таковыми не являются, однако их линейные комбинации (ф2 + ф3) и (ф2 - ф3) - собственные для 52с собственными значениями 1*A + 1) и 0-@ + 1) соответственно. В итоге получаются 3 функции, относящиеся к собственному значению со спиновым квантовым числом 5 = 1 и различающиеся проекциями на ось z: +1, 0 и -1 , а также одна функция, относящаяся к собственному значению со спиновым квантовым числом 5 = 0. Число, указывающее количе- количество различных спиновых функций при данном 5 и равное 2S +1, носит название мультиплетности состояния; компоненты мультиплета отличаются друг от друга проекциями на некоторую ось, например, осьг. В рассмотренном примере функции a(l)aB), a(l)PB) + P(l)aB) и РA)рB) суть компоненты триплета, а аA)CB) - рA)аB) - синг- летная функция. Для одного электрона возможны две функции аA) и РA), относящиеся к одному и тому же собственному значению с s = 1/2, так что эти две функции - компоненты дублета. г. Спин и магнитное поле. Как было сказано в предыду- предыдущем параграфе, при наличии внешнего однородного магнитного поля в гамильтониане появляется дополнительный член, опреде- определяемый магнитным моментом частицы: -/iB0. При учете спина 137
магнитный момент будет складываться из орбитального и спино- спинового магнитных моментов: fi} + /i5, и если для электрона ц} = (q/2mc)L, то для спинового магнитного момента электрона вновь возникает несколько неожиданное, хотя и следующее из теории и опыта выражение: /is = (q/mc)S, так что полный магнитный момент для системы электронов в этом случае приобретает следующий вид B.5.11) 2тс Для других частиц, имеющих ненулевой собственный момент (спин), множитель перед S будет другим: так, для протона этот множитель равен 5,5854, а для ядра 17О атома кислорода он равен -0,7572 (отметим, что спин этого ядра равен 5/2). В общем случае, следовательно 2^k f2mkc причем gk носит название гиромагнитного отношения. Даже если система находится в состоянии с нулевым орби- орбитальным моментом, у нее может быть ненулевой спин, что приво- приводит, как и в случае атомов серебра, к проявлению в магнитном поле состояний с различными проекциями спина. д. Спин и симметрия волновой функции. Если в квантовой системе имеется несколько одинаковых частиц, например электронов или протонов, обладающих одними и теми же зарядом и массой, то различить эти частицы, сказать, какая из них первая, а какая вторая и т. д. невозможно. Эта неразличимость приводит к тому, что при перестановках индексов одинаковых частиц в волновой функции плотность вероятности меняться не должна, т.е. волновая функция при таких перестановках может лишь менять знак либо вообще должна оставаться без изменений. Оказывается, что волновая функция ведет себя различно при таких перестанов- перестановках в зависимости от спина одинаковых частиц, входящих в систему: если спин s каждой частицы в системе одинаковых (тождественных) частиц равен полуцелому числу, как, например, для электронов, то при любой перестановке пары индексов этих частиц волновая функция должна менять знак на противопо- противоположный; если же спин s равен целому числу, например для дейтро- дейтрона / = 1, для ядра атома 6Li / = 1 и т.п., то в этом случае волновая функция при любой такой перестановке должна оставаться без изменений. Другими словами, волновая функция системы частиц 138 с полуцелым спином s антисимметрична относительно переста- перестановок индексов частиц, а с целым спином полносимметрична. При этом под индексом частицы подразумевается ее номер как в про- пространственной, так и спиновой части волновой функции. Сформулированное утверждение о симметрии волновых функций относительно перестановок индексов частиц было доказано В.Паули в 1940 г.1; оно было введено задолго до этого доказательства, в самом начале развития квантовомеханических представлений, и часто носит название принципа Паули. Это же название обычно используется и для упрощенной формулировки принципа, когда волновая функция системы электронов записыва- записывается через одноэлектронные функции (орбитали). е. Пример. Пусть для системы двух электронов волновая функция имеет вид: W(l,2) = фA,2)аA)РB), где 1 и 2 - номера (индексы) электронов. Переставим в этой функции местами индексы первого и второго электронов: WB,l) = фB,1)аB)РA). Ни функция W(l,2), ни функция Ч>B,1) в общем случае не являются ни симметричной, ни антисимметричной. Однако из них можно составить такую их линейную комбинацию, которая требуемым свойством обладать будет. Действительно, функция Ч>A52) = 441,2) - Ч>B,1) = фA,2)аA)рB) - фB,1)аB)рA) при перестановке индексов 1 и 2 меняет знак на противоположный, т.е. является антисимметричной относительно такой перестановки. Задачи 1. Построить для системы трех электронов спиновые функции, собственные для операторов Sz и S2. 2. Что произойдет с триплетным уровнем (например, атома углерода в основном состоянии) при наложении постоянного магнитного поля? 2 Паули Вольфганг A900 - 1958), выдающийся швейцарский физик, один из главных участников создания квантовой теории. Им также было введено A927) квазирелятивистское уравнение для электрона, предсказано существование нейтрино и сделан заметный шаг в развитии теории относительности. В исходном варианте A925) указанный принцип был сформулирован как принцип запрета на наличие в атоме двух эквивалентных электронов, для которых значения всех четырех квантовых чисел совпадают.
Глава III Приближенные методы решения задач квантовой механики § 1. Вариационный метод Необходимость в методах отыскания приближенных решений уравнения Шредингера определяется тем, что круг точно решаемых задач весьма ограничен, тогда как такие задачи, как определение квантовых состояний молекулярных систем, вообще точных решений не имеют. К тому же в большинстве случаев такие решения и не нужны, поскольку всегда требуется знать молекулярные свойства лишь с определенной точностью, знать поведение системы в тех или иных условиях лишь при определен- определенном интервале изменений, допуске начальных данных о системе, например, знать поведение систем в химических реакциях лишь при определенном статистическом усреднении результатов по отдельным элементарным актам химических реакций и т.п. Подчас нужна даже более качественная информация: будет ли система стабильной в заданных условиях, будет ли она сравнительно легко реагировать с заданными другими системами и т.п. Для установления закономерностей в изменении тех или иных величин также обычно не требуется слишком уж высокая точность. Поэтому нужны такие приближенные подходы, которые при оптимальной затрате сил и времени давали бы возможность получать результаты требуемого уровня точности. а. Вариационный подход. Одним из наиболее широко используемых является вариационный метод, базирующийся на следующем построении. Каждое дифференциальное уравнение, как правило, может рассматриваться как уравнение, определяющее такие функции, на которых те или иные функционалы достигают экстремальных значений. При этом под функционалом подразу- подразумевается правило, которое ставит в соответствие каждой функции из некоторого класса функций число. Например, каждой ограничен- ограниченной функции Ц)(х), заданной на отрезке [а, Ь], ставится в соответ- соответствие ее значение в некоторой точке х0 этого отрезка: ^[ф(*)] = ф(х0)' в частности, в точке а или в точке Ь, либо интеграл от этой функции 140 по всему отрезку: F2[q>(x)] = fq>(x)dx, либо интеграл от ее квадрата а модуля: "* и т.п. Все это будут различные функционалы на данном классе функций. В квантовой механике функционалами являются, например, средние значения операторов < а > = Гг|> *Atydx на функциях, имеющих смысл волновых функций квантовой системы, т.е. непрерывных вместе со своими первыми производными, ограниченных и обладающих интегрируемым квадратом модуля, либо нормируемых на 6-функцию. При рассмотрении функционалов на заданном классе функ- функций, например функций с интегрируемым квадратом модуля, мож- можно, как и для обычных функций, сформулировать задачу о поиске их экстремумов, т.е. о поиске таких функций из этого класса, на которых функционал достигает экстремальных значений. Так, можно попытаться найти среди всех возможных функций вида г|> = Рп(х)е~*х , где Р (х) - полином не выше я-й степени, такую функцию, которая на всей оси была бы наиболее близка заданной функции/(х), например в смысле среднеквадратичного уклонения: 2 mm — 00 f(x) - dx причем в функциях г|> можно менять как коэффициенты полинома (лишь бы они были конечны), так и параметр ? > 0. Условия, определяющие экстремумы функционалов, очень похожи на те, которые имеются для обычных функций. Для функций достаточным условием экстремума служит обращение первой производной в некоторой точке х0 в нуль. Для функционалов также рассматриваются их приращения при изменениях тех функций, на которых они определены. Если функция ср(г) получает приращение 6ф(г), то функционал ^[срС*)] получает приращение F[y(x) + Ьср(х)] - F[q>(x)]. Главная линейная по 6qp часть этого приращения обозначается как 6/?[ф(д:)] и носит название (первой) вариации функционала F, тогда как 6ф называется вариацией функции qp. Для того, чтобы функционал F достигал экстремума на функции qp, достаточным условием служит обращение его вариации в нуль: bF — 0. Рассмотрим в качестве примера функционал энергии /(НО = <г|> | Н | г|» C.1.1) 141
и дадим функции ц> приращение бгр, считая для простоты, что функция \\) и ее вариация вещественны. Приращение функционала / будет определяться равенством: 1(\\) + бгр) -1(\\)) = <г|) + бгр | Я | гр + 6г|)> - <г|) Я г|» = = <Ь\\) Я <6г|) Линейная по 6г|> часть этого приращения есть вариация функционала/: = <6г|> C.1.2) Для функционалов типа A) характерно то, что умножение функции г|) на произвольный множитель а приводит к умножению функцио- функционала на |а|2. Поэтому любое значение /(xJj) можно уменьшить или (j) у и увеличить при умножении г|> на соответствующий множитель а (кроме случая /(г|>) = 0). Это означает, что ставить задачу об экстремуме функционала A) не имеет смысла до тех пор, пока мы не учтем ч Я x|j> отвечает энергии мы не учтем, что среднее значение <г|> Я x|j> системы только на нормированных функциях г|>. Для того, чтобы учесть условие нормировки, напишем вместо A) такое представление функционала энергии, которое автоматически сводит все к нормированным функциям: <ф|Я|ф> я ч», C.1.3) <ф|Ф> где г|> = <ф|ф> 1/2ф, т.е. г|> - нормированная функция, а ф - не обязательно таковая. Дадим теперь функции ф приращение 6ф. Тогда приращение функционала / будет выглядеть следующим образом: 6Ф] - Я 6ф> 7/ ф|Ф 6ф > <ф|Ф> Считая интегралы с приращениями в знаменателе первой дроби значительно меньшими <ф ф>, можно разложить первую дробь в ряд по степеням приращений в знаменателе и оставить далее лишь линейную по 6ф часть. Тогда вариация функционала как главная 142 линейная по 6ф часть приращения будет иметь вид: <6ф Я 6/[Ф]= Ф Ф < ф|Я|ф <ф|ф> < ф ф > = <Ф | Ф >-'[(<6ф | Я | ф> - /[ф]<6ф + (<Ф | Я16ф> -/[ф]<ф 6ф>)]. Функционал /[ф] - вещественное число, которое можно ввести под символ интегралов <6ф ф > и <ф 6ф>, а равенство 6/ нулю опре- определяет достаточное условие экстремума этого функционала: <6ф | (Н -1) | ф> + <ф | (Я -1) | 6ф > = 0, 6ф > = 0. либо, поскольку оператор Я- эрмитов, то C.1.4) <6ф | (Я - I) | ф> + Чтобы понять, что стоит за этим соотношением, необходи- необходимо сформулировать еще одно утверждение, известное как основная лемма вариационного исчисления: ь если интеграл fby(x)f(x)dx равен нулю при произвольных а вариациях 6ф(дг), то подынтегральная функция f(x) всюду на отрезке [а, Ь] равна нулю. Эта лемма справедлива как при одной, так и при нескольких переменных интегрирования, причем пределы интегрирования могут становиться и равными ± оо5 лишь бы интеграл, написанный выше, существовал. Используя эту лемму применительно к D), приходим с учетом вещественности ф, 6ф и / к равенству (Я-/)ф = 0, C.1.5) т.е. функция ф, если она обеспечивает экстремум функционалу /[ф], должна удовлетворять уравнению на собственные значения, причем сам функционал на этой функции должен быть равен соответствующему собственному значению. Уравнение E) пред- представляет собой как раз то дифференциальное уравнение, которое определяет функции, называемые экстремалями, т.е. функции, на которых функционал / достигает экстремума. Для комплексных функций ф при эрмитовом операторе Я 143
получается аналогичное утверждение. Действительно, пусть ф = а + ib, а г|> = (Н-Г)ц) = с + й. Тогда соотношение D), как нетрудно убедиться, при условии вещественности функций а, Ъ, с и d, т. е при выполнении равенств <Ьа Ьа> и т. п., приводит к о = <с следующему уравнению: <Ьа \ о + <bb \ d> = 0. Функции а и очевидно, можно варьировать независимо, а это означает в свою очередь, что основная лемма вариационного исчисления приводит к двум равенствам: с = d = 0, т.е. к тому, что г|> = (Н - /)ф = 0. Уравнение D) показывает, что поиск экстремума функци- функционала /[ф], заданного выражением C), в конечном итоге сводится к поиску экстремума несколько отличного функционала Н\ г|»-/<г|> г|», где i|> = ф<ф ф>~1/2, а / - некоторое число. Оба подхода к поиску экстремалей, т.е. на основе выражения C) с ненормированной функцией ф и на основе функционала F[i|>] с нормированной функцией гр, эквивалентны. Число / при этом называется неопре- неопределенным множителем Лагранжа. Следовательно, нахождение безусловного экстремума функционала C) эквивалентно нахожде- нахождению условного экстремума функционала I[ty], т.е. экстремума /[i|>] при условии <г|) г|>> = 1, с помощью метода неопределенных множителей Лагранжа: вместо /[г|>] надо рассмотреть функционал F[i|>] = /[г|>] - к <гр | г|», где к - неопределенный множитель, который после решения вариационной задачи и нахождения функции г|> в общем случае как функции к определяется окончательно из соотношения <г|> 11|» = 1. Для временного уравнения Шредингера можно также построить функционал, определяющий решения этого уравнения как экстремали некоторого функционала, однако конструкция здесь получается более сложной (прежде всего из-за того, что оператор id/dt не является эрмитовым (об этом уже упоминалось в § 4 гл. I), и останавливаться на ней мы не будем. б. Вариационный метод. Итак, задачу нахождения решений дифференциального уравнения Шредингера можно свести к задаче поиска экстремалей функционала энергии. На основе этого утверждения можно предложить следующий подход к приближен- приближенному решению этого уравнения: выберем некоторый класс функций (например, содержащих параметры), составим функционал энергии на этих функциях и, варьируя функции в пределах выбранного класса (меняя параметры в них), найдем те, на которых функционал 144 энергии будет иметь экстремум. Полученные таким образом функции будут приближенными оценками для точных функций, и по мере расширения класса пробных функций эти оценки должны стремиться к точным функциям. При таком построении остается открытым вопрос, к каким именно точным функциям являются приближениями полученные оценки. И здесь дать более определенный ответ на вопрос можно не для всех, а только для так называемых ограниченных снизу (или сь^рху) операторов, к числу которых, как правило, относятся операторы Гамильтона, в частности для атомных и молекулярных задач. Ограниченным снизу оператором А называется оператор, во всей области определения которого, т.е. для произвольной нор- нормированной функции ф из этой области, справедливо соотношение <ф А C.1.6) где С - некоторая постоянная. Если для оператора Гамильтона Н той или иной конкретной задачи неравенство F) выполнено и если существует такая функция ф0, на которой в этом соотношении достигается равенство, то очевидно, что функционал энергии на этой функции <ф0 Н | фо> будет иметь минимум и, следовательно, согласно вариационному подходу, функция ф0 должна быть соб- собственной для Н: 7/ф0 = ?"офо, а постоянная Ео и будет минималь- минимальным значением функционала энергии1. На всех других функциях Ф функционал энергии будет иметь значения, большие Е (в общем случае значению Е() могут отвечать несколько функций ф , т.е. минимальное собственное значение может быть вырожденным): <Ф |Н\ ф> ъЕ . C.1.7) Это неравенство носит название вариационного принципа квантовой механики: среднее значение оператора Гамильтона на любой функции ф из класса допустимых нормированных функций всегда больше минимального значения энергии Ео для рассмат- рассматриваемой квантовомеханической системы; оно становится равным ему тогда и только тогда, когда функция ф совпадает с собственной функцией 7/, относящейся к собственному значению Ео. 1 То, что функции ф0, на которых достигается равенство, существуют не для любого оператора А, можно убедиться на конкретном примере оператора импульса рх = -idfdx, если в качестве области определения его рассматривать лишь функции из 82 (с интегрируемым квадратом модуля): как уже говорилось в гл. I, собственные функции рх в этом пространстве не содержатся (можно, однако, показать, что они могут быть определены как пределы некоторых последовательностей из 8 145
Состояние с минимальной энергией носит название основ- основного, все остальные состояния с большей энергией - возбужден- возбужденных. Следовательно, та функция из класса пробных функций, кото- которая дает минимальное значение функционалу энергии на этом классе, будет служить оценкой для точной функции основного состояния. Коль скоро при этом ищется минимум функционала энергии, то говорят, что полученная оценка на данном классе функций является наилучшей по энергии. Естественно, что при таком подходе остается проблема возбужденных состояний. Однако и для них можно сформулировать утверждения типа представленного неравенством G), хотя и в не столь удобной форме. Именно: собственное значение Е первого возбужденного состояния служит нижней границей функционала энергии на всех тех функциях ф, которые ортогональны ф0 , т.е. точной собственной функции основного состояния: <Ф | Н | ф> г» Ех для всех ф таких, что <ф | фо> = 0. C.1.8) Минимум этого функционала достигается на той функции ф , которая является собственной для Н с собственным значением Для следующего (второго) возбужденного состояния поиск должен вестись среди функций ф, ортогональных одновременно точным собственным функциям ф0 и ф1 и т.д. в. Линейный вариационный метод. Часто пробные функ- функции ф выбирают в виде линейной комбинации некоторых известных функций хк (к = 1, 2,..., я), которые задают на основе тех или иных физических соображений, отвечающих конкретной физической задаче: п Ф= C.1.9) к-\ Следовательно, меняться в функции ф могут лишь коэф- коэффициенты ск (при условии, что <ф ф> = 1), тогда как функции %к играют роль некоторого базиса, на который натягивается простран- пространство линейных комбинаций (9), представляющих пробные функции Ф (поэтому функции хк и называются базисными). Функционал энергии имеет в этом случае вид: Н п п Ф>= где Hkl = к,1=\ к,1=\ Н Х/> - величины, которые могут быть вычислены, поскольку функции хА известны. Их обычно называют матричными элементами гамильтониана в базисе функций хг Для нормирован- нормированных функций где так называемые интегралы перекрывания Skl э < хк | х, > также могут быть вычислены. Как было сказано выше, поиск экстремума /[ф] при условии нормировки функции ф эквивалентен поиску безусловного экстремума функционала ^[ф] = /[ф] - е <ф ф> , а в данном конкретном случае - поиску безусловного экстремума квадратичной функции переменных ск и ct: C.1.10) Базисные функции хк всегда могут быть выбраны нормированными, тогда как ортогональными друг другу они быть не обязаны: Skk = 1, и в общем случае Skl * 0 при к * I (согласно неравенству Коши - Шварца S ? 1). Экстремум функционала ^[ф] - это то же, что и экстремум функции /, и достаточными условиями для его сущест- существования будут следующие: Э/ / дск - 0 и df I дс*к = 0 для любого к (если ск вещественны, то эти два условия совпадают, если же комплексны, то ск и с*к можно считать независимыми переменными, поскольку ск = ак + ibk, с\ - ак - ibk, вещественные величины ак и Ьк независимы, так что коэффициент с\ линейно независим от ск). Итак, дс, C.1.11) дс, ш\ 1, L.^ ...,А7. Вторая система уравнений, отвечающая условиям д//дск - 0, отличается от первой переходом к комплексно-сопряженным вели- величинам, поскольку Н1к = <xl\H\xk > = < X* | н I X/ >* = Н*н и аналогично Sik = 5^ • Если перейти от д//дск к (д//дск)*, то получится та же самая система уравнений, что и первая, но вместо е будет стоять е*. Беря тогда разности соответствующих пар урав- уравнений, получим соотношения вида (е - е*)^/^*/с/ = 0, показываю- 146 147
вающие, что е = е*, т.е. множитель е - вещественный1. По этой причине вторую систему можно далее не рассматривать, оставив лишь первую. Система уравнений A1) есть система линейных одно- однородных уравнений относительно неизвестных с . Она имеет нетривиальные решения только тогда, когда ее определитель из коэффициентов Hkl - eSw перед неизвестными обращается в нуль: det{Hkl-ESkl} = 0. C.1.12) Этот определитель, если его развернуть по обычным правилам вычисления определителей, будет представлять собой полином я-й степени относительно е, а корни полинома будут определять те значения е, при которых у системы A1) есть нетривиальное решение. Матрицы с элементами // и S - эрмитовы. В этом случае существует теорема, согласно которой уравнение A2), называемое вековым (или секулярным) уравнением2, будет иметь п вещественных корней, из которых для оценки энергии основного состояния нужно выбрать низший (т.е. минимальный). После нахождения корней е/ (i = 1, 2, ..., я), для каждого из них можно получить соответствующее решение системы A1), причем для каждого i у коэффициентов с при этом должен быть введен индекс, указывающий номер решения, например с1Г Каждое решение будет определять лишь относительные величины коэффициентов с (уравнения однородны!), тогда как абсолютные их величины можно найти, если воспользоваться условиями нормировки: l любого L Записав коэффициенты си (/ = 1,2, ..., п) в виде вектор- столбца с( , а интегралы Нк{ и S - в виде матриц Н и S, можем представить систему уравнений A1) в матричном виде: (Н - E.S)c.= 0 (i = 1, 2, ... ,л). C.1.13) Суммы ок ~2,iSkiCi для всех к равняться нулю не могут, поскольку °к =^11<Хк Xi>ci = ^i<Xk\ciXi >=<Х*|ф> .т.е. функция ср, если бы все ок = 0, была бы ортогональна всему пространству функций, натягиваемому на %к •> а коль скоро она сама принадлежит этому пространству, то ф и 0. Название происходит от вековых возмущений движения планет, при описании которых появляются подобного типа уравнения (лат. secula - век). И наконец, если выписать последовательно друг за другом все столбцы с , с2,..., с , образовав из них квадратную матрицу С , а числа е; записать в виде квадратной диагональной матрицы Е (с нулевыми недиагональными матричными элементами), то уравне- уравнения A3) могут быть записаны в наиболее общем виде: НС = SCE. C.1.14) В линейном вариационном методе, называемом также методом Релея - Ритца, получается п решений, отвечающих п собственным значениям задачи A4), причем эти решения взаимно ортогональны и могут быть нормированы: Левая часть последнего равенства в этой записи представлена в виде скалярного произведения вектора с. на вектор с , или, что то же, - в виде произведения вектора-строки с} на вектор-столбец Sc. Матрица S при таком представлении играет роль метрики, определяющей форму задания скалярного произведения для линей- линейного пространства, натянутого на векторы с- У/Ot/C/. Из этих решений для описания основного состояния нужно выбрать низшее по энергии. Возникает естественный вопрос: могут ли быть для чего- либо полезны остальные функции? Оказывается, могут, причем по существу в не меньшей степени, чем та функция, которая отвечает основному состоянию. Существует очень важная теорема (на ее доказательстве останавливаться не будем), которая сводит- сводится к тому, что если упорядочить собственные значения (энерге- (энергетические уровни) точной задачи в порядке их возрастания: Ео ? Ех ? Е2 ? ... , и упорядочить таким же образом собственные значения линейной вариационной задачи A4): е^е^е^ ... s еп, то каждое из чисел е. будет оценкой сверху для соответствующего значения Е: е а ?. (i = 1, 2,..., п). При этом каждая из функций (9), отвечающая собственному значению е., будет наилучшей по энергии оценкой точной волновой функции /-го состояния системы (принцип минимакса Р. Куранта). Следовательно, теорема дает обоснование тому, что линей- линейный вариационный метод позволяет получить оценку для возбужденных уровней энергии, а также оценку для соответ- 148 149
ствующих волновых функций. Для произвольного вариационного метода, в котором фигурируют нелинейные вариационные параметры, утверждений типа указанной теоремы сформулировать уже нельзя. г. Пример. Рассмотрим одномерную задачу со следующим оператором Гамильтона: 2 н= - 1 d 2m dx2 + -кх1 2 +1 o l C.1.16) Если бы в этом операторе не было последнего члена, то мы имели бы обычную задачу о гармоническом осцилляторе с оператором Hh , решения которой нам известны (см. § 5 гл. I). Попробуем теперь найти оценку для собственных значений и собственных функций гамильтониана A6) с помощью линейного вариационного метода. Выберем для простоты в качестве базиса первые четыре собственные функции гармонического осциллятора [см. равенства A.5.14)и A.5.15)]: ; x, = 41 4л C.1.17) - 4 причем 2; = л/тк . Запишем пробную функцию вариационного метода в виде c*Cj < Н\ х>, и тогда функционал энергии будет таким / = учтем далее, что Н = Hh + V, причем функции х - собственные для оператора Hh : Поэтому <х, | Н| х> = <Х, | НЪо+ V | х> = Ej <х; | Х> + <Х,-1 v\ X> - = ЕЬГ + V , где учтено то обстоятельство, что функции х, и X, взаимно ортогональны E. = 6..), а также введено обозначение Vi = <Х-1 ^|х>- Используя обычную процедуру вариационного исчисления при поиске экстремума / с дополнительным условием 150 J нормировки ф, найдем уравнения для определения коэффициентов с: 3 3 ' C.1.18) Прежде чем приступать к решению этой системы уравнений, необходимо найти интегралы F =<xj ^|x>=='fX/Wx .Л. Отметим, что при замене переменных х -* -х функции х0 и х2 переходят в себя, не меняя знака, т.е. являются четными функциями; четной функцией является и х ; в свою очередь, функции х и X ~ нечетные: они при такой замене переменных меняют знак на обратный. Поэтому интегралы V , у которых индексы i и/ имеют различную четность, равны нулю, как интегралы от нечетных функций. Выпишем теперь матрицу системы A8), расположив для большей ясности ее структуры функции х, в порядке хо> Х2' Е о е + ч) ^20 0 0 0 ^02 Е2-г + 0 0 Е 0 0 'i — ? + V v3l 0 0 Е3-е .C.1.19) Для того, чтобы система уравнений A8) имела нетривиальное решение, необходимо обращение в нуль ее определителя, т.е. определителя матрицы A9). Структура матрицы A9) показывает, что он равен произведению двух определителей второго порядка, равенство нулю которых приводит для каждого из них к уравнению второй степени относительно неизвестной е : (е - Eof - (Е2 - Ео + V00 + У22)(г - EQ) - V2QVQ2=0; 2QVQ2 Vn+ V33)(e-E1) C.1.20) Решения первого из этих уравнений: Л . C.1.21) Вычисление интегралов с невозмущенными волновыми функциями 151
A7) оператора Гамильтона гармонического осциллятора приводит к следующим конкретным выражениям дляэтих интегралов: 1 1^5 22 = v - у = 20 02 2л/я! Если / достаточно мал, так что квадратичным по / членом под корнем можно пренебречь, то е, как и следовало ожидать, выража- выражается только лишь через диагональные члены (верхняя матрица второго порядка в A9) становится диагональной): eQ = Е + VQQ и е2 = Е2 + V2V что соответствует знакам "-" и "+"перед корнем в B1). Если же величиной V2QVQ пренебречь нельзя, то корень можно разложить в ряд и ограничиться лишь линейным членом с ео = У 02 г2 = Е2 +V22 (E2+V22)- C.1.22) Наконец, подставляя эти выражения в уравнения A8) для определения коэффициентов с и с , получим, например, для функций Фоиф2: Ф0 = с о Хо- 20 (E2+V22)-(E0+Vm) Х2 = Хо Si = С2 20 Хо +Х2 Х2 C.1.23) (Ъ 1 {(Е2+У22)-(Е0+Уж) Равенства B2) показывают, что при / > 0 собственные значения увеличиваются (в основном за счет членов, линейных по ': ^оо и ^22^ так что УРОВНИ энергии повышаются, причем с учетом величин матричных элементов V.. можно сказать, что повышение второго возбужденного уровня г сильнее, чем основ- основного eQ. При этом надо помнить, что и та, и другая величина - оценки сверху для точных значений, и насколько они уклоняются от точных значений, сказать на базе вариационного принципа без дальнейшего анализа нельзя. Что же касается волновых функций, то в основном состоянии при / > 0 происходит увеличение плотности при значениях х вблизи нуля, а точнее при |х| < 1/у2^ , и уменьшение ее при больших значениях |jc| . При отрицательных / наблюдается 152 обратная картина (см. рис. 3.1.1). У функции ф2, как следует из выражения B4), при / > 0 плотность вблизи нуля уменьшается, зато максимумы становятся несколько выше и сдвигаются в сторону меньших значений х ; соответственно меняется картина и при / < 0. Для функций ф1 и ф3 и собственных значений е] и е3 общие выражения выписываются без труда, если заменить в соотноше- соотношениях B2 -24) индекс 0 на индекс 1, а индекс 2 - на индекс 3- Так, C.1.25) C.1.26) (E3+V33)-(E,+Vn)' Ф, = ci Xi- 31 (E3+V33)-(El+Vn) Хз Что же касается численных значений матричных элементов V , К31 и Г33, то они здесь несколько больше по абсолютной величине, чем в предшествующем случае: • V = V = I 7 31 13 Это, в частности, приводит при отрицательных / к уменьшению расстояния между основным и первым возбужденным уровнем по мере роста |/|: 18/2 Аналогичная картина наблюдается для разности 9/ 11/ - е2 - со - д. Заключительные замечания. Представленный в настоящем параграфе вариационный подход применим к задачам дискретного спектра при условии ограниченности (снизу) оператора Гамильтона- Можно ввести соответствующую конструкцию и для других задач, в том числе и для тех, в которых время фигурирует явно и требуется использовать временное уравнение Шредингера. Хотя эти конструкции часто более сложны, чем представленная выше, тем не менее, вариационный подход в большинстве случаев дает весьма мощные способы построения и отыскания приближен- приближенных решений квантовомеханических задач. Правда, как уже отмечалось, вариационный метод дает 153 А
обычно лишь одностороннюю оценку, например сверху. При необходимости получить двусторонние оценки приходится затрачивать существенно больше сил и времени. Обычно вместо построения таких оценок используют интуицию к опыт предшест- предшествующих расчетов, позволяющие примерно представить себе, како- какова возможна ошибка при конкретной реализации того или иного вариационного подхода. Задачи 1. Для задачи об атоме водорода найти а и Р , при которых пробные функции а) гр = е~аг; б) г|>2 = е~^г (а, C > 0) дают минимум функционалу энергии. 2. Для задачи о гармоническом осцилляторе (масса т = 1, силовая постоянная к = со2) найти вариационную оценку для энергии основного состояния с пробной функцией г|> = с1 е* + с2 е~2а х (ее - фиксированная постоянная, большая нуля). 3. В эрмитовой матрице А л-го порядка выделен блок 2 х 2 из элементов первых двух строк и первых двух столбцов. Что можно сказать о собственных значениях этого блока в сравнении с собственными значениями матрицы А? 4. Что изменится, если в линейном вариационном методе перейти от базисных функций.ха к функциям ^р = ^асарХа ? 5. Пусть задан базисный набор линейно независимых функций х, (ot = 1, 2,..., К) с матрицей интегралов перекрывания S: S = <ха %*>• Пусть далее для матрицы S определены собственные значения и собственные векторы: Sb = кЪ . Доказать, что X. > 0 (при любом /). 6. В условиях предыдущей задачи и при нормированных векторах b (b 1"b = 1) показать, что а) матрица L. = X.b.-bi" имеет в качестве собственных значений одно значение к и К- 1 значение, равное 0; К ' t б) матрица L = \ ktbtb] имеет те же самые собственные 1=1 значения и собственные векторы, что и матрица Ь, так что она совпадает с S; К 1/2 в) матрица SI/2 = 5)^' Ь.Ь.Т (к. > 0) обладает теми свойствами, что SI/2S1/2 = S и (SI/2)t = S. 154 7. Показать, что векторы С. = SI/2c, где ci - решения уравнения A3), взаимно ортогональны. 8. Показать, что если определить матрицу равенством S/2 = У ^S~l/2 Ч'Ь .*,то от набора базисных нормированных функций Х„ (Xa^SXo = 8aa) можно перейти к набору базисных ортонормиро- ванных функций § с помощью соотношения 2= = ^а Ха (^ )аа (такие функции носят название функций, ортонормированных по Лёвдину). § 2. Стационарная теория возмущений Другой метод приближенного решения задач квантовой ме- механики носит название теории возмущений. Постановка задачи здесь весьма проста: по известным решениям некоторой исход- исходной задачи восстановить решения другой, слабо отличающейся от нее задачи. Существует довольно большое число различных вариантов теории возмущений, из которых мы ограничимся в су- существенной степени лишь одним для стационарных задач и од- одним - для задач, в которых учитывается явная зависимость от времени. В настоящем параграфе будут рассмотрены стационар- стационарные задачи. а. Общая постановка задачи. Пусть требуется найти ре- решения стационарного уравнения Шредингера для квантовой си- системы с гамильтонианом Н и пусть известны решения задачи с некоторым гамильтонианом HQ, например для модельной системы с тем же числом частиц. При этом HQ считается близким к Н, система с гамильтонианом Н рассматривается как возмущенная система по отношению к модельной системе, в качестве оператора возмущения выступает V = Н - HQ9 так что Н = HQ+ У. Что подразумевается под близостью Н к HQ, будет пояснено несколько позднее. Итак, требуется найти собственные функции Ч*к и собствен- собственные значения Ек оператора Н, если известны собственные функ- функции W^ и собственные значения Е^ оператора HQ. Введем оператор //^согласно равенству Нх = HQ + XV, который совпадает при к = 0 с HQ, а при к = 1 - с Н, и представим собственные функции и собственные значения Нк в виде рядов по степеням к: 155
C.2.1) + ... . C.2.2) Если подставить эти ряды в уравнение Шредингера (к) ? Ek(k)Wk(k) и принять, что оно выполняется при всех к на некотором отрезке изменения к, например на отрезке [0, 1], то множители, стоящие в правой и левой частях этого уравнения при одинаковых степенях А,, должны быть равны. Это условие приводит к следующей системе равенств (слева выписаны соответствую- соответствующие степени к): C.2.3) [Я0 - Ek@)] = (- V 1 Первое из них показывает, что ?Л@) и 4^@) совпадают с и соответственно. Второе определяет VJ^ и ^ третье - Ч^ и ?"jp и т.д. При этом будем считать, что мы рас- рассматриваем лишь состояния дискретного спектра, так что функции , которые далее ради единообразия будем обозначать как , нормированы на единицу. Умножив второе из равенств C) на W> ** слева и проинте- проинтегрировав по всей области изменения переменных, т.е., другими словами, взяв скалярное произведение W^ и (Яо - получим . C.2.4) Поскольку оператор 7У0, а вместе с ним и оператор HQ - E^ эрмитовы, то в левой части равенства HQ - E^ можно перевести на первое место: (Я„- =0. Это показывает, что в равенстве D) слева стоит нуль. Поэтому >-V C-2.5) Умножим теперь то же самое второе равенство слева на 156 (т * к) я проинтегрируем по всей области изменения пере- переменных. Воспользовавшись вновь эрмитовостьюТУ и ортогональ- ортогональностью Ч^°) и Wi°\ получим: fit Л P C.2.6) Введем теперь еще одно предположение о системе собст- собственных функций оператора HQ: будем считать, что эта система является полной (см. п. д § 3 гл.1), так что любую функцию "' можно записать в виде ряда Фурье по функциям @ш@) с ,(O m у т Из этого равенства следует, что C.2.7) C.2.8) поскольку обычная процедура умножения G) слева на Ч^* и интегрирования ведет сразу же к равенству (8). Таким образом, стоящий в выражении F) интеграл < Ч^ Ч^1* > есть не что иное, , и тогда C.2.9) как коэффициент разложения W^ по функциям V mk Е @) m @) Штрих у знака суммы означает, что суммирование ведется по всем тем невозмущенным состояниям, у которых энергия от- отлична от Е^. Здесь мы встретились с еще одним интересным обстоятельством: в Ч*^ не входят все те функции, которые имеют ту же энергию Е^, что и W ^, т.е. функции вырожденного набора. Обозначим их через Ч^(/ = 1, 2, ... , К), где К - кратность вырождения. При записи уравнения E) молчаливо предполагалось, что данному значению энергии Е^ принадлежит лишь одна волновая функция Ч* ^ . В действительности же К может быть и больше единицы. Более того, при наличии вырождения любая из функций ] > должны ]у , как и любая их линейная комбинация удовлетворять первому из равенств в C). Следовательно, Ч* @) не 157
б. Пример. Рассмотрим пример предшествующего пара- параграфа, а именно, задачу об осцилляторе с гамильтонианом 1 1 , # = - -А + ~кх2 + на базе теории возмущений. Невозмущенным оператором Н бу- будем считать гамильтониан гармонического осциллятора, а возму- возмущением -оператор V = 1 х . Невозмущенные уровни энергии яв- являются невырожденными, поэтому вся конструкция теории возму- возмущений здесь может использоваться именно для этого случая. Итак, ?<0) = о)(к + 1/2), к = 0, 1, ... и kk 4,@) * Am" "ктУтк . - m) ¦B) _ Как и при использовании вариационного метода, ограничимся в этих выражениях лишь первыми четырьмя уровнями энергии и соответствующими невозмущенными волновыми функциями. Кроме того, вновь учтем структуру матрицы V, что позволяет без труда выписать следующие соотношения: а) для основного состояния {а = @) = _ l_ 00 ~ „ Е = B) = 0 ^02^20 / @) а б) для второго возбужденного состояния 5ш 2 5/ ^02 I @) _/r@) 2 -^0 F - 2 + 5/ 2а 1 i 2 2а 4wa Если вспомнить выражения для энергии C.1.22), полученные в рамках вариационного подхода при условии, что корень в C.1.21) допускает разложение в ряд, то можно убедиться в наличии единственного различия: оно заключается в отсутствии у поправок 160 второго порядка Е^ и Е^ в знаменателях разности V22 - ^ Это различие подробнее будет обсуждено в следующем пункте. в. Замечания. 1. Построение рядов теории возмущений осу- осуществляется по достаточно простым алгоритмам, а потому теория возмущений широко используется в расчетах характеристик атом- атомных и молекулярных систем. В отдельных задачах, где матричные элементы V вычисляются сравнительно легко, используются и весьма высокие порядки теории возмущений (до сотого). Тем не менее, обычно ограничиваются лишь первым и вторым, а при более точном анализе - третьим и четвертым порядками. 2. За редкими исключениями используется конечный набор невозмущенных функций, что, по существу, приводит к пред- представлению оператора возмущения матрицей V конечного порядка. Матрица HQ невозмущенного оператора Гамильтона в базисе функ- функций, собственных для этого оператора, диагональна, и на диагонали стоят значения энергии невозмущенных состояний: Е\\У матри- матрицы V в общем случае отличны от нуля как диагональные, так и недиагональные элементы. Выделим из V диагональную матрицу D , а оставшуюся матрицу обозначим как W : V=D+W. Матрицу D далее можно объединить с HQ. При этом собст- собственные векторы (т.е. невозмущенные функции) останутся без изменений, а собственные значения (уровни энергии) изменятся: ?(°) =>?(°) + у . Это простое рассуждение показывает, что для теории возмущений существенна лишь недиагональная часть V, что и проявилось в вариационном методе на примере соотношений C.1.22): знаменатели в них представляют собой не разности ?@)_?@)? а величины (?@) + Vj _ (Е@) + у^ те как раз разности собственных значений матрицы Н + D . Если бы мы строили теорию возмущений именно с такой невозмущенной мат- матрицей, то получили бы выражения, точно повторяющие C.1.22). Таким образом, невозмущенные уровни энергии можно в существенной степени выбирать произвольно, влияя тем самым на сходимость ряда теории возмущений. При этом соответ- соответственным образом будет меняться лишь диагональная часть матрицы V. 3. Использование теории возмущений оправдано тогда, когда возмущение мало, т.е. когда ряды теории возмущений сходятся. Однако эти ряды подчас можно использовать и тогда, когда сходимости нет, ограничиваясь лишь их первыми членами 6 — 1395 161
(порядками), поскольку при этом получаются оценки, имеющие, как можно показать, отношение к вариационному методу и его модификациям. Недостатком таких подходов является то, что теория возмущений не позволяет сказать, получается ли соответ- соответствующая оценка оценкой сверху или снизу. Поэтому разработаны комбинированные подходы, объединяющие достоинства как теории возмущений, так и вариационных методов, и носящие название вариационно-пертурбационных подходов (вторая часть этого термина от англ. perturbation - возмущение). Задачи 1. Выписать формулы теории возмущений для энергии в 3-м порядке и для волновой функции во 2-м порядке. 2. С помощью теории возмущений оценить собственные значения (вплоть до 4-го порядка) и собственные векторы (в первом порядке) матрицы Н а с с b где a, b и с - вещественны. Рассмотреть случай а = b . 3. С помощью теории возмущений оценить собственные значения матрицы Н 2 -0. 0. 5 5 -0 2 -0 .5 .5 0 -0. 3 .5 .5 § 3. Временная теория возмущений а. Возмущения, зависящие от времени. Если возмущение явно зависит от времени, то необходимо рассматри- рассматривать временное уравнение Шредингера C.3.1) В этом случае условие малости возмущения, помимо всего проче- прочего, будет определяться моментом времени, в котором рассматри- рассматривается возмущенное состояние, и начальным состоянием. Будем 162 считать, что начальное состояние отвечает оператору Гамильтона Но , явно от времени не зависящему: Но = Н0(х), где х - совокуп- совокупность только пространственных переменных. Следовательно, мы предполагаем, что до момента времени tQ возмущение отсутству- отсутствует. Для такой ситуации частными решениями уравнения A) с гамильтонианом Но будут функции C.3.2) а общим решением - некоторая линейная комбинация частных решений с не зависящими от времени коэффициентами: Л. Как и в случае стационарной задачи, будем предполагать, что функции ФОк в каждый данный момент времени образуют полный набор, т.е. любое решение A) может быть представлено в виде ряда Фурье по функциям Фок, коэффициенты которого, однако, в общем случае явно зависят от времени: ? °* . C.3.4) к Подставим это выражение в A) и учтем, что функции собственные для оператора Но. Тогда ^-*"' = V(x,t) ^ck 4>ok(x) е- к dt к что при скалярном умножении слева на ^01{х) (т.е. при умножении на 4*0/(х) и интегрировании по х) с учетом ортогональности собственных функций эрмитова оператора дает (для любого /): >e i(Eo!-Eok)t C.3.5) Таким образом, вместо исходного уравнения A) мы получим сис- систему вообще говоря бесконечного числа уравнений с неизвестны- неизвестными функциями времени ck(t), являющуюся системой обыкновенных дифференциальных уравнений первого порядка. Можно попро- попробовать решать эту систему итерационным путем, однако пред- предварительно для сокращения записей введем дополнительные \ обозначения: как и ранее, VJt) = V(x,t) ; ш№ = E0l - E № 0l Qk; Vlk(t, ш) = Vlke™lkt. Матричные элементы V[k(t) и V/A(f,to) в общем 163
случае явно зависят от времени. В этих обозначениях система уравнений B0) имеет вид: |сД0 = -^,ш)с,@ (/=1,2,...). C.3.6) Будем теперь считать, что ck(t) медленно меняются в зависимости от t, поэтому после включения возмущения в момент времени t за достаточно малый промежуток времени от *0 до t коэффициенты ск в правой части уравнения F) постоянны, например ск = ck(tQ). Тогда эту систему уравнений можно проинтегрировать: t (tst 0 где J-, - постоянная интегрирования. При t = tQ это соотношение переходит в c?tQ)= ?,, так что в первом приближении C.3.7) [0 Если воспользоваться теперь этим выражением и вновь подста- подставить его в правую часть уравнения F), а затем проинтегрировать, то получим выражение для функций c,(f) второго приближения: 'о к,т t' 'о C.3.8) Продолжая итерации далее, приходим к бесконечному ряду с чле- членами того же типа, что и в уравнении (8), но со все увеличиваю- увеличивающимся числом интегралов от *0 до t в каждом члене. Эта конструк- конструкция очень похожа на то, что было в теории возмущений для стационарных задач (т.е. в стационарной теории возмущений): если бы с самого начала перед оператором V в F) мы поставили параметр X, то в разложении вида (8) первый член не зависел бы от к, т.е. это был бы коэффициент ак в соотношении C), второй член зависел бы от X линейно, третий - квадратично и т.д. Другими словами, это было бы разложение коэффициента c(t) в ряд по степеням X. Справедливость подобного разложения зависит прежде всего оттого, насколько приемлема начальная аппроксима- аппроксимация коэффициентов ct(t) постоянными величинами ct(t0) на всем 164 рассматриваемом интервале времени, а также от того, как ведут себя последовательные члены ряда (т.е. члены при последо- последовательных степенях К): убывают, возрастают, осциллируют и т.д. Отметим, что ограничение в (8) первыми двумя членами носит название первого борновского приближения ( по имени известного немецкого физика М.Борна), а первыми тремя - второго борнов- борновского приближения. Если в момент времени t = *0 возмущение отсутствует, то волновую функцию в этот момент времени можно записать в виде соотношения C). Умножая выражение (8) на Ч* Jx)e~lE°lt и суммируя по /, получим с учетом выражения D): ф 0/ ф0> [0 C.3.9) 1>т t0 t0 Этот ряд уже представляет не отдельные коэффициенты ct(t) , a волновую функцию возмущенной квантовой системы в момент времени t. Здесь также первые два члена в правой части опреде- определяют первое борновское приближение, которое, в частности, отчетливо показывает, что интегралы Сdt <Ф0/1 V\ Фо> суть не что иное, как коэффициенты разложения поправки первого порядка ФA) к функции Фо в ряд по исходным невозмущенным функциям Фо/. Далее мы ограничимся лишь первым борновским приближением, считая, что по крайней мере при малых временах после включе- включения возмущения V(x,t) в момент времени t = tQ это приближение справедливо. Рассмотрим тот частный случай, когда возмущение может быть представлено в виде произведения двух сомножите- сомножителей: V(x), зависящего только от пространственных переменных, и Д*), зависящего только от времени. Такое возмущение появляется, например, когда квантовая система попадает в поле монохро- монохроматической световой волны, и в каждой точке напряженность электрического и магнитного полей определяется векторным потенциалом -IU)/ А = А0(гу В частности, для плоской монохроматической волны А0(г) = = А е0'1", где п - направление распространения волны и пт - ска- скалярное произведение векторов п и г, т.е. проекция г на это направ- направление. При таком представлении потенциала в виде V(x) • f(t) 165 L.
функция Ф(г,*) первого борновского приближения запишется так: ) = Ф0(дс,г) - i^a , C.3.10) так что зависимость функции Ф(г,*) от времени в первом порядке теории возмущений будет определяться интегралом Фурье для функцииДг). б. Пример: плоская монохроматическая волна. Рассмо- Рассмотрение взаимодействия квантовой системы с электромагнитным полем обычно проводится в предположении, что поле может быть описано классически (см.§ 4, гл. 2). Возмущение квантовой системы полем определяется теми членами в гамильтониане Н , которые зависят от потенциалов поля: 2 1-1 *Щ V С / ?| где г и р( - радиус-векторы и векторы импульса каждой частицы системы, q. - заряды частиц, U - их "внутренний" потенциал взаимодействия между собою, а А(г, t) и ф(г, t) - векторный и скалярный потенциалы в точке нахождения частицы L Следова- Следовательно, Н = Н + V и п 1 о V = c C.3.12) 2mtc Монохроматическое электромагнитное излучение характеризуется тем, что потенциалы A(r.,f) и qp(iy) могут быть записаны в виде произведений координатной и временной функций: -№t причем за счет определенного произвола в выборе потенциалов поля (так называемой градиентной инвариантности) скалярный потенциал такого внешнего электромагнитного поля может быть принят равным нулю: Ф0(г.) = 0, а векторный потенциал может 166 дополнительно удовлетворять условию divA0(r) = 0. Следователь- Следовательно, возмущение V с учетом того, что р.*Ал('г.)'Ш = divA • to + An(r.V 5,-гр, Mr I 0^ \* U ¦ \f^- l" Л *¦ может быть представлено так: „2 . C.3.13) zf2mic " ^ ¦: Г2т1с После того, как возмущение определено, вернемся к функции <f>(x,t) первого борновского приближения A0) в предположении, что до включения возмущения система находилась в стационарном состоянии Фо = ФОЛ(*,0> так что согласно определению C) функции Фо все коэффициенты ат равны нулю за исключением ak: am = Поэтому из соотношения A0) с учетом A3) можно написать: о/ nijC '0 о/ Aj 4* ok C.3.14) 'o Если напряженность внешнего электромагнитного поля мала, то вторым членом возмущения, квадратичным по Ао, можно прене- пренебречь. Далее, t'-t f-t0 i(co/Jk-a>X'-'o) /((о ft - w) . Aw Sin—- Аш/2 , C.3.15) где Aw = ш/А - ш. Первый сомножитель в этом выражении по модулю равен единице, так что на определение вероятности пере- перехода он не влияет. Второй сомножитель (положим в нем ради прос- простоты *0 = 0) представляет собой функцию Д*;ДоУ) = sin(^ Дшп/(Дш / 2), параметрически зависящую от Аш и ведущую себя так, как пока- показано на рис. 3.3.1. Она меняется в пределах от 2/Дш до - 2/Аш, причем по мере уменьшения Дш, т.е. по мере приближения частоты 167
плоской монохроматической волны к частоте ш/А период /() увеличивается, и при (Ato*/2)sl/4 эта функция представляет собой (в пределах 1 %) линейную функцию времени: /(*;Дш) = t. Чтобы понять, что означает условие, при котором Рис. 3.3.1. Функция = sin(Ao>* / 2)/(Аа> / 2). можно заменить на t, вспомним, что выражение Аш/2 записано в атомных единицах. В этой системе единицей времени служит 1.а.е.в. «2,565*10-17с, а единицей энергии 1 а.е.э. -2,195-105 см-1. Поэтому, если время взаимодействия световой волны с молекулой отвечает хотя бы нескольким десяткам периодов колебаний, то для излучения в видимой области (ш « 104 + 3-Ю4 см1) это время должно составить « 10 - 13 с , т.е. « 104 а.е.в. Величина АШ/2 будет меньше 1/4, если Дш s 1/2* « -10'4 а.е.э., т.е. <; 10 см; амплитуда функции/(/;Дш), равная 2/Аш, при этом будет не меньше «104, т.е. будет достаточно большой. Такой результат означает, что коэффициент перед функцией Фо/ в соотношении A0) или A4) становится достаточно большим, что в свою очередь говорит о том, что функция ФОк к моменту времени t по существу переходит в функцию Фо/: Фок -+ Фок + ЬФ0Г и если Ь»19то нормированная функция в момент времени t будет практически совпадать с Ф . При увеличении времени взаимодействия разность частот Дш уменьшается обратно пропорционально этому времени, а амплитуда 2/Дш увеличивается линейно со временем взаимо- взаимодействия. Вероятность же перехода в единицу времени будет определяться квадратом модуля матричного элемента оператора i = Z \(r)'Pp K более детальному рассмотрению которого мы теперь и перейдем. 168 Этот матричный элемент включает интегралы <хи a /pVn Ф > C 3 16} О/ 0V 1х Ж / Ок которые зависят от конкретного вида координатной части А0(г) векторного потенциала внешнего поля. Так, для плоской волны А (г) = А00*е1кг , где к - волновой вектор в направлении распро- распространения волны (длина которой равна ш/с), а вектор Аоо имеет постоянные компоненты (они, в частности, определяют фазы коле- колебаний волны по разным направлениям). Для сферической волны Ап(г) = — eikr-n , где п - единичный вектор в сферической системе координат по направлению г и т.п. Если начало системы координат находится в центре масс молекулы, то существенной для вычисления интеграла A6) является та область изменения г , где волновые функции Ч* и Ч* заметно отличны от нуля. Эта область для атомов составляет величины порядка 10 - 1 нм, для (неполимерных) молекул обычно 10° - 102 нм. Область же частот инфракрасного, видимого и ультрафиолетового диапазона простирается от 102 до 105 см (соответствующие длины волн составляют 105 - 102 нм), так что величины кг для плоской или сферической волны могут меняться в пределах от 10~6 до 10°. Это означает, что, как правило, длина волны заметно больше "разме- "размеров" молекулы и в пределах этих размеров функцию А0(г) можно либо принять постоянной, либо в крайнем случае считать ее линейной функцией г: А0(г) = Аоо + Вт, C.3.17) где Аоо - постоянный вектор, а В - матрица с компонентами ( а, р = х, у, z). Подставим выражение A7) в интеграл A6): > + < учтем далее то обстоятельство, что представленные в правой части интегралы можно преобразовать на основе следующих соотношений: n = im(H г -г-Н } Н Ф = F Ф * 2х.р — imlH X: —Х;Н ) + i ; C.3.15) jrXj Л О J J 0/ v 7 х.р + у.р . = im(Hjcy - x.yHX и, наконец -Ь, о х р . + Ь у р - Ху jryj yx^j^XJ (х.р + у.р ) + yx , C.3.19) 169
где / = хр - ур , a b и b - некоторые числа. Чтобы не ¦^ z * у у г х ху ух г загромождать текст дальнейшими выкладками, обсудим лишь простейшую задачу, когда В = 0, т.е. когда векторный потенциал А (г) можно принять постоянным вектором Ао0. Конечно, это, казалось бы, противоречит определению векторного потенциала, поскольку он задан всегда с точностью до градиента некоторой функции, в качестве которого можно выбрать вектор Аоо , так что в целом векторный потенциал обращается в нуль. Однако при этом следует помнить, что представление вектора А (г) постоянным вектором является лишь локальным, лишь в той небольшой (по сравнению с длиной волны) области, где допустимо разложение в ряд и обрыв его на первых членах. Итак, пусть А (г) = А . Тогда о* = А >. C.3.20) Подставляя это выражение наряду с равенством A5) в выражение A4) и ограничиваясь только линейными по Ао членами, получим: nijC Aw/2 I <Щ <v Ok Aw/2 Фш. C.3.21) В матричном элементе последнего равенства фигурирует оператор У ?,г, = D,T.e. оператор дипольного момента всей совокупности частиц, входящих в рассматриваемый атом или молекулу. Коль скоро этот матричный элемент (а точнее - его квадрат модуля) в конечном итоге и определяет вероятность перехода из состояния Фп, в состояние Фп/ , мы приходим к заключению, что в первом борновском приближении при взаимодействии монохроматической плоской электромагнитной волны с молекулой вероятность пере- перехода молекулы из одного квантового состояния в другое должна быть пропорциональна квадрату модуля матричного элемента дипольного момента перехода, записанного на функциях Фо/ и Фог 170 В классической теории картина взаимодействия излучения с молекулой в известной степени похожа. Предполагается, что каждая частица в молекуле совершает периодическое движение, так что в целом у молекулы имеется дипольный момент D, который может быть представлен в виде ряда Фурье по частотам периодических движений. Ради простоты предположим, что у рассматриваемой системы ("молекулы") имеется всего одна час- частота колебаний ш. Тогда: D = Do + DjCos^f + 6j) + D2cosBw* + 62) + ... Излучение с частотой ш поглощается такой системой, причем интенсивность поглощения пропорциональна D^ и кубу частоты ш. Следовательно, вместо квадрата модуля матричного элемента дипольного момента перехода здесь выступает квадрат амплитуды составляющей дипольного момента, колеблющейся с частотой ш. в. Вероятности переходов. Выше мы получили выражение для коэффициента c((t) в первом порядке теории возмущений, квадрат модуля которого должен быть пропорционален вероятности перехода из состояния Фок в состояние Ф . Опуская все промежуточные выкладки, выпишем выражение для вероятности перехода в единицу времени под влиянием внешнего электромагнитного поля: где введено обозначение = < >2 + < + < 2, а р(ш/А) - плотность электромагнитного излучения, предпола- предполагаемого ради простоты изотропным, т.е. таким, для которого все компоненты вектора А00 одинаковы по модулю: |Л00 | = |Л00 | = . Согласно классической электромагнитной теории эта 00,г плотность имеет вид: 1к 2с чю, где Аоо - длина вектора Аоо . Если молекула первоначально находилась в состоянии Ч* то под влиянием излучения с частотой шг она перейдет в состояние Ч* с вероятностью W^. = Д/_#.р(ш/.), причем, как следует из рас- рассмотрения предыдущего пункта, В^. = В , поскольку индексы j и / в этом рассмотрении были равноправны. Этот переход с излу- излучением будет вынужденным, поскольку его определяет внешнее поле. Однако молекула из более высокого по энергии состояния 171
может переходить в более низкое состояние и самопроизвольно, спонтанно. Пусть вероятность такого перехода будет равна Л^. Эту вероятность можно определить на основе процедуры, пред- предложенной А.Эйнштейном и опирающейся на рассмотрение термо- термодинамического равновесия между двумя состояниями с энергиями EQ. и EQl. Если число молекул в состоянии с энергией EQ. равно N., а в состоянии с энергией EQl - iV;, то согласно закону Больцмана, определяющему распределение частиц (молекул) по состояниям при равновесии, отношение этих двух чисел будет равно « ¦» i ¦• w t~ * I ? * й' I t~ * ж М * й' / М * й' Ж/ /А/ —г* / м ш I ——§-* 1кй 4l\ Ik ш /Л/ / i\i ^^ & '-Jf\v '*¦* / ^ *^п/ **¦¦* ^^ ^ \jj I./ i\>j. где Г- температура, а Л - константа Больцмана, равная (если ак выражена в см ) следующей величине: к = 0,69496 см-'-К-1. Число молекул, переходящих за единицу времени из состояния) в состояние /, равно г = NW а из состояния / в состояние j С, . = NW, . + ЛГА, . . При равновесии эти два числа должны быть равны, что приводит к следующему соотношению (с учетом равенства W^. и Далее, поскольку W t = В _/р(шг), то /-7 = \е J ~ U Р(ш(/)"°у—/ * C.3.22) При равновесии излучения с веществом плотность энергии излуче- излучения р(шг) определяется законом распределения излучения Планка: что сразу же позволяет преобразовать выражение B2) : т.е. вероятность спонтанного излучения также определяется квадратом матричного элемента дипольного момента перехода, но зависимость от частоты иная. Отметим, что величины А. ,, А^. hBw носят название коэффициентов Эйнштейна. г. Дополнительные замечания. 1°. В ходе представленного выше рассмотрения было сделано довольно много различных упро- упрощающих предположений, в том числе было принято, что 172 А0(г) = Аоо. Если учесть следующие члены разложения Ао по степеням х, у, z, то появляются матричные элементы квадру- польного и более высоких электрических моментов, которые стано- становятся определяющими в случаях, когда матричный элемент дипольного момента по тем или иным причинам обращается в нуль. Не были учтены и члены, пропорциональные квадрату векторного потенциала, а эти члены, очевидно, должны становиться значи- значимыми тогда, когда интенсивность излучения велика, например, когда рассматривается мощное лазерное излучение. В этих ситуа- ситуациях играют заметную или даже доминирующую роль нелинейные по напряженности поля члены, появляющиеся в матричных элементах, содержащих А2. 2°. При введенных предположениях о виде векторного потенциала напряженность электрического поля определяется соотношением: 1 ЭА С" с dt = i — А с а магнитная индукция В = rotA = 0, что в конечном итоге и опреде- определило то обстоятельство, что интенсивность перехода связана с квадратом матричного элемента электрического дипольного мо- момента D. Если бы для А было использовано хотя бы чуть более сложное представление А = Аоо + Вт, то уже в этом случае появил- появился бы матричный элемент магнитного момента перехода, свя- связанный с оператором момента импульса (см. соотношение A9)). 3°. Наконец, при переходе к более высоким порядкам теории возмущений появятся матричные элементы переходов, обусловлен- обусловленных наведенным дипольным моментом в системе, т.е. поляри- поляризуемостью. Оператор поляризуемости </, появляющийся во втором порядке теории возмущений, имеет следующие матричные элементы: о/ C.3.23) причем коэффициенты с. зависят не только от частоты падающего света, но и от частот переходов wfc и <ог В общем случае вероят- вероятности переходов, определяемые оператором поляризуемости, будут отличны от нуля, если какой-либо матричный элемент оператора дипольного момента < Фо* ОФ0у > отличен от нуля и к = / (так называемое релеевское рассеяние света с той же частотой, что и частота падающего света ш), либо если произведение D Фо - >< ФОу D Фо/ > отлично от нуля, и происходит переход <Ф 173
с так называемой составной частотой ш - ш/л (стоксова частота рассеяния) или с частотой ш + Шд. (антистоксова частота рассеяния). Оба этих перехода отвечают комбинационному рассеянию света. § 4. Нестационарные задачи квантовой механики Предшествующие главы были в основном посвящены изучению стационарных задач, по крайней мере в тех случаях, когда разбирались конкретные примеры. Ниже будут коротко обсуждены те наиболее существенные аспекты, которые присущи задачам, требующим решения нестационарного (временного) уравнения Шредингера. а. Общая формулировка. При решении временного уравнения Шредингера встречаются две основные ситуации. В первой из них оператор Гамильтона Н явно от времени не зависит, однако начальное состояние квантовой системы таково, что отвечающая ему волновая функция Ф(г, t = 0) = Ч^г) собственной для оператора Н не является. Обычно при этом предполагается, что система собственных функций гр (г) гамильтониана Н образует полный набор, так что Vo может быть представлена в виде ряда Фурье по этому набору ХРО= 2/с^* ' a Решение временного уравнения Шредингера можно написать следующим образом: -iE>', C.4.1) причем коэффициенты с в этом разложении не зависят явно от времени и совпадают с таковыми в разложении V = 4*(t = 0). Пусть, например, в разложении A) присутствуют всего две функции грх и гр2: W(t) = с1гр1 е~^ + с2%е-^ , C.4.2) и пусть к тому же с, = с2. Тогда в начальный момент времени, т. е. при * = 0 Чг0=с1(гр] + г1J), а при tx = n/(E2-E]) эта функция перейдет в Ч'(^) = сге~т "( 2~El\ty\ — гр2)' далее еще через промежуток времени tx - вновь в функцию Ч*ои т.п. Другими словами, будут наблюдаться осцилляции с периодом т = 2л/(Е2 -Ег), который будет тем больше, чем ближе друг к другу находятся уровни энергии Ех и Е2стационарных состояний. Другой, чуть более сложный пример заключается в сле- следующем. Пусть в начальный момент времени t = 0 волновая 174 функция свободной частицы (ради простоты - движущейся в од- одном измерении) имеет вид нормированного гауссова колокола = iJ2a I я е'0* с максимумом в точке х = 0 . Собственные функции гамильтониана свободной частицы относятся к непрерыв- непрерывному спектру и имеют вид грА= 11/л/2л)е^ " k , где к- волновое число, меняющееся от -ос до +оо и связанное с ^соотношением к2 = 2тЕк. Коэффициенты разложения Чг() по функциям грА при t = 0 определяются обычным путем: 00 с к = J> к(х)Ч?0(х)±с = — 00 — 00 00 (здесь учтено то, что Се dx- \n I "к). Следовательно, в произ- — 00 вольный момент времени t вместо Ч^ будем иметь функцию Щх, t) = — 00 После небольших преобразований подынтегрального выражения придем к равенству: , 0 = C.4.3) .00 показывающему, что под интегралом один из сомножителей пред- ставляет собой осциллирующую функцию е ' , при t = О переходящую в единицу. Если бы в этой функции вместо к2 стояла первая степень к, то интеграл легко было бы вычислить. В результате получилась бы вновь функция типа гауссова пакета, но перемещающаяся со временем в пространстве как целое. Очевидно, что при наличии осциллирующего множителя с к2 не только положение исходной функции, но и ее форма будут меняться со временем. Такого типа образования с волновой функцией, существенно отличной от нуля в локальной области, в квантовой механике обычно называют волновыми пакетами, в данном случае это гауссов волновой пакет. 175
Во второй из указанных выше ситуаций предполагается, что оператор Гамильтона явно зависит от времени, причем эта зависимость появляется в некоторый момент времени t = t 9 например tQ= -ос или 0, когда "включается" взаимодействие рассматриваемой системы с внешним полем. До включения взаимодействия квантовая система, как правило, предполагается находящейся в одном из стационарных состояний, отвечающих гамильтониану без взаимодействия. Эта ситуация примерно та же, что и рассмотренная в § 3 при анализе взаимодействия с электро- электромагнитным полем, однако здесь зависящая от времени часть оператора Гамильтона, т.е. У(г, t), уже не предполагается малой. Как и при рассмотрении временной теории возмущений, волновую функцию можно представить в виде A), но теперь уже с коэф- коэффициентами с., зависящими от времени. Далее можно получить систему дифференциальных уравнений для этих коэффициентов и искать ее решения тем или иным методом. Очень часто во временных задачах волновую функцию конечного состояния Ч* (индекс / отвечает английскому final), определенную в момент времени t, выражают через функцию ЧГ начального состояния (при t = tQ9 индекс i отвечает английскому initial) с помощью оператора преобразования S(t, t0): C.4.4) Этот оператор, носящий название S-матрицы, не должен менять норму волновой функции, так что <УФ, \S4*. > = <Ч*. ]$tS\4fi > = <Ч*. |Ч*. >. Поскольку это соотношение должно выполняться для любой волновой функции рассматриваемой системы, то оператор S должен быть унитарным: Пусть теперь начальное состояние Ч*. совпадает с одним из стаци- стационарных состояний, например с qp.(f) = г|ге~'?'', а конечное состояние Ч^ представлено в виде ряда A). Тогда, очевидно, ск@ = <%(№,> = <Ф4@№> = <Ф4@1%,('о)> = SU, C.4.5) т.е. коэффициент ck(t) равен элементу 5к. матрицы S в базисе функций ф.(*0) и <pt(*). При соударении двух подсистем, что отвечает, например, задаче химической кинетики, гамильтониан явно от времени не 176 зависит, так что полная энергия системы в целом должна сохра- сохраняться (Е= Е). Попробуем теперь оценить вероятность перехода из начального <р, в некоторое конечное состояние ф^за единицу времени. Для этого сначала вычислим величину S?., определяе- определяемую равенством о Матричный элемент Skic учетом соотношения A) в отсутствие явной зависимости Н от времени может быть записан в виде 5 It t) = U ei(Ek~Ei)t, где Г.. не зависит от t, a X - некоторая fcA ' §' ki ki постоянная, которую определим далее. Теперь HEk-Et)x _j о ДЕк-Е^/2 _-i в Ек - , Вероятность перехода из состояния ф.в состояние ф^за единицу времени будет определяться выражением ии- ^х = 2 2 sin2 (ax / 2) az(x/2) При усреднении по достаточно большому промежутку времени можно считать, что х -* со, и воспользоваться далее хорошо известным в теории 6-функций пределом при х -* °° (см. также Приложение2 ирис. 1.2.4): sin ах ь/ ч hm —-— = ло(а) . х^>оо а х Следовательно, при достаточно больших временах х Постоянная к обычно в этих выражениях подбирается так, чтобы 2\Ц2п = 2л, в частности, используют следующий выбор: к = -i, 111
так что для вероятности перехода в итоге получим выражение W^=2n\Tk^b(Ek-E). C.4.6) Таким образом, в тех задачах, где оператор Гамильтона явно от времени не зависит, сохраняется полная энергия системы, что отражено в выражении F) наличием 6-функции, равной нулю при Ек* Ei9 а вероятность перехода из начального состояния qpf в конечное состояние ф^ определяется квадратом модуля матричного элемента Т , также не зависящего от времени. Эти матричные элементы образуют в целом так называемую Т-матрицу. Достоин- Достоинством использования S- и Т-матриц является то, что рассматрива- рассматривается вполне определенный канал реакции, т.е. переход из вполне определенного начального во вполне определенное конечное состояние, что позволяет выделять наиболее вероятные каналы, находить так называемые запрещенные каналы, для которых вероятность перехода равна нулю и т.п. б. Возбужденные состояния. При воздействии электро- электромагнитного поля система с вероятностью, зависящей от этого поля, переходит в другие состояния. В частности, система, находив- находившаяся в основном состоянии, переходит в возбужденные, а находившаяся в возбужденном состоянии - в другие возбужденные и в основное состояния. Помимо вероятности такого вынужденного перехода у системы в возбужденном состоянии есть вероятность самопроизвольного, спонтанного перехода в более низкие по энергии состояния1. Следовательно, в возбужденном состоянии система находится лишь конечное время, называемое ее време- временем жизни Г, а затем переходит в другое состояние. Соотношение неопределенностей "энергия-время" приводит в таком случае к заключению, что энергия квантовой системы в возбужденном состоянии не определена точно, а только лишь с некоторой дисперсией, оцениваемой соотношением (A?J a (Г~2)/4, если считать, что неопределенность задания времени определяется величиной Г (в известном смысле это верхняя оценка для А/, хотя и весьма грубая). Сказанное выше приводит к заключению, что каждое возбуж- возбужденное состояние в действительности не является стационарным, каждый возбужденный уровень энергии определен лишь с некоторой шириной Е ± АЕ. Представление волновой функции Ч* в виде A) 1 В равновесном состоянии при наличии электромагнитного излучения соотношение вероятностей переходов уже было рассмотрено в § 4 гл. II. 178 показывает, что возможна следующая интерпретация появления той или иной ширины у возбужденного состояния: имеется возбуж- возбужденное состояние с энергией Е 9 но наряду с ним у квантовой системы есть и другие состояния, отвечающие, например, энергиям Е < Е{, а кроме того есть фотоны с энергиями Е. - Е . У квантовой системы как таковой энергии разные, однако у объеди- объединенной системы "квантовая система + фотон" имеются вырож- вырожденные состояния с энергией Е , между которыми возможны переходы без каких-либо энергетических затрат. А это как раз и означает появление со временем состояний исходной квантовой системы с энергией Е < ?и фотона с энергией?.-?.,.даже если система в начальный момент времени находилась в "чистом" состоянии с энергией ?\ Подобные причины, приводящие кушире- нию уровней возбужденных состояний, действуют и в системах сложных частиц (например, атомов или молекул) при их столкнове- столкновениях друг с другом: полная энергия системы сталкивающихся частиц при этом не меняется, однако подсистемы из одних стацио- стационарных состояний могут переходить в другие, в том числе за счет перераспределения кинетической энергии подсистем на внутренние степени свободы, т.е. на относительное движение внутри подсис- подсистем. При этом у подсистем с разной вероятностью появляются разные стационарные состояния при сохранении полной энергии системы как целого. Такой эффект накладывается на описанную выше естественную ширину уровня, приводя к дополнительному уширению, носящему название уширения давлением. Мы не будем выводить формулы, определяющие ширину уровня, поскольку это потребовало бы от нас достаточно детальных рассуждений. Пока для нас важен сам факт уширения. Коль скоро химические реакции связаны обычно с переходами в возбужденные состояния, то этот фактор появления более или менее широких энергетических полос (вместо уровней) должен, очевидно, учиты- учитываться при разработке кинетических теорий. в. Туннелирование. При рассмотрении одномерных задач уже отмечалось, что при наличии потенциальных барьеров конечной высоты имеется определенная вероятность найти частицу в области, где высота барьера превышает энергию этой частицы (см.рис. 3.4.1). Даже если в начальный момент времени волновая функция W такова, что она, например, локализована в области I, а вне ее равна нулю, то в последующие моменты времени появятся ненулевые вероятности обнаружить частицу справа от исходной области локализации, т.е. в областях II и III. Другими словами, со временем 179
частица пройдет, "просочится" через потенциальный барьер и начнет двигаться вправо (х —> оо). Этот результат, конечно, радикально отличается от того, что получается в классической теории. С ним связано довольно большое число различных хорошо известных эффектов, в частности радиоактивный распад, термо- термоэмиссия электронов, так называемая предиссоциация молекул, ряд химических реакций при низких температурах и т.п. Для понимания всех этих процессов нельзя обойтись только стационарным подходом, хотя он и может служить исходным шагом, и необходимо в конечном итоге переходить к рассмотрению поведения нестацио- нестационарных систем во времени. III Рис. 3.4.1. Туннельное прохождение частицы через прямоугольный потенциальный барьер высоты V. Выше уже было сказано, что гауссов волновой пакет с течением времени даже в отсутствие внешних воздействий меняет свою форму. Если же на его пути встречаются препятствия из тех или иных потенциалов, то эти искажения формы становятся еще более значительными. Характерно однако то, что в A), как уже было сказано, коэффициенты с; остаются постоянными, если потенциальные препятствия не зависят явно от времени. Поэтому при распространении волнового пакета необходимо знать эти коэффициенты, следующие из разложения Ч* в момент времени t= О, а также и сами базисные функции г|>г(г)> по которым проводится разложение и которые являются решениями стационарной задачи. Зная и то, и другое, можно восстановить всю временную картину. Очень часто, однако, ограничиваются при таком анализе лишь свойствами волновых функций стационарных состояний. Для того, чтобы качественно понять, почему это можно делать, рассмотрим 180 бегло еще один пример. Пусть опять-таки одномерный потенциал имеет форму, показанную на рис. 3.4.1. Найдем стационарные решения этой задачи. При этом будем предполагать, коль скоро в данной задаче все состояния принадлежат непрерывному спектру, что нас интересуют только те решения в области III, которые отвечают монохроматической волне, распространяющейся в положительном направлении. При таком ограничении общий вид решения гр(х) будет следующим (Е < V) : Нос в области 1(х < 0): гр. = Ае + Be 1" в области II @ <; л;* а): лр2 = Се1" + (к- J2m{E - V)); в области III (х > а): ф = Fe (к = V2/w? ). C.4.7) Условия сшивания функций и их первых производных в точках разрыва потенциала (х - О, х = а) приводят к выражениям всех коэффициентов через какой-либо один из них, например черезЛ. Не будем выписывать все эти выражения, а представим лишь два из них: ^-<Г^12сЬка-/(---) к к) C.4.8а) •(к К\ ) -1 C.4.86) 2сЪка - i\ 1 shKa А. U k) \ Во временной картине функция гр3 представляет собой плоскую волну, распространяющуюся в положительном направлении х. Квадрат модуля ее дает (в некоторых относительных единицах, потому что функция гр(х) пока еще не нормирована) плотность вероятности найти частицу в соответствующей точке области III: к2к2 \А\ C.4.9) (здесь учтено то, что ch2x - sh2x = 1). В функции г^ первое слага- слагаемое отвечает такой же волне, хотя и с другой амплитудой, тогда как второе - волне, распространяющейся в отрицательном направлении. Если теперь записать некоторый волновой пакет со о то далее из него можно выделить в области I то слагаемое, которое отвечает пакету, распространяющемуся в положительном направ- 181
t лении и представляемому волновой функцией вида C.4.10) и пакету, распространяющемуся в отрицательном направлении (функция Ч* соответствующая второму слагаемому выражения tyx(k) в области I). В области III по выбранному построению будет лишь волновой пакет, распространяющийся в положительном направлении. Пусть (опять-таки ради простоты) коэффициенты ск отличны от нуля лишь в достаточно узкой области изменения к: i,s к s к2, причем всюду в этой области ck = l/yjk2 - кх . Коэффициенты Ак также можно заменить на некоторое их среднее значение Л. Тогда квадрат модуля функции A0) сведется к виду A\2fdkfdk'c*k.ckei{k-k>)x = 2 [l-cos(?2 - &i)x]. Аналогично будут записываться и квадраты модулей других компонент функции Ч* . При переходе к моменту времени t = 0 появятся более сложные зависимости, однако существенно то, что они будут представлять собой произведения квадратов модулей коэффициентов А, В и т.д. на некоторые более или менее одинаковые функции, зависящие от параметров, задающих волновой пакет. Поэтому о том, как распространяется пакет, какова вероятность обнаружить частицу в той компоненте волновой функции Ч*, которая отвечает пакету в области III, и какова вероятность обнаружить ее в той компоненте, которая в области I распространяется в отрицательном направлении - обо всем этом весьма качественно можно судить по относительным величинам В и F\ . Поэтому величины X/ = \F\ /\А\ и хг = Щ А А носят название коэффициентов прохождения и отражения соответственно. Если они вычислены для какого-либо определен- определенного к, то говорят, что эти величины относятся к каналу к. Так, используя выраженгие (9), получим: X/ = 4к2*2 2,2 A(V-Ek)Ek При больших значениях ка, т.е. при большой высоте той части барьера V~Ekb которая находится над рассматриваемым уровнем энергии Ек, либо при большой ширине барьера а или большой массе частицы т shica можно приближенно заменить на eKfl/2, так что выражение для коэффициента прохождения можно упростить до следующего: X/ 16 1 V J V Таким образом, коэффициент прохождения экспоненциально Рис. 3.4.2. Туннельное расщепление в потенциале с двумя ямами. убывает в зависимости от указанных параметров. Это - весьма важный качественный результат, широко используемый при обсуж- обсуждении различных квантовых процессов, связанных с эволюцией волновых пакетов1. г. Туннельное расщепление. Для того, чтобы выявить ряд дополнительных особенностей, связанных с нестационарными состояниями, рассмотрим еще один модельный пример. Выберем потенциал одномерной задачи в том виде, как он изображен на рис. 3.4.2: V = оо при \х\ > Ъ\ V = 0 при a s |x| s Ь\ V = Vo> 0 при |х| < а. 182 1 На рассмотрении коэффициента отражения останавливаться не будем, посколь- поскольку на основе соотношений (8) можно показать, что х+хг = 1, так что например, по мере увеличения высоты барьера волновой пакет практически полностью будет отражаться от такого препятствия. 183
Используя обычную процедуру записи решений в областях I, II и III в предположении, что рассматривается лишь ситуация, когда Е < VQ9 получим следующие выражения для волновых функций: симметричные (относительно инверсии х -» -х) решения , = Asin к(Ь + х) 4>n = BchKx [к- J2m(VQ - E) , cha = (ea + e"a)/2]; C.4.11a) антисимметричные решения xPl = A$ink(b + x); = BshKx [sha = (ea - e"a)/2]; C.4.116) Постоянные А и В, а также допустимые значения Лик определяются из условий сшивания этих функций и их первых производных в точках ±а, а также из условия нормировки. В частности, для кнк получаются следующие уравнения: в случае симметричных решений -kctgk(b -a) = кШкя, C.4.12а) где tha = sha/cha; для антисимметричных решений -kctgk(b - а) = кс±ка, C.4.126) где ctha = 1 /tha. Решать эти трансцендентные уравнения не будем, однако качественную картину можно получить, если представить графически правую и левую части этих уравнений и найти точки пересечения этих графиков, которые как раз и отвечают решениям. При построении графиков удобно перейти к переменной у = си и к преобразованным параметрам Л и к: Л = k/a = (E/V0)I/2, где a - 0 ; к = к/a = Такое преобразование удобно прежде всего по той причине, что Л2 + К2 = 1 и Л, X <; 1. Кроме того, обозначим аа как м, а а(Ь - а) - как см. В этих обозначениях уравнения A2) сводятся к следующим: -Acte смЛ = X th uk , -Actg смЛ = Л cth мл . На рис. 3.4.3 представлены графики правых и левых частей этих уравнений при с = 3, м = 1 (сплошные кривые) и при с = 3, м = 2 184 C.4.13) (пунктир). Решения Л8 и Ла8 получаются как абсциссы точек пересечения соответствующих графиков. При этом с выбрано равным 3 по той причине, что при меньших значениях в боковые ямы I и III уровни вообще не попадают: они все лежат выше вершины барьера. Симметричные и антисимметричные решения группируются попарно, и расстояние между уровнями каждой пары быстро стремится к нулю по мере роста высоты барьера. Обычно говорят, что эти уровни расщеплены относительно тех своих положений, когда высота потенциального выступа стремится к бесконечности. Оценить характер зависимости величины расщепления от параметров задачи можно так же, как в предыдущем примере. При больших значениях и\ гиперболические тангенс и котангенс могут быть приближенно записаны следующим образом: th uk = 1 - 2е~2и\ cth uk = 1 + 2е~2и\ -г А -4 О 0,4 0,6 0,8 Л 1.0 Рис. 3.4.3. Графическое решение уравнений A3) для задачи с потенциалом, изображенным на рис. 3.4.2 ( Л =^V/E ; а - графики функций A) / - - ActgcuA при с = 3, B) / = XthuX, C) / * kcthuk при и = 1; б - то же при и = 2; Л + X - 1). Если эти выражения подставить в A3), то, пренебрегая сначала величиной 2е~2и\ можно найти некоторое среднее значение Л, общее для обоих уравнений A3), а потом и соответствующие поправки ДЛ8 и AAas к этому среднему для симметричного и антисимметричного решений. Ограничиваясь при этом только низшей парой решений, можно заметить (в том числе и по графику рис. 3.4.3), что сиА должно быть примерно равным л, оставаясь тем не менее меньшим л, а Л должно быть близко к нулю, и так как к = vl - Л2 , то к должно быть близко к единице. 185 I
С учетом всех этих замечаний для величины расщепления -? = К0(Л2ю-Л28)-4У0ЛДЛ Е ?з-| -а о а Рис. 3.4.4. Локализация нестационарных решений. можно после ряда преобразований получить следующую оценку: где Е - некоторое среднее из Es и Eas. Следовательно, для расщеп- расщепления здесь получается результат, весьма похожий на тот, что был установлен в предыдущем примере для коэффициента прохождения: расщепление экспоненциально убывает с ростом таких ясных по своему физическому смыслу параметров, как масса частицы, расстояние уровня до вершины барьера и ширина барьера. Вернемся теперь к волновым функциям A1) рассматри- рассматриваемой пары уровней. При малых различиях кик для симметрич- симметричного и антисимметричного решений малы будут различия и норми- нормировочных множителей А и В. Если теперь взять в некоторый начальный момент времени / = О волновую функцию гр(х, 0) в ви- виде нормированной суммы симметричного и антисимметричного решений1: [ips(x) + ipas(x)] / V2 , то такая функция будет фактически локализована в левой яме (рис.3.4.4). В момент времени /, как уже говорилось в п. а, я №. as eiE>' г Множитель l/v2 введен для нормировки использованной линейной комби- комбинации функций tys и tyas, если они сами нормированы. Их же ортогональность обеспечивается различием в типах симметрии. 186 а для того, чтобы не терять наглядности при общении с комплекс- комплексными функциями, перейдем к плотности вероятности распреде- распределения частицы, т.е. к квадрату модуля волновой функции: В момент времени t0 = 0 плотность вероятности сосре- сосредоточена в левой яме: \у\2= (\\>s + ipasJ/2, тогда как через проме- промежуток времени Дг = tx - fo= л/ЛЕ она будет сосредоточена в правой яме и т.д. Плотность осциллирует из одной ямы в другую с перио- периодом 2к/АЕ. Казалось бы этот результат нам уже известен из п. а. Новое здесь то, что теперь у нас есть и оценка для А?, которая показывает, как будет меняться этот период в зависимости от параметров задачи. Каждое из состояний, локализованных в некоторый момент времени в какой-либо потенциальной яме, не является стационар- стационарным и со временем переходит из этой ямы в другую (если таковая есть). Так, два оптических изомера одного и того же вещества имеют одну и ту же энергию, и превращение одного из них в другой, как правило, требует достаточно большой энергии. Следовательно, такое превращение можно моделировать на основе только что рассмотренного примера. Тогда становится очевидным, что оба изомера не отвечают стационарным состояниям вещества: стацио- стационарные состояния описываются лишь симметричной и антисим- антисимметричной функциями и в этих состояниях никакой оптической активности не проявляется. Оптическим изомерам отвечают линей- линейные комбинации этих функций, поскольку при синтезе ( в момент t = 0) получается, например, какой-либо один из них. Из этой же модели ясно, что оптическим изомерам отвечает одна и та же средняя энергия, сами же изомеры со временем должны превра- превращаться друг в друга. Однако коль скоро в таких задачах энергии симметричного и антисимметричного решений различаются очень слабо, то и периоды превращений могут быть очень велики (годы и болееI. К тому же в таких "замедленных" задачах активно проявляется и еще один фактор: наличие внешней среды, внешнего окружения других молекул, статистическое влияние потенциала 1 Состояния с достаточно большими периодами превращений, напоминающие во многом стационарные состояния (в частности, волновые функции которых обладают интегрируемым квадратом модуля), хотя в действительности таковыми и не являющиеся, часто называют метастабильными состояниями. 187
I! которых, как правило, приводит к стабилизации тех или иных долгоживущих нестационарных образований. К сожалению, обсуждение этой проблемы выходит за рамки настоящей книги, хотя различные нестационарные состояния встречаются весьма часто в окружающей нас природе. г. Непрерывный спектр. Вероятность найти систему в момент времени t в том же самом состоянии, что и в начальный момент / = О, как следует из результатов п. а, определяется равенством что для дискретного набора уровней сводится к комбинации функций типа cos[(Ek - E)t], что также следует из примера того же пункта. В случае непрерывного спектра для вероятности P(t) выполнено аналогичное соотношение с заменой суммирования по дискретному набору уровней на интегрирование по соответствую- соответствующему интервалу сплошного спектра: где w(E) ? О - плотность распределения энергии в начальном состоянии. Если, например, w(E) = а при 0 zE &EY и w(E) = 0 при Е > Е{9 то для случая, когда непрерывный спектр занимает всю Положительную полуось энергий, будем иметь P(t) = 2а sin(Ext I 2) г Этот результат показывает, что вероятность убывает со временем. Можно показать (В. А. Фок и С. Н. Крылов, 1947 г.), что при достаточно общих требованиях к функции w(?), в частности, требовании непрерывности, вероятность остаться в том же самом состоянии убывает со временем по экспоненциальному закону: P(t) ~ e~°-\ так что привычная нам экспоненциальная форма радио- радиоактивного распада - это довольно общая особенность квантовых систем, связанная с тем, что начальное состояние лежит в области непрерывного спектра. Задачи 1. Доказать, что при операторе Гамильтона/f, явно от времени не зависящем, функция 4s = Y .с^грДгУ"^1', где ijj.(r) и Е, - соб- собственные функции и собственные значения Н, является решением временного уравнения Шредингера, причем коэффициенты с. от времени не зависят. (Учесть, что функции гр.(г) линейно независимы.) 2. Объяснить, что качественнно изменится в задаче с двумя потенциальными ямами (п. г), если ямы становятся различ- различными по глубине. 3. Получить выражения для коэффициентов прохождения и отражения в задаче с прямоугольным потенциальным барьером при Е > V. Меняются ли эти величины монотонно с ростом Е1 4. Оценить, как качественно изменится форма прямоуголь- прямоугольного волнового пакета Ч^х, 0) = 0 при х<~аи при х > -b9 W(x, 0) = с при -а ? х ^ —Ь , а > b > 0, если он проходит через прямоугольный потенциальный барьер. 188
Глава IV Теория симметрии в квантовой механике § 1. Законы сохранения а. Различные представления. Каждая квантовая система в том или ином квантовом состоянии определяется волновой функцией Ч*, которая может быть задана аналитически либо численно (ее значениями в отдельных точках пространства и в заданный момент времени). Она может быть представлена, как уже говорилось, и в виде ряда Фурье по полному набору базисных функций {%,}•> например собственных для некоторого оператора А: В таком случае функция Ч* полностью определяется набором чисел с.9 другими словами - числа с{ задают представление функции Ч* в базисе {%,-}- Эти числа, как уже говорилось, опреде- определяются равенством с. = <%. Ч*>. Если х; являются собственными для А, то говорят об ^-представлении. В рамках стационарной теории возмущений мы пользовались разложением по собственным функциям оператора Но , т.е. энергетическим представлением. Возможно разложение в ряд Фурье по собственным функциям оператора импульса Р, например для одномерной задачи - по собственным функциям оператора р = -i&A , т.е. по функциям Хк = Аке , где к - любое вещественное число, а Ак - нормиро- нормировочный множитель, равный \]42п для всех к. Выражения для коэффициентов ск9 зависящих теперь уже от переменной к, определяются аналогично тому, что имело место в случае дискрет- дискретного спектра: с(к) = цг(х')<!х', — 00 а вместо суммы по / в A) будет стоять интеграл по переменной к: fc(k)Xk(x)dk = -L Jdk e ikx — oo 4*(x')dx' . — 00 —oo 190 (Из этого равенства, коль скоро оно должно быть справедливо для любой функции, например из пространства 82, следует также, что 2л: — с» где b(x-xf) - 6-функция Дирака). Возможны и другие представления функции Ч* в зависи- зависимости от выбора базиса, причем, очевидно, не только Ч*, но и функций вида ВЧ*> где В - некоторый эрмитов оператор, не выводящий функции Ч* за пределы исходного гильбертова про- пространства. Поскольку то с учетом A) можно написать Пользуясь ортонормированностью базисных функций %к> при ска- скалярном умножении этого равенства на х, найдем: Интегралы В. = В |%> и образованная из них матрица В с элементами В. задают представление оператора В в базисе {%.} (см. также § 4 гл.1). б. Коммутационные соотношения. Пусть теперь имеется оператор А, который не зависит явно от времени и коммутирует с оператором Гамильтона. Подействуем этим оператором на левую и правую части временного уравнения Шредингера: 4f) i (AW) = АНУ = ) dt dt Следовательно, функция АЧ* наряду с Ч* будет являться решением временного уравнения Шредингера. Если, в частности, в некото- некоторый начальный момент времени функция Ч* была собственной функцией оператора A: A4*(t = t0) = c№{t = to)9 то и во все последующие моменты времени t ~ to+ At она будет собственной для А с тем же собственным значением. Доказательство этого утверждения базируется на следующем. Пусть А/ мало, так что допустимо представление: АО = dt t-t At. 0 'О 191
Действуя на правую и левую части этой цепочки равенств операто- оператором А, получим AW(/o + АО = A4f(tQ) - ШАЩг^М = a[W(t0) - iW(to)At] = = a4*(to+ At). D.1.2) Коль скоро это соотношение выполняется при / = t0 + At, от этого момента времени можно перейти к / = to+ 2А/ИТ.Д. o Так, если при инверсии / волновая функция 4*(t0) меняла знак на обратный: PP(t0) = (-1 L*(t), то это ее свойство сохранит- сохранится и в последующие моменты времени при условии, что оператор / коммутирует с гамильтонианом. Пусть теперь оператор А таков, что он переводит любое решение Ф временного уравнения Шредингера вновь в решение этого уравнения; W = АЧ*. В этом случае говорят, что временное уравнение инвариантно относительно А, или инвариантно при преобразовании А. Далее, если временное уравнение инвариантно относительно оператора А и он не зависит явно от времени, то А и Н коммутируют; АН = НА, что показывается без труда. Если оператор А, коммутирующий с if, не является самосо- самосопряженным, можно утверждать, что оператор Ат, эрмитово-сопря- женный А, также коммутирует с Н, поскольку А^Н = (WAY = (НАУ - {АН? = #U* = НА\ где мы воспользовались тем, что № = Н. От операторов А и А^ можно перейти к двум самосопряженным операторам As = = (А + А^)/2 и A&s = (А - A*)/2i9 которые также будут коммутировать с Н. В квантовой механике, как уже говорилось, физически наблюдаемым величинам должны отвечать именно самосопряженные операторы, собственные значения которых вещественны. в. Законы сохранения. Физические величины, представ- представляемые самосопряженными операторами А, явно от времени не зависящими и коммутирующими с оператором Гамильтона, сохраняются во времени. Это утверждение означает, что среднее значение каждого такого оператора на любой функции состояния не зависит от времени, а функция W, собственная для А в некоторый момент времени t0, остается таковой во все последующие моменты времени. Вторую часть этого утверждения мы уже 1 При доказательстве в разложении по At возможно учесть и более высокие производные, однако для настоящего изложения это не столь существенно. Существенно только то, что окончательный результат остается тем же самым. 192 доказали (см. последовательность равенств B)). Первая часть доказывается также достаточно просто: если Ф - произвольная функция состояния, то дА , . . , ., ЭФ dt <Ф А > = dt НФ А Ф> + <Ф А А\Ф > + < Ф НФ dt Ф > + < Ф \А > = dt (НА-АН) Ф > = 0, где использовано то, что А явно от времени не зависит. Приведем теперь несколько примеров, иллюстрирующих высказанное в начале этого пункта утверждение. 1°. Пусть оператор ГамильтонаНявно от времени не зави- зависит. Поскольку он коммутирует сам с собой, его среднее значение <Ч* Н Ч*> на любой функции состояния Фот времени не зависит, а если к тому же ЧЧ^) - собственная функция //, то она сохраняется собственной и в любой другой момент времени /: /ЛР(/) = E4*(i)9 что свидетельствует о законе сохранения энергии системы. 2°. Если квантовая система свободна, т.е. внешний потенциал отсутствует, то оператор Гамильтона такой системы зависит лишь от расстояний между частицами, ее составляющими. Поэтому переход от исходной системы с радиусами-векторами частиц г( к сдвинутой в пространстве системе с радиусами-векторами г + а, где а - некоторый постоянный вектор, будет означать, что а) = Щг) aw 3*. Т . . . = Здесь W(r) = Ф(г1, г2, ... , г^). При достаточно малых а можно ограничиться в этом разложении первыми двумя членами, так что где V; - векторный оператор градиента (оператор набла) по пере менным с индексом /: „ .а .а а V,- si + j + к d Оператор А в этом случае коммутирует с //, поскольку он ком- коммутирует с оператором кинетической энергии Г, что достаточно 7 — 1395 193
очевидно, и с оператором V, ибо, например, для одного из слагае- слагаемых Сбудем иметь: 1 R 12 1 R 12 1 R 12 1 R 12 D.1.3) Первое слагаемое справа содержит производные по координатам —1 / 9 9 9 \ обеих частиц от RX2 = \(х\ - *2 ) + 0>i - .У 2 ) + Bi ~ Z2 ) -1/2 а дх 2/ 1 R 12 (xx ~x2) (x}- R 12 3 12 = 0 и аналогично для производных по>> и по z. Таким образом, первое слагаемое в C) равно нулю, что и свидетельствует о коммутирова- коммутировании А с Н. Оператор А есть сумма единичного оператора 1 и оператора ^a*V; = /а • Р , где Р- оператор полного импульса сис- системы. Коль скоро А коммутирует с Н при любом смещении а , то это в конечном итоге означает, что полный импульс свободной системы сохраняется. 3°. Аналогично можно показать, что для свободной системы или для системы со сферически симметричным (относительно начала системы координат) внешним потенциалом с оператором Гамильтона будет коммутировать оператор 1 + /8ф-?, где 6ф - вектор поворота вокруг некоторой оси на малый угол 6ф (направленный по этой оси), г.Ь - оператор момента количества движения системы как целого (например, при повороте вокруг оси z получим 1 + iby-Lz). Следо- Следовательно для таких систем сохраняется проекция момента коли- количества движения на выделенную ось вращения, а коль скоро эта ось произвольна, то сохраняется и скалярный квадрат оператора момента L2. г. Группа уравнения Шредингера. Группой G называ- называется (конечное или бесконечное) множество элементов, например S\9 g2> ••••> 8N> для которых определено произведение, причем мно- множество замкнуто относительно умножения, т.е. если g и g€z G, то и g^EG; кроме того, для группы требуется: а) ассоциативность умножения g,(ggk) = (gg)gkl б) наличие единицы, т.е. такого элемента е (например, элемента g,), для которого справедливы равенства: eg = ge = g\ 194 в) наличие обратного элемента g.l для каждого элемен- элемента группы gj9 т.е. такого элемента, что gj gt = gt gf = e . Операторы, относительно которых временное уравнение Шредингера для заданной квантовой системы является инвариант- инвариантным, образуют группу А, В, ... Действительно, если AW и БФ - решения временного уравнения, то в силу инвариантности реше- решением будет и В(АЧ*), т.е. оператор С = ВА также принадлежит группе G. Тождественная операция, очевидно, принадлежит G и является ее единицей, а вот что касается обратных операторов, то здесь положение хитрее: по крайней мере, если они существуют, то также принадлежат G. (Останавливаться на доказательстве этого утверждения не будем). Группа G, образованная операто- операторами, коммутирующими с оператором Гамильтона, называется группой уравнения Шредингера. Рассмотрим множество собствен- собственных функций х, оператора A EG. Это множество можно разбить на подмножества тех функций, которые принадлежат одному и тому же собственному значению оператора А : так что Axik = ?*Xik для кажД°го '¦ Любая линейная комбинация функций xik одного и того же подмножества есть вновь функция, собственная для А с тем же собственным значением а.. Матрич- Матричные элементы оператора Н в этом случае можно записать так: НА Сравнивая начало и конец этой цепочки равенств, приходим к выводу, что при / * <Х Л ¦ D.1.4) Если функции у образуют полный набор (при всех / и к\ то опера- тор Н представляется в базисе этих функций блочно-диагональной матрицей, отличные от нуля элементы которой, вообще говоря, отвечают лишь тем значениям индексов, когда / = у. Следова- Следовательно, функции, собственные для оператора Н, всегда могут быть представлены как линейные комбинации функций лишь одного подмножества Хп>Хц>—>Хиц- Этот вывод составляет одно из 195 'I! > 7* 1 L
утверждений теоремы Вигнера-Эккарта, о которой речь пойдет в § 4 настоящей главы. Так, в задаче об атоме водорода мы нашли, что оператор Н коммутирует с оператором L2, а также с операторами проекций момента La (a = х, у, z\ коммутирующими в свою очередь с L2. Исходя из сказанного выше, можно сразу же сделать вывод, что собственные функции оператора Н могут быть представлены как линейные комбинации функций, собственных для L2 с одним и тем же собственным значением /(/ + 1), а также функций, собственных для одного из операторов La, например Lz. При действии на эти функции х//и операторов Lx и L они будут переходить в другие функции, однако, коль скоро Lx и L коммутируют с L2, то получаемые функции Lx%lm и Lyxlm будут представляться линейными комбинациями функций, относящихся к тому же значению /. Все это нам уже известно, однако служит теперь подтверждением тому общему заключению о структуре матриц операторов и разбиению собственных функций на подмножества, которое было сформулировано выше. В этом примере операторы L , Lx, Ly, и Lz порождают элементы группы уравнения Шредингера для задачи об атоме водорода, отвечающие всевозможным поворотам в трехмерном пространстве. Эта группа включает также всевозможные произведения операторов поворотов и операторов отражения в плоскостях, проходящих через ядро. Операторы же L2 и La являются генераторами такой группы, т.е. такими операторами, с помощью которых можно построить все элементы группы вращений трехмерного пространства. Если квантовая система не обладает сферической симмет- симметрией, то по крайней мере не все операторы La коммутируют с Н. Так, в однородном магнитном поле гамильтониан содержит член вида W - ^aih ' Н, где /. - операторы момента импульса отдель- i ных частиц, а. - постоянные, а Н - постоянный вектор напряжен- напряженности магнитного поля, направление которого может быть выбрано, например, за координатную ось z, так что W= yaili2Hz . В этом случае с оператором Гамильтона будет коммутировать оператор проекции момента L2^^liz9 а также оператор однако операторы Lx и Ly коммутировать с Н уже не будут. Задачи 1. Доказать утверждения последнего абзаца. 2. Доказать, что при повороте на угол 6ф вокруг оси z волновая функция W(jc, у, z, t) переходит в функцию A + /6ф?,)ЧЧ х, у, z, О с точностью до членов более высокого порядка малости по 6ф. Указание: учесть, что при повороте на угол ф вокруг оси z координаты преобразуются следующим образом: х = cos ф х - sin ф у ; у' = sin ф х + cos ф у ; z = z. 3. Для гармонического осциллятора группой уравнения Шредингера служит множество двух элементов: единичного и инверсии /, при которой х переходит в -х. Какова структура матриц операторов Ни р = -i— в базисе функций, собственных для /? dx ii 196 § 2. Группы симметрии а. Операции симметрии. Преобразования переменных в уравнении Шредингера, не меняющие его вида, называются операциями симметрии. Операции симметрии образуют группу, которая, очевидно, является группой уравнения Шредингера: последовательное выполнение двух таких операций не меняет вида уравнения Шредингера, т.е. является операцией, принадлежащей группе; единице соответствует отсутствие преобразования перемен- переменных, обратной операции - преобразование от новых переменных к исходным старым. Любое преобразование переменных должно быть неособенным, т.е. должно переводить 7V независимых переменных вновь в 7V независимых переменных, так как в противном случае вид уравнения Шредингера изменился бы: вместо исходных 7V переменных оно содержало бы М< N новых переменных. К числу операций симметрии относятся: а) перестановки индексов частиц с одними и теми же зарядами, массами и другими характеристиками, например для двух электронов: б) операции точечной симметрии: вращения вокруг некоторой оси, отражения в тех или иных плоскостях, вращения с 197
последующим отражением в плоскости, перпендикулярной оси вращения и, наконец, инверсия/, при которой каждый радиус-вектор г7 переходит в -г. При всех этих операциях не меняет своего положения хотя бы одна точка пространства, в силу чего группы, образованные такими операциями, носят название точечных; в) сдвиг всех радиусов-векторов г частиц на постоянный вектор: г, => г,-' = г,- + а , причем а может быть произвольным. На других операциях симметрии остановимся позднее, а пока заметим, что все указанные выше операции являются линей- линейными преобразованиями переменных, а потому могут быть заданы с помощью некоторых линейных операторов или матриц преобразо- преобразования. Следует при этом отметить, что линейные преобразования, о которых идет речь, могут рассматриваться с двух позиций. Либо задана базисная координатная система (например, ортонормиро- ванных) векторов е., преобразуемая операциями симметрии, тогда как векторы г, задающие положения точек в пространстве, остают- остаются без изменений. Это означает, что операции симметрии выполня- выполняются для системы координат, а само пространство остается без изменений: к Здесь g - оператор, отвечающий операции симметрии g. Коль скоро любой вектор г= V х,е, при этом не меняется, то его координаты должны преобразовываться матрицей CL , обратной матрице С : -1 т \ т С ы Поэтому, если вектор г задан вектором-столбцом из координат х, то при операции симметрии будет выполняться следующее пре- преобразование: \Хп/ g 1-1 8 \хп/ = С 8 -1 х\ Х2 \Хп/ .-1 (матрица Cg , очевидно, представляет элемент группы симметрии, обратный g , т.е. CI1 = С . ). 8 Либо есть вторая возможность. Система координат, а следовательно и базисные векторы е., остаются на местах, тогда как векторы-столбцы преобразуются матрицами С^ для операций g. Обычно это записывается следующим образом: в первом случае r=>g~lr\ во втором случае г => gr. Ниже мы будем пользо- пользоваться именно представлением второго случая. Итак, если при некоторой операции симметрии g каждый вектор г переходит в вектор г/ = gr,, где g - соответствующий оператор, то функция Ф(гр г2,..., r^ t\ зависящая от радиусов- векторов частиц, переходит в следующую: 2, 0 = Предположим теперь, что функция Ф - собственная для оператора if с собственным значением Е: НФ = ЕФ. При действии на это равенство оператором g слева найдем: где учтено то, что гамильтониан при операциях симметрии не меня- меняется, т.е. (gH) = Н. Следовательно, функция #Ф также будет соб- собственной для Н с тем же собственным значением Е. Если исходное квантовое состояние, описываемое функцией Ф, не вырождено, то и Ф должны различаться лишь численными множителями: = ХФ, т.е. функция Ф - собственная для g с собственным значением к. Для любой конечной группы (т.е. группы с конечным числом 7V элементов) последовательное применение одной и той же операции приведет рано или поздно к тому, что оператор к раз совпадет с единицей: gk - е, а следовательно, Хк = 1. Отсюда непо- непосредственно находим, что X = yi = elnik. Если же состояние вы- вырождено и имеется т функций Фр ..., Фт, относящихся к заданному собственному значению Е, то при действии на одну из них, например Ф/5 оператором g мы можем получить не ту же функцию Ф; с точностью до множителя, а линейную комбинацию всех функций вырожденного набора т D.2.1) 2 /'=1 Коэффициенты gu> образуют квадратную матрицу G(g), представ- представляющую оператор g на конечномерном линейном пространстве, 198 199
натянутом на функции Ф. Любой другой оператор симметрии из группы G также будет задаваться аналогичной квадратной матри- матрицей. Коль скоро мы уже сказали, что gk = e, это означает, что матрица G обладает тем свойством, что ее к-я степень равна единице: G* = 1. Это условие должно быть выполнено для любой из матриц, отвечающих операциям симметрии конечной группы. Оно, в частности, означает, что определитель матрицы G по моду- модулю должен быть равен единице. б. Представления групп. Множество Г матриц G1? G2,..., G^ называется представлением группы G, если каждому элементу gt E G соответствует матрица G/? причем из равенства g\g = gk следует равенство GG = Gk. Коль скоро в группе у каждого элемента есть обратный, то матрицы G. все должны быть неосо- неособенные. Единице группы отвечает единичная матрица 1. Матрицы из чисел gir в A) образуют представление группы симметрии G на пространстве функций Ф,(/ = 1, 2,..., т). Рассмотренные выше преобразования: вращения, отражения и другие - не меняют расстояний между точками пространства. К тому же они не меняют и норму функций Ф: = <ф gig ф> = <ф | ф> D.2.2) так как ,gr2,...,grN; , gr2,..., grN; t) dr[dr2'... dr'N = — GO GO = /Ф (rl,r2,...,rN;t)<b(rl,r2,...,rN;t)Jdrldr2...drNt — GO где r/ = gr,, a J- модуль якобиана преобразования от переменных г/ к переменным г, составленного из производных dx'iaJdx^ (а, р = х, у, z), т.е. из элементов матрицы G преобразования координат. Модуль же определителя этой матрицы, как показано в конце предыдущего пункта, равен единице. Соотношение B) должно выполняться для любой функции Ф, имеющей конечную норму, т.е. конечный интеграл <Ф Ф>. Отсюда следует, что gig = e D.2.3) и соответственно для представления Г: G4J = 1. D.2.4) Матрицы, удовлетворяющие такому соотношению, называются унитарными. Для конечномерных матриц из соотношения D) к 200 тому же следует и равенство GG1 = 1 (см. задачу 1). Вещест- Вещественные матрицы, удовлетворяющие D), называются ортогональ- ортогональными. Определитель унитарных и ортогональных матриц по модулю равен единице. Таким образом, матрицы G/ представления Г суть унитар- унитарные матрицы. Можно доказать, что все возможные представления каждой группы G (в том числе и не обязательно группы точечной симметрии) эквивалентны ее унитарным представлениям, другими словами, при подходящем выборе базиса матрицы любого представления переходят в унитарные матрицы, а потому при рассмотрении представлений достаточно ограничиться лишь унитарными представлениями. Среди всех унитарных представ- представлений всегда есть единичное, или полносимметричное, в котором каждому элементу группы g. отвечает одна и та же матрица размерности 1 х 1, а именно единица. Пусть теперь задано линейное векторное пространство 91 размерности /w, на котором определено представление Г. В этом пространстве имеется ортонормированный базис из векторов е , которые будем записывать в виде строки (ер е2,...,ет), тогда как произвольный вектор х есть произведение этой строки на столбец из проекций вектора х на базисные векторы: \хт/ Этот столбец будем обозначать далее также через х. Унитарные матрицы G представления Г преобразуют эти векторы-столбцы без изменения их длины, определяемой соотношением I1 = 1х I It2 t х = х'х. При переходе от исходного базиса векторов е. к новому ортонорми- рованному базису должно выполняться равенство (el>e2>*">em) = где матрица U опять-таки должна быть унитарной в силу условия сохранения ортонормированности базиса. Векторы х также пре- преобразуются с помощью матрицы U, тогда как преобразование матриц представления получается следующим образом: если у = Gx, то, умножая это равенство слева на U и вводя между G и х единичную 201
матрицу 1, представленную в виде произведения 1ЛТ1, получим: у ' = Uy = (UGUt)Ux = G x . Следовательно, матрицы G представления Г преобразуются в матрицы G' = UGlH представления Г', и так как эти два представления различаются лишь из-за того, что в векторном пространстве по разному заданы два базиса, то они называются эквивалентными. Несмотря на то, что у матриц, отличающихся друг от друга преобразованием эквивалентности, соответствующие матричные элементы, вообще говоря, различны, тем не менее у них есть и такие комбинации этих матричных элементов, которые при пре- преобразованиях эквивалентности не меняются, т.е. являются инва- инвариантами преобразований. В частности, не меняется сумма диаго- диагональных элементов матрицы, называемая ее следом и обозна- обозначаемая либо как Sp ( от немецкого Spur - след), либо как tr (от английского trace): SpG' = Kl k,l \ i и поскольку UrU = 1, то hi Совокупность следов матриц представления, записанная, например, в виде вектора-столбца, носит название характера представления. При преобразовании эквивалентности не меняется и опреде- определитель матрицы G. Это следует из того, что определитель произве- произведения матриц равен произведению их определителей (все матрицы в нашем случае - квадратные, следовательно, определитель для каждой из них имеет смысл): detU1" • detU * detG = detUrU • detG = = detG. Правда, такой инвариант не очень интересен, ибо определи- определитель всех матриц представления по модулю должен быть равен единице. Есть и другие инварианты у матриц G, сохраняющиеся при преобразованиях эквивалентности, но мы их обсуждать не будем. Интересно то, что каждый элемент g группы G можно пре- преобразовать в некоторый элемент этой же группы следующим образом: g[ = gtg g~l для любого индекса /. В представлении Г 202 элементу g\ будет отвечать матрица G[ =G,GG,1, а поскольку матрицы G( унитарны, так что GJ1 =gJ, то указанное преобразо- преобразование есть преобразование эквивалентности, при котором инвари- инварианты матрицы G не меняются. Операции g- , как и матрицы G-, образуют вместе с g (или G) так называемый класс сопряженных элементов. Для матриц представления Г все матрицы из класса сопряженных элементов имеют один и тот же след (как, впрочем, одинаковы и все другие их инварианты), поэтому таблицы характеров приводятся лишь для классов сопряженных элементов. Таким образом, характеры эквивалентных представлений одинако- одинаковы, а следы матриц, отвечающих сопряженным элементам группы, равны друг другу. в. Приведение представлений. При различных преобра- преобразованиях базиса в пространстве 91 может возникнуть такая ситуация, что часть векторов, например е , е2, ... , ек (к < /w), преобразуется матрицами G* в себя, т.е. в 91 имеется подпро- подпространство 31 С 31, инвариантное относительно матриц представле- представления Г. Это означает, что матрицы G имеют следующую структуру: G = G G и 21 т.е. верхний правый блок в каждой из матриц G равен нулю. В таком случае говорят, что представление Г приводимо на про- пространстве 91. Верхний диагональный блок Gn размерности кхк действует на подпространстве 91, и не выводит векторы этого под- подпространства за его пределы. Если к тому же и G21 = 0 для всех операций группы, то представление Г называется вполне приводимым: оно по существу составлено из двух представлений Г] и Г2 меньшей размерности, определенных на двух линейных пространствах 911 и 9t?, что записывается следующим образом: 91 = '2ИГ=Г, Итак, в этом случае: G и 0 G 91, , G22x2 ? 9t2; где фигурные скобки обозначают множества матриц Gn и G22 для всех элементов группы. Вместо исходного представления Г можно рассматривать лишь представления Г, и Г2. Представления, образованные унитарными матрицами, обладают той хорошей 203
особенностью, что если они приводимы, то они одновременно и вполне приводимы. Возникает естественный вопрос, сколько у данной группы может быть различных неприводимых неэквивалентных представ- представлений и на какие неприводимые представления при соответствующем выборе базиса может быть разбито данное представление? Ответ на этот вопрос, по крайней мере для группы конечного порядка, дается двумя утверждениями (теоремами), на доказательстве которых мы останавливаться не будем, а только лишь наметим его после формулировки этих утверждений. Первое из них звучит следующим образом: для группы G конечного порядка N сумма квадратов размерностей я. неэквивалентных неприводимых представлений Г. равна порядку группы: ^nf = N. Это - так называемая теорема Бернсайда. Например, у группы 2-го порядка может быть только .два разных неприводимых представления, причем оба одномерные; у группы 6-го порядка - либо 6 одномерных неприводимых представле- представлений, либо два одномерных и одно двумерное неприводимые представления (поскольку I2 + I2 + 22 = 6), других же возможностей нет. Второе утверждение заключается в том, что число, указываю- указывающее, сколько раз /w. данное неприводимое представление Г. встречается в приводимом представлении Г, определяется формулой: т. = 1 *— (Хг^Хг), D.2.5) где хг (g) и Хг (s) ~ следы матриц, отвечающих элементу группы g в представлениях Г и Г, а Хг и Хг ~~ соответствующие векторы-столбцы, составленные из этих следов. Символ ( , ) отвечает скалярному произведению таких векторов, определение которого очевидно из формулы E). Доказательство этих утверждений обычно основывается на следующем. Выпишем матрицы какого-либо представления и выделим в каждой из них элемент, стоящий на пересечении /-й строки иу'-го столбца: j j j матрица: элемент: 204 S, G g, G g, N Составим из этих элементов вектор-столбец Л^-мерного простран- пространства g,,(O = .. \ D.2.6) Таких векторов-столбцов для данного представления Г можно построить п2, где п = п(Г) - размерность представления. Оказы- Оказывается, что для неприводимых представлений эти векторы взаимно ортогональны: и, следовательно, они линейно независимы. Для двух неэквивалент- неэквивалентных неприводимых представлений Г; и Г2 они также ортогональны: (8у(Г1),8и(Г2)) = 0 (Vi,y, Л,/)¦ D.2.8) Эта конструкция показывает, что в Л^-мерном пространстве с вектора- 0 0 "У ми-столбцами из Л^ компонент имеется набор к-пх + п2 + ... + ns (S - число неприводимых представлений) линейно независимых взаимно ортогональных векторов вида F), так что к, по крайней мере, не превышает N. Далее, если выполняются соотношения вытекающие из G) и (8), то при суммировании по / и у получим так называемые соотношения ортогональности для характеров неприводимых представлений: 1 " * ' ч — х - ^ « . D.2.9) о Таким образом, характеры неприводимых представлений взаимно ортогональны и нормированы на N. Если приводимое представление составлено из некоторого числа неприводимых, т.е. где /w( - числа, указывающие, сколько раз Г\ встречается в Г, то 205
для характера х(Г) представления Г можно написать: Х(П = т^Т,) + т2х(Г2) + ... + т,х(Г,). Умножая х(Г) слева скалярно на х(Г,), получим формулу E). г. Прямое произведение представлений. Очень часто в прикладных задачах встречаются выражения, которые содержат произведения функций, преобразующихся по тем или иным представлениям точечных групп. В частности, в §§ 2 и 3 пред- предшествующей главы уже встречались интегралы вида <гр D <р>, в которых как функции гр и ф, так и оператор дипольного момента могут преобразовываться по различным неприводимым представ- представлениям. Возникает естественный вопрос, по какому представлению в этих случаях будет преобразовываться подынтегральное выра- выражение и как специфика получаемых преобразований будет отра- отражаться на величине указанного интеграла. Возьмем две функции: и.(х) и v{y\ зависящие каждая от своего набора переменных (обозначаемых символами х и у) и принадлежащие двум линейным пространствам 9^ и 9t2 размернос- размерности 5, иХ2, на которых действуют два представления Г^ и Г2, соответственно: grut(x) = где gr - элемент группы G, G./Г,; gr) - элемент матрицы G(F];^rr) представления Г,, отвечающей операции^. Произведение функций ut(x)v{y) при операции gr будет преобразовываться следующим образом: kj=\ D.2.10) причем величины D.2.11) образуют квадратную матрицу порядка S]'S2 (/, к = 1,2, ..., Sx и у,/= 1, 2,..., ?2), у которой номером строки являются два индекса- 206 / и у, а номером столбца - два индекса к и /. Можно показать (см. задачу 6), что матрицы с элементами Gt также образуют представление Г группы G, которое в общем случае является приводимым. Это представление Г называется прямым произведе- произведением представлений Г, и Г2 и обозначается следующим образом: Г = Fj х Г, или Г = Г} ® Г2. Характер представления Г получается обычным путем при суммировании диагональных элементов G по всем возможным значениям индексов / и у: /5, W= D-2.12) Следовательно, характер прямого произведения, т.е. представле- представления Г, равен просто произведению характеров представлений Г} и 1\, его порождающих. Для нахождения того, на какие неприво- неприводимые представления распадается Г, далее надо использовать формулу E). Часто встречается такая ситуация, когда функции v при- принадлежат тому же подпространству, что и функции и, так что, напри- например, v = и (например, когда встречается произведение молекулярных орбиталей, преобразующихся по одному и тому же неприводимому представлению). В этих случаях от базиса функций ut(x)u(y) имеет смысл, как правило, перейти к так называемому симметризованному базису, определяемому равенствами (/ sy): 1 - u D.2.13) При построении прямого произведения A0) базисные функции st преобразуются друг через друга, и аналогично ведут себя функции г, преобразующиеся лишь через функции tr По существу, в симметризованном базисе прямое произведение распадается на два представления: одно из них определено на подпространстве 91 функций s 9 другое - на подпространстве 9t2 функций Г. Пользу- Пользуясь равенствами типа A0) и учитывая, что в этом случае Г =Г , далее можно показать, что характер представления, действующего в 9tp может быть записан следующим образом: 207
тогда как для характера представления, действующего в 9t2, будет справедливо равенство ; g) = \%lx (g) - ^ХГ1 (82) • D.2.14) Представление, определенное на 9tp носит название симметризо- ванного квадрата исходного представления Г, а на 9t2 - анти- симметризованного квадрата. Происхождение этих названий очевидно. По аналогии могут быть определены и более высокие степени и симметризованные степени представлений. д. Пример. Для иллюстрации высказанных выше общих положений рассмотрим следующий простой пример. Пусть имеет- имеется модельная система из трех протонов, каждый из которых находится на одной из координатных осей на расстоянии Ro от начала системы координат (рис. 4.2.1), и из одного ядра атома азота, который находится на линии ON, направленной под одним и тем же углом к каждой из координатных осей, и удален от начала С Рис. 4.2.1. Система из трех протонов и одного ядра N. Указаны элементы симметрии: ось С3 и плоскость о . системы координат на расстояние R. Очевидно, что такая модель отвечает одной из возможных конфигураций ядер молекулы аммиака. Эта конфигурация обладает следующими шестью опера- операциями симметрии: единичная е, поворот С3 вокруг оси ON (в положительном направлении) на угол 2я/3 и другой поворот ( С32 ) вокруг той же оси на угол 4 л/3, три отражения в трех плоскостях, 208 проходящих через ось ON и одну из координатных осей Ох , О_у и Ог (операции ох, оу и az). При выполнении этих операций ядро N остается на месте, а три либо два протона меняются местами. Если ввести вектор с компонентами hv h2 и hv указывающими просто номера протонов, то при операциях симметрии компоненты векторов будут меняться местами, что можно представить с помощью матричного умноже- умножения следующим образом: 4 l п п п а\\ 2 3 аг\ а22 агъ Д-Э1 &ХУ &Х\ Матрицы A(g), входящие в это равенство, для указанных операций симметрии таковы : g A(g) х(П е а о о\ 0 1 0 ,0 0 1. 3 Сз (° ° г\ 1 0 0 ,0 1 0, 0 г 2 (° 1 °\ 0 0 1 Д о о, 0 /1 0 0\ 0 0 1 ,0 1 0, 1 Оу (° ° г\ 0 1 0 Д о оу 1 oz (° 1 °\ 1 0 0 ,0 0 lj 1 В последней строке выписаны характеры представления, образо- образованного матрицами A(g). Рассматриваемая группа есть не что иное, как точечная группа симметрии (обозначаемая как C3V), порядок которой равен 6. Используя таблицы характеров точечных групп (см. следующий параграф и Приложение 2), можно найти, что у этой группы имеется 3 неприводимых представления, одно двумерное и два одномерных. Таблица характеров этих неприводимых представлений приведена ниже: c3v Г! г2 Гз е 1 1 2 Сз 1 1 -1 Г2 1 1 -1 ох 1 -1 0 1 -1 0 oz 1 -1 0 Матрицы одномерных представлений совпадают с характерами, матрицы двумерного представления Г3 выписаны ниже (все эти 209
матрицы как для одномерных, так и для двумерного представления являются ортогональными): -1/2 -V3/2N л/3/2 -112, °у '-1/2 л/з/2ч л/3/2 1/2, ( -1/2 -л/3/2 -1/2 -1/2 - л/3 / 2' -л/3/2 1/2 С помощью формулы E) можно установить, сколько раз каждое из неприводимых представлений содержится в приводи- приводимом трехмерном представлении Г : т(Г)= --(З-1 + 0-1+ 0-1+ 1-1+ 1-1+ 1-1) = 1, 1 6 1я(Г)= 'LC-l + 0-1 + 0-1 -1-1 -1-1 -1-1) = 0, 2 6 т(Г)= 3 6 Следовательно, представление Г при подходящем выборе базиса переходит в прямую сумму двух неприводимых представле- представлений: Г, и Г3. Выпишем, наконец, для данной группы характеры прямых произведений, используя сокращенную запись, при которой классу эквивалентных операций отвечает одна колонка в таблице: Прямое произведение Г1*Г, Г,хГ2 Г1*Г3 Г2хГ2 Г2хГ3 Г3хГ3 L 3 з J sy"! И зХ* 3 J a s у in Операции группы е 1 1 2 1 2 4 3 1 2С3 1 1 -1 1 -1 1 0 1 1 -1 0 1 1 0 1 На какие неприводимые представления разбивается г, Г2 Г3 Г1 Г3 г1+г2+г3 г1+г3 Г2 210 е. Заключительные замечания. Наличие симметрии позволяет проводить классификацию волновых функций по тем неприводимым представлениям (или, как часто говорят, по типам симметрии), которые присущи группе уравнения Шредингера. Оно приводит также к правилам отбора (см. §4 настоящей главы и следующие главы), в основе которых лежит теорема Вигнера- Эккарта, и ко множеству других полезных аспектов использования симметрии при рассмотрении многоэлектронных молекулярных систем, на которые мы постоянно будем обращать внимание в главах, посвященных квантовой химии. Оно приводит и к конкретным формам законов сохранения для тех или иных квантовомеханических задач, позволяя при этом уменьшить размерность этих задач. Выше мы не останавливались на том, к чему может привести включение времени в рассматриваемые преобразования (операции симметрии). Отметим лишь, что сама по себе эта пере- переменная t может менять знак, т.е. претерпевать инверсию: t -* -t, что преобразует уравнение Шредингера: r-*-j -/й Однако, если при этом в уравнении одновременно перейти к ком- комплексно сопряженным величинам справа и слева, то получим: dt Для зависимости гамильтониана от времени, обусловленной внешним электромагнитным полем, как следует из формул §4 гл.П, справедливо H*(-t)=H(t). Это означает, что оператор Z, осущест- осуществляющий инверсию времени с одновременным переходом к комплексно-сопряженным величинам, коммутирует как с гамиль- гамильтонианом Я, так и с оператором itididt. Следовательно, если Щг) была решением исходного временного уравнения Шредингера, то таковой будет и функция Ч?*(-0. Задачи 1. Рассмотреть все возможные операции симметрии пра- правильной w-угольной пирамиды и w-угольной призмы. 2. Пусть у группы G есть одномерное представление Г} и комплексно-сопряженное ему представление Тх , которые не совпадают. Пусть группа G есть группа стационарного уравнения Шредингера. Показать, что если у уравнения Шредингера в этом 211
случае существует решение ty, преобразующееся по представле- представлению Гр то существует и отличное от него решение ip*, преобразую- преобразующееся по представлению Г^ и принадлежащее тому же собствен- собственному значению (дублет Крамерса). 3. Вращение в плоскости ху на угол ф задается ортогональ- ортогональной матрицей (оператором) cosqp - sirup' _ Sirup СО5ф Каковы ее собственные значения и собственные функции? 4. Показать, что переход от одного ортонормированного базиса к другому, также ортонормированному, в конечномерном пространстве осуществляется унитарной (ортогональной) матрицей. 5. Показать, что унитарное приводимое представление является одновременно и вполне приводимым. 6. Показать, что матрицы прямого произведения представ- представлений также образуют представление. 7. Из операций группы g = e9 g2, g3,..., gN можно составить вектор-столбец Si 8n! при действии на который любой из операций g. группы (т.е. при умно- умножении каждого элемента вектора на g) получается новый вектор отличающийся от исходного перестановкой его элементов. Такое преобразование вектора g для каждого элемента группы g может быть представлено квадратной матрицей G. порядка п. Показать, что матрицы G; образуют представление группы. Замечание: это представление называется регулярным. 8. Проверить, что матрицы A(g) ъп.д образуют представ- представление. 9. Построить регулярное представление для группы C3V из п. д. Выяснить, на какие неприводимые представления оно разби- разбивается. На какие неприводимые представления разбивается регу- регулярное представление для произвольной конечной группы? 212 § 3. Системы тождественных частиц. Группы перестановок и точечные группы симметрии В настоящем параграфе будет продолжено обсуждение групп симметрии, присущих молекулярным системам конечных размеров. Мы не затронем при этом групп симметрии твердого тела или высокомолекулярных соединений, обсуждение которых фактически выходит за рамки настоящего изложения. а. Перестановки тождественных частиц. Молекулярные системы, составляющие основной объект внимания квантовой химии, имеют ту характерную особенность, что они включают, как правило, некоторое число тождественных частиц, имеющих одни и те же массу, заряд, спин и т.п. Как уже было сказано в § 5 гл. II, оператор Гамильтона не меняется (и не должен меняться по физическим соображениям) при перестановке в нем индексов тождественных частиц, поскольку в противном случае у этих частиц имелась бы такая характеристика, по которой их можно было бы различить. Другими словами, оператор Гамильтона должен коммутировать со всеми операторами перестановок индексов тождественных частиц, так что группа перестановок SN каждой подсистемы тождественных частиц есть группа уравнения Шредингера для всей системы. А это означает, что волновые функции V как решения этого уравнения должны преобразовываться при действии на них операторов перестановок по какому-либо неприводимому представлению Г группы SN. Кроме того, если в начальный момент времени W(r, t0) преобразовывалась по неприводимому представлению Г, то и во все последующие моменты времени она будет преобразовываться именно по этому же представлению. По какому конкретно представлению группы SN волновая функция может преобразовываться (по любому или по каким-либо выделенным) квантовая механика отвечает лишь постулатом: волновые функции должны преобразовываться по полносиммет- полносимметричному представлению (т.е. оставаться без изменений), если тож- тождественные частицы имеют целый спин s; волновые функции должны преобразовываться по антисимметричному представле- представлению (т.е. менять знак при каждой перестановке индексов двух частиц), если тождественные частицы имеют полуцелый спин s. Оба представления одномерные. Частицы с целым спином называ- называются бозонами (по имени индийского физика Шатьендраната Бозе), а с полуцелым спином - фермионами (по имени итальянского физика Энрико Ферми, работавшего в основном в США). 213
Так, в молекуле N2H4 имеется три подсистемы тождест- тождественных частиц: 18 электронов (s = 1/2), 4 протона (s - 1/2) и 2 ядра атома азота (s = 1 для 14N и s - 1/2 для 15N). Поэтому волновая функция должна быть антисимметричной при перестанов- перестановках индексов электронов либо индексов протонов и симметричной при перестановках индексов ядер 14N. Если же в молекулу входят вместо протонов дейтероны 2Н E=1), то по перестановкам индексов дейтеронов волновая функция также должна быть полносимметрична. Такой жесткий отбор по типам симметрии относительно перестановок проявляется в том, какие уровни энергии могут быть у системы, какие допустимы квантовые состояния и какова должна быть статистика в системе большого числа тождественных частиц. Требование к волновой функции быть антисимметричной или полносимметричной не зависит к тому же от того, насколько велик потенциал взаимодействия тождественных частиц между собой: если это взаимодействие пренебрежимо мало, как например, взаимодействие электронов двух атомов, находящихся на большом расстоянии друг от друга, все равно полная волновая функция системы должна быть антисимметрична относительно перестано- перестановок индексов всех электронов этих атомов1. б. Группы перестановок. Группа SN перестановок индексов TV частиц, N предметов и т.п. включает N1 операций. Среди возможных перестановок выделяют транспозиции (элементарные перестановки двух предметов или индексов) и циклические перестановки, отвечающие, например, переходу индекса 1 на место 2, индекса 2 на место 3 и т.д. до индекса к, переходящего на место 1. Перестановки часто обозначают символом (I 2 3 N' \1\ 12 '3 *•• lN показывающим, что 1 переходит на место / 2 - на место i2 и т.д. Так, циклическая перестановка трех индексов имеет вид: /1 2 3\ /1 2 3' либо 2 3 1 3 1 2 1 Говоря о малости взаимодействия, мы имеем в виду лишь электромагнитные взаимодействия, а не те слабые взаимодействия, которые вводятся в теории элементарных частиц и ответственны за распад ряда мюонов, iC-мезонов и Л-гиперонов, а также за C-распад ядер. Каждая перестановка может быть выполнена как последо- последовательность того или иного числа транспозиций, причем эта последовательность может быть осуществлена разными путями с разным числом транспозиций. Характерно однако то, что для заданной перестановки это число всегда либо нечетно (включая сами транспозиции), либо четно. Так, первая из указанных циклических перестановок может быть записана в виде или 1 1 и т.п., где в символах перестановок опущены не меняющиеся при транспозициях индексы. По этому признаку все перестановки делятся на четные (четное число транспозиций) и нечетные (нечетное число транспозиций). Указанная выше циклическая перестановка - четная. В заключение этого пункта приведем еще две полезные для последующего формулы. ПустьД1, 2,..., N)- произвольная функция переменных 1-й, 2-й и т.д. частиц. Тогда оператор действующий согласно равенству 1 N\ D.3.1) в котором Р — оператор перестановки, а суммирование ведется по всем перестановкам, переводит функцию/A, 2,..., N) в полносим- полносимметричную функцию/ , не меняющуюся при любой перестанов- перестановке индексов частиц. Множитель 1/NI введен для того, чтобы выполнялось равенство S2= S. Так, для двух частиц S - ^A + Р12) и S2 =1A + JP12)A + JP12) = 1A + 2JP12+JP122) = 1A + P12) = ^- Аналогично оператор^, определенный соотношением ,..., N) = 2,..., N), D.3.2) гдер - четность перестановки, а суммирование также ведется по всем перестановкам Р, переводит функцию/A, 2,..., N) в анти- антисимметричную функцию/ т, меняющую знак при любой нечетной V 214 215
перестановке. Например, пусть Д1, 2) = ф,A)ф2B). Тогда _ J_ ~ 2 = ^[Ф1A)Ф2B)-Ф,B)ф2A)]-| 2 где символ detjcppCpJ обозначает определитель, составленный из функций ф и ф2, зависящих каждая от переменных либо первой, либо второй частицы. в. Точечные группы. Точечные группы симметрии встре- встречаются главным образом при рассмотрении молекулярных систем, поэтому более детально разговор о них пойдет во второй части книги. Здесь же будет приведена краткая классификация операций, образующих точечные группы, и самих точечных групп. Предварительно введем понятие прямого произведения групп1. Пусть имеются две группы G'?P г иG/г/г Тогда множество пар элементов {g;, A } с умножением по формуле называется прямым произведением G = С^®С2 двух групп G, и G^. Порядок группы G равен произведению порядков сомножи- сомножителей. Если у групп G, и G. нет общих элементов (кроме единичной операции) и они определены как совокупность операций на одном и том же классе объектов, то каждую пару {gt, A } можно записать как произведение gh . Формула C) и ассоциативность умножения в группе в этом случае показывают, что (glh)(gkh) = gt(h gk) hn a в то же время gh- gkh! = g.gk- hhl = gt(gkhf) hp т.е. операции А. и gAдолжны коммутировать при любых индексах; и к . Пусть, например, рассматриваются операции симметрии в трехмерном пространстве и группа G, включает единичный элемент е и отражение g, в плоскости ху , а группа G, - элемент е и поворот А, вокруг оси z на угол я. Прямое произведение этих групп будет содержать 4 элемента: единичный {е, е}; отражение в плоскости ху: {gve}\ поворот вокруг оси z: {e, А,} и инверсию {g,, Aj}, при которой х -* -jt, >> -* -^ и 2 -» -2 . Выше было рассмотрено прямое произведение представлений, которые, как уже говорилось, в общем случае тоже являются группами, образованными матрицами! 216 Вернемся теперь к точечным группам. Эти группы обычно включают следующие операции: 1. Повороты вокруг некоторой оси симметрии на углы (п - целое, к - 1, 2,..., п-\). Такая ось симметрии называется осью симметрии ат-го порядка, она обозначается соответствующим числовым символом п. Операции поворота обозначаются как Сп , С2п, ..., С". Очевидно, что С~к = Спп~к для любого к*п-\9 где С~к =(Ск)~1. Ось симметрии с максимальным п называется главной осью. 2. Отражения в плоскостях симметрии, обозначаемых буквой т. Операция отражения в плоскости, проходящей через главную ось, обозначается как ov(v - vertical, поскольку главная ось обычно выбирается направленной по оси z). Операция отражения в плоскости, перпендикулярной главной оси, обозна- обозначается как oh (A - horisontal). Кроме того, вводят еще операции отражения od (d - diagonal), о которых будет сказано позже. 3. Инверсия (в начале системы координат), при которой вектор г переходит в вектор -г, т.е. все три декартовы координаты меняют знак на обратный. Инверсия обозначается либо символом 1, указывающим на наличие центра инверсии, либо символом /, указывающим на наличие операции инверсии. 2яг 4. Зеркальные повороты: повороты на угол —к с последу- п к ющим отражением в плоскости oh. Они обозначаются как Sп и для точечных групп существенны прежде всего тогда, когда п превосходит порядок главной поворотной оси симметрии. Зеркаль- Зеркально-поворотная ось обозначается символом п . В кристаллохимии под зеркальными поворотами обычно подразумевают поворот вокруг оси ат-го порядка (оси z) с последующей инверсией. Посколь- Поскольку инверсия может быть представлена как последовательность, например, двух операций - отражения в плоскости ху и поворота вокруг оси 2 на угол я, то эти два определения зеркальных поворотов отличаются друг от друга именно на такой поворот вокруг оси 2. Те или иные сочетания указанных операций симметрии (с неподвижным при всех операциях началом системы координат, т.е. операций точечной симметрии) приводят к точечным группам. Эти группы обозначаются либо по тем пространственным элементам, которые порождают операции симметрии, например лг, т, 1, либо 217
по самим имеющимся в группе операциям симметрии. Первый способ приводит к так называемой международной символике обозначения точечных групп, второй - к символике Шёнфлиса (Далее, как и в случае Э. Шрёдингера, будем писать е вместо ё). В квантовой механике молекул обычно используется символика Шёнфлиса, поэтому мы будем пользоваться далее именно ею, однако в настоящем параграфе при введении обозначений точеч- точечных групп будем приводить и международную символику (наиболее распространенную в кристаллохимии). Для молекул обычно встречаются следующие точечные группы: 1. Группы Ся(международный символ: л), включающие п поворотов сл, С„2, ..., С;. 2. Группы С, (т.е. 1) и СДт.е. /w), включающая каждая по два элемента: единичный и инверсию (С) либо единичный и отражение в плоскости о(С). 3. Группы С , состоящие из поворотов С к •> отражений ov и их произведений. Эти группы отвечают симметрии правильной л-угольной пирамиды. Для нечетных п (= 3, 5, ...) имеется п эквивалентных плоскостей отражения, переходящих друг в друга при поворотах С * . В международной символике это группы 3/w, 5т и т.п. Для четных п плоскости симметрии разбиваются на два эквивалентных класса -т и т\ первые из них проходят, например, через противоположные вершины многоугольника в основании пирамиды (им отвечают операции отражения а ), вторые - через середины противоположных сторон, т.е. по биссектрисе угла между двумя соседними плоскостями ov (отвечающие им операции отражения обозначаются как od). В междунароной символике при четных п получаются обозначения 2тт, или тт2; ттА и т.п. 4. Группы Cnh, состоящие из поворотов Сп и отражения oh в плоскости /w, перпендикулярной оси симметрии. При нечетных п группы Cnh наряду с поворотами включают зеркальные повороты Sn, при четных п ~ инверсию /. В международной символике это группы 2//w, Ъ1т и т.п. (символ 1т указывает, что плоскость симметрии т перпендикулярна главной оси симметрии). При четном п эти группы могут быть записаны в виде прямого произ- произведения Сп®С( либо в виде Сп®С5 , тогда как при нечетном - только в виде Сп®С?. (В приведенном выше примере прямого произведения была получена группа C2h= C2®C .) 5. Группы Dff, состоящие из поворотов С к и поворотов С, 218 вокруг п осей симметрии второго порядка, перпендикулярных главной оси. Это группы операций поворотов правильных п~ угольных призм, совмещающих их с собой. Группа D2 обозначается также как V, в международной символике - как 222 (три взаимно перпендикулярных оси симметрии второго порядка). Остальные группы Dn обозначаются как nil либо как я/22 в зависимости от того, нечетно или четно п. Косая черта при этом подчас опускается. 6. Группы Dnh включают наряду с операциями симметрии группы D также и отражения в плоскостях т и //и', т.е. операции аи oh. Их обозначения в международной символике: п/тт - для нечетных п и п/ттт - для четных п\ эти обозначения для, например, четных п указывают, что есть ось симметрии я-го порядка, операция oh отражения в плоскости 1т и операции ov и oj отражения в двух классах неэквивалентных плоскостей т' и т", проходящих через ось п. Оси симметрии второго порядка получаются как линии пересечения плоскостей 1т и т' (либо т"). Группа D2h обозначается при этом как ттт. Как и для группы СяЛ, можно установить, что D . = D ® С при нечетных п либо D , = D ®С при четных л. 7. Группы Sn включают зеркальные повороты вокруг зеркально-поворотной оси п-го порядка. Для нечетных п они совпадают с группами D . Для четных я, когда п = 2к и к - нечетно, S2k = Ck®Cr Как уже было сказано, в международной символике зеркально-поворотной оси п отвечает поворот на угол Bл/п)к с последующей инверсией. В этом случае группа обозначается как п . Она соответствует группе S2wb обозначениях Шёнфлиса. 8. Группы Dnd включают операции группы S2n и повороты вокруг осей второго порядка, перпендикулрных главной оси. Эти группы отвечают "скошенной" призме: две правильные и-угольные призмы поставлены друг на друга и потом одна из них повернута относительно другой на угол к/п вокруг главной оси (рис. 4.3.1). 9. Группы Т и Td. Группа Т состоит из всех поворотов, совмещающих правильный тетраэдр сам с собой. У правильного тетраэдра есть 4 оси третьего порядка, проходящие каждая через одну из вершин и 3 оси второго порядка, проходящие через середины противоположных ребер. Группа Т^ есть группа всех операций симметрии правильного тетраэдра (Т^ = Т®Сл = D ®С ). Она включает 24 элемента. У этой группы наряду с одно- и двумерными неприводимыми представлениями есть и трехмерные представления. Обозначение в международной символике 4 3 т. 219
10, Группы О и Oh - группа операций поворотов и группа всех операций симметрии правильного октаэдра. Международный символ для группы Oh: тЪт (рис. 4.3.1). 11, Группы I поворотов и \h всех операций симметрии пра- правильного икосаэдра. 12, Группы Cocv и D^ - группы симметрии линейных и линей- линейных гомоядерных (центросимметричных) молекул. Имеется ось симметрии бесконечного порядка, бесконечное число плоскостей /и, проходящих через эту ось, а у группы D^ и инверсия. Их обозна- обозначения в международной символике: <х>т и оо т (или оо/тт) соответственно. а b' Рис. 4.3.1. a - "Скошенная" призма (симметрия точечной группы D ) и б - правильный октаэдр (симметрия точечной группы ОА). г. Обозначения неприводимых представлений точечных групп. Для обозначения этих представлений обычно используют следующие буквы: А и В для одномерных, Е для двумерных, F (или Т) для трехмерных, С,Яи т.д. для четырех-, пяти- и т.д. мерных неприводимых представлений. Если в одномерном представлении операции Сп отвечает 1, то это Л-представление, если -1, то ^-представление. Символы одномерных представле- представлений, у которых операции симметрии ah отвечает 1, снабжаются штрихом, а если -1, то двумя штрихами: А' и А". Символы представлений, у которых операции инверсии отвечает единичная матрица (так называемые четные представления), снабжаются внизу справа индексом g (от немецкого gerade - четный), а если 220 единичная матрица, умноженная на-1 (нечетные представления), - то индексом и (от ungerade - нечетный): например, Bg и Ви. Кроме того, представления могут быть при прочих равных символах просто пронумерованы: Au,A2^,FlH,F2(/ и т.п., где цифры в нижних индексах как раз и представляют собой эти номера. Отметим еще, что для одноэлектронных функций при обозначении тех представле- представлений, по которым они преобразуются, как правило, используют строчные латинские буквы: е2 , alw, а" и т.п. У групп С и D^ обозначения представлений обычно иные, что определяется следующим. В силу цилиндрической симметрии задачи электронные волновые функции могут быть представлены в виде произведения, содержащего в качестве одного сомножителя функцию угла поворота системы электронов вокруг оси Сх, а в качестве второго - функцию остальных переменных, которые обозначим одним символом q : Ф(г,, г2,...,г„) = ХЛ(Ф)<ВД • Функция хл(ф)> как можно показать, является собственной для оператора проекции Lz - -id/dq) электронного орбитального момента на ось молекулы с собственным значением Л и имеет обычный для таких операторов вид: ХЛ(ф) ~ AelAv. При этом функции, отвечающие значениям ±Л, вырождены по энергии (оператор Гамильтона зависит от \} ) и преобразуются по двумер- двумерным вещественным представлениям, нумеруемым по значению Л , как и в случае атома водорода, но только с заменой соответ- соответствующих латинских букв на прописные греческие: Квантовое число Л Представление (тип симметрии) 0 1 п 2 А 3 Ф 4 ... Г ... Задачи 1. Четными или нечетными являются перестановки: /1 2 3 4\ 2 14 3, 2. Объясните, что означают представленные ниже обозна- обозначения неприводимых представлений и приведите примеры тех 221 а 2 з 4
точечных групп, у которых такие представления могут встре- встретиться: ,А , 2 ,А7 . и * 2и 3. Какого типа представления должны получиться для следующих прямых произведений: А"®А\ А®В, А ®Е , В ®Е ? § 4. Теорема Вигнера-Эккарта и правила отбора Операции симметрии, как уже говорилось, представляют собой некоторые преобразования переменных, так что ,, г2,..., гл) = 4f(grl9 #г2, .., grn) для любой операции g группы симметрии G. Каждая из функций Ч* преобразуется по некоторому представлению, приводимому или неприводимому, также как и более сложные конструкции, например произведения таких функций. При этом произведения функций, преобразующихся по неприводимым представлениям, сами преобразуются по прямым произведениям неприводимых пред- представлений (см. § 2). Эти результаты при некоторых дополнитель- дополнительных утверждениях приводят к ряду весьма важных следствий, широко используемых в квантовой механике атомов и молекул. а. Интегралы от базисных функций неприводимых представлений. Пусть для некоторого неприводимого пред- представления Г размерности г имеется система базисных функций Ф; (/ = 1, 2,..., г), преобразующихся операциями группы симметрии друг через друга. Рассмотрим интегралы от этих функций по всей области изменения переменных, на которой они определены (будем также считать, что эти интегралы сходятся, т.е. конечны): Интеграл Ij(gk) =/?*Ф; ^т (^ = drldr2'^drn) допускает замену переменных, преобразующую gjrl вновь в г,, т.е. замену, осущест- осуществляемую обратной операцией g^1. При этом dridrr..drn перейдет в d(gllvl)d(gllT2)...d(gllTn) = \j\dridr2...drn9 где J - якобиан преобразования, т.е. определитель, составленный из частных производных вида d(gllxia)/dxj& a xia - компонента с индексом а (= 1, 2 или 3) радиуса-вектора г.. Коль скоро операции симметрии суть линейные преобразования компонент векторов, осуществля- осуществляемые унитарными матрицами, то \j = 1, так что It(gk) = It(e) - - ГФ, drxdr2...drn для любой операции gAE G. Следовательно, все интегралы от функций g хр одинаковы. Введем теперь функцию N D.4.1) k=l (N - порядок группы), называемую средним функции ф( по группе. Интеграл от этой функции 1 И 1 N (<$>dx= — N & также, как следует из этой цепочки равенств, равен I.. С другой стороны, если подействовать на функцию Ф любой операцией группы gn то она не изменится, так как \ Е, . 1 N 222 и когда к пробегает все значения индексов операций группы, то же самое делает и к' (хотя и в другой последовательности), так что g Ф = Ф. Очевидно, что Ф преобразуется по полносимметрич- полносимметричному представлению Fs группы. Если же функция ф( преобразо- преобразовывалась по неприводимому представлению Г, отличному от Гх, то каждая из функций gхр также будет преобразовываться по этому представлению, а потому их сумма не может преобразо- преобразовываться по полносимметричному представлению. Другими словами, операции g.He выводят функцию ф за пределы про- странства St , на котором действует представление Г, как и переход к линейной комбинации функций gхр . Поэтому Ф должна содержаться в Sts, а с другой стороны, она преобразуется по пред- представлению, отличному от Г. Единственная возможность для разрешения этого противоречия заключается в том, что Ф, а вместе в нею и /., равны нулю. Таким образом, интеграл от функции, преобразующейся по неприводимому представлению Г, отличному от единичного, или полносимметричного представления Г5, равен нулю. Как следует из этого рассуждения, от условия сходимости интеграла/, можно, вообще говоря, отказаться. Если функция ф преобразуется по приводимому представлению Гп, которое может быть приведено 223
к сумме неприводимых Ги, то функция ф может быть записана как сумма функций, каждая из которых преобразуется по одному из этих неприводимых представлений: Ч) = ^иЧ3и •> причем сумма берется по всем тем w, которые входят в сумму Гп = ^тТи, множитель ти указывает, сколько раз Гц встречается в Гп . Интег- Интеграл от функции ф будет отличен от нуля только тогда, когда ф содержит слагаемое, преобразующееся по полносимметричному представлению. б. Матричные элементы операторов. Перейдем теперь к более сложной конструкции, когда вычисляются матричные эле- элементы тех или иных операторов квантовой механики. Подынтег- Подынтегральное выражение в этом случае содержит произведение функций ф* и Aty, где А - оператор, матричный элемент которого и опре- определяется функциями ф и \р. Оператор А при действии операций симметрии преобразу- преобразуется тем или иным способом: так, оператор Гамильтона остается без изменений (ведь рассматривается группа операций, относи- относительно которых уравнение Шредингера инвариантно), так же как не меняются по отдельности операторы кинетической и потен- потенциальной энергии. Следовательно, операторы H,TnV полносим- полносимметричны относительно операций группы симметрии. В то же время оператор дипольного момента D = \ qa*a таковым не является. Например, в случае группы С3,, главная ось симметрии которой направлена по оси z, при всех операциях симметрии Dz не меняется, тогда как Dx и D преобразуются друг через друга. Различно будут преобразовываться в этом случае и компоненты квадрупольного момента, пропорциональные х2 + у2, ху, xz, х2 + z2, у2 + z2, yz. В целом же функция Aty будет преобразовываться по пря- прямому произведению представлений ГА и Г^, тогда как все подынтегральное выражение матричного элемента преобразуется по прямому произведению трех представлений: Г Г^ и Г^. Представление Гф совпадает с Г , если его матрицы веществен- вещественны (т.е. ортогональны). В противном случае Гф и Г различны. Кроме того, если функции ф и г)) суть базисные функции одного и того же пространства, на котором действует неприводимое пред- представление Цр, то в Г^®!^ должен быть взят лишь симметри- зованный квадрат Г^. Таким образом, подынтегральное выражение матричного элемента <ф А -ф> преобразуется как одна из компонент 224 линейного пространства, на котором действует представление Гф®!^®!^,. Для оператора Н представление Г^ есть не что иное как Г , и поэтому поведение ф*/А|) определяется пред- i<f * ставлением Гт®Г1И. в. Теорема Вигнера-Эккарта. Как говорилось в § 2, характер прямого произведения двух представлений для любой операции gk равен произведению характеров этих представлений: ХГ1®г2 (gk ) = Хг, (gk )Xr2 (gk )¦ Для того, чтобы выяснить, будет ли в этом прямом произведении содержаться единичное представ- представление, надо воспользоваться формулой D.2.5): 1 ЛГ 8k поскольку Хге(#*)=1 Для любого к. Правая часть последнего равенства соответствует той же формуле D.2.5), если бы мы выясняли, сколько раз представление Г,содержится в представ- представлении Г2. Но оба эти представления по исходному утверждению неприводимые. Это означает, что Г] содержится (один раз) в Г2, только если эти представления совпадают. Учитывая это обстоятельство и сказанное в п. а, можем теперь сформулировать утверждение, носящее название теоремы Вигнера-Эккарта: - матрица полносимметричного оператора А в базисе функций, преобразующихся по неприводимым представлениям группы симметрии, имеет блочно-диагональный вид, причем каждый диагональный блок относится к одному неприводимому представлению (т.е. содержит матричные элементы на функциях одного и того же представления); - матрица оператора А, преобразующегося по неполносим- метричному представлению, содержит лишь те ненулевые блоки с элементами <ф. \А I ф >, в которых ф и Ац), преобразуются по одному и тому же неприводимому представлению. Следовательно, матрица оператора Гамильтона будет иметь вид, представленный на следующей странице. Символами представлений здесь обозначены те блоки, которые содержат матричные элементы на функциях, базисных доя этих представлений. Высказанное выше утверждение составляет, по существу, лишь первую половину теоремы Вигнера-Эккарта. Вторая ее половина связана со структурой блоков, относящихся к вырожден- вырожденным представлениям. Ниже лишь на примере будет пояснено 8 — 1395 225 м.
содержание этой второй половины теоремы, тем более что в приклад- прикладных проблемах, как правило, бывает достаточно ограничиться лишь утверждением, приведенным выше. Н = О о о 2 о о о Гз Итак, пусть ф(, ф2 и ф3 - базисные функции неприводимого трехкратно вырожденного представления Г. Для полносиммет- полносимметричного оператора А подынтегральные выражения матричных элементов на этих функциях <ф. \А ц>> (i, к = 1, 2, 3) будут преобразовываться по представлению îà = Г© ..., т.е. это 11 Г *^ g ' представление будет приводимо и будет содержать лишь один раз полносимметричное представление Г5. Нетрудно заметить, что функцией, преобразующейся по Г5, будет следующая: Действительно, з а-1 а- / з р-1 / з P,Y«l\a=l / p,Y=l ' P-l где учтена ортогональность (или унитарность) матриц представ- представления Ск. Полученный результат сразу же показывает, что функции фа^4фр (а * Р) преобразуются по представлениям, которые не содержат полносимметричную компоненту, а потому интегралы 226 L от них должны быть равны нулю. Кроме того, можно также показать, что все интегралы Ааа = <фа \А | фа> равны друг другу. Поэтому блок матрицы А, отвечающий функциям ф1? ф2 и ф3, будет иметь следующий вид: А aa о о о aa о о о Совершенно аналогичная ситуация возникает тогда, когда имеются два поднабора функций ф1? ф2, ф3 и г|),, г|J, г|K, преобразующихся каждый по неприводимому представлению Г и выбранных так, что на каждом поднаборе матрицы представления для каждой операции симметрии одни и те же. Рассуждения, подобные тем, что были проведены выше, показывают, что блок матрицы А, отвечающий этим двум поднаборам, приобретает следующую форму: Ф1 Ф2 Фз Уз ф1 Аи 0 0 в 0 0 Ф2 0 Аи 0 0 в 0 Фз 0 0 Аи 0 0 в в 0 0 Аи' 0 0 0 в 0 0 Аи' 0 V3 0 0 в 0 0 Аи' гдеЛи = и В = 227
Обобщение этих утверждений о структуре матрицы А в блоках, относящихся к представлениям произвольной размерности при произвольных числах т повторения поднаборов функций, преобразующихся по одному и тому же представлению, и состав- составляет вторую половину теории Вигнера-Эккарта. г. Правила отбора. Для операторов, преобразующихся по неполносимметричным представлениям, отличными от нуля оказываются и матричные элементы недиагональных блоков, хотя в целом положение здесь имеет общие черты с обсуждавшимся выше хотя бы по той причине, что не все недиагональные матрич- матричные элементы отличны от нуля: часть из них по симметрии также обращается в нуль. А эти недиагональные матричные элементы оказываются важными при анализе интенсивностей переходов между различными состояниями. В § 3 гл.III уже было показано, что вероятность испускания или поглощения света, т.е. вероятность перехода, вынуждаемого внешним монохроматическим электромагнитным полем, пропор- пропорциональна квадрату модуля дипольного момента перехода, а для плоскополяризованного излучения при фиксированной ориентации молекулы - квадрату модуля соответствующей компоненты ди- дипольного момента. Поэтому, если матричный элемент дипольного момента перехода по симметрии обращается в нуль, вероятность перехода будет также равна нулю. В таких случаях говорят, что переход запрещен по симметрии, в противном же случае говорят о разрешенных переходах. Установление только лишь на основании соображений симметрии того, являются ли переходы из каждого заданного состояния в состояния той же или другой симметрии разрешенными или запрещенными, носит название отбора перехо- переходов, а потому совокупность общих утверждений о том, какие переходы запрещены по симметрии (все же остальные, очевидно, разрешены), носит название правил отбора по симметрии '. Если дипольный переход оказывается запрещенным, то, как правило, разрешены переходы, обусловленные более высокими членами разложения амплитуды векторного потенциала по сте- степеням компонент г, прежде всего - квадрупольным моментом 1 Бывают правила отбора и по другим характеристикам, например по спину, т.е. по мультиплетности состояний, участвующих в переходах. Бывают и приближенные правила отбора, когда переходы оказываются хотя и разрешенными, но соответствующие матричные элементы операторов перехода близки к нулю настолько, что ими с высокой степенью точности можно пренебречь. 228 системы заряженных частиц. Обычно интенсивность таких перехо- переходов на несколько порядков ниже по сравнению с разрешенными дипольными переходами. При комбинационном рассеянии вероятность перехода оказывается связанной с матричным элементом поляризуемости перехода (см. § 3 гл.III). Выпишем этот матричный элемент в несколько упрощенном виде, опуская несущественные для общего представления коэффициенты: <ф;«ф ^ **•¦ (О */¦ \ СО -СО; ik СО -СО kj <ф,- >< Ф* D ф: > Вектор D записан здесь в виде вектора-столбца с компонентами Dx, D , Dz, каждый матричный элемент <ф; | D фА> также представ- представляет собой вектор-столбец, при умножении которого на вектор- строку <фА | DT ф> получается матрица 3-го порядка, элементы которой определяют вероятности переходов при той или иной поляризации световой волны. Следовательно, переход при комби- комбинационном рассеянии будет возможен, лишь если отличны от нуля одновременно матричные элементы <ф, |^а|фА> и <ФА D ф>. Однако, поскольку здесь ведется суммирование по к, то среди возбужденных состояний, как правило, найдется такое состояние, для которого матричные элементы одновременно отличны от нуля. При расчетах интенсивностей переходов, связанных с вращением плоскости поляризации световой волны, возникают в качестве определяющих вращательную силу перехода матричные элементы магнитного момента и т.д. Для каждого из рассмотрен- рассмотренных выше случаев будут получаться свои точные или прибли- приближенные правила отбора, определяющие вероятности соответству- соответствующих переходов. д. Пример. Пусть имеется некоторая система зарядов qa (а = 1, 2,..., N), причем внешнее поле, действующее на систему, имеет симметрию точечной группы C2v (с неподвижной точкой в центре масс зарядов и с осью симметрии 2-го порядка, направлен- направленной по оси г). В общем случае у такой системы, как показывает таблица характеров неприводимых представлений этой группы, c2v Ах А2 Вх В2 е 1 1 1 1 с2 1 1 -1 -1 ст v(xz) 1 -1 1 1 -1 1 z;x\y\z2 ху х; xz У>уг 229 L
могут быть состояния 4 типов: Ах, А2, Bv Вг В правой части таблицы показано, по каким неприводимым представлениям преобразуются величины х, у и z, определяющие характер преобразования компонент дипольного момента, а также величины д:2, у2, z2, xy, xz иyz9 отвечающие соответствующим компонентам квадрупольного момента или поляризуемости. Для дипольных переходов из состояний типа Ах будут разрешены лишь переходы в состояния А ^ при поляризации волны по оси 2 и переходы в состояния типа Вх и В2 при поляризации световой волны по направлениям х и у соответственно; дипольные переходы в состояния типа А2 вообще будут запрещены. Как следует из таблицы, такой переход может проявиться лишь при комбинационном рассеянии или под влиянием ху-компоненты квадрупольного момента системы. Задачи 1. Матрица гамильтониана в базисе функций j^ (а = 1, 2,..., М), преобразующихся по неприводимым представлениям группы симметрии системы, имеет блочно-диагональный вид. Какова при этом будет структура матрицы интегралов перекрывания S с элементами <у у >? /va Л.р 2. Показать, что оператор кинетической энергии системы частиц инвариантен относительно операций симметрии. 3. Рассмотреть правила отбора для дипольных переходов у системы зарядов с внешним полем, имеющим симметрию точечной группы а) C3v; б) С4уи в) S4. 4. Найти правила отбора по симметрии для дипольного мо- момента перехода гармонического осциллятора. 5. Разрешены ли в атоме водорода дипольные переходы, при которых сохраняется орбитальное квантовое число /? 6. Пусть оператор Гамильтона явно от спиновых операто- операторов не зависит. Как можно сформулировать тогда правила отбора по спину для дипольных моментов перехода? Глава V Общие вопросы решения молекулярных задач § 1. Молекулярное уравнение Шредингера Квантово-механическое рассмотрение атомных и молеку- молекулярных систем зависит от того, являются ли такие системы сво- свободными или имеется внешнее поле, действующее на частицы составляющие атом или молекулу. Более просты, вообще говоря, построения в тех случаях, когда эти системы свободны, а потому с них мы и начнем изложение квантовой механики молекул. При этом до тех пор, пока не будет особой необходимости, различать атомы и молекулы не будем. Кроме того, будем использовать сис- систему атомных единиц. а. Стационарное уравнение Шредингера. Для свободных систем можно перейти от исходного временного к стационарному уравнению Шредингера, которое записывается в обычном виде: НЧ* = ЕЧ* E.1.1) с гамильтонианом где отдельные слагаемые имеют смысл - кинетической энергии ядер: E.1.2) a E.1.3а) - кинетической энергии электронов: N ,¦-1 E.1.36) - потенциала взаимодействия электронов между собой, пред- представляемого, например, кулоновским взаимодействием: - 2~~Т2~' E.1.3в) где г. - расстояние между электронами с индексами / wj ; 231 1цц^
- потенциала взаимодействия электронов с ядрами: у =_ f en E.1.3г) где Za - заряд ядра a, Ria - расстояние от электрона / до ядра а; - потенциала взаимодействия ядер между собой: — _ 1 v ZaZ$ -^ Z d ' E.1 .Зд) пп где Raa - расстояние между ядрами с индексами аир. Конечно, в более общем подходе, когда рассматриваются и другие взаимо- взаимодействия в системе, например взаимодействие каждого электрона с магнитным полем остальных электронов, приведенных выраже- выражений для потенциалов уже будет недостаточно. Характерно, однако, что при этом будут выполняться следующие соотношения: V = — > b(L i\ ft 14а} где g(i,j) = g(j, /) - некоторая функция, зависящая от переменных /- иу-го электронов, симметричная относительно перестановки этих переменных и по своему аналитическому виду одна и та же для любой пары электронов; еп E.1.46) где V"v(av,i) - одна и та же функция для каждой пары, состоя- состоящей из ядра вида v с индексом av (например, любого из протонов в молекуле углеводорода) и электрона с индексом /; число s указывает, сколько различных видов ядер встречается в моле- молекуле; E.1.4в) где Гуц(ау,рц) - взаимодействие ядра av вида v и ядра Рц вида \i, причем Vvpr V^. Формулами D) мы пока пользоваться не будем, коль скоро сущности последующих рассуждений это не меняет. б. Отделение переменных центра масс. Как уже говори- говорилось при рассмотрении задачи об атоме водорода, для свободной системы потенциалы взаимодействия частиц между собой не зависят от переменных центра масс системы, а полный импульс сохраняется, т.е. оператор импульса системы как целого коммути- 232 рует с оператором Гамильтона: РН = HP, где Р = V ра + ^ Pi a Чтобы отделить переменные, отвечающие импульсу Р, введем так называемые координаты Якоби, причем сначала введем их для подсистем ядер и электронов отдельно. Если для ядер в исходной инерциальной системе координат радиусы-векторы обозначить как Ra, то далее можно линейным преобразованием перейти к следующим векторам: M2R i + М? Л if E.1.5) MlR где ^а (а = 1, 2,..., K-Y) есть разность радиуса-вектора центра масс первых а ядер и радиуса-вектора ядра с номером а+1, тогда как \к есть радиус-вектор S центра масс подсистемы ядер (рис. 5.1.1). Оператор кинетической энергии ядер при этом будет иметь вид 2М As, E.1.6) д2 д2 д2 где, например, Д^ =—^ + —^ + К 2 ^2 уа и Рис. 5.1.1. Координаты Якоби для трех частиц. 233 L
-1 1/-1 . 1/-1 постоянные, выражающиеся через массы ядер: щ * = Мх + М2 1 = (Мх + М2У1 + М3 и т.п. Аналогично для электронов вводятся координаты - rt - г2 , E.1.7) N где г • - радиус-вектор /-го электрона, а Л - радиус-вектор центра масс подсистемы электронов. Оператор кинетической энергии подсистемы электронов будет иметь вид, аналогичный F). Наконец, от векторов ЗиЛ перейдем к их линейным ком- комбинациям MS+ NA E.1.8) R ц.м. М + N и E.1.9) Первая из них определяет радиус-вектор центра масс всей систе- системы, вторая - относительное расположение центров масс подсис- подсистем ядер и электронов. В новых переменных оператор Гамильтона приобретет вид Н =- ц.м. J_ 2\i А." к-\ 1 *"T 1 E.1.10) где Vee(tj) означает, что оператор Vee зависит только от пере- переменных Л1>-*->Ллг--р аналогично Vnn(^) зависит только от пере- переменных Е1ч...,?«- <; тот же смысл имеют символы л и ? в обозначении оператора Ven (?, л, *-) • Кроме того, в этом выражении \i~x = N~l + М~19 т.е. \i - приведенная масса для двух подсистем: электронов и ядер. От переменных центра масс зависит в выражении A0) для оператора Гамильтона лишь первое слагаемое, так что волновую 234 функцию Ф, собственную для Н, можно искать в виде E.1.11) причем Р* +Р* +Р; = 2(М + N)Etr, где Etr - энергия поступа- поступательного (трансляционного) движения системы как целого, Рх, Ру иЛ- постоянные компоненты импульса системы (собственные значения соответствующих операторов). Представление волновой функции Ф в виде A1) позволяет выделить экспоненциальный /PR множитель е им , не обладающий интегрируемым квадратом модуля; оставшаяся же часть, т.е. функция г|)(?, л> ^), для связан- связанных состояний атомов и молекул интегрируемым квадратом модуля, вообще говоря, обладать уже должна: эта волновая функ- функция, отвечающая покоящемуся центру масс (для нее Кцм = 0), должна быть существенно отличной от нуля лишь в ограниченной, локализованной области пространства. При поиске приближенных выражений для г|)(?, лД) это условие интегрируемости всегда имеет смысл учитывать, используя, например, в вариационном методе базисные функции, также имеющие интегрируемый квад- квадрат модуля. Естественно, можно было бы не вводить отдельно пере- переменные центров масс ядер и электронов, а сразу ввести единую систему координат Якоби для всех частиц молекулы. Выше это сделано не было по следующей причине. В гамильтониане A0) после отделения переменных центра масс можно вместо трех независимых переменных к подставить три независимые переменные Л, что формально эквивалентно совмещению начала системы координат с центром масс ядер. Существенно подчеркнуть, что такая эквивалентность в действительности формальна, поскольку при этом центр масс всей системы полностью не отделяется, так что волновая функция должна была бы иметь сомножитель рас- рассмотренного выше типа (e/PR), причем в этой новой системе коорди- координат полный импульс системы уже не должен быть сохраняющейся величиной, а волновая функция - обладать интегрируемым квадратом модуля. Введение же указанной подстановки проводится при условии, что она не меняет характера получаемого решения, и ищется такая волновая функция, которая интегрируемым квадратом модуля обладает. Найдя такое решение, в нем далее необходимо выделить переменные Л, заменить их на к, после чего полученная подобным образом функция и будет представлять собой искомую волновую функцию исследуемой молекулярной системы. 235
Что интересного дает обсуждаемая подстановка? Она позволяет вернуться в существенной степени к декартовым коор- координатам электронов. Действительно, в гамильтониане A0) опера- тор переходит в 2ц 111 АЛ = АЛ 2\i 2N 2М Л , и коль скоро 11 — + — М N то Л 2а и АЛ. Второе слагаемое должно давать существенно меньший вклад, поскольку Мпо крайней мере на три порядка больше N. Первое же слагаемое вместе с четвертым где операторы членом в гамильтониане A0) дает 2 Лапласа А7- записаны в декартовых координатах. Кроме того, в выражении для потенциала Ven(?»ц,к) замена к на Л приводит вновь к декартовым переменным электронов, т.е. Ven=Ven($l9...?K_l'9rl,...9rN). Поэтому гамильтониан A0), в котором переменные центра масс отделены и введена замена к на Л , приобретает вид: К-\ Л- 2M E.1.12) Последним членом при поиске собственных функций этого оператора можно на первых порах пренебречь, а далее учесть его как поправку, например по теории возмущений. Все приведенные преобразования относятся к числу таких тонкостей, которые в настоящем тексте, при первом знакомстве с квантовой химией, может быть, и не стоило бы обсуждать. Упомя- Упомянуто о них с единственной целью - показать, что даже в столь простых (казалось бы) местах квантовой теории молекул не все столь ясно и прозрачно, как может показаться на первый взгляд. Тем не менее, ниже столь подробно, как это только что сделано, на таких тонких вопросах теории останавливаться не будем, отмечая лишь при необходимости, что они существуют. б. Вращение системы, как целого. Проблема выделения переменных, отвечающих вращению свободной системы как цело- целого, гораздо сложнее проблемы выделения переменных центра масс. В то же время выделять их надо, ибо в противном случае распре- распределение плотности вероятности каждой частицы должно быть по физическим соображениям сферически симметрично, каждая молекула должна представлять собой шарик с каким-то распреде- 236 лением радиальной плотности для каждой частицы, в эту молекулу входящей 1. В классической механике вращение системы определяется ее угловой скоростью в данный момент времени, если использует- используется лагранжев формализм, и моментом импульса (т.е. моментом количества движения, угловым моментом), если используется га- мильтонов формализм, на базе которого строится и квантовая меха- механика. Если угловой момент равен нулю, то вращение системы от- отсутствует. Казалось бы, наиболее естественный путь отделения вращательных переменных заключается в том, чтобы перейти от исходной инерциальной лабораторной системы координат к новой системе, вращающейся относительно исходной, а потому - неинер- циальной, в которой угловой момент равнялся бы нулю. Однако сделать это не так-то просто. Действительно, для перехода от одной системы координат к другой у нас должны быть уравнения, связывающие переменные одной системы с переменными другой, например уравнения вида<7,= <7,(Г1> г2>--> r7v)>'= Ь 2,..., 3N. Если среди переменных rl9 r2,..., Гу есть зависимые, а ^-независимые переменные, то / может быть и меньше 37V, причем тогда должны существовать уравнения связи вида^(гг, г2,..., Гу) = ОД = 1, 2,...,/, которые и позволяют выделить независимые переменные. Как уже сказано, хотелось бы ввести такую систему координат, в которой выполнялись бы условия Lx = L - Lz = 0, т.е., например: Lx = где rt - скорость движения /-й частицы, a pt - ее импульс; скобки (axb)^ означают, что взята ^-компонента векторного произведения. Эти условия, связывающие вращающуюся систему координат с системой материальных точек (молекулой) отличаются от условий fk = 0 тем, что они содержат скорости rt. Перейти от них к усло- условиям вида^(г19 г2, ..., Гдг) = 0 в общем случае нельзя, ибо диф- дифференциальные уравнения первого порядка вида A3) в общем случае не являются интегрируемыми. Следовательно, условия равенства нулю компонент момента импульса не дают возмож- возможности найти такие уравнения, которые определяли бы угловые ^-г^-О, E.1.13) !Нет оснований для какого-либо выделенного направления или выделенной конфигурации частиц, отличающейся от другой конфигурации лишь поворотом вокруг произвольной оси, проходящей через центр масс, на произвольный угол. 237 t i
переменные, задающие положение подвижной системы координат относительно неподвижной, через все остальные координаты час- частиц молекулярной системы. Введем теперь несколько формул, поясняющих сказанное выше. Положение осей подвижной системы координат Oxyz относительно осей неподвижной, лабораторной системы OXYZ может быть определено тремя углами Эйлера ф, Ф и х (рис. 5.1.2), которые задают три последовательных поворота от одной системы к другой (начала обеих систем координат совпадают). Первый поворот совершается вокруг оси OZb положительном направлении на угол ф. Ось OZ при этом не меняется, равно как не меняется и проекция Z произвольного радиуса-вектора R на эту ось. Компоненты N Рис. 5.1.2. Углы Эйлера, определяющие положение подвижной системы координат Oxyz относительно неподвижной (лабораторной) системы OXYZ: ср - угол прецессии, Ф - угол нутации и х - угол собственного вращения. вектора R в новой системе Ox'y'z' определятся следующим преобразованием (по существу, преобразуются лишь X и Y в х1 = X соБф + Y sirup и у = -X sincp + Y У 2' = А ф Y sincp -sinqp О 0 ON О 1, (X\ Y E.1.14а) Второй поворот совершается вокруг оси Ох' на угол Ф, так чтобы новая ось Oz" совпала с осью Oz подвижной системы координат 238 (это совпадение определяет и величину угла ф, поскольку линия Oz' должна лежать в плоскости x'OZ): tx"\ y" = Ad (x'\ У' r / = 1 0 0 о \ * E.1.146) lx'\ У' Наконец, третий поворот совершается вокруг оси Oz" на угол х> так чтобы ось Ох" совпала с осью Ох, а Оу" - с осью Оу: У I v"\ = А У П ( cosx 0) -sinx cosx 0 У E.1.14b) О 0 1 \ / \ r \ / \ i Результирующий поворот определяется последовательностью трех указанных поворотов, т.е. матрицей А = А -А^-А . Коль скоро каж- каждая из матриц-сомножителей ортогональна (в чем нетрудно убе- убедиться прямой проверкой), то ортогональной будет и матрица А. Итак, имеем: r = A-R, R = Afr, E.1.15) где г- вектор-столбец из компонент вектора в подвижной системе, a R - вектор-столбец из компонент того же вектора в неподвижной системе координат. Скорости изменения г и R с течением времени связаны следующим соотношением, получающимся при дифференци- дифференцировании A5) по времени: E.1.16) Здесь А - матрица, получающаяся из А' взятием производной по времени от каждого ее элемента, причем АА' = 1. Что касается матрицы АА*, то ее структура очень проста: аа + = = А у/ -ХТУ * ~ф "ф Поскольку далее Aj)AjAj+A Л . E.1.17) X о о о о о (Q/ 0 о о > о 0 о А Ат - 0 -Ф 0^ ф 0 0 0 0 0 и X' -& и Ф ~ величины векторов угловой скорости со, направленных 239
по осям Oz, Ох' (называемой линией узлов) и OZ соответственно. Поэтому ( ° AXAJ= (<oz)z О О { о оо, где <о2 - угловая скорость вращения вокруг оси Oz, направленная по этой оси, так что ее проекция (<о2Jна эту ось совпадает с длиной вектора <о2; далее cosx sinX - sinx COSX 0 0 1 '0 0 0 0 0 (ох. 0 ш 0 0 0 -ых 0 0 -со^ cosx ^ со х. sinx со х. cos/ 0 cosx sinx 0 О О - sinx cosx О О 1 I О о 0 где сох> - длина вектора угловой скорости при поворотах вокруг линии узлов, а (ю^ )х и (&х, )у - проекции этого вектора на оси подвижной системы координат. Аналогично записываются элемен- ты и оставшейся в правой части A6) матрицы АхА^(АфА(|))А^Ах через проекции вектора coz , отвечающего поворотам вокруг оси 0Z неподвижной системы. Коль скоро полная угловая скорость ю системы есть векторная сумма указанных трех угловых скоростей: = о>2 + <ох. + <oz, то окончательно найдем: 1 0 -ю, " ч -О) Следовательно, у 0 со. о ААгг = co2jc - = юх г т.е. скорость R в лабораторной системе координат, как показы- показывают A6) и полученное равенство, есть записанная в этой системе 240 сумма собственной скорости г и скорости юхг, обусловленной вращением подвижной системы координат: E.1.18) Для частицы с массой т момент импульса с использованием A5) можно теперь записать так: где переход к последнему равенству основан на том, что слева в нем стоит векторное произведение двух векторов в лабораторной системе, а справа записано сначала это же векторное произведение в подвижной системе, а потом совершен обратный переход к лабораторной системе. Вектор 1 = г х/иг есть момент импульса в подвижной системе (который, как очень хотелось бы, должен быть по возможности близким нулю). Двойное же векторное произведе- произведение можно переписать, применяя известную формулу векторного исчисления: ах (Ьх с) = Ь(а с)- c(ab). E.1.20) Тогда получим t 2 t E.1.21) причем I - симметричная матрица, элементами которой служат моменты инерции (на диагонали) и так называемые произведе- произведения инерции (на недиагональных местах): (т(г2 -х2) - тху - mxz - тху т(г2-у2) - туг - mxz - туг т(г2 -г2) E.1.22) Для системы материальных точек матрица I будет суммой матриц B2), относящихся к отдельным точкам. Эту матрицу часто назы- называют матрицей тензора инерции. Используя соотношение B1), мо- можем найти выражение для ю и подставить его в A8): AR = г - г х I1 (AL - 1). E.1.23) Таким образом, скорость R в лабораторной системе координат выражена через скорость в подвижной системе, через момент им- импульса L в лабораторной системе и через момент импульса 1 в • подвижной системе. Подставим выражение B3) для скорости R • каждой материальной точки в функцию Лаграйжа и попробуем перейти далее к функции Гамильтона (с тем, чтобы записать далее оператор Гамильтона). При этом переход к импульсам потребует 241
использования независимых координат и построения канонически сопряженных им импульсов. Будем использовать в качестве таких независимых коорди- координат относительные координаты частиц qt (i ~ 1, 2,..., л, где п для свободной системы 7V материальных точек равно в общем случае 37V-6), углы Эйлера, связывающие подвижную систему с лабора- лабораторной, и координаты центра масс. В качестве 6 условий связи подвижной системы с молекулой примем следующие: l.M. N E.1.24) ("I где гю - некоторая фиксированная конфигурация частиц (всех или только лишь части) рассматриваемой молекулярной системы. Второе из этих векторных условий допускает переход к конечным уравнениям, не содержащим скоростей: N где с - постоянный вектор. Условия B4) для молекул обычно записывают так, что они относятся только к ядерной подсистеме. В этом случае они носят название условий Эккарта. Такая запись связана, конечно, с опреде-ленными приближениями, обсуждать которые детальнее не будем. Последующий переход к функции, а затем и оператору Гамильтона приводит после ряда довольно громоздких преобразований к га-мильтониану вида: Я = Т 2 Lad~%4 2 а л а,Р-1 E.1.25) где La - компоненты момента импульса всей молекулярной системы (Lx, Ly и Lz при а = 1, 2 и 3 соответственно), рк - опера- операторы импульсов (- ihd/dqk^, канонически сопряженных относи- относительным обобщенным координатам qk ; (I-1)otg - элементы матрицы, обратной матрице B2), tkl - элементы матрицы кинетической энергии относительного движения частиц, V(q) - потенциал взаимодействия частиц друг с другом, и, наконец, Сак- 242 элементы матрицы размера Зхл , где п - число независимых относительных переменных qk. Все величины (I-1)ap, tki и Сак суть функции этих относительных переменных. Если записать операторы La в виде вектора-столбца L, опе- операторы рк - в виде вектора-столбца Р (с п компонентами), а также ввести соответствующие матрицы I, T и С, то матричное представ- представление гамильтониана B5) будет выглядеть следующим образом: Н = -LTVlL + -РТТР + V + ~(PTCTL + LTCP), E.1.26) 2 2 2 В выражении B5) или B6) первый член соответствует вра- вращению системы как целого, хотя он через посредство элементов матрицы I зависит и от относительных координат. В этом члене в действительности должен был бы стоять вектор L - /, где / - оператор, соответствующий угловому моменту 1 в подвижной системе; однако этот оператор в предположении его малости мы пока опускаем. Если второе условие Эккарта записывается только лишь для ядерной подсистемы, то / будет включать момент импульса электронов и так называемый колебательный момент импульса ядер, который за счет того, что момент импульса ядер в существенной степени оказывается исключенным этим вторым условием, является малым, и им действительно обычно пренебре- пренебрегают. Следующие два члена в правой части B5) или B6) связаны с относительным движением частиц в системе. Они как раз представляют основной интерес в квантовохимических задачах, и о них далее будет идти более подробный разговор. И наконец, последний член в B5) или B6) отвечает так называемому кори- олисову взаимодействию относительного движения с вращением системы. (Соответствующая сила, как известно еще со школь- школьной скамьи, приводит к размыванию правого берега у рек, теку- текущих с севера на юг.) Кориолисовым взаимодействием при на- начальном рассмотрении молекулярных задач также обычно пре- пренебрегают. § 2. Адиабатическое приближение Отделение переменных центра масс позволяет перейти к волновым функциям с интегрируемым квадратом модуля (для связанных состояний), а введение подвижной системы координат, связанной с молекулой или с ее ядерной подсистемой, позволяет 243
избавиться от сферически усредненной картины распределения плотности вероятности для частиц, образующих молекулу. И тот, и другой шаг очень важны, однако получающиеся при этом урав- уравнения остаются настолько сложными, что приходится думать о дальнейшем их упрощении за счет введения тех или иных приближе- приближений. Для того, чтобы лучше понять, как их вводить, рассмотрим модельный пример. а. Модельная двумерная задача. Допустим, что после отделения переменных центра масс и вращательных переменных у нас осталось всего две переменные - х и у, а оператор Гамиль- Гамильтона имеет следующий простой вид: 1 д2 1 д 1, -кх „ . ^ +— lyz + hcy . E.2.1) 2m sx2 2M dy2 2 2У Потенциал в этом гамильтониане отвечает двумерному гармо- гармоническому осциллятору, причем силовые постоянные к и / (обе больше нуля) будем считать величинами одного и того же по- порядка, а \2 < Ы, так что двумерная парабола, отвечающая этому потенциалу, имеет минимум. Введем теперь масштабное преобра- преобразование переменных X = 4тх и Y = -jMy , что приведет к гамиль- гамильтониану вида д2 1 д2 +-QJY2 +AXY , E.2.2) 2 2 2дХ2 2dY2 2 где Q^ = к/т, Q^ = 1/М и Л = \j4mM . Далее можно ввести линейное преобразование переменных X и Y, при котором квад- квадратичная форма потенциала сведется к диагональному виду и гамильтониан Н станет суммой двух гамильтонианов /г, и /г2, каждый из которых будет отвечать одномерному гармоническому осциллятору, причем у первого из них частота колебаний будет равна col5 у второго - ш2, где Л2 E.2.3) 'Q,2 -Q2 • - По мере увеличения одной из масс, например М, величины Q,\ и Л2 будут уменьшаться, так что при достаточно большой массе М 244 будут справедливы следующие соотношения, получающиеся из C) разложением корней в ряд и ограничением первыми членами: CO Q 2 2 2 1 м со2. 2 t 1- mQ M При возрастании М частота coj стремится к Q1? т.е. к частоте осциллятора с массой т и силовой постоянной к, тогда как частота второго осциллятора стремится к нулю. Этот пример отчетливо показывает, что различие в массах т и Мпри примерно одинаковых по порядку величины слагаемых потенциала приводит к заметно различающимся по своим часто- частотам осцилляторам, причем гамильтониан для одного из них (с частотой coj) получается из исходного гамильтониана простым выбрасыванием оператора кинетической энергии, содержащего "большую" массу Л/. б. Теория возмущений. Если вместо переменных X и Y, введенных в предыдущем пункте, воспользоваться переменны- переменными ? и ц: А и то гамильтониан A) преобразуется к следующему: 1/2 Я'=1И Я- Z, к 1 д 2 Эт, 2П ,E.2.4) причем к = (т/Му и при М»т величина к « 1, что дает на- надежду на использование к в качестве параметра возмущения: где //0, V и W определяются из D). Конечно, на этом пути возни- возникают свои сложности, поскольку Но зависит только от 2;, а чле- члены, определяющие возмущение, зависят и от ?, и от т). Однако из этих сложностей при некоторых дополнительных оговорках выбраться можно, что действительно позволило М.Борну и Р.Оппенгеймеру1 в 1927 г. предложить для разделения электрон- 'Борн Макс A882 - 1970), немецкий физик, которому принадлежит современная интерпретация волновой функции. Автор гидродинамической теории ядра, его именем названы борновские приближения в теории возмущений (см. § 3 гл. III). Оппенгеймер Роберт A904 - 1967), американский физик, начинавший научную деятельность в Германии. Известен работами по квантовой механике, физике атомного ядра и космических лучей. Руководил работами по созданию американской атомной бомбы. 245
ных и ядерных переменных в молекулярных задачах такую тео- теорию возмущений, в которой волновые функции и собственные значения (энергии) представлялись в виде рядов по степеням малого параметра к = фп/М , где в качестве т выступала масса электрона, а в качестве М - некоторая средняя масса тех ядер, которые входят в молекулу. В самом худшем с позиций теории возмущений случае, когда в качестве Мфигурирует масса протона, к "* t//48% ^О'-^, так что параметр возмущения действительно оказывается достаточно малым. Естественно, что для молекулы потенциал уже отличается от потенциала многомерного гармонического осциллятора. В под- подходе Борна - Оппенгеймера, однако, предполагалось, что движе- движение ядер ограничено сравнительно малыми областями вблизи неко- некоторого равновесного положения каждого из ядер, так что потенциал можно представить в виде (сходящегося) ряда по степеням малых смещений от положения равновесия. И тогда перед каждой из степеней возникает соответствующий параметр малости в виде к в той или иной степени. в. Адиабатическое приближение. После высказанных в двух предыдущих пунктах наводящих соображений можно при- принять, что после отделения центра масс в молекулярном гамиль- гамильтониане, например в E.1.12), оператор кинетической энергии ядер является в некотором смысле малым, и им можно на начальном этапе рассмотрения пренебречь. Тогда получается так называе- называемый электронный гамильтониан n, E-2.5) ** i в котором дифференциальные операторы относятся только лишь к электронным переменным. Производных по ядерным перемен- переменным в этом операторе нет, в то же время потенциал Ven (как впро- впрочем и Vnn) от ядерных переменных зависит. Ядра играют при таком подходе роль внешнего поля, в котором находятся электроны. Если Ven представлен кулоновскими членами взаимодействия ядер и электронов, то это поле есть не что иное, как поле фиксированных точечных зарядов, зависящих от относительного их расположения. Потенциал Vnn при этом от электронных переменных не зависит и для каждой фиксированной конфигурации ядер имеет вполне опре- определенное численное значение. Следовательно, оператор Не зависит от переменных ядер лишь как от некоторых параметров; их изме- 246 нение влечет за собой изменение внешнего поля, а тем самым и изменение волновой функции и собственного значения: ЯеФе;(г, R) = ВДФе,(г, R), E.2.6) где специально подчеркнуто, что волновая функция и отвечаю- отвечающее ей собственное значение зависят от конфигурации ядер, зада- задаваемой в F) символом R. Функции Фе; носят название электронных волновых функ- функций. Коль скоро они являются собственными функциями элек- электронного гамильтониана, то для связанных состояний подсисте- подсистемы электронов их можно нормировать на единицу: =1, E.2.7) а для состояний сплошного спектра - на 6-функцию. Функции Фе1 и Фер отвечающие разным собственным значениям, взаимно ортогональны: Ф ¦ Ф • ^ en ^ ej >г=о О'")), где интегрирование опять-таки ведется только по электронным переменным. В то же время общее решение уравнения F) может быть записано в виде где , R) = Фе(г, R)-X(R), E.2.8) - некоторая произвольная функция ядерных переменных. В представлении (8). функция х не определена. Этим об- обстоятельством можно, однако, выгодно воспользоваться и подо- подобрать х так, чтобы функция W(r, R) давала бы наилучшее при- приближение (по энергии), определяемое вариационным принципом, для задачи о молекуле в целом. Если записать молекулярный га- гамильтониан в виде Н = Не + Тп, где Тп - оператор кинетической энергии ядер, и потребовать, чтобы в выражении (8) функция Фе удовлетворяла электронному волновому уравнению и чтобы в целом функция Ф(г, R) была нормирована: |>й=1, E-2.9) то далее можно попытаться найти такие функции х> которые да- дают экстремум функционалу энергии / = < ^//(Ф >гд . Можно показать, что эти функции, по крайней мере при вещественных функциях Фе, удовлетворяют следующему уравнению: {Tn + Et(R) + < ФЯ.|ГЛ|ФЯ. >r}xik(R) = EikXik(R) • E-2.10) 247
Следовательно, наилучшие по энергии функции x^W в пред- представлении (8) удовлетворяют уравнению A0), имеющему смысл волнового уравнения для1 подсистемы ядер, находящейся в по- потенциальном поле е,>г. E.2.11) Первое слагаемое в правой части этого выражения есть не что иное, как собственное значение электронного гамильтониана (уравнение F)), а второе - поправка первого порядка теории возмущений к этому собственному значению, если бы в качестве возмущения можно было бы рассматривать оператор кинетической энергии ядер Тп. Эта поправка есть функция только ядерных пере- переменных. Поэтому она может быть включена непосредственно в собственное значение электронного гамильтониана, если его на- написать в виде Не=Не + 2< Фе1\Тп\Фы >г |ФЯ. >< Фя.|, E.2.12) где символ \Фе1 ><Фе1-| означает оператор, действующий на лю- любую функцию ф по следующему правилу: / Часто этой поправкой, коль скоро она обычно мала, пренебрега- пренебрегают. И тогда в потенциале A1) остается только функция Et{R). Таким образом, волновая функция (8) является наилучшей по энергии, если ее сомножители Фе и х удовлетворяют системе двух уравнений: E.2.13) где Et(R) = Et(R) + < Фе(\Тп\Фе1 >г. Полученная при этом кон- конструкция для нахождения волновой функции в виде двух сомно- сомножителей, удовлетворяющих уравнениям A3), носит название адиабатического приближения. В этом приближении электронная волновая функция Фе/ находится для каждой (фиксированной) ядерной конфигурации, тогда как ядерная функция %ik{R) определя- определяется для потенциала, усредненного по всем возможным расположе- расположениям электронов, поскольку ;>г, E.2.14) т.е. Et(R) представляет собой среднее значение Н на элек- 248 тронной волновой функции Фе/. Классический образ достаточно прост: электроны движутся в фиксированном или в очень мед- медленно, адиабатически меняющемся поле ядер, тогда как их дви- движение в свою очередь настолько быстро, что ядра испытывают лишь воздействие поля, усредненного по всем конфигурациям электронов. Функция Et{R) или Ё( (R) как функция относительных переменных ядер графически может быть представлена как некоторая поверхность Et - Et(R), в силу чего она обычно и называется поверхностью потенциальной энергии, или, что про- проще, потенциальной поверхностью. Для двухатомных молекул она называется потенциальной кривой. Такое же название использу- используется и для одномерных сечений потенциальных поверхностей. Так, для молекулы NO2 потенциальная поверхность в общем случае зависит от трех относительных ядерных переменных, например от расстояний RfN-Oj), R(N-O2) и от валентного угла Oi-N-O2- В то же время на этой поверхности можно рассматривать различные сечения, например, отвечающие изменению расстояния R(N-Oi) при фиксированных двух других переменных или при фиксированном валентном угле и равенстве расстояний R^N-C^) и R(N-O2) и т.п. г. О терминологии. Приближение, в котором использует- используется электронный гамильтониан Не, определяемый равенством A2), носит название адиабатического приближения (первого порядка), если же в качестве электронного гамильтониана фигурирует Не, то возникает приближение Борна-Оппенгеймера. В обоих прибли- приближениях электронная волновая функция - одна и та же, тогда как решения ядерного волнового уравнения в A3), получаемые с Et(R) и ?,-(/?), будут различны. Очень часто, однако, особенно среди не- неспециалистов, терминами адиабатическое приближение и прибли- приближение Борна-Оппенгеймера обозначают одно и то же, а именно приближение с электронным гамильтонианом 7/е. Если решение электронного уравнения приближения Борна- Оппенгеймера находится к тому же для одной, выбранной по како- какому-либо принципу конфигурации ядер {Ro}'. Яе(г, Л0)Фе,(г, Ro) = Яе«(*о)Фе/(г а ядерное уравнение решается с потенциалом то приходим к грубому приближению Борна-Оппенгеймера. Термин "адиабатический" буквально означает "не перехо- 249
дящий через" (греч. а - не, dia - через, batos - идти). Он воз- возник в термодинамике, где обозначал процессы, в которых тепло- теплота не передается из системы или в систему через ее оболочку. В квантовой механике он обозначает такие процессы, в которых энергия системы меняется непрерывно при непрерывном изме- изменении внешних параметров, параметров потенциала, и не проис- происходит скачкообразного перехода из одного состояния в другое (как, например, при поглощении излучения). Именно подобного типа ситуация связывается с уравнениями A3): ядра движутся медлен- медленно, при изменении ими своего положения электронная волновая функция непрерывно меняется как функция параметров, опреде- определяющих геометрическую конфигурацию ядер. Несколько жаргонно, но образно говорят о том, что электронная волновая функция "успе- "успевает следить за перемещениями ядер". Ядра образуют медленно меняющуюся (или просто медленную) подсистему, тогда как элек- электроны образуют быструю подсистему. д. Выход за рамки адиабатического приближения. В более точных, чем адиабатическое приближение, подходах волновую функцию можно попытаться аппроксимировать линейной комбинацией функций Фе/(г, К): <5-2Л5> i причем "коэффициенты" Х/(-К) этой линейной комбинации зависят от ядерных переменных и подлежат определению. Будем предпо- предполагать ради простоты, что Ч* нормирована на единицу, и выпишем функционал энергии Прежде чем преобразовывать это выражение далее, заметим, что оператор Тп можно переписать в виде скалярного произведения вектора-столбца из первых производных по ядерным переменным (с некоторыми коэффициентами) на себя. Например, пусть Т =- п 2Ц] ,2 \ к2 1 2ц: ,2 \ 2 д7\2 Тогда можно ввести вектор-столбец tn , для которого эрмитово- сопряженная вектор-строка будет иметь вид: 1 а 1 л i 1 так что оператор кинетической энергии может быть записан следующим образом: Т =-*t-f . E.2.16) В общем случае вектор tn содержит столько компонент, сколько независимых ядерных переменных входит в tn. При действии опе- оператора Тп на произведение двух функций, каждая из которых зави- зависит от Л, получим ,-(ГЛФ«)- E-2.17) Следовательно, приведенный выше функционал энергии приобре- приобретет вид R 250 j>r\Xj>R < Вариация этого функционала при условии нормировки функции Ч* и ортонормированности функций Фы приводит на основе достаточ- достаточного условия экстремума к системе уравнений, определяющих "ко- "коэффициенты" Xi(R): [Тп +Eej(R)]Xi(R)+ 2(<Фе1\Тп\Ф^ >г - W E.2.18) -2<Ф^|Фе;>,^хДЛ) = ?Х;(Л). Первая строчка определяет обычный оператор Гамильтона для ядерного волнового уравнения приближения Борна-Оппенгеймера, Во второй же строке приу * г стоят члены, определяющие выход за рамки адиабатического приближения, тогда как при / =j в этой строке интеграл <Фе;|*„|Фе; >г при вещественной функции Фег обращается, как можно показать, в нуль, а интеграл < Фе1*|Гя|Фет- >г есть не что иное, как уже обсуждавшаяся адиабатическая поправ- поправка первого порядка. Решения системы уравнений A8) и определя- определяют функцию Ч* A5), являющуюся более точной (по энергии), чем то, что получается в адиабатическом приближении. е. Пример. Рассмотрим простой пример, в котором опера- оператор Тп зависит от одной переменной: Тп = id /dR ), где R ~ 2ц ^ ' например межъядерное расстояние в двухатомной молекуле. Пусть, кроме того, линейная комбинация A5), представляющая 251 И
функцию Ф, содержит всего два члена (индекс е у Фе1 также опустим): Тогда уравнения A8) сведутся к двум связанным уравнениям [Тп (Угг - 2 = Е%2 , E.2.19) где Eel(R) и Ee2(R) - адиабатические потенциалы (первого порядка), К12=<Ф1|ГЛ|Ф2>Г, К21=К/2, W12 =<Фе11^+|Фе2 >г и trt = (i/2\i)(d/dR) . Уравнения A9) содержат недиагональные мат- матричные элементы Vx2 ~2Wi2tn, что не позволяет выделить отдель- отдельные уравнения для функций Xi и Х2 с соответствующими адиабати- адиабатическими потенциальными кривыми, как то было в адиабатическом приближении. Однако они все-таки допускают определенное упрощение за счет излагаемой ниже конструкции. Введем линейное преобразование электронных волновых функций с коэффициентами ct {ij =1,2), зависящими от R: В качестве матриц С будем далее рассматривать только ортого- ортогональные матрицы (при каждом/?). Для того, чтобы функция Ч* при этом осталась без изменений, функции Xi и %2 также должны быть преобразованы, но с помощью матрицы С: Используя тот же вариационный подход, что и выше, можно найти следующие уравнения для функций Х\ и Xi (матричные элементы записаны на электронных функциях Ф,): 2 >г х, 2 <Ф,\Тп+Не\Ф1>гХг+<Ф1\Тп+Не\Ф с ф2\тп + яе|Ф, >r xi + < ф2|т; + #е|Ф2 >г Коэффициенты с^(К) теперь можно подобрать так, чтобы недиаго- недиагональные элементы матрицы W, аналогичные элементам матрицы W в A9), т. е. матричный элемент W12 = < Ф^/^Фз > и элемент 252 n обратились бы в нуль. В таком случае недиагональные матричные элементы уравнений B0) уже не содержат оператора d/dR . При близких значениях ?,(/?) и E2(R% когда адиабатическое приближение и оказывается не вполне приемлемым, в этих матричных элементах слагаемые вида с*1с12?1 +С21С22^2 **\сисп +С21с22р также можно положить равными нулю из-за ортогональности матрицы С, поскольку для ортогональной матрицы выражение в скобках равно нулю. Тогда останутся отличными от нуля лишь элементы Vv = < Ф1|Г„|Ф2 >г и V , которые суть функции от Л, причем, как правило, достаточно малые по модулю почти при всех R. Если и ими пренебречь, то останется лишь диагональное пред- представление, в котором каждая из функций Xi и Х2 определяется своим уравнением: 2 E2(R) ¦ E2(R) Xi = X2 = E.2.21) Такое представление называется диабатическим (т.е. не адиабати- адиабатическим). Оно заметно отличается от адиабатического в тех облас- областях изменения Л, где расстояние между потенциальными кривыми (поверхностями) невелико. В этих областях cJR) * 6. , и потенци- потенциальные кривые диабатического представления уже не соответству- соответствуют энергии быстрой подсистемы в поле медленной подсистемы, а сами коэффициенты сильно зависят от R. Тем не менее диабатическое представление полезно, поскольку оно лучше адаптировано к описанию медленной подсистемы, когда она меняется достаточно быстро, например, при описании тех ситуа- ситуаций, когда реагирующие молекулы сталкиваются достаточно быстро. Не останавливаясь на критериях, при которых слова "дос- "достаточно быстро" приобретают вполне определенный смысл, мож- можно лишь отметить, что такие критерии существуют и что переход к диабатическому представлению при рассмотрении химических реакций проводится во многих случаях. Задачи 1. Написать электронный гамильтониан в адиабатическом представлении для молекул LiH, H3 и ВеОН. 2. Решить задачу о системе двух связанных гармонических осцилляторов (см. п. а) в адиабатическом приближении. 253 ¦1
3. Для задачи о системе двух связанных гармонических осцилляторов выяснить смысл введения диабатического пред- представления (используя лишь двухуровневое приближение) и найти это представление. 4. Пользуясь теорией возмущений второго порядка, найти общий вид решений уравнений A9) в двухуровневом приближении, т.е. при использовании в качестве базиса двух функций х10 и Х2о адиабатического приближения. § 3. Электронное волновое уравнение Адиабатическое приближение позволило выделить сомно- сомножители волновой функции: ее электронную и ядерную составля- составляющие, а также записать те уравнения, которым они удовлетво- удовлетворяют. Дальнейшие шаги связаны с анализом этих уравнений, по- построением их приближенных решений и исследованием свойств решений. При этом основное внимание в квантовой химии уделя- уделяется рассмотрению электронного уравнения, что служит причи- причиной того, что настоящий и ряд последующих параграфов будут отданы анализу решений именно электронного уравнения. а. Одноэлектронный подход. Электронное уравнение для молекулы может быть представлено в виде 9 Ф(г,Л)-?(Л)Ф(г,Л). E.3.1) Если бы в операторе Гамильтона Не отсутствовали члены меж- межэлектронного взаимодействия вида 1/г^, то он свелся бы к сум- сумме одноэлектронных операторов i \ z a Kai / i где h{i) - одноэлектронный оператор, зависящий от переменных электрона с индексом / и представляющий собой оператор Гамильтона для задаче об одном электроне в поле всех ядер. Решение стационарного уравнения Шреингера, согласно сказан- сказанному в § 2 гл. I, можно тогда искать в виде произведения М}(гь ..-,г^) = ф1(г1)ф2(г2) ... фд^ГдО, E.3.3) причем каждая из одноэлектронных функций ф*(гА) должна быть 254 решением одноэлектронного волнового уравнения вида т.е. 1. 2 а а Лси E.3.4) при условии, что функции щ нормированы и в своей совокупности образуют набор линейно независимых функций. Так, для двухэлектронной задачи Нетрудно, однако, убедиться, что наряду с функцией яр в качестве решения для задачи с оператором Н^ может быть взята и функция ^(г1,г2)=ф1(г2)ф2(г1), отвечающая тому же самому собственному значению ej + e2, что и функция г|)(г19 г2). Из этих двух решений для системы двух элек- электронов необходимо в конечном итоге построить функцию, антисим- антисимметричную относительно перестановок символов электронов, т.е. меняющую знак при всех нечетных перестановках, в данном слу- случае при транспозиции Р12. При этом требование антисимметрич- антисимметричности должно выполняться только при учете и спиновых индексов электронов (см. детальнее п. д § 5 гл. II). Обозначив поэтому одноэлектронные функции с учетом спинового множителя, т.е. спин-орбитали, через г^Дг,, а,), а всю совокупность пространствен- пространственных переменных и спинового индекса для каждого электрона одной цифрой (например, {гь ох} => 1), получим выражение для антисим- антисимметричного решения: 2, o2)-\\J(ru a^^2, о2)], - нормировочный множитель, аг^ иг|J нормированы и линейно независимы. Эту функцию можно записать следующим образом: E.3.5) т.е. представить ее в виде определителя. Величина определителя не меняется, если из одной его строки вычесть другую с некото- некоторым множителем Щ1,2)~А E.3.6) 255 I
Коэффициент X далее можно подобрать так, чтобы функции aj>2 = ^2 ~Mh были бы взаимно ортогональны: и т.е. Для системы N электронов антисимметричную волновую функцию Ч* также можно записать в виде определителя: , 2, ..., = А E.3.7) В этой цепочке равенств Л обозначает оператор антисимметриза- антисимметризации (антисимметризатор), Р - оператор перестановки 7V индексов, р - четность перестановки, А - нормировочный множитель. Сумма берется по всем возможным перестановкам индексов электронов. В последней строке под символом det в фигурных скобках стоят элементы главной диагонали определителя. Как и для двух электронов, первую строку определителя G) можно умножить на коэффициент Х2 и вычесть из второй строки, на коэффициент Х3 и вычесть из третьей строки и т.д. Далее коэф- коэффициенты Х2, ..., \N можно подобрать так, чтобы функции Ф* = Ук -kjfcipi (* = 2, •••> ЛО были бы ортогональны -ф1ф После этого аналогичную процедуру умножения на числа \х3, ..., \xN н вычитания результата из соответствующей строки можно повто- повторить со второй строкой и т.д. Выбирая таким образом числа ^2> •••> kjv > Цз> •••> Mw> можно в конце концов сделать все строки в определителе G) взаимно ортогональными, а к тому же и нормиро- нормировать одноэлектронные функции, входящие в этот определитель. Следовательно, для гамильтониана #@) собственными функциями являются функции, представляемые в виде определи- определителя (или в более общем случае в виде линейной комбинации определителей), который составлен из 7V одноэлектронных линейно 256 независимых функций. В общем для гамильтониана Не такое представление, конечно, справедливым не будет из-за наличия членов межэлектронного взаимодействия. Эти члены, однако, можно попробовать аппроксимировать суммой одноэлектронных операторов (функций): 71Х 2- Как это конкретно сделать - пока вопрос второй (например, запи- записав V{rt) в виде многочлена с варьируемыми коэффициентами и подобрав их по тому или иному критерию). Важно отметить, что при этом оператор Гамильтона можночвновь свести к сумме одно- одноэлектронных операторов a ai а волновую функцию системы N электронов представить в виде определителя из одноэлектронных функций, собственных для h(i). В этом варианте взаимодействие между электронами учитывается введением некоторого среднего поля, в котором находится данный электрон и которое создается всеми остальными электронами. В рассмотренных Подходах операторы Гамильтона не содержали слагаемых, зависящих от спиновых операторов. Следовательно, спиновые операторы будут коммутировать с этими операторами Гамильтона. Это означает в свою очередь, что волновые функции, представленные как определители, либо будут собственными для операторов спина, либо из них могут быть построены такие линейные комбинации, которые будут собствен- собственными для этих операторов. Другими словами, их можно спроек- спроектировать по спину и перейти к функциям "чистых" спиновых состояний. Такие спроектированные функции называются конфигурационными функциями состояния. Они отвечают определенным электронным конфигурациям, т.е. последовательно- последовательности индексов орбиталей, входящих в однодетерминантные функции, с указанием их чисел заполнения, показывающих сколько раз дан- данная орбиталь входит в определитель: один (со спин-функцией а или со спин-функцией Р) либо два (с той и с другой спин-функцией). б. Матричные элементы одно- и двухэлектронных операторов на функциях в виде определителей. Для дальнейшего построения теории на>* необходимо будет получить выражения для матричных элементов одно- и двухэлектронных 9 — 1395 257
операторов /гA) и g(\9 2) = gB, 1), а также для интегралов перекрывания на функциях в виде определителей: <К\к\Ь>ш<Ч!к\Ц1)\Ч!ь>9 E.3.8) <K\g(\a)\L> = <4*K\g(l2)\4'L> E.3.9) и где функции Ч^ и Ч^ представляют собой нормированные детерми- детерминанты для системы N электронов, составленные из ортонормиро- ортонормированных спин-орбиталей г|^. Начнем рассмотрение с интеграла перекрывания: LN }) где, например, E.3.10) - нормировочные множители перед детерминантами в Ч*к и Ч*А, а дополнительный индекс А' или L у спин-орбиталей подчеркивает их принадлежность тому или иному определителю. Разложим теперь тот и другой определитель по первому столбцу: Skl=AkA kl kAl >, E.3.11) где Afj^- и MLy - миноры, получаемые из исходных определителей вычеркиванием первого столбца и /- или у-й строки соответ- соответственно. Если \\)Ki = yLj9 то интеграл <(Фй-A)|'ФцA) > = *> в противном случае он равен нулю. Продолжая намеченный процесс последовательного разложения по первым столбцам миноров GV-1)-, GV-2)-ro и т.д. порядков, придем в конечном итоге к стоящим под знаком суммы произведениям вида ;i A) > < 4>Ki2 B)\yLh B) >...< xpKiN (N)\^LJN (N) >, в каждом из которых встретится обязательно хотя бы один интег- интеграл < tyKin \i\}LJn >,в котором \\?Kin * \pLJn , если определители Ч*к и 258 различаются хотя бы одной спин-орбиталью. Коль скоро такой интеграл равен нулю, то и каждое произведение в этом случае обращается в нуль, т.е. SKL = 0. Если же оба определителя одинако- одинаковы (К = Z), то в соотношении A1) интеграл <tyjci AI ^х/ 0) > = 1 при / =j и равен нулю во всех остальных случаях. Поэтому A1) сведется к следующему выражению: 2 N . N iml 1ш1 E.3.12) Вводя разложение определителей Мк\ (ЛМ)-го порядка вновь по первому столбцу, получим < 2f>, . E.3.13) где MKij - минор GV-2)-ro порядка, получающийся из исходного определителя вычеркиванием первого и второго столбцов и двух строк с номерами / и у. Суммирование по у ведется по всем тем значениям, которые не равны /. Продолжая этот процесс далее, в конце концов придем к минорам первого порядка, каждый из которых есть интеграл < ^^[г^ > , равный единице. Число таких единиц будет равно числу всех возможных миноров первого порядка, которое без труда получается следующим образом: число миноров (ЛМ)-го порядка, а следовательно, и число членов в сумме A2) равно N (i = 1, 2,..., N); каждый из этих миноров дает 7V-1 миноров GV-2)-ro порядка, что приводит к числу членов в сумме A2), раЁному N(N-1); продолжение этого процесса увеличи- увеличивает это число в N-2 раз, далее в N-Ъ раз вплоть до множителя N-(N-\) = 1, так что полное число миноров первого порядка получается равным N(N-1)... 2Л - N\. Таким образом, A\(NX) = 1, т.е. Ак = (N\)~42 . Нормированные определители (^)}, E.3.14) составленные из ортонормированных спин-орбиталей tyKi9 обычно называют детерминантами Слэтера по имени выдающегося амери- американского теоретика Джона Слэтера1. Запишем теперь выражения 1 Слэтер Джон, один из создателей квантовой механики молекул и квантовой химии, работавший в США. Его именем названы однодетерминантные волновые функции, один из вариантов метода самосогласованного поля, атомные орбитали, используемые в качестве базисных при молекулярных расчетах и т.д. Хорошо известны его монографии, часть из них переведена на русский язык (см. стр.510). 259
для матричных элементов G) оператора АA). Этот оператор действует только на функции, зависящие от переменных первого электрона. Поэтому, разлагая определители Слэтера Ч?к и 4>L по первому столбцу, найдем: <K\h(l)\L> = jB^ Миноры MKi и MLj- суть определители (JV—1 )-го порядка, составлен- составленные из ортонормированных функций. Если MKi = MLj- или в крайнем случае отличается от него лишь порядком нумерации орбиталей, то интеграл < Мк\Мц > - (N -1)! (с точностью до множителя ±1). В противном случае этот интеграл равен нулю. В отличие же от того результата, который был использован при рассмотрении интеграла перекрывания, теперь уже нельзя утверждать, что интег- интеграл < ty &;|A(l)|ty ц > должен обращаться в нуль при \\)ю * \\)Lj. По- Поэтому возможны два случая, когда интеграл < K\h(Yj\L > не равен нулю: а) Ч*к = 4*L и тогда >; E.3.15а) б) Ч?к * 4*L, однако они различаются лишь одной орбиталью, например tyKi * tyLi (все же остальные орбитали в обоих определи- определителях одинаковы); при этом <4K\h(\)\4>L> = j<4Ki\hV)\yu>. E.3.156) Во всех остальных случаях матричный элемент < обращается в нуль. Для суммы одноэлектронных операторов У h(i) можно без труда установить, что для любого i <4K\h(i)\4>L >-<^|*(l)|VL >, E.3.16) так что при нахождении среднего значения оператора Гамильтона A) для всей системы электронов соответствующие матричные элементы вида A5а) и A56) должны быть просто умножены на число членов в этой сумме, т.е. на N. Для того, чтобы придти к соотношению A6), поступим следующим образом. Заменим в 260 i L интеграле < ^kI^KOI^l > переменные /-го электрона на перемен- переменные 1 -го электрона, а переменные 1 -го электрона - на переменные 1-го электрона. При такой замене переменных интеграл не изменит- изменится, оператор /r(i) перейдет в АA), а функция 4?L - в определитель вида Эта запись показывает, что функция 4*L отличается от 4?L лишь перестановкой двух столбцов: i- и 1-го. Из теории определителей хорошо известно, что такие два определителя отличаются друг от друга лишь множителем -1. Поэтому 4*L = - 4*L , Ч*к = - Ч*к , что и доказывает справедливость соотношения A6). Аналогичные рассуждения могут быть выполнены и для матричных элементов двухэлектронных операторов #A, 2). Не останавливаясь на них подробнее и оставляя их в качестве задач, окончательно можно выписать соотношения, которые называются правилами Слэтера для матричных элементов одно- и двухэлек- двухэлектронных операторов. Если обозначить через *рУ определитель Слэтера Ч1, в котором спин-орбиталь гр, заменена на спин-орбиталь г|л, а через Ч*.^ - определитель Слэтера Ч1, в котором гр, и грл заменены на г|ь и г^/, соответственно, то правила Слэтера будут иметь вид: а) для одноэлектронного оператора А = N E.3.17) и т.д. для определителей, отличающихся от Ч* заменой трех и более спин орбиталей; б) для двухэлектронного оператора В = ^ V g(i, j) 261
, 2I \\f = 0 и т.д. E.3.18) Во всех интегралах в правых частях соотношений A8) как слева, так и справа от символа оператора g(l, 2) на первом месте стоит функция, зависящая от переменных первого электрона, на втором - функция, зависящая от переменных второго электрона. Так например, в. Метод конфигурационного взаимодействия. Формулы, полученные в предыдущем пункте, можно непосред- непосредственно использовать в рамках вариационного подхода к опре- определению приближенной электронной волновой функции, если рассматривать конфигурационные функции состояния, а точнее - пока что однодетерминантные функции Ч*к как тот базис, который можно использовать в линейном вариационном методе. Действи- Действительно, если у нас имеется М функций Ч?к (К = 1, 2, ..., М), то пробную волновую функцию можно записать в виде м : E.3.19) с коэффициентами Ск, подлежащими определению из условия экстремума функционала энергии Е = <Ч*\Не\Ч*>г при сохранении нормировки функции Ч>: <Ч>|Ч>>,. = 1. Как было установлено в п. в § 1 гл. III, для определения коэффициентов Ск получается система линейных однородных уравнений м = 1,2,...,М), E.3.20) необходимым условием существования нетривиальных решений которой служит обращение в нуль векового определителя det{< VK\He\4?L > - ЕЬ^} = 0, E.3.21) или, что то же, удовлетворение величин Е вековому уравнению B1). В общем случае у векового уравнения имеется М корней, часть из которых может и совпадать друг с другом. Каждому корню Et отвечает свой набор коэффициентов Сю, определяющих, согласно A9), волновую функцию Ч>,. Величины Et можно располо- расположить в порядке возрастания и тогда каждая из этих величин будет оценкой сверху для соответствующего точного значения энергии 262 Е ? Еточн, а набор коэффициентов CKi (вектор-столбец С;) опреде- определит наилучшую по энергии волновую функцию /-го состояния в дан- данном базисе. Поскольку Ч*к и 4>L -однодетерминантные функции, состав- составленные из одноэлектронных спин-орбиталей, а оператор Не можно записать в виде Не = + \ то для нахождения матричных элементов Не в базисе функций Ч*к (К - 1,2, ..., М) можно воспользоваться формулами A7) и A8), т.е. правилами Слэтера для вычисления матричных элементов. Вся эта конструкция при некоторых дополнительных уточне- уточнениях носит название метода конфигурационного взаимодействия (англ. configuration interaction, сокращенно CI); она широко используется для решения электронного волнового уравнения. Что же касается этих уточнений, то они представлены ниже. г. Спиновая чистота. Однодетерминантные функции в общем случае не являются собственными для операторов спина V5- и Sz = ySzi . Однако точные электронные волно- волновые функции в обсуждаемом нами приближении таковыми являют- являются. Поэтому целесообразно с самого начала использовать такие базисные функции, которые собственны для 5^ и Sz. Если спин-орбитали выбраны в виде гр, = Ф,а или <p({$, где ф; зависит только от пространственных переменных л;, у9 z одного электрона (такие функции в квантовой химии называются орбита- лями), то определитель Ч*к будет собственной функцией оператора Sz. Действительно, функция Ч*к может быть написана следующим образом: где суммирование ведется по всем перестановкам индексов элек- электронов, а среди функций tyKi встречается п со спиновым множи- множителем а и N - п - со спиновым множителем р. При действии оператора Sz = V .Szi на функцию Ч*к он будет действовать на каждое слагаемое, а в каждом слагаемом - только на спиновой 263 L
сомножитель (оператор проекции спина Sz - линейный), так что, например, Следовательно, собственным значением оператора Sz на каждом слагаемом в разложении Ч?к будет одно и то же число Bп - N)/2, так что вся функция Ч?к будет собственной для Sz с тем же соб- собственным значением. Что же касается поведения волновой функции Ч*к при действии оператора S , то здесь положение оказывается более серьезным. Действительно, оператор 52 можно представить в более подробной записи так: 2 s = или, с учетом того, что sixsjx = N SiySjy следующим образом: S = E.3.22) i-l При переходе к этому равенству была учтена перестановочность спиновых операторов разных электронов, например si+Sj_ = s_si+. Возьмем из выражения B2) только члены, относящиеся к паре электронов i иу: S2(i,j) = S? +5;2 +5^5^+5^5^+25^^, E.3.23) и подействуем этим оператором на четыре функции: a(/)a(/), Р(ОР(/)> а@Р(/) и Р@«(/)? учитывая при этом правила действия одноэлектронных спиновых операторов на спин-функции аир: E.3.24а) S2(i, тогда как для смешанных произведений, включающих функции а и Р одновременно, будем иметь: 2 = a@P(/) + P@a(/)? E.3.246) = P@a(/) + P(/)a(O- Следовательно, первые две функции - собственные для S2 с собственным значением 1A + 1) = 2, тогда как две другие - нет. Поэтому при действии соответствующих слагаемых из S2 на сомно- сомножитель a(i)P(/) появляется дополнительно слагаемое с сомножите- сомножителем а(/)Р(/), т.е. слагаемое из другого детерминанта. И только если перед а(/)Р(/) стоит пространственная часть вида <p(/)<p(/), т.е. с одной и той же орбиталью и для а, и для р, то указанное второе слагаемое встретится в исходном определителе, и тогда можно будет надеяться, что этот определитель окажется собственным для S2. Отметим, что из формул B4) следует (см. также § 5 гл. II), что функция a(/)P(/) + P(i)a(/) - собственная для S2(i,j) с собствен-ным значением 1A + 1) = 2, тогда как функция a(i)P(/)- P(/)a(/) - собственная для этого оператора с собственным значе- значением, равным нулю. Чтобы иметь функции, собственные для оператора S2, можно ввести проекторы на эти функции. Как это делается, покажем на примере. Пусть функция Ч* есть линейная комбинация двух функций - Ч*{ и Ч*2, собственных для оператора S2 с собственными зна- значениями S{(S{ + 1) и ^(^ + 1): = clSl(Sl + Введем теперь новый оператор c2S2(S2 52 -S2(S2 +1) (при Si * S2 знаменатель отличен от нуля). Легко убедиться с по- помощью вышеприведенных выражений, что 264 т.е. оператор Рх проектирует функцию Ч* на функцию Ч*х. В общем случае можно точно так же убедиться, что оператор - 5, (St + 1) E.3.25) 265 L
проектирует на состояние, собственное для S2 с собственным значением SiO^i + 1), если произведение сомножителей берется по всем допустимым индексам /, отличным от 1. При таком проектировании в общем случае из исходного детерминанта появляется линейная комбинация с фиксированными коэффициентами. И вот эта-то линейная комбинация, собственная для операторов Sz и ?2, носит название конфигурационной функции состояния. Такие функции, собственные для операторов S2 и Sz, носят к тому же название функций, чистых по спину или, что то же, правильных по спину. При наличии у ядерной конфигурации молекулы точечной симметрии от конфигурационной функции сос- состояния обычно требуют также, чтобы она преобразовывалась по тому или иному неприводимому представлению точечной группы, т.е. была, как говорят, и правильной по симметрии. У многоатомных молекул очень часто основным является синглетное состояние, когда S— О (такое положение может встре- встретиться только при четном числе электронов). Если попытаться описать синглетное состояние однодетерминантной функцией, то оказывается, что это сделать можно при выполнении весьма прос- простого условия: каждая орбиталь должна входить в детерминант дважды: один раз со спин-функцией а и один - со спин-функцией р. Если у молекулы есть к тому же определенная пространствен- пространственная симметрия и орбитали преобразуются по неприводимым представлениям соответствующей точечной группы симметрии, то для вырожденных представлений (типа E,Fu т.п.) в определи- определитель должны входить все компоненты этого представления как с функцией а, так и с функцией р. В этих случаях говорят, что каждая орбиталь дважды (или двукратно) занята. Орбитали, преобразую- преобразующиеся друг в друга при операциях симметрии и представляющие собой тем самым базис какого-либо неприводимого представле- представления, образуют так называемую оболочку. Поэтому в однодетерми- нантном представлении волновой функции синглетного состояния все оболочки должны быть либо полностью заняты (другими сло- словами, полностью заполнены), либо полностью вакантны. Частично заполненных оболочек быть не должно. В этих случаях говорят также, что имеются лишь замкнутые оболочки. При наличии час- частично заполненных оболочек говорят об открытых оболочках. Доказательство утверждений предшествующего абзаца ба- базируется на использовании формул типа B2), B4) и B5). Проводить его не будем, отсылая читателя к более специальной литературе. 266 Отметим лишь, что замкнутые, т.е. полностью заполненные оболочки дают нулевой вклад в собственные значения S2 и Sz. Поэтому при выяснении того, является ли функция собственной для этих операторов и чему равно собственное значение, их можно не рассматривать. д. Электронная конфигурация. При заданном наборе орбиталей ф1? ф2,..., ф/ каждая однодетерминантная функция мо- может быть охарактеризована тем, какие орбитали из этого набора входят в детерминант и в каком числе (либо один раз с одной из спин-функций, либо два раза с той и другой спин-функциями). Другими словами, такой детерминант соответствует заданному множеству орбиталей из набора <р1э ф2,..., Ф/ с указанием их чисел заполнения. Задание совокупности занятых орбиталей и их чисел заполнения определяет, как уже говорилось, электронную конфигу- конфигурацию. Каждому детерминанту соответствует определенная элек- электронная конфигурация. Например, для четырех электронов можно построить определитель, отвечающий конфигурации (ф!J(ф2J> в обозначении которой верхние индексы представляют собой числа заполнения. В то же время конфигурации (ф!J(Ф2I(ФзI соответ- соответствует не один, а четыре детерминанта, поскольку как орбиталь Ф2, так и орбиталь ф3 может входить в детерминант либо с множи- множителем а, либо с множителем р. Из этих детерминантов (в виде линейных комбинаций) и строятся далее конфигурационные функ- функции состояния, чистые по спину. Термин "конфигурационное взаимодействие" (часто сокра- сокращаемый до KB) ведет свое начало именно от термина "электронная конфигурация", поскольку переход к учету конфигурационного взаимо- взаимодействия означает введение линейной комбинации конфигурационных функций состояния, соответствующих различным электронным конфи- конфигурациям. Получаемая при этом функция уже не отвечает какой-либо одной конфигурации. В связи с тем, что слово "взаимодействие" здесь не несет прямого физического смысла, не отображает какое-либо физическое взаимодействие частиц, оно, естественно, в данном упот- употреблении не вполне удачно. Тем не менее, к нему уже привыкли и по этой причине не меняют, хотя отдельные школы в квантовой химии (в частности, ленинградская) предпочитают говорить о "наложении конфигураций" либо о "суперпозиции конфигураций". е. Вычислительная процедура. В заключение параграфа кратко представим вычислительную процедуру метода конфигураци- конфигурационного взаимодействия, что позволит яснее понять его структуру. 267
1. На основе тех или иных соображений выбирается набор ортонормированных орбиталей <pl5 ф2,..., ф/9 из которых конструи- конструируется удвоенное число спин-орбиталей \^i (i= I, 2,..., 21). 2. Задаются все возможные электронные конфигурации в виде (q)j )* (ф2 )*2.. ,(ф;)'/, где ik = 0,1 или 2, причем /j + /2 + ... +i/ = N9 и для каждой из них проводится построение конфигурационных функций состояния *Р^, отвечающих определенной мультиплетнос- ти 2S + 1 и определенному квантовому числу проекции Sz, а также, если требуется, - определенному типу симметрии. 3. При фиксированной геометрической конфигурации ядер вычисляются матричные элементы < Ч^Я^Ч^ > электронного гамильтониана Не с использованием правил Слэтера A7) и A8), после чего записывается вековое уравнение B1) и находятся его корни, являющиеся оценками сверху для соответствующих соб- собственных значений электронного гамильтониана. 4. Для каждого корня Et решается система линейных одно- однородных уравнений B0), находятся коэффициенты CiK и, наконец, волновая функция Ч*(., с которой и проводятся все дальнейшие вы- вычисления, в частности вычисления средних физических величин, характеризующих исследуемую молекулярную систему при данной геометрической конфигурации ядер в данном состоянии. 5. Вычисления пп. 3 и 4 повторяются для других геометри- геометрических конфигураций ядер. Конечно, конкретная реализация вычислительной процеду- процедуры может быть иной. При этом, однако, основная суть построения конфигурационных функций состояния и использования линейного вариационного метода остается без изменений. Задачи L Вывести соотношения A8). 2. Пусть имеется молекула, содержащая 2N электронов и задан набор орбиталей <рь ср2, ... , ф/. Какое число электронных конфигураций отвечает этому набору? Сколько на базе данного набо- набора можно построить детерминантов Слэтера (и конфигурационных функций состояния), отвечающих собственному значению 5Z, равному нулю? Оценить получаемые величины при 2N= 10 и / = 8, 10 и 20. 3. С помощью проектора B5) построить конфигурационную функцию состояния для системы трех электронов, отвечающую электронной конфигурации (ф^ЧфгЖфзI и собственным значени- значениям: a)S = Sz= 1/2, 6M = 3/2, Sz = 1/2. 268 § 4. Метод валентных схем В предыдущем параграфе уже было отмечено, что метод конфигурационного взаимодействия характеризуется вполне определенным способом построения спиновой части конфигураци- конфигурационной функции состояния. Таких способов существует несколько, причем один из них возник на самом начальном этапе развития квантовой химии и по настоящее время используется при констру- конструировании пробных волновых функций многоэлектронных систем. По своим идеям он не менее интересен, чем метод конфигурацион- конфигурационного взаимодействия, а поэтому имеет смысл остановиться на нем несколько подробнее. а. Спиновые функции, собственные дляБ2 и St Конфигу- Конфигурационная функция состояния возникла из определителя Слэтера при применении спинового проектора E.3.25). Другой способ построения спиновой функции можно ввести следующим образом. Выше (в § 3) было отмечено, что замкнутой оболочке отвечают спиновые квантовые числа S и Sz9 равные нулю. Следовательно, поведение многоэлектронной функции по отношению к спиновым операторам в целом должно определяться лишь ее незамкнутыми оболочками. Та часть электронной конфигурации, которая относит- относится к замкнутым оболочкам, имеет вид при наличии симметрии в замкнутую оболочку входят все компо- компоненты базисных орбиталей вырожденных неприводимых представ- представлений. С учетом спиновых множителей в произведения, отвечаю- отвечающие детерминантам конфигурационной функции состояния, будут входить сомножители вида Для двух разных функций cpj и ф2 можно, как следует из результатов § 3, построить такой спиновой сомножитель, который в определенном смысле будет эквивалентен замкнутой оболочке: <Pi@<P2(/)[a@P(/) ~ P@a(/)L тогда как для двух одинаковых функций ф! = ф2 этот сомножитель возникает автоматически при антисймметризации произведения <Pi(/)<Pi(/)a(i)P(/). При действии на этот сомножитель оператора S\iJ) получается нуль (как, впро- впрочем, и при действии оператора szi + * •). Если имеется три электро- электрона, то функция [a(i)p(/) - P@a(/)la(*) является собственной для оператора 52{U j\ k) с собственным значением X w + Ц •> те* с 5 = 1/2, 269
что означает, по существу, нулевой вклад от скобки ар - Ра. Для системы из 4 электронов функция [аA)РB)- рA)аB)][аC)РD)- РC)аD)] вновь отвечает S - О, тогда как функция [а( 1) CB) - C( 1)аB)]аC)аD) соответствует 5=^ + ^ = 1, т.е. квантовое число S для нее определяется лишь сомножителем аC)аD). Такой анализ без труда может быть продолжен. При этом получается вполне определенный способ построения спиновых функций из скобок ар-Ра и функций аа... (либо PP...)- б. Диаграммы Румера. Введенные выше спиновые функции далее должны быть умножены на пространственные функции (орбитали), а полученное при этом произведение - антисимметризовано. Вот эти функции как раз и образуют базис, на основе которого линейным вариационным методом ищется приближенная волновая функция в методе валентных схем, или методе валентных связей (англ. valence bond). Название метода определяется тем, что базисные функции в нем допускают простое графическое представление, напоминающее в чем-то структурную формулу соединения. Поясним это представление сначала на прос- простом примере. Пусть у нас имеется 4 базисных орбитали: qpl5 ср2, фз и ф4 и четыре электрона. Поставим на окружности (или в вершинах правильного п-угольника) 4 точки, представляющие эти орбитали, и соединим чертой те точки, которые отвечают двум орбиталям, связанным спиновой скобкой ар - Ра. Если какая-либо орбиталь будет встречаться в произведении дважды (со спин-функцией а и со спин-функцией Р), то на диаграмме поставим ей в соответствие петлю •?) у данной точки на окружности. И, наконец, однократно занятой орбитали поставим в соответствие стрелку. Тогда для об- обсуждаемой задачи получим: 3 диаграммы вида iH E.4.1) 12 диаграмм вида E.4.2) 270 (и кроме этих двух еще 10 диаграмм с чертой, соединяющей точки 1-3, 1-4, 2-3, 2-4, 3-4); 6 диаграмм вида E.4.3) (и еще 5 диаграмм с двумя петлями у точек 1 иЗ, 1 и 4, 2 и 3, 2 и 4, 3 и 4). Все эти диаграммы будут отвечать функциям с S = 0 и Sz = 0. Каждая такая диаграмма называется валентной схемой, откуда и происходит название метода. Функции, отвечающие первым трем диаграммам, не явля- являются линейно независимыми. В качестве линейно независимых из них можно выбрать, например, те функции, для которых нет пересечений линий на валентной схеме (т.е. функции, отвечающие первым двум диаграммам в A)). Это утверждение было доказано известным советским ученым, начинавшим работать в Германии, Ю.Румером в 1932 г. и носит название теоремы Румера. Диа- Диаграммы вида отвечают уже несинглетным состояниям, и рассматривать их не будем. Для каждой диаграммы соответствующая функция строится весьма просто. Возьмем, например, первую диаграмму в B). Она показывает, что в четырехэлектронную функцию должны входить орбитали ф1 и ф2, связанные спиновой скобкой ар - Ра и дважды - орбиталь ф3: E-4-4) х[аA)рB)-рA)аB)]аC)рD)}, где сумма берется по всем перестановкам индексов электронов, а А - нормировочный множитель, зависящий от того, что собой представляют функции ф^. Происхождение названия "валентные схемы" связано со 271
¦ if.1 следующим. Первоначально в качестве функций ф, выбирались функции атомного, а точнее говоря - водородоподобного типа. Каждая спиновая скобка ар - Ра при этом объединяла две функции Ф, и фу, относящиеся к двум атомным центрам. Если эти два центра отстояли далеко друг от друга, то вклад в энергию от этих двух орбиталей был примерно таким же, как в изолированных атомах. Наибольший вклад, как правило, получался тогда, когда два центра были рядом. В этом случае прямая, соединяющая (на диаграмме) две функции двух соседних центров, формально совпадала с валентным штрихом в классической структурной формуле. Наибольший вклад в энергию получался, как правило, от тех диаграмм, которые при такой интерпретации совпадали или были похожими на классическую структурную формулу. Вот отсюда и началась терминология, которая столь характерна для этого метода: валентные схемы, валентные связи, сосуществующие (резонирующие) валентные структуры, т.е. те схемы, для которых отвечающие им функции Ч*к входили в линейную комбинацию метода Ритца с заметными весами (коэффициентами Ск либо их квадратами модуля) и т.п. Сегодня все уже отчетливо понимают, что сколько-нибудь прямого смысла функции отдельных валентных схем не имеют, поскольку они зависят от выбора и формы представления базисных функций, от их числа, от того, какие валентные схемы учитываются при построении полной функции и т.п. Тем не менее, общая терминология метода продолжает сохраняться, а поскольку она дает возможность к тому же использовать определенные мнемонические правила, то и приносит определенную пользу. Нам нет смысла останавливаться на этих вопросах детальнее, поскольку они носят более специальный и в известной степени исторический характер. в. Пример; молекула Нг. Рассмотрим, как будет полу- получаться в рамках метода валентных схем волновая функция для основного (синглетного) состояния молекулы водорода. Выберем сначала в качестве исходных функций ф, по одной 15-атомной ор- битали на каждом центре: ф1 = \sx и ф2 = \s2, где в правых частях индексы 1 и 2 относятся к центрам 1 и 2 соответственно. Для двух электронов и двух базисных функций диаграммы метода ва- валентных схем будут иметь вид: а отвечающие этим диаграммам функции будут такими: 1 1 и ш = Лш152A)Ь2B)[аA)рB)-рA)аB)]. E.4.5) Здесь А\, Аи и Am - нормировочные множители. Имеется и еще одна валентная схема 1 1 272 но она отвечает триплетному (возбужденному для данной молеку- молекулы) состоянию. Следовательно, в таком весьма простом базисе, включаю- включающем всего лишь две функции, в качестве пробной волновой функции линейного вариационного метода может быть взята функция Ч> = СМ + СПЧ>П + СШЧ>Ш E.4.6) с коэффициентами, определяемыми из условия экстремума функ- функционала энергии при нормированной волновой функции Ч*. В этой сумме первое слагаемое при больших межъядерных расстояниях R отвечает симметричному распределению электронной плотнос- плотности, когда один электрон находится у ядра 1, а другой - у ядра 2. (Точнее надо было бы сказать о том, что у ядра 1 сосредоточена электронная плотность, отвечающая одному электрону, и у ядра 2 - плотность, также отвечающая одному электрону). Второе (и аналогично, третье) слагаемое отвечает такому распределению заряда, когда у одного центра A или 2) сосредоточено два элек- электрона, а у другого - ни одного. Структура I по этой причине носит название ковалентной (от англ. covalent, идущего от лат. со - вместе, valens - являющийся сильным, имеющий силу), а структуры II и III - ионных. Соотношение весов, под которыми обычно подразу- подразумевают квадраты модулей соответствующих коэффициентов Сь меняется в зависимости от R. Так, вблизи равновесного расстоя- расстояния, т.е. расстояния, отвечающего минимуму на потенциальной кривой, основной вклад в функцию Ч*, как показывают численные расчеты, дает функция структуры I (Q = 0,940), хотя и при заметных (Сп = Сш = 0,241) вкладах структур II и III (цифры относятся к расчету с ls-функциями (€>3к)ше^г, причем для ?, как для варьируе- варьируемого параметра, взято оптимальное значение 1,193.)При R -*• оо для 273
основного состояния веса структур II и III стремятся к нулю и функция *Р по существу переходит в антисимметризованное произведение волновых функций двух изолированных атомов водорода. Если расширить базис еще двумя функциями - <р3 = 2pzX и Ф4 - 2pz2, где ось z совпадает с межъядерной осью, то число валентных схем резко возрастает за счет следующих (помимо вы- вышеуказанных): ковалентные структуры, ионные структуры, так что в итоге в общей сложности получается 4 ковалентные и 6 ионных структур. В качестве базисных можно взять, однако, не функции ф15 ф2, ф3 и ф4, а их линейные комбинации, например vf (l52 ~2P z2 E.4.7) и построить точно также, как и с функциями ф;, волновые функции Ч*А , отвечающие всем указанным валентным схемам. В совокуп- совокупности как функции Ч*?, так и функции х?к будут представлять два различных базиса одного и того же линейного пространства. Тем не менее, в оптимальную для основного состояния волновую функ- функцию, которая может быть найдена в этом пространстве, базисные функции Ц*к будут входить с другими коэффициентами, чем функ- функции Ч*?. Если к тому же использовать в расчетах функции не всех валентных схем, а только лишь некоторой их части, то и функции ФиФ, приближающие точную, получатся, вообще говоря, разными. 274 г. Историческая справка. Метод валентных схем был предложен при рассмотрении молекулы водорода английскими физиками Вальтером Гайтлером и Фрицем Лондоном A927). Он получил активное развитие в работах дважды лауреата Нобелевской премии Лайнуса Полинга1 и его сотрудников, в частности Дж. Уэланда (начало 30-х годов). Далее ряд принципиальных вопросов структуры метода был решен Р. Мак-Вини и А. Годдардом. Задачи 1. Найти числа ковалентных и ионных валентных схем для а) молекулы LiH, если в качестве базиса выбраны функции ) у , 2sLi, 2pzU и lsH.; б) молекулы ВО, если для каждого атома использован минимальный базис из Is, 2s и 2р функций. 2. Записать выражение для функционала энергии с функцией F), предварительно определив нормировочные множители Ak в выра- выражениях E). 1 ПолингЛайнус Карл A901-1997), американский ученый, крупнейший специалист в области квантовой механики и строения молекул, теории химической связи, иммунохимии, структуры белков и молекулярной генетики. Иностранный член Российской Академии наук, один из инициаторов Пагуошского движения ученых за мир. Часть его книг переведена на русский язык: "Природа химической связи" (М., Госхимиздат, 1947), "Общая химия" (М., Мир^ 1974) и др.
Глава VI Одноэлектронное приближение § 1. Метод самосогласованного поля При обсуждении методов конфигурационного взаимодействия и валентных схем основной акцент приходился на способ построения тех функций, линейной комбинацией которых аппроксимировалось точное решение электронного волнового уравнения. При этом орби- тали, из которых строились конфигурационные функции состояния либо функции отдельных валентных схем, были фиксированы. Можно, од- однако, поставить задачу нахождения и оптимальных орбиталей, а сле- следовательно, и тех одноэлектронных операторов Гамильтона, для ко- которых эти орбитали являются собственными. а. Одноконфигурационное приближение. Выберем сначала простейшую конструкцию для волновой функции Ч1, а именно, будем предполагать, что функция Ч1 представлена в виде одного детерми- детерминанта Слэтера из ортонормированных спин-орбиталей tyf. . F.1.1) Среднее значение электронного оператора Гамильтона на функции Ч* без труда можно записать, если воспользоваться правилами Слэтера для вычисления матричных элементов одно- и двухэлектронных операторов: Е=<Ч>\Не\Ч>> = ад j > - < ад F.1.2) где использованы, как и ранее, следующие обозначения для одноэлектроного оператора: 2 a R\a F.1.3) 276 и для двухэлектронных интегралов на спин-орбиталях фу: 1 Ф*О)Ф/B)>. F.1.4) Ограничение i * j в сумме с двухэлектронными интегралами ( j 1*Ф 1*"Ф j >~<"Ф11Фу1'Ф/Ф1* > можно снять, поскольку при i = j эта разность тождественно обращается в нуль. Согласно вариационному принципу, величина Е в соотноше- соотношении B) служит оценкой сверху для точной энергии основного состоя- состояния системы при любой функции Ч*. Сохраняя представление функции Ч* в виде детерминанта A), мы можем менять функции г|); и при этом среди всех возможных выбрать те, которые дают минимум функци- функционалу B). Эти изменения &% функций %, т.е. их вариации, должны производиться так, чтобы сохранялась нормировка и чтобы они ос- оставались взаимно ортогональными (в противном случае перестало бы быть справедливым выражение B), которое получается именно для ортонормированных спин-орбиталей). При поиске экстремумов функционала Е, значения которого зависят от выбора функций хр/ при дополнительных условиях их орто- нормированное™, как уже было сказано в § 1 гл. III, можно восполь- воспользоваться методом неопределенных множителей Лагранжа. Именно, отыскание условного экстремума Е эквивалентно поиску безуслов- безусловного экстремума функционала F.1.5) Ui где е;у— неопределенные множители Лагранжа. Если функции tyi - вещественные, то условия < *Ф 11"Ф; > = &ij и < "Ф у |"ф,- > - 6 -t совпада- совпадают, и тогда в E) можно оставить только независимые слагаемые, например c/s /. Если же функции ty;- комплексные, т.е. грк - ak+ibk, а функции щ и Ьк вещественные, то, как уже говорилось, указанные два условия эквивалентны двум независимым равенствам: и bt\a} = Ьц. Дадим теперь одной из функций, например typ приращение 5% и выпишем линейную по 6ty; часть приращения функционала /: FЛ.6) 277
где Z содержит все те члены, которые включают вариацию бгр, после вертикальной черты в символах интегралов. Перед суммой с двух- электронными интегралами фигурировавший в B) множитель 1/2 ис- исчез, поскольку при записи приращений этих интегралов возникают обязательно два следующих слагаемых: > и < так как индексы / и/ в сумме выражения B) пробегают все значения независимо, а эти слагаемые равны друг другу, что следует из неза- независимости интеграла от обозначения переменных. Действительно, если в интеграле < ^ j,A) bty t B)| ^} A) \\) i B) > обозначить перемен- переменные 2 через переменные 1, а переменные 1 — через переменные 2, то он не изменится: Последнее равенство выписано с учетом общепринятого соглаше- соглашения писать на первом месте переменные с индексом 1, на втором - с индексом 2. Это обстоятельство и приводит в конечном итоге к удвоению числа двухэлектронных интегралов при записи их вариа- вариации, т.е. линейной по 6% части приращения. Согласно основной лемме вариационного исчисления при не- независимой вариации 6% одной лишь функции ty, необходимое условие экстремума функционала б// = 0 означает равенство нулю того выра- выражения, на которое под интегралом умножается бг^,{1). Прежде чем, однако, выписать это требование, отметим, что при вещественных функциях гр, и вещественных вариациях бгр, приращение Z совпадает со всем тем, что выписано в правой части F) перед Z, а при комплекс- комплексных функциях \\>; и комплексных вариациях 6г|>/ Z почти полностью совпадает с выражением, комплексно сопряженным выписанному в правой части F) в явном виде: различаются лишь те члены, которые содержат неопределенные множители Лагранжа, за счет того, что в Z входят 6.., а не е*. Однако это различие на самом деле несущест- несущественно, поскольку из уравнений, определяющих функции г^, далее следует, что е* = еу/ . И поскольку для комплексных функций вариации ЬЦ). и Si|j* независимы, то окончательно приходим к уравнению, следующему из необходимого условия экстремума 278 функционала / и отвечающему равенству нулю коэффициента перед вариацией 6г|> *: Г-Ll J dx2x\)A\) Г12 F.1.7) Для коэффициента перед вариацией 6г|>, получается такое же уравнение, но комплексно сопряженное уравнению G), откуда и следует вышеприведенное равенство для неопределенных множителей Лагранжа. Аналогичные уравнения получаются и при рассмотрении других независимых вариаций 6vp *, так что для всех i — 1, 2,..., N получится система уравнений вида G). Поскольку е.. = е .., то матрица, составленная из неопределенных множителей Лагранжа, эрмитова. Прежде чем обсуждать полученные уравнения, вспомним, что в функции Ч7, представленной в виде определителя х\>2B) строки можно складывать друг с другом с некоторыми коэффициен- коэффициентами, т.е. можно переходить к функциям xj) Д1) = ^kCjk\\)кA), не меняя самого определителя *Р, если коэффициенты с .к образуют, например, ортогональную матрицу. Действительно, при этом det detC m m = ±4>, если матрица С, составленная из коэффициентов с , ортогональна. JK 279
Щ '¦it- (Вместо ортогонального можно рассмотреть унитарное преобразо- преобразование, определитель которого по модулю равен 1). Если коэффициенты с образуют ортогональную либо уни- унитарную матрицу, то функции ty . можно без труда выразить через ф , поскольку в этом случае С г = Cf, так что . F.1.8) к Подставим теперь это выражение для \р . и аналогичное—для . в уравнение G), умножим полученное соотношение на cni и просум- просуммируем по /. После всех этих операций получится следующее уравнение: Г12 '12 (n = 1,2,... , F.1.9) к ij И вот теперь, по-видимому, становится ясным, ради чего было затеяно это преобразование функций: коль скоро матрица коэффициентов е,у- эрмитова, то всегда найдется такое ортогональное (унитарное) преобразование С, которое сводит эту матрицу к диагональному виду: Следовательно, волновая функция *Р в виде A) всегда может быть построена из таких функций гр„ (здесь и далее черту над этими спин-орбиталями опускаем), которые удовлетворяют уравнениям вида G) или (9) с диагональной матрицей неопределенных множителей Лагранжа. б. Уравнения Хартри-Фока. Уравнения типа (9) были по- получены следующим образом: сначала рассматривалось необходимое условие экстремума функционала / при вариации всего лишь одной функции гр,, что привело к уравнению G). Далее было отмечено, что при вариациях других функций получаются аналогичные уравнения и что функции гр, допускают в однодетерминантном представлении Ч* унитарное преобразование, так что на самом деле можно совершенно аналогично записать функционал энергии на функциях tyn, на которых матрица г с элементами е,-,- — диагональна (мы еще не знаем эти функции, но воспользоваться тем, что матрица г диагональна, уже можем). Таким образом, мы пришли к системе 7V уравнений вида 280 F.1.10) где для краткости введены следующие обозначения F.1.11) F.1.12) r12 Уравнения A0) называются уравнениями Хартри-Фока по имени предложивших их английского физика Д.Р.Хартри и советского физика В.А.Фока, работавшего в Ленинградском университете и ос- основавшего ленинградскую школу квантовой химии. Д.Хартри, по существу, предложил сначала (на основании интуитивных соображе- соображений) уравнения без учета антисимметричности волновой функции си- системы электронов, т.е. для волновой функции Ч*, записанной в виде простого произведения: FЛЛЗ) В. А. Фоку принадлежит вариационная формулировка проблемы с учетом антисимметричности волновой функции. Практически одно- одновременно с Фоком уравнения Хартри - Фока были получены Дж. Слэтером, однако его имя в название этих уравнений не включается, поскольку под уравнениями Хартри - Фока - Слэтера подразумева- подразумевается еще одна конструкция системы уравнений для определения ор- биталей. Фигурирующий в уравнениях Хартри-Фока оператор //A), как следует из соотношения A1), допускает простую интерпретацию: это кулоновский потенциал, создаваемый в точке нахождения первого электрона распределенным в пространстве зарядом второго элект- электрона, причем плотность этого распределения задается квадратом модуля спин-орбитали гр/: р1 B) = гр t B) гр/B). По этой причине опе- операторы J и У^1 называют кулоновскими (орбитальным и полным, соответственно). Оператор у Jl определяеттокулоновскоеполе, которое действует на электрон 1 в каждой точке пространства со стороны всех остальных электронов системы, тогда как плотность распределения этого электрона определяется спин-орбиталью гр,. Второй же оператор, т.е. К^ 1), имеет более сложный характер: при действии на функцию гр,{1) он переводит ее в функцию гр/A) с 281
множителем, также имеющим смысл некоторого потенциала. Однако, если потенциал //A) всюду положителен (неотрицателен), то для потенциала, определяемого оператором К^\\ этого уже сказать нельзя, поскольку его действие сводится не только к умножению на некоторый интеграл, о знаке которого в общем случае сказать ниче- ничего нельзя, но и к замене функции г|),< 1) на функцию Г12 Слагаемое с оператором ^/ Kt A) полностью определяется тем, что пробная волновая функция Ч* должна быть антисимметрична относительно перестановок ("обмена") индексов электронов. Поэтому операторы ХД1) и у\1(Г/A) носят название обменных операторов. Если бы для функции Ч* было использовано представление A3) в виде простого произведения, то члены с Kt A) в уравнениях отсутствовали бы. Кроме того, в ^/// для каждой функции гр, нужно было бы опустить оператор /,, поскольку он был введен, если вспомнить замечание после формулы B), на основании того, что (J,-*,>,¦(!)-0. F.1.14) Оператор F(l) = ЛA) + V .(J . - Kj) имеет смысл одноэлек- тронного оператора Гамильтона (хотя и зависящего от системы ор- биталей для каждой задачи) и по аналогии часто называется операто- оператором Фока, или фокианом. Традиционный способ решения нелинейных интегродифферен- циальных уравнений Хартри-Фока заключается в простой итерации: выбираются некоторые начальные спин-орбитали г|к ? с которыми (о) (о) * находятся операторы J w и К , после чего решается система харт- ри-фоковских уравнений, в результате появляются функции xjj. сле- следующего шага итераций. Как правило, такой процесс сходится, хотя нередки случаи, когда сходимости достичь не удается, что приводит к необходимости применять специальные методы принудительной сходимости. В конечном итоге при такой итерационной процедуре на некотором шаге получаются функции, которые при использовании их в кулоновском и обменном операторах вновь приводят в качестве решений к тем же функциям (в пределах заданной точности). При достижении подобной ситуации говорят о том, что поле, создаваемое 282 электронами, и орбитальные распределения этих электронов согла- согласованы, другими словами, это поле является самосогласованным. Поэтому метод Хартри-Фока часто называют методом самосо- самосогласованного поля (ССП; англ. self-consistent field, SCF). в. Разновидности метода и терминология. Полученные выше уравнения Хартри-Фока A0) записаны для спин-орбиталей. Однако в § 3 было сказано, что, как правило, бывает желательным использовать пробные функции, собственные для операторов сим- симметрии. Выше было отмечено, что требование к однодетерминантной функции быть собственной для операторов спина является достаточно жестким. Оно приводит, в частности, при условии S = 0 к тому, что все оболочки, встречающиеся в выражении для W, должны быть обя- обязательно полностью заполненными. При этом каждая орбиталь ф; встречается в детерминанте дважды: со спин-функцией а и со спин- функцией р. Коль скоро в уравнениях Хартри-Фока операторы не за- зависят от спиновых индексов, или от спиновых переменных (по край- крайней мере в том приближении, в котором мы пока работаем), то по этим переменным можно провести интегрирование и исключить их из уравнений. Выполнение этой процедуры приводит к системе урав- уравнений Хартри-Фока для орбиталей фД/ =1,2,..., 7V/2; JV- четно): N12 F.1.15) причем операторы Jk и Kk определены теперь уже на орбиталях ф^, a не на спин-орбиталях. Уравнения A5) справедливы только для атом- атомных и молекулярных систем с замкнутыми оболочками. Они носят название уравнений ограниченного метода Хартри-Фока (метод ОХФ, англ. restricted Hartree-Fock theory, RHF). Подобного же типа конструкция может быть получена и тогда, когда имеется подсистема замкнутых оболочек и, кроме того, под- подсистема k наполовину заполненных оболочек, которым отвечают спин-орбитали с одной и той же спиновой функцией, например а. Можно показать, что такая функция также является собственной для S2 и Sz с собственными значениями (k/2)[(k/2) + 1] и к/2. В этом случае так- также без особого труда можно получить хартри-фоковские уравнения типа A5) для замкнутых оболочек и уравнения для открытых (полу- (полузаполненных) оболочек. Эти уравнения тоже относятся к числу урав- 283
нений ограниченного метода ССП (при наличии открытых оболочек). В других случаях конструкция уравнений оказывается более сложной. Нет смысла их подробно разбирать здесь. Остановимся лишь на используемых названиях. Если, как это и было в первоначаль- первоначальном нашем изложении, ограничений по спину не вводится, то получа- получаемый метод называется неограниченным методом Хартри-Фока (НХФ, англ. unrestricted Hartree-Fock theory, UHF), или, что то же, методом разных орбиталей для разных спинов (РОРС, англ. different orbitalsfor different spins, DODS). В этом методе в полной аналогии с тем, что делается в ограниченном методе, можно исключить спи- спиновые переменные и получить уравнения ССП для орбиталей. Одна- Однако уравнения для орбиталей, входящих в волновую функцию Ч* со спин- функцией а, будут отличны от таковых для орбиталей со спин-функ- спин-функцией C, так же как будут различны в общем случае и их решения, что и определяет название подхода (РОРС). Если однодетерминантную волновую функцию V спроекти- спроектировать на подпространство собственных для S2 и Sz функций (см. § 3 гл. V) до построения уравнений, а потом уже искать орбитали, то получится спин-спроектированный метод Хартри-Фока (англ. spin- projected). И наконец, если отказаться от одноконфигурационного при- приближения, написать пробную волновую функцию так, как это делается в методе конфигурационного взаимодействия, но дать при этом воз- возможность орбиталям, входящим в конфигурационные функции состо- состояния, меняться (варьировать) свободно и независимо (кроме условий ортонормировки либо даже просто нормировки), то получится много- многоконфигурационный метод самосогласованного поля (МК ССП, англ. multiconfigurational self-consistent field, MC SCF). Этот подход по- позволяет оптимальным образом выбрать орбитали в методе конфигу- конфигурационного взаимодействия, а потому в существенной степени умень- уменьшить число используемых конфигурационных функций состояния. Следовательно, он является не столь экстенсивным, как метод кон- конфигурационного взаимодействия, а с другой стороны, он позволяет эффективно выйти за рамки одноэлектронного приближения. г. Энергия и электронная плотность. Под одноэлек- тронным приближением подразумевается такое приближение, в котором волновая функция представляет собой функцию, собственную для суммы одноэлеюронных операторов, например в методе Хартри- Фока- для суммы фокианов, относящихся к отдельным электронам. Так, в неограниченном методе Хартри-Фока волновая функция 284 является собственной для электронного оператора Гамильтона ХФ е N N i=X а F.1.16) с собственным значением N N N N F-1.17) Интересно сравнить это выражение с тем, что было получено для функционала энергии B), как среднего значения оператора Га- Гамильтона Не на однодетерминантной функции W: эти два выражения не совпадают, т.е. Е * Е , так что ХФ F.1.18) где для краткости записи введено общепринятое сокращение Коль скоро ЕХФ представляет собой сумму собственных зна- значений By фокиана F, называемых часто орбитальными энергиями, то из сказанного следует, что сумма орбитальных энергий не имеет смысла полной энергии системы, т.е. придавать орбитальным энер- энергиям какой-либо физический смысл величин, составляющих энергию системы в хартри-фоковском приближении, нельзя. Отметим еще одно весьма полезное соотношение, справед- справедливое только в рамках одноэлектронного приближения. Для много- многоэлектронной системы электронная плотность определяется соотноше- соотношением Г,F.1.19) где W(r, ах; 2,3, N) - волновая функция, в которой переменные перво- 285
го электрона заменены на переменные г произвольной точки обыч- обычного трехмерного пространства с учетом интегрирования по соот- соответствующей спиновой переменной а1? которая отвечала первому электрону. Множитель N перед интегралом учитывает то обстоятель- обстоятельство, что электронная плотность создается всеми N электронами системы, а волновая функция Ч? антисимметрична относительно пе- перестановки индексов электронов, в силу чего интеграл от функции 4*(l; г, а2; 3,..., N)\ равен по величине выписанному в A9) интегра- интегралу. Общее же число таких интегралов будет равно как раз N. Если функция Ч* представляет собой определитель Слэтера, то, разлагая и определитель Ч*, и определитель Ч* по первому столбцу, получим N , 3, ...9N)MjB939 ...,N)do1ck2...chN, где MjUMj - миноры, получаемые вычеркиванием из исходного оп- определителя первого столбца и /- илиу-й строки соответственно. Как следует из правил Слэтера, Поэтому для р(г) можно сразу же написать N , F.1.20) где функции ф, в последней сумме повторяются не более двух раз, если в исходном определителе Слэтера встречаются двукратно занятые орбитали. Таким образом, в одноэлектронном приближении электронная плотность есть сумма плотностей, каждая из которых определяется соответствующей одноэлектронной функцией, т.е. орбиталью. Плот- Плотность распределения отрицательного заряда в молекуле отличается от B0) лишь знаком, поскольку в используемой нами атомной системе единиц заряд каждого электрона равен -1. д. Немного о физическом смысле. Приближение Хартри- Фока, как показывают полученные уравнения, сводится к аппрокси- аппроксимации точного электронного гамильтониана Нсуммой одноэлектрон- одноэлектронных операторов носящих название операторов Фока, или фокианов; Я N a F.1.21) 286 где операторы Vt{i) определяются тем средним электростатическим полем, которое действует на каждый электрон / со стороны всех ос- остальных электронов системы. Эти операторы в разных приближени- приближениях могут быть разными, и метод Хартри-Фока, по существу, предла- предлагает (независимо от его варианта) конкретную пропись построения таких операторов VfJ). Точная физическая задача об атоме или молекуле моделируется при этом набором одноэлектронных задач, задач о квантовохимическом поведении электрона в поле ядер и не- некотором дополнительном поле, обусловленном наличием других элек- электронов. Это дополнительное поле может быть самосогласованным, т.е. меняться при изменении состояния электрона, находящегося в этом поле, либо не быть таковым, а задаваться какими-либо дополни- дополнительными, "внешними" условиями. Если оно, в частности, будет самосогласованным в том смысле, который только и обсуждался выше, то получится приближение Хартри-Фока. При других спосо- способах его задания возможно появление множества других приближе- приближений, о которых мы лишь упоминаем для того, чтобы подчеркнуть многообразие одноэлектронных подходов. Для многоатомных моле- молекул эти подходы сегодня являются доминирующими, что в конечном итоге связано даже не столь с относительной простотой вычисли- вычислительных процедур для нахождения волновых функций и средних зна- значений физических величин, сколь с весьма высокой наглядностью одноэлектронной картины и пригодностью ее во многих задачах, на- например задачах первоначального определения равновесной структу- структуры молекул в основном состоянии. Одноэлектронное приближение к тому же подчас становится достаточно точным при увеличении числа атомов в молекуле, когда конфигурация всей молекулы становится все в большей степени пред- ставима в виде отдельных, относительно хорошо локализованных структурных фрагментов. Одноэлектронное приближение часто ока- оказывается достаточно продуктивным и для других задач, в которых поведение отдельных электронов слабо зависит от конкретного рас- распределения других электронов. Например, в сильно возбужденных состояниях возможны такие ситуации, когда один электрон распре- распределен в пространстве достаточно далеко от ядра атома или ядер молекулы, и его поведение определяется лишь средним полем остальных электронов (это так называемые ридберговы состояния атомов и молекул, аналогичные возбужденным состояниям атома водорода с достаточно большим главным квантовым числом, скажем п аЗ). Второй возможный случай - когда атом или молекула находят- находятся в сильном электромагнитном поле, напряженность которого такова, 287
что взаимодействия электронов с полем и между собой становятся сравнимыми по величине, либо поле даже превалирует по своему влиянию. При этом внешнее поле может меняться во времени, что приводит к необходимости использовать приближение Хартри-Фока для решения временного уравнения Шредингера, т.е. к необходимос- необходимости построения временного метода Хартри-Фока. § 2. Метод самосогласованного поля. Прикладные проблемы Метод Хартри-Фока для атомных и молекулярных систем позволяет определить совокупность орбиталей (или спин-орбиталей), из которых строится многоэлектронная волновая функция. Эти же ор- орбитали могут служить тем базисом, из которого возможно создавать конфигурационные функции состояния, используемые в методе кон- конфигурационного взаимодействия. Поэтому целесообразно продолжить анализ того, что может дать хартри-фоковское приближение. а. Вводные замечания. Орбитали, получаемые при решении обычных уравнений Хартри-Фока, как правило, называют каноничес- каноническими. Эти орбитали в каждом из вариантов приближения ССП опре- определяются, вообще говоря, однозначно. В то же время, как уже было сказано в предыдущем параграфе, орбитали, входящие в детерминант Слэтера или в одноконфигурационную функцию состояния, можно линейно преобразовать друг через друга, и если такое преобразова- преобразование унитарно или ортогонально, детерминант будет оставаться неиз- неизменным с точностью до некоторого множителя, по модулю равного единице (как уже не раз говорилось, в квантовой механике все волно- волновые функции определены с точностью до произвольного числового множителя). Следовательно, отдельные орбитали, называемые атомными для атомов и молекулярными для молекул, не инвариантны относительно таких преобразований, тогда как полная волновая функция инвариантна. Это означает, что сами по себе отдельные молекулярные орбитали прямого физического смысла не имеют. Тем не менее, физи- физический смысл у орбиталей подчас может просматриваться в некоторых задачах, когда, например, изменение волновой функции при переходе от одного состояния к другому по преимуществу оказывается связанным с изменением всего лишь одной орбитали атома или молекулы. 288 б. Теорема Купманса. Приведем один пример подобного типа задач. Пусть мы нашли решение, например в рамках неограниченно- неограниченного метода Хартри-Фока, для основного состояния молекулы при не- некоторой фиксированной конфигурации ядер. Другими словами, мы нашли N спин-орбиталей, из которых должна быть построена волно- волновая функция молекулы. Попробуем использовать эти орбитали для построения конфигурационных функций состояния катиона этой мо- молекулы при той же геометрической конфигурации (как говорят, при той же геометрии) ядер, что и у неионизованной молекулы. Таким образом, рассматривается переход М —* М+ + е~, причем предпола- предполагается, что система орбиталей для М известна, а расположение ядер при ионизации не меняется. Подобные процессы без изменения гео- геометрической конфигурации ядер обычно называют вертикальными. Из N спин-орбиталей можно построить N определителей Слэтера (N-Л )-го порядка, каждый из них содержит все спин-орбитали, кроме одной, так что определитель 4fi не содержит орбитали с индексом /. Из полученных N определителей составим линейную комбинацию и найдем коэффициенты с, линейным вариационным методом. Коль скоро функции x?i взаимно ортогональны по построению (они состав- составлены из набора ортогональных и нормированных спин-орбиталей), то метод Ритца приводит к системе линейных однородных уравнений вида I1?. F.2.2) > определяются без Матричные элементы < труда, поскольку они записаны на определителях Слэтера и отлича- отличаются друг от друга тем, что в одном из них (вФ/) присутствуют спин-орбитали \\>х , ife—» 'Фм > %n >•••> У>ы , а в другом QPJ) - \\>х , ••• > ity-i 9 4>j+\ V) ^n • По отношению к W, определитель Wy при j является (с точностью до порядка расположения строк) таким, в котором строка tyj заменена на строку гр„ т.е. эти два определителя отличаются друг от друга одной функцией. Согласно правилам Слэтера, 2 k(k*i,j) 10 — 1395 289
где символ (±) слева показывает, что матричный элемент может от- отличаться от правой части знаком за счет перестановок строк в Ч* относительно Ч*,, в сумме же, стоящей справа, ограничение к * i9j можно снять, ибо при к = i (как и при к =j) стоящее в квадратных скобках выражение обращается в нуль. Поэтому 2 и коль скоро справа в матричном элементе в качестве оператора сто- стоит фокиан F - h + ^kml{jk " Кк )' Д™ которого гр, - функция собст- собственная с собственным значением th а к тому же <ф/|г|>у> = 0 при /' *j\ то все недиагональные матричные элементы < W.|H |W. > в урав- уравнениях B) обращаются в нуль. Что же касается диагональных элементов, то для них получа- получаем соотношение, аналогичное приведенному выше (на основе опять- таки правил Слэтера): Л-0 ] -г(. F.2.3) Таким образом, диагональный матричный элемент гамильто- гамильтониана < W.|HjW. > равен энергии молекулы Е за вычетом орби- орбитальной энергии е,, а все недиагональные элементы, как уже было сказано, равны нулю. Как следует из уравнений B), в выбранном базисе электронные состояния иона описываются однодетерминант- ными функциями Ч*,, составленными из тех же спин-орбиталей, которые были получены для молекулы, а энергия /-го состояния катиона Ei отличается от энергии молекулы Е на величину соответствующей орбитальной энергии, взятой с обратным знаком: Е.-Е = -г.. Эта разность, как известно, называется вертикаль- вертикальным потенциалом ионизации /л В итоге мы получили так называемую теорему Купманса (введенную Т. Купмансом в 1933 г.): в приближении Хартри-Фока потенциал ионизации равен взятой с обратным знаком орбитальной энергии ионизируемой молекулы. 290 Теорема Купманса свидетельствует о том, что канонические хартри-фоковские молекулярные орбитали могут служить в качестве тех элементов, которые не меняются в определенном приближении при переходе от молекулы к ее катиону. В зависимости от орбитальной энергии канонической орбитали получается целый спектр потенциа- потенциалов ионизации, зарегистрировать которые можно с помощью фото- фотоэлектронной (при /^ 30 эВ) и рентгеноэлектронной спектроскопии (при / - 200 - 500 эВ). При этом теорема Купманса, не учитывающая многие эффекты, в частности орбитальные различия молекулы и ка- катиона (так называемую орбитальную релаксацию), специфику межэ- межэлектронного взаимодействия (электронную корреляцию) и др., дает обычно точность порядка 1 - 2 эВ в фотоэлектронной области и по- порядка 1 - 5 эВ в рентгеноэлектронной области. При использовании теоремы Купманса обычно опираются либо на ограниченный метод Хартри-Фока, либо на рассмотренный выше неограниченный его вариант. В остальных случаях, когда имеются как полностью заполненные (замкнутые), так и частично заполненные (открытые) оболочки, возможны некоторые осложнения, на которых мы останавливаться не будем, но которые могут приводить и к более значительным ошибкам, чем те, которые указаны выше. В заключение этого пункта отметим, что величины е, < 0 от- отвечают положительным потенциалам ионизации, т.е. тому, что молекула по энергии лежит ниже, чем катион, либо что анион стабиль- стабильнее нейтральной молекулы (если в качестве М в вышеприведенных рассуждениях использован анион). *. Общие свойства орбиталей. Орбитали, получаемые при решении хартри-фоковских уравнений, обладают рядом свойств, общих как для атомных, так и для молекулярных систем. Прежде всего следует заметить, что вблизи любого из ядер, например ядра а, уравнение для каждой орбитали в качестве доминирующего члена в потенциале будет содержать лишь -Za/Rla . Если перейти к сферическим координатам с началом на ядре а, то одноэлектронные уравнения приобретают для радиальной переменной (см. задачу об атоме водорода) следующий вид: d2R + — dr dr r \ иг / г где R = R(r) - радиальная функция, г = /?1а - расстояние от электрона до ядра a, V(r) - потенциал всех остальных ядер и среднего поля ш* 291 L
(остальных) электронов. При г —* О наибольшими членами в этом уравнении становятся: при / * О - центробежный член /(/ + I)//*2; при / = 0 - член с множителем г. Если при рассмотрении поведения волновой функции требовать, чтобы она была непрерывна и конечна, так чтобы существовала ее первая производная, то необходимо, что- чтобы для / * О функция R —» О при г —* О (что на самом деле и обеспе- обеспечивается в радиальной волновой функции множителем г1), тогда как при / = О должен стремиться к нулю множитель перед г: — +Zai?@) = 0. F.2.3) Это так называемое условие каспа (касповое условие, или условие заострения) для одноэлектронной волновой функции, ведущей себя как водородоподобная волновая функция s-типа вблизи ядра (будь то в атоме или в молекуле). Название "касп" отвечает буквальной транскрипции английского слова cusp, обозначающего в геометрии ту точку, где пересекаются под некоторым углом, не равным л, две кривые. С другой стороны, важно установить поведение орбиталей на больших расстояниях от ядра или системы ядер молекулы. При этом потенциал в фокиане будет складываться из кулоновского потенциала взаимодействия данного электрона с ядрами и из потенциала взаи- взаимодействия с остальными N- 1 электронами, локализованными где- то вблизи ядер в том пространстве, которое хоть и часто, но условно принято называть объемом молекулы. Следовательно, при г -» о© для данного электрона его поведение будет определяться прежде всего суммарным зарядом оставшейся части молекулы (так называемого молекулярного остова), а также в меньшей степени - дипольным моментом и более высокими электрическими моментами остова при выборе начала системы координат, например, в центре заряда осто- остова. Поэтому поведение одноэлектронной волновой функции при г -* оо должно также быть похожим на поведение водородоподобной функции, т.е. представлять собой некоторый полином (из которого при г -*• оо существен только старший член), умноженный на экспоненту е~&9 где параметр ? должен стремиться к Zfn, причем Z- заряд осто- остова, а п - целое число, имеющее смысл главного квантового числа. Для водородоподобного атома величина In = Z2/2n2 представляет со- собой (с точностью до множителя, связанного с приведенной массой и примерно равного единице) потенциал ионизации с уровня, отвечаю- 292 щего главному квантовому числу п. Таким образом, асимптотически молекулярные орбитали при г -» оо должны вести себя следующим образом: Приведенные рассуждения отчетливо показывают, что по своему общему поведению молекулярные орбитали при очень малых и очень больших г должны быть похожи на атомные, так что имеет смысл аппроксимировать их линейной комбинацией атомных орбиталей (ЛКАО), что и было широко использовано в квантовой химии с самых ранних этапов ее развития. г. Приближение ЛКАО. В приближении ЛКАО каждая мо- молекулярная орбиталь записывается в виде линейной комбинации не- некоторого числа Л/заданных по тем или иным правилам базисных фун- функций, обычно имеющих вид атомных орбиталей F-2-5) если начало системы координат для каждой орбитали х^, / т выбрано на соответствующем ядре а, с которым ассоциирована эта функция. Совокупность всех индексов, определяющих х> будем далее зада- задавать одним индексом v: xv (v e Ь 2,..., М). Для молекулярной орби- орбитали (сокращенно МО) ср, будем иметь V и в одноэлектронном приближении вместо определения МО, имею- имеющих подчас достаточно сложную структуру, оказывается необходи- необходимым найти всего лишь систему коэффициентов с^, задающих все орбитали одноконфигурационной функции исследуемого электронно- электронного состояния молекулы. Базисные функции xv по своим угловым частям У/ т(Ф, ср) имеют обычный характер, т.е. такой же, как у водородоподобных функций. В то же время при выборе радиальных частей xv наблюдается весьма большое разнообразие. Так, если с точностью до нормировочного множителя v F.2.7) т.е. если по своей радиальной части^функции xv похожи на функции D), но с варьируемым параметром t^9 то такие функции называются слэтеровскими (или слейтеровскими). При этом А:- некоторое число, 293 L
выбираемое по определенным правилам. Соответствующий базис называется базисом орбиталей слэтеровского типа (ОСТ, англ. Slater type orbital, STO). Параметры t^ иногда подбираются из условия оптимальности по энергии, однако чаще всего они бывают фиксиро- фиксированы. В 1930 г. Дж.Слэтер предложил специальные правила для опре- определения параметров t^ и к, которыми долгое время пользовались практически все исследователи, однако сейчас в большинстве слу- случаев выбирают те или иные табличные системы параметров. Слэте- ровские функции оказались неудобными для расчета ряда интегра- интегралов от произведений этих функций, прежде всего в тех случаях, когда они центрированы на разных центрах. Поэтому на сегодняшний день слейтеровский базис обычно используют лишь для двухатомных и линейных (по расположению ядер) многоатомных молекул. Более удобным для расчетов оказался так называемый гауссов базис (базис орбиталей гауссова типа, базис ОГТ, от англ. Gaussian type orbitals, GTO), в котором радиальная часть задается в виде Rv =rKe~^r\ F.2.8) Полностью в декартовых координатах эти функции записываются как F.2.9) (декартовы гауссовы орбитали). В таком базисе поведение функций и при г —> О, и при г -» оо не совпадает с тем, которое должно было бы получаться асимптотически. Хотя, конечно, нужно заметить, что и у орбиталей слэтеровского типа правильной картины также не на- наблюдается: параметры ?v не совпадают с соответствующими потен- потенциалами ионизации, касповые условия C) не выполняются, так как используется линейная комбинация базисных орбиталей и в области расположения каждого ядра возникает наложение составляющих, отвечающих всем функциям такой линейной комбинации, и т.п. Тем не менее, слэтеровские функции все-таки ближе к точным функциям по своему поведению при г —> оо и при г —» 0. Для того, чтобы улучшить аппроксимацию молекулярных ор- орбиталей, часто используют базис, в котором радиальные части пред- представляют собой сумму двух или трех слагаемых с экспоненциальными множителями, например: Такие базисы называют двухэкспонентными (или соответственно 294 трехэкспонентными), а иногда, к сожалению, пользуются и таким бук- буквальным (и жаргонным) заимствованием из английского языка, как "дабл-дзета" и "трипл-дзета" базисы. Коэффициенты в этих суммах обычно определяют из условия наилучшего приближения получен- полученных численым путем хартри-фоковских атомных орбиталей либо из аналогичных условий. Для гауссовых функций очень часто используют и такой прием: линейной комбинацией п гауссовых функций аппроксимируют слэ- слэтеровские функции с оптимизированными параметрами. Такие линей- линейные комбинации с постоянными коэффициентами называют обычно сгруппированными гауссовыми функциями и используют для них обо- обозначение ОСТ-иГФ (орбиталь слэтеровского типа, составленная из п гауссовых функций; англ. STO-wG, т.е. Slater type orbital contracted jrom n Gaussians). Сгруппированные гауссовы функции иногда не вполне удачно называют сжатыми функциями, а иногда, опять-таки не задумываясь сколько-нибудь серьезно о русскоязычном эквивален- эквиваленте, - коитрактированными функциями; те же гауссовы функции, из которых составлены эти комбинации, иногда называют "гауссианами". Сделаем еще несколько замечаний о терминологии. При очень малых величинах параметров ^ функции называются диффузными. Если они включают угловую часть Yim{^ ф) со значениями /, превы- превышающими те значения, которые встречаются у орбиталей атомов в их основных электронных состояниях, то такие функции называются поляризационными, т.е. функциями, позволяющими учесть искаже- искажение (поляризацию) сферического атомного распределения электрон- электронной плотности под влиянием более низкого по симметрии окружения из других ядер молекулы. Наконец, если функция у^ центрирована не на ядре, т.е. отвечающая этой функции система координат не имеет своим началом точку расположения какого-либо ядра, то такого типа функция, как правило, называется связевой (обычно она выбирается центрированной в некоторой точке на прямой, соединяющей два ядра). В тех случаях, когда орбитали y задаются произведением радиальной функции на сферическую гармонику Yj^'d; qp), угловой момент определяется значением / и орбиталь называется, как обычно, орбиталью s-, р-, с/-,...типа при / = О,1,2,... Декартовы гауссовы фун- функции типа (9) уже не соответствуют в общем случае определенной сферической функции, однако используемые на практике декартовы гауссовы орбитали обычно выбираются так, что w, w, p являются неотрицательными целыми числами. При т = п =р = 0 орбиталь (9) 295
сферически симметрична и соответствует 1 = т + п+р = 0 (s-орби- таль). Если одно из чисел w, n,p равно 1, а остальные равны нулю, то орбиталь (9) соответствует I = т + п + р = 1 (р-орбиталь). При т + п +р = к> 1 орбитали (9) соответствуют определенному значению / углового момента, и их называют d~,f-, #-,...орбиталями, исходя из значения к. При построении сгруппированных гауссовых функций в виде линейных комбинаций орбиталей (9) значения параметров т, п, р принимаются одинаковыми, и тип орбитали, определяемый числом т + п +р, характеризует линейную комбинацию в целом. д. Метод Хартри-Фока-Роотхана. Аппроксимация моле- молекулярных орбиталей линейной комбинацией базисных (атомных) функций применительно к решению хартри-фоковской задачи для молекул была введена К. Роотханом (которого в русскоязычной литературе обычно называют Рутаном) сначала для систем с замкну- замкнутыми оболочками A952 г.), а потом и для систем с открытыми обо- оболочками. Корректная схема вывода уравнений, получивших название уравнений Хартри-Фока-Роотхана, заключается в следующем: а) записывается многоэлектронная (одноконфигурационная) вол- волновая функция с молекулярными орбиталями, представленными в виде линейной комбинации базисных функций; б) записывается функционал энергии для такой функции; он, оче- очевидно, зависит только от коэффициентов с^ разложения молекуляр- молекулярных орбиталей по базисными орбиталям; в) коэффициенты cN варьируются в функционале энергии с учетом ортонормированности молекулярных орбиталей, т.е. по существу, ис- используются необходимые условия экстремума функционала энергии по отношению к коэффициентам с^\ г) в ходе решения полученной системы уравнений для коэффици- коэффициентов Сд, определяются орбитальные энергии и орбитали, из которых далее строится полная волновая функция Фис нею находятся тре- требуемые средние значения свойств. Мы не будем проходить весь этот путь, а воспользуемся бо- более короткой процедурой. Эта процедура, хотя и требует на самом деле более детального и долгого обоснования, которое мы опускаем, ведет, тем не менее, к тем же конечным результатам. Возьмем для определенности уравнения ограниченного метода Хартри-Фока N/2 1=1 . = ?.ф., i i^i> F.2.10) 296 подставим вместо ф. и Ф/ их представление в заданном базисе: Ф,- = 5)ус^Ху и Ф/ = 5)Y C/YXY и умножим слева уравнение A0) на функцию Хц (дая любого ^i), после чего проинтегрируем левую и правую части по пространственным переменным, например х,у, z. В результате этой последовательности операций получим систему уравнений (/= l,2,...,7V/2): м 2 V-1 с. =0, F.2.11) где оператор F представлен теперь в виде матрицы со следующими элементами: F з < > = ч.ь < \iy\vb > — < \iy\bv РуЬ. F.2.12) N12 Величины РуЬ = 2 X называются обычно порядками /-1 связей, что опять-таки имеет прежде всего чисто исторические корни и связано с интерпретацией этих величин в простейших вариантах одноэлектронного приближения. Уравнения A1) не являются линейными уравнениями отно- относительно неизвестных c/v. Однако если в матричных элементах F использовать некоторое начальное приближение cj® для этих коэф- коэффициентов, а, следовательно, и для величин Р^, то далее можно решить систему линейных однородных уравнений A1), найти новые коэффициенты с$ и порядки связей Р^ и повторять этот цикл до тех пор, пока не будет достигнута сходимость (если она будет иметь место). Для того же чтобы система A1) имела нетривиальные реше- решения, необходимо, чтобы ее определитель обращался в нуль: F.2.13) что приводит к вековому уравнению и задаче отыскания его корней ?,. Каждому корню соответствует получаемый из системы A1) набор коэффициентов Сд,, определяющий молекулярную орбиталь .ф,-. 297
Уравнения A3) и A1) содержат матричные элементы F^v и интегралы перекрывания S^v. В свою очередь F^v представляют со- собой комбинацию интегралов, называемых молекулярными интегра- интегралами и имеющих вид: а) < Xul~2"^IX энергии; v > = -интеграл кинетической б) < X, ядром а; а R 1а V > - интеграл взаимодействия электрона с -1 <ХцA)хуB) г{2 хУA)ХбB)> = < MY|v6> - интеграл меж- межэлектронного взаимодействия. Интегралы первых двух видов называются одноэлектронными, последние - двухэлектронными. Кроме того, дополнительно исполь- используется следующая терминология: если интеграл включает функции (в том числе 1 /R\a\ центрированные на одном центре, то он одноцен- тровый, на двух центрах - двухцентровый; имеются также трех- и четырехцентровые интегралы. Основную массу среди молекулярных интегралов составляют двухэлектронные трех- и четырехцентровые интегралы. Действительно, если число базисных функций Хц равно М, то число интегралов кинетической энергии равно (с учетом эрми- товости оператора - ~ Д) М(М + 1)/2 « Л/2/2. В то же время число двухэлектронных интегралов (с учетом независимости интеграла от замены переменных первого и второго электронов) составляет дня вещественных базисных функций величину (Л/4 + 2Л/3 + ЪМ1 + 2М)/8, т.е. с ростом М растет как Л/4/8. Так, при М= 10 число интегралов кинетической энергии равно 55, число двухэлектронных интегралов - 1540, тогда как при М= 40 эти числа уже составляют 820 и 336610 соответственно. Задачи 1. Вывести уравнение Хартри-Фока-Роотхана для системы с зам- замкнутыми оболочками на базе прямого вариационного подхода. 2. Каков физический смысл может быть у незаполненных (вирту- (виртуальных) орбиталей, получаемых при решении уравнений Хартри-Фока наряду с орбиталями, используемыми для построения хартри-фоков- ской функции? 298 § 3. Молекула Н2 Сопоставим теперь результаты, получаемые при рассмотре- рассмотрении электронных состояний простейшей молекулярной системы - мо- молекулы Н2 - в различных приближениях. а. Приближение Хартри-Фока в варианте МО ИКАО. Как уже говорилось в § 4 гл-V, при рассмотрении метода валентных схем, простейшим базисом для данной задачи являются две функции 1 sa и 1jb , где индексы показывают, что они центрированы на ядрах А и В соответственно. Из этих двух функций можно построить две мо- молекулярные орбитали: F.3.1) причем коэффициенты су должны удовлетворять следующим усло виям нормировки и ортогональности (предполагаем, что коэффициен ты Су вещественны, и используем обозначение S = <1 sA| > = cn+2cncnS + = С 2\ =1, <ф1|ф2 > = спс21 +(спс22 + cnc21)S + с12с22 =0. Из орбиталей ф, можно построить 4 спин-орбитали: \р t = qp2a; а и ^4 = ФгР ~исоответствующиеоднодетер- г|J = минантные функции, число которых равно числу сочетаний из 4 по 2, т.е. 6. Эти функции имеют вид: F.3.2) В отличие от метода валентных схем, использующего базис атом- атомных орбиталей, здесь уже не столь очевидно выделение "ионных" и "ковалентных" составляющих. По отношению к операторам спина функции *Р; ведут себя следующим образом: собственное значение 299
оператора Sz равно 0 на функциях Ч*\ , Ч*з> 4*4 и Ч*б> равно 1 на функции 4*2 и равно -1 на функции 4*5; собственное значение S на функциях и 4*6 и на функции ЧР3 - у^з ~ ^4)/'2 равно нулю, тогда как (в полной аналогии с тем, что было представлено для метода валент- валентных схем) функции Ч*2> 4*5 и ЧР4 = (*Р3 + х?4 )/>/2 отвечают собствен- собственному значению с S = 1. Таким образом, имеем следующие комбинации собственных значений операторов S2 и Sz и отвечающих им функций: = 0, 52 = 0: = 1 : = 0 : = -1: Средние значения электронного гамильтониана на этих функциях: Е1Ш< е2 = < vp1 > = 2 < Ф1|Л|ф1 ф2|Л|ф <Ф1Ф2|ф1Ф2 >+ <ф1ф2|ф2ф1 >; ф2|Л|ф Ф,Ф ,Ф2 Ф1Ф 1Ф2 Е6=< Следовательно, для двух функций Ч*i и Ч*6 имеется лишь одно уравнение Хартри-Фока с фокианом вида = h + Jx либо J2, F.3.3) так что 300 \h+f = \h+ Г12 dx2 1ф ; для трех функций Ч*,, 2> Х4 иФ5~ Двауравнения, определяющие функции qpi и ф2, с фокианом ; F.3.4) и, наконец, для функции Ч?3 фокиан имеет вид: F.3.5) где к= 1,2- номер функции, на которую действует оператор F$. В базисе функций xi = 1^а и Х2 = 1**в уравнения Хартри-Фока приобретают, например, для Ч*\ и Фб следующий вид: /р F х 11 12 F F \ 21 22/ 1 \С21 = ? <x1lx2 \ 2/ F.3.6) где _1 2 i.t-1 F12 = 1J--1 P.. = 2c. c. Представленные выражения для матричных элементов по- показывают, что диагональные матричные элементы фокиана равны друг другу, поскольку < xJ^IX! > = < Х21Л1х2 > и 2 2 <XiXilXiXy>- Поэтому фокиан имеет вид : F = \2 \F2\ F\\ Решая уравнение (F — eS)c = 0, выпишем сначала det{F - eS} - 0, т.е. (Fn - еJ - (Fi2 - tSJ = 0, так что i2 И 11 -^12 1-5 F.3.7) 301
После подстановки этих выражений в уравнения F) окончательно получим 11 1 C21 ¦2 - F.3.8) -12/ V^+ ^Э W \C22 Таким образом, мы нашли молекулярные орбитали, являющиеся решениями уравнений Хартри-Фока с фокианом C). Совершенно ана- аналогично можно найти решения с фокианами D) и E). Можно, однако, сразу же заметить, что у данной задачи имеет- имеется довольно высокая точечная симметрия, в частности имеется плос- плоскость симметрии он, перпендикулярная соединяющей ядра оси сим- симметрии бесконечного порядка. Отражение в этой плоскости не меня- меняет электронный гамильтониан, как не меняют его и другие операции группы D^, а потому функции Ч*ь ..., Ч*6 либо соответствующие их линейные комбинации должны преобразовываться по неприводимым представлениям этой точечной группы. При вращениях вокруг оси С т, так же как и при отражении в любой из плоскостей av, проходя- проходящих через эту ось, функции lsA и lsB не меняются, тогда как при отражении в плоскости а/,, а также при поворотах вокруг любой оси симметрии второго порядка, проходящей перпендикулярно оси С , и при инверсии функции lsA и lsB переходят друг в друга. Их линейные комбинации 1 Ф2 = 1 -Х2)> F.3.9) V2-25 т.е. как раз функции, определяемые векторами (8), преобразуются по полносимметричному 2 * и антисимметричному 2 + (нечетному от- относительно инверсии) представлению соответственно. Вне зависи- зависимости от вида фокиана C, 4 или 5) функции ф! и ф2 будут все время иметь вид (9), поскольку для данной простой задачи они, по существу, определяются лишь ее симметрией. При этом орбитальные энергии, им отвечающие, будут, без сомнения, зависеть в общем случае от вида фокиана, так как они представляют собой, как уже говорилось, средние значения фокиана на функциях (9). Матричные элементы фокиана C) F\u F22 и Fi29 как показы- показывают численные расчеты, отрицательны, причем IF12I < \F\\\- По этой 302 причине г\ < ?2 < 0. Если вернуться к выражению для энергии Е\ или ?6, то можно получить соотношения, выражающие эти величины че- через интегралы от lsA и 1$в, которые мы пока выписывать не будем, чтобы не загромождать текст, а вернемся к ним в п. в. Выпишем еще выражения для функций х?\ и 4*6 с учетом ра- равенств (9) и с учетом того, что если у определителя строка пред- представлена в виде суммы двух строк, то он равен сумме двух опреде- определителей, отвечающих каждый одной из этих двух строк. Если запи- записать знак "+" для функции 4*i и знак "-" для функции Ч*6, то будем иметь: 1 1 det 1 1 (lsA ±lsB)a, 1 (l5A±l5B)P л/2 >/2 ± 25 l5B(l)l5AB))(ap-pa)]. F.3.10) Если теперь вспомнить, что говорилось в § 4 предыдущей главы, то первое и второе слагаемые в квадратных скобках правой части последнего равенства отвечают ионным валентным схемам, тогда как третье слагаемое - ковалентной схеме. В отличие от того, что получалось в методе валентных схем, коэффициенты перед эти- этими слагаемыми в рамках метода Хартри-Фока, или метода молеку- молекулярных орбиталей, жестко фиксированы (равны в данном случае друг другу) и не меняются при изменении межъядерного расстояния. В частности, при R —> °° в энергию системы будут давать вклад все три слагаемых, что означает, что на диссоциационном пределе энер- энергия будет содержать составляющие, обусловленные ковалентными и ионными членами, т.е. физическая картина получается неверной: дол- должны были бы присутствовать лишь члены, отвечающие диссоциации либо на два атома, либо на анион Н~ и катион Н+ (протон). б. Конфигурационное взаимодействие. Функции Ч^' Ч*4 и Ч^ отвечают трем спиновым компонентам триплетного электронно- электронного состояния, симметрия которого, как следует из вида этих функций, типа 2 у , так что они соответствуют электронному состоянию 2„ (вверху слева указана мультиплетность 25 + 1). Функция Ч*3 отно- относится к этому же типу симметрии, но с другой мультиплетностью: j2? . И наконец, функции 4*i и W^ соответствуют электронным 303
состояниям одного и того же типа 2 * . Поэтому следующим шагом уточнения электронной волновой функции этого типа симметрии является переход к хоть и весьма ограниченному, но конфигура- конфигурационному взаимодействию: причем, как сказано выше, Ч*\ отвечает конфигурации уг ¦ og, тогда как Фб ~ конфигурации ср2 = а„ . Здесь использованы стандартные обозначения для орбиталей: ogn ou, символ а указывает, что орбиталь не меняется при отражении в плоскости, проходящей через главную ось симметрии, а символы g и и уже известны. Функции Ч1! и 4*6 различаются двумя орбиталями. Поэтому система уравнений метода конфигурационного взаимодействия (Ни -Е)СЛ +Н.2С2 = 0, 411 } х 12 2 F.3.11) 1С1+(Я22-?)С2=0, согласно правилам Слэтера, будет иметь в качестве матричного эле- элемента Н\2 величину а в качестве элементов Н\\ и #22 - соответствующие хяртри-фоков- УД) ские энергии Ег6 . Вековое уравнение для системы A1) имеет вид: Е2 - 12 так что ХФ 2 причем <ояоя\оиои> = gg 1 >]. F.3.13) В последнем соотношении учтено равенство <l5AlsA|lsAlsA > = = < lsBlsB|lsBlsB > и то? что двухэлектронные интегралы не зависят от перестановки индексов электронов. При больших межъядерных расстояниях (R —> оо) в выраже- выражениях для энергии Е\ и Ев можно пренебречь интегралами S, < lsA\h\lsB >, < 1?В|Л|1$А > , а также дв^электронными интеграла- 304 ми вида < lsAlsA|lsAlsB > и < lsAlsA|lsBlsB > , что в итоге дает: = <l5A|--A-— \lsA >+-<lsAlsA\lsAlsA Al 2 ft/ 4 ЧА F.3.14) 2 Л1В 4 Для энергии ? в рамках метода конфигурационного взаимо- взаимодействия при R —> оо получим 2Е н для знака "-" F.3.15) 2ЕН+ < l5Al5A|lsAl5A > для знака "+". Здесь Е\\ - энергия основного состояния атома водорода. Коль ско- скоро интеграл <l5Al5A|lsAlsA > положителен, то низшему корню отвечает энергия Е^3 = 2ЕН, причем в этом случае, как следует из A1), С\ = -С2. Верхнему корню отвечает решение С\ ~ С^ Волновой функцией низшего состояния будет (без нормировочного множителя): т.е. теперь уже волновая функция низшего состояния при R —> оо от- отвечает системе двух атомов водорода. За счет введения конфигура- конфигурационного взаимодействия при R—*oo ионные члены стремятся к нулю, что и обеспечивает правильное поведение волновой функции на дис- социационном пределе. При конечных межъядерных расстояниях учет конфигураци- конфигурационного взаимодействия позволяет изменить соотношение ковалент- ного и ионного вкладов, отойти от фиксированных весов этих вкладов, имевших место в методе молекулярных орбиталей. в. Нулевое дифференциальное перекрывание. При записи матричных элементов и выражений для энергии при R—><x> мы вос- воспользовались тем обстоятельством, что произведение lsA(l)lsB(l) при больших расстояниях между центрами стремится к нулю, а потому 305
и интегралы, содержащие такие произведения, также в пределе дол- должны быть равны нулю. При конечных расстояниях R произведения такого типа уже не равны нулю. Однако, если в этих произведениях первый сомножитель существенно отличен от нуля там, где второй близок к нулю и наоборот, то произведение вида Ха (') Хв A) м°жно считать близким к нулю почти всюду, а следовательно и интегралы от таких произведений также будут близки к нулю. Для приближен- приближенных расчетов этим условием, или этим приближением, называемым приближением нулевого дифференциального перекрывания (НДП, англ. zero differential overlap, ZDO), пользуются очень часто. При прочих равных условиях оно оказывается тем лучше, чем дальше друг от друга находятся центры А и В. Так, выражение для хартри-фоковс- кой энергии при R —> оо, по существу, было записано именно в этом приближении. В следующей главе на основе этого приближения будут вве- введены некоторые из полуэмпирических методов квантовой химии. А пока что выпишем с учетом этого приближения приведенные выше выражения для хартри-фоковских энергий состояний 2 *, 2 * их 2 * . При этом будем пользоваться приближением НДП только в тех слу- случаях, где встречается произведение 1$а0I5в0) без каких-либо до- дополнительных операций (например, частных производных от одного или обоих сомножителей).В частности, интеграл перекрывания S= 0. Для простоты далее будем вместо 1$д писать а, а вместо 1$в - Итак, — —(< аа\аа > + <bb\bb>\ < ab\ab>; > + <аа\аа>\ = <a\h\a> + <b\h\b —(< aa\aa bb\bb>) + — < ab\ab>. Интеграл < ab\ab > (в том числе и в общем случае для произвольных функций а и Ь) положителен. В то же время 306 < аа\аа > г < ab \ ab > . Поэтому ?2 < #з >а если к тому же предпо- предположить, что интеграл < а | А | b > по модулю достаточно мал (что следует и из численных расчетов), то Ei < Е^. Кроме того, Е\ < Е$. При учете конфигурационного взаимодействия вклад интег- интегралов вида < аа\аа > в энергию состояния 1 2 уменьшается, а в энергию состояния 2 2 увеличивается. г. Расширение базиса. Использованный выше базис, без со- сомнений, является слишком малым. Необходимо учесть, что распре- распределение электронной плотности должно терять сферическую симмет- симметрию у каждого центра, т.е. должно поляризоваться вторым центром. Необходимо также учесть, что электронная корреляция должна при- приводить к тому, что электроны будут находиться по возможности да- далее друг от друга, что обеспечивается увеличением угла между плоскостями, проходящими через оба ядра молекулы и через один из электронов (так называемая угловая корреляция), а также увеличением разности радиальных переменных для обоих электронов (радиальная корреляция). Есть и ряд других факторов, также подлежащих учету при построении более корректной волновой функции. Для такого уче- учета указанных факторов в базис вводятся дополнительные функции, например 2/>2д и 2р2ц на центрах А и В, что позволяет при переходе к функциям типа c\lsA + c-{lpz^ вводить поляризацию электронного распределения вдоль оси молекулы. Для учета угловой поляризации необходимо в простейшем случае ввести функции типа 2рх и 2ру на каждом центре, а может быть, и функции типа dили/. Какие функции вводить и в каком числе, определяется конкретно для тех или иных рассматриваемых молекулярных систем на основании имеющегося опыта расчетов. Следует лишь отметить, что при точных расчетах сравнительно простых молекул, состоящих из атомов второго или третьего периодов, используют на сегодняшний день не только d- и/- функции, но подчас и g- и й-функции, причем используется по не- несколько функций каждого типа с различными экспоненциальными па- параметрами. Очевидно, что базис должен быть достаточно адекватен по- поставленной задаче и при малых межъядерных расстояниях. Другими словами, он должен включать и такие функции, которые позволили бы качественно правильно воспроизвести ту волновую функцию, ко- которая должна получиться при R —> 0, например для двухатомной мо- молекулы при переходе к пределу объединенного атома. Для того, что- чтобы выяснить, какие функции при этом должны потребоваться, обыч- 307
но пользуются корреляционными диаграммами, о которых будет ска- сказано подробнее в п. б следующего параграфа. § 4. Симметрия волновых функций и орбиталей Электронный оператор Гамильтона отвечает фиксированной ядерной конфигурации, которая при наличии в молекуле тождествен- тождественных ядер может обладать определенной точечной симметрией, т.е. симметрией той или иной точечной группы. Так, у молекулы СНз име- имеются три тождественных ядра - протона, что приводит к возможной симметрии у этой молекулы, отвечающей точечной группе D^ (плос- (плоская конфигурация), либо СзУ (пирамидальная конфигурация), либо Civ (плоская с расположением протонов в вершинах равнобедренного треугольника), Cs (плоская) иС]. Возможны, конечно, и линейные конфигурации С^у , хотя они и весьма мало вероятны. Каждой сим- симметричной конфигурации отвечает группа операций, не меняющих электронный гамильтониан и, следовательно, коммутирующих с этим гамильтонианом. а. Симметрия электронной волновой функции. Элект- Электронная волновая функция стационарного состояния, т.е. собственная функция электронного гамильтониана, для симметричных ядерных конфигураций должна преобразовываться по одному из неприводи- неприводимых представлений соответствующей точечной группы симметрии. Это утверждение, однако, справедливо лишь для точной функции. При- Приближенная функция подобным свойством обладать в общем случае не должна, что влечет за собой вполне определенные, не всегда при- приятные последствия. Действительно, если она не преобразуется по не- неприводимому представлению, то ее можно представить в виде ли- линейной комбинации функций, преобразующихся по таким представ- представлениям. Следовательно, к функции какого-либо типа симметрии бу- будут добавляться функции других типов симметрии, которые могут привести к нарушению требования вариационного принципа давать оценку сверху к точным собственным функциям вполне определен- определенных типов симметрии. Поэтому желательно, чтобы пробная функция требуемыми свойствами симметрии все же обладала. Добиться этого в общем-то несложно: можно построить проек- проекторы нате или иные неприводимые представления, например в виде Хг, F.4.1) 308 где gk - операция группы G порядка N9 gk - ей соответствующий оператор, Хг,-(?*) - характер неприводимого представления для операции g^ mt - размерность этого представления. Однако при та- таком проектировании возможно нарушение условий, которые налага- налагаются на используемый класс пробных функций. В частности, одно- детерминантная функция может превратиться в линейную комбина- комбинацию функций и перестать быть однодетерминантной. В рамках ме- метода Хартри-Фока коэффициенты в такой линейной комбинации будут определяться характером неприводимого представления Хг,- •> т*е- будут фиксированы. Тем не менее, желание сохранить однодетерминантное пред- представление бывает подчас достаточно сильным (например, чтобы иметь наглядную интерпретацию, характерную для функций одноэлек- тронного приближения), что приводит к естественному вопросу: в каких случаях такое представление действительно возможно? Прежде чем на него ответить, отметим еще одно важное обстоятельство. В отличие от метода конфигурационного взаимодействия ме- метод самосогласованного поля рассчитан на построение приближен- приближенной функции лишь основного состояния. При дополнительных усло- условиях, например, при заданной мультиплетности состояния, он нацелен на построение однодетерминантной или одноконфигурационной функ- функции основного состояния среди состояний этой мультиплетности. Все другие получающиеся решения, если они не отвечают вырожденной задаче, в общем случае не имеют сколько-нибудь определенного фи- физического смысла. Эти решения, как правило, не ортогональны реше- решению, низшему по энергии, и не могут непосредственно быть исполь- использованы для построения функций возбужденных состояний. Конечно, бывают и исключения, но это такие детали, на которых пока останав- останавливаться не стоит. Так называемые виртуальные орбитали, получае- получаемые как решения одноэлектронного уравнения Fqp « eqp сверх тех орбиталей, которые входят в детерминант (одноконфигурационную функцию) основного состояния, отвечают даже физически иной за- задаче: в этом уравнении фокиан содержит оператор вида У / (.// ~ &i) •> где суммирование ведется по всем занятым орбиталям, в силу чего для виртуальных орбиталей он отвечает задаче о поведении электро- электрона в поле ядер и усредненном поле всех N электронов молекулы (в этой сумме остается N слагаемых вместо N - 1 слагаемого, как то имеет место для любой из занятых орбиталей). Следовательно, вир- виртуальные орбитали должны отвечать скорее задаче об анионе, а не о 309
нейтральной молекуле (в связи с этим обстоятельством при поиске орбиталей, служащих для построения конфигурационных функций со- состояния в методе конфигурационного взаимодействия, часто в каче- качестве набора орбиталей, расширяющего исходный набор, берут вир- виртуальные орбитали из задачи о катионе). Таким образом, общее построение метода Хартри-Фока го- годится лишь для основного состояния (при тех или иных ограничениях). Покажем, что если при решении уравнений Хартри-Фока найдено единственное решение, отвечающее абсолютному минимуму энергии, то соответствующий детерминант будет преобразовываться по одному из неприводимых одномерных представлений, отвечающих типу симметрии основного состояния при заданной симметрии ядерной конфигурации. Операция симметрии, как уже говорилось, есть неко- некоторое (ортогональное или унитарное) преобразование пространства, либо соответствующее преобразование функций, заданных в этом про- пространстве. Пусть такой операцией является gt E G. Тогда одноде- терминантная функция Ч1 (либо одноконфигурационная; далее везде эту оговорку мы просто будем лишь подразумевать) преобразуется следующим образом: = (M)-1/2det{?;x|)i, яф2,..., g&N }, F.4.2) причем gjtyk представляют собой преобразованные одноэлектронные функции %, которые всегда можно записать в виде N 2 М к, F.4.3) где Д# — некоторая функция, ортогональная всем функциям г|)/, вхо- входящим в детерминант (она может просто быть равной нулю), тогда как коэффициенты с^ / определяются при ортонормированнных г|>/ соотношениями: Cik, / = < Ф/1 gt 1% > . F.4.4) Если подставить выражения C) в правую часть B), то можно вос- воспользоваться тем, что детерминант, у которого некоторая строка представлена суммой двух строк, есть сумма двух детерминантов с соответствующими строками-слагаемыми. Например, Ч>2B) A2B) По этой причине выражение B) для функции Ч*; можно переписать следующим образом: 4ft ш gi4> - (N -1/2 det N det{A1,A2,...,AiV} m-l Здесь Ф^ - детерминант, отличающийся от первого детерминанта в квадратных скобках заменой в нем строки из функций 2) im\ cim,i "Ф / на строку АшA), АшB),..., АШGУ), т.е. на строку из функций Аш. Далее идут детерминанты с двумя, тремя и т.д. подобными заменами. Все эти слагаемые, которые обозначим через х(Д) > ортогональны первому детерминанту, стоящему в квадратных скобках. Если ввести, кроме того, матрицу Q с элементами с^ /, то первый детерминант можно записать как детерминант произведения двух матриц: одной, составленной из коэффициентов с^ /, и второй (матрицы у) — из функций г|)/(и). Следовательно, г • detV+Х,-(А)], 310 где использовано то, что определитель произведения двух матриц равен произведению их определителей. Поскольку (iV!)/2 det\|/ = Ч*, находим Ф,- -ft^-detCi •Ч' + (ЛГ!)-1/2Х/(А). F.4.5) При том условии, которое было сформулировано вначале, - единственность абсолютного минимума - сразу же следует равенство X; (А) = 0, что в свою очередь, как можно показать, влечет за собой равенство нулю всех А^. К тому же, сохранение ортонормированности функций при операциях симметрии < ф'ф^&'ф/ > - 6# влечет за собой условие, что С; - унитарная матрица с определителем, по модулю равным единице. Итак, мы пришли к выводу, что в рассматриваемом случае числа detC/, / = 0, !,...,#-1 образуют представление, которое, будучи одномерным, является, очевидно, неприводимым. Орбитали же 'Фь —> 'Флг (точнее было бы говорить о спин-орбиталях, однако там, где ясно, о чем именно идет речь, такой детализации проводить не будем) преобразуются друг через друг^ матрицами С(, которые также 311
образуют представление, вообще говоря, приводимое. Если его привес- привести, то отдельные орбитали будут преобразовываться также по неприво- неприводимым представлениям, в том числе и вырожденным, хотя вся многоэлектронная функция при этом будет преобразовываться лишь по какому-то одному одномерному неприводимому представлению. б. Ограниченный метод Хартри-Фока. Указанная выше возможность нахождения единственного детерминанта в действитель- действительности достаточно явно прослеживается лишь в рамках ограниченно- ограниченного метода Хартри-Фока, когда каждая орбиталь из образующих ба- базис неприводимого представления входит в определитель дважды (со спин-функциями а и Р), либо каждая из них входит единожды, но обя- обязательно с одной и той же спин-функцией (только а или только р), другими словами, когда в детерминанте встречаются только полнос- полностью либо только наполовину заполненные оболочки. В рамках остальных приближений Хартри-Фока положение сложнее. Так, в неограниченном методе Хартри-Фока для детерми- детерминанта с одним и тем же числом п спин-функций а и спин-функций р (так что число электронов N= 2ri) при некоторой операции симмет- симметрии g возможен переход орбитали ф, из ф,а в орбиталь фя+/ спин- орбитали ф„+/Р и наоборот. Получающаяся функция будет отлична от исходной, хотя на ней все средние значения операторов, не завися- зависящих от спина, так же как и операторов Sz и S2, будут одинаковы. Это говорит о том, что для такой задачи нужно использовать линейную комбинацию по крайней мере двух функций: исходной Ч1 и преобразо- преобразованной g1?, поскольку они равноценны! Более того, даже в рамках ограниченного метода Хартри- Фока возникают ситуации, на первый взгляд кажущиеся неожидан- неожиданными, однако в действительности вполне естественные для этого метода. Так, при расчетах молекулы СО2 для изогнутых геометричес- геометрических конфигураций симметрии C2V энергия понижается по мере увеличения валентного угла а и стремления его к я, что соответству- соответствует тому, что равновесная конфигурация молекулы в основном состоя- состоянии - линейная. Однако расчет непосредственно линейной конфигура- конфигурации дает точку на этом сечении потенциальной поверхности Е = Е(а), выпадающую из плавного поведения при а -> к, причем выпадаю- выпадающую вверх по энергии. Объяснение подобному факту довольно очевидно: для линейной конфигурации, где симметрия выше, на орбитали накладываются более жесткие ограничения. В частности, некоторые из них должны преобразовываться по одному из неприводи- 312 мых представлений типа П, которые являются двумерными, или дву- двукратно вырожденными, либо по представлениям типа Л, также двумер- двумерным, и т. п. При изгибе молекулы две компоненты (функции двух вырожденных состояний) П-представления расщепляются по энергии, они становятся различными, т.е. не должны переходить друг в друга при вращениях вокруг оси симметрии линейной молекулы либо при других операциях симметрии. Вот эта-то возникающая дополнитель- дополнительная свобода в форме орбиталей и приводит к понижению полной энер- энергии системы и резкому изменению формы молекулярных орбиталей. Различные варианты метода Хартри-Фока обладают целым набором особенностей поведения такого типа (как говорят, неста- бильностями различного типа): имеется симметрийная нестабиль- нестабильность, комплексная нестабильность (по отношению к появлению мни- мнимых слагаемых у орбиталей), триплетная нестабильность (по отно- отношению к появлению у орбиталей таких добавок, которые ведут к со- составляющим волновой функции с иной мультиплетностью, чем у ис- исходной функции, например, триплетной составляющей у изначально синглетной функции, т.е. функции, описывающей синглетное состоя- состояние). Хотя вопрос о том, в каких случаях, для каких областей потен- потенциальной поверхности и с какими причинами связано наличие неста- бильностей, весьма интересен, а ответ на него очень полезен, в час- частности, при анализе реакционной способности химических соедине- соединений, рассматривать далее эту проблему мы не будем, поскольку она требует некоторого дополнительного математического аппарата и до- дополнительной подготовки. в. Орбитальные корреляционные диаграммы. При любых изменениях геометрической конфигурации ядер молекулы, сохраня- сохраняющих симметрию исходной конфигурации, тип симметрии электрон- электронной волновой функции не меняется. При этом сохраняются и типы симметрии орбиталей, входящих, например, в определитель Слэтера ограниченного метода Хартри-Фока. Это обстоятельство совмест- совместно с некоторыми дополнительными условиями позволяет вводить весьма важные для качественного анализа орбитальные корреляци- корреляционные диаграммы, широко используемые как в квантовой химии, так и в химии вообще. Ниже в этом пункте речь пойдет об основных принципах построения орбитальных диаграмм, а конкретные приме- примеры тех или иных диаграмм будут представлены в § 1 гл. IX. Корреляционная диаграмма - это диаграмма изменения энер- энергии при изменении параметров задачи (прежде всего геометричес- 313
ких), которая связывает, как правило, две или большее число геомет- геометрических шнфигураций, соответствующих физическим системам, для которых решения уравнения Шредингера известны, и позволяющая судить об энергии системы при некоторых промежуточных конфигу- конфигурациях ядер. "Крайние" конфигурации, для которых решения известны, выполняют роль нулевого приближения теории возмуще- возмущений, а промежуточные соответствуют своего рода возмущенным си- системам. Эта аналогия достаточно наглядна, хотя и обладает недо- недостатками. В качестве энергии может выступать либо энергия того или иного состояния квантовой системы, либо орбитальная энергия. В последнем случае и получаются орбитальные корреляционные ди- диаграммы. Как пример можно назвать диаграммы для двухатомных мо- молекул, где имеется лишь один геометрический параметр - межъя- межъядерное расстояние R. При /?—><» молекула переходит в два разъеди- разъединенных атома, для которых полные и орбитальные энергии предпола- предполагаются известными. При R —> 0 получается атомная система с заря- зарядом ядра, равным сумме зарядов ядер двух разъединенных атомов: Z = Z\ + Z2. При этом из электронной энергии предварительно для построения корреляционной диаграммы надо исключить слагаемое V(R) - Z\Zi/R\i (которое потом можно ввести обратно); тогда при построении диаграммы при R —> О, т.е. в пределе объединенного ато- атома, не возникает стремления энергии к бесконечности. Промежуточ- Промежуточные значения R отвечают двухатомной молекуле, диаграммы для полных электронных энергий с включением V(R) представляют по- потенциальные кривые двухатомных молекул в различных состояниях, тогда как диаграммы для орбитальных энергий (без V(R)) приводят к орбитальным корреляционным диаграммам. При построении таких диаграмм предполагается, что энергия, будь то полная электронная либо орбитальная, непрерывно зависит от геометрических параметров системы. И хотя с волновыми функ- функциями возникают некоторые особенности (например, перемещение каспов 5-функций вслед за перемещениями ядер), полная электрон- электронная энергия, как можно показать, остается непрерывной вместе с ее первыми производными по геометрическим параметрам. Будем счи- считать, что такого же типа непрерывность существует и у орбитальных энергий. Это - первое из упомянутых выше условий. Второе условие связано с тем, какие состояния (или орбитали) должны быть соединены на корреляционных диаграммах непрерыв- 314 ными линиями, какие из них переходят в какие при непрерывном из- изменении геометрии системы. Для того чтобы дать качественный ответ на этот вопрос, рассмотрим двухуровневое приближение. Пусть гамильтониан (или фокиан) записан в виде #и Я и 12 7*21 ^22 матричные элементы которого зависят от R (скажем, для двухатом- двухатомной молекулы). Будем считать эти матричные элементы веществен- вещественными и обозначим их следующим образом: Я22 = е, #ц = Х.е и #п = = а. Тогда для энергетических уровней Е\ и Ej такой системы получим обычные выражения ?± х-г г2+а2 причем для определенности опять-таки примем, что X г 1 (в против- противном случае Яц и #22 можно поменять местами), а ? < 0, так что е. F.4.6) Верхнему знаку "-" здесь соответствует более высоко лежащий уро- уровень. И наконец, также без нарушения общности рассуждений допу- допустим справедливость условия: а в предельном случае (R —* 0 или R —> оо) стремится к нулю, а волновая функция, собственная для #, имеет вид где 1 и Ч^°) - решения задачи с а * 0. Рассмотрим теперь два случая. В первом из них X, » 1, на- например К - 10, и \а/г\ = Ъ ** 1, например Ъ = 1/2 . При этих значениях параметров задачи — ±J - +- И 9 Л 1 — ±- 1 + 2 21 2-81 ^* *«№ где использовано разложение корня в ряд : V1 + х =1 + \х- ....Соб- 315
ственные значения невозмущенной задачи, равные ей 10е, практи- практически не изменились. Собственные функции, отвечающие этим соб- собственным значениям, будут такими: Ч?г = 0,998Ц^0) + 0,055 Ч*2@); Ч*2 = -0,055 Ч^°> + 0,998Ч*<°>, причем приведены выражения для нормированных функций, хотя по- существу нам требуется знать лишь соотношение коэффициентов перед функциями Ч^°) и Ч1^. Таким образом, и волновые функции изменились мало. Перейдем теперь ко второму случаю. Пусть X ¦>¦ 1, например К = 1,1, тогда как \а/г\ имеет то же самое значение. Невозмущенные собственные значения равны 1,1е и е. Очевидно, что ? = Г1552? 0548 ? . Для волновых функций будем иметь Ч* = 0,74 Ж@) + 0,6714^ 0); Ч* = ~0,67Щ{0) + 0,741Ч^0). Полученный результат означает, что при одном и том же взаимодей- взаимодействии (возмущении) #12 результат существенно зависит от того, на- насколько близки уровни энергии A0? и е либо 1,1 ? и е), например, двух разъединенных атомов, т.е. двух невзаимодействующих подсистем. Следовательно, второе условие сводится к близости уровней полной энергии или орбитальных энергий у соответствующих "крайних" под- подсистем, отвечающих предельной геометрии системы. Возьмем в качестве примера двухатомную молекулу ВЫ. Для построения орбитальной корреляционной диаграммы требуются ве- величины орбитальных энергий разъединенных атомов Н и В, а также объединенного атома, которым в данном случае служит атом С. Эти орбитальные энергии представлены в таблице (см. следующую страницу), содержащей также данные и для других атомов. При рассмотрении орбитальных энергий можно установить, что молекулярная орбиталь 1а по существу останется практически неизменной орбиталью 15 атома В, а орбитали 2а, За и 4а будут представлять собой линейные комбинации 1$н, 2$в и 2р2в > тогда как орбитали 2/>дв и 2py& приведут к образованию двукратно вырожден- вырожденной л-орбитали. В основном состоянии заполненными будут орбита- орбитали молекулы 1а, 2а и За, что дает электронную конфигурацию 316 1а22а23а2 и однодетерминантную функцию типа 2+. При этом 1а15в;(в лв) - \sH, где X < 1 , функции даны в ненормированном виде, а коэффици ент перед орбиталью lsH ™шь примерно равен единице (ось z на правлена от В к Н). Атом и электронная конфигурация НA5) Не (Is2) U(\s22s) \s 2s Be(\s22s2) \s 2s B(\s22s22p) \s 2s 2p Орбиталь- Орбитальные энергии (a. e.) -0,500 -0,918 -2,478 -0,196 ^,376 -0,309 -7,695 -0,495 -0,310 Атом и электронная конфигурация C(\s22s22p2,3P) \s 2s 2p N(\s22s22p\*S) \s 2s 2p O(\s22s22p\3P) \s 2s 2p Орбиталь- Орбитальные энергии (a. e.) -11,326 -0,706 -0,433 -15,62 -0,935 -0,551 -20,67 -1,230 -0,605 Объединенный атом для молекулы ВЫ - атом углерода. Срав- Сравнение орбитальных энергий при R —* 0 и при R-^oo показывает, что энергия la-орбитали при сближении атомов В и Н должна сильно понижаться, энергия 2а-орбитали понижается (от -0,5 до -0,7 а.е.), а энергия За-орбитали слабо повышается (до -0,4 а.е.). Получающаяся в итоге корреляционная диаграмма представлена на рис. 6.4.1. Для гомоядерных двухатомных молекул, например молекулы Li2, появляется еще один элемент симметрии: а/, (либо инверсия), что приводит к дополнительной классификации орбиталей nog- и и- типам симметрии. Отметим лишь в заключение этого пункта, что при введении взаимодействия двух подсистем, при переходе от двух атомов к двух- двухатомной молекуле меняются, конечно, и диагональные матричные элементы Н\\ и Н22 (в том же самом двухуровневом приближении). Однако поскольку матричные элементы Н\\ и Н22 по своей природе носят в данном случае существенно атомный характер (т.е. опреде- определяются подсистемами), то этими изменениями мы пренебрегли. 317
m г. Общее замечание. Корреляционные диаграммы играют важную роль при качественном анализе свойств и поведения различ- различных двух- и многоатомных молекул. Связано это прежде всего с тем, что результаты квантовохимических расчетов необходимы в ос- основной своей массе не для знания точных величин тех или иных свойств молекул, а для сравнительного анализа поведения этих вели- величин при переходе от одной молекулы к другой, при переходе от одной -2 1.У —8 в объединенный атом ¦*- R В + Н Рис. 6.4.1. Корреляционная диаграмма для молекулы ВН. изомерной формы к другой и т.п. Такой анализ опирается на систему определенных корреляций, графически представляемых корреляци- корреляционными диаграммами. В целом вся химия представляет собой в су- существенной степени корреляционную науку. Начиная, по крайней мере, со времен появления периодического закона, а далее при сравнитель- сравнительном анализе термохимических и термодинамических величин, при сравнительном анализе реакционной способности, при введении раз- различных корреляционных соотношений типа соотношений Гаммета и 318 т.п. - всюду вводятся всего лишь определенные корреляции, позво- позволяющие переходить от одного химического соединения к другому, от одного свойства к другому, от исходных реагентов к продуктам реак- реакции и т.д. Сами по себе эти корреляции не зависят от того, найдены ли они чисто эмпирически, или на основании теоретических сообра- соображений. Тем не менее, при их поиске всегда полезно иметь некую еди- единую теоретическую конструкцию, служащую основой и обеспечива- обеспечивающую направление такого поиска. Во многих случаях именно такой конструкцией и является квантовая химия, обеспечивающая к тому же и обоснование многих эмпирических закономерностей. Задачи 1. Рассмотреть на основе теории возмущений Релея-Шредин- гера изменение уровней энергии (во втором порядке) и волновых функций (в первом порядке) в трехуровневой задаче с гамильтонианом Н - Я и а а \ Н 22 н зз для следующих случаев: все три уровня невозмущенной задачи (ког- да а = Ъ - с * 0) близки; два уровня близки, третий удален от них; все три уровня далеки друг от друга. 2. Построить корреляционные диаграммы для молекул LiH, LiHe, LiB и Ве2. (Орбитальные энергии для атомов приведены в таблице пункта д). 3. Можно ли сказать что-либо о симметрии орбиталей молеку- молекулы Нз и иона Нз , если использовать базис из трех ls-функций (по одной на каждом центре) и неограниченный метод Хартри-Фока для нахождения молекулярных орбиталей? Рассмотреть задачу в прибли- приближении нулевого дифференциального перекрывания (конфигурация ядер имеет симметрию точечной группы a) D3/,, б) C § 5. Методы функционала плотности о. Энергия как функционал матриц плотности. Практи- Практически с самого начала использования квантовой механики для атом- атомных и молекулярных задач возникла мысль о нахождении таких урав- уравнений, которые содержали бы не волновые функции, зависящие от 319
переменных всех электронов системы, а более простые функции, за- зависящие от переменных максимум двух электронов. Основанием для построения таких уравнений служило то, что электронный оператор Гамильтона может быть записан в виде суммы одно- и двухэлект- ронных слагаемых (не считая потенциал межъядерного взаимодей- взаимодействия, который от электронных переменных вовсе не зависит): F.5.1) а F.5.2) Как следует из принципа неразличимости тождественных частиц (электронов) и как видно непосредственно из представленных выра- выражений, аналитически все одноэлектронные слагаемые одинаковы и различаются лишь индексами электронов; то же самое справедливо и для двухэлектронных слагаемых. Выражение для электронной энер- энергии при этом имеет вид: - Г- -1 dxxdx2, F.5.3) где р(г',г)иГ(г1',Г2;г1г2) - так называемые матрицы плотности первого и второго порядка, определяемые равенствами: ,r2,...,r^; o)dr2...drNdo, F.5.4) p(r',r) = N ГЧ** (г, J 19г29т3,...9г#9 o]dr3...drNdo. F.5.5) Символ [...]= означает, что после действия оператора на матрицу плотности штрихованные переменные заменяются на нештрихованные, и только после этого проводится интегрирование по переменным либо одного, либо двух электронов. В интегралах D) и E) индекс а обозначает набор спиновых переменных всех электронов, причем по всем этим переменным (индексам) проводится интегри- интегрирование в обычном для таких переменных смысле. Для двухэлектронной части фактически требуется лишь знание диагональной части матрицы плотности, т.е. знание функции Г(Г|? г2; г1? г2), так что с учетом этого обстоятельства выражение 320 F.5.6) для энергии может быть записано в более простом виде: E=f[h(r)p(rf,r)]=dr+f\rx -г1 Таким образом, электронная энергия представляет собой фун- функционал матрицы плотности первого порядка и диагональной части матрицы плотности второго порядка. б. Теорема Хоэнберга - Кона. В 1964 г. П. Хоэнберг и В. Кон высказали более сильное утверждение о том, что для основного состо- состояния энергия является функционалом лишь электронной плотности: Е = Е[р(г)]9 F.5.7) так что разные потенциалы порождают разные плотности. Указать, однако, конкретную (аналитическую) форму этого функционала на основе имеющихся доказательств данного утверждения, носящего название теоремы Хоэнберга- Кона, не представляется возможным. В силу существенности этой теоремы остановимся на про- простом её доказательстве. Пусть имеется два разных электронных опе- оператора Гамильтона, отвечающих системам с одним и тем же числом электронов и соответствующих ядер, так что Н, = Т+ V, = Г+ У2 + (уг - У2) = Н2 + (V, - У2) . F.5.8) Кроме того, пусть 4х] и х?2 суть функции основных состояний систем с гамильтонианами Нх и Н2 соответственно. Разность W = Vx - V2 не содержит операторов кинетической энергии и операторов межэлектронного взаимодействия, она определяется только различием во внешних для данной системы одночастичных потенциалах (связанном, например, с различием ядерных конфигура- конфигураций) и зависит лишь от этих потенциалов. Согласно вариационному принципу (в общем случае 4х] не яв- является собственной функцией Н2, а Ч^ - собственной функцией Нг): 1>, (а) } = <Ч>2|#2 + УУ|Ф2> = Е2 + <4*2\W\4*2>. (б) Коль скоро W есть сумма разностей одноэлектронных операторов, представляющих действие внешнегого поля (например ядер) на каждый из электронов в гамильтонианах Нj и Н2'. то <4>2\W\4>2 >=Jp2(r)V(r)c/r. II — 1395 321
Если взять теперь сумму соотношений (а) и (б), то после небольших преобразований придем к неравенству: j[Pi(r)-P2(r)]V(r)drbO, которое показывает, что для области ?2, где потенциал V(r) отличен от нуля, найдется такая принадлежащая ей подобласть, в которой Р](г) * Р2(г)> что и доказывает исходное утверждение теоремы. Следует подчеркнуть, что доказательство опиралось на вариационный принцип, а потому справедливо в представленной формулировке только для основных состояний. в. Методы, основанные на использовании функционалов плотности. Задолго до появления теоремы Хоэнберга - Кона пред- предпринимались многочисленные попытки свести, хотя бы приближен- приближенно, электронную энергию основного состояния к такому выражению, которое зависело бы непосредственно только от электронной плотно- плотности, т. е. было бы функционалом электронной плотности. При этом прежде всего исходили из приближения Хартри - Фока, когда выра- выражения для матриц плотности после интегрирования по спиновым пе- переменным записываются в следующем виде: N 1-1 /f=i Г(г1',г^;г1,г2)= N- Р ~ 1 N F.5.10) В этих выражениях ср, и фу - орбитали, входящие в определитель Слэ- тера, стрелки Т и | указывают на та, что орбитали входят в опреде- определитель со спин-функциями аир соответственно; число орбиталей со спин-функциями а равно/?, со спин-функциями C равно N-p. Для диагональной части матрицы плотности второго порядка, 322 которая как раз и требуется для вычисления двухэлектронных интег ралов, получим: - p(ri) i, r2) pf(r2, ? r2) p (r2, F.5.1 где N . F,5.12) Pt(ri,r2)= ^ При использовании этих обозначений выражение для энергии приоб- приобретает следующий вид: Е = f[h(r)p(r',r)]jr + J|ri - г,] {р(Г1)р(г2) - (r1?r2)pt F.5.13) Первое слагаемое в двухэлектронной части уже выражено через элек- электронную плотность. А для двух последующих слагаемых, носящих название обменно-корреляционных членов1 была предложена следу- следующая замена: F.5.14) Одноэлектронные потенциалы VxAr{) и Vx (*i) оказалось возмож- возможным оценить для такой конкретной системы, как свободный элект- электронный газ, т. е. для системы электронов, находящейся в некотором объеме в отсутствие внешнего потенциала. В зависимости от исполь- использованного для оценки подхода были получены выражения вида 1/3 1/3 а числовой множитель а оказался лежащим в пределах от 1 до 2/3. 1 Название связано с тем, что помимо обычных обменных членов в выражении для энергии хартри-фоковского приближения эти слагаемые содержат интегралы вида ri- -ф)(Г1)ф*(г1)ф1(г2)ф|0 исключающие из кулоновской части энергию взаимодействия электрона с самим собой. II 323
Уравнения Хартри - Фока (см. §§ 1 и 2) для орбиталей ф можно теперь представить следующим образом: , F.5.16a) r - r -lp(r')dr' - VXai (r)L4 (r) = гцсрп (г). F.5.166) Потенциалы A5) совместно с дополнительными модельными кон- конструкциями , определяющими вид орбиталей, были широко использо- использованы для построения так называемых Ачх-приближений. Не останав- останавливаясь на них детальнее, отметим лишь, что подлинного расцвета подходы, основанные на введении потенциалов Vx. и Vx, , достигли лишь тогда, когда начались поиски более общих и более точных вы- выражений для этих потенциалов. Во всех рассмотренных случаях при выполнении соотношений A4) электронная энергия становилась фун- функционалом электронной плотности и не зависела ни от недиагональ- недиагональных элементов матрицы плотности первого порядка, ни от матрицы плотности второго порядка. По этой причине методы нахождения электронной волновой функции, основанные на введении потенциалов типа A5) вместо потенциалов, отвечающих обменным операторам У^1^1 [см. F.1.12)], получили название методов функционала плотности. Потенциалы Кх. и Vx, более сложного вида могут зависеть не только от электронной плотности, как таковой, но и от её градиента. Фактически это означает, что обменно-корреляционная энергия Ехс, определяемая соотношениями A4), представляется в виде ряда по степеням смещений истинной плотности от плотности, отвечающей свободному электронному газу, причем в этом ряду считаются отличными от нуля не только первые члены с потенциалами вида A5), но и следующие члены с первыми производными плотности: F.5.17) где символы о их соответствуют спин-функциям аир, т.е. стрелкам f и | , а коэффициенты Ст либо постоянны, либо являются слабо меняющимися функциями плотностей р и р . 324 Следует, однако, подчеркнуть, что точные аналитические вы- выражения для обменно-корреляционных потенциалов Vx (гг) и Vx (rj) не известны. По этой причине часто для этих потенциалов пользуют- пользуются выражениями, содержащими то или иное число подгоночных па- параметров, которые далее определяют, например, на основе сопостав- сопоставления с экспериментальными данными. Такой подход привел к появ- появлению очень большого числа разновидностей метода функционала плотности и к большому числу программ, реализующих эти разно- разновидности. Тем не менее, самым существенным обстоятельством в рамках метода функционала плотности является зависимость выра- выражений для энергии лишь от электронной плотности, что, в свою оче- очередь, означает возможность решать задачу практически независимо от числа электронов. Другими словами, метод может быть исполь- использован и для протяженных молекулярных систем, и для систем, вклю- включающих тяжелые атомы. Детальные теоретические исследования показали, что в рам- рамках метода функционала плотности, несмотря на исходное одноэлек- тронное приближение, в большей или меньшей степени (в зависимос- зависимости от аппроксимации обменно-корреляционной энергии) могут учи- учитываться и корреляционные поправки, связанные с выходом за рамки одноэлектронного приближения. Это обстоятельство в какой-то мере определяет то, что в рамках лучших вариантов метода функционала плотности очень часто получаются весьма хорошие результаты.
Глава VII Дальнейшие упрощения при решении электронной задачи § 1. Полуэмпирические методы квантовой химии в приближении НДП При рассмотрении многих задач квантовой химии, прежде всего - задач о многоатомных молекулах, часто используют полуэм- полуэмпирические методы, под которыми подразумевают обычно все те, в которых вводятся параметры, определяемые из экспериментальных данных. При этом в число таких параметров не включаются фунда- фундаментальные постоянные и данные о геометрической конфигурации ядер молекулы. а. Нулевое дифференциальное перекрывание. Основой мно- многих полуэмпирических методов служит приближение Хартри-Фока в некотором фиксированном для выбранных задач базисе, дополнен- дополненное двумя предположениями: - о возможности введения нулевого дифференциального пере- перекрывания в том или ином его варианте; - о возможности определения части или всех молекулярных интегралов, остающихся после введения НДП, из сравнения резуль- результатов расчета с экспериментальными данными по некоторому набору опорных соединений. Рассмотрим в качестве иллюстрации построения подобных подходов один из самых простых (и самых грубых) вариантов: метод полного пренебрежения дифференциальным перекрыванием, сокра- сокращенно ППДП (англ. complete neglect of the differential overlap, CNDO). В этом методе нулевое дифференциальное перекрывание вводится для любой пары базисных орбиталеи: G.1.1) причем запись именно в таком виде подчеркивает, что НДП вводит- вводится только в подынтегральных выражениях. В предшествующей главе 326 было сказано, что это приближение, как правило, должно быть впол- вполне удовлетворительным при больших расстояниях между теми цент- центрами, с которыми связаны базисные функции Хм и Xv* При малых расстояниях, в том числе и для двух функций на одном и том же центре, такое приближение является доволно грубым. Не будем, од- однако, пытаться доказывать, что оно все-таки имеет некоторый, хоть и весьма зыбкий фундамент. Будем исходить лишь из простого поло- положения: давайте попробуем, а если получится совсем плохо, то либо отбросим этот подход полностью, либо попытаемся его уточнить. Итак, вводим полное пренебрежение дифференциальным пе- перекрыванием и для определенности считаем, что для исследуемого класса молекул можно использовать ограниченный метод Хартри- Фока для систем с замкнутыми оболочками. Начнем конкретное рас- рассмотрение с диагонального матричного элемента фокиана: N12 X > = u\ = <x, R G.1.2) N12 где РуЬ =2 У с^с1ь . В приближении НДП интеграл /=1 нулю, если у * 6, а интеграл <щ B) можно переписать так: = 0, если 6 * \i и у * равен . Поэтому = < R \i lv 1 G.1.3) Выделим теперь в правой части C) те члены, которые относятся толь- только к ядру, на котором центрирована функция х . Для того, чтобы запись стала более прозрачной, обозначим ядра большими буквами: орби- таль [I центрирована на ядре М; ^ означает, что суммирование ведется по всем тем индексам орбиталеи, которые центрированы на 327
ядре М; 2, означает, что суммирование ведется по индексам орби- Y^M талей, центрированных на ядрах, отличных от М. Теперь C) можно переписать так: -Ад-2м в 1 2 . G.1.4) Здесь Jy - кулоновский оператор на орбитали =J Г12 Если бы орбитали х^ были обычными каноническими атом- атомными орбиталями, получаемыми при решении хартри-фоковской задачи для каждого атома М, то первый интеграл в правой части D) совпадал бы в приближении НДП с диагональным матричным 1 7 элементом атомного фокиана F, A) = - - Д - м +VP / еспи т Иv > ~ п ^ YY Y ' ссли _ ^ *ЧМ y оы к тому же Рп(у ?М,у ^ ц) совпадали с соответствующими атомными величинами. А такой диагональный матричный элемент есть не что иное, как орбитальная энергия е , отвечающая орбитали Хц и равная, согласно теореме Купманса, атомному потенциалу ионизации /ц , взятому с обратным знаком. Таким образом, выражениеD) упрощается до следующего: 1 1 рп < MY MY > - < в R 1В G.1.5) т.е. диагональный матричный элемент F^ содержит эмпиричес- эмпирический параметр /ц , относящийся к атому М, а также весьма неболь- небольшое число двухэлектронных интегралов вида <цу | ЦУ> О том числе и при у = ц) и одноэлектронных интегралов взаимодействия элек- электрона, распределенного в пространстве с плотностью х* A)Х A)> со всеми ядрами, отличными от ядра атома М. 328 Недиагональный матричный элементF^v можно также упростить с учетом нулевого дифференциального перекрывания: 1 1 2 — 2 В Л1В _ Y_~b_ R ^*1 R V> v> \ р (< л УМ' 1 G.1.6) Исходя из общей идеи нулевого дифференциального перекры- перекрывания, первое слагаемое в правой части F), казалось бы, надо поло- положить равным нулю. Правда, в этом слагаемом присутствует член вида Хц (~ ~ д)Ху , о котором никаких специальных соглашении пока нет. Можно было бы думать, что выполнение равенства Хц Xv^i = О влечет за собой в какой-то степени и выполнение соотношения Х^ A)А XvO^Ti = 0 9 однако это не так, поскольку первое из этих со- соотношений является весьма приближенным. Поэтому все первое сла- слагаемое не оценивается, а рассматривается как некий единый пара- параметр, определяемый парой центров, с которыми связаны функции х^ и Xv: (Vv^v ' гДе 5^v ~ интеграл перекрывания <Хц|хУ>' вычисляе- вычисляемый с заданными базисными функциями (при этом нулевое диффе- дифференциальное перекрывание не используется!), а C - эмпирический параметр, о структуре которого речь пойдет позднее. Прежде чем завершить построение намеченной выше расчетной схемы, остано- остановимся на двух весьма важных для этого завершения моментах. б. Валентное приближение. Полуэмпирические методы, в том числе и методы типа ППДП, обычно развиваются в рамках ва- валентного приближения, под которым подразумевается следующее. Для каждого атома, из которых конструируется молекула, в одно- электронном приближении получается система атомных орбиталей и орбитальных энергий, которые могут быть охарактеризованы такой же системой квантовых чисел, что и у атома водорода: главным кван- квантовым числом л, определяющим число узлов у радиальной волновой функции (это число равно п - 1); орбитальным / и магнитным т кван- квантовыми числами, определяющими структуру угловой части одноэлек- тронной волновой функции, и спиновым квантовым числом 5 = 1/2. Орбитальные энергии задаются значениями п и / (в отсутствие учета спин-орбитального взаимодействия, см. следующую главу). По зна- значениям этих энергий орбитали, встречающиеся в конфигурационной 329
функции состояния атома, располагаются следующим образом: сна- сначала идут двукратно заполненные орбитали, отвечающие замкнутым оболочкам, причем электронная плотность для орбиталей этих обо- оболочек в существенной степени сосредоточена вблизи ядер. Так, если вспомнить водородоподобные атомы, то для орбитали Is наиболее вероятное расстояние электрона от ядра равно a^lZ, где а0 ~ борове- кий радиус («0,529 A), Z - заряд ядра, так что для атома углерода, если подобная оценка годится, это расстояние будет «0,09 А, а для атомов с большими величинами Z - и того меньше. Эти орбитали с наиболее низкими каноническими орбитальными энергиями для более высоких по энергии орбиталей играют роль своего рода оболочки, экранирующей ядро атома. Орбитали с более высокими энергиями в хорошем приближении могут быть получены как решения задачи, в которой электроны низших орбиталей отсутствуют, а вместо истин- истинного заряда Z ядра используется некий эффективный заряд Z*, при- примерно равный Z за вычетом числа электронов на низших по энергии орбиталях (лучше было бы говорить о сильно локализованных вбли- вблизи ядра орбиталях, но между такой степенью локализации и канони- канонической орбитальной энергией существует вполне четко прослежива- прослеживающееся однозначное соответствие). Низшие по энергии, сильно ло- локализованные орбитали называются обычно остовными орбиталя- ми, а более высокие - валентными. Название "валентные" связано с тем, что именно эти атомные орбитали служат основой построения молекулярных орбиталей, дают в них главный вклад, тогда как остовные орбитали при образовании молекулы из атомов в существен- существенной степени сохраняют свой атомоподобный характер. Если при рас- рассмотрении молекулярных задач в качестве базиса берутся лишь ва- валентные орбитали, а остовные орбитали учитываются лишь косвен- косвенно - через эффективные заряды ядер атомов, то такое приближение и носит название валентного. Так, для атомов второго периода в качесте остовной исполь- используют двукратно заполненную орбиталь ls-типа, тогда как для атомов третьего периода остов дополняется орбиталями 2s- и 2р-типа. Та- Такое подразделение на остовные и валентные орбитали достаточно условно, особенно для тяжелых атомов; оно может быть проведено подчас по-разному, в зависимости от поставленной задачи с включе- включением меньшего или большего числа орбиталей в число валентных. Влияние остовных орбиталей может быть учтено и более точ- точно, если вместо эффективных зарядов вверти некоторые фиксирован- 330 ные пространственные распределения зарядов остовных электронов. Такие пространственные распределения задают потенциалы, в кото- которых движутся валентные электроны, что приводит к построению раз- различного рода методов с модельными потенциалами либо с некото- некоторыми так называемыми псевдопотенциалами, учитывающими наличие остовных электронов и согласуемыми в ходе решения задачи с рас- распределением валентных электронов. Не следует, конечно, думать, что подразделение орбиталей и соотносимых с ними электронов в какой-то мере нарушает принцип неразличимости электронов: как и для однодетерминантной функции в целом, мы получаем лишь, что та или иная составляющая электрон- электронного распределения молекулы моделируется некоторой (приближен- (приближенной) функцией, тогда как оставшаяся часть рассматривается более детально, например на основе орбитальной картины. Получаемый же результат не зависит от какой-либо нумерации электронов, а зависит лишь от того, сколько электронов отнесено к одной части и сколько - к другой. в. НДП и инвариантность системы молекулярных ин- интегралов. Среди базисных функций (атомных орбиталей) встреча- встречаются, как правило, те, которые преобразуются по вырожденным пред- представлениям группы вращений для данного конкретного атома, например />-, d- ил и/-орбитали. Это означает, что выбор осей Ох9 Оу, Oz и задание, скажем, тройки орбиталей/^ ,ру ир2, непосредственно связанных с данными осями, для каждого атома в отдельности не должны влиять на окончательные результаты квантовохимических расчетов. Однако в рамках изложенной схемы НДП это не так. Дей- Действительно, возьмем два атома А и В, принадлежащих, например, атомам второго периода, так что в валентном приближении для них надо будет использовать орбитали 2sд, 2рд, 2sg и 2pg, в обозначении которых ради простоты цифру 2 будем далее опускать. В качестве тройкир-орбиталей на центре А можно выбрать орбитали/^ ,ру ирг либо, с равным правом, орбитали рх,ру ИР2, связанные с осями Ох,Оу иОг, получающимися при повороте исходной системы на угол ф вокруг оси у (так что Оу = Оу). Орбитали р связаны с орбиталя- мир соотношениями: Рх = Ру = р ~ Ру G.1.7) 331
Рассмотрим теперь молекулярный интеграл <sB рхА sB pzA >, равный в приближении НДП нулю, а в то же время при подстановке в него соотношений G) записывающийся следующим образом: О = <sBp = [-<sBpxA\sBpxA> xA \z BxA + <sbPza\ sbPza>1 sincpcoscp + <sBpxA | sBpzA>cos2y. Последнее слагаемое с интегралом <sBpxA \ sBpzA> также должно быть принято равным нулю в силу приближения НДП, а коль скоро угол ф произволен, то это должно означать, что в этом прибли- приближении следует принять справедливость равенства <sbPxA I sbPxA> = <sbPzA I sbPzA> G.1.8) вне зависимости от выбора осей системы координат. Если к тому же орбитали 2sA и 2рА суть орбитали слейтеров- ского типа с одним и тем же экспоненциальным множителем, например 25д = 1 и 1 (аналогично для 2рхА и 2руА), то в этом случае, как нетрудно убе- убедиться, сумма трех интегралов <$врад | sBpaA> с а = лс, у и z будет равна утроенному интегралу <sBsA | sBsA>. Именно это приближение <sbPxA\sbPxA>== <sBPyA sBPyA> = <sBPzA sbPzA> я ¦ = <5в5а|5в5а> G.1.9) и используют в большинстве расчетных методов, базирующихся на идее о НДП, причем не только в таких интегралах, но и в других подобных, например в интегралах 1 R 1А PzA > = < 1 R 1А г. Методы ППДП/1, ППДП/2 и другие. После замечаний двух предшествующих пунктов можно вернуться к построению конк- конкретных выражений для матричных элементов фокиана. Итак, будем рассматривать задачу в валентном приближении, например для атомов второго периода. Для диагонального матричного элемента F^ фоки- фокиана в этом случае можно написать следующее выражение: 332 2 где Рв = УРуу (так называемый заряд на атоме В), уев YMM = <2sM 2sM YMB = <25 М и, наконец, VMB = <2s м R IB 2sM >. Для недиагонального матричного элемента получается сле- следующее выражение (для орбиталей одного центра F^v = 0): = PmnS1iV-^uvYmn(^v;M*N). G.1.11) Эти формулы были первоначально введены в рамках прибли- приближения ППДП/1 с тем лишь исключением, что в A0) вместо \Р^ использовалась величина/*м - ^^мм • При этом достаточно быстро было выяснено, что вместо / в диагональном матричном элементе лучше использовать полусумму потенциала ионизации и соответству- соответствующего сродства к электрону: (/ + Аи)/2, вместо величины Рм - ^ Р v имеет смысл взять величину (Рм - ZM ) - \ (Лш ~ 1) = (^м + 2 ~~ -Zl<) - \Pt,t, , что, как нетрудно заметить, лучше соответствует использованному выше построению, а вместо величины Кмв ввести величину ZbYmb- Получаемые при этом формулы для матричных элементов имеют вид /.. + А, \Щ мм G.1.12) " (jv = ~~ ~2 M-v причем параметры PMN, естественно, в общем случае имеют другие значения, чем в схеме ППДП/1. Более того, они имеют разные зна- значения в зависимости от того, по каким свойствам проводится пара- параметризация, т.е. проводится определение этих величин. Формулы A2) 333
представляют матричные элементы фокиана в методе ППДП/2, пред- предложенного Дж. Поплом и Дж. Сигалом в 1965 г. Параметры CMN в рамках обсуждаемых полуэмпирических методов обычно записыва- записываются как полусумма двух параметров, каждый из которых относится к одному атому: Pmn = г (Рм + Pn)- Эти параметры при первоначальном построении метода ППДП/2 были определены из сравнения результатов расчетов ряда двух- и трехатомных молекул, прежде всего - разностей орбитальных энергий, с данными неэмпирических расчетов этих молекул. Разности орбитальных энергий брались по той причине, что абсолютные вели- величины этих энергий зависят от выбора начала отсчета для энергии, а это начало в неэмпирических методах, учитывающих все электроны, и в полуэмпирических методах, опирающихся на валентное прибли- приближение, различно. Для того, чтобы понять, каков порядок разных параметров в методе ППДП/2, приведем следующие цифры [энергии - в эВ, ? - в (атомная единица длины)]: Элемент С N О (/й + Лц)/2 |i = 2s 14,05 19,32 25,39 (/ц + ЛУ2 \х = 2р 5,57 7,28 9.11 1,625 1,950 2,275 Pmn 21 25 31 В начале 70-х годов появились работы по определению пара- параметров для атомов переходных металлов и вообще атомов элементов третьего и четвертого периодов. Возникло множество различных па- параметризаций в рамках более или менее единой схемы ППДП/2, но с некоторыми вариациями. Были введены параметризации Фишера - Кольмара A969), Бойда - Вайтхэда A972) и ряд других, приспособ- приспособленных для расчета тех или иных свойств молекул. В различных сво- своих вариантах этот метод быстро завоевал популярность, был исполь- использован для расчета очень большого числа соединений, что позволило весьма хорошо понять его достоинства и недостатки, а после этого периода расцвета в связи с развитием вычислительной техники и раз- разработкой новых, более совершенных полуэмпирических схем он стал постепенно вытесняться такими методами, как ЧПДП (частичное пренебрежение дифференциальным перекрыванием, англ. INDO, intermediate neglect of the differential overlap), МЧПДП/3 (т.е. третья 334 версия метода модифицированного частичного пренебрежения диф- дифференциальным перекрыванием, англ. MINDO, modified INDO), AM 1 (первая версия остинской модели, англ. Austine Model), PM3 и т.п. В настоящее время из полуэмпирических методов этой группы наибо- наиболее популярны МЧПДП/3, AMI и РМЗ, в которых используется пара- параметризация по термохимическим данным, а также метод МПДП (модифицированное пренебрежение дифференциальным перекрыва- перекрыванием, англ. MNDO, modified neglect of the differential overlap). Bee эти методы были разработаны в коллективе, возглавляемом извест- известным специалистом в области органической и квантовой химии Майк- Майклом Дьюаром (Чикаго, США), перу которого принадлежит весьма известная книга "Теория молекулярных орбиталей в органической химии", переведенная на русский язык в 1972 г. в издательстве "Мир". Мы не будем останавливаться на каждом из этих методов. Отметим лишь, что метод МПДП, предложенный в 1977 г., основы- основывался на довольно детализированной схеме пренебрежения двухатом- двухатомным дифференциальным перекрыванием (когда в произведении X* A)х A) индексы |х и v относятся к разным центрам) и позволил заметно расширить круг доступных для расчета соединений. Его па- параметризация также в существенной степени опиралась на термохи- термохимические данные. д. Конфигурационное взаимодействие. Как уже говорилось, представленные выше методы построены на основе одноэлектрон- ного приближения. Системы параметров для каждого из них адапти- адаптированы к соответствующей расчетной схеме, а потому при переходе к многоконфигурационным приближениям результаты не должны обя- обязательно улучшаться. С другой стороны, есть ряд таких свойств, при расчете которых необходимо использовать различные конфигураци- конфигурационные функции состояния. Прежде всего к их числу относятся час- частоты первых, наиболее длинноволновых переходов и соответствую- соответствующие интенсивности. Для того, чтобы иметь возможность рассчитать подобные свойства, были предложены различные полуэмпирические схемы, учитывающие многоконфигурационный характер волновых функций. Для примера упомянем метод ППДП/С (С - спектроскопи- спектроскопическая параметризация), введенный в 1968 г. Дж. Дель Бене и X. Джаффе. В этом методе двухцентровые интегралы межэлектронно- межэлектронного взаимодействия оцениваются по методу заряженных сфер, когда каждая р-орбиталь заменяется двумя заряженными сферами, каса- касающимися в точке расположения соответствующего ядра (рис. 7.1.1), 335
.':*'(¦ причем энергия отталкивания сфер вычисляется по весьма простым формулам; одноцентровые интегралы межэлектронного отталкива- отталкивания полагаются равными <цц | цц> = / - А , а также вводится ряд других отличий от стандартной процедуры ППДП/2. В то же время, хотя и весьма ограниченно, учитывается конфигурационное взаимо- взаимодействие на конфигурациях, однократно возбужденных по отношению к конфигурации основного состояния. Как правило, ошибки частот первых переходов при использовании этого метода составляют вели- величины порядка нескольких десятых электрон-вольта. Тем не менее, порядок расположения по энергии низших возбужденных состояний метод передает обычно правильно. -ей -е/2 Рис. 7.1.1. Моделирование/?-орбитали двумя заряженными сферами. Учет однократно возбужденных конфигураций с использова- использованием приближения заряженных сфер был присущ и методу Паризе- ра-Парра-Попла (ППП), предложенному еще в 1953 г. для расчета энергий возбуждения л-электронных систем (о л-электронах см. § 3 настоящей главы). е. Возможности полуэмпирических методов приближе- приближения НДП. О возможностях этих методов, как правило, приходится судить по многочисленным результатам расчетов на их основе. Час- Частично, однако, можно судить и по самой конструкции того или иного метода, а также по тому, какие экспериментальные данные были ис- использованы для параметризации. О методе ППДП/1 говорить не будем, поскольку он для рас- расчетов практически не использовался. Метод ППДП/2 воспроизводит равновесные межъядерные расстояния с точностью в несколько де- десятых ангстрема, что, конечно, нельзя считать хорошим результатом. В то же время он с точностью 1°-3° воспроизводит валентные углы, что связано с сильной зависимостью интегралов перекрывания 336 входящих в недиагональные матричные элементы фокиана, от взаимной ориентации соответствующих атомов. Удовлетворительные результаты этот метод дает и при расчетах потенциальной поверхно- поверхности вблизи положения равновесия (в частности, величин вторых производных электронной энергии по геометрическим параметрам, вычисленным в минимуме потенциальной поверхности, т.е. так называемых силовых постоянных), а также при расчетах констант магнитного экранирования ядер электронами. В то же время расчеты энтальпий атомизации и потенциалов ионизации с исходной парамет- параметризацией дали весьма неудовлетворительные результаты, что приве- привело к тому, что при построении, например, модифицированного варианта метода X. Фишером и X. Кольмаром были введены дополнительные параметры (в недиагональные матричные элементы), определяв- определявшиеся по термохимическим данным. Методы типа РМЗ и МПДП позволили создать расчетые схе- схемы, дающие, как правило, хорошие результаты (т. е. близкие к наибо- наиболее точным экспериментальным результатам) при вычислении эн- энтальпий образования и потенциалов ионизации различных соединений, а также при вычислении относительной стабильности различных изо- изомеров и конформеров молекул (где метод ППДП/2 давал часто про- просто абсурдные результаты). Более того, эти методы приводили во многих случаях к правильным результатам и при анализе переходных состояний в различных реакциях органических соединений. Правда, были и отдельные исключения (например, появление асимметричного переходного состояния в реакциях циклоприсоединения в отличие от того, что давали неэмпирические расчеты), но их было не слишком много. В то же время методы типа МЧПДП оказались непригодными при рассмотрении соединений с водородными связями и при расчете барьеров внутреннего вращения в ненасыщенных соединениях. От- Отчасти эти недостатки удалось снять при переходе к методу МПДП, который точнее воспроизводит относительную стабильность изоме- изомеров соединений с двойными и тройными связями, последовательность расположения по энергии орбиталей различных типов (что сущест- существенно при анализе фотоэлектронных спектров), величины барьеров внутреннего вращения и другие характеристики. И хотя на сегодняшний день все в большей степени становятся доступными неэмпирические расчеты достаточно сложных систем, все же роль полуэмпирических методов, в том числе и базирующих- 337
ся на приближении НДП, остается весьма существенной как для пер- первоначальной оценки, так и для проведения оценок на качественном уровне, где не требуются результаты высокой количественной точно- точности. Характерная особенность полуэмпирических методов, представ- представленных в настоящем и последующих параграфах, состоит в том, что они сохраняют основную структуру неэмпирических конструкций, сохраняют свойства симметрии рассматриваемых объектов, экви- эквивалентность отдельных фрагментов в них и многие другие характе- характеристики, что позволяет, особенно при весьма осторожном отношении к расчетным результатам этих методов, получать качественно пра- правильные заключения об особенностях отдельных соединений и про- проводить их сравнение. ж. Валентное состояние. С валентным приближением тесно связано и представление о валентном состоянии атомов в молекулах, которым одно время активно увлекались; в настоящее время этот интерес заметно спал прежде всего по причине искусственности са- самой конструкции. Идея валентного состояния возникла из следующих сообра- соображений. Атом углерода в основном состоянии ^Р имеет электронную конфигурацию Is22s22p2, тогда как при переходе к молекуле метана СН4 необходимо при построении молекулярных орбиталей исполь- использовать наряду с 25-орбиталью все три 2р-орбитали на равных основаниях, т.е. исходить из конфигурации (не выписывая остов Is2 и опуская обозначение главного квантового числа): spxpypz = sp^. Очевидно, что энергия состояний, отвечающих этой конфигурации, выше, чем энергия основного состояния, т.е. для перехода в любое из них требуется затрата энергии. Образующиеся в СН4 химические связи эквивалентны, что позволяет использовать вместо 5- и р- орбиталей 4 эквивалентные гибридные орбитали Al9 /z2, h3 и Л4. Вычисленные для электронной конфигурации hih2h^hA энергии отдельных состояний атома углерода будут такими же, что и для конфигурации sp3. Низшее по энергии состояние атома углерода для таких электронных конфигураций и было названо валентным. В общем случае валентным состоянием атома называется его, как правило, гипотетическое состояние, которое в одноконфигура- ционном приближении соответствует такой системе гибридных атом- атомных орбиталей, входящих в электронную конфигурацию, которая учи- учитывает число образуемых данным атомом химических связей (вклю- (включая их кратность) и эквивалентность всех или части из них. Чтобы не 338 вводить для каждого атома в каждом химическом соединении свое валентное состояние, выделяют несколько типичных валентных со- состояний. Так, для атома углерода выделяют валентные состояния /г4 (все гибридные орбитали эквивалентны), h3p (тригональное располо- расположение трех эквивалентных соседних центров), h2p2 (два эквивалент- эквивалентных соседних центра) и т. п. для других атомов. Представление о валентном состоянии потребовалось для того, чтобы сказать, что при переходе атома, например атома углерода С, в связанное состояние необходимо сначала затратить энергию на воз- возбуждение в валентное состояние (так называемое промотирование электронов на гибридные орбитали), после чего эта затрата с лихвой компенсируется энергией, выделяющейся при образовании химичес- химических связей. Представления о роли валентных состояний одно время привлекали для сравнения прочности различных связей, сравнения прочности химических соединений, выявления близости характера атомов в различных соединениях и т.п. Тем не менее, такая картина хоть и наглядна, но малопродук- малопродуктивна. О валентном состоянии (кроме простейших случаев) можно судить лишь после выполнения квантовохимического расчета, а не до него. В качестве стандартных выбирают некоторые условные ва- валентные состояния, которые (за исключением молекул типа СН4) практически не отвечают тому, что имеет место в действительности. Дальнейшее перечисление таких проблем введения понятия валент- валентного состояния вряд ли целесообразно. Интерес к этому понятию су- существенно снизился за счет двух факторов: не ясно, как его вводить при расширении базиса атомных орбиталей и при учете много конфи- конфигурационного характера волновой функции (используемая подчас за- запись с дробными числами заполнения орбиталей опять-таки облада- обладает своими интерпретационными недостатками). Можно, конечно, попытаться выделить доминирующую конфигурацию и для нее ввес- ввести понятие валентного состояния, либо выделить в базисе те атом- атомные орбитали, которые входят в молекулярные орбитали с наиболь- наибольшими весами. При этом, однако, искусственность конструкции на- настолько возрастает, что ее применение теряет сколько-нибудь значи- значительный смысл. Отметим, что единственной областью, где это понятие в какой- то мере еще продолжает существовать, является область простей- простейших полуэмпирических методов квантовохимических расчетов при использовании минимальных базисов. 339
Задачи 1. Рассмотреть общую структуру расчета в приближении ППДП молекул LiH и СО2. 2. Записать в общем виде диагональные и недиагональные мат- матричные элементы фокиана в приближении пренебрежения двухатом- двухатомным дифференциальным перекрыванием. Как можно было бы ввес- ввести параметризацию для этих матричных элементов? § 2. Расширенный метод Хюккеля Полуэмпирические методы квантовой химии не ограничива- ограничиваются лишь теми, которые базируются на приближении НДП. Среди них есть множество таких, в которых используются иные идеи, хотя подчас и достаточно родственные. а. Простейший метод молекулярных орбиталей. В 1958 г. Г. Дель Ре предложил весьма простой вариант метода молекулярных орбиталей, который сегодня уже практически не используется, однако он послужил предшественником подобного же типа методов, нашедших широкое распространение. В этом методе использован эффективный гамильтониан, представляющий собой сумму одноэлектронных гамильтонианов, конкретный вид которых не определяется. В заданном базисе (обычно в минимальном слейтеров- ском базисе для валентных электронов) матричные элементы такого гамильтониана представляются следующим образом: G.2.1) причем аир- фиксированные параметры метода, а величины е„у и бц определены следующим образом: e^v зависят только от пары ато- атомов, на которых центрированы базисные функции х^ и xv> а от окру- окружения этих атомов не зависят; б„ зависят как от центра ц, так и от соседних центров. При этом 6„ определяются равенством * \Х V" V ' G.2.2) v - центры, соседние с ц где суммирование ведется по индексам v центров, соседних с \i, a 6qn и y^v - табличные параметры, определенные по тем или иным экспериментальным данным, 6^ - неизвестные, определяемые для 340 каждой молекулы из системы уравнений B), выписанных для всех неэквивалентных атомов. Число уравнений равно числу таких неэк- неэквивалентных атомов, т.е. числу неизвестных в этих уравнениях. Основным дальнейшим упрощением было то, что вековое урав- уравнение вариационного метода решалось для пар орбиталей, каждая пара предполагалась соотнесенной с определенной химической свя- связью в молекуле, причем сам по себе метод предлагался для рас- рассмотрения соединений без кратных связей. Видно, что упрощений в методе много, но надо помнить, что он был предложен еще в тот период, когда компьютерной техники в современном ее понимании не существовало. В те годы появилось множество различных простых вариантов метода молекулярных ор- орбиталей, однако ниже мы остановимся лишь на одном из них, кото- который и сегодня имеет достаточно широкое распространение. 6. Расширенный метод Хюккеля. В 1963 г. Р. Хоффман и независимо Дж. Попл и Д. Сантри предложили следующую конструкцию метода молекулярных орбиталей, развитую в рамках валентного приближения (как, впрочем, и другие полуэмпирические методы). Для матричных элементов эффективного гамильтониана в базисе атомных орбиталей, в качестве которых используются обыч- обычно орбитали слэтеровского типа, были введены соотношения: F = f\lv = К (ц * v), если орбитали % и относятся к одному и тому же или к двум соседним центрам; F\iv = 0 во всех остальных случаях. G.2.3) Коль скоро орбитали Хц и xv на одном и том же центре всегда выбираются ортогональными, то фактически для них получается то же, что и для орбиталей двух несоседних центров: F^v = 0 (ц * v). Постоянная К есть некоторый эмпирический параметр, меняющийся, как показали пробные расчеты, в пределах от 1,5 до 2,0. Поэтому обычно выбирается фиксированное значение К = 1,75. Строгого обоснования у этих формул, конечно, нет. Тем не ме- менее качественно общую картину, ведущую к ним, можно понять следующим образом. Для одноэлектронного эффективного гамиль- гамильтониана на основании весьма общих соображений можно написать яэффA) = _ 1 G.2.4) 341
где UJX) - потенциал взаимодействия электрона с ядром атома а в молекуле, экранированного некоторым средним полем других элект- электронов у этого ядра, т.е. потенциал взаимодействия электрона с осто- остовом атома а. Недиагональный матричный элемент этого гамильтони- гамильтониана в базисе атомных орбиталей может быть записан так: , >. G.2.5) Если считать, что орбитали х являются собственными для соответствующего "атомного" одноэлектронного гамильтониана, за- записанного в скобках в первом интеграле правой части: --A + U 1 то получим, что весь этот интеграл равен ~(?м + ev)^uv Поскольку ^> же согласно теореме Купманса ?„ и ev равны потенциалам ионизации, взятым с обратным знаком, то их можно заменить при необходимос- необходимости на соответствующие экспериментальные величины. Второй интеграл в правой части E) также можно оценить следующим образом: разложим xv по некоторому полному набору (ортонормированных) функций %^, центрированных на ядре ц, при условии, что первой функцией в этом разложении является 00 00 Xv " Тогда будем иметь для интеграла: <Х и. и. <Хц и. Л.-2 G.2.6) где было использовано при разложении в ряд Фурье соотношение cv\i= <Хц I Xv> = S\iv Одноцентровые интегралы, стоящие под знаком суммы в правой части F), должны быть, как правило, малыми, и ими можно пренебречь. По крайней мере, если потенциал U^ сферически симметричен, то все интегралы, в которых ХцХ по своей угловой части отличаются от Хм, будут просто равны нулю по требованиям симметрии. Оставшийся же первый интеграл правой части F) - того же типа, что выписаны в C). Для третьего интеграла в правой части E) можно использовать аналогичные рассуждения, учитывая допол- дополнительно, что эти интегралы трехцентровые и должны быть по вели- величине еще меньше, чем предшествующие. Поэтому в итоге получим следующее соотношение: G.2.7) причем \ v » 1/2. Сравнение результатов расчетов с точными рас- расчетными и экспериментальными данными позволило оценить \^v как К/2 = 1,75/2 = 0,875. Для диагональных матричных элементов в соот- соответствии с предшествующим рассуждением используется выраже- выражение, данное в C). Нет смысла более детально останавливаться на представ- представленном выше обосновании как из-за его качественного характера, так и из-за того, что сами расчеты в рамках рассматриваемого метода претендуют лишь на качественный полуэмпирический результат. Отметим лишь, что аппроксимация недиагональных матричных эле- элементов полусуммой соответствующих диагональных элементов, ум- умноженной на интеграл перекрывания, носит название приближения Малликена1. В качестве величин а„ в расширенном методе Хюккеля используют взятые с обратным знаком потенциалы ионизации атомов в валентных состояниях - некоторых гипотетических состояниях, на физическом смысле которых мы остановились подробнее в предыду- предыдущем параграфе. Эти потенциалы ионизации отличаются, например, от потенциалов ионизации с уровней 2s и 2р, хотя и близки к ним. В качестве примера для ряда атомов величины а^ (эВ) представлены в таблице (см.следующую страницу). в. Пример: молекула воды Н2О. При рассмотрении любой молекулярной системы расширенным методом Хюккеля сначала вы- выбирается базис (минимальный валентный базис из слэтеровских 342 1 Малликен Роберт Сандерсон A896 - 1986), лауреат Нобелевской премии A966), внес весьма большой вклад в развитие основных представлений квантовой химии, в частности одним из первых предложил метод молекулярных орбиталей. Большое число исследований выполнено им в области теоретической молекулярной спектроскопии и фотохимии. 343
Параметры расширенного метода Хюккеля (в эВ) Атом Н С N Оболочка и 2s 2р 2s 2р 13,6 21,4 11,4 26,0 13,4 'ц 13,6 11,3 14,5 Атом О F С\ Вг Оболочка 2s 2р 2р Ър 4Р 32,3 14,8 18,1 15,0 13,1 h 13,6 17,4 13,0 11,8 орбиталей, см. также § 1 настоящей главы), т.е. в данном случае л/л: ; X4 = ^Рю = 1 X2 = 1 Хз = G.2.8) причем ?н = 1,300, ^о = ? = 2,275. Оси системы координат располо- расположим следующим образом: будем предполагать, что конфигурация ядер молекулы имеет симметрию C2v, при этом начало системы координат находится на ядре кислорода, ось z направлена по биссектрисе угла Н-О-Н, ось* перпендикулярна плоскости молекулы и ось у лежит в этой плоскости (см. рис. 7.2.1). При таком выборе осей матрица S О Н ц.м. У н Рис. 7.2.1. Конфигурация молекулы Н2О симметрии С 344 интегралов перекрывания будет иметь следующий вид: Xi Хз S = Х4 Х5 Хб Xi 1 Sn 0 5,5 X2 S\2 1 5,3 0 ,5 5,6 Хз 5I3 5I3 1 0 0 0 X4 0 0 0 1 0 0 X5 5,5 ,5 0 0 1 0 Хб 5,6 5,6 0 0 0 1 Согласно соотношениям C) матрица F эффективного гамиль- гамильтониана получается умножением каждого диагонального элемента этой матрицы наа^, а недиагонального- наК(а„ + Оу)/2. Если ввести диагональную матрицу D с элементами d^ = KaJ2, то прямой про- проверкой нетрудно убедиться, что матрицу F можно записать так: G.2.9) К Именно для этой матрицы и необходимо будет далее найти собственные значения и собственные векторы. Прежде чем это делать для молекулы воды, обсудим еще одно общее обстоятельство. При изложении методов типа ППДП было отмечено, что сохранение инвариантности результатов в этих методах требует, чтобы при вращении осей, определяющих ориентацию орбиталей вырожденной оболочки, например 2р-орбита- лей, молекулярные интегралы не менялись. В конечном итоге это приводит к замене в интегралах орбиталей р-типа на орбитали 5-типа. Выясним, каково положение с такого же типа инвариант- инвариантностью в расширенном методе Хюккеля. При этом рассмотрение будем вести непосредственно на тех матрицах, которые получаются в этом методе для Н20. Если бы орбитали, центрированные на кислороде, были связаны с другими осями, повернутыми относительно исходных, то блок матрицы S, относящийся только лишь к орбиталям кислорода, в частности, только лишь к 2р-орбиталям кислорода, не изменился бы, а интегралы перекрывания 514, 515 и S16 (при данном выборе осей 5*14 = 0) преобразовались бы друг через друга с помощью ортого- ортогональной матрицы С. Если эти интегралы записать в виде вектора- строки (как они стоят в матрице S) и обозначить преобразованные 345
U = интегралы штрихами, то указанное преобразование можно пред- представить в виде В целом же при этом матрица S будет преобразовываться с помощью матрицы U: 0 С) • (I - единичная матрица размерности 3 х 3), согласно соотношению /I 0 \(St S2\/I S => S' = | + I I @ c^lsj 1 До и1" s и Матрица F эффективного гамильтониана перейдет в следующую: F = DS + S D - М) = DUtsU + UfSUD - Щ G.2.10) где Х = 2(К-1)/К. Структура матрицы D такова, что диагональному блоку матрицы U, который образован матрицей С, отвечает в D скалярная матрица, т.е. единичная матрица, умноженная на число Ка-^2 ; для других же элементов D соответствующий блок U образован единичной матрицей. Это означает, что DU"** = U"^D, UD = DU и, следовательно D = U^UD = U^DU. Соотношение A0) тогда приводит к равенству F' = U' FU, так что у F' те же самые собственные значения, что у F, а собственные векторы с отличаются лишь преобразованием U^ от исходных: с = U' с.Этот результат свидетельствует о том, что в расши- расширенном методе Хюккеля с указанной инвариантностью относительно вращения осей, определяющих ориентацию орбиталей, проблем не возникает. Используя теперь численные значения параметров матрицы F можем написать: ^ для -13,6 - 23,8512 -30,6513 -30,6S13 0 -21,9S15 -21,9515 -21,9S16 -21,9S16 -23,8S]2 -30,6S]3 - 13,6 - 30,6S13 -21,4 0 0 0 0 0 0 0 -11,4 0 0 -21,9515 -21,9516 -21,9515 -21,9S16 0 0 -11,4 0 0 0 0 -11,4 G.2.11) Чтобы найти собственные значения и собственные векторы этой матрицы, необходимо задать геометрическую конфигурацию ядер молекулы, после чего с введенными выше базисными функциями можно вычислить интегралы перекрывания а затем уже работать с числовой матрицей. Тем не менее, некоторые общие заключения можно попробовать получить и с выписанной матрицей F. Прежде всего заметим, что интегралы перекрывания 512, S^, 514, S^ и S16 зависят от расстояний Л(О-Нг) и R(O-H2), т.е. от тех величин, кото- которые называют часто длинами связей (термин, хотя и неудачный, ибо связь - это взаимодействие, но все же широко используемый). От валентного угла а при заданных расстояниях /?(О-Н,-) = Яо зависят интегралы перекрывания 5^2» Si5 и ^16- Поэтому для того, чтобы понять, как зависит полная энергия молекулы (в основном состоянии) от R или от а, необходимо сначала выписать в явном виде соответ- соответствующие зависимости матричных элементов от этих переменных, а затем получить и собственные значения матрицы F как функции этих переменных. Преобразуем сначала матрицу F, перейдя к новому базису симмет- ризованных функций следующего вида (слева указаны сначала типы симметрии базисных функций о,-, преобразующихся по соответствую- соответствующим неприводимым представлениям группы C2v): А 1 2S 1 12 G.2.12) : а6 = При этом вектор-строка исходных функций умножится справа на матрицу Хг> Хз> Х4> Хз> Хб) vt- -1 и и 0 0 0 0 0 0 0 0 0 1 0 0 1 0 0 0 V - V 0 0 0 0 0 0 0 0 1 0 _ч 1 0 0 1 0 и v=(V2-2Si2) 346 2Si2) . В то же время каждый век- вектор с,- из коэффициентов с/ц перед хц в выражении для молекулярной 347
орбитали ф( умножится слева на матрицу V, а матрица F перейдет в матрицу Fv = VFV" вида f2u2(Fu+F12) 2uF16 2uF13 0 0 0 2aF]6 0 0 0 0 2uFn 0 0 0 0 0 0 0 h2v2(Fn-Fn 2vF]5 0 0 0 0 ) 2vF15 ?55 0 0 0 0 0 *44/ G.2.13) Эта матрица имеет блочно-диагональный вид, и первый блок отно- относится к представлению Al9 второй - к В2 и третий - к Вх. Третий блок имеет размерность 1x1, так что ему соответствует собствен- собственное значение е6 = F44 = -11,4 эВ, а собственный вектор для этого соб- собственного значения будет иметь вид сI = @, 0, 0, 0, 0, 1). Функция 2рх кислорода остается неизменной при переходе от атомов к молекуле. Входящие в выражение A1) и соответственно A3) интегралы 515 и Sl6 как функции валентного угла могут быть без труда вычисле- вычислены, если обратиться к рис. 7.2.2: орбитали 2ру и 2pz кислорода У У Рис. 7.2.2. Преобразование орбиталей р2 и ру при вращении вокруг оси х при вычислении интегралов S]5 и S16. (индекс О не выписываем) при вращениях вокруг осих, перпендикуляр- перпендикулярной плоскости листа, преобразуются друг через друга, так что можно написать G.2.14) 2pz = sin^ • 2р'у + cos- • 2p'z 348 Учитывая, чтоорбиталь 2р'у ортогональна орбитали ЬН1(по симметрии), и обозначая с учетом расположения осей интеграл < 2prz | lsH1>, не зависящий от валентного угла а, через S, получим 515 = а 2Py> = ~s sin^"' 2pz> = а Интегралы S, Sn и 5*13 находятся далее либо аналитически, либо прямым численным интегрированием. Зависимость орбитальных энергий е, от валентного угла а представлена на рис. 7.2.3. Величины интегралов перекрывания вычислены с функциями (8) при R = R(O-H{) = Я(О-Н2) = 2,0 а.е., т.е. при Я, весьма близком к равновесному расстоянию Re = 0,957 А = = 1,81 а.е. В частности, при R = 2,0 а.е. интеграл S равен 0,4486. Дальнейший расчет связан с суммированием орбитальных энергий низших орбиталей, занятых в основном состоянии (в данном случае la , \bT 2a , и \Ь.) и с определением равновесной геометрической конфигурации молекулы воды. Кроме того, вычисленные собственные векторы совместно с базисными функциями позволяют найти при каждой геометрии (т.е. геометрической конфигурации ядер) электрон- электронное распределение, средний дипольный момент и другие характерис- характеристики молекулы. 10 п За Рис. 7.2.3. Зависимости орбитальных энергий г молекулы воды от валентного угла а, вычисленные в приближении расширенного метода Хюккеля. Орбиталь \а1ч лежащая ниже -25 эВ, не показана. 349
§ 3. Различные типы молекулярных орбиталей Полученные в предыдущем параграфе результаты для моле- молекулы воды позволяют дать более детальный анализ структуры молекулярных орбиталей, который, в свою очередь, приводит к достаточно общим заключениям об их возможных типах. а. Орбитали симметрии и эквивалентные орбитали. Получаемые при решении хартри-фоковской задачи молекулярные ор- орбитали для системы с замкнутыми оболочками, каковой и является молекула воды в основном состоянии, обладают той особенностью, что они преобразуются по неприводимым представлениям точечной группы симметрии молекулы. Конфигурация основного состояния мо- молекулы Н2О может быть записана как \а\Уэ\2а\\Ь^, где орбитали, как это обычно принято, обозначены непосредственно символами не- неприводимых представлений (только не прописными, а строчными бук- буквами, что всегда делается для одноэлектронных функций), тогда как орбитали одного и того же типа различаются своими номерами: lay и 2а\. Характерной чертой таких орбиталей является то, что в каждую из них входят, как правило, базисные (атомные) орбитали всех цент- центров, по крайней мере тех из них, которые переходят друг в друга при операциях симметрии точечной группы. При этом выше уже отмеча- отмечалось, что из базисных орбиталей можно построить сначала орбитали симметрии а,- (типа Xl + Х2 и Xl ~ X2X а потом из них - молекулярные орбитали ф. Итак, для молекулы воды орбиталями, входящими в хартри- фоковскую волновую функцию основного состояния, будут следующие: - с12Хб Х2) " + X2) G-3.1) где нумерация орбиталей X/ отвечает G.2.8), первый индекс у cia - номер молекулярной орбитали, второй - номер соответствующей орбитали симметрии. Каждая из молекулярных орбиталей A) входит в слейтеровский определитель дважды: со спин-функцией а и со спин- функцией р. Коль скоро такой определитель не изменится при любом ортогональном преобразовании молекулярных орбиталей (с точнос- точностью до числового множителя, по модулю равного единице), то можно задаться целью перейти от ср, к другим орбиталям с другими свойст- 350 вами симметрии, например, к таким, которые при операциях симмет- симметрии переходят друг в друга. И то, как это можно сделать конкретно, показывает следующее рассуждение. Пусть для группы Cjv имеются две орбитали, л 1 и Л2> перехо- переходящие друг в друга при операциях группы. Составив из ц \ и ч\2 вектор- столбец г\ с двумя компонентами, можем написать: еЦ-Щ С2Ц = О Г U о, ч = ч; 'О 1 Г О 4=4, что означает, что вектор т\ при операциях симметрии группы C2v пре- преобразуется по приводимому представлению Г, характер которого представлен в следующей таблице: а а2 О О Такое представление есть прямая сумма двух неприводимых представлений: A i®52; любые две функции ах и 62, преобразующиеся по этим неприводимым представлениям, позволяют построить две орбитали, переходящие при операциях симметрии друг в друга: Коэффициент к произволен, и для того, чтобы преобразование было ортогональным, нужно потребовать выполнения условия О = <т|1|т|2> = <tfj + kb2\a\ - kb2> = 1 - к*к, где учтено то, что а^ и Ъ2 нормированы и взаимно ортогональны. Считая к вещественным, сразу же находим, что к = ±1. Следова- Следовательно, с точностью до нормировочных множителей (равных в данном случае l/>/2): щ=ах+Ь2, У\2 = ах-Ъ2. G.3.2) Возвращаясь вновь к орбиталям A) и используя для построе- построения т|, орбитали laj и \Ь2, получим 11 = Xl + СрХз " СпХб ~ ^25X5' 12 = Х2 + ^13X3 " ^12X6 + ^25X5> G.3.3) 351
где сп = сг2/сц , с13 = с13/сп и с25 = с25/с22 . Здесь вновь т^ и г\2 представлены в ненормированном виде. Орбитали, преобразующиеся при операциях симметрии точеч- точечной группы молекулы друг в друга, называются эквивалентными орбиталями. Для молекулы воды эквивалентные орбитали C) вклю- включают каждая: атомную орбиталь одного из водородов (х\ или Хг) и линейную комбинацию орбиталей кислорода, обладающую таким же свойством эквивалентности, что и исходная эквивалентная молеку- молекулярная орбиталь, в которую она входит. Эквивалентные линейные комбинации атомных орбиталей данного центра, преобразующиеся друг через друга при операциях симметрии точечной группы, назы- называются гибридными (атомными) орбиталями. Происхождение этого термина в данной ситуации понятно, хотя и не имеет того прямого смысла, который имеется у него в биологии. В общем же случае под гибридными орбиталями атома подразумеваются любые линейные комбинации атомных орбиталей, преобразующихся по разным непри- неприводимым представлениям группы вращений, например s- и р-орби- талей, s-,p- и tZ-орбиталей и т.п.1 Следует отметить, что для построения орбиталей C) были взяты молекулярные орбитали \ах и \ЪЪ хотя вместо \ах могла быть использована орбиталь 2ах либо некоторая линейная комбинация \ix \ах + \122ах с фиксированными коэффициентами \ix и \л2. В любом из этих случаев далее возможно построить две эквивалентные орбитали типа т^ и г\ъ которым будут отвечать и две гибридные орбитали hx и Л2, составленные из атомных орбиталей кислорода. Обычно от гибридных орбиталей требуют, чтобы они были ортогональны друг другу. Для орбиталей h\ = Хз - ^Хб " WC5 и h2 = Хз " ^Хб + ИХ5> G.3.4) фигурирующих в C) и выписанных в ненормированном виде, это означает, что Q = <hx\h2>=\ +Х2-и2, G.3.5) коль скоро хз, Х5 и Хб как атомные орбитали одного и того же центра взаимно ортогональны и нормированы. Конечно, такое требование накладывает дополнительное ограничение на коэффициенты, фигуриру- Лайнус Полинг, которому гибридные орбитали обязаны своим появлением, еще в 1958 г. весьма верно заметил, что если бы орбитали придумали химики, то сначала они придумали бы именно тетраэдрические орбитали, a s- и р-орбитали интерпретировали как гибридные орбитали, построенные изтетраэдрических. 352 ющие в выражениях для гибридных орбиталей, однако позволяет ввести некоторый новый элемент, которого в предшествующих рассуждениях не было: от гибридных орбиталей hx и Л2, записанных в виде D) с пока произвольными коэффициентами, удовлетворяющи- удовлетворяющими условию ортогональности E), можно потребовать и определенной направленности. Что это означает конкретно, видно из следующего. Орбитали Х5 и Хб СУТЬ 2ру и 2р2 орбитали кислорода, имеющие при заданном г максимальные значения вдоль осей у и z соответственно. Их линейная комбинация = . (сг2ру + c22pz) = сощ2р + sinqp /_2 . _2 J где coscp = c-y \Jci + c\ , есть также орбиталь р-типа, максимальное значение которой достигается вдоль оси w, проходящей в плоскости yz под углом ф к оси у. Другими словами, этар-орбиталь направлена по оси п. Добавление к такой орбитали сферически симметричной орбитали 5-типа (т.е. х3) не меняет направленности орбитали •&, т.е. для нее сохраняется осевая симметрия относительно п с максиму- максимумом (или минимумом) на этой оси. В соотношениях D) для орбитали hx угол ф] определяется равенством tgqpj = \л/К9 а для орбитали h2 угол ф2 - равенством tgф2 = -\лГк9 т.е. ф2 = л - qpj. Это означает, что угол между осями пх ии2, определяющими направленность орбита- лей hx и Ъъ равен а - к - 2ф^ Если приравнять, например, а валент- валентному углу, то тем самым будет введено второе условие на \ и ц в соотношении E), что даст возможность однозначно (или с точнос- тьнз до знака) определить эти коэффициенты, а с другой стороны, ввести такие базисные гибридные орбитали, которые будут направ- направлены от ядра атома кислорода к протонам. Именно эти, направлен- направленные к соседним центрам эквивалентные атомные орбитали и были названы гибридными орбиталями на ранних этапах развития кванто- квантовой химии. Гибридные орбитали, определенные таким образом, пред- представляют собой линейные комбинации атомных орбиталей с коэффи- коэффициентами, отличными в общем случае от тех, которые получаются при построении эквивалентных орбиталей из канонических молеку- молекулярных орбиталей. Тем не менее, они могут служить удобным бази- базисом при различных построениях решений молекулярной задачи как в одноэлектронном приближении, так и в методе конфигурационного вза- взаимодействия. Отклонения эквивалентных орбиталей у данного центра от таких (направленных) гибридных орбиталей могут свидетельство- 12 — 1395 353
вать о пригодности последних для построения молекулярных орбита- лей в различных полуколичественных подходах, опирающихся на малые базисы. Направленность гибридных орбиталей часто служила осно- основанием для рассуждений о направленности химических связей, осо- особенно при дополнительном условии, что наиболее прочные химические связи образуются по направлениям максимального перекрывания орбиталей двух соседних центров (критерий, использовавшийся при построении гибридных орбиталей Л. Полингом в начале 30-х годов). Более того, конструкции двух, трех и четырех эквивалентных орбита- лей, которые могут быть построены из одной s и трех/? орбиталей у данного центра и которые получили название sp, sp2 и sp* гибридных орбиталей, служили в свое время обоснованием линейного, тригональ- ного и тетраэдрического расположения соседних атомов (заместите- (заместителей) у данного центра, хотя, как следует из всего вышесказанного, не гибридизация определяет расположение заместителей, а именно расположение заместителей определяет характер гибридизации орбиталей у данного центра. В частности, прямыми расчетами было показано, что если в базисе отсутствует s-функция, то с тремя р- функциями, определяющими в конечном итоге сферическое распре- распределение заряда у данного центра, получаются те же самые результа- результаты для оптимального расположения четырех заместителей, например атомов водорода в метане, что и при использовании построений с гибридными орбиталями. Вернемся теперь вновь к молекуле воды. Для определения коэффициентов в линейных комбинациях, представляющих гибридные орбитали в общем виде, G.3.6) h2 = Y23X3 + Y25X5 + Y26X6> имеются одно соотношение ортогональности G.3.7а) два соотношения нормировки Y?3+Yis +Yi6 = Y23+Y25+Y26 = G.3.76) одно соотношение, связывающее эти коэффициенты с валентным углом. Прежде чем выписывать это соотношение отметим, что 354 hi и h2 переходят друг в друга при операциях симметрии группы C2v, откуда следует, что у23 = Yi3> Y25 = ~Yi5> Y26 = Yi6> a соотношения G) упрощаются до ?Y?+Y?l G3Лв) так что = 1/2, у?з + Y?6 = V2 • Очевидно, среди всех коэффици- коэффициентов в F) остается произвольным всего лишь один. Он-то и опреде- определяется из условия 2Yi5Yi6 Y?6- = - tga, где a - валентный угол. Условие следует из того, что a = jt - 2ф1э tg2(p! = 2tg(p!/(l - tgftpj) и tgcpj = y15/y16. Поскольку yf5 -I/2' TO окончательно приходим к равенствам 1 1 - cosa jt 11+ cosa jt Yl6=——: при as- и Y16=-r—: при a*-, V2 sina 2 V2 sina 2 тогда как у13 определяется из равенств G6): у 13 + у 16 = 1/2 (при том, cosa + cos" a sin2a (ва- что уi5 -\J2)\ в частности, при a s= jt/2 у 13 = - лентный угол a < л/2 для данной задачи не рассматриваем). Если a = JT, тоу16 = 0A+ cosa стремится к нулю быстрее, чем sina), а yf5 =у^3? т.е. у15 = ±у13 = ±l/V2 . Гибридными орби- орбиталями будут ~-г= Х5) = 2Р У т.е. орбитали, отвечающие случаю ^-гибридизации. Если же a то у16 =1/д/2, Yi3 = 0и у15 = ± l/V2 , так что = jt/2, К = - Xs) = - ~Л 355 12' L
т.е. орбитали р-типа, направленные не по осям у и z, а по биссектри- биссектрисам углов третьего и второго квадрантов к протонам 1 и 2 (чему соответствует выбор знаков в правых частях выражений для Л^ и Л2). Из орбиталей 2а^ и \ЬХ в A) можно получить также две экви- эквивалентные орбитали ^j и ^2? которые в отличие от орбиталей t\x и ч\2 будут преобразовываться в себя при операциях е и oxz и будут пере- переходить друг в друга при операциях С2 и оуг Эти орбитали должны иметь вид h=NBax + \\bx% 1 Х V G.3.8) а если потребовать, чтобы эти орбитали были ортогональны, то по- получится дополнительное условие X. = ±1. Такие две эквивалентные орбитали будут включать от атома кислорода линейные комбинации сЗзХз + с32Хб ± Хф т-е- С33^ + c32^Pz± 2рх> те- вновь получаются две гибридные орбитали, переходящие при операциях симметрии группы друг в друга. Эти орбитали носят название орбиталей неподелен- ных пар, поскольку они направлены не к соседним центрам (атомам), а туда, где этих соседей нет, и в то же время их числа заполнения в синглетном состоянии равны двум. Можно, конечно, потребовать, чтобы эти орбитали были не только эквивалентны и взаимно ортого- ортогональны, но и построить из орбиталей 2s, 2px, 2ру и 2pz такую четверку гибридных орбиталей, которая преобразовывалась бы в себя при опе- операциях группы тетраэдра Т^($р3-гибридизация), при искажениях ко- которого возникает группа C2V- Тем самым можно задать некоторое "начало отсчета" для гибридных орбиталей, отклонение от которого при переходе к реальной молекуле, в данном случае - молекуле воды, определяет степень изменения характера гибридизации орбиталей атома кислорода и т.п. Нет смысла углубляться в подобные постро- построения, поскольку умозрительный характер их достаточно очевиден, тогда как принести какую-то пользу они могут прежде всего при кон- конкретном сравнении, сопоставлении орбитальной структуры однотип- однотипных соединений, выяснении, как меняется эта структура при измене- изменении окружения у некоторого атома в этих соединениях и т.п. Таким образом, в полной волновой функции, имеющей вид оп- определителя Слэтера, возможно преобразование орбиталей (без изме- изменения всей функции) и лереход к системе эквивалентных орбиталей, порождающих, в свою очередь, систему гибридных орбиталей для каждого центра в зависимости от симметрии его окружения. Эквива- 356 лентные орбитали уже не являются каноническими хартри-фоковс- кими орбиталями, им не отвечает та или иная орбитальная энергия. Не являются таковыми для отдельного атома и гибридные орбитали, хотя часто вычисленное для атома среднее значение энергии, отве- отвечающее электронной конфигурации с гибридными орбиталями, слу- служит некоторой гипотетической точкой отсчета, так называемой энер- энергией валентного состояния. Все подобные величины (типа энергии валентного состояния) допускают, как правило, довольно понятную интерпретацию при использовании базисов небольшой размерности, например, минимальных, тогда как при переходе к более точным конструкциям они теряют свою простоту и наглядность, а потому и перестают быть привлекательными. Гибридные орбитали, в частно- частности, хороши для простейших качественных рассуждений, особенно если уметь этими рассуждениями пользоваться. Однако по мере улуч- улучшения качества приближений, например при переходе к методу кон- конфигурационного взаимодействия, их достоинства постепенно блек- блекнут, и при достаточно строгом анализе структуры волновых функций гибридные орбитали практически уже не используются. б. Локализованные орбитали. Стремление к эквивалентным и гибридным орбиталям определялось в значительной степени жела- желанием иметь привычную для химии картину молекулы как состоящей из атомов, соединенных химическими связями, причем этим связям отвечают отдельные молекулярные орбитали. Такую картину можно попытаться получить и в более общем случае, когда та или иная симметрия задачи отсутствует, а в то же время представление о системе в большей или меньшей степени локализованных орбиталей сохраняется. Подобная попытка опять-таки должна основываться на инвариантности полной волновой функции при преобразованиях орби- орбиталей, входящих в волновую функцию молекулярной системы, например, в однодетерминантную или одноконфигурационную функ- функцию. При таких преобразованиях остаются открытыми пока два воп- вопроса: каковы должны быть критерии, определяющие орбитали, кото- которые отвечают в той или иной степени привычным химическим пред- представлениям о локальных химических связях и локальных взаимодей- взаимодействиях, а также каков смысл построения таких орбиталей, для каких целей они могут понадобиться. На второй вопрос ответ можно будет дать ближе к концу настоящего параграфа, с первым же разобраться несколько проще. Очевидно, что две орбитали, ф,- и фу, можно считать локали- 357 L.
зованными по отношению друг к другу, если дифференциальное их перекрывание ф;(г)ф (г) является либо малым, либо просто равным нулю. Чтобы считать, что это условие выполнено почти всюду, мож- можно принять, что мал интеграл по всему пространству от квадрата модуля такого произведения: |ф> > = mm. Для системы орбиталей ф,г (/ = 1, 2, ..., п) в качестве критерия их взаимной локализации можно тогда принять условие минимума суммы таких интегралов по всем возможным парам орбиталей: G.3.9) при обычных требованиях нормировки и взаимной ортогональности орбиталей. Интересно заметить, что величина/ = У <|ф/|2 |ср -1 > инвариантна относительно ортогональных (унитарных) преобразований п п орбиталей. Действительно, еслиф, = Ус1кЦ)'к и ф ¦ = У с 7ф/, то к=\ /= *,*' 1,1' к,Ы\ Следовательно, минимум суммы в (9) эквивалентен макси- максимуму следующего выражения: 2|2>. G-3-10) так что при достижении этого максимума орбитали ф, можно счи- считать наиболее локализованными. Сумму (9), как впрочем и сумму A0), можно представить и через двухэлектронные интегралы, если воспользоваться в качестве двухэлектронного оператора дельта-функцией б(г, - г2): п J = G.3.11) Такое представление величины J наводит на мысль, что при введении критериев локализации вместо оператора 6(rj - г2) могут 358 быть использованы и другие операторы, в частности, г12 - расстояние между двумя электронами (для пары локализованных орбиталей это расстояние должно быть по возможности больше), r{? ~~ оператор межэлектронного взаимодействия (для пары локализованных орбиталей взаимодействие двух электронов должно быть мини- минимально) и т.п. Первый из указанных критериев (максимум функцио- функционала/с оператором Ь(г\ - г2)) был введен В. фон-Ниссеном A972), второй (минимум JB = У<ф;A)ф(-B)|г12|фД1)ф,-B)>) - С. Бойзом A960), а третий (максимум суммы величин межэлектронного оттал- отталкивания для пар электронов, относящихся каждая к одной орбитали, /ER = У < ф,- A)ф(- B) гхг фД1)фг- B) > ) - К. Эдмистоном и К. Рюден- бергом A963). Существует и ряд других критериев, связанных с одно- и двухэлектронными интегралами, но на них мы останавливаться не будем. Отметим лишь, что первоначально в качестве критерия локали- локализации С. Бойз ввел условие максимума суммы так называемых орбитальных центроид заряда: i причем речь шла о центроидах заряда, поскольку оператор г совпа- совпадает с точностью до знака с оператором дипольного момента элект- электрона. Как показали конкретные численные расчеты множества мо- молекул, все эти критерии локализации приводят к весьма близким ре- результатам, которые кратко сводятся к следующим. Орбитали дей- действительно получаются локализованными, относясь в основном к од- одному, двум либо трем центрам; для соседних (ближайших по межъя- межъядерному расстоянию) центров такие локализованные орбитали мо- могут быть соотнесены со с вязе вы ми орбиталями, в которых с макси- максимальными весами фигурируют атомные орбитали двух соседних цен- центров, с остовными атомными орбиталями и с орбиталями неподелен- ных пар, т.е. гибридными орбиталями, образованными атомными орбиталями валентных оболочек атома. Для ненасыщенных соеди- соединений, например алкенов, двойной связи отвечают две эквивалент- эквивалентные (или почти эквивалентные) локализованные орбитали (см. рис. 7.3.1), представляющие собой линейную комбинацию а- и л-орбита- лей того локализованного фрагмента молекулы, который включает двойную связь; тройной связи отвечают три локализованные и экви- 359
валентные (либо почти эквивалентные) орбитали, переходящие друг в друга при поворотах вокруг оси, проходящей через ядра атомов, связанных тройной связью. Такого типа локализованные орбитали часто называют "банановыми". Рис. 7.3.1. Пространственное представление одной из локализованных орбиталей двойной связи этилена. Для электронодефицитных молекул, в которых число хими- химических связей (с учетом их кратности), определяемое по числу пар ближайших, соседних атомов в структурной формуле, больше числа пар электронов, в качестве локализованных появляются и так назы- называемые трехцентровые орбитали, максимальные веса в которых от- отвечают атомным орбиталям трех соседних центров. Так, для клас- классической модельной системы этого типа - молекулы диборана - по- получаются 4 локализованные связевые орбитали, отвечающие связям атомов бора с концевыми атомами водорода, и 2 локализованные трех- трехцентровые орбитали, отвечающие двум тройкам центров Bj-H-I^s включающим протоны в пространстве между В| и В2. Подобного же типа локализованные орбитали возникают и у сопряженных систем. Так, для л-орбиталей бензола получается система трех локализо- локализованных в существенной степени трехцентровых орбиталей, при опе- операциях симметрии молекулы переходящих друг в друга либо в линей- линейную комбинацию этих же орбиталей (см. рис. 7.3.2). в. Натуральные орбитали. Конструкция локализованных орбиталей вполне понятна в рамках приближения Хартри-Фока либо приближений, аналогичных ему по структуре волновой функции. При переходе к методам, учитывающим конфигурационное взаимодей- взаимодействие, положение становится гораздо менее ясным, что связано преж- прежде всего с тем, что линейные преобразования орбиталей при непол- 360 ном, частичном учете конфигурационного взаимодействия, т.е. при использовании некоторого выбранного набора конфигураций, как правило, не сохраняют полной волновой функции. Отдельные орбитали а Рис. 7.3.2. Одна из трех локализованных л-орбиталей бензола (представлена лишь волновая функция над плоскостью бензольного кольца): а - пространственное изображение, б - контурная диаграмма. Более полная локализация достигается при одновременном использовании и о-орбиталей. 361
входят в волновую функцию с большим или меньшим весом в зависимости от того, в каких конфигурационных функциях состояния они встречаются и с какими весами эти конфигурационные функции входят в полную функцию. По-видимому, при введении критериев локализации вес орбиталеи необходимо как-то учитывать. С другой стороны, при полном учете конфигурационного взаи- взаимодействия, при полном учете всех тех конфигурационных функций состояния, которые могут быть построены на том или ином наборе молекулярных орбиталеи, становится неважным, как эти орбитали преобразуются друг через друга, т.е. в каком конкретно виде они за- заданы. По этой причине в многоконфигурационных функциях стараются сначала ввести такие молекулярные орбитали, с которыми ряд метода конфигурационного взаимодействия сходится наиболее быстро, далее из полученного таким образом набора молекулярных орбиталеи отбирают лишь некоторую часть наиболее существенных орбиталеи, и на этом более узком наборе пользуются методом полного конфигу- конфигурационного взаимодействия, в рамках которого вполне очевиден переход к локализованным орбиталям того или иного типа. Очевидно, в предложенной последовательности действий пока неясен один этап: построение молекулярных орбиталеи, с которыми ряд сходится наиболее быстро. Детальное обсуждение этого этапа представляет собой хотя и интересную, но специальную проблему. К тому же он не имеет однозначного ответа до тех пор, пока не сказано, что означают слова "сходится наиболее быстро". Один из возмож- возможных способов построения таких орбиталеи заключается в следующем. Рассмотрим одноэлектронную матрицу плотности, о которой уже было сказано в § 5 гл. VI: Р(г',г) G.3.12) Эта функция совпадает с электронной плотностью р(г) молекулы при г = г': р(г', г) ¦ р(г) и имеет нормировку Jp(r', r)\r,=rdxdydz = N. В методе конфигурационного взаимодействия, где функция Ф имеет вид линейной комбинации конфигурационных функций 362 состояния Ф*: <&=2кСкфк> матрица плотности согласно соотношению A2) запишется так: м Р(Г',Г)= G.3.13) При М —> оо в конечном итоге получается так называемое орбитальное представление точной матрицы плотности. Коэф- Коэффициенты Су образуются как линейные комбинации произведений коэффициентов C*KCL при тех конфигурационных функциях состояния Ф^ и Ф^, которые включают орбитали ср, (в Ф^) и ср7 (в Ф^). Из A2) следует равенство р(г', г) = р*(г', г), что при представлении р в виде A3) означает, что Сц =с^, т.е. матрица С коэффициентов Сц - эрмитова. Коль скоро так, то унитарным преобразованием орбиталеи м м Ф/ = 2)М**Ф* ' y,uikujk =&ij эту матрицу можно привести к диаго- к=\ нальному виду м м р(г',г)= м м G.3.14) где щ - так называемое число заполнения орбитали Такие орбитали ф^, в которых матрица плотности р(г', г), пред- представляемая набором коэффициентов с у, имеет диагональный вид, на- называются натуральными, или естественными орбиталями. Можно показать, что среди всех возможных представлений матрицы плот- плотности ряд по натуральным орбиталям, т.е. ряд, определяемый пос- последовательностью чисел заполнения пк, сходится наиболее быстро. При заданном конечном числе орбиталеи Мименно ряд по натураль- натуральным орбиталям наилучшим образом воспроизводит точную матрицу плотности рассматриваемой молекулярной задачи. Следовательно, с одноэлектронной матрицей плотности, составленной на базе s нату- натуральных орбиталеи с максимальными числами заполнения, можно надеяться получить наилучшее приближение для одноэлектронной части того или иного свойства, например, энергии молекулы. 363
Именно по этой причине в качестве орбиталей, в базисе кото- которых ряд метода конфигурационного взаимодействия сходится наибо- наиболее быстро, берут натуральные орбитали (в последние годы молеку- молекулярные орбитали часто строят в виде линейной комбинации натураль- натуральных атомных орбиталей, т.е. натуральных орбиталей, полученных при решениии задачи об изолированном атоме). Очевидным недостат- недостатком конструкций, использующих точные натуральные орбитали, яв- является то, что эти орбитали можно найти лишь после того, как найдена соответствующая волновая функция. Поэтому обычно прибегают к построению приближенных натуральных орбиталей, для нахождения которых развиты специальные методы. г. Натуральные связевые орбитали. Концепция натураль- натуральных, в частности натуральных атомных орбиталей весьма близка по своему идейному построению методу валентных схем, в котором можно попытаться вместо расширения числа учитываемых функций валентных схем ввести такой орбитальный базис, который был бы наилучшим в том, например, смысле, что основной вклад в волновую функцию определялся бы лишь одной схемой (или некоторым мини- минимальным их числом). Входящие в функцию этой схемы орбитали можно было бы назвать валентно-оптимальными. К тому же можно потребовать, чтобы эти орбитали были достаточно локализованными, в частности одно- или двухцентровыми. Такое преобразование ухуд- ухудшит качество базисных орбиталей, но приблизит картину к привыч- привычным химическим представлениям. По существу именно такая конструкция была введена и реа- реализована Ф. Вейнхолдом, но не с функцией валентных схем, а с фун- функцией метода Хартри-Фока либо при дальнейшем учете конфигура- конфигурационного взаимодействия - с более точными функциями. В выраже- выражении A1) можно выделить блок, относящийся к одному атому. Для этого молекулярные орбитали ф, запишем в виде линейных комбина- ций атомных: ф, = ^ ^^ахХо^ где а нумерует центры (ядра), a . _ а=1 А.=1 А, - орбитали у соответствующего центра. Тогда A4) сведется к виду: p(r',r)= а,А. G.3.15) М Блок матрицы U, относящийся к одному атому, будет состоять 364 из матричных элементов Ua^ ац. Диагонализация его приведет к на- натуральным орбиталям niA атома А в молекуле. Для пары атомов, прежде всего соседних, наиболее близко расположенных друг к другу, такая процедура диагоналюации дает возможность найти натуральные связевые орбитали. Входящая в данную натуральную связевую ор- биталь v, линейная комбинация атомных орбиталей атома А будет представлять собой гибридную орбиталь hA этого атома и аналогично - для атома В, так что v, = biAhA + й/В//в, a biA и 6/В - коэффициенты перед нормированными гибридными орбиталями hA и /zB. Проведя такие построения для всех, а проще - лишь для бли- ближайших пар атомов, а если необходимо - то и троек (и т.д.) атомов, получим систему натуральных локализованных орбиталей, включа- включающих: натуральные орбитали остова, натуральные атомные орбита- орбитали (неподеленных пар), натуральные связевые орбитали и т.д. Отби- Отбирая из них те, которым соответствуют максимальные числа запол- заполнения (т.е. собственные значения, полученные при диагонализации блоков матрицы плотности), далее можно построить, например, од- нодетерминантную функцию Ч^, которая будет отвечать конфигурации 2 2 2 2 2 n\Avn2A-> •••viv2---vs и включать орбитали атомного и связевого типа. Эта функция была названа льюисовской, поскольку она, как правило, отвечает льюисовской структуре молекулы, а точнее гово- говоря - структурной формуле этой молекулы (быть может с указанием неподеленных пар). При этом возникло множество весьма интерес- интересных аспектов структуры натуральных связевых орбиталей, например появление трехцентровых орбиталей для бороводородов, различные системы натуральных орбиталей для разных спинов в случае моле- молекул с открытыми оболочками и т.п. К сожалению, у нас нет возмож- возможности на них останавливаться. Подчеркнем лишь, что введение на- натуральных связевых орбиталей - еще один шаг на пути объединения химических и квантовомеханических представлений, хотя и базиру- базирующихся при конкретных расчетах подчас на априорном знании, где химическая связь в молекуле есть, а где ее нет. § 4. Простой метод Хюккеля Простой метод Хюккеля был введен для л-электронных систем на самом раннем этапе развития квантовой химии. Точнее, он был предложен немецким ученым Е. Хюккелем в 1931 г. Пережив 365
в 30 - 40-е годы период сравнительно широкого использования, он не потерял своего значения и по сей день по той причине, что в самой его структуре заложена способность правильно отражать симметрию молекулярных систем и их топологию, т.е. последовательность соединения атомов, их близость или удаленность друг от друга и т.п. а. п-Электронное приближение. Если все ядра молеку- молекулярной системы (или ее фрагмента) расположены в плоскости, например, а^, то молекулярные орбитали делятся по своему поведе- поведению относительно отражения в этой плоскости на два класса: симметричные, не меняющие знак при отражении, и антисиммет- антисимметричные, меняющие знак на противоположный. Первые из них называются о-орбиталями, вторые - л-орбиталями. В приближении самосогласованного поля, т.е. в приближении Хартри-Фока, фокиан F для невырожденных электронных состояний полносимметричен, что означает, что матричные элементы фокиана на орбиталях разного типа симметрии согласно теореме Вигнера-Эккарта должны быть равны нулю. Если базис, в котором представлены молекулярные орбитали, разбит на два базисных набора (или может быть сведен к таким наборам) симметричных и антисимметричных функций, то матричные элементы фокиана <х F у > будут равны нулю, если Хц и Ху разного типа симметрии, и, вообще говоря, будут отличны от нуля в противном случае. Это в свою очередь означает, что матрица фокиана, как, впрочем, и матрица интегралов перекрывания, имеет блочно-диагональный вид: F = о 0 0 И хотя матричные элементы в каждом блоке за счет двух- электронных интегралов зависят от всего набора орбиталей - и о, и л, тем не менее, задачу можно решать итерациями, поэтапно, сначала определяя о-орбитали, затем - я-орбитали, затем вновь возвращаясь к определению о-орбиталей и т.п. Если же считать о-орбитали приближенно известными на основе модельных представлений, то можно в конечном итоге ограничиться рассмотрением лишь я-блока. Такой подход, в котором рассматривается лишь подсистема л-орбита- лей, определяемая некоторым эффективным одноэлектронным 366 оператором, моделирующим подсистему электронов на о-орбиталях, носит название л-электронного приближения. л-Электронное приближение распространяется без особого труда и на метод конфигурационного взаимодействия, по крайней мере в том его варианте, когда при построении конфигурационных функций состояния учитываются возбуждения с л-орбиталей на те или иные вакантные л-орбитали, тогда как система о-орбиталей во всех этих функциях остается без изменений, образуя так называемый о-остов. Этот остов учитывается либо с помощью некоторого модельного потенциала, либо с помощью соответствующей параметризации матричных элементов гамильтониана. Для л-электронного приближения существенным является оп- определение того, какое число л-орбиталей входит в полную TV-алек- тронную волновую функцию в каждом из определителей Слэтера. Однозначного ответа этот вопрос в общем случае нет, однако для отдельных систем или отдельных классов систем на него можно по- получить достаточно определенный ответ. Так, для сопряженных уг- углеводородов (каждый из атомов углерода, входящий в сопряженный фрагмент, имеет три или менее ближайших соседа и все атомы этого фрагмента находятся в случае равновесной конфигурации в одной плоскости) прямой подсчет орбиталей минимального базиса B5 и 2р) показывает, что у каждого атома углерода имеется по одной базис- базисной л-орбитали - 2pz, антисимметричной относительно плоскости сопряженного фрагмента. Если к тому же исходить из самых что ни на есть простейших представлений о том, что о-орбитали суть лока- локализованные двухцентровые молекулярные орбитали, на каждую из которых попадает один электрон от одного атома углерода, а число таких орбиталей равно числу ближайших соседей у данного атома, т.е. трем, то для заполнения л-орбиталей от каждого атома С остается по одному электрону. Этим простейшим рассуждениям можно дать и более строгое обоснование, если проводить, например, в приближении Хартри-Фока неэмпирические расчеты таких систем с учетом всех электронов. Тем не менее, и этот путь будет в определенной степени эмпирическим. В более сложных случаях, когда в системах появляются гетероатомы, решение проблемы числа л-электронов обычно достига- достигается перебором небольшого количества возможных вариантов и выделением того из них, который дает лучшие результаты. б. Метод молекулярных орбиталей Хюккеля (МОХ). Метод Хюккеля вводится для сопряженных, так называемых л-элек- 367
тронных систем в л-электронном приближении. От каждого атома, входящего в сопряженную систему, берется по одной 2/?2-орбитали, и матричные элементы фокиана F (точнее - эффективного одно- электронного гамильтониана /f.AA) записываются в виде а, если \х - атом углерода; ац = а + 6ЦР, если \х - гетероатом; G.4.1) если \i и v - два соседних атома углерода; = Р + ?NVf3, если \х и v - соседние атомы, - атом углерода, v - гетероатом; , если \i и v - гетероатомы; - О, если центры ц и v не являются соседними. Таким образом, метод полностью параметризован: все входящие в расчет величины (а, р, 6Ц и др.) суть параметры, определяемые по экспериментальным данным. Интегралы пере- перекрывания базисных орбиталей либо считаются одними и теми же для соответствующих эквивалентных пар атомов, например S для всех пар соседних атомов углерода, либо просто полагаются равными нулю. Подобная параметризация автоматически учитывает симмет- симметрию задачи (для эквивалентных по симметрии атомов и пар атомов, очевидно, вводятся одинаковые матричные элементы) и учитывает последовательность расположения атомов сопряженного фрагмента, поскольку понятие "соседние атомы" либо целиком опирается на классическую формулу химического строения молекулы, либо использует структурные данные о равновесной геометрической конфигурации молекулы. Орбитальные энергии определяются из векового уравнения det(H - eS) = 0 , где Н и S - матрица эффективного гамильтониана с элементами A) и матрица интегралов перекрывания соответственно. После определе- определения орбитальных энергий е,- находятся коэффициенты с,- в линейных комбинациях для л-орбиталей ф/ = однородных уравнений из системы линейных т = 1,2,...,m), 368 где т - число базисных л-орбиталей. Далее предполагается, что в полную волновую функцию входят лишь те орбитали, которые имеют низшие орбитальные энергии. Другими словами, предполагается, что заполнение л-орбиталей производится в порядке возрастания их орбитальных энергий. И наконец, полная энергия, относящаяся к л- электронной подсистеме и называемая часто л-электронной энерги- энергией, вычисляется как сумма соответствующих орбитальных энергий с учетом чисел заполнения для каждой орбитали {п = 2, 1 или 0). Такое правило вычисления полной энергии, хотя и не соответствует тому, что должно было бы иметь место в приближении Хартри-Фока, тем не менее, обоснованно, поскольку матричные элементы Яцу параметризованы и параметры можно подобрать так, чтобы оно по возможности выполнялось. Параметризация метода Хюккеля, выпол- выполненная так, чтобы полная энергия равнялась сумме орбитальных, носит название термохимической. В то же время для воспроизведения частот переходов из основного состояния молекулы в возбужденные по разностям орбитальных энергий естественно потребовалась другая параметризация, получившая название спектроскопической (сравните с тем, что говорилось в § 1 настоящей главы). Конкретные расчеты показали к тому же, что учет интегралов перекрывания в рамках простого метода Хюккеля не приводит к сколько-нибудь заметному улучшению результатов. В то же время он требует изменения параметризации интегралов В По этой при- чине обычно принимают матрицу интегралов перекрывания равной единичной матрице, т.е. считают все интегралы перекрывания равными нулю. Электронная плотность р(г) в методе Хюккеля, как и в других вариантах одноэлектронного приближения с ортогональными моле- молекулярными орбиталями, имеет вид т р(г) « i-l где ni - числа заполнения, либо с учетом представления ф^ в виде линейной комбинации базисных л-орбиталей G.4.2) Величины Рцу, как уже говорилось, называются зарядом на H,v\ атоме ^1 при A = уи порядком связи А - А при \i*\9A~- атом с ц ц 369
номером \х. Они характеризуют величины электронного заряда в области вблизи атома ц либо в области связи A -Av. \Х V в. Примеры. 1. Для простейшей системы - молекулы этиле- этилена - принимается, что геометрическая конфигурация всех ядер (в том числе и протонов), определяющая симметрию внешнего поля для электронов в адиабатическом приближении, плоская. Для построе- построения молекулярных л-орбиталей от каждого атома углерода берется по одной 2/?7-орбитали - х, их2, так что в методе Хюккеля я-орби- тали имеют вид Ф; = c Матрицы эффективного гамильтониана и перекрывания: Н = а и S = 1 G.4.3) приводят к вековому уравнению det(H - eS) = det из которого сразу же следует, что а + В а - е В-е5 -е5 а - е = 0, 1 + 5 а - Р = а = а - (у = C - aS). 1-5 1-5 Как уже сказано выше, интеграл перекрывания обычно счи- считают равным нулю (его непосредственное вычисление со слейтеров- скими 2/?2-орбиталями при R = 2,5 а.е., отвечающем примерно рав- равновесному расстоянию С-С в молекуле этилена, приводит к величине, близкой к 0,25). Величины а и C, как показывают оценки, отрицательны (а - орбитальная энергия электрона в атоме углерода, примерно равная -11,5 эВ, а C в зависимости от способа оценки колеблется от -1 до -2,5 эВ). Следовательно, низшей является орбитальная энергия е, = (а + р)/A + 5). Орбитали ф, и ф2 определяются по существу симметрией за- задачи и имеют вид: Эти орбитали формально записываются точно так же, как и при 370 решении задачи о молекуле Н2, для которой в качестве Xi и Х2 выс" тупали 1$н-функции, тогда как здесь фигурируют 2/?2-функции атомов углерода. Поскольку низшей по энергии является орбиталь ф, и, кро- кроме того, по тем правилам, о которых говорилось выше, в задаче име- имеется два электрона в jt-электронной подсистеме, то для полной фун- функции в я-электронном приближении можно было бы написать что приводит к полной л-электронной энергии = 2а + 1 + 5 и к л-электронной плотности р = 2ф,(гJ = 1 Х2(г)J- -1 Следовательно, заряд на каждом из атомов равен A + 5) порядок связи С,-С2 также равенA + 5). При 5 = 0 заряд на каждом атоме становится равным 1, так же как и порядок связи Р12. 2. Перейдем теперь к более сложному примеру В нем, как и во всех последующих, будем принимать S = 0. Итак, пусть имеется молекула С3Н3, в которой атомы углерода для равновесной конфигу- конфигурации занимают положения в вершинах правильного треугольника 3 Матрица гамильтониана имеет вид Н а а G.4.4) и при единичной матрице интегралов перекрывания вековое уравне- уравнение представляется следующим образом: (а-г det а - е а - е = 0. 371
Если О, то каждую строчку в этом определителе можно поделить на C. При этом весь определитель поделится на (З3, но равенство нулю не нарушится. Обозначим далее (а - е)/C через —х. Тогда получим det -х 1 М 1 -х 1 1 1 -X Корнями этого уравнения будут так что (е = а + л ДГ-1 — ?] = а + Xj = Х — — 1, е2 = е3 = а - а диаграмма орбитальных энергий (с указанием заполнения соответ- соответствующих орбиталей) будет иметь вид s 4 а-р а а+2р - Фг.фз Состояние, отвечающее такому заполнению, является вырож- вырожденным, поскольку при энергии а - C электрон может занимать либо орбиталь ф2, либо орбиталь ф3, не говоря уже о том, что любая из этих орбиталей может входить в полную волновую функцию либо со спин-функцией а, либо со спин-функцией C. Полная л-электронная энергия равна Если бы в системе было два л-электрона, т.е. образовался бы, например, катион С3Н3 > то при прочих равных условиях мы имели бы Ек = 2а + 4C. Это отчетливо показывает (C < 0!), что такой катион стабильнее по отношению к системе разъединенных атомов, чем нейтральная молекула: понижение энергии для него составляет 4C , тогда как для молекулы лишь 3C |. Анион C3HJ получается еще 372 менее стабильным, чем нейтральная молекула (Ек = 4а + 2|3). Молекула С3Н3 должна по этим энергетическим соображениям достаточно легко реагировать с электроноакцепторными реагентами, переводящими ее в положительно заряженное состояние. Выпишем теперь выражения для орбиталей 1 Ф1 = либо г: Ф2 = Фз = 1 "Хз)> Хз)- + величиной 1/2 2 й — 1Ф2 + Фз 19 что приводит к таким значениям зарядов на Для системы с замкнутой лхэлектронной оболочкой С3Н3 , как и в предыдущем примере, получается одно и то же значение для заряда на атоме: Р{ = Р2 = Р3= 2/3, и одно и то же значение для порядка связи: Р = 2/3 {\i * v). Если же перейти к нейтральной системе, то в силу того, что орбитали ф2 и ф3 вырождены, для их вклада в электронную плотность следует пользоваться усредненной 2 v " ' ")9 атомах и порядков связей: Р] = Р2 = Эти величины порядков связей показывают, что электронная плотность в пространстве между ядрами углерода (при одном и том же расстоянии С-С) в нейтральной молекуле меньше, чем в катионе. Для молекулы С3Н5 с линейным или почти линейным распо- расположением ядер атомов углерода A-2-3) матрица гамильтониана не- несколько иная, чем D): 0\ G.4.5) = 1 и Ри = ^23 = а а О а вырождение уже отсутствует, а энергии и орбитали таковы: г- 1 г ?) = a +V2C, ф, = -(xi + V2 Х2 + Хз); е2 = а, 1 = а -V2 6, V2 1 G.4.6) Фз= 373
Заряды на атомах вновь все получаются равными единице, тогда как порядки связей таковы: Рп = Р23 = V2/2, Р13 = 0, что по существу соответствует принятой изначально модели молекулы. 3. Следующей молекулой пусть будет С4Н4. Для нее возмож- возможны две формулы: с четырехчленным циклом (т.е. циклобутадиен I) и с трехчленным циклом (метиленциклопропен II): 1 I Для них получаются по той же процедуре, что и выше, следу- следующие орбитальные энергии: ?2 а Х2 - Хз - Хз " 3U): } II ?з ?4 Еп I: a + 2p a a a - 2C 4a + II: a+ 2,170C a+ 0,311C a - C a-1,481C 4a + 4,962C Можно выписать и молекулярные орбитали, которые находятся без труда для циклобутадиена и несколько более трудоемко - для мети- ленциклопропена: Ф2 = °>5(Xl Ф4 = °>5(Xi + 0>539х4), -2,214x4), G.4.8) + 1,674x4). Для II орбитали выписаны так, чтобы яснее было видно со- соотношение коэффициентов перед Xi и х2: орбитали ф,, ф2 и ф4 являются симметричными относительно плоскости a , проходящей через центры 3 и 4 перпендикулярно плоскости молекулы a ; орбиталь Фз является антисимметричной относительно этой плоскости. С полученными орбиталями далее находятся лхэлектронные заряды на атомах и порядки связей, которые обычно записываются в виде молекулярных диаграмм, структура которых очевидна из 374 = 0,5(Х| + х2 + Хз + Фз = О,5(Х, - х2 " Хз + Ф, = 0,523(Х, + х2 + Ф2 = 0,368(Х, + Х2 " Фз - 0,707(х, - Ф4 = О,ЗО2(Х, + представляемых ниже (электронная конфигурация для I а для II -ф^ф2 ): 1,000 0,818 0,877 0,500 0,818 ^о~758 ф, ф2Фз На молекулярных диаграммах, как это и сделано, указывают обычно заряды на атомах и порядки связей лишь для одного из экви- эквивалентных атомов и одной из эквивалентных пар атомов. Кроме того, на молекулярных диаграммах, как правило, указывают не просто заряды на атомах, а так называемые индексы свободной валентности Fa, равные некоторой постоянной/("максимальной валентности", зависящей от природы атома а, например для углерода/ = 4,000) за вычетом суммы порядков связей у данного атома, при этом для освязей порядок принимается равным 1. В этом примере мы впервые сталкиваемся с ситуацией, когда не все атомы углерода сопряженной системы эквивалентны: для ме- тиленциклопропена симметрия отвечает точечной группе C2v, так что эквивалентными друг другу оказываются лишь атомы 1 и 2, а также соответствующие пары 1-3 и 2-3. Полученные результаты, несмотря на всю простоту подхода, приводят к ряду важных следствий. Во-первых, структура II ста- стабильнее структуры I, причем в структуре II имеется повышенный электронный заряд на атоме 4, что отчетливо указывает на положение атаки этой молекулы электрофильным реагентом. Во-вторых, структу- структура I характеризуется вырождением орбиталей ф2 и ф3, что при двух электронах, попадающих на эти орбитали, приводит к появлению син- глетного и триплетного электронного состояний. В рамках метода Хюккеля энергия этих состояний должна быть одинакова, однако в более точных подходах должно выполняться правило Хунда1, так что 1 Правило Хунда говорит в общем случае о том, что при прочих равных условиях для одной и той же электронной конфигурации состояние с более высокой мультплетностью будет лежать по энергии ниже, чем с более низкой. У этого правила нет строгого доказательства, качественно оно опирается на расс^вдения о том, что у пространственной части волновой функции состояния с более высокой мультиплетностью число узловых поверхностей меньше, чем у остальных состояний, возникающих из той же конфигурации. На более детальных обоснованиях правила останавливаться не будем. 375
можно утверждать, что триплетное состояние будет лежать по энер- энергии ниже, чем синглетное. С другой стороны, при искажении геомет- геометрии I, например при переходе к конфигурации прямоугольника (когда C = #12 < #23 = Y)' происходит понижение энергии верхней занятой орбитали (полная л-электронная энергия остается без изменений) и основным состоянием системы будет синглетное. Следовательно, для таких систем интерпретировать результаты, полученные в рамках простого метода Хюккеля, становится опасным (о возникающих при этом особенностях речь отчасти пойдет подробнее в следующем па- параграфе). В-третьих, повышение порядков связи Сх-С2 и С3-С4 озна- означает при прочих равных условиях повышение электронной плотности в пространстве между ядрами, так что связи С,-С2 и С3-С4 Должны быть более близки по своему характеру к обычной двойной связи в этилене, где, как уже было сказано, порядок равен 1,000, тогда как связи С,-С3 и С2-Сз отклоняются от "этиленового стандарта" в об- обратную сторону. 4. Наконец, для полноты картины рассмотрим еще одну мо- модельную систему с четырьмя атомами углерода в л-электронной системе, а именно, молекулу бутадиена-1,3: С4Н6 . С точки зрения метода Хюккеля различия между цис- и транс-формами этой молекулы отсутствуют, из-за чего о них мы не говорим. Для этой молекулы матрица эффективного гамильтониана в лхэлектронном приближении имеет вид Н = а 0 0 0 а 0 о а а собственные значения которой таковы : + V5 =а = а+ 1,618C; z = а + s -1+ л/5 1+ л/5 = а-0,618р; -а-1,6180. Как и в предшествующем случае, решения, отвечающие этим собственным значениям, либо симметричны относительно операции симметрии для данной задачи, т. е. перестановки центров 1 и 4 и одно- одновременно центров 2 и 3, либо антисимметричны. Эта операция для 376 /иранс-бутадиена отвечает повороту на угол к вокруг оси z, являю- являющейся осью симметрии второго порядка (группа С2). С учетом такой симметрии либо непосредственно при решении уравнений Не, = е^ ? - — ОС получим (са = -L-— сп): Р ф1 = 0,372(Xl + 1,618 ф2 = 0,602(Xl + 0,618 Ф3 = 0,602(Xl - 0,618 ф4 = 0,372(Xl - 1,618 1,618Х G.4.9) S AS - 0,618X3 + X4>> S + 1,618хз - X4) AS (в последней колонке указан тип симметрии орбитали: S означает, что орбиталь не меняется при повороте на угол л, AS - что орбиталь меняет знак при таком повороте). Полная л-электронная энергия в основном состоянии бутадиена Ел = 4а + 4,4720, т.е. несколько выше, чем для метиленциклопропена, но ниже, чем для цикло- бутадиена. Молекулярная диаграмма имеет вид (прямым шрифтом указаны индексы свободной валентности): 0,391 * Л894 0,448 0,837 так что порядки связей близки к величинам, полученным в случае метиленциклопропена. При переходе к возбужденному состоянию, отвечающему электронной конфигурации ф] Ф2Ф3 и лежащему по энергии на -1,23бр выше основного (C < 0), молекулярная диаграм- диаграмма переходит в следующую: 0,560 0,725 Nja 448 У 1,383 т.е. в возбужденном состоянии больше должна напоминать двойную центральная связь С2-С3? тогда как концевые С-С связи становятся ближе к ординарным. г. Алыпернантные углеводороды. Для этилена, циклобута- диена и бутадиена-1,3 орбитальные уровни ef расположены симмет- симметрично относительно величины а: если есть уровень а + /гф, то есть и уровень а - /wC. Этот результат оказывается достаточно общим в рамках хюккелевского подхода. Во всех таких системах все центры (атомы углерода), входящие в сопряженную систему, можно поде- поделить на два класса следующим образом: возьмем какой-либо один из 377
центров и отметим его звездой * ; у всех соседних с ним центров звезды ставить не будем, тогда как у соседних с ними центров вновь у каждого поставим звезду и т.д. Например Во всех указанных системах каждый атом со звездой обяза- обязательно соседствует с атомами без звезды и наоборот. В то же время для метиленциклопропена такой разметки уже провести нельзя, по- поскольку с какого атома мы бы ни начинали, все равно придем к ситуации, когда рядом оказываются либо два атома со звездой, либо два атома без звезды: *¦ ¦•* или Соединения, в которых возможно указанное разбиение центров на два класса, причем центры каждого класса соседствуют только с центра- центрами другого класса, называются альтернантными (англ. alternant - чередующийся, имеющий чередующиеся слои, объекты и т.п.). Если для альтернантной системы сначала перенумеровать атомы одного класса, а потом - атомы другого класса, то матрица эффективного гамильтониана будет иметь вид Н = al где I - единичная матрица. Например, для бутадиена при нумерации 1 2 * 'а О О а О 6 о a О О a • Число атомов со звездой не обязательно должно равняться числу атомов без звезды, однако такая ситуация встречается реже и дос- достаточно специфична, так что на ней останавливаться не будем. 378 Если записать Н в виде Н + al, так что у матрицы Н на диагонали будут стоять нули, а не а, то это приведет лишь к изменению собственных значений: собственное значение е, матрицы Н переходит в собственное значение xi = е, - а матрицы Н. Далее, если в соответствии со структурой Н представить вектор с, следую- следующим образом: где с,* и с,_ - векторы с числом компонент, равным числу атомов со звездой и атомов без нее соответственно, то из матричного уравне- уравнения Не, = xici следуют два: -*,с,* + Тс,_ = 0, Возьмем теперь вектор /* = 0. G.4.10) с,-* -с I- отличающийся от исходного заменой с,_ на него матрицей Н + х{1: X;Cj* — 1С j _ ,+ I ж\ ¦v ?* с,_, и подействуем на Согласно соотношениям A0) вектор, стоящий в правой части этого равенства, имеет нулевые компоненты, что означает следующее: если xi - собственное значение Н, отвечающее собственному вектору с,, то и —xi есть собственное значение Н, а отвечающий ему собствен- собственный вектор совпадает с с ¦, у которого перед всеми компонентами, отвечающими атомам без звезды (т.е. перед коэффициентами у соответствующих базисных функций), знак изменен на противо- противоположный. Для альтернантных соединений может быть доказан и ряд дру- других полезных соотношений, останавливаться на которых не будем, так как они представляют уже более специальный интерес. Отметим лишь, что альтернантные системы могут быть и такими, в которых атомы со звездой суть атомы одного элемента (например, В), а без звезды - другого (например, N). Общие теоремы, относящиеся к альтернантным углеводородам, т.е. к соединениям с одной и той же 379
величиной а, могут быть переформулированы без особого труда и применительно к таким, более сложным системам. Задачи 1. В рамках метода Хкжкеля решить задачу о собственных значениях и собственных векторах для следующих систем (в пред- предположении, что для всех них геометрическая конфигурация углеродного скелета плоская): а) С(СН2K (сравнить с бутадиеном) б) бензол СЛН, 5 в) изомер бензола (в предположении, что конфи- конфигурация плоская симметрии D2h и Н]4= у) 6 г) С6Н4 (плоская конфигурация) 2. Найти орбитальные и полные л-электронные энергии сле- следующих соединений: a) —N—Н б) Н ¦N в) Н I N- при условии, что aN = а + Р; pCN = /ф и от атома азота в л- электронную систему входит: а) один электрон, б) два электрона. 380 § 5. Метод Хюккеля: теория возмущений Метод Хюккеля направлен на получение качественных заключений о стабильности систем, о тенденциях в изменении энергии или других свойств, например распределения электронной плотности, при переходе от одного соединения к другому, в частности при переходе, определяемом заменой атома углерода на гетероатом либо изомеризацией. При этом, конечно, надо помнить о том, что меняется не только л-электронная структура задачи. Меняется и то, что связа- связано с а-орбиталями, однако подчас эти изменения либо можно учесть в рамках того же разделения задач для а- и л-подсистем и после рассмотрения изменений в л-электронной задаче добавить соответ- соответствующие поправки от осоставляющей, либо рассматривать такие ситуации, в которых изменение а-подсистемы малосущественно и им можно пренебречь, например при расчетах энергий первых л-электронных переходов в родственных системах и качественном сопоставлении получаемых величин. Именно этими причинами обусловлено стремление во мно- многих задачах, решаемых в рамках метода Хюккеля или расширенного метода Хюккеля, использовать теорию возмущений. Суть даже не в том, что теория возмущений позволяет проще решить задачу: такой проблемы в рамках указанных методов обычно не возникает при наличии современной вычислительной техники. Суть в том, что теория возмущений часто позволяет яснее увидеть структуру задачи, узнать, например, какие составляющие возмущения более важны для рассматриваемого свойства и т.п. о. Теория возмущений. Ит;ак, пусть эффективный л-электрон- ный гамильтониан Но переходит в новый гамильтониан Н = Но + V, где V - возмущение, представляющее собой матрицу того же порядка, что и Но. Согласно обычной теории возмущений Релея- Шредингера собственные значения Et матрицы Н в отсутствие вырождения можно представить следующим образом: Ei = е, + cJVc, п VV-- -8 G.5.1) где Vy = с,- V с ¦, векторы с; и с относятся к невозмущенной задаче, п ~ порядок матрицы Но. Второй член справа представляет собой поправку первого порядка, следующий за ним - поправку второго 381
порядка и т.д. Для собственных векторов С7 возмущенной задачи, выписывая явно лишь члены первого порядка теории возмущений, будем иметь п С, = с, VJi j + ... . - г G.5.2) Ниже основное внимание будет уделено энергетическим величинам, так что вернемся теперь к A). В первом порядке получим ¦ V с- G.5.3) и если V определяется лишь изменением диагонального члена матрицы гамильтониана: V^v = d Ь , то G.5.4) Для л-электронной энергии при суммировании по всем занятым орбиталям с учетом их чисел заполнения получим поправку первого порядка, выражающуюся через заряды на атомах Р = У Q,,dlt. Если же в V отличны от нуля недиагональные элементы, например лишь элементы F и V = к. то приходим к выражению, содержащему порядок связи \i—v: Е$] = (^v + V * где PpV = y^t c/kl сы . Таким образом, мы получим хотя и вполне конкретный, но достаточно тривиальный результат: в первом порядке теории возмущений изменение л-электронной энергии определяется характеристиками q и Р представляющими в своей совокупности распределение электронной плотности невозмущенной задачи. Перейдем теперь к более сложному объекту: поправке второго порядка теории возмущений, причем опять рассмотрим сначала частные случаи. Пусть V - диагональная матрица с единственным ненулевым элементом d . Тогда общее выражение - 111 { \i,v Ci\iCjvCj\i' 8,-8 v^Vv G.5.5) приводит в этом случае к следующему равенству * * ¦*"* ¦*"* ** ** - ¦ гу, d,. s лм,, d.t . Е\2) = 1 • — ? \1 G.5.6) Величина л'^ называется орбитальной самополяризуемостью, тогда как сумма по всем занятым орбиталям с учетом чисел заполнения: n\i,\i * 5)iniJt|i,n ' есть так называемая л-электронная самополяри- самополяризуемость атома ц. Если при возмущении меняется лишь матричный элемент V\iv ~ Vv\i от ^ до ^nvP' a все остальные матричные элементы Но остаются без изменений, то из E) получим Е B). = 1 ci\i cjv cj\i \iv , \iv G.5.7) Величину л|,Ук1У называют орбитальной самополяризуемостью связи ^_v5a ^"i^Unv = л^У)цу -самополяризуемостью этой связи. Если в матрице V отличными от нуля будут несколько величин V^ то появляются и самополяризуемости вида л^ vp : л * v CjpCiv) Я — P t вида Jtliv nr_ и т.п. Нет смысла останавливаться на них подробнее, поскольку сама по себе конструкция достаточно очевидна. Отметим лишь, что термин самополяризуемости не соотносим непосредственно с поляризуемостью, хотя и имеет к ней отношение: он появляется по той причине, что слагаемое второго порядка, возникающее при рассмотрении молекулы в однородном электрическом поле напряжен- д. ности Е, имеет вид -Е'аЕ , где а - матрица поляризуемости, выражающаяся, как нетрудно убедиться, через величины введенных выше самополяризуемостей и интегралы вида к v$. При расчете поправок второго порядка к полным молекулярным величинам, например к л-электронной энергии B) = 2, L V V- lJ J1 G.5.8) 382 383
в двойной сумме обязательно встретятся два члена: VuVn VjiVjj П: И П , которые при «; = п различаются лишь знаком (за счет порядка расположения членов в разности, стоящей в знаменателе). Следовательно, если пока рассматривать лишь наиболее часто встречающиеся молекулярные системы, у которых каждая орбиталь Ф; либо занята двумя электронами, либо вакантна (ni - 2 либо 0), то в этом случае в сумме вида (8) исчезают все члены, для которых / и у относятся одновременно к числу занятых, так что B) _ п л = 1 1 V- V- G.5.9) j-m + l /«1 е/ ~ ?У Поскольку энергии вакантных орбиталей ф лежат выше, чем занятых Ф; для основного состояния, то очевидно, что в этом случае Е ^ < 0, т.е. поправка второго порядка приводит к понижению невозмущенной энергии для систем с замкнутыми оболочками. Для л-электронных систем с частично заполненными оболоч- оболочками выражения получаются несколько более громоздкими, хотя при этом и следует отметить, что сам по себе для таких систем метод Хюккеля мало пригоден и получаемые в его рамках результаты суть свидетельство того, что с такими системами, где метод Хюккеля приводит к открытым оболочкам, нужно разбираться дополнительно. Тем не менее, представление различных примеров начнем именно с такой задачи. б. Пример: циклобутадиен. Пусть в молекуле циклобутади- ена происходит (за счет чего - пока не важно) искажение геометрии, причем такое, что межъядерные расстояния Cj-C2 и С3-С4 остают- остаются без изменений, а расстояния С2-С3 и C4-Cj увеличиваются, так что ядерная конфигурация углеродного скелета приобретает форму прямоугольника: В эффективном гамильтониане интегралЬ! а будем считать остаю- остающимися без изменений, интегралы |3 для соседей 1-2 и 3-4 - также 384 не меняющимися, а для пар 2-3 и 4-1 - переходящими в интегралы Р' _ р + /ф. Матрица возмущения, следовательно, такова: V = о о о о о о о о о о о о G.5.10) Для последующих выкладок используем выражения G.4.7) для невозмущенных молекулярных орбиталей из предшествующего параграфа. Начнем с того, что орбитали ф2 и ф3 вырождены. Поэтому при применении теории возмущений необходимо сначала найти правильные орбитали нулевого приближения из векового уравнения второго порядка, которое к тому же определит и поправки первого порядка к энергии вырожденного уровня: Ф2 > Ф2> ф2 ф3> > - с=0, либо, что то же cJVc3 '2 (i) с=о. Численные величины будут таковы: С2 2 Следовательно, E^=-k&9 a E^ = /ф, причем собственные векторы С2 и сз невозмущенной задачи не меняются, т.е. в нулевом приближении эти векторы являются правильными векторами нулевого порядка (при А:^ 0 возмущенные векторы должны переходить именно в эти векторы). С другой стороны, вырождение исходной задачи снимается и вне зависимости от знака к одна орбитальная энергия становится ниже исходного уровня e2s 3 = а> a вторая выше. 13— 1395 385
G.5.11) Прежде чем двигаться далее, отметим, что искаженная ядер- ядерная конфигурация отвечает симметрии D2h, причем функции ф1? ф2, ф3 и ф4 невозмущенной задачи преобразуются по неприводимым представлениям АХш B3g , B2g и Alg соответственно. Если же не учитывать в качестве элемента симметрии плоскость о^ (а следова- следовательно, и повороты С2(х) и С2(у))9 поскольку все л-орбитали анти- антисимметричны, т.е. ведут себя одинаково относительно этой плоскости, то оставшимися нетривиальными операциями симметрии будут C2(z), о^ и о' так что точечной группой симметрии, образованной этими операциями совместно с единицей, будет C2v. Орбитали ф19 ф2, ф3 и ф4 преобразуются по неприводимым представлениям А19 Въ Вх и А2 этой группы соответственно. Матрица возмущения V A0) при операциях этой группы не меняется, т.е. она является полносиммет- полносимметричной. Такой анализ показывает, что все матричные элементы < Ф/ ^ Ф7 > = с,- Vc • при / #у обращаются в нуль. Функции ф, являются собственными и для возмущенного гамильтониана, только лишь собственные значения будут иными: Ех = 6j + /ф = а + B + Е2 = е2 - к$ = а ~ ?3 = е3 + /ф = а + Е4 = е4 - /ф = а - B + Пусть ради определенности к ? 0. При этом матричные элементы //цу, относящиеся к парам центров с увеличенным расстоянием между ними, по модулю меньше чем р. Тогда при движении по координатеТ?, задающей расстояние, в обратную сторону Остановится положительным, если при Rq, отвечающем конфигурации квадрата, Яцу не имеет экстремума (в общем случае появление экстремума у Яцу именно для конфигурации квадрата маловероятно). Диаграмма, отвечающая такой картине, представлена на рис. 7.5.1, где через Rq обозначено фиксированное расстояние при конфигурации квадрата, а через Rx - меняющееся расстояние. Как уже говорилось, л-электронная энергия циклобутадиена равна Еп = 4а + 4C, тогда как при измененном расстоянии 7?! получается следующий результат: Rx > Ro, к < 0: Еп - 4а + 4C; Rx < 7?0, к > 0: Ел = 4а + 4C + 4*р; т.е. при уменьшении расстояния R{ jt-электронная энергия системы понижается. Если бы приняли допущение об обратном соотношении знаков у к , то единственно, что изменилось бы в полученном 386 результате, так это переход к более низким энергиям в правой части диаграммы (при 7?, > Ro). Таким образом, конфигурация плоского квадрата для цикло- бутадиена в л-электронном приближении не соответствует точке минимума на поверхности потенциальной энергии, т.е. эта конфигу- конфигурация должна быть неустойчивой относительно по крайней мере рассмотренных искажений. Е а-2р- а а к>0 к<0 RX<RO RQ RX>RO прямоугольник квадрат прямоугольник Рис. 7.5.1. Изменение л-электронных орбитальных энергий цикло- бутадитена при искажении геометрии. в. Пример: переход к бутадиену. Возможны и такие искажения конфигурации квадрата, которые соответствуют переходу к молекуле с открытой цепью: xl При этом расстояния R(CX -C2), 7?(С2-С4) и 7?(С3 -С4) остаются, например, теми же, что и в исходной молекуле, т.е. 7?0, тогда как R(CX -C4) = R\ меняется. В качестве матрицы возмущения в этом случае будет фигурировать следующая: V = ( 0 0 0 0 0 0 0 0 0 3 0 0 0 0 0 G.5.12) причем для возмущенной задачи (если опять-таки не учитывать в 13' 387 L.
качестве элемента симметрии плоскости о^) из элементов симметрии остается лишь плоскость о^ и точечной группой симметрии будет Сг Ось С2(х) не имеет смысла включать, поскольку С2(х) = о^о , т.е. этот элемент симметрии связан с о . Матрица V A2) симметрична относительно операций Cs, a орбитали ф; разбиваются по неприводимым представлениям этой группы следующим образом: Ф1 и ф3 - представление А'; Ф2 и ф4 - представление А". Поэтому матрица W с элементами < ф, | F | ф 7 > = с* V с • будет иметь уже несколько более сложную структуру, чем в предыдущем примере, когда у такой же матрицы отличными от нуля были лишь диагональ- диагональные элементы: О (Ш/2 О /ф/2 О -к$12 О -/ф/2 /2 0 /ф/2 О О -Щ/2 О -Ш/2 что позволяет сразу же получить величины орбитальных энергий в различных порядках теории возмущений, представленные в таблице: Номер уровня 1 2 3 4 ос + 2р а а а-2C /fcp/2 -/fcp/2 /fcp/2 -/fcp/2 eP ^р/8 ^р/8 -^р/8 -^р/8 вг+еР + еР> а + 2р + D/fc + *2)p/8 а - D/fc - ^)р/8 а + D/fc - ^)р/8 а - 2р - D/fc + ^)р/8 Здесь вновь наблюдается расщепление исходного вырожден- вырожденного уровня, и если к < О при Rx > Rq9 то низшими по энергии будут qpj и ф2 (при достаточно малых I к\). Следовательно, л-электронная к2 энергия будет равна Еп = 2ЕХ + 2Е2 = 4а + 4C + — р, что опять-таки означает понижение энергии при искажении геометрии системы. 388 Выпишем также в первом порядке теории возмущений низшие по энергии орбитали ф! и ф2 возмущенной системы, записав сначала векторы с, на основе формулы B): Л . Л л I С2=с2- 21 - 8 - 8i - 8 41 - ? = Ci + —С так что 4>i« Ф2 = где АхиА2-нормировочные множители, а X = D - к)/D + к). Срав- Сравним теперь этот результат с полученным для бутадиена в § 4. Формально переходу к молекуле бутадиена отвечает возмущение A2) с к = -1. При этом значении к собственные значения Е{ с точностью до второго порядка теории возмущений равны: Ех = а + 1,75C и Е2 = а + 0,625C, а орбитали ф! и ф2 выглядят следующим образом: Ф1 =^i(Xi + Ь667х2+ 1,667х3 + Х4)> Ф2 = А2(хх + 0,600х2 - 0,600хз - ХД что весьма близко тому, что было получено для бутадиена прямым путем без использования теории возмущений (см. выражения G.2.9) и предшествующие им для орбитальных энергий). г. Пример: переход к метиленциклопропену. При переходе 2i гЗ 2 формально совершается следующее: связь 1—4 заменяется на связь 1-3, так что матрица возмущения V = / 0 о {-к 0 ? о о о о о о о о 0 / при к = 1 как раз и будет отвечать такому переходу. Вновь, как и 389
ранее, найдем матрицу W с элементами WtJ- =c? Vc-, с помощью которой далее уже без особого труда находятся возмущенные собственные значения и собственные векторы: W = О о -Л6/2 Г -Ар/2 Тв/Y" /2 О О Поскольку здесь вновь в невозмущенной задаче уровни е2 з вырождены, то необходимо найти такие линейные комбинации орбиталей ф2 и ф3, которые будут правильными функциями нулевого приближения. Для определения коэффициентов в этих линейных комбинациях нужно составить вековое уравнение второго порядка, которое отвечает блоку матрицы W, выделенному пунктиром: (О-В1)) а2 - (АЭ/2) аъ = О, а2 = О, так что = 0,2071 Ар, ф2 = а2(р2 + «3Фз = 0,9239<р2 + 0,3827ф3; Е{31) = -1.2071АР, фз = 0,3827ф2 - 0,9239ф3. Таким образом для собственных значений получим: / 1 2 3 4 а + 2р а а а-2C 0 0,207*|3 -1,207*р *Р Ер) 0,188 ^р 0,125 ^р -0,125 ^р 0,188 ^р а + 2,188р а + 0,296р а-1,296р а- 1,188р 17 ТОНН а + 2,17р а + 0,31р а- 1,00р а-1,48р Для занятых орбиталей §х и ф2 орбитальные энергии получаются достаточно близкими к точным, тогда как для вирту- виртуальных орбиталей (незанятых) ф3 и ф4 точность уже не столь хороша (даже уровни Е3 и Е4 пока что имеют неправильный порядок рас- расположения). Такой результат достаточно характерен для задач, в которых требуется находить не только энергию основного, но и возбужденных состояний. Что же касается полной л-электронной энергии Ел = 4а + 4,968C, то она также хорошо воспроизводит точную величину: ?лточн = 4а + 4,962р. Глава VIII Тонкие взаимодействия и кристаллическое поле § 1. Спин-орбитальное и спин-спиновое взаимодействие Особенности электронных волновых функций определяются не только межэлектронным взаимодействием, т.е. электронной кор- корреляцией, приводящей к большим или меньшим отклонениям от одноэлектронного приближения, но и рядом других взаимодействий, пока не учитывавшихся. Другими словами, в гамильтониане молеку- молекулярной системы пока не принимался во внимание ряд слагаемых, приводящих подчас к хотя и не очень сильным, но весьма характер- характерным эффектам. Такие взаимодействия обычно носят название тонких и сверхтонких, а вызываемые ими расщепления вырожденных энергетических уровней обуславливают тонкую и сверхтонкую структуру атомных и молекулярных спектров. а. Спин-орбитальное взаимодействие. Если отвлечься на момент от квантовомеханического движения электрона в молекуле (в поле ядер и других электронов), то можно вспомнить, что движу- движущийся электрон, обладающий зарядом и магнитным моментом, со- создает вокруг себя электромагнитное поле, взаимодействующее с другими частицами. С другой стороны, все частицы, движущиеся относительно какой-либо одной из них (например, того же электрона), должны также создавать поле, взаимодействующее, в частности, с магнитным моментом этой частицы. Так, электрон в одноэлектронном атоме находится в поле ядра, причем ядро будем считать помещенным в начало системы коорди- координат. Оно создает кулоновское поле, напряженность которого в каж- каждой точке пространства равна Е. С точки же зрения наблюдателя, находящегося в месте расположения перемещающегося электрона, ядро движется и, следовательно, создает вокруг себя и электричес- электрическое, и магнитное поле. В простейшем случае, когда электрон движется 391
относительно ядра прямолинейно и равномерно со скоростью v/9 ядро в месте нахождения электрона создает электромагнитное поле, характеризуемое (в "электронной" системе координат, т.е. с началом на электроне) напряженностями Е'иН', связанными с Е, как следу- следует из теории относительности, соотношениями: Е' = Е, Ехр,. (8.1.1) Магнитное поле напряженности Н' будет взаимодействовать с собственным магнитным моментом электрона, что приведет к появле- появлению в гамильтониане члена, пропорционального s; • Н', т.е. s, • (Expj)l. Подобного типа выражения возникают и в квантовомеханическом операторе Гамильтона при переходе от уравнения Дирака-Кулона (см. § 5 гл. II) к нерелятивистскому пределу и представлении оператора релятивистского уравнения в виде ряда по степеням р/тс , где р - импульс электрона, т - его масса. При этом члены, которые зависят от спина и появляются в гамильтониане помимо фигурирующих в обычном уравнении Шредингера, будут иметь вид е тс 2т2с2 (8.1.2) так что полный оператор ГамильтонаН = Но + #s0, аЯ0- бесспино- бесспиновый нерелятивистский гамильтониан. Напряженности Е и Н могут быть обусловлены внешним элек- электромагнитным полем, но они имеют и слагаемые, определяющиеся теми полями, которые связаны с движением частиц в системе, если система многочастичная. При переходе к такой системе обобщение выражения B) производится обычным образом: берется сумма по всем возможным взаимодействиям частиц между собой. Так, для электрона с индексом /, находящегося в точке г;, напряженность Е,-, создаваемая всеми остальными частицами (каждая из них порож- порождает кулоновское поле, а суммарный потенциал ф этого поля в каждой точке пространства создается всеми частицами), Б,- =-grad,-(p = 1*9- а R; (8-1.3) ia Выражение A) справедливо лишь при переходе к другой инерциальной системе координат. Конечно, в системе, где частицы совершают финитное движение, оно несправедливо, но на достаточно малом временном интервале его можно считать выполняющимся хотя бы в среднем. 392 а - индекс ядра с зарядом Zae, R;a - вектор длины Ria, направленный от ядра а в точку расположения электрона /, г,у - аналогичный вектор с началом на электроне у, е - абсолютная величина заряда электрона. Напряженность магнитного поля в той же самой точке будет определяться выражением: га х P ia R ia е тс (8.1.4) Р/а = Р/ - Ра * Pij - Pi " Р/> Яа = Zae- Подставляя C) и D) в выражение, получаемое при суммиро- суммировании B) по индексам всех электронов, и пренебрегая первой суммой в D), поскольку она содержит множители вида l//wa, a массы ядер более чем на 3 порядка превосходят массу электрона, придем к оператору _2 н . = so 2m V ¦2'i a , (8.1.5) где lia = Ria x pt - оператор углового момента электрона относитель- относительно ядра а и /;у = Гц х pt - оператор углового момента электрона / относительно электрона у. Оба эти момента, будучи умноженными на цв = еЙ/2/ис, приводят к соответствующим магнитным моментам ц, тогда как (e^/2/wc)s; отвечает спиновому магнитному моменту ц^. Следовательно, оператор E) содержит линейную комбинацию членов, каждый из которых есть произведение того или иного орбитального магнитного момента на спиновый магнитный момент, а потому этот оператор и носит название оператора спин-орбитального взаимо- взаимодействия, что отражено в его обозначении Hs0. Слагаемые по / в первой сумме отвечают спин-орбитальному взаимодействию спино- спинового и орбитального магнитных моментов одного и того же электрона, обусловленному электрическим полем ядер; аналогичные слагаемые по / во второй сумме - такому же взаимодействию, но связанному с электрическим полем других электронов; наконец, третья сумма отвечает взаимодействию спинового магнитного момента одного электрона с магнитным орбитальным моментом другого электрона (так называемое взаимодействие "спин - другая орбита"). Очень часто коэффициенты пйред произведениями вида lia'St аппроксимируют некоторыми усредненными числовыми значениями ;а, которые получили название постоянных (констант) спин-орбиталь- 393
ного взаимодействия. При такой аппроксимации выражение E) пере- переходит в следующее: **so = ¦/aria *si 2 Л-0 (8.1.6) Здесь не выписана последняя сумма в E), поскольку ею в таком при- приближении очень часто пренебрегают, как дающей в среднем замет- заметно меньший вклад, чем слагаемые, выписанные в F). б. Проявления спин-орбитального взаимодействия. Пос- После такого, хотя и весьма упрощенного, но достаточно громоздкого обоснования можно обсудить те следствия, которые определяются спин-орбитальным взаимодействием. Рассмотрим сначала простой пример. Пусть имеется одноэлектронный атом, для которого, как сле- следует из F), оператор Hso будет очень простым: Hs0 = l=/-s. В отсут- отсутствие этого оператора бесспиновое уравнение Шредингера сводится к задаче о водородоподобном атоме, решениями которой являются функции (os - спиновая функция: либо а, либо C), а собственными значениями (связанных состояний) невозмущенного оператора- величины 2 ' При этом ради простоты принято, что ядро находится в начале сис- системы координат, и использована атомная система единиц. Операторы / и s не действуют на радиальную функцию Rn /, так что при дальней- дальнейшей записи ее можно опустить, и использовать обозначение |/, т; sp> для произведения Y\m os. Кроме того, оператор l-s = l^x + ljsy + ljsz можно представить через операторы повышения-понижения (см. п. б § 2 гл. II): (/± = lx ± Ну, s± = sx ± iSy). Все операторы, стоящие в правой части этого равенства, не выводят функции |/, т; sp> за пределы простран- пространства функций с одним и тем же / и не меняют спинового квантового числа s = 1/2. Они меняют лишь т и sz. Оператор tys можно рассматривать как возмущение V ис- исходного оператора Гамильтона Но. При заданных / и s функции |/, т; 394 отвечают одному и тому же значению энергии, т.е. вырождены. Для того, чтобы найти правильные (по теории возмущений) функции нулевого приближения, необходимо записать линейные комбинации Ф* = У. ск m,s Ъ m>sz >' составить систему линейных уравнений и найти ее решения. Чтобы не загромождать текст общими выклад- выкладками, положим / = 1. Тогда т = 1, 0, -1 и имеется 6 базисных функций 11,1; 5^, [1,0; 5^ и 11, -1; sp>, причем sz = ± 112. Согласно результатам § 2 гл. II имеем: /±|/,/w±l;sr > = l,m;sz ± ) \l,m±l;s i ± s что приводит к следующей матрице оператора возмущения m;sz 1; 1/2 1; -1/2 0; 1/2 0; -1/2 -1; 1/2 -1; -1/2 1; 1/2 1/2 0 0 0 0 0 1; -1/2 0 -1/2 л/2/2 0 0 0 0; 1/2 0 V2/2 0 0 0 0 0; -1/2 0 0 0 0 V2/2 0 -1; 1/2 0 0 0 V2/2 -1/2 0 -1; -1/2 0 0 0 0 0 1/2 Определение ее собственных значений и коэффициентов ск;т^ дает следующие выражения для правильных функций нулевого приближе- приближения и соответствующих поправок первого порядка к невозмущенной энергии Ф1 = 1,1; 1/2 > = 7 2, (8.1.8) Фб = 395
Нетрудно убедиться, что функции ф; являются не только пра- правильными функциями нулевого приближения, но и точными собствен- собственными функциями оператора Но + Hso (после умножения их на одну и ту же радиальную функцию Rn /). Кроме того, функции ф2, Фз, Ф4 и Ф5 не являются собственными для операторов lz и sz, т.е. несмотря на симметрию поля, в котором находится электрон, в этих состояни- состояниях проекция углового момента не сохраняется. Можно проверить, однако, что эти функции являются собственными для операторов пол- полного момента (8.1.9) Собственное значение У2 Л 15 4 Ф1 3 " 2 (И 3 2 Ф2 15 4 1 2 Функция Фз 4 2U 1 2 Ф4 ) 4 1 "г Ф5 3 4 1 ~2 Фб 15 4 3 " 2 Таким образом, спин-орбитальное взаимодействие для водо- родоподобного атома в шестикратно вырожденном 2Р-состоянии при- приводит к расщеплению вырожденного уровня на два: Eq + \12 и Eq - !=, первый из которых четырехкратно вырожден и отвечает квантово- квантовому числу полного момента у = 3/2, тогда как второй двукратно вырожден и отвечает у =1/2. Нетрудно заметить, что эти значения у равны соответственно / + s и / - 5, т.е. тем значениям, которые и должны получаться при сложении моментов (см. п. д § 2 гл. II). Вели- Величина расщепления равна 3^/2 и зависит, очевидно, от постоянной спин- орбитального взаимодействия. Коль скоро 3; есть некоторое среднее от величины, пропорциональной 1/Ria, то основной вклад при усреднении будет получаться от области пространства вблизи ядра, т.е. от тех волновых функций, которые заметно отличны от нуля вблизи ядра и даже в молекулах носят существенно "атомный" характер. В то же время следует учесть, что s-орбитали вклада в спин-орбиталь- спин-орбитальное взаимодействие не дают. В целом постоянные спин-орбитального взаимодействия за- зависят от заряда ядра, а также от главного п и орбитального / квантовых 396 чисел: \п\. Можно прямым вычислением показать, что в водородо- подобных атомах \п\~~ Z^ir?. В многоэлектронных атомах происходит экранирование ядра электронами, и зависимость от Z и п становится не столь резко выраженной и более сложной. В любом случае спин- орбитальное взаимодействие наиболее велико для электронов внут- внутренних оболочек тяжелых атомов, а в молекулах - для электронов внутренних оболочек атомных остовов, что позволяет и для молекул характеризовать величины этого взаимодействия с помощью атом- атомных постоянных. Возникающее расщепление уровней, вырожденных в отсут- отсутствие спин-орбитального взаимодействия, проявляется как тонкая структура спектров. Так, у щелочных металлов низший возбужденный уровень 2Р расщепляется на два: 2Рз/2 и 2Р\/2- У Na (Z= 11, и = 3) это расщепление составляет -17 см, у К (Z= 19, п - 4) -58 см, тогда как у Cs (Z= 55, п = 6) оно достигает уже величины 554 см. У атомов галогенов эти расщепления для «^-электронов еще боль- больше, а постоянные !;„/ для F 272 см, для С1 587 см, а для I 5060 см. При таких больших величинах \п\ квантовые числа L и S, а также и понятие мультиплетности теряют смысл, что приводит к необходимости рассматривать лишь полный момент импульса от- отдельного электрона (/;) и момент импульса всей системы в целом Запреты на переходы между уровнями с разной мультиплет- ностью также снимаются, что приводит, например, к появлению в спектрах полос, отвечающих переходам между триплетными и синг- летными состояниями (так называемая фосфоресценция). Интенсив- Интенсивность таких переходов обычно тем больше, чем больше матричный элемент оператора спин-орбитального взаимодействия на функциях тех состояний, которые участвуют в переходе. Выше оператор спин-орбитального взаимодействия был за- записан в виде, включавшем спиновый магнитный момент электрона и орбитальные моменты электронов относительно различных точек про- пространства. Без сомнений, этими членами не исчерпываются все сла- слагаемые этого оператора: в него должны быть включены операторы, отвечающие взаимодействию спиновых магнитных моментов ядер с орбитальными магнитными моментами электронов и ядер. Однако, поскольку получаемые при этом выражения обратно пропорциональ- пропорциональны массам частиц, фигурирующих в таких слагаемых, то соответ- 397
ствующие члены будут приводить к заметно меньшим расщеплени- расщеплениям, обуславливающим наряду с другими факторами сверхтонкую структуру энергетического спектра. Так, оператор спин-орбитально- спин-орбитального взаимодействия электронов и ядер имеет вид Г/SO Меп = lia 'i (8.1.10) где aia = 2ga\in\iB/R^a , цвЛ1а3 = eh/2mc - боровский магнетон (для электрона), \хп = ehl2mpc - ядерный магнетон (масса тр равна массе протона) и /а - спин ядра а. Постоянная ga, носящая название g- фактора для ядра а, есть коэффициент пропорциональности между спином ядра, умноженным на \хт и его магнитным моментом. Свя- Связанное с Н™ расщепление составляет обычно величины порядка нескольких тысячных обратного сантиметра (см): например, для состояния2?j/2 атома Na усредненная величина aia= 94,5 МГц, а для состояния 2р3/2 19,1 МГц, т.е. примерно 0,003 - 0,001 см. в. Спин-спиновое взаимодействие. Это взаимодействие спи- спиновых магнитных моментов электронов и ядер имеет такое же про- происхождение, что и спин-орбитальное взаимодействие. Спин-спиново- Спин-спиновому взаимодействию электронов отвечает следующая составляющая полного гамильтониана: HL = г5 ч (8.1.11) Здесь ge - электронный g-фактор, равный для свободного электрона 2,002319. В круглых скобках, как всегда, стоят скалярные произведения векторных операторов, так что, например, gfSj = sixsJX + з^у + sizsjz. Оператор A1) приводит к расщеплению энергетического уровня спинового мультиплета даже в отсутствие внешнего магнитного поля. По этой причине такое расщепление называют расщеплением в нулевом поле; оно характерно для каждого несинглетного состояния молекулы и определяется методом электронного парамагнитного резонанса. Так например, уровень триплетного состояния молекулы под влиянием электронного спин-спинового взаимодействия расщепляется в зависимости от симметрии электронной волновой функции, т.е. сим- симметрии ядерного остова, на две или три компоненты. Чтобы убедиться в этом, достаточно рассмотреть матрицы гамильтониана A1) для 398 двухэлектронной задачи в базисе трех функций г|>A,2)аA)аB), ц>A,2)рA)рB) и Ч)A,2)[аA)рB) + рA)аB)]Д/2 , отвечающих ком- компонентам триплета. В случае сферической симметрии системы (на- (например, атома) расщепления не происходит, при осевой симметрии (линейная молекула) уровень расщепляется на два и при симметрии группы D2/, или более низкой - на три уровня, как показано на рис. 8Л.1. Величина расщепления при симметрии D2/, определяется двумя так называемыми параметрами расщепления в нулевом поле: D=3<фаа >> (см. рисунок). При и ? = <г|>аа D > 0 и ? > 0 низший уровень отделен от среднего на величину D - Е, а от верхнего - на D + Е. Как правило, \D\ < 0,1 - 0,2 см (за исключением ряда радикалов типа метилена, где | D | достигает величины 0,7 -2,0 см), а \Е\ < 0,01 - 0,05 см . Спин-спиновое взаимодействие собственных магнитных мо- моментов электронов и ядер, а также ядер с ядрами представляется такого же типа операторами, что и A1) с частичной или полной заменой s-l; 8- "I, 1 У ЕЛ- D/3 s - 1; \ - -1, 0, 1 \ -2D/3 Чч ..-о {DJ3)-E D+E D-E 2D/3 °1 sz'° о, = |0> Осевая Симметрия симметрия D Атом Рис. 8.1.1. Расщепление в нулевом поле уровня триплетного состояния. Обозначения спиновых функций: |1> ¦ |аа>; |0> = (|сф> + |Ра>) / V2 и |-1> = |РР>. D и Е - параметры расщепления в нулевом поле; sx, syw sz- собственные значения операторов sx, s и sz соответственно. 399
операторов s,- на операторы /а и с соответствующей заменой рассто- расстояний между частицами1. Так, ядерное спин-спиновое взаимодействие, обычно представляемое оператором ss = 2, ^аР ^а " ^Р ) > характеризуется постоянными (константами) Jaa ядерного спин-спи- спин-спинового взаимодействия, зависящими от расстояния между ядрами как Rj?, в силу чего их обычно определяют только для пар близко расположенных ядер. В большинстве случаев для таких пар ядер 20 <JaR < 250 Гц A Гц « 3,336* КН1 см~1). Эти постоянные, как и постоянные расщепления в нулевом поле, а также постоянные элек- электрон-электронного и электрон-ядерного спин-спинового взаимодей- взаимодействия являются характерными величинами для каждой молекулы, для каждого окружения ядра а или пары ядер аир другими ядрами. г. Методы электронного парамагнитного и ядерного маг- магнитного резонанса (ЭПР и ЯМР). Эти методы основаны на ис- использовании расщепления вырожденных уровней энергии молекулы (или атома) во внешнем поле. Как уже говорилось в § 4 гл. II, нали- наличие магнитного момента у системы, равного для подсистемы элект- электронов \ir(L + gS), где L hS- орбитальный момент и спин, a g « 2,0, приводит при наличии внешнего магнитного поля напряженности Н к появлению в гамильтониане членов вида , (8.1.12) к которым должны быть добавлены все обсуждавшиеся выше опе- операторы спин-орбитального и спин-спинового взаимодействия. Пред- Предположим пока ради простоты, что L = 0, т.е. орбитальный момент отсутствует1. Тогда остается так называемый электронный спино- спиновой гамильтониан вида (8.1.13) 1 В выражении A1) при этом оставляют обычно лишь члены, содержащие скалярные произведения спиновых операторов, поскольку остальные слагаемые дают заметно меньший вклад. 2 Этот случай весьма характерен для многоатомных молекул, поскольку поле ядер в них, как правило, не обладает высокой симметрией и электронный угловой момент не сохраняется, не является интегралом движения, так что среднее значение его в стационарном состоянии обращается в нуль. Для уже упоминавшейся двухэлектронной задачи, например для ато- атома в состоянии 3?, находящегося в поле симметрии D2/,, этот гамиль- гамильтониан может быть сведен к такому (8.1.14) где Он Е- уже упоминавшиеся параметры расщепления в нулевом поле. Первое слагаемое приводит к расщеплению исходного уровня на три равноотстоящие компоненты, тогда как второе меняет экви- эквидистантное расположение уровней (рис.8.1.2), причем эти изменения будут зависеть от того, ориентировано ли внешнее магнитное поле по направлению г, х или у либо по какому-то еще (промежуточному) направлению. энергия Е Н Атом в отсутствие сев Расщепление Расщепление полем Н в нулевом поле Атом в магнитном поле НИ О z Рис. 8.1.2. Расщепление уровней энергии атома при наличии внешнего магнитного поля (крайняя правая диаграмма отвечает случаю поля, параллельного оси Oz\ если поле параллельно оси Ох, то сохраняет свое положение уровень с sx = 0 и т. д.). Если к тому же рассмотреть для этой задачи матричные эле- элементы дипольного момента перехода, то можно установить, что пе- переходы разрешены только для состояний А/и5 = ± 1, где ms - квантовое число проекции спина (-1, 0 и +1 в данном случае) на направление внешнего поля. Следовательно, можно наблюдать два перехода (-1 -» 0 и 0 -* 1) с разными частотами, причем эти частоты зависят от напряженности внешнего поля Н и от ориентации молекулы отно- относительно направления поля. В отсутствие спин-спинового взаимодей- взаимодействия наблюдалась бы только одна частота перехода, поскольку пе- переходы -1 -» 0 и 0 -* 1 по частоте совпадали бы. В целом же тонкая структура спектра, обусловленного такими переходами, будет зависеть 400 401
от параметров расщепления в нулевом поле, которые в свою очередь тесно связаны со структурой молекулы. Экспериментально это построение реализуется в методе элек- электронного парамагнитного резонанса (в английской транскрипции на- название метода несколько точнее соответствует лежащей в его осно- основе идее: electron spin resonance, ESR). В методе ЭПР как раз иссле- исследуются расщепления вырожденных уровней мультиплетных состоя- состояний молекул, возникающие под влиянием внешнего магнитного поля, и тонкая структура наблюдаемых спектров, связаных с переходами между расщепленными компонентами этих уровней. Весьма похожие идеи лежат в основе метода ЯМР, в котором также наблюдаются переходы между расщепившимися в магнитном поле компонентами, обусловленными различными проекциями маг- магнитных спиновых моментов ядер на направление поля, а тонкая струк- структура таких спектров ЯМР связана с наличием межъядерного спин- спинового взаимодействия. Отметим лишь, что если метод ЭПР может быть применен к системам в состояниях с мультиплетнос- тью, большей 1, то метод ЯМР пригоден для всех тех систем, в кото- которых есть ядра с отличным от нуля спином (!Н, 13С и др.). Задачи 1. Провести полностью рассмотрение расщепления во внеш- внешнем магнитном поле уровней дублетного и триплетного состояний с учетом расщепления в нулевом поле. 2. Пусть имеется состояние 2Р атома В. Какова должна быть структура уровней для этого атома, если учитывать спин-орбиталь- спин-орбитальное взаимодействие ? 3. Рассмотреть решения задачи с гамильтонианом A4) для дву- хэлектронной системы в триплетном состоянии при условии, что поле направлено вдоль оси: a) z\ б) х\ в) у. § 2. Теория кристаллического поля и теория поля лигандов В химии сравнительно часто встречаются соединения, в которых внешнее окружение того или hhof'o атома (иона) или группы атомов оказывает сравнительно слабое воздействие на них, так что их влияние, по крайней мере при начальном рассмотрении, может быть принято за возмущение. К тому же в подобных системах внешнее окружение имеет, как правило, высокую симметрию, что позволяет прежде всего учесть влияние окружения для вырожденных уровней и найти правильные (по симметрии) волновые функции нулевого при- приближения и уровни энергии в первом порядке теории возмущений. Обычно при этом имеется некоторый центральный атом либо ион, например переходного металла, и его окружение в виде тех или иных симметрично расположенных лигандов1, хотя в качестве центральных могут встретиться и группы атомов, например уранильная группа UO2. Поскольку внешнее поле часто создается также кристаллическим полем, т.е. окружением иона в кристалле, и именно эти задачи были начальными при построении излагаемого ниже подхода, он получил название теории кристаллического поля. а. Одноэлектронная задача. Атом с р-элекмроном. Пусть имеется некоторый атом или ион, который имеет на внешней р-оболочке один электрон (часто говорят в этих случаях об одном р- электроне), а остальные его электроны можно рассматривать вместе с ядром как некий эффективный остов. Если теперь поместить этот атом во внешнее поле, обладающее более низкой симметрией, чем сферическая, то, вообще говоря, произойдет расщепление р-уровня. При этом в поле октаэдрической и тетраэдрической симметрии вы- вырождение сохранится, тогда как в поле с симметрией правильного квадрата (D4h) уровень расщепится на два (типа А\и и типа Еи% в поле тригональной симметрии (D3/,) -также на два (А"и ?"), а в поле симметрии D2h ~ на три (В1и, В2и и #зы)- Такое рассмотрение можно продолжить на поля другой симметрии, однако общая картина, по- видимому, достаточно ясна. Если вместо р-электрона имеется d-электррн, то расщепления возникают уже в полях и октаэдрической, и тетраэдрической симмет- симметрии: в первом случае - на два уровня состояний типа Eg и T2g, во втором - также на два уровня состояний типа Е и Т^1- При более низкой симметрии появляется система из трех уровней (например, для Deh: AAg + Elg + E2g ; для D3h: A' + ?'+ ?"), а при дальнейшем 1 Слово "лиганд" происходит от немецкого Liegand, означающего нечто лежащее. Исходное ударение в нем падает на первый слог, хотя очень часто в русском языке его произносят как лиганд. 2 Обычно в теории кристаллического поля трехкратно вырожденные представления обозначают буквой Т, а не F, чему мы и будем следовать ниже. 402 403
понижении симметрии - из 4 и 5 уровней (например, для D4h: B2g + Eg > B 2g и тп)- g g g g g g ) Открытым вопросом при этом остается, какой из получаемых уровней будет лежать ниже, какой выше. Для того, чтобы ответить на него, необходимо решить соответствующее вековое уравнение с возмущением, определяемым лигандами. Однако, поскольку для любой из точечных групп можно сказать, по какому из неприводи- неприводимых представлений преобразуется та или иная (р- или d-) функция либо линейная комбинация этих функций, то можно непосредственно оценить, каковы должны быть средние значения энергии на этих фун- функциях. Для этого к тому же можно использовать качественные рас- рассуждения о том, какие интегралы должны быть меньше, а какие боль- больше, и каков у них должен быть знак. Пусть, например, взята задача о центральном атоме (катионе) с одним р-электроном при внешнем поле тригональной симметрии, создаваемом тремя точечными лигандами 1,2 и 3, лежащими в плос- плоскости ху9 так что лиганд с индексом 1 находится на оси Ох, как то изображено на рис. 8.2.1. Орбитальрг преобразуется по представле- У У Рис. 8.2.1. Поле тригональной симметрии и орбитальрг центрального атома. нию A<i\ орбиталир^ иру - по представлению Е. Возмущение, вноси- вносимое лигандами, можно записать в виде суммы вкладов от каждого лиганда: V^(r) + V2(r) + V3(r). Энергия состояния я2" будет тогда представляться следующим образом: Е(а2") = <рг |Я0 + Vi + V2 + V3\pz> = Ео + 3C, (8.2. la) 404 где р = < pz \Vt \pz >. Если лиганд - точечный положительный заряд, то Р < 0, при точечном отрицательном заряде C > 0. Для состояния е' можно вычислить среднее значение гамильтониана лишь на одной компоненте: E(e')=EQ+<px\Vl + Введем следующие обозначения: <px\V1 \px> «аи, очевидно, <ру | V1 \ру> = <рг | V1 \pz> = р. Кроме того, заметим, что орбитали рх иру можно записать через орбиталирд/ нру', повернутые относитель- относительно исходных на угол ф (в положительном направлении): рх = cosqp рх - sinqp py\ ру = втф рх' + совф ру\ При рассмотрении интеграла <рх |V2 \px> можно представить тогдард.через орбитальрх\ направленную к лиганду 2, и орбитальр^'. Для этого надо выполнить поворот на угол ф = 2л/3 : <Px\V2\Px> = <р \рхг> sin2qp |V2 С учетом введенных выше обозначений и того, что интеграл <рх | V2 \py'> по соображениям симметрии равен нулю, в результате получим <Рх\У2\Рх> = \Рх> = Т« + I так что окончательно (8.2.16) Опять-таки из качественных соображений можно с уверенностью утверждать, что Щ < \а\. Поэтому при наличии точечных лигандов с положительным зарядом, когда а, Р < 0, низшим уровнем будет Е(е'% а высшим - Е(а2") : о тогда как при лигандах с отрицательным зарядом расположение уров- 405
ней меняется на обратное. Обычно при построении таких энергети- энергетических диаграмм в качестве нуля отсчета берут ту величину энер- энергии, которая отвечает сумме Ео и общего для всех уровней сдвига, обусловленного сферически симметричной частью потенциала. В данном случае такой величиной будет Eq + а + 2C. б. Одноэлектронная задача. Атом с d-электроном. Со- Совершенно аналогично можно рассмотреть задачи об относительном расположении уровней атома с одним d-электроном в полях различ- различной симметрии. Например, в поле октаэдрической симметрии при 6 эквивалентных точечных лигандах в вершинах октаэдра будем иметь E(eg) =¦ _у 4а (8.2.2а) где а = <dx2_y2\V1\dx2_ 2 > и р = <dx2_ 2 8.2.2). Для трехкратно вырожденного уровня Vcd 2 2 > (см. рис. J x -у v r Vi (г) = ?0+4a' (8.2.26) причем а' = = < > . О соотношении величин а и а' говорить трудно, однако численные оценки со слэтеровскими (или водородопо- добными) функциями показывают, что а > а'. О 4а' ¦/¦ 1,6а + 2,4а' 1,6a + 2,4a'+ 2p \ \ 4а '+20 Рис. 8.2.2. Влияние кристаллического поля октаэдрической (О ) и тетра- эдрической (Td) симметрии на орбитальные энергии атома с одним ^-электроном. В поле тетраэдрической симметрии (см. тот же рисунок) ре- результаты получаются весьма похожие: x -У E(e) =?0 + 4a (a = <dx2_y: E(t2) = Eo + 4a' (a' = <dxyVl d^ причем опять-таки численные оценки приводят к соотношению a < а'. Следовательно, общая картина расщепления d-уровня в полях раз- различной симметрии будет выглядеть так, как показано на рис. 8.2.3. Очевидно, что для каждого поля той или иной симметрии величины Eq будут, вообще говоря, различными, и лишь для удобства сопостав- сопоставления расщеплений в качестве нуля отсчета, например для поля сим- симметрии ld, принята величина Ео + 1,6а + 2,4а', а расстояние 4а' - 4а между уровнями Е(е) и E(t2) обозначено через А (так что 3E(t2) + 2Е(е) = 0): E(t2) = 0,4Д, Ео = 0, Е(е) = -0,6Д. Для системы с одним электроном все состояния будут дуб- дублетными. Однако, как сказано в предыдущем параграфе, существует ч е C3v MXY3 MX атом (ион) MX MX4Y MX, Рис. 8.2.З. Расщепление ^-уровня в полях различной симметрии. Для каждого типа симметрии общий сдвиг уровней, обусловленный сферически симметричной частью потенциала, принят за нуль отсчета. Указаны также общие формулы соединений, которые могут иметь соответствующий тип симметрии. 406 407
спин-орбитальное взаимодействие, которое приведет к дополнитель- дополнительному расщеплению уровней. Так, уровень t2, которому отвечают 6 функций = dY7a , = d xz (8.2.4) при наличии спин-орбитального взаимодействия, представляемого оператором Hs0 = %/-s = Q=J2)(l+s_ + l_s+ + 2/^), расщепится на два, которым будут отвечать в первом порядке теории возмущений энер- энергии ?i(/2) ¦ ?о + 4ct' + § и ?2(^2) e ^о + 4ot' - §/2 , причем первый из них будет вырожден двукратно, а второй - четырехкратно. Волновые функции будут линейными комбинациями функций г|>;. Например, для уровня Е\ в нулевом порядке теории возмущений (8.2.5) Следует заметить, что в отсутствие сферической или цилиндричес- цилиндрической симметрии электронные волновые функции уже не будут собствен- собственными для операторов моментов импульса (Z2, s2 vtj2). Классифициро- Классифицировать же состояния при малом возмущении, вносимом спин-орбиталь- спин-орбитальным взаимодействием, можно по типам симметрии, добавляя при необходимости дополнительные индексы, например at2 и Ы2. Возможна, однако, и обратная ситуация, когда спин-орбиталь- спин-орбитальное взаимодействие велико, а кристаллическое поле, создаваемое лигандами, слабое. В этом случае в качестве возмущения удобно взять поле лигандов V = ^ .Vi¦,, а оператор спин-орбитального взаимо- взаимодействия включить в невозмущенный гамильтониан. Функции (8.2.4) должны быть дополнены еще четырьмя: после после чего имеет смысл вспомнить, что операторы /v и sv (v= jc, у, z) не выводят соответствующие сомножители в грг за пре- пределы пространств функций с заданными / и s (в данном случае 2 и 1/2 соответственно). Кроме того, при наличии спин-орбитального вза- взаимодействия для свободного атома функции будут собственными для оператора j2 = (I + sJ с собственными значениями / + s, / + s - 1,..., |/ - 51, т.е. 2 + 1/2 = 5/2 и 2 - 1/2 = 3/2 . Найти отвечающие этим 408 собственным значениям функции несложно. Прежде всего отметим, что функции е2/'Ф + e-2i<p 2_ 2a = R(r)sin2Ъ а, 2/ а составлены как сумма и разность функций, собственных для /2 и sz В частности, есть функция, собственная для jz=lz + szc собственным значением 4 и для j2 с собственным значением f (f +1) = f . Действуя на эту функцию оператором j_ = /_ + s_ , будем получать собственные для jz функции с меньшими значениями^: j- Ф5/2, 5/2 = С- + ОФ5/2, 5/2 = JU + JzXJ-Jz +1> Ч>5/2, 3/2 - = >/5ф5/2,з/2 « R(r)sin2^2^ а + e2i(p Р ), так что и далее Ф5/2, 1/2 Ф 5/2,-1/2 Ф5/2,-з/2= Ф5/2.-5/2 - Заменяя в этих выражениях е±2/(Р на cos2cp ± isinly и е±/(Р на coscp ± isincp, а также е/Оф на 1, получим выражения дая q>s/2,jz не" посредственно через функции г|^ . Получающиеся линейные комби- комбинации хоть и просты, но громоздки, в силу чего выписывать их не будем. Важно лишь то, что появляются 2 терма 2D5/2 и 2D3/2, кото- которые при введении кристаллического поля расщепляются далее на 409
компоненты в зависимости от симметрии поля (см. выше задачу об одном d-электроне). Обычно для атомов расщепления термов с различными j не- невелики, что определяет тонкую структуру атомных спектров. Гораз- Гораздо большие расщепления возникают в тех случаях, когда на исходной вырожденной оболочке находится не один электрон, а несколько. в. Случай двух электронов. Рассмотрим основные черты тех результатов, которые получаются при переходе к системам с нескольки- несколькими электронами на вырожденной оболочке, например к системе с двумя d-электронами. В такой задаче число состояний, отвечающих одной и той же конфигурации, заметно возрастает. Действительно, если использовать в качестве базиса функции D) и F) при рассмотрении двухэлектронных конфигурационных функций состояния Ч^ >то полное число различных однодетерминантных функций, которые можно построить на этом базисе, будет равно: cf0 = 45 (число сочетаний из 10 функций по 2). Часть таких детерминантов будет отвечать три- 7 1 1 1 плетным состояниям: их число равно 2С5 + -^С5 С4 = 30 (первое слагаемое - число детерминантов с одной и той же спиновой функ- функцией типа detjd^a, dxza} , второе - с различными функциями типа det{d^a, dxzfi} + det{dL,p, dxza}). Оставшиеся 15 функций отвечают синглетным состояниям. Все эти состояния для свободного атома можно классифицировать далее по квантовым числам полного мо- момента импульса L = 1\ + /2 • При этом, однако, удобнее работать не с функциями dxy , dxz и т.п., а с функциями, собственными для про- проекции момента /2. Введем для этих функций обозначение |/, т; s, sz> и для нашего конкретного случая опустим ради простоты символы / = 2 и s = 1/2. Тогда одноэлектронные базисные функции будут следующими: Ф! = |2,1/2>, ф2 - |1, 1/2>, ф3 = |0,1/2>, ф4 = |-1,1/2>, ф5 = 1-2, Ф6 = |2,-1/2>, ф7 = |1,-1/2>, ф8 = |0 ,-1/2>, ф9 = |-1-1/2>, ф10 = |-2, Любое произведение двух таких функций характеризуется вполне определенными значениями Lz = /lz + l2z и Sz = su + s2z . Так, 1фA) ф2B) = 3-Ф1A) Ф2B), 5,ф1A) ф2B) = 1-ф1A) ф2B) и т.п. ) ,ф1() ф2() ф1() ф2() и .п. Максимальная проекция Lz и, следовательно, максимальное квантовое число полного момента импульса равно 4 для функции Ч^ = det{|2, l/2> , |2, -1/2>}. Эта функция отвечает 9-кратно вырожден- вырожденному состоянию 1G. Остальные функции этого состояния могут быть 410 получены при действии оператора L_ на функцию у?1. Они уже будут представлять собой в общем случае линейные комбинации одноде- однодетерминантных функций. Другим синглетным состояниям отвечают W2 = detfll, l/2>, |1, -1/2>} и W3 = det{|0,1/2>, |0, -1/2>} с квантовыми числами полного момента 2 и 0, а также функции, которые получают- получаются из Ч*2 и Ч*з при последовательном действии оператора L_. Эти состояния по обычной классификации должны быть обозначены как lD и lS (всего получится 5 + 1=6 функций, что с 9 функциями для состояния 1G даст указанное выше число 15). Функции триплетных состояний представляются похожим спо- способом: выбирается любая пара функций ф( с одной и той же спин- функцией, записывается двухэлектронная функция, например Ч*4 = = det{|2, l/2>, |1,1/2>}, после чего из нее строятся две другие компо- компоненты триплета с помощью оператора 5— Функция W4 отвечает кван- квантовому числу полного момента L = 3, т.е. это - одна из функций 3F- состояния. Функции второго триплетного состояния получаются с по- помощью оператора!,- из функции Ч*5 = det{|l, l/2>, |0,1/2>}; они отве- отвечают L = 1 и состоянию ЪР. Таким образом, получается 3 синглетных и 2 триплетных состояния, которые за счет межэлектронного взаимодействия будут иметь различную энергию. Какое из этих со- состояний основное и какова последовательность возбужденных состо- состояний, ответить без количественных оценок энергии в рамках рассмат- рассматриваемого одноэлектронного приближения затруднительно. Можно лишь сказать, что состояние с максимальной мультиплетностью бу- будет скорее всего основным, а если таких состояний несколько, то ниже по энергии будут те состояния, орбитальная структура которых по- позволяет электронам находиться как можно дальше друг от друга (как уже говорилось, это утверждение называется правилом Хунда). Для конфигурации d2 низшим состоянием оказывается 37% за ним следует !Z), далее 3Р, затем !G и, наконец - !5 (см. рис. 8.2.4). Предсказать такую последовательность без численных оценок нельзя. Волновые функции, построенные указанным способом, без со- сомнений, являются приближенными, хотя и могут быть далее уточнены при введении конфигурационного взаимодействия. Их характерной особенностью является то, что они - собственные для операторов полного углового момеота/, и полного спина S многоэлеюронной систе- системы. Иными словами, эти функции построены в приближении LS-связи, или связи Рэссела-Саундерса. При наличии сильного спин-орбитально- спин-орбитального взаимодействия лучшим нулевым приближением оказываются 411
базисные функции, собственные для операторов/2 njz. В таком подходе говорят о конфигурационных функциях состояния, отвечающих jy-связи (или охо-связи, что то же). Обычно на начальном этапе рассмотрения используют приближение LS-связи. / / / / s I / а в Рис. 8.2.4. Расщепление уровней энергии для состояний, отвечающих конфигурации d1 в октаэдрическом поле лигандов: а - уровень в отсутствие взаимо- взаимодействия между электронами; б - сдвиг уровня под влиянием сферически симметрич- симметричной части потенциала межэлектронного отталкивания; в- расщепление при полном учете межэлектронного отталкивания. г. Слабое и сильное кристаллическое поле. Определение волновых функций отдельных состояний позволяет далее перейти к установлению того, как расщепляются исходные уровни при переходе к этим состояниям под влиянием кристаллического поля, которое предполагается настолько слабым, что расщепление уровней можно находить по теории возмущений. Здесь в силу вступает анализ примерно такого же типа, что и для одноэлектронной задачи, однако с той разницей, что матричные элементы возмущения должны вычисляться на двухэлектронных функциях. Не будем заниматься этими выкладками, а лишь укажем, что, например, в октаэдри- октаэдрическом поле ^-состояние расщепляется на состояния ЪТХ ЪТ2 и A2g (в порядке возрастания энергии при отрицательных лигандах), D - на lT2g и lEg и т.д. В целом конфигурация d2 порождает в октаэдрическом поле 11 состояний, а при учете спин-орбитального взаимодействия картина становится еще более сложной. 412 Если же кристаллическое поле является достаточно сильным, так что расщепления, им обусловленные, превосходят таковые от меж- межэлектронного отталкивания, то целесообразнее в качестве начально- начального приближения взять функции и уровни энергии каждого из электро- электронов в кристаллическом поле и лишь потом ввести межэлектронное отталкивание как возмущение. При таком подходе начальным оказывается то приближение, которое уже было обсуждено в п. б. Для одного электрона появляются два уровня: t2g и eg, для второго - такие же два уровня. Функции для двух электронов будут иметь вид детерминантов (или их линейных комбинаций), построенных из ба- базисных функций х; (hg)> i = 1» 2, 3 и хл (eg), k = 1, 2. Как показывает теория групп, все произведения функций, преобразующихся по каким- либо представлениям группы, также преобразуются по представле- представлению, являющемуся прямым произведением исходных. Двухэлектрон- ные функции будут, следовательно, преобразовываться по представ- представлениям T2g x T2g Го = T2g x E g f lT2g+ lEg+ xAXg (конфигурация t22), 2g + lT2g + 3^ig + 1 rig (конфигурация -Enx e о *Alg+%+lAlg (конфигурация е2). Здесь справа в равенствах выписаны представления, для которых могут быть построены соответствующие антисимметричные волновые функции либо синглетных, либо триплетных состояний, что указано слева вверху у символа представления цифрой допустимой мультиплетности состояния. Представления, порождаемые каждым прямым произведением, приведены в порядке возрастания энергии соответствующих состояний (заметьте выполнение правила Хунда для каждой конфигурации). Действительность, конечно, сложнее, чем представленные простые модели. Поэтому случаи слабого и сильного поля рассматри- рассматривают лишь как предельные, на основе которых можно построить корреляционные диаграммы, связывающие уровни состояний одних и тех же типов симметрии и представляющие зависимости уровней от некоторого параметра, характеризующего переход от слабого к сильному полю. Такие корреляционные диаграммы для большого числа электронных конфигураций в полях симметрии различных точеч- точечных групп были впервые построены японскими учеными Я. Танабе и С. Сугано в 1956 г. и называются диаграммами Танабе-Сугано. 413
д. Теория поля лигандов. Более точное рассмотрение соедине- соединений с центральным атомом, окруженным лигандами, получится, если считать лиганды не точечными зарядами, а атомами или ионами, на ядрах которых центрированы атомные орбитали, используемые для построения молекулярных орбиталей системы в целом. При этом из орбиталей лигандов предварительно получают орбитали симметрии, которые и комбинируют с орбиталями центрального атома той же самой симметрии. Пусть в простейшем случае на каждом из ядер лигандов окта- эдрического окружения центрального атома (иона) центрирована одна 5-функция, так что имеется 6 функций, переходящих друг в друга при операциях симметрии группы О/,. Эти функции порождают приводимое шестимерное представление Г, характеры которого определяются просто: это те числа лигандов, которые при операциях симмет-рии остаются на местах. Так, при операции С4 не меняют своего поло- положения 2 лиганда (на оси вращения), при отражении в плоскости а^ - 4 лиганда (лежащие в этой плоскости) и т.д. Если записать характе- характеры представления Г, а потом воспользоваться обычным соотноше- соотношением для выяснения того, какие неприводимые представления в нем содержатся, то получим Г = Aig + Eg + Tlu, так что линейные комби- комбинации s-орбиталей лигандов входят только в молекулярные орбитали указанных типов симметрии. Аналогичное построение можно выпол- выполнить и для ^-орбиталей лигандов, предварительно ориентировав их определенным образом на каждом центре: например, выбрав для каж- каждого центра ось z совпадающей с осью, которая проходит через ли- ганд и центральный атом. При этом орбитали рг всех лигандов будут преобразовываться лишь друг через друга, а орбитали рхнру дадут приводимое 12-мерное представление и т.д. В целом такой подход получил название теории поля лигандов. Он весьма близок обычному методу молекулярных орбиталей, но используется прежде всего для высокосимметричных систем с предварительным этапом построения из исходного базиса орбиталей симметрии. е. Области применения. Теория кристаллического поля и теория поля лигандов широко использовались при установлении того, какое состояние комплексного соединения является основным и ка- какова его мультиплетность (что определяет магнитные свойства ком- комплекса и его спектр ЭПР), каковы величины расщеплений для низ- низших уровней, а следовательно, и каков спектр того или иного комп- 414 лексного соединения, что будет происходить с этим спектром при понижении симметрии (при замене одних лигандов другими) и т.п. Обычно в комплексных соединениях металлов первого переходного ряда расщепления составляют от 7000 до 20000 см , а второго - примерно в 1,5 раза больше. По величине вызываемых расщеплений у одного и того же центрального атома лиганды могут быть располо- расположены в ряд, называемый спектрохимическим. Для наиболее распро- распространенных лигандов такие ряды, имеющие, очевидно, лишь каче- качественный характер, широко представлены в научной литературе. В целом теория кристаллического поля имеет прежде всего качественную направленность, хотя во многих случаях дает и вполне приемлемые количественные результаты, особенно при полуэмпири- полуэмпирическом подходе, когда параметры теории определяются из сравнения с экспериментальными величинами, например с частотами первых переходов. Успех ее связан с активным использованием симметрии соединений, которая играет определяющую роль в подобных задачах вне зависимости от уровня используемого квантовохимического при- приближения. Опора на свойства симметрии и теорию групп позволили теории кристаллического поля и теории поля лигандов достичь при всей их простоте весьма широкой области применения и продемон- продемонстрировать силу простых моделей в современной квантовой химии.
Глава IX Корреляционные диаграммы и учет симметрии § 1. Корреляционные диаграммы Корреляционной диаграммой в общем случае называют гра- графическое представление изменения энергии либо другого свойства системы при изменении параметров, определяющих эту систему (см. § 4 гл. VI). Как правило, в качестве параметров выступают межъя- межъядерные расстояния, валентные углы и другие величины, задающие геометрическую конфигурацию молекулы, либо связанные с ними величины, например порядки связей. Выше мы уже сталкивались с корреляционными диаграммами, в настоящем же параграфе будут расширены принципы, используемые при их построении, и обсуждены дополнительно возникающие воп- вопросы. о. Правило непересечения. Заметную роль при построении корреляционных диаграмм играет правило непересечения, тесно свя- связанное с наличием или отсутствием симметрии у молекулярной сис- системы. Рассмотрим сначала простой пример. Пусть электронное вол- волновое уравнение НеФ(т, R) = ?е(Л)Ф(г, R) решается вариационным методом в базисе двух функций Ф] и Ф2, так что (9.1.1) Ф = cx(R) Фх + c2(R) Ф2 , где R - совокупность переменных, задающих геометрическую кон- конфигурацию молекулы. При решении векового уравнения второго по- порядка НС, = Е,С; определятся два корня: Ех = EeX(R) и Е2 = Ee2(R). Если Ны = <Ф^|Яе|Ф/> (?,/=1,2)- элементы матрицы Н, то -Н22 f + 4Я12Я21 (9.1.2) Собственные значения Ех и Е2 зависят от R, поскольку зави- зависимость от R присуща матричным элементам Hkl. Возникает при 416 этом естественный вопрос, когда возможно выполнение равенства Е\ = Е2, т.е. когда две потенциальные поверхности EeX(R) и Ee2(R) могут пересечься? Формула B) отчетливо показывает, что равенство собственных значений достигается при выполнении двух условий: HU(R) = H22(R) и HX2(R)H2X(R) = 0. (9.1.3) Для двухатомных молекул, где имеется лишь один геометри- геометрический параметр - межъядерное расстояние Л, в общем случае сис- система уравнений C) будет несовместна, откуда следует утверждение о том, что потенциальные кривые двухатомных молекул не пересе- пересекаются. Пересечение оказывается возможным, лишь если хотя бы одно из условий C) выполняется автоматически, например, если функции Ф\ и Ф2 относятся к разным типам симметрии (преобразу- (преобразуются по разным неприводимым представлениям) и тогда - в силу теоремы Вигнера-Эккарта - недиагональный матричный элемент обращается в нуль: Нх2 ¦ 0. Поэтому более точная формулировка правила непересечения такова: потенциальные кривые двух состояний одного и того же типа симметрии, как правило, не пересекаются, тогда как кривые состояний различных типов симметрии пересекаться могут. Наличие пересечения потенциальных кривых соответствует ситуации, изображенной на рис. 9.1.1а, однако, как правило, они должны вести себя так, как показано на рис. 9.1.16. Точки Rq, где кривые I и II сближаются, называют обычно точками псевдопересечения (англ. avoided crossing). Правило непересечения было установлено JI. Д. Ландау и К. Зенером A932-33 гг.). Другой возможный случай, когда Нх2 - 0, отвечает тому, что ф1 и ф2 _ собственные функции оператора Не. Здесь также нельзя сказать, пересекаются ли ЕеХ и Ее2, поскольку никаких избыточных условий не появляется. Положение оказывается несколько парадок- парадоксальным: для точных функций определенного ответа о возможности пересечения нет, тогда как для приближенных он есть: как правило, пересечение невозможно. Однако в этой парадоксальности и заклю- заключается то, что формулируемое утверждение является всего лишь пра- правилом: раз для приближенных функций поверхности, вообще говоря, не пересекаются, то скорее всего они не будут пересекаться и для точных функций. Для многоатомных молекул в условиях типа C) содержится более одного параметра и их несовместности не возникает. Однако если взять сечение потенциальной поверхности, отвечающие одному лишь меняющемуся параметру, например Q^ и фиксированным 72 14 — 1395 417
значениям остальных параметров из множества R, то для этого сечения должно появляться опять-таки правило непересечения, коль скоро оно формально отвечает случаю двухатомной молекулы. Для любого другого аналогичного сечения правило тоже должно действо- действовать, так что можно надеяться на его выполнение и для многомерной а EJA Рис 9.1.1. Пересечение (а) и псевдопересечение (б) потенциальных кривых. поверхности. К тому же, в большинстве таких сечений исходная симметрия, как правило, понижается, различия между разными типами неприводимых представлений, характерные для групп высокой сим- симметрии, теряются и все состояния становятся состояниями одного и того же типа симметрии. Например, для группы C3v имеются непри- неприводимые представления Аь А2 и Е, При понижении симметрии, например для молекулы NH3 (при увеличении одного из валентных углов или одного из межъядерных расстояний N-H) до симметрии точечной группы С5, включающей лишь одну плоскость симметрии а, происходит следующее упрощение (так называемая редукция) не- неприводимых представлений: АХ->А'9 А2^> А'\ Е-*А'®А". Для многоатомных молекул одномерные сечения будут, как правило, соответствовать несимметричным конфигурациям, так что правило непересечения будет для них выполняться. По мере же повышения симметрии возможности для пересечения потенциальных поверхно- поверхностей (различных типов симметрии) будут становиться все большими. Отметим, что если число базисных функций Ф, превышает 2, то условие совпадения двух собственных значений все равно можно 418 представить с помощью двух соотношений, аналогичных в конечном итоге C). Наличие именно двух условий при числе параметров п > 2 означает фактически следующее: и Таким образом, многообразие точек пересечения есть в общем слу- случае пересечение двух поверхностей, заданных каждая в (п -1 )-мерном пространстве, т. е. это многообразие есть некоторая (п - 2)-мерная поверхность. Так, для п = 3 - это одномерная поверхность. Следова- Следовательно, потенциальные поверхности двух состояний не касаются друг друга, а пересекаются, как две конические поверхности (соединение поверхностей двух конусов вершинами). Поэтому точки пересечения называют точками конического пересечения. Часто обоснование правила непересечения проводят на основе теории возмущений, когда выбирают некоторую точку R вблизи точ- точки пересечения R$, считая приращение потенциала при таком пере- переходе за возмущение. Недостатков у такого рассмотрения несколько: потенциалы кулоновского типа обладают особенностью и такие осо- особенности меняют свое положение при изменении геометрии, что оз- означает, что приращения потенциала не являются малыми; переход от невырожденного случая к вырожденному в теории возмущений тре- требует отдельного внимания и т.п. К тому же в двухуровневом при- приближении уровни, как следует из формулы B), всегда будут расходиться, т.е. тенденция к непересечению вносится заранее. И еще на одну проблему перехода от одних геометрических конфигураций молекулы к другим следует обратить внимание: при малых изменениях геометрии у молекул часто наблюдаются резкие перестройки электронной конфигурации, что также ставит под вопрос правомерность использования теории возмущений и требует особого внимания к правильному выбору начального приближения, т.е. гео- геометрической конфигурации R$ и соответствующей функции Ф(г, R$). б. Орбитальное правило непересечения. В тех случаях, когда орбитали представляют собой собственные функции некоторого фокиана, единого для всех этих орбиталей (например, в рамках огра- ограниченного метода Хартри-Фока для синглетных невырожденных со- состояний), правило непересечения сохраняет свою силу без каких-либо особых изменений и для орбиталей. Для полносимметричного фокиа- фокиана при этом матричные элементы <ф,| F \tyj> обращаются в нуль, если спин-орбитали \pi и г|>; либо орбитали ф, и ф, преобразуются по раз- различным неприводимым представлениям, так что для орбиталей каж- Чг 419 L
дого типа симметрии получается своя подсистема уравнений (с еди- единым фокианом для всех этих подсистем). Для орбиталей же одного типа совпадение двух собственных значений г\ и е2 означает наличие двух условий: (9.1.4) аналогичных таковым для полного гамильтониана. Если фокиан задан в некотором базисе, например трех функций Хь Х2 и Хз данного типа симметрии, то равенство двух орбитальных энергий ?| = е2 означает, что в вековом уравнении е3 - аг2 + Ьг-с = = (е - ?i)(e - ?2)(е - ?3) * 0 на коэффициенты a, b и с должны быть наложены условия, вытекающие из того, что t\ = е2. Однако выгля- выглядеть все это будет настолько громоздко (особенно если записать коэф- коэффициенты а,Ьис через матричные элементы F^v (ц, v= = 1,2,3), что делать этого не будем, ограничившись лишь общим пониманием того, что и в таком случае появляются некоторые дополнительные условия. б. Корреляционные диаграммы для двухатомных молекул. Отчасти об этих диаграммах речь уже шла в § 4 nn.VI. Тем не менее, теперь у нас добавился новый элемент - правило непересечения; кро- кроме того следует сказать, что при построении этих диаграмм исполь- используется еще один качественный критерий, следующий из опыта рас- расчетов простейших двухатомных систем в рамках молекулярно-орби- тальных приближений (в частности, молекул Н2 и Н2). Этот крите- критерий сводится к тому, что орбитальная энергия понижается тем силь- сильнее, чем больше перекрывание соответствующих базисных орбита- лей в области между ядрами и чем меньше узловых поверхностей (где орбиталь обращается в нуль) возникает при переходе к молеку- молекулярной системе. Последнее утверждение опирается на уже упоми- упоминавшуюся теорему Гильберта для одномерных задач и опыт конк- конкретных расчетов. Все подобные утверждения не являются, естествен- естественно, жесткими и носят характер лишь правил, сопровождаемых слова- словами "вообще говоря". Поведение орбитальных энергий при переходе от разъединен- разъединенных атомов к молекуле породило даже специальную терминологию: если орбитальная энергия понижается, то такая орбетгаль была названа связывающей, если повышается, то разрыхляющей (или антисвязы- вающей, что возникло при буквальном переводе английского термина 420 antibonding), а если приближенно остается без изменений, то несвязывающей (nonbonding). Эта терминология широко использова- использовалась на начальном этапе квантовой химии, сейчас она встречается гораздо реже. Как правило, орбитальные корреляционные диаграммы для двухатомных молекул представляются в весьма качественном виде. И хотя для их построения могут быть использованы точные хартри- фоковские энергии, большого смысла это не имеет, поскольку на какую- либо количественную информацию такие диаграммы не претендуют. Начнем краткое рассмотрение диаграмм с гомоядерных мо- молекул, образованных атомами элементов первого и второго перио- периодов, так что при рассмотрении пределов - разъединенных атомов и объединенного атома - можно ограничиться оболочками с п ^ 3. Для двух разъединенных атомов имеем пары вырожденных уровней: LvA и \sB; 2sA и 2sB; 2рА и 2рв. При сближении атомов эти уровни рас- расщепляются, переходя в уровни молекулы, каждый из которых будет либо невырожденным, либо максимум двукратно вырожденным в за- зависимости от типа симметрии той молекулярной орбитали (или орби- орбиталей), которая отвечает данному уровню. В нулевом приближении из пары 1sah lsB орбиталей возникают 2 молекулярные орбитали: log = lsA + lsB и 1аы= ЬА- lsB, причем нормировочные коэффициенты ради простоты не выписываются. Аналогичное расщепление возни- возникает и для 25-уровня, так что соответствующие молекулярные орби- орбитали имеют вид: 2ag = 2sA + 2sB , 2ои = 2sA - 2sB. Орбитали р„ ру и pz трехкратно вырожденного набора в поле осевой симметрии расщеп- расщепляются на два поднабора: {рх, ру} и pz (ось z направлена по линии, соединяющей ядра). Первый из них порождает молекулярные орби- орбитали ям = {рхА + рхВ,руА + руВ } и Kg = {рхА-рхв,РУА -Рув }> тогда как второй - орбитали ои = ры +pzB и ag=pzA -pzB. Орбитали аи имеют на одну больше узловых поверхностей, чем соответствующие og- орбитали, и должны, следовательно, при сближении атомов А и В быть выше по энергии орбиталей og. Для я-орбиталей картина обратная: у яы-орбиталей узловых поверхностей меньше, чем у xg. Для объединенного атома, когда два ядра начинают расхо- расходиться (напомним, что при построении диаграммы межъядерное от- отталкивание из рассмотрения исключается, чтобы не возникало особенности при R -* 0), атомные орбитали приобретают типы симметрии молекулярной задачи. При этом 5-орбиталь (любая) переходит в а^-орбиталь, pz - в аи-орбиталь, рх и ру - в соответ- 14 — 1395 421 L
ствующие компоненты ли-орбитали, dzl- в суорбиталь, dxz и dyz - в компоненты л^-орбитали, dxlyl udxy - в компоненты б^-орбитали. После всего этого обсуждения с учетом указанных выше пра- правил, прежде всего правила непересечения, придем для гомоядерных молекул к корреляционной диаграмме вида, изображенного на рис. 9.1.2 и рассмотрим в качестве примера на её основе корреляционную диаграмму для молекулы В2. Пример, может быть, и не вполне удач- удачный, ибо при равновесном расстоянии у этой молекулы весьма близко расположены несколько верхних занятых и нижних вакантных орби- 2р,2р' 2s,2s' Is,1*' B + B Рис. 9.1.2. Корреляционная диаграмма для гомоядерной двухатомной молекулы (на примере молекулы В2). талей, однако он полезен, поскольку одновременно демонстрирует и те трудности, с которыми приходится иметь дело при построении кор- корреляционных диаграмм даже для простых систем. Отметим предварительно, что при рассмотрении различных электронных конфигураций, которые могут быть выписаны на основе принципа заполнения для орбиталей молекулы, принимается, что ос- основному состоянию отвечает последовательное заполнение орбита- лей в порядке возрастания их энергии, тогда как низшим возбужден- 422 ным - перевод одного или двух электронов с верхних заполненных на низшие вакантные орбитали. При этом изменением всех орбиталей при переходе от одного электронного состояния к другому фактичес- фактически пренебрегают. Если при заполнении орбиталей возникает конфигу- конфигурация с открытой электронной оболочкой, например типа ...л2 (мно- (многоточие означает остов из замкнутых оболочек), то ей будут соответ- соответствовать несколько электронных состояний молекулы, которые в ор- орбитальном подходе все имеют одну и ту же энергию, однако в дей- действительности (при учете межэлектронного взаимодействия) могут существенно различаться по энергии: разница может достигать ве- личин порядка 1 -3 эВ. В частности, для конфигурации ...зг„ функ- функция должна преобразовываться по (приводимому) представлению прямого произведенияПи ®ПМ = 2* ©2" ©А так что этой конфигурации отвечает три электронных состояния различных типов симметрии. Диаграмма, представленная на рис. 9.1.2, показывает, что мо- молекуле В2 в основном состоянии скорее всего будет соответствовать "У "У ? 2 9 электронная конфигурацияloglou2og2oulKu, причем мультиплет- ность состояния с учетом правила Хунда должна равняться трем, так что основным будет состояние X \S " ]. Вблизи равновесного рас- о стояния, как показывают результаты конкретных расчетов, орбитали 2ои и \пи расположены весьма близко по энергии (в пределах 0,1 эВ), что приводит к тому, что для низшего возбужденного состояния а5Аи, отделенного от основного всего лишь на —0,1 эВ, ведущей электронной конфигурацией будет loglou 2og 2ou 1лм 3og. Что дают подобные орбитальные диаграммы? Они позволя- позволяют, хотя и весьма качественно, но все же судить о стабильности обра- образующейся молекулы (большое число связывающих и малое число раз- разрыхляющих орбиталей либо наоборот), о том, орбитали какого типа симметрии определяют химическое связывание в рассматриваемой молекуле, о большей или меньшей стабильности ее катиона и аниона относительно нейтральной формы (в зависимости от того, с какой орбитали удаляется электрон), о том, будет ли энергия образования 1 Основное состояние двухатомных молекул обычно обозначается символом X, следующие за ним в порядке возрастания энергии состояния той же мультиплет- ности -А, В, С и т.д; состояния любой другой мультиплетности -а, Ь,с и т. д. 423 L
молекулы увеличиваться или уменьшаться при ее переходе в возбуж- возбужденные состояния и т.п. Так, по представленной диаграмме можно говорить о том, что ионизация молекулы В2 должна приводить к состоянию В2 сконфи- гурацией ...2аи1яи, что отвечает состоянию П , либо к состоя- 1 и нию с конфигурацией ...2ам1я^, что отвечает по симметрии тем же состояниям, что и у В2, но с заменой индекса g на индекс и у симво- символа алектронного состояния и с измененной мультиплетностью BS + 1 = = 2 и 4). Неопределенность опять-таки возникает из-за того, что по энергии орбитали 2ag и 1 яы близки друг другу и без дальнейших коли- количественных оценок более определенные высказывания вряд ли допу- допустимы. Низшему триплетному возбужденному состоянию молекулы В2 должна отвечать одна из следующих конфигураций: ...2а 1я3 ...2oulKu3og и ...2oulKu3og, где многоточие вновь означает ос- остов, не меняющийся при возбуждении (lal lol 2ol). В действитель- ности первое триплетное возбужденное состояние молекулы В2 есть 2g9 что может отвечать лишь последней конфигурации. Точно таким же способом, как и выше, могут быть построены корреляционные диаграммы для гетероядерных двухатомных моле- молекул. Несколько сложнее для двухатомных молекул построить корре- корреляционные диаграммы для уровней полной электронной энергии (без учета межъядерного отталкивания), прежде всего по той причине, что требуемая информация об электронных состояниях атомов, как правило, более скудна, чем для орбиталей. в. Диаграммы Уолша. Распространение орбитальных кор- корреляционных диаграмм на трехатомные молекулы позволило А.Уолшу, начиная с 1953 г., проанализировать широкий ряд различных классов трехатомных молекул с целью выяснения того, будет ли для них равновесная конфигурация линейной или нелинейной, будет ли она существенно меняться при электронном возбуждении молекулы или при ионизации и т.п. Для такого анализа корреляционные диаграммы опять-таки рассматриваются в рамках простейшего базиса атомных орбиталей при условии, что в молекуле А-В-С межъядерные расстояния меняются слабо и эти изменения не влияют на общий анализ зависимости энергии от валентного угла. В отличие от двухатомных молекул здесь рассматривается лишь сечение потенци- потенциальной поверхности, а предельные значения валентного угла (например, 424 я/2 и я) не отвечают каким-либо наблюдаемым конфигурациям. С другой стороны, здесь нет необходимости исключать межъядерное отталкивание, как то делалось при рассмотрении диаграмм для двух- двухатомных молекул. Построение диаграмм Уолша обсудим на простейшем при- примере трехатомных гидридов Н-А-Н , где А - атом второго периода. В качестве базиса возьмем ls-орбитали для атомов водорода (обо- (обозначим их через h\ и Л2), а также Is-, 2s- и 2р-орбитали для централь- центрального атома. Расстояния Н-А будем считать одинаковыми для обоих атомов Н. Пусть сначала взята линейная конфигурация ядер (точечная группа симметрии D^). Базисные орбитали для такой системы мож- можно преобразовать в следующие орбитали симметрии: тип симметрии орбитали орбитали симметрии h\ +h2, Is, 2s hx +/?2, 2pz {2px, 2py} (ось z - ось симметрии со-го порядка; нормировочные множители не указаны). Орбитали симметрии типа а~ приводят к трем молекуляр- молекулярным орбиталям: c,-i*(Ai+A2) + c-q;\s + c^-ls, причем коэффициентыс^ определяются эффективным одноэлектронным гамильтонианом. При этом можно надеяться, что орбиталь Is будет носить в значительной степени атомный характер и не будет (так же, как и соответствую- соответствующая энергия) существенно меняться при изменении валентного угла. В таком случае вековое уравнение сведется к уравнению второго порядка, матричные элементы которого можно рассматривать как некоторые параметры либо как известные из эксперимента величи- величины (по крайней мере, часть из них). Аналогичное положение возника- возникает с орбиталями типа ои и их орбитальными энергиями. Орбитали же типа ли остаются просто атомными орбиталями, так что фактически не меняется и их орбитальная энергия. Для изогнутой конфигурации с валентным углом я/2 точечной группой симметрии будет C2v. Орбитали типа о„ перейдут в орбита- орбитали типа яj, аи- в Ь\, а орбиталь ли распадется на 2 компоненты, одна из которых (ру) будет типа а1; а вторая - типа Ь2. Далее для каждого типа симметрии должны быть построены соответствующие молеку- молекулярные орбитали, после чего уже можно попробовать выяснить, как 425 L
меняется характер перекрывания атомных орбиталей при переходе от изогнутой к линейной конфигурации. Так, например, орбиталь За} может быть записана в виде 2ру + Щх + h2) + \i-2s, причем при а « л/2 она имеет связывающий характер, т.е. ее энергия должна быть ниже энергии атомной орбитали 2р тогда как при а -¦ к коэффициенты к и ц стремятся к нулю и орбитальная энергия должна возрастать, пе- переходя примерно в энергию атомной 2/у-орбитали. Энергия орбитали \Ь2 сильно меняться при изменении а не должна, тогда как энергия орбитали 1 b\ = 2pz + v{hx - h2) должна при увеличении а уменьшает- уменьшается, поскольку перекрывание 2pzHhx-h2 достигает максимума в каж- каждой из областей А - Щ и Н2- А при линейной конфигурации молекулы. Это обсуждение можно продолжить, однако, по-видимому, суть используемого подхода ясна. В итоге получается корреляционная диаграмма, изображенная на рис. 9.1.3. Судя по этой диаграмме, при За. 16.! 2а, и За„ \аи 90 а 180е Рис. 9.1.3. Диаграмма Уолша для трехатомных гидридов АН2 эле- элементов второго периода. использовании обычного принципа заполнения орбиталей в основном состоянии молекула ВН2 E валентных электронов) должна быть изо- изогнутой (экспериментальное значение равновесного валентного угла ае= 131°), молекулы СН2, NH2, OH2 - также нелинейными (ае = 136, 103 и 105° соответственно), тогда как у молекулы FH2 должна наметиться явная тенденция к увеличению валентного угла. На основе такой диаграммы можно заключить, что молекула ПН2 должна быть близка к линейной, а при ионизации ВН2, т.е. при переходе к ВН2 , валентный угол скорее всего будет уменьшаться и т.д. 426 Приведенные экспериментальные данные для дигидридов С, N и О показывают мало объяснимое на основе данной диаграммы изменение ае при переходе от ВН2 к СН2 и от СН2 к NH2 • Такие детали выходят за пределы возможностей представленного каче- качественного подхода, если при этом не пользоваться какой-либо более точной расчетной информацией. С позиций этой диаграммы, однако, остается непонятным, почему при переходе от NH2 к NH2 валент- валентный угол увеличивается резко (до 158°), а при переходе от СН2 к СН2 - увеличивается слабо (до 142°). Нужны дополнительные со- соображения, например, об отталкивании частично положительно заря- заряженных атомов Н и т.п., однако вряд ли простую корреляционную картину стоит сколько-нибудь активно усложнять. Лучше помнить о ее качественном характере и ограничениях. В следующем параграфе рассмотрение корреляционных диа- диаграмм будет продолжено на еще одном, хотя и простом, но весьма важном примере. § 2. Сохранение орбитальной симметрии Во всех предыдущих случаях обсуждения корреляционных диаграмм орбитальная симметрия не менялась при сохранении точечной группы симметрии молекулы. С этой точки зрения смысл заглавия настоящего параграфа не вполне прозрачен, однако из дальнейшего он станет яснее. о. Реакция 2С2Н4 -¦ С4Н8. Рассмотрим корреляционную орбитальную диаграмму, отвечающую переходу от двух молекул этилена к молекуле циклобутана. Конечно, в общем случае не вполне ясно, что выбрать в качестве геометрического параметра, задающего такой переход, поскольку каждая из подсистем определяется 37V-6 параметрами (когда молекулы нелинейны), т.е. для С4Н8 -тридцатью параметрами. Поэтому придется, по крайней мере при начальном рассмотрении, сузить постановку задачи и рассмотреть лишь такую модель, в которой задание этого параметра было бы очевидным. Например, будем считать, что молекулы этилена сближаются так, что точки, отвечающие серединам межъядерных расстояний С-С в каждой молекуле, находятся на одной прямой, а плоскости равновесных конфигураций обеих молекул перпендикулярны этой прямой (см. рис. 9.2.1). Другими словами, молекулы этилена 427 L
сближаются так, что все время сохраняется точечная симметрия Dlh для конфигурации ядер. Следовательно, молекулярные орбитали всей системы мож- можно классифицировать по неприводимым представлениям этой группы. В качестве же параметра, задающего сечение многомерной потенци- потенциальной поверхности, выступает расстояние R между указанными Рис. 9.2.1. Сближение двух молекул этилена по оси z. точками середин расстояний С-С. При больших R взаимодействие Между молекулами С2Н4 мало и им можно пренебречь, так что орбитали каждой из этих молекул можно классифицировать по неприводимым представлениям группы D2^ присущей этой молекуле. Если таким взаимодействием пренебречь нельзя, то для дальнейшего рассмотрения можно использовать теорию возмущений в той или иной ее форме. Для одной молекулы этилена возьмем в качестве базиса минимальный валентный базис атомных орбиталей Л, = Ь, (/ = 1,2,3, 4; / - номер протона) и 2sa , 2ра (а = 1, 2 - номер ядра углерода). Из этих орбиталей можно составить 12 молекулярных орбиталей. Как показывает более детальное рассмотрение, электронной конфигурацией основного состояния является следующая (не указаны, но учтены при нумерации две остовные молекулярные орбитали типа ag и точный порядок следования орбиталей Ъги<> Ьзи и b\g при таком подходе установить трудно, хотя из рассмотрения расположения узловых плоскостей следует вывод о приведенном расположении их по энергии. В этой последовательности первые 5 орбиталей являются а-орбиталями, а последняя (Ь\и) - л-орбиталью. Нижней вакантной орбиталью будет также орбиталь я-типа b^g. Если эти первые 5 орбиталей преобразовать на основе той или иной процедуры локализа- локализации (см. § 3 гл. VII), то придем к системе четырех эквивалентных орбиталей, примерно отвечающих четырем парам центров С и Н, т.е. к системе четырех локализованных С-Н орбиталей, тогда как пятой орбиталью будет локализованная а-орбиталь С-С. Эти локализован- локализованные орбитали в существенной степени определяются лишь симмет- симметрией системы и заметно не меняются при сближении молекул этилена и некотором искажении геометрической конфигурации каждой из молекул, в частности, при таком выходе атомов Н из плоскости, который в итоге должен привести к соответствующей равновесной конфигурации молекулы С4Н8. По этой причине, по крайней мере на первых порах, можно ограничиться при дальнейшем обсуждении лишь орбиталями типа Ь\и от каждой молекулы и, быть может, орбиталями big. Эти орбитали имеют вид ( нумерация центров представлена на указанном рисунке, тип симметрии пока что указан для изолиро- изолированных молекул С2Н4 )• g = BBPzi ~ причем A = B + 2S)~V2 , В = B - 2S)~1/2 , S = < 2pzX\2pz2 > . Если учесть грубость всей представленной модели, то, судя по всему, можно пока положить 5 = 0, так что А-В- 1/ V 2 . Орбитали ф! и ф2 при больших R почти вырождены, тогда как при малом взаимодействии между молекулами из этих двух орбиталей согласно теории возмущений получаются линейные комбинации, правильные по симметрии для всей системы: Тип симметрии ag (ss) b\u (as) Орбиталь Vi=4>i-4>2 Ч>2 = Ф1 +Ф2 Тип симметрии b2u (so) b3g (aa) Орбиталь УЗ = фз - ф4 М>4 = Фз + Ф4 428 Орбитали пока выписаны без нормировочных множителей, которые можно при необходимости ввести. В скобках для большей ясности указано поведение функций гр/ при отражении в плоскостях 429 L
ху и xz соответственно: s означает, что функция не меняет знак при таком отражении (симметричная функция), а - что функция меняет знак (антисимметричная функция). Изменение орбитальных энергий при сближении молекул показано слева на рис. 9.2.2. У молекулы С4Н8 в отличие от двух изолированных молекул С2Н4 имеются две химические связи Ci-Сз и С1-С4 , которым в лервом приближении отвечают локализованные орбитали (а-типа) аи \ / W ь1«/\ ф ф — — —г 2 изолированные 2 взаимо- циклобутан локализованные молекулы действующие орбитали этилена молекулы этилена Рис. 9.2.2. Изменение орбитальных энергий при сближении двух молекул этилена с переходом к молекуле циклобутана. Ф1 = 2pzl - 2р2з и Фг = ^Pzi ~ 2pz4 с орбитальными энергиями ниже энергии л>орбитали ф! (или фз). Это утверждение несколько условно, поскольку локализованные орбитали не являются, вообще говоря, каноническими хартри-фоковскими, а потому не отвечают какой-либо определенной орбитальной энергии (как собственному значению фокиана). Тем не менее, если орбитали ф! и ф2 вырождены, а за счет взаимодействия с молекулярным остовом вырождение снимается, то при малой величине взаимодействия расщепление должно быть небольшим, и две линейные комбинации правильных по симметрии молекулярных орбиталей вновь могут быть сведены к орбиталям фх и фз, которым можно сопоставить энергию из интервала ?i и е2 энергий, отвечающих расщепленным уровням. Именно на основе этих соображений построена правая часть диаграммы рис.9.2.2. Следующий шаг при построении полной диаграммы очевиден: необходимо соединить линиями корреляции орбитали одной и той же симметрии справа и слева (в порядке возрастания по энергии, если имеются уровни одного и того же типа симметрии). Весьма характер- характерной особенностью получаемой при этом картины будет наличие пересечения двух орбитальных уровней Ъ\и и biu- Это означает, что основному состоянию двух взаимодействующих молекул этилена 2 2 отвечает электронная конфигурация ...я Ь1м, тогда как молекуле ¦у -у циклобутана ...а Ь2и. Следовательно, при медленном (адиабатичес- (адиабатическом) сближении двух молекул этилена молекула циклобутана образоваться может, но в возбужденном (причем даже не в низшем возбужденном) состоянии, поскольку предполагается выполненным условие сохранения орбитальной симметрии при таком сближении. В качестве медленного сближения может, в частности, рассматриваться столкновение молекул при обычных тепловых энергиях, когда не происходит какого-либо их электронного возбуждения. Если же исходить из возбужденной конфигурации ...аДиЬ2м •> то при переходе к циклической молекуле эта электронная конфигура- конфигурация сохранится, причем отвечать она будет также возбужденному состоянию. Тем не менее, такой переход уже не потребует столь существенных затрат энергии, как в предыдущем случае. Это означает, что данное превращение 2С2Н4 -* C4Hg можно осуществить фотохимически: при возбуждении одной из молекул излучением с частотой, соответствующей первому переходу, и столкновении ее с невозбужденной молекулой они реагируют и образуется С4Н8*, который далее либо излучает, либо при столкно- столкновении с другими молекулами или стенками теряет энергию возбужде- возбуждения и переходит в основное состояние. К аналогичным заключениям о наличии высокого энергети- энергетического барьера можно придти и при рассмотрении корреляционной диаграммы для полной энергии, но при одном дополнительном условии: сохранении в одноконфигурационном приближении исходной электронной конфигурации до той точки (точнее области) на пути перехода от одной системы к другой, где возникает возможность пересечения с потенциальной поверхностью другого состояния того же самого типа симметрии. В таких точках почти-вырождения двух состояний система может менять свою электронную конфигурацию, что и происходит, как правило, при рассмотрении электронной задачи 430 431
в адиабатическом приближении. Именно при соблюдении данного условия можно придти к выводу о наличии энергетического барьера, в противном же случае, зная только лишь тип симметрии состояния, можно было бы соединить на корреляционной диаграмме два уровня типа А ^ низших справа и слева. Получающаяся в итоге диаграмма представлена на рис. 9.2.3. б. Правила Вудворда-Хофмана. Рассмотрение подобного типа примеров различных одностадийных превращений (химических реакций) органических соединений позволило очень интересному V Ь фгф 1*2*3 \гф ф 1*2*4 \гф ф 1*2*3 *1*2 Рис. 9.2.3. Корреляционная диаграмма для уровней энергии л- электронных состояний при превращении 2С2Н4 -» C4Hg. Справа и слева указаны электронные конфигурации и отвечающие им типы симметрии электронных состояний. альянсу двух ученых - химика-органика Р. Вудворда1 и физико- химика, специалиста в области квантовой химии Р. Хоффмана - сформулировать набор простых правил, позволяющих выявить наличие или отсутствие энергетического барьера на пути реакции. Первые публикации Р. Вудворда и Р. Хоффмана в этом направлении появились в 1965 г., вызвав широчайший поток исследований для различных типов реакций органических соединений. 1 Вудворд Роберт A917-79) - известный американский химик-органик, иностран- иностранный член АН СССР. Возглавляемым им научным коллективом установлено строение и проведен синтез таких биологически важных соединений, как хинин, .кортизон, хлорофилл, витамин В12 и др. Лауреат Нобелевской премии A965). 432 Эти правила (сохранения орбитальной симметрии) сводятся к следующим: 1. В каждой реакции должны быть выделены и рассмотрены отдельно одностадийные акты, обычно называемые синхронными, или согласованными реакциями1. (Название обусловлено тем, что в этих реакциях появление новых химических связей и исчезновение старых идет одновременно, согласованно.) 2. При построении корреляционной диаграммы "исходные веще- вещества - продукты реакции" должны быть выделены те элементы симметрии, которые присутствуют вдоль всего пути реакции и относительно которых сохраняется тип симметрии молекулярных орбиталей вдоль этого пути. 3, Выбранные для анализа корреляционной диаграммы элементы симметрии обязательно должны пересекать связи, возникающие и исчезающие в рассматриваемом процессе. Точнее говоря, они должны пересекать те валентные штрихи в химических формулах, которые меняются в ходе реакции. Для анализа бесполезны те элементы симметрии, по отношению к которым все орбитали корреляционной диаграммы ведут себя одинаково, скажем сим- симметричны или антисимметричны (например, плоскость OyZ при сближении двух молекул этилена). 4, При установлении корреляций должна быть восстановлена высшая симметрия, присущая системе в отсутствие различий во влиянии заместителей, при замене гетероатомов на изоэлектронные им углеродные группировки и т.п. Тем не менее, после первоначаль- первоначального анализа на основе корреляционной диаграммы, отвечающей высшей симметрии, следует тщательно выяснить возможные особенности и изменения, которые могут быть обусловлены присутствием в молекуле именно гетероатомов, ибо даже порядок расположения орбитальных уровней у них может быть иным, чем у эквивалентных углеродных группировок. в. Электроциклические реакции. Первоначально подход на основе принципа сохранения орбитальной симметрии был развит Р. Вудвордом и Р. Хоффманом для электроциклических реакций, 1 Используют также совсем неудачное для русского языка название концертные реакции, поскольку в английском языке слово concert как прилагательное имеет основной смысл "действующие вместе", тогда как в русском слово концертный означает лишь "относящийся к концерту". 433
заключающихся в циклизации системы с п я-электронами и образова- образованием системы с (п - 2) л-электронами и двумя а-электронами. Ниже мы иногда будем пользоваться этим языком, подразумевающим, что из исходной системы с числом электронов на я-орбиталях, равным п, возникает новая система, в которой это число уменьшается на 2 и появляется еще одна а-орбиталь, заполненная двумя электронами. Обратная реакция также называется электроциклической. Классическим примером таких реакций служит обратимое превращение бутадиен <?> циклобутен CU си си-сщ II си. Было обращено внимание на то, что в этих системах возмож- возможны два различных способа циклизации: при образовании новой связи между концевыми (в сопряженной системе) атомами С у каждого из этих атомов происходит такое перемещение заместителей, что один из них оказывается над плоскостью цикла, другой - под плоскостью. Другими словами, при таком перемещении группы СНз в 1,4-диметил- бутадиене либо окажутся одновременно над плоскостью цикла, либо одна - над плоскостью цикла, другая - под ней. Фактически происхо- происходит поворот плоскостей С(Нз)-С/-Н (; = 1 или 4) на угол -я/2 либо по, либо против часовой стрелки, как это показано на рис. 9.2.4. Попробуем теперь для таких процессов построить корреляци- корреляционные диаграммы. При этом будем считать, что у (диметил)бутадиена можно ограничиться лишь системой я-орбиталей и влиянием метильных групп на эти орбитали можно пренебречь, из-за чего и поставлены выше скобки у "диметил". Исходный набор орбиталей и орбитальных энергий возьмем из хюккелевской задачи и учтем, что симметрия исходной системы C2v. Группы СН3 при повороте даже на малый угол выходят из плоскости, и симметрия понижается до груп- группы Cs при дисротаторном процессе (плоскость симметрии axz ) и до С2 при конротаторном процессе (ось симметрии Oz). Следовательно, классификация орбиталей при этих двух процессах проводится по разным элементам симметрии. Конечное состояние системы отве- отвечает замкнутому циклу, причем возникает новая а-орбиталь (из двух ярх-орбиталей атомов С, концевых в я-системе), которая в случае связывания должна отвечать такому перекрыванию (повернутых) лрх- 434 орбиталей, при котором не возникает узловой плоскости между соот- соответствующими ядрами С. Кроме того, образуется и я-орбиталь сря из ярх-орбиталей атомов С3 и С4 (того же типа, что в этилене). При дисротаторном процессе (С,) и орбиталь фо, и орбиталь фя имеют тип симметрии а\ тогда как у исходного бутадиена низшая занятая / \ н н V \ н \ Л н а' а" у а' * ч а" а" а' а' ьч ¦а- -Ь. -а ч К>*чч ч * * а У Ь а • * Ъ Рис. 9.2.4. Дисротаторный (а) и конротаторный (б) механизмы замыкания цикла и соответствующие корреляционные диаграммы. Влияние заместителей R на относительное положение уровней стереоизомеров считается малым и на диаграммах не отражено. орбиталь Ц)х имеет тип симметрии а', а верхняя занятая ф2 - а". При конротаторном процессе (С2) орбиталь фо - я-типа, орбиталь фл - 6-типа, тогда как у бутадиена ц>[ имеет тип 6, а ф2 - тип а. Совер- Совершенно аналогично можно рассмотреть и отнести по симметрии и виртуальные орбитали реагента и продукта реакции. В итоге получа- получаются две корреляционные диаграммы, представленные на рис. 9.2.4 и показывающие, что дисротаторный механизм требует преодоления 435 L
значительного энергетического барьера, тогда как при конротатор- ном процессе такой барьер мал либо вообще отсутствует. На вели- величину барьера, конечно, оказывают влияние различные дополнитель- дополнительные факторы (например, влияние метильных групп), однако, если оно не очень велико, то общая качественная картина измениться не должна. Следовательно, реакция замыкания цикла у диметилбута- диена стереоспецифична1. Интересно и то, что у производных гекса- триена при электроциклической реакции также наблюдается стерео- специфичность, но высокий барьер оказывается уже характерным для конротаторного процесса. Этот факт находит весьма простое объяснение при анализе соответствующих корреляционных диаграмм (см. Задачу 1). Анализ на базе корреляционных диаграмм, учитывающих орбитальную симметрию, был далее распространен Р. Вудвордом и Р. Хоффманом на реакции циклоприсоединения, например, на реакцию Дильса-Альдера сн2 н сн2 II сн2 НС н h сн При этом было показано, что при взаимодействии этилена с молеку- молекулой полнена, имеющего 2к + 2 (к = 0, 1,...) заполненных тс-орбиталей, реакция разрешена для термического превращения и запрещена (т.е. имеет высокий барьер) для фотохимического, тогда как для полиенов с 2к + I заполненной л-орбиталью картина меняется на обратную. По существу к этому же типу реакций относится взаимодействие двух молекул этилена (к = 0). Наконец, были рассмотрены на базе корреляционных диаграмм сигматропные реакции, в которых происходит миграция а-связи (принадлежащей сопряженной молекулярной системе) в новое положение внутри этой системы, например переход Реакция называется стереоспецифической, если она проходит практически по одному стереохимическому направлению, а если такое направление лишь преобладает среди других, то стереоселективной. 436 Н с2н5 сн Мы не будем останавливаться на этом классе реакций, хотя подход Вудворда-Хоффмана оказался весьма плодотворным и для них. в. Теория граничных орбиталей. Предтечей подхода Вуд- Вудворда-Хоффмана оказалась теория, развитая выдающимся японским ученым К. Фукуи во второй половине пятидесятых годов и существо- существовавшая уже в завершенном виде к моменту появления работ, базиро- базировавшихся на принципе сохранения орбитальной симметрии *. В частности, на основе этой теории были интерпретированы результаты таких электроциклических реакций, как термическая и фотохимичес- фотохимическая циклизация полиенов. (Экспериментально различия в стереохи- стереохимии циклизации, вызываемой термически или фотохимически, были установлены еще в 1961 г. на примере изомеризации соединений, род- родственных кальциферолу, т.е. витамину D). Основная идея теории граничных орбиталей заключается в том, что при рассмотрении различных механизмов превращений требуется следить прежде всего за поведением граничных орбиталей, т.е. высшей по орбитальной энергии (высших) занятой и низшей (низших) вакантной. Эти орбитали обозначаются как ВЗМО и НВМО соответственно. Так, в реакции циклизации бутадиена высшей занятой орбиталью является следующая: ф2 = 0,602xi + 0,372x2 - 0,372хз - 0,602X4- 1 Фукуи Кенити (р. 1918), выдающийся японский физико-химик, создавший теорию граничных орбиталей. Лауреат Нобелевской премии A981, совместно с Р.Хоффманом). По теории граничных орбиталей первый обзор "Orbital Symmetry and Electrocyclic Rearrangements" , написанный К. Фукуи и X. Фудзимото, появился в книге "Mech- "Mechanisms of Molecular Migrations", vol.2, ThyagarajaB.S., Ed., Interscience, 1969, p.l 17. 437
При конротаторном механизме /v-орбитали концевых групп атомов 1 и 4 будут перекрываться так, что между центрами 1 и 4 возникает узловая плоскость, тогда как при дисротаторном подобной плоскости возникать не будет. Следовательно, граничная орбиталь ф2 такова, что при поворотах концевых групп связывающая молекулярная орбиталь может появиться лишь при дисротаторном процессе. У гексатриена граничная орбиталь имеет иную структуру, что сказывается на специфичности циклизации: X конротаторный механизм (орбитали всех остальных атомов не изображены). Для бимолекулярных реакций (типа реакции Дильса-Альде- ра) взаимодействие осуществляется так, что ВЗМО одного реаген- реагента должна перекрываться (без образования узловых поверхностей) с НВМО другого, и наоборот. Предполагается к тому же, что взаимодействие подсистем при таком перекрывании тем больше, чем ближе по энергии заполненные и вакантные орбитали. По этой причине наиболее существенный вклад во взаимодействие определяется лишь величинами, связанными с ВЗМО одного реагента и НВМО другого, если, конечно, эти реагенты не одинаковы либо не весьма близки, когда вклад от той и другой пары орбиталей примерно равен. Есте- Естественным условием такого совместного (попарного) рассмотрения орбиталей было то, что симметрия орбиталей (ВЗМО и НВМО) от- относительно некоторого общего элемента симметрии должна быть одинакова у обоих реагентов. Так, для реакции Дильса-Альдера орбитальные энергии ВЗМО и НВМО реагентов соотносятся, как показано на рис. 9.2.5. Группа точечной симметрии для объединенной системы (бутадиен + этилен) включает, кроме тождественной операции, отражение в плоскости^, так что это группа Cs (рис. 9.2.6). На рис.9.2.5 указаны также типы симметрии орбиталей относительно операций этой группы. При сближении подсистем, как следует из теории возмущений, образуются две новые высшие занятые молекулярные орбитали всей 438 Симметрия Са НВМО а-0,62р a' ВЗМО п a + 0,62p L А 2 1 бутадиен а' этилен Рис. 9.2.5. Диаграмма уровней ВЗМО и НВМО бутадиена и этилена для анализа реакции Дильса-Альдера на основе теории граничных орбиталей. Рис. 9.2.6. Плоскость симметрии для системы бутадиен - этилен. 439
системы: ipi = qpi + Х,ф3 и грг = ф1 + М-ф2> гДе ^ и М-~ коэффициенты, зависящие от расстояния между подсистемами. Графически это можно представить так: ВЗМО нвмо ш о НВМО ВЗМО и о В обеих образующихся орбиталях перекрывание орбиталей реагентов является безузловым, что означает малую величину барьера для термического механизма реакции. В то же время, если взять вместо бутадиена гексатриен, то картина меняется: ФЗ = 0,51xi + 0,21x2 ~ 0,42хз - 0,42Х4 + 0,21Х5 + 0,51Хб • Здесь ВЗМО имеет тип симметрии а', и коррелировать с НВМО этилена она не может. Аналогичный результат получается и при рассмотрении корреляции ВЗМО этилена с НВМО гексатриена. Такой результат свидетельствует о наличии энергетического барьера, возникающего при сближении молекул из-за того, что перекрывания орбиталей, ведущего к понижению энергии, т.е. к связыванию, нет. Рассмотрение только граничных орбиталей, казалось бы, заметно сужает общую картину, возникающую при построении орбитальных корреляционных диаграмм, поскольку, как видно из последнего примера с гексатриеном, ВЗМО одного реагента может 440 коррелировать не с НВМО, а со следующей за ней орбиталью, и наоборот. Тем не менее, во многих случаях рассмотрение граничных орбиталей оказывается достаточным для получения качественно правильных выводов о характере изменения энергии вдоль пути реакции и о стабильности образующихся соединений. Поэтому подходы, базирующиеся на теории граничных орбиталей, и по сей день широко используются при рассмотрении химических соединений и их превращений. г. Некоторые обоснования. Как только что было упомяну- упомянуто, за теорией граничных орбиталей стоит в большей или меньшей степени теория возмущений, поскольку для орбигалей каждого данного типа симметрии наибольший вклад во втором порядке по энергии и в первом - по волновой функции дают те орбитали, которые наиболее близки к данной по энергии, т.е. для ВЗМО - это НВМО, и наоборот. Помимо этого соображения следует упомянуть и еще об одном, весьма важном по крайней мере для основного состояния. Как уже говорилось в § 5 гл. VI, в 1964 г. П. Хоэнберг и В. Кон сформулировали теорему (и дали одно из ее доказательств), которая утверждает, что для основного состояния электронная плотность полностью определяет волновую функцию и все свойства молекулы в этом состоянии. Это утверждение может быть перенесено и на приближение Хартри-Фока, по крайней мере в тех его вариантах, где можно ввести единый фокиан для всей системы занятых орбиталей. Коль скоро плотности различны, функции Фг и Ф2 основных состояний двух систем с одним и тем же набором частиц различаются хотя бы одной орбиталью, поскольку плотность определяется суммой квадра- квадратов модулей отдельных орбиталей. Для канонических хартри- фоковских орбиталей, собственных для фокиана, определяемого этими же орбиталями, задание одной орбитали при известном исходном гамильтониане по существу определяет весь набор хартри-фоковских занятых орбиталей основного состояния (для данного типа симмет- симметрии). По этой причине граничные орбитали (по крайней мере заня- занятые), пусть некоторым сложным и неизвестным пока образом, определяют всю волновую функцию приближения Хартри-Фока и отражают поведение этой функции при изменении параметров задачи. И наконец, есть третья причина, ведущая обычно к правильным результатам при использовании столь простых подходов. Эта причина в том, что рассматриваются ряды однотипных соединений и однотип- однотипные превращения (например, электроциклические реакции), для 441
которых механизмы превращений должны быть похожи. Даже если в целом обсуждаемые соединения оказываются заметно различающи- различающимися, группы атомов (фрагменты молекул), которые затрагиваются химическим превращением (т.е. реакционный центр), обычно бывают весьма близки в таких рядах, что допускает и однотипные корреляции для соответствующих систем. Конечно существуют, и существуют в немалом числе исклю- исключения из правил сохранения орбитальной симметрии и теории граничных орбиталей, причины которых часто бывают известны, хотя и не всегда заранее предсказуемы. Например, одной из причин может служить многоконфигурационный характер волновых функций соединений, возникающих на отдельных стадиях процесса, как впро- впрочем и многостадийность процесса, не все стадии которого заранее легко предсказать. Еще одно обстоятельство, о котором уже говори- говорилось ранее при обсуждении полуэмпирических методов, заключает- заключается в том, что, по существу, используемые конструкции являются даже не приближением Хартри-Фока, а еще более грубыми. Достаточно вспомнить про орбитальные энергии, из которых в рассмотренных корреляционных подходах слагается полная энергия и которые не дают этого результата непосредственно в приближении ССП. А то, что все- таки подобные грубые конструкции подчас дают качественно правильные результаты, определяется опять-таки тем, что они базируются на сохранении основного каркаса квантовомеханической теории и на общих, не зависящих от приближения идеях о симметрии систем или их отдельных фрагментов, дополняемых постоянными сопоставлениями с эмпирическими данными и закономерностями. Задачи 1. Рассмотреть с учетом сохранения орбитальной симмет- симметрии реакцию Дильса-Аль дера на примере взаимодействия бутадиена с этиленом, гексатриена с этиленом и двух молекул бутадиена. Обсу- Обсудить соответствующие обратные реакции (так называемые ретро- реакции Дильса-Альдера). 2. Рассмотреть на основе принципа сохранения орбитальной симметрии и на базе теории граничных орбиталей а) раскрытие цикла цикл опро пил катиона; б) замыкание в цикл пентадиениланиона; в) превращение бицикло[4,1,0]гепта-2,4-диена в тропилиден (циклогепта-1,3,5-триен). Глава X Движение ядер §1. Потенциальные поверхности и симметрия При адиабатическом разделении электронных и ядерных пе- переменных потенциал ядерного уравнения получается как собственное значение оператора Гамильтона для электронного волнового урав- уравнения и графически представляется потенциальной поверхностью. Потенциальные поверхности как функции 3N-6 переменных, где N- число частиц в системе, имеют ряд общих черт для молекулярных систем, о которых и пойдет речь в настоящем параграфе. о. Предельное поведение. При удалении от системы одного атома или группы атомов, т.е. при стремлении расстояния между дву- двумя образующимися подсистемами к бесконечности, собственное зна- значение электронного волнового уравнения будет стремиться к некото- некоторому предельному значению, равному сумме электронных энергий разделенных подсистем и называемому диссоциационным пределом. Таких пределов у многоатомной молекулы имеется столько, сколько различных (хотя бы мыслимых) способов существует для ее деления на две или большее число подсистем. Разные диссоциационные пре- пределы отвечают разным энергиям, причем они отделены друг от друга областями более высоких значений энергии, поскольку эти области отвечают большим значениям не одного, а сразу двух или большего числа геометрических параметров. Как правило, диссоциационным пределам отвечают некоторые ложбины на потенциальных поверх- поверхностях, разделенные повышенными участками, имеющими характер плато при достаточно больших значениях тех или иных параметров, определяющих эти пределы. Так, для трехатомной молекулы ABC возможны пределы АВ + С, АС + В, ВС + АиА + В + С при диссоциации на нейтральные подсистемы. Возможна диссоциация и на ионные подсистемы, например, АВ+ + С" или АВ~ + С+, однако такие пределы отвечают другим потенциальным поверхностям, поскольку при одной и той же геометрической конфигурации ядер системы АВ + С и АВ+ + С" имеют, как правило, различные энергии. 443
Стремление к диссоциационному пределу может иметь раз- различный характер в зависимости оттого, на какие подсистемы распа- распадается молекула. Важно то, что при больших расстояниях между под- подсистемами их взаимодействие с высокой точностью может быть ап- аппроксимировано классическими выражениями, поскольку перекры- перекрывание волновых функций подсистем стремится к нулю и все сугубо квантовомеханические эффекты типа обменного взаимодействия так- также стремятся к нулю. Поэтому при диссоциации на ионы АВ+ + С" асимптотически стремление к диссоциационному пределу будет оп- определяться кулоновским законом: E(R) - 7? , тогда как при диссоциации на две нейтральные подсистемы, одна из которых (АВ) обладает постоянным дипольным моментом D , а другая (С) лишь квадрупольным моментом, это стремление к пределу определяется зависимостью /?~4. Электростатическое взаимодействие двух гетероядерных двухатомных молекул пропорционально /?~3 , а двух гомоядерных-/?; наконец, взаимодействие двух молекул симметрии Jd пропорционально R~7 (см. также далее § 2 гл. XI). В случае, если при диссоциации подсистемы совершают независимо еще и враща- вращательное движение, то необходимо усреднение по всем возможным ориентациям молекул-подсистем, что, например, при взаимодействии двух полярных двухатомных молекул приводит к закону /?~6 (вместо /?~3 при фиксированной ориентации диполей). С другой стороны, при очень малых расстояниях между любой парой ядер за счет межядерного отталкивания потенциал стремится к +оо по кулоновскому закону, так что при любом межъядерном расстоянии R, стремящемся к нулю, на потенциальной поверхности имеется достаточно быстро возрастающая потенциальная стенка. В промежуточной области конечных значений всех геометри- геометрических параметров, которая и представляет наибольший интерес, пове- поведение потенциальной поверхности может быть весьма различным: на поверхности могут быть более или менее глубокие минимумы, разделенные потенциальными барьерами (хребтами), причем на этих барьерах также имеются более высокие участки, например области максимумов, либо менее высокие, отвечающие точкам перевала че- через тот или иной потенциальный барьер. Возможны и такие ситуа- ситуации, например в трехатомных молекулах, когда потенциальная энер- энергия при обходе одним из атомов молекулярного остова (при некото- некотором интервале расстояний от этого остова) меняется слабо, так что на потенциальной поверхности имеется замкнутая ложбина, в кото- 444 рой может находиться указанный атом и для выхода из которой ему потребуется дополнительная энергия. Такая ситуация имеет место для молекул LiNC, LiAlF4 и т.п., в которых роль "атома в ложбине" играет атом Li. Такая же картина характерна и для возбужденных состояний многих молекул, особенно при сравнительно высоких энер- энергиях возбуждения, когда молекулярная система моделируется относи- относительно жестким остовом и более или менее свободно перемещаю- перемещающимся около этого остова фрагментом молекулы. б. Изотопическое замещение. При введении приближения Борна-Оппенгеймера первоначально предполагают ядра фиксирован- фиксированными, что приводит к электронному волновому уравнению, собствен- собственные значения которого на следующем шаге, при переходе к ядерному уравнению, суть не что иное, как тот потенциал, в котором находится система ядер. Примечательно здесь прежде всего отсутствие масс ядер в электронном уравнении, что означает отсутствие зависимости по- потенциальных поверхностей от изотопического замещения. Конечно, при переходе к более высоким приближениям эта зависимость появ- появляется, хотя остается весьма слабой. Таким образом, с высокой точностью можно считать, что элек- электронная волновая функция для изотопомеров, т.е. молекул, различа- различающихся лишь изотопическим замещением, одна и та же, как и соот- соответствующие потенциальные поверхности. Последнее обстоятельство позволяет активно использовать такое замещение для получения по возможности большей информации о потенциальной поверхности того или иного квантового состояния молекулы. в. Перестановочная и пространственная симметрия ядер- ядерной конфигурации. Электронный оператор Гамильтона Не при пе- перестановках индексов тождественных ядер не меняется, т.е. он пол- полносимметричен относительно таких перестановок. Это означает, что операторы таких перестановок коммутируют с электронным гамиль- гамильтонианом Р(НеФ) = (РНе )(РФ) = НеРФ . Среднее значение Не на функции РФ по этой причине равно сред- среднему значению Не на функции Ф : <РФ\Не\РФ > = < Ф\Р*НеР\Ф > = < Ф\Р*РНе\Ф > = < Ф|Яе|Ф >, поскольку jP'jP = 1 для операторов перестановок. В свою очередь данный результат означает, что если Ф - собственная функция Не с собственным значением Ee(R\ то и РФ - функция, собственная с 445
тем же собственным значением. Другими словами, потенциальная поверхность должна быть полносимметрична относительно переста- перестановок индексов ядер. Функция же Ф, собственная для Не , должна преобразовываться по одному из неприводимых представлений груп- группы перестановок. Если в молекуле имеется несколько различных набо- наборов тождественных ядер, то для каждого набора должно выполнять- выполняться такое же требование, так что в целом вся электронная волновая функция должна преобразовываться по (прямому) произведению групп перестановок для каждого отдельного набора. Согласно общим положениям, полная волновая функция мо- молекулы должна быть полносимметрична или антисимметрична отно- относительно перестановок индексов тождественных ядер, если эти ин- индексы включают указание и на спин ядер. Однако электронная вол- волновая функция -лишь один из сомножителей полной функции, и для него возможен заметно больший простор в выборе представления. Помимо перестановочной есть и другая симметрия: опреде- определенные конфигурации тождественных ядер приводят к симметричному потенциальному полю, в котором движутся электроны и которое не меняется при поворотах в пространстве, отражениях в тех или иных плоскостях, зеркальных поворотах, инверсии всего пространства и т.п. Коль скоро потенциальная поверхность вводится в системе коорди- координат, начало которой находится в центре масс, то обычно все эти преобразования пространства совершаются так, чтобы центр масс при них не менял своего положения. Это означает, что все элементы симметрии, с помощью которых осуществляются преобразования, ос- оставляют центр масс неизменным. Другими словами, рассматриваются операции, образующие точечные группы симметрии. Так, в молекуле Н3 три протона могут занимать произвольные положения в пространстве. Однако среди всех возможных их конфи- конфигураций существуют конфигурации и равнобедренного треугольника (^2vM и равностороннего треугольника @ЗЛ), и линейная (D^). Для конфигурации D3h все пространство разбивается операциями этой группы на шесть эквивалентных областей, переходящих друг в друга при выполнении операций группы. Для конфигурации C2V таких обла- областей четыре и т.п. Потенциал, создаваемый ядрами, в этих случаях также обладает соответствующей симметрией. Перестановочная и пространственная симметрия тесно свя- связаны друг с другом, поскольку любая точечная группа изоморфна, эквивалентна некоторой подгруппе группы перестановок, расширен- 446 ной за счет дополнительного введения операции инверсии, т.е. пря- прямому произведению такой подгруппы и группы С,-. Тем не менее, с физической точки зрения их различают прежде всего по той причине, что точечные группы симметрии связаны с преобразованиями про- пространства, оставляющими неизменным внешнее потенциальное поле, тогда как в группах перестановок физическая основа не всегда про- просматривается столь отчетливо. г. Симметрия потенциальной поверхности. Возникает ес- естественный вопрос, как симметрия системы тождественных ядер от- отражается на потенциальной поверхности. Для того, чтобы ответить на него, выполним сначала весьма простую операцию на конкретном примере молекулы Н3 . Максимально возможная точечная группа симметрии для этой молекулы - D3h (группу D^ не рассматриваем, ибо отличающие ее от 0ЗЛ операции симметрии сводятся к произ- произвольным вращениям вокруг оси оо-го порядка, т.е. к вращениям системы как целого). Возьмем некоторую точку E(Rq) на потенциаль- потенциальной поверхности, отвечающую какой-либо геометрической конфигур- конфигурации ядер, и выполним любую операцию симметрии из 0ЗЛ, например поворот вокруг оси симметрии 3-го порядка. При этом исходная точка перейдет в другую, но отвечающую тому же самому значению энер- энергии: E(R0) -» E(CslRQ) = E(R0). Здесь уместно напомнить, что по- поворот объекта - потенциальной поверхности - эквивалентен такому же повороту системы координат, но в обратном направлении, в силу чего выше и написано CJ1. Будем далее перемещаться из исходной точки {/?0} потенциальной поверхности по некоторому пути на этой поверхности. Этот путь указанной операцией симметрии будет вос- воспроизводиться в другой области пространства, но он будет, что весь- весьма важно, вновь отвечать некоторому пути на той же самой потенци- потенциальной поверхности (рис. 10.1.1). Следовательно, если взять область пространства, которая при применении к ней операций симметрии точечной группы @ЗЛ в дан- данном случае) позволяет заполнить все пространство, и соответствую- соответствующую этой области часть потенциальной поверхности, то применение к последней операций симметрии позволит воспроизвести всю потен- потенциальную поверхность. Другими словами: потенциальная поверхность обладает для каждой молекулы максимально возможной точечной симметрией. (Вращения системы как целого при этом должны быть исключены.) Так, потенциальные поверхности молекул NH3, C2H4 и С2Н6 должны иметь симметрию D3h, D4/, и D6h соответственно. В 447 ¦ -*¦*-
частности, для С2Н4 эта конфигурация отвечает двум ядрам углеро- углерода на оси z (оси симметрии С4) и четырем протонам в вершинах квадрата в плоскости аЛ, перпендикулярной этой оси. Очевидно, что в качестве операций симметрии при рассмотрении конкретных задач могут потребоваться лишь операции некоторых подгрупп максималь- максимальной группы, например, для D3h - это C3v, D3, С3 или Cs. У III I Рис. 10.1.1. Условное представление пути на потенциальной поверхности, начинающегося из точки Ro в области I и его воспроизведение в областях II и III при поворотах вокруг оси симметрии третьего порядка, совпадающей с осью Oz, перпен- перпендикулярной плоскости рисунка. д. Равновесные конфигурации. Сформулированный выше ре- результат о симметрии потенциальной поверхности в какой-то степени противоречит здравому смыслу, поскольку достаточно привычно счи- считать, что молекула NH3 имеет форму треугольной пирамиды, С2Н4 - плоская и т.д. Однако эти привычные представления связаны ведь с равновесными конфигурациями ядер молекулы, т.е. с конфигурация- конфигурациями, отвечающими минимумам на потенциальной поверхности. По- Поэтому в действительности никакого противоречия нет: утверждение о симметрии относится ко всей поверхности в целом, а то, что на ней могут быть экстремальные точки и не обладающие этой симметрией, в частности точки, отвечающие положениям равновесия, не должно вызывать никаких неясностей и отрицательных эмоций. Однако от- относительно всех экстремальных точек на потенциальной поверхнос- поверхности можно сформулировать еще два полезных утверждения: 448 1. Конфигурация ядер, отвечающая максимально допустимой для молекулы симметрии, всегда соответствует экстремуму на по- потенциальной поверхности (минимуму, максимуму или седлу) по отно- отношению к таким деформациям, при которых эта симметрия понижает- понижается; деформации, сохраняющие максимальную симметрию, порожда- порождают на потенциальной поверхности хребты, ложбины и точки перевала. 2. Если на потенциальной поверхности есть минимум (или дру- другой экстремум), не отвечающий максимально симметричной конфи- конфигурации, то операциями группы максимальной симметрии он воспро- воспроизводится в других областях потенциальной поверхности. Иными словами, этот минимум размножается, репродуцируется на потенци- потенциальной поверхности операциями симметрии максимальной группы. Так, для NH3 равновесная конфигурация соответствует симметрии C3v, означая тем самым, что на потенциальной поверхности есть два эквивалентных минимума, а конфигурация более высокой симметрии Оз/, (т.е. плоская треугольная) отвечает максимуму на пути перехода от одного минимума к другому. Следует отметить, что операции симметрии, сводящиеся к простым поворотам системы координат как целого, не должны при- приводить к подобному процессу размножения минимумов, поскольку они не меняют расположение ядер друг относительно друга, а потенци- потенциальная поверхность строится именно в относительных координатах. Такие повороты влияют на тип симметрии волновой функции, определяющей вращение ядер, но не на свойства потенциальной поверхности. е. Локальная симметрия. Вблизи тех точек, которые соот- соответствуют равновесным конфигурациям, симметрия потенциальной поверхности отвечает симметрии именно равновесной конфигурации (операции которой образуют подгруппу максимально допустимой группы). Поэтому при исследовании нормальных колебаний ядер вблизи положения равновесия для классификации состояний можно пользоваться неприводимыми представлениями точечной группы рав- равновесной конфигурации молекулы, а не максимально допустимой группы. К тому же на отдельных участках потенциальной поверхности, отвечающих изменению лишь переменных, относящихся к локальному фрагменту молекулы, возможно также появление локальной симмет- симметрии, отражающей симметрию этого фрагмента. Так, при анализе по- потенциальной поверхности пропана помимо общей симметрии С2у этой молекулы можно учесть то, что локальные фрагменты - метальные группы - имеют симметрию СзУ- Конечно, это утверждение не явля- 449
ется строгим, поскольку такая симметрия существует лишь прибли- приближенно, однако локальная симметрия фрагментов полезна, особенно при различных упрощенных полуэмпирических подходах, поскольку ее учет способствует сохранению качественно правильной картины при описании электронной волновой функции и при анализе отдельных нормальных колебаний ядер. В частности, рассмотрение такой прибли- приближенной симметрии оказывается полезным при исследовании превра- превращений органических молекул на базе теории сохранения орбитальной симметрии, где при первоначальном анализе рекомендуется даже заменить гетероатомы на атомы углерода, чтобы симметрия превра- превращающейся системы атомов и связей молекулы (реакционного центра) была бы по возможности наиболее высокой. лс. Общее замечание. Полной группой симметрии ядерной подсистемы молекул является так называемая перестановочно-ин- перестановочно-инверсионная, или динамическая группа, наряду со всеми операциями перестановок тождественных ядер (или соответствующими преобра- преобразованиями пространства, отвечающими перестановкам) включающая и операцию инверсии, а также ее произведения на операции пере- перестановок. Такая группа оказывается весьма полезной, если не сказать необходимой, при систематизации квантовых состояний нежестких молекул, в которых ядра совершают движения большой амплитуды, так что приближение малых колебаний перестает быть применимым, а потому проводить классификацию состояний только на основе симметрии равновесной конфигурации становится невозможно. Для той же молекулы NH3 эта группа изоморфна группе D^h тогда как для молекулы С2Н4 она включает 2!х 4!х 2 = 96 элементов. Задачи 1. Что можно сказать о симметрии потенциальной поверхнос- поверхности таких систем, как С6Н6, С8Н8, С4В4? 2. Каковы могут быть диссоциационные пределы в основном состоянии у молекул Li4, C2H2, CHF3? §2. Электронно-колебательное взаимодействие Адиабатическое приближение приводит к тому, что электрон- электронная волновая функция не зависит от того, в каком квантовом состоя- состоянии находится подсистема ядер. В действительности же влияние 450 состояния ядерной подсистемы существует, так что вместо волновых функций вида Ф(г, Л)х(Л) необходимо рассматривать более сложные конструкции, например получающиеся при разложении в ряд точной волновой функции молекулы по функциям адиабатического прибли- приближения V = V .ФДг,Л)хДЛ) с последующим определением из сис- системы связанных уравнений функций х,-. Эти уравнения содержат так называемые операторы неадиабатической связи в слагаемых вида -Ф, . и т.п. Однако к взаимодействию движений элек- электронной и ядерной подсистем молекулы очень часто относят не эти операторы, а операторы, которые получаются при выборе гораздо менее точного начального приближения для разделения электронных и ядерных переменных, а именно грубого приближения Борна- Оппенгеймера. При этом ряд эффектов, не проявляющихся в обычном адиабатическом приближении, поскольку они этим приближением автоматически учитываются, выступают на поверхность и выглядят достаточно ярко. о. Электронно-колебательное взаимодействие в грубом приближении Борна-Оппенгеймера. В этом приближении пред- предполагается, что мы можем получить решения электронного уравнения Ф,{г, R) для некоторой фиксированной геометрической конфигурации ядер {/?а0} и вычислить с этими функциями потенциальные поверх- поверхности нулевого приближения Справа в этом равенстве от Ra зависит лишь гамильтониан Не. При малых изменениях параметров Ra по сравнению с Ra0 изменение гамильтониана W = He(Ra) - He(Ra0) можно формально принять за возмущение и построить далее ряд теории возмущений, что как раз обычно и делается. Однако, в силу кулоновского характера потенци- потенциала взаимодействия электронов с ядрами возникает вопрос, можно ли в действительности такое возмущение считать малым? Поэтому можно немного изменить процедуру рассмотрения и получить в итоге выражения того же типа, что дает и теория возму- возмущений. Для этого прежде всего запишем гамильтониан He(R) в базисе функций Ф,-(г, RQ), считая этот набор функций полным либо, если это не так, получая некоторое приближенное матричное представление оператора. Следовательно, He(R) будет представлен матрицей Нв с элементами Hi} (R) - < Ф, (г,RQ)\Не\Ф j (r,Ro) >, которые мы будем 451
предполагать непрерывными вместе со своими первыми производ- производными, так что при малых смещениях от конфигурации {/?0} можно написать: A0.2.1) a dRa где Otj{R) - остаточные члены второго и более высоких порядков малости по смещениям ARa = Ra - Ra0. Поскольку для H€(Rq) фун- функции Ф/(г, /?о) - собственные, то ,. A0.2.2) Будем также считать, что у диагональных матричных элементов Не можно выписать и вторые производные в точке о В отсутствие смещений ARa матрица Не диагональна и ее собственными векторами с, служат такие векторы, у которых один элемент (в /-й строке) равен 1, а все остальные элементы - нули. Если перейти теперь к некоторой смещенной конфигурации, для кото- которой хотя бы при некотором а ARa * 0, то возникающие изменения матричных элементов можно принять за возмущение. Отличие от непосредственного рассмотрения изменений потенциала Не при сме- смещениях заключается здесь в одном: мы рассматриваем лишь интег- интегральные характеристики и их производные по Ra , а не изменения кулоновских потенциалов при смещениях зарядов. В первом порядке теории возмущений поправки к невозму- невозмущенным энергиям E^Rq) будут определяться лишь диагональными матричными элементами оператора возмущения, если величины Ег не вырождены: дНи a dRa AR а A0.2.3) При наличии вырождения надо сначала определить правиль- правильные собственные векторы с^ нулевого приближения при решении соответствующего векового уравнения, а заодно и поправки первого порядка теории возмущений. Так, при наличии двукратно вырожден- вырожденного уровня необходимо будет решить систему двух линейных одно- однородных уравнений, в которых ниже для упрощения записи будет опущен индекс а ? символ суммирования по а и и указание на то, что 452 I производные по R берутся в той точке {Rao}, вблизи которой опера- оператор Не представляется в виде ряда: dHv dR дН 12 dR дН 21 дН 22 dR dR AR-E! (i) 'il = 0 (/ = 1,2), A0.2.4) Обозначим к тому же производные по R штрихом: дНц/dR = Н'ы. Тогда из D) получим: AE Нл 1 — //-? и 22 АЛ, A0.2.5) причем величина Д?"^ = {Н[х + #22)/2 определяет общий сдвиг первоначально вырожденного уровня^0) под влиянием возмущения. Эта формула показывает, как уже не раз говорилось, что исходный вырожденный уровень ?(°) под влиянием возмущения в первом порядке смещается на величину AE^^AR и к тому же расщепляется на два, если подкоренное выражение в E) отлично от нуля. Один из этих уровней оказывается ниже среднего значения ?(°) + AE^^AR , второй - выше, причем, как видно из E), производная этого смещения по AR для того и другого уровня различается лишь знаком. Полученный результат весьма интересен, поскольку он пока- показывает, что вырождение состояний, обусловленное, например, высо- высокой симметрией изначально выбранной конфигурации, может за счет смещений ядер и перехода к менее симметричным конфигурациям быть снято. Понижение одного из возникающих уровней показыва- показывает, что если в начальном положении равновесия электронное состоя- состояние и было вырожденным, то при учете возмущения равновесной становится конфигурация с более низкой симметрией и вырождение (частично или полностью) снимается. Во втором порядке по А/?а, как показывают формулы обыч- обычной теории возмущений, можно для энергии написать ЕР = 2 1 dR a A0.2.6) 453
Это выражение для энергии выписано в явном виде для того, чтобы обратить внимание на два обстоятельства. В первой строке сумма берется по всем j\ относящимся к состояниям, невырожденным с состоянием /, и при прочих равных условиях слагаемые в этом выра- выражении тем больше, чем ближе E.{Rq) к E^Rq). Это означает, что для невырожденных, но близких друг к другу уровней поправки второго порядка, вообще говоря, должны быть велики. Кроме того, коль ско- скоро сумма берется по всем j, то вероятность того, что дНц /dRa * 0, хотя бы при некотором у(*/), будет отличной от нуля (в противном случае возмущение для уровня / просто отсутствует), а это в свою очередь говорит о том, что первый член в F) может давать вклад в Е\2^, причем знак его определяется и номером уровня /, т.е. знаком энергетической дроби, и самими производными дНц /dRa . Второе слагаемое в F) отвечает гармоническому приближе- приближению, а величины д Ни /dRa dRo имеют смысл силовых постоянных. Если для состояния i в качестве исходной взята равновесная конфигу- конфигурация, то силовая постоянная Faa - д2Ни /d2Ra должна быть поло- положительной (в случае минимума на потенциальной поверхности). Первое же слагаемое в F), когда оно отрицательно, может уменьшать величину силовой постоянной Faa, а то и сделать ее отрицательной. Такой результат означает, что даже в отсутствие вырождения за счет вклада второго порядка теории возмущений возможен переход от минимума на потенциальной поверхности к седлу (максимуму по отдельным направлениям), что еще раз говорит о возможности иска- искажения исходной, например высокосимметричной, равновесной конфигурации. б. Адиабатическое приближение. В адиабатическом при- приближении вышеуказанные эффекты, как уже было сказано, автома- автоматически учитываются. Здесь электронная волновая функция определя- определяется для каждой конфигурации ядер, а потому функция Ф,{г, R) вклю- включает все поправки теории возмущений, возникающие при переходе к этой функции от Ф^г, Rq). Гамильтониан Не тот же, что и исполь- используемый в грубом приближении Борна-Оппенгеймера при вычислении Ei0(R), т.е. точный электронный гамильтониан. Поэтому соответ- соответствующие поправки теории возмущений автоматически учтены здесь и для энергии. К тому же получаемые выражения для энергии и волновых функций не содержат в явном виде каких-либо производных по переменным {/?а}, задающим конфигурацию ядер молекулы. 454 Производные появляются лишь при учете неадиабатических поправок, поскольку эти поправки определяются операторами вида < ф.| dR а dR и < ф.|—-|ф; >, причем, как правило, наи- а dR больший вклад дают первые из них, содержащие интегралы с первы- первыми производными Ф; по Ra. Эти интегралы могут быть записаны на основе следующего соотношения (Ф, и Ф; - функции, собственные для Не): dR а dR a dR а ЭФ ~dR а dR а Поскольку к тому же д 0 = dR <Ф, Ф : > = < 1 ' J а ЭФ, ЭЛ~ ЭФ, а " dR а ТО dR 1 а dR а Последнее равенство показывает, что матричный элемент неадиаба- неадиабатической поправки первого порядка представляется выражением, очень похожим на то, что фигурирует в теории возмущений, и на то, что было в грубом приближении Борна-Оппенгеймера. Матричные элементы неадиабатических поправок возникают при действии оператора кинетической энергии ядер на электронную волновую функцию. В качестве сомножителя перед ними выступают либо массы ядер, либо некоторые приведенные массы, имеющие тот же порядок величины, что и массы ядер. Поэтому в целом неадиаба- неадиабатические поправки обычно очень малы в отличие от поправок, появ- появляющихся при традиционном введении электронно-колебательного взаимодействия. в. Эффекты Яна-Теллера* Снятие вырождения электронных термов многоатомной молекулы при понижении симметрии ядерной 455
конфигурации и связанное с ним понижение симметрии равновесной конфигурации молекул носят название эффекта Яна-Теллера1. Если этот эффект проявляется в первом порядке теории возмущений (с волновыми функциями грубого приближения Борна-Оппенгеймера в качестве невозмущенных), то он называется эффектом Яна-Телле- Яна-Теллера первого порядка. Если же в нулевом приближении электронные состояния невырождены, то поправки, связанные с электронно- колебательным взаимодействием, могут привести к указанным выше особенностям изменения термов и равновесных конфигураций за счет членов второго порядка теории возмущений. По этой причине ука- указанные особенности называют либо эффектом Яна-Теллера второго порядка, либо псевдоэффектом Яна-Теллера. Г. А. Ян и Э. Теллер A937 г.) показали на примере всех точечных групп симметрии, не- неприводимые представления которых имеют размерность не выше трех, что всегда найдется такое неполносимметричное колебание многоатомной молекулы, которое понижает электронную энергию вырожденного электронного состояния, так что минимум на потен- потенциальной поверхности смещается к конфигурации ядер с более низ- низкой симметрией. В указанной терминологии ими был рассмотрен эффект первого порядка. Так, в случае двукратно вырожденного элек- электронного состояния типа Е искажение, ведущее к понижению сим- симметрии, может быть связано с двукратно вырожденным колебанием того же типа симметрии. Понижение симметрии равновесной конфигурации приводит к нескольким эквивалентным минимумам, переходящим друг в друга при операциях группы высокой симметрии, не входящих в число операций группы образующейся равновесной конфигурации. Так, из выражения E) следует, что возникает два минимума, отвечающих некоторым положительному и отрицательному значениям А/?а. Для октаэдрических комплексов переходных металлов за счет эффекта Яна-Теллера (первого порядка) появляется 3 эквивалентных мини- минимума, отвечающих октаэдру, вытянутому или сжатому по одной из его трех осей 4-го порядка. Наличие трех минимумов, разделенных барьерами, приводит, если эти барьеры невысоки, к туннельному 1 Теллер Эдвард (р. 1908), американский физик. Родился в Венгрии, учился и работал в Германии, Дании, Великобритании, с 1935 г. в США. Труды по ядер- ядерной физике, термоядерным реакциям, астрофизике. Участник создания амери- американских атомной и термоядерной бомб. 456 расщеплению уровня, отвечающего системе с такими же, но изоли- изолированными друг от друга минимумами. Между расщепленными уровнями возможны переходы, что приводит к тонкой структуре оп- оптических спектров комплексов, к изменению правил отбора и появлению новых линий в колебательном спектре. Если потенциальные барьеры между минимумами достаточно высоки, то система, попав в один из них, будет находиться в нем про- продолжительное время: это так называемый статический эффект Яна- Теллера. В противном случае проявляется динамический эффект Яна- Теллера. Обычно основное состояние молекулы, для которого как раз и рассматриваются эффекты Яна-Теллера первого порядка, невы- невырождено. Однако даже в тех случаях, когда вырождение есть, элект- электронно-колебательное взаимодействие не настолько велико, чтобы ба- барьер между минимумами оказался достаточно высоким. Поэтому статический эффект Яна-Теллера наблюдают только при наличии вне- внешних воздействий, в частности при увеличении высоты барьеров в кристаллах. Минимумам потенциальной поверхности в этих случаях отвечают такие конфигурации всей кристаллической структуры, при которых вырождение для каждой отдельной молекулы или иона в кристалле снимается. Такое энергетически выгодное расположение локально искаженных фрагментов кристалла (в общем случае возникающее не только за счет эффектов Яна-Теллера) может быть разрушено при повышении температуры тепловыми флуктуациями, что приводит, например, к структурным фазовым переходам в так называемых ян-теллеровских кристаллах. Для свободных молекул и молекулярных комплексов, т.е. в отсутствие внешнего воздействия, характерен именно динамический эффект. Для линейных многоатомных молекул с вырожденным элект- электронным состоянием линейной конфигурации при деформационных ко- колебаниях также возможно смещение минимума от линейной к изог- изогнутой конфигурации, что носит название эффекта Реннера-Теллера. Как и в случае эффекта Яна-Теллера, этот эффект может быть сла- слабым и проявляться лишь в уменьшении силовой постоянной дефор- деформационного колебания линейной молекулы, либо быть сильным и приводить к нелинейной равновесной конфигурации молекул. Экспериментально структурные и спектральные проявления эффектов Яна-Теллера наблюдаются для некоторых молекулярных кристаллов и кристаллов комплексов переходных металлов. С ними связывают особенности ряда кристаллических структур (например, 15— 1395 457
подвижность координационной сферы Cu(II) в керамиках, форми- формирование винтовой структуры в кристаллах типа CsCuCl3 и т.п.), структурные фазовые переходы в кристаллах, особенности оптических спектров, активацию ряда молекул при их взаимодействии с актив- активными центрами катализаторов и т.п. С эффектами Яна-Теллера свя- связывают и ряд особенностей поведения молекул в биологических системах. Глава XI Химическая связь § 1. О природе химической связи Химическая связь - это такое взаимодействие между атомами или молекулами, которое приводит к образованию из них стабильных или метастабильных химических соединений. Такими соединениями могут быть как молекулы, так и конденсированные системы. Природа химической связи, т.е. то, благодаря чему и как она возникает, были предметом многочисленных обсуждений и в научной, и в учебной литературе. cl Парные взаимодействия в классической и квантовой те- ориях. Со второй половины XIX века, когда формулировались ос- основные представления классической теориии химического строения, было принято в качестве почти абсолютного утверждения, что при образовании молекулы из атомов между каждой парой из них суще- существует взаимодействие и все эти взаимодействия можно подразде- подразделить на два типа: главные, определяющие возможность существова- существования и химическую стабильность образующегося соединения как целого и называемые химическими связями, и неглавные, влияющие в большей или меньшей степени лишь на вторичные особенности соединений при одном и том же наборе главных взаимодействий. Помимо образования химических связей как таковых важна и последовательность соединения атомов между собой. При этом стабильное соединение из заданных атомов образуется тогда, когда последовательность химических связей между ними образует неразрывную цепь (в которую могут входить и циклы). Следовательно, в классической теории не обсуждается, чем определено наличие химической связи, и в то же время считается, что химические связи образуются между парами атомов, располагающихся наиболее близко друг к другу, причем число химических связей, образуемых данным атомом, определяется его валентностью. Представления о двойных, тройных и т.п. связях возникли не просто из-за их качественного различия, а в существенной степени благодаря стремлению сохранить у каждого атома фиксированную валентность (одну или несколько). 15* 459 L
7— В квантовой механике при переходе к молекулам формально представление об атомах, их образующих, не сохраняется. Теория оперирует лишь с определенными числами ядер (с соответствующи- соответствующими зарядами) и электронов. Далее записывается оператор Гамильто- Гамильтона и решается временное или стационарное уравнение Шредингера. Здесь также вводится представление о парном взаимодействии, но поскольку в качестве составляющих молекулу частиц фигурируют уже не атомы, а ядра и электроны, то речь идет о парном взаимо- взаимодействии именно ядер и электронов. Возникает довольно существен- существенный разрыв между двумя теориями, что приводило и приводит к многочисленным попыткам ввести в квантовой теории представления об атомах в молекуле, т.е. представления, активно используемые современной химией, без которых она существовать фактически пока не может. Это обстоятельство влечет за собой и попытку объяснения того, как возникает то взаимодействие, которое принято называть химической связью. б. Двухатомные молекулы. Обсуждение проблем химичес- химической связи начиналось с рассмотрения двухатомных молекул, поскольку для них неясностей с выделением пары взаимодействующих атомов в молекуле не существует. Первые расчеты молекулы водорода, вы- выполненные В. Хайтлером и Ф. Лондоном1 A927) на основе метода валентных схем, привели к выводу, что главный вклад в энергию образования молекулы Н2 в основном состоянии XxI,+g дает так на- называемый обменный интеграл Х-Я>;AЖB)Яе^ а в целом энергия образования определяется выражением J К + а __ + 1+5 1 + 5 где 5 =< г|)д \tyb >. Интеграл У (так называемый кулоновский интег- 1 Лондон Фриц Вольфганг A900-54) совместно с В. Хайтлером выполнил расчеты молекулы Н2, рассмотрел в рамках метода валентных схем четырехэлектронную проблему, разработал теорию дисперсионных межмолекулярных сил, создал один из широко известных вариантов теории сверхпроводимости. Хайтлер Вальтер (р. 1904), известен своими трудами в области квантовой теории излучения (третье издание его монографии "Квантовая теория излучения'* переведено в 1956 г. на русский язык). 460 грал), как показали расчеты с ls-функциями, центрированными на ядрах а и 6, составляет вблизи равновесного расстояния примерно 10-15% полной величины Ef. Если воспользоваться выражением для Не молекулы водо- водорода, то можно далее для J иК написать: к J = -2 R A1.1.3а) \ь K=-2S< 1 R \ь R A1.1.36) Эти выражения отчетливо показывают, что обменный интеграл за- зависит от интеграла перекрывания S базисных функций i|>fl и tyb. Если от функций i|>fl и tyb перейти к их ортогонализованным линейным комбинациям, определяемым, например, выражениями Фа = A1.1.4) где А и В - нормировочные множители, а X - параметр, определяю- определяющий соотношение весов функций i|>fl и г|>^ в их ортогонализованных линейных комбинациях сра и ф^1, и построить далее волновую функ- функцию метода валентных схем на функциях сра и qpt, то в выражении C6) члены с интегралом перекрывания пропадут. Останется лишь интеграл < фаф^|ф^фа > , который, как можно показать, неотрица- неотрицателен. Следовательно, при подобной замене обменный интеграл не только становится меньше по модулю, но и при некотором S меняет знак на обратный. Это в свою очередь означает, что он приводит не к связыванию двух атомов, а к их отталкиванию. Таким образом, исходное утверждение о том, что связывание в молекуле водорода определяется обменным интегралом, существен- существенно зависит от выбора базиса, а потому не может иметь какого-либо определенного физического смысла. К тому же следует заметить, что молекулярный ион Н^, ДОЯ которого никакого обменного интеграла не возникает, имеет энергию связи, превышающую половину энер- энергии связи для молекулы Н2 (как того и следовало ожидать из-за от- отталкивания электронов). Таким образом, исходное утверждение о том, что связывание в молекуле водорода определяется обменным интегралом, сущест- Например, при X = -0.3 и S = 0.7 коэффициент -(k+ 5)/(l + KS) равен -0.45. 461 L
венно зависит от выбора базиса, а потому не может иметь какого- либо определенного физического смысла. К тому же следует заметить, что молекулярный ион Н2 »для которого никакого обменного интеграла не возникает, имеет энергию связи, пренвышающую половину энергии связи для молекулы Н7 (как того и следовало ожидать из-за отталкивания электронов). Несколько более интересные результаты получаются для той же задачи в приближении метода молекулярных орбиталей. Коль скоро основному состоянию здесь отвечает конфигурация а", то спиновой функцией служит (а$ - (За)/V2 , что соответствует синглетному состоянию. Как и в рамках метода валентных схем, был сделан вы- вывод, что образование стабильного состояния связано с поведением спиновой функции: электроны должны быть спарены так, чтобы об- образовалось синглетное состояние. Спаривание, однако, существует и в триплетном состоянии, когда имеется функция (сф + (За)/V2 . Это свидетельствует о том, что различие в энергии различных мульти- плетов связано прежде всего с симметрией пространственной части волновой функции, в частности, с характером и числом узловых по- поверхностей у нее. Симметрия же пространственной части определя- определяется тем жестким требованием, что в целом волновая функция дол- должна быть антисимметрична относительно перестановок индексов электронов. Для двух электронов симметричность спиновой функ- функции (триплет) влечет за собой антисимметричность пространствен- пространственной части, и наоборот. Отсюда и появляется столь жесткая связь ор- орбитального заполнения и мультиплетности в рамках метода молеку- молекулярных орбиталей. Для многоэлектронной системы такой жесткой связи уже нет, что приводит, с одной стороны, к множеству валент- валентных схем, отвечающих одной и той же мультиплетности, а с другой - к отсутствию непосредственной связи между узловой структурой про- пространственной части и мультиплетностью. К тому же при решении вопроса о том, какое состояние будет ниже по энергии, балансируют два фактора: заполнение по возмож- возможности более низких по энергии орбиталей (что, как правило, ведет и к более низкой полной энергии) и уменьшение межэлектронного от- отталкивания за счет максимально возможного разведения электронов в пространстве, т.е. локализация их на пространственно разделен- разделенных орбиталях. При сильно различающихся орбитальных энергиях первый фактор доминирует: более низким оказывается состояние с максимально заполненными низшими по энергии орбиталями, а это 462 означает, что образуется состояние с минимальной мультиплетнос- мультиплетностью. Для многих молекул основное состояние действительно явля- является синглетным. Если орбитальные энергии близки или вырождены, верх берет, как правило, второй фактор и появляются состояния с более высокой мультиплетностью (так называемое правило Хунда, носящее качественный характер и не имеющее строгого обоснования). Чтобы проводить сравнение корректно, в рамках метода мо- молекулярных орбиталей нужно прежде всего сопоставлять те состоя- состояния, которые отвечают одной и той же конфигурации. Для молекулы ¦у Н2, как уже говорилось в § 3 гл.VI, конфигурации ag отвечает одно состояние, тогда как конфигурации ogau -двасостояния 2* и 2*, волновые функции которых имеют вид х;) = 1[а,A)оиB) + авA)а,B)](ар - fkx), A1.1.5) а энергии A1.1.6) > + < ogou\ogou >-< ogau\ouog > , где Eq - общая для обеих энергий часть, связанная с одноэлектрон- ными операторами. Коль скоро интеграл <ogau\auag > положите- положителен, то в триплетном состоянии для двухэлектронной задачи меж- межэлектронное отталкивание меньше, чем в синглетном. Действитель- Действительно, при сближении электронов 1 и 2 пространственная часть три- плетного состояния, как следует из E), стремится к нулю, т.е. веро- вероятность найти оба электрона вблизи одной точки пространства будет в этом случае близка к нулю. Для синглетного состояния такого ус- условия нет. Именно это обстоятельство и доминирует при использо- использовании ортогональных одноэлектронных функций с близкими или рав- равными орбитальными энергиями. В существенной степени на критерии минимальности меж- межэлектронного отталкивания основана конструкция перехода к лока- локализованным орбиталям. При их использовании, однако, уже нет воз- возможности привлечь к рассмотрению орбитальные энергии, посколь- поскольку локализованные орбитали не являются собственными для кано- канонического фокиана. В то же время локализованные орбитали позво- 463
ляют пользоваться, например, такой дополнительной характеристи- характеристикой, как их эквивалентность (или почти-эквивалентность). Рассмотренная выше модель химической связи для гомоя- дерных двухатомных молекул независимо от используемого метода - валентных схем или молекулярных орбиталей - получила название модели ковалентной связи (от лат. со - приставка, означающая со- совместность, и valens - имеющий силу). Как правило, ковалентная связь характеризуется увеличением электронной плотности в области между ядрами по сравнению с суммой электронных плотностей сво- свободных атомов. Это достаточно очевидно в том примере молекулы Н2, который обсужден выше. Так, при использовании базиса из Is- функций и нормировке плотности на число частиц (так чтобы для молекулы и разделенных атомов эта нормировка была одинакова) в рамках метода валентных схем а в рамках метода молекулярных орбиталей - и, следовательно, A1.1.7) Как показывает прямая численная оценка1, при 5 > 0 в обоих случаях Ар > 0 в области между ядрами и Ар < 0 на межъядерной оси во внешних областях, а также вблизи ядер. При образовании ковалентной связи обычно к тому же пред- предполагается, что от каждого атома берется по одному электрону (хотя это и не обязательно: Н?, L12 , Li3 и т.п.!), либо при образовании кратных связей - по два или по три электрона. Для гетероядерных молекул эта картина естественным образом нарушается и приходится говорить о появлении полярной ковалентной связи (см.ниже). Допол- ' ПРИ каь = ' >4 а.с, т. е. при Rab» Rc, S = 0,7529. В точке посередине между ядрами ApVB = 0,237ра, Дрм0 = 0,282ра, на ядре а Друв = -0,147ра@), Дрмо = -0,174рв@). 464 нительные осложнения привносит переход к возбужденным состоя- состояниям, когда даже для гомоядерных молекул возможна диссоциация на А+ и А", так что при стремлении к диссоциационному пределу возможно появление отчетливой поляризации. Правда, стационарные возбужденные состояния должны описываться волновыми функция- функциями, удовлетворяющими стационарному уравнению Шредингера, а потому такие функции должны учитывать симметрию гамильтониана и формально поляризации наступить не может. Однако реально она есть, и с высокой степенью точности поляризованная функция может быть описана линейной комбинацией почти вырожденных функций - симметричной и антисимметричной относительно отражения в ПЛОСКОСТИ О/,. в. Ионная связь. Таким образом, данное выше рассмотрение позволяет выявить ряд полезных для дальнейшего обсуждения об- обстоятельств и подойти ближе к пониманию проблемы химической связи. Тем не менее, модель на основе гомоядерных двухатомных молекул годится не всегда. Имеются ведь и такие двухатомные моле- молекулярные системы, например молекулы щелочных галогенидов AHal, для которых диаграмма орбитальных энергий имеет следующий вид: атом А щелоч- щелочного металла молекула AHal атом Hal галогена 1 4,5 эВ а а nfp -12 эВ Из-за большого расстояния по энергии между ns-орбиталью А и л'/?г-орбиталью Hal молекулярная cr-орбиталь представляет собой и'/>-орбиталь с небольшой "примесью" ns-орбитали: i|>o = ri pz + Xns (к » 0). По этой причине в нулевом приближении можно считать, что в молекуле образуются анион Hal" и катион А+, взаимодейству- взаимодействующие друг с другом по кулоновскому закону и в большей или меньшей степени поляризующие друг друга, т.е. искажающие сферически симметричное распределение заряда каждого из ионов. Такая модель в отличие от предшествующей (для молекулы Н2) получила назва- 465
ние модели ионной связи: при образовании молекулы происходит смещение электронного заряда от одного центра к другому с обра- образованием ионов, взаимодействующих между собой по кулоновскому закону. При образовании химической связи между одинаковыми атомами (модель ковалентной связи) также происходит простран- пространственное перераспределение электронной плотности, но если про- провести плоскость посредине между двумя одинаковыми центрами, то суммарный заряд по одну и по другую стороны от этой плоскости один и тот же. При образовании же ионной связи картина иная: если провести такую плоскость посредине между центрами А и Hal, то при сближении атомов происходит существенный перенос заряда через эту поверхность. В частности, если величина переносимого заряда равна заряду электрона, то можно говорить об образовании катиона и аниона и о кулоновском взаимодействии между ними. В действительности переноса целочисленного заряда и обра- образования чисто ионной связи никогда не наблюдается. Даже в моле- молекулах щелочных галогенидов эта величина не превышает -0,85. Поэтому в рамках ионной модели возникают различные поправки на поляризацию ионов и другие искажающие факторы, а тогда, когда перенос заряда составляет еще меньшие величины, то говорят про- просто об образовании полярной связи. В этих случаях отдельным ато- атомам в молекуле на основе тех или иных условных критериев подчас ставят в соответствие дробные заряды. Так, для молекулы СО в основном состоянии при малых межъядерных расстояниях (близких к равновесному) можно качественно записать перераспределение за- заряда с помощью выражения С6"О6+, тогда как при расстояниях, не- несколько больших равновесного, распределение заряда становится иным: С6+О6" и, наконец, диссоциирует молекула на нейтральные атомы С и О. По используемой модели к ионной связи очень близка так называемая донорно-акцепторная связь, однако в этом случае, как правило, речь идет не об отдельных атомных орбиталях атомов, об- образующих двухатомную молекулу, а о молекулярных орбиталях двух подсистем (молекул), носящих название донора D и акцептора А соответственно (см. схему). При взаимодействии этих двух под- подсистем образуется единая система с верхней занятой орбиталью Ф = Фа + ^Фэ> причем X < 1, так что эта орбиталь по существу представляет собой орбиталь акцептора г|>А, модифицированную добавкой ?а|> D . Электроны, занимавшие в разделенных подсистемах 466 орбиталь г|> D, в молекуле DA занимают орбиталь Ч>. В зависимости от величины X заряд в большей или меньшей степени переносится от донора к акцептору, в силу чего образующаяся система может быть представлена как D+A", причем величина переносимого заряда зависит как от разности орбитальных энергий i|> D и i|> A, так и от симметрии вновь образующегося фрагмента в системе DA. D DA А (ВЗМО, высшая", занятая орбиталь) \ (НВМО, вакантная орбиталь) Простейший пример образования такого типа связи - взаи- взаимодействие ВН3 с NH3 , ведущее к соединению H3B-NH3 с распре- распределением заряда, примерно отвечающим схеме H3B~-N+H3. Более сложные конструкции подобного же типа - комплексные ионы [Ti(H2ON]3+, [Co(NH3N]3+ и т.п. (Обычно при рассмотрении таких систем используют теорию кристаллического поля или теорию поля лигандов). Несколько иного рода соединения образуются при взаимодействии бензола или ароматических конденсированных углеводородов с молекулами галогенов, например с Вг2 или 12, когда ароматический углеводород играет роль акцептора, причем в качестве акцепторной выступает вакантная л-орбиталь, относящаяся ко всей сопряженной системе. Рассмотрение, подобное представленному выше, можно про- продолжать и далее, однако уже из изложенного, по-видимому, доста- достаточно очевидно, что для выяснения того, почему возникает та или иная связь и чем эти связи существенно, качественно отличаются друг от друга, оно мало полезно. В основном такое рассмотрение базируется на сопоставлении орбитальной структуры до образования связи и после, т.е. связано с описанием происхождения, генезиса связи, но не с существом ее как таковой после того, как она возникла. г. Двух- и многоцентровые связи. В качестве одной из спе- специфических сторон химической связав некоторых соединениях вы- выделяют ее многоцентровый характер. Так, говорят о трехцентровых 467 1--^1и
связях в бороводородах, о многоцентровых связях в металлоценах и т.п. При этом обычно имеют в виду следующее. Молекулярные орбитали, входящие в состав од ноконф игу ра- рационной функции, можно линейным преобразованием свести к лока- локализованным орбиталям, включающим лишь атомные орбитали, от- относящиеся к небольшому числу центров (все остальные базисные функции, если и входят в заданную локализованную орбиталь, то с малыми весами). Как правило, локализованные орбитали включают функции лишь одного или двух соседних центров. Так, при использо- использовании минимального базиса атомных орбиталей молекулярные орбитали метана, отвечающие электронной конфигурации la] 2ax \tx основного состояния, могут быть сведены к следующим локализо- локализованным: остовная ls-орбиталь углерода и 4 локализованных эквивалентных орбитали, каждая из которых включает одну sp3- гибридную орбиталь углерода и ls-орбиталь соответствующего атома водорода, т.е. 4 двухцентровые орбитали, которые соотносят с четырьмя связями С-Н, хотя, конечно, такое соотнесение весьма условно. В то же время для молекулы Н^ ПРИ геометрической конфигурации ядер в вершинах правильного треугольника основной электронной конфигурацией является \а\, причем орбиталь \ах в минимальном базисе имеет вид -*• +ls? где номера V3 + 3S у 15-функций отвечают номерам ядер. Такую функцию преобразовать к более локализованной нельзя, базисные орбитали всех трех центров входят в нее на равных основаниях, и поэтому в подобных случаях говорят именно о наличии трехцентровой связи. Аналогичное положение возникает при попытке локализовать три молекулярные я-орбитали бензола, получающиеся, например, в приближении Хюккеля. Эти орбитали преобразуются по представлениям А2и иE\g9 и из них можно построить 3 локализованные эквивалентные орби- орбитали, имеющие, например, следующий вид (ради простоты считаем, что 2рг?-орбитали, где к=1, 2,..., 6указывает номер центра, взаимно ортогональны): ^ + 3Xi + 2х2 - Х4) > Ф2 = ^2 BХ2 + ЗХз + 2Х4 - Х6) > Фз = з^B)С4 +ЗХ5 +2Хб-Х2)- (П.1.8) Каждая из этих орбиталей является в существенной степени трехцентровой, вклад орбитали четвертого центра заметно меньше (если сопоставлять квадраты коэффициентов). 468 В молекуле диборана трехцентровые локализованные орби- орбитали образованы двумя гибридными орбиталями атомов В и ls-op- биталью одного из мостиковых водородов. В молекулах циклопента- диенильных соединений, например ферроцена, также возможно по- построение пяти многоцентровых (точнее, трехцентровых) орбиталей, включающих по одной 2р2-орбитали от атомов углерода обоих колец и соответствующей орбитали Fe, т.е. одной из пяти эквивалентных орбиталей, которые при наличии группы симметрии D^ можно по- построить из d-орбиталей центрального атома. Примеров таких на се- сегодня существует множество и перечислять их далее нет смысла. В рамках метода валентных схем необходимость введения мно- многоцентровых орбиталей возникает тогда, когда для данного соедине- соединения из соображений симметрии нельзя ограничиться одной лишь ва- валентной схемой, а нужно рассматривать хотя бы две из них. Так, для молекулы Нз это будут три схемы: 1 а для молекулы бензола - по крайней мере две: 4 4 1 1 Для молекулы диборана \kyll ^Н5 2< >В^ н таких валентных схем также будет как минимум две: А.У 469
В качестве базисных для атомов В здесь выбраны гибридные атом- атомные орбитали Ауц, Ау12, hy2\ и hy^ кроме того, чтобы не затем- затемнять картину, на схемах опущены 15-орбитали концевых атомов Н и соответствующие гибридные орбитали ht (i = 1, 2, 3, 4) атомов В, а также остовные 15-орбитали атомов В. Собственно в самом факте многоцентровости орбитали ничего особенного нет: все молекулярные орбитали, получаемые при решении обычной задачи Хартри-Фока, являются многоцентровыми. Однако наличие многоцентровых орбиталей указанного выше типа, т.е. таких, которые при линейном преобразовании занятых в данном состоянии орбиталей не могут быть сведены к двухцентровым, сви- свидетельствует о том, что при диссоциации соединений, когда центры, относящиеся к одной из таких орбиталей, попадают в разные про- продукты диссоциации, должно происходить значительное перераспре- перераспределение электронной плотности. В рамках метода валентных схем это означает, что вес одной из эквивалентных структур должен стремиться к 1, а других - к нулю. Такое положение обычно свидетельствует о том, что в некоторой области геометрических конфигураций молекулы близко расположе- расположены две потенциальные поверхности (псевдопересечение), что в свою очередь, как правило, говорит о важной роли электронной корреляции в этой области. Следовательно, появление многоцентровых локали- локализованных орбиталей есть дополнительный намек на возможную сложную структуру потенциальной поверхности и волновой функции соответствующего электронного состояния. д. Поведение кинетической и потенциальной энергии при образовании связи. Увеличение электронной плотности в области между ядрами при образовании химической связи привело к рассуж- рассуждениям о том, что возникновение связи может быть приписано пони- понижению потенциальной энергии взаимодействия электронов с ядра- ядрами. Однако при этом должны возрастать межэлектронное отталки- отталкивание и средняя кинетическая энергия электронов, если они находятся в меньшем объеме пространства по сравнению с системой разде- разделенных атомов. Ответ на часть возникающих здесь вопросов может быть получен на основе так называемой теоремы вириала, которую в простейшем варианте можно сформулировать, исходя из нижесле- нижеследующего рассмотрения. Пусть имеется некоторое (стационарное) квантовое состояние с волновой функцией W, собственной для гамильтониана Н = Т + V 470 с собственным значением Е. Рассмотрим для этого состояния сред- среднее значение эрмитова оператора Fj =(xjPj + PjXj) /2,гдел^-одна из декартовых переменных, определяющих точку конфигурационного пространства для всей системы рассматриваемых частиц, a Pj - оператор канонически сопряженного ей импульса: Pj = -i djdXj . В качестве оператора// может выступать полный гамильтониан, элек- электронный оператор Не для молекулярной системы и т.п. Поскольку и и dV и zi I д i PjH - Hpj = -*— и XjH -Hxj = —— = pj9 dxj J J ntj dXj ntj J то для коммутатора F: и Н можно сразу же написать - HFj = i m A1.1.9) Среднее значение коммутатора двух эрмитовых операторов А и В на функции, собственной для одного из этих операторов, скажем Л, равно нулю: < \$АВ - А4|ц> > =< Ац>|Яф > - < -ф|ВАф > = а < Ч>|В|Ч> > - - а < ф| В|Ч> > = 0. Поэтому, если функция W - собственная для Я, то из (9) следует 1 — .2|,тг^_^1ТИ- ЭУ1Ш>. A1.1.10) В классической механике - 8V/dXj есть компонента силы Fj по координате ху Величина \ -XjFj носит название вириала (от нем. das Virial, берущего свое начало от лат vires, множественного числа слова vis - сила). При суммировании по всем переменным слева в соотношении A0) получится удвоенная средняя кинетическая энер- энергия, а справа - среднее значение вириала, которое при конкретном задании потенциала, как правило, можно далее упростить. Так, если V = 1 ^ k-x^Xj, т.е. потенциал многомерного гармонического осцил- осциллятора, то ^ jxj[^/^xj) = ^' так что из (Ю) будет следовать весьма простое равенство: <Т> = <V> ,slE = 2<T> - 2<V> . В случае кулоновского потенциала электронной задачи kl выражение для одного из слагаемых вириальной суммы будет таким: A1.1.12) Ч-D -+IXJ -' а 471
Просуммировав A2) по;, а затем добавив и вычтя из правой части этого выражения laXa(dV/dXa), получим равенство 2 .. X " ~R* 2 ^ ~R ' A1.1.13) В первой строке справа в этом равенстве стоит -V, вторая же строка равна -^aXa(dV/dXa)9 так что окончательно для кулоновского потенциала можем написать: <W|Ra-VaV|W>. A1.1.14) Это соотношение и представляет собой теорему вириала. Для двухатомной молекулы, если ввести для двух ядер координаты центра масс X, Y, Z и относительные переменные х, у, z (х=Хх -Х2,...) и учесть, что задача рассматривается в системе цен- центра масс ядер, получим -< 4>\R(dV/dR)\4i >, где R - радиальная переменная для вектора R с координатами х, у и г. Наконец, учитывая, что в последнем интеграле интегрирование ведется лишь по электронным переменным и что dV/dR = дНе /3R, ± ±1 р а также то, что ± < W|W> = < к соотношению ц, = 0, придем 2<T>=~<V>-R A1.1.15) Оно допускает и две следующие эквивалентные записи (поскольку <T> + <V>=E): v ' дЕ ^"' (П.1.16а) < V > = 2Е + R дЕ_ dR A1.1.166) При R -* оо , если Е - 0 быстрее, чем cR~\ е > 0 и с - некоторые постоянные, < Т > и < V > также стремятся к нулю. Для связанных 472 состояний (поведение E = E(R) примерно передается кривой Морзе) 3E/dR>0 при R>RG и dE/dR<0 в области R < Re . К тому же <Г> = -?"h<V> = 2? при R = Re. Качественно поведение этих функций в зависимости от R можно понять из Рис. 11.1.1'. Таким образом, при образовании химической связи действи- действительно происходит увеличение средней кинетической энергии элект- электронов, однако одновременно понижается и средняя потенциальная энергия, причем это понижение превышает рост кинетической энер- энергии на величину E(R). Ничего большего на основе теоремы вириала не достигается: нельзя сказать, как ведет себя средняя энергия меж- межэлектронного отталкивания, как меняется вклад в энергию от тех или иных областей пространства и т.п. В отдельных приближениях, типа приближений Хартри-Фока с аппроксимацией обменного потен- Е а. е. О 1 4 5 R а. е. Рис. 11.1.1. Зависимость электрон- электронной энергии ?, а также средних значений кинетической Т и потен- потенциальной V энергии от межядерно- го расстояния R для двухатомной молекулы. циала, теорема вириала может быть сформулирована и для средних орбитальных величин. Все же остальные результаты о влиянии и соотношении тех или иных вкладов в энергию образования химической связи в двухатомных молекулах, как правило, можно получить лишь при численных расчетах. е. Общий итог. Рассмотрение, представленное выше, по- позволяет сформулировать лишь некоторые, весьма общие заключения 1 Для получения количественных соотношений следует помнить,что для многих состояний двухатомных молекул хорошей аппроксимацией потенциальной кривой является функция Морзе: E(R) = Z)(l-exp[-C(# -i?e)]) -Д где D и р - некоторые постоянные, связанные с глубиной потенциальной ямы и второй производной в точке минимума (силовой постоянной). 473
о химической связи. Без сомнений, первоосновой является электро- электростатическое взаимодействие микрочастиц, однако не при клас- классическом, а при квантовом распределении зарядов в пространстве, определяемом в конечном итоге той волновой функцией квантового состояния, которая удовлетворяет уравнению Шредингера. О харак- характере образующейся химической связи можно судить по изменению электронного распределения относительно такового у невзаимодей- невзаимодействующих подсистем. Часто, однако, такой информации бывает недос- недостаточно, поскольку распределение электронной плотности отражает влияние межэлектронного отталкивания, т.е. электронной корреляции, лишь косвенно. А эта корреляция в большинстве случаев оказывается существенной. На языке орбитальных представлений корреляция оз- означает необходимость введения (натуральных) орбиталей с дробными числами заполнения, причем для той подсистемы спин-орбиталей, где числа заполнения равны 1, с высокой точностью приемлемо од- ноэлектронное приближение, тогда как для остальных спин-орбита- спин-орбиталей учет корреляции является весьма важным. Особенно сложное положение возникает при анализе проблемы химической связи в возбужденных состояниях, где помимо элек- электронной корреляции существенную роль играют, например, ридберго- вы молекулярные орбитали, весьма похожие на ридберговы орбитали атомов, но уже с молекулярным остовом с асимметричным распреде- распределением заряда. В возбужденных состояниях чаще, чем в основном, встречается ситуация, когда в различных областях пространства электронная конфигурация системы различна, так что при возбужде- возбуждении колебательных состояний молекула с заметной вероятностью оказывается в каждой из этих областей или хотя бы в нескольких из них. И наконец, следует вспомнить об областях псевдопересечений потенциальных поверхностей различных состояний, в которых само представление об электронном состоянии как таковом теряет смысл. По этим причинам пытаться дать сколько-нибудь едино- единообразное толкование природы химической связи, кроме как на базе уже упомянутых самых общих представлений, вряд ли целесообразно. В то же время для классификационных целей могут быть использо- использованы весьма различные признаки, в частности основанные на анализе происхождения связей. Тем не менее, при этом следует помнить, что представляют собой эти признаки . Так, если считать, что молекула Н2 образуется из двух нейтральных атомов, то можно говорить о ковалентной связи между атомами. Однако, если эта молекула 474 образуется при взаимодействии Н + Н+, то придется, по-видимому, говорить о донорно-акцепторной связи, хотя по характеру распреде- распределения электронной плотности возникающее (возбужденное) состо- состояние ничем существенно не будет отличаться от распределения плотности, присущего ковалентной связи. § 2. Межмолекулярные взаимодействия и химическая связь в конденсированных системах Межмолекулярные взаимодействия по своей энергии, как правило, заметно слабее тех, что принято называть химической свя- связью: обычно это величины от десятых до десятка кДж/моль, тогда как к собственно химическим связям относят величины порядка десятков и сотен кДж/моль. Тем не менее, по своей природе это такие же взаимодействия микрочастиц, что и традиционные химические связи. В силу того, что при взаимодействии двух молекул в этих случаях не возникает отчетливо локальных взаимодействий, например относящихся всего лишь к одной паре атомов в молекулах, многие межмолекулярные взаимодействия классифицируют как неспецифические1. Наиболее сильно влияние межмолекулярных взаимодействий проявляется в конденсированных фазах. а. Составляющие межмолекулярных взаимодействий. Рассмотрим сначала общую задачу о взаимодействии двух молекул А и В, находящихся первоначально в квантовых состояниях с волно- волновыми функциями *РА0 и Ч*т соответственно. Пусть теперь учиты- учитывается их взаимодействие в предположении, что оно настолько мало, что допустимо использование теории возмущений. Гамильтониан всей системы из двух молекул можно записать в виде Н = НА + Нв + W , где W - возмущение, вносимое взаимодействием молекул, которое при необходимости может быть детализировано: в нем могут быть выделены взаимодействия электронов разных подсистем, электронов одной подсистемы с ядрами другой и т.п. 1 Термин вряд ли удачен, поскольку для такого рода взаимодействий характерна не общность, не неспецифичность, а именно отсутствие отчетливо локализован- локализованных взаимодействий. У ковалентной связи те же составляющие, что и у межмолекулярного взаимодействия, но из-за различия в межатомных расстояниях соотношение отдельных вкладов иное. 475
Если бы W = 0, то частное решение задачи с гамильтонианом Но = НА + Нв можно было бы искать в виде произведения функций подсистем, например Wo = Ч^о^во * При наличии возмущения вво- вводится оператор Н(К) = Нд+ XW , возмущенные функции и собствен- собственные значения (энергии) записываются в виде рядов по степеням X, полученные выражения подставляются в уравнение Шредингера и коэффициенты перед одинаковыми степенями X справа и слева в этих уравнениях приравниваются нулю, что дает (см.п. а § 2 гл. III): (#0-Яо)^ О, A1.2.1) (Я0-?0)Ч>B>=/ для нулевого, первого и второго порядков соответственно. Решени- Решением первого уравнения является уже выписанная функция Wo с соб- собственным значением ?"А0 + ?"во > те- это решение для двух невзаимо- невзаимодействующих молекул. Второе уравнение при умножении слева на и интегрировании по переменным всех частиц дает =< WA0WB0|W|WA0WB0 > (Н.2.2) так что в первом порядке теории возмущений энергия взаимодей- взаимодействия определяется с волновыми функциями неизменных молекул А и В. Это так называемое прямое электростатическое взаимодействие молекул. Оператор W включает все электростатические взаимо- взаимодействия частиц одной подсистемы с частицами другой подсисте- подсистемы. При больших расстояниях между подсистемами (т.е. между их центрами масс) можно ввести для этих операторов так называемые мультипольные разложения. Пусть, например, R^ - вектор,направ- ленный от электрона i молекулы А к ядру |3 молекулы В и R - вектор от центра масс А к центру масс В. Тогда R,-p = R - г, + R«, где г,- - радиус-вектор электрона / в системе центра масс A, a Rp - радиус- вектор ядра р в системе центра масс В, так что rh R$ « R. Для оператора кулоновского взаимодействия этих частиц может быть за- записан следующий ряд: Z R = -Z \ R R ri ~ A1.2.3) а при суммировании аналогичных выражений по индексам всех 476 частиц - ряд по мультипольным взаимодействиям (п - единичный вектор в направлении R): W = , ZAdBR-ZBdAR ш dAdB - 3(dAnXdBn) + г + ;; г. • • ¦ V11 '*" 4) R R* RJ Первый член этого ряда содержит суммарные заряды ZA и ZB моле- молекул А и В и отличен от нуля, если обе молекулы заряжены. Для ней- нейтральных молекул он равен нулю. Второй отвечает взаимодействию дипольного момента одной молекулы, например dA, с зарядом дру- другой, третий - взаимодействию дипольных моментов dA и dB молекул, следующий за ними член отвечает взаимодействию так называемо- называемого квадрупольного момента одной молекулы с зарядом другой и т.д. Во втором порядке теории возмущений для энергии получа- получается формула, аналогичная B), но уже содержащая VW вместо одной из функций Ч?о: ?B) =<Ч'А()Ч'во1^1ч'A) >• Функция первого по- порядка Ч^1) ортогональна функции нулевого приближения Ч*о и может быть записана в виде суммы трех членов: A1.2.5) где 4$) =< WA0|^A) >А, Ч^ =<WB0|^A) >в, а функция 4*^ ортогональна и WA0, и WB0 при интегрировании по соответствующей группе переменных. С учетом E) для величины выписано следующее выражение: может быть =< >, A1.2.6) каждое слагаемое которого содержит то или иное изменение волно- волновой функции под влиянием возмущения. Поэтому ЕУ^ носит название поляризационной поправки. Первые два слагаемые отвечают такой системе, в которой волновая функция одной молекулы не меняется, а функция другой меняется под влиянием первой. Другими словами, одна из молекул индуцирует в другой смещение зарядов, оставаясь сама при этом неизменной. По этой причине первые два слагаемые называются индукционной энергией межмолекулярного взаимо- взаимодействия. Оставшееся третье слагаемое при более подробной запи- записи напоминает дисперсионную формулу в оптике, а потому и было названо дисперсионной энергией взаимодействия. Оно соответствует 477
взаимодействию наведенных моментов молекул при их взаимном влиянии. Для молекул в основных состояниях энергия дисперсионно- дисперсионного взаимодействия отрицательна, т.е. оно приводит к притяжению молекул. Можно показать, что ведущий член в этой энергии спадает с расстоянием как R~^ . Помимо указанных составляющих межмолекулярного взаи- взаимодействия существует и ряд других, которые мы по существу только лишь упомянем. Не говоря уже о более высоких порядках теории возмущений, можно напомнить, что волновые функции системы в целом должны быть антисимметричны относительно перестановок индексов электронов (перестановки тождественных ядер практически не сказываются). При больших/? вклад в энергию, обязанный своим появлением антисимметризации функций вида WA0WB0, достаточно мал, однако по мере уменьшения R он быстро возрастает. Так, при взаимодействии двух молекул этилена этот вклад составляет -0,04 от электростатического при R = 10 а.е., а при R = 5 а.е. он уже дости- достигает относительной величины ~4. Поскольку антисимметризация волновой функции связана с обменом индексов электронов, то этот вклад в энергию межмолекулярного взаимодействия носит название обменного. Далее, если взаимодействуют две одинаковые молекулы, при- причем одна из них находится в основном D%), а другая - в возбуж- возбужденном (WB/7) состоянии, то в нулевом приближении наряду с функцией WA0WBw той же самой энергии будет отвечать и ^Ап^во •> так что появляется двукратное вырождение для каждого из таких состояний. Следовательно, должна быть использована теория возмущений для вырожденного случая и, например, вместо B) необходимо уже будет использовать выражение = \ < Входящие в него интегралы вида получили название резонансных, а связанный с ними вклад в элект- электростатическую энергию - резонансной энергии взаимодействия. При переходе к более тонким приближениям необходим учет в возмущении W и тех членов, которые связаны с наличием спина и магнитных моментов у заряженных частиц. В общем, разнообразие отдельных составляющих при рассмотрении межмолекулярных вза- взаимодействий оказывается весьма и весьма богатым. 478 В целом межмолекулярные взаимодействия меняют как энер- энергию системы, так и волновые функции подсистем, ее образующих. Проявления их по этой причине оказываются весьма разнообразны- разнообразными. Они приводят к сдвигу линий и полос в спектрах молекул, меняют термодинамические свойства, приводя к отклонениям от идеаль- идеальности, они же обусловливают и конденсацию, и существование кон- конденсированных фаз как таковых. Правда при этом часто взаимодей- взаимодействие подсистем при их сближении оказывается настолько большим, что приводит к химической связи и к образованию новых структур, но это уже отдельный вопрос. Под влиянием межмолекулярных взаи- взаимодействий в конденсированных фазах образуются димеры, тримеры и более тяжелые олигомеры, к тому же эти образования имеют не один, а несколько изомеров (что характерно для структуры многих жидкостей). Межмолекулярные взаимодействия определяют адсорб- адсорбцию на поверхности и взаимодействие макротел. б. Водородная связь. Водородная связь - взаимодействие одного молекулярного фрагмента АН и атома В другого фрагмента с образованием системы А-Н-В , в которой атом водорода играет роль мостика, соединяющего А и В . Эти фрагменты могут принадлежать как разным, так и одной и той же молекуле. В качестве А и В выступают обычно так называемые электроотрицательные атомы, т.е. те, которые обладают достаточно большим сродством к электрону, так что в молекулах около них сосредотачивается избыточный электрический отрицательный заряд: О, N, F, в меньшей степени S, Р, С1 и т.п. Межъядерное расстояние Н-В обычно остается несколько большим, чем А-Н даже при одинаковых атомах А и В, хотя в таком соединении, как (F-H-F)" наблюдается полная выровненность этих расстояний. Как правило, в молекулах типа RAH, склонных к образованию водородной связи, атом Н заряжен положительно, точнее говоря, элек- электронная плотность вблизи протона понижена по сравнению с нейт- нейтральным атомом водорода, что приводит к такой ориентации фраг- фрагмента В, при которой к протону подходит область с максимальной электронной плотностью, например область локализации неподелен- ной электронной пары. Поэтому в образовании водородной связи важ- важную роль играет электростатическое взаимодействие соответству- соответствующих молекулярных фрагментов. Если же полностью использовать тот язык, что был представлен в предыдущем пункте, то можно сказать, что в образование водородной связи должны привносить 479
значительные вклады обменное и поляризационное взаимодействие, хотя, конечно, такое подразделение вкладов при столь малых рас- расстояниях не всегда может быть четко проведено. Энергия образования системы с водородной связью из разъе- разъединенных подсистем меняется в широких пределах: от -5 кДж/моль до -150 кДж/моль. К числу наиболее прочных соединений относятся ионные образования типа (Н2О-Н-ОН2)+, где существенную роль играют прежде всего электростатические взаимодействия. В катионе Н5О2+ протон равноудален от обоих ядер атомов кислорода в равновесном положении. На потенциальных поверхностях подобных соединений часто имеются две более или менее эквивалентные ямы, когда протон находится ближе к А или ближе к В, разделенные относительно невысоким барьером, через который протон может туннелировать. Особенно велика роль этого процесса в циклических димерах, где каждая молекула образует две водородные связи К В катионах (Н2О)ЛН+ также имеются два эквивалентых положения протона. И хотя соединения со связью типа водородной образуются и другими атомами, например Li, тем не менее вся совокупность факторов, ведущих к возникновению водородной связи, наиболее благоприятна именно в случае протона. Водородной связи обязаны своим существованием множество различных ассоциатов с открытыми и замкнутыми в циклы цепями, например, уже упомянутые циклические димеры карбоновых кислот R-СГ ОН ¦ ¦ ¦ ( либо ассоциаты с сетчатой структурой, например типа структуры льда. Как хорошо известно, ассоциация молекул приводит к повыше- повышению температур плавления и кипения и к изменению многих других характеристик. Так, в инфракрасных (колебательных) спектрах при образовании водородной связи вместо узкой полосы, отвечающей возбуждению валентного колебания А-Н, появляется сравнительно широкая (размытая) полоса с увеличенной интегральной интенсив- интенсивностью и с максимумом, сдвинутым в сторону низких частот отно- относительно частоты валентного колебания А-Н. 1 В димерах карбоновых кислот такой туннельный переход совершается за вре- времена порядка 10~5 с, приводя к протонному обмену между двумя молекулами цикла. 480 в. Конденсированные фазы. Любая конденсированная фаза представляет собой некое единое образование, которое, однако, в за- зависимости от составляющих ее молекул или атомов можно моделиро- моделировать различными способами, позволяющими выделить и наиболее правильно отобразить те или иные свойства этой фазы. Так, если рас- рассматриваются рентгеноэлектронные спектры, связанные с возбужде- возбуждением электронов внутренних оболочек, то оказывается приемлемой локальная модель, в которой для каждого исследуемого центра нужно учитывать лишь его достаточно близкое окружение (как правило, ближайшее). С другой стороны, при рассмотрении проводимости образца требуется модель, учитывающая влияние всего множества атомов или молекул, образующих конденсированную систему. Поэтому для конденсированных фаз вряд ли целесообразно говорить о каком- либо отдельном типе химической связи в них, а лучше говорить о влиянии образования того или иного, уже упомянутого выше типа связи на их свойства. Так, для кристаллов, называемых молекулярными и образуемых многими органическими соединениями, можно ввести модель отдельных, упорядочение расположенных молекул, связанных между собой сравнительно слабым межмолекулярным взаимодей- взаимодействием. Под влиянием этого взаимодействия каждая из молекул меняется (например, молекулы нафталина уже не имеют в кристалле симметрию точечной группы D^), и более того, молекулы, занимающие в решетке неэквивалентные позиции, меняются различно. Тем не менее, в качестве фрагментов молекулярных кристаллов отчетливо просмат- просматриваются отдельные молекулы либо некоторые их ассоциаты. Для других систем, в частности, для хорошо известного примера конденсированной фазы (кристалла или расплава) NaCl, инди- индивидуальность молекул газовой фазы совершенно теряется и возникает полностью или частично упорядоченная система, которую можно аппроксимировать моделью ионной решетки (или ионного расплава). Без сомнений, ионы в такой системе отличаются от существующих в газовой фазе, будь то отдельные атомные ионы или некоторые их объединения типа двухатомных молекул. Тем не менее, как модель определенного уровня точности такое рассмотрение вполне допустимо. На ранних этапах квантовомеханического рассмотрения задач об описании кристаллов основное внимание уделялось тем харак- характерным чертам, которые обусловлены именно периодической струк- структурой и большим числом упорядоченных частиц. Эти черты прежде всего сводятся к тому, что орбитальные энергии (либо полные энер- 481
гии - в зависимости от выбранного приближения) отдельных атомов или молекул кристалла в отсутствие взаимодействия между этими частицами оказываются вырожденными, при учете же взаимодей- взаимодействия вырождение снимается и вместо одного уровня появляется, вообще говоря, N уровней, гдеЛ^- число взаимодействующих экви- эквивалентных подсистем. В кристалле N весьма велико, а расстояние между самыми низшими и верхним уровнями в этой структуре конечно и составляет обычно величину, не превышающую нескольких электрон-вольт. По этой причине расщепившиеся уровни образуют некоторую квазинепрерывную зону, т.е. зону уровней почти сплошного спектра. Такая картина возникает для любого исходного энергети- энергетического уровня того структурного звена, из которого образуется кри- кристалл. Каждый уровень порождает зону, эти зоны могут быть уже или шире в зависимости от величины взаимодействия, к тому же отдельные зоны могут частично или полностью накрывать друг друга. Именно эта особенность - образование зон - и характерна для упо- упорядоченных фаз (кристаллов), тогда как специфика взаимодействий определяет ширину каждой зоны и их взаимное расположение. В отличие от кристалла в жидкости и в аморфном твердом теле дальний порядок в расположении молекул отсутствует. Тем не менее наличие ближнего порядка и статистическое распределение различных конфигураций ядер с ближним порядком приводят к похожему уширению уровней и образованию зон, хотя структура их выражена гораздо менее определенно, чем в случае упорядоченных систем. Следует отметить, что в реальных кристаллах наличие различного рода дефектов решетки и примесей также может оказывать значительное влияние на идеальную зонную структуру. Отметим, что в учебной литературе долгое время говорили, да и говорят по настоящее время о наличии особого типа химической связи, названного металлической связью, в качестве характерной чер- черты которой выделяли образование своего рода электронного газа в поле ионных остовов образующих металл атомов. Однако, образо- образование зон и участков почти сплошного энергетического спектра у подсистем электронов в кристаллах характерно и для диэлектриков, и для полупроводников. Отличительной чертой металлов является лишь частичное заполнение верхней зоны, так называемой зоны проводимости, приводящее к тому, что даже слабое воздействие на систему внешнего электрического поля вызывает заметное перерас- перераспределение электронной плотности, ее смещение под влиянием поля 482 (как то всегда имеет место в задачах с вырождением или почти вы- вырождением). г. Молекулярные модели в теории твердого тела. Как уже говорилось, при описании различных свойств вводятся и разные модели, позволяющие наиболее корректно описать данное свойство или группу свойств. И если ранее основное внимание уделялось, напри- например, анализу общей структуры зон того или иного твердого тела, то в последнее время все большее внимание стало уделяться молеку- молекулярным моделям, позволяющим выделить отдельный фрагмент твер- твердотельной структуры и дать его описание, которое в существенной степени акцентирует внимание на локальных особенностях и свойствах фрагментов, в том числе на специфике химических связей в таких фрагментах и, в свою очередь, на специфике их влияния на свойства периодической структуры в целом. Молекулярные модели наиболее важны при рассмотрении процессов на поверхности кристаллов, а также свойств твердых тел, обусловленных наличием выделенных локальных центров, например примесных. Ниже мы совсем коротко остановимся именно на таких моделях. В модели молекулярного кластера выделяется фрагмент кри- кристалла и его рассматривают либо как изолированную молекулу, либо на тех местах, где находились атомы, с которыми данный фрагмент был соединен химическими связями, вводятся некоторые эффек- эффективные атомы, что позволяет учесть ближайшее окружение гранич- граничных атомов кластера. Выбор размера и формы молекулярного клас- кластера - достаточно сложная задача с неоднозначным ответом. Для такого кластера пропадает трансляционная симметрия, т.е. главная отличительная особенность кристалла как такового. Вместо указанных выше граничных условий для молекуляр- молекулярного кластера в модели квазимолекулярной расширенной элементар- элементарной ячейки (КРЭЯ) вводят циклические граничные условия, что при- приводит к появлению периодичности и позволяет учесть ряд особенно- особенностей квантовых состояний системы, связанных с пространственной симметрией кристалла. Эти циклические граничные условия могут, так сказать, замыкать выделенный молекулярный кластер на себя, когда условиями цикличности оказываются связаны только атомы кластера. В этом случае получается модель "периодического клас- кластера". Собственно же в модели КРЭЯ вводится сначала "основная область" кристалла, состоящая из достаточно большого числа (N) повторяющихся молекулярных кластеров, далее для нее вводятся 483
циклические граничные условия (как в зонной теории), после чего учитывается симметрия образованной таким образом системы, и каждое из квантовых состояний модели КРЭЯ получается как состоя- состояние с волновой функцией, преобразующейся по одному из неприводи- неприводимых представлений группы CN (или более сложных, если циклические условия введены для всех трех пространственных направлений). Во всех этих моделях не возникает какого-либо особого воп- вопроса о химических связях, поскольку они оперируют с теми же пред- представлениями, что и в обычных молекулярных подходах. д. Итог. Модели твердого тела оказали заметное влияние на развитие квантовой химии, особенно квантовой химии протяженных систем (одномерных цепочек, двумерных полимерных сеток и т.п.). Многие идеи, возникшие в рамках этих моделей, оказались весьма полезными и для молекулярных задач, в частности, идеи, связанные с миграцией возбуждения, с образованием долгоживущих возбужден- возбужденных состояний и т.п. Исследования жидких систем активно стимули- стимулировали квантовохимические расчеты различных ассоциатов, диме- ров, эксимеров и аналогичных образований. Выяснение того, до каких пределов образец вещества может еще считаться металлом, привело к многочисленным расчетам кластеров, образованных атомами металлов, при различных их геометрических конфигурациях и различном числе атомов, входящих в них. Такое перечисление можно продолжать, однако при этом стоит не забывать о том, что во всех подходах, базирующихся на атомных и молекулярных представлениях, всегда явно или неявно использу- используются понятия атома в молекуле, атома в узле кристаллической решетки, того или иного выделенного фрагмента в молекуле и т.п. В то же время пока сами по себе эти понятия определены у нас не были и предполагалось лишь, что они интуитивно понятны, а потому в особых определениях не нуждаются и могут использоваться не- непосредственно. То, что такие определения, однако, и дать непросто, будет показано в следующем параграфе. § 3. Атомы в молекулах Первоначальные попытки выделения атомов в молекулах были связаны с выбором базисных функций, центрированных на атомах. Вообще говоря, такие функции должны были бы вести себя правильно вблизи соответствующего ядра (соблюдая условия каспа), 484 обращаться в нуль вблизи остальных ядер и в целом, в своей сово- совокупности, давать асимптотически правильное поведение по мере удаления электрона от всего остального остова. Как уже говорилось при обсуждении различных систем базисных функций, ни одна из широко используемых систем этим требованиям не удовлетворяет (кроме функций, получаемых прямыми численными расчетами). Тем не менее, негласно принималось, в частности на основе опыта конкретных расчетов, что функциями таких базисов пользоваться все же можно, в том числе и при получении результатов высокого уровня точности, если взять побольше базисных функций на каждом центре. а. Выделение атомов на основе атомных орбиталей. Рассмотрим сначала электронную волновую функцию молекулы в одноконфигурационном приближении Хартри-Фока с молекулярными орбиталями фр представленными в виде линейной комбинации базисных атомных орбиталей хау центрированных только на ядрах: v, A1.3.1) a,v где a - индекс ядра, v нумерует функции на ядре а. Очевидно, что функцию v A1.3.2) ict "" можно трактовать как вклад в орбиталь qp, от атома а. Для элект- электронной плотности будет справедливо выражение A1.3.3) Здесь « — число заполнения i-й орбитали. Ради простоты будем далее считать функции Xav и коэффициенты ciav вещественными. Функцию A1.3.4) Pa = v,V где a,w' A1.3.5) также можно трактовать как вклад в электронную плотность от ато- атома а. Если бы функции xav были локализованы в сферах, окружаю- окружающих ядра, причем эти сферы для разных ядер не перекрывались бы, то ра точно представляла бы такой вклад. Однако, функции xav опре- определены во всем пространстве и почти всюду они отличны от нуля. 485
Это означает, что перекрестные члены в C), относящиеся к разным атомам, также дают ненулевой вклад в энергию, т.е. даже электрон- электронная плотность не может быть представлена как некоторая сумма вкладов от отдельных атомов. По-видимому можно попытаться из- избавиться от перекрестных членов, проведя некоторые границы между центрами и отнеся то, что дает перекрестный член по одну сторону от границы, к одному атому, а то, что по другую - к другому. При этом атомная плотность становится зависящей от функций, центри- центрированных на других ядрах, а к тому же возникает и определяющий вопрос, как, на основе каких принципов проводить эту границу. Далее, если ввести такую границу, то опять возникает вопрос, что делать с той частью атомной плотности, которая по атомным орбиталям отно- относится к данному атому, а в то же время находится за проведенной границей этого атома? Однозначного ответа на него также получить невозможно. Величины типа E), как уже говорилось ранее, будучи умноженными на заряд электрона, получили название зарядов на ато- атомах (по Малликену). Они действительно соответствовали бы тако- таковым, если бы не перекрывание атомных орбиталей разных центров. Если такое перекрывание мало, то их можно считать равными заря- зарядам на атомах приближенно. К сожалению, малости перекрывания почти никогда не достигается, и с малликеновскими зарядами на ато- атомах приходится оперировать весьма осторожно (подчас даже оце- оценить с ними дипольный момент молекулы оказывается невозмож- невозможным). Сама по себе тенденция введения локализованных орбиталей в качестве одной из своих целей имела то же самое стремление построить из исходных функций такие, которые давали бы мини- минимальное перекрывание при сохранении их локализованное™, а потому могли бы приводить, например, к базису, для которого анализ засе- ленностей по Малликену имел бы достаточно серьезное основание. Было предпринято множество других попыток сохранить по- понятие атома в молекуле, но, тем не менее, практически всегда они не удовлетворяли последующих исследователей по тем или иным при- причинам. Так, были попытки построить волновую функцию молекулы из многоэлектронных атомных функций, которые привели к созда- созданию весьма разумного по своей конструкции и полезного для расче- расчетов малых молекул полуэмпирического метода двухатомных фраг- фрагментов в молекулах (и ряда его вариантов). Были попытки постули- постулировать (естественно, при некотором обосновании) сохранение не толь- только плотности, относящейся к атому, но и перекрестной плотности, 486 относящейся к двум соседним атомам и т.п. Как правило, все эти подходы развивались в рамках приближения самосогласованного поля с использованием базисов из достаточно хорошо локализованных атомных орбиталей. Кроме того, коль скоро и атом, и молекула - физические объекты в обычном трехмерном пространстве, то и разбиение молекулы на атомы всегда стремились проводить в том же пространстве, несмотря на то, что при использовании представ-ления волновых функций или их некоторых сверток приходится иметь дело с функциями, заданными в пространстве большего числа измерений: даже матрица плотности первого порядка зависит от шести пространственных переменных. б. Подход Бейдера. Одна из наиболее удачных попыток со- сохранения классической концепции атома в молекуле принадлежит Р. Бейдеру и его сотрудникам, исходившим из анализа распределения электронной плотности в молекуле. Электронная плотность р(х9у9 z) задает некоторое скалярное поле в трехмерном пространстве, которое может быть охарактеризовано, например, его совокупностью экст- экстремальных точек, линий и поверхностей, особых точек и т.п. Так, максимальные значения электронной плотности достигаются в точках, где находятся ядра, причем эти точки являются фактически для р(г) точками заострения (из-за поведения s-функций). Чтобы четче понять топологию функции р(г), можно воспользоваться векторным полем, связанным с функцией р, а именно полем градиента Vp(r) в gradp(r), выявляющим прежде всего экстремальные свойства исходной функции р(г). Рассмотрим семейство интегральных кривых дифференциаль- дифференциального уравнения dr / — = Vo(x v z) (ПЗ 6) ds где s - параметр, определяющий кривую г = r(s). Если бы функция р была функцией двух переменных, например х и у, то мы имели бы два уравнения: dx dp dy dp ds dx ds dy которые после деления левых и правых частей второго из них на соответствующие части первого дали бы dy др/ду Ру(х,у) — — ^ (ll.J.f) dx dp/dx рх(х,у) 487
Во всех точках пространства, где рх и ру отличны от нуля, имеются регулярные решения дифференциального уравнения G) и через каж- каждую точку (xq , у о) проходит лишь одна интегральная кривая этого уравнения у = у(х ; >>о, xq). Точки же, где и числитель, и знаменатель в правой части G) одновременно обращаются в нуль, носят название особых точек, причем в зависимости от поведения рх и ру при стрем- стремлении (х, у) к особой точке (xq, у0) можно ввести дополнительную информацию о характере интегральных кривых. Не останавливаясь на этих вопросах подробнее, отметим, что Ъ 7~ У X х + у ,то р'у = -а — р, рх = -а — р, dy у так что — = — и у = сх • dx х Все интегральные кривые проходят при этом через начало координат, где находится ядро. Для трехмерной задачи F) будет по- получаться то же самое: интегральные кривые уравнения F) сходятся в тех точках, где расположены ядра. Если у электронной плотности имеется в некоторой точке максимум или минимум, то интегральные кривые будут вести себя похоже: эти точки будут узлами, в которые сходятся интегральные кривые. Для седловой точки поведение будет несколько иным: интегральные кривые будут огибать ее как семейство гипербол, например типа>> = сх~т (т > 0), причем будут получаться 4 области, заполняемые этими кривыми и разделенные, по крайней мере вблизи седла, плоскостями (если седло находится в начале системы коор- координат) др/ду = ах + Ьу+ Р(х,у) и др/дх = cx + dy + Q(x,у) , где .Р и g содержат члены более высоких степеней по х и у , чем линейные, а потому вблизи седла могут рассматриваться как члены более высоко- высокого порядка малости. Точка пересечения этих плоскостей, либо в более протяженной области - поверхностей, и будет исходной особой точкой, т.е. седлом. Р. Бейдер из анализа карт распределения электронной плот- плотности сделал вывод, что точкам расположения ядер отвечают рас- рассмотренные выше точки заострения (каспы) функции р, а в остальном эта функция ведет себя так, что либо появляются седловые точки где-то в областях между ядрами, либо, если по некоторому пути и достигается равенство dp/dt = 0, где *- координата, ортогональная s, то при этом остается dp/ds * 0 , что не нарушает общей картины расположения интегральных кривых. Поверхности S, разделяющие 488 области с регулярной картиной интегральных кривых, могут быть получены как решения уравнения A1.3.8) относительно компонент единичного вектора п, ортогонального та- такой поверхности. Так, для молекулы BN распределение электронной плотности в основном электронном состоянии, интегральные кривые, векторы градиента и поверхность S показаны на рис. 11.3.1 для сечения трехмерного пространства, отвечающего, например, равенст- равенству у = 0: ось z является межъядерной осью, распределение р осесим- метрично, а потому переход от такого сечения к трехмерной картине получается при вращении изображенных на этом рисунке кривых вокруг оси z. Поверхности 5,, разделяющие области Ка, в которых нахо- находятся максимум по одному ядру, и определенные соотношениями (8), были выбраны в качестве границ атомов. Многочисленные расчеты, выполненные Р. Бейдером и его сотрудниками, показали, что ядра всегда служат узлами интегральных кривых, а каждая регулярная область, в которой расположены кривые, сходящиеся к Рис. 11.3.1. Распределение электронной плотности в основном состоянии молекулы BN (в сечении плоскостью, проходящей через межъядерную ось), интегральные кривые уравнения F), векторы фадиента (стрелки) и поверхность 5, разделяющая области атомов N и В. 16 - 1395 489
одному ядру, охватывает это ядро и в существенной степени сохраняет свою форму при переходе от одной молекулы к другой, как впрочем сохраняется и суммарный заряд, приходящийся на эту область. Так, при переходе от молекулы LiH к молекуле LiF (обе - в основных состояниях) электронный заряд, приходящийся на область KLi атома Li, меняется от -2,09 до -2,06 а. е. (т. е. единиц абсолютной величины заряда электрона); следовательно, и в том и в другом слу- случае эта область отвечает почти "чистому" катиону Li с зарядом 0,91 и 0,94 а. е. соответственно. Правда, такая сохраняемость для других атомов может быть выражена менее четко, однако при этом возника- возникает естественный вопрос, как проводить сравнение: сравнивать ли основные состояния, или состояния с одной и той же доминирующей конфигурацией, или на основе какого-либо еще признака. Так, заряды на атоме В (волновые функции приближения Хартри-Фока) монотонно меняются в ряду молекул ВВе, В2, ВС, BN, ВО от 5,43 до 3,93 а. е., однако при этом постоянно меняется и электронная конфигурация; в то же время и при сохранении электронной конфигурации эти заряды в ряде случаев также меняются довольно заметно, например 3,43 и 3,93 а. е. для BF+ и ВО соответственно. Характерной особенностью выделения атомов с помощью границ 52- (поток плотности через которые равен нулю, в соответствии с их определением) является то, что для каждой из областей Va в отдельности выполняется теорема вириала, утверждающая, что для равновесной конфигурации 2<Т>а~ -<V>a, где символ а означает, что интегрирование ведется по области Va атома а. Расчеты показали к тому же хорошую переносимость величин <Т>а, а следовательно и средней энергии, приходящейся на атом о.:Еа= <Т>а + <V>a=—<Т>а. При доказательстве выполнения теоремы вириала исполь-зуется тот факт, что поток плотности через границу равен нулю, т.е. выполняется соотношение (8). Тем не менее, по сравнению со всей молекулой в целом здесь есть и вполне определенная специфика, поскольку каждой такой "автовириальный" атом в молекуле находится в поле всех других атомов, включающих как ядра, так и электроны, что приводит к появлению в средних величинах обязательно потенциала взаимо- взаимодействия с остальными областями. Например, для взаимодействия электронов с ядрами можно написать следующее выражение: en a r-R a dv = - J a r-R a r- a r-R a 490 L В каждом из интегралов справа р(г) может быть заменена на pa(r), т.е. на функцию, относящуюся лишь к области Va. Здесь первая сумма относится к взаимодействию электронов атома а с его ядром, тогда как вторая представляет взаимодействие этих же электронов со всеми остальными ядрами. Для межэлектронного взаимодействия можно получить аналогичные выражения, хотя там уже появляются интег- интегралы с двухчастичной электронной плотностью Г(г1? г2) (см. § 5 гл. VI), которую также можно разбить на сумму вкладов от пар областей V и VQ. в. Подход Татевского1. Изложенный выше подход базируется на идее об отсутствии потока электронной плотности через некоторые границы, окружающие атомы в молекулах. Очевидно, что выбор в качестве исходного объекта рассмотрения электронной плотности не является определяющим: могут быть выбраны и другие физические величины, на базе которых строятся подобные конструкции, лишь бы была достаточно ясна физическая картина лежащей в основе конструкции модели. В качестве такой модели можно рассмотреть, например, сле- следующую. Коль скоро в молекуле имеется некоторое потенциальное поле, то, очевидно, с этим полем можно связать некоторое поле сил, действующих в каждой точке пространства на единичный заряд. В области вблизи какого-либо ядра суммарная сила будет такова, что в ней будет доминировать сила, определяемая этим ядром, тогда как где-то между ядрами будет проходить такая поверхность, для точек которой силы, действующие со стороны зарядов, распределенных в областях по одну и по другую сторону от этой поверхности, равны по величине и противоположны по направлению, т.е. компенсируют друг друга. Таким образом, для определения поверхности Sa, выделяющей область, относимую к тому или иному ядру, появляется уравнение F(r)n = Wn = 0 , A1.3.9) где F(r) - сила, действующая в точке г на единичный заряд, V = V(r) - потенциал в этой точке, а п - единичный вектор, ортогональный граничной поверхности Sa. Это уравнение весьма похоже на (8), но 1 Татевский Владимир Михайлович A914-1999), известный советский физи- кохимик, разрабатывавший основы как классической, так и квантовомеханической теории строения химических соединений, а также решивший ряд фундаментальных и прикладных задач спектроскопии органических соединений, термохимии и термодинамики топлив, в том числе ракетных. 16* 491
имеет даже более ясный физический смысл, чем (8). При переходе к квантовомеханическим выражениям здесь, очевидно, нужно ввести интегралы по распределениям всех частиц (электронов и ядер) молекулы в пространстве, что приводит к выражениям вида п • grad -1- V Zv r-Rv 4 P(r') r-r' (ядро v BVa ) A1.3.10) = n • grad - 7 r -Rn -+J- p( r- '¦) r' ядро \i e v определяющим граничные поверхности S, по одну сторону от которых находится область Ка, по другую - область Vp. Так же как в модели Бейдера, здесь можно утверждать, что вблизи одного ядра сила направлена к этому ядру, вблизи другого ядра - к другому, а где-то между ними должна быть поверхность, на которой возникает компенсация этих сил. В. М. Татевским еще до работ Р. Бейдера была предложена весьма похожая модель, которая исходила не из представления о силах, несколько чуждых по своей идеологии квантовой механике, а из разбиения полной энергии на вклады от областей. Если все про- пространство молекулы можно разбить на области Wa , каждая из которых содержит одно ядро, то полная энергия такой системы может быть представлена как сумма вкладов от областей Wa и сумма вкладов от всех пар областей Wa и Wa: о. Выделение атомов, согласно Татевскому, должно отвечать макси- максимуму абсолютной величины первой суммы, т.е. суммы атомных вкла- вкладов, или, что то же, минимуму абсолютной величины второй суммы. Этот критерий приводит к системе уравнений, определяющих грани- границы областей Wa , похожих на A0), а именно, в каждой точке г граничной поверхности должно быть справедливо соотношение Za Г(г,г') Z, r-R а W "а г-г' r-R p(r) r-r /г'. A1.3.12) 492 Ради простоты соотношение выписано для системы с двумя ядрами аир, попадающими в области Wa и Wa, по обе стороны от границы, их разъединяющей. Это условие определяет не равенство сил, а ра- равенство потенциалов, создаваемых в граничной точке зарядами той и другой области. Если Г(г, г') записать в виде Г(г, г') = Хр(г)р(г') + +Д(г, г') и учесть условия нормировки для матриц плотности! и, в N - 1 частности, условие fT(r,r')rfr' = р(г), то легко убедиться в ** 2 том, что при выборе X ~ (N - l)/2N получим ГД(г, r')dr' = 0 . Предполагая, что Д(г, г') мало, и оставляя для Г(г, г') только лишь член с произведением р(г)р(г'), получим при подстановке такого пред- представления Г(г, г') в A3) соотношение, которое будет весьма близко к A1), если в последнем снять справа и слева символ n-grad . После того, как границы атомов в молекуле найдены, можно сопоставить этим атомам как энергетические характеристики, так и другие величины, имеющие смысл вклада каждого атома в полную величину того или иного свойства молекулы. г. Общий итог. Помимо рассмотренных выше был предло- предложен и ряд других моделей, позволяющих ввести понятие атома в молекуле на основе тех или иных критериев. Множественность этих моделей отчетливо показывает, что выделить некоторую относи- относительно самостоятельную часть из целого можно лишь при определен- определенных допущениях о соотношении этой части и целого и о границах (не обязательно пространственных), определяющих выделяемую часть. При этом сколь естественными эти границы ни казались бы, сколь тесно они не связывались бы с теми или иными физическими кон- концепциями, все же определенная доля субъективного выбора остается. Каждый способ выделения атомов в молекуле есть лишь опреде- определенная теоретическая модель, позволяющая по возможности лучше (либо нагляднее, либо то и другое вместе) описать исследуемую со- совокупность свойств молекулярных систем на языке составляющих, которые относятся к отдельным фрагментам этих систем и, как пра- правило, в той или иной степени сохраняются у этих фрагментов при переходе от одной молекулы к другой, В классической теории химического строения понятие атома в молекуле является изначальным. Здесь интуитивно ясно, что это 1 Матрицы плотности обычно нормируются следующим образом: Jp(r)rfr = N и ffr(r,r')drdr' = N(N-l)/2. 493
такое, как ясно и то, что атом в молекуле меняется, меняются и сопоставляемые с ним свойства в зависимости от окружения этого атома, прежде всего ближайшего. В квантовой теории понятие атома вторично, его приходится вводить, задаваясь какими-то дополнитель- дополнительными моделями. В то же время, после того как модель задана, здесь гораздо лучше просматриваются связи выделенного атома с его окружением, количественные соотношения, определяющие и свойства атома и их зависимость от окружения и т.п. Другими словами, ввести в квантовой теории какой-либо единый взгляд на то, что есть атом в молекуле, нельзя, но если какой-то взгляд введен, то дальше возника- возникают гораздо более богатые, чем в классической теории, перспективы, в том числе и количественные. Послесловие Представленный выше текст дает лишь самые основы той науки, которая сегодня называется квантовой химией (прежде всего молекулярных систем). Многие интересные и важные аспекты при этом остались не затронутыми вовсе. Однако если признать, что современная квантовая химия, несмотря на ее сравнительную молодость, развита не менее, чем основные разделы физической химии, а к тому же во многих направлениях она развивается заметно активнее, то становится понятным, что в объеме настоящего издания представить квантовую химию во всем расцвете ее возможностей было просто нельзя. Тем более, что собственно квантовой химии посвящено лишь около половины книги. Специфика квантовой химии заключается в том, что она ис- использует аппарат столь своеобразной науки, как квантовая механика, к которой нужно привыкнуть, что требует если не усилий, то хотя бы времени. Очень часто, особенно в прикладных направлениях, квантовую химию представляют на достаточно примитивном уровне, не требующем сколько-нибудь серьезного понимания основ квантовой теории, К сожалению, это всего лишь некоторый прием, за который приходится достаточно дорого платить, поскольку люди, в той или иной степени понимающие квантовую химию, научились рассуждать и активно пользоваться ее примитизированным языком только после того, как достаточно глубоко овладели и идеями, и математическим аппаратом квантовой химии. За примерами далеко ходить не надо, тогда как обратные примеры - примеры специалистов, овладевших квантовой химией на примитивном уровне и в то же время понимающих ее возможности и способных с толком использовать ее в своей работе (хотя бы на том же уровне), - найти гораздо сложнее. Тот курс квантовой мехеники и квантовой химии, который дается на химических факультетах университетов, не преследует цель подготовить специалиста по квантовой химии. Его цель, очевидно, совсем в другом: дать понимание основных идей квантовой теории, используемых при рассмотрении химических задач, показать основы применяемого математического аппарата, весьма непростого для химика, и дать представление об основных моделях молекулярных 495 L
систем, используемых современной теоретической химией. Выпускник химического факультета университета, независимо от того, ждет ли его исследовательская или педагогическая работа, должен понимать язык, на котором объясняется химическая наука сегодня, а этот язык в качестве фундаментальной составной части включает язык квантовой теории. Уже сказано, что многие стороны и проблемы квантовой хи- химии в тексте книги не обсуждаются, а подчас и почти не упомянуты. Самая серьезная и важная из этих проблем - проблема элементар- элементарного акта химических реакций. Конечно, некоторые простейшие аспекты этой проблемы были представлены при рассмотрении задач о сохранении орбитальной симметрии. Сегодня, однако, она развита достаточно сильно и в рамках строгих количественных подходов, опирающихся, в частности, на результаты квантовой теории рассея- рассеяния, либо на результаты некоторых гибридных построений, например, расчетов движения по классическим траекториям с использованием потенциальных поверхностей, рассчитанных квантовохимически. К сожалению, используемый при этом аппарат требует несколько более высокого уровня подготовки, чем дает настоящий учебник, а заниматься лишь кратким описанием получаемых результатов вряд ли было бы целесообразно. Конспективно обсуждены и подходы, используемые в кван- квантовой химии при изучении конденсированных систем. В настоящее время появилась даже такая ветвь квантовой химии, как квантовое материаловедение, для демонстрации которой, к сожалению, места опять-таки не было. Полностью отсутствует обсуждение вопросов, важных для понимания истории развития химической мысли, например квантовомеханических аспектов теории резонанса, а также различных электронных теорий, например теории Гиллеспи. Не затронуты многие широко используемые квантовохимические расчетные методы, в частности различные варианты метода связанных электронных пар, а также методы анализа тех составляющих, которые в своей совокупности образуют химическую связь в молекулах (независимо от их размеров), хотя, конечно, богатство идей, здесь существующих, весьма поучительно и было бы полезно любому человеку, начинаю- начинающему погружаться даже в самые поверхностные слои современной теоретической химии. Вся эта красота, все богатство красок теории в существенной степени, однако, теряются при начальном представ- представлении материала, ограниченном жесткими рамками учебного издания. 496 Тем не менее, остается все же надежда, что студент либо любой человек, начинающий изучать квантовую химию по этой книге, почувствует прелесть теоретического знания и постарается, хотя бы отчасти, его понять и расширить. Если же таковое чувство возникнет, то есть вероятность, что возникнет и желание представить себе структуру окружающего нас мира чуть глубже, чем представляем себе ее мы сейчас, а потому и дополнить новыми идеями и новым пониманием. Современная литература по квантовой химии, и книжная, и журнальная, весьма богата (хотя, к сожалению, на русском языке она сегодня представлена во многом уже несколько устаревшими изданиями), что позволяет при определенной настойчивости выйти достаточно быстро на самые живые, быстро развивающиеся пробле- проблемы современной химии, которые сегодня решаются лишь при активном использовании расчетных данных. Достаточно вспомнить, сколь серьезную роль сыграли результаты квантовохимических расчетов при интерпретации экспериментальных данных, в том числе данных физикохимических исследований, в первые же месяцы и годы после открытия фуллеренов, а также сколь активно используются квантовохимические данные при построении и применении корреляци- корреляционных соотношений "структура-активность", например в прикладных задачах фармакологии и молекулярной биологии. Тем не менее, для того, чтобы идти дальше, нужно начать идти. Может быть, такому началу и будет способствовать этот учебник.
Приложение 1 Соотношения атомных и некоторых других единиц Для энергии справедлива следующая цепочка равенств: 1 а.е. = 2625,4999 кДж/моль = 627,5095 ккал/моль = 27,2114 эВ = 219474,63 см-1 = 315773,2 К = 657,968-1013 Гц. Из нее, в частности, следует, что 1 эВ = 0,036749 а.е. = 8065,54 см1 = 11604,45 К; 1 см1 = 1,43877 К = 2,99792-1010 Гц. Для линейных размеров 1 а.е. (бор) = 0,529177-1010 м « 0,0529 нм. Для времени а.е. -2,53556-1017с. Для заряда 1 а.е. = 1,602189-1019Кл = 4,803242'10-1Оед. заряда в системе СГСЭ. Для массы а.е.м. = 9,109534-10-31кг. Для дипольного момента 1 а.е. = 2,542 Д. Постоянная Планка П = 1,0545887-1034 Дж с = 1 а.е. действия. Скорость света в вакууме с = 2,99792458 м с1 = 137,03604 а. е. скорости. Магнетон, Бора \хв = 9,27408 Дж Т1 (Т, тесла - единица плотности магнитного потока в СИ, равная 104 Гс, гаусс, в системе СГС) 498 Приложение 2 Свойства 6-функции 6-Функция относится к так называемым обобщенным функци- функциям и может быть определена как предел последовательностей обычных функций, например л/л при a 00 (П2.1) р, ч ,. a sinax 6(х) = hm при a я ax и т. п. Эта функция может быть представлена и интегралом Фурье 6(х-хо) = —оо й Характерным ее свойством является то, что оо (П2.2) — 00 и, как бы ни выбиралась последовательность A), всегда соотноше- соотношение B) должно быть выполнено. Из этого соотношения либо из рассмотрения пределов A) также следует, что Ь(ах) = — 6(х) приа>0 и 6(-х) = -6(х а 6(х2 - Xq ) = -—[б(х - х0) + 6(х + хоI; 2xL 0 00 J6(a - хN(х - b)dx = b(a - b); — 00 00 //(x) — 00 d_ dx 6(x-x0) dx- - dx — 00 dx Соотношение (З) фактически определяет производную 6-фун- 6-функции. Применение 6-функции согласно этим равенствам позволяет избежать рассмотрения предельных переходов и ведет к удобным способам вычисления многих математических соотношений, встреча- встречающихся в квантовой механике при рассмотрении задач с непре- непрерывным спектром. 499
Приложение 3 Таблицы характеров некоторых точечных групп В правой части таблиц указано, по каким представлениям преобразуются функции х, у, z; х2, у2, z2, xy, xz nyz, а также компоненты Rx, R nRz вектора вращения системы координат вокруг некоторой С оси. 2 2? х2; у2; г2; ху у=;х= x\y;z x ;y ; 22; xy; yz; xz c2v Ах Я Аг Я. В2 I 1 1 I 1 С2 1 1 -I _] Gv(xz) I -1 I — 1 GviyZ) I — 1 — I 1 2 R, x; Ry y;Rx x2;y2;z2 xy xz yz C2* Ag B8 Au B» I 1 I 1 1 C2 I -I I -1 i 1 1 — 1 -I 1 -1 -1 I R, Rx;Ry z x;y x2; y2; z2; xy xz;yz C3v A, A 2 E I 1 1 2 2C3 1 I -1 3ov 1 -1 0 2-y2>xy}\ {xz,yz} C4v o2d = yd Ax A2 *i B2 E I 1 1 1 1 1 2 2C4 2S4 1 1 -1 -1 0 C2 C2 1 1 1 1 -2 2ov 2C2' 1 -1 1 -1 0 2<3d 2od 1 -1 -1 1 0 2 В C4v R, z в D2d {x,y};{R;, Ry} x2 V; S x2-/ xy {xz.yz} 500 Ax Аг Ex E2 I 1 1 2 2 2C5 1 1 a P 2C52 1 1 P a 5av 1 -1 0 0 z Rz {x,y}; V Rx, Ry} x'+y^z2 {xz, yz} {x2-y\xy} Ax A2 E In V5-1 a « 2cos— - —-— 4я л/5 +1 = 4cos-— = - 2 2C 3C 1 1 2 1 1 -1 1 -1 0 ,Ry) x2 + y2; z2 {x2-y2,xy} {xz, Ag Bxg B2g Big Au Bxu B2u Взи I 1 1 1 1 1 1 1 1 C2(z) 1 1 -1 -1 1 1 -1 -1 c2iy) 1 -1 1 -1 1 -1 1 -1 C2(x) \ 1 -1 -1 1 1 -1 -1 1 / 1 1 1 1 ; -i j. -l | -i | -l Oxy 1 1 -1 -1 -1 -1 1 1 Gxz 1 -1 1 -1 -1 1 -1 1 1 -1 -1 1 -1 1 1 -1 Rx Ry Rx 2 У X x2;/;^ xy xz yz Ax' A2' E' Ax" A2" E" Axg A2g Eg s A \u Аги Eu I I 1 1 2 1 1 2 2C3 2C3 1 1 -1 1 1 -1 зс2 I 3C2 | 1 -1 0 1 -1 0 i 1 1 2 i -i 1 -1 1 -2 i i 253 256 1 1 -1 -1 -1 1 3av 3ad 1 -1 0 — 1 1 0 R2 {x, z {* {x, у] в o3h ,Ry) в 03d ,,Ry) в 03h У] в D3t/ x2 + {x2- {x2- {xz, {xz, -y\ -y2, yz] yz] A xy] xy] bD bD в и V зл 501
D4 л, Л А2 Вх В2 Е I 1 1 1 1 1 2 2С4 1 1 -I -1 0 С 2~Г 1 1 1 1 -2 2С2' 1 -1 1 -1 0 2С2" 1 -1 -1 1 0 z; R2 {x,y};{Rx,Ry} * V; z2 jc2V ¦* У fe yz} 0 /*! ^2 E Fx F2 I I 1 1 2 3 3 8C3 8C3 1 1 -1 0 0 3C2 3C2 1 1 2 -1 -1 6S4 6C4 1 -1 0 1 —1 6C2' 1 _j 0 -1 1 {Rx,Ry,Rz}i {x,y,z} вО {x,y,z} sTd «Т^иО; {xv, xz, yz} {xy,xz,yz} 1 Fi F2 G H I 1 3 3 4 5 12C5 1 У 5 -1 0 12C52 1 6 У -1 0 20C3 1 0 0 1 -1 15C2 1 -1 -1 0 1 {x,y,z}; {RX,RV,RZ} * * ''V -К' yy ZJ 2,2, 2 X +)T+Z Vz'-x2-/^2-/, xy,xz,yz} 502 CM on О О CO. CM CM О о CM in CM CO CM in CM CM in о CO CM о со CM in CM CM Q QQ Q QQ D D Й Q QQ 8 5 Q QQ Q QQ Q QQ a? — — CO. 0 I — — CO. i I I I CO. ^^17777 ¦—"i—i OOi—'¦—'OO — — со. — — CD. — — CM CM — гч — (Ч — (Ч . — . D — D — D i — гч — сч ^- 1— 1— 1— О О со гм (Ч (Ч (N a — — — — (N СМ I I I I — — — — СМ СМ — — — — о о — — см гм I I I I _¦ 1— 1— 1— О О — — — — СМ СМ I I — — — — см см — — см см I I I I I — см см ад ад ад ад ад з з з з з з (Ч — (Ч ¦— Ы\ — (Ч — <Ч — (Ч 503
сч К СЧ I I ^ (Ч (Ч ftf 5, г* N —* -т* Г* © — — — — © — ! I I О О С4 со С4 о СО С4 — О О —< —i *—< О 7 7 7П- —i >- еО — О CJ О сч •~* О О «—< .—< >—< о С4 >—' О >—' О О *—" >—| — о —• о ел О О ел О О + II (Ч N сч ft? — — О О О е- э- 9- <N со ел ел ел О О О о о о М М N - - Г4 М М О а < е (Ч N (Ч (Ч 8 9- 3 3 (Ч N R ° — — О О - * 9- кл О О (N 9- кл О О (N 9- О О 9- кл О О I I 504 505
Литература I. Квантовая механика (L Книги для начального чтения 1. ДолиновВ.К, Балашов В.В. Курс квантовой механики.-М.: Изд-во МГУ, 1982.280 с. 2. Елютин П.В., Кривченков В.Д Квантовая механика.- М: Наука, 1976.334 с. 3. Матвеев А.Н. Атомная физика.- М: Высшая школа, 1989.439 с. 4. МепешинаА.М. Курс квантовой механики для химиков.-Воронеж: Изд-во Воронежского ун-та, 1974.379 с. 5. ЭткинсП. Кванты. Справочник концепций.- М: Мир, 1977.496 с. б. Книги, требующие некоторой начальной подготовки 6. БамД. Квантовая теория.- М.: Наука, 1965.727 с. 7. БоумА. Квантовая механика: основы и приложения.-М.: Мир, 1990.720 с. 8. Давыдов А.С. Квантовая механика.-М.:ГИФМЛ, 1963,748 с. 9. Ландау ЛД.,ЛифшщЕМ. Квантовая механика. Нерелятивистская тео- теория.- М.: 1989.768 с. 10. МессиаА. Квантовая механика.-М.: Мир, 1978. Т.1,652 с, Т.2,640 с. I1. Савельев И.В. Основы теоретической физики. Т.2. Квантовая механика. - М.: Наука, 1996.432 с. 12. Ярив А. Введение в теорию и приложения квантовой механики.- М.:Мир, 1984.360 с. в. Задачники 13. ГалицкийВ.М., КарнаковБ.М., Коган В.И. Задачи по квантовой механике.- М.: Наука, 1981.648 с. 14. Гольдман И.И., Кривченков ВД. Сборник задач по квантовой механике.- М.:ГИТТЛ, 1957.275 с. , П. Квантовая химия о. Учебники 1. АбаренковИ.В., БратцевВ.Ф.,ТулубА.В. Начала квантовой химии. Высшая школа, 1989.304 с. 506 -М. 2. Грибов Л.А.,Муштакова С. П. Квантовая химия.-М.: Гардарики, 1999. 390с. 3. ЗаградникР.,ПолакР. Основы квантовой химии.- М.: Мир, 1979. 504 с. 4. Краснов КС. Молекулы и химическая связь.-М.: Высшая школа, 1977, 280 с. 5. МинкинВ.И.,СимкинБЯ.,МиняевРМ. Теория строения молекул.-Ростов- Дон: Феникс, 1997. 560 с. 6. Симкин Б.Я., Клейкий М.Е., Глуховцев М.Н. Задачи по теории строения молекул.- Ростов-Дон: Феникс, 1997.272 с. 7. Степанов Н. Ф., Пупышев В. И. Квантовая механика молекул и квантовая химия.- М.: Изд-во МГУ, 1991.384 с. 8. ФларриР. Квантовая химия.- М.: Мир, 1985.472 с. 9. Фудзинага С. Метод молекулярных орбиталей.- М.: Наука, 1983.464 с. 10. Эварестов РА. Квантовохимические методы в теории твердого тела.- Л.: Изд-во ЛГУ, 1982.280 с. б. Специальная литература 11. Берсукер И. Б. Электронное строение и свойства координационных сое- соединений. Введение в теорию.- Л.: Химия, 1976. 350 с. 12. Берсукер И.Б. Эффект Яна-Теллера и вибронные взаимодействия в современной химии.- М.: Наука, 1987. 344 с. 13. БорисоваН.П. Методы квантовой химии в молекулярной спектроскопии.- Л.: Изд-во ЛГУ, 1981.286 с. 14. Браун П. А., Киселев А. А. Введение в теорию молекулярных спектров.-Л.: Изд-во ЛГУ, 1983.232 с. 15. Дьюар М.,Догерти Р. Теория возмущений молекулярных орбиталей в органической химии.- М.: Мир, 1977.696 с. 16. Катан ИГ. Введение в теорию межмолекулярных взаимодей ствий.-М.: Наука, 1982.311с. 17. Мак-ВиниР, Сатклиф Б. Квантовая механика молекул.-М.: Мир, 1972. 382 с. 18. ПирсонР. Правила симметрии в химических реакциях.- М.: Мир, 1979. 592 с. 19. Полуэмпирические методы расчета электронной структуры / Под ред. Дж.Сигала.-М.:Мир, 1980. Т. 1 327 с. 20. СлэтерДж. Электронная структура молекул.- М.: Мир, 1965. 587 с. 21. Слэтер Дою. Методы самосогласованного поля для молекул и твердых тел.- М.: Мир, 1978.662 с. 22. Травень В. Ф. Электронная структура и свойства органических молекул.- М.: Химия, 1989.384 с. 23. ФлайгерУ. Строение и динамика молекул.- М.:Мир, 1982. Т. 1 и 2. 872 с. 507
III. Теория симметрии 1. Банкер Ф. Симметрия молекул и молекулярная спектроскопия.- М: Мир, 1981.451с. 2. Болотин А.Б., Степанов Н.Ф. Теория групп и ее применение в квантовой механике молекул.- Вильнюс: Элком, 1999.246 с. 3. Катан КГ. Симметрия многоэлектронных систем.-М.: 1969.408 с. 4. ПетрашеньМ.И., Трифонов Е.Д. Применение теории групп в квантовой механике.- М.: Наука, 1967.308 с. 5. Фларри Р Группы симметрии. Теория и химические приложения.- М.: Мир, 1983.396 с. ' 6. Эварестов Р.А., Смирнов В.П. Методы теории групп в квантовой химии твердого тела.- Л.: Изд-во ЛГУ, 1987.375 с. Предметный указатель Адиабатический потенциал первого по- порядка 252 Адиабатическое приближение 246, 248 Анизотропный потенциал 91 Антисимметричная функция 47 Антисимметричное представление 213 Антисимметризатор 256 АнтисимметризованныЙ квадрат пред- представления 208 Антистоксова частота рассеяния 174 Атомная система единиц 25 Атомы в молекулах: подход Бейдера 493 Атомы в молекулах: подход Татевского 497 Взаимодействие "спин - другая ор- орбита" 393 Вириал 477 Виртуальная орбиталь 309 Водородная связь 485 Водородоподобная функция 293 Волновая функция 18 Волновой пакет 181 Вращение системы как целого 236 Вращательные квантовые числа 106 Временная теория возмущений 162 Второе борновское приближение 165 Вынужденный переход 171 Высшая занятая молекулярная орби- орбиталь (ВЗМО) 437 Базис орбиталей гауссова типа 294 Базисные функции 51, 293 Безусловный экстремум 147 Бозон 213 Боровский радиус 116 Валентная орбиталь 330 Валентная схема 271 Валентное приближение 329 Валентное состояние 338 Вариационный принцип квантовой механики 145 Вариация функционала 141 Вековое уравнение 13, 148 Вероятность перехода 170 Вертикальный процесс 289 Вертикальный потенциал ионизации 290 Векторная модель 98 Векторный потенциал 121 Векторы ортогональные 8 Гамильтониан 21 Гамильтониан Дирака 133 Гармонический осциллятор 71 Гауссов базис 294 Гауссов волновой пакет 175, 180 Генераторы группы 196 Геометрия молекулы 349 ^р-Гибридизация 355 5/?3-Гибридизация 356 Гибридная орбиталь 352 Гильбертово пространство 14, 52 Гиромагнитное отношение 138 Главная ось симметрии 217 Граничная орбиталь 437 Грубое приближение Борна-Оппенгей- мера 249 Группа 194 - перестановок 214 - перестановочно-инверсионная 450 - точечная 216 - уравнения Шредингера 195 509
Декартова гауссова орбиталь 295 Двухуровневое приближение 315 Двухцентровые интегралы 298 Двухэлектронные интегралы 298 Двухэкспонентный базис 294 Детерминант 11 Диабетическое представление 253 Диагональная матрица 10 Диаграмма Танабе-Сугано 413 - Уолша 424 Диамагнитная восприимчивость 128 Димеры карбоновых кислот 486 Динамическая группа 450 Динамический эффект Яна-Теллера 457 Дипольный момент 126 Дирака обозначения 20 Дисротаторный процесс 434 Дисперсионная энергия 483 Диссоциационный предел 443 Диффузные функции 295 Диэлектрическая проницаемость 120 Длина связи 347 Донорно-акцепторная связь 472 Дублет 137 Единичная матрица 10 Единичное представление 201 Естественная орбиталь 363 Естественная ширина уровня 179 Закон распределения излучения Планка 172 Законы сохранения 192 Заряд на атоме 369 Замкнутая оболочка 266 Зеркальный поворот 217 Зона проводимости 488 - уровней энергии 488 Изотопическое замещение 445 Изотопомер 445 Инверсия 217 Индекс свободной валентности 375 Индукционная энергия 483 Интеграл перекрывания 147, 298 Интегральная кривая 493 Ионная связь 471 Ионная структура 273 Канал реакции 178 Каноническая орбиталь 288, 293 Канонически сопряженные величины 63 Карта распределения электронной плотности 494 Касповое условие 292 Квадратная матрица 10 Квадрупольный момент 130, 483 Квазимолекулярная расширенная элементарная ячейка 489 Квантовая скобка Пуассона 45 Квантовое состояние 18 Квантовые числа 106 Класс сопряженных элементов 203 Ковалентная связь 470 Ковалентная структура 273 Комбинационное рассеяние света 174 Коммутатор операторов 45 Коммутирующие операторы 58 Комплексная нестабильность 314 Конечная группа 199 Коническое пересечение 419 Конротаторный процесс 434 Константа спин-орбитального взаимодействия 393 Конфигурационная функция состояния 257 Координаты Якоби 233 Кориолисово взаимодействие 243 Корреляционная диаграмма 315, 416 Кососимметричная матрица 10 Коэффициент прохождения 182 - отражения 182 Критерии локализации орбиталей 359 Кубические сферические гармоники 107 Кулоновский оператор 281 Лабораторная система координат 238 Лиганд 403 Линейный вариационный метод 146 510 Линейный оператор 9, 42 Линия узлов 240 Локализованные орбитали 357 Локальная симметрия 449 Льюисовская функция 365 Магнетон 127 Магнетон Бора 127 Магнитная индукция 120 Магнитная проницаемость 120 Магнитное квантовое число 115 Магнитный дипольный момент 127 Магнитный момент 127 Матричное представление оператора 55 Матричный элемент оператора 49 S-Матрица 176 Т-Матрица 178 Матрица диагональная 10 - единичная 10 - квадратная 10 - кососимметричная 10 - неособенная 12 - несингулярная 12 - обратная 12 - ортогональная 13 - особенная 12 - плотности второго порядка 320 - плотности первого порядка 320 - прямоугольная 10 - самосопряженная 12 - скалярная 10 - симметричная 10 - сингулярная 12 - транспонированная 10 - унитарная 13 - эрмитова 12 - эрмитово-сопряженная 12 Матрицы Паули 135 Международная символика: обозначе- обозначения точечных групп 218 Межмолекулярные взаимодействия 481 неспецифические 481 Металлическая связь 488 Метод AMI 335 - валентных связей 270 - валентных схем 270 Метод конфигурационного взаимодей- взаимодействия 263 - модифицированного частичного пренебрежения дифференциаль- дифференциальным перекрыванием МЧПДП/3 (MINDO/3) 334 - молекулярных орбиталей Хюк- келя 367 - МПДП (MNDO) 335 - неопределенных множителей Лагранжа 144, 277 - Паризера-Парра-Попла (ППП) 336 - полного пренебрежения диффе- дифференциальным перекрыванием 326 - ППДП/2 332 - ППДП/С 335 - РМЗ 335 - разных орбиталей для разных спинов 284 - Релея-Ритца 149 - самосогласованного поля 283 - Хартри-Фока 283 - Хюккеля 365 - частичного пренебрежения дифференциальным перекрыванием ЧПДП (INDO) 334 - электронного парамагнитного резонанса (ЭПР) 400 - ядерного магнитного резонанса ЯМР 400 Методы функционала плотности 324 Микрочастица 17 Модель квазимолекулярной расширен- расширенной элементарной ячейки 489 - ковалентной связи 470 - молекулярного кластера 489 - "периодического кластера" 489 Многоконфигурационный метод само- самосогласованного поля 284 Многоцентровая связь 473 Молекулярная диаграмма 374 Молекулярные интегралы 298 Молекулярные модели твердых тел 489 Монохроматическая световая волна 165 Мультиплет 137 Мультиплетность 137 511
Мультипольное разложение 482 Наблюдаемая 20 Наложение конфигураций 267 Напряженность магнитного поля 120 - электрического поля 120 Натуральная орбиталь 360, 363 Натуральная связевая орбиталь 364 Неограниченный метод Хартри-Фока 284 Неопределенный множитель Лагранжа 144 Непрерывный спектр 48 Несвязывающая орбиталь 421 Неспецифические межмолекулярные взаимодействия 481 Нечетная функция 151 Низшая вакантная молекулярная орбиталь (НВМО) 437 Нормировка на 8-функцию 40 Нулевое дифференциальное перекрывание 326 Нутация 99 Обменное межмолекулярное взаимо- взаимодействие 484 Обменно-корреляционные члены 323 Обменный оператор 282 Обобщенный потенциал 122 Обозначения Дирака 20 - неприводимых представлений 220 Оболочка 266 Объединенный атом 316 Ограниченный метод Хартри-Фока 283 Одноконфигурационное приближение 276 Одномерное движение 69 Однородное магнитное поле 124 Однородное электрическое поле 123 Одноцентровые интегралы 298 Одноэлектронное приближение 254, 284 Одноэлектронные интегралы 298 Оператор антисимметризации 256 - Гамильтона 21 - импульса 20 - кинетической энергии 22 - координаты 20 - кулоновский 281 - Лапласа 22 - линейный 9 - набла 193 - неадиабатической связи 451 - обменный 282 -, ограниченный снизу 145 - перестановки 46 - повышения 77 - понижения 77 - спин-орбитального взаимодей- взаимодействия 393 - Фока 282 Операторы момента импульса 21, 92 Определитель 11 Определителя свойства 11 Оптические изомеры 187 Орбитали эквивалентные 352 тг-Орбиталь 366 о-Орбиталь 366 Орбиталь 263 - валентная 330 - виртуальная 309 - гибридная 352 - граничная 437 - локализованная 357 - натуральная 360 - неподеленной пары 356 - несвязывающая 421 - остовная 330 - разрыхляющая 420 - связывающая 420 - симметрии 350 - слейтеровского типа 294 Орбитальная корреляционная диаграм- диаграмма 315 Орбитальная самополяризуемость 383 Орбитальная центроида заряда 359 Орбитальная энергия 285 Орбитальное правило непересечения 419 Ортогональная матрица 13, 201 Ортогональные векторы 8 Ортонормированная система функций 15 512 Особая точка 494 Основная лемма вариационного исчис- исчисления 143 Основное состояние 146 Основной уровень 32 Остовная орбиталь 330 Открытая оболочка 266 Параметризация полуэмпирических методов 334 Параметры расщепления в нулевом поле 399 - метода ППДП/2 334 Первое борновское приближение 165 Перестановка 214 - четная 215 - нечетная 215 Перестановочно-инверсионная группа 450 Переход, запрещенный по симметрии 228 - разрешенный по симметрии 228 Периодический кластер 489 Плоская монохроматическая волна 165 Плотность электрического тока 120 Поверхность потенциальной энергии 249 Подвижная система координат 238 Порядок оси симметрии 217 Порядок связи 369 Поле октаэдрической симметрии 406 - тетраэдрической симметрии 407 - тригональной симметрии 404 Полином Эрмита 76 Полная система функций 15 Полносимметричная функция 47 Полносимметричное представление 201,213 Полнота системы собственных функций 50 Поляризационная поправка 483 Поляризуемость 173 Полярная ковалентная связь 470 Постоянная спин-орбитального взаимодействия 393 Постулаты квантовой механики 19 Потенциал анизотропный 91 - ионизации 290 Потенциальная кривая 249 Потенциальная поверхность 249, 443 Потенциальный яшик 55 Правила Вудворда-Хоффмана 432 - отбора по симметрии 228 - Слэтера 261 - сохранения орбитальной симмет- симметрии 433 Правило непересечения 416 - Хунда 469 Представление антисимметричное 213 - вполне приводимое 203 - группы 200 - единичное 201 - оператора 191 - полносимметричное 201, 213 - приводимое 203 - регулярное 212 - унитарное 201 - функции 190 Представления эквивалентные 202 Преобразование эквивалентности 202 Преобразования Лоренца 134 Прецессия 99 Ха-Приближение 324 Приближение Борна-Оппенгеймера 249 - ЛКАО 293 - нулевого дифференциального перекрывания 306 Приводимое представление 203 Принцип Паули 139 - минимакса Куранта 149 - соответствия 18 - суперпозиции 43 Присоединенное уравнение Лежандра 87 Присоединенный полином Лежандра 87 Производная 8-функции 505 Простейший метод молекулярных орбиталей 340 Пространство 8г 15 Простой метод Хюккеля 365 Прямое произведение групп 216 представлений 206 Прямоугольная матрица 10 513
Прямоугольный потенциальный ящик 30 Псевдопересечение 476 Псевдоэффект Яна-Теллера 456 Равновесная конфигурация 448 Радиальная корреляция 307 Радиальное уравнение 85, 111 Разделение переменных 85 Разрыхляющая орбиталь 420 Расширенный метод Хюккеля 341 Реакция Дильса-Альдера 436 Реакция сигматропная 436 - стереоселективная 436 - стереоспецифическая 436 - циклоприсоединения 436 Регулярное представление 212 Резонансная энергия взаимодействия 484 Результаты измерений 64 Релятивистское уравнение 133 Самополяризуемость 383 - атома 383 - связи 383 Самосогласованное поле 283 Самосопряженная матрица 12 Самосопряженный оператор 53 Свойства волновых функций 27 Связевая орбиталь 359 Связевая функция 295 jj-Связь 412 LS-Связь 411 юю-Связь 412 Связь донорно-акцепторная 472 - ионная 471 - ковалентная 470 - металлическая 488 - многоцентровая 473 - полярная ковалентная 470 - Рэссела-Саундерса 411 Связывающая орбиталь 420 Сгруппированные гауссовы функции 295 Секулярное уравнение 148 514 Сигматропная реакция 436 Сила Лоренца 122 Сильное кристаллическое поле 412 Символ Кронекера 9 Символика Шёнфлиса 218 Симметризованный квадрат представле- представления 208 Симметрийная нестабильность 313 Симметричная матрица 10 Симметрия потенциальной поверхности 447 Синглет 137 Синхронная реакция 433 Скалярная матрица 10 Скалярное произведение 8 Скалярный потенциал 121 Слабое кристаллическое поле 412 След матрицы 10,202 Сложение моментов 100 - спинов 136 Слэтеровские орбитали 293 Смешанный ансамбль 26 Собственная функция 46 Собственное значение 13, 46 Собственные функции операторов момента импульса 96 Собственный вектор 13 Согласованная реакция 433 Соотношение неопределенностей 63 энергия-время 66 Сохранение орбитальной симметрии 427 Спектроскопическая параметризация 369 Спин 132 - частицы 136 Спиновая чистота 263 Спиновое квантовое число 136 Спин-орбиталь 255 Спин-орбитальное взаимодействие 393 Спин-спиновое взаимодействие 398 Спин-спроектированный метод Хартри-Фока 284 Спонтанный переход 172 Статический эффект Яна-Теллера 457 Стационарная теория возмущений 155 Стационарное уравнение Шредингера 25 Стереоселективная реакция 436 Стереоспецифическая реакция 436 Стоксова частота рассеяния 174 Ступенька потенциала 33 Сферическая волна 169 Сферическая потенциальная яма 92 Сферическая система координат 82 Сферические гармоники 107 Сферические поверхностные гармо- гармоники 107 Сферические функции 107 Тензор диамагнитной восприимчивости 128 Теорема Вигнера-Эккарта 225 - вириала 476, 478 - Купманса 290 - Румера 271 - Хоэнберга - Кона 321 Теория возмущений 155 - граничных орбиталей 437 - кристаллического поля 403 - поля лигандов 414 Термохимическая параметризация 369 Тессеральные сферические гармоники 107 Топология функции плотности 493 Точечная группа 198, 216 Точка конического пересечения 419 Транспозиция 214 Транспонированная матрица 10 Трехцентровая орбиталь 360 Триплет 137 Триплетная нестабильность 314 Туннелирование 38, 181 Угловая корреляция 307 Угловая скорость вращения 240 Угловое уравнение 85 Углы Эйлера 238 Унитарная матрица 13, 200 Унитарное представление 201 Уравнение Дирака 133 - Шредингера 21 - Эрмита 73 Уравнения Максвелла 120 Уравнения Хартри-Фока 281 - Хартри-Фока-Роотхана 296 Уровни энергии 32 Условие заострения 292 - каспа 292 Условия сшивания 28 - Эккарта 242 Уширение давлением 180 g-Фактор 398 Ферм ион 213 Фокиан 282 Функции, ортонормированные по Лёвдину 155 Функционал 140 - электронной плотности 322 - энергии 145 Функциональное пространство 14 Функциональный определитель 11 5-Функция Дирака 40 5-Функция, производная 505 5-Функция, свойства 505 Функция Морзе 479 - состояния 18 - , чистая по спину 266 - Эрмита 76 Характер представления 202 Химическая связь 465 Центр масс 233 Центральное поле 82 Циклическая перестановка 214 Цилиндрическая система координат 91 Четная перестановка 215 Четная функция 151 Число заполнения орбитали 363 Чистый ансамбль 26 Эквивалентные представления 202 Эквивалентные орбитали 352 515 А
Экстремаль 143 Экстремум функционала 141 Электрическая индукция 120 Электрический дипольный момент 126 Электронная волновая функция 247 я-Электронная энергия 369 я-Электронное приближение 366 Электронная конфигурация 257, 267 Электронно-колебательное взаимодей- взаимодействие 451 Электронный гамильтониан 246 Электронный парамагнитный резонанс 400 Электронный спиновой гамильтониан 400 Электронный g-фактор 398 Электроциклическая реакция 433 Энергетическая зона 488 Энергетический барьер 432 Энергетическое представление 190 Эрмитов оператор 43, 53 Эрмитова матрица 12 Эрмитово-сопряженная матрица 12 Эффект Реннера-Теллера 457 - Яна-Теллера динамический 457 второго порядка 456 первого порядка 456 статический 457 Эффективные заряды ядер 330 Эффекты Яна-Теллера 455 Ядерная функция 248 Ядерное спин-спиновое взаимодействие 400 Ядерный магнитный резонанс 400 Якобиан преобразования 200 Оглавление Предисловие 3 Краткая вспомогательная сводка определений и соотношений из линейной алгебры и функционального анализа 8 Глава I. ИСХОДНЫЕ ПОЛОЖЕНИЯ КВАНТОВОЙ МЕХАНИКИ 17 § 1. Основные понятия и постулаты квантовой механики .- 17 § 2. Простейшие одномерные задачи 27 § 3. Математический аппарат квантовой механики 42 § 4. Матричное представление операторов 53 § 5. Одномерное движение. Задача о гармоническом осцилляторе 69 Глава II. ЦЕНТРАЛЬНОЕ ПОЛЕ И МОМЕНТ КОЛИЧЕСТВА ДВИЖЕНИЯ 82 § 1. Движение частицы в центральном поле 82 §2. Теория момента количества движения 92 § 3. Атом водорода 108 § 4. Внешнее электромагнитное поле 120 §5. Спин 132 Глава III. ПРИБЛИЖЕННЫЕ МЕТОДЫ РЕШЕНИЯ ЗАДАЧ КВАНТОВОЙ МЕХАНИКИ 140 § 1. Вариационный метод 140 § 2. Стационарная теория возмущений 155 § 3. Временная теория возмущений 162 § 4. Нестационарные задачи квантовой механики 174 Глава IV. ТЕОРИЯ СИММЕТРИИ В КВАНТОВОЙ МЕХАНИКЕ 190 § 1. Законы сохранения 190 § 2. Группы симметрии 197 517
§ 3. Системы тождественных частиц. Группы перестановок и точечные группы симметрии 213 § 4. Теорема Вигнера-Эккарта и правила отбора 222 Глава V. ОБЩИЕ ВОПРОСЫ РЕШЕНИЯ МОЛЕКУЛЯРНЫХ ЗАДАЧ 231 § 1. Молекулярное уравнение Шредингера 231 § 2. Адиабатическое приближение 243 § 3. Электронное волновое уравнение 254 § 4. Метод валентных схем 269 Глава VI. ОДНОЭЛЕКТРОННОЕ ПРИБЛИЖЕНИЕ 276 § 1. Метод самосогласованного поля 276 § 2. Метод самосогласованного поля. Прикладные проблемы 288 §3. Молекула Н2 299 § 4. Симметрия волновых функций и орбиталей 308 § 5. Методы функционала плотности 319 Глава VII. ДАЛЬНЕЙШИЕ УПРОЩЕНИЯ ПРИ РЕШЕНИИ ЭЛЕКТРОННОЙ ЗАДАЧИ 326 § 1. Полуэмпирические методы квантовой химии в приближении нулевого дифференциального перекрывания 326 § 2. Расширенный метод Хюккеля 340 § 3. Различные типы молекулярных орбиталей 350 § 4. Простой метод Хюккеля 365 § 5. Метод Хюккеля: теория возмущений 381 Глава VIII. ТОНКИЕ ВЗАИМОДЕЙСТВИЯ И КРИСТАЛЛИЧЕСКОЕ ПОЛЕ 391 § 1. Спин-орбитальное и спин-спиновое взаимодействие 391 § 2. Теория кристаллического поля и теория поля лигандов 402 Глава IX. КОРРЕЛЯЦИОННЫЕ ДИАГРАММЫ И УЧЕТ СИММЕТРИИ 416 § 1. Корреляционные диаграммы 416 § 2. Сохранение орбитальной симметрии 427 518 ГлаваХ. ДВИЖЕНИЕ ЯДЕР 443 § I. Потенциальные поверхности и симметрия 443 § 2. Электронно-колебательное взаимодействие 450 Глава XI ХИМИЧЕСКАЯ СВЯЗЬ 459 § 1. О природе химической связи 459 § 2. Межмолекулярные взаимодействия и химическая связь в конденсиро- конденсированных системах 475 § 3. Атомы в молекулах 484 Послесловие 495 Приложение 1. Соотношение атомных и ряда других единиц 498 Приложение 2. Свойства 5-функции 499 Приложение 3. Таблицы характеров некоторых точечных групп , 500 Литература 50^ Предметный указатель 509 1
ТЕОРЕТИЧЕСКИЕ ОСНОВЬ ХИМИИ Николай Федо физической х вич Сте п кафедры фоку м М.В математических эаведуюши раторией ия квантовой механики №*еет звания «Заслуженный ель науки РФ» и «Заслуженный профессор М ковско уни Акадвми Рос- Российской Академии естествен наук. редколлегий изданий физической хим*и и Автор фий) по км 250 публикаций в хиъи1, строен-- числе моногра молеку молесу- ¦ механ ив мопвку