Материал: Спецглавы высшей математики. численные методы. Пантелеев И.Н

Внимание! Если размещение файла нарушает Ваши авторские права, то обязательно сообщите нам

 

f1

f1

 

x

y

 

 

f2

f2

W x

 

x

y

 

f3

f3

 

x

y

 

Имеем

f1

 

 

z

 

 

 

2x

f2

 

 

z

 

4x

 

 

f3

 

6x

z

 

 

 

 

2y

2z

2y

 

 

4 .

4

2z

 

 

 

 

 

 

 

 

 

W x

 

 

1

1

 

1

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

0

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

2 1

4 ,

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

4

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

3

 

1

 

 

 

 

 

 

 

Причем

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

W x

 

 

 

1

 

1

 

 

1

 

 

 

 

 

 

 

 

 

 

 

 

 

0

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

2

1 4 40.

 

 

 

 

 

 

 

 

 

 

 

 

 

4

1

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

3

 

 

 

 

 

 

 

 

 

Следовательно, матрица W x 0 — неособенная. Вычисляем

обратную ей матрицу:

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

3

 

1

 

 

1

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

15

5

 

 

5

 

8

 

 

8

 

 

8

 

 

 

 

 

 

 

1

 

 

 

 

 

 

 

 

 

 

 

W

1

x

0

 

 

 

 

 

 

 

 

 

7

 

1

 

3

 

 

 

 

14

2

 

 

6

 

 

 

 

 

 

 

 

 

 

 

 

.

 

 

40

 

 

20

 

20

 

20

 

 

 

 

 

 

11

7 1

 

 

 

11

 

7

 

 

1

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

40

 

40

 

40

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

По формуле (IV.15) получаем первое приближение: 68

 

 

 

 

 

 

 

 

 

3

1

 

 

1

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

0.5

8

 

8

 

 

8

 

 

0.25

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

x 1 x 0 W 1 x 0 F x 0 0.5

 

7

 

1

 

 

3

 

 

 

1.25

 

 

20

20

 

20

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

11

 

 

7

 

 

 

 

1

 

 

 

1.00

 

 

 

 

 

 

 

 

 

 

0.5

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

40

 

 

40 40

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

0.5

 

0.375

 

0.875

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

0

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

0.5

 

 

0.500

.

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

0.125

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

0.5

 

 

 

0.375

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

 

Аналогично находятся дальнейшие приближения. Результаты вычислений приведены в таблице.

Последовательные приближения корней

I

X

у

z

0

0.5

0.5

0.5

1

0.875

0.5

0.375

2

0.78981

0.49662

0.36993

3

0.78521

0.49662

0.36992

Останавливаясь на приближении .x(3), будем иметь: x= 0.7852;

у = 0.4966; г = 0.3699.

4.3. Решение нелинейных систем методами спуска

Общий недостаток всех рассмотренных ранее методов решения систем нелинейных уравнений состоит в локальном характере сходимости, затрудняющем их применение в случаях (достаточно типичных), когда существуют проблемы с выбором начального приближения, обеспечивающего сходимость итерационной вычислительной процедуры. В этих случаях можно использовать численные методы оптимизации — данный раздел вычислительной математики выделяется в само-

69

f x, y 0
g x, y 0

стоятельную дисциплину. Для использования наглядной геометрической интерпретации приводимых ниже рассуждений и их результатов ограничимся, как и в предыдущем пункте, рассмотрением системы, состоящей из двух уравнений с двумя неизвестными

(IV.16)

Из функций f(x,y), g(x,y) системы (IV.16) образуем новую функцию.

x, y f x, y 2 g x, y 2 . (IV.17)

Так как эта функция не отрицательная, то найдется точка (вообще говоря, не единственная) (х*, у*) такая, что

x, y x*, y * 0

x, y R2 .

70

Рис. IV.1. Пространственная интерпретация метода наискорейшего спуска для функции (IV.17)

Рис. IV.2. Траектория наискорейшего спуска для функции (IV.17) в плоскости ХОУ

71

Следовательно, если тем или иным способом удается получить точку (x*,y*), минимизирующую функцию Ф(х,у), и если

при этом окажется, что min x, y x*, y * 0 , то точка

x, y R2

(х*,у*) — истинное решение системы (IV.16), поскольку

f x*, y * 0,

x*, y * 0

g x*, y * 0,

Последовательность точек (xk,yk) — приближений к точке (х*, у*) минимума функции Ф(x,у) — обычно получают по рекуррентной формуле

 

x

 

 

x

 

p

 

 

.

 

k 1

 

 

k

 

k

(IV.18)

 

 

 

 

 

k

,

 

yk 1

 

yk

qk

 

где k =0,1,2,..., (pk,qk)r - вектор, определяющий направление минимизации, a αk— скалярная величина, характеризующая величину шага минимизации (шаговый множитель). Учитывая геометрический смысл задачи минимизации функций двух переменных Ф(х, у) — "спуск на дно" поверхности z = Φ(x:,у) (рис. IV.1), итерационный метод (IV.18) можно назвать методом спуска, если вектор (pk,qk)T при каждом k является направлением спуска (т. е. существует такое а >0, что Ф(хk + apk,yk +αqk)<Φ(xk,yk)), и если множитель ak подбирается так, чтобы

выполнялось условие релаксации Ф(xk+1,yk+1)<Ф(xk,yk) означающее переход на каждой итерации в точку с меньшим значе-

нием минимизируемой функции.

Таким образом, при построении численного метода вида (IV.18) минимизации функции Ф(х,у) следует ответить на два главных вопроса: как выбирать направление спуска (pk,qk)T и как регулировать длину шага в выбранном направлении с помощью скалярного параметра — шагового множителя ak. Приведем простые соображения по этому поводу.

При выборе направления спуска естественным является выбор такого направления, в котором минимизируемая функция убы-

72

вает наиболее быстро. Как известно из математического анализа функций нескольких переменных, направление наибольшего возрастания функции в данной точке показывает ее градиент в этой точке. Поэтому примем за направление спуска вектор

p

 

 

 

 

 

x

k

, y

k

 

 

 

 

 

 

k

 

 

 

x

 

 

 

(IV.19)

 

 

xk , yk

 

 

 

 

 

 

qk

 

 

 

y xk , yk

 

— антиградиент функции Ф(х,у). Таким образом, из семейств (IV.18) выделяем градиентный метод.

Оптимальный шаг в направлении антиградиента — это такой шаг, при котором значение Ф(xk+1,yk+1 ) наименьшее среди всех других значений Ф(x,у) в этом фиксированном направлении, т. е. когда точка xk 1 , yk 1 является точкой условного

минимума. Следовательно, можно рассчитывать на наиболее быструю сходимость метода (IV.19), если полагать в нем

ak arg min xk a x (xk , yk ),

yk a y xk , yk .

(IV.20)

a 0

 

 

Такой выбор шагового множителя, называемый исчерпывающим спуском, вместе с формулой (IV.19) определяет метод наискорейшего спуска.

Геометрическая интерпретация этого метода хорошо видна на рис. IV.1, IV.2. Характерны девяностоградусные изломы траектории наискорейшего спуска, что объясняется исчерпываемостью спуска и свойством градиента (а значит, и антиградиента) быть перпендикулярным к линии уровня в соответствующей точке.

Наиболее типичной является ситуация, когда найти точно (аналитическими методами) оптимальное значение ak не удается. Следовательно, приходится делать ставку на применение каких-либо численных методов одномерной минимизации и находить ak в (IV.18) лишь приближенно.

73

Несмотря на то, что задача нахождения минимума функции одной переменой k a xk a x (xk , yk ), yk a y xk , yk . намного проще, чем решаемая задача, применение тех или

иных численных методов нахождения значений ak arg min k a с той или иной точностью требует вычисле-

ния нескольких значений минимизируемой функции.

Так как это нужно делать на каждом итерационном шаге, то при большом числе шагов реализация метода наискорейшего спуска в чистом виде является достаточно высокозатратной. Существуют эффективные схемы приближенного вычисления квазиоптимальных ak, в которых учитывается специфика минимизируемых функций (типа сумм квадратов функций).

Зачастую успешной является такая стратегия градиентного метода, при которой шаговый множитель ak в (IV.18) берется либо сразу достаточно малым постоянным, либо предусматривается его уменьшение, например, делением пополам для удовлетворения условию релаксации на очередном шаге. Хотя каждый отдельный шаг градиентного метода при этом, вообще говоря, далек от оптимального, такой процесс по числу вычислений функции может оказаться более эффективным, чем метод наискорейшего спуска. Главное достоинство градиентных методов решения нелинейных систем — глобальная сходимость. Нетрудно доказать, что процесс градиентного спуска приведет к какой-либо точке минимума функции из любой начальной точки. При определенных условиях найденная точка минимума будет искомым решением исходной нелинейной системы.

Главный недостаток — медленная сходимость. Доказано, что сходимость этих методов только линейная, причем, если для многих методов, таких как метод Ньютона, характерно ускорение сходимости при приближении к решению, то здесь имеет место скорее обратное. Поэтому есть необходимость построения гибридных алгоритмов, которые начинали бы поиск искомой точки — решения данной нелинейной системы — глобально сходящимся градиентным методом, а затем производи-

74

ли уточнение каким-то быстросходящимся методом, например методом Ньютона (разумеется, если данные функции обладают нужными свойствами).

Примечание.

Порядком сходимости последовательности (xk) к х* назы-

вают такое число р, что

 

x * xk 1

 

C

 

x * xk

 

p

, где С > 0,

 

 

 

 

при всех k > k0.

Разработан ряд методов решения экстремальных задач, которые соединяют в себе низкую требовательность к выбору начальной точки и высокую скорость сходимости. К таким методам, называемым квазиньютоновскими, можно отнести, например, метод переменной метрики (Дэвидона-Флетчера- Пауэлла), симметричный и положительно определенный методы секущих (на основе формулы пересчета Бройдена).

При наличии негладких функций в решаемой задаче следует отказаться от использования производных или их аппроксимаций и прибегнуть к так называемым методам прямого поиска (циклического покоординатного спуска, Хука и Дживса, Роленброка и т. п.). Описание упомянутых и многих других методов такого типа можно найти в учебной и в специальной литературе, посвященной решению экстремальных задач.

Для разных семейств численных методов минимизации могут быть рекомендованы свои критерии останова итерационного процесса. Например, учитывая, что в точке минимума дифференцируемой функции должно выполняться необходимое условие экстремума, на конец счета градиентным методом можно выходить, когда достаточно малой становится норма градиента. Если принять во внимание, что минимизация применяется к решению нелинейной системы, то целесообразнее отслеживать близость к нулю минимизируемой неотрицательной функции, т. е. судить о точности получаемого приближения по квадрату его евклидовой метрике.

Для решения n-мерной системы (IV.1) следует свести задачу к решению экстремальной задачи:

75

n

x fi2 x min.

i1

Рассмотрим далее примеры реализации некоторых алгоритмов поиска экстремумов функций, зависящих от нескольких переменных, в пакете MATLAB.

Пример IV.1. Алгоритм поиска экстремума функции с шагом, не зависящим от свойств минимизируемой функции. Простейший вариант метода наискорейшего спуска рассмотрим

на примере поиска минимума

квадратической функции

f x, y x2 y 2

двух переменных с оврагом, пологость ко-

торого определяется параметром

μ. Решение данной задачи в

пакете MATLAB находится выполнением следующей последовательности команд:

1.Создайте файл F_L4.m (листинг IV.1), содержащий описание функции, возвращающей значения функции f(x,y) в узлах координатной сетки.

Листинг 4.1. Файл F_L4.m function z=F_L4 (x,y,mu) N=length(x);

z=zeros(N); for i=l:N for j=l:N

z(i,j)=x(i).^2+mu*y(j).^2; end;

end;

2.Постройте графики исследуемой функции при различных значениях параметра μ.

» N=23;

» Xmin=-5; Xmax=5; » Ymin=-5;Ymax=5; » i=l:N;j=l:N;

» x(i)=Xmin+i*(Xmax-Xmin)/N; » y(j)=Ymin+j*(Ymах-Ymin)/N;

»Ml=F_L4(x,y,0.5); M2=F_L4(x,y,l) ;M3=F_L4(x,y, 1.5) ;

»[X Y]=meshgrid(x,y);

»surfc(X,Y,Ml); colormap gray

»surfc(X,Y,M2); colorap gray

»surfc(X,Y,M3); colormap gray

Из рис. IV.3-IV.5 видно, что при μ = l функция f(x,y,μ) представляет собой параболоид вращения, при μ>1 параболоид становится эллиптическим, "вытягиваясь" вдоль оси оХ (при μ < 1 — вдоль оси оY).

Рис. IV.3. Поверхность и карта линий уровня функции f x, y x2 0.5 y 2

77

76

Источник: https://studfile.net/preview/16565850/