Парная линейная регрессия
Для характеристики влияния изменений Х на вариацию У служат методы регрессионного анализа. В случае парной линейной зависимости строится регрессионная модель
где n– число наблюдений;
а0, а1 – неизвестные параметры уравнения;
ei – ошибка случайной переменной У.
Уравнение регрессии записывается как
где Уiтеор – рассчитанное выровненное значение результативного признака после подстановки в уравнение X.
Параметры а0 и а1 оцениваются с помощью процедур, наибольшее распространение из которых получил метод наименьших квадратов. Его суть заключается в том, что наилучшие оценки ag и а, получают, когда
т.е. сумма квадратов отклонений эмпирических значений зависимой переменной от вычисленных по уравнению регрессии должна быть минимальной. Сумма квадратов отклонений является функцией параметров а0 и а1. Ее минимизация осуществляется решением системы уравнений
Можно воспользоваться и другими формулами, вытекающими из метода наименьших квадратов, например:
Аппарат линейной регрессии достаточно хорошо разработан и, как правило, имеется в наборе стандартных программ оценки взаимосвязи для ЭВМ.
Важен смысл параметров: а1 – это коэффициент регрессии, характеризующий влияние, которое оказывает изменение Х на У. Он показывает, на сколько единиц в среднем изменится У при изменении Х на одну единицу. Если а, больше 0. то наблюдается положительная связь. Если а имеет отрицательное значение, то увеличение Х на единицу влечет за собой уменьшение У в среднем на а1. Параметр а1 обладает размерностью отношения У к X.
Параметр a0 – это постоянная величина в уравнении регрессии. Казалось бы, что экономического смысла он не имеет, но в ряде случаев его интерпретируют как начальное значение У.
Например, по данным о стоимости оборудования Х и производительности труда У методом наименьших квадратов получено уравнение
У = -12,14 + 2,08Х.
Коэффициент а, означает, что увеличение стоимости оборудования на 1 млн руб. ведет в среднем к росту производительности труда на 2.08 тыс. руб.
Значение функции У = a0 + а1Х называется расчетным значением и на графике образует теоретическую линию регрессии.
Смысл теоретической регрессии в том, что это оценка среднего значения переменной У для заданного значения X.
Парная корреляция или парная регрессия могут рассматриваться как частный случай отражения связи некоторой зависимой переменной, с одной стороны, и одной из множества независимых переменных – с другой. Когда же требуется охарактеризовать связь всего указанного множества независимых переменных с результативным признаком, говорят о множественной корреляции или множественной регрессии.