По территориям региона приводятся данные за 200Х г.
| Номер региона | Среднедушевой прожиточный минимум в день одного трудоспособного, руб., х | Среднедневная заработная плата, руб., у |
|---|---|---|
| 1 | 78 | 133 |
| 2 | 82 | 148 |
| 3 | 87 | 134 |
| 4 | 79 | 154 |
| 5 | 89 | 162 |
| 6 | 106 | 195 |
| 7 | 67 | 139 |
| 8 | 88 | 158 |
| 9 | 73 | 152 |
| 10 | 87 | 162 |
| 11 | 76 | 159 |
| 12 | 115 | 173 |
Задание:
1. Постройте поле корреляции и сформулируйте гипотезу о форме связи.
2. Рассчитайте параметры уравнения линейной регрессии

3. Оцените тесноту связи с помощью показателей корреляции и детерминации.
4. Дайте с помощью среднего (общего) коэффициента эластичности сравнительную оценку силы связи фактора с результатом.
5. Оцените с помощью средней ошибки аппроксимации качество уравнений.
6. Оцените с помощью F-критерия Фишера статистическую надёжность результатов регрессионного моделирования.
7. Рассчитайте прогнозное значение результата, если прогнозное значение фактора увеличится на 10% от его среднего уровня. Определите доверительный интервал прогноза для уровня значимости 
8. Оцените полученные результаты, выводы оформите в аналитической записке.
Решение:
Решим данную задачу с помощью Excel.
1. Сопоставив имеющиеся данные х и у, например, ранжировав их в порядке возрастания фактора х, можно наблюдать наличие прямой зависимости между признаками, когда увеличение среднедушевого прожиточного минимума увеличивает среднедневную заработную плату. Исходя из этого, можно сделать предположение, что связь между признаками прямая и её можно описать уравнением прямой. Этот же вывод подтверждается и на основе графического анализа.
Чтобы построить поле корреляции можно воспользоваться ППП Excel. Введите исходные данные в последовательности: сначала х, затем у.
Выделите область ячеек, содержащую данные.
Затем выберете: Вставка / Точечная диаграмма / Точечная с маркерами как показано на рисунке 1.
Рисунок 1 Построение поля корреляции
Анализ поля корреляции показывает наличие близкой к прямолинейной зависимости, так как точки расположены практически по прямой линии.
2. Для расчёта параметров уравнения линейной регрессии
воспользуемся встроенной статистической функцией ЛИНЕЙН.
Для этого:
1) Откройте существующий файл, содержащий анализируемые данные;
2) Выделите область пустых ячеек 5×2 (5 строк, 2 столбца) для вывода результатов регрессионной статистики.
3) Активизируйте Мастер функций: в главном меню выберете Формулы / Вставить функцию.
4) В окне Категория выберете Статистические, в окне функция – ЛИНЕЙН. Щёлкните по кнопке ОК как показано на Рисунке 2;
Рисунок 2 Диалоговое окно «Мастер функций»
5) Заполните аргументы функции:
Известные значения у – диапазон, содержащий данные результативного признака;
Известные значения х – диапазон, содержащий данные факторного признака;
Константа – логическое значение, которое указывает на наличие или на отсутствие свободного члена в уравнении; если Константа = 1, то свободный член рассчитывается обычным образом, если Константа = 0, то свободный член равен 0;
Статистика – логическое значение, которое указывает, выводить дополнительную информацию по регрессионному анализу или нет. Если Статистика = 1, то дополнительная информация выводится, если Статистика = 0, то выводятся только оценки параметров уравнения.
Щёлкните по кнопке ОК;
Рисунок 3 Диалоговое окно аргументов функции ЛИНЕЙН
6) В левой верхней ячейке выделенной области появится первый элемент итоговой таблицы. Чтобы раскрыть всю таблицу, нажмите на клавишу <F2>, а затем на комбинацию клавиш <Ctrl>+<Shift>+<Enter>.
Дополнительная регрессионная статистика будет выводиться в порядке, указанном в следующей схеме:
| Значение коэффициента b | Значение коэффициента a |
| Стандартная ошибка b | Стандартная ошибка a |
| Коэффициент детерминации R2 | Стандартная ошибка y |
| F-статистика | Число степеней свободы df |
| Регрессионная сумма квадратов
|
Остаточная сумма квадратов
|
Рисунок 4 Результат вычисления функции ЛИНЕЙН
Получили уровнение регрессии:
Делаем вывод: С увеличением среднедушевого прожиточного минимума на 1 руб. среднедневная заработная плата возрастает в среднем на 0,92 руб.
3. Коэффициент детерминации 
По вычисленному коэффициенту детерминации 

Связь оценивается как тесная.
4. С помощью среднего (общего) коэффициента эластичности определим силу влияния фактора на результат.
Для уравнения прямой 
Средние значения найдём, выделив область ячеек со значениями х, и выберем Формулы / Автосумма / Среднее, и то же самое произведём со значениями у.
Рисунок 5 Расчёт средних значений функции и аргумент
Таким образом, при изменении среднедушевого прожиточного минимума на 1% от своего среднего значения среднедневная заработная плата изменится в среднем на 0,51%.
С помощью инструмента анализа данных Регрессия можно получить:
— результаты регрессионной статистики,
— результаты дисперсионного анализа,
— результаты доверительных интервалов,
— остатки и графики подбора линии регрессии,
— остатки и нормальную вероятность.
Порядок действий следующий:
1) проверьте доступ к Пакету анализа. В главном меню последовательно выберите: Файл/Параметры/Надстройки.
2) В раскрывающемся списке Управление выберите пункт Надстройки Excel и нажмите кнопку Перейти.
3) В окне Надстройки установите флажок Пакет анализа, а затем нажмите кнопку ОК.
• Если Пакет анализа отсутствует в списке поля Доступные надстройки, нажмите кнопку Обзор, чтобы выполнить поиск.
• Если выводится сообщение о том, что пакет анализа не установлен на компьютере, нажмите кнопку Да, чтобы установить его.
4) В главном меню последовательно выберите: Данные / Анализ данных / Инструменты анализа / Регрессия, а затем нажмите кнопку ОК.
5) Заполните диалоговое окно ввода данных и параметров вывода:
Входной интервал Y – диапазон, содержащий данные результативного признака;
Входной интервал X – диапазон, содержащий данные факторного признака;
Метки – флажок, который указывает, содержит ли первая строка названия столбцов или нет;
Константа – ноль – флажок, указывающий на наличие или отсутствие свободного члена в уравнении;
Выходной интервал – достаточно указать левую верхнюю ячейку будущего диапазона;
6) Новый рабочий лист – можно задать произвольное имя нового листа.
Затем нажмите кнопку ОК.
Рисунок 6 Диалоговое окно ввода параметров инструмента Регрессия
Результаты регрессионного анализа для данных задачи представлены на рисунке 7.
Рисунок 7 Результат применения инструмента регрессия
5. Оценим с помощью средней ошибки аппроксимации качество уравнений. Воспользуемся результатами регрессионного анализа представленного на Рисунке 8.
Рисунок 8 Результат применения инструмента регрессия «Вывод остатка»
Составим новую таблицу как показано на рисунке 9. В графе С рассчитаем относительную ошибку аппроксимации по формуле:
Рисунок 9 Расчёт средней ошибки аппроксимации
Средняя ошибка аппроксимации рассчитывается по формуле:
Качество построенной модели оценивается как хорошее, так как 
6. Из таблицы с регрессионной статистикой (Рисунок 4) выпишем фактическое значение F-критерия Фишера:
Поскольку 
8. Оценку статистической значимости параметров регрессии проведём с помощью t-статистики Стьюдента и путём расчёта доверительного интервала каждого из показателей.
Выдвигаем гипотезу Н0 о статистически незначимом отличии показателей от нуля:


На рисунке 7 имеются фактические значения t-статистики:
t-критерий для коэффициента корреляции можно рассчитать двумя способами:
I способ: 
где 
Данные для расчёта возьмём из таблицы на Рисунке 7.
II способ:
Фактические значения t-статистики превосходят табличные значения:
Поэтому гипотеза Н0 отклоняется, то есть параметры регрессии и коэффициент корреляции не случайно отличаются от нуля, а статистически значимы.
Доверительный интервал для параметра a определяется как
Для параметра a 95%-ные границы как показано на рисунке 7 составили:
Доверительный интервал для коэффициента регрессии определяется как
Для коэффициента регрессии b 95%-ные границы как показано на рисунке 7 составили:
Анализ верхней и нижней границ доверительных интервалов приводит к выводу о том, что с вероятностью 
7. Полученные оценки уравнения регрессии позволяют использовать его для прогноза. Если прогнозное значение прожиточного минимума составит:
Тогда прогнозное значение прожиточного минимума составит:
Ошибку прогноза рассчитаем по формуле:
где
Дисперсию посчитаем также с помощью ППП Excel. Для этого:
1) Активизируйте Мастер функций: в главном меню выберете Формулы / Вставить функцию.
2) В окне Категория выберете Статистические, в окне функция – ДИСП.Г. Щёлкните по кнопке ОК.
3) Заполните диапазон, содержащий числовые данные факторного признака. Нажмите ОК.
Рисунок 10 Расчёт дисперсии
Получили значение дисперсии
Для подсчёта остаточной дисперсии на одну степень свободы воспользуемся результатами дисперсионного анализа как показано на Рисунке 7.
Доверительные интервалы прогноза индивидуальных значений у при 
Интервал достаточно широк, прежде всего, за счёт малого объёма наблюдений. В целом выполненный прогноз среднемесячной заработной платы оказался надёжным.
Условие задачи взято из: Практикум по эконометрике: Учеб. пособие / И.И. Елисеева, С.В. Курышева, Н.М. Гордеенко и др.; Под ред. И.И. Елисеевой. – М.: Финансы и статистика, 2003. – 192 с.: ил.
Рисунок 4 Результат вычисления функции ЛИНЕЙН
Получили уровнение регрессии:
Делаем вывод: С увеличением среднедушевого прожиточного минимума на 1 руб. среднедневная заработная плата возрастает в среднем на 0,92 руб.
Означает, что 52% вариации заработной платы (у) объясняется вариацией фактора х — среднедушевого прожиточного минимума, а 48% — действием других факторов, не включённых в модель.
По вычисленному коэффициенту детерминации можно рассчитать коэффициент корреляции: 
Связь оценивается как тесная.
4. С помощью среднего (общего) коэффициента эластичности определим силу влияния фактора на результат.
Для уравнения прямой средний (общий) коэффициент эластичности определим по формуле:
Средние значения найдём, выделив область ячеек со значениями х, и выберем Формулы / Автосумма / Среднее , и то же самое произведём со значениями у.
Рисунок 5 Расчёт средних значений функции и аргумент
Таким образом, при изменении среднедушевого прожиточного минимума на 1% от своего среднего значения среднедневная заработная плата изменится в среднем на 0,51%.
С помощью инструмента анализа данных Регрессия можно получить:
— результаты регрессионной статистики,
— результаты дисперсионного анализа,
— результаты доверительных интервалов,
— остатки и графики подбора линии регрессии,
— остатки и нормальную вероятность.
Порядок действий следующий:
1) проверьте доступ к Пакету анализа . В главном меню последовательно выберите: Файл/Параметры/Надстройки .
2) В раскрывающемся списке Управление выберите пункт Надстройки Excel и нажмите кнопку Перейти.
3) В окне Надстройки установите флажок Пакет анализа , а затем нажмите кнопку ОК .
Если Пакет анализа отсутствует в списке поля Доступные надстройки , нажмите кнопку Обзор , чтобы выполнить поиск.
Если выводится сообщение о том, что пакет анализа не установлен на компьютере, нажмите кнопку Да , чтобы установить его.
4) В главном меню последовательно выберите: Данные / Анализ данных / Инструменты анализа / Регрессия , а затем нажмите кнопку ОК .
5) Заполните диалоговое окно ввода данных и параметров вывода:
Входной интервал Y — диапазон, содержащий данные результативного признака;
Входной интервал X — диапазон, содержащий данные факторного признака;
Метки — флажок, который указывает, содержит ли первая строка названия столбцов или нет;
Константа — ноль — флажок, указывающий на наличие или отсутствие свободного члена в уравнении;
Выходной интервал — достаточно указать левую верхнюю ячейку будущего диапазона;
6) Новый рабочий лист — можно задать произвольное имя нового листа.
Затем нажмите кнопку ОК .
Рисунок 6 Диалоговое окно ввода параметров инструмента Регрессия
Результаты регрессионного анализа для данных задачи представлены на рисунке 7.
Рисунок 7 Результат применения инструмента регрессия
5. Оценим с помощью средней ошибки аппроксимации качество уравнений. Воспользуемся результатами регрессионного анализа представленного на Рисунке 8.
Рисунок 8 Результат применения инструмента регрессия «Вывод остатка»
Составим новую таблицу как показано на рисунке 9. В графе С рассчитаем относительную ошибку аппроксимации по формуле:
Рисунок 9 Расчёт средней ошибки аппроксимации
Средняя ошибка аппроксимации рассчитывается по формуле:
Качество построенной модели оценивается как хорошее, так как не превышает 8 — 10%.
6. Из таблицы с регрессионной статистикой (Рисунок 4) выпишем фактическое значение F-критерия Фишера:
Поскольку 
8. Оценку статистической значимости параметров регрессии проведём с помощью t-статистики Стьюдента и путём расчёта доверительного интервала каждого из показателей.
Выдвигаем гипотезу Н 0 о статистически незначимом отличии показателей от нуля:


На рисунке 7 имеются фактические значения t-статистики:
t-критерий для коэффициента корреляции можно рассчитать двумя способами:
где 
Данные для расчёта возьмём из таблицы на Рисунке 7.
Фактические значения t-статистики превосходят табличные значения:
Поэтому гипотеза Н 0 отклоняется, то есть параметры регрессии и коэффициент корреляции не случайно отличаются от нуля, а статистически значимы.
Доверительный интервал для параметра a определяется как
Для параметра a 95%-ные границы как показано на рисунке 7 составили:
Доверительный интервал для коэффициента регрессии определяется как
Для коэффициента регрессии b 95%-ные границы как показано на рисунке 7 составили:
Анализ верхней и нижней границ доверительных интервалов приводит к выводу о том, что с вероятностью 
7. Полученные оценки уравнения регрессии позволяют использовать его для прогноза. Если прогнозное значение прожиточного минимума составит:
Тогда прогнозное значение прожиточного минимума составит:
Ошибку прогноза рассчитаем по формуле:
где
Дисперсию посчитаем также с помощью ППП Excel. Для этого:
1) Активизируйте Мастер функций : в главном меню выберете Формулы / Вставить функцию .
3) Заполните диапазон, содержащий числовые данные факторного признака. Нажмите ОК .
Рисунок 10 Расчёт дисперсии
Получили значение дисперсии
Для подсчёта остаточной дисперсии на одну степень свободы воспользуемся результатами дисперсионного анализа как показано на Рисунке 7.
Доверительные интервалы прогноза индивидуальных значений у при с вероятностью 0,95 определяются выражением:
Интервал достаточно широк, прежде всего, за счёт малого объёма наблюдений. В целом выполненный прогноз среднемесячной заработной платы оказался надёжным.
Условие задачи взято из: Практикум по эконометрике: Учеб. пособие / И.И. Елисеева, С.В. Курышева, Н.М. Гордеенко и др.; Под ред. И.И. Елисеевой. — М.: Финансы и статистика, 2003. — 192 с.: ил.
Для общей оценки качества построенной эконометрической определяются такие характеристики как коэффициент детерминации, индекс корреляции, средняя относительная ошибка аппроксимации, а также проверяется значимость уравнения регрессии с помощью F -критерия Фишера. Перечисленные характеристики являются достаточно универсальными и могут применяться как для линейных, так и для нелинейных моделей, а также моделей с двумя и более факторными переменными. Определяющее значение при вычислении всех перечисленных характеристик качества играет ряд остатков ε i , который вычисляется путем вычитания из фактических (полученных по наблюдениям) значений исследуемого признака y i значений, рассчитанных по уравнению модели y рi .
показывает, какая доля изменения исследуемого признака учтена в модели. Другими словами коэффициент детерминации показывает, какая часть изменения исследуемой переменной может быть вычислена, исходя из изменений включённых в модель факторных переменных с помощью выбранного типа функции, связывающей факторные переменные и исследуемый признак в уравнении модели.
Коэффициент детерминации R 2 может принимать значения от 0 до 1. Чем ближе коэффициент детерминации R 2 к единице, тем лучше качество модели.
Индекс корреляции можно легко вычислить, зная коэффициент детерминации:
Индекс корреляции R характеризует тесноту выбранного при построении модели типа связи между учтёнными в модели факторами и исследуемой переменной. В случае линейной парной регрессии его значение по абсолютной величине совпадает с коэффициентом парной корреляции r (x, y) , который мы рассмотрели ранее, и характеризует тесноту линейной связи между x и y . Значения индекса корреляции, очевидно, также лежат в интервале от 0 до 1. Чем ближе величина R к единице, тем теснее выбранный вид функции связывает между собой факторные переменные и исследуемый признак, тем лучше качество модели.

выражается в процентах и характеризует точность модели. Приемлимая точность модели при решении практических задач может определяться, исходя из соображений экономической целесообразности с учётом конкретной ситуации. Широко применяется критерий, в соответствии с которым точность считается удовлетворительной, если средняя относительная погрешность меньше 15%. Если E отн.ср. меньше 5%, то говорят, что модель имеет высокую точность. Не рекомендуется применять для анализа и прогноза модели с неудовлетворительной точностью, то есть, когда E отн.ср. больше 15%.
F-критерий Фишера используется для оценки значимости уравнения регрессии. Расчётное значение F-критерия определяется из соотношения:

Критическое значение F -критерия определяется по таблицам при заданном уровне значимости α и степенях свободы (можно использовать функцию FРАСПОБР в Excel). Здесь, по-прежнему, m – число факторов, учтённых в модели, n – количество наблюдений. Если расчётное значение больше критического, то уравнение модели признаётся значимым. Чем больше расчётное значение F -критерия, тем лучше качество модели.
Определим характеристики качества построенной нами линейной модели для Примера 1 . Воспользуемся данными Таблицы 2. Коэффициент детерминации :
Следовательно, в рамках линейной модели изменение объёма продаж на 90,1% объясняется изменением температуры воздуха.

Значение индекса корреляции в случае парной линейной модели как мы видим, действительно по модулю равно коэффициенту корреляции между соответствующими переменными (объём продаж и температура). Поскольку полученное значение достаточно близко к единице, то можно сделать вывод о наличии тесной линейной связи между исследуемой переменной (объём продаж) и факторной переменноё (температура).
Критическое значение F кр при α = 0,1; ν 1 =1; ν 2 =7-1-1=5 равно 4,06. Расчётное значение F -критерия больше табличного, следовательно, уравнение модели является значимым.
Средняя относительная ошибка аппроксимации
Построенная линейная модель парной регрессии имеет неудовлетворительную точность (>15%), и её не рекомендуется использовать для анализа и прогнозирования.
В итоге, несмотря на то, что большинство статистических характеристик удовлетворяют предъявляемым к ним критериям, линейная модель парной регрессии непригодна для прогнозирования объёма продаж в зависимости от температуры воздуха. Нелинейный характер зависимости между указанными переменными по данным наблюдений достаточно хорошо виден на Рис.1. Проведённый анализ это подтвердил.
Среди различных методов прогнозирования нельзя не выделить аппроксимацию. С её помощью можно производить приблизительные подсчеты и вычислять планируемые показатели, путем замены исходных объектов на более простые. В Экселе тоже существует возможность использования данного метода для прогнозирования и анализа. Давайте рассмотрим, как этот метод можно применить в указанной программе встроенными инструментами.
Наименование данного метода происходит от латинского слова proxima – «ближайшая» Именно приближение путем упрощения и сглаживания известных показателей, выстраивание их в тенденцию и является его основой. Но данный метод можно использовать не только для прогнозирования, но и для исследования уже имеющихся результатов. Ведь аппроксимация является, по сути, упрощением исходных данных, а упрощенный вариант исследовать легче.
Главный инструмент, с помощью которого проводится сглаживания в Excel – это построение линии тренда. Суть состоит в том, что на основе уже имеющихся показателей достраивается график функции на будущие периоды. Основное предназначение линии тренда, как не трудно догадаться, это составление прогнозов или выявление общей тенденции.
Но она может быть построена с применением одного из пяти видов аппроксимации:
- Линейной;
- Экспоненциальной;
- Логарифмической;
- Полиномиальной;
- Степенной.
Рассмотрим каждый из вариантов более подробно в отдельности.
Способ 1: линейное сглаживание
Прежде всего, давайте рассмотрим самый простой вариант аппроксимации, а именно с помощью линейной функции. На нем мы остановимся подробнее всего, так как изложим общие моменты характерные и для других способов, а именно построение графика и некоторые другие нюансы, на которых при рассмотрении последующих вариантов уже останавливаться не будем.
Прежде всего, построим график, на основании которого будем проводить процедуру сглаживания. Для построения графика возьмем таблицу, в которой помесячно указана себестоимость единицы продукции, производимой предприятием, и соответствующая прибыль в данном периоде. Графическая функция, которую мы построим, будет отображать зависимость увеличения прибыли от уменьшения себестоимости продукции.
Сглаживание, которое используется в данном случае, описывается следующей формулой:
В конкретно нашем случае формула принимает такой вид:
Величина достоверности аппроксимации у нас равна 0,9418 , что является довольно приемлемым итогом, характеризующим сглаживание, как достоверное.
Способ 2: экспоненциальная аппроксимация
Теперь давайте рассмотрим экспоненциальный тип аппроксимации в Эксель.
Общий вид функции сглаживания при этом такой:
где e – это основание натурального логарифма.
В конкретно нашем случае формула приняла следующую форму:
Способ 3: логарифмическое сглаживание
Теперь настала очередь рассмотреть метод логарифмической аппроксимации.
В общем виде формула сглаживания выглядит так:
где ln – это величина натурального логарифма. Отсюда и наименование метода.
В нашем случае формула принимает следующий вид:
Способ 4: полиномиальное сглаживание
Настал черед рассмотреть метод полиномиального сглаживания.
Формула, которая описывает данный тип сглаживания, приняла следующий вид:
Способ 5: степенное сглаживание
В завершении рассмотрим метод степенной аппроксимации в Excel.
Данный способ эффективно используется в случаях интенсивного изменения данных функции. Важно учесть, что этот вариант применим только при условии, что функция и аргумент не принимают отрицательных или нулевых значений.
Общая формула, описывающая данный метод имеет такой вид:
В конкретно нашем случае она выглядит так:
Как видим, при использовании конкретных данных, которые мы применяли для примера, наибольший уровень достоверности показал метод полиномиальной аппроксимации с полиномом в шестой степени (0,9844 ), наименьший уровень достоверности у линейного метода (0,9418 ). Но это совсем не значит, что такая же тенденция будет при использовании других примеров. Нет, уровень эффективности у приведенных выше методов может значительно отличаться, в зависимости от конкретного вида функции, для которой будет строиться линия тренда. Поэтому, если для этой функции выбранный метод наиболее эффективен, то это совсем не означает, что он также будет оптимальным и в другой ситуации.
Если вы пока не можете сразу определить, основываясь на вышеприведенных рекомендациях, какой вид аппроксимации подойдет конкретно в вашем случае, то есть смысл попробовать все методы. После построения линии тренда и просмотра её уровня достоверности можно будет выбрать оптимальный вариант.
Контрольная работа: Парная регрессия
Смысл регрессионного анализа – построение функциональных зависимостей между двумя группами переменных величин Х1 , Х2 , … Хр и Y. При этом речь идет о влиянии переменных Х (это будут аргументы функций) на значения переменной Y (значение функции). Переменные Х мы будем называть факторами, а Y – откликом.
Наиболее простой случай – установление зависимости одного отклика y от одного фактора х. Такой случай называется парной (простой) регрессией.
Парная регрессия – уравнение связи двух переменных у иx :

где у – зависимая переменная (результативный признак);
х – независимая, объясняющая переменная (признак-фактор).
Различают линейные и нелинейные регрессии.
Линейная регрессия:
Нелинейные регрессии делятся на два класса: регрессии, нелинейные относительно включенных в анализ объясняющих переменных, но линейные по оцениваемым параметрам, и регрессии, нелинейные по оцениваемым параметрам.
Регрессии, нелинейные по объясняющим переменным:
• полиномы разных степеней
•равносторонняя гипербола
Регрессии, нелинейные по оцениваемым параметрам:
• степенная 
• показательная
• экспоненциальная
Построение уравнения регрессии сводится к оценке ее параметров. Для оценки параметров регрессий, линейных по параметрам, используют метод наименьших квадратов (МНК). МНК позволяет получить такие оценки параметров, при которых сумма квадратов отклонений фактических значений результативного признака у от теоретических 
Для линейных и нелинейных уравнений, приводимых к линейным, решается следующая система относительно а и b :
Можно воспользоваться готовыми формулами, которые вытекают из этой системы:
Тесноту связи изучаемых явлений оценивает линейный коэффициент парной корреляции 
и индекс корреляции 

Оценку качества построенной модели даст коэффициент (индекс) детерминации, а также средняя ошибка аппроксимации.
Средняя ошибка аппроксимации – среднее отклонение расчетных значений от фактических:
Допустимый предел значений 
Средний коэффициент эластичности 
Задача дисперсионного анализа состоит в анализе дисперсии зависимой переменной:
где 


Долю дисперсии, объясняемую регрессией, в общей дисперсии результативного признака у характеризует коэффициент (индекс) детерминации R 2 :

Коэффициент детерминации – квадрат коэффициента или индекса корреляции.
F -тест – оценивание качества уравнения регрессии – состоит в проверке гипотезы Но о статистической незначимости уравнения регрессии и показателя тесноты связи. Для этого выполняется сравнение фактического Fфакт и критического (табличного) Fтабл значений F -критерия Фишера. F факт определяется из соотношения значений факторной и остаточной дисперсий, рассчитанных на одну степень свободы:
п – число единиц совокупности;
т – число параметров при переменных х.
Fтабл – это максимально возможное значение критерия под влиянием случайных факторов при данных степенях свободы и уровне значимости а. Уровень значимости а – вероятность отвергнуть правильную гипотезу при условии, что она верна. Обычно а принимается равной 0,05 или 0,01.
Если Fтабл Fфакт , то гипотеза Н0 не отклоняется и признается статистическая незначимость, ненадежность уравнения регрессии.
Для оценки статистической значимости коэффициентов регрессии и корреляции рассчитываются t -критерий Стьюдента и доверительные интервалы каждого из показателей. Выдвигается гипотеза Н0 о случайной природе показателей, т.е. о незначимом их отличии от нуля. Оценка значимости коэффициентов регрессии и корреляции с помощью f-критерия Стьюдента проводится путем сопоставления их значений с величиной случайной ошибки:
Случайные ошибки параметров линейной регрессии и коэффициента корреляции определяются по формулам:
Сравнивая фактическое и критическое (табличное) значения t-статистики – tтабл и tфакт – принимаем или отвергаем гипотезу Hо .
Связь между F-критерием Фишера и t-статистикой Стьюдента выражается равенством
Если tтабл tфакт , то гипотеза Но не отклоняется и признается случайная природа формирования a , b или 
Для расчета доверительного интервала определяем предельную ошибку ∆ для каждого показателя:
Формулы для расчета доверительных интервалов имеют следующий вид:
Если в границы доверительного интервала попадает ноль, т.е. нижняя граница отрицательна, а верхняя положительна, то оцениваемый параметр принимается нулевым, так как он не может одновременно принимать и положительное, и отрицательное значения.
Прогнозное значение 




и строится доверительный интервал прогноза:

По 22 регионам страны изучается зависимость розничной продажи телевизоров, y от среднедушевых денежных доходов в месяц, x (табл. 1):
| Название: Парная регрессия Раздел: Рефераты по математике Тип: контрольная работа Добавлен 13:41:57 15 апреля 2011 Похожие работы Просмотров: 3780 Комментариев: 22 Оценило: 4 человек Средний балл: 4.5 Оценка: неизвестно Скачать |
| № региона | X | Y |
| 1,000 | 2,800 | 28,000 |
| 2,000 | 2,400 | 21,300 |
| 3,000 | 2,100 | 21,000 |
| 4,000 | 2,600 | 23,300 |
| 5,000 | 1,700 | 15,800 |
| 6,000 | 2,500 | 21,900 |
| 7,000 | 2,400 | 20,000 |
| 8,000 | 2,600 | 22,000 |
| 9,000 | 2,800 | 23,900 |
| 10,000 | 2,600 | 26,000 |
| 11,000 | 2,600 | 24,600 |
| 12,000 | 2,500 | 21,000 |
| 13,000 | 2,900 | 27,000 |
| 14,000 | 2,600 | 21,000 |
| 15,000 | 2,200 | 24,000 |
| 16,000 | 2,600 | 34,000 |
| 17,000 | 3,300 | 31,900 |
| 19,000 | 3,900 | 33,000 |
| 20,000 | 4,600 | 35,400 |
| 21,000 | 3,700 | 34,000 |
| 22,000 | 3,400 | 31,000 |
1. Постройте поле корреляции и сформулируйте гипотезу о форме связи.
2. Рассчитайте параметры уравнений линейной, степенной, экспоненциальной, полулогарифмической, обратной, гиперболической парной регрессий.
3. Оцените тесноту связи с помощью показателей корреляции и детерминации.
4. С помощью среднего (общего) коэффициента эластичности дайте сравнительную оценку силы связи фактора с результатом.
5. Качество уравнений оцените с помощью средней ошибки аппроксимации.
6. С помощью F-критерия Фишера определите статистическую надежность результатов регрессионного моделирования. Выберите лучшее уравнение регрессии и дайте его обоснование.
7. Рассчитайте прогнозное значение результата по линейному уравнению регрессии, если прогнозное значение фактора увеличится на 7% от его среднего уровня. Определите доверительный интервал прогноза для уровня значимости α=0,05.
8. Оцените полученные результаты, выводы оформите в аналитической записке.
1. Поле корреляции для:
· Линейной регрессии y=a+b*x:
Гипотеза о форме связи: чем больше размер среднедушевого денежного дохода в месяц (факторный признак), тем больше при прочих равных условиях розничная продажа телевизоров (результативный признак). В данной модели параметр b называется коэффициентом регрессии и показывает, насколько в среднем отклоняется величина результативного признака у при отклонении величины факторного признаках на одну единицу.
· Степенной регрессии 
Гипотеза о форме связи : степенная функция имеет вид Y=ax b .
Параметр b степенного уравнения называется показателем эластичности и указывает, на сколько процентов изменится у при возрастании х на 1%. При х = 1 a = Y.
· Экспоненциальная регрессия 
· Равносторонняя гипербола 
Гипотеза о форме связи: В ряде случаев обратная связь между факторным и результативным признаками может быть выражена уравнением гиперболы: Y=a+b/x.
· Обратная гипербола 
· Полулогарифмическая регрессия 
2. Рассчитайте параметры уравнений линейной, степенной, экспоненциальной, полулогарифмической, обратной, гиперболической парной регрессий.
· Рассчитаем параметры уравнений линейной парной регрессии. Для расчета параметров a и b линейной регрессии y=a+b*x решаем систему нормальных уравнений относительно a и b:
По исходным данным рассчитываем ∑y, ∑x, ∑yx, ∑x 2 , ∑y 2 (табл. 2):
| № региона | X | Y | XY | X^2 | Y^2 | Y^cp | Y-Y^cp | Ai |
| 1 | 2,800 | 28,000 | 78,400 | 7,840 | 784,000 | 25,719 | 2,281 | 0,081 |
| 2 | 2,400 | 21,300 | 51,120 | 5,760 | 453,690 | 22,870 | -1,570 | 0,074 |
| 3 | 2,100 | 21,000 | 44,100 | 4,410 | 441,000 | 20,734 | 0,266 | 0,013 |
| 4 | 2,600 | 23,300 | 60,580 | 6,760 | 542,890 | 24,295 | -0,995 | 0,043 |
| 5 | 1,700 | 15,800 | 26,860 | 2,890 | 249,640 | 17,885 | -2,085 | 0,132 |
| 6 | 2,500 | 21,900 | 54,750 | 6,250 | 479,610 | 23,582 | -1,682 | 0,077 |
| 7 | 2,400 | 20,000 | 48,000 | 5,760 | 400,000 | 22,870 | -2,870 | 0,144 |
| 8 | 2,600 | 22,000 | 57,200 | 6,760 | 484,000 | 24,295 | -2,295 | 0,104 |
| 9 | 2,800 | 23,900 | 66,920 | 7,840 | 571,210 | 25,719 | -1,819 | 0,076 |
| 10 | 2,600 | 26,000 | 67,600 | 6,760 | 676,000 | 24,295 | 1,705 | 0,066 |
| 11 | 2,600 | 24,600 | 63,960 | 6,760 | 605,160 | 24,295 | 0,305 | 0,012 |
| 12 | 2,500 | 21,000 | 52,500 | 6,250 | 441,000 | 23,582 | -2,582 | 0,123 |
| 13 | 2,900 | 27,000 | 78,300 | 8,410 | 729,000 | 26,431 | 0,569 | 0,021 |
| 14 | 2,600 | 21,000 | 54,600 | 6,760 | 441,000 | 24,295 | -3,295 | 0,157 |
| 15 | 2,200 | 24,000 | 52,800 | 4,840 | 576,000 | 21,446 | 2,554 | 0,106 |
| 16 | 2,600 | 34,000 | 88,400 | 6,760 | 1156,000 | 24,295 | 9,705 | 0,285 |
| 17 | 3,300 | 31,900 | 105,270 | 10,890 | 1017,610 | 29,280 | 2,620 | 0,082 |
| 19 | 3,900 | 33,000 | 128,700 | 15,210 | 1089,000 | 33,553 | -0,553 | 0,017 |
| 20 | 4,600 | 35,400 | 162,840 | 21,160 | 1253,160 | 38,539 | -3,139 | 0,089 |
| 21 | 3,700 | 34,000 | 125,800 | 13,690 | 1156,000 | 32,129 | 1,871 | 0,055 |
| 22 | 3,400 | 31,000 | 105,400 | 11,560 | 961,000 | 29,992 | 1,008 | 0,033 |
| Итого | 58,800 | 540,100 | 1574,100 | 173,320 | 14506,970 | 540,100 | 0,000 | |
| сред значение | 2,800 | 25,719 | 74,957 | 8,253 | 690,808 | 0,085 | ||
| станд. откл | 0,643 | 5,417 |
Система нормальных уравнений составит:

· Рассчитаем параметры уравнений степенной парной регрессии. Построению степенной модели 

Для расчетов используем данные табл. 3:
| № рег | X | Y | XY | X^2 | Y^2 | Yp^cp | y^cp |
| 1 | 1,030 | 3,332 | 3,431 | 1,060 | 11,104 | 3,245 | 25,67072 |
| 2 | 0,875 | 3,059 | 2,678 | 0,766 | 9,356 | 3,116 | 22,56102 |
| 3 | 0,742 | 3,045 | 2,259 | 0,550 | 9,269 | 3,004 | 20,17348 |
| 4 | 0,956 | 3,148 | 3,008 | 0,913 | 9,913 | 3,183 | 24,12559 |
| 5 | 0,531 | 2,760 | 1,465 | 0,282 | 7,618 | 2,827 | 16,90081 |
| 6 | 0,916 | 3,086 | 2,828 | 0,840 | 9,526 | 3,150 | 23,34585 |
| 7 | 0,875 | 2,996 | 2,623 | 0,766 | 8,974 | 3,116 | 22,56102 |
| 8 | 0,956 | 3,091 | 2,954 | 0,913 | 9,555 | 3,183 | 24,12559 |
| 9 | 1,030 | 3,174 | 3,268 | 1,060 | 10,074 | 3,245 | 25,67072 |
| 10 | 0,956 | 3,258 | 3,113 | 0,913 | 10,615 | 3,183 | 24,12559 |
| 11 | 0,956 | 3,203 | 3,060 | 0,913 | 10,258 | 3,183 | 24,12559 |
| 12 | 0,916 | 3,045 | 2,790 | 0,840 | 9,269 | 3,150 | 23,34585 |
| 13 | 1,065 | 3,296 | 3,509 | 1,134 | 10,863 | 3,275 | 26,4365 |
| 14 | 0,956 | 3,045 | 2,909 | 0,913 | 9,269 | 3,183 | 24,12559 |
| 15 | 0,788 | 3,178 | 2,506 | 0,622 | 10,100 | 3,043 | 20,97512 |
| 16 | 0,956 | 3,526 | 3,369 | 0,913 | 12,435 | 3,183 | 24,12559 |
| 17 | 1,194 | 3,463 | 4,134 | 1,425 | 11,990 | 3,383 | 29,4585 |
| 19 | 1,361 | 3,497 | 4,759 | 1,852 | 12,226 | 3,523 | 33,88317 |
| 20 | 1,526 | 3,567 | 5,443 | 2,329 | 12,721 | 3,661 | 38,90802 |
| 21 | 1,308 | 3,526 | 4,614 | 1,712 | 12,435 | 3,479 | 32,42145 |
| 22 | 1,224 | 3,434 | 4,202 | 1,498 | 11,792 | 3,408 | 30,20445 |
| итого | 21,115 | 67,727 | 68,921 | 22,214 | 219,361 | 67,727 | 537,270 |
| сред зн | 1,005 | 3,225 | 3,282 | 1,058 | 10,446 | 3,225 | |
| стан откл | 0,216 | 0,211 |
Рассчитаем С и b:
Получим линейное уравнение: 
Подставляя в данное уравнение фактические значения х, получаем теоретические значения результата y .
· Рассчитаем параметры уравнений экспоненциальной парной регрессии. Построению экспоненциальной модели 

Для расчетов используем данные табл. 4:
| № региона | X | Y | XY | X^2 | Y^2 | Yp | y^cp |
| 1 | 2,800 | 3,332 | 9,330 | 7,840 | 11,104 | 3,225 | 25,156 |
| 2 | 2,400 | 3,059 | 7,341 | 5,760 | 9,356 | 3,116 | 22,552 |
| 3 | 2,100 | 3,045 | 6,393 | 4,410 | 9,269 | 3,034 | 20,777 |
| 4 | 2,600 | 3,148 | 8,186 | 6,760 | 9,913 | 3,170 | 23,818 |
| 5 | 1,700 | 2,760 | 4,692 | 2,890 | 7,618 | 2,925 | 18,625 |
| 6 | 2,500 | 3,086 | 7,716 | 6,250 | 9,526 | 3,143 | 23,176 |
| 7 | 2,400 | 2,996 | 7,190 | 5,760 | 8,974 | 3,116 | 22,552 |
| 8 | 2,600 | 3,091 | 8,037 | 6,760 | 9,555 | 3,170 | 23,818 |
| 9 | 2,800 | 3,174 | 8,887 | 7,840 | 10,074 | 3,225 | 25,156 |
| 10 | 2,600 | 3,258 | 8,471 | 6,760 | 10,615 | 3,170 | 23,818 |
| 11 | 2,600 | 3,203 | 8,327 | 6,760 | 10,258 | 3,170 | 23,818 |
| 12 | 2,500 | 3,045 | 7,611 | 6,250 | 9,269 | 3,143 | 23,176 |
| 13 | 2,900 | 3,296 | 9,558 | 8,410 | 10,863 | 3,252 | 25,853 |
| 14 | 2,600 | 3,045 | 7,916 | 6,760 | 9,269 | 3,170 | 23,818 |
| 15 | 2,200 | 3,178 | 6,992 | 4,840 | 10,100 | 3,061 | 21,352 |
| 16 | 2,600 | 3,526 | 9,169 | 6,760 | 12,435 | 3,170 | 23,818 |
| 17 | 3,300 | 3,463 | 11,427 | 10,890 | 11,990 | 3,362 | 28,839 |
| 19 | 3,900 | 3,497 | 13,636 | 15,210 | 12,226 | 3,526 | 33,978 |
| 20 | 4,600 | 3,567 | 16,407 | 21,160 | 12,721 | 3,717 | 41,140 |
| 21 | 3,700 | 3,526 | 13,048 | 13,690 | 12,435 | 3,471 | 32,170 |
| 22 | 3,400 | 3,434 | 11,676 | 11,560 | 11,792 | 3,389 | 29,638 |
| Итого | 58,800 | 67,727 | 192,008 | 173,320 | 219,361 | 67,727 | 537,053 |
| сред зн | 2,800 | 3,225 | 9,143 | 8,253 | 10,446 | ||
| стан откл | 0,643 | 0,211 |
Рассчитаем С и b:
Получим линейное уравнение: 

Для расчета теоретических значений y подставим в уравнение 
· Рассчитаем параметры уравнений полулогарифмической парной регрессии. Построению полулогарифмической модели 

Для расчетов используем данные табл. 5:
| № региона | X | Y | XY | X^2 | Y^2 | y^cp |
| 1 | 1,030 | 28,000 | 28,829 | 1,060 | 784,000 | 26,238 |
| 2 | 0,875 | 21,300 | 18,647 | 0,766 | 453,690 | 22,928 |
| 3 | 0,742 | 21,000 | 15,581 | 0,550 | 441,000 | 20,062 |
| 4 | 0,956 | 23,300 | 22,263 | 0,913 | 542,890 | 24,647 |
| 5 | 0,531 | 15,800 | 8,384 | 0,282 | 249,640 | 15,525 |
| 6 | 0,916 | 21,900 | 20,067 | 0,840 | 479,610 | 23,805 |
| 7 | 0,875 | 20,000 | 17,509 | 0,766 | 400,000 | 22,928 |
| 8 | 0,956 | 22,000 | 21,021 | 0,913 | 484,000 | 24,647 |
| 9 | 1,030 | 23,900 | 24,608 | 1,060 | 571,210 | 26,238 |
| 10 | 0,956 | 26,000 | 24,843 | 0,913 | 676,000 | 24,647 |
| 11 | 0,956 | 24,600 | 23,506 | 0,913 | 605,160 | 24,647 |
| 12 | 0,916 | 21,000 | 19,242 | 0,840 | 441,000 | 23,805 |
| 13 | 1,065 | 27,000 | 28,747 | 1,134 | 729,000 | 26,991 |
| 14 | 0,956 | 21,000 | 20,066 | 0,913 | 441,000 | 24,647 |
| 15 | 0,788 | 24,000 | 18,923 | 0,622 | 576,000 | 21,060 |
| 16 | 0,956 | 34,000 | 32,487 | 0,913 | 1156,000 | 24,647 |
| 17 | 1,194 | 31,900 | 38,086 | 1,425 | 1017,610 | 29,765 |
| 19 | 1,361 | 33,000 | 44,912 | 1,852 | 1089,000 | 33,351 |
| 20 | 1,526 | 35,400 | 54,022 | 2,329 | 1253,160 | 36,895 |
| 21 | 1,308 | 34,000 | 44,483 | 1,712 | 1156,000 | 32,221 |
| 22 | 1,224 | 31,000 | 37,937 | 1,498 | 961,000 | 30,406 |
| Итого | 21,115 | 540,100 | 564,166 | 22,214 | 14506,970 | 540,100 |
| сред зн | 1,005 | 25,719 | 26,865 | 1,058 | 690,808 | |
| стан откл | 0,216 | 5,417 |
Рассчитаем a и b:
Получим линейное уравнение: 
· Рассчитаем параметры уравнений обратной парной регрессии. Для оценки параметров приведем обратную модель 

Для расчетов используем данные табл. 6:
| № региона | X | Y | XY | X^2 | Y^2 | Y^cp |
| 1 | 2,800 | 0,036 | 0,100 | 7,840 | 0,001 | 24,605 |
| 2 | 2,400 | 0,047 | 0,113 | 5,760 | 0,002 | 22,230 |
| 3 | 2,100 | 0,048 | 0,100 | 4,410 | 0,002 | 20,729 |
| 4 | 2,600 | 0,043 | 0,112 | 6,760 | 0,002 | 23,357 |
| 5 | 1,700 | 0,063 | 0,108 | 2,890 | 0,004 | 19,017 |
| 6 | 2,500 | 0,046 | 0,114 | 6,250 | 0,002 | 22,780 |
| 7 | 2,400 | 0,050 | 0,120 | 5,760 | 0,003 | 22,230 |
| 8 | 2,600 | 0,045 | 0,118 | 6,760 | 0,002 | 23,357 |
| 9 | 2,800 | 0,042 | 0,117 | 7,840 | 0,002 | 24,605 |
| 10 | 2,600 | 0,038 | 0,100 | 6,760 | 0,001 | 23,357 |
| 11 | 2,600 | 0,041 | 0,106 | 6,760 | 0,002 | 23,357 |
| 12 | 2,500 | 0,048 | 0,119 | 6,250 | 0,002 | 22,780 |
| 13 | 2,900 | 0,037 | 0,107 | 8,410 | 0,001 | 25,280 |
| 14 | 2,600 | 0,048 | 0,124 | 6,760 | 0,002 | 23,357 |
| 15 | 2,200 | 0,042 | 0,092 | 4,840 | 0,002 | 21,206 |
| 16 | 2,600 | 0,029 | 0,076 | 6,760 | 0,001 | 23,357 |
| 17 | 3,300 | 0,031 | 0,103 | 10,890 | 0,001 | 28,398 |
| 19 | 3,900 | 0,030 | 0,118 | 15,210 | 0,001 | 34,844 |
| 20 | 4,600 | 0,028 | 0,130 | 21,160 | 0,001 | 47,393 |
| 21 | 3,700 | 0,029 | 0,109 | 13,690 | 0,001 | 32,393 |
| 22 | 3,400 | 0,032 | 0,110 | 11,560 | 0,001 | 29,301 |
| Итого | 58,800 | 0,853 | 2,296 | 173,320 | 0,036 | 537,933 |
| сред знач | 2,800 | 0,041 | 0,109 | 8,253 | 0,002 | |
| стан отклон | 0,643 | 0,009 |
Рассчитаем a и b:
Получим линейное уравнение: 

Для расчета теоретических значений y подставим в уравнение 
· Рассчитаем параметры уравнений равносторонней гиперболы парной регрессии. Для оценки параметров приведем модель равносторонней гиперболы 

Для расчетов используем данные табл. 7:
| № региона | X=1/z | Y | XY | X^2 | Y^2 | Y^cp |
| 1 | 0,357 | 28,000 | 10,000 | 0,128 | 784,000 | 26,715 |
| 2 | 0,417 | 21,300 | 8,875 | 0,174 | 453,690 | 23,259 |
| 3 | 0,476 | 21,000 | 10,000 | 0,227 | 441,000 | 19,804 |
| 4 | 0,385 | 23,300 | 8,962 | 0,148 | 542,890 | 25,120 |
| 5 | 0,588 | 15,800 | 9,294 | 0,346 | 249,640 | 13,298 |
| 6 | 0,400 | 21,900 | 8,760 | 0,160 | 479,610 | 24,227 |
| 7 | 0,417 | 20,000 | 8,333 | 0,174 | 400,000 | 23,259 |
| 8 | 0,385 | 22,000 | 8,462 | 0,148 | 484,000 | 25,120 |
| 9 | 0,357 | 23,900 | 8,536 | 0,128 | 571,210 | 26,715 |
| 10 | 0,385 | 26,000 | 10,000 | 0,148 | 676,000 | 25,120 |
| 11 | 0,385 | 24,600 | 9,462 | 0,148 | 605,160 | 25,120 |
| 12 | 0,400 | 21,000 | 8,400 | 0,160 | 441,000 | 24,227 |
| 13 | 0,345 | 27,000 | 9,310 | 0,119 | 729,000 | 27,430 |
| 14 | 0,385 | 21,000 | 8,077 | 0,148 | 441,000 | 25,120 |
| 15 | 0,455 | 24,000 | 10,909 | 0,207 | 576,000 | 21,060 |
| 16 | 0,385 | 34,000 | 13,077 | 0,148 | 1156,000 | 25,120 |
| 17 | 0,303 | 31,900 | 9,667 | 0,092 | 1017,610 | 29,857 |
| 19 | 0,256 | 33,000 | 8,462 | 0,066 | 1089,000 | 32,564 |
| 20 | 0,217 | 35,400 | 7,696 | 0,047 | 1253,160 | 34,829 |
| 21 | 0,270 | 34,000 | 9,189 | 0,073 | 1156,000 | 31,759 |
| 22 | 0,294 | 31,000 | 9,118 | 0,087 | 961,000 | 30,374 |
| Итого | 7,860 | 540,100 | 194,587 | 3,073 | 14506,970 | 540,100 |
| сред знач | 0,374 | 25,719 | 9,266 | 0,146 | 1318,815 | |
| стан отклон | 0,079 | 25,639 |
Рассчитаем a и b:
Получим линейное уравнение: 

3. Оценка тесноты связи с помощью показателей корреляции и детерминации :
· Линейная модель. Тесноту линейной связи оценит коэффициент корреляции. Был получен следующий коэффициент корреляции rxy =b

· Степенная модель. Тесноту нелинейной связи оценит индекс корреляции. Был получен следующий индекс корреляции 

· Экспоненциальная модель. Был получен следующий индекс корреляции ρxy =0,8124, что говорит о том, что связь прямая и очень сильная, но немного слабее, чем в линейной и степенной моделях. Коэффициент детерминации r²xy =0,66. Это означает, что 66% вариации результативного признака (розничнаяпродажа телевизоров, у) объясняется вариацией фактора х – среднедушевой денежный доход в месяц.
· Полулогарифмическая модель. Был получен следующий индекс корреляции ρxy =0,8578, что говорит о том, что связь прямая и очень сильная, но немного больше чем в предыдущих моделях. Коэффициент детерминации r²xy =0,7358. Это означает, что 73,58% вариации результативного признака (розничнаяпродажа телевизоров, у) объясняется вариацией фактора х – среднедушевой денежный доход в месяц.
· Гиперболическая модель. Был получен следующий индекс корреляции ρxy =0,8448 и коэффициент корреляции rxy =-0,1784 что говорит о том, что связь обратная очень сильная. Коэффициент детерминации r²xy =0,7358. Это означает, что 73,5% вариации результативного признака (розничнаяпродажа телевизоров, у) объясняется вариацией фактора х – среднедушевой денежный доход в месяц.
· Обратная модель. Был получен следующий индекс корреляции ρxy =0,8114 и коэффициент корреляции rxy =-0,8120, что говорит о том, что связь обратная очень сильная. Коэффициент детерминации r²xy =0,6584. Это означает, что 65,84% вариации результативного признака (розничнаяпродажа телевизоров, у) объясняется вариацией фактора х – среднедушевой денежный доход в месяц.
Вывод: по полулогарифмическому уравнению получена наибольшая оценка тесноты связи: ρxy =0,8578 (по сравнению с линейной, степенной, экспоненциальной, гиперболической, обратной регрессиями).
4. С помощью среднего (общего) коэффициента эластичности дайте сравнительную оценку силы связи фактора с результатом.
Рассчитаем коэффициент эластичности для линейной модели:
· Для уравнения прямой:y = 5,777+7,122∙x
· Для уравнениястепенноймодели 
· Для уравненияэкспоненциальноймодели
Для уравненияполулогарифмическоймодели 
· Для уравнения обратной гиперболической модели 
· Для уравнения равносторонней гиперболической модели 
Сравнивая значения 
·
·
·
·
·
·
Известно, что коэффициент эластичности показывает связь между фактором и результатом, т.е. на сколько% изменится результат y от своей средней величины при изменении фактора х на 1% от своего среднего значения. В данном примере получилось, что самая большая сила связи между фактором и результатом в полулогарифмической модели, слабая сила связи в обратной гиперболической модели.
5. Оценка качества уравнений с помощью средней ошибки аппроксимации.
Подставляя в уравнение регрессии фактические значения х, определим теоретические (расчетные) значения 

В среднем расчетные значения отклоняются от фактических на:
· Линейная регрессия. 

Качество построенной модели оценивается как хорошее, так как 
· Степенная регрессия. 

Качество построенной модели оценивается как хорошее, так как 
· Экспоненциальная регрессия. 

Качество построенной модели оценивается как хорошее, так как 
· Полулогарифмическая регрессия. 

Качество построенной модели оценивается как хорошее, так как 
· Гиперболическая регрессия. 

Качество построенной модели оценивается как хорошее, так как 
· Обратная регрессия. 

Качество построенной модели оценивается как хорошее, так как 
6. Рассчитаем F-критерий:
· Линейная регрессия. 

источники:
http://welom.ru/srednyaya-oshibka-approksimacii-v-excel-ocenka-kachestva-uravneniya/
http://www.bestreferat.ru/referat-268496.html
Вариант
5
1
задание
-
Постройте
поле корреляции и сформулируйте гипотезу
о форме связи.
-
Введу
значения Y
и X
в таблицу, отсортирую их по возрастанию
по X:Y
X
68,77
70,5
64,19
70,64
65,78
70,93
63,35
71,61
67,67
73,37
60,95
75,93
61,21
76,31
65,96
76,37
67,47
76,72
61,13
77,18
65,55
77,43
62,47
77,79
64,53
78,38
66,67
78,5
64,81
78,75
69,68
79,3
61,5
79,38
61,57
79,69
-
Построю
поле корреляции по данным из таблицы:
-
Сказать
о форме связи достаточно тяжело, потому
что точки располагаются неравномерно.
Возможно, здесь линейная форма связи.
-
Рассчитайте
параметры уравнения линейной регрессии.
-
Чтобы
рассчитать параметры уравнения линейной
регрессии, необходимо написать само
уравнение: y=ax+b,
а также нужно записать формулу для
коэффициентов а и b.
-
Введу
в таблицу новые показатели: x*y,
x^2,
сумму, среднее значение и рассчитаю
их, а затем по формулам рассчитаю
коэффициенты а и b.
|
|
||||
|
|
||||
-
Оцените
тесноту связи с помощью показателей
корреляции и детерминации.
-
С
помощью формулы линейного коэффициента
парной корреляции определю тесноту
связи
R=-0,221
-
Коэффициент
детерминации – это коэффициент
корреляции в квадрате.
Он
равен = 0,049
Вывод:
связь слабая.
-
Оцените
с помощью средней ошибки аппроксимации
качество уравнений.
Средняя
ошибка аппроксимации – среднее отклонение
расчетных значений от фактических:
Для
данных расчётов мне необходимо значение

которое в Excel
назову y(t).
По формуле рассчитала показатель А.
Средняя
ошибка аппроксимации равна 3,5%. Величина
ошибки аппроксимации говорит о высоком
качестве модели.
-
Оцените
с помощью F -критерия Фишера и t -критерия
Стьюдента статистическую значимость
результатов регрессионного моделирования.
-
Рассчитаю
F-критерий
Фишера по формулам
Критическое
значение рассчитала по специальной
статистической формуле в Excel
F.ОБР.ПХ.
(вероятность 0,05; степени свободы1 =1;
степени свободы2 = 16). F(критич)
= 4,49
Фактическое
значение рассчитала по формуле:

где n-
количество исследуемых точек.
F
(фактич) = 0,78
Так
как F
(критич) больше F
(фактич), то можно сделать вывод, что
уравнение связи является статистически
незначимым.
-
Рассчитаю
критический t-критерий
Стьюдента по статистической формуле
в Excel
СТЬЮДЕНТ.ОБР.2Х (вероятность = 0,05; степени
свободы (18-2) =16). t (критич) = 2,12.
Фактическое
значение считаю для каждого параметра:
Параметр
а:
,
Параметр
b:
Параметр
r:
t(a)
= -0,01
t(b)
= 1,16
t(r
) = -0,91
Так
как все фактические критерии параметров
меньше критического t-критерия,
значит все параметры статистически не
значимые.
-
По
значениям характеристик, рассчитанным
в пп. 3-5, выберите лучшее уравнение
регрессии и дайте его обоснование.
Наше
уравнение линейной регрессии обладает
такими свойствами:
-
Связь
слабая (по коэффициенту парной корреляции) -
Высокое
качество модели (по средней ошибке
аппроксимации) -
Уравнение
связи и все его параметры являются
статистически незначимыми (на основании
F-критерия
Фишера и t-критерия
Стьюдента)
-
Рассчитайте
прогнозное значение результата, если
значение фактора увеличится на 10% от
его среднего уровня. Определите
доверительный интервал прогноза для
уровня значимости α= 0,05
Прогнозное
значение
определяется путём подстановки в
уравнение регрессии
соответствующего (прогнозного) значения

Вычисляется средняя стандартная ошибка
прогноза
:
где
и
строится доверительный интервал
прогноза:
-
Найду
прогнозное значение результативного
фактора
при значении признака-фактора,
составляющем 110% от среднего уровня
-
Найду
доверительный интервал прогноза. Ошибка
прогноза
Доверительный
интервал рассчитывается:

Здесь:
(двухстороннее значение t-критерия
Стьюдента): t
(0,05; 18-2) = 2,12
Доверительный
интервал: (63,16- 9,81*2,12; 63,16+ 9,81*2,12) = (42,38;
83,95)
Истинное
значение прогноза (63,16) попадает в этот
интервал.
2
задание
Разработайте
план погашения кредита, полученного на
следующих условиях: Сумма кредита – Р
тысяч рублей, срок кредита – n лет,
процентная ставка по кредиту – i% годовых,
количество платежей в год –m раз. Данные
для каждого варианта приводятся в
таблице ниже:
|
Сумма |
Срок |
Процентная |
Количество |
|
675 |
5 |
28 |
1 |
-
Составлю
таблицу «План погашения кредита»
|
№ п/п |
Сумма |
Годовая |
Процентные |
Осталось |
-
Для
начала рассчитаю сумму ежегодного
платежа (тыс. руб.). Для этого выберу
финансовую функцию ПЛТ в Excel:
ПЛТ(28%; В3; А3; 0; 0)
Ежегодный
платёж на протяжении 5-ти лет будет
равным. Поэтому можно рассчитать общую
сумму выплат (долг + проценты) и переплату:
-
Общая
сумма выплат = сумма ежегодного платежа
* срок кредита = 266, 59 тыс. р. * 5 лет = 1332,94
тыс. р. -
Переплата
составит = общая сумма выплат – сумма
кредита = 1332,59 тыс. р. – 675 тыс. р. = 657, 94
тыс. р.
-
Рассчитаю
годовую выплату основного долга:
Для
этого использую функцию ОСПЛТ в Excel:
ОСПЛТ (28%; период; $B$3;
$A$3;
0) – период соответственно каждой строке
(1-5)
Годовая
выплата по кредиту для каждого года
составила:
-
Далее
рассчитаю сколько процентных платежей
уплачивается за каждый период. Для
этого из суммы ежегодного платежа вычту
годовую выплату основного долга
(результаты этих вычислений на фото
таблицы Excel
выше). -
Чтобы
посчитать последний столбец «осталось
выплатить» проделаю следующую операцию:
-
для
первого периода: =$A$3+СУММ($C$6:C6), где $A$3
– первоначальная сумма кредита, $C$6:C6
– годовая выплата основного долга в
рассматриваемый период; -
для
второго периода: =$E$6+СУММ($C$7:C7), где $E$6
– осталось выплатить в предыдущем
периоде; -
для
остальных периодов первое слагаемое
будет равно «осталось выплатить» в
предыдущем периоде, а второе слагаемое
– годовая выплата основного долга в
рассматриваемом периоде.
В
конце последнего периода «осталось
выплатить» становится равным 0, так как
мы полностью погасили долг.
План
погашения кредита разработан.
3
задание
-
определить
оптимальный план выпуска, максимизирующий
прибыль; -
насколько
изменится оптимальное решение, если
продукция будет измеряться в шт.
(целочисленное). -
насколько
изменится оптимальное решение, если
задана нижняя граница плана выпуска
по каждому изделию (договорные
обязательства) -
Провести
анализ чувствительности оптимального
решения.
|
Нормы |
Запасы |
||||
|
Изделие |
Изделие |
Изделие |
Изделие |
||
|
Сырьё |
5 |
1 |
8 |
7 |
745 |
|
Сырьё |
1 |
5 |
5 |
6 |
610 |
|
Сырьё |
7 |
5 |
7 |
4 |
768 |
|
Цена |
7 |
6 |
9 |
14 |
-
Составлю
таблицу в Excel:
создала сроку «коэф. цф», где написала
коэффициенты переменных из первого
уравнения и столбец «знач. цф». Через
функцию СУММПРОИЗВ посчитала «знач.
цф». Затем, нажав ячейку «знач. цф»,
нажму «поиск решения» и введу ограничения,
а также выберу метод поиска решений.
Таким образом определила оптимальный
план выпуска, максимизирующий прибыль.
-
Для
ответа на второй вопрос задачи оставлю
эту же таблицу. В графе поиска решений
добавлю ограничение на значения
переменных – они должны быть целыми.
Значение переменных изменится
незначительно (округлится до целых
чисел), а в столбце на пересечении стоки
«огранич» и столбца «знач. цф» произойдут
изменения с 745 до 741 (на 4 ед.) и с 768 до 764
(на 4 ед.)
-
Задам
произвольную нижнюю границу: 1 и добавлю
это условие в ограничения на поиск
решений. При этом значения переменных
изменятся следующим образом:
Х1
уменьшится на 3 ед., Х2 уменьшится на 3
ед., Х3 увеличится на 1 ед., Х4 увеличится
на 2 ед.
-
Отчёты:
Согласно
отчёту о результатах все ресурсы являются
дефицитными (состояние – привязка).
Согласно
отчёту об устойчивости:
Х1: допустимое
увеличение =6,741, допустимое уменьшение
= 0,172
Х2: допустимое увеличение =6,894,
допустимое уменьшение = 0,217
Х3:
допустимое увеличение =5,306, допустимое
уменьшение = 1Е+30
Х4: допустимое увеличение
=0,208, допустимое уменьшение = 7,271.
F10:
допустимое увеличение =348, 774, допустимое
уменьшение = 242,896
F11:
допустимое увеличение =620,75, допустимое
уменьшение = 306,26
F9:
допустимое увеличение =185,368, допустимое
уменьшение = 496,6
Соседние файлы в предмете Компьютерный практикум
- #
20.03.201819.8 Кб2691 курс КП 11.xlsx
- #
20.03.201836.24 Кб1601 курс КП 6.xlsx
- #
20.03.201821.95 Кб1111 курс КП 8.xlsx
- #
20.03.201822.76 Кб1361 курс КП 9.xlsx
- #
1. Настройка пакета для выполнения регрессионного анализа
Процедуры корреляционно-регрессионного анализа выполняются в табличном процессоре с помощью модуля «Пакет анализа». Для подключения этого модуля с помощью команды СЕРВИС – НАДСТРОЙКИ выведите окно НАДСТРОЙКИ и включите надстройку ПАКЕТ АНАЛИЗА.
Рис. 11. Диалоговое окно Надстройки меню Сервис.
После выполнения этой процедуры в ниспадающем меню пункта СЕРВИС появится команда АНАЛИЗ ДАННЫХ.
Рис. 12. Лист ППП «Excel» пункт меню Сервис команда Анализ данных.
2. Расчет показателей описательной статистики
Для проверки требований, предъявляемых к исходным данным, следует рассчитать ряд показателей, характеризующих эти данные (среднее значение, дисперсия и т. д.). Эти характеристики данных можно получить, воспользовавшись функцией СЕРВИС — АНАЛИЗ ДАННЫХ – ОПИСАТЕЛЬНАЯ СТАТИСТИКА.
Рис. 13. Диалоговое окно АНАЛИЗ ДАННЫХ.
После выбора требуемой функции откроется окно ОПИСАТЕЛЬНАЯ СТАТИСТИКА.
Рис. 14. Диалоговое окно ОПИСАТЕЛЬНАЯ статистика.
Для расчета показателей описательной статистики в окне «Входной интервал» укажите область ячеек электронной таблицы, где расположены анализируемые данные (исследуемый показатель и все факторы). Желательно в эту область включить ячейки с обозначениями переменных (Х0, Х1, …, Хр) для комфортного восприятия результатов вычислений. Если метки данных (обозначения переменных) учтены, то в области ВХОДНЫЕ ДАННЫЕ включите опцию «Метки в первой строке». Затем в области «Параметры вывода» укажите, куда должны быть выведены результаты расчетов (Новый лист либо Выходной интервал И верхняя левая ячейка области электронной таблицы, где должны быть размещены результаты).
В области «Параметры вывода» включите опцию «Итоговая статистика» и выполните процедуру.
В полученных результатах расчетов удалите повторяющуюся информацию (многократное повторение названий статистик) и рассчитайте для каждого показателя коэффициенты вариации (по среднему значению и стандартному отклонению).
3. Выявление тесноты связи и закона зависимости между факторами и результирующим показателем (анализ полей корреляции)
Для построения полей корреляции (диаграмм рассеивания) используйте команду ВСТАВКА – ДИАГРАММА – ТОЧЕЧНАЯ (вариант без соединения точек) либо мастер диаграмм. В результате выполнения этой команды появится окно МАСТЕР ДИАГРАММ (шаг 2 из 4):
Рис. 15. Диалоговое окно Мастера диаграмм.
В окне Диапазон укажите область столбца электронной таблицы, где находится массив данных для фактора, и через точку с запятой область данных по результирующему показателю. Щелкните мышкой по кнопке ДАЛЕЕ. В результате появится окно следующего 3 шага. В соответствующих окнах введите заголовок графика и названия осей; разместите график на рабочем листе. Постройте графики, отражающие влияние каждого фактора на исследуемый показатель.
Рис. 16. Диалоговое окно Мастера диаграмм – Параметры диаграммы.
Элементы корреляционной матрицы получите, воспользовавшись функцией СЕРВИС — АНАЛИЗ ДАННЫХ — КОРРЕЛЯЦИЯ. В результате будет открыто окно АНАЛИЗ ДАННЫХ.
Рис. 17. Диалоговое окно Анализ данных.
После выбора требуемой функции откроется окно КОРРЕЛЯЦИЯ.
Рис. 18. Диалоговое окно Корреляция.
В окне «Входной интервал» задайте область ячеек электронной таблицы, где расположены анализируемые данные (исследуемый показатель и все факторы). В эту область так же включите ячейки с обозначениями переменных (Х0, Х1, …, Хр). Если метки учтены в области данных, то в окне КОРРЕЛЯЦИЯ включите опцию «Метки в первой строке». Затем в области «Параметры вывода» укажите левую верхнюю ячейку области электронной таблицы, куда должна быть выведена корреляционная матрица.
Анализируя корреляционную матрицу, сделайте выводы о том, как сильно связаны факторы между собой и с исследуемым показателем. Если обнаружены коллинеарные (мультиколлинеарные) факторы, то для дальнейшего анализа следует оставить только один из этих факторов. Проводя анализ взаимосвязей показателей по корреляционной матрице, необходимо помнить о том, что парные коэффициенты корреляции — это показатели тесноты связи для линейных зависимостей.
4. Расчет параметров регрессионной модели
Вид регрессионной модели обосновывают двумя путями: теоретическим и эмпирическим. В первом случае используют качественные рассуждения о законе связи между исследуемым показателем и каждым из факторов, а также результаты других исследователей по построению аналогичных регрессионных моделей. При эмпирическом подходе выводы о форме связи делают на основе анализа фактических данных, представленных в виде первичных полей корреляции.
Чаще всего для анализа используют линейный вид модели или модель, которую можно привести к линейному виду путем некоторых преобразований и замены переменных.
Для расчета параметров регрессионной модели воспользуйтесь функцией СЕРВИС — АНАЛИЗ ДАННЫХ — РЕГРЕССИЯ. В результате появится окно АНАЛИЗ ДАННЫХ. В этом окне выберите инструмент анализа РЕГЕРССИЯ.
Рис. 19. Диалоговое окно Анализ данных.
После щелчка мышкой по кнопке ОК на экране появится окно РЕГРЕССИЯ.
Рис. 20. Диалоговое окно Регрессия.
В этом окне в области «Входной интервал Y» укажите область ячеек, где находятся данные исследуемого показателя, в области «Входной интервал X» — область ячеек с данными по всем факторам. Желательно при этом учитывать обозначения переменных. Если метки данных включены при определении области переменных, то включите опцию «Метки».
Чтобы получить данные для расчета средней относительной ошибки аппроксимации, в этом диалоговом окне поставьте флажок рядом с опцией ОСТАТКИ.
В результате использования функции СЕРВИС — АНАЛИЗ ДАННЫХ — РЕГРЕССИЯ будут получены не только параметры модели, но и показатели, позволяющие оценить надежность построенной модели.
5. Исключение из модели факторов, оказывающих несущественной влияние
Все факторы, влияние которых на исследуемый показатель несущественно, должны быть исключены из модели. Влияние фактора следует считать несущественным, если соответствующий коэффициент регрессии статистически не значим, то есть его можно приравнять нулю. Коэффициент регрессии следует считать статистически значимым (не равным нулю), если фактическая величина критерия Стьюдента будет больше табличного значения этого критерия. Табличное значение критерия Стьюдента можно найти, воспользовавшись в Excel мастером функций
.
После обращения к мастеру функций на экране появится окно «Мастер функций – шаг 1 из 2».
Рис. 21. Диалоговое окно Мастера функций.
В левой части этого окна выберите категорию функций «Статистические», в правой части, используя бегунок, выберите функцию «СТЬЮДРАСПРОБР» и щелкните мышкой по кнопке ОК. В результате появится окно для задания параметров этой функции. В этом окне «Вероятность» – уровень значимости (
= 1-
, где
— доверительная вероятность).
Рис. 22. Диалоговое окно функции Стьюдраспобр.
Уровень значимости обычно принимают равным 0,05; число степеней свободы
=
(где
— число наблюдений,
— число параметров регрессионной модели).
Если в модели присутствует несколько несущественных факторов, то первым следует исключить тот фактор, для которого табличное значение критерия Стьюдента намного больше
. Несущественно влияющий фактор убирают из совокупности наблюдений и пересчитывают параметры регресcионной модели и ее характеристики. Для модели, полученной на втором шаге, заново проверяют статистическую значимость коэффициентов регресcии. Если вновь обнаружен фактор, оказывающий несущественное влияние на анализируемый показатель, то этот фактор также исключают из модели. Отсев факторов из модели выполняют до тех пор, пока в ней останутся только факторы, оказывающие сильное влияние на
.
Чтобы убедиться в том, что из модели были исключены факторы, оказывающие слабое влияние на исследуемый показатель, сравните величины коэффициентов детерминации первого и последнего шагов. Их различие будет незначительным.
6. Проверка надежности регрессионной модели
Вывод о статистической значимости модели в целом делают по — критерию. Если фактическая величина критерия Фишера окажется больше табличного значения, то полученная модель статистически значима и полно описывает изменение исследуемого показателя под действием факторов, присутствующих в модели.
Теоретическое значение — критерия также можно получить с помощью мастера функций
. Для этого в окне «Мастер функций – шаг 1 из 2» следует выбрать функцию FРАСПОБР.
Рис. 23. Диалоговое окно Мастера функций.
В окне выбранной функции задайте требуемые параметры.
Рис. 24. Диалоговое окно функции Fраспобр.
«Вероятность» – уровень значимости (обычно принимают равным 0,05); «Число_степеней свободы1» — это число факторов, присутствующих в модели, «Число_степеней свободы2» определяют как разность между числом наблюдений и числом параметров модели.
Если Fрасч > Fтабл, то построенная модель считается статистически надежной, а следовательно, правильно отражает закон изменения исследуемого показателя под действием факторов, присутствующих в модели.
7. Проверка адекватности регрессионной модели
Среднюю относительную ошибку аппроксимации пользователь должен рассчитать самостоятельно по формуле 
фактические (расчетные) значения исследуемого показателя.
Если модель используют для целей анализа, допустима величина средней относительной ошибки до 10%, при применении модели для прогнозирования ошибка не должна быть больше 4%.
Для этого рядом с остатками следует добавить столбец фактических значений исследуемого показателя и выполнить ряд промежуточных расчетов.
8. Интерпретация полученных результатов
На этом этапе разрабатывают рекомендации об использовании результатов регрессионного анализа. Анализируют коэффициенты регрессии в натуральном и стандартизованном масштабе, а также коэффициенты эластичности.
Коэффициент регрессии в натуральном масштабе показывает, на сколько своих единиц измерения в среднем изменится исследуемый показатель
при увеличении
— го фактора на единицу своего измерения. При этом влияние остальных факторов находится на среднем уровне; свободный член уравнения характеризует изменение показателя за счет изменения факторов, неучтенных в модели.
В связи с тем, что факторы имеют различный физический смысл и различные единицы измерения, коэффициенты регрессии нельзя сравнивать между собой и, следовательно, невозможно определить, какой из факторов оказывает наибольшее влияние. Для устранения различий в единицах измерения применяют частные коэффициенты эластичности, рассчитываемые по формуле:

— средние значения
— го фактора и исследуемого показателя,
— коэффициент регрессии, стоящий при переменной
в многофакторном уравнении регрессии. Как известно, коэффициент эластичности характеризующие на сколько % в среднем изменится
При увеличении j-го фактора на 1% при фиксированном положении других факторов.
При определении степени влияния отдельных факторов необходим показатель, который бы учитывал влияние анализируемых факторов с учетом различий в уровне их колеблемости. Таким показателем является коэффициент регрессии в стандартизированном масштабе 
показывает на какую часть своего среднеквадратического отклонения изменится
при изменении j-го фактора на одно свое среднеквадратическое отклонение при фиксированном значении остальных факторов. Уравнение регрессии в стандартизированном масштабе :
где
Границы влияния фактора на исследуемый показатель рассчитываются по формуле (левая граница)
(правая граница), где
— доверительные полуинтервалы.
| < Предыдущая | Следующая > |
|---|
Здравствуйте на этой странице я собрала теорию и практику с примерами решения задач по предмету эконометрика с решением по каждой теме, чтобы вы смогли освежить знания!
Если что-то непонятно — вы всегда можете написать мне в WhatsApp и я вам помогу!
Эконометрика
Эконометрика — это наука, изучающая конкретные количественные и качественные взаимосвязи экономических объектов и процессов с помощью математических и статистических методов и моделей.
Эконометрика — эффективный инструмент научного анализа и моделирования в профессиональной деятельности экономиста, менеджера и инженера
Парная регрессия и корреляция
Парная регрессия — уравнение связи двух переменных 


где 

Различают линейные и нелинейные регрессии.
Линейная регрессия :
Нелинейные регрессии делятся на два класса: регрессии, нелинейные относительно включенных в анализ объясняющих переменных, но линейные по оцениваемым параметрам, и регрессии, нелинейные по оцениваемым параметрам.
Возможно эта страница вам будет полезна:
Регрессии, нелинейные по объясняющим переменным:
• полиномы разных степеней
• равносторонняя гипербола
Регрессии, нелинейные по оцениваемым параметрам’.
• степенная
• показательная
• экспоненциальная
Построение уравнения регрессии сводится к оценке ее параметров. Для оценки параметров регрессий, линейных по параметрам, используют метод наименьших квадратов (МНК). МНК позволяет получить такие оценки параметров, при которых сумма квадратов отклонений фактических значений результативного признака 


Для линейных и нелинейных уравнений, приводимых к линейным, решается следующая система относительно 


Можно воспользоваться готовыми формулами, которые вытекают из этой системы:

Тесноту связи изучаемых явлений оценивает линейный коэффициент парной корреляции 


и индекс корреляции 


Оценку качества построенной модели даст коэффициент (индекс) детерминации, а также средняя ошибка аппроксимации.
Средняя ошибка аппроксимации — среднее отклонение расчетных значений от фактических:

Допустимый предел значений 
Средний коэффициент эластичности 


Задача дисперсионного анализа состоит в анализе дисперсии зависимой переменной:

где 


Долю дисперсии, объясняемую регрессией, в общей дисперсии результативного признака у характеризует коэффициент (индекс) детерминации 

Коэффициент детерминации — квадрат коэффициента или индекса корреляции.







где 






Если 



Для оценки статистической значимости коэффициентов регрессии и корреляции рассчитываются 



Случайные ошибки параметров линейной регрессии и коэффициента корреляции определяются по формулам:

Сравнивая фактическое и критическое (табличное) значения 



Связь между 


Если 








Для расчета доверительного интервала определяем предельную ошибку 

Формулы для расчета доверительных интервалов имеют следующий вид:

Если в границы доверительного интервала попадает ноль, т.е. нижняя граница отрицательна, а верхняя положительна, то оцениваемый параметр принимается нулевым, так как он не может одновременно принимать и положительное, и отрицательное значения.
Прогнозное значение 




где


Пример задачи №1
По семи территориям Уральского района за 199Х г. известны значения двух признаков (табл. 1.1).

Требуется:
а)линейной;
б) степенной;
в) показательной;
г) равносторонней гиперболы.
Оценить каждую модель через среднюю ошибку аппроксимации 

Решение:
1а. Для расчета параметров 


решаем систему нормальных уравнений относительно 


По исходным данным рассчитываем

Уравнение регрессии:

С увеличением среднедневной заработной платы на 1 руб. доля расходов на покупку продовольственных товаров снижается в среднем на 0,35 %-ных пункта. Рассчитаем линейный коэффициент парной корреляции:

Связь умеренная, обратная.
Определим коэффициент детерминации:

Вариация результата на 12,7% объясняется вариацией фактора 




В среднем расчетные значения отклоняются от фактических на 8,1%.
Рассчитаем 

поскольку 
Полученное значение указывает на необходимость принять гипотезу 
- Построению степенной модели
предшествует процедура линеаризации переменных. В примере линеаризация производится путем логарифмирования обеих частей уравнения:


Для расчетов используем данные табл. 1.3.

Рассчитаем 


Получим линейное уравнение:

Выполнив его потенцирование, получим:

Подставляя в данное уравнение фактические значения 




Характеристики степенной модели указывают, что она несколько лучше линейной функции описывает взаимосвязь.
1в. Построению уравнения показательной кривой 

где

Для расчетов используем данные табл. 1.4.
Значения параметров регрессии 


Получено линейное уравнение:

Произведем потенцирование полученного уравнения и запишем его в обычной форме:

Тесноту связи оценим через индекс корреляции 

Связь умеренная.

1г. Уравнение равносторонней гиперболы 


Для расчетов используем данные табл. 1.5.

Значения параметров регрессии 


Получено уравнение:

Индекс корреляции:





где

Следовательно, принимается гипотеза 
Пример задачи №2
По территориям региона приводятся данные за 199Х г. (табл. 1.6).

Требуется:
- Построить линейное уравнение парной регрессии у от х.
- Рассчитать линейный коэффициент парной корреляции и среднюю ошибку аппроксимации.
- Оценить статистическую значимость параметров регрессии и корреляции.
- Выполнить прогноз заработной платы у при прогнозном значении среднедушевого прожиточного минимумах, составляющем 107% от среднего уровня.
- Оценить точность прогноза, рассчитав ошибку прогноза и его доверительный интервал.
Решение:
- Для расчета параметров уравнения линейной регрессии строим расчетную таблицу (табл. 1.7).

Получено уравнение регрессии:

С увеличением среднедушевого прожиточного минимума на 1 руб. среднедневная заработная плата возрастает в среднем на 0,92 руб.
- Тесноту линейной связи оценит коэффициент корреляции:

Это означает, что 52% вариации заработной платы (


Качество построенной модели оценивается как хорошее, так как 
- Оценку статистической значимости параметров регрессии проведем с помощью
-статистики Стьюдента и путем расчета доверительного интервала каждого из показателей.
Выдвигаем гипотезу 



составит 2,23.
Определим случайные ошибки 
Тогда

Фактические значения 

поэтому гипотеза 


Рассчитаем доверительный интервал для 


Доверительные интервалы:

Анализ верхней и нижней границ доверительных интервалов приводит к выводу о том, что с вероятностью

параметры 

Полученные оценки уравнения регрессии позволяют использовать его для прогноза. Если прогнозное значение прожиточного минимума составит:

тогда прогнозное значение прожиточного минимума составит:

5. Ошибка прогноза составит:

Предельная ошибка прогноза, которая в 95% случаев не будет превышена, составит:

Доверительный интервал прогноза:

Выполненный прогноз среднемесячной заработной платы оказался надежным

но неточным, так как диапазон верхней и нижней границ доверительного интервала 

Пример задачи №3
По группе предприятий, производящих однородную продукцию, известно, как зависит себестоимость единицы продукции у от факторов, приведенных в табл. 1.8.
Требуется:
- Определить с помощью коэффициентов эластичности силу влияния каждого фактора на результат.
- Ранжировать факторы по силе влияния.
Решение:
- Для уравнения равносторонней гиперболы


Для уравнения прямой


Для уравнения степенной зависимости


Для уравнения показательной зависимости

Сравнивая значения 


Для формирования уровня себестоимости продукции фуппы предприятий первоочередное значение имеют цены на энергоносители; в гораздо меньшей степени влияют трудоемкость продукции и отчисляемая часть прибыли. Фактором снижения себестоимости выступает размер производства: с ростом его на 1% себестоимость единицы продукции снижается на -0,97%.
Пример задачи №4
Зависимость потребления продукта А от среднедушевого дохода по данным 20 семей характеризуется следующим образом:
уравнение регрессии

индекс корреляции

остаточная дисперсия

Требуется:
Провести дисперсионный анализ полученных результатов.
Решение:
Результаты дисперсионного анализа приведены в табл. 1.9.

В силу того что

гипотеза о случайности различий факторной и остаточной дисперсий отклоняется. Эти различия существенны, статистически значимы, уравнение надежно, значимо, показатель тесноты связи надежен и отражает устойчивую зависимость потребления продукта 
Реализация типовых задач в Excel
Решение с помощью ППП Excel
- Встроенная статистическая функция ЛИНЕЙН определяет параметры линейной регрессии
. Порядок вычисления следующий:
1) введите исходные данные или откройте существующий файл, содержащий анализируемые данные;
2) выделите область пустых ячеек 5×2 (5 строк, 2 столбца) для вывода результатов регрессионной статистики или область 1×2 — для получения только оценок коэффициентов регрессии;
3) активизируйте Мастер функций любым нз способов:
а) в главном меню выберите Вставка/Функция;
б) на панели инструментов Стандартная щелкните по кнопке Вставка функции;
4) в окне Категория (рис. 1.1) выберите Статистические, в окне Функция — ЛИНЕЙН. Щелкните по кнопке ОК;

5) заполните аргументы функции (рис. 1.2):
Известные значенияу — диапазон, содержащий данные результативного признака;
Известные значения_х — диапазон, содержащий данные факторов независимого признака;
Константа — логическое значение, которое указывает на наличие или на отсутствие свободного члена в уравнении; если Константа = 1, то свободный член рассчитывается обычным образом, если Константа = 0, то свободный член равен 0; Статистика — логическое значение, которое указывает, выводить дополнительную информацию по регрессионному анализу или нет. Если Статистика = 1, то дополнительная информация выводится, если Статистика — 0, то выводятся только оценки параметров уравнения. Щелкните по кнопке ОК;
6) в левой верхней ячейке выделенной области появится первый элемент итоговой таблицы. Чтобы раскрыть всю таблицу, нажмите на клавишу 

Дополнительная регрессионная статистика будет выводиться в порядке, указанном в следующей схеме:
Для вычисления параметров экспоненциальной кривой 
Для данных из примера 2 результат вычисления функции ЛИНЕЙН представлен на рис. 1.3, функции ЛГРФПРИБЛ — на рис. 1.4.

- С помощью инструмента анализа данных Регрессия, помимо результатов регрессионной статистики, дисперсионного анализа и доверительных интервалов, можно получить остатки и графики подбора линии регрессии, остатков и нормальной вероятности. Порядок действий следующий:
1) проверьте доступ к пакету анализа. В главном меню последовательно выберите Сервис /Надстройки. Установите флажок Пакет анализа (рис. 1.5);
2) в главном меню выберите Сервис/Анализ данных/Регрессия. Щелкните по кнопке ОК;
3) заполните диалоговое окно ввода данных и параметров вывода (рис. 1.6):
Входной интервал 
Входной интервал 
Метки — флажок, который указывает, содержит ли первая строка названия столбцов или нет;
Константа — ноль — флажок, указывающий на наличие или отсутствие свободного члена в уравнении;
Выходной интервал — достаточно указать левую верхнюю ячейку будущего диапазона;
Новый рабочий лист — можно задать произвольное имя нового листа.
Если необходимо получить информацию и графики остатков, установите соответствующие флажки в диалоговом окне. Щелкните по кнопке ОК.

Результаты регрессионного анализа для данных из примера 2 представлены на рис. 1.7.

Решение с помощью ППП Statgraphics
Порядок вычислений при использовании функции Simple Regression следующий:
1) введите исходные данные (рис. 1.8) или откройте существующий файл, содержащий исходные данные;
2) в главном меню последовательно выберите Relate/Simple Regression;
3) заполните диалоговое окно ввода данных. В поле «

4) в окне табличных настроек поставьте флажок напротив Analysis Summary.
Результаты вычислений появятся в отдельном окне. Для данных из примера 2 результат применения функции Simple Regression представлен на рис. 1.9.
Как видим, результаты вычислений вручную и с помощью компьютера совпадают.
Возможно эта страница вам будет полезна:
Множественная регрессия и корреляция
Множественная регрессия — уравнение связи с несколькими независимыми переменными:

где 

Для построения уравнения множественной регрессии чаще используются следующие функции:
• линейная —

• степенная —

• экспонента —

• гипербола —

Можно использовать и другие функции, приводимые к линейному виду.
Для оценки параметров уравнения множественной регрессии применяют метод наименьших квадратов (МНК). Для линейных уравнений и нелинейных уравнений, приводимых к линейным, строится следующая система нормальных уравнений, решение которой позволяет получить оценки параметров регрессии:

Для ее решения может быть применен метод определителей:

где

определитель системы.

Другой вид Уравнения множественной регрессии — уравнение регрессии в стандартизованном масштабе:

у-у
где 

К уравнению множественной регрессии в стандартизованном масштабе применим МНК. Стандартизованные коэффициенты регрессии (

Связь коэффициентов множественной регрессии 


Параметр 

Средние коэффициенты эластичности для линейной регрессии рассчитываются по формуле

Для расчета частных коэффициентов эластичности применяется следующая формула:

Тесноту совместного влияния факторов на результат оценивает индекс множественной корреляции:

Значение индекса множественной корреляции лежит в пределах от 0 до 1 и должно быть больше или ранно максимальному парному индексу корреляции:

Индекс множественной корреляции для уравнения в стандартизованном масштабе можно записать и виде

При линейной зависимости коэффициент множественной корреляции можно определить через матрицу парных коэффициентов корреляции:

где

определитель матрицы парных коэффициентов корреляии;

определитель матрицы межфакторной корреляции.
Частные коэффициенты (или индексы) корреляции, измеряющие влияние на у фактора 

или по рекуррентной формуле:
Частные коэффициенты корреляции изменяются в пределах от —1 до 1.
Качество построенной модели в целом оценивает коэффициент (индекс) детерминации. Коэффициент множественной детерминации рассчитывается как квадрат индекса множественной корреляции:

Скорректированный индекс множественной детерминации содержит поправку на число степеней свободы и рассчитывается по формуле

где 

Значимость уравнения множественной регрессии в целом оценивается с помощью 

Частный 



Оценка значимости коэффициентов чистой регрессии с помощью 

где 


При построении уравнения множественной регрессии может возникнуть проблема мупьтиколлинеарности факторов, их тесной линейной связанности.
Считается, что две переменные явно коллинеарны, т.е. находятся между собой в линейной зависимости, если 
По величине парных коэффициентов корреляции обнаруживается лишь явная коллинеарность факторов. Наибольшие трудности в использовании аппарата множественной регрессии возникают при наличии мультиколлинеарности факторов. Чем сильнее мультикол-линеарность факторов, тем менее надежна оценка распределения суммы объясненной вариации по отдельным факторам с помощью метода наименьших квадратов.
Для оценки мультиколлинеарности факторов может использоваться определитель матрицы парных коэффициентов корреляции между факторами.
Если бы факторы не коррелировали между собой, то матрица парных коэффициентов корреляции между факторами была бы единичной матрицей, поскольку все недиагональные элементы 

матрица коэффициентов корреляции между факторами имела бы определитель, равный 1:

так как

Если же наоборот, между факторами существует полная линейная зависимость и все коэффициенты корреляции равны 1, то определитель такой матрицы равен 0:

Чем ближе к 0 определитель матрицы межфакторной корреляции, тем сильнее мультиколлинеарность факторов и ненадежнее результаты множественной регрессии. И наоборот, чем ближе к 1 определитель матрицы межфакторной корреляции, тем меньше мультиколлинеарность факторов.
Проверка мультиколлинеарности факторов может быть проведена методом испытания гипотезы о независимости переменных

Доказано, что величина

имеет приближенное распределение

степенями свободы. Если фактическое значение 



Для применения МНК требуется, чтобы дисперсия остатков была гомоскедастичной. Это значит, что для каждого значения фактора 

При нарушении гомоскедастичности мы имеем неравенства

При малом объеме выборки для оценки гетероскедастичности может использоваться метод Гольдфельда Кнандта. Основная идея теста Гольдфельда — Квандта состоит в следующем:
1) упорядочение и наблюдений по мере возрастания переменной 
2) исключение из рассмотрения 


3) разделение совокупности из 

4) определение остаточной суммы киндратов для первой 


При выполнении нулевой гипотезы о гомоскедастичности отношение 




Уравнения множественной регрессии могут включать в качестве независимых переменных качественные признаки (например, профессия, пол, образование, климатические условия, отдельные регионы и т.д.). Чтобы ввести такие переменные в регрессионную модель, их необходимо упорядочить и присвоить им те или иные значения, т.е. качественные переменные преобразовать в количественные.
Такого вида сконструированные переменные принято в эконометрике называть фиктивными переменными. Например, включать в модель фактор «пол» в виде фиктивной переменной можно в следующем виде:

Коэффициент регрессии при фиктивной переменной интерпретируется как среднее изменение зависимой переменной при переходе от одной категории (женский пол) к другой (мужской пол) при неизменных значениях остальных параметров. На основе 
Пример задачи №5
По 30 территориям России имеются данные, представленные в табл. 2.1.

Требуется:
- Построить уравнение множественной регрессии в стандартизованной и естественной форме; рассчитать частные коэффициенты эластичности, сравнить их с
и
пояснить различия между ними.
- Рассчитать линейные коэффициенты частной корреляции и коэффициент множественной корреляции, сравнить их с линейными коэффициентами парной корреляции, пояснить различия между ними.
- Рассчитать общий и частные
-критерии Фишера.
Решение:
Линейное уравнение множественной регрессии 



Для расчета его параметров применим метод стандартизации переменных и построим искомое уравнение в стандартизованном масштабе:

Расчет 

Получим уравнение

Для построения уравнения в естественной форме рассчитаем 




Значение а определим из соотношения

Для характеристики относительной силы влияния 



С увеличением средней заработной платы 






Различия в силе влияния фактора на результат, полученные при сравнении 




- Линейные коэффициенты частной корреляции здесь рассчитываются по рекуррентной формуле:

Если сравнить значения коэффициентов парной и частной корреляции, то приходим к выводу, что из-за слабой межфакторной связи 

Расчет линейного коэффициента множественной корреляции выполним с использованием коэффициентов 


Зависимость 




Сравнивая 


С вероятностью 



Частные 










Сравнивая 



Гипотезу 




Целесообразность включения в модель фактора 



Низкое значение 






Пример задачи №6
По 20 территориям России изучаются следующие данные (табл. 2.2): зависимость среднегодового душевого дохода у (тыс. руб.) от доли занятых тяжелым физическим трудом в общей численности занятых 

Требуется:
- Составить таблицу дисперсионного анализа для проверки при уровне значимости
статистической значимости уравнения множественной регрессии и его показателя тесноты связи.
- С помощью частных
-критериев Фишера оценить, насколько целесообразно включение в уравнение множественной регрессии фактора
после фактора
и насколько целесообразно включение
после
.
- Оценить с помощью
-критерия Стыодента статистическую значимость коэффициентов при переменных
и
множественного уравнения регрессии.
Решение:
- Задача дисперсионного анализа состоит в проверке нулевой гипотезы
о статистической незначимости уравнения регрессии в целом и показателя тесноты связи.
Анализ выполняется при сравнении фактического и табличного (критического) значений 

определяется из соотношения значений факторной и остаточной дисперсий, рассчитанных на одну степень свободы:

где 



Результаты дисперсионного анализа представлены в табл. 2.3.
Сравнивая 


Возможно эта страница вам будет полезна:

Результаты дисперсионного анализа представлены в табл. 2.4.
Включение фактора 



Аналогично проверим целесообразность включения в модель дополнительного фактора 



В силу того что

приходим к выводу, что включение 




Табличные (критические) значения 




В нашем примере при

Сравнивая 



приходим к заключению, что величина 


Возможно эта страница вам будет полезна:
Пример задачи №7
Зависимость спроса на свинину 



Требуется:
- Представить данное уравнение в естественной форме (не в логарифмах).
- Оценить значимость параметров данного уравнения, если известно, что
-критерий для параметра
при
составил 0,827, а для параметра
при
— 1,015.
Решение:
- Представленное степенное уравнение множественной регрессии приводим к естественной форме путём потенцирования обеих частей уравнения:

Значения коэффициентов регрессии 





Спрос на свинину 

- Это весьма небольшие значения
-критерия, которые свидетельствуют о случайной природе взаимосвязи, о статистической ненадежности всего уравнения, поэтому применять полученное уравнение для прогноза не рекомендуется.
Возможно эта страница вам будет полезна:
Пример задачи №8
По 20 предприятиям региона (табл. 2.5) изучается зависимость выработки продукции на одного работника у (тыс. руб.) от ввода в действие новых основных фондов 

Требуется:
- Оценить показатели вариации каждого признака и сделать вывод о возможностях применения МНК для их изучения.
- Проанализировать линейные коэффициенты парной и частной корреляции.
- Написать уравнение множественной регрессии, оценить значимость его параметров, пояснить их экономический смысл.
- С помощью
-критерия Фишера оценить статистическую надежность уравнения регрессии и
. Сравнить значения скорректированного и нескорректированного линейных коэффициентов множественной детерминации.
- С помощью частных
-критериев Фишера оценить целесообразность включения в уравнение множественной регрессии фактора
после
и фактора
после
.
- Рассчитать средние частные коэффициенты эластичности и дать на их основе сравнительную оценку силы влияния факторов на результат.
Возможно эта страница вам будет полезна:
Реализация типовых задач в Excel
- Решение примера проведем с использованием ППП MS Excel и Statgraphics.
Решение с помощью ППП Excel
Сводную таблицу основных статистических характеристик для одного или нескольких массивов данных можно получить с помощью инструмента анализа данных Описательная статистика. Для этого выполните следующие шаги:
1) введите исходные данные или откройте существующий файл, содержащий анализируемые данные;
2) в главном меню выберите последовательно пункты Сервис / Анализ данных / Описательная статистика, после чего щелкните по кнопке ОК;
3) заполните диалоговое окно ввода данных и параметров вывода (рис. 2.1):
Входной интервал — диапазон, содержащий анализируемые данные, это может быть одна или несколько строк (столбцов); Группирование — по столбцам или по строкам — необходимо указать дополнительно;
Метки — флажок, который указывает, содержит ли первая строка названия столбцов или нет;
Выходной интервал — достаточно указать левую верхнюю ячейку будущего диапазона;
Новый рабочий лист — можно задать произвольное имя нового листа.
Если необходимо получить дополнительную информацию Итоговой статистики, Уровня надежности, k-го наибольшего и наименьшего значений, установите соответствующие флажки в диалоговом окне. Щелкните по кнопке ОК.
Результаты вычисления соответствующих показателей для каждого признака представлены на рис. 2.2.
Решение с помощью ППП Statgraphics
Для проведения многофакторного анализа в ППП Statgraphics используется пункт меню Multiple Variable Analysis. Для получения показателей описательной статистики необходимо проделать следующие операции:
1) ввести исходные данные или открыть существующий файл, содержащий анализируемые данные;
2) в главном меню выбрать Describe/Numeric Data/Multiple Variable Analysis;
3) заполнить диалоговое окно ввода данных (рис. 2.3). Ввести названия всех столбцов, значения которых вы хотите включить в анализ; щелкнуть по кнопке ОК;
4) в окне табличных настроек поставить флажок напротив Summary Statistics (рис. 2.4). Итоговая статистика — показатели вариации -появится в отдельном окне.
Для данных примера 4 результат применения функции Multiple Variable Analysis представлен на рис. 2.5.
Сравнивая значения средних квадратических отклонений и средних величин и определяя коэффициенты вариации:
приходим к выводу о повышенном уровне варьирования признаков, хотя и в допустимых пределах, не превышающих 35%. Совокупность предприятий однородна, и для ее изучения могут использоваться метод наименьших квадратов и вероятностные методы оценки статистических гипотез.
- Значения линейных коэффициентов парной корреляции определяют тесноту попарно связанных переменных, использованных в данном уравнении множественной регрессии. Линейные коэффициенты частной корреляции оценивают тесноту связи значений двух переменных, исключая влияние всех других переменных, представленных в уравнении множественной регрессии.
Решение с помощью ППП Excel
К сожалению, в ППП MS Excel нет специального инструмента для расчета линейных коэффициентов частной корреляции. Матрицу парных коэффициентов корреляции переменных можно рассчитать, используя инструмент анализа данных Корреляция. Для этого:
1) в главном меню последовательно выберите пункты Сервис / Анализ данных / Корреляция. Щелкните по кнопке ОК;
2) заполните диалоговое окно ввода данных и параметров вывода (см. рис. 2.1);
3) результаты вычислений — матрица коэффициентов парной корреляции — представлены на рис. 2.6.
Решение с помощью ППП Stat graphics
При проведении многофакторного анализа — Multiple Variable Analysis — вычисляются линейные коэффициенты парной корреляции и линейные коэффициенты частной корреляции. Последовательность операций описана в п.1 этого примера. Для отображения результатов вычисления на экране необходимо установить флажки напротив Correlations и Partial Correlations в окне табличных настроек (рис. 2.7).
В результате получим матрицы коэффициентов парной и частной корреляции (рис. 2.8).
Значения коэффициентов парной корреляции указывают на весьма тесную связь выработки у как с коэффициентом обновления основных фондов — 

Но в то же время межфакторная связь 



Коэффициенты частной корреляции дают более точную характеристику тесноты связи двух признаков, чем коэффициенты парной корреляции, так как очищают парную зависимость от взаимодействия данной пары признаков с другими признаками, представленными в модели. Наиболее тесно связаны 


связь 


а межфакторная зависимость 




Все это приводит к выводу о необходимости исключить фактор 
Если сравнить коэффициенты парной и частной корреляции, то можно увидеть, что из-за высокой межфакторной зависимости коэффициенты парной корреляции дают завышенные оценки тесноты связи:

Именно по этой причине рекомендуется при наличии сильной коллинеарности (взаимосвязи) факторов исключать из исследования тот фактор, у которого теснота парной зависимости меньше, чем теснота межфакторной связи.
- Вычисление параметров линейного уравнения множественной регрессии.
Решение с помощью ППП Excel
Эта операция проводится с помощью инструмента анализа данных Регрессия. Она аналогична расчету параметров парной линейной регрессии, описанной в 1-м разделе практикума, только в отличие от парной регрессии в диалоговом окне при заполнении параметра входной интервал и следует указать не один столбец, а все столбцы, содержащие значения факторных признаков. Результаты анализа представлены на рис. 2.9.
Для вычисления параметров множестнсшшП регрессии можно использовать процедуру Multiple Regression. Дни »нно:
1) введите исходные данные или откройте сущее i иун>щи11 файл;
2) в главном меню последовательно выберите Heinle / Multiple Regression;
3) заполните диалоговое окно ввода данных. II ноне Depended Variable введите название столбца, содержащею шичпш» зависимой переменной, в поле Independed Variable — нашими* i ишбцов, содержащих значения факторов. Щелкните по кнопке ОК
Результаты вычисления функции Multiple КсЦ1 гм1«ш появятся в отдельном окне (рис. 2.10).
По результатам вычислений составим урцниемн* множественной регрессии вида

Значения случайных ошибок параметров 

Они показывают, какое значение данной характеристики сформировалось под влиянием случайных факторов. Эти значения используются для расчета 

Если значения 




На это же указывает показатель вероятности случайных значений параметров регрессии: если а меньше принятого нами уровня (обычно 0,1; 0,05 или 0,01; это соответствует 10%; 5% или 1% вероятности), делают вывод о неслучайной природе данного значения параметра, т.е. о том, что он статистически значим и надежен. В противном случае принимается гипотеза о случайной природе значения коэффициентов уравнения. Здесь

что позволяет рассматривать 
Величина 


Величины 



Оценку надежности уравнения регрессии в целом и показателя тесноты связи 


По данным таблиц дисперсионного анализа, представленным на рис. 2.9 и 2.10, 



Значения скорректированного и нескорремирпианпого линейных коэффициентов множественной детерминации приведены на рис. 2.9 и 2.10 в рамках регрессионной статистики.
Нескорректированный коэффициент множественной детерминации

оценивает долю вариации результата за счет представленных в уравнении фактором в общей вариации результата. Здесь эта доля составляет 94,7% и указывает на весьма высокую степень обусловленности вариации вариацией факторов, иными словами — на весьма теси> i факторов с результатом.
Скорректированный коэффициент множественной детерминации

определяет тесноту связи с учетом степеней свободы общей и остаточной дисперсий. Он дает такую оценку тесноты связи, которая не зависит от числа факторов и потому может сравниваться по разным моделям с разным что ном факторов. Оба коэффициента указывают на весьма высокую (Ооиес 90%) детерминированность результата в модели факторами.
1) введите исходные данные или откройте существующий файл;
2) в главном меню последовательно выберите пункты Relate / Multiple Regression;
3) заполните диалоговое окно ввода данных. В поле Depended Variable введите название столбца, содержащего значения зависимой переменной, в поле Independed Variable — названия столбцов, содержащих значения факторов, в том порядке, в котором будет проводиться анализ целесообразности включения факторов в модель. Чтобы оценить статистическую значимость включения в модель фактора 







4) в окне табличных настроек поставьте флажок напротив поля Conditional Sums of Squares.
Результаты вычисления показаны на рис. 2.11.
Частный 











Если поменять первоначальный порядок включения факторов в модель и рассмотреть вариант включения 




Вероятность его случайного формирования составила 0,04%, это значительно меньше принятого стандарта 





Общий вывод состоит в том, что множественная модель с факторами 


содержит неинформативный фактор 


более простым, хорошо детерминированным, ириголным для анализа и для прогноза.
- Средние частные коэффициенты эластичности показывают, на сколько процентов от значения своей средней изменяется результат при изменении фактора
на 1% от своей средней
и
при фиксированном воздействии на у всех прочих факторов, включенных в уравнение регрессии. Для линейной зависимости

где 


По значениям частных коэффициентов эластичности можно сделать вывод о более сильном влиянии на результат у признака фактора 

Возможно эта страница вам будет полезна:
Система эконометрических уравнений
Сложные экономические процессы описывают с помощью системы взаимосвязанных (одновременных) уравнений.
Различают несколько видов систем уравнений: • система независимых уравнений — когда каждая зависимая переменная 


Для решения этой системы и нахождения ее параметров используется метод наименьших квадратов;
• система рекурсивных уравнений — когда зависимая переменная 


Для решения этой системы и нахождения ее параметров используется метод наименьших квадратов;
• система взаимосвязанных (совместных) уравнений — когда одни и те же зависимые переменные в одних уравнениях входят в левую часть, а в других — в правую:

Такая система уравнений называется структурной формой модели.
Эндогенные переменные — взаимозависимые переменные, которые определяются внутри модели (системы) 
Экзогенные переменные — независимые переменные, которые определяются вне системы 
Предопределенные переменные — экзогенные и лаговые (за предыдущие моменты времени) эндогенные переменные системы.
Коэффициенты 

Система линейных функций эндогенных переменных от всех предопределенных переменных системы — приведенная форма модели.

где 
Необходимое условие идентификации — выполнение счетного правила:



где 

Достаточное условие идентификации — определитель матрицы, составленной из коэффициентов при переменных, отсутствующих в исследуемом уравнении, не равен нулю, и ранг этой матрицы не менее числа эндогенных переменных системы без единицы.
Для решения идентифицируемого уравнения применяется косвенный метод наименьших квадратов, для решения сверхидентифицированных — двухшаговый метод наименьших квадратов.
Косвенный МНК состоит в следующем:
• составляют приведенную форму модели и определяют численные значения параметров каждого ее уравнения обычным МНК;
• путем алгебраических преобразований переходят от приведенной формы к уравнениям структурной формы модели, получая тем самым численные оценки структурных параметров.
Двухшаговый МНК заключается в следующем:
• составляют приведенную форму модели и определяют численные значения параметров каждого ее уравнения обычным МНК;
• выявляют эндогенные переменные, находящиеся в правой части структурного уравнения, параметры которого определяют двухша-говым МНК, и находят расчетные значения по соответствующим уравнениям приведенной формы модели;
• обычным МНК определяют параметры структурного уравнения, используя в качестве исходных данных фактические значения предопределенных переменных и расчетные значения эндогенных переменных, стоящих в правой части данного структурного уравнения.
Пример задачи №9
Требуется:
- Оценить следующую структурную модель на идентификацию:

- Исходя из приведенной формы модели уравнений

найти структурные коэффициенты модели.
Решение:
Проверим каждое уравнение системы на необходимое (Н) и достаточное (Д) условия идентификации.
Первое уравнение. Н: эндогенных переменных — 

Д: в первом уравнений отсутствуют 


Определитель матрицы не равен 0, ранг матрицы равен 2; следовательно, выполняется достаточное условие идентификации, и первое уравнение точно идентифицируемо.
Второе уравнение.
Н: эндогенных переменных — 
Выполняется необходимое равенство: 3 = 2+ 1, следовательно, уравнение точно идентифицируемо.
Д: во втором уравнении отсутствуют 


Определитель матрицы не равен 0, ранг матрицы равен 2, следовательно, выполняется достаточное условие идентификации, и второе уравнение точно идентифицируемо.
Третье уравнение.
Н: эндогенных переменных — 

Выполняется необходимое равенство: 2=1 + 1, следовательно, уравнение точно идентифицируемо.
Д: в третьем уравнении отсутствуют 


Определитель матрицы не равен 0, ранг матрицы равен 2, следовательно, выполняется достаточное условие идентификации, и третье уравнение точно идентифицируемо.
Следовательно, исследуемая система точно идентифицируема и может быть решена косвенным методом наименьших квадратов.
- Вычислим структурные коэффициенты модели:
1)из третьего уравнения приведенной формы выразим 

Данное выражение содержит переменные 


2) во втором уравнении СФМ нет переменных 

Первый этап: выразим 

Подстановка данного выражения во второе уравнение ПФМ не решило бы задачу до конца, так как в выражении присутствует 
Выразим 

Подставим его в выражение 

Второй этап: аналогично, чтобы выразить 






Следовательно,

Подставим полученные 


Это уравнение можно получить из ПФМ иным путем. Суммируя все уравнения, получим

Далее из первого и второго уравнений ПФМ исключим домножив первое уравнение на 3, а второе — на (-2) и просуммировав их:

Затем аналогичным путем из полученных уравнений исключаем 

3) из второго уравнения ПФМ выразим 

Подставим полученное выражение в третье уравнение ПФМ:

Таким образом, СФМ примет вид

Пример задачи №10
Изучается модель вида

где 




Информация за девять лет о приростах всех показателей дана в табл. 3.1*.
Для данной модели была получена система приведенных уравнений:

Требуется:
- Провести идентификацию модели.
- Рассчитать параметры первого уравнения структурной модели.
Решение:
В данной модели две эндогенные переменные ( и ) и две экзогенные переменные ( и ). Второе уравнение точно идентифицировано, так как содержит две эндогенные переменные и не содержит одну экзогенную переменную из системы. Иными словами, для второго уравнения имеем по счетному правилу идентификации равенство: 2=1 + 1.
Первое уравнение сверхидентифицировано, так как в нем на параметры при 





- Для определения параметров сверхидентифицированной модели используется двухшаговый метод наименьших квадратов.
Шаг 1. На основе системы приведенных уравнений по точно идентифицированному второму уравнению определим теоретические значения эндогенной переменной 

подставим значения 


Шаг 2. По сверхидентифицированному уравнению структурной формы модели заменяем фактические значения 



Далее к сверхидентифицированному уравнению применяется метод наименьших квадратов. Обозначим новую переменную 



Система нормальных уравнений составит:

Итак, первое уравнение структурной модели будет таким:

Пример задачи №11
Имеются данные за 1990-1994 гг. (табл. 3.3).

Требуется: Построить модель вида

рассчитав соответствующие структурные коэффициенты.
Решение:
Система одновременных уравнений с двумя эндогенными и двумя экзогенными переменными имеет вид

В каждом уравнении две эндогенные и одна отсутствующая экзогенная переменная из имеющихся в системе. Для каждого уравнения данной системы действует счетное правило 2=1 + 1. Это означает, что каждое уравнение и система в целом идентифицированы.
Для определения параметров такой системы применяется косвенный метод наименьших квадратов.
С этой целью структурная форма модели преобразуется в приведенную форму:

в которой коэффициенты при 
Для нахождения значений 


При ее решении предполагается, что 


Применительно к ней необходимые суммы оказываются следующими:

Система нормальных уравнений составит:

Решая ее, получим:

Итак, имеем

Аналогично строим систему нормальных уравнений для определения коэффициентов 


Следовательно,

тогда второе уравнение примет вид

Приведенная форма модели имеет вид

Из приведенной формы модели определяем коэффициенты структурной модели:

Итак, структурная форма модели имеет вид

Пример задачи №12
Рассматривается следующая модель:

где

Требуется:
- В предположении, что имеются временные ряды данных по всем переменным модели, предложите способ оценки ее параметров.
- Как изменится ваш ответ на вопрос п. 1, если из модели исключить тождество дохода?
Решение:
- Модель представляет собой систему одновременных уравнений. Для ответа на вопрос о способе оценки параметров модели проверим каждое ее уравнение на идентификацию.
Модель включает четыре эндогенные переменные 




Проверим необходимое условие идентификации для уравнений модели уравнение.
Это уравнение включает две эндогенные переменные 

II уравнение.
Уравнение II включает две эндогенные переменные, 
III уравнение.
Уравнение III тоже включает две эндогенные переменные и не включает три предопределенные переменные. Это уравнение сверхидентифицировано.
IV уравнение.
Уравнение IV представляет собой тождество, параметры которого известны. Необходимости в его идентификации нет.
Проверим для каждого из уравнений достаточное условие идентификации. Для этого составим матрицу коэффициентов при переменных модели:

В соответствии с достаточным условием идентификации определитель матрицы коэффициентов при переменных, не входящих в исследуемое уравнение, не должен быть равен нулю, а ранг матрицы должен быть равен числу эндогенных переменных модели минус 1, т.е. 4-1=3.
I уравнение.
Матрица коэффициентов при переменных, не входящих в уравнение, имеет вид

Ее ранг равен 3, так как определитель квадратной подматрицы 3×3 этой матрицы не равен нулю:

Достаточное условие идентификации для I уравнения выполняется.
II уравнение.
Выпишем матрицу коэффициентов при переменных, не входящих в уравнение:

Ее ранг равен трем, так как определитель квадратной подматрицы 3 х 3 этой матрицы не равен нулю:

Достаточное условие идентификации для II уравнения выполняется.
Ill уравнение.
Выпишем матрицу коэффициентов при переменных, не входящих в уравнение:

Ее ранг равен трем, так как определитель квадратной подматрицы 3 х 3 этой матрицы не равен нулю:

Достаточное условие идентификации для III уравнения выполняется.
Таким образом, все уравнения модели сверхидентифицированы. Для оценки параметров каждого из уравнений будем применять двухшаговый МНК.
Шаг 1. Запишем приведенную форму модели в общем виде:

где 
Определим параметры каждого из приведенных выше уравнений в отдельности обычным МНК. Затем найдем расчетные значения
эндогенных переменных 
Шаг 2. В исходных структурных уравнениях заменим эндогенные переменные, выступающие в качестве факторных признаков, их расчетными значениями:

Применяя к каждому из полученных уравнений в отдельности обычный МНК, определим структурные параметры


Если из модели исключить тождество дохода, число предопределенных переменных модели уменьшится на 1 (из модели будет исключена переменная 




Временные ряды в эконометрических исследованиях
Модели, построенные по данным, характеризующим один объект за ряд последовательных моментов (периодов), называются моделями временных рядов.
Временной ряд — это совокупность значений какого-либо показателя за несколько последовательных моментов или периодов.
Каждый уровень временного ряда формируется из трендовой 


Модели, в которых временной ряд представлен как сумма перечисленных компонент, — аддитивные модели, как произведение -мультипликативные модели временного ряда. Аддитивная модель имеет вид:

мультипликативная модель:

Построение аддитивной и мультипликативной моделей сводится к расчету значений 
1) выравнивание исходного ряда методом скользящей средней;
2) расчет значений сезонной компоненты 
3) устранение сезонной компоненты из исходных уровней ряда и получение выровненных данных в аддитивной 

4) аналитическое выравнивание уровней 

5) расчет полученных по модели значений 

6) расчет абсолютных и/или относительных ошибок.
Автокорреляция уровней ряда — это корреляционная зависимость между последовательными уровнями временного ряда:

где

коэффициент автокорреляции уровней ряда первого порядка;

где

коэффициент автокорреляции уровней ряда второго порядка.
Формулы для расчета коэффициентов автокорреляции старших порядков легко получить из формулы линейного коэффициента корреляции.
Последовательность коэффициентов автокорреляции уровней первого, второго и т.д. порядков называют автокорреляционной функцией временного ряда, а график зависимости ее значений от величины лага (порядка коэффициента автокорреляции) — коррело-граммой.
Построение аналитической функции для моделирования тенденции (тренда) временного ряда называют аналитическим выравниванием временного ряда. Для этого чаще всего применяются следующие функции:
• линейная
• гипербола
• экспонента
• степенная функция
• парабола второго и более высоких порядков

Параметры трендов определяются обычным МНК, в качестве независимой переменной выступает время 


При построении моделей регрессии по временным рядам для устранения тенденции используются следующие методы.
Метод отклонений от тренда предполагает вычисление трендовых значений для каждого временного ряда модели, например 


Для дальнейшего анализа используют не исходные данные, а отклонения от тренда.
Метод последовательных разностей заключается в следующем: если ряд содержит линейный тренд, тогда исходные данные заменяются первыми разностями:

если параболический тренд — вторыми разностями:

В случае экспоненциального и степенного тренда метод последовательных разностей применяется к логарифмам исходных данных.
Модель, включающая фактор времени, имеет вид

Параметры а и b этой модели определяются обычным МНК.
Автокорреляция в остатках — корреляционная зависимость между значениями остатков 
Для определения автокорреляции остатков используют критерий Дарвина — Уотсона и расчет величины:

Коэффициент автокорреляции остатков первого порядка определяется по формуле

Критерий Дарбина — Уотсона и коэффициент автокорреляции остатков первого порядка связаны соотношением

Эконометрические модели, содержащие не только текущие, но и лаговые значения факторных переменных, называются моделями с распределенным лагом.
Модель с распределенным лагом в предположении, что максимальная величина лага конечна, имеет вид

Коэффициент регрессии 





В момент 







Величины

называются относительными коэффициентами модели с распределенным лагом. Если все коэффициенты 

Величина среднего лага модели множественной регрессии определяется по формуле средней арифметической взвешенной:

и представляет собой средний период, в течение которого будет происходить изменение результата под воздействием изменения фактора в момент 
Медианный лаг — это период, в течение которого с момента времени 

где 
Оценку параметров моделей с распределенными лагами можно проводить согласно одному из двух методов: методу Койка или методу Алмон.
В распределении Койка делается предположение, что коэффициенты при лаговых значениях объясняющей переменной убывают в геометрической прогрессии:

Уравнение регрессии преобразуется к виду

После несложных преобразований получаем уравнение, оценки параметров которого приводят к оценкам параметров исходного уравнения.
В методе Алмон предполагается, что веса текущих и лаговых значений объясняющих переменных подчиняются полиномиальному распределению:

Уравнение регрессии примет вид

Расчет параметров модели с распределенным лагом методом Алмон проводится по следующей схеме:
1) устанавливается максимальная величина лага 
2) определяется степень полинома 
3) рассчитываются значения переменных 
4) определяются параметры уравнения линейной регрессии 

5) рассчитываются параметры исходной модели с распределенным лагом.
Модели, содержащие в качестве факторов лаговые значения зависимой переменной, называются моделями авторегрессии, например:

Как и в модели с распределенным лагом, 



Отметим, что такая интерпретация коэффициентов модели авторегрессии и расчет долгосрочного мультипликатора основаны на предпосылке о наличии бесконечного лага в воздействии текущего значения зависимой переменной на ее будущие значения.
Пример задачи №13
По данным за 18 месяцев построено уравнение регрессии зависимости прибыли предприятия 



При анализе остаточных величин были использованы значения, приведенные в табл. 4.1.

Требуется:
- По трем позициям рассчитать
- Рассчитать критерий Дарбина — Уотсона.
- Оценить полученный результат при 5%-ном уровне значимости.
- Указать, пригодно ли уравнение для прогноза.
Решение:
определяется путем подстановки фактических значений
и
в уравнение регрессии:

Остатки 

Следовательно,




- Критерий Дарбина — Уотсона рассчитывается по формуле

4-4 = 4-3,81 =0,19,
что значительно меньше, чем 
- Уравнение регрессии не может быть использовано для прогноза, так как в нем не устранена автокорреляция в остатках, которая может иметь разные причины. Автокорреляция в остатках может означать, что в уравнение не включен какой-либо существенный фактор. Возможно также, что форма связи неточна, а может быть, в рядах динамики имеется общая тенденция.
Пример задачи №14
Имеются следующие данные о величине дохода на одного члена семьи и расхода на товар 
Требуется:
- Определить ежегодные абсолютные приросты доходов и расходов и сделать выводы о тенденции развития каждого ряда.
- Перечислить основные пути устранения тенденции для построения модели спроса на товар
в зависимости от дохода.
- Построить линейную модель спроса, используя первые разности уровней исходных динамических рядов.
- Пояснить экономический смысл коэффициента регрессии.
- Построить линейную модель спроса на товар
, включив в нее фактор времен». Интерпретировать полученные параметры.
Решение:
Обозначим расходы на товар 



Расчеты можно оформить в виде таблицы (табл. 4.4).

Значения 

Так как ряды динамики имеют общую тенденцию к росту, то для построения регрессионной модели спроса на товар 

Другой возможный путь учета тенденции при построении моделей — найти по каждому ряду уравнение тренда:

и отклонения от него:

Далее модель строится по отклонениям от тренда:

При построении эконометрических моделей чаще используется другой путь учета тенденции — включение в модель фактора времени. Иными словами, модель строится по исходным данным, но в нее в качестве самостоятельного фактора включается время, т.е. 
Модель имеет вид

Для определения параметров 


Применительно к нашим данным имеем

Решая эту систему, получим:

откуда модель имеет вид

Коэффициент регрессии

Он означает, что с ростом прироста душевого дохода на 1%-ный пункт расходы на товар 
Модель имеет вид

Применяя МНК, получим систему нормальных уравнений:

Расчеты оформим в виде табл. 4.5.

Система уравнений примет вид

Решая ее, получим

Уравнение регрессии имеет вид

Параметр 




Пример задачи №15
По данным за 30 месяцев некоторого временного ряда 
Требуется:
- Охарактеризовать структуру этого ряда, используя графическое изображение.
- Для прогнозирования значений
в будущие периоды предполагается построить уравнение авторегрессии. Выбрать наилучшее уравнение, обосновать выбор. Указать общий вид этого уравнения.
Решение:
- Так как значения всех коэффициентов автокорреляции достаточно высокие, ряд содержит тенденцию. Поскольку наибольшее абсолютное значение имеет коэффициент автокорреляции 4-го порядка
, ряд содержит периодические колебания, цикл этих колебаний равен 4.
Наиболее целесообразно построение уравнения авторегрессии:

так как значение 
Кроме того, возможно построение и множественного уравнения авторегрессии 




Сравнить полученные уравнения и выбрать наилучшее решение можно с помощью скорректированного коэффициента детерминации.
Пример задачи №16
На основе помесячных данных о числе браков (тыс.) в регионе за последние три года была построена аддитивная модель временного ряда. Скорректированные значения сезонной компоненты за соответствующие месяцы приводятся в табл. 4.6.
Уравнение тренда выглядит следующим образом:

при расчете параметров тренда использовались фактические моменты времени 
Требуется:
- Определить значение сезонной компоненты за декабрь.
- На основе построенной модели дать прогноз общего числа браков, заключенных в течение первого квартала следующего года.
Решение:
- Сумма значений сезонной компоненты внутри одного цикла должна быть равна нулю (в соответствии с методикой построения аддитивной модели временного ряда). Следовательно, значение сезонной компоненты за декабрь составит:

Число браков, заключенных в первом квартале следующего года, есть сумма числа браков, заключенных в январе 


Для расчета трендовых значений воспользуемся уравнением тренда, указанным в условии задачи:

Соответствующие значения сезонных компонент составят:

Таким образом,

Количество браков, заключенных в первом квартале следующего года, составит: 2,61 + 5,64 + 3,17 = 11,42 тыс., или 11420.
Пример задачи №17
Динамика выпуска продукции Финляндии характеризуется данными (млн долл.), представленными в табл. 4.7.
Требуется:
- Провести расчет параметров линейного и экспоненциального трендов.
- Построить графики ряда динамики и трендов.
- Выбрать наилучший вид тренда на основании графического изображения и значения коэффициента детерминации.
Реализация типовых задач в Excel
Решение с использованием ППП MS Excel
- Для определения параметров линейного тренда по методу наименьших квадратов используется статистическая функция ЛИНЕЙН, для определения экспоненциального тренда -ЛГРФПРИБЛ. Порядок вычисления был рассмотрен в 1-м разделе практикума. В качестве зависимой переменной в данном примере выступает время
. Приведем результаты вычисления функций ЛИНЕЙН и ЛГРФПРИБЛ (рис. 4.2 и 4.3).

Запишем уравнения линейного и экспоненциального тренда, используя данные рис. 4.2 и 4.3:

- Построение графиков осуществляется с помощью Мастера диаграмм.
Порядок построения следующий:
1) введите исходные данные или откройте существующий файл, содержащий анализируемые данные;
2) активизируйте Мастер диаграмм любым из следующих способов:
а) в главном меню выберите Вставка/Диаграмма;
б) на панели инструментов Стандартная щелкните по кнопке Мастер диаграмм;
3) в окне Тип выберите График (рис. 4.4); вид графика выберите в поле рядом со списком типов. Щелкните по кнопке Далее;
4) заполните диапазон данных, как показано на рис. 4.5. Установите флажок размещения данных в столбцах (строках). Щелкните по кнопке Далее;
5) заполните параметры диаграммы на разных закладках (рис. 4.6): названия диаграммы и осей, значения осей, линии сетки, параметры легенды, таблица и подписи данных. Щелкните по кнопке Далее;
6) укажите место размещения диаграммы на отдельном или на имеющемся листе (рис. 4.7). Щелкните по кнопке Далее. Готовая диаграмма, отражающая динамику уровней изучаемого ряда, представлена на рис. 4.8.
В ППП MS Excel линия тренда может быть добавлена в диаграмму с областями гистограммы или в график. Для этого:
1) выделите область построения диаграммы; в главном меню выберите Диаграмма/Добавить линию тренда;
2) в появившемся диалоговом окне (рис. 4.9) выберите вид линии тренда и задайте соответствующие параметры. Для полиномиального тренда необходимо задать степень аппроксимирующего полинома, для скользящего среднего — количество точек усреднения.

В качестве дополнительной информации на диаграмме можно отобразить уравнение регрессии и значение среднеквадратического отклонения, установив соответствующие флажки на закладке Параметры (рис. 4.10). Щелкните по кнопке ОК.
На рис. 4.11 — 4.15 представлены различные виды трендов, описывающие исходные данные задачи.
Сравним значения 





Исходные данные лучше всего описывает полином 6-й степени. Следовательно, в рассматриваемом примере для расчета прогнозных значений следует использовать полиномиальное уравнение.
Кстати готовые на продажу задачи тут, и там же теория из учебников может быть вам поможет она.
Пример задачи №18
Имеются данные о динамике товарооборота и доходов населения России за 1997 — 1999 гг. (табл. 4.8).
Требуется:
- Оценить параметры модели с распределенными лагами методом Алмон.
- Постройте таблицу результатов дисперсионного анализа. Оцените значимость построенной модели.
Решение:
Решение с использованием ППП Statistica
- Для построения регрессионной модели с распределенными лагами необходимо априори задать длину максимального лага, для этой задачи выберем длину 3. Тогда уравнение регрессии будет выглядеть следующим образом:

Для оценки параметров этой модели согласно методу Алмон необходимо задать степень аппроксимирующего полинома. Для решения используем соответствующую процедуру ППП Statistica. Порядок расчетов следующий:
1) введите исходные данные или откройте существующий файл другого формата, содержащий анализируемые данные, в опции Data Management в окне переключения модулей (рис. 4.16). Если создаете новый файл данных, в соответствующих ячейках укажите количество строк и столбцов. В нашем случае — 2 столбца, 36 строк;

2) из модуля управления данными перейдите в модуль анализа временных рядов, выбрав в меню пункт Time Series / Forecasting;
3) откройте файл, содержащий данные — Open Data (рис. 4.17);
4) выделите все переменные, используемые для анализа, — Variables. Щелкните по кнопке ОК (рис. 4.18).
5) щелкните по кнопке Distributed lags analysis (см. рис. 4.17);
6) в окне Distributed Lags Analysis (рис. 4.19) выделите название зависимой переменной, в появляющемся окне Independent variable -название независимой переменной. В ячейке Lag length укажите значение максимального лага, в ячейке Almon polynomial lags — степень аппроксимирующего полинома. Степень полинома не должна превышать значение максимального лага. Щелкните по кнопке ОК (Begin analysis);
7) результаты расчетов — оценки регрессионных коэффициентов и значимость уравнения — приведены на рис. 4.20 и 4.21.
Согласно данным таблицы дисперсионного анализа (см. рис. 4.21), полученные значения 

Задачи с решением по всем темам эконометрики
Эконометрика – это раздел экономики, занимающийся разработкой и применением статистических методов для измерений взаимосвязей между экономическими переменными.
Эконометрика – это самостоятельная научная дисциплина, объединяющая совокупность теоретических результатов, приемов, методов и моделей.
Парный регрессионный анализ. Функциональная, статистическая и корреляционная зависимости
Из математики известно понятие функциональной зависимости (связи), когда каждому значению одной переменной соответствует вполне определенное значение другой (например, площадь круга в зависимости от радиуса и т.д.).
В экономике в большинстве случаев между переменными величинами существуют зависимости, когда каждому значению одной переменной соответствует не какое-то определенное, а множества возможных значений другой переменной Иначе говоря, каждому значению одной переменной соответствует определенное (условное) распределение другой переменной. Такая зависимость получила название статистической (или стохастической, вероятностной).
Возникновение понятия статистической связи обуславливается тем, что зависимая переменная подвержена влиянию множества неконтролируемых или неучтенных факторов, а таюке тем, что измерение значений переменных сопровождается случайными ошибками. Примером статистической связи является зависимость урожайности от количества внесенных удобрений, производительности труда на предприятии от его энерговооруженности и т.п.
В силу неоднозначности статистической зависимости между 







Корреляционной зависимостью между двумя переменными называется функциональная зависимость между значениями одной из них и условным математическим ожиданием другой.
Корреляционная зависимость может быть представлена в виде

где

В регрессионном анализе рассматривается односторонняя зависимость случайной переменной 







Уравнение (1.1) называется модельным уравнением регрессии (или просто уравнением регрессии), а функция 
Для точного описания уравнения регрессии необходимо знать условный закон распределения зависимой переменной 






где 



Уравнение (1.2) называется выборочным уравнением регрессии
При правильно определенной аппроксимирующей функции 

Линейная парная регрессия
Рассмотрим в качестве примера зависимость между сменной добычей угля на одного рабочего 



Изобразим полученную зависимость графически точками координатной плоскости (рис. 1.1). Такое изображение статистической зависимости называется полем корреляции.

По расположению эмпирических точек можно предполагать наличие линейной корреляционной (регрессионной) зависимости между переменными 


Найдем формулы расчета неизвестных параметров уравнения линейной регрессии. Согласно методу наименьших квадратов неизвестные параметры 




На основании необходимого условия экстремума функции двух переменных 

откуда после преобразований получим систему нормальных уравнений для определения параметров линейной регрессии

Разделив обе части уравнений (1.5) на 

где соответствующие средние определяются по формулам:

Решая систему (1.6), найдем

Коэффициент 

Коэффициент регрессии 




выборочная дисперсия переменной 

выборочная ковариация.

Уравнение регрессии примет вид:

Задача №1.1.
По данным табл. 1.1 найти уравнение регрессии 

Решение:
Вычислим все необходимые суммы:

Затем находим параметры уравнения регрессии:
Уравнение регрессии 


Из полученного уравнения регрессии (см. рис. I 1) следует, что при увеличении мощности пласта 

Коэффициент корреляции
Оценим тесноту корреляционной зависимости. Рассмотрим случай линейной зависимости вида (1.10):

На первый взгляд, подходящим измерителем тесноты связи 







В этом выражении величина 




Величина 



Если 



Отметим другие модификации формулы 


Выборочный коэффициент корреляции 

- Коэффициент корреляции принимает значения на отрезке [-1;1], т.е.
. Чем ближе
к единице, тем теснее связь.
- При
корреляционная связь представляет линейную функциональную зависимость. При этом все наблюдаемые значения располагаются на прямой линии (рис. 1.3 а, 6).
- При
линейная корреляционная связь отсутствует. При этом линия регрессии параллельна оси
(рис. 1.3 в).
Следует отметить, что 









Возможно эта страница вам будет полезна:
Задача №1.2.
По данным табл. 1.1 вычислить коэффициент корреляции между переменными 
Решение:
В примере 1.1 были вычислены суммы

Вычислим сумму:

Вычислим коэффициент корреляции:

т. е. связь между переменными достаточно тесная
Основные положения регрессионного анализа. Оценка параметров парной регрессионной модели
Рассматриваемая в регрессионном анализе зависимость 




где 



Рассмотрим линейный регрессионный анализ, для которого функция 

Предположим, что для оценки параметров линейной функции регрессии (1.16) взята выборка, содержащая 



Отметим основные предпосылки регрессионного анализа.

(или математическое ожидание зависимой переменной 


или

условие гомоскедастичности или равноизменчивости возмущения (зависимой переменной)).

В этом случае модель (1.17) называется классической нормальной линейной регрессионной моделью.
Для получения уравнения регрессии достаточно предпосылок 1-4. Требование выполнения предпосылки 5 (т. е. рассмотрение «нормальной регрессии») необходимо для оценки точности уравнения регрессии и его параметров.
Оценкой модели (1.17) по выборке является уравнение регрессии

Параметры этого уравнения 

Воздействие неучтенных случайных факторов и ошибок наблюдений в модели (1.17) определяется с помощью дисперсии возмущений (ошибок) или остаточной дисперсии 

где 


В знаменателе выражения (1.18) стоит число степеней свободы 
Ответ на вопрос, являются ли оценки 

Теорема Гаусса—Маркова. Если регрессионная модель (1.17) удовлетворяет предпосылкам 1 -4 , то оценки 





Интервальная оценка функции регрессии и ее параметров
Построим доверительный интервал для функции регрессии, т.е. для условного математического ожидания 


Найдем дисперсию групповой средней 


На рис. 1.4 линия регрессии (1.19) изображена графически. Для произвольного наблюдаемого значения 




Дисперсия групповой средней равна сумме дисперсий двух независимых слагаемых выражения (1.19):

Здесь учтено, что 

Дисперсии выборочной средней 


Оценка 


Основываясь на предпосылках 1 — 5 регрессионного анализа можно показать, что статистика 




где 











Определим доверительный интервал для индивидуальных значений зависимой переменной. Построенная доверительная область для 






а соответствующий доверительный интервал для прогнозов индивидуальных значений 

Построим доверительный интервал для параметров регрессионной модели, в частности для параметров регрессионной модели 

При выполнении предпосылки 5 регрессионного анализа статистика 

имеет 

Поэтому интервальная опенка параметра 

При построении доверительного интервала для параметра 






доверительный интервал выбирается таким образом, чтобы

Задача №1.3.
По данным табл. 1.1 требуется:
1) оценить сменную среднюю добычу угля на одного рабочего для шахт с мощностью пласта 8 м;
2) найти 95% — ные доверительные интервалы для индивидуального и среднего значений сменной добычи угля на 1 рабочего для таких же шахт;
3) найти с надежностью 0,95 интервальные оценки коэффициента рецессии 

Решение:
Уравнение регрессии 





Для построения доверительного интервала для 



Подставим из таблицы найденные значения в формулы

Следовательно

По таблице значений 



Средняя сменная добыча угля на одного рабочего для шахт с мощностью пласта 8м с надежностью 0,95 находится в пределах от 2,77 до 6,03 т. 2. Чтобы построить доверительный интервал для индивидуального значения 

Искомый доверительный интервал примет вид:

Таким образом, индивидуальная сменная добыча угля на одного рабочего для шахт с мощностью пласта 8м с надежностью 0,95 находится в пределах от 0,57 до 8,23 т.
- Найдем 95% -ный доверительный интервал для параметра
по формуле (1.27)

т. е. с надежностью 0,95 при изменении мощности пласта 

Найдем 95%-ный доверительный интервал для параметра
Учитывая, что 


Подставим найденные значения в формулу для оценки интервала получим:

Таким образом, с надежностью 0,95 дисперсия возмущений заключена в пределах от 1,29 до 10,36, а их стандартное отклонение — от 1,13 до 3,22 (т).
Оценка значимости уравнения регрессии. Коэффициент детерминации
Проверить значимость уравнения регрессии — значит установить, соответствует ли математическая модель, выражающая зависимость между переменными, экспериментальным данным и достаточно ли включенных в уравнение объясняющих переменных (одной или нескольких) для описания зависимой переменной.
Проверка значимости уравнения регрессии производится на основе дисперсионного анализа.
Согласно основной идее дисперсионного анализа

или

где 


Нетрудно убедиться, что третье слагаемое

Представим полученные соотношения в виде таблицы 1.3
Средние квадраты 




Уравнение регрессии значимо на уровне 

Задача №1.4.
По данным табл. 1.1 оценить на уровне 


Решение:
Ранее, были

Вычислим суммы квадратов для определения компонент дисперсии:

Находим значение 

По таблице значений 

Так как

то уравнение регрессии значимо.
Одной из наиболее эффективных оценок адекватности регрессионной модели, мерой качества уравнения регрессии, (или, как говорят, мерой качества подгонки регрессионной модели к найденным значениям 

Величина 
Так как 







Заметим, что коэффициент 
Если известен коэффициент детерминации 

В случае парной линейной регрессионной модели коэффициент детерминации равен квадрату коэффициента корреляции, т. е. 
Задача №1.5.
По данным табл. 1.1 найти коэффициент детерминации и пояснить его смысл.
Решение:
В примере 1.4 было получено 

Коэффициент детерминации можно было вычислить и иначе, если учесть, что в примере 1.2 был вычислен коэффициент корреляции 


Это означает, что вариация зависимой переменной 

Множественный регрессионный анализ. Классическая нормальная линейная модель множественной регрессии
Экономические явления, как правило, определяются большим числом одновременно и совокупно действующих факторов. В связи с этим часто возникает задача исследования зависимости одной зависимой переменной 

Обозначим 


где


Включение в регрессионную модель новых объясняющих переменных приводит к целесообразности использования матричных обозначений. Магричное описание регрессии облегчает как теоретические концепции анализа, так и необходимые расчетные процедуры.
Введем обозначения:



матрица значений объясняющих переменных, или матрица плана размерности 







Тогда в матричной форме модель примет вид:

Оценкой этой модели по выборке является уравнение

где

Оценка параметров классической регрессионной модели методом наименьших квадратов
Для оценки вектора неизвестных параметров 
Условие минимизации остаточной суммы квадратов запишется в виде:

На основании необходимого условия экстремума функции нескольких переменных 

После вычисления вектора частных производных приравняем его 0 — 


Для решения этого матричного уравнения относительно вектора оценок параметров 






Кроме того, полагают, что число имеющихся наблюдений (значений) каждой из объясняющих и зависимой переменных превосходит ранг-матрицы 


В новых терминах приведенные ранее предпосылки для множественного регрессионного анализа могут быть записаны следующим образом:
Модель (2.2), удовлетворяющая приведенным предпосылкам 1-6, называется классической нормальной линейной моделью множественной регрессии, если же среди приведенных не выполняется лишь предпосылка о нормальном законе распределения вектора возмущений с , то модель называется просто классической линейной моделью множественной рефессии.
Решением уравнения (2.4) является вектор

где 


Рассмотренная выше для парной регрессионной модели теорема Гаусса — Маркова оказывается верной для модели (2.2) множественной регрессии и может быть сформулирована в следующем виде
При выполнении предпосылок множественного регрессионного анализа оценка метода наименьших квадратов 
Зная вектор 

где 


Задача №2.1.
Имеются следующие данные о сменной добыче угля на одного рабочего 








Решение:
Обозначим

(в матрицу 
Для удобства вычислений составляем вспомогательную таблицу.

Вычислим матрицы:

Умножим матрицу 


Уравнение множественной регрессии имеет вид:

Оно показывает, что при увеличении только мощности пласта 




Добавление в регрессионную модель новой объясняющей переменной







Ковариационная матрица и ее выборочная оценка
Вариации оценок параметров определяют точность уравнения множественной регрессии. Для их измерения в многомерном регрессионном анализе рассматривают так называемую ковариационную матрицу вектора оценок параметров 

где элементы 



Учитывая, что оценки 


Ковариация характеризует как степень рассеяния значений двух переменных относительно их математических ожиданий, так и взаимосвязь этих переменных.
Определение доверительных интервалов для коэффициентов и функции регрессии
Доверительный интервал для параметров регрессионной модели

Оценка 



где 





Учитывая, что статистика 













В обшей постановке гипотеза 



Доверительный интервал для параметра 

- Доверительный интервал для функции репрессии или для условного математического ожидания зависимой переменной

где 


- Доверительный интервал для индивидуальных значений зависимой переменной

где

- Доверительный интервал для параметра
.
В множественной регрессии он строится аналогично парной модели с соответствующим изменением числа степеней свободы с критерия

Задача №2.2
По данным примера 2.1 оценить сменную добычу угля на одного рабочего для шахт с мощностью пласта 8 м и уровнем механизации работ 6%; наши 95%-ные доверительные интервалы для индивидуального и среднего значений сменной добычи угля на одного рабочего для таких же шахт. Проверить значимость коэффициентов регрессии и построить для них 95%-ные доверительные интервалы. Найти интервачьную оценку для дисперсии 
Решение:
В примере 2.1 уравнение регрессии получено в виде

По условию надо оценить 



Для построения доверительного инггерала для 


Находим

Вычисляем

По таблице значений 

находим 


Итак, с надежностью 0,95 средняя сменная добыча угля на одного рабочего для шахт с мощностью пласта 8 м и уровнем механизации работ 6% находится в пределах от 4,27 до 7,29 т.
Сравнивая новый доверительный интервал для функции регрессии 
Это связано с тем, что включение в модель новой объясняющей переменной позволяет несколько повысить точность модели за счет увеличения взаимосвязи зависимой и объясняющей переменных.
Найдем доверительный интервал для индивидуального значения 

Вычислим


Итак, с надежностью 0,95 индивидуальное значение сменной добычи угля в шахтах с мощностью пласта 8 м и уровнем механизации работ 6% находится в пределах от 2,80 до 8,76 (т).
Проверим значимость коэффициентов регрессии 




Так как

тo коэффициент 
Аналогично для 


т. е. коэффициент 
Доверительный интервал коэффициента регрессии 

Доверительный интервал коэффициента регрессии 

Итак, с надежностью 0,95 за счет изменения на 1 м мощности пласта 





Найдем 95%-ный доверительный интервал для параметра 

степени свободы найдем по таблице значений критерия Пирсона


С помощью формулы (2.14) находим интервал

Таким образом, с надежностью 0,95 дисперсия возмущений заключена в пределах от 0,738 до 6,99, а их стандартное отклонение — от 0,859 до 2,64(т).
Оценка значимости множественной регрессии. Коэффициенты детерминации R²
В модели множественной регрессии, как и в случае парной регрессионной модели, общая вариация 

где 

Уравнение множественной регрессии значимо (иначе — гипотеза о равенстве нулю параметров регрессионной модели, т. е.

отвергается), если

где 

Коэффициент детерминации 


Величина 

Вместе с тем использование только одного коэффициента детерминации 


Поэтому предпочтительнее использовать скорректированный (адаптированный, поправленный) коэффициент детерминации 

Из формул следует, что чем больше число объясняющих переменных 








Если известен коэффициент детерминации 

где 

Возможно эта страница вам будет полезна:
Задача №2.3.
По данным примера 2.1 определить множественный коэффициент детерминации и проверить значимость полученного уравнения регрессии 



Решение:
Вычислим произведения векторов (см. пример 2.1):

По формуле (2 18) определим множественный коэффициент детерминации

Коэффициент детерминации 


Зная 

Оно больше табличного 





Временные ряды и прогнозирование. Общие сведения о временных рядах и задачах их анализа
Под временным рядом (динамическим рядом, или рядом динамики) в экономике подразумевается последовательность наблюдений некоторого признака (случайной величины) 


В табл. 3.1 приведены данные, отражающие спрос на некоторый товар за восьмилетний период (усл. ед.), т. е. временной ряд спроса 

На рис. 3.1 временной ряд 

Методы исследования моделей, основанных на данных пространственных выборок и временных рядов, вообще говоря, отличаются Объясняется это Tev что в отличие от пространственных выборок наблюдения во временных ряда как правило, нельзя считать независимыми.
При анализе точности этих моделей и определении интервальных ошибок прогноза на их основе, будем полагать, что рассматриваемые в главе регрессионные модели временных рядов удовлетворяют условиям классической модели.
В общем виде при исследовании экономического временного ряда 

где 



Первые три составляющие (компоненты) 


Важнейшей классической задачей при исследовании экономических временных рядов является выявление и статистическая оценка основной тенденции развития изучаемого процесса и отклонений от нее.
Основные этапы анализа временных рядов:
графическое представление и описание поведения временного ряда; выделение и удаление закономерных (неслучайных) составляющих временного ряда (тренда, сезонных и циклических сост авляющих);
сглаживание и фильтрация (удаление низко — или высокочастотных составляющих временного ряда);
исследование случайной составляющей временного ряда, построение и проверка адекватности математической модели для ее описания;
прогнозирование развития изучаемого процесса на основе имеющегося временного ряда;
исследование взаимосвязи между различными временными рядами. Наиболее распространенными методами анализа временных рядов являются корреляционный и спектральный анализ, модели авторегрессии и скользящей средней
Временной ряд 





Стационарные временные ряды и их характеристики. Автокорреляционная функция
Важное значение в анализе временных рядов имеют стационарные временные ряды, вероятностные свойства которых не изменяются во времени.
Временной ряд 













Степень тесноты связи между последовательностями наблюдений временного ряда

(сдвинутых относительно друг друга на 



Коэффициент 







Статистической оценкой 


Функция 
При расчете 







Для стационарного временного ряда с увеличением лага г взаимосвязь членов временного ряда 





Наряду с автокорреляционной функцией при исследовании стационарных временных рядов рассматриваем частная автокорреляционная функция 







Статистической оценкой 






где 

Задача №3.1
По данным табл. 1 для временного ряда у, найти среднее чначение, среднее квадратическое отклонение, коэффициенты автокорреляции (для лагов г=1;2) и частный коэффициент автокорреляции I-го порядка.
Решение:
Среднее значение временного ряда находим по формуле (3.1):

Дисперсию и среднее квадратическое отклонение вычислим, воспользовавшись соотношением:
Найдем коэффициент автокорреляции 


Сначала вычисляем необходимые суммы:

Затем подставим их в формулу:

при

получим:

Коэффициенты автокорреляции 







Для определения частного коэффициента корреляции 1-го порядка 





Знание автокорреляционных функций 

Аналитическое выравнивание (сглаживание) временного ряда
Одной из важнейших задач исследования экономического временного ряда является выявление основной тенденции изучаемого процесса, выраженной неслучайной составляющей 
Для решения этой задачи вначале необходимо выбрать вид функции 

При выборе соответствующей функции 


При использовании метола наименьших квадратов для выявления основной тенденции значения временного ряда 


где 
Для линейной функции согласно методу наименьших квадратов параметры прямой 

Задача №3.2.
По данным табл. 3.1 найти уравнение неслучайной составляющей (тренда) для временного ряда у, полагая тренд линейным.
Решение:
Вначале вычислим необходимые суммы:
Система нормальных уравнений имеет вид:

Решая эту систему, находим уравнение тренда:

Это значит, что спрос (см. рис 3.1) ежегодно увеличивается в среднем на 26,5 ед.
Уравнение регрессии с учётом зависимостей (1.7) — (1.10) и (3.7) можно представить в виде:


Проверим значимость полученного уравнения тренда по 
а) сумму квадратов, обусловленную регрессией

б) общую сумму квадратов отклонений зависимой переменной от средней

в) остаточную сумму квадратов, характеризующую влияние неучтённых факторов

Затем найдем по формуле (1.30) при 

По таблице значений критерия Фишера-Снсдекора определяем 
Так как 
Другим методом выравнивания (сглаживания) временного ряда является метод скользящих средних. Он основан на переходе от начальных значений членов ряда к их средним значениям на интервале времени, длина которого определена заранее. При что и сам выбранный интервал времени «скользит» вдоль ряда.
Получаемый таким образом ряд скользящих средних ведет себя более гладко, чем исходный ряд, из-за усреднения отклонений ряда.
Действительно, если разброс значений члена временного ряда 





Задача №3.3.
Провести сглаживание временного ряда 

Решение:
Скользящие средние вычисляем по формуле:

При 

Для 

Для 

В результате получим сглаженный ряд, представленный в табл. 3.3.
На рис. 3.1 этот ряд изображен графически в виде пунктирной линии
Прогнозирование на основе моделей временных рядов
Одна из нажнейших задач (этапов) анализа временного (динамического) ряда состоит в прогнозировании на его основе развития изучаемого процесса. При этом исходят из того, что тенденция развития, установленная в прошлом, может быть распространена (экстраполирована) на будущий период.
Задача ставится так: имеется временной ряд 





Если рассматривать временной ряд как регрессионную модель изучаемого признака по переменной «время», то к нему могут быть применены рассмотренные выше методы анализа. Следует, однако, вспомнить, что одна из основных предпосылок регрессионного анализа состоит в том, что возмущения 

Задача №3.4.
По данным табл. 3.1 дать точечную и с надежностью 0,95 интервальную оценки прогноза среднего и индивидуального значений спроса на некоторый товар на момент 
Решение:
Выше, в примере 3.2, получено уравнение регрессии 

Оценкой 

Найдем оценку 

Находим табличное значение 

или

Для нахождения интервальной оценки прогноза индивидуального значения 


Интервальная оценка для 

или

Итак, с надежностью 0,95 среднее значение спроса на товар на девятый год будет заключено от 345,9 до 468,9 (ед ), а ею индивидуальное значение -от 307,3 до 507,5 (ед ).
Как правило, прогноз развития изучаемого процесса на основе экстраполяции временных рядов оказывается эффективным, r рамка, краткосрочного или среднесрочного периода прогнозирования.
Автокорреляция остатков временного ряда
При моделировании реальных экономических процессов част возникают ситуации, в которых условия классической линейной модели регрессии оказываются нарушенными В частности, могут не выполняться предпосылки 3 и 4 регрессионного анализа (см. § 1.4) о том, что случайные возмущения (ошибки) модели имеют постоянную дисперсию и не коррелированны между собой. Так, например, при рассмотрении зависимости расходов на потребление от уровня доходов семей можно ожидать, что в более обеспеченных семьях вариация расходов выше, чем в малообеспеченных, т. е. дисперсии возмущений не одинаковы.
При анализе временных рядов мы часто сталкиваемся с ситуацией, когда наблюдаемые в данный момент значения зависимой переменной коррелированны с их значениями в предыдущие моменты времени, т. е. имеется корреляция между возмущениями в разные моменты времени.
Рассмотрим регрессионную модель временного (динамического) ряда. Упорядоченность наблюдений оказывается существенной в том случае, если прослеживается механизм влияния результатов предыдущих наблюдений на результаты последующих. Математически это выражается в том, что случайные величины 





Оценивая методом наименьших квадратов зависимость курса от времени (номера наблюдений), получим следующие результаты:

Естественно предположить, что результаты предыдущих торгов оказывают влияние на результаты последующих: если в какой-то момент курс окажется завышенным по сравнению с реальным, то скорее всего он будет завышен на следующих торгах, т. е. имеет место положительная автокорреляция. Графически (см. рис 3.2) положительная автокорреляция выражается в чередовании тех зон, где наблюдаемые значения оказываются выше объясненных (лежащих на прямой 
Отрицательная автокорреляция встречается в тех случаях, когда завышенные значения в предыдущих наблюдениях приводят к занижению их в наблюдениях последующих (наблюдения действуют друг на друга по принципу «маятника»). Графически это выражается в том, что результаты наблюдений 


Метод наименьших квадратов при наличии коррелированности ошибок регрессии даст несмещенные и состоятельные (разумеется, неэффективные) оценки коэффициентов регрессии, однако, оценки их дисперсий несостоятельные и смешенные (как правило, в сторону занижения), т. е. результаты тестирования гипотез оказываются недостоверными.
Как правило, если автокорреляция присутствует, то наибольшее влияние на последующее наблюдение оказывает результат предыдущего наблюдения Так, например, если рассматривается ряд значений курса какой-либо ценной бумаги, то, очевидно, именно результат последних торгов служит основой для формирования курса на следующих торгах. Ситуация, когда на значение наблюдения у, оказывает основное влияние не результат 
Таким образом, отсутствие корреляции между соседними членами позволяет считать, что корреляция отсутствует в целом, и обычный метод наименьших квадратов дает адекватные и эффективные результаты.
Наличие автокорреляции между соседними членами можно определить с помощью теста Дарбина- Уотсона. Этот критерий (тест) Дарбина- Уотсона основан на простой идее: если корреляция ошибок регрессии не равна нулю, то она присутствует и в остатках регрессии 

В случае отсутствия автокорреляции выборочный коэффициент 

Тест Дарбина-Уотсона имеет один существенный недостаток -распределение статистики 


Однако существуют два пороговых значения 

Если фактически наблюдаемое значение 
а) 
б) 
в) 
г) 
Графическая иллюстрация теста Дарбина-Уотсона приведена на рис. 3.3:

Для 



Недостатками критерия Дарбина -Уотсона является наличие области неопределенности критерия и то, что критические значения 
Задача №3.5.
Выявить на уровне значимости 0,05 наличие втокорреляции возмущений для временного ряда_у, по данным табл. 3.1.
Решение:
В примере 3.2 получено уравнение тренда

В табл. 3.4 приведен расчет данных, необходимых для вычисления ^-статистики.
Находим суммы

подставляем в формулу (3.9) и вычисляем значение статистики

По таблице значений критерия Дарбина — Уотсона при 








Для рассматриваемого временного ряда спроса на уровне значимости 0,05 гипотеза об отсутствии автокорреляции возмущений принимается.
Готовые задачи по эконометрике
Эконометрика – это самостоятельная научная дисциплина, объединяющая совокупность теоретических результатов, приемов, методов и моделей, предназначенных для того, чтобы на базе экономической теории, экономической статистики и экономических измерений, математико-статистического инструментария придавать конкретное количественное выражение общим (качественным) закономерностям, обусловленным экономической теорией.
Эконометрика – одна из базовых дисциплин экономического образования во всем мире.
Эконометрические модели парной регрессии
Эконометрика является одной из важнейших составляющих современного экономического образования. Применение эконометрических методов является необходимым условием проведения качественных экономических исследований.
Современную эконометрику можно разделить на два направления: теоретическую и прикладную.
Теоретическая эконометрика занимается изучением специальных вероятностных (т.н. регрессионных) моделей, используя при этом аппарат теории вероятностей и математической статистики.
В основе прикладной эконометрики лежит применение вероятностных моделей для количественного описания и анализа экономических явлений и процессов.
Между этими направления существует глубокая двусторонняя взаимосвязь. Основные результаты теоретической эконометрики в виде статистических тестов и новых классов вероятностных моделей находят свое применение при решении прикладных задач. С другой стороны, в прикладной эконометрике в процессе исследования экономических явлений возникают ситуации или наблюдаются эффекты, которые не описываются существующими моделями. Это является предпосылкой для дальнейшего развития теоретического аппарата.
Термин «эконометрика» дословно читается как «измерения в экономике». Однако не каждое измерение в экономике относится к эконометрике, поэтому дадим точное определение.
Эконометрика (или эконометрия) изучает методы оценивания параметров моделей, характеризующих количественную взаимосвязь между экономическими показателями, а также рассматривает основные направления применения этих моделей в экономических исследованиях.
Предметом изучения эконометрики являются социально-экономические системы, процессы или явления, описываемые моделями. Методы исследования — математические методы, базирующиеся на теории вероятностей и математической статистике (далее ТВиМС), и других разделах математики. Структурно эконометрические исследования приведены на рис. 1.1.

Построение эконометрической модели условно делят на четыре этапа:
- спецификация модели, т.е. её запись в математической форме;
- сбор и подготовка экономической информации;
- оценивание параметров модели;
- проверка модели на достоверность.
Этапы 1) и 2) взаимозаменяемы. Полученную модель применяют для прогнозирования, планирования и с другими целями.
Термин «эконометрика» был введен в научный оборот в начале 20-го века. В 1928 г. была опубликована работа Ч. Кобба и П. Дугласа, посвященная исследованию производственной функции, связывающей объём выпуска продукции в отрасли, затраты труда и затраты капитала. Модель производственной функции Кобба-Дугласа является, пожалуй, первым примером использования эконометрики и отражает классический подход к эконометрическому анализу.
Окончательное становление эконометрики относят к 1930 году, когда европейскими и американскими учёными было основано «Эконометриче-ское сообщество». С 1933 г. выходит журнал «Эконометрия», издающийся этим сообществом.
Основателями эконометрии считаются Р. Фриш, Я. Тинберген, И. Шумпетер, Л. Клейн, Р. Стоун и другие учёные. Их целью было объединение экономической теории с математическими и статистическими методами. Модели, предложенные этими учеными, способствовали развитию математического и статистического аппарата и расширению области применения эконометрики.
После Второй мировой войны были построены комплексные эконо-метрические модели на макроуровне, в которых основное внимание уделялось спросу, финансовому состоянию, налогам, прибылям, ценам и другим важнейшим экономическим показателям.
Наиболее используемыми в эконометрии являются: производственные функции; функции потребления различных групп населения; функции предпочтения потребителей; межотраслевые модели производства, распределения и потребления продукции; модели экономического равновесия.
Помимо экономических исследований, эконометрические методы успешно применяются в биологии, истории, социологии и некоторых других общественных и естественных науках, где необходимо оценивать взаимосвязи между большим количеством переменных.
Важность данной науки подчеркивает тот факт, что за эконометрические исследования многократно присуждалась Нобелевская премия в области экономики.
В настоящее время эконометрия продолжает динамично развиваться и охватывает всё новые сферы экономических знаний.
Особенности эконометрических моделей
Математическая модель социально-экономической системы, процесса или явления представляет собой абстрактную запись основных его закономерностей с помощью математических формул и соотношений. Эконометрические модели относятся к функциональным стохастическим моделям. Они количественно описывают корреляционно-регрессионную связь между исследуемыми показателями.
Эконометрическая модель содержит три группы элементов: вектор 


В данном случае 


В общем виде эконометрическую модель можно записать в виде:

Здесь 


Для построения эконометрической модели необходимо выполнение следующих условий:
наличие достаточно большой совокупности наблюдений;
- однородность совокупности наблюдений;
- точность входных данных.
В отношении оценивания степени однородности совокупности наблюдений существует много различных подходов. Впрочем, все исследователи согласны с тем, что экономические наблюдения, как правило, неоднородны. Поэтому речь может идти лишь о достижении определенной степени однородности, которая обеспечит достоверность экономических выводов.
Различают качественную и количественную однородность. Под первой подразумевается однотипность экономических объектов, их одинаковое качество и определенное назначение. Под второй — однородность группы единиц совокупности, которая определяется на основе количественных показателей.
В математической статистике есть ряд критериев, которые позволяют сделать вывод, являются ли рассматриваемые случайные выборки однородными и можно ли их объединять в одну совокупность для проведения эконометрических исследований.
Точность выходных данных существенно влияет на выводы, которые могут быть сделаны на основе эконометрического моделирования. Погрешности могут возникать при формировании алгоритма расчёта показателей, при округлении, повторном учёте тех или иных показателей и др. Все ошибки делят на систематические, т.е. такие, которые имеют постоянную величину, либо изменяются, подчиняясь определенной функциональной зависимости, и случайные, которые обусловлены влиянием случайных факторов при формировании показателей.
При формировании совокупности наблюдений необходимо обращать внимание и на наличие ошибок во входных данных. Если нет возможности избежать этих ошибок, то необходимо применять специальные методы оценивания параметров эконометрической модели.
Наиболее часто используемым методом для количественной оценки взаимосвязей в эконометрии является корреляционно-регрессионный анализ. Суть метода заключается в определении оценок количественного влияния показателей на исследуемую величину и построении на этой основе строгой зависимости между ними, которая в общем виде записывается в виде некоторой функции:

где 

Чаще всего с этой целью используется линейная функция. Однако возможны и другие формы зависимостей: экспоненциальная, степенная, гиперболическая и другие.
Каждая из рассматриваемых функций может быть сведена к линейной с помощью алгебраических преобразований или путем замены. По этой причине именно исследованию линейной зависимости уделяется значительное внимание.
В реальной ситуации наблюдаемые величины отклоняются от данной функциональной формы связи, поэтому в регрессионную модель включается стохастическая составляющая 
В классической линейной эконометрической модели переменная s интерпретируется как случайная переменная, которая имеет нормальный закон распределения с математическим ожиданием, равным нулю, и постоянной дисперсией.
Парная регрессия. Однофакторные линейные эконометрические модели
Простейшими эконометрическими моделями являются модели парной регрессии. Парная регрессия представляет собой зависимость между двумя переменными — 


Здесь 





Таким образом, 




В парной регрессии выбор вида математической функции (спецификация) 
1) графическим;
2) аналитическим, т.е. исходя из теории изучаемой взаимосвязи;
3) экспериментальным.
Чаще всего эти способы применяют комплексно.
Графический способ основан на внешнем виде корреляционного поля. Напомним, что корреляционным полем называют множество точек 


Если точки корреляционного поля выстраиваются как бы вдоль гипотетической прямой, то в качестве модели парной регрессии следует брать линейную модель:

В противном случае нужно выбирать нелинейную модель.
Аналитический способ выбора типа уравнения регрессии основан на изучении материальной природы связи исследуемых признаков. Здесь важную роль играет опыт экономиста, который знаком с наработанными схемами зависимостей между социально-экономическими показателями.
При использовании экспериментального способа сравнивают величины остаточной дисперсии, рассчитанной для разных моделей:

Чем меньше величина остаточной дисперсии 
В эконометрическом моделировании следует придерживаться принципа — чем сложнее модель, тем большее количество наблюдений 
Сложность модели можно определить показателем 


Например, 

Соответственно 

При построении эконометрической модели необходимо придерживаться статистического правила:

Таким образом, если 



Простейшими эконометрическими моделями являются однофакторные линейные модели парной регрессии. В этом случае предполагается, что между двумя исследуемыми показателями существует линейная корреляционная зависимость. В общем виде однофакторная линейная эконометрическая модель имеет вид:

где 



Чтобы найти уравнение регрессии, необходимо найти неизвестные параметры 

При нахождении оценок параметров уравнения регрессии возникает вопрос, каким критерием следует воспользоваться, чтобы найденная прямая наиболее точно отражала зависимость между показателями. В любом случае расчетные значения зависимой переменной, найденные с помощью уравнения регрессии, будут отклоняться истинных наблюдений.
В качестве критерия можно было бы рассматривать сумму этих отклонений. Однако, поскольку одни имеют разные знаки, то при суммировании будут взаимно «погашаться». Чтобы избежать этого, в качестве критерия предлагается рассматривать сумму квадратов этих отклонений. Этот принцип и лежит в основе метода наименьших квадратов (МНК).
Постановка задачи следующая. Уравнение регрессии будем искать в виде:

где 






Заметим, что применение МНК возможно при выполнении следующих условий:
- Математическое ожидание остатков (ошибок) равно нулю.
- Случайные величины
имеют одинаковую дисперсию.
- Остатки распределены по нормальному закону с математическим ожиданием, равным нулю и постоянной дисперсией.
Рассмотрим сумму квадратов отклонений как функцию двух переменных 

Для того чтобы найти минимум этой функции, вычислим ее частные производные первого порядка по переменным 

После преобразований получаем систему нормальных уравнений:

Решаем её относительно 


Отметим следующее свойство оценок МНК: линия регрессии всегда проходит через среднюю точку 



Преобразовав формулу, имеем:

Умножив числитель и знаменатель на 

Рассмотрим экономический смысл этого коэффициента. Если в уравнении регрессии 


Таким образом, коэффициент регрессии в линейной модели показывает, на сколько единиц в среднем изменится зависимая переменная, если независимую переменную увеличить на единицу при прочих неизменных условиях. Значению свободного члена 
Задача №1.1.
В таблице 1.1 приведены данные за восемь лет об объёме прямых иностранных инвестициях (далее ПИИ) в экономику страны и объёме валового внутреннего продукта (далее ВВП).

Необходимо найти уравнение линейной регрессии, отражающее зависимость ВВП от ПИИ.
Решение:
Введём в MS Excel данные. С помощью «Мастера диаграмм» построим точечную диаграмму — корреляционное поле (рис. 1.2).

Для упрощения расчётов составим таблицу 1.2.

Найдём оценки параметров уравнения регрессии, используя формулы:


Уравнение регрессии имеет вид:

Коэффициент регрессии 
Проверка адекватности однофакторной линейной эконометрической модели, значимости её параметров и построение прогнозов
Следующий этап эконометрического моделирования заключается в оценке качества полученного уравнения и его параметров.
Для оценки тесноты и направления связи между двумя показателями используется коэффициент парной корреляции. Его можно вычислить по формуле:

где 



Для вычисления коэффициента парной корреляции можно также использовать преобразованную формулу:

В отличие от коэффициента регрессии, коэффициент корреляции является показателем относительной меры связи между двумя показателями. Значения коэффициента корреляции всегда находятся в пределах:

Положительное значение коэффициента свидетельствует о прямой связи, т.е. с увеличением независимой переменной 

Если модуль коэффициента парной корреляции близок к 1 

Если 




В случае, когда 



Таким образом, коэффициент парной корреляции характеризует тесноту и направление линейной связи между показателями. Следует отметить, что знак коэффициента корреляции всегда совпадает со знаком коэффициента регрессии.
Связь между коэффициентом парной корреляции 


Ещё одним показателем адекватности линейной модели является коэффициент детерминации 

где 

Эти показатели вычисляются по формулам:

Таким образом, коэффициент детерминации — это часть дисперсии, которая объясняет регрессию. Величина коэффициента детерминации изменяется в пределах от нуля до единицы:

Если значение 
Кроме того, коэффициент детерминации показывают, какая часть вариации (изменения) зависимой переменной 



Рассмотренные выше коэффициенты парной корреляции и детерминации, как показатели адекватности модели, имеют между собой связь, которая выражается формулой:
т.е. коэффициент детерминации равен квадрату коэффициента корреляции.
Осуществляется также проверка значимости коэффициента корреляции, которая подразумевает проверку статистической гипотезы 



Для проверки гипотезы рассчитывается 

где 
Для заданного уровня значимости (допустимой вероятности ошибки) 



Для проверки значимости параметров уравнения парной регрессии 



В знаменателях этих дробей стоят случайные ошибки параметров эконометрической модели:

где 
Найденные расчётные значения берут по модулю и сравнивают с табличным 


Замечание 1.1. Требование значимости коэффициента регрессии 

Для проверки адекватности эконометрической модели используют 

Данное число сравнивается с табличным значением распределения Фишера, найденного по заданному уровню значимости 


Возможно эта страница вам будет полезна:
Задача №1.2.
По данным примера 1.1 найти значение коэффициентов парной корреляции и детерминации. Проверить значимость коэффициента корреляции, параметров регрессии и значимость модели в целом при уровне значимости 
Согласно таблице 1.1, объём ПИИ в последнем временном периоде составлял 


Решение:
Рассчитаем линейный коэффициент корреляции:

Близость коэффициента корреляции к единице указывает на тесную линейную связь между признаками. Коэффициент детерминации

показывает, что уравнением регрессии объясняется 98,41% дисперсии результативного признака, а на долю прочих факторов приходится 1,59%.
Проверим значимость коэффициента парной корреляции по критерию Стьюдента. Расчётное значение критерия равно:

По уровню значимости 


Расчётное значение, взятое по модулю, больше табличного. Следовательно, коэффициент корреляции является значимым с надёжностью не менее 95% 
Для оценки статистической значимости параметров регрессии рассчитаем 


Табличное значение 



Модули обоих расчётных значения больше табличного, поэтому признаём статистическую значимость параметров регрессии с надёжностью не менее 95%.
Оценим качество уравнения регрессии в целом с помощью 


Количество степеней свободы для критерия Фишера 



Так как 
Для вычисления точечного прогноза объёма ВВП достаточно в уравнение регрессии подставить предполагаемый объём ПИИ, т.е. 30,72 млрд. долл. Точечный прогноз для ВВП будет следующим:

Ошибка прогноза составляет:
Интервальный прогноз для 

Поэтому доверительный интервал будет следующим:

Замечание 1.2. Эконометрическую модель можно считать достоверной, если построенные с помощью неё прогнозы отклоняются от фактических данных не более, чем на 10%. Модель из Задача 1.1 была построена по статистическим данным 2007-2014 гг. Фактические данные за 2015 г. составили 



Абсолютное отклонение составит:

Относительное отклонение:

Так как 
Оценивание параметров в однофакторных нелинейных эконометрических моделях
Необходимость построения нелинейных моделей парной регрессии приводит к некоторому усложнению преобразований данных и вычислений. Однако при современном развитии информационных технологий эти трудности вполне преодолимы.
Задача №1.3.
В таблице 1.3 приведены данные по десяти однотипным заводам, специализирующихся на ремонте шахтного оборудования в Донецком регионе. Годовой объём выпуска продукции 

Требуется:
1) средствами MS Excel построить нелинейные уравнения парной регрессии 

2) выбрать лучшую модель.
Решение:
Принято различать два класса уравнений нелинейных регрессий. Первый из них включает нелинейные уравнения относительно объясняющих переменных, но линейные по оцениваемым параметрам.
К ним, например, относятся: многочлены (полиномы) различных степеней

и т.д.; равносторонняя гипербола

полулогарифмическая функция

Регрессии первого класса приводятся к линейному виду заменой переменных. Дальнейшая оценка параметров производится с помощью МНК.
Например, парабола второй степени

приводится к линейному виду с помощью замены:

В результате приходим к двухфакторному уравнению

оценка параметров которого осуществляется при помощи МНК.
Равносторонняя гипербола

может быть использована для характеристики связи удельных расходов сырья, материалов, топлива от объёма выпускаемой продукции, времени обращения товаров от величины товарооборота, процента прироста заработной платы от уровня безработицы (кривая Филипса), расходов на непродовольственные товары от доходов или общей суммы расходов (кривые Энгеля) и в других случаях. Гипербола приводится к линейному уравнению заменой: 


Второй класс нелинейных уравнений — регрессии, нелинейные по оцениваемым параметрам. К ним, например, относятся: степенная 


Покажем, как это делается на примере степенной функции 

где

Таким образом, мы применяем МНК к преобразованным данным, а затем потенцированием (обратная замена) находим искомое уравнение.
Широкое использование степенной функции связано с тем, что параметр 
Такие задачи удобно решать в MS Excel. Для этого нужно выполнить следующую последовательность действий:
• ввести экспериментальные данные в столбцы (или построчно);
• на основании введённых данных построить точечную диаграмму;
• активизировать данные диаграммы, щелкнув по точкам левой кнопкой «мыши»;
• в пункте меню «Диаграмма» выбрать опцию «Добавить линию тренда…»;
• в пункте меню «Тип» выбрать «Полиномиальная (степень 2-я)» или «Логарифмическая», или «Степенная», или «Экспоненциальная»;
• в пункте «Параметры» — «Показывать уравнение на диаграмме» и «Поместить на диаграмму величину достоверности аппроксимации (R1)».
Для величины достоверности аппроксимации выполняется неравенство: 


На рис. 1.3-1.6 поместим корреляционное поле, соответствующую линию регрессии, уравнение регрессии и величину достоверности аппроксимации 


Наибольшую величину достоверности аппроксимации 
Однако ранее было приведено статистическое правило:

Полиномиальная модель второй степени

имеет два неизвестных параметра 





Т.к. в Задаче 1.3 имеем 
Среди оставшихся моделей наибольшую величину достоверности аппроксимации 

Введём замену 

Логарифмируя обе части уравнения, получим

Следовательно, экспоненциальная модель имеет один неизвестный параметр 




Значит, лучшей моделью является экспоненциальная модель (рис. 1.6),

Задача 1.3 выполнена.
Заканчивая эту главу, заметим, что, эконометрические модели парной регрессии описаны во многих учебниках и учебных пособиях. Несмотря на свою простоту, эти модели весьма востребованы в практических задачах экономики.
Множественная регрессия в эконометрических задачах. Производственная функция Кобба-Ду гласа в эконометрическом моделировании
Американский экономист Пол Дуглас в 30-е годы XX в. наблюдал за данными перерабатывающей промышленности США на протяжении двадцати лет и заметил зависимость между экономическими показателями. Он не сумел определить функцию, описывающую эту зависимость, и обратился в 1927 г. к математику Чарльзу Коббу, который предложил следующую функцию:

где 




Так появилась производственная функция Кобба-Дугласа, принадлежащая к наиболее известным производственным функциям, широко применяемым в экономических исследованиях.
С точки зрения эконометрии эта функция — не что иное, как двух-факторная нелинейная регрессионная модель. С точки зрения математики — мультипликативная степенная функция.
Для определения неизвестных параметров этой модели прологарифмируем левую и правую части функции:

Введём замены

и получим линейную модель

С помощью МНК будем искать параметры 


Продемонстрируем на конкретных данных этапы построения производственной функции Кобба-Дугласа.
Задача №2.1.
Финансово-промышленная группа «Росслад» владеет шестнадцатью заводами по производству сахара. Имеются данные (табл. 9.3) прошлого года о выпуске продукции у (млн. руб.), затратах труда 


Требуется:
A) Построить производственную функцию Кобба-Дугласа. Б) Рассчитать характеристики:
1) среднюю производительность труда;
2) среднюю фондоотдачу;
3) предельную производительность труда;
4) предельную фондоотдачу;
5) эластичность выпуска продукции по затратам труда;
6) эластичность выпуска продукции по ПФ;
7) потребность в ресурсах труда;

9) фондовооружённость труда;
10) предельную норму замещения затрат труда производственными фондами;
11) эластичность замещения ресурсов.
B) Найти прогноз выпуска 


Решение:
А) Составим расчётную таблицу 2.2.

Для наших данных система нормальных уравнений будет следующей:

Введём в рассмотрение матрицы

Запишем систему в матричном виде

Согласно методу обратной матрицы

Обратную матрицу находим с помощью Microsoft Excel. Напомним, что операции с матрицами желательно завершать нажатием клавиши «F2» и «Ctrl+Shift+Enter». Итак, имеем:

Так как

Значения неизвестных параметров:

Производственная функция Кобба-Дугласа имеет вид:

Б) Рассчитаем основные характеристики производственной функции: 1) средняя производительность труда равна:
Следовательно, с увеличением затрат труда 

2) средняя фондоотдача равна:

Таким образом, с увеличением затрат ПФ (при неизменных затратах труда) средняя фондоотдача снижается. Увеличение же затрат труда (при неизменных затратах ПФ) ведёт к росту средней фондоотдачи; 3) предельная производительность труда:

Следовательно, с увеличением затрат труда (при неизменных затратах ПФ) предельная производительность труда снижается. Наоборот, увеличение затрат ПФ (при неизменных затратах труда) ведёт к росту предельной производительности труда;
4) предельная фондоотдача:

Таким образом, с увеличением затрат ПФ (при неизменных затратах труда) предельная фондоотдача снижается. Увеличение же затрат труда (при неизменных затратах ПФ) ведёт к росту предельной фондоотдачи; 5) эластичность выпуска продукции по затратам труда:

Данный показатель указывает на то, что при увеличении затрат труда 

При увеличении ПФ на 1% выпуск продукции может предельно увеличиться на 0,6892%;
7) производственная функция позволяет рассчитать потребность в одном из ресурсов при заданном объеме выпуска продукции 
Потребность в ресурсах труда:



9) производственная функция позволяет исследовать вопросы соотношения, замещения, взаимодействия ресурсов. В частности, определяется важный экономический показатель — фондовооружённость труда:

10) взаимодействующие в рамках производственной функции ресурсы могут замещать друг друга. Предельная норма замещения затрат труда 


Предельная норма замещения зависит не только от параметров 


11) влияние соотношения объемов ресурсов на предельную норму замещения 

Эластичность замещения ресурсов для производственной функции Кобба-Дугласа всегда равна единице. Т.е. изменению фондовооружённости труда на 1% соответствует изменение предельной нормы замещения также на 1%.
В) Найдём точечный прогноз выпуска продукции для заданных значений


Задача 2.1 решена полностью.
Многофакторные линейные эконометрические модели
Ввиду чёткой интерпретации результатов наиболее широко в множественной регрессии используется линейная функция.
Рассмотрим многофакторную линейную эконометрическую модель:

Ей соответствует линейное уравнение множественной регрессии

Параметры, являющиеся множителями при независимых переменных, называются коэффициентами «чистой» регрессии. Они характеризуют среднее изменение результата с изменением соответствующего фактора на единицу при неизмененном значении других факторов.
Классический подход к оцениванию параметров линейной модели множественной регрессии основан на МНК:

Задача №2.2.
Открытое акционерное общество «РосСельхозХолдинг» более десяти лет производит пшеницу в своих тридцати агроцехах, расположенных в разных областях Российской Федерации. Имеются данные прошлого года (табл. 9.5) о прибыли предприятия 
удельном весе сельскохозяйственных рабочих в составе агроцеха 






Предполагая, что между переменной 

- Найти линейное уравнение множественной регрессии;
- С помощью алгоритма пошаговой регрессии построить эконометрическую модель с максимальным числом значимых коэффициентов при уровне значимости 0,05.
- Построить точечный и интервальный прогнозы для
при допущении, что средние показатели по независимым переменным будут превышены на 5%.
Решение:
В Microsoft Excel имеется пункт меню «Сервис», который содержит надстройку «Анализ данных». В нём выбираем инструмент анализа «Регрессия». Вводим входной интервал для у и входной интервал для 



- Столбец «Коэффициенты» (рис. 2.1) содержит найденные параметры уравнения регрессии. Т.о. линейная пятифакторная регрессионная модель имеет вид:

По коэффициентам регрессии можно давать объяснения. Например, если текучесть кадров 


- Прокомментируем данные отчета на рис. 9.8.
Множественный коэффициент корреляции 



Множественный коэффициент детерминации 



В разделе «Дисперсионный анализ» (рис. 9.8) на пересечении строки «Остаток» и столбца «MS» находится несмещённая оценка дисперсии остатков 


Раздел «Дисперсионный анализ» называют ANOVA-таблицей (analysis of variance). Она содержит обозначение 



Значимость уравнения множественной регрессии в целом определяется с помощью статистического 



Для нашей задаче:

Эту вероятность сравниваем с заданным уровнем значимости 

Последний раздел отчёта на рис. 9.8 содержит коэффициенты регрессии


В столбце «Стандартная ошибка» расположены
Для проверки значимости коэффициентов регрессии применяют статистический 




Они помещены в столбце «
Заметим, что свободный член 



Для нашей задачи (столбец «

Эти вероятности сравниваем с заданным уровнем значимости 

то оценки коэффициентов регрессии

не являются значимыми. Т.к.

то оценки коэффициентов регрессии

значимы с надёжностью не менее 95%.
Среди незначимых оценок наибольшая вероятность ошибки

поэтому переменная 
Такой подход называют алгоритмом пошагового регрессионного анализа. После завершения алгоритма мы получим уравнение регрессии с максимальным числом значимых коэффициентов.
На рис. 9.8 в столбцах «Нижние 95%» и «Верхние 95%» содержит интервальные оценки коэффициентов регрессии. Т.к. среди этих параметров оказались незначимые, то нет смысла давать объяснения их интервальным оценкам. Это будет сделано после построения окончательной модели.
Повторяем те же действия, что и в начале решения задачи. В Microsoft Excel в пункте меню «Сервис» выбираем пакет прикладных программ «Анализ данных». Пользуемся инструментом анализа «Регрессия». Вводим входной интервал для у и входной интервал для 

Получена линейная четырёхфакторная эконометрическая модель:

Т.к. множественный коэффициент корреляции 





Фактическое значение критерия Фишера составляет 



Найденная вероятность 



Вводим входной интервал для 

Линейная трёхфакторная эконометрическая модель имеет вид:

Отчет на рис. 9.10 содержит следующую информацию. Множественный коэффициент корреляции 




Фактическое значение критерия Фишера 


Столбец «

(свободный член 

Алгоритм пошагового регрессионного анализа завершён. Построенная трёхфакторная модель — это уравнение регрессии с максимальным числом 
В столбцах «Нижние 95%» и «Верхние 95%» содержит интервальные оценки параметров уравнения регрессии. Они вычислены по данным столбцов «Коэффициенты» и «Стандартная ошибка»:

Численные значения доверительных интервалов объясняют следующим образом. Например, точеная оценка 
- Построим точечный и интервальный прогнозы для прибыли предприятия v при допущении, что средние показатели по
будут превышены на 5%.
Так как

то предполагаемые значения:

Вектор предполагаемых значений:

Точечный прогноз для среднего значения прибыли агроцеха:

Вычислим дисперсию прогноза:

Извлекая квадратный корень, найдём среднеквадратическую ошибку прогноза 
Доверительный интервал для среднего значения (математического ожидания) прогноза зависимой переменной находим по формуле:

Рассчитаем дисперсию и среднее квадратическое отклонение индивидуального прогноза:

Доверительный интервал для индивидуального значения прогноза:

Задачи 2.2 выполнено полностью.
Возможно эта страница вам будет полезна:
Границы применимости классического метода наименьших квадратов в эконометрнческом моделировании
Рассмотрим многофакторную линейную эконометрическую модель:

При построении такой модели предполагают, что выполняются следующие гипотезы.
- Спецификация модели:

где 
- Числовые значения независимых переменных
являются детерминированными (не случайными) величинами. Векторы

являются линейно независимыми в пространстве 


Дисперсии:

Причём значения математических ожиданий и дисперсий ошибок не зависят от номера наблюдений 
- При
ковариации ошибок равны нулю:

Т.е. для разных наблюдений имеет место статистическая независимость (некоррелированность) ошибок.

При выполнении гипотез 1 — 5 эконометрическая модель называется нормальной линейной регрессионной моделью.
Важнейшую роль в эконометрическом анализе играет следующая теорема, формулировка которой приводится без доказательства.
Теорема Гаусса-Маркова. Предположим, что для линейной модели множественной регрессии выполняются гипотезы 1 — 4. Тогда оценки коэффициентов регрессии 
Заметим, что при невыполнении отдельных гипотез теорема Гаусса-Маркова становится неприменимой. Следовательно, и классический МНК не будет давать достоверных результатов.
Нарушение условия линейной независимости векторов 
2) приводит к нежелательному явлению, называемому мультиколлинеар-ностью. Условие независимости дисперсии ошибок от номера наблюдения (гипотеза 3) называется гомоскедастичностью. Нарушение данного условия называют гетероскедастичностью. Невыполнение гипотезы 4 называется автокорреляцией остатков.
В эконометрическом моделировании надо уметь выявлять эти нежелательные явления и устранять их. При невозможности устранения — научиться моделировать в условиях невозможности применения классического МНК.
Мультиколлинеарность в массиве независимых переменных эконометрической модели
Мультиколлинеарность означает существование тесной линейной зависимости, или сильной корреляции, между двумя или более объясняющими переменными.
Она негативно влияет на количественные характеристики эконометриче-ской модели, или делает её построение вообще невозможным.
Задача №2.3.
На производительность труда однотипных малых предприятий влияет ряд факторов, среди которых: удельный вес рабочих на предприятии 





Решение:
Исследуем мультпколлинеарность в массиве независимых переменных при помощи алгоритма Фаррара-Глобера. Расчёты проведём в Microsoft Excel, округляя числа до четвёртого знака после запятой.
- Нахождение корреляционной матрицы выполним с помощью встроенной функции «Корреляция» (Сервиз—>Анализ данных —> Корреляция), которая позволяет находить коэффициенты корреляции более чем двух факторов:

Её определитель: 
При 


- Определим фактическое значение критерия «хи»-квадрат Пирсона:

Фактическое значение критерия 




- С помощью функции МОБР() определим обратную матрицу:

- Вычисление
-критериев Фишера осуществляем по формуле

где 


Фактические значения критериев сравниваются с табличным 


Т.к. 


- Находим частные коэффициенты корреляции по формуле

где 







Вычисление 

Имеем

Фактические значения критериев сравниваются с табличным 


Т.к. 


Для того, чтобы избавиться от мультиколлинеарности, можно исключить одну из переменных мультиколлинеарной пары 



Гетсроскедастичность в эконометрическом моделировании
Условие независимости дисперсии ошибок от номера наблюдения называется гомоскедастичностью. Нарушение данного условия вызывает нежелательное явление, называемое гетероскедастичиостью.
Гетероскедастичность возникает, когда значения переменных в уравнении регрессии сильно отличаются в разных наблюдениях, т.е. если анализируемые объекты неоднородны. Неоднородность объектов может отражаться в несопоставимости их «размеров».
Например, в одну выборку объединены крупные и мелкие банки, у которых анализируется зависимость прибыли 

Неоднородность может также проявляться, когда в одну выборку объединяются предприятия разного профиля деятельности.
Часто при исследовании совокупности данных на гетероскедастичность предполагается, что дисперсия остатков пропорциональна квадрату значений одной из независимых переменных 
В этом случае наиболее эффективен параметрический тест Гольд-фельда-Квандта. Опишем его алгоритм.
Задача №2.4.
В таблице 2.5 приведены данные по зависимой переменной 


Решение:
Применим параметрический тест Гольдфельда-Квандта.
Предположим, что дисперсия остатков пропорциональна квадрату значений одной из независимых переменных 


Как видно из рис. 2.4 — 2.6 источником гетероскедастичности является, скорее всего, переменная 
Данные примут вид (табл. 2.6).
В MS Excel в пункте меню «Сервис» выбираем надстройку «Анализ данных». Пользуемся инструментом анализа «Регрессия». Вводим входной интервал для 




17 авг. 2022 г.
читать 2 мин
Всякий раз, когда мы подбираем модель линейной регрессии , модель принимает следующую форму:
Y = β 0 + β 1 X + … + β i X +ϵ
где ϵ — член ошибки, не зависящий от X.
Независимо от того, насколько хорошо можно использовать X для предсказания значений Y, в модели всегда будет какая-то случайная ошибка.
Одним из способов измерения дисперсии этой случайной ошибки является использование стандартной ошибки регрессионной модели , которая представляет собой способ измерения стандартного отклонения остатков ϵ.
В этом руководстве представлен пошаговый пример расчета стандартной ошибки регрессионной модели в Excel.
Шаг 1: Создайте данные
В этом примере мы создадим набор данных, содержащий следующие переменные для 12 разных учащихся:
- Оценка экзамена
- Часы, потраченные на учебу
- Текущая оценка
Шаг 2: Подгонка регрессионной модели
Далее мы подгоним модель множественной линейной регрессии , используя экзаменационный балл в качестве переменной ответа и часы обучения и текущую оценку в качестве переменных-предикторов.
Для этого щелкните вкладку « Данные » на верхней ленте, а затем щелкните « Анализ данных» :
Если вы не видите эту опцию доступной, вам нужно сначала загрузить Data Analysis ToolPak .
В появившемся окне выберите Регрессия.В появившемся новом окне заполните следующую информацию:
Как только вы нажмете OK , появится результат регрессионной модели:
Шаг 3: Интерпретируйте стандартную ошибку регрессии
Стандартная ошибка модели регрессии — это число рядом со стандартной ошибкой :
Стандартная ошибка этой конкретной модели регрессии оказывается равной 2,790029 .
Это число представляет собой среднее расстояние между фактическими результатами экзаменов и оценками экзаменов, предсказанными моделью.
Обратите внимание, что некоторые экзаменационные баллы будут отличаться от прогнозируемого более чем на 2,79 единицы, в то время как некоторые будут ближе. Но в среднем расстояние между реальными экзаменационными баллами и прогнозируемыми составляет 2,790029 .
Также обратите внимание, что меньшая стандартная ошибка регрессии указывает на то, что модель регрессии более точно соответствует набору данных.
Таким образом, если мы подгоним новую регрессионную модель к набору данных и получим стандартную ошибку, скажем, 4,53 , эта новая модель будет хуже предсказывать результаты экзаменов, чем предыдущая модель.
Дополнительные ресурсы
Другим распространенным способом измерения точности регрессионной модели является использование R-квадрата. Прочтите эту статью , чтобы получить хорошее объяснение преимуществ использования стандартной ошибки регрессии для измерения точности по сравнению с R-квадратом.
Средняя ошибка аппроксимации
Решение проводим при помощь онлайн калькулятора Линейное уравнение регрессии.
а) линейное уравнение регрессии;
Использование графического метода.
Этот метод применяют для наглядного изображения формы связи между изучаемыми экономическими показателями. Для этого в прямоугольной системе координат строят график, по оси ординат откладывают индивидуальные значения результативного признака Y, а по оси абсцисс — индивидуальные значения факторного признака X.
Совокупность точек результативного и факторного признаков называется полем корреляции.
Для наших данных система уравнений имеет вид
Из первого уравнения выражаем а и подставим во второе уравнение
Получаем b = -0.35, a = 76.88
Уравнение регрессии:
y = -0.35 x + 76.88
| x | y | x 2 | y 2 | x • y | y(x) | (y i -y cp ) 2 | (y-y(x)) 2 | |y — y x |:y |
| 45,1 | 68,8 | 2034,01 | 4733,44 | 3102,88 | 61,28 | 119,12 | 56,61 | 0,1094 |
| 59 | 61,2 | 3481 | 3745,44 | 3610,8 | 56,47 | 10,98 | 22,4 | 0,0773 |
| 57,2 | 59,9 | 3271,84 | 3588,01 | 3426,28 | 57,09 | 4,06 | 7,9 | 0,0469 |
| 61,8 | 56,7 | 3819,24 | 3214,89 | 3504,06 | 55,5 | 1,41 | 1,44 | 0,0212 |
| 58,8 | 55 | 3457,44 | 3025 | 3234 | 56,54 | 8,33 | 2,36 | 0,0279 |
| 47,2 | 54,3 | 2227,84 | 2948,49 | 2562,96 | 60,55 | 12,86 | 39,05 | 0,1151 |
| 55,2 | 49,3 | 3047,04 | 2430,49 | 2721,36 | 57,78 | 73,71 | 71,94 | 0,172 |
| 384,3 | 405,2 | 21338,41 | 23685,76 | 22162,34 | 405,2 | 230,47 | 201,71 | 0,5699 |
Примечание: значения y(x) находятся из полученного уравнения регрессии:
y(45.1) = -0.35*45.1 + 76.88 = 61.28
y(59) = -0.35*59 + 76.88 = 56.47
. . .
Ошибка аппроксимации
Оценим качество уравнения регрессии с помощью ошибки абсолютной аппроксимации. Средняя ошибка аппроксимации — среднее отклонение расчетных значений от фактических:
F-статистики. Критерий Фишера.
Проверка значимости модели регрессии проводится с использованием F-критерия Фишера, расчетное значение которого находится как отношение дисперсии исходного ряда наблюдений изучаемого показателя и несмещенной оценки дисперсии остаточной последовательности для данной модели.
Если расчетное значение с k1=(m) и k2=(n-m-1) степенями свободы больше табличного при заданном уровне значимости, то модель считается значимой.
где m – число факторов в модели.
Оценка статистической значимости парной линейной регрессии производится по следующему алгоритму:
1. Выдвигается нулевая гипотеза о том, что уравнение в целом статистически незначимо: H0: R 2 =0 на уровне значимости α.
2. Далее определяют фактическое значение F-критерия:
где m=1 для парной регрессии.
3. Табличное значение определяется по таблицам распределения Фишера для заданного уровня значимости, принимая во внимание, что число степеней свободы для общей суммы квадратов (большей дисперсии) равно 1 и число степеней свободы остаточной суммы квадратов (меньшей дисперсии) при линейной регрессии равно n-2.
4. Если фактическое значение F-критерия меньше табличного, то говорят, что нет основания отклонять нулевую гипотезу.
В противном случае, нулевая гипотеза отклоняется и с вероятностью (1-α) принимается альтернативная гипотеза о статистической значимости уравнения в целом.
Табличное значение критерия со степенями свободы k1=1 и k2=5, Fkp = 6.61
Поскольку фактическое значение F b
в) показательная регрессия;
г) модель равносторонней гиперболы.
Система нормальных уравнений.
Для наших данных система уравнений имеет вид
7a + 0.1291b = 405.2
0.1291a + 0.0024b = 7.51
Из первого уравнения выражаем а и подставим во второе уравнение
Получаем b = 1054.67, a = 38.44
Уравнение регрессии:
y = 1054.67 / x + 38.44
Ошибка аппроксимации.
Оценим качество уравнения регрессии с помощью ошибки абсолютной аппроксимации.
Метод аппроксимации в Microsoft Excel
Среди различных методов прогнозирования нельзя не выделить аппроксимацию. С её помощью можно производить приблизительные подсчеты и вычислять планируемые показатели, путем замены исходных объектов на более простые. В Экселе тоже существует возможность использования данного метода для прогнозирования и анализа. Давайте рассмотрим, как этот метод можно применить в указанной программе встроенными инструментами.
Выполнение аппроксимации
Наименование данного метода происходит от латинского слова proxima – «ближайшая» Именно приближение путем упрощения и сглаживания известных показателей, выстраивание их в тенденцию и является его основой. Но данный метод можно использовать не только для прогнозирования, но и для исследования уже имеющихся результатов. Ведь аппроксимация является, по сути, упрощением исходных данных, а упрощенный вариант исследовать легче.
Главный инструмент, с помощью которого проводится сглаживания в Excel – это построение линии тренда. Суть состоит в том, что на основе уже имеющихся показателей достраивается график функции на будущие периоды. Основное предназначение линии тренда, как не трудно догадаться, это составление прогнозов или выявление общей тенденции.
Но она может быть построена с применением одного из пяти видов аппроксимации:
- Линейной;
- Экспоненциальной;
- Логарифмической;
- Полиномиальной;
- Степенной.
Рассмотрим каждый из вариантов более подробно в отдельности.
Способ 1: линейное сглаживание
Прежде всего, давайте рассмотрим самый простой вариант аппроксимации, а именно с помощью линейной функции. На нем мы остановимся подробнее всего, так как изложим общие моменты характерные и для других способов, а именно построение графика и некоторые другие нюансы, на которых при рассмотрении последующих вариантов уже останавливаться не будем.
Прежде всего, построим график, на основании которого будем проводить процедуру сглаживания. Для построения графика возьмем таблицу, в которой помесячно указана себестоимость единицы продукции, производимой предприятием, и соответствующая прибыль в данном периоде. Графическая функция, которую мы построим, будет отображать зависимость увеличения прибыли от уменьшения себестоимости продукции.
- Для построения графика, прежде всего, выделяем столбцы «Себестоимость единицы продукции» и «Прибыль». После этого перемещаемся во вкладку «Вставка». Далее на ленте в блоке инструментов «Диаграммы» щелкаем по кнопке «Точечная». В открывшемся списке выбираем наименование «Точечная с гладкими кривыми и маркерами». Именно данный вид диаграмм наиболее подходит для работы с линией тренда, а значит, и для применения метода аппроксимации в Excel.
Существует ещё один вариант её добавления. В дополнительной группе вкладок на ленте «Работа с диаграммами» перемещаемся во вкладку «Макет». Далее в блоке инструментов «Анализ» щелкаем по кнопке «Линия тренда». Открывается список. Так как нам нужно применить линейную аппроксимацию, то из представленных позиций выбираем «Линейное приближение».
Если же вы выбрали все-таки первый вариант действий с добавлением через контекстное меню, то откроется окно формата.
В блоке параметров «Построение линии тренда (аппроксимация и сглаживание)» устанавливаем переключатель в позицию «Линейная».
При желании можно установить галочку около позиции «Показывать уравнение на диаграмме». После этого на диаграмме будет отображаться уравнение сглаживающей функции.
Также в нашем случае для сравнения различных вариантов аппроксимации важно установить галочку около пункта «Поместить на диаграмму величину достоверной аппроксимации (R^2)». Данный показатель может варьироваться от 0 до 1. Чем он выше, тем аппроксимация качественнее (достовернее). Считается, что при величине данного показателя 0,85 и выше сглаживание можно считать достоверным, а если показатель ниже, то – нет.
После того, как провели все вышеуказанные настройки. Жмем на кнопку «Закрыть», размещенную в нижней части окна.
Сглаживание, которое используется в данном случае, описывается следующей формулой:
В конкретно нашем случае формула принимает такой вид:
Величина достоверности аппроксимации у нас равна 0,9418, что является довольно приемлемым итогом, характеризующим сглаживание, как достоверное.
Способ 2: экспоненциальная аппроксимация
Теперь давайте рассмотрим экспоненциальный тип аппроксимации в Эксель.
- Для того, чтобы изменить тип линии тренда, выделяем её кликом правой кнопки мыши и в раскрывшемся меню выбираем пункт «Формат линии тренда…».
После этого запускается уже знакомое нам окно формата. В блоке выбора типа аппроксимации устанавливаем переключатель в положение «Экспоненциальная». Остальные настройки оставим такими же, как и в первом случае. Щелкаем по кнопке «Закрыть».
Общий вид функции сглаживания при этом такой:
где e – это основание натурального логарифма.
В конкретно нашем случае формула приняла следующую форму:
Способ 3: логарифмическое сглаживание
Теперь настала очередь рассмотреть метод логарифмической аппроксимации.
- Тем же способом, что и в предыдущий раз через контекстное меню запускаем окно формата линии тренда. Устанавливаем переключатель в позицию «Логарифмическая» и жмем на кнопку «Закрыть».
В общем виде формула сглаживания выглядит так:
где ln – это величина натурального логарифма. Отсюда и наименование метода.
В нашем случае формула принимает следующий вид:
Способ 4: полиномиальное сглаживание
Настал черед рассмотреть метод полиномиального сглаживания.
- Переходим в окно формата линии тренда, как уже делали не раз. В блоке «Построение линии тренда» устанавливаем переключатель в позицию «Полиномиальная». Справа от данного пункта расположено поле «Степень». При выборе значения «Полиномиальная» оно становится активным. Здесь можно указать любое степенное значение от 2 (установлено по умолчанию) до 6. Данный показатель определяет число максимумов и минимумов функции. При установке полинома второй степени описывается только один максимум, а при установке полинома шестой степени может быть описано до пяти максимумов. Для начала оставим настройки по умолчанию, то есть, укажем вторую степень. Остальные настройки оставляем такими же, какими мы выставляли их в предыдущих способах. Жмем на кнопку «Закрыть».
Линия тренда с использованием данного метода построена. Как видим, она ещё более изогнута, чем при использовании экспоненциальной аппроксимации. Уровень достоверности выше, чем при любом из использованных ранее способов, и составляет 0,9724.
Данный метод наиболее успешно можно применять в том случае, если данные носят постоянно изменчивый характер. Функция, описывающая данный вид сглаживания, выглядит таким образом:
В нашем случае формула приняла такой вид:
y=0,0015*x^2-1,7202*x+507,01
Теперь давайте изменим степень полиномов, чтобы увидеть, будет ли отличаться результат. Возвращаемся в окно формата. Тип аппроксимации оставляем полиномиальным, но напротив него в окне степени устанавливаем максимально возможное значение – 6.
Формула, которая описывает данный тип сглаживания, приняла следующий вид:
Способ 5: степенное сглаживание
В завершении рассмотрим метод степенной аппроксимации в Excel.
- Перемещаемся в окно «Формат линии тренда». Устанавливаем переключатель вида сглаживания в позицию «Степенная». Показ уравнения и уровня достоверности, как всегда, оставляем включенными. Жмем на кнопку «Закрыть».
Данный способ эффективно используется в случаях интенсивного изменения данных функции. Важно учесть, что этот вариант применим только при условии, что функция и аргумент не принимают отрицательных или нулевых значений.
Общая формула, описывающая данный метод имеет такой вид:
В конкретно нашем случае она выглядит так:
Как видим, при использовании конкретных данных, которые мы применяли для примера, наибольший уровень достоверности показал метод полиномиальной аппроксимации с полиномом в шестой степени (0,9844), наименьший уровень достоверности у линейного метода (0,9418). Но это совсем не значит, что такая же тенденция будет при использовании других примеров. Нет, уровень эффективности у приведенных выше методов может значительно отличаться, в зависимости от конкретного вида функции, для которой будет строиться линия тренда. Поэтому, если для этой функции выбранный метод наиболее эффективен, то это совсем не означает, что он также будет оптимальным и в другой ситуации.
Если вы пока не можете сразу определить, основываясь на вышеприведенных рекомендациях, какой вид аппроксимации подойдет конкретно в вашем случае, то есть смысл попробовать все методы. После построения линии тренда и просмотра её уровня достоверности можно будет выбрать оптимальный вариант.
Мы рады, что смогли помочь Вам в решении проблемы.
Помимо этой статьи, на сайте еще 11905 инструкций.
Добавьте сайт Lumpics.ru в закладки (CTRL+D) и мы точно еще пригодимся вам.
Отблагодарите автора, поделитесь статьей в социальных сетях.
Опишите, что у вас не получилось. Наши специалисты постараются ответить максимально быстро.
Содержание
- Тогда средняя ошибка аппроксимации равна
- Задача №3. Расчёт параметров регрессии и корреляции с помощью Excel
- Задание:
- Решение:
Тогда средняя ошибка аппроксимации равна
Таблица 3.1 – Исходные данные
| Область | Средний размер назначенных ежемесячных пенсий, у.д.е., у | Прожиточный минимум в среднем на одного пенсионера в месяц, у.д.е., х |
| Орловская | ||
| Рязанская | ||
| Смоленская | ||
| Тверская | ||
| Тульская | ||
| Ярославская |
Эмпирические коэффициенты регрессии b0, b1 будем определять с помощью инструмента «Регрессия» надстройки «Анализ данных» табличного процессораMS Excel.
Алгоритм определения коэффициентов состоит в следующем.
1. Вводимисходные данные в табличный процессор MS Excel.
2. Вызываемнадстройку Анализ данных(рисунок 2).
3.Выбираем инструмент анализа Регрессия(рисунок 3).
4. Заполняем соответствующие позиции окна Регрессия (рисунок 4).
5. Нажимаем кнопку ОК окна Регрессия и получаем протокол решения задачи (рисунок 5)
Рисунок 2 – Активизация надстройки Анализ данных
Рисунок 3 – Выбор инструмента Регрессия

Рисунок 4 – Окно Регрессия
Рисунок 5 – Протокол решения задачи
Из рисунка 5 видно, что эмпирические коэффициенты регрессии соответственно равны
b1 = 0, 0088.
Тогда уравнение парной линейной регрессии, связывающая величину ежемесячной пенсии у с величиной прожиточного минимумахимеет вид

Далее, в соответствии с заданием необходимо оценить тесноту статистической связи между величиной прожиточного минимума х и величиной ежемесячной пенсии у. Эту оценку можно сделать с помощью коэффициента корреляции 
Параметр «R – квадрат», представленныйна рисунке 5 представляет собой квадрат коэффициента корреляции 

На следующем этапе, в соответствии с заданием необходимо определить степень связи объясняющей переменной х с зависимой переменной у, используя коэффициент эластичности. Коэффициент эластичности для модели парной линейной регрессии определяется в виде:

Следовательно, при изменении прожиточного минимума на 1% величина ежемесячной пенсии изменяется на 0,000758%.
Далее определяем среднюю ошибку аппроксимации по зависимости

Для этого исходную таблицу 1 дополняем двумя колонками, в которых определяем значения, 

Таблица 3.2. Расчет средней ошибки аппроксимации.
| Область | Средний размер назначенных ежемесячных пенсий, у.д.е., у | Прожиточный минимум в среднем на одного пенсионера в месяц, у.д.е., х | ![]() |
![]() |
| Орловская | 0,032 | |||
| Рязанская | 0,045 | |||
| Смоленская | 0,021 | |||
| Тверская | 0,012 | |||
| Тульская | 0,028 | |||
| Ярославская | 0,017 | |||
| S=0,155 |
Тогда средняя ошибка аппроксимации равна

Из практики известно, что значение средней ошибки аппроксимации не должно превышать (12…15)%
На последнем этапе выполним оценкустатистической надежности моделирования спомощью F – критерия Фишера. Для этого выполним проверку нулевой гипотезы Н0 о статистической не значимости полученного уравнения регрессиипо условию:
если при заданном уровне значимости a = 0,05 теоретическое (расчетное) значение F-критерия больше его критического значения Fкрит (табличного), то нулевая гипотеза отвергается, и полученное уравнение регрессии принимается значимым.
Из рисунка 5 следует, что Fрасч = 0,0058. Критическое значение F-критерия определяем с помощью использования статистической функции FРАСПОБР (рисунок 6). Входными параметрами функции является уровень значимости (вероятность) и число степеней свободы 1 и 2. Для модели парной регрессии число степеней свободы соответственно равно 1 (одна объясняющая переменная) и n-2 = 6-2=4.
Рисунок 6 – Окно статистической функции FРАСПОБР
Из рисунка 6 видно, что критическое значение F-критерия равно 7,71.
Источник
Задача №3. Расчёт параметров регрессии и корреляции с помощью Excel
По территориям региона приводятся данные за 200Х г.
| Номер региона | Среднедушевой прожиточный минимум в день одного трудоспособного, руб., х | Среднедневная заработная плата, руб., у |
|---|---|---|
| 1 | 78 | 133 |
| 2 | 82 | 148 |
| 3 | 87 | 134 |
| 4 | 79 | 154 |
| 5 | 89 | 162 |
| 6 | 106 | 195 |
| 7 | 67 | 139 |
| 8 | 88 | 158 |
| 9 | 73 | 152 |
| 10 | 87 | 162 |
| 11 | 76 | 159 |
| 12 | 115 | 173 |
Задание:
1. Постройте поле корреляции и сформулируйте гипотезу о форме связи.
2. Рассчитайте параметры уравнения линейной регрессии

3. Оцените тесноту связи с помощью показателей корреляции и детерминации.
4. Дайте с помощью среднего (общего) коэффициента эластичности сравнительную оценку силы связи фактора с результатом.
5. Оцените с помощью средней ошибки аппроксимации качество уравнений.
6. Оцените с помощью F-критерия Фишера статистическую надёжность результатов регрессионного моделирования.
7. Рассчитайте прогнозное значение результата, если прогнозное значение фактора увеличится на 10% от его среднего уровня. Определите доверительный интервал прогноза для уровня значимости 
8. Оцените полученные результаты, выводы оформите в аналитической записке.
Решение:
Решим данную задачу с помощью Excel.
1. Сопоставив имеющиеся данные х и у, например, ранжировав их в порядке возрастания фактора х, можно наблюдать наличие прямой зависимости между признаками, когда увеличение среднедушевого прожиточного минимума увеличивает среднедневную заработную плату. Исходя из этого, можно сделать предположение, что связь между признаками прямая и её можно описать уравнением прямой. Этот же вывод подтверждается и на основе графического анализа.
Чтобы построить поле корреляции можно воспользоваться ППП Excel. Введите исходные данные в последовательности: сначала х, затем у.
Выделите область ячеек, содержащую данные.
Затем выберете: Вставка / Точечная диаграмма / Точечная с маркерами как показано на рисунке 1.
Рисунок 1 Построение поля корреляции
Анализ поля корреляции показывает наличие близкой к прямолинейной зависимости, так как точки расположены практически по прямой линии.
2. Для расчёта параметров уравнения линейной регрессии
воспользуемся встроенной статистической функцией ЛИНЕЙН.
1) Откройте существующий файл, содержащий анализируемые данные;
2) Выделите область пустых ячеек 5×2 (5 строк, 2 столбца) для вывода результатов регрессионной статистики.
3) Активизируйте Мастер функций: в главном меню выберете Формулы / Вставить функцию.
4) В окне Категория выберете Статистические, в окне функция – ЛИНЕЙН. Щёлкните по кнопке ОК как показано на Рисунке 2;
Рисунок 2 Диалоговое окно «Мастер функций»
5) Заполните аргументы функции:
Известные значения у – диапазон, содержащий данные результативного признака;
Известные значения х – диапазон, содержащий данные факторного признака;
Константа – логическое значение, которое указывает на наличие или на отсутствие свободного члена в уравнении; если Константа = 1, то свободный член рассчитывается обычным образом, если Константа = 0, то свободный член равен 0;
Статистика – логическое значение, которое указывает, выводить дополнительную информацию по регрессионному анализу или нет. Если Статистика = 1, то дополнительная информация выводится, если Статистика = 0, то выводятся только оценки параметров уравнения.
Щёлкните по кнопке ОК;
Рисунок 3 Диалоговое окно аргументов функции ЛИНЕЙН
6) В левой верхней ячейке выделенной области появится первый элемент итоговой таблицы. Чтобы раскрыть всю таблицу, нажмите на клавишу , а затем на комбинацию клавиш + + .
Дополнительная регрессионная статистика будет выводиться в порядке, указанном в следующей схеме:
| Значение коэффициента b | Значение коэффициента a |
| Стандартная ошибка b | Стандартная ошибка a |
| Коэффициент детерминации R 2 | Стандартная ошибка y |
| F-статистика | Число степеней свободы df |
| Регрессионная сумма квадратов |
Остаточная сумма квадратов
Рисунок 4 Результат вычисления функции ЛИНЕЙН
Получили уровнение регрессии:
Делаем вывод: С увеличением среднедушевого прожиточного минимума на 1 руб. среднедневная заработная плата возрастает в среднем на 0,92 руб.
3. Коэффициент детерминации 
По вычисленному коэффициенту детерминации 

Связь оценивается как тесная.
4. С помощью среднего (общего) коэффициента эластичности определим силу влияния фактора на результат.
Для уравнения прямой 
Средние значения найдём, выделив область ячеек со значениями х, и выберем Формулы / Автосумма / Среднее, и то же самое произведём со значениями у.
Рисунок 5 Расчёт средних значений функции и аргумент
Таким образом, при изменении среднедушевого прожиточного минимума на 1% от своего среднего значения среднедневная заработная плата изменится в среднем на 0,51%.
С помощью инструмента анализа данных Регрессия можно получить:
— результаты регрессионной статистики,
— результаты дисперсионного анализа,
— результаты доверительных интервалов,
— остатки и графики подбора линии регрессии,
— остатки и нормальную вероятность.
Порядок действий следующий:
1) проверьте доступ к Пакету анализа. В главном меню последовательно выберите: Файл/Параметры/Надстройки.
2) В раскрывающемся списке Управление выберите пункт Надстройки Excel и нажмите кнопку Перейти.
3) В окне Надстройки установите флажок Пакет анализа, а затем нажмите кнопку ОК.
• Если Пакет анализа отсутствует в списке поля Доступные надстройки, нажмите кнопку Обзор, чтобы выполнить поиск.
• Если выводится сообщение о том, что пакет анализа не установлен на компьютере, нажмите кнопку Да, чтобы установить его.
4) В главном меню последовательно выберите: Данные / Анализ данных / Инструменты анализа / Регрессия, а затем нажмите кнопку ОК.
5) Заполните диалоговое окно ввода данных и параметров вывода:
Входной интервал Y – диапазон, содержащий данные результативного признака;
Входной интервал X – диапазон, содержащий данные факторного признака;
Метки – флажок, который указывает, содержит ли первая строка названия столбцов или нет;
Константа – ноль – флажок, указывающий на наличие или отсутствие свободного члена в уравнении;
Выходной интервал – достаточно указать левую верхнюю ячейку будущего диапазона;
6) Новый рабочий лист – можно задать произвольное имя нового листа.
Затем нажмите кнопку ОК.
Рисунок 6 Диалоговое окно ввода параметров инструмента Регрессия
Результаты регрессионного анализа для данных задачи представлены на рисунке 7.
Рисунок 7 Результат применения инструмента регрессия
5. Оценим с помощью средней ошибки аппроксимации качество уравнений. Воспользуемся результатами регрессионного анализа представленного на Рисунке 8.
Рисунок 8 Результат применения инструмента регрессия «Вывод остатка»
Составим новую таблицу как показано на рисунке 9. В графе С рассчитаем относительную ошибку аппроксимации по формуле:
Рисунок 9 Расчёт средней ошибки аппроксимации
Средняя ошибка аппроксимации рассчитывается по формуле:
Качество построенной модели оценивается как хорошее, так как 
6. Из таблицы с регрессионной статистикой (Рисунок 4) выпишем фактическое значение F-критерия Фишера:
Поскольку 
8. Оценку статистической значимости параметров регрессии проведём с помощью t-статистики Стьюдента и путём расчёта доверительного интервала каждого из показателей.
Выдвигаем гипотезу Н0 о статистически незначимом отличии показателей от нуля:


На рисунке 7 имеются фактические значения t-статистики:
t-критерий для коэффициента корреляции можно рассчитать двумя способами:
I способ:
где 
Данные для расчёта возьмём из таблицы на Рисунке 7.
II способ:
Фактические значения t-статистики превосходят табличные значения:
Поэтому гипотеза Н0 отклоняется, то есть параметры регрессии и коэффициент корреляции не случайно отличаются от нуля, а статистически значимы.
Доверительный интервал для параметра a определяется как
Для параметра a 95%-ные границы как показано на рисунке 7 составили:
Доверительный интервал для коэффициента регрессии определяется как
Для коэффициента регрессии b 95%-ные границы как показано на рисунке 7 составили:
Анализ верхней и нижней границ доверительных интервалов приводит к выводу о том, что с вероятностью 
7. Полученные оценки уравнения регрессии позволяют использовать его для прогноза. Если прогнозное значение прожиточного минимума составит:
Тогда прогнозное значение прожиточного минимума составит:
Ошибку прогноза рассчитаем по формуле:
где
Дисперсию посчитаем также с помощью ППП Excel. Для этого:
1) Активизируйте Мастер функций: в главном меню выберете Формулы / Вставить функцию.
2) В окне Категория выберете Статистические, в окне функция – ДИСП.Г. Щёлкните по кнопке ОК.
3) Заполните диапазон, содержащий числовые данные факторного признака. Нажмите ОК.
Рисунок 10 Расчёт дисперсии
Получили значение дисперсии
Для подсчёта остаточной дисперсии на одну степень свободы воспользуемся результатами дисперсионного анализа как показано на Рисунке 7.
Доверительные интервалы прогноза индивидуальных значений у при 
Интервал достаточно широк, прежде всего, за счёт малого объёма наблюдений. В целом выполненный прогноз среднемесячной заработной платы оказался надёжным.
Условие задачи взято из: Практикум по эконометрике: Учеб. пособие / И.И. Елисеева, С.В. Курышева, Н.М. Гордеенко и др.; Под ред. И.И. Елисеевой. – М.: Финансы и статистика, 2003. – 192 с.: ил.
Источник
Как Найти Среднюю Относительную Ошибку Аппроксимации в Excel
Оценка этой формы связи по коэффициенту множественной корреляции и средней ошибке аппроксимации показывает, что адекватность данной модели не подтверждается. Действительно, хотя значение коэффициента достаточно высокое (0,92), средняя ошибка аппроксимации составляет более 10% (I = 14,5%). Поэтому данная форма должна быть исключена из перебора известных уравнений регрессии. [c.29]
Анализ полученной формы связи по той же причине, что и в первом случае, позволяет сделать вывод о непригодности и этой модели. Коэффициент множественной корреляции хотя и имеет более высокое значение, чем в линейной зависимости (0,93), но по величине средней ошибки аппроксимации (б = 12,4%) это уравнение регрессии подлежит исключению из дальнейшего перебора. [c.29]
Оценка полученной модели по статистическим характеристикам показывает, что колеблемость затрат исследуемой подсистемы на 85 % обусловлена колеблемостью факторов, включенных в модель, коэффициент множественной корреляции высокий (/ = 0,92) и существенный (f = = 39,8), модель является адекватной, средняя ошибка аппроксимации (ё = 5,7%) меньше 10%. [c.39]
Статистический анализ показывает, что уравнение значимо Рф = 5,054 при /»табл = 3,01, корреляционное отношение равно 0,9959, ее»стандартная ошибка равна 0,0015. Среднее квадратическое отклонение расчетной себестоимости от фактической равно 0,018. Средняя ошибка аппроксимации 1,1%. [c.90]
В случаях, когда трудно обосновать форму зависимости, решение задачи можно провести по разным моделям и сравнить полученные результаты. Адекватность разных моделей фактическим зависимостям проверяется по критерию Фишера, показателю средней ошибки аппроксимации и величине множественного коэффициента детерминации, о которых речь пойдет несколько позже (см. 7.4). [c.144]
Эти сведения вводятся в ПЭВМ и рассчитываются матрицы парных и частных коэффициентов корреляции, уравнение множественной регрессии, а также показатели, с помощью которых оценивается надежность коэффициентов корреляции и уравнения связи критерий Стьюдента, критерий Фишера, средняя ошибка аппроксимации, множественные коэффициенты корреляции и детерминации. [c.145]
Для того чтобы убедиться в надежности уравнения связи и правомерности его использования для практической цели, необходимо дать статистическую оценку надежности показателей связи. Для этого используются критерий Фишера (F-отношение), средняя ошибка аппроксимации ( ), коэффициенты множественной корреляции (/ ) и детерминации (D). [c.151]
Для статистической оценки точности уравнения связи используется также средняя ошибка аппроксимации [c.152]
Чем меньше теоретическая линия регрессии (рассчитанная по уравнению) отклоняется от фактической (эмпиричной), тем меньше средняя ошибка аппроксимации. В нашем примере она составляет 0,0364, или 3,64 %. Учитывая, что в экономических расчетах допускается погрешность 5-8 %, можно сделать вывод, что исследуемое уравнение связи довольно точно описывает изучаемые зависимости. [c.152]
Модель считается адекватной, т.е. пригодной для практического использования, если средняя ошибка аппроксимации не превосходит 15%. [c.123]
Оценку качества построенной модели даст коэффициент (индекс) детерминации, а также средняя ошибка аппроксимации. [c.6]
Средняя ошибка аппроксимации — среднее отклонение расчетных значений от фактических [c.6]
Подставляя в данное уравнение фактические значения х, получаем теоретические значения результата ух. По ним рассчитаем показатели тесноты связи — индекс корреляции рху и среднюю ошибку аппроксимации 7, [c.13]
Рассчитать линейный коэффициент парной корреляции и среднюю ошибку аппроксимации. [c.16]
Это означает, что 52% вариации заработной латы (у) объясняется вариацией фактора х — среднедушевого прожиточного минимума. Качество модели определяет средняя ошибка аппроксимации [c.18]
Оцените с помощью средней ошибки аппроксимации качество уравнений. [c.38]
Оцените качество уравнений с помощью средней ошибки аппроксимации. [c.42]
Оцените качество уравнения через среднюю ошибку аппроксимации. [c.92]
Оцените качество каждого тренда через среднюю ошибку аппроксимации, линейный коэффициент автокорреляции отклонений. [c.166]
Представим расчет средней ошибки аппроксимации для уравнения ух = 9,876 + 5,129 hue в табл. 2.7. А = — 7,3 = 1,2%, что [c.88]
В стандартных программах чаще используется первая формула для расчета Средней ошибки аппроксимации. [c.88]
В чем смысл средней ошибки аппроксимации и как она определяется [c.89]
Выбор вида модели основан на логическом анализе изучаемых показателей, сравнении статистических характеристик (средняя ошибка аппроксимации, критерий Фишера, коэффициенты множественной корреляции и детерминации), рассчитанных для различных функций по одним и тем же первичным данным. [c.31]
Проверка приведенной в формуле (154) себестоимости по фактическим данным 103 СМУ показала, что средняя ошибка аппроксимации, определяющая степень соответствия расчетных значений фактическим, составила всего 1,5%, что вполне допустимо. [c.227]
Мнение эксперта
Знайка, самый умный эксперт в Цветочном городе
Если у вас есть вопросы, задавайте их мне!
Задать вопрос эксперту
Из всех средних по Коши допустимыми средними в порядковой шкале являются только члены вариационного ряда порядковые статистики. Если же вы хотите что-то уточнить, я с радостью помогу!
Коэффициент детерминации равен , что означает, что только 9,6% объясняется регрессией объясняющей переменнойх на величину у. Соответственно величина 1-равная 90,4 % характеризует долю дисперсии переменнойу, вызванную влиянием всех остальных, неучтенных в эконометрической модели объясняющих переменных.
Стандартная ошибка в Microsoft Excel
В блоке параметров «Построение линии тренда (аппроксимация и сглаживание)» устанавливаем переключатель в позицию «Линейная».
При желании можно установить галочку около позиции «Показывать уравнение на диаграмме». После этого на диаграмме будет отображаться уравнение сглаживающей функции.
Статистическое моделирование
Расчет параметров уравнения линейной регрессии, оценка тесноты связи с помощью показателей корреляции и детерминации. Определение средней ошибки аппроксимации. Статистическая надежность моделирования с помощью F-критерия Фишера и t-критерия Стьюдента.
Отправить свою хорошую работу в базу знаний просто. Используйте форму, расположенную ниже
Студенты, аспиранты, молодые ученые, использующие базу знаний в своей учебе и работе, будут вам очень благодарны.
Потребительские расходы на душу населения, тыс.руб., y
1. Рассчитайте параметры уравнения линейной регрессии.
2. Оцените тесноту связи с помощью показателей корреляции и детерминации.
3. Определите среднюю ошибку аппроксимации. Сделайте вывод.
4. Оцените статистическую надежность регрессионного моделирования с помощью F-критерия Фишера и t-критерия Стьюдента.
Вычисление параметров линейного уравнения регрессии. С помощью инструмента Регрессия (Данные Анализ данных Регрессия) получаем следующие результаты.
Экономический смысл уравнения: с увеличением денежных доходов x на 1тыс.руб. — потребительские расходы y в среднем возрастает на 0,34 тыс. руб.
Cвязь между переменными x и y прямая, сильная, тесная, т.е. величина потребительских расходов значительно зависит от денежных доходов.
v Коэффициент детерминации R 2 = 0,74, т.е. в 74% случаев изменения денежных доходов приводят к изменению потребительских расходов. Другими словами точность подбора уравнения регрессии 74% — высокая.
3. Для определения средней ошибки аппроксимации рассчитываем столбцы yx, y-yx, Ai:
Получаем значение средней ошибки аппроксимации =15,8%
Это означает, что, в среднем, расчетные значения зависимого признака отклоняются от фактических значений на 15,8%. Величина ошибки аппроксимации говорит о плохом качестве модели.
1. Выдвигаем нулевую гипотезу о статистической незначимости параметров регрессии и показателя корреляции a=b=rxy=0;
3. Для определения табличного значения критерия рассчитываем коэффициенты k1=m=1 и
4. Сравниваем фактическое и табличное значения критерия Fфакт >Fтабл, т.е. нулевую гипотезу отклоняем и делаем вывод о статистической значимости и надежности полученной модели.
1. Выдвигаем нулевую гипотезу о статистически незначимом отличии показателей от нуля: a=b=rxy=0;
2. Табличное значение t-критерия зависит от числа степеней свободы и заданного уровня значимости б. Уровень значимости — это вероятность отвергнуть правильную гипотезу при условии, что она верна. Для числа степеней свободы 12 и уровня значимости б =0,05 tтабл=2,18
3. Фактическое значение t- критерия рассчитываются отдельно для каждого параметра модели. С этой целью сначала определяются случайные ошибки параметров ma,mb,mrxy.
4.Сравним фактические значения t-критерия с табличным значением:
Нулевую гипотезу отклоняем, параметры a,b,rxy — не случайно отличаются от нуля и являются статистически значимыми и надежными.
В) Чтобы рассчитать доверительный интервал для параметров регрессии a, b, необходимо определить предельную ошибку параметров:
Анализ верхней и нижней границ доверительных интервалов показывает, что с вероятностью
p = 1 — б = 0,95 параметры a и b не принимают нулевых значений, т.е. являются статистически значимыми и надежными.
ь Уравнение парной линейной регрессии yx= 215,94+0,34x. Экономический смысл уравнения: с увеличением денежных доходов x на 1тыс.руб. — потребительские расходы y в среднем возрастает на 0,34 тыс. руб.
ь Множественный коэффициент корреляции R=0,86 указывает на связь между переменными x и y прямая, сильная, тесная, т.е. величина потребительских расходов значительно зависит от денежных доходов.
ь Коэффициент детерминации R 2 = 0,74,показывает, что в 74% случаев изменения денежных доходов приводят к изменению потребительских расходов. Точность подбора уравнения регрессии 74% — высокая.
ь Значение средней ошибки аппроксимации =15,8% означает, что среднем, расчетные значения зависимого признака отклоняются от фактических значений на 15,8%. Величина ошибки аппроксимации говорит о плохом качестве модели.
ь Фактическое значение больше табличного значения критерия Fфакт >Fтабл, указывает, что полученная модель статистически значима и надежна
ь При сравнении фактических значений t-критерия с табличным значением, получаем, что параметры a,b,rxy — не случайно отличаются от нуля и являются статистически значимыми и надежными.
ь Анализ верхней и нижней границ доверительных интервалов показывает, что с вероятностью p = 1 — б = 0,95 параметры a и b не принимают нулевых значений, т.е. являются статистически значимыми и надежными.
1. Вводим данные в таблицу (EXCEL) — столбцы № x1, х2, х3, х4,y. Для удобства проведения расчетов поместим результаты промежуточных расчетов в таблицу [Приложение1]
Мнение эксперта
Знайка, самый умный эксперт в Цветочном городе
Если у вас есть вопросы, задавайте их мне!
Задать вопрос эксперту
Когда будет выполнено последнее действие, то не только произведется расчет количества ячеек, которые заполнены числами, но и вычисляется ошибка средней арифметической. Если же вы хотите что-то уточнить, я с радостью помогу!
Пример 1. В таблице приведены данные, характеризующие динамику курса доллара на протяжении 10 лет (с 2006 по 2016 год). Необходимо спрогнозировать курс доллара на 2019 год на основании имеющихся данных.
Статистическое моделирование
При оценке экологических воздействий первая, наиболее обобщенная оценка — обычно порядковая, например: природная среда стабильна — природная среда угнетена (деградирует). Аналогична эколого-медицинская шкала: нет выраженного воздействия на здоровье людей — отмечается отрицательное воздействие на здоровье.
Как сделать апроксимацию в excel?
(Обратите внимание на дополнительный раздел от 04.06.2017 в конце статьи.)
Учет и контроль! Те, кому за 40 должны хорошо помнить этот лозунг из эпохи построения социализма и коммунизма в нашей стране.
«Мы, помню, 5 лет назад изготавливали до 1000 штук таких изделий в месяц, а сейчас и 700 еле-еле собираем!». Открываем статистику и видим, что 5 лет назад и 500 штук не изготавливали…
«Во сколько обходится километр пробега твоего автомобиля с учетом всех затрат?» Открываем статистику – 6 руб./км. Поездка на работу – 107 рублей. Дешевле, чем на такси (180 рублей) более чем в полтора раза. А бывали времена, когда на такси было дешевле…
«Сколько времени требуется для изготовления металлоконструкций уголковой башни связи высотой 50 м?» Открываем статистику – и через 5 минут готов ответ…
«Сколько будет стоить ремонт комнаты в квартире?» Поднимаем старые записи, делаем поправку на инфляцию за прошедшие годы, учитываем, что в прошлый раз купили материалы на 10% дешевле рыночной цены и – ориентировочную стоимость мы уже знаем…
Ведя учет своей профессиональной деятельности, вы всегда будете готовы ответить на вопрос начальника: «Когда. ». Ведя учет домашнего хозяйства, легче спланировать расходы на крупные покупки, отдых и прочие расходы в будущем, приняв соответствующие меры по дополнительному заработку или по сокращению необязательных расходов сегодня.
В этой статье я на простом примере покажу, как можно обрабатывать собранные статистические данные в Excel для возможности дальнейшего использования при прогнозировании будущих периодов.
Аппроксимация в Excel статистических данных аналитической функцией.
1. Включаем Excel и помещаем на лист таблицу с данными статистики.
2. Далее строим и форматируем точечную диаграмму, в которой по оси X задаем значения аргумента – количество переработанных уголков в тоннах. По оси Y откладываем значения исходной функции – общий выпуск металлоконструкций в месяц, заданные таблицей.
О том, как построить подобную диаграмму, подробно рассказано в статье «Как строить графики в Excel?».
3. «Наводим» мышь на любую из точек на графике и щелчком правой кнопки вызываем контекстное меню (как говорит один мой хороший товарищ — работая в незнакомой программе, когда не знаешь, что делать, чаще щелкай правой кнопкой мыши…). В выпавшем меню выбираем «Добавить линию тренда…».
4. В появившемся окне «Линия тренда» на вкладке «Тип» выбираем «Линейная».
5. Далее на вкладке «Параметры» ставим 2 галочки и нажимаем «ОК».
6. На графике появилась прямая линия, аппроксимирующая нашу табличную зависимость.
Мы видим кроме самой линии уравнение этой линии и, главное, мы видим значение параметра R 2 – величины достоверности аппроксимации! Чем ближе его значение к 1, тем наиболее точно выбранная функция аппроксимирует табличные данные!
7. Строим линии тренда, используя степенную, логарифмическую, экспоненциальную и полиномиальную аппроксимации по аналогии с тем, как мы строили линейную линию тренда.
Лучше всех из выбранных функций аппроксимирует наши данные полином второй степени, у него максимальный коэффициент достоверности R 2 .
8. Удаляем все линии тренда с поля диаграммы, кроме логарифмической функции. Для этого щелкаем правой кнопкой мыши по ненужным линиям и в выпавшем контекстном меню выбираем «Очистить».
9. В завершении добавим к точкам табличных данных планки погрешностей. Для этого правой кнопкой мыши щелкаем на любой из точек на графике и в контекстном меню выбираем «Формат рядов данных…» и настраиваем данные на вкладке «Y-погрешности» так, как на рисунке ниже.
10. Затем щелкаем по любой из линий диапазонов погрешностей правой кнопкой мыши, выбираем в контекстном меню «Формат полос погрешностей…» и в окне «Формат планок погрешностей» на вкладке «Вид» настраиваем цвет и толщину линий.
Аналогичным образом форматируются любые другие объекты диаграммы в Excel!
Окончательный результат диаграммы представлен на следующем снимке экрана.
Для повышения достоверности аппроксимации статистических данных должно быть много. Двенадцать пар значений – это маловато.
Из практики скажу, что хорошим результатом следует считать нахождение аппроксимирующей функции с коэффициентом достоверности R 2 >0,87. Отличный результат – при R 2 >0,94.
В этой статье я лишь прикоснулся к верхушке айсберга под названием сбор, обработка и практическое использование статистических данных. О том удалось, или нет, мне расшевелить ваш интерес к этой теме, надеюсь узнать из комментариев и рейтинга статьи в поисковиках.
Затронутый вопрос аппроксимации функции одной переменной имеет широкое практическое применение в разных сферах жизни. Но гораздо большее применение имеет решение задачи аппроксимации функции нескольких независимых переменных…. Об этом и не только читайте в следующих статьях на блоге.
Подписывайтесь на анонсы статей в окне, расположенном в конце каждой статьи или в окне вверху страницы.
Не забывайте подтверждать подписку кликом по ссылке в письме, которое придет к вам на указанную почту (может прийти в папку «Спам»).
С интересом прочту Ваши комментарии, уважаемые читатели! Пишите!
(04.06.2017)
Высокоточная красивая замена табличных данных простым уравнением.
Вас не устраивают полученные точность аппроксимации (R 2 2 =0,9963.
Урок 4. Виды аппроксимации в Excel
Текст урока с работающими фрагментами расчетов в файле uroki-approksimacii.xls
Как и предыдущие, этот урок с аналогичным текстом лучше смотреть не листе Excel (см. Уроки аппроксимации.xls, Лист1)
Щелкнем правой кнопкой по линии на рисунке, затем левой кнопкой по опции «Добавить линию тренда» и смотрим — какие услуги предлагаются нам этой опцией в части реализации аппроксимации в Excel.
Получаем следующую информацию в несколько измененной нами
Используется для аппроксимации данных по методу наименьших квадратов в соответствии с уравнением:
где b — угол наклона и a — координата пересечения оси абсцисс (свободный член).
Используется для аппроксимации данных по методу наименьших квадратов в соответствии с уравнением:
Используется для аппроксимации данных по методу наименьших квадратов в соответствии с уравнением:
Используется для аппроксимации данных по методу наименьших квадратов в соответствии с уравнением:
Используется для аппроксимации данных по методу наименьших квадратов в соответствии с уравнением:
Снова щелкаем по линии рисунка, затем по опции «Добавить линию тренда», далее по опции «Параметры» и ставим флажки в окошках слева от записей: «показывать уравнение на диаграмме» и «поместить на диаг- рамму величину достоверности аппроксимации R^2, после чего щелкаем по кнопке OK. Пробуем все варианты аппроксимации по порядку.
Линейная аппроксимация дает нам R^2=0.9291 — это низкая достоверность и плохой результат.
Для перехода к степенной аппроксимации щелкаем правой кнопкой по линии тренда, затем левой кнопкой — по опции «Формат линии тренда», далее по опциям «Тип» и «Степенная». На этот раз получили R^2=0.999.
Запишем уравнение линии тренда в виде, пригодном для расчетов на листе Excel:
Максимальная погрешность аппроксимации получилась на уровне 0.23 ккал/кг. Для аппроксимации экспериментальных данных такой результат был бы чудесным, но для аппроксимации справочной таблицы это не слишком хороший результат. Поэтому попробуем проверить другие варианты аппроксимации в Excel посредством программы построения трендов.
Логарифмическая аппроксимация дает нам R^2=0.9907 — несколько хуже, чем по степенному варианту. Экспоненнта в том варианте, который предлагает программа построения трендов, вообще не подошла — R^2=0.927.
Полиноминальная аппроксимация со степенью 2 (это y=a+b1*x+b2*x^2) обеспечила R^2=0.9896. При степени 3 получили R^2=0.999, но с явным искажением аппроксимируемой кривой, в особенности при P>0.07 кгс/см2. Наконец, пятая степень нам дает R^2=1 — это, как утверждается, максимально тесная связь между исходными данными и их аппроксимацией.
Перепишем уравнение полинома в пригодном для расчетов на листе Excel виде:
и сравним результат аппроксимации с исходной таблицей:
Примечание. Обнаруженный дефект связан с работой программы построения трендов, но не с методом МНК.
Метод аппроксимации в Microsoft Excel
Выполнение аппроксимации
Главный инструмент, с помощью которого проводится сглаживания в Excel – это построение линии тренда. Суть состоит в том, что на основе уже имеющихся показателей достраивается график функции на будущие периоды. Основное предназначение линии тренда, как не трудно догадаться, это составление прогнозов или выявление общей тенденции.
Но она может быть построена с применением одного из пяти видов аппроксимации:
Рассмотрим каждый из вариантов более подробно в отдельности.
Способ 1: линейное сглаживание
Прежде всего, давайте рассмотрим самый простой вариант аппроксимации, а именно с помощью линейной функции. На нем мы остановимся подробнее всего, так как изложим общие моменты характерные и для других способов, а именно построение графика и некоторые другие нюансы, на которых при рассмотрении последующих вариантов уже останавливаться не будем.
Существует ещё один вариант её добавления. В дополнительной группе вкладок на ленте «Работа с диаграммами» перемещаемся во вкладку «Макет». Далее в блоке инструментов «Анализ» щелкаем по кнопке «Линия тренда». Открывается список. Так как нам нужно применить линейную аппроксимацию, то из представленных позиций выбираем «Линейное приближение».
Если же вы выбрали все-таки первый вариант действий с добавлением через контекстное меню, то откроется окно формата.
В блоке параметров «Построение линии тренда (аппроксимация и сглаживание)» устанавливаем переключатель в позицию «Линейная».
При желании можно установить галочку около позиции «Показывать уравнение на диаграмме». После этого на диаграмме будет отображаться уравнение сглаживающей функции.
После того, как провели все вышеуказанные настройки. Жмем на кнопку «Закрыть», размещенную в нижней части окна.
Сглаживание, которое используется в данном случае, описывается следующей формулой:
В конкретно нашем случае формула принимает такой вид:
Величина достоверности аппроксимации у нас равна 0,9418, что является довольно приемлемым итогом, характеризующим сглаживание, как достоверное.
Способ 2: экспоненциальная аппроксимация
Теперь давайте рассмотрим экспоненциальный тип аппроксимации в Эксель.
-
Для того, чтобы изменить тип линии тренда, выделяем её кликом правой кнопки мыши и в раскрывшемся меню выбираем пункт «Формат линии тренда…».
После этого запускается уже знакомое нам окно формата. В блоке выбора типа аппроксимации устанавливаем переключатель в положение «Экспоненциальная». Остальные настройки оставим такими же, как и в первом случае. Щелкаем по кнопке «Закрыть».
В конкретно нашем случае формула приняла следующую форму:
Способ 3: логарифмическое сглаживание
Теперь настала очередь рассмотреть метод логарифмической аппроксимации.
-
Тем же способом, что и в предыдущий раз через контекстное меню запускаем окно формата линии тренда. Устанавливаем переключатель в позицию «Логарифмическая» и жмем на кнопку «Закрыть».
где ln – это величина натурального логарифма. Отсюда и наименование метода.
Способ 4: полиномиальное сглаживание
Настал черед рассмотреть метод полиномиального сглаживания.
Линия тренда с использованием данного метода построена. Как видим, она ещё более изогнута, чем при использовании экспоненциальной аппроксимации. Уровень достоверности выше, чем при любом из использованных ранее способов, и составляет 0,9724.
Данный метод наиболее успешно можно применять в том случае, если данные носят постоянно изменчивый характер. Функция, описывающая данный вид сглаживания, выглядит таким образом:
y=0,0015*x^2-1,7202*x+507,01
Теперь давайте изменим степень полиномов, чтобы увидеть, будет ли отличаться результат. Возвращаемся в окно формата. Тип аппроксимации оставляем полиномиальным, но напротив него в окне степени устанавливаем максимально возможное значение – 6.
Формула, которая описывает данный тип сглаживания, приняла следующий вид:
Способ 5: степенное сглаживание
В завершении рассмотрим метод степенной аппроксимации в Excel.
-
Перемещаемся в окно «Формат линии тренда». Устанавливаем переключатель вида сглаживания в позицию «Степенная». Показ уравнения и уровня достоверности, как всегда, оставляем включенными. Жмем на кнопку «Закрыть».
Данный способ эффективно используется в случаях интенсивного изменения данных функции. Важно учесть, что этот вариант применим только при условии, что функция и аргумент не принимают отрицательных или нулевых значений.
Общая формула, описывающая данный метод имеет такой вид:
Если вы пока не можете сразу определить, основываясь на вышеприведенных рекомендациях, какой вид аппроксимации подойдет конкретно в вашем случае, то есть смысл попробовать все методы. После построения линии тренда и просмотра её уровня достоверности можно будет выбрать оптимальный вариант.
Отблагодарите автора, поделитесь статьей в социальных сетях.
Функция ЛГРФПРИБЛ для аппроксимации данных таблиц в Excel
Функция ЛГРФПРИБЛ в Excel предназначена для определения значений, на основе которых может быть построена экспоненциальная кривая, аппроксимирующая имеющиеся числовые данные, и возвращает массив значений. Для корректной работы рассматриваемой функции ее следует вводить как формулу массива.
Методы аппроксимации табличных данных в Excel
Функция ЛГРФПРИБЛ возвращает данные, необходимые для построения кривой, описываемой следующим уравнением:
Если имеется две и более переменных, это уравнение переписывается следующим образом:
Возвращаемые рассматриваемой функцией данные представляют собой следующий массив:
То есть, имеем массив оснований, возводимых в степени (известные значения переменных x), и коэффициент b.
Пример 1. В таблице приведены данные, характеризующие динамику курса доллара на протяжении 10 лет (с 2006 по 2016 год). Необходимо спрогнозировать курс доллара на 2019 год на основании имеющихся данных.
Для расчета тренда (коэффициент, используемый для предсказания последующих значений курса) используем функцию:
Для предсказания курса на 2019 год используем формулу:
Как видно, полученное значение имеет небольшую степень достоверности. Использование данного типа аппроксимации для предсказания курса валют нерационально.
Прогнозирование финансовых результатов методом аппроксимации в Excel
Пример 2. В таблице имеются данные о зарплатах за прошедший год (помесячно). Определить оптимальный способ предсказания размеров зарплат для последующих периодов.
Определим коэффициенты достоверности аппроксимации для линейной и экспоненциальной функций с помощью следующих функций (вводить как формулы массива CTRL+SHIFT+Enter):
Поскольку обе функции возвращают результат в виде массива данных, в котором в третьей строке первого столбца содержится искомое значение R^2, используем функцию ИНДЕКС для возврата желаемого результата.
Чем ближе значение R^2 к 1, тем выше точность аппроксимации. Как видно, наибольшую точность обеспечивает экспоненциальная функция. Однако разница не является существенной, поэтому использование функции ЛИНЕЙН является допустимым в данном случае.
Правила метода аппроксимации по функции ЛГРФПРИБЛ в Excel
=ЛГРФПРИБЛ( известные_значения_y; [известные_значения_x];[конст];[статистика])
Мнение эксперта
Знайка, самый умный эксперт в Цветочном городе
Если у вас есть вопросы, задавайте их мне!
Задать вопрос эксперту
Например, кривая Филипса характеризует нелинейное соотношение между нормой безработицы и процентом прироста заработной платы. Если же вы хотите что-то уточнить, я с радостью помогу!
Для заданного набора значений переменных Y и Х расчетное значение среднего величины Y является в линейной регрессии функцией только одного параметра – коэффициента регрессии. В соответствии с этим факторная сумма квадратов отклонений имеет число степеней свободы, равное 1. А число степеней свободы остаточной суммы квадратов отклонений при линейной регрессии равно n-2.
Ошибка аппроксимации — Энциклопедия по экономике
Статистический анализ показывает, что уравнение значимо Рф = 5,054 при /»табл = 3,01, корреляционное отношение равно 0,9959, ее»стандартная ошибка равна 0,0015. Среднее квадратическое отклонение расчетной себестоимости от фактической равно 0,018. Средняя ошибка аппроксимации 1,1%. [c.90]


















































































































































































































предшествует процедура линеаризации переменных. В примере линеаризация производится путем логарифмирования обеих частей уравнения:

. Порядок вычисления следующий:








статистической значимости уравнения множественной регрессии и его показателя тесноты связи.


при 
-критерия Фишера оценить статистическую надежность уравнения регрессии и 




















определяется путем подстановки фактических значений 




. Приведем результаты вычисления функций ЛИНЕЙН и ЛГРФПРИБЛ (рис. 4.2 и 4.3).

















. Чем ближе
корреляционная связь представляет линейную функциональную зависимость. При этом все наблюдаемые значения располагаются на прямой линии (рис. 1.3 а, 6).
линейная корреляционная связь отсутствует. При этом линия регрессии параллельна оси
(рис. 1.3 в).
по формуле (1.27)










имеют одинаковую дисперсию.








являются детерминированными (не случайными) величинами. Векторы
ковариации ошибок равны нулю:
-критериев Фишера осуществляем по формуле





















































