Оценка уровней значимости коэффициентов регрессионного уравнения. Оценка статистической значимости уравнения регрессии и его параметров

Итоговые тесты по эконометрике

1. Оценка значимости параметров уравнения регрессии осуществляется на основе:

А) t - критерия Стьюдента;

б) F -критерия Фишера – Снедекора;

в) средней квадратической ошибки;

г) средней ошибки аппроксимации.

2. Коэффициент регрессии в уравнении , характеризующем связь между объемом реализованной продукции (млн. руб.) и прибылью предприятий автомобильной промышленности за год (млн. руб.) означает, что при увеличении объема реализованной продукции на 1 млн. руб. прибыль увеличивается на:

г) 0,5млн. руб.;

в) 500тыс. руб.;

Г) 1,5 млн. руб.

3. Корреляционное отношение (индекс корреляции) измеряет степень тесноты связи между Х и Y :

а) только при нелинейной форме зависимости;

Б) при любой форме зависимости;

в) только при линейной зависимости.

4. По направлению связи бывают:

а) умеренные;

Б) прямые;

в) прямолинейные.

5. По 17 наблюдениям построено уравнение регрессии:
.
Для проверки значимости уравнения вычислено наблюдаемое значение t - статистики: 3.9. Вывод:

А) Уравнение значимо при a= 0,05;

б) Уравнение незначимо при a = 0,01;

в) Уравнение незначимо при a = 0,05.

6. Каковы последствия нарушения допущения МНК «математическое ожидание регрессионных остатков равно нулю»?

А) Смещенные оценки коэффициентов регрессии;

б) Эффективные, но несостоятельные оценки коэффициентов регрессии;

в) Неэффективные оценки коэффициентов регрессии;

г) Несостоятельные оценки коэффициентов регрессии.

7. Какое из следующих утверждений верно в случае гетероскедастичности остатков?

А) Выводы по t и F- статистикам являются ненадежными;

г) Оценки параметров уравнения регрессии являются смещенными.

8. На чем основан тест ранговой корреляции Спирмена?

А) На использовании t – статистики;

в) На использовании ;

9. На чем основан тест Уайта?

б) На использовании F– статистики;

В) На использовании ;

г) На графическом анализе остатков.

10. Каким методом можно воспользоваться для устранения автокорреляции?

11. Как называется нарушение допущения о постоянстве дисперсии остатков?

а) Мультиколлинеарность;

б) Автокорреляция;

В) Гетероскедастичность;

г) Гомоскедастичность.

12. Фиктивные переменные вводятся в:

а) только в линейные модели;

б) только во множественную нелинейную регрессию;

в) только в нелинейные модели;

Г) как в линейные, так и в нелинейные модели, приводимые к линейному виду.

13. Если в матрице парных коэффициентов корреляции встречаются
, то это свидетельствует:

А) О наличии мультиколлинеарности;

б) Об отсутствии мультиколлинеарности;

в) О наличии автокорреляции;

г) Об отсутствии гетероскедастичности.

14. С помощью какой меры невозможно избавиться от мультиколлинеарности?

а) Увеличение объема выборки;

Г) Преобразование случайной составляющей.

15. Если
и ранг матрицы А меньше (К-1) то уравнение:

а) сверхиденцифицировано;

Б) неидентифицировано;

в) точно идентифицировано.

16.Уравнение регрессии имеет вид:

А)
;

б)
;

в)
.

17.В чем состоит проблема идентификации модели?

А) получение однозначно определенных параметров модели, заданной системой одновременных уравнений;

б) выбор и реализация методов статистического оценивания неизвестных параметров модели по исходным статистическим данным;

в) проверка адекватности модели.

18. Какой метод применяется для оценивания параметров сверхиденцифицированного уравнения?

В) ДМНК, КМНК;

19. Если качественная переменная имеет k альтернативных значений, то при моделировании используются:

А) (k-1) фиктивная переменная;

б) kфиктивных переменных;

в) (k+1) фиктивная переменная.

20. Анализ тесноты и направления связей двух признаков осуществляется на основе:

А) парного коэффициента корреляции;

б) коэффициента детерминации;

в) множественного коэффициента корреляции.

21. В линейном уравнении x = а 0 +a 1 х коэффициент регрессии показывает:

а) тесноту связи;

б) долю дисперсии "Y", зависимую от "X";

В) на сколько в среднем изменится "Y" при изменении "X" на одну единицу;

г) ошибку коэффициента корреляции.

22. Какой показатель используется для определения части вариации, обусловленной изменением величины изучаемого фактора?

а) коэффициент вариации;

б) коэффициент корреляции;

В) коэффициент детерминации;

г) коэффициент эластичности.

23. Коэффициент эластичности показывает:

А) на сколько % изменится значение y при изменении x на 1 %;

б) на сколько единиц своего измерения изменится значение yпри измененииxна 1 %;

в) на сколько % изменится значение yпри измененииxна ед. своего измерения.

24. Какие методы можно применить для обнаружения гетероскедастичности ?

А) Тест Голфелда-Квандта;

Б) Тест ранговой корреляции Спирмена;

в) Тест Дарбина- Уотсона.

25. На чем основан тест Голфельда -Квандта

а) На использовании t– статистики;

Б) На использовании F – статистики;

в) На использовании ;

г) На графическом анализе остатков.

26. С помощью каких методов нельзя устранить автокорреляцию остатков?

а) Обобщенным методом наименьших квадратов;

Б) Взвешенным методом наименьших квадратов;

В) Методом максимального правдоподобия;

Г) Двухшаговым методом наименьших квадратов.

27. Как называется нарушение допущения о независимости остатков?

а) Мультиколлинеарность;

Б) Автокорреляция;

в) Гетероскедастичность;

г) Гомоскедастичность.

28. Каким методом можно воспользоваться для устранения гетероскедастичности?

А) Обобщенным методом наименьших квадратов;

б) Взвешенным методом наименьших квадратов;

в) Методом максимального правдоподобия;

г) Двухшаговым методом наименьших квадратов.

30. Если по t -критерию большинство коэффициентов регрессии статистически значимы, а модель в целом по F - критерию незначима то это может свидетельствовать о:

а) Мультиколлинеарности;

Б) Об автокорреляции остатков;

в) О гетероскедастичности остатков;

г) Такой вариант невозможен.

31. Возможно ли с помощью преобразования переменных избавиться от мультиколлинеарности?

а) Эта мера эффективна только при увеличении объема выборки;

32. С помощью какого метода можно найти оценки параметра уравнения линейной регрессии:

А) методом наименьшего квадрата;

б) корреляционно-регрессионного анализа;

в) дисперсионного анализа.

33. Построено множественное линейное уравнение регрессии с фиктивными переменными. Для проверки значимости отдельных коэффициентов используется распределение:

а) Нормальное;

б) Стьюдента;

в) Пирсона;

г) Фишера-Снедекора.

34. Если
и ранг матрицы А больше (К-1) то уравнение:

А) сверхиденцифицировано;

б) неидентифицировано;

в) точно идентифицировано.

35. Для оценивания параметров точно идентифицируемой системы уравнений применяется:

а) ДМНК, КМНК;

б) ДМНК, МНК, КМНК;

36. Критерий Чоу основывается на применении:

А) F - статистики;

б) t - статистики;

в) критерии Дарбина –Уотсона.

37. Фиктивные переменные могут принимать значения:

г) любые значения.

39. По 20 наблюдениям построено уравнение регрессии:
.
Для проверки значимости уравнения вычислено значение статистики: 4.2. Выводы:

а) Уравнение значимо при a=0.05;

б) Уравнение незначимо при a=0.05;

в) Уравнение незначимо при a=0.01.

40. Какое из следующих утверждений не верно в случае гетероскедастичности остатков?

а) Выводы по tиF- статистикам являются ненадежными;

б) Гетероскедастичность проявляется через низкое значение статистики Дарбина-Уотсона;

в) При гетероскедастичности оценки остаются эффективными;

г) Оценки являются смещенными.

41. Тест Чоу основан на сравнении:

А) дисперсий;

б) коэффициентов детерминации;

в) математических ожиданий;

г) средних.

42. Если в тесте Чоу
то считается:

А) что разбиение на подынтервалы целесообразно с точки зрения улучшения качества модели;

б) модель является статистически незначимой;

в) модель является статистически значимой;

г) что нет смысла разбивать выборку на части.

43. Фиктивные переменные являются переменными:

а) качественными;

б) случайными;

В) количественными;

г) логическими.

44. Какой из перечисленных методов не может быть применен для обнаружения автокорреляции?

а) Метод рядов;

б) критерий Дарбина-Уотсона;

в) тест ранговой корреляции Спирмена;

Г) тест Уайта.

45. Простейшая структурная форма модели имеет вид:

А)

б)

в)

г)
.

46. С помощью каких мер возможно избавиться от мультиколлинеарности?

а) Увеличение объема выборки;

б) Исключения переменных высококоррелированных с остальными;

в) Изменение спецификации модели;

г) Преобразование случайной составляющей.

47. Если
и ранг матрицы А равен (К-1) то уравнение:

а) сверхиденцифицировано;

б) неидентифицировано;

В) точно идентифицировано;

48. Модель считается идентифицированной, если:

а) среди уравнений модели есть хотя бы одно нормальное;

Б) каждое уравнение системы идентифицируемо;

в) среди уравнений модели есть хотя бы одно неидентифицированное;

г) среди уравнений модели есть хотя бы одно сверхидентифицированное.

49. Какой метод применяется для оценивания параметров неиденцифицированного уравнения?

а) ДМНК, КМНК;

б) ДМНК, МНК;

В) параметры такого уравнения нельзя оценить.

50. На стыке каких областей знаний возникла эконометрика:

А) экономическая теория; экономическая и математическая статистика;

б) экономическая теория, математическая статистика и теория вероятности;

в) экономическая и математическая статистика, теория вероятности.

51. В множественном линейном уравнении регрессии строятся доверительные интервалы для коэффициентов регрессии с помощью распределения:

а) Нормального;

Б) Стьюдента;

в) Пирсона;

г) Фишера-Снедекора.

52. По 16 наблюдениям построено парное линейное уравнение регрессии. Для проверки значимости коэффициента регрессии вычислено t на6л =2.5.

а) Коэффициент незначим при a=0.05;

б) Коэффициент значим при a=0.05;

в) Коэффициент значим при a=0.01.

53. Известно, что между величинами X и Y существует положительная связь. В каких пределах находится парный коэффициент корреляции?

а) от -1 до 0;

б) от 0 до 1;

В) от –1 до 1.

54. Множественный коэффициент корреляции равен 0.9. Какой процент дисперсии результативного признака объясняется влиянием всех факторных признаков?

55. Какой из перечисленных методов не может быть применен для обнаружения гетероскедастичности ?

А) Тест Голфелда-Квандта;

б) Тест ранговой корреляции Спирмена;

в) метод рядов.

56. Приведенная форма модели представляет собой:

а) систему нелинейных функций экзогенных переменных от эндогенных;

Б) систему линейных функций эндогенных переменных от экзогенных;

в) систему линейных функций экзогенных переменных от эндогенных;

г) систему нормальных уравнений.

57. В каких пределах меняется частный коэффициент корреляции вычисленный по рекуретным формулам?

а) от - до +;

б) от 0 до 1;

в) от 0 до + ;

Г) от –1 до +1.

58. В каких пределах меняется частный коэффициент корреляции вычисленный через коэффициент детерминации?

а) от - до +;

Б) от 0 до 1;

в) от 0 до + ;

г) от –1 до +1.

59. Экзогенные переменные:

а) зависимые переменные;

Б) независимые переменные;

61. При добавлении в уравнение регрессии еще одного объясняющего фактора множественный коэффициент корреляции:

а) уменьшится;

б) возрастет;

в) сохранит свое значение.

62. Построено гиперболическое уравнение регрессии: Y = a + b / X . Для проверки значимости уравнения используется распределение:

а) Нормальное;

Б) Стьюдента;

в) Пирсона;

г) Фишера-Снедекора.

63. Для каких видов систем параметры отдельных эконометрических уравнений могут быть найдены с помощью традиционного метода наименьших квадратов?

а) система нормальных уравнений;

Б) система независимых уравнений;

В) система рекурсивных уравнений;

Г) система взаимозависимых уравнений.

64. Эндогенные переменные:

А) зависимые переменные;

б) независимые переменные;

в) датированные предыдущими моментами времени.

65. В каких пределах меняется коэффициент детерминации?

а) от 0 до +;

б) от -до +;

В) от 0 до +1;

г) от -l до +1.

66. Построено множественное линейное уравнение регрессии. Для проверки значимости отдельных коэффициентов используется распределение:

а) Нормальное;

б) Стьюдента;

в) Пирсона;

Г) Фишера-Снедекора.

67. При добавлении в уравнение регрессии еще одного объясняющего фактора коэффициент детерминации:

а) уменьшится;

Б) возрастет;

в) сохранит свое значение;

г) не уменьшится.

68. Суть метода наименьших квадратов заключается в том, что:

А) оценка определяется из условия минимизации суммы квадратов отклонений выборочных данных от определяемой оценки;

б) оценка определяется из условия минимизации суммы отклонений выборочных данных от определяемой оценки;

в) оценка определяется из условия минимизации суммы квадратов отклонений выборочной средней от выборочной дисперсии.

69. К какому классу нелинейных регрессий относится парабола:

73. К какому классу нелинейных регрессий относится экспоненциальная кривая:

74. К какому классу нелинейных регрессий относится функция вида ŷ
:

А) регрессии, нелинейные относительно включенных в анализ переменных, но линейных по оцениваемым параметрам;

б) нелинейные регрессии по оцениваемым параметрам.

78. К какому классу нелинейных регрессий относится функция вида ŷ
:

а) регрессии, нелинейные относительно включенных в анализ переменных, но линейных по оцениваемым параметрам;

Б) нелинейные регрессии по оцениваемым параметрам.

79. В уравнении регрессии в форме гиперболы ŷ
если величина
b >0 , то:

А) при увеличении факторного признака х значения результативного признака у замедленно уменьшаются, и при х→∞ средняя величина у будет равна а;

б) то значение результативного признака у возрастает с замедленным ростом при увеличении факторного признака х , и при х→∞

81. Коэффициент эластичности определяется по формуле

А) Линейной функции;

б) Параболы;

в) Гиперболы;

г) Показательной кривой;

д) Степенной.

82. Коэффициент эластичности определяется по формуле
для модели регрессии в форме:

а) Линейной функции;

Б) Параболы;

в) Гиперболы;

г) Показательной кривой;

д) Степенной.

86. Уравнение
называется:

А) линейным трендом;

б) параболическим трендом;

в) гиперболическим трендом;

г) экспоненциальным трендом.

89. Уравнение
называется:

а) линейным трендом;

б) параболическим трендом;

в) гиперболическим трендом;

Г) экспоненциальным трендом.

90. Система виды называется:

А) системой независимых уравнений;

б) системой рекурсивных уравнений;

в) системой взаимозависимых (совместных, одновременных) уравнений.

93. Эконометрику можно определить как:

А) это самостоятельная научная дисциплина, объединяющая совокупность теоретических результатов, приемов, методов и моделей, предназначенных для того, чтобы на базе экономической теории, экономической статистики и математико-статистического инструментария придавать конкретное количественное выражение общим (качественным) закономерностям, обусловленным экономической теорией;

Б) наука об экономических измерениях;

В) статистический анализ экономических данных.

94. К задачам эконометрики можно отнести:

А) прогноз экономических и социально-экономических показателей, характеризующих состояние и развитие анализируемой системы;

Б) имитация возможных сценариев социально-экономического развития системы для выявления того, как планируемые изменения тех или иных поддающихся управлению параметров скажутся на выходных характеристиках;

в) проверка гипотез по статистическим данным.

95. По характеру различают связи:

А) функциональные и корреляционные;

б) функциональные, криволинейные и прямолинейные;

в) корреляционные и обратные;

г) статистические и прямые.

96. При прямой связи с увеличением факторного признака:

а) результативный признак уменьшается;

б) результативный признак не изменяется;

В) результативный признак увеличивается.

97. Какие методы используются для выявления наличия, характера и направления связи в статистике?

а) средних величин;

Б) сравнения параллельных рядов;

В) метод аналитической группировки;

г) относительных величин;

Д) графический метод.

98. Какой метод используется для выявления формы воздействия одних факторов на другие?

а) корреляционный анализ;

Б) регрессионный анализ;

в) индексный анализ;

г) дисперсионный анализ.

99. Какой метод используется для количественной оценки силы воздействия одних факторов на другие:

А) корреляционный анализ;

б) регрессионный анализ;

в) метод средних величин;

г) дисперсионный анализ.

100. Какие показатели по своей величине существуют в пределах от минус до плюс единицы:

а) коэффициент детерминации;

б) корреляционной отношение;

В) линейный коэффициент корреляции.

101. Коэффициент регрессии при однофакторной модели показывает:

А) на сколько единиц изменяется функция при изменении аргумента на одну единицу;

б) на сколько процентов изменяется функция на одну единицу изменения аргумента.

102. Коэффициент эластичности показывает:

а) на сколько процентов изменяется функция с изменением аргумента на одну единицу своего измерения;

Б) на сколько процентов изменяется функция с изменением аргумента на 1%;

в) на сколько единиц своего измерения изменяется функция с изменением аргумента на 1%.

105. Величина индекса корреляции, равная 0,087, свидетельствует:

А) о слабой их зависимости;

б) о сильной взаимосвязи;

в) об ошибках в вычислениях.

107. Величина парного коэффициента корреляции, равная 1,12, свидетельствует:

а) о слабой их зависимости;

б) о сильной взаимосвязи;

В) об ошибках в вычислениях.

109. Какие из приведенных чисел могут быть значениями парного коэффициента корреляции:

111. Какие из приведенных чисел могут быть значениями множественного коэффициента корреляции:

115. Отметьте правильную форму линейного уравнения регрессии:

а) ŷ
;

б) ŷ
;

в) ŷ
;

Г) ŷ
.

Проверить значимость параметров уравнения регрессии можно, используя t-статистику .

Задание:
По группе предприятий, выпускающих один и тот же вид продукции, рассматриваются функции издержек:
y = α + βx;
y = α x β ;
y = α β x ;
y = α + β / x;
где y – затраты на производство, тыс. д. е.
x – выпуск продукции, тыс. ед.

Требуется:
1. Построить уравнения парной регрессии y от x:

  • линейное;
  • степенное;
  • показательное;
  • равносторонней гиперболы.
2. Рассчитать линейный коэффициент парной корреляции и коэффициент детерминации . Сделать выводы.
3. Оценить статистическую значимость уравнения регрессии в целом.
4. Оценить статистическую значимость параметров регрессии и корреляции.
5. Выполнить прогноз затрат на производство при прогнозном выпуске продукции, составляющем 195 % от среднего уровня.
6. Оценить точность прогноза, рассчитать ошибку прогноза и его доверительный интервал.
7. Оценить модель через среднюю ошибку аппроксимации.

Решение :

1. Уравнение имеет вид y = α + βx
1. Параметры уравнения регрессии.
Средние значения

Дисперсия

Среднеквадратическое отклонение

Коэффициент корреляции

Связь между признаком Y фактором X сильная и прямая
Уравнение регрессии

Коэффициент детерминации
R 2 = 0.94 2 = 0.89, т.е. в 88.9774 % случаев изменения х приводят к изменению y. Другими словами - точность подбора уравнения регрессии - высокая

x y x 2 y 2 x ∙ y y(x) (y-y cp) 2 (y-y(x)) 2 (x-x p) 2
78 133 6084 17689 10374 142.16 115.98 83.83 1
82 148 6724 21904 12136 148.61 17.9 0.37 9
87 134 7569 17956 11658 156.68 95.44 514.26 64
79 154 6241 23716 12166 143.77 104.67 104.67 0
89 162 7921 26244 14418 159.9 332.36 4.39 100
106 195 11236 38025 20670 187.33 2624.59 58.76 729
67 139 4489 19321 9313 124.41 22.75 212.95 144
88 158 7744 24964 13904 158.29 202.51 0.08 81
73 152 5329 23104 11096 134.09 67.75 320.84 36
87 162 7569 26244 14094 156.68 332.36 28.33 64
76 159 5776 25281 12084 138.93 231.98 402.86 9
115 173 13225 29929 19895 201.86 854.44 832.66 1296
0 0 0 16.3 20669.59 265.73 6241
1027 1869 89907 294377 161808 1869 25672.31 2829.74 8774

Примечание: значения y(x) находятся из полученного уравнения регрессии:
y(1) = 4.01*1 + 99.18 = 103.19
y(2) = 4.01*2 + 99.18 = 107.2
... ... ...

2. Оценка параметров уравнения регрессии
Значимость коэффициента корреляции

По таблице Стьюдента находим Tтабл
T табл (n-m-1;α/2) = (11;0.05/2) = 1.796
Поскольку Tнабл > Tтабл, то отклоняем гипотезу о равенстве 0 коэффициента корреляции. Другими словами, коэффициента корреляции статистически - значим.

Анализ точности определения оценок коэффициентов регрессии





S a = 0.1712
Доверительные интервалы для зависимой переменной

Рассчитаем границы интервала, в котором будет сосредоточено 95% возможных значений Y при неограниченно большом числе наблюдений и X = 1
(-20.41;56.24)
Проверка гипотез относительно коэффициентов линейного уравнения регрессии
1) t-статистика


Статистическая значимость коэффициента регрессии a подтверждается

Статистическая значимость коэффициента регрессии b не подтверждается
Доверительный интервал для коэффициентов уравнения регрессии
Определим доверительные интервалы коэффициентов регрессии, которые с надежность 95% будут следующими:
(a - t S a ; a + t S a)
(1.306;1.921)
(b - t b S b ; b + t b S b)
(-9.2733;41.876)
где t = 1.796
2) F-статистики


Fkp = 4.84
Поскольку F > Fkp, то коэффициент детерминации статистически значим

В социально-экономических исследованиях часто приходится работать в условиях ограниченной совокупности, либо с выборочными данными. Поэтому после математических параметров уравнение регрессии необходимо оценить их и уравнение в целом на статистическую значимость, т.е. необходимо убедиться, что полученное уравнение и его параметры сформированы под влиянием неслучайных факторов.

Прежде всего, оценивается статистическая значимость уравнения в целом. Оценка, как правило, проводится с использованием F-критерия Фишера. Расчет F-критерия базируется на правиле сложения дисперсий. А именно, общего дисперсионного признака-результата = дисперсия факторная + дисперсия остаточная.

Фактическая цена

Теоретическая цена
Построив уравнение регрессии можно рассчитать теоретическое значение признака-результата, т.е. рассчитанные по уравнению регрессии с учетом его параметров.

Эти значения будут характеризовать признак-результат, сформировавшийся под влиянием факторов включенных в анализ.

Между фактическими значениями признака-результата и рассчитанными на основе уравнения регрессии всегда существуют расхождения (остатки), обусловленные влиянием прочих факторов, не включенных в анализ.

Разность между теоретическими и фактическими значениями признака-результата называется остатками. Общая вариация признака-результата:

Вариация по признаку-результату, обусловленная вариацией признаков факторов, включенных в анализ оценивается через сопоставления теоретических значений резул. признака и его средних значений. Остаточная вариация через сопоставление теоретических и фактических значений результатирующего признака. Общая дисперсия , остаточная и фактическая имеют разное число степеней свободы.

Общая , п - число единиц в изучаемой совокупности

Фактическая , п - число факторов, включенных в анализ

Остаточная

F-критерий Фишера рассчитывается как отношение к , причем рассчитаны на одну степень свободы.

Использование F-критерия Фишера в качестве оценки статистической значимости уравнения регрессии очень логично. - это результат. признака, обусловленная факторами включенными в анализ, т.е. это доля объясненной результат. признака. - это (вариация) признака результата обусловленная факторами влияние которых не учитывается, т.е. не включенными в анализ.

Т.о. F-критерий призван оценить значимое превышение над . Если несущественно ниже , а тем более, если оно превышает , следовательно, в анализ включены не те факторы, которые действительно влияют на признак-результат.

F-критерий Фишера табулирован, фактическое значение сравнивается с табличным. Если , то уравнение регрессии признается статистически значимым. Если наоборот – уравнение статистически не значимо и не может использоваться на практике, значимость уравнения в целом говорит о статистической значимости показателей корелляции.

После оценки уравнения в целом необходимо оценить статистическую значимость параметров уравнения. Эта оценка осуществляется с использованием t-статистики Стьюдента. t-статистика рассчитывается как отношение параметров уравнения (по модулю) к их стандартной средней квадратической ошибке. Если оценивается однофакторная модель, то рассчитывается 2 статистики.

Во всех компьютерных программах расчет стандартной ошибки и t-статистики для параметров проводится с расчетом самих параметров. T-статистика табулирована. Если значение , то параметр признается статистически значимым, т.е. сформированным под влиянием неслучайных факторов.

Расчет t-статистики по существу означает проверку нулевой гипотезы о незначимости параметра, т.е. равенстве его нулю. При однофакторной модели оценивается 2 гипотезы: и

Уровень значимости принятия нулевой гипотезы зависит от уровня принятой доверительной вероятности. Так если исследователь задает уровень вероятности 95%, уровень значимости принятия будет рассчитываться , следовательно, если уровень значимости ≥ 0,05, то принимается и параметры считаются статистически незначимыми. Если , то отвергается и принимается альтернатива: и .

В пакетах прикладных программ по статистике также приводится уровень значимости принятия нулевых гипотез. Оценка значимости уравнения регрессии и его параметров может дать следующие результаты:

Во-первых, уравнение в целом значимо(по F-критерию) и также статистически значимы все параметры уравнения. Это означает, что полученное уравнение может быть использовано как для принятия управленческих решений, так и для прогнозирования.

Во-вторых, по F-критерию уравнение статистически значимо, но не значим хотя бы один из параметров уравнения. Уравнение может быть использовано для принятия управленческих решений относительно анализируемых факторов, но не может быть использовано для прогнозирования.

В-третьих, уравнение статистически не значимо, либо по F- критерию уравнение значимо, но не значимы все параметры полученного уравнения. Уравнение не может быть использовано не для каких целей.

Чтобы уравнение регрессии можно было признать моделью связи между признаком-результатом и признаками-факторами необходимо чтобы в него были включены все важнейшие факторы, определяющие результат, чтобы содержательная интерпретация параметров уравнения соответствовала теоретически обоснованным связям в изучаемом явлении. Коэффициент детерминации R 2 должен быть > 0,5.

При построении множественного уравнения регрессии целесообразно осуществить оценку по так называемому скорректированному коэффициенту детерминации (R 2). Величина R 2 (как и корелляции) возрастает при увеличение числа факторов включенных в анализ. Особенно завышается значение коэф-в в условиях небольших совокупностей. С целью погасить отрицательное влияние R 2 и корелляции корректируют с учетом числа степеней свободы, т.е. числа свободно варьирующих элементов при включении определенных факторов.

Скорректированный коэф-т детерминации

п –объем совокупности/число наблюдений

k – число факторов включенных в анализ

п-1 – число степеней свободы

(1-R 2) - величина остатка/ необъясненной дисперсии результативного признака

Всегда меньше R 2 . на основе можно сравнивать оценки уравнений с разным числом анализируемых факторов.

34. Задачи изучения динамических рядов.

Ряды динамики называют временными рядами или динамическими рядами. Динамический ряд – это упорядоченная во времени последовательность показателей, характеризующих то или иное явление (объем ВВП с 90 по 98 гг). Целью изучения рядов динамики является выявление закономерности развития изучаемого явления (основной тенденции) и прогнозирование на этой основе. Из определения РД следует, что любой ряд состоит из двух элементов: время t и уровень ряда (те конкретные значения показателя, на основе которого построен ДРяд). ДРяды могут быть 1)моментными – ряды, показатели которых фиксируются на момент времени, на определенную дату, 2)интервальными – ряды, показатели которого получают за какой-то период времени (1.численность населения СПб, 2.объем ВВП за период). Разделение рядов на моментные и интервальные необходимо, поскольку это определяет специфику расчета некоторых показателей ДРядов. Суммирование уровней интервальных рядов дает содержательно интерпретируемый результат, что нельзя сказать о суммировании уровней моментных рядов, поскольку последние содержат повторный счет. Важнейшей проблемой в анализе рядов динамики является проблема сопоставимости уровней ряда. Это понятие очень разноплановое. Уровни должны быть сопоставимы по методам расчета и по территории и охвату единиц совокупности. Если ДРяд строится в стоимостных показателях, то все уровни должны быть представлены или рассчитаны в сопоставимых ценах. При построении интервальных рядов уровни должны характеризовать одинаковые отрезки времени. При построении моментных РядовД уровни должны фиксироваться на одну и ту же дату. ДРяды могут быть полными и неполными. Неполные ряды используются в официальных изданиях (1980,1985,1990,1995,1996,1997,1998,1999…). Комплексный анализ РД включает изучение следующих моментов:

1. расчет показателей изменения уровней РД

2. расчет средних показателей РД

3. выявление основной тенденции ряда, построение трендовых моделей

4. оценка автокорреляции в РД, построение авторегрессионных моделей

5. корреляция РД (изучение связей м/у ДРядами)

6. прогнозирование РД.

35. Показателей изменения уровней временных рядов .

В общем виде РядД может быть представлен:

у – уровень ДР, t – момент или период времени к которому относится уровень (показатель), n – длина ДРяда (число периодов). при изучении ряда динамики рассчитывают следующие показатели: 1. абсолютный прирост, 2. коэффициент роста (темп роста), 3. ускорение, 4. коэффициент прироста (темп прироста), 5. абсолютное значение 1 % прироста. Рассчитываемые показатели могут быть: 1. цепные – получают путем сопоставления каждого уровня ряда с непосредственно предшествующим, 2. базисные – получают путем сопоставления с уровнем, выбранным за базу сравнения (если специально не оговаривается, за базу берется 1ый уровень ряда). 1. Цепные абсолютные приросты: . Показывает на сколько больше или меньше . Цепные абсолютные приросты называют показателями скорости изменения уровней динамического ряда. Базисный абсолютный прирост : . Если уровни ряда представляют собой относительные показатели, выраженные в %-ах, то абсолютный прирост выражается в пунктах изменения. 2. коэффициент роста (темпы роста): Рассчитывается как отношение уровней ряда к непосредственно предшествующим (цепные коэффициенты роста), либо к уровню, принятому за базу сравнения (базисные коэффициенты роста): . Характеризует во сколько раз каждый уровень ряда > или < предшествующего или базисного. На основе коэффициентов роста рассчитываются темпы роста. Это коэффициенты роста, выраженные в %ах: 3. на основе абсолютных приростов рассчитывают показатель – ускорение абсолютных приростов : . Ускорение – абсолютный прирост абсолютных приростов. Оценивает как изменяются сами приросты, они стабильны или принимают ускорение (возрастают). 4. темп прироста – это отношение прироста к базе сравнения. Выражается в %-ах: ; . Темп прироста – это темп роста минус 100%. Показывает на сколько % данный уровень ряда > или < предшествующего либо базисного. 5. абсолютное значение 1% прироста. Рассчитывается как отношение абсолютного прироста к темпу прироста, т.е.: - сотая доля предыдущего уровня. Все эти показатели рассчитываются для оценки степени изменения уровней ряда. Цепные коэффициенты и темпы роста называются показателями интенсивности изменения уровней ДРядов.

2. Расчет средних показателей РД Рассчитывают средние уровни рядов, средние абсолютные приросты, средние темпы роста и средние темпы прироста. Средние показатели рассчитываются с целью обобщения информации и возможности сравнивать уровни и показатели их изменения по различным рядам. 1. средний уровень ряда а) для интервальных временных рядов рассчитывается по средней арифметической простой: , где n – число уровней во временном ряду; б) для моментных рядов средний уровень рассчитывается по специфической формуле, которая называется средней хронологической: . 2. средний абсолютный прирост рассчитывается на основе цепных абсолютных приростов по средней арифметической простой:

. 3. Средний коэффициент роста рассчитывается на основе цепных коэффициентов роста по формуле средней геометрической: . При комментарии средних показателей ДРядов необходимо указывать 2 момента: период, который характеризует анализируемый показатель и временной интервал, за который построен ДРяд. 4. Средний темп роста : . 5. средний темп прироста : .

С помощью МНК можно получить лишь оценки параметров уравнения регрессии. Чтобы проверить, значимы ли параметры (т.е. значимо ли они отличаются от нуля в истинном уравнении регрессии) используют статистические ме­тоды проверки гипотез. В качестве основной гипотезы вы­двигают гипотезу о незначимом отличии от нуля параметра регрессии или коэффициента корреляции. Альтернативной гипотезой, при этом является гипотеза обратная, т.е. о неравенстве нулю параметра или коэффициента корреляции. Для проверки гипотезы используется t- критерий Стьюдента.

Найденное по данным наблюдений значение t- критерия (его еще называют наблюдаемым или фактиче­ским) сравнивается с табличным (критическим) значением, определяемым по таблицам распределения Стьюдента (ко­торые обычно приводятся в конце учебников и практикумов по статистике или эконометрике). Табличное значение оп­ределяется в зависимости от уровня значимости и числа степеней свободы, которое в случае линейной парной рег­рессии равно , n -число наблюдений.

Если фактическое значение t -критерия больше таб­личного (по модулю), то считают, что с вероятностью параметр регрессии (ко­эффициент корреляции) значимо отличается от нуля.

Если фактическое значение t -критерия меньше таб­личного (по модулю), то нет оснований отвергать основную гипотезу, т.е. параметр регрессии (коэффициент корреля­ции) незначимо отличается от нуля при уровне значимости .

Фактические значения t -критерия определяются по формулам:

,

,

где .

Для проверки гипотезы о незначимом отличии от нуля коэффициента линейной парной корреляции используют критерий:

где r - оценка коэффициента корреляции, полученная по наблюдаемым данным.

Прогноз ожидаемого значения результативного признака Y по линейному парному уравнению регрессии.

Пусть требуется оценить прогнозное значение призна­ка-результата для заданного значения признака-фактора . Прогнозируемое значение признака-результата с дове­рительной вероятностью равной принадлежит интервалу прогноза:

,

где - точечный прогноз;

t - коэффициент доверия, определяемый по таблицам распределения Стьюдента в зависимости от уровня значимости α и числа степеней свободы ;

Средняя ошибка прогноза.

Точечный прогноз рассчитывается по линейному уравнению регрессии, как:

.

Средняя ошибка прогноза определяется по формуле:

.

Пример 1.

На основе данных, приведенных в Приложении и соответствующих варианту 100, требуется:



1. Построить уравнение линейной парной регрессии одного признака от другого. Один из признаков, соответствующих Вашему варианту, будет играть роль факторного (Х), другой - результативного . Причинно-следственные связи между признаками установить самим на основе экономического анализа. Пояснить смысл параметров уравнения.

3. Оценить статистическую значимость параметров регрессии и коэффициента корреляции с уровнем значимости 0,05.

4. Выполнить прогноз ожидаемого значения признака-результата Yпри прогнозном значении признака-фактора X, составляющим 105% от среднего уровня X. Оценить точность прогноза, рассчитав ошибку прогноза и его доверительный интервал с вероятностью 0,95.

Решение:

В качестве признака-фактора в данном случае выберем курсовую цену акций, так как от прибыльности акций зависит величина начисленных дивидендов. Таким образом, результативным будет признак дивиденды, начисленные по результатам деятельности .

Для облегчения расчетов построим расчетную таблицу, которая заполняется по ходу решения задачи. (Таблица 1)

Для наглядности зависимости Yот X представим графически. (Рисунок 2)

Таблица 1 - Расчетная таблица


1. Построим уравнение регрессии вида: .

Для этого необходимо определить параметры уравнения и .

Определим ,

где - среднее из значений , возведенных в квадрат;

Среднее значение в квадрате.

Определим параметр а 0 :

Получим уравнение регрессии следующего вида:

Параметр показывает, сколько составили бы дивиденды, начисленные по результатам деятельности при отсутствии влияния со стороны курсовой цены акций. На основе параметра можно сделать вывод, что при изменении курсовой цены акций на 1 руб. произойдет изменение дивидендов в ту же сторону на 0,01 млн. руб.



2. Рассчитаем линейный коэффициент парной корреляции и коэффициент детерминации.

Линейный коэффициент парной корреляции определим по формуле:

,

Определим и :

Коэффициент корреляции, равный 0,708, позволяет судить о тесной связи между результативным и факторным признаками .

Коэффициент детерминации равен квадрату линейного коэффициента корреляции:

Коэффициент детерминации показывает, что на вариации начисленных дивидендов зависит от вариации курсовой цены акций, и на - от остальных неучтенных в модели факторов.

3. Оценим значимость параметров уравнения регрессии и линейного коэффициента корреляции по t- критерию Стьюдента. Необходимо сравнить расчетные значения t- критерия для каждого параметра и сравнить его с табличным.

Для расчета фактических значений t -критерия определим :

Для оценки существенности, значимости коэффициента корреляции используется t-критерий Стьюдента.

Находится средняя ошибка коэффициента корреляции по формуле:

Н
а основе ошибки рассчитываетсяt-критерий:

Рассчитанное значение t-критерия сравнивают с табличным, найденным в таблице распределения Стьюдента при уровне значимости 0,05 или 0,01 и числе степеней свободы n-1. Если расчетное значение t-критерия больше табличного, то коэффициент корреляции признается значимым.

При криволинейной связи для оценки значимости корреляционного отношения и уравнения регрессии применяется F-критерий. Он вычисляется по формуле:

или

где η – корреляционное отношение; n – число наблюдений; m – число параметров в уравнении регрессии.

Рассчитанное значение F сравнивается с табличным для принятого уровня значимости α (0,05 или 0,01) и чисел степеней свободы к 1 =m-1 и k 2 =n-m. Если расчетное значение F превышает табличное, связь признается существенной.

Значимость коэффициента регрессии устанавливается с помощью t-критерия Стьюдента, который вычисляется по формуле:

где σ 2 а i - дисперсия коэффициента регрессии.

Она вычисляется по формуле:

где к – число факторных признаков в уравнении регрессии.

Коэффициент регрессии признается значимым, если t a 1 ≥t кр. t кр отыскивается в таблице критических точек распределения Стьюдента при принятом уровне значимости и числе степеней свободы k=n-1.

4.3.Корреляционно-регрессионный анализ в Excel

Проведём корреляционно-регрессионный анализ взаимосвязи урожайности и затрат труда на 1 ц зерна. Для этого открываем лист Excel, в ячейки А1:А30 вводим значения факторного признака урожайности зерновых культур, в ячейки В1:В30 значения результативного признака – затраттруда на 1 ц зерна. В меню Сервис выберем опцию Анализ данных. Щелкнув левой кнопкой мыши по этому пункту, откроем инструмент Регрессия. Щелкаем по кнопке OK, на экране появляется диалоговое окно Регрессия. В поле Входной интервал У вводим значения результативного признака (выделяя ячейки В1:В30), в поле Входной интервал Х вводим значения факторного признака (выделяя ячейки А1:А30). Отмечаем уровень вероятности 95%, выбираем Новый рабочий лист. Щелкаем по кнопке OK. На рабочем листе появляется таблица «ВЫВОД ИТОГОВ», в которой даны результаты вычисления параметров уравнения регрессии, коэффициента корреляции и другие показатели, позволяющие определить значимость коэффициента корреляции и параметров уравнения регрессии.

ВЫВОД ИТОГОВ

Регрессионная статистика

Множественный R

R-квадрат

Нормированный R-квадрат

Стандартная ошибка

Наблюдения

Дисперсионный анализ

Значимость F

Регрессия

Коэффициенты

Стандартная ошибка

t-статистика

P-Значение

Нижние 95%

Верхние 95%

Нижние 95,0%

Верхние 95,0%

Y-пересечение

Переменная X 1

В данной таблице «Множественный R» - это коэффициент корреляции, «R-квадрат» - коэффициент детерминации. «Коэффициенты: Y-пересечение» - свободный член уравнения регрессии 2,836242; «Переменная Х1» – коэффициент регрессии -0,06654. Здесь имеются также значения F-критерия Фишера 74,9876, t-критерия Стьюдента 14,18042, «Стандартная ошибка 0,112121», которые необходимы для оценки значимости коэффициента корреляции, параметров уравнения регрессии и всего уравнения.

На основе данных таблицы построим уравнение регрессии: у х =2,836-0,067х. Коэффициент регрессии а 1 =-0,067 означает, что с повышением урожайности зерновых на 1 ц/га затраты труда на 1 ц зерна уменьшаются на 0,067 чел.-ч.

Коэффициент корреляции r=0,85>0,7, следовательно, связь между изучаемыми признаками в данной совокупности тесная. Коэффициент детерминации r 2 =0,73 показывает, что 73% вариации результативного признака (затрат труда на 1 ц зерна) вызвано действием факторного признака (урожайности зерновых).

В таблице критических точек распределения Фишера - Снедекора найдём критическое значение F-критерия при уровне значимости 0,05 и числе степеней свободы к 1 =m-1=2-1=1 и k 2 =n-m=30-2=28, оно равно 4,21. Так как рассчитанное значение критерия больше табличного (F=74.9896>4,21), то уравнение регрессии признаётся значимым.

Для оценки значимости коэффициента корреляции рассчитаем t-критерий Стьюдента:

В
таблице критических точек распределения Стьюдента найдём критическое значениеt-критерия при уровне значимости 0,05 и числе степеней свободы n-1=30-1=29, оно равно 2,0452. Так как расчётное значение больше табличного, то коэффициент корреляции является значимым.