Альтернативная ошибка это

Alternatif Error Sans

“HAHAHAHAHAHA I GOT THE WHOLE MULTİVERSE IN MY HANDS”.

BackStory

Jack/AL!Error

The Necessary Deal

It would be more explanatory to start by explaining the error cycle that occurs inside the Undertale alternate universes. Error tried to kill Geno, but actually ended up causing Geno to kill himself. This caused his Sans to reset and then hit Anti-Void. He went crazy there and it turned into a mistake. Then, somewhere along the line, he went to Geno and started paradox again. and this paradox kept advancing itself without stopping, Jack/ALerror was the one who would take the role of the other error in this paradox, but when Jack killed himself, he did not hit the Anti-Void, he had unknowingly broken the cycle. and Jack is a gateway to all the Alternate universes called «Over-Door», this was a place where not only the alternate universes, but all the undertale Alternate universes were located in the Incalculably genocidal ruins. jack saw everything, realized the whole error cycle, realized how serious the cycle he broke was.

Jack began to watch all the alternate universes in a confused way, no matter how unresponsive he was, he thought, «I should have gone back, should I have accepted the role of the loop. huh… he thought he tried to teleport himself outside, but just like Geno said, «It’s meaningless like a broken pencil,» he said to himself and laughed. and Jack threw himself on the ground «Because of me, I have doubled the suffering that all AU’s would normally endure.. IT’S ALL MY FAULT I don’t deserve to be happy.» he crawled on the floor and finally closed his eyes. he stood like that until he got bored because he was never involved in the place where there was no time and space. when he opened his eyes, he touched the ground with his finger and a red flame started coming out of the ground. he began to destroy all those endless alternative results he saw, even if he didn’t want to, with his own hands.

Note: from now on, it will proceed as a First-person narrative

I panicked as the endless possibilities slowly disappeared in front of me, involuntarily destroying them, I screamed for half, but no one answered, I didn’t even know where I was, I was all alone, it was so quiet, it was so empty, and it was so perfect. at that moment, I thought inwardly that I wish I had let error kill me.. but the fire in front of me suddenly disappeared, brought everything back and turned blue, I retreated out of fear. a flame calling itself ryan, and a flame then transformed itself into a skeleton-like state just like me, I asked him his name, he answered me «Ryan» and started talking to me, it seemed like he was kidding. «HAHAHAHAH have you lost your way, I’m kidding, idiots like you don’t deserve a tale like this, do you really want to stay in a stupid book and stay in the error loop? I’m the answer to all the questions you’re afraid to find, and don’t tell me that you’re going to try to go back to the stupid old cycle before you get to this reality, »

since I didn’t think I deserved to live anymore, I touched the jacket he was wearing to see if it was real, he pulled a sword in his hand and pointed it at my eye. «Do you want to die again?» he shouted at me in a loud voice that was really real, «he said I’m the king and god of everything that can be,» so I answered him without caring, «you’re just a king, not a warrior.» I was expecting him to kill me, but he called me brave for telling him that, he told me that my soul, my codes, my files, and I was no longer anything I depended on. i was really out of the loop, I had no purpose left to live, so Ryan offered me this offer. «I will get you out of here, but in any case, you will give your own life to me.» it was amazing that someone so superior that the concept of death could not reach, came to me with such an offer. but I had no purpose to live, so I accepted for this reason.

Even though I was completely out of the loop, the line I needed to move forward was obvious. my appearance was starting to look like a mistake, but I started to get glitchy because I broke the cycle. but ryan fixed me in such a way that I won’t die and my glichs will stop. he took me to a place called the alternative community, and here I found out that he was the king. because of this state I had entered and the agreement I had accepted, my powers were slowly beginning to manifest themselves.

But when I found out that Ryan was the one who planned this whole cycle, my desire to die completely disappeared. Ryan had planned all my suffering, and inferium had destroyed the universe, the first of the altenatives universe, had taken away the happiness he had given again, had promised myself that I would never die without making him pay, I didn’t want to die anymore, I WANTED TO KILL RYAN.

Personality

Betrayal

When Jack realized that he had been betrayed, he grew a great hatred for Ryan, destroying all the favors that Ryan had done him, even though he knew that he would disappear when the time came. he had turned into someone with an aggressive sense of killing who didn’t care about anything anymore. he even once challenged Ryan to smash the entire multiverse in his hand and shouted “I GOT THE WHOLE MUTLIVERSE IN MY HANDS”.

Powers

100/10 Error Blaster

He uses a type of Gaster Blaster called Error Blaster, which are simply Gaster Blasters that are black in color and have blue traces of tears falling from red eye sockets. Error’s Gaster blaster is bigger, faster and more powerful than Classic Sans.

TRanslate

100/10=Error Blaster: Error Blaster adı verilen, basitçe siyah renkli ve kırmızı göz yuvalarından düşen mavi gözyaşı izleri olan Gaster Blaster'lar olan bir tür Gaster Blaster kullanır. Error's Gaster blaster, Classic Sans'tan daha büyük, daha hızlı ve daha güçlüdür.

Blue Wires

It uses blue strings through the tear ducts to bind and tear apart SOULS, if the strings get inside a victim, it can transfer his soul to the victim’s body, destroy his body, and also destroy the victim’s soul, and destroy the victim’s soul. o. This allows him to be able to control the victim when the victim is helpless. This is Error’s «main weapon» because Error feels more comfortable with wires, as Error does not have a very good view.

TRanslate

Mavi Teller: RUHLARI bağlamak ve parçalamak için gözyaşı kanallarından mavi ipler kullanır, ipleri bir kurbanın içine girerse, ruhunu kurbanın vücuduna aktarabilir, vücudunu yok edebilir ve kurbanın ruhunu da yok edebilir ve kurbanın ruhunu yok edebilir. o. Bu, kurban çaresizken kurbanı kontrol edebilmesini sağlar. Bu Error'ın "ana silahı"dır çünkü Error'ın çok iyi bir görüşü olmadığı için Error tellerle daha rahat hisseder.

Glitch Hop

As the main means of Omnidirectional Transportation, he can direct himself and others to other aus.

TRanslate

Çok Yönlü Taşımacılığın ana aracı olarak kendisini ve başkalarını diğer AU'lara yönlendirebilir.

Red Wires

These strings boil hot to the touch, infused with light determination from Error’s past as Geno. This, as a viable method of torture, will cause increased suffering, both through people and monsters. Although they can result in mental damage, they do not cause real damage.

TRanslate

Bu dizeler, Error'ın Geno olarak geçmişinden gelen hafif kararlılıkla aşılanmış dokunuşa sıcak kaynar. Bu, uygulanabilir bir işkence yöntemi olarak, hem insanlar hem de canavarlar aracılığıyla artan acıya neden olacaktır. Zihinsel hasarla sonuçlanabilseler de, gerçek hasara neden olmazlar

Green Wires

These sequences are used in conjunction with the blue sequences, and extracted statistics are used to infuse them into other entities as well. This is actually a healing method.

TRanslate

Bu diziler, mavi dizilerle bağlantılı olarak kullanılır ve onları diğer varlıklara da aşılamak için ayıklanmış istatistikler kullanılır. Bu aslında bir iyileşme yöntemidir.

White Wires

These arrays function only as regular arrays. There is nothing else for them. Error often uses them to trap others, in addition to even removing strange limbs.

TRanslate

Bu diziler sadece normal diziler olarak işlev görür. Onlara başka bir şey yok. Error genellikle onları başkalarını tuzağa düşürmek için kullanır, hatta garip uzuvları çıkarmanın yanı sıra.

Misleading strings

Error is inevitably Error!the strings he discovered through hard work with 404. These wires gain the ability to change their perception, hearing and senses, allowing them to enter the person’s SPIRIT. They are usually black in color, but once, by influencing someone else’s SPIRIT, they turn into a rainbow color.

TRanslate

Error'ın kaçınılmaz olarak Error!404 ile sıkı çalışma yoluyla keşfettiği dizeler. Bu teller, kişinin RUHU'na girmelerine izin vererek onların algılarını, işitmelerini ve duyularını değiştirme yeteneği kazanırlar. Genellikle siyah renktedirler, ancak bir kez başka birinin RUHU'nu etkileyerek gökkuşağı rengine dönüşürler.

Error Explosion

The bug can shoot large, black blasters that fire red beams. Although they only have a range of 3 m before the beam evaporates, these instantly shoot at everything.

TRanslate

Hata, kırmızı ışınlar ateşleyen büyük, siyah blasterler atabilir. Işın buharlaşmadan önce yalnızca 3 m menzile sahip olmalarına rağmen, bunlar anında her şeye ateş eder.

Fault beam

Essentially the Novice God Ray, which Error calls the «Glitch Ray» to make it sound special, this works as you would expect. However, unlike the God Ray, this beam is a coherent beam instead of a simple fire. This beam, which is much thinner, has no effect on the inorganic material. For organic material, this beam instantly disrupts their code, either by making them obey Hata’s every command, or by decomposing their bodies until they essentially become a shell.

TRanslate

Esasen Error'ın kulağa özel gelmesi için "Glitch Ray" adını verdiği Acemi Tanrı Işını, bu beklediğiniz gibi çalışır. Ancak, God Ray'den farklı olarak, bu ışın basit bir ateş yerine tutarlı bir ışındır. Çok daha ince olan bu ışının inorganik malzeme üzerinde herhangi bir etkisi yoktur. Organik malzeme için, bu ışın, ya Hata'nın her komutuna uymalarını sağlayarak ya da esasen bir kabuk haline gelene kadar vücutlarını ayrıştırarak kodlarını anında bozar.

The Eyes of the Overseer

There is a row of eyes on Error’s right arm, who sews his hand into his coat. Although Error says that this is just a cosmetic feature of her clothing, her real abilities are unknown. Only fools would believe such a thing.

TRanslate

Error'ın sağ kolunun üzerinde elini paltosuna diken bir dizi göz var. Error bunun sadece giysisinin kozmetik bir özelliği olduğunu söylese de, gerçek yetenekleri bilinmiyor. Böyle bir şeye ancak aptallar inanırdı.

«One Finger»

Error.take out the ropes in his hand and pass them to him.»It can turn into an evolved error form» ‘This power allows him to win any kind of war, even if it weakens him later’

Lightning Explosives

Powerful Explosives designed by Hata, capable of destroying almost anything fired at him. The Damage Rating was 100000, but due to his progress in the Multiverse, as well as upgrades to the Mainframe, he now stands in infinity.

TRanslate

Hata tarafından tasarlanan, kendisine ateş edilen neredeyse her şeyi yok edebilen Güçlü Patlayıcılar. Hasar Derecesi 100000'dü, ancak Çoklu Evrendeki ilerlemelerinden ve Ana Bilgisayardaki yükseltmelerin yanı sıra şimdi sonsuzda'da duruyor.

Reankaryasyon

This Ability is used when the Bug is killed or takes a lot of damage. When he takes too much damage or is killed, he will scatter his code on the ground and then erase himself from the world. After this.The particles left behind by the Bug will collect code from the world and then return to the Bug’s lair and revive the Bug from the sources they received.

TRanslate

Bu Yetenek, Hata öldürüldüğünde veya çok fazla hasar aldığında kullanılır. Çok fazla hasar aldığında veya öldürüldüğünde kodunu toprağa saçacak ve ardından kendini dünyadan silecektir. Bundan sonra.Hata''nın geride bıraktığı parçacıklar dünyadan kod toplayacak ve daha sonra Hata''nın inine geri dönecek ve aldıkları kaynaklardan Hatayı'ü yeniden canlandıracaktır.

MFTL+ Speed

The error is so fast that it can reach the center of the universe in a matter of minutes.

TRanslate

Hata o kadar hızlıdır ki, evrenin merkezine birkaç dakika içinde ulaşabilir.

Pixelation Manipulation

The Error can manipulate the air, turning particles into tiny pixels and allowing it to form things out of any physical material. He can also use it on himself instead of teleporting.

TRanslate

Hata havayı manipüle edebilir, parçacıkları küçük piksellere dönüştürebilir ve herhangi bir fiziksel malzemeden bir şeyler oluşturmasına izin verebilir. Bunu ışınlanma yerine kendi üzerinde de kullanabilir.

Relations.

Soon

Feats

  • »Error.he has destroyed many multiverses with a single finger before.»
  • «When the bug travels the multiverse, king!he fought with the multiverse and tore it apart in 4 seconds.»
  • «The mistake that runs all its potential «has defeated the true creator in the void»
  • «The white threads acquired by the error allow it to move apart from the dimensions, which puts the error above the concept of dimension»
  • «He has left the concept of speed behind, he moves apart from speed or time»
  • »Error. while fighting with alternative 404, one by one god ray bounced back from him on his way to a mistake and destroyed several galaxies.»
  • «Because he moves apart from time, the attacks don’t work on him»
  • «since he has dimensional superiority, only beings superior to dimension can damage him»
  • »Error.it has never been deleted since the last time it was deleted, it can become more powerful by changing its codes.»
  • «He knows you’re in fiction»
  • «He can see and hear someone watching him»
  • »Error. he once blew up the computer of someone who was watching him from the computer»
  • «He can even see an invisible or unknown dimension by overcoming the concept of dimension»
  • «By transcending the concept of power, he surpasses his own power by surpassing the concept of almost infinite»
  • «He had defeated a being that denoted infinity and made his own puppet»
  • »Error.he once blew up the computer of someone who was watching him from the computer»
  • «A person was looking at the wiki of the error from the computer.»The mistake is that he noticed him and put that viewer on the wiki and put himself in the place of that child»
  • »Error.everything is known or unknown fiction, etc.he knows it made him have nervous breakdowns,
  • but he overcame them and can play the character he wants as a puppet.in the void of error, non-fiction(a real-life child is a prison)»
  • Error can The ghost can use emo’s powers.

Feats tr translate

'Hata.önceden tek parmakla bir çok çoklu evrenleri yok etmiştir''
''Hata çoklu evrenleri gezerken kral!çoklu evren ile kapışmıştır 4 saniyede onu parçalamıştır''
''Tüm potansiyelini çalıştıran hata ''boşlukta gerçek yaratıcıyı yenmiştir''
''Alternatif404! ile girdiği kapışmada 5 tane galaxi yok olmuştu''
'Hatanın edindiği beyaz ipler onun boyutlardan ayrı hareket etmesini sağlıo buda hatayı boyut kavramının üstüne geçiyor''
'Hız kavramını geride bıraktı hızdan veya zamandan ayrı hareket ediyor''
''Hata. alternatif 404 ile kapışırken bir bir god ray hataya giderken ondan geri sekti ve birkaç galaksiyi yok etti''
''Zamandan ayrı hareket ettiği için saldırılar ona işlemiyor''
''boyut üstünlüğü olduğu için sadece boyuttan üstün varlıklar ona hasar verebilir''
''Hata.en son silindiğinden beri asla silinmedi kendisinin kodlarını değiştirerek daha güçlü olabilio''
'Kurgunun içinde olduğun farkında''
''Onu izleyen birini görebilir ve duyabilir''
''Hata.birkere kendisini bilgisayardan izleyen birinin bilgisayarını patlattı''
''Boyut kavramını aşarak görünmeyen veya bilinmeyen bir boyutları bile görebiliyor''
''Güç kavramını aşarak kendi gücünü neredeyse sonsuz kavramını aşarak daha üste çıkarıyor''
''Sonsuzluğu belirten bir varlığı yenmişti ve kendi kuklası yapmıştı
''Bir kişi bilgisayardan hatanın wikisine bakıyordu.''Hata onu fark edip o izleyeni wikiye geçirdi ve kendisini o çocuğun yerine geçirdi''
''Hayalet emo bir atkı şeklinde hatanın atkısı halinde bulunuyor ve bu hataya.hayalet emonun güçlerini sağlıyo''
Error hayalet emonun güçlerini kullanabilir.

Материал из MachineLearning.

Перейти к: навигация, поиск

Содержание

  • 1 Методика проверки статистических гипотез
  • 2 Альтернативная методика на основе достигаемого уровня значимости
  • 3 Типы критической области
  • 4 Ошибки первого и второго рода
  • 5 Свойства статистических критериев
  • 6 Типы статистических гипотез
  • 7 Типы статистических критериев
    • 7.1 Критерии согласия
    • 7.2 Критерии сдвига
    • 7.3 Критерии нормальности
    • 7.4 Критерии однородности
    • 7.5 Критерии симметричности
    • 7.6 Критерии тренда, стационарности и случайности
    • 7.7 Критерии выбросов
    • 7.8 Критерии дисперсионного анализа
    • 7.9 Критерии корреляционного анализа
    • 7.10 Критерии регрессионного анализа
  • 8 Литература
  • 9 Ссылки

Статистическая гипотеза (statistical hypothesys) — это определённое предположение о распределении вероятностей, лежащем в основе наблюдаемой выборки данных.

Проверка статистической гипотезы (testing statistical hypotheses) — это процесс принятия решения о том, противоречит ли рассматриваемая статистическая гипотеза наблюдаемой выборке данных.

Статистический тест или статистический критерий — строгое математическое правило, по которому принимается или отвергается статистическая гипотеза.

Методика проверки статистических гипотез

Пусть задана случайная выборка x^m = (x_1,ldots,x_m) — последовательность m объектов из множества X.
Предполагается, что на множестве X существует некоторая неизвестная вероятностная мера mathbb{P}.

Методика состоит в следующем.

  1. Формулируется нулевая гипотеза H_0 о распределении вероятностей на множестве X. Гипотеза формулируется исходя из требований прикладной задачи. Чаще всего рассматриваются две гипотезы — основная или нулевая H_0 и альтернативная H_1. Иногда альтернатива не формулируется в явном виде; тогда предполагается, что H_1 означает «не H_0». Иногда рассматривается сразу несколько альтернатив. В математической статистике хорошо изучено несколько десятков «наиболее часто встречающихся» типов гипотез, и известны ещё сотни специальных вариантов и разновидностей. Примеры приводятся ниже.
  2. Задаётся некоторая статистика (функция выборки) T:: X^m to mathbb{R}, для которой в условиях справедливости гипотезы H_0 выводится функция распределения F(T) и/или плотность распределения p(T). Вопрос о том, какую статистику надо взять для проверки той или иной гипотезы, часто не имеет однозначного ответа. Есть целый ряд требований, которым должна удовлетворять «хорошая» статистика T. Вывод функции распределения F(T) при заданных H_0 и T является строгой математической задачей, которая решается методами теории вероятностей; в справочниках приводятся готовые формулы для F(T); в статистических пакетах имеются готовые вычислительные процедуры.
  3. Фиксируется уровень значимости — допустимая для данной задачи вероятность ошибки первого рода, то есть того, что гипотеза на самом деле верна, но будет отвергнута процедурой проверки. Это должно быть достаточно малое число alpha in [0,1]. На практике часто полагают alpha=0.05.
  4. На множестве допустимых значений статистики T выделяется критическое множество Omega_alpha наименее вероятных значений статистики T, такое, что mathbb{P}{TinOmega_alphaleft|H_0right.} = alpha. Вычисление границ критического множества как функции от уровня значимости alpha является строгой математической задачей, которая в большинстве практических случаев имеет готовое простое решение.
  5. Собственно статистический тест (статистический критерий) заключается в проверке условия:

Итак, статистический критерий определяется статистикой T
и критическим множеством Omega_alpha, которое зависит от уровня значимости alpha.

Замечание.
Если данные не противоречат нулевой гипотезе, это ещё не значит, что гипотеза верна.
Тому есть две причины.

Альтернативная методика на основе достигаемого уровня значимости

Широкое распространение методики фиксированного уровня значимости было вызвано сложностью вычисления многих статистических критериев в докомпьютерную эпоху. Чаще всего использовались таблицы, в которых для некоторых априорных уровней значимости были выписаны критические значения. В настоящее время результаты проверки гипотез чаще представляют с помощью достигаемого уровня значимости.

Достигаемый уровень значимости (пи-величина, англ. p-value) — это наименьшая величина уровня значимости,
при которой нулевая гипотеза отвергается для данного значения статистики критерия T:

p(T) = min { alpha:: TinOmega_alpha },

где
Omega_alpha — критическая область критерия.

Другая интерпретация:
достигаемый уровень значимости p(T) — это вероятность при справедливости нулевой гипотезы получить значение статистики, такое же или ещё более экстремальное, чем T.

Если достигаемый уровень значимости достаточно мал (близок к нулю), то нулевая гипотеза отвергается.
В частности, его можно сравнивать с фиксированным уровнем значимости;
тогда альтернативная методика будет эквивалентна классической.

Типы критической области

Обозначим через t_alpha значение, которое находится из уравнения F(t_alpha) = alpha, где F(t) = mathbb{P}left{ T<t right} — функция распределения статистики T.
Если функция распределения непрерывная строго монотонная,
то t_alpha есть обратная к ней функция:

t_alpha = F^{-1}(alpha).

Значение t_alpha называется также alphaквантилем распределения F(t).

На практике, как правило, используются статистики T с унимодальной (имеющей форму пика) плотностью распределения.
Критические области (наименее вероятные значения статистики) соответствуют «хвостам» этого распределения.
Поэтому чаще всего возникают критические области одного из трёх типов:

  • Левосторонняя критическая область:
определяется интервалом Omega_alpha = (-infty,, t_alpha).
пи-величина: p(T) = F(T).
  • Правосторонняя критическая область:
определяется интервалом Omega_alpha = (t_{1-alpha},,+infty).
пи-величина: p(T) = 1-F(T).
  • Двусторонняя критическая область:
определяется двумя интервалами Omega_alpha = (-infty,, t_{alpha/2}) cup (t_{1-alpha/2},,+infty);
пи-величина: p(T) = min left{ 2F(T),; 2(1-F(T)) right}.

Ошибки первого и второго рода

  • Ошибка первого рода или «ложная тревога» (англ. type I error, alpha error, false positive) — когда нулевая гипотеза отвергается, хотя на самом деле она верна. Вероятность ошибки первого рода:
alpha = mathbb{P}left{ TinOmega_alpha | H_0 right}.
  • Ошибка второго рода или «пропуск цели» (англ. type II error, beta error, false negative) — когда нулевая гипотеза принимается, хотя на самом деле она не верна. Вероятность ошибки второго рода:
beta(H_1) = mathbb{P}left{ TnotinOmega_alpha | H_1 right}.
  Верная гипотеза
 H_0   H_1 
Результат
 применения 
критерия
 H_0  H_0 верно принята H_0 неверно принята 
(Ошибка второго рода)
 H_1  H_0 неверно отвергнута 
(Ошибка первого рода)
H_0 верно отвергнута

Свойства статистических критериев

Мощность критерия:
1 - beta(H) = mathbb{P}left{ TinOmega_alpha | H right} — вероятность отклонить гипотезу H_0, если на самом деле верна альтернативная гипотеза H.
Мощность критерия является числовой функцией от альтернативной гипотезы H.

Несмещённый критерий:
1-beta(H) geq alpha
для всех альтернатив H
или, что то же самое,
mathbb{P}left{ TinOmega_alpha | H right} geq mathbb{P}left{ TinOmega_alpha | H_0 right}
для всех альтернатив H.

Состоятельный критерий:
beta(H) to 0 при mtoinfty для всех альтернатив H.

Равномерно более мощный критерий.
Говорят, что критерий с мощностью 1-beta(H) является равномерно более мощным, чем критерий с мощностью 1-beta'(H), если выполняются два условия:

  1. beta(H_0) = beta'(H_0);
  2. beta(H_1) leq beta'(H_1) для всех рассматриваемых альтернатив H_1neq H_0, причём хотя бы для одной альтернативы неравенство строгое.

Типы статистических гипотез

  • Простая гипотеза однозначно определяет функцию распределения на множестве X. Простые гипотезы имеют узкую область применения, ограниченную критериями согласия (см. ниже). Для простых гипотез известен общий вид равномерно более мощного критерия (Теорема Неймана-Пирсона).
  • Сложная гипотеза утверждает принадлежность распределения к некоторому множеству распределений на X. Для сложных гипотез вывести равномерно более мощный критерий удаётся лишь в некоторых специальных случаях.

Типы статистических критериев

В зависимости от проверяемой нулевой гипотезы статистические критерии делятся на группы, перечисленные ниже по разделам.

Наряду с нулевой гипотезой, которая принимается или отвергается по результату анализа выборки, статистические критерии могут опираться на дополнительные предположения, которые априори предпологаются выполненными.

  • Параметрические критерии предполагают, что выборка порождена распределением из заданного параметрического семейства. В частности, существует много критериев, предназначенных для анализа выборок из нормального распределения. Преимущество этих критериев в том, что они более мощные. Если выборка действительно удовлетворяет дополнительным предположениям, то параметрические критерии дают более точные результаты. Однако если выборка им не удовлетворяет, то вероятность ошибок (как I, так и II рода) может резко возрасти. Прежде чем применять такие критерии, необходимо убедиться, что выборка удовлетворяет дополнительным предположениям. Гипотезы о виде распределения проверяются с помощью критериев согласия.
  • Непараметрические критерии не опираются на дополнительные предположения о распределении. В частности, к этому типу критериев относится большинство ранговых критериев.

Критерии согласия

Критерии согласия проверяют, согласуется ли заданная выборка с заданным фиксированным распределением, с заданным параметрическим семейством распределений, или с другой выборкой.

  • Критерий Колмогорова-Смирнова
  • Критерий хи-квадрат (Пирсона)
  • Критерий омега-квадрат (фон Мизеса)

Критерии сдвига

Специальный случай двухвыборочных критериев согласия.
Проверяется гипотеза сдвига, согласно которой распределения двух выборок имеют одинаковую форму и отличаются только сдвигом на константу.

  • Критерий Стьюдента
  • Критерий Уилкоксона-Манна-Уитни

Критерии нормальности

Критерии нормальности — это выделенный частный случай критериев согласия.
Нормально распределённые величины часто встречаются в прикладных задачах, что обусловлено действием закона больших чисел.
Если про выборки заранее известно, что они подчиняются нормальному распределению, то к ним становится возможно применять более мощные параметрические критерии.
Проверка нормальность часто выполняется на первом шаге анализа выборки, чтобы решить, использовать далее параметрические методы или непараметрические.
В справочнике А. И. Кобзаря приведена сравнительная таблица мощности для 21 критерия нормальности.

  • Критерий Шапиро-Уилка
  • Критерий асимметрии и эксцесса

Критерии однородности

Критерии однородности предназначены для проверки нулевой гипотезы о том, что
две выборки (или несколько) взяты из одного распределения,
либо их распределения имеют одинаковые значения математического ожидания, дисперсии, или других параметров.

Критерии симметричности

Критерии симметричности позволяют проверить симметричность распределения.

  • Одновыборочный критерий Уилкоксона и его модификации: критерий Антилла-Кёрстинга-Цуккини, критерий Бхаттачария-Гаствирса-Райта
  • Критерий знаков
  • Коэффициент асимметрии

Критерии тренда, стационарности и случайности

Критерии тренда и случайности предназначены для проверки нулевой гипотезы об
отсутствии зависимости между выборочными данными и номером наблюдения в выборке.
Они часто применяются в анализе временных рядов, в частности, при анализе регрессионных остатков.

Критерии выбросов

Критерии дисперсионного анализа

Критерии корреляционного анализа

Критерии регрессионного анализа

Литература

  1. Вероятность и математическая статистика: Энциклопедия / Под ред. Ю.В.Прохорова. — М.: Большая российская энциклопедия, 2003. — 912 с.
  2. Кобзарь А. И. Прикладная математическая статистика. Справочник для инженеров и научных работников. — М.: Физматлит, 2006. — 816 с.

Ссылки

  • Statistical hypothesis testing — статья в англоязычной Википедии.

Ошибки I и II рода при проверке гипотез, мощность

Общий обзор

Принятие неправильного решения

Мощность и связанные факторы

Проверка множественных гипотез

Общий обзор

Большинство проверяемых гипотез сравнивают между собой группы объектов, которые испытывают влияние различных факторов.

Например, можно сравнить эффективность двух видов лечения, чтобы сократить 5-летнюю смертность от рака молочной железы. Для данного исхода (например, смерть) сравнение, представляющее интерес (напри­мер, различные показатели смертности через 5 лет), называют эффектом или, если уместно, эффектом лечения.

Нулевую гипотезу выражают как отсутствие эффекта (например 5-летняя смертность от рака мо­лочной железы одинаковая в двух группах, получаю­щих разное лечение); двусторонняя альтернативная гипотеза будет означать, что различие эффектов не равно нулю.

Критериальная проверка гипотезы дает возможность определить, достаточно ли аргументов, чтобы отвергнуть нулевую гипотезу. Можно принять только одно из двух решений:

  1. отвергнуть нулевую гипотезу и принять альтер­нативную гипотезу
  2. остаться в рамках нулевой гипотезы

Важно: В литературе достаточно часто встречается понятие «принять нулевую гипотезу». Хотелось бы внести ясность, что со статистической точки зрения принять нулевую гипотезу невозможно, т.к. нулевая гипотеза представляет собой достаточно строгое утверждение (например, средние значения в сравниваемых группах равны ).

Поэтому фразу о принятии нулевой гипотезы следует понимать как то, что мы просто остаемся в рамках гипотезы.

Принятие неправильного решения

Возможно неправильное решение, когда отвергают/не отвергают нулевую гипотезу, потому что есть только выборочная информация.

  Верная гипотеза
H0 H1
Результат

 применения 

критерия

H0 H0 верно принята H0 неверно принята 

(Ошибка второго рода)

H1 H0 неверно отвергнута 

(Ошибка первого рода)

H0 верно отвергнута

Ошибка 1-го рода: нулевую гипотезу отвергают, когда она истинна, и делают вывод, что имеется эффект, когда в действительности его нет. Максимальный шанс (вероятность) допустить ошибку 1-го рода обозначается α (альфа). Это уровень значимости критерия; нулевую гипотезу отвергают, если наше значение p ниже уровня значимости, т. е., если p < α.

Следует принять решение относительно значения а прежде, чем будут собраны данные; обычно назначают условное значение 0,05, хотя можно выбрать более ограничивающее значение, например 0,01.

Шанс допустить ошибку 1-го рода никогда не превысит выбранного уровня значимости, скажем α = 0,05, так как нулевую гипотезу отвергают только тогда, когда p< 0,05. Если обнаружено, что p > 0,05, то нулевую гипотезу не отвергнут и, следовательно, не допустят ошибки 1-го рода.

Ошибка 2-го рода: не отвергают нулевую гипотезу, когда она ложна, и делают вывод, что нет эффекта, тогда как в действительности он существует. Шанс возникновения ошибки 2-го рода обозначается β (бета); а величина (1-β) называется мощностью критерия.

Следовательно, мощность — это вероятность отклонения нулевой гипотезы, когда она ложна, т.е. это шанс (обычно выраженный в процентах) обнаружить реальный эффект лечения в выборке данного объема как статистически значимый.

В идеале хотелось бы, чтобы мощность критерия составляла 100%; однако это невозможно, так как всегда остается шанс, хотя и незначительный, допустить ошибку 2-го рода.

К счастью, известно, какие факторы влияют на мощность и, таким образом, можно контролировать мощность критерия, рассматривая их.

Мощность и связанные факторы

Планируя исследование, необходимо знать мощность предложенного критерия. Очевидно, можно начинать исследование, если есть «хороший» шанс обнаружить уместный эффект, если таковой существует (под «хорошим» мы подразумеваем, что мощность должна быть по крайней мере 70-80%).

Этически безответственно начинать исследование, у которого, скажем, только 40% вероятности обнаружить реальный эффект лечения; это бесполезная трата времени и денежных средств.

Ряд факторов имеют прямое отношение к мощности критерия.

Объем выборки: мощность критерия увеличивается по мере увеличения объема выборки. Это означает, что у большей выборки больше возможностей, чем у незначительной, обнаружить важный эффект, если он существует.

Когда объем выборки небольшой, у критерия может быть недостаточно мощности, чтобы обнаружить отдельный эффект. Эти методы также можно использовать для оценки мощности критерия для точно установленного объема выборки.

Вариабельность наблюдений: мощность увеличивается по мере того, как вариабельность наблюдений уменьшается.

Интересующий исследователя эффект: мощность критерия больше для более высоких эффектов. Критерий проверки гипотез имеет больше шансов обнаружить значительный реальный эффект, чем незначительный.

Уровень значимости: мощность будет больше, если уровень значимости выше (это эквивалентно увеличению допущения ошибки 1-го рода, α, а допущение ошибки 2-го рода, β, уменьшается).

Таким образом, вероятнее всего, исследователь обнаружит реальный эффект, если на стадии планирования решит, что будет рассматривать значение р как значимое, если оно скорее будет меньше 0,05, чем меньше 0,01.

Обратите внимание, что проверка ДИ для интересующего эффекта указывает на то, была ли мощность адекватной. Большой доверительный интервал следует из небольшой выборки и/или набора данных с существенной вариабельностью и указывает на недостаточную мощность.

Проверка множественных гипотез

Часто нужно выполнить критериальную проверку значимости множественных гипотез на наборе данных с многими переменными или существует более двух видов лечения.

Ошибка 1-го рода драматически увеличивается по мере увеличения числа сравнений, что приводит к ложным выводам относительно гипотез. Следовательно, следует проверить только небольшое число гипотез, выбранных для достижения первоначальной цели исследования и точно установленных априорно.

Можно использовать какую-нибудь форму апостериорного уточнения значения р, принимая во внимание число выполненных проверок гипотез.

Например, при подходе Бонферрони (его часто считают довольно консервативным) умножают каждое значение р на число выполненных проверок; тогда любые решения относительно значимости будут основываться на этом уточненном значении р.

Связанные определения:
p-уровень
Альтернативная гипотеза, альтернатива
Альфа-уровень
Бета-уровень
Гипотеза
Двусторонний критерий
Критерий для проверки гипотезы
Критическая область проверки гипотезы
Мощность
Мощность исследования
Мощность статистического критерия
Нулевая гипотеза
Односторонний критерий
Ошибка I рода
Ошибка II рода
Статистика критерия
Эквивалентные статистические критерии

В начало

Содержание портала

При
проверке гипотезы экспериментальные
данные могут противоречить
гипотезе
,
тогда эта гипотезаотклоняется.

В
противном случае, если экспериментальные
данные согласуются
с
гипотезой
,
то онане
отклоняется
.

Значит,
статистическая проверка гипотез,
основанная на экспериментальных данных,
неизбежно связанно с риском
принять ложное решение
.

Тогда
в терминах правильности или ошибочности
принятия H0
и
 можно
указать четыре потенциально возможных
результата применения критерия к
выборке. При
этом возможны ошибки двух родов.

Ошибкой первого
рода

называется
ошибка отклонения правильной гипотезы
.
Вероятность
ошибки первого рода равна
уровню значимости
,
т.е.

.

Эта
формула означает, что гипотеза
отклоняется с вероятностью,
хотя эта гипотеза верна. Название
«уровень значимости» в терминах «сходства
и различия» — это вероятность того, что
мы сочли различия существенными (приняли),
а они на самом деле случайны (верна
гипотеза).

Для того чтобы
проверяемая гипотеза была достаточно
обоснованно отвергнута, уровень
значимости выбирают достаточно малым,
в практике: 0,01; 0,001.

Ошибкой второго
рода

называется ошибка принятия неверной
гипотезы.
Вероятность
ошибки второго рода обозначается
:

.

Эта
формула означает, что гипотеза
принимается с вероятностью,
хотя верна альтернативная гипотеза.

Чем
меньше уровень значимости, тем меньше
вероятность забраковать верную гипотезу,
т.е. совершить ошибку первого рода, но
при этом увеличивается вероятность
принятия неверной гипотезы, т.е. совершения
ошибки второго рода.

Принята гипотеза

H0

H1

Верна

гипотеза

H0


вероятность правильно принять H0,
когда верна H0


вероятность ошибочно принять H1,
когда верна H0
(ошибка
1-го рода, уровень значимости
)

H1


вероятность ошибочно принять H0,
когда верна H1
(ошибка
2-го рода
)


вероятность правильно принять H1,
когда верна H
(мощность
критерия
)

Возможны
два
статистических правильных решения

по выборочным данным:

1) Принять верную гипотезу . Вероятность этого решения называетсяуровнем доверия;

2)
принять
верную гипотезу
.
Вероятностьтакого решения называетсямощностью
критерия
.
Мощность критерия в терминах
«сходство-различие» — это его способность
выявлять различия, если они есть
.

4.
Односторонний и двусторонний критерии

По
виду альтернативной (конкурирующей)
гипотезы
определяется вид критической области,
в которой результаты выборочного
наблюдения выглядят менее правдоподобными
в отношении нулевой гипотезы.

Если
конкурирующая гипотеза имеет вид
:,
то критическая область— правосторонняя и соответствующийкритерий
называется правосторонним,
а в случае
:критерий
называется левосторонним.

Область
допустимых

Правосторонняя

значений
критическая
область

(принятия
гипотезы
)
(отклоненияи принятия)

Если конкурирующая гипотеза имеет вид
:,
т.е.,
то критическая областьявляется объединением полубесконечных
промежутков: — двусторонняя.

Область

Критическая допустимых
Критическая

область значений область

Важное замечание.В психологии часто
эмпирическое значениесравнивается одновременно с двумя
критическими(0,05)
и(0,01),
которые соответствуют уровням значимости
в 5% и 1% и находятся по соответствующим
таблицам. Все три числа,(0,05),(0,01)
располагают на «оси значимости». Числоможет попасть в одну из трех областей:
незначимости различий, значимости
различий, неопределенности.

Область Область
Область

незначимости неопределенности
значимости

различий различий

К

Соседние файлы в предмете [НЕСОРТИРОВАННОЕ]

  • #
  • #
  • #
  • #
  • #
  • #
  • #
  • #
  • #
  • #
  • #

Ошибки первого рода (англ. type I errors, α errors, false positives) и ошибки второго рода (англ. type II errors, β errors, false negatives) в математической статистике — это ключевые понятия задач проверки статистических гипотез. Тем не менее, данные понятия часто используются и в других областях, когда речь идёт о принятии «бинарного» решения (да/нет) на основе некоего критерия (теста, проверки, измерения), который с некоторой вероятностью может давать ложный результат.

Содержание

  • 1 Определения
  • 2 О смысле ошибок первого и второго рода
  • 3 Вероятности ошибок (уровень значимости и мощность)
  • 4 Примеры использования
    • 4.1 Радиолокация
    • 4.2 Компьютеры
      • 4.2.1 Компьютерная безопасность
      • 4.2.2 Фильтрация спама
      • 4.2.3 Вредоносное программное обеспечение
      • 4.2.4 Поиск в компьютерных базах данных
      • 4.2.5 Оптическое распознавание текстов (OCR)
      • 4.2.6 Досмотр пассажиров и багажа
      • 4.2.7 Биометрия
    • 4.3 Массовая медицинская диагностика (скрининг)
    • 4.4 Медицинское тестирование
    • 4.5 Исследования сверхъестественных явлений
  • 5 См. также
  • 6 Примечания

Определения

Пусть дана выборка mathbf{X} = (X_1,ldots,X_n)^{top} из неизвестного совместного распределения mathbb{P}^{mathbf{X}}, и поставлена бинарная задача проверки статистических гипотез:

begin{matrix} H_0  H_1, end{matrix}

где H_0 — нулевая гипотеза, а H_1 — альтернативная гипотеза. Предположим, что задан статистический критерий

f:mathbb{R}^n to {H_0,H_1},

сопоставляющий каждой реализации выборки mathbf{X} = mathbf{x} одну из имеющихся гипотез. Тогда возможны следующие четыре ситуации:

  1. Распределение mathbb{P}^{mathbf{X}} выборки mathbf{X} соответствует гипотезе H_0, и она точно определена статистическим критерием, то есть f(mathbf{x}) = H_0.
  2. Распределение mathbb{P}^{mathbf{X}} выборки mathbf{X} соответствует гипотезе H_0, но она неверно отвергнута статистическим критерием, то есть f(mathbf{x}) = H_1.
  3. Распределение mathbb{P}^{mathbf{X}} выборки mathbf{X} соответствует гипотезе H_1, и она точно определена статистическим критерием, то есть f(mathbf{x}) = H_1.
  4. Распределение mathbb{P}^{mathbf{X}} выборки mathbf{X} соответствует гипотезе H_1, но она неверно отвергнута статистическим критерием, то есть f(mathbf{x}) = H_0.

Во втором и четвертом случае говорят, что произошла статистическая ошибка, и её называют ошибкой первого и второго рода соответственно. [1][2]

  Верная гипотеза
 H_0   H_1 
Результат
 применения 
критерия
 H_0  H_0 верно принята  H_0 неверно принята 
(Ошибка второго рода)
 H_1   H_0 неверно отвергнута 
(Ошибка первого рода)
H_0 верно отвергнута

О смысле ошибок первого и второго рода

Как видно из вышеприведённого определения, ошибки первого и второго рода являются взаимно-симметричными, то есть если поменять местами гипотезы H_0 и H_1, то ошибки первого рода превратятся в ошибки второго рода и наоборот. Тем не менее, в большинстве практических ситуаций путаницы не происходит, поскольку принято считать, что нулевая гипотеза H_0 соответствует состоянию «по умолчанию» (естественному, наиболее ожидаемому положению вещей) — например, что обследуемый человек здоров, или что проходящий через рамку металлодетектора пассажир не имеет запрещённых металлических предметов. Соответственно, альтернативная гипотеза H_1 обозначает противоположную ситуацию, которая обычно трактуется как менее вероятная, неординарная, требующая какой-либо реакции.

С учётом этого ошибку первого рода часто называют ложной тревогой, ложным срабатыванием или ложноположительным срабатыванием — например, анализ крови показал наличие заболевания, хотя на самом деле человек здоров, или металлодетектор выдал сигнал тревоги, сработав на металлическую пряжку ремня. Слово «положительный» в данном случае не имеет отношения к желательности или нежелательности самого события.

Термин широко используется в медицине. Например, тесты, предназначенные для диагностики заболеваний, иногда дают положительный результат (т.е. показывают наличие заболевания у пациента), когда на самом деле пациент этим заболеванием не страдает. Такой результат называется ложноположительным.

В других областях обычно используют словосочетания со схожим смыслом, например, «ложное срабатывание», «ложная тревога» и т.п. В информационных технологиях часто используют английский термин false positive без перевода.

Из-за возможности ложных срабатываний не удаётся полностью автоматизировать борьбу со многими видами угроз. Как правило, вероятность ложного срабатывания коррелирует с вероятностью пропуска события (ошибки второго рода). То есть: чем более чувствительна система, тем больше опасных событий она детектирует и, следовательно, предотвращает. Но при повышении чувствительности неизбежно вырастает и вероятность ложных срабатываний. Поэтому чересчур чувствительно (параноидально) настроенная система защиты может выродиться в свою противоположность и привести к тому, что побочный вред от неё будет превышать пользу.

Соответственно, ошибку второго рода иногда называют пропуском события или ложноотрицательным срабатыванием — человек болен, но анализ крови этого не показал, или у пассажира имеется холодное оружие, но рамка металлодетектора его не обнаружила (например, из-за того, что чувствительность рамки отрегулирована на обнаружение только очень массивных металлических предметов).

Слово «отрицательный» в данном случае не имеет отношения к желательности или нежелательности самого события.

Термин широко используется в медицине. Например, тесты, предназначенные для диагностики заболеваний, иногда дают отрицательный результат (т.е. показывают отсутствие заболевания у пациента), когда на самом деле пациент страдает этим заболеванием. Такой результат называется ложноотрицательным.

В других областях обычно используют словосочетания со схожим смыслом, например, «пропуск события», и т.п. В информационных технологиях часто используют английский термин false negative без перевода.

Степень чувствительности системы защиты должна представлять собой компромисс между вероятностью ошибок первого и второго рода. Где именно находится точка баланса, зависит от оценки рисков обоих видов ошибок.

Вероятности ошибок (уровень значимости и мощность)

Вероятность ошибки первого рода при проверке статистических гипотез называют уровнем значимости и обычно обозначают греческой буквой alpha (отсюда название alpha-errors).

Вероятность ошибки второго рода не имеет какого-то особого общепринятого названия, на письме обозначается греческой буквой beta (отсюда beta-errors). Однако с этой величиной тесно связана другая, имеющая большое статистическое значение — мощность критерия. Она вычисляется по формуле (1-beta). Таким образом, чем выше мощность, тем меньше вероятность совершить ошибку второго рода.

Обе эти характеристики обычно вычисляются с помощью так называемой функции мощности критерия. В частности, вероятность ошибки первого рода есть функция мощности, вычисленная при нулевой гипотезе. Для критериев, основанных на выборке фиксированного объема, вероятность ошибки второго рода есть единица минус функция мощности, вычисленная в предположении, что распределение наблюдений соответствует альтернативной гипотезе. Для последовательных критериев это также верно, если критерий останавливается с вероятностью единица (при данном распределении из альтернативы).

В статистических тестах обычно приходится идти на компромисс между приемлемым уровнем ошибок первого и второго рода. Зачастую для принятия решения используется пороговое значение, которое может варьироваться с целью сделать тест более строгим или, наоборот, более мягким. Этим пороговым значением является уровень значимости, которым задаются при проверке статистических гипотез. Например, в случае металлодетектора повышение чувствительности прибора приведёт к увеличению риска ошибки первого рода (ложная тревога), а понижение чувствительности — к увеличению риска ошибки второго рода (пропуск запрещённого предмета).

Примеры использования

Радиолокация

В задаче радиолокационного обнаружения воздушных целей, прежде всего, в системе ПВО ошибки первого и второго рода, с формулировкой «ложная тревога» и «пропуск цели» являются одним из основных элементов как теории, так и практики построения радиолокационных станций. Вероятно, это первый пример последовательного применения статистических методов в целой технической области.

Компьютеры

Понятия ошибок первого и второго рода широко используются в области компьютеров и программного обеспечения.

Компьютерная безопасность

Наличие уязвимостей в вычислительных системах приводит к тому, что приходится, с одной стороны, решать задачу сохранения целостности компьютерных данных, а с другой стороны — обеспечивать нормальный доступ легальных пользователей к этим данным (см. компьютерная безопасность). Moulton (1983, с.125) отмечает, что в данном контексте возможны следующие нежелательные ситуации:

  • когда нарушители классифицируются как авторизованные пользователи (ошибки первого рода)
  • когда авторизованные пользователи классифицируются как нарушители (ошибки второго рода)

Фильтрация спама

Ошибка первого рода происходит, когда механизм блокировки/фильтрации спама ошибочно классифицирует легитимное email-сообщение как спам и препятствует его нормальной доставке. В то время как большинство «антиспам»-алгоритмов способны блокировать/фильтровать большой процент нежелательных email-сообщений, гораздо более важной задачей является минимизировать число «ложных тревог» (ошибочных блокировок нужных сообщений).

Ошибка второго рода происходит, когда антиспам-система ошибочно пропускает нежелательное сообщение, классифицируя его как «не спам». Низкий уровень таких ошибок является индикатором эффективности антиспам-алгоритма.

Пока не удалось создать антиспамовую систему без корреляции между вероятностью ошибок первого и второго рода. Вероятность пропустить спам у современных систем колеблется в пределах от 1% до 30%. Вероятность ошибочно отвергнуть валидное сообщение — от 0,001 % до 3 %. Выбор системы и её настроек зависит от условий конкретного получателя: для одних получателей риск потерять 1% хорошей почты оценивается как незначительный, для других же потеря даже 0,1% является недопустимой.

Вредоносное программное обеспечение

Понятие ошибки первого рода также используется, когда антивирусное программное обеспечение ошибочно классифицирует безвредный файл как вирус. Неверное обнаружение может быть вызвано особенностями эвристики, либо неправильной сигнатурой вируса в базе данных. Подобные проблемы могут происходить также и с антитроянскими и антишпионскими программами.

Поиск в компьютерных базах данных

При поиске в базе данных к ошибкам первого рода можно отнести документы, которые выдаются поиском, несмотря на их иррелевантность (несоответствие) поисковому запросу. Ошибочные срабатывания характерны для полнотекстового поиска, когда поисковый алгоритм анализирует полные тексты всех хранимых в базе данных документов и пытается найти соответствия одному или нескольким терминам, заданным пользователем в запросе.

Большинство ложных срабатываний обусловлены сложностью естественных языков, многозначностью слов: например, «home» может обозначать как «место проживания человека», так и «корневую страницу веб-сайта». Число подобных ошибок может быть снижено за счёт использования специального словаря. Однако это решение относительно дорогое, поскольку подобный словарь и разметка документов (индексирование) должны создаваться экспертом.

Оптическое распознавание текстов (OCR)

Разнообразные детектирующие алгоритмы нередко выдают ошибки первого рода. Программное обеспечение оптического распознавания текстов может распознать букву «a» в ситуации, когда на самом деле изображены несколько точек, которые используемый алгоритм расценил как «a».

Досмотр пассажиров и багажа

Ошибки первого рода регулярно встречаются каждый день в компьютерных системах предварительного досмотра пассажиров в аэропортах. Установленные в них детекторы предназначены для предотвращения проноса оружия на борт самолёта; тем не менее, уровень чувствительности в них зачастую настраивается настолько высоко, что много раз за день они срабатывают на незначительные предметы, такие как ключи, пряжки ремней, монеты, мобильные телефоны, гвозди в подошвах обуви и т.п. (см. обнаружение взрывчатых веществ, металлодетекторы).

Таким образом, соотношение числа ложных тревог (идентифицикация благопристойного пассажира как правонарушителя) к числу правильных срабатываний (обнаружение действительно запрещённых предметов) очень велико.

Биометрия

Ошибки первого и второго рода являются большой проблемой в системах биометрического сканирования, использующих распознавание радужной оболочки или сетчатки глаза, черт лица и т.д. Такие сканирующие системы могут ошибочно отождествить кого-то с другим, «известным» системе человеком, информация о котором хранится в базе данных (к примеру, это может быть лицо, имеющее право входа в систему, или подозреваемый преступник и т.п.). Противоположной ошибкой будет неспособность системы распознать легитимного зарегистрированного пользователя, или опознать подозреваемого в преступлении.[3]

Массовая медицинская диагностика (скрининг)

В медицинской практике есть существенное различие между скринингом и тестированием:

  • Скрининг включает в себя относительно дешёвые тесты, которые проводятся для большой группы людей при отсутствии каких-либо клинических признаков болезни (например, мазок Папаниколау).
  • Тестирование подразумевает гораздо более дорогие, зачастую инвазивные, процедуры, которые проводятся только для тех, у кого проявляются клинические признаки заболевания, и которые, в основном, применяются для подтверждения предполагаемого диагноза.

К примеру, в большинстве штатов в США обязательно прохождение новорожденными процедуры скрининга на оксифенилкетонурию и гипотиреоз, помимо других врождённых аномалий. Несмотря на высокий уровень ошибок первого рода, эти процедуры скрининга считаются целесообразными, поскольку они существенно увеличивают вероятность обнаружения этих расстройств на самой ранней стадии.[4]

Простые анализы крови, используемые для скрининга потенциальных доноров на ВИЧ и гепатит, имеют существенный уровень ошибок первого рода; однако в арсенале врачей есть гораздо более точные (и, соответственно, дорогие) тесты для проверки, действительно ли человек инфицирован каким-либо из этих вирусов.

Возможно, наиболее широкие дискуссии вызывают ошибки первого рода в процедурах скрининга на рак груди (маммография). В США уровень ошибок первого рода в маммограммах достигает 15%, это самый высокий показатель в мире.[5] Самый низкий уровень наблюдается в Нидерландах, 1%.[6]

Медицинское тестирование

Ошибки второго рода являются существенной проблемой в медицинском тестировании. Они дают пациенту и врачу ложное убеждение, что заболевание отсутствует, в то время как в действительности оно есть. Это зачастую приводит к неуместному или неадекватному лечению. Типичным примером является доверие результатам кардиотестирования при выявлении коронарного атеросклероза, хотя известно, что кардиотестирование выявляет только те затруднения кровотока в коронарной артерии, которые вызваны стенозом.

Ошибки второго рода вызывают серьёзные и трудные для понимания проблемы, особенно когда искомое условие является широкораспространённым. Если тест с 10%-ным уровнем ошибок второго рода используется для обследования группы, где вероятность «истинно-положительных» случаев составляет 70%, то многие отрицательные результаты теста окажутся ложными. (См. Теорему Байеса).

Ошибки первого рода также могут вызывать серьёзные и трудные для понимания проблемы. Это происходит, когда искомое условие является редким. Если уровень ошибок первого рода у теста составляет один случай на десять тысяч, но в тестируемой группе образцов (или людей) вероятность «истинно-положительных» случаев составляет в среднем один случай на миллион, то большинство положительных результатов этого теста будут ложными.[7]

Исследования сверхъестественных явлений

Термин ошибка первого рода был взят на вооружение исследователями в области паранормальных явлений и привидений для описания фотографии или записи или какого-либо другого свидетельства, которое ошибочно трактуется как имеющее паранормальное происхождение — в данном контексте ошибка первого рода — это какое-либо несостоятельное «медиасвидетельство» (изображение, видеозапись, аудиозапись и т.д.), которое имеет обычное объяснение.[8]

См. также

  • Статистическая значимость
  • Ложноположительный
  • Атака второго рода
  • Случаи ложного срабатывания систем предупреждения о ракетном нападении
  • Receiver_operating_characteristic

Примечания

  1. ГОСТ Р 50779.10-2000. «Статистические методы. Вероятность и основы статистики. Термины и определения.». Стр. 26
  2. Valerie J. Easton, John H. McColl. Statistics Glossary: Hypothesis Testing.
  3. Данный пример как раз характеризует случай, когда классификация ошибок будет зависеть от назначения системы: если биометрическое сканирование используется для допуска сотрудников (нулевая гипотеза: «проходящий сканирование человек действительно является сотрудником»), то ошибочное отождествление будет ошибкой второго рода, а «неузнавание» — ошибкой первого рода; если же сканирование используется для опознания преступников (нулевая гипотеза: «проходящий сканирование человек не является преступником»), то ошибочное отождествление будет ошибкой первого рода, а «неузнавание» — ошибкой второго рода.
  4. Относительно скрининга новорожденных, последние исследования показали, что количество ошибок первого рода в 12 раз больше, чем количество верных обнаружений (Gambrill, 2006. [1])
  5. Одним из последствий такого высокого уровня ошибок первого рода в США является то, что за произвольный 10-летний период половина обследуемых американских женщин получают как минимум одну ложноположительную маммограмму. Такие ошибочные маммограммы обходятся дорого, приводя к ежегодным расходам в 100 миллионов долларов на последующее (ненужное) лечение. Кроме того, они вызывают излишнюю тревогу у женщин. В результате высокого уровня подобных ошибок первого рода в США, примерно у 90-95% женщин, получивших хотя бы раз в жизни положительную маммограмму, на самом деле заболевание отсутствует.
  6. Наиболее низкие уровни этих ошибок наблюдаются в северной Европе, где маммографические плёнки считываются дважды, и для дополнительного тестирования устанавливается повышенное пороговое значение (высокий порог снижает статистическую эффективность теста).
  7. Вероятность того, что выдаваемый тестом результат окажется ошибкой первого рода, может быть вычислена при помощи Теоремы Байеса.
  8. На некоторых сайтах приведены примеры ошибок первого рода, например: Атлантическое Сообщество Паранормальных явлений (The Atlantic Paranormal Society, TAPS) и Морстаунская организация по Исследованию Привидений (Moorestown Ghost Research).

Введение в проверку гипотез

  • Редакция Кодкампа

17 авг. 2022 г.
читать 2 мин


Статистическая гипотеза – это предположение о параметре совокупности .

Например, мы можем предположить, что средний рост мужчины в США составляет 70 дюймов.

Предположение о росте является статистической гипотезой , а истинный средний рост мужчины в США является популяционным параметром .

Проверка гипотезы — это формальный статистический тест, который мы используем, чтобы отвергнуть или не опровергнуть статистическую гипотезу.

Два типа статистических гипотез

Чтобы проверить, верна ли статистическая гипотеза о параметре совокупности, мы получаем случайную выборку из совокупности и выполняем проверку гипотезы на выборочных данных.

Существует два типа статистических гипотез:

Нулевая гипотеза , обозначаемая как H 0 , представляет собой гипотезу о том, что выборка данных происходит чисто случайно.

Альтернативная гипотеза , обозначаемая как H 1 или H a , представляет собой гипотезу о том, что на выборочные данные влияет какая-то неслучайная причина.

Проверка гипотез

Проверка гипотезы состоит из пяти шагов:

1. Сформулируйте гипотезы.

Сформулируйте нулевую и альтернативную гипотезы. Эти две гипотезы должны быть взаимоисключающими, поэтому, если одна верна, другая должна быть ложной.

2. Определите уровень значимости для гипотезы.

Определите уровень значимости. Распространенные варианты: .01, .05 и .1.

3. Найдите тестовую статистику.

Найдите тестовую статистику и соответствующее значение p. Часто мы анализируем среднее значение или долю населения, и общая формула для нахождения тестовой статистики выглядит следующим образом: (выборочная статистика — параметр совокупности) / (стандартное отклонение статистики)

4. Отклонить или не отклонить нулевую гипотезу.

Используя тестовую статистику или p-значение, определите, можете ли вы отклонить или не отклонить нулевую гипотезу на основе уровня значимости.

Значение p говорит нам о силе доказательств в поддержку нулевой гипотезы. Если p-значение меньше уровня значимости, мы отклоняем нулевую гипотезу.

5. Интерпретируйте результаты.

Интерпретируйте результаты проверки гипотезы в контексте заданного вопроса.

Два типа ошибок принятия решений

Есть два типа ошибок принятия решений, которые можно сделать при проверке гипотезы:

Ошибка I типа: вы отвергаете нулевую гипотезу, когда она на самом деле верна. Вероятность совершения ошибки первого рода равна уровню значимости, часто называемому альфа и обозначаемому как α.

Ошибка типа II: вы не можете отвергнуть нулевую гипотезу, когда она на самом деле ложна. Вероятность совершения ошибки типа II называется мощностью теста или бета и обозначается как β.

Односторонний и двусторонний тесты

Статистическая гипотеза может быть односторонней или двусторонней.

Односторонняя гипотеза предполагает утверждение «больше» или «меньше».

Например, предположим, что средний рост мужчины в США больше или равен 70 дюймам. Нулевой гипотезой будет H0: µ ≥ 70 дюймов, а альтернативной гипотезой будет Ha: µ < 70 дюймов.

Двусторонняя гипотеза предполагает утверждение «равно» или «не равно».

Например, предположим, что мы предполагаем, что средний рост мужчины в США равен 70 дюймам. Нулевой гипотезой будет H0: µ = 70 дюймов, а альтернативной гипотезой будет Ha: µ ≠ 70 дюймов.

Примечание. Знак «равно» всегда включается в нулевую гипотезу, будь то =, ≥ или ≤.

По теме: Что такое гипотеза направления?

Типы проверки гипотез

Существует множество различных типов проверки гипотез, которые вы можете выполнять в зависимости от типа данных, с которыми вы работаете, и цели вашего анализа.

Следующие руководства содержат объяснение наиболее распространенных типов проверки гипотез:

Введение в одновыборочный t-критерий
Введение в двухвыборочный t-критерий
Введение в t-критерий парных выборок
Введение в Z-тест одной пропорции
Введение в двухпропорционный Z-тест

Ошибки, встроенные в систему: их роль в статистике

В прошлой статье я указал, как распространена проблема неправильного использования t-критерия в научных публикациях (и это возможно сделать только благодаря их открытости, а какой трэш творится при его использовании во всяких курсовых, отчетах, обучающих задачах и т.д. — неизвестно). Чтобы обсудить это, я рассказал об основах дисперсионного анализа и задаваемом самим исследователем уровне значимости α. Но для полного понимания всей картины статистического анализа необходимо подчеркнуть ряд важных вещей. И самая основная из них — понятие ошибки.

Ошибка и некорректное применение: в чем разница?

В любой физической системе содержится какая-либо ошибка, неточность. В самой разнообразной форме: так называемый допуск — отличие в размерах разных однотипных изделий; нелинейная характеристика — когда прибор или метод измеряют что-то по строго известному закону в определенных пределах, а дальше становятся неприменимыми; дискретность — когда мы чисто технически не можем обеспечить плавность выходной характеристики.

И в то же время существует чисто человеческая ошибка — некорректное использование устройств, приборов, математических законов. Между ошибкой, присущей системе, и ошибкой применения этой системы есть принципиальная разница. Важно различать и не путать между собой эти два понятия, называемые одним и тем же словом «ошибка». Я в данной статье предпочитаю использовать слово «ошибка» для обозначения свойства системы, а «некорректное применение» — для ошибочного ее использования.

То есть, ошибка линейки равна допуску оборудования, наносящего штрихи на ее полотно. А ошибкой в смысле некорректного применения было бы использовать ее при измерении деталей наручных часов. Ошибка безмена написана на нем и составляет что-то около 50 граммов, а неправильным использованием безмена было бы взвешивание на нем мешка в 25 кг, который растягивает пружину из области закона Гука в область пластических деформаций. Ошибка атомно-силового микроскопа происходит из его дискретности — нельзя «пощупать» его зондом предметы мельче, чем диаметром в один атом. Но способов неправильно использовать его или неправильно интерпретировать данные существует множество. И так далее.

Так, а что же за ошибка имеет место в статистических методах? А этой ошибкой как раз и является пресловутый уровень значимости α.

Ошибки первого и второго рода

Ошибкой в математическом аппарате статистики является сама ее Байесовская вероятностная сущность. В прошлой статье я уже упоминал, на чем стоят статистические методы: определение уровня значимости α как наибольшей допустимой вероятности неправомерно отвергнуть нулевую гипотезу, и самостоятельное задание исследователем этой величины перед исследователем.
Вы уже видите эту условность? На самом деле, в критериальных методах нету привычной математической строгости. Математика здесь оперирует вероятностными характеристиками.
И тут наступает еще один момент, где возможна неправильная трактовка одного слова в разном контексте. Необходимо различать само понятие вероятности и фактическую реализацию события, выражающуюся в распределении вероятности. Например, перед началом любого нашего эксперимента мы не знаем, какую именно величину мы получим в результате. Есть два возможных исхода: загадав некоторое значение результата, мы либо действительно его получим, либо не получим. Логично, что вероятность и того, и другого события равна 1/2. Но показанная в предыдущей статье Гауссова кривая показывает распределение вероятности того, что мы правильно угадаем совпадение.

Наглядно можно проиллюстрировать это примером. Пусть мы 600 раз бросаем два игральных кубика — обычный и шулерский. Получим следующие результаты:

До эксперимента для обоих кубиков выпадение любой грани будет равновероятно — 1/6. Однако после эксперимента проявляется сущность шулерского кубика, и мы можем сказать, что плотность вероятности выпадения на нем шестерки — 90%.

Другой пример, который знают химики, физики и все, кто интересуется квантовыми эффектами — атомные орбитали. Теоретически электрон может быть «размазан» в пространстве и находиться практически где угодно. Но на практике есть области, где он будет находиться в 90 и более процентах случаев. Эти области пространства, образованные поверхностью с плотностью вероятности нахождения там электрона 90%, и есть классические атомные орбитали, в виде сфер, гантелей и т.д.

Так вот, самостоятельно задавая уровень значимости, мы заведомо соглашаемся на описанную в его названии ошибку. Из-за этого ни один результат нельзя считать «стопроцентно достоверным» — всегда наши статистические выводы будут содержать некоторую вероятность сбоя.

Ошибка, формулируемая определением уровня значимости α, называется ошибкой первого рода. Ее можно определить, как «ложная тревога», или, более корректно, ложноположительный результат. В самом деле, что означают слова «ошибочно отвергнуть нулевую гипотезу»? Это значит, по ошибке принять наблюдаемые данные за значимые различия двух групп. Поставить ложный диагноз о наличии болезни, поспешить явить миру новое открытие, которого на самом деле нет — вот примеры ошибок первого рода.

Но ведь тогда должны быть и ложноотрицательные результаты? Совершенно верно, и они называются ошибками второго рода. Примеры — не поставленный вовремя диагноз или же разочарование в результате исследования, хотя на самом деле в нем есть важные данные. Ошибки второго рода обозначаются буквой, как ни странно, β. Но само это понятие не так важно для статистики, как число 1-β. Число 1-β называется мощностью критерия, и как нетрудно догадаться, оно характеризует способность критерия не упустить значимое событие.
Однако содержание в статистических методах ошибок первого и второго рода не является только лишь их ограничением. Само понятие этих ошибок может использоваться непосредственным образом в статистическом анализе. Как?

ROC-анализ

ROC-анализ (от receiver operating characteristic, рабочая характеристика приёмника) — это метод количественного определения применимости некоторого признака к бинарной классификации объектов. Говоря проще, мы можем придумать некоторый способ, как отличить больных людей от здоровых, кошек от собак, черное от белого, а затем проверить правомерность такого способа. Давайте снова обратимся к примеру.

Пусть вы — подающий надежды криминалист, и разрабатываете новый способ скрытно и однозначно определять, является ли человек преступником. Вы придумали количественный признак: оценивать преступные наклонности людей по частоте прослушивания ими Михаила Круга. Но будет ли давать адекватные результаты ваш признак? Давайте разбираться.
Вам понадобится две группы людей для валидации вашего критерия: обычные граждане и преступники. Положим, действительно, среднегодовое время прослушивания ими Михаила Круга различается (см. рисунок):

Здесь мы видим, что по количественному признаку времени прослушивания наши выборки пересекаются. Кто-то слушает Круга спонтанно по радио, не совершая преступлений, а кто-то нарушает закон, слушая другую музыку или даже будучи глухим. Какие у нас есть граничные условия? ROC-анализ вводит понятия селективности (чувствительности) и специфичности. Чувствительность определяется как способность выявлять все-все интересующие нас точки (в данном примере — преступников), а специфичность — не захватывать ничего ложноположительного (не ставить под подозрение простых обывателей). Мы можем задать некоторую критическую количественную черту, отделяющую одних от других (оранжевая), в пределах от максимальной чувствительности (зеленая) до максимальной специфичности (красная).
Посмотрим на следующую схему:

Смещая значение нашего признака, мы меняем соотношения ложноположительного и ложноотрицательного результатов (площади под кривыми). Точно так же мы можем дать определения Чувствительность = Полож. рез-т/(Полож. рез-т + ложноотриц. рез-т) и Специфичность = Отриц. рез-т/(Отриц. рез-т + ложноположит. рез-т).

Но главное, мы можем оценить соотношение положительных результатов к ложноположительным на всем отрезке значений нашего количественного признака, что и есть наша искомая ROC-кривая (см. рисунок):

А как нам понять из этого графика, насколько хорош наш признак? Очень просто, посчитать площадь под кривой (AUC, area under curve). Пунктирная линия (0,0; 1,1) означает полное совпадение двух выборок и совершенно бессмысленный критерий (площадь под кривой равна 0,5 от всего квадрата). А вот выпуклость ROC кривой как раз и говорит о совершенстве критерия. Если же нам удастся найти такой критерий, что выборки вообще не будут пересекаться, то площадь под кривой займет весь график. В целом же признак считается хорошим, позволяющим надежно отделить одну выборку от другой, если AUC > 0,75-0,8.

С помощью такого анализа вы можете решать самые разные задачи. Решив, что слишком много домохозяек оказались под подозрением из-за Михаила Круга, а кроме того упущены опасные рецидивисты, слушающие Ноггано, вы можете отвергнуть этот критерий и разработать другой.

Возникнув, как способ обработки радиосигналов и идентификации «свой-чужой» после атаки на Перл-Харбор (отсюда и пошло такое странное название про характеристику приемника), ROC-анализ нашел широкое применение в биомедицинской статистике для анализа, валидации, создания и характеристики панелей биомаркеров и т.д. Он гибок в использовании, если оно основано на грамотной логике. Например, вы можете разработать показания для медицинской диспансеризации пенсионеров-сердечников, применив высокоспецифичный критерий, повысив эффективность выявления болезней сердца и не перегружая врачей лишними пациентами. А во время опасной эпидемии ранее неизвестного вируса вы наоборот, можете придумать высокоселективный критерий, чтобы от вакцинации в прямом смысле не ускользнул ни один чих.

С ошибками обоих родов и их наглядностью в описании валидируемых критериев мы познакомились. Теперь же, двигаясь от этих логических основ, можно разрушить ряд ложных стереотипных описаний результатов. Некоторые неправильные формулировки захватывают наши умы, часто путаясь своими схожими словами и понятиями, а также из-за очень малого внимания, уделяемого неверной интерпретации. Об этом, пожалуй, нужно будет написать отдельно.

Как уже объяснил Саймон в своем ответе, целые числа являются типами значений, и все типы значений всегда передаются по значению (по умолчанию). Это означает, что когда вы вызываете, например, IsFizz с countOfFizz все, что происходит, это то, что значение этой переменной передается функции, которая затем имеет свою собственную переменную с копией значения. Поэтому, когда функция меняет значение, изменяется только значение локальных переменных, но это изменение никогда не приведет к исходной переменной.

Одним из способов решения этой проблемы было бы явно передать эти переменные по ссылке. Вы можете сделать это, используя ref int countOfFizz в сигнатуре функции для параметра (например, добавьте ключевое слово ref). Тем не менее, я не рекомендую вам делать это, поскольку он не будет предоставлять состояние, FizzBuzz может иметь класс FizzBuzz.

Таким образом, в объектно-ориентированном программировании вы создаете объекты, в которых есть состояние. В вашем случае FizzBuzz — это класс, тип этих объектов. Теперь, если мы подумаем об этом и учтем, что вы, по-видимому, хотите подсчитать количество случаев Fizz/Buzz/FizzBuzz, имеет смысл иметь эти подсчеты, содержащиеся внутри объекта.

Поэтому, прежде всего, вы должны сделать переменные экземпляра countOfX переменных, привязанные к объекту.

Рассматривая методы IsFizz и т.д., Все они должны возвращать логическое значение. Поэтому вполне вероятно, что они изначально были предназначены только для проверки ввода и возврата true или false в зависимости от того, была ли проверка успешной или нет. Здесь мы также можем увеличивать наши счетчики, когда находим значение. Таким образом, в конце концов, эти методы должны принимать только входные данные, выполнять проверку, увеличивать счетчик и возвращать результат проверки.

Методы TotalX могут просто вернуть результаты текущего счетчика, в то время как метод BeginTesting может сбросить их до нуля (без каких-либо параметров).

Наконец, в главной функции вы хотите создать только один экземпляр FizzBuzz чтобы мы могли делиться состоянием в течение всей продолжительности программы. Вы должны проверить возвращаемые значения для методов IsX и напечатать соответствующий ответ здесь (часто вы не хотите, чтобы типы классов произвольно печатали материал, но обрабатывали их на другом уровне — в вашем случае — консольное приложение, которое происходит в главной функции).

Как последнее замечание, я хотел бы, чтобы вы знали, что Im много интерпретирует здесь оригинальную задачу и не может точно сказать, каково первоначальное намерение этого кода. С моей точки зрения, это выглядит немного смешно, чтобы сделать это так. Проблема FizzBuzz, даже в этом измененном экземпляре, является простой проблемой, направленной на то, чтобы показать, способен ли человек к основному мышлению, связанному с программированием. Это не обязательно должно быть проблемой для работы в сложной объектно-ориентированной манере, но, подобно типичному «Hello World», похоже, есть люди, которые любят чрезмерно обобщать его, чтобы сделать его ужасно сложным для удовольствия или практики, Я действительно не согласен с тем, что этот экземпляр FizzBuzz с этим предопределенным базовым кодом либо обобщен, ни интересен, ни хорошая практика. Но опять же, это только мое мнение.

И, наконец, последний намек на это «правильно»: выход «FizzBuzz» представляет собой комбинацию обоих условных обозначений для «Fizz» и «Buzz». Это означает, что если число соответствует «FizzBuzz», оно также делает это для отдельных. Поэтому вы должны убедиться, что проверка отдельных пользователей либо явно препятствует комбинации «FizzBuzz», либо сначала проверяет комбинированную, и отменяет дальнейшие проверки, если она соответствует.

8 июля 2021 г.

При проверке гипотез нулевая гипотеза — это гипотеза по умолчанию, которая утверждает, что между переменными нет статистической значимости. Исследователь проверяет нулевую гипотезу, чтобы увидеть, достаточно ли статистической значимости, чтобы опровергнуть ее, и это иногда приводит к ошибке типа 1 или типа 2. Если вы занимаетесь проверкой гипотез как частью своей работы, важно понимать, как ошибки типа 1 и типа 2 могут повлиять на ваши результаты.

В этой статье мы объясним, что такое ошибки типа 1 и типа 2, рассмотрим, как они могут возникнуть, обсудим их важность в исследованиях и приведем примеры, которые помогут вам понять эти концепции.

Ошибки типа 1 и типа 2 относятся к неправильным определениям нулевой гипотезы, но они различаются тем, что исследователь считает верным или ложным в отношении гипотезы. Ошибка 1-го типа, также называемая ложноположительной, возникает, когда исследователь отвергает нулевую гипотезу, которая является истинной, и решает, что существует статистически значимое различие, которого не существует. Ошибка типа 2 является обратной ошибкой типа 1. Также известная как ложный отрицательный результат, она возникает, когда исследователь не отвергает нулевую гипотезу, когда альтернативная гипотеза верна.

Например, в судебном деле нулевая гипотеза будет заключаться в том, что обвиняемый невиновен, пока его вина не будет доказана, а альтернативная гипотеза будет состоять в том, что он виновен. Есть четыре возможных исхода в отношении истинного характера дела:

  • Истинно отрицательный: признан невиновным в суде и невиновен на самом деле.

  • Ложное срабатывание: признан виновным в суде, но на самом деле невиновен.

  • Ложноотрицательный: признан невиновным в суде, но на самом деле виновен.

  • Истинно положительный: признан виновным в суде и фактически виновен

В приведенном выше примере второй и третий результаты являются ошибками типа 1 и типа 2 соответственно. В случае ложного срабатывания присяжные ошибочно отвергают нулевую гипотезу, утверждающую, что подсудимый невиновен. В случае ложноотрицательного результата они ошибочно не отвергают нулевую гипотезу.

Почему возникают ошибки первого рода?

Есть два фактора, которые обычно способствуют возникновению ошибок 1-го рода:

Шанс

Проверка гипотез никогда не бывает стопроцентной, поэтому всегда есть возможность сделать неверные выводы на основе имеющихся данных. Как правило, данные поступают из выборочной совокупности, относительно небольшой выборки лиц, предназначенных для обозначения более широкой демографической группы. Иногда данные, генерируемые выборочными совокупностями, искажают выводы, которые не обязательно отражают интересы всего населения. Это переменная, которую исследователи не могут контролировать, но они могут помочь смягчить ее, выбрав более крупные выборки.

Злоупотребление служебным положением

Иногда ошибки 1-го рода возникают из-за неправильной исследовательской практики. Например, исследователи могут неосознанно исказить результаты теста, завершив его слишком рано. Им может показаться, что у них достаточно данных, хотя стандартная практика рекомендует продолжить тест. В качестве альтернативы они могут сделать вывод, несмотря на то, что им не удалось достичь соответствующего уровня статистической значимости. Исследователи могут избежать выводов типа 1, связанных с злоупотреблением служебным положением, если будут следовать протоколам исследований и обеспечивать надежность своей практики.

Почему возникают ошибки второго рода?

Основным фактором, способствующим возникновению ошибок 2-го рода, является размер выборки. Чем больше размер выборки, тем больше вероятность обнаружения различий в статистическом тесте. Например, если вы хотите проверить, относятся ли студенты колледжа положительно или отрицательно к определенному продукту, группа из трех человек может выразить только два к одному разнообразию или вообще ничего не сказать. Для сравнения, выборка из 1000 человек с большей вероятностью вызовет широкий спектр мнений и, таким образом, более точно отразит большую часть населения.

Какова важность ошибок типа 1 по сравнению с ошибками типа 2?

Ошибки типа 1 и типа 2 являются значительными из-за последствий, которые они имеют в реальных приложениях. Ошибки типа 1 обычно приводят к ненужному использованию ресурсов без какой-либо выгоды. Например, если исследователь-медик совершает ошибку 1-го рода в отношении эффективности нового лечения, он может подтвердить ошибочность исследований и методов, что может привести к созданию лекарства, не приносящего облегчения.

Ошибки 2-го типа важны тем, что могут помешать выделению ресурсов и выполнению необходимых действий. Например, при скрининге пациента на наличие заболевания ложноотрицательный результат может свидетельствовать о том, что пациент здоров, хотя на самом деле он нуждается в медицинском вмешательстве.

Примеры ошибок типа 1 и типа 2

Рассмотрим эти примеры ошибок типа 1 и типа 2, чтобы помочь вам понять, что они из себя представляют:

Пример ошибки 1 рода

Медицинский исследователь проверяет эффективность домашнего средства от головной боли. Нулевая гипотеза состоит в том, что домашнее средство не влияет на головную боль, в то время как альтернативная гипотеза состоит в том, что оно лечит головную боль. Исследователь набирает выборку из 20 пациентов с хроническими головными болями и назначает лекарство половине из них в течение одного месяца. Половина, не получающая лекарство, продолжает страдать от хронических головных болей, в то время как у шести человек из оставшейся половины головные боли прекратились.

На основании вышеизложенного исследователь отвергает нулевую гипотезу. Однако, учитывая небольшое количество тех, кто испытал облегчение, могут возникнуть сомнения относительно того, было ли это лекарство или посторонний фактор, который улучшил состояние шести участников. Если эти шесть участников использовали другие средства от головной боли вместе с тестируемым средством, вполне вероятно, что исследователь совершил ошибку 1-го типа.

Пример ошибки 2 рода

Интернет-магазин хочет знать, могут ли изменения дизайна его веб-сайта помочь увеличить продажи. Нулевая гипотеза состоит в том, что изменения дизайна не влияют на продажи, а альтернативная гипотеза говорит об обратном. Продавец проводит A/B-тестирование, в ходе которого сравниваются две версии сайта, существующая версия и обновленная версия. Три дня мониторят продажи на основе существующей версии. Затем в течение следующих трех дней они представляют новую версию и смотрят, как она повлияет на продажи. По истечении шести дней они не видят значительных изменений в показателях продаж.

Однако возможно, что увеличение периодов наблюдения для каждой версии сайта привело бы к статистически значимой разнице. Если бы розничный продавец отслеживал продажи в течение одного месяца каждый и заметил увеличение продаж во втором месяце, он совершил бы ошибку второго рода, ошибочно приняв нулевую гипотезу.

С файлом xx.py:

class Foo(object):
    def __init__(self, x):
        self.x = x

    def __long__(self):
        return long(self.x)

    def __float__(self):
        return float(self.x)


y = Foo(22)

print '%d' % y
print '%d' % y

Интерактивный режим:

$ python -V
Python 2.6.7

$ python -i xx.py 
22
22
>>> 
TypeError: int() argument must be a string or a number, not 'Foo'
>>> '%d' % y
'22'
>>> '%d' % y
TypeError: int() argument must be a string or a number, not 'Foo'
>>> '%d' % y
'22'
>>> '%d' % y
TypeError: int() argument must be a string or a number, not 'Foo'

Почему он чередуется между печатью «22» и вызовом TypeError?

Почему возникает ошибка при первом возврате каретки (без ввода)?

Спасибо.

2 ответа

Похоже на ошибку в питоне! Я предполагаю, что это вызвано некоторыми остатками старых исключений на основе строк.

Шестнадцатеричный материал — отвлекающий маневр, вы также можете получить странное поведение, просто назначив y = Foo(1), и простое использование '%d' % y покажет забавные вещи переключения.

Вы должны получить ошибку TypeError в первом print '0x%x' % y скрипте, потому что эта часть не определена четко. Но каким-то образом результат оказывается принудительным, и похоже, что строковое исключение каким-то образом… пропускается, когда его, вероятно, следовало превратить в TypeError.

Если этот материал для замены строк содержит ошибки, это еще одна причина перейти к предпочтительному новому методу форматирования строк, например. print '{0:x}'.format(22)


2

wim
15 Ноя 2011 в 08:43

Я знаю, почему вы получаете сообщение об ошибке, потому что вы не определили метод __int__ для класса, который используется для многих вещей, включая форматирование строк в старом стиле через int(). . Кажется, я припоминаю, что int() будет работать только с числовыми типами, строками и объектами, у которых есть метод __int__() (хотя могут быть и другие, о которых я забыл).

Когда вы добавляете:

def __int__(self):
    return int(self.x)

К вашему определению класса, тогда ошибка исчезнет.

Если вы просто хотите, чтобы ошибка исчезла, это все, что вам нужно сделать.


В чем я не уверен, так это в том, почему вы получаете ошибку при альтернативных запусках. На самом деле вам не нужно ничего делать при альтернативных запусках, нажатие клавиши ENTER вызовет ошибку, такую ​​же, как при запуске:

pax$ python -i xx.py
0x16
0x16
>>> **ENTER**
TypeError: int() argument must be a string or a number, not 'Foo'
>>> '%x'%y
'16'
>>> **ENTER**
TypeError: int() argument must be a string or a number, not 'Foo'
>>> '%x'%y
'16'
>>> **ENTER**
TypeError: int() argument must be a string or a number, not 'Foo'
>>> **ENTER**
>>> **ENTER**
>>> **ENTER**
>>>


1

paxdiablo
15 Ноя 2011 в 08:56

Понравилась статья? Поделить с друзьями:

Не пропустите эти материалы по теме:

  • Яндекс еда ошибка привязки карты
  • Альтендорф f45 ошибка е07
  • Альта ошибка 10060
  • Альбион ошибка подключения к серверу повторите попытку позже
  • Альбион лаунчер ошибка

  • 0 0 голоса
    Рейтинг статьи
    Подписаться
    Уведомить о
    guest

    0 комментариев
    Старые
    Новые Популярные
    Межтекстовые Отзывы
    Посмотреть все комментарии