De laatste keer dat ik naar een gemiddelde rekenmachine greep, was dat niet voor schoolwerk, maar voor een klantbijeenkomst. We waren de responstijden aan het bekijken van een Laravel API die ik had gebouwd, en iemand liet een kolom van 200 latentienummers in de chat vallen en vroeg: "dus #39; is het gemiddelde?" Ik had een spreadsheet kunnen openen, maar ik wilde niet het gemiddelde. Ik wilde de mediaan, omdat een handvol langzame cold-start-verzoeken het gemiddelde naar een getal sleepte waardoor de API er slechter uitzag dan in de praktijk. Het gemiddelde zei 340 milliseconden. De mediaan zei: wat een mediaan is eigenlijk een goede reden voor deze.
tl;dr: Een gemiddelde rekenmachine neemt een lijst met getallen en geeft het gemiddelde, de mediaan en de modus, plus het bereik en de standaarddeviatie terug. Het gemiddelde is de som gedeeld door de telling, de mediaan is de middelste waarde wanneer gesorteerd, en de modus is de meest voorkomende waarde. De Toolz gemiddelde rekenmachine berekent ze allemaal tegelijk uit een geplakte lijst, verwerkt komma's, spaties of regeleindes en toont de gesorteerde waarden zodat elk cijfer controleerbaar is Alles draait client-side: geen upload, geen aanmelding, werkt offline.
Ik bouw SaaS-producten op Laravel en React en ik verzend WordPress-plug-ins, en cijfers komen constant: timings aanvragen, conversiepercentages, downloadtellingen van plug-ins, survey-scores Meestal heb ik geen grafiek nodig, ik heb drie of vier samenvattende statistieken nodig die correct en onmiddellijk worden berekend, dus ik kan iets waars zeggen over de gegevens en verder gaan. Daarvoor is een spreadsheet openen overkill, en als ik het in mijn hoofd doe, is het een goede manier om stilletjes fout te zijn Dus heb ik een rekenmachine gebouwd die een lijst met getallen en handen terugneemt naar elk gemiddelde dat ertoe doet, en dit is de redenering achter elk van elk.
Wat is een gemiddelde rekenmachine?
Een gemiddelde rekenmachine is een hulpmiddel dat een lijst met getallen reduceert tot een handvol samenvattende statistieken die de hele set beschrijven Het woord & quot; average" is bedrieglijk casual, omdat het in het dagelijks spraakgebruik bijna altijd het rekenkundig gemiddelde betekent, maar in de statistiek zijn er drie verschillende gemiddelden, en ze beantwoorden drie verschillende vragen Het gemiddelde vertelt je het algemene niveau De mediaan vertelt je de typische waarde De modus vertelt je de meest voorkomende waarde Een goede rekenmachine geeft je alle drie naast elkaar, want als je naar slechts één ervan kijkt, is hoe mensen uiteindelijk de verkeerde conclusie trekken uit perfect goede gegevens.
Buiten de drie gemiddelden rapporteert een volledige rekenmachine de spreidingsmaten: het bereik tussen de kleinste en grootste waarden, en de standaarddeviatie, die kwantificeert hoe strak de getallen zich rond het gemiddelde clusteren Twee datasets kunnen een identiek gemiddelde van 50 hebben terwijl de ene een zachte cluster is van 48 tot 52 en de andere schommelt van 5 tot 95. het gemiddelde kan ze niet uit elkaar houden. De standaarddeviatie kan, en vaak is het het nuttiger aantal van de twee. De Toolz gemiddelde rekenmachine berekent het gemiddelde, de mediaan, de modus, het bereik, de variantie en beide vormen van standaarddeviatie uit één enkele lijst, zodat u de volledige samenvatting krijgt in plaats van één cijfer afzonderlijk.
Wat is het verschil tussen gemiddelde, mediaan en modus?
Dit is de vraag waar het hele gereedschap omheen is gebouwd, dus het is de moeite waard om precies te zijn Het gemiddelde is wat de meeste mensen het gemiddelde noemen: tel elke waarde bij elkaar op en deel door hoeveel het er zijn Voor de lijst 12, 15, 18 is de som 45 en de telling is 3, dus het gemiddelde is 15. het gemiddelde gebruikt elke waarde, waardoor het gevoelig is voor extremen, een enkel zeer groot of zeer klein getal trekt het in die richting.
De mediaan is de middelste waarde zodra de getallen gesorteerd zijn Voor een oneven telling is het gewoon de waarde in het midden; voor een even telling is het het gemiddelde van de twee middelste waarden De bepalende eigenschap is dat het negeert hoe ver de uitschieters verwijderd zijn, het geeft alleen om positie, dus het blijft staan wanneer een paar extreme waarden het gemiddelde zouden laten vliegen De modus is de waarde die het vaakst voorkomt, en het is de enige van de drie die een werkelijke waarde uit de gegevens moet zijn Een set kan geen modus hebben als elke waarde uniek is, of meerdere modi als er een gelijkspel is, die de rekenmachine eerlijk rapporteert in plaats van er willekeurig een te kiezen.
| Gemiddeld | Hoe het wordt gevonden | het beste voor | zwakke plaats |
|---|---|---|---|
| Mean | Som gedeeld door telling | Symmetrische gegevens zonder grote uitschieters | Rondgesleept door extreme waarden |
| Mediaan | Middenwaarde bij sorteren | Scheefgetrokken gegevens, inkomens, responstijden | Negeert de omvang van uitschieters volledig |
| manier | Meest voorkomende waarde | Categorieën, meest voorkomende keuze | Bestaat misschien niet, of het kunnen er meerdere zijn |
De praktische regel die ik gebruik: wanneer de gegevens ruwweg symmetrisch zijn, is het gemiddelde de eerlijke samenvatting Wanneer het scheef is, leiden salarissen, pagina laadtijden, alles met een lange staart, met de mediaan, omdat het gemiddelde het typische geval zal overdrijven. Door beide te rapporteren, zoals het hulpmiddel doet, kan uw lezer de scheefheid zelf zien.
Hoe gaat de rekenmachine om met de getallen die ik plak?
De invoer is bewust vergevingsgezind, omdat reële getallen in rommelige formaten aankomen, U kunt waarden scheiden met komma's, spaties, tabbladen of nieuwe regels, en ze vrij mengen Dat betekent een kommalijst als 12, 15, 18 werkt, een door spaties gescheiden lijn werkt, en, het meest nuttig, een kolom die rechtstreeks uit Excel of Google Spreadsheets wordt gekopieerd, werkt omdat een geplakte kolom als één getal per regel arriveert Elk token dat geen geldig nummer is, wordt eenvoudigweg overgeslagen in plaats van een fout te gooien, dus een verdwaald label of een achterliggende opmerking stopt de berekening niet.
Er is één bewust gedrag dat de moeite waard is om te weten: een komma wordt altijd behandeld als een scheidingsteken, nooit als een scheidingsteken voor duizenden. Dus als je plakt 1,000 de tool leest het als twee getallen, 1 en 0, niet als duizend Dit is de veilige standaard omdat er geen betrouwbare manier is om een komma van duizenden te vertellen van een lijst komma zonder te raden, en verkeerd raden corrumpeert stilletjes het resultaat Als je getallen duizenden scheidingstekens gebruiken, strip ze dan eerst, een snelle find-and-replace, of plak ze één per regel waar de komma nooit verschijnt Eenmaal geparseerd worden de waarden gesorteerd en wordt elke statistiek berekend uit die schone lijst, en de tool toont je de gesorteerde waarden zodat je kunt bevestigen dat het precies leest wat je bedoeld hebt.
Hoe gebruik ik de gemiddelde rekenmachine?
De stroom is kort door ontwerp Plak uw nummers in het vak, of klik op Voorbeeld om een bewerkt voorbeeld te laden Scheid de waarden echter handig, komma's, spaties, of één per regel, en het gereedschap parseert ze allemaal op dezelfde manier Klik vervolgens op Berekenen.
De resultaten verschijnen in twee lagen De bovenste rij toont de vier cijfers die mensen voor de meeste bereiken: het gemiddelde, de mediaan, de modus en de telling Daaronder geeft een raster je de som, het minimum en maximum, het bereik, de steekproef en populatie standaardafwijkingen, de twee varianties, en, wanneer elke waarde positief is, het geometrische gemiddelde Onderaan drukt het gereedschap de volledige gesorteerde lijst af, dus er is niets verborgen achter een zwarte doos, je kunt elke statistiek terug traceren naar de getallen die het hebben geproduceerd Een kopieerknop plaatst de hele samenvatting op je klembord als gelabelde lijnen, klaar om in een rapport te plakken, een huiswerkantwoord of een spreadsheetcel Als je met percentages werkt in plaats van onbewerkte, telt de percentage calculator is de betere eerste stop, en voor cijfergemiddelden specifiek de GPA-calculator past kredietweging toe, het gewone gemiddelde niet.
Wat is het verschil tussen populatie en steekproef standaarddeviatie?
Standaardafwijking meet spreiding, de gemiddelde afstand van de waarden tot het gemiddelde, maar er zijn twee versies van en het kiezen van de verkeerde is een veelgemaakte fout Het verschil is een enkel getal in de noemer Populatiestandaardafwijking deelt de som van de kwadratische afwijkingen door N, de telling van waarden Steekproefstandaardafwijking deelt door N min 1, een tweak genaamd Bessel' s correctie De rekenmachine rapporteert beide, dus je bent nooit gedwongen om opnieuw te berekenen omdat je de verkeerde hebt gekozen.
Wat je wilt hangt af van wat je cijfers vertegenwoordigen Als je lijst de hele groep is waar je om geeft, elke leerling in een klas, elk verzoek in een vaste batch, gebruik dan het populatiecijfer, want je hebt alles gemeten en er valt niets in te schatten Als je lijst een steekproef is die is getrokken uit een grotere populatie en je wilt de spreiding van die hele populatie afleiden, gebruik dan het steekproefcijfer, want delen door N min 1 corrigeert een bias waardoor kleine steekproeven er anders minder variabel uitzien dan ze in werkelijkheid zijn De steekproefwaarde is altijd iets groter, en in de meeste reële analyses, waar je gegevens een steekproef zijn van iets groters, is het degene die moet rapporteren Bij twijfel is de standaardafwijking van de steekproef de veiligere standaard, en daarom dat statistieken ook standaard standaard standaard standaard standaard standaard standaard standaard naar deze waarde gaan.
Wanneer moet ik het geometrische gemiddelde gebruiken in plaats van het rekenkundig gemiddelde?
Het meetkundig gemiddelde is het gemiddelde dat de meeste mensen nooit geleerd hebben maar af en toe echt nodig hebben, Waar het rekenkundig gemiddelde de waarden en delingen optelt, vermenigvuldigt het meetkundig gemiddelde ze allemaal met elkaar en neemt de n-de wortel Dat maakt het het juiste gemiddelde voor grootheden die eerder samenstellen dan optellen: groeicijfers, beleggingsrendementen, veranderingspercentages in de tijd, en ratio's Als een waarde het ene jaar met 10 procent groeit en het volgende jaar met 30 procent, is de gemiddelde jaarlijkse groei niet 20 procent, dan is het het meetkundig gemiddelde van de groeifactoren, dat iets lager is omdat de samenstelling niet lineair is.
De rekenmachine toont het geometrische gemiddelde alleen wanneer elke waarde in uw lijst positief is, omdat het wiskundig ongedefinieerd is voor nul of negatieve getallen, kunt u geen betekenisvolle wortel nemen van een product dat een negatief bevat Dus als u het in de resultaten ziet, komen uw gegevens in aanmerking; als u dat niet doet, heeft u een nul - of een negatieve waarde en het rekenkundig gemiddelde is wat u hoe dan ook wilt Voor het alledaagse geval van het middelen van testscores, metingen of tellingen is het rekenkundig gemiddelde correct en het meetkundig gemiddelde een curiositeit Voor alles wat met een percentage groeit, is het het eerlijke getal en het rekenkundig gemiddelde overdrijft het gemiddelde.
Waar past de gemiddelde rekenmachine in een echte workflow?
Voor mij is het een snel-antwoord tool die tussen de ruwe data en een beslissing zit Iemand plakt een kolom met getallen en stelt een vraag, en ik heb een verdedigbare samenvatting nodig in seconden, geen spreadsheet en een grafiek Het API latentie voorbeeld is typisch: ik leid met de mediaan omdat de verdeling scheef is, noem het gemiddelde om de scheefheid te tonen, en citeer de standaarddeviatie zodat de lezer weet of het getal stabiel is of overal Drie statistieken, één plak, klaar.
Het koppelt ook op natuurlijke wijze met de andere numerieke tools op de site. Als de onbewerkte gegevens vastzitten in een spreadsheetbestand, wordt de CSV-viewer opent het als een sorteerbaar raster zodat ik de rechterkolom schoon kan kopiëren voordat ik het hier plak Als ik een verandering rapporteer in plaats van een niveau, zal de percentage calculator verwerkt de wiskunde van het verhogen of verlagen, en voor het omzetten van een berekend cijfer in woorden voor een factuur of een rapport nummer naar woorden doet de spelling Geen van deze upload uw gegevens, zodat u ze kunt ketenen op dezelfde privé nummers zonder een tweede gedachte Als u een kit van alledaagse hulpprogramma's, mijn Handleiding voor productiviteitstools voor loopt door hoe de kleintjes samenkomen, en de bredere Handleiding voor webontwikkelaars dekt de gegevensverwerkingsstukken.
Wat zijn de grenzen die de moeite waard zijn om te weten?
Eerlijkheid over limieten is een onderdeel van het vertrouwen op een tool De rekenmachine berekent beschrijvende statistieken, de cijfers die de gegevens die je hebt samenvatten, en het doet geen inferentiële statistieken: geen betrouwbaarheidsintervallen, geen hypothesetests, geen regressie Dat zijn aparte vragen die meer nodig hebben dan een lijst met waarden, en een tool die anders pretendeerde zou misleidend zijn Als je een p-waarde nodig hebt, is dit het verkeerde hulpmiddel, en dat is door het ontwerp.
Het behandelt ook elk getal als een onafhankelijke waarde met gelijk gewicht. Dat is precies goed voor een gewone lijst, maar het is niet wat je wilt als de waarden gewogen moeten worden, een cijfergemiddelde waarbij cursussen verschillende studiepunten met zich meebrengen, heeft bijvoorbeeld de GPA-calculator in plaats daarvan, die elk cijfer vermenigvuldigt met zijn credits voordat het middel wordt. Ten slotte leeft de hele berekening in het browsergeheugen, dus is het gebouwd voor het alledaagse geval van tientallen, honderden of een paar duizend getallen, niet voor het streamen van een dataset met meerdere miljoenen rijen, die thuishoort in een database of een statistiekpakket. Voor de lijsten plakken mensen daadwerkelijk, responstijden, scores, prijzen, tellingen, geen van deze limieten bijt. Wetende dat ze bestaan, is slechts het verschil tussen het goed gebruiken van een tool en erdoor verrast worden.
Veelgestelde vragen
Hoe bereken je het gemiddelde van een lijst met getallen? Het gemiddelde, of rekenkundig gemiddelde, is de som van alle getallen gedeeld door hoeveel getallen er zijn Tel elke waarde bij elkaar op, deel dan door de telling Voor 12, 15, en 18 is de som 45 en de telling is 3, dus het gemiddelde is 45 gedeeld door 3, dat is 15 De gemiddelde rekenmachine doet dit en de mediaan en modus in één stap.
Wat is het verschil tussen gemiddelde, mediaan en modus? Het gemiddelde is het rekenkundig gemiddelde van alle waarden, de mediaan is de middelste waarde wanneer de getallen gesorteerd worden, en de modus is de waarde die het vaakst voorkomt, ze kunnen sterk verschillen op scheve gegevens, waarbij een paar grote waarden het gemiddelde omhoog trekken terwijl de mediaan blijft staan Het rapporteren van alle drie geeft een vollediger beeld dan wie dan ook alleen.
Hoe wordt de mediaan berekend als er een even aantal waarden is? Sorteer de getallen en neem de twee waarden in het midden, dan gemiddeld ze Voor de gesorteerde lijst 4, 8, 15, 16 zijn de twee middelste waarden 8 en 15, dus de mediaan is 8 plus 15 gedeeld door 2, wat 11,5 is Bij een oneven telling is de mediaan gewoon de enkele waarde in het midden.
Wat betekent het als er geen modus of meer dan één modus is? Als elk getal precies verschijnt zodra de set geen modus heeft, en het gereedschap rapporteert & quot;Geen modus" Als twee of meer waarden overeenkomen met de hoogste frequentie, is de set multimodaal en vermeldt de rekenmachine elke waarde die gelijk is in plaats van er één te kiezen. Dit is eerlijker dan tools die in stilte alleen de eerste meest voorkomende waarde retourneren.
Moet ik de standaarddeviatie van de populatie of steekproef gebruiken? Gebruik de standaarddeviatie van de populatie wanneer uw gegevens de hele groep zijn waar u om geeft, en steekproef standaarddeviatie wanneer uw gegevens een steekproef zijn van een grotere populatie die u wilt beschrijven Steekproef standaarddeviatie deelt door N min 1 om een bias te corrigeren en is iets groter In de meeste reële analyses zijn uw gegevens een steekproef, dus het voorbeeldcijfer is de gebruikelijke keuze.
Wanneer moet ik het geometrische gemiddelde gebruiken? Gebruik het geometrische gemiddelde voor grootheden die zich vermenigvuldigen in plaats van optellen, zoals groeicijfers, beleggingsrendementen en ratio's. Het is de n-de wortel van het product van de waarden en geeft een nauwkeurigere gemiddelde veranderingssnelheid in de loop van de tijd. Het wordt alleen gedefinieerd als elke waarde positief is, dus de tool laat het alleen in dat geval zien.
Kan ik nummers plakken uit een spreadsheet? Ja. kopieer een kolom of rij uit Excel, Google Spreadsheets of een CSV en plak deze in De rekenmachine accepteert waarden die gescheiden zijn door komma's, spaties, tabbladen of nieuwe regels, zodat een geplakte kolom correct wordt gelezen zonder opnieuw te formatteren Niet-numerieke tekst wordt genegeerd in plaats van een fout te veroorzaken.
Worden mijn gegevens naar een server verzonden? Nee Elke berekening wordt uitgevoerd als JavaScript in uw browser Niets dat u typt of plakt wordt geüpload, gelogd of opgeslagen, en de tool blijft werken zonder internetverbinding zodra de pagina is geladen, wat u kunt bevestigen door het netwerktabblad te bekijken terwijl u berekent.



