Scorecard: przejrzyste oceny według ustalonych kryteriów
Zbuduj blok oceny typu scorecard z ustalonymi kryteriami, przejrzystym ważeniem, wynikami cząstkowymi powiązanymi z dowodami oraz metodą, którą czytelnicy i maszyny mogą jednoznacznie zweryfikować.
Scorecard to zwarty blok oceniający, który punktuje jeden podmiot według ustalonego zestawu kryteriów i łączy te wyniki cząstkowe przy użyciu podanej metody. Zamienia werdykt w możliwy do sprawdzenia rachunek, zamiast prosić czytelnika o zaufanie wyeksponowanej liczbie.
| Kryterium | Waga | Wynik | Podsumowanie dowodów |
|---|---|---|---|
| Kontrole bezpieczeństwa | 30% | 8,0/10 | Wymagane kontrole udokumentowane; dwie zaawansowane kontrole niedostępne |
| Użyteczność | 25% | 7,5/10 | Testowano pięć określonych zadań; jedno wymagało wielokrotnej nawigacji |
| Zasięg integracji | 25% | 9,0/10 | Obsługiwane 18 z 20 wymaganych integracji |
| Wsparcie | 20% | 6,0/10 | Odpowiedź e-mail spełniła opublikowaną umowę SLA; brak kanału telefonicznego |
| Wynik ważony | 100% | 7,7/10 | Suma każdego wyniku pomnożonego przez jego wagę; zaokrąglone do jednego miejsca dziesiętnego |
Wyłącznie przykładowa ilustracja. Wymieniony produkt i obserwacje są fikcyjne. Skala: 0–10, gdzie 0 oznacza niespełnienie kryterium, a 10 oznacza jego pełne spełnienie.
Dlaczego ten element jest ważny
Czytelnicy słusznie podchodzą sceptycznie do ocen, ponieważ pojedyncza liczba może ukrywać dziesiątki decyzji redakcyjnych. Które cechy były oceniane? Czy były oceniane w ten sam sposób dla każdego podmiotu? Czy komercyjnie wygodna funkcja mogła przeważyć nad poważnym ograniczeniem? Scorecard redukuje tę niepewność, utrzymując werdykt, kryteria, wagi i dowody razem. Pomaga czytelnikowi zgodzić się z faktami, jednocześnie nie zgadzając się co do priorytetów: ktoś, kto bardziej ceni wsparcie niż integracje, widzi, dlaczego opublikowany wynik końcowy może nie pasować do jego decyzji.
Psychologia działa tylko wtedy, gdy metoda poprzedza autorytet liczby. Duże cyfry sugerują pomiar. Miejsca dziesiętne sugerują powtarzalność. Bez ujawnionego rubrykatora i obliczeń „8,3/10” to opinia w laboratoryjnym przebraniu. Opublikowanie kotwic skali, reguły dowodowej, wag i polityki zaokrąglania nadaje precyzji uzasadnione źródło i uwidacznia decyzje redakcyjne, zamiast udawać, że nie istnieją.
Możliwość ekstrakcji maszynowej oznacza, że zautomatyzowany system może zachować informację o tym, co było oceniane, znaczeniu każdego kryterium, skali punktowej oraz relacji między wynikami cząstkowymi a wynikiem końcowym. Gołe „7,7” jest niejednoznaczne: może być oceną użytkownika, wynikiem testu lub numerem wersji. Tekstowa tabela z jawnym podmiotem i skalą udostępnia stabilne pary pole-wartość. Crawlery i systemy odpowiedzi AI mogą zacytować ograniczone twierdzenie, takie jak „7,5 na 10 za użyteczność w teście pięciu zadań”, nie odrywając liczby od jej podstawy.
Zgodnie z zasadami pisania elementów , blok, którego celem jest punktowana ocena, musi korzystać z typowanego kontraktu scorecard. Wiersz stylizowanych odznak nie jest równoważny. Typowany element zachowuje metodologię, umożliwia walidację wag i wyników całkowitych oraz wspiera spójne wyniki w różnych systemach publikacji.
Kiedy go używać
Użyj scorecarda, gdy jeden lub więcej podmiotów zostało ocenionych według tego samego stabilnego rubrykatora, a uzyskane wyniki cząstkowe pomagają czytelnikowi zrozumieć werdykt. Odpowiednie dane wejściowe obejmują udokumentowane testy, zweryfikowane specyfikacje odwzorowane na wymagania, ekspercką inspekcję według opublikowanych kotwic lub określoną mieszankę tych źródeł. Scorecard zasługuje na swoje miejsce, gdy czytelnicy mogliby podjąć inną decyzję po zobaczeniu podziału na kryteria.
Metoda musi istnieć przed rozpoczęciem oceny. Zdefiniuj podmiot, zasady kwalifikowalności, kryteria, wagi, kotwice skali, źródła dowodów, warunki testów, politykę dotyczącą brakujących danych i zasadę zaokrąglania. Zamroź je dla całego zestawu ocenianych obiektów. Jeśli metoda zmieni się w trakcie, przeskaluj każdy dotknięty podmiot lub oznacz wyniki jako różne edycje, których nie należy bezpośrednio porównywać.
Częste niemal-błędy obejmują:
- Niescoreowana macierz funkcji. Jeśli zadaniem jest pokazanie, czy funkcje istnieją, użyj tabeli porównawczej . Dodawanie punktów może zniekształcić różnice, które są faktograficzne, a nie oceniające.
- Pojedynczy zmierzony wskaźnik. Szybkość strony, cena, czas odpowiedzi i żywotność baterii mają już swoje jednostki. Podaj pomiar i odpowiedni benchmark; nie zamieniaj go na arbitralną ocenę gwiazdkową.
- Agregat recenzji użytkowników. Średnia klientów ma innych autorów, inne warunki próbkowania i inne mechanizmy kontroli stronniczości. Wyświetlaj ją jako przypisany agregat, a nie jako scorecard publikacji.
- Lista kontrolna. Spełnienie sześciu z ośmiu wymagań nie jest automatycznie oceną 7,5/10. Niektóre wymagania mogą być obowiązkowe i niekompensowalne, co oznacza, że siła w innym obszarze nie może zrekompensować porażki.
- Odznaka zwycięzcy. „Wybór redakcji” przekazuje konkluzję, ale nie uzasadnienie. Może wynikać ze scorecarda; nie może go zastąpić.
- Ranking utworzony po zobaczeniu produktów. Kryteria wybrane w celu uzasadnienia preferowanego zwycięzcy to uzasadnienie post-hoc, a nie powtarzalna ocena.
Nie używaj wyniku całkowitego, gdy kryteria nie mogą się sensownie kompensować. Na przykład poważna awaria bezpieczeństwa powinna zwykle skutkować wykluczeniem lub jawnym stanem porażki, a nie być uśredniana przez atrakcyjny design. W takim przypadku opublikuj osobno bramki zaliczenia/niezaliczenia i pozostałą ocenę opisową.
Gdzie go umieścić
Umieść pierwszy scorecard po tym, jak strona zidentyfikuje podmiot, cel oceny, odbiorców, datę testu oraz zwięzłe oświadczenie o metodologii. W recenzji jest to zazwyczaj po podsumowującym werdykcie, a przed szczegółowymi sekcjami kryteriów. W porównaniu przedstaw wspólny rubrykator raz, a następnie prezentuj scorecardy w tej samej kolejności podmiotów, która jest używana na stronie. W raporcie benchmarkingowym wyjaśnij kohortę i okres danych przed pokazaniem jakiegokolwiek ocenianego podmiotu.
Element może pojawić się blisko góry tylko wtedy, gdy metoda jest widoczna bezpośrednio przed nim lub dostępna przez sąsiedni, opisowy link metody. Wynik nie może prowadzić strony, zanim czytelnicy dowiedzą się, co było oceniane. Szczegółowe dowody mogą pojawić się później, ale każdy wiersz nadal potrzebuje krótkiego podsumowania dowodów lub bezpośredniego linku do odpowiedniej sekcji.
Nie umieszczaj scorecarda bezpośrednio obok agregatu ocen gwiazdkowych, referencji, promocji cenowej, przycisku partnerskiego lub banera „zwycięzcy”. Te elementy mogą sprawić, że decyzja redakcyjna będzie wyglądać na komercyjnie motywowaną lub spowodować, że czytelnicy połączą oddzielne systemy oceniania. Nie umieszczaj dwóch scorecardów z różnymi skalami obok siebie. Zachowaj co najmniej jeden akapit wyjaśniający między scorecardem a gęstym wykresem lub drugim systemem punktacji i nigdy nie oddzielaj metodologii od jej scorecarda reklamą.
Anatomia
Opisany zrzut ekranu musi identyfikować następujące obszary:
- Podmiot: dokładny produkt, firma, strona, usługa lub edycja, która została oceniona.
- Wynik ogólny: obliczony rezultat, zawsze wyświetlany z mianownikiem lub skalą.
- Podsumowanie metody: kto oceniał, kiedy, z użyciem jakich dowodów i warunków testowych.
- Kotwice skali: co oznaczają minimum, środek i maksimum; nie tylko „na 10”.
- Etykieta i definicja kryterium: jeden stabilny wymiar i granice tego, co obejmuje.
- Waga: wkład kryterium w wynik całkowity, z uwzględnieniem jawnego równego ważenia.
- Wynik cząstkowy: rezultat dla tego kryterium na zadeklarowanej skali.
- Podsumowanie dowodów: obserwacja lub źródło uzasadniające wynik cząstkowy.
- Informacja o obliczeniach i zaokrągleniu: wzór użyty do uzyskania wyświetlanego wyniku całkowitego.
- Data i wersja: kiedy przeprowadzono ocenę i która wersja podmiotu lub planu była testowana.
- Ujawnienie: wszelkie relacje handlowe, udostępniony dostęp lub istotne ograniczenia testowania.
Przykłady projektowe
Każdy wariant zachowuje ten sam podstawowy kontrakt. Kompresja wizualna może ograniczyć opis w każdym wierszu, ale nie może usuwać metodologii, wag, skali ani dostępu do dowodów.
Ważony standard: domyślny dla recenzji i decyzji zakupowych. Użyj go, gdy kryteria mają różne znaczenie. Pokaż każdą wagę i potwierdź, że sumują się do 100%.
Kompaktowe równe ważenie: odpowiednie, gdy metoda redakcyjna przypisuje każdemu kryterium identyczny wpływ. „Równe ważenie” musi być widoczne; pominięta waga nie jest wagą równą.
Scorecard porównawczy: używaj dla dwóch lub trzech podmiotów ocenianych według jednego zamrożonego rubrykatora. Kryteria pozostają wierszami, a podmioty pozostają w spójnej kolejności. Dla większej liczby podmiotów użyj oddzielnych kart lub tabeli porównawczej z linkami do dowodów, aby czytanie na urządzeniach mobilnych było możliwe.
Scorecard z bramką: używaj, gdy obowiązkowy warunek może nadpisać ważony wynik. Podaj bramkę przed opcjonalnymi kryteriami i wyświetl „Nierekomendowane — obowiązkowy wymóg bezpieczeństwa niespełniony”, zamiast pozwalać, by wysoka średnia sugerowała akceptację.
Stan niekompletny lub niepunktowany: używaj tylko wtedy, gdy brak dowodów jest uczciwy, a polityka została zdefiniowana z wyprzedzeniem. Oznacz kryterium jako „Nie testowano”, wyjaśnij dlaczego i albo wstrzymaj wynik całkowity, albo pokaż wynik tymczasowy, którego mianownik i ponowne ważenie są jawne. Nigdy po cichu nie przypisuj zera ani nie redystrybuuj wagi.
Parametry
| Nazwa | Typ | Wymagane | Min/maks | Domyślne | Źródło |
|---|---|---|---|---|---|
| subject | Ciąg znaków | Tak | 2–80 znaków | Brak | Atrybut |
| title | Ciąg znaków | Nie | 3–12 słów; 90 znaków | „Scorecard” | Atrybut lub pierwszy nagłówek |
| score | Liczba dziesiętna | Wyprowadzone | Minimum skali–maksimum skali; jeden wyświetlany ułamek dziesiętny | Obliczone | Obliczone z elementów potomnych |
| scaleMin | Liczba | Tak | 0–1000 | 0 | Atrybut |
| scaleMax | Liczba | Tak | Większe niż scaleMin; nie więcej niż 1000 | 10 | Atrybut |
| method | Tekst zwykły | Tak | 20–80 słów | Brak | Treść przed elementami |
| dateEvaluated | Data ISO | Tak | Jedna prawidłowa data | Brak | Atrybut |
| version | Ciąg znaków | Warunkowe | 1–50 znaków | Brak | Atrybut |
| rounding | Enum | Tak | whole, one-decimal, two-decimal | one-decimal | Atrybut |
| criteria | Uporządkowana lista elementów | Tak | 3–7 elementów | Brak | Treść |
| criterion | Ciąg znaków | Tak | 2–8 słów; 60 znaków | Brak | Nagłówek elementu |
| weight | Procent | Tak | 1–100%; wszystkie elementy sumują się do 100% | Brak | Atrybut elementu |
| subscore | Liczba dziesiętna lub „not-tested” | Tak | Minimum skali–maksimum skali | Brak | Atrybut elementu |
| evidence | Tekst zwykły z opcjonalnymi linkami | Tak | 8–40 słów | Brak | Treść elementu po nagłówku |
| gate | Boolean | Nie | true lub false | false | Atrybut elementu |
| disclosure | Tekst zwykły | Warunkowe | 10–60 słów | Brak | Treść po elementach |
Wzór dla standardowego modelu 0–10 to total = Σ(subscore × weight as a decimal). Walidacja musi odrzucać ujemne wagi, sumy różne od 100%, wyniki cząstkowe poza skalą oraz ręcznie wprowadzony wynik ogólny różniący się od wyniku obliczonego. Renderer może obliczyć wynik całkowity, ale przechowywane kryteria i wagi pozostają autorytatywnymi danymi wejściowymi.
Składnia i przykłady kodu
Wszystkie poniższe implementacje przedstawiają tę samą fikcyjną ocenę. Zachowują metodę, datę, skalę, kolejność elementów, wagi, dowody i politykę zaokrąglania.
Przenośna dyrektywa Markdown
:::scorecard{subject="Acme Support Desk" scaleMin=0 scaleMax=10 dateEvaluated="2026-08-20" rounding=one-decimal}
## Product evaluation
We tested five standard support tasks and verified required controls and integrations against documentation current on the evaluation date.
::item{weight=30 subscore=8}
### Security controls
Required controls documented; two advanced controls unavailable.
::
::item{weight=25 subscore=7.5}
### Usability
Five defined tasks tested; one required repeated navigation.
::
::item{weight=25 subscore=9}
### Integration coverage
Eighteen of twenty required integrations supported.
::
::item{weight=20 subscore=6}
### Support
Email response met the published SLA; no phone channel.
::
:::
Hugo shortcode
Adapter Hugo powinien akceptować tylko nazwane parametry w wywołaniach rodzica i elementów. Poniższy zapis jest przenośną specyfikacją implementacji; nie twierdzi, że renderer już istnieje w tym repozytorium.
{{< scorecard subject="Acme Support Desk" scale-min="0" scale-max="10" evaluated="2026-08-20" rounding="one-decimal" >}}
## Product evaluation
We tested five standard support tasks and verified controls and integrations against current documentation.
{{< score criterion="Security controls" weight="30" value="8" >}}Required controls documented; two advanced controls unavailable.{{< /score >}}
{{< score criterion="Usability" weight="25" value="7.5" >}}Five defined tasks tested; one required repeated navigation.{{< /score >}}
{{< score criterion="Integration coverage" weight="25" value="9" >}}Eighteen of twenty required integrations supported.{{< /score >}}
{{< score criterion="Support" weight="20" value="6" >}}Email response met the published SLA; no phone channel.{{< /score >}}
{{< /scorecard >}}
Blok WordPress
<!-- wp:amicited/scorecard {"subject":"Acme Support Desk","scaleMin":0,"scaleMax":10,"dateEvaluated":"2026-08-20","rounding":"one-decimal"} -->
<!-- wp:amicited/score {"criterion":"Security controls","weight":30,"subscore":8} -->
<p>Required controls documented; two advanced controls unavailable.</p>
<!-- /wp:amicited/score -->
<!-- wp:amicited/score {"criterion":"Usability","weight":25,"subscore":7.5} -->
<p>Five defined tasks tested; one required repeated navigation.</p>
<!-- /wp:amicited/score -->
<!-- wp:amicited/score {"criterion":"Integration coverage","weight":25,"subscore":9} -->
<p>Eighteen of twenty required integrations supported.</p>
<!-- /wp:amicited/score -->
<!-- wp:amicited/score {"criterion":"Support","weight":20,"subscore":6} -->
<p>Email response met the published SLA; no phone channel.</p>
<!-- /wp:amicited/score -->
<!-- /wp:amicited/scorecard -->
Edytor WordPress powinien obliczać, a nie umożliwiać wprowadzania wyniku całkowitego. Powinien blokować publikację, gdy wagi nie sumują się do 100%, i ostrzegać, gdy elementowi brakuje dowodów lub testowanej wersji.
Przykłady
Dobrze: powtarzalny ważony osąd
Acme Support Desk: 7,7/10, ocenione 20 sierpnia 2026. Kontrole bezpieczeństwa uzyskują 8,0 przy wadze 30%; użyteczność 7,5 przy 25%; zasięg integracji 9,0 przy 25%; wsparcie 6,0 przy 20%. Każdy wynik cząstkowy jest powiązany z udokumentowanym wymaganiem lub testem pięciu zadań. Wynik całkowity to suma ważonych wyników cząstkowych i jest zaokrąglany jednokrotnie, na końcu, do jednego miejsca dziesiętnego.
To działa, ponieważ inny redaktor mógłby użyć tego samego rubrykatora, dowodów i formuły oraz wyjaśnić ewentualne rozbieżności na poziomie kryterium. Miejsce dziesiętne jest uzasadnione ważonymi danymi wejściowymi. Wynik jest ograniczony datą i testowanymi warunkami, więc nie sugeruje trwałej jakości produktu.
Źle: werdykt dopasowany do liczb
Acme Support Desk: 9,3/10. Funkcje 9,5, wartość 9,0, doświadczenie 9,4. „Nasi eksperci wzięli pod uwagę wszystko, co ma znaczenie.”
To zawodzi, ponieważ kryteria nakładają się na siebie i nie mają definicji, wag, kotwic, dowodów, daty testu ani obliczeń. „Wartość” nie może być interpretowana bez ceny, planu, odbiorców i alternatyw. „Doświadczenie” może obejmować użyteczność, wsparcie lub oba. Niewyjaśnione miejsce dziesiętne sugeruje precyzję, której metoda nie jest w stanie zapewnić. Naprawa wymaga zdefiniowania rubrykatora przed oceną, zebrania dowodów na poziomie kryterium, ujawnienia wag i obliczenia wyniku całkowitego na podstawie zarejestrowanych danych wejściowych — a nie wybierania wyników cząstkowych, które uśredniają się do pożądanej liczby w nagłówku.
Oznaczenia schematów i dostępność
Scorecard nie ma ogólnego typu Schema.org. Domyślnie pozostaw go jako widoczną treść w ramach prawidłowego oznaczenia encji i artykułu strony. Oznaczenia Review i Rating mogą mieć zastosowanie, gdy autentyczna recenzja ocenia konkretny kwalifikujący się element. W przypadku ich użycia ratingValue, bestRating i worstRating muszą być zgodne z widocznym wynikiem ogólnym i skalą; autor recenzji, recenzowany przedmiot, data i wspierająca treść recenzji również muszą być obecne. Scorecard dla benchmarku firmy, ram redakcyjnych lub abstrakcyjnej koncepcji nie staje się kwalifikowalny tylko dlatego, że zawiera liczbę.
Nie oznaczaj każdego kryterium jako osobnego Review i nie używaj AggregateRating dla obliczonego wyniku jednego redaktora. Agregat reprezentuje wiele ocen i wymaga widocznej liczby oraz odpowiedniego źródła. Nigdy nie mieszaj zewnętrznej średniej użytkowników z sumą redakcyjną bez pokazania tych dwóch systemów osobno. Jeśli strona cytuje wiele materiałów, użyj bloku źródeł
, aby szerszy zestaw dowodów był możliwy do sprawdzenia.
Dla dostępności używaj prawdziwej tabeli, gdy czytelnicy muszą porównywać kryteria w kolumnach. Zapewnij podpis określający podmiot i wynik całkowity, nagłówki kolumn, nagłówki wierszy oraz wiersz obliczeniowy w tfoot. Te same informacje muszą pozostać dostępne, gdy kolory, ikony i graficzne wskaźniki znikną. Nie ogłaszaj „zielonego” lub „pięciu wypełnionych gwiazdek” jako jedynego statusu; pokaż „8 na 10”.
Paski postępu mogą uzupełniać tekst, ale nie mogą go zastąpić. Nadaj każdemu znaczącemu wskaźnikowi dostępną nazwę, bieżącą wartość, minimum i maksimum. Zachowaj kolejność źródłową na urządzeniach mobilnych, zamiast konwertować każdą kolumnę na nieoznaczony stos. Etykiety narzędziowe (tooltips) nie mogą zawierać wymaganych dowodów, ponieważ użytkownicy klawiatury, dotyku i samego tekstu mogą ich nigdy nie otrzymać. Unikaj role="alert", automatycznych karuzel i animowanego odliczania punktów: wynik jest statyczną treścią redakcyjną, a nie zdarzeniem systemu czasu rzeczywistego.
Zasady pisania
Wyjaśnij powód oceny przed opublikowaniem wyniku. Podaj odbiorców i decyzję, którą ocena wspiera, ponieważ kryteria „najlepszego” dla małego zespołu mogą być błędne dla regulowanego przedsiębiorstwa. Zdefiniuj każde kryterium w jednym zdaniu przed szczegółową analizą lub w jej ramach. Kryteria muszą być wystarczająco odrębne, aby ta sama obserwacja nie była nagradzana dwukrotnie.
Użyj od trzech do siedmiu kryteriów. Mniej niż trzy zwykle sprowadza się do prostego porównania; więcej niż siedem utrudnia audyt wyniku całkowitego i zachęca do trywialnych rozróżnień. Etykiety kryteriów mają od dwóch do ośmiu słów. Podsumowania dowodów mają od 8 do 40 słów i przedstawiają obserwację, a nie przymiotnik promocyjny. „Obsługuje SAML SSO w planie enterprise” to dowód; „doskonałe bezpieczeństwo” powtarza osąd.
Publikuj kotwice skali. Dla skali 0–10 zdefiniuj co najmniej 0, 5 i 10 dla każdego kryterium lub dla naprawdę wspólnego rubrykatora. Punkt środkowy musi opisywać stan możliwy do przetestowania, a nie „średni”, chyba że populacja porównawcza i statystyka są zdefiniowane. Utrzymuj wszystkie podmioty na tej samej skali i wersji rubrykatora.
Ważenie musi być przejrzyste. Pokaż każdy procent, upewnij się, że suma wynosi 100%, i wyjaśnij, dlaczego kryteria o wyższej wadze mają większe znaczenie dla wskazanych odbiorców. Równe ważenie wciąż jest ważeniem i musi być określone. Nie zmieniaj wag dla poszczególnych podmiotów i nie pozwól, aby status sponsorski, prowizja partnerska, dostęp do produktu lub preferowany wynik na nie wpływały.
Obliczaj z niezaokrąglonymi wynikami cząstkowymi, a następnie zaokrąglij wynik końcowy jednokrotnie. Domyślnie wyświetlaj jedno miejsce dziesiętne. Dwa miejsca dziesiętne są dozwolone tylko wtedy, gdy rubrykator wejściowy niezawodnie rozróżnia taką precyzję; w przeciwnym razie generują fałszywą pewność. Umieszczaj mianownik przy każdym wyniku i odróżniaj procenty od punktów.
Nigdy nie umieszczaj w scorecardzie niepopartej pochwały, wezwania do sprzedaży, presji cenowej, referencji, gwiazdek od użytkowników ani nieujawnionej relacji handlowej. Nie ukrywaj dyskwalifikującej porażki w przypisie. Nie traktuj brakujących dowodów jako neutralnego punktu środkowego. Podaj „nie testowano”, postępuj zgodnie z wcześniej zdefiniowaną regułą dotyczącą brakujących danych i wstrzymaj wynik całkowity, gdy uczciwe obliczenie jest niemożliwe.
Typy wpisów, które go używają
Frontmatter postTypes jest źródłem tego mapowania. Umieszczenie oznacza, że format może obsługiwać scorecard, gdy istnieje stabilny rubrykator i dowody na poziomie kryterium; nie wymaga oceny na każdej stronie.
| Typ wpisu | Wymóg | Rola scorecarda |
|---|---|---|
| Strona recenzji | Zalecane, gdy werdykt ma charakter ilościowy | Pokazuje, w jaki sposób testowane cechy i wagi przekładają się na ocenę redakcyjną. |
| Strona porównania konkurencji | Opcjonalne | Stosuje jeden zamrożony rubrykator do wymienionych konkurentów bez zmiany kryteriów w zależności od podmiotu. |
| Porównanie A vs B | Opcjonalne | Ujawnia kompromisy na poziomie kryteriów, gdy pojedynczy zwycięzca ukryłby dopasowanie do odbiorców. |
| Najlepsze X dla Y | Zalecane, gdy rankingi korzystają z punktacji | Łączy priorytety wskazanych odbiorców z wagami wyboru i kolejnością. |
| Poradnik zakupowy | Opcjonalne | Przekłada udokumentowane wymagania kupujących na przejrzysty model oceny. |
| Raport benchmarkingowy | Opcjonalne | Punktuje członków kohorty tylko wtedy, gdy metoda benchmarku definiuje stabilne kotwice i porównywalne dowody. |
| Profil firmy | Wyjątkowe | Ocenia ujawnione ramy, a nie ogólną wartość korporacyjną lub reputację. |
| Profil dostawcy | Opcjonalne | Podsumowuje dopasowanie do kryteriów zakupowych, zachowując dowody i obowiązkowe bramki. |
Lista kontrolna QA
- Podmiot, wersja lub plan, data oceny, odbiorcy i decyzja są wyraźnie określone.
- Metodologia została zdefiniowana przed oceną i można ją zastosować ponownie.
- Istnieje od trzech do siedmiu odrębnych kryteriów z możliwymi do przetestowania definicjami.
- Każde kryterium ma widoczną wagę, a wszystkie wagi sumują się dokładnie do 100%.
- Kotwice skali wyjaśniają, co oznaczają minimum, środek i maksimum.
- Każdy wynik cząstkowy ma podsumowanie dowodów oraz możliwe do prześledzenia źródło lub obserwację testową.
- Obowiązkowe bramki nie mogą być uśredniane przez siłę w kryteriach opcjonalnych.
- Wynik całkowity jest obliczany z wyników cząstkowych i wag, a następnie zaokrąglany tylko raz.
- Wyświetlana precyzja jest poparta granulacją danych wejściowych.
- Brakujące dowody są zgodne z ujawnioną polityką i nigdy nie są po cichu punktowane jako zero lub średnia.
- Relacje handlowe, udostępniony dostęp i istotne ograniczenia są ujawnione.
- Scorecard nie jest umieszczony obok gwiazdek użytkowników, referencji, promocji ani sprzecznej skali.
- Nagłówki tabeli, podpis, kolejność czytania, odpowiedniki tekstowe i przepływ na urządzeniach mobilnych są dostępne.
- Dane strukturalne, jeśli występują, są zgodne z widocznym podmiotem, autorem, oceną i skalą oraz kwalifikują się dla danego typu strony.
- Wybrany typ wpisu występuje w
postTypes, a otaczający artykuł dostarcza szczegółowych dowodów.
FAQ
Czy każdy scorecard wymaga ważonych kryteriów?
Każdy scorecard musi określać, w jaki sposób kryteria wpływają na wynik końcowy. Równe ważenie jest dopuszczalne, ale również musi być ujawnione. Jeśli niektóre kryteria mają większe znaczenie, opublikuj każdą wagę i upewnij się, że sumują się do 100%.
Ile kryteriów powinien zawierać scorecard?
Użyj od trzech do siedmiu. Cztery lub pięć zwykle zapewnia wystarczające pokrycie bez tworzenia fałszywej precyzji. Jeśli ocena wymaga więcej niż siedmiu, pogrupuj szczegółowe punkty kontrolne pod mniejszą liczbą ocenianych kryteriów i opublikuj pełny rubrykator osobno.
Czy scorecard może używać miejsc dziesiętnych?
Tak, gdy dane wejściowe i obliczenia to uzasadniają. Domyślnie pokazuj nie więcej niż jedno miejsce dziesiętne w wyświetlanym wyniku całkowitym, podaj zasadę zaokrąglania i nigdy nie dodawaj miejsc dziesiętnych tylko po to, by subiektywna ocena wyglądała na zmierzoną.
Czy recenzje użytkowników mogą zasilać redakcyjny scorecard?
Tylko jako wyraźnie nazwane dane wejściowe z ujawnionym źródłem, wielkością próby, okresem zbierania i wkładem w formułę. Nie zmieniaj etykiety oceny użytkownika zewnętrznego na ocenę redakcyjną ani nie łącz jej po cichu z wynikami testów.
Czy scorecard kwalifikuje się do schematu review lub rating?
Nie automatycznie. Oznaczenie ratingowe jest odpowiednie tylko wtedy, gdy strona ocenia kwalifikujący się, jasno zidentyfikowany podmiot, a widoczna ocena, skala, autor i treść wspierająca spełniają odpowiednie wymagania dotyczące danych strukturalnych.
Więcej samouczków w tej sekcji
Gotowy, aby zastosować to w praktyce?
Bezpłatne sprawdzenie · 7-dniowy okres próbny · bez karty kredytowej