Водич за тестирање на игри на табла: Како да тестирате рамнотежа како професионалец

После 25 години развивање на Neutronium: Parallel Wars и извршување на 12+ документирани сесии за тестирање на репродукција, можам да ви ја кажам разликата помеѓу тестирањето за играње и QZQZXQXA-тестовите за репродукција. Барањето пријатели да ја играат вашата игра не е тестирање. Тоа е дружење со вашата игра на маса. Професионалното тестирање за игра е систематска валидација на рамнотежа - дефинирана метрика, тестирање со една променлива, структурирано собирање податоци и дисциплина секоја сесија да се третира како експеримент наместо како искуство.

. Принципите важат за секоја сложена игра. Примерите потекнуваат од 47 механика на Neutronium: Parallel Wars и 13 нивоа на универзумот, кои обезбедија доволно сложеност за стрес-тестирање на секоја методологија опишана овде.

Зошто повеќето тестирања за репродукција не успеваат

Единствената најчеста грешка при тестирањето за играње: прашување „дали беше забавно?“ на крајот од сесијата. „Забава“ е премногу широка за да може да се дејствува. Забавата не може да ви каже кој механичар ја нарушил рамнотежата. Забавата не може да ви каже во кој момент од сесијата ангажманот паднал. Забавата е заклучок, а не дијагноза.

Наместо тоа, измерете специфична метрика: стапка на победа по фракција, превртува во прв конфликт, QZXA0006 различни средна игра, Должина на сесија по фаза. Овие бројки ви кажуваат каде да барате. „Забава“ не ви кажува ништо за што веќе не сте се сомневале.

Студија на случај

Снежната топка Nuclear Port — Универзум 7

Nuclear Port во Neutronium: Parallel Wars генерираат експоненцијален приход: 1 порта дава 2 Nn по круг, 10 порти даваат 220 Nn по круг. Во раните сесии, учесниците на играта ја опишаа економијата како „чувство на неурамнотеженост“. Не е корисно. Поправката бара мерење: која беше вистинската разлика Nn помеѓу лидерот и последното место на крајот на Universe 6?

Следењето

MEQA откри сооднос меѓу лидерот и последниот приход од 14:1 во седмата сесија - лидерот има акумулирано 6 порти, играчите кои заостануваат имаа 0. Тоа не е „неурамнотежено чувство“. Тоа е дефинирана бројка што го надминува прагот за контрола на квалитет 5:1 и предизвикува задолжителна промена на дизајнот. Без тоа мерење, поправката ќе беше претпоставка. Со него, поправката беше насочена: да се направат пристаништата уништливи за време на борба. Формулата за приходи е непроменета. Проблемот е решен.

Основниот неуспех на неструктурираното тестирање за играње: без дефинирани метрики, не можете да разликувате проблем со дизајнот од адаптација на играч. Искусните играчи се прилагодуваат на скршената механика - тие градат стратегии околу скршеноста, престануваат да се жалат на тоа и прават да изгледа како „начинот на кој се игра играта“. Мерењето открива што крие однесувањето.

Преглед на рамката MEQA

За Neutronium: Parallel Wars, методологијата за систематско тестирање за играње е рамката MEQA - структура со четири столба развиена во текот на 25 години повторување. Секој столб се однесува на различна категорија на потреби за тестирање:

M

Мерливост

Секоја сесија има дефинирани нумерички метрики следени пред да започне сесијата. Коефициенти на приход, стапки на добивки, број на територии, должина на сесија по фаза.Ако не можете да дефинирате број за него, не можете да го тестирате.

E

ангажман

Следено темпо по ниво на универзум. Времето по фаза открива каде играчите се откачуваат пред повратните информации по натпреварот. Паузите за внимание кај помладите играчи се мерливи неуспеси во ангажманот.

Q

Контрола на квалитет

Дефинирани прагови за поминување/неуспех за секоја метрика, поставени пред да се соберат какви било податоци. Преминувањето на прагот предизвикува промена во дизајнот - отстранување на субјективноста од „кога нешто е доволно скршено за да се поправи?“ прашање.

A

Прилагодливост

Metrics следена низ различни групи играчи: опсег на возраст, нивоа на искуство, број на играчи. Механичар кој е избалансиран за искусни возрасни лица може катастрофално да пропадне со групи на мешана возраст.

Целосната методологија на рамката MEQA - вклучително и специфичните метрики што се користат за Neutronium: Parallel Wars и системот за праг на QC - е детално документирана на MEQA Рамка за играње методологија за тестирање: A Биланс. Овој водич се фокусира на практичната апликација на ниво на сесија.

Поставување сесија за тестирање за игра

Професионалните сесии за тестирање на игра имаат три фази: поставување пред сесијата, набљудување за време на сесијата и структуриран дебриф по сесијата. Секоја фаза има специфични барања што повеќето неформални тестови за играње целосно ги прескокнуваат.

Претсесија: Дефинирајте точно една механичка промена што ја тестирате. Запишете го пред да пристигнат играчите. Ако не можете да наведете „денес тестираме дали со тоа што Nuclear Port може да се уништат, се намалува соодносот меѓу лидерот и последниот приход под 5:1“ - не сте подготвени да извршите сесија. Хипотезата мора да биде специфична и фалсификувана. Запишете ја основната метрика од претходната сесија за директна споредба.

За време на сесијата: Назначете еден набљудувач кој НЕ игра. Задачата на набљудувачот е да снима: должина на сесија по фаза, време на одлучување по вртење (просечно), какви било моменти на конфузија или исклучување, состојба на победа/пораз по фракција по универзум. Набљудувачот не учествува во играта, не објаснува правила и не одговара на прашања - ако играчот има прашање, тоа се податоци. Снимете што ги збунило и зошто.

Известување по сесијата: 15 минути максимум. Само структурирани прашања - специфични прашања за однесувањето, а не „дали уживавте? Погледнете го делот ЧПП за точните прашања што треба да ги користите.Соберете писмени одговори кога е можно - вербалните одговори ги губат деталите и воведуваат социјална пристрасност (играчите не сакаат директно да му кажат негативни работи на дизајнерот).

Податоци за собирање на секоја сесија без исклучок:

  • Должина на сесија по ниво на универзум
  • Победа/загуба по фракција
  • Сврти брои до првата борба
  • Разлика во приходот помеѓу лидерот и играчот што следи во средината на играта
  • Број на настани за збунетост на играчите (дефиниран како: играчот поставува прашање за правила или презема незаконско дејство)

Identifying Balance Problems

Проблемите со рамнотежата спаѓаат во пет категории, секоја со посебен сигнал во податоците:

Лидер за бегство: сигнал — водечкиот играч никогаш не изгубил по Universe 5 во 3 од 4 сесии. Праг: ако лидерот победи од позицијата што ја имаше во Универзум 4 во повеќе од 70% од сесиите, играта ефективно завршува на Универзум 4. Истражете ја механиката на приходите и територијата во универзумите 1–4.

Анализа парализа: сигнал — просечното време на одлучување по вртење се зголемува додека универзумите напредуваат побрзо отколку што налага сложеноста на одлуката. Просечното вртење од 5 минути во Универзумот 3 што станува просечно вртење од 20 минути во Универзумот 6 со само 2 додадени нови механики сугерира проблем на механичка интеракција, а не проблем на сложеност. Истражете кои конкретни одлуки одземаат најмногу време.

Доминација на фракцијата: сигнал — една фракција добива 60% или повеќе од сесиите на 5 или повеќе тестови. Очекуваната стапка на победа во балансирана игра со 4 фракции е приближно 25%. Со 60%, фракцијата не е само подобра - таа има структурна предност што другите фракции не можат да ја надминат со подобра игра. Истражете ја уникатната механика на доминантната фракција за непредвидени ефекти на интеракција.

Паѓање на ангажманот: сигнал - играчите стануваат пасивни или видливо исклучени во одреден универзум. Набљудувачко однесување: играчите ги проверуваат телефоните, го тргаат погледот од таблата, прашуваат „кога е мојот ред?“ Ова се мерливи настани. Запишете кога се појавуваат и кој универзум бил во тек.

Студија на случај — доминација на фракции

Iit Економска нерамнотежа во универзумот 6+

Iit, економската фракција, освои 7 од 10 сесии во Universe 6 и погоре поради акумулација на приход Nuclear Port. Податоците беа јасни: стапка на добивка од 70%, 4× над очекуваните 25% од основната линија. Беа тестирани три поправки, по една по сесија, следејќи го правилото за една променлива.

Test 1: Намалете ги Nuclear Port вредностите на приходот. Резултат - стапката на победа Iit падна на 28%, во прифатлив опсег. Проблем: играчите на Iit пријавија дека фракцијата се чувствува „шуплива“ со намалена вредност на портата. Економскиот идентитет беше уништен. Враќање.

Test 2: Limit Nuclear Port count per player. Резултат — стапка на победа Iit 35%, поблиску до избалансирана. Проблем: играњето доцна ја изгуби својата економска динамика на ескалација. Други фракции објавија помалку интересни одлуки кога Iit не ​​можеше да се размери. Враќање.

Test 3: Направете Nuclear Port-ови уништливи за време на борба. Резултат - стапка на победа Iit 31%, во прифатлив опсег. Нема негативни ефекти врз другите фракции. Формулата за приход на пристаништето е непроменета - економскиот идентитет зачуван.Поправка е потврдена.

Правило со една променлива

Правилото за една променлива е најважниот принцип при тестирањето на рамнотежата и најчесто прекршуваниот принцип. Правилото: променете точно една работа помеѓу сесиите.

Причината е дијагностичката јасност. Ако промените три механика и играта се подобри, не знаете која промена е одговорна. Можеби сте решиле еден проблем и сте создале други два кои сè уште не се појавиле. Можеби сте поправиле некој симптом и сте ја оставиле основната причина на место. Не можете да знаете - затоа што сте промениле три работи истовремено.

се примени на Neutronium: Parallel Wars: кога Universe 7 се чувствуваше „премногу брзо“ - сесиите траеја пократки од очекуваното, а играчите се чувствуваа избрзани - три можни причини беа истражени во одделни сесии:

  • Сесија A: Проширено темпо — додаде уште еден дополнителен циклус на збогатување на Universe 7. Резултат: должината на сесијата се зголеми за 8 минути. Резултатот од ангажманот е непроменет. Не е основната причина.
  • Сесија B: Дополнителна механика додадена во Universe 7. Резултат: должината на сесијата се зголеми за 5 минути. Резултатот на ангажманот се зголеми. Идентификувана делумна причина.
  • Сесија C: Ја преуреди постојната механика за порамномерно да ја дистрибуира густината на одлуката. Резултат: должината на сесијата се зголеми за 6 минути И резултатот на ангажманот значително се зголеми. Утврдена е основната причина - механичкото групирање на крајот од универзумот создаде избрзани завршетоци.

Без тестирање на секоја промена посебно, увидот на сесијата C - проблемот со механичкото кластерирање - би бил невидлив. Комбинираната промена на B+C можеби изгледаше како „додавањето механика помогна“, кога вистинската поправка беше преуредување на она што веќе беше таму.

Честа грешка: Водење на сесија каде што сте смениле „само две мали работи“. Нема мали промени во играта со меѓузависна механика. Секоја промена е потенцијално променлива. Посветете се на една по сесија.

Тестирање со мешани групи на искуство

Најтешкиот предизвик за рамнотежа во дизајнот на друштвени игри не е рамнотежата на фракциите или скалирањето на приходите - тоа е обезбедување на искусните играчи да не доминираат тривијално со новите играчи во истата сесија. Повеќето дизајнери на игри целосно го игнорираат ова и ја губат својата фамилија и обична публика.

За Neutronium: Parallel Wars, столбот за приспособливост MEQA експлицитно ги следеше стапките на добивка во сесии со мешано искуство. Пред да се решат проблемот, искусните играчи освоија 78% од сесиите во мешани групи - сериозна нерамнотежа што ќе ги спречи новите играчи да се вратат на сесија 2.

Решението беше системот за хендикеп Progress Journal: искусните играчи кои претходно освоиле универзум започнуваат со негативен баланс Nn пропорционален на нивната предност во искуството. Калибрацијата дојде од податоците на сесијата MEQA:

Одиграни сесии (искусен играч) Почетен хендикеп Стапка на добивка за пост-хендикеп (exp.плеер)
1–3 сесии−5 Nn54%Q5XZXA
4–7 сесии−10 Nn52%
8+ сесии−15 Nn51%Q6QZXA

Целта за стапка на добивка со искусни наспроти нова е 55–65%. Под 55% значи дека нема значајно изразување на вештини - искусните играчи немаат предност од нивното знаење. Над 65% значи дека новото искуство на играчот е ефективно прекинато - тие не можат да се натпреваруваат без оглед на донесените одлуки.

Идентификување празнини во искуството во податоците: следете го бројот на сесии за секој играч заедно со податоците за победа/пораз. Ако играчот со 10 сесии добива 75% од игрите против играчите со 2 сесии, калибрацијата на хендикепот треба да се приспособи - или самите механичари создаваат неповратни предности кои се комбинираат премногу брзо.

„Крепа од 12 сесии“ во Neutronium: откако играчите на домаќините собраа 12+ сесии, играта стана недостапна за новите играчи кои се приклучија за прв пат. Јазот во знаењето на механичарот беше преголем за да се премости преку нормална игра. Поправете: системот Progress Journal, кој ја направи видлива разликата во искуството и примени пропорционална корекција. Без податоците што ја покажуваат конкретно карпата од 12 сесии, овој проблем би се појавил како „нови играчи не се враќаат“ наместо „новите играчи на сесија 1 со домаќини од 12 сесии имаат стапка на победа од 23%.“

Кога да престанете да го репродуцирате тестирањето

Една од најчестите грешки во развојот на друштвени игри е играњето тестирање на неодредено време - користејќи „сè уште играме тестирање“ како причина да се избегне испораката. Ова е одговор на страв облечен како строгост. Во одреден момент, податоците ви кажуваат дека сте готови.

Тестот за намалување на : ако три последователни сесии за тестирање за играње не произведат акциони точки на податоци — ниту една метричка не го преминува прагот на КК, не се снимаат нови настани за конфузија, ниту падовите на ангажманот не сте ја достигнале моменталната состојба на играње на играта — сте ја достигнале моменталната состојба на играње на играта. Дополнителните сесии даваат потврда, а не откривање.

Критериумите за подготвеност за брод на

Neutronium: Parallel Wars се:

  1. Стапката на победа кај сите 4 фракции е во рамките на 10% од еднаква (цел: 25% секоја, прифатлив опсег: 22–28% по фракција)
  2. Резултатот за ангажман останува над 4 од 5 во сите сесии на универзумите 1–6
  3. Нема збунувачки настани снимени во 3 последователни сесии на универзумите 1–3 (главната игра)
  4. Стапка на добивка со мешано искуство (искусно наспроти ново) во опсег од 55–65% во 3 последователни сесии

Кога сите четири критериуми се исполнети во три последователни сесии, играта е во состојба на брод. Не е совршено - „совршено“ не е значајна состојба за игра. Состојбата на бродот значи дека податоците повеќе не ги идентификуваат подобрувањата што би го промениле искуството на играчот на мерлив начин.

Често поставувани прашања

Колку сесии за тест за играње ви се потребни пред да објавите игра на табла?
Минимум 10–15 сесии со различни групи за игра со мала сложеност. За сложени игри со повеќе фракции и длабока механика, 30-50+ сесии се пореални.Neutronium: Parallel Wars имаше 12+ документирани сесии за валидација на рамнотежа - одделно од 25 години невообичаена игра за развој. Бројот е помалку важен од квалитетот: 12 структурирани сесии со дефинирана метрика произведуваат повеќе активна податоци од 100 неструктурирани сесии каде што сте прашале „дали беше забавно?“
Дали дизајнерот треба да игра на тестови за играње?
Не, за тестирање на конкурентна рамнотежа. Присуството на дизајнерот го менува однесувањето на играчите на два начина: играчите му поставуваат прашања на дизајнерот наместо да снимаат збунувачки настан, а играчите ги ублажуваат нивните повратни информации за да избегнат да изгледаат критични. Водете сесии само за набљудувачи за тестирање на рамнотежа - дизајнерот гледа, снима податоци и не учествува. Дизајнерот може да игра во случајни сесии за повратни информации, но тие сесии не треба да бидат примарен извор на податоци за билансот.
Како пишувате добри прашања за тестирање за играње?
Избегнете „дали уживавте во ова? — премногу нејасни и социјално пристрасни кон позитивни одговори. Користете специфични прашања за однесувањето: „Во кој момент сметавте дека вашата стратегија повеќе не е остварлива? открива кога не успее механиката за привлекување. „Кога решивте да се префрлите од проширување во одбрана? открива динамика на темпо и притисок. „Која одлука се чувствуваше најнејасна во нејзините последици? идентификува механика на која им недостасува видлива повратна информација. Прашањата за однесување откриваат механички проблеми; прашањата за претпочитање откриваат проблеми со темата. Тие се посебни категории и им требаат посебни прашања.
Кои алатки ги користат професионалните дизајнери на игри за тестирање?
Tabletop Симулатор за далечински сесии и управување со верзии — ви овозможува да се вратите на претходните верзии на играта без да изгубите време за физички прототип. Google Листови за следење на податоците од сесиите — креирајте образец пред сесија 1 и пополнете ги истите колони секоја сесија. Хартиени прототипови (никогаш дигитални макети) за рано физичко тестирање - физичките токени откриваат ергономски проблеми што ги кријат дигиталните макети, вклучително и брзината на ракување со компонентите, видливоста во услови на игра и чувството на цена на одлуката кога физички ги положувате токените. Гласовни снимки од дебрифинзи по сесијата за подоцнежен преглед - играчите честопати кажуваат важни работи ненамерно што белешката ги промашува во моментот.

Прочитајте ја целосната рамка MEQA

Целосната методологија MEQA - вклучувајќи ги праговите за QC, метричките дефиниции и целосната студија на случај Nuclear Port - е документирана во статијата за рамка MEQA.

Прочитајте ја рамката MEQA →