Tapaustutkimus: Hathora säästää miljoonia yhdistämällä pilven ja bare metal -palvelimet

By Kevin Casey

Hathora luotti aluksi täysin AWS-pilvi-infrastruktuuriin moninpelialustansa skaalaamisessa, mutta korkeat kustannukset uhkasivat sen suurinta asiakassegmenttiä. Siirtymällä hybridimalliin, jossa käytettiin bare metal -palvelimia ja pilvipalveluita strategisesti, Hathora pienensi kuluja merkittävästi, paransi suorituskykyä ja saavutti valtavan maailmanlaajuisen skaalautuvuuden.

Key Takeaways

Kunnianhimoiset tavoitteet kohtaavat pilvipalveluiden realiteetit: Hathora tavoitteli nopeaa kasvua tukeutumalla pilvi-infrastruktuuriin. Se isännöi palvelujaan AWS:ssä Kubernetesin avulla ja palveli pelinkehittäjiä pienistä tiimeistä suuriin pelistudioihin.

MMO-markkinat: miljardien dollarien leikkikenttä: MMO-pelimarkkinoiden ennustetaan kasvavan lähes 30 miljardilla dollarilla vuoteen 2029 mennessä, mikä tarjoaa Hathoran kaltaisille yrityksille valtavia mahdollisuuksia mutta aiheuttaa myös vakavia infrastruktuurihaasteita.

Menestys ja paine: liikaa liian nopeasti: Yli 100 pelistudiota otti Hathoran alustan nopeasti käyttöön, mutta suurempien asiakkaiden vaatimukset paljastivat pelkästään pilvipalveluihin perustuneen lähestymistavan rajoitukset ja korkeat kustannukset.

Strategian uudelleenarviointi: kantapään kautta oppiminen: Ymmärrettyään infrastruktuurinsa puutteet Hathoran tiimi arvioi liiketoimintasuunnitelmansa uudelleen löytääkseen kestävät tavat tukea suuria pelistudioita ja tehdä niiden palvelemisesta kannattavaa.

Oppeja teknologiajohtajille: sopeutuminen skaalautuvuuteen: Hathoran kokemus opettaa teknologiajohtajille infrastruktuurin skaalautuvuuden merkityksen sekä sen, kuinka pilvipalveluiden kustannukset ja kasvustrategiat on tasapainotettava.

Joskus juuri sama infrastruktuuri, joka auttaa saavuttamaan onnistuneen julkaisun, päätyy muodostumaan esteeksi liiketoiminnan kohotessa korkeuksiin.

Hathoran tapauksessa tämä oli sekä kirjaimellisesti totta että hieman ironista: yritys tarjoaa videopelistudioille kriittistä infrastruktuuria ja palvelinten orkestrointia moninpelattavien verkkopelien isännöintiin ja skaalaamiseen.

Useimmilla mittareilla kyseessä on valtava markkina. Esimerkiksi tutkimusyhtiö Technavio ennusti, että massiivisten monen pelaajan verkkopelien (MMO) markkinat kasvavat lähes 30 miljardilla dollarilla vuosien 2025 ja 2029 välillä. Myös muut analyytikot ennustavat vastaavaa kasvua seuraavien noin viiden vuoden aikana.

Hathora halusi julkaista ja skaalata alustansa nopeasti, joten se noudatti monille startup-yrityksille, pienille tiimeille ja muille yrityksille yleistynyttä toimintamallia: se panosti täysin pilvipalveluihin ja ajoi kaiken Amazon Web Services -palvelussa käyttäen EKS:ää, pilvipalvelujätin täysin hallinnoitua Kubernetes-palvelua. Sen tavoitteet vaikuttivat rajattomilta: Hathora halusi palvella kaikenkokoisia pelinkehittäjiä pienimmistä tiimeistä suurimpiin studioihin ja kaikkia siltä väliltä.

Ja se toimi – tiettyyn pisteeseen asti. Yli 100 pelistudiota otti Hathoran alustan käyttöön kuuden kuukauden kuluessa sen ensimmäisestä julkaisusta. Alkuvaiheen menestys paljasti perustavanlaatuisen ongelman, kun otetaan huomioon Hathoran tavoite palvella kaikenkokoisia pelistudioita eri puolilta maailmaa: kun yritys alkoi työskennellä yhä suurempien studioiden kanssa, sen ainoastaan pilvipalveluihin perustuvan infrastruktuurin talous muuttui nopeasti kestämättömäksi – niin pahasti, että se oli vaarassa menettää suuren ja tuottoisan osan koko markkinasta.

Tässä tapaustutkimuksessa tarkastelemme ensikäden tietojen avulla, kuinka Hathoran teknologiajohtaja ja tiimi muuttivat alkuperäistä liiketoiminta- ja teknologiastrategiaansa mahdollisesti dramaattisin tuloksin – sekä mitä oppeja tästä voidaan saada muiden alojen teknologiajohtajille.

Yritys & teknologiajohtaja

Yritys: Hathora, maailmanlaajuinen kriittisen infrastruktuurin ja palvelinten orkestroinnin tarjoaja videopelejä kehittäville studioille niiden moninpelattavien verkkopelien isännöintiin.

Teknologiajohtaja: Harsh Pandey, joka on myös yrityksen perustaja:

“Rakensimme Hathoran antaaksemme kaikenkokoisille pelistudioille pääsyn maailmanlaajuisen mittakaavan infrastruktuuriin ilman, että niiden tarvitsee rakentaa sitä itse. Mutta kun aloimme laskea suurempien studioiden hintoja, taloudellinen yhtälö ei enää toiminut. Pilvipalveluiden kustannukset, erityisesti datan siirtämisestä pois palvelusta aiheutuvat kulut, tekivät tarjonnastamme kestämättömän juuri sellaisille asiakkaille, joita halusimme palvella.”

Pääkonttori: New York

Asiakaskattavuus: Nykyään Hathora palvelee (kirjaimellisesti) asiakkaita ympäri maailmaa 14 maailmanlaajuisella alueella kuudella mantereella.

Liiketoimintaongelma

Suuret tavoitteet tuovat yleensä mukanaan suuria haasteita, ja juuri näin kävi Harshille ja Hathoralle.

Osa tästä liittyy pelialan perusluonteeseen: MMO-pelit eivät ole pieniä perheyrityksiä, joiden liikennemäärät ovat ennustettavia. Moninpelien on sen sijaan tarjottava jatkuvasti päivityksiä jokaiselle yhteydessä olevalle pelaajalle samanaikaisesti ja erittäin suorituskykyisesti.

Tämä tarkoittaa valtavia tietomääriä, jotka liikkuvat säännöllisesti edestakaisin taustajärjestelmien ja yksittäisten pelaajien välillä. Suurimmissa peleissä pelaajia voi olla miljoonia. Ja jos pidät omia asiakkaitasi vaativina, sanotaan nyt vain, etteivät vakavat pelaajat välttämättä ole kovin kärsivällisiä pelin suorituskyvyn ja käyttäjäkokemuksen suhteen.

Pelipalvelinten työkuormien ajaminen Hathoran ainoastaan pilvipalveluihin perustuvalla alustalla toimi hyvin pienempien studioiden kohdalla. Kun suurempi studio kuitenkin lähestyi yritystä hinnoitteluun liittyen, Harsh ja tiimi ymmärsivät taloudellisen mallin rajoitukset.

“Tiesimme, että meidän oli ratkaistava haaste, kun pelipalvelinten isännöintialustamme avulla sisäisiä pelitestejä tekevä suuri pelistudio kysyi julkaisun hinnoittelusta”, Harsh kertoi meille. “Heidän ennakoitu kaistanleveyslaskunsa nousi yli miljoonaan dollariin kuukaudessa.”

Harshin mukaan tämä oli neljä kertaa pelin ajamisen normaalit odotetut laskentakustannukset. Se ei ollut kestävää studiolle eikä Hathoralle. Hathora joutui näin sanotusti tienhaaraan: se voisi pitäytyä alkuperäisessä, ainoastaan pilvipalveluihin perustuvassa strategiassaan ja ottaa riskin suuren studiokokoluokan segmentin menettämisestä tai tehdä muutoksen.

“Ratkaistava ongelma oli hinnoittelu, yksinkertaisesti sanottuna”, Harsh sanoo.

Ratkaisu oli kuitenkin tekninen: Hathoran täytyi muuttaa omaa infrastruktuuriaan vastaamaan paremmin pelipalvelinten työkuormien erityisvaatimuksia ja ottaa samalla käyttöön hinnoittelumalli, jonka myös suurimmat studiot voisivat helposti ottaa käyttöön.

Mitä he tekivät asialle ja miksi

Kaikenlaiset teknologia-alan ammattilaiset ovat kuulleet runsaasti puhetta infrastruktuurin ja työkuormien pilveen siirtämisen hyödyistä tai yksinkertaisesti pilvipohjaisen yrityksen perustamisesta. Tämä on ollut merkittävä suuntaus jo vuosien ajan, eikä Hathora ollut poikkeus.

Hathora lähti ratkaisemaan suurasiakkaisiin liittyvää ongelmaansa lähes päinvastaisesta suunnasta ottamalla käyttöön hybridipilvi-arkkitehtuurin ja tekemällä lopulta suuren panostuksen vanhaan luottoratkaisuun: paljasmetallipalvelimiin. 

(Tutustu artikkeliimme tästä uudemmasta suuntauksesta, jossa siirrytään pilviympäristöistä omissa tiloissa sijaitsevaan infrastruktuuriin.)

Harsh kertoo yrityksen kehityksestä:

”Siirryimme hybridimalliin ja seurasimme infrastruktuurikustannuksia samanaikaista istuntoa kohden, viivettä eri maailmanlaajuisilla alueilla sekä kaiken ylläpitämiseen tarvittavaa insinöörityötä. Siirtämällä 80 % työkuormistamme paljasmetallipalvelimille voimme lähes puolittaa laskentakustannukset ja pienentää kaistanleveyskustannuksia yli 90 %. Hallinnoimme nyt yli 30 000 ydintä 14 alueella suhteellisen pienen insinööritiimin voimin. Tällainen tehokkuus ja kattavuus olisi ollut mahdotonta alkuperäisellä arkkitehtuurillamme.”

He hyödyntävät edelleen pilvi-infrastruktuuria skaalautuvuuden ja kysyntäpiikkien hallintaan, mutta sen osuus työkuormista on noin 20 % aiemman 100 %:n sijaan. Hathoran teknologiapino tukeutuu nyt kahteen paljasmetallipalveluntarjoajaan sekä AWS:n ja GCP:n pilviresursseihin sen sijaan, että kaikki olisi AWS:ssä. Harsh ja hänen tiiminsä valitsivat Talos Linuxin, erityisesti Kubernetes-ympäristöihin suunnitellun minimalistisen jakelun, sekä Omnin (myös Sidero Labsilta) orkestrointiin yhdestä hallintatasosta kaikissa hybridipilviympäristöissä.

On sanomattakin selvää, ettei kyse ollut yhtä yksinkertaisesta asiasta kuin valokatkaisimen kääntäminen päälle tai pois päältä. Lisäksi huomioon oli otettava sekä hyviä että huonoja puolia. Pelkkään pilveen siirtyminen auttoi Hathoraa alun perin käynnistämään toimintansa nopeasti ja onnistuneesti. Tästä mallista luopuminen merkitsi ainakin aluksi joidenkin pilven tarjoamien etujen menettämistä:

”Muutoksen tekeminen merkitsi monien pilvialustojen tarjoamien mukavuuksien menettämistä”, Harsh kertoo. ”Menettäisimme helpon automaattisen skaalauksen, sisäänrakennetun valvonnan ja hallinnoidut palvelut. Tämä lisäsi operatiivista monimutkaisuutta. Meidän oli myös osoitettava, että pystymme vastaamaan pilven suorituskykyyn tai ylittämään sen. Ei ollut mitään takeita siitä, että löytäisimme tarvitsemamme tavalla toimivia toimittajia tai työkaluja. Uskomme kuitenkin, että kustannusten ja suorituskyvyn saaminen hallintaan oli liiketoimintamallimme kannalta välttämätöntä, ja olimme valmiita ottamaan tämän riskin.”

Panostus tuottaa tulosta ja tasoittaa tietä Hathoran seuraavalle kasvuvaiheelle: yritys palvelee nyt asiakkaita kuudella mantereella. Se pystyy tarjoamaan suurimmille studioille saman kriittisen infrastruktuurin huomattavasti aiempaa pienemmin kustannuksin. Se tarjoaa myös tarkemman hallinnan pelityökuormien ainutlaatuisiin vaatimuksiin (tämä on myös vaatimustenhallintaohjelmiston hyöty), sillä Talos Linux mahdollistaa solmutason hallinnan ja Omni yhtenäisen klusteriorkestroinnin riippumatta siitä, missä työkuormat suoritetaan.

”Nämä työkalut ovat minimalistisia, turvallisia ja helppoja käyttää erityyppisissä infrastruktuureissa”, Harsh sanoo. ”Arvioimme teknologiapinoamme suorituskyvyn, kustannusten ja säilyttämämme hallinnan perusteella. Uuden kokoonpanon ansiosta voimme toimia pienen tiimin voimin ja skaalautua maailmanlaajuisesti sitoutumatta yhteen toimittajaan.”

Hathoran pieni insinööritiimi onkin muodostunut eräänlaiseksi epäviralliseksi KPI-mittariksi. Se osoitti välittömiä suorituskyky- ja kustannushyötyjä siirrettyään ensimmäisen kokonaisen alueensa hybridimalliin ja skaalautui sen jälkeen nopeasti — nyt käytössä on 14 aluetta eri puolilla maailmaa.

”Aina kun joku saa tietää, että vain muutama insinööri hallinnoi infrastruktuuriamme, se vahvistaa konkreettisesti käsitystä siitä, miten pitkälle olemme päässeet.”

Keskeiset oivallukset & opit

Sinun ei tarvitse toimia digitaalisen infrastruktuurin tai videopelien alalla voidaksesi soveltaa vastaavia periaatteita ja oppeja omassa yrityksessäsi.

  • Kuuntele asiakkaitasi: Harsh ja hänen tiiminsä ymmärsivät, että heillä oli ongelma — ja että heidän oli ryhdyttävä ratkaisemaan sitä ennakoivasti — kuuntelemalla asiakkaitaan. Erityisesti suuri studio, joka oli käyttänyt Hathoraa sisäiseen testaukseen, kysyi myöhemmin kustannusarvioita siitä, mitä pelin ajaminen Hathoralla maksaisi. CTO:t ovat yhtä lailla vastuussa asiakkaiden ongelmien ratkaisemisesta kuin teknologiaratkaisujen rakentamisesta — nämä kaksi asiaa kulkevat käsi kädessä.
  • Älä pelkää muuttaa suuntaa. ”Pilvi ensin”, ”pilvinatiivi” ja vastaavia termejä tulisi pitää mukautuvina strategioina, ei pyhinä opinkappaleina. Sama periaate pätee laajemminkin: se, että aloitat tietyllä strategialla, ei tarkoita, että sinun on pitäydyttävä siinä ikuisesti. Hathora olisi voinut pysyä ennallaan ja pitäytyä kokonaan pilvessä, mutta se olisi rajoittanut sen kasvupotentiaalia ja viime kädessä sen infrastruktuurilla toimivien pelien suorituskykyä.

Hybridiin malliin siirtyminen mahdollisti sen, että yritys pystyi palvelemaan kaikenkokoisia asiakkaita ja parantamaan suorituskykyä, koska pelikuormitusten erityisvaatimuksiin voitiin vastata joustavammin ja hallitummin. Hathora on sittemmin pystynyt lanseeraamaan yritystason palvelun, joka tarjoaa suurimmille studioille ennakoitavan hinnoittelun ja vahvat suorituskykytakuut.

  • Analysoi huolellisesti. Tällaista muutosta ei voi toteuttaa arvailemalla. Harsh ja hänen tiiminsä tekivät Talosin ja Omnin kanssa kattavan konseptitodennuksen testatakseen strategisen muutoksensa:

"Kun olimme varmistaneet, että pystyimme orkestroimaan kaiken yhden järjestelmän kautta, siirsimme ensimmäisen kokonaisen alueemme uuteen ympäristöön. Suorituskyky parani välittömästi. Sen jälkeen otimme mallin käyttöön maailmanlaajuisesti ja lisäsimme toimittajia ja sijainteja työn edetessä”, Harsh sanoi.

Se analysoi hyödyt ja haitat – mukaan lukien pilven hyötyjen alkuperäisen menetyksen, jonka Harsh toi edellä esiin – yllätysten minimoimiseksi. Se tiesi, että sen oli löydettävä Kubernetes-yhteensopiva ratkaisu, joka pystyisi orkestroimaan kaiken useissa ympäristöissä ja alueilla sekä käsittelemään jokaista konetta olennaisesti samalla tavalla riippumatta siitä, toimiko se fyysisellä palvelimella vai pilvessä.

Harsh huomautti, että he perehtyivät myös perusteellisesti toimittajien vertailuun vertailemalla AMD:n ja Intelin suorittimia, testaamalla todellista verkon suorituskykyä ja arvioimalla toimittajia sen perusteella, kuinka hyvin ne suoriutuivat AWS:n Global Acceleratoria vastaan. 

”Varmistimme, ettei uusi kokoonpanomme ollut vain edullisempi, vaan myös nopeampi ja luotettavampi niillä alueilla, joilla sillä oli merkitystä.”

  • Ajattele pitkällä aikavälillä: Tämän kaltaiset mullistavat suunnanmuutokset eivät ole vain kertaluonteisten ongelmien ratkaisemista. Oikein toteutettuina ne avaavat jatkuvasti uusia mahdollisuuksia tulevaisuudessa. Pitkän aikavälin ajattelutapa tuottaa jo tulosta Hathoralle. Se jatkaa uusien ominaisuuksien kehittämistä suuremmille studioille, kuten omistettujen klusterivaihtoehtojen, alueellisen vertaisverkkoyhteyden pienen viiveen tiedonsiirtoja varten sekä reaaliaikaisten tapahtumien aikaisen tehostetun havainnoitavuuden kehittämistä.

Harsh sanoi myös, että Hathoran uusi pelialan infrastruktuurimalli osoittaa potentiaalista arvoa muilla toimialoilla, joilla tarvitaan reaaliaikaista reagointia ja suurta läpimenokykyä, ja että yrityksen pitkän aikavälin suunnitelmana on ottaa käyttöön uusia ratkaisuja pelialan ulkopuolisille kehittäjille.

”Hybridiin malliin siirtyminen antoi meille pitkän aikavälin joustavuutta. Voimme nyt siirtyä nopeasti uusille alueille, testata uusia laitteistotoimittajia ilman toimittajalukkoa ja antaa asiakkaille enemmän hallintaa siihen, miten heidän infrastruktuurinsa otetaan käyttöön. Alustasta on tullut paljon modulaarisempi ja mukautuvampi.”

Lisää tapaustutkimuksia ja toimintamalleja saat tilaamalla The CTO Clubin uutiskirjeen.

Kevin Casey
Kevin Casey is an award-winning technology and business writer with deep expertise in digital media. He covers all things IT, with a particular interest in cloud computing, software development, security, careers, leadership, and culture. Kevin's stories have been mentioned in The New York Times, The Wall Street Journal, CIO Journal, and other publications. His InformationWeek.com on ageism in the tech industry, "Are You Too Old For IT?," won an Azbee Award from the American Society of Business Publication Editors (ASBPE), and he's a former Community Choice honoree in the Small Business Influencer Awards. In the corporate world, he's worked for startups and Fortune 500 firms – as well as with their partners and customers – to develop content driven by business goals and customer needs. He can turn almost any subject matter into stories that connect with their intended audience, and has done so for companies like Red Hat, Verizon, New Relic, Puppet Labs, Intuit, American Express, HPE, Dell, and others. Kevin teaches writing at Duke University, where he is a Lecturing Fellow in the nationally recognized Thompson Writing Program.
Follow the author:

You may also like