Не работает сервер: что должен делать директор, пока проблему решают специалисты

Сервер недоступен, 1С не открывается, сотрудники один за другим пишут в общий чат «а у вас тоже не работает?». В этот момент директору не нужно разбираться в индикаторах на корпусе сервера или лезть в серверную самому: этим займется специалист.

Но есть вещи, которые в этой ситуации реально зависят именно от руководителя, и то, насколько грамотно он их сделает, часто определяет, обернется ли авария часом простоя или целым потерянным днем.

Разберем, что конкретно должен делать директор или собственник в момент сбоя сервера, а что стоит сразу передать техническому специалисту, не тратя на это время.

Не звонить сразу пяти разным людям

Первая инстинктивная реакция при массовом сбое: одновременно писать в чат сисадмину, звонить знакомому айтишнику и параллельно набирать подрядчика, чтобы уж наверняка кто-то откликнулся быстрее.

На практике это только замедляет решение проблемы: несколько человек начинают параллельно и без координации лезть в одну и ту же систему, мешая друг другу, а директор тратит время не на управление ситуацией, а на пересказ одного и того же разным людям.
Правильное действие простое: обратиться к одному ответственному, тому, с кем заранее согласована ответственность за инфраструктуру, будь то штатный специалист или подрядчик на аутсорсинге, и дать ему время на диагностику, прежде чем подключать кого-то еще.

Дать специалисту точную информацию

Роль директора на старте не в том, чтобы чинить сервер, а в том, чтобы быстро собрать и передать специалисту информацию, которая реально ускоряет диагностику.

Полезно зафиксировать точное время, когда проблема началась, у всех ли сотрудников она возникла одновременно или только у части, и что именно происходит: сервер полностью недоступен, отдельные программы не открываются, или сеть работает, но медленно.

Фраза «у нас все сломалось» специалисту почти ничего не дает и вынуждает его тратить время на вопросы, которые директор мог выяснить заранее за пару минут, просто спросив сотрудников в общем чате.

Решить, что критично восстановить в первую очередь

Пока специалист занимается диагностикой, у директора есть время принять управленческое решение, которое технический специалист сам принять не может: что для бизнеса критично восстановить в первую очередь, если полное восстановление займет несколько часов.

Для розничной компании это может быть касса и складской учет, для сервисной компании: доступ к CRM с клиентами, для бухгалтерии: конкретные отчетные периоды перед сдачей отчетности.

Без этого решения специалист вынужден либо восстанавливать все подряд без приоритетов, теряя время, либо угадывать, что важнее для бизнеса именно сейчас, что не его зона ответственности.

Держать сотрудников в курсе

Пока проблема решается, сотрудники обычно продолжают писать в общий чат с вопросами, отвлекая и друг друга, и тех, кто занят решением проблемы.

Простое короткое сообщение от руководителя, что проблема известна, ей занимаются, и примерное время, когда будет следующее обновление, снимает большую часть этого шума и не дает панике распространиться по компании.

Не обязательно давать точные технические подробности или обещать конкретное время восстановления, если оно еще не известно. Достаточно самого факта, что ситуация под контролем и кто-то ей занимается.

Не давить на специалиста ускорением через панику

Когда простой длится дольше, чем ожидалось, естественное желание руководителя: постоянно спрашивать «когда заработает» и требовать ускориться. На практике это чаще замедляет решение, чем ускоряет его: специалист вынужден отвлекаться на объяснения статуса вместо того, чтобы заниматься непосредственно восстановлением.
Более продуктивный подход: договориться заранее об определенных контрольных точках, например «сообщи через 30 минут, даже если результата пока нет», и держаться этой договоренности, а не писать каждые пять минут.

После восстановления: разбор причины, а не просто облегчение

Когда работа восстановлена, велик соблазн просто выдохнуть и вернуться к обычным делам. Но именно в этот момент стоит задать специалисту несколько конкретных вопросов: в чем была причина сбоя, можно ли было ее предотвратить заранее, и что нужно изменить, чтобы подобная ситуация не повторилась или, если повторится, восстановление прошло быстрее.

Практический вопрос, который директору стоит задать отдельно: зависело ли восстановление от одного конкретного человека, и что случилось бы, если бы этот человек оказался недоступен в момент аварии.

Ответ на этот вопрос часто вскрывает риски, которые незаметны, пока все работает штатно, и которые стоит закрыть до следующего инцидента, а не после него.

Итог

Директору в момент сбоя сервера не нужно разбираться в технических деталях восстановления: для этого есть специалисты.

Но управленческие решения в этой ситуации, а именно кому звонить, что передать специалисту, что восстанавливать в первую очередь, как информировать команду и что спросить после инцидента, целиком остаются на руководителе, и именно от них часто зависит, во сколько компании реально обойдется простой.

Смотрите также