Студент не может войти

Проверьте, что выдана ссылка /s/…, а не главная страница сервера или административный ключ. Если адрес содержит localhost, исправьте PUBLIC_URL. Проверьте HTTPS и доступ с другой сети, затем состояние relay/tunnel. Доступ преподавателя из своей сети не доказывает доступность из аудитории.

Кнопка недоступна

Прочитайте сообщение интерфейса. Проверьте завершение занятия, правила комнаты и замок отдельной ячейки. «Запускать код» ограничивает также файлы и терминал. Преподаватель может продолжить занятие или изменить нужное правило; переустановка сервера здесь не поможет.

Тетрадь открылась, а Python не запускается

sudo scripts/cluster.sh status
sudo scripts/cluster.sh logs
sudo k3s kubectl -n colloq get pods
sudo k3s kubectl -n colloq get events --sort-by=.lastTimestamp

Проверьте, работает ли брокер, доступен ли закреплённый image digest, хватает ли CPU/памяти/GPU и корректен ли mount workspace. ImagePullBackOff обычно требует проверки registry и прав, Pending — причин планирования в событиях. Health брокера проверяет доступ к API, а не весь путь исполнения.

Не заменяйте недоступную ревизию другой без осознанного решения и не подключайте комнаты к общему Jupyter. После устранения причины выполните sudo scripts/cluster.sh smoke и настоящую ячейку через приложение.

NameError или изменившиеся данные

Возможно, не выполнена подготовительная ячейка, ядро перезапустилось или другой участник изменил общие значения. Проверьте порядок запуска. В Консилиуме изменения объектов и файлов сохраняются между попытками; личные листы не создают личную память Python.

Не устанавливается пакет или не скачиваются данные

В production исходящая сеть ядра по умолчанию ограничена DNS, а root filesystem защищён от записи. Подготовьте библиотеку в образе окружения, а данные загрузите в комнату или используйте одобренный оператором outbound-профиль. Не отключайте сетевую защиту всего namespace ради одного импорта.

CUDA недоступна

Проверьте драйвер гостевой VM, NVIDIA RuntimeClass, allocatable devices, наличие свободного устройства и GPU-метаданные каталога. CPU-окружение само не становится GPU-окружением.

nvidia-smi
sudo k3s kubectl get runtimeclass
sudo k3s kubectl describe node
sudo scripts/cluster.sh gpu-preflight

Если GPU занят комнатой, preflight не выселяет её. Повторите проверку в согласованное время со свободной картой. Реальное выполнение CUDA необходимо даже при корректном nvidia-smi.

Оракул молчит

Проверьте выбор оракула при создании, лимит участника, паузу между вопросами и статус завершения занятия. Владелец проверяет provider URL, модель, ключ и доступ приложения к API. Ошибка провайдера не означает поломку Python-ядра. Не отправляйте секреты в диагностический чат.

Заканчивается диск

Проверьте раздел с /var/lib/colloq и место под резервные копии. Upload-лимиты приложения не являются квотой для Python. Сначала определите источник роста, сохраните нужные материалы и только затем очищайте данные. Не удаляйте вручную каталог активной комнаты или образы, на которые ссылается каталог.

Запуск заблокирован после restore

Проверьте сообщение о .restore-in-progress. Повторите тот же проверенный restore с флагами recovery, описанными в руководстве. Снятие маркера вручную может запустить приложение над частично восстановленными данными.

На странице чтения нет файлов или новых правок

Это ожидаемо: публикация содержит выбранные версии ячеек и выводов, а не файлы комнаты. После изменения живой тетради выполните повторную публикацию. Если ссылка снята с публикации, вернуть её может преподаватель; права комнаты /s/… от этого не меняются.

Что приложить к сообщению о проблеме

Укажите версию выпуска, время, шаги воспроизведения, ожидаемый и фактический результат. Добавьте статус компонентов и относящиеся к сбою события. Уберите административные ссылки, ключи, персональные данные и ненужный вывод ячеек. На Vast используйте NAME=hse SINCE=30m make vast-logs; логи удалённых Pod могут уже отсутствовать.