Telecobra, 2026-10-06. Документальные профили, не результаты GPU-тестов.
Нужны Linux, совместимый NVIDIA-драйвер, Docker + NVIDIA Container Toolkit.
На выделенном стенде: venv, pip install -r requirements.txt.
Выберите одну модель: python prepare.py PROFILE; bash PROFILE.sh.
API: http://127.0.0.1:8000/v1, model=telecobra-model.
Для нескольких узлов используйте один JSON-lock, скопированный с узла 0:
python prepare.py PROFILE --lock /path/to/lock.json
NODE_RANK=1 HEAD_ADDR=PRIVATE_HEAD_IP NODE_IP=PRIVATE_WORKER_IP bash PROFILE.sh
Qwen: четыре узла, Inkling: два; на каждом восемь GPU.
Ранги от нуля, HEAD_ADDR одинаков. Порты кластера только в приватной сети.
Не ставит драйвер, не открывает порты, не обращается к Telecobra.
Полные веса; контекст проверки 32K, одновременных запросов четыре.
Сохраните locks и результаты собственной приёмки перед постоянным запуском.
