Инструмент upskill: передача экспертных навыков генерации CUDA-ядер от Claude к открытым LLM
Фреймворк upskill позволяет обучать локальные open-source модели сложным доменным задачам через генерацию контекстных скиллов силами крупных LLM, снижая затраты на инференс.
Вышел новый фреймворк upskill, предназначенный для создания, тестирования и внедрения специализированных навыков (agent skills) для языковых моделей. Идея заключается в том, чтобы использовать мощные фронтиерные модели (например, Claude) в роли «учителя» для генерации контекста, инструкций в Markdown и скриптов, которые затем помогают компактным open-source моделям справляться со сложными узкоспециализированными задачами. В качестве демонстрации разработчики протестировали инструмент на одной из самых хардкорных задач для AI — написании и оптимизации CUDA-ядер для диффузионных моделей. Основные моменты подхода: * Перенос контекста: Навыки оформляются в виде понятных файлов (инструкции и код), которыми легко делиться и ревьюить. * Оценка эффективности: Инструмент `upskill` автоматически генерирует тест-кейсы на основе трафика работы агента и сравнивает производительность модели с подключенным навыком и без него. * Оптимизация расходов: Подход позволяет задействовать более дешевые и компактные локальные модели для решения задач, которые раньше требовали вызова тяжелых флагманских LLM. 💡 Где захостить и как запустить: Рассчитать точный VRAM под кванты этой модели, скорость генерации (токенов/сек) и выбрать подходящий сервер с GPU можно у нас на ServerSales в калькуляторе AI-моделей (/ai) или каталоге GPU (/gpu).
Планируете развернуть эту нейросеть?
На ServerSales вы можете рассчитать точные требования к VRAM под разные типы квантования (4-bit Q4 / FP8 / FP16), оценить скорость генерации (токенов/сек) и сразу подобрать проверенный сервер с GPU от ведущих провайдеров.
Надежные облачные платформы и серверы в РФ
Крупнейший IaaS-провайдер РФ: облачные VPS, Bare Metal серверы и GPU-кластеры для ИИ.
Скоростные VPS от 299 ₽/мес, почасовая тарификация, готовые образы и GPU RTX 4090 / A100.
Hostkey
GPU RTX 3090 24GB
CPU
8 ядер
RAM
64 ГБ
Диск
500 ГБ NVMe
Канал
1 Гбит/с
GPU
NVIDIA RTX 3090 (24 ГБ GDDR6X)
24 999 ₽/мес
Timeweb Cloud
GPU RTX A5000 24GB
CPU
8 ядер
RAM
64 ГБ
Диск
500 ГБ NVMe
Канал
1 Гбит/с
GPU
NVIDIA RTX A5000 (24 ГБ GDDR6X)
24 999 ₽/мес
Hostkey
GPU RTX 4090 24GB
CPU
16 ядер
RAM
128 ГБ
Диск
1000 ГБ NVMe
Канал
1 Гбит/с
GPU
NVIDIA RTX 4090 (24 ГБ GDDR6X)
32 999 ₽/мес
Ищете точную конфигурацию под ваш бюджет?
Используйте наш интерактивный мастер подбора: рассчитайте точные ресурсы CPU, RAM и диска за 3 шага.