Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
2233
8K контекста — не приговор: пишем coding agent для локальных LLM с бюджетом токенов, параллельными воркерами и песочницей
Как запихнуть coding agent в 8K контекста? Токенное бюджетирование, параллельные исполнители и изоляция файлов — полный гайд с кодом для Ollama и LM Studio.
2234
DeepSeek V4 vs Claude Sonnet 4.6 на русскоязычных задачах: реальное тестирование для разработки и продакшна
Сравнение DeepSeek V4 и Claude Sonnet 4.6 на 50 русскоязычных задачах разработки. Извлечение данных, классификация, расчеты. Результаты тестирования и слабые ме
2235
YouTube запускает AI-поиск 'Ask YouTube': новая фича для Premium, которая наконец-то делает поиск по видео умным
YouTube запускает Ask YouTube — умный поиск на базе Gemini для подписчиков Premium. Как работает, чем отличается от обычного поиска и почему это меняет правила
2236
Отлавливаем NaN в PyTorch за 3 мс: forward hook для точной локализации первого NaN в слое
Как с помощью forward hook в PyTorch за 3 мс найти первый NaN в нейросети. Сравнение с detect_anomaly и torch.isnan. Пример кода и рекомендации.
2237
Как AI-агент Cursor за $180 и 3 дня сделал то, что команда делала 3 месяца: реальная история и уроки
Реальный кейс: как AI-агент Cursor выполнил 3-месячную работу за 3 дня и $180. Подробный разбор, уроки, подводные камни.
2238
Создаём антиспам-бота для Telegram на своей LSTM нейросети: пошаговое руководство
Создайте антиспам-бота для Telegram с нуля на своей LSTM нейросети. Сбор датасета, обучение, интеграция с TDLib. Полный код и примеры.
2239
Сравнение LLM апреля 2026: DeepSeek V4 Pro vs Qwen 3.6 Plus и другие — кто победил по качеству и цене?
Сравнительный тест LLM апреля 2026: DeepSeek V4 Pro, Qwen 3.6 Plus, Claude Opus 4.7. Бенчмарки, стоимость за токен, рекомендации для production. Кто реально лид
2240
RTX 5070 Ti + RTX 2060: 22 ГБ VRAM из ничего. Запускаем 30B LLM без покупки нового GPU
Пошаговый гайд: объединяем новую RTX 5070 Ti (16 ГБ) и старую RTX 2060 (6 ГБ) через llama.cpp multi-GPU. Запускаем Qwen 2.5 32B, Gemma 27B и другие 30B модели н
2241
Дистиллированный Claude 4.6 Opus: экономия или профанация?
Разбираем, стоит ли дистиллировать Claude 4.6 Opus. Реальные кейсы, качество reasoning, цена вопроса. Когда fine-tune оправдан, а когда - пустая трата.
2242
TRELLIS.2 от Microsoft: 4 миллиарда причин забыть о ручном моделировании
Microsoft открыла TRELLIS.2 — нейросеть, которая из одной картинки делает 3D-модель с PBR-текстурами. 4 миллиарда параметров, 16x сжатие и лицензия MIT.
2243
10 скрытых настроек Claude Code, которые превратят его из 'работает' в 'работает как отдел'
Глубокий гайд по скрытым настройкам Claude Code: CLAUDE.md, effort xhigh, subagents, MCP серверы и другие конфиги, которые заставят AI-агента работать как целый
2244
Склеиваем Gemma и DeepSeek: гибрид без дообучения через Ghetto MLOps
Смержите Gemma 3 и DeepSeek V3.2 без fine-tuning: пошаговый гайд с PyTorch хаками, SVD-проекцией и разбором ошибок. Реально? Да, но есть нюансы.