Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

2233 8K контекста — не приговор: пишем coding agent для локальных LLM с бюджетом токенов, параллельными воркерами и песочницей Как запихнуть coding agent в 8K контекста? Токенное бюджетирование, параллельные исполнители и изоляция файлов — полный гайд с кодом для Ollama и LM Studio. 9 мин чтения 2234 DeepSeek V4 vs Claude Sonnet 4.6 на русскоязычных задачах: реальное тестирование для разработки и продакшна Сравнение DeepSeek V4 и Claude Sonnet 4.6 на 50 русскоязычных задачах разработки. Извлечение данных, классификация, расчеты. Результаты тестирования и слабые ме 5 мин чтения 2235 YouTube запускает AI-поиск 'Ask YouTube': новая фича для Premium, которая наконец-то делает поиск по видео умным YouTube запускает Ask YouTube — умный поиск на базе Gemini для подписчиков Premium. Как работает, чем отличается от обычного поиска и почему это меняет правила 3 мин чтения 2236 Отлавливаем NaN в PyTorch за 3 мс: forward hook для точной локализации первого NaN в слое Как с помощью forward hook в PyTorch за 3 мс найти первый NaN в нейросети. Сравнение с detect_anomaly и torch.isnan. Пример кода и рекомендации. 5 мин чтения 2237 Как AI-агент Cursor за $180 и 3 дня сделал то, что команда делала 3 месяца: реальная история и уроки Реальный кейс: как AI-агент Cursor выполнил 3-месячную работу за 3 дня и $180. Подробный разбор, уроки, подводные камни. 8 мин чтения 2238 Создаём антиспам-бота для Telegram на своей LSTM нейросети: пошаговое руководство Создайте антиспам-бота для Telegram с нуля на своей LSTM нейросети. Сбор датасета, обучение, интеграция с TDLib. Полный код и примеры. 7 мин чтения 2239 Сравнение LLM апреля 2026: DeepSeek V4 Pro vs Qwen 3.6 Plus и другие — кто победил по качеству и цене? Сравнительный тест LLM апреля 2026: DeepSeek V4 Pro, Qwen 3.6 Plus, Claude Opus 4.7. Бенчмарки, стоимость за токен, рекомендации для production. Кто реально лид 9 мин чтения 2240 RTX 5070 Ti + RTX 2060: 22 ГБ VRAM из ничего. Запускаем 30B LLM без покупки нового GPU Пошаговый гайд: объединяем новую RTX 5070 Ti (16 ГБ) и старую RTX 2060 (6 ГБ) через llama.cpp multi-GPU. Запускаем Qwen 2.5 32B, Gemma 27B и другие 30B модели н 7 мин чтения 2241 Дистиллированный Claude 4.6 Opus: экономия или профанация? Разбираем, стоит ли дистиллировать Claude 4.6 Opus. Реальные кейсы, качество reasoning, цена вопроса. Когда fine-tune оправдан, а когда - пустая трата. 4 мин чтения 2242 TRELLIS.2 от Microsoft: 4 миллиарда причин забыть о ручном моделировании Microsoft открыла TRELLIS.2 — нейросеть, которая из одной картинки делает 3D-модель с PBR-текстурами. 4 миллиарда параметров, 16x сжатие и лицензия MIT. 6 мин чтения 2243 10 скрытых настроек Claude Code, которые превратят его из 'работает' в 'работает как отдел' Глубокий гайд по скрытым настройкам Claude Code: CLAUDE.md, effort xhigh, subagents, MCP серверы и другие конфиги, которые заставят AI-агента работать как целый 9 мин чтения 2244 Склеиваем Gemma и DeepSeek: гибрид без дообучения через Ghetto MLOps Смержите Gemma 3 и DeepSeek V3.2 без fine-tuning: пошаговый гайд с PyTorch хаками, SVD-проекцией и разбором ошибок. Реально? Да, но есть нюансы. 6 мин чтения