Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
625
PCA, t-SNE и UMAP: гид по алгоритмам снижения размерности — от математики до практики
Сравниваем PCA, t-SNE и UMAP: математика, скорость, качество визуализации. Узнайте, какой алгоритм выбрать, как настроить perplexity и n_neighbors и избежать ло
626
Эффективный промптинг для Claude Code: от голосовой транскрипции до HTML-отчётов
Голосовая транскрипция, обязательные тесты и предварительное обсуждение архитектуры — три техники, которые заменяют устаревший prompt engineering в Claude Code.
627
BeeLlama.cpp v0.4.1: KVarN и Precision Tail — как сэкономить VRAM без потери точности
BeeLlama.cpp v0.4.1: KVarN и mixed-precision KV cache precision tail сокращают VRAM на 34% без потери точности. Бенчмарки KLD на Qwen 3.6 27B доказывают: kvarn5
628
Визуализация решений AI-агентов: как превратить лог кода в mind map с помощью Atlas
Atlas автоматически сохраняет контекст сессий Claude Code и Codex в Markdown-файлы и строит mind map решений. Снижение токенов на 99.97% при передаче контекста,
629
За кулисами: почему OpenAI и Anthropic лоббируют ограничения для open-source моделей, пока публично поддерживают открытость
Прямой разбор противоречия: публичные заявления OpenAI и Anthropic о поддержке открытости против $40+ млн лоббистских бюджетов на ограничение open-source моделе
630
DGX Spark vs M5 Max MacBook Pro: что выбрать для локального инференса и обучения моделей в 2025 году
Детальное сравнение NVIDIA DGX Spark и Apple M5 Max MacBook Pro (128 ГБ RAM) для локального запуска LLM и обучения нейросетей. Тесты производительности, архитек
631
Сравнение Claude Code, OpenCode и Pi: одинаковое качество кода, но разная скорость и затраты
Тест DeepSeek V4 Flash через Claude Code, OpenCode и Pi: качество правок идентично, но Claude Code тратит в 4 раза больше времени. Сравниваем scaffolding, затра
632
OpenSmith: Локальный трейсер для LLM-пайплайнов с дашбордом и экспортом в OpenTelemetry
OpenSmith — open-source Python-инструмент для трассировки LLM-пайплайнов без облака, аккаунта или Docker. Декоратор @trace, локальный SQLite, дашборд с live-обн
633
Сборка Inferno на 4×Tesla P100: тест LLM и планы на шесть карт
Реальные замеры: 50 токенов/с и Perplexity 530–550 на четырёх NVIDIA Tesla P100. Разбираем, оправдана ли сборка в 2026 году и что даст расширение до шести карт.
634
Интеграция Minimax M3 в llama.cpp: архитектура MSA и локальный инференс без облаков
Minimax M3 с архитектурой MSA теперь в llama.cpp. Запускайте модели локально на CPU и GPU без облачных API. Пошаговое руководство, бенчмарки на i9, M2 и RTX 409
635
Gemma 3: что нового в обновлённой линейке моделей от Google и стоит ли её внедрять
Google готовит Gemma 3 — открытую модель с улучшенной архитектурой, контекстом до 128K токенов и оптимизацией для CPU и мобильных устройств. Разбираем ожидаемые
636
Agentic Bakeoff: ThinkingCap vs Fable Fusion vs стоковый Qwen3.6-27B — кто побеждает в агентных задачах?
90 тестовых прогонов, 6 задач, 3 модели: ThinkingCap экономит 34% токенов, но срывается в штопор лишних вызовов. Fable Fusion находит мейнтейнера через GitHub A