Перейти к содержанию
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

625 PCA, t-SNE и UMAP: гид по алгоритмам снижения размерности — от математики до практики Сравниваем PCA, t-SNE и UMAP: математика, скорость, качество визуализации. Узнайте, какой алгоритм выбрать, как настроить perplexity и n_neighbors и избежать ло 13 мин чтения 626 Эффективный промптинг для Claude Code: от голосовой транскрипции до HTML-отчётов Голосовая транскрипция, обязательные тесты и предварительное обсуждение архитектуры — три техники, которые заменяют устаревший prompt engineering в Claude Code. 9 мин чтения 627 BeeLlama.cpp v0.4.1: KVarN и Precision Tail — как сэкономить VRAM без потери точности BeeLlama.cpp v0.4.1: KVarN и mixed-precision KV cache precision tail сокращают VRAM на 34% без потери точности. Бенчмарки KLD на Qwen 3.6 27B доказывают: kvarn5 6 мин чтения 628 Визуализация решений AI-агентов: как превратить лог кода в mind map с помощью Atlas Atlas автоматически сохраняет контекст сессий Claude Code и Codex в Markdown-файлы и строит mind map решений. Снижение токенов на 99.97% при передаче контекста, 9 мин чтения 629 За кулисами: почему OpenAI и Anthropic лоббируют ограничения для open-source моделей, пока публично поддерживают открытость Прямой разбор противоречия: публичные заявления OpenAI и Anthropic о поддержке открытости против $40+ млн лоббистских бюджетов на ограничение open-source моделе 9 мин чтения 630 DGX Spark vs M5 Max MacBook Pro: что выбрать для локального инференса и обучения моделей в 2025 году Детальное сравнение NVIDIA DGX Spark и Apple M5 Max MacBook Pro (128 ГБ RAM) для локального запуска LLM и обучения нейросетей. Тесты производительности, архитек 11 мин чтения 631 Сравнение Claude Code, OpenCode и Pi: одинаковое качество кода, но разная скорость и затраты Тест DeepSeek V4 Flash через Claude Code, OpenCode и Pi: качество правок идентично, но Claude Code тратит в 4 раза больше времени. Сравниваем scaffolding, затра 6 мин чтения 632 OpenSmith: Локальный трейсер для LLM-пайплайнов с дашбордом и экспортом в OpenTelemetry OpenSmith — open-source Python-инструмент для трассировки LLM-пайплайнов без облака, аккаунта или Docker. Декоратор @trace, локальный SQLite, дашборд с live-обн 8 мин чтения 633 Сборка Inferno на 4×Tesla P100: тест LLM и планы на шесть карт Реальные замеры: 50 токенов/с и Perplexity 530–550 на четырёх NVIDIA Tesla P100. Разбираем, оправдана ли сборка в 2026 году и что даст расширение до шести карт. 10 мин чтения 634 Интеграция Minimax M3 в llama.cpp: архитектура MSA и локальный инференс без облаков Minimax M3 с архитектурой MSA теперь в llama.cpp. Запускайте модели локально на CPU и GPU без облачных API. Пошаговое руководство, бенчмарки на i9, M2 и RTX 409 8 мин чтения 635 Gemma 3: что нового в обновлённой линейке моделей от Google и стоит ли её внедрять Google готовит Gemma 3 — открытую модель с улучшенной архитектурой, контекстом до 128K токенов и оптимизацией для CPU и мобильных устройств. Разбираем ожидаемые 7 мин чтения 636 Agentic Bakeoff: ThinkingCap vs Fable Fusion vs стоковый Qwen3.6-27B — кто побеждает в агентных задачах? 90 тестовых прогонов, 6 задач, 3 модели: ThinkingCap экономит 34% токенов, но срывается в штопор лишних вызовов. Fable Fusion находит мейнтейнера через GitHub A 7 мин чтения