Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

1849 Multi-Agent AI для CNC-мастерских: разбор системы MachinaCheck на AMD MI300X Разбираем MachinaCheck — multi-agent систему для анализа STEP-файлов на AMD MI300X. Сравнение с альтернативами, реальные кейсы, кому подойдёт. 5 мин чтения 1850 Tesla V100 в 2026: серверный монстр, который пытались превратить в игровую карту (и AI-станцию) Nvidia Tesla V100: серверный ускоритель GV100 с 32GB HBM2 за 40 тысяч рублей. Реально ли играть и обучать нейронки? Сборка кастомного корпуса, сравнение с Titan 1 мин чтения 1851 Как разогнать DeepSeek-V4-Flash до 85 токенов в секунду: MTP, W4A16 и RTX PRO 6000 Гайд по настройке DeepSeek-V4-Flash с MTP-спекуляцией и квантованием W4A16+FP8: 85 tok/s на двух RTX PRO 6000. Конфиг llama.cpp, профилирование GPU, сравнение с 7 мин чтения 1852 Локальная память AI-агента превосходит Zep: результаты бенчмарка на LoCoMo и HotpotQA Свежий бенчмарк показал: локальная память агента набрала 59% против 28% у Zep на LoCoMo, и 71.5% на HotpotQA. Разбираем, почему это меняет правила игры для авто 4 мин чтения 1853 Как избежать неожиданных счетов за Claude Code: история с $6000 и советы по контролю расходов Реальная история перерасхода $6000 на Claude Code. Почему это случилось и как настроить лимиты, кэш, модели и мониторинг, чтобы не повторить судьбу жертв дороги 7 мин чтения 1854 DeepSeek TUI и альтернативы: когда переходить на мультимодельные терминальные агенты (Claude, Gemini)? Разбираем ограничения DeepSeek TUI, сравниваем с Claude Code и Gemini CLI. Когда мультимодельный терминальный агент становится необходимостью. Гайд по выбору и 7 мин чтения 1855 xAI продаёт compute Anthropic: признаки ухода от разработки собственных AI-моделей? Анализ сделки между xAI и Anthropic: продажа вычислительных мощностей Colossus, IPO SpaceX и вопросы к будущему Grok. Признаки смены стратегии Илона Маска. 5 мин чтения 1856 16 гигов для OCR в 2026: что реально влезет и как не нарваться на тормоза Сравнение PaddleOCR, GLM-OCR, Nemotron OCR v2 и других моделей для видеокарт с 16 ГБ VRAM. Тесты на печатном тексте, рукописях и формулах. Рекомендации по выбор 5 мин чтения 1857 Как субъективно оценить скорость генерации LLM: скрипт для визуализации tokens/s Узнайте, как скрипт визуализации токенов в секунду помогает реально ощутить скорость генерации LLM, сравнить квантования и избежать иллюзий бенчмарков. 6 мин чтения 1858 NCCL-Free Tensor Parallelism в llama.cpp: две Blackwell GPU работают без лишних танцев с бубном Разбираем новую фичу llama.cpp b9095 — тензорный параллелизм без NCCL на двух Blackwell. Как это работает, кому нужно и почему проще, чем кажется. 5 мин чтения 1859 Методичка разработки с LLM: Test + Spec Driven Development и Sub-agents Пошаговый гайд по TSDD — методике, объединяющей исполняемые спецификации, тесты и суб-агентов для надежной кодогенерации. Работает с любыми LLM. 5 мин чтения 1860 Structured Outputs в OpenAI, Gemini и xAI: дуэль JSON-схем и constrained decoding Разбираем Structured Outputs в GPT-5.3, Gemini 3 и Grok-3: JSON Schema, constrained decoding, баги и продакшн-нюансы. Что выбрать разработчику в 2026? 8 мин чтения