Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
6325
LLM на старом ноутбуке: заставляем модель работать там, где она не должна
Подробный гайд по запуску TinyLlama и других моделей на слабом железе. Контекстное прунирование, мониторинг энтропии Шеннона, Python скрипты.
6326
120V - не приговор: как собрать ферму для локальных LLM в США без переделки проводки
Практические решения для питания фермы под локальные LLM на американской электросети 120V. Расчеты, схемы подключения, выбор PSU и распределение нагрузки.
6327
HashHop: $500M за реверс-инжиниринг памяти LLM. Как это работает на самом деле
Полный разбор HashHop - технологии за $500M. Как работает реверс-инжиниринг Memory-Augmented Language Models и почему это стоит таких денег. Архитектура, связь
6328
8 миллиардов параметров для C++: какие opensource модели реально генерируют код, а не галлюцинируют в 2026
Тестируем DeepSeek-Coder-6.7B, Qwen-Coder-7B и CodeLlama-7B на реальных задачах C++. Сравнение скорости, качества и памяти для Windows с GGUF.
6329
Sweep: Как запустить 1.5B модель для предсказания правок кода и повысить продуктивность
Обзор Sweep — инструмента с моделью на 1.5B параметров для предсказания следующих правок в коде. Сравнение с Copilot, установка, примеры использования и повышен
6330
M4 Mac Mini или ждать M5? Железный выбор для локальных LLM в 2026 году
Полный разбор железа для локальных LLM в 2026: M4 Mac Mini тесты, прогнозы по M5, сравнение с серверами и ПК. Что купить прямо сейчас?
6331
Meta блокирует AI-персонажей для подростков: регуляторы наступают, индустрия дрожит
Meta закрывает доступ к AI-персонажам для пользователей до 18 лет после судебных исков. Как это изменит индустрию AI-развлечений в 2026 году.
6332
Как Давос превратился в главную AI-конференцию мира: что говорят CEO на 23 января 2026 года
Анализ сдвига повестки Всемирного экономического форума: от экономики к ИИ. Критика регуляции, предупреждения о пузырях и прогнозы от топ-менеджеров.
6333
Сумасшедшие $480 миллионов за презентацию: как AI-стартапы научились продавать воздух и почему это скоро лопнет
Анализ рекордного seed-раунда в $480M без MVP. Почему инвесторы снова верят в магию презентаций и когда лопнет новый AI-пузырь. Экспертные мнения и данные на ян
6334
LongCat Flash Thinking 2601: агент, который обещает обогнать Claude. Получилось?
Разбираем новую модель LongCat Flash Thinking 2601: тестируем 60+ инструментов, сравниваем производительность с Claude 4.5 Sonnet и считаем реальную стоимость з
6335
Маленькие LLM на Raspberry Pi и MacBook Air: как заставить их работать умнее, а не тяжелее
Практическое руководство по работе с маленькими LLM на ограниченном железе. Оптимизация контекста, RAG, выбор моделей и инструментов на 2026 год.
6336
Почему бесконечный контекст (1M токенов) не решает проблему памяти AI-агентов: разбираем концепцию Memory OS
Глубокий разбор проблемы памяти AI-агентов. Почему бесконечный контекст не работает, как устроен Memory OS и что такое жизненный цикл памяти. Практические решен