Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6325 LLM на старом ноутбуке: заставляем модель работать там, где она не должна Подробный гайд по запуску TinyLlama и других моделей на слабом железе. Контекстное прунирование, мониторинг энтропии Шеннона, Python скрипты. 9 мин чтения 6326 120V - не приговор: как собрать ферму для локальных LLM в США без переделки проводки Практические решения для питания фермы под локальные LLM на американской электросети 120V. Расчеты, схемы подключения, выбор PSU и распределение нагрузки. 8 мин чтения 6327 HashHop: $500M за реверс-инжиниринг памяти LLM. Как это работает на самом деле Полный разбор HashHop - технологии за $500M. Как работает реверс-инжиниринг Memory-Augmented Language Models и почему это стоит таких денег. Архитектура, связь 9 мин чтения 6328 8 миллиардов параметров для C++: какие opensource модели реально генерируют код, а не галлюцинируют в 2026 Тестируем DeepSeek-Coder-6.7B, Qwen-Coder-7B и CodeLlama-7B на реальных задачах C++. Сравнение скорости, качества и памяти для Windows с GGUF. 7 мин чтения 6329 Sweep: Как запустить 1.5B модель для предсказания правок кода и повысить продуктивность Обзор Sweep — инструмента с моделью на 1.5B параметров для предсказания следующих правок в коде. Сравнение с Copilot, установка, примеры использования и повышен 6 мин чтения 6330 M4 Mac Mini или ждать M5? Железный выбор для локальных LLM в 2026 году Полный разбор железа для локальных LLM в 2026: M4 Mac Mini тесты, прогнозы по M5, сравнение с серверами и ПК. Что купить прямо сейчас? 6 мин чтения 6331 Meta блокирует AI-персонажей для подростков: регуляторы наступают, индустрия дрожит Meta закрывает доступ к AI-персонажам для пользователей до 18 лет после судебных исков. Как это изменит индустрию AI-развлечений в 2026 году. 6 мин чтения 6332 Как Давос превратился в главную AI-конференцию мира: что говорят CEO на 23 января 2026 года Анализ сдвига повестки Всемирного экономического форума: от экономики к ИИ. Критика регуляции, предупреждения о пузырях и прогнозы от топ-менеджеров. 4 мин чтения 6333 Сумасшедшие $480 миллионов за презентацию: как AI-стартапы научились продавать воздух и почему это скоро лопнет Анализ рекордного seed-раунда в $480M без MVP. Почему инвесторы снова верят в магию презентаций и когда лопнет новый AI-пузырь. Экспертные мнения и данные на ян 5 мин чтения 6334 LongCat Flash Thinking 2601: агент, который обещает обогнать Claude. Получилось? Разбираем новую модель LongCat Flash Thinking 2601: тестируем 60+ инструментов, сравниваем производительность с Claude 4.5 Sonnet и считаем реальную стоимость з 5 мин чтения 6335 Маленькие LLM на Raspberry Pi и MacBook Air: как заставить их работать умнее, а не тяжелее Практическое руководство по работе с маленькими LLM на ограниченном железе. Оптимизация контекста, RAG, выбор моделей и инструментов на 2026 год. 9 мин чтения 6336 Почему бесконечный контекст (1M токенов) не решает проблему памяти AI-агентов: разбираем концепцию Memory OS Глубокий разбор проблемы памяти AI-агентов. Почему бесконечный контекст не работает, как устроен Memory OS и что такое жизненный цикл памяти. Практические решен 7 мин чтения