Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
4525
Слияние llama.cpp и Hugging Face: Конец DIY-эры или рождение нового монстра?
Анализ слияния llama.cpp и Hugging Face на 2026 год. Что это значит для разработчиков, конкуренции и будущего локальных LLM?
4526
BitNet в браузере на любом GPU: пишем WGSL-кернелы с нуля и обходим CUDA
Полный туториал по запуску BitNet LLM в браузере на любом GPU через WebGPU. Пишем WGSL-ядра с нуля для 1-битных моделей. Активация, внимание, слои - всё в брауз
4527
Индия на Codex: почему каждый второй молодой разработчик там уже не пишет код вручную
Анализ рынка: почему индийские программисты массово перешли на GPT-5.2 Codex и ChatGPT. Цифры, кейсы и скрытые риски.
4528
Тихие убийцы: баги llama.cpp, которые сломают ваш AI-пайплайн (и как их обойти)
Глубокий разбор опасных багов в llama.cpp, которые ломают продакшн-пайплайны. Рабочие решения для проблем со стоп-токенами, утечками памяти и некорректным кэшир
4529
Pantry на Go: решение проблемы амнезии AI-агентов без Python и зависимостей
Как Pantry на Go решает проблему амнезии AI-агентов между сессиями. Сравнение с Echovault, установка, примеры для Claude Code.
4530
Индия строит свой AI-щит: 8 экзафлопс от G42 и Cerebras против зависимости от Запада
Как Индия создает суверенную AI-инфраструктуру на 8 экзафлопс с Cerebras WSE-3. Обход санкций, контроль данных и новая война за суперкомпьютеры.
4531
Покупка сломанных GPU с eBay для локальных LLM: реальная экономия или ловушка?
Полное руководство по покупке неисправных видеокарт на eBay для локальных LLM. Плюсы, минусы, риски и пошаговый план проверки в 2026 году.
4532
Kimi K2.5 против Opus 4.6: когда дешевая модель меньше галлюцинирует в фармацевтике
Неожиданные результаты теста Placebo Bench: Kimi K2.5 делает меньше ошибок в фармацевтике, чем флагманский Claude Opus 4.6. Данные на 20.02.2026.
4533
Legal RAG Bench переворачивает представление о RAG: Retrieval бьёт Reasoning 2:1
Анализ Legal RAG Bench на 20.02.2026: Kanon 2 Embedder побеждает, ошибки извлечения убивают reasoning, практические выводы для архитектуры RAG-систем.
4534
Context Lens: Я узнал, что Gemini сжирает токены в 15 раз быстрее Claude
Инструмент для анализа расхода токенов в кодинг-агентах. Сравниваем Claude 3.7 Sonnet и Gemini 2.0 Ultra, находим утечки контекста и экономим до 40% на API-вызо
4535
Skills в Cursor и Claude Code: когда промпты превращаются в библиотеку
Практическое руководство по созданию Skills для ИИ-ассистентов. Как стандартизировать промпты и повысить качество кода в 2026 году.
4536
Модель сопроцессоров: как правильно распределять задачи между человеком и ИИ для реальных проектов
Практическое руководство по внедрению модели сопроцессоров для эффективной работы с ИИ в продакшене. Снижайте когнитивную нагрузку, повышайте продуктивность.