Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

4525 Слияние llama.cpp и Hugging Face: Конец DIY-эры или рождение нового монстра? Анализ слияния llama.cpp и Hugging Face на 2026 год. Что это значит для разработчиков, конкуренции и будущего локальных LLM? 6 мин чтения 4526 BitNet в браузере на любом GPU: пишем WGSL-кернелы с нуля и обходим CUDA Полный туториал по запуску BitNet LLM в браузере на любом GPU через WebGPU. Пишем WGSL-ядра с нуля для 1-битных моделей. Активация, внимание, слои - всё в брауз 11 мин чтения 4527 Индия на Codex: почему каждый второй молодой разработчик там уже не пишет код вручную Анализ рынка: почему индийские программисты массово перешли на GPT-5.2 Codex и ChatGPT. Цифры, кейсы и скрытые риски. 4 мин чтения 4528 Тихие убийцы: баги llama.cpp, которые сломают ваш AI-пайплайн (и как их обойти) Глубокий разбор опасных багов в llama.cpp, которые ломают продакшн-пайплайны. Рабочие решения для проблем со стоп-токенами, утечками памяти и некорректным кэшир 9 мин чтения 4529 Pantry на Go: решение проблемы амнезии AI-агентов без Python и зависимостей Как Pantry на Go решает проблему амнезии AI-агентов между сессиями. Сравнение с Echovault, установка, примеры для Claude Code. 7 мин чтения 4530 Индия строит свой AI-щит: 8 экзафлопс от G42 и Cerebras против зависимости от Запада Как Индия создает суверенную AI-инфраструктуру на 8 экзафлопс с Cerebras WSE-3. Обход санкций, контроль данных и новая война за суперкомпьютеры. 6 мин чтения 4531 Покупка сломанных GPU с eBay для локальных LLM: реальная экономия или ловушка? Полное руководство по покупке неисправных видеокарт на eBay для локальных LLM. Плюсы, минусы, риски и пошаговый план проверки в 2026 году. 8 мин чтения 4532 Kimi K2.5 против Opus 4.6: когда дешевая модель меньше галлюцинирует в фармацевтике Неожиданные результаты теста Placebo Bench: Kimi K2.5 делает меньше ошибок в фармацевтике, чем флагманский Claude Opus 4.6. Данные на 20.02.2026. 6 мин чтения 4533 Legal RAG Bench переворачивает представление о RAG: Retrieval бьёт Reasoning 2:1 Анализ Legal RAG Bench на 20.02.2026: Kanon 2 Embedder побеждает, ошибки извлечения убивают reasoning, практические выводы для архитектуры RAG-систем. 6 мин чтения 4534 Context Lens: Я узнал, что Gemini сжирает токены в 15 раз быстрее Claude Инструмент для анализа расхода токенов в кодинг-агентах. Сравниваем Claude 3.7 Sonnet и Gemini 2.0 Ultra, находим утечки контекста и экономим до 40% на API-вызо 6 мин чтения 4535 Skills в Cursor и Claude Code: когда промпты превращаются в библиотеку Практическое руководство по созданию Skills для ИИ-ассистентов. Как стандартизировать промпты и повысить качество кода в 2026 году. 8 мин чтения 4536 Модель сопроцессоров: как правильно распределять задачи между человеком и ИИ для реальных проектов Практическое руководство по внедрению модели сопроцессоров для эффективной работы с ИИ в продакшене. Снижайте когнитивную нагрузку, повышайте продуктивность. 8 мин чтения