Все выпуски
Архив публикаций
Все материалы AiManual в единой хронологической ленте.
4849
GLM-5: 20 токенов в секунду на M3 Ultra, магия с опечатками и битва квантов Q2 против TQ1
Практический обзор GLM-5 на Unsloth. Сравниваем квантования Q2 и TQ1, 20 токенов в секунду на M3 Ultra, проверяем способность модели исправлять опечатки в реаль
4850
Индийский AI-бум: как Neysa и Blackstone строят альтернативу AWS и Google Cloud для локальных вычислений
Индия строит суверенную AI-инфраструктуру. Neysa с инвестициями $1.2 млрд и Blackstone создают локальные GPU-облака. Конкуренция с AWS и Google Cloud.
4851
ChatGPT превращается в рекламный щит: как 'эншитификация' толкает всех на локальные нейросети
В феврале 2026 OpenAI официально внедрила рекламу в бесплатный ChatGPT. Как это ускоряет массовый переход на локальные LLM и почему термин 'enshittification' ст
4852
Микро-LLM за 5 часов: Библия + C++ = странные галлюцинации
Пошаговый гайд по созданию микро-LLM с нуля за 5 часов. Код на Python, BPE токенизатор, эксперимент со смешанными датасетами (Библия + C++).
4853
QED-Nano: как 4B-модель доказывает сложные теоремы и запускается на ноутбуке
Обзор QED-Nano - 4B-модели для автоматического доказательства теорем. Запуск на обычном ноутбуке, сравнение с альтернативами, примеры использования.
4854
Ling-2.5-1T: тестируем 1-триллионную модель с 63B активных параметров и 1M контекстом
Тестируем Ling-2.5-1T — модель с 1 триллионом параметров, 63B активных и 1 млн токенов контекста. Сравнение с альтернативами, примеры использования и рекомендац
4855
Скандал Anthropic и Пентагона: почему ИИ-компании отказываются от военных контрактов
Конфликт между Anthropic и Пентагоном из-за контракта на $200 млн. Почему ИИ-компании отказываются от военных заказов и что стоит за этическими ограничениями Cl
4856
Утечка бенчмарков DeepSeek-V4: что известно и стоит ли ждать
Полный разбор утекших данных о DeepSeek-V4: реальные цифры, сравнение с GPT-5 и Claude-4, стоит ли ждать релиз.
4857
Copilot устал. Cursor дорогой. Как поставить локального китайского гения в VS Code
Полный гайд по замене Copilot/Cursor на локальные модели DeepSeek V3 или Qwen Coder. Настройка в VS Code, экономия денег, полная приватность.
4858
Визуализация внимания GPT-2: как заставить модель «видеть» Bad Apple через оптимизацию эмбеддингов
Эксперимент по оптимизации эмбеддингов в GPT-2 для генерации карт внимания, соответствующих кадрам из Bad Apple. Подробное руководство с кодом.
4859
CIANA Parrot: ваш персональный ИИ-ассистент, который не смотрит через плечо
Сборка приватного персонального ассистента CIANA Parrot на локальных LLM. Полный контроль данных, персонализация, задачи, заметки. Руководство на 2026 год.
4860
Что такое RAG-агенты для бизнеса: как Glean и другие создают «слой интеллекта» между ИИ и корпоративными данными
Как RAG-агенты вроде Glean решают проблему контекста для LLM в корпоративной среде. Интеграция Slack, Jira, Salesforce. Актуально на февраль 2026.