Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

4849 GLM-5: 20 токенов в секунду на M3 Ultra, магия с опечатками и битва квантов Q2 против TQ1 Практический обзор GLM-5 на Unsloth. Сравниваем квантования Q2 и TQ1, 20 токенов в секунду на M3 Ultra, проверяем способность модели исправлять опечатки в реаль 6 мин чтения 4850 Индийский AI-бум: как Neysa и Blackstone строят альтернативу AWS и Google Cloud для локальных вычислений Индия строит суверенную AI-инфраструктуру. Neysa с инвестициями $1.2 млрд и Blackstone создают локальные GPU-облака. Конкуренция с AWS и Google Cloud. 6 мин чтения 4851 ChatGPT превращается в рекламный щит: как 'эншитификация' толкает всех на локальные нейросети В феврале 2026 OpenAI официально внедрила рекламу в бесплатный ChatGPT. Как это ускоряет массовый переход на локальные LLM и почему термин 'enshittification' ст 5 мин чтения 4852 Микро-LLM за 5 часов: Библия + C++ = странные галлюцинации Пошаговый гайд по созданию микро-LLM с нуля за 5 часов. Код на Python, BPE токенизатор, эксперимент со смешанными датасетами (Библия + C++). 9 мин чтения 4853 QED-Nano: как 4B-модель доказывает сложные теоремы и запускается на ноутбуке Обзор QED-Nano - 4B-модели для автоматического доказательства теорем. Запуск на обычном ноутбуке, сравнение с альтернативами, примеры использования. 6 мин чтения 4854 Ling-2.5-1T: тестируем 1-триллионную модель с 63B активных параметров и 1M контекстом Тестируем Ling-2.5-1T — модель с 1 триллионом параметров, 63B активных и 1 млн токенов контекста. Сравнение с альтернативами, примеры использования и рекомендац 6 мин чтения 4855 Скандал Anthropic и Пентагона: почему ИИ-компании отказываются от военных контрактов Конфликт между Anthropic и Пентагоном из-за контракта на $200 млн. Почему ИИ-компании отказываются от военных заказов и что стоит за этическими ограничениями Cl 4 мин чтения 4856 Утечка бенчмарков DeepSeek-V4: что известно и стоит ли ждать Полный разбор утекших данных о DeepSeek-V4: реальные цифры, сравнение с GPT-5 и Claude-4, стоит ли ждать релиз. 5 мин чтения 4857 Copilot устал. Cursor дорогой. Как поставить локального китайского гения в VS Code Полный гайд по замене Copilot/Cursor на локальные модели DeepSeek V3 или Qwen Coder. Настройка в VS Code, экономия денег, полная приватность. 8 мин чтения 4858 Визуализация внимания GPT-2: как заставить модель «видеть» Bad Apple через оптимизацию эмбеддингов Эксперимент по оптимизации эмбеддингов в GPT-2 для генерации карт внимания, соответствующих кадрам из Bad Apple. Подробное руководство с кодом. 10 мин чтения 4859 CIANA Parrot: ваш персональный ИИ-ассистент, который не смотрит через плечо Сборка приватного персонального ассистента CIANA Parrot на локальных LLM. Полный контроль данных, персонализация, задачи, заметки. Руководство на 2026 год. 7 мин чтения 4860 Что такое RAG-агенты для бизнеса: как Glean и другие создают «слой интеллекта» между ИИ и корпоративными данными Как RAG-агенты вроде Glean решают проблему контекста для LLM в корпоративной среде. Интеграция Slack, Jira, Salesforce. Актуально на февраль 2026. 5 мин чтения