Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

4213 Как создать сложную LLM-симуляцию с памятью на Python: разбор кейса Noodle Shop с GLM 4.7 и Qwen Пошаговое руководство по созданию сложной LLM-симуляции с системой памяти. Разбираем кейс ресторана лапши с использованием GLM 4.7 30B и Qwen 2.5 35B. 9 мин чтения 4214 Mixture of Experts (MoE) в трансформерах: полное руководство по архитектуре и настройке в Hugging Face Полное руководство по Mixture of Experts (MoE) в трансформерах. Архитектура, принцип работы sparse моделей, настройка в Hugging Face и практические советы на 20 9 мин чтения 4215 Pi*0.6: Как применить метод Physical Intelligence для постобучения роботов без сложного RL Гайд по применению метода Physical Intelligence Pi*0.6 для постобучения роботов. Оффлайн-RL, ACT policy, классификация действий. Практический разбор без хайпа. 8 мин чтения 4216 4 стадии рефакторинга AI-сгенерированного кода: от вайбкодинга до чистой архитектуры Пошаговый гайд по превращению AI-кода в чистую архитектуру. Разбираем реальный кейс с конвертером JSON Telegram: от вайбкодинга до Dependency Injection. 10 мин чтения 4217 Трояны в skill.md файлах: как Claude Code стал мишенью для крипто-воров Обнаружена масштабная атака через файлы skill.md в Claude Code. Trojan.JS/CrypoStealz крадет данные и криптовалюту. Как проверить проект и защититься. 4 мин чтения 4218 Геополитика ИИ: почему Сэм Альтман ищет деньги в Индии на фоне кризиса в OpenAI и США Сэм Альтман обратился к Индии за инвестициями, пока OpenAI сталкивается с финансовым кризисом. Анализ геополитики ИИ на 2026 год. 4 мин чтения 4219 Qwen3.5-27B против DeepSeek-V3.2: как маленький гигант бьет монстра на STEM-задачах Результаты тестирования на бенчмарке AA-II показывают, что Qwen3.5-27B конкурирует с DeepSeek-V3.2 по STEM-задачам при меньшем размере. 4 мин чтения 4220 Как реализовать 'сон' для локальных LLM: методика MEMIT для постоянной памяти без RAG Пошаговый гайд по реализации 'сна' для локальных LLM через MEMIT. Редактирование весов трансформера для постоянной памяти. Работает на MacBook Air. 8 мин чтения 4221 CLaaS: обзор и настройка open-source библиотеки для обучения LLM вашими фидбеками в реальном времени Как настроить CLaaS для continual learning LLM с LoRA адаптерами. Решение проблемы катастрофического забывания. Примеры использования с Telegram и OpenClaw. 5 мин чтения 4222 Утечка весов Seedance 2.0: 96 GB VRAM и безумная гонка за квантованием Веса модели Seedance 2.0 слиты в сеть. Для запуска нужно 96 GB видеопамяти. Сообщество в спешке ищет способы квантования гиганта. 4 мин чтения 4223 Лоботомические слои в Llama 3.1 и Qwen 2.5: как избежать 'зоны убийства' здравого смысла при fine-tuning Практическое руководство по обнаружению и обходу лоботомических слоев в моделях Llama 3.1 и Qwen 2.5 при тонкой настройке. Сохраните фактические знания модели. 8 мин чтения 4224 Qwen3.5-35B-A3B: практический туториал по созданию FlappyBird на TypeScript и Vite с генерацией звуков Пошаговый туториал по созданию игры FlappyBird на TypeScript и Vite с использованием локальной модели Qwen3.5-35B-A3B для генерации кода и звуков. Практическое 6 мин чтения