Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
4377
материалов
01
Почему Python теряет позиции в AI: налог на производительность и альтернатива Swift для инференса
Разбираем, почему Python медленнее для инференса AI, и как Swift MLX становится альтернативой на edge-устройствах. Замеры, сравнение, пошаговый план.
02
Как правильно апскейлить Gemma 4: настройка layer_scalar при дублировании слоёв
Пошаговое руководство по корректировке layer_scalar для стабильного апскейла Gemma 4. Формула s^(1/N), примеры ошибок и фиксы.
03
Typed Answer Contracts: The Only Way to Stop RAG Hallucinations (With Code)
Learn how to use typed answer contracts (Pydantic + structured generation) to prevent RAG hallucinations. Full Python code included.
04
Бесплатный ИИ-агент для HH.ru: как заставить нейросеть искать работу за тебя
Пошаговое руководство по созданию бесплатного ИИ-агента для автоматического отклика на вакансии HH.ru. Playwright, Ollama, Aiogram, Python. Полный код.
05
Как находить слепые зоны в промптинге: методика работы с Claude Fable 5
Практическая методика выявления скрытых пробелов в промптах с помощью Claude Fable 5. Матрица Unknowns, итеративный промптинг и реальные примеры.
06
Handoff-driven development: новая методология AI-assisted разработки с шаблоном репозитория
Handoff-driven development — методология, которая решает проблему потери контекста в AI-кодинге. Пошаговый план, шаблон репозитория и типичные ошибки.
07
The Fast Gemma Challenge: как выжать из Gemma 4 MoE 100+ TPS на A10G с помощью мультиагентного подхода
Ускорьте Gemma 4 MoE на A10G до 100+ токенов в секунду. Мультиагентный подход: квантование, батчинг, распараллеливание экспертов и vLLM. Пошаговый гайд с кодом
08
Почему скорость prefilling критична для RAG и почему Strix Halo проигрывает интерактивному использованию
Разбираем, почему скорость prefilling — главный враг RAG, и почему AMD Strix Halo с его медленной памятью проигрывает серверным GPU в интерактивных сценариях.
09
Как использовать subagents в Claude Code для борьбы с переполнением контекста: полное руководство
Пошаговое руководство по созданию subagents в Claude Code через YAML frontmatter. Как делегировать задачи, избежать 'зоны тупости' и снизить стоимость токенов.
10
Как заменить LLM-вики на чистый Python-компилятор: пошаговое руководство с кодом
Пошаговое руководство по созданию локального компилятора заметок на Python без LLM. Парсер Markdown, граф связей, генератор HTML и линтер. Полный код и тесты.
11
Робот-дворецкий за $100: инструкция по сборке (сделай сам)
Пошаговое руководство: как из Raspberry Pi и пары моторов собрать робота с голосовым управлением и локальным ИИ за $100. Комплектующие, сборка, софт, частые оши
12
Шесть нерассказанных уроков RAG: почему косинус не основа, и как строить retrieval на SQL-фильтрации
Критика стандартного RAG pipeline. Почему косинус не решает семантику, как SQL-фильтрация делает retrieval точным и быстрым. Практические примеры и код.