Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

4377 материалов
01 Почему Python теряет позиции в AI: налог на производительность и альтернатива Swift для инференса Разбираем, почему Python медленнее для инференса AI, и как Swift MLX становится альтернативой на edge-устройствах. Замеры, сравнение, пошаговый план. 1 мин чтения 02 Как правильно апскейлить Gemma 4: настройка layer_scalar при дублировании слоёв Пошаговое руководство по корректировке layer_scalar для стабильного апскейла Gemma 4. Формула s^(1/N), примеры ошибок и фиксы. 6 мин чтения 03 Typed Answer Contracts: The Only Way to Stop RAG Hallucinations (With Code) Learn how to use typed answer contracts (Pydantic + structured generation) to prevent RAG hallucinations. Full Python code included. 8 мин чтения 04 Бесплатный ИИ-агент для HH.ru: как заставить нейросеть искать работу за тебя Пошаговое руководство по созданию бесплатного ИИ-агента для автоматического отклика на вакансии HH.ru. Playwright, Ollama, Aiogram, Python. Полный код. 9 мин чтения 05 Как находить слепые зоны в промптинге: методика работы с Claude Fable 5 Практическая методика выявления скрытых пробелов в промптах с помощью Claude Fable 5. Матрица Unknowns, итеративный промптинг и реальные примеры. 7 мин чтения 06 Handoff-driven development: новая методология AI-assisted разработки с шаблоном репозитория Handoff-driven development — методология, которая решает проблему потери контекста в AI-кодинге. Пошаговый план, шаблон репозитория и типичные ошибки. 5 мин чтения 07 The Fast Gemma Challenge: как выжать из Gemma 4 MoE 100+ TPS на A10G с помощью мультиагентного подхода Ускорьте Gemma 4 MoE на A10G до 100+ токенов в секунду. Мультиагентный подход: квантование, батчинг, распараллеливание экспертов и vLLM. Пошаговый гайд с кодом 8 мин чтения 08 Почему скорость prefilling критична для RAG и почему Strix Halo проигрывает интерактивному использованию Разбираем, почему скорость prefilling — главный враг RAG, и почему AMD Strix Halo с его медленной памятью проигрывает серверным GPU в интерактивных сценариях. 5 мин чтения 09 Как использовать subagents в Claude Code для борьбы с переполнением контекста: полное руководство Пошаговое руководство по созданию subagents в Claude Code через YAML frontmatter. Как делегировать задачи, избежать 'зоны тупости' и снизить стоимость токенов. 7 мин чтения 10 Как заменить LLM-вики на чистый Python-компилятор: пошаговое руководство с кодом Пошаговое руководство по созданию локального компилятора заметок на Python без LLM. Парсер Markdown, граф связей, генератор HTML и линтер. Полный код и тесты. 6 мин чтения 11 Робот-дворецкий за $100: инструкция по сборке (сделай сам) Пошаговое руководство: как из Raspberry Pi и пары моторов собрать робота с голосовым управлением и локальным ИИ за $100. Комплектующие, сборка, софт, частые оши 6 мин чтения 12 Шесть нерассказанных уроков RAG: почему косинус не основа, и как строить retrieval на SQL-фильтрации Критика стандартного RAG pipeline. Почему косинус не решает семантику, как SQL-фильтрация делает retrieval точным и быстрым. Практические примеры и код. 7 мин чтения