Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
4407
материалов
01
PDF-to-Markdown: итоги бенчмарка трёх инструментов на разных GPU (PaddleOCR-VL, Marker, PP-StructureV3)
Бенчмарк скорости и точности трёх инструментов для PDF-to-Markdown на GPU A100, V100, T4. Реальные цифры, проблемы установки, выбор лучшего решения.
02
От идеи к SaaS: как я автоматизировал создание флеш-карт с помощью ИИ-агентов и бросил Anki
Реальный кейс: как бэкенд-инженер создал SaaS для автоматического создания флеш-карт с помощью LLM-агентов. Архитектура, проблемы, решения и технические детали.
03
120GB VRAM и тишина: как разогнать гигантские LLM без сжигания денег
Полное руководство по выбору и запуску моделей типа Minimax 2.1 и Qwen3 на системах с 120GB+ VRAM. Квантование Q4, оптимизация памяти, реальные тесты.
04
Архитектура мультиагентных систем для юридических задач: практический разбор на примере Ken1.0 и SimCourt
Глубокий технический разбор архитектур мультиагентных систем для юридических задач. Сравнение SimCourt и практической реализации на Ken1.0. Решение проблемы гал
05
Inheritune: режем жир из LLM — вырезаем вырожденные слои внимания и получаем меньшие, но сильные модели
Полное руководство по Inheritune: как находить и удалять дегенеративные слои внимания в LLM для создания компактных моделей без потери качества. Код, примеры, о
06
LLM как судья: сравнительный тест GPT-5.2, Claude 4.6 и Gemini 3.1 для анализа судебных решений
Эксперимент: три топовые LLM анализируют арбитражные дела. Кто точнее предсказывает исход? Результаты теста на реальных данных.
07
Как выбрать LLM для инженерных задач на Python: полный бенчмарк 100+ моделей по скорости и качеству
Практическое сравнение 100+ LLM для инженерных задач на Python. Тестирование на RTX 4060 Ti и OpenRouter. Методология оценки, результаты, рекомендации.
08
15 бесплатных AI-сервисов для генерации изображений в 2026: практический гид по выбору инструмента
Полный гид по бесплатным AI-сервисам для генерации изображений в 2026 году. Сравнение, реальные примеры, критерии выбора и скрытые ограничения.
09
NPC с характером: как строить локальных агентов с памятью, которая помнит даже оскорбления
Полное руководство по созданию локальных NPC с долговременной памятью на Ollama, ChromaDB, системой релевантности и динамикой социальных связей.
10
Oro: Как рекурсивные циклы в латентном пространстве заменяют миллиарды параметров (и почему это не просто очередная модная архитектура)
Разбор архитектуры Oro: как рекурсивные циклы в латентном пространстве дают 3-кратный прирост в манипуляции знаниями без роста параметров. Актуально на февраль
11
Strix Halo под прицелом: M2.5, Step 3.5 Flash и Qwen3 Coder Next в огне реальных тестов
Реальные тесты производительности новых моделей на Strix Halo с ROCm 7.2. Сравнение квантований, скорости генерации и качества кода на 128 ГБ RAM.
12
Когда стоит обучать свою модель с нуля: практические кейсы и сравнение с готовыми решениями
Полное руководство по выбору: обучать модель с нуля или использовать fine-tuning. Разбор реальных кейсов, стоимости и технических нюансов на 2026 год.