Перейти к содержанию
Тематическая лента

Подборка материалов

Публикации, объединённые общей практической задачей.

1920 материалов
01 OntoIndex: строим граф кода для ИИ-агентов с MCP и веб-интерфейсом Обзор OntoIndex — инструмента для построения семантического графа кода. Сравнение с альтернативами, примеры использования, настройка MCP-сервера и веб-интерфейс 6 мин чтения 02 NuCS vs Choco: сравнение производительности Python- и Java-решателей для задач ограничений Подробный бенчмарк двух решателей задач ограничений: чистый Python с Numba (NuCS) против зрелого Java-фреймворка (Choco). Код, команды, анализ производительност 4 мин чтения 03 Как добавить ASR bias для моделей транскрипции голоса: открытая реализация и пример кода Практическое руководство по добавлению смещения (bias) в модели ASR для улучшения распознавания специфических слов. Код на Python для Whisper и других моделей. 5 мин чтения 04 Refiner: библиотека робототехники от бывшей команды Hugging Face, которая переворачивает претрейнинг Обзор Refiner — open-source библиотеки для робототехники от бывшей команды претрейнинга Hugging Face. Возможности, сравнение с LeRobot, примеры использования и 5 мин чтения 05 Локальный AI-мониторинг экрана: запускаем open-source инструмент одной командой ScreenWatch — open-source инструмент для приватного AI-мониторинга экрана. Запускается одной командой, использует локальную LLM, никаких облаков. 6 мин чтения 06 Интеграция LLM в корпоративную шину: обзор redb.Route.Llm и enterprise-паттернов Как встроить языковые модели в корпоративную шину без монолита? Обзор библиотеки redb.Route.Llm, Enterprise Integration Patterns для LLM и примеры кода для .NET 7 мин чтения 07 Lemonade v10.7: как запускать LLM на любом железе — обзор новых рабочих групп и функций Новая версия Lemonade 10.7: поддержка рабочих групп, запуск LLM на AMD, Intel, Apple Silicon. Сравнение с Ollama, LM Studio. Кому подойдет? 5 мин чтения 08 FlashMemory-DeepSeek-V4: новый метод Lookahead Sparse Attention для ультра-длинного контекста Разбираем инновацию DeepSeek — Lookahead Sparse Attention. Как работает, с чем сравнивать, кому подойдёт. Контекст до 1M токенов без потери качества. 5 мин чтения 09 Когда Hypothesis пасует: как LLM-агент откопал баги в NumPy, SciPy и Pandas Разбор метода property-based testing с LLM-агентом: как нейросеть находит ошибки в популярных Python-библиотеках, реальные примеры багов и сравнение с альтернат 6 мин чтения 10 OSCAR RotationZoo: новое квантование KV Cache до 2 бит — инструкция по установке и применению Разбираем OSCAR RotationZoo — квантование KV Cache до 2 бит со спектральным вращением. Инструкция по установке, сравнение с альтернативами, примеры для локально 5 мин чтения 11 ntkMirror: как заставить LLM расписаться в собственной лжи без дообучения (ICML 2026) ntkMirror — тренировка-free метод предсказуемого контроля галлюцинаций в LLM. Как работает, сравнение с RAG и RLHF, примеры кода. Результаты ICML 2026. 5 мин чтения 12 Unsloth выпустил GGUF-квантизации Gemma 4 с QAT и MTP: запускаем на GPU и CPU Новые GGUF-квантизации Gemma 4 от Unsloth с QAT и MTP. Ускорение до 40 токенов/c на RTX 4090, запуск на CPU. Сравнение квантований, примеры команд. 6 мин чтения