Перейти к содержанию
Новое AiManual теперь в MAX Подписаться
Все выпуски

Архив публикаций

Все материалы AiManual в единой хронологической ленте.

6709 GPU Rental Price Tracker: как следить за ценами на облачные GPU и экономить на аренде Обзор GPU Rental Price Tracker — инструмента для отслеживания цен на облачные GPU. Сравнение провайдеров, настройка алертов, реальная экономия на аренде A100, H 6 мин чтения 6710 Как создать автономный Infinite Podcast на локальных моделях: полный гайд с Python и RTX 5060 Ti Полный гайд по созданию бесконечного автономного подкаста на локальных языковых моделях без облачных API. Python, TTS, LLM и полная независимость. 10 мин чтения 6711 RLVR с GRPO: от теории к работающему коду в ноутбуке Пошаговое руководство по RLVR с GRPO алгоритмом. Учим LLM с подкреплением с нуля: установка, код, обучение, ошибки. Полный ноутбук с кодом. 7 мин чтения 6712 Автономный ИИ-агент QA для тестирования бэкенда: концепция и архитектура стенда Полное руководство по созданию автономного ИИ-агента QA для тестирования бэкенда. Концепция, архитектура стенда, пошаговый план и разбор ошибок. 8 мин чтения 6713 Экстремальная оптимизация языковых моделей: как запустить LLM на NES и в compile-time C++ Технический эксперимент: как запустить языковую модель на Nintendo Entertainment System и в compile-time C++ с помощью template метапрограммирования. 6502 asm, 8 мин чтения 6714 Сербские сканы против LLM: как достать данные и не сойти с ума Полный гайд по OCR и LLM для сканированных PDF на сербском. Решаем проблемы с точностью, layout detection и мультимодальностью. Код, ошибки, альтернативы. 10 мин чтения 6715 Confer: приватная альтернатива ChatGPT от создателя Signal — как это работает и кому нужно Moxie Marlinspike, создатель Signal, запускает Confer — приватную альтернативу ChatGPT с шифрованием в TEE. Разбираемся, как это работает и кому подойдет. 5 мин чтения 6716 Speekium: ваш личный голосовой ассистент, который не шпионит Установка, настройка и use cases Speekium — open-source голосового ассистента на Tauri и Rust с интеграцией Ollama. Полная приватность. 5 мин чтения 6717 Европейский GPU-дефицит: как запускать локальные LLM на доступном железе Практическое руководство по запуску локальных языковых моделей на CPU, старом железе и бюджетных видеокартах. Оптимизация памяти, выбор моделей, пошаговая настр 10 мин чтения 6718 Как создать мобильное приложение с локальным ИИ на llama.cpp: пошаговый туториал Подробное руководство по разработке мобильного приложения с офлайн-ИИ на llama.cpp. Приватность, автономность и полный контроль над данными. 6 мин чтения 6719 Как создать плагин tool parser для vLLM под конкретную модель (на примере Apriel-1.6-15B-Thinker) Подробное руководство по созданию кастомного парсера инструментов для vLLM на примере модели Apriel-1.6-15B-Thinker. Шаги, код, нюансы. 6 мин чтения 6720 Итоги 2025: От o1 к o4 — как reasoning-модели изменили подход к решению задач и что это значит для разработчиков Разбор эволюции reasoning-моделей в 2025 году: как переход от o1 к o4 изменил подход к решению сложных задач, что такое RLVR и inference-scaling, и почему это в 6 мин чтения