Тематическая лента
Подборка материалов
Публикации, объединённые общей практической задачей.
2253
материалов
01
DiffusionGemma для tool calls: почему параллельная генерация выигрывает у авторегрессии
Разбираем, как DiffusionGemma с двунаправленным вниманием и параллельной генерацией улучшает качество вызовов инструментов (tool calls). Сравнение с авторегресс
02
«Мех-костюм» для LLM: стартап Probably получает $9M от a16z и обещает убить галлюцинации
Стартап Probably привлек $9M seed от a16z на гибрид LLM и детерминированного валидатора. Разбираемся, как «мех-костюм» data science решит проблему галлюцинаций
03
Вайбкодинг, увольнения и битва за выживание: IT-рынок 2026 в зеркале AI
Анализ рынка IT в 2026: вайбкодинг обвалил ставки, Atlassian уволила 1600 человек, гиганты вливают миллиарды. Выживание или адаптация?
04
HalBench: кто меньше врёт? Рейтинг открытых моделей и удар по репутации Meta
HalBench — новый бенчмарк для оценки сикофантии у LLM. Qwen 3.6 и Gemma 4 лидируют, Meta Llama провалилась. Разбираем результаты и скандал.
05
Gemma 4 на Amazon Bedrock: как Google отдала open-weight модель под крыло AWS и что из этого вышло
Пошаговое руководство по развертыванию Gemma 4 с открытыми весами в Amazon Bedrock. Бенчмарки, цены, архитектура MoE и сравнение с конкурентами.
06
Почему стоит пересмотреть использование Ollama: проблемы и альтернативы
Критический разбор Ollama: утечки памяти, безопасность, производительность. Какие альтернативы выбрать для локальных LLM в 2026 году?
07
Код самбы или плагиат? Как бразильская Rio оказалась китайской Qwen и подорвала доверие к open-source
Бразильская AI-модель Rio оказалась ребрендингом Qwen 3.5. Технический детектив, реакция сообщества и уроки для open-source экосистемы.
08
Первый в мире спутник с AI-зрением: как Gemma 3 на орбите находит объекты по текстовым запросам
Loft Orbital и JPL запустили первый спутник с VLM на борту: Gemma 3 ищет объекты по тексту в реальном времени. Как edge AI меняет космическую разведку.
09
Qwen 3.7: китайский ответ DeepSeek и ChatGPT — кто кого?
Разбираем Qwen 3.7 от Alibaba: возможности, сильные стороны, сравнение с DeepSeek V4 и GPT-5. Кому стоит мигрировать, а кому лучше остаться?
10
Nemotron против конкурентов: сравнительный тест моделей до 120B на Strix Halo
Сравнение Nemotron-4-120B, Llama 3.3 70B, Qwen3 Coder Next 48B и других на Strix Halo 128GB. Скорость, качество, практические выводы.
11
Agentopia: как 10-летняя симуляция общества из LLM-агентов перевернула подход к синтетическим данным
Как 10-летняя симуляция жизни сотен AI-агентов генерирует качественные синтетические данные для обучения ИИ. Разбор Agentopia, AI Independence Bench и сценариев
12
Конечные автоматы против галлюцинаций: SymFSM превращает болтовню нейросети в вычислимую архитектуру
Узнайте, как SymFSM использует конечные автоматы для структурирования мышления LLM, снижения галлюцинаций и создания предсказуемых агентов. Обзор подхода и его