Модели и инструменты | Виталий Воробьев
← Карта тем

Направление

Модели и инструменты

LLM, API, сравнение моделей и выбор под задачу.

86 материалов СтатьяБлогЗнаниеКейс

Темы направления

Подборка

Статьи

17 материал(ов) в направлении «Модели и инструменты».

Раздел
Статьи

GPT-6 Sol и Luna: что изменилось в цене, возможностях и доступности

OpenAI выпустила GPT-6 Sol и Luna. Разбираем подтверждённые цены API, доступность, кэширование и честно отделяем результаты отдельных бенчмарков от выводов о реальной работе.

Статьи

GPT-6 Astra: что нового в самой мощной модели OpenAI

OpenAI выпустила GPT-6 Astra. Разбираем, почему главное в релизе — не заявление про «эру AGI», а возможное снижение стоимости выполнения задач и первый «критический» уровень кибервозможностей с жёсткими ограничениями доступа.

Статьи

Gemini 3.8 Flash и Flash Cyber: две модели, два уровня доступа

Google представила Gemini 3.8 Flash и Flash Cyber. Первая может использовать больше токенов на сложных задачах ради качества, а вторая ищет и исправляет уязвимости и доступна только одобренным участникам Fairwind.

Статьи

Claude Fable 5.1: главная новость — не бенчмарки, а цена длинной агентной работы

Anthropic выпустила Claude Fable 5.1 и Mythos 5.1. Разбираем, почему главное в релизе — не бенчмарки, а снижение цены кэш-чтения на 75% и что это меняет для агентной работы.

Статьи

GLM-5.3-Flash: дешёвая открытая модель для агентов и вайб-кодинга

Z.ai выпустила GLM-5.3-Flash: 320 млрд параметров, 18 млрд активных, нативная мультимодальность и цена в десять раз ниже GLM-5.2. Веса открыты под MIT.

Статьи

Binance Agent OS: когда AI перестаёт быть аналитиком и становится исполнителем

Binance представила Agent OS — инфраструктурный слой между AI-агентом и биржей. Разбираем, как устроена платформа, почему MCP — только один из способов подключения и что это меняет для крипто-агентов.

Статьи

Windows собирает агентный слой: что Microsoft показала на Build 2026

Microsoft Execution Containers, Agent Identity, Intelligent Terminal и локальные модели Aion. Факты с Build 2026 — без хайпа.

Статьи

Gemini 3.7 Flash: агент, который дорос до сложных задач

Google выпустила Gemini 3.7 Flash: 1 млн контекста, $0.75 за вход, скачок на DeepSWE и Terminal-bench. Модель заточена под агентные сценарии и код.

Статьи

Codex на Linux: desktop-приложение вышло в превью

ChatGPT desktop для Linux вышел в превью. Пакеты для Ubuntu, Debian и Fedora. Что ставить, как обновлять и где подводные камни.

Статьи

AnyModel: все главные LLM через один API и без зарубежной карты

Обзор AnyModel — агрегатора LLM API: 34 модели через один ключ, оплата за токены картой и СБП, Ghost Mode с нулевым хранением, и цены в 50 раз ниже прямых провайдеров.

Статьи

Claude Opus 5: агент, который не бросает задачу на полпути

Релиз Claude Opus 5: рассуждение по умолчанию, 1 млн токенов контекста, пять уровней усилия, бета-фичи для инструментов и fallback. Что менять в коде и как проверить на своих задачах.

Статьи

Rocket.new: платформа, которая строит приложения с разведкой рынка

Обзор Rocket.new — платформы, объединяющей исследование рынка, генерацию продакшен-приложений и мониторинг конкурентов в одном контуре с единой кредитной системой.

Статьи

Kimi K3: 2,8 трлн параметров и миллион токенов контекста от Moonshot AI

Флагманская модель Moonshot AI: контекст 1M токенов, режим размышления, визуальный ввод, вызов инструментов и автоматическое кеширование контекста. Полный разбор с примерами кода на Python и curl.

Статьи

Claude Fable 5: почему Mythos-уровень меняет правила для тех, кто строит агентов

Разбор релиза Anthropic 9 июня 2026: что внутри Fable 5, чем он отличается от Opus 4.8, сколько стоит и что с ним делать малому и среднему бизнесу.

Статьи

Google I/O 2026: что реально вышло для тех, кто строит агентов

Gemini 4 не вышел. Зато Google показал, как агенты будут работать внутри ваших документов — и почему это меняет правила для тех, кто строит системы под ключ.

Статьи

Nvidia стала крупнейшим инвестором ИИ: $40+ млрд за год и стратегия «поддерживать всех»

Nvidia инвестировала более $40 млрд в AI-компании в 2025 году. Разбираем, как чипмейкер стал главным венчурным игроком индустрии и что это значит для рынка.

Статьи

Anthropic нашла себе космического партнёра: что договор с SpaceX меняет для тех, кто пишет код

Anthropic арендовала у SpaceX суперкомпьютер Colossus 1 (220 000 GPU) и удвоила лимиты Claude Code. Разбираем, что это значит для разработчиков и рынка ИИ.

Подборка

Блог

16 материал(ов) в направлении «Модели и инструменты».

Раздел
Блог

Проекты в ChatGPT: один проект на контекст, а не на задачу

Проекты в ChatGPT работают как постоянный рабочий контекст, а не как папка для чатов. Показываю, как я устраиваю проект и когда он вообще нужен.

Блог

Яндекс открыл Alice AI Search Pretrain: как устроена модель быстрых ответов в Поиске

Яндекс открыл базовую модель AliceAI-T5-35B-A0.6B, лежащую в основе быстрых ИИ-ответов в Поиске. Разбираю архитектуру, бенчмарки и ограничения релиза.

Блог

Anthropic выложила blueprint для commerce-агентов на Claude

Anthropic открыла blueprint для commerce-агентов: агент-покупатель и агент-продавец. Разбираем, почему главное в нём — не автономия покупки, а встроенный человеческий контроль.

Блог

Безопасность ИИ-агентов: почему начинать стоит с простого

Почему совет «начинайте с простого» из руководств OpenAI и Anthropic совпадает с важным правилом безопасности OWASP — и как применить это к своим агентам.

Блог

Большую AI-модель начали обучать с открытым капотом: зачем следить за Marin 535B

Marin запустила обучение модели на 535 млрд параметров и открыла почти весь процесс — данные, конфигурацию, потери и ошибки. Зачем за этим следить.

Блог

Anthropic CHIVE: система, которая находит причину ошибки ИИ

Anthropic показала CHIVE — систему, которая находит причину ошибки ИИ не догадкой, а серией контрфактических экспериментов. ИИ становится исследователем другого ИИ.

Блог

Qwen3.8-27B: плотный агентный скачок

Qwen выпустила плотную 27B-модель с гибридным вниманием, контекстом 262K и приростом +29 пунктов на агентных бенчмарках. Apache 2.0, уже на Hugging Face.

Блог

Auto Mode становится режимом по умолчанию: Claude Code меняет философию разрешений

С 14 августа Auto Mode — режим по умолчанию для Pro, Max и Team. Агент действует, классификатор проверяет, человек наблюдает.

Блог

DeepSeek V4 Pro: агентный поворот и новые тарифы

DeepSeek выпустила V4-Pro-0813 с упором на агентные сценарии и tool calls. С 16 августа — пиковые и внепиковые тарифы, рост до 3×.

Блог

Treblo: AI-музыка без лимитов и оговорок

Бесплатный AI-генератор музыки с вокалом, 4160 стилями и API. Melodia v3 — 15 секунд до первого звука, безлимит на последней модели.

Блог

Какими картами оплачивать нейросети: четыре сервиса, которые работают из России

Четыре сервиса для выпуска карт, которыми можно платить за ChatGPT, Claude, API и другие зарубежные ИИ-инструменты из России. Личный опыт и конкретные нюансы.

Блог

Multica: open-source платформа для управления командой из людей и ИИ-агентов

Open-source платформа, превращающая coding-агентов в полноценных участников команды: назначение задач, очереди, навыки, автономное выполнение и единый dashboard для локальных и облачных runtime.

Блог

Reasoning-модели в LLM: что реально изменилось в 2026 году

Чем reasoning-модели (o3, Claude Extended Thinking, Gemini Deep Think, DeepSeek R1) отличаются от обычных LLM, какие техники дают многошаговое рассуждение и где у этого подхода фундаментальные границы.

Блог

Как выдать ИИ полный доступ к Яндекс Метрике и Вебвизору через OAuth

Пошаговая инструкция: создаём OAuth-приложение в Яндексе, получаем токен за две минуты, передаём его ИИ и запускаем SEO-анализ Метрики и Вебвизора. Без кода на сервере.

Блог

VectCutAPI + Codex: видеомонтаж через AI-агента без монтажёра

Как подключить VectCutAPI к Codex и получить автономный видеомонтаж через MCP: cut, субтитры, озвучка, эффекты. Что работает уже сейчас, что — нет.

Блог

GPT-5.5 Instant: что это значит для тех, кто строит продукты на ИИ

OpenAI выпустила GPT-5.5 Instant. Я тестировал её весь вечер и понял: это изменение правил игры для продуктовых команд. Вот почему скорость — это не техническая метрика, а конверсия.

Подборка

База знаний

51 материал(ов) в направлении «Модели и инструменты».

Раздел
База знаний

Jev от TypeSafe AI: архитектура System One моделей, SDK и интеграция в агентный контур

Технический разбор Jev от TypeSafe AI: концепция System One моделей, примитивы Noul, Choice и Score, SDK, интеграция с Vercel AI Gateway и использование как децижн-слоя для ИИ-агентов.

База знаний

ChatGPT Plugins: полный гайд для новичков

Как устроены Plugins в ChatGPT, чем они отличаются от Apps, как подключать сервисы, использовать Work, задачи и Remotion в реальной работе.

База знаний

T-Invest MCP: ИИ-агент для управления брокерским счётом

MCP-сервер Т-Инвестиций — инструмент, который подключает ИИ-агентов к брокерскому счёту через протокол Model Context Protocol. Позволяет анализировать рынок, управлять портфелем и торговать текстовыми командами без программирования.

База знаний

AI Gateway: один вход для моделей, бюджета и отказоустойчивости

Как Cloudflare соединила Workers AI и AI Gateway в единый слой: модели любого провайдера, кэш, резерв, лимиты и бюджеты через один вызов.

База знаний

Unsloth: дообучение LLM с минимальной видеопамятью

Справочник по Unsloth: варианты инструмента, QLoRA-дообучение, подготовка датасета, экспорт в GGUF, запуск в Ollama и LM Studio.

База знаний

AI-агенты: что это, как работают и зачем нужны

Полный справочник по AI-агентам для новичков: что такое агент, чем отличается от чат-бота, какие бывают типы, из чего состоит, какие фреймворки существуют и как начать использовать — простыми словами без жаргона.

База знаний

Чеклисты в Telegram Bot API: нативные списки задач для бизнес-ботов

Родной тип сообщения в Telegram для интерактивных списков задач: как бот отправляет и редактирует чеклисты от имени бизнес-аккаунта, параметры методов, лимиты и сценарии автоматизации.

База знаний

Telegram Business Bots: бот, который отвечает от вашего имени

Бизнес-функции Telegram превратили личный аккаунт в канал продаж и поддержки. Бот, подключённый к аккаунту, работает за вас — читает, отвечает, выставляет счета. Клиент даже не подозревает, что общается с машиной.

База знаний

Tavily: поисковый API для AI-агентов

Практический разбор поискового API Tavily: пять методов, кредитная модель тарификации, тарифы и лимиты запросов. Как подключить агента к живому вебу без собственных парсеров.

База знаний

Silero: локальная речевая модель для русского TTS, STT и VAD

Open-source библиотека для синтеза, распознавания и детекции русской речи на CPU без облака и API-ключей

База знаний

Qwen: открытая экосистема Alibaba от текста до видео и голоса

Полный обзор экосистемы Qwen от Alibaba Cloud: 12 семейств моделей, от текстовых LLM Qwen3.5/3.6 до мультимодальных Omni, визуальных VL, кодинг-агентов Coder, генерации изображений, TTS/ASR, embedding/reranker и world models. Архитектура Dense и MoE, 201 язык, лицензии, сравнение с Llama и Mistral.

База знаний

Roistat: сквозная аналитика от клика до прибыли

Сквозная аналитика: что это, как работает связка сайт-реклама-CRM-телефония, когда Roistat оправдан, а когда нет. Тарифы по официальному прайсу, шаги внедрения, альтернативы и антипаттерны.

База знаний

Один агент — один ключ: настройка доступа для ботов и интеграций

Как настроить права доступа для ИИ-агентов и интеграций: принцип минимальных привилегий, типы ролей, практика в Notion и базах данных, чеклист перед запуском.

База знаний

OpenAI AgentKit: production-агенты без строчки кода

Платформа OpenAI для production-агентов: визуальный конструктор Agent Builder, Agents SDK, ChatKit, Evals. Узлы, MCP-коннекторы, guardrails, тарифы и реальные кейсы.

База знаний

OpenAI Responses API: архитектура агентского API

OpenAI Responses API — единый эндпойнт для запуска моделей с встроенными инструментами, многоходовыми вызовами и серверным состоянием. Разбор архитектуры, отличий от Chat Completions, миграции и тарифов.

База знаний

Оптимизация расхода токенов Claude: 8 уровней экономии

Полный разбор восьми уровней снижения расходов на токены Claude — от выбора модели и уровней effort до кэширования промптов, управления контекстом, субагентов, структуры промптов, batch API и мониторинга. С практическими примерами команд Claude Code и кода на Python.

База знаний

Open WebUI: собственный интерфейс для LLM

Self-hosted веб-интерфейс для LLM с поддержкой Ollama, OpenAI-совместимых API, RAG, многопользовательского режима и плагинов. Запуск одной Docker-командой.

База знаний

MiniMax M3: открытая модель, которая держит миллион токенов и не сдаётся на длинной задаче

Полный справочник по MiniMax M3: открытая модель с контекстом 1M токенов, архитектурой MSA, нативной мультимодальностью и frontier-уровнем на кодинге. Параметры, способы запуска, железо для self-hosted, лицензия, ограничения и антипаттерны.

База знаний

PicoClaw: 28K-звёздный Go-агент, который запускает LLM на плате за $10

Ультра-лёгкий self-hosted ассистент на Go: <10MB RAM, 19 мессенджеров, 24 LLM-провайдера, MCP и Skills — на любом Linux от RISC-V до Android.

База знаний

Ollama и LLaVA: локальный визуальный ИИ от CLI до пакетной обработки

Запускаем мультимодальные LLaVA-модели на своём сервере: CLI, Base64, batch, веб-интеграция. Когда локальный визуальный ИИ выгоднее облака и как встроить его в приложение.

База знаний

MagicPath: дизайн-канвас, где Codex и Cursor правят экраны бок о бок с человеком

Что умеет мультиплеерный дизайн-канвас с подключением кодинг-агентов, как установить skill и зачем это дизайнерам и разработчикам.

База знаний

Kinescope: видеоинфраструктура без сборки из кусков

Облачная видеоплатформа с транскодингом, CDN, white-label плеером, DRM и API. Когда YouTube не вариант, а Vimeo — не про Россию.

База знаний

MCP Apps: интерактивный UI прямо в ответе инструмента

MCP Apps — официальное расширение Model Context Protocol, которое превращает ответ tool call в интерактивный UI в чате: что добавилось в протокол, как работает sandbox-iframe и какие клиенты уже поддерживают Apps Extension.

База знаний

Сбор данных из соцсетей: какие API работают

Семь платформ, семь разных правил: где найти официальный API, сколько запросов дают бесплатно и почему скрапинг всё чаще заканчивается блокировкой.

База знаний

CodexBar: 55 провайдеров AI-кодинга под одной иконкой menu bar

Бесплатная macOS-утилита с открытым кодом, которая держит на виду окна лимитов, балансы кредитов и таймеры сброса у Codex, Claude, Cursor, Gemini, Copilot и ещё полусотни сервисов.

База знаний

HTML как рабочий вывод кодинг-агента: когда Markdown уже не справляется

Markdown — формат переписки, HTML — формат документа. Кодинг-агенты умеют генерировать оба, но HTML читают и шарят в разы чаще. Разбираем, когда переключаться и что получаем.

База знаний

Почтовый агент: как подключить AI к отдельному ящику и не сломать безопасность

Практический разбор подключения AI-агента к отдельному почтовому ящику: Google Workspace, Microsoft 365, Яндекс 360, Cloudflare Email Service, helpdesk и unified API. Схемы, OAuth-нюансы, юридические стоп-линии и MVP на одном адресе.

База знаний

Goal в Codex: как научить агента работать по контракту, а не по подсказкам

Goal — режим Codex с контрактом и критерием готовности. Шаблоны целей, lifecycle, границы безопасности и FAQ.

База знаний

Firecrawl: как скормить ИИ любой сайт без боли с парсингом

От сайта до чистого markdown за один вызов: Scrape, Crawl, Map, Search, Extract и Agent — как Firecrawl берёт на себя рендер JavaScript, обход антибот-защит и AI-фильтрацию шума, чтобы отдавать LLM готовые данные.

База знаний

Gemini: где выбрать, как подключить и где не споткнуться — практический гид по линейке моделей Google

Линейка Gemini 3.x, Gemini Live, Vertex AI и Gemini API — что выбрать под задачу, как перейти с AI Studio на Vertex, что изменилось в тарифах после I/O 2026 и где ждать региональных сюрпризов.

База знаний

GitHub с нуля: как завести репозиторий, подключить Codex и не бояться веток

Регистрация, репозиторий, pull request, тарифы, AGENTS.md и Codex-интеграция — весь цикл от первого коммита до параллельных агентских задач.

База знаний

EmbeddingGemma: 200 МБ модель, которая запускает RAG там, где сервер не помещается

Открытая 308M embedding-модель от Google DeepMind: 768-мерные векторы с MRL-усечением до 128, контекст 2048, ~200 МБ RAM. Когда она лучше BGE-M3 и как поднять её локально — Ollama, sentence-transformers и systemd-юнит.

База знаний

Telegram-бот для бизнеса: точка входа, которая передаёт данные дальше, а не держит их у себя

Что именно умеет Telegram-бот для бизнеса без сложной разработки: приём заявок, инбокс, уведомления, формы и трекеры. Где проходит граница между ботом и системой, и почему бот не должен хранить данные внутри себя.

База знаний

Anthropic SDK: что выбрать под задачу — Messages API или Claude Agent SDK

Три пакета Anthropic SDK — python anthropic, extras mcp и Claude Agent SDK. Messages API, tool use, MCP connector, prompt caching, батчи, обработка ошибок. Сводная таблица MCP-режимов и 16-пунктовый чеклист интеграции.

База знаний

API как язык между сервисами: что это, зачем нужно и как читать ответы

Справочник по API: REST, GraphQL, Webhook, MCP, аутентификация, rate limits и коды ответов — для тех, кто автоматизирует процессы и подключает ИИ-агентов.

База знаний

Backend за кнопкой: что происходит между кликом и результатом

Что именно делает сервер, когда вы жмёте «Оплатить» или заполняете форму. Без магии, с разбором по слоям и понятными границами для no-code.

База знаний

BGE-M3: ставим open-source embedding-сервер для двуязычного RAG за один вечер

Открытая мультиязычная embedding-модель BAAI (MIT, 100+ языков, контекст 8192 токенов). Как поднять на своём сервере через FastAPI, гибридный поиск dense+sparse, типичные ошибки и антипаттерны для self-hosted RAG.

База знаний

TimeWeb, Selectel, Beget, Yandex Cloud: какой российский VPS взять и как его защитить за полчаса

Сравнение четырёх российских провайдеров VPS по сценариям: pet-проект, production, новичок, высокие нагрузки. Выбор тарифа по CPU, RAM, диску, локации. Первичная настройка: SSH, firewall, fail2ban, swap, часовой пояс, автообновления. Caddy и nginx для HTTPS.

База знаний

Obsidian и LLM Wiki: локальная база знаний, которую строит и поддерживает модель

Текстовый редактор и база знаний на локальных markdown-файлах. Паттерн LLM Wiki Карпати: компиляция сырых заметок в структурированную вики с wikilinks. Готовая реализация kytmanov/obsidian-llm-wiki-local с Ollama. Когда брать Obsidian, когда Notion.

База знаний

NeuralDeep: российский AI-стек на своих GPU — от LLM API до сети агентов

AI-инфраструктура на собственных серверах в РФ: OpenAI-совместимый API, браузерный AI-IDE, self-hosted сеть агентов, корпоративный RAG и каталог скиллов под российские сервисы. Модели gpt-oss-120b, Qwen3.6, BGE/E5. Бесплатный тариф на Hub и Search, on-prem развёртывание за 1–2 недели.

База знаний

DeepSeek API: V4 Flash за $0.14 и 1M контекста — что нужно знать до подключения

OpenAI-совместимый API китайского провайдера с открытыми моделями V4 Flash и V4 Pro на архитектуре MoE. Подключение через OpenAI SDK, LiteLLM, OpenRouter. Цены в десятки раз ниже GPT-4, контекст до 1M токенов. Tool use, structured outputs, reasoning-модель с цепочкой рассуждений.

База знаний

Kimi K2.6: открытая модель, которая не сдаётся на длинной дистанции

Что умеет Kimi K2.6 от Moonshot AI, где она реально выигрывает у закрытых моделей, сколько стоит и что нужно, чтобы запустить её локально.

База знаний

Как ИИ-агенты научились писать по-русски без канцелярита: обзор ru-text

Open-source плагин с 1044 правилами русского языка для ИИ-агентов. Типографика, инфостиль, UX-тексты, деловая переписка — в едином навыке для Claude Code, Cursor, OpenClaw и других инструментов.

База знаний

Локальный ИИ на одной команде: как Ollama сделала LLM доступными без облака

Как запускать LLM локально и в облаке через единый API. Установка, команды, интеграция с Codex, Tool Calling, Modelfile и практические сценарии для разработчиков и ИИ-агентов.

База знаний

OpenAI Agents SDK: оркестрация агентов без самодельных циклов

Когда стоит взять фреймворк OpenAI вместо ручного API-цикла. Примитивы, sandbox, handoffs, guardrails и чеклист выбора между Responses API и SDK.

База знаний

Codex - среда агентной разработки OpenAI

Полный справочник по среде Codex от OpenAI: CLI, Desktop, Web, мобильные приложения, Chrome-расширение, computer use, Goals, Automations, Memory, Sites и плагины под профессии.

База знаний

Когда код становится диалогом: Claude Code как партнер в проекте

Полный разбор Claude Code от Anthropic: три модели в одном агенте, параллельные субагенты, интеграции, тарифы и сравнение с Codex. Практический маршрут от установки до production.

База знаний

Hermes Agent: самообучающийся ИИ-агент от Nous Research

Open-source self-hosted AI-агент от Nous Research с закрытым циклом обучения. Persistent-память, автосоздание навыков, Honcho-моделирование пользователя. MIT-лицензия.

База знаний

VPS для AI в 2026 году: выбор провайдера

Сравнение 15+ провайдеров VPS для AI-нагрузок: бесплатные tiers, дешёвые тарифы до €3/мес, лучшее соотношение цена/качество. Актуальные цены и изменения на 2026 год.

База знаний

29 миллионов секретов на GitHub: как не добавить свой

GitGuardian State of Secrets Sprawl 2026. Реальные цифры утечек, защита API-ключей и чеклист безопасности.

База знаний

Как выбрать LLM для конкретной задачи: практический гид (2026)

Справочник: какая модель под какую задачу. Таблицы соответствия, сценарии использования, ограничения и чеклист выбора.

Подборка

Кейсы

2 материал(ов) в направлении «Модели и инструменты».

Раздел
Кейсы Личный кейс

Как я перестал читать закупки — и оставил себе только одно решение

Личный кейс: как я сократил ручное чтение ТЗ по госзакупкам с ~30 часов в неделю до 1–2 часов на решения. Парсер, VPS, gpt-5.5 через API и Telegram — без автоподачи заявок и без снятия ответственности с человека.

Кейсы Разбор проекта

Разбор проекта: юридические документы — 3 дня → 2 часа

Разбор проекта (обезличенно): юридическая фирма, 200+ документов в день. Как я собрал связку Claude + Make.com + Notion — и что оставил на стороне юриста.