GPT-6 Sol и Luna: что изменилось в цене, возможностях и доступности
OpenAI выпустила GPT-6 Sol и Luna. Разбираем подтверждённые цены API, доступность, кэширование и честно отделяем результаты отдельных бенчмарков от выводов о реальной работе.
Направление
LLM, API, сравнение моделей и выбор под задачу.
Подборка
17 материал(ов) в направлении «Модели и инструменты».
OpenAI выпустила GPT-6 Sol и Luna. Разбираем подтверждённые цены API, доступность, кэширование и честно отделяем результаты отдельных бенчмарков от выводов о реальной работе.
OpenAI выпустила GPT-6 Astra. Разбираем, почему главное в релизе — не заявление про «эру AGI», а возможное снижение стоимости выполнения задач и первый «критический» уровень кибервозможностей с жёсткими ограничениями доступа.
Google представила Gemini 3.8 Flash и Flash Cyber. Первая может использовать больше токенов на сложных задачах ради качества, а вторая ищет и исправляет уязвимости и доступна только одобренным участникам Fairwind.
Anthropic выпустила Claude Fable 5.1 и Mythos 5.1. Разбираем, почему главное в релизе — не бенчмарки, а снижение цены кэш-чтения на 75% и что это меняет для агентной работы.
Z.ai выпустила GLM-5.3-Flash: 320 млрд параметров, 18 млрд активных, нативная мультимодальность и цена в десять раз ниже GLM-5.2. Веса открыты под MIT.
Binance представила Agent OS — инфраструктурный слой между AI-агентом и биржей. Разбираем, как устроена платформа, почему MCP — только один из способов подключения и что это меняет для крипто-агентов.
Microsoft Execution Containers, Agent Identity, Intelligent Terminal и локальные модели Aion. Факты с Build 2026 — без хайпа.
Google выпустила Gemini 3.7 Flash: 1 млн контекста, $0.75 за вход, скачок на DeepSWE и Terminal-bench. Модель заточена под агентные сценарии и код.
ChatGPT desktop для Linux вышел в превью. Пакеты для Ubuntu, Debian и Fedora. Что ставить, как обновлять и где подводные камни.
Обзор AnyModel — агрегатора LLM API: 34 модели через один ключ, оплата за токены картой и СБП, Ghost Mode с нулевым хранением, и цены в 50 раз ниже прямых провайдеров.
Релиз Claude Opus 5: рассуждение по умолчанию, 1 млн токенов контекста, пять уровней усилия, бета-фичи для инструментов и fallback. Что менять в коде и как проверить на своих задачах.
Обзор Rocket.new — платформы, объединяющей исследование рынка, генерацию продакшен-приложений и мониторинг конкурентов в одном контуре с единой кредитной системой.
Флагманская модель Moonshot AI: контекст 1M токенов, режим размышления, визуальный ввод, вызов инструментов и автоматическое кеширование контекста. Полный разбор с примерами кода на Python и curl.
Разбор релиза Anthropic 9 июня 2026: что внутри Fable 5, чем он отличается от Opus 4.8, сколько стоит и что с ним делать малому и среднему бизнесу.
Gemini 4 не вышел. Зато Google показал, как агенты будут работать внутри ваших документов — и почему это меняет правила для тех, кто строит системы под ключ.
Nvidia инвестировала более $40 млрд в AI-компании в 2025 году. Разбираем, как чипмейкер стал главным венчурным игроком индустрии и что это значит для рынка.
Anthropic арендовала у SpaceX суперкомпьютер Colossus 1 (220 000 GPU) и удвоила лимиты Claude Code. Разбираем, что это значит для разработчиков и рынка ИИ.
Подборка
16 материал(ов) в направлении «Модели и инструменты».
Проекты в ChatGPT работают как постоянный рабочий контекст, а не как папка для чатов. Показываю, как я устраиваю проект и когда он вообще нужен.
Яндекс открыл базовую модель AliceAI-T5-35B-A0.6B, лежащую в основе быстрых ИИ-ответов в Поиске. Разбираю архитектуру, бенчмарки и ограничения релиза.
Anthropic открыла blueprint для commerce-агентов: агент-покупатель и агент-продавец. Разбираем, почему главное в нём — не автономия покупки, а встроенный человеческий контроль.
Почему совет «начинайте с простого» из руководств OpenAI и Anthropic совпадает с важным правилом безопасности OWASP — и как применить это к своим агентам.
Marin запустила обучение модели на 535 млрд параметров и открыла почти весь процесс — данные, конфигурацию, потери и ошибки. Зачем за этим следить.
Anthropic показала CHIVE — систему, которая находит причину ошибки ИИ не догадкой, а серией контрфактических экспериментов. ИИ становится исследователем другого ИИ.
Qwen выпустила плотную 27B-модель с гибридным вниманием, контекстом 262K и приростом +29 пунктов на агентных бенчмарках. Apache 2.0, уже на Hugging Face.
С 14 августа Auto Mode — режим по умолчанию для Pro, Max и Team. Агент действует, классификатор проверяет, человек наблюдает.
DeepSeek выпустила V4-Pro-0813 с упором на агентные сценарии и tool calls. С 16 августа — пиковые и внепиковые тарифы, рост до 3×.
Бесплатный AI-генератор музыки с вокалом, 4160 стилями и API. Melodia v3 — 15 секунд до первого звука, безлимит на последней модели.
Четыре сервиса для выпуска карт, которыми можно платить за ChatGPT, Claude, API и другие зарубежные ИИ-инструменты из России. Личный опыт и конкретные нюансы.
Open-source платформа, превращающая coding-агентов в полноценных участников команды: назначение задач, очереди, навыки, автономное выполнение и единый dashboard для локальных и облачных runtime.
Чем reasoning-модели (o3, Claude Extended Thinking, Gemini Deep Think, DeepSeek R1) отличаются от обычных LLM, какие техники дают многошаговое рассуждение и где у этого подхода фундаментальные границы.
Пошаговая инструкция: создаём OAuth-приложение в Яндексе, получаем токен за две минуты, передаём его ИИ и запускаем SEO-анализ Метрики и Вебвизора. Без кода на сервере.
Как подключить VectCutAPI к Codex и получить автономный видеомонтаж через MCP: cut, субтитры, озвучка, эффекты. Что работает уже сейчас, что — нет.
OpenAI выпустила GPT-5.5 Instant. Я тестировал её весь вечер и понял: это изменение правил игры для продуктовых команд. Вот почему скорость — это не техническая метрика, а конверсия.
Подборка
51 материал(ов) в направлении «Модели и инструменты».
Технический разбор Jev от TypeSafe AI: концепция System One моделей, примитивы Noul, Choice и Score, SDK, интеграция с Vercel AI Gateway и использование как децижн-слоя для ИИ-агентов.
Как устроены Plugins в ChatGPT, чем они отличаются от Apps, как подключать сервисы, использовать Work, задачи и Remotion в реальной работе.
MCP-сервер Т-Инвестиций — инструмент, который подключает ИИ-агентов к брокерскому счёту через протокол Model Context Protocol. Позволяет анализировать рынок, управлять портфелем и торговать текстовыми командами без программирования.
Как Cloudflare соединила Workers AI и AI Gateway в единый слой: модели любого провайдера, кэш, резерв, лимиты и бюджеты через один вызов.
Справочник по Unsloth: варианты инструмента, QLoRA-дообучение, подготовка датасета, экспорт в GGUF, запуск в Ollama и LM Studio.
Полный справочник по AI-агентам для новичков: что такое агент, чем отличается от чат-бота, какие бывают типы, из чего состоит, какие фреймворки существуют и как начать использовать — простыми словами без жаргона.
Родной тип сообщения в Telegram для интерактивных списков задач: как бот отправляет и редактирует чеклисты от имени бизнес-аккаунта, параметры методов, лимиты и сценарии автоматизации.
Бизнес-функции Telegram превратили личный аккаунт в канал продаж и поддержки. Бот, подключённый к аккаунту, работает за вас — читает, отвечает, выставляет счета. Клиент даже не подозревает, что общается с машиной.
Практический разбор поискового API Tavily: пять методов, кредитная модель тарификации, тарифы и лимиты запросов. Как подключить агента к живому вебу без собственных парсеров.
Open-source библиотека для синтеза, распознавания и детекции русской речи на CPU без облака и API-ключей
Полный обзор экосистемы Qwen от Alibaba Cloud: 12 семейств моделей, от текстовых LLM Qwen3.5/3.6 до мультимодальных Omni, визуальных VL, кодинг-агентов Coder, генерации изображений, TTS/ASR, embedding/reranker и world models. Архитектура Dense и MoE, 201 язык, лицензии, сравнение с Llama и Mistral.
Сквозная аналитика: что это, как работает связка сайт-реклама-CRM-телефония, когда Roistat оправдан, а когда нет. Тарифы по официальному прайсу, шаги внедрения, альтернативы и антипаттерны.
Как настроить права доступа для ИИ-агентов и интеграций: принцип минимальных привилегий, типы ролей, практика в Notion и базах данных, чеклист перед запуском.
Платформа OpenAI для production-агентов: визуальный конструктор Agent Builder, Agents SDK, ChatKit, Evals. Узлы, MCP-коннекторы, guardrails, тарифы и реальные кейсы.
OpenAI Responses API — единый эндпойнт для запуска моделей с встроенными инструментами, многоходовыми вызовами и серверным состоянием. Разбор архитектуры, отличий от Chat Completions, миграции и тарифов.
Полный разбор восьми уровней снижения расходов на токены Claude — от выбора модели и уровней effort до кэширования промптов, управления контекстом, субагентов, структуры промптов, batch API и мониторинга. С практическими примерами команд Claude Code и кода на Python.
Self-hosted веб-интерфейс для LLM с поддержкой Ollama, OpenAI-совместимых API, RAG, многопользовательского режима и плагинов. Запуск одной Docker-командой.
Полный справочник по MiniMax M3: открытая модель с контекстом 1M токенов, архитектурой MSA, нативной мультимодальностью и frontier-уровнем на кодинге. Параметры, способы запуска, железо для self-hosted, лицензия, ограничения и антипаттерны.
Ультра-лёгкий self-hosted ассистент на Go: <10MB RAM, 19 мессенджеров, 24 LLM-провайдера, MCP и Skills — на любом Linux от RISC-V до Android.
Запускаем мультимодальные LLaVA-модели на своём сервере: CLI, Base64, batch, веб-интеграция. Когда локальный визуальный ИИ выгоднее облака и как встроить его в приложение.
Что умеет мультиплеерный дизайн-канвас с подключением кодинг-агентов, как установить skill и зачем это дизайнерам и разработчикам.
MCP Apps — официальное расширение Model Context Protocol, которое превращает ответ tool call в интерактивный UI в чате: что добавилось в протокол, как работает sandbox-iframe и какие клиенты уже поддерживают Apps Extension.
Семь платформ, семь разных правил: где найти официальный API, сколько запросов дают бесплатно и почему скрапинг всё чаще заканчивается блокировкой.
Бесплатная macOS-утилита с открытым кодом, которая держит на виду окна лимитов, балансы кредитов и таймеры сброса у Codex, Claude, Cursor, Gemini, Copilot и ещё полусотни сервисов.
Markdown — формат переписки, HTML — формат документа. Кодинг-агенты умеют генерировать оба, но HTML читают и шарят в разы чаще. Разбираем, когда переключаться и что получаем.
Практический разбор подключения AI-агента к отдельному почтовому ящику: Google Workspace, Microsoft 365, Яндекс 360, Cloudflare Email Service, helpdesk и unified API. Схемы, OAuth-нюансы, юридические стоп-линии и MVP на одном адресе.
Goal — режим Codex с контрактом и критерием готовности. Шаблоны целей, lifecycle, границы безопасности и FAQ.
От сайта до чистого markdown за один вызов: Scrape, Crawl, Map, Search, Extract и Agent — как Firecrawl берёт на себя рендер JavaScript, обход антибот-защит и AI-фильтрацию шума, чтобы отдавать LLM готовые данные.
Линейка Gemini 3.x, Gemini Live, Vertex AI и Gemini API — что выбрать под задачу, как перейти с AI Studio на Vertex, что изменилось в тарифах после I/O 2026 и где ждать региональных сюрпризов.
Регистрация, репозиторий, pull request, тарифы, AGENTS.md и Codex-интеграция — весь цикл от первого коммита до параллельных агентских задач.
Открытая 308M embedding-модель от Google DeepMind: 768-мерные векторы с MRL-усечением до 128, контекст 2048, ~200 МБ RAM. Когда она лучше BGE-M3 и как поднять её локально — Ollama, sentence-transformers и systemd-юнит.
Что именно умеет Telegram-бот для бизнеса без сложной разработки: приём заявок, инбокс, уведомления, формы и трекеры. Где проходит граница между ботом и системой, и почему бот не должен хранить данные внутри себя.
Три пакета Anthropic SDK — python anthropic, extras mcp и Claude Agent SDK. Messages API, tool use, MCP connector, prompt caching, батчи, обработка ошибок. Сводная таблица MCP-режимов и 16-пунктовый чеклист интеграции.
Справочник по API: REST, GraphQL, Webhook, MCP, аутентификация, rate limits и коды ответов — для тех, кто автоматизирует процессы и подключает ИИ-агентов.
Что именно делает сервер, когда вы жмёте «Оплатить» или заполняете форму. Без магии, с разбором по слоям и понятными границами для no-code.
Открытая мультиязычная embedding-модель BAAI (MIT, 100+ языков, контекст 8192 токенов). Как поднять на своём сервере через FastAPI, гибридный поиск dense+sparse, типичные ошибки и антипаттерны для self-hosted RAG.
Сравнение четырёх российских провайдеров VPS по сценариям: pet-проект, production, новичок, высокие нагрузки. Выбор тарифа по CPU, RAM, диску, локации. Первичная настройка: SSH, firewall, fail2ban, swap, часовой пояс, автообновления. Caddy и nginx для HTTPS.
Текстовый редактор и база знаний на локальных markdown-файлах. Паттерн LLM Wiki Карпати: компиляция сырых заметок в структурированную вики с wikilinks. Готовая реализация kytmanov/obsidian-llm-wiki-local с Ollama. Когда брать Obsidian, когда Notion.
AI-инфраструктура на собственных серверах в РФ: OpenAI-совместимый API, браузерный AI-IDE, self-hosted сеть агентов, корпоративный RAG и каталог скиллов под российские сервисы. Модели gpt-oss-120b, Qwen3.6, BGE/E5. Бесплатный тариф на Hub и Search, on-prem развёртывание за 1–2 недели.
OpenAI-совместимый API китайского провайдера с открытыми моделями V4 Flash и V4 Pro на архитектуре MoE. Подключение через OpenAI SDK, LiteLLM, OpenRouter. Цены в десятки раз ниже GPT-4, контекст до 1M токенов. Tool use, structured outputs, reasoning-модель с цепочкой рассуждений.
Что умеет Kimi K2.6 от Moonshot AI, где она реально выигрывает у закрытых моделей, сколько стоит и что нужно, чтобы запустить её локально.
Open-source плагин с 1044 правилами русского языка для ИИ-агентов. Типографика, инфостиль, UX-тексты, деловая переписка — в едином навыке для Claude Code, Cursor, OpenClaw и других инструментов.
Как запускать LLM локально и в облаке через единый API. Установка, команды, интеграция с Codex, Tool Calling, Modelfile и практические сценарии для разработчиков и ИИ-агентов.
Когда стоит взять фреймворк OpenAI вместо ручного API-цикла. Примитивы, sandbox, handoffs, guardrails и чеклист выбора между Responses API и SDK.
Полный справочник по среде Codex от OpenAI: CLI, Desktop, Web, мобильные приложения, Chrome-расширение, computer use, Goals, Automations, Memory, Sites и плагины под профессии.
Полный разбор Claude Code от Anthropic: три модели в одном агенте, параллельные субагенты, интеграции, тарифы и сравнение с Codex. Практический маршрут от установки до production.
Open-source self-hosted AI-агент от Nous Research с закрытым циклом обучения. Persistent-память, автосоздание навыков, Honcho-моделирование пользователя. MIT-лицензия.
Сравнение 15+ провайдеров VPS для AI-нагрузок: бесплатные tiers, дешёвые тарифы до €3/мес, лучшее соотношение цена/качество. Актуальные цены и изменения на 2026 год.
GitGuardian State of Secrets Sprawl 2026. Реальные цифры утечек, защита API-ключей и чеклист безопасности.
Справочник: какая модель под какую задачу. Таблицы соответствия, сценарии использования, ограничения и чеклист выбора.
Подборка
2 материал(ов) в направлении «Модели и инструменты».
Личный кейс: как я сократил ручное чтение ТЗ по госзакупкам с ~30 часов в неделю до 1–2 часов на решения. Парсер, VPS, gpt-5.5 через API и Telegram — без автоподачи заявок и без снятия ответственности с человека.
Разбор проекта (обезличенно): юридическая фирма, 200+ документов в день. Как я собрал связку Claude + Make.com + Notion — и что оставил на стороне юриста.