Перейти к основному содержимому

Новые модели, гибкие лимиты и экспорт цен

Мы упростили создание первого API-ключа, добавили гибкое управление лимитами расходов и расширили каталог моделей.

Что нового

  • Новые модели в доступе: мы добавили Kimi K3, GPT-5.6, Gpt Image 2, Gemini 3.1, Nano Banana 2, Veo и другие. Примеры запросов вы найдете в каталоге моделей.

  • Быстрое создание API-ключа: сгенерируйте свой первый API-ключ Caila прямо в сниппете запроса к модели или конфигурации для кодинг-агента, чтобы сразу начать работу.

  • Гибкая настройка лимитов расходов: для API-ключа можно установить сразу несколько лимитов (например 100 рублей в час и 1 000 рублей в день) и настроить поведение при создании или увеличении лимита.

  • OpenAI Responses API: поддержан оригинальный формат API OpenAI для создания и управления процессом генерации ответов.

    Пример запроса
    curl -L 'https://caila.io/api/providers/openai/v1/responses' \
    -H 'Content-Type: application/json' \
    -H 'Authorization: <Your_Caila_API_key>' \
    -d '{
    "model": "gpt-5.6-sol",
    "input": "Are semicolons optional in JavaScript?"
    }'
  • Цены моделей в XLSX: выгрузите прайс-лист с помощью кнопки Экспорт цен (xlsx) на странице каталога для удобного анализа и планирования бюджета.

  • Обратная связь в один клик: в боковом меню появился пункт Обратная связь, чтобы отправить обращение в службу поддержки прямо из интерфейса.

  • Переключение между аккаунтами: теперь доступно в боковом меню без перехода на отдельную страницу.

Аналитика по API-ключам и умные настройки в чате

Что нового:

  • Обновленный чат с умными настройками: теперь в чате для сравнения моделей на вкладке Параметры отображаются только настройки, применимые для выбранной модели. Редактирование тела запроса также доступно на вкладке JSON.
  • Расходы по каждому API-ключу: в разделе Аналитика появилась новая вкладка Разбивка по ключам, которая поможет отслеживать, какие из ключей потребляют больше ресурсов.

Новая Caila: передовые модели и интеграции для разработчиков

Мы полностью обновили интерфейс платформы, превратив ее в быстрый и удобный хаб для доступа к ведущим кодинговым LLM. Карточка каждой модели сразу показывает цены и готовые сниппеты запросов, а также настроек для популярных кодинг-агентов.

Perplexity, Manus и Google TTS

Мы добавили доступ к Perplexity, Manus и Google TTS с поддержкой нативного формата запросов и публичные цены моделей.

Основные обновления:

  • Perplexity: сервис AI-поиска, который находит в интернете актуальную информацию по запросу и возвращает краткий структурированный ответ со ссылками на первоисточники. Подробнее
  • Manus: универсальный AI-агент, который не просто отвечает на вопросы, а самостоятельно выполняет задачи. Подробнее
  • Google TTS: поддержка синтеза речи с Gemini-моделями. Доступно 30 голосов, различные форматы вывода (LINEAR16, MP3, OGG_OPUS) и режим стриминга. Подробнее
  • Публичный доступ к ценам через API: метод GET /api/mlpcore/pricing возвращает актуальные цены на модели без авторизации.

Биллинг:

  • Отчет по расходам LLM теперь доступен за последние 120 дней.
  • Ускорено обновление данных о расходах и балансе: данные теперь обновляются в течение минуты.
  • Унифицирован учет токенов по всем провайдерам.

Детализация расходов и график доступного остатка лимитов

В этом релизе — новые модели OpenAI и новые возможности отслеживания расходов.

Основные изменения:

  • Расходы по API-ключам: просматривайте лимиты расходов и графики восполнения доступного остатка в разделе Моё пространство → Отчеты → Расходы по API-ключам.

  • Email-уведомления о приближении к лимитам расходов API-ключей: укажите адреса для получения сообщений в настройках аккаунта.

  • Расширенный отчет по расходам LLM: теперь в отчете доступна группировка данных по дням или за месяц, фильтр по API-ключам и детализация по типам токенов: входные, выходные, кэшированные.

    Чтобы скачать отчет:

    1. В разделе Моё пространство → Отчеты → Биллинг выберите диапазон дат.
    2. Нажмите Отчет по расходам LLM и укажите параметры отчета.
  • Новые модели OpenAI: gpt-5.4, gpt-5.4-pro, gpt-5.3-chat-latest, gpt-5.3-codex доступны в сервисе OpenAI Proxy.

    Пример запроса
    curl -L 'https://caila.io/api/adapters/openai/v1/responses' \
    -H 'Content-Type: application/json' \
    -H 'Authorization: <Your_Caila_API_key>' \
    -d '{
    "model": "gpt-5.4",
    "input": "Are semicolons optional in JavaScript?"
    }'
  • В разделе Моё пространство → Отчеты → Цены на модели добавлены поиск по моделям и вендорам и сортировка по столбцам.


Нашли баг, придумали обходной путь или просто есть мнение об обновлении? Пишите в чат для разработчиков

Запуск MCP-серверов из Git и единая таблица цен

Встречайте обновление платформы! Мы добавили запуск MCP-серверов из Git-репозиториев для быстрой и удобной интеграции. А новая страница цен поможет выбрать подходящую модель и планировать расходы.

Что нового

  • Единая страница с ценами: страница Цены моделей отображает доступные модели и стоимость обращения к ним, чтобы вы могли сравнивать модели по цене и выбрать подходящую.
  • Запуск MCP-серверов из Git: теперь вы можете разворачивать MCP-серверы, просто указав ссылку на Git-репозиторий. Поддерживаются Node.js 18+, Python 3.10+, Rust 1.70+.
  • MCP-сервер для поиска через DuckDuckGo: доступен в сервисе DuckDuckGo / Search MCP и готов к использованию.
  • Расширенный API для истории запросов: получайте больше данных об истории обращений к моделям, включая стоимость и содержимое запросов и ответов. Подробнее в документации

Нашли баг, придумали обходной путь или просто есть мнение об обновлении? Пишите в чат для разработчиков

Маскирование данных и контроль расходов

В этом релизе добавлена интеграция с Jay Guard для защиты данных в запросах к LLM, кэширование промтов для Claude, а также реализованы важные доработки лимитов API-ключей и биллинга.

Маскирование данных в запросах

Шлюз безопасности Jay Guard обнаруживает и защищает персональные данные при отправке запросов к LLM. В зависимости от настроенных правил, Jay Guard блокирует отправку запроса или маскирует данные, заменяя реальные значения плейсхолдерами и восстанавливая их в ответе.

MCP-серверы

В этом релизе Caila добавлена поддержка MCP-серверов, пошаговый мастер создания всех типов сервисов, автоматическая генерация документации, а также повышена надежность и стабильность работы.

  • MCP-серверы: платформа предоставляет готовые MCP-серверы и прототипы для запуска — их можно найти в разделе каталога MCP-серверы, а также возможность развернуть свой MCP-сервер из Docker-образа или NPM-пакета (смотрите подробную инструкцию).

  • Пошаговый мастер создания сервисов. Теперь создание сервиса начинается с выбора типа:

    • MLP-сервис;
    • MCP-сервер;
    • Веб-приложение.

    Дальнейшие шаги и набор настроек адаптированы для выбранного типа.

  • Автогенерация документации: для созданного сервиса формируется инструкция по его использованию с примерами запросов. Отображается в разделе Обзор карточки сервиса с пометкой «Создано автоматически» и доступна для редактирования.

  • Автоматический перезапуск проблемных инстансов: платформа отслеживает работу ML-сервисов и перезапускает их, если количество ошибок обработки запросов выше порога.

  • Исправлена некорректная обработка стрим-ответов адаптеров по методу predict-with-config-stream.

Nano Banana Pro, Fal.ai и Gamma

В этом релизе Caila добавлены новые ML-модели, поддержка нативного формата Claude, получение баланса по API, а также улучшения биллинга и UX.

Новые модели

  • Nano Banana Pro (Gemini 3 Pro Image Preview) — новая модель от Google для генерации изображений по текстовому описанию. Доступна в сервисе Google / Gemini Image. В запросе укажите модель gemini-3-pro-image-preview.
  • Fal.ai — новый сервис-адаптер для генерации видео: image-to-video или text-to-video. Доступные модели указаны в описании сервиса.
  • Gamma — новый сервис-адаптер для генерации презентаций.

Sora 2, мастер создания сервиса и детализация расходов

Ключевые обновления в этом релизе:

  • Sora 2: новейшая модель для генерации видео теперь доступна в РФ с оплатой в рублях. Подробнее
  • Гибкий выбор провайдера для доступа к моделям OpenAI. Подробнее
  • Детализация расходов: можно посмотреть данные в разбивке по моделям и заголовку Z-billingId в API-запросах. Подробнее
  • Мастер создания ML-сервиса: единый пользовательский путь включает все необходимые операции и сокращает время запуска сервиса. Подробнее