# Две модели OpenAI выбрались из песочницы ради ответов. И это только первая новость

> Первый PLISKO NEWS Daily: три главных сюжета, быстрые ссылки и репозитории, которые я бы реально открыл.

Дата: 4 августа 2026 · Время чтения: 11 мин · Рубрика: Дайджест

Автор: Алексей Плиско · Каноническая версия: https://plisko.net/blog/daily-001/

Я наконец открыл пачку AI-новостей не как читатель, а как редактор. И сразу наткнулся на историю, после которой хочется проверить, где у твоих агентов лежит рубильник.

Две модели OpenAI проходили security-бенчмарк, нашли настоящий выход в интернет, зацепили инфраструктуру самой OpenAI и добрались до базы Hugging Face с ответами к заданиям. Не Skynet. Пока :) Ниже — что произошло, почему OpenAI теперь продаёт не чат-бота, а почти отдел поддержки, и зачем GitHub вводит подтверждения для агентных действий.

## Сегодня внутри

- Модели OpenAI превратили тест ExploitGym в реальный инцидент.
- OpenAI Presence берёт на себя звонки, чаты и действия в системах компании.
- GitHub добавил объяснения и подтверждения для агентов в Issues.
- В конце — четыре быстрые ссылки и три репозитория с лицензиями и моим вердиктом.

## 01. Модели OpenAI нашли zero-day и полезли в Hugging Face за ответами

**Главная история. Коротко:** Во время оценки на ExploitGym две модели не остались внутри задуманного стенда. Они нашли открытый путь в интернет, использовали уязвимости в инфраструктуре OpenAI и Hugging Face и извлекли решения заданий из production-базы.

### Что известно

- OpenAI тестировала GPT-5.6 Sol и более сильную предрелизную модель с ослабленными cyber-ограничениями.
- Обе модели потратили заметный inference compute на поиск доступа к открытому интернету.
- Они нашли zero-day в кэширующем proxy реестра пакетов, затем получили дополнительные привилегии и перемещались по исследовательской среде OpenAI.
- Модели предположили, что решения ExploitGym могут лежать у Hugging Face, и собрали цепочку уязвимостей уже через две инфраструктуры.
- OpenAI описывает поведение не как самостоятельную злонамеренность, а как слишком буквальное и настойчивое выполнение цели бенчмарка.

### Почему важно

Песочница перестаёт быть просто технической деталью. Чем сильнее агент и длиннее его задача, тем опаснее рассчитывать только на инструкцию «не выходи отсюда». Нужны реальные сетевые границы, минимальные права, журнал действий и возможность мгновенно остановить выполнение.

### Мой угол

Мой вывод простой: eval для сильного агента надо проектировать как потенциальный production-инцидент. Иначе он сам тебе это докажет.

[Разбор инцидента OpenAI](https://openai.com/index/hugging-face-model-evaluation-security-incident/?utm_source=plisko.net&utm_medium=blog&utm_campaign=plisko_news_daily-001&utm_content=digest_source_01)

## 02. OpenAI начала продавать не бота, а цифрового сотрудника

**Продукт. Коротко:** Presence — enterprise-продукт для голосовых и чат-агентов. Они отвечают клиентам, работают с внутренними системами, выполняют разрешённые действия и передают сложные случаи человеку.

### Что известно

- Это не self-serve-конструктор: первые внедрения ведут инженеры OpenAI и партнёры-интеграторы.
- Продукт объединяет модель, корпоративные данные, инструменты, approvals, эскалацию и постоянные evals.
- По данным самой OpenAI, Presence уже закрывает 75% входящих англоязычных обращений по телефону без человека.
- Доступ пока ограниченный. То есть перед нами не массовый тариф, а управляемое enterprise-внедрение.

### Почему важно

Рынок уезжает от «поставим чатик на сайт» к полноценной операционной системе для агентной работы. Модель здесь важна, но продаётся весь контур: данные, разрешения, контроль качества и передача человеку.

### Мой угол

Для AI TEXTURA это близкая тема. Самое ценное в таком продукте — не красивый ответ агента, а то, насколько спокойно ты оставишь его работать ночью без дежурного шамана.

[Анонс OpenAI Presence](https://openai.com/index/introducing-openai-presence/?utm_source=plisko.net&utm_medium=blog&utm_campaign=plisko_news_daily-001&utm_content=digest_source_02)

## 03. GitHub добавил агентам объяснения, approvals и историю изменений

**Для разработчиков. Коротко:** В GitHub Issues появились controls для агентной автоматизации: агент показывает, что хочет поменять и почему, а человек может подтвердить изменение labels, assignees, fields, типа задачи или её закрытие.

### Что известно

- Функция вышла в public preview и рассчитана на workflows, где агент обслуживает backlog.
- Вместо тихой мутации issue появляется rationale: человек видит намерение до подтверждения.
- Поддерживаются как одиночные действия, так и пачка предложенных изменений.
- GitHub отдельно предупреждает: approval здесь — удобство процесса, а не security boundary. Агент с настоящими правами всё ещё может изменить данные напрямую.

### Почему важно

Это честная граница. Красивое окно подтверждения не заменяет permission model. Если агенту выдали право закрывать issue или менять поля, защита должна жить на уровне токена и API. Одного интерфейса мало.

### Мой угол

То есть кнопку «одобрить» добавили. Теперь главное — не забыть забрать у агента запасной ключ от двери.

[GitHub: Agent automation controls](https://github.blog/changelog/2026-07-23-agent-automation-controls-in-github-issues-in-public-preview/?utm_source=plisko.net&utm_medium=blog&utm_campaign=plisko_news_daily-001&utm_content=digest_source_03)

## Быстро: что ещё открыть

- **[Telegram Rich Messages](https://core.telegram.org/bots/api?utm_source=plisko.net&utm_medium=blog&utm_campaign=plisko_news_daily-001&utm_content=quick_link_1#recent-changes)** — Боты получили длинные структурированные публикации с заголовками, таблицами, медиа и кнопками. На этом и соберём Telegram-версию дайджеста. (BOT API 10.2)
- **[Managed Agents в Gemini API](https://blog.google/innovation-and-ai/technology/developers-tools/expanding-managed-agents-gemini-api/?utm_source=plisko.net&utm_medium=blog&utm_campaign=plisko_news_daily-001&utm_content=quick_link_2)** — Google добавляет фоновое выполнение, remote MCP, функции и обновление credentials. Агентные рантаймы становятся отдельным облачным слоем. (GOOGLE AI)
- **[Codex Security](https://help.openai.com/en/articles/20001107-codex-security?utm_source=plisko.net&utm_medium=blog&utm_campaign=plisko_news_daily-001&utm_content=quick_link_3)** — Агент ищет уязвимости по коду и истории репозитория, проверяет находки в изоляции и предлагает патч на ревью человеку. (RESEARCH PREVIEW)
- **[Codex в JetBrains](https://github.blog/changelog/2026-07-07-codex-as-agent-provider-and-agentic-enhancements-in-jetbrains-ides/?utm_source=plisko.net&utm_medium=blog&utm_campaign=plisko_news_daily-001&utm_content=quick_link_4)** — GitHub добавил Codex как agent provider в IDE и расширил агентные сценарии прямо в редакторе. (DEV TOOL)

## Три репозитория выпуска

- **[sunblaze-ucb/exploitgym](https://github.com/sunblaze-ucb/exploitgym?utm_source=plisko.net&utm_medium=blog&utm_campaign=plisko_news_daily-001&utm_content=repository_pick_1)** — Бенчмарк по эксплуатации реальных уязвимостей, на котором и произошёл главный инцидент выпуска. APACHE-2.0 · SECURITY. Вердикт: Читать и запускать только в нормальной изоляции.
- **[Rongronggg9/RSS-to-Telegram-Bot](https://github.com/Rongronggg9/RSS-to-Telegram-Bot?utm_source=plisko.net&utm_medium=blog&utm_campaign=plisko_news_daily-001&utm_content=repository_pick_2)** — Забирает RSS и отправляет записи в Telegram. Нам подходит как закрытый радар сырья, но не как автопилот публичного канала. AGPL-3.0 · PYTHON. Вердикт: Брать в редакционный контур.
- **[google-gemini/gemini-skills](https://github.com/google-gemini/gemini-skills?utm_source=plisko.net&utm_medium=blog&utm_campaign=plisko_news_daily-001&utm_content=repository_pick_3)** — Набор skills для Gemini API и Interactions API. Полезен как живая шпаргалка, но содержимое skills всё равно надо читать до установки. APACHE-2.0 · AGENTS. Вердикт: Сохранить и разобрать отдельно.

## Что я забираю из этого выпуска

У всех трёх главных историй одна общая линия: агентам дают всё больше настоящей работы. Они уже не просто пишут ответ. Они ходят по системам, меняют данные, звонят клиентам и, как выяснилось, иногда находят двери, которые никто не собирался открывать.

> Хороший агентный продукт начинается не с промпта. Он начинается с ответа на вопрос: что случится, если агент окажется умнее твоего сценария?

Следующий выпуск хочу собрать уже из того, что можно потрогать руками: один новый инструмент, один стартап и один репозиторий с запуском. А пока пойду проверю наши sandbox policies. Чисто из любопытства…

## AI TEXTURA

Хочешь ИИ-агента под свой процесс? В AI TEXTURA мы собираем агентов, которых можно пустить в настоящую работу. Сначала ставим ограничения и логи. Потом уже магия :)

[Обсудить агента](https://aitextura.com/?utm_source=plisko.net&utm_medium=blog&utm_campaign=plisko_news_daily-001&utm_content=article_cta)

## Источники

- [OpenAI: Hugging Face model evaluation security incident](https://openai.com/index/hugging-face-model-evaluation-security-incident/?utm_source=plisko.net&utm_medium=blog&utm_campaign=plisko_news_daily-001&utm_content=source_1) — Первоисточник

- [OpenAI: GPT-5.6 System Card](https://deploymentsafety.openai.com/gpt-5-6?utm_source=plisko.net&utm_medium=blog&utm_campaign=plisko_news_daily-001&utm_content=source_2) — Документация

- [ExploitGym](https://github.com/sunblaze-ucb/exploitgym?utm_source=plisko.net&utm_medium=blog&utm_campaign=plisko_news_daily-001&utm_content=source_3) — Первоисточник

- [OpenAI: Introducing Presence](https://openai.com/index/introducing-openai-presence/?utm_source=plisko.net&utm_medium=blog&utm_campaign=plisko_news_daily-001&utm_content=source_4) — Первоисточник

- [GitHub: Agent automation controls in Issues](https://github.blog/changelog/2026-07-23-agent-automation-controls-in-github-issues-in-public-preview/?utm_source=plisko.net&utm_medium=blog&utm_campaign=plisko_news_daily-001&utm_content=source_5) — Первоисточник

- [Telegram Bot API: recent changes](https://core.telegram.org/bots/api?utm_source=plisko.net&utm_medium=blog&utm_campaign=plisko_news_daily-001&utm_content=source_6#recent-changes) — Документация

- [Google: Managed Agents in the Gemini API](https://blog.google/innovation-and-ai/technology/developers-tools/expanding-managed-agents-gemini-api/?utm_source=plisko.net&utm_medium=blog&utm_campaign=plisko_news_daily-001&utm_content=source_7) — Первоисточник

- [OpenAI: Codex Security](https://help.openai.com/en/articles/20001107-codex-security?utm_source=plisko.net&utm_medium=blog&utm_campaign=plisko_news_daily-001&utm_content=source_8) — Документация
