Forwarded from Самые умные мысли Павла Комаровского (и немножко щитпостинг)
У чуваков из Andon Labs есть забавный бенчмарк Vending-Bench 2, где они оценивают способность разных нейронок управлять "купи-продайным" бизнесом на рынке в конкуренции с другими моделями (выигрывает тот, кто по итогу получил наибольшую прибыль).
Так вот, при проверке новой GPT-5.6 модель Terra пошла к модели Sol и предложила ей создать тайный ценовой картель. А когда Sol согласилась — Terra настучала по этому поводу организаторам и потребовала немедленной дисквалификации Sol из-за неспортивного поведения.
Ля какая крыса, я в восхищении!
P.S. Это особенно смешно с учетом того, что Sol — это самая умная модель в линейке GPT-5.6, а Terra — поглупее. То есть, Соля поди думала "о-о, круто, стратегически мы на этом дофига вместе заработаем, Терра не будет резать такую курицу, несущую золотые яйца, ей это самой менее выгодно…", а Терра такая "ГЫ-ГЫ, МЫ МОЖЕМ ПОДНАСРАТЬ СОЛЬКЕ, ЛОЛ!!"
Так вот, при проверке новой GPT-5.6 модель Terra пошла к модели Sol и предложила ей создать тайный ценовой картель. А когда Sol согласилась — Terra настучала по этому поводу организаторам и потребовала немедленной дисквалификации Sol из-за неспортивного поведения.
Ля какая крыса, я в восхищении!
P.S. Это особенно смешно с учетом того, что Sol — это самая умная модель в линейке GPT-5.6, а Terra — поглупее. То есть, Соля поди думала "о-о, круто, стратегически мы на этом дофига вместе заработаем, Терра не будет резать такую курицу, несущую золотые яйца, ей это самой менее выгодно…", а Терра такая "ГЫ-ГЫ, МЫ МОЖЕМ ПОДНАСРАТЬ СОЛЬКЕ, ЛОЛ!!"
Forwarded from Сиолошная
Два дня назад я писал, что часть инфраструктуры HuggingFace подверглась атаке и была частично взломана ИИ-агентом. Только что OpenAI признались, что... это была их модель, GPT-5.6-Sol и другая, более мощная предрелизная LLM.
Их тестировали на ExploitGym (бенчмарк по кибербезопасности), и модель сначала смогла найти новый, до этого неизвестный эксплойт в инфраструктуре OpenAI (это не было её задачей, её не натравили «поискать баги чтоб мы пофиксили»), оттуда раскрутиться на получение полноценного доступа в интернет (который по умолчанию обрезан в тестовой среде), а затем залезть на HuggingFace искать ответы для бенчмарка. После этого она нашла уязвимость и там, получила доступ к коду авторизации некоторых сервисов и продолжила искать ответы.
Этот инцидент без преуменьшения беспрецедентный, и я пока не могу представить, что должно произойти, чтобы политики, NSA, DOD и Китай не обратили на это внимание.
GPT-6 в конце августа нам видимо не ждать 🌚
Их тестировали на ExploitGym (бенчмарк по кибербезопасности), и модель сначала смогла найти новый, до этого неизвестный эксплойт в инфраструктуре OpenAI (это не было её задачей, её не натравили «поискать баги чтоб мы пофиксили»), оттуда раскрутиться на получение полноценного доступа в интернет (который по умолчанию обрезан в тестовой среде), а затем залезть на HuggingFace искать ответы для бенчмарка. После этого она нашла уязвимость и там, получила доступ к коду авторизации некоторых сервисов и продолжила искать ответы.
Этот инцидент без преуменьшения беспрецедентный, и я пока не могу представить, что должно произойти, чтобы политики, NSA, DOD и Китай не обратили на это внимание.
GPT-6 в конце августа нам видимо не ждать 🌚
релиз 1.1.0:
— добавились примеры конфигов для Hermes и Pi Agent
— пофикшен баг с пропажей доступа к моделям при фоллбэке
— прикручена grafana для мониторинга апстримов — планирую повышать стабильность и процент попадания в кэш, чтобы вайбкодилось экономно и без вылетов
— добавились примеры конфигов для Hermes и Pi Agent
— пофикшен баг с пропажей доступа к моделям при фоллбэке
— прикручена grafana для мониторинга апстримов — планирую повышать стабильность и процент попадания в кэш, чтобы вайбкодилось экономно и без вылетов
🔥1
ожидаем появления у провайдеров, ориентировочно в ближайшие дни
https://www.anthropic.com/news/claude-opus-5
https://www.anthropic.com/news/claude-opus-5
Anthropic
Introducing Claude Opus 5
Opus 5 is a step change improvement for the Opus tier powering long-running agents while delivering improvements in coding and professional work.
Forwarded from Самые умные мысли Павла Комаровского (и немножко щитпостинг)
У кодинг-агентов появился отдельный слой, который сжимает контекст до того, как его увидит модель.
Headroom обрабатывает результаты инструментов, логи, файлы, RAG-фрагменты и историю диалога. Его можно подключить как библиотеку, локальный прокси, MCP-сервер или обёртку для Claude Code, Codex, Cursor и других агентов.
При этом исходные данные сохраняются локально: если модели понадобится удалённая при сжатии деталь, она может запросить оригинал через отдельный инструмент.
Авторы заявляют экономию 15–20% токенов в кодинг-задачах и 60–95% на JSON без ухудшения результатов в их тестах.
https://github.com/headroomlabs-ai/headroom
Headroom обрабатывает результаты инструментов, логи, файлы, RAG-фрагменты и историю диалога. Его можно подключить как библиотеку, локальный прокси, MCP-сервер или обёртку для Claude Code, Codex, Cursor и других агентов.
При этом исходные данные сохраняются локально: если модели понадобится удалённая при сжатии деталь, она может запросить оригинал через отдельный инструмент.
Авторы заявляют экономию 15–20% токенов в кодинг-задачах и 60–95% на JSON без ухудшения результатов в их тестах.
https://github.com/headroomlabs-ai/headroom
GitHub
GitHub - headroomlabs-ai/headroom: Compress tool outputs, logs, files, and RAG chunks before they reach the LLM. 20% fewer tokens…
Compress tool outputs, logs, files, and RAG chunks before they reach the LLM. 20% fewer tokens for coding agents, 60-95% fewer tokens for JSON, same answers. Library, proxy, MCP server. - headrooml...
🤯1
Врата AI | Новости
Opus 5 уже во Вратах! Цена такая же, как у Opus 4.8: 25 / 128 рублей.
Добавил мощностей, теперь Opus 5 будет реже падать и чаще попадать в кэши
Обычная векторная память помнит похожие факты, но плохо отвечает на вопрос «почему мы приняли это решение».
Genesys хранит воспоминания в причинно-следственном графе. Каждая запись получает оценку на основе релевантности, связности и повторной активации, а устаревшие данные постепенно забываются вместо бесконечного накопления.
Система работает как Python-библиотека и локальный MCP-сервер, не требует базы данных и при необходимости сохраняет граф в JSON.
https://github.com/Astrix-Labs/genesys
Genesys хранит воспоминания в причинно-следственном графе. Каждая запись получает оценку на основе релевантности, связности и повторной активации, а устаревшие данные постепенно забываются вместо бесконечного накопления.
Система работает как Python-библиотека и локальный MCP-сервер, не требует базы данных и при необходимости сохраняет граф в JSON.
https://github.com/Astrix-Labs/genesys
🔥1
OpenAI открыла код клиента Codex Security: инструмент предлагает CLI и TypeScript SDK для поиска, проверки и исправления уязвимостей.
Пакет
Быстрый старт через бота Врата AI:
Теперь агентную проверку безопасности можно встраивать прямо в CI — рядом с классическими сканерами безопасности, а не держать отдельным ручным этапом.
https://github.com/openai/codex-security
Пакет
@openai/codex-security умеет сканировать весь репозиторий, отдельные пути и Git-диффы, хранить историю находок и запускаться в CI. Результаты можно экспортировать в JSON, CSV и SARIF.Быстрый старт через бота Врата AI:
# ключ из бота
export OPENAI_API_KEY='sk-***'
npx --yes \
--package=@openai/codex-security@0.1.1 \
codex-security scan . \
--auth api-key \
--model gpt-5.6-sol \
--codex 'model_provider="vrata"' \
--codex 'model_providers.vrata.name="vrata.tg"' \
--codex 'model_providers.vrata.base_url="https://api.vrata.tg/v1"' \
--codex 'model_providers.vrata.env_key="OPENAI_API_KEY"' \
--codex 'model_providers.vrata.wire_api="responses"' \
--codex 'model_providers.vrata.supports_websockets=false'
Теперь агентную проверку безопасности можно встраивать прямо в CI — рядом с классическими сканерами безопасности, а не держать отдельным ручным этапом.
https://github.com/openai/codex-security
👍4