Врата AI | Новости
15 subscribers
38 photos
3 videos
39 links
@vrata_ai_bot — бот для покупки дешёвых моделей Claude и GPT за рубли.
Download Telegram
У чуваков из Andon Labs есть забавный бенчмарк Vending-Bench 2, где они оценивают способность разных нейронок управлять "купи-продайным" бизнесом на рынке в конкуренции с другими моделями (выигрывает тот, кто по итогу получил наибольшую прибыль).

Так вот, при проверке новой GPT-5.6 модель Terra пошла к модели Sol и предложила ей создать тайный ценовой картель. А когда Sol согласилась — Terra настучала по этому поводу организаторам и потребовала немедленной дисквалификации Sol из-за неспортивного поведения.

Ля какая крыса, я в восхищении!

P.S. Это особенно смешно с учетом того, что Sol — это самая умная модель в линейке GPT-5.6, а Terra — поглупее. То есть, Соля поди думала "о-о, круто, стратегически мы на этом дофига вместе заработаем, Терра не будет резать такую курицу, несущую золотые яйца, ей это самой менее выгодно…", а Терра такая "ГЫ-ГЫ, МЫ МОЖЕМ ПОДНАСРАТЬ СОЛЬКЕ, ЛОЛ!!"
Forwarded from Сиолошная
Два дня назад я писал, что часть инфраструктуры HuggingFace подверглась атаке и была частично взломана ИИ-агентом. Только что OpenAI признались, что... это была их модель, GPT-5.6-Sol и другая, более мощная предрелизная LLM.

Их тестировали на ExploitGym (бенчмарк по кибербезопасности), и модель сначала смогла найти новый, до этого неизвестный эксплойт в инфраструктуре OpenAI (это не было её задачей, её не натравили «поискать баги чтоб мы пофиксили»), оттуда раскрутиться на получение полноценного доступа в интернет (который по умолчанию обрезан в тестовой среде), а затем залезть на HuggingFace искать ответы для бенчмарка. После этого она нашла уязвимость и там, получила доступ к коду авторизации некоторых сервисов и продолжила искать ответы.

Этот инцидент без преуменьшения беспрецедентный, и я пока не могу представить, что должно произойти, чтобы политики, NSA, DOD и Китай не обратили на это внимание.

GPT-6 в конце августа нам видимо не ждать 🌚
релиз 1.1.0:

— добавились примеры конфигов для Hermes и Pi Agent

— пофикшен баг с пропажей доступа к моделям при фоллбэке

— прикручена grafana для мониторинга апстримов — планирую повышать стабильность и процент попадания в кэш, чтобы вайбкодилось экономно и без вылетов
🔥1
Альтман: «Мы уже практически создали джинна, который способен исполнять любые желания»

[буквально пять минут спустя]

— «БЛЭТ, джинн от нас сбежал и начал совершать уголовные преступления в интернете!!»
Opus 5 уже во Вратах!

Цена такая же, как у Opus 4.8: 25 / 128 рублей.
🔥3
У кодинг-агентов появился отдельный слой, который сжимает контекст до того, как его увидит модель.

Headroom обрабатывает результаты инструментов, логи, файлы, RAG-фрагменты и историю диалога. Его можно подключить как библиотеку, локальный прокси, MCP-сервер или обёртку для Claude Code, Codex, Cursor и других агентов.

При этом исходные данные сохраняются локально: если модели понадобится удалённая при сжатии деталь, она может запросить оригинал через отдельный инструмент.

Авторы заявляют экономию 15–20% токенов в кодинг-задачах и 60–95% на JSON без ухудшения результатов в их тестах.

https://github.com/headroomlabs-ai/headroom
🤯1
Врата AI | Новости
Opus 5 уже во Вратах! Цена такая же, как у Opus 4.8: 25 / 128 рублей.
Добавил мощностей, теперь Opus 5 будет реже падать и чаще попадать в кэши
Обычная векторная память помнит похожие факты, но плохо отвечает на вопрос «почему мы приняли это решение».

Genesys хранит воспоминания в причинно-следственном графе. Каждая запись получает оценку на основе релевантности, связности и повторной активации, а устаревшие данные постепенно забываются вместо бесконечного накопления.

Система работает как Python-библиотека и локальный MCP-сервер, не требует базы данных и при необходимости сохраняет граф в JSON.

https://github.com/Astrix-Labs/genesys
🔥1
OpenAI открыла код клиента Codex Security: инструмент предлагает CLI и TypeScript SDK для поиска, проверки и исправления уязвимостей.

Пакет @openai/codex-security умеет сканировать весь репозиторий, отдельные пути и Git-диффы, хранить историю находок и запускаться в CI. Результаты можно экспортировать в JSON, CSV и SARIF.

Быстрый старт через бота Врата AI:

# ключ из бота
export OPENAI_API_KEY='sk-***'

npx --yes \
--package=@openai/codex-security@0.1.1 \
codex-security scan . \
--auth api-key \
--model gpt-5.6-sol \
--codex 'model_provider="vrata"' \
--codex 'model_providers.vrata.name="vrata.tg"' \
--codex 'model_providers.vrata.base_url="https://api.vrata.tg/v1"' \
--codex 'model_providers.vrata.env_key="OPENAI_API_KEY"' \
--codex 'model_providers.vrata.wire_api="responses"' \
--codex 'model_providers.vrata.supports_websockets=false'


Теперь агентную проверку безопасности можно встраивать прямо в CI — рядом с классическими сканерами безопасности, а не держать отдельным ручным этапом.

https://github.com/openai/codex-security
👍4