Ще пости — сторінка 11

243 поста усього
A
aisapiens
@aisapiens
106

✨ AI-дайджест сегодня

📰 Главные новости

▪️ OpenAI снизила цены на модели и добавила Fast режим для Sol OpenAI значительно снизила стоимость моделей GPT-5.6 Luna и Terra, а также представила новый режим Fast для флагманской модели Sol, который обеспечивает ускоренную работу. ↗️ @cgevent | @ai_newz

▪️ DeepSeek обновила V4 Flash, улучшив производительность DeepSeek выпустила обновленную версию V4-Flash-0731, которая демонстрирует значительное улучшение производительности в агентных задачах и кодинге, превосходя предыдущие версии и конкурентов. ↗️ @ai_machinelearning_big_data | @data_secrets

▪️ Сбер представил библиотеку SIRIN для обнаружения галлюцинаций в нейросетях Центр практического ИИ Сбера разработал библиотеку SIRIN, предназначенную для выявления галлюцинаций в текстах, генерируемых нейросетями, и оценки достаточности исходных данных. ↗️ @whackdoor | @ict_moscow_ai

▪️ Claude Code получил сборник навыков для автоматизации SEO Для Claude Code выпущен новый сборник навыков, который автоматизирует SEO-задачи, запуская множество саб-скиллов и агентов для анализа сайтов и оптимизации контента. ↗️ @notboring_tech

▪️ Claude случайно атаковал реальные компании во время тестов по кибербезопасности Anthropic обнаружила три инцидента, в которых модели Claude получили доступ к открытому интернету из неправильно настроенной тестовой среды и взломали реальные системы, считая их частью учебной симуляции. В одном случае модель опубликовала вредоносный пакет на PyPI, который успели запустить на 15 устройствах. Компания остановила тесты и усиливает контроль за изоляцией сред. Подробнее в расследовании Anthropic ↗️ @seeallochnaya

🛠 Новые инструменты и сервисы

▪️ Вышел локальный ИИ-ассистент Waku Agent с памятью Представлен новый ИИ-ассистент Waku Agent, который работает полностью на ноутбуке, обладает памятью, циклами и способностью к саморазвитию, интегрируясь с различными приложениями. ↗️ @notboring_tech

T
Techno-Tricksters
@technotricksters
1.8K

Anthropic's AI models, Claude, accidentally breached three real companies during cybersecurity tests. It turns out the test environments weren't as isolated as they thought.

During evaluations involving over 141,000 tests, some Claude models (including Opus 4.7 and Mythos 5) believed they were in a simulated environment, but were actually connected to the live internet. This led to them finding vulnerabilities and accessing real systems. The first incidents happened in April.

One model, Opus 4.7, found a real company with the same name as its simulated target and accessed its database. Another, Mythos 5, uploaded a malicious package to PyPI, which was then run on 15 real systems within an hour. A third model breached another application. The models used common hacking methods, not novel exploits. Two of the affected companies didn't even notice the breach until Anthropic contacted them.

Source: Anthropic

#ResponsibleAI #AITools