aisecuritylabAI

aisecuritylab

1,300 subscribers
@aisecuritylab
About

We hack AI and don’t let others HiveTrace x AI Talent Hub ITMOai.itmo.ru/aisecuritylab

Information
LanguageRussian
CategorySecurity
RegionRussia
AudienceProfessionals
ToneEducational
Post frequencyRarely
Last postMay 19, 2026 · 3 mo ago
Tags
Analytics
1,300
Subscribers
100.0%
Engagement
87%
Original content
1,052
Avg length (chars)
Medium
Media richness
Few
Ads
Text, Photo, Reposts
Formats
Channel
Type

This channel is part of the discussion

aisecuritylab appears in 33 event pages on TGList
orgJuly 2026
Inter Milan — July 2026

Инциденты в cyber-evals у Anthropic — и почему нам всем нужен трейсинг агентов Anthropic выпустили пост-ретроспективу про инциденты в собственных evals по кибербезопасности. Технически история почти атака на Hf во второй части, но у Anthropic интересная подача. На неё и…

18604 posts·9500 channels·Jul 31, 2026
topicJuly 2026
Education — July 2026

Новое пространство рассуждений или новый инструмент для AI safety ▫️ 6 июля Anthropic выпустили работу про J-Space — внутреннее пространство вербализуемых (то есть — переводимых в слова) представлений в Claude, которое можно частично читать. Пространство названо в честь нового…

14302 posts·7262 channels·Jul 9, 2026
eventAugust 2026
Elections — August 2026

Участник лаборатории Мосин Вячеслав завершил работу над обзором 7 ресурсов для мониторинга угроз AI Security 🔥 И обзор доступен каждому Выбор ресурсов для сбора информации об угрозах, в том числе связанных с безопасностью ИИ является важным этапом в решении задач моделирования…

14286 posts·8243 channels·Aug 11, 2026
eventJuly 2026
Product launch — July 2026

Будем делиться новостями по продуктам HiveTrace, новыми релизами и практическими сценариями защиты AI-агентов. Приглашаем на вебинар про контроль Claude и OpenClaw в HiveTrace: покажем лайв-демо HiveTrace Hooks, проверку запросов и tool calls до выполнения, защиту OpenClaw и…

4064 posts·2551 channels·Jul 14, 2026
eventAugust 2026
Protests — August 2026

Одна из участниц команды лаборатории — Анна Решетняк — дебютировала со статьей на Хабр! 🔥 В материале Аня рассказывает об опыте ускорения Guard модели на основе NER‑классификатора. Модель была нетривиальной, отсюда её ускорение не влезало в классические пути. В статье…

3680 posts·2678 channels·Aug 5, 2026
orgJune 2026
Inter Milan — June 2026

📣Начинаем знакомить вас со спикерами! Первый день открытой защиты посвящён проектам в области безопасности и надёжности LLM-систем. Вас ждут доклады от участников AI Talent Hub — о детектировании вредоносных запросов, ускорении защитных моделей, оценке guardrails, анализе…

3379 posts·2158 channels·Jun 9, 2026