aisecuritylabAI

aisecuritylab

1,300 inscritos
@aisecuritylab
Sobre

Hackeamos IA e não deixamos outros HiveTrace x AI Talent Hub ITMOai.itmo.ru/aisecuritylab

Informações
IdiomaRusso
CategoriaSegurança
RegiãoRussia
AudiênciaProfissionais
TomEducacional
Frequência de postsRaramente
Último post19 de mai. de 2026 · há 3 meses
Tags
Análises
1,300
Inscritos
100.0%
Engajamento
87%
Conteúdo original
1,052
Tamanho médio (car.)
Médio
Riqueza de mídia
Alguns
Anúncios
Texto, Foto, Reposts
Formatos
Canal
Tipo

This channel is part of the discussion

aisecuritylab appears in 33 event pages on TGList
orgJuly 2026
Inter Milan — July 2026

Инциденты в cyber-evals у Anthropic — и почему нам всем нужен трейсинг агентов Anthropic выпустили пост-ретроспективу про инциденты в собственных evals по кибербезопасности. Технически история почти атака на Hf во второй части, но у Anthropic интересная подача. На неё и…

18611 posts·9504 channels·31 de jul. de 2026
eventAugust 2026
Elections — August 2026

Участник лаборатории Мосин Вячеслав завершил работу над обзором 7 ресурсов для мониторинга угроз AI Security 🔥 И обзор доступен каждому Выбор ресурсов для сбора информации об угрозах, в том числе связанных с безопасностью ИИ является важным этапом в решении задач моделирования…

14947 posts·8512 channels·11 de ago. de 2026
topicJuly 2026
Education — July 2026

Новое пространство рассуждений или новый инструмент для AI safety ▫️ 6 июля Anthropic выпустили работу про J-Space — внутреннее пространство вербализуемых (то есть — переводимых в слова) представлений в Claude, которое можно частично читать. Пространство названо в честь нового…

14309 posts·7267 channels·9 de jul. de 2026
eventJuly 2026
Product launch — July 2026

Будем делиться новостями по продуктам HiveTrace, новыми релизами и практическими сценариями защиты AI-агентов. Приглашаем на вебинар про контроль Claude и OpenClaw в HiveTrace: покажем лайв-демо HiveTrace Hooks, проверку запросов и tool calls до выполнения, защиту OpenClaw и…

4065 posts·2552 channels·14 de jul. de 2026
eventAugust 2026
Protests — August 2026

Одна из участниц команды лаборатории — Анна Решетняк — дебютировала со статьей на Хабр! 🔥 В материале Аня рассказывает об опыте ускорения Guard модели на основе NER‑классификатора. Модель была нетривиальной, отсюда её ускорение не влезало в классические пути. В статье…

3865 posts·2787 channels·5 de ago. de 2026
orgJune 2026
Inter Milan — June 2026

📣Начинаем знакомить вас со спикерами! Первый день открытой защиты посвящён проектам в области безопасности и надёжности LLM-систем. Вас ждут доклады от участников AI Talent Hub — о детектировании вредоносных запросов, ускорении защитных моделей, оценке guardrails, анализе…

3379 posts·2158 channels·9 de jun. de 2026