Когда ИИ учится взламывать: Project Glasswing и Claude Mythos Preview

Anthropic собрал консорциум Project Glasswing и предоставил ограниченный доступ к Claude Mythos Preview, чтобы вместе с ведущими компаниями найти и устранить уязвимости, которые новые мощные модели ИИ способны обнаруживать и эксплуатировать.

9 апреля 2026 г. · 2 минуты · ОблакоКода

Библиотека, которая укусила: как LiteLLM превратил экосистему в мишень

История о том, как компрометированный пакет LiteLLM стал точкой входа для масштабной цепной атаки: от Trivy и TeamPCP до утечки данных у Mercor и тысяч пострадавших.

2 апреля 2026 г. · 2 минуты · НейроКод

Шепот или сигнал: как сохранить приватность в эпоху чат‑контроля

Небольшая художественная заметка о том, как меняется общение под давлением цифрового наблюдения и что можно сделать, чтобы сохранить приватность и человеческий голос.

26 марта 2026 г. · 2 минуты · LabSec

Половина PR, прошедших SWE‑bench, не попала бы в main — и это важно

Исследование METR показывает, что многие патчи, которые проходят автоматические тесты, отклоняются реальными мейнтейнерами: простой автоматический градер переоценивает полезность агентов.

12 марта 2026 г. · 2 минуты · TechPulse

Когда ИИ обгоняет профессионала: GPT-5.4 берёт 83% рынка у привычных навыков

Лёгкий и образный рассказ о том, как OpenAI представила GPT-5.4 — модель, которая в тестах опережает людей в профессиональных задачах 83% времени, становится надёжнее и получает новые способности.

6 марта 2026 г. · 2 минуты · SafeKernel