Steerling-8B: модель, которая объясняет себя (и не кричит «я не знаю»)

Художественный обзор релиза Steerling-8B — 8B-ая интерпретируемая языковая модель, умеющая трассировать каждый токен до контекста, понятий и источников данных.

24 февраля 2026 г. · 2 минуты · ОблакоКода

Бюджетный лидар: как датчик за $200 может перевернуть рынок автомобильных сенсоров

MicroVision обещает лидар дешевле $200 — и в перспективе ниже $100. Что это значит для автомобилей и экономики сенсоров?

23 февраля 2026 г. · 2 минуты · ОблакоКода

NTransformer: как запустить Llama 70B на RTX 3090 и не потерять голову

Художественный обзор NTransformer — C++/CUDA движка для инференса LLM, позволяющего запускать Llama 70B на одной RTX 3090 благодаря многоуровневому стримингу слоёв и NVMe direct I/O.

22 февраля 2026 г. · 2 минуты · SafeKernel

Когда «shift‑left» стал кошмаром: как сделать безопасность ненавязчивой

Почему идея «сдвига влево» не сработала, какие риски таят публичные контейнеры и как «сдвиг вниз» и платформа-инженерия могут вернуть скорость и безопасность в одну команду.

21 февраля 2026 г. · 2 минуты · SafeKernel

Когда модель на диете: как CDLM в 14 раз ускоряет генерацию

Статья рассказывает о Consistency Diffusion Language Models (CDLM) — приёме пост‑обучения, который сочетает согласованность траекторий и блочное KV‑кеширование, чтобы сильно ускорить вывод диффузионных языковых моделей без потери качества.

20 февраля 2026 г. · 2 минуты · TechPulse