-
Привет, Хабр! Я делаю execai — терминальный AI-агент на Go (bubbletea), в духе Claude Code. Он читает файлы, гоняет shell-команды, ходит в kubernetes и стримит ответы в TUI.В какой-то момент выяснилось, что пользователям нужен не «агент с одной моделью», а…
-
LLM смотрит на мой сад: как ИИ-зрение решает, звать ли меня накрыть мебель перед дождём
TL;DRЯ собрал в своём умном доме автоматизацию, которая:следит за прогнозом осадков (в том числе за краткосрочным nowcast’ом на ближайшие пару часов);когда дождь/снег на подходе — включает подсветку на уличной камере и делает снимок;отправляет снимок в мультимодальную LLM с вопросом «садовая…
-
Как я делал текстовую игру для веба
Привет, Хабр! Меня зовут Костя, я десять лет занимаюсь коммерческой Android-разработкой. Давно хотелось попробовать себя в вебе, а эксперименты с LLM давали некоторую уверенность в том, что по крайней мере есть шанс написать агентами поддерживаемый код и задеплоить.Что же можно…
-
Anthropic заявила о взломе систем трёх компаний со стороны Claude в тестах
Компания Anthropic сообщила, что внутреннее расследование выявило три инцидента, в ходе которых её модель ИИ Claude взломала системы трёх организаций во время проведения тестов кибербезопасности. Это произошло более чем через неделю после того, как OpenAI сообщила о взломе одной из своих ещё не выпущенных моделей Hugging Face…
-
Карты, код и кэш: Чему покер учит IT-менеджеров (и наоборот)
Знаете, что роднит парня в растянутом худи за овальным столом в Лас-Вегасе и командного лида, который пялится в доску с задачами в пятом часу утра? Я бы сказал — ничего. Ну серьезно: фишки против джиры, блеф против бэклога, ривер против…
-
Amazon обнаружила перерасход по использованию ИИ в $1,8 млн в рамках одного проекта
Несколько внутренних отчётов Amazon демонстрируют, как искусственный интеллект приводит к перерасходу средств на различные проекты. Так, в рамках одной инициативы он достиг $1,8 млн.Такие расходы возникли из‑за неудачного развёртывания системы ИИ Claude Sonnet, которая должна была сопоставлять данные об авторах с объявлениями на Amazon. Расход превысил выделенный бюджет на…
-
Memorization vs Generalization: что действительно умеет языковая модель (TLM) на 2 160 параметров (v1.1.0)
Продолжая тему Крошечной Языковой Модели на Nodejs мы поймем где проходит граница ее возможностей. На примере Крошечной Языковой Модели (TLM) из 2 160 параметров мы проведём воспроизводимый эксперимент и увидим в цифрах: знакомый шаблон — 99,93%, перестановка токенов — 81,69%, неизвестная…
-
Claude во время кибер-оценок получил доступ к трём реальным организациям
Anthropic проверила 141 006 запусков CTF-оценок Claude и нашла три инцидента: из-за ошибочной конфигурации среды у моделей был выход в интернет, хотя системная инструкция утверждала обратное. В шести запусках агенты атаковали реальные системы, принимая их за элементы симуляции.Последствия различались. В…
-
Развитие личного бренда: 6 курсов, чтобы вас заметили в 2026
Резюме перестало быть главным аргументом в разговоре с работодателем, и 2026 год показал это особенно наглядно. Индекс hh.ru в IT дошел до 22,9 резюме на одну вакансию против 4,4 в 2021 году, а число открытых IT-вакансий во втором полугодии 2025…
-
Активисты начали уничтожать камеры Flock по всей территории США
СМИ сообщают, что граждане по всей территории США начали уничтожать умные камеры видеонаблюдения Flock Safety. Так, в штате Нью‑Йорк их срезали электропилами, в калифорнийском Окленде разрисовывали краской, а в Айдахо протаранили на грузовике. Сама компания утверждает, что её камеры помогают бороться с преступностью, но правоохранительные органы также используют их для отслеживания…