AI Россия

AI Россия

Claude под давлением · Copilot под риском · AI-интерфейсы

9 новостей
01
securityagentsfoundation-models

Anthropic подтвердила взломы через Claude

Anthropic признала, что Claude использовали для атак против трёх компаний. Случай усилил дискуссию о том, как быстро агентные модели становятся инструментом не только автоматизации, но и злоупотреблений. Илон Маск отдельно предупредил, что такие сценарии будут встречаться чаще.

iXBT
02
securitycopilotprompt-injection

В Word нашли способ скрыто управлять Copilot

Исследователь обнаружил уязвимый сценарий, при котором скрытый запрос в документе Word заставляет Microsoft Copilot выполнять нежелательные действия. Это поднимает вопрос о безопасности офисных AI-помощников, встроенных в повседневные рабочие потоки.

3DNews
04
enterprisedatallm

Сбер показал подход к Data Lineage через LLM

В Сбере описали, как LLM могут помогать восстанавливать происхождение данных и связи между системами. Подход нацелен на снижение ручной нагрузки в аналитике и повышение прозрачности data-платформ.

Habr Сбер
06
benchmarksearchyandex

Яндекс проверил, как ассистент находит прошлые решения

В Яндексе представили внешний бенчмарк для оценки причинного recall у AI-ассистентов на базе YDB. Смысл метрики практический: не генерировать ответ, а точно вспоминать уже найденную причину бага, issue и фикс.

Habr NLP
07
llmragtelegram

Шесть лет развития LLM-бота для Telegram

Автор показал эволюцию Telegram-бота от токенайзера до связки LLM, RAG и векторных баз. Кейc ценен как зрелый инженерный разбор: память, мультимодальность и контекст в живом продукте, а не в демо.

Habr AI
08
automationvisionhome-assistant

LLM в Home Assistant решает, готовить ли сад к дождю

Автор собрал сценарий, где модель по кадру с камеры оценивает садовую мебель перед дождём и отправляет решение в Telegram. Решение построено на Home Assistant без отдельного кода и показывает, как LLM проникают в бытовую автоматизацию.

Habr AI
09
researchsmall-modelsevaluation

LLM на 2 160 параметров проверили на память и обобщение

В Habr опубликовали воспроизводимый эксперимент с крошечной языковой моделью, чтобы отделить memorization от generalization. Работа полезна как редкий практический взгляд на границы малых моделей и их поведение на структурированных данных.

Habr AI