AI Россия

AI Россия

Huawei, Alibaba и GigaChat · рынок памяти и LLM

7 новостей
01
modelsfoundation-modelschina

Huawei показала openPangu 2.0 Pro

Huawei представила openPangu 2.0 Pro — новую версию своей большой модели. Релиз усиливает конкуренцию в сегменте foundation models и подтверждает, что китайские вендоры продолжают наращивать собственные ИИ-платформы.

iXBT
02
infrastructuretrainingchips

Alibaba выделила Moonshot вычисления на 20 000 чипов Nvidia

По данным Bloomberg, Alibaba предоставила Moonshot доступ к вычислительным мощностям на базе 20 000 ускорителей Nvidia для обучения моделей Kimi. Это один из заметных сигналов вокруг реальной инфраструктуры, на которой сегодня строятся крупные LLM.

3DNews
03
memoryhardwareefficiency

Физики показали способ снизить энергозатраты памяти

Исследователи из Эдинбургского университета нашли подход, который может заметно уменьшить энергию, нужную для записи данных в память. Для генеративного ИИ, где стоимость хранения и передачи данных растет, это потенциально важная технологическая развилка.

3DNews
04
dataprivacyllm

ShieldFont скрывает смысл текста от ИИ

Бразильское агентство Seneda & Abrucio и студия Playtype выпустили бесплатный шрифт ShieldFont, который остается читаемым для человека, но искажает смысл для моделей. Решение адресует растущий конфликт между веб-контентом и автоматическим сбором данных для обучения.

3DNews
05
evaluationsearchllm

Как отличить реальный вывод ИИ от маркетинговых обещаний

Материал Habr разбирает, почему нельзя обещать гарантированное попадание бренда в ответы ChatGPT и что вместо этого можно измерять. Тема важна для рынка AI SEO и инструментов, которые пытаются управлять видимостью в генеративных ответах.

Habr NLP
06
deploymentmemoryvoice-assistant

Яндекс показал, как экономит память в колонках с Алисой

Яндекс рассказал о семплирующем профилировании памяти в умных колонках с Алисой, где младшие устройства работают всего с 256 МБ ОЗУ. Публикация показывает, как на проде приходится выжимать эффективность из ограниченного железа.

Habr Яндекс
07
modelsresearchgeneration

Сбер рассказал, как обучал диффузионную LLM для GigaChat

Команда GigaChat опубликовала разбор эксперимента с диффузионными языковыми моделями GFusion. Это редкий для рынка материал о практической проверке dLLM — направления, которое может изменить саму архитектуру генерации текста.

Habr Сбер