Всем привет! Меня зовут Николай. Сначала отвечу на вопрос из заголовка. Нафаня — это агентный RAG-помощник по нормативно-технической документации, связанной со строительством и ценообразованием (методики Минстроя, ГОСТы, СНиПы, СП и профильные законы). Эта статья о том, как устроен Нафаня, как прошла его проверка на сложном бенчмарке и как архитектура менялась шаг за шагом, чтобы преодолеть […]
Машинное обучение
Всем привет! На связи Толя Потапов, MLE в Т-Банке. Продолжаем развивать линейку открытых моделей Gen-T. Мы делились русскоязычными семействами моделей T-Lite и T-Pro. Сегодня выпускаем модель другого класса — T-Search. Это открытый агент-ретривер для сложного многошагового поиска. Классический RAG предполагает, что ответ находится по формулировке вопроса: один запрос — и нужный документ в топе выдачи. […]
Привет, Хабр! Февраль 2026 года. За один месяц вышли: Gemini 3.1 Pro от Google, Claude Sonnet 4.6 и Opus 4.6 от Anthropic, GPT-5.3 и GPT-5.4 от OpenAI (5.4 — через два дня после 5.3, без каких-либо объяснений), Grok 4.20 от xAI, Qwen 3.5 от Alibaba, DeepSeek V4, GLM-5 от Zhipu, Seed 2.0 от ByteDance. Семь […]
Что происходит, когда ваши собственные исследователи называют вас пропагандистским рупором, почему CEO Anthropic признаёт, что 50% рабочих мест могут исчезнуть, и данные, которые OpenAI отчаянно хочет похоронить. Ведущие исследователи только что покинули OpenAI. Не ради более высоких зарплат. Не чтобы присоединиться к Google или *Meta. Они ушли, потому что отказались участвовать в том, что считали […]
Google DeepMind объявил о публикации предварительного прототипа SIMA-2 (Scalable Instructable Multiworld Agent) — следующего поколения агента, который, по словам создателей, «переходит за рамки простого исполнения инструкций, чтобы понимать и взаимодействовать с окружающей средой». SIMA-1, представленный в марте 2024 года, обучался на сотнях часов видеоигр и смог выполнять простые команды во множестве 3-D игр, но в сложных […]
Nvidia официально присоединилась к Индийскому альянсу глубоких технологий (IDTA) в качестве сооснователя. Этот альянс объединяет крупнейших инвесторов и венчурные фонды, чтобы поддерживать развитие экосистемы стартапов в области ИИ, робототехники, биотехнологий и полупроводников в Индии. По данным CNBC, IDTA планирует инвестировать около 2 миллиардов долларов в молодые компании, работающие на стыке науки и технологий. Nvidia не […]
Учёные из Meta* FAIR и Эдинбургского университета создали метод, который позволяет не только определить, насколько корректно рассуждает языковая модель, но и вмешаться в процесс, чтобы исправить ошибку. Подход получил название Circuit-based Reasoning Verification (CRV) и основан на анализе «вычислительных цепей» — подграфов нейронов, которые реализуют скрытые алгоритмы внутри модели. CRV строит граф вычислений модели и […]
Всем привет! Меня зовут Анастасия Рысьмятова, я руковожу юнитом LLM в Авито.В этой статье я расскажу, как мы с командой создали и адаптировали нашу большую языковую модель A-vibe: зачем решили развивать собственную LLM, как построили токенизатор, собрали датасеты, провели SFT и RL и что получили в итоге. Поделюсь основными экспериментами и покажу наши результаты. Сегодня […]









