Лаборатория · Microsoft Research
lab xAI News · 27 д назад · 80 просмотров

xAI сделала Grok 4.6 доступной в Microsoft Foundry

xAI объявила о том, что её последняя флагманская модель Grok 4.6 теперь доступна через Microsoft Foundry. Модель предназначена для долгоживущих агентов и амбициозных интерактивных и визуальных задач, обладает контекстным окном на 500k и настраиваемыми усилиями рассуждения.

lab Microsoft Research Blog · 2 д назад · 28 просмотров

Microsoft выпустила RetroChimera для предсказания ретросинтеза

Microsoft Research опубликовала и открыла исходный код RetroChimera, новой системы для предсказания ретросинтеза, которая объединяет две взаимодополняющие модели для предложения высококачественных путей синтеза. Система интегрирует R-SMILES 2, модель на основе Transformer для de-novo генерации, с NeuralLoc, моделью на основе графовых нейронных сетей (GNN), используя обученную стратегию ансамблирования для ранжирования предсказаний.

lab Microsoft Research Blog · 22 д назад · 42 просмотра

Microsoft выпустила GigaPath-Flash и GigaTIME-Flash для эффективных патологических фундаментальных моделей

Microsoft Research выпустила GigaPath-Flash и GigaTIME-Flash, эффективные варианты своих патологических фундаментальных моделей, предназначенные для масштабных исследований на уровне популяции за счёт резкого снижения вычислительных требований.

arxiv arXiv cs.AI · 14 д назад SWE-bench Verified · 72.6% · 29 просмотров

ExecCritic использует специфичное для роли обучение с подкреплением для улучшения кодогенерирующих агентов посредством ремонта, направляемого тестами

ExecCritic представляет собой фреймворк, который разделяет конструирование тестов и исправление исходного кода, чтобы предотвратить ложное доверие к кодогенерирующим агентам. Система использует Test agent и Repair agent, оба из которых поддерживаются моделью Qwen-3.5-35B-A3B и обучаются отдельно с помощью обучения с подкреплением.

arxiv arXiv cs.CL · 14 д назад SWE-bench Verified · 72.6% · 25 просмотров

ExecCritic использует ролевое RL для улучшения кодогенерирующих агентов через тест-ориентированное исправление

Исследователи представляют ExecCritic — фреймворк, сочетающий структуру test-verify-revise с ролевым обучением с подкреплением для повышения эффективности кодогенерирующих агентов. Система разделяет создание тестов и исправление исходного кода: Test-агент генерирует тесты, специфичные для репозитория, а Repair-агент корректирует код на основе обратной связи от выполнения.