Исследования 19

Исследования

Иллюстрация AIFoxNews к материалу: Microsoft представила Agent Lightning v1.0 для обучения агентов на реальных harness-системахИллюстрация

Microsoft представила Agent Lightning v1.0 для обучения агентов на реальных harness-системах

Microsoft Research Asia опубликовала Agent Lightning v1.0 — открытый фреймворк для reinforcement learning, который позволяет обучать агента в том же harness-окружении, где он работает при развёртывании.

Microsoft Research BlogЧитать →

Исследования

Иллюстрация AIFoxNews к материалу: Tencent выпустила первый публичный релиз фреймворка UniRLИллюстрация

Tencent выпустила первый публичный релиз фреймворка UniRL

Tencent опубликовала UniRL v0.1.0 — фреймворк для обучения мультимодальных моделей с подкреплением. В релиз вошли сценарии для диффузионных моделей, LLM и VLM, а также несколько алгоритмов и движков запуска.

GitHub: Tencent-HunyuanЧитать →

Исследования

Иллюстрация AIFoxNews к материалу: Cohere описала модель, которая рассуждает на языке запросаИллюстрация

Cohere описала модель, которая рассуждает на языке запроса

Cohere представила Tiny Aya L2-Thinker — модель, обученную рассуждать на языке пользователя, а не только формулировать на нём финальный ответ. По описанию компании, она делает это более чем в 93% случаев в 60 языках.

Cohere BlogЧитать →

Исследования

Иллюстрация AIFoxNews к материалу: Apple описала метод RISED для обучения универсальных LLM-агентовИллюстрация

Apple описала метод RISED для обучения универсальных LLM-агентов

Apple опубликовала работу RISED — метод обучения LLM-агента в нескольких интерактивных средах. Подход использует рубрики поведения для выбора данных и само-дистилляции.

Apple Machine Learning ResearchЧитать →

Исследования

Иллюстрация AIFoxNews к материалу: Aleph Alpha показала, как загрязнение данных искажает оценки моделейИллюстрация

Aleph Alpha показала, как загрязнение данных искажает оценки моделей

Aleph Alpha проверила обучающие данные на совпадения с бенчмарками и обнаружила, что утечки способны заметно завышать результаты. Компания также выявила ограничения собственной очистки данных.

Aleph AlphaЧитать →

Исследования

Иллюстрация AIFoxNews к материалу: Google Research предложила контекстный подход к безопасности AI-агентовИллюстрация

Google Research предложила контекстный подход к безопасности AI-агентов

Google Research опубликовала отчёт о проблемах приватности и безопасности автономных агентов. Авторы предлагают оценивать уместность действий с учётом контекста, социальных норм и конкретного потока данных.

Google Research BlogЧитать →

Исследования

Иллюстрация AIFoxNews к материалу: PyTorch перенесла медиаввод и вывод в TorchCodecИллюстрация

PyTorch перенесла медиаввод и вывод в TorchCodec

PyTorch Foundation описала новую структуру медиастека: TorchCodec отвечает за декодирование и кодирование, а TorchVision и TorchAudio — за преобразование данных. Одновременно часть прежних API объявлена устаревшей или удалена.

PyTorch BlogЧитать →

Исследования

Иллюстрация AIFoxNews к материалу: Apple изучила, как пользователи определяют данные для персонального MLИллюстрация

Apple изучила, как пользователи определяют данные для персонального ML

Apple опубликовала исследование персональных систем сенсинга, в которых люди сами задают наблюдаемые явления. Участники недельного эксперимента использовали два открытых прототипа в повседневной жизни.

Apple Machine Learning ResearchЧитать →

Исследования

Иллюстрация AIFoxNews к материалу: ServiceNow описала систему генерации данных для корпоративных агентовИллюстрация

ServiceNow описала систему генерации данных для корпоративных агентов

ServiceNow-AI представила AutoSynthData — подход к созданию обучающих данных для корпоративных AI-агентов на основе ошибок целевой модели и результатов более сильной модели-учителя.

Hugging Face BlogЧитать →

Страница 1 из 2