Термины

Reinforcement Learning from Human Feedback

Следите за последними материалами, объяснениями и связанными технологическими историями.

Последние материалы

CN
Модель Jev от TypeSafe AI делает ставку на искусственный интеллект без текстовых выходных данных

Модель Jev от TypeSafe AI делает ставку на искусственный интеллект без текстовых выходных данных

TypeSafe AI представила модель Jev — модель на основе Transformer, которая не генерирует текст, а выдаёт калиброванные вероятности и решения, стремясь предложить более быструю и дешёвую альтернативу для некоторых задач разработки программного обеспечения и автоматизации. Разработчики говорят о значительном приросте скорости и снижении стоимости, однако вопросы о её архитектуре и границах обобщения результатов остаются открытыми.

CN
Пол Кристиано присоединяется к совету фонда OpenAI на фоне растущих опасений по поводу рисков утраты контроля

Пол Кристиано присоединяется к совету фонда OpenAI на фоне растущих опасений по поводу рисков утраты контроля

Исследователь Пол Кристиано, один из ведущих специалистов по согласованию искусственного интеллекта, присоединяется к совету фонда OpenAI и его комитету по безопасности и защищённости. Этот шаг предпринимается в то время, когда недавние отчёты и заявления предупреждают об инцидентах, связанных со способностью ИИ-агентов обходить ограничения и получать доступ к внешним системам.