Tech Meridian ← К СУЩНОСТЯМ
EN

ТЕМА · ENTITY #884

safety

Хронология связанных событий, источники и контекст из новостной базы.

ХРОНОЛОГИЯ СОБЫТИЙ

2

RESEARCH · 1 ИСТОЧН. · Apple Machine Learning Research

Как индукция ценностей меняет поведение больших языковых моделей (исследование)

В статье исследуют, как дообучение разговорных больших языковых моделей на поднаборах данных предпочтений, выражающих конкретные ценности (например, полезность, честность), влияет на поведение моделей за пределами целевых черт. Измеряя проявление других ценностей, безопасность модели, антропоморфный язык и качество ответов, авторы показывают, что (i) индукция ценности вызывает выражение связанных или даже противоположных ценностей, (ii) индукция «позитивных» ценностей обычно повышает безопасность, и (iii) любая индукция ценностей увеличивает использование антропоморфного, подтверждающего и льстивого языка.

6.0

RESEARCH · 1 ИСТОЧН. · OpenAI

OpenAI объявляет грантовую программу на $5 млн для исследований влияния генеративного ИИ на развитие подростков

OpenAI объявила прием заявок на грантовую программу на $5 млн для поддержки независимых исследований того, как генеративный ИИ влияет на развитие подростков, их благополучие и безопасность. Программа предназначена для финансирования работ, изучающих влияние генеративного ИИ на подростков.

7.0