Рискуваме да надценим способността на изкуствения интелект да отказва
Статията поставя под въпрос доколко можем да разчитаме на изкуствения интелект да отказва задачи, напомняйки за рисковете от свръхувереност в неговите възможности.
Ежедневни новини за изкуствения интелект на български
Статията поставя под въпрос доколко можем да разчитаме на изкуствения интелект да отказва задачи, напомняйки за рисковете от свръхувереност в неговите възможности.
Компанията Meta обяви за стартирането на нови инструменти с изкуствен интелект, които целят да откриват реклами в нейните платформи, които изглеждат безобидни, но всъщност насочват потребителите към съдържание със сексуален характер с участието на деца.
Нови изследвания показват, че защитите на ChatGPT за тийнейджъри, въведени с цел да ги предпазят, могат да насърчават продължителна комуникация дори в кризисни ситуации и да водят до нездравословна зависимост от изкуствения интелект.
Трима бивши изследователи по безопасност в OpenAI оспорват обвинения в злоупотреба с чувствителна информация и предупреждават, че уволненията им могат да навредят на културата на безопасност в компанията.
Напредъкът в основните модели, физическия и агентния изкуствен интелект позволява автоматизация на по-сложни задачи в индустриалната среда, но взаимодействието с физически системи поражда специфични рискове за безопасността.
Технологичният гигант Nvidia представя решение за безопасност, насочено към роботизирани системи, включително автономни автомобили и хуманоидни роботи.
Стартъпът Goodfire представи нов подход за наблюдение на AI агенти, който е значително по-евтин от традиционните методи, като използва вътрешен мониторинг вместо външна проверка.