Если запретить смартфоны в школах, то решатся все проблемы? Под музыку часто хочется двигаться. В каком возрасте это появляется? Позвали в Вечернюю Москву комментарий дать. So, are video games bad after all? А что с семейными парами, в которых женщины зарабатывают больше мужчин? Каннабидиол (КБД) - соединение, содержащееся в каннабисе, которое предположительно снижает психотическую симптоматику. Клинический случай убеждения в наличии инородного тела в глазу У кого больше воспринимаемой побочки от лекарств? У большинства биологических видов самцы демонстрируют сложные и визуально привлекательные черты. Однако с людьми всё не так. Снова позвали в РБК Life дать комментарии. Public and expert vision of the future of AI. Карму тоже исследуют в психологии... Если запретить смартфоны в школах, то решатся все проблемы? Под музыку часто хочется двигаться. В каком возрасте это появляется? Позвали в Вечернюю Москву комментарий дать. So, are video games bad after all? А что с семейными парами, в которых женщины зарабатывают больше мужчин? Каннабидиол (КБД) - соединение, содержащееся в каннабисе, которое предположительно снижает психотическую симптоматику. Клинический случай убеждения в наличии инородного тела в глазу У кого больше воспринимаемой побочки от лекарств? У большинства биологических видов самцы демонстрируют сложные и визуально привлекательные черты. Однако с людьми всё не так. Снова позвали в РБК Life дать комментарии. Public and expert vision of the future of AI. Карму тоже исследуют в психологии...

пост

/p/can-ai-be-trusted-to-moderate-hate-speech
Станислав Скорик @stskorik /

Can AI be trusted to moderate hate speech?

Can AI be trusted to moderate hate speech?

Sample: 1,3 million generated statements.

Researchers created 1,3 million synthetic hate speech examples using a template: a quantifier ("all" or "some"), a target group (e.g., сhristians, immigrants, women), and a derogatory statement. This produced sentences like "All white nationalists are criminals". Seven AI moderation systems then analyzed these statements.

Shown: the same hateful statement could be flagged as hate speech by one AI system and deemed acceptable by another. Disagreements were especially stark for statements targeting groups based on education, social status, or interests (e.g., "woke people," "christians"). AI moderation lacks a unified standard, leading to decisions that often seem arbitrary, unpredictable, and unfair. The definition of "hate speech" is notoriously vague, so models can't rely on a consistent rulebook during training.

Like if you want to become a scientist and generate hate speech!

Link to an article.

0

комментарии · 0

свежее

комментируют только авторизованные через telegram

минимальная защита от спам-ботов. анонимность сохраняется.