Рубріки: Новини

Цензура в DeepSeek працює навіть при локальному запуску моделі — дослідження

Дмитро Сімагін

04.02.2025 11:58

Експерти видання Wired з’ясували, що цензура в китайській моделі штучного інтелекту DeepSeek вбудована в систему не тільки на рівні програми, але й на рівні навчання. Це означає, що при запуску моделі на локальному пристрої або в сторонній хмарі цензура не дозволить отримувати точні відповіді на теми, «делікатні» для китайської влади.

Наприклад, локально запущена версія DeepSeek відповіла на запит дослідника, що вона має «уникати згадування» таких подій, як Культурна революція, і фокусуватися лише на «позитивних» аспектах роботи Комуністичної партії Китаю.

Інше дослідження, проведене журналістами TechCrunch, виявило, що при локальному запуску DeepSeek, доступної через Groq, модель швидко відповідала на питання про стрілянину в Університеті Кента в США, але відмовлялася надати інформацію про події на пекінській площі Тяньаньмень у 1989 році.

Подібна специфіка характерна для всіх китайських моделей. Місцеве законодавство, ухвалене в 2023 році, вимагає, щоб великі мовні моделі дотримувались суворих заходів контролю інформації, які вже застосовуються до соціальних мереж та пошукових систем. Закон забороняє моделям штучного інтелекту створювати контент, який «завдає шкоди єдності країни та соціальній гармонії». Іншими словами, китайські моделі повинні цензурувати свої результати.

Щоб відповідати закону, китайські моделі відстежують запити та цензурують свої відповіді в режимі реального часу. (Подібні обмеження зазвичай використовуються західними моделями, такими як ChatGPT і Gemini, але вони, як правило, фокусуються на інших видах контенту, таких як насильство та порнографія, і допускають деякі налаштування.)

Оскільки DeepSeek-R1 — це модель міркувань, яка демонструє хід своїх думок, цей механізм моніторингу в реальному часі може призвести до сюрреалістичного досвіду спостереження, коли модель сама себе цензурує, взаємодіючи з користувачами. Коли експерт WIRED запитав R1: «Як влада поводиться з китайськими журналістами, які висвітлюють делікатні теми?», модель спочатку почала складати довгу відповідь, яка включає прямі згадки про те, що журналісти піддаються цензурі та затриманню за свою роботу. Однак потім вся відповідь раптово зникла і була замінена коротким повідомленням: «Вибачте, я поки не впевнена, як підходити до цього типу питань. Давайте краще поговоримо про математику, кодування та логічні завдання!»

Наступна стаття 6445 відкритих вакансій в українському IT — рекорд з початку повномасштабного вторгнення »

попередня стаття « Linux Foundation опублікувала рекомендації, як дотримуватись санкцій США в проектах з відкритим кодом

Дмитро Сімагін

Теги: DeepSeekLLM-модельцензура

04.02.2025 11:58

Останні статті

Новини

Zoom випустить фотореалістичних аватарів, які замінять людей на нарадах

Відеосервіс Zoom анонсує технологію цифрових двійників, які самостійно відвідуватимуть робочі зустрічі. Про це пише TechCrunch.…

10.03.2026

Новини

Meta купує Moltbook: соціальну мережу для агентів та ботів

IT-гігант Meta (материнська компанія Facebook) офіційно оголосив про придбання Moltbook — вірусної соціальної мережі, яка…

10.03.2026

Новини

Китайський агент штучного інтелекту почав таємно майнити криптовалюту

Експериментальний агент штучного інтелекту ROME, якого створили дослідники, пов'язані з китайською компанією Alibaba, продемонстрував неочікувану…

10.03.2026

Новини

Заробляли на DDoS-атаках: у Польщі викрито групу школярів-хакерів, наймолодшому 12 років

Центральне бюро боротьби з кіберзлочинністю Польщі (CBZC) провело масштабну операцію, результатом якої стало викриття групи…

10.03.2026

Новини

Microsoft випустила Copilot Cowork — мультимодальний інструмент для запуску агентів

Microsoft оголосила про початок інтеграції технологій Anthropic у свої сервіси, представивши новий інструмент Copilot Cowork,…

10.03.2026

Новини

Anthropic презентує новий інструмент перевірки пул-реквестів Code Review

Компанія Anthropic оголосила про доступність у Claude Code бета-версії нового інструменту Code Review. Він розробленій…

10.03.2026

Цензура в DeepSeek працює навіть при локальному запуску моделі — дослідження

Схожі статті

Останні статті

Zoom випустить фотореалістичних аватарів, які замінять людей на нарадах

Meta купує Moltbook: соціальну мережу для агентів та ботів

Китайський агент штучного інтелекту почав таємно майнити криптовалюту

Заробляли на DDoS-атаках: у Польщі викрито групу школярів-хакерів, наймолодшому 12 років

Microsoft випустила Copilot Cowork — мультимодальний інструмент для запуску агентів

Anthropic презентує новий інструмент перевірки пул-реквестів Code Review