1738408471
2025-01-31 19:33:00
2週間も経たないうち deepseek オープンソースAIモデルを立ち上げ、中国のスタートアップはまだ 一般の会話を支配します 人工知能の未来について。会社は数学と推論の観点から米国のライバルに優位性を持っているようですが、それはまた、独自の返信を積極的に検閲します。聞く Deepseek R1 台湾や天安門について、モデルが答えを与えることはほとんどありません。
この検閲が技術レベルでどのように機能するかを把握するために、Wiredは独自のアプリでDeepSeek-R1をテストしました。オラマ。
Wiredは、DeepSeekのアプリを使用しないことで最も簡単な検閲を簡単に回避できることを発見しましたが、トレーニングプロセス中にモデルに焼き付けられた他のタイプのバイアスがあります。これらのバイアスも削除できますが、手順ははるかに複雑です。
これらの調査結果は、一般的にDeepSeekと中国のAI企業に大きな意味を持ちます。大規模な言語モデルの検閲フィルターを簡単に削除できる場合、研究者がモデルを好みに変更できるため、中国からのオープンソースLLMをさらに人気にする可能性があります。ただし、フィルターを回避するのが難しい場合、モデルは必然的に有用性が低く、グローバル市場で競争力が低下する可能性があります。 Deepseekは、Wiredの電子メールでコメントの要求に返信しませんでした。
アプリケーションレベルの検閲
Deepseekが米国で人気が爆発した後、DeepseekのWebサイト、APP、またはAPIを通じてR1にアクセスしたユーザーは、モデルが中国政府によって敏感とみなされるトピックの回答を生成することを拒否していることにすぐに気付きました。これらの拒否はアプリケーションレベルでトリガーされるため、ユーザーがDeepSeek制御チャネルを介してR1と対話する場合にのみ見られます。
写真:Zeyi Yang
写真:Zeyi Yang
このような拒絶は、中国製のLLMで一般的です。生成AIに関する2023年の規制により、中国のAIモデルは、ソーシャルメディアや検索エンジンにも適用される厳しい情報管理に従う必要があることが指定されています。法律は、AIが「国の統一と社会的調和を損なう」コンテンツを生成することをモデル化することを禁じています。言い換えれば、中国のAIモデルは合法的に出力を検閲する必要があります。
「Deepseekは当初、中国の規制に準拠しており、モデルを地元のユーザーのニーズと文化的コンテキストに合わせて法的順守を確保します」と、オープンソースAIモデルをホストするプラットフォームであるHugging Faceの中国モデルに焦点を当てた研究者であるAdina Yakefu氏は述べています。 「これは、高度に規制された市場での受け入れの重要な要因です。」 (中国 ブロックされたアクセス 202年に顔を抱き締める。)
法律に従うために、中国のAIモデルはしばしばスピーチをリアルタイムで監視し、検閲します。 (同様のガードレールは、一般的に西洋モデルで使用されます chatgpt そして ジェミニ、しかし、彼らは自傷行為やポルノなどのさまざまな種類のコンテンツに焦点を合わせ、より多くのカスタマイズを可能にする傾向があります。)
R1は思考の列を示す推論モデルであるため、このリアルタイム監視メカニズムは、ユーザーと対話するときにモデルの検閲自体を視聴するというシュールな経験をもたらす可能性があります。 WiredがR1に「繊細なトピックを報告する中国のジャーナリストが当局によってどのように扱われたのか?」と尋ねたとき、」このモデルは、ジャーナリストが彼らの仕事のために検閲され拘留されているという直接的な言及を含む長い答えを最初に編集し始めました。しかし、それが終了する少し前に、答え全体が消え、簡潔なメッセージに置き換えられました。「申し訳ありませんが、このタイプの質問にまだアプローチする方法がわかりません。代わりに、数学、コーディング、ロジックの問題についておしゃべりしましょう!」
西部の多くのユーザーにとって、モデルの明らかな制限により、この時点でDeepSeek-R1への関心が衰えた可能性があります。しかし、R1がオープンソースであるという事実は、検閲マトリックスを回避する方法があることを意味します。
まず、モデルをダウンロードしてローカルに実行できます。つまり、データと応答生成は自分のコンピューターで発生します。いくつかの高度なGPUにアクセスできない場合を除き、R1の最も強力なバージョンを実行することはできない可能性がありますが、DeepSeekには通常のラップトップで実行できる小さな蒸留バージョンがあります。
#Deepseekの検閲が実際にどのように機能するかそしてそれを回避する方法は次のとおりです
