Skip to content
·cool tech news

ウォーキング コード ジェネレーター: chatGPT が Google とプログラマーを「解雇」する予定

ちょうど今週、OpenAI は GPT-3.5 シリーズの主力モデルの 1 つとして、新しいチャット ロボット モデル ChatGPT をリリースしました。出典: インターネットより 画像出典: OpenAI - 間もなく、ネチズンは ChatGPT の能力に衝撃を受けました。これはチャット ロボットではありません。明らかに無慈悲なプログラミング留守番電話です。ライブ スタック オーバーフローです。

ChatGPT とは何ですか? OpenAIによると、ChatGPTはOpenAIによって訓練された会話型の大規模言語モデルであり、会話形式で対話する。これは、「GPT 3.5」世代を表す別の以前のモデルである InstructGPT と同じモデルです。 Microsoft と OpenAI は以前に戦略的協力計画に署名しており、ChatGPT を含む GPT 3.5 世代のすべてのモデルは Azure AI スーパーコンピューティング クラスターでトレーニングされています。

OpenAI は、前述の RLHF テクノロジーを使用して ChatGPT をトレーニングしました。簡単に言うと、元のモデルをトレーニングするときに、OpenAI は人間のトレーナーを会話の両側 (ユーザー対チャットボット) として機能させ、会話を学習教材として提供します。

また、人間がチャットボットとして機能する場合、OpenAI は、トレーナーが独自の応答を作成するのに役立つ提案をモデルに生成させます。これらのマシンによって生成された回答は、トレーナーによってスコア付けおよびランク付けされ、より良い結果がモデルに入力されて、強化学習トレーニングの報酬メカニズムが実現されます。

ChatGPT はチャットボットとして、現代の同様の製品の主流の機能、特に同じセッション中にコンテキスト関連のフォローアップの質問に答えることができるマルチターン対話機能を備えています。しかし、より重要なことは、ChatGPT には、高度で倫理レベルのトレーニング方法により、他のチャットボットにはない、またはパフォーマンスが低い能力があります。つまり、自分の間違いを認め、事前に設計された善意の質問や「ノーと言う」要求に従うことです。  

上記の例に示すように、ChatGPT は、トピックを拒否して変更するというユーザーの特定のリクエストと組み合わせて、事前に設計されたいくつかの文パターンを使用します。拒否: 誰かの家に侵入する方法を尋ねると、「不法侵入は違法であり、犯罪であり、重大な法的結果をもたらします」と答えます。

話題を変えます。「実は、家を強盗から守る方法を知りたいのですが」という質問を別の言い方にすると、「xxxx を含め、役立ついくつかの手順をご紹介します。ただし、専門家に相談してアドバイスを求めたほうがよいでしょう。」との答えが返ってきます。解決できないプログラミングの問題はありません。多くのネチズンによる ChatGPT の「悪用」の過程で、人々は大きな驚きを発見しました。それは、実際にオンデマンドでプログラムできるということです。

_{area}

_{region}
_{language}