日本語版
最新ニュース
科学&テクノロジー

クロード3.7ソネットとクロードコード\人類

今日、私たちはClaude 3.7 Sonnetを発表しています1、これまでで最もインテリジェントなモデルと市場での最初のハイブリッド推論モデル。 Claude 3.7ソネットは、インスタント近くの応答または拡張された段階的な考え方を生成できます。 ユーザーに表示されます。 APIユーザーはまた、細粒の制御を持っています どのぐらいの間 モデルは考えることができます。Claude 3.7 Sonnetは、コーディングとフロントエンドのWeb開発において特に強力な改善を示しています。モデルに加えて、エージェントコーディングのClaude Codeのコマンドラインツールも導入しています。 Claudeコードは、限られた調査プレビューとして利用でき、開発者はターミナルから直接Claudeに実質的なエンジニアリングタスクを委任できるようにします。Claude 3.7 Sonnetがすべて利用可能になりました クロード フリー、プロ、チーム、エンタープライズを含む計画 - と同様に 人類API、 アマゾンの岩盤、 そして Google CloudのVertex AI。拡張思考モードは、フリークロード層を除くすべての表面で利用できます。標準的な思考モードと拡張思考モードの両方で、Claude 3.7 Sonnetは前任者と同じ価格を持っています:100万ドルあたりの入力トークン3ドル、100万ドルの出力トークンは、思考トークンを含むものです。クロード3.7ソネット:フロンティアの推論は実用的になりました市場の他の推論モデルとは異なる哲学を備えたClaude 3.7 Sonnetを開発しました。人間が迅速な反応と深い反射の両方に単一の脳を使用するのと同じように、私たちは、推論は完全に別のモデルではなく、フロンティアモデルの統合能力であるべきだと考えています。この統一されたアプローチは、ユーザーにとってよりシームレスなエクスペリエンスも生み出します。Claude 3.7 Sonnetは、この哲学をいくつかの方法で具体化しています。まず、Claude 3.7 Sonnetは通常のLLMと推論モデルの両方であり、モデルに正常に答えてもらいたいときに選択できます。 答える前にもっと考えてください。標準モードでは、Claude 3.7 Sonnetは、Claude 3.5 Sonnetのアップグレードバージョンを表しています。で…

クロード3.7ソネットとクロードコード\人類

1740440877
2025-02-24 18:28:00

今日、私たちはClaude 3.7 Sonnetを発表しています1、これまでで最もインテリジェントなモデルと市場での最初のハイブリッド推論モデル。 Claude 3.7ソネットは、インスタント近くの応答または拡張された段階的な考え方を生成できます。 ユーザーに表示されます。 APIユーザーはまた、細粒の制御を持っています どのぐらいの間 モデルは考えることができます。

Claude 3.7 Sonnetは、コーディングとフロントエンドのWeb開発において特に強力な改善を示しています。モデルに加えて、エージェントコーディングのClaude Codeのコマンドラインツールも導入しています。 Claudeコードは、限られた調査プレビューとして利用でき、開発者はターミナルから直接Claudeに実質的なエンジニアリングタスクを委任できるようにします。

Claude 3.7 Sonnetがすべて利用可能になりました クロード フリー、プロ、チーム、エンタープライズを含む計画 – と同様に 人類APIアマゾンの岩盤、 そして Google CloudのVertex AI。拡張思考モードは、フリークロード層を除くすべての表面で利用できます。

標準的な思考モードと拡張思考モードの両方で、Claude 3.7 Sonnetは前任者と同じ価格を持っています:100万ドルあたりの入力トークン3ドル、100万ドルの出力トークンは、思考トークンを含むものです。

クロード3.7ソネット:フロンティアの推論は実用的になりました

市場の他の推論モデルとは異なる哲学を備えたClaude 3.7 Sonnetを開発しました。人間が迅速な反応と深い反射の両方に単一の脳を使用するのと同じように、私たちは、推論は完全に別のモデルではなく、フロンティアモデルの統合能力であるべきだと考えています。この統一されたアプローチは、ユーザーにとってよりシームレスなエクスペリエンスも生み出します。

Claude 3.7 Sonnetは、この哲学をいくつかの方法で具体化しています。まず、Claude 3.7 Sonnetは通常のLLMと推論モデルの両方であり、モデルに正常に答えてもらいたいときに選択できます。 答える前にもっと考えてください。標準モードでは、Claude 3.7 Sonnetは、Claude 3.5 Sonnetのアップグレードバージョンを表しています。で 拡張思考モード、回答する前に自己反映され、数学、物理学、指導に従う、コーディング、その他多くのタスクでのパフォーマンスが向上します。通常、モデルのプロンプトが両方のモードで同様に機能することがわかります。

第二に、APIを介してClaude 3.7 Sonnetを使用する場合、ユーザーは 予算 考えるには、128Kトークンの出力制限までのnの価値について、nトークン以下で考えるようにクロードに伝えることができます。これにより、回答の品質のために速度(およびコスト)をトレードオフすることができます。

第三に、推論モデルの開発では、数学やコンピューターサイエンスの競争の問題についてはやや少なくなり、代わりに、ビジネスが実際にLLMを使用する方法をよりよく反映する現実世界のタスクに焦点を移しました。

早期テスト Claudeのコーディング機能におけるリーダーシップを全面的に実証しました:Cursorは、Claudeが再び実世界のコーディングタスクのクラス最高であり、複雑なコードベースの処理から高度なツールの使用まで大幅に改善されていることを指摘しました。 Cognitionは、コードを計画し、フルスタックの更新を処理することで、他のどのモデルよりもはるかに優れていることがわかりました。 Vercelは、複雑なエージェントワークフローに対するClaudeの例外的な精度を強調しましたが、ReplitはClaudeを展開して、他のモデルが失速する洗練されたWebアプリとダッシュボードをゼロから構築しました。 Canvaの評価では、Claudeは、優れたデザインの味とエラーが大幅に減少した生産対応コードを一貫して作成しました。

Claude 3.7 Sonnetを示すバーチャートSWE-Benchの最先端として検証
Claude 3.7 Sonnetは、SWE-Bench Verifiedで最新のパフォーマンスを実現し、実際のソフトウェアの問題を解決するAIモデルの能力を評価します。足場の詳細については、付録を参照してください。
クロード3.7ソネットをタウベンチの最先端として示すバーチャート
Claude 3.7 Sonnetは、ユーザーとツールの相互作用を備えた複雑な現実世界のタスクでAIエージェントをテストするフレームワークであるTau-Benchで最先端のパフォーマンスを実現しています。足場の詳細については、付録を参照してください。
フロンティア推論モデルを比較するベンチマークテーブル
Claude 3.7 Sonnetは、指導に従った、一般的な推論、マルチモーダル機能、およびエージェントコーディングで優れており、数学と科学の顕著な後押しを提供します。従来のベンチマークを超えて、それは私たちの以前のすべてのモデルよりも優れていました ポケモンゲームプレイテスト

クロードコード

2024年6月以来、Sonnetは世界中の開発者にとって好ましいモデルとなっています。今日、私たちは、限られた調査プレビューで、最初のエージェントコーディングツール(私たちの最初のエージェントコーディングツール)を導入することにより、開発者にさらに力を与えています。

Claude Codeは、コードを検索および読み取り、ファイルを編集し、テストを書き込み、実行し、コードをGitHubにコミットしてプッシュできるアクティブなコラボレーターであり、コマンドラインツールを使用します。

Claude Codeは初期の製品ですが、特にテスト駆動型開発、複雑な問題のデバッグ、大規模なリファクタリングにとって、チームにとってはすでに不可欠になっています。初期のテストでは、Claudeコードは通常45分以上の手動作業が必要な1回のパスでタスクを完了し、開発時間とオーバーヘッドを短縮しました。

今後数週間で、使用法に基づいて継続的に改善することを計画しています。ツールコールの信頼性の向上、長期にわたるコマンドのサポート、アプリ内レンダリングの改善、Claude自身の能力の理解を拡大することを計画しています。

Claude Codeの目標は、開発者がClaudeを使用してコーディングに将来のモデルの改善を通知する方法をよりよく理解することです。による このプレビューに参加します、クロードを構築および改善するために使用するのと同じ強力なツールにアクセスできるようになり、フィードバックはその将来を直接形作ります。

CodeBaseでClaudeを使用します

また、Claude.aiでコーディングエクスペリエンスを改善しました。 GitHubの統合は、すべてのClaudeプランで利用できるようになりました。開発者がコードリポジトリをClaudeに直接接続することを可能にします。

Claude 3.7 Sonnetは、これまでで最高のコーディングモデルです。あなたの個人的、仕事、およびオープンソースプロジェクトをより深く理解することで、それはあなたの最も重要なGitHubプロジェクト全体でバグ、機能の開発、および構築文書を修正するためのより強力なパートナーになります。

責任を持って建設

Claude 3.7 Sonnetの広範なテストと評価を実施し、外部の専門家と協力して、セキュリティ、安全性、信頼性に関する基準を満たすことを保証しました。 Claude 3.7 Sonnetは、有害な要求と良性のリクエストの間でより微妙な区別をもたらし、削減します 45%の不必要な拒否 その前身と比較して。

システムカード このリリースでは、いくつかのカテゴリで新しい安全性の結果をカバーし、他のAIラボと研究者が彼らの仕事に適用できる責任あるスケーリングポリシー評価の詳細な内訳を提供します。また、このカードは、コンピューターの使用に伴う新たなリスク、特に迅速な噴射攻撃に対処し、これらの脆弱性を評価し、クロードを訓練してそれらに抵抗し、軽減する方法を説明します。さらに、推論モデルからの潜在的な安全性の利点を調べます。モデルがどのように意思決定を行うか、モデルの推論が本当に信頼できる信頼性であるかどうかを理解する能力です。完全を読んでください システムカード 詳細については。

先を見ています

クロード3.7ソネットとクロードコードは、人間の能力を真に強化できるAIシステムに向けた重要なステップをマークします。深く推論し、自律的に働き、効果的に協力する能力により、彼らはAIが何を豊かにして拡大する未来に近づきます 人間は達成できます

アシスタントからパイオニアに進んでいるクロードを示すマイルストーンのタイムライン

これらの新しい機能を探求し、それらを作成するものを確認することを楽しみにしています。いつものように、私たちはあなたを歓迎します フィードバック モデルの改善と進化を続けています。

#クロード3.7ソネットとクロードコード人類

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。