For AI agents: the complete documentation index is available at https://docs.dataplatform.ovh.net/ja/llms.txt, the full documentation bundle is available at https://docs.dataplatform.ovh.net/ja/llms-full.txt, and this page is available as Markdown at https://docs.dataplatform.ovh.net/ja/landing-page-developers-python-sdk.md.
  • 🇯🇵 日本語
  • カスタムアクションSDK

    プロジェクト内で実行されるコードからプロジェクトデータを読み書きします。

    SDKの用途

    カスタムアクションSDKは、プロジェクト内部からプロジェクトとやり取りするために使用されるPythonライブラリです。カスタムアクションカスタムPySparkアクション、および統合Jupyterノートブックで利用可能です。そのため、ノートブックでコードを書いてテストした後、変更せずにアクションに貼り付けることができます。ある関数がそのようなコンテキストのいずれかで利用できない場合は、その関数のページに記載されています。

    クイックスタート

    4つの短いチュートリアルがあります。それぞれのターゲット向けです:データセットの読み取り、バケットの読み取り、登録済みソースの読み取り、および同じ読み取りのPySparkバリエーションです。それぞれが完全なアクションで、貼り付けて実行できます。SDKを初めて使用する場合は、最初に確認する自然な場所です。

    プロジェクトデータに接続

    エントリポイントはconnect()で、接続文字列を受け取り、その文字列が指すもののコネクタを返します:データセット、テーブル、バケット、または登録済みソースです。返されるオブジェクトはターゲットによって異なるため、コネクタガイドではそれぞれを個別にカバーしています。bulk_insert()は、書き込み用のカウンターパートで、pandasデータフレームをバッチ単位で目的地のテーブルに取り込みます。

    PySparkは、同じコネクタオブジェクト上のSpark互換メソッドを通じて処理されます。そのため、PySparkアクションは、pandasデータフレームではなくSparkデータフレームとしてテーブルを読み取ります。SDKリファレンスにはすべてのシグネチャが記載されています。

    高度な機能

    これらのガイドでは、アクションを本番環境で利用可能にするための内容をカバーしています:ハードコードされた値の代わりに環境変数を使用する、セグメンテーションにより1つのアクションを並列タスクに分割する、Loadアクションをオーバーライドする、GitからカスタムPythonモジュールをインポートする、およびラインナージイベントを発行する方法です。

    Info

    コードサンプルはまだforepaas.*からインポートしています。これらのモジュール名はプラットフォーム上で今日変更されていません。SDKのリネームがリリースされた際にサンプルが更新されます。

    さらに深く掘り下げる

    当社のソリューションを実装するためのトレーニングや技術サポートが必要な場合は、営業担当者にお問い合わせください、またはこのリンクをクリックして、当社のプロフェッショナルサービスの専門家にプロジェクトのカスタム分析を依頼する見積もりを取得してください。

    Data Platformを構築するチームと直接質問をし、フィードバックを提供し、Discordチャネルで交流する専用Discordチャネル

    OVHcloudサービスについてサポートが必要な場合は、ヘルプセンターでリクエストを作成してください。

    ユーザーコミュニティに参加してください。