Konfigurera ditt Databricks-projekt

Databricks IDE-tillägget erbjuder en konfigurationsvy inom tillägget som gör det enkelt att konfigurera och uppdatera inställningar för ditt Databricks-projekt. Dessa funktioner inkluderar lokala mappinställningar, installation av AI-verktyg, en valare för utplacering av ett målområde för arbetsytan, enkel konfiguration av autentisering och beräkning, synkronisering av arbetsytsmappar och enkla steg för att aktivera den virtuella Python-miljön som krävs för felsökning.

Konfigurationsvyn i Databricks IDE-tillägget är tillgänglig när du har skapat eller migrerat ett projekt till ett Databricks-projekt. Se Skapa ett nytt Databricks-projekt.

Anteckning

Tidigare versioner av Databricks IDE-tillägg definierade konfigurationsinställningar i en projekt-JSON-fil och miljövariabler sattes i terminalen. I utgåvan finns projekt- och miljökonfiguration i databricks.yml- och databricks.env-filerna.

Om projektet är ett Databricks-tillgångspaket tillhandahåller databricks-utsträckningsgränssnittet även en paketresursutforskare och en paketvariabelvy för att hantera dina paketresurser och variabler. Se Bundle- och utforskarfunktioner.

Ställ in den lokala mappen

För att välja en annan lokal mapp för ditt Databricks-projekt, klicka på kugghjulsikonen som är kopplad till posten Lokal mapp i konfigurationsvyn .

Installera och använd AI-verktyg

Important

Den här funktionen finns i Beta.

AI-verktygsdelen i konfigurationsvyn gör det möjligt att installera AI-verktyg så att dina kodagenter fungerar effektivt med Azure Databricks. Tillägget kontrollerar om AI-verktyg är installerade på global eller projektnivå, inklusive installationer som du utfört via Azure Databricks CLI, och uppdaterar den visade statusen. För mer information om AI-verktyg, se Agentfärdigheter för AI-kodningsassistenter och aitools kommandogrupp.

För att installera AI-verktyg:

  1. I konfigurationsvyn i tillägget, klicka på Installera AI-verktyg.
  2. Följ instruktionerna för att välja ett teleskop och verktyg för att slutföra installationen.

När AI-verktyg installeras visas en grön robotikon bredvid AI-verktyg. AI-verktyg uppdateras automatiskt till den senaste versionen.

Databricks tillägg AI-verktyg

För att avinstallera AI-verktyg, högerklicka på AI-verktyg och välj Avinstallera AI-verktyg.

Ändra arbetsytan för måldistribution

Om du vill välja eller byta distributionsmål för ditt Databricks-projekt (till exempel för att växla från ett dev mål till ett prod mål):

  1. I konfigurationsvyn i Databricks-tillägget, klicka på kugghjulsikonen (Välj ett Databricks Asset Bundle-mål) kopplat till Target.

    Välj ett paketmål

  2. I kommandopaletten väljer du önskat distributionsmål.

När ett mål har konfigurerats visas värd- och distributionsläget. Information om distributionslägen för deklarativ automationspaket finns i Distributionslägen för deklarativa automationspaket.

Arbetsytevärden kan ändras genom att ändra målinställningen workspace i konfigurationsfilen databricks.yml som är associerad med projektet. Se mål.

Anteckning

Följande funktioner för Databricks IDE-tillägg är endast tillgängliga när målutbyggnadsläget utvecklas:

  • Använda det anslutna utvecklingsklustret för paketjobb
  • Synkronisera mappfiler för arbetsytor
  • Välj ett interaktivt utvecklingskluster

Konfigurera Databricks-profilen för projektet

När du skapar ett Databricks-projekt eller konverterar ett projekt till ett Databricks-projekt konfigurerar du en profil som inkluderar autentiseringsinställningar som används för att ansluta till Databricks. Om du vill ändra den autentiseringsprofil som används klickar du på kugghjulsikonen som är associerad med AuthType i konfigurationsvyn.

För mer information om autentisering av Databricks IDE-tillägg, se Sätt upp auktorisation för Databricks IDE-tillägget.

Välj beräkning för att köra kod och jobb

Med Databricks IDE-tillägget kan du välja serverlöst, välja ett befintligt Azure Databricks-kluster eller skapa ett nytt Azure Databricks-kluster för att köra din kod och dina jobb. När du har anslutit till beräkning visas ett klusters ID, Databricks Runtime-version, skapare, tillstånd och åtkomstläge. Du kan också starta och stoppa ett kluster och navigera direkt till klustrets sidinformation.

Tips

Om du inte vill vänta tills jobbklustret startar kontrollerar du Åsidosätt jobbklustret i paketet precis under klustervalet för att använda det valda klustret för att köra paketjobb i utvecklingsläge. Detta är inte tillgängligt om du använder serverlös beräkning.

Använd serverlös

Serverlös beräkning hanteras av Azure Databricks. När du kör arbetsbelastningar på serverlös beräkning allokerar och hanterar Azure Databricks automatiskt de nödvändiga beräkningsresurserna.

  1. I konfigurationsvyn , klicka på Välj beräkning eller kugghjulsikonen (Konfigurera beräkning).

    Konfigurera beräkning

  2. I kommandopaletten väljer du Serverlös.

    Val av serverlös beräkning

Använda ett befintligt kluster

Om du har ett befintligt Azure Databricks-kluster som du vill använda:

  1. I konfigurationsvyn , klicka på Välj beräkning eller kugghjulsikonen (Konfigurera beräkning).

  2. I kommandopaletten väljer du det kluster som du vill använda.

Skapa ett nytt kluster

Om du inte har ett befintligt Azure Databricks-kluster eller om du vill skapa ett nytt:

  1. I konfigurationsvyn , klicka på Välj beräkning eller kugghjulsikonen (Konfigurera beräkning).

  2. I kommandopaletten klickar du på Skapa nytt kluster.

  3. När du uppmanas att öppna den externa webbplatsen (din Azure Databricks-arbetsyta) klickar du på Öppna.

  4. Logga in på din Azure Databricks-arbetsyta om du uppmanas att göra det.

  5. Följ anvisningarna för att skapa ett kluster.

    Anteckning

    Databricks rekommenderar att du skapar ett personligt beräkningskluster . På så sätt kan du börja köra arbetsbelastningar omedelbart, vilket minimerar kostnaderna för beräkningshantering.

  6. När klustret har skapats och körs går du tillbaka till Visual Studio Code.

  7. I konfigurationsvyn , bredvid klustret, klicka på kugghjulsikonen (Konfigurera beräkning).

    Konfigurera klusterikon 3

    I kommandopaletten klickar du på det kluster som du vill använda.

Synkronisera din arbetsytemapp med Databricks

Du kan synkronisera den fjärranslutna Databricks-arbetsytmappen som är kopplad till ditt Databricks-projekt genom att klicka på synkikonen (Starta synkronisering) som är kopplad till Fjärrmappen i konfigurationsvyn i Databricks-tillägget.

Anteckning

Databricks IDE-tillägg fungerar endast med workspace-kataloger som den skapar. Du kan inte använda en befintlig arbetsytekatalog i projektet om den inte har skapats av tillägget.

Om du vill navigera till arbetsytevyn i Databricks klickar du på ikonen för extern länk (Öppna länk externt) som är associerad med Fjärrmapp.

Tillägget avgör vilken Azure Databricks-arbetsytemapp som ska användas baserat på file_path inställningen i mappningen workspace av projektets associerade paketkonfiguration. Se arbetsyta.

Anteckning

Databricks IDE-tillägg utför endast envägs, automatisk synkronisering av filändringar från ditt lokala Visual Studio Code-projekt till den relaterade arbetsytmappen i din fjärranslutna Azure Databricks-arbetsyta. Filerna i den här fjärrarbetsytans katalog är avsedda att vara tillfälliga. Initiera inte ändringar i dessa filer från din fjärrarbetsyta eftersom dessa ändringar inte synkroniseras tillbaka till ditt lokala projekt.

För användningsdetaljer om funktionen för workspace-katalogsynkronisering för tidigare versioner av Databricks IDE-tillägget, se Välj en workspace-katalog för Databricks IDE-tillägget.

Starta en SSH-tunnel

Important

Den här funktionen finns i Beta.

Du kan starta en SSH-tunnel från Databricks IDE-tillägg för att öppna en fjärrutvecklingssession på Azure Databricks beräkning. Detta gör att du kan redigera filer och köra kod direkt mot fjärrberäkning från Visual Studio Code.

  1. För att starta en SSH-tunnel, klicka på knappen Start SSH Tunnel i SSH-tunnelvyn i tillägget.

  2. Välj sedan klassisk eller serverlös beräkning att ansluta till:

    • Kluster: Klusterplockaren visar endast kluster som använder dedikerat (enanvändar-) åtkomstläge. Om du redan har ett enanvändarkluster valt i din lokala Visual Studio Code-session, är det klustret förvalt för SSH-anslutningen.
    • Serverlös: Om du inte väljer ett kluster ansluter tunneln till serverless compute som standard.

När du startar en tunnel öppnas en ny Visual Studio Code-instans i samma IDE som du använder just nu. Den fjärrsessionen öppnar din hemmapp (users/username@databricks.com) som standard och visar automatiskt den specifika fil du aktivt redigerade. Autentiseringen är förkonfigurerad, så du behöver inte logga in igen för att ansluta till fjärrsessionen.

Konfigurera Din Python-miljö och Databricks Connect

I avsnittet Python-miljö i konfigurationsvyn kan du enkelt konfigurera din virtuella Python-utvecklingsmiljö och installera Databricks Connect för att köra och felsöka kod och notebook-celler. Virtuella Python-miljöer ser till att projektet använder kompatibla versioner av Python- och Python-paket (i det här fallet Databricks Connect-paketet).

För att konfigurera Python-miljön för ditt projekt, i konfigurationsvyn för tillägget:

  1. Klicka på det röda objektet Aktivera virtuell miljö under Python-miljö.
  2. I kommandopaletten väljer du Venv eller Conda.
  3. Välj eventuella beroenden som du vill installera.

Om du vill ändra miljöer klickar du på kugghjulsikonen (Ändra virtuell miljö) som är associerad med Aktiv miljö.

För information om installation av Databricks Connect, som möjliggör körning och felsökning av kod och anteckningsböcker inom Visual Studio Code, se Debug code using Databricks Connect för Databricks IDE-tillägget.