Roman Klimenko
EN

Magien i CluedIn

https://youtu.be/WrVayWXPUOo?si=XIUybRa5jS6w0Bmk

IPython, kommandoshellen bag Jupyter-notebooks, har en nyttig funktion kaldet magics. Med magics kan du bruge kommandolinjelignende syntaks i stedet for at skrive Python til hver handling.

Denne tilgang kan gøre gentagne opgaver nemmere, også når du arbejder med CluedIn Python SDK. Jeg byggede CluedIn Magic for at give CluedIn-API'et den type brugergrænseflade.

CluedIn Magic afhænger af CluedIn Python SDK, så installationen giver dig begge pakker:

%pip install cluedin-magic

Når jeg arbejder i Microsoft Fabric, Synapse Analytics eller Databricks, installerer jeg normalt pakkerne i environmentet på forhånd. Så behøver jeg ikke gøre det i hver notebook.

Indlæs CluedIn Magic med %load_ext:

%load_ext cluedin_magic

Når udvidelsen er indlæst, kan du bruge %cluedin-magic. Uden parametre eller med ugyldige parametre viser den en kort brugsvejledning:

Available commands: get-context, search
Usage:
%cluedin get-context --jwt <jwt>
%cluedin search --context <context> --query <query> [--limit <limit>]

Hent en CluedIn-context

Kald til CluedIn-API'et kræver en context med oplysninger som domain, organisationsnavn, credentials eller API-token. CluedIn Magic kan udlede de øvrige oplysninger fra et API-token.

Du kan oprette et API-token under Administration -> API Tokens i CluedIn.

I dette eksempel gemmer jeg tokenet i en environment-variabel og læser det ind i en notebook-variabel:

access_token = %env ACCESS_TOKEN

Send variablen til CluedIn Magic:

ctx = %cluedin get-context --jwt $access_token

Du kan ogsĂĄ sende tokenet direkte:

ctx = %cluedin get-context --jwt eyJhbGci...5Odvpr1g

Den oprettede context virker bĂĄde med CluedIn Python SDK og CluedIn Magic.

Søg

Angiv en context og en forespørgsel for at indlæse alle /Infrastructure/User entities. Kommandoen returnerer data som en pandas DataFrame:

%cluedin search --context ctx --query +entityType:/Infrastructure/User
notebook

Brug en grænse til at hente et udsnit af et stort datasæt. Dette eksempel vælger ti entities af vilkårlig type:

%cluedin search --context ctx --query * --limit 10

Denne forespørgsel returnerer ti /IMDb/Name-poster, hvor Vocabulary Key imdb.name.birthYear ikke er lig med \\N:

%cluedin search --context ctx --query +entityType:/IMDb/Name -properties.imdb.name.birthYear:"\\\\N" --limit 10

Du kan ogsĂĄ gemme resultatet i en variabel og bruge det som en almindelig pandas DataFrame:

pd = %cluedin search --context ctx --query +entityType:/IMDb/Name +properties.imdb.name.birthYear:1981
pd.head()