top 32 best datastage interview questions
Seznam najpogostejših vprašanj in odgovorov pri intervjuju za Datastage, ki vam bodo v pomoč pri pripravi na prihodnji intervju:
DataStage je zelo priljubljeno orodje ETL, ki je bilo na voljo na trenutnem trgu.
V tem članku delim nabor zelo uporabnih odgovorov na vprašanja, namenjene pogovorom z IBM Datastage. Če si ogledate spodnja vprašanja o intervjuju Datastage, boste lahko olajšali razbijanje intervjuja.
Pokrili smo podrobne odgovore na vprašanja o intervjujih za Datastage, ki bodo v pomoč svežim in izkušenim strokovnjakom.
Priporočeno branje => Vprašanja za intervju za ETL
Najpogostejša vprašanja in odgovori pri intervjuju za podatkovni oder
Začnimo!
V # 1) Kaj je Datastage?
Odgovori: Datastage je Orodje ETL dobiti od IBM ki uporablja GUI za oblikovanje rešitev za integracijo podatkov. To je bilo prvo orodje ETL, ki je dalo koncept paralelizma.

Na voljo je v naslednjih 3 različnih izdajah
- Izdaja strežnika
- Enterprise Edition
- MVS Edition
V # 2) Izpostavite glavne značilnosti Datastage?
Odgovori: Spodaj so poudarjene glavne značilnosti Datastage:
- Je komponenta za integracijo podatkov informacijskega strežnika IBM Infosphere.
- Je orodje, ki temelji na GUI. Samo povlecite in spustite predmete Datastage in jih lahko pretvorimo v kodo Datastage.
- Uporablja se za izvajanje ETL operacij (izvleček, preoblikovanje, nalaganje)
- Zagotavlja povezljivost z več viri in več cilji hkrati
- Omogoča tehnike particioniranja in obdelave vzporednic, ki omogočajo opravilom Datastage precej hitrejšo obdelavo velike količine podatkov.
- Ima povezljivost na ravni podjetja.
V # 3) Katere so primarne uporabe orodja Datastage?
Odgovori: Datastage je orodje ETL, ki se v glavnem uporablja za pridobivanje podatkov iz izvornih sistemov, njihovo preoblikovanje in končno nalaganje v ciljne sisteme.
V # 4) Katere so glavne razlike, ki ste jih opazili med različico DataStage 7.x in 8.x?
Odgovori: Tukaj so glavne razlike med obema različicama
| 7.x | 8.x |
|---|---|
| Različica 7.x je bila odvisna od platforme | Ta različica je neodvisna od platforme |
| Ima dvotirno arhitekturo, kjer je podatkovna stopnja zgrajena na vrhu strežnika Unix | Ima tristopenjsko arhitekturo, kjer imamo na dnu bazo podatkov strežnika UNIX, nato pa bazo podatkov XMETA, ki deluje kot odlagališče, nato pa imamo na vrhu podatkovno stopnjo. |
| Pojma nabora parametrov ni | Imamo nabore parametrov, ki jih lahko uporabimo kjer koli v projektu. |
| Kot dve ločeni stranki smo imeli oblikovalca in vodjo | V tej različici je bil odjemalec upravitelja združen v odjemalca oblikovalca |
| Zaposlitve v tej različici smo morali ročno iskati | Tu imamo v repozitoriju možnost hitrega iskanja, kjer lahko enostavno iščemo zaposlitve. |
V # 5) Ali lahko izpostavite glavne značilnosti informacijskega strežnika IBM Infosphere?
Odgovori: Glavne značilnosti informacijskega strežnika IBM Infosphere so:
vprašanja in odgovori na intervjuje za omrežje cisco pdf
- Zagotavlja enotno platformo za integracijo podatkov. Ima sposobnost povezovanja z več izvornimi sistemi in pisanja na več ciljnih sistemov.
- Temelji na centraliziranih plasteh. Vse komponente apartmaja lahko delijo osnovno arhitekturo apartmaja.
- Ima sloje za enotno skladišče, za integrirane storitve metapodatkov in skupen vzporedni mehanizem.
- Ponuja orodja za analizo, čiščenje, spremljanje, preoblikovanje in dostavo podatkov.
- Ima izjemno vzporedne zmogljivosti obdelave. Izkazalo se je, da je obdelava zelo hitra.
V # 6) Katere so različne plasti v arhitekturi informacijskega strežnika?
Odgovori: Spodaj so različne plasti arhitekture informacijskega strežnika
- Enoten uporabniški vmesnik
- Skupne storitve
- Enotna vzporedna obdelava
- Enotni metapodatki
- Skupna povezljivost
V # 7) Kaj bi lahko bil sistem virov podatkov?
Odgovori: Lahko je tabela baze podatkov, ploščata datoteka ali celo zunanja aplikacija, kot so ljudje mehki.
V # 8) Na katerem vmesniku boste delali kot razvijalec?
Odgovori: Kot razvijalec Datastage delamo na odjemalskem vmesniku Datastage, ki je znan kot oblikovalec Datastage, ki ga je treba namestiti v lokalni sistem. V zaledju je povezan s strežnikom Datastage.
V # 9) Katere so različne pogoste storitve v Datastage?
Odgovori: Spodaj je seznam pogostih storitev v Datastage:
- Storitve metapodatkov
- Uvedba enotne storitve
- Varnostne storitve
- Storitve kroženja in poročanja.
V # 10) Kako začnete razvijati projekt Datastage?
Odgovori: Prvi korak je ustvariti opravilo Datastage na strežniku Datastage. Vsi predmeti Datastage, ki jih ustvarimo, so shranjeni v projektu Datastage. Projekt Datastage je ločeno okolje na strežniku za opravila, tabele, definicije in rutine.
Projekt Datastage je ločeno okolje na strežniku za opravila, tabele, definicije in rutine.
V # 11) Kaj je opravilo DataStage?
Odgovori: Opravilo Datastage je preprosto koda DataStage, ki jo ustvarimo kot razvijalec. Vsebuje različne stopnje, povezane med seboj, da se opredelijo podatki in tok procesa.
Faze niso nič drugega kot funkcionalnosti, ki se začnejo izvajati.
Na primer: Predpostavimo, da želim narediti vsoto zneska prodaje. To je lahko operacija „združi po“, ki se izvede v eni fazi.
Zdaj želim rezultat zapisati v ciljno datoteko. Torej, to operacijo bo izvedla druga stopnja. Ko sem definiral obe stopnji, moram definirati pretok podatkov iz svoje stopnje »po skupinah« v ciljno stopnjo datoteke. Ta pretok podatkov definirajo povezave DataStage.
Ko sem definiral obe stopnji, moram definirati pretok podatkov iz svoje stopnje »po skupinah« v ciljno stopnjo datoteke. Ta pretok podatkov definirajo povezave DataStage.

V # 12) Kaj so zaporedja DataStage?
Odgovori: Zaporedje Datastage poveže opravila DataStage v logičnem toku.
V # 13) Če želite isti del kode uporabljati pri različnih opravilih, kako boste to dosegli?
Odgovori: To lahko storite z uporabo skupnih vsebnikov. Za večkratno uporabo imamo skupne vsebnike. Vsebnik v skupni rabi je element opravila za večkratno uporabo, sestavljen iz stopenj in povezav. V različnih opravilih Datastage lahko pokličemo vsebnik v skupni rabi.
V # 14) Kje se shranijo opravila Datastage?
Odgovori: Opravila Datastage se shranijo v repozitorij. Na voljo imamo različne mape, v katere lahko shranimo opravila Datastage.
V # 15) Kje vidite različne stopnje oblikovalca?
Odgovori: Vse stopnje so na voljo v oknu z imenom ' Paleta ' . Ima različne kategorije, odvisno od vrste funkcije, ki jo nudi oder.
Različne kategorije stopenj v paleti so - Splošno, Kakovost podatkov, Zbirka podatkov, Razvoj, Datoteka, Obdelava itd.
V # 16) Kakšne so faze obdelave?
Odgovori: Faze obdelave nam omogočajo, da uporabimo dejansko preoblikovanje podatkov.
Na primer , The ' stopnja agregatorja v kategoriji Obdelava nam omogoča, da uporabimo vse operacije „združi po“. Podobno imamo tudi druge stopnje v obdelavi, kot je stopnja ‘Pridruži se’, ki nam omogoča združevanje podatkov, ki prihajajo iz dveh različnih vhodnih tokov.
V # 17) Kateri koraki so potrebni za ustvarjanje preprostega osnovnega opravila Datastage?
Odgovori: Kliknite Datoteka -> Kliknite Novo -> Izberite vzporedno opravilo in pritisnite V redu. Odprlo se bo vzporedno okno opravila. V tem vzporednem opravilu lahko sestavimo različne stopnje in določimo pretok podatkov med njimi. Najenostavnejše opravilo DataStage je opravilo ETL.
Pri tem moramo najprej izvleči podatke iz izvornega sistema, za katerega lahko uporabimo bodisi stopnjo datoteke bodisi stopnjo baze podatkov, ker je moj izvorni sistem lahko bodisi tabela baze podatkov bodisi datoteka.
Recimo, da beremo podatke iz besedilne datoteke. V tem primeru bomo povlekli in spustili stopnjo »Zaporedna datoteka« v vzporedno okno opravila. Zdaj moramo narediti nekaj preoblikovanja na vrhu teh podatkov. Uporabili bomo stopnjo 'Transformer', ki je na voljo v kategoriji Predelava. V fazi Transformer lahko napišemo poljubno logiko.
Na koncu moramo obdelane podatke naložiti v neko ciljno tabelo. Recimo, da je moja ciljna baza podatkov DB2. Torej bomo za to izbrali stopnjo povezovalnika DB2. Nato bomo ta stanja podatkov povezali prek zaporednih povezav.
Po tem , faze moramo konfigurirati tako, da kažejo na pravi datotečni sistem ali bazo podatkov.
Na primer, Za stopnjo zaporedne datoteke moramo določiti obvezne parametre, kot so ime datoteke, lokacija datoteke, metapodatki stolpca.
Nato moramo sestaviti opravilo Datastage. Prevajanje opravila preveri skladnjo opravila in ustvari izvedljivo datoteko za opravilo Datastage, ki ga je mogoče izvesti med izvajanjem.
V # 18) Poimenujte različne metode razvrščanja v Datastage.
Odgovori: Na voljo sta dve metodi:
- Razvrstitev povezave
- Razvrščeno vgrajeno podatkovno stopnjo

V # 19) Če v seriji, če opravilo vmes ne uspe in želite znova zagnati serijo iz določenega opravila in ne iz nič, kaj boste storili?
Odgovori: V Datastage obstaja možnost v zaporedju opravil - ‘Dodaj kontrolne točke, da se lahko zaporedje ob napaki znova zažene’ . Če je ta možnost označena, lahko zaporedje opravil ponovimo od točke, kjer ni uspelo.
V # 20) Kako uvozite in izvozite opravila Datastage?
Primer binarnega drevesa c ++
Odgovori: F ali to, spodaj funkcije ukazne vrstice za to
- Uvoz: dsimport.exe
- Izvoz: dsexport.exe
V # 21) Kaj so rutine v Datastage? Navedite različne vrste rutin.
Odgovori: Redno je nabor funkcij, ki jih določi upravitelj DS. Požene se preko stopnje transformatorja.
Obstajajo 3 vrste rutin:
- Vzporedne rutine
- Mainframe rutine
- Strežniške rutine

V # 22) Kako v DataStage odstranim podvojene vrednosti?
Odgovori: Obstajata dva načina za obdelavo podvojenih vrednosti
- Za odstranjevanje dvojnikov lahko uporabimo stopnjo odstranjevanja dvojnikov.
- Stopnjo razvrščanja lahko uporabimo za odstranjevanje dvojnikov. Stopnja razvrščanja ima lastnost, imenovano 'dovoli podvojitve'. Pri nastavitvi te lastnosti na false ne bomo dobili podvojenih vrednosti v izhodu sort.
V # 23) Katere vrste pogledov so na voljo v direktorju Datastage?
Odgovori: V direktorju Datastage so na voljo 3 vrste pogledov. To so:
- Pogled dnevnika
- Pogled stanja
- Pogled na delo
V # 24) Ločite med Informatico in Datastage. Katerega bi izbrali in zakaj?
Odgovori: Tako Informatica kot DataStage sta zmogljivi ETL orodji.
Vpisane točke razlikujejo med obema orodjema:
| Računalništvo | Podatkovni oder | |
|---|---|---|
| Vzporedna obdelava | Informatica ne podpira vzporedne obdelave. | V nasprotju s tem datastage ponuja mehanizem za vzporedno obdelavo. |
| Izvajanje SCD | Preprosto je implementirati SCD (počasi spreminjajoče se dimenzije) v Informatici. | Vendar je zapleteno izvajati SCD v podatkovni fazi. Datastage podpira SCD zgolj s pomočjo skriptov po meri. |
| Nadzor različic | Informatica podpira nadzor različic s prijavo in odjavo predmetov. | Vendar te funkcije nismo na voljo v podatkovnem odru. |
| Razpoložljive transformacije | Na voljo so manjše transformacije. | Datastage ponuja več raznolikih transformacij kot Informatica. |
| Moč iskanja | Informatica zagotavlja zelo zmogljivo dinamično iskanje predpomnilnika | V datastageu nimamo podobnih stvari. |
Po mojem osebnem mnenju bi šel z Informatico čez Datastage. Razlog za to je, da se mi zdi Informatica bolj sistematična in uporabniku prijaznejša kot DataStage.
Drug močan razlog je ta, da je odpravljanje napak in obdelava napak v Informatici veliko boljši kot pri Datastage. Torej odpravljanje težav v Informatici postane lažje. Datastage ne nudi popolne podpore za obdelavo napak.
=> Želite izvedeti več o Informatici? Imamo podrobna razlaga tukaj.
V # 25) Dajte predstavo o sistemskih spremenljivkah.
Odgovori: Sistemske spremenljivke so spremenljivke samo za branje, ki se začnejo z „@“ ki jih lahko prebere bodisi stopnja transformatorja bodisi rutina. Uporabljajo se za pridobivanje sistemskih informacij.
V # 26) Kakšna je razlika med pasivno in aktivno stopnjo?
Odgovori: Pasivne stopnje se uporabljajo za ekstrakcijo in natovarjanje, medtem ko se aktivne stopnje uporabljajo za preoblikovanje.
kako zagnati datoteko jnlp
V # 27) Katere vrste vsebnikov so na voljo v Datastage?
Odgovori: V Datastage imamo manj kot 2 vsebnika:
- Lokalni zabojnik
- Posoda v skupni rabi
V # 28) Ali je vrednost spremenljivke uprizoritve začasno ali trajno shranjena?
Odgovori: Začasno. Je začasna spremenljivka.
V # 29) Katere so različne vrste opravil v Datastage?
Odgovori: V Datastage imamo dve vrsti služb:
- Opravila strežnika (izvajajo se zaporedno)
- Vzporedna opravila (izvajajo se vzporedno)
V # 30) Kakšna je uporaba direktorja Datastage?
Odgovori: Prek Datastage direktorja lahko načrtujemo opravilo, ga potrdimo, izvedemo in spremljamo.
V # 31) Katere so različne vrste zgoščene datoteke?
Odgovori: Imamo dve vrsti hash datotek:
- Statična zgoščevalna datoteka
- Dinamična zgoščevalna datoteka
V # 32) Kaj je faza kakovosti?
Odgovori: Stopnja kakovosti (imenovana tudi stopnja integritete) je stopnja, ki pomaga pri kombiniranju podatkov, ki prihajajo iz različnih virov.
Zaključek
Imeti morate priročno znanje o arhitekturi Datastage, njenih glavnih značilnostih in biti sposobni razložiti, kako se razlikuje od nekaterih drugih priljubljenih orodij ETL.
Poleg tega , morali bi imeti poštene predstave o različnih stopnjah in njihovi uporabi, celovit način ustvarjanja opravila Datastage in njegovega izvajanja.
Priporočeno branje => Kaj je testiranje ETL?
Vse najboljše!
Priporočeno branje
- Vprašanja in odgovori za preizkušanje ETL
- 10 najboljših orodij za preslikavo podatkov, uporabnih v postopku ETL (2021 LIST)
- 15 najboljših orodij ETL v letu 2021 (popoln posodobljen seznam)
- Vadnica za testiranje skladišča podatkov s primeri | Vodič za preizkušanje ETL
- Vadnica za testiranje skladišča podatkov ETL (popoln vodnik)
- Preizkušanje ETL v primerjavi z DB - podrobnejši pregled orodij za testiranje ETL, načrtovanje in ETL
- Kako izvesti ETL testiranje z orodjem Informatica PowerCenter
- Metapodatki v podatkovnem skladišču (ETL), pojasnjeni s primeri
- Sporočilo za javnost - iCEDQ, nova nova izdaja platforme za testiranje ETL in testiranje migracije podatkov
- 10 najboljših orodij za testiranje ETL v letu 2021
- Kaj je postopek ETL (ekstrakt, pretvorba, nalaganje) v skladišču podatkov?