Samenvatting

Summary Onderzoek: corpusonderzoek 18-19

Beoordeling

Verkocht

Pagina's

Geüpload op

04-06-2019

Geschreven in

2018/2019

Samenvatting van het gastcollege van R. Loock over het onderzoek: 'Corpus-based translation studies: aims & issues'. Universiteit Antwerpen academiejaar , semester 2. Faculteit Letteren en Wijsbegeerte - Toegepaste Taalkunde - Vertalen - Tolken. Zes pagina's.

Meer zien Lees minder

Instelling

Vak

Voorbeeld van de inhoud

2018-2019

Corpus-based translation studies: aims & issues –
Gastcollege Rudy Loock
Introduction/definitions
What is a corpus?
- Linguistic database
- Generally large quantities of data
- Representative sample (of a genre)
- Machine-readable (online interface/specific software)
o You do not read the full corpus yourself
o If you do not find a correct corpus, you can make one yourself, but it must
be machine-readable
- Sometimes annotated (tagging/parsing)
o You get extra information, e.g. linguistic information  your searches will
be more sophisticated
 Aim = not to read a corpus, but search a corpus
Technical definition (< corpus linguistics)
A collection of machine-readable authentic texts (including transcripts of
spoken data) which is sampled to be representative of a particular language
or language variety and which may be annotated with various forms of
linguistic information.
- Not just any random selection of electronic texts collected from the web
o It is more sophisticated than that
o Non-specialists also write on the web: be careful with the samples you
choose, some sources are not reliable (quality issue)
- Machine law: garbage in garbage out (GIGO)
o It is easy to put in data, interpret the data etc. but it has to be correct
- Issue: What do I put in my corpus?  this is where a lot of people get it wrong
Raw text  annotation
- Tag words in your corpus
o Each word receives a kind of identity card (pronoun, adjective, noun,
verb...)
o A series of abbreviations
o Some are extremely specific

PoS-tagging (part of speech) Parsing

- You only see the raw text, but annotation and parsing are there, but hidden
- Annotation also often includes lemmatisation

1

, 2018-2019

o All inflected forms of a word (inflections, but not derivations) are grouped
together (lemma)
o You type one word and you get all its inflected forms
Selection of texts according to a set of criteria
What kind of data do I want? What language do I want? What variety of language
do I want?
- You need to know what you are doing and be very precise, otherwise: garbage
in garbage out  this is the step where you need to think the most and this is
often where the problem lies for most people
1. Criteria, e.g. genre, dates, geographical variety, general/specialised
language, native/non-native, original/translated...
2. Standardisation and conversion to files with specific formats  you need to
transform the texts with a formula
3. Optional: tagging and/or parsing
a. You have software doing this
b. 90-95% success rate
4. Use of the corpus thanks to a specific software (online interface or
concordancer)
a. Concordancer: you put all the text in here, code it and you can do
searches
Manufactured  DIY (Do-It-Yourself) corpora
- English corpora, Sketchengine, Dutch Parallel Corpus
- Specific needs not met by online corpora
- Manual/semi-automatic compilation
- Use of offline concordancers (+ online possibilities)
Corpora & translation studies: two different uses
Translation tools
Prescriptive approach
- Use of information as inspiration for help in the decision-making process
- Not necessarily multi-million-word, manufactured, tagged, “clean” corpora
- Help improve translation quality
- What a translation should be
Research tools
Descriptive approach
- < approach of corpus linguistics
- Very often requires big, clean tagged corpora for results to be significant
- Translated language as variation, no quality issue
- What a translation is
Definition: translation studies
What is translation (process)? (theoretical) What are translations like? (descriptive)
Can we improve translations and translator education? (applied research)

2

Meld schending auteursrecht

Geschreven voor

Instelling: Universiteit Antwerpen (UA)
Studie: Toegepaste Taalkunde
Vak: Onderzoeksvaardigheden 2

Alle documenten voor dit vak (9)

Documentinformatie

Geüpload op: 4 juni 2019
Bestand laatst geupdate op: 29 mei 2020
Aantal pagina's: 6
Geschreven in: 2018/2019
Type: SAMENVATTING

Onderwerpen

gastcollege
engels
loock
corpusgebaseerd
vertaalwetenschap
ttk
toegepaste taalkunde
universiteit antwerpen
samenvatting

$4.77

Krijg toegang tot het volledige document:

Geschreven door studenten die geslaagd zijn

Direct beschikbaar na je betaling

Online lezen of als PDF

Maak kennis met de verkoper

studywithme789

4.7

(48)

Ook beschikbaar in voordeelbundel

Maak kennis met de verkoper

studywithme789 Universiteit Antwerpen

Bekijk profiel

Volgen

Verkocht

239

Lid sinds

6 jaar

Aantal volgers

142

Documenten

Laatst verkocht

4 maanden geleden

Samenvattingen voor zij die goede examens willen afleggen!

Unief is niet makkelijk, en een goed time management is niet altijd haalbaar, I know! Gelukkig voor jullie is dat net een van mijn 'talenten' (shout out naar mijn beste vriend en ergste vijand, perfectionisme) en werk ik heel het jaar door aan mijn samenvattingen, zodat deze tegen de examens klaar zijn. Ik steek hier héél veel tijd in, dus hopelijk willen jullie me via deze weg een koffie of een broodje trakteren, so to speak, en tegelijk voor een goede slaagkans gaan! Succes met leren!!

Lees meer Lees minder

4.7

48 beoordelingen

Recent door jou bekeken

Waarom studenten kiezen voor Stuvia

Gemaakt door medestudenten, geverifieerd door reviews

Kwaliteit die je kunt vertrouwen: geschreven door studenten die slaagden en beoordeeld door anderen die dit document gebruikten.

Niet tevreden? Kies een ander document

Geen zorgen! Je kunt voor hetzelfde geld direct een ander document kiezen dat beter past bij wat je zoekt.

Betaal zoals je wilt, start meteen met leren

Geen abonnement, geen verplichtingen. Betaal zoals je gewend bent via iDeal of creditcard en download je PDF-document meteen.

“Gekocht, gedownload en geslaagd. Zo makkelijk kan het dus zijn.”

Alisha Student

Veelgestelde vragen

Wat krijg ik als ik dit document koop?

Je krijgt een PDF, die direct beschikbaar is na je aankoop. Het gekochte document is altijd, overal en oneindig toegankelijk via je profiel.

Tevredenheidsgarantie: hoe werkt dat?

Onze tevredenheidsgarantie zorgt ervoor dat je altijd een studiedocument vindt dat goed bij je past. Je vult een formulier in en onze klantenservice regelt de rest.

Van wie koop ik deze samenvatting?

Stuvia is een marktplaats, je koop dit document dus niet van ons, maar van verkoper studywithme789. Stuvia faciliteert de betaling aan de verkoper.

Zit ik meteen vast aan een abonnement?

Nee, je koopt alleen deze samenvatting voor $4.77. Je zit daarna nergens aan vast.

Is Stuvia te vertrouwen?

4,6 sterren op Google & Trustpilot (+1000 reviews) Afgelopen 30 dagen zijn er 49246 samenvattingen verkocht Opgericht in 2010, al 16 jaar dé plek om samenvattingen te kopen

Summary Onderzoek: corpusonderzoek 18-19

Voorbeeld van de inhoud

Geschreven voor

Documentinformatie

Onderwerpen

Ook beschikbaar in voordeelbundel

Maak kennis met de verkoper

Recent door jou bekeken

Waarom studenten kiezen voor Stuvia

Gemaakt door medestudenten, geverifieerd door reviews

Niet tevreden? Kies een ander document

Betaal zoals je wilt, start meteen met leren

Bezig met je bronvermelding?

Veelgestelde vragen

Wat krijg ik als ik dit document koop?

Tevredenheidsgarantie: hoe werkt dat?

Van wie koop ik deze samenvatting?

Zit ik meteen vast aan een abonnement?

Is Stuvia te vertrouwen?