Senin, 13 November 2017

Terjemahan Jurnal Syntax

Evaluasi dan Klasifikasi Penggunaan Sintaks
dalam Menentukan Persamaan Semantik Teks Pendek

Makalah ini menguraikan dan mengkategorikan cara menggunakan informasi sintaksis di sejumlah algoritma untuk menentukan kesamaan semantik teks pendek. Kami mempertimbangkan penggunaan informasi pesanan kata, pemberian label part-of-speech, pelabelan parsing dan peran semantik. Kami menganalisis dan mengevaluasi efek penggunaan sintaks pada algoritma
kinerja dengan memanfaatkan hasil tes deteksi parafrase pada Research Paraphrase Corpus Microsoft. Kami juga mengusulkan klasifikasi algoritma baru berdasarkan penerapannya pada bahasa dengan alat pemrosesan bahasa alami yang langka.

pengolahan bahasa alami, MSRPC, parsing, penandaan part-of-speech, pelabelan peran semantik, kesamaan semantik shorttext, sintaks, urutan kata.

I. PENDAHULUAN
MEMERIKSA kesamaan semantik teks pendek adalah proses di mana nilai diberikan pada teks yang diberikan sesuai dengan tingkat keterkaitan semantik.
diantara mereka. Sistem persamaan semantik teks pendek (STSS) umumnya memberikan skor antara nol dan satu, di mana nol mewakili semimilitude semantik total,
dan satu kesetaraan semantik total. Kesamaan semantik teks pendek sangat penting karena teks pendek banyak digunakan saat ini dalam bentuk pencarian
kueri dan hasil mesin, berita utama dan cuplikan, komentar di berbagai jejaring sosial, dll.

Ada beberapa masalah pengolahan bahasa alami (NLP) yang bergantung pada penggunaan beberapa ukuran kesamaan semantik teks. Masalah seperti itu termasuk teks
summarization dan klasifikasi, menjawab pertanyaan, pencarian informasi, dll. Dalam ringkasan teks pilihan kalimat yang akan disertakan dalam ringkasan sangat penting.
Selama proses itu, terutama saat membuat ringkasan berdasarkan beberapa dokumen, penting untuk menghindari pemungutan kalimat yang berisi informasi yang sama dengan salah satu kalimat yang sudah dipilih [1]. Dalam pencarian informasi atau sistem penjawab pertanyaan, sering terjadi bahwa query terdiri dari informasi yang ditulis dengan cara yang berbeda dari yang digunakan dalam dokumen yang memegang jawabannya. Dengan memperhitungkan variasi ini, peningkatan kinerja yang signifikan dapat dicapai [2].

Ada dua cara utama untuk menentukan kesamaan semantik: pendekatan statistik, yang didasarkan pada penggunaan teks corpora, dan pendekatan topologi, berdasarkan pada penggunaan pengetahuan ahli. Metode statistik bergantung pada hipotesis distribusi yang menurutinya kata-kata dengan makna serupa cenderung muncul dalam konteks yang sama [3].

Dengan menerapkan hipotesis ini ke sebuah teks besar corpus, adalah mungkin untuk menciptakan ruang semantik yang menentukan berapa kali setiap kata muncul dalam setiap konteks. Konteks biasanya berupa kata lain yang kedekatannya dengan kata yang diamati muncul atau dokumen. Melalui proses ini setiap kata secara efektif menetapkan vektor konteksnya sendiri yang memungkinkan untuk membandingkan makna kata dengan membandingkan masing-masing vektor konteksnya. Keuntungan utama dari metode statistik terletak pada kenyataan bahwa satu-satunya sumber daya yang dibutuhkan untuk menciptakan ruang semantik adalah teks corpus yang tidak disebutkan dalam bahasa yang diinginkan.

Dalam pendekatan topologi, tingkat kesamaan semantik antara dua kata ditentukan dengan menggunakan basis pengetahuan buatan manusia, mis. yang WordNet [4]. Karena ini
Sumber daya diciptakan dengan menggunakan pengetahuan ahli manusia, mereka dapat memodelkan tingkat keterkaitan semantik dengan cukup berhasil, bila digabungkan dengan metrik jarak yang sesuai. Kelemahan utama mereka adalah kerja keras yang diperlukan untuk membangunnya.

Sisa dari makalah ini disusun sebagai berikut: Pertama-tama, kami memberikan gambaran umum tentang berbagai jenis informasi sintaksis yang dapat digunakan oleh sistem STSS, dan juga
alat yang digunakan untuk mendapatkannya. Kami kemudian menguraikan berbagai algoritma STSS dan cara masing-masing menggunakan informasi sintaksis. Setelah itu kami sampaikan sebuah evaluasi dari kata tersebut
algoritma dan karakteristik mereka dan kami mengusulkan klasifikasi algoritma baru berdasarkan penerapannya pada bahasa dengan alat NLP yang langka. Akhirnya, kami menyarankan beberapa kemungkinan jalan penelitian masa depan

II. INFORMASI SYNTACTIC DAN ALAT PENGOLAHAN SYNTAX
Informasi sintaksis paling dasar yang didapat dari teks adalah urutan kata-kata muncul di dalamnya. Tidak ada alat khusus bahasa yang diperlukan untuk memanfaatkan data pesanan kata, sehingga jenis informasi ini mudah diakses dalam segala situasi.

Jenis informasi sintaksis yang paling sering digunakan adalah tag part-of-speech (POS), yang dihasilkan oleh penutur part-of-speech bahasa tertentu (misalnya penukar POS bahasa Inggris biasanya dapat membedakan antara 36 bagian pembicaraan yang berbeda yang didefinisikan di Penn Proyek Treebank [5]). Penugasan tepat dari tag POS mewakili masalah klasifikasi, oleh karena itu penantang POS biasanya dibuat dengan menerapkan metode pembelajaran mesin yang diawasi pada teks korpus yang sebelumnya telah diberi catatan dengan tag POS yang benar. Penanda POS modern mencapai akurasi yang sangat tinggi (sekitar 97%) [6], menjadikannya alat bahasa yang sangat diperlukan yang digunakan oleh semua teknik analisis sintaksis lanjutan.

Penguraian dangkal atau chunking adalah proses yang mengidentifikasi konstituen dalam sebuah kalimat, mis. kelompok kata benda, kata kerja, kelompok kata kerja, dll. Namun, penguraian dangkal tidak menentukan struktur internal konstituen ini, juga tidak menentukan peran mereka dalam kalimat tersebut. Parsers penuh, sebaliknya, menghasilkan representasi struktur kalimat, biasanya berbentuk pohon parse berbasis konstituensi atau ketergantungan. Mirip dengan penukar POS, sebagian besar parser modern adalah statistik, yaitu mereka menggunakan teknik pembelajaran mesin dalam hubungannya dengan korpus pelatihan data parsel tangan. Inilah alasan mengapa parser untuk bahasa yang berbeda harus dibuat secara terpisah, yang merupakan usaha yang lebih besar daripada pembuatan tag penanda POS karena penguraian manual kalimat adalah proses yang lamban dan sulit. Parser statistik terbaik mencapai tingkat akurasi yang baik sekitar 91% [7], namun masih menghasilkan lebih banyak kesalahan daripada penambah POS.

Metode paling maju untuk mendapatkan informasi sintaksis adalah analisis semantik sintaksis yang disebut Semantic Role Labeling (SRL). SRL dapat dipandang sebagai bentuk penguraian yang lebih kompleks dimana label diberikan kepada konstituen sesuai dengan peran mereka dalam kalimat tersebut. Oleh karena itu, modul SRL mampu menyimpulkan kata-kata mana yang mewakili subjek, objek, kata kerja utama, dan sebagainya. Daya tarik SRL terletak pada tingkat informasi yang sangat tinggi. Meskipun demikian, kinerja TI mutakhir tetap jauh lebih rendah daripada parser dan penambah POS, berkisar antara 70% dan 90%, tergantung pada korpus pelatihan / pengujian yang digunakan dan prosedur evaluasi [8].

III. ALGORITMA SIMILARITASI STATISTIK
Mihalcea dkk. [9] mengusulkan metode dasar STSS umum di mana mereka menguji beberapa algoritma kesamaan word-to-word. Dua di antaranya menggunakan teknik statistik: PMI-IR (Informasi Saling Berpihak Pointwise - Information Retrieval) dan LSA (Latent Semantic Analysis). Dalam kasus PMI-IR Mihalcea et al. menggunakan isi indeks mesin pencari AltaVista sebagai korpus pelatihan, sedangkan untuk LSA mereka menggunakan British National Corpus yang berisi sekitar 100 juta kata. Metode mereka membandingkan teks dalam bentuk kata-kata dengan menemukan kata yang paling mirip dalam teks kedua untuk setiap kata dari kata pertama dan sebaliknya. Selama proses ini, sistem menggunakan tag POS untuk mencegah kata-kata dengan berbagai bagian ucapan dipasangkan.

Islam dan Inkpen [10] juga merancang metode mereka di sekitar prinsip tas-of-kata, tapi keduanya menyertakan metrik kesamaan string, dan memilih varian yang berbeda dari algoritma PMI, yang disebut SOC-PMI (PMI Orde Kedua), yang diterapkan di British National Corpus. Mereka bereksperimen dengan informasi sintaksis dasar dalam bentuk tatanan kata umum dalam dua teks. Furlan dkk. [11] menganggap versi modifikasi dari pendekatan Islam dan Inkpen di mana algoritma COALS (Correlated Occupence Analogue to Lexical Semantics), dilatih mengenai sebuah korpus abstrak artikel dari Wikipedia bahasa Inggris, digunakan sebagai pengganti SOC-PMI.

Lintean dan Rus [12] mengusulkan pendekatan tas-kata-kata berdasarkan kata-kata yang serakah. Di dalamnya, algoritma LSA dilatih pada korpus TASA yang berisi lebih dari 10 juta kata. Metode mereka menggunakan tag POS dengan nada yang sama seperti [9], namun mereka juga menganggap bentuk pembatasan ini lebih lemah, di mana mereka hanya menggunakan kelas kata dasar, seperti kata kerja, bukan kategori yang lebih spesifik seperti infinitives, participle, past tenses , dll.

Blacoe dan Lapata menciptakan model memori distributional (DM) yang mengandalkan tuple word-link-word tertimbang yang disusun menjadi tensor orde ketiga. Matriks yang berbeda dapat diekstraksi dari tensor semacam itu, menciptakan ruang semantik yang berbeda yang sesuai untuk berbagai masalah. Sebuah tagger POS dan parser dependensi diperlukan untuk konstruksi model ini. Blacoe dan Lapata menggabungkan beberapa perusahaan besar, termasuk British National Corpus dan versi bahasa Inggris dari Wikipedia, berjumlah lebih dari tiga miliar kata. Selain itu, mereka menganggap pendekatan yang lebih sederhana yang disebut SDS (Simple Distributional Semantic Space) yang diciptakan melalui penerapan langsung semantik distribusi di British National Corpus. Berbeda dengan model DM, SDS tidak menggunakan informasi sintaksis atau preprocessing teks.

IV. ALGORITMA SIMILARITASI TOPOLOGI
Mihalcea dkk. [9] juga menguji pendekatan STSS mereka bersamaan dengan enam algoritma yang bergantung pada WordNet sebagai basis pengetahuan. Algoritma ini berbeda di antara mereka sendiri dengan metrik khusus yang digunakan untuk menentukan jarak semilom word-to-word. Apalagi Mihalcea et al. menggabungkan semua ukuran kesamaan topologi dan statistik dan mengevaluasi kinerja bersama mereka.

Fernando dan Stevenson [14] memeriksa enam metrik WordNet yang sama pada model tas-kata-kata di mana semua kata-kata kata kesamaan diperhitungkan. Karena sebagian besar ukuran WordNet hanya dapat membandingkan arti kata-kata yang termasuk dalam kelas kata yang sama, tagger POS digunakan dengan cara yang mirip dengan [9].

Selain varian yang menggunakan algoritma LSA, Lintean dan Rus [12] juga bereksperimen dengan lima metrik WordNet pada model yang sama, memanfaatkan informasi POS dengan cara yang sudah dijelaskan.

Liu dkk. [15] merumuskan suatu metode yang menggabungkan ukuran jarak semantik berdasarkan pengetahuan WordNet dengan koefisien korelasi kesamaan urutan kata.
Koefisien ini dihitung antara vektor kata-indeks asli dan relatif dari kalimat yang diberikan.

Ramage dkk. [16] memperkenalkan model STSS di mana dua tas kata tidak dibandingkan secara langsung. Apa yang dibandingkan adalah distribusi yang disebabkan oleh setiap teks saat digunakan sebagai benih berjalan acak di atas grafik yang dibuat dengan menggunakan statistik WordNet dan korpus. Tag POS digunakan baik sebagai bagian integral dari proses konstruksi grafik dan dalam menentukan distribusi awal di atas ruang negara untuk teks singkat tertentu.

Li et al. [17] merancang pendekatan mereka di sekitar metode penguraian dangkal yang memecah kalimat menjadi kata benda, kata kerja dan frase preposisi. Perbandingan semantik kalimat dilakukan dengan membandingkan makna antara konstituen masing-masing dan kemudian menggabungkan kesamaan dari tiga jenis frasa. Arti kata individu diperoleh dari WordNet, menggunakan pendekatan yang sama seperti yang ada di [15].

Lee et al. [18] menciptakan mekanisme pemrosesan sintaksis yang bergantung pada daftar dependensi yang diketik yang dihasilkan oleh parser. Metode mereka mengubah daftar ini menjadi seperangkat pola sintaksis subjek-subjek, sehingga melakukan pelabelan semantik dasar. Set ini kemudian dibandingkan antara teks pendek yang diberikan dengan membandingkan bagian-bagian yang sesuai dari setiap pasangan pola. Proses ini dilakukan dengan menggunakan tidak hanya ukuran semantik berbasis WordNet, tapi juga metrik kesamaan string.

Furlan dkk. [11] mengusulkan sebuah algoritma yang mengandalkan jaringan semantik ConceptNet sebagai basis pengetahuannya. Mereka menggunakan mekanisme SRL yang mampu mengekstrak objek subjek tupel dari kalimat tertentu.

Oliva dkk. [19] mempertimbangkan beberapa metrik WordNet untuk menghitung kata demi kata kesamaan dan untuk sebagian besar dari mereka mereka menggunakan tagger POS untuk alasan yang sama seperti [9] dan [14]. Namun, model SyMSS Oliva dkk. secara signifikan lebih kompleks karena melakukan ketergantungan bersama yang dalam - sintaksis dan analisis semantik dari teks yang diberikan. Begitu informasi sintaksis diproses, pasangan model menyusun kata-kata yang memiliki fungsi sintaksis yang sama dan membandingkannya pada tingkat semantik. SyMSS juga menurunkan skor kemiripan akhir dalam kasus di mana satu kalimat mengandung struktur sintaksis tertentu yang tidak ada pada objek lainnya, yaitu ketika objek tidak langsung hanya muncul dalam satu kalimat dan bukan kalimat lainnya.

V. EVALUASI DAN KLASIFIKASI
Hasil dari semua algoritma yang dijelaskan, diurutkan sesuai dengan tingkat keakuratannya, ditampilkan pada Tabel 1. Jika beberapa variasi dari pendekatan dasar ditawarkan, opsi terbaik berkinerja dipilih. Selain itu, kami telah menandai jenis informasi / alat sintaksis yang digunakan masing-masing metode. Perlu dicatat bahwa penanda ini hanya berkaitan dengan algoritma STSS sendiri - parser, misalnya, tidak dapat berfungsi tanpa informasi paruh bicara, namun jika model STSS menggunakannya tidak secara eksplisit menggunakan tag POS dengan cara lain, maka hanya kolom Parsing yang berisi spidol.

Kinerja algoritma dievaluasi pada tes deteksi parafrase dengan menggunakan Microsoft Research Paraphrase Corpus (MSRPC) [20]. Korpus ini terdiri dari 5801 pasang kalimat yang semuanya setidaknya berhubungan secara semantis, namun hanya sebagian yang merupakan parafrase sejati yaitu pasangan yang setara secara semantis. Seluruh korpus diberi catatan dengan nilai kesamaan biner yang menentukan apakah pasangan kalimat mewakili parafrase atau tidak. Tugas algoritma STSS adalah mencoba mencocokkan skor kalimat-pasangan yang diberikan oleh annotator manusia. Karena kesepakatan antar-penilai rata-rata di antara hakim manusia adalah 83%, ini merupakan batas atas untuk kinerja sistem STSS.

Ukuran kinerja algoritma utama adalah akurasi, dihitung sebagai rasio pasangan kalimat yang diklasifikasikan dengan benar dan jumlah total pasangan di korpus. Beberapa metrik lain yang sering digunakan meliputi: presisi, yang mewakili rasio dari parafrase yang diidentifikasi dengan benar dan jumlah pasangan diklasifikasikan sebagai parafrase oleh sistem; ingat, dihitung sebagai rasio dari parafrase yang diidentifikasi dengan benar dan jumlah jumlah parafrase di korpus; dan ukuran F yang merupakan presisi presisi dan recall yang harmonis.

Mengingat ketersediaan alat NLP berbeda dari satu bahasa ke bahasa lainnya, dan bahwa dalam kasus bahasa kecil banyak alat canggih seringkali tidak ada, jelas bahwa penerapan pendekatan STSS sangat bergantung pada informasi sintaksis yang digunakannya. . Inilah sebabnya mengapa pada Tabel 1 kami mengusulkan klasifikasi algoritma STSS yang baru ke dalam tiga jenis - D, W dan L - sesuai dengan penerapannya pada bahasa dengan alat NLP yang langka.

Algoritma tipe-D adalah yang langsung berlaku untuk semua bahasa karena tidak memerlukan alat sintaksis bahasa tertentu. Algoritma W-type adalah yang memiliki penerapan yang luas ke banyak bahasa karena satu-satunya tool sintaksis bahasa yang mereka gunakan adalah tagger POS, yang merupakan jenis alat pengolah sintaksis yang paling dasar dan paling umum. Akhirnya, algoritma tipe-L adalah yang memiliki penerapan terbatas karena mengandalkan metode analisis sintaksis lanjutan, seperti pelabelan parsing dan label semantik, yang hanya tersedia dalam sejumlah kecil bahasa. Perlu dicatat bahwa, selain masalah penggunaan sintaksis, pendekatan kesamaan topologi harus berurusan dengan masalah terpisah untuk menemukan basis pengetahuan yang sesuai (paling sering dalam bentuk WordNet) dalam bahasa yang diinginkan.

Dapat dilihat bahwa jumlah algoritma tipe D agak rendah, dan kebanyakan menggunakan prinsip kesamaan statistik. Algoritma W-type adalah yang paling luas. Berbeda dengan metode tipe-D, algoritma tipe L biasanya berpusat pada teknik topologi. Semua pendekatan W-type yang lebih baru melakukan hal yang sama atau lebih baik dari tipe D, yang diharapkan karena mereka memiliki lebih banyak data dalam bentuk tag POS. Namun, menarik untuk dicatat bahwa, setidaknya dalam kategori kesamaan topologi, metode tipe W mengungguli bahkan tipe L, yang memanfaatkan informasi sintaksis yang lebih dalam. Salah satu alasan utama perbedaan ini terletak pada kenyataan bahwa alat sintaksis tingkat lanjut menghasilkan kesalahan yang jauh lebih banyak daripada penukar POS yang lebih sederhana, yang menyebabkan ketidakakuratan dalam penilaian STSS.

Algoritma D-type berperforma terbaik adalah pendekatan topologi yang disarankan oleh Liu etal. [15]. Di antara algoritma statistik model tipe D terbaik adalah Blacoe dan Lapata's Simple Distributional Semantic Space [13]. Metode Islam dan Inkpen [10] dekat dengannya, meskipun masuknya informasi pesanan bersama ke dalam bukunya
Kesamaan skor sebenarnya mengarah ke hasil yang sedikit lebih buruk. Meski dengan pendekatan statistik yang diajukan oleh Furlan et al. [11] sangat mirip dengan yang ada di [10], korpus yang digunakan untuk melatih algoritma COALS agak kecil, oleh karena itu hasilnya tidak mengejutkan.

Lintean dan Rus [12] menawarkan algoritma W-type terbaik, yang juga merupakan pendekatan berkinerja terbaik pada umumnya, mencapai tingkat akurasi dan F-measure tertinggi. Selain itu, penerapan metrik LSA mereka lebih baik daripada upaya sebelumnya untuk menggunakannya. Disimpulkan bahwa pilihan antara membandingkan hanya kata-kata tersebut dengan bagian pembicaraan yang persis sama dan memungkinkan perbandingan antara kelas kata yang lebih luas bergantung pada tugas yang dimaksud. Secara khusus, hasil yang lebih baik pada tes pendeteksian parafrasa dicapai dengan menerapkan pembatasan yang lebih ketat, sehingga memanfaatkan informasi POS tambahan.

Algoritma topologi W-type umumnya berkinerja lebih baik daripada statistik. Meskipun pilihan metrik WordNet untuk digunakan dalam pendekatan topologi bergantung pada berbagai faktor, dua metrik menonjol - JCN, yang menghasilkan hasil optimal pada [14] dan [19] dan hasil terbaik kedua di [12 ], dan LCH, yang
menyelesaikan tingkat kinerja mutakhir dalam hubungannya dengan [12] dan hasil terbaik kedua di [14]. Pendekatan yang lebih lawas, seperti [9], mencapai hasil maksimal dengan menggabungkan semua metrik WordNet dengan metode kesamaan statistik. Namun, sistem ini memerlukan penggunaan delapan ukuran yang berbeda, yang membuatnya tidak efisien secara komputasi.

Kebanyakan algoritma L-type masuk dalam kategori topologi, namun Blacoe dan Lapata [13] menciptakan model memori distribusi statistik yang mengungguli mereka. Namun, metode L-type state-of-the-art ini hanya sedikit lebih baik daripada pendekatan SDS yang lebih sederhana yang diusulkan di kertas yang sama, yang membuat kasus yang kuat untuk algoritma tipe-D. Selanjutnya, model tipe-D sederhana dari Liu dkk. [15] mengalahkan semua solusi tipe-L dalam hal akurasi dan ukuran F.

Wiemer-Hastings [21] menunjukkan bahwa peringkat kesamaan manusia sangat dipengaruhi oleh kemiripan kata kerja, namun kurang oleh kesamaan subjek dan objek. Sebagian besar algoritma tipe L mencoba memanfaatkan temuan ini dan berhasil memperbaiki keakuratan sistem dengan menetapkan bobot yang berbeda pada persamaan dari konstituen yang berbeda. Metode Li etal. [17] mencapai hasil terbaik jika bobot yang sedikit lebih besar diberikan pada kata kerja dan frase kata benda daripada frase preposisi. Kinerja model SyMSS Oliva etal. [19] meningkat jika pembobotan sesuai peran semantik diterapkan, dengan kata kerja membawa bobot, subjek dan objek yang paling kecil, sementara pelengkap adverbia dan peran lainnya diberi nilai lebih rendah. Pendekatan topologi Furlan dkk. [11] mencapai tingkat akurasi maksimal dengan memberi kata kerja empat kali lebih besar daripada yang digunakan untuk subjek dan objek. Namun demikian, metode ini berkinerja buruk dibandingkan dengan algoritma statistik yang disajikan dalam makalah yang sama karena banyak subjek dan objek terdiri dari kata benda yang tepat yang tidak dapat ditemukan dalam basis pengetahuan ConceptNet, yang secara efektif membuat penyusun tersebut tidak relevan dalam perhitungan nilai kemiripan. Meski model Lee et al. [18] Pada prinsipnya, juga mampu memanfaatkan bauran subjek-kata kerja, efek teknik ini pada sistem belum dieksplorasi.

VI. KESIMPULAN
Analisis menunjukkan bahwa kinerja state-of-the-art saat ini dicapai dengan menggunakan tag POS bersamaan dengan ukuran kesamaan topologi. Pendekatan yang tidak menggunakan informasi sintaksis mengorbankan tingkat akurasi untuk kesederhanaan dan penerapan yang lebih luas, sedangkan algoritma yang memanfaatkan informasi sintaksis dalam masih terhambat oleh ketepatan alat pengolahan sintaksis yang tidak mencukupi.

Masalah ini bisa diatasi dengan mengandalkan alat sintaksis sederhana sambil menganalisis konsekuensi yang lebih dalam dari hasilnya. Banyak algoritma yang ada menggunakan penukar POS baik sebagai alat preprocessing untuk teknik analisis yang lebih maju, atau untuk mencegah kata-kata dengan berbagai bagian ucapan dibandingkan. Namun, walaupun beberapa makalah telah menunjukkan bahwa akurasi STSS meningkat dengan mempertimbangkan perbedaan alami yang penting antara berbagai unsur penyusun ([11], [17], [19]), namun sejauh ini metode sejauh ini mempertimbangkan untuk mengambil keuntungan dari perbedaan ini. di tingkat POS.

Menugaskan bobot yang berbeda dengan kesamaan berbagai bagian pembicaraan akan memanfaatkan perbedaan kepentingan ini. Serentak, mengingat tingginya akurasi penanda POS, hal itu akan menghindari hukuman kinerja yang dihasilkan oleh alat sintaksis yang kompleks. Pendekatan seperti itu, terutama bila dikombinasikan dengan algoritma kesamaan statistik, akan memungkinkan terciptanya sistem STSS dengan akurasi tinggi dan penerapan yang luas terhadap bahasa dengan sumber daya NLP terbatas.
Read More ->>

Minggu, 19 Maret 2017

PENGENALAN SOSIOLINGUISTIK

 PENGENALAN SOSIOLINGUISTIK
    A.    Pengertian Sosiolinguistik
Sosiolinguistik berasal dari dua kata yaitu “Sosiologi” dan “Linguistik”. Sosiologi atau sosial yaitu berhubungan dengan masyarakat. Linguistik adalah ilmu yang mempelajari tentang bahasa. Jadi, sosiolinguistik ilmu yang mempelajari tentang hubungan masyarakat dengan bahasa.

Sosiolinguistik juga didefinisikan sebagai:
1.      Studi yang berkaitan dengan hubungan antara bahasa dan konteks di mana ia digunakan. Dengan kata lain, itu mempelajari hubungan antara bahasa dan masyarakat. Ini menjelaskan kita orang berbicara berbeda dalam konteks sosial yang berbeda. Ini membahas fungsi sosial dari bahasa dan cara itu digunakan untuk menyampaikan makna sosial. Semua topik menyediakan banyak informasi tentang karya-karya bahasa, serta tentang hubungan sosial dalam masyarakat, dan cara orang sinyal aspek identitas sosial mereka melalui bahasa mereka (Jenet Holmes, 2001)
2.      Ilmu yang berkaitan dengan interaksi bahasa dan keadaan (Carol M. Eastman, 1975; 113).
3.      studi yang berkaitan dengan menyelidiki hubungan antara bahasa dan masyarakat dengan tujuan pemahaman yang lebih baik dari struktur bahasa dan bagaimana bahasa berfungsi dalam komunikasi (Ronald Wardhaugh, 1986: 12)
Sosiolinguistik merupakan ilmu antardisiplin antara  sosiologi dengan linguistik, dua  bidang  ilmu empiris yang  mempunyai kaitan erat. Sosiologi merupakan  kajian yang  objektif dan  ilmiah mengenai manusia di dalam masyarakat, lembaga-lembaga, dan prosessosial yang ada di dalam masyarakat.
Hudson (1996, hal. 4) :
Sosiolinguistik (mikro) adalah studi tentang bahasa dalam hubungannya dengan masyarakat.
Sosiologi bahasa (makro) adalah studi tentang masyarakat dalam kaitannya dengan bahasa.
Dalam sosiolinguistik kita mempelajari bahasa dan masyarakat dalam rangka untuk mengetahui sebanyak yang kita dapat tentang apa jenis bahasa hal, dan dalam sosiologi bahasa kita membalikkan arah tujuan kami.
Berbagai bahasa sebagai "satu set item linguistik dengan distribusi yang sama," definisi yang memungkinkan kita untuk mengatakan bahwa semua mengikuti variasi: Kanada Inggris, London Inggris, Inggris dari komentar sepak bola, dan sebagainya.
Ada beberapa kemungkinan hubungan antara bahasa dan masyarakat. Salah satunya adalah bahwa struktur sosial dapat berpengaruh atau menentukan struktur dan perilaku linguistik. Hubungan kedua mungkin secara langsung bertentangan dengan yang pertama: struktur linguistik dan perilaku baik dapat mempengaruhi atau menentukan struktur sosial. Hubungan ketiga yang mungkin adalah bahwa pengaruh arahan: bahasa dan masyarakat dapat mempengaruhi satu sama lain. Kemungkinan keempat adalah untuk menganggap bahwa tidak ada hubungan sama sekali antara struktur bahasa dan struktur sosial dan bahwa setiap independen dari yang lain. (https://fatchulfkip.wordpress.com/2008/03/19/sociolinguistics/)



Coulmas (1997, hal. 2):
Micro-sosiolinguistik menyelidiki bagaimana struktur sosial mempengaruhi cara orang berbicara dan bagaimana variasi bahasa dan pola dari berkorelasi dengan atribut sosial seperti kelas, jenis kelamin, dan usia.
Makro-sosiolinguistik, studi apa yang masyarakat lakukan dengan bahasa mereka, yaitu, sikap dan keterikatan yang menghitung untuk distribusi fungsional bentuk bahasa dalam masyarakat, pergeseran bahasa, pemeliharaan, dan penggantian, pembatasan dan interaksi masyarakat.
    B.     Variasi Bahasa : Fokus pada Pengguna
Ada empat variasi bahasa yang didasarkan pada penggunanya. Yang pertama adalah idiolek, yang kedua adalah dialek, yang berikutnya adalah dialek sosial dan yang terakhir adalah dialek temporal. Deskripsi variasi bahasa mereka dapat dilihat sebagai berikut:
1.      Idiolek
Idiolek adalah variasi bahasa yang individu di alam (Chaer & Agustina, 1995: 82). Setiap orang memiliki variasi bahasa sendiri atau idiolek sendiri. Variasi idiolek ini menyangkut dengan warna suara, pilihan kata, gaya bahasa, urutan kalimat, dll, warna suara adalah aspek yang paling dominan dalam variasi bahasa, karena kita dapat mengenali seseorang hanya dengan mendengarkan suara tanpa melihat orang tersebut .

2.      Dialek
Menurut Spolsky (1998: 33) dialek adalah sesuatu yang berhubungan dengan variasi yang terletak regional atau sosial. Dialek juga berarti variasi bahasa yang berasal dari kelompok pengguna yang relatif dalam angka, yang tinggal di satu tempat, wilayah atau daerah tertentu (Chaer & Agustina, 1995: 83). Sejak dialek didasarkan pada tempat, wilayah atau daerah di mana para pengguna tinggal, biasanya disebut sebagai daerah dialek, dialek regional atau dialek geografi. Pengguna dialek memiliki fitur tertentu yang menandai mereka sebagai orang yang memiliki dialek yang sama meskipun mereka memiliki idiolek mereka sendiri. Orang-orang yang menggunakan bahasa Jawa dan Semarang memiliki dialek khusus mereka sendiri yang berbeda dengan orang lain yang memiliki dialek Surabaya. Tetapi mereka dapat berkomunikasi dengan baik satu sama lain karena dialek yang mereka gunakan termasuk dalam bahasa yang sama, yaitu Jawa. Definisi  yang disebutkan oleh (Chaer & Agustina, 1995) di atas sejalan dengan apa yang Spolsky (1998) simpulkan tentang dialek regional. Dia menyimpulkan bahwa dialek daerah cenderung menunjukkan perbedaan kurang dari tetangga dekat mereka dan perbedaan yang lebih besar dari tetangga yang jauh (Spolsky, 1998: 29).

     variasi regional atau dialek daerah juga dapat ditemukan dalam dunia internatonal. variasi dapat dibedakan dari pengucapan, kosakata dan bahkan dari perbedaan tata bahasa (Holmes, 2001: 124). Pengucapan dan kosakata perbedaan mungkin adalah perbedaan paling mudah bahwa orang menyadari antara dialek yang berbeda dari bahasa Inggris. Contoh perbedaan lafal yang disebutkan oleh Holmes (2001: 124) dalam bukunya adalah kata “ayah” yang diucapkan oleh orang Selandia Baru, terdengar seperti kata “mati” yang diucapkan oleh orang Inggris dan kata “tuhan” yang diucapkan oleh orang Amerika, terdengar seperti kata “penjaga” yang diucapkan oleh Inggris, dan juga kata “terakhir” yang terdengar seperti “tangga” untuk banyak penutur bahasa Inggris non-Amerika.



3.      Dialek Sosial
Dialek sosial berarti variasi bahasa yang menyangkut status sosial dan kelas (Chaer & Agustina, 1995: 84). variasi bahasa ini biasanya variasi bahasa yang paling diucapkan dan paling memakan waktu untuk berbicara tentang sejak variasi ini menyangkut semua masalah pribadi dari pengguna, seperti usia, jenis kelamin, pekerjaan, tingkat royalti,, status sosial ekonomi, kelas sosial, dan lain-lain. Menurut Holmes (2001: 134) dialek sosial adalah bahasa yang mencerminkan pengelompokan orang yang didasarkan pada faktor-faktor sosial dan ekonomi yang sama. Holmes (2001: 134) juga menyatakan bahwa dialek seseorang mencerminkan latar belakang sosialnya yang dapat ditemukan komplikasi dialek sosial di Jawa dan cara yang digunakan oleh penutur Jawa untuk menunjukkan latar belakang sosial mereka. Dalam bahasa Jawa, dialek sosial tertentu dapat didefinisikan sebagai kombinasi tertentu dari gaya atau tingkat yang memiliki pola yang khas dari kosakata, tata bahasa dan pengucapan. Dalam bahasa Jawa, setiap kali seseorang Jawa berbicara dengan orang yang berbeda, dia harus memilih kata yang tepat dan pengucapan karena hampir setiap kata yang berbeda dan mereka cocok bersama dalam pola atau tingkat.

4.      Dialek Temporal
Dialek temporal berarti variasi bahasa yang digunakan oleh kelompok sosial tertentu dalam waktu tertentu (Chaer & Agustina, 1995: 84). Sebagai contoh, variasi bahasa dapat dilihat dalam pengembangan bahasa Inggris. Menurut Widarso (1989: 22-28) pengembangan bahasa Inggris telah dimulai dari bahasa Inggris Lama pada tahun 600 sampai tahun 1100, Inggris Tengah pada tahun 1100 sampai tahun 1450, Awal bahasa Inggris modern pada tahun 1450 sampai tahun 1700 dan bahasa inggris modern digunakan hingga sekarang.
     C.    Variasi Bahasa : Fokus pada Penggunaan
Dalam hal variasi bahasa yang didasarkan pada penggunaannya, diskusi adalah fokus pada cara-cara di mana pidato mencerminkan konteks di mana bahasa digunakan dan tidak karakteristik dari pembicara (Holmes, 2001: 223). Variasi bahasa yang menyangkut penggunaan atau fungsi dapat disebut sebagai gaya atau mendaftar.

1.      Gaya
Ada banyak istilah untuk Gaya yang pada dasarnya sama, Yang pertama disebutkan di sini adalah definisi yang diberikan oleh Marjohan (1988: 34) gaya yang mengacu pada variasi dalam berbicara atau menulis dari yang lebih formal ke yang lebih santai.
Menurut Holmes (2001: 246) gaya merujuk pada variasi bahasa yang mencerminkan perubahan faktor situasional. Dia juga menyebutkan bahwa gaya sering dianalisis sesuai dengan tingkat formalitas (Holmes, 2001: 246). Hal ini sesuai dengan Martin Joos (1967) dalam bukunya “Lima Jam” seperti dikutip Nababan (1986: 22) yang membagi gaya formalitas menjadi lima tingkat, kaku, formal, konsultatif, santai dan gaya intim. Deskripsi gaya ini dapat dilihat pada berikut ini:
a.       Gaya kaku. Hal ini paling gaya formal digunakan dalam situasi formal dan upacara (Nababan, 1986: 22). Hal ini disebut kaku karena pola telah dibentuk tegas dan tidak pernah dapat diubah oleh siapa pun. Dalam bentuk tertulis, kita bisa melihat gaya ini dalam dokumen sejarah, ratifikasi, dan dokumen resmi lainnya.
b.      Gaya formal. Ini adalah gaya yang digunakan dalam pidato resmi, pertemuan resmi, correspendence kantor, buku pelajaran untuk sekolah, dll (Chaer & Agustina, 1995: 93). Gaya Formal pada dasarnya mirip dengan gaya kaku yang hanya digunakan dalam situasi formal dan tidak dalam situasi informal. Contoh gaya yang formal seperti dikutip Marjohan (1988: 35) dari Nababan (1987) adalah paragraf pertama dari pembukaan UUD 1945 Republik Indonesia yang ditulis dalam formal atau bahkan dalam gaya kaku,
“Bahwa sesungguhnya kemerdekaan itu ialah hak segala bangsa dan oleh sebab itu maka penjajahan di atas dunia harus dihapuskan karena tidak sesuai dengan peri kemanusiaan dan peri keadilan”.
c.       Gaya konsultatif. Ini adalah gaya yang digunakan dalam percakapan biasa diadakan di sekolah, dalam pertemuan atau percakapan yang mengarah ke hasil dan produksi (Nababan, 1986: 22). Dapat dikatakan bahwa gaya ini adalah yang paling sering digunakan.
d.      Gaya kasual. Ini adalah gaya yang digunakan untuk berbicara dengan teman-teman, keluarga atau kerabat, selama waktu luang, saat berolahraga, dll (Chaer & Agustina, 1995: 93).
e.       Gaya intim. Ini adalah gaya yang digunakan dengan orang-orang yang memiliki hubungan dekat dengan speaker (Nababan, 1986: 22). Dengan menggunakan gaya ini orang-orang tidak perlu menggunakan kalimat lengkap dengan artikulasi yang jelas, mereka hanya cukup menggunakan kata-kata singkat. Hal ini terjadi terutama karena ada pemahaman di antara mereka.

2.    Tingkat Nada
Menurut Holmes (2001: 246) mengacu pada bahasa kelompok orang dengan kepentingan umum atau pekerjaan, atau bahasa yang digunakan dalam situasi yang terkait dengan kelompok-kelompok tersebut. Contoh dari Tingkat Nada yang berbeda dapat dilihat pada bahasa yang digunakan oleh wartawan, legalis, lelang, komentator olahraga, pilot maskapai penerbangan, penjahat, pemodal, politisi, dan juga bahasa yang digunakan di ruang sidang dan ruang kelas. Salah satu contoh yang disebutkan oleh Holmes (2001: 247) dalam bukunya bahasa yang digunakan oleh orang-orang yang menggambarkan acara olahraga yang dapat dibedakan dengan mudah dari bahasa yang digunakan dalam konteks lain terutama dalam kosa kata.
Berbagai bahasa ditandai dengan pilihan kosa kata dan digunakan dalam situasi tertentu yang melibatkan peran dan status tertentu juga dapat dianggap sebagai tingkat nada juga (Spolsky, 1998; 34). Definisi lain dari daftar yang disebutkan oleh Chaer & Agustina (1995: 92) adalah bahwa kekhawatiran tingkat nada dengan apa aktivitas, tujuan atau bidang bahasa yang digunakan. Misalnya variasi bahasa yang digunakan dalam bidang jurnalistik, layanan militer, kegiatan ilmiah, dll.
Variasi bahasa di bidang jurnalisme memiliki karakteristik khusus, yaitu sederhana, komunikatif dan singkat. Bahasanya sederhana karena itu harus dipahami dengan mudah, komunikatif karena memiliki untuk menyampaikan berita secara tepat, dan singkat karena ruang terbatas (di media cetak) dan waktu yang terbatas (di media elektronik).
Variasi bahasa di bidang jasa militer telah dikenal dengan karakteristiknya, yang singkat dan ketat sejalan dengan tugas militer dan kehidupan yang penuh disiplin dan instruksi. Sementara bahasa ilmiah telah dikenal dengan karakteristiknya menjadi lurus ke depan, jelas dan bebas dari ambiguitas, metafora dan idiom karena bahasa ilmu harus memberikan informasi ilmiah jelas, tanpa keraguan, dan bebas dari kemungkinan ditafsirkan dalam arti yang berbeda .

    D.    Kesimpulan
Sebuah bahasa merupakan hal penting dalam suatu masyarakat. Ini bukan alat untuk komunikasi dan interaksi tetapi juga untuk membangun dan memelihara hubungan manusia.
Salah satu ciri dari bahasa adalah sosial. Itu adalah untuk mengatakan bahwa semua kejadia harus dalam kaitannya dengan aspek sosial. Seorang anak yang baru lahir mengakuisisi bahasa di lingkungan sosial (keluarga sebagai bagian dari masyarakat tutur). Sebuah penggunaan bahasa juga terjadi di masyarakat tutur.
Berdasarkan wilayah geografis, satu komunitas mungkin berbeda dari satu ke yang lain. Hal ini menyebabkan variasi yang berbeda dari bahasa: dialek. Jenis-jenis dialek yang dikenal sebagai dialek geografis atau regional. Fakta juga menunjukkan bahwa para anggota komunitas masyarakat atau pidato di hierarki sosial yang sama. Akibatnya, ada juga variasi bahasa yang sama yang digunakan oleh berbagai jenis pengguna bahasa. Jenis-jenis variasi bahasa dikenal sebagai dialek sosial.
Sosiolinguistik mempelajari bahasa dan variasi, dan bagaimana mereka digunakan dalam komunitas pidato dalam kaitannya dengan latar belakang sosial-budaya dari bahasa yang mereka gunakan sendiri.











Read More ->>

Senin, 13 Maret 2017

Morphology (words)

DEFINITION

morphology and dictionary

Morphology is the branch of linguistics (and one of the major components of grammar) that studies word structures, especially in terms of morphemes. Adjective: morphological.

Traditionally, a basic distinction has been made between morphology (which is primarily concerned with the internal structures of words) and syntax (which is primarily concerned with the ways in which words are put together in sentences).

In recent decades, however, numerous linguists have challenged this distinction. See, for example, lexicogrammar and lexical-functional grammar (LFG).

The two main branches of morphology (inflectional morphology and lexical word-formation) are discussed below in Examples and Observations.





EXAMPLES AND OBSERVATIONS

"The term 'morphology' has been taken over from biology where it is used to denote the study of the forms of plants and animals. . . . It was first used for linguistic purposes in 1859 by the German linguist August Schleicher (Salmon 2000), to refer to the study of the form of words. In present-day linguistics, the term 'morphology' refers to the study of the internal structure of words, and of the systematic form-meaning correspondences between words. . . .
"The notion 'systematic' in the definition of morphology given above is important. For instance, we might observe a form difference and a corresponding meaning difference between the English noun ear and the verbhear. However, this pattern is not systematic: there are no similar word pairs, and we cannot form new English verbs by adding h- to a noun. There is no possible verb to heye with the meaning 'to see' derived from the noun eye. Therefore, such pairs of words are of no relevance to morphology."(Geert E. Booij, An Introduction to Linguistic Morphology, 3rd ed., Oxford University Press, 2012)


The Aims of Morphology"Morphology is an essential subfield of linguistics. Generally, it aims to describe the structures of words and patterns of word formation in a language. Specifically, it aims to (i) pin down the principles for relating the form and meaning of morphological expressions, (ii) explain how the morphological units are integrated and the resulting formations interpreted, and (iii) show how morphological units are organized in the lexicon in terms of affinity and contrast. The study of morphology uncovers the lexical resources of language, helps speakers to acquire the skills of using them creatively, and consequently express their thoughts and emotions with eloquence."(Zeki Hamawand, Morphology in English: Word Formation in Cognitive Grammar. Continuum, 2011)


Two Branches of Morphology- "For English, [morphology] means devising ways of describing the properties of such disparate items as a, horse, took, indescribable, washing machine, and antidisestablishmentarianism. A widely recognized approach divides the field into two domains: lexical or derivational morphology studies the way in which new items of vocabulary can be built up out of combinations of elements (as in the case of in-describ-able); inflectional morphology studies the ways words vary in their form in order to express a grammatical contrast (as in the case of horses, where the ending marks plurality)."(David Crystal, The Cambridge Encyclopedia of the English Language, 2nd ed. Cambridge University Press, 2003)
- "The distinction between words and lexemes provides the basis for the division of morphology into two branches: inflectional morphology and lexical word-formation.
"Inflectional morphology deals with the inflectional forms of various lexemes. It has something of the character of an appendix to the syntax, the major component of the grammar. Syntax tells us when a lexeme may or must carry a certain inflectional property, while inflectional morphology tells us what form it takes when it carries that inflectional property.
"Lexical word-formation, by contrast, is related to the dictionary. It describes the processes by which new lexical bases are formed and the structure of complex lexical bases, those composed of more than one morphological element. The traditional term is simply 'word-formation.'"(Rodney Huddleston and Geoffrey K. Pullum, The Cambridge Grammar of the English Language. Cambridge University Press, 2002)


Two Basic Approaches to Morphological Analysis"There are two complementary approaches to morphology, analytic and synthetic. The linguist needs both.
"The analytic approach has to do with breaking words down, and it is usually associated with American structuralist linguistics of the first half of the twentieth century. . . . No matter what language we're looking at, we need analytic methods that are independent of the structures we are examining; preconceived notions might interfere with an objective, scientific analysis. This is especially true when dealing with unfamiliar languages.
"The second approach to morphology is more often associated with theory than with methodology, perhaps unfairly. This is the synthetic approach. It basically says, 'I have a lot of little pieces here. How do I put them together?' This question presupposes that you already know what the pieces are. Analysis must in some way precede synthesis."(Mark Aronoff and Kirsten Fudeman, What Is Morphology? 2nd ed. Wiley-Blackwell, 2011)
Read More ->>

Phonetics

DEFINITION

Phonetics is the branch of linguistics that deals with the sounds of speech and their production, combination, description, and representation by written symbols. Adjective: phonetic.

A linguist who specializes in phonetics is known as a phonetician.

As discussed below, the boundaries between the disciplines of phonetics and phonology aren't always sharply defined.
Read More ->>

Phoneme (word sounds)


DEFINITION


phoneme

In linguistics a phoneme is the smallest sound unit in a language that is capable of conveying a distinct meaning, such as the s of sing and the r of ring. Adjective: phonemic.

Phonemes are language specific. In other words, phonemes that are functionally distinct in English (for example, /b/ and /p/) may not be so in another language. (Phonemes are customarily written between slashes, thus /b/ and /p/.) Different languages have different phonemes.



EXAMPLES AND OBSERVATIONS

"The central concept in phonology is the phoneme, which is a distinctive category of sounds that all the native speakers of a language or dialect perceive as more or less the same. . . . [A]lthough the two [k] sounds in kicked are not identical--the first one is pronounced with more aspiration than the second--they are heard as two instances of [k] nonetheless. . . . Since phonemes are categories rather than actual sounds, they are not tangible things; instead, they are abstract, theoretical types or groups that are only psychologically real. (In other words, we cannot hear phonemes, but we assume they exist because of how the sounds in languages pattern as they are used by speakers.)"(Thomas E. Murray, The Structure of English: Phonetics, Phonology, Morphology. Allyn and Bacon, 1995)

"Two points need to be stressed: (1) the most important property of a phoneme is that it contrasts with the other phonemes in the system, and hence (2) we can only speak of the phoneme of some particular speech variety (a particular accentof a particular language). Languages differ in the number of phonemes they distinguish . . ., but every valid word in every language necessarily consists of some permissible sequence of that language's phonemes."(R.L. Trask, A Dictionary of Phonetics and Phonology. Routledge, 2004)

An Alphabetical Analogy: Phonemes and Allophones"The concepts of phoneme and allophone become clearer by analogy with the letters of the alphabet. We recognize that a symbol is a despite considerable variations in size, colour, and (to a certain extent) shape. The representation of the letter a is affected in handwriting by the preceding or following letters to which it is joined. Writers may form the letter idiosyncratically and may vary their writing according to whether they are tired or in a hurry or nervous. The variants in the visual representations are analogous to the allophones of a phoneme, and what is distinctive in contrast to other alphabetic letters is analogous to the phoneme."(Sidney Greenbaum, The Oxford English Grammar. Oxford University Press, 1996)

Differences Between Members of a Phoneme"We cannot rely on the spelling to tell us whether two sounds are members of different phonemes. For example, . . . the words key and car begin with what we can regard as the same sound, despite the fact that one is spelled with the letter k and the other with c. But in this case, the two sounds are not exactly the same. . . . If you whisper just the first consonants in these two words, you can probably hear the difference, and you may be able to feel that your tongue touches the roof of the mouth in a different place for each word. This example shows that there may be very subtle differences between members of a phoneme. The sounds at the beginning of key and car are slightly different, but it is not a difference that changes the meaning of a word in English. They are both members of the same phoneme."(Peter Ladefoged and Keith Johnson, A Course in Phonetics, 6th ed. Wadsworth, 2011)

Read More ->>

Definition of Language

DEFINITION
language sign

Language is a human system of communication that uses arbitrary signals, such as voice sounds, gestures, and/or written symbols. The study of language is called linguistics.

Linguists (that is, specialists in the study of language) have defined language in many different ways. Here, chronologically arranged, are a few of those definitions.


"Language is a purely human and non-instinctive method of communicating ideas, emotions and desires by means of voluntarily produced symbols."(Edward Sapir, Language: An Introduction to the Study of Speech. Harcourt, Brace and Company, 1921)
"A language is a system of arbitrary vocal symbols by means of which a social group cooperates."(B. Bloch and G. Trager, Outline of Linguistic Analysis. Waverly Press, 1942)
From now on I will consider a language to be a set (finite or infinite) of sentences, each finite in length and constructed out of a finite set of elements."(Noam Chomsky, Syntactic Structures, 1957)
"[L]anguage is behaviour which utilizes body parts: the vocal apparatus and the auditory system for oral language; the brachial apparatus and the visual system for sign language. . . . Such body parts are controlled by none other than the brain for their functions."(Fred C.C. Peng, Language in the Brain: Critical Assessments. Continuum, 2005)
"A language consists of symbols that convey meaning, plus rules for combining those symbols, that can be used to generate an infinite variety of messages."(Wayne Weiten, Psychology: Themes And Variations, 7th ed. Thomson Wadsworth, 2007)

"We can define language as a system of communication using sounds or symbols that enables us to express our feelings, thoughts, ideas, and experiences."(E. Bruce Goldstein, Cognitive Psychology: Connecting Mind, Research, and Everyday Experience, 2nd ed. Thomson, 2008)


OBSERVATIONS ON LANGUAGE


"Would I had phrases that are not known, utterances that are strange, in new language that has not been used, free from repetition, not an utterance which has grown stale, which men of old have spoken."(ancient Egyptian inscription)
"Language is not an abstract construction of the learned, or of dictionary makers, but is something arising out of the work, needs, ties, joys, affections, tastes, of long generations of humanity, and has its bases broad and low, close to the ground."(Walt Whitman) 
"A language can be compared to a sheet of paper. Thought is one side of the sheet and sound the reverse side. Just as it is impossible to take a pair of scissors and cut one side of the paper without at the same time cutting the other, so it is impossible in a language to isolate sound from thought, or thought from sound."(French linguist Ferdinand de Saussure)
"Language is the mother of thought, not its handmaiden."(Karl Kraus)
"A language is a dialect with an army and navy."(Proverb popularized by linguist Max Weinreich, 1894-1965)
"But behavior in the human being is sometimes a defense, a way of concealing motives and thoughts, as language can be a way of hiding your thoughts and preventing communication."(Abraham Maslow)
"All words, in every language, are metaphors."(Marshall McLuhan)

Origins of Language: The East Side Story

"Language began in Africa, though exactly where is a matter of controversy. East Africa was the birthplace, according to a scenario sometimes known as the 'East Side story.' Around 3 million years ago, a major earthquake created the Great Rift Valley, splitting Africa's inhabitants into two major groups. Our cousins, the chimps, were left living and playing in the lush and tree-rich terrain of the humid west. But our ancestors, the proto-humans, were stranded in the increasingly arid east, where they were forced to adapt or die. . . . They were forced to broaden their diet, and began scavenging for meat. Better nourishment led to a bigger brain, a greater degree of social organization and, eventually, to language.

"But more important than the exact location of language within Africa is the fact that all human languages are remarkably similar to one another, indicating a common origin. Any human can learn any other human language. This contrasts with, say, bird communication, where the quacking of a duck has little in common with the trilling of a nightingale."

(Jean Aitchison, The Word Weavers: Newshounds and Wordsmiths. Cambridge University Press, 2007)




Likenesses and Differences
"When languages come to be seriously compared with one another, the question arises: are all languages alike, or are they different?

"Presumably everyone agrees that there are certain respects in which all languages are alike. All languages consist of meanings, wordings and sounds; they all have names for things; they all have melody, rhythm and syllabic articulation. Equally, everyone agrees that there are certain respects in which languages differ: not only do they obviously have different names for things, they also construct these names differently, have different kinds of melody and rhythm, and different ways of wording and of sounding.

The issue is, simply, which is to be more emphasized, the uniformity or the variety. This is really the old 'analogy-anomaly' controversy metaphorized into a modern form; but it is a critical issue. Philosophers of language stress the universals; they make all languages look alike. Ethnographers stress the variables; they make all languages look different. When new languages came to be described by European linguists, from the early 17th century onwards, first the modern European languages and then languages from further afield, both these opposing tendencies became apparent. Either every language is treated as a version of Latin, or each language is described in its own terms.

"The consequences of this are still with us today."
(Michael A.K. Halliday, "Ideas About Language" in Essays in Honor of Charles F. Hockett, ed. by Frederick B. Agard et al. Brill, 1983)



sumber : https://www.thoughtco.com/what-is-a-language-1691218
Read More ->>

Minggu, 12 Maret 2017

Daftar Irregular Verb & Regular Verb

Hay,. Hay,. Ketemu Lagi Bersama Saya Handiqa Minudin Kali Ini Aku Akan Memposting Tentang Daftar Irregular Verb & Regular Verb.(Sebenernya Cuma CoPas Sihh Hehe dari http://kelasbahasainggris.com/) Oke Ngak Usah Panjang-Panjang Langsung Ajja,. :-)

Untuk Daftar Lengkap Irregular Verb Klik Disini

Untuk Daftar Lengkap Regular Verb Klik Disini

Read More ->>

Bagaimana Menjadi Seorang Guru Yang Baik

1. Berilah contoh yang baik kepada siswa Anda. Ingat bahwa Anda adalah guru. Hal ini penting bagi Anda untuk menjadi seperti "superhero" Angka di mata mereka. Ingat bahwa siswa Anda mencari untuk Anda dan akan mencoba untuk meniru disposisi Anda. Jika Anda kasar atau tidak pantas, mereka akan memiliki model yang tidak pantas untuk perilaku mereka. Sangat penting bahwa siswa melihat Anda sebagai orang yang percaya diri, sehingga mereka mengikuti langkah Anda, dan merasa nyaman berbicara dengan Anda. Siswa, dari segala usia, membutuhkan seseorang yang mereka dapat bersandar, melihat ke, dan kepercayaan.


2. Memiliki konsekuensi yang jelas. Mengatur konsekuensi spesifik untuk melanggar aturan. Putuskan apa konsekuensinya dan kemudian menerapkannya secara konsisten. konsekuensi Anda harus mengikuti prosedur yang dimulai dengan sinyal non-verbal (seperti hanya melihat siswa), untuk sinyal verbal (meminta siswa untuk menyenangkan berhenti berbicara), untuk peringatan lisan (jika ini terus berlanjut akan ada konsekuensi ), untuk pelaksanaan konsekuensi. Konsekuensinya terserah Anda dan tergantung pada program sekolah. Banyak sekolah memiliki sistem penahanan (siswa melakukan membenci penahanan), atau mungkin menulis garis, atau duduk jauh dari siswa lain.


3. Jadilah penuh kasih. pendidik besar membentuk hubungan yang kuat dengan siswa mereka dan menunjukkan bahwa mereka peduli tentang mereka sebagai orang-orang. Mereka hangat, diakses, antusias dan peduli. Terbuka untuk tinggal di sekolah setelah-jam untuk membantu siswa atau mendapatkan terlibat dalam komite dan kegiatan sekolah-lebar, dan mereka menunjukkan komitmen untuk sekolah.


4. Mengatur beberapa aturan dasar. Anda harus memiliki 3-5 aturan bahwa siswa tahu tentang. Ini adalah aturan yang, bila rusak, tunduk pada skema konsekuensi yang diuraikan di atas. Coba memungkinkan kelas untuk menunjukkan aturan-aturan dasar: memiliki diskusi kelas dan menulis ide-ide, itu membuat kelas merasa mereka mendengarkan dan bahwa Anda peduli tentang pendapat dan masukan sementara juga menetapkan beberapa dasar bahwa mereka akan setia kepada karena mereka mereka telah membuat itu. Bertindak sebagai mediator untuk memastikan bahwa aturan diputuskan sesuai. Beberapa mungkin, misalnya, menjadi tenang ketika guru berbicara, saling menghormati, dan menyelesaikan pekerjaan rumah dan tugas kelas.


5. Cobalah menjaga lingkungan yang kreatif! Ini akan membantu anak-anak (5-11) berpikir lebih kreatif dan mereka akan datang dengan keren, ide-ide baru.
Read More ->>

Rabu, 08 Maret 2017

How to be a good teacher

1.  Set a good example to your students. Remember that you are the teacher. It is important for you to be like a "superhero" figure in their eyes. Remember that your students look up to you and will  try to mimic your disposition. If you are rude or inappropriate, they will have an inappropriate model for their behavior. It is vital that students see you as a person with confidence, so that they follow your lead, and feel comfortable talking to  you. Students, of all ages, need someone they can lean on, look up to, and trust.


2.  Have well-defined consequences. Set specific consequences for breaking the rules. Decide what those consequences are and then implement them consistently. Your consequences should follow a procedure that starts with a non-verbal signal (such as just looking at the student), to a verbal signal (asking the student to please stop talking), to a verbal warning (if this continues there will be consequences), to the implementation of the consequence. The consequences are up to you and depend on the program of the school. Many schools have a detention system (students do despise detentions), or perhaps writing lines, or sitting away from other students.


3.  Be compassionate. Great educators form strong relationships with their students and show that they care about them as people. They are warm, accessible, enthusiastic and caring. Be open to staying at school after-hours to help students or get involved in school-wide committees and activities, and they demonstrate a commitment to the school.


4.  Set some ground rules. You should have 3-5 rules that the students know about. These are the rules that, when broken, are subject to the consequence scheme outlined above. Try allowing the class to suggest the ground rules: have a class discussion and write ideas, it makes the class feel they are listened to and that you care about their opinions and input while also setting some groundwork that they will feel loyal to because they've made it. Act as a mediator to make sure that the rules decided upon are appropriate. Some may be, for instance, be quiet when the teacher is talking, respect each other, and finish the homework and classwork.


5.  Try maintaining a creative environment!  This will help children (5-11) think more creatively and they will come up with cool, new ideas. 
Read More ->>
Diberdayakan oleh Blogger.