; (redundancy) ѤˤĤơ#1089. ȸ; ([2012-04-20-1])#1090. ; ([2012-04-21-1])#1091. ;١ѡ ([2012-04-22-1])#1098. ؤͿƤ뼨2 ([2012-04-29-1])#1101. Zipf's law ([2012-05-02-1]) ʤɤǵƤηϤΤȤƤߤ;Τۤˡ㤨бѸֻȤɽŪηϤˤ;ͤ뤳ȤǤ롥#1599. Qantas ȯ ([2013-09-12-1]) Ǿ̤ꡤ㤨 <q> θˤ <u> 뤳Ȥ˹⤤ΩǴԤ뤿ᡤ<qu> ;ζˤƹ⤤ʸϢȤȤǤ롥
ѸֻηϤΤȤƤߤƤ;⤤ΤᡤѸθá֡졤Ѥʤɤ˴ؤ塤Ѿμ˭٤ǤСɬˡ̤֤ƤʤȤ⡤ʬʸϤɲ뤳ȤǤ롥ġñֻεϤΰæϤȤꡤʸʸζ̤ʤꡤʬ¾ζˡάƤ⡤¿ΤΡ褽ɤ뤳Ȥϲǽ̤˸ѲѰۤˤƷû (shortening) ӻǤ뤳ȤͤСɸŪʽդˤƤ⡤ֻˤṳ̂ˤȤưפ롥δϡγݤѤκǾϾΩطˤꡤξԤϤ줫Фꤹʤ褦ʷǡֻηϤХݻƤΤȹͤ롥
줫ϤФꤹηϤȤƵǽʤʤΤΡ¿ФˤȤɤޤ¤ϡʤȤѤΤǤ롥ȤƷӵѤƤǶ Short Messages Service (SMS) ǤϡѼԤϡꥢ뤿ˡåɲǽϰǤʤ٤̤ɬפ롥ѸΥåˤĤƤСֻ;Ǿˤ褦ʸץˤ뤳ȤˤäơºݤΰΨ뤳ȤǤ롥ſʸΤθǤȤäȤ
ºݤˡθƤߤ褦ʲ "Text Squeezer" ϡ첻礿ˤȤḁ̊ץ1ĤǤPerl ⥸塼 Lingua::EN::Squeeze ѡˡϤƥȤˤ뤬10%ʾΰΨ롥ϥƥȤϡΤ˲뤬ƤȤʤѤȤ狼롥Ṳ̆ˡǽ줿ʸǡѸˡ;Ǥ뤫ΤƤ餤
#1813. IPA ٵήˤҲʬ ([2014-04-14-1]) ˰³Ĵؤ˴ؤɽˤĤơCarr (xx--xxi) βؤζʽˡĴﴱοޤIPAʬɽڡ˰ƤΤĤΤǡʲåPDFˡ

ä˱ˤٵήˤҲʬɽˤĤơؽΰˤʤ褦ˤȡɽηġʲ˺äƤߤĴؤγؽΰˤɤ
αѸظˤơҤɽȤХꥫѸ˴ؤ Kucera and Francis (1967) ΤΤ䡤ꥹѸŤ֤꿷ΤȤ CELEX (1993) 䤽2 (cf. #1424. CELEX2 ([2013-03-21-1])) 褯ѤƤǶᡤȽˡ˴ŤꥫѸθɽ줿٥륮إؤμ¸زʤ SUBTLEXus Ǥ롥HP顤SUBTLEXus ΰ췲ɽΥե䵭ҤɡǤ롥
SUBTLEXus δפˤ륳ѥϡ8388αDzλνǤꡤ5100˵ڤ֡SUBTLEXus ɽϡKucera and Francis CELEX ɽ٤ơĤλФ줿ɸˤƤƤȼĥƤ롥٤ϡФ (lemma) ȤǤϤʤ (word form) Ȥ˿Ƥꡤ㤨̾Ǥñ -s ʤɤʣ̰ʰۤʤ74,286ˡ̾ưʤʣʻȤѤˤĤƤϡ줾ʻ줴Ȥ٤ˤ⥢Ǥ뤷ͥʻ (Dominant POS) Τۤع绻٤ؤ⥢Ǥ롥ǡˤϡۤ˲αDz˸Ƥ뤫ʸȤƸƤΤϲ٤пäɸZipf ɸ (cf. #1101. Zipf's law ([2012-05-02-1])) ʤɤޤޤƤ롥μΥǡޤޤƤȡŪȥǥǤͭѤǤäե١Ǥ뤳Ȥ⸲ħ
ɤǤ뤤ĤΥǡΤʤ "a zipped Excel file of SUBTLEX-US with the Zipf values included" ɤäƤߤ㤨С(1) Ū¿졤 (2) ¿αDzˤ⸽ϡŪʰ̣٤⤤ȹͤ (1) (2) ˴ؤпλɸݤ碌ơ߽¤٤ƺǽ100ȡäκñ100줬ϤάҳʤɤޤޤƤ뤬ʲΥꥹȤǤ롥
you, I, the, to, s, a, it, t, that, and, of, what, in, me, is, we, this, he, on, for, my, m, your, don, have, do, re, no, be, know, was, not, can, are, all, with, just, get, here, but, there, ll, so, they, like, right, out, go, up, about, she, if, him, got, at, now, come, oh, one, how, well, want, yeah, her, think, good, see, let, did, why, who, as, going, his, will, from, when, back, time, yes, look, d, take, an, where, man, would, them, been, some, or, tell, us, had, were, say, could, gonna, didn, hey
ۤˤϡ10졤25졤50졤100졤250졤500졤1,000졤2,500졤5,000졤10,000졤25,000졤50,000졤100,000ˤĤơDominant POS Ȥ˿夲Ƥߤ뤳Ȥ⤿䤹#666. COCA 5000ʻ̤γϡ ([2011-02-22-1])#667. COCA 50ʻ̤γϡ ([2011-02-23-1])#1132. ñʻ̤γ ([2012-06-02-1]) εǤ⡤̤Υѥˤ褦ĴԤäSUBTLEX-US ǤĴ̤ϼΥդˤޤȤ롥
ʲϤޤθġ (SUBTLEX-US Word Frequency Extractor) ޤʤΤǡ10ޤǤ̤ϤʤͤǤSUBTLEXus ʣʸǽʡSUBTLEXus Online Search ɤ
ʸʸˡ (construction grammar) ϡλȾδ֤ȯŸƤǧθؤ˴ŤʸˡǤ롥Lakoff, Fillmore, Goldberg, Kay ʤɤˤäƤ
ʸȤªΤΤϡˤĹ롥¤ؤǤ뤵Ƥήʸפιͤ⡤ض̤ƹΤƤ롥ʸˡоˤꡤιʸʸв졤ŪӸݤȤư褦ˤʤä
1970ǯȾǧθؤˤꡤʸñ˷ŪʴǤϤʤǽỤ̄Ūʴ饢ץ褦ˤʤäιʸϡع¤ΤǤϤʤ켫Ȥλʤˤΰ̣ľܹñ̤ǤȤͤ㤨СMe write a novel?! Ȥ츫˳Ūʹʸϡ켫ΤȼαΧʼȽ徺ĴΥȥ͡ӤӤˤȼ֤פްդ롥ޤThere's the bell! Τ褦ʹʸϡͺؤ夲ưȤȤѤ뤳Ȥ¿γФľפɽ魯ȤäʸʸˡǤϡʸΤΤ̣ѡΧʤɤꤷƤª롥
ʸ̣ʤɤꤷƤȤäƤ⡤εζѰۤ롥㤨СIs A B? ιʸŵŪ˼ȯù٤ɽ魯Is that a fact? ϡ̾ǤϤʤüԤζäɽ魯ʤŪȯù (indirect speech_act) Τ褦ˡʸʸˡϡʸȤΰ̣δطץȥŪ˹ͤɬפȼĥ롥ޤ귿ʸȤʤȡΤʤθ¾ΤΤ˸Ǥʤʤʤɡ̣ŪŪͻ̤Τʤʤ륱⤢롥㤨СThanks a lot, Thanks a million ȯŸ Thanks a billion ϲǽ*Thanks a hundred ԲǽȤʤ롥day in day out, month in month out ϲĤminute in minute out century in century out ԲĤǤ롤 (Taylor 225--28)
ʸʸˡϾ嵭Τ褦ʸˡؤΥꥢȤƤǯǤʸˡ¦ǤʸʸˡȿΤȿʬʤɤȯŸƤƤ롥ʸħˤʤäƤȤ
ʸʸˡȤߤ BNC ʸ˹ʸդǡ١http://framenet.icsi.berkeley.edu/ ǸƤꡤΥեꥢǤ롥ܤ٤Ѹ칽ʸϿƤ롥
Taylor, John R. Linguistic Categorization. 3rd ed. Oxford: OUP, 2003.
#1809. American Heritage Dictionary Notes ([2014-04-10-1]) ǡThe Free Dictionary ǥǤ Notes ؤΥäNotes ΤΤϡ1.6MBΥڡءˡϡΤʤ Word Histories ˴ؤ Notes Τǡ١#952. Etymology Search ([2011-12-05-1]) Τǡġ "AHD Word History Note Search" äƤߤ
츻ϿƤ븫ФǤСΥñФ褯ΥġͭϤޤʤΥġħϡNotes ȤɽǸǤ͡ʥǥեȡˤˤ롥㤨Сܤ˲餫θڤΤñθ츻ΤǤСθܥå Japan Ф褤ɴطǤ (Irish|Ireland) ʤɤۤˤϡsearch range "Search for entry words" ؤơ^[A-Z] ȸܥåȡͭ̾θ츻롤
2֤ε#1806. ARCHER shew show ([2014-04-07-1]) ȡ#1807. ARCHER between betwixt ([2014-04-08-1]) ǡARCHER Untagged ѤơѰ۷٤̻ŪˤɤΤ褦˿ܤƤĴ
ѸνޤॳѥȤƤϡۤ CEECS (The Corpus of Early English Correspondence, LC (The Lampeter Corpus of Early Modern English Tracts), CLMET3.0 (The Corpus of Late Modern English Texts, version 3.0), PPCMBE, COHA ʤɤꡤ줾ħ뤬ARCHER ϡ1600--1999ǯȤޤȤޤä֤СѼ綠줾ˤĤƥʬʤƤꡤŪ緿˥ѥȤƲͤ⤤#1802. ARCHER 3.2 ([2014-04-03-1]) ǾҲ𤷤̤ꡤߥ־ǰ̸ƤǤˤĤƤϡޤʤɤƤ餺ǽ¤Ѥ뤳ȤϤǤʤǤȳѤǤ롥Ƥ Frequency lists Keywords εǽϥǥͭ˻ȤѥΤñ٥ꥹ (TXT)Ƥ롥
̻ŪʸѲȤ ARCHER ˾ൡǽϡ2֤εĴ褦ˡ븡٤ɤäơʤĤǤ˥̤ˡˤɤΤ褦˿ܤƤñ˳ǧǤ褦ˤ뤳ȤRestricted query ǻȥʤꡤ˸ϤƥҥåȿƤ椯ȤȤϼȤǤǤ뤬֤뤷ݤ#607. Google Books Ngram Viewer ([2010-12-25-1]) COHA Ǥϡ̻Ūʰǽˤ뵡ǽƤΤǡARCHER Ǥ;פƱͤεǽߤʤ롥ǡߤΤʤкäƤޤȤȤǡñʥץȤȤARCHER θ̤Υ饤ˤϡƥȤɽ魯ե̾դƤ뤬ե̾λͤˤС3ʸ줾쥸롤ѼΤ줫ɽ魯ȤʤäƤ롥ǡ̤ԡơʲΥƥȥܥåŽդƤȡŬڤ˥ե̾Ϥ롤Ѽ老Ȥ˥ҥåȿƤ졤ղƤȤġ (ARCHER Period-Genre Sorter) ARCHER ǤνϷ̤ڡˤޤˤϡ뤬ƥڡԥڤѤƤФ褤

ɸϡꥫβȡȯ Samuel Finley Breese Morse (1791--1872) ȯſѤ硥ȥġȤΤ롥û (dot)3ܤĹʤĹ (dash) (space) Ȥ߹碌ʤꡤȤ߹碌ե٥åȤб롥
Morse ϡ1830ǯſۤơ1838ǯ˸Υ⡼륹θۤθ塤1844ǯ Baltimore Washington ؤκǽſ̤ŪʺǽΥå "What has God wrought!" ȯŪȿƤӡθ塤衼åѤDzä졤1851ǯ˹ݲĤˤ International (or Continental) Morse Code ꤵ줿1938ǯ˾ѹä줿ߤ˻ޤǹŪˤϹǤ§ȤѤƤʤꥫϥꥸʥǤλѤˤ³ˡ⡼륹ˤſϡä饸ȯˤŪ˱Ƥʤä̿ĶǤ¤ξǽǤ뤳Ȥ顤21θߤǤⴰ̵ѤȤʤä櫓ǤϤʤӡʸ⡼륹ʤɤθѼ⸽줿ߤǤϥޥ奢̵ȤˤѤʤɤ˻ϰϤ¤Ƥ롥
Ūˤϡ⡼륹ϤĤħäηϤǤ롥Ǥħϡ졤Ȥ櫓ʸ礭¸ηϤǤȤȤΩηϤȤϡѵȤäƤ褯Ǥ䥿ॿݸƱͤǤ롥Saussure #1074. Hjelmslev θء ([2012-04-05-1]) ѸǤС¼ (substance) Ѥäǡ (form) ѤäƤʤȤȤˤʤ롥⡼륹ǤϡȥġȤ߹碌ե٥å1ʸ˸̩бƤꡤ줬ȤʸƱǻ־夢뤤϶־롥¤ӽȤϤˤϤ뤬ϼΩͭǤϤʤظˤʸʤäΤˤʤӾ塤p. 125ˡ
⡼륹Τ⤦1Ĥħϡμ̤ǤȤϤĤĤ⡤Ȥϰۤʤʬ (double_articulation) äƤ뤳ȤΤ褦ʬͭ뵭ηϤȤΤ⡼륹ϿŪʵηϤǤ뤫顤ʬηкտŪȤ߹ޤ줿ȤȤ϶ä٤ȤǤϤʤʬĤۤεηϤȤơҤξã衤ֹʤɤ⤢ˡȤϰۤʤʬȤ߹ޤƤ뤳Ȥܤͤ롥⡼륹ǤϡβǤΤϥȥȥġ2Ǥ롥2ΡֲǡפޤäǷޤäĿȤ߹碌뤳Ȥǡ1ĤʸбַǡפΤ褦ʡַǡפ嵭θ¸§äƤ椯ΤӾ塤p. 87ˡۤˤϡɤε;㤤ʤɤħ褦
Ǥϡݥ⡼륹μºݤߤƤߤ褦ξܺ٤ϡRecommendation ITU-R M.1677-1 (10/2009) International Morse code (PDF) ǧǤ롥̤Ρʱʸ˥ƥȤȹݥ⡼륹Ѵϡ־ Morse Code Translator ʤɤʤΤ뤬ʲ hellog ǤäƤߤƥȤ뤤ϥ⡼륹Ϥȡ¾Ѵ͡
#1730. AmE-BrE 2006 Frequency Comparer ([2014-01-21-1]), #1739. AmE-BrE Diachronic Frequency Comparer ([2014-01-30-1]) ǡthe Brown family of corpora [2010-06-29-1]ε#428. The Brown family of corpora ѾաפȡˤѤѼ֤뤤̻ŪӥġäBrown family ȤС褦߷פԤޤ줿 ICE (International Corpus of English) ۵[2010-09-26-1]ε#517. ICE 7ϰѼ拾ѥפȡˡ1990ǯʹߤνդäդǼ줿100쵬ϤΥѥǡߤӲǽȤʤ褦˺Ƥ롥
ǡ긵ˤ ICE ΤCanada, Jamaica, India, Singapore, the Philippines, Hong Kong αѸѼ拾ѥ6оݤˡƱ褦ɽꡤǡ١ӤǽȤʤġȤˤĤƤϡ#1730. AmE-BrE 2006 Frequency Comparer ([2014-01-21-1]) Ȥ줿
#1730. AmE-BrE 2006 Frequency Comparer ([2014-01-21-1]) ǡ2006ǯνեƥȤԻƳѼ拾ѥҲ𤷡˴ŤӥġΥġʤ鵤ŤΤƱˡԻ졤ϤƱ100٤ the Brown family of corpora ʡ#428. The Brown family of corpora Ѿա ([2010-06-29-1])ˤϢȤСľ50ǯ֤ۤɤ̻ŪʱƴӤưפ˲ǽȤʤ롥
ǡεǾҲ𤷤 Professor Paul Baker - Linguistics and English Language at Lancaster University ˤ AmE06 BrE06 ˲äơեꥫѸɽ Brown (1961), Frown (1992)եꥹѸɽ LOB (1961), FLOB (1991) ɽФ碌ƥǡ١ѤλϡAmE-BrE 2006 Frequency Comparer ȤۤƱʤΤǡμ ([2014-01-21-1]) Ȥ줿ϤɽǤϡθиƥȤοٽ̤ϾʤƤꡤ100٤ɽˤȤɤƤΤǡAmE06 BE06 ˤĤԤξɬפʾˤϡAmE-BrE 2006 Frequency Comparer ɤ
Professor Paul Baker - Linguistics and English Language at Lancaster University ȤڡƤäBaker ԻѸ졦Ƹ쥳ѥ BE06 AmE06 ξȡФñꥹȤ롥ΥѥΤϡ桼ID᤹Сؤ CQP (Corpus Query Processor) system ꥢǤ롥
BE06 AmE06 ϡ2006ǯ˽Ǥ줿ꥹѼȥꥫѼνնѹեѥǤ롥Ի乽ϡ#428. The Brown family of corpora Ѿա ([2010-06-29-1]) ǾҲ𤷤 The Brown family ˽सƤꡤ500ƥȡ2000η100ۤɤεϤ
ơΥڡɤǤ BE06 Wordlist in WordSmith 5 format AmE06 Wordlist in WordSmith 5 format ʸФǤϤʤ˸ˤɽФ줾ǡ١ơѼθ٤ӤƤ AmE-BrE Frequency 2006 Comparer ʤġƤߤ
acknowledgment, acknowledgement, aging, ageing, aluminum, aluminium, analyze, analyse, apologize, apologise, armor, armour, behavior, behaviour, center, centre, civilization, civilisation, color, colour, defense, defence, disk, disc, endeavor, endeavour, favor, favour, favorite, favourite, fiber, fibre, flavor, flavour, fulfill, fulfil, gray, grey, harbor, harbour, honor, honour, humor, humour, inquiry, enquiry, judgment, judgement, labor, labour, license, licence, liter, litre, marvelous, marvellous, mold, mould, mom, mum, neighbor, neighbour, neighborhood, neighbourhood, odor, odour, organize, organise, pajamas, pyjamas, parlor, parlour, program, programme, realize, realise, recognize, recognise, skeptic, sceptic, specter, spectre, sulfur, sulphur, theater, theatre, traveler, traveller, tumor, tumour
ޤǤϡäֻ˴ؤƺΥѥˤӤϡ#708. Frequency Sorter CGI ([2011-04-05-1]) ѤꡤBNC Frequency Extractor ([2012-12-08-1]) ȡ#1322. ANC Frequency Extractor ([2012-12-09-1]) Ȥ߹碌ꡤthe Brown Family corpora ʻѤʤɡѼ拾ѥθӤˤн褷ƤΥġˤ¿ʴĶǤ
#1567. ѸܸΥ饤ѥĤҲ ([2013-08-11-1]) ǡܸΥѥȤKOTONOHA ָܸնѹեѥ˸ڤΡظܸնѹեѥ (BCCWJ: Balanced Corpus of Contemporary Written Japanese) ϡضƱѵˡͿʹʸ浡Ω츦ʸʳؾʲʳظΰ踦ܸ쥳ѥץץȤƱdzȯܳŪʥѥǤ롥
ѥƤˤĤƤϡƱȤˡ2012ǯ3ߡоݤȤʤäƤΤϡʲ11Υǡ1500ǤפȤ롥ץϡ1976--2008ǯˤƤʸǡ11ΥϽҡʹʽ桤Yahoo!ηޡYahoo!֥ʸˡΧϿˤ錄롥ƥƥȤ2Υץ뤬Ƥꡤ֤ҤȤĤĹ1000˸ꤷץ (Ĺץ)⤦ҤȤĤϡϤʤʸϤΰ̣ΤޤȤޤбñ̤ΤǤ (Ĺץ)ޤǤĴˤСĹץʿĹϿʹ1000Ҥ4000ǤפȤ롥
BCCWJ Ѥˡ䥤եϤĤ뤬äȤؤʤΤˤĥäǼǤ롥Ͽפǡɽؤʸˤ륳ѥʸǤ롥Ϥ̵٤500¤뤬ڤ˻ȤǤ롥
ѿɬפǼǤϡƱѥФơûñ̡Ĺñ̡ʸ3ĤˡˤꡤŪʣʸ뤳ȤǤ롥
ޤ̤ΥեȤơNINJAL-LWP for BCCWJ (NLB) 롥Ԥ1.20ǤǤϡBBCWJ ΤۤȤɤΥǡоݤȤơ뤳ȤǤ롥ڡ
ϢơNLB ƱեѤǤ⤦1Ĥܸ쥳ѥҲ𤹤롥ؤ֥ȤƥȤԻ11줫ʤȥ֥ѥ (Tsukuba Web Corpus: TWC) ؤΥեNINJAL-LWP for TWC (NLT)Ǥ롥ڡ
ε#1621. The Middle English Grammar Corpus (MEG-C) ([2013-10-04-1]) ǿ줿ѸϿ LALME βŻ eLALME ǯEdinburgh ؤꥪ饤Ǹ줿 LALME ˤä꤬ʤɡǤȤäƤ褯ǽ˭٤両ؤʤɤǡŻǤȤѤƤ椯ȤˤʤȻפ롥
ǤФƼγĥʤƤ뤬Item Number ʤɤбֹ椬ۤʤäƤΤ⤢Τդפ롥㤨Сbetween ΰ۷ʬۤˤĤơǤǤ Dot Maps 703--06, 1118--19 6ʬۿޤǺܤƤ뤬ŻǤǤ Item Number 89 ΤȤ16ʬۿޤǺܤƤ롥ºݡDot Map οŻǤˤʤä1/3ʾ
ޤ桼ϿޤȤΤܤĥ롥#1394. between ΰ۷֤ʬ̻ۤŪѲ ([2013-02-19-1]) ε ([2013-10-04-1]) Ǥˤ between Ū۷˴ؤơλҲ x ޤॿפѸǤɤΤ褦ʬۤƤΤꤿꤷ褦"User-defined Maps" εǽ顤"Select one or more items" "89 BETWEEN pr [North & Ireland]" ǡ"Select one or more forms" x ޤ֤Τ٤Ƥ˥å롥줫 "Make map" åСʲΤ褦 Dot Map ȤȤߤǤ롥 Dot Map ⡤٤塼˥Ǥ롥

Ǥ Item Map Τϡ־ǤϿѤθ³顤ŻǤǤʤؼʤȤơ桼ϿޤΥɥåȤå뤳Ȥˤꡤˤܤΰֻݥåץåפ뤳ȤǤ롥ϴ Dot Map ǤԲǽʤΤǡ桼ϿޤѲͤϹ⤤
Ҳ𤷤 LALME ϥѥ The Middle English Grammar Corpus (MEG-C) ȹ碌ơѸĤܳŪ˥ǥȤΤǤϤʤ
ʤϿȤмΡ#846. HelMapperUK --- hellog ͤαѹϿ CGI ([2011-08-21-1]) ɤ
McIntosh, Angus, M. L. Samuels, and M. Benskin. A Linguistic Atlas of Late Mediaeval English. 4 vols. Aberdeen: Aberdeen UP, 1986.
Ѹ˾αѱѼ Robert Cawdrey A Table Alphabeticall (1604) ˤĤơcawdrey γƵˤƤ饤ȤˡùܵҤǽȤ뤿ˡʰץǡ١館ȾмưǥƥȤäƤΤʤΤǺ˥顼뤫⤷ʤȤꤢȤ褦ˤ
ǡ١Ƥ֥饦ǥƥȷˤƱϡɤʤ뤤ϥƥȥե뤽ΤΤˡ
# ǡ١Τɽ
select * from cawdrey
# Ͽ˥ˤäƥ
select INITIAL, count(*) from cawdrey group by INITIAL
# Ͽʸˤäƥ
select LENGTH, count(*) from cawdrey group by LENGTH
# Ͽ츻ˤäƥ
select LANGUAGE, count(*) from cawdrey group by LANGUAGE
# 츻ȸĹδط
select LANGUAGE, avg(LENGTH) from cawdrey group by LANGUAGE
# Ͽˤäƥ
select DEF_WC, count(*) from cawdrey group by DEF_WC
# 츻δط
select LANGUAGE, avg(DEF_WC) from cawdrey group by LANGUAGE
# "(k)" (kind of) ޤ
select LEMMA, DEFINITION from cawdrey where DEFINITION like '%(k)%'
# " or " ޤ
select LEMMA, DEFINITION from cawdrey where DEFINITION like '% or %'
# " and " ޤ
select LEMMA, DEFINITION from cawdrey where DEFINITION like '% and %'
# ɤʶǽäƤ뤫
select substr(DEFINITION, -1, 1), count(*) from cawdrey group by substr(DEFINITION, -1, 1)
ݡ롦Х ס رѸθá١ҡʸ˥ӡ1976ǯ
־Ѥ뤳ȤΤǤ륳ѥĤҲ𤷤
ޤ#1441. JACET 8000 Υ١ˤå٥ʬϥġ ([2013-04-07-1]) Ǽ夲ëϡBusiness Letter Corpus Υ饤ǸƤ롥27ΥѥθǽȤʤäƤ뤬ᥤ100Ķʤ Business Letter Corpus (BLC2000) Ȥ˥դ POS-tagged BLC 2Ĥ1970ǯʹߤαƤ¾νʪǡǤ롥
Instructions for the First-Time User ǤޤȤƤ褦ˡΥѥΤʤˤϡ167Ķ State of the Union Address (1790--2006) ʤɥǡɤǤΤ⤢ꡤͭѤǤ롥Ѻʸγؽ䡤ȼǡ١ΥΤ˻ͤˤʤ롥
ʤƱȤǤϡҤγƼ拾ѥ N-Gram Search Ԥʤ Bigram Plus εǽƤ롥N-Gram θˤϡܥ֥#956. COCA N-Gram Search ([2011-12-09-1]) ⻲ȡ
ϡѹΥ (University of Leeds) 絬Ϥ Leeds collection of Internet corporaѸϤᡤե졤ܸʤɤ͡ʸΥѥ饤ǸǤ롥
ܸΥѥξˤĤƤϾܤʤKOTONOHA ָܸնѹեѥϽ¤Ƥ褦ܸۤ쥳ѥξȤƤϡѥܸؤΤξ --- ѥҲͭѡ
ܤαѸ춵ǤϡJACET 8000פȤý褯Ѥ롥Ƹ1--8θå٥뤬դƤꡤʸƥȤȽ䶵ฦ桦ȯʤɤ˻Ȥ롥ۤˤ⡤Ū SVL12000 WLC ʤɤθý¸ߤ뤬줾ħˤĤƤϡë١ˤĤˡΤ褦ˤ롥
JACET8000 رѸ춵زܸѰԻؽåꥹȤǡBritish National Corpus ܿͱѸؽԤδĶƧޤȼ˺줿֥ѥ˽ζ鸽ξˤθפƺ줿ΤǡܿͱѸؽԤΤβʳŪɽפȤɾƤޤܤϡرѸ춵زܸꥹJACET List of 8000 Basic Words١رѸ춵زܸѰ2003ǯˤȤƤ
SVL12000ʡɸÿ12000סˤϳҥ륯ȼ˳ȯåꥹȤǡ֥ͥƥ֥ԡΡֻ١פ١ˤʤ顤ܿͳؽԤˤȤäƤΡͭסֽפθԽפΤǡ¸γؽɽǤϥСƤʤ?Ǿ٥θáLevel 8 ? Level 12ˤޤޤƤΤħǤ
WLC ١ ϡAWK ˤå٥ʬ۷¬ץסë 1998) ˤƺ줿ΤǡӥͥѸʬѤò35,000θФ줫ʤåꥹȤǤܤ ȤƤʤWLC ١ǻѤƤʻ쥿μˤĤƤϤȤƤ
ë륪饤 Word Level CheckerʱʸٲϥץǤϡƥȥܥå˱ʸꤲȡå٥뤴ȤΥƥȥСΨ֤Ƥ롥١ȤƤϡJACET8000, SVL12000, WLC (Ver.02) Τ줫뤳ȤǤ롥
ä JACEL 8000 ١ȤġȤƤϡJACET 8000 TOOLS 餤ĤΤΤ˥Ǥ롥
JACET 8000 LEVEL ANALYZER: ʸꤲȡñФ첽Ǹå٥뤴ȤΥƥȥСΨ֤Ƥ롥ץλͤˤĤƤϡ忭ˤ JACET 8000 °CD-ROM Υץǡˡͤˤʤ롥
JACET 8000 LEVEL MARKER: ʸꤲȡñ˥٥ɽ魯 (1--8) Ĥƥ顼ɽƤ롥
JACET 8000 Measuring Vocabulary: Ͽǥƥȡ#833. Ͽǥƥȡ ([2011-08-08-1]) ǾҲ𤷤 Test Your Vocab ⻲ȡ
Ϣơ¾αѸɽˤĤƤϡ#308. Ѹκѱñꥹȡ ([2010-03-01-1]) ȡ
#471. toilet ˭٤նɽ WordNet Visuwords Ǥߤ ([2010-08-11-1]) #1270. ͥåȥβĻ벽ġ켭 ([2012-10-18-1]) ǡ饤ѤǤ奢ġҲ𤷤ä˸[2012-10-18-1]˥äƤΤǻȡˡ instaGrok ʤ륦֥ӥȯgrok Ȥ¯ "to understand sth completely using your feelings rather than considering the facts" ̣뤬instaGrok Ǥϥ奢ľŪ˸Υͥåȥİ뤳ȤǤ롥
ϤͥåȥޤϡGraph Words, Visuwords, Visual Thesaurus ʤɤȤ褽Ʊ餷ʸɤȷӤĤ륦֥ڡưؤΥϢʤɤΤŪˡ Glossary ˤϡꤷɤϢŪ (syntagmatic) Ū (paradigmatic) ˴ˤĤʤ췲ʤषϢ۸췲ȸƤ֤٤ˤñȤȤ뤬ϻꥭɤȯȤȯۻٱ¥ġȤʤ롥㤨Сɤ "tsunami" ꤹȡʲΤ褦ʲ̤ʲåȳǡˡ

ǡϥ־ΥǡΤ褦ǤɤΤ褦ʥȤäƤΤǤ롥
Glossary Ϣ۸췲ǤñȴФ⤷ʤȻפΥġä°̤켭Ūʸ췲ȤϰۤʤäϢ۸줬Ƥ⤷֥١ʤΤǡ"Japan", "Pacific ocean" ʤɤθͭ̾ʤɤȻŪϢ۸줬줿ꤹ롥100ޤǤΥꥹȤϤ롥
Helsinki Corpus (The Diachronic Part of the Helsinki Corpus of English Texts) 1991ǯ˸ư衤Ѹ˥ѥθĤȤƽѤƤHC ϸߤǤƤ餺ܥ֥Ǥ#381. oft often ʬ̻ۤŪѲ ([2010-05-13-1]) Ϥᡤhc γƵǸڤƤ
HC ܳŪ˻ȤʤˤϡΥޥ˥奢ɤɬפ롥Ȥ櫓̥֥ѥθϲƤɬפ뤷COCOA Format ˤ뻲ȥפCOCOA Format ϡHC ΥƥˤΥƥȤ˴ؤξͿ뤿ηǤ롥ƥƥȤˤĤơǯ塤Ԥ̡ʸʸʤɤξηˤͿƤ롥ѼԤϡξѤ뤳ȤˤꡤξƥȤӽФȤǤȤ櫓
HC COCOA Ѥιʤߤؤˤ뤿ˡޤɽˤޤȤǡ١ (SQLite)
A = "author"
B = "name of text file"
C = "part of corpus"
D = "dialect"
E = "participant relationship"
F = "foreign original"
G = "relationship to foreign original"
H = "social rank of author"
I = "setting"
J = "interaction"
K = "contemporaneity"
M = "date of manuscript"
N = "name of text"
O = "date of original"
P = "page"
Q = "text identifier"
R = "record"
S = "sample"
T = "text type"
U = "audience description"
V = "verse" or "prose"
W = "relationship to spoken language"
X = "sex of author"
Y = "age of author"
Z = "prototypical text category"
ŵŪʸȤƵƤ
# ɽΤƸ[ | ѥڡ ]
select * from hccocoa
# ʬ̤Υƥȿ
select C, count(*) from hccocoa group by C
# ƥȥ̤Υƥȿ
select T, count(*) from hccocoa group by T
# ME ˻ʬƤƥȤγƼ
select B, C, D, V from hccocoa where C like 'M%' order by C
ε#1321. BNC Frequency Extractor ([2012-12-08-1]) ˰³ANC (American National Corpus) ˴ŤɽANC Second Release Frequency Data Υڡ˸ƤΤǡ"ANC Frequency Extractor"
# եƥȤǡƺȤ "diarrhoea" vs. "diarrhea" ֻ٤ǧ
select * from written where word like "diarrh%"
# եƥȤǡƺȤ "judgement" vs. "judgment" ֻ٤ǧʤ¾[2009-12-27-1]ε#244. ֻαƺΥꥹȡפֻǤ椯Ȥ⤷
select * from written where word like "judg%ment%"
# -ly ǽʤõflat adverb ⤷ʤõ
select * from anc where lemma not like "%ly" and pos like "RB%"
# -s ǽõadverbial genitive ̾Ĥ⤷ʤõ
select * from anc where pos like "RB%" and word like "%s"
# ñ̾ʣ̾ token Ӥ written subcorpus spoken subcorpus ǡ[2011-06-07-1]ε#771. ̾ñʣ١פȡ
select pos, sum(freq) from written where pos in ("NN", "NNS") group by pos
select pos, sum(freq) from spoken where pos in ("NN", "NNS") group by pos
select pos, sum(freq) from anc where pos in ("NN", "NNS") group by pos
ANC ͭȴ褵줿 OANC (Open American National Corpus) ̵ANC ڤ OANC ˤĤƤϡ#708. Frequency Sorter CGI ([2011-04-05-1]) #509. Dracula ˸ whilst (2) ([2010-09-18-1]) ȡ
"BNC Frequency Extractor" "ANC Frequency Extractor" Ȥ߹碌ƻȤСäαƺˤĤ٤δñĴǤ롥
Adam Kilgarriff Ƥ BNC database and word frequency lists 顤Ф첽Ƥʤɽ (unlemmatised lists) ɤǤ褦˥ǡ١館
# եƥȤǡƺȤ "diarrhoea" vs. "diarrhea" ֻ٤ǧ
select * from written where word like "diarrh%"
# s ǻϤޤʬι⤤
select * from variances where word like "s%" order by variance desc limit 100
# 첻Ѱۤʣñ١cf. #708. Frequency Sorter CGI([2011-04-05-1]) Ǥ lemma ä
select * from bnc where word in ("foot", "goose", "louse", "man", "mouse", "tooth", "woman") and pos = "nn1" order by freq desc
# 첻Ѱۤʣ
select * from bnc where word in ("feet", "geese", "lice", "men", "mice", "teeth", "women") and pos = "nn2"
# POSǤޤȤ٤ι⤤ˡä 'demog'
select pos, sum(freq) from demog group by pos order by sum(freq) desc
# Ǥ¿Ȥ̾
select * from variances where pos like "n%" order by variance desc limit 100
# Ǥ¿Ȥƻ
select * from variances where pos like "aj%" order by variance desc limit 100
ʤФ첽Ƥɽ (lemmatised list) ˤĤƤϡ٤ˤ800ʾ帽롤6318̤ޤǤθФΤߤ˸ꤵƤꡤθġϡ#708. Frequency Sorter CGI ([2011-04-05-1]) ȤƼƤ롥Ϣơ#956. COCA N-Gram Search ([2011-12-09-1]) ⻲ȡ
Powered by WinChalow1.0rc4 based on chalow