2011-07-20, 11:20
  #1
Medlem
Följande har jag funderat på ett tag. Hur kan det komma sig att vissa bokstäver (här menar jag grafem) har diakritiska tecken av olika slag medan andra aldrig har det? Jag har gjort en sammanställning av de diakritförsedda bokstäverna med hjälp av Windowsprogrammet Teckenuppsättning:

Ù Ú Û Ǔ Ü Ũ Ū Ŭ Ů Ű Ų Ǖ Ǘ Ǚ Ǜ Ư
À Á Â Ã Ä Å Ā Ă Ǎ Ą
Ì Í Î Ï Ī Ĭ Į İ Ĩ Ǐ
Ē Ĕ Ė Ę Ě È É Ê Ë
Ò Ó Ô Õ Ö Ơ Ǒ Ő Ǒ
Ĺ Ļ Ľ Ŀ Ł
Ć Ĉ Ċ Č Ç
Ĝ Ğ Ġ Ģ
Ŝ Ş Š Ś
Ţ Ť Ŧ
Ź Ż Ž
Ŷ Ý Ÿ
Ĥ Ħ
Ď Đ
Ř Ŗ
Ń Ň
Ĵ
Ķ
Ŵ

(för att se tecknen tydligare, kopiera in detta i t.ex. ett Worddokument och öka teckenstorleken)

Av någon anledning leder U stort. Diakriter är vanligast hos vokaler och ovanligare hos konsonanter. Men det jag noterar är att diakriter helt saknas för B, F, P och V. Varför? Jag har inte heller sett dessa tecken försedda med diakriter i något annat sammanhang (finfonetisk notation bortser vi ifrån här).

Vid närmare granskning framträder ett mönster: alla dessa konsonanter råkar vara labiala i någon mening, antingen bilabiala (B, P) eller labiodentala (V, F). Vad beror detta på?
__________________
Senast redigerad av In-Fredel 2011-07-20 kl. 12:04.
Citera
2011-07-20, 13:43
  #2
Medlem
egon2bs avatar
Citat:
Ursprungligen postat av In-Fredel
Följande har jag funderat på ett tag. Hur kan det komma sig att vissa bokstäver (här menar jag grafem) har diakritiska tecken av olika slag medan andra aldrig har det? Jag har gjort en sammanställning av de diakritförsedda bokstäverna med hjälp av Windowsprogrammet ...
(för att se tecknen tydligare, kopiera in detta i t.ex. ett Worddokument och öka teckenstorleken) ...
Det finns ytterligare ett skäl att analysera detta via Word. Om man målar ett mystiskt grafem och gör Infoga/Symbol i Word så får man Unicode-namnet och 16-bitars-koden. Ta till exempel det maltesiska H:et (Ħ) med namnet "latin capital letter H with stroke" och Ư med namnet "latin capital U with horn".¹ Unicode har också tecknet "latin capital U with hook" men Word tycks blanda ihop dom två senare. (Min Word-version är snart ett decennium gammal.) I tveksamma fall gäller Unicode.

Har In-Fredel surfat i Unicode-standarden som är världens state-of-the-art vad gäller grafem? Frågan om snedfördelning kan komma i ett annat ljus om man lämnar Microsofts horisont.

http://www.unicode.org/charts/ (skriv in 0187 resp 01AF exempelvis)
http://en.wikipedia.org/wiki/Maltese_alphabet

Det är en uttalad policy av Unicode att grafem inte skall vara explicit bundna till ett visst språk. Tyska, ungerska, turkiska och svenska ö/Ö är samma grafem. Detta har hittills visat sig vara ett bra beslut av Unicode. Samtidigt finns det en stark korrelation mellan kodsidor och språk som arabiska. Runorna på 16A0 ff är väl ett gränsfall.

I praktiken har förstås enskilda länder tagit initiativ för att få sina språk stödda vad gäller grafem i operativsystem och ordbehandlare. ISO hade ett parallellprojekt till Unicode, och den konvergerade med Unicode. I slutremissen lämnade ISO över till Unicode-consortiet. IPA stöds av Unicode men implementationerna förefaller ojämna i exempelvis Windows och Word (i 2003 års upplagor).

Ref. http://en.wikipedia.org/wiki/ISO_10646

Då och då påminner jag om att Island gjorde ett tappert jobb med att få utökningen av 7-bits ASCII till 8-bits ISO Latin1 att täcka þÞðÐ. Fransmännen »glömde« äska utrymme där för ligaturen œŒ i 8-bitskoden. Att spida förklaringen skulle bara spä på fördomarna mot grodätare och deras eftermiddagsvanor. Så småningom fixade Microsoft in œŒ‰ och ett par tjeckiska grafem i en gråzon.

I själva verket gjordes det viktiga arbetet med 8-bits ISO Latin 1 av företaget Digital Equipment Corporation, som hade duktiga tekniker men otillräcklig kommersiell drivkraft. Xerox och Apple gjorde fina jobb på vägen mot Unicode. Det stora blå bolaget har skämt ut sig genom att släpa på gammalt skräp som "national code pages" in i dessa dagar.

¹ Annars är frasen "horny U" företrädesvis avsett för användning i dualis inom familjen.
__________________
Senast redigerad av egon2b 2011-07-20 kl. 13:48.
Citera
2011-07-20, 16:42
  #3
Medlem
Citat:
Ursprungligen postat av egon2b
Har In-Fredel surfat i Unicode-standarden som är världens state-of-the-art vad gäller grafem? Frågan om snedfördelning kan komma i ett annat ljus om man lämnar Microsofts horisont.
Tack för en viktig synpunkt och ett intressant webbsidetips. Jag har tittat igenom Latin Extended-A–D där det finns enstaka exempel på <b>, <p> och <v> med diakriter, men det är nästan bara förlängningar eller krokar på bokstäverna, fortfarande inga "lösa" diakriter som grava eller akuta accenter exempelvis. Först i Latin Extended Additional hittar jag <p> med akut accent. <v> har endast tilde och prick under. Det finns inte alltid uppgifter om i vilka språk dessa används, och oftast är det bara tecken som används vid translitterering av icke-romanska skriftsystem.

Jag kom för övrigt också på att <m> aldrig har diakriter i "vanliga" teckenuppsättningar, så att säga i skriftsystem som är baserade på det latinska alfabetet och som är någorlunda etablerade och alltså inte bara någon vetenskaplig skrivbordsskapelse för specialändamål. Lustigt nog är även /m/ ett bilabialt ljud.

Den lista som jag sammanställde i mitt första inlägg baseras vad jag kan se på diakritiska tecken som används i olika europeiska språk. Jag nöjer mig därför med att konstatera att inga tecken för <b f m p v> har diakriter här och frågar mig vad det beror på. Finns det helt enkelt inget behov av att förändra eller markera nyanser hos ljud ljuden /b f m p v/ på samma sätt som att det förekommer en uppsjö av olika diakritförsedda <s> eller <c> för att markera olika sje-ljud i europeiska språk?
__________________
Senast redigerad av In-Fredel 2011-07-20 kl. 16:47.
Citera
2011-07-20, 18:16
  #4
Medlem
Kryžininkass avatar
Citat:
Ursprungligen postat av In-Fredel
Jag kom för övrigt också på att <m> aldrig har diakriter i "vanliga" teckenuppsättningar, så att säga i skriftsystem som är baserade på det latinska alfabetet och som är någorlunda etablerade och alltså inte bara någon vetenskaplig skrivbordsskapelse för specialändamål. Lustigt nog är även /m/ ett bilabialt ljud.

Ett gränsfall är väl litauiskans accenttecken, som visserligen inte skrivs ut i vanlig text men som har sin givna plats i ordböcker och andra metaspråkliga sammanhang. Och de har ju en etablerad ortografi på ett helt annat sätt än om man vill ange accenttyp och -placering i t.ex. svenska. Man kanske snarare kan jämföra dem med de semitiska abjaderna som har vokaltecken som kan användas vid behov.

En i någon mening "vanlig" teckenuppsättning är också den man oftast skriver forniriska med. Där har pricken över <f>, <s>, <n> och <m> följt med från handskriftstiden* till den postgutenbergska tiden.

*ndskr och ftst – stackars invandrare med konsonantklusterförbud i sina modersmål.
Citera
2011-07-20, 19:01
  #5
Medlem
Citat:
Ursprungligen postat av Kryžininkas
Ett gränsfall är väl litauiskans accenttecken, som visserligen inte skrivs ut i vanlig text men som har sin givna plats i ordböcker och andra metaspråkliga sammanhang. Och de har ju en etablerad ortografi på ett helt annat sätt än om man vill ange accenttyp och -placering i t.ex. svenska. Man kanske snarare kan jämföra dem med de semitiska abjaderna som har vokaltecken som kan användas vid behov.
Mina litauiskkunskaper är mycket begränsade, men vad jag kan se på Wikipedia används diakriterna med de vanliga vokalerna och konsonanterna, de som ingår i min lista ovan. Alfabetet ger i mina ögon ett normalösteuropeiskt intryck.

(Är Kryžininkas för övrigt ett litauiskt ord/namn, med caron och allt?)

Citat:
Ursprungligen postat av Kryžininkas
En i någon mening "vanlig" teckenuppsättning är också den man oftast skriver forniriska med. Där har pricken över <f>, <s>, <n> och <m> följt med från handskriftstiden* till den postgutenbergska tiden.
Detta måste ett av få exempel på språk där <f> och <m> diakritiseras på ett relativt naturligt sätt, dvs. för annat bruk än vid translitterering.

*

Wikipedia har rätt utförliga listor i artiklarna för de vanliga diakritiska tecknen, alltså akut och grav accent, punkt, caron, cirkumflex etc. Den enda diakriten som <f> och <v> har där är punkt. Akut accent förekommer även hos <p> och <m>. Vad är det som gör att de mest märkliga kombinationer som macron tillsammans tilde eller trema tillsammans grav accent förekommer men inte något så okomplicerat som <v> med akut accent? Det är en gåta för mig.

Jag funderar på om det finns en grafisk aspekt på det hela, t.ex. att det är svårt att placera vissa diakriter på bokstäver med långa upp- eller nedstaplar. Möjligen skulle det kunna förklara varför <f>, <p> och <b> med diakriter är sällsynta. Men å andra sidan verkar diakriter kunna användas med t.ex. <l>, <h> och <g> utan problem. Det borde absolut inte vara något problem med <v> i alla fall. Vad har dessa fem labiala konsonanter gemensamt?
__________________
Senast redigerad av In-Fredel 2011-07-20 kl. 19:04.
Citera
2011-07-20, 19:53
  #6
Medlem
Kryžininkass avatar
Citat:
Ursprungligen postat av In-Fredel
Mina litauiskkunskaper är mycket begränsade, men vad jag kan se på Wikipedia används diakriterna med de vanliga vokalerna och konsonanterna, de som ingår i min lista ovan. Alfabetet ger i mina ögon ett normalösteuropeiskt intryck.
Ja, accenttecknen ingår som sagt inte i standardortografin även om det finns en standardiserad ortografi för dem. Slår jag t.ex. upp exempel i några olika svenska ordbokböcker kan jag stöta på rätt många varianter såsom exémpel, exem´pel, exẹmpel och ex'empel, medan det på litauiska är mer självklart att man skriver krỹžininkas (för att samtidigt svara på din fråga).

(http://en.wikipedia.org/wiki/Lithuanian_language#Pitch_accent
http://en.wikipedia.org/wiki/Lithuanian_accentuation)

Citat:
Ursprungligen postat av In-Fredel
Vad har dessa fem labiala konsonanter gemensamt?
De är labiala?
Citera

Skapa ett konto eller logga in för att kommentera

Du måste vara medlem för att kunna kommentera

Skapa ett konto

Det är enkelt att registrera ett nytt konto

Bli medlem

Logga in

Har du redan ett konto? Logga in här

Logga in