平假名

日语表音文字之一,用于书写助词、动词词尾和日语固有词汇。

平假名是日语固有的表音文字,由 46 个基本字母 (清音) 加上浊音、半浊音和拗音构成的体系组成。它是从汉字的草书体发展而来的文字,字形柔和圆润是其特征。平安时代主要由女性使用,因此也被称为"女手 (おんなで)",紫式部的《源氏物语》和清少纳言的《枕草子》也是以假名为主体的文体写成的。

在日语文章中,平假名用于书写助词 (は、が、を、に)、动词和形容词的活用词尾 (する、できる、美しい)、连词 (しかし、また)、副词 (とても、すぐに) 等。还有一种把本可以用汉字书写的词特意改用平假名表记的技法,称为"ひらく (开假名)",例如将"事"写成"こと"、"出来る"写成"できる",可以提高文章的易读性。汉字接连排列的地方改用假名后,视觉上的压迫感会减轻,因此编辑现场会一边观察汉字与假名的比例一边进行调整。

在 Unicode 中,平假名配置在 U+3040 到 U+309F 的范围。除基本的 46 个字符外,还包括小书假名 (ぁ、ぃ、ぅ) 和历史假名 (ゐ、ゑ) 等。在编程中,可以用正则表达式 /[\u3040-\u309F]/ 判定平假名,用于输入验证和字符种类的分类。不过,只用这个范围来判定会出现遗漏。"あー"这样的长音符 ー 是 U+30FC,属于片假名区块,因此不会匹配上面的正则表达式。区块开头的 U+3040 是未分配码位,而单独表示浊点、半浊点的 U+309B 和 U+309C 是"片假名平假名共用"的记号。在平假名输入框的验证中,实务上的顺序是先决定是否允许长音符和小书假名,然后再编写范围。与片假名的相互转换可以通过将 Unicode 码位偏移 96 (0x60) 来实现,但如果一律套用,同样会在长音符上崩坏。ー (U+30FC) 减去 96 会变成半浊点 ゜ (U+309C),字符串会静默损坏。ヵ ヶ ヽ ヾ 有对应的平假名 (ゕ ゖ ゝ ゞ) 所以没有问题,但编写转换函数时,需要把 ー 以及 ㇰ 这类小书片假名 (片假名语音扩展区) 排除在处理对象之外。

平假名与片假名的使用区分是日语的重要规则。平假名用于和语 (大和词) 和语法要素,片假名用于外来语和拟声拟态词。同样的"さくら",用平假名书写给人柔和的印象,用片假名写成"サクラ"则会产生外来语式的印象,或带上"托儿"的含义。这种使用区分是支撑日语表现力丰富性的要素。

一个常见的误解是把平假名认作"简单的文字"、只适合儿童。它确实是日语学习中最先学到的文字,但在商务文件和公文中,恰当地使用平假名同样不可或缺。过多使用汉字会使文章生硬难读,反之平假名过多则会给人幼稚的印象。专业写作者会有意识地控制汉字与平假名的平衡。

在字符计数中,平假名作为全角字符计为 1 个字符,在 UTF-8 中占用 3 个字节。在社交媒体的字符数限制下,平假名较多的文章比汉字较多的文章需要更多字符才能传达相同的信息量。例如"東京都"是 3 个字符,但用平假名写成"とうきょうと"就变成 6 个字符。在字符数受限的场景中,适当使用汉字可以提高信息密度。

分享这篇文章