初歩のシェルスクリプトで遊ぶ[Unicodeコードポイントをutf8へ変換するシェル関数] - HatenaDiary id:Narr CP932、いわゆるシフトJISのテキストファイルを、UTF8に変換します。iconvはもちろん、odコマンドも使いません。最後は先週のこれを使います。 いち…
$ printf '\U3042' あ というようなことがBashではできます。Unicodeのコードポイントを入れると、文字に変換できる、と。 似た機能はzshにはあるみたいですが、高速なdashや、busyboxでは使えませんでした。 今回つくったのは、これの代用シェル関数です。…
#!/bin/sh #!/usr/bin/busybox sh #PATH='' #set -x # ========================================================================================= # ■ 16進数の入力をバイナリに変換する # # xxd -r -pの代替品 # # 入力は16進数の偶数桁 空白またはタブ…
初歩のシェルスクリプトで遊ぶ[フィルタコマンドを繰り返し実行する『竹輪』] - HatenaDiary id:Narr 2022年のスクリプトを、Windows版のbusyboxで動作するようにしました。だいたいLinux版と同じように動きます。このスクリプトに、Virtualbox上のdebianと…
今回はシェルスクリプトではなく、コマンドの試用です。
ISBN - Wikipediaシェル関数くみました。 ISBNコードの数字を与えて、チェックディジットを計算、正しければ終了コードが0、間違っていれば終了コードが1です。
フィルタコマンドを繰り返し実行するスクリプト『竹輪』 初歩のシェルスクリプトで遊ぶ[md5チェックサムのファイル書式を変換] - HatenaDiary id:Narr 先日のスクリプトのように、標準入力からデータを受け取って、加工し、標準出力からデータを出力するよう…
Name MD5 Bytes --------------------------------------------------------------- -------------------------------- --------- omake\nukamiso-doc_beta13_changelog.txt 44bab025a725a77604ecdacea076c899 18,809 omake\nukamiso-doc_beta13_license.txt…
最初の覚え方・序盤に覚えるとお得な事柄 最初の覚え方は、説明書からズレすぎないほうがよい。 序盤に、長く使える手軽な方法を覚えておいたほうがよい。いくら汎用性があっても、そのぶん慣れと勉強が必要な手段だけに絞らないほうがよい。
繰り返し使うスクリプト部品はどうやって分離する? このあたり試行錯誤中です。来月には取り下げてるかも。
シェル変数は手書きノートをイメージする
「シェルスクリプトの勘所」っぽい内容ですが、私が今、気をつけてるポイントというだけです。私は素人なだけでなく単なる初心者で、解説記事を書く実力はありません。半年も経てば私も気が変わってる可能性は高いです。参考程度にしてください。そこまで自…
棒の先端が尖っている歪みを直す
TTEditのグリフcsvファイルをsvgファイルへ変換する
TTEdit,OTEditの制御点データをcsvファイルへ書き出す TTEditでは、画像の赤枠で囲った部分、座標の値を、csvファイルで書き出すことができます。 書き出したcsvファイルは、TTEditに読み込むこともできます。 どちらも一文字ずつならGUIでできますが、GUIで…
自信は無いけど文字リスト Release v5.2.1 · IBM/plex · GitHub IBMPlexSansJP-Regular.otf , ヒント無し版の横書きUnicode文字一覧表、のようなもの。勉強兼ねて作ったもので、よくわかりません。いろいろ注意点もありますんで、参考にするなら注意深く参考…
ダウンロードは「リンク」のそれっぽいところから。 更新 OpenTypeにPr6Nを追加 JIS90のOpenTypeをProからStdに切り替え TTEditのバージョンアップに伴いTrueType版のファイルフォーマット切り替え 古いMS明朝準拠だったのがWindows10準拠になった 作成可能…
漢字をつくる優先順位の一案 個人の趣味で日本語フォントを作るときの、漢字制作の目安を一覧にしました。優先順位っすね。一案の一覧。いや一覧の一案か。あれどっちだ。いいやどうでも。 あくまで大雑把な目安です。必要な漢字がはっきり分かってるなら、…
常用漢字の見直し カテゴリ:常用漢字 - ウィクショナリー日本語版基本的には、コピペが比較的に楽にできる資料を公開してくださってるところを見つければ終了、ではあるんですが。
三国志人名漢字の見直し フォント以外のダウンロード、のところにスクリプトを置きました。これ使って、あらためて三国志の人名漢字を探し直します。
文字種類管理シェルスクリプトで、文字コードのリストを「1」「0」のリストに変換する 簡易な文字種類を数えるシェルスクリプト『暖簾』について。 昨日は普通のテキストファイルを文字コードのリストに変換するスクリプトについて書いた。今日は文字コード…
簡易な文字種類を数えるシェルスクリプト『暖簾』 何をするスクリプトか テキストファイルを突っ込むと、使われている文字の種類をリストにする。 文字の種類ごとに、テキストファイルを比較する。 片方にだけ使われている文字は? 両方に使われている文字は…
IPA mj明朝の漢字を書き出す MJ文字情報一覧 | 一般社団法人 文字情報技術促進協議会 Creative Commons — 表示 - 継承 2.1 日本 — CC BY-SA 2.1 JPLibreOfficeで開いて、こんな感じで選択、コピーします。テキストファイルに貼り付け。 U+3005 U+3006 U+303B…
シフトJISの文字コードから文字一覧をつくる(作り直し) beta-reverse.hatenadiary.jp これの作り直し。意外と無いっすね。文字が、だーっと並んだだけ、の文字リストって。
HTMLの数値文字参照を文字に変えたり整えたり cat character.html | nkf --numchar-input --no-best-fit-chars -x 数値参照を文字に変えるなら、nkfがいいのは分かるのだけれど。
sortもuniqも効かない文字はけっこうあるような $ cat 丸数字やローマ数字.txt ⅰⅱⅲⅳⅴⅵⅶⅷⅸⅹ¬¦'"ⅰⅱⅲⅳⅴⅵⅶⅷⅸⅹⅠⅡⅢⅣⅤⅥⅦⅧⅨⅩ¬¦'" ①②③④⑤⑥⑦⑧⑨⑩⑪⑫⑬⑭⑮⑯⑰⑱⑲⑳㉑㉒㉓㉔㉕㉖㉗㉘㉙㉚ ①②③④⑤⑥⑦⑧⑨⑩⑪⑫⑬⑭⑮⑯⑰⑱⑲⑳㉑㉒㉓㉔㉕㉖㉗㉘㉙㉚ ①②③④⑤⑥⑦⑧⑨⑩⑪⑫⑬⑭⑮⑯⑰⑱⑲⑳㉑㉒㉓㉔㉕㉖㉗㉘…
VSつきの文字を抜き出す $ cat ivstest.txt ななかまど 辻󠄀 辻󠄀辻味噌󠄀味噌 $ cat ivstest.txt |./ttedit_20210327_02.sh --html ななかまど 辻󠄀 辻󠄀辻味噌󠄀味噌 という感じに、異体字セレクタつきのテキストデータを入れると、異体…
複数のUnicodeがひとつのCIDを指すとき TTEditのTrueTypeフォントを、OTEditでOpenTypeフォントに変換するとき、殆どの文字は、ひとつのunicodeの文字が、ひとつのCIDにコピーされます。一対一になってる。 a → a b → b c → cところが、複数のunicode文字が…
unicodeからのコピー先が変更された189文字を表示するテキストファイル TTEdit,OTEditで、「文字一覧」の「テキストファイルの文字を表示」から指定する、テキストファイルを作ります。ProフォントとPr6Nフォントとで、同じunicodeから違うCIDにコピーする18…
29文字をさらに分類する JIS2004で字形変更があった168文字に入っている160文字については、まぁ、今まで通り、だろうか。基本的には、経済産業省のPDFを参考にする。 JIS漢字コード表の改正について−報道発表−経済産業省残りの29文字分、これらをさらに…