Metin Araçları rehberi
XGM Metin Araçları kelime, karakter, satır ve baytı nasıl sayar, yazım biçimi ile slug nasıl üretilir, emoji ve aksanlar sayıları neden değiştirir.
Sayaç neleri ölçer
| Sayım | Nasıl |
|---|---|
| Karakterler | Tarayıcının metin bölümlemesiyle, kullanıcının gördüğü karakterler (grafem kümeleri) |
| Boşluksuz karakterler | Boşluk karakterleri dışındaki kod noktaları |
| Kelimeler | Boşluklarla ayrılmış diziler |
| Cümleler | ., !, ? ya da … ile biten metinler, ayrıca sonda kalan bitmemiş cümle |
| Satırlar | Satır sonlarıyla ayrılanlar |
| Paragraflar | Boş satırlarla ayrılan bloklar |
| Baytlar | Metnin UTF-8 olarak kodlanmış boyutu |
| Okuma süresi | Kelime sayısının dakikada 230 kelimeye bölümü |
Metin nasıl sayılır
- Metin Araçları aracını açın ve metninizi yapıştırın ya da yazın.
- Sayımları okuyun; siz yazdıkça güncellenirler.
- İlgili sayıyı, uymanız gereken sınırla karşılaştırın; örneğin bir meta açıklama uzunluğu ya da bir form alanı sınırıyla.
- Düzenleme yapın ve sayıların değişmesini izleyin.
Sayım tarayıcınızda yapılır; bu yüzden taslaklarınız, mesajlarınız ve belgeleriniz cihazınızda kalır. Metin hiçbir aşamada XGM sunucusuna gönderilmez, bu da henüz yayımlanmamış yazılar ya da gizli sözleşme metinleri üzerinde rahatça çalışabileceğiniz anlamına gelir. Sayfayı kapattığınızda yazdığınız her şey kaybolur, çünkü hiçbir yere kaydedilmez.
Yazım biçimini değiştirmek ve slug üretmek
Metin Araçları'nın iki kipi daha vardır. Yazım biçimini değiştir kipi girdiyi yaygın tüm biçimlerde aynı anda gösterir: camelCase, PascalCase, snake_case, CONSTANT_CASE, kebab-case, Title Case, sentence case, küçük harf ve büyük harf. Kelimeler boşluklarda, alt çizgilerde, tirelerde ve küçük harften büyük harfe geçişte ayrılır; HTTPServer gibi peş peşe gelen büyük harf dizileri tek kelime olarak birlikte kalır. Bu kip, aynı adı kodda, veritabanı sütununda ve arayüz metninde kullanırken elle yapılan yazım hatalarını ortadan kaldırır.
Slug kipi her satırı bir URL yol parçasına dönüştürür: aksanlar çevriyazıya uğrar (é yerine e, ß yerine ss gelir), & işareti and olur ve harf ya da rakam olmayan diğer her şey ayırıcıya dönüşür. Ayırıcı olarak tire veya alt çizgi seçebilir, bir de azami uzunluk belirtebilirsiniz; kesme işlemi kelimenin ortasında değil, bir ayırıcıda yapılır. Aksanlı harf içeren başlıklar da aynı kurala tabidir, böylece bağlantı her sistemde okunabilir ve paylaşılabilir kalır.
How to Fix DMARC p=none in 30 Days
how-to-fix-dmarc-p-none-in-30-daysEmoji, aksanlar ve uzunlukların neden farklı olduğu
Metin sayılar olarak saklanır ve bu sayıları saymanın birden çok yolu vardır. é gibi bir harf tek kod noktası olabileceği gibi iki kod noktası da olabilir (bir e ve ardından gelen birleştirici aksan); ikisi de ekranda birebir aynı görünür. Bayraklar ve aile grupları gibi emojiler ise birden fazla kod noktasını tek bir görünür simgede birleştirir. Bu yüzden "uzunluk" sorusunun tek bir doğru yanıtı yoktur; yanıt, sayanın hangi birimi kullandığına bağlıdır.
| Metin | Görünen karakter | JavaScript uzunluğu (UTF-16) | UTF-8 baytları |
|---|---|---|---|
hello | 5 | 5 | 5 |
café | 4 | 4 | 5 |
👍 | 1 | 2 | 4 |
🇷🇴 (bayrak) | 1 | 4 | 8 |
Bir form "en fazla 280 karakter" dediğinde, arkasındaki sistem görünür karakterleri, kod noktalarını, UTF-16 birimlerini ya da baytları sayıyor olabilir. Emoji içeren bir metin, sayaç sınırın içinde gösterdiği halde reddediliyorsa, hizmet büyük olasılıkla başka bir şey sayıyordur. Bayt sayısı, veritabanı sütunları ve yük boyutunu sınırlayan API'ler için kullanışlıdır. Şüpheye düştüğünüzde emojiyi çıkarıp yeniden deneyin; metin aniden kabul ediliyorsa sayım birimi bayt ya da kod birimidir.
const text = "🇷🇴 café";
text.length; // UTF-16 code units
[...text].length; // code points
[...new Intl.Segmenter().segment(text)].length; // visible characters
new TextEncoder().encode(text).length; // UTF-8 bytesYaygın uzunluk sınırları
| Nerede | Tipik öneri veya sınır | Ölçü birimi |
|---|---|---|
| Sayfa başlığı (arama sonuçları) | Yaklaşık 50-60 karakter | Görüntüleme genişliği; karakter sayısı yol gösterici |
| Meta açıklama | Yaklaşık 120-160 karakter | Görüntüleme genişliği; karakter sayısı yol gösterici |
| SMS | GSM 7 bit alfabesinde 160 karakter, Unicode karakterlerle 70 | Kodlamaya bağlı birimler |
| DNS TXT dizesi | Dize başına 255 bayt | Bayt |
Veritabanında VARCHAR(n) | Veritabanına bağlı: bazılarında karakter, bazılarında bayt | Belgelere bakın |
SEO etiketleri için meta etiketi oluşturucusu uzunluklar hakkında doğrudan uyarı verir. SMS tarafında tek bir emoji bütün mesajı Unicode kodlamasına geçirir ve mesaj başına sınırı 160 karakterden 70 karaktere düşürür; bu, birçok göndereni şaşırtır. Aynı durum temel GSM alfabesinin dışında kalan Türkçe harfler için de geçerli olabilir. Sınırı aşan metin birden fazla parçaya bölünerek gönderilir ve her parça ayrı ücretlendirilir.
Bir sınıra göre yazmak
Sayım en çok yazarken işe yarar, sonrasında değil. Taslağı yapıştırın, sınırın ne kadar üstünde olduğunuzu görün ve tek tek harfler yerine bütün ifadeleri çıkarın: dolgu kelimelerini ve tekrarlanan düşünceleri atmak metni hem daha hızlı kısaltır hem de iyileştirir. Düzenleme yaptıkça karakter sayısının güncellenmesini izleyin. Hedefin biraz altında kalmak iyi bir alışkanlıktır, çünkü başlıklara sonradan marka adı ya da ayırıcı eklenebilir.
- En önemli bilgiyle başlayın; sınırlar çoğu zaman sondan keser.
- Uzun ifadelerin yerine kısalarını koyun: "yapabilmek amacıyla" yerine "için", "şu an itibarıyla" yerine "şimdi".
- Gerçekten anlam katmadıkça SMS'te ve bayt sınırı olan sistemlerde emoji kullanmayın.
- Çeviriler için yer bırakın: aynı mesaj Almancada ya da Romencede çoğu zaman İngilizcedekinden uzundur.
- Bildirim önizlemeleri gibi sabit sayıda satırla gösterilen alanlarda satır sayısını da kontrol edin.
Kod ve veri söz konusu olduğunda izlenmesi gereken sayı bayt sayısıdır. JSON yüklerinin, HTTP başlıklarının ve DNS kayıtlarının boyut sınırları bayt cinsindendir; kısa görünen bir dize, ASCII dışındaki karakterler UTF-8 olarak kodlandığında bu sınırları aşabilir. Türkçe ya da Romence metinlerde aksanlı harfler karakter başına iki bayt tuttuğu için fark hızla büyür.
Görünmeyen karakterler
Belgelerden, web sayfalarından ya da sohbet uygulamalarından kopyalanan metin, göremediğiniz karakterler içerebilir: bölünmez boşluklar, sıfır genişlikli boşluklar, yumuşak tireler ya da yön işaretleri. Bunlar karakter ve bayt olarak sayılır, kelime sayımını bozabilir, formlarda ve kodda doğrulama hatalarına yol açabilir. Sayacın verdiği sayılarla beklentiniz arasındaki fark çoğu zaman bunların ilk işaretidir. Özellikle PDF belgelerinden ve tablo hücrelerinden yapılan yapıştırmalar bu karakterleri sıkça taşır.
Bir sayım yanlış görünüyorsa şüphelendiğiniz bölümü yeniden yazın ya da metni önce düz metin düzenleyicisine yapıştırın. Geliştiriciler bu tür karakterleri Regex Test Aracı içinde [\u00A0\u200B-\u200F\u2060\uFEFF] gibi bir düzenli ifadeyle bulabilir. Aynı ifadeyi bir derleme öncesi denetime koymak, sorunun yayına çıkmasını baştan engeller.
Okuma süresi ve kelime sayıları
Okuma süresi, genel metnin sessiz okunması için dakikada ortalama 230 kelime varsayar. Teknik içerik, kod ve ikinci dilde yazılmış metin daha yavaş okunur; bu yüzden tahmini, https://xgm.ro/guides adresindekine benzer rehberler için bir alt sınır, blog yazıları ve makaleler için makul bir değer olarak kabul edin. Sayfada kod blokları ya da tablolar varsa gerçek süre belirgin biçimde uzar.
Kelime sayımı boşluklara göre yapılır. Çince ya da Japonca gibi kelimeleri boşlukla ayırmayan diller bu yöntemle anlamlı biçimde sayılamaz; tireli kelimeler veya arasında boşluk bulunan sayılar da aracın ayırdığı gibi sayılır. Sözleşme veya yayıncılık şartları söz konusuysa, karşı tarafın hangi sayım yöntemini kullandığını, örneğin belirli bir kelime işlemcininkini, önceden doğrulayın. Aynı metin için iki araç arasında yüzde birkaçlık fark çıkması olağandır.
Diğer metin araçları sayaçla birlikte iyi çalışır: yazım biçimi kipi büyük küçük harf düzenini değiştirir, slug kipi ise bir başlığı example.com/blog/my-first-post gibi URL dostu bir yola dönüştürür. Üç kip de aynı sayfada yer aldığı için metni bir kez yapıştırıp aralarında geçiş yapabilirsiniz.
SSS
Sayaç boşlukları dahil ediyor mu?
İkisini de gösterir: boşluklarla birlikte karakter sayısı ve boşluksuz karakter sayısı.
Bir emoji neden tek karakter sayılıyor?
Sayaç karakterleri insanların gördüğü gibi sayar. Aynı emoji JavaScript'te 2 veya daha fazla birim, UTF-8'de 4 veya daha fazla bayt olabilir.
Aynı sayıda karaktere izin veren bir form için metnim neden çok uzun?
Hizmet baytları ya da UTF-16 kod birimlerini sayıyor olabilir. Emojiler ve aksanlı harfler bunlardan göründüğünden fazlasını kullanır.
Okuma süresi nasıl hesaplanır?
Kelime sayısının dakikada 230 kelimeye bölünmesiyle; bu, sessiz okuma için yaygın bir ortalamadır.
Cümleler nasıl tespit edilir?
Cümle sonu noktalama işaretlerine göre: nokta, ünlem işareti, soru işareti ve üç nokta. Nokta içeren kısaltmalar cümle sonu olarak sayılabilir.
Metnim bir yere yükleniyor mu?
Hayır. Tüm sayım tarayıcınızda yapılır.
Paragraf olarak ne sayılır?
En az bir boş satırla ayrılmış metin.
Bayt sayısı neden önemli?
Veritabanları, API'ler ve protokoller boyutu çoğu zaman bayt cinsinden sınırlar. UTF-8, ASCII için bir bayt, diğer karakterler için dört bayta kadar kullanır.
İki kelime sayacı neden farklı sayılar veriyor?
Kelimeleri farklı ayırırlar: yalnızca boşluklarda ya da ayrıca tirelerde, eğik çizgilerde ve noktalama işaretlerinde. Sayılar, URL'ler ve kısaltmalar anlaşmazlığın olağan kaynaklarıdır.
Satır sonu karakter olarak sayılır mı?
Satır sonu metnin içinde bir karakterdir, bu yüzden boşluklarla birlikte karakter sayısında ve bayt sayısında görünür. Boşluksuz sayımın dışında bırakılır.
Boşluk kullanmayan dillerde çalışır mı?
Karakter, satır ve bayt sayıları her dil için çalışır. Kelime sayımı boşluklara dayandığı için Çince ya da Japonca gibi dillerde anlamlı değildir.