SMS

Cos'è un segmento SMS e perché un messaggio ne ha costati tre?

Un segmento SMS è una parte fatturabile di un testo SMS, quindi tre parti comportano tre unità di addebito.

Un telefono può mostrare un testo lungo come un unico messaggio anche quando la rete trasporta più parti. L'alfabeto usato per codificare il testo determina quante parti Bird addebita.

Cos'è un segmento?

Un segmento è il pezzo di testo più grande che un singolo messaggio di rete può trasportare. Il testo latino semplice occupa 160 caratteri in un segmento. Se il messaggio contiene anche un solo carattere fuori da quell'insieme, come un'emoji, una virgoletta tipografica o la maggior parte delle lettere accentate, ogni segmento contiene invece 70 caratteri.

Quando un messaggio richiede più di un segmento, ogni parte cede un po' di spazio a un'intestazione che il telefono usa per riassemblarle: 153 caratteri per parte nel testo semplice, 67 per l'insieme più ampio. Quindi 161 lettere semplici costano due segmenti: 153 nel primo e otto nel secondo.

Bird conta il testo semplice nell'alfabeto GSM-7 e tutto il resto come UCS-2, le due codifiche accettate dagli operatori. Alcuni caratteri contano doppio anche all'interno di GSM-7, e alcune emoji contano doppio in UCS-2; la pagina sulla codifica li elenca.

Perché un messaggio ne ha costati tre?

Bird addebita in base al numero di segmenti, quindi un messaggio da tre segmenti comporta tre unità alla tariffa applicabile.

Bird calcola il conteggio al momento dell'accettazione dell'invio. Anche la destinazione, la categoria del messaggio e il tipo di mittente determinano il prezzo applicabile. Consulta i prezzi SMS per la rotta che utilizzi.

Per esempio, 150 lettere latine normali occupano un segmento. Aggiungi un'emoji con faccina sorridente e l'intero corpo usa UCS-2. Quell'emoji conta doppio, portando il totale a 152. Dividendo 152 per la capacità multipart di 67 si ottengono tre segmenti.

Quali caratteri cambiano la codifica?

Qualsiasi carattere fuori da GSM-7 sposta l'intero corpo in UCS-2.

Le virgolette dritte rientrano in GSM-7. Le virgolette tipografiche no. Le lettere é e ü rientrano. Le lettere á, í e ú no. Anche il testo in cinese, giapponese, coreano, arabo, thai e hindi richiede la codifica più ampia.

Un nome o il titolo di un prodotto inserito in un template può quindi cambiare la codifica dell'intero messaggio. Verifica il testo completo dopo aver inserito quei valori.

Perché il conteggio dei caratteri dà un risultato diverso?

Alcuni caratteri contano doppio ai fini del limite del segmento.

GSM-7 conta ciascuno tra , [, ], {, }, \, ~, ^ e | come due caratteri. Anche il carattere form feed, che richiede un'interruzione di pagina, conta doppio. Ottanta simboli dell'euro riempiono quindi un segmento.

Un corpo di 159 lettere latine normali seguito da ha 160 caratteri. Ai fini del limite ne conta 161. Richiede due segmenti.

Alcune emoji, come 😀, contano doppio in UCS-2. Trentacinque di queste riempiono un segmento. La pagina sulla codifica elenca i caratteri che richiedono attenzione speciale.

Come verifico il conteggio in Bird?

Leggi il conteggio calcolato dall'oggetto segments nella risposta del messaggio.

  • count è un intero di almeno 1. Ogni segmento conteggiato è un'unità fatturabile. I messaggi in uscita hanno un limite massimo di 12. Un corpo più lungo riceve HTTP 422, rifiutando la richiesta senza troncare il testo.
  • encoding è GSM_7BIT o UCS2, e identifica quale capacità si applica.
  • characters conta i caratteri nel testo prima di applicare le regole del conteggio doppio. Usa count per controllare i segmenti fatturabili.

Per un messaggio che deve rientrare in un segmento, controlla count dopo aver preparato il corpo completo. Includi i nomi inseriti e conta doppio caratteri come 😀.

Puoi anche impostare options.smart_encoding su true o false. Il valore predefinito è false. Quando abilitato, sostituisce la punteggiatura supportata solo se l'intero risultato rientra in GSM-7. Un'emoji rimasta nel corpo impedisce tutte le sostituzioni. Smart encoding spiega questo comportamento.

La guida ai limiti dei caratteri documenta le regole di conteggio e i campi della risposta.

In breve

  1. Ogni segmento è un'unità fatturabile.

    Un messaggio suddiviso in tre segmenti viene addebitato come tre unità alla tariffa applicabile.

  2. La codifica determina la capacità.

    Un solo carattere fuori dall'alfabeto compatto SMS sposta l'intero corpo nella codifica Unicode.

  3. Alcuni caratteri contano doppio.

    Il simbolo dell'euro conta come due caratteri ai fini del limite. Anche alcune emoji contano doppio.

  4. Ogni segmento multipart riserva spazio per l'intestazione.

    La suddivisione riduce la capacità di ogni parte, compresa la prima.

Costruisci sulla stessa rete.

Una chiave API di test è subito tua. L'accesso alla produzione si sblocca quando aggiungi un metodo di pagamento e verifichi un mittente.

La tua prossima idea.
Pronta a partire.