plano/crates/common/src/tokenizer.rs

use log::trace;

#[derive(thiserror::Error, Debug, PartialEq, Eq)]
#[allow(dead_code)]
pub enum Error {
    #[error("Unknown model: {model_name}")]
    UnknownModel { model_name: String },
}

#[allow(dead_code)]
pub fn token_count(model_name: &str, text: &str) -> Result<usize, Error> {
    trace!("getting token count model={}", model_name);
    //HACK: add support for tokenizing mistral and other models
    //filed issue https://github.com/katanemo/arch/issues/222

    let updated_model = match model_name.starts_with("gpt") {
        false => {
            trace!(
                "tiktoken_rs: unsupported model: {}, using gpt-4 to compute token count",
                model_name
            );

            "gpt-4"
        }
        true => model_name,
    };

    // Consideration: is it more expensive to instantiate the BPE object every time, or to contend the singleton?
    let bpe = tiktoken_rs::get_bpe_from_model(updated_model).map_err(|_| Error::UnknownModel {
        model_name: updated_model.to_string(),
    })?;
    Ok(bpe.encode_ordinary(text).len())
}

#[cfg(test)]
mod test {
    use super::*;

    #[test]
    fn encode_ordinary() {
        let model_name = "gpt-3.5-turbo";
        let text = "How many tokens does this sentence have?";
        assert_eq!(
            8,
            token_count(model_name, text).expect("correct tokenization")
        );
    }

    #[test]
    fn unrecognized_model() {
        assert_eq!(
            2,
            token_count("unknown model", "hello world").expect("correct tokenization")
        )
    }
}
log improvements and some code refactor (#379) 2025-01-31 10:37:53 -08:00			`use log::trace;`
Add Ratelimit on request tokens (#44) Signed-off-by: José Ulises Niño Rivera <junr03@users.noreply.github.com> 2024-09-04 17:28:12 -07:00
Add support for streaming and fixes few issues (see description) (#202) 2024-10-28 20:05:06 -04:00			`#[derive(thiserror::Error, Debug, PartialEq, Eq)]`
Add Ratelimit on request tokens (#44) Signed-off-by: José Ulises Niño Rivera <junr03@users.noreply.github.com> 2024-09-04 17:28:12 -07:00			`#[allow(dead_code)]`
			`pub enum Error {`
Add support for streaming and fixes few issues (see description) (#202) 2024-10-28 20:05:06 -04:00			`#[error("Unknown model: {model_name}")]`
			`UnknownModel { model_name: String },`
Add Ratelimit on request tokens (#44) Signed-off-by: José Ulises Niño Rivera <junr03@users.noreply.github.com> 2024-09-04 17:28:12 -07:00			`}`

			`#[allow(dead_code)]`
			`pub fn token_count(model_name: &str, text: &str) -> Result<usize, Error> {`
log improvements and some code refactor (#379) 2025-01-31 10:37:53 -08:00			`trace!("getting token count model={}", model_name);`
use passed in model name in chat completion request 2025-03-21 14:46:45 -07:00			`//HACK: add support for tokenizing mistral and other models`
			`//filed issue https://github.com/katanemo/arch/issues/222`

			`let updated_model = match model_name.starts_with("gpt") {`
			`false => {`
			`trace!(`
			`"tiktoken_rs: unsupported model: {}, using gpt-4 to compute token count",`
			`model_name`
			`);`

			`"gpt-4"`
			`}`
			`true => model_name,`
			`};`

Add Ratelimit on request tokens (#44) Signed-off-by: José Ulises Niño Rivera <junr03@users.noreply.github.com> 2024-09-04 17:28:12 -07:00			`// Consideration: is it more expensive to instantiate the BPE object every time, or to contend the singleton?`
use passed in model name in chat completion request 2025-03-21 14:46:45 -07:00			`let bpe = tiktoken_rs::get_bpe_from_model(updated_model).map_err(\|_\| Error::UnknownModel {`
			`model_name: updated_model.to_string(),`
Add support for streaming and fixes few issues (see description) (#202) 2024-10-28 20:05:06 -04:00			`})?;`
Add Ratelimit on request tokens (#44) Signed-off-by: José Ulises Niño Rivera <junr03@users.noreply.github.com> 2024-09-04 17:28:12 -07:00			`Ok(bpe.encode_ordinary(text).len())`
			`}`

			`#[cfg(test)]`
			`mod test {`
			`use super::*;`

			`#[test]`
			`fn encode_ordinary() {`
			`let model_name = "gpt-3.5-turbo";`
			`let text = "How many tokens does this sentence have?";`
			`assert_eq!(`
			`8,`
			`token_count(model_name, text).expect("correct tokenization")`
			`);`
			`}`

			`#[test]`
			`fn unrecognized_model() {`
			`assert_eq!(`
use passed in model name in chat completion request 2025-03-21 14:46:45 -07:00			`2,`
			`token_count("unknown model", "hello world").expect("correct tokenization")`
Add Ratelimit on request tokens (#44) Signed-off-by: José Ulises Niño Rivera <junr03@users.noreply.github.com> 2024-09-04 17:28:12 -07:00			`)`
			`}`
			`}`