@basetenlabs/client - v0.2.0
Preparing search index...
modelconfig
TRTLLMRuntimeConfigurationV2
Interface TRTLLMRuntimeConfigurationV2
interface
TRTLLMRuntimeConfigurationV2
{
enable_chunked_prefill
?:
boolean
;
max_batch_size
?:
number
;
max_num_tokens
?:
number
;
max_seq_len
?:
number
|
null
;
patch_kwargs
?:
{
[
k
:
string
]:
|
string
|
number
|
unknown
[]
|
{
[
k
:
string
]:
unknown
}
|
null
;
}
;
served_model_name
?:
string
|
null
;
tensor_parallel_size
?:
number
;
[
k
:
string
]:
unknown
;
}
Indexable
[
k
:
string
]:
unknown
Index
Properties
enable_
chunked_
prefill?
max_
batch_
size?
max_
num_
tokens?
max_
seq_
len?
patch_
kwargs?
served_
model_
name?
tensor_
parallel_
size?
Properties
Optional
enable_
chunked_
prefill
enable_chunked_prefill
?:
boolean
Optional
max_
batch_
size
max_batch_size
?:
number
Optional
max_
num_
tokens
max_num_tokens
?:
number
Optional
max_
seq_
len
max_seq_len
?:
number
|
null
Optional
patch_
kwargs
patch_kwargs
?:
{
[
k
:
string
]:
|
string
|
number
|
unknown
[]
|
{
[
k
:
string
]:
unknown
}
|
null
;
}
Optional
served_
model_
name
served_model_name
?:
string
|
null
Optional
tensor_
parallel_
size
tensor_parallel_size
?:
number
Settings
Member Visibility
Protected
Inherited
External
Theme
OS
Light
Dark
On This Page
Properties
enable_
chunked_
prefill
max_
batch_
size
max_
num_
tokens
max_
seq_
len
patch_
kwargs
served_
model_
name
tensor_
parallel_
size
@basetenlabs/client - v0.2.0
Loading...