Implementing support for laguna arch
This commit is contained in:
@@ -20,6 +20,7 @@ struct llama_longhaul_cache {
|
||||
bool remap(int layer, ggml_tensor * ids);
|
||||
void release(int layer);
|
||||
|
||||
uint32_t capacity() const;
|
||||
uint32_t max_ubatch(uint32_t n_expert_used) const;
|
||||
const std::string & error() const;
|
||||
bool failed() const;
|
||||
|
||||
Reference in New Issue
Block a user