Fix LLM gateway path, update M1.8 gate test to load real chunks (Option B)
This commit is contained in:
@@ -115,7 +115,7 @@ impl ChatClient {
|
||||
|
||||
/// Complete a prompt.
|
||||
pub async fn complete(&self, system: &str, user: &str, max_tokens: u32) -> Result<Completion> {
|
||||
let url = format!("{}/qwen/chat/completions", self.base_url);
|
||||
let url = format!("{}/chat/completions", self.base_url);
|
||||
|
||||
let request = CompletionRequest {
|
||||
model: self.model.clone(),
|
||||
|
||||
Reference in New Issue
Block a user