Files
cursor-byok/cursor-server/tests/prefix_stability.rs
T

549 lines
16 KiB
Rust

#[path = "support/fixtures.rs"]
mod fixtures;
use std::collections::BTreeMap;
use cursor_server::{
cursor::prompting::{Mode, PromptAssets, PromptCompiler},
model::{project_messages, ProjectedContent},
model::{
CanonicalMessage, MessageContent, Origin, Role, ToolCallContent, ToolDefinition,
ToolResultContent,
},
};
use sha2::{Digest, Sha256};
#[test]
fn projecting_an_append_only_context_preserves_the_complete_prefix() {
let first = vec![fixtures::user("u1", "one")];
let mut second = first.clone();
second.push(fixtures::user("u2", "two"));
let projected_first = project_messages(&first).unwrap();
let projected_second = project_messages(&second).unwrap();
assert_eq!(projected_first, projected_second[..projected_first.len()]);
}
#[test]
fn every_tool_result_is_projected_as_string_content() {
let object = serde_json::json!({"merge": false, "todos": []});
let messages = vec![
tool_result("object", object.clone()),
tool_result("string", serde_json::Value::String("plain text".into())),
];
let projected = project_messages(&messages).unwrap();
let ProjectedContent::ToolResult(object_result) = &projected[0].content else {
panic!("expected tool result")
};
let object_text = &object_result.content;
assert_eq!(
serde_json::from_str::<serde_json::Value>(object_text).unwrap(),
object
);
let ProjectedContent::ToolResult(string_result) = &projected[1].content else {
panic!("expected tool result")
};
assert_eq!(string_result.content, "plain text");
}
#[test]
fn assistant_text_and_thinking_remain_separate_during_projection() {
let messages = vec![CanonicalMessage {
message_id: "assistant".into(),
role: Role::Assistant,
origin: Origin::Assistant,
content: MessageContent::Assistant {
text: "visible answer".into(),
thinking: "private reasoning".into(),
tool_round_id: Some("round".into()),
replay_state: None,
tool_calls: Vec::new(),
},
runtime_event_id: None,
}];
let projected = project_messages(&messages).unwrap();
let ProjectedContent::Assistant { text, thinking, .. } = &projected[0].content else {
panic!("expected assistant")
};
assert_eq!(text, "visible answer");
assert_eq!(thinking, "private reasoning");
}
#[test]
fn split_tool_pairs_reconstruct_the_original_provider_assistant_message() {
let messages = vec![
assistant_tool_pair(
"assistant-second",
"model-call",
1,
"call-second",
"visible answer",
"complete reasoning",
),
tool_result_with_call("result-second", "call-second", "second"),
assistant_tool_pair("assistant-first", "model-call", 0, "call-first", "", ""),
tool_result_with_call("result-first", "call-first", "first"),
];
let projected = project_messages(&messages).unwrap();
assert_eq!(projected.len(), 3);
assert_eq!(projected[0].role, Role::Assistant);
let ProjectedContent::Assistant {
thinking, calls, ..
} = &projected[0].content
else {
panic!("expected assistant")
};
assert_eq!(thinking, "complete reasoning");
assert_eq!(calls[0].call_id, "call-first");
assert_eq!(calls[1].call_id, "call-second");
let ProjectedContent::ToolResult(second) = &projected[1].content else {
panic!("expected tool result")
};
let ProjectedContent::ToolResult(first) = &projected[2].content else {
panic!("expected tool result")
};
assert_eq!(second.call_id, "call-second");
assert_eq!(first.call_id, "call-first");
}
#[test]
fn every_prompt_mode_loads_the_captured_tool_set() {
let assets = PromptAssets::load(
std::path::Path::new(env!("CARGO_MANIFEST_DIR"))
.join("../prompt/cursor")
.as_path(),
)
.unwrap();
assert_eq!(assets.mode(Mode::Agent).tools.len(), 20);
assert_eq!(
assets
.mode(Mode::Agent)
.tools
.iter()
.map(|tool| tool.name.as_str())
.collect::<Vec<_>>(),
vec![
"Shell",
"Grep",
"Delete",
"WebSearch",
"WebFetch",
"GenerateImage",
"EditNotebook",
"TodoWrite",
"StrReplace",
"Write",
"Read",
"ReadLints",
"Glob",
"AskQuestion",
"Task",
"AwaitShell",
"GetMcpTools",
"FetchMcpResource",
"SwitchMode",
"CallMcpTool",
]
);
assert_mode(
&assets,
Mode::Ask,
&[
"AskQuestion",
"CallMcpTool",
"Delete",
"FetchMcpResource",
"Glob",
"Grep",
"Read",
"ReadLints",
"Shell",
"StrReplace",
"Task",
"TodoWrite",
"WebFetch",
"WebSearch",
"Write",
],
"1ca80a9b5547546217ac4999cd5069225c39cbd2df48e8468bb0105c18215236",
);
assert_mode(
&assets,
Mode::Plan,
&[
"Shell",
"Glob",
"Grep",
"Read",
"TodoWrite",
"ReadLints",
"WebSearch",
"WebFetch",
"AskQuestion",
"CreatePlan",
"Task",
"FetchMcpResource",
"CallMcpTool",
],
"06f9137d74d06edd03d90cb4124533d127be439eb2a480be4760944cd7c36d85",
);
assert_mode(
&assets,
Mode::Debug,
&[
"AskQuestion",
"CallMcpTool",
"Delete",
"FetchMcpResource",
"Glob",
"Grep",
"Read",
"ReadLints",
"Shell",
"StrReplace",
"Task",
"TodoWrite",
"WebFetch",
"WebSearch",
"Write",
],
"1ca80a9b5547546217ac4999cd5069225c39cbd2df48e8468bb0105c18215236",
);
assert_mode(
&assets,
Mode::Multitask,
&[
"AskQuestion",
"CallMcpTool",
"Delete",
"FetchMcpResource",
"Glob",
"Grep",
"Read",
"ReadLints",
"Shell",
"StrReplace",
"SwitchMode",
"Task",
"TodoWrite",
"WebFetch",
"WebSearch",
"Write",
"GenerateImage",
],
"b5b1310e3012b93f3b32e1cd834dad4865db1744200f362922c28fb0735aa86f",
);
assert_mode(
&assets,
Mode::Subagent,
&[
"Shell",
"Grep",
"Delete",
"WebSearch",
"WebFetch",
"GenerateImage",
"ReadLints",
"EditNotebook",
"TodoWrite",
"StrReplace",
"Write",
"Read",
"Glob",
"Task",
"AwaitShell",
"GetMcpTools",
"FetchMcpResource",
"SwitchMode",
"UpdateCurrentStep",
"CallMcpTool",
],
"142a76a2d0764585ebfd4c1c9b335a22d859e5a1d2ef515cc513923d8c7138b6",
);
assert_mode(
&assets,
Mode::Compaction,
&[],
"4f53cda18c2baa0c0354bb5f9a3ecbe5ed12ab4d8e11ba873c2f11161202b945",
);
assert_eq!(
schema_digest(&assets.mode(Mode::Agent).tools),
"7e9055bf2ae45384762a417b11a82db7a224d71c3fe716b7af6f06d589319335"
);
let shell = assets
.mode(Mode::Agent)
.tools
.iter()
.find(|tool| tool.name == "Shell")
.unwrap();
assert!(
shell.parameters["properties"]["block_until_ms"]["description"]
.as_str()
.unwrap()
.contains("do not combine it with `nohup`, `&`, `disown`")
);
for mode in [
Mode::Agent,
Mode::Ask,
Mode::Debug,
Mode::Multitask,
Mode::Subagent,
Mode::Compaction,
] {
assert!(!assets
.mode(mode)
.tools
.iter()
.any(|tool| tool.name == "CreatePlan" || tool.name == "PatchEdit"));
}
}
#[test]
fn every_captured_mode_owns_and_renders_its_runtime_template() {
let compiler = PromptCompiler::new(
PromptAssets::load(
std::path::Path::new(env!("CARGO_MANIFEST_DIR"))
.join("../prompt/cursor")
.as_path(),
)
.unwrap(),
);
let values = BTreeMap::from([
("REQUEST_CONTEXT", String::new()),
("OPEN_FILES", String::new()),
("SELECTED_CONTEXT", String::new()),
("ACTION_CONTEXT", String::new()),
("TIMESTAMP", "Sunday, Aug 16, 2026, 11:31 PM (UTC+8)".into()),
("USER_QUERY", "question".into()),
("DEBUG_SERVER_ENDPOINT", "http://debug".into()),
("DEBUG_LOG_PATH", "/tmp/debug.log".into()),
("DEBUG_SESSION_ID", "session".into()),
]);
for (mode, marker) in [
(Mode::Agent, "You are still in **Agent Mode**"),
(Mode::Ask, "Ask mode is active."),
(Mode::Plan, "Plan mode is active."),
(Mode::Debug, "You are now in **DEBUG MODE**"),
(Mode::Multitask, "The user has engaged **Multitask Mode**"),
] {
let rendered = compiler.runtime_message(mode, &values).unwrap();
assert!(rendered.contains(marker), "missing {mode:?} marker");
assert!(rendered.contains("<user_query>\nquestion\n</user_query>"));
assert_eq!(rendered.matches("<user_query>").count(), 1);
}
}
fn assert_mode(assets: &PromptAssets, mode: Mode, expected: &[&str], digest: &str) {
assert_eq!(
assets
.mode(mode)
.tools
.iter()
.map(|tool| tool.name.as_str())
.collect::<Vec<_>>(),
expected
);
assert_eq!(schema_digest(&assets.mode(mode).tools), digest);
}
fn schema_digest(tools: &[ToolDefinition]) -> String {
hex::encode(Sha256::digest(serde_json::to_vec(tools).unwrap()))
}
#[test]
fn dynamic_mcp_tools_are_appended_after_the_stable_mode_tool_prefix() {
let assets = PromptAssets::load(
std::path::Path::new(env!("CARGO_MANIFEST_DIR"))
.join("../prompt/cursor")
.as_path(),
)
.unwrap();
let compiler = PromptCompiler::new(assets);
let base = compiler
.prompt_spec(Mode::Agent, "model", &[], false)
.unwrap();
let dynamic = compiler
.prompt_spec(
Mode::Agent,
"model",
&[ToolDefinition {
name: "mcp_repo_lookup".into(),
description: "lookup".into(),
parameters: serde_json::json!({"type": "object"}),
}],
false,
)
.unwrap();
assert_eq!(base.tools, dynamic.tools[..base.tools.len()]);
assert_eq!(dynamic.tools.last().unwrap().name, "mcp_repo_lookup");
}
#[test]
fn dynamic_mcp_tool_cannot_replace_a_mode_tool() {
let assets = PromptAssets::load(
std::path::Path::new(env!("CARGO_MANIFEST_DIR"))
.join("../prompt/cursor")
.as_path(),
)
.unwrap();
let compiler = PromptCompiler::new(assets);
let error = compiler
.prompt_spec(
Mode::Agent,
"model",
&[ToolDefinition {
name: "Read".into(),
description: "replacement".into(),
parameters: serde_json::json!({"type": "object"}),
}],
false,
)
.unwrap_err();
assert!(error
.to_string()
.contains("dynamic MCP tool conflicts with a mode tool: Read"));
}
#[test]
fn agent_system_prompt_is_static_and_substitutes_the_model_name() {
let assets = PromptAssets::load(
std::path::Path::new(env!("CARGO_MANIFEST_DIR"))
.join("../prompt/cursor")
.as_path(),
)
.unwrap();
let compiler = PromptCompiler::new(assets);
let request = compiler
.prompt_spec(Mode::Agent, "test-model", &[], false)
.unwrap();
let prompt = &request.instructions;
assert!(prompt.contains("powered by test-model"));
assert!(!prompt.contains("{{FAKE_MODEL_NAME}}"));
assert!(!prompt.contains("<user_info>"));
}
#[test]
fn subagent_uses_the_agent_prompt_and_only_the_captured_tool_delta() {
let assets = PromptAssets::load(
std::path::Path::new(env!("CARGO_MANIFEST_DIR"))
.join("../prompt/cursor")
.as_path(),
)
.unwrap();
let compiler = PromptCompiler::new(assets);
let agent_prompt = compiler
.prompt_spec(Mode::Agent, "model", &[], false)
.unwrap();
let subagent_prompt = compiler
.prompt_spec(Mode::Subagent, "model", &[], false)
.unwrap();
assert_eq!(agent_prompt.instructions, subagent_prompt.instructions);
let request = compiler
.prompt_spec(Mode::Subagent, "model", &[], false)
.unwrap();
assert_eq!(
request
.tools
.iter()
.map(|tool| tool.name.as_str())
.collect::<Vec<_>>(),
vec![
"Shell",
"Grep",
"Delete",
"WebSearch",
"WebFetch",
"GenerateImage",
"ReadLints",
"EditNotebook",
"TodoWrite",
"StrReplace",
"Write",
"Read",
"Glob",
"Task",
"AwaitShell",
"GetMcpTools",
"FetchMcpResource",
"SwitchMode",
"UpdateCurrentStep",
"CallMcpTool",
]
);
let task = request
.tools
.iter()
.find(|tool| tool.name == "Task")
.unwrap();
let properties = task.parameters["properties"].as_object().unwrap();
assert!(!properties.contains_key("environment"));
assert!(!properties.contains_key("cloud_base_branch"));
let suppressed = compiler
.prompt_spec(Mode::Subagent, "model", &[], true)
.unwrap();
assert!(!suppressed
.tools
.iter()
.any(|tool| tool.name == "UpdateCurrentStep"));
}
fn tool_result(id: &str, output: serde_json::Value) -> CanonicalMessage {
tool_result_with_call(id, &format!("call-{id}"), output)
}
fn tool_result_with_call(
id: &str,
call_id: &str,
output: impl Into<serde_json::Value>,
) -> CanonicalMessage {
let output = output.into();
CanonicalMessage {
message_id: id.into(),
role: Role::Tool,
origin: Origin::Tool,
content: MessageContent::ToolResult(ToolResultContent {
call_id: call_id.into(),
name: "Tool".into(),
content: output
.as_str()
.map(str::to_string)
.unwrap_or_else(|| output.to_string()),
is_error: false,
}),
runtime_event_id: None,
}
}
fn assistant_tool_pair(
id: &str,
tool_round_id: &str,
index: usize,
call_id: &str,
text: &str,
thinking: &str,
) -> CanonicalMessage {
CanonicalMessage {
message_id: id.into(),
role: Role::Assistant,
origin: Origin::Assistant,
content: MessageContent::Assistant {
text: text.into(),
thinking: thinking.into(),
tool_round_id: Some(tool_round_id.into()),
replay_state: None,
tool_calls: vec![ToolCallContent {
index,
call_id: call_id.into(),
name: "Tool".into(),
arguments: serde_json::json!({}),
}],
},
runtime_event_id: None,
}
}