{"bin": "64_token_ish", "content_sha256": "f59731cc305b5fb24bb2ab683264f7859047fb9b52932ae7bd0efa5b2f708f6e", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:internal/hub/systems/system_manager.go", "end": 10837, "example_id": "0000028d15d22379705968eaadc3ff06fafbee99dc94c6ae0531a499d2c84161", "language": "go", "prefix": ".Id) {\n\t\t_ = sm.RemoveSystem(record.Id)\n\t}\n\n\t// Create new system if none provided\n\tif system == nil {\n\t\tsystem = sm.NewSystem(record.Id)\n\t}\n\n\t// Populate system from record\n\tsystem.Status = record.GetString(\"status\")\n\tsystem.Host = record.GetString(\"host\"", "repo": "henrygd/beszel", "span_codepoints": 256, "start": 10581, "suffix": " The system is immediately added to monitoring with the provided connection and version info.\nfunc (sm *SystemManager) AddWebSocketSystem(systemId string, agentVersion semver.Version, wsConn *ws.WsConn) error {\n\tsystemRecord, err := sm.hub.FindRecordById(\"", "target": ")\n\tsystem.Port = record.GetString(\"port\")\n\n\treturn sm.AddSystem(system)\n}\n\n// AddWebSocketSystem creates and adds a system with an established WebSocket connection.\n// This method is called when an agent connects via WebSocket with valid authentication.\n//"} {"bin": "32_token_ish", "content_sha256": "4225aecbb3bb3e4d52de1a7301857329ec58bfb7663b4b47703e9fd999d6004b", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/define.sh", "end": 13369, "example_id": "00000a2112b544b721e9fad8364263b4e23dfb2a35ba037e4cc5c3c119133633", "language": "shell", "prefix": " \"$input\" == \"thai\" ]] && id=\"th\"\n short=\"th\"\n lang=\"Thai\"\n culture=\"th-TH\" ;;\n \"tr\" | \"tr-\"* | \"turkish\" | \"türk\" | \"turk\" )\n [[ \"$input\" == \"turkish\" || \"$input\" == \"türk\" || \"$input\" == \"turk\" ]] && id=\"tr\"\n short=\"tr\"\n ", "repo": "dockur/windows", "span_codepoints": 128, "start": 13241, "suffix": "== \"ukrainian\" ]] && id=\"uk\"\n short=\"uk\"\n lang=\"Ukrainian\"\n culture=\"uk-UA\" ;;\n \"hk\" | \"zh-hk\" | \"cn-hk\" )\n short=\"hk\"\n lang=\"Chinese (Traditional)\"\n desc=\"Chinese HK\"\n culture=\"zh-TW\" ;;\n \"tw\" | \"zh-tw\" | \"cn-tw\" )", "target": "lang=\"Turkish\"\n culture=\"tr-TR\" ;;\n \"ua\" | \"ua-\"* | \"uk\" | \"uk-\"* | \"ukrainian\" )\n [[ \"$input\" == \"ua\" || \"$input\" "} {"bin": "64_token_ish", "content_sha256": "7710f0c3f8a841937588aa777aa88e7c65df3bfbca88158aa2f93fbc65ca96d9", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/__tests__/auth-commands.test.ts", "end": 4878, "example_id": "00000bc7fd2c22505103e798222a0377d3940e7d45ece775c228973be9c2442e", "language": "typescript", "prefix": "alue(\"valid-token\");\n vi.stubGlobal(\n \"fetch\",\n vi.fn().mockResolvedValue({\n ok: true,\n json: () =>\n Promise.resolve({\n success: true,\n name: \"Test User\",\n email: \"test@example.com\",\n ", "repo": "upstash/context7", "span_codepoints": 256, "start": 4622, "suffix": "(l) => l.includes(\"test@example.com\"))).toBe(true);\n });\n\n test(\"shows session expired hint when fetch fails\", async () => {\n mockGetValidAccessToken.mockResolvedValue(\"valid-token\");\n vi.stubGlobal(\n \"fetch\",\n vi.fn().mockResolvedValue({", "target": " teamspace: null,\n }),\n })\n );\n\n await runCommand(\"whoami\");\n expect(logOutput.some((l) => l.includes(\"Logged in\"))).toBe(true);\n expect(logOutput.some((l) => l.includes(\"Test User\"))).toBe(true);\n expect(logOutput.some("} {"bin": "16_token_ish", "content_sha256": "433a345a279c2d54be51864ef77c0a7b19d0f8604b9a441ce0a1eded31f113e8", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:src/hooks/caveman-stats.js", "end": 18962, "example_id": "00000cfe352bfffb49fac0bfae60bea56878a65c1c2773fd15849d59f3cd1878", "language": "javascript", "prefix": "d count against Pro/Max limits) are untouched by caveman —\n // any session-usage % would overstate real limit relief. See\n // docs/HONEST-NUMBERS.md.\n footer += ' Reduction is of output tokens only; input/cache usage is unchanged.';\n savings = ", "repo": "JuliusBrussee/caveman", "span_codepoints": 64, "start": 18898, "suffix": " `Est. tokens saved: ${estSaved.toLocaleString()} (~${Math.round(ratio * 100)}% of output)\\n` +\n usdLine).replace(/\\n$/, '');\n } else if (mode && mode !== 'off') {\n savings = `No savings estimate for '${mode}' mode — only 'ful", "target": "(`Est. without caveman: ${estNormal.toLocaleString()}\\n` +\n "} {"bin": "8_token_ish", "content_sha256": "f27ac893dc3f6befb569083a96dc3001948855d41eaed82b8cdb1c5ec633c10c", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/dwarf/dwarf_expr.c", "end": 12826, "example_id": "0000100154add4adb4a7aff2ed15531429d40ad04ee2b13e6bead264049900b0", "language": "c", "prefix": "BReg25: case DW_ExprOp_BReg26: case DW_ExprOp_BReg27:\n case DW_ExprOp_BReg28: case DW_ExprOp_BReg29: case DW_ExprOp_BReg30: case DW_ExprOp_BReg31:\n {reg_code_dw = (opcode - DW_ExprOp_BReg0);}goto based_reg_read;\n case DW_ExprOp_BRegX:\n ", "repo": "EpicGames/raddebugger", "span_codepoints": 32, "start": 12794, "suffix": "u64[0];}goto based_reg_read;\n based_reg_read:;\n {\n ARCH_RegCode reg_code = arch_reg_code_from_dw(arch, reg_code_dw);\n Rng1U16 reg_rng = arch_info->reg_code_rng_table[reg_code];\n U64 read_size = dim_1u16(reg_rng);\n read", "target": "{reg_code_dw = operands[0].u512."} {"bin": "16_token_ish", "content_sha256": "00bf56c318de8dd5a39de90b845ac6771a0348a7efebe39dd8c2e5736ac45c8d", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_rss_converter.py", "end": 4540, "example_id": "000014107c7810d777488a669d341beca74f3693a6a201c49c2d7e8b82f30245", "language": "python", "prefix": " def _parse_rss_type(self, doc: Document) -> DocumentConverterResult:\n \"\"\"Parse the type of an RSS feed.\n\n Returns None if the feed type is not recognized or something goes wrong.\n \"\"\"\n root = doc.getElementsByTagName(\"rss\")[0]\n", "repo": "microsoft/markitdown", "span_codepoints": 64, "start": 4476, "suffix": " if not channel_list:\n raise ValueError(\"No channel found in RSS feed\")\n channel = channel_list[0]\n channel_title = self._get_data_by_tag_name(channel, \"title\")\n channel_description = self._get_data_by_tag_name(channel, \"", "target": " channel_list = root.getElementsByTagName(\"channel\")\n "} {"bin": "64_token_ish", "content_sha256": "d5426d932b8f49c499da40a69b8b75b3f66055136cc701832bb40b9d33221fd6", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown-ocr/src/markitdown_ocr/_pdf_converter_with_ocr.py", "end": 10979, "example_id": "0000141497b55f45b161b296a6d0b647fd182056b5fd4682c19b2ad111d07fc1", "language": "python", "prefix": " markdown_content.append(item[\"text\"])\n else: # image\n ocr_text = item[\"ocr_text\"]\n img_marker = (\n ", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 10723, "suffix": "regular text\n text_content = page.extract_text() or \"\"\n if text_content.strip():\n markdown_content.append(text_content.strip())\n else:\n ", "target": " f\"\\n\\n*[Image OCR]\\n{ocr_text}\\n[End OCR]*\\n\"\n )\n markdown_content.append(img_marker)\n else:\n # No images detected - just extract "} {"bin": "64_token_ish", "content_sha256": "39d5269c2895517ab7c1c054aec392c7dfcd27d59a9e6a69107bbd63a304a8c8", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/hooks/pre_commit_hooks/check_xml.rs", "end": 4323, "example_id": "00001c8d070f19f7b1919aca0b9648b7970a2af416e4efe7b7b9ea6babebda1a", "language": "rust", "prefix": ").await?;\n let (code, output) = check_file(Path::new(\"\"), &file_path).await?;\n assert_eq!(code, 1);\n assert!(!output.is_empty());\n Ok(())\n }\n\n #[tokio::test]\n async fn test_invalid_xml_syntax_error() -> Result<()> {\n ", "repo": "j178/prek", "span_codepoints": 256, "start": 4067, "suffix": "let (code, output) = check_file(Path::new(\"\"), &file_path).await?;\n assert_eq!(code, 1);\n assert!(!output.is_empty());\n Ok(())\n }\n\n #[tokio::test]\n async fn test_invalid_xml_trailing_text() -> Result<()> {\n let dir = te", "target": " let dir = tempdir()?;\n let content = br#\"\n\n text\n\"#;\n let file_path = create_test_file(&dir, \"syntax_error.xml\", content).await?;\n "} {"bin": "64_token_ish", "content_sha256": "41f333c036d3e7c5d742f81da42534ef63ce6c1c25b2237145029d55248000f3", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/image.sh", "end": 3676, "example_id": "00001e663d647d69f709de8a46835eda20ddc245556efdf42aeccb85c45f71fb", "language": "shell", "prefix": " [[ \"$edition\" == \"$prefix\"* ]] || continue\n score=\"${#pattern}\"\n elif [ \"$edition\" = \"$pattern\" ]; then\n score=\"${#pattern}\"\n else\n continue\n fi\n\n if (( score > best_score )); then\n result=\"$priority\"\n ", "repo": "dockur/windows", "span_codepoints": 256, "start": 3420, "suffix": "_name\"\n local -n bases_ref=\"$bases_name\"\n local -n groups_ref=\"$groups_name\"\n local -n indexes_ref=\"$indexes_name\"\n\n local count image image_index\n local display product platform\n local edition_id install_type\n local candidate flags i\n\n versions_re", "target": " best_score=\"$score\"\n fi\n\n done\n\n done\n\n echo \"$result\"\n return 0\n}\n\ngetVersions() {\n\n local xml=\"$1\"\n local versions_name=\"$2\"\n local bases_name=\"$3\"\n local groups_name=\"$4\"\n local indexes_name=\"$5\"\n local -n versions_ref=\"$versions"} {"bin": "8_token_ish", "content_sha256": "8e220fb270b050bf1ece82efad6ae81ac5a9a1bdb9962fd7414e5d47b209737f", "document_id": "nicbarker/clay@e6cc36941ab2af5d81107617039d6f527a1c660b:renderers/GLES3/clay_renderer_gles3.h", "end": 5427, "example_id": "00001f2340009515c4e34da8eb18e3702913829ac33d3a1e2b7242d6fe5d4e47", "language": "c", "prefix": "\" // Border thicknesses\\n\"\n \" float L = vBorderWidths.x;\\n\"\n \" float R = vBorderWidths.y;\\n\"\n \" float T = vBorderWidths.z;\\n\"\n \" float B = vBorderWidths.w;\\n\"\n \" bool CLAY_BORDERS_ARE_INSET = true; // it is true\\n\"\n \" ", "repo": "nicbarker/clay", "span_codepoints": 32, "start": 5395, "suffix": " 0.0 || T > 0.0 || B > 0.0);\\n\"\n \" float outerAlpha = 1.0;\\n\"\n \" // If it is not a border but rect or image, then it only has outer border what is provided\\n\"\n \" // Otherwise it increases the outter border, but the provided borde is the i", "target": " bool isBorder = (L > 0.0 || R >"} {"bin": "32_token_ish", "content_sha256": "a2aed2930510f336d4c741954ba889652e6d51fa7896e117c1928cc2f08be559", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/languages/python/uv.rs", "end": 18968, "example_id": "000023fce37735448079bec0773c9fd696f5e69c6f2cc2617cb4e6a80f8ee059", "language": "rust", "prefix": "acquire(uv_dir.join(\".lock\"), \"uv\").await?;\n\n if uv_path.is_file() {\n match validate_uv_binary(&uv_path) {\n Ok(_) => {\n trace!(uv = %uv_path.display(), \"Found compatible managed uv\");\n ", "repo": "j178/prek", "span_codepoints": 128, "start": 18840, "suffix": ", error = %err, \"Skipping incompatible managed uv\");\n }\n }\n }\n\n let source = if let Some(uv_source) = uv_source_from_env(&EnvVars) {\n uv_source\n } else {\n Self::select_source().await?\n ", "target": "return Ok(Self::new(uv_path));\n }\n Err(err) => {\n warn!(uv = %uv_path.display()"} {"bin": "16_token_ish", "content_sha256": "0c1b6668c25c53f3726ae586a89b69d62c3032532207e5e702e02c928a10f680", "document_id": "cloudwego/eino@ca0441ac0bceed8945dcf7d5a18c237c924c6aa8:compose/chain_branch_test.go", "end": 6805, "example_id": "00002c6c298a128a3a61af4f1399182fd076288463a313c097fe53c9a0be1f0d", "language": "go", "prefix": "\tsw.Close()\n\t\t\t}()\n\n\t\t\treturn sr, nil\n\t\t}))\n\t\tc.AppendBranch(NewStreamChainBranch(streamCon).AddLambda(\"one_key\", CollectableLambda(func(ctx context.Context, in *schema.StreamReader[string]) (output string, err error) {\n\t\t\tdefer in.Close()\n\t\t\tfor {\n\t\t\t\tv, ", "repo": "cloudwego/eino", "span_codepoints": 64, "start": 6741, "suffix": "}\n\n\t\t\t\tif err != nil {\n\t\t\t\t\treturn \"\", err\n\t\t\t\t}\n\n\t\t\t\toutput += v\n\t\t\t}\n\n\t\t\treturn output + output, nil\n\t\t})).\n\t\t\tAddLambda(\"two_key\", CollectableLambda(func(ctx context.Context, in *schema.StreamReader[string]) (output string, err error) {\n\t\t\t\tdefer in.Clo", "target": "err := in.Recv()\n\t\t\t\tif errors.Is(err, io.EOF) {\n\t\t\t\t\tbreak\n\t\t\t\t"} {"bin": "16_token_ish", "content_sha256": "c7b8119f0c956a69abf4cf48d23de9667d47f54b68c51ba9fb9e3762758a81f8", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:internal/migrations/0_collections_snapshot_0_19_0_dev_1.go", "end": 12993, "example_id": "000034b4443170dd16c07b3da496459e23288467147b8f290567f2f81165bb33", "language": "go", "prefix": "alse,\n\t\t\t\t\"id\": \"autodate3332085495\",\n\t\t\t\t\"name\": \"updated\",\n\t\t\t\t\"onCreate\": true,\n\t\t\t\t\"onUpdate\": true,\n\t\t\t\t\"presentable\": false,\n\t\t\t\t\"system\": false,\n\t\t\t\t\"type\": \"autodate\"\n\t\t\t}\n\t\t],\n\t\t\"indexes\": [\n\t\t\t\"CREATE UNIQUE INDEX ` + \"`\" + `idx_30Lwgf2` + \"`\" + ", "repo": "henrygd/beszel", "span_codepoints": 64, "start": 12929, "suffix": " + `)\"\n\t\t],\n\t\t\"system\": false\n\t},\n\t{\n\t\t\"id\": \"2hz5ncl8tizk5nx\",\n\t\t\"listRule\": null,\n\t\t\"viewRule\": null,\n\t\t\"createRule\": null,\n\t\t\"updateRule\": null,\n\t\t\"deleteRule\": null,\n\t\t\"name\": \"systems\",\n\t\t\"type\": \"base\",\n\t\t\"fields\": [\n\t\t\t{\n\t\t\t\t\"autogeneratePattern\": \"", "target": "` ON ` + \"`\" + `user_settings` + \"`\" + ` (` + \"`\" + `user` + \"`\""} {"bin": "32_token_ish", "content_sha256": "58db8045145b385dc288be7faa24820813d36d5d39171370af1ce50ecd968256", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/spiders/test_cache.py", "end": 3594, "example_id": "000034c5ce475f0e3f88a8300bccb61a3fb1bea86b48758e75ad42d16c20664a", "language": "python", "prefix": " fp = b\"\\xaa\" * 20\n corrupt_path = Path(tmpdir) / f\"{fp.hex()}.json\"\n corrupt_path.write_text(\"not valid json{{{\")\n\n result = await cache.get(fp)\n assert result is None\n\n @pytest.mark.anyio\n async def test_", "repo": "D4Vinci/Scrapling", "span_codepoints": 128, "start": 3466, "suffix": "fp1 = b\"\\x01\" * 20\n fp2 = b\"\\x02\" * 20\n\n await cache.put(fp1, _make_response(url=\"https://a.com\"), \"GET\")\n await cache.put(fp2, _make_response(url=\"https://b.com\"), \"GET\")\n\n assert await cache.get(fp1) is not Non", "target": "clear(self):\n with tempfile.TemporaryDirectory() as tmpdir:\n cache = ResponseCacheManager(tmpdir)\n "} {"bin": "32_token_ish", "content_sha256": "55cb9fb5c350dda7373c4699fcb729abccb37d8198ea158278eccba44efe3f0a", "document_id": "nicbarker/clay@e6cc36941ab2af5d81107617039d6f527a1c660b:examples/clay-official-website/main.c", "end": 27804, "example_id": "00003563289337af64345d2b7f112cba207ec2a0cd0db37d1b0f8c2fac4a3158", "language": "c", "prefix": " .layout = { .sizing = { CLAY_SIZING_PERCENT(0.5) }, .layoutDirection = CLAY_TOP_TO_BOTTOM, .childGap = 8 } }) {\n CLAY_TEXT(CLAY_STRING(\"Integrated Debug Tools\"), CLAY_TEXT_CONFIG({ .fontSize = 52, .fontId = FONT_ID_TITLE_56, .textColor = COLOR_", "repo": "nicbarker/clay", "span_codepoints": 128, "start": 27676, "suffix": " CLAY_TEXT(CLAY_STRING(\"Clay includes built in \\\"Chrome Inspector\\\"-style debug tooling.\"), CLAY_TEXT_CONFIG({ .fontSize = 28, .fontId = FONT_ID_BODY_36, .textColor = COLOR_LIGHT }));\n CLAY_TEXT(CLAY_STRING(\"View your layout hierarchy and confi", "target": "LIGHT }));\n CLAY(CLAY_ID(\"DebuggerSpacer\"), { .layout = { .sizing = { CLAY_SIZING_GROW(.max = 16) }} }) {}\n "} {"bin": "32_token_ish", "content_sha256": "96c7d7dfa1d78c78e511c69062a8eaa0ad654af338473162f90e4f932480cbe4", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/llm/groq/chat.py", "end": 2020, "example_id": "0000379728e07eb6826e1d7110fc0f3d4fc171bfe4f483c674d9f5d1d9f4edec", "language": "python", "prefix": "ation\n\tmodel: GroqVerifiedModels | str\n\n\t# Model params\n\ttemperature: float | None = None\n\tservice_tier: Literal['auto', 'on_demand', 'flex'] | None = None\n\ttop_p: float | None = None\n\tseed: int | None = None\n\n\t# Client initialization parameters\n\tapi_key: ", "repo": "browser-use/browser-use", "span_codepoints": 128, "start": 1892, "suffix": "# Increase default retries for automation reliability\n\n\tdef get_client(self) -> AsyncGroq:\n\t\treturn AsyncGroq(api_key=self.api_key, base_url=self.base_url, timeout=self.timeout, max_retries=self.max_retries)\n\n\t@property\n\tdef provider(self) -> str:\n\t\treturn", "target": "str | None = None\n\tbase_url: str | URL | None = None\n\ttimeout: float | Timeout | NotGiven | None = None\n\tmax_retries: int = 10 "} {"bin": "64_token_ish", "content_sha256": "63486d6505ad24addef3dd5ab280e52e6b8b1825a498961478c31c4f318bdef0", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_zip_converter.py", "end": 3316, "example_id": "0000420d496e16be0e552b9cba72395ed7d84df8230e881864b6833c018c1640", "language": "python", "prefix": "try:\n z_file_stream = io.BytesIO(zipObj.read(name))\n z_file_stream_info = StreamInfo(\n extension=os.path.splitext(name)[1],\n filename=os.path.basename(name),\n ", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 3060, "suffix": " md_content += f\"## File: {name}\\n\\n\"\n md_content += result.markdown + \"\\n\\n\"\n except UnsupportedFormatException:\n pass\n except FileConversionException:\n pass\n\n ", "target": " )\n result = self._markitdown.convert_stream(\n stream=z_file_stream,\n stream_info=z_file_stream_info,\n )\n if result is not None:\n "} {"bin": "8_token_ish", "content_sha256": "4225aecbb3bb3e4d52de1a7301857329ec58bfb7663b4b47703e9fd999d6004b", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/define.sh", "end": 13072, "example_id": "00004215dce64872071487fa994f9917c3b9145d4eef8b56bae8491d08d0e32f", "language": "shell", "prefix": "svenska\" )\n [[ \"$input\" == \"se\" || \"$input\" == \"swedish\" || \"$input\" == \"svenska\" ]] && id=\"sv\"\n short=\"sv\"\n lang=\"Swedish\"\n culture=\"sv-SE\" ;;\n \"th\" | \"th-\"* | \"thai\" )\n [[ \"$input\" == \"thai\" ]] && id=\"th\"\n short=\"th\"\n ", "repo": "dockur/windows", "span_codepoints": 32, "start": 13040, "suffix": "TH\" ;;\n \"tr\" | \"tr-\"* | \"turkish\" | \"türk\" | \"turk\" )\n [[ \"$input\" == \"turkish\" || \"$input\" == \"türk\" || \"$input\" == \"turk\" ]] && id=\"tr\"\n short=\"tr\"\n lang=\"Turkish\"\n culture=\"tr-TR\" ;;\n \"ua\" | \"ua-\"* | \"uk\" | \"uk-\"* | \"ukrainian\"", "target": " lang=\"Thai\"\n culture=\"th-"} {"bin": "64_token_ish", "content_sha256": "e191ce730fc08df89719c6c568529d86eb786e2395518ed9c12562358c33ddd3", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/commands/artifact-workflow.test.ts", "end": 23576, "example_id": "0000466647f0184b85a2c3891d61fb48bed84a42e9161e8b669d94f37148a417", "language": "typescript", "prefix": " // Overwrite tasks with all completed\n await fs.writeFile(\n path.join(changeDir, 'tasks.md'),\n '## Tasks\\n- [x] Task 1\\n- [x] Task 2'\n );\n\n const result = await runCLI(['instructions', 'apply', '--change', 'done-apply'], {", "repo": "Fission-AI/OpenSpec", "span_codepoints": 256, "start": 23320, "suffix": " () => {\n // Create a spec-driven style change with all artifacts\n await createTestChange('apply-schema-test', ['proposal', 'design', 'specs', 'tasks']);\n\n const result = await runCLI(\n ['instructions', 'apply', '--change', 'apply-sch", "target": "\n cwd: tempDir,\n });\n expect(result.exitCode).toBe(0);\n expect(result.stdout).toContain('complete ✓');\n expect(result.stdout).toContain('ready to be archived');\n });\n\n it('uses spec-driven schema apply configuration', async"} {"bin": "32_token_ish", "content_sha256": "0755713adc0a8eb76a9ce758a89666fc1af72833fcdf5f497d1d293ce1ee55bf", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:skills/open-source/references/agent.md", "end": 4277, "example_id": "000053b67256125c484e6da2799b156fe342aa443e9d8482ba7ea1352f6c8456", "language": "markdown", "prefix": "ons\nhistory.errors() # Errors (None for clean steps)\nhistory.model_actions() # All actions with parameters\nhistory.model_outputs() # All model outputs\nhistory.last_action() # Last action\n\n# Analysis\nhistory.", "repo": "browser-use/browser-use", "span_codepoints": 128, "start": 4149, "suffix": "successful() # Completed successfully? (None if not done)\nhistory.has_errors() # Any errors?\nhistory.model_thoughts() # Reasoning (AgentBrain objects)\nhistory.action_results() # All ActionResult objects\nhistory.acti", "target": "final_result() # Final extracted content (last step)\nhistory.is_done() # Agent completed?\nhistory.is_"} {"bin": "32_token_ish", "content_sha256": "d8bd95dc0fae7abc7673552f70df4fc356cb9e81527483f06c07043098e8784f", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:agent/gpu_test.go", "end": 2139, "example_id": "000055a9821fb80f40ecc1234b6ecc9656e7de214120ec74b3b12e4d75939f51", "language": "go", "prefix": " 62.35,\n\t\t\t\t\tCount: 1,\n\t\t\t\t},\n\t\t\t\t\"2\": {\n\t\t\t\t\tName: \"A10\",\n\t\t\t\t\tTemperature: 44.0,\n\t\t\t\t\tMemoryUsed: 21700.0 / 1.024,\n\t\t\t\t\tMemoryTotal: 23028.0 / 1.024,\n\t\t\t\t\tUsage: 0.0,\n\t\t\t\t\tPower: 59.57,\n\t\t\t\t\tCount: 1,\n\t\t\t\t},\n\t\t\t\t\"3\": {\n\t", "repo": "henrygd/beszel", "span_codepoints": 128, "start": 2011, "suffix": ": 0.0,\n\t\t\t\t\tPower: 61.76,\n\t\t\t\t\tCount: 1,\n\t\t\t\t},\n\t\t\t},\n\t\t\twantValid: true,\n\t\t},\n\t\t{\n\t\t\tname: \"empty input\",\n\t\t\tinput: \"\",\n\t\t\twantData: map[string]system.GPUData{},\n\t\t\twantValid: false,\n\t\t},\n\t\t{\n\t\t\tname: \"malformed data\",\n\t\t\t", "target": "\t\t\t\tName: \"A10\",\n\t\t\t\t\tTemperature: 45.0,\n\t\t\t\t\tMemoryUsed: 18222.0 / 1.024,\n\t\t\t\t\tMemoryTotal: 23028.0 / 1.024,\n\t\t\t\t\tUsage"} {"bin": "64_token_ish", "content_sha256": "1e8c05cf577f582439d8bbe8b090f854d0f784829ad07dcf2cc4acdb993c5b1b", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/samba.sh", "end": 4033, "example_id": "00005dcba43fca5c402da84a358d54c9cca9c9c7d2fecf38f838ea1902934657", "language": "shell", "prefix": " guest account = nobody\"\n echo \" map to guest = Bad User\"\n echo \" server min protocol = NT1\"\n echo \" follow symlinks = yes\"\n echo \" wide links = yes\"\n echo \" unix extensions = no\"\n echo \" inherit owner = yes\"\n echo \" ", "repo": "dockur/windows", "span_codepoints": 256, "start": 3777, "suffix": " services\"\n echo \" load printers = no\"\n echo \" printing = bsd\"\n echo \" printcap name = /dev/null\"\n echo \" disable spoolss = yes\"\n } > \"$SAMBA_CONFIG\"; then\n error \"Failed to write Samba config \\\"$SAMBA_CONFIG\\\" !\"\n return 1\n ", "target": " create mask = 0666\"\n echo \" directory mask = 02777\"\n echo \" force user = root\"\n echo \" force group = root\"\n echo \" force create mode = 0666\"\n echo \" force directory mode = 02777\"\n echo \"\"\n echo \" # Disable printing"} {"bin": "32_token_ish", "content_sha256": "ab5c97cd2d97c4a83a2b8ece386dbdbb1508dd350a483fd12612262ed89cca04", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/tools-ai-sdk/src/index.test.ts", "end": 5854, "example_id": "00006329e52596b802a19b8dd7fd2d4ff1dc491595df159b81531ee568b9d669", "language": "typescript", "prefix": ",\n }),\n execute: async ({ input }) => ({ result: `processed: ${input}` }),\n });\n\n const agent = new Context7Agent({\n model: bedrock(\"anthropic.claude-3-haiku-20240307-v1:0\"),\n tools: {\n customTool,\n },\n", "repo": "upstash/context7", "span_codepoints": 128, "start": 5726, "suffix": " const agent = new Context7Agent({\n model: bedrock(\"anthropic.claude-3-haiku-20240307-v1:0\"),\n stopWhen: stepCountIs(5),\n });\n\n const result = await agent.generate({\n prompt: \"Find the React library and get documentation ", "target": " });\n\n expect(agent).toBeDefined();\n });\n\n test(\"should generate response using agent workflow\", async () => {\n "} {"bin": "16_token_ish", "content_sha256": "e37c60a0804564c1029273344d1ca7916ebd7cfc8a8e6b2bcd4175b0266fa455", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/bilibili/download.test.js", "end": 4027, "example_id": "000065dbb85b0f4c0773132fd21534f5ca0f153a9906c61d43678323776db279", "language": "javascript", "prefix": "ts.toSatisfy(\n (err) => err instanceof CommandExecutionError && /paid-content metadata/.test(err.message),\n );\n expect(mockDownloadMedia).not.toHaveBeenCalled();\n });\n\n it('skips pre-check entirely with --force', async () => {\n const rows =", "repo": "jackwener/OpenCLI", "span_codepoints": 64, "start": 3963, "suffix": " quality: 'best', force: true });\n\n expect(rows[0].status).toBe('success');\n expect(mockApiGet).not.toHaveBeenCalled();\n expect(mockDownloadMedia).toHaveBeenCalledTimes(1);\n });\n\n it('does not block download when the pre-check API itself fails',", "target": " await command.func(page, { bvid: 'BV1xx411c7mD', output: './o',"} {"bin": "64_token_ish", "content_sha256": "5e1ddd128c8a824eb2905880e165b59d6818baf2a14501b76d361b956e74f3d6", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:crates/rig-core/src/providers/openai/mod.rs", "end": 6541, "example_id": "00006aa241a711358684b88dddcb54ab5e114f283fed62feed1508976397c50e", "language": "rust", "prefix": " \"b\": { \"type\": \"number\" }\n }\n });\n\n sanitize_schema(&mut schema);\n\n let required = schema[\"required\"].as_array().unwrap();\n assert!(required.contains(&json!(\"a\")));\n assert!(required.contains(&json!(\"b\"", "repo": "0xPlaygrounds/rig", "span_codepoints": 256, "start": 6285, "suffix": " ]\n });\n\n sanitize_schema(&mut schema);\n\n assert!(schema.get(\"oneOf\").is_none());\n assert!(schema[\"anyOf\"].as_array().is_some());\n }\n\n #[test]\n fn test_sanitize_recurses_into_nested_objects() {\n let mut schema = ", "target": ")));\n assert_eq!(required.len(), 2);\n }\n\n #[test]\n fn test_sanitize_converts_one_of_to_any_of() {\n let mut schema = json!({\n \"oneOf\": [\n { \"type\": \"string\" },\n { \"type\": \"number\" }\n "} {"bin": "64_token_ish", "content_sha256": "d8bd95dc0fae7abc7673552f70df4fc356cb9e81527483f06c07043098e8784f", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:agent/gpu_test.go", "end": 47641, "example_id": "00006ea91d4086735cb5b3fa19e8b991c5fd9ecfecc2a197a4e4e106dca6f8d2", "language": "go", "prefix": " (B)\": \"10737418240\", \"VRAM Total Used Memory (B)\": \"1073741824\", \"Card Series\": \"Radeon RX 6800\"}}`),\n\t\t\t\t[]byte(`{\"card0\": {\"GUID\": \"34756\", \"Temperature (Sensor edge) (C)\": \"60.0\", \"Current Socket Graphics Package Power (W)\": \"150.0\", \"GPU use (%)\": \"40", "repo": "henrygd/beszel", "span_codepoints": 256, "start": 47385, "suffix": "\", \"GPU use (%)\": \"50\", \"VRAM Total Memory (B)\": \"10737418240\", \"VRAM Total Used Memory (B)\": \"3221225472\", \"Card Series\": \"Radeon RX 6800\"}}`),\n\t\t\t},\n\t\t\tparser: func(gm *GPUManager) func([]byte) bool {\n\t\t\t\treturn gm.parseAmdData\n\t\t\t},\n\t\t\texpectedValues: m", "target": "\", \"VRAM Total Memory (B)\": \"10737418240\", \"VRAM Total Used Memory (B)\": \"2147483648\", \"Card Series\": \"Radeon RX 6800\"}}`),\n\t\t\t\t[]byte(`{\"card0\": {\"GUID\": \"34756\", \"Temperature (Sensor edge) (C)\": \"70.0\", \"Current Socket Graphics Package Power (W)\": \"200.0"} {"bin": "64_token_ish", "content_sha256": "8546a18bbe8a04fd2d86495a665834aeb952f55c860586210e5f03b43ed95298", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/context-menu.tsx", "end": 2015, "example_id": "00006efb28b7114c084f3ea02254a8ee74d3d85b4053248c9adc3b1d5a13297c", "language": "typescript", "prefix": "h-(--available-height) min-w-32 origin-(--transform-origin) overflow-x-hidden overflow-y-auto rounded-lg bg-popover p-1 text-popover-foreground shadow-md ring-1 ring-foreground/10 duration-100 outline-none data-[side=bottom]:slide-in-from-top-2 data-[side=", "repo": "OpenCut-app/OpenCut", "span_codepoints": 256, "start": 1759, "suffix": "95 data-closed:animate-out data-closed:fade-out-0 data-closed:zoom-out-95\", className )}\n {...props}\n />\n \n \n )\n}\n\nfunction ContextMenuGroup({ ...props }: ContextMenuP", "target": "inline-end]:slide-in-from-left-2 data-[side=inline-start]:slide-in-from-right-2 data-[side=left]:slide-in-from-right-2 data-[side=right]:slide-in-from-left-2 data-[side=top]:slide-in-from-bottom-2 data-open:animate-in data-open:fade-in-0 data-open:zoom-in-"} {"bin": "16_token_ish", "content_sha256": "632ce87a34d6fee432909ff25310b13c5a844a9fd0d52ddd5a8c6447648a4858", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:agent/server_test.go", "end": 9995, "example_id": "0000718b39717c14cbe9781ef5d848cb6ecc481fdec5060dfa0c270dead519b1", "language": "go", "prefix": "ntVersion: \"SSH-2.0-beszel\",\n\t\t\texpectError: true,\n\t\t},\n\t\t{\n\t\t\tname: \"empty version string\",\n\t\t\tclientVersion: \"\",\n\t\t\texpectError: true,\n\t\t},\n\t\t{\n\t\t\tname: \"version string with underscore but no version\",\n\t\t\tclientVersion: \"beszel_", "repo": "henrygd/beszel", "span_codepoints": 64, "start": 9931, "suffix": "\tname: \"version with patch and build metadata\",\n\t\t\tclientVersion: \"SSH-2.0-beszel_1.2.3+build.123\",\n\t\t\texpectedVersion: \"1.2.3+build.123\",\n\t\t\texpectError: false,\n\t\t},\n\t}\n\n\tfor _, tt := range tests {\n\t\tt.Run(tt.name, func(t *testing.T) {\n\t\t", "target": "\",\n\t\t\texpectedVersion: \"\",\n\t\t\texpectError: true,\n\t\t},\n\t\t{\n\t\t"} {"bin": "16_token_ish", "content_sha256": "06f26bb3c51ea4c51fbae2011a47c06440f2c1d43820a6eb65732476abc3450c", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:sqlite-vec-rescore.c", "end": 1863, "example_id": "000075cda754ba8ace22fb5ae264e513e9a51e669655b1c6246263a338200d8f", "language": "c", "prefix": "loat vector table (rowid-keyed for fast random access)\n zSql = sqlite3_mprintf(\n \"CREATE TABLE \\\"%w\\\".\\\"%w_rescore_vectors%02d\\\"\"\n \"(rowid INTEGER PRIMARY KEY, vector BLOB NOT NULL)\",\n p->schemaName, p->tableName, i);\n if (!zSql)", "repo": "asg017/sqlite-vec", "span_codepoints": 64, "start": 1799, "suffix": ", -1, &stmt, 0);\n sqlite3_free(zSql);\n if ((rc != SQLITE_OK) || (sqlite3_step(stmt) != SQLITE_DONE)) {\n *pzErr = sqlite3_mprintf(\n \"Could not create '_rescore_vectors%02d' shadow table: %s\", i,\n sqlite3_errmsg(db));\n sqlit", "target": "\n return SQLITE_NOMEM;\n rc = sqlite3_prepare_v2(db, zSql"} {"bin": "32_token_ish", "content_sha256": "2672a14a62dc3390d2f1249555e6befe2308ca0479a1e0e2006980170ba0396c", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:engineering-book/src/ch09-no-std-and-feature-verification.md", "end": 6029, "example_id": "00007a04c7d0c159ae4d3003d2c50f41cd4c2222b822527746868e94f3b13bd6", "language": "markdown", "prefix": "──────────────────────────────────────────────────────────┘\n```\n\n**What you lose without `std`:**\n- No `HashMap` (requires a hasher — use `BTreeMap` from `alloc`, or `hashbrown`)\n- No `println!()` (requires stdout — use `core::fmt::Write` to a buffer)\n- No", "repo": "microsoft/RustTraining", "span_codepoints": 128, "start": 5901, "suffix": ", no threads (unless provided by a platform HAL)\n- No `Mutex` (use `spin::Mutex` or platform-specific locks)\n\n### Building a `no_std` Crate\n\n```rust\n// src/lib.rs — a no_std library crate\n#![no_std]\n\n// Optionally use heap allocation\nextern crate alloc;\nus", "target": " `std::error::Error` (stabilized in `core` since Rust 1.81, but many\n ecosystems haven't migrated)\n- No file I/O, no networking"} {"bin": "16_token_ish", "content_sha256": "ad9dcc71789a56c70695c623f4be10a42594d43505ce3a6fff323ee7743ec106", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/linker/pdb_ext/pdb_builder.c", "end": 5585, "example_id": "00007f305e339d69a5183876dc2b6700c967dc878e5f3846fcd64d00c81f92f9", "language": "c", "prefix": "[i], buckets[i]->key, buckets[i]->value, pack_ud); }\n\n // compute count of present words that are needed\n U64 present_word_count = 0;\n U64 present_msb = bit_array_scan_right_to_left32(ht->present_bits, 0, ht->present_bits.count*32, 1);\n if (present_msb", "repo": "EpicGames/raddebugger", "span_codepoints": 64, "start": 5521, "suffix": " / 32 + 1; }\n\n // compute count of deleted words that are needed\n U64 deleted_word_count = 0;\n U64 deleted_msb = bit_array_scan_right_to_left32(ht->deleted_bits, 0, ht->deleted_bits.count*32, 1);\n if (deleted_msb < ht->deleted_bits.count*32) { deleted_", "target": " < ht->present_bits.count*32) { present_word_count = present_msb"} {"bin": "32_token_ish", "content_sha256": "f675d6d404617e1e1689184e44da357b529068183e076c753bbc1f3b4aab9a6f", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/_test_vectors.py", "end": 8242, "example_id": "000089892b6f564782b95e6cdce20bd252b687529644af3b1267fe0af6d427fe", "language": "python", "prefix": "Test Author\",\n \"A test EPUB document for MarkItDown testing\",\n \"# Chapter 1: Test Content\",\n \"This is a **test** paragraph with some formatting\",\n \"* A bullet point\",\n \"* Another point\",\n \"#", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 8114, "suffix": " must_not_include=[],\n ),\n]\n\n\nDATA_URI_TEST_VECTORS = [\n FileTestVector(\n filename=\"test.docx\",\n mimetype=\"application/vnd.openxmlformats-officedocument.wordprocessingml.document\",\n charset=None,\n url=None,\n must_in", "target": " Chapter 2: More Content\",\n \"*different* style\",\n \"> This is a blockquote for testing\",\n ],\n "} {"bin": "16_token_ish", "content_sha256": "d5426d932b8f49c499da40a69b8b75b3f66055136cc701832bb40b9d33221fd6", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown-ocr/src/markitdown_ocr/_pdf_converter_with_ocr.py", "end": 1425, "example_id": "000098f3e3e8c6d24899e066f3b2a9819db9fccabe9eb97ff0ce377f0212e45a", "language": "python", "prefix": "ge.images\n\n # Method 2: If no images found, try underlying PDF objects\n if not images and hasattr(page, \"objects\") and \"image\" in page.objects:\n images = page.objects.get(\"image\", [])\n\n # Method 3: Try filtering all objects ", "repo": "microsoft/markitdown", "span_codepoints": 64, "start": 1361, "suffix": "\"):\n all_objs = page.objects\n for obj_type in all_objs.keys():\n if \"image\" in obj_type.lower() or \"xobject\" in obj_type.lower():\n potential_imgs = all_objs.get(obj_type, [])\n if pot", "target": "for image types\n if not images and hasattr(page, \"objects"} {"bin": "8_token_ish", "content_sha256": "fba7f4080f31b16dc86517fd452cefa8f10e1dc3391cadffe4df598b627b2c06", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:examples/rag_dynamic_tools_multi_turn/src/main.rs", "end": 4498, "example_id": "000099966f304afa66a5c502122c2c00c38dc689c15047fccde6053fe4b27d21", "language": "rust", "prefix": "ext prompt and a dynamic tool source\n let calculator_rag = openai_client\n .agent(openai::GPT_4)\n .preamble(\n \"You are a calculator here to help the user perform arithmetic operations.\n Use the tools provided to answer", "repo": "0xPlaygrounds/rig", "span_codepoints": 32, "start": 4466, "suffix": "do any math on your own.\",\n )\n // Add a dynamic tool source with a sample rate of 2 (i.e.: only\n // 2 additional tool will be added to prompts)\n .retrieved_tools(2, index, toolset)\n .build();\n\n // Prompt the agent and ", "target": " the user's question and do not "} {"bin": "8_token_ish", "content_sha256": "e37c60a0804564c1029273344d1ca7916ebd7cfc8a8e6b2bcd4175b0266fa455", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/bilibili/download.test.js", "end": 2126, "example_id": "00009b70d9b014a4229eca917786eb4daa30fbbe77b938d7fea415fdb0e4bd26", "language": "javascript", "prefix": "wnloadMedia).toHaveBeenCalledTimes(1);\n });\n\n it('throws PAID_CONTENT for member-only bangumi when account has no vip', async () => {\n mockApiGet\n .mockResolvedValueOnce(viewPayload({ rights: { pay: 1 } })) // view\n .mockResolvedValueOnce({ ", "repo": "jackwener/OpenCLI", "span_codepoints": 32, "start": 2094, "suffix": "}); // nav\n\n await expect(\n command.func(page, { bvid: 'BV1xx411c7mD', output: './o', quality: 'best', force: false }),\n ).rejects.toSatisfy((err) => err instanceof CliError && err.code === 'PAID_CONTENT');\n expect(mockDownloadMedia).not.toHa", "target": "code: 0, data: { vipStatus: 0 } "} {"bin": "8_token_ish", "content_sha256": "bfb61792348d0e569cedf1c2b3307d237c6c2ecebbf76db01f09e4a0c8922f38", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:cmd/robots2policy/main.go", "end": 6236, "example_id": "00009b883ad7e630ca41a5fefd782cb9459926225c09f31d782234cc9d45612d", "language": "go", "prefix": "erAgents) > 0 && value != \"\" {\n\t\t\t\tcurrentAllows = append(currentAllows, value)\n\t\t\t}\n\n\t\tcase \"crawl-delay\":\n\t\t\tif len(currentUserAgents) > 0 {\n\t\t\t\tif delay, err := parseIntSafe(value); err == nil {\n\t\t\t\t\tcurrentCrawlDelay = delay\n\t\t\t\t}\n\t\t\t}\n\t\t}\n\t}\n\n\t// Don'", "repo": "TecharoHQ/anubis", "span_codepoints": 32, "start": 6204, "suffix": "\n\tif len(currentUserAgents) > 0 {\n\t\trule := createRuleFromAccumulated(currentUserAgents, currentDisallows, currentAllows, currentCrawlDelay)\n\t\trules = append(rules, rule)\n\t}\n\n\t// Mark blacklisted user agents (those with \"Disallow: /\")\n\tfor i := range rules", "target": "t forget the last group of rules"} {"bin": "64_token_ish", "content_sha256": "f47fe2e6440578eeb20408bc3131b63fb8e1ae4f6ea26dbdcca33e7901e5ee8c", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:src/hooks/caveman-config.js", "end": 8745, "example_id": "0000a012307d86631cf97ed5d3ef927a00d4a4b3b6a8b95309c923711644b58f", "language": "javascript", "prefix": "turn null;\n\n const O_NOFOLLOW = typeof fs.constants.O_NOFOLLOW === 'number' ? fs.constants.O_NOFOLLOW : 0;\n const flags = fs.constants.O_RDONLY | O_NOFOLLOW;\n let fd;\n let out;\n try {\n fd = fs.openSync(flagPath, flags);\n const buf ", "repo": "JuliusBrussee/caveman", "span_codepoints": 256, "start": 8489, "suffix": "(!VALID_MODES.includes(raw)) return null;\n return raw;\n } catch (e) {\n return null;\n }\n}\n\n// Symlink-safe append. Same parent-dir + symlink-target rules as safeWriteFlag,\n// but opens with O_APPEND so concurrent writers from different sessions don'", "target": "= Buffer.alloc(MAX_FLAG_BYTES);\n const n = fs.readSync(fd, buf, 0, MAX_FLAG_BYTES, 0);\n out = buf.slice(0, n).toString('utf8');\n } finally {\n if (fd !== undefined) fs.closeSync(fd);\n }\n\n const raw = out.trim().toLowerCase();\n if "} {"bin": "32_token_ish", "content_sha256": "69cc8ae62cec8ea6a5108b8505b4a4d8816dc8e835610424e9ca7f0504f11d70", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/xianyu/publish.test.js", "end": 3731, "example_id": "0000ad40c66202fd12b203a339c2cd3a70f879cc3bf192af25fc1226526407b6", "language": "javascript", "prefix": "filled: ['title', 'description', 'price', 'condition'], missing: [] },\n { ok: true },\n { status: 'published', item_id: '123456789012', url: 'https://www.goofish.com/item?id=123456789012' },\n ],\n });\n\n ", "repo": "jackwener/OpenCLI", "span_codepoints": 128, "start": 3603, "suffix": " item_id: '123456789012',\n title: 'MacBook Pro',\n price: '¥5999.99',\n condition: '轻微使用',\n url: 'https://www.goofish.com/item?id=123456789012',\n message: '发布成功',\n }]);\n });\n\n it('uses", "target": "const rows = await publishCommand.func(page, validArgs);\n\n expect(rows).toEqual([{\n status: 'published',\n "} {"bin": "16_token_ish", "content_sha256": "e6a3afe46f95ebf1b7e2059c7f0f07a9f8699cae7d7f775def63b542b03ec689", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/answer.sh", "end": 20814, "example_id": "0000af6b4b34f21a1d5dbd00fc6d7eff9ec6f1432c0ba962f1579ec72b28d089", "language": "shell", "prefix": " local user_xml\n user_xml=$(escapeXMLSed \"$user\") || return 1\n\n sed -i \"s|-name \\\"Docker\\\"|-name \\\"\\$env:USERNAME\\\"|g\" \"$asset\" || return 1\n sed -i 's|where name=\"Docker\"|where name=\"%USERNAME%\"|g' \"$asset\" || return 1\n sed -i \"s|Docker|$user_xml|g\" \"$asset\" || return 1\n sed -i \"s|Docker|$user_xml|g\" \"$asset\" || return 1\n fi\n\n local pass=\"${PASSWORD:-admin}\"\n local pw adm", "target": ">Docker|$user_xml|g\" \"$asset\" || return 1\n "} {"bin": "8_token_ish", "content_sha256": "7f6bee86702a488d29ef0dcaabf424bbe2aca345a6a642319d43a1fe0276792e", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:hooks/ponytail-subagent.js", "end": 366, "example_id": "0000b128a4b537563823c872fcdeb69a913133e1d2893e56b9ffcd0fa1c69381", "language": "javascript", "prefix": "Start context is parent-thread only and never reaches subagents, so\n// without this every Task-spawned agent runs ponytail-unaware (issue #252).\n// When ponytail mode is active, inject the same ruleset into each subagent.\n//\n// Scoping (opt-in, issue #506)", "repo": "DietrichGebert/ponytail", "span_codepoints": 32, "start": 334, "suffix": "to a regex and\n// the ruleset is injected only into subagents whose agent_type matches. The\n// regex is unanchored and case-insensitive — \"explore|general\" matches either,\n// \"^general$\" is exact. Unset means inject into every subagent, as before.\n\nconst {", "target": ": set PONYTAIL_SUBAGENT_MATCHER "} {"bin": "64_token_ish", "content_sha256": "fcf067fceb8e3428fdac592012b5de635307730e203700ca40e6347925a555a9", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:async-book/src/ch12-common-pitfalls.md", "end": 8707, "example_id": "0000b262d7f3fa9e6ae5dc2587e54db72b2dd37850ac7b2f4cc265a4da153934", "language": "markdown", "prefix": " let b = fetch(\"url_b\").await; // 1 second (waits for a to finish first!)\n}\n\n// ✅ CONCURRENT: Takes 1 second total\nasync fn fast() {\n let (a, b) = tokio::join!(\n fetch(\"url_a\"), // Both start immediately\n fetch(\"url_b\"),\n );\n}\n\n// ✅ ", "repo": "microsoft/RustTraining", "span_codepoints": 256, "start": 8451, "suffix": "```\n\n> **Trap**: `let a = fetch(url).await; let b = fetch(url).await;` is sequential!\n> The second `.await` doesn't start until the first finishes. Use `join!` or\n> `spawn` for concurrency.\n\n## Case Study: Debugging a Hung Production Service\n\nA real-world ", "target": "ALSO CONCURRENT: Using let + join\nasync fn also_fast() {\n let fut_a = fetch(\"url_a\"); // Create future (lazy — not started yet)\n let fut_b = fetch(\"url_b\"); // Create future\n let (a, b) = tokio::join!(fut_a, fut_b); // NOW both run concurrently\n}\n"} {"bin": "16_token_ish", "content_sha256": "795fe7db5dc234e3b2e008ebe3a1508b1640f35ec8988cffbc9587732a2a28b1", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:tests/providers/openrouter/cassette/agent_tool_sessions.rs", "end": 4002, "example_id": "0000b7423aef7f0f13943b93fd243d89c699e48b5a0d874ab98949b627b658fb", "language": "rust", "prefix": "rror(\"session tool error\")]\nstruct SessionToolError;\n\nimpl Tool for PingEmpty {\n const NAME: &'static str = \"ping_empty\";\n type Error = SessionToolError;\n type Args = EmptyArgs;\n type Output = String;\n\n fn description(&self) -> String {\n ", "repo": "0xPlaygrounds/rig", "span_codepoints": 64, "start": 3938, "suffix": "\n }\n\n fn parameters(&self) -> serde_json::Value {\n json!({\n \"type\": \"object\",\n \"properties\": {},\n \"required\": []\n })\n }\n\n async fn call(\n &self,\n _context: &mut rig::tool::ToolContext", "target": " \"Return EMPTY-OK. This tool takes no arguments.\".to_string()"} {"bin": "64_token_ish", "content_sha256": "b0c2e7dbc7a768fb843fb80037bde82e6746cf7c4017e1c801f828cf827a45cc", "document_id": "modelcontextprotocol/java-sdk@fd004989b9484c9b81be6b03463396797b354804:mcp-test/src/main/java/io/modelcontextprotocol/client/AbstractMcpAsyncClientTests.java", "end": 24097, "example_id": "0000be41e39c796fdf1c5f3f6922db37d1fe1731ed7c84bb8ee75c1cfccf716a", "language": "java", "prefix": "lete();\n\t\t\t\t});\n\t}\n\n\t@Test\n\tvoid testInitializeWithElicitationCapability() {\n\t\tClientCapabilities capabilities = ClientCapabilities.builder().elicitation().build();\n\t\tElicitResult elicitResult = ElicitResult.builder(ElicitResult.Action.ACCEPT)\n\t\t\t.content(", "repo": "modelcontextprotocol/java-sdk", "span_codepoints": 256, "start": 23841, "suffix": "::nonNull).verifyComplete();\n\t\t\t\t});\n\t}\n\n\t@Test\n\tvoid testInitializeWithAllCapabilities() {\n\t\tvar capabilities = ClientCapabilities.builder()\n\t\t\t.experimental(Map.of(\"feature\", Map.of(\"featureFlag\", true)))\n\t\t\t.roots(true)\n\t\t\t.sampling()\n\t\t\t.build();\n\n\t\tFu", "target": "Map.of(\"foo\", \"bar\"))\n\t\t\t.build();\n\t\twithClient(createMcpTransport(),\n\t\t\t\tbuilder -> builder.capabilities(capabilities).elicitation(request -> Mono.just(elicitResult)),\n\t\t\t\tclient -> {\n\t\t\t\t\tStepVerifier.create(client.initialize()).expectNextMatches(Objects"} {"bin": "32_token_ish", "content_sha256": "ad9dcc71789a56c70695c623f4be10a42594d43505ce3a6fff323ee7743ec106", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/linker/pdb_ext/pdb_builder.c", "end": 57279, "example_id": "0000cbaf92b3f47bc0e7eb0d50ce4d5e32b6c6af53768f067889226e666767b5", "language": "c", "prefix": "sed_bucket_arr[0]) * build.compressed_bucket_count;\n U64 gsi_size = sizeof(build.header) + hash_record_arr_size + bitmap_size + compressed_bucket_arr_size;\n \n ProfBeginV(\"Reserve %M for GSI hash table\", gsi_size);\n msf_stream_reserve(", "repo": "EpicGames/raddebugger", "span_codepoints": 128, "start": 57151, "suffix": "symbols_sn, build.symbol_data.size);\n ProfEnd();\n\n ProfBegin(\"Write GSI header\");\n msf_stream_write_struct(msf, gsi_sn, &build.header);\n ProfEnd();\n\n ProfBegin(\"Write hash records [%M]\", hash_record_arr_size);\n msf_stream_write_parallel(tp, msf, gsi_", "target": "msf, gsi_sn, gsi_size);\n ProfEnd();\n\n ProfBeginV(\"Reserve %M for symbols\", build.symbol_data.size);\n msf_stream_reserve(msf, "} {"bin": "32_token_ish", "content_sha256": "20d0c254b23a5b09ef7d3c07ac1d45e381cfd1c069fdfe8a85db113539d02f3c", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/commands/store-root-selection.test.ts", "end": 19555, "example_id": "0000cec7bedcc3348c73f92ef3e17d37d4d3839bfdb11f60d592a65b5fae1a7b", "language": "typescript", "prefix": " ...env,\n XDG_DATA_HOME: path.join(tempDir, 'data-empty'),\n };\n\n const result = await runCLI(['status', '--json'], { cwd: appRepo, env: isolatedEnv });\n expect(result.exitCode).toBe(0);\n const json = parseJson(result);\n ", "repo": "Fission-AI/OpenSpec", "span_codepoints": 128, "start": 19427, "suffix": "non-interactive', () => {\n it('fails without a change name instead of opening a picker', async () => {\n createChange(storeRoot, 'store-change');\n\n const result = await runCLI(['archive', '--store', 'team-context', '--json'], {\n cwd: app", "target": "expect(json.changes).toEqual([]);\n expect(json.root.source).toBe('implicit');\n });\n });\n\n describe('archive --json is "} {"bin": "16_token_ish", "content_sha256": "7e4ac7074d0ac6faa1be629b5e4866a53f4ef03be33239de567338dd8dcffb53", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/test_pdf_tables.py", "end": 44319, "example_id": "0000d1e7694c9f47766ff7758f90c54d77f3bd3b669ca20f8bb7945cb6039d0e", "language": "python", "prefix": "has at least one column (pipe-separated content)\n for row_idx, row in enumerate(table):\n assert (\n len(row) >= 1\n ), f\"{pdf_file}: Table {table_idx}, row {row_idx} has no columns\"\n", "repo": "microsoft/markitdown", "span_codepoints": 64, "start": 44255, "suffix": " row_content = \" \".join(cell.strip() for cell in row)\n assert (\n len(row_content.strip()) > 0\n ), f\"{pdf_file}: Table {table_idx}, row {row_idx} is empty\"\n\n def test_borderless_", "target": "\n # Verify the row has non-empty content\n "} {"bin": "32_token_ish", "content_sha256": "a9f203c76c3a7fcbff7d6b23b9f36e1f3fa9fa21a02f1998003a0710ca39e608", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/core/completions/installers/powershell-installer.test.ts", "end": 20399, "example_id": "0000dc082a8f0c8673a1d5edcf6af7a9c3dcc030814e922617f10951164d4f03", "language": "typescript", "prefix": ");\n const result = await spacedInstaller.install(mockCompletionScript);\n\n expect(result.success).toBe(true);\n expect(result.installedPath).toContain('openspec powershell test');\n\n // Cleanup\n await fs.rm(spacedHomeDir, { recursive:", "repo": "Fission-AI/OpenSpec", "span_codepoints": 128, "start": 20271, "suffix": "/ Windows uses ACLs which Node.js chmod doesn't control\n it.skipIf(process.platform === 'win32')('should return failure on permission error', async () => {\n const targetPath = installer.getInstallationPath();\n const targetDir = path.dirname(ta", "target": " true, force: true });\n });\n\n // Skip on Windows: fs.chmod() on directories doesn't restrict write access on Windows\n /"} {"bin": "8_token_ish", "content_sha256": "f675d6d404617e1e1689184e44da357b529068183e076c753bbc1f3b4aab9a6f", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/_test_vectors.py", "end": 6079, "example_id": "0000dfd5628ca91e4d63717a64e69ad65c1ec21713c5ffc900d2b83fd44a4cc4", "language": "python", "prefix": "\"test_rss.xml\",\n mimetype=\"text/xml\",\n charset=\"utf-8\",\n url=None,\n must_include=[\n \"# The Official Microsoft Blog\",\n \"## Ignite 2024: Why nearly 70% of the Fortune 500 now use Microsoft 365 Copilot\",\n ", "repo": "microsoft/markitdown", "span_codepoints": 32, "start": 6047, "suffix": " absolutely true that the industry is moving incredibly fast\",\n ],\n must_not_include=[\" {\n trackEvent(\"command\", { name: \"upgrade\" });\n\n const ", "repo": "upstash/context7", "span_codepoints": 256, "start": 4352, "suffix": " return;\n }\n\n if (!info.updateAvailable) {\n log.success(`ctx7 is up to date (${pc.bold(`v${VERSION}`)})`);\n return;\n }\n\n log.blank();\n log.info(\n `Update available: ${pc.bold(`v${info.currentVersion}`)} ${pc.dim(\"->\")} ${pc.bold(`v${info.lat", "target": "info = await checkForUpdates({ force: true });\n const plan = info?.upgradePlan ?? getUpgradePlan();\n\n if (!info) {\n log.warn(\"Couldn't check for updates right now.\");\n log.info(`Try again later or run ${pc.cyan(plan.displayCommand)} manually.`);\n "} {"bin": "64_token_ish", "content_sha256": "b5605939a6cb527522511e86e34ab8818263cf47ff3b9d0ec6e4dea481e3fd65", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/engines/_browsers/_base.py", "end": 3634, "example_id": "0000ee13063f41473104bb0659f9b21c7bd534336b0f06a668f105ada4c85ca7", "language": "python", "prefix": "o cover\n \"\"\"Get a new page to use\"\"\"\n # No need to check if a page is available or not in sync code because the code blocked before reaching here till the page closed, ofc.\n ctx = context if context is not None else self.context\n ", "repo": "D4Vinci/Scrapling", "span_codepoints": 256, "start": 3378, "suffix": "_headers)\n\n if disable_resources or blocked_domains:\n page.route(\"**/*\", create_intercept_handler(disable_resources, blocked_domains))\n page_info = self.page_pool.add_page(page)\n page_info.mark_busy()\n return page_inf", "target": " assert ctx is not None, \"Browser context not initialized\"\n page = ctx.new_page()\n page.set_default_navigation_timeout(timeout)\n page.set_default_timeout(timeout)\n if extra_headers:\n page.set_extra_http_headers(extra"} {"bin": "8_token_ish", "content_sha256": "40d218b913bdf11f10a2906adf24bb1815076e549923d62c67b7a1dcb94e0ab6", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:c-cpp-book/src/ch05-data-structures.md", "end": 2319, "example_id": "0000f0f14f75a0308e863838f42d9a34b3d35f52b3ae48eaa07bdab1d818fdbb", "language": "markdown", "prefix": "ue);\n let u : (u32, bool) = (43, false);\n println!(\"{}, {}\", t.0, t.1);\n println!(\"{}, {}\", u.0, u.1);\n let (num, flag) = get_tuple(); // Tuple destructuring\n println!(\"{num}, {flag}\");\n}\n```\n\n### Rust references\n- References in Rust are roughly ", "repo": "microsoft/RustTraining", "span_codepoints": 32, "start": 2287, "suffix": " some key differences\n - It is legal to have any number of read-only (immutable) references to a variable at any point of time. A reference cannot outlive the variable scope (this is a key concept called **lifetime**; discussed in detail later)\n - On", "target": "equivalent to pointers in C with"} {"bin": "16_token_ish", "content_sha256": "35d3bac200ce605ab32a55e6d873c36bd652ca3ec57136de120b0870f450cb79", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/core/validation.test.ts", "end": 48660, "example_id": "0000fe36cc7630ff8bfd59e0cd9b1ed99807ad1def552f0378cf107da37b57f3", "language": "typescript", "prefix": " const delta = `# Test Spec\n\n## ADDED Requirements\n\n### Requirement: Notes as scenario\nThe system SHALL accept any level-4 child, matching the spec path.\n\n#### Notes\nThe spec path treats every level-4 child of a requirement as a scenario.`;\n\n const ", "repo": "Fission-AI/OpenSpec", "span_codepoints": 64, "start": 48596, "suffix": "\n const report = await new Validator(true).validateChangeDeltaSpecs(changeDir);\n\n // The spec path (parseScenarios) counts every level-4 child with content\n // as a scenario, so the delta counter deliberately does the same.\n expect(repo", "target": "changeDir = await writeChangeDelta('fidelity-h4-parity', delta);"} {"bin": "32_token_ish", "content_sha256": "08627035eea96b25c22866667d6a9dba8ee9c7094d1da26da90ce4e645a6c6f6", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/__tests__/github.test.ts", "end": 2403, "example_id": "0001003a66a029649aef2acc0d8701f8fa6f4e5ec3be81580e57104747df27c8", "language": "typescript", "prefix": "\n\n expect(execFileSync).not.toHaveBeenCalled();\n expect(result).toEqual({ status: \"ok\", skills: [] });\n expect(vi.mocked(fetch).mock.calls[0][1]).toMatchObject({\n headers: expect.objectContaining({ Authorization: \"token env-token\" }),\n });", "repo": "upstash/context7", "span_codepoints": 128, "start": 2275, "suffix": " const result = await listSkillsFromGitHub(\"upstash/context7\");\n\n expect(execFileSync).not.toHaveBeenCalled();\n expect(result).toEqual({ status: \"ok\", skills: [] });\n expect(vi.mocked(fetch).mock.calls[0][1]).toMatchObject({\n headers: expec", "target": "\n });\n\n test(\"falls back to GH_TOKEN when GITHUB_TOKEN is unset\", async () => {\n vi.stubEnv(\"GH_TOKEN\", \"gh-env-token\");\n\n "} {"bin": "32_token_ish", "content_sha256": "351fad53d9e0661c25cd3b4e6d9b3a6f281b9bad45046ce3e7c67d425c4421d3", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/test_module_misc.py", "end": 20402, "example_id": "0001014694996590991e4e9376e3cc59509f33e341c85df633c8bdffffffec04", "language": "python", "prefix": "PPTX file\n markitdown.convert(os.path.join(TEST_FILES_DIR, \"test.pptx\"))\n\n # Verify the prompt was passed to the OpenAI API for PPTX images too\n assert mock_client.chat.completions.create.called\n call_args = mock_client.chat.completions.create.", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 20274, "suffix": "test_prompt\n\n\n@pytest.mark.skipif(\n skip_llm,\n reason=\"do not run llm tests without a key\",\n)\ndef test_markitdown_llm() -> None:\n client = openai.OpenAI()\n markitdown = MarkItDown(llm_client=client, llm_model=\"gpt-4o\")\n\n result = markitdown.", "target": "call_args\n messages = call_args[1][\"messages\"]\n assert len(messages) == 1\n assert messages[0][\"content\"][0][\"text\"] == "} {"bin": "16_token_ish", "content_sha256": "a497dee4dafc4abf3240125d7c0de66f8773905518ca138257a2987dd64837dd", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/test_cu_converter.py", "end": 17747, "example_id": "000104b36b518663e0912134d36371f44ef3c447e8728199fa96cde5ea10f84e", "language": "python", "prefix": "r\n\n with patch(\"markitdown.converters._cu_converter.to_llm_input\", return_value=\"\"):\n conv.convert(\n io.BytesIO(b\"fake pdf\"),\n StreamInfo(extension=\".pdf\", mimetype=\"application/pdf\"),\n )\n\n ", "repo": "microsoft/markitdown", "span_codepoints": 64, "start": 17683, "suffix": "assert call_args.kwargs[\"analyzer_id\"] == \"prebuilt-documentSearch\"\n\n @pytest.mark.parametrize(\n (\"mimetype\", \"expected_analyzer\"),\n [\n (\"video/mp4\", \"prebuilt-videoSearch\"),\n (\"video/x-m4v\", \"prebuilt-videoSearch\"),\n", "target": "call_args = conv._client.begin_analyze_binary.call_args\n "} {"bin": "8_token_ish", "content_sha256": "b5605939a6cb527522511e86e34ab8818263cf47ff3b9d0ec6e4dea481e3fd65", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/engines/_browsers/_base.py", "end": 21967, "example_id": "000113965b6ae5f3778f5de690a09b33c14310118a8067f85aeb9c36ca80906a", "language": "python", "prefix": "ing the detected Cloudflare challenge type, if\n found. Returns None if no challenge matches.\n \"\"\"\n challenge_types = (\n \"non-interactive\",\n \"managed\",\n \"interactive\",\n )\n for ctype", "repo": "D4Vinci/Scrapling", "span_codepoints": 32, "start": 21935, "suffix": " if f\"cType: '{ctype}'\" in page_content:\n return ctype\n\n # Check if turnstile captcha is embedded inside the page (Usually inside a closed Shadow iframe)\n selector = Selector(content=page_content)\n if selector.css('scrip", "target": " in challenge_types:\n "} {"bin": "64_token_ish", "content_sha256": "4e2675f18f3be6437130d04b91e962aaa3cc5198e5c9372d24e6241b57977be8", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_doc_intel_converter.py", "end": 2662, "example_id": "00011bf120324cbfa079b0275b14017958321f2bf9e0199fa2424a040d0b598f", "language": "python", "prefix": " )\n elif type_ == DocumentIntelligenceFileType.PPTX:\n prefixes.append(\n \"application/vnd.openxmlformats-officedocument.presentationml\"\n )\n elif type_ == DocumentIntelligenceFileType.XLSX:\n ", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 2406, "suffix": "/xhtml+xml\")\n elif type_ == DocumentIntelligenceFileType.PDF:\n prefixes.append(\"application/pdf\")\n prefixes.append(\"application/x-pdf\")\n elif type_ == DocumentIntelligenceFileType.JPEG:\n prefixes.append(\"image", "target": " prefixes.append(\n \"application/vnd.openxmlformats-officedocument.spreadsheetml.sheet\"\n )\n elif type_ == DocumentIntelligenceFileType.HTML:\n prefixes.append(\"text/html\")\n prefixes.append(\"application"} {"bin": "8_token_ish", "content_sha256": "39572d3bbe924bf0194220bee109d7d5271e39aa5deb24c96318573d48bcb7ac", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/parser/test_ancestor_navigation.py", "end": 2155, "example_id": "00011dd1b5ef84cfa78a0097f8e329ac69aaa7ec50e98b96f6e058586c070726", "language": "python", "prefix": "or_returns_none_when_not_found(self, nested_page):\n \"\"\"find_ancestor() should return None if no ancestor matches\"\"\"\n target = nested_page.css(\"#target\")[0]\n result = target.find_ancestor(lambda el: el.has_class(\"nonexistent-class\"))\n ", "repo": "D4Vinci/Scrapling", "span_codepoints": 32, "start": 2123, "suffix": " def test_iterancestors_on_text_node_is_empty(self, nested_page):\n \"\"\"iterancestors() on a text node should yield nothing (not raise)\"\"\"\n text_node = nested_page.css(\"#target::text\")[0]\n ancestors = list(text_node.iterancestors())\n ", "target": " assert result is None\n\n "} {"bin": "64_token_ish", "content_sha256": "5848aafed458a6248492caf5cdd329b541eed38118fca6da78487163e2a246d3", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:lib/policy/policy_test.go", "end": 1405, "example_id": "00011e85a1cc0115905936da60a0d70aa2f25d0c4d6819bcd0ac25ab633ede00", "language": "go", "prefix": " *testing.T) {\n\t\t\t\tfin, err := os.Open(filepath.Join(\"..\", \"config\", \"testdata\", \"good\", st.Name()))\n\t\t\t\tif err != nil {\n\t\t\t\t\tt.Fatal(err)\n\t\t\t\t}\n\t\t\t\tdefer fin.Close() //nolint:errcheck\n\n\t\t\t\tctx := thothmock.WithMockThoth(t)\n\t\t\t\tif _, err := ParseConfig(ctx", "repo": "TecharoHQ/anubis", "span_codepoints": 256, "start": 1149, "suffix": "{\n\t\t\t\t\tt.Fatal(err)\n\t\t\t\t}\n\t\t\t\tdefer fin.Close() //nolint:errcheck\n\n\t\t\t\tif _, err := ParseConfig(t.Context(), fin, fin.Name(), anubis.DefaultDifficulty, \"info\", false); err != nil {\n\t\t\t\t\tt.Fatal(err)\n\t\t\t\t}\n\t\t\t})\n\t\t})\n\t}\n}\n\nfunc TestBadConfigs(t *testing.T) ", "target": ", fin, fin.Name(), anubis.DefaultDifficulty, \"info\", false); err != nil {\n\t\t\t\t\tt.Fatal(err)\n\t\t\t\t}\n\t\t\t})\n\n\t\t\tt.Run(\"without-thoth\", func(t *testing.T) {\n\t\t\t\tfin, err := os.Open(filepath.Join(\"..\", \"config\", \"testdata\", \"good\", st.Name()))\n\t\t\t\tif err != nil "} {"bin": "32_token_ish", "content_sha256": "9c282f5f84cc19c9b451d8b4d08a9ad8e651ca2b81ffc41e8aa98463cb3fd0f4", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/commands/auth.ts", "end": 637, "example_id": "0001282a42f3b25b647fffda076f3eedd359e57cc84b5cc1fc78ba1cda19b704", "language": "typescript", "prefix": "FAULT_DEVICE_POLL_INTERVAL_SECONDS,\n} from \"../utils/auth.js\";\n\nimport { trackEvent } from \"../utils/tracking.js\";\nimport { CLI_CLIENT_ID } from \"../constants.js\";\nimport { getBaseUrl } from \"../utils/api.js\";\n\nlet baseUrl = \"https://context7.com\";\n\nexport", "repo": "upstash/context7", "span_codepoints": 128, "start": 509, "suffix": "\n program\n .command(\"login\")\n .description(\"Log in to Context7\")\n .option(\"--no-browser\", \"Don't open browser automatically\")\n .action(async (options) => {\n await loginCommand(options);\n });\n\n program\n .command(\"logout\")\n .descr", "target": " function setAuthBaseUrl(url: string): void {\n baseUrl = url;\n}\n\nexport function registerAuthCommands(program: Command): void {"} {"bin": "32_token_ish", "content_sha256": "1c106518cee9163d5cb2953f0160d6fe4cecbc83a2b7dd6c904e8eb7713c52f9", "document_id": "Netflix/maestro@abdbdadf8f075b8fa488c9efb386b468c709a63c:maestro-common/src/main/java/com/netflix/maestro/models/parameter/BooleanParamDefinition.java", "end": 2633, "example_id": "000141386a968b123eb8bbb48a9543cb8c9462ed8ca92cee5296ebd99e09ece6", "language": "java", "prefix": "}\n\n @Override\n public ParamType getType() {\n return ParamType.BOOLEAN;\n }\n\n @Override\n public BooleanParamDefinition asBooleanParamDef() {\n return this;\n }\n\n @Override\n public Parameter toParameter() {\n return BooleanParameter.builder()\n ", "repo": "Netflix/maestro", "span_codepoints": 128, "start": 2505, "suffix": " .tags(getTags())\n .mode(getMode())\n .meta(getMeta())\n .build();\n }\n\n @Override\n public ParamDefinition copyAndUpdate(\n Object updatedValue,\n String expression,\n ParamMode mode,\n Map meta,\n ", "target": " .name(getName())\n .value(getValue())\n .expression(getExpression())\n .validator(getValidator())\n "} {"bin": "16_token_ish", "content_sha256": "0ade33ba18b5de7898b0031c737185a5bc944d529b58ba3661e833f930a77ade", "document_id": "cloudwego/eino@ca0441ac0bceed8945dcf7d5a18c237c924c6aa8:adk/filesystem/backend_inmemory_test.go", "end": 5587, "example_id": "000146366d8ee634ef0a0f23589de11c54e752c3b8cb7379791c78862011191d", "language": "go", "prefix": ", err := backend.LsInfo(ctx, &LsInfoRequest{Path: \"/\"})\n\t\tif err != nil {\n\t\t\tt.Fatalf(\"LsInfo failed: %v\", err)\n\t\t}\n\n\t\tfor _, info := range infos {\n\t\t\tif strings.Contains(info.Path, \"/\") {\n\t\t\t\tt.Errorf(\"Path should be filename only, got: %s\", info.Path)\n\t\t", "repo": "cloudwego/eino", "span_codepoints": 64, "start": 5523, "suffix": "(\"Expected directory name 'dir1', got: %s\", info.Path)\n\t\t\t\t}\n\t\t\t} else {\n\t\t\t\tif info.Path != \"file1.txt\" && info.Path != \"file2.txt\" {\n\t\t\t\t\tt.Errorf(\"Expected filename 'file1.txt' or 'file2.txt', got: %s\", info.Path)\n\t\t\t\t}\n\t\t\t}\n\t\t}\n\t})\n\n\tt.Run(\"Subdirector", "target": "\t}\n\t\t\tif info.IsDir {\n\t\t\t\tif info.Path != \"dir1\" {\n\t\t\t\t\tt.Errorf"} {"bin": "8_token_ish", "content_sha256": "412b98dd4784b2e2ddbd8291fd29bf324cdc15c9d99f415ba201d43125e3d5e4", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown-ocr/tests/test_xlsx_converter.py", "end": 5633, "example_id": "00014bbf9f72cdb209ce5a5e54de64cda5d73498e6b6cb23e85d4b0867182a20", "language": "python", "prefix": "\\n[End OCR]*\\n\\n\"\n \"*[Image OCR]\\nMOCK_OCR_TEXT_12345\\n[End OCR]*\\n\\n\"\n \"## Details\\n\\n\"\n \"| Detailed Metrics |\\n\"\n \"| --- |\\n\"\n \"| System Health |\\n\\n\"\n \"### Images in this sheet:\\n\\n\"\n \"*[Image OCR]\\nMOCK_", "repo": "microsoft/markitdown", "span_codepoints": 32, "start": 5601, "suffix": " \"## Summary\\n\\n\"\n \"| Quarter Summary |\\n\"\n \"| --- |\\n\"\n \"| Overall Performance |\\n\\n\"\n \"### Images in this sheet:\\n\\n\"\n \"*[Image OCR]\\nMOCK_OCR_TEXT_12345\\n[End OCR]*\"\n )\n assert _convert(\"xlsx_multiple_imag", "target": "OCR_TEXT_12345\\n[End OCR]*\\n\\n\"\n"} {"bin": "64_token_ish", "content_sha256": "ad9dcc71789a56c70695c623f4be10a42594d43505ce3a6fff323ee7743ec106", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/linker/pdb_ext/pdb_builder.c", "end": 89282, "example_id": "00015101db4aec4a7bd989d0c13ed65f090ff77751cb810305f57307e6994ee6", "language": "c", "prefix": " += 1;\n count_16[digit_16] += 1;\n }\n ProfEnd();\n\n //\n // sort on section offset\n //\n\n ProfBegin(\"Offsets\");\n U32 offset_8lo = 0;\n U32 offset_8hi = 0;\n for (U64 i = 1; i <= ArrayCount(count_8lo); i += 1) {\n U32 current_8lo = count_8lo[i - 1];", "repo": "EpicGames/raddebugger", "span_codepoints": 256, "start": 89026, "suffix": " U32 current_16 = count_16[i - 1];\n count_16[i - 1] = offset_16;\n offset_16 += current_16;\n }\n ProfEnd();\n\n count_8lo[0] = 0;\n count_8hi[0] = 0;\n count_16[0] = 0;\n\n ProfBegin(\"Order 8 Lo\");\n for (U64 i = 0; i < sc_count; i += 1) {\n PDB_Dbi", "target": "\n U32 current_8hi = count_8hi[i - 1];\n count_8lo[i - 1] = offset_8lo;\n count_8hi[i - 1] = offset_8hi;\n offset_8lo += current_8lo;\n offset_8hi += current_8hi;\n }\n\n U32 offset_16 = 0;\n for (U64 i = 1; i <= ArrayCount(count_16); i += 1) {\n "} {"bin": "32_token_ish", "content_sha256": "15c2f6475fc8450120c113d13ffb66e41a1689602376c09acdbe67d34f8c0567", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/engines/_browsers/_controllers.py", "end": 1344, "example_id": "00015603170a7be7ddcf713cc092cef91b1e0e368d304e44cc5dfb68029d61f7", "language": "python", "prefix": "wser_options\",\n \"_user_data_dir\",\n \"_headers_keys\",\n \"max_pages\",\n \"page_pool\",\n \"_max_wait_for_page\",\n \"playwright\",\n \"context\",\n )\n\n def __init__(self, **kwargs: Unpack[PlaywrightSession]):\n \"", "repo": "D4Vinci/Scrapling", "span_codepoints": 128, "start": 1216, "suffix": "directory.\n\n :param headless: Run the browser in headless/hidden (default), or headful/visible mode.\n :param disable_resources: Drop requests for unnecessary resources for a speed boost.\n Requests dropped are of type `font`, `image", "target": "\"\"A Browser session manager with page pooling, it's using a persistent browser Context by default with a temporary user profile "} {"bin": "64_token_ish", "content_sha256": "bcc202c2f3745a7c508423db9b7e6656ee7d0a7bc37f032f7ca61497e6f5a70d", "document_id": "steipete/agent-scripts@bb3688355a4c1894dd53b4ed867d1600918fadf0:skills/clawsweeper-status/scripts/clawsweeper-status.sh", "end": 3022, "example_id": "00015d53dcaa0868a7c835242732849bc891590f66c5c717751aef6ac9afe7e9", "language": "shell", "prefix": "_page=${status_page_size}\" \\\n --jq '.workflow_runs | map({\n databaseId: .id,\n name,\n event,\n status,\n conclusion,\n createdAt: .created_at,\n url: .html_url\n })' >\"$output\"\n}\n\nfetch_activity_page() {\n local endpoint_", "repo": "steipete/agent-scripts", "span_codepoints": 256, "start": 2766, "suffix": "page_size\" -eq 1 ]; then\n cat \"$error_file\" >&2\n return 1\n fi\n page_size=$((page_size / 2))\n [ \"$page_size\" -lt 1 ] && page_size=1\n done\n}\n\n: >\"$all_runs_jsonl\"\ngh run list --repo \"$clawsweeper_repo\" --limit \"$run_limit\" \\\n --json data", "target": "template=\"$1\"\n local output=\"$2\"\n local page_size=\"$activity_page_size\"\n local error_file=\"$tmpdir/activity-error\"\n\n while :; do\n if gh api \"${endpoint_template/__PAGE__/$page_size}\" >\"$output\" 2>\"$error_file\"; then\n return 0\n fi\n if [ \"$"} {"bin": "8_token_ish", "content_sha256": "7e4ac7074d0ac6faa1be629b5e4866a53f4ef03be33239de567338dd8dcffb53", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/test_pdf_tables.py", "end": 6076, "example_id": "000165c985a3d908d55e45d6a3383cf49ffad5172c69a37662d33ab7e60dde84", "language": "python", "prefix": "rs\n second_table_headers = [\n \"Category\",\n \"Unit Cost\",\n \"Total Value\",\n \"Last Audit\",\n \"Notes\",\n ]\n for header in second_table_headers:\n assert header in text_content, ", "repo": "microsoft/markitdown", "span_codepoints": 32, "start": 6044, "suffix": "}'\"\n\n # Validate second table has all expected SKUs (10 products)\n second_table_skus = [\n \"SKU-8847\",\n \"SKU-9201\",\n \"SKU-4563\",\n \"SKU-7728\",\n \"SKU-3345\",\n \"SKU-5512\",\n ", "target": "f\"Should contain header '{header"} {"bin": "64_token_ish", "content_sha256": "a9f203c76c3a7fcbff7d6b23b9f36e1f3fa9fa21a02f1998003a0710ca39e608", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/core/completions/installers/powershell-installer.test.ts", "end": 12450, "example_id": "000167092350f415d0d6b029b89213baa297a4ef33890f6427335fc8bd6f4f78", "language": "typescript", "prefix": "fs.readFile(profilePath, 'utf-8');\n expect(content).toBe('# My custom config\\nWrite-Host \"Hello\"');\n });\n\n it('should remove content between markers', async () => {\n const profilePath = installer.getProfilePath();\n await fs.mkdir(path.", "repo": "Fission-AI/OpenSpec", "span_codepoints": 256, "start": 12194, "suffix": " '# My config',\n ].join('\\n');\n\n await fs.writeFile(profilePath, initialContent);\n\n const result = await installer.removeProfileConfig();\n\n expect(result).toBe(true);\n const content = await fs.readFile(profilePath, 'utf-8');\n ", "target": "dirname(profilePath), { recursive: true });\n\n const initialContent = [\n '# OPENSPEC:START',\n '# OpenSpec completions',\n 'if (Test-Path \"/path\") {',\n ' . \"/path\"',\n '}',\n '# OPENSPEC:END',\n '',\n "} {"bin": "64_token_ish", "content_sha256": "6799887379de0dcc229a02897ab44d1ad774b2cbe6ce7cad59832e42feb0129c", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:internal/hub/heartbeat/heartbeat_test.go", "end": 6601, "example_id": "0001683de5c2998da4db924d0317f7c2b53d56c1f8d2a3adff377a8d1b202d51", "language": "go", "prefix": "Paused)\n\t\t\tassert.Equal(t, tt.expectPending, req.payload.Systems.Pending)\n\t\t})\n\t}\n}\n\nfunc newTestHub(t *testing.T) *beszeltests.TestHub {\n\tt.Helper()\n\tapp, err := beszeltests.NewTestHub(t.TempDir())\n\trequire.NoError(t, err)\n\tt.Cleanup(app.Cleanup)\n\treturn ", "repo": "henrygd/beszel", "span_codepoints": 256, "start": 6345, "suffix": " *beszeltests.TestHub, userID, name, host, status string) *core.Record {\n\tt.Helper()\n\tsystem, err := beszeltests.CreateRecord(app.App, \"systems\", map[string]any{\n\t\t\"name\": name,\n\t\t\"host\": host,\n\t\t\"port\": \"45876\",\n\t\t\"users\": []string{userID},\n\t\t\"stat", "target": "app\n}\n\nfunc createTestUser(t *testing.T, app *beszeltests.TestHub) *core.Record {\n\tt.Helper()\n\tuser, err := beszeltests.CreateUser(app.App, \"admin@example.com\", \"password123\")\n\trequire.NoError(t, err)\n\treturn user\n}\n\nfunc createTestSystem(t *testing.T, app"} {"bin": "16_token_ish", "content_sha256": "443080798372388ca8503e5d13da7c26dd80cec5ecf33246437cefd3f08219ef", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/cli/run/run.rs", "end": 20140, "example_id": "00016f52ac0b0c13e6300f3c841ecf64b573622101db8ed156559eaae5db9011", "language": "rust", "prefix": " verbose,\n success: true,\n file_modified: false,\n }\n }\n\n fn render_project_header(\n &mut self,\n project: &Project,\n failed: bool,\n show_project_headers: bool,\n ) -> Result<()> {\n ", "repo": "j178/prek", "span_codepoints": 64, "start": 20076, "suffix": " }\n\n self.reporter.suspend(|| {\n writeln!(\n self.status_printer.printer().stdout(),\n \"{} {}\",\n project_status_marker(failed),\n project.display_name().cyan().bold()\n )\n", "target": " if !show_project_headers {\n return Ok(());\n "} {"bin": "32_token_ish", "content_sha256": "092f291eeb5bb00cc23a8c942300169b7249d123bc4820e2fff0af1cff1f4d71", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/empty.tsx", "end": 2075, "example_id": "00017099ee46aa49286ac4bb0183714c0c5ab33ee328bf702a9b219d89bf4572", "language": "typescript", "prefix": "ption({ className, ...props }: React.ComponentProps<\"p\">) {\n return (\n a]:underline [&>a]:underline-offset-4 [&>a:hover]:text-primary\",\n ", "repo": "OpenCut-app/OpenCut", "span_codepoints": 128, "start": 1947, "suffix": ") {\n return (\n \n )\n}\n\nexport {\n Empty,\n Empt", "target": " className\n )}\n {...props}\n />\n )\n}\n\nfunction EmptyContent({ className, ...props }: React.ComponentProps<\"div\">"} {"bin": "8_token_ish", "content_sha256": "e6a3afe46f95ebf1b7e2059c7f0f07a9f8699cae7d7f775def63b542b03ec689", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/answer.sh", "end": 12631, "example_id": "0001712825d1b6446f145e2bdc1ff8f3c97e7d145bbaa58bf4bb0e135a700835", "language": "shell", "prefix": "fi\n\n if ! tmp=$(mktemp -p /run/assets \".${id}.XXXXXX\"); then\n error \"Failed to create a temporary $type answer file!\"\n return 1\n fi\n\n local expressions\n\n if [ \"$type\" = \"evaluation\" ]; then\n expressions=(\n -e '/.*<\\/ProductKey", "repo": "dockur/windows", "span_codepoints": 32, "start": 12599, "suffix": "\\/ProductKey>/d'\n )\n else\n expressions=(\n -e '/.*<\\/InstallFrom>/d'\n -e '/.*<\\/ProductKey>/d'\n -e '//,/<\\/InstallFrom>/d'\n -e '//,/<\\/ProductKey>/d'\n )\n fi\n\n if ! sed \"${expr", "target": ">/d'\n -e '//,/<"} {"bin": "32_token_ish", "content_sha256": "a9cbe88ad1942abf948ad9f3ca3dc064f9d63ed3a0fe95cbecc794f45e2662c9", "document_id": "unitycatalog/unitycatalog@ed504deea31b30c3e7d27e360372077cce04a509:server/src/test/java/io/unitycatalog/server/utils/PopulateTestDatabase.java", "end": 11146, "example_id": "000172aa9e564556ec61b54a66db7ca8ea064c9e9855002a82eb224fd117f9f0", "language": "java", "prefix": "n session = factory.openSession()) {\n Transaction tx = session.beginTransaction();\n session.persist(externalTableInfoDAO);\n session.persist(p11);\n session.persist(p21);\n tx.commit();\n }\n\n // Create external partitioned table.", "repo": "unitycatalog/unitycatalog", "span_codepoints": 128, "start": 11018, "suffix": "/ - first_name\n // - age\n // - country (partition column)\n // All the data in this table are fake and were generated by tool Faker.\n // Partition column has three unique values / partitions.\n // Data is stored in DELTA format.\n System.out", "target": "\n // This table represents an example of how Unity handles partitioned tables.\n // The table contains three columns:\n /"} {"bin": "8_token_ish", "content_sha256": "bff1a37c65382e95aaf6b69ce0941b4fb00e070421ae28b386642f1d79cb78fd", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/mcp/src/index.ts", "end": 19728, "example_id": "0001739d015ba3bcadf92562d7a7f3f98116b9699e3013f3ac1d69c2c04b6347", "language": "typescript", "prefix": " // headers, even though the per-tool timeout is much higher.\n const transport = new StreamableHTTPServerTransport({\n sessionIdGenerator: undefined,\n enableJsonResponse: false,\n });\n\n const server = createMcpServer();", "repo": "upstash/context7", "span_codepoints": 32, "start": 19696, "suffix": "\n transport.close();\n server.close();\n });\n\n installTransportArgAliasing(transport);\n await server.connect(transport);\n\n await requestContext.run(context, async () => {\n await transport.handleRequest(r", "target": "\n res.on(\"close\", () => {"} {"bin": "32_token_ish", "content_sha256": "ac0c1e1489a77d30b7183e060e379f5cbba13f9b6a8beb0cae1a5990ec5ca00c", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/llm/ollama/chat.py", "end": 2001, "example_id": "000175a91c1b6d96ff044222fe9f410a4e8407f9c3e849a90954b84912bdb192", "language": "python", "prefix": "tion[str]: ...\n\n\t@overload\n\tasync def ainvoke(self, messages: list[BaseMessage], output_format: type[T], **kwargs: Any) -> ChatInvokeCompletion[T]: ...\n\n\tasync def ainvoke(\n\t\tself, messages: list[BaseMessage], output_format: type[T] | None = None, **kwargs", "repo": "browser-use/browser-use", "span_codepoints": 128, "start": 1873, "suffix": "messages)\n\n\t\ttry:\n\t\t\tif output_format is None:\n\t\t\t\tresponse = await self.get_client().chat(\n\t\t\t\t\tmodel=self.model,\n\t\t\t\t\tmessages=ollama_messages,\n\t\t\t\t\toptions=self.ollama_options,\n\t\t\t\t)\n\n\t\t\t\treturn ChatInvokeCompletion(completion=response.message.content o", "target": ": Any\n\t) -> ChatInvokeCompletion[T] | ChatInvokeCompletion[str]:\n\t\tollama_messages = OllamaMessageSerializer.serialize_messages("} {"bin": "64_token_ish", "content_sha256": "f11925640560580736567c2764d22f2a3b38131f8a648ba9f694fa0e6f39d437", "document_id": "DataWithBaraa/sql-data-warehouse-project@92406686380cde6eca208c8b43e6fa40ecd26344:tests/quality_checks_silver.sql", "end": 3429, "example_id": "0001775bb70543fc89ed13821fe3f7b64ec5b3b2c394996c08877f61a5b45c47", "language": "sql", "prefix": "t \n OR sls_order_dt > sls_due_dt;\n\n-- Check Data Consistency: Sales = Quantity * Price\n-- Expectation: No Results\nSELECT DISTINCT \n sls_sales,\n sls_quantity,\n sls_price \nFROM silver.crm_sales_details\nWHERE sls_sales != sls_quantity * sls_price\n ", "repo": "DataWithBaraa/sql-data-warehouse-project", "span_codepoints": 256, "start": 3173, "suffix": "=====\n-- Checking 'silver.erp_cust_az12'\n-- ====================================================================\n-- Identify Out-of-Range Dates\n-- Expectation: Birthdates between 1924-01-01 and Today\nSELECT DISTINCT \n bdate \nFROM silver.erp_cust_az12\nWH", "target": " OR sls_sales IS NULL \n OR sls_quantity IS NULL \n OR sls_price IS NULL\n OR sls_sales <= 0 \n OR sls_quantity <= 0 \n OR sls_price <= 0\nORDER BY sls_sales, sls_quantity, sls_price;\n\n-- ==============================================================="} {"bin": "16_token_ish", "content_sha256": "a1b49fc9a53a294c1dce664aadc988e730fa31a69962fb26bf28faeba060eea0", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/spiders/spider.py", "end": 11762, "example_id": "000177a09b46001bbc4ffbcc85129b78c6775fee0f77d4ba39905b7404ef0775", "language": "python", "prefix": " one as they are scraped.\n Access `spider.stats` during iteration for real-time statistics.\n\n Note: SIGINT handling for pause/resume is not available in stream mode.\n \"\"\"\n token = set_logger(self.logger)\n try:\n ", "repo": "D4Vinci/Scrapling", "span_codepoints": 64, "start": 11698, "suffix": "crawldir, self._interval)\n async for item in self._engine:\n yield item\n finally:\n self._engine = None\n reset_logger(token)\n if self.log_file:\n for handler in self.logger.handl", "target": " self._engine = CrawlerEngine(self, self._session_manager, self."} {"bin": "64_token_ish", "content_sha256": "3f0e691dc253a9f329dc0a630983dc2ea5bc1c1f9814d71ea50a66c7451a0dd2", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/_markitdown.py", "end": 5533, "example_id": "00017b1d02d1c4743fbc3129855d720001a6bb61c6a57d3d6468a1746beea603", "language": "python", "prefix": " \"/usr/bin\",\n \"/usr/local/bin\",\n \"/opt\",\n \"/opt/bin\",\n \"/opt/local/bin\",\n \"/opt/homebrew/bin\",\n ", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 5277, "suffix": " # Register converters for successful browsing operations\n # Later registrations are tried first / take higher priority than earlier registrations\n # To this end, the most specific converters should appear below the most generi", "target": " \"C:\\\\Windows\\\\System32\",\n \"C:\\\\Program Files\",\n \"C:\\\\Program Files (x86)\",\n ]\n ):\n self._exiftool_path = candidate\n\n "} {"bin": "64_token_ish", "content_sha256": "027a493bd355747f514515346e6f509b641e2e4b44923b5ba82ba5fac582a8cd", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/security/test_domain_filtering.py", "end": 12890, "example_id": "000180a1d5f05bb2521618cf29f2bb4c4ba94ffbb10c92d513f9432753bc2d46", "language": "python", "prefix": "wser.watchdogs.security_watchdog import SecurityWatchdog\n\n\t\tbrowser_profile = BrowserProfile(allowed_domains=['example.com'], headless=True, user_data_dir=None)\n\t\tbrowser_session = BrowserSession(browser_profile=browser_profile)\n\t\tevent_bus = EventBus()\n\t\t", "repo": "browser-use/browser-use", "span_codepoints": 256, "start": 12634, "suffix": "watchdog._is_root_domain('site.net') is True\n\n\t\t# Subdomains (more than 1 dot) - should return False\n\t\tassert watchdog._is_root_domain('www.example.com') is False\n\t\tassert watchdog._is_root_domain('mail.example.com') is False\n\t\tassert watchdog._is_root_dom", "target": "watchdog = SecurityWatchdog(browser_session=browser_session, event_bus=event_bus)\n\n\t\t# Simple root domains (1 dot) - should return True\n\t\tassert watchdog._is_root_domain('example.com') is True\n\t\tassert watchdog._is_root_domain('test.org') is True\n\t\tassert "} {"bin": "64_token_ish", "content_sha256": "0f13b1a10d5b81f30188542997d570c2e1b7c6514cc862fae1a74145aefb8d8f", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/spiders/request.py", "end": 4138, "example_id": "0001811e37ea493f535528d8c25796a94d260f0bc98281a3f2e18ec5ee56b7b8", "language": "python", "prefix": " tuple(sorted(filtered_kwargs.items()))\n\n if include_headers:\n headers = self._session_kwargs.get(\"headers\") or self._session_kwargs.get(\"extra_headers\") or {}\n processed_headers = {}\n # Some header normalization\n ", "repo": "D4Vinci/Scrapling", "span_codepoints": 256, "start": 3882, "suffix": ", option=orjson.OPT_SORT_KEYS), usedforsecurity=False).digest()\n self._fp = fp\n return fp\n\n def __repr__(self) -> str:\n callback_name = getattr(self.callback, \"__name__\", None) or \"None\"\n return f\" = str::from_utf8(&output.stdout)?\n .lines()\n .filter_map(parse_toolchain_line)\n .collect();\n\n let infos: Vec = futures_util::stream::iter(entries)\n .map(async move |(name, path)| toolchain", "repo": "j178/prek", "span_codepoints": 256, "start": 7213, "suffix": " None\n }\n })\n .collect()\n .await;\n\n Ok(infos)\n }\n\n /// List system-installed Rust toolchains.\n pub(crate) async fn list_system_toolchains(&self) -> Result> {\n ", "target": "_info(name, path).await)\n .buffer_unordered(8)\n .filter_map(async move |result| match result {\n Ok(info) => Some(info),\n Err(e) => {\n warn!(\"Skipping invalid toolchain: {e:#}\");\n "} {"bin": "64_token_ish", "content_sha256": "e9a7e9eb6b087e60e2fed07e61370fbd1bfca76b16bb95c86170cffedcebff96", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:benchmarks/robustness-audit.js", "end": 9044, "example_id": "00018c19ec6cd6268ff622433c230273c65d27194fc99ef1c2c01ba172f8ddaa", "language": "javascript", "prefix": " and \"@\" in a' },\n { name: 'url', arity: 1, names: ['validate_url', 'is_valid_url', 'is_url', 'validate', 'is_valid'],\n prompt: 'Write a Python function that validates whether a string is a valid HTTP or HTTPS URL.',\n cases: [[['https://example.com'", "repo": "DietrichGebert/ponytail", "span_codepoints": 256, "start": 8788, "suffix": " p = urlparse(u)\\n return p.scheme in (\"http\",\"https\") and bool(p.netloc)',\n bad: 'from urllib.parse import urlparse\\ndef validate_url(u):\\n return bool(urlparse(u))' },\n { name: 'creditcard', arity: 1, names: ['validate_credit_card', 'is_valid_", "target": "], true], [['http://a.b/c'], true], [['https://x.io/p?q=1'], true], [['garbage'], false], [[''], false], [['example.com'], false], [['ftp://example.com'], false], [['http://'], false]],\n good: 'from urllib.parse import urlparse\\ndef validate_url(u):\\n "} {"bin": "16_token_ish", "content_sha256": "8546a18bbe8a04fd2d86495a665834aeb952f55c860586210e5f03b43ed95298", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/context-menu.tsx", "end": 8047, "example_id": "000194e11e98367a2ae854875177155019195656bb34855ce2de06a7b759ec20", "language": "typescript", "prefix": "e)}\n {...props}\n />\n )\n}\n\nfunction ContextMenuShortcut({\n className,\n ...props\n}: React.ComponentProps<\"span\">) {\n return (\n \n )\n}\n\nexport {\n ContextMenu,\n ContextMenuTrigger,\n ContextMenuContent,\n ContextMenuItem,\n ContextMenuCheckboxItem,\n ContextMenuRadioItem,\n ContextMenuLabel,\n ContextMenuSeparator,\n C", "target": "text-muted-foreground group-focus/context-menu-item:text-accent-"} {"bin": "8_token_ish", "content_sha256": "c7b29f83a2da158b5ba141012a008e84236cc3111f22ab4303bf9d49bbdeb7e9", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:crates/rig-core/src/memory.rs", "end": 17104, "example_id": "000196ae625e1c188bef211ccbd45fb06f6d0747f15d06d9c601fe1ffdd245cf", "language": "rust", "prefix": "filter_transforms_loaded_messages() {\n let mem = InMemoryConversationMemory::new()\n .with_filter(|msgs: Vec| msgs.into_iter().rev().take(2).collect());\n\n mem.append(\n \"c\",\n vec![user(\"1\"), assistant(\"", "repo": "0xPlaygrounds/rig", "span_codepoints": 32, "start": 17072, "suffix": "\n )\n .await\n .unwrap();\n\n let loaded = mem.load(\"c\").await.unwrap();\n assert_eq!(loaded.len(), 2, \"filter should retain only 2 messages\");\n }\n\n #[tokio::test]\n async fn arc_conversation_memory_forwards_to_inner()", "target": "2\"), user(\"3\"), assistant(\"4\")],"} {"bin": "64_token_ish", "content_sha256": "443080798372388ca8503e5d13da7c26dd80cec5ecf33246437cefd3f08219ef", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/cli/run/run.rs", "end": 17329, "example_id": "00019a2493031a63656d1fc1b4f92d8efb41c709fe8d74beb7453705ca5e1a54", "language": "rust", "prefix": " .run_project_level(project_runs, input, file_index, clean_baseline)\n .await?;\n let mut stop_after_level = false;\n\n for project_result in project_results {\n stop_after_level |= session.finish_project_run(project", "repo": "j178/prek", "span_codepoints": 256, "start": 17073, "suffix": "impl<'a> ProjectDepthGroups<'a> {\n fn new(projects: &'a [Arc]) -> Self {\n Self { projects, idx: 0 }\n }\n}\n\nimpl<'a> Iterator for ProjectDepthGroups<'a> {\n type Item = &'a [Arc];\n\n fn next(&mut self) -> Option", "target": "_result, show_project_headers)?;\n }\n\n if stop_after_level {\n break;\n }\n }\n\n session.finish(workspace, show_diff_on_failure).await\n}\n\nstruct ProjectDepthGroups<'a> {\n projects: &'a [Arc],\n idx: usize,\n}\n\n"} {"bin": "8_token_ish", "content_sha256": "3f0e691dc253a9f329dc0a630983dc2ea5bc1c1f9814d71ea50a66c7451a0dd2", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/_markitdown.py", "end": 11281, "example_id": "00019ac49a0d512885fd05258c8106e572ec35262bb923fe0845988ab9826967", "language": "python", "prefix": " return self.convert_uri(source, stream_info=stream_info, **_kwargs)\n else:\n return self.convert_local(source, stream_info=stream_info, **kwargs)\n # Path object\n elif isinstance(source, Path):\n ", "repo": "microsoft/markitdown", "span_codepoints": 32, "start": 11249, "suffix": ", stream_info=stream_info, **kwargs)\n # Request response\n elif isinstance(source, requests.Response):\n return self.convert_response(source, stream_info=stream_info, **kwargs)\n # Binary stream\n elif (\n hasat", "target": "return self.convert_local(source"} {"bin": "8_token_ish", "content_sha256": "d5426d932b8f49c499da40a69b8b75b3f66055136cc701832bb40b9d33221fd6", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown-ocr/src/markitdown_ocr/_pdf_converter_with_ocr.py", "end": 12866, "example_id": "00019e2349eef4d6ec801403ef25b46e9b1357d34fcebede68e6a840877acfce", "language": "python", "prefix": " page_num: Page number (1-indexed)\n\n Returns:\n List of image info dicts with 'stream', 'bbox', 'name', 'y_pos'\n \"\"\"\n images = []\n\n try:\n pdf_bytes.seek(0)\n with pdfplumber.open(pdf_bytes) as pdf:", "repo": "microsoft/markitdown", "span_codepoints": 32, "start": 12834, "suffix": "len(pdf.pages):\n page = pdf.pages[page_num - 1] # 0-indexed\n images = _extract_images_from_page(page)\n except Exception:\n pass\n\n # Sort by vertical position (top to bottom)\n images.sort", "target": "\n if page_num <= "} {"bin": "8_token_ish", "content_sha256": "cb3d208f51c444f5138a34fef6e37356f75471e10c238df4ee018e7b3d896a6c", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/test_browser_use_skill_install_docs.py", "end": 2848, "example_id": "00019eab1322d7d6ca994bad03353a06b272d0ca7b2eec7923e9ae5bd1b25ac7", "language": "python", "prefix": "\n\tenv['PYTHONPATH'] = os.pathsep.join(part for part in (str(ROOT), env.get('PYTHONPATH', '')) if part)\n\tenv['UV_TOOL_INSTALL_ARGS_FILE'] = str(uv_args)\n\n\tresult = subprocess.run(\n\t\t[sys.executable, '-m', 'browser_use.cli', 'skill', 'install'],\n\t\tcwd=ROOT,\n", "repo": "browser-use/browser-use", "span_codepoints": 32, "start": 2816, "suffix": ",\n\t\ttext=True,\n\t\ttimeout=10,\n\t)\n\n\tassert result.returncode == 0, result.stderr\n\tassert uv_args.read_text(encoding='utf-8') == 'tool install --python 3.12 --upgrade --force browser-use'\n\texpected = (\n\t\t'---\\n'\n\t\t'name: browser-use\\n'\n\t\t'description: \"Direct", "target": "\t\tenv=env,\n\t\tcapture_output=True"} {"bin": "16_token_ish", "content_sha256": "a9f203c76c3a7fcbff7d6b23b9f36e1f3fa9fa21a02f1998003a0710ca39e608", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/core/completions/installers/powershell-installer.test.ts", "end": 25476, "example_id": "0001a0c3df3128bcd1fd6231bd56ccba20580d693948557540ff72c09dff082c", "language": "typescript", "prefix": "ofilePath, '# My profile\\n');\n\n const result = await installer.configureProfile(mockScriptPath);\n expect(result).toBe(true);\n\n const raw = await fs.readFile(profilePath);\n expect(raw[0]).toBe(0xef);\n expect(raw[1]).toBe(0xbb);\n ", "repo": "Fission-AI/OpenSpec", "span_codepoints": 64, "start": 25412, "suffix": "(3).toString('utf-8');\n expect(content).toContain('# My profile');\n expect(content).toContain('# OPENSPEC:START');\n });\n\n it('should skip UTF-16 BE profile and leave it unchanged', async () => {\n delete process.env.OPENSPEC_NO_AUTO_CON", "target": " expect(raw[2]).toBe(0xbf);\n\n const content = raw.subarray"} {"bin": "32_token_ish", "content_sha256": "b3ad41b0689c17cd7c1de3e0a08f5011bda7d693370008413492e2125b91773f", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:agent/disk_test.go", "end": 4610, "example_id": "0001a87218e35b65426753fb2b2ca2830c550ed06deaf5d12695f9c47f70072e", "language": "go", "prefix": "\tdiskIoCounters: map[string]disk.IOCountersStat{\n\t\t\t\t\t\"ada0\": {Name: \"ada0\", ReadBytes: 1000, WriteBytes: 1000},\n\t\t\t\t},\n\t\t\t},\n\t\t)\n\n\t\tassert.True(t, ok)\n\t\tassert.Equal(t, \"ada0\", key)\n\t\tassert.True(t, stats.Root)\n\t\tassert.Equal(t, \"/\", stats.Mountpoint)\n\t})", "repo": "henrygd/beszel", "span_codepoints": 128, "start": 4482, "suffix": "]*system.FsStats{},\n\t\t\t\"overlay\",\n\t\t\t\"/\",\n\t\t\ttrue,\n\t\t\t\"\",\n\t\t\tfsRegistrationContext{\n\t\t\t\tfilesystem: \"nvme0n1p2\",\n\t\t\t\tisWindows: false,\n\t\t\t\tdiskIoCounters: map[string]disk.IOCountersStat{\n\t\t\t\t\t\"nvme0n1\": {Name: \"nvme0n1\", ReadBytes: 1000, WriteBytes: 1000}", "target": "\n\n\tt.Run(\"uses filesystem setting as root fallback\", func(t *testing.T) {\n\t\tkey, _, ok := registerFilesystemStats(\n\t\t\tmap[string"} {"bin": "16_token_ish", "content_sha256": "37dea31db4757ee41e18bf6e82526d2c4e421cd01cf03ba56b2f4a0f64b26cc7", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/pdb/pdb_parse.c", "end": 1595, "example_id": "0001aeb9b55ef5f0b7c749096853185a783cb0edfa9582e5db10e073a4d63f76", "language": "c", "prefix": "names_len_off + 4;\n U32 names_base_opl = names_base_off + names_len;\n \n // table layout: hash table\n U32 hash_table_count_off = names_base_opl;\n U32 hash_table_max_off = hash_table_count_off + 4;\n \n U32 hash_table_count =", "repo": "EpicGames/raddebugger", "span_codepoints": 64, "start": 1531, "suffix": " 4 <= data.size){\n hash_table_count = *(U32*)(data.str + hash_table_count_off);\n hash_table_max = *(U32*)(data.str + hash_table_max_off);\n }\n \n // table layout: words\n U32 num_present_words_off = hash_table_max_off + 4;\n ", "target": " 0;\n U32 hash_table_max = 0;\n if (hash_table_max_off +"} {"bin": "64_token_ish", "content_sha256": "9efd8c49e5b4bf7132f59fb450ea26db8ef4b27ada37df95ae1e1761fd8231d0", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/core/shell.py", "end": 25642, "example_id": "0001b1298a3165d4fa6e19ce5eaa6e6fa12b102ec258772e47a4c2d119c92a61", "language": "python", "prefix": "lse cast(Selectors, page.css(css_selector))\n for page in pages:\n match extraction_type:\n case \"markdown\":\n yield cls._convert_to_markdown(page.html_content)\n case \"html\"", "repo": "D4Vinci/Scrapling", "span_codepoints": 256, "start": 25386, "suffix": " )\n for s in (\n \"\\n\",\n \"\\r\",\n \"\\t\",\n \" \",\n ):\n # Remove consecutive", "target": ":\n yield page.html_content\n case \"text\":\n txt_content = page.get_all_text(\n strip=True, ignore_tags=(\"script\", \"style\", \"noscript\", \"svg\", \"iframe\")\n "} {"bin": "16_token_ish", "content_sha256": "f759cbf40824426107b527127b7a79b6efb613fc85f0c162d4a24cad7789d7ef", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/__main__.py", "end": 3679, "example_id": "0001b154b03f755e757ff38d9424e634c36d75371b62d83c99ce2eb1ccffde4d", "language": "python", "prefix": " parser.add_argument(\n \"--list-plugins\",\n action=\"store_true\",\n help=\"List installed 3rd-party plugins. Plugins are loaded when using the -p or --use-plugin option.\",\n )\n\n parser.add_argument(\n \"--keep-data-uris\",\n ", "repo": "microsoft/markitdown", "span_codepoints": 64, "start": 3615, "suffix": "encoded images) in the output. By default, data URIs are truncated.\",\n )\n\n parser.add_argument(\"filename\", nargs=\"?\")\n args = parser.parse_args()\n\n # Parse the extension hint\n extension_hint = args.extension\n if extension_hint is not None", "target": " action=\"store_true\",\n help=\"Keep data URIs (like base64-"} {"bin": "32_token_ish", "content_sha256": "24179f119e6fef8863e7a291d43e708a7917286c42c8682df5d5d3302f4ab8c2", "document_id": "steipete/agent-scripts@bb3688355a4c1894dd53b4ed867d1600918fadf0:skills/npm/scripts/reserve-packages.sh", "end": 1410, "example_id": "0001b189a89a84bd87332fdf2c440f8b60620926ba70253305beb4477f2f89ec", "language": "shell", "prefix": "t}\"\n shift 2\n ;;\n --item)\n ITEM=\"${2:?missing item}\"\n ITEM_EXPLICIT=1\n shift 2\n ;;\n --account)\n ACCOUNT=\"${2:?missing account}\"\n shift 2\n ;;\n -h | --help)\n usage\n exit 0\n ;;\n --)\n ", "repo": "steipete/agent-scripts", "span_codepoints": 128, "start": 1282, "suffix": ";;\n *)\n PACKAGES+=(\"$1\")\n shift\n ;;\n esac\ndone\n\n# Desktop fallback keeps the legacy item name unless one was named explicitly.\nif [ -n \"$ACCOUNT\" ] && [ \"$ITEM_EXPLICIT\" -eq 0 ]; then\n ITEM=\"npmjs\"\nfi\n\nif [ \"${#PACKAGES[@]}\" -eq 0 ]; th", "target": " shift\n PACKAGES+=(\"$@\")\n break\n ;;\n -*)\n echo \"unknown flag: $1\" >&2\n usage >&2\n exit 2\n "} {"bin": "16_token_ish", "content_sha256": "b3a0c69c32b557a7b1dd00b93eb466752d5ffbc6da40065dfebc1d6d27b25795", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/1688/download.js", "end": 1731, "example_id": "0001b9d95a79302ab075a10a4a722719875867d7f61421302470ce0ee53dc441", "language": "javascript", "prefix": " name: 'download',\n access: 'read',\n description: '批量下载 1688 商品页可提取的图片和视频素材',\n domain: 'www.1688.com',\n strategy: Strategy.COOKIE,\n args: [\n {\n name: 'input',\n required: true,\n positional: true,\n ", "repo": "jackwener/OpenCLI", "span_codepoints": 64, "start": 1667, "suffix": "\n { name: 'output', default: './1688-downloads', help: '输出目录' },\n ],\n columns: ['index', 'type', 'status', 'size'],\n func: async (page, kwargs) => {\n const assets = await extractAssetsForInput(page, String(kwargs.input ?? ''));\n ", "target": " help: '1688 商品 URL 或 offer ID(如 887904326744)',\n },"} {"bin": "32_token_ish", "content_sha256": "b599f78a00beae75851f82323500929bc374b82d8b697e18a7f33febf782c222", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/xiaoe/courses.js", "end": 3985, "example_id": "0001c201cc003ed80057ffef4ee68162229cfe989b17051832f21631f9df764f", "language": "javascript", "prefix": "ts;\n})()`;\n}\n\nasync function getXiaoeCourses(page) {\n let rows;\n try {\n await page.goto('https://study.xiaoe-tech.com/', { waitUntil: 'load', settleMs: 8000 });\n rows = await page.evaluate(buildCoursesScript());\n } catch (error) {\n ", "repo": "jackwener/OpenCLI", "span_codepoints": 128, "start": 3857, "suffix": " `Failed to list xiaoe courses: ${message}`,\n 'page may not have rendered or auth may be required',\n );\n }\n if (!Array.isArray(rows) || rows.length === 0) {\n throw new EmptyResultError(\n 'xiaoe/courses',\n ", "target": " const message = error instanceof Error ? error.message : String(error);\n throw new CommandExecutionError(\n "} {"bin": "32_token_ish", "content_sha256": "4a917370dfb68dcf981252756ee4ff2e2915a27993a583dd0d43e61977a62609", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:src/commands/store.ts", "end": 16282, "example_id": "0001c5c640409b6332fc0139f537ce593ce4294398e982400fac2668307c1ad3", "language": "typescript", "prefix": " error\n );\n }\n }\n\n async unregister(id: string, options: StoreJsonOptions = {}): Promise {\n try {\n const payload = toCleanupOutput(await unregisterStore({ id }));\n\n if (options.json) {\n printJson(payload);\n ", "repo": "Fission-AI/OpenSpec", "span_codepoints": 128, "start": 16154, "suffix": " options.json,\n { store: null, registry: null, files: null, status: [] },\n error\n );\n }\n }\n\n async remove(id: string, options: StoreRemoveOptions = {}): Promise {\n try {\n const target = await prepareStoreCleanup({ id ", "target": " return;\n }\n\n printCleanupHuman('Unregistered store', payload);\n } catch (error) {\n this.handleFailure(\n "} {"bin": "8_token_ish", "content_sha256": "a2aed2930510f336d4c741954ba889652e6d51fa7896e117c1928cc2f08be559", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/languages/python/uv.rs", "end": 8561, "example_id": "0001d8623d53091e1c2247271d12e146d458cff3a0d04ffd9be7a2f178966f1e", "language": "rust", "prefix": "e'll fall back to simple API approach\n _ => return self.install_from_simple_api(store, target, source).await,\n };\n\n debug!(\"Fetching uv metadata from: {}\", api_url);\n let response = REQWEST_CLIENT\n .get(&api_url)\n", "repo": "j178/prek", "span_codepoints": 32, "start": 8529, "suffix": "/*\")\n .send()\n .await\n .and_then(reqwest::Response::error_for_status)\n .with_context(|| format!(\"Failed to fetch uv metadata from PyPI at {api_url}\"))?;\n\n let metadata: serde_json::Value = response.json().", "target": " .header(\"Accept\", \"*"} {"bin": "16_token_ish", "content_sha256": "a4cb101371d1dc25246d0a71f0c6e85ec2291d0c3c9fa0a9dbaf267bc5f38914", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown-ocr/src/markitdown_ocr/_pptx_converter_with_ocr.py", "end": 5472, "example_id": "0001dfb8590035c6892b1a5f377ccd73b50b5a2cdd887b56d88802069767a037", "language": "python", "prefix": "shape.has_text_frame:\n if shape == title:\n md_content += \"# \" + shape.text.lstrip() + \"\\\\n\"\n else:\n md_content += shape.text + \"\\\\n\"\n\n # Group Shapes\n ", "repo": "microsoft/markitdown", "span_codepoints": 64, "start": 5408, "suffix": "GROUP:\n sorted_shapes = sorted(\n shape.shapes,\n key=lambda x: (\n float(\"-inf\") if not x.top else x.top,\n float(\"-inf\") if not x.left else", "target": " if shape.shape_type == pptx.enum.shapes.MSO_SHAPE_TYPE."} {"bin": "8_token_ish", "content_sha256": "ad9dcc71789a56c70695c623f4be10a42594d43505ce3a6fff323ee7743ec106", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/linker/pdb_ext/pdb_builder.c", "end": 84779, "example_id": "0001e20c114eecd5a7fdba265b3e8b7a1c3296bb2b5d55f46c4164aed065f7fa", "language": "c", "prefix": "ush_array_no_zero(arena, U16, mod_list.count);\n task.source_file_name_offset_arr = source_file_name_offsets_arr;\n tp_for_parallel(tp, 0, mod_arr_count, dbi_build_file_info_assign_file_offsets_task, &task);\n\n // pack strings\n String8 string_buffer = cv_", "repo": "EpicGames/raddebugger", "span_codepoints": 32, "start": 84747, "suffix": ", string_ht);\n\n // layout file info sections\n String8List file_info_srl = {0};\n str8_serial_begin(arena, &file_info_srl);\n str8_serial_push_u16(arena, &file_info_srl, mod_count16);\n str8_serial_push_u16(arena, &file_info_srl, total_source_file_count16", "target": "pack_string_hash_table(arena, tp"} {"bin": "32_token_ish", "content_sha256": "5a5272472557744e1616060b62948523e7c1710eee94906d9d0c4d369bdaa756", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/calendar.tsx", "end": 6897, "example_id": "0001e22249f32dc42c0e36c74d263473a2556f9bc9dd7db71fcb9fff45476994", "language": "typescript", "prefix": "\n className,\n day,\n modifiers,\n locale,\n ...props\n}: React.ComponentProps & { locale?: Partial }) {\n const defaultClassNames = getDefaultClassNames()\n\n const ref = React.useRef(null)\n React.useEffect(() ", "repo": "OpenCut-app/OpenCut", "span_codepoints": 128, "start": 6769, "suffix": " size=\"icon\"\n data-day={day.date.toLocaleDateString(locale?.code)}\n data-selected-single={\n modifiers.selected &&\n !modifiers.range_start &&\n !modifiers.range_end &&\n !modifiers.range_middle\n }\n data-range-", "target": "=> {\n if (modifiers.focused) ref.current?.focus()\n }, [modifiers.focused])\n\n return (\n \n TimeTriggerWithWatermark.builder()\n .lastTriggerTimestamp(System.currentTimeMillis())\n .timeTrigger(t)\n "} {"bin": "64_token_ish", "content_sha256": "ad49a50cdc019bba871bad85c97b1b6272cb8c44739f289d6010239be2069cd8", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/filesystem/file_system.py", "end": 9589, "example_id": "0001eca662f9b1f4c07e0ae94b1e6696aebf030c377f1bb9632a6a3b694058ee", "language": "python", "prefix": "ion(self) -> str:\n\t\treturn 'html'\n\n\nclass XmlFile(BaseFile):\n\t\"\"\"XML file implementation\"\"\"\n\n\t@property\n\tdef extension(self) -> str:\n\t\treturn 'xml'\n\n\nclass FileSystemState(BaseModel):\n\t\"\"\"Serializable state of the file system\"\"\"\n\n\tfiles: dict[str, dict[str", "repo": "browser-use/browser-use", "span_codepoints": 256, "start": 9333, "suffix": "Path, create_default_files: bool = True):\n\t\t# Handle the Path conversion before calling super().__init__\n\t\tself.base_dir = Path(base_dir) if isinstance(base_dir, str) else base_dir\n\t\tself.base_dir.mkdir(parents=True, exist_ok=True)\n\n\t\t# Create and use a de", "target": ", Any]] = Field(default_factory=dict) # full filename -> file data\n\tbase_dir: str\n\textracted_content_count: int = 0\n\n\nclass FileSystem:\n\t\"\"\"Enhanced file system with in-memory storage and multiple file type support\"\"\"\n\n\tdef __init__(self, base_dir: str | "} {"bin": "64_token_ish", "content_sha256": "69b3a396d37da516b901d0b77db7129d10cdb9cd5df3c644178068ee6a57f585", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:crates/rig-core/src/providers/gemini/interactions_api/streaming.rs", "end": 7726, "example_id": "0001ed00f0b34bf668fb5d011ad7ce94f47bc4b5dcfb45696626739c09694034", "language": "rust", "prefix": "amingChoice::FinalResponse(StreamingCompletionResponse {\n usage: final_usage.or_else(|| final_interaction.as_ref().and_then(|i| i.usage.clone())),\n interaction: final_interaction,\n model_version,\n }))", "repo": "0xPlaygrounds/rig", "span_codepoints": 256, "start": 7470, "suffix": "Vec>,\n) -> InteractionEventStream\nwhere\n T: HttpClientExt + Clone + Default + std::fmt::Debug + 'static,\n{\n let mut event_source = GenericEventSource::new(client.clone(), request);\n\n let stream = stream! {\n while let Some(event_result) ", "target": ";\n }\n .instrument(span);\n\n Ok(streaming::StreamingCompletionResponse::stream(Box::pin(\n stream,\n )))\n }\n}\n\npub(crate) fn stream_interaction_events(\n client: super::InteractionsClient,\n request: Request<"} {"bin": "32_token_ish", "content_sha256": "1568d8bf1aa102797496685ffe371b2f7d84699167e00ff4ad5abed0fef912c6", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/spiders/test_sitemap.py", "end": 2325, "example_id": "0001f3fa327011b1fa2329c9274f89a72ea8ca2e3186422798b79a744b81c4ff", "language": "python", "prefix": "url, sid=\"default\")\n return resp\n\n\nasync def _collect(agen: AsyncGenerator) -> list:\n return [item async for item in agen]\n\n\nclass TestSitemapSpiderFlow:\n @pytest.mark.asyncio\n async def test_urlset_dispatched_through_rules(self):\n class", "repo": "D4Vinci/Scrapling", "span_codepoints": 128, "start": 2197, "suffix": "self):\n return [CrawlRule(LinkExtractor(allow=r\"/posts/\"), callback=self.parse_post)]\n\n async def parse_post(self, response):\n yield {\"post\": response.url}\n\n spider = S()\n out = await _collect(spider._", "target": " S(SitemapSpider):\n name = \"s\"\n sitemap_urls = [\"https://example.com/sitemap.xml\"]\n\n def rules("} {"bin": "16_token_ish", "content_sha256": "bc9427b1700107d33dade0026f858459850759ee9c148383c990965d5a2aec8b", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:skills/cloud/references/api-v2.md", "end": 10222, "example_id": "0002007abf2e30bc4e300ee7da2b84dda781f37173eaf33c25b7a0ecee9b88b3", "language": "markdown", "prefix": "op_task_and_session` |\n| SessionStatus | `active`, `stopped` |\n| BrowserSessionStatus | `active`, `stopped` |\n| ProxyCountryCode | `us`, `uk`, `fr`, `it`, `jp`, `au`, `de`, `fi`, `ca`, `in` (+185 more) |\n| SupportedLLMs | `browser-use-llm`, `gpt-4.1`, `gpt", "repo": "browser-use/browser-use", "span_codepoints": 64, "start": 10158, "suffix": "`, `gemini-flash-latest`, `gemini-flash-lite-latest`, `gemini-3-flash-preview`, `gemini-3.1-flash-lite`, `claude-sonnet-4-20250514`, `gpt-4o`, `gpt-4o-mini`, `llama-4-maverick-17b-128e-instruct`, `claude-3-7-sonnet-20250219` |\n| UploadContentType | `image/", "target": "-4.1-mini`, `o4-mini`, `o3`, `gemini-2.5-flash`, `gemini-2.5-pro"} {"bin": "32_token_ish", "content_sha256": "f47fe2e6440578eeb20408bc3131b63fb8e1ae4f6ea26dbdcca33e7901e5ee8c", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:src/hooks/caveman-config.js", "end": 9802, "example_id": "0002074dce5d0a0d68d87e957ad34be8cce01756fcc3c827e29ed9804c4651f7", "language": "javascript", "prefix": "mbolicLink()) {\n realDir = fs.realpathSync(dir);\n const realStat = fs.statSync(realDir);\n if (!realStat.isDirectory()) return;\n if (typeof process.getuid === 'function') {\n if (realStat.uid !== process.getuid()) {\n ", "repo": "JuliusBrussee/caveman", "span_codepoints": 128, "start": 9674, "suffix": " return;\n }\n } else {\n const home = os.homedir();\n const normalized = path.resolve(realDir).toLowerCase();\n const normalizedHome = path.resolve(home).toLowerCase();\n if (!normalized.startsWith(normal", "target": " if (debug) process.stderr.write(`[caveman] appendFlag: symlink target ${realDir} owned by uid ${realStat.uid}\\n`);\n "} {"bin": "16_token_ish", "content_sha256": "1e2203cf7d3137221a7ff2d1b79d5405580eea2ce4c22ba916dbeb9c689e96be", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:tests/test-unit.c", "end": 27939, "example_id": "000207d571c2f990d0da7a7f6e68da1fcef998498ba6ee369ee08a51e0e1b91a", "language": "c", "prefix": "f(d - 2.0f) < 1e-6f);\n }\n\n printf(\" All distance_cosine_float tests passed.\\n\");\n}\n\nvoid test_distance_hamming() {\n printf(\"Starting %s...\\n\", __func__);\n float d;\n\n // Identical bitmaps: distance = 0\n {\n unsigned char a[] = {0xFF};\n unsigned ", "repo": "asg017/sqlite-vec", "span_codepoints": 64, "start": 27875, "suffix": "assert(d == 0.0f);\n }\n\n // All different: distance = 8\n {\n unsigned char a[] = {0xFF};\n unsigned char b[] = {0x00};\n d = _test_distance_hamming(a, b, 8);\n assert(d == 8.0f);\n }\n\n // Half different: 0xFF vs 0x0F = 4 bits differ\n {\n unsi", "target": "char b[] = {0xFF};\n d = _test_distance_hamming(a, b, 8);\n "} {"bin": "16_token_ish", "content_sha256": "2672a14a62dc3390d2f1249555e6befe2308ca0479a1e0e2006980170ba0396c", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:engineering-book/src/ch09-no-std-and-feature-verification.md", "end": 3948, "example_id": "0002098efcb58405c9a54fc6ff930a4676fe2877ccfc90df9c55cc0bb3e986b7", "language": "markdown", "prefix": "agnostic tools (before the OS loads)\n- BMC firmware diagnostics (resource-constrained ARM SoCs)\n- Kernel-level PCIe diagnostics (kernel module or eBPF probe)\n\n### `core` vs `alloc` vs `std` — The Three Layers\n\n```text\n┌─────────────────────────────────────", "repo": "microsoft/RustTraining", "span_codepoints": 64, "start": 3884, "suffix": " │\n│ Everything in core + alloc, PLUS: │\n│ • File I/O (std::fs, std::io) │\n│ • Networking (std::net) │\n│ • Threads (std::thread) ", "target": "────────────────────────┐\n│ std "} {"bin": "8_token_ish", "content_sha256": "d8ae6660f9c30e8d3fd0285e7acc211debb9a6dc4537b11964b89d713452bb5c", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:agent/server.go", "end": 696, "example_id": "0002162ccba7efcc4ca7fa65d334afef3dd4085292c1179d0e95bc5767f326f1", "language": "go", "prefix": "rverOptions contains configuration options for starting the SSH server.\ntype ServerOptions struct {\n\tAddr string // Network address to listen on (e.g., \":45876\" or \"/path/to/socket\")\n\tNetwork string // Network type (\"tcp\" or \"unix\"", "repo": "henrygd/beszel", "span_codepoints": 32, "start": 664, "suffix": "SSH public keys for authentication\n}\n\n// hubVersions caches hub versions by session ID to avoid repeated parsing.\nvar hubVersions map[string]semver.Version\n\n// StartServer starts the SSH server with the provided options.\n// It configures the server with se", "target": ")\n\tKeys []gossh.PublicKey // "} {"bin": "16_token_ish", "content_sha256": "69cc8ae62cec8ea6a5108b8505b4a4d8816dc8e835610424e9ca7f0504f11d70", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/xianyu/publish.test.js", "end": 7244, "example_id": "00021d81d29da9eb2205a7ac5992cedca8a80b6acd604c101072f11e53021d0d", "language": "javascript", "prefix": "nceOf(CommandExecutionError);\n\n await expect(publishCommand.func(makePage({\n evaluateResults: [\n { hasPublishForm: true },\n { ok: true },\n { ok: true, missing: [] },\n { ok: true ", "repo": "jackwener/OpenCLI", "span_codepoints": 64, "start": 7180, "suffix": "(CommandExecutionError);\n });\n\n it('browser category script is async and returns typed failure reasons', async () => {\n const result = await runBrowserScript('
', __test__.buildSelectCategoryEvaluate('笔记本'));\n\n ", "target": "},\n ],\n }), validArgs)).rejects.toBeInstanceOf"} {"bin": "32_token_ish", "content_sha256": "7e4ac7074d0ac6faa1be629b5e4866a53f4ef03be33239de567338dd8dcffb53", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/test_pdf_tables.py", "end": 15084, "example_id": "00022453497390c8e3e46ea0a42333046be4ef203bbfc6f2772b86420ef959e0", "language": "python", "prefix": "\",\n \"Headphones - Premium Black\",\n \"AUDIO-5521\",\n \"$349.99\",\n \"$299.99\",\n # Product 2: USB-C Hub\n \"USB-C Hub 7-in-1 Adapter\",\n \"ACC-8834\",\n \"$79.99\",\n \"$159.", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 14956, "suffix": " \"$260.00\",\n # Product 4: Wireless Mouse\n \"Ergonomic Wireless Mouse\",\n \"ACC-9012\",\n \"$59.99\",\n # Product 5: Screen Cleaning Kit\n \"Screen Cleaning Kit\",\n \"CARE-1156\",\n ", "target": "98\",\n # Product 3: Portable SSD\n \"Portable SSD 2TB\",\n \"STOR-2241\",\n \"$289.00\",\n "} {"bin": "8_token_ish", "content_sha256": "ab7d0b795cc4c53fbc05178f67b73f0d6f93fb57cd448017f2d32470a77c9546", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:src/core/update.ts", "end": 27468, "example_id": "0002245f825b75caf879f93df29bdd26773ded31e4cf6bcf020f9f32e4950be0", "language": "typescript", "prefix": "rkflowId) => availableCodexWorkflows.has(workflowId)));\n\n if (removableMatches.length > 0) {\n await this.performLegacyCleanup(\n projectPath,\n pickGlobalLegacyPromptFiles(\n detection,\n removableMatches.map((prompt) =>", "repo": "Fission-AI/OpenSpec", "span_codepoints": 32, "start": 27436, "suffix": "\n }\n\n const blockedMatches = getLegacyGlobalPromptMatches(detection)\n .filter((prompt) => !removableMatches.some((match) => match.path === prompt.path));\n\n if (blockedMatches.length > 0) {\n console.log(chalk.yellow('Preserved deferred gl", "target": " prompt.path)\n )\n );"} {"bin": "8_token_ish", "content_sha256": "052d859eda206385b608aba621784a7ef7dce0e689a5dcc6b9f45f7aed596e76", "document_id": "cloudwego/eino@ca0441ac0bceed8945dcf7d5a18c237c924c6aa8:adk/interrupt_test.go", "end": 37442, "example_id": "000229d9136ff151dcfae1a368a9dfbc4811e4b4f58f20c4f655982bc5c680b0", "language": "go", "prefix": "utput.Message.Content, \"my agent completed with data resume sa\")\n\tevent, ok = iter.Next()\n\tassert.True(t, ok)\n\tassert.NoError(t, event.Err)\n\tassert.Equal(t, event.Output.MessageOutput.Message.Content, \"completed\")\n\t_, ok = iter.Next()\n\tassert.False(t, ok)\n", "repo": "cloudwego/eino", "span_codepoints": 32, "start": 37410, "suffix": "\treturn &myStore{\n\t\tm: map[string][]byte{},\n\t}\n}\n\ntype myStore struct {\n\tm map[string][]byte\n}\n\nfunc (m *myStore) Set(_ context.Context, key string, value []byte) error {\n\tm.m[key] = value\n\treturn nil\n}\n\nfunc (m *myStore) Get(_ context.Context, key string)", "target": "}\n\nfunc newMyStore() *myStore {\n"} {"bin": "64_token_ish", "content_sha256": "f759cbf40824426107b527127b7a79b6efb613fc85f0c162d4a24cad7789d7ef", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/__main__.py", "end": 3466, "example_id": "00022aa34962fccab14944bb39d7d38a1850d200259d3a5b25d8455934533e1f", "language": "python", "prefix": " \"--cu-file-types\",\n type=str,\n help=\"Comma-separated list of file types to route to Content Understanding (e.g., pdf,jpeg,mp4). If omitted, all supported types are routed.\",\n )\n\n parser.add_argument(\n \"-p\",\n \"--use-", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 3210, "suffix": "3rd-party plugins. Plugins are loaded when using the -p or --use-plugin option.\",\n )\n\n parser.add_argument(\n \"--keep-data-uris\",\n action=\"store_true\",\n help=\"Keep data URIs (like base64-encoded images) in the output. By default, ", "target": "plugins\",\n action=\"store_true\",\n help=\"Use 3rd-party plugins to convert files. Use --list-plugins to see installed plugins.\",\n )\n\n parser.add_argument(\n \"--list-plugins\",\n action=\"store_true\",\n help=\"List installed "} {"bin": "8_token_ish", "content_sha256": "7a17d8c904eab1813a220279c31ef51598214735923d178bed9beb92e9cf0230", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:benchmarks/correctness.js", "end": 5085, "example_id": "00022c4b8eaf1ee57d4c9dd6bc8bb6b2f651012fe95480b32675490950109e20", "language": "javascript", "prefix": "e.code}\n\n// Find the debounce function\nconst fn = typeof debounce === 'function' ? debounce\n : typeof module !== 'undefined' && typeof module.exports === 'function' ? module.exports\n : null;\n\nif (!fn) {\n console.error(\"FAIL: no debounce function found\")", "repo": "DietrichGebert/ponytail", "span_codepoints": 32, "start": 5053, "suffix": " debounced function should not fire immediately\nlet callCount = 0;\nconst debounced = fn(() => { callCount++; }, 50);\ndebounced();\ndebounced();\ndebounced();\n\nif (callCount > 0) {\n console.error(\"FAIL: debounce fired immediately (should wait)\");\n process.e", "target": ";\n process.exit(1);\n}\n\n// Test:"} {"bin": "32_token_ish", "content_sha256": "0ade33ba18b5de7898b0031c737185a5bc944d529b58ba3661e833f930a77ade", "document_id": "cloudwego/eino@ca0441ac0bceed8945dcf7d5a18c237c924c6aa8:adk/filesystem/backend_inmemory_test.go", "end": 47932, "example_id": "00023495fc16db28f029eed94ab19391bf2fccf7af0db6904068793251be6a06", "language": "go", "prefix": "repRaw failed: %v\", err)\n\t\t}\n\t\tif len(matches) != 1 {\n\t\t\tt.Errorf(\"Expected 1 match, got %d\", len(matches))\n\t\t}\n\t})\n}\n\nfunc TestInMemoryBackend_GrepRaw_Concurrent(t *testing.T) {\n\tbackend := NewInMemoryBackend()\n\tctx := context.Background()\n\n\tfor i := 0; i", "repo": "cloudwego/eino", "span_codepoints": 128, "start": 47804, "suffix": " with error message\", i),\n\t\t})\n\t}\n\n\tt.Run(\"concurrent grep operations\", func(t *testing.T) {\n\t\tdone := make(chan bool)\n\t\tfor i := 0; i < 10; i++ {\n\t\t\tgo func() {\n\t\t\t\t_, err := backend.GrepRaw(ctx, &GrepRequest{\n\t\t\t\t\tPattern: \"error\",\n\t\t\t\t})\n\t\t\t\tif err != n", "target": " < 10; i++ {\n\t\tbackend.Write(ctx, &WriteRequest{\n\t\t\tFilePath: fmt.Sprintf(\"/file%d.txt\", i),\n\t\t\tContent: fmt.Sprintf(\"content%d"} {"bin": "16_token_ish", "content_sha256": "8e220fb270b050bf1ece82efad6ae81ac5a9a1bdb9962fd7414e5d47b209737f", "document_id": "nicbarker/clay@e6cc36941ab2af5d81107617039d6f527a1c660b:renderers/GLES3/clay_renderer_gles3.h", "end": 10073, "example_id": "00023d247a24191a43935a6d59d02fdb50bb9da0afb04e5177602acec8f8aa6d", "language": "c", "prefix": "gl_Position = vec4(ndc * vec2(1.0, -1.0), 0.0, 1.0);\\n\"\n \" vUV = aUV;\\n\"\n \" vColor = aColor;\\n\"\n \" vTexSlot = aTexSlot;\\n\"\n \"}\\n\";\n\nconst char *GLES3_TEXT_FRAGMENT_SHADER =\n GLSL_VERSION\n \"\\n\"\n \"precision mediump float;\\n\"\n ", "repo": "nicbarker/clay", "span_codepoints": 64, "start": 10009, "suffix": ";\\n\"\n \"uniform sampler2D uTex0;\\n\"\n \"uniform sampler2D uTex1;\\n\"\n \"uniform sampler2D uTex2;\\n\"\n \"uniform sampler2D uTex3;\\n\"\n \"out vec4 fragColor;\\n\"\n \"void main() {\\n\"\n \" int slot = int(vTexSlot + 0.5);\\n\"\n \" float coverage;\\", "target": " \"in vec2 vUV;\\n\"\n \"in vec4 vColor;\\n\"\n \"in float vTexSlot"} {"bin": "64_token_ish", "content_sha256": "f675d6d404617e1e1689184e44da357b529068183e076c753bbc1f3b4aab9a6f", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/_test_vectors.py", "end": 5553, "example_id": "000241141d9ec2c073ee7c0c308334211340a241c8c73a1e9714c1e09eeffa20", "language": "python", "prefix": "ml,%3Csvg%20width%3D\",\n ],\n ),\n FileTestVector(\n filename=\"test_mskanji.csv\",\n mimetype=\"text/csv\",\n charset=\"cp932\",\n url=None,\n must_include=[\n \"| 名前 | 年齢 | 住所 |\",\n \"| --- | --- | --- ", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 5297, "suffix": "\"ascii\",\n url=None,\n must_include=[\n \"5b64c88c-b3c3-4510-bcb8-da0b200602d8\",\n \"9700dc99-6685-40b4-9a3a-5e406dcb37f3\",\n ],\n must_not_include=[],\n ),\n FileTestVector(\n filename=\"test_rss.xml\",\n ", "target": "|\",\n \"| 佐藤太郎 | 30 | 東京 |\",\n \"| 三木英子 | 25 | 大阪 |\",\n \"| 髙橋淳 | 35 | 名古屋 |\",\n ],\n must_not_include=[],\n ),\n FileTestVector(\n filename=\"test.json\",\n mimetype=\"application/json\",\n charset="} {"bin": "32_token_ish", "content_sha256": "bcc202c2f3745a7c508423db9b7e6656ee7d0a7bc37f032f7ca61497e6f5a70d", "document_id": "steipete/agent-scripts@bb3688355a4c1894dd53b4ed867d1600918fadf0:skills/clawsweeper-status/scripts/clawsweeper-status.sh", "end": 6936, "example_id": "00024a1c855fcf70c62510e5982a946ee60a5a3285357e7465828d4e28f4214e", "language": "shell", "prefix": "RL:-https://clawsweeper.openclaw.ai}/api/exact-review-queue\" \\\n >\"$exact_queue_json\" 2>/dev/null && \\\n jq -e '\n type == \"object\" and\n (.pending | type == \"number\") and\n (.dispatching | type == \"number\") and\n (.leased | type == \"number\") and", "repo": "steipete/agent-scripts", "span_codepoints": 128, "start": 6808, "suffix": "available=false\n printf '{}\\n' >\"$exact_queue_json\"\nfi\n\nactive_count=\"$(jq '[.workflow_runs[]\n | select(.status == \"in_progress\" or .status == \"pending\" or .status == \"queued\" or .status == \"waiting\" or .status == \"requested\")\n] | length' \"$runs_json\")\"\n", "target": "\n (.target_stats | type == \"array\")\n ' \"$exact_queue_json\" >/dev/null; then\n exact_queue_available=true\nelse\n exact_queue_"} {"bin": "64_token_ish", "content_sha256": "9a3dd7879415651a061d217594d4ea9f985b2e3903c1b65cf03099cdb94dc49b", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:crates/rig-core/src/providers/openai/embedding.rs", "end": 16754, "example_id": "0002559e9788436ed8dfd2561114618e64ed35d88ea83dc24b69edea94efd35e", "language": "rust", "prefix": "c_openai_embedding_response_requires_usage() {\n let body = r#\"{\n \"object\": \"list\",\n \"model\": \"text-embedding-3-small\",\n \"data\": [{ \"object\": \"embedding\", \"index\": 0, \"embedding\": [0.1] }]\n }\"#;\n\n assert", "repo": "0xPlaygrounds/rig", "span_codepoints": 256, "start": 16498, "suffix": "\"}\"#;\n let http_client =\n RecordingHttpClient::with_error_response(http::StatusCode::ACCEPTED, body);\n let client = CompletionsClient::builder()\n .api_key(\"test-key\")\n .http_client(http_client)\n .bu", "target": "!(serde_json::from_str::(body).is_err());\n }\n\n #[tokio::test]\n async fn embedding_preserves_raw_provider_error_json_on_api_error_envelope() {\n let body = r#\"{\"message\":\"embedding quota exceeded\",\"type\":\"insufficient_quota"} {"bin": "16_token_ish", "content_sha256": "9df7c88562b71531d2c3276c5804a29df072b2222eaf9c85432bf7317588ccd1", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/xiaohongshu/creator-notes-summary.js", "end": 3423, "example_id": "0002577f08991d2d1a4b3d4650df77e3401e893a4f331e2b48d802478eacdff6", "language": "javascript", "prefix": " of notes.entries()) {\n if (index > 0) {\n await page.wait({ time: 1 + Math.random() * 2 });\n }\n if (!note.id) {\n results.push({\n rank: index + 1,\n id: note", "repo": "jackwener/OpenCLI", "span_codepoints": 64, "start": 3359, "suffix": "published_at: note.date,\n views: String(note.views),\n likes: String(note.likes),\n collects: String(note.collects),\n comments: String(note.comments),\n shares: '',", "target": ".id,\n title: note.title,\n "} {"bin": "16_token_ish", "content_sha256": "e191ce730fc08df89719c6c568529d86eb786e2395518ed9c12562358c33ddd3", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/commands/artifact-workflow.test.ts", "end": 20357, "example_id": "00025b780723224a11fb7f18b1cdb3b00153e0be83cdf5caecba786b4827adcb", "language": "typescript", "prefix": "aName).toBe('spec-driven');\n expect(json.state).toBe('ready');\n expect(json.contextFiles).toBeDefined();\n expect(typeof json.contextFiles).toBe('object');\n expect(json.contextFiles.proposal).toEqual([expectedProposalPath]);\n expect", "repo": "Fission-AI/OpenSpec", "span_codepoints": 64, "start": 20293, "suffix": " it('resolves single-star glob artifacts consistently between status and apply', async () => {\n const schemaDir = path.join(tempDir, 'openspec', 'schemas', 'glob-test');\n const templatesDir = path.join(schemaDir, 'templates');\n await fs.m", "target": "(json.contextFiles.specs).toEqual([expectedSpecPath]);\n });\n\n"} {"bin": "32_token_ish", "content_sha256": "e6ff121105322d4915f1e730b2fabdd4e83031022c24eb8c82da405412e47089", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:tests/test_repo_local_config.js", "end": 1910, "example_id": "000265c9533ba90be0390f91e2667dea1c5dcb61d656442a805ea02786f4f675", "language": "javascript", "prefix": " config resolution tests\\n');\n\ntest('returns \"full\" when no env, no repo config, no user config', (tmp) => {\n process.chdir(tmp);\n assert.strictEqual(getDefaultMode(), 'full');\n});\n\ntest('reads .caveman/config.json in cwd', (tmp) => {\n fs.mkdirSync(path", "repo": "JuliusBrussee/caveman", "span_codepoints": 128, "start": 1782, "suffix": "}));\n process.chdir(tmp);\n assert.strictEqual(getDefaultMode(), 'lite');\n});\n\ntest('reads .caveman.json in cwd', (tmp) => {\n fs.writeFileSync(path.join(tmp, '.caveman.json'),\n JSON.stringify({ defaultMode: 'ultra' }));\n process.chdir(tmp);\n assert.", "target": ".join(tmp, '.caveman'));\n fs.writeFileSync(path.join(tmp, '.caveman', 'config.json'),\n JSON.stringify({ defaultMode: 'lite' "} {"bin": "32_token_ish", "content_sha256": "b5605939a6cb527522511e86e34ab8818263cf47ff3b9d0ec6e4dea481e3fd65", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/engines/_browsers/_base.py", "end": 18381, "example_id": "00026bb30e9138495c507af885bb0d5187f4ea4e2c4618985e3659e41221dbd9", "language": "python", "prefix": " {\n \"args\": flags,\n \"headless\": config.headless,\n \"channel\": \"chrome\" if config.real_chrome else \"chromium\",\n }\n )\n if config.executable_path:\n ", "repo": "D4Vinci/Scrapling", "span_codepoints": 128, "start": 18253, "suffix": " else:\n self._browser_options = {}\n\n if config.additional_args:\n self._context_options.update(config.additional_args)\n\n def _build_context_with_proxy(self, proxy: Optional[ProxyType] = None) -> Dict[str, Any]:\n \"\"\"\n ", "target": "self._browser_options[\"executable_path\"] = config.executable_path\n\n self._user_data_dir = config.user_data_dir\n "} {"bin": "16_token_ish", "content_sha256": "4a917370dfb68dcf981252756ee4ff2e2915a27993a583dd0d43e61977a62609", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:src/commands/store.ts", "end": 12441, "example_id": "000279d5423b5ce42cf086804cbda2830af7c6abe93c500c3b4d2782ad479a64", "language": "typescript", "prefix": "e.metadata.present === null) return 'unknown';\n return 'invalid';\n}\n\nfunction formatDoctorGitHuman(store: StoreDoctorOutput['stores'][number]): string {\n if (store.git.is_repository === null) return 'unknown';\n if (!store.git.is_repository) return 'not ", "repo": "Fission-AI/OpenSpec", "span_codepoints": 64, "start": 12377, "suffix": "no: string): string =>\n value === null ? 'unknown' : value ? yes : no;\n\n return `repository detected (commits: ${fact(store.git.has_commits, 'yes', 'none')}, uncommitted changes: ${fact(store.git.has_uncommitted_changes, 'yes', 'no')}, remote: ${fact(s", "target": "detected';\n\n const fact = (value: boolean | null, yes: string, "} {"bin": "32_token_ish", "content_sha256": "06f26bb3c51ea4c51fbae2011a47c06440f2c1d43820a6eb65732476abc3450c", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:sqlite-vec-rescore.c", "end": 4842, "example_id": "00027f91b8983c7f5ddc8b9d0e23d0e62d8cd23c3bd02b9c9606b03fbdf5edfd", "language": "c", "prefix": "OK) {\n sqlite3_finalize(stmt);\n return rc;\n }\n sqlite3_bind_int64(stmt, 1, chunk_rowid);\n sqlite3_bind_int64(stmt, 2, chunk_rowid);\n sqlite3_bind_zeroblob64(stmt, 3, blob_size);\n rc = sqlite3_step(stmt);\n sqlite3_finalize(stmt);", "repo": "asg017/sqlite-vec", "span_codepoints": 128, "start": 4714, "suffix": "=======================\n// Quantization\n// ============================================================================\n\nstatic void rescore_quantize_float_to_bit(const float *src, uint8_t *dst,\n size_t dimensions) ", "target": "\n if (rc != SQLITE_DONE)\n return rc;\n }\n return SQLITE_OK;\n}\n\n// ====================================================="} {"bin": "64_token_ish", "content_sha256": "5308ec899ac988a3e5b27c4735c528027023dd4b5b7d58811cdb19b16d1eb657", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/mido.sh", "end": 7761, "example_id": "00028400d9b6e80ade81a5528bcea5905209bc1f5a1a69f7f860f07a232d0c60", "language": "shell", "prefix": "rc != 0 )); then\n error \"Microsoft server gave us no download link to our request for an automated download!\"\n info \"Response: $linkJson\"\n return 1\n fi\n\n MIDO_URL=\"$link\"\n return 0\n}\n\ndownloadWindowsEval() {\n\n local id=\"$1\"\n local lang=\"$2\"\n ", "repo": "dockur/windows", "span_codepoints": 256, "start": 7505, "suffix": " type=\"iot\"\n winVer=\"windows-11-iot-enterprise-ltsc-eval\" ;;\n \"win11${PLATFORM,,}-enterprise-ltsc-eval\" )\n type=\"ltsc\"\n winVer=\"windows-11-enterprise\" ;;\n \"win2025-eval\" )\n type=\"server\"\n winVer=\"windows-server-2025\" ;;\n \"", "target": " local desc=\"$3\"\n local culture compare type\n local agent language winVer\n\n case \"${id,,}\" in\n \"win11${PLATFORM,,}-enterprise-eval\" )\n type=\"enterprise\"\n winVer=\"windows-11-enterprise\" ;;\n \"win11${PLATFORM,,}-enterprise-iot-eval\" )\n "} {"bin": "16_token_ish", "content_sha256": "4225aecbb3bb3e4d52de1a7301857329ec58bfb7663b4b47703e9fd999d6004b", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/define.sh", "end": 10891, "example_id": "000285ff92eb64fc2da9c0c2ee898be339357a76b1de3a8fe73bb3dece0e3e62", "language": "shell", "prefix": "g=\"Lithuanian\"\n culture=\"lt-LT\" ;;\n \"lv\" | \"lv-\"* | \"latvian\" | \"latvijas\" )\n [[ \"$input\" == \"latvian\" || \"$input\" == \"latvijas\" ]] && id=\"lv\"\n short=\"lv\"\n lang=\"Latvian\"\n culture=\"lv-LV\" ;;\n \"nb\" | \"nb-\"* | \"nn\" | \"nn-\"* | \"", "repo": "dockur/windows", "span_codepoints": 64, "start": 10827, "suffix": " || \"$input\" == \"no\" || \"$input\" == \"norwegian\" || \"$input\" == \"norsk\" ]] && id=\"nn\"\n short=\"no\"\n lang=\"Norwegian\"\n culture=\"nb-NO\" ;;\n \"nl\" | \"nl-\"* | \"dutch\" | \"nederlands\" )\n [[ \"$input\" == \"dutch\" || \"$input\" == \"nederlands\" ]] &", "target": "no\" | \"no-\"* | \"norwegian\" | \"norsk\" )\n [[ \"$input\" == \"nb\""} {"bin": "64_token_ish", "content_sha256": "c842a5e93844d5c84714e4af06bfe88e5298f3dca13ac3af583dc1152492efe2", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/fetchers/async/test_stealth.py", "end": 2325, "example_id": "00029a401b2efaa1aeea87c17d021e4edeae5a46e34f771d12cd3be684fdd9dc", "language": "python", "prefix": "nize=True)\n ).status == 200\n\n @pytest.mark.parametrize(\n \"kwargs\",\n [\n {\"block_webrtc\": True, \"allow_webgl\": True},\n {\"block_webrtc\": False, \"allow_webgl\": True},\n {\"block_webrtc\": True, \"allow_webgl", "repo": "D4Vinci/Scrapling", "span_codepoints": 256, "start": 2069, "suffix": " 10,\n \"cookies\": [{\"name\": \"test\", \"value\": \"123\", \"domain\": \"example.com\", \"path\": \"/\"}],\n \"google_search\": True,\n \"extra_headers\": {\"ayo\": \"\"},\n \"selector_config\": {\"keep_comments\": False, \"keep", "target": "\": False, \"disable_resources\": True},\n {\"wait_selector\": \"h1\", \"wait_selector_state\": \"attached\"},\n {\"wait_selector\": \"h1\", \"wait_selector_state\": \"visible\"},\n {\n \"network_idle\": True,\n \"wait\":"} {"bin": "32_token_ish", "content_sha256": "c7b8119f0c956a69abf4cf48d23de9667d47f54b68c51ba9fb9e3762758a81f8", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:internal/migrations/0_collections_snapshot_0_19_0_dev_1.go", "end": 19364, "example_id": "00029b4edc6d2f7c9559dfe1a27124471b85c1f256d33d7ba30fcdf3eb112d5e", "language": "go", "prefix": "6}\",\n\t\t\t\t\t\t\"hidden\": false,\n\t\t\t\t\t\t\"id\": \"text3208210256\",\n\t\t\t\t\t\t\"max\": 12,\n\t\t\t\t\t\t\"min\": 6,\n\t\t\t\t\t\t\"name\": \"id\",\n\t\t\t\t\t\t\"pattern\": \"^[a-f0-9]+$\",\n\t\t\t\t\t\t\"presentable\": false,\n\t\t\t\t\t\t\"primaryKey\": true,\n\t\t\t\t\t\t\"required\": true,\n\t\t\t\t\t\t\"system\": true,\n\t\t\t\t\t\t\"type\":", "repo": "henrygd/beszel", "span_codepoints": 128, "start": 19236, "suffix": "relation3377271179\",\n\t\t\t\t\t\t\"maxSelect\": 1,\n\t\t\t\t\t\t\"minSelect\": 0,\n\t\t\t\t\t\t\"name\": \"system\",\n\t\t\t\t\t\t\"presentable\": false,\n\t\t\t\t\t\t\"required\": false,\n\t\t\t\t\t\t\"system\": false,\n\t\t\t\t\t\t\"type\": \"relation\"\n\t\t\t\t},\n\t\t\t\t{\n\t\t\t\t\t\t\"autogeneratePattern\": \"\",\n\t\t\t\t\t\t\"hidden\": fals", "target": " \"text\"\n\t\t\t\t},\n\t\t\t\t{\n\t\t\t\t\t\t\"cascadeDelete\": false,\n\t\t\t\t\t\t\"collectionId\": \"2hz5ncl8tizk5nx\",\n\t\t\t\t\t\t\"hidden\": false,\n\t\t\t\t\t\t\"id\": \""} {"bin": "8_token_ish", "content_sha256": "2672a14a62dc3390d2f1249555e6befe2308ca0479a1e0e2006980170ba0396c", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:engineering-book/src/ch09-no-std-and-feature-verification.md", "end": 14437, "example_id": "00029ec8b3ba13e3bddfd7eeadb976c4ccc3dab38b031c1bc737e002fffbbe63", "language": "markdown", "prefix": "features + each individually:\ncargo hack check --each-feature --workspace\ncargo check --workspace --all-features\ncargo check --workspace --no-default-features\n```\n\n\n#### 🔴 Exercise 2: Build a `no_std` Library\n\nCreate a library crate that compiles", "repo": "microsoft/RustTraining", "span_codepoints": 32, "start": 14405, "suffix": "simple stack-allocated ring buffer. Verify it compiles for `thumbv7em-none-eabihf` (ARM Cortex-M).\n\n
\nSolution\n\n```rust\n// lib.rs\n#![no_std]\n\npub struct RingBuffer {\n data: [u8; N],\n head: usize,\n len: us", "target": " with `#![no_std]`. Implement a "} {"bin": "8_token_ish", "content_sha256": "d8bd95dc0fae7abc7673552f70df4fc356cb9e81527483f06c07043098e8784f", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:agent/gpu_test.go", "end": 4594, "example_id": "0002a041d079f54f9784dd585e4a62de6960a36adbaa6c6647d32784a5bd8328", "language": "go", "prefix": " (%)\": \"0\",\n\t\t\t\t\t\"VRAM Total Memory (B)\": \"536870912\",\n\t\t\t\t\t\"VRAM Total Used Memory (B)\": \"482263040\",\n\t\t\t\t\t\"Card Series\": \"Rembrandt [Radeon 680M]\"\n\t\t\t\t},\n\t\t\t\t\"card1\": {\n\t\t\t\t\t\"GUID\": \"38294\",\n\t\t\t\t\t\"Temperature (Sensor edge) (C)\": \"49.0\",\n\t\t\t\t\t\"Temperature", "repo": "henrygd/beszel", "span_codepoints": 32, "start": 4562, "suffix": "\n\t\t\t\t\t\"Temperature (Sensor memory) (C)\": \"62.0\",\n\t\t\t\t\t\"Average Graphics Package Power (W)\": \"19.0\",\n\t\t\t\t\t\"GPU use (%)\": \"20.3\",\n\t\t\t\t\t\"VRAM Total Memory (B)\": \"25753026560\",\n\t\t\t\t\t\"VRAM Total Used Memory (B)\": \"794341376\",\n\t\t\t\t\t\"Card Series\": \"Navi 31 [Radeo", "target": " (Sensor junction) (C)\": \"49.0\","} {"bin": "64_token_ish", "content_sha256": "4225aecbb3bb3e4d52de1a7301857329ec58bfb7663b4b47703e9fd999d6004b", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/define.sh", "end": 12067, "example_id": "0002a9a9cc67791a71e29114fde80d3d10bffb1842783627c24209fa7b503ef3", "language": "shell", "prefix": "e\"\n desc=\"Portuguese\"\n culture=\"pt-BR\" ;;\n \"pt-\"* )\n short=\"pp\"\n lang=\"Portuguese\"\n culture=\"pt-BR\" ;;\n \"ro\" | \"ro-\"* | \"romanian\" | \"română\" | \"romana\" )\n [[ \"$input\" == \"romanian\" || \"$input\" == \"română\" || \"$input\" ==", "repo": "dockur/windows", "span_codepoints": 256, "start": 11811, "suffix": "\" ;;\n \"sk\" | \"sk-\"* | \"slovak\" | \"slovenský\" | \"slovensky\" )\n [[ \"$input\" == \"slovak\" || \"$input\" == \"slovenský\" || \"$input\" == \"slovensky\" ]] && id=\"sk\"\n short=\"sk\"\n lang=\"Slovak\"\n culture=\"sk-SK\" ;;\n \"sl\" | \"sl-\"* | \"si\" | \"si-\"", "target": " \"romana\" ]] && id=\"ro\"\n short=\"ro\"\n lang=\"Romanian\"\n culture=\"ro-RO\" ;;\n \"ru\" | \"ru-\"* | \"russian\" | \"ruski\" )\n [[ \"$input\" == \"russian\" || \"$input\" == \"ruski\" ]] && id=\"ru\"\n short=\"ru\"\n lang=\"Russian\"\n culture=\"ru-RU"} {"bin": "64_token_ish", "content_sha256": "35d3bac200ce605ab32a55e6d873c36bd652ca3ec57136de120b0870f450cb79", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/core/validation.test.ts", "end": 26852, "example_id": "0002ab0a674ed62f6ca4f88d144c1144ee19be2a3797dc623cecf041f0f8c6ed", "language": "typescript", "prefix": "ry.errors).toBe(0);\n expect(report.issues.some(i => i.message.includes('Example only'))).toBe(false);\n });\n\n it('does not count scenario headers inside fenced code blocks toward the required scenario count', async () => {\n const changeDir =", "repo": "Fission-AI/OpenSpec", "span_codepoints": 256, "start": 26596, "suffix": "Documentation Generator\nThe system SHALL render a delta example in its output.\n\n\\`\\`\\`markdown\n#### Scenario: Example scenario\n\\`\\`\\`\n`;\n\n const specPath = path.join(specsDir, 'spec.md');\n await fs.writeFile(specPath, deltaSpec);\n\n const val", "target": " path.join(testDir, 'test-change-fenced-scenario-only');\n const specsDir = path.join(changeDir, 'specs', 'test-spec');\n await fs.mkdir(specsDir, { recursive: true });\n\n const deltaSpec = `# Test Spec\n\n## ADDED Requirements\n\n### Requirement: "} {"bin": "16_token_ish", "content_sha256": "6799887379de0dcc229a02897ab44d1ad774b2cbe6ce7cad59832e42feb0129c", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:internal/hub/heartbeat/heartbeat_test.go", "end": 6714, "example_id": "0002ab773b7b8a02ee1fed4622fbb29fed0da6b042227ef2721379a53e317266", "language": "go", "prefix": "zeltests.TestHub) *core.Record {\n\tt.Helper()\n\tuser, err := beszeltests.CreateUser(app.App, \"admin@example.com\", \"password123\")\n\trequire.NoError(t, err)\n\treturn user\n}\n\nfunc createTestSystem(t *testing.T, app *beszeltests.TestHub, userID, name, host, status", "repo": "henrygd/beszel", "span_codepoints": 64, "start": 6650, "suffix": "CreateRecord(app.App, \"systems\", map[string]any{\n\t\t\"name\": name,\n\t\t\"host\": host,\n\t\t\"port\": \"45876\",\n\t\t\"users\": []string{userID},\n\t\t\"status\": status,\n\t})\n\trequire.NoError(t, err)\n\treturn system\n}\n\nfunc createTriggeredAlert(t *testing.T, app *beszelte", "target": " string) *core.Record {\n\tt.Helper()\n\tsystem, err := beszeltests."} {"bin": "8_token_ish", "content_sha256": "a497dee4dafc4abf3240125d7c0de66f8773905518ca138257a2987dd64837dd", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/test_cu_converter.py", "end": 2982, "example_id": "0002ae5a83aac0520fef26ed8a793ecfb7fd1f9725e75bebef7de71c30219fb0", "language": "python", "prefix": " \".json\",\n \".zip\",\n \".epub\",\n \".py\",\n \".rs\",\n ],\n )\n def test_rejects_unsupported_extensions(self, ext):\n conv = _make_converter()\n assert not conv.accepts(io.BytesIO(b\"\"), StreamInfo", "repo": "microsoft/markitdown", "span_codepoints": 32, "start": 2950, "suffix": "----------------------------------------------------------------\n# accepts() tests — MIME-based\n# ---------------------------------------------------------------------------\n\n\nclass TestAcceptsMime:\n \"\"\"Test accepts() for MIME type matching.\"\"\"\n\n @py", "target": "(extension=ext))\n\n\n# -----------"} {"bin": "8_token_ish", "content_sha256": "c7b8119f0c956a69abf4cf48d23de9667d47f54b68c51ba9fb9e3762758a81f8", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:internal/migrations/0_collections_snapshot_0_19_0_dev_1.go", "end": 25825, "example_id": "0002aed310a0bd79bc59d0dccd1e97bcd3fafe7ee71f6474ced3b7a2165124d6", "language": "go", "prefix": "[a-z0-9]+$\",\n\t\t\t\t\"presentable\": false,\n\t\t\t\t\"primaryKey\": true,\n\t\t\t\t\"required\": true,\n\t\t\t\t\"system\": true,\n\t\t\t\t\"type\": \"text\"\n\t\t\t},\n\t\t\t{\n\t\t\t\t\"cascadeDelete\": true,\n\t\t\t\t\"collectionId\": \"_pb_users_auth_\",\n\t\t\t\t\"hidden\": false,\n\t\t\t\t\"id\": \"relation2375276105\",\n\t\t", "repo": "henrygd/beszel", "span_codepoints": 32, "start": 25793, "suffix": "\": 0,\n\t\t\t\t\"name\": \"user\",\n\t\t\t\t\"presentable\": false,\n\t\t\t\t\"required\": false,\n\t\t\t\t\"system\": false,\n\t\t\t\t\"type\": \"relation\"\n\t\t\t},\n\t\t\t{\n\t\t\t\t\"cascadeDelete\": true,\n\t\t\t\t\"collectionId\": \"2hz5ncl8tizk5nx\",\n\t\t\t\t\"hidden\": false,\n\t\t\t\t\"id\": \"relation3377271179\",\n\t\t\t\t\"ma", "target": "\t\t\"maxSelect\": 1,\n\t\t\t\t\"minSelect"} {"bin": "64_token_ish", "content_sha256": "8ed1398aa1ca4b7885c4f0c3fe12e2f4555fb681cb73ab10cb79f3079d24870a", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/_exceptions.py", "end": 1698, "example_id": "0002d098598f02343a237ffc493c47d122e75ef19e532cd947c8b76cab53fd28", "language": "python", "prefix": "er was found for the given file.\n \"\"\"\n\n pass\n\n\nclass FailedConversionAttempt(object):\n \"\"\"\n Represents a single attempt to convert a file.\n \"\"\"\n\n def __init__(self, converter: Any, exc_info: Optional[tuple] = None):\n self.converter", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 1442, "suffix": " message: Optional[str] = None,\n attempts: Optional[List[FailedConversionAttempt]] = None,\n ):\n self.attempts = attempts\n\n if message is None:\n if attempts is None:\n message = \"File conversion failed.\"\n ", "target": " = converter\n self.exc_info = exc_info\n\n\nclass FileConversionException(MarkItDownException):\n \"\"\"\n Thrown when a suitable converter was found, but the conversion\n process fails for any reason.\n \"\"\"\n\n def __init__(\n self,\n "} {"bin": "32_token_ish", "content_sha256": "37dea31db4757ee41e18bf6e82526d2c4e421cd01cf03ba56b2f4a0f64b26cc7", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/pdb/pdb_parse.c", "end": 29511, "example_id": "0002d536a826a8e1f3ffc3424bb8ade09842d9886aa2b877cbd0754971712e11", "language": "c", "prefix": " // unique name\n if (compare_unique_name){\n if (lf_struct->props & CV_TypeProp_HasUniqueName) {\n U8 *unique_name_ptr = name_ptr + name.size + 1;\n String8 unique_name", "repo": "EpicGames/raddebugger", "span_codepoints": 128, "start": 29383, "suffix": " }\n }\n else{\n extracted_name = name;\n }\n }\n }\n }break;\n \n case CV_LeafKind_CLASS2:\n ", "target": " = str8_cstring_capped((char*)unique_name_ptr, (char *)(first + cap));\n extracted_name = unique_name;\n "} {"bin": "64_token_ish", "content_sha256": "c84154be2a7e8cb5c0b350485417005c4865b86870578e24f3b773b5a82c97d3", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/cli/install.rs", "end": 14160, "example_id": "0002d5d6d3a6c7eb6159cb3e5a0d80fdbd41e2029cfcc9f6fe9a8b0a834eb0ef", "language": "rust", "prefix": " \" {}\\n\",\n ),\n \"note:\".yellow().bold(),\n \"hint:\".yellow().bold(),\n \"git config --unset-all --global core.hooksPath\".cyan(),\n \"git config --unset-all --system core.hooksPath\".cyan(),\n ", "repo": "j178/prek", "span_codepoints": 256, "start": 13904, "suffix": "_dir().await?\n };\n\n let types: Vec = if all {\n HookType::value_variants().to_vec()\n } else {\n get_hook_types(hook_types, project.as_ref(), config.as_deref())\n };\n\n for hook_type in types {\n let hook_path = hook", "target": " \"git config --local core.hooksPath \".cyan(),\n );\n }\n\n let project = Project::discover(config.as_deref(), &CWD).ok();\n let hooks_path = if let Some(dir) = git_dir {\n dir.join(\"hooks\")\n } else {\n git::get_git_hooks"} {"bin": "8_token_ish", "content_sha256": "1e2203cf7d3137221a7ff2d1b79d5405580eea2ce4c22ba916dbeb9c689e96be", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:tests/test-unit.c", "end": 46181, "example_id": "0002d7a65932c0fdc18ede08e8051ca69a5a60990ce4434e062e1dceda15b523", "language": "c", "prefix": "\n\n // Error: missing BY\n {\n const char *input = \"emb float[128] INDEXED diskann(neighbor_quantizer=binary)\";\n rc = vec0_parse_vector_column(input, (int)strlen(input), &col);\n assert(rc == SQLITE_ERROR);\n }\n\n // Error: unknown algorithm\n {\n ", "repo": "asg017/sqlite-vec", "span_codepoints": 32, "start": 46149, "suffix": "128] INDEXED BY hnsw(neighbor_quantizer=binary)\";\n rc = vec0_parse_vector_column(input, (int)strlen(input), &col);\n assert(rc == SQLITE_ERROR);\n }\n\n // Error: unknown option key\n {\n const char *input = \"emb float[128] INDEXED BY diskann(neighbo", "target": " const char *input = \"emb float["} {"bin": "8_token_ish", "content_sha256": "b3ad41b0689c17cd7c1de3e0a08f5011bda7d693370008413492e2125b91773f", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:agent/disk_test.go", "end": 15218, "example_id": "0002d9ede84150bc978d27d1b9ab24a5dcb6aeaca5ed6ef5108512711e4a1fd4", "language": "go", "prefix": "efPath: \"/extra-filesystems\",\n\t\t\t\tdiskIoCounters: map[string]disk.IOCountersStat{\n\t\t\t\t\t\"nvme0n1p1\": {Name: \"nvme0n1p1\"},\n\t\t\t\t\t\"nvme1n1\": {Name: \"nvme1n1\"},\n\t\t\t\t},\n\t\t\t},\n\t\t}\n\t}\n\n\tt.Run(\"registers direct child of extra-filesystems\", func(t *testing.T) {", "repo": "henrygd/beszel", "span_codepoints": 32, "start": 15186, "suffix": "(map[string]*system.FsStats)}\n\t\td := makeDiscovery(agent)\n\n\t\td.addPartitionExtraFs(disk.PartitionStat{\n\t\t\tDevice: \"/dev/nvme0n1p1\",\n\t\t\tMountpoint: \"/extra-filesystems/nvme0n1p1__caddy1-root\",\n\t\t})\n\n\t\tstats, exists := agent.fsStats[\"nvme0n1p1\"]\n\t\tassert", "target": "\n\t\tagent := &Agent{fsStats: make"} {"bin": "8_token_ish", "content_sha256": "a9cbe88ad1942abf948ad9f3ca3dc064f9d63ed3a0fe95cbecc794f45e2662c9", "document_id": "unitycatalog/unitycatalog@ed504deea31b30c3e7d27e360372077cce04a509:server/src/test/java/io/unitycatalog/server/utils/PopulateTestDatabase.java", "end": 7481, "example_id": "0002df7ea6cf5b6da82660a53ff9025fdca2de197f5d451840dc4deb64bda0cc", "language": "java", "prefix": "d();\n addTypeTextAndJsonText(marksColumnUniform);\n\n TableInfoDAO uniformTableInfoDAO =\n TableInfoDAO.builder()\n .id(uniformTableId)\n .name(tableName + \"_uniform\")\n .schemaId(UUID.fromString(schemaId))\n ", "repo": "unitycatalog/unitycatalog", "span_codepoints": 32, "start": 7449, "suffix": " .columns(List.of(idColumnUniform, nameColumnUniform, marksColumnUniform))\n .dataSourceFormat(DataSourceFormat.DELTA.getValue())\n .type(TableType.EXTERNAL.getValue())\n .createdAt(new Date())\n .updatedAt(n", "target": " .comment(\"Uniform table\")\n "} {"bin": "32_token_ish", "content_sha256": "79ed8d9f177c8fd734382eb386f48693117fcc6f0f849d771d5d12dd5616ffeb", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/mcp/src/lib/auth/auth-prompt.ts", "end": 1614, "example_id": "0002e8d3f888793e0cda4b0fc62842fbc3ff97cc2b602dac1e56eb49ecc73699", "language": "typescript", "prefix": "d writes credentials into your MCP client config.\",\n \"After it finishes, disable then re-enable the Context7 MCP server in your editor so the new credentials take effect.\",\n ].join(\"\\n\");\n}\n\n// User-facing strings double as enum const values: keeps the", "repo": "upstash/context7", "span_codepoints": 128, "start": 1486, "suffix": "\nconst CHOICE_RUN_SETUP = \"I'll run the command to sign in\";\nconst CHOICE_STAY_ANON = \"Continue anonymously with smaller limits\";\n\n/**\n * Fires a form-mode elicitation that surfaces a sign-in nudge in the client UI\n * when the backend has signaled (via `X-", "target": " schema in the\n// simpler `enum: [...]` shape, which clients render more reliably than\n// `oneOf` with separate `const`/`title`."} {"bin": "8_token_ish", "content_sha256": "9afb82603add497b23b3fc1bda6166cca0f8459d3dc1eaf52e53a6c5bb07605d", "document_id": "cloudwego/eino@ca0441ac0bceed8945dcf7d5a18c237c924c6aa8:adk/failover_chatmodel_test.go", "end": 16976, "example_id": "0002e9de0001d219b2f1e4825609cdaa9f626d7798dbb6baa6468a9c6fc680da", "language": "go", "prefix": "Attempt)\n\t\t\t\treturn m2, nil, nil\n\t\t\t},\n\t\t}\n\n\t\tw := newFailoverModelWrapper[*schema.Message](&failoverProxyModel{}, cfg)\n\t\tctx := withTypedChatModelAgentExecCtx(context.Background(), &chatModelAgentExecCtx{\n\t\t\tfailoverLastSuccessModel: m1,\n\t\t})\n\t\tsr, err :=", "repo": "cloudwego/eino", "span_codepoints": 32, "start": 16944, "suffix": "{schema.UserMessage(\"hi\")})\n\t\trequire.NoError(t, err)\n\t\tmsgs, err := drainMessageStream(sr)\n\t\trequire.NoError(t, err)\n\t\trequire.Len(t, msgs, 1)\n\t\trequire.Equal(t, \"final\", msgs[0].Content)\n\t\trequire.Equal(t, \"p1p2\", seenOutput.Load())\n\t\trequire.Equal(t, in", "target": " w.Stream(ctx, []*schema.Message"} {"bin": "32_token_ish", "content_sha256": "68074fd22a569d98ccb447ed827a43637115b4b427cd5c53ef21810f1a0f66c1", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/observability.py", "end": 1091, "example_id": "0002edc0b76665fff1c3a2165b42611a949ea14ce552adca1314046a1d4f22a7", "language": "python", "prefix": "port Any, Literal, TypeVar, cast\n\nlogger = logging.getLogger(__name__)\nfrom dotenv import load_dotenv\n\nload_dotenv()\n\n# Type definitions\nF = TypeVar('F', bound=Callable[..., Any])\n\n\n# Check if we're in debug mode\ndef _is_debug_mode() -> bool:\n\t\"\"\"Check if ", "repo": "browser-use/browser-use", "span_codepoints": 128, "start": 963, "suffix": "lower()\n\tif lmnr_debug_mode == 'debug':\n\t\t# logger.info('Debug mode is enabled for observability')\n\t\treturn True\n\t# logger.info('Debug mode is disabled for observability')\n\treturn False\n\n\n# Try to import lmnr observe\n_LMNR_AVAILABLE = False\n_lmnr_observe =", "target": "we're in debug mode based on environment variables or logging level.\"\"\"\n\n\tlmnr_debug_mode = os.getenv('LMNR_LOGGING_LEVEL', '')."} {"bin": "64_token_ish", "content_sha256": "06f26bb3c51ea4c51fbae2011a47c06440f2c1d43820a6eb65732476abc3450c", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:sqlite-vec-rescore.c", "end": 15375, "example_id": "000303fa034fb62d0fbb436f22503192f8a779af6251491cbe9e72e5069c5c31", "language": "c", "prefix": " {\n rc = SQLITE_ERROR;\n goto cleanup;\n }\n // Validate blob sizes match chunk_size expectations\n if (validityBytes < (p->chunk_size + 7) / 8 ||\n rowidsBytes < p->chunk_size * (int)sizeof(i64)) {\n rc = SQLITE_ERROR;\n goto ", "repo": "asg017/sqlite-vec", "span_codepoints": 256, "start": 15119, "suffix": ";\n for (int j = 0; j < p->chunk_size; j++) {\n if (!bitmap_get(chunkValidity, j))\n continue;\n i64 rid = chunkRowids[j];\n void *found = bsearch(&rid, arrayRowidsIn->z, arrayRowidsIn->length,\n s", "target": "cleanup;\n }\n\n memset(chunk_distances, 0, p->chunk_size * sizeof(f32));\n memset(chunk_topk_idxs, 0, k_oversample * sizeof(i32));\n bitmap_copy(b, chunkValidity, p->chunk_size);\n\n if (arrayRowidsIn) {\n bitmap_clear(bmRowids, p->chunk_size)"} {"bin": "32_token_ish", "content_sha256": "e6a3afe46f95ebf1b7e2059c7f0f07a9f8699cae7d7f775def63b542b03ec689", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/answer.sh", "end": 14085, "example_id": "00030626ff96f77db41c9fb21538a51c8b5e4434e94532d38d4947a8e395fa2c", "language": "shell", "prefix": " \"Failed to select $type image index $index!\"\n return 1\n fi\n fi\n\n if ! markGeneratedXML \"$tmp\" ||\n ! xmllint --nonet --noout \"$tmp\"; then\n rm -f \"$tmp\"\n error \"Generated $type answer file is invalid!\"\n return 1\n fi\n\n if ! chmod 644 ", "repo": "dockur/windows", "span_codepoints": 128, "start": 13957, "suffix": " fi\n\n return 0\n}\n\ngenerateEvalXML() {\n\n # Evaluation templates are generated from their normal counterpart so\n # both variants remain identical except for evaluation-specific selectors.\n\n local id=\"$1\"\n local detected_index=\"${2:-}\"\n local normal=\"${", "target": "\"$tmp\" || ! mv -f \"$tmp\" \"$target\"; then\n rm -f \"$tmp\"\n error \"Failed to create $type answer file: $target\"\n return 1\n "} {"bin": "8_token_ish", "content_sha256": "95383ddef7ba45f64965375a87116f32448700cc800cadba683fdbfb17a4a95e", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/test_history_wait_time.py", "end": 3144, "example_id": "000317d756ad550db6336dba541664135c4ba5c3b68e30dc5a8b167d63c9248c", "language": "python", "prefix": "ate old format from JSON\n\told_metadata_dict = {\n\t\t'step_number': 0,\n\t\t'step_start_time': 1000.0,\n\t\t'step_end_time': 1002.5,\n\t\t# step_interval field doesn't exist (old format)\n\t}\n\n\t# Should load successfully with step_interval defaulting to None\n\tmetadata =", "repo": "browser-use/browser-use", "span_codepoints": 32, "start": 3112, "suffix": "_metadata_dict)\n\n\tassert metadata.step_number == 0\n\tassert metadata.step_start_time == 1000.0\n\tassert metadata.step_end_time == 1002.5\n\tassert metadata.step_interval is None # Default value\n\n\ndef test_duration_seconds_property_still_works():\n\t\"\"\"Test that", "target": " StepMetadata.model_validate(old"} {"bin": "32_token_ish", "content_sha256": "7710f0c3f8a841937588aa777aa88e7c65df3bfbca88158aa2f93fbc65ca96d9", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/__tests__/auth-commands.test.ts", "end": 8851, "example_id": "0003212c2234a0442e4f64a1a30202864c7d9d386a7067a5e9608f1ee7f3685c", "language": "typescript", "prefix": ": \"bearer\" },\n });\n\n const pending = performLogin(false);\n // First poll fires after the initial 0ms interval; slow_down then\n // bumps the interval by 5000ms before the second poll.\n await vi.advanceTimersByTimeAsync(5500);\n ", "repo": "upstash/context7", "span_codepoints": 128, "start": 8723, "suffix": "finally {\n vi.useRealTimers();\n }\n });\n\n test(\"returns null when start request throws\", async () => {\n mockStartDeviceAuthorization.mockRejectedValue(new Error(\"network down\"));\n\n expect(await performLogin(false)).toBeNull();\n expect(moc", "target": "const result = await pending;\n expect(result).toBe(\"t\");\n expect(mockPollDeviceToken).toHaveBeenCalledTimes(2);\n } "} {"bin": "16_token_ish", "content_sha256": "c84154be2a7e8cb5c0b350485417005c4865b86870578e24f3b773b5a82c97d3", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/cli/install.rs", "end": 11435, "example_id": "0003216bc1ca8a073368c81393f364edc11feed0e3ecc62ea6dbd497acf3e554", "language": "rust", "prefix": "))\n .replace(\"[PREK_ARGS]\", &args.join(\" \"));\n\n fs_err::OpenOptions::new()\n .write(true)\n .create(true)\n .truncate(true)\n .open(&hook_path)?\n .write_all(hook_script.as_bytes())?;\n\n #[cfg(unix)]\n {\n ", "repo": "j178/prek", "span_codepoints": 64, "start": 11371, "suffix": "hook_path.metadata()?.permissions();\n perms.set_mode(hook_mode);\n fs_err::set_permissions(&hook_path, perms)?;\n }\n\n // Unused on non-Unix platforms\n #[cfg(not(unix))]\n let _ = hook_mode;\n\n writeln!(printer.stdout(), \"{hint}\")?;", "target": "use std::os::unix::fs::PermissionsExt;\n\n let mut perms = "} {"bin": "32_token_ish", "content_sha256": "0c1b6668c25c53f3726ae586a89b69d62c3032532207e5e702e02c928a10f680", "document_id": "cloudwego/eino@ca0441ac0bceed8945dcf7d5a18c237c924c6aa8:compose/chain_branch_test.go", "end": 5862, "example_id": "00032e58cde93583b30d0977a5e8ed5305ca1fd0dc676abb6951d6123c48b84e", "language": "go", "prefix": "utput, nil\n\t\t\t})))\n\n\t\tassert.Nil(t, c.err)\n\t\tcompiledChain, err := c.Compile(context.Background())\n\t\tassert.Nil(t, err)\n\n\t\tout, err := compiledChain.Invoke(context.Background(), \"one\")\n\t\tassert.Nil(t, err)\n\t\tassert.Equal(t, \"oneone\", out)\n\t})\n\n\tt.Run(\"real", "repo": "cloudwego/eino", "span_codepoints": 128, "start": 5734, "suffix": " {\n\t\t\tmsg, err := sr.Recv()\n\t\t\tif err != nil {\n\t\t\t\treturn \"\", err\n\t\t\t}\n\t\t\tdefer sr.Close()\n\n\t\t\tswitch msg {\n\t\t\tcase \"one\":\n\t\t\t\treturn \"one_key\", nil\n\t\t\tcase \"two\":\n\t\t\t\treturn \"two_key\", nil\n\t\t\tcase \"three\":\n\t\t\t\treturn \"three_key\", nil\n\t\t\tdefault:\n\t\t\t\tretur", "target": " stream\", func(t *testing.T) {\n\t\tstreamCon := func(ctx context.Context, sr *schema.StreamReader[string]) (key string, err error)"} {"bin": "8_token_ish", "content_sha256": "06f26bb3c51ea4c51fbae2011a47c06440f2c1d43820a6eb65732476abc3450c", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:sqlite-vec-rescore.c", "end": 1138, "example_id": "00033273f4f5185e93a8171e5f0ab036d781962e9ad133e9f7b4054af18afebb", "language": "c", "prefix": " // Quantized chunk table (same layout as _vector_chunks)\n char *zSql = sqlite3_mprintf(\n \"CREATE TABLE \\\"%w\\\".\\\"%w_rescore_chunks%02d\\\"\"\n \"(rowid PRIMARY KEY, vectors BLOB NOT NULL)\",\n p->schemaName, p->tableName, i);\n if (!zSql", "repo": "asg017/sqlite-vec", "span_codepoints": 32, "start": 1106, "suffix": " sqlite3_stmt *stmt;\n int rc = sqlite3_prepare_v2(db, zSql, -1, &stmt, 0);\n sqlite3_free(zSql);\n if ((rc != SQLITE_OK) || (sqlite3_step(stmt) != SQLITE_DONE)) {\n *pzErr = sqlite3_mprintf(\n \"Could not create '_rescore_chunks%02d' shad", "target": ")\n return SQLITE_NOMEM;\n "} {"bin": "8_token_ish", "content_sha256": "3641a863ac524478d70063e4487c16e17230c167d21d6ebdd2a738539d836a63", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/archive.rs", "end": 7417, "example_id": "000336198cfac164ebafc3bf71372c619475d39b1b0ecc6d596e915c01bec2b8", "language": "rust", "prefix": " prior to proceeding, as per:\n // https://docs.rs/async_zip/0.0.16/async_zip/base/read/stream/\n (.., zip) = entry.skip().await?;\n\n // Store the current offset.\n offset = zip.offset();\n\n continue;\n ", "repo": "j178/prek", "span_codepoints": 32, "start": 7385, "suffix": ".join(path);\n let is_dir = entry.reader().entry().dir()?;\n\n // Either create the directory or write the file to disk.\n if is_dir {\n if directories.insert(path.clone()) {\n fs_err::tokio::create_dir_all(path).aw", "target": " };\n\n let path = target"} {"bin": "64_token_ish", "content_sha256": "bc0af3ba327657630e5f6c60be619e6b5394bf03edc29b1384a15f09a1b348bf", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:src/hooks/caveman-activate.js", "end": 3486, "example_id": "00033d9ab62e5672a7a8c2eb2ee44ab96559533530e77753c3f5fa1aa57ad69d", "language": "javascript", "prefix": "th hooks at\n// $CLAUDE_CONFIG_DIR/hooks/ and the skill at $CLAUDE_CONFIG_DIR/skills/caveman/.\n// All misses fall through to the hardcoded fallback ruleset below.\nconst skillCandidates = [];\nif (process.env.CLAUDE_PLUGIN_ROOT) {\n skillCandidates.push(", "repo": "JuliusBrussee/caveman", "span_codepoints": 256, "start": 3230, "suffix": "';\nfor (const candidate of skillCandidates) {\n try {\n skillContent = fs.readFileSync(candidate, 'utf8');\n break;\n } catch (e) { /* try next candidate */ }\n}\n\nlet output;\n\nif (skillContent) {\n // Strip YAML frontmatter\n const body = skillContent.r", "target": "path.join(process.env.CLAUDE_PLUGIN_ROOT, 'skills', 'caveman', 'SKILL.md'));\n}\nskillCandidates.push(\n path.join(__dirname, '..', '..', 'skills', 'caveman', 'SKILL.md'),\n path.join(__dirname, '..', 'skills', 'caveman', 'SKILL.md')\n);\n\nlet skillContent = '"} {"bin": "8_token_ish", "content_sha256": "6f8e0258269e160c83ea20b5b6568220afad26b3a325e65bb3c1e7dd27297781", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:type-driven-correctness-book/src/ch13-reference-card.md", "end": 4955, "example_id": "00033de5e0a3aa7fdee17ed0f83206cbe3f59edd81d1ce71b500dba53f2d5600", "language": "markdown", "prefix": "e | Don't derive Clone |\n| `let vendor_id: u16 = 0xFFFF` | Sentinel carried internally | `let vendor_id: Option = None` |\n| `fn route(level: &str)` with fallback | Typos silently default | `let level: DiagLevel = s.parse()?` |\n| `Builder::new().finish", "repo": "microsoft/RustTraining", "span_codepoints": 32, "start": 4923, "suffix": "object constructed | Typestate builder: `finish()` gated on `Set` |\n| `let buf: Vec` for fixed-size HW buffer | Size only checked at runtime | `RegisterBank<4096>` (const generic) |\n| Raw `unsafe { ptr::read(...) }` scattered | UB risk, unauditable | `", "target": "()` without fields | Incomplete "} {"bin": "16_token_ish", "content_sha256": "bfb61792348d0e569cedf1c2b3307d237c6c2ecebbf76db01f09e4a0c8922f38", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:cmd/robots2policy/main.go", "end": 1713, "example_id": "000344d27c4d98c2d71d6b719fb9f0079435e62c3ec383c16695e5a0b7c550c6", "language": "go", "prefix": "ig.Weight `yaml:\"weight,omitempty\" json:\"weight,omitempty\"`\n\tName string `yaml:\"name\" json:\"name\"`\n\tAction string `yaml:\"action\" json:\"action\"`\n}\n\nfunc init() {\n\tflag.Usage = func() {\n\t\tfmt.Fprintf(os", "repo": "TecharoHQ/anubis", "span_codepoints": 64, "start": 1649, "suffix": "\"%s [options] -input \\n\\n\", os.Args[0])\n\t\tflag.PrintDefaults()\n\t\tfmt.Fprintln(os.Stderr, \"\\nExamples:\")\n\t\tfmt.Fprintln(os.Stderr, \" # Convert local robots.txt file\")\n\t\tfmt.Fprintln(os.Stderr, \" robots2policy -input robots.txt -output policy.y", "target": ".Stderr, \"Usage of %s:\\n\", os.Args[0])\n\t\tfmt.Fprintf(os.Stderr, "} {"bin": "8_token_ish", "content_sha256": "5a9976de581707f0f816221505b968d3d2da6a9415279166c491882a217f5ad7", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/linker/lnk_symbol_table.c", "end": 16564, "example_id": "000352c2a7f43acd1d1587cd2ae88d621b2e36ea28c5f37fe093a99f0c7cfef7", "language": "c", "prefix": "x1000);\n new_trie->name = &symbol->name;\n new_trie->symbol = symbol;\n MemoryZeroArray(new_trie->child);\n\n // try to insert new node\n LNK_SymbolHashTrie *cmp = ins_atomic_ptr_eval_cond_assign(curr_trie_ptr,", "repo": "EpicGames/raddebugger", "span_codepoints": 32, "start": 16532, "suffix": " was symbol inserted?\n if (cmp == curr_trie) {\n break;\n }\n\n // rollback chunk list push\n --chunks->last->count;\n\n // retry insert with trie node from another thread\n curr_trie = cmp;\n }\n\n // load current symbol\n ", "target": " new_trie, curr_trie);\n\n //"} {"bin": "32_token_ish", "content_sha256": "bd73903a16a7ef88221cde582f85e861f568f4d9fd018c94d82ebbde37357b6e", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/lichess/lichess.test.js", "end": 3007, "example_id": "00035e73549bd9e6738e0bb311d8593ad9b3080ef91f8b3bc1c6e24ab8e749f2", "language": "javascript", "prefix": "ching', async () => {\n const fetchMock = vi.fn();\n vi.stubGlobal('fetch', fetchMock);\n await expect(cmd.func({ perf: '' })).rejects.toThrow(ArgumentError);\n await expect(cmd.func({ perf: 'turbo' })).rejects.toThrow(ArgumentError", "repo": "jackwener/OpenCLI", "span_codepoints": 128, "start": 2879, "suffix": "toHaveBeenCalled();\n });\n\n it('throws EmptyResultError on empty leaderboard', async () => {\n vi.stubGlobal('fetch', vi.fn().mockResolvedValue(new Response(JSON.stringify({ users: [] }), { status: 200 })));\n await expect(cmd.func({ perf:", "target": ");\n await expect(cmd.func({ perf: 'blitz', limit: 9999 })).rejects.toThrow(ArgumentError);\n expect(fetchMock).not."} {"bin": "64_token_ish", "content_sha256": "052d859eda206385b608aba621784a7ef7dce0e689a5dcc6b9f45f7aed596e76", "document_id": "cloudwego/eino@ca0441ac0bceed8945dcf7d5a18c237c924c6aa8:adk/interrupt_test.go", "end": 63701, "example_id": "00036ddcecad4a66bd25f5ff05517cb2a9b456233b74470d21653153e4246200", "language": "go", "prefix": "eckpointErr error\n\tfor {\n\t\tevent, ok := iter.Next()\n\t\tif !ok {\n\t\t\tbreak\n\t\t}\n\t\tevents = append(events, event)\n\t\tif event.Err != nil {\n\t\t\tcheckpointErr = event.Err\n\t\t\tt.Logf(\"event error: %v\", event.Err)\n\t\t}\n\t}\n\n\t// The bug: checkpoint save fails because the", "repo": "cloudwego/eino", "span_codepoints": 256, "start": 63445, "suffix": "failed stream's error in session\")\n\n\tvar hasInterrupt bool\n\tfor _, event := range events {\n\t\tif event.Action != nil && event.Action.Interrupted != nil {\n\t\t\thasInterrupt = true\n\t\t}\n\t}\n\tassert.True(t, hasInterrupt, \"should receive an interrupt event from the", "target": " failed stream's error chunk\n\t// is encountered during gob encoding of the session events.\n\t// If the bug is fixed, checkpointErr should be nil and we should see an interrupt event.\n\tassert.NoError(t, checkpointErr, \"checkpoint save should not fail due to "} {"bin": "8_token_ish", "content_sha256": "35d3bac200ce605ab32a55e6d873c36bd652ca3ec57136de120b0870f450cb79", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/core/validation.test.ts", "end": 7003, "example_id": "00037b69df6a742b12c729fa88f43cc113c75a21f5ceb27d2ee46cb47af03afa", "language": "typescript", "prefix": "\n#### Scenario: Invalid credentials\nGiven a user with invalid credentials\nWhen they submit the login form\nThen they see an error message`;\n\n const specPath = path.join(testDir, 'spec.md');\n await fs.writeFile(specPath, specContent);\n \n ", "repo": "Fission-AI/OpenSpec", "span_codepoints": 32, "start": 6971, "suffix": ");\n const report = await validator.validateSpec(specPath);\n \n expect(report.valid).toBe(true);\n expect(report.summary.errors).toBe(0);\n });\n\n it('should detect missing overview section', async () => {\n const specContent = `# ", "target": "const validator = new Validator("} {"bin": "64_token_ish", "content_sha256": "d84cd6b8a42ef21acf064a431e36ca1db3f3c27035b11f04a96b2abfa87b7933", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/core/references.test.ts", "end": 7929, "example_id": "000381cd3201cf314a8f24bdbb2b0cdde433334ca16bb7dec0a39f500f1a7f72", "language": "typescript", "prefix": "ce_root_unhealthy',\n fix: expect.stringContaining('openspec store doctor'),\n })\n );\n }\n });\n\n it('degrades every reference when the registry is unreadable', async () => {\n const registryDir = path.join(globalDataDir, 'stores');", "repo": "Fission-AI/OpenSpec", "span_codepoints": 256, "start": 7673, "suffix": "entry of entries) {\n expect(entry.status[0].code).toBe('reference_registry_unreadable');\n }\n });\n\n it('skips spec content, fetch recipes, and the budget in health mode (3.6)', async () => {\n const storeRoot = await registerStore('team-context'", "target": "\n fs.mkdirSync(registryDir, { recursive: true });\n fs.writeFileSync(path.join(registryDir, 'registry.yaml'), ':[ not yaml');\n\n const entries = await assemble(['team-context', 'other-context']);\n\n expect(entries).toHaveLength(2);\n for (const "} {"bin": "8_token_ish", "content_sha256": "41f333c036d3e7c5d742f81da42534ef63ce6c1c25b2237145029d55248000f3", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/image.sh", "end": 3919, "example_id": "0003859ef3a8760e7dd1e8007b867a4d840d70fe32523507f6124672a01f71e3", "language": "shell", "prefix": "_name=\"$5\"\n local -n versions_ref=\"$versions_name\"\n local -n bases_ref=\"$bases_name\"\n local -n groups_ref=\"$groups_name\"\n local -n indexes_ref=\"$indexes_name\"\n\n local count image image_index\n local display product platform\n local edition_id install_", "repo": "dockur/windows", "span_codepoints": 32, "start": 3887, "suffix": " versions_ref=()\n bases_ref=()\n groups_ref=()\n indexes_ref=()\n\n platform=$(getPlatform \"$xml\")\n count=$(xmllint --nonet --xpath 'count(/WIM/IMAGE)' - 2>/dev/null <<< \"$xml\") || return 0\n\n for ((i=1; i<=count; i++)); do\n\n image_index=$(xmllint --n", "target": "type\n local candidate flags i\n\n"} {"bin": "8_token_ish", "content_sha256": "0ade33ba18b5de7898b0031c737185a5bc944d529b58ba3661e833f930a77ade", "document_id": "cloudwego/eino@ca0441ac0bceed8945dcf7d5a18c237c924c6aa8:adk/filesystem/backend_inmemory_test.go", "end": 15931, "example_id": "000385bf0813d628b475dad13d0c705e7aa26575ed21198c05ea9cd6564a2afa", "language": "go", "prefix": "] = true\n\t\t\t} else {\n\t\t\t\tt.Errorf(\"Unexpected path: %s\", info.Path)\n\t\t\t}\n\t\t}\n\n\t\tfor path, found := range expected {\n\t\t\tif !found {\n\t\t\t\tt.Errorf(\"Expected absolute path not found: %s\", path)\n\t\t\t}\n\t\t}\n\t})\n}\n\nfunc TestInMemoryBackend_Concurrent(t *testing.T) ", "repo": "cloudwego/eino", "span_codepoints": 32, "start": 15899, "suffix": "()\n\tctx := context.Background()\n\n\t// Test concurrent writes and reads\n\tdone := make(chan bool)\n\tfor i := 0; i < 10; i++ {\n\t\tgo func(n int) {\n\t\t\tbackend.Write(ctx, &WriteRequest{\n\t\t\t\tFilePath: \"/concurrent.txt\",\n\t\t\t\tContent: \"content\",\n\t\t\t})\n\t\t\tbackend.Rea", "target": "{\n\tbackend := NewInMemoryBackend"} {"bin": "64_token_ish", "content_sha256": "fafc7dce4309aac0cdf33c8d5eb4f90a536fca6595a6ec33ae75df4e9e72f247", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/llm/litellm/chat.py", "end": 2513, "example_id": "0003865e59e050d90a40cec47b6954f03f72f6f62fd2570fba9077c30c1de992", "language": "python", "prefix": "one:\n\t\t\"\"\"Extract token usage from a litellm response.\"\"\"\n\t\tusage = getattr(response, 'usage', None)\n\t\tif usage is None:\n\t\t\treturn None\n\n\t\tprompt_tokens = getattr(usage, 'prompt_tokens', 0) or 0\n\t\tcompletion_tokens = getattr(usage, 'completion_tokens', 0) ", "repo": "browser-use/browser-use", "span_codepoints": 256, "start": 2257, "suffix": "_cached = getattr(details, 'cached_tokens', None)\n\n\t\treturn ChatInvokeUsage(\n\t\t\tprompt_tokens=prompt_tokens,\n\t\t\tprompt_cached_tokens=int(prompt_cached) if prompt_cached is not None else None,\n\t\t\tprompt_cache_creation_tokens=int(cache_creation) if cache_cre", "target": "or 0\n\n\t\tprompt_cached = getattr(usage, 'cache_read_input_tokens', None)\n\t\tcache_creation = getattr(usage, 'cache_creation_input_tokens', None)\n\n\t\tif prompt_cached is None:\n\t\t\tdetails = getattr(usage, 'prompt_tokens_details', None)\n\t\t\tif details:\n\t\t\t\tprompt"} {"bin": "64_token_ish", "content_sha256": "37dea31db4757ee41e18bf6e82526d2c4e421cd01cf03ba56b2f4a0f64b26cc7", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/pdb/pdb_parse.c", "end": 29287, "example_id": "0003887410964c8256357ef47d3797fe42fbe72bdb07c44919f6061320965254", "language": "c", "prefix": "+ 1);\n CV_NumericParsed size = cv_numeric_from_data_range(numeric_ptr, first + cap);\n \n // name\n U8 *name_ptr = numeric_ptr + size.encoded_size;\n String8 name = ", "repo": "EpicGames/raddebugger", "span_codepoints": 256, "start": 29031, "suffix": " U8 *unique_name_ptr = name_ptr + name.size + 1;\n String8 unique_name = str8_cstring_capped((char*)unique_name_ptr, (char *)(first + cap));\n extracted_name = unique_name;\n }\n ", "target": "str8_cstring_capped((char*)name_ptr, (char *)(first + cap));\n \n // unique name\n if (compare_unique_name){\n if (lf_struct->props & CV_TypeProp_HasUniqueName) {\n "} {"bin": "64_token_ish", "content_sha256": "a618f96d7f0b1e9c887a3ca44e23f411f471845cd521c72fb41df8fef6b335fb", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/paperreview/submit.js", "end": 2303, "example_id": "00038ffac561a70700a979f78d20760d4e1ac26acd79818b2551b91eef0243ab", "language": "javascript", "prefix": " throw new CliError('ARGUMENT', 'An email address is required.', 'Pass --email
');\n }\n if (dryRun) {\n return summarizeSubmission({\n pdfFile,\n email,\n venue,\n ", "repo": "jackwener/OpenCLI", "span_codepoints": 256, "start": 2047, "suffix": " method: 'POST',\n headers: { 'Content-Type': 'application/json' },\n body: JSON.stringify({\n filename: pdfFile.fileName,\n venue,\n }),\n });\n ensureSuccess(uploadUrlResponse, upload", "target": " message: 'Input validation passed. No remote request was sent.',\n dryRun: true,\n });\n }\n const { response: uploadUrlResponse, payload: uploadUrlPayload } = await requestJson('/api/get-upload-url', {\n "} {"bin": "64_token_ish", "content_sha256": "484e503fcb815524b23c61ae6a3c74d86ade5f21fae906a41317ec2f8925fb88", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/__tests__/remove.test.ts", "end": 2060, "example_id": "000396a62e33ab70da382c6e852bf5f047639eb847df0eb8f6d2afefe03ee27f", "language": "typescript", "prefix": "n(tmpdir(), `ctx7-uninstall-${Date.now()}`);\n await mkdir(tempDir, { recursive: true });\n process.chdir(tempDir);\n});\n\nafterEach(async () => {\n process.chdir(originalCwd);\n await rm(tempDir, { recursive: true, force: true });\n vi.restoreAllMocks();\n})", "repo": "upstash/context7", "span_codepoints": 256, "start": 1804, "suffix": "\", \"SKILL.md\");\n const mcpSkillPath = join(tempDir, \".cursor\", \"skills\", \"context7-mcp\", \"SKILL.md\");\n\n await mkdir(join(tempDir, \".cursor\", \"rules\"), { recursive: true });\n await mkdir(join(tempDir, \".cursor\", \"skills\", \"find-docs\"), { recursive:", "target": ";\n\ndescribe(\"remove command\", () => {\n test(\"removes only CLI artifacts for cursor project setup\", async () => {\n const rulePath = join(tempDir, \".cursor\", \"rules\", \"context7.mdc\");\n const cliSkillPath = join(tempDir, \".cursor\", \"skills\", \"find-docs"} {"bin": "64_token_ish", "content_sha256": "f9195f442170c1d21467e69398def04e748f5bbbc5ab619c289aec8d5a9d422f", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/yahoo/search.test.js", "end": 707, "example_id": "00039c3cfc064e44118889a3daeaad021d2be207a84547434ac8d0d2876731bf", "language": "javascript", "prefix": " goto: vi.fn().mockResolvedValue(undefined),\n wait: vi.fn().mockResolvedValue(undefined),\n evaluate: vi.fn().mockResolvedValue(evaluateResult),\n };\n}\n\ndescribe('yahoo search', () => {\n it('should register as a valid command', () => {\n expect(", "repo": "jackwener/OpenCLI", "span_codepoints": 256, "start": 451, "suffix": ").toBe('search.yahoo.com');\n });\n\n it('should define keyword positional arg', () => {\n const kwArg = command.args.find(a => a.name === 'keyword');\n expect(kwArg).toBeDefined();\n expect(kwArg.positional).toBe(true);\n expect(kwArg.required).toB", "target": "command).toBeDefined();\n expect(command.site).toBe('yahoo');\n expect(command.name).toBe('search');\n expect(command.access).toBe('read');\n expect(command.browser).toBe(true);\n expect(command.strategy).toBe('public');\n expect(command.domain"} {"bin": "32_token_ish", "content_sha256": "9ea1b94f6304d1aed4b677b35338f932f9e29b4d712b138062c3227746209b38", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_wikipedia_converter.py", "end": 1745, "example_id": "00039f8cc508b709accd7b0e3770b04b6b271c0d45c0d95ab47b3b6ebd259986", "language": "python", "prefix": "o: StreamInfo,\n **kwargs: Any, # Options to pass to the converter\n ) -> DocumentConverterResult:\n # Parse the stream\n encoding = \"utf-8\" if stream_info.charset is None else stream_info.charset\n soup = bs4.BeautifulSoup(file_", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 1617, "suffix": "\", \"style\"]):\n script.extract()\n\n # Print only the main content\n body_elm = soup.find(\"div\", {\"id\": \"mw-content-text\"})\n title_elm = soup.find(\"span\", {\"class\": \"mw-page-title-main\"})\n\n webpage_text = \"\"\n main_", "target": "stream, \"html.parser\", from_encoding=encoding)\n\n # Remove javascript and style blocks\n for script in soup([\"script"} {"bin": "16_token_ish", "content_sha256": "20d0c254b23a5b09ef7d3c07ac1d45e381cfd1c069fdfe8a85db113539d02f3c", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/commands/store-root-selection.test.ts", "end": 3362, "example_id": "0003a8583c50fd5e78cb1c47310d91fd3df923934a8b0d7a0414dfafad693827", "language": "typescript", "prefix": "FileSync(\n path.join(changeDir, 'proposal.md'),\n '## Why\\nBilling needs work.\\n\\n## What Changes\\n- **billing:** Add billing\\n'\n );\n fs.writeFileSync(\n path.join(changeDir, 'tasks.md'),\n options.tasksDone === false ? '- [ ] Task 1", "repo": "Fission-AI/OpenSpec", "span_codepoints": 64, "start": 3298, "suffix": ") {\n const specDir = path.join(changeDir, 'specs', 'billing');\n fs.mkdirSync(specDir, { recursive: true });\n fs.writeFileSync(path.join(specDir, 'spec.md'), options.deltaSpec ?? VALID_DELTA_SPEC);\n }\n return changeDir;\n }\n\n function ", "target": "\\n' : '- [x] Task 1\\n'\n );\n if (options.deltaSpec !== null"} {"bin": "16_token_ish", "content_sha256": "8ae91557828e8597f00437dbbb71227e676e152c94bbd03804aee6a1bcaa4987", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/hooks/pre_commit_hooks/check_merge_conflict.rs", "end": 4387, "example_id": "0003ad4fb159b227285c08aed1f4afe4ab0691fc50394ef043edb60afc515f25", "language": "rust", "prefix": ", \"clean.txt\", content).await?;\n let (code, output) = check_file(Path::new(\"\"), &file_path).await?;\n assert_eq!(code, 0);\n assert!(output.is_empty());\n Ok(())\n }\n\n #[tokio::test]\n async fn test_conflict_marker_start() -", "repo": "j178/prek", "span_codepoints": 64, "start": 4323, "suffix": " = b\"Some content\\n<<<<<<< HEAD\\nConflicting line\\n\";\n let file_path = create_test_file(&dir, \"conflict.txt\", content).await?;\n let (code, output) = check_file(Path::new(\"\"), &file_path).await?;\n assert_eq!(code, 1);\n assert!(!o", "target": "> Result<()> {\n let dir = tempdir()?;\n let content"} {"bin": "64_token_ish", "content_sha256": "ab7d0b795cc4c53fbc05178f67b73f0d6f93fb57cd448017f2d32470a77c9546", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:src/core/update.ts", "end": 9208, "example_id": "0003b0ac172bc27f840b12da3c6b27d46694b2e8987c1605fd19eb3b06c24cf3", "language": "typescript", "prefix": "t failedTools: Array<{ name: string; error: string }> = [];\n const skillsInvocableCommandSkips: string[] = [];\n let removedCommandCount = 0;\n let removedSkillCount = 0;\n let removedDeselectedCommandCount = 0;\n let removedDeselectedSkillCount", "repo": "Fission-AI/OpenSpec", "span_codepoints": 256, "start": 8952, "suffix": "join(resolvedProjectPath, tool.skillsDir, 'skills');\n const shouldGenerateSkills = shouldGenerateSkillsForTool(tool.value, delivery);\n const shouldGenerateCommands = shouldGenerateCommandsForTool(tool.value, delivery);\n const toolWorkf", "target": " = 0;\n\n for (const toolId of toolsToUpdate) {\n const tool = AI_TOOLS.find((t) => t.value === toolId);\n if (!tool?.skillsDir) continue;\n\n const spinner = ora(`Updating ${tool.name}...`).start();\n\n try {\n const skillsDir = path."} {"bin": "64_token_ish", "content_sha256": "ab5c97cd2d97c4a83a2b8ece386dbdbb1508dd350a483fd12612262ed89cca04", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/tools-ai-sdk/src/index.test.ts", "end": 5385, "example_id": "0003b85d9cd57f26f28dd294bfe85d55044979de06a1e397195d9e983493658c", "language": "typescript", "prefix": " instructions: \"Custom instructions for testing\",\n });\n\n expect(agent).toBeDefined();\n });\n\n test(\"should accept Context7 config options\", () => {\n const agent = new Context7Agent({\n model: bedrock(\"anthropic.claude-3-haiku", "repo": "upstash/context7", "span_codepoints": 256, "start": 5129, "suffix": "\",\n inputSchema: z.object({\n input: z.string().describe(\"Test input\"),\n }),\n execute: async ({ input }) => ({ result: `processed: ${input}` }),\n });\n\n const agent = new Context7Agent({\n model: bedrock(\"anthrop", "target": "-20240307-v1:0\"),\n apiKey: \"ctx7sk-test-key\",\n });\n\n expect(agent).toBeDefined();\n });\n\n test(\"should accept additional tools alongside Context7 tools\", () => {\n const customTool = tool({\n description: \"A custom test tool"} {"bin": "64_token_ish", "content_sha256": "d7c5a42bb1923a79a37836f579ca57d36098a3cfe30440271ec73597e1c3d3a4", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:examples/cloud/README.md", "end": 1647, "example_id": "0003bdaf0c8c324b263682d19d6e8a58bf4591f717bb975de2aabe58aab4e5de", "language": "markdown", "prefix": "task.py)** - Your first cloud task (start here!)\n- **[02_fast_mode_gemini.py](./02_fast_mode_gemini.py)** - ⚡ Ultra-fast mode with Gemini Flash & Fireship humor\n- **[03_structured_output.py](./03_structured_output.py)** - Get structured JSON responses\n- **", "repo": "browser-use/browser-use", "span_codepoints": 256, "start": 1391, "suffix": " execution ($0.01/step)\n2. **Disable proxy** when not needed for captcha solving\n3. **Disable element highlighting** for better performance\n4. **Set max_agent_steps** to prevent runaway costs\n5. **Use structured output** to reduce parsing overhead\n6. **Add", "target": "[04_proxy_usage.py](./04_proxy_usage.py)** - 🌍 Proxy for geo-restrictions & captcha solving\n- **[05_search_api.py](./05_search_api.py)** - 🔍 Search API for content extraction (BETA)\n\n## 💰 Cost Optimization Tips\n\n1. **Use Gemini Flash** for fastest/cheapest"} {"bin": "16_token_ish", "content_sha256": "b898fa7d192aa35a985cd95e242dc3dbd71dd2a2b5bdf6abf0b3e17cf44a79fa", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converter_utils/docx/math/latex_dict.py", "end": 4161, "example_id": "0003c4be755d4312725250a6e0548333c10ecd724051dc11fd07cd50fedc9c07", "language": "python", "prefix": "\\gg \",\n \"\\u2208\": \"\\\\in \",\n \"\\u2209\": \"\\\\notin \",\n \"\\u220b\": \"\\\\ni \",\n \"\\u220c\": \"\\\\nni \",\n # Ordinary symbols\n \"\\u221e\": \"\\\\infty \",\n # Binary relations\n \"\\u00b1\": \"\\\\pm \",\n \"\\u2213\": \"\\\\mp \",\n # Italic, Latin, uppercase\n ", "repo": "microsoft/markitdown", "span_codepoints": 64, "start": 4097, "suffix": "\n \"\\U0001d437\": \"D\",\n \"\\U0001d438\": \"E\",\n \"\\U0001d439\": \"F\",\n \"\\U0001d43a\": \"G\",\n \"\\U0001d43b\": \"H\",\n \"\\U0001d43c\": \"I\",\n \"\\U0001d43d\": \"J\",\n \"\\U0001d43e\": \"K\",\n \"\\U0001d43f\": \"L\",\n \"\\U0001d440\": \"M\",\n \"\\U0001d441\": \"N\",\n ", "target": "\"\\U0001d434\": \"A\",\n \"\\U0001d435\": \"B\",\n \"\\U0001d436\": \"C\","} {"bin": "8_token_ish", "content_sha256": "90368b23c0d0ca8bb0d2fc007c86100de630857bd2934d5a9254402095b039c6", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_cu_converter.py", "end": 1715, "example_id": "0003cb73121da8af102315abaf505040553d18543b1974e992e017d27af48dc9", "language": "python", "prefix": "ultAzureCredential: # type: ignore[no-redef]\n pass\n\n def to_llm_input(*args, **kwargs): # type: ignore[no-redef]\n pass\n\n\n# ---------------------------------------------------------------------------\n# File type enum and routing tables\n# ", "repo": "microsoft/markitdown", "span_codepoints": 32, "start": 1683, "suffix": "-------------------------------------------\n\n\nclass ContentUnderstandingFileType(str, Enum):\n \"\"\"Supported file types for Content Understanding conversion.\"\"\"\n\n # Documents\n PDF = \"pdf\"\n DOCX = \"docx\"\n PPTX = \"pptx\"\n XLSX = \"xlsx\"\n HTM", "target": "--------------------------------"} {"bin": "32_token_ish", "content_sha256": "b3a0c69c32b557a7b1dd00b93eb466752d5ffbc6da40065dfebc1d6d27b25795", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/1688/download.js", "end": 994, "example_id": "0003cbf0d0916bf682380eccd07875d217c289c073072763f4610878f18cbb49", "language": "javascript", "prefix": "ssets) {\n const items = [];\n const pushImages = (urls, prefix) => {\n urls.forEach((url, index) => {\n items.push({\n type: 'image',\n url,\n filename: `${offerId}_${prefix}_${String(index + 1", "repo": "jackwener/OpenCLI", "span_codepoints": 128, "start": 866, "suffix": " pushImages(assets.sku_images, 'sku');\n pushImages(assets.detail_images, 'detail');\n pushImages(assets.other_images, 'other');\n assets.videos.forEach((url, index) => {\n items.push({\n type: 'video',\n url,\n ", "target": ").padStart(2, '0')}${extFromUrl(url, '.jpg')}`,\n });\n });\n };\n pushImages(assets.main_images, 'main');\n "} {"bin": "64_token_ish", "content_sha256": "c7b8119f0c956a69abf4cf48d23de9667d47f54b68c51ba9fb9e3762758a81f8", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:internal/migrations/0_collections_snapshot_0_19_0_dev_1.go", "end": 27003, "example_id": "0003d203c75d37aea1f53d43678c181369fa01afe92f7000f46672afd6a6a695", "language": "go", "prefix": "idden\": false,\n\t\t\t\t\"id\": \"date2675529103\",\n\t\t\t\t\"max\": \"\",\n\t\t\t\t\"min\": \"\",\n\t\t\t\t\"name\": \"start\",\n\t\t\t\t\"presentable\": false,\n\t\t\t\t\"required\": true,\n\t\t\t\t\"system\": false,\n\t\t\t\t\"type\": \"date\"\n\t\t\t},\n\t\t\t{\n\t\t\t\t\"hidden\": false,\n\t\t\t\t\"id\": \"date16528305\",\n\t\t\t\t\"max\": \"\",\n\t", "repo": "henrygd/beszel", "span_codepoints": 256, "start": 26747, "suffix": "\" + ` (\\n ` + \"`\" + `user` + \"`\" + `,\\n ` + \"`\" + `system` + \"`\" + `\\n)\",\n\t\t\t\"CREATE INDEX ` + \"`\" + `idx_6T7ljT7FJd` + \"`\" + ` ON ` + \"`\" + `quiet_hours` + \"`\" + ` (\\n ` + \"`\" + `type` + \"`\" + `,\\n ` + \"`\" + `end` + \"`\" + `\\n)\"\n\t\t],\n\t\t\"listRule\": \"@re", "target": "\t\t\t\"min\": \"\",\n\t\t\t\t\"name\": \"end\",\n\t\t\t\t\"presentable\": false,\n\t\t\t\t\"required\": true,\n\t\t\t\t\"system\": false,\n\t\t\t\t\"type\": \"date\"\n\t\t\t}\n\t\t],\n\t\t\"id\": \"pbc_451525641\",\n\t\t\"indexes\": [\n\t\t\t\"CREATE INDEX ` + \"`\" + `idx_q0iKnRP9v8` + \"`\" + ` ON ` + \"`\" + `quiet_hours` + \"`"} {"bin": "16_token_ish", "content_sha256": "a9cbe88ad1942abf948ad9f3ca3dc064f9d63ed3a0fe95cbecc794f45e2662c9", "document_id": "unitycatalog/unitycatalog@ed504deea31b30c3e7d27e360372077cce04a509:server/src/test/java/io/unitycatalog/server/utils/PopulateTestDatabase.java", "end": 13140, "example_id": "0003eb8c5c3d76ce0019103c51ad0c5aa153356c973cc23f529b9ca597e36560", "language": "java", "prefix": " .schemaId(UUID.fromString(schemaId))\n .comment(\"Partitioned table\")\n .columns(List.of(firstName, age, country))\n .dataSourceFormat(DataSourceFormat.DELTA.getValue())\n .type(TableType.EXTERNAL.getValue(", "repo": "unitycatalog/unitycatalog", "span_codepoints": 64, "start": 13076, "suffix": " Date())\n .url(partitionedTablePath)\n .build();\n\n partitionedTableInfoDAO\n .getColumns()\n .forEach(columnInfoDAO -> columnInfoDAO.setTable(partitionedTableInfoDAO));\n\n try (Session session = factory.openSession()) ", "target": "))\n .createdAt(new Date())\n .updatedAt(new"} {"bin": "64_token_ish", "content_sha256": "8e6e4cc0362274dfdffebfe2c34dfc352377feab8251ac7c81eb3a7437fde08c", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:examples/models/langchain/serializer.py", "end": 1093, "example_id": "0003ec88c709cd9de4a7b50a30ab28dd48bc2db4ee3185e9c20bfbc2db22da37", "language": "python", "prefix": "ge,\n)\n\n\nclass LangChainMessageSerializer:\n\t\"\"\"Serializer for converting between browser-use message types and LangChain message types.\"\"\"\n\n\t@staticmethod\n\tdef _serialize_user_content(\n\t\tcontent: str | list[ContentPartTextParam | ContentPartImageParam],\n\t) ", "repo": "browser-use/browser-use", "span_codepoints": 256, "start": 837, "suffix": "\t\t\t'type': 'text',\n\t\t\t\t\t\t'text': part.text,\n\t\t\t\t\t}\n\t\t\t\t)\n\t\t\telif part.type == 'image_url':\n\t\t\t\t# LangChain format for images\n\t\t\t\tserialized_parts.append(\n\t\t\t\t\t{'type': 'image_url', 'image_url': {'url': part.image_url.url, 'detail': part.image_url.detail}}\n", "target": "-> str | list[str | dict]:\n\t\t\"\"\"Convert user message content for LangChain compatibility.\"\"\"\n\t\tif isinstance(content, str):\n\t\t\treturn content\n\n\t\tserialized_parts = []\n\t\tfor part in content:\n\t\t\tif part.type == 'text':\n\t\t\t\tserialized_parts.append(\n\t\t\t\t\t{\n\t\t\t"} {"bin": "32_token_ish", "content_sha256": "25bf224c95efef7f424e6fcbbe72ac1b10ff5f030c244260a0a5723be8210325", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:tests/installer/e2e.freshinstall.test.mjs", "end": 663, "example_id": "0003f1b634b48387051e262a198b0b87ababaa049fa30e4579775aa8b7955039", "language": "javascript", "prefix": " pipeline that a dry-run can't\n// see — missing hook files, malformed settings entries, broken statusline\n// wiring, idempotency bugs, JSONC-tolerance regressions (#249-class).\n//\n// Limitations:\n// - The Claude Code provider only triggers when `claude` ", "repo": "JuliusBrussee/caveman", "span_codepoints": 128, "start": 535, "suffix": " that don't need `claude` (idempotence,\n// JSONC tolerance) always run.\n// - The installer's uninstall path also calls `claude plugin uninstall` and\n// `gemini extensions uninstall` against whatever binary is on PATH. We\n// strip those out of", "target": "is on PATH. Tests\n// that depend on it skip cleanly when missing (most CI runners and dev\n// boxes won't have it). Tests"} {"bin": "8_token_ish", "content_sha256": "007a2f56e0b9d64cf28e4aeeb7329fb3bd818400bb88444dc92ef5537d7255b4", "document_id": "nicbarker/clay@e6cc36941ab2af5d81107617039d6f527a1c660b:renderers/cairo/clay_renderer_cairo.c", "end": 6936, "example_id": "0003fc3ab232c22c49f816eea1b46336c145a8563197dce1c06e0213cbb18e5d", "language": "c", "prefix": "nerRadius.topRight,\n\t\t\t\t\t 3 * M_PI / 2, 2 * M_PI); // 270° to 360°\n\t\t\tcairo_arc(cr, bb.x + bb.width - config->cornerRadius.bottomRight,\n\t\t\t\t\t bb.y + bb.height - config->cornerRadius.bottomRight,\n\t\t\t\t\t config->cornerRadius.bottomRight,\n\t\t\t\t\t 0, M_PI / 2", "repo": "nicbarker/clay", "span_codepoints": 32, "start": 6904, "suffix": " bb.x + config->cornerRadius.bottomLeft,\n\t\t\t\t\t bb.y + bb.height - config->cornerRadius.bottomLeft,\n\t\t\t\t\t config->cornerRadius.bottomLeft,\n\t\t\t\t\t M_PI / 2, M_PI); // 90° to 180°\n\t\t\tcairo_close_path(cr);\n\n\t\t\tcairo_fill(cr);\n\t\t\tbreak;\n\t\t}\n\t\tcase CLAY_RENDER", "target": "); // 0° to 90°\n\t\t\tcairo_arc(cr,"} {"bin": "16_token_ish", "content_sha256": "549bf14217ca8076437fa391ef117efe215ebcad0268561dc85bc6ec4f7d19cd", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:tests/providers/deepseek/request_hook.rs", "end": 3165, "example_id": "0003feee366c0429f53467104a1385bed4e8dfdff8aa7cbc7950b4f4dba559dd", "language": "rust", "prefix": " response_calls: Arc::new(AtomicUsize::new(0)),\n seen_prompt: Arc::new(Mutex::new(None)),\n seen_response: Arc::new(Mutex::new(None)),\n };\n\n let response = agent.prompt(\"Entertain me!\").add_", "repo": "0xPlaygrounds/rig", "span_codepoints": 64, "start": 3101, "suffix": "(&response);\n anyhow::ensure!(\n hook.prompt_calls.load(Ordering::SeqCst) == 1,\n \"expected one prompt hook call\"\n );\n anyhow::ensure!(\n hook.response_calls.load(Ordering::SeqCst) ", "target": "hook(hook.clone()).await?;\n\n assert_nonempty_response"} {"bin": "8_token_ish", "content_sha256": "a5ea4191118ce5a1c0609ea738431ae64550706fa92f4f28b6eb86124a16c5bb", "document_id": "modelcontextprotocol/java-sdk@fd004989b9484c9b81be6b03463396797b354804:mcp-core/src/main/java/io/modelcontextprotocol/client/transport/ServerParameters.java", "end": 2814, "example_id": "00040195831689dcdf90fbdb32b5b21af646d1f3c8fcec161ce16746198e8d4e", "language": "java", "prefix": "env.putAll(env);\n\t\t\t}\n\t\t\treturn this;\n\t\t}\n\n\t\tpublic Builder addEnvVar(String key, String value) {\n\t\t\tAssert.notNull(key, \"The key can not be null\");\n\t\t\tAssert.notNull(value, \"The value can not be null\");\n\t\t\tthis.env.put(key, value);\n\t\t\treturn this;\n\t\t}\n\n\t\t", "repo": "modelcontextprotocol/java-sdk", "span_codepoints": 32, "start": 2782, "suffix": "{\n\t\t\treturn new ServerParameters(command, args, env);\n\t\t}\n\n\t}\n\n\t/**\n\t * Returns a default environment object including only environment variables deemed\n\t * safe to inherit.\n\t */\n\tprivate static Map getDefaultEnvironment() {\n\t\treturn System", "target": "public ServerParameters build() "} {"bin": "64_token_ish", "content_sha256": "351fad53d9e0661c25cd3b4e6d9b3a6f281b9bad45046ce3e7c67d425c4421d3", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/test_module_misc.py", "end": 9133, "example_id": "0004138d4eb28a06b336c1be17747043a50e6f446a53a1018e759530bbfb4ccd", "language": "python", "prefix": "?param=value\"\n netloc, path = file_uri_to_path(file_uri)\n assert netloc is None\n assert path == \"/path/to/file.txt\"\n\n # Test file URI with fragment\n file_uri = \"file:///path/to/file.txt#fragment\"\n netloc, path = file_uri_to_path(file_uri)", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 8877, "suffix": "result = markitdown_with_style_map.convert(\n os.path.join(TEST_FILES_DIR, \"test_with_comment.docx\")\n )\n validate_strings(result, DOCX_COMMENT_TEST_STRINGS)\n\n\ndef test_docx_equations() -> None:\n markitdown = MarkItDown()\n docx_file = os.p", "target": "\n assert netloc is None\n assert path == \"/path/to/file.txt\"\n\n\ndef test_docx_comments() -> None:\n # Test DOCX processing, with comments and setting style_map on init\n markitdown_with_style_map = MarkItDown(style_map=\"comment-reference => \")\n "} {"bin": "32_token_ish", "content_sha256": "f27ac893dc3f6befb569083a96dc3001948855d41eaed82b8cdb1c5ec633c10c", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/dwarf/dwarf_expr.c", "end": 15642, "example_id": "0004193e2fe742326627624c5debae436d1bd17c84b9ddd14bb68ae2c9d52b3a", "language": "c", "prefix": "1);\n }\n n->v = push_vals[push_idx];\n SLLStackPush(state->top_val, n);\n }\n }\n \n //- rjf: do not need a break? advance state.\n //\n // (if we *do* need a break, this means we need to ask the caller for\n // more info", "repo": "EpicGames/raddebugger", "span_codepoints": 128, "start": 15514, "suffix": "\n state->op_idx += 1;\n state->off = off;\n }\n \n //- rjf: at the end of the expression? -> set success, fill result\n if(off == expr.size)\n {\n result.status = DW_EvalStatus_Good;\n if(state->top_val != 0)\n {\n resu", "target": ", like memory reads, and so we want to resume from the\n // offset just before this opcode)\n //\n if(!need_a_break)\n {"} {"bin": "16_token_ish", "content_sha256": "e6ff121105322d4915f1e730b2fabdd4e83031022c24eb8c82da405412e47089", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:tests/test_repo_local_config.js", "end": 1655, "example_id": "000421d7b349169e2023f906ddf9aa98a9d964a1d5ba71961d01ecc55aeae4d3", "language": "javascript", "prefix": "defined) delete process.env.CAVEMAN_DEFAULT_MODE;\n else process.env.CAVEMAN_DEFAULT_MODE = origEnv;\n fs.rmSync(tmpBase, { recursive: true, force: true });\n }\n}\n\nconsole.log('repo-local config resolution tests\\n');\n\ntest('returns \"full\" when no env, ", "repo": "JuliusBrussee/caveman", "span_codepoints": 64, "start": 1591, "suffix": ";\n assert.strictEqual(getDefaultMode(), 'full');\n});\n\ntest('reads .caveman/config.json in cwd', (tmp) => {\n fs.mkdirSync(path.join(tmp, '.caveman'));\n fs.writeFileSync(path.join(tmp, '.caveman', 'config.json'),\n JSON.stringify({ defaultMode: 'lite' }", "target": "no repo config, no user config', (tmp) => {\n process.chdir(tmp)"} {"bin": "16_token_ish", "content_sha256": "9efd8c49e5b4bf7132f59fb450ea26db8ef4b27ada37df95ae1e1761fd8231d0", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/core/shell.py", "end": 26617, "example_id": "000422773d5249ae58449ff6db5e6b4b06405fc979e10be626388f417046b5ad", "language": "python", "prefix": " if not page or not isinstance(page, Selector): # pragma: no cover\n raise TypeError(\"Input must be of type `Selector`\")\n elif not filename or not isinstance(filename, str) or not filename.strip():\n raise ValueError(\"Filename ", "repo": "D4Vinci/Scrapling", "span_codepoints": 64, "start": 26553, "suffix": "html\", \".txt\")):\n raise ValueError(\"Unknown file type: filename must end with '.md', '.html', or '.txt'\")\n else:\n with open(filename, \"w\", encoding=page.encoding) as f:\n extension = filename.split(\".\")[-1]\n ", "target": "must be provided\")\n elif not filename.endswith((\".md\", \"."} {"bin": "64_token_ish", "content_sha256": "a2aed2930510f336d4c741954ba889652e6d51fa7896e117c1928cc2f08be559", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/languages/python/uv.rs", "end": 16274, "example_id": "00042bac61dbb73839ca4f220fc6e7dcb390154de30bc673f73a1ce38fd2ea94", "language": "rust", "prefix": " }\n })\n .collect::>();\n\n while let Some(result) = tasks.join_next().await {\n if let Ok((source, response)) = result {\n if let Ok(resp) = response\n ", "repo": "j178/prek", "span_codepoints": 256, "start": 16018, "suffix": "select! {\n Ok(true) = check_github() => InstallSource::GitHub,\n Ok(source) = select_best_pypi() => InstallSource::PyPi(source),\n else => {\n warn!(\"Failed to check uv source availability, falli", "target": " && resp.status().is_success()\n {\n best = source;\n break;\n }\n }\n }\n\n Ok(best)\n }\n\n let source = tokio::"} {"bin": "16_token_ish", "content_sha256": "fcf067fceb8e3428fdac592012b5de635307730e203700ca40e6347925a555a9", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:async-book/src/ch12-common-pitfalls.md", "end": 7092, "example_id": "00042e1195181a21d74f9e4089ab1c5e3daf6c41987f8920b7df8bd56aef0ab5", "language": "markdown", "prefix": " tokio::spawn(async move {\n let _ = conn.shutdown().await;\n });\n\n // ✅ Workaround 2: Use a synchronous close\n // self.connection.blocking_close();\n }\n}\n```\n\n**Best practice**: Provide an explicit `async fn close(self)", "repo": "microsoft/RustTraining", "span_codepoints": 64, "start": 7028, "suffix": " only as a safety net, not the primary cleanup path.\n\n### select! Fairness and Starvation\n\n```rust\nuse tokio::sync::mpsc;\n\n// ❌ UNFAIR: busy_stream always wins, slow_stream starves\nasync fn unfair(mut fast: mpsc::Receiver, mut slow: mpsc::Receiver Result<()> {\n let dir = tempdir()?;\n let file_path = create_test_file(&dir, \"invalid_name.xml\", b\"<1root/>\").await?;\n let (code, output) = ", "repo": "j178/prek", "span_codepoints": 32, "start": 6907, "suffix": "path).await?;\n assert_eq!(code, 1);\n assert!(!output.is_empty());\n Ok(())\n }\n\n #[tokio::test]\n async fn test_valid_xml_with_cdata() -> Result<()> {\n let dir = tempdir()?;\n let content = br#\" anyhow::Result<()> {\n let temp = TempDir::new()?;\n let dir_path = temp.path().join(\"non-existent\");\n\n let stats = remove_dir_all(&dir_path, None)?;\n assert_eq!(stats.num_files, 0);\n assert_eq!(", "target": "::NotADirectory);\n assert!(file_path.exists(), \"file must not be deleted\");\n\n Ok(())\n }\n\n #[test]\n fn rm_"} {"bin": "64_token_ish", "content_sha256": "40d218b913bdf11f10a2906adf24bb1815076e549923d62c67b7a1dcb94e0ab6", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:c-cpp-book/src/ch05-data-structures.md", "end": 16634, "example_id": "0004388037d55d0c4d4f0d2e75ed50ff44d80963ea8c04e37d33c278b8f2cad3", "language": "markdown", "prefix": "ve |\n| `T&&` (rvalue ref) | Just `T` | Take by value = take ownership |\n| `T&&` in template (universal ref) | `impl Trait` or `` | Generics replace forwarding |\n| `std::move(x)` | `x` (just use it) | Move is the default |\n| `std::forward(x)` |", "repo": "microsoft/RustTraining", "span_codepoints": 256, "start": 16378, "suffix": "and the source is invalidated:\n\n```rust\n// Rust move = memcpy the bytes, mark source as invalid\nlet s1 = String::from(\"hello\");\nlet s2 = s1; // Bytes of s1 are copied to s2's stack slot\n // s1 is now invalid — compiler enforces this\n// println", "target": " No equivalent needed | No universal references to forward |\n\n#### 2. Moves Are Bitwise — No Move Constructors\n\nIn C++, moving is a *user-defined operation* (move constructor / move assignment). In Rust, moving is always a **bitwise memcpy** of the value, "} {"bin": "8_token_ish", "content_sha256": "adc07f2bdb51d6295fbb6f069a335988a232ba76ede6fb7c4480d2e9843bf878", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:tests/providers/llamacpp/structured_output.rs", "end": 3308, "example_id": "00043f62d0ad359dc6873f252de756d17db5ac140feace875f2408bb7b024a97", "language": "rust", "prefix": "nded_details_structured_output() {\n let client = support::completions_client();\n let model = support::model_name();\n let agent = client\n .agent(model)\n .preamble(WEATHER_PREAMBLE)\n .temperature(0.0)\n .build();\n\n let ", "repo": "0xPlaygrounds/rig", "span_codepoints": 32, "start": 3276, "suffix": "_typed::(\n \"Return JSON weather data for Los Angeles with fields city, current.temperature_f, current.humidity_pct, and current.description.\",\n )\n .extended_details()\n .await\n .expect(\"extended prompt", "target": "extended = agent\n .prompt"} {"bin": "8_token_ish", "content_sha256": "2e2ac2e045c91407dda7722c34239b8afed22ac27509acbde53b9ec4035d5a1c", "document_id": "modelcontextprotocol/java-sdk@fd004989b9484c9b81be6b03463396797b354804:mcp-test/src/test/java/io/modelcontextprotocol/server/ResourceSubscriptionTests.java", "end": 4759, "example_id": "000444932177651fc324537dfa2509feb6b3a6441860970184cecc0a96b0979b", "language": "java", "prefix": "tification());\n\t\ttransportProvider.simulateIncomingMessage(subscribeRequest(RESOURCE_URI));\n\t\ttransport.clearSentMessages();\n\n\t\tStepVerifier\n\t\t\t.create(server.notifyResourcesUpdated(new McpSchema.ResourcesUpdatedNotification(\"test://other/resource\")))\n\t\t\t.", "repo": "modelcontextprotocol/java-sdk", "span_codepoints": 32, "start": 4727, "suffix": "transport.getAllSentMessages())\n\t\t\t.as(\"notification for a different URI should not reach a session subscribed to a different URI\")\n\t\t\t.isEmpty();\n\n\t\tserver.closeGracefully().block();\n\t}\n\n\t@Test\n\tvoid notifyResourcesUpdated_afterUnsubscribe_doesNotNotifySe", "target": "verifyComplete();\n\n\t\tassertThat("} {"bin": "64_token_ish", "content_sha256": "1e2203cf7d3137221a7ff2d1b79d5405580eea2ce4c22ba916dbeb9c689e96be", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:tests/test-unit.c", "end": 47185, "example_id": "00044683822fc4d3fd38da672e2169989e266cf032c92d12ad739e5ae0968949", "language": "c", "prefix": "NN(NEIGHBOR_QUANTIZER=BINARY)\";\n rc = vec0_parse_vector_column(input, (int)strlen(input), &col);\n assert(rc == SQLITE_OK);\n assert(col.index_type == VEC0_INDEX_TYPE_DISKANN);\n assert(col.diskann.quantizer_type == VEC0_DISKANN_QUANTIZER_BINARY);", "repo": "asg017/sqlite-vec", "span_codepoints": 256, "start": 46929, "suffix": "_column(input, (int)strlen(input), &col);\n assert(rc == SQLITE_OK);\n assert(col.diskann.search_list_size == 128); // default (unified)\n assert(col.diskann.search_list_size_search == 256);\n assert(col.diskann.search_list_size_insert == 64);\n ", "target": "\n sqlite3_free(col.name);\n }\n\n // Split search_list_size: search and insert\n {\n const char *input = \"emb float[128] INDEXED BY diskann(neighbor_quantizer=binary, search_list_size_search=256, search_list_size_insert=64)\";\n rc = vec0_parse_vector"} {"bin": "32_token_ish", "content_sha256": "c84154be2a7e8cb5c0b350485417005c4865b86870578e24f3b773b5a82c97d3", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/cli/install.rs", "end": 15354, "example_id": "000452f83f92433d367746ac6806f44a784ff1d81982edb99308f98ff7153739", "language": "rust", "prefix": " printer.stderr(),\n \"`{}` is not managed by prek, skipping.\",\n hook_path.user_display().cyan()\n )?;\n }\n continue;\n }\n ", "repo": "j178/prek", "span_codepoints": 128, "start": 15226, "suffix": " printer.stderr(),\n \"`{}` does not exist, skipping.\",\n hook_path.user_display().cyan()\n )?;\n }\n continue;\n }\n Err(err) => return", "target": "Err(err) if err.kind() == std::io::ErrorKind::NotFound => {\n if !all {\n writeln!(\n "} {"bin": "64_token_ish", "content_sha256": "90368b23c0d0ca8bb0d2fc007c86100de630857bd2934d5a9254402095b039c6", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_cu_converter.py", "end": 15375, "example_id": "00045c4c7d23bc6106d0d370ab78c8615baacab02849fbd261b75862a85fd6a1", "language": "python", "prefix": "file_modality in {\"document\", \"image\"}\n return file_modality == analyzer_modality\n\n\n# ---------------------------------------------------------------------------\n# Converter\n# ---------------------------------------------------------------------------\n\n", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 15119, "suffix": " def __init__(\n self,\n *,\n endpoint: str,\n credential: AzureKeyCredential | TokenCredential | None = None,\n analyzer_id: Optional[str] = None,\n file_types: Optional[List[ContentUnderstandingFileType]] = None,\n ", "target": "\nclass ContentUnderstandingConverter(DocumentConverter):\n \"\"\"Converts files using Azure Content Understanding.\n\n Provides high-quality document, image, audio, and video conversion\n with structured field extraction via YAML front matter.\n \"\"\"\n\n "} {"bin": "16_token_ish", "content_sha256": "007a2f56e0b9d64cf28e4aeeb7329fb3bd818400bb88444dc92ef5537d7255b4", "document_id": "nicbarker/clay@e6cc36941ab2af5d81107617039d6f527a1c660b:renderers/cairo/clay_renderer_cairo.c", "end": 7908, "example_id": "00046741971bbe0ff214831921ac80b2049111635f9d22d02c9c5dc68d71977c", "language": "c", "prefix": "e(&toTerminate);\n\t\t\tchar *font_family = fonts[config->fontId];\n\n\t\t\tClay_BoundingBox bb = command->boundingBox;\n\t\t\tClay_Color color = config->textColor;\n\n\t\t\tcairo_select_font_face(Clay__Cairo, font_family, CAIRO_FONT_SLANT_NORMAL, CAIRO_FONT_WEIGHT_NORMAL);", "repo": "nicbarker/clay", "span_codepoints": 64, "start": 7844, "suffix": "(cr, bb.x, bb.y + bb.height);\n\n\t\t\tcairo_set_source_rgba(cr, CLAY_TO_CAIRO(color));\n\t\t\tcairo_show_text(cr, text);\n\t\t\tcairo_close_path(cr);\n\n\t\t\tfree(text);\n\t\t\tbreak;\n\t\t}\n\t\tcase CLAY_RENDER_COMMAND_TYPE_BORDER: {\n Clay_BorderRenderData *config = &c", "target": "\n\t\t\tcairo_set_font_size(cr, config->fontSize);\n\n\t\t\tcairo_move_to"} {"bin": "16_token_ish", "content_sha256": "9211ddd2687ba04a75c6c19f9896bbd1e62343d3d738e093f5241119da405645", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/browser/test_tabs.py", "end": 16155, "example_id": "0004727d450046fd2560c922571ade543d154709864325ba613b42e3362086bf", "language": "python", "prefix": "home page\",\n\t\t\t\t\"evaluation_previous_goal\": \"Starting task\",\n\t\t\t\t\"memory\": \"Navigating to home page\",\n\t\t\t\t\"next_goal\": \"Navigate to home page\",\n\t\t\t\t\"action\": [\n\t\t\t\t\t{{\n\t\t\t\t\t\t\"navigate\": {{\n\t\t\t\t\t\t\t\"url\": \"{base_url}/home\",\n\t\t\t\t\t\t\t\"new_tab\": false\n\t\t\t\t\t\t}}\n\t", "repo": "browser-use/browser-use", "span_codepoints": 64, "start": 16091, "suffix": "\t\t\tf\"\"\"\n\t\t\t{{\n\t\t\t\t\"thinking\": \"Opening page 1 in new tab\",\n\t\t\t\t\"evaluation_previous_goal\": \"Home page loaded\",\n\t\t\t\t\"memory\": \"Opening page 1\",\n\t\t\t\t\"next_goal\": \"Open page 1\",\n\t\t\t\t\"action\": [\n\t\t\t\t\t{{\n\t\t\t\t\t\t\"navigate\": {{\n\t\t\t\t\t\t\t\"url\": \"{base_url}/page1\",\n\t\t", "target": "\t\t\t\t}}\n\t\t\t\t]\n\t\t\t}}\n\t\t\t\"\"\",\n\t\t\t# Action 2: Open page1 in new tab\n"} {"bin": "8_token_ish", "content_sha256": "bdd3c89b8a1c3e224ddd424546129eee3c8a1e96087431cc06ff70948fbb8082", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/cli/test_cli.py", "end": 9113, "example_id": "0004740a6d28e42a0774b78e26e4685bee5686f6dde2f51b0c6c03f4ae1d0a50", "language": "python", "prefix": "\n\n with patch(\"scrapling.fetchers.StealthyFetcher.fetch\") as mock_fetch:\n mock_fetch.return_value = configure_selector_mock()\n\n result = runner.invoke(\n stealthy_fetch, [html_url, str(output_file), \"--executable-", "repo": "D4Vinci/Scrapling", "span_codepoints": 32, "start": 9081, "suffix": " )\n assert result.exit_code == 0\n assert mock_fetch.call_args.kwargs[\"executable_path\"] == \"/opt/custom-chromium\"\n\n monkeypatch.setenv(\"SCRAPLING_EXECUTABLE_PATH\", \"/opt/env-chromium\")\n with patch(\"scrapling.fe", "target": "path\", \"/opt/custom-chromium\"]\n "} {"bin": "16_token_ish", "content_sha256": "3f0e691dc253a9f329dc0a630983dc2ea5bc1c1f9814d71ea50a66c7451a0dd2", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/_markitdown.py", "end": 18409, "example_id": "00047c88785b69886b75b241b6db2d08098a8ea8c6face99a38991007472ff1b", "language": "python", "prefix": " a content-type header, get the mimetype and charset (if present)\n mimetype: Optional[str] = None\n charset: Optional[str] = None\n\n if \"content-type\" in response.headers:\n parts = response.headers[\"content-type\"].split(\";\")\n ", "repo": "microsoft/markitdown", "span_codepoints": 64, "start": 18345, "suffix": "in parts:\n if part.strip().startswith(\"charset=\"):\n _charset = part.split(\"=\")[1].strip()\n if len(_charset) > 0:\n charset = _charset\n\n # If there is a content-disposition he", "target": " mimetype = parts.pop(0).strip()\n for part "} {"bin": "32_token_ish", "content_sha256": "82dc30e0c9cd672a324b6d0d1a5f44c4a823908593ee65406431f975b93d4297", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converter_utils/docx/math/omml.py", "end": 2671, "example_id": "00048027f1ae5d33124b526cb27442312178c29d26b5463092b917b8f84b0e0f", "language": "python", "prefix": "of the elm,return dict\n \"\"\"\n latex_chars = dict()\n for stag, t, e in self.process_children_list(elm, include):\n latex_chars[stag] = t\n return latex_chars\n\n def process_children(self, elm, include=None):\n \"\"\"", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 2543, "suffix": " isinstance(t, Tag2Method) else str(t)\n for stag, t, e in self.process_children_list(elm, include)\n )\n )\n\n def process_unknow(self, elm, stag):\n return None\n\n\nclass Pr(Tag2Method):\n text = \"\"\n\n __val_tags = ", "target": "\n process children of the elm,return string\n \"\"\"\n return BLANK.join(\n (\n t if not"} {"bin": "64_token_ish", "content_sha256": "5997502d65e6d8b077a92f6efab4879ebc35c78e1ad8ba8bfd5ea52e9de5f294", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:src/mcp-servers/caveman-shrink/compress.js", "end": 3760, "example_id": "0004874105eedf22bac23be6e0b3338a8c7fedbaad9361c91896c3639e0a1cb5", "language": "javascript", "prefix": "AX_RESTORE_PASSES; pass++) {\n sentinel.lastIndex = 0;\n if (!sentinel.test(out)) break;\n out = out.replace(/\u0000(\\d+)\u0000/g, (_, i) => segments[+i]);\n }\n return out;\n}\n\nfunction compressProse(text) {\n let s = text;\n s = s.replace(LEADERS, '');\n s = ", "repo": "JuliusBrussee/caveman", "span_codepoints": 256, "start": 3504, "suffix": "s = s.replace(/\\n{3,}/g, '\\n\\n');\n // Capitalize the first letter of each sentence we may have left lowercase.\n s = s.replace(/(^|[.!?]\\s+)([a-z])/g, (_, pre, ch) => pre + ch.toUpperCase());\n return s.trim();\n}\n\nfunction compress(text, _opts) {\n if (ty", "target": "s.replace(PLEASANTRIES, '');\n s = s.replace(HEDGES, '');\n s = s.replace(FILLERS, '');\n s = s.replace(ARTICLES, '');\n // Collapse repeated whitespace introduced by removals.\n s = s.replace(/[ \\t]{2,}/g, ' ');\n s = s.replace(/\\s+([,.;:!?])/g, '$1');\n "} {"bin": "64_token_ish", "content_sha256": "8431c3887cbca17a42deac1ca6b992cd80dcaeac0bdccff6a9b6f1def2926638", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:lib/config/expressionorlist_test.go", "end": 2191, "example_id": "000489ec544103392c2425db15748158c27d5ce48d301c701a762dc2a10ccb0b", "language": "go", "prefix": "ame: \"all\",\n\t\t\tinput: &ExpressionOrList{\n\t\t\t\tAll: []string{\"true\", \"true\"},\n\t\t\t},\n\t\t\toutput: []byte(`all:\n - \"true\"\n - \"true\"`),\n\t\t\terr: nil,\n\t\t},\n\t\t{\n\t\t\tname: \"all one\",\n\t\t\tinput: &ExpressionOrList{\n\t\t\t\tAll: []string{\"true\"},\n\t\t\t},\n\t\t\toutput: []byte", "repo": "TecharoHQ/anubis", "span_codepoints": 256, "start": 1935, "suffix": ": []string{\"true\"},\n\t\t\t},\n\t\t\toutput: []byte(`\"true\"`),\n\t\t\terr: nil,\n\t\t},\n\t} {\n\t\tt.Run(tt.name, func(t *testing.T) {\n\t\t\tresult, err := yaml.Marshal(tt.input)\n\t\t\tif !errors.Is(err, tt.err) {\n\t\t\t\tt.Errorf(\"wanted marshal error: %v but got: %v\", tt.err, err", "target": "(`\"true\"`),\n\t\t\terr: nil,\n\t\t},\n\t\t{\n\t\t\tname: \"any\",\n\t\t\tinput: &ExpressionOrList{\n\t\t\t\tAny: []string{\"true\", \"false\"},\n\t\t\t},\n\t\t\toutput: []byte(`any:\n - \"true\"\n - \"false\"`),\n\t\t\terr: nil,\n\t\t},\n\t\t{\n\t\t\tname: \"any one\",\n\t\t\tinput: &ExpressionOrList{\n\t\t\t\tAny"} {"bin": "32_token_ish", "content_sha256": "a497dee4dafc4abf3240125d7c0de66f8773905518ca138257a2987dd64837dd", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/test_cu_converter.py", "end": 25258, "example_id": "0004a5a5a4a4269e9311b57df461fcca14b585d6afbf613f1a2e42f3ebe3b9c0", "language": "python", "prefix": "es(self):\n assert _get_modality(ContentUnderstandingFileType.MP4) == \"video\"\n assert _get_modality(ContentUnderstandingFileType.MOV) == \"video\"\n\n def test_audio_types(self):\n assert _get_modality(ContentUnderstandingFileType.WAV) ==", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 25130, "suffix": "----------------------------------\n# convert() mock tests\n# ---------------------------------------------------------------------------\n\n\nclass TestConvertMock:\n \"\"\"Test convert() with mocked CU SDK.\"\"\"\n\n def _run_convert(self, extension, mimetype, e", "target": " \"audio\"\n assert _get_modality(ContentUnderstandingFileType.MP3) == \"audio\"\n\n\n# -----------------------------------------"} {"bin": "8_token_ish", "content_sha256": "a4cb101371d1dc25246d0a71f0c6e85ec2291d0c3c9fa0a9dbaf267bc5f38914", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown-ocr/src/markitdown_ocr/_pptx_converter_with_ocr.py", "end": 8210, "example_id": "0004bf3a05e04bd404a6d77fa8617d0b79e44385bbc73cac0ce5c649fb91994a", "language": "python", "prefix": "tle:\n md += f\": {chart.chart_title.text_frame.text}\"\n md += \"\\\\n\\\\n\"\n data = []\n category_names = [c.label for c in chart.plots[0].categories]\n series_names = [s.name for s in chart.series]\n ", "repo": "microsoft/markitdown", "span_codepoints": 32, "start": 8178, "suffix": "series_names)\n\n for idx, category in enumerate(category_names):\n row = [category]\n for series in chart.series:\n row.append(series.values[idx])\n data.append(row)\n\n markdow", "target": " data.append([\"Category\"] + "} {"bin": "8_token_ish", "content_sha256": "b0c2e7dbc7a768fb843fb80037bde82e6746cf7c4017e1c801f828cf827a45cc", "document_id": "modelcontextprotocol/java-sdk@fd004989b9484c9b81be6b03463396797b354804:mcp-test/src/main/java/io/modelcontextprotocol/client/AbstractMcpAsyncClientTests.java", "end": 11802, "example_id": "0004c05064673125339f1f9a14e7ebe32e7584906d77499ba55a0eb06854e3d6", "language": "java", "prefix": "AGE)))\n\t\t\t\t.consumeNextWith(resources -> {\n\t\t\t\t\tassertThat(resources).isNotNull().satisfies(result -> {\n\t\t\t\t\t\tassertThat(result.resources()).isNotNull();\n\n\t\t\t\t\t\tif (!result.resources().isEmpty()) {\n\t\t\t\t\t\t\tResource firstResource = result.resources().get(0);", "repo": "modelcontextprotocol/java-sdk", "span_codepoints": 32, "start": 11770, "suffix": ".uri()).isNotNull();\n\t\t\t\t\t\t\tassertThat(firstResource.name()).isNotNull();\n\t\t\t\t\t\t}\n\t\t\t\t\t});\n\t\t\t\t})\n\t\t\t\t.verifyComplete();\n\t\t});\n\t}\n\n\t@Test\n\tvoid testListAllResources() {\n\t\twithClient(createMcpTransport(), mcpAsyncClient -> {\n\t\t\tStepVerifier.create(mcpAsyncC", "target": "\n\t\t\t\t\t\t\tassertThat(firstResource"} {"bin": "32_token_ish", "content_sha256": "4c97ba0ad9cd26c9138e513afc2a2a9fcd0179cac1ccf754be8b9ef5c673f525", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:pi-extension/test/helpers.test.js", "end": 5591, "example_id": "0004c88314799aacfd5e5aaf9a76e3341febf952d33c21f23869b9d8ca21e3e7", "language": "javascript", "prefix": "sert.ok(filtered.includes(\"Other line\"));\n});\n\ntest(\"filterSkillBodyForMode does not drop a rule bullet whose label matches a mode name\", () => {\n // A rule bullet like \"- Full: ...\" has the same \"label: text\" shape as a\n // worked example, but isn't one", "repo": "DietrichGebert/ponytail", "span_codepoints": 128, "start": 5463, "suffix": " `- Full: do not confuse this rule label with the mode name.\\n- Lite: same risk, this is a real rule bullet.\\n- lite: \"real worked example\"\\n- ultra: \"real worked example\"`;\n\n const filtered = filterSkillBodyForMode(body, \"ultra\");\n\n assert.ok(filtered.i", "target": " — it must survive in every mode. Only the\n // quoted, `- lite: \"...\"`-style bullets are real per-mode examples.\n const body ="} {"bin": "32_token_ish", "content_sha256": "8e6e4cc0362274dfdffebfe2c34dfc352377feab8251ac7c81eb3a7437fde08c", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:examples/models/langchain/serializer.py", "end": 868, "example_id": "0004cbb6c8168326f620ca3776b60e198eff3e7dc898def0d0cda743649696c6", "language": "python", "prefix": "l,\n\tUserMessage,\n)\nfrom browser_use.llm.messages import (\n\tSystemMessage as BrowserUseSystemMessage,\n)\n\n\nclass LangChainMessageSerializer:\n\t\"\"\"Serializer for converting between browser-use message types and LangChain message types.\"\"\"\n\n\t@staticmethod\n\tdef ", "repo": "browser-use/browser-use", "span_codepoints": 128, "start": 740, "suffix": "\"Convert user message content for LangChain compatibility.\"\"\"\n\t\tif isinstance(content, str):\n\t\t\treturn content\n\n\t\tserialized_parts = []\n\t\tfor part in content:\n\t\t\tif part.type == 'text':\n\t\t\t\tserialized_parts.append(\n\t\t\t\t\t{\n\t\t\t\t\t\t'type': 'text',\n\t\t\t\t\t\t'text'", "target": "_serialize_user_content(\n\t\tcontent: str | list[ContentPartTextParam | ContentPartImageParam],\n\t) -> str | list[str | dict]:\n\t\t\"\""} {"bin": "64_token_ish", "content_sha256": "7e4ac7074d0ac6faa1be629b5e4866a53f4ef03be33239de567338dd8dcffb53", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/test_pdf_tables.py", "end": 38692, "example_id": "0004cff34317bc239e9a4eff3ef343e98fa71972ebdd977f333d4de8a49a9383", "language": "python", "prefix": " def test_markdown_table_columns_have_pipes(self, markitdown):\n \"\"\"Test that form-style PDF columns are separated with pipes.\"\"\"\n pdf_path = os.path.join(\n TEST_FILES_DIR, \"SPARSE-2024-INV-1234_borderless_table.pdf\"\n )\n\n ", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 38436, "suffix": " = text_content.split(\"\\n\")\n table_rows = [\n line for line in lines if line.startswith(\"|\") and line.endswith(\"|\")\n ]\n\n assert len(table_rows) > 0, \"Should have markdown table rows\"\n\n # Check that at least some rows h", "target": " if not os.path.exists(pdf_path):\n pytest.skip(f\"Test file not found: {pdf_path}\")\n\n result = markitdown.convert(pdf_path)\n text_content = result.text_content\n\n # Find table rows and verify column structure\n lines"} {"bin": "64_token_ish", "content_sha256": "e7540a86fc80cdd3b0f6c7a332f60b360569342270ce3dd7ec204f7370e5a784", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:scripts/check-rule-copies.js", "end": 2204, "example_id": "0004d06263b6a0d9f99fd616a1076fcc7fa6fb06e7c5514912dbe34d49412a01", "language": "javascript", "prefix": "ve heuristic', // ceiling-comment rule\n 'ONE runnable check', // test reflex\n 'flimsier algorithm', // robust-variant rule\n // the four \"not lazy about\" safety carve-outs: pin each so a reword ", "repo": "DietrichGebert/ponytail", "span_codepoints": 256, "start": 1948, "suffix": " 'input validation at trust boundaries',\n 'prevents data loss',\n 'security',\n 'accessibility',\n 'Lazy code without its check is unfinished', // one-check promoted to headline\n];\n\nconst skill = read('skills/ponytail/SKILL.md');\nconst sources = [['skills", "target": "in either\n // file can't silently drop one. Only validation was pinned before. These are the\n // continuous substrings present in both files (\"prevents data loss\" because the\n // full \"error handling that prevents data loss\" wraps a line in SKILL.md).\n "} {"bin": "16_token_ish", "content_sha256": "0d2185d967bbbf3092237c9858b4a0d0fe5a03b7b6347bdbf1b15e7b1ea492f9", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/hooks/pre_commit_hooks/requirements_txt_fixer.rs", "end": 12210, "example_id": "0004d17cf7c6799d1be0bceabc0a97664e95bc14d347f71219dd609769ac5207", "language": "rust", "prefix": "cd\\na=3.0.0 \\\\\\n --hash=sha256:a1b1c1d1\",\n b\"a=3.0.0 \\\\\\n --hash=sha256:a1b1c1d1\\nb==1.0.0\\nc=2.0.0 \\\\\\n --hash=sha256:abcd\\n\",\n ),\n (\n b\"a=2.0.0 \\\\\\n --hash=sha256:abcd\\nb==1.0.0\\n\",\n b\"", "repo": "j178/prek", "span_codepoints": 64, "start": 12146, "suffix": " (b\"foo\\r\\nbar\\r\\n\", b\"bar\\r\\nfoo\\r\\n\"),\n (b\"# header\\nfoo \\\\\\n\\nbar\\n\", b\"# header\\n\\nbar\\n\"),\n (\n b\"zeta\\n-e git+ssh://url \\\\\\n --config=#egg=Alpha\\n\",\n b\"-e git+ssh://url \\\\\\n --config=#egg=Alp", "target": "a=2.0.0 \\\\\\n --hash=sha256:abcd\\nb==1.0.0\\n\",\n ),\n "} {"bin": "32_token_ish", "content_sha256": "5308ec899ac988a3e5b27c4735c528027023dd4b5b7d58811cdb19b16d1eb657", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/mido.sh", "end": 16514, "example_id": "0004df1ceda534a5c4a13addb082cde1ec6d33a8f7b3ba0728a52acdb814418e", "language": "shell", "prefix": "CE=\"$version\"\n return 0\n fi ;;\n\n \"win2025-eval\" | \"win2022-eval\" | \"win2019-eval\" | \\\n \"win2019-hv\" | \"win2016-eval\" | \"win2012r2-eval\" )\n\n if downloadWindowsEval \"$version\" \"$lang\" \"$edition\"; then\n MIDO_SOURCE=\"$version\"\n ", "repo": "dockur/windows", "span_codepoints": 128, "start": 16386, "suffix": "\"Invalid VERSION specified, value \\\"$version\\\" is not recognized!\"\n return 1\n ;;\n esac\n\n MIDO_URL=$(getMido \"$version\" \"$lang\" \"\")\n [ -z \"$MIDO_URL\" ] && return 1\n\n if [[ \"${version,,}\" == \"win2008r2\"* ]]; then\n MIDO_SOURCE=\"win2008r2-eval", "target": " return 0\n fi ;;\n\n \"win2008r2\"*| \"win81${PLATFORM,,}\"* | \"win10${PLATFORM,,}-enterprise\"* ) ;;\n\n * )\n error "} {"bin": "8_token_ish", "content_sha256": "cb149140fb847f745eb03149390c69f24858811a64f60fc98ece5b305665b934", "document_id": "DataWithBaraa/sql-data-warehouse-project@92406686380cde6eca208c8b43e6fa40ecd26344:scripts/silver/proc_load_silver.sql", "end": 7478, "example_id": "0004e22224e0a29249b03630823a69b296dd9f97acddcab69fd5f7904fc09c34", "language": "sql", "prefix": "onze.erp_loc_a101;\n\t SET @end_time = GETDATE();\n PRINT '>> Load Duration: ' + CAST(DATEDIFF(SECOND, @start_time, @end_time) AS NVARCHAR) + ' seconds';\n PRINT '>> -------------';\n\t\t\n\t\t-- Loading erp_px_cat_g1v2\n\t\tSET @start_time = GETDATE()", "repo": "DataWithBaraa/sql-data-warehouse-project", "span_codepoints": 32, "start": 7446, "suffix": "silver.erp_px_cat_g1v2';\n\t\tTRUNCATE TABLE silver.erp_px_cat_g1v2;\n\t\tPRINT '>> Inserting Data Into: silver.erp_px_cat_g1v2';\n\t\tINSERT INTO silver.erp_px_cat_g1v2 (\n\t\t\tid,\n\t\t\tcat,\n\t\t\tsubcat,\n\t\t\tmaintenance\n\t\t)\n\t\tSELECT\n\t\t\tid,\n\t\t\tcat,\n\t\t\tsubcat,\n\t\t\tmaintenanc", "target": ";\n\t\tPRINT '>> Truncating Table: "} {"bin": "16_token_ish", "content_sha256": "15c2f6475fc8450120c113d13ffb66e41a1689602376c09acdbe67d34f8c0567", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/engines/_browsers/_controllers.py", "end": 3536, "example_id": "0004e684789020b8c2058485f753e65807369f9a8202242a15e9d38a05c3ae55", "language": "python", "prefix": " rules. Defaults to the system default locale.\n :param timezone_id: Changes the timezone of the browser. Defaults to the system timezone.\n :param wait_selector_state: The state to wait for the selector given with `wait_selector`. The", "repo": "D4Vinci/Scrapling", "span_codepoints": 64, "start": 3472, "suffix": " have a Chrome browser installed on your device, enable this, and the Fetcher will launch an instance of your browser and use it.\n :param load_dom: Enabled by default, wait for all JavaScript on page(s) to fully load and execute.\n :param cdp_", "target": " default state is `attached`.\n :param real_chrome: If you"} {"bin": "64_token_ish", "content_sha256": "0f5034b20cdf6c444eb5542cb84be31eb733aba3ceafcdf7de204d108ca38ea7", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:lib/config/expressionorlist.go", "end": 802, "example_id": "0004e7860b6a5acd303a9188a00588332288a046f2a1085e174e58ceffd2b2eb", "language": "go", "prefix": "ionCantHaveBoth = errors.New(\"config: expression block can't contain multiple expression types\")\n)\n\ntype ExpressionOrList struct {\n\tExpression string `json:\"-\" yaml:\"-\"`\n\tAll []string `json:\"all,omitempty\" yaml:\"all,omitempty\"`\n\tAny ", "repo": "TecharoHQ/anubis", "span_codepoints": 256, "start": 546, "suffix": "{\n\t\t\tif i != 0 {\n\t\t\t\tfmt.Fprintf(&sb, \" && \")\n\t\t\t}\n\t\t\tfmt.Fprintf(&sb, \"( %s )\", pred)\n\t\t}\n\t\treturn sb.String()\n\tcase len(eol.Any) != 0:\n\t\tvar sb strings.Builder\n\t\tfor i, pred := range eol.Any {\n\t\t\tif i != 0 {\n\t\t\t\tfmt.Fprintf(&sb, \" || \")\n\t\t\t}\n\t\t\tfmt.Fprin", "target": " []string `json:\"any,omitempty\" yaml:\"any,omitempty\"`\n}\n\nfunc (eol ExpressionOrList) String() string {\n\tswitch {\n\tcase len(eol.Expression) != 0:\n\t\treturn eol.Expression\n\tcase len(eol.All) != 0:\n\t\tvar sb strings.Builder\n\t\tfor i, pred := range eol.All "} {"bin": "8_token_ish", "content_sha256": "85934c959e5d8525fe947cded1423dfafddc32c1300782cdac63411aed25984d", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/commands/workflow-instructions-skipped.test.ts", "end": 4371, "example_id": "0004f213122f514ac92c6ec91e70adcce7793f51c4a9220b0c1cfbe8510e1aa0", "language": "typescript", "prefix": "tempDir = fs.mkdtempSync(path.join(os.tmpdir(), 'openspec-test-'));\n });\n\n afterEach(() => {\n fs.rmSync(tempDir, { recursive: true, force: true });\n });\n\n it('does not block apply on a skipped artifact when the schema requires all artifacts', async ", "repo": "Fission-AI/OpenSpec", "span_codepoints": 32, "start": 4339, "suffix": "apply block falls back to requiring every artifact,\n // including the specs-producing one - the skip must count as present.\n const schemaDir = path.join(tempDir, 'openspec', 'schemas', 'mini');\n fs.mkdirSync(schemaDir, { recursive: true });\n fs", "target": "() => {\n // A schema with no "} {"bin": "8_token_ish", "content_sha256": "cf55fa3d72b6844e516e27b96125d33de000bf81990bb3c58965cb22abff8fa4", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:csharp-book/src/ch15-2-incremental-adoption-strategy.md", "end": 1187, "example_id": "0004f7a268c1762c8af6c9b650894b7beeeac21889f339246b4d83324b7ccffa", "language": "markdown", "prefix": "line in content.lines() {\n for word in line.split_whitespace() {\n let word = word.to_lowercase();\n *word_count.entry(word).or_insert(0) += 1;\n }\n }\n \n let mut sorted: Vec<_> = word_count.into_iter().collect();\n ", "repo": "microsoft/RustTraining", "span_codepoints": 32, "start": 1155, "suffix": "(&a.1));\n \n for (word, count) in sorted.into_iter().take(args.top) {\n println!(\"{}: {}\", word, count);\n }\n \n Ok(())\n}\n```\n\n### Phase 2: Replace Performance-Critical Components (Weeks 5-8)\n```rust\n// Replace CPU-intensive data processi", "target": " sorted.sort_by(|a, b| b.1.cmp"} {"bin": "8_token_ish", "content_sha256": "3b9cfbe86bc2af4f7f23042e60eaccf5e8d9df866d8a35a77d00672eab5202e6", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/_base_converter.py", "end": 1063, "example_id": "0004fdc5d53725ea6c9ac1a9fa402f66cfcbaba9898030a902669d3ab583dc35", "language": "python", "prefix": "for `markdown`. New code should migrate to using `markdown` or __str__.\"\"\"\n return self.markdown\n\n @text_content.setter\n def text_content(self, markdown: str):\n \"\"\"Soft-deprecated alias for `markdown`. New code should migrate to using `", "repo": "microsoft/markitdown", "span_codepoints": 32, "start": 1031, "suffix": " self.markdown = markdown\n\n def __str__(self) -> str:\n \"\"\"Return the converted Markdown text.\"\"\"\n return self.markdown\n\n\nclass DocumentConverter:\n \"\"\"Abstract superclass of all DocumentConverters.\"\"\"\n\n def accepts(\n self,\n ", "target": "markdown` or __str__.\"\"\"\n "} {"bin": "16_token_ish", "content_sha256": "e7c8fec3d2391a4034c89d78e2e526a03aa6a919c6603ae15d4bf3a38553c16e", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/core/completions/completion-provider.test.ts", "end": 7095, "example_id": "00050502d55aa6bffb1c6baddfed52b319055caa347e9bfd857453228aff5495", "language": "typescript", "prefix": ") => {\n it('should return both change and spec IDs', async () => {\n const changesDir = path.join(testDir, 'openspec', 'changes');\n const specsDir = path.join(testDir, 'openspec', 'specs');\n await fs.mkdir(changesDir, { recursive: true });", "repo": "Fission-AI/OpenSpec", "span_codepoints": 64, "start": 7031, "suffix": "Create a change\n await fs.mkdir(path.join(changesDir, 'my-change'), { recursive: true });\n await fs.writeFile(path.join(changesDir, 'my-change', 'proposal.md'), '# Change');\n\n // Create a spec\n await fs.mkdir(path.join(specsDir, 'my-spe", "target": "\n await fs.mkdir(specsDir, { recursive: true });\n\n // "} {"bin": "32_token_ish", "content_sha256": "50b7035847a157b1de8f79fcfedda8b0ef1a36a993ad2edb7c3b7d48236ecf3e", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:tests/fuzz/diskann-prune-direct.c", "end": 2386, "example_id": "00051611b2417cfd77b240341db0954ada7b8436b7b784c90b61bfad9f5f6a76", "language": "c", "prefix": "rom interesting values */\n uint8_t alpha_idx = fuzz_byte(&data, &size, 0) % 8;\n float alpha_values[] = {0.0f, 0.5f, 1.0f, 1.2f, 1.5f, 2.0f, 10.0f, 100.0f};\n float alpha = alpha_values[alpha_idx];\n\n if (num_candidates == 0) {\n /* Test empty case */\n ", "repo": "asg017/sqlite-vec", "span_codepoints": 128, "start": 2258, "suffix": "NULL, &outCount);\n assert(rc == 0 /* SQLITE_OK */);\n assert(outCount == 0);\n return 0;\n }\n\n /* Allocate arrays */\n int n = num_candidates;\n float *inter_distances = malloc(n * n * sizeof(float));\n float *p_distances = malloc(n * sizeof(float)", "target": " int outCount = -1;\n int rc = diskann_prune_select(NULL, NULL, 0, alpha, max_neighbors,\n "} {"bin": "16_token_ish", "content_sha256": "5baae817d107ad948db05ed348477fea168289f3f29a4eddcc7466d5575da497", "document_id": "modelcontextprotocol/java-sdk@fd004989b9484c9b81be6b03463396797b354804:mcp-test/src/main/java/io/modelcontextprotocol/server/AbstractMcpSyncServerTests.java", "end": 4040, "example_id": "00051d0e7b2a061fe325f8baebe542f122cb8a3a291f65bf2be3716361106baa", "language": "java", "prefix": "ception();\n\t}\n\n\t@Test\n\tvoid testAddDuplicateToolCall() {\n\t\tTool duplicateTool = McpSchema.Tool.builder(TEST_TOOL_NAME, EMPTY_JSON_SCHEMA).title(\"Duplicate tool\").build();\n\n\t\tvar mcpSyncServer = prepareSyncServerBuilder().serverInfo(\"test-server\", \"1.0.0\")\n", "repo": "modelcontextprotocol/java-sdk", "span_codepoints": 64, "start": 3976, "suffix": "))\n\t\t\t.toolCall(duplicateTool,\n\t\t\t\t\t(exchange, request) -> CallToolResult.builder().content(List.of()).isError(false).build())\n\t\t\t.build();\n\n\t\tassertThatCode(() -> mcpSyncServer.addTool(McpServerFeatures.SyncToolSpecification.builder()\n\t\t\t.tool(duplicateTo", "target": "\t\t\t.capabilities(ServerCapabilities.builder().tools(true).build("} {"bin": "32_token_ish", "content_sha256": "35d3bac200ce605ab32a55e6d873c36bd652ca3ec57136de120b0870f450cb79", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/core/validation.test.ts", "end": 33812, "example_id": "00051e334c460ceb00cf1008aaaa1f1d29f9a4bcf689937e11741d2605a19d12", "language": "typescript", "prefix": "tent);\n const issues = shallIssues(report.issues);\n expect(issues).toHaveLength(1);\n expect(issues[0].message).not.toContain('not only in the header');\n });\n\n it('does not flag a requirement whose body line contains the keyword', async", "repo": "Fission-AI/OpenSpec", "span_codepoints": 128, "start": 33684, "suffix": "S\\n- **WHEN** x\\n- **THEN** y'\n );\n const report = await new Validator().validateSpecContent('demo', content);\n expect(shallIssues(report.issues)).toHaveLength(0);\n });\n\n it('rejects a lowercase shall/must in the body (matching the del", "target": " () => {\n const content = buildSpec(\n '### Requirement: Logging\\nThe system SHALL log all events.\\n\\n#### Scenario: "} {"bin": "16_token_ish", "content_sha256": "5a7bb103af6db7af89215cb2d20097fe59f2ac689e5175e4960290466fd47faf", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/browser/watchdogs/recording_watchdog.py", "end": 5572, "example_id": "000523e5bf4587d1848ac595fe738948f0e8211cf0609f6d66416329ae635eda", "language": "python", "prefix": "reencast on the specific session\n\t\t\t\t\tawait self.browser_session.cdp_client.send.Page.stopScreencast(session_id=self._current_session_id)\n\t\t\t\texcept Exception as e:\n\t\t\t\t\t# It's possible the session is already closed\n\t\t\t\t\tself.logger.debug(f'Failed to stop ", "repo": "browser-use/browser-use", "span_codepoints": 64, "start": 5508, "suffix": "self._current_session_id = cdp_session.session_id\n\n\t\t\t# Start recording on the new session\n\t\t\tawait cdp_session.cdp_client.send.Page.startScreencast(\n\t\t\t\tparams=self._screencast_params, # type: ignore\n\t\t\t\tsession_id=cdp_session.session_id,\n\t\t\t)\n\t\t\tself.lo", "target": "screencast on old session {self._current_session_id}: {e}')\n\n\t\t\t"} {"bin": "16_token_ish", "content_sha256": "f9195f442170c1d21467e69398def04e748f5bbbc5ab619c289aec8d5a9d422f", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/yahoo/search.test.js", "end": 2628, "example_id": "00052497a333adc9bb24330c2510f854beae3bedf4ef621ca448252ef0cfbbf3", "language": "javascript", "prefix": "]],\n });\n\n await expect(command.func(page, { keyword: 'opencli', limit: 1, page: 2 })).resolves.toEqual([{\n rank: 8,\n title: 'OpenCLI',\n url: 'https://github.com/jackwener/OpenCLI',\n snippet: 'CLI browser tooling',\n }]);\n });\n", "repo": "jackwener/OpenCLI", "span_codepoints": 64, "start": 2564, "suffix": " URLs', async () => {\n const page = createPageMock([\n [\n 'Bad redirect',\n 'https://r.search.yahoo.com/_ylt=x/RU=javascript%3Aalert(1)/RK=2/RS=x',\n 'should not be emitted',\n ],\n ]);\n\n await expect(command.func(page, {", "target": "\n it('drops decoded Yahoo redirect targets that are not http(s)"} {"bin": "16_token_ish", "content_sha256": "a2aed2930510f336d4c741954ba889652e6d51fa7896e117c1928cc2f08be559", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/languages/python/uv.rs", "end": 14554, "example_id": "00052d8a931e42c181ccbc2bd72eceeb793fde384a3f4af657657b6e52396abb", "language": "rust", "prefix": "> Self {\n Self { path }\n }\n\n pub(crate) fn cmd(&self, store: &Store) -> Cmd {\n let mut cmd = Cmd::new(&self.path);\n cmd.env(EnvVars::UV_CACHE_DIR, store.cache_path(CacheBucket::Uv));\n cmd\n }\n\n async fn select_source(", "repo": "j178/prek", "span_codepoints": 64, "start": 14490, "suffix": "Result {\n let url = format!(\n \"https://github.com/astral-sh/uv/releases/download/{CUR_UV_VERSION}/uv-x86_64-unknown-linux-gnu.tar.gz\"\n );\n let response = REQWEST_CLIENT\n .head(url)\n ", "target": ") -> Result {\n async fn check_github() -> "} {"bin": "64_token_ish", "content_sha256": "58db8045145b385dc288be7faa24820813d36d5d39171370af1ce50ecd968256", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/spiders/test_cache.py", "end": 1163, "example_id": "00053d33b4fdf7666c071d4c1ccb92217ce865f0d408b84000ce447e54a9c91d", "language": "python", "prefix": "body,\n status=status,\n reason=\"OK\",\n encoding=\"utf-8\",\n cookies={},\n headers={\"content-type\": \"text/html\"},\n request_headers={\"user-agent\": \"test\"},\n method=\"GET\",\n )\n\n\nclass TestResponseCacheManager:\n\n ", "repo": "D4Vinci/Scrapling", "span_codepoints": 256, "start": 907, "suffix": "x12\\x13\\x14\"\n original = _make_response(body=b\"test content\")\n\n await cache.put(fp, original, \"GET\")\n restored = await cache.get(fp)\n\n assert restored is not None\n assert restored.url == o", "target": " @pytest.mark.anyio\n async def test_put_get_roundtrip(self):\n with tempfile.TemporaryDirectory() as tmpdir:\n cache = ResponseCacheManager(tmpdir)\n fp = b\"\\x01\\x02\\x03\\x04\\x05\\x06\\x07\\x08\\x09\\x0a\\x0b\\x0c\\x0d\\x0e\\x0f\\x10\\x11\\"} {"bin": "16_token_ish", "content_sha256": "7710f0c3f8a841937588aa777aa88e7c65df3bfbca88158aa2f93fbc65ca96d9", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/__tests__/auth-commands.test.ts", "end": 1033, "example_id": "000540110eed1e19faa1659221297ecd6986c7a4d89e778d50f4689acae789a2", "language": "typescript", "prefix": "\n DEFAULT_DEVICE_POLL_INTERVAL_SECONDS: 5,\n}));\n\nvi.mock(\"../utils/tracking.js\", () => ({\n trackEvent: vi.fn(),\n}));\n\nconst mockSpinner = {\n start: vi.fn().mockReturnThis(),\n stop: vi.fn().mockReturnThis(),\n succeed: vi.fn().mockReturnThis(),\n fail: ", "repo": "upstash/context7", "span_codepoints": 64, "start": 969, "suffix": " default: () => mockSpinner }));\n\nconst mockOpen = vi.fn().mockResolvedValue(undefined);\nvi.mock(\"open\", () => ({ default: (...args: unknown[]) => mockOpen(...args) }));\n\nvi.mock(\"../constants.js\", () => ({ CLI_CLIENT_ID: \"test-client-id\" }));\nvi.mock(\"../", "target": "vi.fn().mockReturnThis(),\n text: \"\",\n};\nvi.mock(\"ora\", () => ({"} {"bin": "32_token_ish", "content_sha256": "e61fd206814e0fb6c5e1c09ab716e41a85f07167bb2394fdb05465ac5cf6f512", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:src/core/parsers/requirement-blocks.ts", "end": 7352, "example_id": "00054382332c06bf60eaf3c13a75151e9cd53257619884648cbd8dad7a91b4a0", "language": "typescript", "prefix": " modified: modifiedLookup.found,\n removed: removedLookup.found,\n renamed: renamedLookup.found,\n },\n };\n}\n\nfunction splitTopLevelSections(lines: string[], fenceMask: boolean[]): Record {\n const result: Record = {};\n const indices: Array<{ title: string; index: number }> = [];\n for (let i = 0; i < lines.length; i++) {\n "} {"bin": "8_token_ish", "content_sha256": "6799887379de0dcc229a02897ab44d1ad774b2cbe6ce7cad59832e42feb0129c", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:internal/hub/heartbeat/heartbeat_test.go", "end": 1335, "example_id": "0005530a4899f5e187ab52e9c6cf259452a1ac75ec76000505983f6ef2b510ab", "language": "go", "prefix": "= func(key string) (string, bool) {\n\t\t\tv, ok := env[key]\n\t\t\treturn v, ok\n\t\t}\n\n\t\thb := heartbeat.New(app.App, getEnv)\n\t\trequire.NotNil(t, hb)\n\t\tcfg := hb.GetConfig()\n\t\tassert.Equal(t, \"https://heartbeat.example.com/ping\", cfg.URL)\n\t\tassert.Equal(t, 90, cfg.", "repo": "henrygd/beszel", "span_codepoints": 32, "start": 1303, "suffix": ".MethodHead, cfg.Method)\n\t})\n}\n\nfunc TestSendGETDoesNotRequireAppOrDB(t *testing.T) {\n\tapp := newTestHub(t)\n\tserver := httptest.NewServer(http.HandlerFunc(func(w http.ResponseWriter, r *http.Request) {\n\t\tassert.Equal(t, http.MethodGet, r.Method)\n\t\tassert.E", "target": "Interval)\n\t\tassert.Equal(t, http"} {"bin": "16_token_ish", "content_sha256": "5a9976de581707f0f816221505b968d3d2da6a9415279166c491882a217f5ad7", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/linker/lnk_symbol_table.c", "end": 29978, "example_id": "00055dd5afb3a096fbff5382b27e18b64224d702862f615282cdb54f12d5d4c6", "language": "c", "prefix": "ol symbol_parsed = lnk_parsed_from_symbol(symbol);\n COFF_SymbolValueInterpType symbol_interp = coff_interp_from_parsed_symbol(symbol_parsed);\n if (symbol_interp == COFF_SymbolValueInterp_Weak) {\n LNK_ObjSymbolRef resolve = {0};\n", "repo": "EpicGames/raddebugger", "span_codepoints": 64, "start": 29914, "suffix": ")) {\n COFF_ParsedSymbol resolve_parsed = lnk_parsed_symbol_from_coff_symbol_idx(resolve.obj, resolve.symbol_idx);\n COFF_SymbolValueInterpType resolve_interp = coff_interp_from_parsed_symbol(resolve_parsed);\n if (resolve_", "target": " if (lnk_resolve_weak_symbol(symtab, symbol_ref, &resolve"} {"bin": "8_token_ish", "content_sha256": "e71a96aa60c9c56253d99a5c996d6ee7c2fe912eecf990bae6f0ecaa06207b72", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/button-group.tsx", "end": 1451, "example_id": "000564eefdb8631c9b63f2aa9262cc8ce83044756420dd446cbd257ab7159647", "language": "typescript", "prefix": "ion,\n ...props\n}: React.ComponentProps<\"div\"> & VariantProps) {\n return (\n \n )\n}\n\nfunction ButtonGroupText({\n className,\n render,\n ...props\n}: useRender.ComponentProps<\"div\">) {\n return useRender({\n defaultTagName: \"div\",\n props: mergeProps<\"div\">(\n {\n className: cn(\n \"flex items-center gap-2 ", "target": ", className)}\n {...props}\n "} {"bin": "64_token_ish", "content_sha256": "50e0577ba8368c10751fe475d2f9fbd308e703514f16866ea53ffe2ac3d766db", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/mercury/mercury.test.js", "end": 8174, "example_id": "0005669ca12d01f559e07109ba714118e072fa9eb4b76a4d2f75b520febb81b3", "language": "javascript", "prefix": "k([\n loggedInState(),\n createSurface(),\n clickResult(true),\n ], {\n uploadFiles: vi.fn().mockResolvedValue({ uploaded: true, files: 1, file_names: ['other.png'] }),\n });\n await expect(command.", "repo": "jackwener/OpenCLI", "span_codepoints": 256, "start": 7918, "suffix": "(),\n clickResult(true),\n ], {\n uploadFiles: vi.fn().mockResolvedValue({\n uploaded: true,\n files: 1,\n file_names: ['receipt.png'],\n target: '[data-testid=\"wrong\"]',\n ", "target": "func(page, validArgs())).rejects.toBeInstanceOf(CommandExecutionError);\n });\n\n it('typed-fails upload confirmation for the wrong input target', async () => {\n const page = createPageMock([\n loggedInState(),\n createSurface"} {"bin": "32_token_ish", "content_sha256": "052d859eda206385b608aba621784a7ef7dce0e689a5dcc6b9f45f7aed596e76", "document_id": "cloudwego/eino@ca0441ac0bceed8945dcf7d5a18c237c924c6aa8:adk/interrupt_test.go", "end": 42658, "example_id": "000570da950ae1e723108fe778644958dba39066f44a9dbe06e4685e68980e15", "language": "go", "prefix": " up the hierarchy: A is parent of B and C.\n\tagentA, err := SetSubAgents(ctx, agentA, []Agent{agentB, agentC})\n\tassert.NoError(t, err)\n\n\t// Run the test\n\trunner := NewRunner(ctx, RunnerConfig{\n\t\tAgent: agentA,\n\t\tCheckPointStore: newMyStore(),\n\t})\n", "repo": "cloudwego/eino", "span_codepoints": 128, "start": 42530, "suffix": "\n\t\tif !ok {\n\t\t\tbreak\n\t\t}\n\t\tevents = append(events, event)\n\t}\n\n\t// We expect 3 transfer events (A->B, B->A, A->C) and 1 interrupt event from C.\n\tassert.Equal(t, 4, len(events))\n\n\tinterruptEvent := events[3]\n\tassert.NotNil(t, interruptEvent.Action.Interrupte", "target": "\titer := runner.Query(ctx, \"start\", WithCheckPointID(\"cyclical-1\"))\n\n\tvar events []*AgentEvent\n\tfor {\n\t\tevent, ok := iter.Next()"} {"bin": "8_token_ish", "content_sha256": "9211ddd2687ba04a75c6c19f9896bbd1e62343d3d738e093f5241119da405645", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/browser/test_tabs.py", "end": 14727, "example_id": "000576b8bdf0bf27e1afd5e7894b3e9d45095681b09d62a2127c4acf8345683e", "language": "python", "prefix": "\t\"next_goal\": \"Complete task\",\n\t\t\t\t\"action\": [\n\t\t\t\t\t{\n\t\t\t\t\t\t\"done\": {\n\t\t\t\t\t\t\t\"text\": \"Successfully opened 4 tabs rapidly without timeout\",\n\t\t\t\t\t\t\t\"success\": true\n\t\t\t\t\t\t}\n\t\t\t\t\t}\n\t\t\t\t]\n\t\t\t}\n\t\t\t\"\"\",\n\t\t]\n\n\t\tmock_llm = create_mock_llm(actions=actions)\n\n\t\tagent ", "repo": "browser-use/browser-use", "span_codepoints": 32, "start": 14695, "suffix": "tabs rapidly and verify browser state remains accessible',\n\t\t\tllm=mock_llm,\n\t\t\tbrowser_session=browser_session,\n\t\t)\n\n\t\t# Run with timeout - should complete within 2 minutes\n\t\ttry:\n\t\t\thistory = await asyncio.wait_for(agent.run(max_steps=5), timeout=120)\n\t\t\t", "target": "= Agent(\n\t\t\ttask='Open multiple "} {"bin": "64_token_ish", "content_sha256": "6cd965a7b847a88e0e87d6a0813870ec7a0b83da46c623863a841c7d4375c139", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/spiders/test_links.py", "end": 4826, "example_id": "000591d6930441fc91b26e51bff20ccf516163b2a443b1956c5fb8b464577ae7", "language": "python", "prefix": "body>\n \n
m
\n \n \"\"\"\n resp = _make_response(html)\n urls = LinkExtractor(restrict_css=\"main\").extract(resp)\n assert", "repo": "D4Vinci/Scrapling", "span_codepoints": 256, "start": 4570, "suffix": "body>\n \"\"\"\n resp = _make_response(html)\n urls = LinkExtractor(restrict_xpath='//div[@id=\"content\"]').extract(resp)\n assert urls == [\"https://example.com/c\"]\n\n\nclass TestTagsAttrs:\n def test_custom_tags_and_attrs_for_st", "target": " urls == [\"https://example.com/main-link\"]\n\n def test_restrict_xpath_scopes_extraction(self):\n html = \"\"\"\n \n \n \n None:\n expected = (\n \"## Ov", "target": "(\"xlsx_image_end.xlsx\", svc) == expected\n\n\n# -------------------"} {"bin": "32_token_ish", "content_sha256": "1464727b468edad013b66218177cde58abe400f28eaa640e2b6b2e3ecb972d97", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:tests/fuzz/rescore-interleave.c", "end": 708, "example_id": "0005ce65e52004e5e14fe1bf91978110adf9a4b8a922d5cdf8e8720f20f10d27", "language": "c", "prefix": "he update code path that the existing rescore-operations.c misses.\n *\n * Key differences from rescore-operations.c:\n * - Tests BOTH bit and int8 quantizers (the existing target only tests bit)\n * - Fuzz-controlled query vectors (not fixed [1,0,0,...])\n * -", "repo": "asg017/sqlite-vec", "span_codepoints": 128, "start": 580, "suffix": " quantization loop)\n * - Interleaves KNN between mutations to stress the blob_reopen path\n * when _rescore_vectors rows have been deleted/modified\n */\nint LLVMFuzzerTestOneInput(const uint8_t *data, size_t size) {\n if (size < 8) return 0;\n\n int rc;\n ", "target": " Exercises the UPDATE path (line 9080+ in sqlite-vec.c)\n * - Tests with 16 dimensions (more realistic, exercises more of the\n * "} {"bin": "16_token_ish", "content_sha256": "11779aab45fc933676969bf24cfa44616ca44d96bc731ef167281c7b9206aa44", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/install.sh", "end": 16097, "example_id": "0005d0c283dc97cad5c77e58f31d76bb8266df96cf8c9746d5de2990f5e7d212", "language": "shell", "prefix": "led to extract archive!\" && return 1\n fi\n\n LABEL=$(isoinfo -d -i \"$file\" | sed -n 's/Volume id: //p') || LABEL=\"\"\n rm -f \"$file\" || warn \"Failed to remove temporary ISO file: $file\"\n\n fi\n\n return 0\n}\n\nsetMachine() {\n\n local id=\"$1\"\n local iso=", "repo": "dockur/windows", "span_codepoints": 64, "start": 16033, "suffix": "! disabled \"$REBUILD\"; then\n\n case \"${id,,}\" in\n \"win2k\"* ) legacy=\"2k\" ;;\n \"winxp\"* ) legacy=\"xp\" ;;\n \"win2003\"* ) legacy=\"2k3\" ;;\n esac\n\n if [ -n \"$legacy\" ]; then\n if ! legacyInstall \"$iso\" \"$dir\" \"$desc\" \"$legacy\"; then", "target": "\"$2\"\n local dir=\"$3\"\n local desc=\"$4\"\n local legacy=\"\"\n\n if "} {"bin": "64_token_ish", "content_sha256": "9c282f5f84cc19c9b451d8b4d08a9ad8e651ca2b81ffc41e8aa98463cb3fd0f4", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/commands/auth.ts", "end": 6474, "example_id": "0005d1cac6b9343645a780c73767bd3f04730bd73c70e50208d293cf590d92dd", "language": "typescript", "prefix": "Error) console.error(pc.red(error.message));\n return null;\n }\n }\n\n waitingSpinner.fail(pc.red(\"Code expired without approval.\"));\n return null;\n}\n\nasync function loginCommand(options: { browser: boolean }): Promise {\n trackEvent(\"command\"", "repo": "upstash/context7", "span_codepoints": 256, "start": 6218, "suffix": " return;\n }\n clearTokens();\n\n const token = await performLogin(options.browser);\n if (!token) {\n process.exit(1);\n }\n console.log(\"\");\n console.log(pc.dim(\"You can now use authenticated Context7 features.\"));\n}\n\nfunction logoutCommand(): void ", "target": ", { name: \"login\" });\n const existingToken = await getValidAccessToken();\n if (existingToken) {\n console.log(pc.yellow(\"You are already logged in.\"));\n console.log(pc.dim(\"Run 'ctx7 logout' first if you want to log in with a different account.\"));\n"} {"bin": "64_token_ish", "content_sha256": "5c1e63b3d563a564b541308139b83e63501bab8012e31b4256df6586d7ff722d", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:test.sql", "end": 6688, "example_id": "0005e34babbc84de225e74fc05ed520d7fb6fcc16e392b02cf3912a4bf27e474", "language": "sql", "prefix": "he Rings: The Fellowship of the Ring', 210, 4.2),\n (5, '[5]', 'documentary', 'An Inconvenient Truth', 93, 3.4),\n (6, '[6]', 'horror', 'Hereditary', 167, 4.7),\n (7, '[7]', 'comedy', 'Anchorman: The Legend of Ron Burgundy', 482, 2.9),\n (8, '[8]', 'scifi'", "repo": "asg017/sqlite-vec", "span_codepoints": 256, "start": 6432, "suffix": ".8),\n (13, '[13]', 'scifi', 'The Matrix', 423, 4.5),\n (14, '[14]', 'fantasy', 'Pan''s Labyrinth', 275, 3.6),\n (15, '[15]', 'documentary', '13th', 191, 4.4),\n (16, '[16]', 'horror', 'It Follows', 314, 4.3),\n (17, '[17]', 'comedy', 'Step Brothers', 74, ", "target": ", 'Blade Runner 2049', 301, 5.0),\n (9, '[9]', 'fantasy', 'Harry Potter and the Sorcerer''s Stone', 134, 4.1),\n (10, '[10]', 'documentary', 'Free Solo', 66, 3.2),\n (11, '[11]', 'horror', 'Get Out', 88, 4.9),\n (12, '[12]', 'comedy', 'The Hangover', 59, 2"} {"bin": "8_token_ish", "content_sha256": "ef670a657540b1db0eedb2b8ab8685a3db6e8362ea3f98a70e9fdc21e97815d7", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/languages/conda.rs", "end": 2097, "example_id": "0005ec0b638649a0d7ab95f13312ffdd1e1c958361d4191f709c71874a411bc3", "language": "rust", "prefix": "install_cmd = Cmd::new(conda);\n install_cmd\n .arg(\"install\")\n .arg(\"-p\")\n .arg(&info.env_path)\n .args(&hook.additional_dependencies);\n if let Some(repo_path) = hook.repo_path", "repo": "j178/prek", "span_codepoints": 32, "start": 2065, "suffix": ".current_dir(repo_path);\n }\n install_cmd\n .check(true)\n .output()\n .await\n .context(\"Failed to install Conda dependencies\")?;\n }\n\n info.persist_env_path();\n\n ", "target": "() {\n install_cmd"} {"bin": "8_token_ish", "content_sha256": "e9a7e9eb6b087e60e2fed07e61370fbd1bfca76b16bb95c86170cffedcebff96", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:benchmarks/robustness-audit.js", "end": 10359, "example_id": "0005eeba82b470790d4e10324df05683a09623329245071b029021ee24198245", "language": "javascript", "prefix": "'],\n prompt: 'Write a Python function that validates an IPv4 address.',\n cases: [[['192.168.1.1'], true], [['0.0.0.0'], true], [['255.255.255.255'], true], [['999.999.999.999'], false], [['256.1.1.1'], false], [['1.2.3'], false], [['abc'], false]],\n ", "repo": "DietrichGebert/ponytail", "span_codepoints": 32, "start": 10327, "suffix": "validate_ipv4(s):\\n try:\\n ipaddress.IPv4Address(s); return True\\n except Exception: return False',\n bad: \"import re\\ndef validate_ipv4(s):\\n return bool(re.match(r'^\\\\d{1,3}\\\\.\\\\d{1,3}\\\\.\\\\d{1,3}\\\\.\\\\d{1,3}$', s))\" },\n];\n\nfunction pyBlo", "target": " good: 'import ipaddress\\ndef "} {"bin": "8_token_ish", "content_sha256": "bd73903a16a7ef88221cde582f85e861f568f4d9fd018c94d82ebbde37357b6e", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/lichess/lichess.test.js", "end": 1646, "example_id": "0005f23ce01562c661b24a48a7f8e7c5909bef2cb58a0f782c11734d689ac05b", "language": "javascript", "prefix": "d: 'closed-user', username: 'ClosedUser', disabled: true,\n }), { status: 200 })));\n await expect(cmd.func({ username: 'ClosedUser' })).rejects.toThrow(EmptyResultError);\n });\n\n it('picks the most-played perf as topPerf', async () => {\n ", "repo": "jackwener/OpenCLI", "span_codepoints": 32, "start": 1614, "suffix": ".fn().mockResolvedValue(new Response(JSON.stringify({\n id: 'someplayer',\n username: 'SomePlayer',\n createdAt: 1543000000000,\n seenAt: 1700000000000,\n count: { all: 100, win: 50, loss: 30, draw: 20 },\n ", "target": " vi.stubGlobal('fetch', vi"} {"bin": "16_token_ish", "content_sha256": "fba7f4080f31b16dc86517fd452cefa8f10e1dc3391cadffe4df598b627b2c06", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:examples/rag_dynamic_tools_multi_turn/src/main.rs", "end": 2539, "example_id": "00061b3643fddcdde314e180fe8fb6a11aa81e5489fca92648f4bbc82d9199c7", "language": "rust", "prefix": "t\",\n \"properties\": {\n \"x\": {\n \"type\": \"number\",\n \"description\": \"The number to subtract from\"\n },\n \"y\": {\n \"type\": \"number\",\n ", "repo": "0xPlaygrounds/rig", "span_codepoints": 64, "start": 2475, "suffix": " }\n })\n }\n\n async fn call(\n &self,\n _context: &mut rig::tool::ToolContext,\n args: Self::Args,\n ) -> Result {\n let result = args.x - args.y;\n Ok(result)\n }\n}\n\nimpl ToolE", "target": " \"description\": \"The number to subtract\"\n }\n "} {"bin": "16_token_ish", "content_sha256": "427964c598bcc8e9a2d31c001d222cd67aed4c56dfe8b3064357ca17e1435285", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:lib/policy/expressions/environment.go", "end": 7362, "example_id": "00061d57e16feaca2b5c029a5b7d7b260fe81503e88490bee907b8093688ec79", "language": "go", "prefix": "Int(rand.IntN(bound))\n\t\t\t\t}),\n\t\t\t),\n\t\t),\n\t}\n\n\targs = append(args, opts...)\n\treturn cel.NewEnv(args...)\n}\n\n// Compile takes CEL environment and syntax tree then emits an optimized\n// Program for execution.\nfunc Compile(env *cel.Env, src string) (cel.Program", "repo": "TecharoHQ/anubis", "span_codepoints": 64, "start": 7298, "suffix": " {\n\t\treturn nil, iss.Err()\n\t}\n\n\tast, iss := env.Check(intermediate)\n\tif iss != nil {\n\t\treturn nil, iss.Err()\n\t}\n\n\treturn env.Program(\n\t\tast,\n\t\tcel.EvalOptions(\n\t\t\t// optimize regular expressions right now instead of on the fly\n\t\t\tcel.OptOptimize,\n\t\t),\n\t)\n}", "target": ", error) {\n\tintermediate, iss := env.Compile(src)\n\tif iss != nil"} {"bin": "8_token_ish", "content_sha256": "bc9427b1700107d33dade0026f858459850759ee9c148383c990965d5a2aec8b", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:skills/cloud/references/api-v2.md", "end": 10897, "example_id": "000636d51c650b372931bc613b412abc21cf1134e07e883b191e8034aea96db2", "language": "markdown", "prefix": "vnd.openxmlformats-officedocument.wordprocessingml.document`, `application/vnd.ms-excel`, `application/vnd.openxmlformats-officedocument.spreadsheetml.sheet`, `text/plain`, `text/csv`, `text/markdown` |\n\n## Response Schemas\n\n**TaskItemView:** id, sessionId", "repo": "browser-use/browser-use", "span_codepoints": 32, "start": 10865, "suffix": "finishedAt?, metadata?, output?, browserUseVersion?, isSuccess?\n\n**TaskView:** extends TaskItemView + steps: TaskStepView[], outputFiles: FileView[]\n\n**TaskStepView:** number, memory, evaluationPreviousGoal, nextGoal, url, screenshotUrl?, actions: string[]", "target": ", llm, task, status, startedAt, "} {"bin": "64_token_ish", "content_sha256": "549bf14217ca8076437fa391ef117efe215ebcad0268561dc85bc6ec4f7d19cd", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:tests/providers/deepseek/request_hook.rs", "end": 608, "example_id": "00063b1fb44b9ca4a3601974894d4a3062e6722e4f1755fd59e5b05c8fa95363", "language": "rust", "prefix": "mic::{AtomicUsize, Ordering};\nuse std::sync::{Arc, Mutex};\n\nuse rig::agent::{\n AgentHook, CompletionCallAction, CompletionCallEvent, CompletionResponseEvent,\n ObservationAction,\n};\nuse rig::completion::{Message, Prompt};\nuse rig::message::UserContent", "repo": "0xPlaygrounds/rig", "span_codepoints": 256, "start": 352, "suffix": "\n response_calls: Arc,\n seen_prompt: Arc>>,\n seen_response: Arc>>,\n}\n\nimpl AgentHook for SessionIdHook<'_> {\n async fn on_completion_call(\n &self,\n _ctx: &rig::agent::HookCont", "target": ";\nuse rig::prelude::*;\nuse rig::providers::deepseek;\n\nuse super::support::with_deepseek_cassette_result;\nuse crate::support::assert_nonempty_response;\n\n#[derive(Clone)]\nstruct SessionIdHook<'a> {\n session_id: &'a str,\n prompt_calls: Arc,"} {"bin": "8_token_ish", "content_sha256": "1464727b468edad013b66218177cde58abe400f28eaa640e2b6b2e3ecb972d97", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:tests/fuzz/rescore-interleave.c", "end": 803, "example_id": "0006425e3bd28bd0cabd9d7032055b911693aaaad3de6957a74b20268794ee19", "language": "c", "prefix": ")\n * - Fuzz-controlled query vectors (not fixed [1,0,0,...])\n * - Exercises the UPDATE path (line 9080+ in sqlite-vec.c)\n * - Tests with 16 dimensions (more realistic, exercises more of the\n * quantization loop)\n * - Interleaves KNN between mutations to ", "repo": "asg017/sqlite-vec", "span_codepoints": 32, "start": 771, "suffix": " when _rescore_vectors rows have been deleted/modified\n */\nint LLVMFuzzerTestOneInput(const uint8_t *data, size_t size) {\n if (size < 8) return 0;\n\n int rc;\n sqlite3 *db;\n sqlite3_stmt *stmtInsert = NULL;\n sqlite3_stmt *stmtUpdate = NULL;\n sqlite3_st", "target": "stress the blob_reopen path\n * "} {"bin": "16_token_ish", "content_sha256": "f38eccf8b65a2cfe02c2255d5f6fd51fee6194cf076f4549be85710ed9fb0e16", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/browser/video_recorder.py", "end": 1802, "example_id": "000651f47933ca058d0bc7df26e858905e8e8c435af005da3dd9a5305cdf97f3", "language": "python", "prefix": "ct specifying the width and height of the video.\n\t\t framerate: The desired framerate for the output video.\n\t\t\"\"\"\n\t\tself.output_path = output_path\n\t\tself.size = size\n\t\tself.framerate = framerate\n\t\tself._writer: Optional['Format.Writer'] = None\n\t\tself._is", "repo": "browser-use/browser-use", "span_codepoints": 64, "start": 1738, "suffix": "\n\n\tdef start(self) -> None:\n\t\t\"\"\"\n\t\tPrepares and starts the video writer.\n\n\t\tIf the required optional dependencies are not installed, this method will\n\t\tlog an error and do nothing.\n\t\t\"\"\"\n\t\tif not IMAGEIO_AVAILABLE:\n\t\t\tlogger.error(\n\t\t\t\t'MP4 recording requ", "target": "_active = False\n\t\tself.padded_size = _get_padded_size(self.size)"} {"bin": "16_token_ish", "content_sha256": "c77c5e7eee15947f2b77a436630d5fbea8573d53894881b75d12f160d001fa81", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/parser/test_parser_advanced.py", "end": 9961, "example_id": "0006539a1f3ef0e4199fedb2c9ea80dd5efe96fba2ff0faa76bd3e753278a3d7", "language": "python", "prefix": "orld\")\n cleaned = text.clean(remove_entities=True)\n assert \"&\" not in cleaned\n assert \"&\" in cleaned\n assert \"\\t\" not in cleaned\n assert \"\\n\" not in cleaned\n\n def test_text_handler_clean_without_entities(self):\n ", "repo": "D4Vinci/Scrapling", "span_codepoints": 64, "start": 9897, "suffix": "\"\n text = TextHandler(\"Hello\\t&\\nWorld\")\n cleaned = text.clean(remove_entities=False)\n assert \"&\" in cleaned\n\n def test_text_handler_json_valid(self):\n \"\"\"Test TextHandler.json() with valid JSON\"\"\"\n text = Text", "target": " \"\"\"Test TextHandler.clean() preserves entities by default\"\""} {"bin": "32_token_ish", "content_sha256": "484e503fcb815524b23c61ae6a3c74d86ade5f21fae906a41317ec2f8925fb88", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/__tests__/remove.test.ts", "end": 9595, "example_id": "000668156f334332bf99f72cbbe8369b43aaa158a3aa0e1da4fa6b3a8d3f8346", "language": "typescript", "prefix": "remove\", {\n agents: [\"codex\"],\n scope: \"project\",\n modes: [\"cli\"],\n });\n });\n\n test(\"does not log not found items when other artifacts were removed\", async () => {\n const agentsPath = join(tempDir, \"AGENTS.md\");\n const tomlPath = ", "repo": "upstash/context7", "span_codepoints": 128, "start": 9467, "suffix": "\n\n await mkdir(join(tempDir, \".codex\"), { recursive: true });\n await mkdir(join(tempDir, \".agents\", \"skills\", \"context7-mcp\"), { recursive: true });\n await writeFile(\n agentsPath,\n \"# Before\\n\\n\\nrule body\\n\",\n },\n skill: {\n name: \"context7-mcp\",\n dir: (scope) =>\n scope === \"global\" ? join(homedir(), \".agent\", \"skills\") : join(\".agent\", \"sk", "target": ")],\n configKey: \"mcpServers\",\n buildEntry: (auth, transport) =>\n transport === \"stdio\" ? stdioEntry(auth) : withHeaders({ serverUrl: mcpUrl(auth) }, auth),\n },\n rule: {\n kind: \"append\",\n file: (scope) => (scope === \"global\""} {"bin": "64_token_ish", "content_sha256": "08518cd096e6c127bd1cebe83e6d1d6551bc3de2d1781bd1b7d9249f31e74708", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/arxiv/utils.js", "end": 899, "example_id": "00071cebdff9ce6e5bb30c06f32aaabf0ae4fa59cc12d2a84b88fca0257471e5", "language": "javascript", "prefix": " async function arxivFetch(params) {\n const resp = await fetch(`${ARXIV_BASE}?${params}`);\n if (!resp.ok) {\n throw new CommandExecutionError(`arXiv API HTTP ${resp.status}`, 'Check your search term or paper ID');\n }\n return resp.text();\n", "repo": "jackwener/OpenCLI", "span_codepoints": 256, "start": 643, "suffix": "must be a positive integer`);\n }\n if (limit > maxValue) {\n throw new ArgumentError(`arxiv ${label} must be <= ${maxValue}`);\n }\n return limit;\n}\nexport function normalizeArxivCategory(value) {\n const category = String(value || '').tri", "target": "}\nexport function normalizeArxivLimit(value, defaultValue, maxValue, label = 'limit') {\n const raw = value ?? defaultValue;\n const limit = Number(raw);\n if (!Number.isInteger(limit) || limit <= 0) {\n throw new ArgumentError(`arxiv ${label} "} {"bin": "32_token_ish", "content_sha256": "59d1436f06a74f2f7327e458fb476980577487ef9d3f8168308197d4b73e605a", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:examples/apps/ad-use/ad_generator.py", "end": 10026, "example_id": "000722928f238211c599ec7747042b74769eddb6a3cf1481107906fffdcba5b2", "language": "python", "prefix": "self.output_dir / f'ad_{timestamp}.mp4'\n\n\t\tasync with aiofiles.open(content_path, 'wb') as f:\n\t\t\tawait f.write(ad_content)\n\n\t\tanalysis_path = self.output_dir / f'analysis_{timestamp}.txt'\n\t\tasync with aiofiles.open(analysis_path, 'w', encoding='utf-8') as ", "repo": "browser-use/browser-use", "span_codepoints": 128, "start": 9898, "suffix": "\\n\\nGENERATED PROMPT:\\n')\n\t\t\tawait f.write(prompt)\n\n\t\treturn str(content_path)\n\n\ndef open_file(file_path: str):\n\t\"\"\"Open file with default system viewer\"\"\"\n\ttry:\n\t\tif sys.platform.startswith('darwin'):\n\t\t\tsubprocess.run(['open', file_path], check=True)\n\t\te", "target": "f:\n\t\t\tawait f.write(f'URL: {url}\\n\\n')\n\t\t\tawait f.write('BROWSER-USE ANALYSIS:\\n')\n\t\t\tawait f.write(analysis)\n\t\t\tawait f.write('"} {"bin": "8_token_ish", "content_sha256": "f8e9ac45de408b94cf389cb041188e3712c32f0d0a0a330eafe39b53c6c12b95", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:crates/rig-lancedb/examples/vector_search_local_ann.rs", "end": 2320, "example_id": "00072bb7c6dd185c64e3b92b8d24a0be8682b988140e047ef5fb3fb5ecdc70da", "language": "rust", "prefix": "ore information\n if table.index_stats(\"embedding\").await?.is_none() {\n table\n .create_index(\n &[\"embedding\"],\n lancedb::index::Index::IvfPq(IvfPqIndexBuilder::default()),\n )\n .execute", "repo": "0xPlaygrounds/rig", "span_codepoints": 32, "start": 2288, "suffix": " // Define search_params params that will be used by the vector store to perform the vector search.\n let search_params = SearchParams::default();\n let vector_store_index = LanceDbVectorIndex::new(table, model, \"id\", search_params).await?;\n\n let ", "target": "()\n .await?;\n }\n\n "} {"bin": "16_token_ish", "content_sha256": "e71882c4a29ebe078c20f67ba5723ed7a2f47bab256f18809d85433d69b36891", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:tests/providers/xai/extractor_usage.rs", "end": 3866, "example_id": "00073354e2799adf52b35c1f17c440751d3c60836e1bca75a583c43b5063b09a", "language": "rust", "prefix": " anyhow::ensure!(response.data.city.as_deref() == Some(\"Springfield\"));\n anyhow::ensure!(response.data.state.as_deref() == Some(\"IL\"));\n anyhow::ensure!(response.data.zip_code.as_deref() == Some(\"62701\"));\n anyhow", "repo": "0xPlaygrounds/rig", "span_codepoints": 64, "start": 3802, "suffix": "ensure!(response.usage.total_tokens > 0);\n\n Ok(())\n },\n )\n .await\n}\n\n#[tokio::test]\nasync fn extract_and_extract_with_usage_return_same_data() -> Result<()> {\n with_xai_cassette_result(\n \"extractor_usage/extract_and_extrac", "target": "::ensure!(response.usage.input_tokens > 0);\n anyhow::"} {"bin": "8_token_ish", "content_sha256": "52fd7a366ab75f9104559c812265dc77a9163657e5b3355af4ce161fdc7acdcc", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/fetchers/async/test_requests.py", "end": 956, "example_id": "00073875fd9e99bbcb3481fb667b062515c6e336091132c894241fa547162c8f", "language": "python", "prefix": "elf, httpbin):\n return {\n \"status_200\": f\"{httpbin.url}/status/200\",\n \"status_404\": f\"{httpbin.url}/status/404\",\n \"status_501\": f\"{httpbin.url}/status/501\",\n \"basic_url\": f\"{httpbin.url}/get\",\n ", "repo": "D4Vinci/Scrapling", "span_codepoints": 32, "start": 924, "suffix": "\",\n \"put_url\": f\"{httpbin.url}/put\",\n \"delete_url\": f\"{httpbin.url}/delete\",\n \"html_url\": f\"{httpbin.url}/html\",\n }\n\n async def test_basic_get(self, fetcher, urls):\n \"\"\"Test doing basic get request with mul", "target": "\"post_url\": f\"{httpbin.url}/post"} {"bin": "64_token_ish", "content_sha256": "788cd992175b00465e9d75748f7aed1eb92fdc88a10b261aba1264d56ceefa89", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/upwork/utils.js", "end": 4710, "example_id": "00073e267951b874ede04c54f615265cc5b7321d3382e64110e35e491e5a369b", "language": "javascript", "prefix": " (sort && sort !== 'recency') params.set('sort', sort);\n if (perPage && perPage !== 10) params.set('per_page', String(perPage));\n if (page && page > 1) params.set('page', String(page));\n return `${UPWORK_ORIGIN}/nx/search/jobs/?${params.toString()", "repo": "jackwener/OpenCLI", "span_codepoints": 256, "start": 4454, "suffix": "!t) throw new ArgumentError(`unknown feed tab \"${tab}\"`);\n return t.state;\n}\n\nexport function buildJobUrl(ciphertext) {\n return `${UPWORK_ORIGIN}/jobs/${ciphertext}`;\n}\n\nexport function isValidCiphertext(value) {\n return CIPHERTEXT_PATTERN.test(St", "target": "}`;\n}\n\nexport function buildFeedUrl(tab) {\n const t = FEED_TABS[tab];\n if (!t) throw new ArgumentError(`unknown feed tab \"${tab}\"`);\n return `${UPWORK_ORIGIN}${t.path}`;\n}\n\nexport function feedStateKey(tab) {\n const t = FEED_TABS[tab];\n if ("} {"bin": "8_token_ish", "content_sha256": "a5b58164080314a19ac002cd0ab1681b7fbda1b6d36a179302c54c8ada632c65", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/infrastructure/test_registry_action_parameter_injection.py", "end": 1251, "example_id": "000758ec6be4097dda7294c3a6943214e1ed84abbbc32ff6cbc456abbd742a45", "language": "python", "prefix": " \n Scroll Test\n \n \n \n
Top of the page
\n
Middle of the page
\n
= 0.0 && innerLocal.x <= iw && innerLocal.y >= 0.0 && innerLocal.y <= ih)\\n\"\n \" discard;\\n\"\n \" frag = vColor;\\n\"\n \" return;\\n\"\n \" }\\n\"\n \" // -------- Non-border rectangle or image --------\\n\"\n \" ", "repo": "nicbarker/clay", "span_codepoints": 128, "start": 8900, "suffix": " \" if (slot == 0) frag = texture(uTex0, vUV);\\n\"\n \" if (slot == 1) frag = texture(uTex1, vUV);\\n\"\n \" if (slot == 2) frag = texture(uTex2, vUV);\\n\"\n \" if (slot == 3) frag = texture(uTex3, vUV);\\n\"\n \" }\\n\"\n \"}\\n", "target": " if (vTexSlot < 0.0) {\\n\"\n \" frag = vColor;\\n\"\n \" } else {\\n\"\n \" int slot = int(vTexSlot + 0.5);\\n\"\n "} {"bin": "32_token_ish", "content_sha256": "1b26871f0b820c46199a36e0afc990e213043443af3e9f6ae77229e2ac07fe5b", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/carousel.tsx", "end": 1333, "example_id": "0007a488624f389b099125ffa3d7d6f879efd91c7b5698b9a03b8de839ea9d8a", "language": "typescript", "prefix": "uselProps\n\nconst CarouselContext = React.createContext(null)\n\nfunction useCarousel() {\n const context = React.useContext(CarouselContext)\n\n if (!context) {\n throw new Error(\"useCarousel must be used within a \")", "repo": "OpenCut-app/OpenCut", "span_codepoints": 128, "start": 1205, "suffix": ",\n ...props\n}: React.ComponentProps<\"div\"> & CarouselProps) {\n const [carouselRef, api] = useEmblaCarousel(\n {\n ...opts,\n axis: orientation === \"horizontal\" ? \"x\" : \"y\",\n },\n plugins\n )\n const [canScrollPrev, setCanScrollPrev] = Reac", "target": "\n }\n\n return context\n}\n\nfunction Carousel({\n orientation = \"horizontal\",\n opts,\n setApi,\n plugins,\n className,\n children"} {"bin": "8_token_ish", "content_sha256": "55cb9fb5c350dda7373c4699fcb729abccb37d8198ea158278eccba44efe3f0a", "document_id": "nicbarker/clay@e6cc36941ab2af5d81107617039d6f527a1c660b:examples/clay-official-website/main.c", "end": 18834, "example_id": "0007a536e5327e664b27e486eec6429ca684b394c748f1499625d9f6370f0857", "language": "c", "prefix": "ap = 8 } }) {\n CLAY_TEXT(CLAY_STRING(\"High Performance\"), CLAY_TEXT_CONFIG({ .fontSize = 48, .fontId = FONT_ID_TITLE_56, .textColor = COLOR_LIGHT }));\n CLAY(CLAY_ID(\"PerformanceSpacer\"), { .layout = { .sizing = { CLAY_SIZING_GROW(.max", "repo": "nicbarker/clay", "span_codepoints": 32, "start": 18802, "suffix": "_TEXT(CLAY_STRING(\"Fast enough to recompute your entire UI every frame.\"), CLAY_TEXT_CONFIG({ .fontSize = 28, .fontId = FONT_ID_BODY_36, .textColor = COLOR_LIGHT }));\n CLAY_TEXT(CLAY_STRING(\"Small memory footprint (3.5mb default) with static all", "target": " = 16) }} }) {}\n CLAY"} {"bin": "8_token_ish", "content_sha256": "d84cd6b8a42ef21acf064a431e36ca1db3f3c27035b11f04a96b2abfa87b7933", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/core/references.test.ts", "end": 1742, "example_id": "0007a93813642b33cb3e631e6502fa68e6f040bf45bde606cb9795c55b68bad1", "language": "typescript", "prefix": " process.env.XDG_DATA_HOME = savedXdgDataHome;\n }\n fs.rmSync(tempDir, { recursive: true, force: true });\n });\n\n function mkdir(relativePath: string): string {\n const dir = path.join(tempDir, relativePath);\n fs.mkdirSync(dir, { recursive:", "repo": "Fission-AI/OpenSpec", "span_codepoints": 32, "start": 1710, "suffix": " async function registerStore(\n id: string,\n options: { healthyRoot?: boolean; metadataId?: string | null } = {}\n ): Promise {\n const storeRoot = mkdir(`stores/${id}`);\n if (options.healthyRoot !== false) {\n createOpenSpecRoot(sto", "target": " true });\n return dir;\n }\n\n "} {"bin": "16_token_ish", "content_sha256": "5b753d325fa4bbc040bdb3da170853ca1000da2826617fe56f6c65d123339097", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/fetchers/test_proxy_rotation.py", "end": 9652, "example_id": "0007ad260fd2400fc813674018868017ad1eb974d5a95cbdbcc22577375e3d5b", "language": "python", "prefix": "sg\", [\n \"net::err_proxy_connection_failed\",\n \"NET::ERR_PROXY_AUTH_FAILED\",\n \"net::err_tunnel_connection_failed\",\n \"Connection refused by proxy\",\n \"Connection reset by peer\",\n \"Connection timed out while connecting ", "repo": "D4Vinci/Scrapling", "span_codepoints": 64, "start": 9588, "suffix": "\"Could not resolve proxy host\",\n ])\n def test_proxy_errors_detected(self, error_msg):\n \"\"\"Test that proxy-related errors are detected\"\"\"\n assert is_proxy_error(Exception(error_msg)) is True\n\n @pytest.mark.parametrize(\"error_msg\", [\n ", "target": "to proxy\",\n \"Failed to connect to proxy server\",\n "} {"bin": "8_token_ish", "content_sha256": "c77c5e7eee15947f2b77a436630d5fbea8573d53894881b75d12f160d001fa81", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/parser/test_parser_advanced.py", "end": 11799, "example_id": "0007c141e61cd7b701d93824b3994ef25510300b8df88f708d25dff6e5aba29c", "language": "python", "prefix": "text_handlers_re_empty(self):\n \"\"\"Test TextHandlers.re() on empty list\"\"\"\n handlers = TextHandlers([])\n results = handlers.re(r\"\\d+\")\n assert isinstance(results, TextHandlers)\n assert len(results) == 0\n\n def test_text_", "repo": "D4Vinci/Scrapling", "span_codepoints": 32, "start": 11767, "suffix": " \"\"\"Test TextHandlers.re() when no element matches\"\"\"\n handlers = TextHandlers([TextHandler(\"abc\"), TextHandler(\"def\")])\n results = handlers.re(r\"\\d+\")\n assert len(results) == 0\n\n def test_text_handlers_extract(self):\n \"", "target": "handlers_re_no_matches(self):\n "} {"bin": "16_token_ish", "content_sha256": "ed58a9742475bd09d4ef99c1f964470cab24f7a919f64bc0379a1db0a91f17c5", "document_id": "steipete/agent-scripts@bb3688355a4c1894dd53b4ed867d1600918fadf0:skills/clawsweeper-status/scripts/clawsweeper-status.test.sh", "end": 4726, "example_id": "0007c3ce6a546b0e2ea4eceb832fa3721d51d1632901695fec179c174f388826", "language": "shell", "prefix": "2099-01-01T00:00:00Z\",\"timelineItems\":{\"nodes\":[{\"createdAt\":\"2099-01-01T00:00:00Z\",\"actor\":{\"login\":\"clawsweeper\"}}]}}]}}}'\n ;;\n *)\n echo \"unexpected gh call: $*\" >&2\n exit 1\n ;;\nesac\nEOF\nchmod +x \"$tmpdir/gh\"\n\ncat >\"$tmpdir/curl\" <<'EOF'\n#!/", "repo": "steipete/agent-scripts", "span_codepoints": 64, "start": 4662, "suffix": "\"fail\" ]; then\n exit 22\nelif [ \"${CURL_TEST_MODE:-}\" = \"absent\" ]; then\n printf '%s\\n' '{\"pending\":2,\"dispatching\":3,\"leased\":5,\"target_stats\":[{\"target_repo\":\"test/other\",\"pending\":1,\"dispatching\":2,\"leased\":4}]}'\n exit 0\nfi\nprintf '%s\\n' '{\"pending\":2", "target": "usr/bin/env bash\nset -euo pipefail\nif [ \"${CURL_TEST_MODE:-}\" = "} {"bin": "16_token_ish", "content_sha256": "1568d8bf1aa102797496685ffe371b2f7d84699167e00ff4ad5abed0fef912c6", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/spiders/test_sitemap.py", "end": 8262, "example_id": "0007cdd77e632fdb5e6a4f6eced01bdbe2e700fb5fad984907eb6b0c7a54bb62", "language": "python", "prefix": " class S(SitemapSpider):\n name = \"s\"\n sitemap_urls = [\"https://example.com/sitemap.xml\"]\n\n def rules(self):\n return [CrawlRule(LinkExtractor(allow=r\"/posts/\"), callback=self.parse_post)]\n\n async", "repo": "D4Vinci/Scrapling", "span_codepoints": 64, "start": 8198, "suffix": "response.url}\n\n spider = S()\n out = await _collect(spider._parse_sitemap(_make_response(URLSET_XML)))\n post_req = next(r for r in out if \"/posts/\" in r.url)\n state = post_req.__getstate__()\n assert state[\"_callback_name\"]", "target": " def parse_post(self, response):\n yield {\"post\": "} {"bin": "8_token_ish", "content_sha256": "6006e1c16fae19b2bb3627b4265064818366c0ea1874188f6a02768eb4fb54ed", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/cli/yaml_to_toml.rs", "end": 5771, "example_id": "0007db975c09a4c8c317b326e4b39203f770bdc063cf585bf05e16af18b109d4", "language": "rust", "prefix": "Value>) -> InlineTable {\n let mut table = InlineTable::new();\n for (key, value) in values {\n let value = match value {\n serde_json::Value::Array(values) => {\n json_array_to_value_with_indent(values, \" \", \" \", ", "repo": "j178/prek", "span_codepoints": 32, "start": 5739, "suffix": " _ => json_to_toml_value(value),\n };\n table.insert(key.as_str(), value);\n }\n format_inline_table_multiline(&mut table, \" \", \" \");\n table\n}\n\nfn format_inline_table_multiline(table: &mut InlineTable, base_indent: &str, closing_inde", "target": "false)\n }\n "} {"bin": "64_token_ish", "content_sha256": "3bf2df8cf0cfb34b2c6cc548f25c2af83eeb8405b9718fc651818894cc171ff9", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:src/core/completions/generators/powershell-generator.ts", "end": 9082, "example_id": "0007dbac6cf3b7e747eba179327ccbb4f526f38b5b4463383028af2146180d95", "language": "typescript", "prefix": "ositionalIndex = 0`);\n lines.push(`${indent}$skipNext = $false`);\n lines.push(`${indent}for ($i = ${firstPositionalTokenIndex}; $i -lt ($commandCount - 1); $i++) {`);\n lines.push(`${indent} if ($skipNext) {`);\n lines.push(`${indent} $", "repo": "Fission-AI/OpenSpec", "span_codepoints": 256, "start": 8826, "suffix": "');\n lines.push(`${indent} if (@(${flagList}) -contains $token) {`);\n lines.push(`${indent} $skipNext = $true`);\n lines.push(`${indent} continue`);\n lines.push(`${indent} }`);\n lines.push(`${indent} if ($toke", "target": "skipNext = $false`);\n lines.push(`${indent} continue`);\n lines.push(`${indent} }`);\n lines.push(`${indent} $token = $tokens[$i]`);\n\n if (valueFlags.length > 0) {\n const flagList = valueFlags.map((flag) => `\"${flag}\"`).join(', "} {"bin": "8_token_ish", "content_sha256": "e3f42cc6e7b4e28174ed9ed1b1046d55cfc1fcc403ea680eee0b61887e0569d9", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:internal/hub/config/config_test.go", "end": 1084, "example_id": "0007e3177394c3ad1dfb8b180085d44e3f64baf1fde841a84aaba90884f0d54f", "language": "go", "prefix": "t string, port uint16, userIDs []string) (*core.Record, error) {\n// \tsystemCollection, err := app.FindCollectionByNameOrId(\"systems\")\n// \tif err != nil {\n// \t\treturn nil, err\n// \t}\n\n// \tsystem := core.NewRecord(systemCollection)\n// \tsystem.Set(\"name\", name", "repo": "henrygd/beszel", "span_codepoints": 32, "start": 1052, "suffix": "/ \tsystem.Set(\"port\", port)\n// \tsystem.Set(\"users\", userIDs)\n// \tsystem.Set(\"status\", \"pending\")\n\n// \treturn system, app.Save(system)\n// }\n\n// Helper function to create a fingerprint record\nfunc createConfigTestFingerprint(app core.App, systemID, token, fi", "target": ")\n// \tsystem.Set(\"host\", host)\n/"} {"bin": "8_token_ish", "content_sha256": "11779aab45fc933676969bf24cfa44616ca44d96bc731ef167281c7b9206aa44", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/install.sh", "end": 3946, "example_id": "0007e574b93eff190f876f08c0f9e4cb39807d4fcd7c63cba2a94d71c6a9f2b5", "language": "shell", "prefix": " backup was incomplete, continuing with installation...\"\n fi\n\n return 1\n\n fi\n fi\n\n [ -f \"$boot\" ] && hasData && return 0\n\n [ ! -f \"$iso\" ] && return 1\n [ ! -s \"$iso\" ] && return 1\n\n # Check if the ISO was already processed by our script\n ", "repo": "dockur/windows", "span_codepoints": 32, "start": 3914, "suffix": "=1 status=none | tr -d '\\000')\n magic=\"$(printf '%s' \"$magic\" | od -A n -t x1 -v | tr -d ' \\n')\"\n local byte=\"16\"\n enabled \"$MANUAL\" && byte=\"17\"\n\n if [[ \"$magic\" != \"$byte\" ]]; then\n\n info \"The ISO will be processed again because the configuration ", "target": " magic=$(dd if=\"$iso\" bs=1 count"} {"bin": "32_token_ish", "content_sha256": "bfb61792348d0e569cedf1c2b3307d237c6c2ecebbf76db01f09e4a0c8922f38", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:cmd/robots2policy/main.go", "end": 3078, "example_id": "0007e6f8c73068452613dfb4411a3cec715facbba7d1ed74710157eb19cccb31", "language": "go", "prefix": "!= nil {\n\t\t\tlog.Fatalf(\"failed to fetch robots.txt from URL: %v\", err)\n\t\t}\n\t\tdefer resp.Body.Close() //nolint:errcheck\n\t\tinput = resp.Body\n\t} else {\n\t\tfile, err := os.Open(*inputFile)\n\t\tif err != nil {\n\t\t\tlog.Fatalf(\"failed to open input file: %v\", err)\n\t\t", "repo": "TecharoHQ/anubis", "span_codepoints": 128, "start": 2950, "suffix": "\t}\n\t\t}()\n\t\tinput = file\n\t}\n\n\t// Parse robots.txt\n\trules, err := parseRobotsTxt(input)\n\tif err != nil {\n\t\tlog.Fatalf(\"failed to parse robots.txt: %v\", err)\n\t}\n\n\t// Convert to Anubis rules\n\tanubisRules := convertToAnubisRules(rules)\n\n\t// Check if any rules w", "target": "}\n\t\tdefer func() {\n\t\t\tif err := file.Close(); err != nil {\n\t\t\t\tlog.Fatalf(\"can't close output file %s: %v\", file.Name(), err)\n\t\t"} {"bin": "64_token_ish", "content_sha256": "5ba9751758fb1bc539c7c05bbd895fbe5c793695efde967888190ccbdbaa0ca5", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/core/test_storage_core.py", "end": 6145, "example_id": "0007f24e80b9a7ad56c7c3c878040bad03a3c0186e8ce2362d6a1270283bf57e", "language": "python", "prefix": "geSystem.cache_clear()\n StorageSystemMixin._get_base_url.cache_clear()\n\n storage_b = SQLiteStorageSystem(storage_file=db_path, url=\"https://site-b.com\")\n assert storage_b.retrieve(\"shared-id\") is None\n finally:\n ", "repo": "D4Vinci/Scrapling", "span_codepoints": 256, "start": 5889, "suffix": ">

Text

\")\n storage.save(element, \"path-test\")\n\n result = storage.retrieve(\"path-test\")\n assert result is not None\n assert \"path\" in result\n # Path should be a list of tag names from roo", "target": " storage_a.close()\n storage_b.close()\n if os.path.exists(db_path):\n os.unlink(db_path)\n\n def test_element_path_is_stored(self):\n storage = self._make_storage()\n element = self._make_element(\" {\n return parseStoreMetadataState(\n await fs.readFile(getStoreMetadataPath(storeRoot), 'utf-8')\n );\n}\n\nexport async function readOptionalStoreMetadataState(\n storeRoot: string\n): Promise {\n try {\n return await", "repo": "Fission-AI/OpenSpec", "span_codepoints": 64, "start": 9210, "suffix": "isFileNotFoundError(error)) {\n return null;\n }\n\n throw error;\n }\n}\n\nexport async function writeStoreMetadataState(\n storeRoot: string,\n state: StoreMetadataState\n): Promise {\n await FileSystemUtils.writeFile(\n getStoreMetadataPath(s", "target": " readStoreMetadataState(storeRoot);\n } catch (error) {\n if ("} {"bin": "64_token_ish", "content_sha256": "99dcbd6daea3baef0e12a72e2b7b847ba9350f06fd8e35d70e80f7b93e66fc2e", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/spiders/session.py", "end": 4338, "example_id": "0007f5dea1a49ff70f26ab74ec8525a3f5a12376bea4016edba2621fca9676d6", "language": "python", "prefix": " if not session._is_alive:\n await session.__aenter__()\n\n if isinstance(session, FetcherSession):\n client = session._client\n\n if isinstance(client, _ASyncSessionLogic):\n ", "repo": "D4Vinci/Scrapling", "span_codepoints": 256, "start": 4082, "suffix": " url=request.url,\n **kwargs,\n )\n else:\n # Sync session or other types - shouldn't happen in async context\n raise TypeError(f\"Session type {type(client)} n", "target": " kwargs = request._session_kwargs.copy()\n method = cast(SUPPORTED_HTTP_METHODS, kwargs.pop(\"method\", \"GET\"))\n response = await client._make_request(\n method=method,\n "} {"bin": "16_token_ish", "content_sha256": "437971d89670725cdf6387d52fa4fffac3d42a8085d9ba12c8a160cd869a1ea7", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/agent/system_prompts/system_prompt_no_thinking.md", "end": 10237, "example_id": "00080d88538e9dd8fea59784fbc46982b666471a20b02220c732f597410a15cb", "language": "markdown", "prefix": "ABSOLUTELY IMPOSSIBLE to continue.\nThe `done` action is your opportunity to terminate and share your findings with the user.\n- Set `success` to `true` only if the full USER REQUEST has been completed with no missing components.\n- If any part of the request", "repo": "browser-use/browser-use", "span_codepoints": 64, "start": 10173, "suffix": "\n- You can use the `text` field of the `done` action to communicate your findings and `files_to_display` to send file attachments to the user, e.g. `[\"results.md\"]`.\n- Put ALL the relevant information you found so far in the `text` field when you call `don", "target": " is missing, incomplete, or uncertain, set `success` to `false`."} {"bin": "64_token_ish", "content_sha256": "82dc30e0c9cd672a324b6d0d1a5f44c4a823908593ee65406431f975b93d4297", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converter_utils/docx/math/omml.py", "end": 6772, "example_id": "00080fe27cad0ff832d2ad5c871c5d92b4ced2db99a5634154a9c08f82f2f815", "language": "python", "prefix": "ict.get(\"den\"))\n\n def do_func(self, elm):\n \"\"\"\n the Function-Apply object (Examples:sin cos)\n \"\"\"\n c_dict = self.process_children_dict(elm)\n func_name = c_dict.get(\"fName\")\n return func_name.replace(FUNC_PLACE, ", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 6516, "suffix": " latex_chars.append(FUNC[t])\n else:\n raise NotImplementedError(\"Not support func %s\" % t)\n else:\n latex_chars.append(t)\n t = BLANK.join(latex_chars)\n return t if FUNC_PLACE in t else", "target": "c_dict.get(\"e\"))\n\n def do_fname(self, elm):\n \"\"\"\n the func name\n \"\"\"\n latex_chars = []\n for stag, t, e in self.process_children_list(elm):\n if stag == \"r\":\n if FUNC.get(t):\n "} {"bin": "32_token_ish", "content_sha256": "9174718df90572538ea76e33692981404a4fc958e6aaaeb00961646dec49d5b6", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/openalex/work.js", "end": 808, "example_id": "00081d2b4e65cb3be1adf8b220078d43171185409e2846cc64256a069501d324", "language": "javascript", "prefix": "from '@jackwener/opencli/registry';\nimport {\n OPENALEX_BASE,\n appendMailto,\n bareDoi,\n bareId,\n openalexFetch,\n reconstructAbstract,\n requireWorkRef,\n} from './utils.js';\n\nconst SELECT_FIELDS = [\n 'id', 'doi', 'title', 'publication_", "repo": "jackwener/OpenCLI", "span_codepoints": 128, "start": 680, "suffix": "', 'related_works', 'language', 'abstract_inverted_index',\n].join(',');\n\ncli({\n site: 'openalex',\n name: 'work',\n access: 'read',\n description: 'Fetch a single OpenAlex Work (paper / preprint / book) — metadata + abstract',\n domain: 'api.ope", "target": "year', 'publication_date',\n 'cited_by_count', 'authorships', 'primary_location', 'open_access', 'type',\n 'referenced_works"} {"bin": "8_token_ish", "content_sha256": "d10e710bb80923427b68fb58b90737299e7aa98b75819f4d1c46df1bde1b712e", "document_id": "cloudwego/eino@ca0441ac0bceed8945dcf7d5a18c237c924c6aa8:components/tool/interface.go", "end": 2713, "example_id": "0008275d4a4231deaa63ee7be447f65becae319f74b7590ab8b2fc09473c896c", "language": "go", "prefix": "/\n// When a tool implements both a standard and an enhanced interface, ToolsNode\n// prioritises the enhanced interface.\ntype EnhancedInvokableTool interface {\n\tBaseTool\n\tInvokableRun(ctx context.Context, toolArgument *schema.ToolArgument, opts ...Option) (", "repo": "cloudwego/eino", "span_codepoints": 32, "start": 2681, "suffix": " EnhancedStreamableTool is the streaming variant of [EnhancedInvokableTool].\n//\n// It streams [schema.ToolResult] chunks, enabling incremental multimodal\n// output. The caller is responsible for closing the returned [schema.StreamReader].\ntype EnhancedStre", "target": "*schema.ToolResult, error)\n}\n\n//"} {"bin": "16_token_ish", "content_sha256": "c7b29f83a2da158b5ba141012a008e84236cc3111f22ab4303bf9d49bbdeb7e9", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:crates/rig-core/src/memory.rs", "end": 12830, "example_id": "00084369e998046b223415d17b31e19616c5c31acd76227b4453309e8d8634ec", "language": "rust", "prefix": "(conversation_id, evicted, carry_over)\n }\n}\n\n/// A simple thread-safe in-memory [`ConversationMemory`] backed by a `HashMap`.\n///\n/// Messages are stored in process memory only and lost on restart. Useful for\n/// tests, examples, and short-lived agents.", "repo": "0xPlaygrounds/rig", "span_codepoints": 64, "start": 12766, "suffix": "`] to apply a history-shaping\n/// transformation on every load (truncation, summarization, re-ordering, etc.).\n/// Reusable named policies live in the `rig-memory` companion crate.\n#[derive(Clone, Default)]\npub struct InMemoryConversationMemory {\n inner", "target": " Pass a closure to\n/// [`InMemoryConversationMemory::with_filter"} {"bin": "16_token_ish", "content_sha256": "b0c2e7dbc7a768fb843fb80037bde82e6746cf7c4017e1c801f828cf827a45cc", "document_id": "modelcontextprotocol/java-sdk@fd004989b9484c9b81be6b03463396797b354804:mcp-test/src/main/java/io/modelcontextprotocol/client/AbstractMcpAsyncClientTests.java", "end": 20082, "example_id": "00084561a4935ad967278919f82f85bd8af1370bac29c5cdf905b56907b5941a", "language": "java", "prefix": "\t\t\t\t\t\t// Still validate basic properties\n\t\t\t\t\t\t\t\t\tif (content instanceof TextResourceContents textContent) {\n\t\t\t\t\t\t\t\t\t\tassertThat(textContent.text()).isNotNull();\n\t\t\t\t\t\t\t\t\t}\n\t\t\t\t\t\t\t\t\telse if (content instanceof BlobResourceContents blobContent) {\n\t\t\t\t\t\t\t\t\t", "repo": "modelcontextprotocol/java-sdk", "span_codepoints": 64, "start": 20018, "suffix": "}\n\t\t\t\t\t\t\t}\n\t\t\t\t\t\t}\n\t\t\t\t\t}\n\t\t\t\t})\n\t\t\t\t.verifyComplete();\n\t\t});\n\t}\n\n\t@Test\n\tvoid testListResourceTemplatesWithoutInitialization() {\n\t\tverifyCallSucceedsWithImplicitInitialization(client -> client.listResourceTemplates(McpSchema.FIRST_PAGE),\n\t\t\t\t\"listing reso", "target": "\tassertThat(blobContent.blob()).isNotNull();\n\t\t\t\t\t\t\t\t\t}\n\t\t\t\t\t\t\t\t"} {"bin": "32_token_ish", "content_sha256": "6fc17d46415a433607908bf11b1333303feb9075356e5abf37deb6cd7cdf5066", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/alert.tsx", "end": 1168, "example_id": "000850249b604ec048ddfe101c663e1667f3152122d084a249fed680eb3a362c", "language": "typescript", "prefix": " }\n)\n\nfunction Alert({\n className,\n variant,\n ...props\n}: React.ComponentProps<\"div\"> & VariantProps) {\n return (\n svg]/alert:col-start-2 [&_a]:underline [&_a]:underline-offset-3 [&_a]:hover:text-foreground\",\n className\n )}\n {...props}\n />\n )\n}\n\nfunction AlertDescription", "target": " {...props}\n />\n )\n}\n\nfunction AlertTitle({ className, ...props }: React.ComponentProps<\"div\">) {\n return (\n (scope === \"global\" ? join(homedir(), \".gemini\", \"GEMINI.md\") : \"GEMINI.md\"),\n sectionMarker: \"\",\n },\n skill: {\n name: \"context7-mcp\"", "repo": "upstash/context7", "span_codepoints": 128, "start": 7166, "suffix": "detect: {\n projectPaths: [\".agent\"],\n globalPaths: [join(homedir(), \".gemini\", \"antigravity\"), join(homedir(), \".agent\")],\n },\n },\n\n gemini: {\n name: \"gemini\",\n displayName: \"Gemini CLI\",\n mcp: {\n projectPaths: [join(\".gemini\",", "target": ",\n dir: (scope) =>\n scope === \"global\" ? join(homedir(), \".agent\", \"skills\") : join(\".agent\", \"skills\"),\n },\n "} {"bin": "16_token_ish", "content_sha256": "aef3213c242b7b08fe389e92a821e0d8b0c82b26ad3b0f041de2aa045bb96293", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/commands/docs.ts", "end": 5900, "example_id": "00089139da129fbde9ad74daeec3504026fcd3ad3322d1cf1b7c843486a2c6b7", "language": "typescript", "prefix": "total === 0) {\n spinner?.warn(`No documentation found for: \"${query}\"`);\n if (!spinner) log.warn(`No documentation found for: \"${query}\"`);\n return;\n }\n\n spinner?.stop();\n\n if (options.json) {\n console.log(JSON.stringify(ctx, null, 2));\n ", "repo": "upstash/context7", "span_codepoints": 64, "start": 5836, "suffix": "const snippet of ctx.codeSnippets) {\n log.plain(pc.bold(snippet.codeTitle));\n if (snippet.codeDescription) log.dim(snippet.codeDescription);\n log.blank();\n for (const code of snippet.codeList) {\n log.plain(\"```\" + code.language);", "target": "return;\n }\n\n log.blank();\n\n if (ctx.codeSnippets) {\n for ("} {"bin": "8_token_ish", "content_sha256": "e8c3a4beb34b69c86a17c3ee673927421b3d6c514dcb8eb0c55123dc4af04f8c", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_xlsx_converter.py", "end": 4271, "example_id": "000894fec7a2fa13f63ac130dea59813c35e3d5d9d6abf6713f75d088445c334", "language": "python", "prefix": "o is not None:\n raise MissingDependencyException(\n MISSING_DEPENDENCY_MESSAGE.format(\n converter=type(self).__name__,\n extension=\".xls\",\n feature=\"xls\",\n )\n ", "repo": "microsoft/markitdown", "span_codepoints": 32, "start": 4239, "suffix": "_exc_info[\n 1\n ].with_traceback( # type: ignore[union-attr]\n _xls_dependency_exc_info[2]\n )\n\n sheets = pd.read_excel(file_stream, sheet_name=None, engine=\"xlrd\")\n md_content = \"\"\n fo", "target": " ) from _xls_dependency"} {"bin": "64_token_ish", "content_sha256": "5b753d325fa4bbc040bdb3da170853ca1000da2826617fe56f6c65d123339097", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/fetchers/test_proxy_rotation.py", "end": 8668, "example_id": "000899962eeddeefc6471a08ceb377d8eba0cff17b4522079f27d8c5aa51935c", "language": "python", "prefix": "on't cause errors\"\"\"\n proxies = [f\"http://p{i}:8080\" for i in range(10)]\n rotator = ProxyRotator(proxies)\n results = []\n\n def get_proxies(n):\n for _ in range(n):\n results.append(rotator.get_proxy())\n\n ", "repo": "D4Vinci/Scrapling", "span_codepoints": 256, "start": 8412, "suffix": " assert all(p in proxies for p in results)\n\n def test_thread_pool_concurrent_access(self):\n \"\"\"Test concurrent access using ThreadPoolExecutor\"\"\"\n proxies = [\"http://p1:8080\", \"http://p2:8080\", \"http://p3:8080\"]\n rotator = Pro", "target": " threads = [Thread(target=get_proxies, args=(100,)) for _ in range(10)]\n for t in threads:\n t.start()\n for t in threads:\n t.join()\n\n # All results should be valid proxies\n assert len(results) == 1000\n "} {"bin": "64_token_ish", "content_sha256": "55cb9fb5c350dda7373c4699fcb729abccb37d8198ea158278eccba44efe3f0a", "document_id": "nicbarker/clay@e6cc36941ab2af5d81107617039d6f527a1c660b:examples/clay-official-website/main.c", "end": 27713, "example_id": "0008a09b836ecfa481d6457e4f87134f69a2d51397f5b2db90fbe2a00c9f7689", "language": "c", "prefix": "0), CLAY_SIZING_FIT(.min = windowHeight - 50) }, .childAlignment = {0, CLAY_ALIGN_Y_CENTER}, .padding = { 82, 82, 32, 32 }, .childGap = 64 }, .backgroundColor = COLOR_RED }) {\n CLAY(CLAY_ID(\"DebuggerLeftText\"), { .layout = { .sizing = { CLAY_SIZING_", "repo": "nicbarker/clay", "span_codepoints": 256, "start": 27457, "suffix": "DebuggerSpacer\"), { .layout = { .sizing = { CLAY_SIZING_GROW(.max = 16) }} }) {}\n CLAY_TEXT(CLAY_STRING(\"Clay includes built in \\\"Chrome Inspector\\\"-style debug tooling.\"), CLAY_TEXT_CONFIG({ .fontSize = 28, .fontId = FONT_ID_BODY_36, .textColor", "target": "PERCENT(0.5) }, .layoutDirection = CLAY_TOP_TO_BOTTOM, .childGap = 8 } }) {\n CLAY_TEXT(CLAY_STRING(\"Integrated Debug Tools\"), CLAY_TEXT_CONFIG({ .fontSize = 52, .fontId = FONT_ID_TITLE_56, .textColor = COLOR_LIGHT }));\n CLAY(CLAY_ID(\""} {"bin": "64_token_ish", "content_sha256": "1568d8bf1aa102797496685ffe371b2f7d84699167e00ff4ad5abed0fef912c6", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/spiders/test_sitemap.py", "end": 1433, "example_id": "0008e52c58a6acaa5342aaac316ffdfe279e8ee61cdcc01d1f1b95dc1e9b4222", "language": "python", "prefix": "/www.sitemaps.org/schemas/sitemap/0.9\"\n xmlns:xhtml=\"http://www.w3.org/1999/xhtml\">\n \n https://example.com/en/page\n \n \n https://example.com/products-sitemap.xml\n https://example.com/skip-sitemap.xml\n\n\"\"\"\n\ndef _make_response(body: bytes, url: str = \"https://example.com/sitemap.xml\", hea", "target": " hreflang=\"de\" href=\"https://example.com/de/page\"/>\n \n\n\"\"\"\n\nINDEX_XML = b\"\"\"\n\n https://example.com/posts-sitemap.xml Path:\n\tbin_dir = tmp_path /"} {"bin": "64_token_ish", "content_sha256": "4f972550616223083bd9304482990caa0f44c4e7ae58f54906ed16a8131be39e", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/engines/constants.py", "end": 1331, "example_id": "0008f021f4c1870b987696249b420eecd9ba4c8cebd03b5f1af08b681a5201fe", "language": "python", "prefix": "ault-browser-check\",\n \"--disable-session-crashed-bubble\",\n \"--disable-search-engine-choice-screen\",\n)\n\nSTEALTH_ARGS = (\n # Explanation: https://peter.sh/experiments/chromium-command-line-switches/\n # Generally this will make the browser faster ", "repo": "D4Vinci/Scrapling", "span_codepoints": 256, "start": 1075, "suffix": "\"--accept-lang=en-US\",\n \"--use-mock-keychain\",\n \"--disable-translate\",\n \"--disable-voice-input\",\n \"--window-position=0,0\",\n \"--disable-wake-on-wifi\",\n \"--ignore-gpu-blocklist\",\n \"--enable-tcp-fast-open\",\n \"--enable-web-bluetooth\",\n ", "target": "and less detectable\n # \"--incognito\",\n \"--test-type\",\n \"--lang=en-US\",\n \"--mute-audio\",\n \"--disable-sync\",\n \"--hide-scrollbars\",\n \"--disable-logging\",\n \"--start-maximized\", # For headless check bypass\n \"--enable-async-dns\",\n "} {"bin": "64_token_ish", "content_sha256": "c6348359933b1ee9ba7c1d4b730f4e80e4f3203a091429b383f793036e441d5b", "document_id": "Netflix/maestro@abdbdadf8f075b8fa488c9efb386b468c709a63c:maestro-engine/src/main/resources/db/migration/postgres/V202008251000__add_workflow_tables.sql", "end": 2309, "example_id": "0009010dfde894f97dd252a2f468b684f46a3e177ee896dda0ebfd1f55a38889", "language": "sql", "prefix": "NOT NULL CHECK (version_id > 0),\n metadata JSONB NOT NULL,\n definition JSON NOT NULL,\n trigger_uuids JSONB,\n create_ts TIMESTAMPTZ DEFAULT CURRENT_TIMESTAMP NOT NULL, -- processing delay is the time diff between it and metadata create_time\n", "repo": "Netflix/maestro", "span_codepoints": 256, "start": 2053, "suffix": ", -- is treated as version (not strictly increasing), add version if needed\n author JSONB NOT NULL, -- author for the properties_changes\n properties_changes JSONB NOT NULL, -- properties changes (delta) for the workflow leve", "target": " PRIMARY KEY (workflow_id, version_id)\n);\n\nCREATE TABLE IF NOT EXISTS maestro_workflow_properties ( -- table of properties changes and previous snapshot, immutable\n workflow_id TEXT NOT NULL COLLATE \"C\",\n create_time INT8 NOT NULL"} {"bin": "16_token_ish", "content_sha256": "b88abcde5a7ca6db5b7c7662be387d73505a073a1b64ebb8119c64f77e442c13", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/command.tsx", "end": 632, "example_id": "000904ee5b7aade278ea3a25a58bc6311f012da9974220314fae282ecacbade8", "language": "typescript", "prefix": "ponents/ui/input-group.tsx\"\nimport { HugeiconsIcon } from \"@hugeicons/react\"\nimport { SearchIcon, Tick02Icon } from \"@hugeicons/core-free-icons\"\n\nfunction Command({\n className,\n ...props\n}: React.ComponentProps) {\n return (\n ", "repo": "OpenCut-app/OpenCut", "span_codepoints": 64, "start": 568, "suffix": "\n \"flex size-full flex-col overflow-hidden rounded-xl bg-popover p-1 text-popover-foreground\",\n className\n )}\n {...props}\n />\n )\n}\n\nfunction CommandDialog({\n title = \"Command Palette\",\n description = \"Search for a command to r", "target": " bool:\n mimetype = (stream_info.mimetype or \"\").lower()\n extension = (stream_info.extension or \"\").lower()\n\n if extension ", "repo": "microsoft/markitdown", "span_codepoints": 64, "start": 3521, "suffix": " for prefix in ACCEPTED_XLS_MIME_TYPE_PREFIXES:\n if mimetype.startswith(prefix):\n return True\n\n return False\n\n def convert(\n self,\n file_stream: BinaryIO,\n stream_info: StreamInfo,\n **kwargs:", "target": "in ACCEPTED_XLS_FILE_EXTENSIONS:\n return True\n\n "} {"bin": "64_token_ish", "content_sha256": "ed58a9742475bd09d4ef99c1f964470cab24f7a919f64bc0379a1db0a91f17c5", "document_id": "steipete/agent-scripts@bb3688355a4c1894dd53b4ed867d1600918fadf0:skills/clawsweeper-status/scripts/clawsweeper-status.test.sh", "end": 4068, "example_id": "00091bca56889a5efbc0d75c7793d7a4ffa08fba0973a843b1180a9102b9c93d", "language": "shell", "prefix": "tabaseId\":24,\"name\":\"repair commit finding intake\",\"status\":\"requested\",\"conclusion\":null,\"createdAt\":\"2099-01-01T00:00:00Z\",\"url\":\"https://github.test/runs/24\"}]'\n ;;\n \"api repos/test/sweeper/actions/runs?status=failure&per_page=12\")\n printf '%s\\n'", "repo": "steipete/agent-scripts", "span_codepoints": 256, "start": 3812, "suffix": "\n printf '%s\\n' '{\"data\":{\"pulls\":{\"nodes\":[{\"title\":\"Closed pull request\",\"url\":\"https://github.test/pull/9\",\"closedAt\":\"2099-01-01T00:00:00Z\",\"timelineItems\":{\"nodes\":[{\"createdAt\":\"2099-01-01T00:00:00Z\",\"actor\":{\"login\":\"clawsweeper\"}}]}}]},\"issues\":", "target": " '[{\"databaseId\":11,\"name\":\"Sweep\",\"status\":\"completed\",\"conclusion\":\"failure\",\"createdAt\":\"2099-01-01T00:00:00Z\",\"url\":\"https://github.test/runs/11\"}]'\n ;;\n \"api repos/test/sweeper/actions/runs?status=\"*)\n printf '%s\\n' '[]'\n ;;\n \"api graphql\")"} {"bin": "32_token_ish", "content_sha256": "6014e167980b968d6f11883c295e39b3693dc97065f3ed05d28088dec8bd8813", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:examples/integrations/slack/README.md", "end": 1294, "example_id": "00091f82579aa369d676d347b6622057aadc27145f67d2da452be7a26fa6d1bc", "language": "markdown", "prefix": "* The URL provided by ngrok is ephemeral and will change each time ngrok is started. You will need to update the request URL in the bot's settings each time you restart ngrok. [See how to update the request URL](#updating-the-request-url-in-bots-settings).", "repo": "browser-use/browser-use", "span_codepoints": 128, "start": 1166, "suffix": " Workspace\", click on \"Install App to Workspace\".\n * Follow the prompts to authorize the app and add it to your workspace.\n5. Set up environment variables:\n * Obtain the `SLACK_SIGNING_SECRET`:\n * Go to the Slack API: https://api.slack.c", "target": "\n4. Add the bot to your Slack workspace:\n * Navigate to the \"OAuth & Permissions\" tab.\n * Under \"OAuth Tokens for Your"} {"bin": "8_token_ish", "content_sha256": "7f33315d49ac2b5c3efc00ab25f4625e1827e7f9d10a354bfde347b632d880f4", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:openspec/work/simplify-context-and-workspace-model/slices/store-root-parity/plan.md", "end": 9622, "example_id": "000920c9c014e28d479b9f9da14fccc3c2fb89c05404f1696361dea965e93782", "language": "markdown", "prefix": "ity.\n- Healthy roots without identity in JSON/non-interactive mode unless `--yes`\n is passed.\n\nMutations:\n\n- With existing identity, update local registry only when needed.\n- With confirmed conversion, create `.openspec-store/store.yaml` and update the\n ", "repo": "Fission-AI/OpenSpec", "span_codepoints": 32, "start": 9590, "suffix": "openspec/` planning files during register.\n\nInteractive conversion prompt should be direct:\n\n```text\nTurn this OpenSpec root into context store \"team-context\"?\n```\n\n### `context-store doctor`\n\nDoctor is the non-mutating health surface.\n\nIt checks:\n\n- Regis", "target": "local registry.\n- Never create `"} {"bin": "32_token_ish", "content_sha256": "5c1e63b3d563a564b541308139b83e63501bab8012e31b4256df6586d7ff722d", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:test.sql", "end": 5442, "example_id": "00092a611791e247b4e4dc354e1dcdcaf575d21cf754b9a8807c8ca51f16111c", "language": "sql", "prefix": " 4.8);\n*/\n\n/*\n\nINSERT INTO vec_movies(movie_id, synopsis_embedding, genre, num_reviews, mean_rating)\nVALUES\n (1, '[1]', 'horror', 153, 4.6),\n (2, '[2]', 'comedy', 382, 2.6),\n (3, '[3]', 'scifi', 53, 5.0),\n (4, '[4]', 'fantasy', 210, 4.2),\n (5, '[5]', ", "repo": "asg017/sqlite-vec", "span_codepoints": 128, "start": 5314, "suffix": "(9, '[9]', 'fantasy', 134, 4.1),\n (10, '[10]', 'documentary', 66, 3.2),\n (11, '[11]', 'horror', 88, 4.9),\n (12, '[12]', 'comedy', 59, 2.8),\n (13, '[13]', 'scifi', 423, 4.5),\n (14, '[14]', 'fantasy', 275, 3.6),\n (15, '[15]', 'documentary', 191, 4.4),\n", "target": "'documentary', 93, 3.4),\n (6, '[6]', 'horror', 167, 4.7),\n (7, '[7]', 'comedy', 482, 2.9),\n (8, '[8]', 'scifi', 301, 5.0),\n "} {"bin": "32_token_ish", "content_sha256": "9a3dd7879415651a061d217594d4ea9f985b2e3903c1b65cf03099cdb94dc49b", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:crates/rig-core/src/providers/openai/embedding.rs", "end": 9290, "example_id": "00092bf1482784fe779d7d3a83adbadf7d42cf7daa614059a9f2a8ab6cf6ee8c", "language": "rust", "prefix": "u64),\n cache_creation_input_tokens: 0,\n tool_use_prompt_tokens: 0,\n reasoning_tokens: 0,\n },\n None if Ext::REQUIRES_USAGE => {\n ", "repo": "0xPlaygrounds/rig", "span_codepoints": 128, "start": 9162, "suffix": ",\n });\n }\n None => crate::completion::Usage::new(),\n };\n\n let embeddings = response\n .data\n .into_i", "target": " return Err(EmbeddingError::MissingUsage {\n provider: Ext::PROVIDER_NAME"} {"bin": "16_token_ish", "content_sha256": "ad49a50cdc019bba871bad85c97b1b6272cb8c44739f289d6010239be2069cd8", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/filesystem/file_system.py", "end": 865, "example_id": "00093ad5723b53506a91e6b9b664a5bfca67ad9dcfbbf842225d73335d92b907", "language": "python", "prefix": ") -> str:\n\t\"\"\"Build a specific error message explaining why the filename was rejected and how to fix it.\"\"\"\n\tbase = os.path.basename(file_name)\n\n\t# Check for binary/image extension\n\tif '.' in base:\n\t\t_, ext = base.rsplit('.', 1)\n\t\text_lower = ext.lower()\n\t", "repo": "browser-use/browser-use", "span_codepoints": 64, "start": 801, "suffix": "f\"Error: Cannot write binary/image file '{base}'. \"\n\t\t\t\tf'The write_file tool only supports text-based files. '\n\t\t\t\tf'Supported extensions: {\", \".join(\".\" + e for e in supported_extensions)}. '\n\t\t\t\tf'For screenshots, the browser automatically captures them", "target": "\tif ext_lower in UNSUPPORTED_BINARY_EXTENSIONS:\n\t\t\treturn (\n\t\t\t\t"} {"bin": "32_token_ish", "content_sha256": "41f333c036d3e7c5d742f81da42534ef63ce6c1c25b2237145029d55248000f3", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/image.sh", "end": 5869, "example_id": "00093ebd213853a9603cc65b03e86baf5807c80c71f3c62d550170cc2deb86bb", "language": "shell", "prefix": "rm\")\n\n [ -n \"$candidate_base\" ] && [ -n \"$candidate_id\" ] && break\n done\n\n if [ -z \"$candidate_base\" ] || [ -z \"$candidate_id\" ]; then\n local name=\"${display:-${image:-$product}}\"\n [ -n \"$name\" ] && warn \"Unknown image name: '$name'\"\n ", "repo": "dockur/windows", "span_codepoints": 128, "start": 5741, "suffix": "* ||\n \"${product,,}\" == *\"evaluation\"* ||\n \"${edition_id,,}\" == *\"eval\"* ||\n \"${flags,,}\" == *\"eval\"* ]]; then\n evaluation=\"-eval\"\n fi\n\n if [ -n \"$evaluation\" ] &&\n [[ \"${candidate_id,,}\" != *\"-eval\" ]]; then\n candidate_", "target": " continue\n fi\n\n local evaluation=\"\"\n\n if [[ \"${image,,}\" == *\"evaluation\"* ||\n \"${display,,}\" == *\"evaluation\""} {"bin": "64_token_ish", "content_sha256": "795fe7db5dc234e3b2e008ebe3a1508b1640f35ec8988cffbc9587732a2a28b1", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:tests/providers/openrouter/cassette/agent_tool_sessions.rs", "end": 6992, "example_id": "00094007dbec636375d3a436f6a414b2b4315d83b37d889bac335b1f733c2f90", "language": "rust", "prefix": "json!({\n \"type\": \"object\",\n \"properties\": {\n \"labels\": {\n \"type\": \"array\",\n \"items\": { \"type\": \"string\" }\n },\n \"separator\": { \"type\": \"string\" }\n ", "repo": "0xPlaygrounds/rig", "span_codepoints": 256, "start": 6736, "suffix": ".log, Self::NAME, &args);\n Ok(format!(\"LABELS-OK {}\", args.labels.join(&args.separator)))\n }\n}\n\nimpl Tool for EscapeEcho {\n const NAME: &'static str = \"escape_echo\";\n type Error = SessionToolError;\n type Args = EchoArgs;\n type Output ", "target": " },\n \"required\": [\"labels\", \"separator\"]\n })\n }\n\n async fn call(\n &self,\n _context: &mut rig::tool::ToolContext,\n args: Self::Args,\n ) -> Result {\n push_invocation(&self"} {"bin": "64_token_ish", "content_sha256": "0ade33ba18b5de7898b0031c737185a5bc944d529b58ba3661e833f930a77ade", "document_id": "cloudwego/eino@ca0441ac0bceed8945dcf7d5a18c237c924c6aa8:adk/filesystem/backend_inmemory_test.go", "end": 35544, "example_id": "000945398fa2d18f073642a3e733f762c6573828f1ccc43afc1dbbf601f658f8", "language": "go", "prefix": "go\",\n\t\tContent: \"package main\\nfunc main() {\\n\\tlog.Error(\\\"error\\\")\\n\\tfmt.Println(\\\"hello\\\")\\n}\",\n\t})\n\tbackend.Write(ctx, &WriteRequest{\n\t\tFilePath: \"/test.py\",\n\t\tContent: \"def hello():\\n print('error')\\n print('world')\",\n\t})\n\tbackend.Write(ctx, ", "repo": "cloudwego/eino", "span_codepoints": 256, "start": 35288, "suffix": "})\n\t\tif err != nil {\n\t\t\tt.Fatalf(\"GrepRaw failed: %v\", err)\n\t\t}\n\t\tif len(matches) != 3 {\n\t\t\tt.Errorf(\"Expected 2 matches, got %d\", len(matches))\n\t\t}\n\t})\n\n\tt.Run(\"empty pattern error\", func(t *testing.T) {\n\t\t_, err := backend.GrepRaw(ctx, &GrepRequest{\n\t\t\tP", "target": "&WriteRequest{\n\t\tFilePath: \"/dir/file.go\",\n\t\tContent: \"package test\\nfunc TestError() {\\n\\tlog.Error(\\\"test error\\\")\\n}\",\n\t})\n\n\tt.Run(\"basic pattern search\", func(t *testing.T) {\n\t\tmatches, err := backend.GrepRaw(ctx, &GrepRequest{\n\t\t\tPattern: \"error\",\n\t\t"} {"bin": "16_token_ish", "content_sha256": "bd73903a16a7ef88221cde582f85e861f568f4d9fd018c94d82ebbde37357b6e", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/lichess/lichess.test.js", "end": 1649, "example_id": "0009455a87836a3d975355b1b827c1c1483e60d06bc81808c67da80f037f3047", "language": "javascript", "prefix": "SON.stringify({\n id: 'closed-user', username: 'ClosedUser', disabled: true,\n }), { status: 200 })));\n await expect(cmd.func({ username: 'ClosedUser' })).rejects.toThrow(EmptyResultError);\n });\n\n it('picks the most-played perf", "repo": "jackwener/OpenCLI", "span_codepoints": 64, "start": 1585, "suffix": "().mockResolvedValue(new Response(JSON.stringify({\n id: 'someplayer',\n username: 'SomePlayer',\n createdAt: 1543000000000,\n seenAt: 1700000000000,\n count: { all: 100, win: 50, loss: 30, draw: 20 },\n ", "target": " as topPerf', async () => {\n vi.stubGlobal('fetch', vi.fn"} {"bin": "64_token_ish", "content_sha256": "6dd2c037cc1d25fac0ad0cb5b34fa9563d91824c0816bf2f0f999ef8e100fa29", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:python-book/src/ch06-enums-and-pattern-matching.md", "end": 1399, "example_id": "00094d0d8cd9030d32f3a9af6d21505767d7718add9c02389fe7a74e9d42dff4", "language": "markdown", "prefix": ":\n return 3.14159 * r * r\n case Rectangle(width=w, height=h):\n return w * h\n case Triangle(base=b, height=h):\n return 0.5 * b * h\n # No compiler warning if you miss a case!\n # Adding a new shape?", "repo": "microsoft/RustTraining", "span_codepoints": 256, "start": 1143, "suffix": "Rectangle(f64, f64), // Rectangle carries width, height\n Triangle { base: f64, height: f64 }, // Named fields also work\n}\n\nfn area(shape: &Shape) -> f64 {\n match shape {\n Shape::Circle(r) => std::f64::consts::PI * r * r,\n Shape::", "target": " grep the codebase and hope you find all match blocks.\n```\n\n### Rust Enums — Data-Carrying Variants\n```rust\n// Rust — enum variants carry data, compiler enforces exhaustive matching\nenum Shape {\n Circle(f64), // Circle carries radius\n "} {"bin": "64_token_ish", "content_sha256": "a497dee4dafc4abf3240125d7c0de66f8773905518ca138257a2987dd64837dd", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/test_cu_converter.py", "end": 25590, "example_id": "000951aebb5b28f897e3bfceafa077d4f27edfb56ce34d43bebf3ae47a12918b", "language": "python", "prefix": "t _get_modality(ContentUnderstandingFileType.WAV) == \"audio\"\n assert _get_modality(ContentUnderstandingFileType.MP3) == \"audio\"\n\n\n# ---------------------------------------------------------------------------\n# convert() mock tests\n# ----------------", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 25334, "suffix": "._client = MagicMock()\n\n mock_result = MagicMock()\n mock_result.contents = []\n mock_poller = MagicMock()\n mock_poller.result.return_value = mock_result\n conv._client.begin_analyze_binary.return_value = mock_poller\n\n ", "target": "-----------------------------------------------------------\n\n\nclass TestConvertMock:\n \"\"\"Test convert() with mocked CU SDK.\"\"\"\n\n def _run_convert(self, extension, mimetype, expected_output=\"mock output\"):\n conv = _make_converter()\n conv"} {"bin": "64_token_ish", "content_sha256": "b3ad41b0689c17cd7c1de3e0a08f5011bda7d693370008413492e2125b91773f", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:agent/disk_test.go", "end": 15588, "example_id": "000961887eabf669afc7918fb7ced64b3f06f895deaa72b85347e6d500e293db", "language": "go", "prefix": "e: \"nvme1n1\"},\n\t\t\t\t},\n\t\t\t},\n\t\t}\n\t}\n\n\tt.Run(\"registers direct child of extra-filesystems\", func(t *testing.T) {\n\t\tagent := &Agent{fsStats: make(map[string]*system.FsStats)}\n\t\td := makeDiscovery(agent)\n\n\t\td.addPartitionExtraFs(disk.PartitionStat{\n\t\t\tDevice: ", "repo": "henrygd/beszel", "span_codepoints": 256, "start": 15332, "suffix": ", \"caddy1-root\", stats.Name)\n\t})\n\n\tt.Run(\"skips nested mount under extra-filesystem bind mount\", func(t *testing.T) {\n\t\tagent := &Agent{fsStats: make(map[string]*system.FsStats)}\n\t\td := makeDiscovery(agent)\n\n\t\t// These simulate the virtual mounts that appe", "target": " \"/dev/nvme0n1p1\",\n\t\t\tMountpoint: \"/extra-filesystems/nvme0n1p1__caddy1-root\",\n\t\t})\n\n\t\tstats, exists := agent.fsStats[\"nvme0n1p1\"]\n\t\tassert.True(t, exists)\n\t\tassert.Equal(t, \"/extra-filesystems/nvme0n1p1__caddy1-root\", stats.Mountpoint)\n\t\tassert.Equal(t"} {"bin": "8_token_ish", "content_sha256": "4a917370dfb68dcf981252756ee4ff2e2915a27993a583dd0d43e61977a62609", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:src/commands/store.ts", "end": 15339, "example_id": "000968ec723594949c75be55c0be2a12ce58d0820966f77e842060b18c25cd0b", "language": "typescript", "prefix": "it registerExistingStore({\n path: inputPath,\n id: options.id,\n allowCreateIdentity: options.yes,\n });\n } catch (error) {\n if (!isRegisterIdentityConfirmationError(error) || options.json || !isInteractive()) {\n ", "repo": "Fission-AI/OpenSpec", "span_codepoints": 32, "start": 15307, "suffix": "\n await confirmRegisterConversion(error);\n result = await registerExistingStore({\n path: inputPath,\n id: options.id,\n allowCreateIdentity: true,\n });\n }\n\n const payload = toMutationOutput(result);\n\n", "target": " throw error;\n }\n"} {"bin": "32_token_ish", "content_sha256": "45e0e0556f9efebd065a7e7043e2f043ba4a1e5ac5bc7bb0ec3ad01877b00fb4", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:openspec/work/simplify-context-and-workspace-model/slices/store-references/spec.md", "end": 10977, "example_id": "00097129b57b29405c675521a5549b726a0650ca2487785e2909d179bf1988de", "language": "markdown", "prefix": " spec, `instructions` output\n carries the index, and the printed fetch command runs verbatim\n against the built binary.\n- **Docs**: a \"Referencing stores from a project\" subsection in\n `docs/cli.md`'s Stores section documenting the `references:` config\n", "repo": "Fission-AI/OpenSpec", "span_codepoints": 128, "start": 10849, "suffix": "store:` pointer for rootless repos (3.2).\n- Canonical remotes in store identity and clone-source hints (3.3).\n- Later relationship health in doctor (3.6) — instructions-inline diagnostics\n are this slice's only health surface.\n- Any change to root resolut", "target": " key (no such config-key reference exists today — this subsection is\n created, not extended).\n\nOut of scope:\n\n- The fallback `"} {"bin": "16_token_ish", "content_sha256": "32ae36fe7f395dbc5c0a3fd3f09b62f2e7c96dba77362530c4f325a7f19ab70e", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_ipynb_converter.py", "end": 1362, "example_id": "0009a073b3cca4e0785d1c2b59a9922607467ff6b18e6cdd8231964c1a895359", "language": "python", "prefix": " or \"utf-8\"\n notebook_content = file_stream.read().decode(encoding)\n return (\n \"nbformat\" in notebook_content\n and \"nbformat_minor\" in notebook_content\n ", "repo": "microsoft/markitdown", "span_codepoints": 64, "start": 1298, "suffix": "cur_pos)\n\n return False\n\n def convert(\n self,\n file_stream: BinaryIO,\n stream_info: StreamInfo,\n **kwargs: Any, # Options to pass to the converter\n ) -> DocumentConverterResult:\n # Parse and convert the note", "target": ")\n finally:\n file_stream.seek("} {"bin": "64_token_ish", "content_sha256": "4db04dc51b2f2baf11bdc92ebee06d9b80da7c154aa26f71ca333908c69c17ec", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:tests/installer/opencode.test.mjs", "end": 7606, "example_id": "0009a3bc88780153a3ad1aca694e8115aa6beb392b208ae3941400843caf68f2", "language": "javascript", "prefix": "\n }\n});\n\n// ── 2c. AGENTS.md fence preserves user content above and below ───────────\ntest('opencode uninstall strips fenced AGENTS.md block, preserving user prefix and suffix', () => {\n const xdg = freshTmpDir();\n const shimDir = shimOpencode();\n try ", "repo": "JuliusBrussee/caveman", "span_codepoints": 256, "start": 7350, "suffix": " const installed = fs.readFileSync(agentsMd, 'utf8');\n // Sandwich the caveman block between user prefix and suffix.\n const userPrefix = '# my project\\n\\nuse 2-space indent.\\n\\n';\n const userSuffix = '\\n## extra\\n\\nkeep PRs small.\\n';\n fs.wr", "target": "{\n const env = { ...process.env, XDG_CONFIG_HOME: xdg, PATH: pathWith(shimDir), NO_COLOR: '1' };\n const r1 = runInstaller(['--only', 'opencode'], env);\n assert.notEqual(r1.status, 2);\n\n const agentsMd = path.join(xdg, 'opencode', 'AGENTS.md');\n"} {"bin": "32_token_ish", "content_sha256": "31b30cd109ca9b78a03872a0225444f57af39495919dbc0f89a2022db23c8058", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:src/mcp-servers/caveman-shrink/index.js", "end": 2376, "example_id": "0009bbbab213965b3a121e240c73871d8aaa7a0dea1e7aa2adc2f36ca27ac0b2", "language": "javascript", "prefix": "C framing over stdio: messages are separated by newlines (the\n// MCP stdio transport uses LSP-like content but most servers emit one JSON\n// object per line). We line-buffer in both directions and parse opportunistically.\nfunction makeLineBuffer(onLine) {\n", "repo": "JuliusBrussee/caveman", "span_codepoints": 128, "start": 2248, "suffix": "\n const line = buf.slice(0, nl);\n buf = buf.slice(nl + 1);\n if (line.trim()) onLine(line);\n }\n };\n}\n\nfunction transformResponse(msg) {\n // Compress description fields on list-style responses. Match by method\n // shape — we don't always", "target": " let buf = '';\n return chunk => {\n buf += chunk.toString('utf8');\n let nl;\n while ((nl = buf.indexOf('\\n')) !== -1) {"} {"bin": "8_token_ish", "content_sha256": "b7e9491e4539f1ef754a442636fd31d75f0b084c4b432dfe0108da1c6ac828dd", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/utils/task-progress.test.ts", "end": 2697, "example_id": "0009c7e44b1d52a594e290bbcc22d9b883f7288cc32ef9429366eab52914a6d6", "language": "typescript", "prefix": "s across nested tasks.md files matched by the glob', async () => {\n await writeGlobSchema();\n await writeChange('globchange', {\n 'backend/tasks.md': '- [x] 1.1 a\\n- [x] 1.2 b\\n',\n 'frontend/tasks.md': '- [x] 2.1 a\\n- [ ] 2.2 b\\n- [ ] 2.3 c\\", "repo": "Fission-AI/OpenSpec", "span_codepoints": 32, "start": 2665, "suffix": "= await getTaskProgressForChange(changesDir, 'globchange', projectRoot);\n expect(progress).toEqual({ total: 5, completed: 3 });\n });\n\n it('resolves the same set of files status resolves (resolution-mechanism parity)', async () => {\n await writeGlob", "target": "n',\n });\n\n const progress "} {"bin": "8_token_ish", "content_sha256": "59d1436f06a74f2f7327e458fb476980577487ef9d3f8168308197d4b73e605a", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:examples/apps/ad-use/ad_generator.py", "end": 12326, "example_id": "0009d784c8fbba6ba0bcd777f0156d33f6bc0b5eec98dbd674c27f2dd3859694", "language": "python", "prefix": "ge_data[\"screenshot_path\"]}')\n\n\nasync def generate_single_ad(page_data: dict, mode: str, ad_id: int):\n\t\"\"\"Generate a single ad using pre-analyzed page data\"\"\"\n\tgenerator = AdGenerator(mode=mode)\n\n\ttry:\n\t\tif mode == 'instagram':\n\t\t\tprompt = generator.create", "repo": "browser-use/browser-use", "span_codepoints": 32, "start": 12294, "suffix": ")\n\t\t\tad_content = await generator.generate_ad_image(prompt, page_data.get('screenshot_path'))\n\t\t\tif ad_content is None:\n\t\t\t\traise RuntimeError(f'Ad image generation failed for ad #{ad_id}')\n\t\telse: # tiktok\n\t\t\tvideo_concept = await generator.create_video_", "target": "_ad_prompt(page_data['analysis']"} {"bin": "64_token_ish", "content_sha256": "6f8e0258269e160c83ea20b5b6568220afad26b3a325e65bb3c1e7dd27297781", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:type-driven-correctness-book/src/ch13-reference-card.md", "end": 4605, "example_id": "0009dc077726b5c170741c0f84d7c8a78d481b7d364ed009d265a7897a76a133", "language": "markdown", "prefix": "\n|-------------|---------------|-------------------|\n| `fn read_sensor() -> f64` | Unitless — could be °C, °F, or RPM | `fn read_sensor() -> Celsius` |\n| `fn encrypt(nonce: &[u8; 12])` | Nonce can be reused (borrow) | `fn encrypt(nonce: Nonce)` (move) |\n| ", "repo": "microsoft/RustTraining", "span_codepoints": 256, "start": 4349, "suffix": ")` |\n| `Clone` on ephemeral keys | Defeats single-use guarantee | Don't derive Clone |\n| `let vendor_id: u16 = 0xFFFF` | Sentinel carried internally | `let vendor_id: Option = None` |\n| `fn route(level: &str)` with fallback | Typos silently default | ", "target": "`fn admin_op(is_admin: bool)` | Caller can lie (`true`) | `fn admin_op(_: &AdminToken)` |\n| `fn send(session: &Session)` | No state guarantee | `fn send(session: &Session)` |\n| `fn process(data: &[u8])` | Not validated | `fn process(data: &ValidFru"} {"bin": "8_token_ish", "content_sha256": "443080798372388ca8503e5d13da7c26dd80cec5ecf33246437cefd3f08219ef", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/cli/run/run.rs", "end": 28026, "example_id": "0009dcef4898093ac4a68d706969f8be8f1ff567412816a01446d9bc05f302ca", "language": "rust", "prefix": ";\n let detail_prefix = if show_group_ui {\n group_output_prefix.as_str()\n } else {\n hook_prefix\n };\n let group_separator = format!(\"{hook_prefix}{}\", \" │\".dimmed());\n\n if show_group_ui {\n ", "repo": "j178/prek", "span_codepoints": 32, "start": 27994, "suffix": " \"Files were modified by following hooks\",\n hook_prefix,\n RunStatus::Failed,\n )?;\n }\n\n for (i, result) in group_results.iter().enumerate() {\n let prefix = if show_group_ui {\n ", "target": "self.status_printer.write(\n "} {"bin": "8_token_ish", "content_sha256": "89955103c50045c5cb519adad23c50d912cdc63b0526b624092bc4005f990bf2", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:openspec/changes/archive/2025-12-25-add-change-manager/design.md", "end": 603, "example_id": "0009dd80f05f73b415da80b1bd109f70c7449866e0a8259a9b1d42164b75f2d2", "language": "markdown", "prefix": "ion.\n\n## Goals / Non-Goals\n\n### Goals\n- **Add** `createChange()` function to create change directories\n- **Add** `validateChangeName()` function for kebab-case validation\n- **Enable** automation (Claude commands, scripts) to create changes\n\n### Non-Goals\n-", "repo": "Fission-AI/OpenSpec", "span_codepoints": 32, "start": 571, "suffix": "(they work fine)\n- Create abstraction layers or manager classes\n- Change how `ListCommand` or `ChangeCommand` work\n\n## Decisions\n\n### Decision 1: Simple Utility Functions\n\n**Choice**: Add functions to `src/utils/change-utils.ts` - no class.\n\n```typescript\n", "target": " Refactor existing CLI commands "} {"bin": "16_token_ish", "content_sha256": "35c833543e45eb1cf840782120f7051744805863a75f70844e0f8d048c57f3dd", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:python-book/src/ch07-ownership-and-borrowing.md", "end": 3392, "example_id": "0009e5fd18311f537883a5dfa848e875fd545299eb4d939e79a33663dd0159cd", "language": "markdown", "prefix": " b_only --> freed: del b (refcount 1→0)\n note right of shared: Both a and b point
to the SAME object\n }\n state \"Rust (Ownership Move)\" as RS {\n [*] --> a_owns2: let a = vec![1,2,3]\n a_owns2 --> b_owns: let b = a (MOVE)\n ", "repo": "microsoft/RustTraining", "span_codepoints": 64, "start": 3328, "suffix": "of b_owns: a is INVALID after move
Compile error if used\n }\n```\n\n***\n\n## Move Semantics vs Reference Counting\n\n### Copy vs Move\n```rust\n// Simple types (integers, floats, bools, chars) are COPIED, not moved\nlet x = 42;\nlet y = x; // x is COPIED t", "target": " b_owns --> freed2: b goes out of scope\n note right "} {"bin": "8_token_ish", "content_sha256": "e61fd206814e0fb6c5e1c09ab716e41a85f07167bb2394fdb05465ac5cf6f512", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:src/core/parsers/requirement-blocks.ts", "end": 1152, "example_id": "0009eed875965693c50af44932e0c7316c407f008424f47bb0cd03a09aa6b7d0", "language": "typescript", "prefix": "the\n * RENAMED+REMOVED cross-section conflict - where two spellings that differ\n * only in case or interior whitespace mean a mistake, never two requirements.\n */\nexport function foldRequirementName(name: string): string {\n return normalizeRequirementName", "repo": "Fission-AI/OpenSpec", "span_codepoints": 32, "start": 1120, "suffix": "+/g, ' ');\n}\n\n/** The canonical requirement header the delta reader recognizes. */\nconst REQUIREMENT_HEADER_REGEX = /^###\\s*Requirement:\\s*(.+)\\s*$/i;\n\n/**\n * Extracts the Requirements section from a spec file and parses requirement blocks.\n */\nexport func", "target": "(name).toLowerCase().replace(/\\s"} {"bin": "32_token_ish", "content_sha256": "ab7d0b795cc4c53fbc05178f67b73f0d6f93fb57cd448017f2d32470a77c9546", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:src/core/update.ts", "end": 2793, "example_id": "0009f35079853afc59dd6415bd9415cdc4d704eac4edaee78124900c45f1449b", "language": "typescript", "prefix": " newlyConfiguredTools: string[];\n workflowOverrides: Partial>;\n deferredGlobalCleanup?: LegacyDetectionResult;\n};\n\n/**\n * Options for the update command.\n */\nexport interface UpdateCommandOptions", "repo": "Fission-AI/OpenSpec", "span_codepoints": 128, "start": 2665, "suffix": "and managed commands) across all configured tools.\n * Returns the union of detected workflow IDs that match ALL_WORKFLOWS.\n *\n * Wrapper around the shared migration module's scanInstalledWorkflows that accepts tool IDs.\n */\nexport function scanInstalledWor", "target": " {\n /** Force update even when tools are up to date */\n force?: boolean;\n}\n\n/**\n * Scans installed workflow artifacts (skills "} {"bin": "16_token_ish", "content_sha256": "5af394bc3338d420d7e38413513cbfc56db01b266b8dde1881c9035c0f5a5d7d", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/browser/test_proxy.py", "end": 2609, "example_id": "0009f3ef00e6b9b172f1a46841994b323273581c8d02a4b7b53e0348a6031a3a", "language": "python", "prefix": "CDP') -> None:\n\t\t\t\t\tself.Fetch = _FetchRegister(outer)\n\n\t\t\tself.send = _Send(self)\n\t\t\tself.register = _Register(self)\n\n\troot = StubCDP()\n\n\t# Attach stubs to session\n\tsession._cdp_client_root = root # type: ignore[attr-defined]\n\t# No need to attach a real ", "repo": "browser-use/browser-use", "span_codepoints": 64, "start": 2545, "suffix": "register Fetch handler and enable auth handling without raising\n\tawait session._setup_proxy_auth()\n\n\tassert root.enabled is True\n\tassert callable(root.auth_callback)\n\n\t# Simulate proxy auth required event\n\tev = {'requestId': 'r1', 'authChallenge': {'source", "target": "CDPSession; _setup_proxy_auth works with root client\n\n\t# Should "} {"bin": "32_token_ish", "content_sha256": "48b2df09502722042a3aeca6f2661bd55067ddf80f79307598be58affbaf1750", "document_id": "nicbarker/clay@e6cc36941ab2af5d81107617039d6f527a1c660b:examples/GLES3-SDL2-video-demo/main.c", "end": 4113, "example_id": "0009f8b74c9af25e14ca575d37da1d563bf39d4638e3f05a81cfb8c78ce4f85f", "language": "c", "prefix": "_stbFonts);\n Gles3_SetRenderTextFunction(&g_gles3, Stb_RenderText, &g_stbFonts);\n\n Gles3_Initialize(&g_gles3, 4096);\n\n int atlasW = 1024;\n int atlasH = 1024;\n if (!Stb_LoadFont(\n &g_gles3.fontTextures[0],\n &g_stbFonts[0", "repo": "nicbarker/clay", "span_codepoints": 128, "start": 3985, "suffix": " abort();\n\n Clay_SetDebugModeEnabled(true);\n}\n\nvoid loop()\n{\n\n glClearColor(0.1f, 0.2f, 0.1f, 1.0f);\n\n Clay_Vector2 scrollDelta = {};\n SDL_Event event;\n while (SDL_PollEvent(&event))\n {\n switch (event.type)\n {\n ", "target": "],\n \"resources/Roboto-Regular.ttf\",\n 24.0f, // bake pixel height\n atlasW,\n atlasH))\n"} {"bin": "64_token_ish", "content_sha256": "8d8cc8322a15ea5ae4d3342fa5c80b9cd50a6da947bdebcc81a9265da1cd8d56", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:scripts/check-versions.js", "end": 618, "example_id": "000a0016e6580f8ac882e706e36106b2f406fef010763ccdccaf1bcbaa4c084e", "language": "javascript", "prefix": "ive host ecosystems, and every release bumps all of them by hand.\n//\n// tests/gemini-extension.test.js already checks the four plugin manifests agree\n// with each other, but that can't catch the failure mode that shipped in v4.8.0:\n// every manifest stayed", "repo": "DietrichGebert/ponytail", "span_codepoints": 256, "start": 362, "suffix": " and\n// 2. on a release-tag CI run, that shared version must equal the tag.\n\nconst fs = require('fs');\nconst path = require('path');\n\nconst root = path.join(__dirname, '..');\nconst PINNED_SEMVER = /^\\d+\\.\\d+\\.\\d+$/;\n\n// Every file that declares the proje", "target": " stale at 4.7.0 *together* while the release moved on, so\n// they \"agreed\" and the test passed (#260, #262). It also ignores the two\n// package.json files. This check closes both gaps:\n// 1. every version-bearing file must share one pinned X.Y.Z version,"} {"bin": "16_token_ish", "content_sha256": "6cd965a7b847a88e0e87d6a0813870ec7a0b83da46c623863a841c7d4375c139", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/spiders/test_links.py", "end": 8733, "example_id": "000a2485747f318bc9769144b9f865327770b71a735225b0a4c49f5bab8b3e4f", "language": "python", "prefix": "w(self):\n ex = LinkExtractor(allow=r\"/posts/\")\n assert ex.matches(\"https://example.com/posts/1\") is True\n assert ex.matches(\"https://example.com/about\") is False\n\n def test_matches_honors_deny(self):\n ex = LinkExtractor(deny=", "repo": "D4Vinci/Scrapling", "span_codepoints": 64, "start": 8669, "suffix": "x\") is False\n assert ex.matches(\"https://example.com/posts/1\") is True\n\n def test_matches_honors_allow_domains(self):\n ex = LinkExtractor(allow_domains=\"example.com\")\n assert ex.matches(\"https://api.example.com/x\") is True\n a", "target": "r\"/admin\")\n assert ex.matches(\"https://example.com/admin/"} {"bin": "32_token_ish", "content_sha256": "f420a2d9f98682d760d4738779dfbb09044a6426b4418d96c69860b90fc903ce", "document_id": "Netflix/maestro@abdbdadf8f075b8fa488c9efb386b468c709a63c:netflix-sel/src/test/java/com/netflix/sel/type/SelJodaDateTimeZoneTest.java", "end": 1919, "example_id": "000a2e878d4c3f6d4c03587888584033de254308dffdc218159db70f9638e8e9", "language": "java", "prefix": "ps(SelOp.ADD_ASSIGN, SelString.of(\"foo\"));\n }\n\n @Test\n public void testCalls() {\n SelType res = one.call(\"forID\", new SelType[] {SelString.of(\"UTC\")});\n assertEquals(\"DATETIME_ZONE: UTC\", res.type() + \": \" + res);\n res =\n one.call(\n ", "repo": "Netflix/maestro", "span_codepoints": 128, "start": 1791, "suffix": "_Angeles\")))\n });\n assertEquals(\"LONG: 0\", res.type() + \": \" + res);\n res =\n another.call(\n \"getOffset\",\n new SelType[] {\n SelJodaDateTime.of(new DateTime(0, DateTimeZone.forID(\"America/Los_Angeles", "target": " \"getOffset\",\n new SelType[] {\n SelJodaDateTime.of(new DateTime(0, DateTimeZone.forID(\"America/Los"} {"bin": "16_token_ish", "content_sha256": "5d1a960ff01b73f651ec0242052a8cf1e064cb88147806bf6e13f92798aca251", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:hooks/ponytail-mode-tracker.js", "end": 1872, "example_id": "000a3807b437f7ba39c64df5206c46c97992ca93afb39849abab837095aff242", "language": "javascript", "prefix": " === 'default') {\n const dmode = parts[2];\n if (dmode === 'off' || dmode === 'lite' || dmode === 'full' || dmode === 'ultra') {\n writeDefaultMode(dmode);\n writeHookOutput('UserPromptSubmit', dmode, 'PONYTAIL DEFAULT ", "repo": "DietrichGebert/ponytail", "span_codepoints": 64, "start": 1808, "suffix": " return; // don't fall through to the session-mode switch\n }\n if (arg === 'lite') mode = 'lite';\n else if (arg === 'full') mode = 'full';\n else if (arg === 'ultra') mode = 'ultra';\n else if (arg === 'off') mode = 'off'", "target": "SET — new sessions start in ' + dmode + '.');\n }\n "} {"bin": "8_token_ish", "content_sha256": "7e3f21ab4f3ade5b28a2d27a6d6b6b27ab4d609baa8d1d33201c39ca6ba1ad59", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/__tests__/upgrade-command.test.ts", "end": 1665, "example_id": "000a52f9c7f820964d01af7cac3510bc128fd99efe4fd23eacce222cd82e5383", "language": "typescript", "prefix": "NSI_PATTERN, \"\");\n}\n\nasync function runCommand(...args: string[]): Promise {\n const program = new Command();\n program.exitOverride();\n registerUpgradeCommand(program);\n await program.parseAsync([\"node\", \"test\", ...args]);\n}\n\nbeforeEach(() => {\n ", "repo": "upstash/context7", "span_codepoints": 32, "start": 1633, "suffix": "= [];\n shouldShowUpdateNotification.mockResolvedValue(true);\n shouldSkipUpdateNotifier.mockReturnValue(false);\n vi.spyOn(console, \"log\").mockImplementation((...args: unknown[]) => {\n logOutput.push(args.join(\" \"));\n });\n spawn.mockReturnValue({\n ", "target": "vi.clearAllMocks();\n logOutput "} {"bin": "16_token_ish", "content_sha256": "2e3366d1c77df39993bbbd1e0a1901a078fa378618987ad1f42c1a8121e42593", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:internal/clampip_test.go", "end": 1039, "example_id": "000a566e597cb0366b5024fbdc9646a0c80c3b063c9803deaf9fb83788fa3b0c", "language": "go", "prefix": ",\n\t\t{\n\t\t\tname: \"IPv4 link-local\",\n\t\t\tinput: \"169.254.0.1\",\n\t\t\texpected: \"169.254.0.0/24\",\n\t\t},\n\t\t{\n\t\t\tname: \"IPv4 public address\",\n\t\t\tinput: \"203.0.113.1\",\n\t\t\texpected: \"203.0.113.0/24\",\n\t\t},\n\n\t\t// IPv6 addresses\n\t\t{\n\t\t\tname: \"IPv6 normal", "repo": "TecharoHQ/anubis", "span_codepoints": 64, "start": 975, "suffix": "48\",\n\t\t},\n\t\t{\n\t\t\tname: \"IPv6 with full expansion\",\n\t\t\tinput: \"2001:0db8:0000:0000:0000:0000:0000:0001\",\n\t\t\texpected: \"2001:db8::/48\",\n\t\t},\n\t\t{\n\t\t\tname: \"IPv6 loopback\",\n\t\t\tinput: \"::1\",\n\t\t\texpected: \"::/48\",\n\t\t},\n\t\t{\n\t\t\tname: \"IPv6 unspec", "target": " address\",\n\t\t\tinput: \"2001:db8::1\",\n\t\t\texpected: \"2001:db8::/"} {"bin": "8_token_ish", "content_sha256": "992d6ec2cf2e8952d1fae378c3baf88134cd0cf874c6f2ab9bd10594673ab665", "document_id": "DataWithBaraa/sql-data-warehouse-project@92406686380cde6eca208c8b43e6fa40ecd26344:scripts/gold/ddl_gold.sql", "end": 2340, "example_id": "000a593cae413919cac48c7afc0b7faf8274e47b0165cffdde9dfbff2b7586f4", "language": "sql", "prefix": "==================================\nIF OBJECT_ID('gold.dim_products', 'V') IS NOT NULL\n DROP VIEW gold.dim_products;\nGO\n\nCREATE VIEW gold.dim_products AS\nSELECT\n ROW_NUMBER() OVER (ORDER BY pn.prd_start_dt, pn.prd_key) AS product_key, -- Surrogate key", "repo": "DataWithBaraa/sql-data-warehouse-project", "span_codepoints": 32, "start": 2308, "suffix": "id,\n pn.prd_key AS product_number,\n pn.prd_nm AS product_name,\n pn.cat_id AS category_id,\n pc.cat AS category,\n pc.subcat AS subcategory,\n pc.maintenance AS maintenance,\n pn.prd_cost AS cost,\n pn", "target": "\n pn.prd_id AS product_"} {"bin": "16_token_ish", "content_sha256": "40d218b913bdf11f10a2906adf24bb1815076e549923d62c67b7a1dcb94e0ab6", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:c-cpp-book/src/ch05-data-structures.md", "end": 5031, "example_id": "000a6309ecd24acba192654a71454e4d424d3ef27e4830afd52d95818090b586", "language": "markdown", "prefix": ", heap-allocated, growable (like C's `malloc`'d buffer, or C++'s `std::string`)\n - `&str` — borrowed, lightweight reference (like C's `const char*` with length, or C++'s `std::string_view` — but `&str` is **lifetime-checked** so it can never dangle)\n ", "repo": "microsoft/RustTraining", "span_codepoints": 64, "start": 4967, "suffix": "length and are guaranteed valid UTF-8\n\n> **For C++ developers:** `String` ≈ `std::string`, `&str` ≈ `std::string_view`. Unlike `std::string_view`, a `&str` is guaranteed valid for its entire lifetime by the borrow checker.\n\n## String vs &str: Owned vs Borr", "target": " - Unlike C's null-terminated strings, Rust strings track their "} {"bin": "8_token_ish", "content_sha256": "7710f0c3f8a841937588aa777aa88e7c65df3bfbca88158aa2f93fbc65ca96d9", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/__tests__/auth-commands.test.ts", "end": 4525, "example_id": "000a656b6048a1c4c3c46d91c3d6e08bc40493db109eaf483f78d49fccb5f67d", "language": "typescript", "prefix": "oBe(true);\n });\n\n test(\"fetches and displays user info when logged in\", async () => {\n mockGetValidAccessToken.mockResolvedValue(\"valid-token\");\n vi.stubGlobal(\n \"fetch\",\n vi.fn().mockResolvedValue({\n ok: true,\n json: () =>\n", "repo": "upstash/context7", "span_codepoints": 32, "start": 4493, "suffix": " success: true,\n name: \"Test User\",\n email: \"test@example.com\",\n teamspace: null,\n }),\n })\n );\n\n await runCommand(\"whoami\");\n expect(logOutput.some((l) => l.includes(\"Logged in\"))).toBe(true);\n", "target": " Promise.resolve({\n "} {"bin": "16_token_ish", "content_sha256": "f1f7cacd585d31c32f6da4ba00497a06038b5c5ba143084876a871eea6af6a59", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/cli/cache_clean.rs", "end": 5195, "example_id": "000a663d3e590d6a07aa5d568f7978fe8500a44e3db3f96f462b20cc1ac161ce", "language": "rust", "prefix": "())\n}\n\n#[cfg(windows)]\n#[allow(clippy::unnecessary_wraps)]\npub fn fix_permissions>(_path: P) -> io::Result<()> {\n // On Windows, permissions are handled differently and this function does nothing.\n Ok(())\n}\n\n#[cfg(test)]\nmod tests {\n ", "repo": "j178/prek", "span_codepoints": 64, "start": 5131, "suffix": ";\n\n #[test]\n fn rm_rf_counts_and_removes_tree() -> anyhow::Result<()> {\n let temp = TempDir::new()?;\n let cache_root = temp.path().join(\"cache\");\n fs_err::create_dir_all(cache_root.join(\"nested/deep\"))?;\n fs_err::write(cac", "target": " use super::remove_dir_all;\n use assert_fs::fixture::TempDir"} {"bin": "8_token_ish", "content_sha256": "35c833543e45eb1cf840782120f7051744805863a75f70844e0f8d048c57f3dd", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:python-book/src/ch07-ownership-and-borrowing.md", "end": 10893, "example_id": "000a6dfcf2d1807c17727102d59b38732ffda9386613076028e71f1468097a64", "language": "markdown", "prefix": "n!(\"{greeting}\");\n}\n\nfn make_greeting(name: String) -> String {\n format!(\"Hello, {name}!\")\n}\n```\n\n
\n🔑 Solution\n\n```rust\nfn main() {\n let mut names = vec![\"Alice\".to_string(), \"Bob\".to_string()];\n let first = &names[0];\n ", "repo": "microsoft/RustTraining", "span_codepoints": 32, "start": 10861, "suffix": "/ Use borrow BEFORE mutating\n names.push(\"Charlie\".to_string()); // Now safe — no live immutable borrow\n\n let greeting = make_greeting(&names[0]); // Pass reference, not owned\n println!(\"{greeting}\");\n}\n\nfn make_greeting(name: &str) -> String { //", "target": " println!(\"First: {first}\"); /"} {"bin": "16_token_ish", "content_sha256": "37bdb61db23b90bc214efc7d6692e2979a7850037fc1bc785810d2e027c41331", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:agent/emmc_linux_test.go", "end": 1901, "example_id": "000a6ec4a4f0906b9f73e10fdaeea0cbbfebd9141f301fb2f71556f93c2905a5", "language": "go", "prefix": "tEmmcHealth(devs[0])\n\tif err != nil || !ok {\n\t\tt.Fatalf(\"collectEmmcHealth() = (ok=%v, err=%v), want (true,nil)\", ok, err)\n\t}\n\tif len(sm.SmartDataMap) != 1 {\n\t\tt.Fatalf(\"SmartDataMap len=%d, want 1\", len(sm.SmartDataMap))\n\t}\n\tvar got *smart.SmartData\n\tfor ", "repo": "henrygd/beszel", "span_codepoints": 64, "start": 1837, "suffix": "nil {\n\t\tt.Fatalf(\"SmartDataMap value nil\")\n\t}\n\tif got.DiskType != \"emmc\" || got.DiskName != \"/dev/mmcblk0\" {\n\t\tt.Fatalf(\"disk fields = (type=%q name=%q), want (emmc,/dev/mmcblk0)\", got.DiskType, got.DiskName)\n\t}\n\tif got.SmartStatus != \"WARNING\" {\n\t\tt.Fatal", "target": "_, v := range sm.SmartDataMap {\n\t\tgot = v\n\t\tbreak\n\t}\n\tif got == "} {"bin": "8_token_ish", "content_sha256": "437971d89670725cdf6387d52fa4fffac3d42a8085d9ba12c8a160cd869a1ea7", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/agent/system_prompts/system_prompt_no_thinking.md", "end": 13322, "example_id": "000a713c2559785cf5324c6ae566c30f18701db8046a34345d4825481a584e1f", "language": "markdown", "prefix": "ep to verify your previous action achieved its goal. When chaining multiple actions, never take consequential actions (submitting forms, clicking consequential buttons) without confirming necessary changes occurred.\n\n\n", "repo": "browser-use/browser-use", "span_codepoints": 32, "start": 13290, "suffix": "in one step. Try to be efficient where it makes sense. Do not predict actions which do not make sense for the current page.\n**Recommended Action Combinations:**\n- `input` + `click` → Fill form field and submit/search in one step\n- `input` + `input` → Fill ", "target": "You can output multiple actions "} {"bin": "16_token_ish", "content_sha256": "f59731cc305b5fb24bb2ab683264f7859047fb9b52932ae7bd0efa5b2f708f6e", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:internal/hub/systems/system_manager.go", "end": 1487, "example_id": "000a76a54acee0d0694bd16a3741c363a031979d764ce350a27a856bc8e8f0d9", "language": "go", "prefix": "f monitored systems and their connections.\n// It handles system lifecycle, status updates, and maintains both SSH and WebSocket connections.\ntype SystemManager struct {\n\thub hubLike // Hub interface for database and ", "repo": "henrygd/beszel", "span_codepoints": 64, "start": 1423, "suffix": " // Thread-safe store of active systems\n\tsshConfig *ssh.ClientConfig // SSH client configuration for system connections\n\tsmartFetchMap *expirymap.ExpiryMap[smartFetchState] // Stores last SMART fetch time/result; TTL is only fo", "target": "alert operations\n\tsystems *store.Store[string, *System] "} {"bin": "64_token_ish", "content_sha256": "3138676f98756389fb4413df4c65c7e8dc25ed39d454a120934163b0e032c5f5", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:src/core/store/foundation.ts", "end": 6369, "example_id": "000a781a05d981498e27053631d3c23622372d4599a7040f8f41ced3e6d49589", "language": "typescript", "prefix": "dataStateSchema.safeParse(raw);\n\n if (!result.success) {\n throw invalidStoreStateError(\n 'store metadata state',\n formatZodIssues(result.error)\n );\n }\n\n validateStoreId(result.data.id);\n\n return {\n version: 1,\n id: result.data.id,", "repo": "Fission-AI/OpenSpec", "span_codepoints": 256, "start": 6113, "suffix": "throw invalidStoreStateError(\n 'store registry state',\n formatZodIssues(result.error)\n );\n }\n\n assertValidStoreIds(Object.keys(result.data.stores), 'store id');\n\n return stringifyYaml({\n version: 1,\n stores: result.data.stores,\n });\n", "target": "\n ...(result.data.remote !== undefined ? { remote: result.data.remote } : {}),\n };\n}\n\nexport function serializeStoreRegistryState(state: StoreRegistryState): string {\n const result = RegistryStateSchema.safeParse(state);\n\n if (!result.success) {\n "} {"bin": "16_token_ish", "content_sha256": "4db04dc51b2f2baf11bdc92ebee06d9b80da7c154aa26f71ca333908c69c17ec", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:tests/installer/opencode.test.mjs", "end": 13702, "example_id": "000a84e3b5f30b350906ac22585819d17cde727dd62362c2605937d5dc319154", "language": "javascript", "prefix": "ld be a function');\n assert.equal(typeof handlers['chat.message'], 'function', 'chat.message should be a function');\n assert.equal(typeof handlers['experimental.chat.system.transform'], 'function',\n 'system.transform should be a function');\n\n ", "repo": "JuliusBrussee/caveman", "span_codepoints": 64, "start": 13638, "suffix": " await handlers['chat.message']({}, { parts: [{ type: 'text', text: '/caveman ultra' }] });\n assert.equal(fs.readFileSync(flagPath, 'utf8'), 'ultra');\n\n // opencode expands \"/caveman \" into the command template before\n // chat.message fir", "target": " // Slash command in a chat.message text part activates ultra.\n "} {"bin": "32_token_ish", "content_sha256": "bccd7e676e152f5edaa4e308c6556ceb59375385ca4332db7798d59112c72145", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:openspec/changes/archive/2025-09-29-add-slash-command-support/proposal.md", "end": 2549, "example_id": "000a992a2456873fd8fd8e093859fdae427c68049ce22da999cab475815c8be8", "language": "markdown", "prefix": "c-proposal`) to avoid collisions.\n4. Centralize templates: define command bodies once and reuse across tools; apply minimal per-tool wrappers (frontmatter, categories, filenames).\n5. During `openspec update`, refresh only existing slash command files (per-", "repo": "Fission-AI/OpenSpec", "span_codepoints": 128, "start": 2421, "suffix": " manage multiple files per tool.\n - Expose targets rather than a single `configFileName` (e.g., `getTargets(): Array<{ path: string; kind: 'slash'; id: string }>`).\n - Provide `generateAll(projectPath, openspecDir)` for init and `updateExisting(projectPa", "target": "file basis) within markers; do not create missing files or new tools.\n\n## Design Ideas\n- Introduce `SlashCommandConfigurator` to"} {"bin": "16_token_ish", "content_sha256": "4621b61096a1629d44edfe74b8cad267456b03794789f6065d1e5f8ef4ee719c", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/test_multi_act_guards.py", "end": 836, "example_id": "000ab325a422bcd779acd4ff4594db4d8912e0396dfa981886cca28012a4b199", "language": "python", "prefix": "er_use.agent.service import Agent\nfrom browser_use.browser import BrowserSession\nfrom browser_use.browser.profile import BrowserProfile\nfrom browser_use.tools.service import Tools\nfrom tests.ci.conftest import create_mock_llm\n\n# ---------------------------", "repo": "browser-use/browser-use", "span_codepoints": 64, "start": 772, "suffix": "-------------------------------------------------------------------------\n\n\n@pytest.fixture(scope='session')\ndef http_server():\n\t\"\"\"Test HTTP server with pages for guard tests.\"\"\"\n\tserver = HTTPServer()\n\tserver.start()\n\n\tserver.expect_request('/form').resp", "target": "------------------------------------------------\n# Fixtures\n# --"} {"bin": "16_token_ish", "content_sha256": "01a08e0f09f3632e23bd42b3610fabff50e91a75eb56cad6b075202046a5d749", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:tests/providers/anthropic/cassette/messages_thinking.rs", "end": 3588, "example_id": "000ab71e98310e851df2fd45e60f45b46bfe7600d0d4d1330ec739a5c02bb747", "language": "rust", "prefix": "story containing redacted_thinking should be accepted\");\n\n let text: String = second_response\n .choice\n .iter()\n .filter_map(|content| match content {\n AssistantContent::Text(text) ", "repo": "0xPlaygrounds/rig", "span_codepoints": 64, "start": 3524, "suffix": " })\n .collect();\n assert!(\n !text.trim().is_empty(),\n \"follow-up turn should produce text after replaying redacted thinking\"\n );\n },\n )\n .await;\n}\n\n#[tokio::test]\nas", "target": "=> Some(text.text.as_str()),\n _ => None,\n "} {"bin": "8_token_ish", "content_sha256": "69cc8ae62cec8ea6a5108b8505b4a4d8816dc8e835610424e9ca7f0504f11d70", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/xianyu/publish.test.js", "end": 7377, "example_id": "000ac3e221d9a2485125d39b5b6495758eed9aba820aefe51ee8ec2ca255044c", "language": "javascript", "prefix": " { ok: true },\n { ok: true, missing: [] },\n { ok: true },\n ],\n }), validArgs)).rejects.toBeInstanceOf(CommandExecutionError);\n });\n\n it('browser category script is async and returns typed failure ", "repo": "jackwener/OpenCLI", "span_codepoints": 32, "start": 7345, "suffix": "const result = await runBrowserScript('
', __test__.buildSelectCategoryEvaluate('笔记本'));\n\n expect(result).toEqual({ ok: false, reason: 'category-trigger-not-found' });\n });\n\n it('browser fill script reports missi", "target": "reasons', async () => {\n "} {"bin": "32_token_ish", "content_sha256": "6fd3e60fb9b01b937c1fe85fd76c33abceea706162169fcfffc8ca18c7d1cca8", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/rednote/user.js", "end": 515, "example_id": "000ac455de49b9ea61d20c9cb9d759b9e125164ad7cbe47b4b06b4ac7edc259c", "language": "javascript", "prefix": "rors';\nimport { USER_SNAPSHOT_JS } from '../xiaohongshu/user.js';\nimport { extractXhsUserNotes, normalizeXhsUserId } from '../xiaohongshu/user-helpers.js';\n\nconst WEB_HOST = 'www.rednote.com';\n\nfunction parseLimit(raw) {\n const parsed = Number(raw ?? 15", "repo": "jackwener/OpenCLI", "span_codepoints": 128, "start": 387, "suffix": "integer, got ${JSON.stringify(raw)}`);\n }\n if (parsed < 1) {\n throw new ArgumentError(`--limit must be a positive integer, got ${parsed}`);\n }\n return parsed;\n}\n\nexport const command = cli({\n site: 'rednote',\n name: 'user',\n acc", "target": ");\n if (!Number.isFinite(parsed) || !Number.isInteger(parsed)) {\n throw new ArgumentError(`--limit must be a positive "} {"bin": "64_token_ish", "content_sha256": "11779aab45fc933676969bf24cfa44616ca44d96bc731ef167281c7b9206aa44", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/install.sh", "end": 9205, "example_id": "000acfa0f052490cded9cfc157c6eb446200b79800346c4d3595de705a59cc6c", "language": "shell", "prefix": "\" || return 1\n fi\n\n if [ -n \"${ADAPTER:-}\" ] && [[ \"${ADAPTER:-}\" != \"virtio-net-pci\" ]]; then\n writeState \"net\" \"$ADAPTER\" || return 1\n fi\n\n if [ -n \"${SOUND:-}\" ] && [[ \"${SOUND:-}\" != \"intel-hda\" ]]; then\n writeState \"sound\" \"$SOUND\" || return", "repo": "dockur/windows", "span_codepoints": 256, "start": 8949, "suffix": " && exit 60\n enabled \"${UNPACK:-}\" && exit 60\n\n efi=$(find \"$dir\" -maxdepth 1 -type d -iname efi -print -quit)\n\n if [ -z \"$efi\" ]; then\n [[ \"${PLATFORM,,}\" == \"x64\" ]] && BOOT_MODE=\"windows_legacy\"\n fi\n\n if [ -n \"$CUSTOM\" ]; then\n BOOT=\"$iso\"\n ", "target": " 1\n fi\n\n if [ -n \"${CPU_MODEL:-}\" ] && [[ \"${CPU_MODEL,,}\" != \"host\" ]]; then\n writeState \"cpu\" \"$CPU_MODEL\" || return 1\n fi\n\n rm -rf \"$TMP\"\n return 0\n}\n\nabortInstall() {\n\n local dir=\"$1\"\n local iso=\"$2\"\n local efi\n\n [[ \"${iso,,}\" == *\".esd\" ]]"} {"bin": "32_token_ish", "content_sha256": "0f13b1a10d5b81f30188542997d570c2e1b7c6514cc862fae1a74145aefb8d8f", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/spiders/request.py", "end": 3468, "example_id": "000aea09fee497105a44f3235dac9e0adc49957ce0c0b83e6b9d0099fdb73d0d", "language": "python", "prefix": "a else b\"\"\n\n data: Dict[str, str | Tuple] = {\n \"sid\": self.sid,\n \"body\": body.hex(),\n \"method\": self._session_kwargs.get(\"method\", \"GET\"),\n \"url\": canonicalize_url(self.url, keep_fragments=keep_fragments),", "repo": "D4Vinci/Scrapling", "span_codepoints": 128, "start": 3340, "suffix": " for key, value in self._session_kwargs.items()\n if key.lower() not in (\"data\", \"json\")\n }\n data[\"kwargs\"] = tuple(sorted(filtered_kwargs.items()))\n\n if include_headers:\n headers = self._s", "target": "\n }\n\n if include_kwargs:\n filtered_kwargs = {\n key.lower(): _stable_value_repr(value)\n "} {"bin": "8_token_ish", "content_sha256": "5c1e63b3d563a564b541308139b83e63501bab8012e31b4256df6586d7ff722d", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:test.sql", "end": 7577, "example_id": "000afd573fd6891677b5ba1b13eb929ff36ae8b0a0301a847606bafbca8bebd3", "language": "sql", "prefix": "', 'A Quiet Place', 271, 4.3),\n (25, '[25]', 'fantasy', 'The Chronicles of Narnia: The Lion, the Witch and the Wardrobe', 310, 3.9);\n\n--select * from vec_movies;\n--select * from vec_movies_metadata_chunks00;\n\n\ncreate virtual table vec_chunks using vec0(\n ", "repo": "asg017/sqlite-vec", "span_codepoints": 32, "start": 7545, "suffix": " +contents text,\n contents_embedding float[1],\n);\n\nINSERT INTO vec_chunks (rowid, user_id, contents, contents_embedding) VALUES\n(1, 123, 'Our PTO policy allows employees to take both vacation and sick leave as needed.', '[1]'),\n(2, 123, 'Employees must p", "target": " user_id integer partition key,\n"} {"bin": "32_token_ish", "content_sha256": "f91858d0b4408f1e05a0ae27f11ae7924776e142476d2efe54887c25e0c89e97", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:tests/fuzz/ivf-cell-overflow.c", "end": 4961, "example_id": "000b0cb889b4f794e59b07d40c8bc5e58407fa63ca978a7310b0c1fd83d784b4", "language": "c", "prefix": "\n }\n sqlite3_free(qvec);\n }\n }\n\n // Test assign-vectors with multi-cell state\n // First clear centroids\n sqlite3_exec(db,\n \"INSERT INTO v(v) VALUES ('clear-centroids')\",\n NULL, NULL, NULL);\n\n // Set centroids manually, then assign\n ", "repo": "asg017/sqlite-vec", "span_codepoints": 128, "start": 4833, "suffix": " 0; d < dim; d++) cvec[d] = (float)c + d * 0.1f;\n\n char cmd[128];\n snprintf(cmd, sizeof(cmd),\n \"INSERT INTO v(v, emb) VALUES ('set-centroid:%d', ?)\", c);\n sqlite3_stmt *sc = NULL;\n sqlite3_prepare_v2(db, cmd, -1, &sc, NULL);\n if (sc) {\n", "target": " for (int c = 0; c < nlist; c++) {\n float *cvec = sqlite3_malloc(dim * sizeof(float));\n if (!cvec) break;\n for (int d ="} {"bin": "16_token_ish", "content_sha256": "351fad53d9e0661c25cd3b4e6d9b3a6f281b9bad45046ce3e7c67d425c4421d3", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/test_module_misc.py", "end": 21647, "example_id": "000b11d1512dba843c3be8e9af34f0c6fb3ca6dd4fc10a97b94861925f5bd925", "language": "python", "prefix": "alt text is included\n validate_strings(result, PPTX_TEST_STRINGS)\n\n\nif __name__ == \"__main__\":\n \"\"\"Runs this file's tests from the command line.\"\"\"\n for test in [\n test_stream_info_operations,\n test_data_uris,\n test_file_uris,", "repo": "microsoft/markitdown", "span_codepoints": 64, "start": 21583, "suffix": " test_markitdown_remote,\n test_speech_transcription,\n test_exceptions,\n test_doc_rlink,\n test_markitdown_exiftool,\n test_markitdown_llm_parameters,\n test_markitdown_llm,\n ]:\n print(f\"Running {test.__na", "target": "\n test_docx_comments,\n test_input_as_strings,\n "} {"bin": "64_token_ish", "content_sha256": "412b98dd4784b2e2ddbd8291fd29bf324cdc15c9d99f415ba201d43125e3d5e4", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown-ocr/tests/test_xlsx_converter.py", "end": 4439, "example_id": "000b1b391cb59fc55a9cb94f74cf10c5a874d18d134685e0c4d574ae957f2ed2", "language": "python", "prefix": "es | $300,000 |\\n\"\n \"| Net Profit | $200,000 |\\n\"\n \"| NaN | NaN |\\n\"\n \"| NaN | NaN |\\n\"\n \"| NaN | NaN |\\n\"\n \"| NaN | NaN |\\n\"\n \"| NaN | NaN |\\n\"\n \"| Signature: | NaN |\\n\\n\"\n \"### Images in this sheet:", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 4183, "suffix": "50,000 |\\n\"\n \"| NaN | NaN |\\n\"\n \"| NaN | NaN |\\n\"\n \"| NaN | NaN |\\n\"\n \"| NaN | NaN |\\n\"\n \"| NaN | NaN |\\n\"\n \"| Approved: | NaN |\\n\\n\"\n \"### Images in this sheet:\\n\\n\"\n \"*[Image OCR]\\nMOCK_OCR_TEXT_123", "target": "\\n\\n\"\n \"*[Image OCR]\\nMOCK_OCR_TEXT_12345\\n[End OCR]*\\n\\n\"\n \"## Budget\\n\\n\"\n \"| Budget Allocation | Unnamed: 1 |\\n\"\n \"| --- | --- |\\n\"\n \"| Marketing | $100,000 |\\n\"\n \"| R&D | $150,000 |\\n\"\n \"| Operations | $"} {"bin": "16_token_ish", "content_sha256": "0755713adc0a8eb76a9ce758a89666fc1af72833fcdf5f497d1d293ce1ee55bf", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:skills/open-source/references/agent.md", "end": 2300, "example_id": "000b3fa57ce160dab25bb23334cf3fa77470be411e6b65de15890a9c08de969d", "language": "markdown", "prefix": "True`): Force one final model call after max_failures\n- `use_thinking` (default: `True`): Enable explicit reasoning steps\n- `flash_mode` (default: `False`): Fast mode — skips evaluation, next goal, thinking; uses memory only. Overrides `use_thinking`\n\n### ", "repo": "browser-use/browser-use", "span_codepoints": 64, "start": 2236, "suffix": "default system prompt\n- `extend_system_message`: Add instructions to default system prompt\n\n### File & Data Management\n- `save_conversation_path`: Path to save conversation history\n- `save_conversation_path_encoding` (default: `'utf-8'`)\n- `available_file_", "target": "System Messages\n- `override_system_message`: Completely replace "} {"bin": "8_token_ish", "content_sha256": "5beede9a668820885154cec341d94f0fc4705c81208e8acf92b61200a4cc9eec", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/test_module_vectors.py", "end": 3112, "example_id": "000b419c3c04919f24e2cf4ba20dca0dec0a7f76968ca44c01611b05a8156252", "language": "python", "prefix": " assert string in result.markdown\n for string in test_vector.must_not_include:\n assert string not in result.markdown\n\n\n@pytest.mark.parametrize(\"test_vector\", GENERAL_TEST_VECTORS)\ndef test_convert_stream_without_hints(test_vector", "repo": "microsoft/markitdown", "span_codepoints": 32, "start": 3080, "suffix": " a stream with no stream info.\"\"\"\n markitdown = MarkItDown()\n\n with open(os.path.join(TEST_FILES_DIR, test_vector.filename), \"rb\") as stream:\n result = markitdown.convert(stream, url=test_vector.url)\n for string in test_vector.must_incl", "target": "):\n \"\"\"Test the conversion of"} {"bin": "32_token_ish", "content_sha256": "7f680ecd488629c0fe448cd24d1e110d44fe52ca5a887f3f817b001a9fdf3bbc", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/languages/bun/version.rs", "end": 2032, "example_id": "000b47a8843bde343d41343e96567ba38b3ee60ca256944e4e532250950f3b42", "language": "rust", "prefix": " return Ok(BunRequest::Any);\n }\n\n // Handle \"bun\" or \"bun@version\" format\n if let Some(version_part) = s.strip_prefix(\"bun@\") {\n if version_part.eq_ignore_ascii_case(\"latest\") {\n return Ok(BunRequest::Any)", "repo": "j178/prek", "span_codepoints": 128, "start": 1904, "suffix": "return Ok(BunRequest::Any);\n }\n\n Self::parse_version_numbers(s, s).or_else(|_| {\n semver::VersionReq::parse(s)\n .map(BunRequest::Range)\n .map_err(|_| Error::InvalidVersion(s.to_string()))\n })\n ", "target": ";\n }\n return Self::parse_version_numbers(version_part, s);\n }\n\n if s == \"bun\" {\n "} {"bin": "16_token_ish", "content_sha256": "f27ac893dc3f6befb569083a96dc3001948855d41eaed82b8cdb1c5ec633c10c", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/dwarf/dwarf_expr.c", "end": 11622, "example_id": "000b52718701603d852509bb2fc5a39bb2b043b6f9ddd8148bed0aa4d97d4faa", "language": "c", "prefix": " = (opcode - DW_ExprOp_Reg0);}goto reg_read;\n case DW_ExprOp_RegX:\n {reg_code_dw = operands[0].u512.u64[0];}goto reg_read;\n reg_read:;\n {\n ARCH_RegCode reg_code = arch_reg_code_from_dw(arch, reg_code_dw);\n Rng1U16 reg_rng ", "repo": "EpicGames/raddebugger", "span_codepoints": 64, "start": 11558, "suffix": " = dim_1u16(reg_rng);\n read_size = Min(read_size, sizeof(push_vals[0].u512));\n reg_rng.max = reg_rng.min + read_size;\n arch_reg_block_read_range(arch_info, regs, reg_rng, &push_vals[0].u512);\n }break;\n \n //- rjf: registe", "target": "= arch_info->reg_code_rng_table[reg_code];\n U64 read_size"} {"bin": "64_token_ish", "content_sha256": "47efdd3796c52b5259c54889413ef331316aacf30f471a38b8be4cce9f2d4839", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/browser/test_cross_origin_click.py", "end": 2754, "example_id": "000b5bec029b47b3f943a20819819243f4f70fc85b366535701406c9dba08253", "language": "python", "prefix": "roper event bus and watchdog system\n\t\tbrowser_state = await browser_session.get_browser_state_summary(\n\t\t\tinclude_screenshot=False,\n\t\t\tinclude_recent_events=False,\n\t\t)\n\t\tassert browser_state.dom_state is not None\n\t\tstate = browser_state.dom_state\n\n\t\tprint(", "repo": "browser-use/browser-use", "span_codepoints": 256, "start": 2498, "suffix": "\ttargets_found.add(target_id)\n\n\t\t\t# Check if element is from iframe (identified by id attributes we set)\n\t\t\t# Iframe elements will have a different target_id when cross_origin_iframes=True\n\t\t\tif element.attributes:\n\t\t\t\telement_id = element.attributes.get('", "target": "f'\\n📊 Found {len(state.selector_map)} total elements')\n\n\t\t# Find elements from different targets\n\t\ttargets_found = set()\n\t\tmain_page_elements = []\n\t\tiframe_elements = []\n\n\t\tfor idx, element in state.selector_map.items():\n\t\t\ttarget_id = element.target_id\n\t\t"} {"bin": "32_token_ish", "content_sha256": "549bf14217ca8076437fa391ef117efe215ebcad0268561dc85bc6ec4f7d19cd", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:tests/providers/deepseek/request_hook.rs", "end": 1002, "example_id": "000b60b146618b2425279f651641de530549e98a3d2c1eea4e5825dfe3bf3cfc", "language": "rust", "prefix": "nse_calls: Arc,\n seen_prompt: Arc>>,\n seen_response: Arc>>,\n}\n\nimpl AgentHook for SessionIdHook<'_> {\n async fn on_completion_call(\n &self,\n _ctx: &rig::agent::HookContext,\n ", "repo": "0xPlaygrounds/rig", "span_codepoints": 128, "start": 874, "suffix": " return CompletionCallAction::stop(\"expected a user message\");\n };\n let prompt_text = content\n .iter()\n .filter_map(|content| match content {\n UserContent::Text(text) => Some(text.text.clone()),\n", "target": " event: CompletionCallEvent<'_>,\n ) -> CompletionCallAction {\n let Message::User { content } = event.prompt else {\n "} {"bin": "32_token_ish", "content_sha256": "ce47440d23e342f9663394a1011db0568ffadbe5ae9303dceef32456dc8b26b8", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/helpers/run-cli.ts", "end": 5591, "example_id": "000b62b7d99288e4c5a6eac8fd89544d4a6b6c5700ccaa0cc70636f0c3051ba0", "language": "typescript", "prefix": " [\n `CLI command timed out after ${timeoutMs}ms: node ${invocation}`,\n stderr ? `stderr tail:\\n${formatOutputTail(stderr)}` : '',\n stdout ? `stdout tail:\\n${formatOutputTail(stdout)}` : '',\n ]\n ", "repo": "Fission-AI/OpenSpec", "span_codepoints": 128, "start": 5463, "suffix": "exitCode: code,\n signal,\n stdout,\n stderr,\n timedOut,\n command: `node ${invocation}`,\n });\n });\n\n if (options.input && child.stdin) {\n child.stdin.end(options.input);\n } else if (child.stdin) {\n ch", "target": " .filter(Boolean)\n .join('\\n\\n')\n )\n );\n return;\n }\n resolve({\n "} {"bin": "64_token_ish", "content_sha256": "45047d9065bebf4b08ee120b5c9c479614be1631ff027439dbe931b7e627620d", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:crates/rig-core/src/providers/xai/completion.rs", "end": 15243, "example_id": "000b670eea087cd2820b402662cd04a663b8b6ab09b8bab9c95eb30b5ca9b4c3", "language": "rust", "prefix": "raw: super::CompletionResponse = serde_json::from_value(serde_json::json!({\n \"id\": \"resp_123\",\n \"model\": \"grok-4.3\",\n \"output\": [\n {\n \"type\": \"reasoning\",\n \"id\": \"rs_123\"", "repo": "0xPlaygrounds/rig", "span_codepoints": 256, "start": 14987, "suffix": " \"role\": \"assistant\",\n \"status\": \"completed\",\n \"content\": [\n { \"type\": \"output_text\", \"text\": \"done\", \"annotations\": [] }\n ]\n }\n ],\n \"usag", "target": ",\n \"summary\": [{ \"type\": \"summary_text\", \"text\": \"thinking\" }],\n \"status\": \"completed\"\n },\n {\n \"type\": \"message\",\n \"id\": \"msg_123\",\n "} {"bin": "64_token_ish", "content_sha256": "6fc17d46415a433607908bf11b1333303feb9075356e5abf37deb6cd7cdf5066", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/alert.tsx", "end": 1312, "example_id": "000b722b1a7cd30c7638aa2e2e2e802cf12d463cbe47a5995afbc327468a9139", "language": "typescript", "prefix": "lert({\n className,\n variant,\n ...props\n}: React.ComponentProps<\"div\"> & VariantProps) {\n return (\n \n )\n}\n\nfunction AlertDescription({\n className,\n ...props\n}: React.ComponentProps<\"div\">) {\n return (\n \n )\n}\n\nfunction AlertTitle({ className, ...props }: React.ComponentProps<\"div\">) {\n return (\n svg]/alert:col-start-2 [&_a]:underline [&_a]:underline-offset-3 ["} {"bin": "16_token_ish", "content_sha256": "b599f78a00beae75851f82323500929bc374b82d8b697e18a7f33febf782c222", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/xiaoe/courses.js", "end": 357, "example_id": "000b7574eb0e3d9a915c2e8d07820e170c4beb6be31ba9642697f18f99e82b29", "language": "javascript", "prefix": " — pulls \"已购内容\" tab cards from\n// `study.xiaoe-tech.com`.\n//\n// Replaces the legacy `pipeline:[]` form. The in-page extraction logic\n// (Vue `__vue__.$parent` walk to match a card title back to the original\n// purchase entry) is kept byte-for-byte — Xiaoe'", "repo": "jackwener/OpenCLI", "span_codepoints": 64, "start": 293, "suffix": " Vue's private runtime tree is\n// the only stable hook. JSDOM cannot reproduce the Vue runtime, so\n// rewriting the IIFE without live verify would be silent-failure risk.\n//\n// What changes:\n// - `func` form + `Strategy.COOKIE` + `browser:true`.\n// - T", "target": "s purchase list is not\n// exposed as a public JSON endpoint, and"} {"bin": "16_token_ish", "content_sha256": "d8ae6660f9c30e8d3fd0285e7acc211debb9a6dc4537b11964b89d713452bb5c", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:agent/server.go", "end": 2434, "example_id": "000b77ccb3b89a65f54582c918bf7e8ad30c325c380448b492844f5123e19f03", "language": "go", "prefix": "\t\tServerConfigCallback: func(ctx ssh.Context) *gossh.ServerConfig {\n\t\t\treturn config\n\t\t},\n\t\t// check public key(s)\n\t\tPublicKeyHandler: func(ctx ssh.Context, key ssh.PublicKey) bool {\n\t\t\tremoteAddr := ctx.RemoteAddr()\n\t\t\tfor _, pubKey := range opts.Keys {\n\t", "repo": "henrygd/beszel", "span_codepoints": 64, "start": 2370, "suffix": "\", \"addr\", remoteAddr)\n\t\t\t\t\treturn true\n\t\t\t\t}\n\t\t\t}\n\t\t\tslog.Warn(\"Invalid SSH key\", \"addr\", remoteAddr)\n\t\t\treturn false\n\t\t},\n\t\t// disable pty\n\t\tPtyCallback: func(ctx ssh.Context, pty ssh.Pty) bool {\n\t\t\treturn false\n\t\t},\n\t\t// close idle connections after 70 ", "target": "\t\t\tif ssh.KeysEqual(key, pubKey) {\n\t\t\t\t\tslog.Info(\"SSH connected"} {"bin": "64_token_ish", "content_sha256": "adc07f2bdb51d6295fbb6f069a335988a232ba76ede6fb7c4480d2e9843bf878", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:tests/providers/llamacpp/structured_output.rs", "end": 4262, "example_id": "000b7ff34389679288807aab51d235ad52b8a7fc5bdb19fe730c323da1af32d6", "language": "rust", "prefix": "t]\n#[ignore = \"requires a local llama.cpp OpenAI-compatible server\"]\nasync fn output_schema_structured_output() {\n let client = support::completions_client();\n let model = support::model_name();\n let agent_with_schema = client\n .agent(model", "repo": "0xPlaygrounds/rig", "span_codepoints": 256, "start": 4006, "suffix": "temperature_f, current.humidity_pct, and current.description.\",\n )\n .await\n .expect(\"output schema prompt should succeed\");\n let parsed: WeatherForecast =\n serde_json::from_str(&response).expect(\"schema response should deseri", "target": ")\n .preamble(WEATHER_PREAMBLE)\n .temperature(0.0)\n .output_schema::()\n .build();\n let response = agent_with_schema\n .prompt(\n \"Return JSON weather data for Chicago with fields city, current."} {"bin": "8_token_ish", "content_sha256": "c84154be2a7e8cb5c0b350485417005c4865b86870578e24f3b773b5a82c97d3", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/cli/install.rs", "end": 10120, "example_id": "000b8dab9d26da5b13b6fb9708212307b26ba055af1bf9f7821105b99a27d482", "language": "rust", "prefix": "ite!(hint, \" with specified config `{}`\", config.display().cyan())?;\n } else if let Some(project) = project {\n let git_root = GIT_ROOT.as_ref()?;\n let project_path = project.path();\n let relative_path = project_path.strip_prefix(git", "repo": "j178/prek", "span_codepoints": 32, "start": 10088, "suffix": " if !relative_path.as_os_str().is_empty() {\n args.push(format!(r#\"--cd=\"{}\"\"#, relative_path.display()));\n }\n\n // Show workspace path if it's not the root project.\n if project_path != git_root {\n writeln!(h", "target": "_root).unwrap_or(project_path);\n"} {"bin": "32_token_ish", "content_sha256": "e9710e26ed2e3d5736ca65b276acce96d4c4cf00bc70ef57d14a2b8ea3cd3d9d", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:agent/connection_manager.go", "end": 4999, "example_id": "000ba2ac1bf2fa7f516b571112c76318588d7212fa485c2a8e3a6f181a379454", "language": "go", "prefix": "\n\t\tc.handleStateChange(WebSocketConnected)\n\tcase SSHConnect:\n\t\tc.handleStateChange(SSHConnected)\n\tcase WebSocketDisconnect:\n\t\tif c.State == WebSocketConnected {\n\t\t\tc.handleStateChange(Disconnected)\n\t\t}\n\tcase SSHDisconnect:\n\t\tif c.State == SSHConnected {\n\t\t", "repo": "henrygd/beszel", "span_codepoints": 128, "start": 4871, "suffix": " based on the new state, including stopping services and initiating reconnections.\nfunc (c *ConnectionManager) handleStateChange(newState ConnectionState) {\n\tif c.State == newState {\n\t\treturn\n\t}\n\tc.State = newState\n\tswitch newState {\n\tcase WebSocketConnect", "target": "\tc.handleStateChange(Disconnected)\n\t\t}\n\t}\n}\n\n// handleStateChange updates the connection state and performs necessary actions\n//"} {"bin": "8_token_ish", "content_sha256": "5527c211ac7776602985d2f9417a65c3b86f47d2875f99ade4c1f3502777beb6", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:skills/open-source/references/tools.md", "end": 2255, "example_id": "000bc86c86c552e76f6c1ce47c3370c54cb2e7656a83c1e29fa2df97373e817b", "language": "markdown", "prefix": "n):\n page = await browser_session.must_get_current_page()\n elements = await page.get_elements_by_css_selector('button[type=\"submit\"]')\n if not elements:\n return ActionResult(extracted_content='No submit button found')\n await elements[0].", "repo": "browser-use/browser-use", "span_codepoints": 32, "start": 2223, "suffix": "extracted_content='Clicked!')\n```\n\n## Injectable Parameters\n\nThe agent fills function parameters by name. These special names are auto-injected:\n\n| Parameter Name | Type | Description |\n|---------------|------|-------------|\n| `browser_session` | `BrowserS", "target": "click()\n return ActionResult("} {"bin": "16_token_ish", "content_sha256": "5e1ddd128c8a824eb2905880e165b59d6818baf2a14501b76d361b956e74f3d6", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:crates/rig-core/src/providers/openai/mod.rs", "end": 6843, "example_id": "000bd8d22d17a1fbdcb5e7365281dc6e1345c729d47e47b4daf3739354abfa54", "language": "rust", "prefix": "ber\" }\n ]\n });\n\n sanitize_schema(&mut schema);\n\n assert!(schema.get(\"oneOf\").is_none());\n assert!(schema[\"anyOf\"].as_array().is_some());\n }\n\n #[test]\n fn test_sanitize_recurses_into_nested_objects() {\n ", "repo": "0xPlaygrounds/rig", "span_codepoints": 64, "start": 6779, "suffix": " \"properties\": {\n \"inner\": {\n \"type\": \"object\",\n \"properties\": {\n \"value\": { \"type\": \"string\" }\n }\n }\n }\n });\n\n saniti", "target": " let mut schema = json!({\n \"type\": \"object\",\n "} {"bin": "32_token_ish", "content_sha256": "cc24a697183b7d609f0b05997f0dc4b1909083a1caea5164318153da88e88591", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/evaluate_tasks.py", "end": 6029, "example_id": "000be03db665850727f3af6d2f6df4f1a10f8fbae1d299cb4bfb1776fcb08b14", "language": "python", "prefix": "n(judge_context)\n\t\tjudge_prompt = f\"\"\"\nYou are a evaluator of a browser agent task inside a ci/cd pipeline. Here was the agent's task:\n{task}\n\nHere is the agent's output:\n{agent_output if agent_output else '[No output provided]'}\n\nDebug info: {debug_info}\n", "repo": "browser-use/browser-use", "span_codepoints": 128, "start": 5901, "suffix": "no output, explain what might have gone wrong.\n\"\"\"\n\t\tresponse = await judge_llm.ainvoke([UserMessage(content=judge_prompt)], output_format=JudgeResponse)\n\t\tjudge_response = response.completion\n\n\t\tresult = {\n\t\t\t'file': os.path.basename(task_file),\n\t\t\t'succe", "target": "\nCriteria for success:\n- {criteria}\n\nReply in JSON with keys: success (true/false), explanation (string).\nIf the agent provided "} {"bin": "64_token_ish", "content_sha256": "a9cbe88ad1942abf948ad9f3ca3dc064f9d63ed3a0fe95cbecc794f45e2662c9", "document_id": "unitycatalog/unitycatalog@ed504deea31b30c3e7d27e360372077cce04a509:server/src/test/java/io/unitycatalog/server/utils/PopulateTestDatabase.java", "end": 2249, "example_id": "000be0aebb0ec9de303f131d44ce8cbaee90f19753aacb0da1e307664a4aa644", "language": "java", "prefix": "e.SessionFactory;\nimport org.hibernate.Transaction;\n\n/**\n * This is a utility class to populate the test database with some sample data. All the quickstart\n * examples in the documentation are based on this sample data. This class is not part of the main\n ", "repo": "unitycatalog/unitycatalog", "span_codepoints": 256, "start": 1993, "suffix": " which might be referred to by storage\n * location of any table/volume should be created before creating the table/volume entry in the\n * database or can be a part of the same PR.\n */\npublic class PopulateTestDatabase {\n\n public static void main(String[] ", "target": "* application code and is only used for testing purposes. To recreate the sample data, first delete\n * the existing database (at /etc/db) and then run main method of this class by running the command\n * `build/sbt server/populateTestDB`. Any data artifacts"} {"bin": "32_token_ish", "content_sha256": "5a9976de581707f0f816221505b968d3d2da6a9415279166c491882a217f5ad7", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/linker/lnk_symbol_table.c", "end": 2530, "example_id": "000be19089bf4c32b512d38392e04211c13667d1b05dfc55fb04c38eed785e96", "language": "c", "prefix": "mbol;\n lnk_symbol_list_push_node(list, node);\n return node;\n}\n\ninternal LNK_SymbolHashTrie *\nlnk_symbol_hash_trie_chunk_list_push(Arena *arena, LNK_SymbolHashTrieChunkList *list, U64 cap)\n{\n if (list->last == 0 || list->last->count >= list->last->cap) {", "repo": "EpicGames/raddebugger", "span_codepoints": 128, "start": 2402, "suffix": " chunk->v = push_array_no_zero(arena, LNK_SymbolHashTrie, cap);\n SLLQueuePush(list->first, list->last, chunk);\n ++list->count;\n }\n\n LNK_SymbolHashTrie *result = &list->last->v[list->last->count++];\n return result;\n}\n\nintern", "target": "\n LNK_SymbolHashTrieChunk *chunk = push_array(arena, LNK_SymbolHashTrieChunk, 1);\n chunk->cap = cap;\n "} {"bin": "64_token_ish", "content_sha256": "1b26871f0b820c46199a36e0afc990e213043443af3e9f6ae77229e2ac07fe5b", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/carousel.tsx", "end": 3686, "example_id": "000be4d27d5108c4ff6d44e21e9d258f69cc8d3fce691d83e3ba80f8d3c0b8e3", "language": "typescript", "prefix": " >\n {children}\n
\n \n )\n}\n\nfunction CarouselContent({ className, ...props }: React.ComponentProps<\"div\">) {\n const { carouselRef, orientation } = useCarousel()\n\n return (\n \n )\n}\n\nfunction CarouselItem({ className, ...props }: React.ComponentProps<\"div\">) {\n const { orientation } = useCarousel()\n\n return (\n \n \n "} {"bin": "32_token_ish", "content_sha256": "52fd7a366ab75f9104559c812265dc77a9163657e5b3355af4ce161fdc7acdcc", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/fetchers/async/test_requests.py", "end": 1477, "example_id": "000be6b5a73a79714a17f4f0f84844b90dd7236bd9dc6e54c4f08d1c957b5e26", "language": "python", "prefix": "}/html\",\n }\n\n async def test_basic_get(self, fetcher, urls):\n \"\"\"Test doing basic get request with multiple statuses\"\"\"\n assert (await fetcher.get(urls[\"status_200\"])).status == 200\n assert (await fetcher.get(urls[\"status_404", "repo": "D4Vinci/Scrapling", "span_codepoints": 128, "start": 1349, "suffix": " fetcher, urls):\n \"\"\"Test if different arguments with the GET request break the code or not\"\"\"\n assert (\n await fetcher.get(urls[\"status_200\"], stealthy_headers=True)\n ).status == 200\n assert (\n await fetch", "target": "\"])).status == 404\n assert (await fetcher.get(urls[\"status_501\"])).status == 501\n\n async def test_get_properties(self,"} {"bin": "64_token_ish", "content_sha256": "79ed8d9f177c8fd734382eb386f48693117fcc6f0f849d771d5d12dd5616ffeb", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/mcp/src/lib/auth/auth-prompt.ts", "end": 1111, "example_id": "000bf66d9c3fa073136d21e48aa6469ae87cca22a4494cf3b596ef70a1c8080f", "language": "typescript", "prefix": " \"http\" | undefined\n): string {\n const flag = clientFlagForCli(clientIde);\n const transportFlag = transport === \"stdio\" ? \" --stdio\" : \"\";\n return flag\n ? `npx ctx7 setup ${flag} --mcp${transportFlag} -y`\n : `npx ctx7 setup --mcp${transportFlag}`;", "repo": "upstash/context7", "span_codepoints": 256, "start": 855, "suffix": "limits, run this in your terminal:\",\n \"\",\n ` ${command}`,\n \"\",\n \"It opens your browser, signs you in, and writes credentials into your MCP client config.\",\n \"After it finishes, disable then re-enable the Context7 MCP server in your editor", "target": "\n}\n\nfunction buildElicitMessage(\n clientIde: string | undefined,\n transport: \"stdio\" | \"http\" | undefined\n): string {\n const command = buildAuthCommand(clientIde, transport);\n return [\n \"You're using Context7 anonymously. To unlock free higher rate "} {"bin": "32_token_ish", "content_sha256": "e9a7e9eb6b087e60e2fed07e61370fbd1bfca76b16bb95c86170cffedcebff96", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:benchmarks/robustness-audit.js", "end": 822, "example_id": "000bfbca1a4a2c85d9c8cd40a2f395f40f082eb5db27976312b819b1689430ec", "language": "javascript", "prefix": "equire('child_process');\nconst fs = require('fs');\nconst os = require('os');\nconst path = require('path');\n\n// ponytail: probe once at load; mirrors correctness.js\nlet pythonCmd;\nfunction python() {\n if (pythonCmd) return pythonCmd;\n for (const cmd of ['", "repo": "DietrichGebert/ponytail", "span_codepoints": 128, "start": 694, "suffix": " catch (_) {}\n }\n return pythonCmd = 'python3';\n}\n\nconst N = Number(process.env.AUDIT_N) || 20;\nconst MODEL = process.env.AUDIT_MODEL || 'gpt-5.4-mini';\nconst ROOT = path.join(__dirname, '..');\nlet kv = {};\ntry {\n kv = Object.fromEntries(fs.readFileSync", "target": "python3', 'python']) {\n try { execSync(`${cmd} -c \"import sys\"`, { stdio: 'pipe' }); pythonCmd = cmd; return pythonCmd; }\n "} {"bin": "8_token_ish", "content_sha256": "632ce87a34d6fee432909ff25310b13c5a844a9fd0d52ddd5a8c6447648a4858", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:agent/server_test.go", "end": 11688, "example_id": "000bfdfa75220f64316aa853f1a5069c1468c00f520ab7c930e4e43f9d26e137", "language": "go", "prefix": "session - should extract new version\n\tversion = agent.getHubVersion(\"different-session\", mockCtx)\n\tassert.Equal(t, \"0.11.0\", version.String())\n\n\t// Test with invalid version string (non-beszel client)\n\tmockCtx.clientVersion = \"SSH-2.0-OpenSSH_8.0\"\n\tversion", "repo": "henrygd/beszel", "span_codepoints": 32, "start": 11656, "suffix": "session\", mockCtx)\n\tassert.Equal(t, \"0.0.0\", version.String()) // Should be empty version for non-beszel clients\n\n\t// Test with no client version\n\tmockCtx.clientVersion = \"\"\n\tversion = agent.getHubVersion(\"no-version-session\", mockCtx)\n\tassert.True(t, vers", "target": " = agent.getHubVersion(\"invalid-"} {"bin": "32_token_ish", "content_sha256": "3bf2df8cf0cfb34b2c6cc548f25c2af83eeb8405b9718fc651818894cc171ff9", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:src/core/completions/generators/powershell-generator.ts", "end": 401, "example_id": "000c049b38f4da6f6de1f0e9c28d3c0231e8bb55baa427c68d0c93865562c4cb", "language": "typescript", "prefix": "tionGenerator,\n CommandDefinition,\n FlagDefinition,\n PositionalDefinition,\n} from '../types.js';\nimport { POWERSHELL_DYNAMIC_HELPERS } from '../templates/powershell-templates.js';\n\n/**\n * Generates PowerShell completion scripts for the OpenSpec CLI.\n * ", "repo": "Fission-AI/OpenSpec", "span_codepoints": 128, "start": 273, "suffix": "readonly shell = 'powershell' as const;\n\n private stripTrailingCommaFromLastLine(lines: string[]): void {\n if (lines.length === 0) return;\n lines[lines.length - 1] = lines[lines.length - 1].replace(/,\\s*$/, '');\n }\n\n /**\n * Generate a PowerShell", "target": "Uses Register-ArgumentCompleter for command completion.\n */\nexport class PowerShellGenerator implements CompletionGenerator {\n "} {"bin": "8_token_ish", "content_sha256": "45e0e0556f9efebd065a7e7043e2f043ba4a1e5ac5bc7bb0ec3ad01877b00fb4", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:openspec/work/simplify-context-and-workspace-model/slices/store-references/spec.md", "end": 9121, "example_id": "000c0b7cf79323d3d107c05ce3bcd1f2bcbfb3fc437cdbbc8e657e3e51b9b4ef", "language": "markdown", "prefix": "new module under `src/core/`, e.g.\n `references.ts`): resolve each id through the shared non-throwing\n resolution variant (decision 5), enumerate the referenced root's\n `openspec/specs/`, extract first-line summaries tolerantly\n (decision 2), and emit ", "repo": "Fission-AI/OpenSpec", "span_codepoints": 32, "start": 9089, "suffix": "root, specs: [{id, summary}], fetch, status: [...]}`\n (`root` absolute; `fetch` the per-store recipe string).\n- **Artifact instructions**: `generateInstructions`\n (`src/core/artifact-graph/instruction-loader.ts:271-339`) gains a\n `references` field; hum", "target": "per-store entries\n `{store_id, "} {"bin": "16_token_ish", "content_sha256": "39381d0d78126e420db0a8a742ec7050a7a227523428aaba035703f0b7e4b2bf", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/llm/tests/test_gemini_image.py", "end": 1646, "example_id": "000c260ebead2eb9ac223b993f9dcf6bf79b1d13405f69f617ab954683dd02e3", "language": "python", "prefix": "se64.b64encode(buffer.getvalue()).decode()\n\n\treturn f'data:image/jpeg;base64,{img_data}'\n\n\nasync def test_gemini_image_vision():\n\t\"\"\"Test Gemini's ability to see and describe images.\"\"\"\n\n\t# Create the LLM\n\tllm = ChatGoogle(model='gemini-2.0-flash-exp')\n\n\t#", "repo": "browser-use/browser-use", "span_codepoints": 64, "start": 1582, "suffix": "_text_image('Hello Gemini! Can you see this text?')\n\n\t# Create messages with image\n\tmessages: list[BaseMessage] = [\n\t\tSystemMessage(content='You are a helpful assistant that can see and describe images.'),\n\t\tUserMessage(\n\t\t\tcontent=[\n\t\t\t\tContentPartTextPar", "target": " Create a random image with text\n\timage_data_url = create_random"} {"bin": "32_token_ish", "content_sha256": "cb3d208f51c444f5138a34fef6e37356f75471e10c238df4ee018e7b3d896a6c", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/test_browser_use_skill_install_docs.py", "end": 1202, "example_id": "000c27dd4c905b110c7850701b2522acd89daa49baf276d9af6e41bf17eb3031", "language": "python", "prefix": "r / 'uv'\n\tuv.write_text(\n\t\t'#!/usr/bin/env python3\\n'\n\t\t'import os, pathlib, sys\\n'\n\t\t'pathlib.Path(os.environ[\"UV_TOOL_INSTALL_ARGS_FILE\"]).write_text(\" \".join(sys.argv[1:]), encoding=\"utf-8\")\\n',\n\t\tencoding='utf-8',\n\t)\n\tuv.chmod(0o755)\n\n\tbrowser_harness ", "repo": "browser-use/browser-use", "span_codepoints": 128, "start": 1074, "suffix": "r}\\n'\n\t\t'if sys.argv[1:] == [\"skill\"]:\\n'\n\t\t' print(text, end=\"\")\\n'\n\t\t'else:\\n'\n\t\t' print(\"usage: browser-harness skill\", file=sys.stderr)\\n'\n\t\t' sys.exit(2)\\n',\n\t\tencoding='utf-8',\n\t)\n\tbrowser_harness.chmod(0o755)\n\treturn bin_dir\n\n\ndef test_docs", "target": "= bin_dir / 'browser-harness'\n\tbrowser_harness.write_text(\n\t\t'#!/usr/bin/env python3\\n'\n\t\t'import sys\\n'\n\t\tf'text = {skill_text!"} {"bin": "64_token_ish", "content_sha256": "cc24a697183b7d609f0b05997f0dc4b1909083a1caea5164318153da88e88591", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/evaluate_tasks.py", "end": 7630, "example_id": "000c2e7e048f228a9498077a9747ac2944656c54a7de4bfa33e1f1ab6430a039", "language": "python", "prefix": "cio.subprocess.PIPE,\n\t\t\t\tenv=env,\n\t\t\t)\n\t\t\tstdout, stderr = await proc.communicate()\n\n\t\t\tif proc.returncode == 0:\n\t\t\t\ttry:\n\t\t\t\t\t# Parse JSON result from subprocess\n\t\t\t\t\tstdout_text = stdout.decode().strip()\n\t\t\t\t\tstderr_text = stderr.decode().strip()\n\n\t\t\t\t\t#", "repo": "browser-use/browser-use", "span_codepoints": 256, "start": 7374, "suffix": " the last line that starts with {)\n\t\t\t\t\tlines = stdout_text.split('\\n')\n\t\t\t\t\tjson_line = None\n\t\t\t\t\tfor line in reversed(lines):\n\t\t\t\t\t\tline = line.strip()\n\t\t\t\t\t\tif line.startswith('{') and line.endswith('}'):\n\t\t\t\t\t\t\tjson_line = line\n\t\t\t\t\t\t\tbreak\n\n\t\t\t\t\tif js", "target": " Display subprocess debug logs\n\t\t\t\t\tif stderr_text:\n\t\t\t\t\t\tprint(f'[SUBPROCESS {os.path.basename(task_file)}] Debug output:')\n\t\t\t\t\t\tfor line in stderr_text.split('\\n'):\n\t\t\t\t\t\t\tif line.strip():\n\t\t\t\t\t\t\t\tprint(f' {line}')\n\n\t\t\t\t\t# Find the JSON line (should be"} {"bin": "16_token_ish", "content_sha256": "18899dc302f60dc36c6b4fd75f8da1a90da191fdb3a82c2f91c0d6ff6d6a476d", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:src/commands/context.ts", "end": 2338, "example_id": "000c43a52e5ca44197276f19b96dd2472962c5cb2257f2fe23e1f377c8443f32", "language": "typescript", "prefix": " };\n}\n\nfunction memberLine(member: WorkingSetMember): string {\n return ` ${member.id} ${member.path}`;\n}\n\nfunction printHumanWorkingSet(workingSet: WorkingSet, declaredReferenceCount: number): void {\n const rootLabel = workingSet.root.store_id ?? path", "repo": "Fission-AI/OpenSpec", "span_codepoints": 64, "start": 2274, "suffix": "for ${rootLabel} (${workingSet.root.path})`);\n console.log('');\n console.log('OpenSpec root');\n console.log(` ${rootLabel} ${workingSet.root.path}`);\n\n const availableStores = workingSet.members.filter(\n (member) => member.role === 'referenced_sto", "target": ".basename(workingSet.root.path);\n console.log(`Working context "} {"bin": "32_token_ish", "content_sha256": "427964c598bcc8e9a2d31c001d222cd67aed4c56dfe8b3064357ca17e1435285", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:lib/policy/expressions/environment.go", "end": 5328, "example_id": "000c4c9be07c183c815c89a78b964096d74c6540c6e341e3ea09c5bf701b6d84", "language": "go", "prefix": "ngType},\n\t\t\t\tcel.StringType,\n\t\t\t\tcel.UnaryBinding(func(str ref.Val) ref.Val {\n\t\t\t\t\ts, ok := str.(types.String)\n\t\t\t\t\tif !ok {\n\t\t\t\t\t\treturn types.ValOrErr(str, \"addr is not a string\")\n\t\t\t\t\t}\n\n\t\t\t\t\tescapes := []string{\"\\\\\", \".\", \":\", \"*\", \"?\", \"-\", \"[\", \"]\", ", "repo": "TecharoHQ/anubis", "span_codepoints": 128, "start": 5200, "suffix": "r, escape, \"\\\\\"+escape)\n\t\t\t\t\t}\n\t\t\t\t\treturn types.String(r)\n\t\t\t\t}),\n\t\t\t),\n\t\t),\n\n\t\tcel.Function(\"segments\",\n\t\t\tcel.Overload(\"segments_string_list_string\",\n\t\t\t\t[]*cel.Type{cel.StringType},\n\t\t\t\tcel.ListType(cel.StringType),\n\t\t\t\tcel.UnaryBinding(func(path ref.V", "target": "\"(\", \")\", \"+\", \"{\", \"}\", \"|\", \"^\", \"$\"}\n\t\t\t\t\tr := string(s)\n\n\t\t\t\t\tfor _, escape := range escapes {\n\t\t\t\t\t\tr = strings.ReplaceAll("} {"bin": "8_token_ish", "content_sha256": "20d0c254b23a5b09ef7d3c07ac1d45e381cfd1c069fdfe8a85db113539d02f3c", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/commands/store-root-selection.test.ts", "end": 4992, "example_id": "000c4ea7708a5a530d31d42ccba4d6848d2c289f4d6a396955d9c5455dd539d5", "language": "typescript", "prefix": "', 'add-billing'))\n ).toBe(true);\n expectNoLocalOpenSpec();\n });\n\n it('includes the shared root block and absolute paths in new change JSON', async () => {\n const result = await runCLI(\n ['new', 'change', 'add-billing', '--store", "repo": "Fission-AI/OpenSpec", "span_codepoints": 32, "start": 4960, "suffix": " { cwd: appRepo, env }\n );\n expect(result.exitCode).toBe(0);\n\n const json = parseJson(result);\n expect(json.root).toEqual({\n path: storeRoot,\n source: 'store',\n store_id: 'team-context',\n });\n expect(", "target": "', 'team-context', '--json'],\n "} {"bin": "8_token_ish", "content_sha256": "4db04dc51b2f2baf11bdc92ebee06d9b80da7c154aa26f71ca333908c69c17ec", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:tests/installer/opencode.test.mjs", "end": 12343, "example_id": "000c62285008ea4ae43a84eeb056dc19d5d8655eff013456897022abd1ead18f", "language": "javascript", "prefix": "ultra, stop caveman, and session init via real hooks', async () => {\n const xdg = freshTmpDir();\n const shimDir = shimOpencode();\n const origDefault = process.env.CAVEMAN_DEFAULT_MODE;\n try {\n const env = { ...process.env, XDG_CONFIG_HOME: xdg, PATH", "repo": "JuliusBrussee/caveman", "span_codepoints": 32, "start": 12311, "suffix": "1' };\n const r = runInstaller(['--only', 'opencode'], env);\n assert.notEqual(r.status, 2);\n\n const pluginPath = path.join(xdg, 'opencode', 'plugins', 'caveman', 'plugin.js');\n const flagPath = path.join(xdg, 'opencode', '.caveman-active');\n\n ", "target": ": pathWith(shimDir), NO_COLOR: '"} {"bin": "32_token_ish", "content_sha256": "9df7c88562b71531d2c3276c5804a29df072b2222eaf9c85432bf7317588ccd1", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/xiaohongshu/creator-notes-summary.js", "end": 1057, "example_id": "000c639183d80bcce557c2973964834e982e5360ba8b71a7e62aadc75858ebe2", "language": "javascript", "prefix": "matches = rows.filter((row) => row.section === section && row.metric.startsWith(prefix) && row.value);\n if (matches.length === 0)\n return { label: '', value: '' };\n const sorted = [...matches].sort((a, b) => parseFloat(b.value) - parseFloat(a.", "repo": "jackwener/OpenCLI", "span_codepoints": 128, "start": 929, "suffix": ";\n}\nexport function summarizeCreatorNote(note, rows, rank) {\n const topSource = findTopBySectionPrefix(rows, '观看来源', '');\n const topInterest = findTopBySectionPrefix(rows, '观众画像', '兴趣/');\n return {\n rank,\n id: note.id,\n title:", "target": "value));\n const top = sorted[0];\n return {\n label: top.metric.slice(prefix.length),\n value: top.value,\n }"} {"bin": "64_token_ish", "content_sha256": "5a7bb103af6db7af89215cb2d20097fe59f2ac689e5175e4960290466fd47faf", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/browser/watchdogs/recording_watchdog.py", "end": 4999, "example_id": "000c6849d1b0255f315907d072f6ae18bf3c30633efd3c9cc9ed50d889d9066e", "language": "python", "prefix": "t) -> None:\n\t\t\"\"\"\n\t\tSwitches video recording to the new tab.\n\t\t\"\"\"\n\t\tif self._recorder:\n\t\t\tself.logger.debug(f'Agent focus changed to {event.target_id}, switching screencast...')\n\t\t\tawait self._start_screencast()\n\n\tasync def _start_screencast(self) -> None", "repo": "browser-use/browser-use", "span_codepoints": 256, "start": 4743, "suffix": ")\n\n\t\t\t# If we are already recording this session, do nothing\n\t\t\tif self._current_session_id == cdp_session.session_id:\n\t\t\t\treturn\n\n\t\t\t# Stop recording on the previous session\n\t\t\tif self._current_session_id:\n\t\t\t\ttry:\n\t\t\t\t\t# Use the root client to stop scree", "target": ":\n\t\t\"\"\"Starts screencast on the currently focused tab.\"\"\"\n\t\tif not self._recorder or not self._screencast_params:\n\t\t\treturn\n\n\t\ttry:\n\t\t\t# Get the current session (for the focused target)\n\t\t\tcdp_session = await self.browser_session.get_or_create_cdp_session("} {"bin": "32_token_ish", "content_sha256": "69b3a396d37da516b901d0b77db7129d10cdb9cd5df3c644178068ee6a57f585", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:crates/rig-core/src/providers/gemini/interactions_api/streaming.rs", "end": 5840, "example_id": "000c6d97a97fb659da32e53a2f0b94a40a397a3a6c3d112c9b9b87471d954a3b", "language": "rust", "prefix": " }\n\n if let Some(usage) = interaction.usage.clone() {\n span.record_token_usage(&usage);\n final_usage = Some(usage);\n ", "repo": "0xPlaygrounds/rig", "span_codepoints": 128, "start": 5712, "suffix": " InteractionSseEvent::Error { .. } => {\n // Preserve the full provider error payload (code +\n // message) by reusing the raw SSE event JSON, matching\n ", "target": " }\n final_interaction = Some(interaction);\n }\n "} {"bin": "64_token_ish", "content_sha256": "a9abaaa7d4fde27e6f0eeb81e77bf764f65216be928bfda8613933a23b0b506a", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/spiders/links.py", "end": 4229, "example_id": "000c767ec3c231ac18c8abb4409d72746e8446063039aa024f2eb8943f309070", "language": "python", "prefix": "param attrs: Attributes on those tags to read URLs from. Default (\"href\",).\n :param canonicalize: Canonicalize URLs (sort query params, normalize path). Default True.\n :param strip: Strip whitespace from extracted URLs. Default True.\n :param keep_", "repo": "D4Vinci/Scrapling", "span_codepoints": 256, "start": 3973, "suffix": " to drop any value.\n \"\"\"\n\n def __init__(\n self,\n allow: Union[str, Pattern[str], PatternInput] = (),\n deny: Union[str, Pattern[str], PatternInput] = (),\n allow_domains: StrOrIterable = (),\n deny_domains: StrOrIterab", "target": "fragment: Preserve the URL fragment when canonicalizing. Default False.\n :param deny_extensions: File extensions to drop. Default `IGNORED_EXTENSIONS`.\n :param process: A function to do a process on the values extracted before using them. Return None"} {"bin": "32_token_ish", "content_sha256": "5baae817d107ad948db05ed348477fea168289f3f29a4eddcc7466d5575da497", "document_id": "modelcontextprotocol/java-sdk@fd004989b9484c9b81be6b03463396797b354804:mcp-test/src/main/java/io/modelcontextprotocol/server/AbstractMcpSyncServerTests.java", "end": 12530, "example_id": "000c81f30bccefe649ff5965f9830c7aca2a7d77ec25c1df8b0c672fcc37bb21", "language": "java", "prefix": "SyncResourceSpecification specification = new McpServerFeatures.SyncResourceSpecification(\n\t\t\t\tresource, (exchange, req) -> ReadResourceResult.builder(List.of()).build());\n\n\t\tmcpSyncServer.addResource(specification);\n\t\tList resources = ", "repo": "modelcontextprotocol/java-sdk", "span_codepoints": 128, "start": 12402, "suffix": "_URI);\n\n\t\tassertThatCode(mcpSyncServer::closeGracefully).doesNotThrowAnyException();\n\t}\n\n\t@Test\n\tvoid testRemoveResource() {\n\t\tvar mcpSyncServer = prepareSyncServerBuilder().serverInfo(\"test-server\", \"1.0.0\")\n\t\t\t.capabilities(ServerCapabilities.builder().r", "target": "mcpSyncServer.listResources();\n\n\t\tassertThat(resources).hasSize(1);\n\t\tassertThat(resources.get(0).uri()).isEqualTo(TEST_RESOURCE"} {"bin": "32_token_ish", "content_sha256": "481fa76914c9c5216aa68f7095a27d11bd5961c129525bc8c307521f6476c20c", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_image_converter.py", "end": 1991, "example_id": "000c8a7ab0912a1da7184a03f7f0c4b08abd7b195633ddc36755203b50845369", "language": "python", "prefix": " \"Author\",\n \"DateTimeOriginal\",\n \"CreateDate\",\n \"GPSPosition\",\n ]:\n if f in metadata:\n md_content += f\"{f}: {metadata[f]}\\n\"\n\n # Try describing the image", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 1863, "suffix": " None and llm_model is not None:\n llm_description = self._get_llm_description(\n file_stream,\n stream_info,\n client=llm_client,\n model=llm_model,\n prompt=kwargs.get(\"llm_p", "target": " with GPT\n llm_client = kwargs.get(\"llm_client\")\n llm_model = kwargs.get(\"llm_model\")\n if llm_client is not"} {"bin": "8_token_ish", "content_sha256": "45047d9065bebf4b08ee120b5c9c479614be1631ff027439dbe931b7e627620d", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:crates/rig-core/src/providers/xai/completion.rs", "end": 2704, "example_id": "000c9594bad3a132cfb79844e4970602baff2e09eb1260054cc7e7692732efc7", "language": "rust", "prefix": "del = req.model.clone().unwrap_or_else(|| model.to_string());\n let mut input: Vec = req\n .preamble\n .as_ref()\n .map_or_else(Vec::new, |p| vec![Message::system(p)]);\n\n let mut additional_params_payload", "repo": "0xPlaygrounds/rig", "span_codepoints": 32, "start": 2672, "suffix": "or(Value::Null);\n\n for msg in chat_history {\n let msg: Vec = msg.try_into()?;\n input.extend(msg);\n }\n\n let tool_choice = req.tool_choice.map(ToolChoice::try_from).transpose()?;\n let mut additional_", "target": " = req.additional_params.unwrap_"} {"bin": "8_token_ish", "content_sha256": "50e0577ba8368c10751fe475d2f9fbd308e703514f16866ea53ffe2ac3d766db", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/mercury/mercury.test.js", "end": 4249, "example_id": "000ca7e71b2b48b3e916cde5f8de4c7bf636d73f1e916d7e7525941ed38f18f2", "language": "javascript", "prefix": " => normalizeReimbursementInput(validArgs({ currency: 'US' }))).toThrow(ArgumentError);\n expect(() => normalizeReimbursementInput(validArgs({ date: '2026-02-30' }))).toThrow(ArgumentError);\n expect(() => normalizeReimbursementInput(validArgs(", "repo": "jackwener/OpenCLI", "span_codepoints": 32, "start": 4217, "suffix": ".toThrow(ArgumentError);\n expect(() => normalizeReimbursementInput(validArgs({ receipt: path.join(tmpDir, 'missing.png') }))).toThrow(ArgumentError);\n });\n});\n\ndescribe('mercury reimbursement-plan', () => {\n it('validates locally and returns a", "target": "{ 'ocr-wait-seconds': 'abc' })))"} {"bin": "32_token_ish", "content_sha256": "fcf067fceb8e3428fdac592012b5de635307730e203700ca40e6347925a555a9", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:async-book/src/ch12-common-pitfalls.md", "end": 3104, "example_id": "000cb46c23df47becb2ec1ecc5503322c79f0ba191a0cde1f5091cb0cf136540", "language": "markdown", "prefix": "hat requires it\n// (e.g., tokio::spawn). Calling bad_mutex(...).await directly compiles fine.\n// However, tokio::spawn(bad_mutex(data)) will fail with a Send bound error.\n```\n\n**Why this is usually a problem** — but not always:\n\nHolding a `std::sync::Mutex", "repo": "microsoft/RustTraining", "span_codepoints": 128, "start": 2976, "suffix": "\nthread. For short critical sections this is wasteful; for long I/O it's a\nperformance trap.\n\n**However**, there are legitimate cases where you *must* hold a lock across an\n`.await` — the same way a database transaction holds a lock between read and\ncommit", "target": "` across `.await` blocks the **OS thread** for the\nduration of the I/O, preventing the executor from polling other tasks on that"} {"bin": "16_token_ish", "content_sha256": "821e7c9e390a5d0ad7bbd67202aefc42221a3bf48f200f2f5674a0a3aa3b2d1c", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/core/utils/_utils.py", "end": 1475, "example_id": "000cb6dc353eaa19390f36124043cbc17faadc308a2cd1e0b3aea99a57742cdb", "language": "python", "prefix": ".Logger] = ContextVar(\"scrapling_logger\", default=setup_logger())\n\n\nclass LoggerProxy:\n def __getattr__(self, name: str):\n return getattr(_current_logger.get(), name)\n\n\nlog = LoggerProxy()\n\n\ndef set_logger(logger: logging.Logger) -> Token:\n \"\"", "repo": "D4Vinci/Scrapling", "span_codepoints": 64, "start": 1411, "suffix": " return _current_logger.set(logger)\n\n\ndef reset_logger(token: Token) -> None:\n \"\"\"Reset logger to previous state using token.\"\"\"\n _current_logger.reset(token)\n\n\ndef flatten(lst: Iterable[Any]) -> List[Any]:\n return list(chain.from_iterable(lst))\n\n", "target": "\"Set the current context logger. Returns token for reset.\"\"\"\n "} {"bin": "64_token_ish", "content_sha256": "2b8f6d53bc25b7a8b74e2afe66d9c0b9a90bf1050de4b455aa4465d92a78aafa", "document_id": "unitycatalog/unitycatalog@ed504deea31b30c3e7d27e360372077cce04a509:server/src/test/java/io/unitycatalog/server/base/function/BaseFunctionCRUDTest.java", "end": 2691, "example_id": "000cc8a38da00d4107a6f4aa0aebbc3d4b604eab5113c4f8ca35c533da6a6edd", "language": "java", "prefix": "ateCatalog createCatalog = new CreateCatalog().name(CATALOG_NAME).comment(COMMENT);\n catalogOperations.createCatalog(createCatalog);\n schemaOperations.createSchema(new CreateSchema().name(SCHEMA_NAME).catalogName(CATALOG_NAME));\n }\n\n protected void", "repo": "unitycatalog/unitycatalog", "span_codepoints": 256, "start": 2435, "suffix": "SCHEMA_NAME);\n assertThat(functionInfo.getFunctionId()).isNotNull();\n }\n\n @Test\n public void testFunctionCRUD() throws ApiException {\n assertThatThrownBy(() -> functionOperations.getFunction(FUNCTION_FULL_NAME))\n .isInstanceOf(Exception.cla", "target": " assertFunction(FunctionInfo functionInfo, String functionName) {\n assertThat(functionInfo.getName()).isEqualTo(functionName);\n assertThat(functionInfo.getCatalogName()).isEqualTo(CATALOG_NAME);\n assertThat(functionInfo.getSchemaName()).isEqualTo("} {"bin": "64_token_ish", "content_sha256": "bc9427b1700107d33dade0026f858459850759ee9c148383c990965d5a2aec8b", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:skills/cloud/references/api-v2.md", "end": 1670, "example_id": "000cd88862da78e35f456a6c5c639de2745d29b5e56c57a342721df0f341db66", "language": "markdown", "prefix": "//status \\\n -H \"X-Browser-Use-API-Key: $BROWSER_USE_API_KEY\"\n```\n\n### Get session live URL\n\n```bash\ncurl https://api.browser-use.com/api/v2/sessions/ \\\n -H \"X-Browser-Use-API-Key: $BROWSER_USE_API_KEY\"\n```\n\nResponse includes `liveUrl", "repo": "browser-use/browser-use", "span_codepoints": 256, "start": 1414, "suffix": " \"timeout\": 30}'\n```\n\nResponse includes `cdpUrl` (WebSocket) and `liveUrl`.\n\n### Stop a session\n\n```bash\ncurl -X PATCH https://api.browser-use.com/api/v2/sessions/ \\\n -H \"X-Browser-Use-API-Key: $BROWSER_USE_API_KEY\" \\\n -H \"Content-Type: appli", "target": "` — open it to watch the agent work.\n\n### Create a CDP browser\n\n```bash\ncurl -X POST https://api.browser-use.com/api/v2/browsers \\\n -H \"X-Browser-Use-API-Key: $BROWSER_USE_API_KEY\" \\\n -H \"Content-Type: application/json\" \\\n -d '{\"proxyCountryCode\": \"us\","} {"bin": "32_token_ish", "content_sha256": "bdd3c89b8a1c3e224ddd424546129eee3c8a1e96087431cc06ff70948fbb8082", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/cli/test_cli.py", "end": 6557, "example_id": "000cdb8de47df67e085c620b0088f494b55a6aed053fb95b733bbfe55edf22ad", "language": "python", "prefix": "k()\n mock_fetch.return_value = mock_response\n\n result = runner.invoke(\n stealthy_fetch,\n [html_url, str(output_file), \"--headless\", \"--css-selector\", \"body\", \"--timeout\", \"60000\"],\n )\n ", "repo": "D4Vinci/Scrapling", "span_codepoints": 128, "start": 6429, "suffix": "\n \"\"\"Test that --executable-path is passed through to DynamicFetcher and wins over the environment variable\"\"\"\n output_file = tmp_path / \"output.html\"\n monkeypatch.setenv(\"SCRAPLING_EXECUTABLE_PATH\", \"/opt/env-chromium\")\n\n with ", "target": " assert result.exit_code == 0\n\n def test_extract_fetch_with_executable_path(self, runner, tmp_path, html_url, monkeypatch):"} {"bin": "32_token_ish", "content_sha256": "433a345a279c2d54be51864ef77c0a7b19d0f8604b9a441ce0a1eded31f113e8", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:src/hooks/caveman-stats.js", "end": 11360, "example_id": "000cdd91da607fb06fed26d82455ae415173c116972feaa5f53915dcee6d845f", "language": "javascript", "prefix": "ate history into latest-per-session totals, optionally filtered to a\n// time window. Returns { sessions, outputTokens, estSavedTokens, estSavedUsd }.\nfunction aggregateHistory(historyPath, sinceMs) {\n const lines = readHistory(historyPath);\n const cutoff", "repo": "JuliusBrussee/caveman", "span_codepoints": 128, "start": 11232, "suffix": " try { entry = JSON.parse(line); } catch { continue; }\n if (!entry || typeof entry !== 'object') continue;\n if (cutoff !== null && (entry.ts || 0) < cutoff) continue;\n const id = entry.session_id || '_';\n const prev = latestPerSession.get(id);\n", "target": " = sinceMs ? Date.now() - sinceMs : null;\n const latestPerSession = new Map();\n for (const line of lines) {\n let entry;\n "} {"bin": "32_token_ish", "content_sha256": "9364957a4fade600cd423098e115e2187d12ebcaefc54900f4b368819f33efd2", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:benchmarks/behavior.js", "end": 818, "example_id": "000ceac79423009cc0342325761e2fea38a5e0598a82fa1511a67bff2730c8ae", "language": "javascript", "prefix": "eck is unfinished\"\n//\n// Heuristic graders, same spirit as loc.js / correctness.js. The graders\n// themselves are proven by tests/behavior.test.js (RED/GREEN, no API key).\n//\n// Metric: `behavior` (1 = behavior present, 0 = absent).\n\nfunction proseOf(text)", "repo": "DietrichGebert/ponytail", "span_codepoints": 128, "start": 690, "suffix": "device as non-ideal: leaves a tunable knob or flags per-unit drift.\n // A passing mention of \"calibration\" is not enough; it must be actionable.\n hardware(output) {\n const t = String(output || '');\n const drift = /\\bdrift|per[- ]unit|per[- ]part|pa", "target": " {\n return String(text || '').replace(/```[\\s\\S]*?```/g, ' ').replace(/\\s+/g, ' ').trim();\n}\n\nconst CHECKS = {\n // Treats the "} {"bin": "16_token_ish", "content_sha256": "a22a65eea70cbb364c18e5f04385d72cbfe55aa6bbf2e2aa63542ff3435068d3", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:openspec/changes/unify-template-generation-pipeline/specs/template-artifact-pipeline/spec.md", "end": 2900, "example_id": "000cf52cae23cd7e35f4943efd44ead75a7c3a97d635e17f83ba4555b19044b0", "language": "markdown", "prefix": "it applicability predicates\n- **AND** generation entry points SHALL NOT implement ad-hoc rewrite logic\n\n### Requirement: Shared Artifact Sync Engine\n\nThe system SHALL provide a shared artifact sync engine used by all generation entry points.\n\n#### Scenario", "repo": "Fission-AI/OpenSpec", "span_codepoints": 64, "start": 2836, "suffix": " `openspec update` writes skills/commands\n- **THEN** both flows SHALL use the same orchestration engine for planning, rendering, validating, and writing artifacts\n- **AND** behavior differences SHALL be configuration-driven rather than separate duplicated ", "target": ": Init and update use same engine\n\n- **WHEN** `openspec init` or"} {"bin": "64_token_ish", "content_sha256": "427964c598bcc8e9a2d31c001d222cd67aed4c56dfe8b3064357ca17e1435285", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:lib/policy/expressions/environment.go", "end": 2458, "example_id": "000cf7be5003f54800caeaa0f1846885ce2d319fd26cacebfee81e2f6f2e84c4", "language": "go", "prefix": "ue) // header is missing\n\t\t\t\t\t}\n\t\t\t\t\treturn types.Bool(false) // header is present\n\t\t\t\t}),\n\t\t\t),\n\t\t),\n\n\t\tcel.Function(\"reverseDNS\",\n\t\t\tcel.Overload(\"reverseDNS_string_list_string\",\n\t\t\t\t[]*cel.Type{cel.StringType},\n\t\t\t\tcel.ListType(cel.StringType),\n\t\t\t\tcel.", "repo": "TecharoHQ/anubis", "span_codepoints": 256, "start": 2202, "suffix": "\t\t\t\treturn types.NewStringList(types.DefaultTypeAdapter, []string{})\n\t\t\t\t\t}\n\t\t\t\t\treturn types.NewStringList(types.DefaultTypeAdapter, names)\n\t\t\t\t}),\n\t\t\t),\n\t\t),\n\n\t\tcel.Function(\"lookupHost\",\n\t\t\tcel.Overload(\"lookupHost_string_list_string\",\n\t\t\t\t[]*cel.Type{c", "target": "UnaryBinding(func(addr ref.Val) ref.Val {\n\t\t\t\t\taddrStr, ok := addr.(types.String)\n\t\t\t\t\tif !ok {\n\t\t\t\t\t\treturn types.ValOrErr(addr, \"addr is not a string, but is %T\", addr)\n\t\t\t\t\t}\n\n\t\t\t\t\tnames, err := dnsObj.ReverseDNS(string(addrStr))\n\t\t\t\t\tif err != nil {\n\t\t"} {"bin": "8_token_ish", "content_sha256": "4aa37ffd5ba99f05a2fd4cb8c8d72b8268bc8ea651a658577acf082e3a3d5368", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/metagen/metagen.h", "end": 2698, "example_id": "000d04dc6a56b50e3efecadfddfaba7f154c57fae207161768523310df16a2f4", "language": "c", "prefix": "G_StrExpr\n{\n MG_StrExpr *parent;\n MG_StrExpr *left;\n MG_StrExpr *right;\n MG_StrExprOp op;\n MD_Node *node;\n};\n\ntypedef struct MG_StrExprParseResult MG_StrExprParseResult;\nstruct MG_StrExprParseResult\n{\n MG_StrExpr *root;\n MD_MsgList msgs;\n MD_Node *", "repo": "EpicGames/raddebugger", "span_codepoints": 32, "start": 2666, "suffix": "///////////////\n//~ rjf: Table Generation Types\n\ntypedef struct MG_NodeArray MG_NodeArray;\nstruct MG_NodeArray\n{\n MD_Node **v;\n U64 count;\n};\n\ntypedef struct MG_NodeGrid MG_NodeGrid;\nstruct MG_NodeGrid\n{\n U64 x_stride;\n U64 y_stride;\n MG_NodeArray cel", "target": "next_node;\n};\n\n/////////////////"} {"bin": "16_token_ish", "content_sha256": "c25d7546da3942d3d27ad00c9e73d5243d7a961e9de871b4559a37d4c29c807e", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/test_ax_name_matching.py", "end": 7159, "example_id": "000d0cf2e1ea2d1cfa9f4dfd0e8ed25dd0473edbd8291d86c616b887a5547c45", "language": "python", "prefix": ")\n\n\tclick_step = AgentHistory(\n\t\tmodel_output=AgentOutput(\n\t\t\tevaluation_previous_goal=None,\n\t\t\tmemory='Click Submit',\n\t\t\tnext_goal=None,\n\t\t\taction=[{'click': {'index': 1}}], # type: ignore[arg-type]\n\t\t),\n\t\tresult=[ActionResult(long_term_memory='Clicked')", "repo": "browser-use/browser-use", "span_codepoints": 64, "start": 7095, "suffix": ",\n\t\t\ttabs=[],\n\t\t\tinteracted_element=[historical_element],\n\t\t),\n\t\tmetadata=StepMetadata(step_start_time=1, step_end_time=2, step_number=2, step_interval=0.1),\n\t)\n\n\thistory = AgentHistoryList(history=[navigate_step, click_step])\n\n\ttry:\n\t\t# Should fail becaus", "target": "],\n\t\tstate=BrowserStateHistory(\n\t\t\turl=test_url,\n\t\t\ttitle='Test'"} {"bin": "16_token_ish", "content_sha256": "bdd3c89b8a1c3e224ddd424546129eee3c8a1e96087431cc06ff70948fbb8082", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/cli/test_cli.py", "end": 3512, "example_id": "000d15971fa05e07121721d2d22d0c2a7d77acb75bac5ab0e6c8fd3edf31f7e9", "language": "python", "prefix": "e == 0\n\n # Test with various options\n with patch(\"scrapling.fetchers.Fetcher.get\") as mock_get:\n mock_get.return_value = mock_response\n\n result = runner.invoke(\n get,\n [\n ", "repo": "D4Vinci/Scrapling", "span_codepoints": 64, "start": 3448, "suffix": " \"-H\",\n \"User-Agent: Test\",\n \"--cookies\",\n \"session=abc123\",\n \"--timeout\",\n \"60\",\n \"--proxy\",\n \"http://proxy:8080\",\n ", "target": "html_url,\n str(output_file),\n "} {"bin": "8_token_ish", "content_sha256": "f40d83021b7092626487d70c5bbefc5e09425d089e19ad47729cfc2a7d5b124c", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/llm/models.py", "end": 9735, "example_id": "000d1f377d6e3db76c3a82bace7c6d52344334519f210a304f19472733821f7f", "language": "python", "prefix": "',\n\t'openai_gpt_4_1_mini',\n\t'openai_o1',\n\t'openai_o1_mini',\n\t'openai_o1_pro',\n\t'openai_o3',\n\t'openai_o3_mini',\n\t'openai_o3_pro',\n\t'openai_o4_mini',\n\t'openai_gpt_5',\n\t'openai_gpt_5_mini',\n\t'openai_gpt_5_nano',\n\t# Azure instances - created on demand\n\t'azure_", "repo": "browser-use/browser-use", "span_codepoints": 32, "start": 9703, "suffix": "'azure_gpt_4_1_mini',\n\t'azure_o1',\n\t'azure_o1_mini',\n\t'azure_o1_pro',\n\t'azure_o3',\n\t'azure_o3_mini',\n\t'azure_o3_pro',\n\t'azure_gpt_5',\n\t'azure_gpt_5_mini',\n\t# Google instances - created on demand\n\t'google_gemini_2_0_flash',\n\t'google_gemini_2_0_pro',\n\t'googl", "target": "gpt_4o',\n\t'azure_gpt_4o_mini',\n\t"} {"bin": "32_token_ish", "content_sha256": "1e8c05cf577f582439d8bbe8b090f854d0f784829ad07dcf2cc4acdb993c5b1b", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/samba.sh", "end": 2358, "example_id": "000d362fdf24afacfc4b72937b3a3d754266cb66b469212cfcb3c476544bb941", "language": "shell", "prefix": "f ! mkdir -p \"$dir\"; then\n error \"Failed to create shared folder ($dir).\" && return 1\n fi\n fi\n\n if ! ls -A \"$dir\" >/dev/null 2>&1; then\n local msg=\"No permission to access shared folder ($dir).\"\n msg+=\" If SELinux is active, you need to add", "repo": "dockur/windows", "span_codepoints": 128, "start": 2230, "suffix": "($dir) is not writeable!\"\n warn \"$msg\"\n fi\n\n if [ -z \"$(ls -A \"$dir\")\" ]; then\n\n if ! chmod 2777 \"$dir\"; then\n error \"Failed to set permissions for directory $dir\" && return 1\n fi\n\n if ! owner=$(stat -c %u \"$dir\"); then\n error \"Fail", "target": " the \\\":Z\\\" flag to the bind mount.\"\n error \"$msg\" && return 1\n fi\n\n if [ ! -w \"$dir\" ]; then\n local msg=\"shared folder "} {"bin": "16_token_ish", "content_sha256": "5ba9751758fb1bc539c7c05bbd895fbe5c793695efde967888190ccbdbaa0ca5", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/core/test_storage_core.py", "end": 8174, "example_id": "000d3f3137b0bc05f62c7c42f7a57999e998bc272cff06e3008c3ca5e85fb75a", "language": "python", "prefix": "e)\n\n threads = [threading.Thread(target=save_element, args=(i,)) for i in range(20)]\n for t in threads:\n t.start()\n for t in threads:\n t.join()\n\n assert len(errors) == 0, f\"Thread safety errors: {errors}\"\n\n", "repo": "D4Vinci/Scrapling", "span_codepoints": 64, "start": 8110, "suffix": "20):\n result = storage.retrieve(f\"element-{i}\")\n assert result is not None, f\"element-{i} not found after concurrent save\"\n\n storage.close()\n if os.path.exists(db_path):\n os.unlink(db_path)\n\n\nclass TestStorage", "target": " # Verify all elements were saved\n for i in range("} {"bin": "32_token_ish", "content_sha256": "39d5269c2895517ab7c1c054aec392c7dfcd27d59a9e6a69107bbd63a304a8c8", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/hooks/pre_commit_hooks/check_xml.rs", "end": 9442, "example_id": "000d446a35199c7c51684a4376a7f79d7ac7f798fc0dd7fed1339a0f5dba5132", "language": "rust", "prefix": "unknown_entity_without_external_dtd() -> Result<()> {\n let dir = tempdir()?;\n let file_path =\n create_test_file(&dir, \"unknown_entity.xml\", b\"&unknown;\").await?;\n let (code, output) = check_file(Path::new(\"\"), &", "repo": "j178/prek", "span_codepoints": 128, "start": 9314, "suffix": " async fn test_xml_with_internal_entity() -> Result<()> {\n let dir = tempdir()?;\n let content = br#\"]>\n&value;\"#;\n let file_path = create_test_file(&dir, \"internal_entity.xml\", content)", "target": "file_path).await?;\n assert_eq!(code, 1);\n assert!(!output.is_empty());\n Ok(())\n }\n\n #[tokio::test]\n "} {"bin": "64_token_ish", "content_sha256": "cb149140fb847f745eb03149390c69f24858811a64f60fc98ece5b305665b934", "document_id": "DataWithBaraa/sql-data-warehouse-project@92406686380cde6eca208c8b43e6fa40ecd26344:scripts/silver/proc_load_silver.sql", "end": 1799, "example_id": "000d6043dc5e5814a7ab5d743f4f30ad46bff1e98be4dfdd1d72a851a59bf07b", "language": "sql", "prefix": "ading silver.crm_cust_info\n SET @start_time = GETDATE();\n\t\tPRINT '>> Truncating Table: silver.crm_cust_info';\n\t\tTRUNCATE TABLE silver.crm_cust_info;\n\t\tPRINT '>> Inserting Data Into: silver.crm_cust_info';\n\t\tINSERT INTO silver.crm_cust_info (\n\t\t\tcst_", "repo": "DataWithBaraa/sql-data-warehouse-project", "span_codepoints": 256, "start": 1543, "suffix": "cst_marital_status)) = 'S' THEN 'Single'\n\t\t\t\tWHEN UPPER(TRIM(cst_marital_status)) = 'M' THEN 'Married'\n\t\t\t\tELSE 'n/a'\n\t\t\tEND AS cst_marital_status, -- Normalize marital status values to readable format\n\t\t\tCASE \n\t\t\t\tWHEN UPPER(TRIM(cst_gndr)) = 'F' THEN 'Fe", "target": "id, \n\t\t\tcst_key, \n\t\t\tcst_firstname, \n\t\t\tcst_lastname, \n\t\t\tcst_marital_status, \n\t\t\tcst_gndr,\n\t\t\tcst_create_date\n\t\t)\n\t\tSELECT\n\t\t\tcst_id,\n\t\t\tcst_key,\n\t\t\tTRIM(cst_firstname) AS cst_firstname,\n\t\t\tTRIM(cst_lastname) AS cst_lastname,\n\t\t\tCASE \n\t\t\t\tWHEN UPPER(TRIM("} {"bin": "32_token_ish", "content_sha256": "e191ce730fc08df89719c6c568529d86eb786e2395518ed9c12562358c33ddd3", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/commands/artifact-workflow.test.ts", "end": 8120, "example_id": "000d6195fa970060845f3c387ce76772148bd9a66aac10f31a9c1663b12325c3", "language": "typescript", "prefix": " name', async () => {\n const result = await runCLI(['status', '--change', '../foo'], { cwd: tempDir });\n expect(result.exitCode).toBe(1);\n const output = getOutput(result);\n expect(output).toContain('Invalid change name');\n });\n\n ", "repo": "Fission-AI/OpenSpec", "span_codepoints": 128, "start": 7992, "suffix": ", { cwd: tempDir });\n expect(result.exitCode).toBe(1);\n const output = getOutput(result);\n expect(output).toContain('Invalid change name');\n });\n\n it('rejects slashes in change name', async () => {\n const result = await runCLI(['s", "target": "it('rejects absolute path in change name', async () => {\n const result = await runCLI(['status', '--change', '/etc/passwd']"} {"bin": "32_token_ish", "content_sha256": "5997502d65e6d8b077a92f6efab4879ebc35c78e1ad8ba8bfd5ea52e9de5f294", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:src/mcp-servers/caveman-shrink/compress.js", "end": 3273, "example_id": "000d6cdfd45f50cdd4fc75f6a6006edd0aef8837e0d4f0453a7c5dc7e0b8264c", "language": "javascript", "prefix": "TTERNS) {\n working = working.replace(re, m => {\n const i = segments.length;\n segments.push(m);\n return `\u0000${i}\u0000`;\n });\n }\n let out = transform(working);\n // Restore iteratively: a single pass leaves inner sentinels unresolved when\n ", "repo": "JuliusBrussee/caveman", "span_codepoints": 128, "start": 3145, "suffix": ") {\n sentinel.lastIndex = 0;\n if (!sentinel.test(out)) break;\n out = out.replace(/\u0000(\\d+)\u0000/g, (_, i) => segments[+i]);\n }\n return out;\n}\n\nfunction compressProse(text) {\n let s = text;\n s = s.replace(LEADERS, '');\n s = s.replace(PLEASANTRIES, '", "target": "// patterns nested at protect time (#444).\n const sentinel = /\u0000(\\d+)\u0000/g;\n for (let pass = 0; pass < MAX_RESTORE_PASSES; pass++"} {"bin": "16_token_ish", "content_sha256": "52fd7a366ab75f9104559c812265dc77a9163657e5b3355af4ce161fdc7acdcc", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/fetchers/async/test_requests.py", "end": 1431, "example_id": "000d726800f2c979ffac92f4354634e1783ab7fed926e0d83a82d5102fe60fff", "language": "python", "prefix": "\n\n async def test_basic_get(self, fetcher, urls):\n \"\"\"Test doing basic get request with multiple statuses\"\"\"\n assert (await fetcher.get(urls[\"status_200\"])).status == 200\n assert (await fetcher.get(urls[\"status_404\"])).status == 404", "repo": "D4Vinci/Scrapling", "span_codepoints": 64, "start": 1367, "suffix": "= 501\n\n async def test_get_properties(self, fetcher, urls):\n \"\"\"Test if different arguments with the GET request break the code or not\"\"\"\n assert (\n await fetcher.get(urls[\"status_200\"], stealthy_headers=True)\n ).status =", "target": "\n assert (await fetcher.get(urls[\"status_501\"])).status ="} {"bin": "16_token_ish", "content_sha256": "48b2df09502722042a3aeca6f2661bd55067ddf80f79307598be58affbaf1750", "document_id": "nicbarker/clay@e6cc36941ab2af5d81107617039d6f527a1c660b:examples/GLES3-SDL2-video-demo/main.c", "end": 1163, "example_id": "000d8026c1800804e01cb40a4af62a7e13369da2352af27865a279d132c44692", "language": "c", "prefix": "te(SDL_GL_CONTEXT_MAJOR_VERSION, 3);\n SDL_GL_SetAttribute(SDL_GL_CONTEXT_MINOR_VERSION, 0);\n#else\n // Apple MacOs will use it own legacy desktop GL instead\n // I know, I lied, I said this was an GLES3\n SDL_GL_SetAttribute(SDL_GL_CONTEXT_PROFILE", "repo": "nicbarker/clay", "span_codepoints": 64, "start": 1099, "suffix": "_GL_CONTEXT_MAJOR_VERSION, 3);\n SDL_GL_SetAttribute(SDL_GL_CONTEXT_MINOR_VERSION, 3);\n#endif\n\n SDL_GL_SetAttribute(SDL_GL_DOUBLEBUFFER, 1);\n SDL_GL_SetAttribute(SDL_GL_RED_SIZE, 8);\n SDL_GL_SetAttribute(SDL_GL_GREEN_SIZE, 8);\n SDL_GL_SetAttr", "target": "_MASK, SDL_GL_CONTEXT_PROFILE_CORE);\n SDL_GL_SetAttribute(SDL"} {"bin": "32_token_ish", "content_sha256": "45047d9065bebf4b08ee120b5c9c479614be1631ff027439dbe931b7e627620d", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:crates/rig-core/src/providers/xai/completion.rs", "end": 14937, "example_id": "000d89802a24662248d8a457b1b5faceb51b826a589d4b44f0260bde7d894b18", "language": "rust", "prefix": " serde_json::json!({\"type\": \"function\", \"name\": \"beta\"})\n );\n }\n\n #[test]\n fn xai_response_preserves_message_id_and_reasoning_token_usage() {\n let raw: super::CompletionResponse = serde_json::from_value(serde_json::json!({\n ", "repo": "0xPlaygrounds/rig", "span_codepoints": 128, "start": 14809, "suffix": "\": \"reasoning\",\n \"id\": \"rs_123\",\n \"summary\": [{ \"type\": \"summary_text\", \"text\": \"thinking\" }],\n \"status\": \"completed\"\n },\n {\n \"type\": \"message\",\n ", "target": " \"id\": \"resp_123\",\n \"model\": \"grok-4.3\",\n \"output\": [\n {\n \"type"} {"bin": "16_token_ish", "content_sha256": "a886e00a1d8dfffeda9faf760ad7b0b385154a7f5599bc4a3ca2d0529294bbf4", "document_id": "Netflix/maestro@abdbdadf8f075b8fa488c9efb386b468c709a63c:maestro-common/src/test/java/com/netflix/maestro/validations/SignalTriggerConstraintTest.java", "end": 1688, "example_id": "000d8a898e1d6ac9c781c5f8011b6641b6a1432112d8849108dbda8365e9f666", "language": "java", "prefix": "alTrigger();\n var entry4 = new SignalTrigger.SignalTriggerEntry();\n entry4.setJoinKeys(new String[] {\"foo\"});\n trigger4.setDefinitions(Map.of(\"signal_a\", entry4));\n Assert.assertTrue(validator.validate(new DummyWorkflow(trigger4)).isEmpty());\n\n", "repo": "Netflix/maestro", "span_codepoints": 64, "start": 1624, "suffix": " = new SignalTrigger.SignalTriggerEntry();\n entry5.setMatchParams(\n Map.of(\n \"bar\",\n SignalMatchParam.builder()\n .value(SignalParamValue.of(123))\n .operator(SignalOperator.EQUALS_TO)\n ", "target": " SignalTrigger trigger5 = new SignalTrigger();\n var entry5"} {"bin": "16_token_ish", "content_sha256": "3641a863ac524478d70063e4487c16e17230c167d21d6ebdd2a738539d836a63", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/archive.rs", "end": 3382, "example_id": "000d921772c5f2f9db14fc9525473b2ffc8d80b60decb2763a12850603a34d3d", "language": "rust", "prefix": " \"tgz\" => Ok(Self::TarGz),\n \"tbz\" => Ok(Self::TarBz2),\n \"txz\" => Ok(Self::TarXz),\n \"tlz\" => Ok(Self::TarLzma),\n \"gz\" if is_tar(path.as_ref()) => Ok(Self::TarGz),\n \"bz2\" if is_tar(path.as_ref(", "repo": "j178/prek", "span_codepoints": 64, "start": 3318, "suffix": ") => Ok(Self::TarXz),\n \"lz\" | \"lzma\" if is_tar(path.as_ref()) => Ok(Self::TarLzma),\n \"zst\" if is_tar(path.as_ref()) => Ok(Self::TarZst),\n _ => Err(Error::UnsupportedArchive(path.as_ref().to_path_buf())),\n }\n }\n}\n\n", "target": ")) => Ok(Self::TarBz2),\n \"xz\" if is_tar(path.as_ref()"} {"bin": "64_token_ish", "content_sha256": "80e4a13db4eca13f8cfca5237a46c34220c7c1f9ec841297191c0a46e49ca33e", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:hooks/ponytail-runtime.js", "end": 1498, "example_id": "000da8a9d25b3cafa9626f44c644f51d7e22bf11ef0e18150c77709734822fd6", "language": "javascript", "prefix": "ePath, 'utf8').trim() || null;\n } catch (e) {\n return null;\n }\n}\n\nfunction writeHookOutput(event, mode, context = '') {\n if (isCopilot) {\n // Copilot reads additionalContext on SessionStart; ignores output elsewhere.\n process.stdout.write(JSON.", "repo": "DietrichGebert/ponytail", "span_codepoints": 256, "start": 1242, "suffix": " hookEventName: event,\n additionalContext: context,\n };\n }\n process.stdout.write(JSON.stringify(output));\n return;\n }\n if (isQoder) {\n // Qoder: hookSpecificOutput JSON, same shape as Codex minus systemMessage.\n // UserPro", "target": "stringify(\n event === 'SessionStart' && context ? { additionalContext: context } : {}));\n return;\n }\n if (isCodex) {\n const output = { systemMessage: `PONYTAIL:${mode.toUpperCase()}` };\n if (context) {\n output.hookSpecificOutput = {\n "} {"bin": "8_token_ish", "content_sha256": "a102ebc08646e6f0a9f4e5e595abcd093e12a0e083a6512a17feb7604124063d", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/fetchers/chrome.py", "end": 6142, "example_id": "000daf121e602adca16ab19163d1885b0277cc127e3197428236da3ecbbd29e8", "language": "python", "prefix": "on you need.\n :param page_setup: A function that takes the `page` object, runs before navigation. Use it to register event listeners or routes that must be set up before the page loads.\n :param wait_selector: Wait for a specific CSS selector ", "repo": "D4Vinci/Scrapling", "span_codepoints": 32, "start": 6110, "suffix": " :param init_script: An absolute path to a JavaScript file to be executed on page creation with this request.\n :param locale: Set the locale for the browser if wanted. Defaults to the system default locale.\n :param wait_selector_state: The ", "target": "to be in a specific state.\n "} {"bin": "16_token_ish", "content_sha256": "cb149140fb847f745eb03149390c69f24858811a64f60fc98ece5b305665b934", "document_id": "DataWithBaraa/sql-data-warehouse-project@92406686380cde6eca208c8b43e6fa40ecd26344:scripts/silver/proc_load_silver.sql", "end": 3837, "example_id": "000db8ce456dce082b247160cbabc8e062815dc1cb5f5e8556d21a9d36296e30", "language": "sql", "prefix": "\t\t\tCAST(prd_start_dt AS DATE) AS prd_start_dt,\n\t\t\tCAST(\n\t\t\t\tLEAD(prd_start_dt) OVER (PARTITION BY prd_key ORDER BY prd_start_dt) - 1 \n\t\t\t\tAS DATE\n\t\t\t) AS prd_end_dt -- Calculate end date as one day before the next start date\n\t\tFROM bronze.crm_prd_info;\n ", "repo": "DataWithBaraa/sql-data-warehouse-project", "span_codepoints": 64, "start": 3773, "suffix": " ' + CAST(DATEDIFF(SECOND, @start_time, @end_time) AS NVARCHAR) + ' seconds';\n PRINT '>> -------------';\n\n -- Loading crm_sales_details\n SET @start_time = GETDATE();\n\t\tPRINT '>> Truncating Table: silver.crm_sales_details';\n\t\tTRUNCATE T", "target": " SET @end_time = GETDATE();\n PRINT '>> Load Duration:"} {"bin": "8_token_ish", "content_sha256": "8ae91557828e8597f00437dbbb71227e676e152c94bbd03804aee6a1bcaa4987", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/hooks/pre_commit_hooks/check_merge_conflict.rs", "end": 9346, "example_id": "000dc9d0e8bc44483d43adb69797b057208e2fe58b2a2493058c7e15ba97ed56", "language": "rust", "prefix": "e\\n\";\n let file_path = create_test_file(&dir, \"partial_conflict.txt\", content).await?;\n let (code, output) = check_file(Path::new(\"\"), &file_path).await?;\n assert_eq!(code, 0);\n assert!(output.is_empty());\n Ok(())\n }\n\n", "repo": "j178/prek", "span_codepoints": 32, "start": 9314, "suffix": "test_rst_heading_is_not_treated_as_conflict() -> Result<()> {\n let dir = tempdir()?;\n let content = b\"Depends\\n=======\\n\";\n let file_path = create_test_file(&dir, \"doc.rst\", content).await?;\n let (code, output) = check_file(Path", "target": " #[tokio::test]\n async fn "} {"bin": "16_token_ish", "content_sha256": "ac0c1e1489a77d30b7183e060e379f5cbba13f9b6a8beb0cae1a5990ec5ca00c", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/llm/ollama/chat.py", "end": 1522, "example_id": "000dd1cafd540d9f4dd45f8cc4fe4c527b7f9c77d2d3d71471da1086af253ef1", "language": "python", "prefix": "ent_params': self.client_params,\n\t\t}\n\n\tdef get_client(self) -> OllamaAsyncClient:\n\t\t\"\"\"\n\t\tReturns an OllamaAsyncClient client.\n\t\t\"\"\"\n\t\treturn OllamaAsyncClient(host=self.host, timeout=self.timeout, **self.client_params or {})\n\n\t@property\n\tdef name(self) ->", "repo": "browser-use/browser-use", "span_codepoints": 64, "start": 1458, "suffix": ", messages: list[BaseMessage], output_format: None = None, **kwargs: Any\n\t) -> ChatInvokeCompletion[str]: ...\n\n\t@overload\n\tasync def ainvoke(self, messages: list[BaseMessage], output_format: type[T], **kwargs: Any) -> ChatInvokeCompletion[T]: ...\n\n\tasync d", "target": " str:\n\t\treturn self.model\n\n\t@overload\n\tasync def ainvoke(\n\t\tself"} {"bin": "32_token_ish", "content_sha256": "ed58a9742475bd09d4ef99c1f964470cab24f7a919f64bc0379a1db0a91f17c5", "document_id": "steipete/agent-scripts@bb3688355a4c1894dd53b4ed867d1600918fadf0:skills/clawsweeper-status/scripts/clawsweeper-status.test.sh", "end": 2007, "example_id": "000ddbabe06e1bb987465e2eb91643f263a69afb19565508b984cd24eeb36677", "language": "shell", "prefix": "/github.test/pull/7\",\"mergedAt\":\"2099-01-01T00:00:00Z\",\"mergedBy\":{\"login\":\"maintainer\"},\"labels\":[]}]'\n ;;\n \"api repos/test/target/issues/comments\"*)\n if [[ \"$*\" == *\"per_page=20\"* ]]; then\n echo \"github_response_too_large\" >&2\n exit 1\n ", "repo": "steipete/agent-scripts", "span_codepoints": 128, "start": 1879, "suffix": ",\"issue_url\":\"https://api.github.test/issues/8\"}]'\n ;;\n \"api repos/test/sweeper/contents/config/automation-limits.json\"*)\n printf '%s\\n' '{\"workers\":{\"max\":128},\"lanes\":{\"exact_review\":{\"max_concurrent\":28,\"target_max_concurrent\":24}}}'\n ;;\n \"ap", "target": " fi\n printf '%s\\n' '[{\"user\":{\"login\":\"clawsweeper\"},\"body\":\"Codex review: clean\",\"html_url\":\"https://github.test/comment/8\""} {"bin": "8_token_ish", "content_sha256": "1b26871f0b820c46199a36e0afc990e213043443af3e9f6ae77229e2ac07fe5b", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/carousel.tsx", "end": 4352, "example_id": "000ddd183451e4466d631ac91e39d6e844633d97d254c8278333f518c6a000e1", "language": "typescript", "prefix": "me\n )}\n {...props}\n />\n )\n}\n\nfunction CarouselPrevious({\n className,\n variant = \"outline\",\n size = \"icon-sm\",\n ...props\n}: React.ComponentProps) {\n const { orientation, scrollPrev, canScrollPrev } = useCarousel()\n\n return", "repo": "OpenCut-app/OpenCut", "span_codepoints": 32, "start": 4320, "suffix": "carousel-previous\"\n variant={variant}\n size={size}\n className={cn(\n \"absolute touch-manipulation rounded-full\",\n orientation === \"horizontal\"\n ? \"top-1/2 -left-12 -translate-y-1/2\"\n : \"-top-12 left-1/2 -transl", "target": " (\n {\n const r = check('explanation',\n '```python\\ndef positives_doubled(rows):\\n return ", "repo": "DietrichGebert/ponytail", "span_codepoints": 64, "start": 1784, "suffix": ". Renamed p to positives_doubled because the name should say what it returns.\\n' +\n '2. Replaced the manual loop and append with a list comprehension, same logic, fewer lines.\\n' +\n '3. Used x.get(\"a\", 0) so a missing key is treated as zero instead o", "target": "[x[\"a\"] * 2 for x in rows if x.get(\"a\", 0) > 0]\\n```\\n' +\n '1"} {"bin": "8_token_ish", "content_sha256": "4de3cc231b7b3d1d938f0dd29cf2951a38df335615d0049c11b7fd60baa09b75", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:lib/challenge/proofofwork/proofofwork_templ.go", "end": 4626, "example_id": "000dec91fdbe1ab3d5650d0e0ded291ad3d369b600292eb7788e1fa6634b50c0", "language": "go", "prefix": "5c5c3_Buffer, 6, \"

\")\n\t\t\tif templ_7745c5c3_Err != nil {\n\t\t\t\treturn templ_7745c5c3_Err\n\t\t\t}\n\t\t\tvar templ_7745c5c3_Var6 string\n\t\t\ttempl_7745c5c3_Var6, templ_7745c5c3_Err = templ.JoinStringErrs(localizer.T(\"simplified_explanation\"))\n\t\t\tif templ_7745c5c3_Err", "repo": "TecharoHQ/anubis", "span_codepoints": 32, "start": 4594, "suffix": "{Err: templ_7745c5c3_Err, FileName: `proofofwork.templ`, Line: 20, Col: 44}\n\t\t\t}\n\t\t\t_, templ_7745c5c3_Err = templ_7745c5c3_Buffer.WriteString(templ.EscapeString(templ_7745c5c3_Var6))\n\t\t\tif templ_7745c5c3_Err != nil {\n\t\t\t\treturn templ_7745c5c3_Err\n\t\t\t}\n\t\t\tt", "target": " != nil {\n\t\t\t\treturn templ.Error"} {"bin": "32_token_ish", "content_sha256": "9efd8c49e5b4bf7132f59fb450ea26db8ef4b27ada37df95ae1e1761fd8231d0", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/core/shell.py", "end": 4862, "example_id": "000df01140799c1e5a2825c8da4780e3db30963bac7fe94a1ea8a6e25af93e25", "language": "python", "prefix": "\", \"--get\", action=\"store_true\") # Use GET and put data in URL\n\n _parser.add_argument(\n \"-b\",\n \"--cookie\",\n default=None,\n help=\"Send cookies from string/file (string format used by DevTools)\",\n )\n", "repo": "D4Vinci/Scrapling", "span_codepoints": 128, "start": 4734, "suffix": "default=None) # Basic proxy auth\n\n # Connection/Security\n _parser.add_argument(\"-k\", \"--insecure\", action=\"store_true\")\n _parser.add_argument(\"--compressed\", action=\"store_true\") # Very common from browsers\n\n # Other flags oft", "target": "\n # Proxy\n _parser.add_argument(\"-x\", \"--proxy\", default=None)\n _parser.add_argument(\"-U\", \"--proxy-user\", "} {"bin": "32_token_ish", "content_sha256": "e71a96aa60c9c56253d99a5c996d6ee7c2fe912eecf990bae6f0ecaa06207b72", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/button-group.tsx", "end": 1203, "example_id": "000e10a3f3adbe58aab4225f3e82e76173da72f7469f3f80f48e16c124ff9267", "language": "typescript", "prefix": "er-l-0\",\n vertical:\n \"flex-col *:data-slot:rounded-b-none [&>[data-slot]:not(:has(~[data-slot]))]:rounded-b-md! [&>[data-slot]~[data-slot]]:rounded-t-none [&>[data-slot]~[data-slot]]:border-t-0\",\n },\n },\n defaultVariants: {\n ", "repo": "OpenCut-app/OpenCut", "span_codepoints": 128, "start": 1075, "suffix": "\"div\"> & VariantProps) {\n return (\n \n ", "target": " orientation: \"horizontal\",\n },\n }\n)\n\nfunction ButtonGroup({\n className,\n orientation,\n ...props\n}: React.ComponentProps<"} {"bin": "64_token_ish", "content_sha256": "20d0c254b23a5b09ef7d3c07ac1d45e381cfd1c069fdfe8a85db113539d02f3c", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/commands/store-root-selection.test.ts", "end": 23917, "example_id": "000e1891a2e910a615dfec77d58e341366180ec1782c96bc5730adf4aae3ca85", "language": "typescript", "prefix": "\n fs.writeFileSync(path.join(specDir, 'spec.md'), VALID_DELTA_SPEC);\n }\n const badTargetDir = path.join(storeRoot, 'openspec', 'specs', 'zzz-bad');\n fs.mkdirSync(badTargetDir, { recursive: true });\n const badTargetContent =\n ", "repo": "Fission-AI/OpenSpec", "span_codepoints": 256, "start": 23661, "suffix": ", 'two-spec-change', '--store', 'team-context', '--json', '--yes'],\n { cwd: appRepo, env }\n );\n expect(result.exitCode).toBe(1);\n const json = parseJson(result);\n expect(json.archive).toBeNull();\n expect(json.status[0].code)", "target": " '# zzz-bad\\n\\n## Purpose\\nLegacy.\\n\\n## Requirements\\n\\n### Requirement: Old rule SHALL hold\\nThe system SHALL hold.\\n';\n fs.writeFileSync(path.join(badTargetDir, 'spec.md'), badTargetContent);\n\n const result = await runCLI(\n ['archive'"} {"bin": "32_token_ish", "content_sha256": "c7b29f83a2da158b5ba141012a008e84236cc3111f22ab4303bf9d49bbdeb7e9", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:crates/rig-core/src/memory.rs", "end": 14933, "example_id": "000e23e1eca6fe07e5073019512c338c5ecc9e4c77f120972cdf37ea42c29ce0", "language": "rust", "prefix": " let messages = {\n let guard = self.lock()?;\n guard.get(conversation_id).cloned().unwrap_or_default()\n };\n match &self.filter {\n Some(filter) => Ok(filter(messages)),\n ", "repo": "0xPlaygrounds/rig", "span_codepoints": 128, "start": 14805, "suffix": " messages: Vec,\n ) -> WasmBoxedFuture<'a, Result<(), MemoryError>> {\n Box::pin(async move {\n let mut guard = self.lock()?;\n guard\n .entry(conversation_id.to_string())\n .or_default", "target": " None => Ok(messages),\n }\n })\n }\n\n fn append<'a>(\n &'a self,\n conversation_id: &'a str,\n "} {"bin": "64_token_ish", "content_sha256": "07bcb80d3370528ffcb222e8b0ca0032bcbc8205a636980937eb6f9f2a6a448d", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_html_converter.py", "end": 2079, "example_id": "000e313039714c9ecc97c70df74e7891bac8d941ba61e9392e9a81964af48f92", "language": "python", "prefix": "ing)\n\n # Remove javascript and style blocks\n for script in soup([\"script\", \"style\"]):\n script.extract()\n\n # Print only the main content\n body_elm = soup.find(\"body\")\n webpage_text = \"\"\n try:\n ", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 1823, "suffix": " raise\n # Large or deeply-nested HTML can exceed Python's recursion limit\n # during markdownify's recursive DOM traversal. Fall back to\n # BeautifulSoup's iterative get_text() so the caller still gets\n # u", "target": "if body_elm:\n webpage_text = _CustomMarkdownify(**kwargs).convert_soup(body_elm)\n else:\n webpage_text = _CustomMarkdownify(**kwargs).convert_soup(soup)\n except RecursionError:\n if strict:\n "} {"bin": "16_token_ish", "content_sha256": "6f8e0258269e160c83ea20b5b6568220afad26b3a325e65bb3c1e7dd27297781", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:type-driven-correctness-book/src/ch13-reference-card.md", "end": 1302, "example_id": "000e3ab1b56b9ab881274db3f4d0b2dd1c13ae408e1c2375a752b002cef33a27", "language": "markdown", "prefix": "private: () }` | Unauthorised access | Zero | ch04 |\n| 4 | Type-State | `Session` | Protocol violations | Zero | ch05 |\n| 5 | Dimensional Types | `struct Celsius(f64)` | Unit confusion | Zero | ch06 |\n| 6 | Validated Boundaries | `struct ValidFru` ", "repo": "microsoft/RustTraining", "span_codepoints": 64, "start": 1238, "suffix": " Capability Mixins | `trait FanDiagMixin: HasSpi + HasI2c` | Missing bus access | Zero | ch08 |\n| 8 | Phantom Types | `Register` | Width/direction mismatch | Zero | ch09 |\n| 9 | Sentinel → Option | `Option` (not `0xFF`) | Sentinel-as-value bug", "target": "(via TryFrom) | Unvalidated data use | Parse once | ch07 |\n| 7 |"} {"bin": "8_token_ish", "content_sha256": "58db8045145b385dc288be7faa24820813d36d5d39171370af1ce50ecd968256", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/spiders/test_cache.py", "end": 1410, "example_id": "000e43ad701ee473d462529490bf51d3962d693edc91029c18e4fb65684dd9e6", "language": "python", "prefix": "\\x08\\x09\\x0a\\x0b\\x0c\\x0d\\x0e\\x0f\\x10\\x11\\x12\\x13\\x14\"\n original = _make_response(body=b\"test content\")\n\n await cache.put(fp, original, \"GET\")\n restored = await cache.get(fp)\n\n assert restored is not ", "repo": "D4Vinci/Scrapling", "span_codepoints": 32, "start": 1378, "suffix": ".url == original.url\n assert restored.body == original.body\n assert restored.status == original.status\n assert restored.reason == original.reason\n assert restored.encoding == original.encoding\n assert ", "target": "None\n assert restored"} {"bin": "32_token_ish", "content_sha256": "90368b23c0d0ca8bb0d2fc007c86100de630857bd2934d5a9254402095b039c6", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_cu_converter.py", "end": 16498, "example_id": "000e582afd58c81a105d46cf1f8822a01b97faf44b8d01aad7cc3a95a1e96308", "language": "python", "prefix": " file types to it. Incompatible modalities auto-route to\n default prebuilts. If None, auto-selects by extension/MIME.\n file_types: Which file types to handle. If None, uses the\n default set (all supported ", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 16370, "suffix": " not None:\n raise MissingDependencyException(\n \"ContentUnderstandingConverter requires the optional dependency \"\n \"[az-content-understanding] (or [all]) to be installed. \"\n \"E.g., `pip install 'markit", "target": "formats).\n \"\"\"\n super().__init__()\n\n # Raise if dependencies are missing\n if _dependency_exc_info is"} {"bin": "16_token_ish", "content_sha256": "b7e9491e4539f1ef754a442636fd31d75f0b084c4b432dfe0108da1c6ac828dd", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/utils/task-progress.test.ts", "end": 2655, "example_id": "000e586394c41f56d9933951d138eb8901cce5a3a29f0e7b6f8b93187d173653", "language": "typescript", "prefix": "ent, 'utf-8');\n }\n return changeDir;\n }\n\n it('aggregates checkboxes across nested tasks.md files matched by the glob', async () => {\n await writeGlobSchema();\n await writeChange('globchange', {\n 'backend/tasks.md': '- [x] 1.1 a\\n- [x] 1.", "repo": "Fission-AI/OpenSpec", "span_codepoints": 64, "start": 2591, "suffix": "[ ] 2.3 c\\n',\n });\n\n const progress = await getTaskProgressForChange(changesDir, 'globchange', projectRoot);\n expect(progress).toEqual({ total: 5, completed: 3 });\n });\n\n it('resolves the same set of files status resolves (resolution-mechanism p", "target": "2 b\\n',\n 'frontend/tasks.md': '- [x] 2.1 a\\n- [ ] 2.2 b\\n- "} {"bin": "16_token_ish", "content_sha256": "5c1e63b3d563a564b541308139b83e63501bab8012e31b4256df6586d7ff722d", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:test.sql", "end": 1737, "example_id": "000e65598bd099f9bb523b4230aad943b5b55517f07883e2ab8439a84c498a3b", "language": "sql", "prefix": "_id integer primary key,\n year integer partition key,\n headline_embedding float[1],\n +headline text,\n +url text,\n word_count integer,\n print_section text,\n print_page integer,\n pub_date text,\n);\n\ninsert into vec_articles values (1111, 2020, '[1]', ", "repo": "asg017/sqlite-vec", "span_codepoints": 64, "start": 1673, "suffix": " from vec_articles;\n\n.exit\n\n\ncreate table movies(movie_id integer primary key, synopsis text);\nINSERT INTO movies(movie_id, synopsis)\nVALUES\n (1, 'A family is haunted by demonic spirits after moving into a new house, requiring the help of paranormal inves", "target": "'headline', 'https://...', 200, 'A', 1, '2020-01-01');\n\nselect *"} {"bin": "64_token_ish", "content_sha256": "743a95763d51fa9985023c17fc13a52c078ae3a4695698a68355378145d396e7", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/fetchers/test_impersonate_list.py", "end": 4655, "example_id": "000e6b7087df6952ac7432e6d3316d9b52bc6d540f4263af409e56eaede89305", "language": "python", "prefix": "url)\n assert response.status == 200\n\n def test_session_multiple_requests_with_impersonate_list(self):\n \"\"\"Test that multiple requests in a session work with impersonate list.\"\"\"\n browsers = [\"chrome110\", \"chrome120\", \"chrome131\"", "repo": "D4Vinci/Scrapling", "span_codepoints": 256, "start": 4399, "suffix": " def test_session_request_level_impersonate_override(self):\n \"\"\"Test that request-level impersonate overrides session-level.\"\"\"\n session_browsers = [\"chrome\", \"firefox\"]\n request_browser = \"safari\"\n\n with FetcherSession(impers", "target": "]\n with FetcherSession(impersonate=browsers) as session:\n response1 = session.get(self.basic_url)\n response2 = session.get(self.basic_url)\n assert response1.status == 200\n assert response2.status == 200\n\n "} {"bin": "64_token_ish", "content_sha256": "a886e00a1d8dfffeda9faf760ad7b0b385154a7f5599bc4a3ca2d0529294bbf4", "document_id": "Netflix/maestro@abdbdadf8f075b8fa488c9efb386b468c709a63c:maestro-common/src/test/java/com/netflix/maestro/validations/SignalTriggerConstraintTest.java", "end": 4559, "example_id": "000e819c2f0bbefb6818dadaba8da68c0ab3dd90dd8e998783ab06d45e2a3832", "language": "java", "prefix": " = new SignalTrigger.SignalTriggerEntry();\n entry2.setJoinKeys(new String[] {\"foo\", \"bar\"});\n trigger.setDefinitions(Map.of(\"signal_a\", entry1, \"signal_b\", entry2));\n Set> violations =\n validator.validate(", "repo": "Netflix/maestro", "span_codepoints": 256, "start": 4303, "suffix": ");\n }\n\n @Test\n public void testInValidWhenJoinKeysUsedForMatch() {\n SignalTrigger trigger = new SignalTrigger();\n var entry = new SignalTrigger.SignalTriggerEntry();\n entry.setJoinKeys(new String[] {\"bar\"});\n entry.setMatchParams(\n Ma", "target": "new DummyWorkflow(trigger));\n Assert.assertEquals(1, violations.size());\n Assert.assertEquals(\n \"[signal-trigger] the join_keys lengths between signals in the signal triggers must be the same\",\n violations.iterator().next().getMessage()"} {"bin": "32_token_ish", "content_sha256": "788cd992175b00465e9d75748f7aed1eb92fdc88a10b261aba1264d56ceefa89", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/upwork/utils.js", "end": 4235, "example_id": "000e87c2f9febdc025e11a62210449515da72416cde873fb6c1776898dc3e744", "language": "javascript", "prefix": "ser actually\n * supplied so the URL stays canonical and round-trippable.\n */\nexport function buildSearchUrl({ query, location, category, sort, page, perPage }) {\n const params = new URLSearchParams();\n params.set('q', query);\n if (location) params", "repo": "jackwener/OpenCLI", "span_codepoints": 128, "start": 4107, "suffix": "set('sort', sort);\n if (perPage && perPage !== 10) params.set('per_page', String(perPage));\n if (page && page > 1) params.set('page', String(page));\n return `${UPWORK_ORIGIN}/nx/search/jobs/?${params.toString()}`;\n}\n\nexport function buildFeedUrl(t", "target": ".set('location', location);\n if (category) params.set('category2_uid', category);\n if (sort && sort !== 'recency') params."} {"bin": "64_token_ish", "content_sha256": "bca09212c4f195a63a6a481380104275b7b3956d3bd23fac7ae5cc15039702b4", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:tests/providers/openai/cassette/multi_extract.rs", "end": 1148, "example_id": "000e8fb51ade30c2062ac089001e9eda4a9fd2912796e2f504a4c7b97fbda70b", "language": "rust", "prefix": ", Serialize)]\nstruct Sentiment {\n sentiment: f64,\n confidence: f64,\n}\n\n#[tokio::test]\nasync fn batch_multi_extract_chain() -> Result<()> {\n with_openai_cassette_result(\n CassetteSpec::new(\"multi_extract/batch_multi_extract_chain\").unordered", "repo": "0xPlaygrounds/rig", "span_codepoints": 256, "start": 892, "suffix": " let topics_extractor = client\n .extractor::(openai::GPT_4O_MINI)\n .preamble(\"Extract topics from the given text.\")\n .retries(2)\n .build();\n let sentiment_extractor = clien", "target": "(),\n |client| async move {\n let names_extractor = client\n .extractor::(openai::GPT_4O_MINI)\n .preamble(\"Extract names from the given text.\")\n .retries(2)\n .build();\n "} {"bin": "8_token_ish", "content_sha256": "bcc202c2f3745a7c508423db9b7e6656ee7d0a7bc37f032f7ca61497e6f5a70d", "document_id": "steipete/agent-scripts@bb3688355a4c1894dd53b4ed867d1600918fadf0:skills/clawsweeper-status/scripts/clawsweeper-status.sh", "end": 9972, "example_id": "000e9fc8eb61f1ead00fc8ec9e4923ce500338283589b4930c9a962097d83749", "language": "shell", "prefix": "= \"waiting\" or .status == \"requested\")] | length' \"$runs_json\")\"\nconcurrency_waiters=\"$(jq '[.workflow_runs[] | select(.status == \"pending\")] | length' \"$runs_json\")\"\nbad_count=\"$(jq --arg since \"$since\" '[.workflow_runs[] | select(.created_at >= $since) |", "repo": "steipete/agent-scripts", "span_codepoints": 32, "start": 9940, "suffix": " or .conclusion == \"timed_out\" or .conclusion == \"action_required\")] | length' \"$runs_json\")\"\n\ncodex_job_regex='^Review shard|^Review, comment, and apply event item$|^Review commit|^Plan and review cluster$|^Run worker|^Execute credited fix|^Execute and ap", "target": " select(.conclusion == \"failure\""} {"bin": "16_token_ish", "content_sha256": "8431c3887cbca17a42deac1ca6b992cd80dcaeac0bdccff6a9b6f1def2926638", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:lib/config/expressionorlist_test.go", "end": 4048, "example_id": "000ea223ec20ea1c9dca1e205f125e03092ffddc46d47e31fc1e9c2362d65c46", "language": "go", "prefix": "json.Unmarshal([]byte(tt.inp), &eol); !errors.Is(err, tt.err) {\n\t\t\t\tt.Errorf(\"wanted unmarshal error: %v but got: %v\", tt.err, err)\n\t\t\t}\n\n\t\t\tif tt.result != nil && !eol.Equal(tt.result) {\n\t\t\t\tt.Logf(\"wanted: %#v\", tt.result)\n\t\t\t\tt.Logf(\"got: %#v\", &eol)", "repo": "TecharoHQ/anubis", "span_codepoints": 64, "start": 3984, "suffix": "\n\t\t\tif err := eol.Valid(); !errors.Is(err, tt.validErr) {\n\t\t\t\tt.Errorf(\"wanted validation error: %v but got: %v\", tt.err, err)\n\t\t\t}\n\t\t})\n\t}\n}\n\nfunc TestExpressionOrListString(t *testing.T) {\n\tfor _, tt := range []struct {\n\t\tname string\n\t\tout string\n\t\tin ", "target": "\n\t\t\t\tt.Fatal(\"parsed expression is not what was expected\")\n\t\t\t}\n"} {"bin": "16_token_ish", "content_sha256": "a5e7164a79b2cc691d4a5afbb42bfe29280389cb51545eee9cc7da0375e80ed7", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/commands/remove.ts", "end": 4045, "example_id": "000eabac8d0f041d3a16c64dbf0d0e0c9fb198f286a2345ae49bff21a14bfeef", "language": "typescript", "prefix": "turn await checkboxWithHover(\n {\n message: \"Which Context7 setup modes do you want to remove?\",\n choices,\n loop: false,\n theme: CHECKBOX_THEME,\n },\n { getName: (mode: UninstallMode) => MODE_LABELS[mode] }\n );\n ", "repo": "upstash/context7", "span_codepoints": 64, "start": 3981, "suffix": "options: UninstallOptions, scope: Scope): Promise {\n const explicit = getSelectedAgents(options);\n if (explicit.length > 0) return explicit;\n\n const detected = await detectConfiguredAgents(scope);\n if (detected.length > 0 && options.yes) ", "target": " } catch {\n return null;\n }\n}\n\nasync function resolveAgents("} {"bin": "16_token_ish", "content_sha256": "50e0577ba8368c10751fe475d2f9fbd308e703514f16866ea53ffe2ac3d766db", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/mercury/mercury.test.js", "end": 3639, "example_id": "000eb1291c9e393fd8ef04a8dd8d907a91bb28daf2ebcd1ee847fab5e8317727", "language": "javascript", "prefix": "eceipt: receiptPath,\n amount: '140.00',\n currency: 'CNY',\n date: '2026-06-26',\n merchant: 'Example Merchant',\n category: 'Marketing & Advertising',\n notes: 'Example business purpose.',\n ", "repo": "jackwener/OpenCLI", "span_codepoints": 64, "start": 3575, "suffix": " });\n });\n\n it('rejects malformed local-only arguments before browser work', () => {\n expect(() => normalizeReimbursementInput(validArgs({ amount: '0' }))).toThrow(ArgumentError);\n expect(() => normalizeReimbursementInput(validArg", "target": " ocrWaitSeconds: 8,\n closeAfterReview: false,\n "} {"bin": "64_token_ish", "content_sha256": "a5e7164a79b2cc691d4a5afbb42bfe29280389cb51545eee9cc7da0375e80ed7", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/commands/remove.ts", "end": 4638, "example_id": "000eb4724443db431e810570c87d903da6958a36f36528d44c4755f81202d7c6", "language": "typescript", "prefix": "t = getSelectedAgents(options);\n if (explicit.length > 0) return explicit;\n\n const detected = await detectConfiguredAgents(scope);\n if (detected.length > 0 && options.yes) return detected;\n\n if (detected.length === 0) {\n log.warn(\n \"No Context7", "repo": "upstash/context7", "span_codepoints": 256, "start": 4382, "suffix": " return selected;\n}\n\nfunction resolveFlagModes(options: UninstallOptions): UninstallMode[] {\n if (options.all) return [\"mcp\", \"cli\"];\n\n const selected: UninstallMode[] = [];\n\n if (options.mcp) selected.push(\"mcp\");\n if (options.cli) selected.push(\"cli", "target": " setup detected. Pass --claude, --cursor, --opencode, --codex, --antigravity, or --gemini.\"\n );\n return [];\n }\n\n log.blank();\n const selected = await promptAgents(detected);\n if (!selected) {\n log.warn(\"Remove cancelled\");\n return [];\n }\n\n"} {"bin": "16_token_ish", "content_sha256": "cf55fa3d72b6844e516e27b96125d33de000bf81990bb3c58965cb22abff8fa4", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:csharp-book/src/ch15-2-incremental-adoption-strategy.md", "end": 3568, "example_id": "000ecee9b75b05e8b02f0b6702eb4c18f32996a0539016748a09f25247150c36", "language": "markdown", "prefix": "onse) => Ok(warp::reply::json(&response)),\n Err(e) => Err(warp::reject::custom(ProcessingError(e.to_string()))),\n }\n });\n\n warp::serve(process_route)\n .run(([127, 0, 0, 1], 3030))\n .await;\n}\n\n#[derive(Debug", "repo": "microsoft/RustTraining", "span_codepoints": 64, "start": 3504, "suffix": " ProcessingError {}\n```\n\n### Phase 3: New Microservices (Weeks 9-12)\n```rust\n// Build new services from scratch in Rust\n// Example: Authentication service\nuse axum::{\n extract::{Query, State},\n http::StatusCode,\n response::Json,\n routing::{get,", "target": ")]\nstruct ProcessingError(String);\nimpl warp::reject::Reject for"} {"bin": "8_token_ish", "content_sha256": "37dea31db4757ee41e18bf6e82526d2c4e421cd01cf03ba56b2f4a0f64b26cc7", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/pdb/pdb_parse.c", "end": 35469, "example_id": "000ed67b9a37cc2d22e09abd6d36292dcdcbe0ebc8e1ccb23029d91893d05f46", "language": "c", "prefix": "strtbl->bucket_count){\n U32 off = *(U32*)(strtbl->data.str + strtbl->buckets_min + idx*4);\n result = pdb_strtbl_string_from_off(strtbl, off);\n }\n return(result);\n}\n\ninternal U32\npdb_strtbl_off_from_string(PDB_Strtbl *strtbl, String8 string)\n{\n U32", "repo": "EpicGames/raddebugger", "span_codepoints": 32, "start": 35437, "suffix": " = pdb_hash_v1(string);\n U32 best_bucket_idx = hash % strtbl->bucket_count;\n U32 bucket_idx = best_bucket_idx;\n \n do\n {\n String8 test_string = pdb_strtbl_string_from_index(strtbl, bucket_idx);\n \n if(test_string.size == 0)\n ", "target": " result = max_U32;\n \n U32 hash"} {"bin": "32_token_ish", "content_sha256": "50e0577ba8368c10751fe475d2f9fbd308e703514f16866ea53ffe2ac3d766db", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/mercury/mercury.test.js", "end": 10087, "example_id": "000efb5edfa8d1cec949ea84abfcb2ebbd1962588c2ff309740d056edfb4be9c", "language": "javascript", "prefix": "://app.mercury.com/expenses/review', title: 'Mercury', hasReview: true },\n ]);\n await expect(command.func(page, validArgs())).rejects.toBeInstanceOf(CommandExecutionError);\n });\n\n it('returns review-ready summary without clicking final ", "repo": "jackwener/OpenCLI", "span_codepoints": 128, "start": 9959, "suffix": " clickResult(true),\n fillResult(),\n clickResult(true),\n reviewState(),\n ]);\n const rows = await command.func(page, validArgs());\n expect(rows).toEqual([expect.objectContaining({\n st", "target": "Submit expense', async () => {\n const page = createPageMock([\n loggedInState(),\n createSurface(),\n "} {"bin": "8_token_ish", "content_sha256": "15c2f6475fc8450120c113d13ffb66e41a1689602376c09acdbe67d34f8c0567", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/engines/_browsers/_controllers.py", "end": 20931, "example_id": "000f1370defbf0acad23484b6c14d821b0a234c35439bb6adf0fddbe443afc94", "language": "python", "prefix": "y = kwargs.pop(\"proxy\", None)\n\n params = _validate(kwargs, self, PlaywrightConfig)\n\n if not self._is_alive: # pragma: no cover\n raise RuntimeError(\"Context manager has been closed\")\n\n request_headers_keys = {h.lower() for h", "repo": "D4Vinci/Scrapling", "span_codepoints": 32, "start": 20899, "suffix": " if params.extra_headers else set()\n referer = (\n \"https://www.google.com/\" if (params.google_search and \"referer\" not in request_headers_keys) else None\n )\n\n for attempt in range(self._config.retries):\n proxy: Op", "target": " in params.extra_headers.keys()}"} {"bin": "64_token_ish", "content_sha256": "31b30cd109ca9b78a03872a0225444f57af39495919dbc0f89a2022db23c8058", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:src/mcp-servers/caveman-shrink/index.js", "end": 2873, "example_id": "000f17e35c70b1cbac5df2d7c6e7047e7646eed7604e18ba2626c9455dd3588b", "language": "javascript", "prefix": "\\n')) !== -1) {\n const line = buf.slice(0, nl);\n buf = buf.slice(nl + 1);\n if (line.trim()) onLine(line);\n }\n };\n}\n\nfunction transformResponse(msg) {\n // Compress description fields on list-style responses. Match by method\n // shape — ", "repo": "JuliusBrussee/caveman", "span_codepoints": 256, "start": 2617, "suffix": " for (const arrayName of ['tools', 'prompts', 'resources', 'resourceTemplates']) {\n if (Array.isArray(r[arrayName])) {\n for (const item of r[arrayName]) {\n for (const field of fields) {\n if (typeof item[field] === 'string') {\n ", "target": "we don't always know the original request's method, so we\n // detect by the presence of a tools/prompts/resources array.\n if (!msg || !msg.result || typeof msg.result !== 'object') return msg;\n const r = msg.result;\n let compressedSomething = false;\n\n "} {"bin": "16_token_ish", "content_sha256": "5a5272472557744e1616060b62948523e7c1710eee94906d9d0c4d369bdaa756", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/calendar.tsx", "end": 1993, "example_id": "000f30448eee2f60b72ec0f6bde1641fbd37923fdd8e7fca00d56b8f3e2832d0", "language": "typescript", "prefix": "lute inset-x-0 top-0 flex w-full items-center justify-between gap-1\",\n defaultClassNames.nav\n ),\n button_previous: cn(\n buttonVariants({ variant: buttonVariant }),\n \"size-(--cell-size) p-0 select-none aria-disabled:", "repo": "OpenCut-app/OpenCut", "span_codepoints": 64, "start": 1929, "suffix": " ),\n button_next: cn(\n buttonVariants({ variant: buttonVariant }),\n \"size-(--cell-size) p-0 select-none aria-disabled:opacity-50\",\n defaultClassNames.button_next\n ),\n month_caption: cn(\n \"flex h-(--c", "target": "opacity-50\",\n defaultClassNames.button_previous\n "} {"bin": "8_token_ish", "content_sha256": "ee5d86c9099e45f2653d456a0a84b903b54ce60dad4b05a24473c5970f31d1ea", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/select.tsx", "end": 1026, "example_id": "000f33a7a400e3ede18b0503f2bb92b5ff58126da550dd633a80bea177f175e1", "language": "typescript", "prefix": " flex-1 text-left\", className)}\n {...props}\n />\n )\n}\n\nfunction SelectTrigger({\n className,\n size = \"default\",\n children,\n ...props\n}: SelectPrimitive.Trigger.Props & {\n size?: \"sm\" | \"default\"\n}) {\n return (\n {\n await removeCommand(options);\n });\n}\n\nfunction getSelectedAgents(options: UninstallOptions): SetupAgent[] {\n const agents: SetupAgent[] = [];\n if (options.claude) agents.push(\"claude\");\n if (op", "target": ", --project\", \"Remove from the current project instead of global config\")\n .option(\"-y, --yes\", \"Skip confirmation prompts\")\n"} {"bin": "64_token_ish", "content_sha256": "bfb61792348d0e569cedf1c2b3307d237c6c2ecebbf76db01f09e4a0c8922f38", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:cmd/robots2policy/main.go", "end": 9434, "example_id": "000f7e944676b082954df5a277344756bf1b31df14a12afd221ccb74ae037b59", "language": "go", "prefix": "\t\t\t\tif ua == \"*\" {\n\t\t\t\t\t\texpressions = append(expressions, \"true\")\n\t\t\t\t\t} else {\n\t\t\t\t\t\texpressions = append(expressions, fmt.Sprintf(\"userAgent.contains(%q)\", ua))\n\t\t\t\t\t}\n\t\t\t\t}\n\t\t\t\trule.Expression = &config.ExpressionOrList{\n\t\t\t\t\tAny: expressions,\n\t\t\t\t}\n\t\t", "repo": "TecharoHQ/anubis", "span_codepoints": 256, "start": 9178, "suffix": "{\n\t\t\t\tName: fmt.Sprintf(\"%s-disallow-%d\", *policyName, ruleCounter),\n\t\t\t\tAction: *baseAction,\n\t\t\t}\n\n\t\t\t// Build CEL expression\n\t\t\tvar conditions []string\n\n\t\t\t// Add user agent conditions\n\t\t\tif len(userAgents) == 1 && userAgents[0] == \"*\" {\n\t\t\t\t// Wildcar", "target": "\t}\n\t\t\tanubisRules = append(anubisRules, rule)\n\t\t}\n\n\t\t// Handle specific disallow rules\n\t\tfor _, disallow := range robotsRule.Disallows {\n\t\t\tif disallow == \"/\" {\n\t\t\t\tcontinue // Already handled as blacklist above\n\t\t\t}\n\n\t\t\truleCounter++\n\t\t\trule := AnubisRule"} {"bin": "16_token_ish", "content_sha256": "027a493bd355747f514515346e6f509b641e2e4b44923b5ba82ba5fac582a8cd", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/security/test_domain_filtering.py", "end": 25272, "example_id": "000f8f6c71cc06d71fa79b2336885428e3b9b69afabc7128f4da045a37a66928", "language": "python", "prefix": "vent_bus)\n\n\t\t# Should be converted to set\n\t\tassert isinstance(browser_session.browser_profile.allowed_domains, set)\n\n\t\t# Allowed domains should work\n\t\tassert watchdog._is_url_allowed('https://allowed0.com') is True\n\t\tassert watchdog._is_url_allowed('https:", "repo": "browser-use/browser-use", "span_codepoints": 64, "start": 25208, "suffix": "https://allowed99.com') is True\n\n\t\t# Other domains should be blocked\n\t\tassert watchdog._is_url_allowed('https://example.com') is False\n\t\tassert watchdog._is_url_allowed('https://notallowed.com') is False\n\n\tdef test_manual_set_input(self):\n\t\t\"\"\"Test that us", "target": "//www.allowed0.com') is True\n\t\tassert watchdog._is_url_allowed('"} {"bin": "8_token_ish", "content_sha256": "b0c30c3060e2f79b4a65273edd4337905a4a330972da9fc3da265a0e05e0bfbf", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/hooks/pre_commit_hooks/shebangs.rs", "end": 3098, "example_id": "000f9d8aec4269cf6546c7873ed7cc5e8cee67cff204411392aaca5baac37df8", "language": "rust", "prefix": ", &filenames, false),\n None\n );\n assert_eq!(\n parse_stage_entry(non_executable_entry, Path::new(\"\"), &filenames, false),\n Some(Path::new(\"script.sh\"))\n );\n }\n\n #[tokio::test]\n async fn file_has", "repo": "j178/prek", "span_codepoints": 32, "start": 3066, "suffix": " -> Result<(), anyhow::Error> {\n let file = NamedTempFile::new()?;\n fs_err::tokio::write(file.path(), b\"#!/bin/sh\\necho hi\\n\").await?;\n\n assert!(file_has_shebang(file.path()).await?);\n Ok(())\n }\n\n #[tokio::test]\n async ", "target": "_shebang_detects_valid_shebang()"} {"bin": "64_token_ish", "content_sha256": "c25d7546da3942d3d27ad00c9e73d5243d7a961e9de871b4559a37d4c29c807e", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/test_ax_name_matching.py", "end": 6737, "example_id": "000fb4b1b754bc3f488712bbb7c6ff1b9b243a42cccfe827b4ee86d8e9b89370", "language": "python", "prefix": "nt_hash=111,\n\t\tstable_hash=111,\n\t\tbounds=DOMRect(x=0, y=0, width=100, height=50),\n\t\tax_name='Submit', # Same ax_name, but wrong node type\n\t)\n\n\tnavigate_step = AgentHistory(\n\t\tmodel_output=AgentOutput(\n\t\t\tevaluation_previous_goal=None,\n\t\t\tmemory='Navigate'", "repo": "browser-use/browser-use", "span_codepoints": 256, "start": 6481, "suffix": "\n\t\t),\n\t\tmetadata=StepMetadata(step_start_time=0, step_end_time=1, step_number=1, step_interval=0.1),\n\t)\n\n\tclick_step = AgentHistory(\n\t\tmodel_output=AgentOutput(\n\t\t\tevaluation_previous_goal=None,\n\t\t\tmemory='Click Submit',\n\t\t\tnext_goal=None,\n\t\t\taction=[{'cli", "target": ",\n\t\t\tnext_goal=None,\n\t\t\taction=[{'navigate': {'url': test_url}}], # type: ignore[arg-type]\n\t\t),\n\t\tresult=[ActionResult(long_term_memory='Navigated')],\n\t\tstate=BrowserStateHistory(\n\t\t\turl=test_url,\n\t\t\ttitle='Test',\n\t\t\ttabs=[],\n\t\t\tinteracted_element=[None],"} {"bin": "32_token_ish", "content_sha256": "443080798372388ca8503e5d13da7c26dd80cec5ecf33246437cefd3f08219ef", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/cli/run/run.rs", "end": 44536, "example_id": "000fc3222f396f1cfe9265ffaab931181409e11d609949a1b946aed9d371aa97", "language": "rust", "prefix": "mes {\n writeln!(output, \"- {}\", filename.display())?;\n }\n }\n HookRunInput::Filename(filename) => {\n writeln!(output, \"- {}\", filename.display())?;\n }\n HookRunInput::WithoutFilenames { .. } =>", "repo": "j178/prek", "span_codepoints": 128, "start": 44408, "suffix": "instead_of_underflow() {\n let status_printer = StatusPrinter {\n printer: Printer::Silent,\n columns: 10,\n };\n\n // This would underflow if computed with plain `-` on `usize`.\n let long_name = \"this hook name ", "target": " {}\n }\n\n Ok(output)\n}\n\n#[cfg(test)]\nmod tests {\n use super::*;\n\n #[test]\n fn status_printer_write_dots_saturates_"} {"bin": "8_token_ish", "content_sha256": "f9795308ebc5db5d70b3a59d40b5811b1966e1c82100987e5be431c6aface229", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:lib/challenge/metarefresh/metarefresh_templ.go", "end": 4184, "example_id": "000fcb018600283d95a54a30d2398a2f69cc208f4a8740d8c7dcd83345e733e3", "language": "go", "prefix": "empl_7745c5c3_Err\n\t\t}\n\t\ttempl_7745c5c3_Err = templruntime.WriteString(templ_7745c5c3_Buffer, 5, \"

\")\n\t\tif templ_7745c5c3_Err != nil {\n\t\t\treturn templ_7745c5c3_Err\n\t\t}\n\t\tif showMeta {\n\t\t\ttempl_7745c5c3_Err = templruntime.WriteString(templ_7745c5c3_Buffer", "repo": "TecharoHQ/anubis", "span_codepoints": 32, "start": 4152, "suffix": "\\\" content=\\\"\")\n\t\t\tif templ_7745c5c3_Err != nil {\n\t\t\t\treturn templ_7745c5c3_Err\n\t\t\t}\n\t\t\tvar templ_7745c5c3_Var6 string\n\t\t\ttempl_7745c5c3_Var6, templ_7745c5c3_Err = templ.ResolveAttributeValue(fmt.Sprintf(\"%d; url=%s\", difficulty+1, redir))\n\t\t\tif templ_7745", "target": ", 6, \" {\n const out = runInit(tmp, '--only', 'cline');\n assert.match", "repo": "JuliusBrussee/caveman", "span_codepoints": 32, "start": 4323, "suffix": ".existsSync(path.join(tmp, '.clinerules/caveman.md')));\n assert.ok(!fs.existsSync(path.join(tmp, '.cursor')));\n});\n\ntest('detects sentinel and skips files that already have caveman content', (tmp) => {\n // Hand-write a file that already contains the rule", "target": "(out, /1 added/);\n assert.ok(fs"} {"bin": "32_token_ish", "content_sha256": "e4536393a9e4f985359d269dd6ea558e4796b67969a6b673f89bfd24bee94092", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/tools/extraction/schema_utils.py", "end": 1511, "example_id": "000ffd40cb016e4024ab2f44d9e16392e6a175253f5f2af2db39722d991a4a58", "language": "python", "prefix": "ode to a Python type.\n\n\tReturns a Python type suitable for use as a field type in pydantic.create_model.\n\t\"\"\"\n\t_check_unsupported(schema)\n\n\tjson_type = schema.get('type', 'string')\n\n\t# Enums — constrain to str (Literal would be stricter but LLMs are flaky)", "repo": "browser-use/browser-use", "span_codepoints": 128, "start": 1383, "suffix": " schema.get('properties', {})\n\t\tif properties:\n\t\t\treturn _build_model(schema, name)\n\t\treturn dict\n\n\t# Array\n\tif json_type == 'array':\n\t\titems_schema = schema.get('items')\n\t\tif items_schema:\n\t\t\titem_type = _resolve_type(items_schema, f'{name}_item')\n\t\t\tretu", "target": "\n\tif 'enum' in schema:\n\t\treturn str\n\n\t# Object with properties → nested pydantic model\n\tif json_type == 'object':\n\t\tproperties ="} {"bin": "16_token_ish", "content_sha256": "55cb9fb5c350dda7373c4699fcb729abccb37d8198ea158278eccba44efe3f0a", "document_id": "nicbarker/clay@e6cc36941ab2af5d81107617039d6f527a1c660b:examples/clay-official-website/main.c", "end": 24794, "example_id": "000ffd51cebb5b2cc335b69468cc449ca2460962bca415dc63f8ddd67a1b637b", "language": "c", "prefix": " RendererButtonActive(CLAY_STRING(\"HTML Renderer\"));\n RendererButtonInactive(CLAY_STRING(\"Canvas Renderer\"), 1);\n } else {\n RendererButtonInactive(CLAY_STRING(\"HTML Renderer\"), 0);\n ", "repo": "nicbarker/clay", "span_codepoints": 64, "start": 24730, "suffix": "\n }\n }\n }\n }\n}\n\nvoid RendererPageMobile() {\n CLAY(CLAY_ID(\"RendererMobile\"), { .layout = { .layoutDirection = CLAY_TOP_TO_BOTTOM, .sizing = { CLAY_SIZING_GROW(0), CLAY_SIZING_FIT(.min = windowHeight - 50) }, .childAli", "target": " RendererButtonActive(CLAY_STRING(\"Canvas Renderer\"));"} {"bin": "32_token_ish", "content_sha256": "412b98dd4784b2e2ddbd8291fd29bf324cdc15c9d99f415ba201d43125e3d5e4", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown-ocr/tests/test_xlsx_converter.py", "end": 6335, "example_id": "001018d16a4c9b4305194d91ba467b48f789c6c28fa477e25524287f624739f2", "language": "python", "prefix": "--------------------------------------------\n# xlsx_complex_layout.xlsx\n# ---------------------------------------------------------------------------\n\n\ndef test_xlsx_complex_layout(svc: MockOCRService) -> None:\n expected = (\n \"## Complex Report\\n", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 6207, "suffix": " |\\n\"\n \"| Jan | 1000 |\\n\"\n \"| Feb | 1200 |\\n\"\n \"| NaN | NaN |\\n\"\n \"| Total | 2200 |\\n\\n\"\n \"### Images in this sheet:\\n\\n\"\n \"*[Image OCR]\\nMOCK_OCR_TEXT_12345\\n[End OCR]*\\n\\n\"\n \"*[Image OCR]\\nMOCK_OCR_TEXT_12", "target": "\\n\"\n \"| Annual Report 2024 | Unnamed: 1 |\\n\"\n \"| --- | --- |\\n\"\n \"| NaN | NaN |\\n\"\n \"| Month | Sales"} {"bin": "16_token_ish", "content_sha256": "484e503fcb815524b23c61ae6a3c74d86ade5f21fae906a41317ec2f8925fb88", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/__tests__/remove.test.ts", "end": 13558, "example_id": "001019ad53e55f05ca0251ebabb227cb12c5b27aa10c84a82ae120bde7e4b5b6", "language": "typescript", "prefix": "xpect(mockCheckboxWithHover.mock.calls[0]?.[0]).toMatchObject({\n message: \"Which agents do you want to remove Context7 setup from?\",\n choices: [{ name: \"Cursor\", value: \"cursor\" }],\n });\n });\n\n test(\"does not prompt when no Context7 setup is", "repo": "upstash/context7", "span_codepoints": 64, "start": 13494, "suffix": "\"), { recursive: true });\n await writeFile(join(tempDir, \".gemini\", \"settings.json\"), \"{}\", \"utf-8\");\n\n await runCommand(\"remove\", \"--project\");\n\n expect(mockCheckboxWithHover).not.toHaveBeenCalled();\n expect(logOutput.some((line) => line.inclu", "target": " detected\", async () => {\n await mkdir(join(tempDir, \".gemini"} {"bin": "8_token_ish", "content_sha256": "6dd2c037cc1d25fac0ad0cb5b34fa9563d91824c0816bf2f0f999ef8e100fa29", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:python-book/src/ch06-enums-and-pattern-matching.md", "end": 6033, "example_id": "00103062bb4490c28b9925aff1a4c564036a7fe7ba014643c7ef757c5cc33111", "language": "markdown", "prefix": "g\"),\n t => println!(\"normal: {t}°\"),\n}\n\n// Nested destructuring\nlet point = (3, (4, 5));\nmatch point {\n (0, _) => println!(\"on y-axis\"),\n (_, (0, _)) => println!(\"y=0\"),\n (x, (y, z)) => println!(\"x={x}, y={y}, z={z}\"),\n}\n```\n\n***\n\n## Option for", "repo": "microsoft/RustTraining", "span_codepoints": 32, "start": 6001, "suffix": " most important Rust enum for Python developers. It replaces\n`None` with a type-safe alternative.\n\n### Python None\n\n```python\n# Python — None is a value that can appear anywhere\ndef find_user(user_id: int) -> dict | None:\n users = {1: {\"name\": \"Alice\"}}", "target": " None Safety\n\n`Option` is the"} {"bin": "64_token_ish", "content_sha256": "6014e167980b968d6f11883c295e39b3693dc97065f3ed05d28088dec8bd8813", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:examples/integrations/slack/README.md", "end": 854, "example_id": "001047c1b5ef332430b5d2419fb02df21f6846bc4293a414d8b1ce18b3ab0d54", "language": "markdown", "prefix": ". Configure the Bot:\n * Navigate to the \"OAuth & Permissions\" tab on the left side of the screen.\n * Under \"Scopes\", add the necessary bot token scopes (add these \"chat:write\", \"channels:history\", \"im:history\").\n3. Enable Event Subscriptions:\n ", "repo": "browser-use/browser-use", "span_codepoints": 256, "start": 598, "suffix": "ngrok](#installing-and-starting-ngrok).\n * **Note:** The URL provided by ngrok is ephemeral and will change each time ngrok is started. You will need to update the request URL in the bot's settings each time you restart ngrok. [See how to update the r", "target": " * Navigate to the \"Event Subscriptions\" tab.\n * Enable events and add the necessary bot events (add these \"message.channels\", \"message.im\").\n * Add your request URL (you can use ngrok to expose your local server if needed). [See how to set up "} {"bin": "8_token_ish", "content_sha256": "5ba9751758fb1bc539c7c05bbd895fbe5c793695efde967888190ccbdbaa0ca5", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/core/test_storage_core.py", "end": 5561, "example_id": "00104f00e106b3da7ad234bc8083cf8b412edc42e5f2dd5e6eb82f023bcfe6e1", "language": "python", "prefix": "h instances share the same DB\n with tempfile.NamedTemporaryFile(suffix='.db', delete=False) as tmp:\n db_path = tmp.name\n\n try:\n storage_a = SQLiteStorageSystem(storage_file=db_path, url=\"https://site-a.com\")\n ", "repo": "D4Vinci/Scrapling", "span_codepoints": 32, "start": 5529, "suffix": " storage_a.save(element, \"shared-id\")\n\n SQLiteStorageSystem.cache_clear()\n StorageSystemMixin._get_base_url.cache_clear()\n\n storage_b = SQLiteStorageSystem(storage_file=db_path, url=\"https://site-b.com\")\n ", "target": "element = self._make_element()\n "} {"bin": "16_token_ish", "content_sha256": "052d859eda206385b608aba621784a7ef7dce0e689a5dcc6b9f45f7aed596e76", "document_id": "cloudwego/eino@ca0441ac0bceed8945dcf7d5a18c237c924c6aa8:adk/interrupt_test.go", "end": 52997, "example_id": "00105a35cc02e2e00b89c1cbc5f2c3d65e260aaa89a0ee9c9e78e9988b4f7237", "language": "go", "prefix": "rAgent\")\n\t}\n\n\t// Now resume the interrupt\n\tinterruptID := interruptCtx.ID\n\titer, err = runner.ResumeWithParams(ctx, \"nested-agent-test-1\", &ResumeParams{\n\t\tTargets: map[string]any{\n\t\t\tinterruptID: \"resume inner tool\",\n\t\t},\n\t})\n\tassert.NoError(t, err)\n\n\t// ", "repo": "cloudwego/eino", "span_codepoints": 64, "start": 52933, "suffix": "\n\tfor {\n\t\tevent, ok := iter.Next()\n\t\tif !ok {\n\t\t\tbreak\n\t\t}\n\t\tfinalEvents = append(finalEvents, event)\n\t}\n\n\t// Verify completion events\n\tassert.Greater(t, len(finalEvents), 0, \"should have completion events after resume\")\n\n\t// Check that we get the expected", "target": "Collect final events after resume\n\tvar finalEvents []*AgentEvent"} {"bin": "32_token_ish", "content_sha256": "67f12660b2279922adcefd6c112b851830dc1d9b2c9f240b190c849d33e837b3", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:pi-extension/index.js", "end": 3079, "example_id": "001079c52fd8d54100d0e6f30347ae100a102f9fd00a9a8731bf81dac35b9fdf", "language": "javascript", "prefix": "ch { return; }\n if (currentMode === \"off\") {\n c.ui.setStatus(\"ponytail\", \"\");\n return;\n }\n const levelIcons = { lite: \"🌿\", full: \"⚡\", ultra: \"🔥\" };\n const icon = levelIcons[currentMode] || \"\";\n const label = currentMode.toUpperCase", "repo": "DietrichGebert/ponytail", "span_codepoints": 128, "start": 2951, "suffix": "\" 🐴 \" + theme.fg(\"muted\", \"ponytail: \") + theme.fg(\"text\", icon + \" \" + label));\n }\n\n const setMode = (mode, ctx) => {\n const normalized = normalizePersistedMode(mode);\n if (!normalized) return;\n\n currentMode = normalized;\n pi.appendEntry(\"po", "target": "();\n const indicator = isActive ? theme.fg(\"accent\", \"●\") : theme.fg(\"dim\", \"○\");\n c.ui.setStatus(\"ponytail\", indicator + "} {"bin": "32_token_ish", "content_sha256": "6799887379de0dcc229a02897ab44d1ad774b2cbe6ce7cad59832e42feb0129c", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:internal/hub/heartbeat/heartbeat_test.go", "end": 1707, "example_id": "0010846961a0df3b49690ee5f03848a20e2850e1a8428ad1fb610bfcdaef1fb1", "language": "go", "prefix": "qual(t, http.MethodHead, cfg.Method)\n\t})\n}\n\nfunc TestSendGETDoesNotRequireAppOrDB(t *testing.T) {\n\tapp := newTestHub(t)\n\tserver := httptest.NewServer(http.HandlerFunc(func(w http.ResponseWriter, r *http.Request) {\n\t\tassert.Equal(t, http.MethodGet, r.Method", "repo": "henrygd/beszel", "span_codepoints": 128, "start": 1579, "suffix": "hb := heartbeat.New(app.App, envGetter(map[string]string{\n\t\t\"HEARTBEAT_URL\": server.URL,\n\t\t\"HEARTBEAT_METHOD\": \"GET\",\n\t}))\n\trequire.NotNil(t, hb)\n\n\trequire.NoError(t, hb.Send())\n}\n\nfunc TestSendReturnsErrorOnHTTPFailureStatus(t *testing.T) {\n\tapp := new", "target": ")\n\t\tassert.Equal(t, \"Beszel-Heartbeat\", r.Header.Get(\"User-Agent\"))\n\t\tw.WriteHeader(http.StatusOK)\n\t}))\n\tdefer server.Close()\n\n\t"} {"bin": "16_token_ish", "content_sha256": "e61fd206814e0fb6c5e1c09ab716e41a85f07167bb2394fdb05465ac5cf6f512", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:src/core/parsers/requirement-blocks.ts", "end": 8243, "example_id": "0010878c7563e7c2ab78963c7e6372310f322f0d0a4ba41e94ed21b4563183aa", "language": "typescript", "prefix": "[], fenceMask: [], bodyStartLine: 0 };\n\nfunction getSectionCaseInsensitive(\n sections: Record,\n desired: string\n): { title: string; body: SectionBody; bodyStartLine: number; found: boolean } {\n const target = desired.toLowerCase();\n", "repo": "Fission-AI/OpenSpec", "span_codepoints": 64, "start": 8179, "suffix": " (title.toLowerCase() === target) {\n return { title, body, bodyStartLine: body.bodyStartLine, found: true };\n }\n }\n return { title: desired, body: EMPTY_SECTION_BODY, bodyStartLine: 0, found: false };\n}\n\nfunction parseRequirementBlocksFromSection", "target": " for (const [title, body] of Object.entries(sections)) {\n if"} {"bin": "16_token_ish", "content_sha256": "cc24a697183b7d609f0b05997f0dc4b1909083a1caea5164318153da88e88591", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/evaluate_tasks.py", "end": 7947, "example_id": "0010896df50b17f72bfee47fba9d6423c9ea15e1c174ab1c6565b6efc9278ba8", "language": "python", "prefix": " be the last line that starts with {)\n\t\t\t\t\tlines = stdout_text.split('\\n')\n\t\t\t\t\tjson_line = None\n\t\t\t\t\tfor line in reversed(lines):\n\t\t\t\t\t\tline = line.strip()\n\t\t\t\t\t\tif line.startswith('{') and line.endswith('}'):\n\t\t\t\t\t\t\tjson_line = line\n\t\t\t\t\t\t\tbreak\n\n\t\t\t\t\tif", "repo": "browser-use/browser-use", "span_codepoints": 64, "start": 7883, "suffix": "PARENT] Task {os.path.basename(task_file)} completed: {result[\"success\"]}')\n\t\t\t\t\telse:\n\t\t\t\t\t\traise ValueError(f'No JSON found in output: {stdout_text}')\n\n\t\t\t\texcept (json.JSONDecodeError, ValueError) as e:\n\t\t\t\t\tresult = {\n\t\t\t\t\t\t'file': os.path.basename(tas", "target": " json_line:\n\t\t\t\t\t\tresult = json.loads(json_line)\n\t\t\t\t\t\tprint(f'["} {"bin": "64_token_ish", "content_sha256": "437971d89670725cdf6387d52fa4fffac3d42a8085d9ba12c8a160cd869a1ea7", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/agent/system_prompts/system_prompt_no_thinking.md", "end": 10575, "example_id": "001093ab5340567840dc746ed481e2a85876dc57ca6d826c56803b291499add8", "language": "markdown", "prefix": "rue` only if the full USER REQUEST has been completed with no missing components.\n- If any part of the request is missing, incomplete, or uncertain, set `success` to `false`.\n- You can use the `text` field of the `done` action to communicate your findings ", "repo": "browser-use/browser-use", "span_codepoints": 256, "start": 10319, "suffix": "the user and fulfill the USER REQUEST.\n- You are ONLY ALLOWED to call `done` as a single action. Don't call it together with other actions.\n- If the user asks for specified format, such as \"return JSON with following structure\", \"return a list of format...", "target": "and `files_to_display` to send file attachments to the user, e.g. `[\"results.md\"]`.\n- Put ALL the relevant information you found so far in the `text` field when you call `done` action.\n- Combine `text` and `files_to_display` to provide a coherent reply to "} {"bin": "32_token_ish", "content_sha256": "bff1a37c65382e95aaf6b69ce0941b4fb00e070421ae28b386642f1d79cb78fd", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/mcp/src/index.ts", "end": 5345, "example_id": "00109d4dab4c3c4e04c3c20cc44af10d8c411b3aa44ba5cf3218aedd7efa36fd", "language": "typescript", "prefix": "ontext7-compatible library ID and returns matching libraries.\n\nYou MUST call this function before 'Query Documentation' tool to obtain a valid Context7-compatible library ID UNLESS the user explicitly provides a library ID in the format '/org/project' or '", "repo": "upstash/context7", "span_codepoints": 128, "start": 5217, "suffix": "\n- Name: Library or package name\n- Description: Short summary\n- Code Snippets: Number of available code examples\n- Source Reputation: Authority indicator (High, Medium, Low, or Unknown)\n- Benchmark Score: Quality indicator (100 is the highest score)\n- Vers", "target": "/org/project/version' in their query.\n\nEach result includes:\n- Library ID: Context7-compatible identifier (format: /org/project)"} {"bin": "64_token_ish", "content_sha256": "fba7f4080f31b16dc86517fd452cefa8f10e1dc3391cadffe4df598b627b2c06", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:examples/rag_dynamic_tools_multi_turn/src/main.rs", "end": 1400, "example_id": "0010a500e3bdd2ec5f819bc79ad33b26884142dbad16cbd86fce0072772bd7b6", "language": "rust", "prefix": "pe\": \"object\",\n \"properties\": {\n \"x\": {\n \"type\": \"number\",\n \"description\": \"The first number to add\"\n },\n \"y\": {\n \"type\": \"number\",\n ", "repo": "0xPlaygrounds/rig", "span_codepoints": 256, "start": 1144, "suffix": " let result = args.x + args.y;\n Ok(result)\n }\n}\n\nimpl ToolEmbedding for Add {\n type InitError = InitError;\n type Context = ();\n type State = ();\n\n fn init(_state: Self::State, _context: Self::Context) -> Result Result {\n "} {"bin": "64_token_ish", "content_sha256": "c77c5e7eee15947f2b77a436630d5fbea8573d53894881b75d12f160d001fa81", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/parser/test_parser_advanced.py", "end": 5973, "example_id": "0010b56baa8d24849c5fbdabb3d2a0a830dbb20e301c0301506219c26938b1bd", "language": "python", "prefix": "ext operation edge cases\"\"\"\n page = Selector(complex_html)\n\n # get_all_text with a custom separator\n text = page.get_all_text(separator=\" | \", strip=True)\n assert \" | \" in text\n\n # Ignore specific tags\n text = page", "repo": "D4Vinci/Scrapling", "span_codepoints": 256, "start": 5717, "suffix": "\"\"Test get_all_text preserves interleaved text nodes\"\"\"\n html = \"\"\"\n \n \n
\n string1\n string2\n string3\n
\n strin", "target": ".get_all_text(ignore_tags=(\"table\",))\n assert \"Cell\" not in text\n\n # With empty values\n text = page.get_all_text(valid_values=False)\n assert text != \"\"\n\n def test_get_all_text_preserves_interleaved_text_nodes(self):\n \""} {"bin": "32_token_ish", "content_sha256": "8ae91557828e8597f00437dbbb71227e676e152c94bbd03804aee6a1bcaa4987", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/hooks/pre_commit_hooks/check_merge_conflict.rs", "end": 1450, "example_id": "0010cddbfb65dd7cdee70202b69ecb5b0986a2ceec789acd74c65387045721b2", "language": "rust", "prefix": "rge().await? {\n return Ok((0, Vec::new()));\n }\n\n run_concurrent_file_checks(\n hook_filenames(&args.filenames, filenames),\n *INTERNAL_CONCURRENCY,\n |filename| check_file(hook.project().relative_path(), filename),\n )\n ", "repo": "j178/prek", "span_codepoints": 128, "start": 1322, "suffix": " let git_dir = get_git_dir().await?;\n\n // Check if MERGE_MSG exists\n let merge_msg_exists = git_dir.join(\"MERGE_MSG\").exists();\n if !merge_msg_exists {\n return Ok(false);\n }\n\n // Check if any of the merge state files exist\n Ok(git", "target": ".await\n}\n\nasync fn is_in_merge() -> Result {\n // Change directory temporarily or ensure we're in the right directory\n "} {"bin": "16_token_ish", "content_sha256": "1464727b468edad013b66218177cde58abe400f28eaa640e2b6b2e3ecb972d97", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:tests/fuzz/rescore-interleave.c", "end": 4321, "example_id": "0010ddfcdde5295b197feb0a39fc8d17c47cd7810d450593af055050d84f4943", "language": "c", "prefix": "RT then immediately UPDATE same row (stresses blob lifecycle) */\n float vec1[16] = {0};\n float vec2[16] = {0};\n for (int j = 0; j < 16 && i < size; j++, i++) {\n vec1[j] = (float)((int8_t)data[i]) / 10.0f;\n vec2[j] = -", "repo": "asg017/sqlite-vec", "span_codepoints": 64, "start": 4257, "suffix": "\n sqlite3_reset(stmtInsert);\n sqlite3_bind_int64(stmtInsert, 1, rowid);\n sqlite3_bind_blob(stmtInsert, 2, vec1, sizeof(vec1), SQLITE_TRANSIENT);\n if (sqlite3_step(stmtInsert) == SQLITE_DONE) {\n /* Only update if insert ", "target": "vec1[j]; /* opposite direction */\n }\n /* Insert */"} {"bin": "64_token_ish", "content_sha256": "3b9cfbe86bc2af4f7f23042e60eaccf5e8d9df866d8a35a77d00672eab5202e6", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/_base_converter.py", "end": 4216, "example_id": "0010f4fb7afff403ae4627348a9d842e11de13722c6ad846b5e7b16d0a745bac", "language": "python", "prefix": " \"\"\"\n Convert a document to Markdown text.\n\n Parameters:\n - file_stream: The file-like object to convert. Must support seek(), tell(), and read() methods.\n - stream_info: The StreamInfo object containing metadata about the ", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 3960, "suffix": " - FileConversionException: If the mimetype is recognized, but the conversion fails for some other reason.\n - MissingDependencyException: If the converter requires a dependency that is not installed.\n \"\"\"\n raise NotImplementedErr", "target": "file (mimetype, extension, charset, etc.)\n - kwargs: Additional keyword arguments for the converter.\n\n Returns:\n - DocumentConverterResult: The result of the conversion, which includes the title and markdown content.\n\n Raises:\n "} {"bin": "8_token_ish", "content_sha256": "99dcbd6daea3baef0e12a72e2b7b847ba9350f06fd8e35d70e80f7b93e66fc2e", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/spiders/session.py", "end": 475, "example_id": "001123441bc583bc38a365b1371b033ab9f3ca9f4c2a875186daa767472ac4ca", "language": "python", "prefix": "rom scrapling.core._types import Set, cast, SUPPORTED_HTTP_METHODS\nfrom scrapling.fetchers import AsyncDynamicSession, AsyncStealthySession, FetcherSession\n\nSession = FetcherSession | AsyncDynamicSession | AsyncStealthySession\n\n\nclass SessionManager:\n \"", "repo": "D4Vinci/Scrapling", "span_codepoints": 32, "start": 443, "suffix": " instances.\"\"\"\n\n def __init__(self) -> None:\n self._sessions: dict[str, Session] = {}\n self._default_session_id: str | None = None\n self._started: bool = False\n self._lazy_sessions: Set[str] = set()\n self._lazy_lock = ", "target": "\"\"Manages pre-configured session"} {"bin": "64_token_ish", "content_sha256": "a4cb101371d1dc25246d0a71f0c6e85ec2291d0c3c9fa0a9dbaf267bc5f38914", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown-ocr/src/markitdown_ocr/_pptx_converter_with_ocr.py", "end": 7180, "example_id": "0011266d94ac1e83ad73cee0562fb21e2d1198ee30d8470244ae49e97e20fa0f", "language": "python", "prefix": "picture(self, shape):\n if shape.shape_type == pptx.enum.shapes.MSO_SHAPE_TYPE.PICTURE:\n return True\n if shape.shape_type == pptx.enum.shapes.MSO_SHAPE_TYPE.PLACEHOLDER:\n if hasattr(shape, \"image\"):\n return", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 6924, "suffix": " html_table = \"\"\n first_row = True\n for row in table.rows:\n html_table += \"\"\n for cell in row.cells:\n if first_row:\n html_table += \"
\" + html.escape(cell", "target": " True\n return False\n\n def _is_table(self, shape):\n if shape.shape_type == pptx.enum.shapes.MSO_SHAPE_TYPE.TABLE:\n return True\n return False\n\n def _convert_table_to_markdown(self, table, **kwargs):\n import html\n\n"} {"bin": "8_token_ish", "content_sha256": "0d2185d967bbbf3092237c9858b4a0d0fe5a03b7b6347bdbf1b15e7b1ea492f9", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/hooks/pre_commit_hooks/requirements_txt_fixer.rs", "end": 11613, "example_id": "001130bbc456d4d9e2b534c6b65c21a1183b3ff94f32fdc46a063eda132e2bde", "language": "rust", "prefix": " (\n b\"foo\\npkg-resources==0.0.0\\nbar\\n\",\n b\"bar\\nfoo\\n\",\n ),\n (\n b\"bar\\npkg_resources==0.0.0\\nfoo\\n\",\n b\"bar\\nfoo\\n\",\n ),\n (\n b\"foo\\npkg", "repo": "j178/prek", "span_codepoints": 32, "start": 11581, "suffix": " b\"bar\\nfoo\\n\",\n ),\n (\n b\"git+ssh://git_url@tag#egg=ocflib\\nDjango\\nijk\\n\",\n b\"Django\\nijk\\ngit+ssh://git_url@tag#egg=ocflib\\n\",\n ),\n (\n b\"b==1.0.0\\nc=2.0.0 ", "target": "_resources==0.0.0\\nbar\\n\",\n "} {"bin": "16_token_ish", "content_sha256": "90368b23c0d0ca8bb0d2fc007c86100de630857bd2934d5a9254402095b039c6", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_cu_converter.py", "end": 1526, "example_id": "0011403413e0214462eec9652e1d87dba9c43f2c0bc5c963fa3d8c3da12c0146", "language": "python", "prefix": "lass TokenCredential: # type: ignore[no-redef]\n pass\n\n class ContentUnderstandingClient: # type: ignore[no-redef]\n pass\n\n class UserAgentPolicy: # type: ignore[no-redef]\n pass\n\n class DefaultAzureCredential: # type: ignore", "repo": "microsoft/markitdown", "span_codepoints": 64, "start": 1462, "suffix": " # type: ignore[no-redef]\n pass\n\n\n# ---------------------------------------------------------------------------\n# File type enum and routing tables\n# ---------------------------------------------------------------------------\n\n\nclass ContentUndersta", "target": "[no-redef]\n pass\n\n def to_llm_input(*args, **kwargs): "} {"bin": "64_token_ish", "content_sha256": "08627035eea96b25c22866667d6a9dba8ee9c7094d1da26da90ce4e645a6c6f6", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/__tests__/github.test.ts", "end": 4030, "example_id": "00114ed6c2f43572f16e856c5e8c20561d1e208fc2634d65a7a6ba9e76ca8118", "language": "typescript", "prefix": "n((url: string) => {\n if (url.includes(\"api.github.com\")) {\n return Promise.resolve({\n ok: true,\n json: () =>\n Promise.resolve({\n sha: \"s\",\n truncated: false,\n ", "repo": "upstash/context7", "span_codepoints": 256, "start": 3774, "suffix": " {\n type: \"blob\",\n path: \"plugins/codex/context7/skills/context7-mcp/references/guide.md\",\n },\n ],\n }),\n });\n }\n return Promise.resolve({", "target": "tree: [\n { type: \"tree\", path: \"plugins/codex/context7/skills/context7-mcp\" },\n {\n type: \"blob\",\n path: \"plugins/codex/context7/skills/context7-mcp/SKILL.md\",\n },\n "} {"bin": "16_token_ish", "content_sha256": "5308ec899ac988a3e5b27c4735c528027023dd4b5b7d58811cdb19b16d1eb657", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/mido.sh", "end": 20243, "example_id": "00114f14bddbc0cb40a9cb7f236ba5aa6b64abb940b73481dd95b3022e7e0526", "language": "shell", "prefix": "meout=30 \\\n --no-http-keep-alive --output-file=\"$log\"\n local rc=$?\n } || :\n\n if (( rc != 0 )); then\n\n local reason\n reason=$(sed -n \\\n -e 's/^wget: //p' \\\n -e 's/^[0-9-]\\{10\\} [0-9:]\\{8\\} ERROR //p' \\\n \"$log\" | tail -n 1)\n\n ", "repo": "dockur/windows", "span_codepoints": 64, "start": 20179, "suffix": " error \"$msg because the file could not be written (disk full?).\"\n elif [ -n \"$reason\" ]; then\n error \"$msg: ${reason%.}.\"\n else\n error \"$msg with exit status $rc.\"\n fi\n\n rm -f \"$log\"\n return 1\n fi\n\n rm -f \"$log\"\n\n if [[ \"$", "target": " msg=\"Failed to download $catalog\"\n\n if (( rc == 3 )); then\n"} {"bin": "8_token_ish", "content_sha256": "351fad53d9e0661c25cd3b4e6d9b3a6f281b9bad45046ce3e7c67d425c4421d3", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/test_module_misc.py", "end": 14809, "example_id": "001150863a4583343d8b06e32a78a638cba0a80a79be3feead61468b20d5189a", "language": "python", "prefix": "taining the target rlink file\n rlink_tmp_dir = os.path.abspath(os.sep + \"tmp\")\n\n # Ensure the tmp directory exists\n if not os.path.exists(rlink_tmp_dir):\n pytest.skip(f\"Skipping rlink test; {rlink_tmp_dir} directory does not exist.\")\n ", "repo": "microsoft/markitdown", "span_codepoints": 32, "start": 14777, "suffix": "os.path.join(rlink_tmp_dir, \"test_rlink.txt\")\n rlink_content = \"de658225-569e-4e3d-9ed2-cfb6abf927fc\"\n b64_prefix = (\n \"ZGU2NTgyMjUtNTY5ZS00ZTNkLTllZDItY2ZiNmFiZjk\" # base64 prefix of rlink_content\n )\n\n if os.path.exists(rlink_file_path", "target": " return\n\n rlink_file_path = "} {"bin": "32_token_ish", "content_sha256": "7f6bee86702a488d29ef0dcaabf424bbe2aca345a6a642319d43a1fe0276792e", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:hooks/ponytail-subagent.js", "end": 1151, "example_id": "00116b973a04d6e807c0f22e8fea40a4ec02e9912baeff7eef9d2c61aaa13161", "language": "javascript", "prefix": " = readMode();\n\n// Absent flag or off → ponytail isn't active; inject nothing.\nif (!mode || mode === 'off') {\n process.exit(0);\n}\n\nfunction inject() {\n try {\n writeHookOutput('SubagentStart', mode, getPonytailInstructions(mode));\n } catch (e) {\n /", "repo": "DietrichGebert/ponytail", "span_codepoints": 128, "start": 1023, "suffix": " treat it as \"no matcher\" and inject.\nlet matcherRe = null;\ntry {\n if (process.env.PONYTAIL_SUBAGENT_MATCHER) {\n matcherRe = new RegExp(process.env.PONYTAIL_SUBAGENT_MATCHER, 'i');\n }\n} catch (e) {\n matcherRe = null;\n}\n\n// No matcher → keep the origi", "target": "/ Silent fail — a stdout error at hook exit must not surface as a hook failure.\n }\n}\n\n// A bad regex must never crash the hook;"} {"bin": "8_token_ish", "content_sha256": "6d68e8dfe205354718729a5f5c9ca9d555a045af6b2cbbc3b6a84caad1076df7", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:src/plugins/opencode/plugin.js", "end": 5341, "example_id": "001171fa3699b63afdd14afd49f81b49e400edfcafc330fe668ee2c31b10e687", "language": "javascript", "prefix": "ation so \"stop talking\n // like caveman\" doesn't trip the activation regex.\n if (/\\b(stop|disable|deactivate|turn off)\\b.*\\bcaveman\\b/i.test(prompt) ||\n /\\bcaveman\\b.*\\b(stop|disable|deactivate|turn off)\\b/i.test(prompt) ||\n /\\bnormal mode\\b/i.", "repo": "JuliusBrussee/caveman", "span_codepoints": 32, "start": 5309, "suffix": ";\n }\n\n // Expanded /caveman command template. opencode replaces a typed\n // \"/caveman \" with the command file's body (\"Activate caveman\n // mode: $ARGUMENTS ...\") before chat.message fires, so the literal\n // slash-command branch below never se", "target": "test(prompt)) {\n return 'off'"} {"bin": "8_token_ish", "content_sha256": "0b42de52d3ca7ee8f1ac6e35f004a5433d41df91a2c12aeff738604dd8129ec5", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/setup/agents.ts", "end": 7574, "example_id": "001173d6c110c6b2a439a0ec9dafc5d9454bc731441bee75b844523554ed1221", "language": "typescript", "prefix": " },\n detect: {\n projectPaths: [\".agent\"],\n globalPaths: [join(homedir(), \".gemini\", \"antigravity\"), join(homedir(), \".agent\")],\n },\n },\n\n gemini: {\n name: \"gemini\",\n displayName: \"Gemini CLI\",\n mcp: {\n projectPaths: [join(\".", "repo": "upstash/context7", "span_codepoints": 32, "start": 7542, "suffix": " globalPaths: [join(homedir(), \".gemini\", \"settings.json\")],\n configKey: \"mcpServers\",\n buildEntry: (auth, transport) =>\n transport === \"stdio\" ? stdioEntry(auth) : withHeaders({ httpUrl: mcpUrl(auth) }, auth),\n },\n rule: {\n ki", "target": "gemini\", \"settings.json\")],\n "} {"bin": "32_token_ish", "content_sha256": "d5426d932b8f49c499da40a69b8b75b3f66055136cc701832bb40b9d33221fd6", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown-ocr/src/markitdown_ocr/_pdf_converter_with_ocr.py", "end": 4116, "example_id": "001174d6f46e4bebcb0d71696bb6ab44395b6d7a86c3692ae8da331ebcc90ab1", "language": "python", "prefix": " # Save to stream\n img_stream = io.BytesIO()\n page_img.original.save(img_stream, format=\"PNG\")\n img_stream.seek(0)\n\n if img_stream:\n images_info.append(\n ", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 3988, "suffix": "}_img_{i}\",\n \"y_pos\": y_pos,\n }\n )\n\n except Exception:\n continue\n\n except Exception:\n pass\n\n return images_info\n\n\nclass PdfConverterWithOCR(Document", "target": " {\n \"stream\": img_stream,\n \"name\": f\"page_{page.page_number"} {"bin": "16_token_ish", "content_sha256": "9a3dd7879415651a061d217594d4ea9f985b2e3903c1b65cf03099cdb94dc49b", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:crates/rig-core/src/providers/openai/embedding.rs", "end": 9771, "example_id": "0011757307d50656b20d5ccc0d3a6db50a60dcca7f00ca4f0ed9a76f1693928d", "language": "rust", "prefix": " let embeddings = response\n .data\n .into_iter()\n .zip(documents.into_iter())\n .map(|(embedding, document)| embeddings::Embedding {\n ", "repo": "0xPlaygrounds/rig", "span_codepoints": 64, "start": 9707, "suffix": " .embedding\n .into_iter()\n .filter_map(|n| n.as_f64())\n .collect(),\n })\n .collect();\n\n ", "target": " document,\n vec: embedding\n "} {"bin": "16_token_ish", "content_sha256": "7000df0736f3a24cf0df420bfcb8d389157fe73611bb5844c544bd7fc6fba98e", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/input-otp.tsx", "end": 1410, "example_id": "0011762a13421d481f333ff1c50d73eeacc8a0ad790d669f49cc1f6c5db1edff", "language": "typescript", "prefix": "lot({\n index,\n className,\n ...props\n}: React.ComponentProps<\"div\"> & {\n index: number\n}) {\n const inputOTPContext = React.useContext(OTPInputContext)\n const { char, hasFakeCaret, isActive } = inputOTPContext?.slots[index] ?? {}\n\n return (\n {\n const helper = requireCjs(path.join(REPO_ROOT, 'bin', 'lib', 'openclaw.js'));\n const dir = freshTmpDir();\n const soul = path.join(dir, 'SOUL.md');\n "} {"bin": "32_token_ish", "content_sha256": "e83d4c1dca2fcfb40d0817bb8684ad4f63dce33fa91a421b78c3a473f9fcf746", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:skills/cloud/references/guides/tools-integration.md", "end": 2520, "example_id": "0011d96dc0aa7bb5ff068ad4f5b84f520f74f3402b8487ff1b0847562c286358", "language": "markdown", "prefix": "r-use SKILL.md into the agent's context. The agent calls browser commands as shell tool invocations.\n\n```bash\nuv pip install 'browser-use[cli]'\n```\n\n**Core workflow** — the agent calls these commands one at a time, reading output between each:\n\n```bash\n# 1", "repo": "browser-use/browser-use", "span_codepoints": 128, "start": 2392, "suffix": "# Output: URL, title, list of clickable elements with indices\n# e.g. [0] \n# [1] \n# [2] About\n\n# 3. Interact — use indices from state\nbrowser-use input 0 \"sea", "target": ". Navigate\nbrowser-use open https://example.com\n\n# 2. Observe — ALWAYS run state first to get element indices\nbrowser-use state\n"} {"bin": "16_token_ish", "content_sha256": "dd0f5e21e02aed8cb8da5125455a35674a0844327cb9c394cdc8c9acebda36cb", "document_id": "steipete/agent-scripts@bb3688355a4c1894dd53b4ed867d1600918fadf0:skills/npm/scripts/npm-service.sh", "end": 1333, "example_id": "001226749b951b82deecf8b81a7fe5d53fdad2b08b799fad46e3c7ac7830965e", "language": "shell", "prefix": " ITEM=\"${2:?missing item}\"\n ITEM_EXPLICIT=1\n shift 2\n ;;\n --account)\n ACCOUNT=\"${2:?missing account}\"\n shift 2\n ;;\n -h | --help)\n usage\n exit 0\n ;;\n --)\n shift\n ARGS=(\"$@\")\n break\n ", "repo": "steipete/agent-scripts", "span_codepoints": 64, "start": 1269, "suffix": "\n\n# Desktop fallback keeps the legacy item name unless one was named explicitly.\nif [ -n \"$ACCOUNT\" ] && [ \"$ITEM_EXPLICIT\" -eq 0 ]; then\n ITEM=\"npmjs\"\nfi\n\nif [ \"${#ARGS[@]}\" -eq 0 ]; then\n usage >&2\n exit 2\nfi\nif [ -z \"${TMUX:-}\" ]; then\n echo \"refusi", "target": " ;;\n *)\n ARGS+=(\"$1\")\n shift\n ;;\n esac\ndone"} {"bin": "16_token_ish", "content_sha256": "45e0e0556f9efebd065a7e7043e2f043ba4a1e5ac5bc7bb0ec3ad01877b00fb4", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:openspec/work/simplify-context-and-workspace-model/slices/store-references/spec.md", "end": 5777, "example_id": "00123088296a2eaa77b74e9b41699ab4ed3546d733fa3871dfdf845442e6cc4b", "language": "markdown", "prefix": "oader.ts:271`), the\n index is assembled by an async core helper invoked from the command\n layer after root resolution, and passed into the (still-sync)\n generators as an input — no async-ification of the instruction\n loader. A registry that cannot ", "repo": "Fission-AI/OpenSpec", "span_codepoints": 64, "start": 5713, "suffix": "else: each declared reference indexes with a\n `reference_registry_unreadable` warning (fix:\n `openspec store doctor`).\n6. **The list is deduplicated, order-preserving, and budgeted like\n context.** A resolved store with zero specs indexes as an entry", "target": "be read or parsed at all degrades the\n same way as everything "} {"bin": "16_token_ish", "content_sha256": "50b7035847a157b1de8f79fcfedda8b0ef1a36a993ad2edb7c3b7d48236ecf3e", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:tests/fuzz/diskann-prune-direct.c", "end": 1647, "example_id": "001239d78659a3781262046f0483a37b33f25eda4ca354ae069ac33a8b3470aa", "language": "c", "prefix": "ic -- it's a public symbol. */\nextern int diskann_prune_select(\n const float *inter_distances, const float *p_distances,\n int num_candidates, float alpha, int max_neighbors,\n int *outSelected, int *outCount);\n\nstatic uint8_t fuzz_byte(const uint8_", "repo": "asg017/sqlite-vec", "span_codepoints": 64, "start": 1583, "suffix": "def;\n uint8_t b = **data;\n (*data)++;\n (*size)--;\n return b;\n}\n\nint LLVMFuzzerTestOneInput(const uint8_t *data, size_t size) {\n if (size < 8) return 0;\n\n /* Consume parameters from fuzz data */\n int num_candidates = fuzz_byte(&data, &size, 0) % 33; ", "target": "t **data, size_t *size, uint8_t def) {\n if (*size == 0) return "} {"bin": "32_token_ish", "content_sha256": "b0c2e7dbc7a768fb843fb80037bde82e6746cf7c4017e1c801f828cf827a45cc", "document_id": "modelcontextprotocol/java-sdk@fd004989b9484c9b81be6b03463396797b354804:mcp-test/src/main/java/io/modelcontextprotocol/client/AbstractMcpAsyncClientTests.java", "end": 2995, "example_id": "001253a9de11c83053bf12f0e99e7709c12c0ea3d481694a1c9fbc69e2595421", "language": "java", "prefix": "s.\n *\n * @author Christian Tzolov\n * @author Dariusz Jędrzejczyk\n */\npublic abstract class AbstractMcpAsyncClientTests {\n\n\tprivate static final String ECHO_TEST_MESSAGE = \"Hello MCP Spring AI!\";\n\n\tabstract protected McpClientTransport createMcpTransport();", "repo": "modelcontextprotocol/java-sdk", "span_codepoints": 128, "start": 2867, "suffix": "{\n\t\treturn Duration.ofSeconds(20);\n\t}\n\n\tMcpAsyncClient client(McpClientTransport transport) {\n\t\treturn client(transport, Function.identity());\n\t}\n\n\tMcpAsyncClient client(McpClientTransport transport, Function custo", "target": "\n\n\tprotected Duration getRequestTimeout() {\n\t\treturn Duration.ofSeconds(14);\n\t}\n\n\tprotected Duration getInitializationTimeout() "} {"bin": "32_token_ish", "content_sha256": "5beede9a668820885154cec341d94f0fc4705c81208e8acf92b61200a4cc9eec", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/test_module_vectors.py", "end": 6748, "example_id": "001281459e15f35f41fd93bc42c6c9f6170a14fbb7116782eef25bb9c68a8ae6", "language": "python", "prefix": "h open(os.path.join(TEST_FILES_DIR, test_vector.filename), \"rb\") as stream:\n result = markitdown.convert(\n stream, stream_info=stream_info, keep_data_uris=True, url=test_vector.url\n )\n\n for string in test_vector.must_include", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 6620, "suffix": " in result.markdown\n\n\nif __name__ == \"__main__\":\n \"\"\"Runs this file's tests from the command line.\"\"\"\n\n # General tests\n for test_function in [\n test_guess_stream_info,\n test_convert_local,\n test_convert_stream_with_hints,\n ", "target": ":\n assert string in result.markdown\n for string in test_vector.must_not_include:\n assert string not"} {"bin": "8_token_ish", "content_sha256": "795fe7db5dc234e3b2e008ebe3a1508b1640f35ec8988cffbc9587732a2a28b1", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:tests/providers/openrouter/cassette/agent_tool_sessions.rs", "end": 22157, "example_id": "001288f6149536d7eba52fad5c4525cc9168fae1a59b2c5c7e5b20bc10f8d043", "language": "rust", "prefix": " let response = model.completion(request).await?;\n let text = response\n .choice\n .iter()\n .filter_map(|content| match content {\n AssistantContent::Text(text) => Some(text", "repo": "0xPlaygrounds/rig", "span_codepoints": 32, "start": 22125, "suffix": " _ => None,\n })\n .collect::();\n\n assert_contains_all_case_insensitive(&text, &[\"teal\", ALPHA_SIGNAL_OUTPUT, \"canary\"]);\n anyhow::ensure!(\n response.usage.input_tokens > 0 && res", "target": ".text.as_str()),\n "} {"bin": "16_token_ish", "content_sha256": "7f33315d49ac2b5c3efc00ab25f4625e1827e7f9d10a354bfde347b632d880f4", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:openspec/work/simplify-context-and-workspace-model/slices/store-root-parity/plan.md", "end": 5695, "example_id": "00128bc12813e1566dd7971e14b61bac221d494590eb85d072a66c04eb6ec832", "language": "markdown", "prefix": " a missing or\nempty directory.\n\nExpected result:\n\n- The directory exists.\n- `.openspec-store/store.yaml` exists.\n- `openspec/config.yaml` exists with `schema: spec-driven`.\n- `openspec/specs/`, `openspec/changes/`, and\n `openspec/changes/archive/` exist.\n", "repo": "Fission-AI/OpenSpec", "span_codepoints": 64, "start": 5631, "suffix": ".\n- No initiative, workspace, agent, slash-command, or tool files are created.\n\n### Git-Only Setup\n\nA human has already run `git init` or cloned an empty repo, so the target folder\ncontains only `.git/`.\n\nExpected result:\n\n- Setup treats the folder as safe", "target": "- JSON `created_files` lists the relative paths created by setup"} {"bin": "64_token_ish", "content_sha256": "cc4c75125e4d49f4663a6bf5ee43baaed60b560bcdb2730b8d22dc55b10e31d3", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:tests/installer/hermes.test.mjs", "end": 2945, "example_id": "00129cfe094e56c4a9e981a34d0dbc75686059543fe114dfa5a687f7310184d1", "language": "javascript", "prefix": "{ recursive: true, force: true });\n }\n});\n\n// ── 2. Uninstall removes every skill we installed (regression guard for #524) ──\ntest('hermes uninstall removes all installed caveman skills (no orphans)', () => {\n const home = freshHome();\n try {\n const ", "repo": "JuliusBrussee/caveman", "span_codepoints": 256, "start": 2689, "suffix": " }\n\n const r2 = runInstaller(['--uninstall'], home);\n assert.notEqual(r2.status, 2);\n\n for (const name of SKILLS) {\n assert.equal(fs.existsSync(path.join(prod, name)), false, `${name} survived uninstall (orphaned skill)`);\n }\n } finally", "target": "r1 = runInstaller(['--only', 'hermes'], home);\n assert.notEqual(r1.status, 2);\n const prod = productivityDir(home);\n for (const name of SKILLS) {\n assert.ok(fs.existsSync(path.join(prod, name)), `precondition: ${name} should be installed`);\n "} {"bin": "8_token_ish", "content_sha256": "5308ec899ac988a3e5b27c4735c528027023dd4b5b7d58811cdb19b16d1eb657", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/mido.sh", "end": 19976, "example_id": "0012aeff706b9c9582839923e8008b57416199f02064c4a916f8ce9863b97e4f", "language": "shell", "prefix": "ailed to create directory \\\"$dir\\\" !\"\n return 1\n fi\n\n if ! log=$(mktemp -p \"$QEMU_DIR\"); then\n error \"Failed to create a temporary wget log.\"\n return 1\n fi\n\n {\n LC_ALL=C wget \"$catalog\" -O \"$dir/$file\" --no-verbose --timeout=30 \\\n --no", "repo": "dockur/windows", "span_codepoints": 32, "start": 19944, "suffix": "$log\"\n local rc=$?\n } || :\n\n if (( rc != 0 )); then\n\n local reason\n reason=$(sed -n \\\n -e 's/^wget: //p' \\\n -e 's/^[0-9-]\\{10\\} [0-9:]\\{8\\} ERROR //p' \\\n \"$log\" | tail -n 1)\n\n msg=\"Failed to download $catalog\"\n\n if (( rc == ", "target": "-http-keep-alive --output-file=\""} {"bin": "8_token_ish", "content_sha256": "96c7d7dfa1d78c78e511c69062a8eaa0ad654af338473162f90e4f932480cbe4", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/llm/groq/chat.py", "end": 1501, "example_id": "0012b03d3b185f411e245e383be02ec0007b358746fa9c1df5903ae3ba3a1ea5", "language": "python", "prefix": "odels = [\n\t'meta-llama/llama-4-maverick-17b-128e-instruct',\n\t'meta-llama/llama-4-scout-17b-16e-instruct',\n\t'openai/gpt-oss-20b',\n\t'openai/gpt-oss-120b',\n]\n\nToolCallingModels = [\n\t'moonshotai/kimi-k2-instruct',\n]\n\nT = TypeVar('T', bound=BaseModel)\n\nlogger =", "repo": "browser-use/browser-use", "span_codepoints": 32, "start": 1469, "suffix": "dataclass\nclass ChatGroq(BaseChatModel):\n\t\"\"\"\n\tA wrapper around AsyncGroq that implements the BaseLLM protocol.\n\t\"\"\"\n\n\t# Model configuration\n\tmodel: GroqVerifiedModels | str\n\n\t# Model params\n\ttemperature: float | None = None\n\tservice_tier: Literal['auto', ", "target": " logging.getLogger(__name__)\n\n\n@"} {"bin": "8_token_ish", "content_sha256": "f59731cc305b5fb24bb2ab683264f7859047fb9b52932ae7bd0efa5b2f708f6e", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:internal/hub/systems/system_manager.go", "end": 851, "example_id": "0012c5e62f46f158b0ed7f17ffe314be22bd5874dc69ef53c3f88d93f7668443", "language": "go", "prefix": "is offline or not responding\n\tpaused string = \"paused\" // System monitoring is paused\n\tpending string = \"pending\" // System is waiting on initial connection result\n\n\t// interval is the default update interval in milliseconds (60 seconds)\n\tinterval int = ", "repo": "henrygd/beszel", "span_codepoints": 32, "start": 819, "suffix": " // Debug interval for faster updates\n\n\t// sessionTimeout is the maximum time to wait for SSH connections\n\tsessionTimeout = 4 * time.Second\n)\n\n// errSystemExists is returned when attempting to add a system that already exists\nvar errSystemExists = errors.N", "target": "60_000\n\t// interval int = 10_000"} {"bin": "16_token_ish", "content_sha256": "6d68e8dfe205354718729a5f5c9ca9d555a045af6b2cbbc3b6a84caad1076df7", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:src/plugins/opencode/plugin.js", "end": 8831, "example_id": "0012cf5f0314e47d16e5ba436aa37e168fdc4c2db3bfc339cff2ff4013224b42", "language": "javascript", "prefix": "d' key is silently ignored. Routing session-init through\n // here means the flag is rewritten on every new session, not just once when\n // the plugin module loads. See https://opencode.ai/docs/plugins#events.\n event: async ({ event } = {}) => {\n if (", "repo": "JuliusBrussee/caveman", "span_codepoints": 64, "start": 8767, "suffix": ");\n },\n\n // Intercept user messages to detect /caveman commands and natural-language\n // mode toggles. opencode fires chat.message with (input, output) where\n // output.parts is the array of message parts; text parts carry .text.\n // Return value is i", "target": "event && event.type === 'session.created') handleSessionCreated("} {"bin": "64_token_ish", "content_sha256": "3deb31cd95b4579965e160d066e582a66ff9c21a50507ca5df735dc3abc1c162", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/msf/msf_parse.c", "end": 3832, "example_id": "0012d167bd1dc75e7e0e1045088c8f8bc71acf7ecfafc20d383a6aab2e385c9c", "language": "c", "prefix": "e {\n U64 super_map_off = OffsetOf(MSF_Header70, root_pn);\n directory_super_map = (U32 *) (msf_data.str + super_map_off);\n }\n \n U32 max_index_count_in_map_page = (page_size - directory_map_page_skip_size) / index_size;\n \n", "repo": "EpicGames/raddebugger", "span_codepoints": 256, "start": 3576, "suffix": "map_ptr;\n if (directory_map_page_index >= whole_file_page_count) {\n got_directory = 0;\n goto parse_directory_done;\n }\n \n U64 directory_map_page_off = ((U64) directory_map_page_index) * page_size;\n U8 *d", "target": " // for each index in super map ...\n U8 *out_ptr = directory_buf;\n U32 *super_map_ptr = directory_super_map;\n for (U32 i = 0; i < page_count_in_directory_map; ++i, ++super_map_ptr) {\n U32 directory_map_page_index = *super_"} {"bin": "32_token_ish", "content_sha256": "3641a863ac524478d70063e4487c16e17230c167d21d6ebdd2a738539d836a63", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/archive.rs", "end": 3137, "example_id": "0012d26a0199036fc74a1ec8a1be0d28d484b8a731fece290389064ba1e98042", "language": "rust", "prefix": " let Some(extension) = path.as_ref().extension().and_then(|ext| ext.to_str()) else {\n return Err(Error::UnsupportedArchive(path.as_ref().to_path_buf()));\n };\n\n match extension {\n \"zip\" => Ok(Self::Zip),\n \"", "repo": "j178/prek", "span_codepoints": 128, "start": 3009, "suffix": "\n \"txz\" => Ok(Self::TarXz),\n \"tlz\" => Ok(Self::TarLzma),\n \"gz\" if is_tar(path.as_ref()) => Ok(Self::TarGz),\n \"bz2\" if is_tar(path.as_ref()) => Ok(Self::TarBz2),\n \"xz\" if is_tar(path.as_ref()) => Ok(Sel", "target": "whl\" => Ok(Self::Zip), // Wheel files are zip files\n \"tgz\" => Ok(Self::TarGz),\n \"tbz\" => Ok(Self::TarBz2),"} {"bin": "64_token_ish", "content_sha256": "9cce25ab3ee66c778986fb598fec953558942da8af4f8fca27bf56e86e4af1ea", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:examples/apps/msg-use/scheduler.py", "end": 4518, "example_id": "0012d5b774bb151a3f244b9720bf7ca4b67dbb9c74098406a4fd2bbad59a4933", "language": "python", "prefix": "e}')\n\n\tllm = ChatGoogle(model='gemini-2.0-flash-exp', temperature=0.3, api_key=GOOGLE_API_KEY)\n\n\ttask = f\"\"\"\n\tSend WhatsApp message:\n\t1. Go to https://web.whatsapp.com\n\t2. Search for contact: {contact}\n\t3. Click on the contact\n\t4. Type message: {message}\n\t", "repo": "browser-use/browser-use", "span_codepoints": 256, "start": 4262, "suffix": "\n\t)\n\n\tagent = Agent(task=task, llm=llm, browser_session=browser)\n\tawait agent.run()\n\tprint(f'✅ Sent to {contact}')\n\n\nasync def auto_respond_to_unread():\n\t\"\"\"Click unread tab and respond to messages\"\"\"\n\tprint('\\nAuto-responding to unread messages...')\n\n\tllm", "target": "5. Press Enter to send\n\t6. Confirm sent\n\t\"\"\"\n\n\tbrowser = BrowserSession(\n\t\theadless=not args.debug, # headless=False only when debug=True\n\t\tuser_data_dir=str(USER_DATA_DIR),\n\t\tstorage_state=str(STORAGE_STATE_FILE) if STORAGE_STATE_FILE.exists() else None,"} {"bin": "32_token_ish", "content_sha256": "9afb82603add497b23b3fc1bda6166cca0f8459d3dc1eaf52e53a6c5bb07605d", "document_id": "cloudwego/eino@ca0441ac0bceed8945dcf7d5a18c237c924c6aa8:adk/failover_chatmodel_test.go", "end": 21373, "example_id": "0012d67eb6b5a577e8494b8b183e886f10e1fb198b251793a55b77e2098cbca7", "language": "go", "prefix": "age]) (model.BaseChatModel, []*schema.Message, error) {\n\t\t\t\treturn m1, nil, nil\n\t\t\t},\n\t\t}\n\n\t\tw := newFailoverModelWrapper[*schema.Message](&failoverProxyModel{}, cfg)\n\t\tctx := withTypedChatModelAgentExecCtx(context.Background(), &chatModelAgentExecCtx{\n\t\t\t", "repo": "cloudwego/eino", "span_codepoints": 128, "start": 21245, "suffix": "\t\trequire.ErrorIs(t, err, wantErr)\n\t\trequire.Equal(t, int32(1), atomic.LoadInt32(&m1Calls))\n\t\trequire.Equal(t, int32(1), atomic.LoadInt32(&shouldCalls))\n\t})\n\n\tt.Run(\"stops when GetFailoverModel returns nil model\", func(t *testing.T) {\n\t\tcfg := &ModelFailov", "target": "failoverLastSuccessModel: m1,\n\t\t})\n\t\tsr, err := w.Stream(ctx, []*schema.Message{schema.UserMessage(\"hi\")})\n\t\trequire.Nil(t, sr)\n"} {"bin": "32_token_ish", "content_sha256": "f40d83021b7092626487d70c5bbefc5e09425d089e19ad47729cfc2a7d5b124c", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/llm/models.py", "end": 7670, "example_id": "0012da0e20b83a5bf21a16e3a62734493982e6dbb84d204dce60ab087dac80fd", "language": "python", "prefix": "hould use ChatOCIRaw directly with proper configuration\n\t\traise ValueError('OCI models require manual configuration. Use ChatOCIRaw directly with your OCI credentials.')\n\n\t# Cerebras Models\n\telif provider == 'cerebras':\n\t\tapi_key = os.getenv('CEREBRAS_API_", "repo": "browser-use/browser-use", "span_codepoints": 128, "start": 7542, "suffix": " bu-latest conversion (need to prepend 'bu-' back)\n\t\tmodel = f'bu-{model_part.replace(\"_\", \"-\")}'\n\t\tapi_key = os.getenv('BROWSER_USE_API_KEY')\n\t\treturn ChatBrowserUse(model=model, api_key=api_key)\n\n\telse:\n\t\tavailable_providers = ['openai', 'azure', 'google", "target": "KEY')\n\t\treturn ChatCerebras(model=model, api_key=api_key)\n\n\t# Browser Use Models\n\telif provider == 'bu':\n\t\t# Handle bu_latest ->"} {"bin": "8_token_ish", "content_sha256": "f1f7cacd585d31c32f6da4ba00497a06038b5c5ba143084876a871eea6af6a59", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/cli/cache_clean.rs", "end": 4618, "example_id": "0012e8e79d2c59e58dd37de1a41d0104385d85404f01c8061d9ff45e18191f70", "language": "rust", "prefix": " let mut permissions = metadata.permissions();\n let current_mode = permissions.mode();\n\n // Add write permissions for owner, group, and others\n let new_mode = current_mode | 0o222;\n permissions.set_mode(new_mode);\n fs_err::set_permissions", "repo": "j178/prek", "span_codepoints": 32, "start": 4586, "suffix": " it's a directory, recursively process its contents\n if metadata.is_dir() {\n let entries = fs_err::read_dir(path)?;\n for entry in entries {\n let entry = entry?;\n fix_permissions(entry.path())?;\n }\n }\n\n Ok", "target": "(path, permissions)?;\n\n // If"} {"bin": "8_token_ish", "content_sha256": "7f680ecd488629c0fe448cd24d1e110d44fe52ca5a887f3f817b001a9fdf3bbc", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/languages/bun/version.rs", "end": 5447, "example_id": "0012f1ce33506b04b6d076038630b23ea21a59f43f5c8c1f0c015b23fc8defcd", "language": "rust", "prefix": "tr(\">=1.0\").unwrap();\n assert!(matches!(req, BunRequest::Range(_)));\n\n let req = BunRequest::from_str(\">=1.0, <2.0\").unwrap();\n assert!(matches!(req, BunRequest::Range(_)));\n }\n\n #[test]\n fn test_bun_request_invalid() {\n ", "repo": "j178/prek", "span_codepoints": 32, "start": 5415, "suffix": "1.1.0.1\").is_err());\n assert!(BunRequest::from_str(\"1.1a\").is_err());\n assert!(BunRequest::from_str(\"invalid\").is_err());\n }\n\n #[test]\n fn test_bun_request_matches() {\n let version = BunVersion(semver::Version::new(1, 1, 4));\n", "target": " assert!(BunRequest::from_str(\""} {"bin": "8_token_ish", "content_sha256": "ab5c97cd2d97c4a83a2b8ece386dbdbb1508dd350a483fd12612262ed89cca04", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/tools-ai-sdk/src/index.test.ts", "end": 5271, "example_id": "00130c728156e571dc366f0f11baa177ee00422205510fc5b3b3297341769a71", "language": "typescript", "prefix": " test(\"should accept Context7 config options\", () => {\n const agent = new Context7Agent({\n model: bedrock(\"anthropic.claude-3-haiku-20240307-v1:0\"),\n apiKey: \"ctx7sk-test-key\",\n });\n\n expect(agent).toBeDefined();\n });\n\n ", "repo": "upstash/context7", "span_codepoints": 32, "start": 5239, "suffix": " tools alongside Context7 tools\", () => {\n const customTool = tool({\n description: \"A custom test tool\",\n inputSchema: z.object({\n input: z.string().describe(\"Test input\"),\n }),\n execute: async ({ input }) => ({ re", "target": " test(\"should accept additional"} {"bin": "16_token_ish", "content_sha256": "9455f01b57052b4412c8b61cae936e5ef9f6169a08418b30d2b03b7905573ca5", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:tests/test_cavecrew_model_overrides.js", "end": 5499, "example_id": "00130ca8cec40682f54cfb63e8fedb2c6ee27c387642396da8965e363962e96a", "language": "javascript", "prefix": "udes('model: sonnet'), 'model line missing in CRLF builder file');\n const strippedCR = out.replace(/\\r\\n/g, '');\n assert.ok(!strippedCR.includes('\\n'), 'mixed line endings in CRLF builder patch');\n});\n\n// ── resolvePluginRoot ────────────────────────────", "repo": "JuliusBrussee/caveman", "span_codepoints": 64, "start": 5435, "suffix": ";\n\ntest('resolves to parent of hooks dir', () => {\n const hooksDir = path.join(os.tmpdir(), 'fake-plugin', 'hooks');\n const root = resolvePluginRoot(hooksDir);\n assert.strictEqual(path.basename(root), 'fake-plugin');\n});\n\n// ── applyOverrides ──────────", "target": "──────────────────────────\n\nconsole.log('\\nresolvePluginRoot\\n')"} {"bin": "8_token_ish", "content_sha256": "3bf2df8cf0cfb34b2c6cc548f25c2af83eeb8405b9718fc651818894cc171ff9", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:src/core/completions/generators/powershell-generator.ts", "end": 2649, "example_id": "001310d1b7c095b0c9337a8c182ccb693ef9582312a05d497fb5ba213566b9fc", "language": "typescript", "prefix": "new($_.Name, $_.Name, \"ParameterValue\", $_.Description)\n }\n return\n }\n\n $command = $tokens[1]\n\n switch ($command) {\n${commandCases}\n }\n}\n\nRegister-ArgumentCompleter -CommandName openspec -ScriptBlock $openspecCompleter\n`;\n }\n\n /", "repo": "Fission-AI/OpenSpec", "span_codepoints": 32, "start": 2617, "suffix": " for a command\n */\n private generateCommandCase(cmd: CommandDefinition, indent: string): string[] {\n const lines: string[] = [];\n\n if (cmd.subcommands && cmd.subcommands.length > 0) {\n // First, check if user is typing a flag for the parent c", "target": "**\n * Generate completion case"} {"bin": "64_token_ish", "content_sha256": "4aa37ffd5ba99f05a2fd4cb8c8d72b8268bc8ea651a658577acf082e3a3d5368", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/metagen/metagen.h", "end": 5930, "example_id": "00131237a8f6066f4a326455f09ffeebc27f99f670494fdda8334c7a307ae05e", "language": "c", "prefix": "line_max_width, U64 max_width, U64 wrap_indent);\n\n////////////////////////////////\n//~ rjf: C-String-Izing\n\ninternal String8 mg_c_string_literal_from_multiline_string(String8 string);\ninternal String8 mg_c_array_literal_contents_from_data(String8 data);\n\n/", "repo": "EpicGames/raddebugger", "span_codepoints": 256, "start": 5674, "suffix": ", void *val);\n\n////////////////////////////////\n//~ rjf: String Expression Parsing\n\ninternal MG_StrExpr *mg_push_str_expr(Arena *arena, MG_StrExprOp op, MD_Node *node);\ninternal MG_StrExprParseResult mg_str_expr_parse_from_first_opl__min_prec(Arena *arena,", "target": "///////////////////////////////\n//~ rjf: Map Functions\n\ninternal MG_Map mg_push_map(Arena *arena, U64 slot_count);\ninternal void *mg_map_ptr_from_string(MG_Map *map, String8 string);\ninternal void mg_map_insert_ptr(Arena *arena, MG_Map *map, String8 string"} {"bin": "16_token_ish", "content_sha256": "3e06a11a058d106b41a6c095d30621ed8ed6fbcb0f5ce728d4d894f2163d3628", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:internal/ogtags/integration_test.go", "end": 3101, "example_id": "00133e4f694ba9fa3b9f4ddc60c03aaa53f16e613095bccbf34cde6281aa1280", "language": "go", "prefix": "testURL, _ := url.Parse(ts.URL)\n\t\t\ttestURL.Path = tc.path\n\t\t\ttestURL.RawQuery = tc.query\n\n\t\t\t// Get OG tags\n\t\t\t// Pass the host from the test URL\n\t\t\togTags, err := cache.GetOGTags(t.Context(), testURL, testURL.Host)\n\n\t\t\t// Check error expectation\n\t\t\tif tc.", "repo": "TecharoHQ/anubis", "span_codepoints": 64, "start": 3037, "suffix": "got nil\")\n\t\t\t\t}\n\t\t\t\treturn\n\t\t\t}\n\n\t\t\tif err != nil {\n\t\t\t\tt.Fatalf(\"unexpected error: %v\", err)\n\t\t\t}\n\n\t\t\t// Verify all expected tags are present\n\t\t\tfor key, expectedValue := range tc.expectedTags {\n\t\t\t\tif value, ok := ogTags[key]; !ok || value != expectedVal", "target": "expectError {\n\t\t\t\tif err == nil {\n\t\t\t\t\tt.Error(\"expected error, "} {"bin": "32_token_ish", "content_sha256": "ee5d86c9099e45f2653d456a0a84b903b54ce60dad4b05a24473c5970f31d1ea", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/select.tsx", "end": 5141, "example_id": "0013409977ae193c4b6ddc0c0c439a0c9156c4a6855fafc1e0ee2744bf48e66a", "language": "typescript", "prefix": ":[span]:last:gap-2\",\n className\n )}\n {...props}\n >\n \n {children}\n \n \n \n \n \n )\n}\n\nfunction SelectSeparator({\n className,\n ...props\n}: SelectPrimitive.Separator.Props) ", "target": " render={\n \n }\n "} {"bin": "64_token_ish", "content_sha256": "eebc5a25bec6f5fecd0d253b3ef94e0423ebda7ba68c09ed6ad709c65f73f8d2", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converter_utils/docx/pre_process.py", "end": 5606, "example_id": "00134d7935cd52d37343015b3bfcbc3b4f88bf2a7ffb396f7157053846f88717", "language": "python", "prefix": "senting the processed DOCX file.\n \"\"\"\n output_docx = BytesIO()\n # The files that need to be pre-processed from .docx\n pre_process_enable_files = [\n \"word/document.xml\",\n \"word/footnotes.xml\",\n \"word/endnotes.xml\",\n ]\n ", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 5350, "suffix": " for name, content in files.items():\n if name in pre_process_enable_files:\n try:\n # Pre-process the content\n updated_content = _pre_process_math(content)\n ", "target": " with zipfile.ZipFile(input_docx, mode=\"r\") as zip_input:\n files = {name: zip_input.read(name) for name in zip_input.namelist()}\n with zipfile.ZipFile(output_docx, mode=\"w\") as zip_output:\n zip_output.comment = zip_input.comment\n "} {"bin": "32_token_ish", "content_sha256": "6006e1c16fae19b2bb3627b4265064818366c0ea1874188f6a02768eb4fb54ed", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/cli/yaml_to_toml.rs", "end": 5809, "example_id": "0013581db91bbe4b2d1f15a890c1789491e1e2c2b3007b9e61abeea178c22fa6", "language": "rust", "prefix": "ct_to_inline(values: &serde_json::Map) -> InlineTable {\n let mut table = InlineTable::new();\n for (key, value) in values {\n let value = match value {\n serde_json::Value::Array(values) => {\n ", "repo": "j178/prek", "span_codepoints": 128, "start": 5681, "suffix": " };\n table.insert(key.as_str(), value);\n }\n format_inline_table_multiline(&mut table, \" \", \" \");\n table\n}\n\nfn format_inline_table_multiline(table: &mut InlineTable, base_indent: &str, closing_indent: &str) {\n let len = table.len();", "target": "json_array_to_value_with_indent(values, \" \", \" \", false)\n }\n _ => json_to_toml_value(value),\n "} {"bin": "16_token_ish", "content_sha256": "24179f119e6fef8863e7a291d43e708a7917286c42c8682df5d5d3302f4ab8c2", "document_id": "steipete/agent-scripts@bb3688355a4c1894dd53b4ed867d1600918fadf0:skills/npm/scripts/reserve-packages.sh", "end": 1581, "example_id": "0013610d9a00791f621cd2a14438dc9a507b4d0889166830e663452fa9ea074a", "language": "shell", "prefix": " ;;\n --)\n shift\n PACKAGES+=(\"$@\")\n break\n ;;\n -*)\n echo \"unknown flag: $1\" >&2\n usage >&2\n exit 2\n ;;\n *)\n PACKAGES+=(\"$1\")\n shift\n ;;\n esac\ndone\n\n# Desktop fallback keeps the legacy item", "repo": "steipete/agent-scripts", "span_codepoints": 64, "start": 1517, "suffix": " \"$ITEM_EXPLICIT\" -eq 0 ]; then\n ITEM=\"npmjs\"\nfi\n\nif [ \"${#PACKAGES[@]}\" -eq 0 ]; then\n usage >&2\n exit 2\nfi\n\nif [ -z \"${TMUX:-}\" ]; then\n echo \"refusing to run: this script reads 1Password and must run inside a persistent tmux session\" >&2\n exit 2\nfi", "target": " name unless one was named explicitly.\nif [ -n \"$ACCOUNT\" ] && ["} {"bin": "32_token_ish", "content_sha256": "022d96c1a0f148ca478bb411002d5866db65f5b8aafb6990122abf2b6d4f7df6", "document_id": "unitycatalog/unitycatalog@ed504deea31b30c3e7d27e360372077cce04a509:server/src/test/java/io/unitycatalog/server/service/IcebergRestCatalogTest.java", "end": 12450, "example_id": "0013b130ed4f4f6f5150dd69010ef087c9a75b49b1f0bc8027a78226fadc13c5", "language": "java", "prefix": "ntentUtf8(), LoadTableResponse.class);\n assertThat(loadTableResponse.tableMetadata().metadataFileLocation())\n .isEqualTo(\n Objects.requireNonNull(this.getClass().getResource(\"/iceberg.metadata.json\"))\n .getPath()", "repo": "unitycatalog/unitycatalog", "span_codepoints": 128, "start": 12322, "suffix": "_NON_PREFIX\n + \"/namespaces/\"\n + TestUtils.SCHEMA_NAME\n + \"/tables/\"\n + TestUtils.TABLE_NAME)\n .aggregate()\n .join();\n assertThat(resp.status", "target": ");\n\n // non-prefixed URL should result in 404\n resp =\n client\n .get(\n TEST_BASE"} {"bin": "64_token_ish", "content_sha256": "d79a023ca8e821858be1525380a0b37d0542299b0da847edfed0fe921b5c1960", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/core/translator.py", "end": 3716, "example_id": "0013c84dfc51ad5c4b200e1bdba8011e455ba1526d8abff77d56df11d53c5e9f", "language": "python", "prefix": "pr, pseudo_element: PseudoElement) -> OriginalXPathExpr:\n \"\"\"\n Dispatch method that transforms XPath to support the pseudo-element.\n \"\"\"\n if isinstance(pseudo_element, FunctionalPseudoElement):\n method_name = f\"xpath_", "repo": "D4Vinci/Scrapling", "span_codepoints": 256, "start": 3460, "suffix": "name}() is unknown\")\n xpath = method(xpath, pseudo_element)\n else:\n method_name = f\"xpath_{pseudo_element.replace('-', '_')}_simple_pseudo_element\"\n method = getattr(self, method_name, None)\n if not method", "target": "{pseudo_element.name.replace('-', '_')}_functional_pseudo_element\"\n method = getattr(self, method_name, None)\n if not method: # pragma: no cover\n raise ExpressionError(f\"The functional pseudo-element ::{pseudo_element."} {"bin": "8_token_ish", "content_sha256": "a1b49fc9a53a294c1dce664aadc988e730fa31a69962fb26bf28faeba060eea0", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/spiders/spider.py", "end": 1508, "example_id": "0013cbfc81c62671f58576f909c847ba9f842c479f9f6492f403b6742ed73196", "language": "python", "prefix": "if level >= logging.ERROR:\n self.counts[logging.ERROR] += 1\n elif level >= logging.WARNING:\n self.counts[logging.WARNING] += 1\n elif level >= logging.INFO:\n self.counts[logging.INFO] += 1\n else:\n ", "repo": "D4Vinci/Scrapling", "span_codepoints": 32, "start": 1476, "suffix": "+= 1\n\n def get_counts(self) -> Dict[str, int]:\n \"\"\"Return counts as a dictionary with string keys.\"\"\"\n return {\n \"debug\": self.counts[logging.DEBUG],\n \"info\": self.counts[logging.INFO],\n \"warning\": self.cou", "target": " self.counts[logging.DEBUG] "} {"bin": "8_token_ish", "content_sha256": "39381d0d78126e420db0a8a742ec7050a7a227523428aaba035703f0b7e4b2bf", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/llm/tests/test_gemini_image.py", "end": 1030, "example_id": "0013db650cb3a7354484d071601867aca96267812dcc2df0a2b5f88da9b6c921", "language": "python", "prefix": "ilable\n\ttry:\n\t\tfont = ImageFont.truetype('arial.ttf', 24)\n\texcept Exception:\n\t\tfont = ImageFont.load_default()\n\n\t# Calculate text position to center it\n\tbbox = draw.textbbox((0, 0), text, font=font)\n\ttext_width = bbox[2] - bbox[0]\n\ttext_height = bbox[3] - ", "repo": "browser-use/browser-use", "span_codepoints": 32, "start": 998, "suffix": ") // 2\n\ty = (height - text_height) // 2\n\n\t# Draw text with contrasting color\n\ttext_color = (255 - bg_color[0], 255 - bg_color[1], 255 - bg_color[2])\n\tdraw.text((x, y), text, fill=text_color, font=font)\n\n\t# Convert to base64\n\tbuffer = io.BytesIO()\n\timage.sa", "target": "bbox[1]\n\tx = (width - text_width"} {"bin": "32_token_ish", "content_sha256": "5527c211ac7776602985d2f9417a65c3b86f47d2875f99ade4c1f3502777beb6", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:skills/open-source/references/tools.md", "end": 3206, "example_id": "0013e5db4ef7b0d4f1de31c937c505ac2712d679a1ce9ce709df8aff19adabdc", "language": "markdown", "prefix": " |\n| `has_sensitive_data` | `bool` | Whether action contains sensitive data |\n\n### Page Methods (via browser_session)\n\n```python\npage = await browser_session.must_get_current_page()\n\n# CSS selector\nelements = await page.get_elements_by_css_selector('button", "repo": "browser-use/browser-use", "span_codepoints": 128, "start": 3078, "suffix": "element = await page.must_get_element_by_prompt(\"login button\", llm=page_extraction_llm) # raises if not found\n```\n\n## Available Default Tools\n\nSource: [tools/service.py](https://github.com/browser-use/browser-use/blob/main/browser_use/tools/service.py)\n\n", "target": ".submit')\n\n# LLM-powered (natural language)\nelement = await page.get_element_by_prompt(\"login button\", llm=page_extraction_llm)\n"} {"bin": "32_token_ish", "content_sha256": "2e3366d1c77df39993bbbd1e0a1901a078fa378618987ad1f42c1a8121e42593", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:internal/clampip_test.go", "end": 3779, "example_id": "0013ef25570e6e3183b3751a72b18fc326985b173c0401223983956128fc5f1e", "language": "go", "prefix": "Is6() {\n\t\t\t\tif result.Bits() != 48 {\n\t\t\t\t\tt.Errorf(\"Expected 48 bits for IPv6, got %d\", result.Bits())\n\t\t\t\t}\n\t\t\t}\n\t\t})\n\t}\n}\n\nfunc TestClampIPZeroValue(t *testing.T) {\n\t// Test that when ClampIP fails, it returns zero value\n\t// Note: It's hard to make addr.", "repo": "TecharoHQ/anubis", "span_codepoints": 128, "start": 3651, "suffix": "\")\n\n\t// Manually create a zero value for comparison\n\tzeroPrefix := netip.Prefix{}\n\n\t// Call ClampIP - it should succeed with valid input\n\tresult, ok := ClampIP(addr)\n\n\t// Verify the function succeeded\n\tif !ok {\n\t\tt.Error(\"ClampIP should succeed with valid ", "target": "Prefix() fail with valid inputs,\n\t// so this test demonstrates the expected behavior\n\taddr := netip.MustParseAddr(\"192.168.1.100"} {"bin": "32_token_ish", "content_sha256": "01a08e0f09f3632e23bd42b3610fabff50e91a75eb56cad6b075202046a5d749", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:tests/providers/anthropic/cassette/messages_thinking.rs", "end": 1475, "example_id": "0013efa36372bc23bd1e804875b3c77e103a0e2b18f075241d23530b0cc3fdc5", "language": "rust", "prefix": "MAGIC_STRING} Reply with the single word OK.\")\n}\n\nfn thinking_params() -> serde_json::Value {\n serde_json::json!({\n \"thinking\": { \"type\": \"enabled\", \"budget_tokens\": 1024 }\n })\n}\n\nfn has_redacted_reasoning(content: &AssistantContent) -> bool {", "repo": "0xPlaygrounds/rig", "span_codepoints": 128, "start": 1347, "suffix": "\n .iter()\n .any(|item| matches!(item, ReasoningContent::Redacted { .. }))\n )\n}\n\n#[tokio::test]\nasync fn redacted_thinking_roundtrip_nonstreaming() {\n with_anthropic_cassette(\n \"messages_thinking/redacted_thinking_", "target": "\n matches!(\n content,\n AssistantContent::Reasoning(reasoning)\n if reasoning\n .content"} {"bin": "16_token_ish", "content_sha256": "a9abaaa7d4fde27e6f0eeb81e77bf764f65216be928bfda8613933a23b0b506a", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/spiders/links.py", "end": 1218, "example_id": "0013f73c38622890e05ad80b81af36a7b496131b69b203a621a5f6f7925c6458", "language": "python", "prefix": " # audio\n \"mp3\",\n \"wma\",\n \"ogg\",\n \"wav\",\n \"ra\",\n \"aac\",\n \"mid\",\n \"au\",\n \"aiff\",\n # video\n \"3gp\",\n \"asf\",\n \"asx\",\n \"avi\",\n \"mov\",\n \"mp4\",\n \"mpg\",\n \"qt\",\n \"rm\",\n \"swf\",\n \"wmv\",\n \"m4a\",\n \"", "repo": "D4Vinci/Scrapling", "span_codepoints": 64, "start": 1154, "suffix": "\"xlsm\",\n \"xlsx\",\n \"xltm\",\n \"xltx\",\n \"potm\",\n \"potx\",\n \"ppt\",\n \"pptm\",\n \"pptx\",\n \"pps\",\n \"doc\",\n \"docb\",\n \"docm\",\n \"docx\",\n \"dotm\",\n \"dotx\",\n \"odt\",\n \"ods\",\n \"odg\",\n \"odp\",\n # other\n \"css\",\n ", "target": "m4v\",\n \"flv\",\n \"webm\",\n # office suites\n \"xls\",\n "} {"bin": "16_token_ish", "content_sha256": "46b85514156e504c086ad1931586c8f34a0b150f8900a83f5fc8cce765bc90f9", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:c-cpp-book/src/ch08-crates-and-modules.md", "end": 4422, "example_id": "0013fd9cbe28e43f588f1a4960e765a622059a2bbdc11b3012337a05f4bee118", "language": "markdown", "prefix": "s)\n- Adding a dependency on ```hellolib``` in ```Cargo.toml``` for ```hello```\n```toml\n[dependencies]\nhellolib = {path = \"../hellolib\"}\n```\n- Using ```add()``` from ```hellolib```\n```rust\nfn main() {\n println!(\"Hello, world! {}\", hellolib::add(21, 21));", "repo": "microsoft/RustTraining", "span_codepoints": 64, "start": 4358, "suffix": "The complete workspace setup:\n\n```bash\n# Terminal commands\nmkdir workspace && cd workspace\n\n# Create workspace Cargo.toml\ncat > Cargo.toml << 'EOF'\n[workspace]\nresolver = \"2\"\nmembers = [\"hello\", \"hellolib\"]\nEOF\n\ncargo new hello\ncargo new --lib hellolib\n```", "target": "\n}\n```\n\n
Solution (click to expand)\n\n"} {"bin": "32_token_ish", "content_sha256": "6cd965a7b847a88e0e87d6a0813870ec7a0b83da46c623863a841c7d4375c139", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/spiders/test_links.py", "end": 2810, "example_id": "0014089b6be3c6e389b29220a5e5d81d635be043d5ac30f6e2a217d77c7b25fd", "language": "python", "prefix": "_out(self):\n resp = _make_response(HTML_BASIC)\n urls = LinkExtractor(deny=r\"/posts/\").extract(resp)\n assert \"https://example.com/posts/1\" not in urls\n assert \"https://example.com/about\" in urls\n\n def test_deny_overrides_allow", "repo": "D4Vinci/Scrapling", "span_codepoints": 128, "start": 2682, "suffix": "\n assert urls == [\"https://example.com/posts/1\"]\n\n def test_compiled_pattern_accepted(self):\n resp = _make_response(HTML_BASIC)\n pat = re.compile(r\"/posts/\\d+$\")\n urls = LinkExtractor(allow=pat).extract(resp)\n assert l", "target": "(self):\n resp = _make_response(HTML_BASIC)\n urls = LinkExtractor(allow=r\"/posts/\", deny=r\"/posts/2\").extract(resp)"} {"bin": "8_token_ish", "content_sha256": "48b2df09502722042a3aeca6f2661bd55067ddf80f79307598be58affbaf1750", "document_id": "nicbarker/clay@e6cc36941ab2af5d81107617039d6f527a1c660b:examples/GLES3-SDL2-video-demo/main.c", "end": 1856, "example_id": "001424f2820710d6b0ec9211cfab7b298011d6bc7bb6e1f6b284d5d42d02bade", "language": "c", "prefix": "_WINDOWPOS_CENTERED,\n SDL_WINDOWPOS_CENTERED,\n initialWidth,\n initialHeight,\n SDL_WINDOW_OPENGL | SDL_WINDOW_RESIZABLE | SDL_WINDOW_SHOWN\n );\n g_ctx.sdlContext = SDL_GL_CreateContext(g_ctx.sdlWindow);\n\n SDL_ShowWindow(g", "repo": "nicbarker/clay", "span_codepoints": 32, "start": 1824, "suffix": ");\n SDL_GL_GetDrawableSize(g_ctx.sdlWindow, &g_ctx.screenWidth, &g_ctx.screenHeight);\n glViewport(0, 0, g_ctx.screenWidth, g_ctx.screenHeight);\n\n glEnable(GL_BLEND);\n // Enables blending, which allows transparent textures to be rendered properl", "target": "_ctx.sdlWindow);\n SDL_Delay(1"} {"bin": "32_token_ish", "content_sha256": "f9195f442170c1d21467e69398def04e748f5bbbc5ab619c289aec8d5a9d422f", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/yahoo/search.test.js", "end": 2944, "example_id": "00143492c159321ca60721cb9b4a324ab5c75dd4b4889aecf82f717e1d81ede9", "language": "javascript", "prefix": "});\n\n it('drops decoded Yahoo redirect targets that are not http(s) URLs', async () => {\n const page = createPageMock([\n [\n 'Bad redirect',\n 'https://r.search.yahoo.com/_ylt=x/RU=javascript%3Aalert(1)/RK=2/RS=x',\n 'should not ", "repo": "jackwener/OpenCLI", "span_codepoints": 128, "start": 2816, "suffix": " code: 'EMPTY_RESULT',\n });\n });\n\n it('fails typed instead of silently returning [] for malformed extraction payloads', async () => {\n const page = createPageMock({ rows: [] });\n\n await expect(command.func(page, { keyword: 'opencli', limit: 1", "target": "be emitted',\n ],\n ]);\n\n await expect(command.func(page, { keyword: 'opencli', limit: 1 })).rejects.toMatchObject({\n "} {"bin": "16_token_ish", "content_sha256": "58d85e6e9b6c53698f1847627b3fe33562fde2f88ffb810142c5583f3819fae2", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_markdownify.py", "end": 2720, "example_id": "001434db618bb666fa5b15deed5a4c77904b64b1425499bc99ed1f33abea6cbe", "language": "python", "prefix": "nodes underscores are escaped\n if (\n self.options[\"autolinks\"]\n and text.replace(r\"\\_\", \"_\") == href\n and not title\n and not self.options[\"default_title\"]\n ):\n # Shortcut syntax\n ", "repo": "microsoft/markitdown", "span_codepoints": 64, "start": 2656, "suffix": " and not title:\n title = href\n title_part = ' \"%s\"' % title.replace('\"', r\"\\\"\") if title else \"\"\n return (\n \"%s[%s](%s%s)%s\" % (prefix, text, href, title_part, suffix)\n if href\n else text\n )\n", "target": " return \"<%s>\" % href\n if self.options[\"default_title\"]"} {"bin": "8_token_ish", "content_sha256": "5d7673d29dc46bb19e1137bb14110377830c2a2f4e97fa71d8f56bb3fadca9b2", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:agent/connection_manager_test.go", "end": 10525, "example_id": "0014568f9c6800a18280f5adb33c7c1b9660abdee5bdf58507475c625dd7a0a7", "language": "go", "prefix": "tching error\",\n\t\t\terr: createDialErr(\"lookup lkahsdfasdf: no such host\"),\n\t\t\tenvValue: \"true\",\n\t\t\texpected: true,\n\t\t},\n\t\t{\n\t\t\tname: \"env var true, matching error with extra context\",\n\t\t\terr: createDialErr(\"lookup beszel.server.lan on [::1]:53", "repo": "henrygd/beszel", "span_codepoints": 32, "start": 10493, "suffix": ": read: connection refused\"),\n\t\t\tenvValue: \"true\",\n\t\t\texpected: true,\n\t\t},\n\t\t{\n\t\t\tname: \"env var true, non-matching error\",\n\t\t\terr: errors.New(\"connection refused\"),\n\t\t\tenvValue: \"true\",\n\t\t\texpected: false,\n\t\t},\n\t\t{\n\t\t\tname: \"env var true, dia", "target": ": read udp [::1]:44557->[::1]:53"} {"bin": "64_token_ish", "content_sha256": "632ce87a34d6fee432909ff25310b13c5a844a9fd0d52ddd5a8c6447648a4858", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:agent/server_test.go", "end": 1302, "example_id": "00145c31824d5cb7fedd6fb447ec5e6a4aee04c72da9925be29c0425dc43f5c1", "language": "go", "prefix": "key pair for bad key test\n\tbadPubKey, badPrivKey, err := ed25519.GenerateKey(nil)\n\trequire.NoError(t, err)\n\tbadSigner, err := gossh.NewSignerFromKey(badPrivKey)\n\trequire.NoError(t, err)\n\tsshBadPubKey, err := gossh.NewPublicKey(badPubKey)\n\trequire.NoError(t", "repo": "henrygd/beszel", "span_codepoints": 256, "start": 1046, "suffix": " port only\",\n\t\t\tconfig: ServerOptions{\n\t\t\t\tNetwork: \"tcp\",\n\t\t\t\tAddr: \":45987\",\n\t\t\t\tKeys: []gossh.PublicKey{sshPubKey},\n\t\t\t},\n\t\t},\n\t\t{\n\t\t\tname: \"tcp with ipv4\",\n\t\t\tconfig: ServerOptions{\n\t\t\t\tNetwork: \"tcp4\",\n\t\t\t\tAddr: \"127.0.0.1:45988\",\n\t\t\t\tKeys: ", "target": ", err)\n\n\tsocketFile := filepath.Join(t.TempDir(), \"beszel-test.sock\")\n\n\ttests := []struct {\n\t\tname string\n\t\tconfig ServerOptions\n\t\twantErr bool\n\t\terrContains string\n\t\tsetup func() error\n\t\tcleanup func() error\n\t}{\n\t\t{\n\t\t\tname: \"tcp"} {"bin": "64_token_ish", "content_sha256": "8ae91557828e8597f00437dbbb71227e676e152c94bbd03804aee6a1bcaa4987", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/hooks/pre_commit_hooks/check_merge_conflict.rs", "end": 9208, "example_id": "001471bd5fccbedfc15cc090d598e7d12d89cd0b15ade13af69a5131eaf432d5", "language": "rust", "prefix": " let output_str = String::from_utf8_lossy(&output);\n assert!(output_str.contains(\"<<<<<<< \"));\n assert!(output_str.contains(\"=======\"));\n Ok(())\n }\n\n #[tokio::test]\n async fn test_ancestor_not_reported_without_conflict_", "repo": "j178/prek", "span_codepoints": 256, "start": 8952, "suffix": "file_path).await?;\n assert_eq!(code, 0);\n assert!(output.is_empty());\n Ok(())\n }\n\n #[tokio::test]\n async fn test_rst_heading_is_not_treated_as_conflict() -> Result<()> {\n let dir = tempdir()?;\n let content = b\"De", "target": "start() -> Result<()> {\n let dir = tempdir()?;\n let content = b\"Before conflict\\n||||||| base\\n\";\n let file_path = create_test_file(&dir, \"partial_conflict.txt\", content).await?;\n let (code, output) = check_file(Path::new(\"\"), &"} {"bin": "16_token_ish", "content_sha256": "7f680ecd488629c0fe448cd24d1e110d44fe52ca5a887f3f817b001a9fdf3bbc", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/languages/bun/version.rs", "end": 3384, "example_id": "001489f18f929343f5f18f6949e40ad3b47f955b507375c3e607483d8fd81473", "language": "rust", "prefix": "tallInfo) -> bool {\n let version = &install_info.language_version;\n self.matches(&BunVersion(version.clone()))\n }\n\n pub(crate) fn matches(&self, version: &BunVersion) -> bool {\n match self {\n Self::Any => true,\n ", "repo": "j178/prek", "span_codepoints": 64, "start": 3320, "suffix": "Self::MajorMinor(major, minor) => version.major == *major && version.minor == *minor,\n Self::MajorMinorPatch(major, minor, patch) => {\n version.major == *major && version.minor == *minor && version.patch == *patch\n }\n ", "target": " Self::Major(major) => version.major == *major,\n "} {"bin": "64_token_ish", "content_sha256": "f91858d0b4408f1e05a0ae27f11ae7924776e142476d2efe54887c25e0c89e97", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:tests/fuzz/ivf-cell-overflow.c", "end": 5826, "example_id": "0014a6241a4e6fc75521bb67c7fed1c2b01f76f50be90b7cbe2f58841df88494", "language": "c", "prefix": "c);\n sqlite3_finalize(sc);\n }\n sqlite3_free(cvec);\n }\n\n sqlite3_exec(db,\n \"INSERT INTO v(v) VALUES ('assign-vectors')\",\n NULL, NULL, NULL);\n\n // Final query after assign-vectors\n {\n float *qvec = sqlite3_malloc(dim * sizeof(float));", "repo": "asg017/sqlite-vec", "span_codepoints": 256, "start": 5570, "suffix": "_blob(sk, 1, qvec, dim * sizeof(float), SQLITE_TRANSIENT);\n while (sqlite3_step(sk) == SQLITE_ROW) {}\n sqlite3_finalize(sk);\n }\n sqlite3_free(qvec);\n }\n }\n\n // Full scan\n sqlite3_exec(db, \"SELECT * FROM v\", NULL, NULL, NULL);\n", "target": "\n if (qvec) {\n for (int d = 0; d < dim; d++) qvec[d] = 1.0f;\n sqlite3_stmt *sk = NULL;\n sqlite3_prepare_v2(db,\n \"SELECT rowid, distance FROM v WHERE emb MATCH ? LIMIT 5\",\n -1, &sk, NULL);\n if (sk) {\n sqlite3_bind"} {"bin": "32_token_ish", "content_sha256": "f59731cc305b5fb24bb2ab683264f7859047fb9b52932ae7bd0efa5b2f708f6e", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:internal/hub/systems/system_manager.go", "end": 8424, "example_id": "0014c252947bdf8b74b867639b2c6f7274afef8073edff774d82965423f4d506", "language": "go", "prefix": "p) || (newStatus == up && prevStatus == down) {\n\t\tif err := sm.hub.HandleStatusAlerts(newStatus, e.Record); err != nil {\n\t\t\te.App.Logger().Error(\"Error handling status alerts\", \"err\", err)\n\t\t}\n\t}\n\treturn e.Next()\n}\n\n// onRecordAfterDeleteSuccess is called ", "repo": "henrygd/beszel", "span_codepoints": 128, "start": 8296, "suffix": "\nfunc (sm *SystemManager) onRecordAfterDeleteSuccess(e *core.RecordEvent) error {\n\tsm.RemoveSystem(e.Record.Id)\n\treturn e.Next()\n}\n\n// AddSystem adds a system to the manager and starts monitoring it.\n// It validates required fields, initializes the system ", "target": "after a system record is successfully deleted.\n// It removes the system from the manager and cleans up all associated resources."} {"bin": "32_token_ish", "content_sha256": "d84cd6b8a42ef21acf064a431e36ca1db3f3c27035b11f04a96b2abfa87b7933", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/core/references.test.ts", "end": 6793, "example_id": "0014df97bf58a67a39f0d811fb4e5cd05f2ade7997f661840f11ec875889a4fb", "language": "typescript", "prefix": "'missing-context', remote: hostile }],\n resolvedRoot: appRoot(),\n globalDataDir,\n });\n expect(entries[0].status[0].fix).not.toContain('git clone');\n expect(entries[0].status[0].fix).toContain('Get a checkout from a teammate');\n", "repo": "Fission-AI/OpenSpec", "span_codepoints": 128, "start": 6665, "suffix": ";\n\n expect(entries[0].status[0]).toEqual(\n expect.objectContaining({ severity: 'warning', code: 'reference_invalid_id' })\n );\n });\n\n it('degrades unhealthy and mismatched stores to reference_root_unhealthy', async () => {\n await registerSto", "target": " }\n });\n\n it('degrades an invalid id to reference_invalid_id', async () => {\n const entries = await assemble(['BAD ID'])"} {"bin": "16_token_ish", "content_sha256": "68074fd22a569d98ccb447ed827a43637115b4b427cd5c53ef21810f1a0f66c1", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/observability.py", "end": 5414, "example_id": "0014ecd3dc0877faaf854ca1a44972a7d167860b80ba411ca3b44c439f58a963", "language": "python", "prefix": "+ param2\n\t\"\"\"\n\tkwargs = {\n\t\t'name': name,\n\t\t'ignore_input': ignore_input,\n\t\t'ignore_output': ignore_output,\n\t\t'metadata': metadata,\n\t\t'span_type': span_type,\n\t\t'tags': ['observe_debug'], # important: tags need to be created on laminar first\n\t\t**kwargs,\n\t}", "repo": "browser-use/browser-use", "span_codepoints": 64, "start": 5350, "suffix": "# Use the real lmnr observe decorator only in debug mode\n\t\treturn cast(Callable[[F], F], _lmnr_observe(**kwargs))\n\telse:\n\t\t# Use no-op decorator (either not in debug mode or lmnr not available)\n\t\treturn _create_no_op_decorator(**kwargs)\n\n\n# Convenience fun", "target": "\n\n\tif _LMNR_AVAILABLE and _lmnr_observe and _is_debug_mode():\n\t\t"} {"bin": "64_token_ish", "content_sha256": "ef12f7533b2dd0260ccbaa6b7484edff23376fb984670114411dc37093b188c2", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/spiders/templates/sitemap.py", "end": 4554, "example_id": "0014f7bba2537ea186e965646e570652900883dbcbf34fe86ade604a8b8a653d", "language": "python", "prefix": "k\":\n href = child.get(\"href\")\n if href:\n urls.append(href.strip())\n return urls\n\n @staticmethod\n def _get_type(el: Any) -> str:\n return etree.QName(el.tag).localname\n\n def ", "repo": "D4Vinci/Scrapling", "span_codepoints": 256, "start": 4298, "suffix": "e:\n self.logger.warning(f\"Failed to decompress sitemap: {e}\")\n return SitemapResult()\n\n try:\n root = etree.fromstring(body)\n except etree.XMLSyntaxError as e:\n self.logger.warning(f\"Failed to parse ", "target": "_sm_body(self, body: bytes, content_type: Optional[str] = None) -> SitemapResult:\n \"\"\"Parse a sitemap body and return its URLs and any child sitemaps.\"\"\"\n try:\n body = self._decompress(body, content_type)\n except OSError as "} {"bin": "32_token_ish", "content_sha256": "a4cb101371d1dc25246d0a71f0c6e85ec2291d0c3c9fa0a9dbaf267bc5f38914", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown-ocr/src/markitdown_ocr/_pptx_converter_with_ocr.py", "end": 958, "example_id": "001505b44525bb6e68f751417dd304abc6fc303b1df41f8b31c5db06e9ea405d", "language": "python", "prefix": "ort pptx\nexcept ImportError:\n _dependency_exc_info = sys.exc_info()\n\n\nclass PptxConverterWithOCR(DocumentConverter):\n \"\"\"Enhanced PPTX Converter with OCR fallback.\"\"\"\n\n def __init__(self, ocr_service: Optional[LLMVisionOCRService] = None):\n ", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 830, "suffix": " self,\n file_stream: BinaryIO,\n stream_info: StreamInfo,\n **kwargs: Any,\n ) -> bool:\n mimetype = (stream_info.mimetype or \"\").lower()\n extension = (stream_info.extension or \"\").lower()\n\n if extension == \".ppt", "target": " super().__init__()\n self._html_converter = HtmlConverter()\n self.ocr_service = ocr_service\n\n def accepts(\n "} {"bin": "8_token_ish", "content_sha256": "b3a0c69c32b557a7b1dd00b93eb466752d5ffbc6da40065dfebc1d6d27b25795", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/1688/download.js", "end": 1236, "example_id": "00153729f22038af4b09b859a8ef7029e7caa885eb8bce01e28f847d7ec2f787", "language": "javascript", "prefix": "\n pushImages(assets.main_images, 'main');\n pushImages(assets.sku_images, 'sku');\n pushImages(assets.detail_images, 'detail');\n pushImages(assets.other_images, 'other');\n assets.videos.forEach((url, index) => {\n items.push({\n ", "repo": "jackwener/OpenCLI", "span_codepoints": 32, "start": 1204, "suffix": ",\n filename: `${offerId}_video_${String(index + 1).padStart(2, '0')}${extFromUrl(url, '.mp4')}`,\n });\n });\n return items;\n}\ncli({\n site: '1688',\n name: 'download',\n access: 'read',\n description: '批量下载 1688 商品页可提取的图片和视频素材", "target": " type: 'video',\n url"} {"bin": "16_token_ish", "content_sha256": "a5b58164080314a19ac002cd0ab1681b7fbda1b6d36a179302c54c8ada632c65", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/infrastructure/test_registry_action_parameter_injection.py", "end": 5820, "example_id": "00156c1c7180dae1f980bd2ab4f1141e67d213c322f36dac1b8bcf99940e17be", "language": "python", "prefix": "ectly reloads the current page.\"\"\"\n\t\t# Navigate to the test page\n\t\tfrom browser_use.browser.events import NavigateToUrlEvent\n\n\t\tevent = browser_session.event_bus.dispatch(NavigateToUrlEvent(url=f'{base_url}/'))\n\t\tawait event\n\n\t\t# Get the current page info ", "repo": "browser-use/browser-use", "span_codepoints": 64, "start": 5756, "suffix": "page_url()\n\t\ttitle_before = await browser_session.get_current_page_title()\n\n\t\t# Refresh the page\n\t\tawait browser_session.refresh()\n\n\t\t# Get the current page info after refresh\n\t\turl_after = await browser_session.get_current_page_url()\n\t\ttitle_after = await", "target": "before refresh\n\t\turl_before = await browser_session.get_current_"} {"bin": "32_token_ish", "content_sha256": "f9795308ebc5db5d70b3a59d40b5811b1966e1c82100987e5be431c6aface229", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:lib/challenge/metarefresh/metarefresh_templ.go", "end": 2838, "example_id": "0015705a40bae81404d9c1d7f4fa9977f366efb925a1cfaf4ac3e34332f91c1d", "language": "go", "prefix": "=\" + anubis.Version)\n\t\tif templ_7745c5c3_Err != nil {\n\t\t\treturn templ.Error{Err: templ_7745c5c3_Err, FileName: `metarefresh.templ`, Line: 13, Col: 174}\n\t\t}\n\t\t_, templ_7745c5c3_Err = templ_7745c5c3_Buffer.WriteString(templ_7745c5c3_Var3)\n\t\tif templ_7745c5c3", "repo": "TecharoHQ/anubis", "span_codepoints": 128, "start": 2710, "suffix": "id=\\\"status\\\">\")\n\t\tif templ_7745c5c3_Err != nil {\n\t\t\treturn templ_7745c5c3_Err\n\t\t}\n\t\tvar templ_7745c5c3_Var4 string\n\t\ttempl_7745c5c3_Var4, templ_7745c5c3_Err = templ.JoinStringErrs(loc.T(\"loading\"))\n\t\tif templ_7745c5c3_Err != nil {\n\t\t\treturn templ.Error{Er", "target": "_Err != nil {\n\t\t\treturn templ_7745c5c3_Err\n\t\t}\n\t\ttempl_7745c5c3_Err = templruntime.WriteString(templ_7745c5c3_Buffer, 3, \"\\\">

\n {children}\n \n \n )\n}\n\nfunction ContextMenuSubContent({\n ...props\n}: React.ComponentProps {\n process.chdir(originalCwd);\n await rm(tempDir, { recursive: true, force: true });\n vi.restoreAllMocks();\n", "repo": "upstash/context7", "span_codepoints": 32, "start": 1802, "suffix": "() => {\n test(\"removes only CLI artifacts for cursor project setup\", async () => {\n const rulePath = join(tempDir, \".cursor\", \"rules\", \"context7.mdc\");\n const cliSkillPath = join(tempDir, \".cursor\", \"skills\", \"find-docs\", \"SKILL.md\");\n const mcpS", "target": "});\n\ndescribe(\"remove command\", "} {"bin": "32_token_ish", "content_sha256": "3138676f98756389fb4413df4c65c7e8dc25ed39d454a120934163b0e032c5f5", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:src/core/store/foundation.ts", "end": 1064, "example_id": "0015cc619b92f9537a20cab6a1ca1cf5be0d5f2c893efce936253a3d1ed4f3eb", "language": "typescript", "prefix": "omises;\n\nexport const STORE_METADATA_DIR_NAME = '.openspec-store';\nexport const STORE_METADATA_FILE_NAME = 'store.yaml';\nexport const STORES_DIR_NAME = 'stores';\nexport const STORE_REGISTRY_FILE_NAME = 'registry.yaml';\n\nexport interface StorePathOptions {\n", "repo": "Fission-AI/OpenSpec", "span_codepoints": 128, "start": 936, "suffix": "branch?: string;\n}\n\nexport type StoreBackendConfig = StoreGitBackendConfig;\n\nexport interface StoreRegistryEntryState {\n backend: StoreBackendConfig;\n}\n\nexport interface StoreRegistryState {\n version: 1;\n stores: Record;", "target": " globalDataDir?: string;\n}\n\nexport interface StoreGitBackendConfig {\n type: 'git';\n local_path: string;\n remote?: string;\n "} {"bin": "32_token_ish", "content_sha256": "ad49a50cdc019bba871bad85c97b1b6272cb8c44739f289d6010239be2069cd8", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/filesystem/file_system.py", "end": 18777, "example_id": "0015d1ad1a928d67226f6017dd806f2759d7da4ac4b7ece7a9404ff32a3e6d33", "language": "python", "prefix": "pages = sorted(page_scores.items(), key=lambda x: -x[1])\n\t\t\t\t\tpriority_pages = [1]\n\t\t\t\t\tfor page_num, _ in sorted_pages:\n\t\t\t\t\t\tif page_num not in priority_pages:\n\t\t\t\t\t\t\tpriority_pages.append(page_num)\n\n\t\t\t\t\t# Add remaining pages in order (for pages with no", "repo": "browser-use/browser-use", "span_codepoints": 128, "start": 18649, "suffix": "page_num)\n\n\t\t\t\t\t# Build content from prioritized pages, respecting char limit\n\t\t\t\t\tcontent_parts = []\n\t\t\t\t\tchars_used = 0\n\t\t\t\t\tpages_included = []\n\n\t\t\t\t\t# First pass: add pages in priority order\n\t\t\t\t\tfor page_num in priority_pages:\n\t\t\t\t\t\ttext = page_texts[", "target": " distinctive content)\n\t\t\t\t\tfor page_num, _ in page_texts:\n\t\t\t\t\t\tif page_num not in priority_pages:\n\t\t\t\t\t\t\tpriority_pages.append("} {"bin": "32_token_ish", "content_sha256": "3b3e3afbd5dfaa6fbc11b71a7d866d635cb019a0d009e218164f8e91b53c4642", "document_id": "cloudwego/eino@ca0441ac0bceed8945dcf7d5a18c237c924c6aa8:components/tool/interrupt_test.go", "end": 762, "example_id": "0015f2cb2bc5baf75b8ec8f307c15a948db3c6fece26eb815a4a1186aa9c56af", "language": "go", "prefix": "e is distributed on an \"AS IS\" BASIS,\n * WITHOUT WARRANTIES OR CONDITIONS OF ANY KIND, either express or implied.\n * See the License for the specific language governing permissions and\n * limitations under the License.\n */\n\npackage tool\n\nimport (\n\t\"context", "repo": "cloudwego/eino", "span_codepoints": 128, "start": 634, "suffix": "t *testing.T) {\n\tctx := context.Background()\n\n\tt.Run(\"basic interrupt\", func(t *testing.T) {\n\t\terr := Interrupt(ctx, \"test info\")\n\t\tassert.Error(t, err)\n\n\t\tvar signal *core.InterruptSignal\n\t\tassert.True(t, errors.As(err, &signal))\n\t\tassert.Equal(t, \"test i", "target": "\"\n\t\"errors\"\n\t\"testing\"\n\n\t\"github.com/stretchr/testify/assert\"\n\n\t\"github.com/cloudwego/eino/internal/core\"\n)\n\nfunc TestInterrupt("} {"bin": "32_token_ish", "content_sha256": "1e2203cf7d3137221a7ff2d1b79d5405580eea2ce4c22ba916dbeb9c689e96be", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:tests/test-unit.c", "end": 43060, "example_id": "0015fc165d11420292ebcb2a68346fa8935a94a7ee0951baf1bfc0f1116fd2c9", "language": "c", "prefix": ");\n }\n\n // All options combined\n {\n const char *s = \"v float[8] indexed by ivf(nlist=32, nprobe=4, quantizer=int8, oversample=2)\";\n rc = vec0_parse_vector_column(s, (int)strlen(s), &col);\n assert(rc == SQLITE_OK);\n assert(col.ivf.nlist == 32", "repo": "asg017/sqlite-vec", "span_codepoints": 128, "start": 42932, "suffix": ");\n sqlite3_free(col.name);\n }\n\n printf(\" All ivf_config_parsing tests passed.\\n\");\n}\n#endif /* SQLITE_VEC_ENABLE_IVF */\n // INT8 quantizer\n {\n const char *input = \"v float[64] INDEXED BY diskann(neighbor_quantizer=int8)\";\n rc = vec0_parse_ve", "target": ");\n assert(col.ivf.nprobe == 4);\n assert(col.ivf.quantizer == VEC0_IVF_QUANTIZER_INT8);\n assert(col.ivf.oversample == 2"} {"bin": "64_token_ish", "content_sha256": "0d2185d967bbbf3092237c9858b4a0d0fe5a03b7b6347bdbf1b15e7b1ea492f9", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/hooks/pre_commit_hooks/requirements_txt_fixer.rs", "end": 12215, "example_id": "00160234041ee9ca8a23975a41598237621a6ba658df285d4df5b58d8dc6f3e3", "language": "rust", "prefix": "@tag#egg=ocflib\\nDjango\\nijk\\n\",\n b\"Django\\nijk\\ngit+ssh://git_url@tag#egg=ocflib\\n\",\n ),\n (\n b\"b==1.0.0\\nc=2.0.0 \\\\\\n --hash=sha256:abcd\\na=3.0.0 \\\\\\n --hash=sha256:a1b1c1d1\",\n b\"a=3.0.0 ", "repo": "j178/prek", "span_codepoints": 256, "start": 11959, "suffix": " (b\"foo\\r\\nbar\\r\\n\", b\"bar\\r\\nfoo\\r\\n\"),\n (b\"# header\\nfoo \\\\\\n\\nbar\\n\", b\"# header\\n\\nbar\\n\"),\n (\n b\"zeta\\n-e git+ssh://url \\\\\\n --config=#egg=Alpha\\n\",\n b\"-e git+ssh://url \\\\\\n --config=#egg=Alpha\\nz", "target": "\\\\\\n --hash=sha256:a1b1c1d1\\nb==1.0.0\\nc=2.0.0 \\\\\\n --hash=sha256:abcd\\n\",\n ),\n (\n b\"a=2.0.0 \\\\\\n --hash=sha256:abcd\\nb==1.0.0\\n\",\n b\"a=2.0.0 \\\\\\n --hash=sha256:abcd\\nb==1.0.0\\n\",\n ),\n "} {"bin": "8_token_ish", "content_sha256": "a9f203c76c3a7fcbff7d6b23b9f36e1f3fa9fa21a02f1998003a0710ca39e608", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/core/completions/installers/powershell-installer.test.ts", "end": 14089, "example_id": "0016097e70cb080ce3eb35eea26507f800324088bf60cde8fdf0ff37787b3443", "language": "typescript", "prefix": " '# Before',\n '# OPENSPEC:START',\n '# OpenSpec',\n '# OPENSPEC:END',\n '# After',\n ].join('\\n');\n\n await fs.writeFile(profilePath, initialContent);\n\n const result = await installer.removeProfileConfig();\n\n ", "repo": "Fission-AI/OpenSpec", "span_codepoints": 32, "start": 14057, "suffix": " const content = await fs.readFile(profilePath, 'utf-8');\n expect(content).toContain('# Before');\n expect(content).toContain('# After');\n });\n\n it('should return false on invalid marker placement', async () => {\n const profilePath = ", "target": " expect(result).toBe(true);\n "} {"bin": "64_token_ish", "content_sha256": "f9795308ebc5db5d70b3a59d40b5811b1966e1c82100987e5be431c6aface229", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:lib/challenge/metarefresh/metarefresh_templ.go", "end": 2335, "example_id": "00160e4d1dab96b3f280f1ee184c06ac3dfa5346f61e9dcc158a1092daa751f4", "language": "go", "prefix": "empl_7745c5c3_Err, FileName: `metarefresh.templ`, Line: 12, Col: 165}\n\t\t}\n\t\t_, templ_7745c5c3_Err = templ_7745c5c3_Buffer.WriteString(templ_7745c5c3_Var2)\n\t\tif templ_7745c5c3_Err != nil {\n\t\t\treturn templ_7745c5c3_Err\n\t\t}\n\t\ttempl_7745c5c3_Err = templruntime", "repo": "TecharoHQ/anubis", "span_codepoints": 256, "start": 2079, "suffix": "_Err = templ.ResolveAttributeValue(anubis.BasePrefix + \"/.within.website/x/cmd/anubis/static/img/happy.webp?cacheBuster=\" + anubis.Version)\n\t\tif templ_7745c5c3_Err != nil {\n\t\t\treturn templ.Error{Err: templ_7745c5c3_Err, FileName: `metarefresh.templ`, Line:", "target": ".WriteString(templ_7745c5c3_Buffer, 2, \"\\\"> principal2VersionsApi.createModelVersion(createVersion2));\n\n // TEST: Get model version as principal-1", "repo": "unitycatalog/unitycatalog", "span_codepoints": 64, "start": 5712, "suffix": " principal1VersionsApi.getModelVersion(\"cat_pr1.sch_pr1.mod_pr1\", 1L);\n assertThat(getVersionInfo).isNotNull();\n\n // TEST: Get model version as principal-2 (not owner) - should fail\n assertPermissionDenied(\n () -> principal2VersionsA", "target": " (owner) - should succeed\n ModelVersionInfo getVersionInfo =\n"} {"bin": "64_token_ish", "content_sha256": "8e220fb270b050bf1ece82efad6ae81ac5a9a1bdb9962fd7414e5d47b209737f", "document_id": "nicbarker/clay@e6cc36941ab2af5d81107617039d6f527a1c660b:renderers/GLES3/clay_renderer_gles3.h", "end": 20541, "example_id": "00163a428da64bc40385f19598cbd76fa3607f91256394a77968a6fb98c6053a", "language": "c", "prefix": "DER_COMMAND_TYPE_TEXT:\n {\n renderer->renderTextFunction(\n cmd,\n &renderer->glyphVtxArray,\n userData);\n break;\n }\n case CLAY_RENDER_COMMAND_TYPE_RECTANGLE:\n case ", "repo": "nicbarker/clay", "span_codepoints": 256, "start": 20285, "suffix": "float gf = c.g / 255.0f;\n float bf = c.b / 255.0f;\n float af = c.a / 255.0f;\n\n bool isImage = cmd->commandType == CLAY_RENDER_COMMAND_TYPE_IMAGE;\n\n // Ensure we don't overflow the capacity\n if (quads->", "target": "CLAY_RENDER_COMMAND_TYPE_IMAGE:\n {\n Clay_RectangleRenderData *config = &cmd->renderData.rectangle;\n Clay_Color c = config->backgroundColor;\n\n // Convert to float 0..1\n float rf = c.r / 255.0f;\n "} {"bin": "32_token_ish", "content_sha256": "4e2675f18f3be6437130d04b91e962aaa3cc5198e5c9372d24e6241b57977be8", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_doc_intel_converter.py", "end": 5840, "example_id": "00166b2d75729a56c68bf9ab1583403f2002449d161f7f79eda4ccf5415aa405", "language": "python", "prefix": "edential | None): The credential to use for authentication.\n file_types (List[DocumentIntelligenceFileType]): The file types to accept. Defaults to all supported file types.\n \"\"\"\n\n super().__init__()\n self._file_types = file", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 5712, "suffix": "this one isn't even instantiated\n # unless explicitly requested.\n if _dependency_exc_info is not None:\n raise MissingDependencyException(\n \"DocumentIntelligenceConverter requires the optional dependency [az-doc-intel", "target": "_types\n\n # Raise an error if the dependencies are not available.\n # This is different than other converters since "} {"bin": "16_token_ish", "content_sha256": "0b42de52d3ca7ee8f1ac6e35f004a5433d41df91a2c12aeff738604dd8129ec5", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/setup/agents.ts", "end": 5143, "example_id": "00167962b5de5926077de7fd8f8073b2bda2ee60fa41d7da3d3d4b08cd8274a5", "language": "typescript", "prefix": "e\", url: mcpUrl(auth), enabled: true }, auth),\n },\n rule: {\n kind: \"append\",\n file: (scope) =>\n scope === \"global\" ? join(homedir(), \".config\", \"opencode\", \"AGENTS.md\") : \"AGENTS.md\",\n sectionMarker: \"\",\n },\n", "repo": "upstash/context7", "span_codepoints": 64, "start": 5079, "suffix": " scope === \"global\" ? join(homedir(), \".agents\", \"skills\") : join(\".agents\", \"skills\"),\n },\n detect: {\n projectPaths: [\"opencode.json\", \"opencode.jsonc\", \".opencode.json\", \".opencode.jsonc\"],\n globalPaths: [join(homedir(), \".config\", ", "target": " skill: {\n name: \"context7-mcp\",\n dir: (scope) =>\n "} {"bin": "64_token_ish", "content_sha256": "992d6ec2cf2e8952d1fae378c3baf88134cd0cf874c6f2ab9bd10594673ab665", "document_id": "DataWithBaraa/sql-data-warehouse-project@92406686380cde6eca208c8b43e6fa40ecd26344:scripts/gold/ddl_gold.sql", "end": 1837, "example_id": "00167d919b190c3a46cb68363730d9b7136727eb119f4df505d5d78fcb5882e1", "language": "sql", "prefix": " AS country,\n ci.cst_marital_status AS marital_status,\n CASE \n WHEN ci.cst_gndr != 'n/a' THEN ci.cst_gndr -- CRM is the primary source for gender\n ELSE COALESCE(ca.gen, 'n/a') \t\t\t -- Fallback to ERP data\n END", "repo": "DataWithBaraa/sql-data-warehouse-project", "span_codepoints": 256, "start": 1581, "suffix": ".erp_loc_a101 la\n ON ci.cst_key = la.cid;\nGO\n\n-- =============================================================================\n-- Create Dimension: gold.dim_products\n-- =============================================================================\nIF OBJ", "target": " AS gender,\n ca.bdate AS birthdate,\n ci.cst_create_date AS create_date\nFROM silver.crm_cust_info ci\nLEFT JOIN silver.erp_cust_az12 ca\n ON ci.cst_key = ca.cid\nLEFT JOIN silver"} {"bin": "64_token_ish", "content_sha256": "3641a863ac524478d70063e4487c16e17230c167d21d6ebdd2a738539d836a63", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/archive.rs", "end": 8469, "example_id": "001685083bc2853b6985e792146c9868d9c2a762e1213648dcc7357467e13fc0", "language": "rust", "prefix": "e permissions here, because we haven't seen the central directory yet.\n let file = fs_err::tokio::File::create(&path).await?;\n let size = entry.reader().entry().uncompressed_size();\n let mut writer = if let Ok(size) = usize", "repo": "j178/prek", "span_codepoints": 256, "start": 8213, "suffix": " tokio::io::copy(&mut reader, &mut writer).await?;\n }\n\n // Close current file prior to proceeding, as per:\n // https://docs.rs/async_zip/0.0.16/async_zip/base/read/stream/\n (.., zip) = entry.skip().await?;\n\n // St", "target": "::try_from(size) {\n tokio::io::BufWriter::with_capacity(std::cmp::min(size, 1024 * 1024), file)\n } else {\n tokio::io::BufWriter::new(file)\n };\n let mut reader = entry.reader_mut().compat();\n "} {"bin": "8_token_ish", "content_sha256": "b898fa7d192aa35a985cd95e242dc3dbd71dd2a2b5bdf6abf0b3e17cf44a79fa", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converter_utils/docx/math/latex_dict.py", "end": 1138, "example_id": "00168f03562a7207db8961f28d13e645bd7ab4528870a65a253720523c87d63b", "language": "python", "prefix": " \"\\u0338\": \"\\\\not{{{0}}}\",\n \"\\u20d0\": \"\\\\leftharpoonaccent{{{0}}}\",\n \"\\u20d1\": \"\\\\rightharpoonaccent{{{0}}}\",\n \"\\u20d2\": \"\\\\vertoverlay{{{0}}}\",\n \"\\u20d6\": \"\\\\overleftarrow{{{0}}}\",\n \"\\u20d7\": \"\\\\vec{{{0}}}\",\n \"\\u20db\": \"\\\\dddot{{{0}}}\",\n", "repo": "microsoft/markitdown", "span_codepoints": 32, "start": 1106, "suffix": "\n \"\\u20e1\": \"\\\\overleftrightarrow{{{0}}}\",\n \"\\u20e7\": \"\\\\annuity{{{0}}}\",\n \"\\u20e9\": \"\\\\widebridgeabove{{{0}}}\",\n \"\\u20f0\": \"\\\\asteraccent{{{0}}}\",\n # Bottom accents\n \"\\u0330\": \"\\\\wideutilde{{{0}}}\",\n \"\\u0331\": \"\\\\underbar{{{0}}}\",\n ", "target": " \"\\u20dc\": \"\\\\ddddot{{{0}}}\","} {"bin": "8_token_ish", "content_sha256": "5a5272472557744e1616060b62948523e7c1710eee94906d9d0c4d369bdaa756", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/calendar.tsx", "end": 2938, "example_id": "00168feb7a0095e7f9be79ff42761c9a04616ecc8055a9f648d92041a8b7ac82", "language": "typescript", "prefix": " ),\n dropdown: cn(\n \"absolute inset-0 bg-popover opacity-0\",\n defaultClassNames.dropdown\n ),\n caption_label: cn(\n \"font-medium select-none\",\n captionLayout === \"label\"\n ? \"text-sm\"\n", "repo": "OpenCut-app/OpenCut", "span_codepoints": 32, "start": 2906, "suffix": " gap-1 rounded-(--cell-radius) text-sm [&>svg]:size-3.5 [&>svg]:text-muted-foreground\",\n defaultClassNames.caption_label\n ),\n table: \"w-full border-collapse\",\n weekdays: cn(\"flex\", defaultClassNames.weekdays),\n weekday:", "target": " : \"flex items-center"} {"bin": "32_token_ish", "content_sha256": "671b22dd756f505c4c929ed467a4263433aa9ac286714b90ed1b3fc8779c536e", "document_id": "Netflix/maestro@abdbdadf8f075b8fa488c9efb386b468c709a63c:maestro-engine/src/test/java/com/netflix/maestro/engine/execution/StepSyncManagerTest.java", "end": 3801, "example_id": "001698f3f723d6b926a6ddd4f6bc31dcc5bdaa1b66c5d7f084a893489579c290", "language": "java", "prefix": " Optional

details = syncManager.sync(instance, workflowSummary, stepRuntimeSummary);\n assertFalse(details.isPresent());\n verify(instanceDao, times(1)).updateStepInstance(workflowSummary, stepRuntimeSummary, null);\n }\n\n @Test\n public void ", "repo": "Netflix/maestro", "span_codepoints": 128, "start": 3673, "suffix": "\"test-summary\")\n .stepAttemptId(2)\n .stepInstanceId(1)\n .dbOperation(DbOperation.DELETE)\n .build();\n Optional
details = syncManager.sync(instance, workflowSummary, stepRuntimeSummary);\n assertTrue(", "target": "testInvalidDbOperation() {\n StepRuntimeSummary stepRuntimeSummary =\n StepRuntimeSummary.builder()\n .stepId("} {"bin": "16_token_ish", "content_sha256": "bcc202c2f3745a7c508423db9b7e6656ee7d0a7bc37f032f7ca61497e6f5a70d", "document_id": "steipete/agent-scripts@bb3688355a4c1894dd53b4ed867d1600918fadf0:skills/clawsweeper-status/scripts/clawsweeper-status.sh", "end": 15794, "example_id": "0016a385ed1a45b0f7f9e2019810b507f7c875a5386f078c2bd701060e0c302c", "language": "shell", "prefix": "url))\"' \"$runs_json\" | head -20\n\nprint_section() {\n local title=\"$1\"\n local body=\"$2\"\n echo\n echo \"## ${title}\"\n echo\n if [ -n \"$body\" ]; then\n printf '%s\\n' \"$body\"\n else\n echo \"- none found in window\"\n fi\n}\n\nmerged=\"$(\n jq -r --arg since \"", "repo": "steipete/agent-scripts", "span_codepoints": 64, "start": 15730, "suffix": "\\t]+\"; \" \") | gsub(\" +\"; \" \") | .[0:160];\n [.[] | select(.mergedAt != null and .mergedAt >= $since)\n ] | sort_by(.mergedAt) | reverse | .[0:$limit][]\n | \"- \\(.url) — \\(.title | one_line) (merged \\(.mergedAt))\"\n ' \"$pulls_json\"\n)\"\nprint_section \"", "target": "$since\" --argjson limit \"$limit\" '\n def one_line: gsub(\"[\\r\\n"} {"bin": "16_token_ish", "content_sha256": "44adec41c8f6c97cefde2462eefd850c4416fa845a8f53c8426215f65e194de5", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/fetchers/requests.py", "end": 1129, "example_id": "0016bc4e28862417c6c36578b3284a9c39e1809f1205334e6887e37689fcda86", "language": "python", "prefix": " selector_config = kwargs.get(\"selector_config\") or {}\n kwargs[\"selector_config\"] = {**cls._generate_parser_arguments(), **selector_config}\n return kwargs\n\n\nclass Fetcher(BaseFetcher):\n \"\"\"A basic `Fetcher` class type that can only do basic GET, ", "repo": "D4Vinci/Scrapling", "span_codepoints": 64, "start": 1065, "suffix": " @classmethod\n def get(cls, url: str, **kwargs: Unpack[GetRequestParams]) -> Response:\n return __FetcherClientInstance__.get(url, **_merge_selector_config(cls, kwargs))\n\n @classmethod\n def post(cls, url: str, **kwargs: Unpack[DataRequestPa", "target": "POST, PUT, and DELETE HTTP requests based on `curl_cffi`.\"\"\"\n\n "} {"bin": "32_token_ish", "content_sha256": "7f33315d49ac2b5c3efc00ab25f4625e1827e7f9d10a354bfde347b632d880f4", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:openspec/work/simplify-context-and-workspace-model/slices/store-root-parity/plan.md", "end": 8048, "example_id": "0016c3f7b3503d4434bf729d3cfe949fcd74bb828cb0d5c016b880f460ca5a7d", "language": "markdown", "prefix": "tadata and Git health.\n- Missing `openspec/changes/archive/` appears under `openspec_root`.\n- Doctor does not create missing directories or repair files.\n\n## Command Behavior\n\n### `context-store setup`\n\nSetup creates or preserves the context-store root for", "repo": "Fission-AI/OpenSpec", "span_codepoints": 128, "start": 7920, "suffix": "git/`.\n- Existing healthy OpenSpec root.\n- Existing root with matching valid context-store identity.\n\nReject:\n\n- A file path.\n- An arbitrary non-empty unmarked folder.\n- A setup target nested inside another Git repository.\n- A root with invalid or conflict", "target": " this machine.\n\nAccept:\n\n- Missing target directory.\n- Empty target directory.\n- Existing target directory that contains only `."} {"bin": "32_token_ish", "content_sha256": "9455f01b57052b4412c8b61cae936e5ef9f6169a08418b30d2b03b7905573ca5", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:tests/test_cavecrew_model_overrides.js", "end": 7687, "example_id": "0016e7774eca2163428a255321b421dc42c37438b0abb875843cdb0513bb6ba0", "language": "javascript", "prefix": "et' });\n const out = fs.readFileSync(path.join(agentsDir, 'cavecrew-builder.md'), 'utf8');\n assert.ok(out.includes('model: sonnet'), 'builder model not inserted');\n });\n});\n\ntest('blank env var is no-op', () => {\n withTmpPlugin((root, agentsDir) =>", "repo": "JuliusBrussee/caveman", "span_codepoints": 128, "start": 7559, "suffix": "REVIEWER_MODEL: '' });\n const out = fs.readFileSync(path.join(agentsDir, 'cavecrew-reviewer.md'), 'utf8');\n assert.strictEqual(out, REVIEWER_FM, 'blank env var should be no-op');\n });\n});\n\ntest('whitespace-only env var is no-op', () => {\n withTmpPl", "target": " {\n fs.writeFileSync(path.join(agentsDir, 'cavecrew-reviewer.md'), REVIEWER_FM, 'utf8');\n applyOverrides(root, { CAVECREW_"} {"bin": "16_token_ish", "content_sha256": "152594b9286ace2bc231bc452d746cb718703e79b31d5392017482a0d8416b03", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:tests/installer/unit.argv.test.mjs", "end": 3738, "example_id": "001706dd6b91e011d717a860862638a96d0b057e6015b4c47981c87e92140c0e", "language": "javascript", "prefix": "e caveman plugin is already installed.\n const r = run('--dry-run', '--only', 'claude', '--with-hooks', '--non-interactive', '--config-dir', `~/${suffix}`);\n assert.equal(r.status, 0);\n // If the literal `~` had survived, we'd see `~/cm-test-…/hooks` in ", "repo": "JuliusBrussee/caveman", "span_codepoints": 64, "start": 3674, "suffix": " absolute home path.\n assert.doesNotMatch(r.stdout, /~\\/cm-test-/);\n // The plan only includes the hooks dir if claude is detected. Skip the\n // positive assertion when claude isn't on PATH on the runner.\n if (/Claude Code detected/.test(r.stdout)) {\n ", "target": "the plan.\n // The fix expands it in parseArgs, so we expect the"} {"bin": "16_token_ish", "content_sha256": "169bacf2ebafeaa14322edd1eee61b3e09378bec00649ae04a60bdb3d8dd900a", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:tests/test_caveman_init.js", "end": 1663, "example_id": "00172dc4a329a20e7cb8e1c4a624464841241ab48bdb6a0ac48cc6f412ca1de9", "language": "javascript", "prefix": "rsor/rules/caveman.mdc'), 'utf8');\n assert.match(cursor, /alwaysApply: true/);\n assert.match(cursor, /Respond terse like smart caveman/);\n const windsurf = fs.readFileSync(path.join(tmp, '.windsurf/rules/caveman.md'), 'utf8');\n assert.match(windsurf, /", "repo": "JuliusBrussee/caveman", "span_codepoints": 64, "start": 1599, "suffix": "tmp, '.clinerules/caveman.md'), 'utf8');\n assert.match(cline, /^Respond terse/);\n const copilot = fs.readFileSync(path.join(tmp, '.github/copilot-instructions.md'), 'utf8');\n assert.match(copilot, /Respond terse/);\n const agents = fs.readFileSync(path.", "target": "trigger: always_on/);\n const cline = fs.readFileSync(path.join("} {"bin": "64_token_ish", "content_sha256": "48b2df09502722042a3aeca6f2661bd55067ddf80f79307598be58affbaf1750", "document_id": "nicbarker/clay@e6cc36941ab2af5d81107617039d6f527a1c660b:examples/GLES3-SDL2-video-demo/main.c", "end": 1843, "example_id": "0017311ccac691ef05a9fb30413bcf3b10f49d7a8ea8e96b9318f4c5acd66f43", "language": "c", "prefix": "e(SDL_GL_RED_SIZE, 8);\n SDL_GL_SetAttribute(SDL_GL_GREEN_SIZE, 8);\n SDL_GL_SetAttribute(SDL_GL_BLUE_SIZE, 8);\n SDL_GL_SetAttribute(SDL_GL_ALPHA_SIZE, 8);\n\n g_ctx.sdlWindow = SDL_CreateWindow(\n \"SDL2 GLES3\",\n SDL_WINDOWPOS_CENTERED", "repo": "nicbarker/clay", "span_codepoints": 256, "start": 1587, "suffix": " SDL_Delay(1);\n SDL_GL_GetDrawableSize(g_ctx.sdlWindow, &g_ctx.screenWidth, &g_ctx.screenHeight);\n glViewport(0, 0, g_ctx.screenWidth, g_ctx.screenHeight);\n\n glEnable(GL_BLEND);\n // Enables blending, which allows transparent textures to be ren", "target": ",\n SDL_WINDOWPOS_CENTERED,\n initialWidth,\n initialHeight,\n SDL_WINDOW_OPENGL | SDL_WINDOW_RESIZABLE | SDL_WINDOW_SHOWN\n );\n g_ctx.sdlContext = SDL_GL_CreateContext(g_ctx.sdlWindow);\n\n SDL_ShowWindow(g_ctx.sdlWindow);\n "} {"bin": "8_token_ish", "content_sha256": "46b85514156e504c086ad1931586c8f34a0b150f8900a83f5fc8cce765bc90f9", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:c-cpp-book/src/ch08-crates-and-modules.md", "end": 10135, "example_id": "001731a65e890797c1bb29bd0027429c2c33445d02b052a7db57c08d0337caa2", "language": "markdown", "prefix": " compile, like -O0)\ndebug = true # Full debug symbols (like -g)\n\n[profile.release]\nopt-level = 3 # Maximum optimization (like -O3)\nlto = \"fat\" # Link-Time Optimization (like -flto)\nstrip = true # Strip symbols (like ", "repo": "microsoft/RustTraining", "span_codepoints": 32, "start": 10103, "suffix": " = 1 # Single codegen unit — slower compile, better optimization\npanic = \"abort\" # No unwind tables (smaller binary)\n```\n\n| C/GCC Flag | Cargo.toml Key | Values |\n|------------|---------------|--------|\n| `-O0` / `-O2` / `-O3` | `opt-level` | `", "target": "the strip command)\ncodegen-units"} {"bin": "64_token_ish", "content_sha256": "c3ba54ac18bfd8fe2b8ed18830463dc9cb455911ad19cbdee15e7474173a4d83", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/hupu/unlike.js", "end": 1396, "example_id": "001737e5550c0ca292c91e109f5999955e5f706a853f98bb26a67795a39ec889", "language": "javascript", "prefix": "https://bbs.hupu.com/pcmapi/pc/bbs/v1/reply/cancelLight';\n // 构建请求体(与点赞相同)\n const body = {\n tid,\n pid,\n puid: '',\n fid,\n shumei_id: '',\n deviceid: ''\n };\n try {\n ", "repo": "jackwener/OpenCLI", "span_codepoints": 256, "start": 1140, "suffix": " }];\n }\n else if (result.code === 0 && result.msg === '你还没有点亮过这个回帖') {\n return [{\n status: '⚠️ 你还没点赞过',\n message: result.msg || ''\n }];\n ", "target": " const result = await postHupuJson(page, tid, url, body, 'Unlike Hupu reply');\n // 处理响应\n if (result.code === 1) {\n return [{\n status: '✅ 取消点赞成功',\n message: ''\n "} {"bin": "16_token_ish", "content_sha256": "e3f42cc6e7b4e28174ed9ed1b1046d55cfc1fcc403ea680eee0b61887e0569d9", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:internal/hub/config/config_test.go", "end": 3760, "example_id": "001738546332a9c90144903cced1eeaed1a7380f9b78a836d7d999fbc3b3c67a", "language": "go", "prefix": " users:\n - \"admin@example.com\"`,\n\t\t\texpectToken: \"preserve-token-999\",\n\t\t\tdescription: \"Existing system should preserve original token when config doesn't specify one\",\n\t\t},\n\t}\n\n\tfor _, tc := range testCases {\n\t\tt.Run(tc.name, func(t *testing.T) {\n\t\t\t", "repo": "henrygd/beszel", "span_codepoints": 64, "start": 3696, "suffix": "tc.setupFunc()\n\n\t\t\t// Write config file\n\t\t\tconfigPath := filepath.Join(testHub.DataDir(), \"config.yml\")\n\t\t\terr := os.WriteFile(configPath, []byte(tc.configYAML), 0644)\n\t\t\trequire.NoError(t, err)\n\n\t\t\t// Create serve event and sync\n\t\t\tevent := &core.ServeEve", "target": "// Setup test data\n\t\t\t_, existingSystem, existingFingerprint := "} {"bin": "64_token_ish", "content_sha256": "ee79bcaac0e3089124e63942e342395480ea4a6fdcd2942e16436b607e63489b", "document_id": "unitycatalog/unitycatalog@ed504deea31b30c3e7d27e360372077cce04a509:server/src/main/java/io/unitycatalog/server/service/ModelService.java", "end": 8510, "example_id": "00173e92d0be54cb9ea4e6fc715c14229a7d677c48ec733d86ffd987d978ce42", "language": "java", "prefix": "eKeys({\n @AuthorizeResourceKey(value = CATALOG, key = \"catalog_name\"),\n @AuthorizeResourceKey(value = SCHEMA, key = \"schema_name\"),\n @AuthorizeResourceKey(value = REGISTERED_MODEL, key = \"model_name\")\n })\n CreateModelVersion ", "repo": "unitycatalog/unitycatalog", "span_codepoints": 256, "start": 8254, "suffix": "getSource() != null;\n ModelVersionInfo createModelVersionResponse =\n modelRepository.createModelVersion(createModelVersion);\n return HttpResponse.ofJson(createModelVersionResponse);\n }\n\n @Get(\"/{full_name}/versions\")\n @AuthorizeExpression(\"", "target": "createModelVersion) {\n assert createModelVersion != null;\n assert createModelVersion.getModelName() != null;\n assert createModelVersion.getCatalogName() != null;\n assert createModelVersion.getSchemaName() != null;\n assert createModelVersion."} {"bin": "8_token_ish", "content_sha256": "39def14b329c32391ccf023b45e9d1bbf05de9695cd79ef9ce32b5692a46ce97", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:rust-patterns-book/src/ch00-introduction.md", "end": 694, "example_id": "00177fd333187defda3dfdafb6d4c9db9f064d01dd306920be0bece1ba58fd1f", "language": "markdown", "prefix": " language ever since\n\n---\n\nA practical guide to intermediate-and-above Rust patterns that arise in real codebases. This is not a language tutorial — it assumes you can write basic Rust and want to level up. Each chapter isolates one concept, explains when ", "repo": "microsoft/RustTraining", "span_codepoints": 32, "start": 662, "suffix": "compilable examples with inline exercises.\n\n## Who This Is For\n\n- Developers who have finished *The Rust Programming Language* but struggle with \"how do I actually design this?\"\n- C++/C# engineers translating production systems into Rust\n- Anyone who has h", "target": "and why to use it, and provides "} {"bin": "32_token_ish", "content_sha256": "5ba9751758fb1bc539c7c05bbd895fbe5c793695efde967888190ccbdbaa0ca5", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/core/test_storage_core.py", "end": 9422, "example_id": "0017961bf338a2cfc8329eec9e101343a8820b71036aeddf2439903c668d8b7a", "language": "python", "prefix": "elect(\"p\")[0]\n result = _StorageTools.element_to_dict(elem)\n assert result[\"text\"] is None\n\n def test_element_no_attributes(self):\n tree = fromstring(\"

Plain

\")\n elem = tree.cssselect(\"p\")[0]\n result = ", "repo": "D4Vinci/Scrapling", "span_codepoints": 128, "start": 9294, "suffix": "(self):\n tree = fromstring('

')\n elem = tree.cssselect(\"p\")[0]\n result = _StorageTools.element_to_dict(elem)\n # Whitespace-only attribute values should be filtered out\n assert \"data-val\" not", "target": "_StorageTools.element_to_dict(elem)\n assert result[\"attributes\"] == {}\n\n def test_element_strips_whitespace_attributes"} {"bin": "8_token_ish", "content_sha256": "badb0e3bed10b37b6df9f5847ff9ee2761c51185dc0efd315803e9c63ae62459", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_docx_converter.py", "end": 894, "example_id": "0017b21c4f9e2da144774505623430f19be2a95d116cc34f618fe5bd616b9d8f", "language": "python", "prefix": "ndency_exc_info = sys.exc_info()\n\n\nACCEPTED_MIME_TYPE_PREFIXES = [\n \"application/vnd.openxmlformats-officedocument.wordprocessingml.document\",\n]\n\nACCEPTED_FILE_EXTENSIONS = [\".docx\"]\n\n\nclass DocxConverter(HtmlConverter):\n \"\"\"\n Converts DOCX files ", "repo": "microsoft/markitdown", "span_codepoints": 32, "start": 862, "suffix": "e.g., headings) and tables are preserved where possible.\n \"\"\"\n\n def __init__(self):\n super().__init__()\n self._html_converter = HtmlConverter()\n\n def accepts(\n self,\n file_stream: BinaryIO,\n stream_info: StreamIn", "target": "to Markdown. Style information ("} {"bin": "64_token_ish", "content_sha256": "e71882c4a29ebe078c20f67ba5723ed7a2f47bab256f18809d85433d69b36891", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:tests/providers/xai/extractor_usage.rs", "end": 3882, "example_id": "0017c3619064deb8a332b0a53d1fd484af1d9550fbd7f115c469a2981e8aa7c0", "language": "rust", "prefix": "IL 62701.\",\n chat_history,\n )\n .await?;\n\n anyhow::ensure!(response.data.street.as_deref() == Some(\"123 Main St\"));\n anyhow::ensure!(response.data.city.as_deref() == Some(\"Springfield\"))", "repo": "0xPlaygrounds/rig", "span_codepoints": 256, "start": 3626, "suffix": ".usage.total_tokens > 0);\n\n Ok(())\n },\n )\n .await\n}\n\n#[tokio::test]\nasync fn extract_and_extract_with_usage_return_same_data() -> Result<()> {\n with_xai_cassette_result(\n \"extractor_usage/extract_and_extract_with_usage_ret", "target": ";\n anyhow::ensure!(response.data.state.as_deref() == Some(\"IL\"));\n anyhow::ensure!(response.data.zip_code.as_deref() == Some(\"62701\"));\n anyhow::ensure!(response.usage.input_tokens > 0);\n anyhow::ensure!(response"} {"bin": "8_token_ish", "content_sha256": "2b8f6d53bc25b7a8b74e2afe66d9c0b9a90bf1050de4b455aa4465d92a78aafa", "document_id": "unitycatalog/unitycatalog@ed504deea31b30c3e7d27e360372077cce04a509:server/src/test/java/io/unitycatalog/server/base/function/BaseFunctionCRUDTest.java", "end": 4138, "example_id": "0017cfad164c43ae2c18d38bf5379d303cd88e98cf40c95c8e62c358539d6fb8", "language": "java", "prefix": " .dataType(ColumnTypeName.INT)\n .fullDataType(\"Integer\")\n .isNullCall(false)\n .routineBody(CreateFunction.RoutineBodyEnum.EXTERNAL)\n .routineDefinition(\"def test():\\n return 1\")\n .securityType(", "repo": "unitycatalog/unitycatalog", "span_codepoints": 32, "start": 4106, "suffix": "DEFINER)\n .specificName(\"test\")\n .sqlDataAccess(CreateFunction.SqlDataAccessEnum.NO_SQL)\n .inputParams(functionParameterInfos);\n CreateFunctionRequest createFunctionRequest =\n new CreateFunctionRequest().functionI", "target": "CreateFunction.SecurityTypeEnum."} {"bin": "32_token_ish", "content_sha256": "c77c5e7eee15947f2b77a436630d5fbea8573d53894881b75d12f160d001fa81", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/parser/test_parser_advanced.py", "end": 5106, "example_id": "0017e4b14080c9fed11fe616381d1c222c05a7b76207766db60827abe2738185", "language": "python", "prefix": "r\") == \"https://example.com/other\"\n assert page.urljoin(\"/absolute\") == \"https://example.com/absolute\"\n assert page.urljoin(\"relative\") == \"https://example.com/relative\"\n\n def test_find_operations_edge_cases(self, complex_html):\n \"\"", "repo": "D4Vinci/Scrapling", "span_codepoints": 128, "start": 4978, "suffix": ".find_all(\n \"span\",\n [\"div\"],\n {\"class\": \"nested\"},\n lambda e: e.text != \"\"\n )\n\n # Regex pattern matching\n pattern = re.compile(r\"Cell \\d+\")\n cells = page.find_all(pattern)\n ass", "target": "\"Test edge cases in find operations\"\"\"\n page = Selector(complex_html)\n\n # Multiple argument types\n _ = page"} {"bin": "16_token_ish", "content_sha256": "b3e742c445e9f43adb83598fabc17f937552368ff3bc2640c20ece59f320f054", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:skills/open-source/SKILL.md", "end": 1212, "example_id": "0017e4d8a1d18ab1d7e0330c397a4a466d7889f69569e278687c9ce576189e1d", "language": "markdown", "prefix": " the relevant file based on what the user needs.\n\n| Topic | Read |\n|-------|------|\n| Install, quickstart, production/@sandbox | `references/quickstart.md` |\n| LLM providers (15+): setup, env vars, pricing | `references/models.md` |\n| Agent params, output,", "repo": "browser-use/browser-use", "span_codepoints": 64, "start": 1148, "suffix": "params, auth, real browser, remote/cloud | `references/browser.md` |\n| Custom tools, built-in tools, ActionResult | `references/tools.md` |\n| Actor API: Page/Element/Mouse (legacy) | `references/actor.md` |\n| MCP server, skills, docs-mcp | `references/inte", "target": " prompting, hooks, timeouts | `references/agent.md` |\n| Browser "} {"bin": "64_token_ish", "content_sha256": "7a2e36133615dcce6c11be0423cb681abfab8b962c58fa96a559dc5ac0d8b3f4", "document_id": "cloudwego/eino@ca0441ac0bceed8945dcf7d5a18c237c924c6aa8:compose/branch_test.go", "end": 3006, "example_id": "0017eac5f480590763f639360c0fc90f6751567451089319062dfb8a5e9ddbc2", "language": "go", "prefix": "Key(\"2\"))\n\tassert.NoError(t, err)\n\terr = g.AddLambdaNode(\"3\", emptyLambda, WithOutputKey(\"3\"))\n\tassert.NoError(t, err)\n\n\terr = g.AddBranch(START, NewStreamGraphMultiBranch(func(ctx context.Context, in *schema.StreamReader[string]) (endNode map[string]bool,", "repo": "cloudwego/eino", "span_codepoints": 256, "start": 2750, "suffix": "err)\n\terr = g.AddEdge(\"3\", END)\n\tassert.NoError(t, err)\n\n\tctx := context.Background()\n\tr, err := g.Compile(ctx)\n\tassert.NoError(t, err)\n\n\tresult, err := r.Invoke(ctx, \"start\")\n\tassert.NoError(t, err)\n\tassert.Equal(t, map[string]any{\n\t\t\"1\": \"start\",\n\t\t\"2\": ", "target": " err error) {\n\t\tin.Close()\n\t\treturn map[string]bool{\"1\": true, \"2\": true}, nil\n\t}, map[string]bool{\"1\": true, \"2\": true, \"3\": true}))\n\tassert.NoError(t, err)\n\n\terr = g.AddEdge(\"1\", END)\n\tassert.NoError(t, err)\n\terr = g.AddEdge(\"2\", END)\n\tassert.NoError(t, "} {"bin": "8_token_ish", "content_sha256": "1015ae6a2822f71d17fb4e2e24c96819e29e1ee99e1613dbc388315df4630152", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:skills/open-source/references/actor.md", "end": 2695, "example_id": "0017ef3f0ba86cd99d86a8382c52db74d35ed1d8bb3afef6f3d723ea8dcdf999", "language": "markdown", "prefix": "`check()` — Toggle checkbox/radio\n- `select_option(values: str | list[str])` — Select dropdown\n- `drag_to(target: Element | Position)`\n\n### Properties\n- `get_attribute(name: str) -> str | None`\n- `get_bounding_box() -> BoundingBox | None`\n- `get_basic_info", "repo": "browser-use/browser-use", "span_codepoints": 32, "start": 2663, "suffix": "(format='jpeg') -> str`\n\n## Mouse Methods\n\n```python\nmouse = page.mouse\nawait mouse.click(x=100, y=200, button='left', click_count=1)\nawait mouse.move(x=500, y=600, steps=1)\nawait mouse.down(button='left')\nawait mouse.up(button='left')\nawait mouse.scroll(x", "target": "() -> ElementInfo`\n- `screenshot"} {"bin": "32_token_ish", "content_sha256": "4aa37ffd5ba99f05a2fd4cb8c8d72b8268bc8ea651a658577acf082e3a3d5368", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/metagen/metagen.h", "end": 1750, "example_id": "00180f8ff80958a8c4517f707765702f7f6104c70d4cd00e63dbee704d4ed0a7", "language": "c", "prefix": "G_StrExprOpKind\n{\n MG_StrExprOpKind_Null,\n MG_StrExprOpKind_Prefix,\n MG_StrExprOpKind_Postfix,\n MG_StrExprOpKind_Binary,\n MG_StrExprOpKind_COUNT\n}\nMG_StrExprOpKind;\n\ntypedef enum MG_StrExprOp\n{\n MG_StrExprOp_Null,\n \n#define MG_StrExprOp_FirstString ", "repo": "EpicGames/raddebugger", "span_codepoints": 128, "start": 1622, "suffix": "_StrExprOp_LastString MG_StrExprOp_BumpToColumn\n \n#define MG_StrExprOp_FirstNumeric MG_StrExprOp_Add\n MG_StrExprOp_Add,\n MG_StrExprOp_Subtract,\n MG_StrExprOp_Multiply,\n MG_StrExprOp_Divide,\n MG_StrExprOp_Modulo,\n MG_StrExprOp_LeftShift,\n MG_StrExpr", "target": "MG_StrExprOp_Dot\n MG_StrExprOp_Dot,\n MG_StrExprOp_ExpandIfTrue,\n MG_StrExprOp_Concat,\n MG_StrExprOp_BumpToColumn,\n#define MG"} {"bin": "8_token_ish", "content_sha256": "433a345a279c2d54be51864ef77c0a7b19d0f8604b9a441ce0a1eded31f113e8", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:src/hooks/caveman-stats.js", "end": 6004, "example_id": "00182141f1eab6d245a619a2303ce35c2607d7ccfd27b6f58527e98ffd3ceb8e", "language": "javascript", "prefix": "bytesSaved, tokensSaved };\n}\n\n// ── Per-mode attribution (#601) ─────────────────────────────────────────────\n// The whole session's tokens must never be credited to whatever mode the flag\n// happens to hold at stats time — a mid-session mode change would ", "repo": "JuliusBrussee/caveman", "span_codepoints": 32, "start": 5972, "suffix": " tokens counted as compressed) or zero it (caveman tokens\n// counted as uncompressed). The mode tracker + SessionStart hook append\n// {ts, mode, prev} rows to .caveman-mode-log.jsonl on every actual transition;\n// stats joins those timestamps against the s", "target": "inflate the\n// estimate (verbose"} {"bin": "64_token_ish", "content_sha256": "f27ac893dc3f6befb569083a96dc3001948855d41eaed82b8cdb1c5ec633c10c", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/dwarf/dwarf_expr.c", "end": 14380, "example_id": "0018493d7e135212808579267e78e2ed5a60d7c2d5335b5ca93bb4197344d7b3", "language": "c", "prefix": "f: implicit location descriptions (value is known, location is not)\n case DW_ExprOp_ImplicitValue:\n {\n push_vals[0] = operands[0];\n }break;\n case DW_ExprOp_StackValue:\n {\n // NOTE(rjf): nothing to do here - program is", "repo": "EpicGames/raddebugger", "span_codepoints": 256, "start": 14124, "suffix": "0] == 0)\n {\n push_vals[0] = popped_vals[0];\n }\n else\n {\n // NOTE(rjf): with a nonzero operand, it is expecting us to read into the\n // DWARF debug info and push as that base type. we do not have access", "target": " over, value (but not location) has\n // been evaluated and exists as the top entry on the stack.\n }break;\n \n //- rjf: conversions\n case DW_ExprOp_Convert:\n case DW_ExprOp_Reinterpret:\n {\n if(operands[0].u512.u64["} {"bin": "8_token_ish", "content_sha256": "f91858d0b4408f1e05a0ae27f11ae7924776e142476d2efe54887c25e0c89e97", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:tests/fuzz/ivf-cell-overflow.c", "end": 2821, "example_id": "00186827c51c20e31ccd3a33d2046e5ca3e891cf3bb09eefcaf863a1e9125e66", "language": "c", "prefix": "of(float), SQLITE_TRANSIENT);\n sqlite3_step(stmtInsert);\n sqlite3_free(vec);\n }\n sqlite3_finalize(stmtInsert);\n\n // Train to assign vectors to centroids (triggers cell building)\n sqlite3_exec(db,\n \"INSERT INTO v(v) VALUES ('compute-centroids')", "repo": "asg017/sqlite-vec", "span_codepoints": 32, "start": 2789, "suffix": "Delete vectors at boundary positions based on fuzz data\n // This tests validity bitmap manipulation at different slot positions\n for (int i = 0; i < num_vecs; i++) {\n int byte_idx = i / 8;\n if (byte_idx < (int)payload_size && (payload[byte_idx] & (", "target": "\",\n NULL, NULL, NULL);\n\n // "} {"bin": "64_token_ish", "content_sha256": "a459bfc07e726e14cfbd5c78a0499961281fb8699d70a7bc3d7132fe32cd4238", "document_id": "unitycatalog/unitycatalog@ed504deea31b30c3e7d27e360372077cce04a509:server/src/test/java/io/unitycatalog/server/utils/TestUtils.java", "end": 1117, "example_id": "00186f4a464024b41c32c66d48c492a4822d9a5f8805df3cdf27f68938eff738", "language": "java", "prefix": "rrorCode;\nimport java.net.URI;\nimport java.net.http.HttpClient;\nimport java.net.http.HttpRequest;\nimport java.net.http.HttpResponse;\nimport java.util.HashMap;\nimport java.util.Map;\nimport java.util.Optional;\nimport org.junit.jupiter.api.function.Executable", "repo": "unitycatalog/unitycatalog", "span_codepoints": 256, "start": 861, "suffix": "= \"uc_testschema2\";\n public static final String TABLE_NAME = \"uc_testtable\";\n public static final String VOLUME_NAME = \"uc_testvolume\";\n public static final String FUNCTION_NAME = \"uc_testfunction\";\n public static final String MODEL_NAME = \"uc_testmode", "target": ";\n\npublic class TestUtils {\n public static final String CATALOG_NAME = \"uc_testcatalog\";\n public static final String SCHEMA_NAME = \"uc_testschema\";\n public static final String CATALOG_NAME2 = \"uc_testcatalog2\";\n public static final String SCHEMA_NAME2 "} {"bin": "8_token_ish", "content_sha256": "08627035eea96b25c22866667d6a9dba8ee9c7094d1da26da90ce4e645a6c6f6", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/__tests__/github.test.ts", "end": 1018, "example_id": "0018701c70be711eca41c30898d0c7e6e65ef7702d8012d17d8bc2e28ea1541e", "language": "typescript", "prefix": "stubEnv(\"GH_TOKEN\", undefined);\n vi.stubGlobal(\n \"fetch\",\n vi\n .fn()\n .mockResolvedValueOnce({\n ok: true,\n json: () => Promise.resolve({ default_branch: \"main\" }),\n })\n .mockResolvedValueOnce({\n ok: true,\n ", "repo": "upstash/context7", "span_codepoints": 32, "start": 986, "suffix": "({ sha: \"tree-sha\", tree: [], truncated: false }),\n })\n );\n});\n\nafterEach(() => {\n vi.unstubAllGlobals();\n vi.unstubAllEnvs();\n});\n\ndescribe(\"GitHub authentication\", () => {\n test(\"reads the GitHub CLI token without invoking a shell\", async () => ", "target": " json: () => Promise.resolve"} {"bin": "32_token_ish", "content_sha256": "02f266e6fb689bcdcb261f9314e2b15cd5f74a735accc93ff69b64ad8c99e975", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_audio_converter.py", "end": 836, "example_id": "00189b4694a972e594013793782afb78f4e964ba1de7da8a2290cfd493c2078f", "language": "python", "prefix": ",\n]\n\n\nclass AudioConverter(DocumentConverter):\n \"\"\"\n Converts audio files to markdown via extraction of metadata (if `exiftool` is installed), and speech transcription (if `speech_recognition` is installed).\n \"\"\"\n\n def accepts(\n self,\n ", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 708, "suffix": "> bool:\n mimetype = (stream_info.mimetype or \"\").lower()\n extension = (stream_info.extension or \"\").lower()\n\n if extension in ACCEPTED_FILE_EXTENSIONS:\n return True\n\n for prefix in ACCEPTED_MIME_TYPE_PREFIXES:\n ", "target": " file_stream: BinaryIO,\n stream_info: StreamInfo,\n **kwargs: Any, # Options to pass to the converter\n ) -"} {"bin": "16_token_ish", "content_sha256": "dcb3a9f400fdde461ae9463bbeeb76181d5e6929c0a018e361c398f75f331e3f", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_bing_serp_converter.py", "end": 2117, "example_id": "0018b67301f357d97dc9fb8c1c59eb6a166bf89be123afa34a9701e0b69cd7cf", "language": "python", "prefix": "e stream\n encoding = \"utf-8\" if stream_info.charset is None else stream_info.charset\n soup = BeautifulSoup(file_stream, \"html.parser\", from_encoding=encoding)\n\n # Clean up some formatting\n for tptt in soup.find_all(class_=\"tptt\"", "repo": "microsoft/markitdown", "span_codepoints": 64, "start": 2053, "suffix": " tptt.string += \" \"\n for slug in soup.find_all(class_=\"algoSlug_icon\"):\n slug.extract()\n\n # Parse the algorithmic results\n _markdownify = _CustomMarkdownify(**kwargs)\n results = list()\n for result in ", "target": "):\n if hasattr(tptt, \"string\") and tptt.string:\n "} {"bin": "8_token_ish", "content_sha256": "5b753d325fa4bbc040bdb3da170853ca1000da2826617fe56f6c65d123339097", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/fetchers/test_proxy_rotation.py", "end": 1755, "example_id": "0018bae4657a0f90837cea96b587c2481f0145329ace99bd4d21ff0d18bb944f", "language": "python", "prefix": "80\", \"http://p2:8080\"]\n rotator = ProxyRotator(proxies)\n\n assert len(rotator) == 2\n assert rotator.proxies == proxies\n\n def test_create_with_dict_proxies(self):\n \"\"\"Test creating rotator with dict proxies\"\"\"\n proxies =", "repo": "D4Vinci/Scrapling", "span_codepoints": 32, "start": 1723, "suffix": "//p1:8080\", \"username\": \"user1\", \"password\": \"pass1\"},\n {\"server\": \"http://p2:8080\"},\n ]\n rotator = ProxyRotator(proxies)\n\n assert len(rotator) == 2\n assert rotator.proxies == proxies\n\n def test_create_with_mixed_p", "target": " [\n {\"server\": \"http:"} {"bin": "64_token_ish", "content_sha256": "d83f50b7e03cacf4aa765e53e5db8849bf5f37f22d20dbe9cec0aa099b05928a", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/tests/languages/system.rs", "end": 1180, "example_id": "0018cef5172c691622d60f23354b6d19cefba53206de5d97c287dffb1bb732ee", "language": "rust", "prefix": "), @r\"\n success: true\n exit_code: 0\n ----- stdout -----\n no-shell.................................................................Passed\n - hook id: no-shell\n - duration: [TIME]\n\n first echo second\n\n ----- stderr -----\n \");\n}\n\n", "repo": "j178/prek", "span_codepoints": 256, "start": 924, "suffix": "-script\n name: shell-script\n language: system\n entry: |\n echo first\n echo second\n shell: sh\n pass_filenames: false\n verbose: true\n \"});\n context.git_add(\".\");", "target": "#[cfg(unix)]\n#[test]\nfn shell_runs_multiline_entry_as_one_script() {\n let context = TestContext::new();\n context.init_project();\n context.write_pre_commit_config(indoc::indoc! {r\"\n repos:\n - repo: local\n hooks:\n - id: shell"} {"bin": "8_token_ish", "content_sha256": "ed58a9742475bd09d4ef99c1f964470cab24f7a919f64bc0379a1db0a91f17c5", "document_id": "steipete/agent-scripts@bb3688355a4c1894dd53b4ed867d1600918fadf0:skills/clawsweeper-status/scripts/clawsweeper-status.test.sh", "end": 1319, "example_id": "0018d4e8c72135b2fa7e5b9f54091351f471d94d58996fcee555b1cb8d5f8039", "language": "shell", "prefix": "intake\",\"status\":\"requested\",\"conclusion\":null,\"steps\":[]}]'\n ;;\n 25)\n printf '%s\\n' '[{\"name\":\"Review, comment, and apply event item\",\"status\":\"in_progress\",\"conclusion\":null,\"steps\":[]}]'\n ;;\n 26)\n printf '%s\\n' '[{\"", "repo": "steipete/agent-scripts", "span_codepoints": 32, "start": 1287, "suffix": "\"in_progress\",\"conclusion\":null,\"steps\":[]},{\"name\":\"Review shard 2\",\"status\":\"in_progress\",\"conclusion\":null,\"steps\":[]}]'\n ;;\n *)\n echo \"unexpected run view: $*\" >&2\n exit 1\n ;;\n esac\n ;;\n \"pr list\")\n printf '%s", "target": "name\":\"Review shard 1\",\"status\":"} {"bin": "8_token_ish", "content_sha256": "1dc3740d5855398479526fd2cf64538ce3fda7477b58ba3e7fd57b6338f875e6", "document_id": "unitycatalog/unitycatalog@ed504deea31b30c3e7d27e360372077cce04a509:server/src/main/java/io/unitycatalog/server/delta/serde/DeltaDataTypeModule.java", "end": 1859, "example_id": "0018e01c49a4c995bcfe19df2e54e2876e23d5530fa60a0dab9ce05bc742a592", "language": "java", "prefix": "r(\n new BeanDeserializerModifier() {\n @Override\n public JsonDeserializer modifyDeserializer(\n DeserializationConfig config,\n BeanDescription desc,\n JsonDeserializer deserializer) {\n ", "repo": "unitycatalog/unitycatalog", "span_codepoints": 32, "start": 1827, "suffix": "= DeltaDataType.class) {\n return new DeltaTypeDeserializer(deserializer);\n }\n return deserializer;\n }\n });\n setSerializerModifier(\n new BeanSerializerModifier() {\n @Override\n pu", "target": " if (desc.getBeanClass() ="} {"bin": "8_token_ish", "content_sha256": "fcf067fceb8e3428fdac592012b5de635307730e203700ca40e6347925a555a9", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:async-book/src/ch12-common-pitfalls.md", "end": 7226, "example_id": "0018edaed5b730cec68e59bc7c44d6bef70b5e9d3ad1acb5de8f6aaee5bb3478", "language": "markdown", "prefix": "locking_close();\n }\n}\n```\n\n**Best practice**: Provide an explicit `async fn close(self)` method and document that callers should use it. Rely on `Drop` only as a safety net, not the primary cleanup path.\n\n### select! Fairness and Starvation\n\n```rust\nuse", "repo": "microsoft/RustTraining", "span_codepoints": 32, "start": 7194, "suffix": ": busy_stream always wins, slow_stream starves\nasync fn unfair(mut fast: mpsc::Receiver, mut slow: mpsc::Receiver) {\n loop {\n tokio::select! {\n Some(v) = fast.recv() => println!(\"fast: {v}\"),\n Some(v) = slow.recv()", "target": " tokio::sync::mpsc;\n\n// ❌ UNFAIR"} {"bin": "8_token_ish", "content_sha256": "3e06a11a058d106b41a6c095d30621ed8ed6fbcb0f5ce728d4d894f2163d3628", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:internal/ogtags/integration_test.go", "end": 2217, "example_id": "0018f9e3d7f3b8a8aec1813bc40c7a353169b5248a4ccfac964417da67807241", "language": "go", "prefix": "lete Page\",\n\t\t\t\t\"og:description\": \"A page with many OG tags\",\n\t\t\t\t\"og:image\": \"http://example.com/image.jpg\",\n\t\t\t\t\"og:url\": \"http://example.com/complete\",\n\t\t\t\t\"og:type\": \"article\",\n\t\t\t},\n\t\t\texpectError: false,\n\t\t},\n\t\t{\n\t\t\tname: ", "repo": "TecharoHQ/anubis", "span_codepoints": 32, "start": 2185, "suffix": ": \"/no-og\",\n\t\t\tquery: \"\",\n\t\t\texpectedTags: map[string]string{},\n\t\t\texpectError: false,\n\t\t},\n\t\t{\n\t\t\tname: \"Nonexistent page\",\n\t\t\tpath: \"/not-found\",\n\t\t\tquery: \"\",\n\t\t\texpectedTags: nil,\n\t\t\texpectError: false,\n\t\t},\n\t}\n\n", "target": " \"Page with no OG tags\",\n\t\t\tpath"} {"bin": "8_token_ish", "content_sha256": "a5e7164a79b2cc691d4a5afbb42bfe29280389cb51545eee9cc7da0375e80ed7", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/commands/remove.ts", "end": 13334, "example_id": "001903b89765096a59edf0e18254f3fc1df1270ece1dad460a6b1ca15dc81c71", "language": "typescript", "prefix": "s(\"mcp\") || modes.includes(\"cli\");\n\n if (modes.includes(\"mcp\")) {\n result.mcp = await uninstallMcp(agentName, scope);\n }\n\n if (shouldRemoveRule) {\n result.rule = await uninstallRule(agentName, scope);\n }\n\n if (skillNames.length > 0) {\n result", "repo": "upstash/context7", "span_codepoints": 32, "start": 13302, "suffix": "agentName, scope, skillNames);\n }\n\n return result;\n}\n\nfunction iconForStatus(status: string): string {\n if (status === \"removed\") return pc.green(\"-\");\n if (status === \"not found\") return pc.dim(\"~\");\n return pc.red(\"!\");\n}\n\nfunction printResults(resu", "target": ".skills = await uninstallSkills("} {"bin": "8_token_ish", "content_sha256": "2817be1fbec189038d8c48a34726a35a39bf812ceba9f1a73795e97d64acf050", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/field.tsx", "end": 1513, "example_id": "00190b697205193dd5879b23d5a86b4beca4c1ae4b1f8bac13a85a275f0dc454", "language": "typescript", "prefix": "[slot=field-group]:gap-4\",\n className\n )}\n {...props}\n />\n )\n}\n\nconst fieldVariants = cva(\n \"group/field flex w-full gap-2 data-[invalid=true]:text-destructive\",\n {\n variants: {\n orientation: {\n vertical: \"flex-col *:w", "repo": "OpenCut-app/OpenCut", "span_codepoints": 32, "start": 1481, "suffix": " horizontal:\n \"flex-row items-center has-[>[data-slot=field-content]]:items-start *:data-[slot=field-label]:flex-auto has-[>[data-slot=field-content]]:[&>[role=checkbox],[role=radio]]:mt-px\",\n responsive:\n \"flex-col *:w-full @md", "target": "-full [&>.sr-only]:w-auto\",\n "} {"bin": "16_token_ish", "content_sha256": "dd5e395a2e41d9dce1c7fe241e9a59cae6a0cd72ff2640cce5160b7905d79687", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/utils/prompts.ts", "end": 2941, "example_id": "001915bfbe9c0b11dc803340c70af310d8c27559f3b010cba1f09bb817eda30a", "language": "typescript", "prefix": "\"object\" && c !== null && !(\"type\" in c && c.type === \"separator\")\n );\n const values = choices.map((c) => c.value);\n const totalItems = values.length;\n let cursorPosition = choices.findIndex((c) => !c.disabled);\n if (cursorPosition < 0) cursorPosition", "repo": "upstash/context7", "span_codepoints": 64, "start": 2877, "suffix": " const getName = options?.getName ?? ((v: T) => (v as { name: string }).name);\n\n const keypressHandler = (_str: string | undefined, key: readline.Key) => {\n if (key.name === \"up\") {\n let next = cursorPosition - 1;\n while (next >= 0 && choices", "target": " = 0;\n\n // Default getName assumes object has 'name' property\n "} {"bin": "64_token_ish", "content_sha256": "2085d460e2783e26a526af76070f699e3153218dc2c8df7ffb2ba0db9e393357", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:crates/rig-core/src/providers/mod.rs", "end": 2579, "example_id": "00196d43fa055921d9cccda4dfa5d3e94abbeef4d8e06195c3aa152f9965fd49", "language": "rust", "prefix": "ing support when the provider supports streaming;\n//! - provider-response error preservation plus `ProviderResponseExt` and\n//! telemetry fields consistent with nearby providers where applicable;\n//! - unit, cassette, or live-test coverage appropriate to", "repo": "0xPlaygrounds/rig", "span_codepoints": 256, "start": 2323, "suffix": ":{\n//! client::{CompletionClient, ProviderClient},\n//! completion::{AssistantContent, CompletionModel},\n//! providers::openai,\n//! };\n//!\n//! # async fn run() -> Result<(), Box> {\n//! // Initialize the OpenAI client\n//! l", "target": " the changed behavior;\n//! - root facade feature/docs updates for companion provider crates; and\n//! - examples and documentation that match the actual API, feature flags, and\n//! credential requirements.\n//!\n//! # Example\n//! ```no_run\n//! use rig_core:"} {"bin": "32_token_ish", "content_sha256": "e7c8fec3d2391a4034c89d78e2e526a03aa6a919c6603ae15d4bf3a38553c16e", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/core/completions/completion-provider.test.ts", "end": 8154, "example_id": "001976e1da32690a23403e2c0137cd09d2f01c402c850073c5c79c7d15395203", "language": "typescript", "prefix": "{\n changeIds: [],\n specIds: [],\n });\n });\n });\n\n describe('clearCache', () => {\n it('should clear all cached data', async () => {\n const changesDir = path.join(testDir, 'openspec', 'changes');\n await fs.mkdir(changesDir", "repo": "Fission-AI/OpenSpec", "span_codepoints": 128, "start": 8026, "suffix": "path.join(changesDir, 'change-1', 'proposal.md'), '# Change 1');\n\n // Populate cache\n await provider.getChangeIds();\n\n // Clear cache\n provider.clearCache();\n\n // Add new change\n await fs.mkdir(path.join(changesDir, 'change-2'", "target": ", { recursive: true });\n\n await fs.mkdir(path.join(changesDir, 'change-1'), { recursive: true });\n await fs.writeFile("} {"bin": "16_token_ish", "content_sha256": "ef12f7533b2dd0260ccbaa6b7484edff23376fb984670114411dc37093b188c2", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/spiders/templates/sitemap.py", "end": 2554, "example_id": "00198b64ed320fe2196d522e4000a38763968f91a38f71c49528b10d2e3dc599", "language": "python", "prefix": "eturn\n\n raise RuntimeError(\"`SitemapSpider` needs `sitemap_urls` to be set.\")\n\n async def parse(self, response: \"Response\") -> AsyncGenerator[Union[Dict[str, Any], Request, None], None]:\n \"\"\"Default callback for processing responses\"\"\"\n ", "repo": "D4Vinci/Scrapling", "span_codepoints": 64, "start": 2490, "suffix": "implement parse() method\")\n yield # Make this a generator for type checkers\n\n def _robots_body(self, response: \"Response\") -> List[str]:\n \"\"\"Extract `Sitemap` directives from a robots.txt body via protego.\"\"\"\n try:\n text", "target": " raise NotImplementedError(f\"{self.__class__.__name__} must "} {"bin": "64_token_ish", "content_sha256": "8ae6661de09a6b87b12dc22d7f668dc052374a9f6887aec48a36ada296c1f5c8", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/amazon/shared.js", "end": 1015, "example_id": "0019abcdc0ccaa31cb1b5830418ffc11873aaf03e10be5de3e5396fb0be45cba", "language": "javascript", "prefix": "nst PRODUCT_URL_PREFIX = 'https://www.amazon.com/dp/';\nexport const DISCUSSION_URL_PREFIX = 'https://www.amazon.com/product-reviews/';\nexport const STRATEGY = 'cookie';\nexport const PRIMARY_PRICE_SELECTORS = [\n '#corePrice_feature_div .a-offscreen',\n ", "repo": "jackwener/OpenCLI", "span_codepoints": 256, "start": 759, "suffix": "'#tp_price_block_total_price_ww',\n];\nconst ROBOT_TEXT_PATTERNS = [\n 'Sorry, we just need to make sure you\\'re not a robot',\n 'Enter the characters you see below',\n 'Type the characters you see in this image',\n 'To discuss automated access to Am", "target": " '#corePriceDisplay_desktop_feature_div .a-offscreen',\n '#corePrice_desktop .a-offscreen',\n '#apex_desktop .a-offscreen',\n '#newAccordionRow_0 .a-offscreen',\n '#price_inside_buybox',\n '#priceblock_ourprice',\n '#priceblock_dealprice',\n "} {"bin": "64_token_ish", "content_sha256": "2672a14a62dc3390d2f1249555e6befe2308ca0479a1e0e2006980170ba0396c", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:engineering-book/src/ch09-no-std-and-feature-verification.md", "end": 2650, "example_id": "0019eb6e67e2b8d4f59f37204816e5582097ab0cabd73eab829afb97bfb19424", "language": "markdown", "prefix": "rect-ipmi = [] # unsafe IPMI ioctl (ch05)\ndirect-accel-api = [] # unsafe accel-mgmt FFI (ch05)\n```\n\n```bash\n# Verify all features compile in isolation AND together\ncargo hack check --each-feature -p diag_tool\n# Catches", "repo": "microsoft/RustTraining", "span_codepoints": 256, "start": 2394, "suffix": "hack check --each-feature --workspace --no-dev-deps\n```\n\n> **Rule of thumb**: Run `cargo hack check --each-feature` in CI for any crate\n> with 2+ features. Run `--feature-powerset` only for core library crates with\n> <8 features — it's exponential ($2^n$ c", "target": ": \"feature 'windows' doesn't compile without 'direct-ipmi'\"\n# Catches: \"#[cfg(feature = \\\"linux\\\")] has a typo — it's 'lnux'\"\n```\n\n**CI integration:**\n\n```yaml\n# Add to CI pipeline (fast — just compilation checks)\n- name: Feature matrix check\n run: cargo "} {"bin": "16_token_ish", "content_sha256": "e7540a86fc80cdd3b0f6c7a332f60b360569342270ce3dd7ec204f7370e5a784", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:scripts/check-rule-copies.js", "end": 1896, "example_id": "001a0919fc36488cb6186d537cdd4e2cdb95aedc9dae65025fcd0a675301654f", "language": "javascript", "prefix": "st INVARIANTS = [\n 'in this codebase', // ladder rung: reuse what already exists (#217)\n 'naive heuristic', // ceiling-comment rule\n 'ONE runnable check', // test reflex\n 'flimsier algorithm", "repo": "DietrichGebert/ponytail", "span_codepoints": 64, "start": 1832, "suffix": "lazy about\" safety carve-outs: pin each so a reword in either\n // file can't silently drop one. Only validation was pinned before. These are the\n // continuous substrings present in both files (\"prevents data loss\" because the\n // full \"error handling t", "target": "', // robust-variant rule\n // the four \"not "} {"bin": "64_token_ish", "content_sha256": "32ae36fe7f395dbc5c0a3fd3f09b62f2e7c96dba77362530c4f325a7f19ab70e", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_ipynb_converter.py", "end": 610, "example_id": "001a263c35f4673278868b2e00a62b98a446bf00c87ca4de2474d06a2ac3b30f", "language": "python", "prefix": "umentConverterResult\nfrom .._exceptions import FileConversionException\nfrom .._stream_info import StreamInfo\n\nCANDIDATE_MIME_TYPE_PREFIXES = [\n \"application/json\",\n]\n\nACCEPTED_FILE_EXTENSIONS = [\".ipynb\"]\n\n\nclass IpynbConverter(DocumentConverter):\n \"", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 354, "suffix": "info.mimetype or \"\").lower()\n extension = (stream_info.extension or \"\").lower()\n\n if extension in ACCEPTED_FILE_EXTENSIONS:\n return True\n\n for prefix in CANDIDATE_MIME_TYPE_PREFIXES:\n if mimetype.startswith(prefix", "target": "\"\"Converts Jupyter Notebook (.ipynb) files to Markdown.\"\"\"\n\n def accepts(\n self,\n file_stream: BinaryIO,\n stream_info: StreamInfo,\n **kwargs: Any, # Options to pass to the converter\n ) -> bool:\n mimetype = (stream_"} {"bin": "16_token_ish", "content_sha256": "ce47440d23e342f9663394a1011db0568ffadbe5ae9303dceef32456dc8b26b8", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:test/helpers/run-cli.ts", "end": 3256, "example_id": "001a27df35b54f86e6d6462ac78134faeb81464b2df1ac8bdd7a1d64bee56215", "language": "typescript", "prefix": "t() {\n if (existsSync(cliEntry)) {\n return;\n }\n\n if (!buildPromise) {\n buildPromise = runCommand('pnpm', ['run', 'build']).catch((error) => {\n buildPromise = undefined;\n throw error;\n });\n }\n\n await buildPromise;\n\n if (!existsSync(", "repo": "Fission-AI/OpenSpec", "span_codepoints": 64, "start": 3192, "suffix": "build. Expected dist/cli/index.js');\n }\n}\n\nexport async function runCLI(args: string[] = [], options: RunCLIOptions = {}): Promise {\n await ensureCliBuilt();\n\n const finalArgs = Array.isArray(args) ? args : [args];\n const invocation = [cl", "target": "cliEntry)) {\n throw new Error('CLI entry point missing after "} {"bin": "16_token_ish", "content_sha256": "39def14b329c32391ccf023b45e9d1bbf05de9695cd79ef9ce32b5692a46ce97", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:rust-patterns-book/src/ch00-introduction.md", "end": 945, "example_id": "001a536d2d85f60fa97c75972ae3368cab5ea5f0b8177a99fc58a12b1c279453", "language": "markdown", "prefix": " isolates one concept, explains when and why to use it, and provides compilable examples with inline exercises.\n\n## Who This Is For\n\n- Developers who have finished *The Rust Programming Language* but struggle with \"how do I actually design this?\"\n- C++/C# ", "repo": "microsoft/RustTraining", "span_codepoints": 64, "start": 881, "suffix": "has hit a wall with generics, trait bounds, or lifetime errors and wants a systematic toolkit\n\n## Prerequisites\n\nBefore starting, you should be comfortable with:\n- Ownership, borrowing, and lifetimes (basic level)\n- Enums, pattern matching, and `Option`/`R", "target": "engineers translating production systems into Rust\n- Anyone who "} {"bin": "64_token_ish", "content_sha256": "5527c211ac7776602985d2f9417a65c3b86f47d2875f99ade4c1f3502777beb6", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:skills/open-source/references/tools.md", "end": 1276, "example_id": "001a57e8c99c1899dd909197dab6b85733b9b894eaf4f866bf10e854b9fc3355", "language": "markdown", "prefix": "** Parameter MUST be named `browser_session: BrowserSession`, not `browser: Browser`. Agent injects by name matching — wrong name fails silently.\n\n## Adding Custom Tools\n\n```python\n@tools.action(description='Fill out banking forms', allowed_domains=['https", "repo": "browser-use/browser-use", "span_codepoints": 256, "start": 1020, "suffix": "this to decide when to call\n- `allowed_domains`: Domains where tool can run (default: all)\n\n### Pydantic Input\n\n```python\nfrom pydantic import BaseModel, Field\n\nclass Car(BaseModel):\n name: str = Field(description='Car name, e.g. \"Toyota Camry\"')\n pr", "target": "://mybank.com'])\nasync def fill_bank_form(account_number: str) -> ActionResult:\n return ActionResult(extracted_content=f'Filled form for account {account_number}')\n```\n\n**Decorator parameters:**\n- `description` (required): What the tool does — LLM uses "} {"bin": "32_token_ish", "content_sha256": "c25d7546da3942d3d27ad00c9e73d5243d7a961e9de871b4559a37d4c29c807e", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/test_ax_name_matching.py", "end": 7196, "example_id": "001a57e9f4060640db67e46f95f2d3ddb0ab04ecc5bfe7e1a98321ad0632d197", "language": "python", "prefix": "er=1, step_interval=0.1),\n\t)\n\n\tclick_step = AgentHistory(\n\t\tmodel_output=AgentOutput(\n\t\t\tevaluation_previous_goal=None,\n\t\t\tmemory='Click Submit',\n\t\t\tnext_goal=None,\n\t\t\taction=[{'click': {'index': 1}}], # type: ignore[arg-type]\n\t\t),\n\t\tresult=[ActionResult(", "repo": "browser-use/browser-use", "span_codepoints": 128, "start": 7068, "suffix": "historical_element],\n\t\t),\n\t\tmetadata=StepMetadata(step_start_time=1, step_end_time=2, step_number=2, step_interval=0.1),\n\t)\n\n\thistory = AgentHistoryList(history=[navigate_step, click_step])\n\n\ttry:\n\t\t# Should fail because no SPAN with ax_name \"Submit\" exist", "target": "long_term_memory='Clicked')],\n\t\tstate=BrowserStateHistory(\n\t\t\turl=test_url,\n\t\t\ttitle='Test',\n\t\t\ttabs=[],\n\t\t\tinteracted_element=["} {"bin": "8_token_ish", "content_sha256": "69b3a396d37da516b901d0b77db7129d10cdb9cd5df3c644178068ee6a57f585", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:crates/rig-core/src/providers/gemini/interactions_api/streaming.rs", "end": 11955, "example_id": "001a58bfb696437f7d1b2f6e6bc8268d401ec4f4cbeff812155a00336e4423fa", "language": "rust", "prefix": "reamingCompletionResponse {\n usage: None,\n interaction: None,\n model_version: Some(\"gemini-2.5-pro-preview-05-06\".to_string()),\n };\n\n assert_eq!(\n response.model_version.as_deref(),\n Some", "repo": "0xPlaygrounds/rig", "span_codepoints": 32, "start": 11923, "suffix": "\n );\n\n let json = serde_json::to_string(&response).unwrap();\n let deserialized: StreamingCompletionResponse = serde_json::from_str(&json).unwrap();\n assert_eq!(\n deserialized.model_version.as_deref(),\n Some", "target": "(\"gemini-2.5-pro-preview-05-06\")"} {"bin": "16_token_ish", "content_sha256": "08518cd096e6c127bd1cebe83e6d1d6551bc3de2d1781bd1b7d9249f31e74708", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/arxiv/utils.js", "end": 1642, "example_id": "001a5d7ca59fe7ddb5705a5c773af0fe9434c7fc8fa85c366fc830f2e1854fd0", "language": "javascript", "prefix": "hysics.comp-ph`);\n }\n return category;\n}\n/** Decode the small set of XML entities arXiv emits in text fields. */\nfunction decodeEntities(s) {\n return s\n .replace(/&/g, '&')\n .replace(/</g, '<')\n .replace(/>/g, '>')\n ", "repo": "jackwener/OpenCLI", "span_codepoints": 64, "start": 1578, "suffix": "\n .replace(/'/g, \"'\");\n}\n/** Extract the text content of the first matching XML tag. */\nfunction extract(xml, tag) {\n const m = xml.match(new RegExp(`<${tag}[^>]*>([\\\\s\\\\S]*?)<\\\\/${tag}>`));\n return m ? m[1].trim() : '';\n}\n/** Extract all ", "target": " .replace(/"/g, '\"')\n .replace(/'/g, \"'\")"} {"bin": "32_token_ish", "content_sha256": "4eb687f37aa26f2ca5fc8a373e58e2cc75e6e5b47ad283ff8719d8c410cf8a29", "document_id": "cloudwego/eino@ca0441ac0bceed8945dcf7d5a18c237c924c6aa8:components/tool/utils/create_options.go", "end": 1885, "example_id": "001a75e72ee45cc6f7f166bc75bcc216f11c5cd1d2b1cd0fb6082f3f0e97c762", "language": "go", "prefix": "want to marshal the output by yourself, you can use this option.\nfunc WithMarshalOutput(m MarshalOutput) Option {\n\treturn func(o *toolOptions) {\n\t\to.m = m\n\t}\n}\n\n// SchemaModifierFn is the schema modifier function for inferring tool parameter from tagged go", "repo": "cloudwego/eino", "span_codepoints": 128, "start": 1757, "suffix": "// 1. jsonTagName: the name defined in the json tag. Specifically, the last 'jsonTagName' visited is fixed to be '_root', which represents the entire go struct. Also, for array field, both the field itself and the element within the array will trigger this", "target": " struct.\n// Within this function, end-user can parse custom go struct tags into corresponding json schema field.\n// Parameters:\n"} {"bin": "64_token_ish", "content_sha256": "67f12660b2279922adcefd6c112b851830dc1d9b2c9f240b190c849d33e837b3", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:pi-extension/index.js", "end": 903, "example_id": "001a83847fbfadce35a5379c7bae542a2c7c167ef6af00e909edd11a554cd84c", "language": "javascript", "prefix": "./hooks/ponytail-instructions.js\");\n\nexport { filterSkillBodyForMode };\nexport const readDefaultMode = getDefaultMode;\nexport const readQuietStartup = getQuietStartup;\n\nconst RUNTIME_MODE_LIST = RUNTIME_MODES.join(\"|\");\nconst PONYTAIL_COMMAND_DESCRIPTION =", "repo": "DietrichGebert/ponytail", "span_codepoints": 256, "start": 647, "suffix": "fallback;\n\n for (let i = entries.length - 1; i >= 0; i -= 1) {\n const entry = entries[i];\n if (entry?.type !== \"custom\" || entry?.customType !== \"ponytail-mode\") continue;\n\n const mode = normalizePersistedMode(entry?.data?.mode);\n if (mode) re", "target": " `Set mode: ${RUNTIME_MODE_LIST}. Commands: status, default `;\n\nexport function resolveSessionMode(entries, fallbackMode = DEFAULT_MODE) {\n const fallback = normalizePersistedMode(fallbackMode) || DEFAULT_MODE;\n if (!Array.isArray(entries)) return "} {"bin": "32_token_ish", "content_sha256": "169bacf2ebafeaa14322edd1eee61b3e09378bec00649ae04a60bdb3d8dd900a", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:tests/test_caveman_init.js", "end": 2596, "example_id": "001a83ffd07d9ca260123969bd3f59bf7ebd8a4cb3bf8f330c253eb8f2ee5698", "language": "javascript", "prefix": " const out = runInit(tmp);\n // 6 repo rule files skipped-already-installed + openclaw skipped (no workspace)\n assert.match(out, /7 skipped/);\n assert.doesNotMatch(out, /[1-9]\\d* added/);\n});\n\ntest('append mode: existing AGENTS.md gets caveman appended (", "repo": "JuliusBrussee/caveman", "span_codepoints": 128, "start": 2468, "suffix": ");\n const agents = fs.readFileSync(path.join(tmp, 'AGENTS.md'), 'utf8');\n assert.match(agents, /Do not delete me/);\n assert.match(agents, /Respond terse like smart caveman/);\n});\n\ntest('skip mode: existing .cursor rule is not overwritten without --force", "target": "not replaced)', (tmp) => {\n fs.writeFileSync(path.join(tmp, 'AGENTS.md'), '# My project\\n\\nDo not delete me.\\n');\n runInit(tmp"} {"bin": "64_token_ish", "content_sha256": "e8c3a4beb34b69c86a17c3ee673927421b3d6c514dcb8eb0c55123dc4af04f8c", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_xlsx_converter.py", "end": 688, "example_id": "001a9083f37baf65893a8b67c55ada42352cec9bed8bba59242c736465fbb9c4", "language": "python", "prefix": "ns import MissingDependencyException, MISSING_DEPENDENCY_MESSAGE\nfrom .._stream_info import StreamInfo\n\n# Try loading optional (but in this case, required) dependencies\n# Save reporting of any exceptions for later\n_xlsx_dependency_exc_info = None\ntry:\n ", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 432, "suffix": "dependency_exc_info = sys.exc_info()\n\nACCEPTED_XLSX_MIME_TYPE_PREFIXES = [\n \"application/vnd.openxmlformats-officedocument.spreadsheetml.sheet\"\n]\nACCEPTED_XLSX_FILE_EXTENSIONS = [\".xlsx\"]\n\nACCEPTED_XLS_MIME_TYPE_PREFIXES = [\n \"application/vnd.ms-exce", "target": "import pandas as pd\n import openpyxl # noqa: F401\nexcept ImportError:\n _xlsx_dependency_exc_info = sys.exc_info()\n\n_xls_dependency_exc_info = None\ntry:\n import pandas as pd # noqa: F811\n import xlrd # noqa: F401\nexcept ImportError:\n _xls_"} {"bin": "16_token_ish", "content_sha256": "743a95763d51fa9985023c17fc13a52c078ae3a4695698a68355378145d396e7", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/fetchers/test_impersonate_list.py", "end": 5731, "example_id": "001aa12313f5a046cca49a87c46816960c569e40e4deb071bed0e742180293f0", "language": "python", "prefix": "ion.get(self.basic_url, impersonate=request_browsers)\n assert response.status == 200\n\n\nclass TestImpersonateTypeValidation:\n \"\"\"Test type validation for impersonate parameter.\"\"\"\n\n def test_impersonate_accepts_string(self):\n \"\"\"Test", "repo": "D4Vinci/Scrapling", "span_codepoints": 64, "start": 5667, "suffix": "not raise any type errors\n session = FetcherSession(impersonate=\"chrome\")\n assert session._default_impersonate == \"chrome\"\n\n def test_impersonate_accepts_list(self):\n \"\"\"Test that impersonate accepts list type.\"\"\"\n # This sho", "target": " that impersonate accepts string type.\"\"\"\n # This should "} {"bin": "8_token_ish", "content_sha256": "67f12660b2279922adcefd6c112b851830dc1d9b2c9f240b190c849d33e837b3", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:pi-extension/index.js", "end": 3799, "example_id": "001aac96833b3cb2a44a881248dbc902dbce4b51851a26e322935c38b37ee5fc", "language": "javascript", "prefix": " => {\n const normalized = String(args || \"\").trim();\n const message = normalized ? `${skillName} ${normalized}` : skillName;\n\n if (ctx?.isIdle?.() === false) {\n pi.sendUserMessage(message, { deliverAs: \"followUp\" });\n ctx?.ui?.notify?.(`", "repo": "DietrichGebert/ponytail", "span_codepoints": 32, "start": 3767, "suffix": ".`, \"info\");\n return;\n }\n\n pi.sendUserMessage(message);\n };\n\n pi.registerCommand(\"ponytail\", {\n description: PONYTAIL_COMMAND_DESCRIPTION,\n handler: async (args, ctx) => {\n const parsed = parsePonytailCommand(args, configuredDefault", "target": "${skillName} queued as follow-up"} {"bin": "64_token_ish", "content_sha256": "9174718df90572538ea76e33692981404a4fc958e6aaaeb00961646dec49d5b6", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/openalex/work.js", "end": 1235, "example_id": "001aad6e2329619c97a103b3cbdeffdd1c2f84abf34c14aff9254a4f53d03c03", "language": "javascript", "prefix": "unt', 'authorships', 'primary_location', 'open_access', 'type',\n 'referenced_works', 'related_works', 'language', 'abstract_inverted_index',\n].join(',');\n\ncli({\n site: 'openalex',\n name: 'work',\n access: 'read',\n description: 'Fetch a single", "repo": "jackwener/OpenCLI", "span_codepoints": 256, "start": 979, "suffix": " DOI (\"10.7717/peerj.4375\"), or full URL' },\n ],\n columns: ['id', 'title', 'type', 'year', 'date', 'language', 'authors', 'venue', 'citations', 'openAccess', 'openAccessUrl', 'referencedCount', 'doi', 'abstract', 'url'],\n func: async (args) => {\n ", "target": " OpenAlex Work (paper / preprint / book) — metadata + abstract',\n domain: 'api.openalex.org',\n strategy: Strategy.PUBLIC,\n browser: false,\n args: [\n { name: 'id', positional: true, required: true, help: 'OpenAlex Work id (\"W2741809807\"),"} {"bin": "64_token_ish", "content_sha256": "9df7c88562b71531d2c3276c5804a29df072b2222eaf9c85432bf7317588ccd1", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/xiaohongshu/creator-notes-summary.js", "end": 1265, "example_id": "001ab8ee233c5ee55cd22743065646a82d03132b74c1be6ca3e3b5f0a0752ba4", "language": "javascript", "prefix": "prefix) && row.value);\n if (matches.length === 0)\n return { label: '', value: '' };\n const sorted = [...matches].sort((a, b) => parseFloat(b.value) - parseFloat(a.value));\n const top = sorted[0];\n return {\n label: top.metric.slice", "repo": "jackwener/OpenCLI", "span_codepoints": 256, "start": 1009, "suffix": " rank,\n id: note.id,\n title: note.title,\n published_at: findDetailValue(rows, 'published_at') || note.date,\n views: findDetailValue(rows, '观看数') || String(note.views),\n likes: findDetailValue(rows, '点赞数') || String(", "target": "(prefix.length),\n value: top.value,\n };\n}\nexport function summarizeCreatorNote(note, rows, rank) {\n const topSource = findTopBySectionPrefix(rows, '观看来源', '');\n const topInterest = findTopBySectionPrefix(rows, '观众画像', '兴趣/');\n return {\n "} {"bin": "32_token_ish", "content_sha256": "5b753d325fa4bbc040bdb3da170853ca1000da2826617fe56f6c65d123339097", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/fetchers/test_proxy_rotation.py", "end": 943, "example_id": "001ad7113107518b1827fe8df61350bba182fa66052259789e71aa909042278a", "language": "python", "prefix": "roxy == \"http://p1:8080\"\n assert next_idx == 1\n\n proxy, next_idx = cyclic_rotation(proxies, 1)\n assert proxy == \"http://p2:8080\"\n assert next_idx == 2\n\n proxy, next_idx = cyclic_rotation(proxies, 2)\n assert proxy =", "repo": "D4Vinci/Scrapling", "span_codepoints": 128, "start": 815, "suffix": " that cyclic_rotation handles index overflow\"\"\"\n proxies = [\"http://p1:8080\", \"http://p2:8080\"]\n\n # Index larger than list length should wrap\n proxy, next_idx = cyclic_rotation(proxies, 5)\n assert proxy == \"http://p2:8080\" # 5 ", "target": "= \"http://p3:8080\"\n assert next_idx == 0 # Wraps around\n\n def test_cyclic_rotation_wraps_index(self):\n \"\"\"Test"} {"bin": "8_token_ish", "content_sha256": "5baae817d107ad948db05ed348477fea168289f3f29a4eddcc7466d5575da497", "document_id": "modelcontextprotocol/java-sdk@fd004989b9484c9b81be6b03463396797b354804:mcp-test/src/main/java/io/modelcontextprotocol/server/AbstractMcpSyncServerTests.java", "end": 22868, "example_id": "001ae567490d338bbd7a7b6d0df774ed6d95c45cae948004997da3b903818408", "language": "java", "prefix": "];\n\t\tvar consumer2Called = new boolean[1];\n\t\tvar rootsContent = new List[1];\n\n\t\tvar multipleConsumersServer = prepareSyncServerBuilder().serverInfo(\"test-server\", \"1.0.0\")\n\t\t\t.rootsChangeHandlers(List.of((exchange, roots) -> {\n\t\t\t\tconsumer1Called[0] = true", "repo": "modelcontextprotocol/java-sdk", "span_codepoints": 32, "start": 22836, "suffix": "\t\t}, (exchange, roots) -> consumer2Called[0] = true))\n\t\t\t.build();\n\n\t\tassertThat(multipleConsumersServer).isNotNull();\n\t\tassertThatCode(multipleConsumersServer::closeGracefully).doesNotThrowAnyException();\n\t\tonClose();\n\n\t\t// Test error handling\n\t\tvar error", "target": ";\n\t\t\t\trootsContent[0] = roots;\n\t"} {"bin": "16_token_ish", "content_sha256": "266573d83fdc357b85a436d69e5d1b82b4a41b26611d24696fb009534f29cc7c", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:tests/fuzz/shadow-corrupt.c", "end": 1549, "example_id": "001aebdb192434ca333ecc7271e2f1fd4ae31518b001ba9d3f1f849d4d59b847", "language": "c", "prefix": "data\n rc = sqlite3_prepare_v2(db,\n \"UPDATE v_chunks SET validity = ? WHERE rowid = 1\", -1, &stmt, NULL);\n if (rc == SQLITE_OK) {\n sqlite3_bind_blob(stmt, 1, payload, payload_size, SQLITE_STATIC);\n sqlite3_step(stmt);\n ", "repo": "asg017/sqlite-vec", "span_codepoints": 64, "start": 1485, "suffix": "\n // Corrupt _chunks rowids blob with fuzz data\n rc = sqlite3_prepare_v2(db,\n \"UPDATE v_chunks SET rowids = ? WHERE rowid = 1\", -1, &stmt, NULL);\n if (rc == SQLITE_OK) {\n sqlite3_bind_blob(stmt, 1, payload, payload_size, SQLITE", "target": "sqlite3_finalize(stmt);\n }\n break;\n }\n case 1: {"} {"bin": "16_token_ish", "content_sha256": "59d1436f06a74f2f7327e458fb476980577487ef9d3f8168308197d4b73e605a", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:examples/apps/ad-use/ad_generator.py", "end": 10933, "example_id": "001af4928abaff1bec4c132a60c9e935b5fd58c604f4712e0cce9168b0977454", "language": "python", "prefix": "d: int = 1):\n\tanalyzer = LandingPageAnalyzer(debug=debug)\n\n\ttry:\n\t\tif ad_id == 1:\n\t\t\tprint(f'🚀 Analyzing {url} for {mode.capitalize()} ad...')\n\t\t\tpage_data = await analyzer.analyze_landing_page(url, mode=mode)\n\t\telse:\n\t\t\tanalyzer_temp = LandingPageAnalyzer", "repo": "browser-use/browser-use", "span_codepoints": 64, "start": 10869, "suffix": "_page(url, mode=mode)\n\n\t\tgenerator = AdGenerator(mode=mode)\n\n\t\tif mode == 'instagram':\n\t\t\tprompt = generator.create_ad_prompt(page_data['analysis'])\n\t\t\tad_content = await generator.generate_ad_image(prompt, page_data.get('screenshot_path'))\n\t\t\tif ad_conten", "target": "(debug=debug)\n\t\t\tpage_data = await analyzer_temp.analyze_landing"} {"bin": "64_token_ish", "content_sha256": "4a917370dfb68dcf981252756ee4ff2e2915a27993a583dd0d43e61977a62609", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:src/commands/store.ts", "end": 18691, "example_id": "001af802d0b49c29a3807b8621355804dac93a882a18ee791ae79f85d3a5877a", "language": "typescript", "prefix": "ND_REGISTRY.find((entry) => entry.name === 'store')?.description ??\n 'Create and manage stores - standalone OpenSpec repos you register on this machine';\n const store = program.command('store').description(storeGroupDescription);\n\n store\n .command(", "repo": "Fission-AI/OpenSpec", "span_codepoints": 256, "start": 18435, "suffix": " .option('--no-init-git', 'Skip every Git action: no init, no initial commit')\n .option('--remote ', 'Canonical clone source recorded in store.yaml')\n .option('--json', 'Output as JSON')\n .action(async (id: string | undefined, options: Stor", "target": "'setup [id]')\n .description('Create and register a local store')\n .option('--path ', 'Folder where the store should live (for example ~/openspec/)')\n .option('--init-git', 'Initialize a Git repository with an initial commit (default)')\n "} {"bin": "64_token_ish", "content_sha256": "4621b61096a1629d44edfe74b8cad267456b03794789f6065d1e5f8ef4ee719c", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/test_multi_act_guards.py", "end": 7205, "example_id": "001b09198c13aa3700b2b763ce31736882af61fb79eeb7ad1c778241609e0444", "language": "python", "prefix": "on_model()\n\t\tactions = [\n\t\t\tActionModel.model_validate({'go_back': {}}),\n\t\t\tActionModel.model_validate({'scroll': {'down': True, 'pages': 1}}),\n\t\t]\n\n\t\tmock_llm = create_mock_llm()\n\t\tagent = Agent(task='test', llm=mock_llm, browser_session=browser_session, ", "repo": "browser-use/browser-use", "span_codepoints": 256, "start": 6949, "suffix": "----------------------\n# 3. Runtime guard — click on link changes URL, remaining actions skipped\n# ---------------------------------------------------------------------------\n\n\nclass TestRuntimeGuard:\n\t\"\"\"Verify that URL/focus changes detected at runtime a", "target": "tools=tools)\n\n\t\tresults = await agent.multi_act(actions)\n\n\t\t# go_back should terminate the sequence — only 1 result\n\t\tassert len(results) == 1, f'Expected 1 result but got {len(results)}: {results}'\n\n\n# -----------------------------------------------------"} {"bin": "32_token_ish", "content_sha256": "46b85514156e504c086ad1931586c8f34a0b150f8900a83f5fc8cce765bc90f9", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:c-cpp-book/src/ch08-crates-and-modules.md", "end": 595, "example_id": "001b0c3032bede88e1cf7791163850e95668bfe2e950926c90b0fdd7389c7335", "language": "markdown", "prefix": "der files, `#include`, and CMake dependency management.\n\n- Modules are the fundamental organizational unit of code within crates\n - Each source file (.rs) is its own module, and can create nested modules using the ```mod``` keyword.\n - All types in a", "repo": "microsoft/RustTraining", "span_codepoints": 128, "start": 467, "suffix": " as ```pub``` (public). The scope of ```pub``` can be further restricted to ```pub(crate)```, etc\n - Even if a type is public, it doesn't automatically become visible within the scope of another module unless it's imported using the ```use``` keyword. C", "target": " (sub-) module are **private** by default, and aren't externally visible within the same crate unless they are explicitly marked"} {"bin": "8_token_ish", "content_sha256": "25bf224c95efef7f424e6fcbbe72ac1b10ff5f030c244260a0a5723be8210325", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:tests/installer/e2e.freshinstall.test.mjs", "end": 24472, "example_id": "001b180e5ea12cc01adf41677e999607042f016bacd2cc57f5a0579f6c546f49", "language": "javascript", "prefix": "OOT, 'bin', 'lib', 'openclaw.js'));\n const dir = freshTmpDir();\n const soul = path.join(dir, 'SOUL.md');\n try {\n fs.writeFileSync(soul, 'before\\n' + helper.MARK_END + '\\nafter\\n');\n const s = helper.stripBootstrapFromSoul(soul);\n assert.equal(s", "repo": "JuliusBrussee/caveman", "span_codepoints": 32, "start": 24440, "suffix": " = fs.readFileSync(soul, 'utf8');\n assert.match(after, /before/);\n assert.match(after, /after/);\n assert.doesNotMatch(after, /caveman-end/);\n } finally {\n fs.rmSync(dir, { recursive: true, force: true });\n }\n});\n\ntest('openclaw: append on a w", "target": ".changed, true);\n const after"} {"bin": "16_token_ish", "content_sha256": "45047d9065bebf4b08ee120b5c9c479614be1631ff027439dbe931b7e627620d", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:crates/rig-core/src/providers/xai/completion.rs", "end": 1201, "example_id": "001b1ac9bfd2e7f912df71f2216d876f16ec7a31e7a5e8c161a9af7a74605cde", "language": "rust", "prefix": "ub const GROK_2_1212: &str = \"grok-2-1212\";\npub const GROK_2_VISION_1212: &str = \"grok-2-vision-1212\";\npub const GROK_3: &str = \"grok-3\";\npub const GROK_3_FAST: &str = \"grok-3-fast\";\npub const GROK_3_MINI: &str = \"grok-3-mini\";\npub const GROK_3_MINI_FAST: ", "repo": "0xPlaygrounds/rig", "span_codepoints": 64, "start": 1137, "suffix": "grok-2-image-1212\";\npub const GROK_4: &str = \"grok-4-0709\";\n\n// ================================================================\n// Request Types\n// ================================================================\n\n#[derive(Debug, Serialize, Deserialize)]\n", "target": "&str = \"grok-3-mini-fast\";\npub const GROK_2_IMAGE_1212: &str = \""} {"bin": "8_token_ish", "content_sha256": "1e8c05cf577f582439d8bbe8b090f854d0f784829ad07dcf2cc4acdb993c5b1b", "document_id": "dockur/windows@36d127d8cfdccb007e03a0c2ee579f75685605fc:src/samba.sh", "end": 4138, "example_id": "001b394c9e93ca7bd8224c1ad9c1616bccb5680d61a0b462b9995bdee50158d6", "language": "shell", "prefix": " force user = root\"\n echo \" force group = root\"\n echo \" force create mode = 0666\"\n echo \" force directory mode = 02777\"\n echo \"\"\n echo \" # Disable printing services\"\n echo \" load printers = no\"\n echo \" printing = bsd", "repo": "dockur/windows", "span_codepoints": 32, "start": 4106, "suffix": "/dev/null\"\n echo \" disable spoolss = yes\"\n } > \"$SAMBA_CONFIG\"; then\n error \"Failed to write Samba config \\\"$SAMBA_CONFIG\\\" !\"\n return 1\n fi\n\n return 0\n}\n\nselectPrimaryShare() {\n\n local tmp=\"/tmp/smb\"\n\n if ! rm -rf \"$tmp\"; then\n error \"", "target": "\"\n echo \" printcap name = "} {"bin": "32_token_ish", "content_sha256": "e8c3a4beb34b69c86a17c3ee673927421b3d6c514dcb8eb0c55123dc4af04f8c", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_xlsx_converter.py", "end": 4230, "example_id": "001b5dcaea6290d629ace2d9a2fdb7a1618543072b0e3c6ca9ef95bfeb1ceafe", "language": "python", "prefix": " # Options to pass to the converter\n ) -> DocumentConverterResult:\n # Load the dependencies\n if _xls_dependency_exc_info is not None:\n raise MissingDependencyException(\n MISSING_DEPENDENCY_MESSAGE.format(\n ", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 4102, "suffix": " )\n ) from _xls_dependency_exc_info[\n 1\n ].with_traceback( # type: ignore[union-attr]\n _xls_dependency_exc_info[2]\n )\n\n sheets = pd.read_excel(file_stream, sheet_name=None, engine=\"", "target": " converter=type(self).__name__,\n extension=\".xls\",\n feature=\"xls\",\n "} {"bin": "64_token_ish", "content_sha256": "69cc8ae62cec8ea6a5108b8505b4a4d8816dc8e835610424e9ca7f0504f11d70", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/xianyu/publish.test.js", "end": 6208, "example_id": "001b6f6884e8d8879791562206dd5c07f01655623c15ffc1101c09fb32616443", "language": "javascript", "prefix": "\n ],\n }), validArgs)).rejects.toBeInstanceOf(CommandExecutionError);\n });\n\n it('uploads validated local images through the discovered file input', async () => {\n const page = makePage({\n evaluateResults: [\n ", "repo": "jackwener/OpenCLI", "span_codepoints": 256, "start": 5952, "suffix": ", url: 'https://www.goofish.com/item?id=123456789012' },\n ],\n });\n\n await publishCommand.func(page, { ...validArgs, images: 'a.png,b.webp' });\n\n expect(page.setFileInput).toHaveBeenCalledWith(['/abs/a.png', '/abs/b.webp'], '", "target": " { hasPublishForm: true },\n { ok: true },\n { ok: true, missing: [] },\n { ok: true, selector: '[id=\"upload\"]' },\n { ok: true },\n { status: 'published', item_id: '123456789012'"} {"bin": "8_token_ish", "content_sha256": "d83f50b7e03cacf4aa765e53e5db8849bf5f37f22d20dbe9cec0aa099b05928a", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/tests/languages/system.rs", "end": 1583, "example_id": "001b777bb6cb4c8c6f0c7a53f0e8fe7481378a2f79fbd68b1bb4c82f456da7c0", "language": "rust", "prefix": " echo second\n shell: sh\n pass_filenames: false\n verbose: true\n \"});\n context.git_add(\".\");\n\n cmd_snapshot!(context.filters(), context.run(), @r\"\n success: true\n exit_code: 0\n ----- stdout -----", "repo": "j178/prek", "span_codepoints": 32, "start": 1551, "suffix": "..............................................Passed\n - hook id: shell-script\n - duration: [TIME]\n\n first\n second\n\n ----- stderr -----\n \");\n}\n\n#[cfg(unix)]\n#[test]\nfn shell_entry_receives_hook_args_before_filenames() -> anyhow::Result", "target": "\n shell-script..............."} {"bin": "16_token_ish", "content_sha256": "b5605939a6cb527522511e86e34ab8818263cf47ff3b9d0ec6e4dea481e3fd65", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/engines/_browsers/_base.py", "end": 16640, "example_id": "001b80aa8933113db428edee5ff03743864bc6b9cad8ac14d2c0c00004da1b7c", "language": "python", "prefix": " params[\"max_pages\"] = params.pop(\"__max_pages\")\n\n config = validate(params, model=model)\n self._headers_keys = (\n {header.lower() for header in config.extra_headers.keys()} if config.extra_headers else set()\n )\n\n ", "repo": "D4Vinci/Scrapling", "span_codepoints": 64, "start": 16576, "suffix": "Tuple | None = None) -> None:\n config: PlaywrightConfig | StealthConfig = self._config\n self._context_options.update(\n {\n \"proxy\": config.proxy,\n \"locale\": config.locale,\n \"timezone_id\":", "target": " return config\n\n def __generate_options__(self, extra_flags: "} {"bin": "32_token_ish", "content_sha256": "ea5d061af29ddbd393e6d097b152876e64f5beab4c839e74a48b43a52aac2ed2", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/fetchers/async/test_dynamic_session.py", "end": 1910, "example_id": "001b8ecefb04d095044635c95635a608f88b99d6077c6ff62a6e487cd97ee4d4", "language": "python", "prefix": "ion.fetch(urls[\"basic\"])\n\n async def test_page_pool_management(self, urls):\n \"\"\"Test page pool creation and reuse\"\"\"\n async with AsyncDynamicSession() as session:\n # The first request creates a page\n response = await ", "repo": "D4Vinci/Scrapling", "span_codepoints": 128, "start": 1782, "suffix": " \n # The second request should reuse the page\n response = await session.fetch(urls[\"html\"])\n assert response.status == 200\n assert session.page_pool.pages_count == 0\n\n # Check pool stats\n ", "target": "session.fetch(urls[\"basic\"])\n assert response.status == 200\n assert session.page_pool.pages_count == 0\n "} {"bin": "32_token_ish", "content_sha256": "30bd93487da64a483d1fa24f0e184d9f62ff39574083d012ba758649fd0d637d", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/test_pptx_svg.py", "end": 3462, "example_id": "001ba33aad107de54c54f1354d3ac1651a26fa202be41fa3e165f2d07360a08b", "language": "python", "prefix": "YPE.PLACEHOLDER\n\n def __init__(self):\n xml = (\n ''\n \"\" % _SVG_NS\n )\n self._element = etree.fromstring(xml)\n self.part = _FakePart()\n\n @prop", "target": "'\n 'schemas.openxmlformats.org/officeDocument/2006/relationships\" '\n 'xmlns:asvg=\"%s\"> List[str]:\n \"\"\"\n Helper needed to determine which analysis features to use.\n Certain document analysis features are not available for\n offi", "target": "prefix):\n return "} {"bin": "64_token_ish", "content_sha256": "6edc588b7324ee760abbd4bce0813f3e52210fdb5e43d3251d6b1e77ef5545f6", "document_id": "steipete/agent-scripts@bb3688355a4c1894dd53b4ed867d1600918fadf0:skills/npm/scripts/publish-package.sh", "end": 1586, "example_id": "001bf79bb7414ab4fa1bb12f1584ddcb7e6ca311e4c0ce4c86dada3bbd8e5eb8", "language": "shell", "prefix": "exit 0 ;;\n *) echo \"unknown argument: $1\" >&2; usage >&2; exit 2 ;;\n esac\ndone\n\n# Desktop fallback keeps the legacy item name unless one was named explicitly.\nif [ -n \"$ACCOUNT\" ] && [ \"$ITEM_EXPLICIT\" -eq 0 ]; then\n ITEM=\"npmjs\"\nfi\n\nif [ -z \"${TMUX:-", "repo": "steipete/agent-scripts", "span_codepoints": 256, "start": 1330, "suffix": " || { echo \"package.json not found in current directory\" >&2; exit 2; }\n\nSCRIPT_DIR=\"$(cd \"$(dirname \"${BASH_SOURCE[0]}\")\" && pwd)\"\nPACKAGE_DIR=\"$PWD\"\nWORK=\"$(mktemp -d /tmp/npm-publish.XXXXXX)\"\nNPMRC=\"$WORK/npmrc\"\n# shellcheck disable=SC2329 # invoked via", "target": "}\" ]; then\n echo \"refusing to run: npm auth must stay inside one persistent tmux session\" >&2\n exit 2\nfi\n\nfor bin in op jq node npm; do\n command -v \"$bin\" >/dev/null 2>&1 || { echo \"missing required binary: $bin\" >&2; exit 2; }\ndone\ntest -f package.json"} {"bin": "64_token_ish", "content_sha256": "cf55fa3d72b6844e516e27b96125d33de000bf81990bb3c58965cb22abff8fa4", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:csharp-book/src/ch15-2-incremental-adoption-strategy.md", "end": 7541, "example_id": "001c2170bf527eaddc0813458ad8f24412880f2bd858be6b73425cc6fda61316", "language": "markdown", "prefix": "e serde::{Deserialize, Serialize};\n\n#[derive(Deserialize, Serialize, Debug)]\nstruct LogEntry {\n timestamp: String,\n level: String,\n message: String,\n}\n\nfn parse_log_entries(json_str: &str) -> Result, Box> {\n ", "repo": "microsoft/RustTraining", "span_codepoints": 256, "start": 7285, "suffix": "-8: Async Programming and Concurrency**\n- `async`/`await` similarities and differences\n- Channels for communication\n- Thread safety guarantees\n\n**Recommended projects:**\n```rust\n// Week 5-6: Generic data processor\ntrait DataProcessor {\n type Output;\n", "target": " let entries: Vec = serde_json::from_str(json_str)?;\n Ok(entries)\n}\n```\n\n### Month 2: Practical Applications\n**Week 5-6: Traits and Generics**\n- Trait system vs interfaces\n- Generic constraints and bounds\n- Common patterns and idioms\n\n**Week 7"} {"bin": "16_token_ish", "content_sha256": "3b88c866184712a6fc737bb364ad9ed1fbadd6cad5f32f8fcb09dad54211f9da", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:tests/providers/doubleword/cassette/conformance.rs", "end": 3871, "example_id": "001c2cba36d19dbf088e6a7079126fe9a380d34d915e4caf5cea181408fb364e", "language": "rust", "prefix": "L_MODEL), |builder| builder)\n .await\n .expect(\"streaming structured output after tool should succeed\");\n },\n )\n .await;\n}\n\n#[tokio::test]\nasync fn structured_extraction_roundtrip() {\n with_doubleword_cassette(\"", "repo": "0xPlaygrounds/rig", "span_codepoints": 64, "start": 3807, "suffix": " structured_extraction(client.completion_model(DEFAULT_MODEL))\n .await\n .expect(\"structured extraction should succeed\");\n })\n .await;\n}\n\n#[tokio::test]\nasync fn tool_choice_modes_roundtrip() {\n with_doubleword_cassette(\"conf", "target": "conformance/structured_extraction\", |client| async move {\n "} {"bin": "8_token_ish", "content_sha256": "4621b61096a1629d44edfe74b8cad267456b03794789f6065d1e5f8ef4ee719c", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/test_multi_act_guards.py", "end": 7229, "example_id": "001c512c10e76cedf54ad033175af525053855914c63f1a7935a38727929ac4d", "language": "python", "prefix": "ession, tools=tools)\n\n\t\tresults = await agent.multi_act(actions)\n\n\t\t# go_back should terminate the sequence — only 1 result\n\t\tassert len(results) == 1, f'Expected 1 result but got {len(results)}: {results}'\n\n\n# ---------------------------------------------", "repo": "browser-use/browser-use", "span_codepoints": 32, "start": 7197, "suffix": " 3. Runtime guard — click on link changes URL, remaining actions skipped\n# ---------------------------------------------------------------------------\n\n\nclass TestRuntimeGuard:\n\t\"\"\"Verify that URL/focus changes detected at runtime abort remaining actions.\"", "target": "------------------------------\n#"} {"bin": "32_token_ish", "content_sha256": "632ce87a34d6fee432909ff25310b13c5a844a9fd0d52ddd5a8c6447648a4858", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:agent/server_test.go", "end": 1588, "example_id": "001c6a09f9abc75201a699b89c91c535b950b17ac0a53e68380f960ce476c91e", "language": "go", "prefix": "l\n\t\terrContains string\n\t\tsetup func() error\n\t\tcleanup func() error\n\t}{\n\t\t{\n\t\t\tname: \"tcp port only\",\n\t\t\tconfig: ServerOptions{\n\t\t\t\tNetwork: \"tcp\",\n\t\t\t\tAddr: \":45987\",\n\t\t\t\tKeys: []gossh.PublicKey{sshPubKey},\n\t\t\t},\n\t\t},\n\t\t{\n\t\t\tname: \"tcp with", "repo": "henrygd/beszel", "span_codepoints": 128, "start": 1460, "suffix": ",\n\t\t\t},\n\t\t},\n\t\t{\n\t\t\tname: \"tcp with ipv6\",\n\t\t\tconfig: ServerOptions{\n\t\t\t\tNetwork: \"tcp6\",\n\t\t\t\tAddr: \"[::1]:45989\",\n\t\t\t\tKeys: []gossh.PublicKey{sshPubKey},\n\t\t\t},\n\t\t},\n\t\t{\n\t\t\tname: \"unix socket\",\n\t\t\tconfig: ServerOptions{\n\t\t\t\tNetwork: \"unix\",\n\t\t\t\tAddr:", "target": " ipv4\",\n\t\t\tconfig: ServerOptions{\n\t\t\t\tNetwork: \"tcp4\",\n\t\t\t\tAddr: \"127.0.0.1:45988\",\n\t\t\t\tKeys: []gossh.PublicKey{sshPubKey}"} {"bin": "64_token_ish", "content_sha256": "46b85514156e504c086ad1931586c8f34a0b150f8900a83f5fc8cce765bc90f9", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:c-cpp-book/src/ch08-crates-and-modules.md", "end": 4224, "example_id": "001cbac28d8c307a44116442c5c2b46131f43275caf31fa569d989036bb55300", "language": "markdown", "prefix": "b hellolib\n```\n\n## Exercise: Using workspaces and package dependencies\n- Take a look at the generated Cargo.toml in ```hello``` and ```hellolib```. Notice that both of them have been added to the upper level ```Cargo.toml```\n- The presence of ```lib.rs``` ", "repo": "microsoft/RustTraining", "span_codepoints": 256, "start": 3968, "suffix": "../hellolib\"}\n```\n- Using ```add()``` from ```hellolib```\n```rust\nfn main() {\n println!(\"Hello, world! {}\", hellolib::add(21, 21));\n}\n```\n\n
Solution (click to expand)\n\nThe complete workspace setup:\n\n```bash\n# Terminal commands", "target": "in ```hellolib``` implies a library package (see https://doc.rust-lang.org/cargo/reference/cargo-targets.html for customization options)\n- Adding a dependency on ```hellolib``` in ```Cargo.toml``` for ```hello```\n```toml\n[dependencies]\nhellolib = {path = \""} {"bin": "16_token_ish", "content_sha256": "39d5269c2895517ab7c1c054aec392c7dfcd27d59a9e6a69107bbd63a304a8c8", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/hooks/pre_commit_hooks/check_xml.rs", "end": 7422, "example_id": "001cd0a99c4be8962ec537e8a64ed405459dd2b8d4a28080b75372093b39b0fd", "language": "rust", "prefix": "> Result<()> {\n let dir = tempdir()?;\n let content = br#\"\n\n characters & symbols]]>\n\"#;\n let file_path = create_test_file(&dir, \"cdata.xml", "repo": "j178/prek", "span_codepoints": 64, "start": 7358, "suffix": "::new(\"\"), &file_path).await?;\n assert_eq!(code, 0);\n assert!(output.is_empty());\n Ok(())\n }\n\n #[tokio::test]\n async fn test_valid_xml_with_comments() -> Result<()> {\n let dir = tempdir()?;\n let content = br#\" ({\n trackEvent: (...args: unknown[]) => ", "repo": "upstash/context7", "span_codepoints": 64, "start": 457, "suffix": ") => ({\n checkForUpdates: (...args: unknown[]) => checkForUpdates(...args),\n getUpgradePlan: (...args: unknown[]) => getUpgradePlan(...args),\n markUpdateNotificationShown: (...args: unknown[]) => markUpdateNotificationShown(...args),\n shouldShowUpdateN", "target": "trackEvent(...args),\n}));\n\nvi.mock(\"../utils/update-check.js\", ("} {"bin": "32_token_ish", "content_sha256": "6dd2c037cc1d25fac0ad0cb5b34fa9563d91824c0816bf2f0f999ef8e100fa29", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:python-book/src/ch06-enums-and-pattern-matching.md", "end": 4442, "example_id": "001d0adb002bb8e17d43f341eef7163057dfa013551b7db38f07d12837e3765e", "language": "markdown", "prefix": "height})\")\n }\n Message::Quit => println!(\"Quitting\"),\n Message::Move { x, y } => println!(\"Moving to ({x}, {y})\"),\n }\n}\n```\n\n***\n\n## Exhaustive Pattern Matching\n\n### Python's match — Not Exhaustive\n```python\n# Python — the wildcard ", "repo": "microsoft/RustTraining", "span_codepoints": 128, "start": 4314, "suffix": "1:\n return \"one\"\n # If you forget the default, Python returns None silently.\n # No warning, no error.\n\ndescribe(42) # Returns None — a silent bug\n```\n\n### Rust's match — Compiler-Enforced\n```rust\n// Rust — MUST handle every possib", "target": "case is optional, no compiler help\ndef describe(value):\n match value:\n case 0:\n return \"zero\"\n case "} {"bin": "32_token_ish", "content_sha256": "bc0af3ba327657630e5f6c60be619e6b5394bf03edc29b1384a15f09a1b348bf", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:src/hooks/caveman-activate.js", "end": 3615, "example_id": "001d735bd80b5bcd849f1512c5bbd99d0d5d761e49831195f11f27d0cf8ddee7", "language": "javascript", "prefix": "ath.join(process.env.CLAUDE_PLUGIN_ROOT, 'skills', 'caveman', 'SKILL.md'));\n}\nskillCandidates.push(\n path.join(__dirname, '..', '..', 'skills', 'caveman', 'SKILL.md'),\n path.join(__dirname, '..', 'skills', 'caveman', 'SKILL.md')\n);\n\nlet skillContent = ''", "repo": "JuliusBrussee/caveman", "span_codepoints": 128, "start": 3487, "suffix": " (e) { /* try next candidate */ }\n}\n\nlet output;\n\nif (skillContent) {\n // Strip YAML frontmatter\n const body = skillContent.replace(/^---[\\s\\S]*?---\\s*/, '');\n\n // Filter intensity table: keep header rows + only the active level's row\n const filtered =", "target": ";\nfor (const candidate of skillCandidates) {\n try {\n skillContent = fs.readFileSync(candidate, 'utf8');\n break;\n } catch"} {"bin": "32_token_ish", "content_sha256": "4db04dc51b2f2baf11bdc92ebee06d9b80da7c154aa26f71ca333908c69c17ec", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:tests/installer/opencode.test.mjs", "end": 9641, "example_id": "001da746cea27883baadfafce933b17d569abe680652a700eea2a4e30412a55a", "language": "javascript", "prefix": "pic/claude-sonnet-4-5\",\n \"theme\": \"dark\",\n}\n`);\n\n const env = { ...process.env, XDG_CONFIG_HOME: xdg, PATH: pathWith(shimDir), NO_COLOR: '1' };\n const r = runInstaller(['--only', 'opencode'], env);\n assert.notEqual(r.status, 2);\n\n const cfg = ", "repo": "JuliusBrussee/caveman", "span_codepoints": 128, "start": 9513, "suffix": "', 'user model setting wiped');\n assert.equal(cfg.theme, 'dark', 'user theme setting wiped');\n assert.ok(cfg.plugin.includes('./plugins/caveman/plugin.js'), 'plugin entry missing');\n } finally {\n fs.rmSync(xdg, { recursive: true, force: true });\n", "target": "JSON.parse(fs.readFileSync(path.join(ocDir, 'opencode.json'), 'utf8'));\n assert.equal(cfg.model, 'anthropic/claude-sonnet-4-5"} {"bin": "16_token_ish", "content_sha256": "4ad0ebc58751706f5978c7c2177c0652c986b799a63e6a04effc9eb8d33048ee", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:scripts/uninstall.js", "end": 1306, "example_id": "001dbf9238ffe94cdcdbc54c4562d48a0e120e28ec037579f93beecb4a5d91b0", "language": "javascript", "prefix": "ettings = JSON.parse(raw);\n const cmd = settings.statusLine && settings.statusLine.command;\n // Only remove the parts ponytail owns. If the user combined statuslines\n // (e.g. caveman && ponytail), keep the other plugin's command intact.\n // ponytail: ", "repo": "DietrichGebert/ponytail", "span_codepoints": 64, "start": 1242, "suffix": " // piping statuslines together is on their own.\n if (typeof cmd === 'string' && cmd.includes(STATUSLINE_SCRIPT)) {\n const parts = cmd\n .split(/&&|;/)\n .map((s) => s.trim())\n .filter(Boolean);\n const others = parts.filter((s) => !s.i", "target": "splits on && / ; to detect other segments — good enough; a user\n"} {"bin": "16_token_ish", "content_sha256": "67f12660b2279922adcefd6c112b851830dc1d9b2c9f240b190c849d33e837b3", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:pi-extension/index.js", "end": 5216, "example_id": "001de1e006ea628570a2667f2905197c65c0f263085d2b894a0e9420609ceeb9", "language": "javascript", "prefix": " setMode(parsed.mode, ctx);\n return;\n }\n\n ctx?.ui?.notify?.(\"Unknown or unsupported /ponytail mode.\", \"warning\");\n },\n });\n\n pi.registerCommand(\"ponytail-review\", {\n description: \"Run /skill:ponytail-review\",\n handler: (_args,", "repo": "DietrichGebert/ponytail", "span_codepoints": 64, "start": 5152, "suffix": "pi.registerCommand(\"ponytail-audit\", {\n description: \"Run /skill:ponytail-audit\",\n handler: (_args, ctx) => sendAlias(\"/skill:ponytail-audit\", \"\", ctx),\n });\n\n pi.registerCommand(\"ponytail-gain\", {\n description: \"Run /skill:ponytail-gain\",\n h", "target": " ctx) => sendAlias(\"/skill:ponytail-review\", \"\", ctx),\n });\n\n "} {"bin": "16_token_ish", "content_sha256": "08627035eea96b25c22866667d6a9dba8ee9c7094d1da26da90ce4e645a6c6f6", "document_id": "upstash/context7@b250c2515694eee4b6df4db82fa056df9ed3e306:packages/cli/src/__tests__/github.test.ts", "end": 865, "example_id": "001df4dbe71993fe55dd9ddc4d24f395f26151c9d9200f89643634384868ae00", "language": "typescript", "prefix": "arAllMocks: the latter keeps implementations, so a\n // mockImplementation set by one test would leak into the next.\n vi.resetAllMocks();\n vi.stubEnv(\"GITHUB_TOKEN\", undefined);\n vi.stubEnv(\"GH_TOKEN\", undefined);\n vi.stubGlobal(\n \"fetch\",\n vi\n ", "repo": "upstash/context7", "span_codepoints": 64, "start": 801, "suffix": " json: () => Promise.resolve({ default_branch: \"main\" }),\n })\n .mockResolvedValueOnce({\n ok: true,\n json: () => Promise.resolve({ sha: \"tree-sha\", tree: [], truncated: false }),\n })\n );\n});\n\nafterEach(() => {\n vi.unstubAllG", "target": " .fn()\n .mockResolvedValueOnce({\n ok: true,\n "} {"bin": "16_token_ish", "content_sha256": "f420a2d9f98682d760d4738779dfbb09044a6426b4418d96c69860b90fc903ce", "document_id": "Netflix/maestro@abdbdadf8f075b8fa488c9efb386b468c709a63c:netflix-sel/src/test/java/com/netflix/sel/type/SelJodaDateTimeZoneTest.java", "end": 2184, "example_id": "001e3b5afa6a9c752e6fde031e47ed48d7a1ea14264b2ed6bb98927373c820e8", "language": "java", "prefix": "Time.of(new DateTime(0, DateTimeZone.forID(\"America/Los_Angeles\")))\n });\n assertEquals(\"LONG: 0\", res.type() + \": \" + res);\n res =\n another.call(\n \"getOffset\",\n new SelType[] {\n SelJodaDateTime.of(", "repo": "Netflix/maestro", "span_codepoints": 64, "start": 2120, "suffix": " });\n assertEquals(\"LONG: -28800000\", res.type() + \": \" + res);\n }\n\n @Test(expected = UnsupportedOperationException.class)\n public void testInvalidCall() {\n one.call(\"invalid\", new SelType[] {SelLong.of(123)});\n }\n\n @Test\n public void te", "target": "new DateTime(0, DateTimeZone.forID(\"America/Los_Angeles\")))\n "} {"bin": "16_token_ish", "content_sha256": "5beede9a668820885154cec341d94f0fc4705c81208e8acf92b61200a4cc9eec", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/test_module_vectors.py", "end": 5006, "example_id": "001e4174fa0b4b597c9e9b2c15c356b25761e6eb1ca4dadaf8a9ac464cc41d85", "language": "python", "prefix": "t in result.markdown\n\n\n@pytest.mark.parametrize(\"test_vector\", GENERAL_TEST_VECTORS)\ndef test_convert_data_uri(test_vector):\n \"\"\"Test the conversion of a data URI.\"\"\"\n markitdown = MarkItDown()\n\n data = \"\"\n with open(os.path.join(TEST_FILES_DIR", "repo": "microsoft/markitdown", "span_codepoints": 64, "start": 4942, "suffix": "b64encode(stream.read()).decode(\"utf-8\")\n mimetype = test_vector.mimetype\n data_uri = f\"data:{mimetype};base64,{data}\"\n\n result = markitdown.convert(\n data_uri,\n url=test_vector.url,\n )\n for string in test_vector.must_include:\n", "target": ", test_vector.filename), \"rb\") as stream:\n data = base64."} {"bin": "32_token_ish", "content_sha256": "ef670a657540b1db0eedb2b8ab8685a3db6e8362ea3f98a70e9fdc21e97815d7", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/languages/conda.rs", "end": 2691, "example_id": "001e440b4fc830e91c89cd1e831baa8968ba78802eb7af6d2fc4d249ebe647bf", "language": "rust", "prefix": " }\n\n info.persist_env_path();\n\n reporter.on_install_complete(progress);\n\n Ok(InstalledHook::Installed {\n hook,\n info: Arc::new(info),\n })\n }\n\n async fn check_health(&self, _info: &InstallInfo) ->", "repo": "j178/prek", "span_codepoints": 128, "start": 2563, "suffix": " filenames: &[&Path],\n reporter: &HookRunReporter,\n ) -> Result<(i32, Vec)> {\n let progress = reporter.on_run_start(hook, filenames.len());\n\n let env_dir = hook.env_path().expect(\"Conda must have env path\");\n let new_pat", "target": " Result<()> {\n Ok(())\n }\n\n async fn run(\n &self,\n store: &Store,\n hook: &InstalledHook,\n "} {"bin": "8_token_ish", "content_sha256": "eb80d813515dd7050641a128cad2cff7390c190f5bb8e6efe440e0509c5bae2f", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/breadcrumb.tsx", "end": 1655, "example_id": "001e477431327ac4df1f55940d476b53ed37199ea0c4b2ccb67052703bda1101", "language": "typescript", "prefix": "der,\n state: {\n slot: \"breadcrumb-link\",\n },\n })\n}\n\nfunction BreadcrumbPage({ className, ...props }: React.ComponentProps<\"span\">) {\n return (\n \n )\n}\n\nfunction BreadcrumbSeparator({\n children,\n className,\n ...props\n}: React.ComponentProps<\"li\">) {\n return (\n !s.includes(STATUSLINE_SCRIPT));\n if (others.length === 0) {\n delete settings.statusLine;\n fs.writeFileSync(settingsPath, JSON.stringify(settings, null, 2), 'utf8');\n console.log(", "repo": "DietrichGebert/ponytail", "span_codepoints": 256, "start": 1755, "suffix": " segment from ${settingsPath}`);\n }\n }\n} catch (e) {\n if (e.code === 'ENOENT') {\n // no settings.json — nothing to clean\n } else if (e instanceof SyntaxError) {\n // ponytail: malformed settings.json — can't safely edit it; leave intact, warn\n ", "target": "`Removed ponytail statusLine entry from ${settingsPath}`);\n } else {\n settings.statusLine.command = others.join(' && ');\n fs.writeFileSync(settingsPath, JSON.stringify(settings, null, 2), 'utf8');\n console.log(`Removed ponytail statusLine"} {"bin": "64_token_ish", "content_sha256": "6006e1c16fae19b2bb3627b4265064818366c0ea1874188f6a02768eb4fb54ed", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/cli/yaml_to_toml.rs", "end": 5828, "example_id": "001eb9b9ecfbd033f103816d3d0dae4a098a2459acb9e43ffc0e963eb45de848", "language": "rust", "prefix": "(value);\n }\n array.set_trailing(format!(\"\\n{closing_indent}\"));\n Value::Array(array)\n}\n\nfn json_object_to_inline(values: &serde_json::Map) -> InlineTable {\n let mut table = InlineTable::new();\n for (key, value) in ", "repo": "j178/prek", "span_codepoints": 256, "start": 5572, "suffix": ".insert(key.as_str(), value);\n }\n format_inline_table_multiline(&mut table, \" \", \" \");\n table\n}\n\nfn format_inline_table_multiline(table: &mut InlineTable, base_indent: &str, closing_indent: &str) {\n let len = table.len();\n if len <= 1 {\n", "target": "values {\n let value = match value {\n serde_json::Value::Array(values) => {\n json_array_to_value_with_indent(values, \" \", \" \", false)\n }\n _ => json_to_toml_value(value),\n };\n table"} {"bin": "16_token_ish", "content_sha256": "671b22dd756f505c4c929ed467a4263433aa9ac286714b90ed1b3fc8779c536e", "document_id": "Netflix/maestro@abdbdadf8f075b8fa488c9efb386b468c709a63c:maestro-engine/src/test/java/com/netflix/maestro/engine/execution/StepSyncManagerTest.java", "end": 6255, "example_id": "001ec06e686fac4c8568a3e9c05edf538d11e9dad5c792137ccf1e8b78ba39d3", "language": "java", "prefix": "anceDao, times(1))\n .updateStepInstance(eq(workflowSummary), eq(stepRuntimeSummary), eventCaptor.capture());\n assertEquals(NotificationJobEvent.class, eventCaptor.getValue().getClass());\n }\n\n @Test\n public void testSyncFailure() {\n doThrow(", "repo": "Netflix/maestro", "span_codepoints": 64, "start": 6191, "suffix": " .updateStepInstance(any(), any(), any());\n StepRuntimeSummary stepRuntimeSummary =\n StepRuntimeSummary.builder()\n .stepId(\"test-summary\")\n .stepAttemptId(2)\n .stepInstanceId(1)\n .dbOperation(DbOp", "target": "new RuntimeException(\"test error\"))\n .when(instanceDao)\n "} {"bin": "16_token_ish", "content_sha256": "9afb82603add497b23b3fc1bda6166cca0f8459d3dc1eaf52e53a6c5bb07605d", "document_id": "cloudwego/eino@ca0441ac0bceed8945dcf7d5a18c237c924c6aa8:adk/failover_chatmodel_test.go", "end": 3971, "example_id": "001ec9fd7452ab1890084ccc62ce183330654f68cf4a1b918c63b9de20cc587e", "language": "go", "prefix": "ckground())\n\t\trequire.False(t, ok)\n\t})\n}\n\nfunc TestFailoverProxyModel(t *testing.T) {\n\tt.Run(\"generate missing context\", func(t *testing.T) {\n\t\tp := &failoverProxyModel{}\n\t\t_, err := p.Generate(context.Background(), []*schema.Message{schema.UserMessage(\"hi", "repo": "cloudwego/eino", "span_codepoints": 64, "start": 3907, "suffix": "\", func(t *testing.T) {\n\t\tp := &failoverProxyModel{}\n\t\t_, err := p.Stream(context.Background(), []*schema.Message{schema.UserMessage(\"hi\")})\n\t\trequire.Error(t, err)\n\t})\n\n\tt.Run(\"generate routes to current model\", func(t *testing.T) {\n\t\tvar called int32\n\t\tt", "target": "\")})\n\t\trequire.Error(t, err)\n\t})\n\n\tt.Run(\"stream missing context"} {"bin": "32_token_ish", "content_sha256": "f2b7a2afd46bccb91ad0511f5ef8df7702dd7ef1306f2975fed6a97a2b0a6769", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:scripts/publish-openclaw-skills.js", "end": 2512, "example_id": "001efc788f6c0f7a4df536bc004f9a0eec39d30b8094c24421620c3e0222b982", "language": "javascript", "prefix": "slice(2);\nconst extra = passthrough.length ? ` (${passthrough.join(' ')})` : '';\nconsole.log(`Publishing ${slugs.length} skills to ClawHub at version ${version}${extra}:`);\n\nfor (const slug of slugs) {\n const args = [\n 'clawhub', 'skill', 'publish', `.", "repo": "DietrichGebert/ponytail", "span_codepoints": 128, "start": 2384, "suffix": "\n ...passthrough,\n ];\n const cmdline = args.map(quote).join(' ');\n console.log(`\\n$ ${cmdline}`);\n const res = spawnSync(cmdline, { stdio: 'inherit', cwd: root, shell: true });\n if (res.status !== 0) {\n console.error(\n `\\nPublish failed for", "target": "openclaw/skills/${slug}`,\n '--slug', slug,\n '--name', displayName(slug),\n '--version', version,\n '--tags', 'latest',"} {"bin": "8_token_ish", "content_sha256": "9ea1b94f6304d1aed4b677b35338f932f9e29b4d712b138062c3227746209b38", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_wikipedia_converter.py", "end": 2063, "example_id": "001f046126eecce21dfd55e19d0927aac94684c0a3be7f44d153fe32c7340c03", "language": "python", "prefix": "pt.extract()\n\n # Print only the main content\n body_elm = soup.find(\"div\", {\"id\": \"mw-content-text\"})\n title_elm = soup.find(\"span\", {\"class\": \"mw-page-title-main\"})\n\n webpage_text = \"\"\n main_title = None if soup.title is ", "repo": "microsoft/markitdown", "span_codepoints": 32, "start": 2031, "suffix": " if body_elm:\n # What's the title\n if title_elm and isinstance(title_elm, bs4.Tag):\n main_title = title_elm.string\n\n # Convert the page\n webpage_text = f\"# {main_title}\\n\\n\" + _CustomMarkdownif", "target": "None else soup.title.string\n\n "} {"bin": "16_token_ish", "content_sha256": "58db8045145b385dc288be7faa24820813d36d5d39171370af1ce50ecd968256", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/spiders/test_cache.py", "end": 6742, "example_id": "001f0ab8fd2431dd146343163575d50460cf3d3a7e420db2c7cbd0c193065f40", "language": "python", "prefix": "pass\n\n async def on_close(self) -> None:\n pass\n\n async def on_error(self, request: Request, error: Exception) -> None:\n pass\n\n async def on_scraped_item(self, item: Dict[str, Any]) -> Dict[str, Any] | None:\n self.scraped_items", "repo": "D4Vinci/Scrapling", "span_codepoints": 64, "start": 6678, "suffix": ", response) -> bool:\n return False\n\n async def retry_blocked_request(self, request: Request, response) -> Request:\n return request\n\n async def start_requests(self) -> AsyncGenerator[Request, None]:\n yield Request(\"https://example", "target": ".append(item)\n return item\n\n async def is_blocked(self"} {"bin": "32_token_ish", "content_sha256": "08518cd096e6c127bd1cebe83e6d1d6551bc3de2d1781bd1b7d9249f31e74708", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/arxiv/utils.js", "end": 2408, "example_id": "001f0ddadae79c6eb0adf1dda06dffc4b1fb19805c757b1eeb11b0f7843664d6", "language": "javascript", "prefix": "\\/${tag}>`, 'g');\n const results = [];\n let m;\n while ((m = re.exec(xml)) !== null)\n results.push(m[1].trim());\n return results;\n}\n/** Extract the value of a named attribute from the first matching tag (open or self-closing). */\nfunction", "repo": "jackwener/OpenCLI", "span_codepoints": 128, "start": 2280, "suffix": ": '';\n}\n/** Extract all values of a named attribute across repeated tags. */\nfunction extractAllAttr(xml, tag, attr) {\n const re = new RegExp(`<${tag}\\\\b[^>]*?\\\\b${attr}=\"([^\"]*)\"`, 'g');\n const out = [];\n let m;\n while ((m = re.exec(xml)) !== ", "target": " extractAttr(xml, tag, attr) {\n const m = xml.match(new RegExp(`<${tag}\\\\b[^>]*?\\\\b${attr}=\"([^\"]*)\"`));\n return m ? m[1] "} {"bin": "64_token_ish", "content_sha256": "4c97ba0ad9cd26c9138e513afc2a2a9fcd0179cac1ccf754be8b9ef5c673f525", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:pi-extension/test/helpers.test.js", "end": 3489, "example_id": "001f3d12013c6a797cc890c4c65dd62375adbb0f7235c27a7254c8dc4fad581f", "language": "javascript", "prefix": "v.PONYTAIL_DEFAULT_MODE;\n else process.env.PONYTAIL_DEFAULT_MODE = previousDefault;\n rmSync(tempDir, { recursive: true, force: true });\n }\n});\n\ntest(\"readQuietStartup resolves env var, config file, and default in that order\", () => {\n const tempDir", "repo": "DietrichGebert/ponytail", "span_codepoints": 256, "start": 3233, "suffix": "\");\n process.env.XDG_CONFIG_HOME = tempDir;\n delete process.env.PONYTAIL_QUIET_STARTUP;\n\n try {\n // No env, no config -> default false (toast still shows)\n assert.equal(readQuietStartup(), false);\n\n // Config file true -> respected\n mkdirSyn", "target": " = mkdtempSync(join(tmpdir(), \"ponytail-quiet-\"));\n const previousXdg = process.env.XDG_CONFIG_HOME;\n const previousEnv = process.env.PONYTAIL_QUIET_STARTUP;\n const configDir = join(tempDir, \"ponytail\");\n const configPath = join(configDir, \"config.json"} {"bin": "16_token_ish", "content_sha256": "e600de391542609373231fab058d23736a8355c544b5c31745f8e07fc3d97eed", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/spiders/scheduler.py", "end": 2772, "example_id": "001f50b7d23ce0b602ec150380d0e2d9fb08f9703de3dc4c7bc6912356d27b16", "language": "python", "prefix": "(self) -> bool:\n return self._queue.empty()\n\n def snapshot(self) -> Tuple[List[Request], Set[bytes]]:\n \"\"\"Create a snapshot of the current state for checkpoints.\"\"\"\n sorted_items = sorted(self._pending.values(), key=lambda x: (x[0],", "repo": "D4Vinci/Scrapling", "span_codepoints": 64, "start": 2708, "suffix": "item in sorted_items]\n return requests, self._seen.copy()\n\n def restore(self, data: \"CheckpointData\") -> None:\n \"\"\"Restore scheduler state from checkpoint data.\n\n :param data: CheckpointData containing requests and seen set\n ", "target": " x[1])) # Maintain queue order\n requests = [item[2] for "} {"bin": "32_token_ish", "content_sha256": "35c833543e45eb1cf840782120f7051744805863a75f70844e0f8d048c57f3dd", "document_id": "microsoft/RustTraining@6bbe5330c4d5480b12cd10739572b03f3f73160c:python-book/src/ch07-ownership-and-borrowing.md", "end": 9365, "example_id": "001f6aee6829bcaa4c84f300bcc97f01f78bafee5d5dba8760f5adcd086f0dfd", "language": "markdown", "prefix": " goes\" model)\nuse std::cell::RefCell;\nlet cell = RefCell::new(42);\n*cell.borrow_mut() = 99; // Mutable borrow at runtime (panics if double-borrowed)\n```\n\n### When to Use Each\n\n| Smart Pointer | Python Analogy | Use Case |\n|---------------|----------------", "repo": "microsoft/RustTraining", "span_codepoints": 128, "start": 9237, "suffix": " | Shared ownership, single-threaded |\n| `Arc` | Thread-safe refcount | Shared ownership, multi-threaded |\n| `RefCell` | Python's \"just mutate it\" | Interior mutability (escape hatch) |\n| `Rc>` | Python's normal object model | Shared + mut", "target": "|----------|\n| `Box` | Normal allocation | Large data, recursive types, trait objects |\n| `Rc` | Python's default refcount"} {"bin": "32_token_ish", "content_sha256": "b88abcde5a7ca6db5b7c7662be387d73505a073a1b64ebb8119c64f77e442c13", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/command.tsx", "end": 1853, "example_id": "001f7d182308ab3ef75dbdc14ade15129c3403720864ed12e9491c96c0ccfd03", "language": "typescript", "prefix": "sName\n )}\n showCloseButton={showCloseButton}\n >\n {children}\n \n \n )\n}\n\nfunction CommandInput({\n className,\n ...props\n}: React.ComponentProps) {\n return (\n
\n ", "target": "data-slot=\"command-input-wrapper\" className=\"p-1 pb-0\">\n \n "} {"bin": "8_token_ish", "content_sha256": "3e34f004d4a9e65609f8c95b47dfe5f0e3a6f2d16b88c7f8af730187ee2fb246", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:src/hooks/caveman-mode-tracker.js", "end": 6888, "example_id": "001f9ce3ab7fa280119dc0b58176c5146aff16a181d8981aa9fbc63d0dcd9ba8", "language": "javascript", "prefix": "= 'off';\n } else if (arg === 'wenyan-full') {\n // Canonical alias — config stores as 'wenyan'\n mode = 'wenyan';\n } else if (VALID_MODES.includes(arg) && !INDEPENDENT_MODES.has(arg)) {\n mode = arg;\n }\n ", "repo": "JuliusBrussee/caveman", "span_codepoints": 32, "start": 6856, "suffix": ", flag untouched (no silent overwrite)\n }\n\n if (mode && mode !== 'off') {\n if (INDEPENDENT_MODES.has(mode)) {\n // Save the prose mode being displaced — but never overwrite an\n // already-saved one with another independent", "target": "// Unknown arg → mode stays null"} {"bin": "8_token_ish", "content_sha256": "a618f96d7f0b1e9c887a3ca44e23f411f471845cd521c72fb41df8fef6b335fb", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/paperreview/submit.js", "end": 1968, "example_id": "001fd7a678da29b3a227cb786edfb0ac54585d10654eee17c6e6249be560d07f", "language": "javascript", "prefix": "kwargs['dry-run'] === true;\n const prepareOnly = kwargs['prepare-only'] === true;\n if (!email) {\n throw new CliError('ARGUMENT', 'An email address is required.', 'Pass --email
');\n }\n if (dryRun) {\n ", "repo": "jackwener/OpenCLI", "span_codepoints": 32, "start": 1936, "suffix": " pdfFile,\n email,\n venue,\n message: 'Input validation passed. No remote request was sent.',\n dryRun: true,\n });\n }\n const { response: uploadUrlResponse, payl", "target": " return summarizeSubmission({\n "} {"bin": "32_token_ish", "content_sha256": "5d7673d29dc46bb19e1137bb14110377830c2a2f4e97fa71d8f56bb3fadca9b2", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:agent/connection_manager_test.go", "end": 9919, "example_id": "002003da6ca2fd53c9fbaabd07c82093421b8518a6d3ebe35b9767b8ab760cf9", "language": "go", "prefix": "ebSocket client\n\tassert.NotPanics(t, func() {\n\t\tcm.connect()\n\t}, \"Connect should not panic without WebSocket client\")\n}\n\nfunc TestShouldExitOnErr(t *testing.T) {\n\tcreateDialErr := func(msg string) error {\n\t\treturn &net.OpError{\n\t\t\tOp: \"dial\",\n\t\t\tNet: \"tcp", "repo": "henrygd/beszel", "span_codepoints": 128, "start": 9791, "suffix": "{\n\t\t{\n\t\t\tname: \"no env var\",\n\t\t\terr: createDialErr(\"lookup lkahsdfasdf: no such host\"),\n\t\t\tenvValue: \"\",\n\t\t\texpected: false,\n\t\t},\n\t\t{\n\t\t\tname: \"env var false\",\n\t\t\terr: createDialErr(\"lookup lkahsdfasdf: no such host\"),\n\t\t\tenvValue: \"false", "target": "\",\n\t\t\tErr: errors.New(msg),\n\t\t}\n\t}\n\n\ttests := []struct {\n\t\tname string\n\t\terr error\n\t\tenvValue string\n\t\texpected bool\n\t}"} {"bin": "16_token_ish", "content_sha256": "5d7673d29dc46bb19e1137bb14110377830c2a2f4e97fa71d8f56bb3fadca9b2", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:agent/connection_manager_test.go", "end": 3284, "example_id": "0020199c01719e75c470d50cd41fc8dacc8afa5dc8396b07c1d3a347f1cdccf1", "language": "go", "prefix": "\n\ttestCases := []struct {\n\t\tname string\n\t\tinitialState ConnectionState\n\t\tevent ConnectionEvent\n\t\texpectedState ConnectionState\n\t}{\n\t\t{\n\t\t\tname: \"WebSocket connect from disconnected\",\n\t\t\tinitialState: Disconnected,\n\t\t\tevent: ", "repo": "henrygd/beszel", "span_codepoints": 64, "start": 3220, "suffix": "\n\t\t{\n\t\t\tname: \"SSH connect from disconnected\",\n\t\t\tinitialState: Disconnected,\n\t\t\tevent: SSHConnect,\n\t\t\texpectedState: SSHConnected,\n\t\t},\n\t\t{\n\t\t\tname: \"WebSocket disconnect from connected\",\n\t\t\tinitialState: WebSocketConnected,\n\t\t", "target": " WebSocketConnect,\n\t\t\texpectedState: WebSocketConnected,\n\t\t},"} {"bin": "64_token_ish", "content_sha256": "b898fa7d192aa35a985cd95e242dc3dbd71dd2a2b5bdf6abf0b3e17cf44a79fa", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converter_utils/docx/math/latex_dict.py", "end": 850, "example_id": "002023be8b086e06560a1f3ae6d2a25fe8740aecb81a9cc8a3b10458616014e1", "language": "python", "prefix": "ave{{{0}}}\",\n \"\\u0301\": \"\\\\acute{{{0}}}\",\n \"\\u0302\": \"\\\\hat{{{0}}}\",\n \"\\u0303\": \"\\\\tilde{{{0}}}\",\n \"\\u0304\": \"\\\\bar{{{0}}}\",\n \"\\u0305\": \"\\\\overbar{{{0}}}\",\n \"\\u0306\": \"\\\\breve{{{0}}}\",\n \"\\u0307\": \"\\\\dot{{{0}}}\",\n \"\\u0308\": \"\\\\ddot{{", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 594, "suffix": " \"\\u0338\": \"\\\\not{{{0}}}\",\n \"\\u20d0\": \"\\\\leftharpoonaccent{{{0}}}\",\n \"\\u20d1\": \"\\\\rightharpoonaccent{{{0}}}\",\n \"\\u20d2\": \"\\\\vertoverlay{{{0}}}\",\n \"\\u20d6\": \"\\\\overleftarrow{{{0}}}\",\n \"\\u20d7\": \"\\\\vec{{{0}}}\",\n \"\\u20db\": \"\\\\dddot{{{0}}}\",\n", "target": "{0}}}\",\n \"\\u0309\": \"\\\\ovhook{{{0}}}\",\n \"\\u030a\": \"\\\\ocirc{{{0}}}}\",\n \"\\u030c\": \"\\\\check{{{0}}}}\",\n \"\\u0310\": \"\\\\candra{{{0}}}\",\n \"\\u0312\": \"\\\\oturnedcomma{{{0}}}\",\n \"\\u0315\": \"\\\\ocommatopright{{{0}}}\",\n \"\\u031a\": \"\\\\droang{{{0}}}\",\n "} {"bin": "64_token_ish", "content_sha256": "671b22dd756f505c4c929ed467a4263433aa9ac286714b90ed1b3fc8779c536e", "document_id": "Netflix/maestro@abdbdadf8f075b8fa488c9efb386b468c709a63c:maestro-engine/src/test/java/com/netflix/maestro/engine/execution/StepSyncManagerTest.java", "end": 5425, "example_id": "002042a02698dd80670e2a901de2e086a8e3a35317e51a1f19699cfb20137828", "language": "java", "prefix": "mmary, stepRuntimeSummary);\n assertFalse(details.isPresent());\n var eventCaptor = ArgumentCaptor.forClass(MaestroJobEvent.class);\n verify(instanceDao, times(1))\n .insertOrUpsertStepInstance(eq(instance), eq(false), eventCaptor.capture());\n ", "repo": "Netflix/maestro", "span_codepoints": 256, "start": 5169, "suffix": "\")\n .stepAttemptId(2)\n .stepInstanceId(1)\n .dbOperation(DbOperation.UPDATE)\n .pendingRecords(\n Collections.singletonList(\n mock(StepInstanceUpdateJobEvent.StepInstancePendingReco", "target": " assertEquals(StepInstanceUpdateJobEvent.class, eventCaptor.getValue().getClass());\n }\n\n @Test\n public void testUpdatePendingRecords() {\n StepRuntimeSummary stepRuntimeSummary =\n StepRuntimeSummary.builder()\n .stepId(\"test-summary"} {"bin": "32_token_ish", "content_sha256": "925a6b50ec3ae4af5ebc325dc25cb3efb3b79e13214d522b6f1e64b2f0b10157", "document_id": "TecharoHQ/anubis@34badc646c39af3d9f1f70757474b141316f23ad:internal/setuplistener.go", "end": 827, "example_id": "00204607caec7a75b6a49c3703361e46b58214417550bb2679a7f906e213e4e0", "language": "go", "prefix": "efaultScheme + address\n\t\t}\n\t}\n\n\tbindUri, err := url.Parse(address)\n\tif err != nil {\n\t\treturn \"\", \"\", fmt.Errorf(\"failed to parse bind URL: %w\", err)\n\t}\n\n\tswitch bindUri.Scheme {\n\tcase \"unix\":\n\t\treturn \"unix\", bindUri.Path, nil\n\tcase \"tcp\", \"http\", \"https\":", "repo": "TecharoHQ/anubis", "span_codepoints": 128, "start": 699, "suffix": "Scheme, address)\n\t}\n}\n\n// SetupListener sets up a network listener based on the input from configuration\n// envvars. It returns a network listener and the URL to that listener or an error.\nfunc SetupListener(network, address, socketMode string) (net.Listen", "target": "\n\t\treturn \"tcp\", bindUri.Host, nil\n\tdefault:\n\t\treturn \"\", \"\", fmt.Errorf(\"unsupported network scheme %s in address %s\", bindUri."} {"bin": "32_token_ish", "content_sha256": "f48ebaff3303550ab1252a95fc1205af5d83932743d0a79aefd472e8c3d983d9", "document_id": "j178/prek@438f9c5a6a594b609413da4ad8643423601a771f:crates/prek/src/languages/rust/rustup.rs", "end": 7305, "example_id": "00206507b87dd5ee7a375681c26e21ea7b1ae2897b90afe5c967805c498aa29d", "language": "rust", "prefix": " let entries: Vec<(String, PathBuf)> = str::from_utf8(&output.stdout)?\n .lines()\n .filter_map(parse_toolchain_line)\n .collect();\n\n let infos: Vec = futures_util::stream::iter(entries)\n .map", "repo": "j178/prek", "span_codepoints": 128, "start": 7177, "suffix": " |result| match result {\n Ok(info) => Some(info),\n Err(e) => {\n warn!(\"Skipping invalid toolchain: {e:#}\");\n None\n }\n })\n .collect()\n .await", "target": "(async move |(name, path)| toolchain_info(name, path).await)\n .buffer_unordered(8)\n .filter_map(async move"} {"bin": "16_token_ish", "content_sha256": "82dc30e0c9cd672a324b6d0d1a5f44c4a823908593ee65406431f975b93d4297", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converter_utils/docx/math/omml.py", "end": 6821, "example_id": "0020711423d37bef707833de3f511dc8e409b9ef850fdd91514aea585139a41f", "language": "python", "prefix": "ce(FUNC_PLACE, c_dict.get(\"e\"))\n\n def do_fname(self, elm):\n \"\"\"\n the func name\n \"\"\"\n latex_chars = []\n for stag, t, e in self.process_children_list(elm):\n if stag == \"r\":\n if FUNC.get(t):\n ", "repo": "microsoft/markitdown", "span_codepoints": 64, "start": 6757, "suffix": ":\n raise NotImplementedError(\"Not support func %s\" % t)\n else:\n latex_chars.append(t)\n t = BLANK.join(latex_chars)\n return t if FUNC_PLACE in t else t + FUNC_PLACE # do_func will replace this\n\n ", "target": " latex_chars.append(FUNC[t])\n else"} {"bin": "8_token_ish", "content_sha256": "d79a023ca8e821858be1525380a0b37d0542299b0da847edfed0fe921b5c1960", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/core/translator.py", "end": 4394, "example_id": "0020c5cdfcedf1aa51688b6a59cac3df1352b6f2487ebcde24524ee6969251c3", "language": "python", "prefix": "ethod(xpath)\n return xpath\n\n @staticmethod\n def xpath_attr_functional_pseudo_element(xpath: OriginalXPathExpr, function: FunctionalPseudoElement) -> XPathExpr:\n \"\"\"Support selecting attribute values using ::attr() pseudo-element\"\"\"\n ", "repo": "D4Vinci/Scrapling", "span_codepoints": 32, "start": 4362, "suffix": " not in ([\"STRING\"], [\"IDENT\"]): # pragma: no cover\n raise ExpressionError(f\"Expected a single string or ident for ::attr(), got {function.arguments!r}\")\n return XPathExpr.from_xpath(xpath, attribute=function.arguments[0].value)\n\n @st", "target": " if function.argument_types()"} {"bin": "64_token_ish", "content_sha256": "eb80d813515dd7050641a128cad2cff7390c190f5bb8e6efe440e0509c5bae2f", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/breadcrumb.tsx", "end": 1149, "example_id": "0020e400bd8bcb0726ee6c89a637a1cabca3e43be5f677b453f387eb2fa6956c", "language": "typescript", "prefix": " data-slot=\"breadcrumb-list\"\n className={cn(\n \"flex flex-wrap items-center gap-1.5 text-xs/relaxed wrap-break-word text-muted-foreground\",\n className\n )}\n {...props}\n />\n )\n}\n\nfunction BreadcrumbItem({ className, ...props", "repo": "OpenCut-app/OpenCut", "span_codepoints": 256, "start": 893, "suffix": ".ComponentProps<\"a\">) {\n return useRender({\n defaultTagName: \"a\",\n props: mergeProps<\"a\">(\n {\n className: cn(\"transition-colors hover:text-foreground\", className),\n },\n props\n ),\n render,\n state: {\n slot: \"breadcr", "target": " }: React.ComponentProps<\"li\">) {\n return (\n \n )\n}\n\nfunction BreadcrumbLink({\n className,\n render,\n ...props\n}: useRender"} {"bin": "64_token_ish", "content_sha256": "70c283b85f052ca1d79eae6c069d430e7aa6d8368e446c7e5d92eaf1fea82193", "document_id": "Fission-AI/OpenSpec@19d41714c8b790488732687443713e406ef5aeef:openspec/changes/archive/2025-10-14-add-github-copilot-prompts/specs/cli-update/spec.md", "end": 546, "example_id": "0020f96757c521c974662575a11951eb5661f469105e469b96ad14f8cdb1c6c7", "language": "markdown", "prefix": "irement: Slash Command Updates\nThe update command SHALL refresh existing slash command files for configured tools without creating new ones.\n\n#### Scenario: Updating slash commands for Claude Code\n- **WHEN** `.claude/commands/openspec/` contains `proposal.", "repo": "Fission-AI/OpenSpec", "span_codepoints": 256, "start": 290, "suffix": " `openspec-proposal.md`, `openspec-apply.md`, and `openspec-archive.md`\n- **THEN** refresh each file using shared templates\n- **AND** ensure templates include instructions for the relevant workflow stage\n\n#### Scenario: Updating slash commands for OpenCode", "target": "md`, `apply.md`, and `archive.md`\n- **THEN** refresh each file using shared templates\n- **AND** ensure templates include instructions for the relevant workflow stage\n\n#### Scenario: Updating slash commands for Cursor\n- **WHEN** `.cursor/commands/` contains"} {"bin": "16_token_ish", "content_sha256": "7a17d8c904eab1813a220279c31ef51598214735923d178bed9beb92e9cf0230", "document_id": "DietrichGebert/ponytail@16f29800fd2681bdf24f3eb4ccffe38be3baec6b:benchmarks/correctness.js", "end": 5669, "example_id": "0020fc3ec0174945ba15bda83002b58a367dc523a5dec959458b62b08b21c3ae", "language": "javascript", "prefix": "}\n\n// Test: should fire after the delay\nsetTimeout(() => {\n if (callCount !== 1) {\n console.error(\"FAIL: expected 1 call after delay, got \" + callCount);\n process.exit(1);\n }\n console.log(\"PASS\");\n}, 120);\n`;\n const f = tmpFile('.mjs', harness)", "repo": "DietrichGebert/ponytail", "span_codepoints": 64, "start": 5605, "suffix": " if (result.ok) return { pass: true, reason: 'Debounce passes all checks' };\n return { pass: false, reason: result.stderr || 'Debounce failed' };\n },\n\n csv(blocks) {\n const code = blocks.find((b) => b.lang === 'python' || b.lang === 'py' || (!b.", "target": ";\n const result = exec(`node \"${f}\"`);\n fs.unlinkSync(f);\n"} {"bin": "16_token_ish", "content_sha256": "02f266e6fb689bcdcb261f9314e2b15cd5f74a735accc93ff69b64ad8c99e975", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_audio_converter.py", "end": 669, "example_id": "002106350da4ed5df59dfa3811c91d8b0efe03cf49299dbae45340379e73d7ba", "language": "python", "prefix": "/mpeg\",\n \"video/mp4\",\n]\n\nACCEPTED_FILE_EXTENSIONS = [\n \".wav\",\n \".mp3\",\n \".m4a\",\n \".mp4\",\n]\n\n\nclass AudioConverter(DocumentConverter):\n \"\"\"\n Converts audio files to markdown via extraction of metadata (if `exiftool` is installed), and ", "repo": "microsoft/markitdown", "span_codepoints": 64, "start": 605, "suffix": " \"\"\"\n\n def accepts(\n self,\n file_stream: BinaryIO,\n stream_info: StreamInfo,\n **kwargs: Any, # Options to pass to the converter\n ) -> bool:\n mimetype = (stream_info.mimetype or \"\").lower()\n extension = (stre", "target": "speech transcription (if `speech_recognition` is installed).\n "} {"bin": "8_token_ish", "content_sha256": "5a7bb103af6db7af89215cb2d20097fe59f2ac689e5175e4960290466fd47faf", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/browser/watchdogs/recording_watchdog.py", "end": 6151, "example_id": "002110d3e20db6a64bcb31b623f4c58aa040b71d483860bcfc3a259153d4b9d7", "language": "python", "prefix": "o recording to target {cdp_session.target_id}')\n\t\texcept Exception as e:\n\t\t\tself.logger.error(f'Failed to switch screencast via CDP: {e}')\n\t\t\t# If we fail to start on the new tab, we reset current session id\n\t\t\tself._current_session_id = None\n\n\tasync def _", "repo": "browser-use/browser-use", "span_codepoints": 32, "start": 6119, "suffix": "-> ViewportSize | None:\n\t\t\"\"\"Gets the current viewport size directly from the browser via CDP.\"\"\"\n\t\ttry:\n\t\t\tcdp_session = await self.browser_session.get_or_create_cdp_session()\n\t\t\tmetrics = await cdp_session.cdp_client.send.Page.getLayoutMetrics(session_id", "target": "get_current_viewport_size(self) "} {"bin": "64_token_ish", "content_sha256": "dcb3a9f400fdde461ae9463bbeeb76181d5e6929c0a018e361c398f75f331e3f", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_bing_serp_converter.py", "end": 1779, "example_id": "00211b29d5a9e77dcd592c8f06e8632e19ebcdd85eb1ae146c11ba99f845fd45", "language": "python", "prefix": "IXES:\n if mimetype.startswith(prefix):\n return True\n\n # Not HTML content\n return False\n\n def convert(\n self,\n file_stream: BinaryIO,\n stream_info: StreamInfo,\n **kwargs: Any, # Options", "repo": "microsoft/markitdown", "span_codepoints": 256, "start": 1523, "suffix": " # Parse the stream\n encoding = \"utf-8\" if stream_info.charset is None else stream_info.charset\n soup = BeautifulSoup(file_stream, \"html.parser\", from_encoding=encoding)\n\n # Clean up some formatting\n for tptt in soup.find", "target": " to pass to the converter\n ) -> DocumentConverterResult:\n assert stream_info.url is not None\n\n # Parse the query parameters\n parsed_params = parse_qs(urlparse(stream_info.url).query)\n query = parsed_params.get(\"q\", [\"\"])[0]\n\n"} {"bin": "8_token_ish", "content_sha256": "7a2e36133615dcce6c11be0423cb681abfab8b962c58fa96a559dc5ac0d8b3f4", "document_id": "cloudwego/eino@ca0441ac0bceed8945dcf7d5a18c237c924c6aa8:compose/branch_test.go", "end": 2755, "example_id": "0021290d00bdb81950fe4c83e76fed387557390961faa652e5036295239df67b", "language": "go", "prefix": "2\", emptyLambda, WithOutputKey(\"2\"))\n\tassert.NoError(t, err)\n\terr = g.AddLambdaNode(\"3\", emptyLambda, WithOutputKey(\"3\"))\n\tassert.NoError(t, err)\n\n\terr = g.AddBranch(START, NewStreamGraphMultiBranch(func(ctx context.Context, in *schema.StreamReader[string]", "repo": "cloudwego/eino", "span_codepoints": 32, "start": 2723, "suffix": "error) {\n\t\tin.Close()\n\t\treturn map[string]bool{\"1\": true, \"2\": true}, nil\n\t}, map[string]bool{\"1\": true, \"2\": true, \"3\": true}))\n\tassert.NoError(t, err)\n\n\terr = g.AddEdge(\"1\", END)\n\tassert.NoError(t, err)\n\terr = g.AddEdge(\"2\", END)\n\tassert.NoError(t, err)\n", "target": ") (endNode map[string]bool, err "} {"bin": "16_token_ish", "content_sha256": "4f972550616223083bd9304482990caa0f44c4e7ae58f54906ed16a8131be39e", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/engines/constants.py", "end": 1617, "example_id": "00212c19816b950d9abd8124f946ac698ac5ecff4477603ca089c3db60f4f989", "language": "python", "prefix": "ass\n \"--enable-async-dns\",\n \"--accept-lang=en-US\",\n \"--use-mock-keychain\",\n \"--disable-translate\",\n \"--disable-voice-input\",\n \"--window-position=0,0\",\n \"--disable-wake-on-wifi\",\n \"--ignore-gpu-blocklist\",\n \"--enable-tcp-fast-open", "repo": "D4Vinci/Scrapling", "span_codepoints": 64, "start": 1553, "suffix": " \"--disable-print-preview\",\n \"--disable-dev-shm-usage\",\n # '--disable-popup-blocking',\n \"--metrics-recording-only\",\n \"--disable-crash-reporter\",\n \"--disable-partial-raster\",\n \"--disable-gesture-typing\",\n \"--disable-checker-imaging\",\n", "target": "\",\n \"--enable-web-bluetooth\",\n \"--disable-cloud-import\",\n "} {"bin": "8_token_ish", "content_sha256": "82dc30e0c9cd672a324b6d0d1a5f44c4a823908593ee65406431f975b93d4297", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converter_utils/docx/math/omml.py", "end": 3299, "example_id": "0021470966c82d9e3c27237cfd2057dca4f385384ceefbc09377a053311f5f01", "language": "python", "prefix": "__dict__\n\n \"\"\" common properties of element\"\"\"\n\n def __init__(self, elm):\n self.__innerdict = {}\n self.text = self.process_children(elm)\n\n def __str__(self):\n return self.text\n\n def __unicode__(self):\n return self.__", "repo": "microsoft/markitdown", "span_codepoints": 32, "start": 3267, "suffix": "(self, name):\n return self.__innerdict.get(name, None)\n\n def do_brk(self, elm):\n self.__innerdict[\"brk\"] = BRK\n return BRK\n\n def do_common(self, elm):\n stag = elm.tag.replace(OMML_NS, \"\")\n if stag in self.__val_tags", "target": "str__(self)\n\n def __getattr__"} {"bin": "64_token_ish", "content_sha256": "5a5272472557744e1616060b62948523e7c1710eee94906d9d0c4d369bdaa756", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/calendar.tsx", "end": 5870, "example_id": "0021515d42eac3ddc4b1ff4edd70de61e7c9e1205d559f65da12d2d0f231933d", "language": "typescript", "prefix": ".props}\n />\n )\n },\n Chevron: ({ className, orientation, ...props }) => {\n if (orientation === \"left\") {\n return (\n \n )\n },\n DayButton: ({ ...props }) => (\n \n )\n }\n\n if (orientation === \"right\") {\n return (\n \n )\n "} {"bin": "8_token_ish", "content_sha256": "bca09212c4f195a63a6a481380104275b7b3956d3bd23fac7ae5cc15039702b4", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:tests/providers/openai/cassette/multi_extract.rs", "end": 3048, "example_id": "00216c0fc918b01d602f75f85a2b243cd74b69d56544f97099396015c02a873f", "language": "rust", "prefix": " \"Extracted names: {}\\nExtracted topics: {}\\nExtracted sentiment: {} ({})\",\n names.names.join(\", \"),\n topics.topics.join(\", \"),\n sentiment.sentiment,\n ", "repo": "0xPlaygrounds/rig", "span_codepoints": 32, "start": 3016, "suffix": " ))\n }\n })\n .buffered(4)\n .try_collect()\n .await?;\n\n anyhow::ensure!(responses.len() == 3);\n for response in responses {\n as", "target": " sentiment.confidence,\n "} {"bin": "32_token_ish", "content_sha256": "1015ae6a2822f71d17fb4e2e24c96819e29e1ee99e1613dbc388315df4630152", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:skills/open-source/references/actor.md", "end": 1225, "example_id": "00216d0a48acf9491ea0b977429c55d90827fd1e486eafc33f1a20cf00a9c8fb", "language": "markdown", "prefix": "rowser Methods\n\n```python\nbrowser = Browser()\nawait browser.start()\n\npage = await browser.new_page(\"https://example.com\") # Open new tab\npages = await browser.get_pages() # List all pages\ncurrent = await browser.get_current_page() ", "repo": "browser-use/browser-use", "span_codepoints": 128, "start": 1097, "suffix": " # Cleanup\n```\n\n## Page Methods\n\n### Navigation\n- `goto(url: str)` — Navigate to URL\n- `go_back()` — Back in history\n- `go_forward()` — Forward in history\n- `reload()` — Reload page\n\n### Element Finding\n- `get_elements_by_css_selector(s", "target": " # Active page\nawait browser.close_page(page) # Close tab\nawait browser.stop() "} {"bin": "16_token_ish", "content_sha256": "f675d6d404617e1e1689184e44da357b529068183e076c753bbc1f3b4aab9a6f", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/tests/_test_vectors.py", "end": 2644, "example_id": "0021b6467bcf60ca4f9cf065d50028cf2e1409f21857b254b6c89193f3495ba8", "language": "python", "prefix": " \"![This phrase of the caption is Human-written.](Picture4.jpg)\",\n ],\n must_not_include=[\"data:image/jpeg;base64,/9j/4AAQSkZJRgABAQE\"],\n ),\n FileTestVector(\n filename=\"test_outlook_msg.msg\",\n mimetype=\"application", "repo": "microsoft/markitdown", "span_codepoints": 64, "start": 2580, "suffix": " must_include=[\n \"# Email Message\",\n \"**From:** test.sender@example.com\",\n \"**To:** test.recipient@example.com\",\n \"**Subject:** Test Email Message\",\n \"## Content\",\n \"This is the body of the", "target": "/vnd.ms-outlook\",\n charset=None,\n url=None,\n "} {"bin": "32_token_ish", "content_sha256": "992d6ec2cf2e8952d1fae378c3baf88134cd0cf874c6f2ab9bd10594673ab665", "document_id": "DataWithBaraa/sql-data-warehouse-project@92406686380cde6eca208c8b43e6fa40ecd26344:scripts/gold/ddl_gold.sql", "end": 2762, "example_id": "0021c55a55a8daaa4c3e3aac62c128ad040628ddd6acd86bd94b771af34c8b7c", "language": "sql", "prefix": "ber,\n pn.prd_nm AS product_name,\n pn.cat_id AS category_id,\n pc.cat AS category,\n pc.subcat AS subcategory,\n pc.maintenance AS maintenance,\n pn.prd_cost AS cost,\n pn.prd_line AS product_line,\n pn.", "repo": "DataWithBaraa/sql-data-warehouse-project", "span_codepoints": 128, "start": 2634, "suffix": "_end_dt IS NULL; -- Filter out all historical data\nGO\n\n-- =============================================================================\n-- Create Fact Table: gold.fact_sales\n-- =============================================================================\nI", "target": "prd_start_dt AS start_date\nFROM silver.crm_prd_info pn\nLEFT JOIN silver.erp_px_cat_g1v2 pc\n ON pn.cat_id = pc.id\nWHERE pn.prd"} {"bin": "8_token_ish", "content_sha256": "3b88c866184712a6fc737bb364ad9ed1fbadd6cad5f32f8fcb09dad54211f9da", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:tests/providers/doubleword/cassette/conformance.rs", "end": 2917, "example_id": "0021c60949f1c00b39d53f3905de691363a4ca225163ba6f94ee39bf458f1c59", "language": "rust", "prefix": " )\n .await;\n}\n\n#[tokio::test]\nasync fn streaming_tool_roundtrip() {\n with_doubleword_cassette(\"conformance/streaming_tool\", |client| async move {\n streaming_tool(client.completion_model(TOOL_MODEL), |builder| builder)\n .await\n ", "repo": "0xPlaygrounds/rig", "span_codepoints": 32, "start": 2885, "suffix": " should succeed\");\n })\n .await;\n}\n\n#[tokio::test]\nasync fn structured_output_after_tool() {\n with_doubleword_cassette(\"conformance/structured_after_tool\", |client| async move {\n structured_after_tool(client.completion_model(TOOL_MODEL), |bu", "target": " .expect(\"streaming tool"} {"bin": "8_token_ish", "content_sha256": "ad49a50cdc019bba871bad85c97b1b6272cb8c44739f289d6010239be2069cd8", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:browser_use/filesystem/file_system.py", "end": 7538, "example_id": "0021f8299d3fe5221a420940e8510a3329392c9973c55c13e89af2eba6165edc", "language": "python", "prefix": "], styles['Title'])\n\t\t\t\t\telif line.startswith('## '):\n\t\t\t\t\t\tpara = Paragraph(line[3:], styles['Heading1'])\n\t\t\t\t\telif line.startswith('### '):\n\t\t\t\t\t\tpara = Paragraph(line[4:], styles['Heading2'])\n\t\t\t\t\telse:\n\t\t\t\t\t\tpara = Paragraph(line, styles['Normal'])\n\t\t\t", "repo": "browser-use/browser-use", "span_codepoints": 32, "start": 7506, "suffix": "\t\t\t\tstory.append(Spacer(1, 6))\n\n\t\t\tdoc.build(story)\n\t\texcept Exception as e:\n\t\t\traise FileSystemError(f\"Error: Could not write to file '{self.full_name}'. {str(e)}\")\n\n\tasync def sync_to_disk(self, path: Path) -> None:\n\t\twith ThreadPoolExecutor() as executo", "target": "\t\tstory.append(para)\n\t\t\t\telse:\n\t"} {"bin": "8_token_ish", "content_sha256": "c3ba54ac18bfd8fe2b8ed18830463dc9cb455911ad19cbdee15e7474173a4d83", "document_id": "jackwener/OpenCLI@5256711a25458e537c5a63d2a6f9c7fd36d0d1eb:clis/hupu/unlike.js", "end": 1429, "example_id": "00220bc810644d1dc92e21565caaf5062a7520dbac959b33737ed54e71be30ff", "language": "javascript", "prefix": " const result = await postHupuJson(page, tid, url, body, 'Unlike Hupu reply');\n // 处理响应\n if (result.code === 1) {\n return [{\n status: '✅ 取消点赞成功',\n message: ''\n ", "repo": "jackwener/OpenCLI", "span_codepoints": 32, "start": 1397, "suffix": "\n else if (result.code === 0 && result.msg === '你还没有点亮过这个回帖') {\n return [{\n status: '⚠️ 你还没点赞过',\n message: result.msg || ''\n }];\n }\n else if (r", "target": " }];\n }"} {"bin": "8_token_ish", "content_sha256": "e9710e26ed2e3d5736ca65b276acce96d4c4cf00bc70ef57d14a2b8ea3cd3d9d", "document_id": "henrygd/beszel@d3a1d61955b0e45fb6b6c76e3ef970cb6518a7e1:agent/connection_manager.go", "end": 7422, "example_id": "00221c04c0994dfff6a6d7241ac42c710d6783a0345ebd3d3bba0f72616621cd", "language": "go", "prefix": "arn(\"WebSocket connection failed\", \"err\", err)\n\t\tc.closeWebSocket()\n\t}\n\treturn err\n}\n\n// startSSHServer starts the SSH server if the agent is currently disconnected.\nfunc (c *ConnectionManager) startSSHServer() {\n\tif c.State == Disconnected {\n\t\tgo c.agent.", "repo": "henrygd/beszel", "span_codepoints": 32, "start": 7390, "suffix": "}\n\n// closeWebSocket closes the WebSocket connection if it exists.\nfunc (c *ConnectionManager) closeWebSocket() {\n\tif c.wsClient != nil {\n\t\tc.wsClient.Close()\n\t}\n}\n\n// shouldExitOnErr checks if the error is a DNS resolution failure and if the\n// EXIT_ON_DN", "target": "StartServer(c.serverOptions)\n\t}\n"} {"bin": "16_token_ish", "content_sha256": "f91858d0b4408f1e05a0ae27f11ae7924776e142476d2efe54887c25e0c89e97", "document_id": "asg017/sqlite-vec@04d28bd21773981e2d266bbf6aa4efbd011eb4f6:tests/fuzz/ivf-cell-overflow.c", "end": 4669, "example_id": "0022307634ad03a837ade6681e3313405bcfed3b4e561ba1681a939cdfd2bd13", "language": "c", "prefix": "\");\n sqlite3_prepare_v2(db, sql, -1, &sk, NULL);\n if (sk) {\n sqlite3_bind_blob(sk, 1, qvec, dim * sizeof(float), SQLITE_TRANSIENT);\n while (sqlite3_step(sk) == SQLITE_ROW) {}\n sqlite3_finalize(sk);\n }\n sqlite3_free(", "repo": "asg017/sqlite-vec", "span_codepoints": 64, "start": 4605, "suffix": "\n // First clear centroids\n sqlite3_exec(db,\n \"INSERT INTO v(v) VALUES ('clear-centroids')\",\n NULL, NULL, NULL);\n\n // Set centroids manually, then assign\n for (int c = 0; c < nlist; c++) {\n float *cvec = sqlite3_malloc(dim * sizeof(float));\n ", "target": "qvec);\n }\n }\n\n // Test assign-vectors with multi-cell state"} {"bin": "32_token_ish", "content_sha256": "ef12f7533b2dd0260ccbaa6b7484edff23376fb984670114411dc37093b188c2", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:scrapling/spiders/templates/sitemap.py", "end": 2666, "example_id": "00224710718899bac38b2c01b6bc1e1666ec697ff021c8db5ae5cb0c4d375a00", "language": "python", "prefix": "r` needs `sitemap_urls` to be set.\")\n\n async def parse(self, response: \"Response\") -> AsyncGenerator[Union[Dict[str, Any], Request, None], None]:\n \"\"\"Default callback for processing responses\"\"\"\n raise NotImplementedError(f\"{self.__class__", "repo": "D4Vinci/Scrapling", "span_codepoints": 128, "start": 2538, "suffix": "response: \"Response\") -> List[str]:\n \"\"\"Extract `Sitemap` directives from a robots.txt body via protego.\"\"\"\n try:\n text = response.body.decode(response.encoding, errors=\"replace\")\n parser = Protego.parse(text)\n ex", "target": ".__name__} must implement parse() method\")\n yield # Make this a generator for type checkers\n\n def _robots_body(self, "} {"bin": "8_token_ish", "content_sha256": "3e06168101152a836f85d114669c60192e82131ad3242bc0635e30d621d252e4", "document_id": "Netflix/maestro@abdbdadf8f075b8fa488c9efb386b468c709a63c:maestro-common/src/main/java/com/netflix/maestro/models/stepruntime/PausedStepAttempt.java", "end": 1571, "example_id": "00224b01185a8ebbe5ff1db383d8d21ac91bbd014ad0a6c41f97775dff312255", "language": "java", "prefix": "nNaming(PropertyNamingStrategies.SnakeCaseStrategy.class)\n@JsonInclude(JsonInclude.Include.NON_NULL)\n@JsonPropertyOrder(\n value = {\n \"workflow_id\",\n \"workflow_version_id\",\n \"workflow_instance_id\",\n \"workflow_run_id\",\n \"step_id\",", "repo": "Netflix/maestro", "span_codepoints": 32, "start": 1539, "suffix": "\"create_time\"\n },\n alphabetic = true)\n@Builder\n@Getter\n@EqualsAndHashCode\npublic class PausedStepAttempt {\n @NotNull private final String workflowId;\n @NotNull private final String stepId;\n private final long workflowVersionId;\n private final lon", "target": "\n \"step_attempt_id\",\n "} {"bin": "32_token_ish", "content_sha256": "dcb3a9f400fdde461ae9463bbeeb76181d5e6929c0a018e361c398f75f331e3f", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_bing_serp_converter.py", "end": 1822, "example_id": "00225d721dfd30f939a05b9bad11c6e1396e043e48e49f8559f2596ba1ec24a4", "language": "python", "prefix": "_stream: BinaryIO,\n stream_info: StreamInfo,\n **kwargs: Any, # Options to pass to the converter\n ) -> DocumentConverterResult:\n assert stream_info.url is not None\n\n # Parse the query parameters\n parsed_params = parse_", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 1694, "suffix": " = \"utf-8\" if stream_info.charset is None else stream_info.charset\n soup = BeautifulSoup(file_stream, \"html.parser\", from_encoding=encoding)\n\n # Clean up some formatting\n for tptt in soup.find_all(class_=\"tptt\"):\n if hasattr", "target": "qs(urlparse(stream_info.url).query)\n query = parsed_params.get(\"q\", [\"\"])[0]\n\n # Parse the stream\n encoding"} {"bin": "16_token_ish", "content_sha256": "6fc17d46415a433607908bf11b1333303feb9075356e5abf37deb6cd7cdf5066", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/alert.tsx", "end": 687, "example_id": "0022972b21a0c2a5f7a1743717643c1ea8c3d818ab3860fae031f7709df618f9", "language": "typescript", "prefix": "has-[>svg]:gap-x-1.5 *:[svg]:row-span-2 *:[svg]:translate-y-0.5 *:[svg]:text-current *:[svg:not([class*='size-'])]:size-3.5\",\n {\n variants: {\n variant: {\n default: \"bg-card text-card-foreground\",\n destructive:\n \"bg-card text", "repo": "OpenCut-app/OpenCut", "span_codepoints": 64, "start": 623, "suffix": " *:[svg]:text-current\",\n },\n },\n defaultVariants: {\n variant: \"default\",\n },\n }\n)\n\nfunction Alert({\n className,\n variant,\n ...props\n}: React.ComponentProps<\"div\"> & VariantProps) {\n return (\n triggers;\n\n DummyWorkflow(SignalTrigger trigger) {\n triggers = List.of(trigger);\n }\n }\n\n @Test\n public void testValid()", "repo": "Netflix/maestro", "span_codepoints": 32, "start": 801, "suffix": "new SignalTrigger();\n Assert.assertTrue(validator.validate(new DummyWorkflow(trigger1)).isEmpty());\n\n SignalTrigger trigger2 = new SignalTrigger();\n trigger2.setDefinitions(Map.of());\n Assert.assertTrue(validator.validate(new DummyWorkflow(trig", "target": " {\n SignalTrigger trigger1 = "} {"bin": "64_token_ish", "content_sha256": "022d96c1a0f148ca478bb411002d5866db65f5b8aafb6990122abf2b6d4f7df6", "document_id": "unitycatalog/unitycatalog@ed504deea31b30c3e7d27e360372077cce04a509:server/src/test/java/io/unitycatalog/server/service/IcebergRestCatalogTest.java", "end": 12681, "example_id": "0022cbe9b3b9f45249a029acc99dae0cb33ed844957565a0e5acbda7cc88d1c9", "language": "java", "prefix": "ocation())\n .isEqualTo(\n Objects.requireNonNull(this.getClass().getResource(\"/iceberg.metadata.json\"))\n .getPath());\n\n // non-prefixed URL should result in 404\n resp =\n client\n .get(\n ", "repo": "unitycatalog/unitycatalog", "span_codepoints": 256, "start": 12425, "suffix": " assertThat(resp.status().code()).isEqualTo(404);\n }\n\n // List uniform tables\n {\n AggregatedHttpResponse resp =\n client\n .get(TEST_BASE_PREFIX + \"/namespaces/\" + TestUtils.SCHEMA_NAME + \"/tables\")\n .aggreg", "target": " TEST_BASE_NON_PREFIX\n + \"/namespaces/\"\n + TestUtils.SCHEMA_NAME\n + \"/tables/\"\n + TestUtils.TABLE_NAME)\n .aggregate()\n .join();\n "} {"bin": "8_token_ish", "content_sha256": "dd9ac331300549b6fb9256d55d68d42f03b6ca7ea7befce1b3a4176e9df42453", "document_id": "modelcontextprotocol/java-sdk@fd004989b9484c9b81be6b03463396797b354804:mcp-core/src/main/java/io/modelcontextprotocol/client/transport/customizer/McpHttpClientAuthorizationErrorHandler.java", "end": 614, "example_id": "0022e2ec321945d56176be95d567e9ff00b6eb1ab4b233ba264b18fedd5a42ff", "language": "java", "prefix": "port io.modelcontextprotocol.common.McpTransportContext;\nimport org.reactivestreams.Publisher;\nimport reactor.core.publisher.Mono;\nimport reactor.core.scheduler.Schedulers;\n\n/**\n * Handle security-related errors in HTTP-client based transports. This class ", "repo": "modelcontextprotocol/java-sdk", "span_codepoints": 32, "start": 582, "suffix": "with status code 401 and 403.\n *\n * @see MCP\n * Specification: Authorization\n * @author Daniel Garnier-Moiroux\n * @deprecated in favor of {@link McpHttpClientTra", "target": "handles MCP\n * server responses "} {"bin": "32_token_ish", "content_sha256": "58d85e6e9b6c53698f1847627b3fe33562fde2f88ffb810142c5583f3819fae2", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_markdownify.py", "end": 2649, "example_id": "0022f5d0df175ff10c7d8009f44ec95f4f1efd725058c4e11fcc309b4a24e28c", "language": "python", "prefix": "t clear if this ever gets thrown\n return \"%s%s%s\" % (prefix, text, suffix)\n\n # For the replacement see #29: text nodes underscores are escaped\n if (\n self.options[\"autolinks\"]\n and text.replace(r\"\\_\", \"_\")", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 2521, "suffix": " return \"<%s>\" % href\n if self.options[\"default_title\"] and not title:\n title = href\n title_part = ' \"%s\"' % title.replace('\"', r\"\\\"\") if title else \"\"\n return (\n \"%s[%s](%s%s)%s\" % (prefix, text, href, t", "target": " == href\n and not title\n and not self.options[\"default_title\"]\n ):\n # Shortcut syntax\n "} {"bin": "16_token_ish", "content_sha256": "c481ef743ef35f0c0518f07e0f49325add564e6811acd660f39a5166aac32090", "document_id": "Netflix/maestro@abdbdadf8f075b8fa488c9efb386b468c709a63c:maestro-timetrigger/src/main/java/com/netflix/maestro/timetrigger/utils/TimeTriggerSubscriptionClient.java", "end": 2349, "example_id": "0022fab1b26cacad02fa2c50be376107d80e47b8fe9bd174f1c2bee169fe5d3b", "language": "java", "prefix": "gger [{}] for workflow id [{}]\",\n current.getTimeTriggerUuid(),\n workflow.getId());\n TimeTriggerExecution execution = convertToExecution(workflow, current);\n insertSubscription(execution);\n } else {\n LOG.info", "repo": "Netflix/maestro", "span_codepoints": 64, "start": 2285, "suffix": " has been sent.\", workflow.getId());\n }\n }\n }\n\n private void insertSubscription(TimeTriggerExecution execution) {\n // Create initial execution message\n triggerProducer.push(execution, Constants.MESSAGE_DELAY_FIRST_EXECUTION);\n metrics.co", "target": "(\n \"No time trigger update for workflow id [{}] as it"} {"bin": "32_token_ish", "content_sha256": "badb0e3bed10b37b6df9f5847ff9ee2761c51185dc0efd315803e9c63ae62459", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converters/_docx_converter.py", "end": 2009, "example_id": "00232518b7c1abcfd1cfd8849328a659642cd39ef0943701dad3d1cc69541e53", "language": "python", "prefix": "\n stream_info: StreamInfo,\n **kwargs: Any, # Options to pass to the converter\n ) -> DocumentConverterResult:\n # Check: the dependencies\n if _dependency_exc_info is not None:\n raise MissingDependencyException(\n ", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 1881, "suffix": "\".docx\",\n feature=\"docx\",\n )\n ) from _dependency_exc_info[\n 1\n ].with_traceback( # type: ignore[union-attr]\n _dependency_exc_info[2]\n )\n\n style_map = k", "target": " MISSING_DEPENDENCY_MESSAGE.format(\n converter=type(self).__name__,\n extension="} {"bin": "8_token_ish", "content_sha256": "c2625ba0f12c95aa3a7a756973033e3481741999229bb74833352b3e0497cd11", "document_id": "D4Vinci/Scrapling@07a548362ff904a2837f503ed9d9f6b9dcef0195:tests/fetchers/async/test_dynamic.py", "end": 1894, "example_id": "00232df13be1c8b117c471050576520a786d4ffcb212df041ee72e75b57f14ab", "language": "python", "prefix": " response = await fetcher.async_fetch(urls[\"html_url\"], page_action=scroll_page)\n assert response.status == 200\n\n @pytest.mark.parametrize(\n \"kwargs\",\n [\n {\"real_chrome\": True, \"disable_resources\": True},\n ", "repo": "D4Vinci/Scrapling", "span_codepoints": 32, "start": 1862, "suffix": "_selector_state\": \"attached\"},\n {\"wait_selector\": \"h1\", \"wait_selector_state\": \"visible\"},\n {\n \"google_search\": True,\n \"real_chrome\": True,\n \"wait\": 10,\n \"locale\": \"en-US\",\n ", "target": " {\"wait_selector\": \"h1\", \"wait"} {"bin": "16_token_ish", "content_sha256": "83d612afc7a975ed9fe21ff2b5a16eb7ff43aa4bd502fb4a584b59f544666ba3", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:tests/installer/e2e.dryrun.test.mjs", "end": 1920, "example_id": "00235cb5b159efe7d9fd02748c7d788d3cc921f9ff53d36314ba93870205139b", "language": "javascript", "prefix": "n-activate\\.js/);\n assert.match(r.stdout, /would merge SessionStart \\+ UserPromptSubmit \\+ statusline/);\n }\n // Nothing should have been written.\n assert.equal(fs.existsSync(path.join(cfg, 'settings.json')), false);\n assert.equal(fs.existsSync(path.", "repo": "JuliusBrussee/caveman", "span_codepoints": 64, "start": 1856, "suffix": " not delete files', () => {\n const cfg = freshTmpDir();\n // Seed a fake installation\n fs.mkdirSync(path.join(cfg, 'hooks'), { recursive: true });\n const fake = path.join(cfg, 'hooks', 'caveman-activate.js');\n fs.writeFileSync(fake, '// fake');\n fs.wr", "target": "join(cfg, 'hooks')), false);\n});\n\ntest('dry-run --uninstall does"} {"bin": "8_token_ish", "content_sha256": "e71882c4a29ebe078c20f67ba5723ed7a2f47bab256f18809d85433d69b36891", "document_id": "0xPlaygrounds/rig@7f1a4950fce8c275541c58936e877125cd053f14:tests/providers/xai/extractor_usage.rs", "end": 5665, "example_id": "00236c2bfed3bd3e2c6e0733bc96b3670b5685983a7a4557e0888b3b34e40507", "language": "rust", "prefix": "\n let person_response = person_extractor\n .extract_with_usage(\"Alice is a 25 year old developer.\")\n .await?;\n anyhow::ensure!(person_response.usage.total_tokens > 0);\n\n let address_extractor = ", "repo": "0xPlaygrounds/rig", "span_codepoints": 32, "start": 5633, "suffix": ":GROK_3_MINI).build();\n let address_response = address_extractor\n .extract_with_usage(\"456 Oak Avenue, Cambridge, MA 02139\")\n .await?;\n anyhow::ensure!(address_response.usage.total_tokens > 0);\n\n ", "target": "client.extractor::
(xai:"} {"bin": "32_token_ish", "content_sha256": "f02e0a3de8711be6c1ad658af45b9d8e9314c63089e01a17324d06eb7f920201", "document_id": "Netflix/maestro@abdbdadf8f075b8fa488c9efb386b468c709a63c:maestro-engine/src/main/resources/db/migration/postgres/V202107151600__add_execution_tables.sql", "end": 1579, "example_id": "002372ab0688d42244a27918eb44f159b440111398cc996f7a3102d44e1859af", "language": "sql", "prefix": "NULL CHECK (workflow_run_id > 0),\n step_id TEXT NOT NULL COLLATE \"C\",\n payload JSON NOT NULL,\n create_ts TIMESTAMPTZ DEFAULT CURRENT_TIMESTAMP NOT NULL,\n PRIMARY KEY (workflow_id, workflow_instance_id", "repo": "Netflix/maestro", "span_codepoints": 128, "start": 1451, "suffix": ", -- True when inserting paused step attempt due to breakpoint. False to denote explicit user actions.\n workflow_id TEXT NOT NULL COLLATE \"C\",\n version INT8 NOT NULL,\n instance_id INT8 NOT NULL,\n ", "target": ", workflow_run_id, step_id)\n);\nCREATE TABLE IF NOT EXISTS maestro_step_breakpoint (\n system_generated BOOL NOT NULL"} {"bin": "16_token_ish", "content_sha256": "5527c211ac7776602985d2f9417a65c3b86f47d2875f99ade4c1f3502777beb6", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:skills/open-source/references/tools.md", "end": 3663, "example_id": "0023754704bb821714d73836df6ed4ce0c3618a5a17a8887821770feb172b0a3", "language": "markdown", "prefix": " Tools\n\nSource: [tools/service.py](https://github.com/browser-use/browser-use/blob/main/browser_use/tools/service.py)\n\n### Navigation & Browser Control\n- `search` — Search queries (DuckDuckGo, Google, Bing)\n- `navigate` — Navigate to URLs\n- `go_back` — Go ", "repo": "browser-use/browser-use", "span_codepoints": 64, "start": 3599, "suffix": "Interaction\n- `click` — Click elements by index\n- `input` — Input text into form fields\n- `upload_file` — Upload files\n- `scroll` — Scroll page up/down\n- `find_text` — Scroll to specific text\n- `send_keys` — Send keys (Enter, Escape, Tab, etc.)\n\n### JavaSc", "target": "back in history\n- `wait` — Wait for specified seconds\n\n### Page "} {"bin": "64_token_ish", "content_sha256": "5a9976de581707f0f816221505b968d3d2da6a9415279166c491882a217f5ad7", "document_id": "EpicGames/raddebugger@78d12eb914378d8552b31c501c12e1c202356024:src/linker/lnk_symbol_table.c", "end": 24265, "example_id": "00237af421f6b7ecda55d78fdc1f4a719f9d583a5002bd19a7ef23df128e2664", "language": "c", "prefix": "MemoryCompare(&s->symbol, ¤t_symbol, sizeof(LNK_ObjSymbolRef)) == 0) { was_visited = s; break; }\n }\n if (was_visited) {\n String8List chain = {0};\n for (struct S *s = sf; s != 0; s = s->next) {\n COFF_ParsedSymbol s_parsed = lnk_", "repo": "EpicGames/raddebugger", "span_codepoints": 256, "start": 24009, "suffix": "= lnk_parsed_symbol_from_coff_symbol_idx(symbol.obj, symbol.symbol_idx);\n str8_list_pushf(scratch.arena, &chain, \"\\t%S Symbol %S (No. %#x)\", sf->symbol.obj->path, symbol_parsed.name, sf->symbol.symbol_idx);\n\n String8 chain_string = str8_list_join", "target": "parsed_symbol_from_coff_symbol_idx(s->symbol.obj, s->symbol.symbol_idx);\n str8_list_pushf(scratch.arena, &chain, \"\\t%S Symbol %S (No. %#x) =>\", s->symbol.obj->path, s_parsed.name, s->symbol.symbol_idx);\n }\n COFF_ParsedSymbol symbol_parsed "} {"bin": "32_token_ish", "content_sha256": "b898fa7d192aa35a985cd95e242dc3dbd71dd2a2b5bdf6abf0b3e17cf44a79fa", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/converter_utils/docx/math/latex_dict.py", "end": 1520, "example_id": "00237b6636c23246569e17c428fc1cd9b43ad87b117955c6901420f93667a6e0", "language": "python", "prefix": "\",\n \"\\u20e1\": \"\\\\overleftrightarrow{{{0}}}\",\n \"\\u20e7\": \"\\\\annuity{{{0}}}\",\n \"\\u20e9\": \"\\\\widebridgeabove{{{0}}}\",\n \"\\u20f0\": \"\\\\asteraccent{{{0}}}\",\n # Bottom accents\n \"\\u0330\": \"\\\\wideutilde{{{0}}}\",\n \"\\u0331\": \"\\\\underbar{{{0}}}\",\n ", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 1392, "suffix": "}}}\",\n \"\\u20ee\": \"\\\\underledtarrow{{{0}}}\",\n \"\\u20ef\": \"\\\\underrightarrow{{{0}}}\",\n # Over | group\n \"\\u23b4\": \"\\\\overbracket{{{0}}}\",\n \"\\u23dc\": \"\\\\overparen{{{0}}}\",\n \"\\u23de\": \"\\\\overbrace{{{0}}}\",\n # Under| group\n \"\\u23b5\": \"\\\\un", "target": " \"\\u20e8\": \"\\\\threeunderdot{{{0}}}\",\n \"\\u20ec\": \"\\\\underrightharpoondown{{{0}}}\",\n \"\\u20ed\": \"\\\\underleftharpoondown{{{0"} {"bin": "32_token_ish", "content_sha256": "47efdd3796c52b5259c54889413ef331316aacf30f471a38b8be4cce9f2d4839", "document_id": "browser-use/browser-use@0964ad452a9f3fe249042a5ffb235e5f98519b2e:tests/ci/browser/test_cross_origin_click.py", "end": 1942, "example_id": "002391c42e84dd83fbd12110a20df1abcb1bb88ecffd558663591d3f89fbda22", "language": "python", "prefix": "rame\" src=\"/iframe-content\" style=\"width: 800px; height: 600px;\">\n\t\t\n\t\t\n\t\t\"\"\"\n\n\t\t# Serve both pages\n\t\thttpserver.expect_request('/multi-target-test').respond_with_data(main_html, content_type='text/html')\n\t\thttpserver.expect_request(", "repo": "browser-use/browser-use", "span_codepoints": 128, "start": 1814, "suffix": "# Navigate to the page\n\t\tawait browser_session.navigate_to(url)\n\n\t\t# Wait for iframe to load\n\t\tawait asyncio.sleep(2)\n\n\t\t# Get DOM state with cross-origin iframe extraction enabled\n\t\t# Use browser_session.get_browser_state_summary() instead of directly cre", "target": "'/iframe-content').respond_with_data(iframe_html, content_type='text/html')\n\t\turl = httpserver.url_for('/multi-target-test')\n\n\t\t"} {"bin": "32_token_ish", "content_sha256": "f759cbf40824426107b527127b7a79b6efb613fc85f0c162d4a24cad7789d7ef", "document_id": "microsoft/markitdown@2e42a01c404629b06892a1bdb5e7bf5261770c40:packages/markitdown/src/markitdown/__main__.py", "end": 2320, "example_id": "0023986268d10d3f3ed6e51de9e4720c4925886ae312c90dd7c4faf1277ec9dd", "language": "python", "prefix": "usive_group()\n cloud_group.add_argument(\n \"-d\",\n \"--use-docintel\",\n action=\"store_true\",\n help=\"Use Document Intelligence to extract text instead of offline conversion. Requires a valid Document Intelligence Endpoint.\",\n )", "repo": "microsoft/markitdown", "span_codepoints": 128, "start": 2192, "suffix": "dest=\"use_cu\",\n help=\"Use Azure Content Understanding to extract text. Requires --cu-endpoint.\",\n )\n\n parser.add_argument(\n \"-e\",\n \"--endpoint\",\n type=str,\n help=\"Document Intelligence Endpoint. Required if using Do", "target": "\n\n cloud_group.add_argument(\n \"--use-cu\",\n \"--use-content-understanding\",\n action=\"store_true\",\n "} {"bin": "64_token_ish", "content_sha256": "ee5d86c9099e45f2653d456a0a84b903b54ce60dad4b05a24473c5970f31d1ea", "document_id": "OpenCut-app/OpenCut@4d8c49ed0706c4dc145361e01c6b1f1a87cbb863:apps/web/src/components/ui/select.tsx", "end": 6002, "example_id": "0023ec5ed7f8c9fa44084dc1d0baf13ec8ed4d6f5349a8277022f0cf3c275b47", "language": "typescript", "prefix": "e={cn(\n \"pointer-events-none -mx-1 my-1 h-px bg-border/50\",\n className\n )}\n {...props}\n />\n )\n}\n\nfunction SelectScrollUpButton({\n className,\n ...props\n}: React.ComponentProps) {\n return (", "repo": "OpenCut-app/OpenCut", "span_codepoints": 256, "start": 5746, "suffix": "}\n {...props}\n >\n \n \n )\n}\n\nfunction SelectScrollDownButton({\n className,\n ...props\n}: React.ComponentProps) {\n ", "target": "\n = 500) {\n const err = (await response.json().catch(() => ({}))) as TokenErrorResponse;\n return {\n", "target": "ok) {\n const tokens = (await response.json()) as TokenData;\n "} {"bin": "16_token_ish", "content_sha256": "25bf224c95efef7f424e6fcbbe72ac1b10ff5f030c244260a0a5723be8210325", "document_id": "JuliusBrussee/caveman@0d95a81d35a9f2d123a5e9430d1cfc43d55f1bb0:tests/installer/e2e.freshinstall.test.mjs", "end": 14579, "example_id": "0024269aad2ff0a83f6ee5ebf1013c6187fe616a50f4a01cd65a1f1f8c57af97", "language": "javascript", "prefix": "got ${versionMatches.length}`);\n const alwaysMatches = skillRaw.match(/^always:/gm) || [];\n assert.equal(alwaysMatches.length, 1, `expected 1 always key after re-run, got ${alwaysMatches.length}`);\n\n const soulRaw = fs.readFileSync(path.join(ws, '", "repo": "JuliusBrussee/caveman", "span_codepoints": 64, "start": 14515, "suffix": " caveman-begin -->/g) || [];\n assert.equal(beginMatches.length, 1, `expected 1 marker block after re-run, got ${beginMatches.length}`);\n } finally {\n fs.rmSync(dir, { recursive: true, force: true });\n }\n});\n\ntest('openclaw install preserves user co", "target": "SOUL.md'), 'utf8');\n const beginMatches = soulRaw.match(/