टेक्स्ट की तुलना करें

दो टेक्स्ट फ़ाइलों के बीच अंतर ढूंढें

Real-time diff

Unified diff

Collapse lines

Highlight change

Syntax highlighting

टूल्स

Diffchecker Desktop The most secure way to run Diffchecker. Get the Diffchecker Desktop app: your diffs never leave your computer!Get Desktop

12GB-vs-16GB

Created 2 months agoDiff never expires

Lines
Total
Removed

Words
Total
Removed

To continue using this feature, upgrade to Diffchecker Pro View Pricing

277 lines

Lines
Total
Added

Words
Total
Added

To continue using this feature, upgrade to Diffchecker Pro View Pricing

275 lines

time=2025-05-05T13:07:25.139Z level=INFO source=images.go:458 msg="total blobs: 13"

time=2025-05-05T13:49:12.680Z level=INFO source=images.go:458 msg="total blobs: 13"

time=2025-05-05T13:07:25.140Z level=INFO source=images.go:465 msg="total unused blobs removed: 0"

time=2025-05-05T13:49:12.681Z level=INFO source=images.go:465 msg="total unused blobs removed: 0"

time=2025-05-05T13:07:25.140Z level=INFO source=routes.go:1300 msg="Listening on [::]:11434 (version 0.6.7)"

time=2025-05-05T13:49:12.681Z level=INFO source=routes.go:1300 msg="Listening on [::]:11434 (version 0.6.7)"

time=2025-05-05T13:07:25.141Z level=INFO source=gpu.go:217 msg="looking for compatible GPUs"

time=2025-05-05T13:49:12.682Z level=INFO source=gpu.go:217 msg="looking for compatible GPUs"

time=2025-05-05T13:07:25.464Z level=INFO source=types.go:130 msg="inference compute" id=GPU-ff09c0e9-5a28-3ac2-7460-12dded00031a library=cuda variant=v12 compute=8.6 driver=12.8 name="NVIDIA GeForce RTX 3060" total="11.6 GiB" available="11.5 GiB"

time=2025-05-05T13:49:13.053Z level=INFO source=types.go:130 msg="inference compute" id=GPU-426eaf30-0b2f-f612-17a7-2aa3cc3497fb library=cuda variant=v12 compute=12.0 driver=12.8 name="NVIDIA Graphics Device" total="15.5 GiB" available="15.4 GiB"

[GIN] 2025/05/05 - 13:07:27 | 200 | 94.653µs | 127.0.0.1 | HEAD "/"

[GIN] 2025/05/05 - 13:49:14 | 200 | 149.304µs | 127.0.0.1 | HEAD "/"

[GIN] 2025/05/05 - 13:07:27 | 200 | 332.494428ms | 127.0.0.1 | POST "/api/pull"

[GIN] 2025/05/05 - 13:49:15 | 200 | 400.965038ms | 127.0.0.1 | POST "/api/pull"

[GIN] 2025/05/05 - 13:07:29 | 200 | 49.961µs | 127.0.0.1 | HEAD "/"

[GIN] 2025/05/05 - 13:49:17 | 200 | 44.732µs | 127.0.0.1 | HEAD "/"

[GIN] 2025/05/05 - 13:07:29 | 200 | 213.715969ms | 127.0.0.1 | POST "/api/pull"

[GIN] 2025/05/05 - 13:49:17 | 200 | 174.298821ms | 127.0.0.1 | POST "/api/pull"

[GIN] 2025/05/05 - 13:07:31 | 200 | 42.131µs | 127.0.0.1 | HEAD "/"

[GIN] 2025/05/05 - 13:49:18 | 200 | 31.261µs | 127.0.0.1 | HEAD "/"

[GIN] 2025/05/05 - 13:07:31 | 200 | 193.73517ms | 127.0.0.1 | POST "/api/pull"

[GIN] 2025/05/05 - 13:49:19 | 200 | 212.931989ms | 127.0.0.1 | POST "/api/pull"

time=2025-05-05T13:32:21.428Z level=WARN source=ggml.go:152 msg="key not found" key=general.alignment default=32

time=2025-05-05T13:49:59.768Z level=WARN source=ggml.go:152 msg="key not found" key=general.alignment default=32

time=2025-05-05T13:32:21.640Z level=WARN source=ggml.go:152 msg="key not found" key=general.alignment default=32

time=2025-05-05T13:50:00.036Z level=WARN source=ggml.go:152 msg="key not found" key=general.alignment default=32

time=2025-05-05T13:32:21.671Z level=WARN source=ggml.go:152 msg="key not found" key=general.alignment default=32

time=2025-05-05T13:50:00.078Z level=WARN source=ggml.go:152 msg="key not found" key=general.alignment default=32

time=2025-05-05T13:32:21.671Z level=WARN source=ggml.go:152 msg="key not found" key=bert.vision.block_count default=0

time=2025-05-05T13:50:00.079Z level=WARN source=ggml.go:152 msg="key not found" key=bert.vision.block_count default=0

time=2025-05-05T13:32:21.671Z level=WARN source=ggml.go:152 msg="key not found" key=bert.attention.head_count_kv default=1

time=2025-05-05T13:50:00.079Z level=WARN source=ggml.go:152 msg="key not found" key=bert.attention.head_count_kv default=1

time=2025-05-05T13:32:21.671Z level=WARN source=ggml.go:152 msg="key not found" key=bert.attention.key_length default=64

time=2025-05-05T13:50:00.079Z level=WARN source=ggml.go:152 msg="key not found" key=bert.attention.key_length default=64

time=2025-05-05T13:32:21.671Z level=WARN source=ggml.go:152 msg="key not found" key=bert.attention.value_length default=64

time=2025-05-05T13:50:00.079Z level=WARN source=ggml.go:152 msg="key not found" key=bert.attention.value_length default=64

time=2025-05-05T13:32:21.672Z level=WARN source=ggml.go:152 msg="key not found" key=bert.attention.head_count_kv default=1

time=2025-05-05T13:50:00.079Z level=WARN source=ggml.go:152 msg="key not found" key=bert.attention.head_count_kv default=1

time=2025-05-05T13:32:21.672Z level=INFO source=sched.go:723 msg="new model will fit in available VRAM in single GPU, loading" model=/root/.ollama/models/blobs/sha256-daec91ffb5dd0c27411bd71f29932917c49cf529a641d0168496c3a501e3062c gpu=GPU-ff09c0e9-5a28-3ac2-7460-12dded00031a parallel=1 available=12384468992 required="1.6 GiB"

time=2025-05-05T13:50:00.079Z level=INFO source=sched.go:723 msg="new model will fit in available VRAM in single GPU, loading" model=/root/.ollama/models/blobs/sha256-daec91ffb5dd0c27411bd71f29932917c49cf529a641d0168496c3a501e3062c gpu=GPU-426eaf30-0b2f-f612-17a7-2aa3cc3497fb parallel=1 available=16488660992 required="1.6 GiB"

time=2025-05-05T13:32:21.839Z level=INFO source=server.go:105 msg="system memory" total="62.8 GiB" free="60.0 GiB" free_swap="0 B"

time=2025-05-05T13:50:00.236Z level=INFO source=server.go:105 msg="system memory" total="62.8 GiB" free="60.0 GiB" free_swap="0 B"

time=2025-05-05T13:32:21.839Z level=WARN source=ggml.go:152 msg="key not found" key=bert.vision.block_count default=0

time=2025-05-05T13:50:00.236Z level=WARN source=ggml.go:152 msg="key not found" key=bert.vision.block_count default=0

time=2025-05-05T13:32:21.839Z level=WARN source=ggml.go:152 msg="key not found" key=bert.attention.head_count_kv default=1

time=2025-05-05T13:50:00.236Z level=WARN source=ggml.go:152 msg="key not found" key=bert.attention.head_count_kv default=1

time=2025-05-05T13:32:21.839Z level=WARN source=ggml.go:152 msg="key not found" key=bert.attention.key_length default=64

time=2025-05-05T13:50:00.236Z level=WARN source=ggml.go:152 msg="key not found" key=bert.attention.key_length default=64

time=2025-05-05T13:32:21.839Z level=WARN source=ggml.go:152 msg="key not found" key=bert.attention.value_length default=64

time=2025-05-05T13:50:00.236Z level=WARN source=ggml.go:152 msg="key not found" key=bert.attention.value_length default=64

time=2025-05-05T13:32:21.839Z level=WARN source=ggml.go:152 msg="key not found" key=bert.attention.head_count_kv default=1

time=2025-05-05T13:50:00.238Z level=WARN source=ggml.go:152 msg="key not found" key=bert.attention.head_count_kv default=1

time=2025-05-05T13:32:21.839Z level=INFO source=server.go:138 msg=offload library=cuda layers.requested=-1 layers.model=25 layers.offload=25 layers.split="" memory.available="[11.5 GiB]" memory.gpu_overhead="0 B" memory.required.full="1.6 GiB" memory.required.partial="1.6 GiB" memory.required.kv="24.0 MiB" memory.required.allocations="[1.6 GiB]" memory.weights.total="1.0 GiB" memory.weights.repeating="577.2 MiB" memory.weights.nonrepeating="488.3 MiB" memory.graph.full="64.0 MiB" memory.graph.partial="64.0 MiB"

time=2025-05-05T13:50:00.239Z level=INFO source=server.go:138 msg=offload library=cuda layers.requested=-1 layers.model=25 layers.offload=25 layers.split="" memory.available="[15.4 GiB]" memory.gpu_overhead="0 B" memory.required.full="1.6 GiB" memory.required.partial="1.6 GiB" memory.required.kv="24.0 MiB" memory.required.allocations="[1.6 GiB]" memory.weights.total="1.0 GiB" memory.weights.repeating="577.2 MiB" memory.weights.nonrepeating="488.3 MiB" memory.graph.full="64.0 MiB" memory.graph.partial="64.0 MiB"

llama_model_loader: loaded meta data with 33 key-value pairs and 389 tensors from /root/.ollama/models/blobs/sha256-daec91ffb5dd0c27411bd71f29932917c49cf529a641d0168496c3a501e3062c (version GGUF V3 (latest))

llama_model_loader: Dumping metadata keys/values. Note: KV overrides do not apply in this output.

llama_model_loader: - kv 0: general.architecture str = bert

llama_model_loader: - kv 1: general.type str = model

llama_model_loader: - kv 2: general.size_label str = 567M

llama_model_loader: - kv 3: general.license str = mit

llama_model_loader: - kv 4: general.tags arr[str,4] = ["sentence-transformers", "feature-ex...

llama_model_loader: - kv 5: bert.block_count u32 = 24

llama_model_loader: - kv 6: bert.context_length u32 = 8192

llama_model_loader: - kv 7: bert.embedding_length u32 = 1024

llama_model_loader: - kv 8: bert.feed_forward_length u32 = 4096

llama_model_loader: - kv 9: bert.attention.head_count u32 = 16

llama_model_loader: - kv 10: bert.attention.layer_norm_epsilon f32 = 0.000010

llama_model_loader: - kv 11: general.file_type u32 = 1

llama_model_loader: - kv 12: bert.attention.causal bool = false

llama_model_loader: - kv 13: bert.pooling_type u32 = 2

llama_model_loader: - kv 14: tokenizer.ggml.model str = t5

llama_model_loader: - kv 15: tokenizer.ggml.pre str = default

llama_model_loader: - kv 16: tokenizer.ggml.tokens arr[str,250002] = ["<s>", "<pad>", "</s>", "<unk>", ","...

llama_model_loader: - kv 17: tokenizer.ggml.scores arr[f32,250002] = [0.000000, 0.000000, 0.000000, 0.0000...

llama_model_loader: - kv 18: tokenizer.ggml.token_type arr[i32,250002] = [3, 3, 3, 2, 1, 1, 1, 1, 1, 1, 1, 1, ...

llama_model_loader: - kv 19: tokenizer.ggml.add_space_prefix bool = true

llama_model_loader: - kv 20: tokenizer.ggml.token_type_count u32 = 1

llama_model_loader: - kv 21: tokenizer.ggml.remove_extra_whitespaces bool = true

llama_model_loader: - kv 22: tokenizer.ggml.precompiled_charsmap arr[u8,237539] = [0, 180, 2, 0, 0, 132, 0, 0, 0, 0, 0,...

llama_model_loader: - kv 23: tokenizer.ggml.bos_token_id u32 = 0

llama_model_loader: - kv 24: tokenizer.ggml.eos_token_id u32 = 2

llama_model_loader: - kv 25: tokenizer.ggml.unknown_token_id u32 = 3

llama_model_loader: - kv 26: tokenizer.ggml.seperator_token_id u32 = 2

llama_model_loader: - kv 27: tokenizer.ggml.padding_token_id u32 = 1

llama_model_loader: - kv 28: tokenizer.ggml.cls_token_id u32 = 0

llama_model_loader: - kv 29: tokenizer.ggml.mask_token_id u32 = 250001

llama_model_loader: - kv 30: tokenizer.ggml.add_bos_token bool = true

llama_model_loader: - kv 31: tokenizer.ggml.add_eos_token bool = true

llama_model_loader: - kv 32: general.quantization_version u32 = 2

llama_model_loader: - type f32: 244 tensors

llama_model_loader: - type f16: 145 tensors

print_info: file format = GGUF V3 (latest)

print_info: file type = F16

print_info: file size = 1.07 GiB (16.25 BPW)

load: model vocab missing newline token, using special_pad_id instead

load: special_eos_id is not in special_eog_ids - the tokenizer config may be incorrect

load: special tokens cache size = 4

load: token to piece cache size = 2.1668 MB

print_info: arch = bert

print_info: vocab_only = 1

print_info: model type = ?B

print_info: model params = 566.70 M

print_info: general.name = n/a

print_info: vocab type = UGM

print_info: n_vocab = 250002

print_info: n_merges = 0

print_info: BOS token = 0 '<s>'

print_info: EOS token = 2 '</s>'

print_info: UNK token = 3 '<unk>'

print_info: SEP token = 2 '</s>'

print_info: PAD token = 1 '<pad>'

print_info: MASK token = 250001 '[PAD250000]'

print_info: LF token = 0 '<s>'

print_info: EOG token = 2 '</s>'

print_info: max token length = 48

llama_model_load: vocab only - skipping tensors

time=2025-05-05T13:32:22.374Z level=INFO source=server.go:409 msg="starting llama server" cmd="/usr/bin/ollama runner --model /root/.ollama/models/blobs/sha256-daec91ffb5dd0c27411bd71f29932917c49cf529a641d0168496c3a501e3062c --ctx-size 4096 --batch-size 512 --n-gpu-layers 25 --threads 32 --parallel 1 --port 43807"

time=2025-05-05T13:50:00.840Z level=INFO source=server.go:409 msg="starting llama server" cmd="/usr/bin/ollama runner --model /root/.ollama/models/blobs/sha256-daec91ffb5dd0c27411bd71f29932917c49cf529a641d0168496c3a501e3062c --ctx-size 4096 --batch-size 512 --n-gpu-layers 25 --threads 32 --parallel 1 --port 45529"

time=2025-05-05T13:32:22.375Z level=INFO source=sched.go:450 msg="loaded runners" count=1

time=2025-05-05T13:50:00.841Z level=INFO source=sched.go:450 msg="loaded runners" count=1

time=2025-05-05T13:32:22.375Z level=INFO source=server.go:585 msg="waiting for llama runner to start responding"

time=2025-05-05T13:50:00.841Z level=INFO source=server.go:585 msg="waiting for llama runner to start responding"

time=2025-05-05T13:32:22.375Z level=INFO source=server.go:619 msg="waiting for server to become available" status="llm server error"

time=2025-05-05T13:50:00.841Z level=INFO source=server.go:619 msg="waiting for server to become available" status="llm server error"

time=2025-05-05T13:32:22.405Z level=INFO source=runner.go:853 msg="starting go runner"

time=2025-05-05T13:50:00.861Z level=INFO source=runner.go:853 msg="starting go runner"

load_backend: loaded CPU backend from /usr/lib/ollama/libggml-cpu-haswell.so

ggml_cuda_init: GGML_CUDA_FORCE_MMQ: no

ggml_cuda_init: GGML_CUDA_FORCE_CUBLAS: no

ggml_cuda_init: found 1 CUDA devices:

Device 0: NVIDIA GeForce RTX 3060, compute capability 8.6, VMM: yes

Device 0: NVIDIA Graphics Device, compute capability 12.0, VMM: yes

load_backend: loaded CUDA backend from /usr/lib/ollama/cuda_v12/libggml-cuda.so

time=2025-05-05T13:32:22.524Z level=INFO source=ggml.go:103 msg=system CPU.0.SSE3=1 CPU.0.SSSE3=1 CPU.0.AVX=1 CPU.0.AVX2=1 CPU.0.F16C=1 CPU.0.FMA=1 CPU.0.BMI2=1 CPU.0.LLAMAFILE=1 CPU.1.LLAMAFILE=1 CUDA.0.ARCHS=500,600,610,700,750,800,860,870,890,900,1200 CUDA.0.USE_GRAPHS=1 CUDA.0.PEER_MAX_BATCH_SIZE=128 compiler=cgo(gcc)

time=2025-05-05T13:50:00.963Z level=INFO source=ggml.go:103 msg=system CPU.0.SSE3=1 CPU.0.SSSE3=1 CPU.0.AVX=1 CPU.0.AVX2=1 CPU.0.F16C=1 CPU.0.FMA=1 CPU.0.BMI2=1 CPU.0.LLAMAFILE=1 CPU.1.LLAMAFILE=1 CUDA.0.ARCHS=500,600,610,700,750,800,860,870,890,900,1200 CUDA.0.USE_GRAPHS=1 CUDA.0.PEER_MAX_BATCH_SIZE=128 compiler=cgo(gcc)

time=2025-05-05T13:32:22.524Z level=INFO source=runner.go:913 msg="Server listening on 127.0.0.1:43807"

time=2025-05-05T13:50:00.963Z level=INFO source=runner.go:913 msg="Server listening on 127.0.0.1:45529"

time=2025-05-05T13:32:22.627Z level=INFO source=server.go:619 msg="waiting for server to become available" status="llm server loading model"

llama_model_load_from_file_impl: using device CUDA0 (NVIDIA Graphics Device) - 15724 MiB free

llama_model_load_from_file_impl: using device CUDA0 (NVIDIA GeForce RTX 3060) - 11810 MiB free

time=2025-05-05T13:50:01.094Z level=INFO source=server.go:619 msg="waiting for server to become available" status="llm server loading model"