1 parent 4d3390c commit d45f20dCopy full SHA for d45f20d
1 file changed
src/llama-model.cpp
@@ -15806,6 +15806,7 @@ struct llm_build_plamo2 : public llm_graph_context_mamba {
15806
cb(zx, "mamba_in_proj", il);
15807
// {8192, 5, 1, 1} -> {8192, 1, 5, 1}
15808
zx = ggml_permute(ctx0, zx, 0, 2, 1, 3);
15809
+ zx = ggml_cont(ctx0, zx);
15810
zx = ggml_reshape_4d(ctx0, zx, head_dim * 2, n_heads, n_seq_tokens, n_seqs);
15811
cb(zx, "mamba_in_proj_out", il);
15812
@@ -15823,7 +15824,6 @@ struct llm_build_plamo2 : public llm_graph_context_mamba {
15823
15824
// conv1d
15825
{
15826
// => {d_conv - 1 + n_seq_tokens, d_inner, n_seqs}
- x = ggml_view_2d(ctx0, x, d_inner, n_seq_tokens * n_seqs, d_inner * x->nb[0], 0);
15827
ggml_tensor * conv_x = ggml_concat(ctx0, conv, ggml_transpose(ctx0, x), 0);
15828
cb(conv_x, "mamba_conv1d_input", il);
15829
0 commit comments