sequelbox's picture
card
60d66ba verified
|
Raw
History Blame Contribute Delete
4.86 kB
metadata
language:
  - en
library_name: transformers
pipeline_tag: image-text-to-text
tags:
  - esper
  - esper-4
  - valiant
  - valiant-labs
  - meta
  - facebook
  - muse-glimmer
  - muse
  - glimmer
  - muse-glimmer-30b
  - 30b
  - reasoning
  - code
  - code-instruct
  - python
  - typescript
  - javascript
  - java
  - c++
  - c
  - c#
  - rust
  - go
  - haskell
  - dev-ops
  - jenkins
  - terraform
  - ansible
  - docker
  - jenkins
  - kubernetes
  - helm
  - grafana
  - prometheus
  - shell
  - bash
  - azure
  - aws
  - gcp
  - cloud
  - scripting
  - powershell
  - problem-solving
  - architect
  - engineer
  - developer
  - creative
  - analytical
  - expert
  - rationality
  - conversational
  - chat
  - instruct
base_model: meta-models/Muse-Glimmer-30B
datasets:
  - sequelbox/Mitakihara2-DeepSeek-V4-Pro
  - sequelbox/Tachibana4-DeepSeek-V4-Pro
  - sequelbox/Titanium4-DeepSeek-V4-Pro
license: apache-2.0

Support our open-source dataset and model releases!

IMG_3906

Esper 4: gemma-4-12B, Qwen3.6-27B, Muse-Glimmer-30B

Esper 4 is an agentic coding, architecture, DevOps, and MLOps specialist built on Muse Glimmer 30B!

Prompting Guide

Esper 4 uses the Muse Glimmer prompt format.

Use Esper 4 with your agentic framework of choice or as a stand-alone chat and code assistant.

Example inference script to get started:

from transformers import AutoProcessor, AutoModelForMultimodalLM

MODEL_ID = "ValiantLabs/Muse-Glimmer-30B-Esper4"
# Load model
processor = AutoProcessor.from_pretrained(MODEL_ID)
model = AutoModelForMultimodalLM.from_pretrained(MODEL_ID, dtype="auto", device_map="auto")

# Prompt
prompt = "Implement CQRS for network appliance config management.\n\nRequirements:\n- Write side: 200 commands/sec, 4 command handlers, SQLite with custom journaling\n- Read side: 1000 queries/sec, 3 read projections in shared memory segments\n- Eventual consistency window: 100ms max\n- Handle atomic swap of projection memory for rebuilds\n- Binary configuration format versioning for schema evolution\n- Framework: libevent with custom protocol parser\n\nConstraints:\n- Manual memory management only, no garbage collection\n- Lock-free data structures where possible\n- Shared memory projections must survive process restarts\n- Command handlers must be thread-safe with 4 worker threads\n- Projection rebuild must not block queries\n- Binary format must support forward/backward compatibility\n- Error handling for corrupted journal recovery\n- Memory-mapped I/O for shared segments\n- Zero-copy where possible for performance\n\nDeliverables:\n1. Command processing pipeline with journaling\n2. Projection engine with shared memory management\n3. Query dispatcher with read-your-writes consistency\n4. Schema evolution system with versioned binary format\n5. Integration with libevent for network I/O\n6. Stress test showing 200 cmd/s + 1000 q/s sustained\n\nAssume x86_64 Linux, pthreads, atomic operations. No high-level frameworks."

messages = [
    {"role": "user", "content": prompt},
]

# Process input
inputs = processor.apply_chat_template(
    messages,
    tokenize=True,
    return_dict=True,
    return_tensors="pt",
    add_generation_prompt=True,
    reasoning_strength="high",
).to(model.device)
input_len = inputs["input_ids"].shape[-1]

# Generate output
outputs = model.generate(**inputs)
response = processor.decode(outputs[0][input_len:], skip_special_tokens=False)
print(response)

image/jpeg

Esper 4 is created by Valiant Labs.

Check out our HuggingFace page to see all of our models!

We care about open source. For everyone to use.