Archai JEV Zagreus 0.4B Ita (System One Decision Engine)

Archai JEV Zagreus 0.4B Ita is an ultra-lightweight, native Italian "System One" decision engine fine-tuned from mii-llm/zagreus-0.4B-ita.

Designed specifically for sub-10ms CPU inference in edge and Rust/C++ environments, this model evaluates native Italian inputs and generates deterministic output tokens (A, B, C, D, TRUE, FALSE) across various reasoning, safety, and classification tasks.

Key Highlights

  • Native Italian Dataset Suite: Trained on a consolidated mixture of 7 native Italian benchmark datasets (EvalITA, HateCheck-IT, RiTA-NLP, STS-B).
  • Dynamic Calibration Loss: Optimized via dynamic joint Cross-Entropy and Brier Score minimization, ensuring well-calibrated confidence probabilities.
  • Ultra-Compact Footprint: Converted to Q8_0 GGUF format with a file size of only 465 MB, allowing instant loading into RAM.

Model Details

  • Developer: nickprock
  • Base Model: mii-llm/zagreus-0.4B-ita (400M Parameters)
  • Architecture: LlamaForCausalLM
  • Fine-Tuning Method: QLoRA ($r=16, \alpha=32$)
  • Quantization Format: GGUF (Q8_0, 465 MB)
  • Target Token Mapping:
    • Multiple Choice Target: A (32), B (33), C (34), D (35)
    • Boolean Verification Target: TRUE (21260), FALSE (31451)

Training & Evaluation Results

Metrics Summary

Metric Epoch 1 Epoch 2 Epoch 3 Final Test Set
Train Loss 0.6461 0.4760 0.4150 —
Validation Loss 0.4700 0.4105 0.3962 —
Validation Accuracy 77.04% 81.49% 82.18% —
Test Accuracy — — — 77.90%
Test Brier Score — — — 0.2407

Dataset Mixture (Italian NLP Suite)

  1. Safety & Moderation: Paul/hatecheck-italian + evalitahf/hatespeech_detection
  2. Multi-Choice Reasoning: RiTA-nlp/ai2_arc_ita (ARC-Challenge + ARC-Easy)
  3. Sentiment Analysis: evalitahf/sentiment_analysis
  4. Natural Language Inference (NLI): evalitahf/textual_entailment
  5. Support Pertinence: evalitahf/faq
  6. Semantic Similarity: stsb_multi_mt (it)

Files in Repository

  • adapter/: LoRA adapters and tokenizer configurations.
  • archai-jev-zagreus-0.4b-q8.gguf: Quantized 8-bit full model (~465 MB) ready for llama.cpp and Rust integrations.
Downloads last month
470
GGUF
Model size
0.4B params
Architecture
llama
Hardware compatibility
Log In to add your hardware

We're not able to determine the quantization variants.

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for nickprock/archai-jev-zagreus-0.4b-ita

Adapter
(1)
this model

Datasets used to train nickprock/archai-jev-zagreus-0.4b-ita