Case Log · CHARLIE
arXiv 2607.05428RELAF 2026
Research Briefing · Μη ταξινομημένο

CHARLIE
σκέφτεται σαν ντετέκτιβ.

Ένα εξειδικευμένο σύστημα AI που λειτουργεί αποκλειστικά τοπικά. Σχεδιάστηκε για να συνδέει αποδεικτικά στοιχεία σε ψηφιακές forensic έρευνες — χωρίς cloud, χωρίς διαρροές και χωρίς να σπάει η αλυσίδα ευθύνης. Μετατρέπει αδόμητα έγγραφα σε δομημένη, ιχνηλατήσιμη νοημοσύνη.

Πηγή
arXiv:2607.05428
Συνέδριο
RELAF 2026 (ICAIL)
Χρονος αναγνωσης
25 λεπτα
Ημ.αρθρου
4-8-2026
A
Exhibit AΤο θεσμικό αδιέξοδο

Η δικαιοσύνη δεν μπορεί απλώς να «στείλει δεδομένα στο cloud».

Κάθε σοβαρή ποινική ή ψηφιακή έρευνα παράγει τεράστιους όγκους αδόμητων δεδομένων — καταθέσεις, τηλεφωνικά logs, φωτογραφίες, μηνύματα και οικονομικές αναφορές. Ένα σύγχρονο LLM θα μπορούσε να τα αναλύσει σε ελάχιστα λεπτά. Όμως η χρήση δημόσιων cloud APIs είναι απαγορευτική.

Στη δικανική επιστήμη (digital forensics), η έννοια της Αλυσίδας Επιτήρησης (Chain of Custody) είναι νομικά απαράβατη. Αν ένα αποδεικτικό στοιχείο περάσει από εξωτερικό διακομιστή τρίτου, η νομική του ισχύς ακυρώνεται ακαριαία στο δικαστήριο. Παράλληλα, τα ευαίσθητα προσωπικά δεδομένα απαιτούν πλήρη κυριαρχία (Data Sovereignty). Το πρόβλημα δεν είναι τεχνικό αλλά θεσμικό: οι αναλυτές αντιμετωπίζουν ασύμμετρη σχέση μεταξύ όγκου δεδομένων και πεπερασμένης γνωστικής ικανότητας του ανθρώπου.

Τα LLMs είναι πιθανοτικά συστήματα που μπορεί να παράγουν hallucinations υπό ελλιπές πλαίσιο. Επιπλέον, οι περιορισμοί του context window εμποδίζουν τη multi-document ανάλυση, ενώ η χρήση cloud-based inference εγείρει ζητήματα εθνικής κυριαρχίας δεδομένων. Η πρόκληση, λοιπόν, είναι να κλιμακώσουμε την ενδελεχή επεξεργασία διατηρώντας την ακεραιότητα της διαδικασίας.

// Cloud AI (Commercial APIs)

  • Τα στοιχεία ταξιδεύουν σε εξωτερικούς servers
  • Παραβιάζεται ακαριαία η αλυσίδα επιτήρησης
  • Κίνδυνος διαρροής ευαίσθητων δικογραφιών
  • Αδύνατος ο ανεξάρτητος δικαστικός έλεγχος
  • Opaque reasoning — καμία ιχνηλασιμότητα

// On-Premise Multi-Agent CHARLIE

  • 100% τοπική εκτέλεση εντός του φορέα
  • Αυστηρή διατήρηση της αλυσίδας επιτήρησης
  • Πλήρης απομόνωση (Air-gapped readiness)
  • Απόλυτη ιχνηλασιμότητα κάθε συλλογισμού
  • Ανοιχτός κώδικας — χωρίς vendor lock-in
B
Exhibit BΟι 5 Αρχές Σχεδίασης

Νομικές υποχρεώσεις που έγιναν αρχιτεκτονικοί κανόνες.

Το CHARLIE δεν σχεδιάστηκε ως γενικού σκοπού chatbot. Σχεδιάστηκε ως governance-aligned σύστημα επεξεργασίας αποδεικτικών στοιχείων, όπου η τεχνική αρχιτεκτονική υποτάσσεται στη διαδικαστική νομιμότητα.

ΑΡΧΗ 01

Data Sovereignty (Κυριαρχία Δεδομένων)

Όλα τα έγγραφα, embeddings και ενδιάμεσα outputs παραμένουν εντός του θεσμικού υποδομικού συνόλου. Καμία μεταφορά δεδομένων σε εξωτερικές υπηρεσίες. Η κυριαρχία αντιμετωπίζεται ως αρχιτεκτονικός περιορισμός, όχι ως επιλογή υλοποίησης.

ΑΡΧΗ 02

Open-Source Autonomy

Χρήση αποκλειστικά open-source και open-weight τεχνολογιών (Qwen3:32B, vLLM, LangGraph, Nomic-embed-text, Ollama). Αποφυγή vendor lock-in, διασφάλιση διαφάνειας και μακροπρόθεσμης βιωσιμότητας.

ΑΡΧΗ 03

Evidential Transparency

Καταγραφή κάθε βήματος: classification, task decomposition, retrieval results, intermediate outputs, synthesis. Τα παραγόμενα outputs διατηρούν ρητή σύνδεση με τα πρωτογενή έγγραφα (explicit provenance linkage).

ΑΡΧΗ 04

Structured Multi-Document Reasoning

Αποσύνθεση πολύπλοκων εντολών σε ατομικά υπο-ερωτήματα. Εκτέλεση σε παράλληλα pipelines, αποθήκευση σε structured memory (tables/key-value), σύνθεση τελικού αποτελέσματος. Ξεπερνά τους περιορισμούς του context window.

ΑΡΧΗ 05

Scalability & Modularity

Υποστήριξη παράλληλης εκτέλεσης και optimized inference. Δυνατότητα προσθήκης νέων modules (π.χ. Bayesian inference, argumentation frameworks) χωρίς ανασχεδιασμό του πυρήνα.

C
Exhibit CΑπό το απλό RAG στους Agents

Η εξέλιξη από παθητικό RAG σε ενεργό evidential workflow engine.

Το κλασικό RAG αποτυγχάνει σε σύνθετες δικογραφίες επειδή απλώς «ανασύρει κείμενα». Το CHARLIE εισάγει ένα agent-based orchestration layer που μετατρέπει το σύστημα σε ενεργή μηχανή δικανικών workflows.

Τα εισερχόμενα ερωτήματα ταξινομούνται πρώτα σε κατηγορίες εργασιών: direct query, structured extraction, aggregation, complex analysis. Αυτό καθορίζει τη στρατηγική εκτέλεσης. Για ένα corpus N εγγράφων και M target attributes, το σύστημα παράγει N × M υπο-ερωτήματα, επιτρέποντας κλιμακούμενη και συστηματική εξαγωγή πληροφοριών σε όλες τις πηγές.

Κάθε υπο-ερώτημα εκτελείται ανεξάρτητα μέσω του RAG pipeline, ενεργοποιώντας παράλληλη επεξεργασία και αποφεύγοντας τους περιορισμούς του context window. Τα ανακτηθέντα δεδομένα αποθηκεύονται σε structured memory (πίνακες ή key-value mappings) με ρητούς συνδέσμους προελεύσεως (provenance links). Το τελικό στάδιο σύνθεσης συγκεντρώνει τη structured memory σε συνεκτικά outputs: tables, JSON objects, ή grounded summaries.

Local LLM
Qwen3:32B (Open-Weight)
Inference Engine
vLLM Engine (PagedAttention)
Agent Framework
LangGraph Orchestration
Embedding Model
nomic-embed-text (Ollama)
Reranker
cross-encoder/ms-marco-MiniLM-L-6-v2
Vector Store
Local Vector Database
Hardware
4× NVIDIA A40 GPUs (Tensor Parallelism)
Max Context
131K tokens
D
Exhibit DΗ Πενταμερής Αρχιτεκτονική Agent

Brain, Perception, Action, Memory, Self-Reflection.

Η αρχιτεκτονικότητα του CHARLIE βασίζεται στο perception–reasoning–action paradigm, προσαρμοσμένο σε ελεγχόμενο δικανικό περιβάλλον. Αντί για αυτόνομο decision-maker, λειτουργεί ως δομημένο reasoning component εντός governed workflow.

01 / Brain

Το Qwen3:32B σε δύο modes: (i) reasoning mode για πολύπλοκες multi-step εργασίες και (ii) fast mode για απλά grounded queries. Όλοι οι συλλογισμοί περιορίζονται σε retrieved documents. Καμία πρόσβαση σε εξωτερικούς πόρους.

02 / Perception

Ελεγχόμενη πρόσβαση σε αποδεικτικά δεδομένα μέσω vector-based retrieval, chunk indexing, metadata association και structured memory querying. Κάθε retrieval operation καταγράφεται για ιχνηλασιμότητα.

03 / Action

Το σύνολο ενεργειών είναι περιορισμένο και προκαθορισμένο: subquery generation, retrieval, parallel execution, structured output construction, memory updates. Αυτό εξασφαλίζει πλήρη αναπαραγωγιμότητα και compliance.

04 / Memory

Short-term working memory και structured persistent memory. Τα εξαγόμενα attributes αποθηκεύονται σε tabular ή key-value formats διατηρώντας ρητούς δεσμούς με τα πηγαία έγγραφα. Υποστηρίζει accumulation across documents.

05 / Self-Reflection

Validation layer που ελέγχει completeness, consistency, structural inconsistencies, ambiguous outputs και hallcination signals. Αν εντοπιστούν προβλήματα, ο pipeline μπορεί να επανεκτελεστεί. Μειώνει τα silent failures.

E
Exhibit EΗ Τεχνική Υλοποίηση

Τα «παρασκήνια» της ροής δεδομένων.

Κάθε έγγραφο τεμαχίζεται σε chunks ~1.000 tokens με overlap 100 tokens, ισορροπώντας semantic coherence και retrieval precision. Τα embeddings παράγονται τοπικά μέσω Ollama και αποθηκεύονται σε local vector DB.

Two-Stage Retrieval Pipeline

Η ανάκτηση ακολουθεί διφασική διελκυστίνδα για μεγιστοποίηση ακρίβειας χωρίς θυσία στην κάλυψη:

Stage 1: Dense Retrieval — cosine similarity, top-k=100 Stage 2: Cross-Encoder Reranking — ms-marco-MiniLM-L-6-v2, top-k=25

Τα prompts προσαρμόζονται ανά στάδιο workflow, επιβάλλοντας structured outputs (JSON, key-value pairs, explicit nulls). Το orchestration υλοποιείται σε LangGraph ως directed execution graph με nodes: classification → planning → decomposition → execution → memory update → validation → synthesis. Οι μεταβάσεις είναι deterministic και auditable.

Απόδειξη Εξαγωγής: JSON Schema

Κάθε subquery επιστρέφει αυστηρά δομημένα objects για downstream aggregation:

{ "incident_id": "2024-FT-0912", "location": { "lat": -15.79, "lon": -47.88 }, "collision_type": " Rear-end collision", "vehicles": ["motorcycle", "passenger_car"], "injury_severity": "fatal", "source_doc": "report_2024_0912.pdf", "confidence": "high" }
F
Exhibit FΕπιχειρησιακή Αξιολόγηση

Από τη θεωρία στα πραγματικά εγκληματολογικά εργαστήρια.

Το CHARLIE αξιολογήθηκε μέσω επιχειρησιακών case studies στο Forensic Institute της Βραζιλίας, όχι μέσω τυποποιημένων benchmarks. Η εστίαση ήταν σε structured multi-document extraction, scalability και longitudinal intelligence generation.

CASE STUDY I / TRAFFIC INTELLIGENCE

Ανάλυση Τροχαίων Ατυχημάτων

Corpus ~2.000 forensic reports ετησίως. Το σύστημα αποσυντέθηκε σε document-level subqueries, εκτέλεσε retrieval-grounded εξαγωγή και aggregated τα αποτελέσματα σε consolidated dataset. Το αποτέλεσμα: εντοπισμός clusters ατυχημάτων, οπτικοποίηση high-risk segments και temporal analysis. Υποστήριξη 4 συνεχών ετών ετήσιας αναφοράς.

CASE STUDY II / FEMICIDE PATTERNS

Ανάλυση Μοτίβων σε Σοβαρές Εγκληματικές Υποθέσεις

Forensic reports από femicide investigations. Εξαγωγή σημασιολογικών μοτίβων σε 5 διαστάσεις: instruments, modus operandi, victim profiles, offender profiles, substance involvement. Εντοπίστηκαν επαναλαμβανόμενα μοτίβα (dominant instrument categories, behavioral dynamics, victim-offender relationships). Όλα τα outputs διατήρησαν traceability στα πηγαία έγγραφα.

01 — Task Classification

Το εισερχόμενο ερώτημα κατηγοριοποιείται (direct / structured / aggregation / complex analysis) για να καθοριστεί η ροή εκτέλεσης.

02 — Decomposition

Η ερώτηση διασπάται σε N × M atomic subqueries. Για παράδειγμα, 2.000 έγγραφα × 8 attributes = 16.000 αυτόνομες κλήσεις RAG.

03 — Parallel Execution

Κάθε υπο-ερώτημα εκτελείται παράλληλα μέσω vLLM με tensor parallelism στα 4× A40 GPUs, εκμηδενίζοντας τον χρόνο αναμονής.

04 — Structured Memory

Τα αποτελέσματα αποθηκεύονται σε structured memory με explicit provenance links, αποφεύγοντας cross-document contamination.

05 — Verification

Η Self-Reflection layer ελέγχει completeness, consistency και ανιχνεύει πιθανά hallcucinations μέσω explicit null reporting.

06 — Final Synthesis

Η σύνθεση παράγει tables, JSON objects ή grounded summaries, ενώ διατηρεί πάντα τη διάκριση μεταξύ primary evidence και analytical artifact.

G
Exhibit GΝομικές & Ηθικές Διαστάσεις

Ο AI δεν αντικαθιστά τον ειδικό — υποστηρίζει την έρευνα.

Η εισαγωγή AI στη δικαιοσύνη εγείρει θεμελιώδη προβλήματα. Το CHARLIE σχεδιάστηκε κάτω από την αρχή ότι τα AI systems σε δικανικά πλαίσια πρέπει να παραμένουν υποτελή στη νομική δοξασία και την ανθρώπινη εμπειρογνωμοσύνη.

CUSTODY

Chain-of-Custody & Evidential Integrity

Το CHARLIE δεν τροποποιεί τα πρωτογενή έγγραφα. Λειτουργεί ως analytical layer που παράγει derived outputs (tables, summaries) διατηρώντας ρητές αναφορές στις πηγές. Όλα τα retrieval steps, subqueries και intermediate outputs καταγράφονται. Τα outputs δεν είναι αυταπόδεικτα (evidentiary artifacts) αλλά analytical aids.

PRIVACY

Data Protection & Confidentiality

Πλήρης on-premise εκτέλεση. Καμία μετάδοση δεδομένων σε cloud. Ακόμα και τα intermediate embeddings παράγονται και παραμένουν τοπικά. Το σύστημα διατηρεί ευθυγράμμιση μεταξύ τεχνικών ορίων επεξεργασίας και θεσμικής δικαιοδοσίας.

OVERSIGHT

Human-in-the-Loop Oversight

Το σύστημα εκτελεί structured extraction και consolidation, όχι συμπεράσματα ενοχής, υπαιτιότητας ή νομικής ευθύνης. Δεν παράγει binding determinations. Οι human analysts ελέγχουν όλα τα outputs πριν την ενσωμάτωσή τους σε επίσημα workflows.

TRUST

Transparency & Explainability

Ενώ η πλήρης interpretability των LLMs παραμένει άλυτη, το CHARLIE εξασφαλίζει procedural transparency: logging retrieval decisions, καταγραφή subquery generation, preservation of structured intermediate outputs και explicit linkage μεταξύ extracted values και source fragments.

RISK

Hallucination Mitigation

Πολυεπίπεδη άμυνα: (1) retrieval-grounded generation περιορίζει outputs σε semantically retrieved fragments, (2) structured decomposition μειώνει ambiguity, (3) explicit null reporting αποτρέπει silent fabrication, (4) human verification διασφαλίζει τελικό έλεγχο.

H
Exhibit HΠεριορισμοί & Μελλοντικές Κατευθύνσεις

Τι δεν κάνει ακόμα — και πού πηγαίνει.

Το CHARLIE εστιάζει σε evidential preparation και structured extraction. Δεν ενσωματώνει ακόμη formal evidential reasoning όπως Bayesian networks ή argumentation frameworks. Το evaluation βασίζεται σε operational case studies, όχι σε controlled benchmarks.

LIMITATIONS I / TECHNICAL

Περιορισμοί Ανάκτησης & Πιθανότητας

Η ποιότητα της εξαγωγής εξαρτάται άμεσα από την ποιότητα του retrieval. Απόντα ή κακά ranked fragments οδηγούν σε incomplete/null extractions. Τα chunks μπορεί να κατακερματίσουν semantically dependent πληροφορίες, ενώ similarity-based retrieval μπορεί να επιστρέψει contextually irrelevant passages. Επιπλέον, το on-premise μοντέλο απαιτεί σημαντικούς υπολογιστικούς πόρους (4× A40 GPUs).

LIMITATIONS II / METHODOLOGICAL

Απουσία Formal Reasoning

Προς το παρόν το σύστημα δεν ενσωματώνει Bayesian inference, probabilistic hypothesis evaluation ή structured argumentation. Τα outputs του είναι inputs για downstream τυπικά μοντέλα — δεν αποτελούν τυπικά μοντέλα από μόνα τους.

// FUTURE 01

Integration with Formal Models

Ενσωμάτωση Bayesian networks για probabilistic inference πάνω σε extracted attributes. Χρήση argumentation frameworks για αυτόματη κατασκευή argument graphs και εντοπισμό evidential conflicts.

// FUTURE 02

Retrieval Robustness

Βελτιστοποίηση chunk size/overlap, υβριδικές ανάκτησης (dense + sparse), multi-hop retrieval για κατακερματισμένες πληροφορίες σε μεγάλες δικογραφίες.

// FUTURE 03

Governance-by-Design

Αυτοματοποιημένη τεκμηρίωση, risk assessment modules, automated model auditing και compliance με εξελισσόμενα νομικά πλαίσια για AI (π.χ. EU AI Act).

I
Exhibit IΕφαρμογές & Οικοσύστημα

Από τα εγκληματολογικά εργαστήρια στις κρίσιμες υποδομές.

Η ανάγκη για ασφαλές, On-Premise Multi-Agent AI επεκτείνεται πολύ πέρα από τα εγκληματολογικά εργαστήρια. Οποιοσδήποτε τομέας διαχειρίζεται ευαίσθητα δεδομένα υψηλής νομικής αξίας μπορεί να επωφεληθεί από αυτό το blueprint.

// HEALTHCARE

Ιατρικοί Φάκελοι & Έρευνα

Ανάλυση ιστορικού ασθενών εντός του νοσοκομείου για διάγνωση σπάνιων παθήσεων, με πλήρη συμμόρφωση GDPR & HIPAA.

// FINANCE

Καταπολέμηση Απάτης (AML)

Εντοπισμός ξεπλύματος χρήματος σε τραπεζικά ιδρύματα χωρίς έκθεση ευαίσθητων χρηματοοικονομικών δεδομένων σε cloud AI.

// ENTERPRISE R&D

Προστασία IP & Πατεντών

Ανάλυση ευαίσθητων πατεντών και πηγαίου κώδικα χωρίς κίνδυνο διαρροής σε δημόσια μοντέλα εκπαίδευσης AI.

// DEFENSE

Στρατιωτική Νοημοσύνη

Ανάλυση πληροφοριών υψηλής ταξινόμησης σε air-gapped περιβάλλοντα όπου η εξωτερική σύνδεση είναι απαγορευτική.

// LEGAL ENTERPRISE

Corporate Litigation

e-Discovery και due diligence σε συγχωνεύσεις εταιρειών, όπου η διαρροή ενός email μπορεί να κοστίσει δισεκατομμύρια.

// JOURNALISM

Investigative Reporting

Ανάλυση leaks και εγγράφων από πηγές προστασίας του whistleblower, διασφαλίζοντας ότι κανένα metadata δεν διαρρέει.

J
Exhibit JΔεοντολογία & Διάλογος

Τα μεγάλα ερωτήματα της επόμενης μέρας.

Η τεχνολογία απέδειξε ότι μπορεί να λειτουργήσει τοπικά και με ασφάλεια. Όμως, η εισαγωγή της τεχνητής νοημοσύνης στη δικαιοσύνη γεννά κρίσιμα προκλήματα που δεν λύνονται με καλύτερα μοντέλα.

?

Πώς αξιολογείται ο «συλλογισμός» ενός AI στο δικαστήριο; Ακόμα κι αν υπάρχει ιχνηλασιμότητα, είναι έτοιμοι οι δικαστές και οι δικηγόροι να αξιολογήσουν την αλγοριθμική λογική των AI agents;

?

Πού τελειώνει η υποστήριξη και πού αρχίζει η εξάρτηση; Υπάρχει ο κίνδυνος οι ερευνητές να επαναπαυθούν στις αναλύσεις του CHARLIE, παραλείποντας τον δικό τους ενδελεχή έλεγχο;

?

Τι γίνεται όταν δύο AI agents διαφωνούν; Αν το Self-Reflection εντοπίσει διχογνωμία μεταξύ subqueries, ποιος έχει τον τελικό λόγο σε ένα δικαστικό πλαίσιο;

?

Μπορεί η procedural transparency να αντικαταστήσει την model interpretability; Όσο και αν ξέρουμε τι έκανε το pipeline, παραμένουμε αδυναμείς να ερμηνεύσουμε το πώς ένα LLM «σκέφτηκε» κάθε token.

Η γνώμη σας μετράει

Θα εμπιστευόσασταν μια δικαστική απόφαση ή μια σοβαρή ιατρική διάγνωση που βασίστηκε στην ανάλυση μιας ομάδας AI agents;

Tweet Share Share ΑΡΧΙΚΗ