Aplicație BrioLogic
Brio Argus
Vede tot în documentele tale și răspunde cu surse, în orice domeniu.
Brio Argus este un asistent AI conectat la documentele interne ale firmei. Pui întrebări în limbaj natural și primești răspunsuri construite din propriile tale documente, cu citări pe care le poți deschide și verifica. Caută după sens și după termeni exacți, citește tabele, scheme și pagini scanate, și organizează totul pe proiecte și domenii de lucru.
Numele vine de la Argus, paznicul cu o sută de ochi din mitologie. Aplicația a pornit din analiza proiectelor de cercetare-dezvoltare și s-a extins către juridic, GDPR și SEO. Rulează cu modele AI locale, pe serverul tău, sau cu furnizori cloud, acolo unde politica ta de date permite. Tu decizi ce documente nu părăsesc niciodată firma.
Pe scurt
- Răspunsuri din documentele tale, nu din cunoștințele generale ale modelului: fiecare afirmație are o citare numerotată care se deschide direct în fragmentul sursă.
- Caută după sens și după cuvinte exacte. Căutarea semantică găsește „clauza de reziliere” și când documentul spune „încetarea contractului”; căutarea lexicală găsește codul de produs sau numărul de articol exact.
- Citește și ce nu este text. Pagini scanate prin OCR, tabele extrase cu structura intactă, diagrame, scheme, organigrame și formulare interpretate cu modele vision.
- Un singur loc pentru chat, documente și proiecte. Conversațiile se păstrează pe server, legate de proiecte, cu un canvas Markdown alături pentru documentul pe care îl redactezi.
- Domenii de lucru, fiecare cu proiectele, prompturile și utilizatorii lui: R&D, juridic, GDPR, SEO sau orice definești tu.
- Modele locale sau cloud, la alegere. Ollama pe serverul tău pentru confidențialitate, OpenAI sau Anthropic pentru redactare, cu posibilitatea de a compara până la trei modele în paralel.
- Rezidența datelor, impusă de aplicație. Documentele marcate „doar on-premise” nu pot fi trimise către niciun furnizor cloud, oricine ar pune întrebarea.
- Robustă la lucrul real. Un refresh nu pierde răspunsul în curs, conversațiile lungi sunt comprimate automat în loc să blocheze modelul, iar administratorii văd încărcarea sistemului fără să vadă conținutul.
Pentru cine este
- Echipe R&D, inginerie și inovare. Documentație tehnică, rapoarte de proiect, standarde și fișe cu desene și tabele de valori. Argus răspunde din ele și arată de unde a luat fiecare cifră.
- Departamente juridice și cabinete de avocatură. Contracte, acte adiționale, hotărâri și proceduri interne, interogate în limbaj natural, cu un set de prompturi juridice preinstalat.
- Responsabili GDPR și conformitate. Politici, registre de prelucrare, contracte cu furnizorii și evaluări de impact, într-un spațiu în care documentele sensibile pot fi ținute exclusiv pe modele locale.
- Echipe SEO și marketing. Audituri, rapoarte, ghiduri de brand și conținut existent, folosite ca bază pentru analize și texte noi, cu prompturi specifice domeniului.
- Firme care vor AI fără să-și trimită datele în afară. Instalare integral on-premise, cu modele locale, fără acces la internet dacă este nevoie.
- Administratori IT și AI. O singură consolă pentru furnizori, instanțe, modele, prompturi, domenii, utilizatori și încărcarea infrastructurii.
Cum funcționează
Mecanismul se numește RAG, de la Retrieval Augmented Generation: generare asistată de documente. În loc să ceri unui model AI să răspundă din ce a învățat pe internet, îi dai mai întâi fragmentele relevante din documentele tale și îi ceri să răspundă doar pe baza lor.
- Încarci documentele în proiect, cu etichete și note. Accesul la ele rămâne limitat la tine și la membrii proiectului.
- Argus le indexează: extrage textul, face OCR unde pagina este scanată, interpretează tabelele și schemele, fragmentează conținutul semantic, fără să rupă tabelele, și salvează fragmentele într-un index de căutare.
- Pui o întrebare. Aplicația caută, doar printre documentele la care ai acces, fragmentele cele mai relevante, după sens și după termeni exacți, și le combină într-o listă ordonată.
- Modelul răspunde folosind acele fragmente, în streaming, cu citări numerotate. Dacă informația nu există în documente, spune asta explicit.
- Verifici și reutilizezi: deschizi sursa fiecărei citări, exporți răspunsul în Word sau continui lucrul în canvas.
Înainte de trimitere poți vedea exact ce primește modelul: istoricul conversației, prompturile globale, fragmentele din documente, canvas-ul și constrângerile active, cu distribuția tokenilor între ele. Nu există nimic ascuns în context.
Funcționalități în detaliu
Chat și conversații
Asistentul principal răspunde incremental, cu metrici vizibile pentru fiecare mesaj: model, instanță, timp până la primul cuvânt, viteză și tokeni consumați. Conversațiile sunt organizate în fire, salvate pe server și, opțional, legate de proiecte. Generarea rulează detașat de browser: dacă dai refresh sau navighezi în altă parte, răspunsul continuă și îl găsești complet la revenire. Un buton de stop oprește explicit generarea.
Fiecare conversație poate avea un prompt de sistem ales dintr-o bibliotecă filtrată pe domeniu, constrângeri suplimentare activabile individual și prompturi globale aplicate la nivelul întregii aplicații. Când istoricul se apropie de limita modelului, mesajele vechi sunt comprimate într-un sumar rulant, manual sau automat, iar ultimele schimburi rămân integral. Aplicația te avertizează înainte de orice trunchiere.
Canvas de lucru
Lângă fiecare conversație ai un document Markdown editabil, pe care îl poți construi împreună cu modelul: creare, rescriere, extindere, explicare, editare. Canvas-ul poate fi inclus în context, astfel încât întrebările următoare să țină cont de ce ai scris deja. Răspunsurile se exportă în DOCX, cu titluri, tabele, liste, cod și linkuri păstrate.
Documente și căutare
Un spațiu de fișiere cu încărcare multiplă, clasificare pe proiecte, etichete și note, afișare ca tabel sau carduri, filtrare, sortare, redenumire, previzualizare și descărcare. Indexarea pornește automat după încărcare sau manual, cu progres vizibil și posibilitate de anulare. Pentru PDF alegi modul de indexare: text, OCR sau interpretare cu model vision.
În chat decizi dacă folosești documentele sau nu, ce fișiere intră în calcul (selecția se păstrează per proiect), dacă vrei fragmentele cele mai relevante sau documentul integral și câte fragmente să fie recuperate. Autorizarea este strictă: fiecare utilizator vede în căutare doar documentele proprii sau ale proiectelor din care face parte.
Proiecte, domenii și colaborare
Proiectele au membri, invitați prin link cu valabilitate limitată, și adună documentele, conversațiile și canvas-ul unei lucrări. Ștergerea este reversibilă, cu restaurare. Lista de proiecte arată numărul de documente, numărul de conversații și ultima activitate.
Domeniile de lucru grupează proiectele și prompturile pe arii: R&D, juridic, GDPR, SEO sau ce definești tu. Utilizatorii văd doar proiectele și prompturile domeniilor alocate. Fiecare domeniu are un hub cu acțiuni rapide: un click pe un prompt al domeniului creează un proiect și o conversație preconfigurată. Domeniul juridic vine cu un set de prompturi preinstalat.
Notificări și profil
Centru de notificări în aplicație, cu clopoțel în bara de navigare, pentru evenimente precum acordarea accesului la un proiect, cererile de acces sau căderea și revenirea unei instanțe AI. Opțional, notificările ajung și pe e-mail, prin orice server SMTP, doar către utilizatorii cu adresa confirmată.
Tabele, scheme și pagini scanate
Multe asistente AI se opresc la textul selectabil. În documentația tehnică, juridică sau financiară, informația importantă stă adesea într-un tabel cu valori, într-o schemă sau pe o pagină scanată. Argus are un pipeline dedicat pentru acestea, cu index propriu, separat de căutarea clasică.
- Tratare uniformă a formatelor. Documentele Word, Excel, PowerPoint și imaginile sunt convertite în PDF și analizate cu aceeași detecție de regiuni ca PDF-urile native.
- Detecție automată de regiuni pe fiecare pagină: imagini, tabele, formulare, diagrame, scheme logice, organigrame, pagini scanate. Poți face doar un triaj rapid sau procesarea completă, oprită oricând.
- Interpretare cu modele vision, cu prompturi specifice fiecărui tip de regiune, păstrând în paralel textul OCR brut, pentru a limita halucinațiile.
- Verificare numerică încrucișată. Cifrele din descrierea generată de modelul vision sunt comparate cu cele citite de OCR și din stratul de text nativ. Divergențele sunt marcate vizibil în previzualizare, înainte de indexare.
- Tabele cu structura intactă, extrase nativ din PDF și Excel, fragmentate pe grupuri de rânduri cu antetul repetat, păstrate atât ca tabel, cât și ca rezumat narativ pentru regăsire mai bună.
- Fișa documentului: un rezumat generat automat la indexare, indexat separat, pentru regăsire la nivel de document, nu doar de fragment.
- Căutare hibridă: rezultatele semantice și cele lexicale sunt fuzionate, diversificate și, opțional, reordonate de un model, iar răspunsurile vin cu citări care se deschid direct în document.
- Previzualizare și revizii. Vezi regiunile detectate marcate color pe pagina randată, cu textul rezultat, înainte de indexare. Reanalizarea unui document păstrează istoricul și marchează indexul vechi până la reindexare.
Modele AI și infrastructură
Argus este multi-furnizor și separă modelele pe capabilități: chat, embeddings pentru căutare semantică și vision pentru imagini și pagini. Poți folosi, de exemplu, embeddings local pentru confidențialitate și un model cloud puternic pentru redactare, acolo unde rezidența datelor permite.
- Ollama, pentru modele locale sau private, cu instanțe multiple pe CPU sau GPU, opțiuni de rulare validate per instanță și fereastră de context dimensionată automat sau fixată de administrator.
- OpenAI pentru chat, embeddings și vision; Anthropic (Claude) pentru chat și vision; OneProvider, un gateway compatibil cu protocolul Anthropic; endpointuri OpenAI-compatibile, precum vLLM sau LM Studio.
- Selecție din interfață a furnizorului, instanței și modelului activ, persistată per utilizator. Modelele disponibile sunt încărcate dinamic de la fiecare furnizor.
- Administrare de modele: instalare, dezinstalare și descărcare din memorie, cu progres în streaming, catalog de modele publice cu preluare automată din biblioteca Ollama.
- Benchmark: aceeași întrebare, către până la trei perechi model/instanță în paralel, pentru a alege modelul potrivit fiecărei sarcini. Pentru modelele vision, răspunsurile pe aceeași imagine se pot captura și compara, cu export Markdown.
- Monitor de disponibilitate al instanțelor Ollama, cu notificare la cădere și la revenire, și pagină de status vizibilă tuturor utilizatorilor: instanțe, modele instalate și încărcate, memorie ocupată, instalări în curs.
Rezidența datelor și securitate
- Documente „doar on-premise”. Marchezi un document ca atare, iar întrebările care îl folosesc nu pot fi rutate către niciun furnizor cloud. Regula este impusă de aplicație, nu lăsată la latitudinea utilizatorului.
- Autorizare strictă pe documente. Căutarea nu returnează niciodată fragmente din documente la care utilizatorul nu are acces.
- Roluri și domenii. Administratori și utilizatori obișnuiți, alocare pe domenii, drepturi pe proiecte gestionate de administrator, conturi active sau inactive.
- Monitorizare fără conținut. Administratorii văd sesiunile active, încărcarea aplicației și a fiecărei instanțe, dar nu mesajele. Istoricul sesiunilor păstrează doar metadate de resurse, cu retenție configurabilă.
- Sesiuni sigure: jetoane de acces de scurtă durată cu reîmprospătare prin rotație, parole criptate, schimbarea parolei invalidează toate sesiunile.
- Protecții la nivel de API: verificarea originii cererilor, limitarea încercărilor la autentificare și la generare, apeluri permise doar către instanțele înregistrate, chei API mascate în răspunsurile de configurare.
- Separare între indexuri: căutarea clasică și pipeline-ul pentru tabele și scheme au depozite separate, iar colecțiile și vectorii orfani se administrează din interfață.
Unde rulează
Pe serverele tale
Argus se livrează prin Docker Compose, cu servicii separate pentru interfață și backend, și poate rula integral on-premise, inclusiv fără acces la internet, cu modele locale prin Ollama. Documentele, indexul și baza de date rămân în infrastructura ta. Este varianta potrivită pentru departamente juridice, responsabili GDPR și firme cu documentație sensibilă.
Găzduit de BrioLogic
Îți configurăm instanța, domeniile și conturile, iar tu începi să lucrezi din browser. Noi administrăm serverele, actualizările și copiile de siguranță. Și aici poți combina modele locale, pe infrastructura administrată de noi, cu furnizori cloud, și poți marca documentele care nu trebuie să ajungă la ei.
Tehnologii
| Interfață | Aplicație web React, responsive, cu temă deschisă și întunecată; răspunsuri în streaming |
|---|---|
| Backend | API REST și streaming în Python (FastAPI), cu joburi de fundal pentru monitorizare și notificări |
| Bază de date | Microsoft SQL Server, pentru utilizatori, proiecte, domenii, conversații, prompturi și setări |
| Index de căutare | ChromaDB pentru căutare semantică, BM25 pentru căutare lexicală, cu tokenizare adaptată limbii române |
| Modele AI | Ollama (local), OpenAI, Anthropic, OneProvider, endpointuri OpenAI-compatibile |
| Documente | PDF, Word, Excel, PowerPoint, text și imagini; OCR Tesseract în română și engleză; conversie Office prin LibreOffice |
| Livrare | Docker Compose, cu script de instalare; teste automate pentru backend și interfață |
Ce nu face
- Nu antrenează modele pe datele tale. Documentele sunt indexate pentru căutare și oferite modelului ca context la fiecare întrebare; modelul în sine nu este modificat.
- Nu înlocuiește verificarea umană. Citările și verificarea numerică reduc mult riscul de erori, dar răspunsurile rămân propuneri de analizat, mai ales în juridic și GDPR.
- Nu editează documentele originale. Argus citește și indexează; pentru conversie, semnare sau protejare folosești Brio DocForge.
- Nu garantează confidențialitatea la furnizorii cloud pe care îi activezi tu. Pentru documentele sensibile, marchează-le „doar on-premise” sau rulează integral cu modele locale.
Întrebări frecvente
Documentele mele ajung la OpenAI sau la Anthropic?
Doar dacă alegi tu asta. Brio Argus poate rula integral cu modele locale prin Ollama, pe serverul tău, fără ca vreun document să părăsească firma. Dacă activezi și un furnizor cloud, documentele marcate „doar on-premise” rămân protejate: întrebările care le folosesc nu pot fi trimise decât către modele locale.
De unde știu că răspunsul nu este inventat?
Fiecare răspuns ancorat în documente vine cu citări numerotate, pe care le deschizi direct în fragmentul sursă. Modelul este instruit să spună explicit când nu găsește informația în documente. Pentru tabele și formulare, cifrele interpretate de modelul vision sunt comparate cu cele citite prin OCR și din textul nativ, iar divergențele sunt semnalate vizibil.
Ce tipuri de documente înțelege?
Fișiere text, PDF, Word, Excel, PowerPoint și imagini. Paginile scanate trec prin OCR în română și engleză. Tabelele, diagramele, schemele, organigramele și formularele sunt detectate ca regiuni și interpretate cu modele vision, nu ignorate.
Este doar pentru echipe de cercetare-dezvoltare?
Nu. Argus a pornit din analiza proiectelor R&D, dar lucrează pe domenii de lucru configurabile, fiecare cu proiectele, prompturile și utilizatorii lui: juridic, GDPR și conformitate, SEO și marketing, inginerie, consultanță. Domeniul juridic vine cu un set de prompturi preinstalat.
Ce se întâmplă dacă dau refresh în timp ce aplicația răspunde?
Nimic rău. Generarea rulează pe server, detașat de browser. Când revii, conversația se reatașează și recuperează tot ce s-a generat între timp. Poți opri explicit un răspuns în curs.
Administratorul vede conversațiile utilizatorilor?
Nu. Dashboardul de monitorizare arată sesiunile active, încărcarea aplicației și a instanțelor AI, modelul folosit, durate și tokeni, dar nu conținutul mesajelor. Istoricul sesiunilor păstrează doar metadate de resurse, cu retenție configurabilă.
De ce am nevoie ca să o instalez la mine?
Un server Linux cu Docker, o instanță Microsoft SQL Server și, pentru modele locale, una sau mai multe mașini cu Ollama, ideal cu GPU. Aplicația se livrează prin Docker Compose și poate rula fără acces la internet. Dacă nu vrei să administrezi infrastructura, o găzduim noi.
Funcționează pe telefon sau tabletă?
Da. Interfața este responsive, listele de fișiere se afișează ca tabel sau carduri, iar afișarea răspunsurilor în streaming este optimizată pentru dispozitive mai lente.
Vrei să vezi Argus pe documentele tale?
Contactează-ne pentru o demonstrație pe documente reale din activitatea ta sau pentru o instalare pilot, cu modele locale sau cloud, după politica ta de date.