Agente ia minimale a risparmio

di muflonebarbuto il
1 risposte

Ciao a tutti. Non posso definirmi un programmatore, anche se qualche lavoro l'ho fatto. Mi piace far lavorare Claude per fare script.

Un po' per divertirmi ho provato a scrivere una GUI che funge da, o forse è meglio dire personalizza, l'agente Pi Agent.

Giusto per applicarla a un caso di lavoro reale avevo alcuni obiettivi:

  1. Sprecare pochissimi token ed essere ottimizzata al massimo.
  2. Utilizzare esclusivamente risorse gratuite, tipo modelli di OpenRoute o modelli locali; quindi è importante avere una catena di servizi che lavorano in modo sequenziale, man mano che si esauriscono i crediti gratuiti, senza perdere il lavoro fatto. Quindi giro le risorse gratuite man mano che si esauriscono.

Poi due funzioni aggiunte per gioco: anonimizzazione dei file di input con IA locale (quella di Rizo) e compressione dati per ridurre lo spreco di token.

Prima era uno script; ora, per far lavorare meglio Claude gratuito (vero artefice), l'ho diviso in due parti: una di installazione pacchetti/GUI, e uno script che scansiona la cartella di lavoro per passare i dati alla IA (per risparmiare token, escludibile).

Visto che l'obiettivo è risparmiare token, ho messo delle checkbox per limitare il lavoro a quello che si deve fare: devo elaborare docx? tolgo browser, Excel, ecc.

Difetti noti

L'ho fatto per farlo girare su Manjaro KDE; deduco possa funzionare anche nelle altre versioni di Linux.

Alla fine, a forza di aggiungere, è venuto fuori un albero di Natale: direi poco intuitivo.

Nonostante questo, sono riuscito a svolgere un prompt di test in locale, senza accelerazione GPU, 32 giga di RAM, CPU moderna. Prompt:

"Segui questi passi in ordine senza chiedere conferma:

  1. Leggi riga 2 di test-pi.csv (colonne: first_name, last_name, email, mobile)
  2. Apri https://demoqa.com/automation-practice-form e in un'unica sequenza:
    • compila firstName, lastName, userEmail, userNumber coi valori letti
    • clicca il radio button 'Other' nel campo Gender
    • salva screenshot in /home/geko/pi-workspace/screenshot_tmp.png (file temporaneo)
  3. Usando python-docx, crea il documento /home/geko/pi-workspace/test.docx con, in quest'ordine:
    • un titolo in grande: "Questo è il titolo"
    • una seconda riga più piccola sotto: "Questa è una prova"
    • sotto queste due righe, inserisci l'immagine /home/geko/pi-workspace/screenshot_tmp.png

Esegui tutto in sequenza, non aspettare conferme."

Lo ha fatto in poco più di 3 minuti. Questo per dire che ottimizza i token. Con ZeroClaw, per dire, in locale non sono riuscito a ottenere nulla.

Altro esperimento: ho portato un lavoro che mi doveva sistemare dei preventivi, che usavo in Antigravity, su questa GUI. Non ci speravo, ma è riuscita nell'impresa. La IA usata in questo caso è Laguna di OpenRoute.

In pratica ci sto giocando, e non escludo di poterla inserire nel mio lavoro.

Spero sia chiaro che lo vedo come un gioco, quindi tutto l'aspetto riguardante la sicurezza non è stato considerato: ha fatto tutto Claude.

Se qualcuno è interessato lo condivido, ma in questo caso più che in altri ribadisco che non è un prodotto con test di sicurezza, nessuna responsabilità da parte mia: allo stato attuale è una versione sperimentale. È uno script, il codice è leggibile, quindi è anche facile incollarlo in Claude o altra IA per chiedere se è sicuro o meno. Lo condividerei su GitLab, quindi sarebbe analizzabile da tutti.

Penso che rimarrà una sorta di esperimento, perché da quel che ho capito il mondo che lavora con la IA non ha problemi ad aprire il portafoglio.

1 Risposte

  • Ci ho pensato un attimo, forse la cosa migliore e mettere online i 3 files. i files si mettono insieme e si esegue  pi-installer.sh. 

    Per chi se ne intende, se mi dite che ci sono problemi tolgo i file.

    Pe ci vuole provare, suggerisco di scaricare i 3 file, copiarli in una sessione gratuita di claude, chiedere cosa fanno un'analisi giusto per capire a cosa servono, se sono sicuri  ed eventualmente ci si fa aiutare nell'uso pratico. Inoltre se manca la funzionalità che interessa basta chiedere che venga aggiunta.

    Fare andare qusto script su windows non è banale, bisogna fare un porting vero e prorio, pero visto che e un software abbastanza limitato penso che claude possa farlo. chiaramente si devono cambiare gli strumenti per operare nel nuovo SO. su arc per convertire in PDF ho dovuto installare libreoffice, ma credo che per ubuntu e altre distro ci sia una piccola parte di libreoffice da installare. bisogna farsi modificare il codice da claude per adattarlo alla propria versione linux, quello di  installazione e la gui.

    https://gitlab.com/Muflonebarbuto/gui-pi-agent/-/blob/main/pi-gui.py?ref_type=heads

    https://gitlab.com/Muflonebarbuto/gui-pi-agent/-/blob/main/pi-installer.sh?ref_type=heads

    https://gitlab.com/Muflonebarbuto/gui-pi-agent/-/blob/main/ricognizione.py?ref_type=heads

    Tolto il problema ora l'installazione dovrebbe andare liscia, prima faceva un test di scrittura e se non era presente il modello locale ia non faceva il test e non finiva l'intallazione. visto che ho voluto provare bonsai ternario e glimmer con relativo modulo vision, ho inserito la possibilita di scegliere il  modulo visione. Ho fatto dei test con e senza modulo visione. Non funziona. Non ho provato con modalità di ragionamento attiva. mentre con il solito Qwen3.6-35B-A3B-UD-Q4_K_M.gguf funziona perfettamete (4,5 minuti). Chiaramente testo modelli perche mi diverto non ho gpu e quindi non ha nessuna utilità per eseguire lavori con la mia configurazione. In realta non e proprio del tutto vero, ho uno script ottimizzato per usare un modello locale per verificare che una riga tradotta in italiano sia corretta rispetto l'originale in inglese. righe corte ci mette 30 secondi per elaborare 10 righe qualcosa fa e l'ho inserito nel lavoro che sto eseguendo. inoltre  ho testato moduli leggeri specializzati in traduzione in italiano e funzionano molto bene in relazione all'hardware che li fa girare, la  velocità è piu che accettabile.

    Inserito edit come servizio internet Nvidia, non ho ben capito come gestisce limiti e crediti. Difetto: bisogna dargli il numero di cellulare. Inserita funzione per testare i modelli per determinati lavori, aggiunto quindi il file test_modelli.py. Aggiunto file di test per alcuni modelli online (test_modelli.csv), il giudice è Claude che ha analizzato i file risultanti. Il prompt era, compreso di errori ortografici e testo poco chiaro: "modifica il file dati_inventati.xlsx mi crei un anuova colonna dove scrivi si se l'eta e maggiore di 40 no se minore uguale. 40 pero e u nvalore che posso inserire io nel foglio e la tabella deve aggiornarsi da sola
    "  I modelli vincenti sono anche quelli che hanno portato a termine il lavoro anche a qualità bassa:

    • deepseek-ai/deepseek-v4-flash-0731
    • nvidia/nemotron-3-super-120b-a12b
    • nvidia/nemotron-3.5-lightning-30b-a3b
    • stepfun-ai/step-3.7-flash

    Certi modelli che hanno superato i 10 minuti per fare il lavoro non possono essere valutati;poolside laguna, infatti ho verificato che funziona, ma nel test ha superato i 10 minuti.

Devi accedere o registrarti per scrivere nel forum
1 risposte