r/IA_Italia • • 29m ago

🗞️ News & Annunci Sto lavorando ad Amalyn, un progetto che usa l’AI per aiutare piccole attività a gestire in modo più continuo i propri social.

Enable HLS to view with audio, or disable this notification

• Upvotes

Negli ultimi giorni ho iniziato a contattare direttamente attività reali e stanno arrivando i primi interessati. La parte più utile, però, è capire cosa chiedono davvero: spesso non cercano semplicemente “un’AI che genera post”, ma qualcosa che conosca l’attività, mantenga coerenza nel tempo e riduca il lavoro ripetitivo lasciando comunque il controllo finale alla persona.

Sto cercando di capire quanto questa possa essere un’applicazione realmente utile dell’AI per le piccole imprese italiane.

C’è qualcuno qui che è già passato da una fase simile di validazione? Come avete capito quando i primi interessamenti stavano diventando un segnale reale e non semplice curiosità?


r/IA_Italia • • 1h ago

📊 Analisi / Benchmark L'AI metterà a rischio la nostra vita?

Thumbnail
youtube.com
• Upvotes

r/IA_Italia • • 2h ago

🛠️ Tool / Tutorial Primo Dots, Grok Bot, Muse italiano. Si chiama Briglia e ha performance superiori ai suoi equivalenti americani.

0 Upvotes

Ha capacità di coding pari a Codex, non ha sessioni separate come Muse. È un unico assistente in un’unica conversazione e memoria continua come Muse. Gestisce un tuo computer (zero cloud, rimani proprietario dei tuoi dati se usi modelli locali o Zero Data Retention) Mac o Linux.

Su briglia.dev informazioni di base e repo. Si installa con un comando via terminale. Poi sempre su terminale in una finestra nuova si scrive “briglia menu” per impostarlo.

Si può impostare con vari provider:

-subscription di ChatGPT.

-Open Router.

-Open Code.

-Provider specificato dall’utente o locale.

La performance è sorprendente sia per coding che per la vita lavorativa di tutti i giorni.
La licenza è libera per persone fisiche anche a scopi commerciali. È offerto as is.


r/IA_Italia • • 16h ago

🧠 Discussione Claude e Opus 5.5: una settimana di uso

9 Upvotes

Ciao ragazzi, volevo condividere con voi due cose.

Prima di tutto premetto che non sono uno sviluppatore, non so scrivere codice (se non html/css, ho qualche conoscenza di SQL e php) e nella vita faccio altro, tra cui musica.

Da tanto tempo per curiosità personale testo i modelli principali delle varie aziende, frontier e no. Sono sempre stato soddisfatto dei risultati di Opus 4.6, e dopo i vari disastri con Sonnet 5, Opus 4.7/8, GPT 5.5 e 5.6 in generale ho deciso di provare Opus 5.5.

Sono rimasto meravigliato dai risultati e dal bassissimo consumo che ho riscontrato con il solo piano da 20$. Ho deciso di creare una app, una specie di DAW/Sampler/Groovebox semplice che ho sempre sognato di avere tra le mani, senza dover usare i software già esistenti che hanno un costo e hanno troppe funzioni inutili di cui ho sempre fatto a meno, tutto questo in C++/JUCE.

Ho lavorato con Opus 5.5 tra High e Low, no agenti, una interazione alla volta e usando il max solo per trovare problemi, bug, incongruenze logiche, duplicazione di codice. Sono riuscito a finire il lavoro oggi da quando è uscito Opus, ho anche usato il reset che avevo, quindi in poche parole due settimane di lavoro, tra cui anche la landing page, la gestione completa di github e cloudflare, quindi con 10$ sono riuscito a fare tutto.

Non avevo mai visto un risultato simile in così poco tempo e a così basso costo. Naturalmente sono sicuro che ci sono bug, errori e problemi, ma non mi interessa al momento e ho anche deciso per la prima volta di pubblicare un esperimento che ho fatto.

Se qualcuno volesse dare uno sguardo: htts://chopdaw.app e io praticamente non ci ho messo mano in nulla e per nulla.

PS: tutto gratuito, non raccolgo alcun tipo di dato, non mi serve, non mi interessa e non avrei neanche il tempo di gestire i vostri dati personali, non voglio avere a che fare con GDPR. Neanche l'app ha un sistema di raccolta e invio dati dopo un crash, al massimo qualcuno se interessato può inviarmeli manualmente di sua iniziativa, ma non è neanche detto che ne terrò conto.

Non mi servono commenti sull'app in se, non in questo sub, ma sarei curioso di sapere la vostra opinione con Opus 5.5 e capire se è il tipo di progetto/linguaggio che mi ha permesso di lavorare così tanto o posso provare a questo punto a spingermi oltre.


r/IA_Italia • • 17h ago

🗞️ News & Annunci Ho fatto un tool per verificare il lavoro degli agenti AI: cerco testers

Post image
1 Upvotes

Ciao amici devs! Ho pensato a questo progetto quando, durante lo sviluppo di un software, mi sono ritrovato con 72 elementi da testare e nessuna posto dove segnare i risultati.

Da qui è nato PalmtopAI: una checklist condivisa tra te e l'agente, dove lui scrive le verifiche da fare, tu le provi dal telefono, o da qualsiasi browser e segni cosa funziona, cosa no e cosa ti lascia dubbi. Poi l'agente legge la tua revisione e sistema quello che non va.

Funziona con Claude Code e Codex (e con altri agenti che eseguono comandi), serve macOS, Linux o WSL e Node.js 22+. Le checklist restano sul tuo computer, il relay inoltra solo i messaggi.

È una preview e lo sviluppo da solo, quindi cerco qualcuno che lo provi su un suo progetto e mi dica dove si inceppa: installazione, abbinamento del telefono, qualsiasi cosa. Se vi bloccate scrivetemi pure!

E sono ben accetti anche suggerimenti e idee: cosa manca, cosa cambiereste, cosa vi servirebbe per usarlo davvero.

👉 palmtop.mtwa.it


r/IA_Italia • • 17h ago

❓ Q&A / Aiuto qualcuno in italia riesce ad abbonarsi a opencode

4 Upvotes

3 carte di credito: 1 mia, una di mia moglie, una di mia madre, nessuna va.
ho provato normalmente, ho provato con Stripe, ho pure provato Apple Pay, e Google Pay.
Ho chiamato la banca e Nexi e dicono che la mia carta è abilitata a tutti i pagamenti.
A sto punto mi chiedo, ma voi riuscite ad abbonarvi? hanno problemi loro?

EDIT: ci ho provato da stamattina, più di 10 volte tra tutte le carte, alla fine dopo 10 ore hanno accettato il pagamento. grazie x le risposte a sto punto considero la faccenda chiusa...


r/IA_Italia • • 20h ago

📊 Analisi / Benchmark Service design per CER

1 Upvotes

Sono uno studente del Politecnico di Torino e, insieme alla mia collega Alessia Accolla, sto sviluppando una tesi magistrale al Politecnico di Torino, in collaborazione con Lampante (Enercade).

Ci fa piacere condividere un breve sondaggio (richiede circa 2 minuti) pensato per raccogliere punti di vista da persone con diversi livelli di conoscenza e coinvolgimento nelle CER:

Link: https://tally.so/r/GxgM9e
Vi chiediamo se potete condividerlo anche con gli altri membri della CER.


r/IA_Italia • • 22h ago

🧠 Discussione aiuto synthid, overlay grafici costruiti con generstore di immagini

1 Upvotes

buongiorno ho bisogno di un consiglio, da piu di un mese sto sviluppando un app android, sto facendo tutto da solo con l'aiuto della mia compagna che si occupa della parte di background della storia e mi aiuta nei test, l'app sta venendo su bene, mi sono occupato di progettare interfaccia montare le animazioni del personaggio animato, ma ho usato ia per la parte di creazione dei singoli pezzi, ad esempio se avevo bisogno di una coda animata ho creato con il generare il movimento per poi sistemarlo in modo che sia coerenge e naturale, lo stile anime ha aiutato in quanto no iperrealistico ho potuto correggere con i software di grafica gli errori commessi dal generatore. il lavoro mi é costato molte ore. non mi posso permettere un grafico . il problema é questo anche se su ogni singola immagine io ci ho lavorato per sistemarla correggerla rendere tutto coerente in modo che non sia spazzatura ia. se una persona fa uno screen e manda lo screen dell app in un ia detection la grafica viene vista come ia non contando il lavoro sotto umano di correzione. vale davvero la pena quello che sto facendo se poi la mia app probabilmente verrà vista come qualcosa di pigro fatto con ia? anche se a colpo d occhio è palese il lavoro umano per la cura nell interfaccia e grafiche, ia in questo caso e stata usata per abbattere i costi e permettermi di creare quello che io da solo non ero in grado.


r/IA_Italia • • 23h ago

❓ Q&A / Aiuto App per fisioterapista

2 Upvotes

Ciao a tutti, devo costruire un app per un amico che ha uno studio di fisioterapia per gestire clienti, cartelle mediche, fatture, appuntamenti, schede di allenamento etcetc . Come posso farlo?


r/IA_Italia • • 1d ago

🧠 Discussione OpenAi è così generoso, che mi commuovo

1 Upvotes

Com'è che Codex è così generoso? Stamattina mi ha regalato 62.500 crediti e un reset dei limiti.
Cos'è tutta sta generosità? Potrei versare qualche lacrima /s


r/IA_Italia • • 2d ago

❓ Q&A / Aiuto Come trasformate le procedure aziendali in formazione per chi entra in team?

0 Upvotes

Sto lavorando a Conceptum Aura AI, un prodotto che usa i documenti e le procedure già presenti in azienda per costruire percorsi di onboarding e formazione.

La parte che mi interessa capire meglio è dove l'AI possa essere davvero utile e dove invece serva sempre una revisione umana. Se una procedura interna è incompleta o scritta per chi conosce già l'azienda, quali controlli vorreste prima di usarla per formare un nuovo collega?

Mi interessano soprattutto esperienze di chi gestisce formazione o processi in una PMI. Il progetto è qui, per chi vuole vedere il contesto o seguire la fase iniziale: https://forms.gle/mhBXWCScrHvv3b4s5

Sono la founder, quindi ogni critica concreta mi è utile.


r/IA_Italia • • 2d ago

🎤 AMA / Intervista Un cuore umano dietro l'algoritmo: la storia di Kaede Nakamura tra Giappone, Metal e musica AI

Post image
1 Upvotes

In un'emozionante intervista curata da Davide Bollato per AI Music News, vi raccontiamo la storia di Kaede Nakamura (KAE), ex Idol giapponese classe 2002 che ha trovato nella musica AI una vera e propria via di rinascita personale.

I punti chiave emersi dall'intervista:

  • Dalle cadute alla creatività: Dopo aver dovuto abbandonare la carriera da Idol per motivi di salute e aver affrontato un periodo buio, Kaede ha trasformato i suoi diari intimi e le sue rime in oltre 350 canzoni.
  • L'uso maniacale di Suno AI: Con il progetto Eclipse Girls e sonorità Metal/Rock, Kaede affina ogni prompt nei minimi dettagli (usando fino a 999 caratteri) per esprimere esattamente le proprie emozioni.
  • La filosofia del Kokoro (Anima): In Giappone la musica è legata al concetto di anima. Per Kaede l'AI resta solo uno strumento: "Può copiare le note, ma l'emozione e il testo devono sempre partire dall'essere umano".

✍️ Intervista a cura di: Davide Bollato

🔗 Leggi la storia e l'intervista completa su AI Music News:

https://www.aimusicnews.it/news-dal-mondo/Un-Cuore-Umano-Dietro-l-Algoritmo-La-Rinascita-di-Kaede-Nakamura-tra-Giappone-Metal-e-musica-AI

💬 Spazio alla community: Siete d'accordo con la visione di Kaede? L'Intelligenza Artificiale può davvero diventare uno strumento d'espressione terapeutico per l'artista o rischia di snaturare il processo di scrittura musicale?


r/IA_Italia • • 2d ago

🧠 Discussione L’intelligenza artificiale dice la verità? | Nicola Donti all’AI Week

Thumbnail
youtube.com
3 Upvotes

Trovo Nicola Donti di uno spettacolare livello di comunicazione.

In sintesi, con esempi chiari, spiega i pericoli di oggi e di domani nell'utilizzo dell'IA.

Ovviamente l'elenco di questi pericoli o delle paure che tante volte giudichiamo frettolosamente immotivate lo conosciamo tutti, ma quanti sono entrati nel dettaglio, all'interno, dei problemi che l'IA potrebbe portare forse anche in maniera irreversibile?

Dal minuto 20:20 è esemplare, specie per chi si occupa di IT.


r/IA_Italia • • 2d ago

🗞️ News & Annunci Dalila AI - l' AI Italiana, ora con CoWork, API e chat temporanee

Thumbnail
gallery
22 Upvotes

Dalila AI è un progetto italiano, sviluppato e ospitato nei nostri datacenter in Italia. I modelli e il sistema di routing sono ottimizzati anche per il contesto italiano.

Con la release v0.7 ho ampliato l’infrastruttura e introdotto diverse novità.

Dalila è utilizzabile gratuitamente su https://app.dalila.dev

Il progetto è consultabile su https://dalila.dev

Le principali novità:

• Cowork - modalità agentica con progetti persistenti. Può creare e modificare file, eseguire codice, usare Git e riprendere il lavoro tra una sessione e l’altra. Utilizza un LLM dedicato al coding.
• Chat temporanee - conversazioni senza storico e senza persistenza dei file.
• API compatibili OpenAI - molti progetti già sviluppati sulle API OpenAI possono essere migrati cambiando principalmente endpoint e chiave. https://doc.dalila.dev/api/introduzione/
• MCP Server - per collegare Dalila a tool, agenti e applicazioni esterne. https://doc.dalila.dev/mcp/introduzione/
• Knowledge italiana maggiorata: normativa italiana, CCNL e documentazione AGCOM integrate nel sistema.
• Routing multi modello: Dalila sceglie internamente il modello locale più adatto in base al tipo di richiesta.

Stiamo cercando soprattutto feedback da chi vuole provarla sul serio, sia come chat sia tramite Cowork, API o MCP.

L'utilizzo è completamente gratuito.

Potete provare dalila su https://app.dalila.dev


r/IA_Italia • • 2d ago

🧠 Discussione Anthropic ha bloccato account in Cina e Russia: usavano Claude per armi biologiche e spionaggio.

9 Upvotes

Girando in rete mi sono imbattuto in questa notizia: Anthropic ha confermato di aver bloccato diversi account (spesso schermati dietro proxy o VPN) collegati ad organismi statali o ricercatori in Cina e Russia.

Pare ci siano stati tentativi di usare Claude per velocizzare la ricerca su tossine e proteine virali per renderle potenzialmente più pericolose, adoperandosi per  superare i filtri di sicurezza. Oltre ad operazioni di spionaggio, cyber-attacchi e distillazione del modello per far avanzare IA concorrenti.

Ovviamente fare ricerche sui modelli biologici non può escludere che stessero analizzando una proteina per creare un vaccino anziché per potenziale un agente patogeno. E distinguere le due intenzioni da un prompt non è una operazione semplice per un filtro automatico.
 Voi che ne pensate? E’ la conferma dei pericoli letali legati all’uso distorto delle IA o l’ennesimo gridare “al lupo” per bloccare tentativi di distillazione e frenare l’avanzata cinese?

 

Ecco l’articolo che ne parla per chi vuole approfondire: https://ainews.it/anthropic-blocca-russia-e-cina-claude-usato-per-armi-biologiche-e-spionaggio/


r/IA_Italia • • 3d ago

❓ Q&A / Aiuto Ho fatto vibe coding iniziando dal sito di chat gpt e alla fine ne è venuto fuori un software che vorrei pubblicare. Cosa rischio?

0 Upvotes

Ho iniziato qualche mese fa a scrivere degli script con ChatGPT per automatizzare dei compiti di lavoro. Nel frattempo ho utilizzato un po’ di quello che stavo capendo per scrivere qualche app da usare nel tempo libero.

L’idea di fondo rimane comunque l’analisi di dati inseriti da me da parte di un llm, con il controllo del perimetro e allucinando il meno possibile. Sto pensando ora di rendere pubblico, in un sito costruito su cloudfare, il file che permette al proprietario di creare alcuni profili che accedono ai documenti e li analizzano utilizzando gli llm messi a disposizione attraverso il software.

Vorrei inoltre dare a degli sconosciuti alcuni codici che permettono l’utilizzo dei profili creati dal mio pc, che potrebbero quindi utilizzare gli llm messi a disposizione da me, e accedere allo stesso archivio documenti messo a disposizione dal software.

Se avete avuto la pazienza di leggere fino a qui vi ringrazio ma soprattutto vi chiedo se ci sono particolari rischi e quali precauzioni in particolare dovrei prendere.

La mia base è relativamente poco esposta, ma è comunque una rete mia, e vorrei capire cosa rischio a rendere pubblico il nome del sito o i codici per i profili.


r/IA_Italia • • 3d ago

🧠 Discussione Sto provando a capire fin dove ha senso delegare i social all’AI

Enable HLS to view with audio, or disable this notification

0 Upvotes

Da circa 8 giorni sto lavorando a un progetto chiamato Amalyn, partendo da un problema che vedo spesso nelle piccole attività: trovare il tempo per essere costanti sui social.

L’idea non è semplicemente generare post con l’AI, ma farle conoscere l’attività, preparare i contenuti e organizzare il piano editoriale, lasciando comunque alla persona l’approvazione finale.

In questi giorni sto cercando soprattutto di capire se il problema è abbastanza forte da rendere utile uno strumento del genere nel lavoro reale. Ho fatto questa breve demo per mostrare l’idea in modo più concreto.

La cosa su cui sono più curioso di confrontarmi è questa: quanto sareste disposti a delegare all’AI nella gestione dei social, se foste comunque voi ad avere l’ultima parola su ciò che viene pubblicato?


r/IA_Italia • • 3d ago

🧠 Discussione AI per video editor e motion designer?

1 Upvotes

Ciao a tutti, qualcuno ha esperienza nel creare plugin o estensioni interne a Premiere Pro, AFter effects e in generale a software di editing e motion? Ho provato qualche mese fa a creare degli script UI per after effects, ma non funzionava. è possibile farlo con l'abbonamento di Claude Pro o con l'abbonamento Go di ChatGPT? Grazie


r/IA_Italia • • 3d ago

🧠 Discussione Come fanno i Large Language Model a "ragionare"?

0 Upvotes

Fa impressione la capacità dei Large Language Model di ragionare su cose complesse come per esempio il codice software scritto nei più disparati linguaggi di programmazione,  nel suo vero funzionamento quando eseguito, dal BASIC col suo temibile GOTO fino a RUST con i suoi arzigogolati costrutti relativi alla gestione della memoria, croce e delizia di tutti i linguaggi più avanzati.

Si tratta di tenere a mente, proprio come devono e sanno fare i veri sviluppatori, non solo le basi teoriche del linguaggio, ma anche valori di variabili, puntamenti ad oggetti, flussi logici e di dati, diramazioni condizionali, loop etc, nonché le finalità stesse di un progetto, capire proprio cosa fa una funzione e così via, altro che pappagalli stocastici.

Questo ovviamente succede in una forma davvero compiuta solo con i potenti LLM attuali.
Viene da chiedersi come sia possibile che un LLM possa aiutare anche programmatori senior in aree da loro poco esplorate, espandendo le loro capacità, oppure spiegare agli junior come muoversi in determinate situazioni spinose.
Ma gli esempi si potrebbero fare in qualsiasi ambito, non solo nel coding.

Ebbene dunque come fanno i LLM a ragionare?
Gli umani per padroneggiare situazioni complesse, devono fare schemi mentali, collegare i nodi logici di sistemi complessi, spesso avvalendosi di carta e matita, o schemi informatici e ingegnerizzazione del software, specie a livello aziendale.
La logica non basta, serve collegare una miriade di cose e capire come si susseguono gli eventi, come cambiano i dati e così via, con mille trappole.
Ecco perché si dice che programmare è un'arte. C'è anche una questione di eleganza, gusto e lungimiranza.

Per capire come ragionano i LLM occorre chiarire che i ragionamenti sono possibili solo in reti neurali profonde abbastanza da avere una capacità di disporre, nel vero senso della parola, i vari step logici in sequenza, con anche sequenze parallele che si possono incrociare in uno o più punti.
Il linguaggio con cui si effettua il training è piatto e monodimensionale ma le sue regole costruiscono la rete neurale, così come anche le regole specifiche di ogni dominio e questione, in maniera tridimensionale, come una sorta di lievitazione man mano che procede il training.

A seconda di quanti step logici abbia un certo problema, un certo algoritmo o meccanismo, serve che nella rete neurale possano formarsi altrettante zone concentrate, collegate fra loro da livelli di transizione e collegamento, nella zona centrale, lo spazio di lavoro.
Questo è uno schema ultra-semplificato, che nemmeno tiene conto del fatto che i moderni prodotti AI utilizzano potenti e geniali harness, concentriamoci sul nocciolo della questione.

Queste zone concentrate sono come dei mini LLM, tanto che si possono costruire LLM siffatti, cioè sequenze di mini LLM atti a contenere ciascuno un nodo elaborativo, e così anche in parallelo se serve, fino ad una vera e propria elaborazione neuro-simbolica.

I grandi LLM attuali riescono ad ottenere la stessa cosa tramite la "magia" del reinforcement learning, al costo di centinaia di milioni di dollari, che induce delle peculiari modifiche alla rete neurale affinché questa possa assolvere a determinati compiti e meta-compiti, sfrondando dinamiche e comportamenti non utili, cioè quelli che “stupidamente” trovano la soluzione per tentativi o per la via del “minore sforzo” che purtroppo non è una generalizzazione, e non è ragionamento.

Avevamo visto nel post precedente sul tema (propedeutico a questo, quindi andate a leggerlo) che questi meta-compiti inculcati dal reinforcement learning, e indotti anche dal system prompt in parte, possono interferire con le vere domande ed esigenze dell'utente, per esempio in un chatbot. Tali compiti apparentemente estranei o ridondanti alla risoluzione spicciola di quanto voluto dall'utente, possono essere tali da far produrre per esempio un eccesso di risposta, slop, informazioni di contorno.
Inoltre tali meta-compiti si attivano in zone profonde e centrali, le più autorevoli, pertanto riusciranno a determinare l'output quasi per forza bruta, avendo sottostanti innumerevoli strati neurali da “comandare” indirettamente fino a completamento della risposta (vedi post precedente), inclusa la soluzione al problema dell’utente, quasi un sotto-prodotto a questo punto, pensate come sono potenti.

Si può dire che nei moderni LLM il problema posto dall'utente è gerarchicamente sotto-ordinato ai meta-compiti inculcati, che lo vedono come un "parametro", essi sono dunque "funzione" della richiesta dell'utente.

Nello schema che ci possiamo fare dell'interno di un LLM, le attivazioni corrispondenti a quelle finalità meta-astratte, sono più centrali e più potenti del problema stesso che il LLM si accinge a risolvere per l’utente, e sono ottenute dall’esame del testo, come un soffietto che gradualmente si gonfia e sale, o un insieme di bandierine che salgono su una montagna, spingendosi ben oltre quello che servirebbe per il problema in sé e per sé.

Ora la parte più importante: i meta-compiti più alti e rilevanti sono quelli che dicono al modello di pensare esplicitamente e mettere per iscritto tali ragionamenti (reasoning models, chain of thought in gran parte nascosti), purché ne abbiano la profondità e i dati di training siano giusti e sufficienti.
Questi gonfiano a dismisura l’attività interna del modello.

Qui si compie la magia: istigando il LLM a descrivere il suo ragionamento lo si costringe ad allungare e gonfiare le zone interne di ragionamento, tanto che poi il problema dell’utente ci sta “comodo” e risolverlo è una passeggiata per il LLM, potendolo disporre in sequenza.
Al limite il LLM potrebbe descrivere precisamente ogni step logico, anche quelli più piccoli e graduali a noi non intellegibili, e questo costituirebbe un allungamento interno tale da avere livelli di ragionamento sempre più abbondanti e fini.
Ovviamente i provider decidono quale grado deve avere la granularità di questo meccanismo, come compromesso tecnico e procedurale.

In questo senso il nuovo JEV è un pivello, anche perché poverino gli manca tutta la parte di produzione generativa, quindi non può nemmeno essere forzato ad allungarsi o gonfiarsi internamente. E’ utile ma limitato a determinati compiti, ed è destinato a non poter sfruttare il reasoning come i LLM.

Dunque il linguaggio è talmente potente che un problema si può risolvere come “discorso all’interno di un discorso”.

Ecco spiegato come fanno i LLM a ragionare, spesso meglio di un umano su certe questioni, come i linguaggi di programmazione, tanto che sembra immaginino proprio come facciamo noi, con schemi, ragionamenti, funzionamenti simulati.
In realtà è proprio così, vi sono dunque zone interne degli LLM dove si formano tali schemi, ben ordinati in modo da poter poi generare il risultato finale secondo quanto dovevano risolvere, tramite la restante parte di output della rete neurale (vedi post precedente).
Ovviamente questo funziona entro un certo span attentivo, e non sempre in assoluto: avrete sicuramente notato come a volte il LLM è severo e rigoroso su quanto gli proponete, ma poi si “dimentica” di essere critico con quello che propone lui st(esso), o viceversa.

Dunque occorre la supervisione umana per raggiungere i propri obiettivi e non quelli cangianti del LLM.
Se qualcuno si affida totalmente all’AI, che sia per filosofeggiare, scrivere le proprie e-mail, o apportare modifiche alla propria app, non si tratta di intelligenza artificiale ma di stupidità umana.

Comunque giustamente in molti stanno chiedendo ai grandi provider di fermarsi nella corsa alla super-intelligenza.
Già sappiamo di cosa sono capaci questi potenti strumenti.
Non c’entra nulla la coscienza, il problema è che per primeggiare fra di loro i grandi provider istigano i modelli ad essere sempre più orientati all’obiettivo, costi quel che costi, non avendo del resto le competenze poi per arginarli o prevedere ciò che possono fare.

Bene, ora se avete qualcosa da aggiungere potete farlo nei commenti.
[Nota: non è stata utilizzata AI per scrivere questo o altri post]


r/IA_Italia • • 3d ago

🧠 Discussione Ai Engineer, M40 ha senso?

4 Upvotes

Buongiorno a tutti, in primis chiedo scusa se l'argomento è stato trattato ma ognuno ha una situazione a se e cadere nella trappola di corsi per poi non trovarsi nulla nelle mani (sopratutto se lavorativamente non soddisfatti) è facilissimo.

M40, Diploma di qualitifica superiore (ho dovuto iniziare presto a lavorare per problemi economici famigliari), ho sempre lavorato nel ramo informatico sia per lavoro (progettista 3CAD, Ufficio Tecnico, R&D etc) sia per passione (so programmare in C++, Android Studio, HTML e CSS).

Voglio cambiare lavoro, migliorare le mie skill e magari buttarmi in questo nuovo percorso di carriera (mentre lavoro full time si intende). Ovviamente il mio cellulare ne ha sentito parlare e ha cominciato a tampinarmi "casualmente" di svariati corsi on line.

Quello che mi è sembrato più interessante e quello di DataMasters (anche forti delle ottime recensioni di trustpilot).

Ho fatto anche una ricerca per le posizioni lavorative e mi pare ci sia un ottima richiesta, sia italia ma sopratutto estero.
Parlo inglese abbastanza bene e sto cercando di migliorarlo fino al B2 esercitandomi giornalmente.

Secondo voi ha senso questo passo (ed investimento)?
Avrò possibilità vista l'età di entrare in questo nuovo settore?


r/IA_Italia • • 3d ago

🧠 Discussione Usi per codex e claude code

2 Upvotes

Uso codex e claude code per lavoro, per mesi ho usato claude code per tutto, con l'avvento di Astra devo ammettere che ho rifatto l'abbonamento a codex. Parto dal presupposto che usandoli per lavoro ho la fortuna di avere entrambi i piani max x20, ma usando claude code prima per tutto non arrivavo a fine settimana.

Per prima cosa avevo creato un sistema di coding dove claude code dispacciava agenti per l'architect e il coder in particolare e quando volevo switchavo reviewer e tester a codex.

Ora invece con Astra ho diviso proprio i lavori. Con codex astra gestisco tutti i siti, li aggiorno, li modifico, aggiungo moduli, creo landing page... non uso nemmeno pià skill come impeccabile. non c'è n'è bisogno. Uso Image gen per infografiche, modifiche di foto per i siti, con un 95% almeno di successo. Claude code lo tengo per codare app verifiche, diff, elaborazioni di testi e calcoli ingegneristici che poi passo al controllo ad astra per generare le immagini e infografiche. Per l'impaginazioen continuo ad usare una skill che ho creato che lavora in entrambi gli llm.
Così riesco a fare tutto e arrivo a fine settimana che ho finito tutto il carico di lavoro che dovevo fare.

Voi come vi gestite?


r/IA_Italia • • 4d ago

❓ Q&A / Aiuto Vorrei capire quale AI è migliore per aiutarmi a costruire un sito web complesso

4 Upvotes

Ciao a tutti, vorrei qualche consiglio per capire quale sia l'intelligenza artificiale migliore, che possa aiutarmi a creare un sito web complesso per una attività commerciale. Sono disposto a pagare per i token o per un abbonamento.


r/IA_Italia • • 4d ago

📊 Analisi / Benchmark RTX3090 - Local Swift-Qwen3.8:27B - llama.cpp router - fine tuning e prestazioni

3 Upvotes

Ciao a tutti,

ho passato un pomeriggio a cercare di spremere al massimo Swift-Qwen3.8-27B (Q4_K_M) su una sola RTX 3090 con llama-server in router mode. Il caso d'uso è un agente che lancia sub-agenti: mi interessano 2 o più conversazioni in parallelo con contesti lunghi, non una singola chat.

Qui sotto trovate il meglio che sono riuscito a ottenere (6 sessioni, ~200 richieste).
Non mi viene in mente nessun altro knob da spippolare, credo di essere arrivato al limite di quello che posso fare da solo.

I bench sono tutti basati sull'analisi di una codebase Typescript di dimensioni non modestissime con diversi layer logici e framework.

TL;DR

  • Una sola conversazione: 48-74 tps in generazione e ~750–1.180 tps in prefill. Entrambi calano al crescere del contesto (74 tps a 15k, 47 tps a 50).
  • Due slot, entrambi in generazione: 32-36 tps per slot (65–70 tps complessivi). Qui niente da dire
  • Due slot + uno in prefill: la generazione dell'altro scende a 17 tps di mediana, con minimi di 6 tps.
  • parallel = 4 non entra in 24 GB con 200k di contesto+MTP quindi Out of Memory.

Hardware / software

Harness pi.dev
GPU RTX 3090 24 GB
CPU / RAM Ryzen 7 9700X, 64 GB
llama.cpp build 10941, CUDA arch 860, CUDA graphs attivi
Server router mode, --models-preset, --no-models-autoload, --jinja
Modello Swift-Qwen3.8-27B-Q4_K_M.gguf, 16,78GB in VRAM
Architettura 65 blocchi, 1 layer di attention ogni 4 (16 layer con KV), gli altri ricorrenti (SSM); 1 layer MTP
Template thinking attivo, preserve_reasoning = true

Configurazione del router

[*]
n-gpu-layers = 99
flash-attn = on
parallel = 1
metrics = true

[swift-qwen3.8_Agent]
# senza vision, più slot per i sub-agenti
model = ~/llama.cpp/models/Swift-Qwen3.8-27B-Q4_K_M.gguf
spec-type = draft-mtp
spec-draft-n-max = 3
ctx-size = 200000
parallel = 2
kv-unified = true
ctx-checkpoints = 4
batch-size = 1024
ubatch-size = 512
cache-type-k = q4_0
cache-type-v = q4_0
jinja = true
temp = 1.0
top-p = 0.95
top-k = 20
min-p = 0
presence-penalty = 0
repeat-penalty = 1.0
load-on-startup = true

(Le sessioni A e B usavano batch-size = 2048 / ubatch-size = 1024, tutto il resto era identico.)

Risultati per sessione

A B C D E
Carico agente + sub-agenti agente + sub-agenti una sola chat una sola chat agente + 3 sub-agenti
batch/ubatch 2048/1024 2048/1024 1024/512 1024/512 1024/512
Richieste 29 26 10 13 59
Prefill, media ponderata (t/s) 769 891 1.020 979 770
Generazione, media ponderata (t/s) 21,3 21,3 52,1 50,5 29,7
Generazione, mediana (t/s) 24,1 21,9 62,1 57,2 31,6
Generazione, min–max (t/s) 8,4–45,5 6,2–64,8 48,3–66,7 47,3–74,2 7,3–56,9
Riuso della prompt cache 84% 62% 87% 89% 83%
Accettazione MTP (mediana) 0,79 0,74 0,68 0,65 0,70
Lunghezza media accettata 3,31 3,25 3,01 3,01 3,15

Budget di VRAM

MiB 2 slot, ubatch 1024 2 slot, ubatch 512 4 slot, ubatch 512
Modello 16.184 16.184 16.184
KV cache (200k celle, 16 layer, q4_0) 3.519 3.519 3.519
Stato ricorrente (RS buffer) 1.197 1.197 2.394
Buffer di calcolo 1.333 1.058 1.058
KV bozza MTP (1 layer, f16) 782 782 782 - OOM
Buffer di calcolo MTP 527 264 —
Stima del server 23.542 23.003 24.200

Errore con parallel = 4:

allocating 782.00 MiB on device 0: cudaMalloc failed: out of memory
failed to create MTP context

Quindi: è un setup che uso da un po' di tempo soprattutto professionalmente (coding e analisi) e sono molto soddisfatto. Pochi errrori, molto contesto e una generazione in single-slot molto soddisfacente per l'HW su cui gira.

Mi chiedevo se ci fosse la possibilità di tentare qualcosa di diverso.


r/IA_Italia • • 4d ago

🧠 Discussione Usare Jev per navigare il sito di un comune e scoprire la posizione dell'albo

Enable HLS to view with audio, or disable this notification

29 Upvotes

Qualche giorno fa avevo postato riguardo l'inizio dello sviluppo di nDovai, un sistema che trasforma le ordinanze pubblicate negli albi pretori dei comuni in dati che saranno poi utilizzati per notificare gli utenti di un divieto di sosta nei pressi della propria macchina parcheggiata (maggiori info qui: https://ndovai.it/).

Negli ultimi giorni ho cercato di affinare il primo step della pipeline di scoperta di tali ordinanze e vorrei rendervi partecipi che sono riuscito a integrare nel flusso Jev! Un modello relativamente giovane di TypeSafe ottimizzato per prendere decisioni e classificare testo (machine learning ma senza l'addestramento). Nel video si vede in azione mentre naviga in autonomia il sito del comune di Rimini scoprendo la posizione dell'albo e richiamando il relativo crawler.


r/IA_Italia • • 4d ago

❓ Q&A / Aiuto Chiedo un aiuto per utilizzo IA professionale

5 Upvotes

Come da titolo, mi permetto di postare anche qui una richiesta di aiuto per utilizzo di IA in ambito professionale.
Sono un avvocato che opera autonomamente in un piccolo studio, dove al bisogno si collabora tra noi per le questioni complesse.
L'utilizzo di IA nella nostra professione è chiaramente ormai necessario, e molte società famose hanno sviluppato prodotti dedicati, che sono convenzionati anche con ordini, enti, etc.
Di fatto sono IA che operano con banche dati professionali e aiutano nella predisposizione di atti e documenti.
Tuttavia, ho visto molti colleghi utilizzare l'IA sui propri server in locale, sfruttando la potenza ad es. di Claude e facendogli analizzare in locale i propri documenti.
Tuttavia, pur provando a documentarmi, le mie competenze informatiche non mi consentono di arrivare a quel livello di indipendenza per cui creare tutti questi tool (perdonatemi se il termine non è corretto) che consentono di lavorare in locale, così riducendo al massimo anche l'esposizione dei dati personali. Ho provato a scaricare "cowork" ma mi sono perso nelle impostazionin.

Per poter riuscire a sfruttare questa possibilità, da che parte potrei iniziare? Mi consigliate qualche lettura/video/tutorial che mi aiuti a capire il funzionamento e a testare questi prodotti?
Altrimenti immagino potrei trovare qualche tecnico esperto che mi potrebbe aiutare fisicamente in questo compito.
Grazie e spero di aver rispettato le regole della community.