Grok 4.6 è arrivato su Amazon Bedrock

Grok 4.6 è arrivato su Amazon Bedrock

Grok 4.6 è disponibile su Amazon Bedrock dal 18 agosto con 500K token di contesto e quattro livelli di reasoning effort.

Il modello dimezza la finestra di contesto rispetto a Grok 4.3, ma guadagna ragionamento configurabile e nove valutazioni

Immagina di dover affidare a un assistente digitale un’attività che dura ore: leggere una relazione, analizzare un grafico, proporre modifiche e poi tornare sui primi passaggi senza ripetere tutto da capo. Fino a poco fa era un compromesso; da metà agosto, con Grok 4.6 su Amazon Bedrock, quel filo può restare teso molto più a lungo.

La notizia in sé è asciutta: dal 18 agosto il modello è disponibile sulla piattaforma di AWS. Ma dietro c’è un cambio di prospettiva che riguarda il modo in cui usiamo i modelli, non solo le loro dimensioni.

Agenti che non perdono il filo

La scena iniziale non è fantascienza. È il tipo di compito per cui xAI ha progettato Grok 4.6: un agente che resta su un problema per molti passaggi, senza dover ricominciare la spiegazione ogni volta. La scheda tecnica lo dice in modo più freddo: 500K token di contesto e quattro livelli di reasoning effort, low, medium, high e xhigh. Tradotto: puoi chiedere al modello di ragionare di più o di meno, a seconda che ti serva una risposta rapida o un’analisi più profonda.

Secondo quanto riportato da Snowflake, Grok 4.6 è progettato per agenti a lunga esecuzione e per attività interattive e visive complesse, mantenendo il contesto su molti passaggi. È esattamente il cambio che serve quando un assistente deve leggere, tornare indietro, correggere e ripartire. Ma per capire davvero cosa cambia, serve guardare cosa c’era prima su Bedrock.

Dal milione di token ai 500K: il paradosso del contesto

Prima di Grok 4.6, su Bedrock girava Grok 4.3. Ed era, almeno sulla carta, un gigante: con il lancio di quel modello xAI è entrata in Amazon Bedrock come fornitore, e Grok 4.3 ha una finestra di contesto di 1 milione di token e gira sul motore di inferenza Mantle di Amazon Bedrock. Un milione di token vuol dire poter caricare documenti lunghissimi in una sola sessione. Sembrerebbe il massimo.

E invece Grok 4.6 dimezza la finestra: 500K token. Il paradosso sta tutto qui. Meno spazio grezzo, ma in cambio una capacità di ragionamento più articolata, con livelli di sforzo configurabili. Non è solo una questione di quanti token entrano: è come il modello li usa. Secondo xAI, al lancio dello scorso 12 agosto Grok 4.6 High ha ottenuto un punteggio di 61 sull’AA Intelligence Index. E secondo Artificial Analysis, quell’indice, nella versione 4.1.1, è un indice composito che incorpora nove valutazioni. In pratica, non misura una sola abilità, ma un insieme di prestazioni.

Questo spiega perché una finestra più corta non è per forza un passo indietro. Un agente che ragiona meglio può cavarsela con meno contesto a disposizione, perché sa tornare sui punti giusti senza dover tenere tutto in memoria grezza. Se la finestra si accorcia, il prezzo però racconta un’altra storia: quanto costa questa capacità?

Il prezzo di restare sul pezzo

A 2 dollari per milione di token in input e 6 in output, con la variante fast al doppio del prezzo, la domanda non è più se conviene provarlo, ma chi può permettersi di non farlo. I numeri arrivano da xAI e sono indicativi: servono a capire che un agente a lunga esecuzione non si paga più come un lusso, ma come una voce di costo da mettere in conto. La corsa è appena iniziata: riusciranno i modelli a mantenere il contesto abbastanza a lungo da finire il lavoro senza far lievitare i costi? E, domanda che le note finora non affrontano, cosa succede ai documenti che affidiamo a questi agenti? Il futuro non è un modello più grande, ma un agente che resta con te abbastanza a lungo da portare a termine il lavoro, e la vera sfida sarà renderlo sostenibile.

🍪 Impostazioni Cookie