Anthropic investe 100 milioni di dollari nella formazione di 10.000 ingegneri Claude
Anthropic ha inaugurato la Claude Frontier Academy e ha annunciato che investirà 100 milioni di dollari per formare 10.000 ingegneri di frontiera entro i tempi previsti. L'affermazione è diretta: il problema non sono i modelli, ma le persone in grado di implementare Claude all'interno di un'azienda operativa.
I primi gruppi sono già operativi a San Francisco, New York e Londra, e provengono da Accenture, Bain, Capgemini, Commonwealth Bank of Australia, Deloitte, McKinsey, Morgan Stanley e Novo Nordisk. Non è necessario candidarsi. La vostra azienda vi nomina e dovrete presentarvi con un progetto intitolato a Claude.
Il programma assomiglia più a una specializzazione medica che a un corso di certificazione. Prevede un'esercitazione in presenza di più giorni, una prova pratica valutata, il distintivo di Ingegnere Residente Claude, e poi 12 settimane alla guida di un'operazione sul campo con gli ingegneri di Anthropic che ti osservano. Superando nuovamente la prova, si ottiene il distintivo di Ingegnere Operativo di Frontiera. Il primo di questi distintivi, a quanto pare, viene rilasciato al termine del periodo di specializzazione.
Steve Corfield, che si occupa di partnership, sostiene che un piccolo team altamente motivato possa "trasformare un'intera azienda". Forse. Anthropic vanta già oltre 175.000 certificazioni Claude in 46.000 aziende, quindi a quanto pare il divario di talenti è ancora abbastanza ampio da giustificare un altro programma, molto più rigoroso. Un sistema basato esclusivamente sulle candidature equivale a un controllo di qualità o a una lista d'attesa molto costosa.
Apple renderà molto più difficile fornire l'accesso completo al disco a un agente di intelligenza artificiale
Apple ha comunicato agli sviluppatori che sta aggiungendo dei controlli in modo che l'accesso completo al disco di macOS possa essere concesso solo con "un'azione molto esplicita da parte dell'utente". L'autorizzazione era stata creata per consentire alle app di backup di visualizzare l'intero disco. Ora, secondo Apple, gli agenti hanno modificato il livello di rischio.
La nota dell'azienda è piuttosto allarmante. Tale modifica può esporre file, email, messaggi e cronologia di navigazione e, nel caso di un'app di comunicazione, anche i dati delle persone con cui si scambiano messaggi. "Con il progredire delle capacità e dell'autonomia degli agenti di intelligenza artificiale, i rischi associati a questo livello di accesso aumenteranno considerevolmente."
La tempistica non è affatto sottile. Questa notizia è arrivata pochi giorni dopo che Jason Aten di Inc. aveva affermato che Muse di Meta sul suo Mac era a conoscenza del contenuto dei suoi messaggi privati. Meta ha contestato l'affermazione. La sua posizione è che l'accesso a Messaggi richiede sia l'accesso completo al disco che un connettore Muse separato, entrambi opzionali. Apple non ha nominato Muse e non ha comunicato a TechCrunch la data di rilascio dei nuovi controlli.
Un vero e proprio avviso, senza data, e una discussione sul fatto che "l'utente abbia cliccato su Consenti" possa essere considerato consenso informato, visto che chi clicca è un agente. Non lo definirei ancora una soluzione. È Apple che ammette che la vecchia finestra di dialogo non è sufficiente.
Meta rende disponibile un kit open source per permetterti di costruire il tuo gadget Muse
Meta ha lanciato Muse Gadgets, un progetto open-source per hardware che interagisce con il suo agente Muse. Il progetto include il firmware e un SDK per Linux. Tra i dispositivi suggeriti ci sono un display e-ink a colori e una chiavetta da collegare alla porta HDMI di un televisore. Un Raspberry Pi o una scheda ESP32 economica sono sufficienti, dopodiché basta collegare i pulsanti e i sensori che si hanno a disposizione.
Ne hanno già costruito uno loro stessi. Nat Friedman, responsabile del prodotto presso Superintelligence Labs, ha dichiarato su X che Muse Home Link è una chiavetta USB-C che permette a Muse di connettersi alla rete domestica, consentendogli di raggiungere altoparlanti e smart TV. Meta ne ha prodotte 5.000 e le sta regalando agli abbonati a Muse fino a esaurimento scorte. Le spedizioni, ha detto, inizieranno tra qualche settimana.
Esiste un server Discord, che è gestito dalla community o dall'assistenza tecnica sotto mentite spoglie. TechCrunch ha notato che il post di Friedman ha totalizzato quasi 30.000 visualizzazioni in poche ore, ipotizzando poi che le scorte gratuite fossero già esaurite. Quest'ultima affermazione è una supposizione, non una stima precisa.
Muse avrebbe dovuto essere l'agente che prenota viaggi e compila moduli. Ora Meta lo vuole anche nell'hardware per hobbisti. Divertente, un po' folle e perfettamente in linea con l'immagine di un'azienda che vorrebbe Muse in ogni stanza.
Si prevede che Trump nominerà il capo dei servizi segreti Jay Clayton come suo responsabile per l'intelligenza artificiale, ma la Casa Bianca dice di non affrettarsi
Reuters, citando una fonte a conoscenza della decisione, ha riferito che il presidente Trump dovrebbe nominare il direttore dell'intelligence nazionale Jay Clayton come suo principale consigliere per l'intelligenza artificiale, ruolo che ha definito "zar dell'IA". Clayton già sovrintende a 18 agenzie di intelligence e manterrebbe tale incarico.
Poi la Casa Bianca ha smentito. Un portavoce ha dichiarato a Reuters che qualsiasi notizia riguardante il personale arriverà dal presidente e che "qualsiasi notizia fino ad allora è pura speculazione". Quindi si tratta di un'aspettativa basata su fonti attendibili, non di una nomina. Secondo Reuters, la CBS l'aveva riportata per prima.
Il contesto rimane incerto anche se il nome non è ancora definitivo. Trump ha affermato di volere un nuovo responsabile per l'IA e una "task force sull'IA", senza però specificare le loro funzioni. David Sacks ha ricoperto il ruolo di responsabile per l'IA all'inizio del secondo mandato, ha lasciato la Casa Bianca e continua a fornire consulenza in materia di intelligenza artificiale. Recentemente ha partecipato a un incontro con il presidente e alcuni dirigenti del settore.
Affidare la politica sull'IA al capo dell'intelligence sarebbe un segnale molto specifico. O lo sarebbe, se ciò accadesse. Finché il presidente non lo confermerà, consideriamo il titolo come una fuga di notizie con una smentita allegata.
Il gateway AI di Cloudflare ora può effettuare ricerche sul web in tempo reale
Cloudflare ha lanciato un'API di ricerca web all'interno di AI Gateway, con Ceramic.ai, Exa e Linkup come primi partner. Il problema a cui sta rispondendo è quasi divertente. Spesso gli agenti tentano di indovinare un URL e poi lo utilizzano tramite curl, ottenendo così un errore 404.
Le chiamate di ricerca compaiono negli stessi log di AI Gateway, consumano gli stessi crediti e sono soggette agli stessi controlli di accesso. Puoi utilizzare la tua chiave. Cloudflare afferma che venderà i servizi di ricerca dei partner al prezzo di listino, senza ricarichi, e segnalerà quali di essi offrono la conservazione zero dei dati.
C'è anche una questione di standard. Questi crawler devono rispettare le regole dei bot verificati di Cloudflare: identificarsi, rispettare il file robots.txt e restituire un link alla pagina utilizzata. I risultati vengono forniti tramite una chiamata REST o un binding Workers. Gli "strumenti server" nativi all'interno del gateway sono in arrivo e la ricerca web dovrebbe essere una delle prime.
Vale la pena averlo se il tuo agente è ancora ancorato al modello di formazione dell'anno scorso. Meno utile se preferisci un indice neutrale. Stai scegliendo un partner e Cloudflare è il metro di misura.
The Verge ha provato Dot di OpenAI e si è bloccato principalmente durante il controllo del bot
L'agente Dot di OpenAI, già annunciato, è stato testato da The Verge. Allison Johnson ha ricevuto un esemplare, che ha chiamato Dotty McDotface, con il piano Pro da 100 dollari al mese. In futuro è previsto il supporto per più agenti Dot. Al momento, è disponibile una macchina virtuale per un collega, in grado di aprire programmi come Blender e GIMP, con la possibilità di connetterlo al proprio computer e di utilizzarlo per effettuare chiamate.
Le commissioni personali sono andate a rotoli. Ha trovato una promozione da 100 dollari mentre prenotava un'installazione di internet, poi si è bloccato durante un controllo manuale. Nessuna carta salvata come Muse. Ha perso un tour gratuito di uno spazio di coworking e gli è stato offerto un pass giornaliero da 35 dollari. Il login di Ikea è andato in loop. Un sito di teriyaki ha bloccato il browser cloud. Alla fine è riuscito a ordinare il teriyaki, dopo che un essere umano è riuscito a inserirlo in Uber Eats.
Dategli però un sito web e una pila di file video, e la recensione cambia. Una telefonata di 10 minuti si è trasformata in un sito personale più pulito. Con l'accesso locale ha ridotto la presenza sui social e ha implementato il nuovo design. La tesi di Johnson è che Dot sia "Codex, ma per la gente comune", e anche che non sia conveniente per il suo lavoro, con un costo di 100 dollari al mese.
Quindi, il simpatico avatar è un software aziendale che può anche ordinare la cena, a patto che il sito web del ristorante non si accorga che si tratta di un bot. Un'avvertenza importante, e lei lo specifica chiaramente.
Il MIT e Sakana AI utilizzano un giudice LLM per ridurre i costi degli agenti di codice auto-miglioranti
VentureBeat ha parlato di SIFT, Recursive Self-Improvement via Fast Tree Search, un sistema sviluppato da ricercatori del MIT e di Sakana AI. La parte più costosa di un agente di codifica auto-migliorante non è la patch in sé, ma il test di ogni singola patch. Una proposta costa circa 12 centesimi. L'esecuzione di 50 task di Polyglot costa circa 6 dollari e 2,6 ore di CPU.
SIFT richiede a un altro modello di confrontare il nuovo agente, a coppie, con un massimo di circa 10 agenti performanti già presenti nell'archivio. Il giudice analizza il codice, non i risultati dei benchmark. Questi confronti (circa 4,4 centesimi ciascuno), insieme a un breve test preliminare di quattro attività, decidono chi merita di essere testato a fondo. I nuovi rami possono essere avviati prima che i test più lenti siano terminati.
Su Polyglot, un'esecuzione di o3-mini ha raggiunto il 35,1% in meno di cinque ore, 42 ore di CPU, circa 150 dollari in crediti API. Questo risultato ha superato un valore di riferimento della Darwin Gödel Machine pari al 30,7%, mentre un'esecuzione di SIFT con il giudice disattivato ha raggiunto solo il 29,8%. Con Qwen3-Coder-30B ha leggermente superato la Huxley-Gödel Machine con circa un terzo di CPU in meno.
Il risultato più eclatante è su TerminalBench. L'agente che sembrava migliore nel piccolo set di ricerca ha ottenuto una media del 28,1% sul benchmark completo. La scelta del giudice ha ottenuto una media del 36,7%. Avevano notato, dal codice stesso, che un verificatore era disattivato per impostazione predefinita. Non c'è un repository pubblico separato collegato, e hanno comunque dovuto bloccare le patch che falsificavano i test. Ovviamente.
Domande frequenti
Cos'è la Claude Frontier Academy di Anthropic?
Anthropic ha inaugurato la Claude Frontier Academy e ha annunciato un investimento di 100 milioni di dollari per formare 10.000 Frontier Deployed Engineer. L'idea di fondo è che i modelli non rappresentino il collo di bottiglia, bensì la carenza di persone in grado di implementare Claude all'interno di un'azienda. I primi corsi sono già in corso a San Francisco, New York e Londra, e coinvolgono professionisti provenienti da aziende come Accenture, Bain, Capgemini, Commonwealth Bank of Australia, Deloitte, McKinsey, Morgan Stanley e Novo Nordisk. Anthropic dichiara di aver già rilasciato oltre 175.000 certificazioni Claude a più di 46.000 aziende.
Come si ottiene il distintivo di Ingegnere di Frontiera schierato sul campo?
Non è necessario candidarsi. È la tua azienda a nominarti e dovresti presentarti con un progetto Claude a te assegnato. Il programma assomiglia più a una specializzazione medica che a un corso di certificazione. Ciò significa un'esercitazione in presenza di più giorni, una prova pratica valutata e un badge di Claude Resident Engineer, dopodiché dovrai trascorrere 12 settimane alla guida di un'implementazione reale sotto la supervisione degli ingegneri di Anthropic. Se superi anche questa prova, otterrai il badge di Frontier Deployed Engineer. Anthropic afferma che i primi di questi badge vengono rilasciati al termine del periodo di residenza.
Perché Apple sta limitando l'accesso completo al disco per gli agenti di intelligenza artificiale?
Apple ha comunicato agli sviluppatori che l'accesso completo al disco di macOS può essere concesso solo con "un'azione esplicita da parte dell'utente". L'autorizzazione è stata creata per consentire alle app di backup di visualizzare l'intero disco, ma Apple afferma che gli agenti basati sull'intelligenza artificiale hanno modificato il rischio. Possono infatti esporre file, email, messaggi, cronologia di navigazione e informazioni personali degli utenti che utilizzano un'app di comunicazione. Meta ha contestato l'affermazione secondo cui Muse leggerebbe i messaggi privati su Mac, precisando che l'accesso a Messaggi richiede l'accesso completo al disco e un connettore di attivazione separato. Apple non ha rivelato il nome di Muse né ha comunicato a TechCrunch la data di rilascio dei controlli.
Come si crea un gadget per Meta Muse?
Meta ha lanciato Muse Gadgets, un firmware open-source e un SDK Linux per dispositivi hardware che interagiscono con il suo agente Muse. Un display e-ink a colori o una chiavetta HDMI per la TV possono utilizzare un Raspberry Pi o un economico ESP32, oltre a pulsanti e sensori. Meta ha prodotto 5.000 dongle Muse Home Link, dispositivi USB-C che integrano Muse nella rete domestica per altoparlanti e smart TV. Meta li sta regalando agli abbonati a Muse fino ad esaurimento scorte. Nat Friedman ha affermato che le spedizioni inizieranno tra qualche settimana.
Trump ha nominato Jay Clayton responsabile dell'intelligenza artificiale?
La Casa Bianca non ha confermato la notizia. Reuters, citando una fonte a conoscenza della decisione, ha riferito che il presidente Trump dovrebbe nominare Jay Clayton, direttore dell'intelligence nazionale, come responsabile per l'IA. Clayton supervisiona 18 agenzie di intelligence e manterrebbe anche l'incarico di direttore dell'intelligence nazionale. Un portavoce della Casa Bianca ha dichiarato che qualsiasi notizia riguardante il personale arriverà dal presidente e che, fino ad allora, qualsiasi indiscrezione in merito è pura speculazione. David Sacks ha ricoperto il ruolo di responsabile per l'IA all'inizio del secondo mandato, ha lasciato la Casa Bianca e continua a fornire consulenza in materia.
In che modo Cloudflare AI Gateway cerca agenti di intelligenza artificiale sul web?
Cloudflare ha lanciato un'API di ricerca web all'interno di AI Gateway, con Ceramic.ai, Exa e Linkup come primi partner. È pensata per agenti di intelligenza artificiale che indovinano un URL, lo interrogano tramite curl e ottengono un errore 404 affidabile. Le chiamate di ricerca utilizzano gli stessi log, crediti e controlli di accesso, ed è possibile utilizzare la propria chiave. Cloudflare afferma che venderà la ricerca dei partner al prezzo di listino, senza alcun ricarico, e segnalerà quali partner offrono la conservazione zero dei dati. Questi crawler devono identificarsi, rispettare il file robots.txt e restituire un link alla pagina utilizzata.
Cos'è successo durante la prova pratica di Dot di OpenAI organizzata da The Verge?
Allison Johnson ha provato un Echo Dot con il piano Pro da 100 dollari al mese, con la promessa di altri dispositivi in futuro. Si tratta di un collega su una macchina virtuale in grado di aprire Blender e GIMP, e che può essere puntato verso il computer o utilizzato tramite telefono. Le commissioni non hanno superato la verifica manuale con pressione prolungata e l'accesso a Ikea, mentre un sito di cucina teriyaki ha bloccato il browser cloud finché un operatore umano non ha aperto Uber Eats. Grazie a un sito web, file video e accesso locale, una chiamata di 10 minuti si è trasformata in un sito personale più pulito, e ha permesso di realizzare un video per i social media e implementare il nuovo design.
In che modo il giudice LLM di SIFT riduce i costi di test per gli agenti di codifica?
SIFT, acronimo di Recursive Self-Improvement via Fast Tree Search, è un progetto di ricercatori del MIT e di Sakana AI. Una proposta costa circa 12 centesimi, mentre 50 task di Polyglot costano circa 6 dollari e 2,6 ore di CPU. Un giudice confronta il nuovo agente a coppie con un massimo di circa 10 agenti archiviati e analizza il codice, non i risultati dei benchmark. I confronti, al costo di circa 4,4 centesimi ciascuno, più un test preliminare con quattro task, decidono chi può eseguire il test completo. Un'esecuzione di o3-mini ha raggiunto il 35,1% su Polyglot, superando il 30,7% di un modello di riferimento Darwin Gödel Machine e il 29,8% senza il giudice.