The Neuron Times

All the AI that's fit to print

N° 272 Édition du matinMorning EditionMorgenausgabeEdizione del mattinoEdizion del mattin · Genève MARDI 29 SEPTEMBRE 2026TUESDAY, 29 SEPTEMBER 2026DIENSTAG, 29. SEPTEMBER 2026MARTEDÌ 29 SETTEMBRE 2026MARTEDÌ 29 SETTEMBRE 2026

À la Une · Sortie modèleFront Page · Model ReleaseSchlagzeilen · Modell-ReleasePrima pagina · Uscita modelloIn prima pagina · Sortida modell

Anthropic lance Claude Sonnet 5.5 : plus rapide, moins cher, à la conquête du segment médianAnthropic Launches Claude Sonnet 5.5: Faster, Cheaper, and Taking Aim at the Mid-Tier MarketAnthropic lanciert Claude Sonnet 5.5: schneller, günstiger, auf Eroberung des MittelsegmentsAnthropic lancia Claude Sonnet 5.5: più veloce, più economico, alla conquista del segmento medioAnthropic el lansa Claude Sonnet 5.5: pussee svelt, mencher car, a la conquista del segment medi

La version intermédiaire de la gamme Claude gagne 30 % en vitesse et coûte jusqu'à 30 % de moins que Sonnet 5.The mid-range model in the Claude lineup gains 30% in speed and costs up to 30% less than Sonnet 5.Die Mittelklasse der Claude-Familie gewinnt 30 % an Geschwindigkeit und kostet bis zu 30 % weniger als Sonnet 5.La versione intermedia della gamma Claude guadagna il 30% in velocità e costa fino al 30% in meno rispetto a Sonnet 5.La version intermediaria de la gamma Claude la guadagna el 30% in velocitaa e la costa fin al 30% de men rispett a Sonnet 5.

Anthropic a annoncé le 28 septembre 2026 la sortie de Claude Sonnet 5.5, présentée comme une amélioration nette de Sonnet 5 avec un double argument : un fonctionnement 30 % plus rapide et un coût réduit jusqu'à 30 % pour la majorité des charges de travail, selon l'annonce officielle du labo.On September 28, 2026, Anthropic announced the release of Claude Sonnet 5.5, presented as a clear improvement over Sonnet 5 with a two-pronged pitch: 30% faster performance and costs reduced by up to 30% for the majority of workloads, according to the lab's official announcement.Anthropic hat am Montag, 28. September 2026, die Veröffentlichung von Claude Sonnet 5.5 angekündigt, präsentiert als deutliche Verbesserung gegenüber Sonnet 5 mit einem doppelten Argument: ein 30 % schnelleres Arbeiten und um bis zu 30 % reduzierte Kosten für die Mehrheit der Workloads, gemäss der offiziellen Ankündigung des Labors.Anthropic ha annunciato il 28 settembre 2026 l'uscita di Claude Sonnet 5.5, presentata come un netto miglioramento di Sonnet 5 con un duplice argomento: un funzionamento più rapido del 30% e un costo ridotto fino al 30% per la maggior parte dei carichi di lavoro, secondo l'annuncio ufficiale del lab.Anthropic l'ha anunziaa el 28 de setember 2026 la sortida de Claude Sonnet 5.5, presentada 'me on mejorament net de Sonnet 5 con du argoment: on fonzionament el 30% pussee svelt e on cost sbassaa fin al 30% per la major part di carich de laurà, segond l'anunzi ofizial del labo.

La communauté a immédiatement débattu de la sortie : la discussion Hacker News « Sonnet 5.5 » a réuni 677 points et 450 commentaires en moins de 24 heures, une ampleur rare, comme en atteste le fil de discussion. L'enjeu pour Anthropic est de tenir le segment médian, là où se joue le volume des usages de production.The community immediately debated the release: the Hacker News discussion “Sonnet 5.5” drew 677 points and 450 comments in under 24 hours, a rare scale, as the discussion thread attests. For Anthropic, the stakes are holding the mid-tier segment, where the volume of production usage is decided.Die Community hat das Release umgehend diskutiert: Die Hacker-News-Debatte «Sonnet 5.5» versammelte innert weniger als 24 Stunden 677 Punkte und 450 Kommentare – eine seltene Dimension, wie der Diskussionsstrang belegt. Für Anthropic geht es darum, das Mittelsegment zu halten, wo sich das Volumen der Produktionseinsätze entscheidet.La comunità ha immediatamente dibattuto l'uscita: la discussione Hacker News «Sonnet 5.5» ha raccolto 677 punti e 450 commenti in meno di 24 ore, un'ampiezza rara, come testimonia il thread di discussione. La posta in gioco per Anthropic è difendere il segmento medio, dove si gioca il volume degli usi in produzione.La comunitaa l'ha subet debattuu de la sortida: la discussion Hacker News «Sonnet 5.5» l'ha regolt 677 pont e 450 comenti in men de 24 or, onaampiezza rara, 'me el testimony el fil de discussion. El post per Anthropic l'è de tegnì el segment medi, là indoa el se giuga el volum di usagg de produzion.

Page 1 — Page 1 — Seite 1 — Pagina 1 — Pagina 1 — À la Une — Modèles & FrontièreFront Page — Models & FrontierFrontseite — Modelle & GrenzeIn Prima Pagina — Modelli & FrontieraA la Prima — Modèj & Fruntiera

I. Modèles & frontièreModels & frontierModelle & GrenzeModelli & frontieraModèj & fruntiera

OpenAI

OpenAI

OpenAI

OpenAI

OpenAI

GPT-6 Astra traite un classeur fiscal de 50 onglets deux fois plus vite que GPT-5.6 SolGPT-6 Astra Processes a 50-Tab Tax Workbook Twice as Fast as GPT-5.6 SolGPT-6 Astra verarbeitet ein Steuer-Workbook mit 50 Tabellenblättern doppelt so schnell wie GPT-5.6 SolGPT-6 Astra elabora un file fiscale di 50 schede due volte più velocemente di GPT-5.6 SolGPT-6 Astra el trata on raccoglieitor fiscal de 50 schedi du voeulte pussee svelt de GPT-5.6 Sol

Le 28 septembre 2026, OpenAI détaille le cas Basis : GPT-6 Astra a complété un classeur fiscal de 50 onglets deux fois plus vite que GPT-5.6 Sol, avec une meilleure compréhension de l'intention utilisateur, selon l'étude de cas publiée par OpenAI. Le point notable est la fiabilité perçue : l'entreprise dit gagner en confiance pour des usages concrets de comptabilité.
On September 28, 2026, OpenAI detailed the Basis case: GPT-6 Astra completed a 50-tab tax workbook twice as fast as GPT-5.6 Sol, with a better grasp of user intent, according to the case study published by OpenAI. The notable point is perceived reliability: the company says it is gaining confidence for concrete accounting use cases.
Am 28. September 2026 beschreibt OpenAI den Anwendungsfall Basis: GPT-6 Astra hat ein 50 Tabellenblätter umfassendes Steuer-Workbook doppelt so schnell vervollständigt wie GPT-5.6 Sol, mit besserem Verständnis der Benutzerabsicht, gemäss der vom Unternehmen publizierten Fallstudie. Bemerkenswert ist die wahrgenommene Zuverlässigkeit: Das Unternehmen attestiert sich mehr Vertrauen für konkrete Buchhaltungseinsätze.
Il 28 settembre 2026 OpenAI dettaglia il caso Basis: GPT-6 Astra ha completato un file fiscale di 50 schede due volte più velocemente di GPT-5.6 Sol, con una migliore comprensione dell'intenzione dell'utente, secondo il caso di studio pubblicato da OpenAI. Il punto notevole è l'affidabilità percepita: l'azienda dichiara di acquisire maggiore fiducia per usi concreti di contabilità.
El 28 de setember 2026, OpenAI el detaja el cas Basis: GPT-6 Astra l'ha completaa on raccoglieitor fiscal de 50 schedi du voeult pussee svelt de GPT-5.6 Sol, con ona comprension mej de l'intenzion de l'utent, segond el studi de cas publicaa de OpenAI. El pont notabil l'è la fiabilitaa percepida: l'azienda la dis de guadagnà fiducia per di usagg concret de contabilitaa.

Google

Google

Google

Google

Google

Google met en avant quatre constructions autour de Gemini 3.8 FlashGoogle Showcases Four Builds Around Gemini 3.8 FlashGoogle stellt vier Konstruktionen rund um Gemini 3.8 Flash in den VordergrundGoogle mette in evidenza quattro realizzazioni attorno a Gemini 3.8 FlashGoogle el met in pruma quatter costruzion torno a Gemini 3.8 Flash

Le 28 septembre 2026, Google publie le retour d'expérience de quatre développeurs construisant sur Gemini 3.8 Flash, décrit comme le « workhorse » de la gamme et lancé début septembre, via un billet dédié sur son blog. Google mise sur ce segment d'efficience pour ancrer le modèle dans les outils de production quotidiens des développeurs.
On September 28, 2026, Google published lessons from four developers building on Gemini 3.8 Flash, described as the “workhorse” of the lineup and launched in early September, via a dedicated blog post. Google is betting on this efficiency segment to anchor the model in developers' daily production tools.
Am 28. September 2026 publiziert Google Erfahrungsberichte von vier Entwicklern, die auf Gemini 3.8 Flash bauen, beschrieben als das «Workhorse» der Familie und Anfang September lanciert, via einem eigenen Blogbeitrag. Google setzt auf dieses Effizienzsegment, um das Modell in den täglichen Produktionswerkzeugen der Entwickler zu verankern.
Il 28 settembre 2026 Google pubblica il ritorno d'esperienza di quattro sviluppatori che costruiscono su Gemini 3.8 Flash, descritto come il «workhorse» della gamma e lanciato a inizio settembre, tramite un post dedicato sul suo blog. Google punta su questo segmento di efficienza per ancorare il modello negli strumenti di produzione quotidiani degli sviluppatori.
El 28 de setember 2026, Google el publica el ritorn d'esperienza de quatter desviluppador che costruissen sora Gemini 3.8 Flash, descritt 'me el «workhorse» de la gamma e largaa ai prumaa de setember, cont on billet dedicaa sora el sò blog. Google el scommett sora chell segment de eficienza là per ancoraà el modell in di strument de produzion cotidian di desviluppador.

Hugging Face

Hugging Face

Hugging Face

Hugging Face

Hugging Face

Holo4 : des agents de computer-use généralistes publiés sur Hugging FaceHolo4: General-Purpose Computer-Use Agents Released on Hugging FaceHolo4: generalistische Computer-Use-Agenten auf Hugging Face veröffentlichtHolo4: agenti di computer-use generalisti pubblicati su Hugging FaceHolo4: di agent de computer-use generalista publicaa sora Hugging Face

H Company publie le 28 septembre 2026 Holo4, un modèle d'agents généralistes de computer-use, annoncé sur le blog de Hugging Face. L'arrivée de la publication sur la plateforme open signalant l'ambition du projet de rendre les agents d'usage d'ordinateur accessibles au-delà des API propriétaires.
H Company released Holo4 on September 28, 2026, a general-purpose computer-use agent model, announced on the Hugging Face blog. Its publication on the open platform signals the project's ambition to make computer-use agents accessible beyond proprietary APIs.
H Company veröffentlicht am 28. September 2026 Holo4, ein Modell generalistischer Computer-Use-Agenten, angekündigt auf dem Blog von Hugging Face. Die Publikation auf der offenen Plattform signaliert den Anspruch des Projekts, Computer-Use-Agenten jenseits proprietärer APIs zugänglich zu machen.
H Company pubblica il 28 settembre 2026 Holo4, un modello di agenti generalisti di computer-use, annunciato sul blog di Hugging Face. La pubblicazione sulla piattaforma open segnala l'ambizione del progetto di rendere gli agenti d'uso del computer accessibili oltre le API proprietarie.
H Company el publica el 28 de setember 2026 Holo4, on modell de agent generalista de computer-use, anunziaa sora el blog de Hugging Face. La rivada de la publicazion sora la plataforma open la segnala l'ambizion del progett de rend i agent d'usagg de computer acesibei oltra di API proprietari.

Industrie

Industry

Industrie

Industria

Industria

World Labs rejoint AMD : l'IA des mondes 3D se consolide côté siliconWorld Labs Joins AMD: 3D-World AI Consolidates on the Silicon SideWorld Labs geht zu AMD: Die KI der 3D-Welten konsolidiert sich auf der SiliziumseiteWorld Labs entra in AMD: l'IA dei mondi 3D si consolida sul fronte siliconWorld Labs el va dent a AMD: l'IA di mond 3D la se consolida de part del silicon

World Labs, la startup de Fei-Fei Li spécialisée dans les mondes 3D générés, a annoncé le 28 septembre 2026 rejoindre AMD, selon le communiqué publié par l'entreprise. L'acquisition a suscité 238 points sur Hacker News, où les observateurs y lisent la volonté d'AMD de sécuriser des capacités de génération 3D pour ses futures plateformes.
World Labs, Fei-Fei Li's startup specializing in generated 3D worlds, announced on September 28, 2026 that it is joining AMD, according to the company's announcement. The acquisition drew 238 points on Hacker News, where observers read it as AMD's intent to secure 3D generation capabilities for its future platforms.
World Labs, das von Fei-Fei Li mitgegründete Startup für generierte 3D-Welten, hat am 28. September 2026 den Anschluss an AMD angekündigt, gemäss der Mitteilung des Unternehmens. Die Übernahme brachte es auf 238 Punkte auf Hacker News, wo Beobachter darin den Willen von AMD lesen, 3D-Generierungsfähigkeiten für künftige Plattformen zu sichern.
World Labs, la startup di Fei-Fei Li specializzata nei mondi 3D generati, ha annunciato il 28 settembre 2026 di entrare a far parte di AMD, secondo il comunicato pubblicato dall'azienda. L'acquisizione ha suscitato 238 punti su Hacker News, dove gli osservatori vi leggono la volontà di AMD di assicurarsi capacità di generazione 3D per le sue future piattaforme.
World Labs, la startup de Fei-Fei Li specializzada in di mond 3D generaa, l'ha anunziaa el 28 de setember 2026 de unìss a AMD, segond el comunegaa publicaa de l'azienda. L'aquisizion l'ha faa nass 238 pont sora Hacker News, indoa i osservador leghen la voeulta de AMD de segurà di capacità de generazion 3D per i sò futur piattaform.

Page 2 — Page 2 — Seite 2 — Pagina 2 — Pagina 2 — Le Cahier TechniqueThe Technical DeskDas Technische DossierIl Quaderno TecnicoEl Quadren Tecnegh

II. Harnais & outilsHarnesses & toolsHarness & WerkzeugeHarness & strumentiArnees & strument

Outils

Tools

Werkzeuge

Strumenti

Strument

Cloudflare lance Cf, une CLI agentique pour piloter son API en langage naturelCloudflare Launches Cf, an Agentic CLI to Drive Its API in Natural LanguageCloudflare lanciert Cf, eine agentische CLI zur Steuerung der eigenen API in natürlicher SpracheCloudflare lancia Cf, una CLI agentica per pilotare la sua API in linguaggio naturaleCloudflare el lansa Cf, ona CLI agentica per pilotà la sò API in lengoeu natural

Cloudflare a lancé le 28 septembre 2026 « Cf », une CLI agentique dédiée à son API, annonce le billet de l'entreprise. L'outil ambitionne de remplacer la mémorisation des flags par du langage naturel, et la discussion a réuni 138 points et 60 commentaires sur Hacker News, où les développeurs ont comparé l'approche aux assistants CLI génériques.
On September 28, 2026, Cloudflare launched “Cf,” an agentic CLI dedicated to its API, the company's post announces. The tool aims to replace memorizing flags with natural language, and the discussion drew 138 points and 60 comments on Hacker News, where developers compared the approach to generic CLI assistants.
Cloudflare hat am 28. September 2026 «Cf» lanciert, eine agentische CLI für die eigene API, wie der Blogbeitrag des Unternehmens ankündigt. Das Werkzeug will das Auswendiglernen von Flags durch natürliche Sprache ersetzen; die Diskussion versammelte 138 Punkte und 60 Kommentare auf Hacker News, wo Entwickler den Ansatz mit generischen CLI-Assistenten verglichen.
Cloudflare ha lanciato il 28 settembre 2026 «Cf», una CLI agentica dedicata alla sua API, annuncia il post dell'azienda. Lo strumento ambisce a sostituire la memorizzazione dei flag con il linguaggio naturale, e la discussione ha riunito 138 punti e 60 commenti su Hacker News, dove gli sviluppatori hanno paragonato l'approccio agli assistenti CLI generici.
Cloudflare l'ha largaa el 28 de setember 2026 «Cf», ona CLI agentica dedicada a la sò API, el nunzia el billet de l'azienda. El strument el vœurria sostituì la memorizzazion di flag cont el lengoeu natural, e la discussion l'ha regolt 138 pont e 60 comenti sora Hacker News, indoa i desviluppador hann confrontaa l'aprossima ai assistent CLI generich.

Open source

Open source

Open Source

Open source

Open source

Jeff : des modèles de décision de 0,8 milliard de paramètres entraînés à la maison, à ~30 msJeff: 0.8-Billion-Parameter Decision Models Trained at Home, at ~30 msJeff: Entscheidungsmodelle mit 0,8 Milliarden Parametern, zu Hause trainiert, bei ~30 msJeff: modelli decisionali da 0,8 miliardi di parametri addestrati in casa, a ~30 msJeff: di modèj de decision de 0,8 milion de parameter aduraa in cà, a ~30 ms

Un développeur indépendant publie le 28 septembre 2026 Jeff, une famille de modèles de décision de 0,8 milliard de paramètres compatibles avec le format Jev, entraînés à domicile et affichant une latence d'environ 30 ms, sur le dépôt GitHub du projet. La présentation a accumulé 395 points et 150 commentaires sur Hacker News, où le routage ultra-léger a nourri le débat sur la viabilité des petits modèles dédiés au choix de routeur.
An independent developer released Jeff on September 28, 2026, a family of 0.8-billion-parameter decision models compatible with the Jev format, trained at home and showing roughly 30 ms latency, on the project's GitHub repository. The showcase racked up 395 points and 150 comments on Hacker News, where the ultra-light routing fueled the debate over the viability of small models dedicated to router selection.
Ein unabhängiger Entwickler veröffentlicht am 28. September 2026 Jeff, eine Familie von Entscheidungsmodellen mit 0,8 Milliarden Parametern, kompatibel mit dem Jev-Format, zu Hause trainiert und mit einer Latenz von rund 30 ms, im GitHub-Repository des Projekts. Die Vorstellung akkumulierte 395 Punkte und 150 Kommentare auf Hacker News, wo das ultraleichte Routing die Debatte über die Tragfähigkeit kleiner Router-Auswahlmodelle befeuerte.
Uno sviluppatore indipendente pubblica il 28 settembre 2026 Jeff, una famiglia di modelli decisionali da 0,8 miliardi di parametri compatibili con il formato Jev, addestrati in casa e con una latenza di circa 30 ms, sul repository GitHub del progetto. La presentazione ha accumulato 395 punti e 150 commenti su Hacker News, dove l'instradamento ultraleggero ha alimentato il dibattito sulla fattibilità dei piccoli modelli dedicati alla scelta del router.
On desviluppador independent el pubblica el 28 de setember 2026 Jeff, ona fameja de modèj de decision de 0,8 milion de parameter compatibij cont el format Jev, aduraa in cà e cont ona latenza de circa 30 ms, sora el deposit GitHub del progett. La presentazion l'ha regoltaa 395 pont e 150 comenti sora Hacker News, indoa el routing ultra-legger l'ha nutrii el dibattit sora la vitalità di piscinitt modèj dedicaa a la scerna del router.

Edge

Edge

Edge

Edge

Edge

Un cluster d'ESP32-S3 exécute un LLM BitNet en 1,58 bitAn ESP32-S3 Cluster Runs a 1.58-Bit BitNet LLMEin Cluster aus ESP32-S3 führt ein BitNet-LLM mit 1,58 Bit ausUn cluster di ESP32-S3 esegue un LLM BitNet a 1,58 bitOn cluster de ESP32-S3 el fonziona on LLM BitNet in 1,58 bit

Un projet publié le 28 septembre 2026 fait tourner un modèle de langage BitNet quantifié en 1,58 bit sur un cluster de microcontrôleurs ESP32-S3, documenté sur GitHub. L'exploit, relayé avec 59 points sur Hacker News, illustre la marge de compression extrême des architectures ternaires sur du matériel dépourvu de GPU.
A project published on September 28, 2026 runs a BitNet language model quantized to 1.58 bits on a cluster of ESP32-S3 microcontrollers, documented on GitHub. The feat, picked up with 59 points on Hacker News, illustrates the extreme compression headroom of ternary architectures on hardware without GPUs.
Ein am 28. September 2026 veröffentlichtes Projekt lässt ein auf 1,58 Bit quantisiertes BitNet-Sprachmodell auf einem Cluster aus ESP32-S3-Mikrocontrollern laufen, auf GitHub dokumentiert. Die Leistung, mit 59 Punkten auf Hacker News aufgegriffen, illustriert den extremen Kompressionsspielraum ternärer Architekturen auf Hardware ohne GPU.
Un progetto pubblicato il 28 settembre 2026 fa girare un modello linguistico BitNet quantizzato a 1,58 bit su un cluster di microcontrollori ESP32-S3, documentato su GitHub. L'impresa, ripresa con 59 punti su Hacker News, illustra il margine di compressione estrema delle architetture ternarie su hardware privo di GPU.
On progett publicaa el 28 de setember 2026 el fa girà on modell de lengoeu BitNet quantificaa in 1,58 bit sora on cluster de microcontrador ESP32-S3, documentaa sora GitHub. L'impreza, relizada cont 59 pont sora Hacker News, la illustra el spazzi de compression estrem di architettur ternari sora hardware senza GPU.

Page 3 — Page 3 — Seite 3 — Pagina 3 — Pagina 3 — La RechercheThe Research PageDie ForschungLa RicercaLa Ricerca

III. Papers & labosPapers & labsPapers & LaborePaper & laboratoriPapée & labo

Papier du jour

Paper of the Day

Papier des Tages

Paper del giorno

Papée del dì

FlyBy : apprendre aux petits modèles de raisonnement à savoir quand penser ne suffit plusFlyBy: Teaching Small Reasoning Models to Know When Thinking Alone Is No Longer EnoughFlyBy: Kleinen Reasoning-Modellen beibringen, wann Denken allein nicht mehr genügtFlyBy: insegnare ai piccoli modelli di ragionamento a sapere quando pensare non basta piùFlyBy: imparà ai piscinitt modèj de resonament a savè quand che pensà no el basta ancmò

Des chercheurs de KAIST AI publient FlyBy, un cadre d'interrogation sélective qui distingue goulots d'exécution et goulots de connaissance dans les petits modèles de raisonnement : quand le modèle atteint sa limite paramétrique, il interroge un modèle plus fort. Sur 1 158 problèmes difficiles et six benchmarks, FlyBy-4B atteint 45,96 % en pass@8, surpassant Qwen3-14B (41,64 %) pour un coût de service 2,7 fois inférieur, selon le papier publié le 28 septembre 2026. Le papier a récolté 16 votes sur HF Daily Papers, le plus haut score du jour.
Researchers at KAIST AI publish FlyBy, a selective-querying framework that distinguishes execution bottlenecks from knowledge bottlenecks in small reasoning models: when the model hits its parametric limit, it queries a stronger model. Across 1,158 hard problems and six benchmarks, FlyBy-4B reaches 45.96% in pass@8, outperforming Qwen3-14B (41.64%) at 2.7 times lower serving cost, according to the paper published on September 28, 2026. The paper gathered 16 votes on HF Daily Papers, the highest score of the day.
Forschende des KAIST AI veröffentlichen FlyBy, ein Framework zur selektiven Befragung, das Ausführungsengpässe von Wissensengpässen in kleinen Reasoning-Modellen unterscheidet: Erreicht das Modell seine parametrische Grenze, befragt es ein stärkeres Modell. Auf 1 158 schwierigen Problemen und sechs Benchmarks erreicht FlyBy-4B 45,96 % bei pass@8 und übertrifft Qwen3-14B (41,64 %) bei 2,7-fach geringeren Betriebskosten, gemäss dem am 28. September 2026 veröffentlichten Papier. Es holte 16 Stimmen auf HF Daily Papers – der Tageshöchstwert.
Ricercatori del KAIST AI pubblicano FlyBy, un quadro di interrogazione selettiva che distingue i colli di bottiglia di esecuzione da quelli di conoscenza nei piccoli modelli di ragionamento: quando il modello raggiunge il suo limite parametrico, interroga un modello più forte. Su 1.158 problemi difficili e sei benchmark, FlyBy-4B raggiunge il 45,96% in pass@8, superando Qwen3-14B (41,64%) a un costo di servizio 2,7 volte inferiore, secondo il paper pubblicato il 28 settembre 2026. Il paper ha raccolto 16 voti su HF Daily Papers, il punteggio più alto della giornata.
Di resercador de KAIST AI publiquen FlyBy, on quadro de interrogazion sceltiva che 'l destingh tra goll d'esecuzion e goll de conossenza in di piscinitt modèj de resonament: quand che 'l modell el riva al sò limit parametregh, el domanda a on modell pussee fort. Sora 1158 problema difizij e ses benchmark, FlyBy-4B el riva al 45,96% in pass@8, con pussee de Qwen3-14B (41,64%) per on cost de servizzi 2,7 voeulte inferior, segond el papée publicaa el 28 de setember 2026. El papée l'ha regolt 16 voet sora HF Daily Papers, el pussee volt pont del dì.

Inférence

Inference

Inferenz

Inferenza

Inferenza

Partager le cache KV entre agents : deux travaux de l'Université nationale de Séoul divise le coût d'inférenceSharing the KV Cache Across Agents: Two Papers from Seoul National University Cut Inference CostsDen KV-Cache zwischen Agenten teilen: zwei Arbeiten der Seoul National University halbieren die InferenzkostenCondividere la cache KV tra agenti: due lavori dell'Università nazionale di Seoul dimezzano il costo d'inferenzaCondivid el cache KV tra agent: du laurà de l'Universitaa nazional de Seul i sbassen el cost d'inferenza

Deux papiers du SNU VLSI Lab, publiés le 28 septembre 2026, s'attaquent au coût du cache KV dans les systèmes multi-agents partageant un contexte : KVCMAS corrige les déviations de cache entre agents via des états de faible rang, offrant un TTFT 2,0 fois plus rapide et une mémoire GPU de pointe réduite jusqu'à 3,7 fois, selon le premier papier ; PReCache, son pendant multi-LoRA, accélère le TTFT jusqu'à 3,1 fois sans entraînement additionnel.
Two papers from the SNU VLSI Lab, published on September 28, 2026, tackle the cost of the KV cache in multi-agent systems sharing context: KVCMAS corrects cache drift between agents via low-rank states, delivering a 2.0x faster TTFT and peak GPU memory reduced by up to 3.7 times, according to the first paper; PReCache, its multi-LoRA counterpart, speeds up TTFT by up to 3.1 times without additional training.
Zwei Papier des SNU VLSI Lab, veröffentlicht am 28. September 2026, setzen sich mit den Kosten des KV-Cache in Multi-Agenten-Systemen mit gemeinsamem Kontext auseinander: KVCMAS korrigiert Cache-Abweichungen zwischen Agenten mittels niedrigdimensionaler Zustände und bietet einen 2,0-fach schnelleren TTFT sowie eine um bis zu Faktor 3,7 reduzierte GPU-Spitzenbelegung, gemäss dem ersten Papier; PReCache, sein multi-LoRA-Gegenstück, beschleunigt den TTFT um bis zu Faktor 3,1 ohne zusätzliches Training.
Due paper del SNU VLSI Lab, pubblicati il 28 settembre 2026, affrontano il costo della cache KV nei sistemi multi-agente che condividono un contesto: KVCMAS corregge le deviazioni di cache tra agenti tramite stati a basso rango, offrendo un TTFT 2,0 volte più rapido e una memoria GPU di picco ridotta fino a 3,7 volte, secondo il primo paper; PReCache, il suo corrispondente multi-LoRA, accelera il TTFT fino a 3,1 volte senza addestramento aggiuntivo.
Du papée del SNU VLSI Lab, publicaa el 28 de setember 2026, i se pero in sul cost del cache KV in di sistema multi-agent che condividen on contest: KVCMAS el correz i deviazion de cache tra agent cont di stat de bass rang, con on TTFT 2,0 voeulte pussee svelt e ona memoria GPU de ponta sbassada fin a 3,7 voeulte, segond el primm papée; PReCache, el sò oponennt multi-LoRA, el sbassa el TTFT fin a 3,1 voeulte senza adruament adizional.

Architecture

Architecture

Architektur

Architettura

Architettura

TaH2 : le looping adaptatif améliore de 53 % la pente de test-time scalingTaH2: Adaptive Looping Improves the Test-Time Scaling Slope by 53%TaH2: Adaptive Looping verbessert die Test-Time-Scaling-Steigung um 53 %TaH2: il looping adattivo migliora del 53% la pendenza del test-time scalingTaH2: el looping adativ el mejora del 53% la pendenza de test-time scaling

TaH2, un transformer en boucle adaptatif de l'université Tsinghua, apprend à n'appliquer des itérations supplémentaires qu'aux tokens qui en bénéficient. Sur les benchmarks AIME, il améliore la pente précision-calcul de 53 % (2,74 contre 1,79) par rapport à un modèle non bouclé et dépasse sa précision maximale d'environ 3,4 points à calcul égal, selon le papier publié le 28 septembre 2026, dont le code est ouvert.
TaH2, an adaptive-looping transformer from Tsinghua University, learns to apply extra iterations only to the tokens that benefit from them. On the AIME benchmarks, it improves the accuracy-compute slope by 53% (2.74 versus 1.79) compared to a non-looped model and exceeds its maximum accuracy by about 3.4 points at equal compute, according to the paper published on September 28, 2026, whose code is open-sourced.
TaH2, ein adaptiv schleifender Transformer der Tsinghua-Universität, lernt, zusätzliche Iterationen nur auf Tokens anzuwenden, die davon profitieren. Auf den AIME-Benchmarks verbessert es die Genauigkeits-Rechen-Steigung um 53 % (2,74 gegenüber 1,79) im Vergleich zu einem nicht schleifenden Modell und übertrifft dessen maximale Genauigkeit bei gleicher Rechenleistung um rund 3,4 Punkte, gemäss dem am 28. September 2026 veröffentlichten Papier, dessen Code offengelegt ist.
TaH2, un transformer a loop adattivo dell'università Tsinghua, impara ad applicare iterazioni supplementari solo ai token che ne beneficiano. Sui benchmark AIME, migliora la pendenza precisione-calcolo del 53% (2,74 contro 1,79) rispetto a un modello senza loop e supera la sua precisione massima di circa 3,4 punti a parità di calcolo, secondo il paper pubblicato il 28 settembre 2026, il cui codice è aperto.
TaH2, on transformer in buscia adativ de l'universitaa Tsinghua, el imprenda a aplicà iterazion suplementar domà ai token che ghe van benefizzi. Sora i benchmark AIME, el mejora la pendenza precision-cass del 53% (2,74 contra 1,79) rispett a on modell minga in buscia e 'l passa la sò precision massima de circa 3,4 pont a cass istess, segond el papée publicaa el 28 de setember 2026, cont el codes duvert.

Apple ML

Apple ML

Apple ML

Apple ML

Apple ML

Apple resserre les taux de convergence de l'optimisation fédéréeApple Tightens Convergence Rates for Federated OptimizationApple verschärft die Konvergenzraten der föderierten OptimierungApple stringe i tassi di convergenza dell'ottimizzazione federataApple el strenz i tass de convergenza de l'ottimizzazion federada

Apple Research publie le 28 septembre 2026 des bornes de convergence améliorées pour les inégalités variationnelles fédérées, comblant l'écart entre l'optimisation fédérée de problèmes à selle et les bornes de pointe connues pour l'optimisation convexe fédérée, dans un papier sur son site de recherche. Le travail alimente l'axe apprendre-sur-appareil du labo, là où la coordination distribuée sans centralisation des données reste le goulot théorique.
Apple Research published on September 28, 2026 improved convergence bounds for federated variational inequalities, closing the gap between federated optimization of saddle problems and the state-of-the-art bounds known for federated convex optimization, in a paper on its research site. The work feeds the lab's on-device learning agenda, where distributed coordination without centralizing data remains the theoretical bottleneck.
Apple Research veröffentlicht am 28. September 2026 verbesserte Konvergenzschranken für föderierte variationelle Ungleichungen und schliesst damit die Lücke zwischen der föderierten Optimierung von Sattelpunktproblemen und den bekannten State-of-the-Art-Schranken der föderierten konvexen Optimierung, in einem Papier auf seiner Forschungsseite. Die Arbeit speist die On-Device-Lernachse des Labors, wo die verteilte Koordination ohne Datenzentralisierung der theoretische Engpass bleibt.
Apple Research pubblica il 28 settembre 2026 dei limiti di convergenza migliorati per le disuguaglianze variazionali federate, colmando il divario tra l'ottimizzazione federata di problemi di sella e i limiti di punta noti per l'ottimizzazione convessa federata, in un paper sul suo sito di ricerca. Il lavoro alimenta l'asse apprendimento-su-dispositivo del lab, dove la coordinazione distribuita senza centralizzazione dei dati rimane il collo di bottiglia teorico.
Apple Research el pubblica el 28 de setember 2026 di born de convergenza mejoraa per i ineguajanzion variazional federad, cont el colmà el spazzi tra l'ottimizzazion federada di problema a sella e i born de punta cognossuu per l'ottimizzazion convesa federada, in d'on papée sora el sò sit de ricerca. El laurà el alimenta l'ass imparà-sura-dispositiv del labo, là indoa la coordinazion distribuida senza centralizzazion di dacc la resta el goll teoregh.

Page 4 — Page 4 — Seite 4 — Pagina 4 — Pagina 4 — La Communauté & ÉditoCommunity & EditorialDie Community & das EditorialLa Comunità & EditorialeLa Comunitaa & Editorial

IV. Communauté & éditoCommunity & editorialCommunity & EditorialComunità & editorialeComunitaa & editorial

Débat

Debate

Debatte

Dibattito

Dibattit

« Il est temps d'enquêter sur les labos d'IA » : l'appel de Cal Newport enflamme la communauté“It Is Time to Investigate the AI Labs”: Cal Newport's Call Sets the Community Ablaze«Es ist Zeit, die KI-Labore zu untersuchen»: Cal Newports Aufruf entflammt die Community«È tempo di indagare sui lab di IA»: l'appello di Cal Newport infiamma la comunità«L'è temp de fà ona recerca sora i labo de IA»: l'apell de Cal Newport el infiamma la comunitaa

L'essayiste Cal Newport plaide le 28 septembre 2026 pour une enquête publique sur les laboratoires d'IA, dans un texte qui a réuni 374 points et 136 commentaires sur Hacker News et original publié sur son site. Son argument : les promesses de capacités imminentes formulées par les labos relèvent d'affirmations invérifiables qu'aucune instance indépendante n'évalue.
Essayist Cal Newport argued on September 28, 2026 for a public investigation into AI laboratories, in a piece that drew 374 points and 136 comments on Hacker News, with the original published on his site. His argument: the labs' promises of imminent capabilities amount to unverifiable claims that no independent body evaluates.
Der Essayist Cal Newport plädiert am 28. September 2026 für eine öffentliche Untersuchung der KI-Labore, in einem Text, der 374 Punkte und 136 Kommentare auf Hacker News versammelte; das Original erschien auf seiner Website. Sein Argument: Die von den Laboren formulierten Versprechen unmittelbarer Fähigkeiten sind nicht überprüfbare Behauptungen, die keine unabhängige Instanz bewertet.
Il saggista Cal Newport plaide il 28 settembre 2026 per un'inchiesta pubblica sui laboratori di IA, in un testo che ha riunito 374 punti e 136 commenti su Hacker News e originale pubblicato sul suo sito. Il suo argomento: le promesse di capacità imminenti formulate dai lab sono affermazioni inverificabili che nessuna istanza indipendente valuta.
El sagista Cal Newport el defensa el 28 de setember 2026 ona recerca publica sora i laboratori de IA, in d'on test che 'l ha regolt 374 pont e 136 comenti sora Hacker News e original publicaa sora el sò sit. El sò argoment: i promess de capacità iminent faa di labo i hinn afermazion minga verificabij che nissuna instanza independent la valuta.

Philanthropie

Philanthropy

Philanthropie

Filantropia

Filantropia

OpenAI double la mise sur le journalisme local avec 5 millions de dollars pour le programme LenfestOpenAI Doubles Down on Local Journalism with $5 Million for the Lenfest ProgramOpenAI verdoppelt beim lokalen Journalismus: 5 Millionen Dollar für das Lenfest-ProgrammOpenAI raddoppia la posta sul giornalismo locale con 5 milioni di dollari per il programma LenfestOpenAI el raddoppia la posta sora el giornalism local cont 5 milion de dollar per el programa Lenfest

OpenAI élargit le 28 septembre 2026 son soutien au programme Lenfest AI Collaborative avec 5 millions de dollars de financement et jusqu'à 5 millions de dollars de crédits logiciels et d'ingénierie, selon l'annonce. Le programme vise à équiper des rédactions locales américaines en outils d'IA, dans la continuité des partenariats presse du labo.
On September 28, 2026, OpenAI expanded its support for the Lenfest AI Collaborative with $5 million in funding and up to $5 million in software and engineering credits, according to the announcement. The program aims to equip local American newsrooms with AI tools, in line with the lab's press partnerships.
OpenAI erweitert am 28. September 2026 seine Unterstützung für das Lenfest AI Collaborative mit 5 Millionen Dollar Finanzierung sowie bis zu 5 Millionen Dollar an Software- und Engineering-Guthaben, gemäss der Ankündigung. Das Programm zielt darauf ab, lokale US-Redaktionen mit KI-Werkzeugen auszustatten, in Fortsetzung der Pressepartnerschaften des Labors.
OpenAI amplia il 28 settembre 2026 il suo sostegno al programma Lenfest AI Collaborative con 5 milioni di dollari di finanziamento e fino a 5 milioni di dollari di crediti software e di ingegneria, secondo l'annuncio. Il programma mira a dotare le redazioni locali americane di strumenti di IA, in continuità con le partnership stampa del lab.
OpenAI el slarga el 28 de setember 2026 el sò sostegn al programa Lenfest AI Collaborative cont 5 milion de dollar de finanzament e fin a 5 milion de dollar de credit software e d'ingegneria, segond l'anunzi. El programma el mira a dotà di redazion locai merican de strument de IA, in de la continuitaa di partenariad de stampa del labo.

Communauté

Community

Community

Comunità

Comunitaa

Le chiffre du jour : 450 commentaires pour Sonnet 5.5 sur Hacker NewsNumber of the Day: 450 Comments for Sonnet 5.5 on Hacker NewsDie Zahl des Tages: 450 Kommentare zu Sonnet 5.5 auf Hacker NewsIl numero del giorno: 450 commenti per Sonnet 5.5 su Hacker NewsEl numer del dì: 450 comenti per Sonnet 5.5 sora Hacker News

La sortie de Sonnet 5.5 a généré l'une des discussions les plus denses de l'année sur Hacker News — 677 points et 450 commentaires en une journée. Au-delà des benchmarks, c'est la structure de prix qui focalise l'attention : une baisse de 30 % combinée à un gain de vitesse de 30 % redessine le point mort économique du développement assisté par IA.
The Sonnet 5.5 release generated one of the year's densest discussions on Hacker News — 677 points and 450 comments in a single day. Beyond benchmarks, it is the pricing structure that draws attention: a 30% price cut combined with a 30% speed gain redraws the economic breakeven point for AI-assisted development.
Das Release von Sonnet 5.5 hat eine der dichtesten Diskussionen des Jahres auf Hacker News generiert – 677 Punkte und 450 Kommentare an einem Tag. Jenseits der Benchmarks ist es die Preisstruktur, die die Aufmerksamkeit bündelt: Eine Preissenkung von 30 % kombiniert mit einem Geschwindigkeitsgewinn von 30 % zeichnet den wirtschaftlichen Break-even-Punkt der KI-gestützten Entwicklung neu.
L'uscita di Sonnet 5.5 ha generato una delle discussioni più dense dell'anno su Hacker News — 677 punti e 450 commenti in una giornata. Al di là dei benchmark, è la struttura dei prezzi a catalizzare l'attenzione: un ribasso del 30% combinato a un guadagno di velocità del 30% ridisegna il punto di pareggio economico dello sviluppo assistito da IA.
La sortida de Sonnet 5.5 l'ha generaa vuna di discussion pussee dens de l'ann sora Hacker News — 677 pont e 450 comenti in vun dì. Oltra di benchmark, l'è la struttura di prezzi che la concentra l'atenzion: ona sbassada del 30% combinada cont on guadagn de velocitaa del 30% la redesigneda el pont mort economegh del desvilupp assistii de IA.

Édito

Editorial

Editorial

Editoriale

Editorial

Édito — Quand la sécurité des agents descend dans le siliciumEditorial — When Agent Security Descends into SiliconEditorial — Wenn die Sicherheit der Agenten ins Silizium hinabsteigtEditoriale — Quando la sicurezza degli agenti scende nel siliconEditorial — Quand che la sicurezza di agent la scenn in del silicon

Trois signaux du 28 septembre 2026 dessinent une même trajectoire : Anthropic et NVIDIA s'unissent pour donner aux entreprises un contrôle accru sur leurs agents, annonce le blog Claude, pendant que NVIDIA dévoile une puce « chien de garde » destinée à superviser chaque agent, rapporte CNBC (136 points sur Hacker News). La gouvernance des agents quitte le document de politique interne pour devenir du silicium. C'est un aveu : le logiciel seul ne suffit plus à garantir le comportement des systèmes autonomes. Reste à savoir qui auditera les gardiens.
Three signals from September 28, 2026 trace the same trajectory: Anthropic and NVIDIA are joining forces to give companies greater control over their agents, the Claude blog announces, while NVIDIA unveiled a “watchdog” chip designed to supervise every agent, CNBC reports (136 points on Hacker News). Agent governance is leaving the internal policy document and becoming silicon. It is an admission: software alone is no longer enough to guarantee the behavior of autonomous systems. What remains to be seen is who will audit the guardians.
Drei Signale des 28. September 2026 zeichnen dieselbe Trajektorie: Anthropic und NVIDIA vereinen sich, um Unternehmen mehr Kontrolle über ihre Agenten zu geben, kündigt der Claude-Blog an, während NVIDIA einen «Watchdog»-Chip zur Überwachung jedes Agenten vorstellt, berichtet CNBC (136 Punkte auf Hacker News). Die Governance der Agenten verlässt das interne Richtliniendokument und wird zu Silizium. Das ist ein Eingeständnis: Software allein genügt nicht mehr, um das Verhalten autonomer Systeme zu garantieren. Zu klären bleibt, wer die Wächter auditiert.
Tre segnali del 28 settembre 2026 disegnano una stessa traiettoria: Anthropic e NVIDIA si uniscono per dare alle imprese un maggiore controllo sui loro agenti, annuncia il blog Claude, mentre NVIDIA svela un chip «cane da guardia» destinato a supervisionare ogni agente, riporta CNBC (136 punti su Hacker News). La governance degli agenti lascia il documento di politica interna per diventare silicon. È un'ammissione: il software da solo non basta più a garantire il comportamento dei sistemi autonomi. Resta da sapere chi auditerà i guardiani.
Tri segnai del 28 de setember 2026 i dessinen l'istessa traiettoria: Anthropic e NVIDIA se unissen per dà ai aziend on control accressuu sora i sò agent, el nunzia el blog Claude, intant che NVIDIA el desvelta ona cippa «can de guardia» destinada a supervisà ogne agent, el raporta CNBC (136 pont sora Hacker News). La governanza di agent la lassa el document de politega interna per vegnì silicon. L'è ona amission: el software da sol no'l basta ancmò a garantì el comportament di sistema autonom. Rest de savè chi el auditarà i guardian.