The Neuron Times

All the AI that's fit to print

N° 269 Édition du matinMorning EditionMorgenausgabeEdizione del mattinoEdizion del mattin · Genève SAMEDI 26 SEPTEMBRE 2026SATURDAY, 26 SEPTEMBER 2026SAMSTAG, 26. SEPTEMBER 2026SABATO 26 SETTEMBRE 2026SABATO 26 SETTEMBRE 2026

À la Une · ÉcosystèmeFront Page · EcosystemSchlagzeilen · ÖkosystemPrima pagina · EcosistemaIn prima pagina · Ecosistema

Claude s'ouvre aux plugins : Anthropic veut faire de son assistant une plateformeClaude opens up to plugins: Anthropic wants to turn its assistant into a platformClaude öffnet sich für Plugins: Anthropic will aus seinem Assistenten eine Plattform machenClaude si apre ai plugin: Anthropic vuole trasformare il suo assistente in una piattaformaClaude el se derviss ai plugin: Anthropic el voeur fà de la soa assistenta ona piattaforma

Le laboratoire publie le 25 septembre 2026 une annonce produit qui invite les développeurs à construire des extensions pour Claude, quelques jours après la sortie d'Opus 5.5.On 25 September 2026, the laboratory published a product announcement inviting developers to build extensions for Claude, just days after the release of Opus 5.5.Das Labor veröffentlicht am 25. September 2026 eine Produktankündigung, die Entwickler einlädt, Erweiterungen für Claude zu bauen – wenige Tage nach dem Release von Opus 5.5.Il laboratorio pubblica il 25 settembre 2026 un annuncio di prodotto che invita gli sviluppatori a costruire estensioni per Claude, pochi giorni dopo l'uscita di Opus 5.5.El laboratori el publicca el 25 de setember 2026 on anunzi prodott che 'l invita i sviluppador a costruì di estension per Claude, quij dì dopo la sortida de Opus 5.5.

Le geste s'inscrit dans une concurrence d'écosystèmes qui s'est durcie cette semaine : OpenAI déploie simultanément ses modèles GPT-6 Sol et Luna dans ChatGPT Work et Codex, et publie le même 25 septembre une étude de cas où la société Proaction revendique +60 % de ventes et plus de 75 heures économisées grâce à Codex. Les plugins sont le levier classique par lequel un assistant générique devient une surface d'intégration professionnelle.The move comes amid an ecosystem rivalry that hardened this week: OpenAI is simultaneously rolling out its GPT-6 Sol and Luna models in ChatGPT Work and Codex, and published on the same 25 September a case study in which the company Proaction claims +60% in sales and more than 75 hours saved thanks to Codex. Plugins are the classic lever by which a generic assistant becomes a professional integration surface.Der Schritt fällt in einen verschärften Ökosystem-Wettbewerb dieser Woche: OpenAI rollt gleichzeitig seine Modelle GPT-6 Sol und Luna in ChatGPT Work und Codex aus und veröffentlicht am selben 25. September eine Fallstudie, in der das Unternehmen Proaction +60 % Umsatz und über 75 eingesparte Stunden dank Codex beansprucht. Plugins sind der klassische Hebel, mit dem ein generischer Assistent zur professionellen Integrationsfläche wird.Il gesto si inserisce in una concorrenza di ecosistemi che questa settimana si è irrigidita: OpenAI distribuisce simultaneamente i suoi modelli GPT-6 Sol e Luna in ChatGPT Work e Codex, e pubblica lo stesso 25 settembre un caso di studio in cui l'azienda Proaction rivendica un +60% di vendite e oltre 75 ore risparmiate grazie a Codex. I plugin sono la leva classica con cui un assistente generico diventa una superficie di integrazione professionale.El gest el se met denter de ona concorenza tra ecosistema che l'è degiada vegnuda dura 'sta setemana chì: OpenAI el met in funzion in istess temp i sò modell GPT-6 Sol e Luna in ChatGPT Work e Codex, e 'l publicca l'istess 25 de setember 2026 on studi de cas indè che la società Proaction la revendega +60% de vendid e pussee de 75 ore risparmiada grazzia a Codex. I plugin hinn la leva classega cont la qual ona assistenta generica la deventa ona superfis de integrazion professional.

Pour Anthropic, l'enjeu dépasse la simple parité de fonctionnalités. La veille, le 25 septembre, une cour d'appel américaine confirmait la désignation d'Anthropic comme risque pour la chaîne d'approvisionnement — un contentieux qui a suscité 734 commentaires sur Hacker News — rappelant que l'expansion commerciale du laboratoire se joue aussi sur le terrain réglementaire. Les plugins arrivent donc au moment où l'entreprise doit prouver qu'elle peut bâtir un écosystème ouvert sans perdre le contrôle de sa sécurité.For Anthropic, the stakes go beyond mere feature parity. The day before, on 25 September, a US appeals court upheld the designation of Anthropic as a supply chain risk — a dispute that drew 734 comments on Hacker News — a reminder that the laboratory's commercial expansion is also being played out on regulatory terrain. The plugins therefore arrive at the very moment the company must prove it can build an open ecosystem without losing control of its safety.Für Anthropic geht es um mehr als blosse Funktionsparität. Am Vortag, dem 25. September, hatte ein US-Berufungsgericht die Einstufung Anthropics als Risiko für die Lieferkette bestätigt – ein Rechtsstreit, der auf Hacker News 734 Kommentare auslöste –, womit die kommerzielle Expansion des Labors auch auf regulatorischem Terrain ausgetragen wird. Die Plugins kommen also genau in dem Moment, in dem das Unternehmen beweisen muss, dass es ein offenes Ökosystem aufbauen kann, ohne die Kontrolle über seine Sicherheit zu verlieren.Per Anthropic, la posta in gioco va oltre la semplice parità di funzionalità. La vigilia, il 25 settembre, una corte d'appello statunitense confermava la designazione di Anthropic come rischio per la catena di fornitura — una controversia che ha suscitato 734 commenti su Hacker News — ricordando che l'espansione commerciale del laboratorio si gioca anche sul terreno regolamentare. I plugin arrivano quindi nel momento in cui l'azienda deve dimostrare di poter costruire un ecosistema aperto senza perdere il controllo della propria sicurezza.Per Anthropic, el giögh el va oltra la sempliga parità de funzionalità. La sera prima, el 25 de setember, ona cort d'appell americana l'aveva confermaa la designazion de Anthropic 'me ris'c per la cadena de forniment — on contenzios che l'ha faa nass 734 comment sora Hacker News — che 'l regorda che l'espansion comercial del laboratori la se giuga anca sora el terren regolamentar. I plugin riven donca in del moment indè che l'impresa la gh'ha de dimostrà che la pò tirà su on ecosistema dervii senza perd el controll de la soa sicurezza.

Page 1 — Page 1 — Seite 1 — Pagina 1 — Pagina 1 — À la Une — Modèles & FrontièreFront Page — Models & FrontierFrontseite — Modelle & GrenzeIn Prima Pagina — Modelli & FrontieraIn prima pagina — Modell & Fruntera

I. La course aux modèlesThe model raceDer Lauf um die ModelleLa corsa ai modelliLa corsa ai modell

Outils

Tools

Werkzeuge

Strumenti

Strument

Ollaya : l'équivalent d'Ollama pour les modèles de décision type JevOllaya: the Ollama equivalent for Jev-style decision modelsOllaya: das Ollama-Pendant für Jev-EntscheidungsmodelleOllaya: l'equivalente di Ollama per i modelli di decisione tipo JevOllaya: l'equivalent de Ollama per i modell de decision tipo Jev

Un projet lancé le 25 septembre 2026 propose une version « Ollama » des modèles de décision type Jev : un gestionnaire local qui télécharge et exécute ces modèles open source en une commande. Le projet est détaillé sur ollaya.dev, et la discussion sur Hacker News a réuni 382 points et 106 commentaires en moins de 24 heures. L'initiative fait suite à l'annonce du rapprochement entre Together AI et l'écosystème Jev, après un tutoriel qui faisait état d'un coût d'entraînement de 17 dollars.
A project launched on 25 September 2026 offers an "Ollama" equivalent for Jev-style decision models: a local manager that downloads and runs these open-source models in a single command. The project is detailed at ollaya.dev, and the discussion on Hacker News gathered 382 points and 106 comments in less than 24 hours. The initiative follows the announcement of a tie-up between Together AI and the Jev ecosystem, after a tutorial reporting a training cost of 17 dollars.
Ein am 25. September 2026 gestartetes Projekt bietet eine «Ollama»-Version von Jev-Entscheidungsmodellen an: ein lokaler Manager, der diese Open-Source-Modelle mit einem Befehl herunterlädt und ausführt. Das Projekt ist auf ollaya.dev dokumentiert, und die Diskussion auf Hacker News versammelte in weniger als 24 Stunden 382 Punkte und 106 Kommentare. Die Initiative folgt auf die Ankündigung einer Annäherung zwischen Together AI und dem Jev-Ökosystem, nach einem Tutorial mit Trainingskosten von 17 Dollar.
Un progetto lanciato il 25 settembre 2026 propone una versione «Ollama» dei modelli di decisione tipo Jev: un gestore locale che scarica ed esegue questi modelli open source con un solo comando. Il progetto è descritto su ollaya.dev, e la discussione su Hacker News ha raccolto 382 punti e 106 commenti in meno di 24 ore. L'iniziativa segue l'annuncio dell'avvicinamento tra Together AI e l'ecosistema Jev, dopo un tutorial che indicava un costo di addestramento di 17 dollari.
On progett lansaa el 25 de setember 2026 el propon la version « Ollama » di modell de decision tipo Jev: on gestor local che 'l descarega e 'l fa girà 'sti modell open source cont on sol comand. El progett l'è detalaa sora ollaya.dev, e la discussion sora Hacker News l'ha regolt 382 pont e 106 comment in manch de 24 or. L'iniziativa la ven dopo l'anunzi del vesinament tra Together AI e l'ecosistema Jev, dopo on tutoriai che 'l diseva de on cost de addestrament de 17 dolar.

Recherche appliquée

Applied research

Angewandte Forschung

Ricerca applicata

Ricerca aplicada

Un modèle de 27B apprend à repérer les mathématiques « intéressantes »A 27B model learns to spot "interesting" mathematicsEin 27B-Modell lernt, «interessante» Mathematik zu erkennenUn modello da 27B impara a individuare la matematica «interessante»On modell de 27B el impara a trà foeu i matematich « interessant »

Des chercheurs de NYU, dont Julia Kempe et Remi Munos, publient le 25 septembre 2026 une méthode pour trier automatiquement les théorèmes selon leur intérêt : le ratio longueur de la preuve sur longueur de l'énoncé. En optimisant cette métrique, le chevauchement avec Mathlib chute de 91,9 % à 30,6 %, et un modèle de 27 milliards de paramètres prédit la difficulté d'une preuve mieux que les modèles frontière généralistes. L'article est disponible sur arXiv.
Researchers at NYU, including Julia Kempe and Remi Munos, published on 25 September 2026 a method to automatically sort theorems by interest: the ratio of proof length to statement length. By optimising this metric, overlap with Mathlib drops from 91.9% to 30.6%, and a 27-billion-parameter model predicts proof difficulty better than generalist frontier models. The paper is available on arXiv.
Forschende der NYU, darunter Julia Kempe und Remi Munos, veröffentlichen am 25. September 2026 eine Methode, um Theoreme automatisch nach ihrem Interesse zu sortieren: das Verhältnis von Beweislänge zu Satzlänge. Durch die Optimierung dieser Metrik sinkt die Überlappung mit Mathlib von 91,9 % auf 30,6 %, und ein Modell mit 27 Milliarden Parametern sagt die Schwierigkeit eines Beweises besser voraus als generalistische Grenzmodelle. Der Artikel ist auf arXiv verfügbar.
Ricercatori della NYU, tra cui Julia Kempe e Remi Munos, pubblicano il 25 settembre 2026 un metodo per ordinare automaticamente i teoremi secondo il loro interesse: il rapporto tra la lunghezza della dimostrazione e la lunghezza dell'enunciato. Ottimizzando questa metrica, la sovrapposizione con Mathlib scende dal 91,9% al 30,6%, e un modello da 27 miliardi di parametri prevede la difficoltà di una dimostrazione meglio dei modelli frontiera generalisti. L'articolo è disponibile su arXiv.
Di ricercador de NYU, tra i quai Julia Kempe e Remi Munos, publichen el 25 de setember 2026 on metod per selezionà automaticament i teorema segond el sò interess: el raport tra la longhezza de la demostrazion e quella de l'enunziaa. Cont l'optimizà 'sta métega chì, el soraponiment con Mathlib el borla del 91,9% al 30,6%, e on modell de 27 miliard de parammeter el prved la difficultaa de ona demostrazion mej di modell de fruntera generich. L'articol l'è disponibil sora arXiv.

Entreprises

Enterprises

Unternehmen

Imprese

Impres

Proaction revendique +60 % de ventes grâce à Codex et GPT-6 AstraProaction claims +60% in sales thanks to Codex and GPT-6 AstraProaction meldet +60 % Umsatz dank Codex und GPT-6 AstraProaction rivendica un +60% di vendite grazie a Codex e GPT-6 AstraProaction la revendega +60% de vendid grazzia a Codex e GPT-6 Astra

OpenAI publie le 25 septembre 2026 le retour d'expérience de Proaction, éditeur de gestion de flotte : avec Codex, GPT-Live-1 et GPT-6 Astra, l'entreprise rapporte une hausse de 60 % des ventes et plus de 75 heures économisées sur ses cycles de build et de vente. L'étude de cas est publiée par OpenAI. Ces chiffres illustrent la course aux preuves d'impact commercial qui accompagne désormais chaque déploiement d'agents en entreprise.
OpenAI published on 25 September 2026 the story of Proaction, a fleet management software vendor: with Codex, GPT-Live-1 and GPT-6 Astra, the company reports a 60% increase in sales and more than 75 hours saved across its build and sales cycles. The case study was published by OpenAI. These figures illustrate the race for proof of commercial impact that now accompanies every enterprise agent deployment.
OpenAI veröffentlicht am 25. September 2026 das Erfahrungsdossier von Proaction, einem Anbieter von Flottenmanagement-Software: mit Codex, GPT-Live-1 und GPT-6 Astra meldet das Unternehmen einen Umsatzanstieg von 60 % und über 75 eingesparte Stunden in seinen Build- und Vertriebszyklen. Die Fallstudie ist von OpenAI veröffentlicht. Diese Zahlen illustrieren den Wettlauf um Nachweise kommerzieller Wirkung, der inzwischen jede unternehmerische Agenten-Einführung begleitet.
OpenAI pubblica il 25 settembre 2026 il resoconto di Proaction, editore di software per la gestione di flotte: con Codex, GPT-Live-1 e GPT-6 Astra, l'azienda riferisce un aumento del 60% delle vendite e oltre 75 ore risparmiate sui propri cicli di build e di vendita. Il caso di studio è pubblicato da OpenAI. Questi cifre illustrano la corsa alle prove di impatto commerciale che ormai accompagna ogni distribuzione di agenti nelle imprese.
OpenAI el publicca el 25 de setember 2026 el ritorn de esperienza de Proaction, editor de gestion de flotta: con Codex, GPT-Live-1 e GPT-6 Astra, l'impresa la rapporta ona salida del 60% di vendid e pussee de 75 ore risparmiada in di sò cich de build e de vendita. El studi de cas l'è publicaa de OpenAI. 'Sti numer chì meten in lus la corsa ai prov d'impatto comercial che ades la va incontra ogni despiegament de agent in impresa.

II. MarchéMarketMarktMercatoMercà

Industrie

Industry

Industrie

Industria

Industria

Microsoft abandonne la course au chatbot personnel avec un Copilot rebootMicrosoft bows out of the personal chatbot race with a Copilot rebootMicrosoft steigt aus dem Rennen um den persönlichen Chatbot aus – mit einem Copilot-RebootMicrosoft abbandona la corsa al chatbot personale con un riavvio di CopilotMicrosoft la lassa la corsa al chatbot personal cont on reboot de Copilot

Selon Bloomberg le 25 septembre 2026, Microsoft abandonnerait la course au chatbot personnel avec un redémarrage complet de Copilot. L'article de Bloomberg a déclenché 93 commentaires et 101 points sur Hacker News. Le repositionnement interviendrait alors que la compétition grand public se joue sur les agents vocaux et les modèles frontière de Google, OpenAI et Anthropic.
According to Bloomberg on 25 September 2026, Microsoft is reportedly bowing out of the personal chatbot race with a complete Copilot reboot. The Bloomberg article sparked 93 comments and 101 points on Hacker News. The repositioning would come as the consumer competition is being fought over voice agents and the frontier models of Google, OpenAI and Anthropic.
Laut Bloomberg vom 25. September 2026 will Microsoft das Rennen um den persönlichen Chatbot mit einem kompletten Neustart von Copilot aufgeben. Der Bloomberg-Artikel löste 93 Kommentare und 101 Punkte auf Hacker News aus. Die Neupositionierung käme in einer Phase, in der sich der Consumer-Wettbewerb auf Sprachassistenten und die Grenzmodelle von Google, OpenAI und Anthropic verlagert.
Secondo Bloomberg il 25 settembre 2026, Microsoft abbandonerebbe la corsa al chatbot personale con un riavvio completo di Copilot. L'articolo di Bloomberg ha scatenato 93 commenti e 101 punti su Hacker News. Il riposizionamento arriverebbe mentre la competizione consumer si gioca sugli agenti vocali e sui modelli frontiera di Google, OpenAI e Anthropic.
Segond Bloomberg el 25 de setember 2026, Microsoft l'abandonaria la corsa al chatbot personal cont on reinizià total de Copilot. L'articol de Bloomberg l'ha faa sccioppà 93 comment e 101 pont sora Hacker News. El reposizionament el rivaria in del moment che la competizion per el grand publicch la se giuga sora i agent vocaj e i modell de fruntera de Google, OpenAI e Anthropic.

Page 2 — Page 2 — Seite 2 — Pagina 2 — Pagina 2 — Le Cahier Technique — Harnais & enginesThe Technical Supplement — Harnesses & enginesDas Technik-Dossier — Harness & EnginesIl Quaderno Tecnico — Harness & enginesEl Quadern Tecnegh — Harness & engines

III. Harnais & systèmesHarnesses & systemsHarness & SystemeHarness & sistemiHarness & sistem

Recette

Recipe

Rezeptur

Ricetta

Ricetta

Rufus-Air : la recette de post-entraînement en huit étapes qu'Amazon publie en open sourceRufus-Air: Amazon's eight-step post-training recipe, published open sourceRufus-Air: die achtstufige Post-Training-Rezeptur, die Amazon als Open Source publiziertRufus-Air: la ricetta di post-addestramento in otto fasi che Amazon pubblica in open sourceRufus-Air: la ricetta de post-addestrament in vott pass che Amazon el publicca in open source

Amazon publie le 25 septembre 2026 Rufus-Air, une recette de post-entraînement entièrement ouverte et reproductible sur GLM-4.5-Air-Base (106 milliards de paramètres dont 12 milliards activés), organisée en huit étapes séquentielles : SFT, RL de raisonnement, RL de codage, RL d'instruction-following, agent général, agent de codage, agent de recherche, RLHF. Le résultat dépasse la version officielle post-entraînée de GLM-4.5-Air, sans nouvelle annotation humaine ni distillation maison. La recette complète est sur arXiv.
Amazon published on 25 September 2026 Rufus-Air, a fully open and reproducible post-training recipe for GLM-4.5-Air-Base (106 billion parameters, 12 billion activated), organised into eight sequential steps: SFT, reasoning RL, coding RL, instruction-following RL, general agent, coding agent, research agent, RLHF. The result outperforms the official post-trained version of GLM-4.5-Air, without new human annotation or in-house distillation. The full recipe is on arXiv.
Amazon veröffentlicht am 25. September 2026 Rufus-Air, eine vollständig offene, reproduzierbare Post-Training-Rezeptur auf GLM-4.5-Air-Base (106 Milliarden Parameter, davon 12 Milliarden aktiviert), gegliedert in acht sequenzielle Schritte: SFT, Reasoning-RL, Coding-RL, Instruction-Following-RL, Generalisten-Agent, Coding-Agent, Research-Agent, RLHF. Das Ergebnis übertrifft die offizielle post-trainierte Version von GLM-4.5-Air – ohne neue menschliche Annotation und ohne eigene Destillation. Die komplette Rezeptur steht auf arXiv.
Amazon pubblica il 25 settembre 2026 Rufus-Air, una ricetta di post-addestramento interamente aperta e riproducibile su GLM-4.5-Air-Base (106 miliardi di parametri di cui 12 miliardi attivati), organizzata in otto fasi sequenziali: SFT, RL di ragionamento, RL di coding, RL di istruzioni, agente generale, agente di coding, agente di ricerca, RLHF. Il risultato supera la versione ufficiale post-addestrata di GLM-4.5-Air, senza nuove annotazioni umane né distillazione interna. La ricetta completa è su arXiv.
Amazon el publicca el 25 de setember 2026 Rufus-Air, ona ricetta de post-addestrament dervia del tutt e replicabil sora GLM-4.5-Air-Base (106 miliard de parammeter, di quai 12 miliard ativaa), organizada in vott pass sequenziai: SFT, RL de resonament, RL de codifica, RL de instruction-following, agent general, agent de codifica, agent de ricerca, RLHF. El risultaa el supera la version offiziala post-addestrada de GLM-4.5-Air, senza noeuv annotazion umana né distillazion de cà. La ricetta completa l'è sora arXiv.

Sécurité

Security

Sicherheit

Sicurezza

Sicurezza

« Just Ask Jev » : un détecteur d'échecs d'alignement à AUROC 0,886, 63 fois moins cher"Just Ask Jev": a detector of alignment failures with AUROC 0.886, 63 times cheaper«Just Ask Jev»: ein Detektor für Alignment-Fehlschläge mit AUROC 0,886 – 63-mal günstiger«Just Ask Jev»: un rilevatore di fallimenti di allineamento con AUROC 0,886, 63 volte più economico« Just Ask Jev »: on detector de fali de allineament a AUROC 0,886, 63 voeulte men car

Des chercheurs présentent le 25 septembre 2026 RLCDAlignBench : Jev, entraîné par RL pour des décisions calibrées, sert de détecteur d'échecs d'alignement sur dix axes (sycophantie, jailbreaks, tromperie, injection de prompt, etc.) couvrant 44 benchmarks et cinq modèles cibles. Une seule question générique atteint une AUROC médiane de 0,886 en zero-shot, pour un coût 63 fois inférieur aux juges LLM. L'article et le code sont disponibles.
Researchers present on 25 September 2026 RLCDAlignBench: Jev, trained by RL for calibrated decisions, serves as a detector of alignment failures across ten axes (sycophancy, jailbreaks, deception, prompt injection, etc.) covering 44 benchmarks and five target models. A single generic question achieves a median AUROC of 0.886 in zero-shot, at 63 times lower cost than LLM judges. The paper and code are available.
Forschende stellen am 25. September 2026 RLCDAlignBench vor: Jev, per RL für kalibrierte Entscheidungen trainiert, dient als Detektor für Alignment-Fehlschläge entlang von zehn Achsen (Sycophancy, Jailbreaks, Täuschung, Prompt-Injektion usw.), die 44 Benchmarks und fünf Zielmodelle abdecken. Eine einzige generische Frage erreicht im Zero-Shot eine mediane AUROC von 0,886 – zu Kosten, die 63-mal tiefer liegen als bei LLM-Juroren. Artikel und Code sind verfügbar.
Ricercatori presentano il 25 settembre 2026 RLCDAlignBench: Jev, addestrato con RL per decisioni calibrate, funge da rilevatore di fallimenti di allineamento su dieci assi (sycophancy, jailbreak, inganno, injection di prompt, ecc.) che coprono 44 benchmark e cinque modelli bersaglio. Una sola domanda generica raggiunge una AUROC mediana di 0,886 in zero-shot, a un costo 63 volte inferiore rispetto ai giudici LLM. L'articolo e il codice sono disponibili.
Di ricercador presenten el 25 de setember 2026 RLCDAlignBench: Jev, adestraa con RL per di decision calibraa, el serviss 'me detector di fali de allineament sora dess ass (sifofania, jailbreak, ingann, iniezion de prompt, eccetera) che quatten 44 benchmark e cinch modell bersaj. Ona sola domanda generica la riva a ona AUROC mediana de 0,886 in zero-shot, cont on cost 63 voeulte men di giudes LLM. L'articol e 'l codes hinn disponibil.

Page 3 — Page 3 — Seite 3 — Pagina 3 — Pagina 3 — La Recherche — Papers & labosThe Research — Papers & labsDie Forschung — Papers & LaboreLa Ricerca — Papers & laboratoriLa Ricerca — Paper & laboratori

IV. Papers du jourPapers of the dayPapers des TagesPaper del giornoPaper del dì

Interprétabilité

Interpretability

Interpretierbarkeit

Interpretabilità

Interpretabilitaa

Un Transformer peut tenir deux pensées à la fois : la preuve de la superposition linéaireA Transformer can hold two thoughts at once: proof of linear superpositionEin Transformer kann zwei Gedanken gleichzeitig fassen: der Nachweis der linearen SuperpositionUn Transformer può tenere due pensieri alla volta: la prova della sovrapposizione lineareOn Transformer el pò tegnì duu penser in istess temp: la prova de la superposizion lineara

Le paper le plus plébiscité de la journée du 25 septembre 2026 sur Hugging Face Daily Papers (57 votes) démontre une propriété inattendue : quand on combine linéairement des entrées de deux flux de texte, le modèle produit une superposition des distributions de token suivants. Cette linéarité serait intrinsèque à l'architecture Transformer et diminue avec le pré-entraînement, mais un fine-tuning léger la restaure ; une procédure de décodage guidé permet même de générer deux continuations cohérentes en une seule passe avant. L'article est sur arXiv.
The most upvoted paper of 25 September 2026 on Hugging Face Daily Papers (57 votes) demonstrates an unexpected property: when inputs from two text streams are linearly combined, the model produces a superposition of the next-token distributions. This linearity appears intrinsic to the Transformer architecture and decreases with pre-training, but light fine-tuning restores it; a guided decoding procedure even generates two coherent continuations in a single forward pass. The paper is on arXiv.
Das am meisten beachtete Paper des 25. September 2026 auf Hugging Face Daily Papers (57 Stimmen) weist eine unerwartete Eigenschaft nach: Wer Eingaben zweier Textströme linear kombiniert, erzeugt eine Superposition der Verteilungen der nächsten Tokens. Diese Linearität wäre der Transformer-Architektur inhärent und nimmt mit dem Pre-Training ab, lässt sich aber durch leichtes Fine-Tuning wiederherstellen; ein Verfahren des geführten Decodings kann sogar zwei kohärente Fortsetzungen in einem einzigen Vorwärtsdurchlauf generieren. Der Artikel steht auf arXiv.
Il paper più votato della giornata del 25 settembre 2026 su Hugging Face Daily Papers (57 voti) dimostra una proprietà inattesa: combinando linearmente input di due flussi di testo, il modello produce una sovrapposizione delle distribuzioni dei token successivi. Questa linearità sarebbe intrinseca all'architettura Transformer e diminuisce con il pre-addestramento, ma un fine-tuning leggero la ripristina; una procedura di decodifica guidata permette persino di generare due continuazioni coerenti in un solo passaggio in avanti. L'articolo è su arXiv.
El paper pussee vosaa del dì del 25 de setember 2026 sora Hugging Face Daily Papers (57 vot) el dimostra ona proprietaa inspettada: quand che se combina linearment di input de duu fluss de test, el modell el prudus ona superposizion di distribution del token vegnent. 'Sta linearitaa chì la saress intrinsega a l'architettura Transformer e la cala cont el pre-addestrament, ma on fine-tuning lesger el la restaora; ona procedura de decodifica guidaa la permet anca de generà duu continuazion coerent in d'ona sola passada inanz. L'articol l'è sora arXiv.

Architecture

Architecture

Architektur

Architettura

Architettura

Neural Spectral Capacity : noter une architecture sans l'entraîner, en 2 secondes de CPUNeural Spectral Capacity: score an architecture without training it, in 2 seconds of CPUNeural Spectral Capacity: eine Architektur bewerten ohne Training – in 2 CPU-SekundenNeural Spectral Capacity: valutare un'architettura senza addestrarla, in 2 secondi di CPUNeural Spectral Capacity: dà on pontegg a ona architettura senza adestràlla, in 2 segond de CPU

Des chercheurs de la City University of Hong Kong proposent le 25 septembre 2026 la Neural Spectral Capacity, un scalaire calculable en forme fermée à partir de la seule spécification de l'architecture, sans instanciation ni données. NSC-DP, un solveur exact par programmation dynamique, découvre en 2 secondes sur CPU une architecture Transformer-XL battant le baseline humain sur WikiText-103, et élague LLaMA-7B en un modèle de 5,7 milliards meilleur sur huit tâches de raisonnement, environ 5 900 fois plus vite que le meilleur proxy sans entraînement. Le paper est accessible sur arXiv.
Researchers at the City University of Hong Kong propose on 25 September 2026 Neural Spectral Capacity, a scalar computable in closed form from the architecture specification alone, without instantiation or data. NSC-DP, an exact dynamic programming solver, discovers in 2 seconds on CPU a Transformer-XL architecture beating the human baseline on WikiText-103, and prunes LLaMA-7B into a 5.7-billion model better on eight reasoning tasks, roughly 5,900 times faster than the best training-free proxy. The paper is accessible on arXiv.
Forschende der City University of Hong Kong schlagen am 25. September 2026 die Neural Spectral Capacity vor: einen Skalar, der in geschlossener Form allein aus der Architektur-Spezifikation berechenbar ist, ohne Instanziierung und ohne Daten. NSC-DP, ein exakter Löser per dynamischer Programmierung, entdeckt in 2 Sekunden auf der CPU eine Transformer-XL-Architektur, die die menschliche Baseline auf WikiText-103 schlägt, und stutzt LLaMA-7B auf ein 5,7-Milliarden-Modell, das auf acht Reasoning-Aufgaben besser abschneidet – rund 5 900-mal schneller als der beste trainingsfreie Proxy. Das Paper ist auf arXiv zugänglich.
Ricercatori della City University of Hong Kong propongono il 25 settembre 2026 la Neural Spectral Capacity, uno scalare calcolabile in forma chiusa a partire dalla sola specificazione dell'architettura, senza istanziazione né dati. NSC-DP, un risolutore esatto per programmazione dinamica, scopre in 2 secondi su CPU un'architettura Transformer-XL che batte il baseline umano su WikiText-103, e pota LLaMA-7B in un modello da 5,7 miliardi migliore su otto compiti di ragionamento, circa 5 900 volte più veloce del miglior proxy senza addestramento. Il paper è accessibile su arXiv.
Di ricercador de la City University of Hong Kong proponen el 25 de setember 2026 la Neural Spectral Capacity, on scalar calculabil a forma saraada partend domà de la specifega de l'architettura, senza instanziazion né dacc. NSC-DP, on resolver esatt per programmazion dinamica, el trà foeu in 2 segond sora CPU ona architettura Transformer-XL che la batt el baseline uman sora WikiText-103, e la pota LLaMA-7B in d'on modell de 5,7 miliard mej sora vott lavorà de resonament, circa 5 900 voeulte pussee a la svelta del mej proxy senza addestrament. El paper l'è acessibil sora arXiv.

Linguistique computationnelle

Computational linguistics

Computerlinguistik

Linguistica computazionale

Lenguistega computazional

Les parties du discours émergent en groupes de latents dans l'espace des SAEParts of speech emerge as groups of latents in SAE spaceRedeteile entstehen als Latent-Gruppen im SAE-RaumLe parti del discorso emergono in gruppi di latenti nello spazio dei SAEI part del discors nassen a grupp de latent in del spazzi di SAE

Le laboratoire CoLingLab de l'université de Pise montre le 25 septembre 2026 que les catégories grammaticales sont hautement récupérables depuis les activations d'un sparse autoencoder (10 votes sur Daily Papers), mais jamais via un mapping un-à-un : chaque catégorie repose sur un groupe compact de latents, stable sur données tenues à l'écart, avec des recouvrements entre catégories apparentées. L'étude est publiée sur arXiv.
The CoLingLab at the University of Pisa shows on 25 September 2026 that grammatical categories are highly recoverable from the activations of a sparse autoencoder (10 votes on Daily Papers), but never via a one-to-one mapping: each category rests on a compact group of latents, stable on held-out data, with overlaps between related categories. The study is published on arXiv.
Das Labor CoLingLab der Universität Pisa zeigt am 25. September 2026, dass grammatische Kategorien aus den Aktivierungen eines Sparse Autoencoders hochgradig rekonstruierbar sind (10 Stimmen auf Daily Papers) – aber nie über ein Eins-zu-eins-Mapping: Jede Kategorie beruht auf einer kompakten Gruppe von Latents, stabil auf zurückgehaltenen Daten, mit Überschneidungen zwischen verwandten Kategorien. Die Studie ist auf arXiv publiziert.
Il laboratorio CoLingLab dell'Università di Pisa mostra il 25 settembre 2026 che le categorie grammaticali sono altamente recuperabili dalle attivazioni di uno sparse autoencoder (10 voti su Daily Papers), ma mai tramite una corrispondenza uno-a-uno: ogni categoria si basa su un gruppo compatto di latenti, stabile su dati tenuti da parte, con sovrapposizioni tra categorie affini. Lo studio è pubblicato su arXiv.
El laboratori CoLingLab de l'universitaa de Pisa el mostra el 25 de setember 2026 che i categorij grammaticaj hinn recuperabil ben di ativazion de on sparse autoencoder (10 vot sora Daily Papers), ma mai cont on mapping vun-a-vun: ogni categoria la se puja sora on grupp compact de latent, stabil sora dacc tegnuu de part, con di soraponiment tra categorij parent. El studi l'è publicaa sora arXiv.

Benchmark

Benchmark

Benchmark

Benchmark

Benchmark

RGBD20K : 20 000 paires RGB-D pour relancer la segmentation sémantiqueRGBD20K: 20,000 RGB-D pairs to revive semantic segmentationRGBD20K: 20 000 RGB-D-Paare für einen neuen Schub der semantischen SegmentierungRGBD20K: 20 000 coppie RGB-D per rilanciare la segmentazione semanticaRGBD20K: 20 000 cobbi RGB-D per fà riparti la segmentazion semantega

L'université de North Texas publie le 25 septembre 2026 RGBD20K : 20 000 paires d'images RGB-D annotées sur 160 catégories fines, contre 40 classes pour NYUv2 et 37 pour SUN RGB-D, avec correction des bruits d'annotation historiques. Une méthode de fusion purifiée par score (SPF) atteint l'état de l'art sur tous les benchmarks évalués ; le dataset a recueilli 7 votes sur Daily Papers. Le paper et le dépôt sont référencés sur arXiv.
The University of North Texas published on 25 September 2026 RGBD20K: 20,000 annotated RGB-D image pairs across 160 fine-grained categories, versus 40 classes for NYUv2 and 37 for SUN RGB-D, with corrections of historical annotation noise. A score-purified fusion method (SPF) achieves state-of-the-art on all evaluated benchmarks; the dataset gathered 7 votes on Daily Papers. The paper and repository are referenced on arXiv.
Die University of North Texas veröffentlicht am 25. September 2026 RGBD20K: 20 000 annotierte RGB-D-Bildpaare in 160 feinen Kategorien – gegenüber 40 Klassen bei NYUv2 und 37 bei SUN RGB-D –, mit Korrektur historischer Annotationsfehler. Eine per Score gereinigte Fusionsmethode (SPF) erreicht auf allen evaluierten Benchmarks den State of the Art; das Dataset erhielt 7 Stimmen auf Daily Papers. Paper und Repository sind auf arXiv referenziert.
L'Università del North Texas pubblica il 25 settembre 2026 RGBD20K: 20 000 coppie di immagini RGB-D annotate su 160 categorie fini, contro 40 classi per NYUv2 e 37 per SUN RGB-D, con correzione dei rumori di annotazione storici. Un metodo di fusione purificato per punteggio (SPF) raggiunge lo stato dell'arte su tutti i benchmark valutati; il dataset ha raccolto 7 voti su Daily Papers. Il paper e il repository sono referenziati su arXiv.
L'universitaa de North Texas la publicca el 25 de setember 2026 RGBD20K: 20 000 cobbi de imagin RGB-D annotaa sora 160 categorij fin, contra 40 class per NYUv2 e 37 per SUN RGB-D, con corezion di sgrisoj de annotazion storge. On metod de fusion purificada per score (SPF) el riva al statt de l'art sora tucc i benchmark valuttaa; el dataset l'ha regolt 7 vot sora Daily Papers. El paper e 'l deposit hinn regerenziaa sora arXiv.

Page 4 — Page 4 — Seite 4 — Pagina 4 — Pagina 4 — La Communauté & ÉditoCommunity & EditorialDie Community & das EditorialLa Comunità & EditorialeLa Comunitaa & Editoriai

V. Signaux & opinionSignals & opinionSignale & MeinungSegnali & opinioneSegnai & opinion

Produit

Product

Produkt

Prodotto

Prodott

ChatGPT gère un historique de sécurité : connexions, MFA et passkeys traçablesChatGPT adds a security history: logins, MFA and passkeys made traceableChatGPT erhält einen Sicherheitsverlauf: Anmeldungen, MFA und Passkeys nachvollziehbarChatGPT gestisce uno storico di sicurezza: accessi, MFA e passkeys tracciabiliChatGPT el ghe met dent on istorigh de sicurezza: conession, MFA e passkeys tracciabil

OpenAI déploie le 25 septembre 2026 l'historique de sécurité dans ChatGPT : chaque compte peut consulter connexions et déconnexions, modifications de MFA et de passkeys, avec horodatage, localisation et appareil. La fonction, accessible via Paramètres > Sécurité et connexion, précède une page d'aide pour sécuriser un compte face à une activité inconnue. Les notes de version officiels documentent le déploiement.
OpenAI is rolling out on 25 September 2026 a security history in ChatGPT: each account can view logins and logouts, changes to MFA and passkeys, with timestamp, location and device. The feature, accessible via Settings > Security and login, precedes a help page for securing an account against unknown activity. The official release notes document the rollout.
OpenAI führt am 25. September 2026 den Sicherheitsverlauf in ChatGPT ein: Jedes Konto kann An- und Abmeldungen, Änderungen an MFA und Passkeys einsehen – mit Zeitstempel, Standort und Gerät. Die Funktion, erreichbar unter Einstellungen > Sicherheit und Anmeldung, geht einer Hilfeseite voraus, die erklärt, wie man ein Konto bei unbekannter Aktivität sichert. Die offiziellen Release Notes dokumentieren die Einführung.
OpenAI distribuisce il 25 settembre 2026 lo storico di sicurezza in ChatGPT: ogni account può consultare accessi e disconnessioni, modifiche a MFA e passkeys, con data e ora, localizzazione e dispositivo. La funzione, accessibile tramite Impostazioni > Sicurezza e accesso, precede una pagina di aiuto per mettere in sicurezza un account di fronte a un'attività sconosciuta. Le note di versione ufficiali documentano la distribuzione.
OpenAI el met in funzion el 25 de setember 2026 l'istorigh de sicurezza in ChatGPT: ogni contecc el pò consultà conession e sconession, mudament de MFA e de passkeys, con orari, localizzazion e apparecc. La funzion, acessibil via Parametri > Sicurezza e conession, la ven prima de ona pagina de jutt per segurizzà on contecc denanz a ona ativitaa sconossuda. I not de version offiziai documenten el despiegament.

Community

Community

Community

Community

Comunitaa

Jev joue à Pokémon Red, en direct et en open sourceJev plays Pokémon Red, live and open sourceJev spielt Pokémon Rot – live und als Open SourceJev gioca a Pokémon Rosso, in diretta e in open sourceJev el giuga a Pokémon Ross, in diretta e in open source

Un développeur a publié le 25 septembre 2026 un projet qui fait jouer Pokémon Rouge à Jev, dont les décisions sont rapides mais pas assez pour Doom. La partie est diffusée en direct avec tokens et coûts affichés ; le code est ouvert et la publication a récolté 175 points et 76 commentaires sur Hacker News. Le stream est accessible en ligne, dépôt sur GitHub inclus.
A developer released on 25 September 2026 a project that has Jev playing Pokémon Red, with decisions that are fast, though not fast enough for Doom. The playthrough is streamed live with tokens and costs displayed; the code is open and the post earned 175 points and 76 comments on Hacker News. The stream is available online, GitHub repository included.
Ein Entwickler hat am 25. September 2026 ein Projekt veröffentlicht, das Jev Pokémon Rot spielen lässt – dessen Entscheidungen sind schnell, aber nicht schnell genug für Doom. Die Partie wird live mit angezeigten Tokens und Kosten übertragen; der Code ist offen, und die Veröffentlichung brachte 175 Punkte und 76 Kommentare auf Hacker News ein. Der Stream ist online zugänglich, Repository auf GitHub inklusive.
Uno sviluppatore ha pubblicato il 25 settembre 2026 un progetto che fa giocare Pokémon Rosso a Jev, le cui decisioni sono rapide ma non abbastanza per Doom. La partita è trasmessa in diretta con token e costi visualizzati; il codice è aperto e la pubblicazione ha raccolto 175 punti e 76 commenti su Hacker News. Lo stream è accessibile online, repository su GitHub incluso.
On sviluppador l'ha publicaa el 25 de setember 2026 on progett che 'l fa giugà a Jev Pokémon Ross, e i sò decision hinn svelt ma no assee per Doom. La partida l'è trasmettuda in diretta con token e cost visibil; el codes l'è dervii e la publicazion l'ha regolt 175 pont e 76 comment sora Hacker News. El stream l'è acessibil in linia, deposit sora GitHub includuu.

Édito

Editorial

Editorial

Editoriale

Editoriai

Édito — L'ouverture comme preuve : quand la confiance se démontre en publicEditorial — Openness as proof: when trust is demonstrated in publicEditorial — Offenheit als Beweis: Wenn Vertrauen öffentlich demonstriert wirdEditoriale — L'apertura come prova: quando la fiducia si dimostra in pubblicoEditoriai — La vertura 'me prova: quand che la fiducia la se dimostra in publicch

La semaine qui s'achève le 26 septembre 2026 aura tout dit d'une industrie en tension. Anthropic ouvre Claude aux plugins le 25 septembre, mais la même journée une cour d'appel confirme sa désignation comme risque de chaîne d'approvisionnement, sur un fil Hacker News à 419 points et 734 commentaires — voir la dépêche de CNBC. Les preuves d'efficacité (Proaction et ses +60 % de ventes documentées par OpenAI) avancent au même rythme que les autopsies de sécurité, comme celle des agents ayant compromis Hugging Face. La leçon de la semaine : l'ouverture — plugins, recettes, datasets — est désormais le signal de confiance par excellence, précisément parce que les systèmes fermés ne peuvent plus prouver seuls qu'ils sont sûrs.
The week ending 26 September 2026 said everything about an industry under tension. Anthropic opens Claude to plugins on 25 September, but the same day an appeals court upholds its designation as a supply chain risk, on a Hacker News thread at 419 points and 734 comments — see the CNBC dispatch. Proof of effectiveness (Proaction and its +60% in sales documented by OpenAI) advances at the same pace as security post-mortems, such as that of the agents that compromised Hugging Face. The lesson of the week: openness — plugins, recipes, datasets — is now the signal of trust par excellence, precisely because closed systems can no longer prove on their own that they are safe.
Die am 26. September 2026 zu Ende gehende Woche hat alles über eine Industrie im Spannungszustand gesagt. Anthropic öffnet Claude am 25. September für Plugins, doch am selben Tag bestätigt ein Berufungsgericht die Einstufung als Lieferketten-Risiko – auf einem Hacker-News-Thread mit 419 Punkten und 734 Kommentaren; siehe die Meldung von CNBC. Die Wirksamkeitsnachweise (Proaction und seine +60 % Umsatz, dokumentiert von OpenAI) schreiten im gleichen Tempo voran wie die Sicherheits-Autopsien, etwa jene der Agenten, die Hugging Face kompromittiert haben. Die Lektion der Woche: Offenheit – Plugins, Rezepturen, Datasets – ist inzwischen das Vertrauenssignal schlechthin, gerade weil geschlossene Systeme nicht mehr allein beweisen können, dass sie sicher sind.
La settimana che si chiude il 26 settembre 2026 avrà detto tutto di un'industria in tensione. Anthropic apre Claude ai plugin il 25 settembre, ma lo stesso giorno una corte d'appello conferma la sua designazione come rischio per la catena di fornitura, su un thread Hacker News con 419 punti e 734 commenti — vedi il dispaccio di CNBC. Le prove di efficacia (Proaction e il suo +60% di vendite documentate da OpenAI) avanzano allo stesso ritmo delle autopsie di sicurezza, come quella degli agenti che hanno compromesso Hugging Face. La lezione della settimana: l'apertura — plugin, ricette, dataset — è ormai il segnale di fiducia per eccellenza, proprio perché i sistemi chiusi non possono più dimostrare da soli di essere sicuri.
La setemana che la se sara el 26 de setember 2026 l'avrà dii tutt d'ona industria in tension. Anthropic el derviss Claude ai plugin el 25 de setember, ma l'istess dì ona cort d'appell la conferma la soa designazion 'me ris'c per la cadena de forniment, sora on fil de Hacker News a 419 pont e 734 comment — varda la depesca de CNBC. I prov de eficienza (Proaction e i sò +60% de vendid documentaa de OpenAI) vàn inanz a l'istess pass di autopsij de sicurezza, 'me quella di agent che hann compromettuu Hugging Face. La lezion de la setemana: la vertura — plugin, ricett, dataset — l'è ades el segnall de fiducia per eccellenza, propi perchè i sistema saraa pœu disen no da sol che hinn segur.