À la Une · FrontièreFront Page · FrontierSchlagzeilen · GrenzbereichPrima pagina · FrontieraIn prima pagina · Frontiera
Moonshot AI publie les poids de Kimi K3, un modèle MoE de 2,8 billions de paramètres en open sourceMoonshot AI releases Kimi K3 weights, a 2.8 trillion parameter open-source MoE modelMoonshot AI veröffentlicht Gewichte von Kimi K3, einem MoE-Modell mit 2,8 Billionen Parametern, als Open SourceMoonshot AI pubblica i pesi di Kimi K3, un modello MoE da 2,8 trilioni di parametri in open sourceMoonshot AI el publica i pes del Kimi K3, on model MoE de 2,8 trilion de parametri in open source
Le laboratoire chinois Moonshot AI a libéré les poids de son modèle géant Kimi K3, un MoE de 2,8T paramètres, dans un contexte de débat mondial sur les modèles ouverts et la sécurité nationale.Chinese lab Moonshot AI has released the weights of its giant Kimi K3 model, a 2.8T parameter MoE, amid a global debate over open models and national security.Das chinesische Labor Moonshot AI hat die Gewichte seines Riesenmodells Kimi K3, einem MoE mit 2,8T Parametern, inmitten einer globalen Debatte über offene Modelle und nationale Sicherheit freigegeben.Il laboratorio cinese Moonshot AI ha rilasciato i pesi del suo modello gigante Kimi K3, un MoE da 2,8T parametri, in un contesto di dibattito globale sui modelli aperti e la sicurezza nazionale.El laboratori cines Moonshot AI l'ha liberaa i pes del sò model gigant Kimi K3, on MoE de 2,8T parametri, in d'on contest de débat mondial in sui model vert e la sicurezza nazional.
De la rédaction — 28 juillet 2026From the editorial desk — 28 July 2026Von der Redaktion — 28. Juli 2026Dalla redazione — 28 luglio 2026De la redazzion — 28 luglio 2026
Moonshot AI a publié le 27 juillet 2026 les poids complets de Kimi K3, un modèle Mixture-of-Experts de 2,8 billions de paramètres dont 104 milliards activés par token, accompagné d'une partie de son infrastructure d'entraînement. Le modèle, qui intègre une fenêtre de contexte d'un million de tokens et des capacités de vision native, se positionne comme le modèle open-weight le plus puissant jamais diffusé, tout en reconnaissant rester derrière les modèles propriétaires Claude Fable 5 et GPT-5.6 Sol sur l'ensemble des benchmarks.On July 27, 2026, Moonshot AI released the full weights of Kimi K3, a 2.8 trillion parameter Mixture-of-Experts model with 104 billion activated parameters per token, along with part of its training infrastructure. The model, which features a one-million-token context window and native vision capabilities, positions itself as the most powerful open-weight model ever released, while acknowledging it still trails proprietary models Claude Fable 5 and GPT-5.6 Sol across all benchmarks.Moonshot AI hat am 27. Juli 2026 die vollständigen Gewichte von Kimi K3 veröffentlicht, einem Mixture-of-Experts-Modell mit 2,8 Billionen Parametern, von denen 104 Milliarden pro Token aktiviert werden, zusammen mit einem Teil seiner Trainingsinfrastruktur. Das Modell, das ein Kontextfenster von einer Million Token und native Bildverarbeitungsfähigkeiten integriert, positioniert sich als das leistungsstärkste je verbreitete Open-Weight-Modell, räumt jedoch ein, bei allen Benchmarks hinter den proprietären Modellen Claude Fable 5 und GPT-5.6 Sol zurückzubleiben.Moonshot AI ha pubblicato il 27 luglio 2026 i pesi completi di Kimi K3, un modello Mixture-of-Experts da 2,8 trilioni di parametri di cui 104 miliardi attivati per token, accompagnato da una parte della sua infrastruttura di addestramento. Il modello, che integra una finestra di contesto di un milione di token e capacità di visione nativa, si posiziona come il modello open-weight più potente mai diffuso, pur riconoscendo di rimanere dietro ai modelli proprietari Claude Fable 5 e GPT-5.6 Sol su tutti i benchmark.Moonshot AI l'ha publicaa el 27 de luj 2026 i pes complet del Kimi K3, on model Mixture-of-Experts de 2,8 trilion de parametri, cont 104 miliard ativai per token, insema a ona part de la soa infrastruttura de training. El model, che l'integra ona finestra de contest de on milion de token e di capacità de vision nativa, el se met 'me el model open-weight pussee potent mai spantegaa, anca se l'è recognossuu de restà indree rispett ai model proprietari Claude Fable 5 e GPT-5.6 Sol in su tucc i benchmark.
La publication des poids intervient dans un contexte géopolitique tendu : le même jour, Anthropic a publié sa position officielle sur les modèles open-weight, tandis que Dario Amodei déclarait au TechCrunch ne pas s'opposer aux modèles ouverts mais craindre l'IA chinoise. Le New York Times rapporte que Moonshot imposera des licences à certains utilisateurs de Kimi K3, tentant de concilier diffusion ouverte et monétisation.The weight release comes amid a tense geopolitical climate: on the same day, Anthropic published its official position on open-weight models, while Dario Amodei told TechCrunch he does not oppose open models but fears Chinese AI. The New York Times reports that Moonshot will impose licenses on certain Kimi K3 users, attempting to reconcile open distribution with monetization.Die Veröffentlichung der Gewichte erfolgt in einem angespannten geopolitischen Kontext: Am selben Tag veröffentlichte Anthropic seine offizielle Position zu Open-Weight-Modellen, während Dario Amodei gegenüber TechCrunch erklärte, er lehne offene Modelle nicht ab, fürchte aber die chinesische KI. Die New York Times berichtet, dass Moonshot bestimmten Nutzern von Kimi K3 Lizenzen auferlegen wird, um offene Verbreitung und Monetarisierung in Einklang zu bringen.La pubblicazione dei pesi avviene in un contesto geopolitico teso: lo stesso giorno, Anthropic ha pubblicato la sua posizione ufficiale sui modelli open-weight, mentre Dario Amodei dichiarava a TechCrunch di non opporsi ai modelli aperti ma di temere l'IA cinese. Il New York Times riporta che Moonshot imporrà licenze ad alcuni utenti di Kimi K3, tentando di conciliare diffusione aperta e monetizzazione.La publicazion di pes la riva in on contest geopolitich tes: el midem dì, Anthropic l'ha publicaa la soa posizion offizial in sui model open-weight, intant che Dario Amodei el diseva al TechCrunch de vess minga contrari ai model vert, ma de temer l'IA cinesa. El New York Times el reporta che Moonshot la imponarà di licenz a certi utent del Kimi K3, tentand de concilià spantegament vert e monetizazion.
Kimi K3 repose sur plusieurs innovations architecturales : l'attention Delta (Kimi Delta Attention) et les résidus d'attention (Attention Residuals) qui améliorent la circulation de l'information sur la profondeur du modèle, ainsi que Stable LatentMoE qui active 16 experts routés sur 896 par token. Selon Moonshot, ces avancées offrent un gain d'efficacité d'environ 2,5 fois par rapport à Kimi K2. Le post-entraînement a mobilisé un apprentissage par renforcement couvrant les domaines général, agentic et code, avec plusieurs niveaux d'effort de raisonnement.Kimi K3 is built on several architectural innovations: Delta Attention (Kimi Delta Attention) and Attention Residuals, which improve information flow across the model's depth, as well as Stable LatentMoE, which activates 16 routed experts out of 896 per token. According to Moonshot, these advances deliver an efficiency gain of approximately 2.5 times compared to Kimi K2. Post-training involved reinforcement learning across general, agentic, and code domains, with multiple levels of reasoning effort.Kimi K3 basiert auf mehreren architektonischen Innovationen: Delta Attention (Kimi Delta Attention) und Attention Residuals, die den Informationsfluss über die Modelltiefe verbessern, sowie Stable LatentMoE, das pro Token 16 von 896 Experten routet. Laut Moonshot bieten diese Fortschritte einen Effizienzgewinn von etwa dem 2,5-Fachen im Vergleich zu Kimi K2. Das Post-Training umfasste Reinforcement Learning in den Bereichen Allgemein, Agentic und Code mit mehreren Reasoning-Anstrengungsstufen.Kimi K3 si basa su diverse innovazioni architetturali: l'attenzione Delta (Kimi Delta Attention) e i residui di attenzione (Attention Residuals) che migliorano la circolazione dell'informazione sulla profondità del modello, così come Stable LatentMoE che attiva 16 esperti instradati su 896 per token. Secondo Moonshot, questi progressi offrono un guadagno di efficienza di circa 2,5 volte rispetto a Kimi K2. Il post-addestramento ha mobilitato un apprendimento per rinforzo che copre i domini generale, agentico e codice, con diversi livelli di sforzo di ragionamento.El Kimi K3 el se basa su diverse innovazion architetturai: l'attenzion Delta (Kimi Delta Attention) e i residov d'attenzion (Attention Residuals) che miglioren la circolazion de l'informazion in su la profondità del model, insema a Stable LatentMoE che l'ativa 16 espert rottà su 896 per token. Segond Moonshot, sti avanzament i offren on guadagn d'efficienza de circa 2,5 voeult rispett al Kimi K2. El post-training l'ha mobilitaa on apprendiment per rinforz che 'l quatta i domini general, agentic e code, con diversi nivej de sforz de resonament.