← Nieuwste papers
💬 NLP

OneSearch-V2: The Latent Reasoning Enhanced Self-distillation Generative Search Framework

OneSearch-V2 is een generatief zoekframework dat door middel van latente redenering en zelfdistillatie complexe zoekopdrachten beter begrijpt en gebruikersintenties onthult, wat resulteert in significante verbeteringen in klik- en conversiepercentages zonder extra inferentiekosten.

Oorspronkelijke auteurs: Ben Chen, Siyuan Wang, Yufei Ma, Zihan Liang, Xuxin Zhang, Yue Lv, Ying Yang, Huangyu Dai, Lingtao Mao, Tong Zhao, Zhipeng Qian, Xinyu Sun, Zhixin Zhai, Yang Zhao, Bochao Liu, Jingshan Lv, Xiao Liang
Gepubliceerd 2026-03-26
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Ben Chen, Siyuan Wang, Yufei Ma, Zihan Liang, Xuxin Zhang, Yue Lv, Ying Yang, Huangyu Dai, Lingtao Mao, Tong Zhao, Zhipeng Qian, Xinyu Sun, Zhixin Zhai, Yang Zhao, Bochao Liu, Jingshan Lv, Xiao Liang, Hui Kong, Jing Chen, Han Li, Chenyi Lei, Wenwu Ou, Kun Gai

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een enorme, levendige digitale winkel bezoekt: Kuaishou Mall. In deze winkel werkt er een superintelligente assistent, genaamd OneSearch. Zijn taak is simpel: als jij iets zoekt, moet hij direct de perfecte producten voor je vinden.

In het verleden (versie 1) was deze assistent slim, maar hij had een paar mankementen. Hij kon soms niet goed begrijpen wat je precies bedoelde als je een vaag woord gebruikte, hij keek alleen naar wat mensen in het verleden hadden gekocht (en miste dus nieuwe trends), en hij werd soms te vastgeplakt aan oude voorkeuren, waardoor hij steeds dezelfde producten voorstelde.

De auteurs van dit artikel hebben OneSearch-V2 bedacht. Dit is een enorme upgrade. Laten we de drie grote verbeteringen bekijken met een paar creatieve vergelijkingen:

1. De "Denk-stap" voor complexe vragen (Thought-Augmented Query Understanding)

Het probleem: Stel je zoekt naar "cadeau voor vriendin". De oude assistent dacht: "Oh, cadeaus? Dan maar een horloge." Maar wat als ze dol is op planten? Of als ze allergisch is voor bloemen? De oude assistent zag de nuance niet.
De oplossing: OneSearch-V2 leert eerst nadenken voordat hij antwoordt.

  • De Analogie: Stel je voor dat de oude assistent een snelkookpan was die direct schreeuwde: "HIER IS EEN HORIZONTE!"
  • De nieuwe assistent is als een chef-kok die eerst even stopt, de ingrediënten bekijkt, en zegt: "Oké, de klant wil een cadeau. Ze houdt van natuur, maar is allergisch voor bloemen. Laten we een mooie potplant in een keramische pot voorstellen, geen snijbloemen."
  • In de techniek noemen ze dit "Chain-of-Thought" (Denkrij). Ze laten een slimme AI eerst een lijstje met sleutelwoorden bedenken (bijv. "allergie", "plant", "cadeau") en gebruiken dit als een geheime tip voor de assistent. Zo begrijpt hij de intentie achter je zoekwoord, niet alleen het woord zelf.

2. Het "Geheime Oefenboek" (Reasoning-Internalized Self-Distillation)

Het probleem: Als de assistent elke keer eerst die lange "denk-stap" moet doen, wordt hij te traag. In een echte winkel wil je geen assistent die 10 seconden stil staat om na te denken; je wilt een snelle reactie.
De oplossing: Ze laten de assistent oefenen met de "denk-stap", maar dan zonder dat hij het later hardop hoeft te zeggen.

  • De Analogie: Stel je voor dat je een student bent die een examen moet doen.
    • Versie 1: De leraar geeft je de oplossing en zegt: "Kijk, hier is het antwoord."
    • Versie 2 (V2): De leraar geeft je eerst de oplossing met de uitleg (de "denk-stap"). Jij oefent dit heel vaak. Uiteindelijk, op het moment van het examen, heb je de uitleg niet meer nodig; je weet het antwoord gewoon intuïtief. Het is alsof het denken in je spiergeheugen is opgeslagen.
  • Dit heet "Zelf-distillatie". De AI leert van een "leraar" (die de denk-stap ziet) en wordt dan getraind om hetzelfde resultaat te geven zonder die stap te zien. Het resultaat? Even slim, maar veel sneller. Geen vertraging voor de gebruiker.

3. De "Echte Klantfeedback" in plaats van een Statische Score (Behavior Feedback Alignment)

Het probleem: De oude assistent leerde van een statische lijst met "wat mensen vroeger hebben gekocht". Dit leidde tot een "echo-kamer": als iedereen vroeger blauwe truien kocht, zag de assistent alleen blauwe truien, zelfs als de klant nu een groene trui wilde. Hij kon niet goed omgaan met nieuwe producten of specifieke wensen.
De oplossing: De assistent kijkt niet meer naar een statische lijst, maar reageert direct op wat jij nu doet.

  • De Analogie:
    • Oude methode: Een menukaart die elke maand wordt geüpdatet op basis van wat er gisteren het meest werd besteld. Als je vandaag iets anders wilt, staat het er niet op.
    • Nieuwe methode (V2): Een live-kok die naar je kijkt. Als je zegt "Ik wil iets lekkers, maar geen suiker", en je kijkt naar een fruittaart, dan schuift hij die direct naar voren. Hij leert direct van je klikken, je in het winkelmandje leggen en je kopen.
  • Ze gebruiken een slim systeem dat niet alleen kijkt of je klikt, maar ook waarom je klikt (is het relevant? heb je het gekocht?). Dit voorkomt dat de assistent vastloopt in oude patronen en zorgt dat nieuwe, minder bekende producten (de "lange staart") ook een kans krijgen.

Wat levert dit op?

De resultaten zijn indrukwekkend:

  • Meer klikken: Mensen klikken 3,98% vaker op de producten die worden getoond.
  • Meer verkopen: De verkoop (conversie) gaat met 2,90% omhoog.
  • Beter voor iedereen: Het werkt niet alleen voor de populaire producten, maar ook voor de obscure, nieuwe spullen en voor mensen met specifieke, moeilijke wensen.
  • Geen trager systeem: Ondanks dat het "slimmer" is, is het niet langzamer. De assistent denkt sneller dan ooit.

Kortom: OneSearch-V2 is als het verschil tussen een robot die een woordenboek opzoekt en een menselijke expert die je kent, begrijpt wat je echt nodig hebt, en dat direct en snel voor je regelt. Het is een stap in de richting van een zoekmachine die écht "denkt" in plaats van alleen maar matcht.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →