From a Lunch Table to an Infinite Universe: Fei-Fei Li Bets on AI's Next Dimension

marsbitPubblicato 2026-05-27Pubblicato ultima volta 2026-05-27

Introduzione

From a Lunch Table Conversation to an Infinite Universe: Fei-Fei Li Bets on AI's Next Frontier - Spatial Intelligence In an era dominated by large language models, AI pioneer Fei-Fei Li argues that true understanding requires spatial intelligence — the ability to perceive, reason, and interact within the physical 3D/4D world. She points to evolutionary history: spatial perception drove the Cambrian explosion 540 million years ago, while language is a far more recent, inherently "lossy" way to encode reality. Current models struggle with basic spatial tasks a child can do, like counting chairs in a video. Her company, World Labs, is pioneering this shift with "Marble," a model that generates navigable, consistent 3D worlds from text, images, or simple 3D inputs—distinct from video generators like Sora. Though smaller than models like GPT-5, due to scarce 3D data and early-stage scaling laws, Marble is already used in gaming, robot training (by NVIDIA), architectural design, and personalized therapy for conditions like OCD and acrophobia. Li envisions this technology enabling "infinite universes" for creativity, social interaction, and more. However, she cautions against utopian or dystopian extremes, advocating for a measured vision where AI enhances human dignity and prosperity, akin to how electricity transformed civilization. The journey is long — as evidenced by the 20-year path to viable autonomous vehicles — but the direction is clear: for AI to move from merely talki...

5 million years – that's the evolutionary age of human language. 540 million years – that's the starting point of the Cambrian explosion sparked by vision and spatial perception.

In 2025 and 2026, when nearly every top Silicon Valley lab was fiercely competing on language models, Professor Fei-Fei Li of Stanford University and founder of World Labs repeatedly raised a question that forced the industry to look up: If AI can only talk and look at pictures, it will never truly "understand" this world.

In three key interviews – the a16z Podcast in June 2025, the Cisco AI Summit in February 2026, and the in-depth 1-hour 19-minute Lenny's Podcast conversation released on May 22, 2026 – she systematically elaborated on a judgment that is being rapidly validated: Spatial Intelligence is the next frontier of AI.

Her statements in the a16z dialogue about "creating infinite universes" and "living in a multiverse," along with her views in Lenny's Podcast that "world models are the next frontier" and "AGI is more of a marketing term," have recently been widely reposted again on X.

"We Are Missing a World Model"

According to a16z partner Martin Casado, during a lunch meeting in Silicon Valley, a table full of AI practitioners was excitedly discussing large language models. Sitting at the other end of the table, Fei-Fei Li suddenly turned and asked him:

"Do you know what we are missing? We are missing a world model."

Casado, an early investor in World Labs and a long-time friend of Li's from her Stanford days, recalled that moment: "Everything clicked." He had independently reached a similar conclusion coming out of extensive investment in the image field: language is not the end of the story.

But Li's thinking on this issue goes back much further than most.

In April 2024, she gave a 15-minute TED Talk, using evolution as her starting point: The appearance of trilobites 540 million years ago allowed life to "see" the world for the first time. The birth of vision ignited an evolutionary race of intelligence, the nervous system began to develop, animals became active, and intelligence emerged. Language is merely a very recent product of this long race.

This judgment was repeatedly reinforced in the three interviews. At the Cisco AI Summit, her statement was more direct:

"Language's history is only about 500,000 years old. But 1.5 billion years ago, animals began to perceive light and touch their environment. The ability to understand, reason, interact, and navigate in the real 3D, 4D physical world is fundamental, as important as linguistic intelligence."

Li is not negating the value of linguistic intelligence. Her core argument is: Language is essentially a "lossy" way of encoding the world.

In the a16z interview, Casado conducted a thought experiment: Blindfold yourself, describe a room using language, then try to complete a task – your chance of success is extremely low. Because language's description of reality is always rough. Remove the blindfold, your brain instantly reconstructs the 3D space, and you can operate, touch, and move.

Li supplemented with a more extreme example from scientific history: Rosalind Franklin's X-ray diffraction photo of DNA was a flat, two-dimensional image, showing a pattern that looked like a cross with diffraction. But Watson and Crick reasoned from that two-dimensional photo to deduce the three-dimensional double-helix structure of DNA. "That structure cannot be two-dimensional. You cannot deduce that structure with two-dimensional thinking."

"If you observe human intelligence, much of it is beyond the scope of language. Language is a lossy way of capturing the world. Pure generative 'language' does not exist in nature; we look around, there are no ready-made sentences or words, yet the entire physical, perceptual, visual world exists."

This is a perspective easily overlooked: most capabilities of current large models are built on a format of information compression that is inherently lossy. In Lenny's Podcast, she used a more mundane test to puncture this illusion:

"Today, you take a model, give it a video clip showing a few office rooms, and ask the model to count the number of chairs. This is something a toddler can do, but AI cannot."

Not to mention deducing physical laws from celestial motion: "Let's give AI all the data, including modern instrument data that Newton didn't have, and ask it to create a set of 17th-century equations about the laws of object motion. Today's AI cannot do that."

Marble: Orders of Magnitude Smaller Than GPT-5

Pushing this judgment into a product is World Labs' first-generation model, Marble, released at the end of 2024.

At the Cisco AI Summit, Li detailed Marble's technical positioning: receiving text, images, video, or simple 3D inputs, and generating a "fully navigable, interactive, and permanently consistent 3D world." She specifically emphasized that this is fundamentally different from video generation models like Sora; environments generated by Marble possess geometric structure, not pixel animations that "look like" video.

In Lenny's Podcast, she used Plato's allegory of the cave for a deeper explanation: Prisoners are tied to chairs, only able to see two-dimensional shadows projected on the wall, but the real drama unfolds in the three-dimensional space behind them. Video models are those shadows, while spatial intelligence aims to create and reason about the real world behind those shadows.

A comparison: GPT-5's training compute is roughly on the order of 10^26 FLOPS, while Marble is several orders of magnitude smaller in scale. The reasons are two-fold: data acquisition difficulty is completely different (high-quality 3D physical data is extremely scarce), and this field is still in the early stages of the "scaling law upward curve."

In Lenny's Podcast, she further explained why robot learning cannot simply replicate the "bitter lesson" of language models. There is a famous assertion in AI: simple models with massive data will eventually surpass complex ones. But "language models have a perfect setup: the training data is words, and the output is also words." In robotics, "you want actions, but the training data lacks actions in the 3D world." This fundamental misalignment between training objectives and data form is the core challenge of robot learning.

World Labs employs a hybrid data strategy: internet-scale text, images, and video, plus simulation data, plus real-world captured data. Li admits, "We are still in the relatively early stages of exploring model architectures," but she expects "the next few years will be very exciting."

Right after, in February 2026, World Labs completed a $1 billion funding round, with participation from NVIDIA, AMD, a16z, valuing the company at around $5 billion, up from $1 billion a year earlier. In April, the team open-sourced the 3D Gaussian splatting rendering engine Spark 2.0, capable of real-time rendering of hundred-million-polygon 3D scenes in web browsers, shifting from a closed-source product to a dual-track strategy of "product + open-source ecosystem." The technical barrier for spatial intelligence is being rapidly lowered.

In Lenny's Podcast, Li also rarely revealed the hardships of entrepreneurship: "If I could whisper one thing to myself 18 months ago: 'The intensity of competition in this field, both technologically and for talent, far exceeds your imagination.'"

Infinite Universes and Multiverses

What really made that a16z interview go viral repeatedly on X was Li's statement about "infinite universes":

"In the entire history of human civilization, we have all lived together in one 3D world. Only a handful of people have been to the moon, but very few. And this technology makes digital virtual worlds incredibly rich. Suddenly, we can actually create infinite universes, some for robots, some for creativity, some for social interaction, some for travel, some for storytelling. Suddenly, we are able to live in a multiverse; the space for imagination is infinite."

Casado provided a more concrete technical explanation: from a single two-dimensional photo, the model can generate a complete 360-degree 3D representation, including the back of a table. You can manipulate, measure, stack—anything you can do in space can be achieved.

This is not science fiction. In the two interviews, Li listed applications where Marble is already being used:

• Game developers used early versions to create games

• A virtual production team collaborating with Sony reduced film production cycles by 40 times

• NVIDIA and multiple academic labs used Marble to train robots

• Architects and designers used it for interior design

• Clinical researchers created personalized immersive trigger environments for patients with OCD, acrophobia

• Someone used it to generate personalized yoga training spaces

The last application was particularly surprising. Li mentioned at the summit that OCD patients are triggered by very specific scenes, "for example, personally I am troubled by piles of dirty laundry, but everyone's trigger points are different." In Lenny's Podcast she added that after release, a friend called her overnight asking if Marble could be used to treat acrophobia. Building physical environments is extremely costly, while Marble only needs a prompt to generate various environments in minutes.

Plato's allegory of the cave is also the best entry point for understanding the 2D vs. 3D divergence.

Li used this allegory to explain: Prisoners tied to chairs can only see two-dimensional shadows projected on the wall. Current language models and video models are essentially those shadows, guessing 3D from 2D. The ambition of spatial intelligence is to create, reason about, and interact with the real world behind those shadows.

In terms of technical roadmap, she drew a clear boundary with a concise comparison:

"A car can be seen as a square robot moving on a two-dimensional plane, its goal is not to hit anything. A robot is a three-dimensional entity operating in a three-dimensional world; the goal of a general-purpose robot is to touch objects without breaking them. This is a higher-dimensional problem."

She also provided a timeline from personal experience: In 2006, she helped create the first self-driving car to travel 138 miles in the desert, predicting autonomous vehicles in 20 years. It wasn't until 2025 that Waymo began operating on city streets at scale.

"Seeing the North Star doesn't mean the journey will be short."

Casado added a more business-savvy observation in the a16z conversation: In the autonomous driving sector alone, the industry invested about $100 billion over 20 years to get where it is today. "Our original roadmap was to solve the world navigation problem first, but it turned out to be extremely difficult."

Li even shared a personal experience in the a16z interview to strengthen the point: About five years ago, she lost stereoscopic vision for several months due to a corneal injury. "Even though I knew very well how big my car was, roughly knew the size of my neighbor's parked car, and I had driven this road many years, I could not judge the distance between my car and the parked car very well. I could only drive at ten miles per hour to avoid scratching other cars."

A lifelong researcher of visual intelligence used her own firsthand struggle after losing depth perception to answer the question "why 3D is irreplaceable."

The Double-Edged Sword of Technology and the Measure of Civilization

Between technological optimism and doomsday rhetoric, Li chose a more restrained and actionable stance. She clearly expressed concern about polarized discourse at the Cisco AI Summit:

"The discussion online often tends to be black and white: either full-blown technological utopianism, ignoring that technology is a double-edged sword; or doomsday talk, as if human survival is at risk at any moment. For a technology so profound for human civilization, this way of discussion is irresponsible."

She didn't stop at criticism but offered a quantifiable anchor for value: electricity.

"If we rewind more than a hundred years, imagine how people then defined the success of electricity. I hope the vision then was: schools lit up, homes warm, machines empowered for industrialization, thereby extending human lifespans, allowing more children to be educated."

Then she applied this anchor to AI: "The definition of success should be that civilization becomes more beautiful, and civilization is composed of every individual pursuing happiness, prosperity, and dignity. That is the definition of success for AI and every technology."

At the end of Lenny's Podcast, she brought this concern down to specific people. She said wherever she goes, she is asked the same question: If I am a farmer, nurse, musician, will AI replace me? Her answer: "Ultimately, AI is about people. No technology should strip away human dignity. Human dignity and autonomy should be at the core of the development, deployment, and governance of every technology."

Looking back at the three interviews, a clear thread emerges.

Fei-Fei Li's thinking on spatial intelligence is not a rebellion against the wave of large models, but an extension built upon it. She saw the limits of language models earlier than most – what a lossy information compression format can do is ultimately limited. The problem spatial intelligence aims to solve is: evolving AI from "talking about the world" to "understanding the world," and ultimately to "acting in the world."

The World Labs team has about 30 people and has raised over $1 billion. Marble is the first-generation product, far smaller in scale than top language models. The scarcity of 3D data and the early state of model architectures determine this will not be a path achieved overnight. But Li said another thing in Lenny's Podcast, perhaps the best annotation for this patience:

"Our brains consume only about 20 watts, dimmer than any light bulb in the room, yet can do so much. The more I work in AI, the more I respect humans."

540 million years of evolution gave carbon-based life this 20-watt spatial intelligence. AI's evolution is being compressed to a few years.

Li did not give a timeline in the three interviews. She just repeatedly returned to that judgment extracted from evolution: perception precedes language, space precedes symbols. What is happening in Silicon Valley labs, Stanford labs, and World Labs offices is not a technological iteration, but an accelerated replay of evolution. (This article was first published on Titanium Media APP, author | Silicon Valley Tech News, editor | Zhao Hongyu)

Appendix: The text transcripts of the above three interviews are archived at 【ima Knowledge Base】 Fei-Fei Li Interviews https://ima.qq.com/wiki/?shareId=3f1d4b4c0d6cb2aeca250e2c5d068390e2d45895816ad607309820e25cb2e9c5

Domande pertinenti

QAccording to the article, what is the fundamental limitation of current large language models that Li Fei-Fei emphasizes?

AThey are built on a 'lossy' information compression format (language) that inherently fails to capture the full richness of the physical, 3D world. Language is a very recent evolutionary development and a poor representation of spatial understanding, which is foundational to intelligence.

QWhat is the core capability of World Labs' Marble model, and how does it fundamentally differ from video generation models like Sora?

AMarble takes text, images, video, or simple 3D inputs and generates a fully navigable, interactive, and persistent 3D world with geometric structure. It creates a true 3D environment, not just a 'video-like' sequence of pixels that looks 3D, as Sora does. Marble aims to create and reason about the real world behind the 'shadows' (2D projections).

QWhat major challenge in robotics learning does Li Fei-Fei highlight, contrasting it with the success of language models?

ARobotics faces a 'fundamental mismatch' between its training objective (actions in the 3D world) and its available data. Unlike language models where training data (words) perfectly matches the output (text), robotics lacks sufficient 'action' data from the real 3D world to effectively train models to perform physical actions.

QBeyond technological applications, what is the 'civilizational yardstick' or definition of success that Li Fei-Fei proposes for AI technology?

AShe defines success by the broader impact on civilization: AI should make civilization better, where civilization is composed of individuals pursuing happiness, prosperity, and dignity. The ultimate goal is that any technology should not deprive humans of their dignity, and human dignity and autonomy should be central to AI development, deployment, and governance.

QWhat personal experience did Li Fei-Fei share to illustrate the irreplaceable importance of 3D spatial perception?

AShe shared that about five years ago, she temporarily lost her stereoscopic vision (3D depth perception) due to a corneal injury. Even with her full knowledge of her car's size and the familiar road, she could not accurately judge distances and had to drive very slowly (around 10 mph) to avoid hitting parked cars, demonstrating the critical role of innate 3D spatial understanding for basic tasks.

Letture associate

Who Will Make Money in the Age of Agents?

In the Agents era of blockchain, traditional value capture theories face challenges. The "Fat Protocol" theory, dominant since 2016, suggested protocols capture most value as their tokens are essential for network use. However, the proliferation of interchangeable L1s, L2s, and modular layers has eroded protocol scarcity and pricing power. Conversely, the "Fat App" theory posits that applications capturing user relationships (like wallets and exchanges) become the primary value layer by controlling distribution and transaction flows. This aligns with the current "Great Repricing" cycle. Agents disrupt this logic. As software users, they lack brand loyalty, prioritize cost and efficiency, and switch between platforms seamlessly. This undermines the front-end UX moats that "Fat Apps" rely on. The article explores several potential futures: 1. **Headless Applications:** Current leading apps could strip their front-ends and become backend API infrastructure for Agents, preserving their role. 2. **Protocol Resurgence:** If integration becomes trivial, Agents might bypass aggregators and interact directly with protocols, reviving "Fat Protocol" dynamics. 3. **Pricing Power Collapse:** Agents' rational, frictionless routing could commoditize the entire stack, compressing margins toward cost and leaving little profit for intermediaries. 4. **Unprecedented Activity:** Agents may enable new, high-frequency, machine-to-machine economic activities, expanding the total value pie even if margins are thin. 5. **A New, Unnamed Model:** Historically, major tech shifts (like the internet's attention economy) create unforeseen business models. The Agents era may spawn entirely new ways to capture value. The most likely outcome is a coexistence where "Fat Apps" continue to serve human users valuing UX, while a separate, Agent-driven economy emerges governed by different rules—where loyalty is based on factors like liquidity, latency, and settlement guarantees rather than brand.

marsbit47 min fa

Who Will Make Money in the Age of Agents?

marsbit47 min fa

Who Will Make Money in the Age of Agents?

Who will capture value in an era where AI Agents become the primary blockchain users? Existing crypto value capture theories assume human users. "Fat Protocols" (2016) posited that protocols capture the most value as applications commoditize on open data, but this weakened as blockchain infrastructure proliferated and became interchangeable. The emerging "Fat Apps" theory argues applications capturing user relationships (like wallets and aggregators) win by controlling distribution and monetizing user flows. Agents fundamentally disrupt this logic. They don't value UX, brand, or convenience, bypassing the front-end moats of fat apps. This leads to several possible futures: 1. **"Headless" Apps**: Current app leaders (e.g., wallets) strip their front ends and become API infrastructure for Agents, preserving their value capture. 2. **Protocol Renaissance**: If integration is easy, Agents skip aggregators and interact directly with protocols, reviving the fat protocol thesis. 3. **Pricing Power Collapse**: Agents' rational, frictionless price shopping could commoditize the entire stack, compressing margins toward cost. Value flows to Agent owners or end-users. 4. **Unprecedented Activity**: Agents could enable entirely new, high-frequency economic activity (e.g., machine-to-machine commerce), expanding the total value pie. 5. **A New, Unnamed Model**: As with the internet's attention economy, a novel, unforeseen business model may emerge. Likely, human and Agent ecosystems will coexist with distinct value capture dynamics. For builders in the Agent realm, the key question shifts from UX to competitive advantages like liquidity, latency, or settlement guarantees that retain automated users.

链捕手1 h fa

Who Will Make Money in the Age of Agents?

链捕手1 h fa

Trading

Spot
Futures

Articoli Popolari

Cosa è $S$

Comprendere SPERO: Una Panoramica Completa Introduzione a SPERO Mentre il panorama dell'innovazione continua a evolversi, l'emergere delle tecnologie web3 e dei progetti di criptovaluta gioca un ruolo fondamentale nel plasmare il futuro digitale. Un progetto che ha attirato l'attenzione in questo campo dinamico è SPERO, denotato come SPERO,$$s$. Questo articolo mira a raccogliere e presentare informazioni dettagliate su SPERO, per aiutare gli appassionati e gli investitori a comprendere le sue basi, obiettivi e innovazioni nei domini web3 e crypto. Che cos'è SPERO,$$s$? SPERO,$$s$ è un progetto unico all'interno dello spazio crypto che cerca di sfruttare i principi della decentralizzazione e della tecnologia blockchain per creare un ecosistema che promuove l'impegno, l'utilità e l'inclusione finanziaria. Il progetto è progettato per facilitare interazioni peer-to-peer in modi nuovi, fornendo agli utenti soluzioni e servizi finanziari innovativi. Al suo interno, SPERO,$$s$ mira a responsabilizzare gli individui fornendo strumenti e piattaforme che migliorano l'esperienza dell'utente nello spazio delle criptovalute. Questo include la possibilità di metodi di transazione più flessibili, la promozione di iniziative guidate dalla comunità e la creazione di percorsi per opportunità finanziarie attraverso applicazioni decentralizzate (dApps). La visione sottostante di SPERO,$$s$ ruota attorno all'inclusività, cercando di colmare le lacune all'interno della finanza tradizionale mentre sfrutta i vantaggi della tecnologia blockchain. Chi è il Creatore di SPERO,$$s$? L'identità del creatore di SPERO,$$s$ rimane piuttosto oscura, poiché ci sono risorse pubblicamente disponibili limitate che forniscono informazioni dettagliate sul suo fondatore o fondatori. Questa mancanza di trasparenza può derivare dall'impegno del progetto per la decentralizzazione—un ethos che molti progetti web3 condividono, dando priorità ai contributi collettivi rispetto al riconoscimento individuale. Centrando le discussioni attorno alla comunità e ai suoi obiettivi collettivi, SPERO,$$s$ incarna l'essenza dell'empowerment senza mettere in evidenza individui specifici. Pertanto, comprendere l'etica e la missione di SPERO rimane più importante che identificare un creatore singolo. Chi sono gli Investitori di SPERO,$$s$? SPERO,$$s$ è supportato da una varietà di investitori che vanno dai capitalisti di rischio agli investitori angelici dedicati a promuovere l'innovazione nel settore crypto. Il focus di questi investitori generalmente si allinea con la missione di SPERO—dando priorità a progetti che promettono avanzamenti tecnologici sociali, inclusività finanziaria e governance decentralizzata. Queste fondazioni di investitori sono tipicamente interessate a progetti che non solo offrono prodotti innovativi, ma contribuiscono anche positivamente alla comunità blockchain e ai suoi ecosistemi. Il supporto di questi investitori rafforza SPERO,$$s$ come un concorrente degno di nota nel dominio in rapida evoluzione dei progetti crypto. Come Funziona SPERO,$$s$? SPERO,$$s$ impiega un framework multifunzionale che lo distingue dai progetti di criptovaluta convenzionali. Ecco alcune delle caratteristiche chiave che sottolineano la sua unicità e innovazione: Governance Decentralizzata: SPERO,$$s$ integra modelli di governance decentralizzati, responsabilizzando gli utenti a partecipare attivamente ai processi decisionali riguardanti il futuro del progetto. Questo approccio favorisce un senso di proprietà e responsabilità tra i membri della comunità. Utilità del Token: SPERO,$$s$ utilizza il proprio token di criptovaluta, progettato per servire varie funzioni all'interno dell'ecosistema. Questi token abilitano transazioni, premi e la facilitazione dei servizi offerti sulla piattaforma, migliorando l'impegno e l'utilità complessivi. Architettura Stratificata: L'architettura tecnica di SPERO,$$s$ supporta la modularità e la scalabilità, consentendo un'integrazione fluida di funzionalità e applicazioni aggiuntive man mano che il progetto evolve. Questa adattabilità è fondamentale per mantenere la rilevanza nel panorama crypto in continua evoluzione. Coinvolgimento della Comunità: Il progetto enfatizza iniziative guidate dalla comunità, impiegando meccanismi che incentivano la collaborazione e il feedback. Nutrendo una comunità forte, SPERO,$$s$ può affrontare meglio le esigenze degli utenti e adattarsi alle tendenze di mercato. Focus sull'Inclusione: Offrendo basse commissioni di transazione e interfacce user-friendly, SPERO,$$s$ mira ad attrarre una base utenti diversificata, inclusi individui che potrebbero non aver precedentemente interagito nello spazio crypto. Questo impegno per l'inclusione si allinea con la sua missione generale di empowerment attraverso l'accessibilità. Cronologia di SPERO,$$s$ Comprendere la storia di un progetto fornisce preziose intuizioni sulla sua traiettoria di sviluppo e sui traguardi. Di seguito è riportata una cronologia suggerita che mappa eventi significativi nell'evoluzione di SPERO,$$s$: Fase di Concettualizzazione e Ideazione: Le idee iniziali che formano la base di SPERO,$$s$ sono state concepite, allineandosi strettamente con i principi di decentralizzazione e focus sulla comunità all'interno dell'industria blockchain. Lancio del Whitepaper del Progetto: Dopo la fase concettuale, è stato rilasciato un whitepaper completo che dettaglia la visione, gli obiettivi e l'infrastruttura tecnologica di SPERO,$$s$ per suscitare interesse e feedback dalla comunità. Costruzione della Comunità e Prime Interazioni: Sono stati effettuati sforzi attivi di outreach per costruire una comunità di early adopters e potenziali investitori, facilitando discussioni attorno agli obiettivi del progetto e ottenendo supporto. Evento di Generazione del Token: SPERO,$$s$ ha condotto un evento di generazione del token (TGE) per distribuire i propri token nativi ai primi sostenitori e stabilire una liquidità iniziale all'interno dell'ecosistema. Lancio della Prima dApp: La prima applicazione decentralizzata (dApp) associata a SPERO,$$s$ è stata attivata, consentendo agli utenti di interagire con le funzionalità principali della piattaforma. Sviluppo Continuo e Partnership: Aggiornamenti e miglioramenti continui alle offerte del progetto, inclusi partnership strategiche con altri attori nello spazio blockchain, hanno plasmato SPERO,$$s$ in un concorrente competitivo e in evoluzione nel mercato crypto. Conclusione SPERO,$$s$ rappresenta una testimonianza del potenziale del web3 e delle criptovalute di rivoluzionare i sistemi finanziari e responsabilizzare gli individui. Con un impegno per la governance decentralizzata, il coinvolgimento della comunità e funzionalità progettate in modo innovativo, apre la strada verso un panorama finanziario più inclusivo. Come per qualsiasi investimento nello spazio crypto in rapida evoluzione, si incoraggiano potenziali investitori e utenti a ricercare approfonditamente e a impegnarsi in modo riflessivo con gli sviluppi in corso all'interno di SPERO,$$s$. Il progetto mostra lo spirito innovativo dell'industria crypto, invitando a ulteriori esplorazioni delle sue innumerevoli possibilità. Mentre il percorso di SPERO,$$s$ è ancora in fase di sviluppo, i suoi principi fondamentali potrebbero effettivamente influenzare il futuro di come interagiamo con la tecnologia, la finanza e tra di noi in ecosistemi digitali interconnessi.

75 Totale visualizzazioniPubblicato il 2024.12.17Aggiornato il 2024.12.17

Cosa è $S$

Cosa è AGENT S

Agent S: Il Futuro dell'Interazione Autonoma in Web3 Introduzione Nel panorama in continua evoluzione di Web3 e criptovalute, le innovazioni stanno costantemente ridefinendo il modo in cui gli individui interagiscono con le piattaforme digitali. Uno di questi progetti pionieristici, Agent S, promette di rivoluzionare l'interazione uomo-computer attraverso il suo framework agentico aperto. Aprendo la strada a interazioni autonome, Agent S mira a semplificare compiti complessi, offrendo applicazioni trasformative nell'intelligenza artificiale (AI). Questa esplorazione dettagliata approfondirà le complessità del progetto, le sue caratteristiche uniche e le implicazioni per il dominio delle criptovalute. Cos'è Agent S? Agent S si presenta come un innovativo framework agentico aperto, progettato specificamente per affrontare tre sfide fondamentali nell'automazione dei compiti informatici: Acquisizione di Conoscenze Specifiche del Dominio: Il framework apprende in modo intelligente da varie fonti di conoscenza esterne ed esperienze interne. Questo approccio duale gli consente di costruire un ricco repository di conoscenze specifiche del dominio, migliorando le sue prestazioni nell'esecuzione dei compiti. Pianificazione su Lungo Orizzonte di Compiti: Agent S impiega una pianificazione gerarchica potenziata dall'esperienza, un approccio strategico che facilita la suddivisione e l'esecuzione efficiente di compiti complessi. Questa caratteristica migliora significativamente la sua capacità di gestire più sottocompiti in modo efficiente ed efficace. Gestione di Interfacce Dinamiche e Non Uniformi: Il progetto introduce l'Interfaccia Agente-Computer (ACI), una soluzione innovativa che migliora l'interazione tra agenti e utenti. Utilizzando Modelli Linguistici Multimodali di Grandi Dimensioni (MLLM), Agent S può navigare e manipolare senza sforzo diverse interfacce grafiche utente. Attraverso queste caratteristiche pionieristiche, Agent S fornisce un framework robusto che affronta le complessità coinvolte nell'automazione dell'interazione umana con le macchine, preparando il terreno per innumerevoli applicazioni nell'AI e oltre. Chi è il Creatore di Agent S? Sebbene il concetto di Agent S sia fondamentalmente innovativo, informazioni specifiche sul suo creatore rimangono elusive. Il creatore è attualmente sconosciuto, il che evidenzia sia la fase embrionale del progetto sia la scelta strategica di mantenere i membri fondatori sotto anonimato. Indipendentemente dall'anonimato, l'attenzione rimane sulle capacità e sul potenziale del framework. Chi sono gli Investitori di Agent S? Poiché Agent S è relativamente nuovo nell'ecosistema crittografico, informazioni dettagliate riguardanti i suoi investitori e sostenitori finanziari non sono documentate esplicitamente. La mancanza di approfondimenti pubblicamente disponibili sulle fondazioni di investimento o sulle organizzazioni che supportano il progetto solleva interrogativi sulla sua struttura di finanziamento e sulla roadmap di sviluppo. Comprendere il supporto è cruciale per valutare la sostenibilità del progetto e il suo potenziale impatto sul mercato. Come Funziona Agent S? Al centro di Agent S si trova una tecnologia all'avanguardia che gli consente di funzionare efficacemente in contesti diversi. Il suo modello operativo è costruito attorno a diverse caratteristiche chiave: Interazione Uomo-Computer Simile a Quella Umana: Il framework offre una pianificazione AI avanzata, cercando di rendere le interazioni con i computer più intuitive. Mimando il comportamento umano nell'esecuzione dei compiti, promette di elevare le esperienze degli utenti. Memoria Narrativa: Utilizzata per sfruttare esperienze di alto livello, Agent S utilizza la memoria narrativa per tenere traccia delle storie dei compiti, migliorando così i suoi processi decisionali. Memoria Episodica: Questa caratteristica fornisce agli utenti una guida passo-passo, consentendo al framework di offrire supporto contestuale mentre i compiti si sviluppano. Supporto per OpenACI: Con la capacità di funzionare localmente, Agent S consente agli utenti di mantenere il controllo sulle proprie interazioni e flussi di lavoro, allineandosi con l'etica decentralizzata di Web3. Facile Integrazione con API Esterne: La sua versatilità e compatibilità con varie piattaforme AI garantiscono che Agent S possa adattarsi senza problemi agli ecosistemi tecnologici esistenti, rendendolo una scelta attraente per sviluppatori e organizzazioni. Queste funzionalità contribuiscono collettivamente alla posizione unica di Agent S all'interno dello spazio crittografico, poiché automatizza compiti complessi e multi-fase con un intervento umano minimo. Man mano che il progetto evolve, le sue potenziali applicazioni in Web3 potrebbero ridefinire il modo in cui si svolgono le interazioni digitali. Cronologia di Agent S Lo sviluppo e le tappe di Agent S possono essere riassunti in una cronologia che evidenzia i suoi eventi significativi: 27 Settembre 2024: Il concetto di Agent S è stato lanciato in un documento di ricerca completo intitolato “Un Framework Agentico Aperto che Usa i Computer Come un Umano”, mostrando le basi per il progetto. 10 Ottobre 2024: Il documento di ricerca è stato reso pubblicamente disponibile su arXiv, offrendo un'esplorazione approfondita del framework e della sua valutazione delle prestazioni basata sul benchmark OSWorld. 12 Ottobre 2024: È stata rilasciata una presentazione video, fornendo un'idea visiva delle capacità e delle caratteristiche di Agent S, coinvolgendo ulteriormente potenziali utenti e investitori. Questi indicatori nella cronologia non solo illustrano i progressi di Agent S, ma indicano anche il suo impegno per la trasparenza e il coinvolgimento della comunità. Punti Chiave su Agent S Man mano che il framework Agent S continua a evolversi, diversi attributi chiave si distinguono, sottolineando la sua natura innovativa e il potenziale: Framework Innovativo: Progettato per fornire un uso intuitivo dei computer simile all'interazione umana, Agent S porta un approccio nuovo all'automazione dei compiti. Interazione Autonoma: La capacità di interagire autonomamente con i computer attraverso GUI segna un passo avanti verso soluzioni informatiche più intelligenti ed efficienti. Automazione di Compiti Complessi: Con la sua metodologia robusta, può automatizzare compiti complessi e multi-fase, rendendo i processi più veloci e meno soggetti a errori. Miglioramento Continuo: I meccanismi di apprendimento consentono ad Agent S di migliorare dalle esperienze passate, migliorando continuamente le sue prestazioni e la sua efficacia. Versatilità: La sua adattabilità attraverso diversi ambienti operativi come OSWorld e WindowsAgentArena garantisce che possa servire un'ampia gamma di applicazioni. Man mano che Agent S si posiziona nel panorama di Web3 e delle criptovalute, il suo potenziale per migliorare le capacità di interazione e automatizzare i processi segna un significativo avanzamento nelle tecnologie AI. Attraverso il suo framework innovativo, Agent S esemplifica il futuro delle interazioni digitali, promettendo un'esperienza più fluida ed efficiente per gli utenti in vari settori. Conclusione Agent S rappresenta un audace passo avanti nell'unione tra AI e Web3, con la capacità di ridefinire il modo in cui interagiamo con la tecnologia. Sebbene sia ancora nelle sue fasi iniziali, le possibilità per la sua applicazione sono vaste e coinvolgenti. Attraverso il suo framework completo che affronta sfide critiche, Agent S mira a portare le interazioni autonome al centro dell'esperienza digitale. Man mano che ci addentriamo nei regni delle criptovalute e della decentralizzazione, progetti come Agent S giocheranno senza dubbio un ruolo cruciale nel plasmare il futuro della tecnologia e della collaborazione uomo-computer.

526 Totale visualizzazioniPubblicato il 2025.01.14Aggiornato il 2025.01.14

Cosa è AGENT S

Come comprare S

Benvenuto in HTX.com! Abbiamo reso l'acquisto di Sonic (S) semplice e conveniente. Segui la nostra guida passo passo per intraprendere il tuo viaggio nel mondo delle criptovalute.Step 1: Crea il tuo Account HTXUsa la tua email o numero di telefono per registrarti il tuo account gratuito su HTX. Vivi un'esperienza facile e sblocca tutte le funzionalità,Crea il mio accountStep 2: Vai in Acquista crypto e seleziona il tuo metodo di pagamentoCarta di credito/debito: utilizza la tua Visa o Mastercard per acquistare immediatamente SonicS.Bilancio: Usa i fondi dal bilancio del tuo account HTX per fare trading senza problemi.Terze parti: abbiamo aggiunto metodi di pagamento molto utilizzati come Google Pay e Apple Pay per maggiore comodità.P2P: Fai trading direttamente con altri utenti HTX.Over-the-Counter (OTC): Offriamo servizi su misura e tassi di cambio competitivi per i trader.Step 3: Conserva Sonic (S)Dopo aver acquistato Sonic (S), conserva nel tuo account HTX. In alternativa, puoi inviare tramite trasferimento blockchain o scambiare per altre criptovalute.Step 4: Scambia Sonic (S)Scambia facilmente Sonic (S) nel mercato spot di HTX. Accedi al tuo account, seleziona la tua coppia di trading, esegui le tue operazioni e monitora in tempo reale. Offriamo un'esperienza user-friendly sia per chi ha appena iniziato che per i trader più esperti.

939 Totale visualizzazioniPubblicato il 2025.01.15Aggiornato il 2025.03.21

Come comprare S

Discussioni

Benvenuto nella Community HTX. Qui puoi rimanere informato sugli ultimi sviluppi della piattaforma e accedere ad approfondimenti esperti sul mercato. Le opinioni degli utenti sul prezzo di S S sono presentate come di seguito.

活动图片