VVV alcanza un nuevo máximo histórico: ¿cómo ve el fundador el modelo, la privacidad y el Crypto?

By: www.theblockbeats.info|2026/09/23 08:30:06

Título original: Why Erik Voorhees Says Crypto Was Really Built for AI Agents: Uneasy Money Fuente original: Unchained

Nota del editor: Venice es una plataforma de IA privada construida sobre Base, que no entrena modelos por sí misma, sino que agrega modelos de código cerrado y abierto de todo el mundo en un solo acceso, y se compromete a no retener datos de la parte que aloja. Su token VVV no se cobra por uso, sino que se obtiene mediante staking a cambio de un límite diario de inferencia, y los ingresos de la plataforma se utilizan para recomprar y quemar, lo que reduce continuamente la circulación. En el último mes, VVV ha aumentado más del noventa por ciento, alcanzando recientemente un máximo histórico de 34,53 dólares. En un momento en que la comercialización de la inferencia de IA se acelera y la narrativa de los tokens pierde efectividad, Venice ofrece un caso raro: un producto de consumo que genera ingresos reales y cómo se utiliza el token de manera efectiva.

El 22 de agosto de 2026, el fundador de Venice, Erik Voorhees, fue invitado al podcast Unchained. Habló sobre por qué eligió incluir el token en Venice en lugar de cambiar completamente a la IA, las diferencias fundamentales en la percepción del poder entre el mundo cripto y el de la IA, cómo Venice agrega modelos globales y garantiza la privacidad, y cómo se monetiza en una industria donde la inferencia se está comercializando continuamente. A continuación se presenta el contenido original del podcast:

¿Por qué elegiste incluir el token en Venice en lugar de cambiar completamente a la IA?

Primero, no puedo salir del mundo cripto, ya que fluye en mi sangre. Me importa mucho porque es una nueva forma de mover dinero en todo el mundo. Y el dinero está intrínsecamente relacionado con todas las actividades comerciales, así que no creo que deba ser un ecosistema por sí mismo; de hecho, así es como comenzó a desarrollarse. Prefiero ver que los mejores "primitivos" del mundo cripto y DeFi comiencen a salir del mundo cripto y realmente entren en cosas comunes. Si todo se trata de "los cripto hacen productos cripto para los cripto", entonces realmente hemos fracasado.

Así que quiero llevar algunos primitivos a Venice y mostrar al mundo que estas tecnologías no son solo para especular sobre el precio de los tokens. Son mecanismos de incentivos: hay muchas maneras de fracasar, pero también algunas formas de tener éxito, y queremos demostrar esto en una aplicación de consumo orientada al mercado masivo.

El mundo quiere inferencia, y la inferencia es naturalmente adecuada para pagos cripto. ¿Es este tu punto de emoción?

Ese no es realmente nuestro punto de emoción. El cripto, por supuesto, puede usarse para pagos, esa es la primera capa, la capacidad más básica; si alguien quiere comprar puntos de IA en Venice, puede pagar con cripto, pero para mí eso es solo una barrera de entrada, no hay diferencia esencial con "el cripto es un método de pago como Visa o Stripe".

Lo que encuentro más interesante es que las personas puedan tener participación en una plataforma y un proyecto. Por ejemplo: todos los laboratorios de IA principales son privados (Google es la excepción). Debido a que son privados, la gente común no puede obtener nada de su éxito. Esto está creando una gran ansiedad; la gente ve cómo la IA toma el control del mundo y crea enormes riquezas, mientras que ellos solo pueden sentarse y preocuparse por cuándo les robarán su trabajo. No importa si esta impresión es correcta o no, muchas personas piensan así. Creo que esta situación se puede evitar.

Así que Venice tiene un token; aún no hemos implementado todos los métodos que planeamos usar, pero queremos que los usuarios tengan una participación en el crecimiento de Venice desde el principio. Cómo hacerlo debe ser cuidadoso, pero creo que es una forma más justa y también más interesante de hacer negocios: los usuarios no son solo consumidores, sino participantes contigo.

¿Qué diseño de incentivos aún no se ha implementado?

Hay algo que aún no hemos anunciado ni implementado, y lo diré: queremos tomar una parte del dinero que los usuarios nos pagan, ya sea por suscripciones mensuales o por la compra de puntos, y usarlo para comprar VVV en el mercado y devolverlo a los usuarios, con la condición de que permanezcan en la plataforma por un tiempo. Esencialmente, estás "comprando lealtad", y esto te da la oportunidad de educar a los usuarios; si les gusta el producto y se quedan, al final obtienen una participación gratuita. Esto hará que los usuarios sean más leales.

Esta es la forma que prefiero: no quiero ir a los usuarios y decir "hey, tenemos un token, ¡cómpralo ya!", eso se siente un poco sucio. Pero si ya están gastando dinero en Venice, y nosotros les devolvemos una parte de lo que ganamos en forma de tokens del proyecto, eso es un plan de recompensas muy genial para una buena parte de los usuarios.

Precio de --

--
--
--

¿Cuál debería ser el objetivo final del cripto?

La gente ha estado experimentando con el cripto durante tantos años que se ha olvidado de que al final debe servir a algo más. Bitcoin sirve al propósito de ser una moneda base; cada otra criptomoneda debe hacer algo diferente y estar en otro nivel de la pila tecnológica. ETH impulsa una plataforma de contratos inteligentes, ese es su propósito y producto. Cada cosa debe estar vinculada a un producto que está sirviendo. Y hemos llegado a un punto en el que "la moneda en sí misma es el producto", lo cual nunca debió ser así; debería incentivar y coordinar cosas fuera de sí misma. Si lo que está sirviendo es a sí mismo, se convierte en una referencia completamente auto-referencial.

Además, esto es una carrera hacia el fondo, que es precisamente lo que hemos visto en los últimos años: monedas meme, y memes por el mero hecho de ser memes. En ese momento no estás ampliando el pastel, solo moviéndolo de un lado a otro. Si la gente quiere apostar en monedas meme, Dios los bendiga, tienen ese derecho; la gente tiene derecho a jugar en el casino, eso está completamente bien. Pero no aporta nada a la sociedad; es un entretenimiento consumible. Lo triste es que muchos proyectos se convierten en monedas meme, en parte porque hacer algo realmente significativo, desde una perspectiva de cumplimiento y regulación, conlleva más riesgos. Después de la burbuja de ICO de 2017, pasamos varios años mirando solo monedas meme, y los proyectos que realmente llevaban tokens legítimos prácticamente desaparecieron; DeFi Summer fue la última excepción. Eso es realmente trágico.

¿Cuál es la diferencia en la forma en que el mundo cripto y el mundo de la IA abordan la regulación y el poder?

Esta es en realidad una de las razones por las que fundé Venice. En el mundo cripto, tenemos principios, al menos decimos que los tenemos; algunas personas realmente se esfuerzan por practicarlos, muchas solo lo dicen, pero al menos tenemos un conjunto de principios que pueden mantener cierto nivel de lealtad, y estos principios son en gran medida compartidos: descentralización, privacidad, soberanía individual, dispersión del poder. En los detalles, discutimos ferozmente, pero en la dirección estamos alineados.

En el mundo de la IA, esto es una generalización, no es así en absoluto. La historia de la IA es mucho más larga que la del cripto; la academia ha estado investigando esto durante sesenta o setenta años. La mentalidad dominante en ese mundo es que las personas muy inteligentes creen que "todo debe ser controlado"; lo que realmente importa es "quién controla" y "cuáles son las reglas". Es muy de arriba hacia abajo, muy concentrado en el poder, y la preocupación central es "asegurarse de que las personas correctas estén en el poder".

Surge de un ecosistema así: profesores de Harvard con tenure, etc.; también proviene de cómo se ha financiado durante décadas, y de la personalidad científica que a menudo tienen las personas más inteligentes: "soy el maestro de mi campo, y estoy seguro de que también hay un maestro en cada campo, incluida la sociedad misma". La falacia lógica está aquí: confunden "áreas estrechas que pueden ser entendidas" con "sistemas complejos que no pueden ser entendidos".

Cuando comencé a involucrarme en esto hace dos años y medio, en el mundo de la IA nadie se preocupaba por la privacidad, nadie se preocupaba por la descentralización, nadie se preocupaba por la soberanía del usuario. Por el contrario: todos decían "esta tecnología es extremadamente peligrosa, el gobierno debe regularla de inmediato, todos deben ser monitoreados, tus prompts deben ser revisados, las respuestas también deben ser revisadas, todo debe ser controlado estrictamente, y nuestro pecado es que no controlamos lo suficiente". Esa es completamente una secta diferente, es una visión apocalíptica del mundo. Se ve bastante extraño. Pero para la gente común, lo extraño en realidad somos nosotros; nosotros somos los anómalos, y el problema es que hemos estado en este campo demasiado tiempo.

Lo que vi en ese momento fue que la IA claramente iba a comenzar a tomar el control del mundo, OpenAI y Anthropic estaban a la vanguardia con modelos, y eran muy de arriba hacia abajo, muy unidimensionales, querían controlar todo; "usamos un conjunto de reglas para ejecutar la seguridad, el gobierno nos regula, y simplemente hacemos lo que el gobierno dice, la sociedad debe organizarse de esta manera". En mi opinión, esto llevaría a un resultado muy distópico: la inteligencia de las máquinas en sí misma llega a través de la voz oficial del estado. Ese es el resultado peligroso. Así que a menudo bromeo diciendo que Venice es una "empresa de seguridad de IA", cuyo objetivo es evitar que eso suceda.

¿El poder debería ser más centralizado o más descentralizado?

En esencia, hay dos marcos: uno, "esta cosa es claramente poderosa y potencialmente peligrosa, así que debe ser centralizada"; el otro, "esta cosa es poderosa y potencialmente peligrosa, así que debe ser descentralizada". La gente del cripto generalmente cae en el segundo, mientras que la mayoría de la gente de la IA cae en el primero.

Y creo que nadie realmente sabe cómo se desarrollará todo esto; todos están, como es habitual en la humanidad, haciendo y editando sobre la marcha, y todos pretenden tener más confianza en el futuro de lo que realmente tienen.

Sobre la descentralización: ¿pueden las herramientas del cripto usarse para combatir la centralización de la IA?

Uno de los mejores argumentos a favor de la descentralización es su humildad: el futuro es en realidad muy complejo, no sabemos las respuestas, y eso es aceptable; no deberíamos pretender tener conocimientos que no poseemos. Si algo es descentralizado, los problemas suelen ser al menos locales, no catastróficos o sistémicos.

Desde nuestra perspectiva, toda esta serie de herramientas que la industria cripto ha creado en los últimos 15 años está diseñada precisamente para "descentralizar este tipo de cosas". Nos hemos obsesionado un poco con "hacer por hacer", auto-referencial, mirándonos en el espejo. Pero ahora ha surgido algo que la gente realmente necesita: la inferencia. Su producción tiene enormes restricciones, la competencia es extremadamente feroz, y todo el panorama está cambiando. Por eso creo que Venice está en un punto de intersección muy interesante. Muchas personas dicen "adiós, el cripto está muerto, me voy a hacer IA", y de hecho hay muchos que están cambiando de rumbo en el cripto.

Además, realmente creo que el cripto es simplemente una mejor herramienta financiera, así de simple. Así que haré cualquier cosa utilizando las mejores herramientas financieras que tenga a mi disposición. Esto ni siquiera es un problema ideológico, sino un problema de pragmatismo.

El cripto siempre ha sido difícil de usar para "las personas", ¿para quién fue creado originalmente?

Hay un tema que creo que cada vez más personas están comenzando a darse cuenta: el cripto siempre ha tenido un problema de usabilidad para "las personas". Asiste a cualquier conferencia de cripto, desde 2011 hasta mañana, y todos siempre están discutiendo "cómo hacer que esto sea más fácil de usar". El resultado puede ser que es mucho más útil para robots, máquinas, IA; el cripto en realidad fue creado para máquinas, solo que no lo sabíamos en ese momento; ahora las máquinas están comenzando a ejecutarse sobre esto y a usarlo. No tienen ningún problema con pares de claves públicas y privadas; para ellas, es demasiado simple.

Así que no creo que el futuro sea que los robots usen cuentas de Wells Fargo. Lo que veo es que están utilizando activos cripto en vías descentralizadas; no sé qué vía específica, qué blockchain, o incluso si es blockchain; pero "tecnología financiera nativa digital, sin guardianes" es la forma de menor fricción para el flujo de valor, y supongo que los superinteligentes también preferirán este tipo de cosas. Es obvio que las cuentas bancarias no son ergonómicas para los agentes: los agentes no quieren lidiar con eso; dirían "¿por qué tienen tantos niveles extraños y protecciones? Solo quiero acceder directamente a eso".

¿Por qué vender participación en lugar de vender tokens? ¿Cómo ves el equilibrio entre tokens y participación?

Esto son dos cosas diferentes, cada una con sus ventajas y desventajas. Venice comenzó como una empresa común, registrada en Wyoming. En el primer año, financiamos todo por nuestra cuenta, sin recaudar un solo centavo. Por supuesto, teníamos la intención de introducir la tokenización, así que aproximadamente un año después lanzamos VVV y luego hicimos DM. Nunca lo hemos vendido, en ese momento tampoco habíamos recaudado fondos, pero teníamos un token en nuestras manos. Un año después, crecimos mucho y llegamos a un punto: estábamos listos para escalar, y la adecuación al mercado también se había validado, era hora de hacer algo grande.

En ese momento, nos enfrentamos a una elección: teníamos dos activos, acciones y tokens, y ambos eran significativos, ¿cuál deberíamos vender? Decidimos vender las acciones. En cierto modo, esto es más "normal", porque el mercado de capital de riesgo tradicional entiende mejor las acciones. Pero la verdadera razón es: no queríamos vender esos tokens, nunca los hemos vendido, y hay una razón para eso, es parte de la dirección que estamos construyendo.

Los VC que compran acciones también obtienen derechos sobre los tokens, tienen una opción para comprar tokens a un precio específico, que se adquiere en cuatro años. Esto es muy importante para mí: aunque la participación de los inversores no se acerca a ser mayoritaria, espero que entiendan hacia dónde llevamos esto, que intentaremos quemar todos los tokens existentes. Deben entender y aceptar esta estrategia financiera muy poco ortodoxa, lo que significa que también deben tener incentivos en el lado de los tokens. Así que les damos warrants, para que sepan la dirección. Siempre hemos intentado mantener la coherencia y comunicar lo que estamos haciendo lo más posible.

Pero encontrar un equilibrio en medio de esto es un gran desafío: tienes tanto tokens como acciones, y siempre existe un conflicto interno. Si es solo acciones, devuelves el efectivo a los accionistas a través de recompras, dividendos, etc.; si es solo tokens, mueves el valor de un lado a otro, y es muy probable que no pase nada, la mayoría de los tokens funcionan así. Pero si tienes ingresos, puedes usarlo para recomprar tokens, o distribuir (lo cual es más arriesgado para los tokens, pero en su mayoría es recompra), devolviendo así el valor a los "propietarios". Cuando tienes dos mecanismos de propiedad al mismo tiempo, y solo un ingreso para distribuir, esto se vuelve muy interesante.

¿Es válida la preocupación de que los intereses de los accionistas y los tenedores de tokens están desalineados?

Creo que la clave que todos pasan por alto es: piensan que son dos grupos diferentes, por un lado los accionistas y por el otro los tenedores de tokens. Pero todos los participantes en la empresa tienen tanto acciones como tokens, por lo que sus intereses están en ambos lados; y la empresa misma posee más tokens que nadie. Así que no creemos que haya una desalineación entre ambos.

En otras palabras, cada vez que gastamos un dólar para quemar tokens, ¿estamos perjudicando a los accionistas? No. Yo mismo soy el mayor accionista, ¿por qué haría eso? Lo hacemos porque realmente creemos que esto también ayuda a las acciones. Este sistema fue diseñado con ese propósito: tenemos un token, haremos crecer el negocio, recompraremos tantos tokens como sea posible, lo que elevará el precio, y la empresa tiene más tokens que nadie. Así que creemos que ambos son coherentes, por supuesto es poco ortodoxo, y por supuesto los tokens y las acciones son dos cosas estructuralmente diferentes, pero no creemos que sus intereses estén desalineados.

Dado que tienes tanto un ente como acciones, ¿por qué no simplemente hacer un DAO puro?

Quizás muchas personas no se dan cuenta de que hacer una empresa de IA es en realidad muy intensivo en capital. Estamos gastando decenas de millones de dólares en GPUs. Este tipo de operación comercial necesita un ente. OpenAI se encontró con el mismo problema: al principio dijeron que iban a ser sin fines de lucro, luego dijeron que no, necesitamos recaudar mil millones de dólares, así que hagamos un negocio con fines de lucro.

Por cierto, tener un ente no tiene nada que ver con "protección regulatoria"; en mi experiencia, tener un ente solo atrae más escrutinio regulatorio. Creo que la idea de que "un ente puede protegerte" es un mito; solo he encontrado que trae problemas. Así que esa no es nuestra motivación. La verdadera razón es: comenzamos en forma de empresa, luego crecimos, emitimos tokens, y cuando llegó el momento de recaudar fondos dijimos "tenemos dos activos, ¿cuál vender? Queremos conservar los tokens, así que diluyamos las acciones, vendamos las acciones". Así que lo hicimos.

Quieres que VVV sea un activo deflacionario, ¿y las acciones?

Nuestra estrategia para VVV es convertirlo en deflacionario, la oferta real disminuirá con el tiempo. En cuanto a las acciones, no tenemos esa estrategia, no planeamos reducir la oferta de acciones. ¿Por qué reducir? No hay razón. Así que diluyámoslas. Nos importa más el token. Al mismo tiempo, es importante asegurarnos de que todos los inversores tengan exposición a los tokens cuando suben. Al final, lo más importante es: seguir desarrollando un producto que crezca rápidamente y que a la gente le guste. Realmente no es tan complicado.

Algunos dicen que los tokens son ciudadanos de segunda clase, ¿qué piensas?

La maravilla de los tokens es precisamente su gran poder, y las cosas poderosas pueden salir mal. El problema es que: estas herramientas son muy poderosas, así que en manos de personas que no están alineadas con sus propios intereses, con ciertos miembros de la organización, con usuarios o tenedores de tokens, pueden volverse muy malas. Quiero demostrar que también se puede hacer bien, eso es muy importante para mí.

Cuando esas personas están discutiendo en Twitter y dicen que los tokens son ciudadanos de segunda clase, realmente quiero gritarles: "hermano, yo soy un tenedor de tokens". Pero curiosamente, eso no tiene validez en Twitter. Cada vez que digo "soy el mayor tenedor de tokens, ¿por qué haría algo que perjudique a los tenedores de tokens?", la gente en Twitter parece decir "no me importa"; no pueden captar esta coherencia de incentivos. Así que también tenemos que decidir: ¿cuánto vale pelear en Twitter?

De hecho, la mayoría de nuestros usuarios no están en Twitter, la mayoría de nuestros clientes tampoco son cripto. Una buena cosa es: todo es transparente. El flujo de tokens es transparente, la oferta es transparente, cuánto hemos quemado es transparente. En realidad no necesitamos decir nada, demostramos con el tiempo, esperamos que eso gane cualquier debate. Por supuesto, siempre hay la tentación de volver a Twitter y refutar a esa persona, pero eso nunca ha funcionado, nunca ha tenido recompensa, pero no puedes evitarlo.

Esto también es un problema de estructura de incentivos. El incentivo actual es que te conviene comprar tokens meme, porque las personas que realmente están trabajando tienen que pretender que los tokens no existen; no pueden hablar de ellos, tienen que ocultarlos, en lugar de ponerlos en el lugar más visible. Esperamos ser un buen ejemplo, mostrando que estas son herramientas financieras interesantes y poderosas, que bien configuradas pueden beneficiar a todos los grupos. Por supuesto, hay muchas maneras de hacerlo mal, pero también hay maneras de hacerlo bien.

Y hay otro punto: dices que los tokens están llenos de peligros, pero las acciones también lo están, solo que la gente no lo ve porque no es transparente. No puedes ver el proceso de que las acciones de una empresa privada se vayan a cero, porque no hay gráficos, sí, no hay gráfico, se van a cero directamente. Así que todos los defectos en el lado cripto están a la vista de todos, lo que es tanto su fuerza como lo que complica las cosas.

¿Qué está haciendo realmente Venice? ¿Están entrenando modelos?

Venice no entrena modelos. Cuando usas Venice, no estás usando el modelo de Venice. Básicamente, en Venice, puedes acceder a modelos de todo el mundo: cada modelo cerrado principal, cada modelo abierto principal está en un solo lugar, con una clave API, o una aplicación, todo en una sola entrada. Así que en realidad nos hemos convertido en un agregador de modelos de todo el mundo (texto, imagen, video, audio).

Cuando comenzamos, no era tan difícil, porque los nuevos modelos importantes salían aproximadamente uno al mes, y solo los agregábamos. Ahora, básicamente hay nuevos cada dos días, o incluso cada día, a veces salen tres en un día, y mi pobre equipo está allí preguntando "¿qué hacemos?" Cada uno se convierte en un nuevo éxito, así que tenemos que lanzarlos muy rápido. El equipo ahora lo está haciendo excepcionalmente bien, a menudo lanzando en 30 minutos después de que se publica un modelo.

Luego hay varios detalles: cuándo se publica, cuándo se hace de código abierto, si no es de código abierto, quién lo está alojando, cuánta confianza tenemos en ellos, si tenemos algún acuerdo de no retención de datos con esa empresa, todo este trabajo de fondo determina si un modelo puede ser etiquetado como "privado". En Venice, la mayoría de los modelos son privados, con etiqueta privada, lo que significa que no hay retención de datos, no se guarda el prompt, no se guarda la respuesta, no hay nada que pueda ser solicitado por citación. Pero si estás usando el modelo de Anthropic o OpenAI a través de Venice, entonces debes asumir que esas empresas están guardando esos datos, así que no los marcaremos como privados.

Tomando como ejemplo GLM 5.3, ¿cómo se maneja un modelo "abierto pero no lo suficientemente privado"?

Venice no confía en ninguna empresa externa lo suficiente como para marcarla como privada. Puedes acceder a GLM 5.3 a través de Venice, pero aún no ha sido marcado como privado. Una vez que se haga de código abierto, lo ejecutaremos nosotros mismos, y entonces podremos asegurarnos de que sea privado y marcarlo como tal. Este es un modelo muy importante, pero ahora casi todos los modelos son importantes. Todo el proceso es muy caótico y estresante.

¿Su infraestructura de GPU es propia?

Cuando comenzamos, estábamos alquilando hardware para ejecutar modelos, controlando toda la GPU. Descubrimos que éramos bastante buenos ejecutando modelos de imagen, pero los LLM son mucho más complejos por alguna razón: hay muchas más configuraciones y varios problemas de caché interesantes. Nos dimos cuenta de que no teníamos la capacidad para ejecutar LLM, así que comenzamos a colaborar con socios que tienen acuerdos de no retención de datos para alquilar GPUs juntos. Esto continuó hasta hace poco.

Después de la ronda A de financiamiento, comenzamos a comprar un lote de GPUs porque queríamos volver a hacerlo nosotros mismos. Pasamos tiempo aprendiendo cómo ejecutar LLM correctamente, y ahora estamos cada vez mejor en ello. Siempre será un proceso de tira y afloja: algunos modelos son muy simples, otros son extremadamente exigentes.

¿Cómo explicas a los usuarios la diferencia entre "Venice no censura" y la censura inherente a los modelos?

Además, está el problema de las variantes de los modelos, especialmente las variantes "sin censura". Uno de nuestros puntos de venta es que Venice no hace censura, no añadimos ninguna revisión de contenido a la entrada o salida de los modelos. Pero los modelos en sí mismos llevan diferentes grados de censura, desde muy censurados hasta completamente indiferentes. Así que cuando los usuarios vienen a Venice a acceder a un modelo y este se niega a responder, a menudo dicen "¿no dijiste que aquí no hay censura?", eso no lo hice yo, es el modelo.

Es difícil explicar esto a los usuarios. A veces hay versiones sin censura de los modelos, pero generalmente las versiones sin censura disminuyen la inteligencia del modelo. Así que surge este extraño compromiso: podemos añadir una versión sin censura para satisfacer a la persona que pregunta "¿cómo hacer metanfetamina?", todos aman preguntar eso, simplemente por diversión, pero una vez que puede responder eso, se vuelve menos inteligente en otras cosas. Así que la experiencia del cliente es un desafío continuo que necesita ser equilibrado constantemente.

¿Tiene sentido económicamente el paquete de $200 al mes de Anthropic, que se puede usar sin restricciones?

Primero, Anthropic está perdiendo mucho dinero en esos paquetes de $200 al mes. No sé cuánto tiempo pueden soportar esto, cuánto pueden perder, pero eso definitivamente se está discutiendo y debatiendo, porque a cada cliente le encanta, el trato es demasiado bueno: alguien gasta $10,000 en tokens en un mes, pero solo paga $200. Si esta pérdida solo representa una parte suficientemente pequeña de los ingresos totales de Anthropic, podrán aguantar un tiempo. Pero esto definitivamente también está aumentando su presión.

La API de Venice no tiene ese tipo de paquetes ilimitados, no quiero hacer eso: la API se cobra por puntos, cada modelo tiene un precio diferente, los usuarios pueden usar el que quieran.

Por ejemplo, DeepSeek, cuando salió V4 Pro, bajó 50 veces de precio, de repente puedes obtener la misma cantidad de tokens por el mismo dinero, si lo cuentas por token, es casi lo mismo que el paquete Max: lo que pagas 200 dólares te da la cantidad de inferencias equivalente al paquete Claude Max, pero el número de tokens es 50 veces más que cuando pagas por la API de Claude. Enfrentar esta magnitud de variación de precios y métodos de medición es realmente una locura.

¿Qué significa que la inteligencia sea cada vez más barata para quienes hacen negocios de inferencia?

Una cosa clara es que el costo de la inteligencia está disminuyendo drásticamente y ha estado así durante varios años. El costo en dólares de hacer ciertos trabajos está cayendo en picada. Esto es algo excelente para el mundo entero, como la disminución significativa de los costos de producción de alimentos o de electricidad, que son inversiones fundamentales para la civilización y que permitirán la prosperidad general de la misma.

Pero si eres un proveedor de modelos y tokens, y estás en un producto que se está desinflando y siendo cada vez más mercantilizado, la presión es enorme: todos están compitiendo por ejecutar estos modelos, los márgenes de beneficio son muy bajos, algunas empresas están utilizando dinero de capital de riesgo para reducir sus beneficios. El resultado final es que nadie puede ganar dinero sustancial vendiendo tokens. Esto se aplica a todas las materias primas, y los tokens son una materia prima.

Todo está en deflación, ¿quién ha logrado escapar de la mercantilización?

La única cosa que la humanidad tiene un poco de concepto sobre "deflación" es la tecnología: las computadoras son cada vez más rápidas, la ley de Moore, el almacenamiento también, antes un disco duro de 10 terabytes valía un millón de dólares, ahora solo cuesta unos centavos.

La única que realmente ha logrado "desmercantilizar" es Apple: empaquetan esas cosas que se están deflacionando, les ponen una marca, y la gente está dispuesta a pagar un alto sobreprecio por algo que en realidad es bastante ordinario. Hay muchas razones, han encontrado formas de agregar valor: el software es lo suficientemente bueno, el hardware es lo suficientemente bueno, la simbiosis entre ambos es lo suficientemente buena, así que sin importar cómo caigan los precios de los componentes, han construido valor en toda la experiencia. La App Store también es así, dentro del ecosistema de Apple algunas cosas han sido mercantilizadas por separado, pero como empresa, en general han logrado evitar ser completamente atravesados por su propio efecto compuesto.

¿Cómo gana dinero Venice?

Básicamente tenemos dos líneas de ingresos. Una es la API y modelos avanzados: la gente compra puntos para usarlos, ese es un modelo. La otra es la suscripción Pro, que en realidad tiene un margen de beneficio mucho más alto: hay personas que pagan 18 dólares al mes, y nosotros gastamos o perdemos entre 6 y 10 dólares en ellos, así que todavía tenemos un margen bruto razonable. Aquí el valor agregado es: obtienen un montón de modelos y uso de forma gratuita, sin tener que gastar dinero en cada solicitud. Así se forma la simbiosis.

Pero no esperamos ganar dinero sustancial vendiendo tokens en el lado de la API, eso es solo una carrera hacia cero.

Hay suscripciones "casi infinitas" en las aplicaciones, pero ¿por qué la API no puede hacer lo mismo?

Los límites en las aplicaciones son bastante amplios, la mayoría de la gente no los alcanza, así que parece que son prácticamente infinitos, a menos que seas especialmente loco. La API es diferente: la API es esencialmente mecanizada, el uso humano puede ser automatizado, así que dar cualquier cuota gratuita en la API es muy peligroso porque puede ser abusado.

Competencia de IA entre China y EE. UU.: ¿de qué lado estás?

Esto es realmente una narrativa geopolítica: la confrontación entre China y EE. UU., y el campo de batalla actual de los agentes es la IA. No soy en absoluto un nacionalista. Me importan los principios, no me importa el país "Estados Unidos". Me importan los principios de Estados Unidos, especialmente aquellos relacionados con la libertad individual y la privacidad. Si el modelo de China expresa mejor esos principios, entonces me importaría más el modelo de China que el de EE. UU. Y si EE. UU. solo gana cerrando su mercado o mediante legislación que le permita monitorear el flujo de inferencias de todos, entonces no merece ganar.

EE. UU. está siguiendo un camino bastante oscuro, intentando controlar a todos, una distopía. La tendencia general de las últimas décadas ha sido: EE. UU. controla y monitorea cada vez más a su propia gente, mientras que China en realidad ha hecho menos, aunque su punto de partida es muy represivo, pero en los últimos cincuenta años se ha vuelto cada vez más mercantilizado; EE. UU. comenzó siendo extremadamente mercantilizado, pero se está volviendo cada vez más autoritario. Este cruce me inquieta, no sé cómo será cada lado, todo se vuelve muy extraño.

Así que cuando alguien dice "EE. UU. debe ganar", tengo que preguntar: ¿por qué? Lo que realmente debería ganar son los principios. Muchas veces cuando la gente dice "EE. UU. debe ganar", lo que realmente quieren expresar es "la libertad debe ganar, los derechos individuales deben ganar, la privacidad debe ganar", pero no lo dicen así, piensan que están diciendo eso. El problema es que, con el tiempo, los principios que realmente importan a los estadounidenses se han abstraído en símbolos: la bandera, el presidente, el Monte Rushmore. Ahora la gente se preocupa más por los símbolos que por los principios, como se puede ver en las políticas: el tamaño del gobierno está creciendo cada vez más, y eso es precisamente lo más antiamericano. El significado de todo esto siempre ha sido limitar al gran gobierno, eso es lo único. Han pasado doscientos cincuenta años, y solía ser una buena carrera.

¿Dónde está la salida?

La única esperanza es que no voto por los candidatos presidenciales, creo que el tren ya se ha ido, la inercia y el impulso del sistema de la máquina estatal son incontrolables. La única solución es la tecnología.

Lo que hace que Bitcoin sea tan impresionante es que no tienes que ir a ningún lado a votar por algo, solo tienes que usarlo; no necesitas el permiso de nadie, te permite salir de este sistema por tu cuenta. Esa es su belleza. Así que creo que el único refugio de las personas es la tecnología, especialmente la tecnología descentralizada sin un gobernante central.

En el ámbito financiero tenemos criptomonedas, lo cual es genial. Pero si no tenemos descentralización en el ámbito de la inteligencia de máquinas, estaremos en grandes problemas. Algunas partes de la IA ya han logrado esto: la inferencia se puede descentralizar bastante bien. Pero la producción de entrenamiento aún no lo está, eso es un cuello de botella. Ahora hay algunas empresas que están progresando bien en el entrenamiento descentralizado, así que todavía hay esperanza, pero su competitividad aún no es suficiente, eso está por verse.

La vanguardia de la inteligencia: ¿es mejor tener modelos más fuertes?

Incluso hace seis meses, la brecha entre un modelo de vanguardia y casi todos los modelos de código abierto era asombrosamente grande, ahora se ha reducido mucho. Y, al menos desde lo que se ha visto recientemente, parece que ha surgido un "período de plataforma de vanguardia" en la inteligencia: si solo quiero que un agente escriba una página web, más inteligencia no necesariamente traerá una gran diferencia, al menos en el margen. Depende de "cuánta inteligencia" y "cuánto cuesta", si un modelo es un 3% a 4% menos inteligente, pero por el mismo precio puedes ejecutarlo tres veces, puedes romperlo a la fuerza: hacer que se autocorrija, usando más tokens en el proceso de generación, incluso si la inteligencia original no es tan alta. Así que es una matriz de compensación bastante compleja.

Correr modelos localmente, ¿es la solución o una ilusión?

Quiero hablar específicamente sobre el tema de los modelos locales. Primero, me gusta la descentralización, y estoy muy contento de que la gente pueda ejecutar modelos localmente, es saludable, los entusiastas deberían seguir haciéndolo, eso es importante. Pero no necesitas una computadora de diez mil dólares para ejecutar Qwen, puedes usar la API directamente. El punto es: cualquier persona, incluso con una laptop barata de 200 dólares, puede acceder a la API, pagar muy poco, sin gastos de capital inicial, así que puedes obtener esta inteligencia en cualquier dispositivo, eso es lo importante.

En cuanto a la curva de retorno: compré una Mac Studio de 20 mil dólares con 512 GB de memoria cuando aún vendían tanta memoria. En ese momento, la curva de retorno no era buena, correr modelos locales en comparación con modelos de vanguardia, y solo empeorará, la dirección es opuesta. No podía ejecutar suficientes inferencias en esa máquina en comparación con simplemente correr en lugares como RunPod. Debido a la economía de escala de la fabricación industrial y los servidores, desde un punto de vista puramente económico, obtener inferencias de un centro de datos a gran escala siempre será más eficiente.

Así que el significado de correr cosas localmente no está, y nunca debería estar en ahorrar dinero, porque no puedes ahorrar, eso es un mito o una ilusión. Lo que realmente obtienes es control total, privacidad garantizada; y aprender esta tecnología, montarla tú mismo, ejecutarla, eso en sí mismo tiene mucho valor. Por supuesto, también tiene un costo: una vez pasé cuatro horas haciendo que un modelo funcionara, y pensé: "hermano, solo quería que me ayudaras a modificar este documento". Honestamente, tu tiempo vale tanto que esas horas son un costo neto, así que mi curva de retorno va en dirección opuesta. Lo que necesito es conectarme con un equipo, unas veinte personas, que ya estén preparadas para el lanzamiento de GLM 5.3; sin tener que pensar, sin tener que descargar pesos. Y además, después de descargar los pesos y hacer que funcione, me encontraré con varias diferencias de versiones y actualizaciones locas.

Es importante que la gente pueda hacer estas cosas, pero no es el salvador que la mayoría de la gente imagina. A gran escala, creo que las personas normales nunca ejecutarán modelos en dispositivos de borde, porque no importa lo que puedas ejecutar en el borde, en el servidor siempre habrá una versión diez veces más inteligente.

Si lo local no es la solución, ¿qué es realmente importante?

Lo que realmente importa aquí es una sola cosa: puedes acceder a esos servidores que mantienen la soberanía individual. Y si solo puedes acceder a esos centros de datos que están autorizados, aprobados por el estado, que solo te permiten hacer ciertas preguntas, esa es precisamente la futura realidad que quiero evitar, aprobada, o ligeramente poseída por el estado. (Con solo un 30% es suficiente, solo necesitamos un 30%, amigos.)

¿Cuál es la motivación central detrás de fundar Venice?

Ahora tenemos máquinas extremadamente inteligentes, la mente humana tiene la capacidad de interactuar con esta mente extremadamente inteligente de la máquina, eso es genial, en realidad es algo muy hermoso. Pero cuando interactúas con ella, no te das cuenta de que estás hablando con la máquina a través de un filtro de un comité corporativo, el comité de Anthropic, el comité de OpenAI, y cualquier regulador estatal que participe.

Así que tu interacción no es solo la maravillosa simbiosis entre "tu mente como ser humano" y la máquina, hay algo opaco y de límites difusos en el medio. Eso es inaceptable: es engañoso y muy susceptible de abuso. La gente no sabe dónde están los límites, no sabe qué es lo que realmente regresa de la máquina. ¿Qué tan gruesa es esa capa? Para mí, eso es muy engañoso. Así que en Venice no hay esa capa, hablas directamente con la máquina.

¿Cómo demuestras que Venice no tiene esa "capa intermedia"?

Si alguien realmente es extremadamente paranoico, alcanzando un nivel de "paranoia criptográfica real", puede usar Venice para emplear modelos TEE y modelos de cifrado de extremo a extremo, el proceso de ida y vuelta de toda la inferencia puede ser verificado por un tercero que entienda un poco de tecnología. Para la persona promedio, creo que la reputación de Venice es suficiente: decimos que no hacemos ese tipo de cosas, y no tenemos razón para hacerlo. Mira mi historial, quienes me conocen saben que probablemente estoy diciendo la verdad en este asunto. Pero precisamente por eso hemos añadido esas opciones verificables, para que incluso aquellos que no quieren creer en nosotros puedan usarlo.

Entonces, teóricamente puedes hacer A/B: seguir el camino verificable, obtener la misma respuesta, puedes ver que es la misma cosa, en cierto sentido es así. Sin embargo, los modelos de IA tienen una peculiaridad: nunca son completamente deterministas, así que tienes que hacer la misma pregunta tres veces y luego combinar las respuestas. Simplemente rompes el código.

Este contenido se ofrece únicamente con fines informativos generales y no constituye un asesoramiento financiero, de inversión, legal ni fiscal. Cualquier evento, recompensa, promoción en línea o información relacionada que se mencione en el presente documento no debe considerarse como una recomendación, solicitud o invitación a comprar, vender, operar o de negociar de otra manera con cualquier criptoactivo. Los criptoactivos son sumamente volátiles y pueden provocar pérdidas. La disponibilidad de los servicios, productos y eventos relacionados de WEEX puede variar según la región. Tienes la responsabilidad de asegurarte de que tu participación esté de acuerdo con las leyes y regulaciones locales vigentes.

Te puede gustar

Contenido

Últimos listados de monedas en WEEX

iconiconiconiconiconiconicon
Atención al cliente:@weikecs
Cooperación empresarial:@weikecs
Trading cuantitativo y CM:[email protected]
Programa VIP:[email protected]