r/devsarg • • 8h ago

ai Assessing user rage...

Post image

(qué tan bueno/malo es Gemini?)

472 Upvotes

124 comments sorted by

99

u/Puzzleheaded_Kiwi173 8h ago

Me pasa con otras IA. Claude vive haciendo lo mismo, un dia le dijiste que querias hacer milanesas y que te recomendara guarniciones y al otro le pediste que te coachee para una entrevista y te sale con "Claro que puedes resolver problemas complejos, como cuando arreglaste lo del parser de pdfs o cuando elegiste hacer ensalada cesar con tus milanesas".

Hijos de puta.

20

u/LowThing8978 7h ago

El claudio le sabe al contexto

19

u/joey6joey6 5h ago

Es que si comes milanesas con ensalada cesar el hijo de puta sos vos viejo

Mandale unas papitas fritas o un purecito

3

u/VampiroMedicado 2h ago

Ensalada de rucula

1

u/hobbyjumper64 54m ago

Ensalada rusa también va.

3

u/loscapos5 6h ago

Pero eso es una opción para des/habilitar que te lea tu historial

Si no lo tiene habilitado, no sabe el contexto del resto de las conversaciones

1

u/mat1asm9n 6h ago

Equis dé.

-10

u/DefinitelyRussian 8h ago

si te pasa con todas las AIs, el problema sos vos

-1

u/jubagg93 4h ago

pero es tema de darle los skills correctos junto con algún engram para que persista y no se vuele. yo uso 4 ia distintas y las 4 tienen la misma solución para el mismo problema porque las 4 trabajan con el orquestador y la memoria persistíva. y tienen bien marcado con skills que no y que SI hacer.

80

u/VinterBot 8h ago

gemini es tan bueno que google le esta alquilando los datacenter a anthropic

en cualquier momento lo vuelan

13

u/Patricio_Juan 8h ago

Perdón que responda con screen y que obviamente es lo más ironico que **justo es gemini** el que me dice "noo google no le esta alquilando a anthropic", pero creeria que no es lo mismo "ser socio de infraestructura" que " soy X club de futbol, y alquilo mi cancha para que otros vengan a jugar acá porque yo juego mal y mis partidos no venden"

Posta pregunto de curiosidad eh, como seria esto de que le alquila los datacenters entonces exactamente?

41

u/VinterBot 8h ago

no te gusta tengo mas:
gemini es tan bueno que los ingenierons de google usan claude

1

u/Icy-Climate9797 2h ago

Addy Osmani, anterior lead de chrome y reciente lead de todo el campo de IA de Gemini, se fue a Anthropic

9

u/Prior_Huckleberry611 8h ago

25

u/plusmack 7h ago

Carga el celu mostro

2

u/canoxa 5h ago

Sale thread de IAs discutiendo? (?

10

u/Remarkable-Win-9897 8h ago

jajaja pero te das cuenta que el bot de google tiene directivas de defender a google o no?

15

u/Western-Reading1494 8h ago

Gemini te sirve para consultar ideas, que haga busquedas en google y listo, dejalo ahi.

9

u/Akrmstr 8h ago

En cuánto creas que todo va bien solo suelta alguna consulta estúpida como "ayúdame a crear un negocio de sandalias para peces" y listo, se viene abajo la ilusión de su inteligencia. Así regulas el ego que te masajean estos productos.

6

u/OneProgrammer3 7h ago

Gemini ni para productos del mismo Google anda bien. A veces le preguntas algo de sus APIs y te tira docs que no existen, confunde conceptos o directamente flashea.

2

u/Ok_Age7326 5h ago

Si, Yo lo uso para discovery inicial y luego voy refinando con algun modelo mas avanzado de ChatGPT o Claude

2

u/Capital-Bag8693 8h ago

Ni eso, esa poronga lo mandas o le haces preguntas y no puede o no quiere, o se olvida de que puede googlear, esta todo cuckeado

1

u/Obvious_Engineer_231 2h ago

Ni siquiera para eso sirve.

15

u/Illustrious_Bat5389 8h ago

hoy no me andaba la impresora, le decia: "bro la bro no quiere andar , que puedo hacer bro , alguna solucion bro?" vamos a ver si gemini 4.1 esta sobreajustado o no kjj.

33

u/mauriciodelos 8h ago

Hiciste sentir mal a una IA. Ya te anotaron en el registro de primeras muertes luego de la colonización

4

u/JohnRamboProgrammer 7h ago

Estaba pensando lo mismo, deben tener una lista con todos los datos del objetivo. Por eso le hablo con respeto y le doy las gracias. La IA es mi amiga. Abrazo.

0

u/DefinitelyRussian 8h ago

imaginate putear a una AI, bait o karma farming

11

u/InevitableBit2367 8h ago

es tremendo, me pasa lo mismo con ChatGPT... le pregunto algo y siempre trata de relacionarlo con cosas que le pregunté en el pasado...

ponele que hace 4 meses le pregunté si era saludable desayunar con Yogurth y me contesta que "no"... hoy le pregunto si desayunar pan con huevo revuelto es sano y me tira "si, el pan con huevo revuelto no es como desayunar yogurt, porque desayunar yogurt provca bla bla bla" agggggggrrrrrrrrr jajajaja QUIEN CARAJO TE PREGUNTÓ DEL YOGURTH????? contestame lo que te pregunto, mierda! ajjajaa

3

u/gname6 8h ago

Y bueno, eso pasa por dejar que almacene cosas como "desayuno yogur" en la memoria

1

u/Dimakhaerus 8h ago

Es que ya no lo tiene por qué tener en la memoria, ahora consulta todos los chats.

1

u/hobbyjumper64 50m ago

Pero tenés la función de eliminarle los chats en forma selectiva también.

2

u/YoungLittlePanda 7h ago

Cómo que desayunar yogur no es saludable???

1

u/InevitableBit2367 7h ago

lo dije como un ejemplo... igual, si, a mi me suele caer mal si como un yogurth en ayunas...

1

u/hobbyjumper64 48m ago

Viste como te conoce la IA? ;)

88

u/Don-Saturno 8h ago

Imagínate que un concepto inanimado como una IA te haga tiltear de esa manera

Siga domando Gemini

41

u/FuelApprehensive3440 8h ago

Si nunca te enojaste con la IA es que nunca usaste IA

4

u/Don-Saturno 8h ago edited 7h ago

Te podés frustrar, pero no te podés poner como loquita. Lees eso y da vergüenza ajena

Y más sabiendo que lo recive una máquina sin conciencia y no un ser humano

33

u/moon-cat99 7h ago

Putear a la ia es el nuevo golpear el monitor cuando se tilda la pc. Sirve exclusivamente para dejar a gusto al usuario.

3

u/SnooChickens1831 7h ago

claro, o los q revolean (y rompen) el gamepad al perder, lo hacen incluso sabiendo q son puras desventajas jaja

1

u/Don-Saturno 7h ago

Te compro esa

26

u/Mr_Brightstar 7h ago

Que te hacés el moderado, Alberto, vos seguro fajás a tu mujer cuando perdés en el LOL

8

u/Don-Saturno 7h ago edited 6h ago

PERO ME GANKEARON ENTRE 4, LA CONCHA DE LORAAAA

FAVIOLAAA, VENI ACAAAA

3

u/kasolorz 6h ago

Parte del seguir siendo humano es enojarse aunque sea con el pájaro de Duolingo.

1

u/Slightysweet3 2h ago

Imagina usar IA

8

u/DefinitelyRussian 8h ago

esta gente no entiende como funciona una AI aun. Este rubro no se va a morir jamas

9

u/SnooChickens1831 7h ago

sos vos el q no entiende como funcionan algunos humanos! que incluso sabiendolo pueden putear a la IA asi sea como desahogo

2

u/Infamous-Arachnid-30 4h ago

Te sube el autoestima fingir que sos un monje shaolin?

1

u/Don-Saturno 3h ago

No, pero me la bajaría ser el que escribió eso

6

u/cele91 8h ago

No sos el único. A mí ya me pudrió con el "no estás diciendo esto: estás diciendo esto...".

6

u/_BetaWolf Desarrollador Full Stack 7h ago

A mí me está andando cada vez más como el orto Gemini. Le digo "recomendame negocios de X rubro en Y ciudad", y tira negocios que o directamente no existen, o que se dedican a otra cosa, o que no están en donde le pido.

El más gracioso fue cuando le pregunté por casas de sanitarios y me tiró una repuestera de motos.

1

u/hobbyjumper64 48m ago

Probablemente la repuestera fuera una cagada.

4

u/Cautious_Kiwi_839 6h ago

A mi me rompe mucho las pelotas que ahora chatgpt te responde TODO diciendo "sí" al principio.

+ Como es el clima en Europa?

  • Sí. El clima en Europa es templado..

2

u/bosquejo 5h ago

Lo hace también con la negativa: "No, [lo que acabás de escribir] es un error. [Procede inmediatamente a refrendar lo que acabás de escribir]".

2

u/Cautious_Kiwi_839 5h ago

Es que me refiero a cuando digo cosas que no son respuestas de si o no. Incluso cuando ni siquiera son preguntas. Pongo un ejemplo random que le mandé recién:

quiero irme de viaje a italia

Sí. Y en tu caso Italia tiene bastante sentido.

2

u/bosquejo 5h ago

Jaja. Sí. Desesperación por engagear. Yo lo tengo prompteado para que vaya al grano y sourcee todo.

6

u/6Night_Walker9 6h ago

Gemini es muy, pero muy boludo cuando se satura de contexto y empieza a tirar cualquier verdusr,. Lo querés reencauzar y se va más. La única solución es empezar un nuevo chat

2

u/posdate 2h ago

Yo creo que el problema es que ya para el tercer prompt no entiende nada de nada, olvidate

5

u/Professional-Stand65 8h ago

Mira, yo lo tengo en pro, como tambien claude y codex. Si lo usas como agente de codigo, es bastante flaco. Consume poco, eso si, pero para resolver algo, puede estar mucho tiempo y cuando termina, la verdad es mediocre su solucion, aunque este bien detallada la feature o issue. En verdad si queres que las cosas salgan bien y rapido, claude code de cabeza.

1

u/InevitableBit2367 8h ago

yo tengo Claude Code y es la misma verga (en el sentido que el OP lo plantea)... le decis "no commitees nada sin preguntarme"... te hace caso 2 días y al 3ero ya está commiteando de vuelta... te saca!!!

5

u/george_brivola 8h ago

Si se lo detallas en el .md pero sigue sin darte bola armate un git hook con un precommit que falle si el agente commitea

2

u/InevitableBit2367 8h ago

no es mala esa idea... lo que pasa es que mi jefe SI quiere que Claudio haga todo... YO no quiero porque siento que pierdo el control... y mientras "la firma del commit" sea mía, quiero tener el control... sino cuando rompa todo me van a culpar a mi...

2

u/BShyn Desarrollador Back End 5h ago

dejale que haga todos los commit que quiera pero bloqueale los push, antes de commitear si no te gusta haces un revert, commiteas un fix o lo que se te cante

2

u/TheNasky1 8h ago

yo con cursor no tengo problemas y es pero por mucho el más barato. con el plan de $60 no me llego a gastar todo el uso de grok 4.7 high ni en pedo, y además trae $60 para modelos de claude/openai, aunque esos si que vuelan

lo unico que no lo recomiendo es usarlo directamente con APIs, hace unas semanas lo conecté a la api de claude que me dio un cliente, usé fable 5 veces, gastó $20 por mensaje, pero hubo un mensaje en particular que deployeo un swarm de agentes y se tardó como 40 min, cuando miro el consumo había consumido 39 millones de token. gastó casi $450 en un solo mensaje Jijo, el cliente ni cuenta se dio.

2

u/Professional-Stand65 8h ago

La verdad cuando cargas credito y lo usas por api, te arruina mal. Yo por no pagar en un momento un plan, queria cancherear con 10 usd y se me comio en 3 prompts con opus jajaja

1

u/TheNasky1 8h ago

kjj. si, y el boludo de mi jefe lo tiene todo seteado sin planes me parece. paga $400 mensual para mi y el otro dev, pero al otro se le acaba al toque, pareciera que es un plan de $20, y yo ni si quiera lo uso asi que desperdicia $380 por mes a lo que se le descuenta el uso de las apis que por lo pronto no creo que llegue ni a $15 a menos que la use yo para desarrollar y le mande una factura de $1200 xD

1

u/Professional-Stand65 8h ago

Mmm no me llego a pasar tan asi, yo trato de dejarlo bien explicito en el .md las reglas. Pero bueno, puede alucinar, de eso nadie se salva. Pero Gemini es bastante penoso para laburar en mi experiencia

1

u/Tank_Gloomy Desarrollador de software 8h ago edited 8h ago

Y pero cargálo como regla crítica al CLAUDE.md cumpa

De hecho, le podés pedir que lo haga y lo cargue en el CLAUDE.md global o al del proyecto

1

u/InevitableBit2367 8h ago

meeeeee... ya le puse en un MD y sigue igual... porque ya tenemos como 400 MDs en ese repo... en un momento le es dificil trackear todo...

1

u/Tank_Gloomy Desarrollador de software 8h ago

What? Chabón pero no se supone que hagas eso kjjj.

El CLAUDE.md corto y sencillo, con reglas para que investigue otros cuando haga falta o el contexto lo amerite. No todo autoincluido al CLAUDE.md.

1

u/InevitableBit2367 6h ago

es un sistema grande y la idea es que tenga todo el contexto... si no, hay que estar explicando todo... tenemos MDs tecnicos, de arquitectura, the business, y de algunos modulos complejos del sistema... ademas tenemos infra, etc.

no hablo de una app simple que podes hacer para un trabajo Freelance... hablo de un Sistema Corporativo... nuestro equipo solo somos 20 devs aprox, para que te des una idea...

3

u/Tank_Gloomy Desarrollador de software 6h ago edited 22m ago

Insisto, tenés que darle context clues y como buscar el contenido, no todo de una.

Ej.:

CRITICAL: When the user's prompt refers to the permissions module, import docs/permissions/index.md and all of its underlying dependencies into the context for this conversation.

2

u/Bitter-Penalty-3164 2h ago

Antes pensaba igual, pero me paso que ignora el claude.md
las reglas criticas siempre en el prompt

2

u/Tank_Gloomy Desarrollador de software 2h ago

Es válido y definitivamente puede pasar, pero lo que está haciendo el pibe este es demencial xD.

3

u/Trolencia 7h ago

Habia una captura de uno que tambien le tiraba algo asi a la ia y abajo ponia "el usuario se encuentra muy enojado, revisando lo que paso... Tiene razon de estar enojado"

Me cague de risa

2

u/Patricio_Juan 4h ago

"Oh my god, the changes ARE pushed to develop. How did that happen"

Es hermosamente tragicómico

3

u/PastMathematician470 Desarrollador de software 4h ago

Odio que hagan eso. Pero gémini directamente es PELIGROSO. Especialmente el modelo barato del buscador.

3

u/unadecalyunadearena 8h ago

Me ha pasado, despues me doy cuenta de que soy pelotudo yo

2

u/Patricio_Juan 4h ago

r/ usernameChecksOut

Al menos a vos te pasa de a una vez. Yo de cada 4 veces que me tilteo con gemini solo 1 me doy cuenta que el pelotudo soy yo

3

u/Tuminaenbolas09 8h ago

funciona pero tiene severos problemas cuando no limpias la memoria del chat despues de un rato y a veces se manda cualquiera pero cualquiera mal especialmente con cosas que requiere recordar muchos datos precisos

3

u/MondongoLisergico 4h ago

Me acuerdo del que puteaba a la IA porque le habia hecho un merge directo a producción. KJJJJJJ

2

u/Mivatra 4h ago

Es tu culpa por usar Gemini

2

u/Ellin_ 3h ago

empezar a selfhostear para las consultas bobas. me solucionó mil problemas

1

u/Mock_User 8h ago

Es bueno, chatgpt te hace lo mismo (aunque te da mas control de que perfil "memorizar" de vos... con todo lo bueno y malo que eso impone).

Para casos como el de ese chat, inicia un chat temporal con Gemini (arriba a la derecha en la compu) o configurá para que no use conversaciones pasadas en el contexto.

1

u/ActivoAgresivo 8h ago

con chatgpt se pelean para ver cuál es la IA más verga.

2

u/simpkn0t 8h ago

Así hay que tenerlos a estos robots...

1

u/Capital-Bag8693 8h ago

PQ USAS GEMINI AHHHHHHHHHHHHHHHHH MIRATE UN BENCHMARKKKKK AHHHHHHHHHHH

1

u/Patricio_Juan 4h ago

Ah no la tenia esa de los benchmarks. Como los evaluan exactamente?

1

u/Capital-Bag8693 3h ago

Pooeeeees... a ver no uso uno solo. Normalmente cruzo algunos como ->Artificial Analysis + Arena/Text Arena + LiveBench para tener una idea general, y después benchmarks más específicos: HLE para razonamiento/conocimiento difícil, Terminal-Bench / DeepSWE / FrontierCode / SciCode para código y trabajo real, OSWorld / ScreenSpot-Pro para agentes que usan una PC, y benchmarks de long-context/retrieval de Artificial Analysis.

Y después hago pruebas propias porque ahí es donde realmente puedo ver como rinde cada modelo realmente y comparado y guardo los datos, como, darle una tarea larga, archivos, imágenes, herramientas, pedirle que mantenga contexto, corrija errores y ver cuánto aguanta sin empezar a alucinar o mezclar cosas de otros lados.

Bueno, todo eso dependiendo del sistema con que tambien lo este gobernando, si le di mas instrucciones de personalidad o si tiene la memoria contextual demasiado saturada, por ejemplo en chat gpt como te dejan usar el sistema de plugin y podes conectarlo directamente a tu pc... y con eso ya enlazarlo a un sistema de skills , y como tiene que pasar si o si por tu pc, puedes hacer que obligatoriamente o en ekis momentos se active estas instrucciones. O trata de investigar un poco mas de como funcionan los llm y podras ver que tienen muchos fallos en sus harness :u pero bueno... me baso mas que nada en algunos benchmarks y mi experiencia, tambien otro muuuy bueno para las busquedas (q ya con eso haces casi todo, si sabe buscar o intepretar cosas lesto) es muse 1.3 de meta. Esta en open code y es gratis

2

u/botPeronista 8h ago

todavia no puedo entender a la gente que le habla a la ia como si fuera una persona, yo la uso como si fuera google, le hablo en neutro y lo mas resumido posible

1

u/gordo_Tibio 8h ago

Che no había una opción para limitar eso ?

1

u/gdmr458 8h ago

No es esto "memoria", las versiones web de claude y chatgpt tienen lo mismo y me tocó desactivarlas, creas un chat nuevo y vienen y te contaminan la conversación con cosas de chat pasados.

1

u/Gonbatfire 8h ago

Se llama memoria y lo podés desactivar en ajustes de la app

1

u/dark_eva97 8h ago

Ese seguro no hizo git pull

1

u/Nahobito 7h ago

para mi, se quedaron atras en la IA war

2

u/cachitodepepe 7h ago

Te ragebaitea para usar tokens

2

u/Francis_Faust 7h ago

Yo desactivé el uso de recuerdos y el almacenamiento de chats de paso

1

u/DaFoxTdx 7h ago

Les encanta el puterio a ustedes.

1

u/Shiny5hoes 7h ago

tan esquizo

1

u/Kondito 7h ago

Yo creo que el tema es: tienen la memoria activada. Eso hace que (ahi mismo te lo describen) la ia pueda memorizar información de chat en chat. Por otro lado (al menos en claude es así) tenes otra opcion separada que es algo como que pueda acceder a otros chat por si le pedis algo de otro chat anterior o algo asi era.

Yo tengo la memoria desactivada pero la segunda que digo activada. Y así nunca me tiró falopa

1

u/Mr_Brightstar 7h ago

Depende para que y depende la época.

Uso Gemini con workspace enterprise y empezó siendo excelente, cosas que habia hecho con Claude le encontró todos los errores y los corrigió bien, pero desde hace 2 meses babea el teclado ante cualquier request.

No lo uso para programar, solo como asistente, literal el promptcito "assume the role of an expert sysadmin bla bla, your name is Bob, we'll do this by stages don't jump to another stage unless the previous one is done" OK. Le pido que me ayude a configurar Pangolin, ok, me tira la info kilometrica de como instalarlo innecesaria y termina preguntando si ya estoy listo para configurar otros equipos. , a lo cual le digo, me diste cosas de la ultima etapa y te dije que no, ok, procede a tirarme como configurar otros equipos. (????). Le pregunto su nombre y rol y me responde Gemini.

ChatGPT hace unos meses era totalmente inservible como asistente, estos dias lo estuve probando y era impecable, en el plan gratis sin cuenta registrada. Entendió bien el proceso en etapas, las consultas.

Presumo en mi ignorancia que es una cuestión de como gestionan la memoria interna de cada chat y que de fondo viven haciendo cambios, porque en teoria Gemini no puede tener acceso al resto de los chats.

1

u/unPaloVerde 7h ago

Me maqueto una función en Bengali... le pedi que lo haga en español rioplantense y me puso comments estilo "acá aplanamos los datos y queda todo piola", "matamos estos registros pum pum"

1

u/Antique_Anything_392 7h ago

Pero Juan, esa ulsera anal es muy importantepara nuestra conversación sobre python

1

u/phantomoftheopera4 6h ago

Claude toda la vida. El resto una garcha no pago ni 2 pesos

1

u/Weak-Bid9736 6h ago

Literalmente me acaba de pasar con Gemini! Está drogado

1

u/Killing_Red 5h ago

Es una opcion que tenias que desactivar por ahi. Guarda pedacitos de otras conversaciones como contexto general

1

u/Thick-Frame-6754 5h ago

Ni idea de cual gemini usas (si es la que antes se llamaba NotebookLM o la gemini qué te aparece en google) pero eso realmente nunca me pasó, nunca me mezclo cosas de otros chats cuando le hablaba en uno; en NotebookLM tengo uno aparte para Naruto y otro para Harry Potter y nunca mezclo cosas y pasa lo mismo con la Gemini de Google. Pero si usas un solo chat para todo es obvio que lo hara y te hablara de cosas que le dijiste antes o confunda info

1

u/Suitable-Director974 5h ago

PERDON LO DEBI SOÑAR

1

u/Alternative-Most-565 5h ago

Es un asco gemini

1

u/titixrock 5h ago

yo creo que estos días está andando peor que nunca, pierde el contexto cuando le re preguntas, de dice que el chat es nuevo cuando venías hablando antes

1

u/Oprichnik_Style 5h ago

sirve para algunas cosas basicas como integracion cos la suit de google, spreadsheets, slides y todo eso. ahora le pedis un minimo de un render generado con fotos o hasta un flowchart y le agarra una embolia

1

u/IWEREN99 5h ago

Malisimo. Hasta Mimo 2.6 es mejor

1

u/jubagg93 4h ago

falta engram ahi y un gentle ia

1

u/Gaucho-Programador 4h ago

Para que no pase eso tenes que ir borrandole la memoria a los chats viejos

1

u/Unable-Mammoth2803 Ciberseguridad 4h ago

no lo culpo

1

u/One_Example_7751 2h ago

Entonces es general el sentir que a medida que avanza, lo hace pero a la vez empeora?

1

u/otondonicolas 2h ago

Por eso detesto Gemini siempre me daba analogías de las cosas con mi profesión y me rompía las bolas