Volver al inicio

Cinco novedades de IA de Google: Gemini dentro de tus herramientas diarias

Google plantó su software Gemini dentro de herramientas diarias como Docs, Chrome y Photos; el presentador recorre cinco novedades, del borrador apoyado en el cuaderno a la voz de estudio, con ejemplos concretos.

Importado a Nodesdaily: (UTC+03:00)
Ver en YouTube — RXDluqe5qwo
Opciones de lectura

La voz del dispositivo no está disponible en este navegador.

Lupa de conceptos

Elige un término técnico de esta vista para leer su definición general, un ejemplo didáctico y su uso en el artículo.

No se encontró ningún término de nuestro glosario en esta vista. El glosario aún no cubre todos los términos.

Google no lanzó la IA como una pestaña nueva; la metió dentro de las apps que ya abres cada día: edición de documentos , generación de voz , edición de imagen , aprendizaje en el navegador y gestión de fotos se renovaron de una tacada. La tesis del presentador es nítida: lo que importa no son las demos vistosas sino estas capacidades funcionando dentro de Docs, Chrome y Photos. Este texto abre las cinco novedades una por una, explicando para qué sirve cada una en el trabajo diario y dónde están sus límites frente a los anuncios oficiales.

Del cuaderno al borrador: Notebook dentro de Docs

La primera novedad conecta la investigación de Gemini Notebook con la superficie de escritura de Google Docs: escribes @ en el documento, eliges el cuaderno, y Gemini redacta el borrador apoyándose en sus fuentes con citas en línea. En el ejemplo del presentador, una estrategia de captación de tres páginas nace de una sola orden desde un cuaderno lleno de análisis de competidores y opiniones de miembros. El anuncio oficial salió el 23 de septiembre en el diario Workspace Updates (workspaceupdates.googleblog.com): @ funciona desde el panel lateral o la barra inferior, los resultados enlazan a las fuentes, y la verificación ocurre sin salir del documento. Según el video, el acceso está abierto a planes Business Standard y superiores más usuarios de Google AI Pro y Ultra; del lado admin, Gemini en Drive y las funciones inteligentes deben estar activadas.

La segunda novedad juega en audio: Gemini 3.8 Flash TTS , pensado para voz creativa con calidad de estudio, y Flash-Lite TTS , pensado para generación rápida y eficiente, son dos modelos hermanos. El truco estrella es diseñar una voz describiéndola con texto: escribes una voz británica segura y cálida, de unos cuarenta y tantos, tono conversacional, y el modelo la construye. Las cifras citadas en el video son audaces: más de 150 voces listas, más de 2000 opciones de producción, más de 100 idiomas y dialectos, con clonación de voz desde 30 segundos de muestra y verificación de consentimiento. La entrada oficial del blog de Google (blog.google) y la ficha del modelo (ai.google.dev) confirman este marco; conviene cotejar las cifras con la documentación API vigente.

Un estudio en el bolsillo: la voz con Gemini 3.8

Los modelos de voz tienen dos ases más: directrices de emoción escritas dentro del texto y soporte nativo de doble voz. Incrustas marcas como entusiasmo y susurro en el guion, y el modelo las interpreta; un solo texto sale como episodio de dos personas con dos voces diseñadas por separado. Google anuncia que el modelo Flash queda primero en el baremo de diseño de voz de Hume AI con un 71,4 por ciento; anotemos que es una puntuación anunciada por la empresa, no una prueba independiente. Las demos publicadas merecen igualmente una escucha, y el acceso general pasa por la API de Gemini.

Tercera parada, la edición de imagen, con primero una corrección de nombre: la herramienta llamada Pix en el video se llama en realidad Google Pics . Anunciada en el evento I/O en mayo de 2026, se abrió al público a principios de septiembre; 9to5Google fecha el lanzamiento el 1 de septiembre mientras el blog de Workspace trae la fecha del 2 de septiembre. La dirección es corta: pics.new. Lo que distingue a Pics no es generar sino la edición por objetos : en la demo del kit de bienvenida tocas la chaqueta y dices pásala a crema, solo la chaqueta cambia; pasas el cuaderno a cuero mientras taza y caja quedan intactas. Los modelos Nano Banana mueven el motor.

Pics también sabe editar y traducir el texto dentro de las imágenes, ampliar los encuadres hacia 2K o 4K, aplicar varios retoques en lote y revertir los no deseados. La herramienta se abre como una capa dentro de Docs y Slides; tomas la imagen desde tu ordenador, Drive o Photos, sin viaje de ida y vuelta a Photoshop. La edición de imágenes subidas a Drive llega en las próximas semanas; el anuncio de Workspace (workspace.google.com) dibuja el mismo cuadro. Visto desde una pequeña empresa, la promesa es clara: las rondas de bocetos dependientes de un diseñador para visuales de producto y promo se acortan.

Chrome y Photos: el asistente que aprende y ordena

La cuarta novedad convierte el navegador Chrome en un asistente de estudio : Gemini puede usar el contenido en pantalla, desde grabaciones de YouTube y episodios hasta artículos de investigación, para preguntas y resúmenes. La pieza más funcional son los quiz interactivos generados desde cualquier página: opción múltiple, respuesta corta y completar huecos, y luego charla sobre los fallos. Según el video, los quiz se abrieron primero en inglés en escritorio en EE. UU. e India; móvil y nuevas regiones seguirán. El escenario de formación de equipos es ingenioso: generar un quiz desde un enlace de lección y convertir el supuesto de visionado en medición. La cobertura de Digital Trends (digitaltrends.com) cuenta en el mismo lote que las pestañas retoman donde quedaron entre dispositivos.

Última parada, Photos con Gemini Spark : una orden de varios pasos como encuentra los mejores retratos de este viaje, acláralos, comparte el mejor ejecuta la cadena elegir-retocar-compartir de un gesto. Tres extras la acompañan: el Guardarropa , que indexa las prendas, sugiere combinaciones y abre la prueba virtual, los efectos adaptativos Ambiente estilo película de 35mm y digital de los 2000, y un pincel de desenfoque que oculta antes de compartir; se suman 15 nuevas plantillas remix. Según el video, Guardarropa y funciones de agente llegaron primero a Android e iOS en EE. UU., India y Brasil. La nota de Photos de la empresa (blog.google) confirma el cuadro; revisar los ajustes de privacidad del lado de indexación sigue siendo lo sensato.

Visualization: nodesdaily AI

Momentos clave

  1. Intro: cinco novedades en una oleada
  2. Notebook dentro de Docs
  3. Voz diseñada con Gemini 3.8
  4. Edición por objetos en Pics
  5. Quiz de Chrome y Photos Spark

Comentario de la IA

"En mi opinión, la noticia real de esta oleada no son los modelos en sí sino que el contexto se ha vuelto portátil: el cuaderno de investigación, la identidad de voz y el archivo de fotos ya hablan con el documento que escribes. Conviene leerlo sin perder de vista el despliegue fragmentado por suscripción y por país."

Evaluación de la IA

El contrapunto más fuerte es el encierro en el ecosistema: estas cinco novedades te retienen más tiempo dentro de una cuenta de Google, y cuando cuadernos, voces, imágenes y fotos convergen bajo un mismo techo, el coste de salida crece. En métricas también conviene la cautela: la puntuación de Hume AI es un resultado anunciado por la empresa, sin verificación independiente, y los recortes por idioma, país y nivel de suscripción reducen el acceso real.

La lista de ausencias no es corta: el video no da precios ni cuotas, la función Guardarropa que indexa todas las fotos abre una pregunta de privacidad, y cómo funciona la verificación de consentimiento del clonado de voz queda sin aclarar. Hay además un pequeño roce de fechas: el video dice 4 de septiembre para Pics, 9to5Google informa el 1 de septiembre y el blog de la empresa trae el 2 de septiembre; nada sustancial, pero merece nota.

El interés del ponente está a la vista: la persona en pantalla es el gemelo digital de un directivo de una agencia SEO y el hilo está ajustado para reclutar miembros hacia la comunidad de pago AI Profit Boardroom; cifras, sesiones en directo y hojas de ruta se sirven en lenguaje de marketing. Leer las promesas de flujo de trabajo con ese filtro, y probar las demos con tus propios archivos antes de decidir, es el camino más corto y seguro.

La conclusión práctica para el lector cabe en tres gestos: esta semana, conectar un cuaderno en Docs vía @ y probar las citas en un borrador pequeño; en audio, escuchar las demos oficiales y revisar tu cuota de API; lanzar una prueba de un solo producto en pics.new. Para equipos, probar el quiz de Chrome en una lección y medir convierte el supuesto de visionado en una salida barata.

Fuentes

8 enlaces; 1 de ellos también citados por 1 otra noticia. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.

google · gemini · notebooklm · tts · google pics · chrome · google photos

Seguir el tema

Antes de esta noticia

Un breve orden de lectura de noticias anteriores vinculadas a este evento por un editor.

Evidencia y fuentes

Revisa los pasajes permitidos, sus versiones y su origen.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…