Ir al contenido
Menú principal
Menú principal
mover a la barra lateral
ocultar
Navegación
Página principal
Cambios recientes
Página aleatoria
Ayuda sobre MediaWiki
Buscar
Buscar
español
Apariencia
Crear una cuenta
Acceder
Herramientas personales
No has accedido
Discusión
Contribuciones
Crear una cuenta
Acceder
Edición de «
OpenAssistant
»
Página
Discusión
español
Leer
Editar
Editar código
Ver historial
Herramientas
Herramientas
mover a la barra lateral
ocultar
Acciones
Leer
Editar
Editar código
Ver historial
General
Lo que enlaza aquí
Cambios relacionados
Información de la página
Apariencia
mover a la barra lateral
ocultar
Advertencia:
no has iniciado sesión. Tu dirección IP se hará pública si haces cualquier edición. Si
inicias sesión
o
creas una cuenta
, tus ediciones se atribuirán a tu nombre de usuario, además de otros beneficios.
Comprobación antispam. ¡
No
rellenes esto!
{| class="infobox vevent" |+ class="infobox-title summary" id="4" |OpenAssistant | colspan="2" class="infobox-image logo" |[[File:Open-Assistant-logo.svg|sinmarco]] |- ! class="infobox-label" scope="row" style="white-space: nowrap;" |Programadores | class="infobox-data" |[[LAION]] y colaboradores |- ! class="infobox-label" scope="row" style="white-space: nowrap;" |Publicación | class="infobox-data" |15 de abril de 2023<span style="display:none">(<span class="bday dtstart published updated">2023-04-15</span>)</span> |- ! class="infobox-label" scope="row" style="white-space: nowrap;" |Categoría de software | class="infobox-data" |<div class="plainlist " style=" margin-left:1em;text-indent:-1em;"> * Modelo de lenguaje * grande. * Transformador * preentrenado * generativo. * Bot conversacional </div> |- ! class="infobox-label" scope="row" style="white-space: nowrap;" |Licencia | class="infobox-data" |[[Apache License|Apache License 2.0]] |- ! class="infobox-label" scope="row" style="white-space: nowrap;" |Website | class="infobox-data" |<span class="url">[https://open-assistant.io open-assistant.io]</span> |} '''OpenAssistant''' es un asistente basado en chat [[Sistema de código abierto|de código abierto]] [[Inteligencia artificial|de inteligencia artificial]] (AI) que comprende tareas, puede interactuar con sistemas de terceros y recuperar información dinámicamente para hacerlo.<ref name="Sin_nombre-20230526131929">{{Obra citada|título=Open-Assistant|url=https://github.com/LAION-AI/Open-Assistant|fechaacceso=2023-03-09|fecha=2023-03-09|editorial=LAION AI}}</ref><ref name=":0">Köpf, Andreas; Kilcher, Yannic; von Rütte, Dimitri; Anagnostidis, Sotiris; Tam, Zhi-Rui; Stevens, Keith; Barhoum, Abdullah; Duc, Nguyen Minh; Stanley, Oliver; Nagyfi, Richárd; ES, Shahul; Suri, Sameer; Glushkov, David; Dantuluri, Arnav; Maguire, Andrew (2023-04-14). "OpenAssistant Conversations -- Democratizing Large Language Model Alignment". arXiv:[[arxiv:2304.07327|2304.07327]] [cs.CL].</ref> El proyecto está desarrollado por un grupo de voluntarios en colaboración con [[LAION (Large-scale Artificial Intelligence Open Network)|LAION]]. Uno de los objetivos de desarrollo incluye el acceso gratuito a [[LLM (modelo grande de lenguaje)|modelos grandes de lenguaje]] que se pueden ejecutar localmente en hardware de consumo.<ref name="Sin_nombre-20230526131929"/> El proyecto está respaldado por un esfuerzo mundial de [[Crowdsourcing|colaboración abierta distribuida]] que involucra a más de 13 500 voluntarios que han creado 600 000 puntos de datos generados por humanos.<ref name=":0" /><ref name=":1">{{Cita web|url=https://laion-ai.github.io/Open-Assistant/blog/2023/04/15/open-assistant-released|título=OpenAssistant RELEASED! The world's best open-source Chat AI! {{!}} Open Assistant|fechaacceso=2023-05-05|fecha=2023-04-15|sitioweb=laion-ai.github.io|idioma=en}}</ref><ref>{{Cita web|url=https://www.kdnuggets.com/open-assistant-explore-the-possibilities-of-open-and-collaborative-chatbot-development.html|título=Open Assistant: Explore the Possibilities of Open and Collaborative Chatbot Development|fechaacceso=2023-05-05|sitioweb=KDnuggets|idioma=en-US}}</ref><ref>{{Cita web|url=https://www.marktechpost.com/2023/04/21/meet-openassistant-an-open-source-chat-model-that-consists-of-a-161k-human-generated-human-annotated-assistant-style-conversation-corpus-including-35-different-languages/|título=Meet OpenAssistant: An open-source chat model That consists of a ~161K human-generated, human-annotated assistant-style conversation corpus, including 35 different languages|fechaacceso=2023-05-05|autor=Shenwai|nombre=Dhanshree Shripad|fecha=2023-04-21|sitioweb=MarkTechPost|idioma=en-US}}</ref> == Desarrollo == Los desarrolladores de OpenAssistant intentaban obtener un [[producto viable mínimo]] inicial siguiendo los tres pasos descritos en el documento de [[arxiv:2203.02155|InstructGPT]].<ref>{{Cita web|url=https://arxiv.org/abs/2203.02155|título=Training language models to follow instructions with human feedback|títulotrad=Entrenamiento de modelos de lenguaje para seguir instrucciones con retroalimentación humana|fechaacceso=16-5-2023|autor=Long Ouyang, Jeff Wu, Xu Jiang, Diogo Almeida, Carroll L. Wainwright, Pamela Mishkin, Chong Zhang, Sandhini Agarwal, Katarina Slama, Alex Ray, John Schulman, Jacob Hilton, Fraser Kelton, Luke Miller, Maddie Simens, Amanda Askell, Peter Welinder, Paul Christiano, Jan Leike, Ryan Lowe|fecha=4-3-2022|sitioweb=Universidad Cornell|idioma=en}}</ref><ref>{{Cita arXiv|last1=Ouyang|first1=Long|last2=Wu|first2=Jeff|last3=Jiang|first3=Xu|last4=Almeida|first4=Diogo|last5=Wainwright|first5=Carroll L.|last6=Mishkin|first6=Pamela|last7=Zhang|first7=Chong|last8=Agarwal|first8=Sandhini|last9=Slama|first9=Katarina|date=2022-03-04|title=Training language models to follow instructions with human feedback|class=cs.CL|eprint=2203.02155}}</ref> # Recopilación de muestras de cumplimiento de instrucciones de alta calidad generadas por [[Aprendizaje por refuerzo a partir de retroalimentación humana|humanos]] (mensaje + respuesta), con el objetivo de alcanzar más de 50.000 muestras de este tipo. Luego, diseñar un proceso colaborativo para recopilar y revisar las indicaciones. Para evitar capacitaciones sobre [[inundación de red]], temas tóxicos, spam, basura (junk data), datos de información personal, los desarrolladores tienen una tabla de clasificación para motivar a la comunidad de voluntarios, que muestra el progreso y los usuarios más activos. # Muestreo de múltiples finalizaciones para cada una de las indicaciones recopiladas. Se muestra luego aleatoriamente a los usuarios la finalización de un aviso (prompt) para clasificarlos de mejor a peor. Se deben recopilar múltiples votos de usuarios independientes para medir el acuerdo general. Los datos de clasificación recopilados se utilizarán para entrenar un modelo de recompensa. # Seguimiento de la fase de entrenamiento RLHF<ref group="N">En el aprendizaje automático, el aprendizaje por refuerzo a partir de la retroalimentación humana (RLHF) o el aprendizaje por refuerzo a partir de las preferencias humanas es una técnica que entrena un "modelo de recompensa" directamente a partir de la retroalimentación humana y lo utiliza como una función de recompensa para optimizar la política de un agente mediante el aprendizaje por refuerzo (RL). ) a través de un algoritmo de optimización.</ref> basada en las indicaciones y el modelo de recompensa. A continuación, se obtendrá el modelo resultante y se continuará con el paso de muestreo completo, es decir, el segundo paso anterior para la siguiente [[iteración]].<ref name="Sin_nombre-20230526131929"/> === Estado del desarrollo === El 10 de marzo de 2023, los primeros modelos de OpenAssistant comenzaron a generar respuestas a las indicaciones de capacitación en el sitio web de OpenAssistant. Estas respuestas estaban abiertas para la clasificación del paso dos del documento InstructGPT anterior. Estos datos se introducirán en la base de datos de entrenamiento. Los modelos son específicamente iteraciones de modelos deduplicados de pythia-6.9B.<ref>{{Cita web|url=https://arxiv.org/pdf/2304.01373.pdf|título=Pythia: A Suite for Analyzing Large Language Models Across Training and Scaling|títulotrad=Pythia: Una suite para analizar modelos de lenguaje grande a través del entrenamiento y escalamiento|fechaacceso=16-5-2023|autor=Stella Biderman, Hailey Schoelkopf, Quentin Anthony, Herbie Bradley, Kyle O’Brien, Eric Hallahan, Mohammad Aflah Khan, Shivanshu Purohit, Sai Prashanth, Edward Raff, Aviya Skowron, Lintang Sutawika, Oskar van der Wal|fecha=3-4-2023|idioma=en}}</ref><ref>{{Cita web|url=https://huggingface.co/EleutherAI/pythia-6.9b-deduped-v0|título=EleutherAI/pythia-6.9b-deduped-v0|fechaacceso=16-5-2023}}</ref> OpenAssistant se hizo público el 15 de abril de 2023.<ref name=":1" /> A partir del 11 de mayo de 2023, Open Assistant apoya 40 idiomas, incluidos [[Idioma catalán|catalán]], [[Idioma austro-bávaro|bávaro]], [[esperanto]] y [[Euskera|vasco]] . == Notas == {{listaref|group=N}} == Referencias == {{listaref|2}} {{Control de autoridades}} [[Categoría:Software de 2023]] [[Categoría:Aplicaciones de la inteligencia artificial]] [[Categoría:Asistentes virtuales]] [[Categoría:Modelos de lenguaje de gran tamaño]] [[Categoría:Bots conversacionales]]
Resumen:
Al guardar los cambios aceptas los
términos de uso
y liberas de forma irrevocable tu contribución conforme a los términos de las licencias
licencia CC BY-SA 4.0
y
GFDL
. Aceptas igualmente que un hipervínculo o URL es atribución suficiente conforme a la licencia Creative Commons.
Cancelar
Ayuda de edición
(se abre en una ventana nueva)
Buscar
Buscar
Edición de «
OpenAssistant
»
Añadir idiomas
Añadir tema