Talk2arxiv: взаимодействие с научными статьями через AI чат

Talk2arxiv: взаимодействие с научными статьями через AI чат

Talk2arxiv — это инструмент, который позволяет взаимодействовать с научными статьями на arXiv и bioRxiv через AI чат на основе ChatGPT. Он позволяет удобно читать статьи и задавать вопросы, получая ответы, основанные на содержании текста.

Проект упрощает доступ к информации из статей, в отличие от большинства существующих решений, где поиск по тексту и выделение ключевых моментов — это трудоемкий процесс. С Talk2arxiv можно просто скопировать ссылку на статью и заменить её часть, чтобы начать диалог с AI, который "прочитал" всю статью. Это особенно полезно для исследователей и студентов, которым нужно быстро понять суть исследований или прояснить сложные моменты.

Запуск проекта осуществляется через веб-браузер, просто заменив arxiv.org или biorxiv.org на talk2arxiv.org или talk2biorxiv.org. Учти, что функционал может ограничиваться наличием HTML-версий статей, и если таковой нет, будет автоматически загружен PDF. Также следует отметить, что проект находится на ранней стадии, и могут возникать недочеты.

Talk2Arxiv — это веб-сервис, который позволяет читать академические статьи с arXiv и bioRxiv и общаться с ИИ, который ознакомился с содержимым этих статей. Чтобы воспользоваться сервисом, достаточно изменить "arxiv.org" на "talk2arxiv.org" в ссылке на статью. Например, вместо arxiv.org/abs/1706.03762 используй talk2arxiv.org/abs/1706.03762. Аналогично работает такая же версия для bioRxiv.

Основные функции

  • Чистый HTML-ридер. Статьи загружаются с HTML5-версии arXiv или с полной версии bioRxiv, с отображением математических формул в MathML.
  • PDF фоллбэк. Если у статьи нет HTML-версии, открывается PDF-файл, который также можно читать и задавать вопросы.
  • Выдели и спроси. Выбери текст в статье и нажми **Ask AI** или **Explain**, чтобы получить ответ от ИИ.
  • Предпросмотры цитирований. Кликни по цитате в списке литературы, чтобы увидеть её предварительный просмотр, и задай вопросы об этой статье.
  • Мобильное чтение. Удобный интерфейс, позволяющий следить за разделами и управлять чатом.
  • Локальная история. Чаты сохраняются в localStorage браузера, что позволяет возвращаться к ним позже.

Как это работает

Сервис работает на платформе Vercel, использующей React и Tailwind CSS. Все API-запросы проходят через Cloudflare Worker, который отвечает за извлечение текста статей, их PDF-версий и метаданных. Каждое взаимодействие пользователя с ИИ отправляется на backend, где обрабатывается моделью GPT-6 Luna от OpenAI.

Установка и запуск

Если ты хочешь установить и запустить Talk2Arxiv на своём локальном сервере, следуй этим шагам:

  • Устанавливай зависимости:
  • yarn
  • Скопируй шаблон конфигурации и добавь свой ключ OpenRouter:
  • cp .dev.vars.example .dev.vars
  • Запусти сервер разработки:
  • yarn dev

Ограничения

Если текст статьи слишком длинный (примерно 800К токенов), сервис выдает сообщение об ошибке. Также могут возникнуть проблемы с доступом к статьям, которые не были отрендерены в HTML на arXiv.

Этот проект ориентирован на пользователей, которым нужно удобно получать доступ к научным работам и взаимодействовать с ними через ИИ, что может значительно ускорить поиск и понимание информации в сложных текстах.

Открыть на GitHub: evanhu1/talk2arxiv →

Что нового на GitHub — короткие обзоры на русском Новые обзоры приходят в Telegram. Без спама, по делу.
Подписаться

Похожие статьи

Популярные темы на сайте