Talk2arxiv: взаимодействие с научными статьями через AI чат
Talk2arxiv — это инструмент, который позволяет взаимодействовать с научными статьями на arXiv и bioRxiv через AI чат на основе ChatGPT. Он позволяет удобно читать статьи и задавать вопросы, получая ответы, основанные на содержании текста.
Проект упрощает доступ к информации из статей, в отличие от большинства существующих решений, где поиск по тексту и выделение ключевых моментов — это трудоемкий процесс. С Talk2arxiv можно просто скопировать ссылку на статью и заменить её часть, чтобы начать диалог с AI, который "прочитал" всю статью. Это особенно полезно для исследователей и студентов, которым нужно быстро понять суть исследований или прояснить сложные моменты.
Запуск проекта осуществляется через веб-браузер, просто заменив arxiv.org или biorxiv.org на talk2arxiv.org или talk2biorxiv.org. Учти, что функционал может ограничиваться наличием HTML-версий статей, и если таковой нет, будет автоматически загружен PDF. Также следует отметить, что проект находится на ранней стадии, и могут возникать недочеты.
Talk2Arxiv — это веб-сервис, который позволяет читать академические статьи с arXiv и bioRxiv и общаться с ИИ, который ознакомился с содержимым этих статей. Чтобы воспользоваться сервисом, достаточно изменить "arxiv.org" на "talk2arxiv.org" в ссылке на статью. Например, вместо arxiv.org/abs/1706.03762 используй talk2arxiv.org/abs/1706.03762. Аналогично работает такая же версия для bioRxiv.
Основные функции
- Чистый HTML-ридер. Статьи загружаются с HTML5-версии arXiv или с полной версии bioRxiv, с отображением математических формул в MathML.
- PDF фоллбэк. Если у статьи нет HTML-версии, открывается PDF-файл, который также можно читать и задавать вопросы.
- Выдели и спроси. Выбери текст в статье и нажми **Ask AI** или **Explain**, чтобы получить ответ от ИИ.
- Предпросмотры цитирований. Кликни по цитате в списке литературы, чтобы увидеть её предварительный просмотр, и задай вопросы об этой статье.
- Мобильное чтение. Удобный интерфейс, позволяющий следить за разделами и управлять чатом.
- Локальная история. Чаты сохраняются в localStorage браузера, что позволяет возвращаться к ним позже.
Как это работает
Сервис работает на платформе Vercel, использующей React и Tailwind CSS. Все API-запросы проходят через Cloudflare Worker, который отвечает за извлечение текста статей, их PDF-версий и метаданных. Каждое взаимодействие пользователя с ИИ отправляется на backend, где обрабатывается моделью GPT-6 Luna от OpenAI.
Установка и запуск
Если ты хочешь установить и запустить Talk2Arxiv на своём локальном сервере, следуй этим шагам:
- Устанавливай зависимости:
yarn
cp .dev.vars.example .dev.vars
yarn dev
Ограничения
Если текст статьи слишком длинный (примерно 800К токенов), сервис выдает сообщение об ошибке. Также могут возникнуть проблемы с доступом к статьям, которые не были отрендерены в HTML на arXiv.
Этот проект ориентирован на пользователей, которым нужно удобно получать доступ к научным работам и взаимодействовать с ними через ИИ, что может значительно ускорить поиск и понимание информации в сложных текстах.
Открыть на GitHub: evanhu1/talk2arxiv →
RepoRadar