Towards a Realistic Long-Term Benchmark for Open-Web Research Agentsfuturesearch.ai1 point·theptip··0 commentsOpen articleSaveView on HN