Models
Datasets
Spaces
Posts
Docs
Enterprise
Pricing
Log In
Sign Up

Collections

Discover the best community collections!

Collections including paper arxiv:2307.08621

Retentive Network: A Successor to Transformer for Large Language Models

Paper • 2307.08621 • Published Jul 17, 2023 • 170

fla-hub/retnet-1.3B-100B

Text Generation • Updated Feb 9 • 42
fla-hub/retnet-2.7B-100B

Text Generation • Updated Feb 9 • 29 • 1
Retentive Network: A Successor to Transformer for Large Language Models

Paper • 2307.08621 • Published Jul 17, 2023 • 170

abacusai/Smaug-72B-v0.1

Text Generation • Updated Feb 23, 2024 • 284 • 468
Running on L4

903

903

ReplaceAnything

📚

Replace objects in images with new content
miqudev/miqu-1-70b

Updated Feb 4, 2024 • 504 • 986
fka/awesome-chatgpt-prompts

Viewer • Updated Jan 6 • 203 • 12.2k • 7.62k

Build error

902

902

Zephyr Chat

🪁

Chat with an AI model
Retentive Network: A Successor to Transformer for Large Language Models

Paper • 2307.08621 • Published Jul 17, 2023 • 170
fka/awesome-chatgpt-prompts

Viewer • Updated Jan 6 • 203 • 12.2k • 7.62k

Generative AI Family

The collection of generative ai with research papers, datasets and models

Attention Is All You Need

Paper • 1706.03762 • Published Jun 12, 2017 • 55
Training Generative Adversarial Networks with Limited Data

Paper • 2006.06676 • Published Jun 11, 2020
A survey of Generative AI Applications

Paper • 2306.02781 • Published Jun 5, 2023
Running on CPU Upgrade

11k

11k

Stable Diffusion 2-1

🔥

Generate images from text descriptions

Efficient Streaming Language Models with Attention Sinks

Paper • 2309.17453 • Published Sep 29, 2023 • 13
Simple and Controllable Music Generation

Paper • 2306.05284 • Published Jun 8, 2023 • 149
FinGPT: Large Generative Models for a Small Language

Paper • 2311.05640 • Published Nov 3, 2023 • 32
MEGABYTE: Predicting Million-byte Sequences with Multiscale Transformers

Paper • 2305.07185 • Published May 12, 2023 • 9

LLM architecture

The Impact of Depth and Width on Transformer Language Model Generalization

Paper • 2310.19956 • Published Oct 30, 2023 • 10
Retentive Network: A Successor to Transformer for Large Language Models

Paper • 2307.08621 • Published Jul 17, 2023 • 170
RWKV: Reinventing RNNs for the Transformer Era

Paper • 2305.13048 • Published May 22, 2023 • 17
Attention Is All You Need

Paper • 1706.03762 • Published Jun 12, 2017 • 55

Detecting Pretraining Data from Large Language Models

Paper • 2310.16789 • Published Oct 25, 2023 • 11
Let's Synthesize Step by Step: Iterative Dataset Synthesis with Large Language Models by Extrapolating Errors from Small Models

Paper • 2310.13671 • Published Oct 20, 2023 • 19
AutoMix: Automatically Mixing Language Models

Paper • 2310.12963 • Published Oct 19, 2023 • 14
An Emulator for Fine-Tuning Large Language Models using Small Language Models

Paper • 2310.12962 • Published Oct 19, 2023 • 13

Retentive Network: A Successor to Transformer for Large Language Models

Paper • 2307.08621 • Published Jul 17, 2023 • 170
LLM4SR: A Survey on Large Language Models for Scientific Research

Paper • 2501.04306 • Published Jan 8 • 35
Agent Laboratory: Using LLM Agents as Research Assistants

Paper • 2501.04227 • Published Jan 8 • 86
On the Measure of Intelligence

Paper • 1911.01547 • Published Nov 5, 2019 • 3

Interesting Musings

Retentive Network: A Successor to Transformer for Large Language Models

Paper • 2307.08621 • Published Jul 17, 2023 • 170
TabLib: A Dataset of 627M Tables with Context

Paper • 2310.07875 • Published Oct 11, 2023 • 8

Previous
1
2
Next

Company

TOS Privacy About Jobs

Website

Models Datasets Spaces Pricing Docs